Definition Parabacteroides distasonis ATCC 8503 chromosome, complete genome.
Accession NC_009615
Length 4,811,379

Click here to switch to the map view.

The map label for this gene is exuT [H]

Identifier: 150009530

GI number: 150009530

Start: 3519374

End: 3520624

Strand: Direct

Name: exuT [H]

Synonym: BDI_2943

Alternate gene names: 150009530

Gene position: 3519374-3520624 (Clockwise)

Preceding gene: 150009529

Following gene: 150009531

Centisome position: 73.15

GC content: 46.92

Gene sequence:

>1251_bases
ATGAAAAATAAGAAATTATATCCTTGGATCGTAGTCGGTTTACTATGGGTTGTCGCCTTACTGAACTATATGGATCGCCA
GATGCTATCAACCATGAAATCAGCTATGATGGTGGATATCGTGGAACTAGAGTCTGCGGCGAACTTCGGACGTTTGATGG
CGGTCTTCCTCTGGATCTACGGATTCATGAGCCCTGTAGCCGGTATGGTGGCAGACAGGGTAAACAGGAAGTGGCTAATC
GTGGGTAGCTTATTTGTCTGGTCCTTCGTGACTTTGATGATGGGGTATTGCACGGATTTCAATCAGATCTATTACCTACG
TGCCTTGATGGGGGTCAGTGAGGCCCTGTATATTCCTGCCGGATTATCGCTTATCACAGATTATCACCAAGAGAAAACAC
GCTCATTAGCCGTAGGTATCCATATGACAGGTCTATACGTAGGCCAAGCCTTGGGGGGATTCGGAGCTACGGTGGCCAGC
GCTTATACGTGGGAAACGACTTTCCATTGGTTTGGTATCATCGGCATCGCTTATAGCGTGGTCTTGATCATCTTCTTACA
CGATAAGAAAGATCATGTGGAACAAGCCGTAAAACTGGAAAATTATCCGAAAGAGAATCCGATTTCCGGTGCGTTTAAAG
GATTAGGGATGTTATTCACGAACATCGCTTTTTGGATCATTCTTCTTTATTTCGCCACGCCGAGCTTACCGGGTTGGGCG
ACAAAGAACTGGCTCCCTACCCTATTCGCTGAAAATCTCTCGTTGGATATGTCCGAGGCCGGTCCGTTATCTACATTCAC
GATCGCTATCTCTTCCTTTATAGGGGTAATCGCCGGAGGTATTTTATCCGATAAATGGATCCAGCGGAATGTCCGGGGAC
GTGTATACACAGGCGCCATCGGTTTGGCATTAACGATACCCTCTCTCCTATTACTAGGATTTGGGCACAACTTCCCGATG
ATTATCGGCGGTGGTCTTTGCTTCGGTATCGGTTATGGTATATTCGACGCCAATAATATGCCTATCCTTTGCCAATTCAT
CTCCCCCCGTTATCGGGCTACAGCCTATGGAATTATGAATATGACCGGTGTATTTGCCGGAGCCGCCATCACGGATATAC
TAGGAAAATCTACCGACGCTGGTAATCTTGGCCATGACTTCGCCATGCTAGCCGGATTGGTACTCATCGCACTTTTAATC
CAAGTGATCTTCTTACGTCCGAAAGTCGCTAATATGACCGACGAATGCTAA

Upstream 100 bases:

>100_bases
TATCTAAAATACTGAAAATTGGTCAATTGACATCAGGGGTCACAACCGTGGCTCCTGATGTTTCTAAGGCTTTGTTTTCC
TTTTTATTTTCCTCAATCAA

Downstream 100 bases:

>100_bases
TTAATCTCATCCAATAAACTAAATAAACAACAAAAAAGTAATTCATTATGAAGAAGAATCTACTGCTCTTAATGCTTGCG
CTCCTACTTCCGGCATTTAT

Product: major facilitator family transporter

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 416; Mature: 416

Protein sequence:

>416_residues
MKNKKLYPWIVVGLLWVVALLNYMDRQMLSTMKSAMMVDIVELESAANFGRLMAVFLWIYGFMSPVAGMVADRVNRKWLI
VGSLFVWSFVTLMMGYCTDFNQIYYLRALMGVSEALYIPAGLSLITDYHQEKTRSLAVGIHMTGLYVGQALGGFGATVAS
AYTWETTFHWFGIIGIAYSVVLIIFLHDKKDHVEQAVKLENYPKENPISGAFKGLGMLFTNIAFWIILLYFATPSLPGWA
TKNWLPTLFAENLSLDMSEAGPLSTFTIAISSFIGVIAGGILSDKWIQRNVRGRVYTGAIGLALTIPSLLLLGFGHNFPM
IIGGGLCFGIGYGIFDANNMPILCQFISPRYRATAYGIMNMTGVFAGAAITDILGKSTDAGNLGHDFAMLAGLVLIALLI
QVIFLRPKVANMTDEC

Sequences:

>Translated_416_residues
MKNKKLYPWIVVGLLWVVALLNYMDRQMLSTMKSAMMVDIVELESAANFGRLMAVFLWIYGFMSPVAGMVADRVNRKWLI
VGSLFVWSFVTLMMGYCTDFNQIYYLRALMGVSEALYIPAGLSLITDYHQEKTRSLAVGIHMTGLYVGQALGGFGATVAS
AYTWETTFHWFGIIGIAYSVVLIIFLHDKKDHVEQAVKLENYPKENPISGAFKGLGMLFTNIAFWIILLYFATPSLPGWA
TKNWLPTLFAENLSLDMSEAGPLSTFTIAISSFIGVIAGGILSDKWIQRNVRGRVYTGAIGLALTIPSLLLLGFGHNFPM
IIGGGLCFGIGYGIFDANNMPILCQFISPRYRATAYGIMNMTGVFAGAAITDILGKSTDAGNLGHDFAMLAGLVLIALLI
QVIFLRPKVANMTDEC
>Mature_416_residues
MKNKKLYPWIVVGLLWVVALLNYMDRQMLSTMKSAMMVDIVELESAANFGRLMAVFLWIYGFMSPVAGMVADRVNRKWLI
VGSLFVWSFVTLMMGYCTDFNQIYYLRALMGVSEALYIPAGLSLITDYHQEKTRSLAVGIHMTGLYVGQALGGFGATVAS
AYTWETTFHWFGIIGIAYSVVLIIFLHDKKDHVEQAVKLENYPKENPISGAFKGLGMLFTNIAFWIILLYFATPSLPGWA
TKNWLPTLFAENLSLDMSEAGPLSTFTIAISSFIGVIAGGILSDKWIQRNVRGRVYTGAIGLALTIPSLLLLGFGHNFPM
IIGGGLCFGIGYGIFDANNMPILCQFISPRYRATAYGIMNMTGVFAGAAITDILGKSTDAGNLGHDFAMLAGLVLIALLI
QVIFLRPKVANMTDEC

Specific function: Aldohexuronate transport system [H]

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cell membrane; Multi-pass membrane protein [H]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the major facilitator superfamily. Phthalate permease family [H]

Homologues:

Organism=Escherichia coli, GI2367379, Length=256, Percent_Identity=26.5625, Blast_Score=82, Evalue=5e-17,
Organism=Escherichia coli, GI1789515, Length=306, Percent_Identity=23.8562091503268, Blast_Score=81, Evalue=1e-16,
Organism=Escherichia coli, GI1789152, Length=331, Percent_Identity=25.0755287009063, Blast_Score=74, Evalue=2e-14,
Organism=Escherichia coli, GI87082320, Length=292, Percent_Identity=22.6027397260274, Blast_Score=69, Evalue=6e-13,
Organism=Caenorhabditis elegans, GI71992409, Length=431, Percent_Identity=24.8259860788863, Blast_Score=73, Evalue=2e-13,
Organism=Caenorhabditis elegans, GI193209775, Length=416, Percent_Identity=21.6346153846154, Blast_Score=72, Evalue=7e-13,
Organism=Caenorhabditis elegans, GI17569727, Length=295, Percent_Identity=24.0677966101695, Blast_Score=68, Evalue=1e-11,
Organism=Caenorhabditis elegans, GI17557872, Length=409, Percent_Identity=23.2273838630807, Blast_Score=67, Evalue=1e-11,
Organism=Drosophila melanogaster, GI17864456, Length=222, Percent_Identity=26.5765765765766, Blast_Score=71, Evalue=1e-12,
Organism=Drosophila melanogaster, GI24654039, Length=222, Percent_Identity=26.5765765765766, Blast_Score=71, Evalue=1e-12,
Organism=Drosophila melanogaster, GI24654041, Length=222, Percent_Identity=26.5765765765766, Blast_Score=71, Evalue=1e-12,
Organism=Drosophila melanogaster, GI24654044, Length=219, Percent_Identity=26.9406392694064, Blast_Score=71, Evalue=1e-12,
Organism=Drosophila melanogaster, GI24654037, Length=222, Percent_Identity=26.5765765765766, Blast_Score=71, Evalue=1e-12,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR004744
- InterPro:   IPR020846
- InterPro:   IPR011701
- InterPro:   IPR016196 [H]

Pfam domain/function: PF07690 MFS_1 [H]

EC number: NA

Molecular weight: Translated: 45760; Mature: 45760

Theoretical pI: Translated: 8.28; Mature: 8.28

Prosite motif: PS50850 MFS

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.0 %Cys     (Translated Protein)
5.0 %Met     (Translated Protein)
6.0 %Cys+Met (Translated Protein)
1.0 %Cys     (Mature Protein)
5.0 %Met     (Mature Protein)
6.0 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKNKKLYPWIVVGLLWVVALLNYMDRQMLSTMKSAMMVDIVELESAANFGRLMAVFLWIY
CCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHH
GFMSPVAGMVADRVNRKWLIVGSLFVWSFVTLMMGYCTDFNQIYYLRALMGVSEALYIPA
HHHHHHHHHHHHHCCCCEEEEHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHCCCC
GLSLITDYHQEKTRSLAVGIHMTGLYVGQALGGFGATVASAYTWETTFHWFGIIGIAYSV
CHHHHHHHHHHHHHHEEEEEEHHHHHHHHHHHCHHHHHHHHEEHHHHHHHHHHHHHHHHH
VLIIFLHDKKDHVEQAVKLENYPKENPISGAFKGLGMLFTNIAFWIILLYFATPSLPGWA
HHHHHCCCCHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCC
TKNWLPTLFAENLSLDMSEAGPLSTFTIAISSFIGVIAGGILSDKWIQRNVRGRVYTGAI
CCCCHHHHHHHCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEECHH
GLALTIPSLLLLGFGHNFPMIIGGGLCFGIGYGIFDANNMPILCQFISPRYRATAYGIMN
HHHHHHHHHHHHHCCCCCCEEEECHHHHHHHHCEECCCCCCEEEEECCCCHHHHHHHHHH
MTGVFAGAAITDILGKSTDAGNLGHDFAMLAGLVLIALLIQVIFLRPKVANMTDEC
HHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCC
>Mature Secondary Structure
MKNKKLYPWIVVGLLWVVALLNYMDRQMLSTMKSAMMVDIVELESAANFGRLMAVFLWIY
CCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHH
GFMSPVAGMVADRVNRKWLIVGSLFVWSFVTLMMGYCTDFNQIYYLRALMGVSEALYIPA
HHHHHHHHHHHHHCCCCEEEEHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHCCCC
GLSLITDYHQEKTRSLAVGIHMTGLYVGQALGGFGATVASAYTWETTFHWFGIIGIAYSV
CHHHHHHHHHHHHHHEEEEEEHHHHHHHHHHHCHHHHHHHHEEHHHHHHHHHHHHHHHHH
VLIIFLHDKKDHVEQAVKLENYPKENPISGAFKGLGMLFTNIAFWIILLYFATPSLPGWA
HHHHHCCCCHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCC
TKNWLPTLFAENLSLDMSEAGPLSTFTIAISSFIGVIAGGILSDKWIQRNVRGRVYTGAI
CCCCHHHHHHHCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEECHH
GLALTIPSLLLLGFGHNFPMIIGGGLCFGIGYGIFDANNMPILCQFISPRYRATAYGIMN
HHHHHHHHHHHHHCCCCCCEEEECHHHHHHHHCEECCCCCCEEEEECCCCHHHHHHHHHH
MTGVFAGAAITDILGKSTDAGNLGHDFAMLAGLVLIALLIQVIFLRPKVANMTDEC
HHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 9579062; 9384377 [H]