The gene/protein map for NC_008820 is currently unavailable.
Definition Prochlorococcus marinus str. MIT 9303, complete genome.
Accession NC_008820
Length 2,682,675

Click here to switch to the map view.

The map label for this gene is ybeC [H]

Identifier: 124022790

GI number: 124022790

Start: 968423

End: 969967

Strand: Reverse

Name: ybeC [H]

Synonym: P9303_10831

Alternate gene names: 124022790

Gene position: 969967-968423 (Counterclockwise)

Preceding gene: 124022791

Following gene: 124022789

Centisome position: 36.16

GC content: 54.76

Gene sequence:

>1545_bases
ATGGGACTGCGCAAGGAACTAAACCTCACCTCCCTAACCATGGCAGTGGTGACAGGCACCATCGGTTCTGGTTGGCTTTT
CGCTCCCTACTTTGCTGCACAACTGGCTGGAGCAGGCAGCCTGCTGGCATGGCTGCTGGGCGGTTTTTTAGCCTTACTGC
TGGCCTTGGTGTTTGCAGAACTCGGATCGCTTGTCCCCAACTCGGGCGCACTGGCGCAAATCCCTCTGCTGACTCATGGG
CGACTGTCAGGATTCATCGGCGGATGGAGCGTATGGCTTTCTTACGTCACCATACCGACCATAGAACTACTCGCCCTACT
GCAATATTTATCAAGCAGCCTCCCTTGGCTTACGCACGTCCAAGGCAACCGTCAGCTACTCAGTCCCGCGGGTCAGATTG
TCGCCGTGATTCTGCTGGTCTTGCTTTGCTGGATCAACCTGCTTGGAGTGCAAACCCTTTCGCGCTGGATCAACCTGCTC
ACAGCCTGGAAACTGATCGTTCCAGTTTTGGTGTCGATTGTGCTCATGGTTATCAGCAGTCACTGGAGCAACCTTGCGGT
ACCTGTTGGCGGTGATGGTGCTGATGTAGTACGTGCTGTAGGTAGTGGAGGGATCTTATTCAGCCTACTGGGATTCCGTA
CTGCGATGGATCTTGCTGGCGAAGCACGTAAGCCGGCTAGGGACGTCCCTCTTGCAATGGCCACAGGCCTAGGCATCTGC
CTACTGCTCTATATCACCCTACAGCTCAGTTTTCTAATCAGCGTGCCACCCACCGAGCTTGGCAACGGTTGGCATGGCCT
AATGCTCAGCGCCCATGGCGGGCCGGTGGTGGCTCTTGCAATGGGTTTCGGCCTTGGATGGATGGTGATTATTCTTCTGG
TGGATGCATTGGTCTCGCCCGGGGCCACAGCTCTTAATTACATGGGTGTCTCTGCCCGGATCATCTGGATGATGGGGAAG
TGTGGGCTCTTGCCTAAAGCTCTCGGACGGCTCAATCATCAGGACGTCCCTCATGTAGCCATAACGCTGAGCATGGTTGT
TAGTGCACTGATGCTCGCGATTGGACCAGGGTGGCAGACAGTCGTCAACTTCTTAACCACAACTTTGATTATCGCCCTAG
CAACCGGACCTGTGAGCTTGCTGGCCCTGCGCCGGCAGATGCCTGATGCGCATCGAGGGTACCGGCTACCAATGGCGGAT
TGGATTTGCCGTCTTGCGTTCGTAACGGCTACATGGTCAATCAGCTGGTGCGGGCGAACTGCTCTAGAGGGTTCCGTTGT
CTGCATCGCTATCCCCACATTAATCTTCGCTGCGGGTCGCTGTTGGCAAGAGAATGGAATGGAAGTACGTCCAGCACTTT
GGTGGGCGCTCTATCTCGGTCTTTTGGTAGGCGATCTGCAACTTTTCAGTGAAGGGCAGCCTTTGGCACTCCCAACACCT
GCAAATATGGCTGTTTTGGCGGTGATGGCATTGATCGTTCTACCTATAGCGGTTGGAAGCGCCCTACCGGAAAAATCACC
TCACGCTTTACTTGGAACTGAATAA

Upstream 100 bases:

>100_bases
AACTACATCCAATTACCTTGACGGCAAAGAATAACAAAAAAGACTGGCAACAATGTTTAGCTTCTTAGCTTGAACAGCAT
GACGGTATTGACACGCATTT

Downstream 100 bases:

>100_bases
GAACCTGCTTAAAAGCTTCATTTTATGCACATATAAGAGCAGGCAATGATCTAAAGAGTTGCAATATGGATGATAGTTGT
CATTGAAAATAAATTTACTT

Product: hypothetical protein

Products: L-tryptophan [Cytoplasm]; Proton [Cytoplasm]; Proton [Cytoplasm]; L-tyrosine [Cytoplasm]; Proton [Cytoplasm]; L-phenylalanine [Cytoplasm] [C]

Alternate protein names: NA

Number of amino acids: Translated: 514; Mature: 513

Protein sequence:

>514_residues
MGLRKELNLTSLTMAVVTGTIGSGWLFAPYFAAQLAGAGSLLAWLLGGFLALLLALVFAELGSLVPNSGALAQIPLLTHG
RLSGFIGGWSVWLSYVTIPTIELLALLQYLSSSLPWLTHVQGNRQLLSPAGQIVAVILLVLLCWINLLGVQTLSRWINLL
TAWKLIVPVLVSIVLMVISSHWSNLAVPVGGDGADVVRAVGSGGILFSLLGFRTAMDLAGEARKPARDVPLAMATGLGIC
LLLYITLQLSFLISVPPTELGNGWHGLMLSAHGGPVVALAMGFGLGWMVIILLVDALVSPGATALNYMGVSARIIWMMGK
CGLLPKALGRLNHQDVPHVAITLSMVVSALMLAIGPGWQTVVNFLTTTLIIALATGPVSLLALRRQMPDAHRGYRLPMAD
WICRLAFVTATWSISWCGRTALEGSVVCIAIPTLIFAAGRCWQENGMEVRPALWWALYLGLLVGDLQLFSEGQPLALPTP
ANMAVLAVMALIVLPIAVGSALPEKSPHALLGTE

Sequences:

>Translated_514_residues
MGLRKELNLTSLTMAVVTGTIGSGWLFAPYFAAQLAGAGSLLAWLLGGFLALLLALVFAELGSLVPNSGALAQIPLLTHG
RLSGFIGGWSVWLSYVTIPTIELLALLQYLSSSLPWLTHVQGNRQLLSPAGQIVAVILLVLLCWINLLGVQTLSRWINLL
TAWKLIVPVLVSIVLMVISSHWSNLAVPVGGDGADVVRAVGSGGILFSLLGFRTAMDLAGEARKPARDVPLAMATGLGIC
LLLYITLQLSFLISVPPTELGNGWHGLMLSAHGGPVVALAMGFGLGWMVIILLVDALVSPGATALNYMGVSARIIWMMGK
CGLLPKALGRLNHQDVPHVAITLSMVVSALMLAIGPGWQTVVNFLTTTLIIALATGPVSLLALRRQMPDAHRGYRLPMAD
WICRLAFVTATWSISWCGRTALEGSVVCIAIPTLIFAAGRCWQENGMEVRPALWWALYLGLLVGDLQLFSEGQPLALPTP
ANMAVLAVMALIVLPIAVGSALPEKSPHALLGTE
>Mature_513_residues
GLRKELNLTSLTMAVVTGTIGSGWLFAPYFAAQLAGAGSLLAWLLGGFLALLLALVFAELGSLVPNSGALAQIPLLTHGR
LSGFIGGWSVWLSYVTIPTIELLALLQYLSSSLPWLTHVQGNRQLLSPAGQIVAVILLVLLCWINLLGVQTLSRWINLLT
AWKLIVPVLVSIVLMVISSHWSNLAVPVGGDGADVVRAVGSGGILFSLLGFRTAMDLAGEARKPARDVPLAMATGLGICL
LLYITLQLSFLISVPPTELGNGWHGLMLSAHGGPVVALAMGFGLGWMVIILLVDALVSPGATALNYMGVSARIIWMMGKC
GLLPKALGRLNHQDVPHVAITLSMVVSALMLAIGPGWQTVVNFLTTTLIIALATGPVSLLALRRQMPDAHRGYRLPMADW
ICRLAFVTATWSISWCGRTALEGSVVCIAIPTLIFAAGRCWQENGMEVRPALWWALYLGLLVGDLQLFSEGQPLALPTPA
NMAVLAVMALIVLPIAVGSALPEKSPHALLGTE

Specific function: Uptake of an yet unknown amino-acid with the concomitant import of a proton [H]

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cell membrane; Multi-pass membrane protein (Potential) [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the amino acid-polyamine-organocation (APC) superfamily. AGT (TC 2.A.3.11) family [H]

Homologues:

Organism=Homo sapiens, GI115648063, Length=439, Percent_Identity=24.373576309795, Blast_Score=68, Evalue=2e-11,
Organism=Homo sapiens, GI115648022, Length=439, Percent_Identity=24.373576309795, Blast_Score=68, Evalue=2e-11,
Organism=Homo sapiens, GI258645169, Length=403, Percent_Identity=23.8213399503722, Blast_Score=67, Evalue=5e-11,
Organism=Homo sapiens, GI258614005, Length=403, Percent_Identity=23.0769230769231, Blast_Score=66, Evalue=1e-10,
Organism=Homo sapiens, GI258614003, Length=403, Percent_Identity=23.0769230769231, Blast_Score=66, Evalue=1e-10,
Organism=Escherichia coli, GI1786302, Length=432, Percent_Identity=23.6111111111111, Blast_Score=80, Evalue=3e-16,
Organism=Escherichia coli, GI1788480, Length=421, Percent_Identity=25.8907363420428, Blast_Score=77, Evalue=2e-15,
Organism=Escherichia coli, GI1790653, Length=437, Percent_Identity=21.5102974828375, Blast_Score=66, Evalue=5e-12,
Organism=Caenorhabditis elegans, GI17540018, Length=416, Percent_Identity=24.7596153846154, Blast_Score=90, Evalue=3e-18,
Organism=Caenorhabditis elegans, GI17532491, Length=407, Percent_Identity=23.5872235872236, Blast_Score=71, Evalue=1e-12,
Organism=Caenorhabditis elegans, GI17568033, Length=418, Percent_Identity=24.4019138755981, Blast_Score=69, Evalue=6e-12,
Organism=Drosophila melanogaster, GI24667468, Length=413, Percent_Identity=24.455205811138, Blast_Score=82, Evalue=7e-16,
Organism=Drosophila melanogaster, GI45550968, Length=411, Percent_Identity=25.3041362530414, Blast_Score=78, Evalue=2e-14,
Organism=Drosophila melanogaster, GI19921172, Length=411, Percent_Identity=25.3041362530414, Blast_Score=78, Evalue=2e-14,
Organism=Drosophila melanogaster, GI24666159, Length=423, Percent_Identity=22.6950354609929, Blast_Score=75, Evalue=1e-13,
Organism=Drosophila melanogaster, GI221512776, Length=423, Percent_Identity=22.6950354609929, Blast_Score=75, Evalue=1e-13,
Organism=Drosophila melanogaster, GI221331183, Length=420, Percent_Identity=23.5714285714286, Blast_Score=71, Evalue=2e-12,
Organism=Drosophila melanogaster, GI17647653, Length=420, Percent_Identity=23.5714285714286, Blast_Score=71, Evalue=2e-12,
Organism=Drosophila melanogaster, GI24664379, Length=420, Percent_Identity=23.5714285714286, Blast_Score=71, Evalue=2e-12,
Organism=Drosophila melanogaster, GI21357367, Length=415, Percent_Identity=24.8192771084337, Blast_Score=69, Evalue=9e-12,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR004841
- InterPro:   IPR002293 [H]

Pfam domain/function: PF00324 AA_permease [H]

EC number: NA

Molecular weight: Translated: 54473; Mature: 54342

Theoretical pI: Translated: 8.49; Mature: 8.49

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.4 %Cys     (Translated Protein)
3.5 %Met     (Translated Protein)
4.9 %Cys+Met (Translated Protein)
1.4 %Cys     (Mature Protein)
3.3 %Met     (Mature Protein)
4.7 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MGLRKELNLTSLTMAVVTGTIGSGWLFAPYFAAQLAGAGSLLAWLLGGFLALLLALVFAE
CCCCCCCCHHHHHHHHHHCCCCCCCHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHH
LGSLVPNSGALAQIPLLTHGRLSGFIGGWSVWLSYVTIPTIELLALLQYLSSSLPWLTHV
HHHCCCCCCCEEECCCEECCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEEC
QGNRQLLSPAGQIVAVILLVLLCWINLLGVQTLSRWINLLTAWKLIVPVLVSIVLMVISS
CCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
HWSNLAVPVGGDGADVVRAVGSGGILFSLLGFRTAMDLAGEARKPARDVPLAMATGLGIC
CCCCEEEECCCCHHHHHHHHCCCHHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHH
LLLYITLQLSFLISVPPTELGNGWHGLMLSAHGGPVVALAMGFGLGWMVIILLVDALVSP
HHHHHHHHHHHHEECCCHHHCCCCEEEEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHCC
GATALNYMGVSARIIWMMGKCGLLPKALGRLNHQDVPHVAITLSMVVSALMLAIGPGWQT
CCHHHHHCCHHHHHHEECCCCCCCHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHCCCHHH
VVNFLTTTLIIALATGPVSLLALRRQMPDAHRGYRLPMADWICRLAFVTATWSISWCGRT
HHHHHHHHHHHHHHCCHHHHHHHHHHCCCHHCCCCCCHHHHHHHHHHHHHHEEEECCCCH
ALEGSVVCIAIPTLIFAAGRCWQENGMEVRPALWWALYLGLLVGDLQLFSEGQPLALPTP
HCCCCCCEEHHHHHHHHHCCHHHCCCCEEHHHHHHHHHHHHHHHHHHHHCCCCCEECCCC
ANMAVLAVMALIVLPIAVGSALPEKSPHALLGTE
CHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCC
>Mature Secondary Structure 
GLRKELNLTSLTMAVVTGTIGSGWLFAPYFAAQLAGAGSLLAWLLGGFLALLLALVFAE
CCCCCCCHHHHHHHHHHCCCCCCCHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHH
LGSLVPNSGALAQIPLLTHGRLSGFIGGWSVWLSYVTIPTIELLALLQYLSSSLPWLTHV
HHHCCCCCCCEEECCCEECCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEEC
QGNRQLLSPAGQIVAVILLVLLCWINLLGVQTLSRWINLLTAWKLIVPVLVSIVLMVISS
CCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
HWSNLAVPVGGDGADVVRAVGSGGILFSLLGFRTAMDLAGEARKPARDVPLAMATGLGIC
CCCCEEEECCCCHHHHHHHHCCCHHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHH
LLLYITLQLSFLISVPPTELGNGWHGLMLSAHGGPVVALAMGFGLGWMVIILLVDALVSP
HHHHHHHHHHHHEECCCHHHCCCCEEEEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHCC
GATALNYMGVSARIIWMMGKCGLLPKALGRLNHQDVPHVAITLSMVVSALMLAIGPGWQT
CCHHHHHCCHHHHHHEECCCCCCCHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHCCCHHH
VVNFLTTTLIIALATGPVSLLALRRQMPDAHRGYRLPMADWICRLAFVTATWSISWCGRT
HHHHHHHHHHHHHHCCHHHHHHHHHHCCCHHCCCCCCHHHHHHHHHHHHHHEEEECCCCH
ALEGSVVCIAIPTLIFAAGRCWQENGMEVRPALWWALYLGLLVGDLQLFSEGQPLALPTP
HCCCCCCEEHHHHHHHHHCCHHHCCCCEEHHHHHHHHHHHHHHHHHHHHCCCCCEECCCC
ANMAVLAVMALIVLPIAVGSALPEKSPHALLGTE
CHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: L-tryptophan [Periplasm]; Proton [Periplasm]; Proton [Periplasm]; L-tyrosine [Periplasm]; Proton [Periplasm]; L-phenylalanine [Periplasm] [C]

Specific reaction: L-tryptophan [Periplasm] + Proton [Periplasm] = L-tryptophan [Cytoplasm] + Proton [Cytoplasm] Proton [Periplasm] + L-tyrosine [Periplasm] = Proton [Cytoplasm] + L-tyrosine [Cytoplasm] Proton [Periplasm] + L-phenylalanine [Periplasm] = Proton [Cytoplasm] +

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 9384377; 12730183 [H]