| Definition | Prochlorococcus marinus str. MIT 9303, complete genome. |
|---|---|
| Accession | NC_008820 |
| Length | 2,682,675 |
Click here to switch to the map view.
The map label for this gene is ybeC [H]
Identifier: 124022790
GI number: 124022790
Start: 968423
End: 969967
Strand: Reverse
Name: ybeC [H]
Synonym: P9303_10831
Alternate gene names: 124022790
Gene position: 969967-968423 (Counterclockwise)
Preceding gene: 124022791
Following gene: 124022789
Centisome position: 36.16
GC content: 54.76
Gene sequence:
>1545_bases ATGGGACTGCGCAAGGAACTAAACCTCACCTCCCTAACCATGGCAGTGGTGACAGGCACCATCGGTTCTGGTTGGCTTTT CGCTCCCTACTTTGCTGCACAACTGGCTGGAGCAGGCAGCCTGCTGGCATGGCTGCTGGGCGGTTTTTTAGCCTTACTGC TGGCCTTGGTGTTTGCAGAACTCGGATCGCTTGTCCCCAACTCGGGCGCACTGGCGCAAATCCCTCTGCTGACTCATGGG CGACTGTCAGGATTCATCGGCGGATGGAGCGTATGGCTTTCTTACGTCACCATACCGACCATAGAACTACTCGCCCTACT GCAATATTTATCAAGCAGCCTCCCTTGGCTTACGCACGTCCAAGGCAACCGTCAGCTACTCAGTCCCGCGGGTCAGATTG TCGCCGTGATTCTGCTGGTCTTGCTTTGCTGGATCAACCTGCTTGGAGTGCAAACCCTTTCGCGCTGGATCAACCTGCTC ACAGCCTGGAAACTGATCGTTCCAGTTTTGGTGTCGATTGTGCTCATGGTTATCAGCAGTCACTGGAGCAACCTTGCGGT ACCTGTTGGCGGTGATGGTGCTGATGTAGTACGTGCTGTAGGTAGTGGAGGGATCTTATTCAGCCTACTGGGATTCCGTA CTGCGATGGATCTTGCTGGCGAAGCACGTAAGCCGGCTAGGGACGTCCCTCTTGCAATGGCCACAGGCCTAGGCATCTGC CTACTGCTCTATATCACCCTACAGCTCAGTTTTCTAATCAGCGTGCCACCCACCGAGCTTGGCAACGGTTGGCATGGCCT AATGCTCAGCGCCCATGGCGGGCCGGTGGTGGCTCTTGCAATGGGTTTCGGCCTTGGATGGATGGTGATTATTCTTCTGG TGGATGCATTGGTCTCGCCCGGGGCCACAGCTCTTAATTACATGGGTGTCTCTGCCCGGATCATCTGGATGATGGGGAAG TGTGGGCTCTTGCCTAAAGCTCTCGGACGGCTCAATCATCAGGACGTCCCTCATGTAGCCATAACGCTGAGCATGGTTGT TAGTGCACTGATGCTCGCGATTGGACCAGGGTGGCAGACAGTCGTCAACTTCTTAACCACAACTTTGATTATCGCCCTAG CAACCGGACCTGTGAGCTTGCTGGCCCTGCGCCGGCAGATGCCTGATGCGCATCGAGGGTACCGGCTACCAATGGCGGAT TGGATTTGCCGTCTTGCGTTCGTAACGGCTACATGGTCAATCAGCTGGTGCGGGCGAACTGCTCTAGAGGGTTCCGTTGT CTGCATCGCTATCCCCACATTAATCTTCGCTGCGGGTCGCTGTTGGCAAGAGAATGGAATGGAAGTACGTCCAGCACTTT GGTGGGCGCTCTATCTCGGTCTTTTGGTAGGCGATCTGCAACTTTTCAGTGAAGGGCAGCCTTTGGCACTCCCAACACCT GCAAATATGGCTGTTTTGGCGGTGATGGCATTGATCGTTCTACCTATAGCGGTTGGAAGCGCCCTACCGGAAAAATCACC TCACGCTTTACTTGGAACTGAATAA
Upstream 100 bases:
>100_bases AACTACATCCAATTACCTTGACGGCAAAGAATAACAAAAAAGACTGGCAACAATGTTTAGCTTCTTAGCTTGAACAGCAT GACGGTATTGACACGCATTT
Downstream 100 bases:
>100_bases GAACCTGCTTAAAAGCTTCATTTTATGCACATATAAGAGCAGGCAATGATCTAAAGAGTTGCAATATGGATGATAGTTGT CATTGAAAATAAATTTACTT
Product: hypothetical protein
Products: L-tryptophan [Cytoplasm]; Proton [Cytoplasm]; Proton [Cytoplasm]; L-tyrosine [Cytoplasm]; Proton [Cytoplasm]; L-phenylalanine [Cytoplasm] [C]
Alternate protein names: NA
Number of amino acids: Translated: 514; Mature: 513
Protein sequence:
>514_residues MGLRKELNLTSLTMAVVTGTIGSGWLFAPYFAAQLAGAGSLLAWLLGGFLALLLALVFAELGSLVPNSGALAQIPLLTHG RLSGFIGGWSVWLSYVTIPTIELLALLQYLSSSLPWLTHVQGNRQLLSPAGQIVAVILLVLLCWINLLGVQTLSRWINLL TAWKLIVPVLVSIVLMVISSHWSNLAVPVGGDGADVVRAVGSGGILFSLLGFRTAMDLAGEARKPARDVPLAMATGLGIC LLLYITLQLSFLISVPPTELGNGWHGLMLSAHGGPVVALAMGFGLGWMVIILLVDALVSPGATALNYMGVSARIIWMMGK CGLLPKALGRLNHQDVPHVAITLSMVVSALMLAIGPGWQTVVNFLTTTLIIALATGPVSLLALRRQMPDAHRGYRLPMAD WICRLAFVTATWSISWCGRTALEGSVVCIAIPTLIFAAGRCWQENGMEVRPALWWALYLGLLVGDLQLFSEGQPLALPTP ANMAVLAVMALIVLPIAVGSALPEKSPHALLGTE
Sequences:
>Translated_514_residues MGLRKELNLTSLTMAVVTGTIGSGWLFAPYFAAQLAGAGSLLAWLLGGFLALLLALVFAELGSLVPNSGALAQIPLLTHG RLSGFIGGWSVWLSYVTIPTIELLALLQYLSSSLPWLTHVQGNRQLLSPAGQIVAVILLVLLCWINLLGVQTLSRWINLL TAWKLIVPVLVSIVLMVISSHWSNLAVPVGGDGADVVRAVGSGGILFSLLGFRTAMDLAGEARKPARDVPLAMATGLGIC LLLYITLQLSFLISVPPTELGNGWHGLMLSAHGGPVVALAMGFGLGWMVIILLVDALVSPGATALNYMGVSARIIWMMGK CGLLPKALGRLNHQDVPHVAITLSMVVSALMLAIGPGWQTVVNFLTTTLIIALATGPVSLLALRRQMPDAHRGYRLPMAD WICRLAFVTATWSISWCGRTALEGSVVCIAIPTLIFAAGRCWQENGMEVRPALWWALYLGLLVGDLQLFSEGQPLALPTP ANMAVLAVMALIVLPIAVGSALPEKSPHALLGTE >Mature_513_residues GLRKELNLTSLTMAVVTGTIGSGWLFAPYFAAQLAGAGSLLAWLLGGFLALLLALVFAELGSLVPNSGALAQIPLLTHGR LSGFIGGWSVWLSYVTIPTIELLALLQYLSSSLPWLTHVQGNRQLLSPAGQIVAVILLVLLCWINLLGVQTLSRWINLLT AWKLIVPVLVSIVLMVISSHWSNLAVPVGGDGADVVRAVGSGGILFSLLGFRTAMDLAGEARKPARDVPLAMATGLGICL LLYITLQLSFLISVPPTELGNGWHGLMLSAHGGPVVALAMGFGLGWMVIILLVDALVSPGATALNYMGVSARIIWMMGKC GLLPKALGRLNHQDVPHVAITLSMVVSALMLAIGPGWQTVVNFLTTTLIIALATGPVSLLALRRQMPDAHRGYRLPMADW ICRLAFVTATWSISWCGRTALEGSVVCIAIPTLIFAAGRCWQENGMEVRPALWWALYLGLLVGDLQLFSEGQPLALPTPA NMAVLAVMALIVLPIAVGSALPEKSPHALLGTE
Specific function: Uptake of an yet unknown amino-acid with the concomitant import of a proton [H]
COG id: NA
COG function: NA
Gene ontology:
Cell location: Cell membrane; Multi-pass membrane protein (Potential) [H]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the amino acid-polyamine-organocation (APC) superfamily. AGT (TC 2.A.3.11) family [H]
Homologues:
Organism=Homo sapiens, GI115648063, Length=439, Percent_Identity=24.373576309795, Blast_Score=68, Evalue=2e-11, Organism=Homo sapiens, GI115648022, Length=439, Percent_Identity=24.373576309795, Blast_Score=68, Evalue=2e-11, Organism=Homo sapiens, GI258645169, Length=403, Percent_Identity=23.8213399503722, Blast_Score=67, Evalue=5e-11, Organism=Homo sapiens, GI258614005, Length=403, Percent_Identity=23.0769230769231, Blast_Score=66, Evalue=1e-10, Organism=Homo sapiens, GI258614003, Length=403, Percent_Identity=23.0769230769231, Blast_Score=66, Evalue=1e-10, Organism=Escherichia coli, GI1786302, Length=432, Percent_Identity=23.6111111111111, Blast_Score=80, Evalue=3e-16, Organism=Escherichia coli, GI1788480, Length=421, Percent_Identity=25.8907363420428, Blast_Score=77, Evalue=2e-15, Organism=Escherichia coli, GI1790653, Length=437, Percent_Identity=21.5102974828375, Blast_Score=66, Evalue=5e-12, Organism=Caenorhabditis elegans, GI17540018, Length=416, Percent_Identity=24.7596153846154, Blast_Score=90, Evalue=3e-18, Organism=Caenorhabditis elegans, GI17532491, Length=407, Percent_Identity=23.5872235872236, Blast_Score=71, Evalue=1e-12, Organism=Caenorhabditis elegans, GI17568033, Length=418, Percent_Identity=24.4019138755981, Blast_Score=69, Evalue=6e-12, Organism=Drosophila melanogaster, GI24667468, Length=413, Percent_Identity=24.455205811138, Blast_Score=82, Evalue=7e-16, Organism=Drosophila melanogaster, GI45550968, Length=411, Percent_Identity=25.3041362530414, Blast_Score=78, Evalue=2e-14, Organism=Drosophila melanogaster, GI19921172, Length=411, Percent_Identity=25.3041362530414, Blast_Score=78, Evalue=2e-14, Organism=Drosophila melanogaster, GI24666159, Length=423, Percent_Identity=22.6950354609929, Blast_Score=75, Evalue=1e-13, Organism=Drosophila melanogaster, GI221512776, Length=423, Percent_Identity=22.6950354609929, Blast_Score=75, Evalue=1e-13, Organism=Drosophila melanogaster, GI221331183, Length=420, Percent_Identity=23.5714285714286, Blast_Score=71, Evalue=2e-12, Organism=Drosophila melanogaster, GI17647653, Length=420, Percent_Identity=23.5714285714286, Blast_Score=71, Evalue=2e-12, Organism=Drosophila melanogaster, GI24664379, Length=420, Percent_Identity=23.5714285714286, Blast_Score=71, Evalue=2e-12, Organism=Drosophila melanogaster, GI21357367, Length=415, Percent_Identity=24.8192771084337, Blast_Score=69, Evalue=9e-12,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR004841 - InterPro: IPR002293 [H]
Pfam domain/function: PF00324 AA_permease [H]
EC number: NA
Molecular weight: Translated: 54473; Mature: 54342
Theoretical pI: Translated: 8.49; Mature: 8.49
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.4 %Cys (Translated Protein) 3.5 %Met (Translated Protein) 4.9 %Cys+Met (Translated Protein) 1.4 %Cys (Mature Protein) 3.3 %Met (Mature Protein) 4.7 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MGLRKELNLTSLTMAVVTGTIGSGWLFAPYFAAQLAGAGSLLAWLLGGFLALLLALVFAE CCCCCCCCHHHHHHHHHHCCCCCCCHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHH LGSLVPNSGALAQIPLLTHGRLSGFIGGWSVWLSYVTIPTIELLALLQYLSSSLPWLTHV HHHCCCCCCCEEECCCEECCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEEC QGNRQLLSPAGQIVAVILLVLLCWINLLGVQTLSRWINLLTAWKLIVPVLVSIVLMVISS CCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH HWSNLAVPVGGDGADVVRAVGSGGILFSLLGFRTAMDLAGEARKPARDVPLAMATGLGIC CCCCEEEECCCCHHHHHHHHCCCHHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHH LLLYITLQLSFLISVPPTELGNGWHGLMLSAHGGPVVALAMGFGLGWMVIILLVDALVSP HHHHHHHHHHHHEECCCHHHCCCCEEEEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHCC GATALNYMGVSARIIWMMGKCGLLPKALGRLNHQDVPHVAITLSMVVSALMLAIGPGWQT CCHHHHHCCHHHHHHEECCCCCCCHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHCCCHHH VVNFLTTTLIIALATGPVSLLALRRQMPDAHRGYRLPMADWICRLAFVTATWSISWCGRT HHHHHHHHHHHHHHCCHHHHHHHHHHCCCHHCCCCCCHHHHHHHHHHHHHHEEEECCCCH ALEGSVVCIAIPTLIFAAGRCWQENGMEVRPALWWALYLGLLVGDLQLFSEGQPLALPTP HCCCCCCEEHHHHHHHHHCCHHHCCCCEEHHHHHHHHHHHHHHHHHHHHCCCCCEECCCC ANMAVLAVMALIVLPIAVGSALPEKSPHALLGTE CHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCC >Mature Secondary Structure GLRKELNLTSLTMAVVTGTIGSGWLFAPYFAAQLAGAGSLLAWLLGGFLALLLALVFAE CCCCCCCHHHHHHHHHHCCCCCCCHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHH LGSLVPNSGALAQIPLLTHGRLSGFIGGWSVWLSYVTIPTIELLALLQYLSSSLPWLTHV HHHCCCCCCCEEECCCEECCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEEC QGNRQLLSPAGQIVAVILLVLLCWINLLGVQTLSRWINLLTAWKLIVPVLVSIVLMVISS CCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH HWSNLAVPVGGDGADVVRAVGSGGILFSLLGFRTAMDLAGEARKPARDVPLAMATGLGIC CCCCEEEECCCCHHHHHHHHCCCHHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHH LLLYITLQLSFLISVPPTELGNGWHGLMLSAHGGPVVALAMGFGLGWMVIILLVDALVSP HHHHHHHHHHHHEECCCHHHCCCCEEEEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHCC GATALNYMGVSARIIWMMGKCGLLPKALGRLNHQDVPHVAITLSMVVSALMLAIGPGWQT CCHHHHHCCHHHHHHEECCCCCCCHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHCCCHHH VVNFLTTTLIIALATGPVSLLALRRQMPDAHRGYRLPMADWICRLAFVTATWSISWCGRT HHHHHHHHHHHHHHCCHHHHHHHHHHCCCHHCCCCCCHHHHHHHHHHHHHHEEEECCCCH ALEGSVVCIAIPTLIFAAGRCWQENGMEVRPALWWALYLGLLVGDLQLFSEGQPLALPTP HCCCCCCEEHHHHHHHHHCCHHHCCCCEEHHHHHHHHHHHHHHHHHHHHCCCCCEECCCC ANMAVLAVMALIVLPIAVGSALPEKSPHALLGTE CHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: L-tryptophan [Periplasm]; Proton [Periplasm]; Proton [Periplasm]; L-tyrosine [Periplasm]; Proton [Periplasm]; L-phenylalanine [Periplasm] [C]
Specific reaction: L-tryptophan [Periplasm] + Proton [Periplasm] = L-tryptophan [Cytoplasm] + Proton [Cytoplasm] Proton [Periplasm] + L-tyrosine [Periplasm] = Proton [Cytoplasm] + L-tyrosine [Cytoplasm] Proton [Periplasm] + L-phenylalanine [Periplasm] = Proton [Cytoplasm] +
General reaction: NA
Inhibitor: NA
Structure determination priority: 6.0
TargetDB status: NA
Availability: NA
References: 9384377; 12730183 [H]