| Definition | Prochlorococcus marinus str. NATL1A, complete genome. |
|---|---|
| Accession | NC_008819 |
| Length | 1,864,731 |
Click here to switch to the map view.
The map label for this gene is yvdB [H]
Identifier: 124025004
GI number: 124025004
Start: 269243
End: 270910
Strand: Reverse
Name: yvdB [H]
Synonym: NATL1_02911
Alternate gene names: 124025004
Gene position: 270910-269243 (Counterclockwise)
Preceding gene: 124025011
Following gene: 124025003
Centisome position: 14.53
GC content: 42.27
Gene sequence:
>1668_bases TTGGCGTTAATTAATGGCTTTCACCTGAAAAATATTAGAGGTGATGTTTTAGGCGGCTTAACAGCTGCAGTTGTGGCATT ACCACTAGCTTTAGCGTTTGGTAATGCTGCTCTTGGTCCTGGGGGCGCTATTTATGGCCTTTACGGGGCAGTCGTAGTTG GCTTCCTCGCCGCTTTATTTGGAGGAACGCCTGCTCAGGTAAGTGGTCCGACTGGGCCGATGAGTGTAACCGTTGCTGGA GTTGTGGCGAGCTTGGCGGCTGTAGGAGTACCTAGGGATTTATCTGCTGGCGAAATTCTTCCTCTAGTAATGGCTGCGGT AGTCATTGGAGGATTATTTCAGATTTTATTTGGCCTACTAAGGCTTGGTAAATACATAACACTTGTTCCATACTCAGTTG TTTCAGGCTTTATGTCTGGAATTGGAGTAATCATAATTACTCTTCAAATAGGTCCTTTACTTGGAATATCAACTCGAGGA GGAGTATTAGAGTCTCTTTCAACTTTATTTAACAATTTCGAGCCAAATGGGGCTGCAGTAGCAGTTGCAGTAATGACACT TGCCATTGTGTTTCTGACCCCCCGTAAAATAAGTCAATGGGTCCCGTCTCCTCTTTTAGCATTATTAATAGTTACTCCTT TATCAATACTTCTTTTTGGCGATAGTTCCATAGACAGGATAGGCGCAATACCAGAGGGTGGTCTTTCTTTAAGTCTCCCA GATCCAAGCCTTGGCAATTTCTTCCCAATAATTCTTAAAGCTGGACTAGTCCTTGCTGTTCTTGGGGCTATTGACTCTCT TCTTACATCTCTTGTCGCAGATAATATTTCTCAAACTAGGCACAATTCTGATAGAGAACTCATTGGACAAGGTATTGGTA ATGCAGTAGCTGGCATTTTCACAGGTTTGCCTGGTGCTGGGGCAACCATGAGAACAGTAATAAATGTCAAATCTGGAGGT TCCACACCAATCTCAGGGATGGTTCATTCAGTCGTATTGCTATTTGTTCTTGTTGGTGCCGGTCCTCTAGCCGCTCAGAT CCCTACCGCTCTTCTTGCAGGAATTTTAATAAAAGTTGGCTTAGACATTATTGATTGGGGATTTCTTTTAAGAGCTCATA AACTTTCGCTGAAAACAGCAAGTGTGATGTATGGAGTCCTATTTATGACAGTTTTCTGGGACTTGATATGGGCTGTACTA GTTGGAGTATTCATAGCCAATATGCTCACAATCGATTCAATTACAGAGACGCAATTGGAGGGAATGGAAGCTGACAACCC ATTCGATTCAACATCAAATAACAATGCAGCAAATGCACAACTCCCCTCAGATGAGAAAGCACTTTTAGATCGTTGTGCGG GAGAAGTAATGCTATTCAGATTAAAAGGGCCACTTAGTTTTGGAGCAGCAAAAGGAATTACTGAAAGAATGATGCTTGTA AGAAACTATAAAGTTCTAATTCTTGATATCACTGATGTTCCTAGACTTGGAGTCACGGCAACTCTCGCAATAGAAGATAT GGTTCAAGAAGCTCTAAGCAACTCAAGGAAAGCATATGTTGCTGGCGCAACAGGAAGAGTAAAGGACAGACTTGCTAAAT TTGGAGTTGATGTAATTGGCACAAGAAAAGAAGCACTTGTAGCTGCAATTGACAGCTTGAATGGTTAA
Upstream 100 bases:
>100_bases AATTTTGTCTAAATCTAGTATGTAAAAATTGAGAATGCTGAACGTAATTGAACCTTGAAGAGATAGGCTTAATCAAGTCA AATCAAGTAAGGAGAGTCGA
Downstream 100 bases:
>100_bases TAATCAATATTTTCATCCAATTTGCTTACTTTAAGAACTAACAGATATGGGACAAAACCTTTTCATACAAAATGCTTTAA GTCCGCCAATACTTTTTTTC
Product: putative sulfate transporter
Products: Proton [Cytoplasm]; SO42- [Cytoplasm] [C]
Alternate protein names: NA
Number of amino acids: Translated: 555; Mature: 554
Protein sequence:
>555_residues MALINGFHLKNIRGDVLGGLTAAVVALPLALAFGNAALGPGGAIYGLYGAVVVGFLAALFGGTPAQVSGPTGPMSVTVAG VVASLAAVGVPRDLSAGEILPLVMAAVVIGGLFQILFGLLRLGKYITLVPYSVVSGFMSGIGVIIITLQIGPLLGISTRG GVLESLSTLFNNFEPNGAAVAVAVMTLAIVFLTPRKISQWVPSPLLALLIVTPLSILLFGDSSIDRIGAIPEGGLSLSLP DPSLGNFFPIILKAGLVLAVLGAIDSLLTSLVADNISQTRHNSDRELIGQGIGNAVAGIFTGLPGAGATMRTVINVKSGG STPISGMVHSVVLLFVLVGAGPLAAQIPTALLAGILIKVGLDIIDWGFLLRAHKLSLKTASVMYGVLFMTVFWDLIWAVL VGVFIANMLTIDSITETQLEGMEADNPFDSTSNNNAANAQLPSDEKALLDRCAGEVMLFRLKGPLSFGAAKGITERMMLV RNYKVLILDITDVPRLGVTATLAIEDMVQEALSNSRKAYVAGATGRVKDRLAKFGVDVIGTRKEALVAAIDSLNG
Sequences:
>Translated_555_residues MALINGFHLKNIRGDVLGGLTAAVVALPLALAFGNAALGPGGAIYGLYGAVVVGFLAALFGGTPAQVSGPTGPMSVTVAG VVASLAAVGVPRDLSAGEILPLVMAAVVIGGLFQILFGLLRLGKYITLVPYSVVSGFMSGIGVIIITLQIGPLLGISTRG GVLESLSTLFNNFEPNGAAVAVAVMTLAIVFLTPRKISQWVPSPLLALLIVTPLSILLFGDSSIDRIGAIPEGGLSLSLP DPSLGNFFPIILKAGLVLAVLGAIDSLLTSLVADNISQTRHNSDRELIGQGIGNAVAGIFTGLPGAGATMRTVINVKSGG STPISGMVHSVVLLFVLVGAGPLAAQIPTALLAGILIKVGLDIIDWGFLLRAHKLSLKTASVMYGVLFMTVFWDLIWAVL VGVFIANMLTIDSITETQLEGMEADNPFDSTSNNNAANAQLPSDEKALLDRCAGEVMLFRLKGPLSFGAAKGITERMMLV RNYKVLILDITDVPRLGVTATLAIEDMVQEALSNSRKAYVAGATGRVKDRLAKFGVDVIGTRKEALVAAIDSLNG >Mature_554_residues ALINGFHLKNIRGDVLGGLTAAVVALPLALAFGNAALGPGGAIYGLYGAVVVGFLAALFGGTPAQVSGPTGPMSVTVAGV VASLAAVGVPRDLSAGEILPLVMAAVVIGGLFQILFGLLRLGKYITLVPYSVVSGFMSGIGVIIITLQIGPLLGISTRGG VLESLSTLFNNFEPNGAAVAVAVMTLAIVFLTPRKISQWVPSPLLALLIVTPLSILLFGDSSIDRIGAIPEGGLSLSLPD PSLGNFFPIILKAGLVLAVLGAIDSLLTSLVADNISQTRHNSDRELIGQGIGNAVAGIFTGLPGAGATMRTVINVKSGGS TPISGMVHSVVLLFVLVGAGPLAAQIPTALLAGILIKVGLDIIDWGFLLRAHKLSLKTASVMYGVLFMTVFWDLIWAVLV GVFIANMLTIDSITETQLEGMEADNPFDSTSNNNAANAQLPSDEKALLDRCAGEVMLFRLKGPLSFGAAKGITERMMLVR NYKVLILDITDVPRLGVTATLAIEDMVQEALSNSRKAYVAGATGRVKDRLAKFGVDVIGTRKEALVAAIDSLNG
Specific function: Possible Sulfate Transporter. [C]
COG id: COG0659
COG function: function code P; Sulfate permease and related transporters (MFS superfamily)
Gene ontology:
Cell location: Cell membrane; Multi-pass membrane protein [H]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 STAS domain [H]
Homologues:
Organism=Homo sapiens, GI39752683, Length=425, Percent_Identity=23.7647058823529, Blast_Score=86, Evalue=9e-17, Organism=Homo sapiens, GI45827800, Length=425, Percent_Identity=23.7647058823529, Blast_Score=86, Evalue=9e-17, Organism=Homo sapiens, GI45827802, Length=442, Percent_Identity=23.5294117647059, Blast_Score=85, Evalue=2e-16, Organism=Homo sapiens, GI94721255, Length=360, Percent_Identity=27.7777777777778, Blast_Score=83, Evalue=8e-16, Organism=Homo sapiens, GI94721253, Length=360, Percent_Identity=27.7777777777778, Blast_Score=83, Evalue=8e-16, Organism=Homo sapiens, GI94721259, Length=360, Percent_Identity=27.7777777777778, Blast_Score=83, Evalue=9e-16, Organism=Homo sapiens, GI94721257, Length=360, Percent_Identity=27.7777777777778, Blast_Score=82, Evalue=1e-15, Organism=Homo sapiens, GI4557535, Length=379, Percent_Identity=23.7467018469657, Blast_Score=79, Evalue=1e-14, Organism=Homo sapiens, GI4505697, Length=402, Percent_Identity=24.6268656716418, Blast_Score=77, Evalue=4e-14, Organism=Homo sapiens, GI16306483, Length=477, Percent_Identity=23.0607966457023, Blast_Score=77, Evalue=5e-14, Organism=Homo sapiens, GI20336282, Length=475, Percent_Identity=22.7368421052632, Blast_Score=77, Evalue=6e-14, Organism=Homo sapiens, GI269784651, Length=386, Percent_Identity=22.7979274611399, Blast_Score=75, Evalue=1e-13, Organism=Escherichia coli, GI87081859, Length=436, Percent_Identity=31.4220183486239, Blast_Score=143, Evalue=2e-35, Organism=Caenorhabditis elegans, GI17551690, Length=379, Percent_Identity=22.9551451187335, Blast_Score=94, Evalue=2e-19, Organism=Caenorhabditis elegans, GI86565215, Length=446, Percent_Identity=24.4394618834081, Blast_Score=87, Evalue=2e-17, Organism=Caenorhabditis elegans, GI86564196, Length=439, Percent_Identity=26.1958997722096, Blast_Score=82, Evalue=8e-16, Organism=Caenorhabditis elegans, GI193203292, Length=437, Percent_Identity=24.0274599542334, Blast_Score=80, Evalue=2e-15, Organism=Caenorhabditis elegans, GI17566848, Length=383, Percent_Identity=25.5874673629243, Blast_Score=76, Evalue=5e-14, Organism=Caenorhabditis elegans, GI86564876, Length=385, Percent_Identity=23.1168831168831, Blast_Score=75, Evalue=1e-13, Organism=Saccharomyces cerevisiae, GI6325260, Length=606, Percent_Identity=22.2772277227723, Blast_Score=93, Evalue=1e-19, Organism=Drosophila melanogaster, GI21355087, Length=399, Percent_Identity=24.3107769423559, Blast_Score=92, Evalue=1e-18, Organism=Drosophila melanogaster, GI24647160, Length=399, Percent_Identity=24.3107769423559, Blast_Score=92, Evalue=1e-18, Organism=Drosophila melanogaster, GI85815873, Length=513, Percent_Identity=25.5360623781676, Blast_Score=86, Evalue=7e-17, Organism=Drosophila melanogaster, GI24666186, Length=425, Percent_Identity=26.1176470588235, Blast_Score=82, Evalue=9e-16, Organism=Drosophila melanogaster, GI24649801, Length=440, Percent_Identity=25.2272727272727, Blast_Score=82, Evalue=9e-16,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR002645 - InterPro: IPR001902 - InterPro: IPR011547 [H]
Pfam domain/function: PF01740 STAS; PF00916 Sulfate_transp [H]
EC number: NA
Molecular weight: Translated: 57337; Mature: 57205
Theoretical pI: Translated: 6.96; Mature: 6.96
Prosite motif: PS50801 STAS
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.2 %Cys (Translated Protein) 2.7 %Met (Translated Protein) 2.9 %Cys+Met (Translated Protein) 0.2 %Cys (Mature Protein) 2.5 %Met (Mature Protein) 2.7 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MALINGFHLKNIRGDVLGGLTAAVVALPLALAFGNAALGPGGAIYGLYGAVVVGFLAALF CCEECCEEECCCCHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHH GGTPAQVSGPTGPMSVTVAGVVASLAAVGVPRDLSAGEILPLVMAAVVIGGLFQILFGLL CCCCCCCCCCCCCHHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHH RLGKYITLVPYSVVSGFMSGIGVIIITLQIGPLLGISTRGGVLESLSTLFNNFEPNGAAV HHCCHHEEHHHHHHHHHHHCCEEEEEEEECCCEECCCCCCHHHHHHHHHHHCCCCCCHHH AVAVMTLAIVFLTPRKISQWVPSPLLALLIVTPLSILLFGDSSIDRIGAIPEGGLSLSLP HHHHHHHHHHHHCCHHHHHHCCHHHHHHHHHHHHHHEEECCCCHHHHCCCCCCCEEEECC DPSLGNFFPIILKAGLVLAVLGAIDSLLTSLVADNISQTRHNSDRELIGQGIGNAVAGIF CCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHH TGLPGAGATMRTVINVKSGGSTPISGMVHSVVLLFVLVGAGPLAAQIPTALLAGILIKVG HCCCCCCCCEEEEEEECCCCCCCHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHH LDIIDWGFLLRAHKLSLKTASVMYGVLFMTVFWDLIWAVLVGVFIANMLTIDSITETQLE HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHC GMEADNPFDSTSNNNAANAQLPSDEKALLDRCAGEVMLFRLKGPLSFGAAKGITERMMLV CCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHCCCCEEEEEECCCCCHHHHHHHHHHHHHH RNYKVLILDITDVPRLGVTATLAIEDMVQEALSNSRKAYVAGATGRVKDRLAKFGVDVIG HCCEEEEEEECCCCCCCCCHHHHHHHHHHHHHCCCCEEEEECCCHHHHHHHHHCCCHHHC TRKEALVAAIDSLNG CHHHHHHHHHHHCCC >Mature Secondary Structure ALINGFHLKNIRGDVLGGLTAAVVALPLALAFGNAALGPGGAIYGLYGAVVVGFLAALF CEECCEEECCCCHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHH GGTPAQVSGPTGPMSVTVAGVVASLAAVGVPRDLSAGEILPLVMAAVVIGGLFQILFGLL CCCCCCCCCCCCCHHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHH RLGKYITLVPYSVVSGFMSGIGVIIITLQIGPLLGISTRGGVLESLSTLFNNFEPNGAAV HHCCHHEEHHHHHHHHHHHCCEEEEEEEECCCEECCCCCCHHHHHHHHHHHCCCCCCHHH AVAVMTLAIVFLTPRKISQWVPSPLLALLIVTPLSILLFGDSSIDRIGAIPEGGLSLSLP HHHHHHHHHHHHCCHHHHHHCCHHHHHHHHHHHHHHEEECCCCHHHHCCCCCCCEEEECC DPSLGNFFPIILKAGLVLAVLGAIDSLLTSLVADNISQTRHNSDRELIGQGIGNAVAGIF CCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHH TGLPGAGATMRTVINVKSGGSTPISGMVHSVVLLFVLVGAGPLAAQIPTALLAGILIKVG HCCCCCCCCEEEEEEECCCCCCCHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHH LDIIDWGFLLRAHKLSLKTASVMYGVLFMTVFWDLIWAVLVGVFIANMLTIDSITETQLE HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHC GMEADNPFDSTSNNNAANAQLPSDEKALLDRCAGEVMLFRLKGPLSFGAAKGITERMMLV CCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHCCCCEEEEEECCCCCHHHHHHHHHHHHHH RNYKVLILDITDVPRLGVTATLAIEDMVQEALSNSRKAYVAGATGRVKDRLAKFGVDVIG HCCEEEEEEECCCCCCCCCHHHHHHHHHHHHHCCCCEEEEECCCHHHHHHHHHCCCHHHC TRKEALVAAIDSLNG CHHHHHHHHHHHCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: Proton [Periplasm]; SO42- [Periplasm] [C]
Specific reaction: Proton [Periplasm] + SO42- [Periplasm] = Proton [Cytoplasm] + SO42- [Cytoplasm] [C]
General reaction: NA
Inhibitor: NA
Structure determination priority: 6.0
TargetDB status: NA
Availability: NA
References: 9384377 [H]