| Definition | Trichodesmium erythraeum IMS101 chromosome, complete genome. |
|---|---|
| Accession | NC_008312 |
| Length | 7,750,108 |
Click here to switch to the map view.
The map label for this gene is rbgA [H]
Identifier: 113476888
GI number: 113476888
Start: 5173187
End: 5174044
Strand: Reverse
Name: rbgA [H]
Synonym: Tery_3374
Alternate gene names: 113476888
Gene position: 5174044-5173187 (Counterclockwise)
Preceding gene: 113476889
Following gene: 113476887
Centisome position: 66.76
GC content: 39.51
Gene sequence:
>858_bases ATGACTATTCAATGGTATCCAGGCCATATTGCTAAGGCTGAACGAAATCTTAAAGAACAACTGAAACGGGTTGATGTGGT TTTAGAAGTTCGAGATGCCCGTATTCCACTTGCTACTCGCCACCCCCAGGTTTCTGAATGGGTAGGGAGTAAGGCACAAG TTTTAGTCATTAACCGTATAGATATGATTTCCTCAGAAGTTATGAAAATTTGGACTGAATGGTTTGAAGCTAATGGGGAA ATGCCTTATTTTACTAATGCTCAGTTGGGCGATGGAGTGAAGAATTTGGCCAAGGCAGTACGGGAGGCTGGTCGTGCTGT TAATCTTAGACGGCGCGATCGCGGAATGTTACCTCGGCCTGTACGTGCTGTGGTAATTGGTTTTCCTAATGTGGGAAAGT CGGCTCTAATTAATAGACTGTTAAAGAGAAAGGTTGTTGAAAGTGCTAGGCGTCCTGGTGTTACTAAGCAATTAAGATGG GTACGCATTTCTGATGAGATTGAATTGTTAGATGCTCCTGGTGTAATTCCTAGTCAAATTAAAAATAGGGAGGATGCAAT TAAGTTGGCAATTTGTGAGGATATCGGGGATGCGGCTTATGATAATCAGCAAGTTGCTGCTAGTATGATTGATTTTTTAA CTTTTTTGGAAACTGATAGTAATGGTTTTGTATCTACTTCTTGTTTGAAATATCGTTATCAATTAGAAGCTCATAATTAT ACGGGTGAGAGTTATTTGCATGAGTTAGCAAATCAAATTTATCAAGGAGATGTTGAACGGACTTCAAGACGAATTTTGGA TGATTTTCGTAAGGGTTTTTTGGGGAAAATATCTTTAGAGTTACCACCTTTCAAATAG
Upstream 100 bases:
>100_bases TAACCATTAGGTCTTCCTCACTATGGGGAGCATTTTGCCCCCACCACTTACTTTATTAGCTCTCTTAAATTTTGATTTTC ACCAATTTTAATTTTCCCTC
Downstream 100 bases:
>100_bases CAGTACTATTTTATTTTAGGTTTAAAATCAAGTCAAAGAATAGAAATTAACTTTGAAGTAAGTGAATATACTGCTAACAA TGTCTTTCATTTTTTTGTAG
Product: ribosomal biogenesis GTPase
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 285; Mature: 284
Protein sequence:
>285_residues MTIQWYPGHIAKAERNLKEQLKRVDVVLEVRDARIPLATRHPQVSEWVGSKAQVLVINRIDMISSEVMKIWTEWFEANGE MPYFTNAQLGDGVKNLAKAVREAGRAVNLRRRDRGMLPRPVRAVVIGFPNVGKSALINRLLKRKVVESARRPGVTKQLRW VRISDEIELLDAPGVIPSQIKNREDAIKLAICEDIGDAAYDNQQVAASMIDFLTFLETDSNGFVSTSCLKYRYQLEAHNY TGESYLHELANQIYQGDVERTSRRILDDFRKGFLGKISLELPPFK
Sequences:
>Translated_285_residues MTIQWYPGHIAKAERNLKEQLKRVDVVLEVRDARIPLATRHPQVSEWVGSKAQVLVINRIDMISSEVMKIWTEWFEANGE MPYFTNAQLGDGVKNLAKAVREAGRAVNLRRRDRGMLPRPVRAVVIGFPNVGKSALINRLLKRKVVESARRPGVTKQLRW VRISDEIELLDAPGVIPSQIKNREDAIKLAICEDIGDAAYDNQQVAASMIDFLTFLETDSNGFVSTSCLKYRYQLEAHNY TGESYLHELANQIYQGDVERTSRRILDDFRKGFLGKISLELPPFK >Mature_284_residues TIQWYPGHIAKAERNLKEQLKRVDVVLEVRDARIPLATRHPQVSEWVGSKAQVLVINRIDMISSEVMKIWTEWFEANGEM PYFTNAQLGDGVKNLAKAVREAGRAVNLRRRDRGMLPRPVRAVVIGFPNVGKSALINRLLKRKVVESARRPGVTKQLRWV RISDEIELLDAPGVIPSQIKNREDAIKLAICEDIGDAAYDNQQVAASMIDFLTFLETDSNGFVSTSCLKYRYQLEAHNYT GESYLHELANQIYQGDVERTSRRILDDFRKGFLGKISLELPPFK
Specific function: Binds GTP and GDP [H]
COG id: COG1161
COG function: function code R; Predicted GTPases
Gene ontology:
Cell location: Cytoplasm (Probable) [H]
Metaboloic importance: NA
Operon status: Not Known
Operon components: None
Similarity: Contains 1 G (guanine nucleotide-binding) domain [H]
Homologues:
Organism=Homo sapiens, GI93277113, Length=306, Percent_Identity=29.4117647058824, Blast_Score=119, Evalue=3e-27, Organism=Homo sapiens, GI296317324, Length=284, Percent_Identity=30.9859154929577, Blast_Score=92, Evalue=5e-19, Organism=Homo sapiens, GI9506611, Length=284, Percent_Identity=30.9859154929577, Blast_Score=92, Evalue=5e-19, Organism=Homo sapiens, GI45643129, Length=192, Percent_Identity=29.6875, Blast_Score=81, Evalue=1e-15, Organism=Homo sapiens, GI45643127, Length=192, Percent_Identity=29.6875, Blast_Score=81, Evalue=1e-15, Organism=Homo sapiens, GI45593130, Length=192, Percent_Identity=29.6875, Blast_Score=80, Evalue=1e-15, Organism=Homo sapiens, GI7019419, Length=162, Percent_Identity=29.6296296296296, Blast_Score=66, Evalue=4e-11, Organism=Caenorhabditis elegans, GI193211047, Length=237, Percent_Identity=32.9113924050633, Blast_Score=109, Evalue=2e-24, Organism=Caenorhabditis elegans, GI17534827, Length=193, Percent_Identity=30.0518134715026, Blast_Score=88, Evalue=5e-18, Organism=Caenorhabditis elegans, GI71990926, Length=158, Percent_Identity=34.8101265822785, Blast_Score=70, Evalue=1e-12, Organism=Caenorhabditis elegans, GI32563985, Length=154, Percent_Identity=35.0649350649351, Blast_Score=70, Evalue=1e-12, Organism=Caenorhabditis elegans, GI32563983, Length=158, Percent_Identity=34.8101265822785, Blast_Score=70, Evalue=2e-12, Organism=Saccharomyces cerevisiae, GI6320842, Length=173, Percent_Identity=32.3699421965318, Blast_Score=81, Evalue=2e-16, Organism=Saccharomyces cerevisiae, GI6324381, Length=168, Percent_Identity=29.7619047619048, Blast_Score=78, Evalue=2e-15, Organism=Saccharomyces cerevisiae, GI6323744, Length=227, Percent_Identity=26.431718061674, Blast_Score=75, Evalue=1e-14, Organism=Drosophila melanogaster, GI85815858, Length=315, Percent_Identity=26.6666666666667, Blast_Score=102, Evalue=3e-22, Organism=Drosophila melanogaster, GI19922460, Length=278, Percent_Identity=25.8992805755396, Blast_Score=71, Evalue=6e-13,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR023179 - InterPro: IPR019991 - InterPro: IPR016478 - InterPro: IPR002917 [H]
Pfam domain/function: PF01926 MMR_HSR1 [H]
EC number: NA
Molecular weight: Translated: 32478; Mature: 32347
Theoretical pI: Translated: 9.78; Mature: 9.78
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.7 %Cys (Translated Protein) 2.1 %Met (Translated Protein) 2.8 %Cys+Met (Translated Protein) 0.7 %Cys (Mature Protein) 1.8 %Met (Mature Protein) 2.5 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MTIQWYPGHIAKAERNLKEQLKRVDVVLEVRDARIPLATRHPQVSEWVGSKAQVLVINRI CEEEECCCHHHHHHHHHHHHHHHHHHHEEECCCCCCCCCCCCCHHHHCCCCCEEEEEEHH DMISSEVMKIWTEWFEANGEMPYFTNAQLGDGVKNLAKAVREAGRAVNLRRRDRGMLPRP HHHHHHHHHHHHHHHHCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHCCHHHHCCCCCCCC VRAVVIGFPNVGKSALINRLLKRKVVESARRPGVTKQLRWVRISDEIELLDAPGVIPSQI CEEEEEECCCCCHHHHHHHHHHHHHHHHHHCCCCCHHEEEEEECCCEEEECCCCCCHHHH KNREDAIKLAICEDIGDAAYDNQQVAASMIDFLTFLETDSNGFVSTSCLKYRYQLEAHNY CCHHHHEEEEHHHHCCCHHCCCHHHHHHHHHHHHHHHCCCCCCEEHHHHHEEEEEECCCC TGESYLHELANQIYQGDVERTSRRILDDFRKGFLGKISLELPPFK CCHHHHHHHHHHHHCCHHHHHHHHHHHHHHCCCCEEEEECCCCCC >Mature Secondary Structure TIQWYPGHIAKAERNLKEQLKRVDVVLEVRDARIPLATRHPQVSEWVGSKAQVLVINRI EEEECCCHHHHHHHHHHHHHHHHHHHEEECCCCCCCCCCCCCHHHHCCCCCEEEEEEHH DMISSEVMKIWTEWFEANGEMPYFTNAQLGDGVKNLAKAVREAGRAVNLRRRDRGMLPRP HHHHHHHHHHHHHHHHCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHCCHHHHCCCCCCCC VRAVVIGFPNVGKSALINRLLKRKVVESARRPGVTKQLRWVRISDEIELLDAPGVIPSQI CEEEEEECCCCCHHHHHHHHHHHHHHHHHHCCCCCHHEEEEEECCCEEEECCCCCCHHHH KNREDAIKLAICEDIGDAAYDNQQVAASMIDFLTFLETDSNGFVSTSCLKYRYQLEAHNY CCHHHHEEEEHHHHCCCHHCCCHHHHHHHHHHHHHHHCCCCCCEEHHHHHEEEEEECCCC TGESYLHELANQIYQGDVERTSRRILDDFRKGFLGKISLELPPFK CCHHHHHHHHHHHHCCHHHHHHHHHHHHHHCCCCEEEEECCCCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 10.0
TargetDB status: NA
Availability: NA
References: 9384377 [H]