| Definition | Rickettsia conorii str. Malish 7, complete genome. |
|---|---|
| Accession | NC_003103 |
| Length | 1,268,755 |
Click here to switch to the map view.
The map label for this gene is nuoG [H]
Identifier: 15893154
GI number: 15893154
Start: 1135580
End: 1137610
Strand: Reverse
Name: nuoG [H]
Synonym: RC1231
Alternate gene names: 15893154
Gene position: 1137610-1135580 (Counterclockwise)
Preceding gene: 15893155
Following gene: 15893153
Centisome position: 89.66
GC content: 37.22
Gene sequence:
>2031_bases TTGGATAAAATAAAAATGATAAAGCTGAACGTAGACGGTTCTGAAATAGAAGTATCAGAAGGTAGCACCGTTTATCAAGC CTGTACACAAGCAGGAAAAGAAATCCCTCATTTTTGTTATCATCAGCGTCTAAAAATTGCTGGTAATTGCCGTATGTGCT TGGTTGAAATGGAAAAATCACCAAAGCCTATAGCTTCTTGTGCTATGCCGGTAAGTAACGGTATGGTTATTCATACCGAT ACGCCGATGGTAAAAAAAGCACGTGAAGGGGTGATGGAGTTTTTACTGATTAACCATCCTTTAGATTGTCCTATTTGTGA TCAGGGCGGAGAGTGTAATTTACAGGATCAGGCTTTCAGATACGGCAAAGGTACTAATAGATTCCACGAAAATAAGAGAT CTATTAAAGATAAATATATGGGACCGTTGATTAAAACAGCGATGACTAGATGCATACAATGCACAAGATGTATTAGATTT GCGAGCGATATAGCGGGAATAGAGGAAATAGGAGCTATTCACCGTGGAGAACACATTGAAGTAACTTCATATTTAGAGCA AACTTTAGATTCCGAAATTTCCGGTAATATGATCGATATTTGTCCCGTCGGTGCTTTGAACTCTAAGCCTTATGCTTTTA AAGCTCGTAAATGGGAGCTAAAACATACCGCTAGCATTGGAGTGCATGATGCCGAAGGCTCTAATATTCGTATTGATAGT AGAGGCGATGAGGTAATGAGGATATTACCTCGTGTTAATGAAGAAATAAATGAAGAGTGGCTTTCGGATAAGAATCGTTT TAGTTATGACGGTTTAAAATATCAGCGCTTGGATCGTCCTTATATCAGAAAAAACGGTAAGTTAGTAGAAGCTAGCTGGA GTGAAGCTTTAAAGACAGTAGCGGATAAAATAAAATCCGTAAAACCAGAAAAGATTGTTGCTATTGCTGGTTCTCTCTCT TCTGTCGAAGCAATGTTTATGTTAAAAACATTATTGCAAAAGCTTGGCTCTAATAATTACAGCGTTAATCAGTTTGACTA TAAACTAGATACCATGCAGCGAGGTAATTATTTATTTAATACTACTATTGCAGGGATAGAAAAGGCTGATTTATGTCTGC TAATCGGAGCAAATCCAAGGCAAATAGCTCCAGTATTAAATAGTAGAATAGGTATGCGAGTACGTGCCGACTCACTAAAA GTAGCAAGAATAGGTGGGGGGCATAACCAAACCTATAAAATTCAGGATTTAGGAAGTGATATTAAGATTATTGAGGAGCT AGCCATTGGTACTCATGAGTTTACGAAAGCCTTAAAAGCAGCAAAATATCTGATGATTATAGTAGGTGACGGTGTATATG CAAGAGATGACGGATATGCTATATTGTCGCTTATTCATAAGATAGTGACTGAATATAATATTATGCGTGATGATTGGAAA GGTTTTAATATATTGCATAATCACGCTTCTATAGTTGGCGGTCTTGATATTGGTTTTAATACTCCTATTAAGCTCGAAGA GTTGGAACTCGCTTATTTACTTGGAACGGACGCCATCCCATTTGATAAGCTGAAATCGACTTTTATAATATATCAAGGAC ATCACGGGGACGCAGGTGCTAGCAGTGCTGATGTAATTTTACCTGCGGCTGCTTATACCGAGCAGAGCGGAATTTACGTA AATTTAGAAGGTAGACCGCAAATAGCAGAAAAAGCAGTATCGCCTGTAGGGGTAGCTAAAGAAGATATAGAAATTATTAA AGAGCTTGCCGGTTATCTAAAAATAGATATCGGAATGGATAATTTGCAAGAAGTAAGAGTAAGACTTGCTAAAGAATATA AGGTATTTGCTAGTATTGATAGAATTATAGAAAATAAATTTAGTAAGTTTAGCTCTAAAGATAAGTTATCAAAAGAGCCT ATAACTGCAGAACCTATTAATTATTATATGACTGACGTGATTAGTAAAAATTCGGTCACTATGGCTAAGTGCGTTGAGGC TAAGGAAGCAAGAGACGAGGAGGTGGCATGA
Upstream 100 bases:
>100_bases TAGTACTATACGTTATACTCGCTGTTTGGTATATACTTCGTGTTGCCATCGGTTTTAAATATATGATAGAAGACAAAGCA TACCCAAACCCTATGACTTA
Downstream 100 bases:
>100_bases TGAAAAATATGCTATTCTCACCCCGTATGTCATTCCTGCAAAAGCTGGATTCTCACTTTTGCGGGAATGATATAATAAGA GTACAACCATGCTAGAACTC
Product: NADH dehydrogenase subunit G
Products: NA
Alternate protein names: NADH dehydrogenase I subunit G; NDH-1 subunit G [H]
Number of amino acids: Translated: 676; Mature: 676
Protein sequence:
>676_residues MDKIKMIKLNVDGSEIEVSEGSTVYQACTQAGKEIPHFCYHQRLKIAGNCRMCLVEMEKSPKPIASCAMPVSNGMVIHTD TPMVKKAREGVMEFLLINHPLDCPICDQGGECNLQDQAFRYGKGTNRFHENKRSIKDKYMGPLIKTAMTRCIQCTRCIRF ASDIAGIEEIGAIHRGEHIEVTSYLEQTLDSEISGNMIDICPVGALNSKPYAFKARKWELKHTASIGVHDAEGSNIRIDS RGDEVMRILPRVNEEINEEWLSDKNRFSYDGLKYQRLDRPYIRKNGKLVEASWSEALKTVADKIKSVKPEKIVAIAGSLS SVEAMFMLKTLLQKLGSNNYSVNQFDYKLDTMQRGNYLFNTTIAGIEKADLCLLIGANPRQIAPVLNSRIGMRVRADSLK VARIGGGHNQTYKIQDLGSDIKIIEELAIGTHEFTKALKAAKYLMIIVGDGVYARDDGYAILSLIHKIVTEYNIMRDDWK GFNILHNHASIVGGLDIGFNTPIKLEELELAYLLGTDAIPFDKLKSTFIIYQGHHGDAGASSADVILPAAAYTEQSGIYV NLEGRPQIAEKAVSPVGVAKEDIEIIKELAGYLKIDIGMDNLQEVRVRLAKEYKVFASIDRIIENKFSKFSSKDKLSKEP ITAEPINYYMTDVISKNSVTMAKCVEAKEARDEEVA
Sequences:
>Translated_676_residues MDKIKMIKLNVDGSEIEVSEGSTVYQACTQAGKEIPHFCYHQRLKIAGNCRMCLVEMEKSPKPIASCAMPVSNGMVIHTD TPMVKKAREGVMEFLLINHPLDCPICDQGGECNLQDQAFRYGKGTNRFHENKRSIKDKYMGPLIKTAMTRCIQCTRCIRF ASDIAGIEEIGAIHRGEHIEVTSYLEQTLDSEISGNMIDICPVGALNSKPYAFKARKWELKHTASIGVHDAEGSNIRIDS RGDEVMRILPRVNEEINEEWLSDKNRFSYDGLKYQRLDRPYIRKNGKLVEASWSEALKTVADKIKSVKPEKIVAIAGSLS SVEAMFMLKTLLQKLGSNNYSVNQFDYKLDTMQRGNYLFNTTIAGIEKADLCLLIGANPRQIAPVLNSRIGMRVRADSLK VARIGGGHNQTYKIQDLGSDIKIIEELAIGTHEFTKALKAAKYLMIIVGDGVYARDDGYAILSLIHKIVTEYNIMRDDWK GFNILHNHASIVGGLDIGFNTPIKLEELELAYLLGTDAIPFDKLKSTFIIYQGHHGDAGASSADVILPAAAYTEQSGIYV NLEGRPQIAEKAVSPVGVAKEDIEIIKELAGYLKIDIGMDNLQEVRVRLAKEYKVFASIDRIIENKFSKFSSKDKLSKEP ITAEPINYYMTDVISKNSVTMAKCVEAKEARDEEVA >Mature_676_residues MDKIKMIKLNVDGSEIEVSEGSTVYQACTQAGKEIPHFCYHQRLKIAGNCRMCLVEMEKSPKPIASCAMPVSNGMVIHTD TPMVKKAREGVMEFLLINHPLDCPICDQGGECNLQDQAFRYGKGTNRFHENKRSIKDKYMGPLIKTAMTRCIQCTRCIRF ASDIAGIEEIGAIHRGEHIEVTSYLEQTLDSEISGNMIDICPVGALNSKPYAFKARKWELKHTASIGVHDAEGSNIRIDS RGDEVMRILPRVNEEINEEWLSDKNRFSYDGLKYQRLDRPYIRKNGKLVEASWSEALKTVADKIKSVKPEKIVAIAGSLS SVEAMFMLKTLLQKLGSNNYSVNQFDYKLDTMQRGNYLFNTTIAGIEKADLCLLIGANPRQIAPVLNSRIGMRVRADSLK VARIGGGHNQTYKIQDLGSDIKIIEELAIGTHEFTKALKAAKYLMIIVGDGVYARDDGYAILSLIHKIVTEYNIMRDDWK GFNILHNHASIVGGLDIGFNTPIKLEELELAYLLGTDAIPFDKLKSTFIIYQGHHGDAGASSADVILPAAAYTEQSGIYV NLEGRPQIAEKAVSPVGVAKEDIEIIKELAGYLKIDIGMDNLQEVRVRLAKEYKVFASIDRIIENKFSKFSSKDKLSKEP ITAEPINYYMTDVISKNSVTMAKCVEAKEARDEEVA
Specific function: NDH-1 shuttles electrons from NADH, via FMN and iron- sulfur (Fe-S) centers, to quinones in the respiratory chain. Couples the redox reaction to proton translocation (for every two electrons transferred, four hydrogen ions are translocated across the cyto
COG id: COG1034
COG function: function code C; NADH dehydrogenase/NADH:ubiquinone oxidoreductase 75 kD subunit (chain G)
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 2Fe-2S ferredoxin-type domain [H]
Homologues:
Organism=Homo sapiens, GI33519475, Length=683, Percent_Identity=49.6339677891654, Blast_Score=657, Evalue=0.0, Organism=Escherichia coli, GI145693161, Length=404, Percent_Identity=30.9405940594059, Blast_Score=221, Evalue=1e-58, Organism=Caenorhabditis elegans, GI17565758, Length=683, Percent_Identity=44.0702781844802, Blast_Score=576, Evalue=1e-164, Organism=Caenorhabditis elegans, GI32566231, Length=576, Percent_Identity=47.3958333333333, Blast_Score=546, Evalue=1e-155, Organism=Caenorhabditis elegans, GI193209088, Length=253, Percent_Identity=56.5217391304348, Blast_Score=325, Evalue=6e-89, Organism=Drosophila melanogaster, GI24640559, Length=692, Percent_Identity=46.5317919075145, Blast_Score=609, Evalue=1e-174, Organism=Drosophila melanogaster, GI24640557, Length=692, Percent_Identity=46.5317919075145, Blast_Score=609, Evalue=1e-174,
Paralogues:
None
Copy number: 60 Molecules/Cell In: Stationary Phase, Rich Media (Based on E. coli). [C]
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR012675 - InterPro: IPR001041 - InterPro: IPR006656 - InterPro: IPR000283 - InterPro: IPR010228 - InterPro: IPR019574 - InterPro: IPR015405 [H]
Pfam domain/function: PF09326 DUF1982; PF00111 Fer2; PF00384 Molybdopterin; PF10588 NADH-G_4Fe-4S_3 [H]
EC number: =1.6.99.5 [H]
Molecular weight: Translated: 75426; Mature: 75426
Theoretical pI: Translated: 7.20; Mature: 7.20
Prosite motif: PS00641 COMPLEX1_75K_1 ; PS00642 COMPLEX1_75K_2 ; PS00643 COMPLEX1_75K_3 ; PS51085 2FE2S_FER_2
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
2.1 %Cys (Translated Protein) 3.1 %Met (Translated Protein) 5.2 %Cys+Met (Translated Protein) 2.1 %Cys (Mature Protein) 3.1 %Met (Mature Protein) 5.2 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MDKIKMIKLNVDGSEIEVSEGSTVYQACTQAGKEIPHFCYHQRLKIAGNCRMCLVEMEKS CCCEEEEEEECCCCEEEECCCCHHHHHHHHHHHCCHHHHHHHHHEECCCCEEEEEEECCC PKPIASCAMPVSNGMVIHTDTPMVKKAREGVMEFLLINHPLDCPICDQGGECNLQDQAFR CCCHHHHCCCCCCCEEEECCCHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCHHHHHH YGKGTNRFHENKRSIKDKYMGPLIKTAMTRCIQCTRCIRFASDIAGIEEIGAIHRGEHIE CCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHCCCCEE VTSYLEQTLDSEISGNMIDICPVGALNSKPYAFKARKWELKHTASIGVHDAEGSNIRIDS HHHHHHHHHHHHHCCCEEEEECCCCCCCCCCEEECEEEEEEECCEECEECCCCCEEEECC RGDEVMRILPRVNEEINEEWLSDKNRFSYDGLKYQRLDRPYIRKNGKLVEASWSEALKTV CCHHHHHHHHHHHHHHHHHHHCCCCCCCCCCEEHHHCCCCHHHCCCCEEECCHHHHHHHH ADKIKSVKPEKIVAIAGSLSSVEAMFMLKTLLQKLGSNNYSVNQFDYKLDTMQRGNYLFN HHHHHCCCCCEEEEEECCHHHHHHHHHHHHHHHHHCCCCCEECEEEEEEHHHHCCCEEEE TTIAGIEKADLCLLIGANPRQIAPVLNSRIGMRVRADSLKVARIGGGHNQTYKIQDLGSD EEECCCCCCCEEEEECCCCHHHHHHHHCCCCCEEECCCEEEEEECCCCCCEEEEHCCCCH IKIIEELAIGTHEFTKALKAAKYLMIIVGDGVYARDDGYAILSLIHKIVTEYNIMRDDWK HHHHHHHHCCHHHHHHHHHHCEEEEEEECCCEEECCCCHHHHHHHHHHHHHHHHHHCCCC GFNILHNHASIVGGLDIGFNTPIKLEELELAYLLGTDAIPFDKLKSTFIIYQGHHGDAGA CCCEEECCHHHEECEECCCCCCCEEHHEEEEEEECCCCCCHHHCCCEEEEEECCCCCCCC SSADVILPAAAYTEQSGIYVNLEGRPQIAEKAVSPVGVAKEDIEIIKELAGYLKIDIGMD CCCCEEEEEHHEECCCCEEEEECCCCHHHHHHCCCCCCCHHHHHHHHHHHHHEEEECCCC NLQEVRVRLAKEYKVFASIDRIIENKFSKFSSKDKLSKEPITAEPINYYMTDVISKNSVT HHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCHHHHHHHHHCCCCCH MAKCVEAKEARDEEVA HHHHHHHHHCCCCCCC >Mature Secondary Structure MDKIKMIKLNVDGSEIEVSEGSTVYQACTQAGKEIPHFCYHQRLKIAGNCRMCLVEMEKS CCCEEEEEEECCCCEEEECCCCHHHHHHHHHHHCCHHHHHHHHHEECCCCEEEEEEECCC PKPIASCAMPVSNGMVIHTDTPMVKKAREGVMEFLLINHPLDCPICDQGGECNLQDQAFR CCCHHHHCCCCCCCEEEECCCHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCHHHHHH YGKGTNRFHENKRSIKDKYMGPLIKTAMTRCIQCTRCIRFASDIAGIEEIGAIHRGEHIE CCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHCCCCEE VTSYLEQTLDSEISGNMIDICPVGALNSKPYAFKARKWELKHTASIGVHDAEGSNIRIDS HHHHHHHHHHHHHCCCEEEEECCCCCCCCCCEEECEEEEEEECCEECEECCCCCEEEECC RGDEVMRILPRVNEEINEEWLSDKNRFSYDGLKYQRLDRPYIRKNGKLVEASWSEALKTV CCHHHHHHHHHHHHHHHHHHHCCCCCCCCCCEEHHHCCCCHHHCCCCEEECCHHHHHHHH ADKIKSVKPEKIVAIAGSLSSVEAMFMLKTLLQKLGSNNYSVNQFDYKLDTMQRGNYLFN HHHHHCCCCCEEEEEECCHHHHHHHHHHHHHHHHHCCCCCEECEEEEEEHHHHCCCEEEE TTIAGIEKADLCLLIGANPRQIAPVLNSRIGMRVRADSLKVARIGGGHNQTYKIQDLGSD EEECCCCCCCEEEEECCCCHHHHHHHHCCCCCEEECCCEEEEEECCCCCCEEEEHCCCCH IKIIEELAIGTHEFTKALKAAKYLMIIVGDGVYARDDGYAILSLIHKIVTEYNIMRDDWK HHHHHHHHCCHHHHHHHHHHCEEEEEEECCCEEECCCCHHHHHHHHHHHHHHHHHHCCCC GFNILHNHASIVGGLDIGFNTPIKLEELELAYLLGTDAIPFDKLKSTFIIYQGHHGDAGA CCCEEECCHHHEECEECCCCCCCEEHHEEEEEEECCCCCCHHHCCCEEEEEECCCCCCCC SSADVILPAAAYTEQSGIYVNLEGRPQIAEKAVSPVGVAKEDIEIIKELAGYLKIDIGMD CCCCEEEEEHHEECCCCEEEEECCCCHHHHHHCCCCCCCHHHHHHHHHHHHHEEEECCCC NLQEVRVRLAKEYKVFASIDRIIENKFSKFSSKDKLSKEPITAEPINYYMTDVISKNSVT HHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCHHHHHHHHHCCCCCH MAKCVEAKEARDEEVA HHHHHHHHHCCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 11557893 [H]