| Definition | Geobacter sulfurreducens PCA chromosome, complete genome. |
|---|---|
| Accession | NC_002939 |
| Length | 3,814,139 |
Click here to switch to the map view.
The map label for this gene is hoxF [H]
Identifier: 39997815
GI number: 39997815
Start: 2997688
End: 2999400
Strand: Reverse
Name: hoxF [H]
Synonym: GSU2721
Alternate gene names: 39997815
Gene position: 2999400-2997688 (Counterclockwise)
Preceding gene: 39997816
Following gene: 39997814
Centisome position: 78.64
GC content: 69.06
Gene sequence:
>1713_bases ATGAACCCCGCCGATCTCCATGCCATGGCCCGGGAAGAACAGGCCCGCCAGGAGGCGCTGCGGTGCCGTATCATGGTCTG TGCCGGTACCCCCTGTCTTTCCGCCGGCGCACTGGCGGTCCTGGACGCGCTGCGCCAGGCGGTGGAGGAGAGCCGGCTCG ATGCGGAGATCGAGGCCGTCAGCACCGGCTGCATGGGGCCGTGCAGCCGCGGTCCCCTCGTGAAAGTGGCAGTTCAGGGG AAACCCGAGATCGTCTACGAGCGCGTCACCCCCGAACTGGCCCGCCAGATTCTCTACTCGGTGGTGAAGGGGCGCCGGCC GCCGACGGCCTCGCCGCTGCCGCCGGATCACCCCTATTTCACCCGCCAGATGAAGATCGTCTTGGCCAACTGCGGTTCCA TCGACCCCGAGCGGATCGAGGAGTATGTGGCCACGGGGGGCTACGATGCCCTTGCCCACGCCCTGCACGAGATGACCCCC GAGGATGTCTGTCGCGAGATCTCCGCTTCGGGACTGCGGGGGCGGGGGGGGGCCGGCTATCCGGCCGGCGTCAAGTGGAA CCTGGCCCGCAAGGCGCCGGGCGAGCGGAAATACGTGGTGGCCAACGGCGACGAGGGGGACCCGGGCGCCTACATGGACC GCTCCGTCATGGAGTCGGACCCCCACCGCATCCTGGAAGGAATGGCCATTGCCGGCTACGCCATCGGCGCGGATCAGGGC TACATCTACGTCCGGGGCGAGTACTACCTGGCCGGAAGGCGGCTCGAGGCCGCCATCCGCGACGCCGAGCGCAAGGGGCT CCTGGGAAGCCGGGTGCTCGGCAGCAACTTCAGTTTCCGCATCGACATCCGCACCGGCGCCGGCGCCTTTGTCTGCGGCG AGGAAACCTCGCTCATGGCTTCCATCATGGGGCGGCGCGGACAGCCCTGGCACCGGCCGCCCTATCCGGCCCAGCGGGGG CTCTGGGGGTGTCCGACCCTCATCAATAACGTGGAGACCCTTGCCACCGTCCCGGCTATCATCGGACGCGGGGCCACCTG GTACGCCGGCATCGGCTCGACCCGGAGCCCGGGAACCAAGGTCTATGCCCTGGCCGGCCAGGTGGAGACCGCCGGCCTGA TCGAAGTCCCCATGGGTACCACGCTGCGGGAGGTGGTGTTCGACATCGGCGGCGGAATCCCCGGCGGCAAGCGCTTCAAG GCTGCCCAGTCGGGCGGCCCTTCGGGCGGCTGCATTCCGGCCGAACACCTGGACACCCCCCTCGATTACGAAAGTATGGA GCGGATCGGCACCATCATGGGCTCCGGCGGACTTATCATCATGGACGAGACGAGCTGCATGCCCGACGTCGCCTCGTTTT TCCTCGATTTCTGCCGGGACGAGAGCTGCGGCAAGTGCATCCCGTGCCGCGTCGGCAGCATGGAGATGCACCGGCTGCTG CGCCGCATAACCTCCGGCACCGCTTGGCCGGACGACCTGCGCCGGCTGGAGGAGCTCTGCGATCTGATGGGCGCCACGAG CCTCTGTGGTCTCGGCCAGACCGCGCCCAACCCGGTGGTGAGCACCCTGCGCTACTTCCGGCACGAATACGAGGCCCACA TCCGCGAGCGCCGCTGCCCGGCGGGCCGCTGCACCATGGCTGCCGAGCAGGAGCCCGGACCCGGCGGCAAGGCACTCCTG CACGCCGTCGGCGTCCCTGGGGAGGTAGGCTGA
Upstream 100 bases:
>100_bases CCGATTCGGCCGCCGCCGCCGTCCGGGTCATGCTGGCGGAAAAGAGCCCGGCCCGCGCAGAAACGGTCCGCCCGGTTCGC CGCCGCAAGGGTGAAGGCCA
Downstream 100 bases:
>100_bases TGCCGGTCATTACTCTGACCATCGACGACGAACTGATCAGCGGTCGCGAGGGGGAAACCCTGCTCCAGGTGATCAAGGAA CACGGCATATCGCTCCCCAC
Product: NAD-reducing hydrogenase subunit alpha
Products: NA
Alternate protein names: NADH dehydrogenase I subunit F 2; NDH-1 subunit F 2 [H]
Number of amino acids: Translated: 570; Mature: 570
Protein sequence:
>570_residues MNPADLHAMAREEQARQEALRCRIMVCAGTPCLSAGALAVLDALRQAVEESRLDAEIEAVSTGCMGPCSRGPLVKVAVQG KPEIVYERVTPELARQILYSVVKGRRPPTASPLPPDHPYFTRQMKIVLANCGSIDPERIEEYVATGGYDALAHALHEMTP EDVCREISASGLRGRGGAGYPAGVKWNLARKAPGERKYVVANGDEGDPGAYMDRSVMESDPHRILEGMAIAGYAIGADQG YIYVRGEYYLAGRRLEAAIRDAERKGLLGSRVLGSNFSFRIDIRTGAGAFVCGEETSLMASIMGRRGQPWHRPPYPAQRG LWGCPTLINNVETLATVPAIIGRGATWYAGIGSTRSPGTKVYALAGQVETAGLIEVPMGTTLREVVFDIGGGIPGGKRFK AAQSGGPSGGCIPAEHLDTPLDYESMERIGTIMGSGGLIIMDETSCMPDVASFFLDFCRDESCGKCIPCRVGSMEMHRLL RRITSGTAWPDDLRRLEELCDLMGATSLCGLGQTAPNPVVSTLRYFRHEYEAHIRERRCPAGRCTMAAEQEPGPGGKALL HAVGVPGEVG
Sequences:
>Translated_570_residues MNPADLHAMAREEQARQEALRCRIMVCAGTPCLSAGALAVLDALRQAVEESRLDAEIEAVSTGCMGPCSRGPLVKVAVQG KPEIVYERVTPELARQILYSVVKGRRPPTASPLPPDHPYFTRQMKIVLANCGSIDPERIEEYVATGGYDALAHALHEMTP EDVCREISASGLRGRGGAGYPAGVKWNLARKAPGERKYVVANGDEGDPGAYMDRSVMESDPHRILEGMAIAGYAIGADQG YIYVRGEYYLAGRRLEAAIRDAERKGLLGSRVLGSNFSFRIDIRTGAGAFVCGEETSLMASIMGRRGQPWHRPPYPAQRG LWGCPTLINNVETLATVPAIIGRGATWYAGIGSTRSPGTKVYALAGQVETAGLIEVPMGTTLREVVFDIGGGIPGGKRFK AAQSGGPSGGCIPAEHLDTPLDYESMERIGTIMGSGGLIIMDETSCMPDVASFFLDFCRDESCGKCIPCRVGSMEMHRLL RRITSGTAWPDDLRRLEELCDLMGATSLCGLGQTAPNPVVSTLRYFRHEYEAHIRERRCPAGRCTMAAEQEPGPGGKALL HAVGVPGEVG >Mature_570_residues MNPADLHAMAREEQARQEALRCRIMVCAGTPCLSAGALAVLDALRQAVEESRLDAEIEAVSTGCMGPCSRGPLVKVAVQG KPEIVYERVTPELARQILYSVVKGRRPPTASPLPPDHPYFTRQMKIVLANCGSIDPERIEEYVATGGYDALAHALHEMTP EDVCREISASGLRGRGGAGYPAGVKWNLARKAPGERKYVVANGDEGDPGAYMDRSVMESDPHRILEGMAIAGYAIGADQG YIYVRGEYYLAGRRLEAAIRDAERKGLLGSRVLGSNFSFRIDIRTGAGAFVCGEETSLMASIMGRRGQPWHRPPYPAQRG LWGCPTLINNVETLATVPAIIGRGATWYAGIGSTRSPGTKVYALAGQVETAGLIEVPMGTTLREVVFDIGGGIPGGKRFK AAQSGGPSGGCIPAEHLDTPLDYESMERIGTIMGSGGLIIMDETSCMPDVASFFLDFCRDESCGKCIPCRVGSMEMHRLL RRITSGTAWPDDLRRLEELCDLMGATSLCGLGQTAPNPVVSTLRYFRHEYEAHIRERRCPAGRCTMAAEQEPGPGGKALL HAVGVPGEVG
Specific function: NDH-1 shuttles electrons from NADH, via FMN and iron- sulfur (Fe-S) centers, to quinones in the respiratory chain. The immediate electron acceptor for the enzyme in this species is believed to be ubiquinone. Couples the redox reaction to proton translocat
COG id: COG1894
COG function: function code C; NADH:ubiquinone oxidoreductase, NADH-binding (51 kD) subunit
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the complex I 51 kDa subunit family [H]
Homologues:
Organism=Homo sapiens, GI260656005, Length=379, Percent_Identity=40.1055408970976, Blast_Score=300, Evalue=3e-81, Organism=Homo sapiens, GI20149568, Length=379, Percent_Identity=40.1055408970976, Blast_Score=300, Evalue=3e-81, Organism=Escherichia coli, GI1788620, Length=404, Percent_Identity=40.0990099009901, Blast_Score=331, Evalue=7e-92, Organism=Caenorhabditis elegans, GI17531727, Length=374, Percent_Identity=39.0374331550802, Blast_Score=286, Evalue=3e-77, Organism=Drosophila melanogaster, GI45550452, Length=378, Percent_Identity=39.9470899470899, Blast_Score=296, Evalue=3e-80, Organism=Drosophila melanogaster, GI19920794, Length=376, Percent_Identity=38.8297872340425, Blast_Score=292, Evalue=5e-79, Organism=Drosophila melanogaster, GI24653819, Length=385, Percent_Identity=31.6883116883117, Blast_Score=225, Evalue=8e-59, Organism=Drosophila melanogaster, GI24653817, Length=355, Percent_Identity=29.2957746478873, Blast_Score=191, Evalue=1e-48,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR001949 - InterPro: IPR019575 - InterPro: IPR011537 - InterPro: IPR011538 - InterPro: IPR019554 [H]
Pfam domain/function: PF01512 Complex1_51K; PF10589 NADH_4Fe-4S; PF10531 SLBB [H]
EC number: =1.6.99.5 [H]
Molecular weight: Translated: 61240; Mature: 61240
Theoretical pI: Translated: 6.71; Mature: 6.71
Prosite motif: PS00645 COMPLEX1_51K_2
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
3.3 %Cys (Translated Protein) 3.5 %Met (Translated Protein) 6.8 %Cys+Met (Translated Protein) 3.3 %Cys (Mature Protein) 3.5 %Met (Mature Protein) 6.8 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MNPADLHAMAREEQARQEALRCRIMVCAGTPCLSAGALAVLDALRQAVEESRLDAEIEAV CCCHHHHHHHHHHHHHHHHHHEEEEEEECCCCHHHHHHHHHHHHHHHHHHHHCCHHHHHH STGCMGPCSRGPLVKVAVQGKPEIVYERVTPELARQILYSVVKGRRPPTASPLPPDHPYF HCCCCCCCCCCCEEEEEECCCCCEEHHHCCHHHHHHHHHHHHHCCCCCCCCCCCCCCCCH TRQMKIVLANCGSIDPERIEEYVATGGYDALAHALHEMTPEDVCREISASGLRGRGGAGY HHHHEEEEECCCCCCHHHHHHHHHCCCHHHHHHHHHHCCHHHHHHHHHHCCCCCCCCCCC PAGVKWNLARKAPGERKYVVANGDEGDPGAYMDRSVMESDPHRILEGMAIAGYAIGADQG CCCCEEEECCCCCCCCEEEEECCCCCCCCHHHHHHHHHCCHHHHHHHHHHEEEEEECCCC YIYVRGEYYLAGRRLEAAIRDAERKGLLGSRVLGSNFSFRIDIRTGAGAFVCGEETSLMA EEEEEEEEEECCHHHHHHHHHHHHCCCCCCCEECCCCEEEEEEECCCCEEEECCHHHHHH SIMGRRGQPWHRPPYPAQRGLWGCPTLINNVETLATVPAIIGRGATWYAGIGSTRSPGTK HHHCCCCCCCCCCCCCHHCCCCCCHHHHHHHHHHHHHHHHHCCCCEEEECCCCCCCCCCE VYALAGQVETAGLIEVPMGTTLREVVFDIGGGIPGGKRFKAAQSGGPSGGCIPAEHLDTP EEEEECCCCCCCEEECCCCCHHHHHHHHHCCCCCCCCCEEHHCCCCCCCCCCCHHHCCCC LDYESMERIGTIMGSGGLIIMDETSCMPDVASFFLDFCRDESCGKCIPCRVGSMEMHRLL CCHHHHHHHHHHHCCCCEEEEECCCCCHHHHHHHHHHHCCCCCCCCCCCCCCCHHHHHHH RRITSGTAWPDDLRRLEELCDLMGATSLCGLGQTAPNPVVSTLRYFRHEYEAHIRERRCP HHHHCCCCCHHHHHHHHHHHHHHCCHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHHHCCC AGRCTMAAEQEPGPGGKALLHAVGVPGEVG CCCCCCCCCCCCCCCHHHHHHCCCCCCCCC >Mature Secondary Structure MNPADLHAMAREEQARQEALRCRIMVCAGTPCLSAGALAVLDALRQAVEESRLDAEIEAV CCCHHHHHHHHHHHHHHHHHHEEEEEEECCCCHHHHHHHHHHHHHHHHHHHHCCHHHHHH STGCMGPCSRGPLVKVAVQGKPEIVYERVTPELARQILYSVVKGRRPPTASPLPPDHPYF HCCCCCCCCCCCEEEEEECCCCCEEHHHCCHHHHHHHHHHHHHCCCCCCCCCCCCCCCCH TRQMKIVLANCGSIDPERIEEYVATGGYDALAHALHEMTPEDVCREISASGLRGRGGAGY HHHHEEEEECCCCCCHHHHHHHHHCCCHHHHHHHHHHCCHHHHHHHHHHCCCCCCCCCCC PAGVKWNLARKAPGERKYVVANGDEGDPGAYMDRSVMESDPHRILEGMAIAGYAIGADQG CCCCEEEECCCCCCCCEEEEECCCCCCCCHHHHHHHHHCCHHHHHHHHHHEEEEEECCCC YIYVRGEYYLAGRRLEAAIRDAERKGLLGSRVLGSNFSFRIDIRTGAGAFVCGEETSLMA EEEEEEEEEECCHHHHHHHHHHHHCCCCCCCEECCCCEEEEEEECCCCEEEECCHHHHHH SIMGRRGQPWHRPPYPAQRGLWGCPTLINNVETLATVPAIIGRGATWYAGIGSTRSPGTK HHHCCCCCCCCCCCCCHHCCCCCCHHHHHHHHHHHHHHHHHCCCCEEEECCCCCCCCCCE VYALAGQVETAGLIEVPMGTTLREVVFDIGGGIPGGKRFKAAQSGGPSGGCIPAEHLDTP EEEEECCCCCCCEEECCCCCHHHHHHHHHCCCCCCCCCEEHHCCCCCCCCCCCHHHCCCC LDYESMERIGTIMGSGGLIIMDETSCMPDVASFFLDFCRDESCGKCIPCRVGSMEMHRLL CCHHHHHHHHHHHCCCCEEEEECCCCCHHHHHHHHHHHCCCCCCCCCCCCCCCHHHHHHH RRITSGTAWPDDLRRLEELCDLMGATSLCGLGQTAPNPVVSTLRYFRHEYEAHIRERRCP HHHHCCCCCHHHHHHHHHHHHHHCCHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHHHCCC AGRCTMAAEQEPGPGGKALLHAVGVPGEVG CCCCCCCCCCCCCCCHHHHHHCCCCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 11481432 [H]