The gene/protein map for NC_003272 is currently unavailable.
Definition Nostoc sp. PCC 7120, complete genome.
Accession NC_003272
Length 6,413,771

Click here to switch to the map view.

The map label for this gene is hoxF [H]

Identifier: 17228247

GI number: 17228247

Start: 873380

End: 875014

Strand: Direct

Name: hoxF [H]

Synonym: alr0752

Alternate gene names: 17228247

Gene position: 873380-875014 (Clockwise)

Preceding gene: 17228246

Following gene: 17228250

Centisome position: 13.62

GC content: 47.09

Gene sequence:

>1635_bases
ATGGAACTGACTGAATTACTAGACATTGGCAGACAAGAACGCTCTCAACAGAAACCTGTGCAGATTCGCTGCTGTACGGC
GGCTGGTTGTCTGTCTGCGAATTCGCAAGCGGTTCAACAACAGTTAGAGCAGGCCGTCAAGGCTGAAGGTTTAGAGGGAG
AGGTACAAGTCTCTGGTGTTGGTTGTATGCGCTTGTGTTGTCAGGGGCCTTTGGTTGAGGTAGAGGGGAGTGGGGAAGAA
AAAACAAAACAAAGGCTTTATGAGAAGGTTACGCCTGAAGATGCGTCAGCAATTATTGGTGCTTTGAAGGGGAAAGAGGC
ACAATTGTCAGTTGTTAACTTAGAACAGCCATTTTTTACTTATCAAGCACCAATTGTTTTAGAGAATAGTGGCAAAATTG
ACCCAGAAAGGATTCAAGCTTATATTGCGGCTCAGGGTTATCAGGGGCTTTACCAAGTGTTGCGGGAGATGACACCGGCG
GCAGTTGTAGACAGTGTTAGTCGTAGTGGTTTGCGGGGGCGTGGTGGTGCTGGTTATCCCACGGGCTTGAAATGGGCGAC
GGTGGCTAAGGCGAAGGGAGAGCGCAAATTTGTCATCTGTAACGCAGATGAGGGAGATCCAGGGGCTTTCATGGATAGGA
GTGTGTTGGAAAGTGATCCGCATCGGGTATTGGAAGGAATGGCGATCGCTGCCTATGCTGTCGGTGCTAGTCAAGGTTAT
ATTTATGTCAGGGCAGAATATCCCATTGCCATCAAACGCCTACACACTGCCATTCATCAAGCCCAAAGGCTCGGTTTGTT
AGGTAGTAATATATTTGAGTCTCCCTTTGATTTTAAAATCGATATCCGCATCGGTGCAGGGGCTTATGTATGCGGCGAAG
AAACAGCCTTGATGGCTTCCATTGAAGGTAAACGCGGTGTCCCTCATCCCCGTCCTCCCTACCCGGCTGAATCTGGTTTA
TGGGGTTATCCTACTTTAATTAATAACGTCGAAACATTCGCCAATATTGCCCCCATTATTCGTAAAGGTGCGGACTGGTT
TGCTAGTATCGGCACGGCTAAAAGTAAAGGGACAAAAGTATTTGCTCTCGCTGGCAAAATCCGCAACACAGGCTTAATTG
AAGTGCCAATGGGTACATCCTTGCGGCAAATAGTGGCAGAAATGGGTGGTGGTATTCCCGATGGTGGTGTTGCCAAAGCT
GTACAAACAGGTGGCCCTTCTGGGGGATGTATTCCCGCTTCGGCTTTTGATACTCCTGTAGACTACGAATCTTTAACTAA
CTTGGGTTCCATGATGGGTTCTGGTGGGATGATTGTCATGGATGACACCACCAACATGGTAGATGTTGCCCGATTTTTTA
TGGAATTTTGTATGGATGAATCCTGCGGTAAGTGTATTCCTTGCCGGGTGGGGACGGTACAACTACATGGATTATTGAGC
AAGATTCGGGAAGGTAAGGCTTCACTTGCTGACTTAGAACTGTTAGAAGAACTGTGCGATATGGTAAAAAATACCAGCTT
GTGCGGTCTAGGTCAGTCTGCGCCTAATCCGGTATTTAGTACATTGCACTATTTCCGCGATGAATATTTGGCGTTGATAG
CTGTAGGAGCCGTTTCTCTAAATTCAACAGATTAA

Upstream 100 bases:

>100_bases
TTCAAGGGTTTAAATCCCCAAATCCAACTGTCTTTAATTTTGAATTTTGAATTTTGAATTGTTAAATTTGTTGCCTTGTT
GTGGAGAGTTGAGAGAAAAC

Downstream 100 bases:

>100_bases
TTAGACATCGCACTCCTCAAAACTACCAAAAAGCGATCGCGCTTTCCCAACATTACACAGGCGATAACTTCGTTAAGCTG
CGCTAACGCACTCTCCAAAA

Product: hydrogenase subunit

Products: NA

Alternate protein names: NADH dehydrogenase I subunit F 2; NDH-1 subunit F 2 [H]

Number of amino acids: Translated: 544; Mature: 544

Protein sequence:

>544_residues
MELTELLDIGRQERSQQKPVQIRCCTAAGCLSANSQAVQQQLEQAVKAEGLEGEVQVSGVGCMRLCCQGPLVEVEGSGEE
KTKQRLYEKVTPEDASAIIGALKGKEAQLSVVNLEQPFFTYQAPIVLENSGKIDPERIQAYIAAQGYQGLYQVLREMTPA
AVVDSVSRSGLRGRGGAGYPTGLKWATVAKAKGERKFVICNADEGDPGAFMDRSVLESDPHRVLEGMAIAAYAVGASQGY
IYVRAEYPIAIKRLHTAIHQAQRLGLLGSNIFESPFDFKIDIRIGAGAYVCGEETALMASIEGKRGVPHPRPPYPAESGL
WGYPTLINNVETFANIAPIIRKGADWFASIGTAKSKGTKVFALAGKIRNTGLIEVPMGTSLRQIVAEMGGGIPDGGVAKA
VQTGGPSGGCIPASAFDTPVDYESLTNLGSMMGSGGMIVMDDTTNMVDVARFFMEFCMDESCGKCIPCRVGTVQLHGLLS
KIREGKASLADLELLEELCDMVKNTSLCGLGQSAPNPVFSTLHYFRDEYLALIAVGAVSLNSTD

Sequences:

>Translated_544_residues
MELTELLDIGRQERSQQKPVQIRCCTAAGCLSANSQAVQQQLEQAVKAEGLEGEVQVSGVGCMRLCCQGPLVEVEGSGEE
KTKQRLYEKVTPEDASAIIGALKGKEAQLSVVNLEQPFFTYQAPIVLENSGKIDPERIQAYIAAQGYQGLYQVLREMTPA
AVVDSVSRSGLRGRGGAGYPTGLKWATVAKAKGERKFVICNADEGDPGAFMDRSVLESDPHRVLEGMAIAAYAVGASQGY
IYVRAEYPIAIKRLHTAIHQAQRLGLLGSNIFESPFDFKIDIRIGAGAYVCGEETALMASIEGKRGVPHPRPPYPAESGL
WGYPTLINNVETFANIAPIIRKGADWFASIGTAKSKGTKVFALAGKIRNTGLIEVPMGTSLRQIVAEMGGGIPDGGVAKA
VQTGGPSGGCIPASAFDTPVDYESLTNLGSMMGSGGMIVMDDTTNMVDVARFFMEFCMDESCGKCIPCRVGTVQLHGLLS
KIREGKASLADLELLEELCDMVKNTSLCGLGQSAPNPVFSTLHYFRDEYLALIAVGAVSLNSTD
>Mature_544_residues
MELTELLDIGRQERSQQKPVQIRCCTAAGCLSANSQAVQQQLEQAVKAEGLEGEVQVSGVGCMRLCCQGPLVEVEGSGEE
KTKQRLYEKVTPEDASAIIGALKGKEAQLSVVNLEQPFFTYQAPIVLENSGKIDPERIQAYIAAQGYQGLYQVLREMTPA
AVVDSVSRSGLRGRGGAGYPTGLKWATVAKAKGERKFVICNADEGDPGAFMDRSVLESDPHRVLEGMAIAAYAVGASQGY
IYVRAEYPIAIKRLHTAIHQAQRLGLLGSNIFESPFDFKIDIRIGAGAYVCGEETALMASIEGKRGVPHPRPPYPAESGL
WGYPTLINNVETFANIAPIIRKGADWFASIGTAKSKGTKVFALAGKIRNTGLIEVPMGTSLRQIVAEMGGGIPDGGVAKA
VQTGGPSGGCIPASAFDTPVDYESLTNLGSMMGSGGMIVMDDTTNMVDVARFFMEFCMDESCGKCIPCRVGTVQLHGLLS
KIREGKASLADLELLEELCDMVKNTSLCGLGQSAPNPVFSTLHYFRDEYLALIAVGAVSLNSTD

Specific function: NDH-1 shuttles electrons from NADH, via FMN and iron- sulfur (Fe-S) centers, to quinones in the respiratory chain. The immediate electron acceptor for the enzyme in this species is believed to be ubiquinone. Couples the redox reaction to proton translocat

COG id: COG1894

COG function: function code C; NADH:ubiquinone oxidoreductase, NADH-binding (51 kD) subunit

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the complex I 51 kDa subunit family [H]

Homologues:

Organism=Homo sapiens, GI20149568, Length=373, Percent_Identity=39.6782841823056, Blast_Score=288, Evalue=7e-78,
Organism=Homo sapiens, GI260656005, Length=373, Percent_Identity=39.6782841823056, Blast_Score=288, Evalue=7e-78,
Organism=Escherichia coli, GI1788620, Length=412, Percent_Identity=39.5631067961165, Blast_Score=332, Evalue=5e-92,
Organism=Caenorhabditis elegans, GI17531727, Length=370, Percent_Identity=38.3783783783784, Blast_Score=283, Evalue=2e-76,
Organism=Drosophila melanogaster, GI45550452, Length=368, Percent_Identity=39.1304347826087, Blast_Score=283, Evalue=3e-76,
Organism=Drosophila melanogaster, GI19920794, Length=370, Percent_Identity=37.8378378378378, Blast_Score=281, Evalue=7e-76,
Organism=Drosophila melanogaster, GI24653819, Length=377, Percent_Identity=32.3607427055703, Blast_Score=221, Evalue=1e-57,
Organism=Drosophila melanogaster, GI24653817, Length=347, Percent_Identity=29.971181556196, Blast_Score=187, Evalue=2e-47,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR001949
- InterPro:   IPR019575
- InterPro:   IPR011537
- InterPro:   IPR011538
- InterPro:   IPR019554 [H]

Pfam domain/function: PF01512 Complex1_51K; PF10589 NADH_4Fe-4S; PF10531 SLBB [H]

EC number: =1.6.99.5 [H]

Molecular weight: Translated: 58065; Mature: 58065

Theoretical pI: Translated: 5.16; Mature: 5.16

Prosite motif: PS00645 COMPLEX1_51K_2

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

2.8 %Cys     (Translated Protein)
2.9 %Met     (Translated Protein)
5.7 %Cys+Met (Translated Protein)
2.8 %Cys     (Mature Protein)
2.9 %Met     (Mature Protein)
5.7 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MELTELLDIGRQERSQQKPVQIRCCTAAGCLSANSQAVQQQLEQAVKAEGLEGEVQVSGV
CCHHHHHHCCHHHHHCCCCEEEEEECHHHHCCCCHHHHHHHHHHHHHHCCCCCEEEECCH
GCMRLCCQGPLVEVEGSGEEKTKQRLYEKVTPEDASAIIGALKGKEAQLSVVNLEQPFFT
HHHHHHCCCCEEEECCCCHHHHHHHHHHHCCCCHHHHHHHHHCCCCCEEEEEECCCCCEE
YQAPIVLENSGKIDPERIQAYIAAQGYQGLYQVLREMTPAAVVDSVSRSGLRGRGGAGYP
EECCEEECCCCCCCHHHHHHHHHHHCHHHHHHHHHHCCHHHHHHHHHHCCCCCCCCCCCC
TGLKWATVAKAKGERKFVICNADEGDPGAFMDRSVLESDPHRVLEGMAIAAYAVGASQGY
CCCCEEEEHHCCCCEEEEEEECCCCCCCCHHHHHHHHCCHHHHHHHHHHHHEEEECCCCE
IYVRAEYPIAIKRLHTAIHQAQRLGLLGSNIFESPFDFKIDIRIGAGAYVCGEETALMAS
EEEEECCCHHHHHHHHHHHHHHHHHHHCCHHHCCCCCEEEEEEECCCEEEECCCCEEEEE
IEGKRGVPHPRPPYPAESGLWGYPTLINNVETFANIAPIIRKGADWFASIGTAKSKGTKV
CCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHCCCHHHHHCCCCCCCCCEE
FALAGKIRNTGLIEVPMGTSLRQIVAEMGGGIPDGGVAKAVQTGGPSGGCIPASAFDTPV
EEEECCCCCCCEEEECCCCHHHHHHHHHCCCCCCCHHHHHHHCCCCCCCCCCCCCCCCCC
DYESLTNLGSMMGSGGMIVMDDTTNMVDVARFFMEFCMDESCGKCIPCRVGTVQLHGLLS
CHHHHHHHHHHHCCCCEEEECCCCCHHHHHHHHHHHHCCCCCCCEECCCCCHHHHHHHHH
KIREGKASLADLELLEELCDMVKNTSLCGLGQSAPNPVFSTLHYFRDEYLALIAVGAVSL
HHHHCCHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHEEC
NSTD
CCCC
>Mature Secondary Structure
MELTELLDIGRQERSQQKPVQIRCCTAAGCLSANSQAVQQQLEQAVKAEGLEGEVQVSGV
CCHHHHHHCCHHHHHCCCCEEEEEECHHHHCCCCHHHHHHHHHHHHHHCCCCCEEEECCH
GCMRLCCQGPLVEVEGSGEEKTKQRLYEKVTPEDASAIIGALKGKEAQLSVVNLEQPFFT
HHHHHHCCCCEEEECCCCHHHHHHHHHHHCCCCHHHHHHHHHCCCCCEEEEEECCCCCEE
YQAPIVLENSGKIDPERIQAYIAAQGYQGLYQVLREMTPAAVVDSVSRSGLRGRGGAGYP
EECCEEECCCCCCCHHHHHHHHHHHCHHHHHHHHHHCCHHHHHHHHHHCCCCCCCCCCCC
TGLKWATVAKAKGERKFVICNADEGDPGAFMDRSVLESDPHRVLEGMAIAAYAVGASQGY
CCCCEEEEHHCCCCEEEEEEECCCCCCCCHHHHHHHHCCHHHHHHHHHHHHEEEECCCCE
IYVRAEYPIAIKRLHTAIHQAQRLGLLGSNIFESPFDFKIDIRIGAGAYVCGEETALMAS
EEEEECCCHHHHHHHHHHHHHHHHHHHCCHHHCCCCCEEEEEEECCCEEEECCCCEEEEE
IEGKRGVPHPRPPYPAESGLWGYPTLINNVETFANIAPIIRKGADWFASIGTAKSKGTKV
CCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHCCCHHHHHCCCCCCCCCEE
FALAGKIRNTGLIEVPMGTSLRQIVAEMGGGIPDGGVAKAVQTGGPSGGCIPASAFDTPV
EEEECCCCCCCEEEECCCCHHHHHHHHHCCCCCCCHHHHHHHCCCCCCCCCCCCCCCCCC
DYESLTNLGSMMGSGGMIVMDDTTNMVDVARFFMEFCMDESCGKCIPCRVGTVQLHGLLS
CHHHHHHHHHHHCCCCEEEECCCCCHHHHHHHHHHHHCCCCCCCEECCCCCHHHHHHHHH
KIREGKASLADLELLEELCDMVKNTSLCGLGQSAPNPVFSTLHYFRDEYLALIAVGAVSL
HHHHCCHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHEEC
NSTD
CCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 11481432 [H]