Definition Ehrlichia chaffeensis str. Arkansas, complete genome.
Accession NC_007799
Length 1,176,248

Click here to switch to the map view.

The map label for this gene is nuoF [H]

Identifier: 88658598

GI number: 88658598

Start: 548735

End: 550018

Strand: Direct

Name: nuoF [H]

Synonym: ECH_0548

Alternate gene names: 88658598

Gene position: 548735-550018 (Clockwise)

Preceding gene: 88657953

Following gene: 88658202

Centisome position: 46.65

GC content: 34.19

Gene sequence:

>1284_bases
ATGTTAAAGGATAGTGATAAAGTATTTACTAATCTTAGTGGTCAATATTCTCCGTTTTTGAGATCTGCAAAAAGTAGGGG
TATTTGGAGTAATATTTTAGAAATATTAAACTTAGGTCCTGAACATATTATTCAAGAAATAAAAAAATCAGGATTGCGTG
GTAGAGGTGGAGCAGGATTTTCTACAGGATTGAAATGGAGCTTCATGCCAAAAACTAGAAAAGAAGGACAGCCAGCATAT
TTAATAATTAATGCAGATGAATCAGAACCTGGTACATGTAAGGACCGTGATATATTAAGATATGACCCTCATAGGCTTAT
TGAAGGAATATTAATAGCTGGTTTTGCAATGAATGTAACTACAGCTTATATTTATATTCGTGGTGAGTTTTATAATGAGT
ATTTAGTATTATCTAAAGCTTTAGAGGAAGCTTATAAAGCTAAGTTAATAGGGAAGAATGCATGTAATTCTGGGTATGAT
TTAGATATTTTTATTCATAGAGGTGCTGGAGCATATATTTGTGGTGAGGAAACTGCTCAACTTGAATCATTAGAAGGAAG
AAAAGGTATGCCAAGATTGAAGCCTCCTTTTCCAGCTGCAATAGGGTTATATGGCTGTCCTACTACTATTAATAATGTTG
AAACTATTGCAACTGTTAGTGAGATCATGAGGAGAGGTAGTGATTGGTTTGCATCTCTCGGAAGAGAAAATAATACTGGT
ACTAAGATTTTTTGTATATCAGGTCATGTGAATAACCCATGTAATGTAGAAGAGGAATTAGGGATTCCCATGAAGGAGCT
TATAGAAAAATATGCAGGAGGTGTTCGTGGAGGATGGGATAATTTATTAGCAGTAATACCTGGTGGTTCATCAGTACCAA
TGCTTCCAAAGTCTATTTGTGACACTGTAAATATGGATTTTGATTCTTTAAGAGCTGTACAATCAGGGTTAGGTACTGCA
GGACTAATAGTTATGGACAAATCAACAGATCTAATAGCAGCTATAGAAAGATTATCACATTTTTATATGCATGAATCTTG
TGGACAATGTACACCATGTAGAGAAGGTACTGGTTGGATGTGGAGAATCATGAAGAAAATGGTAAAAGGTGATGCTACAT
CTGAAAGCATTGATTTATTATTGAATATTACACATCAAGTAGAAGGGCATACTATATGTGCTCTTGGTGATGCTGCAGCT
TGGCCTATACAAGGATTAATTAGACATTTTAGAAATGTTATTGAAGATCGGATAAGGGATTATAATAATGATAAATTAAC
TTAA

Upstream 100 bases:

>100_bases
ATGTAATATTGTTAGTATAGTCTTAATGTTAGCGGTGTTTGTATAGGTCGTTATTAATTCTGTTAGTTTTTTGGTAATTT
CTAATATTGTATAAGGCTTT

Downstream 100 bases:

>100_bases
TCTCTATGTGTTATGGTTTTTATTTGTATTTAAAAATATATCTGTTTTTCATGTTAATGTACTGTTAGGGGATTATATAT
AAGTAAATTTTTAACTTTTA

Product: NADH dehydrogenase I subunit F

Products: NA

Alternate protein names: NADH dehydrogenase I subunit F; NDH-1 subunit F [H]

Number of amino acids: Translated: 427; Mature: 427

Protein sequence:

>427_residues
MLKDSDKVFTNLSGQYSPFLRSAKSRGIWSNILEILNLGPEHIIQEIKKSGLRGRGGAGFSTGLKWSFMPKTRKEGQPAY
LIINADESEPGTCKDRDILRYDPHRLIEGILIAGFAMNVTTAYIYIRGEFYNEYLVLSKALEEAYKAKLIGKNACNSGYD
LDIFIHRGAGAYICGEETAQLESLEGRKGMPRLKPPFPAAIGLYGCPTTINNVETIATVSEIMRRGSDWFASLGRENNTG
TKIFCISGHVNNPCNVEEELGIPMKELIEKYAGGVRGGWDNLLAVIPGGSSVPMLPKSICDTVNMDFDSLRAVQSGLGTA
GLIVMDKSTDLIAAIERLSHFYMHESCGQCTPCREGTGWMWRIMKKMVKGDATSESIDLLLNITHQVEGHTICALGDAAA
WPIQGLIRHFRNVIEDRIRDYNNDKLT

Sequences:

>Translated_427_residues
MLKDSDKVFTNLSGQYSPFLRSAKSRGIWSNILEILNLGPEHIIQEIKKSGLRGRGGAGFSTGLKWSFMPKTRKEGQPAY
LIINADESEPGTCKDRDILRYDPHRLIEGILIAGFAMNVTTAYIYIRGEFYNEYLVLSKALEEAYKAKLIGKNACNSGYD
LDIFIHRGAGAYICGEETAQLESLEGRKGMPRLKPPFPAAIGLYGCPTTINNVETIATVSEIMRRGSDWFASLGRENNTG
TKIFCISGHVNNPCNVEEELGIPMKELIEKYAGGVRGGWDNLLAVIPGGSSVPMLPKSICDTVNMDFDSLRAVQSGLGTA
GLIVMDKSTDLIAAIERLSHFYMHESCGQCTPCREGTGWMWRIMKKMVKGDATSESIDLLLNITHQVEGHTICALGDAAA
WPIQGLIRHFRNVIEDRIRDYNNDKLT
>Mature_427_residues
MLKDSDKVFTNLSGQYSPFLRSAKSRGIWSNILEILNLGPEHIIQEIKKSGLRGRGGAGFSTGLKWSFMPKTRKEGQPAY
LIINADESEPGTCKDRDILRYDPHRLIEGILIAGFAMNVTTAYIYIRGEFYNEYLVLSKALEEAYKAKLIGKNACNSGYD
LDIFIHRGAGAYICGEETAQLESLEGRKGMPRLKPPFPAAIGLYGCPTTINNVETIATVSEIMRRGSDWFASLGRENNTG
TKIFCISGHVNNPCNVEEELGIPMKELIEKYAGGVRGGWDNLLAVIPGGSSVPMLPKSICDTVNMDFDSLRAVQSGLGTA
GLIVMDKSTDLIAAIERLSHFYMHESCGQCTPCREGTGWMWRIMKKMVKGDATSESIDLLLNITHQVEGHTICALGDAAA
WPIQGLIRHFRNVIEDRIRDYNNDKLT

Specific function: NDH-1 shuttles electrons from NADH, via FMN and iron- sulfur (Fe-S) centers, to quinones in the respiratory chain. Couples the redox reaction to proton translocation (for every two electrons transferred, four hydrogen ions are translocated across the cyto

COG id: COG1894

COG function: function code C; NADH:ubiquinone oxidoreductase, NADH-binding (51 kD) subunit

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the complex I 51 kDa subunit family [H]

Homologues:

Organism=Homo sapiens, GI20149568, Length=420, Percent_Identity=65.2380952380952, Blast_Score=590, Evalue=1e-168,
Organism=Homo sapiens, GI260656005, Length=420, Percent_Identity=65.2380952380952, Blast_Score=589, Evalue=1e-168,
Organism=Escherichia coli, GI1788620, Length=394, Percent_Identity=41.6243654822335, Blast_Score=321, Evalue=6e-89,
Organism=Caenorhabditis elegans, GI17531727, Length=426, Percent_Identity=62.6760563380282, Blast_Score=585, Evalue=1e-167,
Organism=Drosophila melanogaster, GI19920794, Length=418, Percent_Identity=65.311004784689, Blast_Score=584, Evalue=1e-167,
Organism=Drosophila melanogaster, GI45550452, Length=418, Percent_Identity=61.244019138756, Blast_Score=546, Evalue=1e-155,
Organism=Drosophila melanogaster, GI24653819, Length=421, Percent_Identity=48.4560570071259, Blast_Score=408, Evalue=1e-114,
Organism=Drosophila melanogaster, GI24653817, Length=421, Percent_Identity=44.8931116389549, Blast_Score=368, Evalue=1e-102,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR001949
- InterPro:   IPR019575
- InterPro:   IPR011537
- InterPro:   IPR011538
- InterPro:   IPR019554 [H]

Pfam domain/function: PF01512 Complex1_51K; PF10589 NADH_4Fe-4S; PF10531 SLBB [H]

EC number: =1.6.99.5 [H]

Molecular weight: Translated: 47196; Mature: 47196

Theoretical pI: Translated: 6.97; Mature: 6.97

Prosite motif: PS00645 COMPLEX1_51K_2

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

2.6 %Cys     (Translated Protein)
3.0 %Met     (Translated Protein)
5.6 %Cys+Met (Translated Protein)
2.6 %Cys     (Mature Protein)
3.0 %Met     (Mature Protein)
5.6 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MLKDSDKVFTNLSGQYSPFLRSAKSRGIWSNILEILNLGPEHIIQEIKKSGLRGRGGAGF
CCCCCCHHHHCCCCCCCHHHHHHHCCCHHHHHHHHHCCCHHHHHHHHHHCCCCCCCCCCC
STGLKWSFMPKTRKEGQPAYLIINADESEPGTCKDRDILRYDPHRLIEGILIAGFAMNVT
CCCCEEEECCCCCCCCCCEEEEEECCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHEEEE
TAYIYIRGEFYNEYLVLSKALEEAYKAKLIGKNACNSGYDLDIFIHRGAGAYICGEETAQ
EEEEEEEECHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCEEEEEEECCCCEEEECCHHHH
LESLEGRKGMPRLKPPFPAAIGLYGCPTTINNVETIATVSEIMRRGSDWFASLGRENNTG
HHHCCCCCCCCCCCCCCCCHHCCCCCCCCCCCHHHHHHHHHHHHCCCHHHHHCCCCCCCC
TKIFCISGHVNNPCNVEEELGIPMKELIEKYAGGVRGGWDNLLAVIPGGSSVPMLPKSIC
CEEEEEECCCCCCCCCHHHCCCCHHHHHHHHCCCCCCCCCCEEEEECCCCCCCCCCHHHH
DTVNMDFDSLRAVQSGLGTAGLIVMDKSTDLIAAIERLSHFYMHESCGQCTPCREGTGWM
HHCCCCHHHHHHHHHCCCCCEEEEEECCCHHHHHHHHHHHHHHHHHCCCCCCCCCCCCHH
WRIMKKMVKGDATSESIDLLLNITHQVEGHTICALGDAAAWPIQGLIRHFRNVIEDRIRD
HHHHHHHHCCCCCCCHHHEEEEEHHHCCCCEEEEECCCCCCCHHHHHHHHHHHHHHHHHC
YNNDKLT
CCCCCCC
>Mature Secondary Structure
MLKDSDKVFTNLSGQYSPFLRSAKSRGIWSNILEILNLGPEHIIQEIKKSGLRGRGGAGF
CCCCCCHHHHCCCCCCCHHHHHHHCCCHHHHHHHHHCCCHHHHHHHHHHCCCCCCCCCCC
STGLKWSFMPKTRKEGQPAYLIINADESEPGTCKDRDILRYDPHRLIEGILIAGFAMNVT
CCCCEEEECCCCCCCCCCEEEEEECCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHEEEE
TAYIYIRGEFYNEYLVLSKALEEAYKAKLIGKNACNSGYDLDIFIHRGAGAYICGEETAQ
EEEEEEEECHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCEEEEEEECCCCEEEECCHHHH
LESLEGRKGMPRLKPPFPAAIGLYGCPTTINNVETIATVSEIMRRGSDWFASLGRENNTG
HHHCCCCCCCCCCCCCCCCHHCCCCCCCCCCCHHHHHHHHHHHHCCCHHHHHCCCCCCCC
TKIFCISGHVNNPCNVEEELGIPMKELIEKYAGGVRGGWDNLLAVIPGGSSVPMLPKSIC
CEEEEEECCCCCCCCCHHHCCCCHHHHHHHHCCCCCCCCCCEEEEECCCCCCCCCCHHHH
DTVNMDFDSLRAVQSGLGTAGLIVMDKSTDLIAAIERLSHFYMHESCGQCTPCREGTGWM
HHCCCCHHHHHHHHHCCCCCEEEEEECCCHHHHHHHHHHHHHHHHHCCCCCCCCCCCCHH
WRIMKKMVKGDATSESIDLLLNITHQVEGHTICALGDAAAWPIQGLIRHFRNVIEDRIRD
HHHHHHHHCCCCCCCHHHEEEEEHHHCCCCEEEEECCCCCCCHHHHHHHHHHHHHHHHHC
YNNDKLT
CCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA