| Definition | Rhizobium etli CIAT 652 plasmid pC, complete sequence. |
|---|---|
| Accession | NC_010997 |
| Length | 1,091,523 |
Click here to switch to the map view.
The map label for this gene is hisD2 [H]
Identifier: 190895132
GI number: 190895132
Start: 862076
End: 863479
Strand: Reverse
Name: hisD2 [H]
Synonym: RHECIAT_PC0000802
Alternate gene names: 190895132
Gene position: 863479-862076 (Counterclockwise)
Preceding gene: 190895133
Following gene: 190895131
Centisome position: 79.11
GC content: 59.97
Gene sequence:
>1404_bases TTGGGGCGCCGCCTGGCGCCCCGCCAACCACAGTCTCTCCAAACCCAGAATGCGGGGCACGGCTTCCGCAAACGAAGAGT TATTGTCATGATCAGACACATCAAAACGGCCCAAGCCTCGACGGCGGGCGCTTCCGATAGCGCGATAACGAAAGCTGTCG AGGAGCTCCTTTCTAAGGTGGAAGCCGGCGGCGACAAAGCGGTCCGGGAACTCTCCGTTAAGTTCGACAAATTCGACCGC GAGTCCTATCGCCTGACAAAAGACGAAATCGCTGCCGCGATTAATTCCCTGACCAAGCAGGAGCGCGAGGACCTGGACTT TGCCCAGGATCAGGTCCGCCGCTTCGCACAGGCACAAAGAGATGCGCTGCAGGATCTCGAAGTCGAGACGATCCCGGGCG TGGTTCTGGGCCATCGCAATGTGCCGATCGAAAATGTCGGCTGCTACGTGCCGGGTGGAAAATATCCGCTGCTTGCATCG GCACATATGACTGTGCTGACAGCGCGTGTGGCGGGCTGCGACCGCGTCATTACCTGTGCTCCCCCGTTCAACGGACAGAT ATCCAACAAGATCGTCGCCGCACAGGCTCTCGCCGGTGCAGACGAGATCTACTGCATCGGCGGTGTTCAGGCGATCGCGG CGATGGGCTATGGCACCGAAACGATCGAAGCCGTCGACATGCTTGCCGGTCCGGGCAATGCCTATGTGGCAGAGGCCAAG CGTCTCTTGTTCGGCAAGGTCGGTATCGACCTGTTTGCCGGCCCGACCGAAACGCTGGTGATTGCTGACGAAAGCGTCGA CGGTGAAATCGTTGCAACGGACCTGCTCGGCCAAGCCGAACATGGTGCCAACTCTCCGGCAGTGCTCATCACCAATTCCG AGAAGCTCGCCAAGGATACACTTGCCGAAATCGACCGGCTCCTGCAGATCCTTCCGACGGCCGCCGTCGCAGGAAAGGCC TGGAACGACTGCGGAGAGATCATCCTCTGCGACACGATCGAGGAAATGGTGTCCGAAGCTGACCGCGTCGCTTCGGAACA CGTTCAGGTCATGACGAGCGACCCGAACTACTTTCTCGAGAACATGAAAAACTATGGAGCGCTGTTCCTTGGCGCCCGCA CCAATGTCGCCTTCGGCGACAAGGTCATCGGCACGAACCACACACTGCCGACGAACAAGGCCGCGCGCTACACCGGCGGT CTGTGGGTGGGGAAATTCCTCAAGACCTGCACCTATCAGCGCATAGAGACCGATGAGGCATCAGCCCTTATCGGTGCCTA TAGCTCTCGTCTCTGCCTGATGGAAGGCTTCGCGGGTCACGCCGAGCAAGCCAACATTCGTGTCCGCCGCTTCGGTGGCC GCAACATTCCTTACGCGGGGGCCGCCGGCCCGCGCGACGCATAA
Upstream 100 bases:
>100_bases GCTGGTGGGACTTCCCGTCGCCGGCCTATTACGAGAAGGAACAGGCTGCCTACGCAAAGATGCGCGAACTCGAGCAGCAT CTATAGAGCCAACTTCAGGC
Downstream 100 bases:
>100_bases GCAACCGGCGGCTTCGACACCCTCTTGTCGAGACTGCCCGCAATCCACCAACCGCTGAGGCAAAAAAGGGGAACTACAAT GAAACTGAAAATGCTTCTTA
Product: histidinol dehydrogenase
Products: NA
Alternate protein names: HDH 2 [H]
Number of amino acids: Translated: 467; Mature: 466
Protein sequence:
>467_residues MGRRLAPRQPQSLQTQNAGHGFRKRRVIVMIRHIKTAQASTAGASDSAITKAVEELLSKVEAGGDKAVRELSVKFDKFDR ESYRLTKDEIAAAINSLTKQEREDLDFAQDQVRRFAQAQRDALQDLEVETIPGVVLGHRNVPIENVGCYVPGGKYPLLAS AHMTVLTARVAGCDRVITCAPPFNGQISNKIVAAQALAGADEIYCIGGVQAIAAMGYGTETIEAVDMLAGPGNAYVAEAK RLLFGKVGIDLFAGPTETLVIADESVDGEIVATDLLGQAEHGANSPAVLITNSEKLAKDTLAEIDRLLQILPTAAVAGKA WNDCGEIILCDTIEEMVSEADRVASEHVQVMTSDPNYFLENMKNYGALFLGARTNVAFGDKVIGTNHTLPTNKAARYTGG LWVGKFLKTCTYQRIETDEASALIGAYSSRLCLMEGFAGHAEQANIRVRRFGGRNIPYAGAAGPRDA
Sequences:
>Translated_467_residues MGRRLAPRQPQSLQTQNAGHGFRKRRVIVMIRHIKTAQASTAGASDSAITKAVEELLSKVEAGGDKAVRELSVKFDKFDR ESYRLTKDEIAAAINSLTKQEREDLDFAQDQVRRFAQAQRDALQDLEVETIPGVVLGHRNVPIENVGCYVPGGKYPLLAS AHMTVLTARVAGCDRVITCAPPFNGQISNKIVAAQALAGADEIYCIGGVQAIAAMGYGTETIEAVDMLAGPGNAYVAEAK RLLFGKVGIDLFAGPTETLVIADESVDGEIVATDLLGQAEHGANSPAVLITNSEKLAKDTLAEIDRLLQILPTAAVAGKA WNDCGEIILCDTIEEMVSEADRVASEHVQVMTSDPNYFLENMKNYGALFLGARTNVAFGDKVIGTNHTLPTNKAARYTGG LWVGKFLKTCTYQRIETDEASALIGAYSSRLCLMEGFAGHAEQANIRVRRFGGRNIPYAGAAGPRDA >Mature_466_residues GRRLAPRQPQSLQTQNAGHGFRKRRVIVMIRHIKTAQASTAGASDSAITKAVEELLSKVEAGGDKAVRELSVKFDKFDRE SYRLTKDEIAAAINSLTKQEREDLDFAQDQVRRFAQAQRDALQDLEVETIPGVVLGHRNVPIENVGCYVPGGKYPLLASA HMTVLTARVAGCDRVITCAPPFNGQISNKIVAAQALAGADEIYCIGGVQAIAAMGYGTETIEAVDMLAGPGNAYVAEAKR LLFGKVGIDLFAGPTETLVIADESVDGEIVATDLLGQAEHGANSPAVLITNSEKLAKDTLAEIDRLLQILPTAAVAGKAW NDCGEIILCDTIEEMVSEADRVASEHVQVMTSDPNYFLENMKNYGALFLGARTNVAFGDKVIGTNHTLPTNKAARYTGGL WVGKFLKTCTYQRIETDEASALIGAYSSRLCLMEGFAGHAEQANIRVRRFGGRNIPYAGAAGPRDA
Specific function: Catalyzes the sequential NAD-dependent oxidations of L- histidinol to L-histidinaldehyde and then to L-histidine [H]
COG id: COG0141
COG function: function code E; Histidinol dehydrogenase
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the histidinol dehydrogenase family [H]
Homologues:
Organism=Escherichia coli, GI1788331, Length=409, Percent_Identity=35.4523227383863, Blast_Score=246, Evalue=2e-66, Organism=Saccharomyces cerevisiae, GI6319819, Length=414, Percent_Identity=36.4734299516908, Blast_Score=223, Evalue=4e-59,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR016161 - InterPro: IPR001692 - InterPro: IPR012131 [H]
Pfam domain/function: PF00815 Histidinol_dh [H]
EC number: =1.1.1.23 [H]
Molecular weight: Translated: 50154; Mature: 50022
Theoretical pI: Translated: 5.92; Mature: 5.92
Prosite motif: PS00611 HISOL_DEHYDROGENASE
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.7 %Cys (Translated Protein) 1.9 %Met (Translated Protein) 3.6 %Cys+Met (Translated Protein) 1.7 %Cys (Mature Protein) 1.7 %Met (Mature Protein) 3.4 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MGRRLAPRQPQSLQTQNAGHGFRKRRVIVMIRHIKTAQASTAGASDSAITKAVEELLSKV CCCCCCCCCCCCCCCCCCCCCHHHCEEEEEEEHHHHHCCCCCCCCHHHHHHHHHHHHHHH EAGGDKAVRELSVKFDKFDRESYRLTKDEIAAAINSLTKQEREDLDFAQDQVRRFAQAQR HCCCHHHHHHHHHHHHHCCCHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH DALQDLEVETIPGVVLGHRNVPIENVGCYVPGGKYPLLASAHMTVLTARVAGCDRVITCA HHHHHCCHHHCCCEEECCCCCCCCCCCEECCCCCCCEEEHHHHHHHHHHHCCCCEEEEEC PPFNGQISNKIVAAQALAGADEIYCIGGVQAIAAMGYGTETIEAVDMLAGPGNAYVAEAK CCCCCCCCCHHHHHHHHCCCCCEEEECHHHHHHHHCCCCHHHHHHHHHCCCCCHHHHHHH RLLFGKVGIDLFAGPTETLVIADESVDGEIVATDLLGQAEHGANSPAVLITNSEKLAKDT HHHHHHCCCEEECCCCCEEEEECCCCCCCEEEHHHHCCCCCCCCCCEEEEECCHHHHHHH LAEIDRLLQILPTAAVAGKAWNDCGEIILCDTIEEMVSEADRVASEHVQVMTSDPNYFLE HHHHHHHHHHHHHHHHCCCCCCCCCCEEEHHHHHHHHHHHHHHHHHCEEEEECCCHHHHH NMKNYGALFLGARTNVAFGDKVIGTNHTLPTNKAARYTGGLWVGKFLKTCTYQRIETDEA HHHCCCEEEEECCCCCCCCCEEECCCCCCCCCCCHHHCCCHHHHHHHHHHHHHHCCCCHH SALIGAYSSRLCLMEGFAGHAEQANIRVRRFGGRNIPYAGAAGPRDA HHHHHHHHCCHHHHHCCCCCCCCCCEEEEEECCCCCCCCCCCCCCCC >Mature Secondary Structure GRRLAPRQPQSLQTQNAGHGFRKRRVIVMIRHIKTAQASTAGASDSAITKAVEELLSKV CCCCCCCCCCCCCCCCCCCCHHHCEEEEEEEHHHHHCCCCCCCCHHHHHHHHHHHHHHH EAGGDKAVRELSVKFDKFDRESYRLTKDEIAAAINSLTKQEREDLDFAQDQVRRFAQAQR HCCCHHHHHHHHHHHHHCCCHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH DALQDLEVETIPGVVLGHRNVPIENVGCYVPGGKYPLLASAHMTVLTARVAGCDRVITCA HHHHHCCHHHCCCEEECCCCCCCCCCCEECCCCCCCEEEHHHHHHHHHHHCCCCEEEEEC PPFNGQISNKIVAAQALAGADEIYCIGGVQAIAAMGYGTETIEAVDMLAGPGNAYVAEAK CCCCCCCCCHHHHHHHHCCCCCEEEECHHHHHHHHCCCCHHHHHHHHHCCCCCHHHHHHH RLLFGKVGIDLFAGPTETLVIADESVDGEIVATDLLGQAEHGANSPAVLITNSEKLAKDT HHHHHHCCCEEECCCCCEEEEECCCCCCCEEEHHHHCCCCCCCCCCEEEEECCHHHHHHH LAEIDRLLQILPTAAVAGKAWNDCGEIILCDTIEEMVSEADRVASEHVQVMTSDPNYFLE HHHHHHHHHHHHHHHHCCCCCCCCCCEEEHHHHHHHHHHHHHHHHHCEEEEECCCHHHHH NMKNYGALFLGARTNVAFGDKVIGTNHTLPTNKAARYTGGLWVGKFLKTCTYQRIETDEA HHHCCCEEEEECCCCCCCCCEEECCCCCCCCCCCHHHCCCHHHHHHHHHHHHHHCCCCHH SALIGAYSSRLCLMEGFAGHAEQANIRVRRFGGRNIPYAGAAGPRDA HHHHHHHHCCHHHHHCCCCCCCCCCEEEEEECCCCCCCCCCCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 11214968 [H]