| Definition | Haemophilus influenzae PittGG chromosome, complete genome. |
|---|---|
| Accession | NC_009567 |
| Length | 1,887,192 |
Click here to switch to the map view.
The map label for this gene is ddc [H]
Identifier: 148828124
GI number: 148828124
Start: 1537685
End: 1539220
Strand: Reverse
Name: ddc [H]
Synonym: CGSHiGG_08300
Alternate gene names: 148828124
Gene position: 1539220-1537685 (Counterclockwise)
Preceding gene: 148828125
Following gene: 148828123
Centisome position: 81.56
GC content: 42.58
Gene sequence:
>1536_bases ATGTCAAACCTCAAACAACACAAACAAGCTTTGTTTTGCAACGATAACGAAGCCATTAACGATTATGAAACAGCGATGAA TAATGCGGTGCAAGCAGTCTCTGCTTGGCTGAAAAATGAAAAAATGTACACAGGCGGTTCAATCAAACAAATGCGAGCCT TAATAAGCGGTTTTAATCCGACGAAAGAGGGTATGGGTGTACAGAAATCACTCGATCATTTGGTAGAAATTTTCCTTAAT CCAAGCCTTAAAGTACATCATCCACACTCACTTGCCCATTTACATTGCCCAACGATGGTAACAAGCCAAATTGCGGAAGT GTTGATTAATGCCACCAACCAATCTATGGACTCTTGGGATCAAAGCCCAGCAGGTTCGATTATGGAGGAGCATTTGATCA ACTGGCTACGCCAAAAAGCAGGCTATGGGGAAGGCACATCAGGCGTGTTCACTTCTGGTGGTACTCAATCTAACTTAATG GGCGTATTGTTGGCACGCGATTGGGCGATTGCAAACCACTGGAAAAACGAAGACGGCTCTGAATGGTCAGTACAACGTGA TGGTATTCCAGCAGAAGCGATGCAAAAAGTGAAAGTGATTTGTTCAGAAAACGCACATTTCTCTGTACAAAAAAATATGG CAATGATGGGCATGGGTTTCCAATCGGTCGTGACCGTGCCATCAAATGCCAATGCACAAATGGATCTTATTGCACTTAAA CAAACACTTGCACAGCTTAAAGCTGATGGCAAAATTACTGCCTGTATTGTTGCTACCGCAGGCACAACAGATGCTGGCGC AATTGATGACTTAAAAGCCATCCGCAAACTTGCCGATGAATATCAAGCGTGGTTACACGTTGATGCCGCTTGGGGTGGCG CATTATTGCTTTCCAAAGATTATCGCTATTTCTTAGATGGTATTGAATTAACTGATTCCATCACGCTTGATTTCCACAAA CACTTCTTCCAAACGATCTCGTGTGGGGCGTTCTTGTTGAAAGATCCTGCGAACTATCGCTTTATCGATTACAAAGCGGA TTATCTCAATTCGGAATATGATGAAGCTCACGGCGTGCCAAACTTAGTGGCGAAATCATTACAAACCACACGTCGTTTCG ACGCATTAAAATTATGGTTTACCCTTGAAGCATTGGGCGAAGATCTTTACGCTTCAATGATCGATCACGGCGTAAAACTG ACCAAAGAAGTCGAGCAATACATCAACGATACTCCTGCCTTAGAAATGCTTGTGCCAAGTCAGTTTGCATCGGTGTTATT CCGTGTCGTACCAAAAGACTATCCAGCTGAATTTATTGATGCACTAAACCAAAACGTGGCAGATGAACTCTTTGCTCGAG GAGAAGCGAATATTGGCGTGACTAAAGTAGGCGACAAACAATCACTGAAAATGACTACCCTAAGCCCGATTGCAACATTG GAAAATGTTAAAGCGTTATTAACTCAAGTACTAACAGAAGCAAATCGTATTAAAGACGACATCAAAAATAGCACTTACAC ACCACCCATTGATTAA
Upstream 100 bases:
>100_bases AGTGAAGGGTTAATTCTGGTTAGTAACAATTTAAGAGAATTTGAGCGAGTTATAGCATTACGTACAGAAAATTGGGTGTA ATTCATATCTAGGAATAATT
Downstream 100 bases:
>100_bases TTAGTTAGTCAATTAACACAAAAAATAACCGCTTGTATCTGAAAACAGGCGGTTATTCTGTAAAATAAAAATCTTTTAGC ATAGATCAAACGAGATATAT
Product: hypothetical protein
Products: NA
Alternate protein names: DABA decarboxylase; DABA-DC [H]
Number of amino acids: Translated: 511; Mature: 510
Protein sequence:
>511_residues MSNLKQHKQALFCNDNEAINDYETAMNNAVQAVSAWLKNEKMYTGGSIKQMRALISGFNPTKEGMGVQKSLDHLVEIFLN PSLKVHHPHSLAHLHCPTMVTSQIAEVLINATNQSMDSWDQSPAGSIMEEHLINWLRQKAGYGEGTSGVFTSGGTQSNLM GVLLARDWAIANHWKNEDGSEWSVQRDGIPAEAMQKVKVICSENAHFSVQKNMAMMGMGFQSVVTVPSNANAQMDLIALK QTLAQLKADGKITACIVATAGTTDAGAIDDLKAIRKLADEYQAWLHVDAAWGGALLLSKDYRYFLDGIELTDSITLDFHK HFFQTISCGAFLLKDPANYRFIDYKADYLNSEYDEAHGVPNLVAKSLQTTRRFDALKLWFTLEALGEDLYASMIDHGVKL TKEVEQYINDTPALEMLVPSQFASVLFRVVPKDYPAEFIDALNQNVADELFARGEANIGVTKVGDKQSLKMTTLSPIATL ENVKALLTQVLTEANRIKDDIKNSTYTPPID
Sequences:
>Translated_511_residues MSNLKQHKQALFCNDNEAINDYETAMNNAVQAVSAWLKNEKMYTGGSIKQMRALISGFNPTKEGMGVQKSLDHLVEIFLN PSLKVHHPHSLAHLHCPTMVTSQIAEVLINATNQSMDSWDQSPAGSIMEEHLINWLRQKAGYGEGTSGVFTSGGTQSNLM GVLLARDWAIANHWKNEDGSEWSVQRDGIPAEAMQKVKVICSENAHFSVQKNMAMMGMGFQSVVTVPSNANAQMDLIALK QTLAQLKADGKITACIVATAGTTDAGAIDDLKAIRKLADEYQAWLHVDAAWGGALLLSKDYRYFLDGIELTDSITLDFHK HFFQTISCGAFLLKDPANYRFIDYKADYLNSEYDEAHGVPNLVAKSLQTTRRFDALKLWFTLEALGEDLYASMIDHGVKL TKEVEQYINDTPALEMLVPSQFASVLFRVVPKDYPAEFIDALNQNVADELFARGEANIGVTKVGDKQSLKMTTLSPIATL ENVKALLTQVLTEANRIKDDIKNSTYTPPID >Mature_510_residues SNLKQHKQALFCNDNEAINDYETAMNNAVQAVSAWLKNEKMYTGGSIKQMRALISGFNPTKEGMGVQKSLDHLVEIFLNP SLKVHHPHSLAHLHCPTMVTSQIAEVLINATNQSMDSWDQSPAGSIMEEHLINWLRQKAGYGEGTSGVFTSGGTQSNLMG VLLARDWAIANHWKNEDGSEWSVQRDGIPAEAMQKVKVICSENAHFSVQKNMAMMGMGFQSVVTVPSNANAQMDLIALKQ TLAQLKADGKITACIVATAGTTDAGAIDDLKAIRKLADEYQAWLHVDAAWGGALLLSKDYRYFLDGIELTDSITLDFHKH FFQTISCGAFLLKDPANYRFIDYKADYLNSEYDEAHGVPNLVAKSLQTTRRFDALKLWFTLEALGEDLYASMIDHGVKLT KEVEQYINDTPALEMLVPSQFASVLFRVVPKDYPAEFIDALNQNVADELFARGEANIGVTKVGDKQSLKMTTLSPIATLE NVKALLTQVLTEANRIKDDIKNSTYTPPID
Specific function: Unknown
COG id: COG0076
COG function: function code E; Glutamate decarboxylase and related PLP-dependent proteins
Gene ontology:
Cell location: Cytoplasmic
Metaboloic importance: NA
Operon status: Not Known
Operon components: None
Similarity: Belongs to the group II decarboxylase family [H]
Homologues:
Organism=Homo sapiens, GI194294551, Length=369, Percent_Identity=29.5392953929539, Blast_Score=167, Evalue=2e-41, Organism=Homo sapiens, GI197383062, Length=472, Percent_Identity=25.8474576271186, Blast_Score=163, Evalue=4e-40, Organism=Homo sapiens, GI197276620, Length=429, Percent_Identity=26.3403263403263, Blast_Score=152, Evalue=6e-37, Organism=Homo sapiens, GI4503875, Length=429, Percent_Identity=26.3403263403263, Blast_Score=152, Evalue=6e-37, Organism=Homo sapiens, GI58331246, Length=428, Percent_Identity=25.2336448598131, Blast_Score=146, Evalue=4e-35, Organism=Homo sapiens, GI4503281, Length=408, Percent_Identity=25.2450980392157, Blast_Score=133, Evalue=3e-31, Organism=Homo sapiens, GI132814448, Length=408, Percent_Identity=25.2450980392157, Blast_Score=133, Evalue=3e-31, Organism=Homo sapiens, GI92110055, Length=424, Percent_Identity=25, Blast_Score=129, Evalue=5e-30, Organism=Caenorhabditis elegans, GI17555682, Length=498, Percent_Identity=26.3052208835341, Blast_Score=155, Evalue=7e-38, Organism=Caenorhabditis elegans, GI71993062, Length=438, Percent_Identity=26.7123287671233, Blast_Score=154, Evalue=9e-38, Organism=Caenorhabditis elegans, GI71993058, Length=428, Percent_Identity=26.1682242990654, Blast_Score=145, Evalue=6e-35, Organism=Caenorhabditis elegans, GI17534819, Length=420, Percent_Identity=24.2857142857143, Blast_Score=110, Evalue=1e-24, Organism=Caenorhabditis elegans, GI17534817, Length=420, Percent_Identity=24.2857142857143, Blast_Score=110, Evalue=1e-24, Organism=Caenorhabditis elegans, GI71981211, Length=455, Percent_Identity=21.978021978022, Blast_Score=109, Evalue=3e-24, Organism=Caenorhabditis elegans, GI71981217, Length=464, Percent_Identity=21.3362068965517, Blast_Score=106, Evalue=2e-23, Organism=Caenorhabditis elegans, GI17551992, Length=468, Percent_Identity=20.5128205128205, Blast_Score=96, Evalue=5e-20, Organism=Caenorhabditis elegans, GI133931025, Length=393, Percent_Identity=21.6284987277354, Blast_Score=72, Evalue=1e-12, Organism=Drosophila melanogaster, GI17136594, Length=438, Percent_Identity=26.9406392694064, Blast_Score=156, Evalue=3e-38, Organism=Drosophila melanogaster, GI21356415, Length=333, Percent_Identity=30.6306306306306, Blast_Score=149, Evalue=4e-36, Organism=Drosophila melanogaster, GI24657193, Length=360, Percent_Identity=28.3333333333333, Blast_Score=141, Evalue=8e-34, Organism=Drosophila melanogaster, GI24657185, Length=360, Percent_Identity=28.3333333333333, Blast_Score=141, Evalue=8e-34, Organism=Drosophila melanogaster, GI24657188, Length=360, Percent_Identity=28.3333333333333, Blast_Score=141, Evalue=8e-34, Organism=Drosophila melanogaster, GI17136190, Length=352, Percent_Identity=26.4204545454545, Blast_Score=128, Evalue=1e-29, Organism=Drosophila melanogaster, GI24585135, Length=334, Percent_Identity=26.6467065868263, Blast_Score=123, Evalue=3e-28, Organism=Drosophila melanogaster, GI24585139, Length=423, Percent_Identity=24.5862884160757, Blast_Score=117, Evalue=2e-26, Organism=Drosophila melanogaster, GI221476190, Length=423, Percent_Identity=24.5862884160757, Blast_Score=117, Evalue=2e-26, Organism=Drosophila melanogaster, GI24585143, Length=423, Percent_Identity=24.5862884160757, Blast_Score=117, Evalue=2e-26, Organism=Drosophila melanogaster, GI24652373, Length=425, Percent_Identity=24.7058823529412, Blast_Score=116, Evalue=4e-26, Organism=Drosophila melanogaster, GI24586044, Length=419, Percent_Identity=24.3436754176611, Blast_Score=107, Evalue=3e-23, Organism=Drosophila melanogaster, GI28573972, Length=431, Percent_Identity=23.2018561484919, Blast_Score=97, Evalue=3e-20,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR002129 - InterPro: IPR015424 - InterPro: IPR015421 - InterPro: IPR015422 - InterPro: IPR021115 [H]
Pfam domain/function: PF00282 Pyridoxal_deC [H]
EC number: =4.1.1.86 [H]
Molecular weight: Translated: 56544; Mature: 56413
Theoretical pI: Translated: 5.43; Mature: 5.43
Prosite motif: PS00392 DDC_GAD_HDC_YDC
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.0 %Cys (Translated Protein) 3.5 %Met (Translated Protein) 4.5 %Cys+Met (Translated Protein) 1.0 %Cys (Mature Protein) 3.3 %Met (Mature Protein) 4.3 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MSNLKQHKQALFCNDNEAINDYETAMNNAVQAVSAWLKNEKMYTGGSIKQMRALISGFNP CCCHHHHHHHEEECCCCCCHHHHHHHHHHHHHHHHHHHCCCEECCCCHHHHHHHHCCCCC TKEGMGVQKSLDHLVEIFLNPSLKVHHPHSLAHLHCPTMVTSQIAEVLINATNQSMDSWD CHHCCCHHHHHHHHHHHHHCCCEEEECCCCHHHEECHHHHHHHHHHHHHHHCCCCHHHCC QSPAGSIMEEHLINWLRQKAGYGEGTSGVFTSGGTQSNLMGVLLARDWAIANHWKNEDGS CCCCHHHHHHHHHHHHHHHCCCCCCCCCCEECCCCHHHHHHHHHHHHHHHHHCCCCCCCC EWSVQRDGIPAEAMQKVKVICSENAHFSVQKNMAMMGMGFQSVVTVPSNANAQMDLIALK CCEEECCCCCHHHHHHHHHHHCCCCCEEHHCCHHHHCCCHHHEEECCCCCCCCHHHHHHH QTLAQLKADGKITACIVATAGTTDAGAIDDLKAIRKLADEYQAWLHVDAAWGGALLLSKD HHHHHHHCCCCEEEEEEEECCCCCCCCHHHHHHHHHHHHHHHHHEEEECCCCCEEEEECC YRYFLDGIELTDSITLDFHKHFFQTISCGAFLLKDPANYRFIDYKADYLNSEYDEAHGVP HHHHHCCCCCCCCEEHHHHHHHHHHHHCCHHEEECCCCCEEEEEEHHHCCCCHHHHCCCH NLVAKSLQTTRRFDALKLWFTLEALGEDLYASMIDHGVKLTKEVEQYINDTPALEMLVPS HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEHCCHH QFASVLFRVVPKDYPAEFIDALNQNVADELFARGEANIGVTKVGDKQSLKMTTLSPIATL HHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHCCCCCCCEEECCCCCCEEEECCCHHHHH ENVKALLTQVLTEANRIKDDIKNSTYTPPID HHHHHHHHHHHHHHHHHHHHHCCCCCCCCCC >Mature Secondary Structure SNLKQHKQALFCNDNEAINDYETAMNNAVQAVSAWLKNEKMYTGGSIKQMRALISGFNP CCHHHHHHHEEECCCCCCHHHHHHHHHHHHHHHHHHHCCCEECCCCHHHHHHHHCCCCC TKEGMGVQKSLDHLVEIFLNPSLKVHHPHSLAHLHCPTMVTSQIAEVLINATNQSMDSWD CHHCCCHHHHHHHHHHHHHCCCEEEECCCCHHHEECHHHHHHHHHHHHHHHCCCCHHHCC QSPAGSIMEEHLINWLRQKAGYGEGTSGVFTSGGTQSNLMGVLLARDWAIANHWKNEDGS CCCCHHHHHHHHHHHHHHHCCCCCCCCCCEECCCCHHHHHHHHHHHHHHHHHCCCCCCCC EWSVQRDGIPAEAMQKVKVICSENAHFSVQKNMAMMGMGFQSVVTVPSNANAQMDLIALK CCEEECCCCCHHHHHHHHHHHCCCCCEEHHCCHHHHCCCHHHEEECCCCCCCCHHHHHHH QTLAQLKADGKITACIVATAGTTDAGAIDDLKAIRKLADEYQAWLHVDAAWGGALLLSKD HHHHHHHCCCCEEEEEEEECCCCCCCCHHHHHHHHHHHHHHHHHEEEECCCCCEEEEECC YRYFLDGIELTDSITLDFHKHFFQTISCGAFLLKDPANYRFIDYKADYLNSEYDEAHGVP HHHHHCCCCCCCCEEHHHHHHHHHHHHCCHHEEECCCCCEEEEEEHHHCCCCHHHHCCCH NLVAKSLQTTRRFDALKLWFTLEALGEDLYASMIDHGVKLTKEVEQYINDTPALEMLVPS HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEHCCHH QFASVLFRVVPKDYPAEFIDALNQNVADELFARGEANIGVTKVGDKQSLKMTTLSPIATL HHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHCCCCCCCEEECCCCCCEEEECCCHHHHH ENVKALLTQVLTEANRIKDDIKNSTYTPPID HHHHHHHHHHHHHHHHHHHHHCCCCCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 7542800; 9514614 [H]