| Definition | Haemophilus influenzae PittGG chromosome, complete genome. |
|---|---|
| Accession | NC_009567 |
| Length | 1,887,192 |
Click here to switch to the map view.
The map label for this gene is allC [C]
Identifier: 148827799
GI number: 148827799
Start: 1153617
End: 1154852
Strand: Reverse
Name: allC [C]
Synonym: CGSHiGG_06340
Alternate gene names: 148827799
Gene position: 1154852-1153617 (Counterclockwise)
Preceding gene: 148827802
Following gene: 148827798
Centisome position: 61.19
GC content: 34.14
Gene sequence:
>1236_bases ATGTCAATTAATCTTAATCGTGTTCAAAATTTAATTGAAAAACTGGCTTTTATTTCATCAGTACCAAACGAGCTGACTCG CTTAGCTTTTACAGAGGAGGATGAAAAGGCCCATAATATGATTATTGAATTATGTAAAGAATATGATTTGTCTATTCGTC GAGATTCAATTGGAAATCTTTTTATTCGTAAGGCAGGTAAAGAAGATTTTTTACCTGCAGTTGCATTCGGATCACATATT GATACTGTTGTGAATGCTGGTAAATTTGATGGTCCTTTGGGATCTGTTGCTGGGTTGGAAATTCTTTTGCAATTGTGTGA ACAGAATATTCAGACTCGTTATCCTTTAGAATTGATAATTTTTACTTGTGAAGAATCGAGTAGATTTAATTTTGCTACAT TGGGTAGTAAAGTTATGTGTGGCATAGTAAATCAAGAAAAATTAAGTTCATTACGTGATAAACAAGGAAAGGGTTTATCA GAAGCTATGGCTGAAGTAGGAATGAATTTTAATTTGGTTAATCAAGCAAAACGTGATGCAAAGGAATTTAAATGTTTTTT TGAACTTCATATAGAACAAGGCCCTCGTTTAGAGAATGAAGGAAAAACAATAGGTGTTGTGACAGGTATTGCTGCCCCGA TTCGTGCAATTGTTAAAATTAAAGGACAAGCGGATCATTCAGGAGCAACAGCAATGCATTATCGTCATGATGCATTGTTA GGAGGATCTGAGTTATCACTTGCTATTGAGCGAGCTGCTATTCAAGCTGGACATTCTACAGTAGCTACAGTAGGTAATAT TACAGCTAAACCAGGAGTAATGAATGTTGTGCCAGGATATTGCGAATTATTAGTAGATATTCGAGGTACACATGTACAAG CTAGAGATTCTGTATTTGAATTATTACAAGAGGAAATTAGTAAAGTTTCAGAAAAAAGAGGATTATTAATTGAGTTACAA CTTATTTCAAAAGATAATCCAATAATATTACCTGAAAATATGGTAAACCAAATAGCTGAAACAGCACATTCCCTTGGTTA TTCTTACGAAATAATGCCAAGTGGTGCTGGACATGATGCAATGCATATGGCAACACTTTGCCCAACAGGTATGATTTTTA TTCCATCTCATTTGGGAATTAGTCATAACCCTCTTGAATTTACTGATTGGAAAGATATAGAGGCAGGAATTAAAGTTTTA CAAAAAGTTATATTGGAGCAGGCTGAAGTTTGTTAA
Upstream 100 bases:
>100_bases TTTAGCAATACCAATATTACGCTTAGAAAAGGTTAATTTTCAACGAAAAATTATAATTGTTTGACGAATATCAAAAAATA AACCGTATCAGGAGAAAACT
Downstream 100 bases:
>100_bases TTGTTATAAAAAACTCGTATAAATAATACGAGTTTTTTATAAAGGCAATTCCGTTGTCGATTTTACTGTTTTTAATATGA TTTCTGATTTTAATGTTTTG
Product: allantoate amidohydrolase
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 411; Mature: 410
Protein sequence:
>411_residues MSINLNRVQNLIEKLAFISSVPNELTRLAFTEEDEKAHNMIIELCKEYDLSIRRDSIGNLFIRKAGKEDFLPAVAFGSHI DTVVNAGKFDGPLGSVAGLEILLQLCEQNIQTRYPLELIIFTCEESSRFNFATLGSKVMCGIVNQEKLSSLRDKQGKGLS EAMAEVGMNFNLVNQAKRDAKEFKCFFELHIEQGPRLENEGKTIGVVTGIAAPIRAIVKIKGQADHSGATAMHYRHDALL GGSELSLAIERAAIQAGHSTVATVGNITAKPGVMNVVPGYCELLVDIRGTHVQARDSVFELLQEEISKVSEKRGLLIELQ LISKDNPIILPENMVNQIAETAHSLGYSYEIMPSGAGHDAMHMATLCPTGMIFIPSHLGISHNPLEFTDWKDIEAGIKVL QKVILEQAEVC
Sequences:
>Translated_411_residues MSINLNRVQNLIEKLAFISSVPNELTRLAFTEEDEKAHNMIIELCKEYDLSIRRDSIGNLFIRKAGKEDFLPAVAFGSHI DTVVNAGKFDGPLGSVAGLEILLQLCEQNIQTRYPLELIIFTCEESSRFNFATLGSKVMCGIVNQEKLSSLRDKQGKGLS EAMAEVGMNFNLVNQAKRDAKEFKCFFELHIEQGPRLENEGKTIGVVTGIAAPIRAIVKIKGQADHSGATAMHYRHDALL GGSELSLAIERAAIQAGHSTVATVGNITAKPGVMNVVPGYCELLVDIRGTHVQARDSVFELLQEEISKVSEKRGLLIELQ LISKDNPIILPENMVNQIAETAHSLGYSYEIMPSGAGHDAMHMATLCPTGMIFIPSHLGISHNPLEFTDWKDIEAGIKVL QKVILEQAEVC >Mature_410_residues SINLNRVQNLIEKLAFISSVPNELTRLAFTEEDEKAHNMIIELCKEYDLSIRRDSIGNLFIRKAGKEDFLPAVAFGSHID TVVNAGKFDGPLGSVAGLEILLQLCEQNIQTRYPLELIIFTCEESSRFNFATLGSKVMCGIVNQEKLSSLRDKQGKGLSE AMAEVGMNFNLVNQAKRDAKEFKCFFELHIEQGPRLENEGKTIGVVTGIAAPIRAIVKIKGQADHSGATAMHYRHDALLG GSELSLAIERAAIQAGHSTVATVGNITAKPGVMNVVPGYCELLVDIRGTHVQARDSVFELLQEEISKVSEKRGLLIELQL ISKDNPIILPENMVNQIAETAHSLGYSYEIMPSGAGHDAMHMATLCPTGMIFIPSHLGISHNPLEFTDWKDIEAGIKVLQ KVILEQAEVC
Specific function: Involved In The Anaerobic Utilization Of Allantoin. Converts Allantoate To (S)-Ureidoglycolate And Ammonia. [C]
COG id: COG0624
COG function: function code E; Acetylornithine deacetylase/Succinyl-diaminopimelate desuccinylase and related deacylases
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the peptidase M20 family
Homologues:
Organism=Escherichia coli, GI1786726, Length=404, Percent_Identity=32.9207920792079, Blast_Score=215, Evalue=5e-57,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): Y588_HAEIN (Q57051)
Other databases:
- EMBL: L42023 - PIR: D64079 - RefSeq: NP_438746.1 - ProteinModelPortal: Q57051 - SMR: Q57051 - GeneID: 950643 - GenomeReviews: L42023_GR - KEGG: hin:HI0588 - NMPDR: fig|71421.1.peg.559 - TIGR: HI_0588 - HOGENOM: HBG583284 - OMA: IAAPIRC - ProtClustDB: PRK09290 - BioCyc: HINF71421:HI_0588-MONOMER - GO: GO:0006508 - InterPro: IPR010158 - InterPro: IPR001261 - InterPro: IPR002933 - InterPro: IPR011650 - PIRSF: PIRSF001235 - TIGRFAMs: TIGR01879
Pfam domain/function: PF07687 M20_dimer; PF01546 Peptidase_M20; SSF55031 Peptidase_M20_dimer
EC number: 3.5.3.- [C]
Molecular weight: Translated: 45092; Mature: 44960
Theoretical pI: Translated: 5.59; Mature: 5.59
Prosite motif: PS00758 ARGE_DAPE_CPG2_1
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.9 %Cys (Translated Protein) 2.9 %Met (Translated Protein) 4.9 %Cys+Met (Translated Protein) 2.0 %Cys (Mature Protein) 2.7 %Met (Mature Protein) 4.6 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MSINLNRVQNLIEKLAFISSVPNELTRLAFTEEDEKAHNMIIELCKEYDLSIRRDSIGNL CCCCHHHHHHHHHHHHHHHHCHHHHHHHHCCCCHHHHHHHHHHHHHHHCCEEECCCCCCH FIRKAGKEDFLPAVAFGSHIDTVVNAGKFDGPLGSVAGLEILLQLCEQNIQTRYPLELII HHCCCCCCCCCHHHHHCHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHCCCCCCEEEEE FTCEESSRFNFATLGSKVMCGIVNQEKLSSLRDKQGKGLSEAMAEVGMNFNLVNQAKRDA EEECCCCCCCHHHCCCHHEEECCCHHHHHHHHHHCCCCHHHHHHHHCCCCCHHHHHHHHH KEFKCFFELHIEQGPRLENEGKTIGVVTGIAAPIRAIVKIKGQADHSGATAMHYRHDALL HHHEEHEEEEECCCCCCCCCCCEEEEEHHHHHHHHHHHEECCCCCCCCCEEEEEHHHHHC GGSELSLAIERAAIQAGHSTVATVGNITAKPGVMNVVPGYCELLVDIRGTHVQARDSVFE CCCHHHHHHHHHHHHCCCCHHHHHCCCCCCCCCCCCCCHHHHHHHHHCCCCCHHHHHHHH LLQEEISKVSEKRGLLIELQLISKDNPIILPENMVNQIAETAHSLGYSYEIMPSGAGHDA HHHHHHHHHHHHCCEEEEEEEECCCCCEECCHHHHHHHHHHHHHCCCEEEEECCCCCCCH MHMATLCPTGMIFIPSHLGISHNPLEFTDWKDIEAGIKVLQKVILEQAEVC HHHHHHCCCCEEEEECCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHCCC >Mature Secondary Structure SINLNRVQNLIEKLAFISSVPNELTRLAFTEEDEKAHNMIIELCKEYDLSIRRDSIGNL CCCHHHHHHHHHHHHHHHHCHHHHHHHHCCCCHHHHHHHHHHHHHHHCCEEECCCCCCH FIRKAGKEDFLPAVAFGSHIDTVVNAGKFDGPLGSVAGLEILLQLCEQNIQTRYPLELII HHCCCCCCCCCHHHHHCHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHCCCCCCEEEEE FTCEESSRFNFATLGSKVMCGIVNQEKLSSLRDKQGKGLSEAMAEVGMNFNLVNQAKRDA EEECCCCCCCHHHCCCHHEEECCCHHHHHHHHHHCCCCHHHHHHHHCCCCCHHHHHHHHH KEFKCFFELHIEQGPRLENEGKTIGVVTGIAAPIRAIVKIKGQADHSGATAMHYRHDALL HHHEEHEEEEECCCCCCCCCCCEEEEEHHHHHHHHHHHEECCCCCCCCCEEEEEHHHHHC GGSELSLAIERAAIQAGHSTVATVGNITAKPGVMNVVPGYCELLVDIRGTHVQARDSVFE CCCHHHHHHHHHHHHCCCCHHHHHCCCCCCCCCCCCCCHHHHHHHHHCCCCCHHHHHHHH LLQEEISKVSEKRGLLIELQLISKDNPIILPENMVNQIAETAHSLGYSYEIMPSGAGHDA HHHHHHHHHHHHCCEEEEEEEECCCCCEECCHHHHHHHHHHHHHCCCEEEEECCCCCCCH MHMATLCPTGMIFIPSHLGISHNPLEFTDWKDIEAGIKVLQKVILEQAEVC HHHHHHCCCCEEEEECCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 7542800; 10675023