| Definition | Haemophilus influenzae Rd KW20 chromosome, complete genome. |
|---|---|
| Accession | NC_000907 |
| Length | 1,830,138 |
Click here to switch to the map view.
The map label for this gene is yhdJ [C]
Identifier: 16272988
GI number: 16272988
Start: 1121801
End: 1123690
Strand: Reverse
Name: yhdJ [C]
Synonym: HI1056
Alternate gene names: 16272988
Gene position: 1123690-1121801 (Counterclockwise)
Preceding gene: 16272989
Following gene: 30995419
Centisome position: 61.4
GC content: 35.19
Gene sequence:
>1890_bases ATGGCGGGCAAAGCACCGAAGAAGGCGAAGAAATTTATTTTAAACGCAATAATAGTCAGTCAGTCAGTCAGTCAGTCAGT CAGTCAGTCAGTCAGTCAGTCAGTCAGTCAGTCAGTCAGTCAGTCAGTCAGTCAGTCAGTCAGTCAGTCAGTCAGTCAGT CAGTCAGTCAGTCAGTCAGTCAATTATACACCAAATTAACCCGAAAAAGACAAGAAATCTTTTTTAATCAAACGCTTGCT TTTGATGAAATTGACCGGCTTTTTGACGCAAAAGCATTCTCAAAATTCTCTCGCTATACCGCAGACGGCAAACAAGCCGT TGGCGAAATAAAACGCCATTCTGACGGCACGCCTGCTGAAAATCTCATTATCAAAGGCAATAATCTAATAGCCCTGCATT CGCTTGCCAAGCAGTTTAAAGGTAAAGTTAAGCTGATTTATATTGACCCGCCGTATAACACGGGCAATGACGGTTTCAAA TACAACGATAAATTTAATCATTCCACTTGGCTGACTTTTATGAAAAATCGGCTGGAAATTGCGAAAACATTGTTAGCTGA TGATGGCGTGATTTTTGTTCAATGTGATGACATTGAACAAGCTTATTTGAAAATATTGATGGATGATATTTTTGATAGAG ATAATTTTTTGAATATTGTTACTGTTAAAACCAAAATTGGTGGTGTATCAGGAAGTTCAGAAGGTAAAAGTTTAAAAGAT TCTACTGAATTTATTAATGTTTTTTCAAAAAATAGAGAAAGATTATTTCTTAACCCAGTTTATCAGAAAACAGAAGTTAA TGAGTTTATTAAAAACTATGAAGATAGTGGAAAAAGTTGGAAATATACGCAGGTTCTTATTGATTTAGGTGAGAAAATAC TTTTAGAAGAAAAGGATGGCTTCAAATATTATCATTATCCTAACGCACAGATGACTTCAATTGTTAAATTTTCACAAGAT CAAAATTTATCAAAAGAAATAATTTATACGGAGTATTCACATAAAGTTTATAGAACTACAAATGCTCAATCTAGCATCAG AAGCAAGATAATTGAAGATTTATATTCCATAAAAAATGGTATTGTTAGCATTGAGTATATTCCACAAAAGGGTAAAAACG CAGGTAATCTTATAGAAGTTTTTTACAATGCTTCAAATAAAGATATGTTTATGTTCCTATCTGATATGCTAATCAAAGAA AAAAATAAATATTTTTACTTACAAAAGGTTAATACACTATGGGACGATATTCAATATAACAATCTAAATAAAGAGGGGGG ATATATTGATTTTAAAAATGGAAAAAAACCAGAAGCCTTATTACGCCGAATAATTGATATGACAACAAAAGAGGGCGACA TCGTCCTAGACTACCATCTTGGCAGTGGTACAACCGCTGCCGTTGCTCACAAAATGAACCGCCAATATATCGGCATTGAA CAAATGGATTATATTGAAACGCTTGCCGTTGAACGCTTGAAAAAAGTGATTGATGGCGAGCAAGGCGGTATATCCAAAGC CGTGAATTGGCAAGGTGGTGGCGAGTTTGTTTATGCAGAACTTGCTCCATTTAACGAAACCGCAAAACAACAAATTTTGG CGTGCGAAGATTCAGACGACATCAAAACGCTGTTTGAAGATTTATGCGAACGCTATTTCCTAAAATACAACGTCAGCGTG AAAGAATTTAGTCAAATTATTGAAGAGCCTGAATTTCAATCTTTGCCATTAGACGAACAAAAACAAATGGTGCTTGAAAT GTTGGATTTAAATCAAATGTATGTTTCATTATCCGAAATGGACGATGAACAATTTGCAGGATGCTTAAATGATGACGATA AAGCGTTAAGCCGTGCGTTCTATCAAGCGGAGAAAAAAGATGGCGAATGA
Upstream 100 bases:
>100_bases ACAAAATACGCCAATCGCATTGGCTTGACGGACGGCAACCGCTTTTTGAAAGACAGTTCGGATATTGTGTTGGATTTTCC GTTTAAAGATTGTGTATTGA
Downstream 100 bases:
>100_bases TAAAACTTTGTTTGATTGGGTGGAAGACCGCAAATCAACCCTAGAAGAAATGGAGCAGACGGATTTTTTCGCACTGCCTG AATTTGTAGAACGCAATTTA
Product: type III restriction-modification system methyltransferase-like protein
Products: NA
Alternate protein names: M.HindVIP; HindVIP methyltransferase
Number of amino acids: Translated: 629; Mature: 628
Protein sequence:
>629_residues MAGKAPKKAKKFILNAIIVSQSVSQSVSQSVSQSVSQSVSQSVSQSVSQSVSQSVSQSVSQLYTKLTRKRQEIFFNQTLA FDEIDRLFDAKAFSKFSRYTADGKQAVGEIKRHSDGTPAENLIIKGNNLIALHSLAKQFKGKVKLIYIDPPYNTGNDGFK YNDKFNHSTWLTFMKNRLEIAKTLLADDGVIFVQCDDIEQAYLKILMDDIFDRDNFLNIVTVKTKIGGVSGSSEGKSLKD STEFINVFSKNRERLFLNPVYQKTEVNEFIKNYEDSGKSWKYTQVLIDLGEKILLEEKDGFKYYHYPNAQMTSIVKFSQD QNLSKEIIYTEYSHKVYRTTNAQSSIRSKIIEDLYSIKNGIVSIEYIPQKGKNAGNLIEVFYNASNKDMFMFLSDMLIKE KNKYFYLQKVNTLWDDIQYNNLNKEGGYIDFKNGKKPEALLRRIIDMTTKEGDIVLDYHLGSGTTAAVAHKMNRQYIGIE QMDYIETLAVERLKKVIDGEQGGISKAVNWQGGGEFVYAELAPFNETAKQQILACEDSDDIKTLFEDLCERYFLKYNVSV KEFSQIIEEPEFQSLPLDEQKQMVLEMLDLNQMYVSLSEMDDEQFAGCLNDDDKALSRAFYQAEKKDGE
Sequences:
>Translated_629_residues MAGKAPKKAKKFILNAIIVSQSVSQSVSQSVSQSVSQSVSQSVSQSVSQSVSQSVSQSVSQLYTKLTRKRQEIFFNQTLA FDEIDRLFDAKAFSKFSRYTADGKQAVGEIKRHSDGTPAENLIIKGNNLIALHSLAKQFKGKVKLIYIDPPYNTGNDGFK YNDKFNHSTWLTFMKNRLEIAKTLLADDGVIFVQCDDIEQAYLKILMDDIFDRDNFLNIVTVKTKIGGVSGSSEGKSLKD STEFINVFSKNRERLFLNPVYQKTEVNEFIKNYEDSGKSWKYTQVLIDLGEKILLEEKDGFKYYHYPNAQMTSIVKFSQD QNLSKEIIYTEYSHKVYRTTNAQSSIRSKIIEDLYSIKNGIVSIEYIPQKGKNAGNLIEVFYNASNKDMFMFLSDMLIKE KNKYFYLQKVNTLWDDIQYNNLNKEGGYIDFKNGKKPEALLRRIIDMTTKEGDIVLDYHLGSGTTAAVAHKMNRQYIGIE QMDYIETLAVERLKKVIDGEQGGISKAVNWQGGGEFVYAELAPFNETAKQQILACEDSDDIKTLFEDLCERYFLKYNVSV KEFSQIIEEPEFQSLPLDEQKQMVLEMLDLNQMYVSLSEMDDEQFAGCLNDDDKALSRAFYQAEKKDGE >Mature_628_residues AGKAPKKAKKFILNAIIVSQSVSQSVSQSVSQSVSQSVSQSVSQSVSQSVSQSVSQSVSQLYTKLTRKRQEIFFNQTLAF DEIDRLFDAKAFSKFSRYTADGKQAVGEIKRHSDGTPAENLIIKGNNLIALHSLAKQFKGKVKLIYIDPPYNTGNDGFKY NDKFNHSTWLTFMKNRLEIAKTLLADDGVIFVQCDDIEQAYLKILMDDIFDRDNFLNIVTVKTKIGGVSGSSEGKSLKDS TEFINVFSKNRERLFLNPVYQKTEVNEFIKNYEDSGKSWKYTQVLIDLGEKILLEEKDGFKYYHYPNAQMTSIVKFSQDQ NLSKEIIYTEYSHKVYRTTNAQSSIRSKIIEDLYSIKNGIVSIEYIPQKGKNAGNLIEVFYNASNKDMFMFLSDMLIKEK NKYFYLQKVNTLWDDIQYNNLNKEGGYIDFKNGKKPEALLRRIIDMTTKEGDIVLDYHLGSGTTAAVAHKMNRQYIGIEQ MDYIETLAVERLKKVIDGEQGGISKAVNWQGGGEFVYAELAPFNETAKQQILACEDSDDIKTLFEDLCERYFLKYNVSVK EFSQIIEEPEFQSLPLDEQKQMVLEMLDLNQMYVSLSEMDDEQFAGCLNDDDKALSRAFYQAEKKDGE
Specific function: Unknown
COG id: COG2189
COG function: function code L; Adenine specific DNA methylase Mod
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the N(4)/N(6)-methyltransferase family
Homologues:
None
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): T3MH_HAEIN (P71366)
Other databases:
- EMBL: L42023 - PIR: C64180 - RefSeq: NP_439215.1 - ProteinModelPortal: P71366 - REBASE: 3701 - GeneID: 950036 - GenomeReviews: L42023_GR - KEGG: hin:HI1056 - NMPDR: fig|71421.1.peg.1016 - TIGR: HI_1056 - HOGENOM: HBG575869 - OMA: EDAWGID - BioCyc: HINF71421:HI_1056-MONOMER - BRENDA: 2.1.1.72 - InterPro: IPR002941 - InterPro: IPR002052 - InterPro: IPR001091 - PRINTS: PR00508
Pfam domain/function: PF01555 N6_N4_Mtase
EC number: =2.1.1.72
Molecular weight: Translated: 71846; Mature: 71715
Theoretical pI: Translated: 5.52; Mature: 5.52
Prosite motif: PS00092 N6_MTASE
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.6 %Cys (Translated Protein) 2.2 %Met (Translated Protein) 2.9 %Cys+Met (Translated Protein) 0.6 %Cys (Mature Protein) 2.1 %Met (Mature Protein) 2.7 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MAGKAPKKAKKFILNAIIVSQSVSQSVSQSVSQSVSQSVSQSVSQSVSQSVSQSVSQSVS CCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH QLYTKLTRKRQEIFFNQTLAFDEIDRLFDAKAFSKFSRYTADGKQAVGEIKRHSDGTPAE HHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHCCCCCCCC NLIIKGNNLIALHSLAKQFKGKVKLIYIDPPYNTGNDGFKYNDKFNHSTWLTFMKNRLEI CEEEECCCEEEHHHHHHHHCCCEEEEEECCCCCCCCCCCEECCCCCCHHHHHHHHHHHHH AKTLLADDGVIFVQCDDIEQAYLKILMDDIFDRDNFLNIVTVKTKIGGVSGSSEGKSLKD HHHHHCCCCEEEEEECCHHHHHHHHHHHHHHCCCCCEEEEEEEEEECCCCCCCCCCCCHH STEFINVFSKNRERLFLNPVYQKTEVNEFIKNYEDSGKSWKYTQVLIDLGEKILLEEKDG HHHHHHHHHCCCCEEEECCHHHHHHHHHHHHHHHCCCCCEEHHHHHHHCCCCEEEECCCC FKYYHYPNAQMTSIVKFSQDQNLSKEIIYTEYSHKVYRTTNAQSSIRSKIIEDLYSIKNG CEEEECCCCHHHHHHHHCCCCCCCHHEEEEECCCEEEEECCHHHHHHHHHHHHHHHHHCC IVSIEYIPQKGKNAGNLIEVFYNASNKDMFMFLSDMLIKEKNKYFYLQKVNTLWDDIQYN CEEEEEECCCCCCCCCEEEEEECCCCCHHHHHHHHHHHHCCCCEEEEEEHHHHHHCCCCC NLNKEGGYIDFKNGKKPEALLRRIIDMTTKEGDIVLDYHLGSGTTAAVAHKMNRQYIGIE CCCCCCCEEECCCCCCHHHHHHHHHHHCCCCCCEEEEEECCCCCHHHHHHHHCCCEECCH QMDYIETLAVERLKKVIDGEQGGISKAVNWQGGGEFVYAELAPFNETAKQQILACEDSDD HHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCEEEEEECCCCHHHHHHEEECCCCHH IKTLFEDLCERYFLKYNVSVKEFSQIIEEPEFQSLPLDEQKQMVLEMLDLNQMYVSLSEM HHHHHHHHHHHHHHHCCCCHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHC DDEQFAGCLNDDDKALSRAFYQAEKKDGE CHHHHHCCCCCCHHHHHHHHHHHHCCCCC >Mature Secondary Structure AGKAPKKAKKFILNAIIVSQSVSQSVSQSVSQSVSQSVSQSVSQSVSQSVSQSVSQSVS CCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH QLYTKLTRKRQEIFFNQTLAFDEIDRLFDAKAFSKFSRYTADGKQAVGEIKRHSDGTPAE HHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHCCCCCCCC NLIIKGNNLIALHSLAKQFKGKVKLIYIDPPYNTGNDGFKYNDKFNHSTWLTFMKNRLEI CEEEECCCEEEHHHHHHHHCCCEEEEEECCCCCCCCCCCEECCCCCCHHHHHHHHHHHHH AKTLLADDGVIFVQCDDIEQAYLKILMDDIFDRDNFLNIVTVKTKIGGVSGSSEGKSLKD HHHHHCCCCEEEEEECCHHHHHHHHHHHHHHCCCCCEEEEEEEEEECCCCCCCCCCCCHH STEFINVFSKNRERLFLNPVYQKTEVNEFIKNYEDSGKSWKYTQVLIDLGEKILLEEKDG HHHHHHHHHCCCCEEEECCHHHHHHHHHHHHHHHCCCCCEEHHHHHHHCCCCEEEECCCC FKYYHYPNAQMTSIVKFSQDQNLSKEIIYTEYSHKVYRTTNAQSSIRSKIIEDLYSIKNG CEEEECCCCHHHHHHHHCCCCCCCHHEEEEECCCEEEEECCHHHHHHHHHHHHHHHHHCC IVSIEYIPQKGKNAGNLIEVFYNASNKDMFMFLSDMLIKEKNKYFYLQKVNTLWDDIQYN CEEEEEECCCCCCCCCEEEEEECCCCCHHHHHHHHHHHHCCCCEEEEEEHHHHHHCCCCC NLNKEGGYIDFKNGKKPEALLRRIIDMTTKEGDIVLDYHLGSGTTAAVAHKMNRQYIGIE CCCCCCCEEECCCCCCHHHHHHHHHHHCCCCCCEEEEEECCCCCHHHHHHHHCCCEECCH QMDYIETLAVERLKKVIDGEQGGISKAVNWQGGGEFVYAELAPFNETAKQQILACEDSDD HHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCEEEEEECCCCHHHHHHEEECCCCHH IKTLFEDLCERYFLKYNVSVKEFSQIIEEPEFQSLPLDEQKQMVLEMLDLNQMYVSLSEM HHHHHHHHHHHHHHHCCCCHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHC DDEQFAGCLNDDDKALSRAFYQAEKKDGE CHHHHHCCCCCCHHHHHHHHHHHHCCCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 7542800