| Definition | Haemophilus influenzae Rd KW20 chromosome, complete genome. |
|---|---|
| Accession | NC_000907 |
| Length | 1,830,138 |
Click here to switch to the map view.
The map label for this gene is 16272989
Identifier: 16272989
GI number: 16272989
Start: 1123464
End: 1124048
Strand: Reverse
Name: 16272989
Synonym: HI1058
Alternate gene names: NA
Gene position: 1124048-1123464 (Counterclockwise)
Preceding gene: 16272990
Following gene: 16272988
Centisome position: 61.42
GC content: 40.17
Gene sequence:
>585_bases ATGAAGACAGACATTCAAACCGAATTAACCCAAGCCCTACTATCACACGAAAAAGTATGGGCGAACGAAGAAAAAACCAT TTTAGCCAAAAACATTCTGTTGGATTTGGTGGAAAAAACCGACCCGACCATCATCGGTTTGTTATTGGGGAATGATGATT TAAAACGCCATTTCTTTGTGGAAGTGAATGGTGTTTTGGTGTTTAAATTGCAGGATTTTCGTTTTTTCTTGGACAAACAC AGCATCAATAATTCCTACACAAAATACGCCAATCGCATTGGCTTGACGGACGGCAACCGCTTTTTGAAAGACAGTTCGGA TATTGTGTTGGATTTTCCGTTTAAAGATTGTGTATTGAATGGCGGGCAAAGCACCGAAGAAGGCGAAGAAATTTATTTTA AACGCAATAATAGTCAGTCAGTCAGTCAGTCAGTCAGTCAGTCAGTCAGTCAGTCAGTCAGTCAGTCAGTCAGTCAGTCA GTCAGTCAGTCAGTCAGTCAGTCAGTCAGTCAGTCAGTCAGTCAGTCAGTCAGTCAGTCAATTATACACCAAATTAACCC GAAAAAGACAAGAAATCTTTTTTAA
Upstream 100 bases:
>100_bases AGAGAGTAATTAAACCTGTGCGGTCGATAAATATACCTAAACACTCTGCTATTCCTTTGTAATAGCACATTAAAATAATG ACTTATGAGGATTGATAACG
Downstream 100 bases:
>100_bases TCAAACGCTTGCTTTTGATGAAATTGACCGGCTTTTTGACGCAAAAGCATTCTCAAAATTCTCTCGCTATACCGCAGACG GCAAACAAGCCGTTGGCGAA
Product: hypothetical protein
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 194; Mature: 194
Protein sequence:
>194_residues MKTDIQTELTQALLSHEKVWANEEKTILAKNILLDLVEKTDPTIIGLLLGNDDLKRHFFVEVNGVLVFKLQDFRFFLDKH SINNSYTKYANRIGLTDGNRFLKDSSDIVLDFPFKDCVLNGGQSTEEGEEIYFKRNNSQSVSQSVSQSVSQSVSQSVSQS VSQSVSQSVSQSVSQSVSQSIIHQINPKKTRNLF
Sequences:
>Translated_194_residues MKTDIQTELTQALLSHEKVWANEEKTILAKNILLDLVEKTDPTIIGLLLGNDDLKRHFFVEVNGVLVFKLQDFRFFLDKH SINNSYTKYANRIGLTDGNRFLKDSSDIVLDFPFKDCVLNGGQSTEEGEEIYFKRNNSQSVSQSVSQSVSQSVSQSVSQS VSQSVSQSVSQSVSQSVSQSIIHQINPKKTRNLF >Mature_194_residues MKTDIQTELTQALLSHEKVWANEEKTILAKNILLDLVEKTDPTIIGLLLGNDDLKRHFFVEVNGVLVFKLQDFRFFLDKH SINNSYTKYANRIGLTDGNRFLKDSSDIVLDFPFKDCVLNGGQSTEEGEEIYFKRNNSQSVSQSVSQSVSQSVSQSVSQS VSQSVSQSVSQSVSQSVSQSIIHQINPKKTRNLF
Specific function: Unknown
COG id: COG2189
COG function: function code L; Adenine specific DNA methylase Mod
Gene ontology:
Cell location: Cytoplasmic
Metaboloic importance: NA
Operon status: Not Known
Operon components: None
Similarity: NA
Homologues:
None
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): Y1058_HAEIN (P44106)
Other databases:
- EMBL: L42023 - PIR: G64019 - RefSeq: NP_439216.1 - REBASE: 3701 - GeneID: 949400 - GenomeReviews: L42023_GR - KEGG: hin:HI1058 - NMPDR: fig|71421.1.peg.1017 - TIGR: HI_1058 - HOGENOM: HBG394481 - OMA: SIIHQIN - ProtClustDB: CLSK879480 - BioCyc: HINF71421:HI_1058-MONOMER - InterPro: IPR022221
Pfam domain/function: PF12564 TypeIII_RM_meth
EC number: NA
Molecular weight: Translated: 21807; Mature: 21807
Theoretical pI: Translated: 6.52; Mature: 6.52
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.5 %Cys (Translated Protein) 0.5 %Met (Translated Protein) 1.0 %Cys+Met (Translated Protein) 0.5 %Cys (Mature Protein) 0.5 %Met (Mature Protein) 1.0 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MKTDIQTELTQALLSHEKVWANEEKTILAKNILLDLVEKTDPTIIGLLLGNDDLKRHFFV CCCCHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHCCCCEEEEEEECCCCCCEEEEE EVNGVLVFKLQDFRFFLDKHSINNSYTKYANRIGLTDGNRFLKDSSDIVLDFPFKDCVLN EECCEEEEEEHHHHHHHHHHCCCCHHHHHHHHCCCCCCCHHHCCCCCEEEECCHHHHHCC GGQSTEEGEEIYFKRNNSQSVSQSVSQSVSQSVSQSVSQSVSQSVSQSVSQSVSQSVSQS CCCCCCCCCEEEEECCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH IIHQINPKKTRNLF HHHHCCCCHHCCCC >Mature Secondary Structure MKTDIQTELTQALLSHEKVWANEEKTILAKNILLDLVEKTDPTIIGLLLGNDDLKRHFFV CCCCHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHCCCCEEEEEEECCCCCCEEEEE EVNGVLVFKLQDFRFFLDKHSINNSYTKYANRIGLTDGNRFLKDSSDIVLDFPFKDCVLN EECCEEEEEEHHHHHHHHHHCCCCHHHHHHHHCCCCCCCHHHCCCCCEEEECCHHHHHCC GGQSTEEGEEIYFKRNNSQSVSQSVSQSVSQSVSQSVSQSVSQSVSQSVSQSVSQSVSQS CCCCCCCCCEEEEECCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH IIHQINPKKTRNLF HHHHCCCCHHCCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 10.0
TargetDB status: NA
Availability: NA
References: 7542800