The gene/protein map for NC_004631 is currently unavailable.
Definition Salmonella enterica subsp. enterica serovar Typhi str. Ty2 chromosome, complete genome.
Accession NC_004631
Length 4,791,961

Click here to switch to the map view.

The map label for this gene is ymdB [H]

Identifier: 29142205

GI number: 29142205

Start: 1837355

End: 1837915

Strand: Reverse

Name: ymdB [H]

Synonym: t1773

Alternate gene names: 29142205

Gene position: 1837915-1837355 (Counterclockwise)

Preceding gene: 29142206

Following gene: 29142204

Centisome position: 38.35

GC content: 55.08

Gene sequence:

>561_bases
GTGAGACAAAAGGGGGGGGTTATGACATCACGTCTTCAGGTCATACAGGGTGATATCACTCAACTTAGCGTCGATGCGAT
TGTGAATGCCGCTAACGCATCATTAATGGGCGGCGGTGGCGTAGACGGCGCAATTCATCGCGCGGCGGGGCCGGCATTGC
TGGACGCCTGTAAACTCATCCGTCAGCAACAGGGCGAATGTCAGACGGGACATGCGGTTATCACGCCTGCTGGCAAGCTT
TCGGCAAAGGCGGTTATTCACACAGTGGGGCCCGTCTGGCGAGGCGGCGAACACCAGGAAGCTGAGCTACTCGAAGAGGC
ATACCGGAATTGTTTGCTGCTTGCCGAGGCGAATCACTTTCGTTCCATCGCTTTTCCGGCAATCAGTACCGGCGTTTATG
GCTATCCACGCGCCCAGGCCGCTGAAGTCGCCGTCAGGACGGTTTCAGATTTTATTACCCGTTACGCTCTGCCTGAACAG
GTATACTTTGTCTGTTATGATGAAGAAACTGCCCGGCTTTACGCAAGATTACTTACTCAGCAAGGCGACGACCCTGCCTG
A

Upstream 100 bases:

>100_bases
AAGCCTGGCGGTGATGAATATTGAGTACCGTTAACGGCGGTGTCATAGATATAAAAAGAGCGACTCTGTTGAAAGCCCTG
CTGTACACTTTGCAGATAAG

Downstream 100 bases:

>100_bases
TAAAACACGCCTGGAGCGTGCCGTTGAACCGCTATGCGCGCGCCATCCCGGAGAGTGCGGCATTCTTGCGCTGGATAACA
GTCTGGACGCTTTTGCCGCC

Product: hypothetical protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 186; Mature: 186

Protein sequence:

>186_residues
MRQKGGVMTSRLQVIQGDITQLSVDAIVNAANASLMGGGGVDGAIHRAAGPALLDACKLIRQQQGECQTGHAVITPAGKL
SAKAVIHTVGPVWRGGEHQEAELLEEAYRNCLLLAEANHFRSIAFPAISTGVYGYPRAQAAEVAVRTVSDFITRYALPEQ
VYFVCYDEETARLYARLLTQQGDDPA

Sequences:

>Translated_186_residues
MRQKGGVMTSRLQVIQGDITQLSVDAIVNAANASLMGGGGVDGAIHRAAGPALLDACKLIRQQQGECQTGHAVITPAGKL
SAKAVIHTVGPVWRGGEHQEAELLEEAYRNCLLLAEANHFRSIAFPAISTGVYGYPRAQAAEVAVRTVSDFITRYALPEQ
VYFVCYDEETARLYARLLTQQGDDPA
>Mature_186_residues
MRQKGGVMTSRLQVIQGDITQLSVDAIVNAANASLMGGGGVDGAIHRAAGPALLDACKLIRQQQGECQTGHAVITPAGKL
SAKAVIHTVGPVWRGGEHQEAELLEEAYRNCLLLAEANHFRSIAFPAISTGVYGYPRAQAAEVAVRTVSDFITRYALPEQ
VYFVCYDEETARLYARLLTQQGDDPA

Specific function: Unknown

COG id: COG2110

COG function: function code R; Predicted phosphatase homologous to the C-terminal domain of histone macroH2A1

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 Macro domain [H]

Homologues:

Organism=Homo sapiens, GI117968621, Length=177, Percent_Identity=45.7627118644068, Blast_Score=155, Evalue=2e-38,
Organism=Homo sapiens, GI13569840, Length=165, Percent_Identity=45.4545454545455, Blast_Score=137, Evalue=5e-33,
Organism=Homo sapiens, GI154813199, Length=168, Percent_Identity=39.8809523809524, Blast_Score=113, Evalue=9e-26,
Organism=Homo sapiens, GI20336746, Length=172, Percent_Identity=33.1395348837209, Blast_Score=112, Evalue=3e-25,
Organism=Homo sapiens, GI93141020, Length=175, Percent_Identity=30.8571428571429, Blast_Score=100, Evalue=6e-22,
Organism=Homo sapiens, GI4758496, Length=175, Percent_Identity=30.8571428571429, Blast_Score=100, Evalue=6e-22,
Organism=Homo sapiens, GI93141018, Length=185, Percent_Identity=29.7297297297297, Blast_Score=100, Evalue=7e-22,
Organism=Homo sapiens, GI8923920, Length=186, Percent_Identity=29.5698924731183, Blast_Score=91, Evalue=6e-19,
Organism=Homo sapiens, GI207450721, Length=165, Percent_Identity=35.7575757575758, Blast_Score=86, Evalue=2e-17,
Organism=Homo sapiens, GI8923143, Length=170, Percent_Identity=34.7058823529412, Blast_Score=86, Evalue=2e-17,
Organism=Homo sapiens, GI226371718, Length=140, Percent_Identity=32.8571428571429, Blast_Score=82, Evalue=2e-16,
Organism=Homo sapiens, GI226371710, Length=140, Percent_Identity=32.8571428571429, Blast_Score=82, Evalue=3e-16,
Organism=Homo sapiens, GI226371706, Length=140, Percent_Identity=32.8571428571429, Blast_Score=82, Evalue=3e-16,
Organism=Homo sapiens, GI226371716, Length=140, Percent_Identity=32.8571428571429, Blast_Score=82, Evalue=3e-16,
Organism=Homo sapiens, GI226371714, Length=140, Percent_Identity=32.8571428571429, Blast_Score=82, Evalue=3e-16,
Organism=Homo sapiens, GI226371712, Length=140, Percent_Identity=32.8571428571429, Blast_Score=82, Evalue=3e-16,
Organism=Homo sapiens, GI165377137, Length=174, Percent_Identity=30.4597701149425, Blast_Score=80, Evalue=1e-15,
Organism=Escherichia coli, GI1787283, Length=177, Percent_Identity=76.271186440678, Blast_Score=284, Evalue=2e-78,
Organism=Caenorhabditis elegans, GI17538214, Length=148, Percent_Identity=52.027027027027, Blast_Score=125, Evalue=1e-29,
Organism=Drosophila melanogaster, GI24586353, Length=159, Percent_Identity=32.7044025157233, Blast_Score=76, Evalue=1e-14,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR002589
- InterPro:   IPR022942 [H]

Pfam domain/function: PF01661 Macro [H]

EC number: NA

Molecular weight: Translated: 19953; Mature: 19953

Theoretical pI: Translated: 6.34; Mature: 6.34

Prosite motif: PS51154 MACRO

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

2.2 %Cys     (Translated Protein)
1.6 %Met     (Translated Protein)
3.8 %Cys+Met (Translated Protein)
2.2 %Cys     (Mature Protein)
1.6 %Met     (Mature Protein)
3.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MRQKGGVMTSRLQVIQGDITQLSVDAIVNAANASLMGGGGVDGAIHRAAGPALLDACKLI
CCCCCCCHHHHHHHHHCCHHHHHHHHHHHHCCCCEECCCCCCHHHHHHCCHHHHHHHHHH
RQQQGECQTGHAVITPAGKLSAKAVIHTVGPVWRGGEHQEAELLEEAYRNCLLLAEANHF
HHHCCCCCCCCEEECCCCCHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHEEEEEECCCC
RSIAFPAISTGVYGYPRAQAAEVAVRTVSDFITRYALPEQVYFVCYDEETARLYARLLTQ
HHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHCCCCCEEEEEECCHHHHHHHHHHHC
QGDDPA
CCCCCC
>Mature Secondary Structure
MRQKGGVMTSRLQVIQGDITQLSVDAIVNAANASLMGGGGVDGAIHRAAGPALLDACKLI
CCCCCCCHHHHHHHHHCCHHHHHHHHHHHHCCCCEECCCCCCHHHHHHCCHHHHHHHHHH
RQQQGECQTGHAVITPAGKLSAKAVIHTVGPVWRGGEHQEAELLEEAYRNCLLLAEANHF
HHHCCCCCCCCEEECCCCCHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHEEEEEECCCC
RSIAFPAISTGVYGYPRAQAAEVAVRTVSDFITRYALPEQVYFVCYDEETARLYARLLTQ
HHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHCCCCCEEEEEECCHHHHHHHHHHHC
QGDDPA
CCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: 11677608; 12644504 [H]