Definition Natranaerobius thermophilus JW/NM-WN-LF, complete genome.
Accession NC_010718
Length 3,165,557

Click here to switch to the map view.

The map label for this gene is yqhT [H]

Identifier: 188586335

GI number: 188586335

Start: 1787823

End: 1788896

Strand: Reverse

Name: yqhT [H]

Synonym: Nther_1718

Alternate gene names: 188586335

Gene position: 1788896-1787823 (Counterclockwise)

Preceding gene: 188586336

Following gene: 188586334

Centisome position: 56.51

GC content: 34.92

Gene sequence:

>1074_bases
ATGTCTAAAATGGACAGACTAAATAGGTTGCGAGGGAAAATGTCAGAGCATGATATCCCAGCCCTGTTTGTAACAAAACA
AGAAAATTGTCGTTACTTAACTGGCTTCACTGGAAGTAGTGGCTTTATACTGGTCACACAAGATGAAAGTTATTTTTTAA
CAGACTTTAGATATGTGGAGCAAGCTGAAGAGCAAATTCCAAAAGACTTTAAAGTAATTAAGCACGAATTTCCCATGGTC
AAAACTCTTAATGAATTACTAAAAAAACTTAATATTGATCAAATTTATCTAGAAAAAAATCATATCACTTATGAAGATTA
CGAAAGGTATCAAGAAAATCTTGAAGCTGACATAATACCAGAAAAAGATTTAGTGTCAGAATTAAGAAAAATAAAGGACA
AAGAAGAAGTGGAAATCTTATCAAAGGCTATTCATATAGCCGATGAAGCTTTTGTACATATTGTTAATTTTATTGAAGAA
GGAGTTACTGAGCGAGACTTGGCTCTTGAACTTGAATACTTTATGAAAAAACAAGGGGCAGAAGACATTTCTTTTGATAT
AATTGTAGCCAGTGGACACCGATCATCATTACCCCATGGAGTAGCGTCAAATAAAAAAATCCAGAATGGTGAATTTATTA
AAATGGATTTTGGAGCAAAATATCAAGGTTATTGCTCTGATATGACTAGAACAGTAGTTTTAGGAAAAGCTAGTGAAGAA
CAGAAAAAGATATATGATCTCGTATTTCAAGCTCAGATGAATGCTTTAGATAATATCCATGCTGGATTAACGGGTAAAGA
AGCGGATAGCTTTGCCAGATTAACTATTGAAAAAGAGGATTATGGCAATTATTTTGGTCATGGATTAGGTCATGGAGTGG
GGATGAAAGTACATGAATCTCCCAGACTTTCGCCTAACCATGAAGACGAATTAGTTCCCGGTATGACGGTTACAGTGGAA
CCTGGAGTGTATATTCCTCAATGGGGTGGTGTTCGAATTGAGGATATTGTTCTCGTTCAAGAACAAGGCTGTGAAGTTCT
AACACGATCAACTAAGGATTTAATCGAGATTTAA

Upstream 100 bases:

>100_bases
TCAGTAATTGCACCTGTTGCTAAAGGTCAAATCTCTGGTATGGGTTTTGCCGGATATTTATTGGCTTTAAATGCTTTTAT
CAAAACTAAGGAGGGTTAGT

Downstream 100 bases:

>100_bases
TTATAGTAGTACCCGTGGAACTAAAGTTGACAAAGGAGGTATTGTAATGATTACTAGTAATGATTTTAAAAATGGCATGA
CAATAGAAGTTGATGGAGAA

Product: peptidase M24

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 357; Mature: 356

Protein sequence:

>357_residues
MSKMDRLNRLRGKMSEHDIPALFVTKQENCRYLTGFTGSSGFILVTQDESYFLTDFRYVEQAEEQIPKDFKVIKHEFPMV
KTLNELLKKLNIDQIYLEKNHITYEDYERYQENLEADIIPEKDLVSELRKIKDKEEVEILSKAIHIADEAFVHIVNFIEE
GVTERDLALELEYFMKKQGAEDISFDIIVASGHRSSLPHGVASNKKIQNGEFIKMDFGAKYQGYCSDMTRTVVLGKASEE
QKKIYDLVFQAQMNALDNIHAGLTGKEADSFARLTIEKEDYGNYFGHGLGHGVGMKVHESPRLSPNHEDELVPGMTVTVE
PGVYIPQWGGVRIEDIVLVQEQGCEVLTRSTKDLIEI

Sequences:

>Translated_357_residues
MSKMDRLNRLRGKMSEHDIPALFVTKQENCRYLTGFTGSSGFILVTQDESYFLTDFRYVEQAEEQIPKDFKVIKHEFPMV
KTLNELLKKLNIDQIYLEKNHITYEDYERYQENLEADIIPEKDLVSELRKIKDKEEVEILSKAIHIADEAFVHIVNFIEE
GVTERDLALELEYFMKKQGAEDISFDIIVASGHRSSLPHGVASNKKIQNGEFIKMDFGAKYQGYCSDMTRTVVLGKASEE
QKKIYDLVFQAQMNALDNIHAGLTGKEADSFARLTIEKEDYGNYFGHGLGHGVGMKVHESPRLSPNHEDELVPGMTVTVE
PGVYIPQWGGVRIEDIVLVQEQGCEVLTRSTKDLIEI
>Mature_356_residues
SKMDRLNRLRGKMSEHDIPALFVTKQENCRYLTGFTGSSGFILVTQDESYFLTDFRYVEQAEEQIPKDFKVIKHEFPMVK
TLNELLKKLNIDQIYLEKNHITYEDYERYQENLEADIIPEKDLVSELRKIKDKEEVEILSKAIHIADEAFVHIVNFIEEG
VTERDLALELEYFMKKQGAEDISFDIIVASGHRSSLPHGVASNKKIQNGEFIKMDFGAKYQGYCSDMTRTVVLGKASEEQ
KKIYDLVFQAQMNALDNIHAGLTGKEADSFARLTIEKEDYGNYFGHGLGHGVGMKVHESPRLSPNHEDELVPGMTVTVEP
GVYIPQWGGVRIEDIVLVQEQGCEVLTRSTKDLIEI

Specific function: Unknown

COG id: COG0006

COG function: function code E; Xaa-Pro aminopeptidase

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the peptidase M24B family [H]

Homologues:

Organism=Homo sapiens, GI11559925, Length=378, Percent_Identity=27.7777777777778, Blast_Score=112, Evalue=5e-25,
Organism=Homo sapiens, GI93141226, Length=268, Percent_Identity=28.7313432835821, Blast_Score=92, Evalue=7e-19,
Organism=Homo sapiens, GI264681563, Length=374, Percent_Identity=25.9358288770053, Blast_Score=91, Evalue=2e-18,
Organism=Homo sapiens, GI260593665, Length=296, Percent_Identity=26.3513513513513, Blast_Score=85, Evalue=1e-16,
Organism=Homo sapiens, GI149589008, Length=296, Percent_Identity=26.3513513513513, Blast_Score=85, Evalue=1e-16,
Organism=Homo sapiens, GI264681565, Length=371, Percent_Identity=24.7978436657682, Blast_Score=75, Evalue=7e-14,
Organism=Escherichia coli, GI1788728, Length=358, Percent_Identity=39.6648044692737, Blast_Score=279, Evalue=2e-76,
Organism=Escherichia coli, GI1789275, Length=264, Percent_Identity=30.3030303030303, Blast_Score=112, Evalue=5e-26,
Organism=Caenorhabditis elegans, GI17509539, Length=268, Percent_Identity=28.7313432835821, Blast_Score=77, Evalue=1e-14,
Organism=Caenorhabditis elegans, GI71989583, Length=259, Percent_Identity=25.4826254826255, Blast_Score=76, Evalue=2e-14,
Organism=Caenorhabditis elegans, GI17508215, Length=297, Percent_Identity=24.5791245791246, Blast_Score=74, Evalue=2e-13,
Organism=Saccharomyces cerevisiae, GI6321118, Length=312, Percent_Identity=27.2435897435897, Blast_Score=106, Evalue=5e-24,
Organism=Saccharomyces cerevisiae, GI6320922, Length=255, Percent_Identity=27.4509803921569, Blast_Score=89, Evalue=2e-18,
Organism=Drosophila melanogaster, GI19920384, Length=283, Percent_Identity=27.5618374558304, Blast_Score=114, Evalue=8e-26,
Organism=Drosophila melanogaster, GI21357079, Length=298, Percent_Identity=27.5167785234899, Blast_Score=99, Evalue=3e-21,
Organism=Drosophila melanogaster, GI17137632, Length=370, Percent_Identity=25.9459459459459, Blast_Score=65, Evalue=7e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR000587
- InterPro:   IPR001714
- InterPro:   IPR000994
- InterPro:   IPR001131 [H]

Pfam domain/function: PF01321 Creatinase_N; PF00557 Peptidase_M24 [H]

EC number: 3.4.-.- [C]

Molecular weight: Translated: 40807; Mature: 40676

Theoretical pI: Translated: 4.85; Mature: 4.85

Prosite motif: PS00491 PROLINE_PEPTIDASE

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.8 %Cys     (Translated Protein)
2.8 %Met     (Translated Protein)
3.6 %Cys+Met (Translated Protein)
0.8 %Cys     (Mature Protein)
2.5 %Met     (Mature Protein)
3.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSKMDRLNRLRGKMSEHDIPALFVTKQENCRYLTGFTGSSGFILVTQDESYFLTDFRYVE
CCHHHHHHHHHCCCCCCCCCEEEEEECCCCEEEEEECCCCCEEEEECCCCEEEHHHHHHH
QAEEQIPKDFKVIKHEFPMVKTLNELLKKLNIDQIYLEKNHITYEDYERYQENLEADIIP
HHHHHCCHHHHHHHHHCCHHHHHHHHHHHCCCCEEEEECCCCCHHHHHHHHHCCCCCCCC
EKDLVSELRKIKDKEEVEILSKAIHIADEAFVHIVNFIEEGVTERDLALELEYFMKKQGA
CHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHCCC
EDISFDIIVASGHRSSLPHGVASNKKIQNGEFIKMDFGAKYQGYCSDMTRTVVLGKASEE
CCCEEEEEEECCCCCCCCCCCCCCCEECCCCEEEEECCCCCCCHHHHCEEEEEEECCCHH
QKKIYDLVFQAQMNALDNIHAGLTGKEADSFARLTIEKEDYGNYFGHGLGHGVGMKVHES
HHHHHHHHHHHHHHHHHHHHCCCCCCCCCCEEEEEEEHHHCCCHHHCCCCCCCCCEECCC
PRLSPNHEDELVPGMTVTVEPGVYIPQWGGVRIEDIVLVQEQGCEVLTRSTKDLIEI
CCCCCCCCCCCCCCEEEEECCCEEECCCCCEEEEEEEEEECCCCHHHHHCHHHHHCC
>Mature Secondary Structure 
SKMDRLNRLRGKMSEHDIPALFVTKQENCRYLTGFTGSSGFILVTQDESYFLTDFRYVE
CHHHHHHHHHCCCCCCCCCEEEEEECCCCEEEEEECCCCCEEEEECCCCEEEHHHHHHH
QAEEQIPKDFKVIKHEFPMVKTLNELLKKLNIDQIYLEKNHITYEDYERYQENLEADIIP
HHHHHCCHHHHHHHHHCCHHHHHHHHHHHCCCCEEEEECCCCCHHHHHHHHHCCCCCCCC
EKDLVSELRKIKDKEEVEILSKAIHIADEAFVHIVNFIEEGVTERDLALELEYFMKKQGA
CHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHCCC
EDISFDIIVASGHRSSLPHGVASNKKIQNGEFIKMDFGAKYQGYCSDMTRTVVLGKASEE
CCCEEEEEEECCCCCCCCCCCCCCCEECCCCEEEEECCCCCCCHHHHCEEEEEEECCCHH
QKKIYDLVFQAQMNALDNIHAGLTGKEADSFARLTIEKEDYGNYFGHGLGHGVGMKVHES
HHHHHHHHHHHHHHHHHHHHCCCCCCCCCCEEEEEEEHHHCCCHHHCCCCCCCCCEECCC
PRLSPNHEDELVPGMTVTVEPGVYIPQWGGVRIEDIVLVQEQGCEVLTRSTKDLIEI
CCCCCCCCCCCCCCEEEEECCCEEECCCCCEEEEEEEEEECCCCHHHHHCHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 8969508; 9384377 [H]