Definition Corynebacterium diphtheriae NCTC 13129 chromosome, complete genome.
Accession NC_002935
Length 2,488,635

Click here to switch to the map view.

The map label for this gene is 38234748

Identifier: 38234748

GI number: 38234748

Start: 2295148

End: 2296968

Strand: Direct

Name: 38234748

Synonym: DIP2207

Alternate gene names: NA

Gene position: 2295148-2296968 (Clockwise)

Preceding gene: 38234743

Following gene: 38234753

Centisome position: 92.23

GC content: 60.74

Gene sequence:

>1821_bases
GTGCAGCAACGACGAAGGCTGATAAGCCGCACGCCGAAACCAGTCACAGCAGCCATCATGGCCATCACCTTGGTCGGCGC
AGCAGCCGTAGGCGTAAGCACCAACAGCGTGCTATTTACCCAAGGCGACGCCATCGCCCCCATCAACCCAGAGCTGACCA
CCTCCAGCCTTGCCGACGGCAACAACGTGCTGGTCACCGACCCAGCAATCGCCACCCAGGGCGAAGGCGAAGGCCCCAAA
ACCGTCAAAGAATTCCACCGCGAACAACCCTTCTCACAGTTCGCACTCACCTGGAACGGCGAACGCGACATCGCAGCCTT
CGTCCGTGGTCAACGCCCCGACGGCACTTGGACCGAATGGTTCGACACCGAACCTCTCGACTATGGATCAGACAACCCCA
ACCATAAAAAGGGCACCGACCTGATCTACATCGAACCCACAACCACAGTGCAGGTATCCATCAGCGGCGTTGACGTCCTT
GGCCCCGACGCAGCCAACTTGGACGCAGTCTTTATCGACGGCGGAACCTCCGATCTTCCCGAAAACGGCATCAACCTCAC
CGCCGACTCCGACGGCATGCCCCGCGTCATCTCCCGCGCAGGCTGGGGTGCCGACGAATCCCTCCGCTGCTCCCGACCAG
AATACGAAGACTCCACCGCAGCTATCGTCATCCACCACACCGCCGGATCCAACAACTACAGCCAAAAAGAATCCCCCGGC
ATCATGCGCGGCATCTACAAATACCACGCACAAACCCTCGGCTGGTGCGACATCGGATACCACGCCCTCGCCGACAAATA
CGGCAACCTCTTCGAAGGCCGCTACGGCGGATTGAACAAGAGCATCGTTGGCGCCCACGCAGGTGGCTTCAACTCCAACA
CCTGGGCTATCTCCATGATGGGTAACTATGACGTAGTCCAGCCCCCACAAGCCATGATCAAATCCGTTGGTGAACTCGCC
GGCTGGCGCGCCAAAGTCGCAGGTATCGACCCCAAGGGCTCCGACACCCACTACTCCGAAGGCTCCAGCTACACCTTCTA
CCCCTACGGTCAAGCAGTACTCCTGCCCAACATCTTCGCCCACCGCGACGTAGGAAACACCGCCTGCCCAGGCCGATACG
GATACGCCCAAATGGACAACATCCGCAACATCGCCAAGCAGAAATACGACTCGATCCGCTCCGGCTCCGGCGCGACAGCA
CCCGCTGCACCGTCTACGCCATCAAAACCAGCGCCTGCACCAGCCGCTCCCGCAGCACCTTCTGCACCAGCCGCTCCCGC
TGGCACTAATCCCATCGGGCTACTCAGCCAAGGCTCCACCCCTGCAAACGCAGGCTCCTTGGTCGGACTTGCCGTCGCAG
CAGCCACCTCGCTCGGTCTGATCGGCAACCTTAACAACATTGGCGACGTCCCCGTCATCGGCGGGCTGAAACTCTCCCAG
CTCCAGCCCATCATCGGCAAAATCGTTGAACTCCTTGGCAACAACGACATCTCCCGTGTATGGCGCGACGTAAACTCCTT
CGCCGGCGCAGCCCTCGGCAACGCCCGCTCCCCCATCGCCCACTACGCCTCTGCCACCGGCACCCCCATCGACTACGCCC
TCTTTGACAACGGCATCGTGATCAGCAACCCAGAAACCGGCACCAACGCCCTCTGGGGAACCATCGGCGACCTATGGGCA
CAACAAGGCTTCGAAGCCGGCCCCCTAGGACTACCCACCAGCTCCGTCTTTGAAGTTGACGGCCTCCAGCGCGTGAACTT
CCAACACGGCTACATCACCTTCAACCCAACAACAAGCGCCGTCGACATCCAGGTGCAGTAA

Upstream 100 bases:

>100_bases
GTCTCAGGGGTTTCTTCTTGCCACTAGGTGCACTAGAGTTAACAAGGATTGTCTTTCTCCTCAGAAGACACACGCGCACA
TCACATCGAGGGAGAACACA

Downstream 100 bases:

>100_bases
CAAGCACAAGCTCGCCCCAGCTGGGGCGAGCTTTTTGTTTACCGATGGTATTCCGACAATGCGGCAGTGGTGCCAGCTTA
AAGAAAACGGAATGAAGAGT

Product: hypothetical protein

Products: NA

Alternate protein names: N-Acetylmuramoyl-L-Alanine Amidase; LGFP Repeat-Containing Protein; N-Acetylmuramoyl-L-Alanine Amidase Domain Protein; Twin-Arginine Translocation Pathway Signal; LOW QUALITY PROTEIN Secreted Protein; N-Acetymuramoyl-L-Alanine Amidase; Bifunctional Protein N-Acetylmuramoyl-L-Alanine Amidase; N-Acetylmuramyl-L-Alanine Amidase; FG-GAP Repeat-Containing Protein; LysM Domain-Containing Protein; N-Acetylmuramoyl-L-Alanine Amidase Lytc; LGFP Repeat Protein

Number of amino acids: Translated: 606; Mature: 606

Protein sequence:

>606_residues
MQQRRRLISRTPKPVTAAIMAITLVGAAAVGVSTNSVLFTQGDAIAPINPELTTSSLADGNNVLVTDPAIATQGEGEGPK
TVKEFHREQPFSQFALTWNGERDIAAFVRGQRPDGTWTEWFDTEPLDYGSDNPNHKKGTDLIYIEPTTTVQVSISGVDVL
GPDAANLDAVFIDGGTSDLPENGINLTADSDGMPRVISRAGWGADESLRCSRPEYEDSTAAIVIHHTAGSNNYSQKESPG
IMRGIYKYHAQTLGWCDIGYHALADKYGNLFEGRYGGLNKSIVGAHAGGFNSNTWAISMMGNYDVVQPPQAMIKSVGELA
GWRAKVAGIDPKGSDTHYSEGSSYTFYPYGQAVLLPNIFAHRDVGNTACPGRYGYAQMDNIRNIAKQKYDSIRSGSGATA
PAAPSTPSKPAPAPAAPAAPSAPAAPAGTNPIGLLSQGSTPANAGSLVGLAVAAATSLGLIGNLNNIGDVPVIGGLKLSQ
LQPIIGKIVELLGNNDISRVWRDVNSFAGAALGNARSPIAHYASATGTPIDYALFDNGIVISNPETGTNALWGTIGDLWA
QQGFEAGPLGLPTSSVFEVDGLQRVNFQHGYITFNPTTSAVDIQVQ

Sequences:

>Translated_606_residues
MQQRRRLISRTPKPVTAAIMAITLVGAAAVGVSTNSVLFTQGDAIAPINPELTTSSLADGNNVLVTDPAIATQGEGEGPK
TVKEFHREQPFSQFALTWNGERDIAAFVRGQRPDGTWTEWFDTEPLDYGSDNPNHKKGTDLIYIEPTTTVQVSISGVDVL
GPDAANLDAVFIDGGTSDLPENGINLTADSDGMPRVISRAGWGADESLRCSRPEYEDSTAAIVIHHTAGSNNYSQKESPG
IMRGIYKYHAQTLGWCDIGYHALADKYGNLFEGRYGGLNKSIVGAHAGGFNSNTWAISMMGNYDVVQPPQAMIKSVGELA
GWRAKVAGIDPKGSDTHYSEGSSYTFYPYGQAVLLPNIFAHRDVGNTACPGRYGYAQMDNIRNIAKQKYDSIRSGSGATA
PAAPSTPSKPAPAPAAPAAPSAPAAPAGTNPIGLLSQGSTPANAGSLVGLAVAAATSLGLIGNLNNIGDVPVIGGLKLSQ
LQPIIGKIVELLGNNDISRVWRDVNSFAGAALGNARSPIAHYASATGTPIDYALFDNGIVISNPETGTNALWGTIGDLWA
QQGFEAGPLGLPTSSVFEVDGLQRVNFQHGYITFNPTTSAVDIQVQ
>Mature_606_residues
MQQRRRLISRTPKPVTAAIMAITLVGAAAVGVSTNSVLFTQGDAIAPINPELTTSSLADGNNVLVTDPAIATQGEGEGPK
TVKEFHREQPFSQFALTWNGERDIAAFVRGQRPDGTWTEWFDTEPLDYGSDNPNHKKGTDLIYIEPTTTVQVSISGVDVL
GPDAANLDAVFIDGGTSDLPENGINLTADSDGMPRVISRAGWGADESLRCSRPEYEDSTAAIVIHHTAGSNNYSQKESPG
IMRGIYKYHAQTLGWCDIGYHALADKYGNLFEGRYGGLNKSIVGAHAGGFNSNTWAISMMGNYDVVQPPQAMIKSVGELA
GWRAKVAGIDPKGSDTHYSEGSSYTFYPYGQAVLLPNIFAHRDVGNTACPGRYGYAQMDNIRNIAKQKYDSIRSGSGATA
PAAPSTPSKPAPAPAAPAAPSAPAAPAGTNPIGLLSQGSTPANAGSLVGLAVAAATSLGLIGNLNNIGDVPVIGGLKLSQ
LQPIIGKIVELLGNNDISRVWRDVNSFAGAALGNARSPIAHYASATGTPIDYALFDNGIVISNPETGTNALWGTIGDLWA
QQGFEAGPLGLPTSSVFEVDGLQRVNFQHGYITFNPTTSAVDIQVQ

Specific function: Unknown

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

Organism=Homo sapiens, GI4827036, Length=161, Percent_Identity=33.5403726708075, Blast_Score=67, Evalue=4e-11,
Organism=Homo sapiens, GI16418405, Length=118, Percent_Identity=33.8983050847458, Blast_Score=67, Evalue=5e-11,
Organism=Drosophila melanogaster, GI24651867, Length=178, Percent_Identity=33.7078651685393, Blast_Score=79, Evalue=1e-14,
Organism=Drosophila melanogaster, GI24645946, Length=235, Percent_Identity=27.6595744680851, Blast_Score=74, Evalue=2e-13,
Organism=Drosophila melanogaster, GI21356551, Length=235, Percent_Identity=27.6595744680851, Blast_Score=74, Evalue=2e-13,
Organism=Drosophila melanogaster, GI24645949, Length=235, Percent_Identity=27.6595744680851, Blast_Score=74, Evalue=2e-13,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 63711; Mature: 63711

Theoretical pI: Translated: 5.05; Mature: 5.05

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.5 %Cys     (Translated Protein)
1.3 %Met     (Translated Protein)
1.8 %Cys+Met (Translated Protein)
0.5 %Cys     (Mature Protein)
1.3 %Met     (Mature Protein)
1.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MQQRRRLISRTPKPVTAAIMAITLVGAAAVGVSTNSVLFTQGDAIAPINPELTTSSLADG
CCHHHHHHHCCCCHHHHHHHHHHHHHHHHCCCCCCEEEEECCCEECCCCCCCCCHHCCCC
NNVLVTDPAIATQGEGEGPKTVKEFHREQPFSQFALTWNGERDIAAFVRGQRPDGTWTEW
CEEEEECCCEECCCCCCCHHHHHHHHHHCCCCEEEEEECCCCCCHHHHCCCCCCCCCCCC
FDTEPLDYGSDNPNHKKGTDLIYIEPTTTVQVSISGVDVLGPDAANLDAVFIDGGTSDLP
CCCCCCCCCCCCCCCCCCCEEEEECCCCEEEEEECCEEEECCCCCCCCEEEECCCCCCCC
ENGINLTADSDGMPRVISRAGWGADESLRCSRPEYEDSTAAIVIHHTAGSNNYSQKESPG
CCCCEEEECCCCCHHHHHHCCCCCCCCCCCCCCCCCCCCEEEEEEECCCCCCCCCCCCCH
IMRGIYKYHAQTLGWCDIGYHALADKYGNLFEGRYGGLNKSIVGAHAGGFNSNTWAISMM
HHHHHHHHHHHHCCCHHCCHHHHHHHHCCHHCCCCCCCCCCEEEECCCCCCCCCEEEEEE
GNYDVVQPPQAMIKSVGELAGWRAKVAGIDPKGSDTHYSEGSSYTFYPYGQAVLLPNIFA
CCCCCCCCHHHHHHHHHHHHCCEEEEECCCCCCCCCCCCCCCCEEEECCCCEEECCCHHH
HRDVGNTACPGRYGYAQMDNIRNIAKQKYDSIRSGSGATAPAAPSTPSKPAPAPAAPAAP
HCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCC
SAPAAPAGTNPIGLLSQGSTPANAGSLVGLAVAAATSLGLIGNLNNIGDVPVIGGLKLSQ
CCCCCCCCCCCCEEEECCCCCCCCCHHHHHHHHHHHHHHHHCCCCCCCCCCEECCCCHHH
LQPIIGKIVELLGNNDISRVWRDVNSFAGAALGNARSPIAHYASATGTPIDYALFDNGIV
HHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHCCCCCCCHHHHHCCCCCCEEEEEECCCEE
ISNPETGTNALWGTIGDLWAQQGFEAGPLGLPTSSVFEVDGLQRVNFQHGYITFNPTTSA
EECCCCCCCHHHHHHHHHHHHCCCCCCCCCCCCCCEEECCCCEEEEEECCEEEECCCCCE
VDIQVQ
EEEEEC
>Mature Secondary Structure
MQQRRRLISRTPKPVTAAIMAITLVGAAAVGVSTNSVLFTQGDAIAPINPELTTSSLADG
CCHHHHHHHCCCCHHHHHHHHHHHHHHHHCCCCCCEEEEECCCEECCCCCCCCCHHCCCC
NNVLVTDPAIATQGEGEGPKTVKEFHREQPFSQFALTWNGERDIAAFVRGQRPDGTWTEW
CEEEEECCCEECCCCCCCHHHHHHHHHHCCCCEEEEEECCCCCCHHHHCCCCCCCCCCCC
FDTEPLDYGSDNPNHKKGTDLIYIEPTTTVQVSISGVDVLGPDAANLDAVFIDGGTSDLP
CCCCCCCCCCCCCCCCCCCEEEEECCCCEEEEEECCEEEECCCCCCCCEEEECCCCCCCC
ENGINLTADSDGMPRVISRAGWGADESLRCSRPEYEDSTAAIVIHHTAGSNNYSQKESPG
CCCCEEEECCCCCHHHHHHCCCCCCCCCCCCCCCCCCCCEEEEEEECCCCCCCCCCCCCH
IMRGIYKYHAQTLGWCDIGYHALADKYGNLFEGRYGGLNKSIVGAHAGGFNSNTWAISMM
HHHHHHHHHHHHCCCHHCCHHHHHHHHCCHHCCCCCCCCCCEEEECCCCCCCCCEEEEEE
GNYDVVQPPQAMIKSVGELAGWRAKVAGIDPKGSDTHYSEGSSYTFYPYGQAVLLPNIFA
CCCCCCCCHHHHHHHHHHHHCCEEEEECCCCCCCCCCCCCCCCEEEECCCCEEECCCHHH
HRDVGNTACPGRYGYAQMDNIRNIAKQKYDSIRSGSGATAPAAPSTPSKPAPAPAAPAAP
HCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCC
SAPAAPAGTNPIGLLSQGSTPANAGSLVGLAVAAATSLGLIGNLNNIGDVPVIGGLKLSQ
CCCCCCCCCCCCEEEECCCCCCCCCHHHHHHHHHHHHHHHHCCCCCCCCCCEECCCCHHH
LQPIIGKIVELLGNNDISRVWRDVNSFAGAALGNARSPIAHYASATGTPIDYALFDNGIV
HHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHCCCCCCCHHHHHCCCCCCEEEEEECCCEE
ISNPETGTNALWGTIGDLWAQQGFEAGPLGLPTSSVFEVDGLQRVNFQHGYITFNPTTSA
EECCCCCCCHHHHHHHHHHHHCCCCCCCCCCCCCCEEECCCCEEEEEECCEEEECCCCCE
VDIQVQ
EEEEEC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA