Definition Mycobacterium avium subsp. paratuberculosis K-10, complete genome.
Accession NC_002944
Length 4,829,781

Click here to switch to the map view.

The map label for this gene is argK [C]

Identifier: 41406785

GI number: 41406785

Start: 707504

End: 708391

Strand: Direct

Name: argK [C]

Synonym: MAP0687

Alternate gene names: 41406785

Gene position: 707504-708391 (Clockwise)

Preceding gene: 41406784

Following gene: 41406786

Centisome position: 14.65

GC content: 73.42

Gene sequence:

>888_bases
ATGACCATCGGAGAGCTGATCGACCGGGCGCGCAACGGATCTCCCCGGGCGGCCGGTCGGCTGCTCAGCCTCGTGGAGGG
CGAGCGGCGCGACGAGGTCTTGACGGCGATCGGTCCCGCGCCCCGCGACACGGGCCCGGTGATCGGCATCACCGGACCGC
CGGGTGCGGGGAAGTCGACGACGGTGGCCGCCCTGGTCGGCGCCTACCGCCGACGCGGATGCCGGGTGGCGGTGCTGGCG
GTGGACCCGTCGTCGCCGTTCAGCGGGGGCGCGCTGCTGGGCGACCGGATCCGAATGGCCGCGCATATCAACGACTCCGA
CGTGTTGATCCGCTCCGTGGCGACCCGCGGGCATCTCGGCGGCCTGGCCGCCGCGGTTCCGGCGGCCATCCGGCTGTTGG
CGGCGATCGGCTACGACGTCGTCCTGCTCGAGACGGTCGGGGTGGGCCAGTCCGAGATCGAGATCGCCGCCGTGGCCGAC
CCGACCGTCGTCATCCTCAATCCCGGTGCCGGCGACGCGGTCCAGGCCGCTAAGGCGGGGGTGTTGGAGGTCGCCGACAT
CGTGGCCGTCAACAAGGCGGACCGCGACGGCGCCGAGCAGACGGTCCGGGATCTTCGTGCCGAAACCAGCGCCCCCATCG
TGTCGTTGATCGCCGCCCGGGGCGAGGGCATCGAGGACCTGATGGCGGTCATCGAGGACCATCGCCGCACCGACAGCCGC
GCCCGTCGACTGGCGCGCGCCCGGGCCCAGATCCTGTCGCTGGCGCAGACCCGGCTGCGCACCCAGCCGGCCCTCGACCG
GCTCGCCGAGGCCGTCGTCGACGGCACCCAGGATCCCTACACCGCCGCCGACCGGCTGCTCTCGCCGTCGAGGACCGAGA
CGGACTGA

Upstream 100 bases:

>100_bases
TTGCGCCGCCGCGGCGGCGGTATCGGCGTCGCGGCGATGTGCGCGGGCGGGGGCATGGGTTCGGCGACGGTGATCGAGGT
CGCGGGCGAATAATGCGCAC

Downstream 100 bases:

>100_bases
CCGCCGGCGGTGTCCCCCAATCGGGGGAACGGGCATTCATCACGTTTGCGGACCGATCGGCGGAGGCGCGCCGCGGGCTA
TCCCCCTACCTTGAGGACCA

Product: hypothetical protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 295; Mature: 294

Protein sequence:

>295_residues
MTIGELIDRARNGSPRAAGRLLSLVEGERRDEVLTAIGPAPRDTGPVIGITGPPGAGKSTTVAALVGAYRRRGCRVAVLA
VDPSSPFSGGALLGDRIRMAAHINDSDVLIRSVATRGHLGGLAAAVPAAIRLLAAIGYDVVLLETVGVGQSEIEIAAVAD
PTVVILNPGAGDAVQAAKAGVLEVADIVAVNKADRDGAEQTVRDLRAETSAPIVSLIAARGEGIEDLMAVIEDHRRTDSR
ARRLARARAQILSLAQTRLRTQPALDRLAEAVVDGTQDPYTAADRLLSPSRTETD

Sequences:

>Translated_295_residues
MTIGELIDRARNGSPRAAGRLLSLVEGERRDEVLTAIGPAPRDTGPVIGITGPPGAGKSTTVAALVGAYRRRGCRVAVLA
VDPSSPFSGGALLGDRIRMAAHINDSDVLIRSVATRGHLGGLAAAVPAAIRLLAAIGYDVVLLETVGVGQSEIEIAAVAD
PTVVILNPGAGDAVQAAKAGVLEVADIVAVNKADRDGAEQTVRDLRAETSAPIVSLIAARGEGIEDLMAVIEDHRRTDSR
ARRLARARAQILSLAQTRLRTQPALDRLAEAVVDGTQDPYTAADRLLSPSRTETD
>Mature_294_residues
TIGELIDRARNGSPRAAGRLLSLVEGERRDEVLTAIGPAPRDTGPVIGITGPPGAGKSTTVAALVGAYRRRGCRVAVLAV
DPSSPFSGGALLGDRIRMAAHINDSDVLIRSVATRGHLGGLAAAVPAAIRLLAAIGYDVVLLETVGVGQSEIEIAAVADP
TVVILNPGAGDAVQAAKAGVLEVADIVAVNKADRDGAEQTVRDLRAETSAPIVSLIAARGEGIEDLMAVIEDHRRTDSRA
RRLARARAQILSLAQTRLRTQPALDRLAEAVVDGTQDPYTAADRLLSPSRTETD

Specific function: May have GTPase activity. May also bind and hydrolyze ATP. May function as chaperone [H]

COG id: COG1703

COG function: function code E; Putative periplasmic protein kinase ArgK and related GTPases of G3E family

Gene ontology:

Cell location: Inner Membrane-Associated [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the ArgK family [H]

Homologues:

Organism=Homo sapiens, GI26892295, Length=272, Percent_Identity=37.5, Blast_Score=157, Evalue=9e-39,
Organism=Escherichia coli, GI1789285, Length=268, Percent_Identity=36.1940298507463, Blast_Score=145, Evalue=4e-36,
Organism=Caenorhabditis elegans, GI71994271, Length=191, Percent_Identity=40.3141361256544, Blast_Score=126, Evalue=1e-29,
Organism=Caenorhabditis elegans, GI71994275, Length=151, Percent_Identity=42.3841059602649, Blast_Score=124, Evalue=7e-29,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR005129
- InterPro:   IPR003593 [H]

Pfam domain/function: PF03308 ArgK [H]

EC number: 2.7.-.- [C]

Molecular weight: Translated: 30638; Mature: 30507

Theoretical pI: Translated: 6.30; Mature: 6.30

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.3 %Cys     (Translated Protein)
1.0 %Met     (Translated Protein)
1.4 %Cys+Met (Translated Protein)
0.3 %Cys     (Mature Protein)
0.7 %Met     (Mature Protein)
1.0 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTIGELIDRARNGSPRAAGRLLSLVEGERRDEVLTAIGPAPRDTGPVIGITGPPGAGKST
CCHHHHHHHHCCCCCHHHHHHHHHHCCCHHHHHHHHCCCCCCCCCCEEEECCCCCCCCHH
TVAALVGAYRRRGCRVAVLAVDPSSPFSGGALLGDRIRMAAHINDSDVLIRSVATRGHLG
HHHHHHHHHHHCCCEEEEEEECCCCCCCCCCHHHHHEEEEEECCCHHHHHHHHHHCCCCC
GLAAAVPAAIRLLAAIGYDVVLLETVGVGQSEIEIAAVADPTVVILNPGAGDAVQAAKAG
HHHHHHHHHHHHHHHHCCCEEEEEECCCCCCCEEEEEECCCEEEEECCCCCHHHHHHHCC
VLEVADIVAVNKADRDGAEQTVRDLRAETSAPIVSLIAARGEGIEDLMAVIEDHRRTDSR
HHHHHHHHHHCCCCCCCHHHHHHHHHHHCCCHHHHHHHHCCCCHHHHHHHHHHHHCCHHH
ARRLARARAQILSLAQTRLRTQPALDRLAEAVVDGTQDPYTAADRLLSPSRTETD
HHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHCCCCCCHHHHHHHCCCCCCCCC
>Mature Secondary Structure 
TIGELIDRARNGSPRAAGRLLSLVEGERRDEVLTAIGPAPRDTGPVIGITGPPGAGKST
CHHHHHHHHCCCCCHHHHHHHHHHCCCHHHHHHHHCCCCCCCCCCEEEECCCCCCCCHH
TVAALVGAYRRRGCRVAVLAVDPSSPFSGGALLGDRIRMAAHINDSDVLIRSVATRGHLG
HHHHHHHHHHHCCCEEEEEEECCCCCCCCCCHHHHHEEEEEECCCHHHHHHHHHHCCCCC
GLAAAVPAAIRLLAAIGYDVVLLETVGVGQSEIEIAAVADPTVVILNPGAGDAVQAAKAG
HHHHHHHHHHHHHHHHCCCEEEEEECCCCCCCEEEEEECCCEEEEECCCCCHHHHHHHCC
VLEVADIVAVNKADRDGAEQTVRDLRAETSAPIVSLIAARGEGIEDLMAVIEDHRRTDSR
HHHHHHHHHHCCCCCCCHHHHHHHHHHHCCCHHHHHHHHCCCCHHHHHHHHHHHHCCHHH
ARRLARARAQILSLAQTRLRTQPALDRLAEAVVDGTQDPYTAADRLLSPSRTETD
HHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHCCCCCCHHHHHHHCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: Arg [C]

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 7.0

TargetDB status: NA

Availability: NA

References: 9679194 [H]