Definition Geobacillus thermodenitrificans NG80-2 chromosome, complete genome.
Accession NC_009328
Length 3,550,319

Click here to switch to the map view.

The map label for this gene is arsC

Identifier: 138895258

GI number: 138895258

Start: 1688069

End: 1688491

Strand: Direct

Name: arsC

Synonym: GTNG_1600

Alternate gene names: 138895258

Gene position: 1688069-1688491 (Clockwise)

Preceding gene: 138895257

Following gene: 138895260

Centisome position: 47.55

GC content: 43.26

Gene sequence:

>423_bases
ATGAAAAACAAAAAGATCATTTACTTCTTATGCACAGGTAACTCTTGCCGCAGCCAAATGGCAGAAGGATGGGCAAAAAA
ATATCTTGGTGATGATTGGGAAGTGTACAGCGCTGGCATTGAAGCACATGGACTAAATCCAAACGCGGTAAAAGTCATGA
AAGAAGTAGGGATTGATATTTCAAATCAGACATCGGATGTCATTGATCCGGAAATTTTAAACAAAGCTGATTTGGTAGTA
ACATTATGTGGTCATGCAGCAGACCATTGTCCAGTAACCCCGCCAAATGTGAAACGCGTACACTGGGGATTCGATGACCC
GGCAAAGGCGGAAGGAACGGAAGAGGAAAAATTAGCTGTATTCCGTCGTGTTCGCGATGAAATCGGCGCGCGCATCAAAA
AATTTGCTGAAACAGGCGAATAA

Upstream 100 bases:

>100_bases
TGCCTGTCATGATTGCGTTAGTCAACGTGGCACTATGGTTTCAACGAAAATACTTTAAAACAGAATCAGTATCATACTAA
CAACAGAGGTGGAAGGAAAC

Downstream 100 bases:

>100_bases
GACTGAATGACAGCCGAGAAGATTCTTCTCGGCTGATTTTACAGGAGGGGAAATCATGATAAAATTTTTAGCTAGGTATT
AGATTCCGAAAAAACCATTT

Product: arsenate reductase

Products: NA

Alternate protein names: Arsenate reductase; Arsenical pump modifier; Low molecular weight protein-tyrosine-phosphatase

Number of amino acids: Translated: 140; Mature: 140

Protein sequence:

>140_residues
MKNKKIIYFLCTGNSCRSQMAEGWAKKYLGDDWEVYSAGIEAHGLNPNAVKVMKEVGIDISNQTSDVIDPEILNKADLVV
TLCGHAADHCPVTPPNVKRVHWGFDDPAKAEGTEEEKLAVFRRVRDEIGARIKKFAETGE

Sequences:

>Translated_140_residues
MKNKKIIYFLCTGNSCRSQMAEGWAKKYLGDDWEVYSAGIEAHGLNPNAVKVMKEVGIDISNQTSDVIDPEILNKADLVV
TLCGHAADHCPVTPPNVKRVHWGFDDPAKAEGTEEEKLAVFRRVRDEIGARIKKFAETGE
>Mature_140_residues
MKNKKIIYFLCTGNSCRSQMAEGWAKKYLGDDWEVYSAGIEAHGLNPNAVKVMKEVGIDISNQTSDVIDPEILNKADLVV
TLCGHAADHCPVTPPNVKRVHWGFDDPAKAEGTEEEKLAVFRRVRDEIGARIKKFAETGE

Specific function: Reduces arsenate [As(V)] to arsenite [As(III)] and dephosphorylates tyrosine phosphorylated proteins, low-MW aryl phosphates and natural and synthetic acyl phosphates. Could switch between different functions in different circumstances

COG id: COG0394

COG function: function code T; Protein-tyrosine-phosphatase

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the low molecular weight phosphotyrosine protein phosphatase superfamily. ArsC family

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): ARSC_GEOTN (A4INR2)

Other databases:

- EMBL:   CP000557
- RefSeq:   YP_001125711.1
- ProteinModelPortal:   A4INR2
- SMR:   A4INR2
- STRING:   A4INR2
- GeneID:   4966537
- GenomeReviews:   CP000557_GR
- KEGG:   gtn:GTNG_1600
- NMPDR:   fig|420246.5.peg.1543
- eggNOG:   COG0394
- HOGENOM:   HBG730979
- OMA:   TVCDGAK
- ProtClustDB:   PRK13530
- BioCyc:   GTHE420246:GTNG_1600-MONOMER
- HAMAP:   MF_01624
- InterPro:   IPR014064
- InterPro:   IPR017867
- PANTHER:   PTHR11717
- SMART:   SM00226
- TIGRFAMs:   TIGR02691

Pfam domain/function: PF01451 LMWPc; SSF52788 Tyr_Pase_low_mol_wt

EC number: =3.1.3.48

Molecular weight: Translated: 15545; Mature: 15545

Theoretical pI: Translated: 6.11; Mature: 6.11

Prosite motif: NA

Important sites: ACT_SITE 11-11 ACT_SITE 83-83 ACT_SITE 90-90

Signals:

None

Transmembrane regions:

None

Cys/Met content:

2.9 %Cys     (Translated Protein)
2.1 %Met     (Translated Protein)
5.0 %Cys+Met (Translated Protein)
2.9 %Cys     (Mature Protein)
2.1 %Met     (Mature Protein)
5.0 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKNKKIIYFLCTGNSCRSQMAEGWAKKYLGDDWEVYSAGIEAHGLNPNAVKVMKEVGIDI
CCCCEEEEEEECCCHHHHHHHHHHHHHHCCCCCEEEECCCCCCCCCHHHHHHHHHHCCCC
SNQTSDVIDPEILNKADLVVTLCGHAADHCPVTPPNVKRVHWGFDDPAKAEGTEEEKLAV
CCCCCCCCCHHHHCHHHHEEECCCCCCCCCCCCCCCCEEEEECCCCCCCCCCCCHHHHHH
FRRVRDEIGARIKKFAETGE
HHHHHHHHHHHHHHHHHCCC
>Mature Secondary Structure
MKNKKIIYFLCTGNSCRSQMAEGWAKKYLGDDWEVYSAGIEAHGLNPNAVKVMKEVGIDI
CCCCEEEEEEECCCHHHHHHHHHHHHHHCCCCCEEEECCCCCCCCCHHHHHHHHHHCCCC
SNQTSDVIDPEILNKADLVVTLCGHAADHCPVTPPNVKRVHWGFDDPAKAEGTEEEKLAV
CCCCCCCCCHHHHCHHHHEEECCCCCCCCCCCCCCCCEEEEECCCCCCCCCCCCHHHHHH
FRRVRDEIGARIKKFAETGE
HHHHHHHHHHHHHHHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: NA