The gene/protein map for NC_009565 is currently unavailable.
Definition Mycobacterium tuberculosis F11, complete genome.
Accession NC_009565
Length 4,424,435

Click here to switch to the map view.

The map label for this gene is arsB [C]

Identifier: 148823874

GI number: 148823874

Start: 3012569

End: 3013858

Strand: Direct

Name: arsB [C]

Synonym: TBFG_12699

Alternate gene names: 148823874

Gene position: 3012569-3013858 (Clockwise)

Preceding gene: 148823873

Following gene: 148823875

Centisome position: 68.09

GC content: 62.87

Gene sequence:

>1290_bases
GTGAGCGTCGTCGCGGTCACCATCTTCGTGGCGGCCTACGTTCTGATTGCCAGCGATCGCGTCAACAAGACGATGGTGGC
GCTGACCGGCGCGGCGGCCGTGGTCGTCCTACCAGTGATCACATCCCACGACATCTTCTATTCCCACGACACCGGAATCG
ACTGGGACGTCATTTTCTTGTTGGTGGGCATGATGATCATCGTCGGAGTGCTGCGGCAGACGGGGGTGTTCGAATACACC
GCGATCTGGGCCGCCAAGCGCGCCCGCGGCTCGCCGCTACGCATCATGATCCTGCTGGTATTGGTGAGCGCGTTGGCGTC
AGCCTTGCTGGATAACGTCACCACGGTGTTGTTGATCGCGCCGGTCACGCTATTGGTGTGCGACCGGTTAAACATCAACA
CGACGTCGTTCCTGATGGCCGAAGTCTTCGCCTCCAACATTGGTGGCGCCGCGACGTTGGTGGGTGACCCGCCGAACATC
ATCGTGGCCAGCCGGGCGGGATTGACGTTCAACGACTTCATGCTGCACTTGACACCGCTGGTAGTCATTGTGCTGATCGC
CCTCATCGCTGTGCTGCCCCGCCTGTTCGGCTCGATCACGGTCGAAGCCGATCGAATTGCCGATGTCATGGCGCTCGACG
AGGGTGAAGCCATCCGCGACCGCGGACTGCTGGTCAAATGTGGCGCCGTGCTGGTGCTGGTGTTCGCGGCCTTCGTCGCC
CATCCGGTGCTGCACATCCAGCCTTCTCTAGTGGCGCTGCTGGGCGCTGGGATGCTGATCGTGGTCTCGGGTCTGACGCG
ATCCGAGTATCTATCCAGCGTCGAGTGGGACACGCTGCTGTTTTTCGCCGGGCTGTTCATTATGGTCGGAGCGCTGGTCA
AGACCGGTGTCGTCAACGATCTCGCGCGGGCAGCGACCCAGCTGACCGGCGGCAATATTGTGGCCACCGCGTTCCTAATC
CTCGGCGTCTCCGCCCCGATCTCGGGAATTATCGACAACATTCCCTACGTCGCCACGATGACGCCCCTCGTCGCGGAGCT
GGTCGCGGTCATGGGGGGTCAACCCAGCACCGACACCCCCTGGTGGGCGCTGGCCCTGGGTGCCGACTTCGGCGGCAACC
TGACCGCAATCGGCGCCAGCGCGAACGTCGTCATGCTCGGAATCGCCCGGCGCGCAGGAGCTCCCATCTCGTTCTGGGAG
TTCACCCGCAAAGGGGCGGTGGTCACGGCCGTCTCGATCGCGCTCGCGGCGATCTACCTGTGGTTGCGGTACTTCGTGTT
GTTGCACTGA

Upstream 100 bases:

>100_bases
CGGCTGCGCAGCCCATTGCTCGCGGTGGTCAAAGACGGCTCGCTGCTCGGGGTGGTCACCGCATCGCGCCTGCTTGCTGC
GGCACTGAAGACTTGACCTC

Downstream 100 bases:

>100_bases
CCATCTGTATTGCCGACAGACCTGTAGCACCAGACGACGCCGCGATGAGCGGCCTACGAGAAGATTCGGAGGATGGCCGA
TGAGCATCATCGCCATCACG

Product: arsenic-transport integral membrane protein arsA

Products: ADP; phosphate; arsenite [Periplasm] [C]

Alternate protein names: NA

Number of amino acids: Translated: 429; Mature: 428

Protein sequence:

>429_residues
MSVVAVTIFVAAYVLIASDRVNKTMVALTGAAAVVVLPVITSHDIFYSHDTGIDWDVIFLLVGMMIIVGVLRQTGVFEYT
AIWAAKRARGSPLRIMILLVLVSALASALLDNVTTVLLIAPVTLLVCDRLNINTTSFLMAEVFASNIGGAATLVGDPPNI
IVASRAGLTFNDFMLHLTPLVVIVLIALIAVLPRLFGSITVEADRIADVMALDEGEAIRDRGLLVKCGAVLVLVFAAFVA
HPVLHIQPSLVALLGAGMLIVVSGLTRSEYLSSVEWDTLLFFAGLFIMVGALVKTGVVNDLARAATQLTGGNIVATAFLI
LGVSAPISGIIDNIPYVATMTPLVAELVAVMGGQPSTDTPWWALALGADFGGNLTAIGASANVVMLGIARRAGAPISFWE
FTRKGAVVTAVSIALAAIYLWLRYFVLLH

Sequences:

>Translated_429_residues
MSVVAVTIFVAAYVLIASDRVNKTMVALTGAAAVVVLPVITSHDIFYSHDTGIDWDVIFLLVGMMIIVGVLRQTGVFEYT
AIWAAKRARGSPLRIMILLVLVSALASALLDNVTTVLLIAPVTLLVCDRLNINTTSFLMAEVFASNIGGAATLVGDPPNI
IVASRAGLTFNDFMLHLTPLVVIVLIALIAVLPRLFGSITVEADRIADVMALDEGEAIRDRGLLVKCGAVLVLVFAAFVA
HPVLHIQPSLVALLGAGMLIVVSGLTRSEYLSSVEWDTLLFFAGLFIMVGALVKTGVVNDLARAATQLTGGNIVATAFLI
LGVSAPISGIIDNIPYVATMTPLVAELVAVMGGQPSTDTPWWALALGADFGGNLTAIGASANVVMLGIARRAGAPISFWE
FTRKGAVVTAVSIALAAIYLWLRYFVLLH
>Mature_428_residues
SVVAVTIFVAAYVLIASDRVNKTMVALTGAAAVVVLPVITSHDIFYSHDTGIDWDVIFLLVGMMIIVGVLRQTGVFEYTA
IWAAKRARGSPLRIMILLVLVSALASALLDNVTTVLLIAPVTLLVCDRLNINTTSFLMAEVFASNIGGAATLVGDPPNII
VASRAGLTFNDFMLHLTPLVVIVLIALIAVLPRLFGSITVEADRIADVMALDEGEAIRDRGLLVKCGAVLVLVFAAFVAH
PVLHIQPSLVALLGAGMLIVVSGLTRSEYLSSVEWDTLLFFAGLFIMVGALVKTGVVNDLARAATQLTGGNIVATAFLIL
GVSAPISGIIDNIPYVATMTPLVAELVAVMGGQPSTDTPWWALALGADFGGNLTAIGASANVVMLGIARRAGAPISFWEF
TRKGAVVTAVSIALAAIYLWLRYFVLLH

Specific function: Involved In Arsenical Resistance. Thought To Form The Channel Of An Arsenite Pump (By Similarity). [C]

COG id: COG1055

COG function: function code P; Na+/H+ antiporter NhaD and related arsenite permeases

Gene ontology:

Cell location: Cell membrane; Multi-pass membrane protein (Probable)

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the CitM (TC 2.A.11) transporter family

Homologues:

Organism=Homo sapiens, GI157266326, Length=167, Percent_Identity=38.9221556886228, Blast_Score=120, Evalue=2e-27,
Organism=Escherichia coli, GI87082277, Length=384, Percent_Identity=24.21875, Blast_Score=67, Evalue=3e-12,
Organism=Escherichia coli, GI1787039, Length=133, Percent_Identity=28.5714285714286, Blast_Score=64, Evalue=2e-11,
Organism=Drosophila melanogaster, GI45550608, Length=479, Percent_Identity=31.3152400835073, Blast_Score=142, Evalue=5e-34,
Organism=Drosophila melanogaster, GI85724998, Length=480, Percent_Identity=25.625, Blast_Score=126, Evalue=3e-29,
Organism=Drosophila melanogaster, GI62484377, Length=480, Percent_Identity=25.625, Blast_Score=125, Evalue=4e-29,
Organism=Drosophila melanogaster, GI24581759, Length=204, Percent_Identity=38.2352941176471, Blast_Score=123, Evalue=2e-28,
Organism=Drosophila melanogaster, GI19920704, Length=204, Percent_Identity=38.2352941176471, Blast_Score=123, Evalue=2e-28,
Organism=Drosophila melanogaster, GI28574683, Length=204, Percent_Identity=38.2352941176471, Blast_Score=123, Evalue=2e-28,
Organism=Drosophila melanogaster, GI28574681, Length=204, Percent_Identity=38.2352941176471, Blast_Score=123, Evalue=2e-28,
Organism=Drosophila melanogaster, GI28574685, Length=204, Percent_Identity=38.2352941176471, Blast_Score=123, Evalue=2e-28,
Organism=Drosophila melanogaster, GI28574678, Length=204, Percent_Identity=38.2352941176471, Blast_Score=123, Evalue=2e-28,
Organism=Drosophila melanogaster, GI24656008, Length=463, Percent_Identity=25.4859611231102, Blast_Score=100, Evalue=3e-21,
Organism=Drosophila melanogaster, GI221472711, Length=223, Percent_Identity=33.6322869955157, Blast_Score=92, Evalue=1e-18,
Organism=Drosophila melanogaster, GI24581764, Length=223, Percent_Identity=33.6322869955157, Blast_Score=90, Evalue=3e-18,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): Y2684_MYCTU (P0A606)

Other databases:

- EMBL:   BX842580
- EMBL:   AE000516
- PIR:   G70528
- RefSeq:   NP_217200.1
- RefSeq:   NP_337259.1
- ProteinModelPortal:   P0A606
- EnsemblBacteria:   EBMYCT00000003901
- EnsemblBacteria:   EBMYCT00000071780
- GeneID:   888366
- GeneID:   925538
- GenomeReviews:   AE000516_GR
- GenomeReviews:   AL123456_GR
- KEGG:   mtc:MT2758
- KEGG:   mtu:Rv2684
- TIGR:   MT2758
- TubercuList:   Rv2684
- GeneTree:   EBGT00050000016378
- HOGENOM:   HBG727257
- OMA:   ASSMSHE
- ProtClustDB:   CLSK792003
- InterPro:   IPR000802
- InterPro:   IPR004680
- PRINTS:   PR00758

Pfam domain/function: PF03600 CitMHS

EC number: NA

Molecular weight: Translated: 45188; Mature: 45057

Theoretical pI: Translated: 5.94; Mature: 5.94

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

HASH(0x1c471b50)-; HASH(0x1c8e50ac)-; HASH(0x1c942e38)-; HASH(0x1c93d310)-; HASH(0x1c5f69c8)-; HASH(0x1c92df9c)-; HASH(0x1c8e4dc4)-; HASH(0x1c93d5bc)-; HASH(0x1b4b15b0)-; HASH(0x1c4cfeb0)-;

Cys/Met content:

0.5 %Cys     (Translated Protein)
3.0 %Met     (Translated Protein)
3.5 %Cys+Met (Translated Protein)
0.5 %Cys     (Mature Protein)
2.8 %Met     (Mature Protein)
3.3 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSVVAVTIFVAAYVLIASDRVNKTMVALTGAAAVVVLPVITSHDIFYSHDTGIDWDVIFL
CCHHHHHHHHHHHHHHHCCCCCCCCEEECCHHHHHHHHHHHCCCEEEECCCCCCHHHHHH
LVGMMIIVGVLRQTGVFEYTAIWAAKRARGSPLRIMILLVLVSALASALLDNVTTVLLIA
HHHHHHHHHHHHHCCCHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHH
PVTLLVCDRLNINTTSFLMAEVFASNIGGAATLVGDPPNIIVASRAGLTFNDFMLHLTPL
HHHHHHHCCCCCCHHHHHHHHHHHHCCCCCEEEECCCCCEEEEECCCCCHHHHHHHHHHH
VVIVLIALIAVLPRLFGSITVEADRIADVMALDEGEAIRDRGLLVKCGAVLVLVFAAFVA
HHHHHHHHHHHHHHHHCCEEEEHHHHHHHHHCCCCCHHHHCCCEEHHHHHHHHHHHHHHH
HPVLHIQPSLVALLGAGMLIVVSGLTRSEYLSSVEWDTLLFFAGLFIMVGALVKTGVVND
CCHHHCCHHHHHHHCCCCEEEEECCCHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHH
LARAATQLTGGNIVATAFLILGVSAPISGIIDNIPYVATMTPLVAELVAVMGGQPSTDTP
HHHHHHHCCCCHHHHHHHHHHHCCCCHHHHHHCCCHHHHHHHHHHHHHHHHCCCCCCCCC
WWALALGADFGGNLTAIGASANVVMLGIARRAGAPISFWEFTRKGAVVTAVSIALAAIYL
EEEEEECCCCCCCEEEECCCCCEEEEEEHHHCCCCCHHHHHHCCCHHHHHHHHHHHHHHH
WLRYFVLLH
HHHHHHHCH
>Mature Secondary Structure 
SVVAVTIFVAAYVLIASDRVNKTMVALTGAAAVVVLPVITSHDIFYSHDTGIDWDVIFL
CHHHHHHHHHHHHHHHCCCCCCCCEEECCHHHHHHHHHHHCCCEEEECCCCCCHHHHHH
LVGMMIIVGVLRQTGVFEYTAIWAAKRARGSPLRIMILLVLVSALASALLDNVTTVLLIA
HHHHHHHHHHHHHCCCHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHH
PVTLLVCDRLNINTTSFLMAEVFASNIGGAATLVGDPPNIIVASRAGLTFNDFMLHLTPL
HHHHHHHCCCCCCHHHHHHHHHHHHCCCCCEEEECCCCCEEEEECCCCCHHHHHHHHHHH
VVIVLIALIAVLPRLFGSITVEADRIADVMALDEGEAIRDRGLLVKCGAVLVLVFAAFVA
HHHHHHHHHHHHHHHHCCEEEEHHHHHHHHHCCCCCHHHHCCCEEHHHHHHHHHHHHHHH
HPVLHIQPSLVALLGAGMLIVVSGLTRSEYLSSVEWDTLLFFAGLFIMVGALVKTGVVND
CCHHHCCHHHHHHHCCCCEEEEECCCHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHH
LARAATQLTGGNIVATAFLILGVSAPISGIIDNIPYVATMTPLVAELVAVMGGQPSTDTP
HHHHHHHCCCCHHHHHHHHHHHCCCCHHHHHHCCCHHHHHHHHHHHHHHHHCCCCCCCCC
WWALALGADFGGNLTAIGASANVVMLGIARRAGAPISFWEFTRKGAVVTAVSIALAAIYL
EEEEEECCCCCCCEEEECCCCCEEEEEEHHHCCCCCHHHHHHCCCHHHHHHHHHHHHHHH
WLRYFVLLH
HHHHHHHCH

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: ATP; arsenite [Cytoplasm]; H2O [C]

Specific reaction: ATP + arsenite [Cytoplasm] + H2O = ADP + phosphate + arsenite [Periplasm] [C]

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 9634230; 12218036