Definition Frankia sp. EAN1pec chromosome, complete genome.
Accession NC_009921
Length 8,982,042

Click here to switch to the map view.

The map label for this gene is 158313659

Identifier: 158313659

GI number: 158313659

Start: 2187817

End: 2189022

Strand: Direct

Name: 158313659

Synonym: Franean1_1823

Alternate gene names: NA

Gene position: 2187817-2189022 (Clockwise)

Preceding gene: 158313658

Following gene: 158313660

Centisome position: 24.36

GC content: 77.11

Gene sequence:

>1206_bases
GTGCTCCTGACGGGCAAGGGTGGTGGTGGGACCACGACGGTGGCAGCGGCGACGGCCACGCTCGCGGCCCAGCGCGGCCA
CCGGACGCTCCTGGTCTGCGCCGACCCGGCCGCCGGCCTGGCCGGCATCCTCGACCATCCGCTCGGCCCCGGTGAGGTCG
AGCTCGAACCCGGGCTGTTCGGCCTCCAACTGGACCTGCGCCACGCGTTCGCCGAGCGCTGGCCGCAACTACGCGCGCTG
ATCTCGGCCGCGGCCCCCGCCGCCGGTGTCGACCTCCTGGAGGTCGAGGAGCTCGCCGGCCTGCCCGGCGCCCTCGAGGC
GCTCACCCTGCTGGAGCTGCGCGACCGGCTCGAGTCGGACCGCTACGACGTCGTGGTCGTCGACGCAGGGCCGGCCAGCG
CCGCGCTGCGGCTGCTGGCGAGCCCGGAGACGCTCGCGTGGGGCTGCCGCCGGCTTGGCTCCCCGGACGGCGTGCTCGCC
CGCTGGATGCGCCCGTCGCTGGCGCTGCCGGGCCGTCTCACCGGGCGGGTGGCCGCGATCGCCGGGCCCGCCTACGAGGC
GGTGTCGTGGCTGGCACGCCTGGCGCGTGACATGCGCGCCCTGCTTGCCGATCCCGTCGTGACCAGCGTGCGCCTGGTGC
TGACCCCGGAGACGGCCGCGCTCGCCCAGGCCCGGCGGACCCTGAGCGCCCTGGCGCTGCACGGCATCGGCGTGGACGCG
GTGGTCGCGAACCGGGTGATCGCTTCGGCCGGGGGCGACGCCTGGCGGGCCGGCTGGGCGGCGGCGCACCGCCAGCAGCT
CATCGAGATCGGCGCGTTCGTCGCGCCGCTGCCCGTCCTCACCGCCGCCTACCGGGCCGGTGAGCCGCTCGGGCTGGAGG
AGCTCGCCGCCTTCGGCGCCGCGGCCTACGGAGACCTCGACCCGGCCGCGGTGCTCAGCGTTCACCGGTCCGGCGAGGGG
GCGGGCCCGCGGGTCGAGCGCACCGAGGGCGGCTACGCCATGTCGTTCGGCCTCCCCTTCGTCGACCGGTCGGAGGTCGA
CCTCGCCCGGGTCGGTGACGACCTCATCGTCAGCGTCGGCCCGCACCGGCGGCTCGTCCCGCTGCCCGCCGCGCTGCGCC
GGTGTGATGTGTCAGGCGCCCGGCTGGCCGAGGAGCGCCTCGTCGTGTCGTTCGTGCCGGACCCGGCCCAGTGGGTGCGC
GCGTGA

Upstream 100 bases:

>100_bases
CTCCGTCGGAAGGTGCAGGGCGGCATCGTCGACGCGGCGCTCAAGGACCTCAAGAAGCACGTCGAGAAGCTCACCGAGAG
CTGACCATCCGGTGCGGTGT

Downstream 100 bases:

>100_bases
GCACGTCGGACGGGGTGCCCCGGGAGGTCGTCGGCTCGCTCGCCCAGGAGGCGGCGCTGCTGGCGGCGGCCGTCCGGGAC
TGGGCGGCGGCCAACGGCGG

Product: arsenite-transporting ATPase

Products: NA

Alternate protein names: Arsenical resistance ATPase; Arsenite-translocating ATPase; Arsenite-transporting ATPase [H]

Number of amino acids: Translated: 401; Mature: 401

Protein sequence:

>401_residues
MLLTGKGGGGTTTVAAATATLAAQRGHRTLLVCADPAAGLAGILDHPLGPGEVELEPGLFGLQLDLRHAFAERWPQLRAL
ISAAAPAAGVDLLEVEELAGLPGALEALTLLELRDRLESDRYDVVVVDAGPASAALRLLASPETLAWGCRRLGSPDGVLA
RWMRPSLALPGRLTGRVAAIAGPAYEAVSWLARLARDMRALLADPVVTSVRLVLTPETAALAQARRTLSALALHGIGVDA
VVANRVIASAGGDAWRAGWAAAHRQQLIEIGAFVAPLPVLTAAYRAGEPLGLEELAAFGAAAYGDLDPAAVLSVHRSGEG
AGPRVERTEGGYAMSFGLPFVDRSEVDLARVGDDLIVSVGPHRRLVPLPAALRRCDVSGARLAEERLVVSFVPDPAQWVR
A

Sequences:

>Translated_401_residues
MLLTGKGGGGTTTVAAATATLAAQRGHRTLLVCADPAAGLAGILDHPLGPGEVELEPGLFGLQLDLRHAFAERWPQLRAL
ISAAAPAAGVDLLEVEELAGLPGALEALTLLELRDRLESDRYDVVVVDAGPASAALRLLASPETLAWGCRRLGSPDGVLA
RWMRPSLALPGRLTGRVAAIAGPAYEAVSWLARLARDMRALLADPVVTSVRLVLTPETAALAQARRTLSALALHGIGVDA
VVANRVIASAGGDAWRAGWAAAHRQQLIEIGAFVAPLPVLTAAYRAGEPLGLEELAAFGAAAYGDLDPAAVLSVHRSGEG
AGPRVERTEGGYAMSFGLPFVDRSEVDLARVGDDLIVSVGPHRRLVPLPAALRRCDVSGARLAEERLVVSFVPDPAQWVR
A
>Mature_401_residues
MLLTGKGGGGTTTVAAATATLAAQRGHRTLLVCADPAAGLAGILDHPLGPGEVELEPGLFGLQLDLRHAFAERWPQLRAL
ISAAAPAAGVDLLEVEELAGLPGALEALTLLELRDRLESDRYDVVVVDAGPASAALRLLASPETLAWGCRRLGSPDGVLA
RWMRPSLALPGRLTGRVAAIAGPAYEAVSWLARLARDMRALLADPVVTSVRLVLTPETAALAQARRTLSALALHGIGVDA
VVANRVIASAGGDAWRAGWAAAHRQQLIEIGAFVAPLPVLTAAYRAGEPLGLEELAAFGAAAYGDLDPAAVLSVHRSGEG
AGPRVERTEGGYAMSFGLPFVDRSEVDLARVGDDLIVSVGPHRRLVPLPAALRRCDVSGARLAEERLVVSFVPDPAQWVR
A

Specific function: Anion-transporting ATPase. Catalyzes the extrusion of arsenite [H]

COG id: COG0003

COG function: function code P; Oxyanion-translocating ATPase

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the arsA ATPase family [H]

Homologues:

Organism=Caenorhabditis elegans, GI17557003, Length=296, Percent_Identity=24.6621621621622, Blast_Score=67, Evalue=2e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR003348
- InterPro:   IPR008978 [H]

Pfam domain/function: NA

EC number: =3.6.3.16 [H]

Molecular weight: Translated: 41752; Mature: 41752

Theoretical pI: Translated: 5.94; Mature: 5.94

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.7 %Cys     (Translated Protein)
1.0 %Met     (Translated Protein)
1.7 %Cys+Met (Translated Protein)
0.7 %Cys     (Mature Protein)
1.0 %Met     (Mature Protein)
1.7 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MLLTGKGGGGTTTVAAATATLAAQRGHRTLLVCADPAAGLAGILDHPLGPGEVELEPGLF
CEEECCCCCCCHHHHHHHHHHHHHCCCCEEEEECCCCCCHHHHHHCCCCCCCEEECCCEE
GLQLDLRHAFAERWPQLRALISAAAPAAGVDLLEVEELAGLPGALEALTLLELRDRLESD
EEEHHHHHHHHHHHHHHHHHHHHCCCCCCCHHEEHHHHHCCCHHHHHHHHHHHHHHHCCC
RYDVVVVDAGPASAALRLLASPETLAWGCRRLGSPDGVLARWMRPSLALPGRLTGRVAAI
CCCEEEEECCCHHHHHHHHCCCHHHHHHHHHCCCCCHHHHHHHCCCCCCCCCCCCCEEEE
AGPAYEAVSWLARLARDMRALLADPVVTSVRLVLTPETAALAQARRTLSALALHGIGVDA
CCCHHHHHHHHHHHHHHHHHHHHCHHHHEEEEEECCCHHHHHHHHHHHHHHHHHCCCHHH
VVANRVIASAGGDAWRAGWAAAHRQQLIEIGAFVAPLPVLTAAYRAGEPLGLEELAAFGA
HHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHCC
AAYGDLDPAAVLSVHRSGEGAGPRVERTEGGYAMSFGLPFVDRSEVDLARVGDDLIVSVG
HHCCCCCHHHHHEEECCCCCCCCCCEECCCCEEEEECCCCCCCCCCHHHHCCCCEEEEEC
PHRRLVPLPAALRRCDVSGARLAEERLVVSFVPDPAQWVRA
CCCCEECCHHHHHHCCCCCHHHHHCCEEEEECCCHHHHHCC
>Mature Secondary Structure
MLLTGKGGGGTTTVAAATATLAAQRGHRTLLVCADPAAGLAGILDHPLGPGEVELEPGLF
CEEECCCCCCCHHHHHHHHHHHHHCCCCEEEEECCCCCCHHHHHHCCCCCCCEEECCCEE
GLQLDLRHAFAERWPQLRALISAAAPAAGVDLLEVEELAGLPGALEALTLLELRDRLESD
EEEHHHHHHHHHHHHHHHHHHHHCCCCCCCHHEEHHHHHCCCHHHHHHHHHHHHHHHCCC
RYDVVVVDAGPASAALRLLASPETLAWGCRRLGSPDGVLARWMRPSLALPGRLTGRVAAI
CCCEEEEECCCHHHHHHHHCCCHHHHHHHHHCCCCCHHHHHHHCCCCCCCCCCCCCEEEE
AGPAYEAVSWLARLARDMRALLADPVVTSVRLVLTPETAALAQARRTLSALALHGIGVDA
CCCHHHHHHHHHHHHHHHHHHHHCHHHHEEEEEECCCHHHHHHHHHHHHHHHHHCCCHHH
VVANRVIASAGGDAWRAGWAAAHRQQLIEIGAFVAPLPVLTAAYRAGEPLGLEELAAFGA
HHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHCC
AAYGDLDPAAVLSVHRSGEGAGPRVERTEGGYAMSFGLPFVDRSEVDLARVGDDLIVSVG
HHCCCCCHHHHHEEECCCCCCCCCCEECCCCEEEEECCCCCCCCCCHHHHCCCCEEEEEC
PHRRLVPLPAALRRCDVSGARLAEERLVVSFVPDPAQWVRA
CCCCEECCHHHHHHCCCCCHHHHHCCEEEEECCCHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 8590279; 8905231 [H]