Definition Agrobacterium vitis S4 plasmid pAtS4e, complete sequence.
Accession NC_011981
Length 631,775

Click here to switch to the map view.

The map label for this gene is 222102901

Identifier: 222102901

GI number: 222102901

Start: 586099

End: 587901

Strand: Direct

Name: 222102901

Synonym: Avi_7650

Alternate gene names: NA

Gene position: 586099-587901 (Clockwise)

Preceding gene: 222102900

Following gene: 222102903

Centisome position: 92.77

GC content: 57.46

Gene sequence:

>1803_bases
ATGCTTGATATCAGCCCAGCTACCAAGATAGACACGGTTTTGTCGAAGCTCGGCAAAGCGCTTGAAAGCGGCGACATTGA
TGCCGCCGTCAACCTGTTTCAGACCGATTGCTATTGGCGCGATCTGGTGACATTCACCTGGAACCTTAAGACACTCGAGG
GTCACGAGCAGATCCGAGAGATGCTGAAGAGCCAGCTTGGCGCCATCACACCCTCGAATTTCGTACAGGATCCAAAAGAG
CCCGCCACTGATGCTGGTGGGATCACTGACGGCTGGTTCGAGTTCGAAACGGGCGTCGCACGCGGTTACGGACATATCCG
CCTGAAGGATGGGCGGATATGGACCCTCTTGACCACCATGACCGAATTGAAGGGCCATGAAGAGCCGAAAGGCATCCGCC
GCCCGATGGGGGCCGAGCACGGCCATGACCGTAACCGCATGACCTGGAAAGAAAAGCGCGAGAGCGAGAGCGCCGAGCTG
GGCTATTCGGCGCAACCCTATGTCGTTATCATCGGTGGCGGCCAGGGAGGCATTGCCCTTGGCGCACGGCTTCGCCAGCT
GGGTGTGCCAACAATCATCATCGAGAAGAACGAGCGCCCGGGCGACAGCTGGCGCAAGCGCTACAAGTCACTCTGCCTGC
ACGACCCCGTCTGGTACGATCATTTGCCGTATATTCCCTTCCCGGAAAACTGGCCCGTCTTCACCCCGAAGGACAAGGTA
GGCGACTGGCTGGAAATGTATACCAAAGTCATGGAGTTGAACTACTGGAGCTCCACGACCTGCAAGTCGGCGCAATTCGA
TGAAGCGACCGGCGAATGGACAGTCATTGTTGAACGCGCCGGCAAGGAAATCGTGCTCAAGCCAAAGCAGCTGGTGCTGG
CGACGGGCATGTCGGGCAAGGCCAATGTGCCGAATTTCCCCGGTCAGGATGTGTTCAAGGGTGAACAGCAACATTCCTCG
CAACATCCGGGGCCTGATGCCTATGCCGGCAAGCGAGTGGTGGTGATCGGCTCCAACAATTCCGCCCACGATATCTGCGC
AGCGCTCTGGGAAGCCGGCGCCGATGTCACCATGCTGCAACGGTCATCCACCCATATCGTCAAATCGGGTTCACTGATGG
AGATCGGTCTGGGCGATCTCTACTCGGAAAGGGCGGTGCAGGGCGGCATGACCACGCGTAAGGCCGACCTGATTTTTGCA
TCCCTGCCCTACCGGATCATGCATGAGTTTCAGATCCCGATTTACAACAGGATTCGTGAACAGGACGCAGATTTTTATAA
GGCACTGGAAGAGGCCGGCTTCATGCTGGACTTCGGCGACGACGAGTCTGGCCTGTTCATGAAATATCTGCGACGTGGAT
CGGGCTATTACATCGATGTCGGCGCCTGTGATCTGGTGATTGACGGCTCGATCAAGCTCAAATCCGGCGTGGACGTCTCG
CATTTGACCGAAAACGCCGTCGTGCTGAAGGATGGTACCCAGTTGCCAGCGGATCTCGTGGTCTATGCCACCGGCTATGG
CTCGATGAACGGCTGGGCGGCCGATCTCATTTCGCGCGACGTCGCTGACAAAATCGGCAAATGTTGGGGGCTCGGCTCCG
ATACGACTAAGGACCCCGGTCCCTGGGAGGGCGAACAACGCAACATGTGGAAGCCGACGCAACAGGACGCACTGTGGTTC
CACGGCGGCAACCTGCACCAGTCACGACACTATTCGCAATATCTGTCATTGCAGCTGAAAGCTCGTCAAGTCGGCATCGA
TACGCCCGTCTACGGCATGACCAGACCGCATCATCTGTCGTAA

Upstream 100 bases:

>100_bases
CTGTTGCGGGAGAGGAGACCGCGCAGGTGATGGCCGCTTCGAAAGGCGCCTGGAGGGGCGCTTCATCACCGATGACACAA
GCACTACGGAGGAGAAGACC

Downstream 100 bases:

>100_bases
AGCCCATAGGGGGCGCCAGCCTGGCTGGTGCCCCCTATGATTGGTCCTGTAAGGTCGTGATTTGCGGAAATGAAATAGAG
ATCGGGTAGGGTGGCGATCG

Product: flavin-containing monooxygenase

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 600; Mature: 600

Protein sequence:

>600_residues
MLDISPATKIDTVLSKLGKALESGDIDAAVNLFQTDCYWRDLVTFTWNLKTLEGHEQIREMLKSQLGAITPSNFVQDPKE
PATDAGGITDGWFEFETGVARGYGHIRLKDGRIWTLLTTMTELKGHEEPKGIRRPMGAEHGHDRNRMTWKEKRESESAEL
GYSAQPYVVIIGGGQGGIALGARLRQLGVPTIIIEKNERPGDSWRKRYKSLCLHDPVWYDHLPYIPFPENWPVFTPKDKV
GDWLEMYTKVMELNYWSSTTCKSAQFDEATGEWTVIVERAGKEIVLKPKQLVLATGMSGKANVPNFPGQDVFKGEQQHSS
QHPGPDAYAGKRVVVIGSNNSAHDICAALWEAGADVTMLQRSSTHIVKSGSLMEIGLGDLYSERAVQGGMTTRKADLIFA
SLPYRIMHEFQIPIYNRIREQDADFYKALEEAGFMLDFGDDESGLFMKYLRRGSGYYIDVGACDLVIDGSIKLKSGVDVS
HLTENAVVLKDGTQLPADLVVYATGYGSMNGWAADLISRDVADKIGKCWGLGSDTTKDPGPWEGEQRNMWKPTQQDALWF
HGGNLHQSRHYSQYLSLQLKARQVGIDTPVYGMTRPHHLS

Sequences:

>Translated_600_residues
MLDISPATKIDTVLSKLGKALESGDIDAAVNLFQTDCYWRDLVTFTWNLKTLEGHEQIREMLKSQLGAITPSNFVQDPKE
PATDAGGITDGWFEFETGVARGYGHIRLKDGRIWTLLTTMTELKGHEEPKGIRRPMGAEHGHDRNRMTWKEKRESESAEL
GYSAQPYVVIIGGGQGGIALGARLRQLGVPTIIIEKNERPGDSWRKRYKSLCLHDPVWYDHLPYIPFPENWPVFTPKDKV
GDWLEMYTKVMELNYWSSTTCKSAQFDEATGEWTVIVERAGKEIVLKPKQLVLATGMSGKANVPNFPGQDVFKGEQQHSS
QHPGPDAYAGKRVVVIGSNNSAHDICAALWEAGADVTMLQRSSTHIVKSGSLMEIGLGDLYSERAVQGGMTTRKADLIFA
SLPYRIMHEFQIPIYNRIREQDADFYKALEEAGFMLDFGDDESGLFMKYLRRGSGYYIDVGACDLVIDGSIKLKSGVDVS
HLTENAVVLKDGTQLPADLVVYATGYGSMNGWAADLISRDVADKIGKCWGLGSDTTKDPGPWEGEQRNMWKPTQQDALWF
HGGNLHQSRHYSQYLSLQLKARQVGIDTPVYGMTRPHHLS
>Mature_600_residues
MLDISPATKIDTVLSKLGKALESGDIDAAVNLFQTDCYWRDLVTFTWNLKTLEGHEQIREMLKSQLGAITPSNFVQDPKE
PATDAGGITDGWFEFETGVARGYGHIRLKDGRIWTLLTTMTELKGHEEPKGIRRPMGAEHGHDRNRMTWKEKRESESAEL
GYSAQPYVVIIGGGQGGIALGARLRQLGVPTIIIEKNERPGDSWRKRYKSLCLHDPVWYDHLPYIPFPENWPVFTPKDKV
GDWLEMYTKVMELNYWSSTTCKSAQFDEATGEWTVIVERAGKEIVLKPKQLVLATGMSGKANVPNFPGQDVFKGEQQHSS
QHPGPDAYAGKRVVVIGSNNSAHDICAALWEAGADVTMLQRSSTHIVKSGSLMEIGLGDLYSERAVQGGMTTRKADLIFA
SLPYRIMHEFQIPIYNRIREQDADFYKALEEAGFMLDFGDDESGLFMKYLRRGSGYYIDVGACDLVIDGSIKLKSGVDVS
HLTENAVVLKDGTQLPADLVVYATGYGSMNGWAADLISRDVADKIGKCWGLGSDTTKDPGPWEGEQRNMWKPTQQDALWF
HGGNLHQSRHYSQYLSLQLKARQVGIDTPVYGMTRPHHLS

Specific function: Unknown

COG id: COG2072

COG function: function code P; Predicted flavoprotein involved in K+ transport

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

Organism=Homo sapiens, GI4503759, Length=358, Percent_Identity=24.8603351955307, Blast_Score=89, Evalue=1e-17,
Organism=Homo sapiens, GI4503757, Length=361, Percent_Identity=26.3157894736842, Blast_Score=87, Evalue=4e-17,
Organism=Homo sapiens, GI4503755, Length=366, Percent_Identity=23.7704918032787, Blast_Score=82, Evalue=2e-15,
Organism=Homo sapiens, GI221316672, Length=358, Percent_Identity=25.6983240223464, Blast_Score=82, Evalue=2e-15,
Organism=Homo sapiens, GI221316674, Length=358, Percent_Identity=25.6983240223464, Blast_Score=81, Evalue=2e-15,
Organism=Homo sapiens, GI221316678, Length=211, Percent_Identity=27.9620853080569, Blast_Score=75, Evalue=2e-13,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR013027
- InterPro:   IPR000103 [H]

Pfam domain/function: PF07992 Pyr_redox_2 [H]

EC number: NA

Molecular weight: Translated: 66981; Mature: 66981

Theoretical pI: Translated: 6.33; Mature: 6.33

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.0 %Cys     (Translated Protein)
2.8 %Met     (Translated Protein)
3.8 %Cys+Met (Translated Protein)
1.0 %Cys     (Mature Protein)
2.8 %Met     (Mature Protein)
3.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MLDISPATKIDTVLSKLGKALESGDIDAAVNLFQTDCYWRDLVTFTWNLKTLEGHEQIRE
CCCCCCCHHHHHHHHHHHHHHHCCCCHHHHHHHHHCCCEEEEEEEEEEEEECCHHHHHHH
MLKSQLGAITPSNFVQDPKEPATDAGGITDGWFEFETGVARGYGHIRLKDGRIWTLLTTM
HHHHHHCCCCCHHHHCCCCCCCCCCCCCCCCEEEECCCHHCCCCEEEEECCCEEEHHHHH
TELKGHEEPKGIRRPMGAEHGHDRNRMTWKEKRESESAELGYSAQPYVVIIGGGQGGIAL
HHHCCCCCCCHHHCCCCCCCCCCCCCCCHHHHHCCCHHHCCCCCCCEEEEEECCCCCHHH
GARLRQLGVPTIIIEKNERPGDSWRKRYKSLCLHDPVWYDHLPYIPFPENWPVFTPKDKV
HHHHHHCCCCEEEEECCCCCCHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCHHH
GDWLEMYTKVMELNYWSSTTCKSAQFDEATGEWTVIVERAGKEIVLKPKQLVLATGMSGK
HHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCEEEEEEECCCEEEECCCEEEEEECCCCC
ANVPNFPGQDVFKGEQQHSSQHPGPDAYAGKRVVVIGSNNSAHDICAALWEAGADVTMLQ
CCCCCCCCCHHHCCCHHHCCCCCCCCCCCCCEEEEEECCCCHHHHHHHHHHCCCCEEEEE
RSSTHIVKSGSLMEIGLGDLYSERAVQGGMTTRKADLIFASLPYRIMHEFQIPIYNRIRE
CCCCEEEECCCEEEECCCHHHHHHHHHCCCCCCHHHEEEECCCHHHHHHHCCCHHHHHHH
QDADFYKALEEAGFMLDFGDDESGLFMKYLRRGSGYYIDVGACDLVIDGSIKLKSGVDVS
CCHHHHHHHHHCCCEEEECCCCCHHHHHHHHCCCCCEEEECCEEEEECCCEEECCCCCHH
HLTENAVVLKDGTQLPADLVVYATGYGSMNGWAADLISRDVADKIGKCWGLGSDTTKDPG
HHCCCEEEEECCCCCCCEEEEEEECCCCCCCHHHHHHHHHHHHHHHHHCCCCCCCCCCCC
PWEGEQRNMWKPTQQDALWFHGGNLHQSRHYSQYLSLQLKARQVGIDTPVYGMTRPHHLS
CCCCCCCCCCCCCCCCEEEEECCCCCHHHHHHHHHHEEEEEHEECCCCCCCCCCCCCCCC
>Mature Secondary Structure
MLDISPATKIDTVLSKLGKALESGDIDAAVNLFQTDCYWRDLVTFTWNLKTLEGHEQIRE
CCCCCCCHHHHHHHHHHHHHHHCCCCHHHHHHHHHCCCEEEEEEEEEEEEECCHHHHHHH
MLKSQLGAITPSNFVQDPKEPATDAGGITDGWFEFETGVARGYGHIRLKDGRIWTLLTTM
HHHHHHCCCCCHHHHCCCCCCCCCCCCCCCCEEEECCCHHCCCCEEEEECCCEEEHHHHH
TELKGHEEPKGIRRPMGAEHGHDRNRMTWKEKRESESAELGYSAQPYVVIIGGGQGGIAL
HHHCCCCCCCHHHCCCCCCCCCCCCCCCHHHHHCCCHHHCCCCCCCEEEEEECCCCCHHH
GARLRQLGVPTIIIEKNERPGDSWRKRYKSLCLHDPVWYDHLPYIPFPENWPVFTPKDKV
HHHHHHCCCCEEEEECCCCCCHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCHHH
GDWLEMYTKVMELNYWSSTTCKSAQFDEATGEWTVIVERAGKEIVLKPKQLVLATGMSGK
HHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCEEEEEEECCCEEEECCCEEEEEECCCCC
ANVPNFPGQDVFKGEQQHSSQHPGPDAYAGKRVVVIGSNNSAHDICAALWEAGADVTMLQ
CCCCCCCCCHHHCCCHHHCCCCCCCCCCCCCEEEEEECCCCHHHHHHHHHHCCCCEEEEE
RSSTHIVKSGSLMEIGLGDLYSERAVQGGMTTRKADLIFASLPYRIMHEFQIPIYNRIRE
CCCCEEEECCCEEEECCCHHHHHHHHHCCCCCCHHHEEEECCCHHHHHHHCCCHHHHHHH
QDADFYKALEEAGFMLDFGDDESGLFMKYLRRGSGYYIDVGACDLVIDGSIKLKSGVDVS
CCHHHHHHHHHCCCEEEECCCCCHHHHHHHHCCCCCEEEECCEEEEECCCEEECCCCCHH
HLTENAVVLKDGTQLPADLVVYATGYGSMNGWAADLISRDVADKIGKCWGLGSDTTKDPG
HHCCCEEEEECCCCCCCEEEEEEECCCCCCCHHHHHHHHHHHHHHHHHCCCCCCCCCCCC
PWEGEQRNMWKPTQQDALWFHGGNLHQSRHYSQYLSLQLKARQVGIDTPVYGMTRPHHLS
CCCCCCCCCCCCCCCCEEEEECCCCCHHHHHHHHHHEEEEEHEECCCCCCCCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA