Definition Acidovorax citrulli AAC00-1 chromosome, complete genome.
Accession NC_008752
Length 5,352,772

Click here to switch to the map view.

The map label for this gene is 120611436

Identifier: 120611436

GI number: 120611436

Start: 3045217

End: 3047802

Strand: Direct

Name: 120611436

Synonym: Aave_2772

Alternate gene names: NA

Gene position: 3045217-3047802 (Clockwise)

Preceding gene: 120611435

Following gene: 120611439

Centisome position: 56.89

GC content: 66.2

Gene sequence:

>2586_bases
GTGAATTCCGTCGCAGCGCGACTTCTACGCCTCCTGCCATGGAGTAGGGCGGTTGCCGCCACATCGCCCAATGCAGGGGC
CGGGGCCGCGGTGACCTCTTCCGGCCAACCGCCAGCAGGCGATGGCAGTGCGGCGCCGACCTTTCCGCGGGTGGCAGGCA
GCCAACCGGGCTGGCTACGAGTGCTCGAAGCCGAGCAGCTGCTCACCACAGTGCAGGCGTCGCGGGCCATCCAGGAGATC
TGGCGCAAGTCGAACCAATCGCGTGAAACGTGGGAGCGGGATCTGCTGCCAGCCATTCACCGCTATGCCGAGTTCGTTCA
GCTGATGCCCGCTTCCGAGGCCCATCACCACGCACACGCTGGCGGCTTGCTGTCGCACACCATCGAGATGCTGTTGGCCG
CGATGACCTGGCGCAATGCTCATCTGCTGCCCGGCGGAAGCGAGATCGAGGAGGTGGACGCACAGCGCGACCAGTGGACC
TACGTCGTGTTCTTCGCCGCGCTGCTGCACGACATCGCGAAGCCCATGACGGACCTGCGCATCCAATGGCGATGCGACGG
CATGGCGGACTCGATCCGCTGGGCTGCAACGGGCGGTAGCCTGGTCCAGATCGCCGGGCGGCGCCCGGCCGCCGAGTACC
TGGTGGACTTCGCTCCAAAAAGCCAGCGTGACTACAGCGCGCACGGTCGCCTGGCGCAGCTGCTGCTCCCACGCATCGCA
CCTGAATCCGCGCTGCAGTTTCTCGCCTACACGCCGGCGGCCCTGGATGCTCTGGAGAAGTACCTGAGCGGCCAGGACAA
GGACAGCCTCGTCGCACAGATCGTCAAGCGGGCCGACAAGCTCTCCACGCAACGGGCGCTGCTGAGCGGCCACAAGGCGC
GGTTCTCAACGGCGAAGGCCGTTCCTTTGATCGATCTGCTGATGCAGGCCATGGCCGCGATGCTGCGTTCTGGATCCACG
CTCCCGCTCAATCGCAGCGGCGCGGCGGGCTGGGTCTACGACGGCGCCATCTGGTTCGTGGCCAAGCGACTGGCCGACGC
GGTGCGCGAGTGGATCAAGACGCACGAACCGGACGAGGCCGTGCCCGGAGAGACCAAGAACGACCGGCTCTTCGACACCT
GGCAGGAGTACGGCGCCATCGAGCTCAACCCGGCGACGGGACAGGCGATCTGGTATGTGACCGTGCATGGCAACGCGGAC
GAGGGCAGCGAGGCCTCGGAGCAGGGCGGCTACGTGCACGAGCTCGCGATGCTGCGGTTCCCGCTGGCCAAGCTTTTCCC
CGATACAGGCAAGTACCCTGCAACAATGCGCGGACATCTGCAGCTGCGCGAGAAGCGCAAGGCTGAAGCATCGGATGGAG
ATCCACCAGGCAAGCCTGCTGCATCTGAACCCAAAGGCGCGCCGACTGCGCCATCGCAGGGCCCATCCGAAGCTGCCGCA
GATCCAGCGAACCCGCCCGTGCAGCAGCCTCCAGTCGCTGCAGCGTCGAAGGCTGATGGGAGGTCCGCGAAGATTGCCGC
AGCAATGCGCGAACCTGCCTTCAACAAGCCCAAGCCAGCCAAACCTGCCGCAACTGCGAGTCGGCCTGGTGAAGCTGATC
CACCGCATGTGCCGCGGCCAGGTGCCCCGACGCCTGGAGCAACGCCGTCGACGGACGAGGCCAAACCGAGGGGAGGGAGG
GCGCAAGCACCTGCAGAGCCTGCAGAGACTGCAGCAATCGTGCGCGCACCCGAGGATGCGCCAGTTCGCGGGCAAGCAAG
GCCCACCGCCATTGAGCCCGACGAGGCGGCATACCTGGTCGACGCCTCCGATTTTCTCGACCCGATGGAATCTGCGGCAG
CGCTGAAGCGTCAGAAAGGCGCACGACCTGCGTTGTCACCTCCTGCTCCAGTAGTGGGCACGACGCCAAGCCTACCTCGC
GAGGATGGTGCAGGTATGCCCGCGCCTGGGCCAAAGGGGCGGCCGGCGGCGCTGGCGGCTACGAAGGCATCCGCCCCGGA
CGCTGCGAGCTCCAAAAACGCTTCCCTGCCAAGACGCGAGAGCGTGAGCGCTGAGTTTCGGCGCATGGCCGATGAACTGG
AGGACCTCCCGGAGATCATGCCACGCAGCGCGCCAACCACTTCATCAACCTCGCCGGCGGCACCAGAGCCGGTGCTGTTG
GCGCAGAAGCTCCCGAGCCTTGCCCGGGAGAGCGACAAGCCCGTGGCCGAGCCCAGCGAGCTCGCAGTGTCCTTTCTGCG
GTGGATCCAGCAGAGCTTGGTGTCACGCGAGCTGAAGTACAACGAACCAGGCGCGGCGGTGCATTTCGTGGAGCAAGGCA
TGGCACTGGTGTCGCCGCTGATCTTCAGGATGTATGCACGCGAGACGGTGGGTGAGGACCAGGCACAGGAGCTCGGCGCG
CGCGTGCAGCGCGAGGTCATCAAGTGCGGCTGGCACATGCCTGGGCCCAACCGCACGAACATCGTCCGCTTCGCAATCCA
CAGCCGTGGCGGCGTGGCCGGGCACCTGTCTTGTGTCGTCTTGGTCGATCCCTCCCGCTGGGTTCAGCCGGTTCCGCCGA
GCAACCCTGTTCTCAAGGTCGTTTAG

Upstream 100 bases:

>100_bases
GTGAAGGTGAGGACATGGCGACGTGGATGCCAGAGGACGGCAATCCCGATCGCGCCCGGCGCTCTTCCATCCAACTGCTG
GCGCAGGGTCAAGGCACGCT

Downstream 100 bases:

>100_bases
TGGAGAAGGAGATCGAATATGGACCAGAAATCAAACATCTCGGCACCGATTGTTCAGCGTGCCAACGTCGCAGCACGGAC
GCGTCATCAGCAACGGAGCA

Product: metal dependent phosphohydrolase

Products: NA

Alternate protein names: Helicase; Relaxase-Related Protein; Metal Dependent Phosphohydrolase; Conjugal Transfer Protein Tral; Type IV Conjugative Transfer System Protein TraI; Type IV Secretion-Like Conjugative Relaxase TraI

Number of amino acids: Translated: 861; Mature: 861

Protein sequence:

>861_residues
MNSVAARLLRLLPWSRAVAATSPNAGAGAAVTSSGQPPAGDGSAAPTFPRVAGSQPGWLRVLEAEQLLTTVQASRAIQEI
WRKSNQSRETWERDLLPAIHRYAEFVQLMPASEAHHHAHAGGLLSHTIEMLLAAMTWRNAHLLPGGSEIEEVDAQRDQWT
YVVFFAALLHDIAKPMTDLRIQWRCDGMADSIRWAATGGSLVQIAGRRPAAEYLVDFAPKSQRDYSAHGRLAQLLLPRIA
PESALQFLAYTPAALDALEKYLSGQDKDSLVAQIVKRADKLSTQRALLSGHKARFSTAKAVPLIDLLMQAMAAMLRSGST
LPLNRSGAAGWVYDGAIWFVAKRLADAVREWIKTHEPDEAVPGETKNDRLFDTWQEYGAIELNPATGQAIWYVTVHGNAD
EGSEASEQGGYVHELAMLRFPLAKLFPDTGKYPATMRGHLQLREKRKAEASDGDPPGKPAASEPKGAPTAPSQGPSEAAA
DPANPPVQQPPVAAASKADGRSAKIAAAMREPAFNKPKPAKPAATASRPGEADPPHVPRPGAPTPGATPSTDEAKPRGGR
AQAPAEPAETAAIVRAPEDAPVRGQARPTAIEPDEAAYLVDASDFLDPMESAAALKRQKGARPALSPPAPVVGTTPSLPR
EDGAGMPAPGPKGRPAALAATKASAPDAASSKNASLPRRESVSAEFRRMADELEDLPEIMPRSAPTTSSTSPAAPEPVLL
AQKLPSLARESDKPVAEPSELAVSFLRWIQQSLVSRELKYNEPGAAVHFVEQGMALVSPLIFRMYARETVGEDQAQELGA
RVQREVIKCGWHMPGPNRTNIVRFAIHSRGGVAGHLSCVVLVDPSRWVQPVPPSNPVLKVV

Sequences:

>Translated_861_residues
MNSVAARLLRLLPWSRAVAATSPNAGAGAAVTSSGQPPAGDGSAAPTFPRVAGSQPGWLRVLEAEQLLTTVQASRAIQEI
WRKSNQSRETWERDLLPAIHRYAEFVQLMPASEAHHHAHAGGLLSHTIEMLLAAMTWRNAHLLPGGSEIEEVDAQRDQWT
YVVFFAALLHDIAKPMTDLRIQWRCDGMADSIRWAATGGSLVQIAGRRPAAEYLVDFAPKSQRDYSAHGRLAQLLLPRIA
PESALQFLAYTPAALDALEKYLSGQDKDSLVAQIVKRADKLSTQRALLSGHKARFSTAKAVPLIDLLMQAMAAMLRSGST
LPLNRSGAAGWVYDGAIWFVAKRLADAVREWIKTHEPDEAVPGETKNDRLFDTWQEYGAIELNPATGQAIWYVTVHGNAD
EGSEASEQGGYVHELAMLRFPLAKLFPDTGKYPATMRGHLQLREKRKAEASDGDPPGKPAASEPKGAPTAPSQGPSEAAA
DPANPPVQQPPVAAASKADGRSAKIAAAMREPAFNKPKPAKPAATASRPGEADPPHVPRPGAPTPGATPSTDEAKPRGGR
AQAPAEPAETAAIVRAPEDAPVRGQARPTAIEPDEAAYLVDASDFLDPMESAAALKRQKGARPALSPPAPVVGTTPSLPR
EDGAGMPAPGPKGRPAALAATKASAPDAASSKNASLPRRESVSAEFRRMADELEDLPEIMPRSAPTTSSTSPAAPEPVLL
AQKLPSLARESDKPVAEPSELAVSFLRWIQQSLVSRELKYNEPGAAVHFVEQGMALVSPLIFRMYARETVGEDQAQELGA
RVQREVIKCGWHMPGPNRTNIVRFAIHSRGGVAGHLSCVVLVDPSRWVQPVPPSNPVLKVV
>Mature_861_residues
MNSVAARLLRLLPWSRAVAATSPNAGAGAAVTSSGQPPAGDGSAAPTFPRVAGSQPGWLRVLEAEQLLTTVQASRAIQEI
WRKSNQSRETWERDLLPAIHRYAEFVQLMPASEAHHHAHAGGLLSHTIEMLLAAMTWRNAHLLPGGSEIEEVDAQRDQWT
YVVFFAALLHDIAKPMTDLRIQWRCDGMADSIRWAATGGSLVQIAGRRPAAEYLVDFAPKSQRDYSAHGRLAQLLLPRIA
PESALQFLAYTPAALDALEKYLSGQDKDSLVAQIVKRADKLSTQRALLSGHKARFSTAKAVPLIDLLMQAMAAMLRSGST
LPLNRSGAAGWVYDGAIWFVAKRLADAVREWIKTHEPDEAVPGETKNDRLFDTWQEYGAIELNPATGQAIWYVTVHGNAD
EGSEASEQGGYVHELAMLRFPLAKLFPDTGKYPATMRGHLQLREKRKAEASDGDPPGKPAASEPKGAPTAPSQGPSEAAA
DPANPPVQQPPVAAASKADGRSAKIAAAMREPAFNKPKPAKPAATASRPGEADPPHVPRPGAPTPGATPSTDEAKPRGGR
AQAPAEPAETAAIVRAPEDAPVRGQARPTAIEPDEAAYLVDASDFLDPMESAAALKRQKGARPALSPPAPVVGTTPSLPR
EDGAGMPAPGPKGRPAALAATKASAPDAASSKNASLPRRESVSAEFRRMADELEDLPEIMPRSAPTTSSTSPAAPEPVLL
AQKLPSLARESDKPVAEPSELAVSFLRWIQQSLVSRELKYNEPGAAVHFVEQGMALVSPLIFRMYARETVGEDQAQELGA
RVQREVIKCGWHMPGPNRTNIVRFAIHSRGGVAGHLSCVVLVDPSRWVQPVPPSNPVLKVV

Specific function: Unknown

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 92020; Mature: 92020

Theoretical pI: Translated: 8.15; Mature: 8.15

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.3 %Cys     (Translated Protein)
2.2 %Met     (Translated Protein)
2.6 %Cys+Met (Translated Protein)
0.3 %Cys     (Mature Protein)
2.2 %Met     (Mature Protein)
2.6 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MNSVAARLLRLLPWSRAVAATSPNAGAGAAVTSSGQPPAGDGSAAPTFPRVAGSQPGWLR
CCHHHHHHHHHCCCHHHHCCCCCCCCCCCEECCCCCCCCCCCCCCCCCCCCCCCCCCCEE
VLEAEQLLTTVQASRAIQEIWRKSNQSRETWERDLLPAIHRYAEFVQLMPASEAHHHAHA
HHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHH
GGLLSHTIEMLLAAMTWRNAHLLPGGSEIEEVDAQRDQWTYVVFFAALLHDIAKPMTDLR
CHHHHHHHHHHHHHHHHCCCEECCCCCHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHCE
IQWRCDGMADSIRWAATGGSLVQIAGRRPAAEYLVDFAPKSQRDYSAHGRLAQLLLPRIA
EEEEECCCCCCCEEEECCCCEEEECCCCCHHHHHHHCCCCCCCCCHHHHHHHHHHHHHCC
PESALQFLAYTPAALDALEKYLSGQDKDSLVAQIVKRADKLSTQRALLSGHKARFSTAKA
HHHHHHHHHCCHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHH
VPLIDLLMQAMAAMLRSGSTLPLNRSGAAGWVYDGAIWFVAKRLADAVREWIKTHEPDEA
HHHHHHHHHHHHHHHHCCCCCCCCCCCCCCEEEHHHHHHHHHHHHHHHHHHHHCCCCCCC
VPGETKNDRLFDTWQEYGAIELNPATGQAIWYVTVHGNADEGSEASEQGGYVHELAMLRF
CCCCCCCCCHHHHHHHCCCEEECCCCCCEEEEEEEECCCCCCCCHHHHCCHHHHHHHHHH
PLAKLFPDTGKYPATMRGHLQLREKRKAEASDGDPPGKPAASEPKGAPTAPSQGPSEAAA
HHHHHCCCCCCCCCHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
DPANPPVQQPPVAAASKADGRSAKIAAAMREPAFNKPKPAKPAATASRPGEADPPHVPRP
CCCCCCCCCCCCCCCCCCCCCHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
GAPTPGATPSTDEAKPRGGRAQAPAEPAETAAIVRAPEDAPVRGQARPTAIEPDEAAYLV
CCCCCCCCCCCCCCCCCCCCCCCCCCHHHCEEEEECCCCCCCCCCCCCCCCCCCCCEEEE
DASDFLDPMESAAALKRQKGARPALSPPAPVVGTTPSLPREDGAGMPAPGPKGRPAALAA
ECHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCEEEE
TKASAPDAASSKNASLPRRESVSAEFRRMADELEDLPEIMPRSAPTTSSTSPAAPEPVLL
CCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCHHH
AQKLPSLARESDKPVAEPSELAVSFLRWIQQSLVSRELKYNEPGAAVHFVEQGMALVSPL
HHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHH
IFRMYARETVGEDQAQELGARVQREVIKCGWHMPGPNRTNIVRFAIHSRGGVAGHLSCVV
HHHHHHHHHCCHHHHHHHHHHHHHHHHHHCCCCCCCCCCCEEEEEEECCCCCEEEEEEEE
LVDPSRWVQPVPPSNPVLKVV
EECCCCCCCCCCCCCCCEEEC
>Mature Secondary Structure
MNSVAARLLRLLPWSRAVAATSPNAGAGAAVTSSGQPPAGDGSAAPTFPRVAGSQPGWLR
CCHHHHHHHHHCCCHHHHCCCCCCCCCCCEECCCCCCCCCCCCCCCCCCCCCCCCCCCEE
VLEAEQLLTTVQASRAIQEIWRKSNQSRETWERDLLPAIHRYAEFVQLMPASEAHHHAHA
HHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHH
GGLLSHTIEMLLAAMTWRNAHLLPGGSEIEEVDAQRDQWTYVVFFAALLHDIAKPMTDLR
CHHHHHHHHHHHHHHHHCCCEECCCCCHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHCE
IQWRCDGMADSIRWAATGGSLVQIAGRRPAAEYLVDFAPKSQRDYSAHGRLAQLLLPRIA
EEEEECCCCCCCEEEECCCCEEEECCCCCHHHHHHHCCCCCCCCCHHHHHHHHHHHHHCC
PESALQFLAYTPAALDALEKYLSGQDKDSLVAQIVKRADKLSTQRALLSGHKARFSTAKA
HHHHHHHHHCCHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHH
VPLIDLLMQAMAAMLRSGSTLPLNRSGAAGWVYDGAIWFVAKRLADAVREWIKTHEPDEA
HHHHHHHHHHHHHHHHCCCCCCCCCCCCCCEEEHHHHHHHHHHHHHHHHHHHHCCCCCCC
VPGETKNDRLFDTWQEYGAIELNPATGQAIWYVTVHGNADEGSEASEQGGYVHELAMLRF
CCCCCCCCCHHHHHHHCCCEEECCCCCCEEEEEEEECCCCCCCCHHHHCCHHHHHHHHHH
PLAKLFPDTGKYPATMRGHLQLREKRKAEASDGDPPGKPAASEPKGAPTAPSQGPSEAAA
HHHHHCCCCCCCCCHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
DPANPPVQQPPVAAASKADGRSAKIAAAMREPAFNKPKPAKPAATASRPGEADPPHVPRP
CCCCCCCCCCCCCCCCCCCCCHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
GAPTPGATPSTDEAKPRGGRAQAPAEPAETAAIVRAPEDAPVRGQARPTAIEPDEAAYLV
CCCCCCCCCCCCCCCCCCCCCCCCCCHHHCEEEEECCCCCCCCCCCCCCCCCCCCCEEEE
DASDFLDPMESAAALKRQKGARPALSPPAPVVGTTPSLPREDGAGMPAPGPKGRPAALAA
ECHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCEEEE
TKASAPDAASSKNASLPRRESVSAEFRRMADELEDLPEIMPRSAPTTSSTSPAAPEPVLL
CCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCHHH
AQKLPSLARESDKPVAEPSELAVSFLRWIQQSLVSRELKYNEPGAAVHFVEQGMALVSPL
HHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHH
IFRMYARETVGEDQAQELGARVQREVIKCGWHMPGPNRTNIVRFAIHSRGGVAGHLSCVV
HHHHHHHHHCCHHHHHHHHHHHHHHHHHHCCCCCCCCCCCEEEEEEECCCCCEEEEEEEE
LVDPSRWVQPVPPSNPVLKVV
EECCCCCCCCCCCCCCCEEEC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA