| Definition | Gluconacetobacter diazotrophicus PAl 5 chromosome, complete genome. |
|---|---|
| Accession | NC_010125 |
| Length | 3,944,163 |
Click here to switch to the map view.
The map label for this gene is aarA [H]
Identifier: 162147614
GI number: 162147614
Start: 1862411
End: 1863712
Strand: Reverse
Name: aarA [H]
Synonym: GDI_1830
Alternate gene names: 162147614
Gene position: 1863712-1862411 (Counterclockwise)
Preceding gene: 162147615
Following gene: 162147612
Centisome position: 47.25
GC content: 63.52
Gene sequence:
>1302_bases TTGATGACCGAGCCAGGAAAAGTGGCCACCGTCTCGCTAGAAGGCAAAACCGCCAGTCTGCCGGTCCTTTCCGGGACGCT GGGCCCGGACGTTCTGGACGTCCGCAGGATCGCCGCCGACATGGGCGTCTTCACCTTCGACCCGGGCTATGGCGAAACGG CGTCGTGCGAAAGCAAGATCACGTTCATCGACGGCGGCAAGGGCGTCCTGCTGCATCGTGGCTACCCGATCGCGCAGCTT GCCGAGCAGGGCACGTTCCTCGAGGTCGCGTACCTGCTGCTGAACGGCGAACTGCCGACGACGGCGCAGCACGAGGCATT CGTCTCGACCATCAAGTCGCACACGCTGCTGCATGAACAGATCCGCAATTTCTTCAACGGGTTCCGCCGCGACGCGCATC CGATGGCGATCCTGTGCGGCACCGTCGGCGCGCTGTCGGCCTTCTATCACGAAGGCACGGACATCTCGAACGAGGCCAGC CGCTCGCTGTCGGCGATGCGCCTGATCGCCAAGCTGCCGACGATCGCGGCCTGGGCGTACAAATACACGCAGGGCGAGCC GTTCGTGTATCCGCGCAACGACCTGAATTACGCGGAAAACTTCCTGTCGATGATGTTCGCGCATCCGTCGGAGCCCTACG TCATCAACCCGGTGCTGGCGCGGGCGATGGATCGCATCCTGATCCTGCATGCCGACCACGAACAGAATGCCTCGACCTCG ACCGTGCGCCTGGCGGGCTCGACCGGCGCCAATCCGTTCGCGTGCATCGCCGCCGGCATCGCGGCGCTGTGGGGACCCGC CCATGGCGGCGCGAACGAGGCCGTGCTGAAAATGCTGGCCGAAATCGGCAACAAGGACAACATCCCCGACTTCATCGCCA AGGTGAAGGACAAGAACAGCGGCGTGCGCCTGATGGGCTTCGGCCATCGCGTGTACAAGAATTTCGACCCGCGCGCGAAG ATCATGCAGGCCACCTGCCATGAGGTGCTGGGCGAACTGGGGATCAAGGACGATCCGCTGCTGGACCTGGCGGTCGAACT GGAAAAGATCGCGATCAACGACGAATATTTCGTCAAGCGCAGCCTGTATCCCAACGTCGATTTCTATTCGGGCATCATCC TGAAGGCGATGGGCATTCCCACCAGCATGTTCACGGTCCTGTTCGCCGTCGCGCGCACGGTGGGCTGGATCAGCCAATGG AAGGAAATGATCGAGGAACCGGGCCAGCGCATCGGCCGTCCGCGCCAGCTCTATACCGGCGCCCCGCAGCGCGACTTCAC GCCGTTCGCGCAGCGCGGCTGA
Upstream 100 bases:
>100_bases CGATGGGCCACGCCATGAACTGTCACGCAGAGGACAGCGGCCCGCAGGTTGGGGATGAGATCGGCCGCATCGCAGGGCGG CGAACGACCAAGAGGAGAGT
Downstream 100 bases:
>100_bases CCGGACCGGCAGGCCCGGGCGGACACGCCCGGGCAGCCCCGTGCCGCCCGCCGGGCATGAAAAAGCCGGCCATCCCGCGG GGGTGGCCGGCTTTTTCATG
Product: citrate synthase
Products: NA
Alternate protein names: Acetic acid resistance protein [H]
Number of amino acids: Translated: 433; Mature: 433
Protein sequence:
>433_residues MMTEPGKVATVSLEGKTASLPVLSGTLGPDVLDVRRIAADMGVFTFDPGYGETASCESKITFIDGGKGVLLHRGYPIAQL AEQGTFLEVAYLLLNGELPTTAQHEAFVSTIKSHTLLHEQIRNFFNGFRRDAHPMAILCGTVGALSAFYHEGTDISNEAS RSLSAMRLIAKLPTIAAWAYKYTQGEPFVYPRNDLNYAENFLSMMFAHPSEPYVINPVLARAMDRILILHADHEQNASTS TVRLAGSTGANPFACIAAGIAALWGPAHGGANEAVLKMLAEIGNKDNIPDFIAKVKDKNSGVRLMGFGHRVYKNFDPRAK IMQATCHEVLGELGIKDDPLLDLAVELEKIAINDEYFVKRSLYPNVDFYSGIILKAMGIPTSMFTVLFAVARTVGWISQW KEMIEEPGQRIGRPRQLYTGAPQRDFTPFAQRG
Sequences:
>Translated_433_residues MMTEPGKVATVSLEGKTASLPVLSGTLGPDVLDVRRIAADMGVFTFDPGYGETASCESKITFIDGGKGVLLHRGYPIAQL AEQGTFLEVAYLLLNGELPTTAQHEAFVSTIKSHTLLHEQIRNFFNGFRRDAHPMAILCGTVGALSAFYHEGTDISNEAS RSLSAMRLIAKLPTIAAWAYKYTQGEPFVYPRNDLNYAENFLSMMFAHPSEPYVINPVLARAMDRILILHADHEQNASTS TVRLAGSTGANPFACIAAGIAALWGPAHGGANEAVLKMLAEIGNKDNIPDFIAKVKDKNSGVRLMGFGHRVYKNFDPRAK IMQATCHEVLGELGIKDDPLLDLAVELEKIAINDEYFVKRSLYPNVDFYSGIILKAMGIPTSMFTVLFAVARTVGWISQW KEMIEEPGQRIGRPRQLYTGAPQRDFTPFAQRG >Mature_433_residues MMTEPGKVATVSLEGKTASLPVLSGTLGPDVLDVRRIAADMGVFTFDPGYGETASCESKITFIDGGKGVLLHRGYPIAQL AEQGTFLEVAYLLLNGELPTTAQHEAFVSTIKSHTLLHEQIRNFFNGFRRDAHPMAILCGTVGALSAFYHEGTDISNEAS RSLSAMRLIAKLPTIAAWAYKYTQGEPFVYPRNDLNYAENFLSMMFAHPSEPYVINPVLARAMDRILILHADHEQNASTS TVRLAGSTGANPFACIAAGIAALWGPAHGGANEAVLKMLAEIGNKDNIPDFIAKVKDKNSGVRLMGFGHRVYKNFDPRAK IMQATCHEVLGELGIKDDPLLDLAVELEKIAINDEYFVKRSLYPNVDFYSGIILKAMGIPTSMFTVLFAVARTVGWISQW KEMIEEPGQRIGRPRQLYTGAPQRDFTPFAQRG
Specific function: Tricarboxylic acid cycle. [C]
COG id: COG0372
COG function: function code C; Citrate synthase
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the citrate synthase family [H]
Homologues:
Organism=Homo sapiens, GI38327625, Length=352, Percent_Identity=28.6931818181818, Blast_Score=124, Evalue=2e-28, Organism=Escherichia coli, GI1786939, Length=425, Percent_Identity=65.8823529411765, Blast_Score=605, Evalue=1e-174, Organism=Escherichia coli, GI1786527, Length=385, Percent_Identity=30.3896103896104, Blast_Score=163, Evalue=2e-41, Organism=Caenorhabditis elegans, GI17555174, Length=442, Percent_Identity=29.185520361991, Blast_Score=130, Evalue=1e-30, Organism=Saccharomyces cerevisiae, GI6319850, Length=374, Percent_Identity=31.0160427807487, Blast_Score=123, Evalue=7e-29, Organism=Saccharomyces cerevisiae, GI6324328, Length=355, Percent_Identity=29.0140845070423, Blast_Score=117, Evalue=4e-27, Organism=Saccharomyces cerevisiae, GI6325257, Length=360, Percent_Identity=27.5, Blast_Score=95, Evalue=2e-20, Organism=Drosophila melanogaster, GI24640124, Length=420, Percent_Identity=29.0476190476191, Blast_Score=126, Evalue=3e-29, Organism=Drosophila melanogaster, GI24640126, Length=420, Percent_Identity=29.0476190476191, Blast_Score=126, Evalue=3e-29, Organism=Drosophila melanogaster, GI21356863, Length=364, Percent_Identity=28.2967032967033, Blast_Score=113, Evalue=3e-25,
Paralogues:
None
Copy number: 624 Molecules/Cell In: Growth Phase, Glucose-minimal MOPS Media. 2,000 Molecules/Cell In: Glucose minimal media [C]
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR016142 - InterPro: IPR016143 - InterPro: IPR002020 - InterPro: IPR016141 - InterPro: IPR019810 - InterPro: IPR010953 [H]
Pfam domain/function: PF00285 Citrate_synt [H]
EC number: =2.3.3.1 [H]
Molecular weight: Translated: 47458; Mature: 47458
Theoretical pI: Translated: 6.80; Mature: 6.80
Prosite motif: PS00480 CITRATE_SYNTHASE
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.9 %Cys (Translated Protein) 3.2 %Met (Translated Protein) 4.2 %Cys+Met (Translated Protein) 0.9 %Cys (Mature Protein) 3.2 %Met (Mature Protein) 4.2 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MMTEPGKVATVSLEGKTASLPVLSGTLGPDVLDVRRIAADMGVFTFDPGYGETASCESKI CCCCCCCEEEEEECCCCCCCCEEECCCCCHHHHHHHHHHHCCCEEECCCCCCCCCCCCEE TFIDGGKGVLLHRGYPIAQLAEQGTFLEVAYLLLNGELPTTAQHEAFVSTIKSHTLLHEQ EEEECCCEEEEECCCCHHHHHHCCCHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHH IRNFFNGFRRDAHPMAILCGTVGALSAFYHEGTDISNEASRSLSAMRLIAKLPTIAAWAY HHHHHHHHCCCCCCHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHCCHHHHHHE KYTQGEPFVYPRNDLNYAENFLSMMFAHPSEPYVINPVLARAMDRILILHADHEQNASTS EECCCCCEEECCCCHHHHHHHHHHHHCCCCCCEEECHHHHHHHCCEEEEECCCCCCCCCC TVRLAGSTGANPFACIAAGIAALWGPAHGGANEAVLKMLAEIGNKDNIPDFIAKVKDKNS EEEEECCCCCCHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHCCCCCCHHHHHHHHCCCC GVRLMGFGHRVYKNFDPRAKIMQATCHEVLGELGIKDDPLLDLAVELEKIAINDEYFVKR CEEEEECCHHHHCCCCHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHEECCHHHHHH SLYPNVDFYSGIILKAMGIPTSMFTVLFAVARTVGWISQWKEMIEEPGQRIGRPRQLYTG CCCCCCCHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEECCC APQRDFTPFAQRG CCCCCCCCHHCCC >Mature Secondary Structure MMTEPGKVATVSLEGKTASLPVLSGTLGPDVLDVRRIAADMGVFTFDPGYGETASCESKI CCCCCCCEEEEEECCCCCCCCEEECCCCCHHHHHHHHHHHCCCEEECCCCCCCCCCCCEE TFIDGGKGVLLHRGYPIAQLAEQGTFLEVAYLLLNGELPTTAQHEAFVSTIKSHTLLHEQ EEEECCCEEEEECCCCHHHHHHCCCHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHH IRNFFNGFRRDAHPMAILCGTVGALSAFYHEGTDISNEASRSLSAMRLIAKLPTIAAWAY HHHHHHHHCCCCCCHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHCCHHHHHHE KYTQGEPFVYPRNDLNYAENFLSMMFAHPSEPYVINPVLARAMDRILILHADHEQNASTS EECCCCCEEECCCCHHHHHHHHHHHHCCCCCCEEECHHHHHHHCCEEEEECCCCCCCCCC TVRLAGSTGANPFACIAAGIAALWGPAHGGANEAVLKMLAEIGNKDNIPDFIAKVKDKNS EEEEECCCCCCHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHCCCCCCHHHHHHHHCCCC GVRLMGFGHRVYKNFDPRAKIMQATCHEVLGELGIKDDPLLDLAVELEKIAINDEYFVKR CEEEEECCHHHHCCCCHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHEECCHHHHHH SLYPNVDFYSGIILKAMGIPTSMFTVLFAVARTVGWISQWKEMIEEPGQRIGRPRQLYTG CCCCCCCHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEECCC APQRDFTPFAQRG CCCCCCCCHHCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 2156811 [H]