| Definition | Azorhizobium caulinodans ORS 571, complete genome. |
|---|---|
| Accession | NC_009937 |
| Length | 5,369,772 |
Click here to switch to the map view.
The map label for this gene is gltA [H]
Identifier: 158423334
GI number: 158423334
Start: 1956920
End: 1958224
Strand: Reverse
Name: gltA [H]
Synonym: AZC_1710
Alternate gene names: 158423334
Gene position: 1958224-1956920 (Counterclockwise)
Preceding gene: 158423335
Following gene: 158423331
Centisome position: 36.47
GC content: 63.37
Gene sequence:
>1305_bases ATGGACGCCACCAACAACGCCACCGCGGCCAAGCTGACAGTGGGCGACAAGAGCTGGGAATTCCCCATCAAGAAAGGAAC CATCGGGCCTGACGTGGTGGATATCTCCAAGCTCTACGGCCAGAGCGGGATGTTCACCTACGATCCGGGCTTCACGTCCA CCGCGTCCTGCGAGAGCCAGATCACCTATATCGACGGCGACGAAGGCGTTCTCCTCTATCGCGGCTTCCCCATCGAGCAG CTCGCCGAGGGCGGTGACTTCCTCGAGACCTGCTACCTGCTGCTGTACGGCGAACTGCCGACCGCCGCCCAGAAGGCGGA CTTCGATCACTCCGTGACCCGTCACACGATGGTTCACGACCAGATGAACCGCTTCTTCAACGGCTTCCGCCGCGACGCGC ACCCCATGGCGATCATGGTGGCCTGCGTCGGCGCGCTCTCGGCCTTCTATCACGACTCCACCGACATCTCCGATCCGCAG CAGCGCCTCATCGCGTCCATCCGCATGATCGCGAAGATGCCGACGCTGGCGGCGATGGCTTACAAGTATTCGATCGGTCA GCCCTTCGTGTATCCGAAGAACGACCTCGACTACGCCTCCAACTTCCTCAACATGTGCTTCGCGGTCCCCTGCGAGGATT ACAAGGTGAGCCCGACGCTCGCCCGTGCGCTGGACAAGATCTTCATCCTGCACGCGGACCACGAGCAGAACGCTTCCACC TCGACGGTGCGTCTCGCCGGCTCGTCCGGCGCCAACCCGTTCGCCTGTATCGCCGCCGGCATCGCCTGCCTGTGGGGTCC GGCGCACGGCGGCGCCAATGAAGCCGCCCTCAAGATGCTGACCGAGATCGGCACGCCGGACCGCATCCCCGAGTTCGTGA ACAAGGCGAAGGACAAGAACGATCCCTTCCGCCTCATGGGCTTCGGCCACCGGGTCTACAAGAACTACGACCCGCGCGCC AAGATCATGCAGCAGACCTGCCACGAAGTGCTGACCGAGCTCGGCATCAAGGACGATCCGCTGCTCGACGTGGCGGTGGA ACTCGAGCGCGTCGCCCTGCACGACGAGTACTTCATCGAGAAGAAGCTCTATCCGAACATCGACTTCTATTCGGGCATCA CCCTGAAGGCGATGGGCTTCCCCACCACCATGTTCACCGTGCTGTTCGCCCTCGCGCGGACCGTCGGCTGGATCGGCCAG TGGAAGGAAATGATCGAGGACCCGAGCCAGCGCATCGGCCGTCCCCGCCAGCTCTACACCGGCGCCGCCCGCCGCGATTA CGTGGCGATGTCCAAGCGCAAGTGA
Upstream 100 bases:
>100_bases CACGCTTGCGGCGGATTTAGGGAGGGTTTACGACTGCGCCCCGGATGCCTTCGCACCCGCGAAGCGCTCAGCGCTTCCGC CCGATTTCAAGGGAGATCTC
Downstream 100 bases:
>100_bases GCGGGACGCGGGGGCCTGCCCCCCGCTGCCCAGCCTTTCTAGGGCGCGGCTTCGGCCGCGCCCTTTTTTTTGTGCCGGCG GAGCCTCTATCGGTGAAGGA
Product: citrate synthase
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 434; Mature: 434
Protein sequence:
>434_residues MDATNNATAAKLTVGDKSWEFPIKKGTIGPDVVDISKLYGQSGMFTYDPGFTSTASCESQITYIDGDEGVLLYRGFPIEQ LAEGGDFLETCYLLLYGELPTAAQKADFDHSVTRHTMVHDQMNRFFNGFRRDAHPMAIMVACVGALSAFYHDSTDISDPQ QRLIASIRMIAKMPTLAAMAYKYSIGQPFVYPKNDLDYASNFLNMCFAVPCEDYKVSPTLARALDKIFILHADHEQNAST STVRLAGSSGANPFACIAAGIACLWGPAHGGANEAALKMLTEIGTPDRIPEFVNKAKDKNDPFRLMGFGHRVYKNYDPRA KIMQQTCHEVLTELGIKDDPLLDVAVELERVALHDEYFIEKKLYPNIDFYSGITLKAMGFPTTMFTVLFALARTVGWIGQ WKEMIEDPSQRIGRPRQLYTGAARRDYVAMSKRK
Sequences:
>Translated_434_residues MDATNNATAAKLTVGDKSWEFPIKKGTIGPDVVDISKLYGQSGMFTYDPGFTSTASCESQITYIDGDEGVLLYRGFPIEQ LAEGGDFLETCYLLLYGELPTAAQKADFDHSVTRHTMVHDQMNRFFNGFRRDAHPMAIMVACVGALSAFYHDSTDISDPQ QRLIASIRMIAKMPTLAAMAYKYSIGQPFVYPKNDLDYASNFLNMCFAVPCEDYKVSPTLARALDKIFILHADHEQNAST STVRLAGSSGANPFACIAAGIACLWGPAHGGANEAALKMLTEIGTPDRIPEFVNKAKDKNDPFRLMGFGHRVYKNYDPRA KIMQQTCHEVLTELGIKDDPLLDVAVELERVALHDEYFIEKKLYPNIDFYSGITLKAMGFPTTMFTVLFALARTVGWIGQ WKEMIEDPSQRIGRPRQLYTGAARRDYVAMSKRK >Mature_434_residues MDATNNATAAKLTVGDKSWEFPIKKGTIGPDVVDISKLYGQSGMFTYDPGFTSTASCESQITYIDGDEGVLLYRGFPIEQ LAEGGDFLETCYLLLYGELPTAAQKADFDHSVTRHTMVHDQMNRFFNGFRRDAHPMAIMVACVGALSAFYHDSTDISDPQ QRLIASIRMIAKMPTLAAMAYKYSIGQPFVYPKNDLDYASNFLNMCFAVPCEDYKVSPTLARALDKIFILHADHEQNAST STVRLAGSSGANPFACIAAGIACLWGPAHGGANEAALKMLTEIGTPDRIPEFVNKAKDKNDPFRLMGFGHRVYKNYDPRA KIMQQTCHEVLTELGIKDDPLLDVAVELERVALHDEYFIEKKLYPNIDFYSGITLKAMGFPTTMFTVLFALARTVGWIGQ WKEMIEDPSQRIGRPRQLYTGAARRDYVAMSKRK
Specific function: Tricarboxylic acid cycle. [C]
COG id: COG0372
COG function: function code C; Citrate synthase
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the citrate synthase family [H]
Homologues:
Organism=Homo sapiens, GI38327625, Length=393, Percent_Identity=26.972010178117, Blast_Score=112, Evalue=7e-25, Organism=Escherichia coli, GI1786939, Length=427, Percent_Identity=68.8524590163934, Blast_Score=629, Evalue=0.0, Organism=Escherichia coli, GI1786527, Length=365, Percent_Identity=30.4109589041096, Blast_Score=162, Evalue=6e-41, Organism=Caenorhabditis elegans, GI17555174, Length=422, Percent_Identity=26.5402843601896, Blast_Score=117, Evalue=1e-26, Organism=Saccharomyces cerevisiae, GI6319850, Length=352, Percent_Identity=26.9886363636364, Blast_Score=96, Evalue=1e-20, Organism=Saccharomyces cerevisiae, GI6325257, Length=415, Percent_Identity=25.5421686746988, Blast_Score=91, Evalue=2e-19, Organism=Saccharomyces cerevisiae, GI6324328, Length=330, Percent_Identity=26.0606060606061, Blast_Score=91, Evalue=3e-19, Organism=Drosophila melanogaster, GI24640126, Length=402, Percent_Identity=27.363184079602, Blast_Score=111, Evalue=1e-24, Organism=Drosophila melanogaster, GI24640124, Length=402, Percent_Identity=27.363184079602, Blast_Score=111, Evalue=1e-24, Organism=Drosophila melanogaster, GI21356863, Length=429, Percent_Identity=24.4755244755245, Blast_Score=99, Evalue=7e-21,
Paralogues:
None
Copy number: 624 Molecules/Cell In: Growth Phase, Glucose-minimal MOPS Media. 2,000 Molecules/Cell In: Glucose minimal media [C]
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR016142 - InterPro: IPR016143 - InterPro: IPR002020 - InterPro: IPR016141 - InterPro: IPR019810 - InterPro: IPR010953 [H]
Pfam domain/function: PF00285 Citrate_synt [H]
EC number: =2.3.3.1 [H]
Molecular weight: Translated: 48341; Mature: 48341
Theoretical pI: Translated: 6.44; Mature: 6.44
Prosite motif: PS00480 CITRATE_SYNTHASE
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.8 %Cys (Translated Protein) 3.9 %Met (Translated Protein) 5.8 %Cys+Met (Translated Protein) 1.8 %Cys (Mature Protein) 3.9 %Met (Mature Protein) 5.8 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MDATNNATAAKLTVGDKSWEFPIKKGTIGPDVVDISKLYGQSGMFTYDPGFTSTASCESQ CCCCCCCCEEEEEECCCCCCCCCCCCCCCCCHHHHHHHHCCCCCEEECCCCCCCCCCCCE ITYIDGDEGVLLYRGFPIEQLAEGGDFLETCYLLLYGELPTAAQKADFDHSVTRHTMVHD EEEEECCCCEEEEECCCHHHHHCCCCHHHHHHHHHHCCCCCHHHHCCCCHHHHHHHHHHH QMNRFFNGFRRDAHPMAIMVACVGALSAFYHDSTDISDPQQRLIASIRMIAKMPTLAAMA HHHHHHHHHCCCCCHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHHHHH YKYSIGQPFVYPKNDLDYASNFLNMCFAVPCEDYKVSPTLARALDKIFILHADHEQNAST HHHCCCCCCCCCCCCHHHHHHHHHHHEECCCCCCCCCHHHHHHHHHEEEEECCCCCCCCC STVRLAGSSGANPFACIAAGIACLWGPAHGGANEAALKMLTEIGTPDRIPEFVNKAKDKN CEEEEECCCCCCHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHCCCCHHHHHHHHHHCCCC DPFRLMGFGHRVYKNYDPRAKIMQQTCHEVLTELGIKDDPLLDVAVELERVALHDEYFIE CCEEEEECCHHHHCCCCHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHH KKLYPNIDFYSGITLKAMGFPTTMFTVLFALARTVGWIGQWKEMIEDPSQRIGRPRQLYT HHCCCCCCCCCCCEEEECCCCHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHCCCHHHHH GAARRDYVAMSKRK CCHHHHHHHHCCCC >Mature Secondary Structure MDATNNATAAKLTVGDKSWEFPIKKGTIGPDVVDISKLYGQSGMFTYDPGFTSTASCESQ CCCCCCCCEEEEEECCCCCCCCCCCCCCCCCHHHHHHHHCCCCCEEECCCCCCCCCCCCE ITYIDGDEGVLLYRGFPIEQLAEGGDFLETCYLLLYGELPTAAQKADFDHSVTRHTMVHD EEEEECCCCEEEEECCCHHHHHCCCCHHHHHHHHHHCCCCCHHHHCCCCHHHHHHHHHHH QMNRFFNGFRRDAHPMAIMVACVGALSAFYHDSTDISDPQQRLIASIRMIAKMPTLAAMA HHHHHHHHHCCCCCHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHHHHH YKYSIGQPFVYPKNDLDYASNFLNMCFAVPCEDYKVSPTLARALDKIFILHADHEQNAST HHHCCCCCCCCCCCCHHHHHHHHHHHEECCCCCCCCCHHHHHHHHHEEEEECCCCCCCCC STVRLAGSSGANPFACIAAGIACLWGPAHGGANEAALKMLTEIGTPDRIPEFVNKAKDKN CEEEEECCCCCCHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHCCCCHHHHHHHHHHCCCC DPFRLMGFGHRVYKNYDPRAKIMQQTCHEVLTELGIKDDPLLDVAVELERVALHDEYFIE CCEEEEECCHHHHCCCCHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHH KKLYPNIDFYSGITLKAMGFPTTMFTVLFALARTVGWIGQWKEMIEDPSQRIGRPRQLYT HHCCCCCCCCCCCEEEECCCCHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHCCCHHHHH GAARRDYVAMSKRK CCHHHHHHHHCCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 8526514 [H]