| Definition | Azoarcus sp. BH72 chromosome, complete genome. |
|---|---|
| Accession | NC_008702 |
| Length | 4,376,040 |
Click here to switch to the map view.
The map label for this gene is ppc
Identifier: 119897283
GI number: 119897283
Start: 1064654
End: 1067407
Strand: Reverse
Name: ppc
Synonym: azo0992
Alternate gene names: 119897283
Gene position: 1067407-1064654 (Counterclockwise)
Preceding gene: 119897298
Following gene: 119897280
Centisome position: 24.39
GC content: 69.35
Gene sequence:
>2754_bases ATGACTCCAGACAAGGACGCACCCCTGCGCGAAGACATCCGCCTGCTCGGCCGCCTGCTCGGCGATACCGTGCGCGACCA GCAGGGCGCCGCCAGCTTCGACCTGATCGAGCGCATCCGCCAGACCTCGGTGCGCTTTCGCCGCGACGAAGACCTCGCCG CCCGGCGCGAACTCGAGGACACCCTGGACGCGCTGTCGCGCGAGCAGACGATCCAGGTGGTGCGCGCGTTCAGCTACTTC TCGCACCTCGCCAACATCGCCGAGGACCAGCACCACATCCGCCGCTCGCGCGCGCACCTGCTGGCCGGCTCCGCCCCGCG TGAGGGCAGCCTGGCCCATGCCGTCGGGCATGCGCTCGACGAACAGCGGCTCGACCCCACCGACCTTGCCGCGTTCTTCG ACACCGCGCTGATCTCGCCGGTGCTGACCGCGCACCCCACCGAGGTGCAGCGCAAGAGCATCCTCAACTGCCAGACCGTG ATCGCCCGTCTGCTCGACGAGCGCGACCGCATGCAGCTCACGCCGGACGAAGCCGAAGCCAACCTGGATGCGCTGCGCCG GGCGGTGCTGACGCTGTGGCAGACGCGCATGCTGCGTCCGGCCAAGCTGTCGGTGATCGACGAGGTGAATAACGGCTTGT CCTACTTCGAGACGACCTTCCTGCGCGAGCTGCCGAGGCTGTACGCCGCACTGGAAGACCGCCTCGCCGGCGCCCAGCCG GCGCTGGCCAACCACGAGCTGCCCGCCTTCCTGCAGGTGGGCAGCTGGATCGGCGGCGACCGCGACGGCAACCCCTACGT CACCGCCGACGTGCTCGAAGAGGCGCTGGCGATGCAGGCGCGCGTCGCGCTCGACTACTACCTCGACGAGCTGCACACGC TCGGCTCGCAACTGTCGCTTTCACAGGGCCTGGTGGGCGCCTCCGACGCGCTGCTGGCGCTGGCCGACCGCTCGCCCGAC CAATCGCCCCACCGCAGCGATGAACCCTACCGGCGCGCGATCGCGGGCATCTATGCACGCCTCTCCGCCACCTACCGCAA CCTGCTCGGCCATCCGCCGGCACGCCACGCGGTGGCCGAAGCCGAGCCCTACGCTGATGTCGCCGCGCTCGCCGACGACC TCGATACGCTCCACCGCTCGCTGGTCGCCAACGGCACCGCGGCGCTCGCACGCGGGCGCCTGCGCCACCTGCGCCGCGCG GTACGGGTGTTCGGCTTTCACCTCGCGCCGATCGACCTGCGCCAGAACTCCGACGTGCATGAGCGCGTCGTCGCCGAGCT GCTGGAAGTCGCGCGCCCCGGCGCCGCCTATCTCGCCCAGGACGAGGCCGGCCGCTGCGCCCTGCTGCTGGACGAACTGG CGACGGCGCGGCCGCTCGCCTCGCCGCACGTGCGCTACAGCGACGACAGCGAGGGCGAGCTGGCGATCTTCCGCGCCGCG CGTCGCGCCCACCTGCGCTACGGGCGCGGTGCGATCCACAACTGCATCATCTCCAAGACCGACGACCTGTCCGACCTGCT CGAACTCGCGGTGCTGCTGAAGGAAGCGGGACTGCTGCGCCCGCTGGAGAAGGCGCTGGATGTGAACATCGTGCCGCTGT TCGAGACCATCGGCGACCTCGAGAACGCCGCCGGCGTCATGGACCGCCTGTTCTCCATCCCGGTCTATCGCGAACTGCTC GCCGCACGCGACCAGACCCAGGAGGTGATGCTCGGCTATTCCGACAGCAACAAGGACGGCGGCTTCCTTACCTCGGGCTG GGCGCTGTACAAGGCAGAGGGTGAACTGGTCGAGGTGTTCGGACGCCACGGCGTGCGCCTGCGCCTCTTCCACGGCCGCG GCGGCTCGGTGGGCCGCGGCGGCGGGCCGAGCTACCAGGCCATCCTCGCCCAGCCGGACGGCGCGGTGCAGGGCCAGATC CGGCTCACGGAACAGGGCGAGGTGATCGCGGCCAAGTACGGCAACCCGGAGGTGGGCCGCCGCAACCTCGAAGTACTGGT CGCCGCCACGCTGGAAACCAGCCTGCGCCGCGATGGCGGCGACGCCACGCCACGCACCTTCCTCGACACGATGCAGGCGC TGTCGGACGCCGCCTTCACCTGTTATCGCGGGCTGGTGTACGAAACGCCGGGCTTCGAGCAGTACTTCTGGGAGTCGACG GTGATCTCCGAGATCGCCGGCCTCAACATCGGTTCGCGCCCGGCTTCGCGAAAGAAAGGCACCCGTATCGACGACCTGCG CGCGATCCCGTGGGTGTTCTCGTGGTCGCAGTGCCGGCTGATGCTGCCGGGCTGGTTCGGCTTCGGCAGCGCGGTAAAGC AGTGGCTGGCGGCCCATCCCAAGGACGGCCTGGGGCTGCTGCAGCGGATGTACCGCGAGTGGTCGTTCTTCGCGACGCTG CTGTCCAACATGGACATGGTGCTGTCCAAGACCGACCTCGCGATCGCCTCACGCTACGCGGAACTGGTGAAGGACCCGGT GCTGCGGGACAGTATCTTCGAGCGCATCCGCAGCGAATGGAAGGACACCGTGGATGCGTTGCTGGCGATCACCGAGCAGG TGGAACTGCTGGACGCCAACCCGCTGCTCAAGCGCTCGATCCGCAACCGCTTTCCCTACCTGGACCCGCTCAACCACGTC CAGGTGGAGCTGCTGCGGCGCCACCGCGAAGGCAACGGCGAGGATGCCCGCATCCGCAACGGCATCCACATCTCCATCAA CGGCATCGCCGCCGGCCTGCGCAACAGCGGCTGA
Upstream 100 bases:
>100_bases GTCCGGACGACTGCGGGTGCTGTGGCCGCCCCCAGACAACGAGACCCTCCCCTCCCGATCGTCGAGACCTTTGCCGGTCT TTTTTATTGCCCGGAACGCC
Downstream 100 bases:
>100_bases GGCCCCCGCGCCGGTAGTGGCGAGACGCGCTACAGGCCGAGCGCCTGCTTGACCGCCGGCCACTGCCGGCGGCTCACCGG CAGGCGCTCGGGAACGCCGG
Product: phosphoenolpyruvate carboxylase
Products: NA
Alternate protein names: PEPC; PEPCase
Number of amino acids: Translated: 917; Mature: 916
Protein sequence:
>917_residues MTPDKDAPLREDIRLLGRLLGDTVRDQQGAASFDLIERIRQTSVRFRRDEDLAARRELEDTLDALSREQTIQVVRAFSYF SHLANIAEDQHHIRRSRAHLLAGSAPREGSLAHAVGHALDEQRLDPTDLAAFFDTALISPVLTAHPTEVQRKSILNCQTV IARLLDERDRMQLTPDEAEANLDALRRAVLTLWQTRMLRPAKLSVIDEVNNGLSYFETTFLRELPRLYAALEDRLAGAQP ALANHELPAFLQVGSWIGGDRDGNPYVTADVLEEALAMQARVALDYYLDELHTLGSQLSLSQGLVGASDALLALADRSPD QSPHRSDEPYRRAIAGIYARLSATYRNLLGHPPARHAVAEAEPYADVAALADDLDTLHRSLVANGTAALARGRLRHLRRA VRVFGFHLAPIDLRQNSDVHERVVAELLEVARPGAAYLAQDEAGRCALLLDELATARPLASPHVRYSDDSEGELAIFRAA RRAHLRYGRGAIHNCIISKTDDLSDLLELAVLLKEAGLLRPLEKALDVNIVPLFETIGDLENAAGVMDRLFSIPVYRELL AARDQTQEVMLGYSDSNKDGGFLTSGWALYKAEGELVEVFGRHGVRLRLFHGRGGSVGRGGGPSYQAILAQPDGAVQGQI RLTEQGEVIAAKYGNPEVGRRNLEVLVAATLETSLRRDGGDATPRTFLDTMQALSDAAFTCYRGLVYETPGFEQYFWEST VISEIAGLNIGSRPASRKKGTRIDDLRAIPWVFSWSQCRLMLPGWFGFGSAVKQWLAAHPKDGLGLLQRMYREWSFFATL LSNMDMVLSKTDLAIASRYAELVKDPVLRDSIFERIRSEWKDTVDALLAITEQVELLDANPLLKRSIRNRFPYLDPLNHV QVELLRRHREGNGEDARIRNGIHISINGIAAGLRNSG
Sequences:
>Translated_917_residues MTPDKDAPLREDIRLLGRLLGDTVRDQQGAASFDLIERIRQTSVRFRRDEDLAARRELEDTLDALSREQTIQVVRAFSYF SHLANIAEDQHHIRRSRAHLLAGSAPREGSLAHAVGHALDEQRLDPTDLAAFFDTALISPVLTAHPTEVQRKSILNCQTV IARLLDERDRMQLTPDEAEANLDALRRAVLTLWQTRMLRPAKLSVIDEVNNGLSYFETTFLRELPRLYAALEDRLAGAQP ALANHELPAFLQVGSWIGGDRDGNPYVTADVLEEALAMQARVALDYYLDELHTLGSQLSLSQGLVGASDALLALADRSPD QSPHRSDEPYRRAIAGIYARLSATYRNLLGHPPARHAVAEAEPYADVAALADDLDTLHRSLVANGTAALARGRLRHLRRA VRVFGFHLAPIDLRQNSDVHERVVAELLEVARPGAAYLAQDEAGRCALLLDELATARPLASPHVRYSDDSEGELAIFRAA RRAHLRYGRGAIHNCIISKTDDLSDLLELAVLLKEAGLLRPLEKALDVNIVPLFETIGDLENAAGVMDRLFSIPVYRELL AARDQTQEVMLGYSDSNKDGGFLTSGWALYKAEGELVEVFGRHGVRLRLFHGRGGSVGRGGGPSYQAILAQPDGAVQGQI RLTEQGEVIAAKYGNPEVGRRNLEVLVAATLETSLRRDGGDATPRTFLDTMQALSDAAFTCYRGLVYETPGFEQYFWEST VISEIAGLNIGSRPASRKKGTRIDDLRAIPWVFSWSQCRLMLPGWFGFGSAVKQWLAAHPKDGLGLLQRMYREWSFFATL LSNMDMVLSKTDLAIASRYAELVKDPVLRDSIFERIRSEWKDTVDALLAITEQVELLDANPLLKRSIRNRFPYLDPLNHV QVELLRRHREGNGEDARIRNGIHISINGIAAGLRNSG >Mature_916_residues TPDKDAPLREDIRLLGRLLGDTVRDQQGAASFDLIERIRQTSVRFRRDEDLAARRELEDTLDALSREQTIQVVRAFSYFS HLANIAEDQHHIRRSRAHLLAGSAPREGSLAHAVGHALDEQRLDPTDLAAFFDTALISPVLTAHPTEVQRKSILNCQTVI ARLLDERDRMQLTPDEAEANLDALRRAVLTLWQTRMLRPAKLSVIDEVNNGLSYFETTFLRELPRLYAALEDRLAGAQPA LANHELPAFLQVGSWIGGDRDGNPYVTADVLEEALAMQARVALDYYLDELHTLGSQLSLSQGLVGASDALLALADRSPDQ SPHRSDEPYRRAIAGIYARLSATYRNLLGHPPARHAVAEAEPYADVAALADDLDTLHRSLVANGTAALARGRLRHLRRAV RVFGFHLAPIDLRQNSDVHERVVAELLEVARPGAAYLAQDEAGRCALLLDELATARPLASPHVRYSDDSEGELAIFRAAR RAHLRYGRGAIHNCIISKTDDLSDLLELAVLLKEAGLLRPLEKALDVNIVPLFETIGDLENAAGVMDRLFSIPVYRELLA ARDQTQEVMLGYSDSNKDGGFLTSGWALYKAEGELVEVFGRHGVRLRLFHGRGGSVGRGGGPSYQAILAQPDGAVQGQIR LTEQGEVIAAKYGNPEVGRRNLEVLVAATLETSLRRDGGDATPRTFLDTMQALSDAAFTCYRGLVYETPGFEQYFWESTV ISEIAGLNIGSRPASRKKGTRIDDLRAIPWVFSWSQCRLMLPGWFGFGSAVKQWLAAHPKDGLGLLQRMYREWSFFATLL SNMDMVLSKTDLAIASRYAELVKDPVLRDSIFERIRSEWKDTVDALLAITEQVELLDANPLLKRSIRNRFPYLDPLNHVQ VELLRRHREGNGEDARIRNGIHISINGIAAGLRNSG
Specific function: Forms oxaloacetate, a four-carbon dicarboxylic acid source for the tricarboxylic acid cycle
COG id: COG2352
COG function: function code C; Phosphoenolpyruvate carboxylase
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the PEPCase type 1 family
Homologues:
Organism=Escherichia coli, GI1790393, Length=918, Percent_Identity=34.5315904139434, Blast_Score=435, Evalue=1e-123,
Paralogues:
None
Copy number: 3,500 Molecules/Cell In: Glucose minimal media [C]
Swissprot (AC and ID): CAPP_AZOSB (A1K454)
Other databases:
- EMBL: AM406670 - RefSeq: YP_932496.1 - STRING: A1K454 - GeneID: 4608298 - GenomeReviews: AM406670_GR - KEGG: azo:azo0992 - eggNOG: COG2352 - HOGENOM: HBG351035 - OMA: AIPWVFG - PhylomeDB: A1K454 - ProtClustDB: PRK00009 - BioCyc: ASP62928:AZO0992-MONOMER - HAMAP: MF_00595 - InterPro: IPR021135 - InterPro: IPR018129 - InterPro: IPR022805 - InterPro: IPR015813 - PRINTS: PR00150
Pfam domain/function: PF00311 PEPcase; SSF51621 Pyrv/PenolPyrv_Kinase_cat
EC number: =4.1.1.31
Molecular weight: Translated: 101777; Mature: 101646
Theoretical pI: Translated: 6.29; Mature: 6.29
Prosite motif: PS00781 PEPCASE_1; PS00393 PEPCASE_2
Important sites: ACT_SITE 145-145 ACT_SITE 578-578
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.5 %Cys (Translated Protein) 1.2 %Met (Translated Protein) 1.7 %Cys+Met (Translated Protein) 0.5 %Cys (Mature Protein) 1.1 %Met (Mature Protein) 1.6 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MTPDKDAPLREDIRLLGRLLGDTVRDQQGAASFDLIERIRQTSVRFRRDEDLAARRELED CCCCCCCCHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHCCCHHHHHHHHHHH TLDALSREQTIQVVRAFSYFSHLANIAEDQHHIRRSRAHLLAGSAPREGSLAHAVGHALD HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHH EQRLDPTDLAAFFDTALISPVLTAHPTEVQRKSILNCQTVIARLLDERDRMQLTPDEAEA HCCCCHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHCCHHCCCCCCCHHHC NLDALRRAVLTLWQTRMLRPAKLSVIDEVNNGLSYFETTFLRELPRLYAALEDRLAGAQP CHHHHHHHHHHHHHHHCCCCHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHCCCCC ALANHELPAFLQVGSWIGGDRDGNPYVTADVLEEALAMQARVALDYYLDELHTLGSQLSL CCCCCCCHHHHHHHHHCCCCCCCCCEEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH SQGLVGASDALLALADRSPDQSPHRSDEPYRRAIAGIYARLSATYRNLLGHPPARHAVAE HCCCCCCCHHHHEEECCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHC AEPYADVAALADDLDTLHRSLVANGTAALARGRLRHLRRAVRVFGFHLAPIDLRQNSDVH CCCHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHCCCEECCCCCCHH ERVVAELLEVARPGAAYLAQDEAGRCALLLDELATARPLASPHVRYSDDSEGELAIFRAA HHHHHHHHHHCCCCCCEEECCCCCCHHHHHHHHHHHCCCCCCCCCCCCCCCCCHHHHHHH RRAHLRYGRGAIHNCIISKTDDLSDLLELAVLLKEAGLLRPLEKALDVNIVPLFETIGDL HHHHHHCCCHHHHHHHCCCCCCHHHHHHHHHHHHHHCCHHHHHHHHCCCEEHHHHHHHHH ENAAGVMDRLFSIPVYRELLAARDQTQEVMLGYSDSNKDGGFLTSGWALYKAEGELVEVF HHHHHHHHHHHHCHHHHHHHHHCCCCHHHEEECCCCCCCCCEEECCEEEEECCCHHHHHH GRHGVRLRLFHGRGGSVGRGGGPSYQAILAQPDGAVQGQIRLTEQGEVIAAKYGNPEVGR CCCCCEEEEEECCCCCCCCCCCCCCEEEEECCCCCCCCEEEEECCCCEEEEECCCCCCCC RNLEVLVAATLETSLRRDGGDATPRTFLDTMQALSDAAFTCYRGLVYETPGFEQYFWEST CCHHEEEEHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHCCEECCCCCHHHHHHHH VISEIAGLNIGSRPASRKKGTRIDDLRAIPWVFSWSQCRLMLPGWFGFGSAVKQWLAAHP HHHHHHCCCCCCCCCCCCCCCCHHHHHCCCCCEECCCCEEECCCCCCHHHHHHHHHHCCC KDGLGLLQRMYREWSFFATLLSNMDMVLSKTDLAIASRYAELVKDPVLRDSIFERIRSEW CCHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHCHHHHHHHHHHHHHHH KDTVDALLAITEQVELLDANPLLKRSIRNRFPYLDPLNHVQVELLRRHREGNGEDARIRN HHHHHHHHHHHHHHHHHCCCHHHHHHHHHCCCCCCCHHHHHHHHHHHHCCCCCCCCEECC GIHISINGIAAGLRNSG CEEEEEHHHHCCCCCCC >Mature Secondary Structure TPDKDAPLREDIRLLGRLLGDTVRDQQGAASFDLIERIRQTSVRFRRDEDLAARRELED CCCCCCCHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHCCCHHHHHHHHHHH TLDALSREQTIQVVRAFSYFSHLANIAEDQHHIRRSRAHLLAGSAPREGSLAHAVGHALD HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHH EQRLDPTDLAAFFDTALISPVLTAHPTEVQRKSILNCQTVIARLLDERDRMQLTPDEAEA HCCCCHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHCCHHCCCCCCCHHHC NLDALRRAVLTLWQTRMLRPAKLSVIDEVNNGLSYFETTFLRELPRLYAALEDRLAGAQP CHHHHHHHHHHHHHHHCCCCHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHCCCCC ALANHELPAFLQVGSWIGGDRDGNPYVTADVLEEALAMQARVALDYYLDELHTLGSQLSL CCCCCCCHHHHHHHHHCCCCCCCCCEEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH SQGLVGASDALLALADRSPDQSPHRSDEPYRRAIAGIYARLSATYRNLLGHPPARHAVAE HCCCCCCCHHHHEEECCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHC AEPYADVAALADDLDTLHRSLVANGTAALARGRLRHLRRAVRVFGFHLAPIDLRQNSDVH CCCHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHCCCEECCCCCCHH ERVVAELLEVARPGAAYLAQDEAGRCALLLDELATARPLASPHVRYSDDSEGELAIFRAA HHHHHHHHHHCCCCCCEEECCCCCCHHHHHHHHHHHCCCCCCCCCCCCCCCCCHHHHHHH RRAHLRYGRGAIHNCIISKTDDLSDLLELAVLLKEAGLLRPLEKALDVNIVPLFETIGDL HHHHHHCCCHHHHHHHCCCCCCHHHHHHHHHHHHHHCCHHHHHHHHCCCEEHHHHHHHHH ENAAGVMDRLFSIPVYRELLAARDQTQEVMLGYSDSNKDGGFLTSGWALYKAEGELVEVF HHHHHHHHHHHHCHHHHHHHHHCCCCHHHEEECCCCCCCCCEEECCEEEEECCCHHHHHH GRHGVRLRLFHGRGGSVGRGGGPSYQAILAQPDGAVQGQIRLTEQGEVIAAKYGNPEVGR CCCCCEEEEEECCCCCCCCCCCCCCEEEEECCCCCCCCEEEEECCCCEEEEECCCCCCCC RNLEVLVAATLETSLRRDGGDATPRTFLDTMQALSDAAFTCYRGLVYETPGFEQYFWEST CCHHEEEEHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHCCEECCCCCHHHHHHHH VISEIAGLNIGSRPASRKKGTRIDDLRAIPWVFSWSQCRLMLPGWFGFGSAVKQWLAAHP HHHHHHCCCCCCCCCCCCCCCCHHHHHCCCCCEECCCCEEECCCCCCHHHHHHHHHHCCC KDGLGLLQRMYREWSFFATLLSNMDMVLSKTDLAIASRYAELVKDPVLRDSIFERIRSEW CCHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHCHHHHHHHHHHHHHHH KDTVDALLAITEQVELLDANPLLKRSIRNRFPYLDPLNHVQVELLRRHREGNGEDARIRN HHHHHHHHHHHHHHHHHCCCHHHHHHHHHCCCCCCCHHHHHHHHHHHHCCCCCCCCEECC GIHISINGIAAGLRNSG CEEEEEHHHHCCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA