Definition Chlorobaculum parvum NCIB 8327 chromosome, complete genome.
Accession NC_011027
Length 2,289,249

Click here to switch to the map view.

The map label for this gene is carB [H]

Identifier: 193213165

GI number: 193213165

Start: 1663893

End: 1665749

Strand: Direct

Name: carB [H]

Synonym: Cpar_1520

Alternate gene names: 193213165

Gene position: 1663893-1665749 (Clockwise)

Preceding gene: 193213161

Following gene: 193213167

Centisome position: 72.68

GC content: 59.34

Gene sequence:

>1857_bases
ATGACCACACCACGCCCTGAACTCTCCGAACAGGCGCAGGCCCTCAGCCAGAAGTTGCCCGCCTCGGCTATGAAAAAAGC
CAAGGAGCACGGCTTTTCCGATTTCCAGATCGCAACCATATTCCAGACCGATGAAGCGGCCGTACGTGAGCTGCGAAGCC
ATTACGGCGTGGTCTCGGTCTTCAAGACCGTCGACACCTGCGCGGCGGAGTTCGACGCCAGCACACCGTACCACTACTCG
ACCTACGACGAGGAAAACGAGTCGGTGCGTTCCGACAACAAGAAAGTGATCATCCTCGGCGGCGGCCCGAACCGCATCGG
CCAGGGCATCGAGTTCGACTACTGCTGCGTGCAGGCGGTGTTCGCCCTGCGTGAAGCCGGGTACGAAACCATCATGGTCA
ACTGCAACCCCGAGACGGTCTCGACCGACTACGATATTGCCGACAAGCTCTACTTCGAACCGCTGACTTTTGAAGACACC
ATCCGCATCATCGAGCACGAGCAGCCGCTCGGCGTCATCGTCAGCTTCGGCGGCCAGACCCCGCTCAAGCTTTCGACCAA
GCTCGATGCTGCCGGCGTGAACATTCTCGGTACTTCGTCCGACGGCATCGACCTGGCCGAAGACCGCAAGCGGTTCGGTG
CGCTGCTCGAAAAGCTTGAGATTCCGCATCCTGAATACGGTACGGCAACCAGCTTCGCCGAAGCTCAGGAAATCACCAAA
CGCATCGGCTATCCGGTGCTGGTTCGCCCCAGCTACGTGCTCGGCGGTCGCGCCATGCGCATCATCTACAATGACGACTC
GCTCAAGGAGTACGTCGATCAGGCACTTTTCATCAGCGAGAAGTATCCGCTTCTGATCGACCACTTCCTCGAAACGGCCG
TGGAGTTCGACATCGACGCTCTGGCCGACGAGACCGACTGCGTCATCAGCGGCATCATGCAGCACGTCGAGGCCGCCGGT
ATCCACAGCGGCGACTCCACCTCGATTCTGCCCTACTACAACATGGATCCGGCGGCAATCGCCACCATGAAGGAGTACAC
CCGCAAGCTCGCCAAGAGCATCGGCGTGATTGGCCTGATGAACGTGCAGTACGCCGTGCAGAACGGCAGCGTTTACGTGA
TCGAGGTCAACCCGCGCGCCAGCCGCACGGTGCCGTTCGTCGGCAAGGCGACCGCGATTCCGGTGGTCAAGATCGCCACG
CGCGTCATGCTCGGTGAAAAGCTCTGCGACCTGCGCAAGGAGTTCAACCTGAAAGATTGTGATGAGTTGGGACTGAAGCA
CATGGCCATCAAAGAGCCGGTCTTCCCGTTCTCGAAATTCGTCAAGTCTGGCGTCTATCTCGGCCCGGAGATGCGCTCTA
CCGGTGAAGCCATGAGCCTTGCCGAAGTGTTCCCGGAAGCGTTCGCCAAAGCCTACCAGGCGGCAAGCATGCACCTGCCA
CCGTCCGGCACGGTCTTCATCAGCGTCAACGATCAGGACAAGTCGGAGAAGATCATCAACATCGCCAGGGAGCTGTACCG
GATGGACTTCGACCTGGTAGCCACAACCGGCACGTACAATTTCCTGACTGAACACGGCATCGAGTGCAAAAAAATCTTCA
AGGTGGGGGAAGAAGGACGCCCGAATATTTTCGACATCATCAAGCTCGGCAAGGTCGATTTCGTCATCAACACCCCGAGG
GGCGAGCAGGCGCTGCATGACGAAGAGGCCATCGGCGCGGCATCGGTGCAGAGCGGCGTGCCGTTCGTTACCACCATCGA
GGCTGCCGAAGCGTCGGCCATGGCGATCGCCTACATGCGCCGCCACGAGTTTGGCGTCAAGAGCCTGCAGGAGTACGCGA
CCTATCGCGATCAATAA

Upstream 100 bases:

>100_bases
CGAGAGGCTTTTTATTATACTCTGGCCGTTGTAATGTACAGCCCTGAATCGTTATCTTGATTTACAGACCTCTTTTCAAG
ATTTTCCAACACGTCCGCGC

Downstream 100 bases:

>100_bases
TTTCCGCCACGAAGCGCCGGGTATCGAAAGTGACGCCCGGCGACTCACTCTCCCTCGGCCCGGCCACGTTCAGCACCTCG
ATTCCGTTTTCCCCGATCCA

Product: carbamoyl-phosphate synthetase large chain domain-containing protein

Products: NA

Alternate protein names: Carbamoyl-phosphate synthetase ammonia chain [H]

Number of amino acids: Translated: 618; Mature: 617

Protein sequence:

>618_residues
MTTPRPELSEQAQALSQKLPASAMKKAKEHGFSDFQIATIFQTDEAAVRELRSHYGVVSVFKTVDTCAAEFDASTPYHYS
TYDEENESVRSDNKKVIILGGGPNRIGQGIEFDYCCVQAVFALREAGYETIMVNCNPETVSTDYDIADKLYFEPLTFEDT
IRIIEHEQPLGVIVSFGGQTPLKLSTKLDAAGVNILGTSSDGIDLAEDRKRFGALLEKLEIPHPEYGTATSFAEAQEITK
RIGYPVLVRPSYVLGGRAMRIIYNDDSLKEYVDQALFISEKYPLLIDHFLETAVEFDIDALADETDCVISGIMQHVEAAG
IHSGDSTSILPYYNMDPAAIATMKEYTRKLAKSIGVIGLMNVQYAVQNGSVYVIEVNPRASRTVPFVGKATAIPVVKIAT
RVMLGEKLCDLRKEFNLKDCDELGLKHMAIKEPVFPFSKFVKSGVYLGPEMRSTGEAMSLAEVFPEAFAKAYQAASMHLP
PSGTVFISVNDQDKSEKIINIARELYRMDFDLVATTGTYNFLTEHGIECKKIFKVGEEGRPNIFDIIKLGKVDFVINTPR
GEQALHDEEAIGAASVQSGVPFVTTIEAAEASAMAIAYMRRHEFGVKSLQEYATYRDQ

Sequences:

>Translated_618_residues
MTTPRPELSEQAQALSQKLPASAMKKAKEHGFSDFQIATIFQTDEAAVRELRSHYGVVSVFKTVDTCAAEFDASTPYHYS
TYDEENESVRSDNKKVIILGGGPNRIGQGIEFDYCCVQAVFALREAGYETIMVNCNPETVSTDYDIADKLYFEPLTFEDT
IRIIEHEQPLGVIVSFGGQTPLKLSTKLDAAGVNILGTSSDGIDLAEDRKRFGALLEKLEIPHPEYGTATSFAEAQEITK
RIGYPVLVRPSYVLGGRAMRIIYNDDSLKEYVDQALFISEKYPLLIDHFLETAVEFDIDALADETDCVISGIMQHVEAAG
IHSGDSTSILPYYNMDPAAIATMKEYTRKLAKSIGVIGLMNVQYAVQNGSVYVIEVNPRASRTVPFVGKATAIPVVKIAT
RVMLGEKLCDLRKEFNLKDCDELGLKHMAIKEPVFPFSKFVKSGVYLGPEMRSTGEAMSLAEVFPEAFAKAYQAASMHLP
PSGTVFISVNDQDKSEKIINIARELYRMDFDLVATTGTYNFLTEHGIECKKIFKVGEEGRPNIFDIIKLGKVDFVINTPR
GEQALHDEEAIGAASVQSGVPFVTTIEAAEASAMAIAYMRRHEFGVKSLQEYATYRDQ
>Mature_617_residues
TTPRPELSEQAQALSQKLPASAMKKAKEHGFSDFQIATIFQTDEAAVRELRSHYGVVSVFKTVDTCAAEFDASTPYHYST
YDEENESVRSDNKKVIILGGGPNRIGQGIEFDYCCVQAVFALREAGYETIMVNCNPETVSTDYDIADKLYFEPLTFEDTI
RIIEHEQPLGVIVSFGGQTPLKLSTKLDAAGVNILGTSSDGIDLAEDRKRFGALLEKLEIPHPEYGTATSFAEAQEITKR
IGYPVLVRPSYVLGGRAMRIIYNDDSLKEYVDQALFISEKYPLLIDHFLETAVEFDIDALADETDCVISGIMQHVEAAGI
HSGDSTSILPYYNMDPAAIATMKEYTRKLAKSIGVIGLMNVQYAVQNGSVYVIEVNPRASRTVPFVGKATAIPVVKIATR
VMLGEKLCDLRKEFNLKDCDELGLKHMAIKEPVFPFSKFVKSGVYLGPEMRSTGEAMSLAEVFPEAFAKAYQAASMHLPP
SGTVFISVNDQDKSEKIINIARELYRMDFDLVATTGTYNFLTEHGIECKKIFKVGEEGRPNIFDIIKLGKVDFVINTPRG
EQALHDEEAIGAASVQSGVPFVTTIEAAEASAMAIAYMRRHEFGVKSLQEYATYRDQ

Specific function: Arginine biosynthesis. Pyrimidine biosynthesis; first step. [C]

COG id: COG0458

COG function: function code EF; Carbamoylphosphate synthase large subunit (split gene in MJ)

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 2 ATP-grasp domains [H]

Homologues:

Organism=Homo sapiens, GI170295797, Length=605, Percent_Identity=36.8595041322314, Blast_Score=399, Evalue=1e-111,
Organism=Homo sapiens, GI21361331, Length=605, Percent_Identity=36.8595041322314, Blast_Score=399, Evalue=1e-111,
Organism=Homo sapiens, GI169790915, Length=605, Percent_Identity=36.8595041322314, Blast_Score=398, Evalue=1e-111,
Organism=Homo sapiens, GI18105007, Length=524, Percent_Identity=37.2137404580153, Blast_Score=358, Evalue=1e-98,
Organism=Escherichia coli, GI1786216, Length=579, Percent_Identity=49.740932642487, Blast_Score=561, Evalue=1e-161,
Organism=Caenorhabditis elegans, GI193204318, Length=594, Percent_Identity=34.3434343434343, Blast_Score=357, Evalue=1e-98,
Organism=Saccharomyces cerevisiae, GI6322331, Length=592, Percent_Identity=35.9797297297297, Blast_Score=396, Evalue=1e-111,
Organism=Saccharomyces cerevisiae, GI6322569, Length=528, Percent_Identity=36.9318181818182, Blast_Score=338, Evalue=2e-93,
Organism=Drosophila melanogaster, GI24642586, Length=548, Percent_Identity=35.948905109489, Blast_Score=350, Evalue=1e-96,
Organism=Drosophila melanogaster, GI45555749, Length=508, Percent_Identity=37.5984251968504, Blast_Score=347, Evalue=2e-95,

Paralogues:

None

Copy number: 4701 Molecules/Cell In: Growth Phase, Glucose-minimal MOPS Media. 3,000 Molecules/Cell In: Glucose minimal media [C]

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR011761
- InterPro:   IPR013815
- InterPro:   IPR013816
- InterPro:   IPR006275
- InterPro:   IPR005479
- InterPro:   IPR005483
- InterPro:   IPR005481
- InterPro:   IPR005480
- InterPro:   IPR011607
- InterPro:   IPR013817
- InterPro:   IPR016185 [H]

Pfam domain/function: PF00289 CPSase_L_chain; PF02786 CPSase_L_D2; PF02787 CPSase_L_D3; PF02142 MGS [H]

EC number: =6.3.5.5 [H]

Molecular weight: Translated: 68351; Mature: 68220

Theoretical pI: Translated: 4.78; Mature: 4.78

Prosite motif: PS50975 ATP_GRASP ; PS00962 RIBOSOMAL_S2_1 ; PS00866 CPSASE_1 ; PS00867 CPSASE_2

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.3 %Cys     (Translated Protein)
2.6 %Met     (Translated Protein)
3.9 %Cys+Met (Translated Protein)
1.3 %Cys     (Mature Protein)
2.4 %Met     (Mature Protein)
3.7 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTTPRPELSEQAQALSQKLPASAMKKAKEHGFSDFQIATIFQTDEAAVRELRSHYGVVSV
CCCCCCCHHHHHHHHHHHCCHHHHHHHHHCCCCCEEEEEEEECCHHHHHHHHHHCCHHHH
FKTVDTCAAEFDASTPYHYSTYDEENESVRSDNKKVIILGGGPNRIGQGIEFDYCCVQAV
HHHHHHHHHHCCCCCCCEECCCCCCCHHHHCCCCEEEEECCCCHHHCCCCCHHHHHHHHH
FALREAGYETIMVNCNPETVSTDYDIADKLYFEPLTFEDTIRIIEHEQPLGVIVSFGGQT
HHHHHCCCEEEEEECCCCCCCCCCCHHHHHEECCCCHHHHHHHHCCCCCCEEEEEECCCC
PLKLSTKLDAAGVNILGTSSDGIDLAEDRKRFGALLEKLEIPHPEYGTATSFAEAQEITK
CEEEECEECCCCCEEEECCCCCCCHHHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHH
RIGYPVLVRPSYVLGGRAMRIIYNDDSLKEYVDQALFISEKYPLLIDHFLETAVEFDIDA
HCCCCEEECCCEEECCEEEEEEECCHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHCCHHH
LADETDCVISGIMQHVEAAGIHSGDSTSILPYYNMDPAAIATMKEYTRKLAKSIGVIGLM
HCCCHHHHHHHHHHHHHHHCCCCCCCCEEEEEECCCHHHHHHHHHHHHHHHHHCCCEEEE
NVQYAVQNGSVYVIEVNPRASRTVPFVGKATAIPVVKIATRVMLGEKLCDLRKEFNLKDC
EEEEEEECCCEEEEEECCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCH
DELGLKHMAIKEPVFPFSKFVKSGVYLGPEMRSTGEAMSLAEVFPEAFAKAYQAASMHLP
HHHCCHHHHHHCCCCHHHHHHHCCCEECCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCC
PSGTVFISVNDQDKSEKIINIARELYRMDFDLVATTGTYNFLTEHGIECKKIFKVGEEGR
CCCEEEEEECCCCHHHHHHHHHHHHHHCCCEEEEECCCHHHHHHCCCCHHHHHHCCCCCC
PNIFDIIKLGKVDFVINTPRGEQALHDEEAIGAASVQSGVPFVTTIEAAEASAMAIAYMR
CCHHHHEEECCEEEEEECCCCCHHHCHHHHCCHHHHHCCCCEEEEECHHHHHHHHHHHHH
RHEFGVKSLQEYATYRDQ
HHHHHHHHHHHHHHHCCC
>Mature Secondary Structure 
TTPRPELSEQAQALSQKLPASAMKKAKEHGFSDFQIATIFQTDEAAVRELRSHYGVVSV
CCCCCCHHHHHHHHHHHCCHHHHHHHHHCCCCCEEEEEEEECCHHHHHHHHHHCCHHHH
FKTVDTCAAEFDASTPYHYSTYDEENESVRSDNKKVIILGGGPNRIGQGIEFDYCCVQAV
HHHHHHHHHHCCCCCCCEECCCCCCCHHHHCCCCEEEEECCCCHHHCCCCCHHHHHHHHH
FALREAGYETIMVNCNPETVSTDYDIADKLYFEPLTFEDTIRIIEHEQPLGVIVSFGGQT
HHHHHCCCEEEEEECCCCCCCCCCCHHHHHEECCCCHHHHHHHHCCCCCCEEEEEECCCC
PLKLSTKLDAAGVNILGTSSDGIDLAEDRKRFGALLEKLEIPHPEYGTATSFAEAQEITK
CEEEECEECCCCCEEEECCCCCCCHHHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHH
RIGYPVLVRPSYVLGGRAMRIIYNDDSLKEYVDQALFISEKYPLLIDHFLETAVEFDIDA
HCCCCEEECCCEEECCEEEEEEECCHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHCCHHH
LADETDCVISGIMQHVEAAGIHSGDSTSILPYYNMDPAAIATMKEYTRKLAKSIGVIGLM
HCCCHHHHHHHHHHHHHHHCCCCCCCCEEEEEECCCHHHHHHHHHHHHHHHHHCCCEEEE
NVQYAVQNGSVYVIEVNPRASRTVPFVGKATAIPVVKIATRVMLGEKLCDLRKEFNLKDC
EEEEEEECCCEEEEEECCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCH
DELGLKHMAIKEPVFPFSKFVKSGVYLGPEMRSTGEAMSLAEVFPEAFAKAYQAASMHLP
HHHCCHHHHHHCCCCHHHHHHHCCCEECCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCC
PSGTVFISVNDQDKSEKIINIARELYRMDFDLVATTGTYNFLTEHGIECKKIFKVGEEGR
CCCEEEEEECCCCHHHHHHHHHHHHHHCCCEEEEECCCHHHHHHCCCCHHHHHHCCCCCC
PNIFDIIKLGKVDFVINTPRGEQALHDEEAIGAASVQSGVPFVTTIEAAEASAMAIAYMR
CCHHHHEEECCEEEEEECCCCCHHHCHHHHCCHHHHHCCCCEEEEECHHHHHHHHHHHHH
RHEFGVKSLQEYATYRDQ
HHHHHHHHHHHHHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9389475 [H]