The gene/protein map for NC_003901 is currently unavailable.
Definition Methanosarcina mazei Go1 chromosome, complete genome.
Accession NC_003901
Length 4,096,345

Click here to switch to the map view.

The map label for this gene is carA [H]

Identifier: 21226141

GI number: 21226141

Start: 49390

End: 50529

Strand: Reverse

Name: carA [H]

Synonym: MM_0039

Alternate gene names: 21226141

Gene position: 50529-49390 (Counterclockwise)

Preceding gene: 21226145

Following gene: 21226140

Centisome position: 1.23

GC content: 49.74

Gene sequence:

>1140_bases
ATGTCTTATGACATTTACTCGCAGGTTCAGATGATGAAAGCAGTACTAGGATTAGAAGATGGAACAGTTATTAAGGGCAC
CGGTTTTGGTGCCGAAGGCACAGCTTGCGGCGAACTCGTTTTTACCACTCAATTCACAGGATATGAGGAGGCTCTGACTG
ACCCTTCCTACAAGGGCCAGATTTTAATGTTTACTTACCCTTTGATAGGGAATTATGGGGTCAGCGGAGAGAGGTTCCAG
TCCGACAACATCCATGCTGAGGGGCTTGTTGTCAGGGAAGCCTGCAAAAAACCCTATCACTACAAATCCACCCGTTCTAT
CCACAAATTTTTAGAGGATGAAGGAAAACCAGGGATTGAAGGCGTGGACACCCGTATGCTCACAATAGGGGCAAGGGAGC
ATGGGACCATGCGTGCAGCCCTTATCACAGGGAGTGACGATGGGGAAGAAGCCGTTGATATGGCGAGGAACTTTCCGCAG
GTAACGGACGAAGAACTTATTGCACGCGTAACCTGCAAAGAACCCCGCTTTATTCCCGGAGCAGCCGGAGCATGGAAAGG
AAGCGGCAAACCCAAACATGCAGTTGTGGTCGACCTCGGCATAAAGAGGAACATCATAAACAACCTGCATAAAAGGGGAA
TTGACCTGACCCTGGTTCCTGCAACCACAAAACCAGAAGAAATCGCAGGCTACGAGCCTGACATGCTATTTATCTCAAAC
GGTCCAGGAGACCCGGAAAAAGCAACGGATGCTATCAATGCCGTAAAGGCTTTTGCAGGCACGATTCCGGTAGCAGGGAT
CTGCTTCGGGCACCAGATTATCTCCCTTGCAATGGGAGCAAGGACATACAAGCTTAAATTCGGGCACAGGGGAGGAAACC
AGCCCGTAAAGGACCTTATCGAGAACAAAATTTTCATAAGCTCCCAGAACCATGGATATGCTGTCGATGCGGATTCCCTT
GAAGGGACAGGGCTTTATGTAAAGTACCTGAACGCAAACGACAAAACCGTTGAAGGGGTTTCCCACAAAGACCTCGACAT
TTTCAGTGTGCAGTTCCACCCTGAAGCACAGGCAGGTCCACTGGATACCGAGGAAACGTTCTTCGGCAAGGTAGTGAAGG
TCCTCGGAGGGGGTCTCTGA

Upstream 100 bases:

>100_bases
ATAAAAAAAGACGATTATCAAAAAAGATGGTTATAAAAAAAGACGATTATAAAATTGTATGTTTATAAAGTGACTTCTCC
AATCATCGCAACACTTATAC

Downstream 100 bases:

>100_bases
TGCCTAAACGTGAAGACATAAAGAAAGTTCTGCTTATAGGTTCAGGGCCGATTACAATCGGGCAGGCTGCAGAGTTCGAC
TTCTCAGGAAGCCAGGCTTG

Product: carbamoyl phosphate synthase small subunit

Products: NA

Alternate protein names: Carbamoyl-phosphate synthetase glutamine chain [H]

Number of amino acids: Translated: 379; Mature: 378

Protein sequence:

>379_residues
MSYDIYSQVQMMKAVLGLEDGTVIKGTGFGAEGTACGELVFTTQFTGYEEALTDPSYKGQILMFTYPLIGNYGVSGERFQ
SDNIHAEGLVVREACKKPYHYKSTRSIHKFLEDEGKPGIEGVDTRMLTIGAREHGTMRAALITGSDDGEEAVDMARNFPQ
VTDEELIARVTCKEPRFIPGAAGAWKGSGKPKHAVVVDLGIKRNIINNLHKRGIDLTLVPATTKPEEIAGYEPDMLFISN
GPGDPEKATDAINAVKAFAGTIPVAGICFGHQIISLAMGARTYKLKFGHRGGNQPVKDLIENKIFISSQNHGYAVDADSL
EGTGLYVKYLNANDKTVEGVSHKDLDIFSVQFHPEAQAGPLDTEETFFGKVVKVLGGGL

Sequences:

>Translated_379_residues
MSYDIYSQVQMMKAVLGLEDGTVIKGTGFGAEGTACGELVFTTQFTGYEEALTDPSYKGQILMFTYPLIGNYGVSGERFQ
SDNIHAEGLVVREACKKPYHYKSTRSIHKFLEDEGKPGIEGVDTRMLTIGAREHGTMRAALITGSDDGEEAVDMARNFPQ
VTDEELIARVTCKEPRFIPGAAGAWKGSGKPKHAVVVDLGIKRNIINNLHKRGIDLTLVPATTKPEEIAGYEPDMLFISN
GPGDPEKATDAINAVKAFAGTIPVAGICFGHQIISLAMGARTYKLKFGHRGGNQPVKDLIENKIFISSQNHGYAVDADSL
EGTGLYVKYLNANDKTVEGVSHKDLDIFSVQFHPEAQAGPLDTEETFFGKVVKVLGGGL
>Mature_378_residues
SYDIYSQVQMMKAVLGLEDGTVIKGTGFGAEGTACGELVFTTQFTGYEEALTDPSYKGQILMFTYPLIGNYGVSGERFQS
DNIHAEGLVVREACKKPYHYKSTRSIHKFLEDEGKPGIEGVDTRMLTIGAREHGTMRAALITGSDDGEEAVDMARNFPQV
TDEELIARVTCKEPRFIPGAAGAWKGSGKPKHAVVVDLGIKRNIINNLHKRGIDLTLVPATTKPEEIAGYEPDMLFISNG
PGDPEKATDAINAVKAFAGTIPVAGICFGHQIISLAMGARTYKLKFGHRGGNQPVKDLIENKIFISSQNHGYAVDADSLE
GTGLYVKYLNANDKTVEGVSHKDLDIFSVQFHPEAQAGPLDTEETFFGKVVKVLGGGL

Specific function: Arginine biosynthesis. Pyrimidine biosynthesis; first step. [C]

COG id: COG0505

COG function: function code EF; Carbamoylphosphate synthase small subunit

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 glutamine amidotransferase type-1 domain [H]

Homologues:

Organism=Homo sapiens, GI18105007, Length=374, Percent_Identity=42.2459893048128, Blast_Score=279, Evalue=2e-75,
Organism=Homo sapiens, GI169790915, Length=381, Percent_Identity=38.0577427821522, Blast_Score=230, Evalue=1e-60,
Organism=Homo sapiens, GI21361331, Length=381, Percent_Identity=38.0577427821522, Blast_Score=230, Evalue=1e-60,
Organism=Escherichia coli, GI1786215, Length=370, Percent_Identity=42.7027027027027, Blast_Score=278, Evalue=6e-76,
Organism=Escherichia coli, GI1789760, Length=155, Percent_Identity=26.4516129032258, Blast_Score=67, Evalue=2e-12,
Organism=Caenorhabditis elegans, GI193204318, Length=370, Percent_Identity=42.4324324324324, Blast_Score=261, Evalue=3e-70,
Organism=Saccharomyces cerevisiae, GI6322331, Length=389, Percent_Identity=41.6452442159383, Blast_Score=266, Evalue=3e-72,
Organism=Saccharomyces cerevisiae, GI6324878, Length=379, Percent_Identity=40.6332453825858, Blast_Score=264, Evalue=1e-71,
Organism=Drosophila melanogaster, GI45555749, Length=372, Percent_Identity=38.1720430107527, Blast_Score=231, Evalue=4e-61,
Organism=Drosophila melanogaster, GI24642586, Length=372, Percent_Identity=38.1720430107527, Blast_Score=231, Evalue=6e-61,

Paralogues:

None

Copy number: 620 Molecules/Cell In: Growth Phase, Minimal Media (Based on E. coli). 2599 Molecules/Cell In: Growth Phase, Glucose-minimal MOPS Media. 3,500 Molecules/Cell In: Glucose minimal media [C]

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR006220
- InterPro:   IPR001317
- InterPro:   IPR006274
- InterPro:   IPR002474
- InterPro:   IPR011702
- InterPro:   IPR017926
- InterPro:   IPR000991 [H]

Pfam domain/function: PF00988 CPSase_sm_chain; PF00117 GATase [H]

EC number: =6.3.5.5 [H]

Molecular weight: Translated: 41008; Mature: 40877

Theoretical pI: Translated: 5.79; Mature: 5.79

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.1 %Cys     (Translated Protein)
2.4 %Met     (Translated Protein)
3.4 %Cys+Met (Translated Protein)
1.1 %Cys     (Mature Protein)
2.1 %Met     (Mature Protein)
3.2 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSYDIYSQVQMMKAVLGLEDGTVIKGTGFGAEGTACGELVFTTQFTGYEEALTDPSYKGQ
CCCCHHHHHHHHHHHHCCCCCCEEEECCCCCCCCCCCEEEEEEECCCHHHHHCCCCCCCE
ILMFTYPLIGNYGVSGERFQSDNIHAEGLVVREACKKPYHYKSTRSIHKFLEDEGKPGIE
EEEEEECCCCCCCCCCCCCCCCCCCCCCEEHHHHHCCCCCCCHHHHHHHHHHHCCCCCCC
GVDTRMLTIGAREHGTMRAALITGSDDGEEAVDMARNFPQVTDEELIARVTCKEPRFIPG
CCCEEEEEEECCCCCCEEEEEEECCCCCHHHHHHHHCCCCCCCHHHHEEEECCCCCCCCC
AAGAWKGSGKPKHAVVVDLGIKRNIINNLHKRGIDLTLVPATTKPEEIAGYEPDMLFISN
CCCCCCCCCCCCEEEEEECCCHHHHHHHHHHCCCCEEEEECCCCCHHHCCCCCCEEEEEC
GPGDPEKATDAINAVKAFAGTIPVAGICFGHQIISLAMGARTYKLKFGHRGGNQPVKDLI
CCCCHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHCCEEEEEEECCCCCCCHHHHHH
ENKIFISSQNHGYAVDADSLEGTGLYVKYLNANDKTVEGVSHKDLDIFSVQFHPEAQAGP
CCEEEEEECCCCEEEECCCCCCCEEEEEEECCCCCEECCCCCCCCEEEEEEECCCCCCCC
LDTEETFFGKVVKVLGGGL
CCCHHHHHHHHHHHHCCCC
>Mature Secondary Structure 
SYDIYSQVQMMKAVLGLEDGTVIKGTGFGAEGTACGELVFTTQFTGYEEALTDPSYKGQ
CCCHHHHHHHHHHHHCCCCCCEEEECCCCCCCCCCCEEEEEEECCCHHHHHCCCCCCCE
ILMFTYPLIGNYGVSGERFQSDNIHAEGLVVREACKKPYHYKSTRSIHKFLEDEGKPGIE
EEEEEECCCCCCCCCCCCCCCCCCCCCCEEHHHHHCCCCCCCHHHHHHHHHHHCCCCCCC
GVDTRMLTIGAREHGTMRAALITGSDDGEEAVDMARNFPQVTDEELIARVTCKEPRFIPG
CCCEEEEEEECCCCCCEEEEEEECCCCCHHHHHHHHCCCCCCCHHHHEEEECCCCCCCCC
AAGAWKGSGKPKHAVVVDLGIKRNIINNLHKRGIDLTLVPATTKPEEIAGYEPDMLFISN
CCCCCCCCCCCCEEEEEECCCHHHHHHHHHHCCCCEEEEECCCCCHHHCCCCCCEEEEEC
GPGDPEKATDAINAVKAFAGTIPVAGICFGHQIISLAMGARTYKLKFGHRGGNQPVKDLI
CCCCHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHCCEEEEEEECCCCCCCHHHHHH
ENKIFISSQNHGYAVDADSLEGTGLYVKYLNANDKTVEGVSHKDLDIFSVQFHPEAQAGP
CCEEEEEECCCCEEEECCCCCCCEEEEEEECCCCCEECCCCCCCCEEEEEEECCCCCCCC
LDTEETFFGKVVKVLGGGL
CCCHHHHHHHHHHHHCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 11932238 [H]