| Definition | Novosphingobium aromaticivorans DSM 12444 chromosome, complete genome. |
|---|---|
| Accession | NC_007794 |
| Length | 3,561,584 |
Click here to switch to the map view.
The map label for this gene is 87200606
Identifier: 87200606
GI number: 87200606
Start: 2800825
End: 2802342
Strand: Direct
Name: 87200606
Synonym: Saro_2593
Alternate gene names: NA
Gene position: 2800825-2802342 (Clockwise)
Preceding gene: 87200605
Following gene: 87200608
Centisome position: 78.64
GC content: 68.71
Gene sequence:
>1518_bases TTGACCTGGGAACCCGAAATCGAGGAACTGCGCCGCCGCGAGGCCATGGCGGAGCAGATGGGCGGTGCCGAAAAGGTCGC GCGCCAGCACGCGCGCGGCAAGCTTGACGCCCGTGCCCGCATTGCCGGGGTCGTCGATGCCGGCAGCTTCCGCGAGATCG GCAAGATCGCCGGCAAGGGCCGTTACGGCCCCGACGGCGAACTGCTCGACCTTGCCCCCTCCAACCTCATCTTCGGCCGC GCCAACGTCGAAGGCCGGCCGGTCGTCGCCTCGGCCGACGACTTCACCGTGCGCGGCGGCGCGGCCGATGCCGCCATTGC CCGCAAGTTCATCCAGTGCGAACAGATGGCGCACACCCTGAAGATCCCGCTCATCCGGATGATCGACGGGACCGGCGGCG GCGGCTCGGTGCGGACGCTCGAGGATATCGGGGCCACCTATGTTCCCGCAACGCCAGGCTGGGGCGATGTCGTCAGGAAC CTCGACACCGTCCCAGTTGTCGCCCTGTCGCTCGGCCCCACCGCCGGGCTCGGCGCGGCGCGCGTCGTCGCCAGCCACTA TTCGATCATGGTCAAGGGCCTCTCGCAGCTCTTCGCCGCAGGCCCCGCCGTCGTCGCCGCCATTGGCGAGGACCGCGACA AGGAAGGGCTCGGCGGCAGCGCCATCCACACCCGCAACGGCGTGGTCGACGAGGAAGTCGCCAACGAGGCCGAAGCCTTC GCCCGCGCCCGGCGCTTCCTCTCCTATCTGCCAAGCCACGTGGGCGGCGCGGCGCCACGCACTGTCGCAGCAGACCCGAC GGACCGCCGCGAGGACTTCCTGATCGACCTCGTCCCGCGCGAAGCCAAGCAGGTCTATTCGATGCGCCGCCTGCTCGACG CGGTGGTCGACAAGGGCAGCCTGTTCGAGATGGGCCGGCTCTGGGGCCGCGCCGTCATCACCGCATTTGCGCGGCTGGAC GGCTGGCCCGTTGCCGTCCTCGCCAGCGACCCCAGCTACCTCGGTGGCTCATGGGATGCGCGCAGCAGCGAAAAGGCGGA GCGCTTCGTCAAGCTGGCCGACCAGTTCCGCCTGCCGCTGGTCCACATGGTCGACAACCCGGGCTTCATGATCGGCCACA CCGCCGAAAGCACAGGCACGATCCGCTATGGCGTGCAGGCGATGAACGCAATCTACAAGGCCACCGTGCCGCTTTGCTCG GTGATCGTTCGCCGCGCCTATGGCATTGCCGGCAGCGCGATGAGCAATGCAGAGGCATTCCAGTACCGCTTTGCCTGGCC ATCCGGCGACTGGGGAAGCCTGCCCATCGAAGGCGGCATCGAGGTCGCCTACAAGTCCGAGATCGAGGCTGCCGAAGACC CCGCCGCCCATCTCGGGGCTATCCGCGACCGGCTCAACCGCGTCCGCTCCCCCTTCCGCACGGCAGAGCGTTTCGGCGTG GAAGACATCGTCGATCCCCGCGACACCCGCCCACTGCTGTGCGAATTCGCCAATCTCGCCTGGCGCACGCTACCCTGA
Upstream 100 bases:
>100_bases GGCGGCGGAGTAGCGCCTGCCGGCAAGTGTCAAGCAATCCGCATTGCGCTCCCCACCCAAATCGAGTGAACTGCCTACCG ATAAACGGAGAGGCACAAGC
Downstream 100 bases:
>100_bases GGCACCGACGTCACCCCGCCGACAGCAGTTCAGCCGCCGCCGGCGCTTCCTCCAGAAGCTCGATCAGCCCGCGTTCATGG CGTGAAAGCCAGCGCGTCGC
Product: propionyl-CoA carboxylase
Products: NA
Alternate protein names: Transcarboxylase 12S subunit [H]
Number of amino acids: Translated: 505; Mature: 504
Protein sequence:
>505_residues MTWEPEIEELRRREAMAEQMGGAEKVARQHARGKLDARARIAGVVDAGSFREIGKIAGKGRYGPDGELLDLAPSNLIFGR ANVEGRPVVASADDFTVRGGAADAAIARKFIQCEQMAHTLKIPLIRMIDGTGGGGSVRTLEDIGATYVPATPGWGDVVRN LDTVPVVALSLGPTAGLGAARVVASHYSIMVKGLSQLFAAGPAVVAAIGEDRDKEGLGGSAIHTRNGVVDEEVANEAEAF ARARRFLSYLPSHVGGAAPRTVAADPTDRREDFLIDLVPREAKQVYSMRRLLDAVVDKGSLFEMGRLWGRAVITAFARLD GWPVAVLASDPSYLGGSWDARSSEKAERFVKLADQFRLPLVHMVDNPGFMIGHTAESTGTIRYGVQAMNAIYKATVPLCS VIVRRAYGIAGSAMSNAEAFQYRFAWPSGDWGSLPIEGGIEVAYKSEIEAAEDPAAHLGAIRDRLNRVRSPFRTAERFGV EDIVDPRDTRPLLCEFANLAWRTLP
Sequences:
>Translated_505_residues MTWEPEIEELRRREAMAEQMGGAEKVARQHARGKLDARARIAGVVDAGSFREIGKIAGKGRYGPDGELLDLAPSNLIFGR ANVEGRPVVASADDFTVRGGAADAAIARKFIQCEQMAHTLKIPLIRMIDGTGGGGSVRTLEDIGATYVPATPGWGDVVRN LDTVPVVALSLGPTAGLGAARVVASHYSIMVKGLSQLFAAGPAVVAAIGEDRDKEGLGGSAIHTRNGVVDEEVANEAEAF ARARRFLSYLPSHVGGAAPRTVAADPTDRREDFLIDLVPREAKQVYSMRRLLDAVVDKGSLFEMGRLWGRAVITAFARLD GWPVAVLASDPSYLGGSWDARSSEKAERFVKLADQFRLPLVHMVDNPGFMIGHTAESTGTIRYGVQAMNAIYKATVPLCS VIVRRAYGIAGSAMSNAEAFQYRFAWPSGDWGSLPIEGGIEVAYKSEIEAAEDPAAHLGAIRDRLNRVRSPFRTAERFGV EDIVDPRDTRPLLCEFANLAWRTLP >Mature_504_residues TWEPEIEELRRREAMAEQMGGAEKVARQHARGKLDARARIAGVVDAGSFREIGKIAGKGRYGPDGELLDLAPSNLIFGRA NVEGRPVVASADDFTVRGGAADAAIARKFIQCEQMAHTLKIPLIRMIDGTGGGGSVRTLEDIGATYVPATPGWGDVVRNL DTVPVVALSLGPTAGLGAARVVASHYSIMVKGLSQLFAAGPAVVAAIGEDRDKEGLGGSAIHTRNGVVDEEVANEAEAFA RARRFLSYLPSHVGGAAPRTVAADPTDRREDFLIDLVPREAKQVYSMRRLLDAVVDKGSLFEMGRLWGRAVITAFARLDG WPVAVLASDPSYLGGSWDARSSEKAERFVKLADQFRLPLVHMVDNPGFMIGHTAESTGTIRYGVQAMNAIYKATVPLCSV IVRRAYGIAGSAMSNAEAFQYRFAWPSGDWGSLPIEGGIEVAYKSEIEAAEDPAAHLGAIRDRLNRVRSPFRTAERFGVE DIVDPRDTRPLLCEFANLAWRTLP
Specific function: The 12S subunit specifically catalyzes the transfer of the carboxyl group of methylmalonyl CoA to the biotin of the 1.3S subunit forming propanoyl-CoA and carboxylated 1.3S-biotin [H]
COG id: COG4799
COG function: function code I; Acetyl-CoA carboxylase, carboxyltransferase component (subunits alpha and beta)
Gene ontology:
Cell location: Cytoplasmic
Metaboloic importance: NA
Operon status: Not Known
Operon components: None
Similarity: Contains 1 carboxyltransferase domain [H]
Homologues:
Organism=Homo sapiens, GI119943100, Length=506, Percent_Identity=32.8063241106719, Blast_Score=246, Evalue=3e-65, Organism=Homo sapiens, GI295821216, Length=526, Percent_Identity=32.1292775665399, Blast_Score=238, Evalue=7e-63, Organism=Homo sapiens, GI11545863, Length=499, Percent_Identity=26.25250501002, Blast_Score=144, Evalue=3e-34, Organism=Caenorhabditis elegans, GI25147362, Length=503, Percent_Identity=31.4115308151093, Blast_Score=239, Evalue=2e-63, Organism=Caenorhabditis elegans, GI25147359, Length=503, Percent_Identity=31.4115308151093, Blast_Score=239, Evalue=2e-63, Organism=Caenorhabditis elegans, GI17552936, Length=505, Percent_Identity=28.3168316831683, Blast_Score=182, Evalue=3e-46, Organism=Saccharomyces cerevisiae, GI6323863, Length=264, Percent_Identity=25.3787878787879, Blast_Score=67, Evalue=7e-12, Organism=Drosophila melanogaster, GI24586065, Length=524, Percent_Identity=26.5267175572519, Blast_Score=162, Evalue=6e-40,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR000438 - InterPro: IPR000022 - InterPro: IPR011763 - InterPro: IPR011762 [H]
Pfam domain/function: PF01039 Carboxyl_trans [H]
EC number: =2.1.3.1 [H]
Molecular weight: Translated: 54422; Mature: 54290
Theoretical pI: Translated: 6.73; Mature: 6.73
Prosite motif: PS50980 COA_CT_NTER ; PS50989 COA_CT_CTER
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.6 %Cys (Translated Protein) 2.4 %Met (Translated Protein) 3.0 %Cys+Met (Translated Protein) 0.6 %Cys (Mature Protein) 2.2 %Met (Mature Protein) 2.8 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MTWEPEIEELRRREAMAEQMGGAEKVARQHARGKLDARARIAGVVDAGSFREIGKIAGKG CCCCCHHHHHHHHHHHHHHCCCHHHHHHHHHCCCCCCHHHEEEEECCCCHHHHHHHHCCC RYGPDGELLDLAPSNLIFGRANVEGRPVVASADDFTVRGGAADAAIARKFIQCEQMAHTL CCCCCCCEEECCCCCEEEEECCCCCCCEEECCCCEEEECCCHHHHHHHHHHHHHHHHHHH KIPLIRMIDGTGGGGSVRTLEDIGATYVPATPGWGDVVRNLDTVPVVALSLGPTAGLGAA HCCEEEEEECCCCCCCCCCHHHCCCEECCCCCCHHHHHHCCCCCCEEEEECCCCCCCHHH RVVASHYSIMVKGLSQLFAAGPAVVAAIGEDRDKEGLGGSAIHTRNGVVDEEVANEAEAF HHHHHHHHHHHHHHHHHHHCCCCEEEECCCCCCCCCCCCCCEECCCCCCCHHHHHHHHHH ARARRFLSYLPSHVGGAAPRTVAADPTDRREDFLIDLVPREAKQVYSMRRLLDAVVDKGS HHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCEEEECCHHHHHHHHHHHHHHHHHCCCC LFEMGRLWGRAVITAFARLDGWPVAVLASDPSYLGGSWDARSSEKAERFVKLADQFRLPL HHHHHHHHHHHHHHHHHHCCCCCEEEEECCCCCCCCCCCCCCHHHHHHHHHHHHHHCCCE VHMVDNPGFMIGHTAESTGTIRYGVQAMNAIYKATVPLCSVIVRRAYGIAGSAMSNAEAF EEEECCCCEEEEECCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHCCCCCE QYRFAWPSGDWGSLPIEGGIEVAYKSEIEAAEDPAAHLGAIRDRLNRVRSPFRTAERFGV EEEEECCCCCCCCCCCCCCEEEEECCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCC EDIVDPRDTRPLLCEFANLAWRTLP HHCCCCCCCCHHHHHHHHHHHHCCC >Mature Secondary Structure TWEPEIEELRRREAMAEQMGGAEKVARQHARGKLDARARIAGVVDAGSFREIGKIAGKG CCCCHHHHHHHHHHHHHHCCCHHHHHHHHHCCCCCCHHHEEEEECCCCHHHHHHHHCCC RYGPDGELLDLAPSNLIFGRANVEGRPVVASADDFTVRGGAADAAIARKFIQCEQMAHTL CCCCCCCEEECCCCCEEEEECCCCCCCEEECCCCEEEECCCHHHHHHHHHHHHHHHHHHH KIPLIRMIDGTGGGGSVRTLEDIGATYVPATPGWGDVVRNLDTVPVVALSLGPTAGLGAA HCCEEEEEECCCCCCCCCCHHHCCCEECCCCCCHHHHHHCCCCCCEEEEECCCCCCCHHH RVVASHYSIMVKGLSQLFAAGPAVVAAIGEDRDKEGLGGSAIHTRNGVVDEEVANEAEAF HHHHHHHHHHHHHHHHHHHCCCCEEEECCCCCCCCCCCCCCEECCCCCCCHHHHHHHHHH ARARRFLSYLPSHVGGAAPRTVAADPTDRREDFLIDLVPREAKQVYSMRRLLDAVVDKGS HHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCEEEECCHHHHHHHHHHHHHHHHHCCCC LFEMGRLWGRAVITAFARLDGWPVAVLASDPSYLGGSWDARSSEKAERFVKLADQFRLPL HHHHHHHHHHHHHHHHHHCCCCCEEEEECCCCCCCCCCCCCCHHHHHHHHHHHHHHCCCE VHMVDNPGFMIGHTAESTGTIRYGVQAMNAIYKATVPLCSVIVRRAYGIAGSAMSNAEAF EEEECCCCEEEEECCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHCCCCCE QYRFAWPSGDWGSLPIEGGIEVAYKSEIEAAEDPAAHLGAIRDRLNRVRSPFRTAERFGV EEEEECCCCCCCCCCCCCCEEEEECCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCC EDIVDPRDTRPLLCEFANLAWRTLP HHCCCCCCCCHHHHHHHHHHHHCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 8366018 [H]