Definition Geobacillus thermodenitrificans NG80-2 chromosome, complete genome.
Accession NC_009328
Length 3,550,319

Click here to switch to the map view.

The map label for this gene is yngE [H]

Identifier: 138895114

GI number: 138895114

Start: 1537258

End: 1538817

Strand: Direct

Name: yngE [H]

Synonym: GTNG_1452

Alternate gene names: 138895114

Gene position: 1537258-1538817 (Clockwise)

Preceding gene: 138895113

Following gene: 138895116

Centisome position: 43.3

GC content: 53.53

Gene sequence:

>1560_bases
ATGGGGATGAAGGAAATAGCTAATCAACGAGTCACGCTGGCTGAGGAGCTAGCGAAACGGGCAGCTGACATTAAAAAAGG
TGGAGCGCCGAAATATCATGAAAAGAACGCTGCCCAAGGAAAGCTGTTTGTGCGCGATCGGTTGAATTTGTTGCTTGATG
ACGGCTTGGAAGTGGAAGACGGATTGTTTGCCAACTGTTTGGCTGACGGACTGCCGGCTGATGGAGTTGTCACCGGCATC
GGCAAAATCAACGGCCGGACCGTCTGCGTGATGGCGAACGACTCCACCGTCAAAGCTGGTTCATGGGGGGCACGTACGGT
CGAAAAAATCATCCGCATCCAGGAGACGGCGGAAAAACTGCGCTGTCCGCTCATTTATTTAGTTGATTCGGCCGGCGCGC
GCATTACCGACCAAATCGAAATGTTTCCCGGCCGACGCGGAGCGGGGCGCATTTTTTACAATGAAGTGAAACTGTCGGGG
AAAGTGCCGCAAGTGTGCTTGCTCTTTGGTCCGTCGGCAGCCGGCGGCGCTTATATTCCAGCGTTTTGTGACATCGTCAT
TATGGTCGAAGGCAATGCATCGATGTATTTAGGCTCGCCGCGCATGGCGGAAATGGTCATCGGCGAAAAAGTGACGCTCG
AAGAAATGGGCGGCGCTCGCATGCATTGTACTGTTTCGGGTTGCGGCGATGTGCTTGTGAAAACCGAAGAAGAGGCGATC
GCCTATGCGCGCCGCTATTTGTCGTATTTTCCGTCCAACTACAGCGAAAAACCGCCGATGGCAGAAGCGAAGCCGCCGAA
ATCGTTCGACAAAACGATTGAAGAGATTTTGCCGGAGAACCAAAACGCACCGTTTAATATGTATGATTTAATTGAGCGGA
TCATTGATGAGGGATCGTTTTGTGAAGTGAAAAAGCTGTTTGCGCCGGAACTCATTACGGGCTTGGCGCGCCTTGCCGGC
CAGCCGATTGGCATTATCGCCAACCAGCCGCGCGTCAAGGGCGGAGTGCTGTTCCACGATTCCGCCGATAAAGCGGCAAA
GTTCATCACCCTTTGCGATGCATTCCACATCCCGCTTTTGTTTTTGGCCGATATCCCGGGCTTTATGATCGGCACGAAAG
TCGAGCGAGCCGGCATTATCCGTCACGGGGCGAAAATGATTGCGGCGATGTCGGAAGCAACGGTGCCGAAAATTTCTATT
ATCGTGCGCAAAGCATACGGCGCCGGATTGTATGCGATGGCTGGACCGGCGTTTGAACCGGATTGCTGCCTCGCGTTTCC
GAACGCGCAAATCGCGGTGATGGGACCGGAGGCGGCTGTCAATGCCGTCTATGCAAACAAAATCGCCGAACTGCCGCCAG
AAGAGCGGCCGGCTTTTGTTGAGCAAAAGCGGGAAGAGTACCGGCGTGATATTGACATTTATCGACTTGCTTCCGAGCTC
GTCATCGACGGGATCATCGCGCCGAACGAGCTGCGTGACGAGCTCATTCGCCGGTTTGACGCTTATATGTCCAAATATAT
GGCTTTTTCCGAACGGAAACATGGGGTATATCCGGTTTGA

Upstream 100 bases:

>100_bases
CGCGGTGTGCAATGCTGTTGGACGTATTGGCGATGACATTCGATGGATAAAAGTACCGCCTGAGAAAACAGCGGAATGAA
CGAAGCAAGGAGGCGACAAC

Downstream 100 bases:

>100_bases
AGAACATGGGCCGCTGTCTCTCTTGCCAAACAACTGAAGATCGTGTATGATAATAATCACCAATCCGCTGCTGCGTTGTG
CGTTGTAGAATGAAGTTTCA

Product: propionyl-CoA carboxylase

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 519; Mature: 518

Protein sequence:

>519_residues
MGMKEIANQRVTLAEELAKRAADIKKGGAPKYHEKNAAQGKLFVRDRLNLLLDDGLEVEDGLFANCLADGLPADGVVTGI
GKINGRTVCVMANDSTVKAGSWGARTVEKIIRIQETAEKLRCPLIYLVDSAGARITDQIEMFPGRRGAGRIFYNEVKLSG
KVPQVCLLFGPSAAGGAYIPAFCDIVIMVEGNASMYLGSPRMAEMVIGEKVTLEEMGGARMHCTVSGCGDVLVKTEEEAI
AYARRYLSYFPSNYSEKPPMAEAKPPKSFDKTIEEILPENQNAPFNMYDLIERIIDEGSFCEVKKLFAPELITGLARLAG
QPIGIIANQPRVKGGVLFHDSADKAAKFITLCDAFHIPLLFLADIPGFMIGTKVERAGIIRHGAKMIAAMSEATVPKISI
IVRKAYGAGLYAMAGPAFEPDCCLAFPNAQIAVMGPEAAVNAVYANKIAELPPEERPAFVEQKREEYRRDIDIYRLASEL
VIDGIIAPNELRDELIRRFDAYMSKYMAFSERKHGVYPV

Sequences:

>Translated_519_residues
MGMKEIANQRVTLAEELAKRAADIKKGGAPKYHEKNAAQGKLFVRDRLNLLLDDGLEVEDGLFANCLADGLPADGVVTGI
GKINGRTVCVMANDSTVKAGSWGARTVEKIIRIQETAEKLRCPLIYLVDSAGARITDQIEMFPGRRGAGRIFYNEVKLSG
KVPQVCLLFGPSAAGGAYIPAFCDIVIMVEGNASMYLGSPRMAEMVIGEKVTLEEMGGARMHCTVSGCGDVLVKTEEEAI
AYARRYLSYFPSNYSEKPPMAEAKPPKSFDKTIEEILPENQNAPFNMYDLIERIIDEGSFCEVKKLFAPELITGLARLAG
QPIGIIANQPRVKGGVLFHDSADKAAKFITLCDAFHIPLLFLADIPGFMIGTKVERAGIIRHGAKMIAAMSEATVPKISI
IVRKAYGAGLYAMAGPAFEPDCCLAFPNAQIAVMGPEAAVNAVYANKIAELPPEERPAFVEQKREEYRRDIDIYRLASEL
VIDGIIAPNELRDELIRRFDAYMSKYMAFSERKHGVYPV
>Mature_518_residues
GMKEIANQRVTLAEELAKRAADIKKGGAPKYHEKNAAQGKLFVRDRLNLLLDDGLEVEDGLFANCLADGLPADGVVTGIG
KINGRTVCVMANDSTVKAGSWGARTVEKIIRIQETAEKLRCPLIYLVDSAGARITDQIEMFPGRRGAGRIFYNEVKLSGK
VPQVCLLFGPSAAGGAYIPAFCDIVIMVEGNASMYLGSPRMAEMVIGEKVTLEEMGGARMHCTVSGCGDVLVKTEEEAIA
YARRYLSYFPSNYSEKPPMAEAKPPKSFDKTIEEILPENQNAPFNMYDLIERIIDEGSFCEVKKLFAPELITGLARLAGQ
PIGIIANQPRVKGGVLFHDSADKAAKFITLCDAFHIPLLFLADIPGFMIGTKVERAGIIRHGAKMIAAMSEATVPKISII
VRKAYGAGLYAMAGPAFEPDCCLAFPNAQIAVMGPEAAVNAVYANKIAELPPEERPAFVEQKREEYRRDIDIYRLASELV
IDGIIAPNELRDELIRRFDAYMSKYMAFSERKHGVYPV

Specific function: Unknown

COG id: COG4799

COG function: function code I; Acetyl-CoA carboxylase, carboxyltransferase component (subunits alpha and beta)

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Contains 1 carboxyltransferase domain [H]

Homologues:

Organism=Homo sapiens, GI119943100, Length=530, Percent_Identity=34.9056603773585, Blast_Score=315, Evalue=9e-86,
Organism=Homo sapiens, GI295821216, Length=550, Percent_Identity=33.8181818181818, Blast_Score=303, Evalue=3e-82,
Organism=Homo sapiens, GI11545863, Length=518, Percent_Identity=35.5212355212355, Blast_Score=286, Evalue=4e-77,
Organism=Homo sapiens, GI38679960, Length=345, Percent_Identity=23.1884057971014, Blast_Score=69, Evalue=9e-12,
Organism=Homo sapiens, GI134142062, Length=343, Percent_Identity=25.0728862973761, Blast_Score=69, Evalue=9e-12,
Organism=Homo sapiens, GI38679977, Length=345, Percent_Identity=23.1884057971014, Blast_Score=69, Evalue=1e-11,
Organism=Homo sapiens, GI38679967, Length=345, Percent_Identity=23.1884057971014, Blast_Score=69, Evalue=1e-11,
Organism=Homo sapiens, GI38679974, Length=345, Percent_Identity=23.1884057971014, Blast_Score=69, Evalue=1e-11,
Organism=Homo sapiens, GI38679971, Length=345, Percent_Identity=23.1884057971014, Blast_Score=69, Evalue=1e-11,
Organism=Caenorhabditis elegans, GI25147362, Length=503, Percent_Identity=35.7852882703777, Blast_Score=315, Evalue=3e-86,
Organism=Caenorhabditis elegans, GI25147359, Length=503, Percent_Identity=35.7852882703777, Blast_Score=315, Evalue=4e-86,
Organism=Caenorhabditis elegans, GI17552936, Length=518, Percent_Identity=35.1351351351351, Blast_Score=308, Evalue=4e-84,
Organism=Caenorhabditis elegans, GI71997163, Length=383, Percent_Identity=22.976501305483, Blast_Score=73, Evalue=5e-13,
Organism=Caenorhabditis elegans, GI133931226, Length=284, Percent_Identity=23.5915492957746, Blast_Score=69, Evalue=7e-12,
Organism=Drosophila melanogaster, GI24586065, Length=548, Percent_Identity=35.5839416058394, Blast_Score=315, Evalue=4e-86,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR000022
- InterPro:   IPR011763
- InterPro:   IPR011762 [H]

Pfam domain/function: PF01039 Carboxyl_trans [H]

EC number: NA

Molecular weight: Translated: 56771; Mature: 56639

Theoretical pI: Translated: 6.29; Mature: 6.29

Prosite motif: PS50980 COA_CT_NTER ; PS50989 COA_CT_CTER

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

2.1 %Cys     (Translated Protein)
3.7 %Met     (Translated Protein)
5.8 %Cys+Met (Translated Protein)
2.1 %Cys     (Mature Protein)
3.5 %Met     (Mature Protein)
5.6 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MGMKEIANQRVTLAEELAKRAADIKKGGAPKYHEKNAAQGKLFVRDRLNLLLDDGLEVED
CCHHHHHCCHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCEEEEHHHHHHHHCCCCCCCC
GLFANCLADGLPADGVVTGIGKINGRTVCVMANDSTVKAGSWGARTVEKIIRIQETAEKL
CHHHHHHHCCCCCCCEEEECCCCCCEEEEEEECCCEEECCCCCHHHHHHHHHHHHHHHHH
RCPLIYLVDSAGARITDQIEMFPGRRGAGRIFYNEVKLSGKVPQVCLLFGPSAAGGAYIP
CCCEEEEEECCCCCEEHHHHCCCCCCCCCCEEEEEEEECCCCCEEEEEECCCCCCCCCCC
AFCDIVIMVEGNASMYLGSPRMAEMVIGEKVTLEEMGGARMHCTVSGCGDVLVKTEEEAI
CCCEEEEEEECCCEEEECCCHHHHHHHCCEEEHHHCCCCEEEEEEECCCCEEEECHHHHH
AYARRYLSYFPSNYSEKPPMAEAKPPKSFDKTIEEILPENQNAPFNMYDLIERIIDEGSF
HHHHHHHHHCCCCCCCCCCCCCCCCCCHHHHHHHHHCCCCCCCCCCHHHHHHHHHCCCCH
CEVKKLFAPELITGLARLAGQPIGIIANQPRVKGGVLFHDSADKAAKFITLCDAFHIPLL
HHHHHHHHHHHHHHHHHHCCCCEEEEECCCCCCCCEEEECCHHHHHHHHHHHHHHHHHHH
FLADIPGFMIGTKVERAGIIRHGAKMIAAMSEATVPKISIIVRKAYGAGLYAMAGPAFEP
HHHCCCCHHHCCCHHHHHHHHHHHHHHHHHHHCCCCEEEEEEEHHCCCCEEEECCCCCCC
DCCLAFPNAQIAVMGPEAAVNAVYANKIAELPPEERPAFVEQKREEYRRDIDIYRLASEL
CCEEECCCCEEEEECCHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHHH
VIDGIIAPNELRDELIRRFDAYMSKYMAFSERKHGVYPV
HHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCC
>Mature Secondary Structure 
GMKEIANQRVTLAEELAKRAADIKKGGAPKYHEKNAAQGKLFVRDRLNLLLDDGLEVED
CHHHHHCCHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCEEEEHHHHHHHHCCCCCCCC
GLFANCLADGLPADGVVTGIGKINGRTVCVMANDSTVKAGSWGARTVEKIIRIQETAEKL
CHHHHHHHCCCCCCCEEEECCCCCCEEEEEEECCCEEECCCCCHHHHHHHHHHHHHHHHH
RCPLIYLVDSAGARITDQIEMFPGRRGAGRIFYNEVKLSGKVPQVCLLFGPSAAGGAYIP
CCCEEEEEECCCCCEEHHHHCCCCCCCCCCEEEEEEEECCCCCEEEEEECCCCCCCCCCC
AFCDIVIMVEGNASMYLGSPRMAEMVIGEKVTLEEMGGARMHCTVSGCGDVLVKTEEEAI
CCCEEEEEEECCCEEEECCCHHHHHHHCCEEEHHHCCCCEEEEEEECCCCEEEECHHHHH
AYARRYLSYFPSNYSEKPPMAEAKPPKSFDKTIEEILPENQNAPFNMYDLIERIIDEGSF
HHHHHHHHHCCCCCCCCCCCCCCCCCCHHHHHHHHHCCCCCCCCCCHHHHHHHHHCCCCH
CEVKKLFAPELITGLARLAGQPIGIIANQPRVKGGVLFHDSADKAAKFITLCDAFHIPLL
HHHHHHHHHHHHHHHHHHCCCCEEEEECCCCCCCCEEEECCHHHHHHHHHHHHHHHHHHH
FLADIPGFMIGTKVERAGIIRHGAKMIAAMSEATVPKISIIVRKAYGAGLYAMAGPAFEP
HHHCCCCHHHCCCHHHHHHHHHHHHHHHHHHHCCCCEEEEEEEHHCCCCEEEECCCCCCC
DCCLAFPNAQIAVMGPEAAVNAVYANKIAELPPEERPAFVEQKREEYRRDIDIYRLASEL
CCEEECCCCEEEEECCHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHHH
VIDGIIAPNELRDELIRRFDAYMSKYMAFSERKHGVYPV
HHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9384377; 9387222 [H]