| Definition | Clostridium acetobutylicum ATCC 824 plasmid pSOL1, complete sequence. |
|---|---|
| Accession | NC_001988 |
| Length | 192,000 |
Click here to switch to the map view.
The map label for this gene is Not Available
Identifier: 15004708
GI number: 15004708
Start: 4107
End: 6680
Strand: Direct
Name: Not Available
Synonym: CA_P0003
Alternate gene names: NA
Gene position: 4107-6680 (Clockwise)
Preceding gene: 15004707
Following gene: 15004709
Centisome position: 2.14
GC content: 34.42
Gene sequence:
>2574_bases ATGAAGAAGAATGTATTATTAACTATTGTCCTAATATTTATGCTTGTAATCTCATATTCAGGCGGCGATTTTAAAGCAGA TACTAACGAAGTAGGAGTTTCCTATGAGACGCATGTACAAAATGTAGGGTGGCAAAACTGGTTTAGTGATGGTGTTGAGG CAGGAACTAATGGTCAAGGACTTAGGATTGAAGCCTTAAAAATTAAGCTTGTAAATGCACCAGTAGGAGCACAAATTTCC TATAGCGCACATGTACAAAATGTAGGCTGGCAAGACTGGGTTAATGACGGAGCTGAGGCAGGAACTGATGGAAAAGGTCT TAGAGTAGAAGCTCTTAAGATAAAACTTGTAAATATGCCAGATTATACAGTTCAATATCAGGCACATGTACAAAATATAG GCTGGCAGAATTGGGTTAGTGATGGAGCTGAAGCTGGAACAGACGGCAAAGGATATAGGGTTGAAGCCTTGAGAATAAAG ATAGTTAAAAAGGTAGCCGTTCAAGCAATAACATTAAATAAAGCCTCAGATGAATTAAAGGTGGGACAGACAGATCAATT AAGTGCAGCCTTTAATCCAACAGATGCTACTAATAAAAATTTAAGTTGGACATCTTCTGATGCAAGCATAGCTTCTGTAG ATTCTAGTGGCAAAATTACGGCGCTTAAGCAGGGAACTTCAATAATTACAGCAACTACAGAGGATGGAAGTAAAACAGCT AATTGCAGTGTTACTGTTAACCCTGGCGATTTGCAAATTTCATATACAACACACGTACAGAATGTAGGGTGGCAAAACTG GTTTAGTGATGGTGTTGAAGCAGGAACTGATGGTCAAGGACTTAGGATTGAAGCCTTAAAAATTAAGCTTTTAAATGCGC CAGCAGGAGCACAAATTACATACAGAGCGCATGTACAAAATGTAGGCTGGCAGAATTGGGTTAGTGATGGAACTGAGGCA GGAACTGACGGCAAAGGTCTTAGAGTTGAAGCACTACAAATAAAACTTGTAAACATGCCAGATTATACAGTTCAATATCA AGCGCATGTGCAAAATGTAGGGTGGCAGAATTGGGTTAGTGACGGAGCTGAAGCAGGAACTGATGGAAAGGGATACAGGG TTGAAGCATTAAAGATAAGGATAGTTAAGAAGATAGCTGTTCAATCTATAACTTTAAATAAAAATTCAGATGAATTAAAT GTAGGACAAACAGATCAATTAAGTGCAGTTTTTAATCCAACGGATGCTACTAATAAAAATATTAAGTGGACTTCTTCTGA TAATTATGTGGCTACAGTAGATAGCACTGGAAAGATAACGGCAGTTTCTGGTGGAAATGCAGTGATAACAGCAACAACAG AGGATGGAAGTAAAACAGCTAACTGCAGTATTGTTGTAAACAGCACTGATTCAAAAGATAATCAAGCACTAGAAAAGGCT AAAACTGTCTTAAACACAATAGTACAGCCTGGTATGACGCAGGTTCAAAAGGAGCTTGCAATCCATGATTATATAGTAAC TAATACTCAGTACGAAACGGCTGTTTTTACAAGCGATAATGTTTCTGATGATATATACACTGCCTATGGGGCACTTATAA ATCATAGAGCTGTATGTCAAGGTTACGCAGAAGCTTTTAAGATGATGTGTAATTTAGTAGGAATTCCAACAGACATAATA GAGGACTTTAAGCTTGATCATGCATGGAATATTGTTAAATTAGATGATGGAAATTACTATCAGGTTGATACTACGTGGGA TGATCCTGTATATGGAGACGATACTTCCTTAAGTATAAGCCATGAATACTTTAATTTGTCAGACAGGCAAATGTTTGCGG ATCATACCATTGATAAAGATAAATGGCATTATCCTAAGGCTGCAGTTGATAACAGCGAGTTTTATTCAATTTCAGGAGAT TCATATGACTCAAATGTGGTTTACACTAATTATAATGGTAAGCTTTCAAGTGTAGATTCAAGTGGAAATATGAAAACCTT GAATGATGATCCATCAGCAAGTATTAATTATTATAATGGATCAATATACTATTTAAGTGGTTCTTCAATATATAAGGTAG ATACTAATGGACAAAATAAAGTGCAAATAGCAAGTGGAGATATACGTAAAATGTATTTGTATAATGGAGCTATTTACTAC CTTGATGCTAATGATTTTTCTATTAACAAGTTAGTTTTAGATGGAACCTATAAAAATAAAAAAGTGATTGGCATTACTTG GAACAGCAGCTATTTTATAAATAATGGATGTTTATATTATGAAGCATATGATGATGACTATCTCCATAAGGTTGATTTAC AGTCACTTACAAATACTAAAATATTAACAGTATCTGATTATTATGTAACTAGTTATAGTAATTATTTATTCTATAAAGAT TCCAATAATCTTTATAGAACAGATCTAAATGGTGGAAATTCAAAACTTATTGTAAATAATATTACAGATAATTTTATTGA TATATTCGAAAATTATATCTACTATAATGACAGTAATAATATTTGGTATAAGATGAATCTTGATGGAAGCAATTTAATAA AATTAATGTTTTAA
Upstream 100 bases:
>100_bases ACATTTATATAAATATGCTTTTTCATGCATTTTTATATAAAGATAGTGCCATAAGAAAACGATATAATTAAAAAATAAAT AAGTTTCATGGAGGACTTAA
Downstream 100 bases:
>100_bases AAAGAAGGCTGCAAAACTATTTTTGGTTTTGCAGCCTCTTTTTATTAAGTTAAAATCACATAAAGTAAATAATGAATTTA CTCAATTATTAATTGATTTT
Product: ChW repeat-/cell adhesion domain-containing transglutaminase-like protease
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 857; Mature: 857
Protein sequence:
>857_residues MKKNVLLTIVLIFMLVISYSGGDFKADTNEVGVSYETHVQNVGWQNWFSDGVEAGTNGQGLRIEALKIKLVNAPVGAQIS YSAHVQNVGWQDWVNDGAEAGTDGKGLRVEALKIKLVNMPDYTVQYQAHVQNIGWQNWVSDGAEAGTDGKGYRVEALRIK IVKKVAVQAITLNKASDELKVGQTDQLSAAFNPTDATNKNLSWTSSDASIASVDSSGKITALKQGTSIITATTEDGSKTA NCSVTVNPGDLQISYTTHVQNVGWQNWFSDGVEAGTDGQGLRIEALKIKLLNAPAGAQITYRAHVQNVGWQNWVSDGTEA GTDGKGLRVEALQIKLVNMPDYTVQYQAHVQNVGWQNWVSDGAEAGTDGKGYRVEALKIRIVKKIAVQSITLNKNSDELN VGQTDQLSAVFNPTDATNKNIKWTSSDNYVATVDSTGKITAVSGGNAVITATTEDGSKTANCSIVVNSTDSKDNQALEKA KTVLNTIVQPGMTQVQKELAIHDYIVTNTQYETAVFTSDNVSDDIYTAYGALINHRAVCQGYAEAFKMMCNLVGIPTDII EDFKLDHAWNIVKLDDGNYYQVDTTWDDPVYGDDTSLSISHEYFNLSDRQMFADHTIDKDKWHYPKAAVDNSEFYSISGD SYDSNVVYTNYNGKLSSVDSSGNMKTLNDDPSASINYYNGSIYYLSGSSIYKVDTNGQNKVQIASGDIRKMYLYNGAIYY LDANDFSINKLVLDGTYKNKKVIGITWNSSYFINNGCLYYEAYDDDYLHKVDLQSLTNTKILTVSDYYVTSYSNYLFYKD SNNLYRTDLNGGNSKLIVNNITDNFIDIFENYIYYNDSNNIWYKMNLDGSNLIKLMF
Sequences:
>Translated_857_residues MKKNVLLTIVLIFMLVISYSGGDFKADTNEVGVSYETHVQNVGWQNWFSDGVEAGTNGQGLRIEALKIKLVNAPVGAQIS YSAHVQNVGWQDWVNDGAEAGTDGKGLRVEALKIKLVNMPDYTVQYQAHVQNIGWQNWVSDGAEAGTDGKGYRVEALRIK IVKKVAVQAITLNKASDELKVGQTDQLSAAFNPTDATNKNLSWTSSDASIASVDSSGKITALKQGTSIITATTEDGSKTA NCSVTVNPGDLQISYTTHVQNVGWQNWFSDGVEAGTDGQGLRIEALKIKLLNAPAGAQITYRAHVQNVGWQNWVSDGTEA GTDGKGLRVEALQIKLVNMPDYTVQYQAHVQNVGWQNWVSDGAEAGTDGKGYRVEALKIRIVKKIAVQSITLNKNSDELN VGQTDQLSAVFNPTDATNKNIKWTSSDNYVATVDSTGKITAVSGGNAVITATTEDGSKTANCSIVVNSTDSKDNQALEKA KTVLNTIVQPGMTQVQKELAIHDYIVTNTQYETAVFTSDNVSDDIYTAYGALINHRAVCQGYAEAFKMMCNLVGIPTDII EDFKLDHAWNIVKLDDGNYYQVDTTWDDPVYGDDTSLSISHEYFNLSDRQMFADHTIDKDKWHYPKAAVDNSEFYSISGD SYDSNVVYTNYNGKLSSVDSSGNMKTLNDDPSASINYYNGSIYYLSGSSIYKVDTNGQNKVQIASGDIRKMYLYNGAIYY LDANDFSINKLVLDGTYKNKKVIGITWNSSYFINNGCLYYEAYDDDYLHKVDLQSLTNTKILTVSDYYVTSYSNYLFYKD SNNLYRTDLNGGNSKLIVNNITDNFIDIFENYIYYNDSNNIWYKMNLDGSNLIKLMF >Mature_857_residues MKKNVLLTIVLIFMLVISYSGGDFKADTNEVGVSYETHVQNVGWQNWFSDGVEAGTNGQGLRIEALKIKLVNAPVGAQIS YSAHVQNVGWQDWVNDGAEAGTDGKGLRVEALKIKLVNMPDYTVQYQAHVQNIGWQNWVSDGAEAGTDGKGYRVEALRIK IVKKVAVQAITLNKASDELKVGQTDQLSAAFNPTDATNKNLSWTSSDASIASVDSSGKITALKQGTSIITATTEDGSKTA NCSVTVNPGDLQISYTTHVQNVGWQNWFSDGVEAGTDGQGLRIEALKIKLLNAPAGAQITYRAHVQNVGWQNWVSDGTEA GTDGKGLRVEALQIKLVNMPDYTVQYQAHVQNVGWQNWVSDGAEAGTDGKGYRVEALKIRIVKKIAVQSITLNKNSDELN VGQTDQLSAVFNPTDATNKNIKWTSSDNYVATVDSTGKITAVSGGNAVITATTEDGSKTANCSIVVNSTDSKDNQALEKA KTVLNTIVQPGMTQVQKELAIHDYIVTNTQYETAVFTSDNVSDDIYTAYGALINHRAVCQGYAEAFKMMCNLVGIPTDII EDFKLDHAWNIVKLDDGNYYQVDTTWDDPVYGDDTSLSISHEYFNLSDRQMFADHTIDKDKWHYPKAAVDNSEFYSISGD SYDSNVVYTNYNGKLSSVDSSGNMKTLNDDPSASINYYNGSIYYLSGSSIYKVDTNGQNKVQIASGDIRKMYLYNGAIYY LDANDFSINKLVLDGTYKNKKVIGITWNSSYFINNGCLYYEAYDDDYLHKVDLQSLTNTKILTVSDYYVTSYSNYLFYKD SNNLYRTDLNGGNSKLIVNNITDNFIDIFENYIYYNDSNNIWYKMNLDGSNLIKLMF
Specific function: Unknown
COG id: NA
COG function: NA
Gene ontology:
Cell location: Cytoplasmic
Metaboloic importance: NA
Operon status: Not Known
Operon components: None
Similarity: NA
Homologues:
None
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR003343 - InterPro: IPR008964 - InterPro: IPR022409 [H]
Pfam domain/function: PF02368 Big_2 [H]
EC number: NA
Molecular weight: Translated: 94687; Mature: 94687
Theoretical pI: Translated: 4.67; Mature: 4.67
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.6 %Cys (Translated Protein) 1.4 %Met (Translated Protein) 2.0 %Cys+Met (Translated Protein) 0.6 %Cys (Mature Protein) 1.4 %Met (Mature Protein) 2.0 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MKKNVLLTIVLIFMLVISYSGGDFKADTNEVGVSYETHVQNVGWQNWFSDGVEAGTNGQG CCCCCHHHHHHHHHHHHCCCCCCEECCCCCCCCEEEHHHCCCCCHHHHHHCCCCCCCCCC LRIEALKIKLVNAPVGAQISYSAHVQNVGWQDWVNDGAEAGTDGKGLRVEALKIKLVNMP EEEEEEEEEEEECCCCCEEEEEEEECCCCCHHHHCCCCCCCCCCCCEEEEEEEEEEECCC DYTVQYQAHVQNIGWQNWVSDGAEAGTDGKGYRVEALRIKIVKKVAVQAITLNKASDELK CCEEEEEEEECCCCCHHHHCCCCCCCCCCCCEEEEEEEEEEEHHHHEEEEEECCCCCCEE VGQTDQLSAAFNPTDATNKNLSWTSSDASIASVDSSGKITALKQGTSIITATTEDGSKTA CCCCCCCEEEECCCCCCCCCCEEECCCCEEEEECCCCCEEEEECCCEEEEEECCCCCCCE NCSVTVNPGDLQISYTTHVQNVGWQNWFSDGVEAGTDGQGLRIEALKIKLLNAPAGAQIT EEEEEECCCCEEEEEEEEECCCCCHHHHHCCCCCCCCCCCEEEEEEEEEEEECCCCCEEE YRAHVQNVGWQNWVSDGTEAGTDGKGLRVEALQIKLVNMPDYTVQYQAHVQNVGWQNWVS EEEEECCCCCHHHHCCCCCCCCCCCCEEEEEEEEEEECCCCCEEEEEEEECCCCCHHHHC DGAEAGTDGKGYRVEALKIRIVKKIAVQSITLNKNSDELNVGQTDQLSAVFNPTDATNKN CCCCCCCCCCCEEEEEEEEEEEEEEEEEEEEECCCCCCCCCCCCCCEEEEECCCCCCCCC IKWTSSDNYVATVDSTGKITAVSGGNAVITATTEDGSKTANCSIVVNSTDSKDNQALEKA EEEECCCCEEEEECCCCEEEEEECCCEEEEEECCCCCCCEEEEEEEECCCCCHHHHHHHH KTVLNTIVQPGMTQVQKELAIHDYIVTNTQYETAVFTSDNVSDDIYTAYGALINHRAVCQ HHHHHHHHCCCHHHHHHHHHHEEEEEECCCEEEEEEECCCCCCHHHHHHHHHHCCHHHHH GYAEAFKMMCNLVGIPTDIIEDFKLDHAWNIVKLDDGNYYQVDTTWDDPVYGDDTSLSIS HHHHHHHHHHHHCCCCHHHHHHCCCCCCEEEEEECCCCEEEEECCCCCCCCCCCCEEEEE HEYFNLSDRQMFADHTIDKDKWHYPKAAVDNSEFYSISGDSYDSNVVYTNYNGKLSSVDS EHEECCCCCEEECCCCCCCCCCCCCCCCCCCCCEEEECCCCCCCCEEEECCCCEEEECCC SGNMKTLNDDPSASINYYNGSIYYLSGSSIYKVDTNGQNKVQIASGDIRKMYLYNGAIYY CCCEEEECCCCCCEEEEECCEEEEEECCEEEEEECCCCCEEEEECCCEEEEEEECCEEEE LDANDFSINKLVLDGTYKNKKVIGITWNSSYFINNGCLYYEAYDDDYLHKVDLQSLTNTK EECCCCEEEEEEEECCCCCCEEEEEEECCCEEEECCEEEEEECCCCCEEEEEHHHCCCCE ILTVSDYYVTSYSNYLFYKDSNNLYRTDLNGGNSKLIVNNITDNFIDIFENYIYYNDSNN EEEEEEEEEEEECCEEEEECCCCEEEEECCCCCCEEEEECCCHHHHHHHHCEEEEECCCC IWYKMNLDGSNLIKLMF EEEEEECCCCCEEEEEC >Mature Secondary Structure MKKNVLLTIVLIFMLVISYSGGDFKADTNEVGVSYETHVQNVGWQNWFSDGVEAGTNGQG CCCCCHHHHHHHHHHHHCCCCCCEECCCCCCCCEEEHHHCCCCCHHHHHHCCCCCCCCCC LRIEALKIKLVNAPVGAQISYSAHVQNVGWQDWVNDGAEAGTDGKGLRVEALKIKLVNMP EEEEEEEEEEEECCCCCEEEEEEEECCCCCHHHHCCCCCCCCCCCCEEEEEEEEEEECCC DYTVQYQAHVQNIGWQNWVSDGAEAGTDGKGYRVEALRIKIVKKVAVQAITLNKASDELK CCEEEEEEEECCCCCHHHHCCCCCCCCCCCCEEEEEEEEEEEHHHHEEEEEECCCCCCEE VGQTDQLSAAFNPTDATNKNLSWTSSDASIASVDSSGKITALKQGTSIITATTEDGSKTA CCCCCCCEEEECCCCCCCCCCEEECCCCEEEEECCCCCEEEEECCCEEEEEECCCCCCCE NCSVTVNPGDLQISYTTHVQNVGWQNWFSDGVEAGTDGQGLRIEALKIKLLNAPAGAQIT EEEEEECCCCEEEEEEEEECCCCCHHHHHCCCCCCCCCCCEEEEEEEEEEEECCCCCEEE YRAHVQNVGWQNWVSDGTEAGTDGKGLRVEALQIKLVNMPDYTVQYQAHVQNVGWQNWVS EEEEECCCCCHHHHCCCCCCCCCCCCEEEEEEEEEEECCCCCEEEEEEEECCCCCHHHHC DGAEAGTDGKGYRVEALKIRIVKKIAVQSITLNKNSDELNVGQTDQLSAVFNPTDATNKN CCCCCCCCCCCEEEEEEEEEEEEEEEEEEEEECCCCCCCCCCCCCCEEEEECCCCCCCCC IKWTSSDNYVATVDSTGKITAVSGGNAVITATTEDGSKTANCSIVVNSTDSKDNQALEKA EEEECCCCEEEEECCCCEEEEEECCCEEEEEECCCCCCCEEEEEEEECCCCCHHHHHHHH KTVLNTIVQPGMTQVQKELAIHDYIVTNTQYETAVFTSDNVSDDIYTAYGALINHRAVCQ HHHHHHHHCCCHHHHHHHHHHEEEEEECCCEEEEEEECCCCCCHHHHHHHHHHCCHHHHH GYAEAFKMMCNLVGIPTDIIEDFKLDHAWNIVKLDDGNYYQVDTTWDDPVYGDDTSLSIS HHHHHHHHHHHHCCCCHHHHHHCCCCCCEEEEEECCCCEEEEECCCCCCCCCCCCEEEEE HEYFNLSDRQMFADHTIDKDKWHYPKAAVDNSEFYSISGDSYDSNVVYTNYNGKLSSVDS EHEECCCCCEEECCCCCCCCCCCCCCCCCCCCCEEEECCCCCCCCEEEECCCCEEEECCC SGNMKTLNDDPSASINYYNGSIYYLSGSSIYKVDTNGQNKVQIASGDIRKMYLYNGAIYY CCCEEEECCCCCCEEEEECCEEEEEECCEEEEEECCCCCEEEEECCCEEEEEEECCEEEE LDANDFSINKLVLDGTYKNKKVIGITWNSSYFINNGCLYYEAYDDDYLHKVDLQSLTNTK EECCCCEEEEEEEECCCCCCEEEEEEECCCEEEECCEEEEEECCCCCEEEEEHHHCCCCE ILTVSDYYVTSYSNYLFYKDSNNLYRTDLNGGNSKLIVNNITDNFIDIFENYIYYNDSNN EEEEEEEEEEEECCEEEEECCCCEEEEECCCCCCEEEEECCCHHHHHHHHCEEEEECCCC IWYKMNLDGSNLIKLMF EEEEEECCCCCEEEEEC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 11466286; 8226639 [H]