Definition Bacillus subtilis subsp. subtilis str. 168 chromosome, complete genome.
Accession NC_000964
Length 4,215,606

Click here to switch to the map view.

The map label for this gene is cstA

Identifier: 255767660

GI number: 255767660

Start: 2936382

End: 2938178

Strand: Reverse

Name: cstA

Synonym: BSU28710

Alternate gene names: 255767660

Gene position: 2938178-2936382 (Counterclockwise)

Preceding gene: 255767661

Following gene: 16079922

Centisome position: 69.7

GC content: 48.86

Gene sequence:

>1797_bases
ATGAATGCGGTTACAATTGTGATAGCATCAATGTGTATTTTGGCTATTGCCTATCGTTTATACGGAACATTTATGATGGT
GAAGGTTCTCAAAGTGAATGATGACAAGCCAACACCTGCTCATGCGCTTGAGGATGGGAAAGACTATGTGCCTACAAATA
AATGGGTTTCGTTCGGCCACCACTTTGCCGCGATCGCAGCGGCCGGGCCGCTGGTCGGACCAATTCTGGCGGCGCAGTTT
GGCTATTTGCCGGGATTATTGTGGCTGTTAATCGGGGCGGTAATTGGGGGAGCCGTCCATGATATTGTGGTGTTGTTTGC
ATCGATGCGCAAAAACGGAAAATCGCTGTCGGAAGTGGCGAAGGATGAGCTTGGCCCTGTTGCAGGATTTTGTACAGGAC
TGTCCATGCTGTTTATCATCACGATCACAATGGCGGGCCTGTCGATGGTTGTCTTGCATGCGCTTGAACGTAATCCATGG
GGAACATTTGCGGTGGGGATTACGATTCCGATTGCGATGGGTGTGGGCTTATTTTATAAGAAAACGGGAAATTTAAAGCT
CGCTTCAACGGTCGGCTTTCTCTTTTTAATGGCAGGAGTCTTTATCGGTCCATGGGTACAGACTACCGCGCTCGGTGACT
TTTTAACGCTAGATACGAAAACGCTTGCAATCGCGCTTCCTGTTTATGCGTTTTTTGCGGCTGCGCTTCCCGTTTGGCTG
CTTCTGGCTCCGCGTGATTATTTAAGCAGCTTTATGAAAATCGGTGTTTTTATCGCTTTGATTGTTGGTGTGTTTGTCGT
CAATCCGTCCATTCCGTTCCCTGCGTTTACAGAATTCGTAAAAGGCGGAGGGCCGGTGCTGGCAGGACCTGTCTGGCCGT
TCATCTCAATAACCATCGCCTGCGGGGCGATCTCTGGGTTCCATGCCTTTGTCGGCTCAGGAACGACACCGAAAATGCTG
AATAAATGGAGTGATATGAAGCCGGTTGCGTTTGGCGCAATGCTTGTTGAGTGTCTTGTCGGTATCATGGCGCTGATTGC
AGCGACCGCTTTACAGCCTGCTGATTACTTTGCGATTAACAGCACGCCTGAGGTTTTCCGTACGCTTGGCATGAATGTCG
TACATTTGCCTGAATTGAGCGGGGAAATCGGTTTGGACTTAGAAGGAAGAACAGGGGGAGCCGTCACGCTTGCGGTAGGG
ATGACTTATATTTTTACCGGAATGCCGTTTTTCAGCCATTTGGCCTCATACTTTTTCCAATTTGTCATTATGTTTGAAGC
GGTCTTTATTTTAACAGCGATTGACGCCGGCACACGTGTCGCCCGTTATTTGATCCAGGACTTCTTCGGGGAGGTGTATA
AGCCGCTGAAGAAAACAGACTGGATTCCGGGCTCTGTATTTGCCAGCGCGCTTGCCTGTTTGATGTGGGGGTACTTGCTG
TATTCAGGAGATATCGGTTCCATTTGGGCGCTCTTCGGCGTTTCTAATCAGCTGATGGCTTCAGTGGGGCTGATTATCGG
AGCGACGATCGTGCTGAAAATCGCCGATAAACGCCGGTACATTCTGACTTGCCTTATCCCGCTTGCCTATTTATATGTCA
CTGTCAATTATGCGGGCTATTGGATGGTGCGCAATGTGTATCTCAATCCTGAAGCAGCAGGATATAGTGTATTGAATGGC
GTATTATCTATCATCATGCTGGTGTTAGGCTTCATCATTATCGTGGCGGCTGTGAAAAAATGGGCGCAGATGTGGAAAGA
TCCGAGCTTAAGGATGGAAGCATCTATACCGGGCTAG

Upstream 100 bases:

>100_bases
CCGGCCCATTCCAGCCGGCTTTTTGTATAGGAAAAAATGACCGCTTTTCACCATGAAATTATGATATATTTATGAAAAAC
AGAAAAGGGGATGGGAGAAA

Downstream 100 bases:

>100_bases
AAGGACTATTGAAAATGCTGAGAGGGGTTGGCAATGAATCTATCAATGAAATATCTTATTCTATACGTATCGGACAGCAA
GCGGGCTATTCATTTTTTAC

Product: carbon starvation-induced membrane protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 598; Mature: 598

Protein sequence:

>598_residues
MNAVTIVIASMCILAIAYRLYGTFMMVKVLKVNDDKPTPAHALEDGKDYVPTNKWVSFGHHFAAIAAAGPLVGPILAAQF
GYLPGLLWLLIGAVIGGAVHDIVVLFASMRKNGKSLSEVAKDELGPVAGFCTGLSMLFIITITMAGLSMVVLHALERNPW
GTFAVGITIPIAMGVGLFYKKTGNLKLASTVGFLFLMAGVFIGPWVQTTALGDFLTLDTKTLAIALPVYAFFAAALPVWL
LLAPRDYLSSFMKIGVFIALIVGVFVVNPSIPFPAFTEFVKGGGPVLAGPVWPFISITIACGAISGFHAFVGSGTTPKML
NKWSDMKPVAFGAMLVECLVGIMALIAATALQPADYFAINSTPEVFRTLGMNVVHLPELSGEIGLDLEGRTGGAVTLAVG
MTYIFTGMPFFSHLASYFFQFVIMFEAVFILTAIDAGTRVARYLIQDFFGEVYKPLKKTDWIPGSVFASALACLMWGYLL
YSGDIGSIWALFGVSNQLMASVGLIIGATIVLKIADKRRYILTCLIPLAYLYVTVNYAGYWMVRNVYLNPEAAGYSVLNG
VLSIIMLVLGFIIIVAAVKKWAQMWKDPSLRMEASIPG

Sequences:

>Translated_598_residues
MNAVTIVIASMCILAIAYRLYGTFMMVKVLKVNDDKPTPAHALEDGKDYVPTNKWVSFGHHFAAIAAAGPLVGPILAAQF
GYLPGLLWLLIGAVIGGAVHDIVVLFASMRKNGKSLSEVAKDELGPVAGFCTGLSMLFIITITMAGLSMVVLHALERNPW
GTFAVGITIPIAMGVGLFYKKTGNLKLASTVGFLFLMAGVFIGPWVQTTALGDFLTLDTKTLAIALPVYAFFAAALPVWL
LLAPRDYLSSFMKIGVFIALIVGVFVVNPSIPFPAFTEFVKGGGPVLAGPVWPFISITIACGAISGFHAFVGSGTTPKML
NKWSDMKPVAFGAMLVECLVGIMALIAATALQPADYFAINSTPEVFRTLGMNVVHLPELSGEIGLDLEGRTGGAVTLAVG
MTYIFTGMPFFSHLASYFFQFVIMFEAVFILTAIDAGTRVARYLIQDFFGEVYKPLKKTDWIPGSVFASALACLMWGYLL
YSGDIGSIWALFGVSNQLMASVGLIIGATIVLKIADKRRYILTCLIPLAYLYVTVNYAGYWMVRNVYLNPEAAGYSVLNG
VLSIIMLVLGFIIIVAAVKKWAQMWKDPSLRMEASIPG
>Mature_598_residues
MNAVTIVIASMCILAIAYRLYGTFMMVKVLKVNDDKPTPAHALEDGKDYVPTNKWVSFGHHFAAIAAAGPLVGPILAAQF
GYLPGLLWLLIGAVIGGAVHDIVVLFASMRKNGKSLSEVAKDELGPVAGFCTGLSMLFIITITMAGLSMVVLHALERNPW
GTFAVGITIPIAMGVGLFYKKTGNLKLASTVGFLFLMAGVFIGPWVQTTALGDFLTLDTKTLAIALPVYAFFAAALPVWL
LLAPRDYLSSFMKIGVFIALIVGVFVVNPSIPFPAFTEFVKGGGPVLAGPVWPFISITIACGAISGFHAFVGSGTTPKML
NKWSDMKPVAFGAMLVECLVGIMALIAATALQPADYFAINSTPEVFRTLGMNVVHLPELSGEIGLDLEGRTGGAVTLAVG
MTYIFTGMPFFSHLASYFFQFVIMFEAVFILTAIDAGTRVARYLIQDFFGEVYKPLKKTDWIPGSVFASALACLMWGYLL
YSGDIGSIWALFGVSNQLMASVGLIIGATIVLKIADKRRYILTCLIPLAYLYVTVNYAGYWMVRNVYLNPEAAGYSVLNG
VLSIIMLVLGFIIIVAAVKKWAQMWKDPSLRMEASIPG

Specific function: Peptide Utilization During Carbon Starvation. [C]

COG id: COG1966

COG function: function code T; Carbon starvation protein, predicted membrane protein

Gene ontology:

Cell location: Cell membrane; Multi-pass membrane protein (Potential)

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the CstA family

Homologues:

Organism=Escherichia coli, GI1786814, Length=568, Percent_Identity=44.8943661971831, Blast_Score=467, Evalue=1e-133,
Organism=Escherichia coli, GI87082431, Length=674, Percent_Identity=38.4272997032641, Blast_Score=441, Evalue=1e-125,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): CSTA_BACSU (P94532)

Other databases:

- EMBL:   Z75208
- EMBL:   AL009126
- PIR:   A69609
- RefSeq:   NP_390749.2
- EnsemblBacteria:   EBBACT00000001670
- GeneID:   937970
- GenomeReviews:   AL009126_GR
- KEGG:   bsu:BSU28710
- NMPDR:   fig|224308.1.peg.2874
- GenoList:   BSU28710
- GeneTree:   EBGT00050000002394
- HOGENOM:   HBG304085
- PhylomeDB:   P94532
- ProtClustDB:   CLSK2393392
- BioCyc:   BSUB:BSU28710-MONOMER
- InterPro:   IPR003706

Pfam domain/function: PF02554 CstA

EC number: NA

Molecular weight: Translated: 64333; Mature: 64333

Theoretical pI: Translated: 8.67; Mature: 8.67

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

HASH(0x114f85c8)-; HASH(0x11950048)-; HASH(0x112b0458)-; HASH(0x101da5b8)-; HASH(0x119a4f3c)-; HASH(0xd380be4)-; HASH(0x117479a4)-; HASH(0x119ad7e0)-; HASH(0x117f7c88)-; HASH(0x11697cd8)-; HASH(0x119954a4)-; HASH(0x1137fff0)-; HASH(0x11256ecc)-; HASH(0xf6c4168)-; HASH(0x10883be8)-; HASH(0x115050c4)-;

Cys/Met content:

1.0 %Cys     (Translated Protein)
4.2 %Met     (Translated Protein)
5.2 %Cys+Met (Translated Protein)
1.0 %Cys     (Mature Protein)
4.2 %Met     (Mature Protein)
5.2 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MNAVTIVIASMCILAIAYRLYGTFMMVKVLKVNDDKPTPAHALEDGKDYVPTNKWVSFGH
CCHHHHHHHHHHHHHHHHHHHHHHHHHHHHEECCCCCCCCHHHCCCCCCCCCCHHHHHHH
HFAAIAAAGPLVGPILAAQFGYLPGLLWLLIGAVIGGAVHDIVVLFASMRKNGKSLSEVA
HHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHH
KDELGPVAGFCTGLSMLFIITITMAGLSMVVLHALERNPWGTFAVGITIPIAMGVGLFYK
HHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEEHHHHHHHHCCCHHEE
KTGNLKLASTVGFLFLMAGVFIGPWVQTTALGDFLTLDTKTLAIALPVYAFFAAALPVWL
ECCCEEHHHHHHHHHHHHHHHHCCCHHHHHCCCHHEECHHHHHHHHHHHHHHHHHHHHHH
LLAPRDYLSSFMKIGVFIALIVGVFVVNPSIPFPAFTEFVKGGGPVLAGPVWPFISITIA
HHCCHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHCCCCCEEECCHHHHHHHHHH
CGAISGFHAFVGSGTTPKMLNKWSDMKPVAFGAMLVECLVGIMALIAATALQPADYFAIN
HHHHHHHHHHHCCCCCHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEEC
STPEVFRTLGMNVVHLPELSGEIGLDLEGRTGGAVTLAVGMTYIFTGMPFFSHLASYFFQ
CCHHHHHHHCCCEEECCCCCCCCCCEECCCCCCEEEHHHHHHHHHHCCHHHHHHHHHHHH
FVIMFEAVFILTAIDAGTRVARYLIQDFFGEVYKPLKKTDWIPGSVFASALACLMWGYLL
HHHHHHHHHHHHHHCHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHH
YSGDIGSIWALFGVSNQLMASVGLIIGATIVLKIADKRRYILTCLIPLAYLYVTVNYAGY
HCCCHHHHHHHHCCCHHHHHHHHHHHHHHHHEEECCCCHHHHHHHHHHHHHHHHHCCCCE
WMVRNVYLNPEAAGYSVLNGVLSIIMLVLGFIIIVAAVKKWAQMWKDPSLRMEASIPG
EEEEEEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEECCCCH
>Mature Secondary Structure
MNAVTIVIASMCILAIAYRLYGTFMMVKVLKVNDDKPTPAHALEDGKDYVPTNKWVSFGH
CCHHHHHHHHHHHHHHHHHHHHHHHHHHHHEECCCCCCCCHHHCCCCCCCCCCHHHHHHH
HFAAIAAAGPLVGPILAAQFGYLPGLLWLLIGAVIGGAVHDIVVLFASMRKNGKSLSEVA
HHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHH
KDELGPVAGFCTGLSMLFIITITMAGLSMVVLHALERNPWGTFAVGITIPIAMGVGLFYK
HHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEEHHHHHHHHCCCHHEE
KTGNLKLASTVGFLFLMAGVFIGPWVQTTALGDFLTLDTKTLAIALPVYAFFAAALPVWL
ECCCEEHHHHHHHHHHHHHHHHCCCHHHHHCCCHHEECHHHHHHHHHHHHHHHHHHHHHH
LLAPRDYLSSFMKIGVFIALIVGVFVVNPSIPFPAFTEFVKGGGPVLAGPVWPFISITIA
HHCCHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHCCCCCEEECCHHHHHHHHHH
CGAISGFHAFVGSGTTPKMLNKWSDMKPVAFGAMLVECLVGIMALIAATALQPADYFAIN
HHHHHHHHHHHCCCCCHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEEC
STPEVFRTLGMNVVHLPELSGEIGLDLEGRTGGAVTLAVGMTYIFTGMPFFSHLASYFFQ
CCHHHHHHHCCCEEECCCCCCCCCCEECCCCCCEEEHHHHHHHHHHCCHHHHHHHHHHHH
FVIMFEAVFILTAIDAGTRVARYLIQDFFGEVYKPLKKTDWIPGSVFASALACLMWGYLL
HHHHHHHHHHHHHHCHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHH
YSGDIGSIWALFGVSNQLMASVGLIIGATIVLKIADKRRYILTCLIPLAYLYVTVNYAGY
HCCCHHHHHHHHCCCHHHHHHHHHHHHHHHHEEECCCCHHHHHHHHHHHHHHHHHCCCCE
WMVRNVYLNPEAAGYSVLNGVLSIIMLVLGFIIIVAAVKKWAQMWKDPSLRMEASIPG
EEEEEEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEECCCCH

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 8969504; 9384377