| Definition | Chlorobium tepidum TLS, complete genome. |
|---|---|
| Accession | NC_002932 |
| Length | 2,154,946 |
Click here to switch to the map view.
The map label for this gene is cafA [H]
Identifier: 21675068
GI number: 21675068
Start: 2124011
End: 2125693
Strand: Reverse
Name: cafA [H]
Synonym: CT2260
Alternate gene names: 21675068
Gene position: 2125693-2124011 (Counterclockwise)
Preceding gene: 21675072
Following gene: 21675067
Centisome position: 98.64
GC content: 58.59
Gene sequence:
>1683_bases ATGAAGAAGAATGTGAAGAAACAGCTCCTGATGAACAAGATCGGAGATGAAATTCAGGTTGCGCTTGTCGAGGAGGGGCG GCTTGCCGAGCTGATTATCGAGCGGCCGGAGAGCATGAGGAGTATCGGCGATATTTATCTGGGCAGGGTGCACAAGGTGG TTGAGGGACTGAAGGCGGCCTTTGTCGATATTGGCCAGAAGTCCGATGGGTTCCTCCACTTTTCGGATGTCGGTACCACC AGCGAGGATTACCGCGCACTTGTCGAGGATGACGATAATGACGAGAATGGCGGTGACGAGGATGATGATGAAAACGAAGG CGATGATAACGCCGAAGCGCCCGCGCCGCCGCGAGAGGCGGCCCGTCCCGCTGGACAGCAGAAGAGCGAGCAAGGGCAGC AGTCGTCCGGCGACGCCGCCGAAAGGCGTCAGTCCTACACCCAGATGATCGCCCAGAAGCTCAAGCCGAACGATTCAATT CTCGTGCAGGTCATCAAGGAGCCGATCGGTACCAAGGGGTCCCGCCTCACCTCCGACATCACCATTGCCGGGCGCTTCAT GGTGCTGCTGCCGTTCGGCGGCGGCCAGATCGCCGTTTCGCGCCGCGTGGTGTCGCGCAAGGAGCGGGGCCGCCTCAAAA AGCTTGTCCGCTCGATGTTGCCCGAAGGGTTCGGCGCGATCATCCGCACGGTGGCCGAGGATCAGGATGAGTCGCTCCTG AAGCAAGATCTCGAAAAGCTTCTGGCCAAGTGGACACAGATCGAGGAGAAGTTGCAGGACGCGCAGCCTCCTCAGCTCAT CTTCAAGGAGGACACCATCATTTCGAGCGTGCTGCGTGATTCGCTCACCACCGATGTGACCGAAATCGTGGCCAACTCGA AATCGATTTATACCGAGACGCTCAACTATATCCAGTGGGCCGCGCCCGACATGGTCAAGAATGTCTCGCTCTACGAGGGC AAGCTGCCGCTCTTCGAGGGTTACGGCATCGCCAAGGATGTAGAGTCGATCTTTTCGCGCAAGGTGTGGCTCAAGTCGGG CGGCTACATCATCATCGAACACACCGAGGCGATGGTGGTCGTGGATGTCAACAGCGGGCGCTACGCCGCCAAGCGCGAAC AGGAGGAGAACTCGCTCAAGACCAACCTCGAAGCTGCCCGCGAGGTCGTGCGCCAGCTCAGGTTGCGCGACATCGGTGGT ATCATCGTGGTGGACTTCATCGACATGATGGATCCGAAAAACTCCAAAAAGGTGTACGACGCCATGAAGGCCGAACTGCG TAACGATCGCGCCAAGTCGAACATTCTGCCGCTTTCAGACTTCGGCATCATGCAGATTACCCGCGAGCGCATCCGCCCGA GCCTCATGCAGCGCATGGGCGACCAGTGCCCCGCCTGCGGCGGCACCGGCGTGGTGCAGGCGCGCTTTACCACCATCAAC CAGGTCGAGCGCTGGCTCCGCAAGTTCGCTCTTCAGCAGAAGGTGCCGTTCCAGCAGCTCGATCTGCATATCAGTCCGAC TGTGCTCGAACCGATGCGCAACAGCGATATGAAAACCGAGATGAAGTGGTTCCTGCAACATCTGGTTTTCGTCAGGATCA AGTCCGATGAAAGCCTGCGCAGCGACGATTTCCGCTTCTACAACCGGAAGACGGGTGCTGACATCACCGCCGAGTTTAAC TGA
Upstream 100 bases:
>100_bases AGAATTTATCAGAGGGCGCTTTCACCCCGGCAGGCCAGGTTTTCTGTAAGCCCGGCAGGCCGCTTTTGGGGCTAGGCAGC CCATAATCGTGAGTCATTGC
Downstream 100 bases:
>100_bases AAAAGAGAACCACAGCCTAATGGAACAGTATCATCAGATCAAGGAACAGATTATTGCATTTTCTTTACTGAGCGCCGACC AGCTCAAGGCCGATGCCCAG
Product: ribonuclease G
Products: NA
Alternate protein names: RNase G; Cytoplasmic axial filament protein [H]
Number of amino acids: Translated: 560; Mature: 560
Protein sequence:
>560_residues MKKNVKKQLLMNKIGDEIQVALVEEGRLAELIIERPESMRSIGDIYLGRVHKVVEGLKAAFVDIGQKSDGFLHFSDVGTT SEDYRALVEDDDNDENGGDEDDDENEGDDNAEAPAPPREAARPAGQQKSEQGQQSSGDAAERRQSYTQMIAQKLKPNDSI LVQVIKEPIGTKGSRLTSDITIAGRFMVLLPFGGGQIAVSRRVVSRKERGRLKKLVRSMLPEGFGAIIRTVAEDQDESLL KQDLEKLLAKWTQIEEKLQDAQPPQLIFKEDTIISSVLRDSLTTDVTEIVANSKSIYTETLNYIQWAAPDMVKNVSLYEG KLPLFEGYGIAKDVESIFSRKVWLKSGGYIIIEHTEAMVVVDVNSGRYAAKREQEENSLKTNLEAAREVVRQLRLRDIGG IIVVDFIDMMDPKNSKKVYDAMKAELRNDRAKSNILPLSDFGIMQITRERIRPSLMQRMGDQCPACGGTGVVQARFTTIN QVERWLRKFALQQKVPFQQLDLHISPTVLEPMRNSDMKTEMKWFLQHLVFVRIKSDESLRSDDFRFYNRKTGADITAEFN
Sequences:
>Translated_560_residues MKKNVKKQLLMNKIGDEIQVALVEEGRLAELIIERPESMRSIGDIYLGRVHKVVEGLKAAFVDIGQKSDGFLHFSDVGTT SEDYRALVEDDDNDENGGDEDDDENEGDDNAEAPAPPREAARPAGQQKSEQGQQSSGDAAERRQSYTQMIAQKLKPNDSI LVQVIKEPIGTKGSRLTSDITIAGRFMVLLPFGGGQIAVSRRVVSRKERGRLKKLVRSMLPEGFGAIIRTVAEDQDESLL KQDLEKLLAKWTQIEEKLQDAQPPQLIFKEDTIISSVLRDSLTTDVTEIVANSKSIYTETLNYIQWAAPDMVKNVSLYEG KLPLFEGYGIAKDVESIFSRKVWLKSGGYIIIEHTEAMVVVDVNSGRYAAKREQEENSLKTNLEAAREVVRQLRLRDIGG IIVVDFIDMMDPKNSKKVYDAMKAELRNDRAKSNILPLSDFGIMQITRERIRPSLMQRMGDQCPACGGTGVVQARFTTIN QVERWLRKFALQQKVPFQQLDLHISPTVLEPMRNSDMKTEMKWFLQHLVFVRIKSDESLRSDDFRFYNRKTGADITAEFN >Mature_560_residues MKKNVKKQLLMNKIGDEIQVALVEEGRLAELIIERPESMRSIGDIYLGRVHKVVEGLKAAFVDIGQKSDGFLHFSDVGTT SEDYRALVEDDDNDENGGDEDDDENEGDDNAEAPAPPREAARPAGQQKSEQGQQSSGDAAERRQSYTQMIAQKLKPNDSI LVQVIKEPIGTKGSRLTSDITIAGRFMVLLPFGGGQIAVSRRVVSRKERGRLKKLVRSMLPEGFGAIIRTVAEDQDESLL KQDLEKLLAKWTQIEEKLQDAQPPQLIFKEDTIISSVLRDSLTTDVTEIVANSKSIYTETLNYIQWAAPDMVKNVSLYEG KLPLFEGYGIAKDVESIFSRKVWLKSGGYIIIEHTEAMVVVDVNSGRYAAKREQEENSLKTNLEAAREVVRQLRLRDIGG IIVVDFIDMMDPKNSKKVYDAMKAELRNDRAKSNILPLSDFGIMQITRERIRPSLMQRMGDQCPACGGTGVVQARFTTIN QVERWLRKFALQQKVPFQQLDLHISPTVLEPMRNSDMKTEMKWFLQHLVFVRIKSDESLRSDDFRFYNRKTGADITAEFN
Specific function: Involved in the processing of the 5'-end of 16S rRNA. Could be involved in chromosome segregation and cell division. It may be one of the components of the cytoplasmic axial filaments bundles or merely regulate the formation of this structure [H]
COG id: COG1530
COG function: function code J; Ribonucleases G and E
Gene ontology:
Cell location: Cytoplasm, cytoskeleton [H]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 S1 motif domain [H]
Homologues:
Organism=Escherichia coli, GI87082235, Length=529, Percent_Identity=31.758034026465, Blast_Score=256, Evalue=2e-69, Organism=Escherichia coli, GI1787325, Length=322, Percent_Identity=38.1987577639752, Blast_Score=230, Evalue=2e-61,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR012340 - InterPro: IPR016027 - InterPro: IPR003029 - InterPro: IPR019307 - InterPro: IPR022967 - InterPro: IPR004659 [H]
Pfam domain/function: PF10150 RNase_E_G; PF00575 S1 [H]
EC number: 3.1.4.- [C]
Molecular weight: Translated: 63234; Mature: 63234
Theoretical pI: Translated: 5.41; Mature: 5.41
Prosite motif: PS50126 S1
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.4 %Cys (Translated Protein) 3.0 %Met (Translated Protein) 3.4 %Cys+Met (Translated Protein) 0.4 %Cys (Mature Protein) 3.0 %Met (Mature Protein) 3.4 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MKKNVKKQLLMNKIGDEIQVALVEEGRLAELIIERPESMRSIGDIYLGRVHKVVEGLKAA CCCHHHHHHHHHHCCCCEEEEEECCCCHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHH FVDIGQKSDGFLHFSDVGTTSEDYRALVEDDDNDENGGDEDDDENEGDDNAEAPAPPREA HHHCCCCCCCEEEECCCCCCHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHH ARPAGQQKSEQGQQSSGDAAERRQSYTQMIAQKLKPNDSILVQVIKEPIGTKGSRLTSDI CCCCCCCHHHHCCCCCCHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHCCCCCCCCCCCE TIAGRFMVLLPFGGGQIAVSRRVVSRKERGRLKKLVRSMLPEGFGAIIRTVAEDQDESLL EEECEEEEEEECCCCEEHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHCCHHHHHH KQDLEKLLAKWTQIEEKLQDAQPPQLIFKEDTIISSVLRDSLTTDVTEIVANSKSIYTET HHHHHHHHHHHHHHHHHHHCCCCCCEEECHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHH LNYIQWAAPDMVKNVSLYEGKLPLFEGYGIAKDVESIFSRKVWLKSGGYIIIEHTEAMVV HHHHHHCCHHHHHCCHHHCCCCCCCCCCCHHHHHHHHHHHHHEEECCCEEEEEECCEEEE VDVNSGRYAAKREQEENSLKTNLEAAREVVRQLRLRDIGGIIVVDFIDMMDPKNSKKVYD EECCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCEEEEEHHHHCCCCCHHHHHH AMKAELRNDRAKSNILPLSDFGIMQITRERIRPSLMQRMGDQCPACGGTGVVQARFTTIN HHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHCCCCCCCCCCCEEEEHHHHHH QVERWLRKFALQQKVPFQQLDLHISPTVLEPMRNSDMKTEMKWFLQHLVFVRIKSDESLR HHHHHHHHHHHHHCCCHHHHCEECCCHHHHHHCCCCHHHHHHHHHHHHHEEEECCCCCCC SDDFRFYNRKTGADITAEFN CCCHHHHCCCCCCCEEEECC >Mature Secondary Structure MKKNVKKQLLMNKIGDEIQVALVEEGRLAELIIERPESMRSIGDIYLGRVHKVVEGLKAA CCCHHHHHHHHHHCCCCEEEEEECCCCHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHH FVDIGQKSDGFLHFSDVGTTSEDYRALVEDDDNDENGGDEDDDENEGDDNAEAPAPPREA HHHCCCCCCCEEEECCCCCCHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHH ARPAGQQKSEQGQQSSGDAAERRQSYTQMIAQKLKPNDSILVQVIKEPIGTKGSRLTSDI CCCCCCCHHHHCCCCCCHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHCCCCCCCCCCCE TIAGRFMVLLPFGGGQIAVSRRVVSRKERGRLKKLVRSMLPEGFGAIIRTVAEDQDESLL EEECEEEEEEECCCCEEHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHCCHHHHHH KQDLEKLLAKWTQIEEKLQDAQPPQLIFKEDTIISSVLRDSLTTDVTEIVANSKSIYTET HHHHHHHHHHHHHHHHHHHCCCCCCEEECHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHH LNYIQWAAPDMVKNVSLYEGKLPLFEGYGIAKDVESIFSRKVWLKSGGYIIIEHTEAMVV HHHHHHCCHHHHHCCHHHCCCCCCCCCCCHHHHHHHHHHHHHEEECCCEEEEEECCEEEE VDVNSGRYAAKREQEENSLKTNLEAAREVVRQLRLRDIGGIIVVDFIDMMDPKNSKKVYD EECCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCEEEEEHHHHCCCCCHHHHHH AMKAELRNDRAKSNILPLSDFGIMQITRERIRPSLMQRMGDQCPACGGTGVVQARFTTIN HHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHCCCCCCCCCCCEEEEHHHHHH QVERWLRKFALQQKVPFQQLDLHISPTVLEPMRNSDMKTEMKWFLQHLVFVRIKSDESLR HHHHHHHHHHHHHCCCHHHHCEECCCHHHHHHCCCCHHHHHHHHHHHHHEEEECCCCCCC SDDFRFYNRKTGADITAEFN CCCHHHHCCCCCCCEEEECC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 7542800 [H]