Definition Chlorobium tepidum TLS, complete genome.
Accession NC_002932
Length 2,154,946

Click here to switch to the map view.

The map label for this gene is cafA [H]

Identifier: 21675068

GI number: 21675068

Start: 2124011

End: 2125693

Strand: Reverse

Name: cafA [H]

Synonym: CT2260

Alternate gene names: 21675068

Gene position: 2125693-2124011 (Counterclockwise)

Preceding gene: 21675072

Following gene: 21675067

Centisome position: 98.64

GC content: 58.59

Gene sequence:

>1683_bases
ATGAAGAAGAATGTGAAGAAACAGCTCCTGATGAACAAGATCGGAGATGAAATTCAGGTTGCGCTTGTCGAGGAGGGGCG
GCTTGCCGAGCTGATTATCGAGCGGCCGGAGAGCATGAGGAGTATCGGCGATATTTATCTGGGCAGGGTGCACAAGGTGG
TTGAGGGACTGAAGGCGGCCTTTGTCGATATTGGCCAGAAGTCCGATGGGTTCCTCCACTTTTCGGATGTCGGTACCACC
AGCGAGGATTACCGCGCACTTGTCGAGGATGACGATAATGACGAGAATGGCGGTGACGAGGATGATGATGAAAACGAAGG
CGATGATAACGCCGAAGCGCCCGCGCCGCCGCGAGAGGCGGCCCGTCCCGCTGGACAGCAGAAGAGCGAGCAAGGGCAGC
AGTCGTCCGGCGACGCCGCCGAAAGGCGTCAGTCCTACACCCAGATGATCGCCCAGAAGCTCAAGCCGAACGATTCAATT
CTCGTGCAGGTCATCAAGGAGCCGATCGGTACCAAGGGGTCCCGCCTCACCTCCGACATCACCATTGCCGGGCGCTTCAT
GGTGCTGCTGCCGTTCGGCGGCGGCCAGATCGCCGTTTCGCGCCGCGTGGTGTCGCGCAAGGAGCGGGGCCGCCTCAAAA
AGCTTGTCCGCTCGATGTTGCCCGAAGGGTTCGGCGCGATCATCCGCACGGTGGCCGAGGATCAGGATGAGTCGCTCCTG
AAGCAAGATCTCGAAAAGCTTCTGGCCAAGTGGACACAGATCGAGGAGAAGTTGCAGGACGCGCAGCCTCCTCAGCTCAT
CTTCAAGGAGGACACCATCATTTCGAGCGTGCTGCGTGATTCGCTCACCACCGATGTGACCGAAATCGTGGCCAACTCGA
AATCGATTTATACCGAGACGCTCAACTATATCCAGTGGGCCGCGCCCGACATGGTCAAGAATGTCTCGCTCTACGAGGGC
AAGCTGCCGCTCTTCGAGGGTTACGGCATCGCCAAGGATGTAGAGTCGATCTTTTCGCGCAAGGTGTGGCTCAAGTCGGG
CGGCTACATCATCATCGAACACACCGAGGCGATGGTGGTCGTGGATGTCAACAGCGGGCGCTACGCCGCCAAGCGCGAAC
AGGAGGAGAACTCGCTCAAGACCAACCTCGAAGCTGCCCGCGAGGTCGTGCGCCAGCTCAGGTTGCGCGACATCGGTGGT
ATCATCGTGGTGGACTTCATCGACATGATGGATCCGAAAAACTCCAAAAAGGTGTACGACGCCATGAAGGCCGAACTGCG
TAACGATCGCGCCAAGTCGAACATTCTGCCGCTTTCAGACTTCGGCATCATGCAGATTACCCGCGAGCGCATCCGCCCGA
GCCTCATGCAGCGCATGGGCGACCAGTGCCCCGCCTGCGGCGGCACCGGCGTGGTGCAGGCGCGCTTTACCACCATCAAC
CAGGTCGAGCGCTGGCTCCGCAAGTTCGCTCTTCAGCAGAAGGTGCCGTTCCAGCAGCTCGATCTGCATATCAGTCCGAC
TGTGCTCGAACCGATGCGCAACAGCGATATGAAAACCGAGATGAAGTGGTTCCTGCAACATCTGGTTTTCGTCAGGATCA
AGTCCGATGAAAGCCTGCGCAGCGACGATTTCCGCTTCTACAACCGGAAGACGGGTGCTGACATCACCGCCGAGTTTAAC
TGA

Upstream 100 bases:

>100_bases
AGAATTTATCAGAGGGCGCTTTCACCCCGGCAGGCCAGGTTTTCTGTAAGCCCGGCAGGCCGCTTTTGGGGCTAGGCAGC
CCATAATCGTGAGTCATTGC

Downstream 100 bases:

>100_bases
AAAAGAGAACCACAGCCTAATGGAACAGTATCATCAGATCAAGGAACAGATTATTGCATTTTCTTTACTGAGCGCCGACC
AGCTCAAGGCCGATGCCCAG

Product: ribonuclease G

Products: NA

Alternate protein names: RNase G; Cytoplasmic axial filament protein [H]

Number of amino acids: Translated: 560; Mature: 560

Protein sequence:

>560_residues
MKKNVKKQLLMNKIGDEIQVALVEEGRLAELIIERPESMRSIGDIYLGRVHKVVEGLKAAFVDIGQKSDGFLHFSDVGTT
SEDYRALVEDDDNDENGGDEDDDENEGDDNAEAPAPPREAARPAGQQKSEQGQQSSGDAAERRQSYTQMIAQKLKPNDSI
LVQVIKEPIGTKGSRLTSDITIAGRFMVLLPFGGGQIAVSRRVVSRKERGRLKKLVRSMLPEGFGAIIRTVAEDQDESLL
KQDLEKLLAKWTQIEEKLQDAQPPQLIFKEDTIISSVLRDSLTTDVTEIVANSKSIYTETLNYIQWAAPDMVKNVSLYEG
KLPLFEGYGIAKDVESIFSRKVWLKSGGYIIIEHTEAMVVVDVNSGRYAAKREQEENSLKTNLEAAREVVRQLRLRDIGG
IIVVDFIDMMDPKNSKKVYDAMKAELRNDRAKSNILPLSDFGIMQITRERIRPSLMQRMGDQCPACGGTGVVQARFTTIN
QVERWLRKFALQQKVPFQQLDLHISPTVLEPMRNSDMKTEMKWFLQHLVFVRIKSDESLRSDDFRFYNRKTGADITAEFN

Sequences:

>Translated_560_residues
MKKNVKKQLLMNKIGDEIQVALVEEGRLAELIIERPESMRSIGDIYLGRVHKVVEGLKAAFVDIGQKSDGFLHFSDVGTT
SEDYRALVEDDDNDENGGDEDDDENEGDDNAEAPAPPREAARPAGQQKSEQGQQSSGDAAERRQSYTQMIAQKLKPNDSI
LVQVIKEPIGTKGSRLTSDITIAGRFMVLLPFGGGQIAVSRRVVSRKERGRLKKLVRSMLPEGFGAIIRTVAEDQDESLL
KQDLEKLLAKWTQIEEKLQDAQPPQLIFKEDTIISSVLRDSLTTDVTEIVANSKSIYTETLNYIQWAAPDMVKNVSLYEG
KLPLFEGYGIAKDVESIFSRKVWLKSGGYIIIEHTEAMVVVDVNSGRYAAKREQEENSLKTNLEAAREVVRQLRLRDIGG
IIVVDFIDMMDPKNSKKVYDAMKAELRNDRAKSNILPLSDFGIMQITRERIRPSLMQRMGDQCPACGGTGVVQARFTTIN
QVERWLRKFALQQKVPFQQLDLHISPTVLEPMRNSDMKTEMKWFLQHLVFVRIKSDESLRSDDFRFYNRKTGADITAEFN
>Mature_560_residues
MKKNVKKQLLMNKIGDEIQVALVEEGRLAELIIERPESMRSIGDIYLGRVHKVVEGLKAAFVDIGQKSDGFLHFSDVGTT
SEDYRALVEDDDNDENGGDEDDDENEGDDNAEAPAPPREAARPAGQQKSEQGQQSSGDAAERRQSYTQMIAQKLKPNDSI
LVQVIKEPIGTKGSRLTSDITIAGRFMVLLPFGGGQIAVSRRVVSRKERGRLKKLVRSMLPEGFGAIIRTVAEDQDESLL
KQDLEKLLAKWTQIEEKLQDAQPPQLIFKEDTIISSVLRDSLTTDVTEIVANSKSIYTETLNYIQWAAPDMVKNVSLYEG
KLPLFEGYGIAKDVESIFSRKVWLKSGGYIIIEHTEAMVVVDVNSGRYAAKREQEENSLKTNLEAAREVVRQLRLRDIGG
IIVVDFIDMMDPKNSKKVYDAMKAELRNDRAKSNILPLSDFGIMQITRERIRPSLMQRMGDQCPACGGTGVVQARFTTIN
QVERWLRKFALQQKVPFQQLDLHISPTVLEPMRNSDMKTEMKWFLQHLVFVRIKSDESLRSDDFRFYNRKTGADITAEFN

Specific function: Involved in the processing of the 5'-end of 16S rRNA. Could be involved in chromosome segregation and cell division. It may be one of the components of the cytoplasmic axial filaments bundles or merely regulate the formation of this structure [H]

COG id: COG1530

COG function: function code J; Ribonucleases G and E

Gene ontology:

Cell location: Cytoplasm, cytoskeleton [H]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 S1 motif domain [H]

Homologues:

Organism=Escherichia coli, GI87082235, Length=529, Percent_Identity=31.758034026465, Blast_Score=256, Evalue=2e-69,
Organism=Escherichia coli, GI1787325, Length=322, Percent_Identity=38.1987577639752, Blast_Score=230, Evalue=2e-61,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR012340
- InterPro:   IPR016027
- InterPro:   IPR003029
- InterPro:   IPR019307
- InterPro:   IPR022967
- InterPro:   IPR004659 [H]

Pfam domain/function: PF10150 RNase_E_G; PF00575 S1 [H]

EC number: 3.1.4.- [C]

Molecular weight: Translated: 63234; Mature: 63234

Theoretical pI: Translated: 5.41; Mature: 5.41

Prosite motif: PS50126 S1

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.4 %Cys     (Translated Protein)
3.0 %Met     (Translated Protein)
3.4 %Cys+Met (Translated Protein)
0.4 %Cys     (Mature Protein)
3.0 %Met     (Mature Protein)
3.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKKNVKKQLLMNKIGDEIQVALVEEGRLAELIIERPESMRSIGDIYLGRVHKVVEGLKAA
CCCHHHHHHHHHHCCCCEEEEEECCCCHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHH
FVDIGQKSDGFLHFSDVGTTSEDYRALVEDDDNDENGGDEDDDENEGDDNAEAPAPPREA
HHHCCCCCCCEEEECCCCCCHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHH
ARPAGQQKSEQGQQSSGDAAERRQSYTQMIAQKLKPNDSILVQVIKEPIGTKGSRLTSDI
CCCCCCCHHHHCCCCCCHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHCCCCCCCCCCCE
TIAGRFMVLLPFGGGQIAVSRRVVSRKERGRLKKLVRSMLPEGFGAIIRTVAEDQDESLL
EEECEEEEEEECCCCEEHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHCCHHHHHH
KQDLEKLLAKWTQIEEKLQDAQPPQLIFKEDTIISSVLRDSLTTDVTEIVANSKSIYTET
HHHHHHHHHHHHHHHHHHHCCCCCCEEECHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHH
LNYIQWAAPDMVKNVSLYEGKLPLFEGYGIAKDVESIFSRKVWLKSGGYIIIEHTEAMVV
HHHHHHCCHHHHHCCHHHCCCCCCCCCCCHHHHHHHHHHHHHEEECCCEEEEEECCEEEE
VDVNSGRYAAKREQEENSLKTNLEAAREVVRQLRLRDIGGIIVVDFIDMMDPKNSKKVYD
EECCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCEEEEEHHHHCCCCCHHHHHH
AMKAELRNDRAKSNILPLSDFGIMQITRERIRPSLMQRMGDQCPACGGTGVVQARFTTIN
HHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHCCCCCCCCCCCEEEEHHHHHH
QVERWLRKFALQQKVPFQQLDLHISPTVLEPMRNSDMKTEMKWFLQHLVFVRIKSDESLR
HHHHHHHHHHHHHCCCHHHHCEECCCHHHHHHCCCCHHHHHHHHHHHHHEEEECCCCCCC
SDDFRFYNRKTGADITAEFN
CCCHHHHCCCCCCCEEEECC
>Mature Secondary Structure
MKKNVKKQLLMNKIGDEIQVALVEEGRLAELIIERPESMRSIGDIYLGRVHKVVEGLKAA
CCCHHHHHHHHHHCCCCEEEEEECCCCHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHH
FVDIGQKSDGFLHFSDVGTTSEDYRALVEDDDNDENGGDEDDDENEGDDNAEAPAPPREA
HHHCCCCCCCEEEECCCCCCHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHH
ARPAGQQKSEQGQQSSGDAAERRQSYTQMIAQKLKPNDSILVQVIKEPIGTKGSRLTSDI
CCCCCCCHHHHCCCCCCHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHCCCCCCCCCCCE
TIAGRFMVLLPFGGGQIAVSRRVVSRKERGRLKKLVRSMLPEGFGAIIRTVAEDQDESLL
EEECEEEEEEECCCCEEHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHCCHHHHHH
KQDLEKLLAKWTQIEEKLQDAQPPQLIFKEDTIISSVLRDSLTTDVTEIVANSKSIYTET
HHHHHHHHHHHHHHHHHHHCCCCCCEEECHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHH
LNYIQWAAPDMVKNVSLYEGKLPLFEGYGIAKDVESIFSRKVWLKSGGYIIIEHTEAMVV
HHHHHHCCHHHHHCCHHHCCCCCCCCCCCHHHHHHHHHHHHHEEECCCEEEEEECCEEEE
VDVNSGRYAAKREQEENSLKTNLEAAREVVRQLRLRDIGGIIVVDFIDMMDPKNSKKVYD
EECCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCEEEEEHHHHCCCCCHHHHHH
AMKAELRNDRAKSNILPLSDFGIMQITRERIRPSLMQRMGDQCPACGGTGVVQARFTTIN
HHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHCCCCCCCCCCCEEEEHHHHHH
QVERWLRKFALQQKVPFQQLDLHISPTVLEPMRNSDMKTEMKWFLQHLVFVRIKSDESLR
HHHHHHHHHHHHHCCCHHHHCEECCCHHHHHHCCCCHHHHHHHHHHHHHEEEECCCCCCC
SDDFRFYNRKTGADITAEFN
CCCHHHHCCCCCCCEEEECC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 7542800 [H]