| Definition | Thermoanaerobacter tengcongensis MB4, complete genome. |
|---|---|
| Accession | NC_003869 |
| Length | 2,689,445 |
Click here to switch to the map view.
The map label for this gene is CinA
Identifier: 20807822
GI number: 20807822
Start: 1357774
End: 1359012
Strand: Reverse
Name: CinA
Synonym: TTE1375
Alternate gene names: 20807822
Gene position: 1359012-1357774 (Counterclockwise)
Preceding gene: 20807823
Following gene: 20807821
Centisome position: 50.53
GC content: 41.24
Gene sequence:
>1239_bases ATGAGAGGAGAAATAATTTCTGTAGGCACAGAGCTTTTATTAGGGCAAATTGTAAATACAAATGCCAAGTATCTATCTGA AAGACTTGCCCTTTTGGGAATTGACATTTATTTTCACACAAACGTAGGGGACAATGAGGAGAGGCTCAAGCAGTGCCTTA AAATCGCCTATGAGAGGTCAGAGTTGATAATAACCACAGGAGGGCTAGGTCCCACTGTAGACGATATAACAAAAGAAACA ATTGCTTCATTTTTAAATCTTCCTCTTGTAGAAAGTGAGGAAGCAAAGCAAGAGATAATCAACTTTTTTGAAAGGATAGG ACAGAAGCCGACAGAAAACAATTTTAAGCAAGCTCTTTTCCCTGCAGGTTCAAAAATCCTTCCAAACAAGAATGGAACTG CTCCCGGCTTTATACTTGAAAAAGAAGGAAAAATCTTTGTGGTCCTTCCAGGACCTCCTTCCGAACTCATACCGATGTTC GAGGAACACGTCTATCCTTACCTAAAAAGATTTACCAGTGAAACAATAAAGTCGCGAGTTTTAAAGATATTTGGTTTAGG GGAATCAAAAGTGGAGGAAATGGTAAGACCCCTACTTCAAGGAAGTAACCCGACTGTGGCACCTCTTGTAGGAGATGGAT ATGTGACTTTGAGGATAACCGCAAAAGGAAAAGAAGAAGAGGTTTATGAGATGATAAGCCAAGTAGAGAAAAAAATAAGG GAGATTTTAGGGGAGTATATTTATGCTGTAGACGATGAAGAGATGGAAGAGATAGTGATTAAGTTACTTCAAAAGAGGGG ATTTACTCTGGCTACCGCAGAGTCCTGCACAGGAGGACTTCTGGCGAAAAAGATAACAGATGTACCTGGGGCTTCAAAAG TCTTCAATCTAGGAGTTGTGACATACAGCAATGAAGCAAAAGAAAAGGTGCTGGGAGTGAAAAAAAGCACATTAGATGCC CACGGCGCAGTAAGCCCTGAAACAGCAAAAGAAATGGCTGAAAATGTAAGAGTATTAGCGAAGTCCGATTTGGGCCTTTC TACCACGGGCATAGCAGGGCCCTCAGGAGGTAGCCCTGAGAAACCTGTAGGACTTGTATATGTGGGATTTGCAACTCCGG AAAAAACTTATGTCAAAAAATTAATGTTAAGCGGTAACAGAGACAGAATACGTACAAGGTCAATGCTTCACGCGTTTGAC ATGGTGAGGAGGTACCTTGAAGGAAGGCAAATTGATTAG
Upstream 100 bases:
>100_bases GATAATGGTGTATATAGCGCTAATTTTGACAATTTACTCGGGTGTGGACTACATTGTAAAATCAAAAGACCTTTTTAAGG ATTGAAAAAGAGGTGTTTGT
Downstream 100 bases:
>100_bases TATAATTATTTTAATACGGAGTATAAAATAATTAATTTGGTCAGGAGGTAAAAGGTTGATGATTGAAAAGCAAAAGGCTT TAGAAATGGCCATTAGTCAA
Product: competence damage-inducible protein A
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 412; Mature: 412
Protein sequence:
>412_residues MRGEIISVGTELLLGQIVNTNAKYLSERLALLGIDIYFHTNVGDNEERLKQCLKIAYERSELIITTGGLGPTVDDITKET IASFLNLPLVESEEAKQEIINFFERIGQKPTENNFKQALFPAGSKILPNKNGTAPGFILEKEGKIFVVLPGPPSELIPMF EEHVYPYLKRFTSETIKSRVLKIFGLGESKVEEMVRPLLQGSNPTVAPLVGDGYVTLRITAKGKEEEVYEMISQVEKKIR EILGEYIYAVDDEEMEEIVIKLLQKRGFTLATAESCTGGLLAKKITDVPGASKVFNLGVVTYSNEAKEKVLGVKKSTLDA HGAVSPETAKEMAENVRVLAKSDLGLSTTGIAGPSGGSPEKPVGLVYVGFATPEKTYVKKLMLSGNRDRIRTRSMLHAFD MVRRYLEGRQID
Sequences:
>Translated_412_residues MRGEIISVGTELLLGQIVNTNAKYLSERLALLGIDIYFHTNVGDNEERLKQCLKIAYERSELIITTGGLGPTVDDITKET IASFLNLPLVESEEAKQEIINFFERIGQKPTENNFKQALFPAGSKILPNKNGTAPGFILEKEGKIFVVLPGPPSELIPMF EEHVYPYLKRFTSETIKSRVLKIFGLGESKVEEMVRPLLQGSNPTVAPLVGDGYVTLRITAKGKEEEVYEMISQVEKKIR EILGEYIYAVDDEEMEEIVIKLLQKRGFTLATAESCTGGLLAKKITDVPGASKVFNLGVVTYSNEAKEKVLGVKKSTLDA HGAVSPETAKEMAENVRVLAKSDLGLSTTGIAGPSGGSPEKPVGLVYVGFATPEKTYVKKLMLSGNRDRIRTRSMLHAFD MVRRYLEGRQID >Mature_412_residues MRGEIISVGTELLLGQIVNTNAKYLSERLALLGIDIYFHTNVGDNEERLKQCLKIAYERSELIITTGGLGPTVDDITKET IASFLNLPLVESEEAKQEIINFFERIGQKPTENNFKQALFPAGSKILPNKNGTAPGFILEKEGKIFVVLPGPPSELIPMF EEHVYPYLKRFTSETIKSRVLKIFGLGESKVEEMVRPLLQGSNPTVAPLVGDGYVTLRITAKGKEEEVYEMISQVEKKIR EILGEYIYAVDDEEMEEIVIKLLQKRGFTLATAESCTGGLLAKKITDVPGASKVFNLGVVTYSNEAKEKVLGVKKSTLDA HGAVSPETAKEMAENVRVLAKSDLGLSTTGIAGPSGGSPEKPVGLVYVGFATPEKTYVKKLMLSGNRDRIRTRSMLHAFD MVRRYLEGRQID
Specific function: Unknown
COG id: COG1058
COG function: function code R; Predicted nucleotide-utilizing enzyme related to molybdopterin-biosynthesis enzyme MoeA
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the CinA family
Homologues:
Organism=Escherichia coli, GI1789052, Length=156, Percent_Identity=44.8717948717949, Blast_Score=135, Evalue=5e-33, Organism=Escherichia coli, GI1788583, Length=422, Percent_Identity=26.5402843601896, Blast_Score=125, Evalue=3e-30, Organism=Escherichia coli, GI1787818, Length=144, Percent_Identity=31.9444444444444, Blast_Score=84, Evalue=2e-17, Organism=Saccharomyces cerevisiae, GI6323832, Length=266, Percent_Identity=25.187969924812, Blast_Score=72, Evalue=1e-13,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): CINA_THETN (Q8RA54)
Other databases:
- EMBL: AE008691 - RefSeq: NP_622993.1 - ProteinModelPortal: Q8RA54 - GeneID: 996418 - GenomeReviews: AE008691_GR - KEGG: tte:TTE1375 - NMPDR: fig|273068.3.peg.1340 - HOGENOM: HBG449871 - OMA: NPTVAPY - ProtClustDB: PRK00549 - BioCyc: TTEN273068:TTE1375-MONOMER - HAMAP: MF_00226_B - InterPro: IPR008136 - InterPro: IPR008135 - InterPro: IPR001453 - Gene3D: G3DSA:3.40.980.10 - PIRSF: PIRSF006728 - SMART: SM00852 - TIGRFAMs: TIGR00199 - TIGRFAMs: TIGR00200
Pfam domain/function: PF02464 CinA; PF00994 MoCF_biosynth; SSF53218 MoCF_biosynth
EC number: NA
Molecular weight: Translated: 45446; Mature: 45446
Theoretical pI: Translated: 6.22; Mature: 6.22
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.5 %Cys (Translated Protein) 2.2 %Met (Translated Protein) 2.7 %Cys+Met (Translated Protein) 0.5 %Cys (Mature Protein) 2.2 %Met (Mature Protein) 2.7 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MRGEIISVGTELLLGQIVNTNAKYLSERLALLGIDIYFHTNVGDNEERLKQCLKIAYERS CCCCEEHHHHHHHHHHHHCCCHHHHHHHHHHEEEEEEEECCCCCCHHHHHHHHHHHHCCC ELIITTGGLGPTVDDITKETIASFLNLPLVESEEAKQEIINFFERIGQKPTENNFKQALF CEEEEECCCCCCHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHCCCCCCCCHHHHHC PAGSKILPNKNGTAPGFILEKEGKIFVVLPGPPSELIPMFEEHVYPYLKRFTSETIKSRV CCCCCCCCCCCCCCCCEEEECCCCEEEEECCCCHHHHHHHHHHHHHHHHHHHHHHHHHHH LKIFGLGESKVEEMVRPLLQGSNPTVAPLVGDGYVTLRITAKGKEEEVYEMISQVEKKIR HHHHCCCHHHHHHHHHHHHCCCCCCEEEEECCCEEEEEEEECCCHHHHHHHHHHHHHHHH EILGEYIYAVDDEEMEEIVIKLLQKRGFTLATAESCTGGLLAKKITDVPGASKVFNLGVV HHHHHHHHHCCHHHHHHHHHHHHHHCCCEEEECCCCCCHHHHHHHHCCCCCCCEEEEEEE TYSNEAKEKVLGVKKSTLDAHGAVSPETAKEMAENVRVLAKSDLGLSTTGIAGPSGGSPE EECCHHHHHHHCCHHHHCCCCCCCCHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCC KPVGLVYVGFATPEKTYVKKLMLSGNRDRIRTRSMLHAFDMVRRYLEGRQID CCEEEEEEEECCCHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHCCCCCC >Mature Secondary Structure MRGEIISVGTELLLGQIVNTNAKYLSERLALLGIDIYFHTNVGDNEERLKQCLKIAYERS CCCCEEHHHHHHHHHHHHCCCHHHHHHHHHHEEEEEEEECCCCCCHHHHHHHHHHHHCCC ELIITTGGLGPTVDDITKETIASFLNLPLVESEEAKQEIINFFERIGQKPTENNFKQALF CEEEEECCCCCCHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHCCCCCCCCHHHHHC PAGSKILPNKNGTAPGFILEKEGKIFVVLPGPPSELIPMFEEHVYPYLKRFTSETIKSRV CCCCCCCCCCCCCCCCEEEECCCCEEEEECCCCHHHHHHHHHHHHHHHHHHHHHHHHHHH LKIFGLGESKVEEMVRPLLQGSNPTVAPLVGDGYVTLRITAKGKEEEVYEMISQVEKKIR HHHHCCCHHHHHHHHHHHHCCCCCCEEEEECCCEEEEEEEECCCHHHHHHHHHHHHHHHH EILGEYIYAVDDEEMEEIVIKLLQKRGFTLATAESCTGGLLAKKITDVPGASKVFNLGVV HHHHHHHHHCCHHHHHHHHHHHHHHCCCEEEECCCCCCHHHHHHHHCCCCCCCEEEEEEE TYSNEAKEKVLGVKKSTLDAHGAVSPETAKEMAENVRVLAKSDLGLSTTGIAGPSGGSPE EECCHHHHHHHCCHHHHCCCCCCCCHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCC KPVGLVYVGFATPEKTYVKKLMLSGNRDRIRTRSMLHAFDMVRRYLEGRQID CCEEEEEEEECCCHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 11997336