| Definition | Thermoanaerobacter tengcongensis MB4, complete genome. |
|---|---|
| Accession | NC_003869 |
| Length | 2,689,445 |
Click here to switch to the map view.
The map label for this gene is ProS
Identifier: 20808685
GI number: 20808685
Start: 2199753
End: 2201474
Strand: Reverse
Name: ProS
Synonym: TTE2319
Alternate gene names: 20808685
Gene position: 2201474-2199753 (Counterclockwise)
Preceding gene: 20808686
Following gene: 20808684
Centisome position: 81.86
GC content: 40.3
Gene sequence:
>1722_bases GTGAGACTGTCACAGTTACTAATGCCAACTTTAAGAGAAGTTCCTGCTGATGCTGAAATTCCAAGCCATGTCCTTATGTT AAAAGCAGGATTGATGAGGAAATTAGCAGCTGGAATATATGTGTATCTGCCTTTAGGAAAAAGAGTACTAAAAAAAGTGG AAGAGATAGTTAGAGAAGAAATGGACAGAGAAGGAAGTCAGGAAGTCTTGATGTCTGCTTTGATTCCTGCAGAGCTTTTT AAGGAAACGGGAAGATGGGATGTGTTTGGACCCGAAATGTTTAAGCTTAAAGACAGAAATGAGAGAGATTTTTGTTTGGG ACCAACTCACGAAGAAGTCTTTACAGACCTTGTAAGAAATGAAGTGAAATCATATAGACAGCTTCCCCTCATACTTTACC AGATTCAAACTAAATTTAGAGACGAGAGGCGTCCGCGCTTTGGTGTGATGAGGAGCAGAGAGTTTATAATGAAGGACGCT TACAGCTTTGATGCTGATTGGGAAGGACTAGACGAATCTTTTAATAAAATGTACAGGGCGTACTGCAGAATATTTGACAG GTGTGGTCTTAAATATCTGGTGGTGGAAGCCGACCCTGGAGCCATGGGAGGAAGAGATTCAAAAGAATTCATGGTGATAT CCAGTGTTGGAGAAGCGGTGATAGCTTACTGCGACAGCTGTGGATACGCTGCCAATGAGGAGAAGGCCGAGTGTTTAATA GAAAGTCGGGATGAGGAGATGCTTGAGATTGAAAAAGTTTATACTCCCAATGTCAAGACTATAGAAGAACTGGTAGACTT CTTAAAAATTTCTCCTAGCAAATTTGTAAAAACTCTCATATACAAAGCAAAAGGCAAAGTTGTAGCAGCTTTGGTTAGAG GCGATAGAGATATAAACGAGACAAAGCTTTTGAATGTTTTGAGCATAAGGGAAGAGGAACTGGAATTGGCTGATGGAGCT TTAGTGGAAGAAGTCACAGGGGCGAAGGTGGGCTTTGCTGGTCCCTTGGGATTGAAAGGAGAAGTGACTTTAGTTGTAGA CAGCGAAATACCACAGTTGAGGAACTTTATCGTGGGAGCCAACGAGACAGATTACCACATAAAAAATGTAAATTATGGCA GAGATTTTAAAGGCGATATCGTAGCAGATATTAAAAGCGTCGTAGAAGGAGATAGGTGCCCAAGGTGTGGTGCTCCTCTT AAAATTGCTAGAGGAATTGAGGTTGGTCATATTTTTAAGCTAGGCACAAAGTACAGCGAGGCGCTAGGAGCTACTTACAC AGATGAGGAAGGGAATGAAAAGCCAATTGTAATGGGATGCTACGGCATTGGAATTAACAGAACTGTAGCTGCAATTATAG AACAGCACCACGATGAAAAAGGCATAATATGGCCTATGAGTGTAGCGCCTTATCATGTCATTGTAGTACCTGTGAATGTA TCAGATGAAGAGCAAAAACAGATTGCAGAAAAGATATACAATAAGTTGCTTGAAGAGAAATTAGAGGTTTTGATTGATGA CAGGGATGTAAGAGCTGGCGTTAAATTTAATGACGCAGATTTGATAGGAATACCTGTAAGAGTAACTATAGGCAAAAAGG TAAAAGAAGGAATTGTTGAAATAAAATTAAGAGAAAGAGAAGAAGTGGAAGAAGTAAAGGTGGAAGAGGTGGTAAAAAGA GTAAAACAAATTGTAGAGGAGAAGTTGAGAGAGCTCTCATGA
Upstream 100 bases:
>100_bases AGGCTTATGCTGTAGTATTACTGGAGGAAAGGTATTGACATATAACCTGCCGTAAAATACAATCTACTTAAAAAATCTCG TACATAGGAGGGTAAAGAGA
Downstream 100 bases:
>100_bases GCTCTTTTTTGCATAAAATTCTTTTACAGTGAAAAAATATTTGTTAAAAGATTGATAAAAATGGGGTGAAGGTTGTGTCA TTGTACATCGTAGGGATAAG
Product: prolyl-tRNA synthetase
Products: NA
Alternate protein names: Proline--tRNA ligase; ProRS
Number of amino acids: Translated: 573; Mature: 573
Protein sequence:
>573_residues MRLSQLLMPTLREVPADAEIPSHVLMLKAGLMRKLAAGIYVYLPLGKRVLKKVEEIVREEMDREGSQEVLMSALIPAELF KETGRWDVFGPEMFKLKDRNERDFCLGPTHEEVFTDLVRNEVKSYRQLPLILYQIQTKFRDERRPRFGVMRSREFIMKDA YSFDADWEGLDESFNKMYRAYCRIFDRCGLKYLVVEADPGAMGGRDSKEFMVISSVGEAVIAYCDSCGYAANEEKAECLI ESRDEEMLEIEKVYTPNVKTIEELVDFLKISPSKFVKTLIYKAKGKVVAALVRGDRDINETKLLNVLSIREEELELADGA LVEEVTGAKVGFAGPLGLKGEVTLVVDSEIPQLRNFIVGANETDYHIKNVNYGRDFKGDIVADIKSVVEGDRCPRCGAPL KIARGIEVGHIFKLGTKYSEALGATYTDEEGNEKPIVMGCYGIGINRTVAAIIEQHHDEKGIIWPMSVAPYHVIVVPVNV SDEEQKQIAEKIYNKLLEEKLEVLIDDRDVRAGVKFNDADLIGIPVRVTIGKKVKEGIVEIKLREREEVEEVKVEEVVKR VKQIVEEKLRELS
Sequences:
>Translated_573_residues MRLSQLLMPTLREVPADAEIPSHVLMLKAGLMRKLAAGIYVYLPLGKRVLKKVEEIVREEMDREGSQEVLMSALIPAELF KETGRWDVFGPEMFKLKDRNERDFCLGPTHEEVFTDLVRNEVKSYRQLPLILYQIQTKFRDERRPRFGVMRSREFIMKDA YSFDADWEGLDESFNKMYRAYCRIFDRCGLKYLVVEADPGAMGGRDSKEFMVISSVGEAVIAYCDSCGYAANEEKAECLI ESRDEEMLEIEKVYTPNVKTIEELVDFLKISPSKFVKTLIYKAKGKVVAALVRGDRDINETKLLNVLSIREEELELADGA LVEEVTGAKVGFAGPLGLKGEVTLVVDSEIPQLRNFIVGANETDYHIKNVNYGRDFKGDIVADIKSVVEGDRCPRCGAPL KIARGIEVGHIFKLGTKYSEALGATYTDEEGNEKPIVMGCYGIGINRTVAAIIEQHHDEKGIIWPMSVAPYHVIVVPVNV SDEEQKQIAEKIYNKLLEEKLEVLIDDRDVRAGVKFNDADLIGIPVRVTIGKKVKEGIVEIKLREREEVEEVKVEEVVKR VKQIVEEKLRELS >Mature_573_residues MRLSQLLMPTLREVPADAEIPSHVLMLKAGLMRKLAAGIYVYLPLGKRVLKKVEEIVREEMDREGSQEVLMSALIPAELF KETGRWDVFGPEMFKLKDRNERDFCLGPTHEEVFTDLVRNEVKSYRQLPLILYQIQTKFRDERRPRFGVMRSREFIMKDA YSFDADWEGLDESFNKMYRAYCRIFDRCGLKYLVVEADPGAMGGRDSKEFMVISSVGEAVIAYCDSCGYAANEEKAECLI ESRDEEMLEIEKVYTPNVKTIEELVDFLKISPSKFVKTLIYKAKGKVVAALVRGDRDINETKLLNVLSIREEELELADGA LVEEVTGAKVGFAGPLGLKGEVTLVVDSEIPQLRNFIVGANETDYHIKNVNYGRDFKGDIVADIKSVVEGDRCPRCGAPL KIARGIEVGHIFKLGTKYSEALGATYTDEEGNEKPIVMGCYGIGINRTVAAIIEQHHDEKGIIWPMSVAPYHVIVVPVNV SDEEQKQIAEKIYNKLLEEKLEVLIDDRDVRAGVKFNDADLIGIPVRVTIGKKVKEGIVEIKLREREEVEEVKVEEVVKR VKQIVEEKLRELS
Specific function: Catalyzes the attachment of proline to tRNA(Pro) in a two-step reaction:proline is first activated by ATP to form Pro- AMP and then transferred to the acceptor end of tRNA(Pro). As ProRS can inadvertently accommodate and process non-cognate amino acids su
COG id: COG0442
COG function: function code J; Prolyl-tRNA synthetase
Gene ontology:
Cell location: Cytoplasm
Metaboloic importance: Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the class-II aminoacyl-tRNA synthetase family. ProS type 1 subfamily
Homologues:
Organism=Homo sapiens, GI34303926, Length=252, Percent_Identity=40.0793650793651, Blast_Score=208, Evalue=9e-54, Organism=Escherichia coli, GI1786392, Length=573, Percent_Identity=48.8656195462478, Blast_Score=526, Evalue=1e-150, Organism=Caenorhabditis elegans, GI115532348, Length=303, Percent_Identity=33.6633663366337, Blast_Score=165, Evalue=6e-41, Organism=Caenorhabditis elegans, GI71991342, Length=172, Percent_Identity=29.0697674418605, Blast_Score=73, Evalue=5e-13, Organism=Caenorhabditis elegans, GI193203271, Length=85, Percent_Identity=34.1176470588235, Blast_Score=70, Evalue=3e-12, Organism=Saccharomyces cerevisiae, GI6320931, Length=540, Percent_Identity=32.037037037037, Blast_Score=236, Evalue=6e-63, Organism=Drosophila melanogaster, GI24656200, Length=214, Percent_Identity=39.7196261682243, Blast_Score=171, Evalue=1e-42,
Paralogues:
None
Copy number: 800 Molecules/Cell In: Growth-Phase, Minimal-Media (Based on E. coli). [C]
Swissprot (AC and ID): SYP_THETN (Q8R7S9)
Other databases:
- EMBL: AE008691 - RefSeq: NP_623856.1 - HSSP: Q58635 - ProteinModelPortal: Q8R7S9 - SMR: Q8R7S9 - GeneID: 997686 - GenomeReviews: AE008691_GR - KEGG: tte:TTE2319 - NMPDR: fig|273068.3.peg.2497 - HOGENOM: HBG403504 - OMA: DFVLGPT - ProtClustDB: PRK09194 - BioCyc: TTEN273068:TTE2319-MONOMER - BRENDA: 6.1.1.15 - GO: GO:0005737 - HAMAP: MF_01569 - InterPro: IPR002314 - InterPro: IPR006195 - InterPro: IPR004154 - InterPro: IPR002316 - InterPro: IPR004500 - InterPro: IPR007214 - Gene3D: G3DSA:3.40.50.800 - Gene3D: G3DSA:3.90.960.10 - PRINTS: PR01046 - TIGRFAMs: TIGR00409
Pfam domain/function: PF03129 HGTP_anticodon; PF00587 tRNA-synt_2b; PF04073 YbaK; SSF52954 Anticodon_bd; SSF55826 YbaK/aa-tRNA-synth-assoc-reg
EC number: =6.1.1.15
Molecular weight: Translated: 64921; Mature: 64921
Theoretical pI: Translated: 5.00; Mature: 5.00
Prosite motif: PS50862 AA_TRNA_LIGASE_II
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.6 %Cys (Translated Protein) 2.6 %Met (Translated Protein) 4.2 %Cys+Met (Translated Protein) 1.6 %Cys (Mature Protein) 2.6 %Met (Mature Protein) 4.2 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MRLSQLLMPTLREVPADAEIPSHVLMLKAGLMRKLAAGIYVYLPLGKRVLKKVEEIVREE CCHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHCCEEEEECCCHHHHHHHHHHHHHH MDREGSQEVLMSALIPAELFKETGRWDVFGPEMFKLKDRNERDFCLGPTHEEVFTDLVRN HCCCCHHHHHHHHHHHHHHHHCCCCCCCCCCCCEEECCCCCCCCCCCCCHHHHHHHHHHH EVKSYRQLPLILYQIQTKFRDERRPRFGVMRSREFIMKDAYSFDADWEGLDESFNKMYRA HHHHHHHCHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHH YCRIFDRCGLKYLVVEADPGAMGGRDSKEFMVISSVGEAVIAYCDSCGYAANEEKAECLI HHHHHHHCCCEEEEEECCCCCCCCCCCCCEEEEHHHHHHHHHHHHCCCCCCCCHHHHHHH ESRDEEMLEIEKVYTPNVKTIEELVDFLKISPSKFVKTLIYKAKGKVVAALVRGDRDINE HCCCHHHHHHHHHCCCCHHHHHHHHHHHHCCHHHHHHHHHHHHCCCEEEEEECCCCCCCH TKLLNVLSIREEELELADGALVEEVTGAKVGFAGPLGLKGEVTLVVDSEIPQLRNFIVGA HHHHHHHHHHHHHHHHHCCHHHHHHCCCCCCCCCCCCCCCEEEEEECCCCHHHHHHEECC NETDYHIKNVNYGRDFKGDIVADIKSVVEGDRCPRCGAPLKIARGIEVGHIFKLGTKYSE CCCCEEEECCCCCCCCCCHHHHHHHHHHCCCCCCCCCCCHHHHCCCCCHHHEECCCHHHH ALGATYTDEEGNEKPIVMGCYGIGINRTVAAIIEQHHDEKGIIWPMSVAPYHVIVVPVNV HHCCCCCCCCCCCCCEEEEEECCCHHHHHHHHHHHHCCCCCCEEEECCCCEEEEEEEECC SDEEQKQIAEKIYNKLLEEKLEVLIDDRDVRAGVKFNDADLIGIPVRVTIGKKVKEGIVE CCHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCEECCCCEEEEEEEEEECHHHHCCHHE IKLREREEVEEVKVEEVVKRVKQIVEEKLRELS EEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHCC >Mature Secondary Structure MRLSQLLMPTLREVPADAEIPSHVLMLKAGLMRKLAAGIYVYLPLGKRVLKKVEEIVREE CCHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHCCEEEEECCCHHHHHHHHHHHHHH MDREGSQEVLMSALIPAELFKETGRWDVFGPEMFKLKDRNERDFCLGPTHEEVFTDLVRN HCCCCHHHHHHHHHHHHHHHHCCCCCCCCCCCCEEECCCCCCCCCCCCCHHHHHHHHHHH EVKSYRQLPLILYQIQTKFRDERRPRFGVMRSREFIMKDAYSFDADWEGLDESFNKMYRA HHHHHHHCHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHH YCRIFDRCGLKYLVVEADPGAMGGRDSKEFMVISSVGEAVIAYCDSCGYAANEEKAECLI HHHHHHHCCCEEEEEECCCCCCCCCCCCCEEEEHHHHHHHHHHHHCCCCCCCCHHHHHHH ESRDEEMLEIEKVYTPNVKTIEELVDFLKISPSKFVKTLIYKAKGKVVAALVRGDRDINE HCCCHHHHHHHHHCCCCHHHHHHHHHHHHCCHHHHHHHHHHHHCCCEEEEEECCCCCCCH TKLLNVLSIREEELELADGALVEEVTGAKVGFAGPLGLKGEVTLVVDSEIPQLRNFIVGA HHHHHHHHHHHHHHHHHCCHHHHHHCCCCCCCCCCCCCCCEEEEEECCCCHHHHHHEECC NETDYHIKNVNYGRDFKGDIVADIKSVVEGDRCPRCGAPLKIARGIEVGHIFKLGTKYSE CCCCEEEECCCCCCCCCCHHHHHHHHHHCCCCCCCCCCCHHHHCCCCCHHHEECCCHHHH ALGATYTDEEGNEKPIVMGCYGIGINRTVAAIIEQHHDEKGIIWPMSVAPYHVIVVPVNV HHCCCCCCCCCCCCCEEEEEECCCHHHHHHHHHHHHCCCCCCEEEECCCCEEEEEEEECC SDEEQKQIAEKIYNKLLEEKLEVLIDDRDVRAGVKFNDADLIGIPVRVTIGKKVKEGIVE CCHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCEECCCCEEEEEEEEEECHHHHCCHHE IKLREREEVEEVKVEEVVKRVKQIVEEKLRELS EEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 11997336