Definition Thermoanaerobacter tengcongensis MB4, complete genome.
Accession NC_003869
Length 2,689,445

Click here to switch to the map view.

The map label for this gene is MetC [H]

Identifier: 20807811

GI number: 20807811

Start: 1346388

End: 1347656

Strand: Reverse

Name: MetC [H]

Synonym: TTE1364

Alternate gene names: 20807811

Gene position: 1347656-1346388 (Counterclockwise)

Preceding gene: 20807813

Following gene: 20807680

Centisome position: 50.11

GC content: 38.46

Gene sequence:

>1269_bases
ATGACATCGCAGGAATTTTTAAAAAACAACTTTAATATTCCGCCAAAAGTCATTGAATTGATAGAAAGCGCTGAAAAGAG
CTGTTTAGATATATTTAAAAAAATTGATGAAATAGTCGAGTACAACCAGTACAAAGTGATATACCATTTTCAAAAGAATA
AATTGAGCGATATTCACTTTAATGGAACCACAGGTTATGGATACGGCGATATTGGAAGAGATGTGATAGAAAAAATATAT
GCTGGCATTTTTGGAGCAGAAGACGCCTTAGTAAGGCCTCAAATCGTTTCTGGAACCCATGCCATATCAATTGTACTTTT
CGGCAATTTAAAACCAAATGAAGAGCTAATTTCGGCTTCTGGAAAGCCCTATGATACATTAGAAGAGGTGATAGGTATAA
AAGGGGAGGGGAGGGGAAGTTTAAGAGAGTGCGGTATTATTTATAAGGAAGTTCCTCTTCTTGAAAATGGGGAAATGGAT
GTAGAAGGCATAAAAAAGGCCATAACTTCAAAAACAAAGATGATAATGATTCAAAGGTCAAAGGGATATGATTATAGAAA
GTCCTTTACTATAGCGGAAATAGGGGAAGTGATTAAAGAGATAAGAAAAGTAAAAGAGGACATAATAGTCTTTGTAGATA
ATTGTTATGGTGAGTTCACAGAAAAAAAAGAACCTACGGAAGTAGGGGCTGATATCGTAGCTGGTTCTCTCATAAAAAAC
ATAGGAGGAGGGATTGCACCTACAGGAGGCTACGTGGTGGGTAAAAAAGAACTTGTGGAAAATGCTTCTTATAAGCTTTA
CGCTCCAGGAATAGGAAAAGAAGTAGGGCCCTCCCTTGGCTTTAATAGACTGATACTTCAAGGCCTGTTTTTTGCTCCAA
AAGTAGTTGGAGAAGCTTTAAAAGGGGCAGTACTTCTTTCAAAAGTCATGTCGGATTTGGGTTATGAAGTACTGCCGGAA
TACAATGAAGAGAGGACAGATATAGTACAGGCTGTAAAATTTAGAACAGAGAAAGAGCTCATATCCTTTATTCAAGGAAT
ACAGTTGGGCTCTTATGTTGATGCTCATGTACTTCCCGAACCTTGGGACATGCCAGGCTATCAGGACAAGGTGATAATGG
CAGCAGGCGGATTTATTCAAGGTTCTTCTATAGAGCTAAGCGCCGATGCGCCTATAAGAGAGCCTTATACTGCCTATGTA
CAGGGAGGCTTGAGTTATCCTCAAGTTAAATTGGCCATATCCATAGCTCTCAGCAGAATTTATTCTTGA

Upstream 100 bases:

>100_bases
TTTATAGATAAATTATATCACCTTTTCGTGTTTTCACAAACTCTTTTAAGTGCTATAATAGTATTGCTTGTAAACTTAAG
ACTAGAGAGAGGTTGATAAA

Downstream 100 bases:

>100_bases
GATAAGGGGTTTTTATTCACAGCCTCTCTAAGCTGTGAGTCGTCCACATGTGTGTAAATCTGCGTGGTTGAAACGTTAGA
ATGCCCCAAAAGCTTTTGCA

Product: cystathionine beta-lyase/cystathionine gamma-synthase

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 422; Mature: 421

Protein sequence:

>422_residues
MTSQEFLKNNFNIPPKVIELIESAEKSCLDIFKKIDEIVEYNQYKVIYHFQKNKLSDIHFNGTTGYGYGDIGRDVIEKIY
AGIFGAEDALVRPQIVSGTHAISIVLFGNLKPNEELISASGKPYDTLEEVIGIKGEGRGSLRECGIIYKEVPLLENGEMD
VEGIKKAITSKTKMIMIQRSKGYDYRKSFTIAEIGEVIKEIRKVKEDIIVFVDNCYGEFTEKKEPTEVGADIVAGSLIKN
IGGGIAPTGGYVVGKKELVENASYKLYAPGIGKEVGPSLGFNRLILQGLFFAPKVVGEALKGAVLLSKVMSDLGYEVLPE
YNEERTDIVQAVKFRTEKELISFIQGIQLGSYVDAHVLPEPWDMPGYQDKVIMAAGGFIQGSSIELSADAPIREPYTAYV
QGGLSYPQVKLAISIALSRIYS

Sequences:

>Translated_422_residues
MTSQEFLKNNFNIPPKVIELIESAEKSCLDIFKKIDEIVEYNQYKVIYHFQKNKLSDIHFNGTTGYGYGDIGRDVIEKIY
AGIFGAEDALVRPQIVSGTHAISIVLFGNLKPNEELISASGKPYDTLEEVIGIKGEGRGSLRECGIIYKEVPLLENGEMD
VEGIKKAITSKTKMIMIQRSKGYDYRKSFTIAEIGEVIKEIRKVKEDIIVFVDNCYGEFTEKKEPTEVGADIVAGSLIKN
IGGGIAPTGGYVVGKKELVENASYKLYAPGIGKEVGPSLGFNRLILQGLFFAPKVVGEALKGAVLLSKVMSDLGYEVLPE
YNEERTDIVQAVKFRTEKELISFIQGIQLGSYVDAHVLPEPWDMPGYQDKVIMAAGGFIQGSSIELSADAPIREPYTAYV
QGGLSYPQVKLAISIALSRIYS
>Mature_421_residues
TSQEFLKNNFNIPPKVIELIESAEKSCLDIFKKIDEIVEYNQYKVIYHFQKNKLSDIHFNGTTGYGYGDIGRDVIEKIYA
GIFGAEDALVRPQIVSGTHAISIVLFGNLKPNEELISASGKPYDTLEEVIGIKGEGRGSLRECGIIYKEVPLLENGEMDV
EGIKKAITSKTKMIMIQRSKGYDYRKSFTIAEIGEVIKEIRKVKEDIIVFVDNCYGEFTEKKEPTEVGADIVAGSLIKNI
GGGIAPTGGYVVGKKELVENASYKLYAPGIGKEVGPSLGFNRLILQGLFFAPKVVGEALKGAVLLSKVMSDLGYEVLPEY
NEERTDIVQAVKFRTEKELISFIQGIQLGSYVDAHVLPEPWDMPGYQDKVIMAAGGFIQGSSIELSADAPIREPYTAYVQ
GGLSYPQVKLAISIALSRIYS

Specific function: Unknown

COG id: COG4100

COG function: function code P; Cystathionine beta-lyase family protein involved in aluminum resistance

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR009651
- InterPro:   IPR015424
- InterPro:   IPR015421 [H]

Pfam domain/function: PF06838 Alum_res [H]

EC number: NA

Molecular weight: Translated: 46498; Mature: 46367

Theoretical pI: Translated: 5.05; Mature: 5.05

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.7 %Cys     (Translated Protein)
1.7 %Met     (Translated Protein)
2.4 %Cys+Met (Translated Protein)
0.7 %Cys     (Mature Protein)
1.4 %Met     (Mature Protein)
2.1 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTSQEFLKNNFNIPPKVIELIESAEKSCLDIFKKIDEIVEYNQYKVIYHFQKNKLSDIHF
CCCHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEEEEECCCCCCEEEE
NGTTGYGYGDIGRDVIEKIYAGIFGAEDALVRPQIVSGTHAISIVLFGNLKPNEELISAS
CCCCCCCCCHHHHHHHHHHHHHHCCCCCCCCCCHHCCCCEEEEEEEEECCCCCHHHHHCC
GKPYDTLEEVIGIKGEGRGSLRECGIIYKEVPLLENGEMDVEGIKKAITSKTKMIMIQRS
CCCHHHHHHHHCCCCCCCCCHHHHCHHHHHCCCCCCCCCCHHHHHHHHHCCCEEEEEECC
KGYDYRKSFTIAEIGEVIKEIRKVKEDIIVFVDNCYGEFTEKKEPTEVGADIVAGSLIKN
CCCCHHHCCCHHHHHHHHHHHHHHHHHHEEEEECCCCHHCCCCCCHHHHHHHHHHHHHHH
IGGGIAPTGGYVVGKKELVENASYKLYAPGIGKEVGPSLGFNRLILQGLFFAPKVVGEAL
HCCCCCCCCCEEECHHHHHCCCCCEEECCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHH
KGAVLLSKVMSDLGYEVLPEYNEERTDIVQAVKFRTEKELISFIQGIQLGSYVDAHVLPE
HHHHHHHHHHHHCCHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCC
PWDMPGYQDKVIMAAGGFIQGSSIELSADAPIREPYTAYVQGGLSYPQVKLAISIALSRI
CCCCCCCCCCEEEEECCEEECCCEEEECCCCCCCCHHHHHHCCCCCCHHHHHHHHHHHHH
YS
CC
>Mature Secondary Structure 
TSQEFLKNNFNIPPKVIELIESAEKSCLDIFKKIDEIVEYNQYKVIYHFQKNKLSDIHF
CCHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEEEEECCCCCCEEEE
NGTTGYGYGDIGRDVIEKIYAGIFGAEDALVRPQIVSGTHAISIVLFGNLKPNEELISAS
CCCCCCCCCHHHHHHHHHHHHHHCCCCCCCCCCHHCCCCEEEEEEEEECCCCCHHHHHCC
GKPYDTLEEVIGIKGEGRGSLRECGIIYKEVPLLENGEMDVEGIKKAITSKTKMIMIQRS
CCCHHHHHHHHCCCCCCCCCHHHHCHHHHHCCCCCCCCCCHHHHHHHHHCCCEEEEEECC
KGYDYRKSFTIAEIGEVIKEIRKVKEDIIVFVDNCYGEFTEKKEPTEVGADIVAGSLIKN
CCCCHHHCCCHHHHHHHHHHHHHHHHHHEEEEECCCCHHCCCCCCHHHHHHHHHHHHHHH
IGGGIAPTGGYVVGKKELVENASYKLYAPGIGKEVGPSLGFNRLILQGLFFAPKVVGEAL
HCCCCCCCCCEEECHHHHHCCCCCEEECCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHH
KGAVLLSKVMSDLGYEVLPEYNEERTDIVQAVKFRTEKELISFIQGIQLGSYVDAHVLPE
HHHHHHHHHHHHCCHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCC
PWDMPGYQDKVIMAAGGFIQGSSIELSADAPIREPYTAYVQGGLSYPQVKLAISIALSRI
CCCCCCCCCCEEEEECCEEECCCEEEECCCCCCCCHHHHHHCCCCCCHHHHHHHHHHHHH
YS
CC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9384377 [H]