Definition Thermomicrobium roseum DSM 5159 plasmid unnamed, complete sequence.
Accession NC_011961
Length 917,738

Click here to switch to the map view.

The map label for this gene is 221635897

Identifier: 221635897

GI number: 221635897

Start: 479935

End: 481725

Strand: Reverse

Name: 221635897

Synonym: trd_A0491

Alternate gene names: NA

Gene position: 481725-479935 (Counterclockwise)

Preceding gene: 221635898

Following gene: 221635896

Centisome position: 52.49

GC content: 71.58

Gene sequence:

>1791_bases
ATGCAACGATCCGACATGCGCGCTTGGGCACGCCCGCGTGCTGGTGCCGCGCTCGTGCTCGTCCTCCTGCTCGCGCTTGG
GGCGGCGCTGGCGGCACGCGACCGGCTGGCCGTTGCTGCTCCCCCGGGCCAGGCGCTCTTAGTCTCGCTGGCTGGCCCAG
CGGGGACGGAGATCGCCATCCTCGACCTCACGACCGGCGCCGAGCTGAACCGGGTGCCCCACCCGGACCGGGCCTACCGG
GAGATCTCCCTCTCGCCGGACGGTCGCCGGGCAGCGGTCGTGCGCAGCGAGCCGGATACGCTGGCCGGCCAGGTGCTCGA
GATCCGCTCGCTCCCCGATTGGACGCTGGAGGCCGTCCTGCCGCTCGGGCTGCAGGCTCCCCCGCTCGCTGACCTGGCGA
CCCGCGAGCCGGAACTGCTGGCCAACCCCTGGCTCGCCTCGGCCGCCTTTTCCGCTGACGGGAAGCTGGCCGCGCTCGCC
TTCTACGGTGGGAGCGGTCCCATCCCCCAGCTCATCGTCACCGCCTACGATCTGGAGAAGCGAACATGGGCTTCCTGGGC
GAAGGGCCTGGGCGGGACCAGTTACGTGTGGCTCTTCCCCAGCCGCGAGCGGTTGCTCGTGGTCAACCGCTCCGTCCTGC
CGCAGTGGACCAACTCGTTGGGGGACGTCTTCGCCCTCGACCCGCAGACCGGCCGAGTGCTCGCCCAGCAGGCCATCCCG
CGGCTGATCACCGCCTACCTGCCGGTACGCGGGCAGAGCGCGCCGAGCATGGCGCCCGGTCTCGCAGCCCCCGTGCTGGT
CGGCAACCAGCTCTGGCTGGTCACTGACGACCTCGCACGCCTGATCCTCGATCCGCGCACGCTGGAGATCCGCTCCGCCG
ACCCGCCGCTCACCCGCGATCTGGCAGCGCAGTTCGTGGCACTCGCCGGTGACTGGCTGGTCGCGTTCTCCACGGAAGCC
TCCGAGCTACTGGCCATCGATGCTGCTTCTTGGCAGCTGACCGCGACGCACCGGCTTCCGGAGGAGGGCTTCCCCTACCG
CTGGCACCTGGTCGGTTCTGACCCGGCGCAGCACGCCGTGTACCTCGCTGATATAGCCGAGGGTTGCCTGTGGCGCTTCC
CGCTCGACAGCGGGACACTCTCGGCACCGCTGGCTTGCGGGCTCTACCTGGAGTTTGCGTACGTCACCTACTATCACTGG
CCGGCGTTCTCCCCGGGCACAGCTGCACCGCTGGGCGCGATTGGCCTGCTCCGGCACCTTCCCGAATCGCTCGCCGGCAC
CGCGACCGCCCTGCTCGCCGGTACCTTCCTCGTCGCCGCGCTGGGCAAGATCGTCTCCCTCGGGCGTCTCGCGCACCTGG
TCGCGACCGTTTTGCCGCGGTTCCGCCGTTGGGCTCGCCCGGCTGCGCTCGGAACCGTCGCGCTGGAACTCCTCACCGGA
GTCCTCTTGCTCCTACCAGGCACCCAGCGCGCTGGGCTCGTGCTCGCCGCGACCGCTCTCCTCGCCTTCACCGCGTTCGC
CGTCGTCGGAGCCCGGCGTGCGCCGGGTGCGGACTGTTCCTGCTTCGGCAACCTGGTGCCCAGTAAGCTCGGCCGCGCCA
CCGTGCTCCGCAACCTGGTCCTGCTCGCGCTCGTCGCGGTAGGCTGGCCAGCGACGGCCGCGCCGTCCCCGCCCGATCTC
GCCATCGCCGCCGGCCTGCTGCTGGCAGTGCTCGCGGTGTCGCGCCTCGTGGCCGCGGCGGCCAGTTTGCGCCGGCTCTC
GCCGGGGACGGAGCCGCGGCATGCTGCCTGA

Upstream 100 bases:

>100_bases
CGACCTCAAAACAATTGGTGTGGAACAGGCAGCGTCGTGTGCACGCGAGCGGTTCTCGTCGGAACCTGCTGAGCTCTGGC
CGAGCGAAAGGAGGCCCCTG

Downstream 100 bases:

>100_bases
GTGGGCCGTCACGACCAGCCTGCTCGGCGCTTGGCTCGCTCTCCTCGGGCTGGCAGTGGTCCTCGCCCGGCTGGCCCAGC
GCCTCCAAGCGCTTCACCAG

Product: hypothetical protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 596; Mature: 596

Protein sequence:

>596_residues
MQRSDMRAWARPRAGAALVLVLLLALGAALAARDRLAVAAPPGQALLVSLAGPAGTEIAILDLTTGAELNRVPHPDRAYR
EISLSPDGRRAAVVRSEPDTLAGQVLEIRSLPDWTLEAVLPLGLQAPPLADLATREPELLANPWLASAAFSADGKLAALA
FYGGSGPIPQLIVTAYDLEKRTWASWAKGLGGTSYVWLFPSRERLLVVNRSVLPQWTNSLGDVFALDPQTGRVLAQQAIP
RLITAYLPVRGQSAPSMAPGLAAPVLVGNQLWLVTDDLARLILDPRTLEIRSADPPLTRDLAAQFVALAGDWLVAFSTEA
SELLAIDAASWQLTATHRLPEEGFPYRWHLVGSDPAQHAVYLADIAEGCLWRFPLDSGTLSAPLACGLYLEFAYVTYYHW
PAFSPGTAAPLGAIGLLRHLPESLAGTATALLAGTFLVAALGKIVSLGRLAHLVATVLPRFRRWARPAALGTVALELLTG
VLLLLPGTQRAGLVLAATALLAFTAFAVVGARRAPGADCSCFGNLVPSKLGRATVLRNLVLLALVAVGWPATAAPSPPDL
AIAAGLLLAVLAVSRLVAAAASLRRLSPGTEPRHAA

Sequences:

>Translated_596_residues
MQRSDMRAWARPRAGAALVLVLLLALGAALAARDRLAVAAPPGQALLVSLAGPAGTEIAILDLTTGAELNRVPHPDRAYR
EISLSPDGRRAAVVRSEPDTLAGQVLEIRSLPDWTLEAVLPLGLQAPPLADLATREPELLANPWLASAAFSADGKLAALA
FYGGSGPIPQLIVTAYDLEKRTWASWAKGLGGTSYVWLFPSRERLLVVNRSVLPQWTNSLGDVFALDPQTGRVLAQQAIP
RLITAYLPVRGQSAPSMAPGLAAPVLVGNQLWLVTDDLARLILDPRTLEIRSADPPLTRDLAAQFVALAGDWLVAFSTEA
SELLAIDAASWQLTATHRLPEEGFPYRWHLVGSDPAQHAVYLADIAEGCLWRFPLDSGTLSAPLACGLYLEFAYVTYYHW
PAFSPGTAAPLGAIGLLRHLPESLAGTATALLAGTFLVAALGKIVSLGRLAHLVATVLPRFRRWARPAALGTVALELLTG
VLLLLPGTQRAGLVLAATALLAFTAFAVVGARRAPGADCSCFGNLVPSKLGRATVLRNLVLLALVAVGWPATAAPSPPDL
AIAAGLLLAVLAVSRLVAAAASLRRLSPGTEPRHAA
>Mature_596_residues
MQRSDMRAWARPRAGAALVLVLLLALGAALAARDRLAVAAPPGQALLVSLAGPAGTEIAILDLTTGAELNRVPHPDRAYR
EISLSPDGRRAAVVRSEPDTLAGQVLEIRSLPDWTLEAVLPLGLQAPPLADLATREPELLANPWLASAAFSADGKLAALA
FYGGSGPIPQLIVTAYDLEKRTWASWAKGLGGTSYVWLFPSRERLLVVNRSVLPQWTNSLGDVFALDPQTGRVLAQQAIP
RLITAYLPVRGQSAPSMAPGLAAPVLVGNQLWLVTDDLARLILDPRTLEIRSADPPLTRDLAAQFVALAGDWLVAFSTEA
SELLAIDAASWQLTATHRLPEEGFPYRWHLVGSDPAQHAVYLADIAEGCLWRFPLDSGTLSAPLACGLYLEFAYVTYYHW
PAFSPGTAAPLGAIGLLRHLPESLAGTATALLAGTFLVAALGKIVSLGRLAHLVATVLPRFRRWARPAALGTVALELLTG
VLLLLPGTQRAGLVLAATALLAFTAFAVVGARRAPGADCSCFGNLVPSKLGRATVLRNLVLLALVAVGWPATAAPSPPDL
AIAAGLLLAVLAVSRLVAAAASLRRLSPGTEPRHAA

Specific function: Unknown

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 62743; Mature: 62743

Theoretical pI: Translated: 8.84; Mature: 8.84

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.7 %Cys     (Translated Protein)
0.5 %Met     (Translated Protein)
1.2 %Cys+Met (Translated Protein)
0.7 %Cys     (Mature Protein)
0.5 %Met     (Mature Protein)
1.2 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MQRSDMRAWARPRAGAALVLVLLLALGAALAARDRLAVAAPPGQALLVSLAGPAGTEIAI
CCCCCCHHHCCCCCCHHHHHHHHHHHHHHHHHCCCEEEECCCCCEEEEEECCCCCCEEEE
LDLTTGAELNRVPHPDRAYREISLSPDGRRAAVVRSEPDTLAGQVLEIRSLPDWTLEAVL
EEECCCCCCCCCCCCCCHHHEEECCCCCCEEEEEECCCCHHHHHHHEECCCCCHHHHHHH
PLGLQAPPLADLATREPELLANPWLASAAFSADGKLAALAFYGGSGPIPQLIVTAYDLEK
CCCCCCCCCHHHHCCCCHHHCCCCHHHHEECCCCCEEEEEEECCCCCCHHHHHHHHHHHH
RTWASWAKGLGGTSYVWLFPSRERLLVVNRSVLPQWTNSLGDVFALDPQTGRVLAQQAIP
HHHHHHHCCCCCCEEEEEECCCCEEEEECCHHCHHHHHCCCCEEEECCCHHHHHHHHHHH
RLITAYLPVRGQSAPSMAPGLAAPVLVGNQLWLVTDDLARLILDPRTLEIRSADPPLTRD
HHHHHHCCCCCCCCCCCCCCCCCCEEECCEEEEEEHHHHHHHCCCCEEEEECCCCCHHHH
LAAQFVALAGDWLVAFSTEASELLAIDAASWQLTATHRLPEEGFPYRWHLVGSDPAQHAV
HHHHHHHHCCCEEEEEECCCCCEEEEECCCEEEEEECCCCCCCCCEEEEEECCCCHHHHH
YLADIAEGCLWRFPLDSGTLSAPLACGLYLEFAYVTYYHWPAFSPGTAAPLGAIGLLRHL
HHHHHHCCCEEECCCCCCCCCCCHHHHHHHHEEEHEEEECCCCCCCCCCHHHHHHHHHHH
PESLAGTATALLAGTFLVAALGKIVSLGRLAHLVATVLPRFRRWARPAALGTVALELLTG
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHH
VLLLLPGTQRAGLVLAATALLAFTAFAVVGARRAPGADCSCFGNLVPSKLGRATVLRNLV
HHHCCCCCCCCCHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHHHHH
LLALVAVGWPATAAPSPPDLAIAAGLLLAVLAVSRLVAAAASLRRLSPGTEPRHAA
HHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCC
>Mature Secondary Structure
MQRSDMRAWARPRAGAALVLVLLLALGAALAARDRLAVAAPPGQALLVSLAGPAGTEIAI
CCCCCCHHHCCCCCCHHHHHHHHHHHHHHHHHCCCEEEECCCCCEEEEEECCCCCCEEEE
LDLTTGAELNRVPHPDRAYREISLSPDGRRAAVVRSEPDTLAGQVLEIRSLPDWTLEAVL
EEECCCCCCCCCCCCCCHHHEEECCCCCCEEEEEECCCCHHHHHHHEECCCCCHHHHHHH
PLGLQAPPLADLATREPELLANPWLASAAFSADGKLAALAFYGGSGPIPQLIVTAYDLEK
CCCCCCCCCHHHHCCCCHHHCCCCHHHHEECCCCCEEEEEEECCCCCCHHHHHHHHHHHH
RTWASWAKGLGGTSYVWLFPSRERLLVVNRSVLPQWTNSLGDVFALDPQTGRVLAQQAIP
HHHHHHHCCCCCCEEEEEECCCCEEEEECCHHCHHHHHCCCCEEEECCCHHHHHHHHHHH
RLITAYLPVRGQSAPSMAPGLAAPVLVGNQLWLVTDDLARLILDPRTLEIRSADPPLTRD
HHHHHHCCCCCCCCCCCCCCCCCCEEECCEEEEEEHHHHHHHCCCCEEEEECCCCCHHHH
LAAQFVALAGDWLVAFSTEASELLAIDAASWQLTATHRLPEEGFPYRWHLVGSDPAQHAV
HHHHHHHHCCCEEEEEECCCCCEEEEECCCEEEEEECCCCCCCCCEEEEEECCCCHHHHH
YLADIAEGCLWRFPLDSGTLSAPLACGLYLEFAYVTYYHWPAFSPGTAAPLGAIGLLRHL
HHHHHHCCCEEECCCCCCCCCCCHHHHHHHHEEEHEEEECCCCCCCCCCHHHHHHHHHHH
PESLAGTATALLAGTFLVAALGKIVSLGRLAHLVATVLPRFRRWARPAALGTVALELLTG
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHH
VLLLLPGTQRAGLVLAATALLAFTAFAVVGARRAPGADCSCFGNLVPSKLGRATVLRNLV
HHHCCCCCCCCCHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHHHHH
LLALVAVGWPATAAPSPPDLAIAAGLLLAVLAVSRLVAAAASLRRLSPGTEPRHAA
HHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA