Definition Tropheryma whipplei TW08/27, complete genome.
Accession NC_004551
Length 925,938

Click here to switch to the map view.

The map label for this gene is 28572833

Identifier: 28572833

GI number: 28572833

Start: 784091

End: 786109

Strand: Direct

Name: 28572833

Synonym: TW692

Alternate gene names: NA

Gene position: 784091-786109 (Clockwise)

Preceding gene: 28572831

Following gene: 28572834

Centisome position: 84.68

GC content: 45.86

Gene sequence:

>2019_bases
TTGTGTAGCGTGGCACCACAAGCAGTGAGAAAGTGTAACCAGTTGTTGACTCGGCGAAAAGTTGTCGAAAAGCTGAAGAA
TTGGCTGCTTTATAACAAGCCTTCTGTTAGACGTGGTGGATTTAAAGGTCCTTATGGGCACGTAGACTGTGGAAGGCACC
CTTGGTGGCAGATTATGTGCCTTTCGGGGGTTGACTATTTTTCTACCCTTGCGTATCAACCGGCAATCGCTGTTGCGGCG
GCTGGTGCAGTTGCGCCGGTTGCGACTTTCTTTTTGGTGCTTGTAACACTTTTTTGTGCCTTGCCTATTTATCGAAGAGT
TGCAAGAGAAAGCCCATTAGGGTCTGGGTCTGTTGCAATGCTTGAGAGGCTGATTCCCTGGTGGGGAGGCAAACTGCTTG
TACTGATTCTACTTGGGTTTATCGCAACCGATTTTATTATTACAATCACCCTATCTGCGTCTGATGCGGGTGAGCATGCT
GTGCACAGTCCGTATATCCCATTTTTTAGAGACATTAACCCGCTTGTAATTCCGATTATTCTCATATCTCTTCTTGGCGG
TGTGTTTTTGCTTGGATTCAACGAAGTGACGCATGTTGCGGTTGTATGTGTTTTTGTGTTTCTTGGACTTAATGCAATCT
TAATCTCTGTTGCCATGACTCATTTGGAGCCATCTTCGTTTTCTGACTGGGGAAGTAAGTTGCTTGCCGGGGCTGGCGGG
GACCCATTTATGGTTATTGTTGCTGCTCTAATTTTGTTTCCAAGCCTCGCATTAGGGCTCAGCGGGTTTGAAACAGGTGT
AACCGTTATGCCGCATATCCGCAACTCAAGACAGAAAAATACCTGCAATGGATGCGTGAAATGCGGTCAAGTTCCTAACT
ATTCTGAGAGAATCAAGGGCGCGCGGCGGCTATTGGCTGCGGCAGCATTAATAATGAGTACATTTCTCGTATTCTCCAAT
TTGGTAGTCACACTGCTTATTCCCTCACGGGAGTTTGAGGATGGTGGAATGGCCAGCGGTCGCGCGCTTGCGTATTTAAG
TGAGAAGTATCTGGGGAGCGATTTTGCAACAGTCTATGACATGAGTACAATAGCGATTCTATGGTTCGCTGGTGCAAGTG
CCATGGCAGGCATGCTCAACATAATACCCAGGTATCTAACAAGATATGGCATGGCCCCCGCGTGGATAAAACATGCAAAA
CCCCTGATTATTGTTATAACCGCAATCTCACTTTCAGTTCTGATAGCTTTTGACGCAAATGTGCACAAACAGGGTGCGGC
GTATGCCACTGGGGTTATGGTTCTTATAACCTCGGCGTCTGTTGCTGTCACCCTGTCTGCTTTGCGTAAAAAACAAAAAT
TTGCTGCAACCGGTCTTGCGGTGGTTAGTATTGTCTTTATTTACACAACGATTTTAATAATTACTGAGCGCCCGAACGGC
ATGCAGATTGCAATGACCTTTATTCTTGGCACAATATTGATTTCGATACTGTCCAGGCTGGTTAGGTCATTCAATATAAG
GGCAACATCTATTACGTTCAACGATTCCGCAAAAGCATTTGTCAGTCAGGATGCAGATGACTATGGGGTAATACATATTC
TTGCAAAAAAACCAGATAAGCCAATTACAAAATCTGAATATCATAACAGAGTTCAGGATGAGACACTGCACAATAGGCTT
TTGCCCGGCTCGCCCGTAATTTTCATTGAAGTATTGCAGTCAGACTCAAGCGATTTTGAGGAAGACCTGATTGTCGAAGG
GAAAATAGTCGGAGGACACCGCGTTTTGCGGACAAGCAGCTGTAACATACCAAGCGCTATTGCGGCGATTTTGTTAGAAA
TACGCGATATAACCGGTGTTACACCGGATGTGTATTTCCATTGGACCGAACGCAATCCGGTAATGAACACTCTTAGATAC
CTAATAACAGGAGGTGGTGAGATCGCCGCAATTACGCGCGAAGTGCTACGTGAGGCCGAACGCAATAGTGAATGCAGGCC
CGTTGTTCATGTGAGCTAA

Upstream 100 bases:

>100_bases
CATTTATAAAATGTACATTTGCAATGGCGCACCTGAAGTGTGCTTACAAAGTGCTGCGCGAATTACGCCTGACGGTGTGA
TATATTGAGCTTCGCTTATC

Downstream 100 bases:

>100_bases
TTGCCACCCAGTAAACGGTTTACTGGCAGCGACATTAACAAAGATGTATAAGCATTTCACCCATTAACCTGCCTCCACAA
GGGTAGATATGGATTATCGA

Product: integral membrane protein

Products: NA

Alternate protein names: Regulatory Protein LysR Family Signature Domain Protein; Integral Membrane Protein; Regulatory Protein

Number of amino acids: Translated: 672; Mature: 672

Protein sequence:

>672_residues
MCSVAPQAVRKCNQLLTRRKVVEKLKNWLLYNKPSVRRGGFKGPYGHVDCGRHPWWQIMCLSGVDYFSTLAYQPAIAVAA
AGAVAPVATFFLVLVTLFCALPIYRRVARESPLGSGSVAMLERLIPWWGGKLLVLILLGFIATDFIITITLSASDAGEHA
VHSPYIPFFRDINPLVIPIILISLLGGVFLLGFNEVTHVAVVCVFVFLGLNAILISVAMTHLEPSSFSDWGSKLLAGAGG
DPFMVIVAALILFPSLALGLSGFETGVTVMPHIRNSRQKNTCNGCVKCGQVPNYSERIKGARRLLAAAALIMSTFLVFSN
LVVTLLIPSREFEDGGMASGRALAYLSEKYLGSDFATVYDMSTIAILWFAGASAMAGMLNIIPRYLTRYGMAPAWIKHAK
PLIIVITAISLSVLIAFDANVHKQGAAYATGVMVLITSASVAVTLSALRKKQKFAATGLAVVSIVFIYTTILIITERPNG
MQIAMTFILGTILISILSRLVRSFNIRATSITFNDSAKAFVSQDADDYGVIHILAKKPDKPITKSEYHNRVQDETLHNRL
LPGSPVIFIEVLQSDSSDFEEDLIVEGKIVGGHRVLRTSSCNIPSAIAAILLEIRDITGVTPDVYFHWTERNPVMNTLRY
LITGGGEIAAITREVLREAERNSECRPVVHVS

Sequences:

>Translated_672_residues
MCSVAPQAVRKCNQLLTRRKVVEKLKNWLLYNKPSVRRGGFKGPYGHVDCGRHPWWQIMCLSGVDYFSTLAYQPAIAVAA
AGAVAPVATFFLVLVTLFCALPIYRRVARESPLGSGSVAMLERLIPWWGGKLLVLILLGFIATDFIITITLSASDAGEHA
VHSPYIPFFRDINPLVIPIILISLLGGVFLLGFNEVTHVAVVCVFVFLGLNAILISVAMTHLEPSSFSDWGSKLLAGAGG
DPFMVIVAALILFPSLALGLSGFETGVTVMPHIRNSRQKNTCNGCVKCGQVPNYSERIKGARRLLAAAALIMSTFLVFSN
LVVTLLIPSREFEDGGMASGRALAYLSEKYLGSDFATVYDMSTIAILWFAGASAMAGMLNIIPRYLTRYGMAPAWIKHAK
PLIIVITAISLSVLIAFDANVHKQGAAYATGVMVLITSASVAVTLSALRKKQKFAATGLAVVSIVFIYTTILIITERPNG
MQIAMTFILGTILISILSRLVRSFNIRATSITFNDSAKAFVSQDADDYGVIHILAKKPDKPITKSEYHNRVQDETLHNRL
LPGSPVIFIEVLQSDSSDFEEDLIVEGKIVGGHRVLRTSSCNIPSAIAAILLEIRDITGVTPDVYFHWTERNPVMNTLRY
LITGGGEIAAITREVLREAERNSECRPVVHVS
>Mature_672_residues
MCSVAPQAVRKCNQLLTRRKVVEKLKNWLLYNKPSVRRGGFKGPYGHVDCGRHPWWQIMCLSGVDYFSTLAYQPAIAVAA
AGAVAPVATFFLVLVTLFCALPIYRRVARESPLGSGSVAMLERLIPWWGGKLLVLILLGFIATDFIITITLSASDAGEHA
VHSPYIPFFRDINPLVIPIILISLLGGVFLLGFNEVTHVAVVCVFVFLGLNAILISVAMTHLEPSSFSDWGSKLLAGAGG
DPFMVIVAALILFPSLALGLSGFETGVTVMPHIRNSRQKNTCNGCVKCGQVPNYSERIKGARRLLAAAALIMSTFLVFSN
LVVTLLIPSREFEDGGMASGRALAYLSEKYLGSDFATVYDMSTIAILWFAGASAMAGMLNIIPRYLTRYGMAPAWIKHAK
PLIIVITAISLSVLIAFDANVHKQGAAYATGVMVLITSASVAVTLSALRKKQKFAATGLAVVSIVFIYTTILIITERPNG
MQIAMTFILGTILISILSRLVRSFNIRATSITFNDSAKAFVSQDADDYGVIHILAKKPDKPITKSEYHNRVQDETLHNRL
LPGSPVIFIEVLQSDSSDFEEDLIVEGKIVGGHRVLRTSSCNIPSAIAAILLEIRDITGVTPDVYFHWTERNPVMNTLRY
LITGGGEIAAITREVLREAERNSECRPVVHVS

Specific function: Unknown

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 73170; Mature: 73170

Theoretical pI: Translated: 9.25; Mature: 9.25

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.6 %Cys     (Translated Protein)
2.4 %Met     (Translated Protein)
4.0 %Cys+Met (Translated Protein)
1.6 %Cys     (Mature Protein)
2.4 %Met     (Mature Protein)
4.0 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MCSVAPQAVRKCNQLLTRRKVVEKLKNWLLYNKPSVRRGGFKGPYGHVDCGRHPWWQIMC
CCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCEEEE
LSGVDYFSTLAYQPAIAVAAAGAVAPVATFFLVLVTLFCALPIYRRVARESPLGSGSVAM
ECCCHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHH
LERLIPWWGGKLLVLILLGFIATDFIITITLSASDAGEHAVHSPYIPFFRDINPLVIPII
HHHHHHHCCHHHHHHHHHHHHHHCEEEEEEEECCCCCCCCCCCCCCCHHHCCCHHHHHHH
LISLLGGVFLLGFNEVTHVAVVCVFVFLGLNAILISVAMTHLEPSSFSDWGSKLLAGAGG
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHCCCC
DPFMVIVAALILFPSLALGLSGFETGVTVMPHIRNSRQKNTCNGCVKCGQVPNYSERIKG
CHHHHHHHHHHHHHHHHHCCCCCCCCCEEECCCCCCCCCCCHHHHHHCCCCCCHHHHHHH
ARRLLAAAALIMSTFLVFSNLVVTLLIPSREFEDGGMASGRALAYLSEKYLGSDFATVYD
HHHHHHHHHHHHHHHHHHHHHHHEEEECCCCCCCCCCCCCHHHHHHHHHHHCCCHHHHHH
MSTIAILWFAGASAMAGMLNIIPRYLTRYGMAPAWIKHAKPLIIVITAISLSVLIAFDAN
HHHHHHHHHHCHHHHHHHHHHHHHHHHHHCCCHHHHHCCCCCEEEEEHHHHHHHEEECCC
VHKQGAAYATGVMVLITSASVAVTLSALRKKQKFAATGLAVVSIVFIYTTILIITERPNG
CCCCCCHHHHHHHHHEECCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHEEEECCCC
MQIAMTFILGTILISILSRLVRSFNIRATSITFNDSAKAFVSQDADDYGVIHILAKKPDK
HHHHHHHHHHHHHHHHHHHHHHHCCCEEEEEEECCCCHHHHHCCCCCCCEEEEEECCCCC
PITKSEYHNRVQDETLHNRLLPGSPVIFIEVLQSDSSDFEEDLIVEGKIVGGHRVLRTSS
CCCHHHHHHHHHHHHHHHCCCCCCCEEEEEEECCCCCCCCHHHEEEEEEECCCEEEEECC
CNIPSAIAAILLEIRDITGVTPDVYFHWTERNPVMNTLRYLITGGGEIAAITREVLREAE
CCCHHHHHHHHHHHHHHCCCCCCEEEEECCCCHHHHHHHHHHCCCCHHHHHHHHHHHHHH
RNSECRPVVHVS
CCCCCCEEEEEC
>Mature Secondary Structure
MCSVAPQAVRKCNQLLTRRKVVEKLKNWLLYNKPSVRRGGFKGPYGHVDCGRHPWWQIMC
CCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCEEEE
LSGVDYFSTLAYQPAIAVAAAGAVAPVATFFLVLVTLFCALPIYRRVARESPLGSGSVAM
ECCCHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHH
LERLIPWWGGKLLVLILLGFIATDFIITITLSASDAGEHAVHSPYIPFFRDINPLVIPII
HHHHHHHCCHHHHHHHHHHHHHHCEEEEEEEECCCCCCCCCCCCCCCHHHCCCHHHHHHH
LISLLGGVFLLGFNEVTHVAVVCVFVFLGLNAILISVAMTHLEPSSFSDWGSKLLAGAGG
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHCCCC
DPFMVIVAALILFPSLALGLSGFETGVTVMPHIRNSRQKNTCNGCVKCGQVPNYSERIKG
CHHHHHHHHHHHHHHHHHCCCCCCCCCEEECCCCCCCCCCCHHHHHHCCCCCCHHHHHHH
ARRLLAAAALIMSTFLVFSNLVVTLLIPSREFEDGGMASGRALAYLSEKYLGSDFATVYD
HHHHHHHHHHHHHHHHHHHHHHHEEEECCCCCCCCCCCCCHHHHHHHHHHHCCCHHHHHH
MSTIAILWFAGASAMAGMLNIIPRYLTRYGMAPAWIKHAKPLIIVITAISLSVLIAFDAN
HHHHHHHHHHCHHHHHHHHHHHHHHHHHHCCCHHHHHCCCCCEEEEEHHHHHHHEEECCC
VHKQGAAYATGVMVLITSASVAVTLSALRKKQKFAATGLAVVSIVFIYTTILIITERPNG
CCCCCCHHHHHHHHHEECCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHEEEECCCC
MQIAMTFILGTILISILSRLVRSFNIRATSITFNDSAKAFVSQDADDYGVIHILAKKPDK
HHHHHHHHHHHHHHHHHHHHHHHCCCEEEEEEECCCCHHHHHCCCCCCCEEEEEECCCCC
PITKSEYHNRVQDETLHNRLLPGSPVIFIEVLQSDSSDFEEDLIVEGKIVGGHRVLRTSS
CCCHHHHHHHHHHHHHHHCCCCCCCEEEEEEECCCCCCCCHHHEEEEEEECCCEEEEECC
CNIPSAIAAILLEIRDITGVTPDVYFHWTERNPVMNTLRYLITGGGEIAAITREVLREAE
CCCHHHHHHHHHHHHHHCCCCCCEEEEECCCCHHHHHHHHHHCCCCHHHHHHHHHHHHHH
RNSECRPVVHVS
CCCCCCEEEEEC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA