Definition Tropheryma whipplei TW08/27, complete genome.
Accession NC_004551
Length 925,938

Click here to switch to the map view.

The map label for this gene is 28572829

Identifier: 28572829

GI number: 28572829

Start: 776233

End: 778524

Strand: Direct

Name: 28572829

Synonym: TW688

Alternate gene names: NA

Gene position: 776233-778524 (Clockwise)

Preceding gene: 28572828

Following gene: 28572831

Centisome position: 83.83

GC content: 44.63

Gene sequence:

>2292_bases
TTGATGAATGGAAAGATACTAGGCTCGGTGACACCTTGTCGCGTTTTGGCCCGCGTGGCCCTTCTTCTCCTCCTATCATC
CCTACAATATGAAACAGCCTTTGCCAGACAGACACCTCCTGCCCTATCCCTCCTATCATCTGTTTCATCTACATCTGTTT
CATCTAATACCAAATACACAAGAGTAAGTAATACAAATACACAAGAAGTATGTGTAACAACTAACACAAATGTATCTCTC
CTAATAGATCCTGTTACAAGCAGTACAAAACAAACCCTGTCCTGCACCCCATCTCTCTCACCCCAACCACAGACACATAT
ATATGTCCCATACACAGATACATCCTCATACCTATATGTCCCATATATAACCAACACACATATATCCCTCTATTACACAG
ATAAGAAAGCAGATCCATCATCTTTCCTAACCTTCCCTCATACAGACATAGCAACCCCATACGGAGATGAGAAAGTAATC
TCCATAACAAAGACAACAACCAATCTCATAGCTCTCCTAACAACCCGTAACATCTTCTTCTTTGACATACATGTAACAGA
GAAACCAAAGATAACTGTTCCCATACACAAACAGATAGATAACACATATCTCTCAGACATACCATCACTCAGAAACTCCA
GATACACCTTCTCTCTAACACACCCAAACAAAGACATAACCATAGATAGATACACCGGACAGATACATCTCTCATCCCTA
CCAACATCTCCCATAACAGCCATAGCCATAAACAAAGACACAAGCACCCATATCACCTATGCAATAGATACACAATATAG
ACAAATTCATCTTGATCCTCCTAAGAAGCCCCGCAAGAGAGATGTGACACCTGTGACTAATACTGGTGTCTGTGCTGCTC
AGACCTATTCCCCTACCTATGCAACAGAATCTCTAGAGGATATGGCCATTCGTGTGACAAATCCAAGCTGGAAGGCTTCC
TCTTATATACCATCCTCATACACCTGGTCTGTTCCTCCTGACACCACAGCACCCATTCCTCCCTCTCCATGTGGTCCAAC
CAAGAAATGGTCACCGGGTGACTGGACACCTACCTGGGTTACCCATCCAACTCCTGTTGACTCCTACGCAACAGAGTCTC
TGGAAGATATGATACGTAAGTTCAAGTCACAGTTAGAGAGTCCAACAAAGAAATCCTTTAGTGCTATAACAGGAAAAACC
TTTGACACAAAACCTCTCCTGCGTGGTGGTGCATACTTCCCAACATCATCCAAGACAGTTGGGTTCTCCACTACGGTTTG
GATAACAGCACCTTTGTCTTCCATTGACCTTAATGTGCCTCTTACCAATGGTATTCAGACGAATGTATTTGTATATCTTG
TATCTGGCACATTCACCTATACCTTCCCCACCATCGGTGCATTCTTTACAACAACCCCAAGCAAGGGAACCATACGGATT
GCCTGGGTCCTTCCTGCCTATGACCCAACCTGGCATGTGCCATTTACAACAGGTGGTATGTATGCCATATTTGACGGGTC
CTCAGCAACATTTCGTGATCTTCTGAATGCATATTCATCTCTATCGGCATCCTTTACGACCGATACAACCTTCTATGCCT
CTAACTCTGGGGATATAACTGTTACAGTGCCTCTTACCAATGGTATTCAGACGAATGTATTTGTGCATCTCTCCTCTGGA
GGATTATCGACAGTTGTTCCGCTCATGACTGCATACCTTACTGCTTCCTCTGAAATCAGTAAGGGAACTATCGCAGCTGC
ATGGGCCGCTCCTGCCTATGACCCAACCTGGCATGTGCCATTTACAACAGCTGATCTGTATGCCACTTATGACGGACCAA
CAGGTGAACTGGTTGGTGTGTTTTACACCCCATATACCATAAATAGGACAGTATCGCGTGGTCAGACTGTAAGTCTTAGT
CCTCTTCCTACCGGAACCTATTCATTTCCAACATATGTGTCTTATGCAACAAAGCCTGGAACTAATCGAGTGCCTGCCTA
TTTATTCATGAATCCTACCAATGGTGCGCTGGTTGGTTCTGTGTATCCCTATGTTGCCCAGGGTCAGTATCAGTTCCCCG
TTGCTGGTGCTGTATATAACCTGCATGTTACAGGTAAGAATAAGCGTCCTAAGAGGGAAGCTGCTGCTCCATGTAGTCCA
ACCAAGAAATGGTCACCGGGTGACTGGACACCTACCTGGGTTACCCATCCAGCTCCTGTTAACTCCTATGCAACAGAGTC
TCTGGAAGATATGATACGTAAGTTCAAGGAGAGTCTCAAGGCTGCTTCATAG

Upstream 100 bases:

>100_bases
GGGTAACACTGGTGTTCTAGTATTTATGGATTGCGTCATGCAATGAGGTTTGCTATGCTTATCACCGGTTATTTAAGAGG
GAATGGGGTGATTAGTTAAA

Downstream 100 bases:

>100_bases
GCCAGAGTAGCTGTGTAATCCAGAGAAGAACACATTCACGATTGTAAAGTTGAATATAATCGTTGTAAATCCTATCAAGG
AGAGCACAGAGGAACGAGTT

Product: WiSP family protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 763; Mature: 763

Protein sequence:

>763_residues
MMNGKILGSVTPCRVLARVALLLLLSSLQYETAFARQTPPALSLLSSVSSTSVSSNTKYTRVSNTNTQEVCVTTNTNVSL
LIDPVTSSTKQTLSCTPSLSPQPQTHIYVPYTDTSSYLYVPYITNTHISLYYTDKKADPSSFLTFPHTDIATPYGDEKVI
SITKTTTNLIALLTTRNIFFFDIHVTEKPKITVPIHKQIDNTYLSDIPSLRNSRYTFSLTHPNKDITIDRYTGQIHLSSL
PTSPITAIAINKDTSTHITYAIDTQYRQIHLDPPKKPRKRDVTPVTNTGVCAAQTYSPTYATESLEDMAIRVTNPSWKAS
SYIPSSYTWSVPPDTTAPIPPSPCGPTKKWSPGDWTPTWVTHPTPVDSYATESLEDMIRKFKSQLESPTKKSFSAITGKT
FDTKPLLRGGAYFPTSSKTVGFSTTVWITAPLSSIDLNVPLTNGIQTNVFVYLVSGTFTYTFPTIGAFFTTTPSKGTIRI
AWVLPAYDPTWHVPFTTGGMYAIFDGSSATFRDLLNAYSSLSASFTTDTTFYASNSGDITVTVPLTNGIQTNVFVHLSSG
GLSTVVPLMTAYLTASSEISKGTIAAAWAAPAYDPTWHVPFTTADLYATYDGPTGELVGVFYTPYTINRTVSRGQTVSLS
PLPTGTYSFPTYVSYATKPGTNRVPAYLFMNPTNGALVGSVYPYVAQGQYQFPVAGAVYNLHVTGKNKRPKREAAAPCSP
TKKWSPGDWTPTWVTHPAPVNSYATESLEDMIRKFKESLKAAS

Sequences:

>Translated_763_residues
MMNGKILGSVTPCRVLARVALLLLLSSLQYETAFARQTPPALSLLSSVSSTSVSSNTKYTRVSNTNTQEVCVTTNTNVSL
LIDPVTSSTKQTLSCTPSLSPQPQTHIYVPYTDTSSYLYVPYITNTHISLYYTDKKADPSSFLTFPHTDIATPYGDEKVI
SITKTTTNLIALLTTRNIFFFDIHVTEKPKITVPIHKQIDNTYLSDIPSLRNSRYTFSLTHPNKDITIDRYTGQIHLSSL
PTSPITAIAINKDTSTHITYAIDTQYRQIHLDPPKKPRKRDVTPVTNTGVCAAQTYSPTYATESLEDMAIRVTNPSWKAS
SYIPSSYTWSVPPDTTAPIPPSPCGPTKKWSPGDWTPTWVTHPTPVDSYATESLEDMIRKFKSQLESPTKKSFSAITGKT
FDTKPLLRGGAYFPTSSKTVGFSTTVWITAPLSSIDLNVPLTNGIQTNVFVYLVSGTFTYTFPTIGAFFTTTPSKGTIRI
AWVLPAYDPTWHVPFTTGGMYAIFDGSSATFRDLLNAYSSLSASFTTDTTFYASNSGDITVTVPLTNGIQTNVFVHLSSG
GLSTVVPLMTAYLTASSEISKGTIAAAWAAPAYDPTWHVPFTTADLYATYDGPTGELVGVFYTPYTINRTVSRGQTVSLS
PLPTGTYSFPTYVSYATKPGTNRVPAYLFMNPTNGALVGSVYPYVAQGQYQFPVAGAVYNLHVTGKNKRPKREAAAPCSP
TKKWSPGDWTPTWVTHPAPVNSYATESLEDMIRKFKESLKAAS
>Mature_763_residues
MMNGKILGSVTPCRVLARVALLLLLSSLQYETAFARQTPPALSLLSSVSSTSVSSNTKYTRVSNTNTQEVCVTTNTNVSL
LIDPVTSSTKQTLSCTPSLSPQPQTHIYVPYTDTSSYLYVPYITNTHISLYYTDKKADPSSFLTFPHTDIATPYGDEKVI
SITKTTTNLIALLTTRNIFFFDIHVTEKPKITVPIHKQIDNTYLSDIPSLRNSRYTFSLTHPNKDITIDRYTGQIHLSSL
PTSPITAIAINKDTSTHITYAIDTQYRQIHLDPPKKPRKRDVTPVTNTGVCAAQTYSPTYATESLEDMAIRVTNPSWKAS
SYIPSSYTWSVPPDTTAPIPPSPCGPTKKWSPGDWTPTWVTHPTPVDSYATESLEDMIRKFKSQLESPTKKSFSAITGKT
FDTKPLLRGGAYFPTSSKTVGFSTTVWITAPLSSIDLNVPLTNGIQTNVFVYLVSGTFTYTFPTIGAFFTTTPSKGTIRI
AWVLPAYDPTWHVPFTTGGMYAIFDGSSATFRDLLNAYSSLSASFTTDTTFYASNSGDITVTVPLTNGIQTNVFVHLSSG
GLSTVVPLMTAYLTASSEISKGTIAAAWAAPAYDPTWHVPFTTADLYATYDGPTGELVGVFYTPYTINRTVSRGQTVSLS
PLPTGTYSFPTYVSYATKPGTNRVPAYLFMNPTNGALVGSVYPYVAQGQYQFPVAGAVYNLHVTGKNKRPKREAAAPCSP
TKKWSPGDWTPTWVTHPAPVNSYATESLEDMIRKFKESLKAAS

Specific function: Unknown

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 83468; Mature: 83468

Theoretical pI: Translated: 9.17; Mature: 9.17

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.8 %Cys     (Translated Protein)
1.0 %Met     (Translated Protein)
1.8 %Cys+Met (Translated Protein)
0.8 %Cys     (Mature Protein)
1.0 %Met     (Mature Protein)
1.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MMNGKILGSVTPCRVLARVALLLLLSSLQYETAFARQTPPALSLLSSVSSTSVSSNTKYT
CCCCEEECCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHCCCCCCCCEEE
RVSNTNTQEVCVTTNTNVSLLIDPVTSSTKQTLSCTPSLSPQPQTHIYVPYTDTSSYLYV
EECCCCCCEEEEEECCCEEEEEECCCCCCCCEEEECCCCCCCCCEEEEEEEECCCCEEEE
PYITNTHISLYYTDKKADPSSFLTFPHTDIATPYGDEKVISITKTTTNLIALLTTRNIFF
EEEECCEEEEEEECCCCCCCCEEEECCCCCCCCCCCCEEEEEEECCCEEEEEEEECCEEE
FDIHVTEKPKITVPIHKQIDNTYLSDIPSLRNSRYTFSLTHPNKDITIDRYTGQIHLSSL
EEEEECCCCEEEEEHHHHCCCHHHHHCHHHCCCEEEEEEECCCCCEEEEEEECEEEEECC
PTSPITAIAINKDTSTHITYAIDTQYRQIHLDPPKKPRKRDVTPVTNTGVCAAQTYSPTY
CCCCEEEEEEECCCCCEEEEEEECCEEEEECCCCCCCCCCCCCCCCCCCEEEEEECCCCC
ATESLEDMAIRVTNPSWKASSYIPSSYTWSVPPDTTAPIPPSPCGPTKKWSPGDWTPTWV
CCCCCCEEEEEEECCCCCCCCCCCCCCEECCCCCCCCCCCCCCCCCCCCCCCCCCCCCEE
THPTPVDSYATESLEDMIRKFKSQLESPTKKSFSAITGKTFDTKPLLRGGAYFPTSSKTV
ECCCCCCHHHHHHHHHHHHHHHHHHCCCHHHHHHHHCCCCCCCCHHHCCCEECCCCCCEE
GFSTTVWITAPLSSIDLNVPLTNGIQTNVFVYLVSGTFTYTFPTIGAFFTTTPSKGTIRI
CEEEEEEEEECCCCEEEECCCCCCCCCEEEEEEEECEEEEECCCCCEEEEECCCCCEEEE
AWVLPAYDPTWHVPFTTGGMYAIFDGSSATFRDLLNAYSSLSASFTTDTTFYASNSGDIT
EEEEECCCCEEEEEEECCCEEEEECCCCHHHHHHHHHHHHCCCCEECCEEEEECCCCCEE
VTVPLTNGIQTNVFVHLSSGGLSTVVPLMTAYLTASSEISKGTIAAAWAAPAYDPTWHVP
EEEEECCCCEEEEEEEECCCCHHHHHHHHHHHHHCCCCCCCCEEEEEECCCCCCCEEECC
FTTADLYATYDGPTGELVGVFYTPYTINRTVSRGQTVSLSPLPTGTYSFPTYVSYATKPG
EEEEEEEEEECCCCCCEEEEEECCEEEECCCCCCCEEEECCCCCCCCCCCCEEEEECCCC
TNRVPAYLFMNPTNGALVGSVYPYVAQGQYQFPVAGAVYNLHVTGKNKRPKREAAAPCSP
CCCCCEEEEECCCCCEEEECCCCEEECCCEECCEEEEEEEEEEECCCCCCCHHCCCCCCC
TKKWSPGDWTPTWVTHPAPVNSYATESLEDMIRKFKESLKAAS
CCCCCCCCCCCCEEECCCCCCHHHHHHHHHHHHHHHHHHCCCC
>Mature Secondary Structure
MMNGKILGSVTPCRVLARVALLLLLSSLQYETAFARQTPPALSLLSSVSSTSVSSNTKYT
CCCCEEECCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHCCCCCCCCEEE
RVSNTNTQEVCVTTNTNVSLLIDPVTSSTKQTLSCTPSLSPQPQTHIYVPYTDTSSYLYV
EECCCCCCEEEEEECCCEEEEEECCCCCCCCEEEECCCCCCCCCEEEEEEEECCCCEEEE
PYITNTHISLYYTDKKADPSSFLTFPHTDIATPYGDEKVISITKTTTNLIALLTTRNIFF
EEEECCEEEEEEECCCCCCCCEEEECCCCCCCCCCCCEEEEEEECCCEEEEEEEECCEEE
FDIHVTEKPKITVPIHKQIDNTYLSDIPSLRNSRYTFSLTHPNKDITIDRYTGQIHLSSL
EEEEECCCCEEEEEHHHHCCCHHHHHCHHHCCCEEEEEEECCCCCEEEEEEECEEEEECC
PTSPITAIAINKDTSTHITYAIDTQYRQIHLDPPKKPRKRDVTPVTNTGVCAAQTYSPTY
CCCCEEEEEEECCCCCEEEEEEECCEEEEECCCCCCCCCCCCCCCCCCCEEEEEECCCCC
ATESLEDMAIRVTNPSWKASSYIPSSYTWSVPPDTTAPIPPSPCGPTKKWSPGDWTPTWV
CCCCCCEEEEEEECCCCCCCCCCCCCCEECCCCCCCCCCCCCCCCCCCCCCCCCCCCCEE
THPTPVDSYATESLEDMIRKFKSQLESPTKKSFSAITGKTFDTKPLLRGGAYFPTSSKTV
ECCCCCCHHHHHHHHHHHHHHHHHHCCCHHHHHHHHCCCCCCCCHHHCCCEECCCCCCEE
GFSTTVWITAPLSSIDLNVPLTNGIQTNVFVYLVSGTFTYTFPTIGAFFTTTPSKGTIRI
CEEEEEEEEECCCCEEEECCCCCCCCCEEEEEEEECEEEEECCCCCEEEEECCCCCEEEE
AWVLPAYDPTWHVPFTTGGMYAIFDGSSATFRDLLNAYSSLSASFTTDTTFYASNSGDIT
EEEEECCCCEEEEEEECCCEEEEECCCCHHHHHHHHHHHHCCCCEECCEEEEECCCCCEE
VTVPLTNGIQTNVFVHLSSGGLSTVVPLMTAYLTASSEISKGTIAAAWAAPAYDPTWHVP
EEEEECCCCEEEEEEEECCCCHHHHHHHHHHHHHCCCCCCCCEEEEEECCCCCCCEEECC
FTTADLYATYDGPTGELVGVFYTPYTINRTVSRGQTVSLSPLPTGTYSFPTYVSYATKPG
EEEEEEEEEECCCCCCEEEEEECCEEEECCCCCCCEEEECCCCCCCCCCCCEEEEECCCC
TNRVPAYLFMNPTNGALVGSVYPYVAQGQYQFPVAGAVYNLHVTGKNKRPKREAAAPCSP
CCCCCEEEEECCCCCEEEECCCCEEECCCEECCEEEEEEEEEEECCCCCCCHHCCCCCCC
TKKWSPGDWTPTWVTHPAPVNSYATESLEDMIRKFKESLKAAS
CCCCCCCCCCCCEEECCCCCCHHHHHHHHHHHHHHHHHHCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA