The gene/protein map for NC_006155 is currently unavailable.
Definition Yersinia pseudotuberculosis IP 32953, complete genome.
Accession NC_006155
Length 4,744,671

Click here to switch to the map view.

The map label for this gene is 51597842

Identifier: 51597842

GI number: 51597842

Start: 4218022

End: 4220514

Strand: Direct

Name: 51597842

Synonym: YPTB3551

Alternate gene names: NA

Gene position: 4218022-4220514 (Clockwise)

Preceding gene: 51597841

Following gene: 51597843

Centisome position: 88.9

GC content: 38.99

Gene sequence:

>2493_bases
ATGCAAGATAATATCGACCATACTGCATCCGTTATAGCGGATACTGATAATACGATTCATCAGCAAGCCAAAGCAGAAGA
GCGCCACCGCCAGGCCGTCAGGCGGGCAACACAGCTACGCAACGATCCGGTACTCAGTGGCATCAATAAACTGGCCTTTT
CTGTTGCACCAAAAATATTGCAGCCTGAAGCCAGAACAGATCTTTCACTGGCCGAAGGAATACCAGAACGAGCAAATGAG
TATGCCGATCCGGCATCTATCCAATCCTTGTTCTCTCCGGGCCGCTATTTATGCGAATTGTATCATGTAGCAAAAGAGTT
ACATGAAGATGGAAACAAACTGCATATCGATAAACGCCGCCCTGATTTACAAGAGCTGGTGCTTAGTAACAGTAATATGA
ATCAAGAAGTCTCTTCGCTGGAGATCTTACTCAATGTACTGCAAACGAAGACGCCTCTGGATGAGCTGACTAAAGATACC
GAAGCACACGCAAATGACAGTTCTTTCACCCTGCCTTATGACGATAACCTGACAGTCATTAATGCAATACTGGAAGATAA
AGCTATCAGTCTGCGAGAAATTGCAGTGCTACTGACGGAGGAGAGTGATTTTAGCCCTACACCCGCATTAGTACAGGAAC
AACTGGGATTGAATCCGGCCAGTTATGCATTAATTGATATAAAATCCCCATTGGATGAGAGTTACGCCAAACGCCTGGCA
CATGCCACGCAACTCAGTGTTGAACAACTGCAATGGCTTAATAAAAATGCCATTGAAAATAGCAGCAATAAAAATGATCC
AGCCAAACTCGAAATACTCGCAGTCATCTCCGAATATCGCCGTTTACATCAGCGTTACGGCCTGTCTGTCGATCCGTTTA
TCGCCATTATTAATGCCGTTAACACCACCCATACCAACGAAAATAAAACCAGTTTCTTCCAGCAGATTTTCTCTACCCTT
GATGTAGATGCAGGATTTAACTTCCTTGATCAGGGTTCGTGGGAAGTGATTATCCGCAAGGCATTGGGCATTACTGCCGA
AGAACTGTTACGTATTGCGAAATATTGCTTTGGTAAGAGTTCAATTAGCAACGTAAAGATGAATAGTAAAAAATTCAGCC
AATTATACCGTATGGCAATGATCCCCCGCACACTTGGTGTGAGTTTCTCGCAAGCTGAATATCTATGGCAGTTATATAGC
CATTCAGATGAAAATATTATGGAAAAAATAGCCCAGGGTAATGCTCTGACCATTATTGATGCCATTATTGTGCTAGAAAA
TACCCTTCAATGGATGAGTGAGCAAAAACTGGATATCACCACCCTACAAGCCATGCTCACCAAGCAATACAGCACCACAG
CGACCCCTGAATTATTTAATTTCTTATCCAATATTTATCAAACCTTAGGTAAGCAAGTTTATTCCGAATCGCTCAAACCT
AATCTGTATCGCAGCTTGGCAAACGGCTTCCACCTAAAAGCTAATGTAGTCGCAGGGCTGGTCAATTGGTTAGCAAAAAA
TGACTCTGAATTTACCTTAGAAAGATTTTGGCAAAATATTTCCATGACCTTTGCTGAAGAGCCTTCATTGCACCAACTGG
AAGTCCATCAACCCTTGCTTATTCAATGCCAAAAACTGAGCCAATACGTATTAATTGCGCAATGGGCAGAGTTGTCTGAA
CAAGAGATAGCATTAATCTTATTACCCAATGGCATTGATAATAGAGGCAGTGCCCCTTCTCCAAGTATCACGCTGTTAAA
GTTATTATCTGAATTTAAGTTATGCCAACAAGAGGCTAAGGTGTCACAAAGCGAATTATTTGACATTATGCAACAGCTGA
TTACTAATACAAATGAAAAACAAGAAAAATTAAGAAATTCAGCAGATAAAGTAATAAGGTCAATAGCAAAAAGCATTGGT
TCTATAAATAACAGCATGGATGATATTGATTCAACCATATCGATTAGAAATGGTAGCGCAACACTGTTCCCCCCAGAACA
CCCCATGTATAAAGCACTTAAACTTGAAGTATCAAACCTTGAAAAATCAAAAATTCAGTTAGAAGGTAAAAAGAAAGAAG
AGGAGATAAAACTAGAACAGGCCAAAGACAATATACAGTCACTAATTAATAATTGGGACAGTGAAATAATCATACGTTTG
GCAGACGCATACCATTGGGATATAAACATTGCTAATAGTATGTTTATACTTATTTTTGGCGAAAAGATAAACTTCACTTT
CCATTATGAGAATAGAAATGATTATCATTATGAAGAACACTATGGTTATCGTTTTGAACAAAAACCAATGTATAGTTTTG
ATAAAAAATTGACTAATGGGTTTGGATCAATCTTATTATTGAAAAATCACATTTATATCGCTGAAAAATTAAAAATCCAT
CCTGGAACCATAATTAAAATAAAAAACTATATTTTTGATGATAAGAGTAACGAGTTAGAGAATATCGCCAACAAGCTAAG
AGTTAATCTTTAA

Upstream 100 bases:

>100_bases
ATTCCGAGGAATTTACGCAGGCAAGTTATTTAGGTAAGCACATCGTTAACACCTGCTGTTTCACATCCCAAGCTAATGTC
CTTAAATATAGAGGTAAATT

Downstream 100 bases:

>100_bases
AAAAACGTTATTACATCCAAATTTAATAGGAATAATAATCATGCCTACTAGCACTGTATTAAATAAAATTAACGAATCGC
GCCGCGACGCATTGGTTAAC

Product: insecticial toxin

Products: NA

Alternate protein names: A Component Of Insecticidal xin Complex; Insecticidal xin Complex Protein TcaA; Insecticial xin; Xin A; Insecticial xin Complex Protein

Number of amino acids: Translated: 830; Mature: 830

Protein sequence:

>830_residues
MQDNIDHTASVIADTDNTIHQQAKAEERHRQAVRRATQLRNDPVLSGINKLAFSVAPKILQPEARTDLSLAEGIPERANE
YADPASIQSLFSPGRYLCELYHVAKELHEDGNKLHIDKRRPDLQELVLSNSNMNQEVSSLEILLNVLQTKTPLDELTKDT
EAHANDSSFTLPYDDNLTVINAILEDKAISLREIAVLLTEESDFSPTPALVQEQLGLNPASYALIDIKSPLDESYAKRLA
HATQLSVEQLQWLNKNAIENSSNKNDPAKLEILAVISEYRRLHQRYGLSVDPFIAIINAVNTTHTNENKTSFFQQIFSTL
DVDAGFNFLDQGSWEVIIRKALGITAEELLRIAKYCFGKSSISNVKMNSKKFSQLYRMAMIPRTLGVSFSQAEYLWQLYS
HSDENIMEKIAQGNALTIIDAIIVLENTLQWMSEQKLDITTLQAMLTKQYSTTATPELFNFLSNIYQTLGKQVYSESLKP
NLYRSLANGFHLKANVVAGLVNWLAKNDSEFTLERFWQNISMTFAEEPSLHQLEVHQPLLIQCQKLSQYVLIAQWAELSE
QEIALILLPNGIDNRGSAPSPSITLLKLLSEFKLCQQEAKVSQSELFDIMQQLITNTNEKQEKLRNSADKVIRSIAKSIG
SINNSMDDIDSTISIRNGSATLFPPEHPMYKALKLEVSNLEKSKIQLEGKKKEEEIKLEQAKDNIQSLINNWDSEIIIRL
ADAYHWDINIANSMFILIFGEKINFTFHYENRNDYHYEEHYGYRFEQKPMYSFDKKLTNGFGSILLLKNHIYIAEKLKIH
PGTIIKIKNYIFDDKSNELENIANKLRVNL

Sequences:

>Translated_830_residues
MQDNIDHTASVIADTDNTIHQQAKAEERHRQAVRRATQLRNDPVLSGINKLAFSVAPKILQPEARTDLSLAEGIPERANE
YADPASIQSLFSPGRYLCELYHVAKELHEDGNKLHIDKRRPDLQELVLSNSNMNQEVSSLEILLNVLQTKTPLDELTKDT
EAHANDSSFTLPYDDNLTVINAILEDKAISLREIAVLLTEESDFSPTPALVQEQLGLNPASYALIDIKSPLDESYAKRLA
HATQLSVEQLQWLNKNAIENSSNKNDPAKLEILAVISEYRRLHQRYGLSVDPFIAIINAVNTTHTNENKTSFFQQIFSTL
DVDAGFNFLDQGSWEVIIRKALGITAEELLRIAKYCFGKSSISNVKMNSKKFSQLYRMAMIPRTLGVSFSQAEYLWQLYS
HSDENIMEKIAQGNALTIIDAIIVLENTLQWMSEQKLDITTLQAMLTKQYSTTATPELFNFLSNIYQTLGKQVYSESLKP
NLYRSLANGFHLKANVVAGLVNWLAKNDSEFTLERFWQNISMTFAEEPSLHQLEVHQPLLIQCQKLSQYVLIAQWAELSE
QEIALILLPNGIDNRGSAPSPSITLLKLLSEFKLCQQEAKVSQSELFDIMQQLITNTNEKQEKLRNSADKVIRSIAKSIG
SINNSMDDIDSTISIRNGSATLFPPEHPMYKALKLEVSNLEKSKIQLEGKKKEEEIKLEQAKDNIQSLINNWDSEIIIRL
ADAYHWDINIANSMFILIFGEKINFTFHYENRNDYHYEEHYGYRFEQKPMYSFDKKLTNGFGSILLLKNHIYIAEKLKIH
PGTIIKIKNYIFDDKSNELENIANKLRVNL
>Mature_830_residues
MQDNIDHTASVIADTDNTIHQQAKAEERHRQAVRRATQLRNDPVLSGINKLAFSVAPKILQPEARTDLSLAEGIPERANE
YADPASIQSLFSPGRYLCELYHVAKELHEDGNKLHIDKRRPDLQELVLSNSNMNQEVSSLEILLNVLQTKTPLDELTKDT
EAHANDSSFTLPYDDNLTVINAILEDKAISLREIAVLLTEESDFSPTPALVQEQLGLNPASYALIDIKSPLDESYAKRLA
HATQLSVEQLQWLNKNAIENSSNKNDPAKLEILAVISEYRRLHQRYGLSVDPFIAIINAVNTTHTNENKTSFFQQIFSTL
DVDAGFNFLDQGSWEVIIRKALGITAEELLRIAKYCFGKSSISNVKMNSKKFSQLYRMAMIPRTLGVSFSQAEYLWQLYS
HSDENIMEKIAQGNALTIIDAIIVLENTLQWMSEQKLDITTLQAMLTKQYSTTATPELFNFLSNIYQTLGKQVYSESLKP
NLYRSLANGFHLKANVVAGLVNWLAKNDSEFTLERFWQNISMTFAEEPSLHQLEVHQPLLIQCQKLSQYVLIAQWAELSE
QEIALILLPNGIDNRGSAPSPSITLLKLLSEFKLCQQEAKVSQSELFDIMQQLITNTNEKQEKLRNSADKVIRSIAKSIG
SINNSMDDIDSTISIRNGSATLFPPEHPMYKALKLEVSNLEKSKIQLEGKKKEEEIKLEQAKDNIQSLINNWDSEIIIRL
ADAYHWDINIANSMFILIFGEKINFTFHYENRNDYHYEEHYGYRFEQKPMYSFDKKLTNGFGSILLLKNHIYIAEKLKIH
PGTIIKIKNYIFDDKSNELENIANKLRVNL

Specific function: Unknown

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 94533; Mature: 94533

Theoretical pI: Translated: 5.55; Mature: 5.55

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.5 %Cys     (Translated Protein)
1.7 %Met     (Translated Protein)
2.2 %Cys+Met (Translated Protein)
0.5 %Cys     (Mature Protein)
1.7 %Met     (Mature Protein)
2.2 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MQDNIDHTASVIADTDNTIHQQAKAEERHRQAVRRATQLRNDPVLSGINKLAFSVAPKIL
CCCCCCHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHH
QPEARTDLSLAEGIPERANEYADPASIQSLFSPGRYLCELYHVAKELHEDGNKLHIDKRR
CCCCCCCCHHHHCCCHHHHHCCCHHHHHHHHCCHHHHHHHHHHHHHHHCCCCEEEECCCC
PDLQELVLSNSNMNQEVSSLEILLNVLQTKTPLDELTKDTEAHANDSSFTLPYDDNLTVI
CCHHHHHHCCCCCCHHHHHHHHHHHHHHCCCCHHHHHCCHHCCCCCCCEECCCCCCHHHH
NAILEDKAISLREIAVLLTEESDFSPTPALVQEQLGLNPASYALIDIKSPLDESYAKRLA
HHHHHHCCHHHHHHEEEEECCCCCCCCHHHHHHHHCCCHHHEEEEEECCCCCHHHHHHHH
HATQLSVEQLQWLNKNAIENSSNKNDPAKLEILAVISEYRRLHQRYGLSVDPFIAIINAV
HHHHHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHH
NTTHTNENKTSFFQQIFSTLDVDAGFNFLDQGSWEVIIRKALGITAEELLRIAKYCFGKS
HCCCCCCHHHHHHHHHHHHHCCCCCCCCCCCCCHHHHHHHHHCCCHHHHHHHHHHHCCCC
SISNVKMNSKKFSQLYRMAMIPRTLGVSFSQAEYLWQLYSHSDENIMEKIAQGNALTIID
CCCCCCCCHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHCCCHHHHHHHHCCCCHHHHH
AIIVLENTLQWMSEQKLDITTLQAMLTKQYSTTATPELFNFLSNIYQTLGKQVYSESLKP
HHHHHHHHHHHHHCCCCHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCH
NLYRSLANGFHLKANVVAGLVNWLAKNDSEFTLERFWQNISMTFAEEPSLHQLEVHQPLL
HHHHHHHCCCEEHHHHHHHHHHHHHCCCCHHHHHHHHHHCCEEECCCCCCCEEECCCHHH
IQCQKLSQYVLIAQWAELSEQEIALILLPNGIDNRGSAPSPSITLLKLLSEFKLCQQEAK
HHHHHHHHHHHHHHHHHCCCCCEEEEEECCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHH
VSQSELFDIMQQLITNTNEKQEKLRNSADKVIRSIAKSIGSINNSMDDIDSTISIRNGSA
CCHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHCCEEEEECCCE
TLFPPEHPMYKALKLEVSNLEKSKIQLEGKKKEEEIKLEQAKDNIQSLINNWDSEIIIRL
EECCCCCCHHHHHHHHHHHCCHHHEEECCCCCHHHHHHHHHHHHHHHHHHCCCHHEEEEE
ADAYHWDINIANSMFILIFGEKINFTFHYENRNDYHYEEHYGYRFEQKPMYSFDKKLTNG
CCCEEEEEEECCCEEEEEEECEEEEEEEECCCCCCCHHHHCCCCCCCCCHHHHHHHHHCC
FGSILLLKNHIYIAEKLKIHPGTIIKIKNYIFDDKSNELENIANKLRVNL
CCCEEEEECCEEEEEEEEECCCCEEEEECHHCCCCCHHHHHHHHHHCCCC
>Mature Secondary Structure
MQDNIDHTASVIADTDNTIHQQAKAEERHRQAVRRATQLRNDPVLSGINKLAFSVAPKIL
CCCCCCHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHH
QPEARTDLSLAEGIPERANEYADPASIQSLFSPGRYLCELYHVAKELHEDGNKLHIDKRR
CCCCCCCCHHHHCCCHHHHHCCCHHHHHHHHCCHHHHHHHHHHHHHHHCCCCEEEECCCC
PDLQELVLSNSNMNQEVSSLEILLNVLQTKTPLDELTKDTEAHANDSSFTLPYDDNLTVI
CCHHHHHHCCCCCCHHHHHHHHHHHHHHCCCCHHHHHCCHHCCCCCCCEECCCCCCHHHH
NAILEDKAISLREIAVLLTEESDFSPTPALVQEQLGLNPASYALIDIKSPLDESYAKRLA
HHHHHHCCHHHHHHEEEEECCCCCCCCHHHHHHHHCCCHHHEEEEEECCCCCHHHHHHHH
HATQLSVEQLQWLNKNAIENSSNKNDPAKLEILAVISEYRRLHQRYGLSVDPFIAIINAV
HHHHHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHH
NTTHTNENKTSFFQQIFSTLDVDAGFNFLDQGSWEVIIRKALGITAEELLRIAKYCFGKS
HCCCCCCHHHHHHHHHHHHHCCCCCCCCCCCCCHHHHHHHHHCCCHHHHHHHHHHHCCCC
SISNVKMNSKKFSQLYRMAMIPRTLGVSFSQAEYLWQLYSHSDENIMEKIAQGNALTIID
CCCCCCCCHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHCCCHHHHHHHHCCCCHHHHH
AIIVLENTLQWMSEQKLDITTLQAMLTKQYSTTATPELFNFLSNIYQTLGKQVYSESLKP
HHHHHHHHHHHHHCCCCHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCH
NLYRSLANGFHLKANVVAGLVNWLAKNDSEFTLERFWQNISMTFAEEPSLHQLEVHQPLL
HHHHHHHCCCEEHHHHHHHHHHHHHCCCCHHHHHHHHHHCCEEECCCCCCCEEECCCHHH
IQCQKLSQYVLIAQWAELSEQEIALILLPNGIDNRGSAPSPSITLLKLLSEFKLCQQEAK
HHHHHHHHHHHHHHHHHCCCCCEEEEEECCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHH
VSQSELFDIMQQLITNTNEKQEKLRNSADKVIRSIAKSIGSINNSMDDIDSTISIRNGSA
CCHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHCCEEEEECCCE
TLFPPEHPMYKALKLEVSNLEKSKIQLEGKKKEEEIKLEQAKDNIQSLINNWDSEIIIRL
EECCCCCCHHHHHHHHHHHCCHHHEEECCCCCHHHHHHHHHHHHHHHHHHCCCHHEEEEE
ADAYHWDINIANSMFILIFGEKINFTFHYENRNDYHYEEHYGYRFEQKPMYSFDKKLTNG
CCCEEEEEEECCCEEEEEEECEEEEEEEECCCCCCCHHHHCCCCCCCCCHHHHHHHHHCC
FGSILLLKNHIYIAEKLKIHPGTIIKIKNYIFDDKSNELENIANKLRVNL
CCCEEEEECCEEEEEEEEECCCCEEEEECHHCCCCCHHHHHHHHHHCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA