Definition Yersinia pseudotuberculosis IP 31758, complete genome.
Accession NC_009708
Length 4,723,306

Click here to switch to the map view.

The map label for this gene is yeaV [H]

Identifier: 153950030

GI number: 153950030

Start: 1755964

End: 1757610

Strand: Direct

Name: yeaV [H]

Synonym: YpsIP31758_1515

Alternate gene names: 153950030

Gene position: 1755964-1757610 (Clockwise)

Preceding gene: 153949373

Following gene: 153949705

Centisome position: 37.18

GC content: 48.88

Gene sequence:

>1647_bases
ATGTTGAACAACCCGAGAAAAGATATACCGCTGATTGTCACCAGTTTGCTCTGCATCATTCTGATTGCTTTGGCATTCAG
CTTATTTCCGCAGCAAAGCAGCCAAATGGCAGAGACCATTTTTAGTGGCGTTACCCGGCTACTGGGATCGACGATCCAAA
TATTAGTGCTGCTTGGCTTAATATTGGTACTTTATATCGCGGTGAGCAAATACGGCAATATTCGTCTGGGTGAGGGAAAG
CCTGAGTATCGTACTATCCCATGGTTGTTTATGTTTATTTGCGCGGGACTTGGTTCATCAACCCTGTATTGGGGGGTGAT
GGAGTGGGCTTATTACTATCAGACACCGGGTCTGAATATTGCGCCAAAAACGCCGAAGGCACTGGAATACAGCGTCAGTT
ACTCCTTCTTTCATTGGGGGATCAGTGCGTGGGCAACTTATGCGTTGGCCTCGCTGATTATGGCTTACCATTTTCATGTC
AGAAAAAACAAAGGGCTAAGTTTGTCGGGGATTATCTCGGCCATTACCGGGGTCAACCCGCAGGGTTTTTGGGGGCGTCT
GGTCGATCTGATCTTTTTAATCGCGACAATAGGGGCGCTGACGATCTCATTAGTGATCACCGCCGCCACATTTACCCGTG
GACTGGCTGCGCTTATCGGCGTGCCTAATAACTTTGCGGTGCAGGCTGGCGTGATGTTGGTAGCGGCAGTTATCTTTTCC
TTTAGTTCGTATATCGGTATTGATCATGGTATGCAGCGCCTGAGCAAAATGGTGGGATGGGGCGCTTTTGGTTTTGCCGT
TCTGGTGCTTTTAGTGGGGCCAACTGAATTCATTATCAATAACACCATTAACTCCATCGGATTAACCACACAAAATTTCC
TGCAAATGAGCCTGTTCACCGACCCTATGGGGGATGGCCGCTTTACCCGCAGTTGGACGGTCTTTTATTGGTTATGGTGG
ATTTCATATACCCCCGGTGTTGCGATGTTTGTGACGCGGGTTTCACGTGGTCGCAAACTCAAAGAGGTTATATGGGCTTT
GCTGCTGGGCAGTTCGCTGGGCTGCTGGTTCTTCTTTGGGGTACTGGAAAGCTACGCGATACAACAGTTTATTAGTGGTG
CGTTAGATGTTCCCCTCATCCTAAATACTCAGGGCGGGGAAACTGCGGTACAAATGCTGCTCAGCGCGCTACCCATGGGC
AAATTATTCCTTGCTGCCTATCTGTTCATCATGATTATTTTCCTGGCTTCACATATGGATGCGGTGGCGTACTGTATGGC
GGCAACCAGCACCCGTAATCTGCGGGAAGGCGAAGATCCTAATCGTATGCTGCGGCTGTTTTGGTGTGTAGTGATTACAC
TGATCCCTCTCTCTATTCTGTTTGCTGGTGCCTCGTTGGATACCATGAAAACGACGGTTGTGCTCACTGCGCTGCCTTTT
TTATTGATTCTCTTGATCGAGGTTTATGGCTTTATCCGCTGGATTAAGCAGGATTATGCCCATGTTCCCGCGCACCTTAT
TGAGCAAAGTACCCCGCAAGTCATGTTGCCGGCTGAATCTTTACCGCCTGCTACTGCGTCAATGTTAGTCGTGGAAACTT
TAGTCGTGGAAACTGCGGCGCCACCCGCCAGTAAGCATAACCAGTAA

Upstream 100 bases:

>100_bases
AGACGAAATAAACAGAGGATAAAACACCGTGCCATAACAAAAATAAAAGCGAGGTGACAGCCCTTTAATGAGCGCACCTC
TCTATAAGCAGGAGCTTCTC

Downstream 100 bases:

>100_bases
GCATAAATAGCAGGCTCTGTTTTTACGTTTCTATGTCGTTGTATGCCGTGTCGGTATTCCCTAAATGTATGACTAAAAAT
TTTACCTATAACACCAAGAT

Product: transporter

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 548; Mature: 548

Protein sequence:

>548_residues
MLNNPRKDIPLIVTSLLCIILIALAFSLFPQQSSQMAETIFSGVTRLLGSTIQILVLLGLILVLYIAVSKYGNIRLGEGK
PEYRTIPWLFMFICAGLGSSTLYWGVMEWAYYYQTPGLNIAPKTPKALEYSVSYSFFHWGISAWATYALASLIMAYHFHV
RKNKGLSLSGIISAITGVNPQGFWGRLVDLIFLIATIGALTISLVITAATFTRGLAALIGVPNNFAVQAGVMLVAAVIFS
FSSYIGIDHGMQRLSKMVGWGAFGFAVLVLLVGPTEFIINNTINSIGLTTQNFLQMSLFTDPMGDGRFTRSWTVFYWLWW
ISYTPGVAMFVTRVSRGRKLKEVIWALLLGSSLGCWFFFGVLESYAIQQFISGALDVPLILNTQGGETAVQMLLSALPMG
KLFLAAYLFIMIIFLASHMDAVAYCMAATSTRNLREGEDPNRMLRLFWCVVITLIPLSILFAGASLDTMKTTVVLTALPF
LLILLIEVYGFIRWIKQDYAHVPAHLIEQSTPQVMLPAESLPPATASMLVVETLVVETAAPPASKHNQ

Sequences:

>Translated_548_residues
MLNNPRKDIPLIVTSLLCIILIALAFSLFPQQSSQMAETIFSGVTRLLGSTIQILVLLGLILVLYIAVSKYGNIRLGEGK
PEYRTIPWLFMFICAGLGSSTLYWGVMEWAYYYQTPGLNIAPKTPKALEYSVSYSFFHWGISAWATYALASLIMAYHFHV
RKNKGLSLSGIISAITGVNPQGFWGRLVDLIFLIATIGALTISLVITAATFTRGLAALIGVPNNFAVQAGVMLVAAVIFS
FSSYIGIDHGMQRLSKMVGWGAFGFAVLVLLVGPTEFIINNTINSIGLTTQNFLQMSLFTDPMGDGRFTRSWTVFYWLWW
ISYTPGVAMFVTRVSRGRKLKEVIWALLLGSSLGCWFFFGVLESYAIQQFISGALDVPLILNTQGGETAVQMLLSALPMG
KLFLAAYLFIMIIFLASHMDAVAYCMAATSTRNLREGEDPNRMLRLFWCVVITLIPLSILFAGASLDTMKTTVVLTALPF
LLILLIEVYGFIRWIKQDYAHVPAHLIEQSTPQVMLPAESLPPATASMLVVETLVVETAAPPASKHNQ
>Mature_548_residues
MLNNPRKDIPLIVTSLLCIILIALAFSLFPQQSSQMAETIFSGVTRLLGSTIQILVLLGLILVLYIAVSKYGNIRLGEGK
PEYRTIPWLFMFICAGLGSSTLYWGVMEWAYYYQTPGLNIAPKTPKALEYSVSYSFFHWGISAWATYALASLIMAYHFHV
RKNKGLSLSGIISAITGVNPQGFWGRLVDLIFLIATIGALTISLVITAATFTRGLAALIGVPNNFAVQAGVMLVAAVIFS
FSSYIGIDHGMQRLSKMVGWGAFGFAVLVLLVGPTEFIINNTINSIGLTTQNFLQMSLFTDPMGDGRFTRSWTVFYWLWW
ISYTPGVAMFVTRVSRGRKLKEVIWALLLGSSLGCWFFFGVLESYAIQQFISGALDVPLILNTQGGETAVQMLLSALPMG
KLFLAAYLFIMIIFLASHMDAVAYCMAATSTRNLREGEDPNRMLRLFWCVVITLIPLSILFAGASLDTMKTTVVLTALPF
LLILLIEVYGFIRWIKQDYAHVPAHLIEQSTPQVMLPAESLPPATASMLVVETLVVETAAPPASKHNQ

Specific function: Unknown

COG id: COG1292

COG function: function code M; Choline-glycine betaine transporter

Gene ontology:

Cell location: Cell inner membrane; Multi-pass membrane protein (Probable) [H]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the BCCT transporter (TC 2.A.15) family [H]

Homologues:

Organism=Escherichia coli, GI1788102, Length=467, Percent_Identity=78.5867237687366, Blast_Score=760, Evalue=0.0,
Organism=Escherichia coli, GI1786224, Length=493, Percent_Identity=26.7748478701826, Blast_Score=227, Evalue=1e-60,
Organism=Escherichia coli, GI1786506, Length=508, Percent_Identity=25.7874015748031, Blast_Score=171, Evalue=9e-44,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR000060
- InterPro:   IPR018093 [H]

Pfam domain/function: PF02028 BCCT [H]

EC number: NA

Molecular weight: Translated: 60389; Mature: 60389

Theoretical pI: Translated: 8.98; Mature: 8.98

Prosite motif: PS00888 CNMP_BINDING_1 ; PS01303 BCCT

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.9 %Cys     (Translated Protein)
3.6 %Met     (Translated Protein)
4.6 %Cys+Met (Translated Protein)
0.9 %Cys     (Mature Protein)
3.6 %Met     (Mature Protein)
4.6 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MLNNPRKDIPLIVTSLLCIILIALAFSLFPQQSSQMAETIFSGVTRLLGSTIQILVLLGL
CCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHH
ILVLYIAVSKYGNIRLGEGKPEYRTIPWLFMFICAGLGSSTLYWGVMEWAYYYQTPGLNI
HHHHHHHHHCCCCEEECCCCCCCCHHHHHHHHHHHCCCCCHHHHHHHHHHHHHCCCCCCC
APKTPKALEYSVSYSFFHWGISAWATYALASLIMAYHFHVRKNKGLSLSGIISAITGVNP
CCCCCCCEEEEEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHCCCC
QGFWGRLVDLIFLIATIGALTISLVITAATFTRGLAALIGVPNNFAVQAGVMLVAAVIFS
CCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHH
FSSYIGIDHGMQRLSKMVGWGAFGFAVLVLLVGPTEFIINNTINSIGLTTQNFLQMSLFT
HHHHHCHHHHHHHHHHHHCCHHHHHHHHHHHHCCHHHHHHCCHHHCCCCHHHHHHHHHHC
DPMGDGRFTRSWTVFYWLWWISYTPGVAMFVTRVSRGRKLKEVIWALLLGSSLGCWFFFG
CCCCCCCEEHHHHHHHHHHHHHHCCCHHHHHHHHHHCCHHHHHHHHHHHCCCHHHHHHHH
VLESYAIQQFISGALDVPLILNTQGGETAVQMLLSALPMGKLFLAAYLFIMIIFLASHMD
HHHHHHHHHHHHCCCCCCEEEECCCCHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHH
AVAYCMAATSTRNLREGEDPNRMLRLFWCVVITLIPLSILFAGASLDTMKTTVVLTALPF
HHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHH
LLILLIEVYGFIRWIKQDYAHVPAHLIEQSTPQVMLPAESLPPATASMLVVETLVVETAA
HHHHHHHHHHHHHHHHHHHHHCCHHHHHCCCCCEEECCCCCCCHHHHHHHHHHHHHHCCC
PPASKHNQ
CCCCCCCC
>Mature Secondary Structure
MLNNPRKDIPLIVTSLLCIILIALAFSLFPQQSSQMAETIFSGVTRLLGSTIQILVLLGL
CCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHH
ILVLYIAVSKYGNIRLGEGKPEYRTIPWLFMFICAGLGSSTLYWGVMEWAYYYQTPGLNI
HHHHHHHHHCCCCEEECCCCCCCCHHHHHHHHHHHCCCCCHHHHHHHHHHHHHCCCCCCC
APKTPKALEYSVSYSFFHWGISAWATYALASLIMAYHFHVRKNKGLSLSGIISAITGVNP
CCCCCCCEEEEEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHCCCC
QGFWGRLVDLIFLIATIGALTISLVITAATFTRGLAALIGVPNNFAVQAGVMLVAAVIFS
CCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHH
FSSYIGIDHGMQRLSKMVGWGAFGFAVLVLLVGPTEFIINNTINSIGLTTQNFLQMSLFT
HHHHHCHHHHHHHHHHHHCCHHHHHHHHHHHHCCHHHHHHCCHHHCCCCHHHHHHHHHHC
DPMGDGRFTRSWTVFYWLWWISYTPGVAMFVTRVSRGRKLKEVIWALLLGSSLGCWFFFG
CCCCCCCEEHHHHHHHHHHHHHHCCCHHHHHHHHHHCCHHHHHHHHHHHCCCHHHHHHHH
VLESYAIQQFISGALDVPLILNTQGGETAVQMLLSALPMGKLFLAAYLFIMIIFLASHMD
HHHHHHHHHHHHCCCCCCEEEECCCCHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHH
AVAYCMAATSTRNLREGEDPNRMLRLFWCVVITLIPLSILFAGASLDTMKTTVVLTALPF
HHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHH
LLILLIEVYGFIRWIKQDYAHVPAHLIEQSTPQVMLPAESLPPATASMLVVETLVVETAA
HHHHHHHHHHHHHHHHHHHHHCCHHHHHCCCCCEEECCCCCCCHHHHHHHHHHHHHHCCC
PPASKHNQ
CCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 11206551; 11258796 [H]