Definition Vibrio splendidus LGP32 chromosome 1, complete genome.
Accession NC_011753
Length 3,299,303

Click here to switch to the map view.

The map label for this gene is ydiU [C]

Identifier: 218708872

GI number: 218708872

Start: 895173

End: 896630

Strand: Direct

Name: ydiU [C]

Synonym: VS_0872

Alternate gene names: 218708872

Gene position: 895173-896630 (Clockwise)

Preceding gene: 218708871

Following gene: 218708873

Centisome position: 27.13

GC content: 47.05

Gene sequence:

>1458_bases
ATGTCTGTCTGGGATTCTATTTCATTTAACAATCGATTTACTGCATTACCTCGACTGTTCTATACCCCAATTCAACCTAC
ACCGTTAAACAATGTCCAATGGCTCGCATGGAACCATAACCTTGCGAATGAACTAGGCTTTCCGTCATTTGAATGCACTT
CCGAGGAGTTGCTTGAGACGTTATCAGGCAATGTTGAACCTGAGCAATTTTCGCCAGTAGCAATGAAATACGCAGGCCAC
CAGTTTGGCTCTTATAACCCTGATTTAGGTGATGGAAGAGGGCTGTTATTAGCTCAAGTTGTCGCGAAAAGTGGTGAAAC
GTTCGACTTACACCTTAAAGGTGCGGGTAAAACTCCCTATTCTCGTATGGGCGATGGTCGTGCTGTTATTCGATCAACGG
TTCGTGAGTATCTATGTAGCGAAGCGATGGCGGGGCTTAATATCCCAACTACTCGCGCATTGGCGATGATGACTAGCGAC
ACACCCGTTTATCGAGAGAAGCAAGAGTGGGGCGCATTGCTGGTGCGTGCTGCTGAGTCACACATCCGTTTCGGTCACTT
TGAACATCTGTTTTATACCAATCAGTTGGCAGAACATAAATTATTGGCCGATAAAGTCATCGAATGGCACTTCCCGGAAT
GCCTCGATGACGACAAACCCTACGCTGCTATGTTTAATCAGATTGTTGATCGCACTGCGGAAATGGTCGCGCTGTGGCAA
GCGAATGGTTTTGCTCATGGGGTGATGAACACCGATAACATGTCGATCATAGGGCAAACCTTCGATTATGGCCCGTTCGC
CTTCTTAGATGAATATGACCCTCGCTTGATCTGTAATCACTCCGACTATCAAGGTCGTTATGCCTTTAATCAGCAGCCTA
GAATTGGATTATGGAATTTGTCGGCACTGGCTCATTCTCTTTCGCCGCTGGTGGATAAAGCCGATTTAGAGGCCGCGTTA
GAACAGTACGAACCACAAATGAACGGTTATTTCAGTCAGCTGATGCGCCGTAAGTTAGGATTGCTTTCGAAACACGAAGG
TGACAGTCGCTTGTTTGAATCTATGTTCGAGCTGATGTCGCAAAACAAAGTCGATTACCCAAGATTCTTTAGAACGCTAT
CGAACCTAGATACATTGCTGCCGCAAGACGTGATTGATTTGGTTATCGACCGCGAGGCCGCAAAGCTATGGGTGGATAAC
TACTTGCAACGCTGTGAATTGGAAGAGAGTTCAGTGGCCGAGCGCTGTGAAAAGATGCGACAAGTAAACCCGAAATACAT
CCTCAGAAACTACCTAGCCCAGCTTGCGATAGATAAAGCTGAGCGCGGTGATAGCAGCGATATTGATGCACTAATGGTGG
TGCTGGCAGACCCTTATGCGGAACATCCTGACTACGAACATCTTGCTGCCTTGCCGCCTGAGTGGGGCAAAGCCATGGAA
ATCAGCTGTTCCTCTTAA

Upstream 100 bases:

>100_bases
TAGCCCCCTTTATCTCAATAGACTCACTGCATAACCTGATCTGAAGTTGTTATCAAACTGTGATAATCTTAAGTCATCTT
TTATCTACAGTGTATCTCTC

Downstream 100 bases:

>100_bases
CCCTCTATGATTCTTTGAGTCGCTAAGTACAGGTAGAGGTCACTAAGATGTGATCTTTATCTGTTTGTTCGTCTAACTTT
ACAAACATGTCAATAATCAA

Product: hypothetical protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 485; Mature: 484

Protein sequence:

>485_residues
MSVWDSISFNNRFTALPRLFYTPIQPTPLNNVQWLAWNHNLANELGFPSFECTSEELLETLSGNVEPEQFSPVAMKYAGH
QFGSYNPDLGDGRGLLLAQVVAKSGETFDLHLKGAGKTPYSRMGDGRAVIRSTVREYLCSEAMAGLNIPTTRALAMMTSD
TPVYREKQEWGALLVRAAESHIRFGHFEHLFYTNQLAEHKLLADKVIEWHFPECLDDDKPYAAMFNQIVDRTAEMVALWQ
ANGFAHGVMNTDNMSIIGQTFDYGPFAFLDEYDPRLICNHSDYQGRYAFNQQPRIGLWNLSALAHSLSPLVDKADLEAAL
EQYEPQMNGYFSQLMRRKLGLLSKHEGDSRLFESMFELMSQNKVDYPRFFRTLSNLDTLLPQDVIDLVIDREAAKLWVDN
YLQRCELEESSVAERCEKMRQVNPKYILRNYLAQLAIDKAERGDSSDIDALMVVLADPYAEHPDYEHLAALPPEWGKAME
ISCSS

Sequences:

>Translated_485_residues
MSVWDSISFNNRFTALPRLFYTPIQPTPLNNVQWLAWNHNLANELGFPSFECTSEELLETLSGNVEPEQFSPVAMKYAGH
QFGSYNPDLGDGRGLLLAQVVAKSGETFDLHLKGAGKTPYSRMGDGRAVIRSTVREYLCSEAMAGLNIPTTRALAMMTSD
TPVYREKQEWGALLVRAAESHIRFGHFEHLFYTNQLAEHKLLADKVIEWHFPECLDDDKPYAAMFNQIVDRTAEMVALWQ
ANGFAHGVMNTDNMSIIGQTFDYGPFAFLDEYDPRLICNHSDYQGRYAFNQQPRIGLWNLSALAHSLSPLVDKADLEAAL
EQYEPQMNGYFSQLMRRKLGLLSKHEGDSRLFESMFELMSQNKVDYPRFFRTLSNLDTLLPQDVIDLVIDREAAKLWVDN
YLQRCELEESSVAERCEKMRQVNPKYILRNYLAQLAIDKAERGDSSDIDALMVVLADPYAEHPDYEHLAALPPEWGKAME
ISCSS
>Mature_484_residues
SVWDSISFNNRFTALPRLFYTPIQPTPLNNVQWLAWNHNLANELGFPSFECTSEELLETLSGNVEPEQFSPVAMKYAGHQ
FGSYNPDLGDGRGLLLAQVVAKSGETFDLHLKGAGKTPYSRMGDGRAVIRSTVREYLCSEAMAGLNIPTTRALAMMTSDT
PVYREKQEWGALLVRAAESHIRFGHFEHLFYTNQLAEHKLLADKVIEWHFPECLDDDKPYAAMFNQIVDRTAEMVALWQA
NGFAHGVMNTDNMSIIGQTFDYGPFAFLDEYDPRLICNHSDYQGRYAFNQQPRIGLWNLSALAHSLSPLVDKADLEAALE
QYEPQMNGYFSQLMRRKLGLLSKHEGDSRLFESMFELMSQNKVDYPRFFRTLSNLDTLLPQDVIDLVIDREAAKLWVDNY
LQRCELEESSVAERCEKMRQVNPKYILRNYLAQLAIDKAERGDSSDIDALMVVLADPYAEHPDYEHLAALPPEWGKAMEI
SCSS

Specific function: Unknown

COG id: COG0397

COG function: function code S; Uncharacterized conserved protein

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the UPF0061 (SELO) family

Homologues:

Organism=Homo sapiens, GI32880229, Length=391, Percent_Identity=40.920716112532, Blast_Score=263, Evalue=2e-70,
Organism=Escherichia coli, GI1787999, Length=482, Percent_Identity=47.0954356846473, Blast_Score=436, Evalue=1e-123,
Organism=Saccharomyces cerevisiae, GI6325034, Length=397, Percent_Identity=32.4937027707809, Blast_Score=181, Evalue=2e-46,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): Y872_VIBSL (B7VL54)

Other databases:

- EMBL:   FM954972
- RefSeq:   YP_002416493.1
- GeneID:   7160470
- GenomeReviews:   FM954972_GR
- KEGG:   vsp:VS_0872
- HOGENOM:   HBG683993
- OMA:   THIRFGH
- ProtClustDB:   PRK00029
- HAMAP:   MF_00692
- InterPro:   IPR003846

Pfam domain/function: PF02696 UPF0061

EC number: NA

Molecular weight: Translated: 55215; Mature: 55084

Theoretical pI: Translated: 4.76; Mature: 4.76

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.4 %Cys     (Translated Protein)
3.5 %Met     (Translated Protein)
4.9 %Cys+Met (Translated Protein)
1.4 %Cys     (Mature Protein)
3.3 %Met     (Mature Protein)
4.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSVWDSISFNNRFTALPRLFYTPIQPTPLNNVQWLAWNHNLANELGFPSFECTSEELLET
CCCCCCCCCCCCHHHHHHHHCCCCCCCCCCCEEEEEECCCHHHHCCCCCCCCCHHHHHHH
LSGNVEPEQFSPVAMKYAGHQFGSYNPDLGDGRGLLLAQVVAKSGETFDLHLKGAGKTPY
HCCCCCCHHCCCHHHHHHCCCCCCCCCCCCCCCHHHHHHHHHCCCCEEEEEEECCCCCCH
SRMGDGRAVIRSTVREYLCSEAMAGLNIPTTRALAMMTSDTPVYREKQEWGALLVRAAES
HHCCCCHHHHHHHHHHHHHHHHHCCCCCCCHHHEEEEECCCCCHHHHHHHHHHHHHHHHH
HIRFGHFEHLFYTNQLAEHKLLADKVIEWHFPECLDDDKPYAAMFNQIVDRTAEMVALWQ
HHCCCCHHHHHHHHHHHHHHHHHHHHHHHCCHHHCCCCCCHHHHHHHHHHHHHHHHHHHH
ANGFAHGVMNTDNMSIIGQTFDYGPFAFLDEYDPRLICNHSDYQGRYAFNQQPRIGLWNL
CCCEEECCCCCCCCEEEECCCCCCCCHHHCCCCCEEEECCCCCCCCEEECCCCCCCEEEH
SALAHSLSPLVDKADLEAALEQYEPQMNGYFSQLMRRKLGLLSKHEGDSRLFESMFELMS
HHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHH
QNKVDYPRFFRTLSNLDTLLPQDVIDLVIDREAAKLWVDNYLQRCELEESSVAERCEKMR
CCCCCHHHHHHHHHHHHHHCHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHH
QVNPKYILRNYLAQLAIDKAERGDSSDIDALMVVLADPYAEHPDYEHLAALPPEWGKAME
HCCHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHCCCCCCCCHHHHHCCCCCCCCEEE
ISCSS
EEECC
>Mature Secondary Structure 
SVWDSISFNNRFTALPRLFYTPIQPTPLNNVQWLAWNHNLANELGFPSFECTSEELLET
CCCCCCCCCCCHHHHHHHHCCCCCCCCCCCEEEEEECCCHHHHCCCCCCCCCHHHHHHH
LSGNVEPEQFSPVAMKYAGHQFGSYNPDLGDGRGLLLAQVVAKSGETFDLHLKGAGKTPY
HCCCCCCHHCCCHHHHHHCCCCCCCCCCCCCCCHHHHHHHHHCCCCEEEEEEECCCCCCH
SRMGDGRAVIRSTVREYLCSEAMAGLNIPTTRALAMMTSDTPVYREKQEWGALLVRAAES
HHCCCCHHHHHHHHHHHHHHHHHCCCCCCCHHHEEEEECCCCCHHHHHHHHHHHHHHHHH
HIRFGHFEHLFYTNQLAEHKLLADKVIEWHFPECLDDDKPYAAMFNQIVDRTAEMVALWQ
HHCCCCHHHHHHHHHHHHHHHHHHHHHHHCCHHHCCCCCCHHHHHHHHHHHHHHHHHHHH
ANGFAHGVMNTDNMSIIGQTFDYGPFAFLDEYDPRLICNHSDYQGRYAFNQQPRIGLWNL
CCCEEECCCCCCCCEEEECCCCCCCCHHHCCCCCEEEECCCCCCCCEEECCCCCCCEEEH
SALAHSLSPLVDKADLEAALEQYEPQMNGYFSQLMRRKLGLLSKHEGDSRLFESMFELMS
HHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHH
QNKVDYPRFFRTLSNLDTLLPQDVIDLVIDREAAKLWVDNYLQRCELEESSVAERCEKMR
CCCCCHHHHHHHHHHHHHHCHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHH
QVNPKYILRNYLAQLAIDKAERGDSSDIDALMVVLADPYAEHPDYEHLAALPPEWGKAME
HCCHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHCCCCCCCCHHHHHCCCCCCCCEEE
ISCSS
EEECC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA