Definition Xanthobacter autotrophicus Py2 chromosome, complete genome.
Accession NC_009720
Length 5,308,934

Click here to switch to the map view.

The map label for this gene is ydiU [C]

Identifier: 154245115

GI number: 154245115

Start: 1343281

End: 1344765

Strand: Reverse

Name: ydiU [C]

Synonym: Xaut_1167

Alternate gene names: 154245115

Gene position: 1344765-1343281 (Counterclockwise)

Preceding gene: 154245116

Following gene: 154245112

Centisome position: 25.33

GC content: 71.04

Gene sequence:

>1485_bases
ATGTCCGCCCCTTTCCCCTTCGACAATTCCTACGCCCGCGACCTGCCGGGCTTCTATGCCCCCGCTACGCCCACCCCGGT
GACCGCGCCCGGCCTCGTGAAGGTCAACGCCCCCCTCGCGGAGGAACTGGGCCTCGACCCCGAAGCGCTGGCTACCCCTC
ACGCGGTGGAGATGTTCGCCGGCCAGCACGTGCCGGAAGGCGCCGACCCCATCGCGCTGGCTTATGCCGGGCACCAGTTC
GGCCAGTTCACGCCCCAGCTCGGCGACGGGCGGGCGATCCTTTTGGGCGAGGTGGTGGACCGCGCCGGCCGGCGCCGCGA
CATCCAGCTGAAGGGCTCCGGCCCCACCCCCTTCTCCCGCCGCGGCGACGGGCGGGCGGCGCTGGGTCCGGTGCTGCGCG
AATATATTGTGAGCGAGGCCATGGCGGCGCTGGGCATCCCCACCACGCGGGCGCTGGCAGCAGTGACCACCGGCGAGCCG
GTGCTGCGCGACCGCCCGCTGCCGGGCGCCGTGCTGGCGCGGGTGGCGGCGAGCCATATCCGCATCGGCACCTTCCAGTT
CTTCGCCGCCCGCAAGGCCACCGACGCGGTGCGCCAGCTGGCCGACTACACCATCGCCAGGCATTATCCCGAGCTGGCCG
GCACCCCCGAACCCTATCTGGCGCTGCTGAACGGCGTCATCGGCCGGCAGGCGGCGCTGGTGGCGCGCTGGCTTCTGGTG
GGCTTCATCCACGGGGTGATGAACACGGACAACATGTCGGTCTCCGGCGAGACCATCGATTACGGCCCTTGCGCCTTCAT
GGACGCCTACGATCCGGAAACGGTGTTCTCCTCCATCGACCAGATGGGCCGCTACGCCTATGGCAACCAGCCGGACATCG
CCCACTGGAACCTGGCCCGCCTCGCCGAATGCCTGATCCCGCTGCTGGGCGAGGACAAGGAGGCCGCCGTCGCCGCGGCC
AACGGCGCCTTGAAGGAGTTCCCGGCGCGCTTCAGGGCGGCGTACCATTCCGGCCTCGTCGCCAAGATCGGCCTTGCGGG
GCCGGACGGGGAAGCGAGCGAGGAGGACACCACCCTCGCCCTTGAGCTGCTGTCGGTGATGGCCGAGTCCAAGGCCGACT
TCACCCTCACCTTCCGCCGGCTCGGGGCCCTCGCCGCCGACCCGGAGGCCGGGGGGCCAGTGCGCGACCTGTTCCTCGAC
CGGGACGCCTTCGACGCCTGGACCACCCGCTGGCGCGAGCGCCTCGCCGCCACCGGGCGCGACGGCGCGGCGACCCGCGC
GGCCATGGACCGCGTCAATCCCCTCTTCATCCCGCGCAACCATCTGGTGGAACAGGTGATCGCGTCGGCGACGGAGGGCG
ATTTCGCGCCGTTCGAGACGCTGAACACGGTGCTGGCACACCCCTTCGAGGAGCAGCCGGCGTTTGCCGCCTATGCCGGC
CTGCCACCGTCCATGGAAGGCTACCAGACCTTCTGCGGGACGTGA

Upstream 100 bases:

>100_bases
CGCCGGCTGGACATCGCCGGGGGGAGCCCCCACCTTTTCCTTGTTCGTTGACGGCCCGGGGGGTCTGCCCCTTTTCCGCC
CCGGGGGAGATTGCCGCACC

Downstream 100 bases:

>100_bases
GGGACCGGTTGAAATCAAGACCGGTATTACCGCGACCACCCCCGTCATGCCCGGGCTTGTCCCGGGCGTCCACCCCGAAC
TGCCTGGAATAGCATGCGAA

Product: hypothetical protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 494; Mature: 493

Protein sequence:

>494_residues
MSAPFPFDNSYARDLPGFYAPATPTPVTAPGLVKVNAPLAEELGLDPEALATPHAVEMFAGQHVPEGADPIALAYAGHQF
GQFTPQLGDGRAILLGEVVDRAGRRRDIQLKGSGPTPFSRRGDGRAALGPVLREYIVSEAMAALGIPTTRALAAVTTGEP
VLRDRPLPGAVLARVAASHIRIGTFQFFAARKATDAVRQLADYTIARHYPELAGTPEPYLALLNGVIGRQAALVARWLLV
GFIHGVMNTDNMSVSGETIDYGPCAFMDAYDPETVFSSIDQMGRYAYGNQPDIAHWNLARLAECLIPLLGEDKEAAVAAA
NGALKEFPARFRAAYHSGLVAKIGLAGPDGEASEEDTTLALELLSVMAESKADFTLTFRRLGALAADPEAGGPVRDLFLD
RDAFDAWTTRWRERLAATGRDGAATRAAMDRVNPLFIPRNHLVEQVIASATEGDFAPFETLNTVLAHPFEEQPAFAAYAG
LPPSMEGYQTFCGT

Sequences:

>Translated_494_residues
MSAPFPFDNSYARDLPGFYAPATPTPVTAPGLVKVNAPLAEELGLDPEALATPHAVEMFAGQHVPEGADPIALAYAGHQF
GQFTPQLGDGRAILLGEVVDRAGRRRDIQLKGSGPTPFSRRGDGRAALGPVLREYIVSEAMAALGIPTTRALAAVTTGEP
VLRDRPLPGAVLARVAASHIRIGTFQFFAARKATDAVRQLADYTIARHYPELAGTPEPYLALLNGVIGRQAALVARWLLV
GFIHGVMNTDNMSVSGETIDYGPCAFMDAYDPETVFSSIDQMGRYAYGNQPDIAHWNLARLAECLIPLLGEDKEAAVAAA
NGALKEFPARFRAAYHSGLVAKIGLAGPDGEASEEDTTLALELLSVMAESKADFTLTFRRLGALAADPEAGGPVRDLFLD
RDAFDAWTTRWRERLAATGRDGAATRAAMDRVNPLFIPRNHLVEQVIASATEGDFAPFETLNTVLAHPFEEQPAFAAYAG
LPPSMEGYQTFCGT
>Mature_493_residues
SAPFPFDNSYARDLPGFYAPATPTPVTAPGLVKVNAPLAEELGLDPEALATPHAVEMFAGQHVPEGADPIALAYAGHQFG
QFTPQLGDGRAILLGEVVDRAGRRRDIQLKGSGPTPFSRRGDGRAALGPVLREYIVSEAMAALGIPTTRALAAVTTGEPV
LRDRPLPGAVLARVAASHIRIGTFQFFAARKATDAVRQLADYTIARHYPELAGTPEPYLALLNGVIGRQAALVARWLLVG
FIHGVMNTDNMSVSGETIDYGPCAFMDAYDPETVFSSIDQMGRYAYGNQPDIAHWNLARLAECLIPLLGEDKEAAVAAAN
GALKEFPARFRAAYHSGLVAKIGLAGPDGEASEEDTTLALELLSVMAESKADFTLTFRRLGALAADPEAGGPVRDLFLDR
DAFDAWTTRWRERLAATGRDGAATRAAMDRVNPLFIPRNHLVEQVIASATEGDFAPFETLNTVLAHPFEEQPAFAAYAGL
PPSMEGYQTFCGT

Specific function: Unknown

COG id: COG0397

COG function: function code S; Uncharacterized conserved protein

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the UPF0061 (SELO) family [H]

Homologues:

Organism=Homo sapiens, GI32880229, Length=406, Percent_Identity=41.3793103448276, Blast_Score=271, Evalue=7e-73,
Organism=Escherichia coli, GI1787999, Length=479, Percent_Identity=41.1273486430063, Blast_Score=353, Evalue=2e-98,
Organism=Saccharomyces cerevisiae, GI6325034, Length=335, Percent_Identity=34.6268656716418, Blast_Score=183, Evalue=5e-47,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR003846 [H]

Pfam domain/function: PF02696 UPF0061 [H]

EC number: NA

Molecular weight: Translated: 52844; Mature: 52713

Theoretical pI: Translated: 4.87; Mature: 4.87

Prosite motif: PS00216 SUGAR_TRANSPORT_1

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.6 %Cys     (Translated Protein)
2.0 %Met     (Translated Protein)
2.6 %Cys+Met (Translated Protein)
0.6 %Cys     (Mature Protein)
1.8 %Met     (Mature Protein)
2.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSAPFPFDNSYARDLPGFYAPATPTPVTAPGLVKVNAPLAEELGLDPEALATPHAVEMFA
CCCCCCCCCCHHHHCCCCCCCCCCCCCCCCCEEEECCCHHHHHCCCHHHHCCCHHHHHHH
GQHVPEGADPIALAYAGHQFGQFTPQLGDGRAILLGEVVDRAGRRRDIQLKGSGPTPFSR
CCCCCCCCCCEEEEECCCHHHCCCCCCCCCCEEEHHHHHHHCCCCCEEEEECCCCCCCCC
RGDGRAALGPVLREYIVSEAMAALGIPTTRALAAVTTGEPVLRDRPLPGAVLARVAASHI
CCCCCHHHHHHHHHHHHHHHHHHHCCCHHHHHEEECCCCCHHCCCCCCHHHHHHHHHHHH
RIGTFQFFAARKATDAVRQLADYTIARHYPELAGTPEPYLALLNGVIGRQAALVARWLLV
EECHHHHHHHHHHHHHHHHHHHHHHHHHCHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHH
GFIHGVMNTDNMSVSGETIDYGPCAFMDAYDPETVFSSIDQMGRYAYGNQPDIAHWNLAR
HHHHHHHCCCCCEECCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHCCCCCCCCCCCCHHH
LAECLIPLLGEDKEAAVAAANGALKEFPARFRAAYHSGLVAKIGLAGPDGEASEEDTTLA
HHHHHHHHHCCCCHHHHHHHCCHHHHHHHHHHHHHHCCCEEEEECCCCCCCCCCCHHHHH
LELLSVMAESKADFTLTFRRLGALAADPEAGGPVRDLFLDRDAFDAWTTRWRERLAATGR
HHHHHHHHHCCCCCEEHHHHHCCCCCCCCCCCCHHHHHHCCHHHHHHHHHHHHHHHHCCC
DGAATRAAMDRVNPLFIPRNHLVEQVIASATEGDFAPFETLNTVLAHPFEEQPAFAAYAG
CCHHHHHHHHHCCCEECCHHHHHHHHHHHCCCCCCCHHHHHHHHHCCCCCCCCCCEEECC
LPPSMEGYQTFCGT
CCCCCHHHHHHCCC
>Mature Secondary Structure 
SAPFPFDNSYARDLPGFYAPATPTPVTAPGLVKVNAPLAEELGLDPEALATPHAVEMFA
CCCCCCCCCHHHHCCCCCCCCCCCCCCCCCEEEECCCHHHHHCCCHHHHCCCHHHHHHH
GQHVPEGADPIALAYAGHQFGQFTPQLGDGRAILLGEVVDRAGRRRDIQLKGSGPTPFSR
CCCCCCCCCCEEEEECCCHHHCCCCCCCCCCEEEHHHHHHHCCCCCEEEEECCCCCCCCC
RGDGRAALGPVLREYIVSEAMAALGIPTTRALAAVTTGEPVLRDRPLPGAVLARVAASHI
CCCCCHHHHHHHHHHHHHHHHHHHCCCHHHHHEEECCCCCHHCCCCCCHHHHHHHHHHHH
RIGTFQFFAARKATDAVRQLADYTIARHYPELAGTPEPYLALLNGVIGRQAALVARWLLV
EECHHHHHHHHHHHHHHHHHHHHHHHHHCHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHH
GFIHGVMNTDNMSVSGETIDYGPCAFMDAYDPETVFSSIDQMGRYAYGNQPDIAHWNLAR
HHHHHHHCCCCCEECCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHCCCCCCCCCCCCHHH
LAECLIPLLGEDKEAAVAAANGALKEFPARFRAAYHSGLVAKIGLAGPDGEASEEDTTLA
HHHHHHHHHCCCCHHHHHHHCCHHHHHHHHHHHHHHCCCEEEEECCCCCCCCCCCHHHHH
LELLSVMAESKADFTLTFRRLGALAADPEAGGPVRDLFLDRDAFDAWTTRWRERLAATGR
HHHHHHHHHCCCCCEEHHHHHCCCCCCCCCCCCHHHHHHCCHHHHHHHHHHHHHHHHCCC
DGAATRAAMDRVNPLFIPRNHLVEQVIASATEGDFAPFETLNTVLAHPFEEQPAFAAYAG
CCHHHHHHHHHCCCEECCHHHHHHHHHHHCCCCCCCHHHHHHHHHCCCCCCCCCCEEECC
LPPSMEGYQTFCGT
CCCCCHHHHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 12597275 [H]