Definition Shigella flexneri 2a str. 2457T, complete genome.
Accession NC_004741
Length 4,599,354

Click here to switch to the map view.

The map label for this gene is ycdG

Identifier: 30062543

GI number: 30062543

Start: 1060803

End: 1062197

Strand: Reverse

Name: ycdG

Synonym: S1079

Alternate gene names: 30062543

Gene position: 1062197-1060803 (Counterclockwise)

Preceding gene: 30062544

Following gene: 30062541

Centisome position: 23.09

GC content: 54.12

Gene sequence:

>1395_bases
GTGGTTCGATCGCAGTTATCACGCGCTGATGCGCCCTGCTTGTTAACCTCCTTAAGGAGACAGCTGATGGCAATGTTCGG
TTTTCCTCACTGGCAGTTAAAATCGACCTCTACAGAGAGCGGCGTGGTCGCGCCGGATGAACGATTGCCGTTTGCTCAGA
CGGCAGTAATGGGCGTTCAACACGCGGTGGCGATGTTTGGCGCGACGGTGTTAATGCCGATTCTGATGGGGCTGGATCCC
AATCTTTCCATTTTAATGTCGGGGATCGGCACGTTACTGTTTTTCTTTATTACCGGCGGGCGCGTCCCCAGTTATCTCGG
CTCCAGCGCGGCTTTTGTCGGCGTGGTGATTGCCGCGACGGGCTTTAACGGTCAGGGCATTAACCCGAATATCAGCATCG
CGCTGGGCGGGATTATCGCCTGTGGGCTGGTTTATACCGTCATTGGCCTGGTGGTGATGAAAATTGGTACACGCTGGATT
GAACGACTAATGCCGCCGGTGGTGACGGGTGCGGTGGTGATGGCGATTGGCCTGAACTTAGCGCCTATCGCAGTGAAAAG
TGTATCGGCTTCGGCCTTTGATAGCTGGATGGCGGTAATGACGGTGCTGTGTATTGGGCTGGTGGCGGTGTTTACCCGTG
GCATGATCCAGCGGTTATTGATTCTCGTAGGATTAATTGTCGCCTGTCTGCTGTATGGCGTGATGACCAACGTTTTAGGG
CTGGGAAAAGCCGTCGATTTTACTCTCGTCAGCTATGCTGCCTGGTTCGGTCTGCCGCATTTTTCCACTCCTGGTTTTAA
TGGCCAGGCGATGATGTTGATTGCGCCCGTGGCGGTGATTCTGGTGGCGGAAAACTTAGGTCATCTCAAGGCGGTCGCCG
GGATGACCGGACGCAATATGGACCCGTATATGGGGCGAGCATTCGTCGGTGATGGTCTGGCAACGATGCTTTCCGGCTCT
GTCGGCGGTAGCGGCGTCACCACCTATGCTGAAAATATCGGTGTGATGGCCGTGACAAAAGTCTACTCGACGCTGGTGTT
TGTTGCAGCTGCCGTCATCGCTATGCTGTTGGGCTTTTCGCCGAAATTTGGCGCGCTGATCCATACCATTCCGGCCGCGG
TGATTGGTGGTGCATCAATTGTTGTGTTCGGGCTGATTGCCGTCGCAGGCGCAAGGATATGGGTACAAAACCGTGTCGAT
TTAAGCCAGAACGCTAATTTGATTATGGTCGCAGTAACCTTCGTGCTGGGCGCGGGTGATTTTGCTCTCACGCTTGGCGG
TTTTACGTTGGGAGGGATCGGTACAGCAACCTTTGGCGCGATTTTACTCAATGCGTTATTAAGCAGAAGGTTGGTTGACG
TTCCACCGCCAGAAGTTGTTCATCAGGAGCCATAA

Upstream 100 bases:

>100_bases
TTGACTGCCGTATCAGCCAGGTGGTGAGCGTCGGCACCCACGACATTCTGTTTTGCGCCATCGAAGCGATTCATCGTCAC
ACCACACCCTACGGGCTGGT

Downstream 100 bases:

>100_bases
ACAGAAAACCGCCGGGTTACCGGCGGTGATGACTTTTTGACGAGCTTAAGAAAAAAATGCATTCGTCATTGATTAGCCCG
GCTAGTTGTCGCTTTTGCCG

Product: putative transport protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 464; Mature: 464

Protein sequence:

>464_residues
MVRSQLSRADAPCLLTSLRRQLMAMFGFPHWQLKSTSTESGVVAPDERLPFAQTAVMGVQHAVAMFGATVLMPILMGLDP
NLSILMSGIGTLLFFFITGGRVPSYLGSSAAFVGVVIAATGFNGQGINPNISIALGGIIACGLVYTVIGLVVMKIGTRWI
ERLMPPVVTGAVVMAIGLNLAPIAVKSVSASAFDSWMAVMTVLCIGLVAVFTRGMIQRLLILVGLIVACLLYGVMTNVLG
LGKAVDFTLVSYAAWFGLPHFSTPGFNGQAMMLIAPVAVILVAENLGHLKAVAGMTGRNMDPYMGRAFVGDGLATMLSGS
VGGSGVTTYAENIGVMAVTKVYSTLVFVAAAVIAMLLGFSPKFGALIHTIPAAVIGGASIVVFGLIAVAGARIWVQNRVD
LSQNANLIMVAVTFVLGAGDFALTLGGFTLGGIGTATFGAILLNALLSRRLVDVPPPEVVHQEP

Sequences:

>Translated_464_residues
MVRSQLSRADAPCLLTSLRRQLMAMFGFPHWQLKSTSTESGVVAPDERLPFAQTAVMGVQHAVAMFGATVLMPILMGLDP
NLSILMSGIGTLLFFFITGGRVPSYLGSSAAFVGVVIAATGFNGQGINPNISIALGGIIACGLVYTVIGLVVMKIGTRWI
ERLMPPVVTGAVVMAIGLNLAPIAVKSVSASAFDSWMAVMTVLCIGLVAVFTRGMIQRLLILVGLIVACLLYGVMTNVLG
LGKAVDFTLVSYAAWFGLPHFSTPGFNGQAMMLIAPVAVILVAENLGHLKAVAGMTGRNMDPYMGRAFVGDGLATMLSGS
VGGSGVTTYAENIGVMAVTKVYSTLVFVAAAVIAMLLGFSPKFGALIHTIPAAVIGGASIVVFGLIAVAGARIWVQNRVD
LSQNANLIMVAVTFVLGAGDFALTLGGFTLGGIGTATFGAILLNALLSRRLVDVPPPEVVHQEP
>Mature_464_residues
MVRSQLSRADAPCLLTSLRRQLMAMFGFPHWQLKSTSTESGVVAPDERLPFAQTAVMGVQHAVAMFGATVLMPILMGLDP
NLSILMSGIGTLLFFFITGGRVPSYLGSSAAFVGVVIAATGFNGQGINPNISIALGGIIACGLVYTVIGLVVMKIGTRWI
ERLMPPVVTGAVVMAIGLNLAPIAVKSVSASAFDSWMAVMTVLCIGLVAVFTRGMIQRLLILVGLIVACLLYGVMTNVLG
LGKAVDFTLVSYAAWFGLPHFSTPGFNGQAMMLIAPVAVILVAENLGHLKAVAGMTGRNMDPYMGRAFVGDGLATMLSGS
VGGSGVTTYAENIGVMAVTKVYSTLVFVAAAVIAMLLGFSPKFGALIHTIPAAVIGGASIVVFGLIAVAGARIWVQNRVD
LSQNANLIMVAVTFVLGAGDFALTLGGFTLGGIGTATFGAILLNALLSRRLVDVPPPEVVHQEP

Specific function: May function as a proton-driven pyrimidine uptake system [H]

COG id: COG2233

COG function: function code F; Xanthine/uracil permeases

Gene ontology:

Cell location: Cell inner membrane; Multi-pass membrane protein [H]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the xanthine/uracil permease family. Nucleobase:cation symporter-2 (NCS2) (TC 2.A.40) subfamily [H]

Homologues:

Organism=Escherichia coli, GI87081818, Length=442, Percent_Identity=98.868778280543, Blast_Score=855, Evalue=0.0,
Organism=Escherichia coli, GI1788843, Length=425, Percent_Identity=36.4705882352941, Blast_Score=247, Evalue=9e-67,
Organism=Escherichia coli, GI87082181, Length=457, Percent_Identity=25.601750547046, Blast_Score=117, Evalue=2e-27,
Organism=Escherichia coli, GI87082178, Length=404, Percent_Identity=27.4752475247525, Blast_Score=75, Evalue=7e-15,
Organism=Escherichia coli, GI1790087, Length=402, Percent_Identity=23.3830845771144, Blast_Score=63, Evalue=5e-11,
Organism=Caenorhabditis elegans, GI71993493, Length=174, Percent_Identity=35.632183908046, Blast_Score=88, Evalue=8e-18,
Organism=Caenorhabditis elegans, GI17542260, Length=174, Percent_Identity=35.632183908046, Blast_Score=88, Evalue=1e-17,
Organism=Caenorhabditis elegans, GI17558856, Length=171, Percent_Identity=30.9941520467836, Blast_Score=76, Evalue=3e-14,
Organism=Caenorhabditis elegans, GI17542262, Length=176, Percent_Identity=30.6818181818182, Blast_Score=76, Evalue=4e-14,
Organism=Caenorhabditis elegans, GI17541904, Length=137, Percent_Identity=34.3065693430657, Blast_Score=73, Evalue=3e-13,
Organism=Drosophila melanogaster, GI21356175, Length=175, Percent_Identity=30.8571428571429, Blast_Score=68, Evalue=1e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR019918
- InterPro:   IPR006042
- InterPro:   IPR006043 [H]

Pfam domain/function: PF00860 Xan_ur_permease [H]

EC number: NA

Molecular weight: Translated: 48143; Mature: 48143

Theoretical pI: Translated: 9.44; Mature: 9.44

Prosite motif: PS01116 XANTH_URACIL_PERMASE

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.9 %Cys     (Translated Protein)
5.2 %Met     (Translated Protein)
6.0 %Cys+Met (Translated Protein)
0.9 %Cys     (Mature Protein)
5.2 %Met     (Mature Protein)
6.0 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MVRSQLSRADAPCLLTSLRRQLMAMFGFPHWQLKSTSTESGVVAPDERLPFAQTAVMGVQ
CCCCHHHCCCCHHHHHHHHHHHHHHHCCCCCEEECCCCCCCCCCCCCCCCHHHHHHHHHH
HAVAMFGATVLMPILMGLDPNLSILMSGIGTLLFFFITGGRVPSYLGSSAAFVGVVIAAT
HHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHCCCCCHHHHCCCHHHHHHHHEEE
GFNGQGINPNISIALGGIIACGLVYTVIGLVVMKIGTRWIERLMPPVVTGAVVMAIGLNL
CCCCCCCCCCCEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHCCCC
APIAVKSVSASAFDSWMAVMTVLCIGLVAVFTRGMIQRLLILVGLIVACLLYGVMTNVLG
CHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
LGKAVDFTLVSYAAWFGLPHFSTPGFNGQAMMLIAPVAVILVAENLGHLKAVAGMTGRNM
CCCHHHHHHHHHHHHHCCCCCCCCCCCCCCHHHHHHHHHHHHHHCCHHHHHHHCCCCCCC
DPYMGRAFVGDGLATMLSGSVGGSGVTTYAENIGVMAVTKVYSTLVFVAAAVIAMLLGFS
CCHHCHHHHCCCHHHHHCCCCCCCCHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHCCC
PKFGALIHTIPAAVIGGASIVVFGLIAVAGARIWVQNRVDLSQNANLIMVAVTFVLGAGD
CCHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHEEECCCCCCCCCCEEHHHHHHHHCCCC
FALTLGGFTLGGIGTATFGAILLNALLSRRLVDVPPPEVVHQEP
CEEEECCEEECCHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCC
>Mature Secondary Structure
MVRSQLSRADAPCLLTSLRRQLMAMFGFPHWQLKSTSTESGVVAPDERLPFAQTAVMGVQ
CCCCHHHCCCCHHHHHHHHHHHHHHHCCCCCEEECCCCCCCCCCCCCCCCHHHHHHHHHH
HAVAMFGATVLMPILMGLDPNLSILMSGIGTLLFFFITGGRVPSYLGSSAAFVGVVIAAT
HHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHCCCCCHHHHCCCHHHHHHHHEEE
GFNGQGINPNISIALGGIIACGLVYTVIGLVVMKIGTRWIERLMPPVVTGAVVMAIGLNL
CCCCCCCCCCCEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHCCCC
APIAVKSVSASAFDSWMAVMTVLCIGLVAVFTRGMIQRLLILVGLIVACLLYGVMTNVLG
CHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
LGKAVDFTLVSYAAWFGLPHFSTPGFNGQAMMLIAPVAVILVAENLGHLKAVAGMTGRNM
CCCHHHHHHHHHHHHHCCCCCCCCCCCCCCHHHHHHHHHHHHHHCCHHHHHHHCCCCCCC
DPYMGRAFVGDGLATMLSGSVGGSGVTTYAENIGVMAVTKVYSTLVFVAAAVIAMLLGFS
CCHHCHHHHCCCHHHHHCCCCCCCCHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHCCC
PKFGALIHTIPAAVIGGASIVVFGLIAVAGARIWVQNRVDLSQNANLIMVAVTFVLGAGD
CCHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHEEECCCCCCCCCCEEHHHHHHHHCCCC
FALTLGGFTLGGIGTATFGAILLNALLSRRLVDVPPPEVVHQEP
CEEEECCEEECCHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 8905232; 9278503 [H]