Definition Escherichia coli HS, complete genome.
Accession NC_009800
Length 4,643,538

Click here to switch to the map view.

The map label for this gene is nupX [H]

Identifier: 157161643

GI number: 157161643

Start: 2295071

End: 2296321

Strand: Reverse

Name: nupX [H]

Synonym: EcHS_A2297

Alternate gene names: 157161643

Gene position: 2296321-2295071 (Counterclockwise)

Preceding gene: 157161644

Following gene: 157161639

Centisome position: 49.45

GC content: 50.68

Gene sequence:

>1251_bases
ATGGATGTCATGAGAAGTGTTCTGGGAATGGTGGTATTGCTGACGATTGCGTTTTTGCTGTCAGTAAACAAGAAGAAGAT
CAGCCTGCGTACCGTTGGCGCGGCGTTAGTGTTACAGGTCGTGATTGGCGGGATTATGCTTTGGTTACCGCCAGGGCGTT
GGGTCGCTGAAAAAGTCGCTTTTGGCGTGCATAAAGTGATGGCGTACAGCGACGCGGGTAGCGCATTTATCTTCGGTTCG
CTGGTCGGGCCGAAAATGGACACGCTGTTTGATGGCGCAGGATTTATCTTTGGTTTCAGGGTATTACCGGCAATTATCTT
CGTCACTGCACTGGTGAGTATTCTCTACTACATCGGTGTGATGGGGATTTTAATTCGCATTCTCGGCGGTATATTCCAGA
AAGCATTAAATATCAGCAAGATTGAGTCATTCGTCGCGGTCACCACCATTTTCCTCGGGCAAAACGAAATTCCGGCGATC
GTCAAACCCTTTATCGATCGTCTGAATCGCAATGAATTATTTACAGCGATTTGTAGTGGCATGGCCTCGATTGCTGGTTC
GACAATGATTGGTTACGCCGCCCTGGGCGTACCTGTGGAATATTTGCTGGCGGCATCGTTAATGGCGATCCCAGGCGGGA
TCTTGTTTGCCCGCCTGTTAAGCCCGGCTACGGAATCTTCGCAGGTTTCCTTTAATAACCTCTCTTTCACCGAAACACCG
CCAAAAAGCATTATTGAAGCCGCTGCGACAGGGGCAATGACCGGGCTGAAAATCGCCGCCGGTGTAGCGACAGTTGTTAT
GGCATTTGTCGCCATCATTGCGTTAATTAATGGTATTATCGGCGGCGTTGGCGGCTGGTTTGGTTTTGCACATGCCTCGC
TGGAGTCCATTTTAGGTTACCTGTTGGCCCCATTGGCGTGGGTGATGGGGGTTGACTGGAGTGATGCAAATCTTGCCGGG
AGTTTGATTGGGCAGAAGCTGGCGATCAATGAATTTGTCGCTTATCTCAATTTCTCGCCATATCTGCAAACGGGTGGCAC
TCTGGATGCTAAAACCGTGGCGATTATTTCTTTCGCGTTGTGCGGTTTCGCTAACTTTGGTTCTATCGGGGTGGTGGTGG
GGGCGTTTTCTGCGGTTGCGCCACACCGTGCGCCGGAAATCGCCCAACTTGGTTTACGCGCGCTGGCGGCGGCGACACTT
TCTAACCTGATGAGTGCTACTATTGCAGGATTCTTTATTGGTTTAGCGTAG

Upstream 100 bases:

>100_bases
AGTGTTGATAACAAGCCGGGTCAGTATCGCAAGATCCAAGCCCGGCTATTTCTGATGGGCAGAAAGCCGTCGCCCAATAT
GACATGAAGAGATAATAACT

Downstream 100 bases:

>100_bases
TGCGCAATTTATGAGCCGGATAAGATGCGGTCAAGCGTCGAATCCGGCAACATTGTTACACCATTGGCACTAATGAAAGC
GCGTTATCGGCAGACAGGGT

Product: NupC family nucleoside transporter

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 416; Mature: 416

Protein sequence:

>416_residues
MDVMRSVLGMVVLLTIAFLLSVNKKKISLRTVGAALVLQVVIGGIMLWLPPGRWVAEKVAFGVHKVMAYSDAGSAFIFGS
LVGPKMDTLFDGAGFIFGFRVLPAIIFVTALVSILYYIGVMGILIRILGGIFQKALNISKIESFVAVTTIFLGQNEIPAI
VKPFIDRLNRNELFTAICSGMASIAGSTMIGYAALGVPVEYLLAASLMAIPGGILFARLLSPATESSQVSFNNLSFTETP
PKSIIEAAATGAMTGLKIAAGVATVVMAFVAIIALINGIIGGVGGWFGFAHASLESILGYLLAPLAWVMGVDWSDANLAG
SLIGQKLAINEFVAYLNFSPYLQTGGTLDAKTVAIISFALCGFANFGSIGVVVGAFSAVAPHRAPEIAQLGLRALAAATL
SNLMSATIAGFFIGLA

Sequences:

>Translated_416_residues
MDVMRSVLGMVVLLTIAFLLSVNKKKISLRTVGAALVLQVVIGGIMLWLPPGRWVAEKVAFGVHKVMAYSDAGSAFIFGS
LVGPKMDTLFDGAGFIFGFRVLPAIIFVTALVSILYYIGVMGILIRILGGIFQKALNISKIESFVAVTTIFLGQNEIPAI
VKPFIDRLNRNELFTAICSGMASIAGSTMIGYAALGVPVEYLLAASLMAIPGGILFARLLSPATESSQVSFNNLSFTETP
PKSIIEAAATGAMTGLKIAAGVATVVMAFVAIIALINGIIGGVGGWFGFAHASLESILGYLLAPLAWVMGVDWSDANLAG
SLIGQKLAINEFVAYLNFSPYLQTGGTLDAKTVAIISFALCGFANFGSIGVVVGAFSAVAPHRAPEIAQLGLRALAAATL
SNLMSATIAGFFIGLA
>Mature_416_residues
MDVMRSVLGMVVLLTIAFLLSVNKKKISLRTVGAALVLQVVIGGIMLWLPPGRWVAEKVAFGVHKVMAYSDAGSAFIFGS
LVGPKMDTLFDGAGFIFGFRVLPAIIFVTALVSILYYIGVMGILIRILGGIFQKALNISKIESFVAVTTIFLGQNEIPAI
VKPFIDRLNRNELFTAICSGMASIAGSTMIGYAALGVPVEYLLAASLMAIPGGILFARLLSPATESSQVSFNNLSFTETP
PKSIIEAAATGAMTGLKIAAGVATVVMAFVAIIALINGIIGGVGGWFGFAHASLESILGYLLAPLAWVMGVDWSDANLAG
SLIGQKLAINEFVAYLNFSPYLQTGGTLDAKTVAIISFALCGFANFGSIGVVVGAFSAVAPHRAPEIAQLGLRALAAATL
SNLMSATIAGFFIGLA

Specific function: Nucleoside transporter [H]

COG id: COG1972

COG function: function code F; Nucleoside permease

Gene ontology:

Cell location: Cell inner membrane; Multi-pass membrane protein [H]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the concentrative nucleoside transporter (CNT) (TC 2.A.41) family [H]

Homologues:

Organism=Homo sapiens, GI11545853, Length=415, Percent_Identity=33.7349397590361, Blast_Score=230, Evalue=1e-60,
Organism=Homo sapiens, GI42542381, Length=422, Percent_Identity=30.8056872037915, Blast_Score=220, Evalue=2e-57,
Organism=Homo sapiens, GI227116277, Length=419, Percent_Identity=30.3102625298329, Blast_Score=207, Evalue=1e-53,
Organism=Escherichia coli, GI1788485, Length=416, Percent_Identity=99.5192307692308, Blast_Score=809, Evalue=0.0,
Organism=Escherichia coli, GI1788488, Length=416, Percent_Identity=88.7019230769231, Blast_Score=702, Evalue=0.0,
Organism=Escherichia coli, GI1788737, Length=414, Percent_Identity=31.8840579710145, Blast_Score=191, Evalue=9e-50,
Organism=Caenorhabditis elegans, GI17560276, Length=396, Percent_Identity=29.2929292929293, Blast_Score=200, Evalue=1e-51,
Organism=Caenorhabditis elegans, GI71991794, Length=399, Percent_Identity=31.8295739348371, Blast_Score=192, Evalue=2e-49,
Organism=Caenorhabditis elegans, GI25146537, Length=202, Percent_Identity=30.6930693069307, Blast_Score=105, Evalue=4e-23,
Organism=Drosophila melanogaster, GI45552519, Length=408, Percent_Identity=31.8627450980392, Blast_Score=227, Evalue=1e-59,
Organism=Drosophila melanogaster, GI45552517, Length=408, Percent_Identity=31.8627450980392, Blast_Score=227, Evalue=1e-59,
Organism=Drosophila melanogaster, GI19921868, Length=408, Percent_Identity=31.8627450980392, Blast_Score=227, Evalue=1e-59,
Organism=Drosophila melanogaster, GI281360430, Length=407, Percent_Identity=33.1695331695332, Blast_Score=207, Evalue=8e-54,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR008276
- InterPro:   IPR018270
- InterPro:   IPR011642
- InterPro:   IPR011657
- InterPro:   IPR002668 [H]

Pfam domain/function: PF07670 Gate; PF07662 Nucleos_tra2_C; PF01773 Nucleos_tra2_N [H]

EC number: NA

Molecular weight: Translated: 43338; Mature: 43338

Theoretical pI: Translated: 9.28; Mature: 9.28

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.5 %Cys     (Translated Protein)
3.4 %Met     (Translated Protein)
3.8 %Cys+Met (Translated Protein)
0.5 %Cys     (Mature Protein)
3.4 %Met     (Mature Protein)
3.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MDVMRSVLGMVVLLTIAFLLSVNKKKISLRTVGAALVLQVVIGGIMLWLPPGRWVAEKVA
CHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHEECCCCHHHHHHHH
FGVHKVMAYSDAGSAFIFGSLVGPKMDTLFDGAGFIFGFRVLPAIIFVTALVSILYYIGV
HHHHHHHHCCCCCCEEEEHHHCCCCHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHH
MGILIRILGGIFQKALNISKIESFVAVTTIFLGQNEIPAIVKPFIDRLNRNELFTAICSG
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHCCHHHHHHHHHHH
MASIAGSTMIGYAALGVPVEYLLAASLMAIPGGILFARLLSPATESSQVSFNNLSFTETP
HHHHHCHHHHHHHHHHCCHHHHHHHHHHHCCHHHHHHHHHCCCCCCCCEEECCCCCCCCC
PKSIIEAAATGAMTGLKIAAGVATVVMAFVAIIALINGIIGGVGGWFGFAHASLESILGY
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
LLAPLAWVMGVDWSDANLAGSLIGQKLAINEFVAYLNFSPYLQTGGTLDAKTVAIISFAL
HHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCHHCCCCCCCHHHHHHHHHHH
CGFANFGSIGVVVGAFSAVAPHRAPEIAQLGLRALAAATLSNLMSATIAGFFIGLA
HCCCCCCHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCC
>Mature Secondary Structure
MDVMRSVLGMVVLLTIAFLLSVNKKKISLRTVGAALVLQVVIGGIMLWLPPGRWVAEKVA
CHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHEECCCCHHHHHHHH
FGVHKVMAYSDAGSAFIFGSLVGPKMDTLFDGAGFIFGFRVLPAIIFVTALVSILYYIGV
HHHHHHHHCCCCCCEEEEHHHCCCCHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHH
MGILIRILGGIFQKALNISKIESFVAVTTIFLGQNEIPAIVKPFIDRLNRNELFTAICSG
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHCCHHHHHHHHHHH
MASIAGSTMIGYAALGVPVEYLLAASLMAIPGGILFARLLSPATESSQVSFNNLSFTETP
HHHHHCHHHHHHHHHHCCHHHHHHHHHHHCCHHHHHHHHHCCCCCCCCEEECCCCCCCCC
PKSIIEAAATGAMTGLKIAAGVATVVMAFVAIIALINGIIGGVGGWFGFAHASLESILGY
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
LLAPLAWVMGVDWSDANLAGSLIGQKLAINEFVAYLNFSPYLQTGGTLDAKTVAIISFAL
HHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCHHCCCCCCCHHHHHHHHHHH
CGFANFGSIGVVVGAFSAVAPHRAPEIAQLGLRALAAATLSNLMSATIAGFFIGLA
HCCCCCCHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Alpha

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 9278503 [H]