Definition Eubacterium eligens ATCC 27750 chromosome, complete genome.
Accession NC_012778
Length 2,144,190

Click here to switch to the map view.

The map label for this gene is cpx [H]

Identifier: 238917424

GI number: 238917424

Start: 1557234

End: 1558688

Strand: Reverse

Name: cpx [H]

Synonym: EUBELI_01502

Alternate gene names: 238917424

Gene position: 1558688-1557234 (Counterclockwise)

Preceding gene: 238917425

Following gene: 238917419

Centisome position: 72.69

GC content: 39.79

Gene sequence:

>1455_bases
ATGAAAAAGATTAAAGCACTTATGCCGGAAGCTTATGATTTTAATGGAAAGCTTCCACTGAAACAGGCAATACCGCTTGG
ACTTCAGCATGTAATGGCAATGTTTGTAGGTAATCTTACACCATTGCTTATTATCACAGGAGCATGCGGAATCGGAGCAG
GAAGTGAGTATGCATCGGTTCAGGTTGCACTTTTACAGAATGCGATGATTATCGCCGGTATTGTAACACTTATCCAGTTG
TTTTCAATTGGACCTGTTGGTGGCAAGGTACCTATTATTATGGGTACAAGCTCAGGATTTATTGGAGTATTCAGCAGTGT
TACCAAGATTATGGGTGGTGGAATATTAGCTTATGGTGCAATTATGGGAGCATCTATTATAGGTGGTCTTTTTGAGACTG
TACTTGGAGCATTTATTAAACCATTAAGAAAATTCTTCCCATCAGTAGTAACAGGAACAGTAGTTCTTTCAATTGGATTG
TCGCTCATCTCAGTAGGTATCAATTCATTTGGTGGTGGAAGCTCTGCTAAGGATTTTGGTTCATTGGAAAATCTTTTCCT
GGCATTTGTTGTGCTTGTAGTTATATTATTTGTTAAGCACTGGACTAAGGGATATCTTAGTTCATCTGCAATTCTTGTTG
GAATTATTGTGGGTTATATTGTAGCAATTATTATGGGACTGGTTCTTCCACATACAGCAGTTACAGCTGATGGAGTTGAG
TATACTAAATCATGGGTACTTAACTGGAACAAGGTAGCAGAGGCTAAATGGATTGCAATTCCAAAGTTTATGCCAGTTAA
GCCTGTGTTTGATTTAAGAGCAATACTTCCTGTACTTGTAATGTTTGTTGTAACAGCAGTAGAGACTGTTGGTGATATTT
CAGGCGTTATGGAAGGTGGAATGAGAAGAGAGGCAACAGATAAGGAGCTTTCTGGAGGTGTAATGTGTGATGGCCTTGGT
TCAACACTTGCAGCCATGTTTGGTGTGCTTCCTAATACATCATTCAGCCAGAATGTAGGACTTGTTGCAATGACTAAGGT
TGTCAACAGAGTTGCACTTGCATCAGGTGCGGTATTCCTTATATTATGTGGACTTATTCCTAAGCTTGGAGCACTTATAT
CAATCATGCCACAGTCAGTACTTGGTGGTGCAGCAGTTATGATGTTCTCATCAATCATAGTAAGTGGTATCCAGCTTATT
ACTAAAGAACCACTTGATGCAAGAAGACTTTCAATTGTTTCAGTTGCACTTGGTGTAGGTTATGGAATGGGTGTAAGCCC
TGCAATTCTTGAACATACACCACAGGCAGTACAGCTTATGTTTGGTGAGTCAGGTATTGTACCTGCAGCATTTGTGGCAA
TATTACTTAATGTGATACTTCCTAAGAGCAAACCGGAAAACGAAGCTGCCACACAGGAAAACGAAGTTAACCAAGATACT
TCAAAAGACGAGTAA

Upstream 100 bases:

>100_bases
TGTATGGGGAGTTGGATATAAGTTTTCGTGATTTAATGTAGAATTAAACATGATAATGTAGTATTATGTTTATACATTTT
TATAAATATCTGGAGGACTT

Downstream 100 bases:

>100_bases
TATCGTCCGGAGTATCAATATCATATAGTTCATATTCATCCCGTACAGGAACTAATACAACCTGTGCGGGATATTTTTTT
GTTAAGAACCCACCGCCTTT

Product: nucleobase:cation symporter-2

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 484; Mature: 484

Protein sequence:

>484_residues
MKKIKALMPEAYDFNGKLPLKQAIPLGLQHVMAMFVGNLTPLLIITGACGIGAGSEYASVQVALLQNAMIIAGIVTLIQL
FSIGPVGGKVPIIMGTSSGFIGVFSSVTKIMGGGILAYGAIMGASIIGGLFETVLGAFIKPLRKFFPSVVTGTVVLSIGL
SLISVGINSFGGGSSAKDFGSLENLFLAFVVLVVILFVKHWTKGYLSSSAILVGIIVGYIVAIIMGLVLPHTAVTADGVE
YTKSWVLNWNKVAEAKWIAIPKFMPVKPVFDLRAILPVLVMFVVTAVETVGDISGVMEGGMRREATDKELSGGVMCDGLG
STLAAMFGVLPNTSFSQNVGLVAMTKVVNRVALASGAVFLILCGLIPKLGALISIMPQSVLGGAAVMMFSSIIVSGIQLI
TKEPLDARRLSIVSVALGVGYGMGVSPAILEHTPQAVQLMFGESGIVPAAFVAILLNVILPKSKPENEAATQENEVNQDT
SKDE

Sequences:

>Translated_484_residues
MKKIKALMPEAYDFNGKLPLKQAIPLGLQHVMAMFVGNLTPLLIITGACGIGAGSEYASVQVALLQNAMIIAGIVTLIQL
FSIGPVGGKVPIIMGTSSGFIGVFSSVTKIMGGGILAYGAIMGASIIGGLFETVLGAFIKPLRKFFPSVVTGTVVLSIGL
SLISVGINSFGGGSSAKDFGSLENLFLAFVVLVVILFVKHWTKGYLSSSAILVGIIVGYIVAIIMGLVLPHTAVTADGVE
YTKSWVLNWNKVAEAKWIAIPKFMPVKPVFDLRAILPVLVMFVVTAVETVGDISGVMEGGMRREATDKELSGGVMCDGLG
STLAAMFGVLPNTSFSQNVGLVAMTKVVNRVALASGAVFLILCGLIPKLGALISIMPQSVLGGAAVMMFSSIIVSGIQLI
TKEPLDARRLSIVSVALGVGYGMGVSPAILEHTPQAVQLMFGESGIVPAAFVAILLNVILPKSKPENEAATQENEVNQDT
SKDE
>Mature_484_residues
MKKIKALMPEAYDFNGKLPLKQAIPLGLQHVMAMFVGNLTPLLIITGACGIGAGSEYASVQVALLQNAMIIAGIVTLIQL
FSIGPVGGKVPIIMGTSSGFIGVFSSVTKIMGGGILAYGAIMGASIIGGLFETVLGAFIKPLRKFFPSVVTGTVVLSIGL
SLISVGINSFGGGSSAKDFGSLENLFLAFVVLVVILFVKHWTKGYLSSSAILVGIIVGYIVAIIMGLVLPHTAVTADGVE
YTKSWVLNWNKVAEAKWIAIPKFMPVKPVFDLRAILPVLVMFVVTAVETVGDISGVMEGGMRREATDKELSGGVMCDGLG
STLAAMFGVLPNTSFSQNVGLVAMTKVVNRVALASGAVFLILCGLIPKLGALISIMPQSVLGGAAVMMFSSIIVSGIQLI
TKEPLDARRLSIVSVALGVGYGMGVSPAILEHTPQAVQLMFGESGIVPAAFVAILLNVILPKSKPENEAATQENEVNQDT
SKDE

Specific function: Unknown

COG id: COG2233

COG function: function code F; Xanthine/uracil permeases

Gene ontology:

Cell location: Cell membrane; Multi-pass membrane protein (Probable) [H]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the xanthine/uracil permease family. Nucleobase:cation symporter-2 (NCS2) (TC 2.A.40) subfamily [H]

Homologues:

Organism=Escherichia coli, GI1790087, Length=468, Percent_Identity=32.2649572649573, Blast_Score=206, Evalue=3e-54,
Organism=Escherichia coli, GI87082181, Length=465, Percent_Identity=31.8279569892473, Blast_Score=198, Evalue=6e-52,
Organism=Escherichia coli, GI87082178, Length=484, Percent_Identity=32.2314049586777, Blast_Score=182, Evalue=5e-47,
Organism=Escherichia coli, GI87081818, Length=472, Percent_Identity=30.0847457627119, Blast_Score=134, Evalue=1e-32,
Organism=Escherichia coli, GI1788843, Length=414, Percent_Identity=27.7777777777778, Blast_Score=115, Evalue=7e-27,
Organism=Caenorhabditis elegans, GI17558856, Length=420, Percent_Identity=23.0952380952381, Blast_Score=78, Evalue=9e-15,
Organism=Caenorhabditis elegans, GI17541904, Length=471, Percent_Identity=20.8067940552017, Blast_Score=76, Evalue=4e-14,
Organism=Caenorhabditis elegans, GI17542262, Length=456, Percent_Identity=22.5877192982456, Blast_Score=72, Evalue=6e-13,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR017588
- InterPro:   IPR006042
- InterPro:   IPR006043 [H]

Pfam domain/function: PF00860 Xan_ur_permease [H]

EC number: NA

Molecular weight: Translated: 50442; Mature: 50442

Theoretical pI: Translated: 8.75; Mature: 8.75

Prosite motif: PS01116 XANTH_URACIL_PERMASE

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.6 %Cys     (Translated Protein)
4.3 %Met     (Translated Protein)
5.0 %Cys+Met (Translated Protein)
0.6 %Cys     (Mature Protein)
4.3 %Met     (Mature Protein)
5.0 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKKIKALMPEAYDFNGKLPLKQAIPLGLQHVMAMFVGNLTPLLIITGACGIGAGSEYASV
CCCHHHHCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHCCCEEHHEECCCCCCCCCCHHHH
QVALLQNAMIIAGIVTLIQLFSIGPVGGKVPIIMGTSSGFIGVFSSVTKIMGGGILAYGA
HHHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEEEECCCCHHHHHHHHHHHHCCHHHHHHH
IMGASIIGGLFETVLGAFIKPLRKFFPSVVTGTVVLSIGLSLISVGINSFGGGSSAKDFG
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHH
SLENLFLAFVVLVVILFVKHWTKGYLSSSAILVGIIVGYIVAIIMGLVLPHTAVTADGVE
HHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHCCHHHCCCCHH
YTKSWVLNWNKVAEAKWIAIPKFMPVKPVFDLRAILPVLVMFVVTAVETVGDISGVMEGG
HHHHHHCCHHHHHCCCEEECCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCC
MRREATDKELSGGVMCDGLGSTLAAMFGVLPNTSFSQNVGLVAMTKVVNRVALASGAVFL
CCCCCCCHHCCCCEEECCHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHCCHHHH
ILCGLIPKLGALISIMPQSVLGGAAVMMFSSIIVSGIQLITKEPLDARRLSIVSVALGVG
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHCC
YGMGVSPAILEHTPQAVQLMFGESGIVPAAFVAILLNVILPKSKPENEAATQENEVNQDT
CCCCCCHHHHHCCCHHHHHHHCCCCCHHHHHHHHHHHHHCCCCCCCCHHHCCHHHCCCCC
SKDE
CCCC
>Mature Secondary Structure
MKKIKALMPEAYDFNGKLPLKQAIPLGLQHVMAMFVGNLTPLLIITGACGIGAGSEYASV
CCCHHHHCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHCCCEEHHEECCCCCCCCCCHHHH
QVALLQNAMIIAGIVTLIQLFSIGPVGGKVPIIMGTSSGFIGVFSSVTKIMGGGILAYGA
HHHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEEEECCCCHHHHHHHHHHHHCCHHHHHHH
IMGASIIGGLFETVLGAFIKPLRKFFPSVVTGTVVLSIGLSLISVGINSFGGGSSAKDFG
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHH
SLENLFLAFVVLVVILFVKHWTKGYLSSSAILVGIIVGYIVAIIMGLVLPHTAVTADGVE
HHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHCCHHHCCCCHH
YTKSWVLNWNKVAEAKWIAIPKFMPVKPVFDLRAILPVLVMFVVTAVETVGDISGVMEGG
HHHHHHCCHHHHHCCCEEECCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCC
MRREATDKELSGGVMCDGLGSTLAAMFGVLPNTSFSQNVGLVAMTKVVNRVALASGAVFL
CCCCCCCHHCCCCEEECCHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHCCHHHH
ILCGLIPKLGALISIMPQSVLGGAAVMMFSSIIVSGIQLITKEPLDARRLSIVSVALGVG
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHCC
YGMGVSPAILEHTPQAVQLMFGESGIVPAAFVAILLNVILPKSKPENEAATQENEVNQDT
CCCCCCHHHHHCCCHHHHHHHCCCCCHHHHHHHHHHHHHCCCCCCCCHHHCCHHHCCCCC
SKDE
CCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 11792842; 8162194 [H]