Definition Salmonella enterica subsp. enterica serovar Typhi str. Ty2 chromosome, complete genome.
Accession NC_004631
Length 4,791,961

Click here to switch to the map view.

The map label for this gene is yncD [H]

Identifier: 29141941

GI number: 29141941

Start: 1549539

End: 1551659

Strand: Direct

Name: yncD [H]

Synonym: t1497

Alternate gene names: 29141941

Gene position: 1549539-1551659 (Clockwise)

Preceding gene: 29141938

Following gene: 29141944

Centisome position: 32.34

GC content: 53.23

Gene sequence:

>2121_bases
ATGAAAATTATTTCCGTTAGACAGCGACTTTATCCCGCCCTCTTATTGCCTCTGACCTTCTCCCCGGTCCTTCAGGCCGC
CAGCGCGCCCAATGAACAAACCATGATAGTCACCGCAACGCCGCAAACCGTATCCGAGCTGGATACACCTGCCGCCGTTA
GCGTCATTGAGGGAGAAGACATGCGTCTGGCGACGCCGCGCGTTAATTTATCTGAGTCTTTAACCAGCGTCCCGGGATTG
CAGGTGCAGAACCGGCAGAACTACGCGCAGGATCTGCAAATCTCTATCCGTGGATTTGGCTCGCGTTCCGCCTTTGGCGT
GCGCGGCATTCGTCTGTATGTTGATGGCATTCCCGCCACCATGCCGGATGGACAAGGCCAGATTTCAAATATTGATATTA
ACAGCATACAAAACGTTGAAGTGTTACGCGGCCCCTTCTCAGCGCTATACGGCAATGCTTCCGGCGGCGTGATAAATGTC
ACCACCGAAACCGGGAGACAGCCGCCCACCCTTGAGGCCAGCAGCTACTACGGCAGTTATGGAAGCTGGCGCTATGGGTT
AAAAGCCACGGGCGCGATGGGGGACGGCACACAGCCTGGCGACGTGGATTACACGGTATCGACTACCCGTTTCACCACCC
ACGGCTACCGCGATCACAGCGGCGCGCGAAAAAATCTGGCTAATGCCAAACTGGGCGTGCGCCTTGACGATGTCAGTAAA
CTTTCGCTGATTTTTAATAGTGTGGACATTAAGGCGGACGATCCCGGCGGACTTACCGAATCTGAATGGAAAGCCGATCC
GCAGCAGGCGCCGCGCGCTGAACAGTACAATACGCGTAAAACCATCAAACAAACTCAGGCAGGATTGCGTTATGAACGTC
AGCTCAGCGCGCAGGATGATATCAGCGTGATGGCCTACGCCGGAGAGCGGGAAACCACGCAATACCAGTCTATTCCCCTG
GTGGCACAGCTAAAACCAGCCCAGGCTGGCGGCGTAATTACACTGCAACGCCACTATCAGGGAATTGATTCCCGCTGGAC
TCACCGGGGAGAATTAGGTGTGCCGGTCACCTTCACTGGCGGGTTAAACTATGAAAACATGAGCGAAAACCGCAAGGGTT
ACAATAATTTCCGTCTCAACAACGGCACCCCTGAGTTCGGGCATAAAGGCGATTTACGGCGGGATGAGCGTAACCTGATG
TGGAATGTCGATCCTTATCTGCAAACCCAGTGGCAGCTTACGCAAAAACTCTCGCTGGATGCTGGCGTGCGCTACAGTTC
CGTGTGGTTCGATTCTAACGATCACTATATCGCGCCCGGCAATGGCGATGACAGCGGCGACGCCAGCTATCACCACTGGC
TACCCGCCGGATCGCTAAAATATGCGTTAACTGACGCCTGGAATCTCTATCTTGCTGCCGGTCGCGGATTTGAAACTCCC
ACTATCAATGAACTTTCTTATCGCGCTGACGGCCAAAGCGGGTTCAACTTTGACCTCAAACCGTCGACCAATGATACGGT
GGAAGTCGGCAGTAAAACGCGGATTGGCAATGGCTTGTTGACCGCCGCGTTATTTCAAACCGATACCGATGATGAAATTG
TCGTCGCCAGTAGTATGGGAGGACGCACTACCTACAAAAACGCGGGCAAAACGCGCCGCCAGGGCGCAGAGCTCGCGTTG
GACCAGCGCTTCGCCGGCGACTGGCGGGTGAAAGCATCATGGACCTGGCTGGATGCGACCTATCGCAGTAACGTTTGTCA
GGGGCAAAACTGTGATGGAAACCGGATGCCCGGCATCGCCCGTAATATGGGATTCGCCTCATTAGGTTTTATCCCGGATG
AGGGGTGGTACGCCGGAACAGACGTTCGGTATATGGGCGATATCATGGCCAATGATGAAAATACCGCCAAAGCGCCTTCG
TATACCGTTGTTGGACTAAATACAGGGTATAAATTTAATTACAGTCAGCTTACCGTCGATATTTTTGGGCGGGTAGATAA
TCTATTTGATGAAGAATATATCGGTTCGGTGATCGTTAATGAATCTAATGGCCGATATTATGAGCCAGCGCCAGGGCGTA
ACTATGGCGTGGGGATTAATCTGGCATGGCAATTTGAATAA

Upstream 100 bases:

>100_bases
TTCTTAACTTAATGTGCGATTAAAATTTCAAAACTTTACATATTGACTACCCTTAATGTCACGTTTTCCGTTGATACGCT
TACATTTATCCGGCATTTTC

Downstream 100 bases:

>100_bases
ATATCCGGCAATAGCGGGGCATCCCCGCTATTGATTAGTCATAGTTTCATGAAAGTTACATGAAGTACTGATTTTTAATC
GTCGCTACGTTTTGTTGCAA

Product: TonB-dependent receptor

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 706; Mature: 706

Protein sequence:

>706_residues
MKIISVRQRLYPALLLPLTFSPVLQAASAPNEQTMIVTATPQTVSELDTPAAVSVIEGEDMRLATPRVNLSESLTSVPGL
QVQNRQNYAQDLQISIRGFGSRSAFGVRGIRLYVDGIPATMPDGQGQISNIDINSIQNVEVLRGPFSALYGNASGGVINV
TTETGRQPPTLEASSYYGSYGSWRYGLKATGAMGDGTQPGDVDYTVSTTRFTTHGYRDHSGARKNLANAKLGVRLDDVSK
LSLIFNSVDIKADDPGGLTESEWKADPQQAPRAEQYNTRKTIKQTQAGLRYERQLSAQDDISVMAYAGERETTQYQSIPL
VAQLKPAQAGGVITLQRHYQGIDSRWTHRGELGVPVTFTGGLNYENMSENRKGYNNFRLNNGTPEFGHKGDLRRDERNLM
WNVDPYLQTQWQLTQKLSLDAGVRYSSVWFDSNDHYIAPGNGDDSGDASYHHWLPAGSLKYALTDAWNLYLAAGRGFETP
TINELSYRADGQSGFNFDLKPSTNDTVEVGSKTRIGNGLLTAALFQTDTDDEIVVASSMGGRTTYKNAGKTRRQGAELAL
DQRFAGDWRVKASWTWLDATYRSNVCQGQNCDGNRMPGIARNMGFASLGFIPDEGWYAGTDVRYMGDIMANDENTAKAPS
YTVVGLNTGYKFNYSQLTVDIFGRVDNLFDEEYIGSVIVNESNGRYYEPAPGRNYGVGINLAWQFE

Sequences:

>Translated_706_residues
MKIISVRQRLYPALLLPLTFSPVLQAASAPNEQTMIVTATPQTVSELDTPAAVSVIEGEDMRLATPRVNLSESLTSVPGL
QVQNRQNYAQDLQISIRGFGSRSAFGVRGIRLYVDGIPATMPDGQGQISNIDINSIQNVEVLRGPFSALYGNASGGVINV
TTETGRQPPTLEASSYYGSYGSWRYGLKATGAMGDGTQPGDVDYTVSTTRFTTHGYRDHSGARKNLANAKLGVRLDDVSK
LSLIFNSVDIKADDPGGLTESEWKADPQQAPRAEQYNTRKTIKQTQAGLRYERQLSAQDDISVMAYAGERETTQYQSIPL
VAQLKPAQAGGVITLQRHYQGIDSRWTHRGELGVPVTFTGGLNYENMSENRKGYNNFRLNNGTPEFGHKGDLRRDERNLM
WNVDPYLQTQWQLTQKLSLDAGVRYSSVWFDSNDHYIAPGNGDDSGDASYHHWLPAGSLKYALTDAWNLYLAAGRGFETP
TINELSYRADGQSGFNFDLKPSTNDTVEVGSKTRIGNGLLTAALFQTDTDDEIVVASSMGGRTTYKNAGKTRRQGAELAL
DQRFAGDWRVKASWTWLDATYRSNVCQGQNCDGNRMPGIARNMGFASLGFIPDEGWYAGTDVRYMGDIMANDENTAKAPS
YTVVGLNTGYKFNYSQLTVDIFGRVDNLFDEEYIGSVIVNESNGRYYEPAPGRNYGVGINLAWQFE
>Mature_706_residues
MKIISVRQRLYPALLLPLTFSPVLQAASAPNEQTMIVTATPQTVSELDTPAAVSVIEGEDMRLATPRVNLSESLTSVPGL
QVQNRQNYAQDLQISIRGFGSRSAFGVRGIRLYVDGIPATMPDGQGQISNIDINSIQNVEVLRGPFSALYGNASGGVINV
TTETGRQPPTLEASSYYGSYGSWRYGLKATGAMGDGTQPGDVDYTVSTTRFTTHGYRDHSGARKNLANAKLGVRLDDVSK
LSLIFNSVDIKADDPGGLTESEWKADPQQAPRAEQYNTRKTIKQTQAGLRYERQLSAQDDISVMAYAGERETTQYQSIPL
VAQLKPAQAGGVITLQRHYQGIDSRWTHRGELGVPVTFTGGLNYENMSENRKGYNNFRLNNGTPEFGHKGDLRRDERNLM
WNVDPYLQTQWQLTQKLSLDAGVRYSSVWFDSNDHYIAPGNGDDSGDASYHHWLPAGSLKYALTDAWNLYLAAGRGFETP
TINELSYRADGQSGFNFDLKPSTNDTVEVGSKTRIGNGLLTAALFQTDTDDEIVVASSMGGRTTYKNAGKTRRQGAELAL
DQRFAGDWRVKASWTWLDATYRSNVCQGQNCDGNRMPGIARNMGFASLGFIPDEGWYAGTDVRYMGDIMANDENTAKAPS
YTVVGLNTGYKFNYSQLTVDIFGRVDNLFDEEYIGSVIVNESNGRYYEPAPGRNYGVGINLAWQFE

Specific function: Probable receptor, tonB-dependent [H]

COG id: COG1629

COG function: function code P; Outer membrane receptor proteins, mostly Fe transport

Gene ontology:

Cell location: Cell outer membrane; Peripheral membrane protein (Potential) [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the tonB-dependent receptor family [H]

Homologues:

Organism=Escherichia coli, GI1787723, Length=706, Percent_Identity=84.8441926345609, Blast_Score=1266, Evalue=0.0,
Organism=Escherichia coli, GI1790743, Length=700, Percent_Identity=23.8571428571429, Blast_Score=92, Evalue=8e-20,
Organism=Escherichia coli, GI1788478, Length=161, Percent_Identity=35.4037267080745, Blast_Score=75, Evalue=1e-14,
Organism=Escherichia coli, GI1787024, Length=346, Percent_Identity=25.4335260115607, Blast_Score=74, Evalue=3e-14,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR012910
- InterPro:   IPR000531 [H]

Pfam domain/function: PF07715 Plug; PF00593 TonB_dep_Rec [H]

EC number: NA

Molecular weight: Translated: 77776; Mature: 77776

Theoretical pI: Translated: 5.32; Mature: 5.32

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.3 %Cys     (Translated Protein)
1.8 %Met     (Translated Protein)
2.1 %Cys+Met (Translated Protein)
0.3 %Cys     (Mature Protein)
1.8 %Met     (Mature Protein)
2.1 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKIISVRQRLYPALLLPLTFSPVLQAASAPNEQTMIVTATPQTVSELDTPAAVSVIEGED
CCHHHHHHHHHHHEEECCCHHHHHHHHCCCCCCEEEEEECCHHHHHCCCCCEEEEEECCC
MRLATPRVNLSESLTSVPGLQVQNRQNYAQDLQISIRGFGSRSAFGVRGIRLYVDGIPAT
EEEECCCCCHHHHHHCCCCCEEECCCCCCCEEEEEEEECCCCCCCCEEEEEEEEECCCCC
MPDGQGQISNIDINSIQNVEVLRGPFSALYGNASGGVINVTTETGRQPPTLEASSYYGSY
CCCCCCEEEEEECCCCCCCHHHHCCHHHHCCCCCCCEEEEECCCCCCCCCCCCCCCCCCC
GSWRYGLKATGAMGDGTQPGDVDYTVSTTRFTTHGYRDHSGARKNLANAKLGVRLDDVSK
CCEEECEEECCCCCCCCCCCCEEEEEEEEEEEECCCCCCCCCHHHHCCCEEEEEECCCCE
LSLIFNSVDIKADDPGGLTESEWKADPQQAPRAEQYNTRKTIKQTQAGLRYERQLSAQDD
EEEEEEEEEEEECCCCCCCCCCCCCCHHHCCCCHHHHHHHHHHHHHHCCCCHHHCCCCCC
ISVMAYAGERETTQYQSIPLVAQLKPAQAGGVITLQRHYQGIDSRWTHRGELGVPVTFTG
EEEEEECCCCCCCHHHCCCEEEEECCCCCCCEEEEHHHHCCCCCCCCCCCCCCCCEEEEC
GLNYENMSENRKGYNNFRLNNGTPEFGHKGDLRRDERNLMWNVDPYLQTQWQLTQKLSLD
CCCCCCCCCCCCCCCCEEECCCCCCCCCCCCCCCCCCCEEEECCHHHHHHHHHHHHHCCC
AGVRYSSVWFDSNDHYIAPGNGDDSGDASYHHWLPAGSLKYALTDAWNLYLAAGRGFETP
CCCEEEEEEECCCCCEECCCCCCCCCCCCEEEECCCCCEEEEEECCEEEEEEECCCCCCC
TINELSYRADGQSGFNFDLKPSTNDTVEVGSKTRIGNGLLTAALFQTDTDDEIVVASSMG
CCCCEEEECCCCCCCEEEECCCCCCEEECCCCEECCCCEEEEEEEECCCCCCEEEEECCC
GRTTYKNAGKTRRQGAELALDQRFAGDWRVKASWTWLDATYRSNVCQGQNCDGNRMPGIA
CCCEECCCCCHHHCCCCEEEHHHCCCCEEEEEEEEEEECHHHCCCCCCCCCCCCCCCCHH
RNMGFASLGFIPDEGWYAGTDVRYMGDIMANDENTAKAPSYTVVGLNTGYKFNYSQLTVD
HCCCCEEECCCCCCCCCCCCCCEEECCEEECCCCCCCCCCEEEEEECCCCEEEHHEEEEE
IFGRVDNLFDEEYIGSVIVNESNGRYYEPAPGRNYGVGINLAWQFE
EHHHHHHHHCHHHCCEEEEECCCCCEECCCCCCCCEEEEEEEEEEC
>Mature Secondary Structure
MKIISVRQRLYPALLLPLTFSPVLQAASAPNEQTMIVTATPQTVSELDTPAAVSVIEGED
CCHHHHHHHHHHHEEECCCHHHHHHHHCCCCCCEEEEEECCHHHHHCCCCCEEEEEECCC
MRLATPRVNLSESLTSVPGLQVQNRQNYAQDLQISIRGFGSRSAFGVRGIRLYVDGIPAT
EEEECCCCCHHHHHHCCCCCEEECCCCCCCEEEEEEEECCCCCCCCEEEEEEEEECCCCC
MPDGQGQISNIDINSIQNVEVLRGPFSALYGNASGGVINVTTETGRQPPTLEASSYYGSY
CCCCCCEEEEEECCCCCCCHHHHCCHHHHCCCCCCCEEEEECCCCCCCCCCCCCCCCCCC
GSWRYGLKATGAMGDGTQPGDVDYTVSTTRFTTHGYRDHSGARKNLANAKLGVRLDDVSK
CCEEECEEECCCCCCCCCCCCEEEEEEEEEEEECCCCCCCCCHHHHCCCEEEEEECCCCE
LSLIFNSVDIKADDPGGLTESEWKADPQQAPRAEQYNTRKTIKQTQAGLRYERQLSAQDD
EEEEEEEEEEEECCCCCCCCCCCCCCHHHCCCCHHHHHHHHHHHHHHCCCCHHHCCCCCC
ISVMAYAGERETTQYQSIPLVAQLKPAQAGGVITLQRHYQGIDSRWTHRGELGVPVTFTG
EEEEEECCCCCCCHHHCCCEEEEECCCCCCCEEEEHHHHCCCCCCCCCCCCCCCCEEEEC
GLNYENMSENRKGYNNFRLNNGTPEFGHKGDLRRDERNLMWNVDPYLQTQWQLTQKLSLD
CCCCCCCCCCCCCCCCEEECCCCCCCCCCCCCCCCCCCEEEECCHHHHHHHHHHHHHCCC
AGVRYSSVWFDSNDHYIAPGNGDDSGDASYHHWLPAGSLKYALTDAWNLYLAAGRGFETP
CCCEEEEEEECCCCCEECCCCCCCCCCCCEEEECCCCCEEEEEECCEEEEEEECCCCCCC
TINELSYRADGQSGFNFDLKPSTNDTVEVGSKTRIGNGLLTAALFQTDTDDEIVVASSMG
CCCCEEEECCCCCCCEEEECCCCCCEEECCCCEECCCCEEEEEEEECCCCCCEEEEECCC
GRTTYKNAGKTRRQGAELALDQRFAGDWRVKASWTWLDATYRSNVCQGQNCDGNRMPGIA
CCCEECCCCCHHHCCCCEEEHHHCCCCEEEEEEEEEEECHHHCCCCCCCCCCCCCCCCHH
RNMGFASLGFIPDEGWYAGTDVRYMGDIMANDENTAKAPSYTVVGLNTGYKFNYSQLTVD
HCCCCEEECCCCCCCCCCCCCCEEECCEEECCCCCCCCCCEEEEEECCCCEEEHHEEEEE
IFGRVDNLFDEEYIGSVIVNESNGRYYEPAPGRNYGVGINLAWQFE
EHHHHHHHHCHHHCCEEEEECCCCCEECCCCCCCCEEEEEEEEEEC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 9278503 [H]