| Definition | Salmonella enterica subsp. enterica serovar Typhi str. Ty2 chromosome, complete genome. |
|---|---|
| Accession | NC_004631 |
| Length | 4,791,961 |
Click here to switch to the map view.
The map label for this gene is sgcX
Identifier: 29141965
GI number: 29141965
Start: 1577286
End: 1578404
Strand: Direct
Name: sgcX
Synonym: t1521
Alternate gene names: 29141965
Gene position: 1577286-1578404 (Clockwise)
Preceding gene: 29141963
Following gene: 29141966
Centisome position: 32.92
GC content: 55.67
Gene sequence:
>1119_bases ATGACCTTTTCTGTGCAGGAAACGCTTTTTTCTTTACTGCGGCTAAACGGGATTTCAGGACATGAAAGCAGTATTGCAAA CGTTATGCAGCACGCGTTCGAACAGCAGGCCAAAGACGTCTGGCGGGATCGCTTAGGTAATGTCGTCGCCCGTTATGGCA GCGATAAATCCGACGCGCTTCGCCTGATGATTTTTGCGCATATGGATGAAGTGGGTTTTATGGTACGCAAGATCGAACCC TCCGGTTTTTTACGTTTTGAACGCGTGGGCGGCCCGGCGCAAATTACTATGCCCGGTTCGATTGTGACGCTTGCCGGATG TTCAGGCGATATCATGGGCTGTATCGGTATTAAAGCATATCACTTCGCGAAGGGTGACGAGCGCACCCAGCCACCCGCGC TCGATAAACTCTGGATTGATATCGGCGCAAAAGATAAAGCGGATGCCGAACGAATGGGTATTCAGGTGGGGACGCCAGTA ACCCTTTACAACCCGCCGCACTGTCTGGGCAACGACCTGGTGTGCAGTAAGGCGCTGGATGACAGGCTGGGGTGTACGGC GCTACTGGGCGTCGCCGAGGCCCTCGCCTCCACACCGCTTGATATCGCGGTATTCCTGGTCGCGTCGGTACAGGAAGAGT TCAATATTCGCGGGATTGTTCCCGTTTTACGACGCGTGCGCCCCGACCTGGCGATTGGTATTGATATCACCCCCTCCTGC GACACGCCTGACCTGCAGGATTACTCGGATGTGCGGGTCAACCACGGCGTCGGCATCACCTGTCTGAACTATCACGGACG CGGTACGTTGGCGGGACTGATTACGCCGCCGCGTTTGCTGCGGATGCTGGAGACCACCGCGCACGAAAATAATATTCCCG TACAGCGTGAAGTCGCGCCAGGCGTCATCACCGAAACAGGCTACATTCAGGTTGAACTGGACGGTATTCCCTGCGCCAGT CTTTCTATTCCCTGCCGCTATACCCACTCGCCAGCCGAAGTCGCCAGCCTGCGCGACCTGGCTGATTGTATCCGTTTACT GACTGCGCTGGCCAATATGTCGCCAGAACAGTTTCCCATTGACCCTGAAACAGGCGCTACACAAGAGGCACGACCATGA
Upstream 100 bases:
>100_bases TATTTAGCGTATTTCCGCGTGACACATTTCACACTTATCCAACCATTCTCCGCCTATAAAACGCTCAACGACTGATTGTT TTATCACCACGGAGACGCCA
Downstream 100 bases:
>100_bases TGAAAAAGATCCTTGTGGCATGTGGTACCGGCATGTCGACATCAACCATGATTGCACAAAAACTGCAGGACTTTCTTGCG GAGCAAGGCATTGCGGCAAC
Product: hypothetical protein
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 372; Mature: 371
Protein sequence:
>372_residues MTFSVQETLFSLLRLNGISGHESSIANVMQHAFEQQAKDVWRDRLGNVVARYGSDKSDALRLMIFAHMDEVGFMVRKIEP SGFLRFERVGGPAQITMPGSIVTLAGCSGDIMGCIGIKAYHFAKGDERTQPPALDKLWIDIGAKDKADAERMGIQVGTPV TLYNPPHCLGNDLVCSKALDDRLGCTALLGVAEALASTPLDIAVFLVASVQEEFNIRGIVPVLRRVRPDLAIGIDITPSC DTPDLQDYSDVRVNHGVGITCLNYHGRGTLAGLITPPRLLRMLETTAHENNIPVQREVAPGVITETGYIQVELDGIPCAS LSIPCRYTHSPAEVASLRDLADCIRLLTALANMSPEQFPIDPETGATQEARP
Sequences:
>Translated_372_residues MTFSVQETLFSLLRLNGISGHESSIANVMQHAFEQQAKDVWRDRLGNVVARYGSDKSDALRLMIFAHMDEVGFMVRKIEP SGFLRFERVGGPAQITMPGSIVTLAGCSGDIMGCIGIKAYHFAKGDERTQPPALDKLWIDIGAKDKADAERMGIQVGTPV TLYNPPHCLGNDLVCSKALDDRLGCTALLGVAEALASTPLDIAVFLVASVQEEFNIRGIVPVLRRVRPDLAIGIDITPSC DTPDLQDYSDVRVNHGVGITCLNYHGRGTLAGLITPPRLLRMLETTAHENNIPVQREVAPGVITETGYIQVELDGIPCAS LSIPCRYTHSPAEVASLRDLADCIRLLTALANMSPEQFPIDPETGATQEARP >Mature_371_residues TFSVQETLFSLLRLNGISGHESSIANVMQHAFEQQAKDVWRDRLGNVVARYGSDKSDALRLMIFAHMDEVGFMVRKIEPS GFLRFERVGGPAQITMPGSIVTLAGCSGDIMGCIGIKAYHFAKGDERTQPPALDKLWIDIGAKDKADAERMGIQVGTPVT LYNPPHCLGNDLVCSKALDDRLGCTALLGVAEALASTPLDIAVFLVASVQEEFNIRGIVPVLRRVRPDLAIGIDITPSCD TPDLQDYSDVRVNHGVGITCLNYHGRGTLAGLITPPRLLRMLETTAHENNIPVQREVAPGVITETGYIQVELDGIPCASL SIPCRYTHSPAEVASLRDLADCIRLLTALANMSPEQFPIDPETGATQEARP
Specific function: Unknown
COG id: COG1363
COG function: function code G; Cellulase M and related proteins
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the peptidase M42 family
Homologues:
Organism=Escherichia coli, GI87082417, Length=372, Percent_Identity=84.1397849462366, Blast_Score=651, Evalue=0.0, Organism=Escherichia coli, GI1790332, Length=354, Percent_Identity=28.5310734463277, Blast_Score=154, Evalue=1e-38, Organism=Escherichia coli, GI1788727, Length=345, Percent_Identity=29.8550724637681, Blast_Score=124, Evalue=8e-30,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): SGCX_SALTI (P58536)
Other databases:
- EMBL: AL627270 - EMBL: AE014613 - RefSeq: NP_455885.1 - RefSeq: NP_805307.1 - ProteinModelPortal: P58536 - SMR: P58536 - GeneID: 1070978 - GeneID: 1247842 - GenomeReviews: AE014613_GR - GenomeReviews: AL513382_GR - KEGG: stt:t1521 - KEGG: sty:STY1452 - HOGENOM: HBG426188 - OMA: HPTIVRW - ProtClustDB: CLSK894115 - BioCyc: SENT209261:T1521-MONOMER - BioCyc: SENT220341:STY1452-MONOMER - InterPro: IPR008007 - PIRSF: PIRSF001123
Pfam domain/function: PF05343 Peptidase_M42
EC number: NA
Molecular weight: Translated: 40342; Mature: 40211
Theoretical pI: Translated: 5.10; Mature: 5.10
Prosite motif: NA
Important sites: ACT_SITE 212-212
Signals:
None
Transmembrane regions:
None
Cys/Met content:
2.7 %Cys (Translated Protein) 2.7 %Met (Translated Protein) 5.4 %Cys+Met (Translated Protein) 2.7 %Cys (Mature Protein) 2.4 %Met (Mature Protein) 5.1 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MTFSVQETLFSLLRLNGISGHESSIANVMQHAFEQQAKDVWRDRLGNVVARYGSDKSDAL CCCCHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHE RLMIFAHMDEVGFMVRKIEPSGFLRFERVGGPAQITMPGSIVTLAGCSGDIMGCIGIKAY EEHHHHHHHHHHHEEEEECCCCCEEEEECCCCEEEEECCCEEEEECCCCCEEEEECCEEE HFAKGDERTQPPALDKLWIDIGAKDKADAERMGIQVGTPVTLYNPPHCLGNDLVCSKALD EECCCCCCCCCCCCCEEEEECCCCCCCCHHHCCEEECCCEEECCCCCCCCCCHHHHHHHH DRLGCTALLGVAEALASTPLDIAVFLVASVQEEFNIRGIVPVLRRVRPDLAIGIDITPSC HHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHCCCCCHHHHHHHCCCCEEEEEEECCCC DTPDLQDYSDVRVNHGVGITCLNYHGRGTLAGLITPPRLLRMLETTAHENNIPVQREVAP CCCCCCCCCCEEEECCCEEEEEEECCCEEEEECCCCHHHHHHHHHHCCCCCCCCCCCCCC GVITETGYIQVELDGIPCASLSIPCRYTHSPAEVASLRDLADCIRLLTALANMSPEQFPI CEEECCCEEEEEECCCCCCCEECCEEECCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCC DPETGATQEARP CCCCCCCCCCCC >Mature Secondary Structure TFSVQETLFSLLRLNGISGHESSIANVMQHAFEQQAKDVWRDRLGNVVARYGSDKSDAL CCCHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHE RLMIFAHMDEVGFMVRKIEPSGFLRFERVGGPAQITMPGSIVTLAGCSGDIMGCIGIKAY EEHHHHHHHHHHHEEEEECCCCCEEEEECCCCEEEEECCCEEEEECCCCCEEEEECCEEE HFAKGDERTQPPALDKLWIDIGAKDKADAERMGIQVGTPVTLYNPPHCLGNDLVCSKALD EECCCCCCCCCCCCCEEEEECCCCCCCCHHHCCEEECCCEEECCCCCCCCCCHHHHHHHH DRLGCTALLGVAEALASTPLDIAVFLVASVQEEFNIRGIVPVLRRVRPDLAIGIDITPSC HHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHCCCCCHHHHHHHCCCCEEEEEEECCCC DTPDLQDYSDVRVNHGVGITCLNYHGRGTLAGLITPPRLLRMLETTAHENNIPVQREVAP CCCCCCCCCCEEEECCCEEEEEEECCCEEEEECCCCHHHHHHHHHHCCCCCCCCCCCCCC GVITETGYIQVELDGIPCASLSIPCRYTHSPAEVASLRDLADCIRLLTALANMSPEQFPI CEEECCCEEEEEECCCCCCCEECCEEECCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCC DPETGATQEARP CCCCCCCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 11677608; 12644504