The gene/protein map for NC_004631 is currently unavailable.
Definition Salmonella enterica subsp. enterica serovar Typhi str. Ty2 chromosome, complete genome.
Accession NC_004631
Length 4,791,961

Click here to switch to the map view.

The map label for this gene is tus [H]

Identifier: 29141795

GI number: 29141795

Start: 1399392

End: 1400321

Strand: Reverse

Name: tus [H]

Synonym: t1338

Alternate gene names: 29141795

Gene position: 1400321-1399392 (Counterclockwise)

Preceding gene: 29141796

Following gene: 29141792

Centisome position: 29.22

GC content: 53.12

Gene sequence:

>930_bases
ATGTCCCGCTACGATCTCGTTGAACGCCTGAATGGCACTTTTCGCCAGATAGAACAACACCTGGCGGCGCTGTCGGATAA
TCTACAGCAGCATTCGCTACTTATCGCTAGTGTCTTTTCACTGCCGCAGGTGACCAAAGAGGCGGAACATGCGCCGCTGG
ACACTATCGAGGTCACGCAACATCTGGGGAAAGAGGCCGAAGCGCTGGCGCTACGTCACTATCGCCATTTGTTTATTCAA
CAGCAGTCCGAAAACCGCAGCAGTAAAGCCGCCGTCCGCCTGCCTGGCGTTTTATGCTATCAAGTGGATAATGCGACACA
GTTAGATCTGGAAAATCAGGTACAGCGCATTAACCAGTTGAAAACCACCTTCGAGCAGATGGTTACGGTAGAGTCCGGTC
TTCCCTCAGCGGCACGTTTTGAGTGGGTGCATCGGCATCTACCCGGCTTAATTACGCTGAACGCTTACCGCACGCTGACG
CTTATCAATAACCCCGCCACCATACGTTTCGGTTGGGCAAATAAACATATTATTAAAAATTTAAGCCGGGATGAGGTTCT
GAGCCAGTTGAAAAAAAGCCTCGCGTCGCCGCGCAGCGTCCCGCCGTGGACGCGCGAACAATGGCAATTCAAGCTGGAAC
GGGAATATCAGGATATCGCTGCCTTACCGCAGCAGGCCAAACTCAAGATTAAGCGCCCGGTTAAGGTACAGCCGATCGCC
CGCATCTGGTATAAAGGCCAGCAGAAACAGGTGCAACACGCCTGCCCCTCGCCGATTATCGCATTAATCAACACGGACAA
CGGCGCTGGCGTGCCGGATATTGGCGGGCTGGAAAACTATGACGCCGATAATATTCAGCACCGTTTTAAACCACAGGCGC
AGCCGCTGCGACTGATTATTCCGCGACTGCACCTGTATGTGGCGGATTAA

Upstream 100 bases:

>100_bases
GATGCCCGACATGACCGCGGCCTGACGTATTTTGCACGCTGGTTGAGCCGCGGGAATTGTGCTATACAGATAGTATGTTG
TAACTAAAGTGAGTGATACC

Downstream 100 bases:

>100_bases
CGTCCCGGCGTCATACTGCCAACCATTAACTCCGGACGTACCCAGGCGTCGAACTCCGCGTCGCTAAGGTATCCTAATGC
CACGGCTGAGGCTTTGAGCG

Product: DNA replication terminus site-binding protein

Products: NA

Alternate protein names: Ter-binding protein [H]

Number of amino acids: Translated: 309; Mature: 308

Protein sequence:

>309_residues
MSRYDLVERLNGTFRQIEQHLAALSDNLQQHSLLIASVFSLPQVTKEAEHAPLDTIEVTQHLGKEAEALALRHYRHLFIQ
QQSENRSSKAAVRLPGVLCYQVDNATQLDLENQVQRINQLKTTFEQMVTVESGLPSAARFEWVHRHLPGLITLNAYRTLT
LINNPATIRFGWANKHIIKNLSRDEVLSQLKKSLASPRSVPPWTREQWQFKLEREYQDIAALPQQAKLKIKRPVKVQPIA
RIWYKGQQKQVQHACPSPIIALINTDNGAGVPDIGGLENYDADNIQHRFKPQAQPLRLIIPRLHLYVAD

Sequences:

>Translated_309_residues
MSRYDLVERLNGTFRQIEQHLAALSDNLQQHSLLIASVFSLPQVTKEAEHAPLDTIEVTQHLGKEAEALALRHYRHLFIQ
QQSENRSSKAAVRLPGVLCYQVDNATQLDLENQVQRINQLKTTFEQMVTVESGLPSAARFEWVHRHLPGLITLNAYRTLT
LINNPATIRFGWANKHIIKNLSRDEVLSQLKKSLASPRSVPPWTREQWQFKLEREYQDIAALPQQAKLKIKRPVKVQPIA
RIWYKGQQKQVQHACPSPIIALINTDNGAGVPDIGGLENYDADNIQHRFKPQAQPLRLIIPRLHLYVAD
>Mature_308_residues
SRYDLVERLNGTFRQIEQHLAALSDNLQQHSLLIASVFSLPQVTKEAEHAPLDTIEVTQHLGKEAEALALRHYRHLFIQQ
QSENRSSKAAVRLPGVLCYQVDNATQLDLENQVQRINQLKTTFEQMVTVESGLPSAARFEWVHRHLPGLITLNAYRTLTL
INNPATIRFGWANKHIIKNLSRDEVLSQLKKSLASPRSVPPWTREQWQFKLEREYQDIAALPQQAKLKIKRPVKVQPIAR
IWYKGQQKQVQHACPSPIIALINTDNGAGVPDIGGLENYDADNIQHRFKPQAQPLRLIIPRLHLYVAD

Specific function: Trans-acting protein required for termination of DNA replication. Binds to DNA replication terminator sequences (terA to terF) to prevent the passage of replication forks. The termination efficiency will be affected by the affinity of this protein for the

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasm [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the tus family [H]

Homologues:

Organism=Escherichia coli, GI1787895, Length=309, Percent_Identity=79.6116504854369, Blast_Score=521, Evalue=1e-149,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR008865 [H]

Pfam domain/function: PF05472 Ter [H]

EC number: NA

Molecular weight: Translated: 35332; Mature: 35201

Theoretical pI: Translated: 9.92; Mature: 9.92

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.6 %Cys     (Translated Protein)
0.6 %Met     (Translated Protein)
1.3 %Cys+Met (Translated Protein)
0.6 %Cys     (Mature Protein)
0.3 %Met     (Mature Protein)
1.0 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSRYDLVERLNGTFRQIEQHLAALSDNLQQHSLLIASVFSLPQVTKEAEHAPLDTIEVTQ
CCHHHHHHHHCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHH
HLGKEAEALALRHYRHLFIQQQSENRSSKAAVRLPGVLCYQVDNATQLDLENQVQRINQL
HCCCHHHHHHHHHHHHHHHHHHCCCCCCCCEEECCCEEEEEECCCCCCCHHHHHHHHHHH
KTTFEQMVTVESGLPSAARFEWVHRHLPGLITLNAYRTLTLINNPATIRFGWANKHIIKN
HHHHHHHHHHHCCCCHHHHHHHHHHHCCCEEEEECEEEEEEECCCCEEEECCCCHHHHHC
LSRDEVLSQLKKSLASPRSVPPWTREQWQFKLEREYQDIAALPQQAKLKIKRPVKVQPIA
CCHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHCCHHHCEEECCCCCCCHHH
RIWYKGQQKQVQHACPSPIIALINTDNGAGVPDIGGLENYDADNIQHRFKPQAQPLRLII
HHHHCCCHHHHHHCCCCCEEEEEECCCCCCCCCCCCCCCCCCCCHHHHCCCCCCHHHHHE
PRLHLYVAD
EEHEEEECC
>Mature Secondary Structure 
SRYDLVERLNGTFRQIEQHLAALSDNLQQHSLLIASVFSLPQVTKEAEHAPLDTIEVTQ
CHHHHHHHHCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHH
HLGKEAEALALRHYRHLFIQQQSENRSSKAAVRLPGVLCYQVDNATQLDLENQVQRINQL
HCCCHHHHHHHHHHHHHHHHHHCCCCCCCCEEECCCEEEEEECCCCCCCHHHHHHHHHHH
KTTFEQMVTVESGLPSAARFEWVHRHLPGLITLNAYRTLTLINNPATIRFGWANKHIIKN
HHHHHHHHHHHCCCCHHHHHHHHHHHCCCEEEEECEEEEEEECCCCEEEECCCCHHHHHC
LSRDEVLSQLKKSLASPRSVPPWTREQWQFKLEREYQDIAALPQQAKLKIKRPVKVQPIA
CCHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHCCHHHCEEECCCCCCCHHH
RIWYKGQQKQVQHACPSPIIALINTDNGAGVPDIGGLENYDADNIQHRFKPQAQPLRLII
HHHHCCCHHHHHHCCCCCEEEEEECCCCCCCCCCCCCCCCCCCCHHHHCCCCCCHHHHHE
PRLHLYVAD
EEHEEEECC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: NA