Definition Sodalis glossinidius str. 'morsitans', complete genome.
Accession NC_007712
Length 4,171,146

Click here to switch to the map view.

The map label for this gene is 85059185

Identifier: 85059185

GI number: 85059185

Start: 2022335

End: 2023066

Strand: Reverse

Name: 85059185

Synonym: SG1207

Alternate gene names: NA

Gene position: 2023066-2022335 (Counterclockwise)

Preceding gene: 85059186

Following gene: 85059184

Centisome position: 48.5

GC content: 63.8

Gene sequence:

>732_bases
ATGAGTAATCCTGCCCGTTATCACCGCGCCTTTGTAGCCGCCGAGTTGGCGGCCTCACAGGATGAAAGCGCGCAAATGAG
CCATCTGGGCCATTACGAGCTGCTGCTGTTCAAGCTGAAGCAGGATTTGGACCGGCTGCATCACGTCGAATCCCGCCGCC
GCAAGGCGCAGCTCAAGCGCGAGATGTTGCCCACCTATCAGCCCTGGGTCGCCGGCGTGCTGGCAAGCGGCACCGGGGCG
CAGGACGCGGTGCTGATGCGGATGCTGGTCTGGCTGCTGGATGTGGGTGACATCACCGCGGCGCTGGATATCGGCGACTA
TGCCCTGCGCCACGCCCTGCTGGCCCCGGACGGATTCGAGCGCGCCACGCCCTGTCTTATTGCAGAAAAGGTCACCGCCA
GCGCCCAGCGCAACCTGAATGACGGCCAGCCGCTCGATACTGAGCAGCTCTTGCGCGCCCGCTCATTGCTGGCTGGGCAG
GATATGCCGGACAAGGTGAAGGCCTGTTTGCTAAAAGTAGTGGGCCACGCGCTACGCCAGGACGGTACCCTGACCCCGGT
CCGTGTGCGTGAGGCGGCGCTGAACGCCATGCATGAGGTGAATACCCGGCTGGCCGTCTGGCATCGGGCGCAGGAGCGCG
CCGGCACTCTGGCGCTGGACGCGGTACCCGCTGAACCGGGCCTGATTAAGCGCCGACAGAAAGAGAAAGCGTTGTTTGAG
TCAAGAGAGTAA

Upstream 100 bases:

>100_bases
AGTATGTGGTCGAGGATTATCAGTGCACGGCGCTGATTGAAAATATCCAGATCCTCGAGCCGGAAGTCACGCCTCCAAAA
AGCCAGGGGAATAAGGGCTG

Downstream 100 bases:

>100_bases
ATGAATTGACCCGTACCTGTGACGAGATACGGCCCAGGAAATCTGTTAGTGCCAACGTCTCTAAAGAGCGGATCAGTCAG
TGGGTTGTGGAGCGAGAGCT

Product: hypothetical protein

Products: NA

Alternate protein names: Small Terminase Subunit; Terminase Endonuclease Subunit; Phage Terminase; Prophage Small Terminase Subunit; Phage Terminase/Endonuclease Subunit; Phage Terminase Endonuclease Small Subunit M; Terminase-Like Protein; Phage R Protein; Gp1 Phage Terminase Endonuclease Subunit; R Protein; Phage Terminase Endonuclease Subunit; Terminase Small Subunit; Bacteriophage-Related Terminase; Phage P2 Small Terminase Subunit GpM-Like Protein; Terminase; Bacteriophage Terminase Small Subunit; Bacteriophage Protein; Phage-Related Terminase

Number of amino acids: Translated: 243; Mature: 242

Protein sequence:

>243_residues
MSNPARYHRAFVAAELAASQDESAQMSHLGHYELLLFKLKQDLDRLHHVESRRRKAQLKREMLPTYQPWVAGVLASGTGA
QDAVLMRMLVWLLDVGDITAALDIGDYALRHALLAPDGFERATPCLIAEKVTASAQRNLNDGQPLDTEQLLRARSLLAGQ
DMPDKVKACLLKVVGHALRQDGTLTPVRVREAALNAMHEVNTRLAVWHRAQERAGTLALDAVPAEPGLIKRRQKEKALFE
SRE

Sequences:

>Translated_243_residues
MSNPARYHRAFVAAELAASQDESAQMSHLGHYELLLFKLKQDLDRLHHVESRRRKAQLKREMLPTYQPWVAGVLASGTGA
QDAVLMRMLVWLLDVGDITAALDIGDYALRHALLAPDGFERATPCLIAEKVTASAQRNLNDGQPLDTEQLLRARSLLAGQ
DMPDKVKACLLKVVGHALRQDGTLTPVRVREAALNAMHEVNTRLAVWHRAQERAGTLALDAVPAEPGLIKRRQKEKALFE
SRE
>Mature_242_residues
SNPARYHRAFVAAELAASQDESAQMSHLGHYELLLFKLKQDLDRLHHVESRRRKAQLKREMLPTYQPWVAGVLASGTGAQ
DAVLMRMLVWLLDVGDITAALDIGDYALRHALLAPDGFERATPCLIAEKVTASAQRNLNDGQPLDTEQLLRARSLLAGQD
MPDKVKACLLKVVGHALRQDGTLTPVRVREAALNAMHEVNTRLAVWHRAQERAGTLALDAVPAEPGLIKRRQKEKALFES
RE

Specific function: Unknown

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 27031; Mature: 26899

Theoretical pI: Translated: 9.13; Mature: 9.13

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.8 %Cys     (Translated Protein)
2.9 %Met     (Translated Protein)
3.7 %Cys+Met (Translated Protein)
0.8 %Cys     (Mature Protein)
2.5 %Met     (Mature Protein)
3.3 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSNPARYHRAFVAAELAASQDESAQMSHLGHYELLLFKLKQDLDRLHHVESRRRKAQLKR
CCCHHHHHHHHHHHHHHHCCCHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
EMLPTYQPWVAGVLASGTGAQDAVLMRMLVWLLDVGDITAALDIGDYALRHALLAPDGFE
HHCCCHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCC
RATPCLIAEKVTASAQRNLNDGQPLDTEQLLRARSLLAGQDMPDKVKACLLKVVGHALRQ
CCCHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHC
DGTLTPVRVREAALNAMHEVNTRLAVWHRAQERAGTLALDAVPAEPGLIKRRQKEKALFE
CCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCEEEECCCCCCCHHHHHHHHHHHHC
SRE
CCC
>Mature Secondary Structure 
SNPARYHRAFVAAELAASQDESAQMSHLGHYELLLFKLKQDLDRLHHVESRRRKAQLKR
CCHHHHHHHHHHHHHHHCCCHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
EMLPTYQPWVAGVLASGTGAQDAVLMRMLVWLLDVGDITAALDIGDYALRHALLAPDGFE
HHCCCHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCC
RATPCLIAEKVTASAQRNLNDGQPLDTEQLLRARSLLAGQDMPDKVKACLLKVVGHALRQ
CCCHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHC
DGTLTPVRVREAALNAMHEVNTRLAVWHRAQERAGTLALDAVPAEPGLIKRRQKEKALFE
CCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCEEEECCCCCCCHHHHHHHHHHHHC
SRE
CCC

PDB accession: NA

Resolution: NA

Structure class: Alpha

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: NA