Definition Prochlorococcus marinus str. MIT 9303, complete genome.
Accession NC_008820
Length 2,682,675

Click here to switch to the map view.

The map label for this gene is sms [H]

Identifier: 124024340

GI number: 124024340

Start: 2341342

End: 2342736

Strand: Reverse

Name: sms [H]

Synonym: P9303_26521

Alternate gene names: 124024340

Gene position: 2342736-2341342 (Counterclockwise)

Preceding gene: 124024346

Following gene: 124024338

Centisome position: 87.33

GC content: 57.28

Gene sequence:

>1395_bases
GTGCGCACTGCTTCCGTCTACGTCTGTCAGAGCTGTGGCGCTAAGACCAGCCAGTTTTTTGGTCGCTGCGCCAGTTGCGG
GACTTGGAATTCCTTGGTCGAACAGGTCGCTCATTCAACCGATGGTCGCCGCCGTAGTAACAGTTTTGATCCGGCGGTGG
AACCAGCGGCGCGGCGCTCGATGGCGATGGCTTCTCTAGGGGATCAACCCGTTTGCCGTCTTGCCAGTGGCTACGACGAA
TTGGATCGAGTCCTGGGAGGCGGTCTGGTGCCTGGATCAATGGTGTTAGTTGGAGGTGATCCTGGTATTGGCAAGAGCAC
GCTGCTGTTGCAGAGCGCCACGGCTATGGCACAGCAACACTCTGTGCTTTACGTGAGTGCTGAGGAGTCTGCCCAGCAGG
TGAAGTTGCGTTGGCTGCGTCTTGAGGGGGTTGTGTCGGACCTGCAGCTTTTGGCGGAAACGGACTTGGAATTGGTGCTT
CAGGAATTGGAAGCACTGCGGCCTGCGGTGGCGATTATCGACAGCATCCAGGCTTTGCATGATGGGTCCCTTTCCAGTGC
GCCTGGCTCTGTCGCTCAGGTGCGCGAGTGTGCAGCAGCTTTACAGCGTTTGGCTAAGCGTCAGGACACAGCCTTGATTT
TGGTGGGCCATGTCACCAAGGAGGGGATGCTGGCGGGCCCCAAGGTGCTTGAGCATTTGGTCGATGCAGTACTCACTTTT
GAGGGCGATCGATTTGCCAGTCATCGCCTTCTGAGGGCTGTAAAAAACCGCTTTGGAGCCACCCATGAGCTGGGGGTGTT
CGAGATGCAGGGCAAGGGCCTAGCTGAAGTAGGGAACCCCAGCGAACTCTTTCTCAAGGGTGAGTCTGCCTCTGGGGTGG
CCACCATCGTGGCCTTTGAAGGGACCCGTTCATTGGTGGTGGATCTGCAGGCTTTGGTGGGTGTAACCAGCTATGCCAGT
CCACGCCGTACCGCTACAGGATTAGGCACCAACCGCTTGCACCAAATTCTGGCCGTATTGGAGAAGCACATGGGCTTGCC
ATTGTCACGCTATGACTGTTATCTGGCTGTTGCTGGCGGATTAGAAGTCGAAGAGCCTGCTGCTGATTTGGGTGTCGCCG
CTGCCGTTGTTTCCAGTTACCGGGATCTCATGCTGCCAAAAGGCACAGTTTTGCTTGGAGAGTTGGGCTTAGGGGGGCAA
TTGCGGCCAGTGGGGCAGCTTGGGCAGCGTCTTAAGGAAGCAGTTCGCTTAGGTTTTCATCGTGCCGTAGTGCCGCAGGG
CAGTGGCCTAGGACCCATCGGCGAGGAGCTGGAGTTGGAACTACTTGAGGCTGCGAGTGTTACTGAGGCTTTGGTGATGG
CCCTCGGTGTGAATCCAGCTGATGATGGCTGCTGA

Upstream 100 bases:

>100_bases
TTCTTTGGCGGCTGCAATCAATGAATCTTAGATAAGAGCTGTTAAGGCCTGCCGGCCTTTTGGTTCATTTAAAGCCAACT
TTCTTTACCTATCTTAGCAA

Downstream 100 bases:

>100_bases
ATGATGTTTTCGCTTTAGAAGTAGACGTCTATGTTGCTTCGGCCTGTTGTCTTCAGCCAGTTCTCAATATCTAGGTAGCC
GCCGGGATAGAGCCTTACCG

Product: DNA repair protein RadA

Products: NA

Alternate protein names: DNA repair protein sms homolog [H]

Number of amino acids: Translated: 464; Mature: 464

Protein sequence:

>464_residues
MRTASVYVCQSCGAKTSQFFGRCASCGTWNSLVEQVAHSTDGRRRSNSFDPAVEPAARRSMAMASLGDQPVCRLASGYDE
LDRVLGGGLVPGSMVLVGGDPGIGKSTLLLQSATAMAQQHSVLYVSAEESAQQVKLRWLRLEGVVSDLQLLAETDLELVL
QELEALRPAVAIIDSIQALHDGSLSSAPGSVAQVRECAAALQRLAKRQDTALILVGHVTKEGMLAGPKVLEHLVDAVLTF
EGDRFASHRLLRAVKNRFGATHELGVFEMQGKGLAEVGNPSELFLKGESASGVATIVAFEGTRSLVVDLQALVGVTSYAS
PRRTATGLGTNRLHQILAVLEKHMGLPLSRYDCYLAVAGGLEVEEPAADLGVAAAVVSSYRDLMLPKGTVLLGELGLGGQ
LRPVGQLGQRLKEAVRLGFHRAVVPQGSGLGPIGEELELELLEAASVTEALVMALGVNPADDGC

Sequences:

>Translated_464_residues
MRTASVYVCQSCGAKTSQFFGRCASCGTWNSLVEQVAHSTDGRRRSNSFDPAVEPAARRSMAMASLGDQPVCRLASGYDE
LDRVLGGGLVPGSMVLVGGDPGIGKSTLLLQSATAMAQQHSVLYVSAEESAQQVKLRWLRLEGVVSDLQLLAETDLELVL
QELEALRPAVAIIDSIQALHDGSLSSAPGSVAQVRECAAALQRLAKRQDTALILVGHVTKEGMLAGPKVLEHLVDAVLTF
EGDRFASHRLLRAVKNRFGATHELGVFEMQGKGLAEVGNPSELFLKGESASGVATIVAFEGTRSLVVDLQALVGVTSYAS
PRRTATGLGTNRLHQILAVLEKHMGLPLSRYDCYLAVAGGLEVEEPAADLGVAAAVVSSYRDLMLPKGTVLLGELGLGGQ
LRPVGQLGQRLKEAVRLGFHRAVVPQGSGLGPIGEELELELLEAASVTEALVMALGVNPADDGC
>Mature_464_residues
MRTASVYVCQSCGAKTSQFFGRCASCGTWNSLVEQVAHSTDGRRRSNSFDPAVEPAARRSMAMASLGDQPVCRLASGYDE
LDRVLGGGLVPGSMVLVGGDPGIGKSTLLLQSATAMAQQHSVLYVSAEESAQQVKLRWLRLEGVVSDLQLLAETDLELVL
QELEALRPAVAIIDSIQALHDGSLSSAPGSVAQVRECAAALQRLAKRQDTALILVGHVTKEGMLAGPKVLEHLVDAVLTF
EGDRFASHRLLRAVKNRFGATHELGVFEMQGKGLAEVGNPSELFLKGESASGVATIVAFEGTRSLVVDLQALVGVTSYAS
PRRTATGLGTNRLHQILAVLEKHMGLPLSRYDCYLAVAGGLEVEEPAADLGVAAAVVSSYRDLMLPKGTVLLGELGLGGQ
LRPVGQLGQRLKEAVRLGFHRAVVPQGSGLGPIGEELELELLEAASVTEALVMALGVNPADDGC

Specific function: May play a role in the repair of endogenous alkylation damage [H]

COG id: COG1066

COG function: function code O; Predicted ATP-dependent serine protease

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the recA family. RadA subfamily [H]

Homologues:

Organism=Escherichia coli, GI1790850, Length=424, Percent_Identity=47.1698113207547, Blast_Score=370, Evalue=1e-103,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR003593
- InterPro:   IPR014774
- InterPro:   IPR004504
- InterPro:   IPR008269
- InterPro:   IPR020568 [H]

Pfam domain/function: PF06745 KaiC; PF05362 Lon_C [H]

EC number: NA

Molecular weight: Translated: 48860; Mature: 48860

Theoretical pI: Translated: 5.64; Mature: 5.64

Prosite motif: PS50162 RECA_2

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.7 %Cys     (Translated Protein)
2.2 %Met     (Translated Protein)
3.9 %Cys+Met (Translated Protein)
1.7 %Cys     (Mature Protein)
2.2 %Met     (Mature Protein)
3.9 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MRTASVYVCQSCGAKTSQFFGRCASCGTWNSLVEQVAHSTDGRRRSNSFDPAVEPAARRS
CCCCCEEEEHHCCCCHHHHHHHHCCCCCHHHHHHHHHHCCCCCCCCCCCCCCCCHHHHHH
MAMASLGDQPVCRLASGYDELDRVLGGGLVPGSMVLVGGDPGIGKSTLLLQSATAMAQQH
HHHHHCCCCHHHHHHCCHHHHHHHHCCCCCCCCEEEECCCCCCCCHHHHHHHHHHHHHCC
SVLYVSAEESAQQVKLRWLRLEGVVSDLQLLAETDLELVLQELEALRPAVAIIDSIQALH
CEEEEECCHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHH
DGSLSSAPGSVAQVRECAAALQRLAKRQDTALILVGHVTKEGMLAGPKVLEHLVDAVLTF
CCCCCCCCCHHHHHHHHHHHHHHHHHCCCCEEEEEEECCCCCCCCCHHHHHHHHHHHHHC
EGDRFASHRLLRAVKNRFGATHELGVFEMQGKGLAEVGNPSELFLKGESASGVATIVAFE
CCCHHHHHHHHHHHHHHCCCCCCCCEEEECCCCCCCCCCCCCEEEECCCCCCEEEEEEEC
GTRSLVVDLQALVGVTSYASPRRTATGLGTNRLHQILAVLEKHMGLPLSRYDCYLAVAGG
CCHHHHHHHHHHHHHHHCCCCCCHHCCCCHHHHHHHHHHHHHHHCCCCHHCCEEEEEECC
LEVEEPAADLGVAAAVVSSYRDLMLPKGTVLLGELGLGGQLRPVGQLGQRLKEAVRLGFH
CCCCCCHHHHHHHHHHHHHHHHHCCCCCCEEEEECCCCCCCCHHHHHHHHHHHHHHHHHH
RAVVPQGSGLGPIGEELELELLEAASVTEALVMALGVNPADDGC
HEECCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCC
>Mature Secondary Structure
MRTASVYVCQSCGAKTSQFFGRCASCGTWNSLVEQVAHSTDGRRRSNSFDPAVEPAARRS
CCCCCEEEEHHCCCCHHHHHHHHCCCCCHHHHHHHHHHCCCCCCCCCCCCCCCCHHHHHH
MAMASLGDQPVCRLASGYDELDRVLGGGLVPGSMVLVGGDPGIGKSTLLLQSATAMAQQH
HHHHHCCCCHHHHHHCCHHHHHHHHCCCCCCCCEEEECCCCCCCCHHHHHHHHHHHHHCC
SVLYVSAEESAQQVKLRWLRLEGVVSDLQLLAETDLELVLQELEALRPAVAIIDSIQALH
CEEEEECCHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHH
DGSLSSAPGSVAQVRECAAALQRLAKRQDTALILVGHVTKEGMLAGPKVLEHLVDAVLTF
CCCCCCCCCHHHHHHHHHHHHHHHHHCCCCEEEEEEECCCCCCCCCHHHHHHHHHHHHHC
EGDRFASHRLLRAVKNRFGATHELGVFEMQGKGLAEVGNPSELFLKGESASGVATIVAFE
CCCHHHHHHHHHHHHHHCCCCCCCCEEEECCCCCCCCCCCCCEEEECCCCCCEEEEEEEC
GTRSLVVDLQALVGVTSYASPRRTATGLGTNRLHQILAVLEKHMGLPLSRYDCYLAVAGG
CCHHHHHHHHHHHHHHHCCCCCCHHCCCCHHHHHHHHHHHHHHHCCCCHHCCEEEEEECC
LEVEEPAADLGVAAAVVSSYRDLMLPKGTVLLGELGLGGQLRPVGQLGQRLKEAVRLGFH
CCCCCCHHHHHHHHHHHHHHHHHCCCCCCEEEEECCCCCCCCHHHHHHHHHHHHHHHHHH
RAVVPQGSGLGPIGEELELELLEAASVTEALVMALGVNPADDGC
HEECCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 8905231 [H]