Definition Mesorhizobium loti MAFF303099 plasmid pMLa, complete sequence.
Accession NC_002679
Length 351,911

Click here to switch to the map view.

The map label for this gene is 13488290

Identifier: 13488290

GI number: 13488290

Start: 260206

End: 262392

Strand: Direct

Name: 13488290

Synonym: mlr9290

Alternate gene names: NA

Gene position: 260206-262392 (Clockwise)

Preceding gene: 13488289

Following gene: 13488291

Centisome position: 73.94

GC content: 52.72

Gene sequence:

>2187_bases
ATGGCCGATTTTGTACAGTCGCACGCTTTGGCGTTGATTTCGGAGGCGGTTGGCGCCTCAACAATAACCGTGCTCAAGGC
TGGCAAAGGCATGGCTCCTCGAGCCACCATCGCGACAGCTCTTGCAGACTGTGGATCTAATGTCGAGTTTGCCGATGGTG
ATTGGCAACGTGGCGGCTATCTCGCTGGATTCCAAAACCTGGTTGATGCGGCTTTGGAATGGACGACCAAAGAATGCCCG
CACCTGATCGAGAAGCACCAGCAATCGCTTAAGCGCCTGTTTCCGCTTCTCTCCAGCGCCGCCTTTACCGTTCCAAAAGA
CCTCACCAACACATCGAGCAAGGAAGAGCGAACACGGTTCTACCATCACGAATATCAGAACAAGCTGCTCGTGGGGCTCG
CCGAATATCTGCTCGAATATGCTAGCCGAAGCGGTCTCCGCTTTGTGCTGGTCATCGATCGAGCTTCAGAGATGTCACCT
ACGGCCGTCAACCTAGTGAAAGTGTTGCGGCGGCTCGACAGCGAACGCCATTTCCGCTTTGTTCTCGTGGACCATTCTAA
TTCCGTGTTCATTGAAGGGGCCTGTGAAGTCAACTTCGGCTGTTATTCGATAGATGAACTGGTCGGTCTCTTTAAACCTG
ACATGGCACCACAGAAGCGGCGGTTGATTTTTGAGGCGGCTCGCGGGAATCCGCTACTCCTTCGCGCTCTGATCACCTGC
AATCAGGCCGGCATGCCCGTTGTTGGATACTTGAGCTCCAATGCTGCTATCGACTTGCACCTGGCGAGCCTGAGCCCTGA
GGAACGCAGCGAGATGCTGCGCTCTTATGTGGAAGCAGACTGCAACCCGACCGATCTCATCGCCCAACGCAACTATGAGA
CATTCGATCGGGGGTATGCTGACGGTCTGCATGCAGAAATGCATCGGGCCGCAATTGAAAAATATCTCGCTGGAAAGTCA
CCCTTGGTGACATTCCACGCCTTATCTGTTCGCAACAAATTCAAGCGGCTCGAGCTTATTGCGGAGCCAAGCGAAATTCT
AAAGAGCATTGGGCTTTATGACACTTGGTTCAGCTATTTCGGCGAAATGTTTGCGGATCCCGAGTTGCGCGTTTACGGAA
CAGGAAACGATGCGATCAACGCGGTTTTCATCAACGCAGCCTTTGTTCTTTACAGCTTGGGCTGCGGCTGCGTCTCGGTT
CCCTATCTCGATCTTTTCTACTCGAAATTCCCATCAAGCCGCTACACGCCCACGGTGCTTTACGCCCAGTCAATGACCTA
TGCCAGATATCAACAGCCAGTGAACCTTCCATTGGCGGAACAATACGCGCTGCGAAACCTCGACACAATTGAGCGCGATT
TCAAATATCACGAAAAATACCATTACATAAAGGTTTTTGCGGAAAACGCCTATGCCTATATCAAGGCAAGGCAGGGTCAA
TTTGATGAAGCTCTCCAGCTTTGCACGGAAGGTAAGGCGACAATGTCAGAGACATATGGCGACAATCGCTTCAAACTACA
TCAGTCAATCTTGATGTATAATATCAGTCAGGTATACGAGCTTGTAAACGAACTTTCTCTGGCGGAGAAAAATCTTGGCG
ATGTCATCGCGGTTGATCCTTATTACGGCGAATACCAGAACGATCTTGGCAATCTCCTCGGCAAAGTCCCGGGCCGTGAA
GTTCACGCGTCAAATGCATATGCGCGCGCGATCGAGCTCTGCCCGCCTTACTACGAGGCGCATTTGAACCGGGCAGGTCT
CCGTAAACGTCTCGGTGATACACAAGGCGCGCTTTCCGATCTTGATCGCGCTCTGTCGATCAAGCCCGAAGAATGGCGAG
CTCTGCTGGAGAAAGGCAATATCCTTCTCTCAGCCGGAAACCCTTCTGCTGCAATTGAAGCTTACCTTGCTGCCGCTGAG
TTCGTTCCCTCACATGCGGACCTGCAGAGCAACTTGGGTCTTGCCTATTCCGAGTTGGAGAAGCCTGAGCAGAGCATCGC
TCATTATCAGAAGGCCCTCGATATCGATCCCCGTCATGCGCCGGCCCACAACAACCTTGCAATTGAGCTGTTCAACGCCA
AGCAGCCTGATGCGGCGTTGGAGCATGCCAATCAAGCCGTCGATTTTGCCGGCGATCCCGACTACGAGGCCACGCGCAAC
CATATCCGCATGGCATTGGCGAGTTAG

Upstream 100 bases:

>100_bases
ACCACGGTCATCCGTACGACCACGCCGTACACAGGCACGGTCTGATGACTTGGGAGGGTGGCAATGCGCCACCCTCCCTC
AACCAAGAACGGGGAGCAAT

Downstream 100 bases:

>100_bases
TCTGCTTGTTGCACGAGATGGCGCAGCGAAATGAGGCGAGTCATGGCGAAGACGCCTCCCCCATTCGAGCTCTGCCATCT
GCGCTATTTCCTGGCCGGCG

Product: hypothetical protein

Products: NA

Alternate protein names: Tetratricopeptide TPR_2 Repeat Protein; Tetratricopeptide TPR_1 Repeat-Containing Protein; Tetratricopeptide Tpr_1 Repeat-Containing Protein; Tetratricopeptide Repeat Family; TPR Repeat Protein; Tetratricopeptide Domain-Containing Protein; Tetratricopeptide Repeat Domain Protein

Number of amino acids: Translated: 728; Mature: 727

Protein sequence:

>728_residues
MADFVQSHALALISEAVGASTITVLKAGKGMAPRATIATALADCGSNVEFADGDWQRGGYLAGFQNLVDAALEWTTKECP
HLIEKHQQSLKRLFPLLSSAAFTVPKDLTNTSSKEERTRFYHHEYQNKLLVGLAEYLLEYASRSGLRFVLVIDRASEMSP
TAVNLVKVLRRLDSERHFRFVLVDHSNSVFIEGACEVNFGCYSIDELVGLFKPDMAPQKRRLIFEAARGNPLLLRALITC
NQAGMPVVGYLSSNAAIDLHLASLSPEERSEMLRSYVEADCNPTDLIAQRNYETFDRGYADGLHAEMHRAAIEKYLAGKS
PLVTFHALSVRNKFKRLELIAEPSEILKSIGLYDTWFSYFGEMFADPELRVYGTGNDAINAVFINAAFVLYSLGCGCVSV
PYLDLFYSKFPSSRYTPTVLYAQSMTYARYQQPVNLPLAEQYALRNLDTIERDFKYHEKYHYIKVFAENAYAYIKARQGQ
FDEALQLCTEGKATMSETYGDNRFKLHQSILMYNISQVYELVNELSLAEKNLGDVIAVDPYYGEYQNDLGNLLGKVPGRE
VHASNAYARAIELCPPYYEAHLNRAGLRKRLGDTQGALSDLDRALSIKPEEWRALLEKGNILLSAGNPSAAIEAYLAAAE
FVPSHADLQSNLGLAYSELEKPEQSIAHYQKALDIDPRHAPAHNNLAIELFNAKQPDAALEHANQAVDFAGDPDYEATRN
HIRMALAS

Sequences:

>Translated_728_residues
MADFVQSHALALISEAVGASTITVLKAGKGMAPRATIATALADCGSNVEFADGDWQRGGYLAGFQNLVDAALEWTTKECP
HLIEKHQQSLKRLFPLLSSAAFTVPKDLTNTSSKEERTRFYHHEYQNKLLVGLAEYLLEYASRSGLRFVLVIDRASEMSP
TAVNLVKVLRRLDSERHFRFVLVDHSNSVFIEGACEVNFGCYSIDELVGLFKPDMAPQKRRLIFEAARGNPLLLRALITC
NQAGMPVVGYLSSNAAIDLHLASLSPEERSEMLRSYVEADCNPTDLIAQRNYETFDRGYADGLHAEMHRAAIEKYLAGKS
PLVTFHALSVRNKFKRLELIAEPSEILKSIGLYDTWFSYFGEMFADPELRVYGTGNDAINAVFINAAFVLYSLGCGCVSV
PYLDLFYSKFPSSRYTPTVLYAQSMTYARYQQPVNLPLAEQYALRNLDTIERDFKYHEKYHYIKVFAENAYAYIKARQGQ
FDEALQLCTEGKATMSETYGDNRFKLHQSILMYNISQVYELVNELSLAEKNLGDVIAVDPYYGEYQNDLGNLLGKVPGRE
VHASNAYARAIELCPPYYEAHLNRAGLRKRLGDTQGALSDLDRALSIKPEEWRALLEKGNILLSAGNPSAAIEAYLAAAE
FVPSHADLQSNLGLAYSELEKPEQSIAHYQKALDIDPRHAPAHNNLAIELFNAKQPDAALEHANQAVDFAGDPDYEATRN
HIRMALAS
>Mature_727_residues
ADFVQSHALALISEAVGASTITVLKAGKGMAPRATIATALADCGSNVEFADGDWQRGGYLAGFQNLVDAALEWTTKECPH
LIEKHQQSLKRLFPLLSSAAFTVPKDLTNTSSKEERTRFYHHEYQNKLLVGLAEYLLEYASRSGLRFVLVIDRASEMSPT
AVNLVKVLRRLDSERHFRFVLVDHSNSVFIEGACEVNFGCYSIDELVGLFKPDMAPQKRRLIFEAARGNPLLLRALITCN
QAGMPVVGYLSSNAAIDLHLASLSPEERSEMLRSYVEADCNPTDLIAQRNYETFDRGYADGLHAEMHRAAIEKYLAGKSP
LVTFHALSVRNKFKRLELIAEPSEILKSIGLYDTWFSYFGEMFADPELRVYGTGNDAINAVFINAAFVLYSLGCGCVSVP
YLDLFYSKFPSSRYTPTVLYAQSMTYARYQQPVNLPLAEQYALRNLDTIERDFKYHEKYHYIKVFAENAYAYIKARQGQF
DEALQLCTEGKATMSETYGDNRFKLHQSILMYNISQVYELVNELSLAEKNLGDVIAVDPYYGEYQNDLGNLLGKVPGREV
HASNAYARAIELCPPYYEAHLNRAGLRKRLGDTQGALSDLDRALSIKPEEWRALLEKGNILLSAGNPSAAIEAYLAAAEF
VPSHADLQSNLGLAYSELEKPEQSIAHYQKALDIDPRHAPAHNNLAIELFNAKQPDAALEHANQAVDFAGDPDYEATRNH
IRMALAS

Specific function: Unknown

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

Organism=Homo sapiens, GI32307148, Length=196, Percent_Identity=29.5918367346939, Blast_Score=70, Evalue=7e-12,
Organism=Homo sapiens, GI32307150, Length=196, Percent_Identity=29.5918367346939, Blast_Score=70, Evalue=7e-12,
Organism=Caenorhabditis elegans, GI115532692, Length=181, Percent_Identity=30.939226519337, Blast_Score=78, Evalue=2e-14,
Organism=Caenorhabditis elegans, GI115532690, Length=181, Percent_Identity=30.939226519337, Blast_Score=77, Evalue=3e-14,
Organism=Caenorhabditis elegans, GI25147174, Length=235, Percent_Identity=27.6595744680851, Blast_Score=66, Evalue=8e-11,
Organism=Drosophila melanogaster, GI17647755, Length=167, Percent_Identity=30.5389221556886, Blast_Score=68, Evalue=3e-11,
Organism=Drosophila melanogaster, GI24585827, Length=167, Percent_Identity=30.5389221556886, Blast_Score=68, Evalue=3e-11,
Organism=Drosophila melanogaster, GI24585829, Length=167, Percent_Identity=30.5389221556886, Blast_Score=68, Evalue=3e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 81324; Mature: 81193

Theoretical pI: Translated: 5.88; Mature: 5.88

Prosite motif: PS50005 TPR L=RR ; PS50293 TPR_REGION

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.4 %Cys     (Translated Protein)
1.6 %Met     (Translated Protein)
3.0 %Cys+Met (Translated Protein)
1.4 %Cys     (Mature Protein)
1.5 %Met     (Mature Protein)
2.9 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MADFVQSHALALISEAVGASTITVLKAGKGMAPRATIATALADCGSNVEFADGDWQRGGY
CCCHHHHHHHHHHHHHHCCCEEEEEECCCCCCCHHHHHHHHHHCCCCCEECCCCCCCCCC
LAGFQNLVDAALEWTTKECPHLIEKHQQSLKRLFPLLSSAAFTVPKDLTNTSSKEERTRF
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCHHCCCHHHCCCCCHHHHHHH
YHHEYQNKLLVGLAEYLLEYASRSGLRFVLVIDRASEMSPTAVNLVKVLRRLDSERHFRF
HHHHHHHHHHHHHHHHHHHHHCCCCCEEEEEEECCCCCCCHHHHHHHHHHHHCCCCCEEE
VLVDHSNSVFIEGACEVNFGCYSIDELVGLFKPDMAPQKRRLIFEAARGNPLLLRALITC
EEEECCCCEEEEEEEEECCCCEEHHHHHHHHCCCCCCCHHHHEEEECCCCHHHHHHHHHH
NQAGMPVVGYLSSNAAIDLHLASLSPEERSEMLRSYVEADCNPTDLIAQRNYETFDRGYA
CCCCCCEEEEECCCCEEEEEEECCCHHHHHHHHHHHHHCCCCHHHHHHCCCCHHHHCCCC
DGLHAEMHRAAIEKYLAGKSPLVTFHALSVRNKFKRLELIAEPSEILKSIGLYDTWFSYF
CCHHHHHHHHHHHHHHCCCCCEEEEHHHHHHHHHHHHHHHCCHHHHHHHCCCHHHHHHHH
GEMFADPELRVYGTGNDAINAVFINAAFVLYSLGCGCVSVPYLDLFYSKFPSSRYTPTVL
HHHHCCCCEEEEECCCCCHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHCCCCCCCCEEE
YAQSMTYARYQQPVNLPLAEQYALRNLDTIERDFKYHEKYHYIKVFAENAYAYIKARQGQ
EECHHHHHHHCCCCCCCHHHHHHHHCHHHHHHHHHHHHCEEEEEEEECCCEEEEEECCCC
FDEALQLCTEGKATMSETYGDNRFKLHQSILMYNISQVYELVNELSLAEKNLGDVIAVDP
HHHHHHHHHCCCHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEECC
YYGEYQNDLGNLLGKVPGREVHASNAYARAIELCPPYYEAHLNRAGLRKRLGDTQGALSD
CCCHHHHHHHHHHHCCCCCEEECCCHHHHHHHHCCCHHHHHCCHHHHHHHHCCCHHHHHH
LDRALSIKPEEWRALLEKGNILLSAGNPSAAIEAYLAAAEFVPSHADLQSNLGLAYSELE
HHHHHCCCHHHHHHHHHCCCEEEECCCCHHHHHHHHHHHHHCCCHHHHHHCCCCHHHHHC
KPEQSIAHYQKALDIDPRHAPAHNNLAIELFNAKQPDAALEHANQAVDFAGDPDYEATRN
CHHHHHHHHHHHCCCCCCCCCCCCCEEEEEECCCCCCHHHHHHHHCCCCCCCCCHHHHHH
HIRMALAS
HHHHEECC
>Mature Secondary Structure 
ADFVQSHALALISEAVGASTITVLKAGKGMAPRATIATALADCGSNVEFADGDWQRGGY
CCHHHHHHHHHHHHHHCCCEEEEEECCCCCCCHHHHHHHHHHCCCCCEECCCCCCCCCC
LAGFQNLVDAALEWTTKECPHLIEKHQQSLKRLFPLLSSAAFTVPKDLTNTSSKEERTRF
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCHHCCCHHHCCCCCHHHHHHH
YHHEYQNKLLVGLAEYLLEYASRSGLRFVLVIDRASEMSPTAVNLVKVLRRLDSERHFRF
HHHHHHHHHHHHHHHHHHHHHCCCCCEEEEEEECCCCCCCHHHHHHHHHHHHCCCCCEEE
VLVDHSNSVFIEGACEVNFGCYSIDELVGLFKPDMAPQKRRLIFEAARGNPLLLRALITC
EEEECCCCEEEEEEEEECCCCEEHHHHHHHHCCCCCCCHHHHEEEECCCCHHHHHHHHHH
NQAGMPVVGYLSSNAAIDLHLASLSPEERSEMLRSYVEADCNPTDLIAQRNYETFDRGYA
CCCCCCEEEEECCCCEEEEEEECCCHHHHHHHHHHHHHCCCCHHHHHHCCCCHHHHCCCC
DGLHAEMHRAAIEKYLAGKSPLVTFHALSVRNKFKRLELIAEPSEILKSIGLYDTWFSYF
CCHHHHHHHHHHHHHHCCCCCEEEEHHHHHHHHHHHHHHHCCHHHHHHHCCCHHHHHHHH
GEMFADPELRVYGTGNDAINAVFINAAFVLYSLGCGCVSVPYLDLFYSKFPSSRYTPTVL
HHHHCCCCEEEEECCCCCHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHCCCCCCCCEEE
YAQSMTYARYQQPVNLPLAEQYALRNLDTIERDFKYHEKYHYIKVFAENAYAYIKARQGQ
EECHHHHHHHCCCCCCCHHHHHHHHCHHHHHHHHHHHHCEEEEEEEECCCEEEEEECCCC
FDEALQLCTEGKATMSETYGDNRFKLHQSILMYNISQVYELVNELSLAEKNLGDVIAVDP
HHHHHHHHHCCCHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEECC
YYGEYQNDLGNLLGKVPGREVHASNAYARAIELCPPYYEAHLNRAGLRKRLGDTQGALSD
CCCHHHHHHHHHHHCCCCCEEECCCHHHHHHHHCCCHHHHHCCHHHHHHHHCCCHHHHHH
LDRALSIKPEEWRALLEKGNILLSAGNPSAAIEAYLAAAEFVPSHADLQSNLGLAYSELE
HHHHHCCCHHHHHHHHHCCCEEEECCCCHHHHHHHHHHHHHCCCHHHHHHCCCCHHHHHC
KPEQSIAHYQKALDIDPRHAPAHNNLAIELFNAKQPDAALEHANQAVDFAGDPDYEATRN
CHHHHHHHHHHHCCCCCCCCCCCCCEEEEEECCCCCCHHHHHHHHCCCCCCCCCHHHHHH
HIRMALAS
HHHHEECC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA