Definition Rhizobium leguminosarum bv. viciae 3841 plasmid pRL12, complete sequence.
Accession NC_008378
Length 870,021

Click here to switch to the map view.

The map label for this gene is 116248788

Identifier: 116248788

GI number: 116248788

Start: 109220

End: 111271

Strand: Direct

Name: 116248788

Synonym: pRL120114

Alternate gene names: NA

Gene position: 109220-111271 (Clockwise)

Preceding gene: 116248787

Following gene: 116248789

Centisome position: 12.55

GC content: 60.23

Gene sequence:

>2052_bases
ATGCCGAACACCACAAACAAGCCGTTGCGCTACCGCCAGATCCATCTCGACTTCCATACGTCGGAACATATTCCCGGCAT
CGGCGTCGACTTCGATCCGGATATTTTCGTTTCAACGCTGAAGGCGGCGCATGTCGACTCGATCACGATCTTCGCCAAGT
GCCATCACGGCTGGTCCTACTATCCGACCAAGGTCGGCAAGCCGCATCCGCGGCTGGCCCGCCCGGACCTCCTCGGCGAC
ATGGTGAAGGCGCTGTCGGCGGCCGATATCGAAAGCCCGATTTATATATCGGTACAGTGGGACGAGCTGACGGCGCGCGA
ACATCCCGAATGGCGCGCCATGACCGCGTCGAACCAATACCATCACGACCGTCCGGACGACCCTTCGGCGGGCAAGCAGC
TTAGCCCGGCGTGGCATACGCTCTGCCTCAACCATGCCGGCCTACGGAAATACATTCTCGACCAGGCGCGCGAAGTCGCG
CAAAGCTATCCCACGCAGGGTCTGTTCTTCGATATCATCCTCACGCCGGATTGTGTATGCCCGGCTTGCATCGAGCGCAT
GCAGTGCGAGGGCCTCGATCCAGAAAATTCGGCGGACCGGCTGAAGAACGACGAGGCCGTCAACGAACAGTTCCGGCGTG
AAACGAGCGAGGCGCTGTTCAAGGAGTTCCCTAATCTCCGCGTCTTCTACAATTGCGGACATATCCACAAGCAGGGCCCG
AAGCGCTTTTCCACCTATTCTCATCTCGAGCTCGAAAGCCTGCCCACCGGCGGTTGGGGTTACGATCACTTTCCGTCCAG
CGCGCGCTACGCGGCAACGCTCGGCATGGATTTCCTGGCACATACAGGCAAGTTCCACACCTCGTGGGGCGAGTTCGGCG
GTTTCAAGCACCCTGATGCGTTGGAATATGAATGTGCGCAAATGATCGCGCTCGGATCGAAGTGCCTGGTCGGCGACCAG
TTGCATCCGAACGGCGCCATCAACCCGGATACTTACGCTTCGATCGCGCCGGCTTATCGACGCGTTGAAAAGCTGGAGCC
GTTTCTGGATGGCGCGAAGCAGGTCTCCGAGATCGCTATATTGTCCGCCGAGCACATGAACCCCAAGGGCGCGCGCAATC
ACCCGAGCGACGATGGCGCGGCACAGATGCTGCAGGAGCTGAAGCGGCCCTTCGACGTGCTCGACAGTTCCGCTCGTTTC
GAGGAGTACCGACTGCTGATCCTGCCGGATGAAATCCCGGTCGATGCTGCCCTTGCGGCGCGGCTGAAAGCCTATCTCGC
CGGTGGCGGCAAGATCATCGCCTCCTGGCATTCGGGCATCGGCGAAGATGGTGCATTTGCTGTCGATTTCGGCATTGAGC
GGCAGGCAACGCCGATCGCGTCCAGACCGAGCTATGTGAAGGCAGGCAAGGACCTTGATCCGTCCATGCCGAAAACGGCC
TTCGTTTTCTACGATGAAGCCGAAACCGTCCGCGCGGTCGGCGCAACGGTGCTGGCCGGTATTTACCCCTCCTACTTCAA
CCGGTCTTACAAACATTTCTGCTCGCACCAGCATGCTCCCGACGATACAGCCGCTGATATGCTTGGCGCTGCCGTGACCG
AGCATGGGGGCATCGCCTATATTGCCTACCCGATCTTTCGGCTTTACCGGGCCATTGGCCAGCCGCTTTACAAATATGTT
GTTCGAGGGCTTCTCGATCGTCTCGTTCCCGATCCGGCGATGGTTACCGATCTTCCCTCATCCGGCCGGGCAACGCTGAC
CCGGCAGATTGGGCACAATCGCCACATCCTGCATCTTCTTTACGGACCGCCGCAGATCCGCGGCAAGGACGTTCGTGGCG
ATGACGGCTCGAGGCGGGTGATGGAAATGATCGAGGACATCCCGGCGATCGGCCCGGTTAACGCCAGCGTGCGGTTGCCG
GCGAAGCCGAAGCGGGTTTTCGATGCCATGACCGGAGAGGATCTGGCCTGGGAAGCCGGCGCAGACGGCGCCATTAGCAT
CACAGTGCCGCGACTGCATATCCACAGCGCCGTGGTGTTCGAAGGCGTCTGA

Upstream 100 bases:

>100_bases
GCGATCATCACGACAATCGTTCCCCTCCTCGTTTTTCTTGTCTTCCAACGTCAGTTCGCCGCCGGCTCTCAAACCCGCAC
CGGCGCAAAGGAATAGGACC

Downstream 100 bases:

>100_bases
TGCAGGTTGAGGTAGGGGAACCGTCGGACATTGCTCTTGCCGCCCGCAACGCTGGTGGGCGGCAGAGCGCTGGGCTATAC
GACGGAAAAGCGCTTCCCCT

Product: hypothetical protein

Products: NA

Alternate protein names: None

Number of amino acids: Translated: 683; Mature: 682

Protein sequence:

>683_residues
MPNTTNKPLRYRQIHLDFHTSEHIPGIGVDFDPDIFVSTLKAAHVDSITIFAKCHHGWSYYPTKVGKPHPRLARPDLLGD
MVKALSAADIESPIYISVQWDELTAREHPEWRAMTASNQYHHDRPDDPSAGKQLSPAWHTLCLNHAGLRKYILDQAREVA
QSYPTQGLFFDIILTPDCVCPACIERMQCEGLDPENSADRLKNDEAVNEQFRRETSEALFKEFPNLRVFYNCGHIHKQGP
KRFSTYSHLELESLPTGGWGYDHFPSSARYAATLGMDFLAHTGKFHTSWGEFGGFKHPDALEYECAQMIALGSKCLVGDQ
LHPNGAINPDTYASIAPAYRRVEKLEPFLDGAKQVSEIAILSAEHMNPKGARNHPSDDGAAQMLQELKRPFDVLDSSARF
EEYRLLILPDEIPVDAALAARLKAYLAGGGKIIASWHSGIGEDGAFAVDFGIERQATPIASRPSYVKAGKDLDPSMPKTA
FVFYDEAETVRAVGATVLAGIYPSYFNRSYKHFCSHQHAPDDTAADMLGAAVTEHGGIAYIAYPIFRLYRAIGQPLYKYV
VRGLLDRLVPDPAMVTDLPSSGRATLTRQIGHNRHILHLLYGPPQIRGKDVRGDDGSRRVMEMIEDIPAIGPVNASVRLP
AKPKRVFDAMTGEDLAWEAGADGAISITVPRLHIHSAVVFEGV

Sequences:

>Translated_683_residues
MPNTTNKPLRYRQIHLDFHTSEHIPGIGVDFDPDIFVSTLKAAHVDSITIFAKCHHGWSYYPTKVGKPHPRLARPDLLGD
MVKALSAADIESPIYISVQWDELTAREHPEWRAMTASNQYHHDRPDDPSAGKQLSPAWHTLCLNHAGLRKYILDQAREVA
QSYPTQGLFFDIILTPDCVCPACIERMQCEGLDPENSADRLKNDEAVNEQFRRETSEALFKEFPNLRVFYNCGHIHKQGP
KRFSTYSHLELESLPTGGWGYDHFPSSARYAATLGMDFLAHTGKFHTSWGEFGGFKHPDALEYECAQMIALGSKCLVGDQ
LHPNGAINPDTYASIAPAYRRVEKLEPFLDGAKQVSEIAILSAEHMNPKGARNHPSDDGAAQMLQELKRPFDVLDSSARF
EEYRLLILPDEIPVDAALAARLKAYLAGGGKIIASWHSGIGEDGAFAVDFGIERQATPIASRPSYVKAGKDLDPSMPKTA
FVFYDEAETVRAVGATVLAGIYPSYFNRSYKHFCSHQHAPDDTAADMLGAAVTEHGGIAYIAYPIFRLYRAIGQPLYKYV
VRGLLDRLVPDPAMVTDLPSSGRATLTRQIGHNRHILHLLYGPPQIRGKDVRGDDGSRRVMEMIEDIPAIGPVNASVRLP
AKPKRVFDAMTGEDLAWEAGADGAISITVPRLHIHSAVVFEGV
>Mature_682_residues
PNTTNKPLRYRQIHLDFHTSEHIPGIGVDFDPDIFVSTLKAAHVDSITIFAKCHHGWSYYPTKVGKPHPRLARPDLLGDM
VKALSAADIESPIYISVQWDELTAREHPEWRAMTASNQYHHDRPDDPSAGKQLSPAWHTLCLNHAGLRKYILDQAREVAQ
SYPTQGLFFDIILTPDCVCPACIERMQCEGLDPENSADRLKNDEAVNEQFRRETSEALFKEFPNLRVFYNCGHIHKQGPK
RFSTYSHLELESLPTGGWGYDHFPSSARYAATLGMDFLAHTGKFHTSWGEFGGFKHPDALEYECAQMIALGSKCLVGDQL
HPNGAINPDTYASIAPAYRRVEKLEPFLDGAKQVSEIAILSAEHMNPKGARNHPSDDGAAQMLQELKRPFDVLDSSARFE
EYRLLILPDEIPVDAALAARLKAYLAGGGKIIASWHSGIGEDGAFAVDFGIERQATPIASRPSYVKAGKDLDPSMPKTAF
VFYDEAETVRAVGATVLAGIYPSYFNRSYKHFCSHQHAPDDTAADMLGAAVTEHGGIAYIAYPIFRLYRAIGQPLYKYVV
RGLLDRLVPDPAMVTDLPSSGRATLTRQIGHNRHILHLLYGPPQIRGKDVRGDDGSRRVMEMIEDIPAIGPVNASVRLPA
KPKRVFDAMTGEDLAWEAGADGAISITVPRLHIHSAVVFEGV

Specific function: Unknown

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 75707; Mature: 75576

Theoretical pI: Translated: 6.56; Mature: 6.56

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.5 %Cys     (Translated Protein)
2.0 %Met     (Translated Protein)
3.5 %Cys+Met (Translated Protein)
1.5 %Cys     (Mature Protein)
1.9 %Met     (Mature Protein)
3.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MPNTTNKPLRYRQIHLDFHTSEHIPGIGVDFDPDIFVSTLKAAHVDSITIFAKCHHGWSY
CCCCCCCCCEEEEEEEEEECCCCCCCCCCCCCCHHHHHHHHHHCCCEEEEEEEECCCCCC
YPTKVGKPHPRLARPDLLGDMVKALSAADIESPIYISVQWDELTAREHPEWRAMTASNQY
CCCCCCCCCCCCCCCHHHHHHHHHHHHCCCCCCEEEEEEECHHCCCCCCCCEEEECCCCC
HHDRPDDPSAGKQLSPAWHTLCLNHAGLRKYILDQAREVAQSYPTQGLFFDIILTPDCVC
CCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEEEEECCCCCC
PACIERMQCEGLDPENSADRLKNDEAVNEQFRRETSEALFKEFPNLRVFYNCGHIHKQGP
HHHHHHHHHCCCCCCCHHHHHCCHHHHHHHHHHHHHHHHHHHCCCCEEEEECCCCCCCCC
KRFSTYSHLELESLPTGGWGYDHFPSSARYAATLGMDFLAHTGKFHTSWGEFGGFKHPDA
HHHCCCCCEEHHCCCCCCCCCCCCCCCCCHHHHHHHHHHHHCCCCCCCHHHCCCCCCCCC
LEYECAQMIALGSKCLVGDQLHPNGAINPDTYASIAPAYRRVEKLEPFLDGAKQVSEIAI
HHHHHHHHHHCCCCCEECCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
LSAEHMNPKGARNHPSDDGAAQMLQELKRPFDVLDSSARFEEYRLLILPDEIPVDAALAA
HHHHCCCCCCCCCCCCCCHHHHHHHHHHCHHHHHCCCCCCCCEEEEEECCCCCHHHHHHH
RLKAYLAGGGKIIASWHSGIGEDGAFAVDFGIERQATPIASRPSYVKAGKDLDPSMPKTA
HHHHHHCCCCEEEEEHHCCCCCCCCEEEEECCCCCCCCCCCCCCHHHCCCCCCCCCCCEE
FVFYDEAETVRAVGATVLAGIYPSYFNRSYKHFCSHQHAPDDTAADMLGAAVTEHGGIAY
EEEECCHHHHHHHHHHHHHHHCHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHCCCCEEE
IAYPIFRLYRAIGQPLYKYVVRGLLDRLVPDPAMVTDLPSSGRATLTRQIGHNRHILHLL
HHHHHHHHHHHHCHHHHHHHHHHHHHHHCCCCHHEECCCCCCCHHHHHHHCCCCEEEEEE
YGPPQIRGKDVRGDDGSRRVMEMIEDIPAIGPVNASVRLPAKPKRVFDAMTGEDLAWEAG
ECCCCCCCCCCCCCCHHHHHHHHHHHCCCCCCCCCCEECCCCHHHHHHHCCCCCCEEECC
ADGAISITVPRLHIHSAVVFEGV
CCCEEEEEECCEEECEEEEECCC
>Mature Secondary Structure 
PNTTNKPLRYRQIHLDFHTSEHIPGIGVDFDPDIFVSTLKAAHVDSITIFAKCHHGWSY
CCCCCCCCEEEEEEEEEECCCCCCCCCCCCCCHHHHHHHHHHCCCEEEEEEEECCCCCC
YPTKVGKPHPRLARPDLLGDMVKALSAADIESPIYISVQWDELTAREHPEWRAMTASNQY
CCCCCCCCCCCCCCCHHHHHHHHHHHHCCCCCCEEEEEEECHHCCCCCCCCEEEECCCCC
HHDRPDDPSAGKQLSPAWHTLCLNHAGLRKYILDQAREVAQSYPTQGLFFDIILTPDCVC
CCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEEEEECCCCCC
PACIERMQCEGLDPENSADRLKNDEAVNEQFRRETSEALFKEFPNLRVFYNCGHIHKQGP
HHHHHHHHHCCCCCCCHHHHHCCHHHHHHHHHHHHHHHHHHHCCCCEEEEECCCCCCCCC
KRFSTYSHLELESLPTGGWGYDHFPSSARYAATLGMDFLAHTGKFHTSWGEFGGFKHPDA
HHHCCCCCEEHHCCCCCCCCCCCCCCCCCHHHHHHHHHHHHCCCCCCCHHHCCCCCCCCC
LEYECAQMIALGSKCLVGDQLHPNGAINPDTYASIAPAYRRVEKLEPFLDGAKQVSEIAI
HHHHHHHHHHCCCCCEECCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
LSAEHMNPKGARNHPSDDGAAQMLQELKRPFDVLDSSARFEEYRLLILPDEIPVDAALAA
HHHHCCCCCCCCCCCCCCHHHHHHHHHHCHHHHHCCCCCCCCEEEEEECCCCCHHHHHHH
RLKAYLAGGGKIIASWHSGIGEDGAFAVDFGIERQATPIASRPSYVKAGKDLDPSMPKTA
HHHHHHCCCCEEEEEHHCCCCCCCCEEEEECCCCCCCCCCCCCCHHHCCCCCCCCCCCEE
FVFYDEAETVRAVGATVLAGIYPSYFNRSYKHFCSHQHAPDDTAADMLGAAVTEHGGIAY
EEEECCHHHHHHHHHHHHHHHCHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHCCCCEEE
IAYPIFRLYRAIGQPLYKYVVRGLLDRLVPDPAMVTDLPSSGRATLTRQIGHNRHILHLL
HHHHHHHHHHHHCHHHHHHHHHHHHHHHCCCCHHEECCCCCCCHHHHHHHCCCCEEEEEE
YGPPQIRGKDVRGDDGSRRVMEMIEDIPAIGPVNASVRLPAKPKRVFDAMTGEDLAWEAG
ECCCCCCCCCCCCCCHHHHHHHHHHHCCCCCCCCCCEECCCCHHHHHHHCCCCCCEEECC
ADGAISITVPRLHIHSAVVFEGV
CCCEEEEEECCEEECEEEEECCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA