Definition Sinorhizobium fredii NGR234 plasmid pNGR234a, complete sequence.
Accession NC_000914
Length 536,165

Click here to switch to the map view.

The map label for this gene is Not Available

Identifier: 16519726

GI number: 16519726

Start: 486755

End: 489292

Strand: Direct

Name: Not Available

Synonym: NGR_a03800

Alternate gene names: 16519726

Gene position: 486755-489292 (Clockwise)

Preceding gene: 16519729

Following gene: 16519725

Centisome position: 90.78

GC content: 63.87

Gene sequence:

>2538_bases
ATGGGCTGGGTCGATCGCCTCCTCTCGCGTTTCAAAATCCGAACGAAGGTGATGCTGCTGGTGTTGCCCTTCATCCTGAG
CATCAGCGCGGTCGGGGTGACTGGCATGCTCGCATCCGGGCTTCTGCAAAGCCGCATGGCGATATCCAACGACGTCGCGG
CATCGCTGCGCGGCTTCAAGGATGTCTATGCGGCAATGATCGGCTTTCTCGACCAGACGACCGAAGAAAACCGGGCGCTC
GTCTTCAGCAAGCTCGACGAGCAGCGCGCCGCGCTCGACGCTGCCGGCGCACGCCTGACGCCGAAGGCCGAAGGCTGGGC
GGAGCTCGAAAGCGCATCCGCGGCGCTTTCTGCGATCAACGGCCGAATGGACGACCTTTGGGCTCTGCATGCCGATGAAG
CCCGCCTCGAAGCCGGCATCAAGGAGGCCTTGGGGGTCATCTCGACATCGCAGGCGGATCTCTTGACCGCCGCCACCGCG
TTCGACAAGTCGATCTCCACGCAGGAAGACGACGCCAAGGAGAAACTGCGTGACGCGCAAAGGATCCTCTCTGCGACAAG
CTTTGTCGTTGCGCTCAGAGATGCATTTGCCGCGCGCAAGGACGATGGCGAGGGCTATCGGGCGATCGCCGCAGCCATGG
GCGACCTGAAGATTCACCAGAAGCTGCTACCGATCGCGTTGCCGAAGAAATCCAAGCCGCTGGGCAAGGCCTTTTCGGCC
AACGTCAGGGCCTTGAGTGCGCTGGTGGATGACAAGGCGCGCCCGCCGGAAAACATAGAGAAAATCCTGGATGTCTTCGC
TGAGCTCAAAGCGCTTAAGGAGCCGTTGGAGGCGGCGGCGACCGCGAAGATGCAGCATGTGTCGACGACTTTCGAGGAGC
TCGATGCCTCGGTTGCCAAGGCCGGGCTCGTAATGCAGGACACGCGGCATCTCACCGATGCCATCTACCTGACGCGCATC
GCACTTGCCGAATTCATGCTCGACCGTTCCGCAGAAAAGCAGTCGACATTGGCAATGCACCTCGCGCAATGCCGCAACGC
GCTCTTTGCGCTGAGCTCCACGGCGGGCGATCTCGGCTTCGCCGGGGAGCAGTCGACCAAGCTCGCAACCTCCTTCGACC
GGATTGAACAGTCCGCCGTCGAACTTGTCGGCGCCACCGGCAAGCGCACACAGCAATTCCAGGCCGCTGCCGACGAGATC
GACCATATCGGCGAGCAGATATCGCTGTTCGCCGACCTGCAACGGAGCGCCGCCGGGCGCCAGAGCCAGGATGCCAATAG
GCTGTCCATCGGCGCCATGGTTCTGGGCGTGATCATCGCTCTCGTTTCCGGCGCGGCGCTGGTGCTCACGCTGAAGGGGC
CGATCGGGGAGATCACCCAGACGATGCGCAATCTGGCCGGTGGCCTGCTCGACACGGCTGTCGCTAACCGGAACCGCGCC
GACGAGATCGGCGAGATGGCGCGTGCCCTCGACGTCTTCAAGACCAATGCGAAGGCGAGGATCGCGCTCGAACAGCGGTC
CGAGCAGGAGCGCGTCGCCGCCCATGCCGAGCGTGAGCGAAACGAGGCGGAAAAGTTGCGCCGCGACCAGGAAATCGCCT
TCGCAGTCGACGCACTGGCAGATGGGCTCGACGCCATGGCAAAGGGCCGGCTGACCTCAACGATCGAGACACCCTTCGCC
CCGGCGCTTGACAAACTGCGCACCGATTTCAACGCCGCCGTCGCGGGCCTCAGGCAAACCCTCCTCGACATCCGCACGAC
GTCGTCCGTCATCCAGGGAAGCGGCCGTCAGATGGCCGAGGGCGCCAAGGCGCTCTCCGGTCGCACCGAGCAGCAGGCCG
CGTCGCTCGAAGAAACAGCCGCAAGCGTTGATGAGATCGTCGCCACCATCCGCAGGGCAGGCGACCAGGCGGCCAATGCC
GACAATACGGTCTCCAAGGCCAAGCAAGACGCCGATCGCTCCACCGTGGTCGTGGGCAATGCGACTGCGGCCATGGGGCG
GATTGAGGCCGCCTCCAGCCATATCGGCCACATCATCGAGGTCATCGACGACATCGCATTCCAGATCAATCTGCTGGCGC
TCAACGCGGGCATCGAGGCGGCGCGCGCCGGCGAGGCCGGCAAAGGTTTTGCCGTGGTCGCGCAGGAGGTGCGGGAACTC
GCGCAGCGGTCCGCCGGGGCTGCTCGGGAGATTGCCGCGTTAATCGGAAACTCCACGGCCGAAGTCGCCAAGGGCGCCGG
CCTCGTCTCCGAAACCGGTGCTGCGTTGCTGGATATCTCCAAGCACATCCTCGAGATCTCGACCCAGATCGAAGCAATCG
CGCTGTCGAGCCGGGAGCAGGCTTCGTCGATCGCCGAGGTGAACGTTGCAATCACGCGGCTTGATCAGCTGACGCAAAGC
AACGCGGCCATGGCCGAGGAGACGCAAGCCGCGAGCTGGACGCTGTCGGGCGAGGCGGACTACCTGATGCAACTCGTCGA
CCGGTTCGATCTTGGTGAGAACAGCGGCAGCGCATCGGAAACAATGAAGGCTGCCTGA

Upstream 100 bases:

>100_bases
ATCGCCGCTTCATTATCGATTTGTTATCCCTCGCCGCCTATCGATGCCGTGATGCTGCGCTGCACGCGGCTGCCACCTCA
ACAAAATTTCGGGACATCTC

Downstream 100 bases:

>100_bases
AGAAACCCCGTCAAAATATTTAACAGCAAGCACCATTGCCATTTGGATTGCGGCGCGGGGATCAGGGGCGGTGAAAACGA
CCCCTCTTCCCGCCGGTCGA

Product: methyl-accepting membrane chemoreceptor

Products: NA

Alternate protein names: Methyl-accepting chemotaxis protein

Number of amino acids: Translated: 845; Mature: 844

Protein sequence:

>845_residues
MGWVDRLLSRFKIRTKVMLLVLPFILSISAVGVTGMLASGLLQSRMAISNDVAASLRGFKDVYAAMIGFLDQTTEENRAL
VFSKLDEQRAALDAAGARLTPKAEGWAELESASAALSAINGRMDDLWALHADEARLEAGIKEALGVISTSQADLLTAATA
FDKSISTQEDDAKEKLRDAQRILSATSFVVALRDAFAARKDDGEGYRAIAAAMGDLKIHQKLLPIALPKKSKPLGKAFSA
NVRALSALVDDKARPPENIEKILDVFAELKALKEPLEAAATAKMQHVSTTFEELDASVAKAGLVMQDTRHLTDAIYLTRI
ALAEFMLDRSAEKQSTLAMHLAQCRNALFALSSTAGDLGFAGEQSTKLATSFDRIEQSAVELVGATGKRTQQFQAAADEI
DHIGEQISLFADLQRSAAGRQSQDANRLSIGAMVLGVIIALVSGAALVLTLKGPIGEITQTMRNLAGGLLDTAVANRNRA
DEIGEMARALDVFKTNAKARIALEQRSEQERVAAHAERERNEAEKLRRDQEIAFAVDALADGLDAMAKGRLTSTIETPFA
PALDKLRTDFNAAVAGLRQTLLDIRTTSSVIQGSGRQMAEGAKALSGRTEQQAASLEETAASVDEIVATIRRAGDQAANA
DNTVSKAKQDADRSTVVVGNATAAMGRIEAASSHIGHIIEVIDDIAFQINLLALNAGIEAARAGEAGKGFAVVAQEVREL
AQRSAGAAREIAALIGNSTAEVAKGAGLVSETGAALLDISKHILEISTQIEAIALSSREQASSIAEVNVAITRLDQLTQS
NAAMAEETQAASWTLSGEADYLMQLVDRFDLGENSGSASETMKAA

Sequences:

>Translated_845_residues
MGWVDRLLSRFKIRTKVMLLVLPFILSISAVGVTGMLASGLLQSRMAISNDVAASLRGFKDVYAAMIGFLDQTTEENRAL
VFSKLDEQRAALDAAGARLTPKAEGWAELESASAALSAINGRMDDLWALHADEARLEAGIKEALGVISTSQADLLTAATA
FDKSISTQEDDAKEKLRDAQRILSATSFVVALRDAFAARKDDGEGYRAIAAAMGDLKIHQKLLPIALPKKSKPLGKAFSA
NVRALSALVDDKARPPENIEKILDVFAELKALKEPLEAAATAKMQHVSTTFEELDASVAKAGLVMQDTRHLTDAIYLTRI
ALAEFMLDRSAEKQSTLAMHLAQCRNALFALSSTAGDLGFAGEQSTKLATSFDRIEQSAVELVGATGKRTQQFQAAADEI
DHIGEQISLFADLQRSAAGRQSQDANRLSIGAMVLGVIIALVSGAALVLTLKGPIGEITQTMRNLAGGLLDTAVANRNRA
DEIGEMARALDVFKTNAKARIALEQRSEQERVAAHAERERNEAEKLRRDQEIAFAVDALADGLDAMAKGRLTSTIETPFA
PALDKLRTDFNAAVAGLRQTLLDIRTTSSVIQGSGRQMAEGAKALSGRTEQQAASLEETAASVDEIVATIRRAGDQAANA
DNTVSKAKQDADRSTVVVGNATAAMGRIEAASSHIGHIIEVIDDIAFQINLLALNAGIEAARAGEAGKGFAVVAQEVREL
AQRSAGAAREIAALIGNSTAEVAKGAGLVSETGAALLDISKHILEISTQIEAIALSSREQASSIAEVNVAITRLDQLTQS
NAAMAEETQAASWTLSGEADYLMQLVDRFDLGENSGSASETMKAA
>Mature_844_residues
GWVDRLLSRFKIRTKVMLLVLPFILSISAVGVTGMLASGLLQSRMAISNDVAASLRGFKDVYAAMIGFLDQTTEENRALV
FSKLDEQRAALDAAGARLTPKAEGWAELESASAALSAINGRMDDLWALHADEARLEAGIKEALGVISTSQADLLTAATAF
DKSISTQEDDAKEKLRDAQRILSATSFVVALRDAFAARKDDGEGYRAIAAAMGDLKIHQKLLPIALPKKSKPLGKAFSAN
VRALSALVDDKARPPENIEKILDVFAELKALKEPLEAAATAKMQHVSTTFEELDASVAKAGLVMQDTRHLTDAIYLTRIA
LAEFMLDRSAEKQSTLAMHLAQCRNALFALSSTAGDLGFAGEQSTKLATSFDRIEQSAVELVGATGKRTQQFQAAADEID
HIGEQISLFADLQRSAAGRQSQDANRLSIGAMVLGVIIALVSGAALVLTLKGPIGEITQTMRNLAGGLLDTAVANRNRAD
EIGEMARALDVFKTNAKARIALEQRSEQERVAAHAERERNEAEKLRRDQEIAFAVDALADGLDAMAKGRLTSTIETPFAP
ALDKLRTDFNAAVAGLRQTLLDIRTTSSVIQGSGRQMAEGAKALSGRTEQQAASLEETAASVDEIVATIRRAGDQAANAD
NTVSKAKQDADRSTVVVGNATAAMGRIEAASSHIGHIIEVIDDIAFQINLLALNAGIEAARAGEAGKGFAVVAQEVRELA
QRSAGAAREIAALIGNSTAEVAKGAGLVSETGAALLDISKHILEISTQIEAIALSSREQASSIAEVNVAITRLDQLTQSN
AAMAEETQAASWTLSGEADYLMQLVDRFDLGENSGSASETMKAA

Specific function: Chemotactic-signal transducers respond to changes in the concentration of attractants and repellents in the environment, transduce a signal from the outside to the inside of the cell, and facilitate sensory adaptation through the variation of the level of

COG id: COG0840

COG function: function code NT; Methyl-accepting chemotaxis protein

Gene ontology:

Cell location: Cell membrane; Multi-pass membrane protein (Potential)

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 methyl-accepting transducer domain

Homologues:

Organism=Escherichia coli, GI1788194, Length=305, Percent_Identity=39.0163934426229, Blast_Score=178, Evalue=1e-45,
Organism=Escherichia coli, GI2367378, Length=266, Percent_Identity=41.3533834586466, Blast_Score=175, Evalue=9e-45,
Organism=Escherichia coli, GI1788195, Length=240, Percent_Identity=42.5, Blast_Score=165, Evalue=1e-41,
Organism=Escherichia coli, GI1787690, Length=299, Percent_Identity=37.4581939799331, Blast_Score=163, Evalue=4e-41,
Organism=Escherichia coli, GI1789453, Length=232, Percent_Identity=35.3448275862069, Blast_Score=129, Evalue=6e-31,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): Y4FA_RHISN (P55439)

Other databases:

- EMBL:   U00090
- RefSeq:   NP_443846.1
- ProteinModelPortal:   P55439
- SMR:   P55439
- GeneID:   962175
- GenomeReviews:   U00090_GR
- KEGG:   rhi:NGR_a03800
- HOGENOM:   HBG299745
- ProtClustDB:   CLSK806032
- GO:   GO:0006935
- InterPro:   IPR004089
- InterPro:   IPR003660
- SMART:   SM00304
- SMART:   SM00283

Pfam domain/function: PF00672 HAMP; PF00015 MCPsignal

EC number: NA

Molecular weight: Translated: 89612; Mature: 89480

Theoretical pI: Translated: 4.94; Mature: 4.94

Prosite motif: PS50111 CHEMOTAXIS_TRANSDUC_2; PS50885 HAMP

Important sites: NA

Signals:

None

Transmembrane regions:

HASH(0xc8211dc)-; HASH(0xc526d10)-;

Cys/Met content:

0.1 %Cys     (Translated Protein)
2.4 %Met     (Translated Protein)
2.5 %Cys+Met (Translated Protein)
0.1 %Cys     (Mature Protein)
2.3 %Met     (Mature Protein)
2.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MGWVDRLLSRFKIRTKVMLLVLPFILSISAVGVTGMLASGLLQSRMAISNDVAASLRGFK
CCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
DVYAAMIGFLDQTTEENRALVFSKLDEQRAALDAAGARLTPKAEGWAELESASAALSAIN
HHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHC
GRMDDLWALHADEARLEAGIKEALGVISTSQADLLTAATAFDKSISTQEDDAKEKLRDAQ
CCHHHHHHCCCCHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHCCCCCCHHHHHHHHHHH
RILSATSFVVALRDAFAARKDDGEGYRAIAAAMGDLKIHQKLLPIALPKKSKPLGKAFSA
HHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCHHHHH
NVRALSALVDDKARPPENIEKILDVFAELKALKEPLEAAATAKMQHVSTTFEELDASVAK
HHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
AGLVMQDTRHLTDAIYLTRIALAEFMLDRSAEKQSTLAMHLAQCRNALFALSSTAGDLGF
HCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCC
AGEQSTKLATSFDRIEQSAVELVGATGKRTQQFQAAADEIDHIGEQISLFADLQRSAAGR
CCCCCHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCC
QSQDANRLSIGAMVLGVIIALVSGAALVLTLKGPIGEITQTMRNLAGGLLDTAVANRNRA
CCCCCCHHHHHHHHHHHHHHHHCCCEEEEEECCCHHHHHHHHHHHHHHHHHHHHHCCCCH
DEIGEMARALDVFKTNAKARIALEQRSEQERVAAHAERERNEAEKLRRDQEIAFAVDALA
HHHHHHHHHHHHHHCCCCCEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
DGLDAMAKGRLTSTIETPFAPALDKLRTDFNAAVAGLRQTLLDIRTTSSVIQGSGRQMAE
HHHHHHHCCCHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHH
GAKALSGRTEQQAASLEETAASVDEIVATIRRAGDQAANADNTVSKAKQDADRSTVVVGN
HHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHCCCCCEEEECC
ATAAMGRIEAASSHIGHIIEVIDDIAFQINLLALNAGIEAARAGEAGKGFAVVAQEVREL
CHHHHHHHHHHHHHHHHHHHHHHHHHHHEEEEEEECCCHHHHCCCCCCCHHHHHHHHHHH
AQRSAGAAREIAALIGNSTAEVAKGAGLVSETGAALLDISKHILEISTQIEAIALSSREQ
HHHCCCHHHHHHHHHCCCHHHHHHCCCCHHHCCHHHHHHHHHHHHHHHHHHHHHHCCHHH
ASSIAEVNVAITRLDQLTQSNAAMAEETQAASWTLSGEADYLMQLVDRFDLGENSGSASE
HHHHHHHHHHHHHHHHHHHCCHHHHHHHHHCCEEECCCHHHHHHHHHHHCCCCCCCCHHH
TMKAA
HHCCH
>Mature Secondary Structure 
GWVDRLLSRFKIRTKVMLLVLPFILSISAVGVTGMLASGLLQSRMAISNDVAASLRGFK
CHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
DVYAAMIGFLDQTTEENRALVFSKLDEQRAALDAAGARLTPKAEGWAELESASAALSAIN
HHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHC
GRMDDLWALHADEARLEAGIKEALGVISTSQADLLTAATAFDKSISTQEDDAKEKLRDAQ
CCHHHHHHCCCCHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHCCCCCCHHHHHHHHHHH
RILSATSFVVALRDAFAARKDDGEGYRAIAAAMGDLKIHQKLLPIALPKKSKPLGKAFSA
HHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCHHHHH
NVRALSALVDDKARPPENIEKILDVFAELKALKEPLEAAATAKMQHVSTTFEELDASVAK
HHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
AGLVMQDTRHLTDAIYLTRIALAEFMLDRSAEKQSTLAMHLAQCRNALFALSSTAGDLGF
HCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCC
AGEQSTKLATSFDRIEQSAVELVGATGKRTQQFQAAADEIDHIGEQISLFADLQRSAAGR
CCCCCHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCC
QSQDANRLSIGAMVLGVIIALVSGAALVLTLKGPIGEITQTMRNLAGGLLDTAVANRNRA
CCCCCCHHHHHHHHHHHHHHHHCCCEEEEEECCCHHHHHHHHHHHHHHHHHHHHHCCCCH
DEIGEMARALDVFKTNAKARIALEQRSEQERVAAHAERERNEAEKLRRDQEIAFAVDALA
HHHHHHHHHHHHHHCCCCCEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
DGLDAMAKGRLTSTIETPFAPALDKLRTDFNAAVAGLRQTLLDIRTTSSVIQGSGRQMAE
HHHHHHHCCCHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHH
GAKALSGRTEQQAASLEETAASVDEIVATIRRAGDQAANADNTVSKAKQDADRSTVVVGN
HHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHCCCCCEEEECC
ATAAMGRIEAASSHIGHIIEVIDDIAFQINLLALNAGIEAARAGEAGKGFAVVAQEVREL
CHHHHHHHHHHHHHHHHHHHHHHHHHHHEEEEEEECCCHHHHCCCCCCCHHHHHHHHHHH
AQRSAGAAREIAALIGNSTAEVAKGAGLVSETGAALLDISKHILEISTQIEAIALSSREQ
HHHCCCHHHHHHHHHCCCHHHHHHCCCCHHHCCHHHHHHHHHHHHHHHHHHHHHHCCHHH
ASSIAEVNVAITRLDQLTQSNAAMAEETQAASWTLSGEADYLMQLVDRFDLGENSGSASE
HHHHHHHHHHHHHHHHHHHCCHHHHHHHHHCCEEECCCHHHHHHHHHHHCCCCCCCCHHH
TMKAA
HHCCH

PDB accession: NA

Resolution: NA

Structure class: Alpha

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 9163424