Definition Rhizobium leguminosarum bv. trifolii WSM2304 chromosome, complete genome.
Accession NC_011369
Length 4,537,948

Click here to switch to the map view.

The map label for this gene is nifS1 [H]

Identifier: 209549495

GI number: 209549495

Start: 1945208

End: 1946374

Strand: Reverse

Name: nifS1 [H]

Synonym: Rleg2_1901

Alternate gene names: 209549495

Gene position: 1946374-1945208 (Counterclockwise)

Preceding gene: 209549498

Following gene: 209549494

Centisome position: 42.89

GC content: 65.98

Gene sequence:

>1167_bases
ATGGCGCCGCCACGCCTTTATCTCGACTGGAATGCCACAGCGCCGCTGCACCCTGCAGCACGCGAGGCGATCATGCGCGC
CATCGACATATTCGGCAATCCGAATTCCGTTCACGGCGAAGGCCGTGCCGCCCGCGCCGCAATCGAATGTGCACGGCGCA
AAGTGGCGGCGCTGGTCGGCACCGACGCCGGCAATGTGATCTTTACCAGCGGCGCCACCGAGGCCGCCAATCTGGTGCTG
ACACCGGATTTCCGCATGGGCCGCACGCCGCTTCAGCTCGGCCGCCTCTACTTCTCGGCAATCGAGCATCCGGCGGTGCG
CGAAGGCGGCCGCTTCGCCAGAGAGAAGATGACCGAGATCCCGGTCACGTCAGACGGCATCGTCGATCTCGATGCGCTTG
GTCTGCTGCTTGATGCACATGACAAGGCCGCCGGCCTGCCGATGGTCGCCATCATGCTCGTCAACAACGAGACCGGCATC
GTCCAGCCTGTGGAGGCGGCGGCAAAGATCGTCCACGCTCATGGCGGGCTCTTCGTCGTCGATGCCGTTCAGGCGGCCGG
CCGCATAGGGCTCGACATCGGCAGGATCGGCGCCGATTTCATGATCGTCTCCTCGCACAAGATCGGCGGGCCGAAGGGTG
CCGGCGCGTTGATTGCCCGCGGCGAGGCGCTGATGCCGCGGCCACTGATCCAGGGTGGCGGCCAGGAGCGGGGTCACCGG
TCGGGGACACAGAATTCACTGGCGCTGATCGGCTTCGGCGCGGCGACGGAAGCTGCATCCGACGAGCTCGAGGCACGCAA
TGCGGCAATCGGCGCGTTGCGCGAGCGGCTGGAAGCCGGCATGCGTCAGGCGGCAACCGATGTGGTGATCCATGGCGAAG
GCGGCGAACGTGTCGCCAACACGATCTTCTTCACTTTGCCTGGGTTGAAGGCCGAGACTGGGCAGATCGCATTCGATCTC
GAAGGTGTAGCGCTTTCGGCGGGCTCAGCCTGCTCATCCGGCCGGCTCGGCGAAAGCCATGTGCTGACGGCGATGGGGCG
CGACGCCAAGCTCGGGGGCTTGCGTATCTCGCTCGGCTTTTCGACGACGGAAGAGGATATCGACCGGGCGATTGCCGCTT
TTGCGAAGATCGCCTGCCGGCGCAGGTCGGCGGGCGAGGCGGCCTGA

Upstream 100 bases:

>100_bases
CACGCATCGTGAATGTGTCATAAGGCAAGCCCGGCGGAAATTTCAAGAAAAATGAACCGCGGGTGCTGAAGCAAGCTCGT
CAAGCGCAGGACTGAAGATC

Downstream 100 bases:

>100_bases
CCGCGTCATAAACTTGCGGAAACGCAAATTTCTGCTTGCCAACCGGGCTGAAAAGTCCCTTTTGGCCTCTTACATCAAGG
GCAGGAATTTGCCCGATATC

Product: class V aminotransferase

Products: NA

Alternate protein names: Nitrogenase metalloclusters biosynthesis protein nifS1 [H]

Number of amino acids: Translated: 388; Mature: 387

Protein sequence:

>388_residues
MAPPRLYLDWNATAPLHPAAREAIMRAIDIFGNPNSVHGEGRAARAAIECARRKVAALVGTDAGNVIFTSGATEAANLVL
TPDFRMGRTPLQLGRLYFSAIEHPAVREGGRFAREKMTEIPVTSDGIVDLDALGLLLDAHDKAAGLPMVAIMLVNNETGI
VQPVEAAAKIVHAHGGLFVVDAVQAAGRIGLDIGRIGADFMIVSSHKIGGPKGAGALIARGEALMPRPLIQGGGQERGHR
SGTQNSLALIGFGAATEAASDELEARNAAIGALRERLEAGMRQAATDVVIHGEGGERVANTIFFTLPGLKAETGQIAFDL
EGVALSAGSACSSGRLGESHVLTAMGRDAKLGGLRISLGFSTTEEDIDRAIAAFAKIACRRRSAGEAA

Sequences:

>Translated_388_residues
MAPPRLYLDWNATAPLHPAAREAIMRAIDIFGNPNSVHGEGRAARAAIECARRKVAALVGTDAGNVIFTSGATEAANLVL
TPDFRMGRTPLQLGRLYFSAIEHPAVREGGRFAREKMTEIPVTSDGIVDLDALGLLLDAHDKAAGLPMVAIMLVNNETGI
VQPVEAAAKIVHAHGGLFVVDAVQAAGRIGLDIGRIGADFMIVSSHKIGGPKGAGALIARGEALMPRPLIQGGGQERGHR
SGTQNSLALIGFGAATEAASDELEARNAAIGALRERLEAGMRQAATDVVIHGEGGERVANTIFFTLPGLKAETGQIAFDL
EGVALSAGSACSSGRLGESHVLTAMGRDAKLGGLRISLGFSTTEEDIDRAIAAFAKIACRRRSAGEAA
>Mature_387_residues
APPRLYLDWNATAPLHPAAREAIMRAIDIFGNPNSVHGEGRAARAAIECARRKVAALVGTDAGNVIFTSGATEAANLVLT
PDFRMGRTPLQLGRLYFSAIEHPAVREGGRFAREKMTEIPVTSDGIVDLDALGLLLDAHDKAAGLPMVAIMLVNNETGIV
QPVEAAAKIVHAHGGLFVVDAVQAAGRIGLDIGRIGADFMIVSSHKIGGPKGAGALIARGEALMPRPLIQGGGQERGHRS
GTQNSLALIGFGAATEAASDELEARNAAIGALRERLEAGMRQAATDVVIHGEGGERVANTIFFTLPGLKAETGQIAFDLE
GVALSAGSACSSGRLGESHVLTAMGRDAKLGGLRISLGFSTTEEDIDRAIAAFAKIACRRRSAGEAA

Specific function: Catalyzes the removal of elemental sulfur atoms from cysteine to produce alanine. Seems to participate in the biosynthesis of the nitrogenase metalloclusters by providing the inorganic sulfur required for the Fe-S core formation [H]

COG id: COG1104

COG function: function code E; Cysteine sulfinate desulfinase/cysteine desulfurase and related enzymes

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the class-V pyridoxal-phosphate-dependent aminotransferase family. NifS/IscS subfamily [H]

Homologues:

Organism=Homo sapiens, GI32307132, Length=388, Percent_Identity=37.3711340206186, Blast_Score=219, Evalue=3e-57,
Organism=Homo sapiens, GI156713448, Length=406, Percent_Identity=32.0197044334975, Blast_Score=166, Evalue=2e-41,
Organism=Escherichia coli, GI48994898, Length=392, Percent_Identity=35.7142857142857, Blast_Score=191, Evalue=8e-50,
Organism=Escherichia coli, GI1787970, Length=369, Percent_Identity=25.4742547425474, Blast_Score=86, Evalue=6e-18,
Organism=Escherichia coli, GI1789175, Length=402, Percent_Identity=26.865671641791, Blast_Score=77, Evalue=2e-15,
Organism=Caenorhabditis elegans, GI25143064, Length=385, Percent_Identity=35.3246753246753, Blast_Score=201, Evalue=5e-52,
Organism=Caenorhabditis elegans, GI17533177, Length=331, Percent_Identity=28.7009063444109, Blast_Score=115, Evalue=3e-26,
Organism=Saccharomyces cerevisiae, GI6319831, Length=381, Percent_Identity=34.6456692913386, Blast_Score=192, Evalue=7e-50,
Organism=Drosophila melanogaster, GI20129463, Length=374, Percent_Identity=35.5614973262032, Blast_Score=197, Evalue=8e-51,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR000192
- InterPro:   IPR020578
- InterPro:   IPR017772
- InterPro:   IPR016454
- InterPro:   IPR015424
- InterPro:   IPR015421
- InterPro:   IPR015422 [H]

Pfam domain/function: PF00266 Aminotran_5 [H]

EC number: =2.8.1.7 [H]

Molecular weight: Translated: 40282; Mature: 40150

Theoretical pI: Translated: 6.86; Mature: 6.86

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.8 %Cys     (Translated Protein)
2.6 %Met     (Translated Protein)
3.4 %Cys+Met (Translated Protein)
0.8 %Cys     (Mature Protein)
2.3 %Met     (Mature Protein)
3.1 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MAPPRLYLDWNATAPLHPAAREAIMRAIDIFGNPNSVHGEGRAARAAIECARRKVAALVG
CCCCEEEEEECCCCCCCHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHHEE
TDAGNVIFTSGATEAANLVLTPDFRMGRTPLQLGRLYFSAIEHPAVREGGRFAREKMTEI
CCCCCEEEECCCCCCCEEEECCCCCCCCCHHHHHHHHHHHHCCCHHHCCCHHHHHHHHCC
PVTSDGIVDLDALGLLLDAHDKAAGLPMVAIMLVNNETGIVQPVEAAAKIVHAHGGLFVV
CCCCCCCEEHHHHHHEEECCCCCCCCCEEEEEEEECCCCCCCHHHHHHHHHHHCCCEEEE
DAVQAAGRIGLDIGRIGADFMIVSSHKIGGPKGAGALIARGEALMPRPLIQGGGQERGHR
EHHHHCCCCCCCHHCCCCCEEEEECCCCCCCCCCCCEEECCCCCCCCHHHCCCCCCCCCC
SGTQNSLALIGFGAATEAASDELEARNAAIGALRERLEAGMRQAATDVVIHGEGGERVAN
CCCCCCEEEEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCEEEEECCCCCCEEE
TIFFTLPGLKAETGQIAFDLEGVALSAGSACSSGRLGESHVLTAMGRDAKLGGLRISLGF
EEEEEECCCCCCCCEEEEEECCEEEECCCCCCCCCCCCCCEEEECCCCCCCCCEEEEECC
STTEEDIDRAIAAFAKIACRRRSAGEAA
CCCHHHHHHHHHHHHHHHHHHCCCCCCC
>Mature Secondary Structure 
APPRLYLDWNATAPLHPAAREAIMRAIDIFGNPNSVHGEGRAARAAIECARRKVAALVG
CCCEEEEEECCCCCCCHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHHEE
TDAGNVIFTSGATEAANLVLTPDFRMGRTPLQLGRLYFSAIEHPAVREGGRFAREKMTEI
CCCCCEEEECCCCCCCEEEECCCCCCCCCHHHHHHHHHHHHCCCHHHCCCHHHHHHHHCC
PVTSDGIVDLDALGLLLDAHDKAAGLPMVAIMLVNNETGIVQPVEAAAKIVHAHGGLFVV
CCCCCCCEEHHHHHHEEECCCCCCCCCEEEEEEEECCCCCCCHHHHHHHHHHHCCCEEEE
DAVQAAGRIGLDIGRIGADFMIVSSHKIGGPKGAGALIARGEALMPRPLIQGGGQERGHR
EHHHHCCCCCCCHHCCCCCEEEEECCCCCCCCCCCCEEECCCCCCCCHHHCCCCCCCCCC
SGTQNSLALIGFGAATEAASDELEARNAAIGALRERLEAGMRQAATDVVIHGEGGERVAN
CCCCCCEEEEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCEEEEECCCCCCEEE
TIFFTLPGLKAETGQIAFDLEGVALSAGSACSSGRLGESHVLTAMGRDAKLGGLRISLGF
EEEEEECCCCCCCCEEEEEECCEEEECCCCCCCCCCCCCCEEEECCCCCCCCCEEEEECC
STTEEDIDRAIAAFAKIACRRRSAGEAA
CCCHHHHHHHHHHHHHHHHHHCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 7568132 [H]