| Definition | Rhizobium leguminosarum bv. trifolii WSM2304 chromosome, complete genome. |
|---|---|
| Accession | NC_011369 |
| Length | 4,537,948 |
Click here to switch to the map view.
The map label for this gene is nifS1 [H]
Identifier: 209549495
GI number: 209549495
Start: 1945208
End: 1946374
Strand: Reverse
Name: nifS1 [H]
Synonym: Rleg2_1901
Alternate gene names: 209549495
Gene position: 1946374-1945208 (Counterclockwise)
Preceding gene: 209549498
Following gene: 209549494
Centisome position: 42.89
GC content: 65.98
Gene sequence:
>1167_bases ATGGCGCCGCCACGCCTTTATCTCGACTGGAATGCCACAGCGCCGCTGCACCCTGCAGCACGCGAGGCGATCATGCGCGC CATCGACATATTCGGCAATCCGAATTCCGTTCACGGCGAAGGCCGTGCCGCCCGCGCCGCAATCGAATGTGCACGGCGCA AAGTGGCGGCGCTGGTCGGCACCGACGCCGGCAATGTGATCTTTACCAGCGGCGCCACCGAGGCCGCCAATCTGGTGCTG ACACCGGATTTCCGCATGGGCCGCACGCCGCTTCAGCTCGGCCGCCTCTACTTCTCGGCAATCGAGCATCCGGCGGTGCG CGAAGGCGGCCGCTTCGCCAGAGAGAAGATGACCGAGATCCCGGTCACGTCAGACGGCATCGTCGATCTCGATGCGCTTG GTCTGCTGCTTGATGCACATGACAAGGCCGCCGGCCTGCCGATGGTCGCCATCATGCTCGTCAACAACGAGACCGGCATC GTCCAGCCTGTGGAGGCGGCGGCAAAGATCGTCCACGCTCATGGCGGGCTCTTCGTCGTCGATGCCGTTCAGGCGGCCGG CCGCATAGGGCTCGACATCGGCAGGATCGGCGCCGATTTCATGATCGTCTCCTCGCACAAGATCGGCGGGCCGAAGGGTG CCGGCGCGTTGATTGCCCGCGGCGAGGCGCTGATGCCGCGGCCACTGATCCAGGGTGGCGGCCAGGAGCGGGGTCACCGG TCGGGGACACAGAATTCACTGGCGCTGATCGGCTTCGGCGCGGCGACGGAAGCTGCATCCGACGAGCTCGAGGCACGCAA TGCGGCAATCGGCGCGTTGCGCGAGCGGCTGGAAGCCGGCATGCGTCAGGCGGCAACCGATGTGGTGATCCATGGCGAAG GCGGCGAACGTGTCGCCAACACGATCTTCTTCACTTTGCCTGGGTTGAAGGCCGAGACTGGGCAGATCGCATTCGATCTC GAAGGTGTAGCGCTTTCGGCGGGCTCAGCCTGCTCATCCGGCCGGCTCGGCGAAAGCCATGTGCTGACGGCGATGGGGCG CGACGCCAAGCTCGGGGGCTTGCGTATCTCGCTCGGCTTTTCGACGACGGAAGAGGATATCGACCGGGCGATTGCCGCTT TTGCGAAGATCGCCTGCCGGCGCAGGTCGGCGGGCGAGGCGGCCTGA
Upstream 100 bases:
>100_bases CACGCATCGTGAATGTGTCATAAGGCAAGCCCGGCGGAAATTTCAAGAAAAATGAACCGCGGGTGCTGAAGCAAGCTCGT CAAGCGCAGGACTGAAGATC
Downstream 100 bases:
>100_bases CCGCGTCATAAACTTGCGGAAACGCAAATTTCTGCTTGCCAACCGGGCTGAAAAGTCCCTTTTGGCCTCTTACATCAAGG GCAGGAATTTGCCCGATATC
Product: class V aminotransferase
Products: NA
Alternate protein names: Nitrogenase metalloclusters biosynthesis protein nifS1 [H]
Number of amino acids: Translated: 388; Mature: 387
Protein sequence:
>388_residues MAPPRLYLDWNATAPLHPAAREAIMRAIDIFGNPNSVHGEGRAARAAIECARRKVAALVGTDAGNVIFTSGATEAANLVL TPDFRMGRTPLQLGRLYFSAIEHPAVREGGRFAREKMTEIPVTSDGIVDLDALGLLLDAHDKAAGLPMVAIMLVNNETGI VQPVEAAAKIVHAHGGLFVVDAVQAAGRIGLDIGRIGADFMIVSSHKIGGPKGAGALIARGEALMPRPLIQGGGQERGHR SGTQNSLALIGFGAATEAASDELEARNAAIGALRERLEAGMRQAATDVVIHGEGGERVANTIFFTLPGLKAETGQIAFDL EGVALSAGSACSSGRLGESHVLTAMGRDAKLGGLRISLGFSTTEEDIDRAIAAFAKIACRRRSAGEAA
Sequences:
>Translated_388_residues MAPPRLYLDWNATAPLHPAAREAIMRAIDIFGNPNSVHGEGRAARAAIECARRKVAALVGTDAGNVIFTSGATEAANLVL TPDFRMGRTPLQLGRLYFSAIEHPAVREGGRFAREKMTEIPVTSDGIVDLDALGLLLDAHDKAAGLPMVAIMLVNNETGI VQPVEAAAKIVHAHGGLFVVDAVQAAGRIGLDIGRIGADFMIVSSHKIGGPKGAGALIARGEALMPRPLIQGGGQERGHR SGTQNSLALIGFGAATEAASDELEARNAAIGALRERLEAGMRQAATDVVIHGEGGERVANTIFFTLPGLKAETGQIAFDL EGVALSAGSACSSGRLGESHVLTAMGRDAKLGGLRISLGFSTTEEDIDRAIAAFAKIACRRRSAGEAA >Mature_387_residues APPRLYLDWNATAPLHPAAREAIMRAIDIFGNPNSVHGEGRAARAAIECARRKVAALVGTDAGNVIFTSGATEAANLVLT PDFRMGRTPLQLGRLYFSAIEHPAVREGGRFAREKMTEIPVTSDGIVDLDALGLLLDAHDKAAGLPMVAIMLVNNETGIV QPVEAAAKIVHAHGGLFVVDAVQAAGRIGLDIGRIGADFMIVSSHKIGGPKGAGALIARGEALMPRPLIQGGGQERGHRS GTQNSLALIGFGAATEAASDELEARNAAIGALRERLEAGMRQAATDVVIHGEGGERVANTIFFTLPGLKAETGQIAFDLE GVALSAGSACSSGRLGESHVLTAMGRDAKLGGLRISLGFSTTEEDIDRAIAAFAKIACRRRSAGEAA
Specific function: Catalyzes the removal of elemental sulfur atoms from cysteine to produce alanine. Seems to participate in the biosynthesis of the nitrogenase metalloclusters by providing the inorganic sulfur required for the Fe-S core formation [H]
COG id: COG1104
COG function: function code E; Cysteine sulfinate desulfinase/cysteine desulfurase and related enzymes
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the class-V pyridoxal-phosphate-dependent aminotransferase family. NifS/IscS subfamily [H]
Homologues:
Organism=Homo sapiens, GI32307132, Length=388, Percent_Identity=37.3711340206186, Blast_Score=219, Evalue=3e-57, Organism=Homo sapiens, GI156713448, Length=406, Percent_Identity=32.0197044334975, Blast_Score=166, Evalue=2e-41, Organism=Escherichia coli, GI48994898, Length=392, Percent_Identity=35.7142857142857, Blast_Score=191, Evalue=8e-50, Organism=Escherichia coli, GI1787970, Length=369, Percent_Identity=25.4742547425474, Blast_Score=86, Evalue=6e-18, Organism=Escherichia coli, GI1789175, Length=402, Percent_Identity=26.865671641791, Blast_Score=77, Evalue=2e-15, Organism=Caenorhabditis elegans, GI25143064, Length=385, Percent_Identity=35.3246753246753, Blast_Score=201, Evalue=5e-52, Organism=Caenorhabditis elegans, GI17533177, Length=331, Percent_Identity=28.7009063444109, Blast_Score=115, Evalue=3e-26, Organism=Saccharomyces cerevisiae, GI6319831, Length=381, Percent_Identity=34.6456692913386, Blast_Score=192, Evalue=7e-50, Organism=Drosophila melanogaster, GI20129463, Length=374, Percent_Identity=35.5614973262032, Blast_Score=197, Evalue=8e-51,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR000192 - InterPro: IPR020578 - InterPro: IPR017772 - InterPro: IPR016454 - InterPro: IPR015424 - InterPro: IPR015421 - InterPro: IPR015422 [H]
Pfam domain/function: PF00266 Aminotran_5 [H]
EC number: =2.8.1.7 [H]
Molecular weight: Translated: 40282; Mature: 40150
Theoretical pI: Translated: 6.86; Mature: 6.86
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.8 %Cys (Translated Protein) 2.6 %Met (Translated Protein) 3.4 %Cys+Met (Translated Protein) 0.8 %Cys (Mature Protein) 2.3 %Met (Mature Protein) 3.1 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MAPPRLYLDWNATAPLHPAAREAIMRAIDIFGNPNSVHGEGRAARAAIECARRKVAALVG CCCCEEEEEECCCCCCCHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHHEE TDAGNVIFTSGATEAANLVLTPDFRMGRTPLQLGRLYFSAIEHPAVREGGRFAREKMTEI CCCCCEEEECCCCCCCEEEECCCCCCCCCHHHHHHHHHHHHCCCHHHCCCHHHHHHHHCC PVTSDGIVDLDALGLLLDAHDKAAGLPMVAIMLVNNETGIVQPVEAAAKIVHAHGGLFVV CCCCCCCEEHHHHHHEEECCCCCCCCCEEEEEEEECCCCCCCHHHHHHHHHHHCCCEEEE DAVQAAGRIGLDIGRIGADFMIVSSHKIGGPKGAGALIARGEALMPRPLIQGGGQERGHR EHHHHCCCCCCCHHCCCCCEEEEECCCCCCCCCCCCEEECCCCCCCCHHHCCCCCCCCCC SGTQNSLALIGFGAATEAASDELEARNAAIGALRERLEAGMRQAATDVVIHGEGGERVAN CCCCCCEEEEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCEEEEECCCCCCEEE TIFFTLPGLKAETGQIAFDLEGVALSAGSACSSGRLGESHVLTAMGRDAKLGGLRISLGF EEEEEECCCCCCCCEEEEEECCEEEECCCCCCCCCCCCCCEEEECCCCCCCCCEEEEECC STTEEDIDRAIAAFAKIACRRRSAGEAA CCCHHHHHHHHHHHHHHHHHHCCCCCCC >Mature Secondary Structure APPRLYLDWNATAPLHPAAREAIMRAIDIFGNPNSVHGEGRAARAAIECARRKVAALVG CCCEEEEEECCCCCCCHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHHEE TDAGNVIFTSGATEAANLVLTPDFRMGRTPLQLGRLYFSAIEHPAVREGGRFAREKMTEI CCCCCEEEECCCCCCCEEEECCCCCCCCCHHHHHHHHHHHHCCCHHHCCCHHHHHHHHCC PVTSDGIVDLDALGLLLDAHDKAAGLPMVAIMLVNNETGIVQPVEAAAKIVHAHGGLFVV CCCCCCCEEHHHHHHEEECCCCCCCCCEEEEEEEECCCCCCCHHHHHHHHHHHCCCEEEE DAVQAAGRIGLDIGRIGADFMIVSSHKIGGPKGAGALIARGEALMPRPLIQGGGQERGHR EHHHHCCCCCCCHHCCCCCEEEEECCCCCCCCCCCCEEECCCCCCCCHHHCCCCCCCCCC SGTQNSLALIGFGAATEAASDELEARNAAIGALRERLEAGMRQAATDVVIHGEGGERVAN CCCCCCEEEEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCEEEEECCCCCCEEE TIFFTLPGLKAETGQIAFDLEGVALSAGSACSSGRLGESHVLTAMGRDAKLGGLRISLGF EEEEEECCCCCCCCEEEEEECCEEEECCCCCCCCCCCCCCEEEECCCCCCCCCEEEEECC STTEEDIDRAIAAFAKIACRRRSAGEAA CCCHHHHHHHHHHHHHHHHHHCCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 7568132 [H]