| Definition | Novosphingobium aromaticivorans DSM 12444 chromosome, complete genome. |
|---|---|
| Accession | NC_007794 |
| Length | 3,561,584 |
Click here to switch to the map view.
The map label for this gene is nifS1 [H]
Identifier: 87200811
GI number: 87200811
Start: 3021704
End: 3022750
Strand: Reverse
Name: nifS1 [H]
Synonym: Saro_2798
Alternate gene names: 87200811
Gene position: 3022750-3021704 (Counterclockwise)
Preceding gene: 87200813
Following gene: 87200810
Centisome position: 84.87
GC content: 67.81
Gene sequence:
>1047_bases TTGCCATCCAGACCGATCTATCTCGACCATGCCGCCACGACGCCCCTGCTGCCCGAGGCAATGGCTGCCATGGAAGCGGG GTGGCGCGTCTGGGCCAACCCTTCGAGCCCGCACGCCGCAGGCCGGGCCGCGCGTGCTGCGCTGGAGGATGCGCGGGCGC GGTTGAAGGCAGCGCTCGGCTGGCGGGGCGAAGTGATCTTCACCTCGGGCGCAAGCGAGGCCCTGGCCATCGGCATTGGC CGCGCCAAGGTGGGGCAAGTTCTTGTTTCCGCTGTTGAACACGACGCGGCGCTGCGGGTGGCGGGCACCGCGCCGAGGCT GCCCGTGGGGGCCGACGGCCGGGTCGACCCGAACGGCACCGAACGATACATGAGCGGCACCGACCGCGCGCTTTACGTGG TGCAGCAGGTCAATAGCGAGACCGGCGTGATACAGGACATCGCGGCGCTGGCAGACCGGGTCCGCAGCGGGGGCCATCTC CTGCTGTGCGACGCCGCGCAGGGGGCCGGAAAGATCGATTTGCCCGATGCGGACATGGTTGTCCTCTCCGCCCACAAGTT CGGAGGGCCTGTGGGAGTCGGCGCGCTGCTGGTGCGCGACTACGGGCTGCTGGAGCCGAGCGGCGGGCAGGAACGGGGCT ATCGCGGCGGGACAGAGGCGATGCCTCTGGTCCTGGGCATGGTCGCTGCGCTGGAAGCTGGAAACGGCTGGCTAAAGCGA GCTTTAGGTTTTCGGGAATCCCTTACGAATCAAATTGTTGATATGGGGGCGGAAATTGTCGCGGGGGATGCACCGCGCAG CCCGACGATTGCCGCCTATCGCATGCCTGGCAAGTCGAGCGCGGCACAACTGATCCGCTTCGACGGTGCGGGCATCGCGG TCTCGGCGGGAAGCGCGTGCTCTTCGGGCTCGCTCAAGGCCAGCCATGTCCTGACCGCGATGGGCTATGCGCACCCGGGC GAAGTGATCCGCGTTTCCATCGGGCGCGAGACGACCGAGGCCGAAATCGCGCGGTTCGTGGAAGTGTGGAAGGGCATTCG CGGGTGA
Upstream 100 bases:
>100_bases CGCAGCGGCAAGGACTGCCGGGGCTGGGAATTGCGTTGACGGCTATATAGAAACGACCCCCGCGAAAGCAATCTTTGCAG ACATTGCCGGATAACCTGAT
Downstream 100 bases:
>100_bases TCTACCTCGACTACCAGGCGACGACCCCTCTCGCCCCGGAAGCGCGCGCGGCGATGCTGCCGTGGCTGGCGGGGCCCGAG GCACCGGGATTTGCCAATCC
Product: class V aminotransferase
Products: NA
Alternate protein names: Nitrogenase metalloclusters biosynthesis protein nifS1 [H]
Number of amino acids: Translated: 348; Mature: 347
Protein sequence:
>348_residues MPSRPIYLDHAATTPLLPEAMAAMEAGWRVWANPSSPHAAGRAARAALEDARARLKAALGWRGEVIFTSGASEALAIGIG RAKVGQVLVSAVEHDAALRVAGTAPRLPVGADGRVDPNGTERYMSGTDRALYVVQQVNSETGVIQDIAALADRVRSGGHL LLCDAAQGAGKIDLPDADMVVLSAHKFGGPVGVGALLVRDYGLLEPSGGQERGYRGGTEAMPLVLGMVAALEAGNGWLKR ALGFRESLTNQIVDMGAEIVAGDAPRSPTIAAYRMPGKSSAAQLIRFDGAGIAVSAGSACSSGSLKASHVLTAMGYAHPG EVIRVSIGRETTEAEIARFVEVWKGIRG
Sequences:
>Translated_348_residues MPSRPIYLDHAATTPLLPEAMAAMEAGWRVWANPSSPHAAGRAARAALEDARARLKAALGWRGEVIFTSGASEALAIGIG RAKVGQVLVSAVEHDAALRVAGTAPRLPVGADGRVDPNGTERYMSGTDRALYVVQQVNSETGVIQDIAALADRVRSGGHL LLCDAAQGAGKIDLPDADMVVLSAHKFGGPVGVGALLVRDYGLLEPSGGQERGYRGGTEAMPLVLGMVAALEAGNGWLKR ALGFRESLTNQIVDMGAEIVAGDAPRSPTIAAYRMPGKSSAAQLIRFDGAGIAVSAGSACSSGSLKASHVLTAMGYAHPG EVIRVSIGRETTEAEIARFVEVWKGIRG >Mature_347_residues PSRPIYLDHAATTPLLPEAMAAMEAGWRVWANPSSPHAAGRAARAALEDARARLKAALGWRGEVIFTSGASEALAIGIGR AKVGQVLVSAVEHDAALRVAGTAPRLPVGADGRVDPNGTERYMSGTDRALYVVQQVNSETGVIQDIAALADRVRSGGHLL LCDAAQGAGKIDLPDADMVVLSAHKFGGPVGVGALLVRDYGLLEPSGGQERGYRGGTEAMPLVLGMVAALEAGNGWLKRA LGFRESLTNQIVDMGAEIVAGDAPRSPTIAAYRMPGKSSAAQLIRFDGAGIAVSAGSACSSGSLKASHVLTAMGYAHPGE VIRVSIGRETTEAEIARFVEVWKGIRG
Specific function: Catalyzes the removal of elemental sulfur atoms from cysteine to produce alanine. Seems to participate in the biosynthesis of the nitrogenase metalloclusters by providing the inorganic sulfur required for the Fe-S core formation [H]
COG id: COG1104
COG function: function code E; Cysteine sulfinate desulfinase/cysteine desulfurase and related enzymes
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the class-V pyridoxal-phosphate-dependent aminotransferase family. NifS/IscS subfamily [H]
Homologues:
Organism=Homo sapiens, GI32307132, Length=371, Percent_Identity=34.2318059299191, Blast_Score=150, Evalue=2e-36, Organism=Homo sapiens, GI156713448, Length=413, Percent_Identity=28.3292978208232, Blast_Score=121, Evalue=8e-28, Organism=Escherichia coli, GI48994898, Length=377, Percent_Identity=35.0132625994695, Blast_Score=145, Evalue=3e-36, Organism=Caenorhabditis elegans, GI25143064, Length=378, Percent_Identity=32.5396825396825, Blast_Score=123, Evalue=1e-28, Organism=Caenorhabditis elegans, GI17533177, Length=241, Percent_Identity=30.2904564315353, Blast_Score=77, Evalue=2e-14, Organism=Saccharomyces cerevisiae, GI6319831, Length=376, Percent_Identity=32.4468085106383, Blast_Score=131, Evalue=1e-31, Organism=Drosophila melanogaster, GI20129463, Length=371, Percent_Identity=34.2318059299191, Blast_Score=138, Evalue=6e-33,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR000192 - InterPro: IPR020578 - InterPro: IPR017772 - InterPro: IPR016454 - InterPro: IPR015424 - InterPro: IPR015421 - InterPro: IPR015422 [H]
Pfam domain/function: PF00266 Aminotran_5 [H]
EC number: =2.8.1.7 [H]
Molecular weight: Translated: 36033; Mature: 35901
Theoretical pI: Translated: 7.70; Mature: 7.70
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.6 %Cys (Translated Protein) 2.9 %Met (Translated Protein) 3.4 %Cys+Met (Translated Protein) 0.6 %Cys (Mature Protein) 2.6 %Met (Mature Protein) 3.2 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MPSRPIYLDHAATTPLLPEAMAAMEAGWRVWANPSSPHAAGRAARAALEDARARLKAALG CCCCCEEEECCCCCCCHHHHHHHHHCCCEEECCCCCCCHHHHHHHHHHHHHHHHHHHHHC WRGEVIFTSGASEALAIGIGRAKVGQVLVSAVEHDAALRVAGTAPRLPVGADGRVDPNGT CCCEEEEECCCCCEEEEECCHHHHHHHHHHHHHCCCEEEEECCCCCCCCCCCCCCCCCCH ERYMSGTDRALYVVQQVNSETGVIQDIAALADRVRSGGHLLLCDAAQGAGKIDLPDADMV HHHHCCCCCEEEEEEHHCCCCCHHHHHHHHHHHHCCCCCEEEEECCCCCCCCCCCCCCEE VLSAHKFGGPVGVGALLVRDYGLLEPSGGQERGYRGGTEAMPLVLGMVAALEAGNGWLKR EEEEHHCCCCHHHHHHHHHHCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHCCCHHHHH ALGFRESLTNQIVDMGAEIVAGDAPRSPTIAAYRMPGKSSAAQLIRFDGAGIAVSAGSAC HHHHHHHHHHHHHHCCCCEEECCCCCCCCEEEEECCCCCCHHHEEEECCCCEEEECCCCC SSGSLKASHVLTAMGYAHPGEVIRVSIGRETTEAEIARFVEVWKGIRG CCCCCHHHHHHHHHCCCCCCCEEEEECCCCCHHHHHHHHHHHHHCCCC >Mature Secondary Structure PSRPIYLDHAATTPLLPEAMAAMEAGWRVWANPSSPHAAGRAARAALEDARARLKAALG CCCCEEEECCCCCCCHHHHHHHHHCCCEEECCCCCCCHHHHHHHHHHHHHHHHHHHHHC WRGEVIFTSGASEALAIGIGRAKVGQVLVSAVEHDAALRVAGTAPRLPVGADGRVDPNGT CCCEEEEECCCCCEEEEECCHHHHHHHHHHHHHCCCEEEEECCCCCCCCCCCCCCCCCCH ERYMSGTDRALYVVQQVNSETGVIQDIAALADRVRSGGHLLLCDAAQGAGKIDLPDADMV HHHHCCCCCEEEEEEHHCCCCCHHHHHHHHHHHHCCCCCEEEEECCCCCCCCCCCCCCEE VLSAHKFGGPVGVGALLVRDYGLLEPSGGQERGYRGGTEAMPLVLGMVAALEAGNGWLKR EEEEHHCCCCHHHHHHHHHHCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHCCCHHHHH ALGFRESLTNQIVDMGAEIVAGDAPRSPTIAAYRMPGKSSAAQLIRFDGAGIAVSAGSAC HHHHHHHHHHHHHHCCCCEEECCCCCCCCEEEEECCCCCCHHHEEEECCCCEEEECCCCC SSGSLKASHVLTAMGYAHPGEVIRVSIGRETTEAEIARFVEVWKGIRG CCCCCHHHHHHHHHCCCCCCCEEEEECCCCCHHHHHHHHHHHHHCCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 10.0
TargetDB status: NA
Availability: NA
References: 7568132 [H]