| Definition | Rickettsia akari str. Hartford, complete genome. |
|---|---|
| Accession | NC_009881 |
| Length | 1,231,060 |
Click here to switch to the map view.
The map label for this gene is nifS1 [H]
Identifier: 157825854
GI number: 157825854
Start: 708766
End: 709881
Strand: Reverse
Name: nifS1 [H]
Synonym: A1C_03965
Alternate gene names: 157825854
Gene position: 709881-708766 (Counterclockwise)
Preceding gene: 157825855
Following gene: 157825853
Centisome position: 57.66
GC content: 32.26
Gene sequence:
>1116_bases ATGATATACCTAGATCATAATGCAACCACCTTTATCGATCCCAAGGTAAAAGAATATATAATAAGTTTGATGAATAAAGA GCTTAACCCTTCGTCAATACATAGAGCAGGTGTATTTGCTAGGAATGTTATAGAAGAAGCACGTTTTCAATTGGTTGCGG CTCTTGGTATAGCCTTATCATCTCGAGAATATGACATTACTTTTACGTCATCGGGAACTGAAAGTAATAATTTAATAATG AAAAATTTTTATGACGGCGATATTTTTATTTCAGCTATTGAACATTTATCGATCTATAACCATATGGAACACGCTCCAAA TATTAAAATTATAAGAGTTAACAATCAAGGTTTGGTTGATTTAGAACATCTAGAAGAGTTATTAGCTCAAAGTAACGCTG CTAAAAAACTAGTTTCTGTAATGATGGCTAATAACGAGAGTGGGGTGCTGCAAGATATAACCACAATAAGTGAAATAGCT AAAAAATATTATGCAAAATTTCATAGTGATTTAGTACAAAGTTTTGGCAGAATATCTATAAATATCAAAGAGTTGGGATT AGATTTTGCGACAATTTCAGGGCATAAAATAGGGGGGGGGCATGGTGGTGGTGCTTTAATCTCTAACTCTAACTTTCAAG TTACTCCTATGATTATAGGAGGAGGACAAGAAAAAGGAATAAGATCAGGTACAGAAAATGTTTTAGCTATTGCAGGGCTT GGTTTGGCAGCTGAGTTAATAACAAAAGATATCTCAGAAAAATATATAAAAATCAAGAGCTTACAAGAATATTTAGAGCA AAAATTAAAAAAATATCCTAATGTAAATATTGTGAGTAATAATATCGCAAGATTGCCTAATACTACTTTATTTACTGTAC AAAATACAGATGCACAAGTGAAATTAATCGGGTTTGATTTACGTAATATTTGCATAAGTTCCGGCTCTGCTTGCTCATCA GGAAAAATCTCTAAATCACACGTATTAAACAATATGGGTGTAGTGGAAGAAGAGGCAAAATCCTCTATTAGAGTATCTTT AAGCCATACTAATACAGTAAGTGATATAAAGGCTTTTATAAAAGCCTTTGAGGAAGTGTATAATATACTCGTTTAA
Upstream 100 bases:
>100_bases AATGTAATTCGCATAAATTATGGAAAGGTCTTGGTAAACATATTAGAGATTATTTTGAAAATATCTCAATTAAAGATACT CTAAACTTAAATATAAATAT
Downstream 100 bases:
>100_bases TTTTAGGCTTTTTGTATACAAAAAATTAATTTTATAAACCATATGAACCAACAATTAAACAATTTAACTTTGCCTATATA TATGGATTATCAGGCAACAA
Product: hypothetical protein
Products: NA
Alternate protein names: Nitrogenase metalloclusters biosynthesis protein nifS1 [H]
Number of amino acids: Translated: 371; Mature: 371
Protein sequence:
>371_residues MIYLDHNATTFIDPKVKEYIISLMNKELNPSSIHRAGVFARNVIEEARFQLVAALGIALSSREYDITFTSSGTESNNLIM KNFYDGDIFISAIEHLSIYNHMEHAPNIKIIRVNNQGLVDLEHLEELLAQSNAAKKLVSVMMANNESGVLQDITTISEIA KKYYAKFHSDLVQSFGRISINIKELGLDFATISGHKIGGGHGGGALISNSNFQVTPMIIGGGQEKGIRSGTENVLAIAGL GLAAELITKDISEKYIKIKSLQEYLEQKLKKYPNVNIVSNNIARLPNTTLFTVQNTDAQVKLIGFDLRNICISSGSACSS GKISKSHVLNNMGVVEEEAKSSIRVSLSHTNTVSDIKAFIKAFEEVYNILV
Sequences:
>Translated_371_residues MIYLDHNATTFIDPKVKEYIISLMNKELNPSSIHRAGVFARNVIEEARFQLVAALGIALSSREYDITFTSSGTESNNLIM KNFYDGDIFISAIEHLSIYNHMEHAPNIKIIRVNNQGLVDLEHLEELLAQSNAAKKLVSVMMANNESGVLQDITTISEIA KKYYAKFHSDLVQSFGRISINIKELGLDFATISGHKIGGGHGGGALISNSNFQVTPMIIGGGQEKGIRSGTENVLAIAGL GLAAELITKDISEKYIKIKSLQEYLEQKLKKYPNVNIVSNNIARLPNTTLFTVQNTDAQVKLIGFDLRNICISSGSACSS GKISKSHVLNNMGVVEEEAKSSIRVSLSHTNTVSDIKAFIKAFEEVYNILV >Mature_371_residues MIYLDHNATTFIDPKVKEYIISLMNKELNPSSIHRAGVFARNVIEEARFQLVAALGIALSSREYDITFTSSGTESNNLIM KNFYDGDIFISAIEHLSIYNHMEHAPNIKIIRVNNQGLVDLEHLEELLAQSNAAKKLVSVMMANNESGVLQDITTISEIA KKYYAKFHSDLVQSFGRISINIKELGLDFATISGHKIGGGHGGGALISNSNFQVTPMIIGGGQEKGIRSGTENVLAIAGL GLAAELITKDISEKYIKIKSLQEYLEQKLKKYPNVNIVSNNIARLPNTTLFTVQNTDAQVKLIGFDLRNICISSGSACSS GKISKSHVLNNMGVVEEEAKSSIRVSLSHTNTVSDIKAFIKAFEEVYNILV
Specific function: Catalyzes the removal of elemental sulfur atoms from cysteine to produce alanine. Seems to participate in the biosynthesis of the nitrogenase metalloclusters by providing the inorganic sulfur required for the Fe-S core formation [H]
COG id: COG1104
COG function: function code E; Cysteine sulfinate desulfinase/cysteine desulfurase and related enzymes
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the class-V pyridoxal-phosphate-dependent aminotransferase family. NifS/IscS subfamily [H]
Homologues:
Organism=Homo sapiens, GI156713448, Length=414, Percent_Identity=30.9178743961353, Blast_Score=180, Evalue=2e-45, Organism=Homo sapiens, GI32307132, Length=370, Percent_Identity=32.7027027027027, Blast_Score=167, Evalue=2e-41, Organism=Escherichia coli, GI48994898, Length=376, Percent_Identity=32.4468085106383, Blast_Score=170, Evalue=1e-43, Organism=Escherichia coli, GI1789175, Length=411, Percent_Identity=24.0875912408759, Blast_Score=70, Evalue=2e-13, Organism=Caenorhabditis elegans, GI25143064, Length=377, Percent_Identity=33.42175066313, Blast_Score=167, Evalue=1e-41, Organism=Caenorhabditis elegans, GI17533177, Length=322, Percent_Identity=29.8136645962733, Blast_Score=127, Evalue=7e-30, Organism=Saccharomyces cerevisiae, GI6319831, Length=383, Percent_Identity=32.6370757180157, Blast_Score=181, Evalue=2e-46, Organism=Drosophila melanogaster, GI20129463, Length=371, Percent_Identity=31.8059299191375, Blast_Score=166, Evalue=3e-41,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR000192 - InterPro: IPR020578 - InterPro: IPR017772 - InterPro: IPR016454 - InterPro: IPR015424 - InterPro: IPR015421 - InterPro: IPR015422 [H]
Pfam domain/function: PF00266 Aminotran_5 [H]
EC number: =2.8.1.7 [H]
Molecular weight: Translated: 40694; Mature: 40694
Theoretical pI: Translated: 7.13; Mature: 7.13
Prosite motif: PS00595 AA_TRANSFER_CLASS_5
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.5 %Cys (Translated Protein) 2.2 %Met (Translated Protein) 2.7 %Cys+Met (Translated Protein) 0.5 %Cys (Mature Protein) 2.2 %Met (Mature Protein) 2.7 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MIYLDHNATTFIDPKVKEYIISLMNKELNPSSIHRAGVFARNVIEEARFQLVAALGIALS CEEECCCCCEEECHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCC SREYDITFTSSGTESNNLIMKNFYDGDIFISAIEHLSIYNHMEHAPNIKIIRVNNQGLVD CCEEEEEEECCCCCCCCEEEEEECCCHHHHHHHHHHHHHHHHHCCCCEEEEEECCCCCEE LEHLEELLAQSNAAKKLVSVMMANNESGVLQDITTISEIAKKYYAKFHSDLVQSFGRISI HHHHHHHHHCCHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCEEE NIKELGLDFATISGHKIGGGHGGGALISNSNFQVTPMIIGGGQEKGIRSGTENVLAIAGL EEHHHCCEEEEECCCCCCCCCCCCEEEECCCEEEEEEEEECCCCCCCCCCCCCEEEEECC GLAAELITKDISEKYIKIKSLQEYLEQKLKKYPNVNIVSNNIARLPNTTLFTVQNTDAQV HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEECCCHHHCCCCEEEEEECCCCEE KLIGFDLRNICISSGSACSSGKISKSHVLNNMGVVEEEAKSSIRVSLSHTNTVSDIKAFI EEEEECHHHHHHCCCCCCCCCCCHHHHHHHCCCCCHHHCCCCEEEEEECCCCHHHHHHHH KAFEEVYNILV HHHHHHHHHCC >Mature Secondary Structure MIYLDHNATTFIDPKVKEYIISLMNKELNPSSIHRAGVFARNVIEEARFQLVAALGIALS CEEECCCCCEEECHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCC SREYDITFTSSGTESNNLIMKNFYDGDIFISAIEHLSIYNHMEHAPNIKIIRVNNQGLVD CCEEEEEEECCCCCCCCEEEEEECCCHHHHHHHHHHHHHHHHHCCCCEEEEEECCCCCEE LEHLEELLAQSNAAKKLVSVMMANNESGVLQDITTISEIAKKYYAKFHSDLVQSFGRISI HHHHHHHHHCCHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCEEE NIKELGLDFATISGHKIGGGHGGGALISNSNFQVTPMIIGGGQEKGIRSGTENVLAIAGL EEHHHCCEEEEECCCCCCCCCCCCEEEECCCEEEEEEEEECCCCCCCCCCCCCEEEEECC GLAAELITKDISEKYIKIKSLQEYLEQKLKKYPNVNIVSNNIARLPNTTLFTVQNTDAQV HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEECCCHHHCCCCEEEEEECCCCEE KLIGFDLRNICISSGSACSSGKISKSHVLNNMGVVEEEAKSSIRVSLSHTNTVSDIKAFI EEEEECHHHHHHCCCCCCCCCCCHHHHHHHCCCCCHHHCCCCEEEEEECCCCHHHHHHHH KAFEEVYNILV HHHHHHHHHCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 7568132 [H]