Definition Neorickettsia sennetsu str. Miyayama chromosome, complete genome.
Accession NC_007798
Length 859,006

Click here to switch to the map view.

The map label for this gene is nifS [H]

Identifier: 88608399

GI number: 88608399

Start: 246255

End: 247847

Strand: Reverse

Name: nifS [H]

Synonym: NSE_0304

Alternate gene names: 88608399

Gene position: 247847-246255 (Counterclockwise)

Preceding gene: 88608518

Following gene: 88608058

Centisome position: 28.85

GC content: 39.92

Gene sequence:

>1593_bases
TTGTCTAGAGGAGAATACCTCACCATGCTCACAGCCAAAACAAGGTATGCGATTGCAGCATCTATTGATATCGCATTGCA
CTCAAAAGGTAGAAAATACGTAAAAACCTCAGAGATTGCATCAAGACAAAAGATATCTGAGAAATTCCTTGAGTTAATTT
TACCACCCCTGAAAAAACAAGGAATTTTAGAGTCTCTACTGGGTCCTGGAGGCGGCTATAGACTTGCTAAAGAGCCCGAC
ACAATCTTTTTGATGCAAATCCTCAAAGCCGTGGCTGATACTCCTAAAATAACTCGTTGTGGTGGTGATGGGCAGCAAAG
CTGTACGGGAGAAGCAAAAAAATGCTGCACCCATAATCTATGGGTTGTTCTAGAGAAAAGGTTCAATAATTTTTTTGAGT
CTGTGACGCTTCAGGACATCATATCAGACGATGTTCTAAGACAAGAAAAGAACATGCACAATGGATCAATATTGGAATCC
CATCAAGAAGACATCATATACATGGATAATAATGCCACAGCCACTCCTTTCCGGTATGCAGTAGAGAAAGCATGTATCCT
CTTAAAATTGCCATATAATGCATCCTCAATTCACAGACGGGGACAAGCAGCCAGAGAAGTTATTGAAGAAGCCCGTAGAC
TGATAAAGAAAAATCTCATCCTCGAAGAAAACTATGAACTTGTATTCACTGCTTCTGGAACAGAAGCAAATAATATGCTT
TTCCATAATGCAAGCGATTACCACCATATAGTTTGCAGTACAGACCACAGTTCGACGCTTAAAGTTGCCAATAACCCTAT
TAAAGTCGATGTTGATGAAAATGGTATTATCAAACTTGAAAGTCTAAAAAGAGCCCTATTGGAAAACCATGGTCAAAAAT
TAGTGTCGCTGTGTCTAGCAAATAGCGAAACTGGAGTTATACAACCCCTAGACCTCATAATGGAAATTGCAAAAAAGCAT
GGGGCATTGGTACATACGGACGCTACACAAGCCATTTCCAGAATTTATTGTAGACTTAATGAGACACAACCAGATTTCAT
TACCTTTTCTGCACACAAAATGGGAGGCATTATTGGTGCCGGGTGCCTTGTTTACAGGAAATATCTTTCGAAAGAACTGA
AACCACTCATCCTAGGAGGAGGACAAGAAAGAAACCTCAGAAGCGGAACAGAAAATCTCGCTGCGATAGCTGCATTTGGA
AATGCATCAACGTTTATTAATACCTCTATAAAAAATATGAAAAATATAAGATCTTTGAGAGATTACATGGAGGATGAGAT
ATCAAAACGCATGAAGTCGGCTGTCATAGTGGGCCAGAAAGCTCAAAGACTTCCGAACACAAGTTGCATCATCATCCCAG
AAATTGACGGGACAACTCAATTAATGCATTTCGATATGCATGGAATATGCGTCAGCAATGGATCAGCATGTTCATCCGGA
CAGCCGGAAGCATCTCATGTGCTGCTCGCAATGGGCTTTGACAATAATATGGCTAAGTCAGCAATTAGAATAAGCTTAGG
GATTTCAAATACAAAAGAAGAAGTGAAAAAGCTTGTATCAACATGGGAGATATTGTACAACATTAGGGCGTAA

Upstream 100 bases:

>100_bases
AAAATCACATTATAAATTATAAATGTCATACCTACCAACAGGTATTTGATAGTGCACTATATAACCGAAGCATGTTAGAA
TCATGATTATTCCATAACCC

Downstream 100 bases:

>100_bases
AACGATTATTACATAGTTTTAATTAGGAAAATGAAAAATGAAGTTGCCAGTATTCCTTGATAATCAATCCACAACAAAAC
CTGATCCAGAAGTCATTGAG

Product: rrf2/class V aminotransferase family protein

Products: NA

Alternate protein names: Nitrogenase metalloclusters biosynthesis protein NifS [H]

Number of amino acids: Translated: 530; Mature: 529

Protein sequence:

>530_residues
MSRGEYLTMLTAKTRYAIAASIDIALHSKGRKYVKTSEIASRQKISEKFLELILPPLKKQGILESLLGPGGGYRLAKEPD
TIFLMQILKAVADTPKITRCGGDGQQSCTGEAKKCCTHNLWVVLEKRFNNFFESVTLQDIISDDVLRQEKNMHNGSILES
HQEDIIYMDNNATATPFRYAVEKACILLKLPYNASSIHRRGQAAREVIEEARRLIKKNLILEENYELVFTASGTEANNML
FHNASDYHHIVCSTDHSSTLKVANNPIKVDVDENGIIKLESLKRALLENHGQKLVSLCLANSETGVIQPLDLIMEIAKKH
GALVHTDATQAISRIYCRLNETQPDFITFSAHKMGGIIGAGCLVYRKYLSKELKPLILGGGQERNLRSGTENLAAIAAFG
NASTFINTSIKNMKNIRSLRDYMEDEISKRMKSAVIVGQKAQRLPNTSCIIIPEIDGTTQLMHFDMHGICVSNGSACSSG
QPEASHVLLAMGFDNNMAKSAIRISLGISNTKEEVKKLVSTWEILYNIRA

Sequences:

>Translated_530_residues
MSRGEYLTMLTAKTRYAIAASIDIALHSKGRKYVKTSEIASRQKISEKFLELILPPLKKQGILESLLGPGGGYRLAKEPD
TIFLMQILKAVADTPKITRCGGDGQQSCTGEAKKCCTHNLWVVLEKRFNNFFESVTLQDIISDDVLRQEKNMHNGSILES
HQEDIIYMDNNATATPFRYAVEKACILLKLPYNASSIHRRGQAAREVIEEARRLIKKNLILEENYELVFTASGTEANNML
FHNASDYHHIVCSTDHSSTLKVANNPIKVDVDENGIIKLESLKRALLENHGQKLVSLCLANSETGVIQPLDLIMEIAKKH
GALVHTDATQAISRIYCRLNETQPDFITFSAHKMGGIIGAGCLVYRKYLSKELKPLILGGGQERNLRSGTENLAAIAAFG
NASTFINTSIKNMKNIRSLRDYMEDEISKRMKSAVIVGQKAQRLPNTSCIIIPEIDGTTQLMHFDMHGICVSNGSACSSG
QPEASHVLLAMGFDNNMAKSAIRISLGISNTKEEVKKLVSTWEILYNIRA
>Mature_529_residues
SRGEYLTMLTAKTRYAIAASIDIALHSKGRKYVKTSEIASRQKISEKFLELILPPLKKQGILESLLGPGGGYRLAKEPDT
IFLMQILKAVADTPKITRCGGDGQQSCTGEAKKCCTHNLWVVLEKRFNNFFESVTLQDIISDDVLRQEKNMHNGSILESH
QEDIIYMDNNATATPFRYAVEKACILLKLPYNASSIHRRGQAAREVIEEARRLIKKNLILEENYELVFTASGTEANNMLF
HNASDYHHIVCSTDHSSTLKVANNPIKVDVDENGIIKLESLKRALLENHGQKLVSLCLANSETGVIQPLDLIMEIAKKHG
ALVHTDATQAISRIYCRLNETQPDFITFSAHKMGGIIGAGCLVYRKYLSKELKPLILGGGQERNLRSGTENLAAIAAFGN
ASTFINTSIKNMKNIRSLRDYMEDEISKRMKSAVIVGQKAQRLPNTSCIIIPEIDGTTQLMHFDMHGICVSNGSACSSGQ
PEASHVLLAMGFDNNMAKSAIRISLGISNTKEEVKKLVSTWEILYNIRA

Specific function: Catalyzes the removal of elemental sulfur atoms from cysteine to produce alanine. Seems to participate in the biosynthesis of the nitrogenase metalloclusters by providing the inorganic sulfur required for the Fe-S core formation [H]

COG id: COG1104

COG function: function code E; Cysteine sulfinate desulfinase/cysteine desulfurase and related enzymes

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the class-V pyridoxal-phosphate-dependent aminotransferase family. NifS/IscS subfamily [H]

Homologues:

Organism=Homo sapiens, GI32307132, Length=371, Percent_Identity=30.188679245283, Blast_Score=148, Evalue=1e-35,
Organism=Homo sapiens, GI156713448, Length=421, Percent_Identity=29.2161520190024, Blast_Score=139, Evalue=7e-33,
Organism=Escherichia coli, GI48994898, Length=368, Percent_Identity=30.4347826086957, Blast_Score=155, Evalue=5e-39,
Organism=Escherichia coli, GI1788880, Length=158, Percent_Identity=32.9113924050633, Blast_Score=86, Evalue=8e-18,
Organism=Caenorhabditis elegans, GI25143064, Length=386, Percent_Identity=31.0880829015544, Blast_Score=159, Evalue=4e-39,
Organism=Caenorhabditis elegans, GI17533177, Length=331, Percent_Identity=30.8157099697885, Blast_Score=117, Evalue=1e-26,
Organism=Saccharomyces cerevisiae, GI6319831, Length=341, Percent_Identity=33.7243401759531, Blast_Score=171, Evalue=4e-43,
Organism=Drosophila melanogaster, GI20129463, Length=374, Percent_Identity=30.7486631016043, Blast_Score=148, Evalue=8e-36,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR000192
- InterPro:   IPR020578
- InterPro:   IPR017772
- InterPro:   IPR016454
- InterPro:   IPR015424
- InterPro:   IPR015421
- InterPro:   IPR015422 [H]

Pfam domain/function: PF00266 Aminotran_5 [H]

EC number: =2.8.1.7 [H]

Molecular weight: Translated: 58785; Mature: 58653

Theoretical pI: Translated: 8.63; Mature: 8.63

Prosite motif: PS01332 UPF0074

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

2.3 %Cys     (Translated Protein)
2.8 %Met     (Translated Protein)
5.1 %Cys+Met (Translated Protein)
2.3 %Cys     (Mature Protein)
2.6 %Met     (Mature Protein)
4.9 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSRGEYLTMLTAKTRYAIAASIDIALHSKGRKYVKTSEIASRQKISEKFLELILPPLKKQ
CCCCCEEEEEEECCCEEEEEEEEEEEECCCCCEEEHHHHHHHHHHHHHHHHHHCCCCHHH
GILESLLGPGGGYRLAKEPDTIFLMQILKAVADTPKITRCGGDGQQSCTGEAKKCCTHNL
HHHHHHHCCCCCCCCCCCCCHHHHHHHHHHHHCCCCEEECCCCCCCCCCCHHHHHHCCCH
WVVLEKRFNNFFESVTLQDIISDDVLRQEKNMHNGSILESHQEDIIYMDNNATATPFRYA
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHCCCCCEEEECCCCCCCHHHHH
VEKACILLKLPYNASSIHRRGQAAREVIEEARRLIKKNLILEENYELVFTASGTEANNML
HHHEEEEEECCCCHHHHHHHHHHHHHHHHHHHHHHHHCCEEECCCEEEEEECCCCCCCEE
FHNASDYHHIVCSTDHSSTLKVANNPIKVDVDENGIIKLESLKRALLENHGQKLVSLCLA
EECCCCCEEEEEECCCCCEEEECCCCEEEEECCCCCEEHHHHHHHHHHHCCHHHHHHHHC
NSETGVIQPLDLIMEIAKKHGALVHTDATQAISRIYCRLNETQPDFITFSAHKMGGIIGA
CCCCCCCCHHHHHHHHHHHCCCEEECCHHHHHHHHHHHCCCCCCCEEEEEHHHHCCHHHH
GCLVYRKYLSKELKPLILGGGQERNLRSGTENLAAIAAFGNASTFINTSIKNMKNIRSLR
HHHHHHHHHHHCCCEEEECCCCCCCCCCCCCCCEEEEEECCCCCEEHHHHHHHHHHHHHH
DYMEDEISKRMKSAVIVGQKAQRLPNTSCIIIPEIDGTTQLMHFDMHGICVSNGSACSSG
HHHHHHHHHHHHHHHHCCHHHHHCCCCCEEEEECCCCCEEEEEEEECEEEECCCCCCCCC
QPEASHVLLAMGFDNNMAKSAIRISLGISNTKEEVKKLVSTWEILYNIRA
CCCCCEEEEEEECCCCHHCCEEEEEECCCCCHHHHHHHHHHHHHHHCCCC
>Mature Secondary Structure 
SRGEYLTMLTAKTRYAIAASIDIALHSKGRKYVKTSEIASRQKISEKFLELILPPLKKQ
CCCCEEEEEEECCCEEEEEEEEEEEECCCCCEEEHHHHHHHHHHHHHHHHHHCCCCHHH
GILESLLGPGGGYRLAKEPDTIFLMQILKAVADTPKITRCGGDGQQSCTGEAKKCCTHNL
HHHHHHHCCCCCCCCCCCCCHHHHHHHHHHHHCCCCEEECCCCCCCCCCCHHHHHHCCCH
WVVLEKRFNNFFESVTLQDIISDDVLRQEKNMHNGSILESHQEDIIYMDNNATATPFRYA
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHCCCCCEEEECCCCCCCHHHHH
VEKACILLKLPYNASSIHRRGQAAREVIEEARRLIKKNLILEENYELVFTASGTEANNML
HHHEEEEEECCCCHHHHHHHHHHHHHHHHHHHHHHHHCCEEECCCEEEEEECCCCCCCEE
FHNASDYHHIVCSTDHSSTLKVANNPIKVDVDENGIIKLESLKRALLENHGQKLVSLCLA
EECCCCCEEEEEECCCCCEEEECCCCEEEEECCCCCEEHHHHHHHHHHHCCHHHHHHHHC
NSETGVIQPLDLIMEIAKKHGALVHTDATQAISRIYCRLNETQPDFITFSAHKMGGIIGA
CCCCCCCCHHHHHHHHHHHCCCEEECCHHHHHHHHHHHCCCCCCCEEEEEHHHHCCHHHH
GCLVYRKYLSKELKPLILGGGQERNLRSGTENLAAIAAFGNASTFINTSIKNMKNIRSLR
HHHHHHHHHHHCCCEEEECCCCCCCCCCCCCCCEEEEEECCCCCEEHHHHHHHHHHHHHH
DYMEDEISKRMKSAVIVGQKAQRLPNTSCIIIPEIDGTTQLMHFDMHGICVSNGSACSSG
HHHHHHHHHHHHHHHHCCHHHHHCCCCCEEEEECCCCCEEEEEEEECEEEECCCCCCCCC
QPEASHVLLAMGFDNNMAKSAIRISLGISNTKEEVKKLVSTWEILYNIRA
CCCCCEEEEEEECCCCHHCCEEEEEECCCCCHHHHHHHHHHHHHHHCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 1317839 [H]