Definition Chloroflexus sp. Y-400-fl chromosome, complete genome.
Accession NC_012032
Length 5,268,950

Click here to switch to the map view.

The map label for this gene is erpA [H]

Identifier: 222523331

GI number: 222523331

Start: 34016

End: 34459

Strand: Reverse

Name: erpA [H]

Synonym: Chy400_0032

Alternate gene names: 222523331

Gene position: 34459-34016 (Counterclockwise)

Preceding gene: 222523332

Following gene: 222523320

Centisome position: 0.65

GC content: 57.43

Gene sequence:

>444_bases
ATGACAACGGTTGATCTCAATCAGATCACATTCCAACCGGCCACCCCACAACCGCTGCTGACCATCAGCGAAGCGGCGAG
CAGCCGTCTGCTCAAGATGATGCAGGAAAAAGAACTGGAAGGCTATGCCTTGCGCGTATTTGTTGCTGGTGGTGGTTGTT
CGGGCCTCCAGTACGGCATGACCTTCGACGACGAGGTACGCGAAGGCGACAACGAGTTTTACGCCGGCAACCTGCGGGTA
CTGGTCGACCCGATCAGCGCCCAATACCTGTTTGGCGCATCGATTGATTTTGTCGATACGCTGATGGGTGGTGGCTTCAA
GATTGACAACCCGAATGCCGTTTCCTCGTGCGGTTGTGGCCACTCATTCCGCGCCCGCGACACCGACTACAGCGAAGACG
ATGAGGACGCGCCGGTCGGTGGATGCAGTGCGTGTGGGATGTAG

Upstream 100 bases:

>100_bases
GAAAGATAGTACTAGCATTTTCGGCCAACATCGTGTATACTGCACATATTGAAGGAGGCAGGCGCTTCGGCGACTGTACA
TTATGGTCAAGGAGTAGTCC

Downstream 100 bases:

>100_bases
GCACAGCATCTGGTAGGCTAAATCATTTACCCAAATCTCCTCATCTTCTGAATGATGAGGAGGTTTTGTGTTTCATTGAA
CCGGGTAATCTCTGGCAGGA

Product: iron-sulfur cluster assembly accessory protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 147; Mature: 146

Protein sequence:

>147_residues
MTTVDLNQITFQPATPQPLLTISEAASSRLLKMMQEKELEGYALRVFVAGGGCSGLQYGMTFDDEVREGDNEFYAGNLRV
LVDPISAQYLFGASIDFVDTLMGGGFKIDNPNAVSSCGCGHSFRARDTDYSEDDEDAPVGGCSACGM

Sequences:

>Translated_147_residues
MTTVDLNQITFQPATPQPLLTISEAASSRLLKMMQEKELEGYALRVFVAGGGCSGLQYGMTFDDEVREGDNEFYAGNLRV
LVDPISAQYLFGASIDFVDTLMGGGFKIDNPNAVSSCGCGHSFRARDTDYSEDDEDAPVGGCSACGM
>Mature_146_residues
TTVDLNQITFQPATPQPLLTISEAASSRLLKMMQEKELEGYALRVFVAGGGCSGLQYGMTFDDEVREGDNEFYAGNLRVL
VDPISAQYLFGASIDFVDTLMGGGFKIDNPNAVSSCGCGHSFRARDTDYSEDDEDAPVGGCSACGM

Specific function: Required for insertion of 4Fe-4S clusters for at least ispG [H]

COG id: COG0316

COG function: function code S; Uncharacterized conserved protein

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the hesB/iscA family [H]

Homologues:

Organism=Homo sapiens, GI160420328, Length=105, Percent_Identity=36.1904761904762, Blast_Score=71, Evalue=3e-13,
Organism=Escherichia coli, GI1786351, Length=104, Percent_Identity=45.1923076923077, Blast_Score=103, Evalue=3e-24,
Organism=Escherichia coli, GI1788877, Length=106, Percent_Identity=37.7358490566038, Blast_Score=74, Evalue=4e-15,
Organism=Caenorhabditis elegans, GI71998452, Length=107, Percent_Identity=35.5140186915888, Blast_Score=69, Evalue=1e-12,
Organism=Caenorhabditis elegans, GI193209025, Length=120, Percent_Identity=28.3333333333333, Blast_Score=65, Evalue=1e-11,
Organism=Caenorhabditis elegans, GI25146411, Length=104, Percent_Identity=29.8076923076923, Blast_Score=64, Evalue=3e-11,
Organism=Saccharomyces cerevisiae, GI6325324, Length=132, Percent_Identity=31.8181818181818, Blast_Score=62, Evalue=3e-11,
Organism=Drosophila melanogaster, GI24649697, Length=112, Percent_Identity=37.5, Blast_Score=80, Evalue=4e-16,
Organism=Drosophila melanogaster, GI24642263, Length=104, Percent_Identity=32.6923076923077, Blast_Score=66, Evalue=6e-12,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR000361
- InterPro:   IPR016092
- InterPro:   IPR017870
- InterPro:   IPR023063 [H]

Pfam domain/function: PF01521 Fe-S_biosyn [H]

EC number: NA

Molecular weight: Translated: 15759; Mature: 15628

Theoretical pI: Translated: 3.93; Mature: 3.93

Prosite motif: PS01152 HESB

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

3.4 %Cys     (Translated Protein)
4.1 %Met     (Translated Protein)
7.5 %Cys+Met (Translated Protein)
3.4 %Cys     (Mature Protein)
3.4 %Met     (Mature Protein)
6.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTTVDLNQITFQPATPQPLLTISEAASSRLLKMMQEKELEGYALRVFVAGGGCSGLQYGM
CCEECCCEEEECCCCCCCEEEHHHHHHHHHHHHHHHCCCCCEEEEEEEECCCCCCEECCC
TFDDEVREGDNEFYAGNLRVLVDPISAQYLFGASIDFVDTLMGGGFKIDNPNAVSSCGCG
CCCHHHHCCCCEEEECCEEEEECCCCCEEEECCCHHHHHHHHCCCEEECCCCCCCCCCCC
HSFRARDTDYSEDDEDAPVGGCSACGM
CCCCCCCCCCCCCCCCCCCCCCCCCCC
>Mature Secondary Structure 
TTVDLNQITFQPATPQPLLTISEAASSRLLKMMQEKELEGYALRVFVAGGGCSGLQYGM
CEECCCEEEECCCCCCCEEEHHHHHHHHHHHHHHHCCCCCEEEEEEEECCCCCCEECCC
TFDDEVREGDNEFYAGNLRVLVDPISAQYLFGASIDFVDTLMGGGFKIDNPNAVSSCGCG
CCCHHHHCCCCEEEECCEEEEECCCCCEEEECCCHHHHHHHHCCCEEECCCCCCCCCCCC
HSFRARDTDYSEDDEDAPVGGCSACGM
CCCCCCCCCCCCCCCCCCCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: NA