Definition Rhodospirillum rubrum ATCC 11170 chromosome, complete genome.
Accession NC_007643
Length 4,352,825

Click here to switch to the map view.

The map label for this gene is eryA [H]

Identifier: 83593455

GI number: 83593455

Start: 2461858

End: 2462910

Strand: Direct

Name: eryA [H]

Synonym: Rru_A2120

Alternate gene names: 83593455

Gene position: 2461858-2462910 (Clockwise)

Preceding gene: 83593448

Following gene: 83593456

Centisome position: 56.56

GC content: 68.28

Gene sequence:

>1053_bases
ATGAACCACTCCATGGCAAACAGACTGCCCGATATCGGGCAGTCTGTCGACAGGGCGACCGTCGGACTGGTCTTCGCCGG
CAATGGCAGCCAGTGGCCGGGGATGGGCGCGGCCCTGTTGCGCGACGATGCGGTTTTTCGCGAAAGCGTCAGCGCCCTTG
ACGCCAAGATCCGTGAGCGGGCCGGCTGGTCGGTGATCGACGCCCTGGACGCGGACACCTCGGCCCTGACCATCGCCCGC
ATCGGCACCGCCCAGCCGCTGCTCTATGCCCTGCAGATCGGCCTTGTCGATAGCCTGCGGGCCCGGGGGCTGGCCTTTGG
CGCGGTTTGCGGCCATTCGGTGGGCGAGGTCGCCGCCGCCACCGTCGTCGGCGCGCTGGACCCCGATCAGGCCCTTGATC
TTATCCTCACCCGCAGCGCCGCCCAGGAACGCACCTGGGGCCAGGGAAAGATGGCCGCCCTCGCCCTCTCGGCGATCGAA
GCCGAAGCGCTCTGCGCCCCATACGATGGCGCCGTCGTCGTCGCCGCCCTCAACAGTCCGACCTCGGTGACGCTTTCGGG
CGATGAGGCCTGCCTGATCGCTCTTGGCGAACAGGCCAAGGCCGCCGGCGCGCTGTTTCGCCTACTTGATCTTGATTACG
CCTTCCACAACCGCGTGCTTGATCCGGTGCGCGACGATCTGCTCAAGGCCCTGGCCCCCTTGCGCCCCCGCCCCTGCGCC
CCCGGCTATCGGTTTTTCTCCTCGGTCGATGGCAAGGCCCGCGGCGGAGAGACCCTTGATGCCCGCTATTGGTGGGATAA
CGTGCGCGAACCGGTGCGCTTCGATGCCGCCGTCACGGCGATGGCGGCCGGCGGCGTCACCACCTTCATCGAAATCGGTC
CCCATCCGATCTTGCGCTCCTATCTGCGCGAGATCCTTCAAGGCCGCTCCCGCCTCGGCCGGGGTCCCCATCCCATCGCC
ACCCTCAGCCGCACGCGCTCGGGGCCCGAAGCCCTGCAGGCCACCCTTGATCACCTGCGCACCCCCCCTTCCCTTCAGCG
CAAATCGGCCTGA

Upstream 100 bases:

>100_bases
GAGCATCGGGGCTTTACAAGCCCTGTTGCCGCGCTGATATCAGAAAGCAAAGGCCTAAAAAAAGGCCGGGATCAAGCATG
ACAAGGCGGGATAGGCGGAC

Downstream 100 bases:

>100_bases
GGCGAGGGATTTGTCATAGCGTGGGATCAGGGCGGGGGGAGCGGGTTGAACATGCGCGTTGTCTATCTGGGCACCTATGA
CCACGACAAGCCGCGCAACC

Product: acyl transferase region

Products: NA

Alternate protein names: 6-deoxyerythronolide B synthase II; DEBS 2; ORF 2 [H]

Number of amino acids: Translated: 350; Mature: 350

Protein sequence:

>350_residues
MNHSMANRLPDIGQSVDRATVGLVFAGNGSQWPGMGAALLRDDAVFRESVSALDAKIRERAGWSVIDALDADTSALTIAR
IGTAQPLLYALQIGLVDSLRARGLAFGAVCGHSVGEVAAATVVGALDPDQALDLILTRSAAQERTWGQGKMAALALSAIE
AEALCAPYDGAVVVAALNSPTSVTLSGDEACLIALGEQAKAAGALFRLLDLDYAFHNRVLDPVRDDLLKALAPLRPRPCA
PGYRFFSSVDGKARGGETLDARYWWDNVREPVRFDAAVTAMAAGGVTTFIEIGPHPILRSYLREILQGRSRLGRGPHPIA
TLSRTRSGPEALQATLDHLRTPPSLQRKSA

Sequences:

>Translated_350_residues
MNHSMANRLPDIGQSVDRATVGLVFAGNGSQWPGMGAALLRDDAVFRESVSALDAKIRERAGWSVIDALDADTSALTIAR
IGTAQPLLYALQIGLVDSLRARGLAFGAVCGHSVGEVAAATVVGALDPDQALDLILTRSAAQERTWGQGKMAALALSAIE
AEALCAPYDGAVVVAALNSPTSVTLSGDEACLIALGEQAKAAGALFRLLDLDYAFHNRVLDPVRDDLLKALAPLRPRPCA
PGYRFFSSVDGKARGGETLDARYWWDNVREPVRFDAAVTAMAAGGVTTFIEIGPHPILRSYLREILQGRSRLGRGPHPIA
TLSRTRSGPEALQATLDHLRTPPSLQRKSA
>Mature_350_residues
MNHSMANRLPDIGQSVDRATVGLVFAGNGSQWPGMGAALLRDDAVFRESVSALDAKIRERAGWSVIDALDADTSALTIAR
IGTAQPLLYALQIGLVDSLRARGLAFGAVCGHSVGEVAAATVVGALDPDQALDLILTRSAAQERTWGQGKMAALALSAIE
AEALCAPYDGAVVVAALNSPTSVTLSGDEACLIALGEQAKAAGALFRLLDLDYAFHNRVLDPVRDDLLKALAPLRPRPCA
PGYRFFSSVDGKARGGETLDARYWWDNVREPVRFDAAVTAMAAGGVTTFIEIGPHPILRSYLREILQGRSRLGRGPHPIA
TLSRTRSGPEALQATLDHLRTPPSLQRKSA

Specific function: Fatty acid biosynthesis. [C]

COG id: COG3321

COG function: function code Q; Polyketide synthase modules and related proteins

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 2 acyl carrier domains [H]

Homologues:

Organism=Homo sapiens, GI41872631, Length=291, Percent_Identity=30.9278350515464, Blast_Score=99, Evalue=5e-21,
Organism=Caenorhabditis elegans, GI212642053, Length=291, Percent_Identity=27.8350515463918, Blast_Score=99, Evalue=5e-21,
Organism=Caenorhabditis elegans, GI17550940, Length=297, Percent_Identity=25.2525252525253, Blast_Score=80, Evalue=1e-15,
Organism=Drosophila melanogaster, GI221330659, Length=296, Percent_Identity=27.7027027027027, Blast_Score=86, Evalue=5e-17,
Organism=Drosophila melanogaster, GI19920632, Length=296, Percent_Identity=27.7027027027027, Blast_Score=86, Evalue=5e-17,
Organism=Drosophila melanogaster, GI24581345, Length=298, Percent_Identity=28.8590604026846, Blast_Score=80, Evalue=2e-15,

Paralogues:

None

Copy number: 500 Molecules/Cell In: Growth Phase, Minimal Media (Based on E. coli). [C]

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR001227
- InterPro:   IPR009081
- InterPro:   IPR014043
- InterPro:   IPR016035
- InterPro:   IPR013149
- InterPro:   IPR013154
- InterPro:   IPR000794
- InterPro:   IPR002198
- InterPro:   IPR015357
- InterPro:   IPR011032
- InterPro:   IPR018201
- InterPro:   IPR014031
- InterPro:   IPR014030
- InterPro:   IPR016036
- InterPro:   IPR016040
- InterPro:   IPR006163
- InterPro:   IPR020842
- InterPro:   IPR020801
- InterPro:   IPR020841
- InterPro:   IPR020807
- InterPro:   IPR020843
- InterPro:   IPR020806
- InterPro:   IPR015083
- InterPro:   IPR006162
- InterPro:   IPR016039
- InterPro:   IPR016038 [H]

Pfam domain/function: PF00698 Acyl_transf_1; PF08240 ADH_N; PF00106 adh_short; PF00107 ADH_zinc_N; PF08990 Docking; PF09277 Erythro-docking; PF00109 ketoacyl-synt; PF02801 Ketoacyl-synt_C; PF00550 PP-binding [H]

EC number: =2.3.1.94 [H]

Molecular weight: Translated: 37093; Mature: 37093

Theoretical pI: Translated: 7.12; Mature: 7.12

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.1 %Cys     (Translated Protein)
1.4 %Met     (Translated Protein)
2.6 %Cys+Met (Translated Protein)
1.1 %Cys     (Mature Protein)
1.4 %Met     (Mature Protein)
2.6 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MNHSMANRLPDIGQSVDRATVGLVFAGNGSQWPGMGAALLRDDAVFRESVSALDAKIRER
CCCCHHHCCCHHHHHHHHEEEEEEEECCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHH
AGWSVIDALDADTSALTIARIGTAQPLLYALQIGLVDSLRARGLAFGAVCGHSVGEVAAA
CCCHHHHHCCCCCCEEEEEECCCCHHHHHHHHHHHHHHHHHCCEEHHHHHCCCHHHHHHH
TVVGALDPDQALDLILTRSAAQERTWGQGKMAALALSAIEAEALCAPYDGAVVVAALNSP
HHHCCCCHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHCCCCCCEEEEEEECCC
TSVTLSGDEACLIALGEQAKAAGALFRLLDLDYAFHNRVLDPVRDDLLKALAPLRPRPCA
CEEEECCCCEEEEEECCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCC
PGYRFFSSVDGKARGGETLDARYWWDNVREPVRFDAAVTAMAAGGVTTFIEIGPHPILRS
CHHHHHHCCCCCCCCCCCEEHHHHHHHCCCCHHHHHHHHHHHHCCCEEEEEECCCHHHHH
YLREILQGRSRLGRGPHPIATLSRTRSGPEALQATLDHLRTPPSLQRKSA
HHHHHHHHHHHCCCCCCCHHHHHHCCCCHHHHHHHHHHHCCCCCHHCCCC
>Mature Secondary Structure
MNHSMANRLPDIGQSVDRATVGLVFAGNGSQWPGMGAALLRDDAVFRESVSALDAKIRER
CCCCHHHCCCHHHHHHHHEEEEEEEECCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHH
AGWSVIDALDADTSALTIARIGTAQPLLYALQIGLVDSLRARGLAFGAVCGHSVGEVAAA
CCCHHHHHCCCCCCEEEEEECCCCHHHHHHHHHHHHHHHHHCCEEHHHHHCCCHHHHHHH
TVVGALDPDQALDLILTRSAAQERTWGQGKMAALALSAIEAEALCAPYDGAVVVAALNSP
HHHCCCCHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHCCCCCCEEEEEEECCC
TSVTLSGDEACLIALGEQAKAAGALFRLLDLDYAFHNRVLDPVRDDLLKALAPLRPRPCA
CEEEECCCCEEEEEECCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCC
PGYRFFSSVDGKARGGETLDARYWWDNVREPVRFDAAVTAMAAGGVTTFIEIGPHPILRS
CHHHHHHCCCCCCCCCCCEEHHHHHHHCCCCHHHHHHHHHHHHCCCEEEEEECCCHHHHH
YLREILQGRSRLGRGPHPIATLSRTRSGPEALQATLDHLRTPPSLQRKSA
HHHHHHHHHHHCCCCCCCHHHHHHCCCCHHHHHHHHHHHCCCCCHHCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: 2024119; 1740151 [H]