Definition Mycobacterium avium subsp. paratuberculosis K-10, complete genome.
Accession NC_002944
Length 4,829,781

Click here to switch to the map view.

The map label for this gene is aroB

Identifier: 41407191

GI number: 41407191

Start: 1146354

End: 1147451

Strand: Direct

Name: aroB

Synonym: MAP1093

Alternate gene names: 41407191

Gene position: 1146354-1147451 (Clockwise)

Preceding gene: 41407190

Following gene: 41407192

Centisome position: 23.74

GC content: 71.4

Gene sequence:

>1098_bases
ATGAGAACCACCCGCGAACCGGTGACCGTGCAGGTGGCCGTCGACCCGCCCTACCCGGTGATCATCGGCACCGGGCTGCT
GGGCGAGCTGGACGAACTGCTCGGCGCCCGGCACAAGGTCGCCGTCGTGCACCAGCCCGTACTCGCCGAGACCGCCGAGG
TGATCCGAAAGCGGTTGGCGGACAAAGGTGTTGACGCGCACCGCATCGAGATCCCGGACGCCGAGGACGGCAAGGACCTC
CCGGTCGTCGGCTTCCTGTGGGAAGTGTTGGGCCGCATCGGAATCGGGCGCAAGGACGCGTTGGTCAGCCTGGGCGGTGG
TGCGGCCACCGACGTCGCCGGTTTCGCGGCGGCCACCTGGCTGCGCGGCGTCGACATCGTGCACGTGCCCACCACCCTGC
TCGGCATGGTCGACGCCGCCGTCGGCGGCAAGACCGGCATCAACACCGACGCCGGCAAGAACCTGGTCGGCGCCTTCCAC
CAGCCGCTCGCGGTGCTGGTCGACCTCGCGACGCTACACACGTTGCCGCCCAACGAGTTGGTGGCCGGCATGGCCGAAGT
CGTCAAGGCCGGCTTCATCGCCGATCCGGCGATCCTCGACCTCATCGAGGCCGATCCGCGAGCCGCGGTGGACCCGTCCG
GCGAGGTGCTGGCCGAGCTGGTCCAGCGCGCCATCGCGGTCAAGGCCGACGTCGTCGCCGCCGACGAGAAGGAGTCGGAG
CTGCGCGAAATCCTCAACTACGGGCACACGTTGGGGCATGCGATCGAGCGCCGCGAGCGCTACCGGTGGCGGCACGGCGC
GGCAGTGTCGGTGGGCCTGGTCTTCGCCGCCGAGCTGGCCCGGTTGGCCGGGCGGCTCGACGACGCCACCGCGCGGCGGC
ACCGCACCATCTTGTCCGCGCTCGGCCTGCCGGTCAGCTACGACGCCGACGCGCTGCCGCAGCTGCTGGAATACATGGCC
GGGGACAAGAAGTCCCGCGCCGGGGTGCTGCGGTTCGTGGTGCTGGACGGATTGGCCAAGCCGGGCCGGCTGGCCGGCCC
GGACCCGTCGCTGCTGGCGGCGGCGTATGCCGCCCTGGCCGACGAGGACGCCTCATGA

Upstream 100 bases:

>100_bases
CCGCCACCATCCGGGTCGACACCAACCGGCGCAACCCCGGCGCGGTGGTGCGCTACATCGTGTCGCGGCTGCCCGCCACC
GATGCCTGCCGGGCCGCCAC

Downstream 100 bases:

>100_bases
TCGTGCAGGTGATCAACGGCCCGAACCTGGGCCGGCTGGGCCGGCGCGAGCCCGACGTGTACGGCGACACCACGCACGAC
CAGCTGGCCGCGCTGATCGA

Product: 3-dehydroquinate synthase

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 365; Mature: 365

Protein sequence:

>365_residues
MRTTREPVTVQVAVDPPYPVIIGTGLLGELDELLGARHKVAVVHQPVLAETAEVIRKRLADKGVDAHRIEIPDAEDGKDL
PVVGFLWEVLGRIGIGRKDALVSLGGGAATDVAGFAAATWLRGVDIVHVPTTLLGMVDAAVGGKTGINTDAGKNLVGAFH
QPLAVLVDLATLHTLPPNELVAGMAEVVKAGFIADPAILDLIEADPRAAVDPSGEVLAELVQRAIAVKADVVAADEKESE
LREILNYGHTLGHAIERRERYRWRHGAAVSVGLVFAAELARLAGRLDDATARRHRTILSALGLPVSYDADALPQLLEYMA
GDKKSRAGVLRFVVLDGLAKPGRLAGPDPSLLAAAYAALADEDAS

Sequences:

>Translated_365_residues
MRTTREPVTVQVAVDPPYPVIIGTGLLGELDELLGARHKVAVVHQPVLAETAEVIRKRLADKGVDAHRIEIPDAEDGKDL
PVVGFLWEVLGRIGIGRKDALVSLGGGAATDVAGFAAATWLRGVDIVHVPTTLLGMVDAAVGGKTGINTDAGKNLVGAFH
QPLAVLVDLATLHTLPPNELVAGMAEVVKAGFIADPAILDLIEADPRAAVDPSGEVLAELVQRAIAVKADVVAADEKESE
LREILNYGHTLGHAIERRERYRWRHGAAVSVGLVFAAELARLAGRLDDATARRHRTILSALGLPVSYDADALPQLLEYMA
GDKKSRAGVLRFVVLDGLAKPGRLAGPDPSLLAAAYAALADEDAS
>Mature_365_residues
MRTTREPVTVQVAVDPPYPVIIGTGLLGELDELLGARHKVAVVHQPVLAETAEVIRKRLADKGVDAHRIEIPDAEDGKDL
PVVGFLWEVLGRIGIGRKDALVSLGGGAATDVAGFAAATWLRGVDIVHVPTTLLGMVDAAVGGKTGINTDAGKNLVGAFH
QPLAVLVDLATLHTLPPNELVAGMAEVVKAGFIADPAILDLIEADPRAAVDPSGEVLAELVQRAIAVKADVVAADEKESE
LREILNYGHTLGHAIERRERYRWRHGAAVSVGLVFAAELARLAGRLDDATARRHRTILSALGLPVSYDADALPQLLEYMA
GDKKSRAGVLRFVVLDGLAKPGRLAGPDPSLLAAAYAALADEDAS

Specific function: Aromatic amino acids biosynthesis; shikimate pathway; second step. [C]

COG id: COG0337

COG function: function code E; 3-dehydroquinate synthetase

Gene ontology:

Cell location: Cytoplasm (Probable)

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the dehydroquinate synthase family

Homologues:

Organism=Escherichia coli, GI1789791, Length=322, Percent_Identity=41.9254658385093, Blast_Score=216, Evalue=2e-57,
Organism=Saccharomyces cerevisiae, GI6320332, Length=285, Percent_Identity=38.2456140350877, Blast_Score=174, Evalue=2e-44,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): AROB_MYCPA (Q741J7)

Other databases:

- EMBL:   AE016958
- RefSeq:   NP_960027.1
- ProteinModelPortal:   Q741J7
- SMR:   Q741J7
- EnsemblBacteria:   EBMYCT00000039320
- GeneID:   2717580
- GenomeReviews:   AE016958_GR
- KEGG:   mpa:MAP1093
- NMPDR:   fig|262316.1.peg.1093
- GeneTree:   EBGT00050000016995
- HOGENOM:   HBG632303
- OMA:   FAAYQEI
- ProtClustDB:   PRK00002
- BRENDA:   4.2.3.4
- GO:   GO:0005737
- HAMAP:   MF_00110
- InterPro:   IPR016303
- InterPro:   IPR002658
- InterPro:   IPR016037
- PANTHER:   PTHR21090:SF1
- PIRSF:   PIRSF001455
- TIGRFAMs:   TIGR01357

Pfam domain/function: PF01761 DHQ_synthase

EC number: =4.2.3.4

Molecular weight: Translated: 38414; Mature: 38414

Theoretical pI: Translated: 5.27; Mature: 5.27

Prosite motif: PS00092 N6_MTASE

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.0 %Cys     (Translated Protein)
1.1 %Met     (Translated Protein)
1.1 %Cys+Met (Translated Protein)
0.0 %Cys     (Mature Protein)
1.1 %Met     (Mature Protein)
1.1 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MRTTREPVTVQVAVDPPYPVIIGTGLLGELDELLGARHKVAVVHQPVLAETAEVIRKRLA
CCCCCCCEEEEEEECCCCCEEECCCHHHHHHHHHCCCCEEEEHHCHHHHHHHHHHHHHHH
DKGVDAHRIEIPDAEDGKDLPVVGFLWEVLGRIGIGRKDALVSLGGGAATDVAGFAAATW
HCCCCCEEEECCCCCCCCCCCHHHHHHHHHHHHCCCCCHHEEECCCCCHHHHHHHHHHHH
LRGVDIVHVPTTLLGMVDAAVGGKTGINTDAGKNLVGAFHQPLAVLVDLATLHTLPPNEL
HHCCCEEEHHHHHHHHHHHHCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHCCCCHHHH
VAGMAEVVKAGFIADPAILDLIEADPRAAVDPSGEVLAELVQRAIAVKADVVAADEKESE
HHHHHHHHHHCCCCCHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHHCCCCHHHH
LREILNYGHTLGHAIERRERYRWRHGAAVSVGLVFAAELARLAGRLDDATARRHRTILSA
HHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHH
LGLPVSYDADALPQLLEYMAGDKKSRAGVLRFVVLDGLAKPGRLAGPDPSLLAAAYAALA
HCCCCCCCHHHHHHHHHHHCCCCCHHHHHHHHHHHHCCCCCCCCCCCCHHHHHHHHHHHH
DEDAS
CCCCC
>Mature Secondary Structure
MRTTREPVTVQVAVDPPYPVIIGTGLLGELDELLGARHKVAVVHQPVLAETAEVIRKRLA
CCCCCCCEEEEEEECCCCCEEECCCHHHHHHHHHCCCCEEEEHHCHHHHHHHHHHHHHHH
DKGVDAHRIEIPDAEDGKDLPVVGFLWEVLGRIGIGRKDALVSLGGGAATDVAGFAAATW
HCCCCCEEEECCCCCCCCCCCHHHHHHHHHHHHCCCCCHHEEECCCCCHHHHHHHHHHHH
LRGVDIVHVPTTLLGMVDAAVGGKTGINTDAGKNLVGAFHQPLAVLVDLATLHTLPPNEL
HHCCCEEEHHHHHHHHHHHHCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHCCCCHHHH
VAGMAEVVKAGFIADPAILDLIEADPRAAVDPSGEVLAELVQRAIAVKADVVAADEKESE
HHHHHHHHHHCCCCCHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHHCCCCHHHH
LREILNYGHTLGHAIERRERYRWRHGAAVSVGLVFAAELARLAGRLDDATARRHRTILSA
HHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHH
LGLPVSYDADALPQLLEYMAGDKKSRAGVLRFVVLDGLAKPGRLAGPDPSLLAAAYAALA
HCCCCCCCHHHHHHHHHHHCCCCCHHHHHHHHHHHHCCCCCCCCCCCCHHHHHHHHHHHH
DEDAS
CCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: NA