Definition Leptospira interrogans serovar Copenhageni str. Fiocruz L1-130 chromosome chromosome I, complete sequence.
Accession NC_005823
Length 4,277,185

Click here to switch to the map view.

The map label for this gene is pabB

Identifier: 45656009

GI number: 45656009

Start: 114882

End: 116657

Strand: Reverse

Name: pabB

Synonym: LIC10098

Alternate gene names: 45656009

Gene position: 116657-114882 (Counterclockwise)

Preceding gene: 45656011

Following gene: 45656008

Centisome position: 2.73

GC content: 32.26

Gene sequence:

>1776_bases
ATGAGAATCGAAGAACTACTATTCTCTGACCAGCCTTTTATGATTTTTGACGAAGGATTCCATCCTTTCGGGAAAATTAT
ATTCCGCAATCCAATTAAAACAATTGAAGTTTATCATTTAGATACACTGTTAACTTCTCTTAACGAAATAAACGTTTATA
TAAAACAAGGTTATTATGTAGCCGGTTTTATTTCCTATGAGGCAGGTTATTTTTTTTCCGACATGAACTGGAAAAAAATC
GATACCGTTTTGCCGCTTTTGTATTTTGCGGTTTTTCAAAACCCCGAAAAATTTCCCGAAATTGAAACAGGACCCTCTCA
AAATTATGGCTTTTACATTTCCTCGATTCCAAACCGTAAAACTTATTTTGAAAATCTAGATATGATTCGAACCAAACTTT
ATCAGGGAGAAATTTATCAGATTAACTATACTGATAAAATTTTTTTTGATTTTGAAGGAGATATATTATCTTTTTATAAA
ACACTGTCCGAAAGACAACCCGTTCCCTACGGATCTTGGATTAGAACCTACGATTGGGATATACTTTCTTTTTCACCGGA
ACTTTTTTTTGAAAAAAAAGAAAAAACTCTGATTACAAAACCAATGAAAGGAACTTATCCAAGAGGCAAATCTCCCAAAG
AGGATAAAAAAAACGCCGAGGCTCTTATCAATTCCGACAAGGAAAAAGCAGAAAATCTAATGATCACAGATTTAATGCGA
AATGACCTCGGAAAAATTAGTAAAGAAGGAAGTGTTCATGTTCAAAATTTGTTCTCGGTAGAAAAATATAAAACGATCTT
TCAAATGACGAGTACGATTCAATCAGAACTATTAGATTCAATCGAATGGAAAGATATTTTTAAAGAACTTTTTCCAGGTG
GATCGATCACAGGAGCACCAAAACTTAGAGCGATGCAACTGATTCAAGAGTTAGAAAAACCCAGAGGAGTTTATACCGGA
GCAATCGGAGTAATTCAACCAAACCAAAACGCAGTTTTTTCGATCGGAATCCGAACTTTAGAATTAAAAAAAGGAAAAGG
AAATATTGGAATCGGTTCGGGGATTACTTGGGATTCTGATCCTGAAAAAGAATGGCTTGAAATTTTAGAAAAAGCAAAAT
TTTTTACGGAAGCTTCCAACAAATTCTCTCTTTTTGAAACCATACTTTATAAAAATGGAATATTTTATTTTCAAAAAGAA
CATTTAAAAAGGATCAAAAATTCAGCAAAAACATTCGGATTTCCTTTTTCCGAACAAGAATGGATTTCTTGTTTGAAAAA
AGTTTCCACAAATTGCATAAGCTCTAATACTTATCGAGTAAAGATCAGTTTAAATTATCTCGGAAAATTTACACTTGAGT
TTCAAACACTCGAAAACTTCCCCAAAAAAGGAACATTAAAAATATGTAATACTTTGATGAATTCTTCTTCCGAATTCAGA
AAACACAAAACAAATCTAAGAGAAATATACGACCGGGAAGGAAAACGTTCTAGAGAAGCGGGTCATCTTGATATTTTATT
TTTGAATGAAAAAAAAGAAATCACCGAAGGAAGTATCAGTAATATTTTCGTAAAAATTGGAAATTCTTACTTTACCCCCC
CGGTGTCTTCAGGTTTACTTCCCGGTATTTTTAGAAACCGCCTTTTAAAACGAAAAGGATTTTACGAGAAAACTCTTTCT
TTGGATGATTTGTTTCGATCAAATTCGGTATTTCTATGCAATTCTCTTAGAGGAATTTTAAGAGTAAAAGAAGTTTATAA
TTTCATAAAAGAATAA

Upstream 100 bases:

>100_bases
ATAATAGATCATTCCAGAAATAAAAATGATTCCGCAGATCTTTACGATTTCTTTGAAACGAAGAGACAAAATGATCAATC
CAAATTAAATTTGTTCTATA

Downstream 100 bases:

>100_bases
CGTAGGAATCTAGTTGCGTAAACCCAAAAGGATTCTAAACTTTAAGTATGAGAACTTTTCTCGGAATCTCTATTCCAGAA
GAAATAAAAGAACAATTAAC

Product: para-aminobenzoate synthase component I

Products: NA

Alternate protein names: ADC synthase; Para-aminobenzoate synthase component I [H]

Number of amino acids: Translated: 591; Mature: 591

Protein sequence:

>591_residues
MRIEELLFSDQPFMIFDEGFHPFGKIIFRNPIKTIEVYHLDTLLTSLNEINVYIKQGYYVAGFISYEAGYFFSDMNWKKI
DTVLPLLYFAVFQNPEKFPEIETGPSQNYGFYISSIPNRKTYFENLDMIRTKLYQGEIYQINYTDKIFFDFEGDILSFYK
TLSERQPVPYGSWIRTYDWDILSFSPELFFEKKEKTLITKPMKGTYPRGKSPKEDKKNAEALINSDKEKAENLMITDLMR
NDLGKISKEGSVHVQNLFSVEKYKTIFQMTSTIQSELLDSIEWKDIFKELFPGGSITGAPKLRAMQLIQELEKPRGVYTG
AIGVIQPNQNAVFSIGIRTLELKKGKGNIGIGSGITWDSDPEKEWLEILEKAKFFTEASNKFSLFETILYKNGIFYFQKE
HLKRIKNSAKTFGFPFSEQEWISCLKKVSTNCISSNTYRVKISLNYLGKFTLEFQTLENFPKKGTLKICNTLMNSSSEFR
KHKTNLREIYDREGKRSREAGHLDILFLNEKKEITEGSISNIFVKIGNSYFTPPVSSGLLPGIFRNRLLKRKGFYEKTLS
LDDLFRSNSVFLCNSLRGILRVKEVYNFIKE

Sequences:

>Translated_591_residues
MRIEELLFSDQPFMIFDEGFHPFGKIIFRNPIKTIEVYHLDTLLTSLNEINVYIKQGYYVAGFISYEAGYFFSDMNWKKI
DTVLPLLYFAVFQNPEKFPEIETGPSQNYGFYISSIPNRKTYFENLDMIRTKLYQGEIYQINYTDKIFFDFEGDILSFYK
TLSERQPVPYGSWIRTYDWDILSFSPELFFEKKEKTLITKPMKGTYPRGKSPKEDKKNAEALINSDKEKAENLMITDLMR
NDLGKISKEGSVHVQNLFSVEKYKTIFQMTSTIQSELLDSIEWKDIFKELFPGGSITGAPKLRAMQLIQELEKPRGVYTG
AIGVIQPNQNAVFSIGIRTLELKKGKGNIGIGSGITWDSDPEKEWLEILEKAKFFTEASNKFSLFETILYKNGIFYFQKE
HLKRIKNSAKTFGFPFSEQEWISCLKKVSTNCISSNTYRVKISLNYLGKFTLEFQTLENFPKKGTLKICNTLMNSSSEFR
KHKTNLREIYDREGKRSREAGHLDILFLNEKKEITEGSISNIFVKIGNSYFTPPVSSGLLPGIFRNRLLKRKGFYEKTLS
LDDLFRSNSVFLCNSLRGILRVKEVYNFIKE
>Mature_591_residues
MRIEELLFSDQPFMIFDEGFHPFGKIIFRNPIKTIEVYHLDTLLTSLNEINVYIKQGYYVAGFISYEAGYFFSDMNWKKI
DTVLPLLYFAVFQNPEKFPEIETGPSQNYGFYISSIPNRKTYFENLDMIRTKLYQGEIYQINYTDKIFFDFEGDILSFYK
TLSERQPVPYGSWIRTYDWDILSFSPELFFEKKEKTLITKPMKGTYPRGKSPKEDKKNAEALINSDKEKAENLMITDLMR
NDLGKISKEGSVHVQNLFSVEKYKTIFQMTSTIQSELLDSIEWKDIFKELFPGGSITGAPKLRAMQLIQELEKPRGVYTG
AIGVIQPNQNAVFSIGIRTLELKKGKGNIGIGSGITWDSDPEKEWLEILEKAKFFTEASNKFSLFETILYKNGIFYFQKE
HLKRIKNSAKTFGFPFSEQEWISCLKKVSTNCISSNTYRVKISLNYLGKFTLEFQTLENFPKKGTLKICNTLMNSSSEFR
KHKTNLREIYDREGKRSREAGHLDILFLNEKKEITEGSISNIFVKIGNSYFTPPVSSGLLPGIFRNRLLKRKGFYEKTLS
LDDLFRSNSVFLCNSLRGILRVKEVYNFIKE

Specific function: Catalyzes the biosynthesis of 4-amino-4-deoxychorismate (ADC) from chorismate and glutamine [H]

COG id: COG0147

COG function: function code EH; Anthranilate/para-aminobenzoate synthases component I

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the anthranilate synthase component I family [H]

Homologues:

Organism=Escherichia coli, GI1788114, Length=255, Percent_Identity=39.6078431372549, Blast_Score=191, Evalue=8e-50,
Organism=Escherichia coli, GI1787518, Length=283, Percent_Identity=27.9151943462898, Blast_Score=128, Evalue=1e-30,
Organism=Escherichia coli, GI87082077, Length=192, Percent_Identity=26.0416666666667, Blast_Score=70, Evalue=3e-13,
Organism=Escherichia coli, GI1786809, Length=208, Percent_Identity=25, Blast_Score=65, Evalue=2e-11,
Organism=Saccharomyces cerevisiae, GI6320935, Length=351, Percent_Identity=29.9145299145299, Blast_Score=143, Evalue=7e-35,
Organism=Saccharomyces cerevisiae, GI6324361, Length=272, Percent_Identity=29.7794117647059, Blast_Score=112, Evalue=2e-25,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR005801
- InterPro:   IPR019999
- InterPro:   IPR006805
- InterPro:   IPR015890
- InterPro:   IPR005802 [H]

Pfam domain/function: PF04715 Anth_synt_I_N; PF00425 Chorismate_bind [H]

EC number: =2.6.1.85 [H]

Molecular weight: Translated: 68690; Mature: 68690

Theoretical pI: Translated: 9.39; Mature: 9.39

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.7 %Cys     (Translated Protein)
1.7 %Met     (Translated Protein)
2.4 %Cys+Met (Translated Protein)
0.7 %Cys     (Mature Protein)
1.7 %Met     (Mature Protein)
2.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MRIEELLFSDQPFMIFDEGFHPFGKIIFRNPIKTIEVYHLDTLLTSLNEINVYIKQGYYV
CCHHHHHHCCCCEEEEECCCCHHHHHHCCCCCCEEEEEEHHHHHHHHHHEEEEEECCEEE
AGFISYEAGYFFSDMNWKKIDTVLPLLYFAVFQNPEKFPEIETGPSQNYGFYISSIPNRK
EEEEEECCCEEECCCCHHHHHHHHHHHHHHHHCCHHHCCCCCCCCCCCCCEEEECCCCCH
TYFENLDMIRTKLYQGEIYQINYTDKIFFDFEGDILSFYKTLSERQPVPYGSWIRTYDWD
HHHHHHHHHHHHHHCCCEEEEECCEEEEEEECCHHHHHHHHHHHCCCCCCCCCEEEECCC
ILSFSPELFFEKKEKTLITKPMKGTYPRGKSPKEDKKNAEALINSDKEKAENLMITDLMR
CEECCHHHHHCCCCCEEEECCCCCCCCCCCCCCHHHHHHHHHHCCCHHHHHHHHHHHHHH
NDLGKISKEGSVHVQNLFSVEKYKTIFQMTSTIQSELLDSIEWKDIFKELFPGGSITGAP
HHHHHCCCCCCEEHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHCCCCCCCCCC
KLRAMQLIQELEKPRGVYTGAIGVIQPNQNAVFSIGIRTLELKKGKGNIGIGSGITWDSD
HHHHHHHHHHHHCCCCEEECEEEEEECCCCCEEEEEEEEEEEECCCCCCCCCCCCCCCCC
PEKEWLEILEKAKFFTEASNKFSLFETILYKNGIFYFQKEHLKRIKNSAKTFGFPFSEQE
CHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHCCEEEEEHHHHHHHHHHHHHCCCCCCHHH
WISCLKKVSTNCISSNTYRVKISLNYLGKFTLEFQTLENFPKKGTLKICNTLMNSSSEFR
HHHHHHHHHHHHCCCCEEEEEEEEEECEEEEEEEEHHHCCCCCCHHHHHHHHHCCHHHHH
KHKTNLREIYDREGKRSREAGHLDILFLNEKKEITEGSISNIFVKIGNSYFTPPVSSGLL
HHHHHHHHHHHCCCCCCCCCCCEEEEEECCCCCCCCCCHHEEEEEECCCCCCCCCCCCCC
PGIFRNRLLKRKGFYEKTLSLDDLFRSNSVFLCNSLRGILRVKEVYNFIKE
CHHHHHHHHHHCCCHHHHCCHHHHHCCCCEEEEHHHHHHHHHHHHHHHHCC
>Mature Secondary Structure
MRIEELLFSDQPFMIFDEGFHPFGKIIFRNPIKTIEVYHLDTLLTSLNEINVYIKQGYYV
CCHHHHHHCCCCEEEEECCCCHHHHHHCCCCCCEEEEEEHHHHHHHHHHEEEEEECCEEE
AGFISYEAGYFFSDMNWKKIDTVLPLLYFAVFQNPEKFPEIETGPSQNYGFYISSIPNRK
EEEEEECCCEEECCCCHHHHHHHHHHHHHHHHCCHHHCCCCCCCCCCCCCEEEECCCCCH
TYFENLDMIRTKLYQGEIYQINYTDKIFFDFEGDILSFYKTLSERQPVPYGSWIRTYDWD
HHHHHHHHHHHHHHCCCEEEEECCEEEEEEECCHHHHHHHHHHHCCCCCCCCCEEEECCC
ILSFSPELFFEKKEKTLITKPMKGTYPRGKSPKEDKKNAEALINSDKEKAENLMITDLMR
CEECCHHHHHCCCCCEEEECCCCCCCCCCCCCCHHHHHHHHHHCCCHHHHHHHHHHHHHH
NDLGKISKEGSVHVQNLFSVEKYKTIFQMTSTIQSELLDSIEWKDIFKELFPGGSITGAP
HHHHHCCCCCCEEHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHCCCCCCCCCC
KLRAMQLIQELEKPRGVYTGAIGVIQPNQNAVFSIGIRTLELKKGKGNIGIGSGITWDSD
HHHHHHHHHHHHCCCCEEECEEEEEECCCCCEEEEEEEEEEEECCCCCCCCCCCCCCCCC
PEKEWLEILEKAKFFTEASNKFSLFETILYKNGIFYFQKEHLKRIKNSAKTFGFPFSEQE
CHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHCCEEEEEHHHHHHHHHHHHHCCCCCCHHH
WISCLKKVSTNCISSNTYRVKISLNYLGKFTLEFQTLENFPKKGTLKICNTLMNSSSEFR
HHHHHHHHHHHHCCCCEEEEEEEEEECEEEEEEEEHHHCCCCCCHHHHHHHHHCCHHHHH
KHKTNLREIYDREGKRSREAGHLDILFLNEKKEITEGSISNIFVKIGNSYFTPPVSSGLL
HHHHHHHHHHHCCCCCCCCCCCEEEEEECCCCCCCCCCHHEEEEEECCCCCCCCCCCCCC
PGIFRNRLLKRKGFYEKTLSLDDLFRSNSVFLCNSLRGILRVKEVYNFIKE
CHHHHHHHHHHCCCHHHHCCHHHHHCCCCEEEEHHHHHHHHHHHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 3057324; 11677609; 2251281 [H]