Definition Corynebacterium diphtheriae NCTC 13129 chromosome, complete genome.
Accession NC_002935
Length 2,488,635

Click here to switch to the map view.

The map label for this gene is pab [H]

Identifier: 38234361

GI number: 38234361

Start: 1836842

End: 1839373

Strand: Reverse

Name: pab [H]

Synonym: DIP1790

Alternate gene names: 38234361

Gene position: 1839373-1836842 (Counterclockwise)

Preceding gene: 38234362

Following gene: 38234360

Centisome position: 73.91

GC content: 58.65

Gene sequence:

>2532_bases
GTGGTTATGCAACGCGCGCATATTTTGGTGGTGGATAATTTCGATTCCTTCACCTACAACATCGTCGACTACCTCCACCG
CTGCGGGGCCCGCACCCACGTGGTCACCAACAACGTATCCCCAGAGGACATTGATCTAGACCGCTACCACGGAATAGTCA
TCTCACCAGGTCCAGGGCATCCCAGTGTGGCAGAAGACGTCGGCATAAGCGCGTGGGTATTACAAACAGCACAGTGCCCA
GTGCTGGGCGTGTGCTTAGGTATGCAGCTGATGGTCACAAGCGAAGGGGGCTGCGTTGATCGTGCGCCGGAGGCTGTCCA
CGGACGCGTAGATACCTTAAATATTGTTGCCGCCGATGAGCTTTTTGCTGGTCTACCTCGGACGTTTTCGATCGTCCGCT
ATCATTCGCTCGCCGCGATCACAGTACCACCCAGCATGGAAGTCACATCTTCTAATCCCGAGGGGATTGTGATGTCGATA
CGTCATCGCAGCAGCCCATGGTGGGGAGTGCAGTTTCATCCGGAATCGATTGCCGGCGATTTCGGTGTGGAGATCATTGA
CCGCTTTGTTGACCTATGCACACCGCAGTATCGCACCGATGAAGTGGAGCTTTGCTGCAGCCCTGTGGAGCTTTTCCATG
CGTTGGGCGGCAGGGGAGCACTGCTGGAATTTGAAGGCACGGCTATCATTGCGATTCCGAGTGGGCAGGTAGCGCACCAC
ATTGAGGAGCTGGAAGTTTCTGGTATTTCGGTGGCCCCGGAGGCATGGGCGCCGCCGGGTTGGTACGGCTACATTGGCTA
CGAGGCTAACGACGCTACCTTTGGCACTGCGGTCCATGCGCCAAAGCCGGCGGAATTTCCCACGACTGCCATGATGTATT
GCACGGAAGTTATTGCGATCCGTGGGGATCGTGCCCAAATCACCGCGCCGAGTTCGCGCTGGGGCCGGTTACGGGATGCG
GTCGTGGCGGCGTCGAAAAGCGTGCCCACGGTGCCGAGTTTCAACCCGACTGGTATCGGGCGGTTGCACGTACGCGACTC
CCGAGAACGCTACATGGCTACGATCGAGCGGATCCAAGAAGCGATTCGAGCCGGCGAAACATATGAAGTCTGCCTGACCA
CCGAACTATTCGCCGAAGTACACGGTGAGGTCCATCCGGCGGCAATGTATCAAGCGCTGAGCACCGCAGTACCTGCGCCT
ATGCGTTCGCTGGTTGTCACCGATGATGTAGCAGTGATTTCCGCGTCACCAGAACGATTTATCACCATGAACGACCGCAT
GGTGTCGTCCTCACCGATCAAAGGAACCAGAAAACGCAGCGCCGACCGCGAAGAAGACCGCGCCTTGGCCGACGATCTGC
GCACCAACCCCAAAGACCGCGCCGAAAACCTCATGATCGTCGACCTTGTGCGCAACGACCTCGCCCGCGTCTGCGAATCA
GGCAGCGTCCGTGTGCCAGAACTATGTGCACTGCACAGCTTTACCACCGTGCACCAGCTGATTTCTACCGTCGAAGGGCA
ACTTCGCCCCACCAGCATGCCTATCGACGTCCTACGCGCCACCTTCCCAGGCGGTTCCATGACTGGGGCGCCCAAACACC
GCACCATGCACCTCATCACCGAGCTCGAAGGCAAACAACGCGGGGTTTACTCCGGATGCATTGGTTATATCGGCGACGAT
CTCCGCACCGATCTTGCTATGGTCATCCGCACCGTCGTGCTCACACCCACCACCTTGAGCTATGGGGTAGGAGGTGCCAT
CATCGCGCTTTCAGACCCCGCCGAAGAATGGGCAGAAATCACCACAAAATCCCGGGTGCTTCTCGACCTACTCGGGCAAG
ATTTCCCACAATCGCTCATCATCGATTCTTTCCTCGTCAACGACGGGAAAACCCGCGGACTCAACCTGCACCTCGACCGC
TTCCGCACTGCTTGCCTAGAACACGGCTATGCCCACCACGAGCAACTCGACGCCTTTTTCGCAGAGGCACTCAGAAGCAT
CCCCGCCACAGGGCAGTGGTTCCCGCGCCTTGAAGCCACACCCACCGAACTACGTATCGCGCTTCGGCCCGCCCCTCAGC
TACGCGGCACCACAACGCTGACCTCGGTGGCGGCAGTACGCCCCACCCCGAAGTACAAAGGCCTCGACCTTGACTACCTC
GCCGAACTGCGGTGCAGTAGCACTACTGACGACGCCCTCCTGGTCACACCAGCCGGTGTGATTGCCGAAACCACCACAGC
CGCCATCATCGCCTGGGACGGCACCAAGTGGATGAGCATGGCCCCAGCCCGATTGGAATCTGTGACTGAATCCCTGCTGA
TCAACAGCGCTCGCGCCCAAGGCGAGATGGTAGTTACTGCAGCCTTGACAGTGCCCGAGGCACAGAAACTCAACCTGTGG
GCGGTGAACTCCCTCCACGGCGTGACCCCCGTGACGCACATTGATGAGGTAGCACTTCCCAGCAATCCCCAGCGCAGTGC
GTTGCTACGCGGATGGTTGTCACAATCTGAGGAGAATATCGCCCAAGTGTGA

Upstream 100 bases:

>100_bases
CTCAACGGCTAACGGCTAAGCTCTCATCCCCGGGCCCCGCAGGAACCTCCGCACGTGTCTGGGGATTTTTGCGTCGATAG
GGTGGCACAAGGAACAATCG

Downstream 100 bases:

>100_bases
CAGTCGGGCGCCCACTTAGTTTGACGCACCCAGTAGAGTATTGAGGTGTTTGGTAATGAAGGAAACTGCAATTACCATCG
AACTTCCTCTTTACGGGAAT

Product: glutamine amidotransferase protein

Products: NA

Alternate protein names: P-aminobenzoic acid synthase; PABA synthase [H]

Number of amino acids: Translated: 843; Mature: 843

Protein sequence:

>843_residues
MVMQRAHILVVDNFDSFTYNIVDYLHRCGARTHVVTNNVSPEDIDLDRYHGIVISPGPGHPSVAEDVGISAWVLQTAQCP
VLGVCLGMQLMVTSEGGCVDRAPEAVHGRVDTLNIVAADELFAGLPRTFSIVRYHSLAAITVPPSMEVTSSNPEGIVMSI
RHRSSPWWGVQFHPESIAGDFGVEIIDRFVDLCTPQYRTDEVELCCSPVELFHALGGRGALLEFEGTAIIAIPSGQVAHH
IEELEVSGISVAPEAWAPPGWYGYIGYEANDATFGTAVHAPKPAEFPTTAMMYCTEVIAIRGDRAQITAPSSRWGRLRDA
VVAASKSVPTVPSFNPTGIGRLHVRDSRERYMATIERIQEAIRAGETYEVCLTTELFAEVHGEVHPAAMYQALSTAVPAP
MRSLVVTDDVAVISASPERFITMNDRMVSSSPIKGTRKRSADREEDRALADDLRTNPKDRAENLMIVDLVRNDLARVCES
GSVRVPELCALHSFTTVHQLISTVEGQLRPTSMPIDVLRATFPGGSMTGAPKHRTMHLITELEGKQRGVYSGCIGYIGDD
LRTDLAMVIRTVVLTPTTLSYGVGGAIIALSDPAEEWAEITTKSRVLLDLLGQDFPQSLIIDSFLVNDGKTRGLNLHLDR
FRTACLEHGYAHHEQLDAFFAEALRSIPATGQWFPRLEATPTELRIALRPAPQLRGTTTLTSVAAVRPTPKYKGLDLDYL
AELRCSSTTDDALLVTPAGVIAETTTAAIIAWDGTKWMSMAPARLESVTESLLINSARAQGEMVVTAALTVPEAQKLNLW
AVNSLHGVTPVTHIDEVALPSNPQRSALLRGWLSQSEENIAQV

Sequences:

>Translated_843_residues
MVMQRAHILVVDNFDSFTYNIVDYLHRCGARTHVVTNNVSPEDIDLDRYHGIVISPGPGHPSVAEDVGISAWVLQTAQCP
VLGVCLGMQLMVTSEGGCVDRAPEAVHGRVDTLNIVAADELFAGLPRTFSIVRYHSLAAITVPPSMEVTSSNPEGIVMSI
RHRSSPWWGVQFHPESIAGDFGVEIIDRFVDLCTPQYRTDEVELCCSPVELFHALGGRGALLEFEGTAIIAIPSGQVAHH
IEELEVSGISVAPEAWAPPGWYGYIGYEANDATFGTAVHAPKPAEFPTTAMMYCTEVIAIRGDRAQITAPSSRWGRLRDA
VVAASKSVPTVPSFNPTGIGRLHVRDSRERYMATIERIQEAIRAGETYEVCLTTELFAEVHGEVHPAAMYQALSTAVPAP
MRSLVVTDDVAVISASPERFITMNDRMVSSSPIKGTRKRSADREEDRALADDLRTNPKDRAENLMIVDLVRNDLARVCES
GSVRVPELCALHSFTTVHQLISTVEGQLRPTSMPIDVLRATFPGGSMTGAPKHRTMHLITELEGKQRGVYSGCIGYIGDD
LRTDLAMVIRTVVLTPTTLSYGVGGAIIALSDPAEEWAEITTKSRVLLDLLGQDFPQSLIIDSFLVNDGKTRGLNLHLDR
FRTACLEHGYAHHEQLDAFFAEALRSIPATGQWFPRLEATPTELRIALRPAPQLRGTTTLTSVAAVRPTPKYKGLDLDYL
AELRCSSTTDDALLVTPAGVIAETTTAAIIAWDGTKWMSMAPARLESVTESLLINSARAQGEMVVTAALTVPEAQKLNLW
AVNSLHGVTPVTHIDEVALPSNPQRSALLRGWLSQSEENIAQV
>Mature_843_residues
MVMQRAHILVVDNFDSFTYNIVDYLHRCGARTHVVTNNVSPEDIDLDRYHGIVISPGPGHPSVAEDVGISAWVLQTAQCP
VLGVCLGMQLMVTSEGGCVDRAPEAVHGRVDTLNIVAADELFAGLPRTFSIVRYHSLAAITVPPSMEVTSSNPEGIVMSI
RHRSSPWWGVQFHPESIAGDFGVEIIDRFVDLCTPQYRTDEVELCCSPVELFHALGGRGALLEFEGTAIIAIPSGQVAHH
IEELEVSGISVAPEAWAPPGWYGYIGYEANDATFGTAVHAPKPAEFPTTAMMYCTEVIAIRGDRAQITAPSSRWGRLRDA
VVAASKSVPTVPSFNPTGIGRLHVRDSRERYMATIERIQEAIRAGETYEVCLTTELFAEVHGEVHPAAMYQALSTAVPAP
MRSLVVTDDVAVISASPERFITMNDRMVSSSPIKGTRKRSADREEDRALADDLRTNPKDRAENLMIVDLVRNDLARVCES
GSVRVPELCALHSFTTVHQLISTVEGQLRPTSMPIDVLRATFPGGSMTGAPKHRTMHLITELEGKQRGVYSGCIGYIGDD
LRTDLAMVIRTVVLTPTTLSYGVGGAIIALSDPAEEWAEITTKSRVLLDLLGQDFPQSLIIDSFLVNDGKTRGLNLHLDR
FRTACLEHGYAHHEQLDAFFAEALRSIPATGQWFPRLEATPTELRIALRPAPQLRGTTTLTSVAAVRPTPKYKGLDLDYL
AELRCSSTTDDALLVTPAGVIAETTTAAIIAWDGTKWMSMAPARLESVTESLLINSARAQGEMVVTAALTVPEAQKLNLW
AVNSLHGVTPVTHIDEVALPSNPQRSALLRGWLSQSEENIAQV

Specific function: Catalyzes the biosynthesis of 4-amino-4-deoxychorismate (ADC) from chorismate and glutamine [H]

COG id: COG0147

COG function: function code EH; Anthranilate/para-aminobenzoate synthases component I

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 glutamine amidotransferase type-1 domain [H]

Homologues:

Organism=Escherichia coli, GI1788114, Length=265, Percent_Identity=40.377358490566, Blast_Score=187, Evalue=2e-48,
Organism=Escherichia coli, GI1787518, Length=308, Percent_Identity=32.1428571428571, Blast_Score=150, Evalue=3e-37,
Organism=Escherichia coli, GI1789760, Length=188, Percent_Identity=38.2978723404255, Blast_Score=116, Evalue=5e-27,
Organism=Escherichia coli, GI1787517, Length=190, Percent_Identity=34.2105263157895, Blast_Score=109, Evalue=6e-25,
Organism=Escherichia coli, GI1786809, Length=207, Percent_Identity=24.1545893719807, Blast_Score=74, Evalue=4e-14,
Organism=Escherichia coli, GI87082077, Length=313, Percent_Identity=20.7667731629393, Blast_Score=67, Evalue=4e-12,
Organism=Saccharomyces cerevisiae, GI6320935, Length=222, Percent_Identity=41.4414414414414, Blast_Score=169, Evalue=1e-42,
Organism=Saccharomyces cerevisiae, GI6324361, Length=381, Percent_Identity=29.3963254593176, Blast_Score=143, Evalue=1e-34,
Organism=Saccharomyces cerevisiae, GI6322638, Length=193, Percent_Identity=37.3056994818653, Blast_Score=127, Evalue=5e-30,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR005801
- InterPro:   IPR006805
- InterPro:   IPR006220
- InterPro:   IPR001317
- InterPro:   IPR015890
- InterPro:   IPR011702
- InterPro:   IPR017926
- InterPro:   IPR000991
- InterPro:   IPR005802
- InterPro:   IPR006221 [H]

Pfam domain/function: PF04715 Anth_synt_I_N; PF00425 Chorismate_bind; PF00117 GATase [H]

EC number: =2.6.1.85 [H]

Molecular weight: Translated: 91777; Mature: 91777

Theoretical pI: Translated: 5.26; Mature: 5.26

Prosite motif: PS00063 ALDOKETO_REDUCTASE_3 ; PS00442 GATASE_TYPE_I

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.7 %Cys     (Translated Protein)
2.5 %Met     (Translated Protein)
4.2 %Cys+Met (Translated Protein)
1.7 %Cys     (Mature Protein)
2.5 %Met     (Mature Protein)
4.2 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MVMQRAHILVVDNFDSFTYNIVDYLHRCGARTHVVTNNVSPEDIDLDRYHGIVISPGPGH
CCCEEEEEEEEECCCCHHHHHHHHHHHCCCCEEEEECCCCCCCCCHHHHCCEEEECCCCC
PSVAEDVGISAWVLQTAQCPVLGVCLGMQLMVTSEGGCVDRAPEAVHGRVDTLNIVAADE
CCHHHHCCCCEEEHCCCCCCHHHHHHCCEEEEECCCCCCCCCCHHHCCCCEEEEEEEHHH
LFAGLPRTFSIVRYHSLAAITVPPSMEVTSSNPEGIVMSIRHRSSPWWGVQFHPESIAGD
HHHCCCCHHHHEEEEEEEEEECCCCCEECCCCCCCEEEEEEECCCCEEEEEECHHHHCCC
FGVEIIDRFVDLCTPQYRTDEVELCCSPVELFHALGGRGALLEFEGTAIIAIPSGQVAHH
CCHHHHHHHHHHCCCCCCCCHHHHCCCHHHHHHHCCCCCEEEEECCEEEEEECCCHHHHH
IEELEVSGISVAPEAWAPPGWYGYIGYEANDATFGTAVHAPKPAEFPTTAMMYCTEVIAI
HHHHHCCCEEECCCCCCCCCCEEEEEEECCCCCCCCEECCCCCCCCCHHHHHHHHHHHHC
RGDRAQITAPSSRWGRLRDAVVAASKSVPTVPSFNPTGIGRLHVRDSRERYMATIERIQE
CCCCCEEECCCHHHHHHHHHHHHHCCCCCCCCCCCCCCCEEEEECCHHHHHHHHHHHHHH
AIRAGETYEVCLTTELFAEVHGEVHPAAMYQALSTAVPAPMRSLVVTDDVAVISASPERF
HHHCCCEEEEEEHHHHHHHHCCCCCHHHHHHHHHHHCCCCHHHEEEECCEEEEECCCCEE
ITMNDRMVSSSPIKGTRKRSADREEDRALADDLRTNPKDRAENLMIVDLVRNDLARVCES
EEECCCEECCCCCCCCHHCCCCCHHHHHHHHHHCCCCHHHHCCEEEEHHHHHHHHHHHCC
GSVRVPELCALHSFTTVHQLISTVEGQLRPTSMPIDVLRATFPGGSMTGAPKHRTMHLIT
CCCCCCHHHHHHHHHHHHHHHHHHCCCCCCCCCCHHHHEEECCCCCCCCCCCCCEEEEEE
ELEGKQRGVYSGCIGYIGDDLRTDLAMVIRTVVLTPTTLSYGVGGAIIALSDPAEEWAEI
CCCCCCCCHHHHHHHHCCCHHHHHHHHHHHHHHHCCCHHCCCCCEEEEEECCCHHHHHHH
TTKSRVLLDLLGQDFPQSLIIDSFLVNDGKTRGLNLHLDRFRTACLEHGYAHHEQLDAFF
HHHHHHHHHHHCCCCCHHHHHHHHHCCCCCCCCEEEEHHHHHHHHHHCCCHHHHHHHHHH
AEALRSIPATGQWFPRLEATPTELRIALRPAPQLRGTTTLTSVAAVRPTPKYKGLDLDYL
HHHHHHCCCCCCCCCCCCCCCCCEEEEECCCCCCCCCHHHHHHEEECCCCCCCCCCHHHH
AELRCSSTTDDALLVTPAGVIAETTTAAIIAWDGTKWMSMAPARLESVTESLLINSARAQ
HHHHCCCCCCCEEEEECCCHHCCCCEEEEEEECCCCHHHCCHHHHHHHHHHHHHHHHCCC
GEMVVTAALTVPEAQKLNLWAVNSLHGVTPVTHIDEVALPSNPQRSALLRGWLSQSEENI
CCEEEEEEEECCCCCCCEEEEECCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHCCHHHH
AQV
HCC
>Mature Secondary Structure
MVMQRAHILVVDNFDSFTYNIVDYLHRCGARTHVVTNNVSPEDIDLDRYHGIVISPGPGH
CCCEEEEEEEEECCCCHHHHHHHHHHHCCCCEEEEECCCCCCCCCHHHHCCEEEECCCCC
PSVAEDVGISAWVLQTAQCPVLGVCLGMQLMVTSEGGCVDRAPEAVHGRVDTLNIVAADE
CCHHHHCCCCEEEHCCCCCCHHHHHHCCEEEEECCCCCCCCCCHHHCCCCEEEEEEEHHH
LFAGLPRTFSIVRYHSLAAITVPPSMEVTSSNPEGIVMSIRHRSSPWWGVQFHPESIAGD
HHHCCCCHHHHEEEEEEEEEECCCCCEECCCCCCCEEEEEEECCCCEEEEEECHHHHCCC
FGVEIIDRFVDLCTPQYRTDEVELCCSPVELFHALGGRGALLEFEGTAIIAIPSGQVAHH
CCHHHHHHHHHHCCCCCCCCHHHHCCCHHHHHHHCCCCCEEEEECCEEEEEECCCHHHHH
IEELEVSGISVAPEAWAPPGWYGYIGYEANDATFGTAVHAPKPAEFPTTAMMYCTEVIAI
HHHHHCCCEEECCCCCCCCCCEEEEEEECCCCCCCCEECCCCCCCCCHHHHHHHHHHHHC
RGDRAQITAPSSRWGRLRDAVVAASKSVPTVPSFNPTGIGRLHVRDSRERYMATIERIQE
CCCCCEEECCCHHHHHHHHHHHHHCCCCCCCCCCCCCCCEEEEECCHHHHHHHHHHHHHH
AIRAGETYEVCLTTELFAEVHGEVHPAAMYQALSTAVPAPMRSLVVTDDVAVISASPERF
HHHCCCEEEEEEHHHHHHHHCCCCCHHHHHHHHHHHCCCCHHHEEEECCEEEEECCCCEE
ITMNDRMVSSSPIKGTRKRSADREEDRALADDLRTNPKDRAENLMIVDLVRNDLARVCES
EEECCCEECCCCCCCCHHCCCCCHHHHHHHHHHCCCCHHHHCCEEEEHHHHHHHHHHHCC
GSVRVPELCALHSFTTVHQLISTVEGQLRPTSMPIDVLRATFPGGSMTGAPKHRTMHLIT
CCCCCCHHHHHHHHHHHHHHHHHHCCCCCCCCCCHHHHEEECCCCCCCCCCCCCEEEEEE
ELEGKQRGVYSGCIGYIGDDLRTDLAMVIRTVVLTPTTLSYGVGGAIIALSDPAEEWAEI
CCCCCCCCHHHHHHHHCCCHHHHHHHHHHHHHHHCCCHHCCCCCEEEEEECCCHHHHHHH
TTKSRVLLDLLGQDFPQSLIIDSFLVNDGKTRGLNLHLDRFRTACLEHGYAHHEQLDAFF
HHHHHHHHHHHCCCCCHHHHHHHHHCCCCCCCCEEEEHHHHHHHHHHCCCHHHHHHHHHH
AEALRSIPATGQWFPRLEATPTELRIALRPAPQLRGTTTLTSVAAVRPTPKYKGLDLDYL
HHHHHHCCCCCCCCCCCCCCCCCEEEEECCCCCCCCCHHHHHHEEECCCCCCCCCCHHHH
AELRCSSTTDDALLVTPAGVIAETTTAAIIAWDGTKWMSMAPARLESVTESLLINSARAQ
HHHHCCCCCCCEEEEECCCHHCCCCEEEEEEECCCCHHHCCHHHHHHHHHHHHHHHHCCC
GEMVVTAALTVPEAQKLNLWAVNSLHGVTPVTHIDEVALPSNPQRSALLRGWLSQSEENI
CCEEEEEEEECCCCCCCEEEEECCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHCCHHHH
AQV
HCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 8472954 [H]