Definition Sphingopyxis alaskensis RB2256, complete genome.
Accession NC_008048
Length 3,345,170

Click here to switch to the map view.

The map label for this gene is pabB [H]

Identifier: 103485667

GI number: 103485667

Start: 174007

End: 175845

Strand: Direct

Name: pabB [H]

Synonym: Sala_0171

Alternate gene names: 103485667

Gene position: 174007-175845 (Clockwise)

Preceding gene: 103485666

Following gene: 103485668

Centisome position: 5.2

GC content: 68.62

Gene sequence:

>1839_bases
ATGGCGGACAGGATTCCCGTTCGGGGGCCGAATAGCCCCCCCTTCGTGCTGCTCGACGATGCGCGCACCGACGGGGCGGC
TTGGGCGCGGCTCTTCGTCGATCCGATCGAGGTACTGACCGCTGCATCGGCCGCCGACGTGCCCGAGCTGCTCGCGGAGC
TGGAGGCCGCTGTGGCGCGTGGCCTCCATGTCGCGGGCTTCCTTGCCTATGAAGCCGGGAAGGGACTCGGAACGGCGTGG
CGCGGTGCCGTCGATGGCGTGGTCGGCGCGATGCCGCTCGGCTGGTTCGGCCTGTTCACCGGGGTGCAGCGCATCGACTC
CGATCATGTCGCAGATCTGCTGTCCGATCCGGCGTCGGCATGGATAGGCTGCGTGACGCCACGGATCGACCGCGCCGACT
ATGTCGCCGCGGTCGAGGCGGTGCTTGCCTATATCCGCGCAGGTGACATTTATCAGGCCAACCTCACCTTCCGCGCCGAT
GTGCCCGTCGCGGGGGATCCGCTCGCCGTTTACGCGCGGCTCCGGCAAACGGCGCGGGCGGGATATGGCGGCTTCATCTG
GACGGGCGAGCAGGCGATCGCATCGCTGTCCCCCGAACTTTTCTTTGCGCTGCGCGGGCGCGAGGTCATCGCGCGGCCGA
TGAAGGGTACCGCGACCCGGCTCGCAGATGGCGCCGCCGACGCGGCATTGGCGCGCGCGCTGGCCAAAGACCCCAAGCAG
CGCGCGGAAAATCTGATGATCGTCGACCTGATCCGCAACGATCTGTCGCGCGTTGCGGCGCCGGGCTCGGTCGCGGTGCC
CGACCTGTTTCGCGTCGAAAGCTTCCCGACGGTCCACCAGCTTGTGTCCGATGTCAGCGCCCGGCTGCCCGAGGGCGTCG
GCGCCGTCGACGTGCTCCGCGCGGCCTTTCCCTGCGGGTCGATCACCGGGGCGCCCAAGGTGCGCGCGATGGAAATCATC
GAGGCGCTGGAGAGCGAACCGCGCGGCCTTTATACGGGCTCGATCGGCTTTATCGAGCCGGGCGGCGATGCCGCATTCAA
CGTCGCGATCCGCACGCTCGTCTTTCCCCGCATTGCCACGCAAGGCGGGTTGCAGGACGCACCGTCATGCGCCACGCTGG
GTCTGGGGTCGGGAATCGTCGCCGACAGCGTGCCGGACGAAGAATGGCGCGAATGTCTGGCCAAGGGGGAATTTGTGGGC
GCAGCGGGTGAGAGCTTCGACCTGATTGAAACCATGTTTTTCGATCCCGTGGAGGGGATTCAGCGCCTCGATGGGCATCT
CGCGCGGATGAAGGCGAGCGCGGCGACGCTGGGCTTCGCCTTCGATCGCCACGGCGCGCGCAACAGCCTGCAATCTGCGA
CCTTCCGCCTGCGCAATGCGGCGCGCGTGCGAATGCGGCTCGCACCTTCGGGGGCGCTTGCGGTTGAGGTGTCGCCGCTT
CCCCGGCTCGCCGAACTGCCGGTACCCGTCGCGGTGCGTCCCGCGCCGATGGGGCCGGGCGATTTTCGCGTGGCGCACAA
GACGAGCCTGCGCGCCCCTTATGATATGGCGCGGCACGACAGCGGCGCCGCCGAAGTCGTGTTCGTCGACGAGCCGGGCT
TCGTTACCGAAGGAAGCTGGAGCAATATCTTCGTCGAGCGCGACGGGGTGCTGTTGACCCCGCCGCTGGCGCTCGGACTG
CTTCCCGGCGTGCTGCGCGGCGAACTCATCGACAAGGGGCGCGCCGTCGAATCGTACCTGCGCCTTGCCGACCTGTCCGC
CGGCTTCTTCCTCGGTAACAGCCTGCGCGGCCTGGTGCCGGCGCGGCTCGCCGAGCCTGCCGACGACGCGACAGGCTGA

Upstream 100 bases:

>100_bases
CATGGGCAGCTATTTTGCGACGATCGACGGCGGGCGCACGATCCGCATGAAGCGCGACCGCTGATTGCAGCCGGAAGGGG
CACGATGCACGCAGGACGGC

Downstream 100 bases:

>100_bases
ATCGCGCATCGCATAGGAAATTATCGCGCCGCCGCCTTGCGATTTGCGGGCGGAGGCTTTAGGCGCGGCCGCGCGCAATT
TCCTGTCAGTCCGCTCGCGA

Product: para-aminobenzoate synthase, component I

Products: NA

Alternate protein names: ADC synthase; Para-aminobenzoate synthase component I [H]

Number of amino acids: Translated: 612; Mature: 611

Protein sequence:

>612_residues
MADRIPVRGPNSPPFVLLDDARTDGAAWARLFVDPIEVLTAASAADVPELLAELEAAVARGLHVAGFLAYEAGKGLGTAW
RGAVDGVVGAMPLGWFGLFTGVQRIDSDHVADLLSDPASAWIGCVTPRIDRADYVAAVEAVLAYIRAGDIYQANLTFRAD
VPVAGDPLAVYARLRQTARAGYGGFIWTGEQAIASLSPELFFALRGREVIARPMKGTATRLADGAADAALARALAKDPKQ
RAENLMIVDLIRNDLSRVAAPGSVAVPDLFRVESFPTVHQLVSDVSARLPEGVGAVDVLRAAFPCGSITGAPKVRAMEII
EALESEPRGLYTGSIGFIEPGGDAAFNVAIRTLVFPRIATQGGLQDAPSCATLGLGSGIVADSVPDEEWRECLAKGEFVG
AAGESFDLIETMFFDPVEGIQRLDGHLARMKASAATLGFAFDRHGARNSLQSATFRLRNAARVRMRLAPSGALAVEVSPL
PRLAELPVPVAVRPAPMGPGDFRVAHKTSLRAPYDMARHDSGAAEVVFVDEPGFVTEGSWSNIFVERDGVLLTPPLALGL
LPGVLRGELIDKGRAVESYLRLADLSAGFFLGNSLRGLVPARLAEPADDATG

Sequences:

>Translated_612_residues
MADRIPVRGPNSPPFVLLDDARTDGAAWARLFVDPIEVLTAASAADVPELLAELEAAVARGLHVAGFLAYEAGKGLGTAW
RGAVDGVVGAMPLGWFGLFTGVQRIDSDHVADLLSDPASAWIGCVTPRIDRADYVAAVEAVLAYIRAGDIYQANLTFRAD
VPVAGDPLAVYARLRQTARAGYGGFIWTGEQAIASLSPELFFALRGREVIARPMKGTATRLADGAADAALARALAKDPKQ
RAENLMIVDLIRNDLSRVAAPGSVAVPDLFRVESFPTVHQLVSDVSARLPEGVGAVDVLRAAFPCGSITGAPKVRAMEII
EALESEPRGLYTGSIGFIEPGGDAAFNVAIRTLVFPRIATQGGLQDAPSCATLGLGSGIVADSVPDEEWRECLAKGEFVG
AAGESFDLIETMFFDPVEGIQRLDGHLARMKASAATLGFAFDRHGARNSLQSATFRLRNAARVRMRLAPSGALAVEVSPL
PRLAELPVPVAVRPAPMGPGDFRVAHKTSLRAPYDMARHDSGAAEVVFVDEPGFVTEGSWSNIFVERDGVLLTPPLALGL
LPGVLRGELIDKGRAVESYLRLADLSAGFFLGNSLRGLVPARLAEPADDATG
>Mature_611_residues
ADRIPVRGPNSPPFVLLDDARTDGAAWARLFVDPIEVLTAASAADVPELLAELEAAVARGLHVAGFLAYEAGKGLGTAWR
GAVDGVVGAMPLGWFGLFTGVQRIDSDHVADLLSDPASAWIGCVTPRIDRADYVAAVEAVLAYIRAGDIYQANLTFRADV
PVAGDPLAVYARLRQTARAGYGGFIWTGEQAIASLSPELFFALRGREVIARPMKGTATRLADGAADAALARALAKDPKQR
AENLMIVDLIRNDLSRVAAPGSVAVPDLFRVESFPTVHQLVSDVSARLPEGVGAVDVLRAAFPCGSITGAPKVRAMEIIE
ALESEPRGLYTGSIGFIEPGGDAAFNVAIRTLVFPRIATQGGLQDAPSCATLGLGSGIVADSVPDEEWRECLAKGEFVGA
AGESFDLIETMFFDPVEGIQRLDGHLARMKASAATLGFAFDRHGARNSLQSATFRLRNAARVRMRLAPSGALAVEVSPLP
RLAELPVPVAVRPAPMGPGDFRVAHKTSLRAPYDMARHDSGAAEVVFVDEPGFVTEGSWSNIFVERDGVLLTPPLALGLL
PGVLRGELIDKGRAVESYLRLADLSAGFFLGNSLRGLVPARLAEPADDATG

Specific function: Catalyzes the biosynthesis of 4-amino-4-deoxychorismate (ADC) from chorismate and glutamine [H]

COG id: COG0147

COG function: function code EH; Anthranilate/para-aminobenzoate synthases component I

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the anthranilate synthase component I family [H]

Homologues:

Organism=Escherichia coli, GI1788114, Length=278, Percent_Identity=45.6834532374101, Blast_Score=218, Evalue=7e-58,
Organism=Escherichia coli, GI1787518, Length=263, Percent_Identity=34.6007604562738, Blast_Score=130, Evalue=2e-31,
Organism=Saccharomyces cerevisiae, GI6320935, Length=264, Percent_Identity=36.3636363636364, Blast_Score=145, Evalue=2e-35,
Organism=Saccharomyces cerevisiae, GI6324361, Length=296, Percent_Identity=29.7297297297297, Blast_Score=102, Evalue=1e-22,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR005801
- InterPro:   IPR019999
- InterPro:   IPR006805
- InterPro:   IPR015890
- InterPro:   IPR005802 [H]

Pfam domain/function: PF04715 Anth_synt_I_N; PF00425 Chorismate_bind [H]

EC number: =2.6.1.85 [H]

Molecular weight: Translated: 64595; Mature: 64464

Theoretical pI: Translated: 4.91; Mature: 4.91

Prosite motif: PS00036 BZIP_BASIC ; PS00770 AA_TRANSFER_CLASS_4

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.7 %Cys     (Translated Protein)
1.6 %Met     (Translated Protein)
2.3 %Cys+Met (Translated Protein)
0.7 %Cys     (Mature Protein)
1.5 %Met     (Mature Protein)
2.1 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MADRIPVRGPNSPPFVLLDDARTDGAAWARLFVDPIEVLTAASAADVPELLAELEAAVAR
CCCCCCCCCCCCCCEEEEECCCCCHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHC
GLHVAGFLAYEAGKGLGTAWRGAVDGVVGAMPLGWFGLFTGVQRIDSDHVADLLSDPASA
CCHHHHEEEHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCHHHHHHHHCCHHHH
WIGCVTPRIDRADYVAAVEAVLAYIRAGDIYQANLTFRADVPVAGDPLAVYARLRQTARA
HHHHCCCCCCHHHHHHHHHHHHHHHHCCCEEEECEEEEECCCCCCCHHHHHHHHHHHHHC
GYGGFIWTGEQAIASLSPELFFALRGREVIARPMKGTATRLADGAADAALARALAKDPKQ
CCCCEEEECHHHHHHCCHHHEEEECCCHHHHCCCCCHHHHHHCCHHHHHHHHHHHCCHHH
RAENLMIVDLIRNDLSRVAAPGSVAVPDLFRVESFPTVHQLVSDVSARLPEGVGAVDVLR
HHCCEEEHHHHHHHHHHHCCCCCCCCCHHHHHCCCCHHHHHHHHHHHHCCCCCCHHHHHH
AAFPCGSITGAPKVRAMEIIEALESEPRGLYTGSIGFIEPGGDAAFNVAIRTLVFPRIAT
HHCCCCCCCCCCCHHHHHHHHHHHCCCCCEEECCCEEECCCCCHHHHHHHHHHHHHHHHC
QGGLQDAPSCATLGLGSGIVADSVPDEEWRECLAKGEFVGAAGESFDLIETMFFDPVEGI
CCCCCCCCCCCEECCCCCCCCCCCCCHHHHHHHHCCCEEECCCCCHHHHHHHHCCHHHHH
QRLDGHLARMKASAATLGFAFDRHGARNSLQSATFRLRNAARVRMRLAPSGALAVEVSPL
HHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHEEEEEECCCCCEEEEECCC
PRLAELPVPVAVRPAPMGPGDFRVAHKTSLRAPYDMARHDSGAAEVVFVDEPGFVTEGSW
CCHHHCCCCEEEECCCCCCCCEEEEHHCCCCCCHHHHHCCCCCEEEEEECCCCCEECCCC
SNIFVERDGVLLTPPLALGLLPGVLRGELIDKGRAVESYLRLADLSAGFFLGNSLRGLVP
CEEEEECCCEEECCHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHCCCCHHCCCCCCCCCH
ARLAEPADDATG
HHHCCCCCCCCC
>Mature Secondary Structure 
ADRIPVRGPNSPPFVLLDDARTDGAAWARLFVDPIEVLTAASAADVPELLAELEAAVAR
CCCCCCCCCCCCCEEEEECCCCCHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHC
GLHVAGFLAYEAGKGLGTAWRGAVDGVVGAMPLGWFGLFTGVQRIDSDHVADLLSDPASA
CCHHHHEEEHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCHHHHHHHHCCHHHH
WIGCVTPRIDRADYVAAVEAVLAYIRAGDIYQANLTFRADVPVAGDPLAVYARLRQTARA
HHHHCCCCCCHHHHHHHHHHHHHHHHCCCEEEECEEEEECCCCCCCHHHHHHHHHHHHHC
GYGGFIWTGEQAIASLSPELFFALRGREVIARPMKGTATRLADGAADAALARALAKDPKQ
CCCCEEEECHHHHHHCCHHHEEEECCCHHHHCCCCCHHHHHHCCHHHHHHHHHHHCCHHH
RAENLMIVDLIRNDLSRVAAPGSVAVPDLFRVESFPTVHQLVSDVSARLPEGVGAVDVLR
HHCCEEEHHHHHHHHHHHCCCCCCCCCHHHHHCCCCHHHHHHHHHHHHCCCCCCHHHHHH
AAFPCGSITGAPKVRAMEIIEALESEPRGLYTGSIGFIEPGGDAAFNVAIRTLVFPRIAT
HHCCCCCCCCCCCHHHHHHHHHHHCCCCCEEECCCEEECCCCCHHHHHHHHHHHHHHHHC
QGGLQDAPSCATLGLGSGIVADSVPDEEWRECLAKGEFVGAAGESFDLIETMFFDPVEGI
CCCCCCCCCCCEECCCCCCCCCCCCCHHHHHHHHCCCEEECCCCCHHHHHHHHCCHHHHH
QRLDGHLARMKASAATLGFAFDRHGARNSLQSATFRLRNAARVRMRLAPSGALAVEVSPL
HHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHEEEEEECCCCCEEEEECCC
PRLAELPVPVAVRPAPMGPGDFRVAHKTSLRAPYDMARHDSGAAEVVFVDEPGFVTEGSW
CCHHHCCCCEEEECCCCCCCCEEEEHHCCCCCCHHHHHCCCCCEEEEEECCCCCEECCCC
SNIFVERDGVLLTPPLALGLLPGVLRGELIDKGRAVESYLRLADLSAGFFLGNSLRGLVP
CEEEEECCCEEECCHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHCCCCHHCCCCCCCCCH
ARLAEPADDATG
HHHCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 3057324; 11677609; 2251281 [H]