Definition Gloeobacter violaceus PCC 7421 chromosome, complete genome.
Accession NC_005125
Length 4,659,019

Click here to switch to the map view.

The map label for this gene is est [H]

Identifier: 37521578

GI number: 37521578

Start: 2158611

End: 2159375

Strand: Reverse

Name: est [H]

Synonym: gll2009

Alternate gene names: 37521578

Gene position: 2159375-2158611 (Counterclockwise)

Preceding gene: 37521581

Following gene: 37521576

Centisome position: 46.35

GC content: 64.31

Gene sequence:

>765_bases
ATGCATCCGATGCTGGAGAACAAGCCCTTTTTTCTCAAAGCTTCCGCCGAGCGCGTGTGCCTATTGCTGCACGGGCTGGG
GGGTGGTCCTTACGAGATGCAGCCGCTGGCCGAATCGCTGTACGCACAGGGGCTTTCGGTGCTGGCGGTGGCCTATCCCG
GCCACGACAAACCCGCCCGCCGCATGCCCGCCTCCACGTGGCCCGAGTGGTACGGCCACATCGAGGCCACCTACCGCAAA
CTCGCAGGGGCGTTTGCAAGCATCAGCGTCGTCGGCTTCTCCACCGGCTGCCCGCTTGCTTTGCACCTGGCGGCGCACTG
GCCGGTGGCGAAACTGGTGCTGATCAGCCCCTTTGTCTCCGTACGCCACCGCTGGTTCTATCTGCTGCCGCCGGAGGCTT
ATCTGTACTCAGTAGGCCGGCTGTTGCCGCAGGTGCCGCGCCGACGTCTGCCGGTGCGCGACCGGGCGATGCGCGAGGCC
GCCGAACAAGCCGCCTACTACCGCACCTTCAACCTCTGCGCCGTGCGCAGCGCCCTTGCCCTTGTCGGCACGGTCAAAGC
GGAATTGTCCCTGGTGCGCTCTCCGTTACTTATCTTGCAGTCGCGCCGGGACAGCGTCGTGGCCCCCTCGGGGGCCGAGT
ATATCTACCGCCGGGTACGCTCTCGCGTCCGGCAATTGCACTGGTTTGACAAATCCGACCATATCCTGCCGCTCGATCTC
GAACGCAAAGAGGTCTACGAACGGGTGGGCCGATTTTTGCTTTGA

Upstream 100 bases:

>100_bases
GCCTCGGGGGGCGGGGACTAAACCCTCCGCCCGTGCGTTGCGGCACCTCCCGACGCGGGACTATGCTGAGGCGGCGCCCG
TTCCAACTCGGCCGCACCGA

Downstream 100 bases:

>100_bases
CGGTTGTTCAAAGAGCGTCCCCCGGCATCGCTTCGTGGGATGGCTTTTCGTCATTTACCTACAGCTCGATTGCAGTTGCA
GGGGTGGGGCACGTGTCGGA

Product: hypothetical protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 254; Mature: 254

Protein sequence:

>254_residues
MHPMLENKPFFLKASAERVCLLLHGLGGGPYEMQPLAESLYAQGLSVLAVAYPGHDKPARRMPASTWPEWYGHIEATYRK
LAGAFASISVVGFSTGCPLALHLAAHWPVAKLVLISPFVSVRHRWFYLLPPEAYLYSVGRLLPQVPRRRLPVRDRAMREA
AEQAAYYRTFNLCAVRSALALVGTVKAELSLVRSPLLILQSRRDSVVAPSGAEYIYRRVRSRVRQLHWFDKSDHILPLDL
ERKEVYERVGRFLL

Sequences:

>Translated_254_residues
MHPMLENKPFFLKASAERVCLLLHGLGGGPYEMQPLAESLYAQGLSVLAVAYPGHDKPARRMPASTWPEWYGHIEATYRK
LAGAFASISVVGFSTGCPLALHLAAHWPVAKLVLISPFVSVRHRWFYLLPPEAYLYSVGRLLPQVPRRRLPVRDRAMREA
AEQAAYYRTFNLCAVRSALALVGTVKAELSLVRSPLLILQSRRDSVVAPSGAEYIYRRVRSRVRQLHWFDKSDHILPLDL
ERKEVYERVGRFLL
>Mature_254_residues
MHPMLENKPFFLKASAERVCLLLHGLGGGPYEMQPLAESLYAQGLSVLAVAYPGHDKPARRMPASTWPEWYGHIEATYRK
LAGAFASISVVGFSTGCPLALHLAAHWPVAKLVLISPFVSVRHRWFYLLPPEAYLYSVGRLLPQVPRRRLPVRDRAMREA
AEQAAYYRTFNLCAVRSALALVGTVKAELSLVRSPLLILQSRRDSVVAPSGAEYIYRRVRSRVRQLHWFDKSDHILPLDL
ERKEVYERVGRFLL

Specific function: Involved in the detoxification of xenobiotics. Shows maximal activity with C6 substrates, with gradually decreasing activity from C8 to C12 substrates. No activity for higher chain length substrates acids rather than long-chain ones [H]

COG id: COG1647

COG function: function code R; Esterase/lipase

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the lipase/esterase LIP3/BchO family [H]

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR012354
- InterPro:   IPR001375 [H]

Pfam domain/function: PF00326 Peptidase_S9 [H]

EC number: =3.1.1.1 [H]

Molecular weight: Translated: 28817; Mature: 28817

Theoretical pI: Translated: 10.30; Mature: 10.30

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.2 %Cys     (Translated Protein)
2.0 %Met     (Translated Protein)
3.1 %Cys+Met (Translated Protein)
1.2 %Cys     (Mature Protein)
2.0 %Met     (Mature Protein)
3.1 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MHPMLENKPFFLKASAERVCLLLHGLGGGPYEMQPLAESLYAQGLSVLAVAYPGHDKPAR
CCCCCCCCCEEEEECHHHEEHEEECCCCCCCCHHHHHHHHHHCCCEEEEEEECCCCCHHH
RMPASTWPEWYGHIEATYRKLAGAFASISVVGFSTGCPLALHLAAHWPVAKLVLISPFVS
CCCCCCCHHHHHHHHHHHHHHHHHHHHEEEEEECCCCCCEEHHHHCCCHHHHHHHHHHHH
VRHRWFYLLPPEAYLYSVGRLLPQVPRRRLPVRDRAMREAAEQAAYYRTFNLCAVRSALA
HCCCEEEEECCHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
LVGTVKAELSLVRSPLLILQSRRDSVVAPSGAEYIYRRVRSRVRQLHWFDKSDHILPLDL
HHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHCCCCCCCEEECCC
ERKEVYERVGRFLL
CHHHHHHHHHHHCC
>Mature Secondary Structure
MHPMLENKPFFLKASAERVCLLLHGLGGGPYEMQPLAESLYAQGLSVLAVAYPGHDKPAR
CCCCCCCCCEEEEECHHHEEHEEECCCCCCCCHHHHHHHHHHCCCEEEEEEECCCCCHHH
RMPASTWPEWYGHIEATYRKLAGAFASISVVGFSTGCPLALHLAAHWPVAKLVLISPFVS
CCCCCCCHHHHHHHHHHHHHHHHHHHHEEEEEECCCCCCEEHHHHCCCHHHHHHHHHHHH
VRHRWFYLLPPEAYLYSVGRLLPQVPRRRLPVRDRAMREAAEQAAYYRTFNLCAVRSALA
HCCCEEEEECCHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
LVGTVKAELSLVRSPLLILQSRRDSVVAPSGAEYIYRRVRSRVRQLHWFDKSDHILPLDL
HHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHCCCCCCCEEECCC
ERKEVYERVGRFLL
CHHHHHHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: 1369099 [H]