Definition Candidatus Solibacter usitatus Ellin6076 chromosome, complete genome.
Accession NC_008536
Length 9,965,640

Click here to switch to the map view.

The map label for this gene is 116624863

Identifier: 116624863

GI number: 116624863

Start: 7250832

End: 7252202

Strand: Direct

Name: 116624863

Synonym: Acid_5787

Alternate gene names: NA

Gene position: 7250832-7252202 (Clockwise)

Preceding gene: 116624861

Following gene: 116624864

Centisome position: 72.76

GC content: 60.98

Gene sequence:

>1371_bases
GTGAAGACCGCCGCGCTTGTAACTACGATCTTGGGTATTTGCATACTGGGTGGTATTTGCATACTGGGCCAAACGCAGCA
ACCCCAGGCGGCCGAAAACGCCACCCTCTTTCTCAACGTTCGCGTTTTCGATGGCAAGGGCAGCGCGCTCTCGCCTTCTT
CCAGCGTACTGGTCAAAGGCAACTCGATCGAGCGCGTATCCACCACCCCCATTGATACCGGCACGGGCCGAACTGTCACG
GTGGTCGATGGCGGCGGCCGTGTGTTGATGCCCGGCCTGATTGACGCGCATTGGCATGCCTTCATGGCGTCAGTGCCGCA
GATGCTTCTCATGACCGCCGACCCTTCCTATCTTCAACTCCTGGCTGCCCGACAGGCCGAGGCGACGTTGATGAGGGGCT
TCACCACCGTGAGAAACCTTGGCGGTCCGGTATTCGGACTCAAGCGCGCGATCGACGAAGGCGCCATGGTTGGTCCGCGC
ATCTACCCTTCGGGAGCCTTCATCTCGCAAACCTCGGGACACGGGGATTTTCGCTTCGGCTTCGAGCTTCCGCGAATGCC
CGGCGGTCCTTTGAGTCATTCCGAGATCGAGGGCGTCGCAGCCATCGCCGACAGCCCGGACGAGGTCCGTCTGCGGGCGA
GAGAGCAACTCAGACAGGGTGCGAGCCAGATCAAGCTGATGGCCGGCGGCGGGGTGGCGTCCCCGTACAACCCGTTGGAA
TCGGTCCAGTATACGGAGCCGGAGATTCGCGCGGCAGTTGAAGCGGCCGACAATTGGGGCACCTATGTGACGGTACACGC
GTATACTCCGCTGGCCATCCGTCAGGCGGTTGCCGCGGGCGTCAAATGCATCGAGCACGGCCACCTGATCGACGAACCGA
CTGCCAGGTTGCTGGCGGAAAAAGGCATCTGGTGGAGCTTGCAGCCGTTTCTGGACGACGAAGATGCGTCTCCCCTGGTG
AACCCGTTCTCTCAGGCAAAGAAATTGAAAGTGTTCGCCGGCACAGAGAACGCGTACAGGCTATCCAGGAAGTACAAGGT
CAAAACCGCTTTCGGCACGGACATCCTGTTCGATGCCAGGGTCGCGGGGCGGCAGGGGGCGCAGCTCGCCAAGCTGGTCC
GCTGGTACACGCCGGCCGAAACGCTGAGCATGGCCACCGCGGCAAATGGCGAGCTGATGGCGCTCTCCGGCTTGATCAAC
CCGTATCCCGGCAAACTGGGCGTGATCGAAGACGGCGCCCTGGCGGACCTGATCCTGGTCGATGGCAATCCGCTGGAAAA
TATCAGGCTCATCGAGGATCCGGGCAAGAACTTCGTCGTCATCATGAAGGACGGCAAGATCTACAAGAACACCCTGCCGA
AGAAGCACTAA

Upstream 100 bases:

>100_bases
CCTGCCTCGCAGCGATCTAATAATTTGAATCCTGGACGGCGAACCCCAAAAAATGAATCGGCCTGATTCGGGCGCAGTCC
CCGAACTCGAGGTACGAAAT

Downstream 100 bases:

>100_bases
TTCGGATTCCCAACCGCTCGCTGGCCCGCGCGGCTCTGAAGGGAGCCGAGACCGTGAGGGAGCGATTGCTAACTTGGTAA
CTTTCACCTTCCATTGAGCC

Product: amidohydrolase

Products: NA

Alternate protein names: Prolidase; Xaa-Pro Dipeptidase; Amidohydrolase Family Protein; Amidohydrolase Family; Imidazolonepropionase; Secreted Hydrolase; Xaa-Pro Dipeptidase Family; M38 Family Peptidase; Aryldialkylphosphatase Related Protein; Metal-Dependent Amidohydrolase; Amidohydrolase Imidazolonepropionase; Parathion Hydrolase; X-Pro Dipeptidase; Aryldialkylphosphatase; Metallo-Dependent Hydrolase; Amidase; Amidohydrolase Domain Protein; Metal-Dependent Hydrolase; Pro-Hyp Dipeptidase; Exported Adenine Deaminase-Like Amidohydrolase; Dipeptidase; Aryldialkylphosphatase-Related Protein; M38 Familypeptidase; Xaa-Arg/Lys Peptidase; Hydrolase

Number of amino acids: Translated: 456; Mature: 456

Protein sequence:

>456_residues
MKTAALVTTILGICILGGICILGQTQQPQAAENATLFLNVRVFDGKGSALSPSSSVLVKGNSIERVSTTPIDTGTGRTVT
VVDGGGRVLMPGLIDAHWHAFMASVPQMLLMTADPSYLQLLAARQAEATLMRGFTTVRNLGGPVFGLKRAIDEGAMVGPR
IYPSGAFISQTSGHGDFRFGFELPRMPGGPLSHSEIEGVAAIADSPDEVRLRAREQLRQGASQIKLMAGGGVASPYNPLE
SVQYTEPEIRAAVEAADNWGTYVTVHAYTPLAIRQAVAAGVKCIEHGHLIDEPTARLLAEKGIWWSLQPFLDDEDASPLV
NPFSQAKKLKVFAGTENAYRLSRKYKVKTAFGTDILFDARVAGRQGAQLAKLVRWYTPAETLSMATAANGELMALSGLIN
PYPGKLGVIEDGALADLILVDGNPLENIRLIEDPGKNFVVIMKDGKIYKNTLPKKH

Sequences:

>Translated_456_residues
MKTAALVTTILGICILGGICILGQTQQPQAAENATLFLNVRVFDGKGSALSPSSSVLVKGNSIERVSTTPIDTGTGRTVT
VVDGGGRVLMPGLIDAHWHAFMASVPQMLLMTADPSYLQLLAARQAEATLMRGFTTVRNLGGPVFGLKRAIDEGAMVGPR
IYPSGAFISQTSGHGDFRFGFELPRMPGGPLSHSEIEGVAAIADSPDEVRLRAREQLRQGASQIKLMAGGGVASPYNPLE
SVQYTEPEIRAAVEAADNWGTYVTVHAYTPLAIRQAVAAGVKCIEHGHLIDEPTARLLAEKGIWWSLQPFLDDEDASPLV
NPFSQAKKLKVFAGTENAYRLSRKYKVKTAFGTDILFDARVAGRQGAQLAKLVRWYTPAETLSMATAANGELMALSGLIN
PYPGKLGVIEDGALADLILVDGNPLENIRLIEDPGKNFVVIMKDGKIYKNTLPKKH
>Mature_456_residues
MKTAALVTTILGICILGGICILGQTQQPQAAENATLFLNVRVFDGKGSALSPSSSVLVKGNSIERVSTTPIDTGTGRTVT
VVDGGGRVLMPGLIDAHWHAFMASVPQMLLMTADPSYLQLLAARQAEATLMRGFTTVRNLGGPVFGLKRAIDEGAMVGPR
IYPSGAFISQTSGHGDFRFGFELPRMPGGPLSHSEIEGVAAIADSPDEVRLRAREQLRQGASQIKLMAGGGVASPYNPLE
SVQYTEPEIRAAVEAADNWGTYVTVHAYTPLAIRQAVAAGVKCIEHGHLIDEPTARLLAEKGIWWSLQPFLDDEDASPLV
NPFSQAKKLKVFAGTENAYRLSRKYKVKTAFGTDILFDARVAGRQGAQLAKLVRWYTPAETLSMATAANGELMALSGLIN
PYPGKLGVIEDGALADLILVDGNPLENIRLIEDPGKNFVVIMKDGKIYKNTLPKKH

Specific function: Unknown

COG id: COG1228

COG function: function code Q; Imidazolonepropionase and related amidohydrolases

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

Organism=Saccharomyces cerevisiae, GI6322248, Length=339, Percent_Identity=38.3480825958702, Blast_Score=209, Evalue=6e-55,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 48874; Mature: 48874

Theoretical pI: Translated: 8.08; Mature: 8.08

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.7 %Cys     (Translated Protein)
2.6 %Met     (Translated Protein)
3.3 %Cys+Met (Translated Protein)
0.7 %Cys     (Mature Protein)
2.6 %Met     (Mature Protein)
3.3 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKTAALVTTILGICILGGICILGQTQQPQAAENATLFLNVRVFDGKGSALSPSSSVLVKG
CCHHHHHHHHHHHHHHCCEEEECCCCCCCCCCCCEEEEEEEEECCCCCCCCCCCCEEEEC
NSIERVSTTPIDTGTGRTVTVVDGGGRVLMPGLIDAHWHAFMASVPQMLLMTADPSYLQL
CCCCEEECCCCCCCCCCEEEEEECCCEEEECCHHHHHHHHHHHHHHHEEEEECCHHHHHH
LAARQAEATLMRGFTTVRNLGGPVFGLKRAIDEGAMVGPRIYPSGAFISQTSGHGDFRFG
HHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHCCCCCCCCEECCCCCEEECCCCCCCEEEE
FELPRMPGGPLSHSEIEGVAAIADSPDEVRLRAREQLRQGASQIKLMAGGGVASPYNPLE
EECCCCCCCCCCCHHCCCEEEECCCCHHHHHHHHHHHHCCHHHEEEEECCCCCCCCCCHH
SVQYTEPEIRAAVEAADNWGTYVTVHAYTPLAIRQAVAAGVKCIEHGHLIDEPTARLLAE
CCCCCCHHHHHHHHHCCCCCCEEEEEECCCHHHHHHHHHHHHHHHCCCCCCCHHHHHHHH
KGIWWSLQPFLDDEDASPLVNPFSQAKKLKVFAGTENAYRLSRKYKVKTAFGTDILFDAR
CCCEEEECCCCCCCCCCCHHCCHHHCCEEEEEECCCCCEEEEEEEEEEEECCCCEEEECH
VAGRQGAQLAKLVRWYTPAETLSMATAANGELMALSGLINPYPGKLGVIEDGALADLILV
HCCCCCHHHHHHHHHCCCHHHHHHHHCCCCCEEEEECCCCCCCCCEEEECCCCEEEEEEE
DGNPLENIRLIEDPGKNFVVIMKDGKIYKNTLPKKH
CCCCCCCEEEEECCCCCEEEEEECCEEECCCCCCCC
>Mature Secondary Structure
MKTAALVTTILGICILGGICILGQTQQPQAAENATLFLNVRVFDGKGSALSPSSSVLVKG
CCHHHHHHHHHHHHHHCCEEEECCCCCCCCCCCCEEEEEEEEECCCCCCCCCCCCEEEEC
NSIERVSTTPIDTGTGRTVTVVDGGGRVLMPGLIDAHWHAFMASVPQMLLMTADPSYLQL
CCCCEEECCCCCCCCCCEEEEEECCCEEEECCHHHHHHHHHHHHHHHEEEEECCHHHHHH
LAARQAEATLMRGFTTVRNLGGPVFGLKRAIDEGAMVGPRIYPSGAFISQTSGHGDFRFG
HHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHCCCCCCCCEECCCCCEEECCCCCCCEEEE
FELPRMPGGPLSHSEIEGVAAIADSPDEVRLRAREQLRQGASQIKLMAGGGVASPYNPLE
EECCCCCCCCCCCHHCCCEEEECCCCHHHHHHHHHHHHCCHHHEEEEECCCCCCCCCCHH
SVQYTEPEIRAAVEAADNWGTYVTVHAYTPLAIRQAVAAGVKCIEHGHLIDEPTARLLAE
CCCCCCHHHHHHHHHCCCCCCEEEEEECCCHHHHHHHHHHHHHHHCCCCCCCHHHHHHHH
KGIWWSLQPFLDDEDASPLVNPFSQAKKLKVFAGTENAYRLSRKYKVKTAFGTDILFDAR
CCCEEEECCCCCCCCCCCHHCCHHHCCEEEEEECCCCCEEEEEEEEEEEECCCCEEEECH
VAGRQGAQLAKLVRWYTPAETLSMATAANGELMALSGLINPYPGKLGVIEDGALADLILV
HCCCCCHHHHHHHHHCCCHHHHHHHHCCCCCEEEEECCCCCCCCCEEEECCCCEEEEEEE
DGNPLENIRLIEDPGKNFVVIMKDGKIYKNTLPKKH
CCCCCCCEEEEECCCCCEEEEEECCEEECCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA