Definition Cupriavidus necator megaplasmid pHG1, complete sequence.
Accession NC_005241
Length 452,156

Click here to switch to the map view.

The map label for this gene is 38637895

Identifier: 38637895

GI number: 38637895

Start: 246623

End: 247966

Strand: Direct

Name: 38637895

Synonym: PHG231

Alternate gene names: NA

Gene position: 246623-247966 (Clockwise)

Preceding gene: 38637894

Following gene: 38637897

Centisome position: 54.54

GC content: 66.59

Gene sequence:

>1344_bases
ATGAGCCGTTACCAGACACGTTTCCAGACGCGGGAGCAGGCCGGCACGGAGCTGGCGTTGGCATTGCGTCCGTACCAGGG
GACCGGCGCCCTGGTCCTGGCGATTCCGCGCGGCGGCGTGCCAGTCGGGCGCATCGTCGCCGATTCACTGGGTGCCGACT
TCGACCTGGTGATGGCGCGCAGGATCGTGCCAGGCATGGCGCTGGACGAATCCGGCGCGACATGGTGCACGTACGAAGCC
AACGCGGACGGCGCGACCGACAGCCAGCGTGACGCCCAGTTCGACCAGCTGCGCCGGCAGCGCGCGGTCTATATGGCGGT
TCGCAAGATTGCGGACCCGAAGGGGCGCGTGGTGATCGTCGTGGATGACGGCCTGGTCAGCGGCGCGACCATGTACGCGG
CGTTGGCCGGCCTGCGCAAGCGGCGCCCCGCCCGGCTCATCTGCGCAATCCCGATCGCCGCCAGGGCCGGGCTGGATCGG
GTCCGCGCCCTGGCCGACGAGATCGTCTGTCTGGATACGCCGGATCGTATCGAGAACCTAGCGCACTTCTATCGCGAGTT
CCAGTTGGTCAGCGACGACCGCGTCAGACAATTGACCGCGATACAGCCAGCCCAATCCCAGGCTCGCTCCCGGCCAGGCG
CCGTGGTGCGCATGCCATCGCTCAGCCTTGCCCTGCAAATTCCTTATGGCACCAGCCGGCTACCCGCCATGCTCGAATCG
GCGCCGAATCCGATGGGCGTCGCGCTGATGGTATGTGCCGGTGGCGCGCAGCGCCGTGCGGCCCGCAGCCAATACCTGGC
GCGCAAGCTTCGGGCGAAGGGATTCGCCACCATGCTTGTGGACCTGCAGCCCGAGAGCAGGGACAATGACGCCCCAGAAT
CAGAAATCGATGACCTTGCGAGAAGGCTAAACCAGGCGCTGATTTTCCTGCGCGCCAGGATGCCGTGCGCAAAGCTTCCG
GCGGGCTTGCTCAGTACCGGTACCGCAGGGGCGGCCGCGCTGCGTGCGGCCGCATGCAGCGCGGACCTTCTCGGCGCCGT
AGCCTGCGTTGCGGGACGCCCGGATCTCGCGGGCAGTGCAACCTTGCAGCGGCTGGACATCCCCGCCCTGCTGATGTGCG
CCAGCGGCGATGCGCAGAACATCCACATCAATAACCTTGCATTCGAACAAATGCACTGCCTGCGGCAACTGCGGCTCATT
CCGACCAGCGGCCGCGGATTCGAAGACCGCAATGCCATGGAAGACATCGCGACGCTCACGGCAGACTGGTTCGGGCGGCA
CCTCGCAACCGCGTCGCCTCCCAGTCTGGCATACGGGGGACGACAAACACCCCCAAACATGTGA

Upstream 100 bases:

>100_bases
CTCGAGCAGGCCAATGCGGCACTGGCCGATCTGCGCGAGGGGCGTCTGTCCGGTGCCGCCGTCCTGAGAATCCGTCACTA
AGGCTTCGGCAGATATCCCC

Downstream 100 bases:

>100_bases
CGCCGCATTCATTCCCGTGCGGCTTTCCCCACCTATACTCAGTGCAGGTGACGGCGCCCCGGAGTCACAGGTACGGTGAC
CTTCAGCCGGATATCAAGCC

Product: hypothetical protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 447; Mature: 446

Protein sequence:

>447_residues
MSRYQTRFQTREQAGTELALALRPYQGTGALVLAIPRGGVPVGRIVADSLGADFDLVMARRIVPGMALDESGATWCTYEA
NADGATDSQRDAQFDQLRRQRAVYMAVRKIADPKGRVVIVVDDGLVSGATMYAALAGLRKRRPARLICAIPIAARAGLDR
VRALADEIVCLDTPDRIENLAHFYREFQLVSDDRVRQLTAIQPAQSQARSRPGAVVRMPSLSLALQIPYGTSRLPAMLES
APNPMGVALMVCAGGAQRRAARSQYLARKLRAKGFATMLVDLQPESRDNDAPESEIDDLARRLNQALIFLRARMPCAKLP
AGLLSTGTAGAAALRAAACSADLLGAVACVAGRPDLAGSATLQRLDIPALLMCASGDAQNIHINNLAFEQMHCLRQLRLI
PTSGRGFEDRNAMEDIATLTADWFGRHLATASPPSLAYGGRQTPPNM

Sequences:

>Translated_447_residues
MSRYQTRFQTREQAGTELALALRPYQGTGALVLAIPRGGVPVGRIVADSLGADFDLVMARRIVPGMALDESGATWCTYEA
NADGATDSQRDAQFDQLRRQRAVYMAVRKIADPKGRVVIVVDDGLVSGATMYAALAGLRKRRPARLICAIPIAARAGLDR
VRALADEIVCLDTPDRIENLAHFYREFQLVSDDRVRQLTAIQPAQSQARSRPGAVVRMPSLSLALQIPYGTSRLPAMLES
APNPMGVALMVCAGGAQRRAARSQYLARKLRAKGFATMLVDLQPESRDNDAPESEIDDLARRLNQALIFLRARMPCAKLP
AGLLSTGTAGAAALRAAACSADLLGAVACVAGRPDLAGSATLQRLDIPALLMCASGDAQNIHINNLAFEQMHCLRQLRLI
PTSGRGFEDRNAMEDIATLTADWFGRHLATASPPSLAYGGRQTPPNM
>Mature_446_residues
SRYQTRFQTREQAGTELALALRPYQGTGALVLAIPRGGVPVGRIVADSLGADFDLVMARRIVPGMALDESGATWCTYEAN
ADGATDSQRDAQFDQLRRQRAVYMAVRKIADPKGRVVIVVDDGLVSGATMYAALAGLRKRRPARLICAIPIAARAGLDRV
RALADEIVCLDTPDRIENLAHFYREFQLVSDDRVRQLTAIQPAQSQARSRPGAVVRMPSLSLALQIPYGTSRLPAMLESA
PNPMGVALMVCAGGAQRRAARSQYLARKLRAKGFATMLVDLQPESRDNDAPESEIDDLARRLNQALIFLRARMPCAKLPA
GLLSTGTAGAAALRAAACSADLLGAVACVAGRPDLAGSATLQRLDIPALLMCASGDAQNIHINNLAFEQMHCLRQLRLIP
TSGRGFEDRNAMEDIATLTADWFGRHLATASPPSLAYGGRQTPPNM

Specific function: Unknown

COG id: COG1926

COG function: function code R; Predicted phosphoribosyltransferases

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: In the C-terminal section; belongs to the dienelactone hydrolase family [H]

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR002925
- InterPro:   IPR000836 [H]

Pfam domain/function: PF01738 DLH; PF00156 Pribosyltran [H]

EC number: NA

Molecular weight: Translated: 48110; Mature: 47979

Theoretical pI: Translated: 9.47; Mature: 9.47

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

2.0 %Cys     (Translated Protein)
3.4 %Met     (Translated Protein)
5.4 %Cys+Met (Translated Protein)
2.0 %Cys     (Mature Protein)
3.1 %Met     (Mature Protein)
5.2 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSRYQTRFQTREQAGTELALALRPYQGTGALVLAIPRGGVPVGRIVADSLGADFDLVMAR
CCCHHHHHHHHHHCCCEEEEEEECCCCCCEEEEEECCCCCCHHHHHHHHHCCCHHHHHHH
RIVPGMALDESGATWCTYEANADGATDSQRDAQFDQLRRQRAVYMAVRKIADPKGRVVIV
HHCCCCEECCCCCEEEEEECCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEEE
VDDGLVSGATMYAALAGLRKRRPARLICAIPIAARAGLDRVRALADEIVCLDTPDRIENL
ECCCCCCHHHHHHHHHHHHHCCCCEEEEEECHHHHCCHHHHHHHHHCEEECCCHHHHHHH
AHFYREFQLVSDDRVRQLTAIQPAQSQARSRPGAVVRMPSLSLALQIPYGTSRLPAMLES
HHHHHHHHHCCCHHHHHHHHCCCHHHHHHCCCCCEEEECCCEEEEECCCCCCHHHHHHHC
APNPMGVALMVCAGGAQRRAARSQYLARKLRAKGFATMLVDLQPESRDNDAPESEIDDLA
CCCCCCEEEEEECCCHHHHHHHHHHHHHHHHHCCEEEEEEEECCCCCCCCCCHHHHHHHH
RRLNQALIFLRARMPCAKLPAGLLSTGTAGAAALRAAACSADLLGAVACVAGRPDLAGSA
HHHHHHHHHHHHCCCHHHCCCHHHCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCH
TLQRLDIPALLMCASGDAQNIHINNLAFEQMHCLRQLRLIPTSGRGFEDRNAMEDIATLT
HHHHCCCCEEEEECCCCCCEEEECCHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHH
ADWFGRHLATASPPSLAYGGRQTPPNM
HHHHHHHHCCCCCCCCCCCCCCCCCCC
>Mature Secondary Structure 
SRYQTRFQTREQAGTELALALRPYQGTGALVLAIPRGGVPVGRIVADSLGADFDLVMAR
CCHHHHHHHHHHCCCEEEEEEECCCCCCEEEEEECCCCCCHHHHHHHHHCCCHHHHHHH
RIVPGMALDESGATWCTYEANADGATDSQRDAQFDQLRRQRAVYMAVRKIADPKGRVVIV
HHCCCCEECCCCCEEEEEECCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEEE
VDDGLVSGATMYAALAGLRKRRPARLICAIPIAARAGLDRVRALADEIVCLDTPDRIENL
ECCCCCCHHHHHHHHHHHHHCCCCEEEEEECHHHHCCHHHHHHHHHCEEECCCHHHHHHH
AHFYREFQLVSDDRVRQLTAIQPAQSQARSRPGAVVRMPSLSLALQIPYGTSRLPAMLES
HHHHHHHHHCCCHHHHHHHHCCCHHHHHHCCCCCEEEECCCEEEEECCCCCCHHHHHHHC
APNPMGVALMVCAGGAQRRAARSQYLARKLRAKGFATMLVDLQPESRDNDAPESEIDDLA
CCCCCCEEEEEECCCHHHHHHHHHHHHHHHHHCCEEEEEEEECCCCCCCCCCHHHHHHHH
RRLNQALIFLRARMPCAKLPAGLLSTGTAGAAALRAAACSADLLGAVACVAGRPDLAGSA
HHHHHHHHHHHHCCCHHHCCCHHHCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCH
TLQRLDIPALLMCASGDAQNIHINNLAFEQMHCLRQLRLIPTSGRGFEDRNAMEDIATLT
HHHHCCCCEEEEECCCCCCEEEECCHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHH
ADWFGRHLATASPPSLAYGGRQTPPNM
HHHHHHHHCCCCCCCCCCCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9634230; 12218036 [H]