Definition Hyphomonas neptunium ATCC 15444 chromosome, complete genome.
Accession NC_008358
Length 3,705,021

Click here to switch to the map view.

The map label for this gene is linC [H]

Identifier: 114799772

GI number: 114799772

Start: 2118227

End: 2119504

Strand: Direct

Name: linC [H]

Synonym: HNE_2042

Alternate gene names: 114799772

Gene position: 2118227-2119504 (Clockwise)

Preceding gene: 114797443

Following gene: 114799004

Centisome position: 57.17

GC content: 59.47

Gene sequence:

>1278_bases
GTGACGGAGCGCGAGCCGCTCCACCCGCACAATCTGCGCTTTGGCGCGAACATTCCGCCCGCCGCCGACATCGACCTTTC
GACGCTCGACCTGATCGATGGCGAACTGTGGCGCCAGGGCAAATACTGGGACCGGTTCGAGCGTCTGCGTAACGAAGACC
CGCTGCATTATTGCCCGGACAGCTTCCCCGGACCATTCTGGTCTGTCACCCGGTATGAAGACGTTATGGCGATCGACACC
GATCACAAACGCTTCTCCTCCAGCTGGGAATATGGCGGCATCACGCTGGGCGAGCCGATCAGCGATTTCGAAATGCCGAT
GTTCATCGCCATGGACGAGCCGCGCCATTCGGAGCAGCGCAAGACTGTGCAGCCTGCCGTGGCGCCAGACATGCTGAAAG
TTTACGAGCCCCTGATCCGCTCGCGCACGCAGGGCCTGCTCGACAGCCTTCCGGTGAATGAGCCGTTCGACTGGGTGGAC
AAAGTTTCGGTCGAGCTGACCACGATGATGCTGGCCACGCTGTTTGATTATCCGTTCGAAAACCGCCGCGACCTGACCCA
TTGGTCAGACGTTGCCACCGGCATGCACAATCCCGACATCTGCCCCGGCGGTGAGGAAGAGTGGAAGGCCACCATGATGA
AATGCCTCATGACGTTCATGGGCATCTATCAGGAGCGCCAGCAACAGCCGCAAAAGCCAGACCTGATGAGCCTTCTGGCC
CATGGCGAGAAGACCAAGAACATGACGCCGATGGAACTGCTCGGCAACGTCATCCTGCTGATCGTGGGCGGCAACGACAC
GACGCGCAACTCGATGACCGCCTCGGTCTTTGCGCTCAACAAGTTCCCCAAAGAGTATGAGAAGCTGAAAGCTGATCCTT
CCATCATCCCCAACATGGTTTCGGAGACGATCCGCTGGCAGACGCCGCTCGCCTACATGCGCCGCACCGCGCTGGAAGAT
GTCGAGATGCACGGCAAGACGATCAAAAAGGGCGACCAGGTTGCCATGTGGTATGTCTCCGCCAACCGCGATGAGCGGTT
CTGGGACAAGCCCAACGACTTTATCGCGGACCGCCCCGAGGCGCGCCGCCATATCTCCTTCGGCTTCGGCATCCACCGCT
GCGTCGGCAACCGTCTTGCCGAACTGCAACTGCGCATTCTCTGGGAAGAGATCATGGAACGCTTCGAGCATATCGAAGTT
CTGGCCGAACCTTCCCTGAACCAGAACGCTTTCGTGAAGGGCTACAACTGGATGCCGGTCGTGCTTCACCCGAAGTAA

Upstream 100 bases:

>100_bases
ACGCGATACGCCCCGCCAAGAGGGTGGGATTCCTGGAGGATTGAACATGGCCGCCGATACCGTTTCTTTCGTCAATCACC
CGGCGCTTGAGCGCCCCAAG

Downstream 100 bases:

>100_bases
GGCTTGGCGGTAGCTGCCTCTCCTGATTAGACCTCCTGTCAGATCTGACAGGAGGTTTTTTTTCATGGACGTTTCCAAAG
CCGTTGAGCAGCGGATTTCG

Product: cytochrome P450 family protein

Products: NA

Alternate protein names: Cytochrome P450 111; Cytochrome P450lin [H]

Number of amino acids: Translated: 425; Mature: 424

Protein sequence:

>425_residues
MTEREPLHPHNLRFGANIPPAADIDLSTLDLIDGELWRQGKYWDRFERLRNEDPLHYCPDSFPGPFWSVTRYEDVMAIDT
DHKRFSSSWEYGGITLGEPISDFEMPMFIAMDEPRHSEQRKTVQPAVAPDMLKVYEPLIRSRTQGLLDSLPVNEPFDWVD
KVSVELTTMMLATLFDYPFENRRDLTHWSDVATGMHNPDICPGGEEEWKATMMKCLMTFMGIYQERQQQPQKPDLMSLLA
HGEKTKNMTPMELLGNVILLIVGGNDTTRNSMTASVFALNKFPKEYEKLKADPSIIPNMVSETIRWQTPLAYMRRTALED
VEMHGKTIKKGDQVAMWYVSANRDERFWDKPNDFIADRPEARRHISFGFGIHRCVGNRLAELQLRILWEEIMERFEHIEV
LAEPSLNQNAFVKGYNWMPVVLHPK

Sequences:

>Translated_425_residues
MTEREPLHPHNLRFGANIPPAADIDLSTLDLIDGELWRQGKYWDRFERLRNEDPLHYCPDSFPGPFWSVTRYEDVMAIDT
DHKRFSSSWEYGGITLGEPISDFEMPMFIAMDEPRHSEQRKTVQPAVAPDMLKVYEPLIRSRTQGLLDSLPVNEPFDWVD
KVSVELTTMMLATLFDYPFENRRDLTHWSDVATGMHNPDICPGGEEEWKATMMKCLMTFMGIYQERQQQPQKPDLMSLLA
HGEKTKNMTPMELLGNVILLIVGGNDTTRNSMTASVFALNKFPKEYEKLKADPSIIPNMVSETIRWQTPLAYMRRTALED
VEMHGKTIKKGDQVAMWYVSANRDERFWDKPNDFIADRPEARRHISFGFGIHRCVGNRLAELQLRILWEEIMERFEHIEV
LAEPSLNQNAFVKGYNWMPVVLHPK
>Mature_424_residues
TEREPLHPHNLRFGANIPPAADIDLSTLDLIDGELWRQGKYWDRFERLRNEDPLHYCPDSFPGPFWSVTRYEDVMAIDTD
HKRFSSSWEYGGITLGEPISDFEMPMFIAMDEPRHSEQRKTVQPAVAPDMLKVYEPLIRSRTQGLLDSLPVNEPFDWVDK
VSVELTTMMLATLFDYPFENRRDLTHWSDVATGMHNPDICPGGEEEWKATMMKCLMTFMGIYQERQQQPQKPDLMSLLAH
GEKTKNMTPMELLGNVILLIVGGNDTTRNSMTASVFALNKFPKEYEKLKADPSIIPNMVSETIRWQTPLAYMRRTALEDV
EMHGKTIKKGDQVAMWYVSANRDERFWDKPNDFIADRPEARRHISFGFGIHRCVGNRLAELQLRILWEEIMERFEHIEVL
AEPSLNQNAFVKGYNWMPVVLHPK

Specific function: Catalyzes the 8-methyl hydroxylation of linalool [H]

COG id: COG2124

COG function: function code Q; Cytochrome P450

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the cytochrome P450 family [H]

Homologues:

Organism=Homo sapiens, GI4503231, Length=200, Percent_Identity=22, Blast_Score=68, Evalue=2e-11,
Organism=Caenorhabditis elegans, GI71982956, Length=214, Percent_Identity=28.0373831775701, Blast_Score=76, Evalue=3e-14,
Organism=Caenorhabditis elegans, GI71982977, Length=342, Percent_Identity=23.3918128654971, Blast_Score=73, Evalue=2e-13,
Organism=Caenorhabditis elegans, GI115532670, Length=214, Percent_Identity=27.5700934579439, Blast_Score=72, Evalue=4e-13,
Organism=Caenorhabditis elegans, GI17540354, Length=196, Percent_Identity=26.0204081632653, Blast_Score=68, Evalue=1e-11,
Organism=Caenorhabditis elegans, GI17552522, Length=196, Percent_Identity=25.5102040816327, Blast_Score=67, Evalue=2e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR001128
- InterPro:   IPR002397
- InterPro:   IPR017972 [H]

Pfam domain/function: PF00067 p450 [H]

EC number: =1.14.99.28 [H]

Molecular weight: Translated: 49395; Mature: 49264

Theoretical pI: Translated: 5.24; Mature: 5.24

Prosite motif: PS00086 CYTOCHROME_P450

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.9 %Cys     (Translated Protein)
5.4 %Met     (Translated Protein)
6.4 %Cys+Met (Translated Protein)
0.9 %Cys     (Mature Protein)
5.2 %Met     (Mature Protein)
6.1 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTEREPLHPHNLRFGANIPPAADIDLSTLDLIDGELWRQGKYWDRFERLRNEDPLHYCPD
CCCCCCCCCCCEEECCCCCCCCCCCCHHHHHHHHHHHHCCCHHHHHHHHCCCCCCCCCCC
SFPGPFWSVTRYEDVMAIDTDHKRFSSSWEYGGITLGEPISDFEMPMFIAMDEPRHSEQR
CCCCCCCCHHCCCCEEEECCCHHHHCCCCCCCCEECCCCCCCCCCCEEEEECCCCCHHHH
KTVQPAVAPDMLKVYEPLIRSRTQGLLDSLPVNEPFDWVDKVSVELTTMMLATLFDYPFE
HHCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCC
NRRDLTHWSDVATGMHNPDICPGGEEEWKATMMKCLMTFMGIYQERQQQPQKPDLMSLLA
CCCCCHHHHHHHCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHH
HGEKTKNMTPMELLGNVILLIVGGNDTTRNSMTASVFALNKFPKEYEKLKADPSIIPNMV
CCCCCCCCCHHHHHCCEEEEEECCCCCCCCCHHHHHHHHHHCHHHHHHHCCCHHHHHHHH
SETIRWQTPLAYMRRTALEDVEMHGKTIKKGDQVAMWYVSANRDERFWDKPNDFIADRPE
HHHHHHCCHHHHHHHHHHHHHHHCCCHHCCCCCEEEEEEECCCCCCCCCCCCCCCCCCCH
ARRHISFGFGIHRCVGNRLAELQLRILWEEIMERFEHIEVLAEPSLNQNAFVKGYNWMPV
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCEEECCCCEEE
VLHPK
EECCC
>Mature Secondary Structure 
TEREPLHPHNLRFGANIPPAADIDLSTLDLIDGELWRQGKYWDRFERLRNEDPLHYCPD
CCCCCCCCCCEEECCCCCCCCCCCCHHHHHHHHHHHHCCCHHHHHHHHCCCCCCCCCCC
SFPGPFWSVTRYEDVMAIDTDHKRFSSSWEYGGITLGEPISDFEMPMFIAMDEPRHSEQR
CCCCCCCCHHCCCCEEEECCCHHHHCCCCCCCCEECCCCCCCCCCCEEEEECCCCCHHHH
KTVQPAVAPDMLKVYEPLIRSRTQGLLDSLPVNEPFDWVDKVSVELTTMMLATLFDYPFE
HHCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCC
NRRDLTHWSDVATGMHNPDICPGGEEEWKATMMKCLMTFMGIYQERQQQPQKPDLMSLLA
CCCCCHHHHHHHCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHH
HGEKTKNMTPMELLGNVILLIVGGNDTTRNSMTASVFALNKFPKEYEKLKADPSIIPNMV
CCCCCCCCCHHHHHCCEEEEEECCCCCCCCCHHHHHHHHHHCHHHHHHHCCCHHHHHHHH
SETIRWQTPLAYMRRTALEDVEMHGKTIKKGDQVAMWYVSANRDERFWDKPNDFIADRPE
HHHHHHCCHHHHHHHHHHHHHHHCCCHHCCCCCEEEEEEECCCCCCCCCCCCCCCCCCCH
ARRHISFGFGIHRCVGNRLAELQLRILWEEIMERFEHIEVLAEPSLNQNAFVKGYNWMPV
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCEEECCCCEEE
VLHPK
EECCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 8376348; 2295633; 3813557; 2578028; 1610873; 12237225 [H]