The gene/protein map for NC_007794 is currently unavailable.
Definition Novosphingobium aromaticivorans DSM 12444 chromosome, complete genome.
Accession NC_007794
Length 3,561,584

Click here to switch to the map view.

The map label for this gene is 87199403

Identifier: 87199403

GI number: 87199403

Start: 1428555

End: 1429190

Strand: Reverse

Name: 87199403

Synonym: Saro_1382

Alternate gene names: NA

Gene position: 1429190-1428555 (Counterclockwise)

Preceding gene: 87199418

Following gene: 87199389

Centisome position: 40.13

GC content: 62.89

Gene sequence:

>636_bases
ATGACGCAATCGAGCAGCGAATCCTGCGCCGGACGGCTTCTGGCGGCACCCGGAATGATGAGGGTTCCCTCGCCCCGGCT
GGAGATGTTCGTGGTGCGCGATTTCCTCTCGCAGGCCGAATGCAACGGGCTGATCGCCCGCATAGAACGGGATCGCAGGC
CCTCGACCATTGCCGATGCCAATGGCGACCACTACTTCCGCACCAGCGAGACCTGCGACCTGCCGATGGATGACCCGGAA
ATCGTCGCTCTCGACGAGAAGCTCTGCGCGCTGTCGGGAATCGGGCGCCCGTTCGGCGAACCGATCCAGGGGCAGCGCTA
TGAATCAGGGCAGGAGTTCAAGGCCCACACCGACTATTTCGACCCGCACGGTGCGGACTTCCAGCGCTTCTGCAGCGTTG
CCGGCCAGCGCACGTGGACCTTCATGGTCTACCTGAACGACGTGGAAGCCGGCGGAGCCACGCGGTTCAAGGTAATCGAC
AAGACGATCCAGCCCGAACGCGGCAAGCTGGTGTGCTGGAACAATCGCCGCCCTGACGGAACGGTCAACCCATGCACGCT
CCATCACGCGATGAAGGTGCGCAAAGGCCTGAAGTACGTCATCACCAAGTGGTACCGCGAAAAGCCCTGGGGCTGA

Upstream 100 bases:

>100_bases
CACGGTCACTCGCATGCGGCAGAAACGTGACGGTTTTACGACCAATCCCGTCGGGGCTTCAAGTTGCGGTCGCCGGGTCC
GGTGTGGCAGGAGGAAGGCC

Downstream 100 bases:

>100_bases
CGGCGTACCTTCAGGCGTCGACCTCGGCATCGCGCACGGCGCGGATCGTCGGCAGACAGCGGAACAGCGTGTCGACGTCG
CCCTTGCCGAGCAGCTCGGT

Product: 2OG-Fe(II) oxygenase

Products: NA

Alternate protein names: 2OG-Fe(II) Oxygenase; Prolyl 4-Hydroxylase Alpha Subunit; Oxidoreductase 2OG-Fe(II) Oxygenase Family; Oxygenase; Procollagen-Proline 2-Oxoglutarate-4-Dioxygenase; Response Regulator Receiver Domain-Containing Protein; 2OG-Fe(II) Oxygenase Family Oxidoreductase; Prolyl 4-Hydroxylase Subunit Alpha; 2OG-Fe(II) Oxygenase Superfamily Protein; 2OG-Fe(II) Oxygenase Family Protein; Procollagen-Proline 2-Oxoglutarate-4- Dioxygenase; Prolyl 4-Hydroxylase

Number of amino acids: Translated: 211; Mature: 210

Protein sequence:

>211_residues
MTQSSSESCAGRLLAAPGMMRVPSPRLEMFVVRDFLSQAECNGLIARIERDRRPSTIADANGDHYFRTSETCDLPMDDPE
IVALDEKLCALSGIGRPFGEPIQGQRYESGQEFKAHTDYFDPHGADFQRFCSVAGQRTWTFMVYLNDVEAGGATRFKVID
KTIQPERGKLVCWNNRRPDGTVNPCTLHHAMKVRKGLKYVITKWYREKPWG

Sequences:

>Translated_211_residues
MTQSSSESCAGRLLAAPGMMRVPSPRLEMFVVRDFLSQAECNGLIARIERDRRPSTIADANGDHYFRTSETCDLPMDDPE
IVALDEKLCALSGIGRPFGEPIQGQRYESGQEFKAHTDYFDPHGADFQRFCSVAGQRTWTFMVYLNDVEAGGATRFKVID
KTIQPERGKLVCWNNRRPDGTVNPCTLHHAMKVRKGLKYVITKWYREKPWG
>Mature_210_residues
TQSSSESCAGRLLAAPGMMRVPSPRLEMFVVRDFLSQAECNGLIARIERDRRPSTIADANGDHYFRTSETCDLPMDDPEI
VALDEKLCALSGIGRPFGEPIQGQRYESGQEFKAHTDYFDPHGADFQRFCSVAGQRTWTFMVYLNDVEAGGATRFKVIDK
TIQPERGKLVCWNNRRPDGTVNPCTLHHAMKVRKGLKYVITKWYREKPWG

Specific function: Unknown

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

Organism=Homo sapiens, GI33589818, Length=182, Percent_Identity=30.2197802197802, Blast_Score=75, Evalue=4e-14,
Organism=Homo sapiens, GI63252893, Length=144, Percent_Identity=32.6388888888889, Blast_Score=73, Evalue=2e-13,
Organism=Homo sapiens, GI63252891, Length=144, Percent_Identity=32.6388888888889, Blast_Score=73, Evalue=2e-13,
Organism=Homo sapiens, GI217272861, Length=144, Percent_Identity=32.6388888888889, Blast_Score=73, Evalue=2e-13,
Organism=Homo sapiens, GI4758868, Length=144, Percent_Identity=31.9444444444444, Blast_Score=72, Evalue=4e-13,
Organism=Homo sapiens, GI217272863, Length=144, Percent_Identity=31.9444444444444, Blast_Score=72, Evalue=4e-13,
Organism=Homo sapiens, GI217272849, Length=191, Percent_Identity=28.7958115183246, Blast_Score=68, Evalue=5e-12,
Organism=Homo sapiens, GI63252888, Length=191, Percent_Identity=28.7958115183246, Blast_Score=68, Evalue=5e-12,
Organism=Homo sapiens, GI63252886, Length=145, Percent_Identity=28.9655172413793, Blast_Score=65, Evalue=4e-11,
Organism=Drosophila melanogaster, GI24651477, Length=201, Percent_Identity=30.8457711442786, Blast_Score=89, Evalue=3e-18,
Organism=Drosophila melanogaster, GI21358233, Length=203, Percent_Identity=29.064039408867, Blast_Score=87, Evalue=1e-17,
Organism=Drosophila melanogaster, GI78706702, Length=135, Percent_Identity=34.0740740740741, Blast_Score=82, Evalue=3e-16,
Organism=Drosophila melanogaster, GI281361323, Length=184, Percent_Identity=28.804347826087, Blast_Score=80, Evalue=8e-16,
Organism=Drosophila melanogaster, GI116008130, Length=200, Percent_Identity=29.5, Blast_Score=79, Evalue=2e-15,
Organism=Drosophila melanogaster, GI116008537, Length=200, Percent_Identity=29.5, Blast_Score=79, Evalue=2e-15,
Organism=Drosophila melanogaster, GI221460681, Length=192, Percent_Identity=29.6875, Blast_Score=74, Evalue=5e-14,
Organism=Drosophila melanogaster, GI24651418, Length=144, Percent_Identity=32.6388888888889, Blast_Score=73, Evalue=1e-13,
Organism=Drosophila melanogaster, GI24651424, Length=129, Percent_Identity=28.6821705426357, Blast_Score=67, Evalue=1e-11,
Organism=Drosophila melanogaster, GI24651420, Length=144, Percent_Identity=29.8611111111111, Blast_Score=64, Evalue=5e-11,
Organism=Drosophila melanogaster, GI24666354, Length=130, Percent_Identity=26.1538461538462, Blast_Score=64, Evalue=5e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 23937; Mature: 23806

Theoretical pI: Translated: 8.05; Mature: 8.05

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

3.3 %Cys     (Translated Protein)
3.3 %Met     (Translated Protein)
6.6 %Cys+Met (Translated Protein)
3.3 %Cys     (Mature Protein)
2.9 %Met     (Mature Protein)
6.2 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTQSSSESCAGRLLAAPGMMRVPSPRLEMFVVRDFLSQAECNGLIARIERDRRPSTIADA
CCCCCCHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEECC
NGDHYFRTSETCDLPMDDPEIVALDEKLCALSGIGRPFGEPIQGQRYESGQEFKAHTDYF
CCCEEEECCCCCCCCCCCCCEEEECHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCC
DPHGADFQRFCSVAGQRTWTFMVYLNDVEAGGATRFKVIDKTIQPERGKLVCWNNRRPDG
CCCCCCHHHHHHHCCCCEEEEEEEEEEECCCCCEEEEEECCCCCCCCCCEEEECCCCCCC
TVNPCTLHHAMKVRKGLKYVITKWYREKPWG
CCCHHHHHHHHHHHHHHHHHHHHHHHCCCCC
>Mature Secondary Structure 
TQSSSESCAGRLLAAPGMMRVPSPRLEMFVVRDFLSQAECNGLIARIERDRRPSTIADA
CCCCCHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEECC
NGDHYFRTSETCDLPMDDPEIVALDEKLCALSGIGRPFGEPIQGQRYESGQEFKAHTDYF
CCCEEEECCCCCCCCCCCCCEEEECHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCC
DPHGADFQRFCSVAGQRTWTFMVYLNDVEAGGATRFKVIDKTIQPERGKLVCWNNRRPDG
CCCCCCHHHHHHHCCCCEEEEEEEEEEECCCCCEEEEEECCCCCCCCCCEEEECCCCCCC
TVNPCTLHHAMKVRKGLKYVITKWYREKPWG
CCCHHHHHHHHHHHHHHHHHHHHHHHCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: NA