Definition Rhodopseudomonas palustris HaA2, complete genome.
Accession NC_007778
Length 5,331,656

Click here to switch to the map view.

The map label for this gene is ygfJ [C]

Identifier: 86750782

GI number: 86750782

Start: 4212307

End: 4213908

Strand: Reverse

Name: ygfJ [C]

Synonym: RPB_3672

Alternate gene names: 86750782

Gene position: 4213908-4212307 (Counterclockwise)

Preceding gene: 86750783

Following gene: 86750781

Centisome position: 79.04

GC content: 69.29

Gene sequence:

>1602_bases
ATGAAGTTCGGGCCGCGCCGTCCGGCCGATGCGATCGGCGGCGTCACCGTGCATTCGCTGCGGCAGAACGGATTGCTGCT
GAAGAAGGGCACCGCGATCGGTCCGGCCGAAGTCGACGCGCTGGAGCGCGCCGGCGTCGGTGAAATTGTCGTCGTTCAAC
TCGAGTCGGGTGATGTCTCGGAGGACGTCGCAGCAGCGGACGTGGCGCAGGCCGTCGCCGGCGACGGTGCCAGCGTCGAG
CGCGCCTTCACCGGCCGCGCCAATCTGTTCGCGCAGCGGCCCGGCGTGCTGGTGGTTGATCGCGCCGCGGTCGATCGGGT
CAATGCGGTCGACGAGGCGATCACCTTCGCGACGCTGCCGGCGTTCAAGCCGGTGGTCGAAGGCGAGATGATCGCGACCG
TCAAGCTGATCCCGTTCGGCGTCGAGGGGAGACTGCGCGACGCCGCGGTGGCGGCTGCACGAGGCTCCGCGCTGCAGGTC
GCGCCCTATGTCATCAAGCGTGTCGGCATCGTGTCGACGCAACTGCCCGGCCTCGCGTCCAAGGTGATCGACAAGACGCT
GCGCGTCACCGCCGAGCGGCTGGCGCCGGCGGGTGCCGAGATCATCGCCGAGCGCCGCATCGCTCATGACGAATCTGCGC
TCGCAACGGCGCTGCAGGAATTGCTCGGCCTCGGCGCCGAGCTGGTGATCGTGTTCGGCGCCTCGGCGATCGCAGACCGC
CGCGACGTCATCCCGGCGGCGATCGGCGCCATCGGCGGGCAGGTCGAGCACTTCGGTATGCCGGTCGATCCCGGCAATCT
GCTGCTGATCGGCAGCGCGTCGGGCGTCCCGGTGCTGGGTGCGCCGGGCTGTGCGCGCTCGCCGGTCGAGAACGGCTTCG
ACTGGGTGCTGATGCGGCTGCTGGCGGGATTGCCCGTGACGCGCGCCGATATCACCGGCATGGGTGTCGGCGGGTTGCTG
ATGGAGATCGTGACCCGACCGCAGCCGCGCGTGCCGGTAGCCGAAGGTGGCCGCAATGTCGCGGCGATCGTGCTCGCCGC
CGGCCGCTCGACCCGGATGGGCGGGCCGAACAAGCTGCTCGCCGAACTGAACGGCACGCCGCTGGTGCGGATCGTGACCG
AGCAGGTATTGGCGTCGAAGGCATCGCGCGCGGTCGTGGTCACCGGGCATCAGGCCGACAAGGTCGAGGCGGCGCTGTCC
GGGCTCGATGTGTCGTTCGTCCATAACCCGGCGTTCGCCGAAGGGCTGGCGTCGTCGGTCAAAGCCGGTATCGCCGCTGT
GCCGGACGATGCCGATGGCGCGATTGTTTGTCTCGGCGACATGCCGCTGATCGATTCCGAACTGATCGACCGGCTGATCG
ACGCGTTCGATCCGGATCGCGGCGGGCTGATCGTGGTGCCGGTCGCAGATGGCCGCCGCGGCAATCCAGTGCTGTGGTCG
CGGCGGTTCTTCGCCGAGCTGATGACGCTCGACGGCGACATCGGCGCGCGCCACCTGATCGCCAAGCATGCCGAGGCGGT
GACCGAAGTGCCGGTCGATGGCCACGCTGCGTTTCTCGATATCGATACGCCGCAGGCGCTCGAGGATGCCCGCCGGGGCT
GA

Upstream 100 bases:

>100_bases
TCGCCATCGGCGCGGTGTCGCCGTCGGAAATTGCGGTGTCGATCATGGCCGAGATCACCGCGACGCTGCGGATGCCGGGG
CCGTCCAAGGCAGCCGCGGT

Downstream 100 bases:

>100_bases
ACGCGGCGCCTCGACGGATTATTCACCAAGTTGAAAGCCCTCTCGACCTAAAGTTCCACCGGGTTACTTGGGGAGGGGAT
CTTGGGGTTGTCTGCTGCTC

Product: 4-diphosphocytidyl-2C-methyl-D-erythritol synthase

Products: NA

Alternate protein names: Molybdopterin Biosynthesis Protein; Metal Dependent Phosphohydrolase; Molybdopterin-Guanine Dinucleotide Biosynthesis Protein A; MobA-Like Protein-Like Protein; Molybdenum Hydroxylase Accessory Protein YgfJ Family; Purine Catabolism Protein PucB; 4-Diphosphocytidyl-2C-Methyl-D-Erythritolsynthas E; Molybdenum Cofactor Cytidylyltransferase; Molybdenum Cofactor Biosynthesis Protein; Molybdopterin Biosynthesis; MobA-Like Protein; MobA-Related Protein; MobA-Like Molybdenum Cofactor Biosynthesis Protein; UDP-N-Acetylglucosamine Pyrophosphorylase; Protein Family UPF; 4-Diphosphocytidyl-2c-Methyl-D-Erythritol Synthase; Metal-Dependent Phosphohydrolase HD Sub Domain Protein; Molybdenum Hydroxylase Accessory Protein; Nucleotidyl Transferase; Conserved MobA-Related Protein; L-Seryl-TRNA(Ser) Selenium Transferase Protein; MobA-Like Protein-Like; Molybdopterin-Guanine Dinucleotide Synthase; Molybdopterin Molybdochelatase; Phosphoglycerate/Bisphosphoglycerate Mutase; Xanthine Dehydrogenase Accessory Protein PucB; Molybdopterin Biosynthesis Protein MoeA; Nucleotide-Diphospho-Sugar Transferase; Domain HDIG Containing Protein; Transcriptional Regulator Fis Family

Number of amino acids: Translated: 533; Mature: 533

Protein sequence:

>533_residues
MKFGPRRPADAIGGVTVHSLRQNGLLLKKGTAIGPAEVDALERAGVGEIVVVQLESGDVSEDVAAADVAQAVAGDGASVE
RAFTGRANLFAQRPGVLVVDRAAVDRVNAVDEAITFATLPAFKPVVEGEMIATVKLIPFGVEGRLRDAAVAAARGSALQV
APYVIKRVGIVSTQLPGLASKVIDKTLRVTAERLAPAGAEIIAERRIAHDESALATALQELLGLGAELVIVFGASAIADR
RDVIPAAIGAIGGQVEHFGMPVDPGNLLLIGSASGVPVLGAPGCARSPVENGFDWVLMRLLAGLPVTRADITGMGVGGLL
MEIVTRPQPRVPVAEGGRNVAAIVLAAGRSTRMGGPNKLLAELNGTPLVRIVTEQVLASKASRAVVVTGHQADKVEAALS
GLDVSFVHNPAFAEGLASSVKAGIAAVPDDADGAIVCLGDMPLIDSELIDRLIDAFDPDRGGLIVVPVADGRRGNPVLWS
RRFFAELMTLDGDIGARHLIAKHAEAVTEVPVDGHAAFLDIDTPQALEDARRG

Sequences:

>Translated_533_residues
MKFGPRRPADAIGGVTVHSLRQNGLLLKKGTAIGPAEVDALERAGVGEIVVVQLESGDVSEDVAAADVAQAVAGDGASVE
RAFTGRANLFAQRPGVLVVDRAAVDRVNAVDEAITFATLPAFKPVVEGEMIATVKLIPFGVEGRLRDAAVAAARGSALQV
APYVIKRVGIVSTQLPGLASKVIDKTLRVTAERLAPAGAEIIAERRIAHDESALATALQELLGLGAELVIVFGASAIADR
RDVIPAAIGAIGGQVEHFGMPVDPGNLLLIGSASGVPVLGAPGCARSPVENGFDWVLMRLLAGLPVTRADITGMGVGGLL
MEIVTRPQPRVPVAEGGRNVAAIVLAAGRSTRMGGPNKLLAELNGTPLVRIVTEQVLASKASRAVVVTGHQADKVEAALS
GLDVSFVHNPAFAEGLASSVKAGIAAVPDDADGAIVCLGDMPLIDSELIDRLIDAFDPDRGGLIVVPVADGRRGNPVLWS
RRFFAELMTLDGDIGARHLIAKHAEAVTEVPVDGHAAFLDIDTPQALEDARRG
>Mature_533_residues
MKFGPRRPADAIGGVTVHSLRQNGLLLKKGTAIGPAEVDALERAGVGEIVVVQLESGDVSEDVAAADVAQAVAGDGASVE
RAFTGRANLFAQRPGVLVVDRAAVDRVNAVDEAITFATLPAFKPVVEGEMIATVKLIPFGVEGRLRDAAVAAARGSALQV
APYVIKRVGIVSTQLPGLASKVIDKTLRVTAERLAPAGAEIIAERRIAHDESALATALQELLGLGAELVIVFGASAIADR
RDVIPAAIGAIGGQVEHFGMPVDPGNLLLIGSASGVPVLGAPGCARSPVENGFDWVLMRLLAGLPVTRADITGMGVGGLL
MEIVTRPQPRVPVAEGGRNVAAIVLAAGRSTRMGGPNKLLAELNGTPLVRIVTEQVLASKASRAVVVTGHQADKVEAALS
GLDVSFVHNPAFAEGLASSVKAGIAAVPDDADGAIVCLGDMPLIDSELIDRLIDAFDPDRGGLIVVPVADGRRGNPVLWS
RRFFAELMTLDGDIGARHLIAKHAEAVTEVPVDGHAAFLDIDTPQALEDARRG

Specific function: Unknown

COG id: COG0303

COG function: function code H; Molybdopterin biosynthesis enzyme

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

Organism=Escherichia coli, GI1789242, Length=188, Percent_Identity=27.1276595744681, Blast_Score=67, Evalue=2e-12,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 55008; Mature: 55008

Theoretical pI: Translated: 5.05; Mature: 5.05

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.4 %Cys     (Translated Protein)
1.7 %Met     (Translated Protein)
2.1 %Cys+Met (Translated Protein)
0.4 %Cys     (Mature Protein)
1.7 %Met     (Mature Protein)
2.1 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKFGPRRPADAIGGVTVHSLRQNGLLLKKGTAIGPAEVDALERAGVGEIVVVQLESGDVS
CCCCCCCCHHHHCCCCHHHHHHCCEEEECCCCCCCHHHHHHHHCCCCCEEEEEECCCCCC
EDVAAADVAQAVAGDGASVERAFTGRANLFAQRPGVLVVDRAAVDRVNAVDEAITFATLP
HHHHHHHHHHHHCCCCCCHHHHHCCCHHHHCCCCCEEEEEHHHHHHHHHHHHHHHHHHCC
AFKPVVEGEMIATVKLIPFGVEGRLRDAAVAAARGSALQVAPYVIKRVGIVSTQLPGLAS
CCCHHHCCCEEEEEEEEEECCCCCHHHHHHHHHCCCCEEHHHHHHHHHHHHHCCCCHHHH
KVIDKTLRVTAERLAPAGAEIIAERRIAHDESALATALQELLGLGAELVIVFGASAIADR
HHHHHHHHHHHHHHCCCCHHHHHHHHHCCCHHHHHHHHHHHHCCCCEEEEEECCHHHHCH
RDVIPAAIGAIGGQVEHFGMPVDPGNLLLIGSASGVPVLGAPGCARSPVENGFDWVLMRL
HHHHHHHHHHHCCCHHHCCCCCCCCCEEEEECCCCCCEECCCCCCCCCCCCCHHHHHHHH
LAGLPVTRADITGMGVGGLLMEIVTRPQPRVPVAEGGRNVAAIVLAAGRSTRMGGPNKLL
HHCCCCCCCCCCCCCHHHHHHHHHCCCCCCCCHHCCCCCEEEEEEECCCCCCCCCCHHHH
AELNGTPLVRIVTEQVLASKASRAVVVTGHQADKVEAALSGLDVSFVHNPAFAEGLASSV
HHCCCCCEEHHHHHHHHHHCCCCEEEEECCCHHHHHHHHHCCCEEEECCCHHHHHHHHHH
KAGIAAVPDDADGAIVCLGDMPLIDSELIDRLIDAFDPDRGGLIVVPVADGRRGNPVLWS
HCCCEECCCCCCCCEEEECCCCCCCHHHHHHHHHHCCCCCCCEEEEECCCCCCCCCCEEH
RRFFAELMTLDGDIGARHLIAKHAEAVTEVPVDGHAAFLDIDTPQALEDARRG
HHHHHHHHHCCCCCCHHHHHHHHHHHHHCCCCCCCEEEEECCCCHHHHHHHCC
>Mature Secondary Structure
MKFGPRRPADAIGGVTVHSLRQNGLLLKKGTAIGPAEVDALERAGVGEIVVVQLESGDVS
CCCCCCCCHHHHCCCCHHHHHHCCEEEECCCCCCCHHHHHHHHCCCCCEEEEEECCCCCC
EDVAAADVAQAVAGDGASVERAFTGRANLFAQRPGVLVVDRAAVDRVNAVDEAITFATLP
HHHHHHHHHHHHCCCCCCHHHHHCCCHHHHCCCCCEEEEEHHHHHHHHHHHHHHHHHHCC
AFKPVVEGEMIATVKLIPFGVEGRLRDAAVAAARGSALQVAPYVIKRVGIVSTQLPGLAS
CCCHHHCCCEEEEEEEEEECCCCCHHHHHHHHHCCCCEEHHHHHHHHHHHHHCCCCHHHH
KVIDKTLRVTAERLAPAGAEIIAERRIAHDESALATALQELLGLGAELVIVFGASAIADR
HHHHHHHHHHHHHHCCCCHHHHHHHHHCCCHHHHHHHHHHHHCCCCEEEEEECCHHHHCH
RDVIPAAIGAIGGQVEHFGMPVDPGNLLLIGSASGVPVLGAPGCARSPVENGFDWVLMRL
HHHHHHHHHHHCCCHHHCCCCCCCCCEEEEECCCCCCEECCCCCCCCCCCCCHHHHHHHH
LAGLPVTRADITGMGVGGLLMEIVTRPQPRVPVAEGGRNVAAIVLAAGRSTRMGGPNKLL
HHCCCCCCCCCCCCCHHHHHHHHHCCCCCCCCHHCCCCCEEEEEEECCCCCCCCCCHHHH
AELNGTPLVRIVTEQVLASKASRAVVVTGHQADKVEAALSGLDVSFVHNPAFAEGLASSV
HHCCCCCEEHHHHHHHHHHCCCCEEEEECCCHHHHHHHHHCCCEEEECCCHHHHHHHHHH
KAGIAAVPDDADGAIVCLGDMPLIDSELIDRLIDAFDPDRGGLIVVPVADGRRGNPVLWS
HCCCEECCCCCCCCEEEECCCCCCCHHHHHHHHHHCCCCCCCEEEEECCCCCCCCCCEEH
RRFFAELMTLDGDIGARHLIAKHAEAVTEVPVDGHAAFLDIDTPQALEDARRG
HHHHHHHHHCCCCCCHHHHHHHHHHHHHCCCCCCCEEEEECCCCHHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA