Definition Ruegeria sp. TM1040, complete genome.
Accession NC_008044
Length 3,200,938

Click here to switch to the map view.

The map label for this gene is yhgF [C]

Identifier: 99080544

GI number: 99080544

Start: 752089

End: 754533

Strand: Direct

Name: yhgF [C]

Synonym: TM1040_0703

Alternate gene names: 99080544

Gene position: 752089-754533 (Clockwise)

Preceding gene: 99080541

Following gene: 99080550

Centisome position: 23.5

GC content: 60.12

Gene sequence:

>2445_bases
ATGTTCCGGACCGCTAAGACGGTACTCCGGCCTCAGTGGTTGCGCATCATCGTGGCCGACGCCAAAGCAAAGGAGCAGCA
GGTTTTGGATACGACCCTTCGAATTGCGCGGAAGATTTCCGAAGAAATCGGATCATCGGTACAGCAGGTGAACGCAGCCG
TGGGGCTCTTGGACGAGGGGGCGACTGTACCTTTTGTCGCGCGCTACCGCAAAGAGGTGACCGGGGGCCTTGATGACACG
CAATTGCGGACCTTGTCGGAGCGGCTGGAATACTTGCGCGAGCTGGAAAAGCGACGGGCCGCGATCCTGGAGACGATTAC
GCAGCAAGACAAGTTGACCGATGATCTGGCGGCATCGATTGCCAAGGCGGAGACCAAGGCGCAGCTCGAAGACATCTATC
TCCCCTTCAAACCCAAGCGTCGCACCAAGGCGATGATCGCGCGCGAAAACGGGCTTGAGCCTCTTCTGGAGGCTATTCTC
GCGGATCGCTCTGCTGATCCCGAGGTTTTGGCCGCGAACTACCTCTCCGGGGAAGTGGCAGACACAAAGACCGCTTTGAA
CGGTGCACGTGATATTCTCACCGAGCGTCTCACCGAGAATGCCGAGCTTTTGGGGCGGCTACGTAATTTCATGCAGTCTG
AAGCCATTTTGCGATCCAAAGTGGTCGAAGGACAGGAGCAGGCGGGTGCCAAATTCTCGGATTACTTCGATCATTCCGAG
GCTTGGAAAACCACCCCGTCGCATCGGGCTCTGGCGATGCTGCGCGGCTCCAACGAGGGCGTGCTGACGCTCGATATTGC
CCCACCGGGCGAAGAGGGGGTCACGCGAGCCGAAGAAATGGTCGCCGCTGTTCTGGAGGTGCGAAGCTCGGCTCCGGGCG
ACAAGTGGCTGCGCAAAGCGGCTGGTTGGACCTGGCGGGTCAAACTGTCGCTGTCGATGATGCTGGAGCTGATGGGCGAT
CTGCGCAGCCGGGCGCAGGACGAAGCTATTTCGGTTTTTGCGCGCAATCTCAAGGATTTGCTCTTCGCTGCCCCAGCCGG
TGCGCGGCCGACCCTCGGGCTGGACCCGGGCATTCGCACCGGCGTCAAGGCCGCAGTGGTTGATGCGACCGGGAAATTGG
TGGCCACAGAGACCCTCTATCCGTTCCAGCCGAAAAACGATCTGCGTGGTGCGCAGGTCTCCATTCTGAAGCTCATCGCC
GAGCACGGGGTTGAGCTGATCGCGATCGGCAATGGTACGGCCAGCCGCGAGACCGAGCGCATGGTCGCCGAAGTTCTGAA
AAACCTGCCCGCCAAGGTCAAAGCGCCGACCAAGGTGGTGGTTTCTGAGGCGGGCGCCTCGGTCTATTCCGCCTCCGAAC
TGGCTGCGCGTGAATTCCCGGATCTTGACGTCAGCTTGCGTGGTGCGGTTTCGATTGCGCGGCGCCTTCAGGATCCGCTA
GCGGAACTGGTCAAGATTGAGCCCAAGAGCATTGGGGTCGGACAATATCAGCATGACGTGGACCAGCATAAGCTTTCCAA
GTCACTCGAAGCCGTGATCGAAGATGTGGTGAACGCGGTTGGTGTTGATCTCAACATGGCGTCCGCACCGCTTTTGGCAC
ATGTCTCGGGTCTTGGTCCCGGCCTTGCCGAAGCCATCGTGGCGCATCGCGACCTCAACGGCGCTTTCAAGACCCGCAAA
GAACTCTTGAAGGTTGCGCGTCTTGGCCCCAAGGCGTTTGAGCAATGTGCAGGTTTCCTGCGTATCCAAGGCGGCAAAGA
GCCTCTGGACGCCTCTGCGGTCCACCCCGAAAGCTATGATGTCGCGCGCAAGATCGTGAGCGCCTGCGGCCGCGATATTC
GCGAGATCATGGGGGACGCCACGGCGCTGAAATCCCTCCGGGCTGAGCAATTCGTCTCTGGTGAGGTCGGCCTGCCCACC
GTACATGACATCTTTGCGGAGCTGGAAAAACCGGGGCGTGATCCACGTCCCTCTTTCGTCACCGCAAGCTTTACCGATGG
CGTGGAGGAGATCACTGATCTCAAACCCGGTATGGTTCTTGAGGGCACAGTGACCAATGTTGCGGCCTTCGGGGCCTTCG
TGGACATTGGTGTGCACCAAGACGGTCTTGTGCATGTGAGCCAGCTGGCCGACAAATTCGTCAAGGACCCGCATGAGATT
GTGAAAACCGGTCAGGTGGTCAAGGTCACGGTGGTCGAGGTGGACGTGCCGCGCAAACGCATCGGCCTGACCATGAAAAA
GGACGGTGGCGCATCTGCGCGAGAGGATCGCGCAGGCCGTGGGCCCTCCCAGAATGCAGCGCGCGGTGGTGCCAAAGGGC
GCAATTCCTCCTCACCCAAACGCCACGGCTCTGCCGCGCCCAGAGGCAAATCCGCCTCGGATAACGGCGCAACGGGCAAT
GGCGCATTGGGGGCCGCCTTGATGGATGCCTTCAAGAAGAAATAG

Upstream 100 bases:

>100_bases
TCACTTTGAGTAAGCGGGTTTCAGATTAAGAATATGCAAATTGTGGGCTGGTTTTCGACGCAGCTTGCCCGCAACGTTTC
CTGATCTCGGCTTGGCCTTG

Downstream 100 bases:

>100_bases
CCCTCGACTGACACGCACCGGCGCCCCTTCTTCTAACGGAAAATATCCCGGGGGAGGGGGCCGGAAGGGACCACCGCGGG
CAGAGCCCCCCTTTTGATCG

Product: RNA binding S1

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 814; Mature: 814

Protein sequence:

>814_residues
MFRTAKTVLRPQWLRIIVADAKAKEQQVLDTTLRIARKISEEIGSSVQQVNAAVGLLDEGATVPFVARYRKEVTGGLDDT
QLRTLSERLEYLRELEKRRAAILETITQQDKLTDDLAASIAKAETKAQLEDIYLPFKPKRRTKAMIARENGLEPLLEAIL
ADRSADPEVLAANYLSGEVADTKTALNGARDILTERLTENAELLGRLRNFMQSEAILRSKVVEGQEQAGAKFSDYFDHSE
AWKTTPSHRALAMLRGSNEGVLTLDIAPPGEEGVTRAEEMVAAVLEVRSSAPGDKWLRKAAGWTWRVKLSLSMMLELMGD
LRSRAQDEAISVFARNLKDLLFAAPAGARPTLGLDPGIRTGVKAAVVDATGKLVATETLYPFQPKNDLRGAQVSILKLIA
EHGVELIAIGNGTASRETERMVAEVLKNLPAKVKAPTKVVVSEAGASVYSASELAAREFPDLDVSLRGAVSIARRLQDPL
AELVKIEPKSIGVGQYQHDVDQHKLSKSLEAVIEDVVNAVGVDLNMASAPLLAHVSGLGPGLAEAIVAHRDLNGAFKTRK
ELLKVARLGPKAFEQCAGFLRIQGGKEPLDASAVHPESYDVARKIVSACGRDIREIMGDATALKSLRAEQFVSGEVGLPT
VHDIFAELEKPGRDPRPSFVTASFTDGVEEITDLKPGMVLEGTVTNVAAFGAFVDIGVHQDGLVHVSQLADKFVKDPHEI
VKTGQVVKVTVVEVDVPRKRIGLTMKKDGGASAREDRAGRGPSQNAARGGAKGRNSSSPKRHGSAAPRGKSASDNGATGN
GALGAALMDAFKKK

Sequences:

>Translated_814_residues
MFRTAKTVLRPQWLRIIVADAKAKEQQVLDTTLRIARKISEEIGSSVQQVNAAVGLLDEGATVPFVARYRKEVTGGLDDT
QLRTLSERLEYLRELEKRRAAILETITQQDKLTDDLAASIAKAETKAQLEDIYLPFKPKRRTKAMIARENGLEPLLEAIL
ADRSADPEVLAANYLSGEVADTKTALNGARDILTERLTENAELLGRLRNFMQSEAILRSKVVEGQEQAGAKFSDYFDHSE
AWKTTPSHRALAMLRGSNEGVLTLDIAPPGEEGVTRAEEMVAAVLEVRSSAPGDKWLRKAAGWTWRVKLSLSMMLELMGD
LRSRAQDEAISVFARNLKDLLFAAPAGARPTLGLDPGIRTGVKAAVVDATGKLVATETLYPFQPKNDLRGAQVSILKLIA
EHGVELIAIGNGTASRETERMVAEVLKNLPAKVKAPTKVVVSEAGASVYSASELAAREFPDLDVSLRGAVSIARRLQDPL
AELVKIEPKSIGVGQYQHDVDQHKLSKSLEAVIEDVVNAVGVDLNMASAPLLAHVSGLGPGLAEAIVAHRDLNGAFKTRK
ELLKVARLGPKAFEQCAGFLRIQGGKEPLDASAVHPESYDVARKIVSACGRDIREIMGDATALKSLRAEQFVSGEVGLPT
VHDIFAELEKPGRDPRPSFVTASFTDGVEEITDLKPGMVLEGTVTNVAAFGAFVDIGVHQDGLVHVSQLADKFVKDPHEI
VKTGQVVKVTVVEVDVPRKRIGLTMKKDGGASAREDRAGRGPSQNAARGGAKGRNSSSPKRHGSAAPRGKSASDNGATGN
GALGAALMDAFKKK
>Mature_814_residues
MFRTAKTVLRPQWLRIIVADAKAKEQQVLDTTLRIARKISEEIGSSVQQVNAAVGLLDEGATVPFVARYRKEVTGGLDDT
QLRTLSERLEYLRELEKRRAAILETITQQDKLTDDLAASIAKAETKAQLEDIYLPFKPKRRTKAMIARENGLEPLLEAIL
ADRSADPEVLAANYLSGEVADTKTALNGARDILTERLTENAELLGRLRNFMQSEAILRSKVVEGQEQAGAKFSDYFDHSE
AWKTTPSHRALAMLRGSNEGVLTLDIAPPGEEGVTRAEEMVAAVLEVRSSAPGDKWLRKAAGWTWRVKLSLSMMLELMGD
LRSRAQDEAISVFARNLKDLLFAAPAGARPTLGLDPGIRTGVKAAVVDATGKLVATETLYPFQPKNDLRGAQVSILKLIA
EHGVELIAIGNGTASRETERMVAEVLKNLPAKVKAPTKVVVSEAGASVYSASELAAREFPDLDVSLRGAVSIARRLQDPL
AELVKIEPKSIGVGQYQHDVDQHKLSKSLEAVIEDVVNAVGVDLNMASAPLLAHVSGLGPGLAEAIVAHRDLNGAFKTRK
ELLKVARLGPKAFEQCAGFLRIQGGKEPLDASAVHPESYDVARKIVSACGRDIREIMGDATALKSLRAEQFVSGEVGLPT
VHDIFAELEKPGRDPRPSFVTASFTDGVEEITDLKPGMVLEGTVTNVAAFGAFVDIGVHQDGLVHVSQLADKFVKDPHEI
VKTGQVVKVTVVEVDVPRKRIGLTMKKDGGASAREDRAGRGPSQNAARGGAKGRNSSSPKRHGSAAPRGKSASDNGATGN
GALGAALMDAFKKK

Specific function: Unknown

COG id: COG2183

COG function: function code K; Transcriptional accessory protein

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 S1 motif domain [H]

Homologues:

Organism=Homo sapiens, GI221136781, Length=774, Percent_Identity=33.2041343669251, Blast_Score=352, Evalue=9e-97,
Organism=Homo sapiens, GI27597090, Length=724, Percent_Identity=24.0331491712707, Blast_Score=111, Evalue=3e-24,
Organism=Escherichia coli, GI87082262, Length=775, Percent_Identity=59.3548387096774, Blast_Score=879, Evalue=0.0,
Organism=Escherichia coli, GI1787140, Length=79, Percent_Identity=41.7721518987342, Blast_Score=64, Evalue=4e-11,
Organism=Escherichia coli, GI145693187, Length=81, Percent_Identity=46.9135802469136, Blast_Score=63, Evalue=7e-11,
Organism=Caenorhabditis elegans, GI17511129, Length=738, Percent_Identity=28.7262872628726, Blast_Score=239, Evalue=4e-63,
Organism=Caenorhabditis elegans, GI17552892, Length=284, Percent_Identity=33.0985915492958, Blast_Score=97, Evalue=4e-20,
Organism=Saccharomyces cerevisiae, GI6321552, Length=186, Percent_Identity=29.0322580645161, Blast_Score=77, Evalue=1e-14,
Organism=Drosophila melanogaster, GI62484314, Length=750, Percent_Identity=31.3333333333333, Blast_Score=350, Evalue=3e-96,
Organism=Drosophila melanogaster, GI24640080, Length=425, Percent_Identity=23.2941176470588, Blast_Score=98, Evalue=3e-20,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR003583
- InterPro:   IPR012340
- InterPro:   IPR016027
- InterPro:   IPR003029
- InterPro:   IPR005227
- InterPro:   IPR006641
- InterPro:   IPR022967
- InterPro:   IPR018974
- InterPro:   IPR023097 [H]

Pfam domain/function: PF00575 S1; PF09371 Tex_N [H]

EC number: NA

Molecular weight: Translated: 87561; Mature: 87561

Theoretical pI: Translated: 8.84; Mature: 8.84

Prosite motif: PS50126 S1

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.2 %Cys     (Translated Protein)
1.7 %Met     (Translated Protein)
2.0 %Cys+Met (Translated Protein)
0.2 %Cys     (Mature Protein)
1.7 %Met     (Mature Protein)
2.0 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MFRTAKTVLRPQWLRIIVADAKAKEQQVLDTTLRIARKISEEIGSSVQQVNAAVGLLDEG
CCCCHHHHHCHHHHEEEEECCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCC
ATVPFVARYRKEVTGGLDDTQLRTLSERLEYLRELEKRRAAILETITQQDKLTDDLAASI
CCCHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
AKAETKAQLEDIYLPFKPKRRTKAMIARENGLEPLLEAILADRSADPEVLAANYLSGEVA
HHHHHHHHHHHHCCCCCCCHHHHHHHHHHCCHHHHHHHHHHCCCCCCCCEEHHHCCCCHH
DTKTALNGARDILTERLTENAELLGRLRNFMQSEAILRSKVVEGQEQAGAKFSDYFDHSE
HHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHCCHHHHCCCHHHHHCCHH
AWKTTPSHRALAMLRGSNEGVLTLDIAPPGEEGVTRAEEMVAAVLEVRSSAPGDKWLRKA
HHCCCCCHHHHHEEECCCCCEEEEEECCCCCHHHHHHHHHHHHHHHHHCCCCHHHHHHHH
AGWTWRVKLSLSMMLELMGDLRSRAQDEAISVFARNLKDLLFAAPAGARPTLGLDPGIRT
CCCEEEEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCHH
GVKAAVVDATGKLVATETLYPFQPKNDLRGAQVSILKLIAEHGVELIAIGNGTASRETER
CCCEEEEECCCCEEEECCCCCCCCCCCCCHHHHHHHHHHHHCCCEEEEECCCCCCHHHHH
MVAEVLKNLPAKVKAPTKVVVSEAGASVYSASELAAREFPDLDVSLRGAVSIARRLQDPL
HHHHHHHCCCCCCCCCHHHHHHHCCCHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHH
AELVKIEPKSIGVGQYQHDVDQHKLSKSLEAVIEDVVNAVGVDLNMASAPLLAHVSGLGP
HHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHCCCC
GLAEAIVAHRDLNGAFKTRKELLKVARLGPKAFEQCAGFLRIQGGKEPLDASAVHPESYD
HHHHHHHHHHCCCHHHHHHHHHHHHHHCCHHHHHHHHCCEEECCCCCCCCCCCCCCCHHH
VARKIVSACGRDIREIMGDATALKSLRAEQFVSGEVGLPTVHDIFAELEKPGRDPRPSFV
HHHHHHHHHCHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHCCCCCCCCCEE
TASFTDGVEEITDLKPGMVLEGTVTNVAAFGAFVDIGVHQDGLVHVSQLADKFVKDPHEI
EEHHHCCHHHHHHCCCCEEEECHHHHHHHHHHHHEECCCCCCHHHHHHHHHHHHCCHHHH
VKTGQVVKVTVVEVDVPRKRIGLTMKKDGGASAREDRAGRGPSQNAARGGAKGRNSSSPK
HHCCCEEEEEEEEEECCHHHHCEEEECCCCCCCCHHCCCCCCCCCCCCCCCCCCCCCCCC
RHGSAAPRGKSASDNGATGNGALGAALMDAFKKK
CCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHCC
>Mature Secondary Structure
MFRTAKTVLRPQWLRIIVADAKAKEQQVLDTTLRIARKISEEIGSSVQQVNAAVGLLDEG
CCCCHHHHHCHHHHEEEEECCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCC
ATVPFVARYRKEVTGGLDDTQLRTLSERLEYLRELEKRRAAILETITQQDKLTDDLAASI
CCCHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
AKAETKAQLEDIYLPFKPKRRTKAMIARENGLEPLLEAILADRSADPEVLAANYLSGEVA
HHHHHHHHHHHHCCCCCCCHHHHHHHHHHCCHHHHHHHHHHCCCCCCCCEEHHHCCCCHH
DTKTALNGARDILTERLTENAELLGRLRNFMQSEAILRSKVVEGQEQAGAKFSDYFDHSE
HHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHCCHHHHCCCHHHHHCCHH
AWKTTPSHRALAMLRGSNEGVLTLDIAPPGEEGVTRAEEMVAAVLEVRSSAPGDKWLRKA
HHCCCCCHHHHHEEECCCCCEEEEEECCCCCHHHHHHHHHHHHHHHHHCCCCHHHHHHHH
AGWTWRVKLSLSMMLELMGDLRSRAQDEAISVFARNLKDLLFAAPAGARPTLGLDPGIRT
CCCEEEEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCHH
GVKAAVVDATGKLVATETLYPFQPKNDLRGAQVSILKLIAEHGVELIAIGNGTASRETER
CCCEEEEECCCCEEEECCCCCCCCCCCCCHHHHHHHHHHHHCCCEEEEECCCCCCHHHHH
MVAEVLKNLPAKVKAPTKVVVSEAGASVYSASELAAREFPDLDVSLRGAVSIARRLQDPL
HHHHHHHCCCCCCCCCHHHHHHHCCCHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHH
AELVKIEPKSIGVGQYQHDVDQHKLSKSLEAVIEDVVNAVGVDLNMASAPLLAHVSGLGP
HHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHCCCC
GLAEAIVAHRDLNGAFKTRKELLKVARLGPKAFEQCAGFLRIQGGKEPLDASAVHPESYD
HHHHHHHHHHCCCHHHHHHHHHHHHHHCCHHHHHHHHCCEEECCCCCCCCCCCCCCCHHH
VARKIVSACGRDIREIMGDATALKSLRAEQFVSGEVGLPTVHDIFAELEKPGRDPRPSFV
HHHHHHHHHCHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHCCCCCCCCCEE
TASFTDGVEEITDLKPGMVLEGTVTNVAAFGAFVDIGVHQDGLVHVSQLADKFVKDPHEI
EEHHHCCHHHHHHCCCCEEEECHHHHHHHHHHHHEECCCCCCHHHHHHHHHHHHCCHHHH
VKTGQVVKVTVVEVDVPRKRIGLTMKKDGGASAREDRAGRGPSQNAARGGAKGRNSSSPK
HHCCCEEEEEEEEEECCHHHHCEEEECCCCCCCCHHCCCCCCCCCCCCCCCCCCCCCCCC
RHGSAAPRGKSASDNGATGNGALGAALMDAFKKK
CCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 7542800 [H]