The gene/protein map for NC_012633 is currently unavailable.
Definition Rickettsia africae ESF-5 chromosome, complete genome.
Accession NC_012633
Length 1,278,540

Click here to switch to the map view.

The map label for this gene is yjcF [C]

Identifier: 229586866

GI number: 229586866

Start: 769824

End: 772697

Strand: Direct

Name: yjcF [C]

Synonym: RAF_ORF0737

Alternate gene names: 229586866

Gene position: 769824-772697 (Clockwise)

Preceding gene: 229586865

Following gene: 229586867

Centisome position: 60.21

GC content: 31.73

Gene sequence:

>2874_bases
ATGACAAATCTTAATATATATAAATGTACAGAAAAAGACCTAAACGATTACCTTGGTTATATAAAAGATACCCCTAGTGT
CTCGCTAAATGATTTTATCAAAAATAAATATTTCGCTGAAGATAATGATAACATTATCATTACTAGTTTAGAAAATATGG
AAATTAACGCAGATTTAGCCAATGCTAATTTCCAAGGTACAATACTAACAGATGCCGTATTTAATAATTGTGACTTAACA
AATACCATATTATGTGATTCAGATTTAACAAATGTAAAATTTAATGATTGTACATTTATCGGTACCGACTTTAGAGGAGC
AAATCTTCATTATACAGATTTTAATTATAAAGATTATGATAACTATAAAATTCCCAATCTCAAAGATAAAATACGAGATA
TAAAACTATCTTTTTCAGATCTTGCAAGATTAAATCAATATATAGATAAAGATTTAGAAAAAGAACATATCAAAGAAATA
GTTATAGATGAAGCTACGAAGACAAAGAAATATATTTTGGCTGGAGAAGACGAAAAAACTTTATGGGACATCAAATCAAA
AGAACTAAAGACTAAGCAAGAAGAGTTAGAAACTCTAAAGCAAAATTTAGATAATCCTGGGATTGCTACCAATCTTTTAA
ATGCTTTTTGGAATAGTGCAGAAACTATTGCTAGAAACCGACAAAACGAACTAGAAAAAATCAACAAGTTACAGCATGAA
GTAAACAAATTAGAAACTGAAGTATATGCTTTAGATAATCTTAGAATGTTCTGCGGTAAGGGTTTAGATGGTATTTTTGA
GCAGTTAAAAGACGAAGAAATACAAATAACACTAGACCCATCATATATTATAGGTTCGACTGCCACAGAACGAGATATAC
CGAAAGAATATATAAAATTAACTTCTGTCGAATTTGATCTATATTTAGCTGAAGCAGCAAAACAATCCAATACAAAATTA
TCTCTTACCGAATTTGTTAGAAAGCAAAAAAATCTTTCAGAAGATTTAAATATAGTTCCTGATCTTTCAGCGATTAATTT
ATCAGGTAAAACTCTTACTAATCTTAACCTGAAGAACACATTATTTGCTTCAGCCAACTTAGAGAATGTCAAAATCTCAA
ATTGTAATTTAGATTTTACTAATTTTGAAGGAGCTAATTTACAAAATGCCGTTTTTCAAAATGTTACGGCTCGTAACGCA
GGATTTCTTTTTGCTGATCTTAAAAAGAGCAAAATTGAAAATAGTGATATGTCAAGAGCTTACATGCCTAAAGTAGATTT
ATCTGAAGTAGAGGTAACAAATAGCAAATTTAATGCGGTTATGATGGTTAATGCCGATGCCGAAAAGTTAATTATTAAAG
ATTCAGAATGGACAAATTCTAATCTTACCGGTATATCACTTGCCTATGCAGATATGCAAAGAGTTCAAATGCAGGGGGTA
GTTTTAAATAATGCACTTCTAGATCAAGCAAATATCGTTTCTACTAATCTTGAAAATGTTTTTATGAATAAAACACATGC
ATTAGAAGCAAAATTTAAAGAGCAATGTAACATGCAAGGCATAACTGCAAGAAATGCCTATTTTAGCGATGCTGAATTTG
AAAATATACTATCTTTAAAAGAAGCTGACTTAAGAGAAGCTATAATGCAGCGTGTTAAACTTAAGAACGCTGATTTAACA
AAAGCACAGCTTGATAAAGCAAATCTTGAATATGCCGATCTTACAAACGCTACGCTTACTAATGCAACTGCACAATTTGC
TAAGTTAAGTAATGCTACTTTAGAAAAAGCAGAAGCCGAGGGATTAAATATTTCGGATGCTATTGCTAAAAATATTAATG
CTAAGGAAGCTAACTTTAAAAATACAATTATGCAGCGTGCCGATCTTACTAAAGCCAATTTCACTAAAGCAGTGTTGGAA
AATGCCGATATGCAAGCAGTGGAAGCAGCCGAGGCTATATTTAAAGAAGCAAATCTAAAACAAGCGAATCTAAAAGCAGC
AAATCTAGCTGGAATTAATAAAGAAGGAGCAGATTTTGATAAAGCAAAAATCAACGATGCTACAAAGATGCATGATACTA
AAGGTGAGGCTAAAGGGAATTTAGATCATCAAGATAAAGACGGTAAAAAAACATCTGTCAATGTTAACGAACATGCTAAA
TTACAAGATAAAATTCATGCAAGAGAGAAAAGCGGTTGGTTTCTGAAAACCGGAGTAGGACAGCTTTGTACAAAACTTGC
TAAAAGTACTACATCAGGAATTAGCCGCGTAACAAAATTTTTAGCAAGTAAAAAATTTGTAGTAGGACTTGCCGTAGTAG
CCGGTCTTGCAGTAGCAGCTGCACCTTTCGTAGCAATGCCTGTGTTATTGGTCACCGGCACGGCCCTTACTACTAAAGCT
TTCATTCTAGGAGCAGGTATTGTGGCCGGAGGGCTAATCGCTACCGGAACTTATAAACTCACTCAAAAACCTTTACGCAA
TCTTCAGAAGTCATTTGAAAACTTAACTAGTAGTATAGATAAATATATCTCACCACCTCCTAAAAATATTGATGAATTAG
TAACAGCAAAACAACAAGCAAGACAAAAAGCTGAGACAGAAAAATCTAAAAAAAGGGAAGAAAATTTAAATAATGTTAAT
AATAATATTGATAAAGCTAAAGAACAAGATCTTTTAAAACAAGCACAAAATAATTTAAACCAAGCAACGCCAAAAGTAGA
AATCAAAGAAAAGAAAGATAAAACTGTAGAAAAACAACAAGCAAAATCTAATACATTCGCAGCAAAATTCAAGCCTAACA
CTAAAGGCAAAGGATTTGCCACAAAAATAAAAGACGAAAAAAAATCACACTCAATAAAAGAAGCATATAACTAA

Upstream 100 bases:

>100_bases
CTAAAACCCGGAGATTATAAAGAAATAAATAATAAAATACTGGAAAATCATTAGTAATGTGTTATTATTAATACATTTTA
ACTAATCATATAGAATACAT

Downstream 100 bases:

>100_bases
ATAAGTGTTAAAAATAATATCCGGTAAATATAGAAACCAAATTATACCTACCGCTAAAAATATCAAATATCGACCTTCCA
CCGGTAAGCTCAAAGAGGCA

Product: hypothetical protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 957; Mature: 956

Protein sequence:

>957_residues
MTNLNIYKCTEKDLNDYLGYIKDTPSVSLNDFIKNKYFAEDNDNIIITSLENMEINADLANANFQGTILTDAVFNNCDLT
NTILCDSDLTNVKFNDCTFIGTDFRGANLHYTDFNYKDYDNYKIPNLKDKIRDIKLSFSDLARLNQYIDKDLEKEHIKEI
VIDEATKTKKYILAGEDEKTLWDIKSKELKTKQEELETLKQNLDNPGIATNLLNAFWNSAETIARNRQNELEKINKLQHE
VNKLETEVYALDNLRMFCGKGLDGIFEQLKDEEIQITLDPSYIIGSTATERDIPKEYIKLTSVEFDLYLAEAAKQSNTKL
SLTEFVRKQKNLSEDLNIVPDLSAINLSGKTLTNLNLKNTLFASANLENVKISNCNLDFTNFEGANLQNAVFQNVTARNA
GFLFADLKKSKIENSDMSRAYMPKVDLSEVEVTNSKFNAVMMVNADAEKLIIKDSEWTNSNLTGISLAYADMQRVQMQGV
VLNNALLDQANIVSTNLENVFMNKTHALEAKFKEQCNMQGITARNAYFSDAEFENILSLKEADLREAIMQRVKLKNADLT
KAQLDKANLEYADLTNATLTNATAQFAKLSNATLEKAEAEGLNISDAIAKNINAKEANFKNTIMQRADLTKANFTKAVLE
NADMQAVEAAEAIFKEANLKQANLKAANLAGINKEGADFDKAKINDATKMHDTKGEAKGNLDHQDKDGKKTSVNVNEHAK
LQDKIHAREKSGWFLKTGVGQLCTKLAKSTTSGISRVTKFLASKKFVVGLAVVAGLAVAAAPFVAMPVLLVTGTALTTKA
FILGAGIVAGGLIATGTYKLTQKPLRNLQKSFENLTSSIDKYISPPPKNIDELVTAKQQARQKAETEKSKKREENLNNVN
NNIDKAKEQDLLKQAQNNLNQATPKVEIKEKKDKTVEKQQAKSNTFAAKFKPNTKGKGFATKIKDEKKSHSIKEAYN

Sequences:

>Translated_957_residues
MTNLNIYKCTEKDLNDYLGYIKDTPSVSLNDFIKNKYFAEDNDNIIITSLENMEINADLANANFQGTILTDAVFNNCDLT
NTILCDSDLTNVKFNDCTFIGTDFRGANLHYTDFNYKDYDNYKIPNLKDKIRDIKLSFSDLARLNQYIDKDLEKEHIKEI
VIDEATKTKKYILAGEDEKTLWDIKSKELKTKQEELETLKQNLDNPGIATNLLNAFWNSAETIARNRQNELEKINKLQHE
VNKLETEVYALDNLRMFCGKGLDGIFEQLKDEEIQITLDPSYIIGSTATERDIPKEYIKLTSVEFDLYLAEAAKQSNTKL
SLTEFVRKQKNLSEDLNIVPDLSAINLSGKTLTNLNLKNTLFASANLENVKISNCNLDFTNFEGANLQNAVFQNVTARNA
GFLFADLKKSKIENSDMSRAYMPKVDLSEVEVTNSKFNAVMMVNADAEKLIIKDSEWTNSNLTGISLAYADMQRVQMQGV
VLNNALLDQANIVSTNLENVFMNKTHALEAKFKEQCNMQGITARNAYFSDAEFENILSLKEADLREAIMQRVKLKNADLT
KAQLDKANLEYADLTNATLTNATAQFAKLSNATLEKAEAEGLNISDAIAKNINAKEANFKNTIMQRADLTKANFTKAVLE
NADMQAVEAAEAIFKEANLKQANLKAANLAGINKEGADFDKAKINDATKMHDTKGEAKGNLDHQDKDGKKTSVNVNEHAK
LQDKIHAREKSGWFLKTGVGQLCTKLAKSTTSGISRVTKFLASKKFVVGLAVVAGLAVAAAPFVAMPVLLVTGTALTTKA
FILGAGIVAGGLIATGTYKLTQKPLRNLQKSFENLTSSIDKYISPPPKNIDELVTAKQQARQKAETEKSKKREENLNNVN
NNIDKAKEQDLLKQAQNNLNQATPKVEIKEKKDKTVEKQQAKSNTFAAKFKPNTKGKGFATKIKDEKKSHSIKEAYN
>Mature_956_residues
TNLNIYKCTEKDLNDYLGYIKDTPSVSLNDFIKNKYFAEDNDNIIITSLENMEINADLANANFQGTILTDAVFNNCDLTN
TILCDSDLTNVKFNDCTFIGTDFRGANLHYTDFNYKDYDNYKIPNLKDKIRDIKLSFSDLARLNQYIDKDLEKEHIKEIV
IDEATKTKKYILAGEDEKTLWDIKSKELKTKQEELETLKQNLDNPGIATNLLNAFWNSAETIARNRQNELEKINKLQHEV
NKLETEVYALDNLRMFCGKGLDGIFEQLKDEEIQITLDPSYIIGSTATERDIPKEYIKLTSVEFDLYLAEAAKQSNTKLS
LTEFVRKQKNLSEDLNIVPDLSAINLSGKTLTNLNLKNTLFASANLENVKISNCNLDFTNFEGANLQNAVFQNVTARNAG
FLFADLKKSKIENSDMSRAYMPKVDLSEVEVTNSKFNAVMMVNADAEKLIIKDSEWTNSNLTGISLAYADMQRVQMQGVV
LNNALLDQANIVSTNLENVFMNKTHALEAKFKEQCNMQGITARNAYFSDAEFENILSLKEADLREAIMQRVKLKNADLTK
AQLDKANLEYADLTNATLTNATAQFAKLSNATLEKAEAEGLNISDAIAKNINAKEANFKNTIMQRADLTKANFTKAVLEN
ADMQAVEAAEAIFKEANLKQANLKAANLAGINKEGADFDKAKINDATKMHDTKGEAKGNLDHQDKDGKKTSVNVNEHAKL
QDKIHAREKSGWFLKTGVGQLCTKLAKSTTSGISRVTKFLASKKFVVGLAVVAGLAVAAAPFVAMPVLLVTGTALTTKAF
ILGAGIVAGGLIATGTYKLTQKPLRNLQKSFENLTSSIDKYISPPPKNIDELVTAKQQARQKAETEKSKKREENLNNVNN
NIDKAKEQDLLKQAQNNLNQATPKVEIKEKKDKTVEKQQAKSNTFAAKFKPNTKGKGFATKIKDEKKSHSIKEAYN

Specific function: Unknown

COG id: COG1357

COG function: function code S; Uncharacterized low-complexity proteins

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 7 pentapeptide repeat domains [H]

Homologues:

Organism=Escherichia coli, GI1790502, Length=229, Percent_Identity=24.0174672489083, Blast_Score=68, Evalue=3e-12,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR001646 [H]

Pfam domain/function: PF00805 Pentapeptide [H]

EC number: NA

Molecular weight: Translated: 106722; Mature: 106591

Theoretical pI: Translated: 7.23; Mature: 7.23

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.8 %Cys     (Translated Protein)
1.7 %Met     (Translated Protein)
2.5 %Cys+Met (Translated Protein)
0.8 %Cys     (Mature Protein)
1.6 %Met     (Mature Protein)
2.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTNLNIYKCTEKDLNDYLGYIKDTPSVSLNDFIKNKYFAEDNDNIIITSLENMEINADLA
CCCCEEEECCHHHHHHHHHHHCCCCCCCHHHHHHCCCCCCCCCCEEEEEECCEEEECEEC
NANFQGTILTDAVFNNCDLTNTILCDSDLTNVKFNDCTFIGTDFRGANLHYTDFNYKDYD
CCCCCCEEEHHHHHCCCCCCCEEEECCCCCCEEECCEEEEECCCCCCEEEEECCCCCCCC
NYKIPNLKDKIRDIKLSFSDLARLNQYIDKDLEKEHIKEIVIDEATKTKKYILAGEDEKT
CCCCCCHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEEECCCCCH
LWDIKSKELKTKQEELETLKQNLDNPGIATNLLNAFWNSAETIARNRQNELEKINKLQHE
HHCCCHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHCHHHHHHHHHHHHHHHHHHHHHH
VNKLETEVYALDNLRMFCGKGLDGIFEQLKDEEIQITLDPSYIIGSTATERDIPKEYIKL
HHHHHHHHHHHHHHHHHHCCCHHHHHHHCCCCCEEEEECCCEEECCCCCCCCCCHHHHHH
TSVEFDLYLAEAAKQSNTKLSLTEFVRKQKNLSEDLNIVPDLSAINLSGKTLTNLNLKNT
HCEEEHHHHHHHHHCCCCEEHHHHHHHHHHCCHHCCCCCCCCCEEECCCCEEECCCCCCE
LFASANLENVKISNCNLDFTNFEGANLQNAVFQNVTARNAGFLFADLKKSKIENSDMSRA
EEECCCCCEEEEECCCEEECCCCCCCHHHHHHHHHHCCCCCEEEEHHHHHHCCCCCCCHH
YMPKVDLSEVEVTNSKFNAVMMVNADAEKLIIKDSEWTNSNLTGISLAYADMQRVQMQGV
HCCCCCCCCEEEECCCCCEEEEEECCCCEEEEECCCCCCCCCCEEEEHHHHHHHHHHHCE
VLNNALLDQANIVSTNLENVFMNKTHALEAKFKEQCNMQGITARNAYFSDAEFENILSLK
EEHHHHHCCCHHHHCCHHHHHHCCHHHHHHHHHHHCCCCCCEECCCCCCCCHHHHHHHHH
EADLREAIMQRVKLKNADLTKAQLDKANLEYADLTNATLTNATAQFAKLSNATLEKAEAE
HHHHHHHHHHHHHHCCCCCCHHHHHHCCCCHHHCCCCHHHHHHHHHHHHHHHHHHHHHCC
GLNISDAIAKNINAKEANFKNTIMQRADLTKANFTKAVLENADMQAVEAAEAIFKEANLK
CCCHHHHHHHCCCCCCCHHHHHHHHHHCCCHHHHHHHHHCCCCHHHHHHHHHHHHHCCCC
QANLKAANLAGINKEGADFDKAKINDATKMHDTKGEAKGNLDHQDKDGKKTSVNVNEHAK
HHCCCHHHCCCCCCCCCCCCHHHCCCHHHHCCCCCCCCCCCCCCCCCCCEEEECCCHHHH
LQDKIHAREKSGWFLKTGVGQLCTKLAKSTTSGISRVTKFLASKKFVVGLAVVAGLAVAA
HHHHHHHHHCCCCEEECCHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHH
APFVAMPVLLVTGTALTTKAFILGAGIVAGGLIATGTYKLTQKPLRNLQKSFENLTSSID
HHHHHHHHHHHCCCHHHHHHHHHHHHHHHCCHHCCCCHHHHHHHHHHHHHHHHHHHHHHH
KYISPPPKNIDELVTAKQQARQKAETEKSKKREENLNNVNNNIDKAKEQDLLKQAQNNLN
HHCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHH
QATPKVEIKEKKDKTVEKQQAKSNTFAAKFKPNTKGKGFATKIKDEKKSHSIKEAYN
HCCCCEEECCHHHHHHHHHHHCCCCEEEEECCCCCCCCCEECCCHHHHHHHHHHHCC
>Mature Secondary Structure 
TNLNIYKCTEKDLNDYLGYIKDTPSVSLNDFIKNKYFAEDNDNIIITSLENMEINADLA
CCCEEEECCHHHHHHHHHHHCCCCCCCHHHHHHCCCCCCCCCCEEEEEECCEEEECEEC
NANFQGTILTDAVFNNCDLTNTILCDSDLTNVKFNDCTFIGTDFRGANLHYTDFNYKDYD
CCCCCCEEEHHHHHCCCCCCCEEEECCCCCCEEECCEEEEECCCCCCEEEEECCCCCCCC
NYKIPNLKDKIRDIKLSFSDLARLNQYIDKDLEKEHIKEIVIDEATKTKKYILAGEDEKT
CCCCCCHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEEECCCCCH
LWDIKSKELKTKQEELETLKQNLDNPGIATNLLNAFWNSAETIARNRQNELEKINKLQHE
HHCCCHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHCHHHHHHHHHHHHHHHHHHHHHH
VNKLETEVYALDNLRMFCGKGLDGIFEQLKDEEIQITLDPSYIIGSTATERDIPKEYIKL
HHHHHHHHHHHHHHHHHHCCCHHHHHHHCCCCCEEEEECCCEEECCCCCCCCCCHHHHHH
TSVEFDLYLAEAAKQSNTKLSLTEFVRKQKNLSEDLNIVPDLSAINLSGKTLTNLNLKNT
HCEEEHHHHHHHHHCCCCEEHHHHHHHHHHCCHHCCCCCCCCCEEECCCCEEECCCCCCE
LFASANLENVKISNCNLDFTNFEGANLQNAVFQNVTARNAGFLFADLKKSKIENSDMSRA
EEECCCCCEEEEECCCEEECCCCCCCHHHHHHHHHHCCCCCEEEEHHHHHHCCCCCCCHH
YMPKVDLSEVEVTNSKFNAVMMVNADAEKLIIKDSEWTNSNLTGISLAYADMQRVQMQGV
HCCCCCCCCEEEECCCCCEEEEEECCCCEEEEECCCCCCCCCCEEEEHHHHHHHHHHHCE
VLNNALLDQANIVSTNLENVFMNKTHALEAKFKEQCNMQGITARNAYFSDAEFENILSLK
EEHHHHHCCCHHHHCCHHHHHHCCHHHHHHHHHHHCCCCCCEECCCCCCCCHHHHHHHHH
EADLREAIMQRVKLKNADLTKAQLDKANLEYADLTNATLTNATAQFAKLSNATLEKAEAE
HHHHHHHHHHHHHHCCCCCCHHHHHHCCCCHHHCCCCHHHHHHHHHHHHHHHHHHHHHCC
GLNISDAIAKNINAKEANFKNTIMQRADLTKANFTKAVLENADMQAVEAAEAIFKEANLK
CCCHHHHHHHCCCCCCCHHHHHHHHHHCCCHHHHHHHHHCCCCHHHHHHHHHHHHHCCCC
QANLKAANLAGINKEGADFDKAKINDATKMHDTKGEAKGNLDHQDKDGKKTSVNVNEHAK
HHCCCHHHCCCCCCCCCCCCHHHCCCHHHHCCCCCCCCCCCCCCCCCCCEEEECCCHHHH
LQDKIHAREKSGWFLKTGVGQLCTKLAKSTTSGISRVTKFLASKKFVVGLAVVAGLAVAA
HHHHHHHHHCCCCEEECCHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHH
APFVAMPVLLVTGTALTTKAFILGAGIVAGGLIATGTYKLTQKPLRNLQKSFENLTSSID
HHHHHHHHHHHCCCHHHHHHHHHHHHHHHCCHHCCCCHHHHHHHHHHHHHHHHHHHHHHH
KYISPPPKNIDELVTAKQQARQKAETEKSKKREENLNNVNNNIDKAKEQDLLKQAQNNLN
HHCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHH
QATPKVEIKEKKDKTVEKQQAKSNTFAAKFKPNTKGKGFATKIKDEKKSHSIKEAYN
HCCCCEEECCHHHHHHHHHHHCCCCEEEEECCCCCCCCCEECCCHHHHHHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 8905231 [H]