| Definition | Ehrlichia chaffeensis str. Arkansas, complete genome. |
|---|---|
| Accession | NC_007799 |
| Length | 1,176,248 |
Click here to switch to the map view.
The map label for this gene is yjcF [C]
Identifier: 88658408
GI number: 88658408
Start: 1109879
End: 1111702
Strand: Direct
Name: yjcF [C]
Synonym: ECH_1083
Alternate gene names: 88658408
Gene position: 1109879-1111702 (Clockwise)
Preceding gene: 88658651
Following gene: 88658166
Centisome position: 94.36
GC content: 27.47
Gene sequence:
>1824_bases ATGAAGCATTGTATAAAACACACTTTTACAGTTTTAATAATATATACATTACTTTTGAACACTAATATATGTTTTGCCCA TACGACAGATCAAGATAATTTTTTTACTGTAAAACGCACTTCTTATACTAAAGAAGATTTTGTAAGCTTCATAGTAAAAT GTCATGCTAAAGGAATACCTTTAGATTTCAAGAAGGAATTCGGCAATAATTTATCTGGAGCAGATTTTAGTGATCTAGAC CTTCGAGGATCAGTATTTGATAACGTTAACCTACTACATGCAAATTTTACTAGAGCTAACTTATCCAATTCCACTTTTAT AGATTCCAATATGCAAGGAGCATCCTTCATTAATGCAAACTTAAGTAAATCCAACATAAAAAATTCAAACTTAAATTTTG CCAATTTCACATCTGCAGATTTACAAAAAACTACAATTACACAATCAAAAATCAACAATACAAACTTTAGTTACTCAGAC ATGCGCTTTTCTATTCTAACAGAAGTCAATGGATCCCTTGCAAACTTTTCTGAAACAGAATTAAAACTAGTTTCAATATT CAACTCTAATATAGAAAAAGCAAATTTTCATGACATTGAAGGTGAAAATATAGTAATCCAAAATTGTAATTTACTAGATT CAAACTTTTTTGGAGCAAATTTAAATAATTCAAAAATTCAATTTTCAAATCTCACAAATACTATCCTATACGCAGTAAAT CTAGATTCATCAGATATAACAGGAAGTAACCTAAGTAATAGCAACATGGAAGTATCAAATATTTCTTTTGCTAATTTTCA CAATGCTAATTTAAGCAATACAAACATGCATCTTGTAGATGCTCATTATACAAATCTTAATAATACAAATTTACATAAAG TTCGTATGAGTGATGCAACTCTAATTGGAGTAAATTTAAATCATGCTGTGTTATCTAACGCAGATTTGAGCAACGCAGAT TTAAGCAATGTCAGCATAGAAGAATCAGATATGCAAGAAATACTTCTTGACTCTACTAATATTACAAGAACGAATATGAA GCATGCTATTTTAAATAACGCAACTATTAATAATACAGTTATTTCAAATTCTGACCTTACGATGACATTAATAAAAGATT CTAAATGGAATAACTCTAGTATCTATTCAAGCAAATTAACCTCTGCAGTTATAGATAACAACATTATTAAACATGGTACA TATGATAAAGTAAATGCAACAAATACATTATGGTCTAATTCAACAATAGAAGATAGCAACATAATTTTCTGCAATTTTGA ATCTGCAATATTCAATAATGATAAAATACATAAAGTGAGCTTTTTTACAAATCACTTAGAATCCGCAAAAGTAGAAGATT CAAACATAGTCGGATCTAGCATTTACAAAAATACTCTCACCAATTTCATAATTAATAATTGTGACATTAAAAATACAATC ATTATCAACAATAAGAATTTTGTACCAACAGAATTTTCTAAACAGGCAATTACATCTATTACAGCTTTACAAGACGCTAT CACAAACAATAAAGTATTTGATGTCAATTTTTCTAATTTTGATTTTAGAAAAATAAACTTAAACAATGCAAATTTTTCAA ACTCTATATTAAAGAATGCAAACTTTTCAGGATCACAATTAGAAAACGTAAATTTTACTAACACAAATCTACAATCTTCT CAATTTGAAAACTCACAACTTAAAAATGTAGATTTTTCTAATGCAAATTTAGAAAACGCGAACTTATCGAACAGTAAATT AAATGATATCAACACATACAAAACAAATTTGCGTCACGTAAAAACTGACAATACTCAGAAATAA
Upstream 100 bases:
>100_bases ATCTAAAAAAATATACAATAGCAAAACTAACATTAACAATTTTATGAGATTTATTACTTATAATAAGCTAAACTACATTG TCAACCTATACAAGTATACT
Downstream 100 bases:
>100_bases ATAAAGATTTAAACTTATACACTAAAACAACATCAAATAATTTTATAGATTGTAATAACATATGATTCAGTTACATATCT TCAACTATCGCAAATCTACC
Product: pentapeptide repeat-containing protein
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 607; Mature: 607
Protein sequence:
>607_residues MKHCIKHTFTVLIIYTLLLNTNICFAHTTDQDNFFTVKRTSYTKEDFVSFIVKCHAKGIPLDFKKEFGNNLSGADFSDLD LRGSVFDNVNLLHANFTRANLSNSTFIDSNMQGASFINANLSKSNIKNSNLNFANFTSADLQKTTITQSKINNTNFSYSD MRFSILTEVNGSLANFSETELKLVSIFNSNIEKANFHDIEGENIVIQNCNLLDSNFFGANLNNSKIQFSNLTNTILYAVN LDSSDITGSNLSNSNMEVSNISFANFHNANLSNTNMHLVDAHYTNLNNTNLHKVRMSDATLIGVNLNHAVLSNADLSNAD LSNVSIEESDMQEILLDSTNITRTNMKHAILNNATINNTVISNSDLTMTLIKDSKWNNSSIYSSKLTSAVIDNNIIKHGT YDKVNATNTLWSNSTIEDSNIIFCNFESAIFNNDKIHKVSFFTNHLESAKVEDSNIVGSSIYKNTLTNFIINNCDIKNTI IINNKNFVPTEFSKQAITSITALQDAITNNKVFDVNFSNFDFRKINLNNANFSNSILKNANFSGSQLENVNFTNTNLQSS QFENSQLKNVDFSNANLENANLSNSKLNDINTYKTNLRHVKTDNTQK
Sequences:
>Translated_607_residues MKHCIKHTFTVLIIYTLLLNTNICFAHTTDQDNFFTVKRTSYTKEDFVSFIVKCHAKGIPLDFKKEFGNNLSGADFSDLD LRGSVFDNVNLLHANFTRANLSNSTFIDSNMQGASFINANLSKSNIKNSNLNFANFTSADLQKTTITQSKINNTNFSYSD MRFSILTEVNGSLANFSETELKLVSIFNSNIEKANFHDIEGENIVIQNCNLLDSNFFGANLNNSKIQFSNLTNTILYAVN LDSSDITGSNLSNSNMEVSNISFANFHNANLSNTNMHLVDAHYTNLNNTNLHKVRMSDATLIGVNLNHAVLSNADLSNAD LSNVSIEESDMQEILLDSTNITRTNMKHAILNNATINNTVISNSDLTMTLIKDSKWNNSSIYSSKLTSAVIDNNIIKHGT YDKVNATNTLWSNSTIEDSNIIFCNFESAIFNNDKIHKVSFFTNHLESAKVEDSNIVGSSIYKNTLTNFIINNCDIKNTI IINNKNFVPTEFSKQAITSITALQDAITNNKVFDVNFSNFDFRKINLNNANFSNSILKNANFSGSQLENVNFTNTNLQSS QFENSQLKNVDFSNANLENANLSNSKLNDINTYKTNLRHVKTDNTQK >Mature_607_residues MKHCIKHTFTVLIIYTLLLNTNICFAHTTDQDNFFTVKRTSYTKEDFVSFIVKCHAKGIPLDFKKEFGNNLSGADFSDLD LRGSVFDNVNLLHANFTRANLSNSTFIDSNMQGASFINANLSKSNIKNSNLNFANFTSADLQKTTITQSKINNTNFSYSD MRFSILTEVNGSLANFSETELKLVSIFNSNIEKANFHDIEGENIVIQNCNLLDSNFFGANLNNSKIQFSNLTNTILYAVN LDSSDITGSNLSNSNMEVSNISFANFHNANLSNTNMHLVDAHYTNLNNTNLHKVRMSDATLIGVNLNHAVLSNADLSNAD LSNVSIEESDMQEILLDSTNITRTNMKHAILNNATINNTVISNSDLTMTLIKDSKWNNSSIYSSKLTSAVIDNNIIKHGT YDKVNATNTLWSNSTIEDSNIIFCNFESAIFNNDKIHKVSFFTNHLESAKVEDSNIVGSSIYKNTLTNFIINNCDIKNTI IINNKNFVPTEFSKQAITSITALQDAITNNKVFDVNFSNFDFRKINLNNANFSNSILKNANFSGSQLENVNFTNTNLQSS QFENSQLKNVDFSNANLENANLSNSKLNDINTYKTNLRHVKTDNTQK
Specific function: Unknown
COG id: COG1357
COG function: function code S; Uncharacterized low-complexity proteins
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 5 pentapeptide repeat domains [H]
Homologues:
Organism=Escherichia coli, GI1790502, Length=255, Percent_Identity=27.0588235294118, Blast_Score=62, Evalue=1e-10, Organism=Drosophila melanogaster, GI221377802, Length=191, Percent_Identity=25.6544502617801, Blast_Score=66, Evalue=6e-11,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR001646 [H]
Pfam domain/function: PF00805 Pentapeptide [H]
EC number: NA
Molecular weight: Translated: 67858; Mature: 67858
Theoretical pI: Translated: 6.30; Mature: 6.30
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.0 %Cys (Translated Protein) 1.5 %Met (Translated Protein) 2.5 %Cys+Met (Translated Protein) 1.0 %Cys (Mature Protein) 1.5 %Met (Mature Protein) 2.5 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MKHCIKHTFTVLIIYTLLLNTNICFAHTTDQDNFFTVKRTSYTKEDFVSFIVKCHAKGIP CCHHHHHHHHHHHHHHHHHCCCEEEEEECCCCCEEEEEECCCCHHHHHHHHHHHHCCCCC LDFKKEFGNNLSGADFSDLDLRGSVFDNVNLLHANFTRANLSNSTFIDSNMQGASFINAN CCHHHHHCCCCCCCCCCCCCCCCCCCCCEEEEEEECEECCCCCCEEECCCCCCCEEEECC LSKSNIKNSNLNFANFTSADLQKTTITQSKINNTNFSYSDMRFSILTEVNGSLANFSETE CCCCCCCCCCCCEEECCCCCCCCEEEEHHHCCCCCCEECCEEEEEEEECCCCCCCCCHHH LKLVSIFNSNIEKANFHDIEGENIVIQNCNLLDSNFFGANLNNSKIQFSNLTNTILYAVN EEEEEEECCCCCCCCCCCCCCCEEEEEECCEECCCCCCCCCCCCEEEEECCCCEEEEEEE LDSSDITGSNLSNSNMEVSNISFANFHNANLSNTNMHLVDAHYTNLNNTNLHKVRMSDAT CCCCCCCCCCCCCCCEEEEEEEEEEECCCCCCCCEEEEEEEEECCCCCCCEEEEEECCEE LIGVNLNHAVLSNADLSNADLSNVSIEESDMQEILLDSTNITRTNMKHAILNNATINNTV EEEEECCHHEECCCCCCCCCCCCCEECHHHHHHHHHCCCCCCCCCCHHHHCCCCEECCEE ISNSDLTMTLIKDSKWNNSSIYSSKLTSAVIDNNIIKHGTYDKVNATNTLWSNSTIEDSN EECCCEEEEEEECCCCCCCCEEHHHHHHHHHCCCCCCCCCCCCCCCCCEEECCCCCCCCC IIFCNFESAIFNNDKIHKVSFFTNHLESAKVEDSNIVGSSIYKNTLTNFIINNCDIKNTI EEEEECCHHHCCCCCEEEEEEEHHHHCCCCCCCCCCCCHHHHHHHHHHHHCCCCCCCEEE IINNKNFVPTEFSKQAITSITALQDAITNNKVFDVNFSNFDFRKINLNNANFSNSILKNA EECCCCCCCCCHHHHHHHHHHHHHHHHCCCEEEEEECCCCEEEEEECCCCCCCHHHHHCC NFSGSQLENVNFTNTNLQSSQFENSQLKNVDFSNANLENANLSNSKLNDINTYKTNLRHV CCCCCEECCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHCCCEEE KTDNTQK CCCCCCC >Mature Secondary Structure MKHCIKHTFTVLIIYTLLLNTNICFAHTTDQDNFFTVKRTSYTKEDFVSFIVKCHAKGIP CCHHHHHHHHHHHHHHHHHCCCEEEEEECCCCCEEEEEECCCCHHHHHHHHHHHHCCCCC LDFKKEFGNNLSGADFSDLDLRGSVFDNVNLLHANFTRANLSNSTFIDSNMQGASFINAN CCHHHHHCCCCCCCCCCCCCCCCCCCCCEEEEEEECEECCCCCCEEECCCCCCCEEEECC LSKSNIKNSNLNFANFTSADLQKTTITQSKINNTNFSYSDMRFSILTEVNGSLANFSETE CCCCCCCCCCCCEEECCCCCCCCEEEEHHHCCCCCCEECCEEEEEEEECCCCCCCCCHHH LKLVSIFNSNIEKANFHDIEGENIVIQNCNLLDSNFFGANLNNSKIQFSNLTNTILYAVN EEEEEEECCCCCCCCCCCCCCCEEEEEECCEECCCCCCCCCCCCEEEEECCCCEEEEEEE LDSSDITGSNLSNSNMEVSNISFANFHNANLSNTNMHLVDAHYTNLNNTNLHKVRMSDAT CCCCCCCCCCCCCCCEEEEEEEEEEECCCCCCCCEEEEEEEEECCCCCCCEEEEEECCEE LIGVNLNHAVLSNADLSNADLSNVSIEESDMQEILLDSTNITRTNMKHAILNNATINNTV EEEEECCHHEECCCCCCCCCCCCCEECHHHHHHHHHCCCCCCCCCCHHHHCCCCEECCEE ISNSDLTMTLIKDSKWNNSSIYSSKLTSAVIDNNIIKHGTYDKVNATNTLWSNSTIEDSN EECCCEEEEEEECCCCCCCCEEHHHHHHHHHCCCCCCCCCCCCCCCCCEEECCCCCCCCC IIFCNFESAIFNNDKIHKVSFFTNHLESAKVEDSNIVGSSIYKNTLTNFIINNCDIKNTI EEEEECCHHHCCCCCEEEEEEEHHHHCCCCCCCCCCCCHHHHHHHHHHHHCCCCCCCEEE IINNKNFVPTEFSKQAITSITALQDAITNNKVFDVNFSNFDFRKINLNNANFSNSILKNA EECCCCCCCCCHHHHHHHHHHHHHHHHCCCEEEEEECCCCEEEEEECCCCCCCHHHHHCC NFSGSQLENVNFTNTNLQSSQFENSQLKNVDFSNANLENANLSNSKLNDINTYKTNLRHV CCCCCEECCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHCCCEEE KTDNTQK CCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA