Definition Shewanella halifaxensis HAW-EB4 chromosome, complete genome.
Accession NC_010334
Length 5,226,917

Click here to switch to the map view.

The map label for this gene is ygjK [H]

Identifier: 167622033

GI number: 167622033

Start: 102372

End: 104537

Strand: Direct

Name: ygjK [H]

Synonym: Shal_0092

Alternate gene names: 167622033

Gene position: 102372-104537 (Clockwise)

Preceding gene: 167622032

Following gene: 167622034

Centisome position: 1.96

GC content: 50.18

Gene sequence:

>2166_bases
ATGCTAACTTGCCTCCTACTGTGTGTTGCTAGCCTCTCTTCACTGGATTCTGCCGACTATCAAAATCTACTGCCTTACCA
AGGCACGCCAACCTCGATGGAGCAGCGTGACAGTAATGGCAATCTCACTATTGGCTCTGTATATACCGATCAAGGTGCTT
GGCATGGCTTTCACCTACCCGATAATGCCGATTATTATGGTGGTTTTACCGGGCCTCTGTTTATCGCTCAAGAATACAGT
TTGCATCTGAGTGACAGCTTGCAACGCTTGCAGTTGATCAACATAGATAAAGACGAATTTATCGCGTTAGACAGCGCCAG
CCGAATCGAGATCTATAGTAGGCCCGACGCCCTAGTGCAGACGTTCATCTGGTCGGGTTTTCAGCTTAACTTGACCCTCA
GTTATAGTGATAATCGTACGGCGGTCATCCGTACCGAATTGATCAATCTATCCCCAAAAGAACAAACTTGGCAGTTGGTA
TGGCACGGTTCTCCCTTTAATTCGCACCCTTCGCAACCGGACTACCACCTCATCAAACAGGCTGAAGTGAATGCTAATCA
TATTAGTTGGCAGCTCAATCCAATCATGGAAACCTGGCGAATTCAGCTTGCCGATGCTGAGTATGAGCTGTGGTTCGATC
GCGATATGAAAATAATGCTCAATGAGCAATCGGGTTATCGCGCCTTTGCCGAACCCGTGACTCTGGCGGCGGGGCAGCAA
CATACTTTTGTCTCGGCGCAGCGATATTTTCATACTCAGGCCGAGCGCAGTGCGCATCTGGCCCCCGACTGGAGCAAGAT
AACGGGTCAGCTCAACGATAATCGCGCCAAGTGGCAAGCCAGATTAGACAGAGCGATAACAGGAGGCGATAAGAGTGCTC
GCCAACTTGCGGTTAAGAGCATGATGACTCTTTTGCACAATTGGCGCAGTCCTGCGGGCGCACTTGATCATGATGCGATT
ACCCCGTCGATTACCTATAAGTGGTTTAACGGTGTGTGGGCCTGGGACAGTTGGAAGCAGGCGGTTGCATTAGCACGTTT
TGACCCTAGCCTAGCCAAGTCTAATGTACTGGCGATGTTCGATTATCAATTTACTGCGCAAGACTCGGTTAGGCCGCAAG
ATGCGGGTAACCTACCCGATGCTATTTTCTACAATAAAGATCGTCAGCGCGGTGGTGAGGGTGGCAACTGGAACGAGCGT
AACGGTAAGCCCCCATTAGCGGCTTGGGCGGTGTGGCAGATCTATGAGCAAGATAAGGATGTCAGCTTTCTTGAGGCTAT
GTACCCCAAACTGTTGGCCTATCATGAGTGGTGGTATCGCAACCGTGACAATAACGATAATGGCTTAGCCGAATATGGCG
CTAACTTACATCCAGCCCACTTGGCTGAAGATGGTTCGATCGATGTGGAAGCGGTGATCGAAGCCGCTGCATGGGAGTCG
GGCATGGATAACGCACCACGATTCGATGTCGATGAGGCGCTGAGTGTTTGGCAAAACCGTCAGGCGGGTCAACTCGTGGG
TTACTCGGTATCGCAGGAGTCAGTCGATCTTAATGCCTACCTCTACGCAGAGAAACGTTTTCTACAACAGATGGCGGCTG
TATTAGGCGATGATAGTGCCGTGGTGAAATGGGATGTGGCTGCAACTCGGCTTGCTAAGCAGATCCAGATGCAGATGTAT
GATCCAGAATCTGGCTTTTTCTATGATATTCGTTATACCGCAACCGGTAGCGAGTTGATGGTAGAGCAGGGAAAAGGTGT
CGAAGGCTGGCTCCCGCTCTGGGCGGGTGCGGCGAGTGAGGCTCAAGCAAAAGTTATAGTTGAGCGTCACCTTGGGGCTG
GACAATTTGGCACCTTAATTCCATTTCCGACCGTAAGTGCCGATAGCCCTAACTTTGCCGCTGCTAAGTATTGGCGCGGC
CCCGTATGGTTGGATCAGGCGTTATTTGGCCTGCAGGGAGTCGAGCGATATGGCTATCATCAACAAGCCAAGGCACTAGC
GAAGCAACTTGTATCACAAGGAGAGGGTATTTTAGGTCAAAGCCCGATTAGGGAAAATTACAACCCACTAACAGGTGAGG
GACTACACTGCACTAACTTTAGCTGGTCTGCTTCCGTACTACTGCTTCTTTATCAATCCTGGTTAGTCGATGGGAATGAT
AATTAA

Upstream 100 bases:

>100_bases
AGTTGTCGTTTCTGGATTGTGAGCTAAAGTTAAACTCGCTTGCAGATTAAATTTTAGCCTGCAATACTTGGGATATAATA
TTCAAAAATAACAATAAATC

Downstream 100 bases:

>100_bases
TCATGAAGTCTAAACTGATAACCATTTGATTTTTAGTTAATAATACTGCCATTTTAAAATAGGCTGCCTAAATATATTAA
TTGGACTGTTAATGTATTGC

Product: glycoside hydrolase family protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 721; Mature: 721

Protein sequence:

>721_residues
MLTCLLLCVASLSSLDSADYQNLLPYQGTPTSMEQRDSNGNLTIGSVYTDQGAWHGFHLPDNADYYGGFTGPLFIAQEYS
LHLSDSLQRLQLINIDKDEFIALDSASRIEIYSRPDALVQTFIWSGFQLNLTLSYSDNRTAVIRTELINLSPKEQTWQLV
WHGSPFNSHPSQPDYHLIKQAEVNANHISWQLNPIMETWRIQLADAEYELWFDRDMKIMLNEQSGYRAFAEPVTLAAGQQ
HTFVSAQRYFHTQAERSAHLAPDWSKITGQLNDNRAKWQARLDRAITGGDKSARQLAVKSMMTLLHNWRSPAGALDHDAI
TPSITYKWFNGVWAWDSWKQAVALARFDPSLAKSNVLAMFDYQFTAQDSVRPQDAGNLPDAIFYNKDRQRGGEGGNWNER
NGKPPLAAWAVWQIYEQDKDVSFLEAMYPKLLAYHEWWYRNRDNNDNGLAEYGANLHPAHLAEDGSIDVEAVIEAAAWES
GMDNAPRFDVDEALSVWQNRQAGQLVGYSVSQESVDLNAYLYAEKRFLQQMAAVLGDDSAVVKWDVAATRLAKQIQMQMY
DPESGFFYDIRYTATGSELMVEQGKGVEGWLPLWAGAASEAQAKVIVERHLGAGQFGTLIPFPTVSADSPNFAAAKYWRG
PVWLDQALFGLQGVERYGYHQQAKALAKQLVSQGEGILGQSPIRENYNPLTGEGLHCTNFSWSASVLLLLYQSWLVDGND
N

Sequences:

>Translated_721_residues
MLTCLLLCVASLSSLDSADYQNLLPYQGTPTSMEQRDSNGNLTIGSVYTDQGAWHGFHLPDNADYYGGFTGPLFIAQEYS
LHLSDSLQRLQLINIDKDEFIALDSASRIEIYSRPDALVQTFIWSGFQLNLTLSYSDNRTAVIRTELINLSPKEQTWQLV
WHGSPFNSHPSQPDYHLIKQAEVNANHISWQLNPIMETWRIQLADAEYELWFDRDMKIMLNEQSGYRAFAEPVTLAAGQQ
HTFVSAQRYFHTQAERSAHLAPDWSKITGQLNDNRAKWQARLDRAITGGDKSARQLAVKSMMTLLHNWRSPAGALDHDAI
TPSITYKWFNGVWAWDSWKQAVALARFDPSLAKSNVLAMFDYQFTAQDSVRPQDAGNLPDAIFYNKDRQRGGEGGNWNER
NGKPPLAAWAVWQIYEQDKDVSFLEAMYPKLLAYHEWWYRNRDNNDNGLAEYGANLHPAHLAEDGSIDVEAVIEAAAWES
GMDNAPRFDVDEALSVWQNRQAGQLVGYSVSQESVDLNAYLYAEKRFLQQMAAVLGDDSAVVKWDVAATRLAKQIQMQMY
DPESGFFYDIRYTATGSELMVEQGKGVEGWLPLWAGAASEAQAKVIVERHLGAGQFGTLIPFPTVSADSPNFAAAKYWRG
PVWLDQALFGLQGVERYGYHQQAKALAKQLVSQGEGILGQSPIRENYNPLTGEGLHCTNFSWSASVLLLLYQSWLVDGND
N
>Mature_721_residues
MLTCLLLCVASLSSLDSADYQNLLPYQGTPTSMEQRDSNGNLTIGSVYTDQGAWHGFHLPDNADYYGGFTGPLFIAQEYS
LHLSDSLQRLQLINIDKDEFIALDSASRIEIYSRPDALVQTFIWSGFQLNLTLSYSDNRTAVIRTELINLSPKEQTWQLV
WHGSPFNSHPSQPDYHLIKQAEVNANHISWQLNPIMETWRIQLADAEYELWFDRDMKIMLNEQSGYRAFAEPVTLAAGQQ
HTFVSAQRYFHTQAERSAHLAPDWSKITGQLNDNRAKWQARLDRAITGGDKSARQLAVKSMMTLLHNWRSPAGALDHDAI
TPSITYKWFNGVWAWDSWKQAVALARFDPSLAKSNVLAMFDYQFTAQDSVRPQDAGNLPDAIFYNKDRQRGGEGGNWNER
NGKPPLAAWAVWQIYEQDKDVSFLEAMYPKLLAYHEWWYRNRDNNDNGLAEYGANLHPAHLAEDGSIDVEAVIEAAAWES
GMDNAPRFDVDEALSVWQNRQAGQLVGYSVSQESVDLNAYLYAEKRFLQQMAAVLGDDSAVVKWDVAATRLAKQIQMQMY
DPESGFFYDIRYTATGSELMVEQGKGVEGWLPLWAGAASEAQAKVIVERHLGAGQFGTLIPFPTVSADSPNFAAAKYWRG
PVWLDQALFGLQGVERYGYHQQAKALAKQLVSQGEGILGQSPIRENYNPLTGEGLHCTNFSWSASVLLLLYQSWLVDGND
N

Specific function: Unknown

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

Organism=Escherichia coli, GI1789462, Length=788, Percent_Identity=34.6446700507614, Blast_Score=445, Evalue=1e-126,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR008928
- InterPro:   IPR001661 [H]

Pfam domain/function: PF01204 Trehalase [H]

EC number: NA

Molecular weight: Translated: 81202; Mature: 81202

Theoretical pI: Translated: 4.80; Mature: 4.80

Prosite motif: PS00107 PROTEIN_KINASE_ATP

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.4 %Cys     (Translated Protein)
1.9 %Met     (Translated Protein)
2.4 %Cys+Met (Translated Protein)
0.4 %Cys     (Mature Protein)
1.9 %Met     (Mature Protein)
2.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MLTCLLLCVASLSSLDSADYQNLLPYQGTPTSMEQRDSNGNLTIGSVYTDQGAWHGFHLP
CHHHHHHHHHHHHHCCCCCHHHCCCCCCCCCCHHHCCCCCCEEEEEEEECCCCCCCCCCC
DNADYYGGFTGPLFIAQEYSLHLSDSLQRLQLINIDKDEFIALDSASRIEIYSRPDALVQ
CCCCCCCCCCCCEEEEECCEEEHHHHHHHEEEECCCHHHEEEECCCCEEEEECCCHHHHH
TFIWSGFQLNLTLSYSDNRTAVIRTELINLSPKEQTWQLVWHGSPFNSHPSQPDYHLIKQ
HHHCCCEEEEEEEEECCCCEEEEEEEEECCCCCCCEEEEEEECCCCCCCCCCCCHHEEEE
AEVNANHISWQLNPIMETWRIQLADAEYELWFDRDMKIMLNEQSGYRAFAEPVTLAAGQQ
CCCCCCEEEEEECCCCEEEEEEEECCEEEEEECCCEEEEEECCCCCCHHHCCEEEECCCC
HTFVSAQRYFHTQAERSAHLAPDWSKITGQLNDNRAKWQARLDRAITGGDKSARQLAVKS
CEEHHHHHHHHHHHHCCCCCCCCHHHHCCCCCCCHHHHHHHHHHHHCCCCHHHHHHHHHH
MMTLLHNWRSPAGALDHDAITPSITYKWFNGVWAWDSWKQAVALARFDPSLAKSNVLAMF
HHHHHHHCCCCCCCCCCCCCCCCEEEEECCCEECCCCHHHHHHHHHCCHHHHHCCEEEEE
DYQFTAQDSVRPQDAGNLPDAIFYNKDRQRGGEGGNWNERNGKPPLAAWAVWQIYEQDKD
EEEECCCCCCCCCCCCCCCCCEEECCHHHCCCCCCCCCCCCCCCCHHHHHHHHHHHCCCC
VSFLEAMYPKLLAYHEWWYRNRDNNDNGLAEYGANLHPAHLAEDGSIDVEAVIEAAAWES
HHHHHHHHHHHHHHHHHHHCCCCCCCCCHHHHCCCCCCHHCCCCCCCCHHHHHHHHHHCC
GMDNAPRFDVDEALSVWQNRQAGQLVGYSVSQESVDLNAYLYAEKRFLQQMAAVLGDDSA
CCCCCCCCCHHHHHHHHCCCCCCCEEEEECCCCCCCEEEEEHHHHHHHHHHHHHHCCCCE
VVKWDVAATRLAKQIQMQMYDPESGFFYDIRYTATGSELMVEQGKGVEGWLPLWAGAASE
EEEEHHHHHHHHHHHHHEEECCCCCEEEEEEEECCCCHHHEECCCCCCCCHHHHCCCCCC
AQAKVIVERHLGAGQFGTLIPFPTVSADSPNFAAAKYWRGPVWLDQALFGLQGVERYGYH
CHHHHHEECCCCCCCCCCCCCCCCCCCCCCCCCHHHHCCCCHHHHHHHHHHHHHHHHCHH
QQAKALAKQLVSQGEGILGQSPIRENYNPLTGEGLHCTNFSWSASVLLLLYQSWLVDGND
HHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCEEECCCCHHHHHHHHHHHHHHCCCCC
N
C
>Mature Secondary Structure
MLTCLLLCVASLSSLDSADYQNLLPYQGTPTSMEQRDSNGNLTIGSVYTDQGAWHGFHLP
CHHHHHHHHHHHHHCCCCCHHHCCCCCCCCCCHHHCCCCCCEEEEEEEECCCCCCCCCCC
DNADYYGGFTGPLFIAQEYSLHLSDSLQRLQLINIDKDEFIALDSASRIEIYSRPDALVQ
CCCCCCCCCCCCEEEEECCEEEHHHHHHHEEEECCCHHHEEEECCCCEEEEECCCHHHHH
TFIWSGFQLNLTLSYSDNRTAVIRTELINLSPKEQTWQLVWHGSPFNSHPSQPDYHLIKQ
HHHCCCEEEEEEEEECCCCEEEEEEEEECCCCCCCEEEEEEECCCCCCCCCCCCHHEEEE
AEVNANHISWQLNPIMETWRIQLADAEYELWFDRDMKIMLNEQSGYRAFAEPVTLAAGQQ
CCCCCCEEEEEECCCCEEEEEEEECCEEEEEECCCEEEEEECCCCCCHHHCCEEEECCCC
HTFVSAQRYFHTQAERSAHLAPDWSKITGQLNDNRAKWQARLDRAITGGDKSARQLAVKS
CEEHHHHHHHHHHHHCCCCCCCCHHHHCCCCCCCHHHHHHHHHHHHCCCCHHHHHHHHHH
MMTLLHNWRSPAGALDHDAITPSITYKWFNGVWAWDSWKQAVALARFDPSLAKSNVLAMF
HHHHHHHCCCCCCCCCCCCCCCCEEEEECCCEECCCCHHHHHHHHHCCHHHHHCCEEEEE
DYQFTAQDSVRPQDAGNLPDAIFYNKDRQRGGEGGNWNERNGKPPLAAWAVWQIYEQDKD
EEEECCCCCCCCCCCCCCCCCEEECCHHHCCCCCCCCCCCCCCCCHHHHHHHHHHHCCCC
VSFLEAMYPKLLAYHEWWYRNRDNNDNGLAEYGANLHPAHLAEDGSIDVEAVIEAAAWES
HHHHHHHHHHHHHHHHHHHCCCCCCCCCHHHHCCCCCCHHCCCCCCCCHHHHHHHHHHCC
GMDNAPRFDVDEALSVWQNRQAGQLVGYSVSQESVDLNAYLYAEKRFLQQMAAVLGDDSA
CCCCCCCCCHHHHHHHHCCCCCCCEEEEECCCCCCCEEEEEHHHHHHHHHHHHHHCCCCE
VVKWDVAATRLAKQIQMQMYDPESGFFYDIRYTATGSELMVEQGKGVEGWLPLWAGAASE
EEEEHHHHHHHHHHHHHEEECCCCCEEEEEEEECCCCHHHEECCCCCCCCHHHHCCCCCC
AQAKVIVERHLGAGQFGTLIPFPTVSADSPNFAAAKYWRGPVWLDQALFGLQGVERYGYH
CHHHHHEECCCCCCCCCCCCCCCCCCCCCCCCCHHHHCCCCHHHHHHHHHHHHHHHHCHH
QQAKALAKQLVSQGEGILGQSPIRENYNPLTGEGLHCTNFSWSASVLLLLYQSWLVDGND
HHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCEEECCCCHHHHHHHHHHHHHHCCCCC
N
C

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9278503 [H]