Definition Escherichia fergusonii ATCC 35469 chromosome, complete genome.
Accession NC_011740
Length 4,588,711

Click here to switch to the map view.

The map label for this gene is yuaQ [H]

Identifier: 218550184

GI number: 218550184

Start: 2940961

End: 2944998

Strand: Direct

Name: yuaQ [H]

Synonym: EFER_2876

Alternate gene names: 218550184

Gene position: 2940961-2944998 (Clockwise)

Preceding gene: 218550179

Following gene: 218550185

Centisome position: 64.09

GC content: 49.46

Gene sequence:

>4038_bases
TTGGATGTATTGCTGGAGATTGTGATGAATAAAATATATCGGCTAAAGTGGAACAGGTCTCGTAACTGTTGGTGCGTCTG
CTCTGAACTGGGGAGCAGAATAAAAGGGAAAAAGTTCCGGGCTGTTTTAATTAGCGCGATAAGTTTATATTCATCTCTGG
CATTCGCCGATGATGTCATCGTAAAAAAGGATGAGACTATTGAATTTGGCAAAGAGAACCAGAGTATCGATTACCGTATT
AAGGTGACCGATAATGCTAATCTGGTTATCAATGCGACAGACACTTCACGTCCACGTCTGACTCTTGCTTCGGGTGGTGG
GTTGGATATCACCGGAGGAAAGGTAACAATCAATGGCCCACTTAACTTTCTGCTGAAAGGTACGGGGTTCCTGAATGTCT
CCAATGCTGGCAGCGAGTTATATGCTGATGATTTGTATGAGTCAAACTCAGGTATGAGACACGATCAAGGCTATTTTAAT
GTCTCCAACGGCGGCAAAATCCATGTTAAGGGCACCAGTCGTCTGACTTATACGCAGGGAAATGTCAGTGGGGAAGGTAG
CCAGGTAAATTCCGAAACCTTCTTTATGGGCGTTTACAGCAGTTACGGTGGTAATCAGTACCTGTCAGTTAATAACGGCG
GTGAAGTTAATGCCAGTAAGCAAATTAGCCTGGGCTATTATAATCAAAACTCCGATACAACACTTGCCGTTTCAGAAGGC
GGTAAAGTATCTGCGCCGACTATTAGTTTAAGCACCAACTCTGAGTTGGCGTTAGGTGCACAGGAAGGAAATGCAGCGAA
GGCGGCAGGGATTATTGATGCCGAAAAAATTGAGTTTGTGTGGGCTTCGACATCAGATAAGAAAATCACTTTAAACCACA
CGGATAAAAACGCGACTATTTCCGCGGATATTGTCAGTGGCAGCGAGGGCCTAGGCTATATCAATGCGCTCAATGGTACA
ACTTACTTAACCGGTGATAACTCCGCCTTTAGCGGCAAAGTCAAAATTGAGAAAAACGGGGCTTTAGGGATCACCCAAAA
TATAGGTACAGCAGAAATCACCAACCGCGGGAAATTACACCTGAAGGCTGACGATAGCATGACCTTTGCCAATAAGATTT
CCGGCAACGGTACAATAAGTATCGACAGTGGGACGGTGGAGTTGACCGGCAATAACTATGCATTCAGCGGATATATTGAT
GTCGCTTCCGATGCTGTCGCTGTTATTTCTGAAGACAAGAACATCGGCCGTGCAGAACTGGATGTTGATGGCAAACTGCA
AATTAATGCCAATAAAGATTGGGTGTTTGATAACGATCTTGAAGGTAAAGGCGTTGTTGAAATAAACATGGGGAATCACG
AATTCTCCTTCGATGAGTTTGCTTATACAGACTGGTTTCAGGGGGCACTGGCATTCCAGAACACGACATTTAACCTGGAA
AAAAATGCTGAGTTTCTGCAGAAAGGCGGGATCACTGCGGGTCAGGGAAGCCAGATAACAGTGGGTAAGGGCGCTCATTC
CATTAGCACTCTGGGATTCTCGGGCGGAACCATTGATTTTGGTGCCCTGACAGCGGGTGCACAGATGACAGAAGGGACAG
TCAACGTTAGTAAAACGCTGGATTTGCGCGGCGAGGGTGTGATTCAGGTTTCTGACAGTGACGTTGTAAGCTCAATATCT
CGTGATATTGACTCTGCGTTATCGCTCACTGAAGTTGATGATGGTAACAGCGCCATTAAGCTGGTTGATGCGCAAGGTGC
GGAAGTTCTGGGCGACGCGGGCAATCTGCAATTGCAGGATAAAAATGGGCAAATCCTCTCCAGCAGCGCCCAACGTGATA
TTCAGCAGAATGGGCAAAAAGCGGCCGTCGGCACTTACGACTATCGCCTGACGAGTGGGATAAACAATGACGGTCTGTAT
ATCGGTTACGGCCTGACCCAGCTTGATTTGCAGGCTACCGACAGTGACGCCCTGGTGCTGAGTGCCAACGGTAAGAGCGA
GAATGCCGCCGATCTCAGTGCAAAGGTTACCGGCAGTGGTGACCTGGCCTTCAGCAGCCAGAAAGGTCAGACCGTATCGC
TTTCTAACAAAGACAACGACTATACCGGTGTTACCGATCTGCGCAGCGGGACGCTTTTGTTGAAGAACGATAACGTGTTG
GGTAATACCCATGAACTGCGTCTGGCGGCAGAGACTGAACTGGATATGAATGGTCACAGCCAGACCGTGGGCACGCTCAA
TGCTAGCGCCAATTCACTGCTGAACTTAAACGACGGCAGTCTGACGGTTACCTATGGGGGCACTTCAACTGGTTCGTTAA
CGGGGAGTGGAGCGCTGAATATTCAGGGCGGCACACTGGACATCGCGGGCGATAACAGCAACCTGACGGCGAATGTGAAC
ATTGCCAGCTCGGCTAATATCCTGGTTAGCCATGCGCAGGGAATGGGTAACGCAAACATTGAGAACTACGGAACCCTGGC
GTTGAATACTCACGGTGAAAAAAGAGCGGCTGCACCAGTGAATTACACCCTGGGTGGCAATCTTACCAACAACGGTACGC
TGATGACCGGGATGTCAGGACAGCAAGCTGGCAACGTGTTAGTGGTGAAGGGGAACTACTACGGTAATAGCGGCCAACTG
GTAATGAATACGGTACTGAATGGCGATGATTCAGTAACCGATAAATTAGTTGTCGAGGGCGATACTAGCGGCACGACTGC
CGTTACGGTGAATAACGCTGGCGGTACAGGTGCTAAAACCCTTAACGGTATCGAACTTATCCATGTAGACGGTAAGTCTG
AGGGAGAATTTGTTCAGGCGGGGCGTATCGTTGCGGGGGCGTATGATTACACTCTTGCGCGTGGACAGGGGGCAAATAGC
GGTAACTGGTATCTGACCAGCGGCAGTGATTCACCTGAACCGCAGCCGGAACCAGAGCCGATGCCGAATCCGGAACCTAA
TCCGAATCCGGAACCTAATCCGAATCCGGAACCTAACCCGAACCCGGAGCCGAATCCGACACCTACGCCGGGCCCGGATC
TGAATATGGATAATGACCTGCGACCGGAAGCGGGCAGCTACATTGCCAACCTTGCAGCAGCGAATATCATGTTTACAACG
CGTCTGCATGAGCGTCTGGGAAATACGGACTATACCGACATGGTGACGGGTGAGCAGAAACAAACCACTATGTGGATGCG
CCATGAAGGTGGCCACAATAAATGGCACGATGGTAGCGGTCAGCTGAAAACTCAGGGTAACCGCTATGTTCTGCAACTGG
GGGGCGATATCGCACAGTGGAGCCAAAACAACAGTGACCGCTGGCATGTAGGGGTCATGGCGGGATATGGCAACAGCGAC
AGCAAAACGACCTCCTCGCGCACTGGTTATCGTGCAAAAGCGAGCGTGAACGGATATAGCACCGGTCTTTATGCCACCTG
GTATGCCGATGACGAATCGCATAATGGAGCGTATCTCGACAGTTGGGGGCAGTACAGCTGGTTTGACAACACAGTGAAAG
GTGATGATTTACAGAGTGAATCTTATAAATCAAAAGGGTTTACCGCGTCACTGGAAGCTGGATACAAACACAAATTAGCT
GAATTTAACGGCAGCAAGGGAACGCGTAACGAATGGTATGTTCAGCCGCAAGCCCAGGTTACCTGGATGGGGGTAAAAGC
CGAGAAGCACCGCGAAAGCAATGGCACCCTTGTTCATAGCAACGGGGATGGCAACATTCAAACCCGACTTGGCGTAAAAA
CCTGGCTGAAGAGCCACCATAAAATGGATGATGGTAAATCCCGCGAGTTCCAGCCGTTTGTAGAAATGAACTGGCTGCAT
AACAGTAAGGATTTCAGCGCCAGCATGGATGGCGTCTCCGTCACTCAGGATGGCGCCCGAAATATTGCTGAGATAAAAAC
CGGGGTGGAAGGACAGCTAAATGCCAACCTGAATGTCTGGGGGAATGTGGGCGTTCAGGTTGCCGATAGGGGATATAATG
ACACCTCTGCAATGGTGGGCATTAAGTGGCAATTCTGA

Upstream 100 bases:

>100_bases
TAGTTGTCAATGCTATGCAAATTTTTTGAATTTTTATATGCCATGAACAGTAACCGGAATGGCATTTAATGCGTTGCTGT
TTATGCAATCTTAGTTTTAT

Downstream 100 bases:

>100_bases
TCTGAATAATCAGTAAAATGAGAGAGCCGAACGGGAGATAATTCGGCTCTCTGTGTCATTTTCTTGCAGTCAGCTTTATC
AGCTAGAGTGAAGACAAGCA

Product: AidA-I adhesin-like protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 1345; Mature: 1345

Protein sequence:

>1345_residues
MDVLLEIVMNKIYRLKWNRSRNCWCVCSELGSRIKGKKFRAVLISAISLYSSLAFADDVIVKKDETIEFGKENQSIDYRI
KVTDNANLVINATDTSRPRLTLASGGGLDITGGKVTINGPLNFLLKGTGFLNVSNAGSELYADDLYESNSGMRHDQGYFN
VSNGGKIHVKGTSRLTYTQGNVSGEGSQVNSETFFMGVYSSYGGNQYLSVNNGGEVNASKQISLGYYNQNSDTTLAVSEG
GKVSAPTISLSTNSELALGAQEGNAAKAAGIIDAEKIEFVWASTSDKKITLNHTDKNATISADIVSGSEGLGYINALNGT
TYLTGDNSAFSGKVKIEKNGALGITQNIGTAEITNRGKLHLKADDSMTFANKISGNGTISIDSGTVELTGNNYAFSGYID
VASDAVAVISEDKNIGRAELDVDGKLQINANKDWVFDNDLEGKGVVEINMGNHEFSFDEFAYTDWFQGALAFQNTTFNLE
KNAEFLQKGGITAGQGSQITVGKGAHSISTLGFSGGTIDFGALTAGAQMTEGTVNVSKTLDLRGEGVIQVSDSDVVSSIS
RDIDSALSLTEVDDGNSAIKLVDAQGAEVLGDAGNLQLQDKNGQILSSSAQRDIQQNGQKAAVGTYDYRLTSGINNDGLY
IGYGLTQLDLQATDSDALVLSANGKSENAADLSAKVTGSGDLAFSSQKGQTVSLSNKDNDYTGVTDLRSGTLLLKNDNVL
GNTHELRLAAETELDMNGHSQTVGTLNASANSLLNLNDGSLTVTYGGTSTGSLTGSGALNIQGGTLDIAGDNSNLTANVN
IASSANILVSHAQGMGNANIENYGTLALNTHGEKRAAAPVNYTLGGNLTNNGTLMTGMSGQQAGNVLVVKGNYYGNSGQL
VMNTVLNGDDSVTDKLVVEGDTSGTTAVTVNNAGGTGAKTLNGIELIHVDGKSEGEFVQAGRIVAGAYDYTLARGQGANS
GNWYLTSGSDSPEPQPEPEPMPNPEPNPNPEPNPNPEPNPNPEPNPTPTPGPDLNMDNDLRPEAGSYIANLAAANIMFTT
RLHERLGNTDYTDMVTGEQKQTTMWMRHEGGHNKWHDGSGQLKTQGNRYVLQLGGDIAQWSQNNSDRWHVGVMAGYGNSD
SKTTSSRTGYRAKASVNGYSTGLYATWYADDESHNGAYLDSWGQYSWFDNTVKGDDLQSESYKSKGFTASLEAGYKHKLA
EFNGSKGTRNEWYVQPQAQVTWMGVKAEKHRESNGTLVHSNGDGNIQTRLGVKTWLKSHHKMDDGKSREFQPFVEMNWLH
NSKDFSASMDGVSVTQDGARNIAEIKTGVEGQLNANLNVWGNVGVQVADRGYNDTSAMVGIKWQF

Sequences:

>Translated_1345_residues
MDVLLEIVMNKIYRLKWNRSRNCWCVCSELGSRIKGKKFRAVLISAISLYSSLAFADDVIVKKDETIEFGKENQSIDYRI
KVTDNANLVINATDTSRPRLTLASGGGLDITGGKVTINGPLNFLLKGTGFLNVSNAGSELYADDLYESNSGMRHDQGYFN
VSNGGKIHVKGTSRLTYTQGNVSGEGSQVNSETFFMGVYSSYGGNQYLSVNNGGEVNASKQISLGYYNQNSDTTLAVSEG
GKVSAPTISLSTNSELALGAQEGNAAKAAGIIDAEKIEFVWASTSDKKITLNHTDKNATISADIVSGSEGLGYINALNGT
TYLTGDNSAFSGKVKIEKNGALGITQNIGTAEITNRGKLHLKADDSMTFANKISGNGTISIDSGTVELTGNNYAFSGYID
VASDAVAVISEDKNIGRAELDVDGKLQINANKDWVFDNDLEGKGVVEINMGNHEFSFDEFAYTDWFQGALAFQNTTFNLE
KNAEFLQKGGITAGQGSQITVGKGAHSISTLGFSGGTIDFGALTAGAQMTEGTVNVSKTLDLRGEGVIQVSDSDVVSSIS
RDIDSALSLTEVDDGNSAIKLVDAQGAEVLGDAGNLQLQDKNGQILSSSAQRDIQQNGQKAAVGTYDYRLTSGINNDGLY
IGYGLTQLDLQATDSDALVLSANGKSENAADLSAKVTGSGDLAFSSQKGQTVSLSNKDNDYTGVTDLRSGTLLLKNDNVL
GNTHELRLAAETELDMNGHSQTVGTLNASANSLLNLNDGSLTVTYGGTSTGSLTGSGALNIQGGTLDIAGDNSNLTANVN
IASSANILVSHAQGMGNANIENYGTLALNTHGEKRAAAPVNYTLGGNLTNNGTLMTGMSGQQAGNVLVVKGNYYGNSGQL
VMNTVLNGDDSVTDKLVVEGDTSGTTAVTVNNAGGTGAKTLNGIELIHVDGKSEGEFVQAGRIVAGAYDYTLARGQGANS
GNWYLTSGSDSPEPQPEPEPMPNPEPNPNPEPNPNPEPNPNPEPNPTPTPGPDLNMDNDLRPEAGSYIANLAAANIMFTT
RLHERLGNTDYTDMVTGEQKQTTMWMRHEGGHNKWHDGSGQLKTQGNRYVLQLGGDIAQWSQNNSDRWHVGVMAGYGNSD
SKTTSSRTGYRAKASVNGYSTGLYATWYADDESHNGAYLDSWGQYSWFDNTVKGDDLQSESYKSKGFTASLEAGYKHKLA
EFNGSKGTRNEWYVQPQAQVTWMGVKAEKHRESNGTLVHSNGDGNIQTRLGVKTWLKSHHKMDDGKSREFQPFVEMNWLH
NSKDFSASMDGVSVTQDGARNIAEIKTGVEGQLNANLNVWGNVGVQVADRGYNDTSAMVGIKWQF
>Mature_1345_residues
MDVLLEIVMNKIYRLKWNRSRNCWCVCSELGSRIKGKKFRAVLISAISLYSSLAFADDVIVKKDETIEFGKENQSIDYRI
KVTDNANLVINATDTSRPRLTLASGGGLDITGGKVTINGPLNFLLKGTGFLNVSNAGSELYADDLYESNSGMRHDQGYFN
VSNGGKIHVKGTSRLTYTQGNVSGEGSQVNSETFFMGVYSSYGGNQYLSVNNGGEVNASKQISLGYYNQNSDTTLAVSEG
GKVSAPTISLSTNSELALGAQEGNAAKAAGIIDAEKIEFVWASTSDKKITLNHTDKNATISADIVSGSEGLGYINALNGT
TYLTGDNSAFSGKVKIEKNGALGITQNIGTAEITNRGKLHLKADDSMTFANKISGNGTISIDSGTVELTGNNYAFSGYID
VASDAVAVISEDKNIGRAELDVDGKLQINANKDWVFDNDLEGKGVVEINMGNHEFSFDEFAYTDWFQGALAFQNTTFNLE
KNAEFLQKGGITAGQGSQITVGKGAHSISTLGFSGGTIDFGALTAGAQMTEGTVNVSKTLDLRGEGVIQVSDSDVVSSIS
RDIDSALSLTEVDDGNSAIKLVDAQGAEVLGDAGNLQLQDKNGQILSSSAQRDIQQNGQKAAVGTYDYRLTSGINNDGLY
IGYGLTQLDLQATDSDALVLSANGKSENAADLSAKVTGSGDLAFSSQKGQTVSLSNKDNDYTGVTDLRSGTLLLKNDNVL
GNTHELRLAAETELDMNGHSQTVGTLNASANSLLNLNDGSLTVTYGGTSTGSLTGSGALNIQGGTLDIAGDNSNLTANVN
IASSANILVSHAQGMGNANIENYGTLALNTHGEKRAAAPVNYTLGGNLTNNGTLMTGMSGQQAGNVLVVKGNYYGNSGQL
VMNTVLNGDDSVTDKLVVEGDTSGTTAVTVNNAGGTGAKTLNGIELIHVDGKSEGEFVQAGRIVAGAYDYTLARGQGANS
GNWYLTSGSDSPEPQPEPEPMPNPEPNPNPEPNPNPEPNPNPEPNPTPTPGPDLNMDNDLRPEAGSYIANLAAANIMFTT
RLHERLGNTDYTDMVTGEQKQTTMWMRHEGGHNKWHDGSGQLKTQGNRYVLQLGGDIAQWSQNNSDRWHVGVMAGYGNSD
SKTTSSRTGYRAKASVNGYSTGLYATWYADDESHNGAYLDSWGQYSWFDNTVKGDDLQSESYKSKGFTASLEAGYKHKLA
EFNGSKGTRNEWYVQPQAQVTWMGVKAEKHRESNGTLVHSNGDGNIQTRLGVKTWLKSHHKMDDGKSREFQPFVEMNWLH
NSKDFSASMDGVSVTQDGARNIAEIKTGVEGQLNANLNVWGNVGVQVADRGYNDTSAMVGIKWQF

Specific function: Unknown

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cell outer membrane; Peripheral membrane protein (Potential) [H]

Metaboloic importance: Non Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 autotransporter (TC 1.B.12) domain [H]

Homologues:

Organism=Escherichia coli, GI1788565, Length=582, Percent_Identity=30.9278350515464, Blast_Score=189, Evalue=8e-49,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR005546
- InterPro:   IPR013425
- InterPro:   IPR006315
- InterPro:   IPR012332
- InterPro:   IPR011050
- InterPro:   IPR004899 [H]

Pfam domain/function: PF03797 Autotransporter; PF03212 Pertactin [H]

EC number: NA

Molecular weight: Translated: 143065; Mature: 143065

Theoretical pI: Translated: 4.68; Mature: 4.68

Prosite motif: PS00639 THIOL_PROTEASE_HIS

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.2 %Cys     (Translated Protein)
1.8 %Met     (Translated Protein)
2.0 %Cys+Met (Translated Protein)
0.2 %Cys     (Mature Protein)
1.8 %Met     (Mature Protein)
2.0 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MDVLLEIVMNKIYRLKWNRSRNCWCVCSELGSRIKGKKFRAVLISAISLYSSLAFADDVI
CHHHHHHHHHHHEEEEECCCCCEEEEHHHHCCCCCCCHHHHHHHHHHHHHHHHHHCCCEE
VKKDETIEFGKENQSIDYRIKVTDNANLVINATDTSRPRLTLASGGGLDITGGKVTINGP
EECCCCEECCCCCCCEEEEEEEECCCCEEEEECCCCCCEEEEECCCCEEEECCEEEECCC
LNFLLKGTGFLNVSNAGSELYADDLYESNSGMRHDQGYFNVSNGGKIHVKGTSRLTYTQG
EEEEEECCCEEEECCCCCCEEHHHHHCCCCCCCCCCCEEECCCCCEEEEEECCEEEEECC
NVSGEGSQVNSETFFMGVYSSYGGNQYLSVNNGGEVNASKQISLGYYNQNSDTTLAVSEG
CCCCCCCCCCCCEEEEEEEECCCCCEEEEECCCCCCCCCCEEEEEEEECCCCCEEEEECC
GKVSAPTISLSTNSELALGAQEGNAAKAAGIIDAEKIEFVWASTSDKKITLNHTDKNATI
CEEECCEEEEECCCCEEEECCCCCCCCEECCEECCEEEEEEECCCCCEEEEEECCCCCEE
SADIVSGSEGLGYINALNGTTYLTGDNSAFSGKVKIEKNGALGITQNIGTAEITNRGKLH
EEEEECCCCCCEEEEEECCEEEEECCCCEEEEEEEEECCCCEEEECCCCCEEECCCCEEE
LKADDSMTFANKISGNGTISIDSGTVELTGNNYAFSGYIDVASDAVAVISEDKNIGRAEL
EEECCCEEEEEECCCCEEEEECCCEEEECCCCEEEEEEEEECCCEEEEEECCCCCCEEEE
DVDGKLQINANKDWVFDNDLEGKGVVEINMGNHEFSFDEFAYTDWFQGALAFQNTTFNLE
CCCCEEEECCCCCEEECCCCCCCEEEEEECCCCCCCCHHHHHHHHHCCEEEEECEEEEEC
KNAEFLQKGGITAGQGSQITVGKGAHSISTLGFSGGTIDFGALTAGAQMTEGTVNVSKTL
CCHHHHHHCCCCCCCCCEEEECCCCCEEEEECCCCCEEEEEEEECCCEECCCEEEEEEEE
DLRGEGVIQVSDSDVVSSISRDIDSALSLTEVDDGNSAIKLVDAQGAEVLGDAGNLQLQD
EECCCEEEEECCCHHHHHHHHHHHHHEEEEEECCCCCEEEEEECCCCEEECCCCCEEEEC
KNGQILSSSAQRDIQQNGQKAAVGTYDYRLTSGINNDGLYIGYGLTQLDLQATDSDALVL
CCCCEEECHHHHHHHHCCCEEEEEEEEEEEECCCCCCCEEEEECCEEEEEEECCCCEEEE
SANGKSENAADLSAKVTGSGDLAFSSQKGQTVSLSNKDNDYTGVTDLRSGTLLLKNDNVL
EECCCCCCCCCEEEEEECCCCEEEECCCCCEEEECCCCCCCCCEEECCCCEEEEECCCEE
GNTHELRLAAETELDMNGHSQTVGTLNASANSLLNLNDGSLTVTYGGTSTGSLTGSGALN
CCCEEEEEEEECEECCCCCCCEEEEEECCCCCEEEECCCEEEEEECCCCCCCCCCCCEEE
IQGGTLDIAGDNSNLTANVNIASSANILVSHAQGMGNANIENYGTLALNTHGEKRAAAPV
ECCCEEEEECCCCCEEEEEEECCCCEEEEEECCCCCCCCCCCEEEEEEECCCCCCCCCCE
NYTLGGNLTNNGTLMTGMSGQQAGNVLVVKGNYYGNSGQLVMNTVLNGDDSVTDKLVVEG
EEEECCCCCCCCEEEECCCCCCCCCEEEEECCEECCCCCEEEEEEECCCCCCCCEEEEEC
DTSGTTAVTVNNAGGTGAKTLNGIELIHVDGKSEGEFVQAGRIVAGAYDYTLARGQGANS
CCCCEEEEEEECCCCCCCCCCCCEEEEEECCCCCCCEEECCEEEEEEEEEEEECCCCCCC
GNWYLTSGSDSPEPQPEPEPMPNPEPNPNPEPNPNPEPNPNPEPNPTPTPGPDLNMDNDL
CCEEEECCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
RPEAGSYIANLAAANIMFTTRLHERLGNTDYTDMVTGEQKQTTMWMRHEGGHNKWHDGSG
CCCHHHHHHHHHHHEEEEEEHHHHHHCCCCCCCCCCCCCHHEEEEEEECCCCCCCCCCCC
QLKTQGNRYVLQLGGDIAQWSQNNSDRWHVGVMAGYGNSDSKTTSSRTGYRAKASVNGYS
CEEECCCEEEEEECCCHHHHCCCCCCEEEEEEEEECCCCCCCCCCCCCCEEEEEECCCCC
TGLYATWYADDESHNGAYLDSWGQYSWFDNTVKGDDLQSESYKSKGFTASLEAGYKHKLA
CCEEEEEEECCCCCCCCEEECCCCCCCCCCCCCCCCCCCCCCCCCCCEEEECCCCCEEHH
EFNGSKGTRNEWYVQPQAQVTWMGVKAEKHRESNGTLVHSNGDGNIQTRLGVKTWLKSHH
CCCCCCCCCCEEEECCCCEEEEEEEEHHHCCCCCCEEEEECCCCCEEEEECHHHHHHHHC
KMDDGKSREFQPFVEMNWLHNSKDFSASMDGVSVTQDGARNIAEIKTGVEGQLNANLNVW
CCCCCCCCCCCCEEEEEEEECCCCCCCCCCCEEECCCCCCCHHHHHCCCCCEEECCEEEE
GNVGVQVADRGYNDTSAMVGIKWQF
ECCCEEEEECCCCCCCEEEEEEEEC
>Mature Secondary Structure
MDVLLEIVMNKIYRLKWNRSRNCWCVCSELGSRIKGKKFRAVLISAISLYSSLAFADDVI
CHHHHHHHHHHHEEEEECCCCCEEEEHHHHCCCCCCCHHHHHHHHHHHHHHHHHHCCCEE
VKKDETIEFGKENQSIDYRIKVTDNANLVINATDTSRPRLTLASGGGLDITGGKVTINGP
EECCCCEECCCCCCCEEEEEEEECCCCEEEEECCCCCCEEEEECCCCEEEECCEEEECCC
LNFLLKGTGFLNVSNAGSELYADDLYESNSGMRHDQGYFNVSNGGKIHVKGTSRLTYTQG
EEEEEECCCEEEECCCCCCEEHHHHHCCCCCCCCCCCEEECCCCCEEEEEECCEEEEECC
NVSGEGSQVNSETFFMGVYSSYGGNQYLSVNNGGEVNASKQISLGYYNQNSDTTLAVSEG
CCCCCCCCCCCCEEEEEEEECCCCCEEEEECCCCCCCCCCEEEEEEEECCCCCEEEEECC
GKVSAPTISLSTNSELALGAQEGNAAKAAGIIDAEKIEFVWASTSDKKITLNHTDKNATI
CEEECCEEEEECCCCEEEECCCCCCCCEECCEECCEEEEEEECCCCCEEEEEECCCCCEE
SADIVSGSEGLGYINALNGTTYLTGDNSAFSGKVKIEKNGALGITQNIGTAEITNRGKLH
EEEEECCCCCCEEEEEECCEEEEECCCCEEEEEEEEECCCCEEEECCCCCEEECCCCEEE
LKADDSMTFANKISGNGTISIDSGTVELTGNNYAFSGYIDVASDAVAVISEDKNIGRAEL
EEECCCEEEEEECCCCEEEEECCCEEEECCCCEEEEEEEEECCCEEEEEECCCCCCEEEE
DVDGKLQINANKDWVFDNDLEGKGVVEINMGNHEFSFDEFAYTDWFQGALAFQNTTFNLE
CCCCEEEECCCCCEEECCCCCCCEEEEEECCCCCCCCHHHHHHHHHCCEEEEECEEEEEC
KNAEFLQKGGITAGQGSQITVGKGAHSISTLGFSGGTIDFGALTAGAQMTEGTVNVSKTL
CCHHHHHHCCCCCCCCCEEEECCCCCEEEEECCCCCEEEEEEEECCCEECCCEEEEEEEE
DLRGEGVIQVSDSDVVSSISRDIDSALSLTEVDDGNSAIKLVDAQGAEVLGDAGNLQLQD
EECCCEEEEECCCHHHHHHHHHHHHHEEEEEECCCCCEEEEEECCCCEEECCCCCEEEEC
KNGQILSSSAQRDIQQNGQKAAVGTYDYRLTSGINNDGLYIGYGLTQLDLQATDSDALVL
CCCCEEECHHHHHHHHCCCEEEEEEEEEEEECCCCCCCEEEEECCEEEEEEECCCCEEEE
SANGKSENAADLSAKVTGSGDLAFSSQKGQTVSLSNKDNDYTGVTDLRSGTLLLKNDNVL
EECCCCCCCCCEEEEEECCCCEEEECCCCCEEEECCCCCCCCCEEECCCCEEEEECCCEE
GNTHELRLAAETELDMNGHSQTVGTLNASANSLLNLNDGSLTVTYGGTSTGSLTGSGALN
CCCEEEEEEEECEECCCCCCCEEEEEECCCCCEEEECCCEEEEEECCCCCCCCCCCCEEE
IQGGTLDIAGDNSNLTANVNIASSANILVSHAQGMGNANIENYGTLALNTHGEKRAAAPV
ECCCEEEEECCCCCEEEEEEECCCCEEEEEECCCCCCCCCCCEEEEEEECCCCCCCCCCE
NYTLGGNLTNNGTLMTGMSGQQAGNVLVVKGNYYGNSGQLVMNTVLNGDDSVTDKLVVEG
EEEECCCCCCCCEEEECCCCCCCCCEEEEECCEECCCCCEEEEEEECCCCCCCCEEEEEC
DTSGTTAVTVNNAGGTGAKTLNGIELIHVDGKSEGEFVQAGRIVAGAYDYTLARGQGANS
CCCCEEEEEEECCCCCCCCCCCCEEEEEECCCCCCCEEECCEEEEEEEEEEEECCCCCCC
GNWYLTSGSDSPEPQPEPEPMPNPEPNPNPEPNPNPEPNPNPEPNPTPTPGPDLNMDNDL
CCEEEECCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
RPEAGSYIANLAAANIMFTTRLHERLGNTDYTDMVTGEQKQTTMWMRHEGGHNKWHDGSG
CCCHHHHHHHHHHHEEEEEEHHHHHHCCCCCCCCCCCCCHHEEEEEEECCCCCCCCCCCC
QLKTQGNRYVLQLGGDIAQWSQNNSDRWHVGVMAGYGNSDSKTTSSRTGYRAKASVNGYS
CEEECCCEEEEEECCCHHHHCCCCCCEEEEEEEEECCCCCCCCCCCCCCEEEEEECCCCC
TGLYATWYADDESHNGAYLDSWGQYSWFDNTVKGDDLQSESYKSKGFTASLEAGYKHKLA
CCEEEEEEECCCCCCCCEEECCCCCCCCCCCCCCCCCCCCCCCCCCCEEEECCCCCEEHH
EFNGSKGTRNEWYVQPQAQVTWMGVKAEKHRESNGTLVHSNGDGNIQTRLGVKTWLKSHH
CCCCCCCCCCEEEECCCCEEEEEEEEHHHCCCCCCEEEEECCCCCEEEEECHHHHHHHHC
KMDDGKSREFQPFVEMNWLHNSKDFSASMDGVSVTQDGARNIAEIKTGVEGQLNANLNVW
CCCCCCCCCCCCEEEEEEEECCCCCCCCCCCEEECCCCCCCHHHHHCCCCCEEECCEEEE
GNVGVQVADRGYNDTSAMVGIKWQF
ECCCEEEEECCCCCCCEEEEEEEEC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: NA