Definition Candidatus Solibacter usitatus Ellin6076 chromosome, complete genome.
Accession NC_008536
Length 9,965,640

Click here to switch to the map view.

The map label for this gene is nolG [H]

Identifier: 116621483

GI number: 116621483

Start: 3011699

End: 3016423

Strand: Direct

Name: nolG [H]

Synonym: Acid_2365

Alternate gene names: 116621483

Gene position: 3011699-3016423 (Clockwise)

Preceding gene: 116621482

Following gene: 116621485

Centisome position: 30.22

GC content: 63.15

Gene sequence:

>4725_bases
ATGCATACACTCGCCCAACTCTGCGTTCGCCGTCCCGTTTTTGCGACCATGCTGGTTCTTTCGCTGGTCGTGGTGGGCAC
CTTTTGCTATTTCAGCCTCGGCGTCGATCTCTTCCCCAAAGTCGATATCCCAACGGTCGTCGTCACCATTGTCAATCCCG
GCGCCTCCCCGGAAGAGGTCGAAACCGAAATCACCAAGAAGGTGGAAGACGCCGTCAACACCATCAGCCAGGTGGACGAG
CTGCGCTCTACCTCCTCCGAGGGCCAGTCGCTCGTCACCATCCAGTTCGAGCTCTCCAAGAACGGCGATGTCGCCGCGCA
GGAAGTCCAGAACAAGGTCAACCTGATCGTCAACAAGCTGCCCGAGACCGCCAAGGCGCCCATCGTCCAGAAGTTCGATC
CCGATGCCACTCCCATTCTGCAGATCGCGGTCTCGGCCAACCGCTCGCTCCGCGACGTCACCCTGATCGCCGATAAGCAG
ATCAAGCAGAAGTTGGAAAATGCCCGCGGCGTCGGCCAGATCACCATCGTCGGCGGCGCCCGCCGCGAAATCCACGTGAT
GGTGGACCCCGACCGCCTCCGCTCCTATAACCTCACCATCAACGACGTCTTCGCCGCCCTGCGCACCCAGAATCTCGAGC
TGCCCGGCGGCAATCTCAGCGCCGGCTCCAAGGAGCTCAGCGTGCGCACCACGGGCCGCATCGTCGATGCCGAACAGTTC
AACCAGGTCACCATCGCCAACCGCAATGGGTATGCCGTCAAAGTAGCCGATATCGGCGTGGCCGAGGATAGCTACGAGGA
ACCCCGCTCCGCCGCGCGCCTCGATGGCGTGCCGGCCGTGACCCTGATCGTCGCCAAACAGAGCGGCGTGAATACCGTGG
CCACCTCGGACGAAGTCAAGGACCGTCTCGCCGAAATCGTCAAGACCCTGCCTCCCGATATCCACGCCTCCGTGATCAGC
GATCAGTCGGTCTTCATCAAGGCCGCCGTCGAAAACATCAAGCACCACCTCATCGAAGGCAGTTTCTTCGCCGCCATCAT
CATCTTTTTCTTCCTGGCCAACATCCGCACCACGCTGATCGCCGCCATTGCGATTCCCACGTCCATCATTTCCACCTTCG
CCCTGATGGCCGCCATGGGCTTCACGCTCAATCAGATCACCATGCTCGCGCTCACCCTGATGGTCGGCATCGTGATCGAT
GACGCCATCATCGTGCTCGAAAATATCTACCGCTACATCGAAGAGAAGGACATGCCGCCCTTCCAGGCGGCCATTCAGGG
CACCAAGGAAATCGGCCTCGCCGTCATGGCCACCACGCTCTCGCTGCTCGCCGTCTTCCTGCCGGTCGGCTTCATGGGAG
GTATCGTCGGCCGCTTCATGAGCTCCTTCGGCTTCACCTCAGCCTTTGCGATCGCGGTCTCGCTCCTGGTCTCCTTTACC
CTGACCCCGATGCTCTGCTCGCGCTTCATCAAGCGCCCCGAACCGGTCGGCCCGGGCCAGCATGCCTCCAAGGAATCCTT
CATCTTCAAGCACCTCGATACTTCCTACACGCGCATGCTGAAGTGGAGCATGGCCCACCGCAAGACCGTGGTCGCGATCA
GCGTTGGCGTGATCCTCTCGATGGTGCCGCTCTTCATGTTCGTCGGCAAGAACTTCCTGCCGCAGGACGATCAGTCGCAG
TACAACGTCCTCATCCGCACCCCGGAAGGCACCTCCATCGCCGCCACCACCAACCTCGCCGAACGCATCGCCCAGGAGGT
CCGCGGCCTCCCCGGCGTGGCCCACACGCTCATGACCGCCGGCGGCAGCGCCGACAAGAGCGTCAATAACGCGTCCATTT
ACGTCAAGCTGACCGATATCGATCAGCGCACCGTCACCCAGCAGCAGCTGATGCAGCGCACGCGCGATCTGATGAAGAAG
TATCCCCCCGAAATCCATACCGGCGTCGAGCTGGTCAGCAGCGTGGGCGGCAATCAGAGCAATGCCGAAATCCAGTACTA
CATTCAGGGTCCGGACCTGAAAAAGCTCGCCGACTACTCCCAGGCCCTGTTAACCAAAATGCGCGCCATGCCCGCCCTCG
TCGATCAGGACAGCACCCTGCGCAGCGGTAAACCCGAAGTGCGCCTCATCATCGATCGCCCCCGCGCCGCCGATCTCGGC
GTCAGCGTGATGGATATCGAACAGGCGCTCAATACCCTGGTGGCCGGTCAGGCCGCCTCCACCTTCAATGCCGGGGACGA
TCAATATGACGTGGTCGTACGCGCTCAGGAACAGTTCCGCGGCAGCGTGGAAGGCCTCGCTAAAATGACCGTGCCGTCGC
GCAAGGTCGGCTCCGTCGGCCTCGATGAAGTCGTCAAAATCGAGCCCGGCACCGGCCCCTCCTCGGTCAACCGCATCGCC
CGTCAGCGTCAGGTGACCCTCTCCGCCAATCTCAAACCCGGTGGCTCGCAAGCCGCCGTCATTCAGCAGTTGAACGAGGC
CAGCGCCCAGCTCAACATGGAACCTGGCTACCACTCCGGTCTGGCCGGCGCTTCCAAGGAACTCGGCCGCACCGGCTATT
ATTTCGCGCTCGCCTTCTCGCTCACCTTCATCTTCATGTACATCGTGCTCGCCGCCCAGTTCGAGAGTTTCATTCACCCG
ATCACGATTCTGATCACCCTGCCGCTCGCCGTGCCCTTCGGCATCCTGTCGCTGTTGATCGCCGGCCAGACCGTCAACAT
CTTTTCCGGCCTCGGCCTGCTGCTCTTATTCGGCATCGTGAAGAAGAACGCGATTCTGCAGATCGATCACACCAACGGTC
TGCGCGAGGCCGGCATGAATCGCTACGACGCCATCATTCAGGCCAACCGCGACCGCCTCCGTCCAATTCTGATGACCACC
ATCGCGCTGGTCGCCGGCATGGCGCCGCTGGTGATCTCGCACGGCACCGGCTCCGCCACCAACCGCTCCATCGGCGTGCT
CGTGGTCGGCGGCCAGTCGCTCTGCCTGATCCTCACCCTGCTCGCCGTGCCGGTCTTCTATTCGCTGTTCGAAGATCTCG
CCGATGGGTTCGCGCACGGCCGCGTTGCCCGTGTCTTCGGCTGGCTGCGCCGCCGTGTCACCAAGGCCGCCGCCATTTCC
GCCGCCCTCGTCGGCTCCCTTTTTGCCCAGCAGCCCGCCCAGGAAACGGTCAAGGTTGCCGAGATTCAACCCCTCAAGCA
GGTGGAGATCGGCCCGCGCATCGGTATCCTCGGCCAGGCAAGGCTCCGCCTGCCGGAAGTCATCGAGCGCGTCCTCGCCA
ACGATCCCGATATCGCCATCTCGCGCATTCAGCTCGAAGAGTCGGGCTATCGCATCCGCGGCGCCCAGGGCGCGTACGAT
CCGCTCATCGGCCTGCGCGCCGATCGCAGCAAGTCCGTCACTCCCGTGGCATCCGCTCTCGGCGGCTCCGCCAGCGGCAA
GCTCACTACCAAATTCTTCGAGGTCAACCCGCAGGTCTCCGGCATTAGTCCCACCGGCGGCAACTACACCCTTACGTTCA
ATAACGCGCGCCAGCAGACCGACAACCTGTTCAGCAGCATCAACCCGGTCTATCCCACCGGCATCGTGATGAACGTCACT
CAGCCGCTGTGGCGCGGTCTGCGTTTCGATGATACCCGCTACCGCATTCAGGTAGCCCGCACCAACCAGCGCCTCAGCGT
TCAGCAGCTCCGCCAGCGCATCATCGAAGTCGTCACCCAGGCGGTACAGGCTTATTGGGAGCTCGACTACGCGTCAAACA
ACCTCAACGTCCAGTTGGAGGCCGTCAAACTCGCGCAAGGCCAGTACGAAAGCAACCGCCGCCAGGCCGTGCAGGGCATC
CTCGCGCCTGTCGATGTCGTGGCCGCGCAGACTCAGTTCGCCACCTTCCAGCAGAATCTGCTCGCCGCCCAGACGGCGCT
CACCTCCGCCGAGAATAATCTGAAGTCGCTGATGCTGCCCAATCGCTCCGACCTCATGTGGGGCATGGCGCTTATCCCCG
AGACCCAGCTCGATGCCGCGGCCTCGGTGCCCGCACTCGATGACGCCATCAAAGAGGCGCTCGCCGGACGCCCCGAAATT
GCCGAGACTTCGCTCGCCATCGACCTCGGCAACCTCGATGTCCGTCTCTCCAAGGAAAATACGCGCCCGCGCATCGACGC
CTTCGCCAACGTCACTTCCGCCGGCCTCGCCGGCACCGTGGTTCCGCCCGGATCCAATCCGATCCTGGCCCTGCTCCCCG
GCGGCGGCATCGTGCCGTCGATCCTGAACGGCGGCTACGGCCAGTCGCTCGGCAACGCCTTCGGCGCCGTCTTCCCCACC
GTGCAGGTCGGCGTGCAGATGTCCTTCCCGATCCGCAATCGCACCGCCGAATCGCAGGCCGCTACTGCCGTACTGGAAAG
CCGCCGCCTTGCCAAGACCAAGGATCAGGTCATGATGGCCGTCGAATCCGACGTCCGCAACGCCTTGCAGGCCGCGACCA
ACAGCCGCGCCCGCCTCTCCGCCGCCATCATCGCCAGCCAGTCCGCCGAAGAGCAATACCTCAGCGAACAGCGCCAGTTC
CAGGCCGGCACCTCCAGCACCTTCCTCGTGCTCCAACGCCAGACCGACCTGATCACCGCCCGCAATCGCGAAACCCGCGC
CCACGCCGATTTCGCCGTCTCCCTCGCCAACCTCGACCGCGCCACCGCCCAAACTCTCGACACCCGCGGCATCCGTTTCC
CATAA

Upstream 100 bases:

>100_bases
TCAGATCCGCATCGTGAGCGGTCTCAATCCCAACGACACCGTCGCCACCAGCCATCAGGCCGAGCTCTTCGATGGCGCCA
CGGTGCAGGTTCGGTAACCC

Downstream 100 bases:

>100_bases
CGTGCCCTTGACTGTATTACACTGCTCTTGTTTGCTCGCAGACCGCAAACATCCGCACCGCAATATTCGCCGCCCATCAG
AGCCGCGACCGTAAGGGAGC

Product: acriflavin resistance protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 1574; Mature: 1574

Protein sequence:

>1574_residues
MHTLAQLCVRRPVFATMLVLSLVVVGTFCYFSLGVDLFPKVDIPTVVVTIVNPGASPEEVETEITKKVEDAVNTISQVDE
LRSTSSEGQSLVTIQFELSKNGDVAAQEVQNKVNLIVNKLPETAKAPIVQKFDPDATPILQIAVSANRSLRDVTLIADKQ
IKQKLENARGVGQITIVGGARREIHVMVDPDRLRSYNLTINDVFAALRTQNLELPGGNLSAGSKELSVRTTGRIVDAEQF
NQVTIANRNGYAVKVADIGVAEDSYEEPRSAARLDGVPAVTLIVAKQSGVNTVATSDEVKDRLAEIVKTLPPDIHASVIS
DQSVFIKAAVENIKHHLIEGSFFAAIIIFFFLANIRTTLIAAIAIPTSIISTFALMAAMGFTLNQITMLALTLMVGIVID
DAIIVLENIYRYIEEKDMPPFQAAIQGTKEIGLAVMATTLSLLAVFLPVGFMGGIVGRFMSSFGFTSAFAIAVSLLVSFT
LTPMLCSRFIKRPEPVGPGQHASKESFIFKHLDTSYTRMLKWSMAHRKTVVAISVGVILSMVPLFMFVGKNFLPQDDQSQ
YNVLIRTPEGTSIAATTNLAERIAQEVRGLPGVAHTLMTAGGSADKSVNNASIYVKLTDIDQRTVTQQQLMQRTRDLMKK
YPPEIHTGVELVSSVGGNQSNAEIQYYIQGPDLKKLADYSQALLTKMRAMPALVDQDSTLRSGKPEVRLIIDRPRAADLG
VSVMDIEQALNTLVAGQAASTFNAGDDQYDVVVRAQEQFRGSVEGLAKMTVPSRKVGSVGLDEVVKIEPGTGPSSVNRIA
RQRQVTLSANLKPGGSQAAVIQQLNEASAQLNMEPGYHSGLAGASKELGRTGYYFALAFSLTFIFMYIVLAAQFESFIHP
ITILITLPLAVPFGILSLLIAGQTVNIFSGLGLLLLFGIVKKNAILQIDHTNGLREAGMNRYDAIIQANRDRLRPILMTT
IALVAGMAPLVISHGTGSATNRSIGVLVVGGQSLCLILTLLAVPVFYSLFEDLADGFAHGRVARVFGWLRRRVTKAAAIS
AALVGSLFAQQPAQETVKVAEIQPLKQVEIGPRIGILGQARLRLPEVIERVLANDPDIAISRIQLEESGYRIRGAQGAYD
PLIGLRADRSKSVTPVASALGGSASGKLTTKFFEVNPQVSGISPTGGNYTLTFNNARQQTDNLFSSINPVYPTGIVMNVT
QPLWRGLRFDDTRYRIQVARTNQRLSVQQLRQRIIEVVTQAVQAYWELDYASNNLNVQLEAVKLAQGQYESNRRQAVQGI
LAPVDVVAAQTQFATFQQNLLAAQTALTSAENNLKSLMLPNRSDLMWGMALIPETQLDAAASVPALDDAIKEALAGRPEI
AETSLAIDLGNLDVRLSKENTRPRIDAFANVTSAGLAGTVVPPGSNPILALLPGGGIVPSILNGGYGQSLGNAFGAVFPT
VQVGVQMSFPIRNRTAESQAATAVLESRRLAKTKDQVMMAVESDVRNALQAATNSRARLSAAIIASQSAEEQYLSEQRQF
QAGTSSTFLVLQRQTDLITARNRETRAHADFAVSLANLDRATAQTLDTRGIRFP

Sequences:

>Translated_1574_residues
MHTLAQLCVRRPVFATMLVLSLVVVGTFCYFSLGVDLFPKVDIPTVVVTIVNPGASPEEVETEITKKVEDAVNTISQVDE
LRSTSSEGQSLVTIQFELSKNGDVAAQEVQNKVNLIVNKLPETAKAPIVQKFDPDATPILQIAVSANRSLRDVTLIADKQ
IKQKLENARGVGQITIVGGARREIHVMVDPDRLRSYNLTINDVFAALRTQNLELPGGNLSAGSKELSVRTTGRIVDAEQF
NQVTIANRNGYAVKVADIGVAEDSYEEPRSAARLDGVPAVTLIVAKQSGVNTVATSDEVKDRLAEIVKTLPPDIHASVIS
DQSVFIKAAVENIKHHLIEGSFFAAIIIFFFLANIRTTLIAAIAIPTSIISTFALMAAMGFTLNQITMLALTLMVGIVID
DAIIVLENIYRYIEEKDMPPFQAAIQGTKEIGLAVMATTLSLLAVFLPVGFMGGIVGRFMSSFGFTSAFAIAVSLLVSFT
LTPMLCSRFIKRPEPVGPGQHASKESFIFKHLDTSYTRMLKWSMAHRKTVVAISVGVILSMVPLFMFVGKNFLPQDDQSQ
YNVLIRTPEGTSIAATTNLAERIAQEVRGLPGVAHTLMTAGGSADKSVNNASIYVKLTDIDQRTVTQQQLMQRTRDLMKK
YPPEIHTGVELVSSVGGNQSNAEIQYYIQGPDLKKLADYSQALLTKMRAMPALVDQDSTLRSGKPEVRLIIDRPRAADLG
VSVMDIEQALNTLVAGQAASTFNAGDDQYDVVVRAQEQFRGSVEGLAKMTVPSRKVGSVGLDEVVKIEPGTGPSSVNRIA
RQRQVTLSANLKPGGSQAAVIQQLNEASAQLNMEPGYHSGLAGASKELGRTGYYFALAFSLTFIFMYIVLAAQFESFIHP
ITILITLPLAVPFGILSLLIAGQTVNIFSGLGLLLLFGIVKKNAILQIDHTNGLREAGMNRYDAIIQANRDRLRPILMTT
IALVAGMAPLVISHGTGSATNRSIGVLVVGGQSLCLILTLLAVPVFYSLFEDLADGFAHGRVARVFGWLRRRVTKAAAIS
AALVGSLFAQQPAQETVKVAEIQPLKQVEIGPRIGILGQARLRLPEVIERVLANDPDIAISRIQLEESGYRIRGAQGAYD
PLIGLRADRSKSVTPVASALGGSASGKLTTKFFEVNPQVSGISPTGGNYTLTFNNARQQTDNLFSSINPVYPTGIVMNVT
QPLWRGLRFDDTRYRIQVARTNQRLSVQQLRQRIIEVVTQAVQAYWELDYASNNLNVQLEAVKLAQGQYESNRRQAVQGI
LAPVDVVAAQTQFATFQQNLLAAQTALTSAENNLKSLMLPNRSDLMWGMALIPETQLDAAASVPALDDAIKEALAGRPEI
AETSLAIDLGNLDVRLSKENTRPRIDAFANVTSAGLAGTVVPPGSNPILALLPGGGIVPSILNGGYGQSLGNAFGAVFPT
VQVGVQMSFPIRNRTAESQAATAVLESRRLAKTKDQVMMAVESDVRNALQAATNSRARLSAAIIASQSAEEQYLSEQRQF
QAGTSSTFLVLQRQTDLITARNRETRAHADFAVSLANLDRATAQTLDTRGIRFP
>Mature_1574_residues
MHTLAQLCVRRPVFATMLVLSLVVVGTFCYFSLGVDLFPKVDIPTVVVTIVNPGASPEEVETEITKKVEDAVNTISQVDE
LRSTSSEGQSLVTIQFELSKNGDVAAQEVQNKVNLIVNKLPETAKAPIVQKFDPDATPILQIAVSANRSLRDVTLIADKQ
IKQKLENARGVGQITIVGGARREIHVMVDPDRLRSYNLTINDVFAALRTQNLELPGGNLSAGSKELSVRTTGRIVDAEQF
NQVTIANRNGYAVKVADIGVAEDSYEEPRSAARLDGVPAVTLIVAKQSGVNTVATSDEVKDRLAEIVKTLPPDIHASVIS
DQSVFIKAAVENIKHHLIEGSFFAAIIIFFFLANIRTTLIAAIAIPTSIISTFALMAAMGFTLNQITMLALTLMVGIVID
DAIIVLENIYRYIEEKDMPPFQAAIQGTKEIGLAVMATTLSLLAVFLPVGFMGGIVGRFMSSFGFTSAFAIAVSLLVSFT
LTPMLCSRFIKRPEPVGPGQHASKESFIFKHLDTSYTRMLKWSMAHRKTVVAISVGVILSMVPLFMFVGKNFLPQDDQSQ
YNVLIRTPEGTSIAATTNLAERIAQEVRGLPGVAHTLMTAGGSADKSVNNASIYVKLTDIDQRTVTQQQLMQRTRDLMKK
YPPEIHTGVELVSSVGGNQSNAEIQYYIQGPDLKKLADYSQALLTKMRAMPALVDQDSTLRSGKPEVRLIIDRPRAADLG
VSVMDIEQALNTLVAGQAASTFNAGDDQYDVVVRAQEQFRGSVEGLAKMTVPSRKVGSVGLDEVVKIEPGTGPSSVNRIA
RQRQVTLSANLKPGGSQAAVIQQLNEASAQLNMEPGYHSGLAGASKELGRTGYYFALAFSLTFIFMYIVLAAQFESFIHP
ITILITLPLAVPFGILSLLIAGQTVNIFSGLGLLLLFGIVKKNAILQIDHTNGLREAGMNRYDAIIQANRDRLRPILMTT
IALVAGMAPLVISHGTGSATNRSIGVLVVGGQSLCLILTLLAVPVFYSLFEDLADGFAHGRVARVFGWLRRRVTKAAAIS
AALVGSLFAQQPAQETVKVAEIQPLKQVEIGPRIGILGQARLRLPEVIERVLANDPDIAISRIQLEESGYRIRGAQGAYD
PLIGLRADRSKSVTPVASALGGSASGKLTTKFFEVNPQVSGISPTGGNYTLTFNNARQQTDNLFSSINPVYPTGIVMNVT
QPLWRGLRFDDTRYRIQVARTNQRLSVQQLRQRIIEVVTQAVQAYWELDYASNNLNVQLEAVKLAQGQYESNRRQAVQGI
LAPVDVVAAQTQFATFQQNLLAAQTALTSAENNLKSLMLPNRSDLMWGMALIPETQLDAAASVPALDDAIKEALAGRPEI
AETSLAIDLGNLDVRLSKENTRPRIDAFANVTSAGLAGTVVPPGSNPILALLPGGGIVPSILNGGYGQSLGNAFGAVFPT
VQVGVQMSFPIRNRTAESQAATAVLESRRLAKTKDQVMMAVESDVRNALQAATNSRARLSAAIIASQSAEEQYLSEQRQF
QAGTSSTFLVLQRQTDLITARNRETRAHADFAVSLANLDRATAQTLDTRGIRFP

Specific function: Involved in the production of Medicago-specific nodulation signal molecule [H]

COG id: COG0841

COG function: function code V; Cation/multidrug efflux pump

Gene ontology:

Cell location: Integral Membrane Protein. Inner Membrane [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

Organism=Escherichia coli, GI1788390, Length=1034, Percent_Identity=31.9148936170213, Blast_Score=492, Evalue=1e-140,
Organism=Escherichia coli, GI1788391, Length=1024, Percent_Identity=31.4453125, Blast_Score=476, Evalue=1e-135,
Organism=Escherichia coli, GI1788814, Length=1040, Percent_Identity=27.8846153846154, Blast_Score=392, Evalue=1e-110,
Organism=Escherichia coli, GI1789666, Length=1034, Percent_Identity=27.5628626692456, Blast_Score=362, Evalue=1e-100,
Organism=Escherichia coli, GI1789930, Length=1035, Percent_Identity=26.3768115942029, Blast_Score=350, Evalue=3e-97,
Organism=Escherichia coli, GI1786667, Length=1041, Percent_Identity=25.4562920268972, Blast_Score=338, Evalue=2e-93,
Organism=Escherichia coli, GI1786788, Length=1053, Percent_Identity=23.7416904083571, Blast_Score=275, Evalue=2e-74,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR001036 [H]

Pfam domain/function: PF00873 ACR_tran [H]

EC number: NA

Molecular weight: Translated: 170070; Mature: 170070

Theoretical pI: Translated: 9.03; Mature: 9.03

Prosite motif: PS50156 SSD

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.3 %Cys     (Translated Protein)
2.2 %Met     (Translated Protein)
2.5 %Cys+Met (Translated Protein)
0.3 %Cys     (Mature Protein)
2.2 %Met     (Mature Protein)
2.5 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MHTLAQLCVRRPVFATMLVLSLVVVGTFCYFSLGVDLFPKVDIPTVVVTIVNPGASPEEV
CCHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCEEEEEEECCCCCHHHH
ETEITKKVEDAVNTISQVDELRSTSSEGQSLVTIQFELSKNGDVAAQEVQNKVNLIVNKL
HHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEEEEEEEECCCCCHHHHHHHHHHHHHHHHC
PETAKAPIVQKFDPDATPILQIAVSANRSLRDVTLIADKQIKQKLENARGVGQITIVGGA
CCHHCCCCCCCCCCCCCCEEEEEECCCCCCCEEEEHHHHHHHHHHHHCCCCEEEEEEECC
RREIHVMVDPDRLRSYNLTINDVFAALRTQNLELPGGNLSAGSKELSVRTTGRIVDAEQF
CEEEEEEECHHHHCEECCHHHHHHHHHHHCCCCCCCCCCCCCCCEEEEEECCCEECHHHC
NQVTIANRNGYAVKVADIGVAEDSYEEPRSAARLDGVPAVTLIVAKQSGVNTVATSDEVK
CEEEEECCCCCEEEEEECCCCCCCCCCCHHHHHCCCCCEEEEEEEECCCCCCCCCCHHHH
DRLAEIVKTLPPDIHASVISDQSVFIKAAVENIKHHLIEGSFFAAIIIFFFLANIRTTLI
HHHHHHHHHCCCCHHHHHHCCCHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHH
AAIAIPTSIISTFALMAAMGFTLNQITMLALTLMVGIVIDDAIIVLENIYRYIEEKDMPP
HHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCH
FQAAIQGTKEIGLAVMATTLSLLAVFLPVGFMGGIVGRFMSSFGFTSAFAIAVSLLVSFT
HHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHH
LTPMLCSRFIKRPEPVGPGQHASKESFIFKHLDTSYTRMLKWSMAHRKTVVAISVGVILS
HHHHHHHHHHCCCCCCCCCCCCCCHHHHHHHHCHHHHHHHHHHHHHCCEEEEHHHHHHHH
MVPLFMFVGKNFLPQDDQSQYNVLIRTPEGTSIAATTNLAERIAQEVRGLPGVAHTLMTA
HHHHHHHHCCCCCCCCCCCCCEEEEECCCCCEEEHHHHHHHHHHHHHCCCCHHHHHHHHC
GGSADKSVNNASIYVKLTDIDQRTVTQQQLMQRTRDLMKKYPPEIHTGVELVSSVGGNQS
CCCCCCCCCCCEEEEEEECCCHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHCCCCCC
NAEIQYYIQGPDLKKLADYSQALLTKMRAMPALVDQDSTLRSGKPEVRLIIDRPRAADLG
CCEEEEEECCCCHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCEEEEEECCCCCCCC
VSVMDIEQALNTLVAGQAASTFNAGDDQYDVVVRAQEQFRGSVEGLAKMTVPSRKVGSVG
CHHHHHHHHHHHHHHCCCCCCCCCCCCCEEEEEEEHHHHCCHHHHHHHHCCCCCCCCCCC
LDEVVKIEPGTGPSSVNRIARQRQVTLSANLKPGGSQAAVIQQLNEASAQLNMEPGYHSG
CCCEEEECCCCCHHHHHHHHHHHEEEEEECCCCCCCHHHHHHHHHHHHHEEECCCCCCCC
LAGASKELGRTGYYFALAFSLTFIFMYIVLAAQFESFIHPITILITLPLAVPFGILSLLI
CCCCHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
AGQTVNIFSGLGLLLLFGIVKKNAILQIDHTNGLREAGMNRYDAIIQANRDRLRPILMTT
CCCHHHHHHHHHHHHHHHHHCCCCEEEEECCCCHHHHCCCHHHHHHHCCHHHHHHHHHHH
IALVAGMAPLVISHGTGSATNRSIGVLVVGGQSLCLILTLLAVPVFYSLFEDLADGFAHG
HHHHHCCHHHEEECCCCCCCCCCEEEEEECCCHHHHHHHHHHHHHHHHHHHHHHHHHHCC
RVARVFGWLRRRVTKAAAISAALVGSLFAQQPAQETVKVAEIQPLKQVEIGPRIGILGQA
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHCCCCHHCCCCCCCCCCCCH
RLRLPEVIERVLANDPDIAISRIQLEESGYRIRGAQGAYDPLIGLRADRSKSVTPVASAL
HCCHHHHHHHHHCCCCCCEEEEEEEECCCCEEECCCCCCCCCCCCCCCCCCCCCHHHHHC
GGSASGKLTTKFFEVNPQVSGISPTGGNYTLTFNNARQQTDNLFSSINPVYPTGIVMNVT
CCCCCCCEEEEEEEECCCCCCCCCCCCCEEEEECCHHHHHHHHHHCCCCCCCCCEEEECC
QPLWRGLRFDDTRYRIQVARTNQRLSVQQLRQRIIEVVTQAVQAYWELDYASNNLNVQLE
HHHHCCCCCCCCEEEEEEECCCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEEEE
AVKLAQGQYESNRRQAVQGILAPVDVVAAQTQFATFQQNLLAAQTALTSAENNLKSLMLP
EEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCHHHHCCC
NRSDLMWGMALIPETQLDAAASVPALDDAIKEALAGRPEIAETSLAIDLGNLDVRLSKEN
CCCHHHHHHHHCCCCHHHHHCCCCHHHHHHHHHHCCCCCCCCCEEEEEECCEEEEEECCC
TRPRIDAFANVTSAGLAGTVVPPGSNPILALLPGGGIVPSILNGGYGQSLGNAFGAVFPT
CCCHHHHHHHHHHCCCCCEEECCCCCCEEEEECCCCCHHHHHCCCCCHHHHHHHHHHCCH
VQVGVQMSFPIRNRTAESQAATAVLESRRLAKTKDQVMMAVESDVRNALQAATNSRARLS
HEECEEEECCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHH
AAIIASQSAEEQYLSEQRQFQAGTSSTFLVLQRQTDLITARNRETRAHADFAVSLANLDR
HHHHHCCCHHHHHHHHHHHHCCCCCCEEEEEEECCCEEEECCCCCCCHHHHEEEHHHHHH
ATAQTLDTRGIRFP
HHHHHHHCCCCCCC
>Mature Secondary Structure
MHTLAQLCVRRPVFATMLVLSLVVVGTFCYFSLGVDLFPKVDIPTVVVTIVNPGASPEEV
CCHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCEEEEEEECCCCCHHHH
ETEITKKVEDAVNTISQVDELRSTSSEGQSLVTIQFELSKNGDVAAQEVQNKVNLIVNKL
HHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEEEEEEEECCCCCHHHHHHHHHHHHHHHHC
PETAKAPIVQKFDPDATPILQIAVSANRSLRDVTLIADKQIKQKLENARGVGQITIVGGA
CCHHCCCCCCCCCCCCCCEEEEEECCCCCCCEEEEHHHHHHHHHHHHCCCCEEEEEEECC
RREIHVMVDPDRLRSYNLTINDVFAALRTQNLELPGGNLSAGSKELSVRTTGRIVDAEQF
CEEEEEEECHHHHCEECCHHHHHHHHHHHCCCCCCCCCCCCCCCEEEEEECCCEECHHHC
NQVTIANRNGYAVKVADIGVAEDSYEEPRSAARLDGVPAVTLIVAKQSGVNTVATSDEVK
CEEEEECCCCCEEEEEECCCCCCCCCCCHHHHHCCCCCEEEEEEEECCCCCCCCCCHHHH
DRLAEIVKTLPPDIHASVISDQSVFIKAAVENIKHHLIEGSFFAAIIIFFFLANIRTTLI
HHHHHHHHHCCCCHHHHHHCCCHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHH
AAIAIPTSIISTFALMAAMGFTLNQITMLALTLMVGIVIDDAIIVLENIYRYIEEKDMPP
HHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCH
FQAAIQGTKEIGLAVMATTLSLLAVFLPVGFMGGIVGRFMSSFGFTSAFAIAVSLLVSFT
HHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHH
LTPMLCSRFIKRPEPVGPGQHASKESFIFKHLDTSYTRMLKWSMAHRKTVVAISVGVILS
HHHHHHHHHHCCCCCCCCCCCCCCHHHHHHHHCHHHHHHHHHHHHHCCEEEEHHHHHHHH
MVPLFMFVGKNFLPQDDQSQYNVLIRTPEGTSIAATTNLAERIAQEVRGLPGVAHTLMTA
HHHHHHHHCCCCCCCCCCCCCEEEEECCCCCEEEHHHHHHHHHHHHHCCCCHHHHHHHHC
GGSADKSVNNASIYVKLTDIDQRTVTQQQLMQRTRDLMKKYPPEIHTGVELVSSVGGNQS
CCCCCCCCCCCEEEEEEECCCHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHCCCCCC
NAEIQYYIQGPDLKKLADYSQALLTKMRAMPALVDQDSTLRSGKPEVRLIIDRPRAADLG
CCEEEEEECCCCHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCEEEEEECCCCCCCC
VSVMDIEQALNTLVAGQAASTFNAGDDQYDVVVRAQEQFRGSVEGLAKMTVPSRKVGSVG
CHHHHHHHHHHHHHHCCCCCCCCCCCCCEEEEEEEHHHHCCHHHHHHHHCCCCCCCCCCC
LDEVVKIEPGTGPSSVNRIARQRQVTLSANLKPGGSQAAVIQQLNEASAQLNMEPGYHSG
CCCEEEECCCCCHHHHHHHHHHHEEEEEECCCCCCCHHHHHHHHHHHHHEEECCCCCCCC
LAGASKELGRTGYYFALAFSLTFIFMYIVLAAQFESFIHPITILITLPLAVPFGILSLLI
CCCCHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
AGQTVNIFSGLGLLLLFGIVKKNAILQIDHTNGLREAGMNRYDAIIQANRDRLRPILMTT
CCCHHHHHHHHHHHHHHHHHCCCCEEEEECCCCHHHHCCCHHHHHHHCCHHHHHHHHHHH
IALVAGMAPLVISHGTGSATNRSIGVLVVGGQSLCLILTLLAVPVFYSLFEDLADGFAHG
HHHHHCCHHHEEECCCCCCCCCCEEEEEECCCHHHHHHHHHHHHHHHHHHHHHHHHHHCC
RVARVFGWLRRRVTKAAAISAALVGSLFAQQPAQETVKVAEIQPLKQVEIGPRIGILGQA
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHCCCCHHCCCCCCCCCCCCH
RLRLPEVIERVLANDPDIAISRIQLEESGYRIRGAQGAYDPLIGLRADRSKSVTPVASAL
HCCHHHHHHHHHCCCCCCEEEEEEEECCCCEEECCCCCCCCCCCCCCCCCCCCCHHHHHC
GGSASGKLTTKFFEVNPQVSGISPTGGNYTLTFNNARQQTDNLFSSINPVYPTGIVMNVT
CCCCCCCEEEEEEEECCCCCCCCCCCCCEEEEECCHHHHHHHHHHCCCCCCCCCEEEECC
QPLWRGLRFDDTRYRIQVARTNQRLSVQQLRQRIIEVVTQAVQAYWELDYASNNLNVQLE
HHHHCCCCCCCCEEEEEEECCCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEEEE
AVKLAQGQYESNRRQAVQGILAPVDVVAAQTQFATFQQNLLAAQTALTSAENNLKSLMLP
EEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCHHHHCCC
NRSDLMWGMALIPETQLDAAASVPALDDAIKEALAGRPEIAETSLAIDLGNLDVRLSKEN
CCCHHHHHHHHCCCCHHHHHCCCCHHHHHHHHHHCCCCCCCCCEEEEEECCEEEEEECCC
TRPRIDAFANVTSAGLAGTVVPPGSNPILALLPGGGIVPSILNGGYGQSLGNAFGAVFPT
CCCHHHHHHHHHHCCCCCEEECCCCCCEEEEECCCCCHHHHHCCCCCHHHHHHHHHHCCH
VQVGVQMSFPIRNRTAESQAATAVLESRRLAKTKDQVMMAVESDVRNALQAATNSRARLS
HEECEEEECCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHH
AAIIASQSAEEQYLSEQRQFQAGTSSTFLVLQRQTDLITARNRETRAHADFAVSLANLDR
HHHHHCCCHHHHHHHHHHHHCCCCCCEEEEEEECCCEEEECCCCCCCHHHHEEEHHHHHH
ATAQTLDTRGIRFP
HHHHHHHCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 1909418; 11481432 [H]