The gene/protein map for NC_009079 is currently unavailable.
Definition Burkholderia mallei NCTC 10247 chromosome II, complete genome.
Accession NC_009079
Length 2,352,693

Click here to switch to the map view.

The map label for this gene is 126445992

Identifier: 126445992

GI number: 126445992

Start: 1711646

End: 1716946

Strand: Reverse

Name: 126445992

Synonym: BMA10247_A1776

Alternate gene names: NA

Gene position: 1716946-1711646 (Counterclockwise)

Preceding gene: 126446736

Following gene: 126447448

Centisome position: 72.98

GC content: 67.95

Gene sequence:

>5301_bases
GTGAATAAGATTTATCGCAAGGTTTGGAACAAGGCGCGCGGCCAACTGGTCGTCGCGTCGGAACTGGCATCCAGCCGTTC
CAGTGTGGGAGAAGCTTCGGTCGACGCGGGGCGATCTGGAGATCGGACAGCCTCGGCGGCATTCGCCAGCGAGGAGCGCA
ATCCCGGCTCAGGCCGGATGATTCCGCTTGCAATAGCCGTGGCTCTGATGTTTTCACCCTACGCATGGGCGGGTGTCGGC
GGAGCCGACAACGGCGTGACGGGGACGAGCAACAACGGCGGGGTAGGCGGATCGTCCGGCGGCGGCGGTGTCCAGTTCAG
CGACATGGGCGTGGCCTTTGTCGGCGATGGCGACTGCTCGATGCTCACGTCCGGGCCGGGATCGTATGCCGGCGTATACG
GTTCGGGGAGCAATTATCTGGGCGGCCTGTTCGGCTTCGGCGCACAGACGTCGGCCGTCGGCTGGGGGACGCCCAGCAAC
GCCGGCGCCAACAGCGGTATCGTCCCATACCAGGGCGCCGCTCAAACCTTCGGCAACGTCACCTATGCCGGCAACGGCAC
GCAGAGCGGCAACTTCACGCAGGCGTTCGGCCTGAATTCCTTTGCGGTCGGCTGCGGCGCTCACGCGACCGGCCTGAGCG
CGACGGCGATCGGCTGGGGAACCACCGCGAGCGGCGCCGGAAGCGTCGCGCTCGGGCTGTACAGCACCGCGAGCGGCCAG
GGATCGTTGGCGTTCGGCACCAGCGCGACGGCGACGGCCACCGACACCATCGCGCTCGGCACGCTGGCCACGGCCAACGC
GGTCAGCGGCGTGGCGATCGGCGCGAACACGCAGGCTTCGGCCGCCAATGCAACCGCGATCGGCGGCAATTCATCCGGCG
CCAACCTCGGCGCGCAGGCGACGGCGGCCGGCGCCACCGCGATCGGCGGCAACGCGACGGCCGGGGCCGCCGCGACGGCG
ACGAACGCCATCGCGATCGGCGGGCAGTCGTCGGCGAAGGATACGAACGATGTGGCCGTGGGCCTGGGCGCGAGGGCCGG
CACGGGAAGCGGCGCGGGCAACGATCTCGCGATCGGCAATGGCGCGACGGCCACGGGCGGCAATTCGATCGCCCAGGGCG
CGGGCGCGAGCGCCAATGCGGCCGGCGCGGTGGCCATCGGCAAATCGGCGTCCGCCGCCGGCGGGCAAGCCGTTTCGATC
GGCGTGGCCAATACCGCGTCGGGCAACGGCGCGGTGGCGATCGGCGATCCGAACGTCGCGACCGGAACCGGCGCTGTCGC
ACTGGGCAACAACAATACGGCCAATGGTCAAGGCGCGGTGGCGCTGGGCAATGTCAGCACGGCGGTCGGCCAAGGCAGCG
TGGCGCTCGGCAACAGCAGCAATGCGGCCGCGGCGGGCGGAGTGGCCTTGGGCGATACCGCGAGCGCGGTGATGGCGGGC
GGCTTGGCACTCGGCTCGCTCGCGACGGCGAGCAATGCGAACGACGTGGCGCTCGGCGCGGGTTCGAAAACCGCCGCGGC
AGTCGCGACGTCCACGGTTTCGGTGAACGGCGCGAACTACGCGGTGGCGGGAAGCGGCCCGGCCAGCACGGTCAGCGTGG
GTGCGCCGGGCAGCGAGCGCACGATCACCAATGTGGCCGCGGGTCAAGTAAGCGCCGGTTCCACCGATGCGGTGAATGGT
TCGGAACTGTACGCGACGAACCAGGCAATCACGACCGGATTGTCGACAGCGAACAGCAGCATCGCGTCGCTGTCCACGTC
GACGTCGACGGGTCTTTCGAGCGCCAACAGCAACATCGGCTCGTTGTCGACGGGTTTGTCGACCGCCAACAGCACGGTTG
CGTCGTTGTCGAGTTCCACGTCGACGGGGCTGTCCTCAGCCAATAGCGCGGTGGCGTCACTGTCCACGTCGACGTCGACG
GGTCTTTCGAGCGCCAACAGCAACATCGGCTCGTTGTCGACAGGTTTGTCGACCGCCAACAGCACGGTTGCGTCGTTGTC
GACGTCCACGGTTGCCGGCCTGAATTCGCTGTCCACCGGATTGAGCACGACCAATAGCAATGTCGCGTCGCTGTCGAGTT
CCACGTCGACGGGATTGTCCTCGGCCAATAGCGCGGTGGCGTCGCTGTCCACGTCGACGTCGACGGGTCTTTCGAGCGCC
AACAGCAACATCGGCTCGTTGTCGACGGGTTTGTCGACCACGAACAGCACGGTTGCGTCGTTGTCGAGCTCGACGTCGAC
CGGTATCGGTTCGTTGTCGACGGGGGTGGCCAATTCTGTCCAGTATGACAGTCCTGCTCATACGTCCATTACCCTGGGTG
GCGCCAGTGCAACGTCACCCGTGAAGATCACTAATTTGGCGGCGGGCGCGAACCCGAGCGATGCCGTCAACTATGAGCAA
CTGACATCGCTGTCGACGTCGGCGTCGACGGGGCTGTCGTCGGCCAACAGCGCGATCACGTCGCTATCCACCTCGACGTC
GACCGGCATCGGCTCGTTGTCCACCGGGTTGAGCACGACCAACAGCAACGTCGCGTCGTTGTCGACGTCGGCGTCGACGG
GACTGTCGTCGGCCAACAGCGCGATCACGTCGCTATCCACCTCGACGTCGACCGGCATCGGCTCGCTGTCCACCGGACTG
AGCACGACCAACAGCAACGTCGCATCGTTGTCGACGTCGGCGTCGACGGGACTGTCGTCGGCCAACAGCGCGATCACGTC
GCTGTCCACCTCGACGTCGACCGGCATCGGCTCGTTGTCCACCGGGTTGAGCACGACCAACAGCAACGTCGCATCGTTGT
CGACGTCGGCGTCGACGGGACTGTCGTCGGCCAACAGCGCGATCACGTCGCTGTCCACCTCGACGTCGACCGGCATCGGT
TCGCTGTCCACCGGGTTGAGCACGACCAACAGCAACGTCGCGTCGCTGTCGACGTCGGCGTCGACGGGACTGTCGTCGGC
CAACAGCGCGATCACATCGCTATCCACCTCGACGTCGACCGGCATCGGTTCGCTGTCCACCGGACTGAGCACGACCAACA
GCAACGTCGCGTCGCTGTCGACGTCGGCGTCGACGGGACTGTCGTCGGCCATCAGCGCGATCACGTCGCTGTCCACCTCG
ACGTCGACCGGCATCGGTTCGCTGTCCACCGGGTTGAGCACGACCAACAGCAACGTCGCGTCGCTGTCGACGTCGGCGTC
GACGGGACTGTCGTCGGCCAACAGCGCGATCACATCGCTATCCACCTCGACGTCGACCGGCATCGGTTCGCTGTCCACCG
GACTGAGCACGACCAACAGCAACGTCGCGTCGCTGTCGACGTCGGCGTCGACGGGACTGTCGTCGGCCATCAGCGCGATC
ACGTCGCTGTCCACCTCGACGTCGACCGGTATCGGCTCGCTGTCCACCGGGTTGAGCACGACCAACAGCAACGTCGCGTC
GTTGTCGACGTCGGCGTCGACGGGACTGTCGTCGGCCAACAGCGCGATCACGTCGCTGTCCACCTCGACGTCGACCGGCA
TCGGTTCGCTGTCCACCGGGCTGAGCACGACCAACAGCAACCTGAGCTCCCTGTCCACGTCGAGCTCGACCGGCCTGAGT
ACGGCCAACAGCAACATCTCGTCGCTGTCCACCGGGCTGAATTCGTTGTCGACCGCGGTCAACGGCGGCGGGACGAAGTA
CTTCCACGCCAACTCGACGCAGCCGGACAGTCAGGCGCTGGGGGCGGATTCCGTCGCGGTCGGGCCGGCGGCCATCGCGG
CGGGCGCAAGCGGCATTGCGATCGGCAATGCGGCGAACGCGGCCGCCAACGGCGCCGTCGCGATCGGCCAGGCCGCCGTC
GCGAAGGGCGGGCTGGCTGTCTCGATCGGGGTGTCGAACACGGCGAGCGGAGACGGCGCGGTGGCGATCGGCGATCCGAA
CGTCGCGACCGGCACCGGCGCGGTCGCGCTTGGCGCGGACAATTCGGCAAACGGCCAGGGCGCCGTCGCGCTCGGCAACG
CGAACATCGCAACCGGAACGGGCTCGCTTGCGTTCGGCAACACGTCGACGGCGGCAGCGGCGGGCGCGGTCGCGTTGGGC
GCCGGCGCAATCGCGAACAATGCGAACGATGTCGCGCTGGGTTCCGCTAGCGTGACCGCGGCTGCGAATCCGGTGGCCAG
CGCGTTGATCGCAGGTCAGGCTTATTCGCTTGCCGGCGGCGCGCCGGCGAGCGTGGTGAGCGTCGGCGCGCCCGGCGCCG
AACGGCAAATCACCAACGTCGCGGCCGGGCGGATTTCCGCCACGTCGACCGATGCGGTGAACGGCTCGCAGATGAATGCG
ATGACTCAGGCGCTGGAATCGCTGTCGACTTCGACGGCCAGCGCGCTGTCCACGGCGCAAAGCGGTCTGGGTTCGTTGTC
GACGGGGCTCAGCTCGACGCAGAGCAGCGTGAGTTCGCTGTCGACGGGGCTCAGCACGACGAGCGGCAATGTGGCGTCGC
TGTCGAGCGGTCTGGGCACGATGCAAAGCGGTATCGCGTCGCTGTCCACGGGGCTGAGCACGACGAACAGCAGCCTCGCG
TCGCTGTCGACCGCCGTGTCCGGCGGCGGTGTTCGCACCAGCAGCTTGGGCGACACGTCGGCGGGCAATGGCGCGAACGC
GTCCGGCGGCAACGGCACGGCGGTCGGCGGCGCCGCGTCCGCTTCGGGAACCGATGCGACCGCGCTGGGCCAGGCGTCGA
ACGCGTCGGGCAATCATTCGACCGCATTGGGGCAAGCATCGAGTGCGTCCGGAAGCGGCTCCACCGCGGTGGGACAAGGC
GCCGGCGCGCCCGGCGACGGCGCTTCGGCATTCGGCCAAGGGGCACTTGCCTCCGGTACGGACTCGACGGCGCTCGGCGC
TCATTCGACGGCTGCGGCGCCGAACTCGGCGGCGATCGGCGCGAATTCGGTGGCGTCCGCGCCGAATTCGGTGTCGTTCG
GTTCGCGGGGCCATGAGCGCAGGCTGACGAATGTCGCGCCGGGGATCGACGGCACCGACGCGGCGAACATGAACCAGCTC
TGGGGCGTGCAATCGAGCGTCGATCAGGCGGCGCGCCGCGCCTATTCCGGGGTGGCGGCCGCGACCGCGCTGACGATGAT
TCCGGAGGTCGACCCCGGCAAGACGATCGCGGTCGGGATCGGCGCGGGCAGCTATCAAGGGTATTCGGCGTCCGCGATCG
GCGTGTCCGTGCGGTTCTCCGACAACCTGAAGGCGAAGCTCGGCGTGGGGATCAGCGCTCAGGGCAGCACATATGGCGCA
GGCGTCTCGTACCAGTGGTAG

Upstream 100 bases:

>100_bases
CCACGCTTGCCGCACGGAGTGGCTGGCGCGGCTCCGTCCACGGAGGTGCGACGTCGAATCCTGGTGCAGCACTGCTTGGG
TAGGTGAGACGGAGGGTGTC

Downstream 100 bases:

>100_bases
CGCGGTGGCGAGCGCACCGGACGAGGAGCGCATCGTCGCTCCTCGTCCGGGCGGCGACGTATCTCCGGACGGCGAGGCAT
CGAATGAATCGGGCGGCGAT

Product: surface-exposed protein

Products: NA

Alternate protein names: Membrane-Anchored Cell Surface Protein; Hemagglutinin Family Protein; Hemagluttinin Domain-Containing Protein; Outer Membrane Protein; Haemagluttinin Family Protein; YadA Domain Protein; Haemagglutinin Family Protein; Haemagglutinin-Related Autotransporter Protein; Surface-Exposed Protein; Hep_Hag Family; Hemagglutinin Domain-Containing Protein; Hep_Hag Family Protein; Autotransporter Adhesin; Hemagluttinin Motif-Containing Protein; Surface Protein; Surface-Exposed Adhesin Protein; YadA-Like C-Terminal Region Protein; Haemagluttinin Domain Protein; Haemagglutinin; Membrane-Anchored Cell Surface Protein Haemagluttinin; Hemagglutinin; Haemagglutinin And Invasin Like Cell Surface Protein; Intracellular Motility Protein A; Outer Membrane Pathogenesis Protein; Hemagglutinin-Related Protein; YadA-Like C-Terminal Domain-Containing; Hemagluttinin Family Protein; YadA/Haemagluttinin Like Protein; Hemaglutinin/Autotransporter Like Protein; Hemagluttinin Like Protein; YadA-Like Protein; Outer Membrane Protein Haemagluttinin-Like

Number of amino acids: Translated: 1766; Mature: 1766

Protein sequence:

>1766_residues
MNKIYRKVWNKARGQLVVASELASSRSSVGEASVDAGRSGDRTASAAFASEERNPGSGRMIPLAIAVALMFSPYAWAGVG
GADNGVTGTSNNGGVGGSSGGGGVQFSDMGVAFVGDGDCSMLTSGPGSYAGVYGSGSNYLGGLFGFGAQTSAVGWGTPSN
AGANSGIVPYQGAAQTFGNVTYAGNGTQSGNFTQAFGLNSFAVGCGAHATGLSATAIGWGTTASGAGSVALGLYSTASGQ
GSLAFGTSATATATDTIALGTLATANAVSGVAIGANTQASAANATAIGGNSSGANLGAQATAAGATAIGGNATAGAAATA
TNAIAIGGQSSAKDTNDVAVGLGARAGTGSGAGNDLAIGNGATATGGNSIAQGAGASANAAGAVAIGKSASAAGGQAVSI
GVANTASGNGAVAIGDPNVATGTGAVALGNNNTANGQGAVALGNVSTAVGQGSVALGNSSNAAAAGGVALGDTASAVMAG
GLALGSLATASNANDVALGAGSKTAAAVATSTVSVNGANYAVAGSGPASTVSVGAPGSERTITNVAAGQVSAGSTDAVNG
SELYATNQAITTGLSTANSSIASLSTSTSTGLSSANSNIGSLSTGLSTANSTVASLSSSTSTGLSSANSAVASLSTSTST
GLSSANSNIGSLSTGLSTANSTVASLSTSTVAGLNSLSTGLSTTNSNVASLSSSTSTGLSSANSAVASLSTSTSTGLSSA
NSNIGSLSTGLSTTNSTVASLSSSTSTGIGSLSTGVANSVQYDSPAHTSITLGGASATSPVKITNLAAGANPSDAVNYEQ
LTSLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGL
STTNSNVASLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSSANSAITSLSTSTSTGIG
SLSTGLSTTNSNVASLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSSAISAITSLSTS
TSTGIGSLSTGLSTTNSNVASLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSSAISAI
TSLSTSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTTNSNLSSLSTSSSTGLS
TANSNISSLSTGLNSLSTAVNGGGTKYFHANSTQPDSQALGADSVAVGPAAIAAGASGIAIGNAANAAANGAVAIGQAAV
AKGGLAVSIGVSNTASGDGAVAIGDPNVATGTGAVALGADNSANGQGAVALGNANIATGTGSLAFGNTSTAAAAGAVALG
AGAIANNANDVALGSASVTAAANPVASALIAGQAYSLAGGAPASVVSVGAPGAERQITNVAAGRISATSTDAVNGSQMNA
MTQALESLSTSTASALSTAQSGLGSLSTGLSSTQSSVSSLSTGLSTTSGNVASLSSGLGTMQSGIASLSTGLSTTNSSLA
SLSTAVSGGGVRTSSLGDTSAGNGANASGGNGTAVGGAASASGTDATALGQASNASGNHSTALGQASSASGSGSTAVGQG
AGAPGDGASAFGQGALASGTDSTALGAHSTAAAPNSAAIGANSVASAPNSVSFGSRGHERRLTNVAPGIDGTDAANMNQL
WGVQSSVDQAARRAYSGVAAATALTMIPEVDPGKTIAVGIGAGSYQGYSASAIGVSVRFSDNLKAKLGVGISAQGSTYGA
GVSYQW

Sequences:

>Translated_1766_residues
MNKIYRKVWNKARGQLVVASELASSRSSVGEASVDAGRSGDRTASAAFASEERNPGSGRMIPLAIAVALMFSPYAWAGVG
GADNGVTGTSNNGGVGGSSGGGGVQFSDMGVAFVGDGDCSMLTSGPGSYAGVYGSGSNYLGGLFGFGAQTSAVGWGTPSN
AGANSGIVPYQGAAQTFGNVTYAGNGTQSGNFTQAFGLNSFAVGCGAHATGLSATAIGWGTTASGAGSVALGLYSTASGQ
GSLAFGTSATATATDTIALGTLATANAVSGVAIGANTQASAANATAIGGNSSGANLGAQATAAGATAIGGNATAGAAATA
TNAIAIGGQSSAKDTNDVAVGLGARAGTGSGAGNDLAIGNGATATGGNSIAQGAGASANAAGAVAIGKSASAAGGQAVSI
GVANTASGNGAVAIGDPNVATGTGAVALGNNNTANGQGAVALGNVSTAVGQGSVALGNSSNAAAAGGVALGDTASAVMAG
GLALGSLATASNANDVALGAGSKTAAAVATSTVSVNGANYAVAGSGPASTVSVGAPGSERTITNVAAGQVSAGSTDAVNG
SELYATNQAITTGLSTANSSIASLSTSTSTGLSSANSNIGSLSTGLSTANSTVASLSSSTSTGLSSANSAVASLSTSTST
GLSSANSNIGSLSTGLSTANSTVASLSTSTVAGLNSLSTGLSTTNSNVASLSSSTSTGLSSANSAVASLSTSTSTGLSSA
NSNIGSLSTGLSTTNSTVASLSSSTSTGIGSLSTGVANSVQYDSPAHTSITLGGASATSPVKITNLAAGANPSDAVNYEQ
LTSLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGL
STTNSNVASLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSSANSAITSLSTSTSTGIG
SLSTGLSTTNSNVASLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSSAISAITSLSTS
TSTGIGSLSTGLSTTNSNVASLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSSAISAI
TSLSTSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTTNSNLSSLSTSSSTGLS
TANSNISSLSTGLNSLSTAVNGGGTKYFHANSTQPDSQALGADSVAVGPAAIAAGASGIAIGNAANAAANGAVAIGQAAV
AKGGLAVSIGVSNTASGDGAVAIGDPNVATGTGAVALGADNSANGQGAVALGNANIATGTGSLAFGNTSTAAAAGAVALG
AGAIANNANDVALGSASVTAAANPVASALIAGQAYSLAGGAPASVVSVGAPGAERQITNVAAGRISATSTDAVNGSQMNA
MTQALESLSTSTASALSTAQSGLGSLSTGLSSTQSSVSSLSTGLSTTSGNVASLSSGLGTMQSGIASLSTGLSTTNSSLA
SLSTAVSGGGVRTSSLGDTSAGNGANASGGNGTAVGGAASASGTDATALGQASNASGNHSTALGQASSASGSGSTAVGQG
AGAPGDGASAFGQGALASGTDSTALGAHSTAAAPNSAAIGANSVASAPNSVSFGSRGHERRLTNVAPGIDGTDAANMNQL
WGVQSSVDQAARRAYSGVAAATALTMIPEVDPGKTIAVGIGAGSYQGYSASAIGVSVRFSDNLKAKLGVGISAQGSTYGA
GVSYQW
>Mature_1766_residues
MNKIYRKVWNKARGQLVVASELASSRSSVGEASVDAGRSGDRTASAAFASEERNPGSGRMIPLAIAVALMFSPYAWAGVG
GADNGVTGTSNNGGVGGSSGGGGVQFSDMGVAFVGDGDCSMLTSGPGSYAGVYGSGSNYLGGLFGFGAQTSAVGWGTPSN
AGANSGIVPYQGAAQTFGNVTYAGNGTQSGNFTQAFGLNSFAVGCGAHATGLSATAIGWGTTASGAGSVALGLYSTASGQ
GSLAFGTSATATATDTIALGTLATANAVSGVAIGANTQASAANATAIGGNSSGANLGAQATAAGATAIGGNATAGAAATA
TNAIAIGGQSSAKDTNDVAVGLGARAGTGSGAGNDLAIGNGATATGGNSIAQGAGASANAAGAVAIGKSASAAGGQAVSI
GVANTASGNGAVAIGDPNVATGTGAVALGNNNTANGQGAVALGNVSTAVGQGSVALGNSSNAAAAGGVALGDTASAVMAG
GLALGSLATASNANDVALGAGSKTAAAVATSTVSVNGANYAVAGSGPASTVSVGAPGSERTITNVAAGQVSAGSTDAVNG
SELYATNQAITTGLSTANSSIASLSTSTSTGLSSANSNIGSLSTGLSTANSTVASLSSSTSTGLSSANSAVASLSTSTST
GLSSANSNIGSLSTGLSTANSTVASLSTSTVAGLNSLSTGLSTTNSNVASLSSSTSTGLSSANSAVASLSTSTSTGLSSA
NSNIGSLSTGLSTTNSTVASLSSSTSTGIGSLSTGVANSVQYDSPAHTSITLGGASATSPVKITNLAAGANPSDAVNYEQ
LTSLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGL
STTNSNVASLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSSANSAITSLSTSTSTGIG
SLSTGLSTTNSNVASLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSSAISAITSLSTS
TSTGIGSLSTGLSTTNSNVASLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSSAISAI
TSLSTSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTTNSNLSSLSTSSSTGLS
TANSNISSLSTGLNSLSTAVNGGGTKYFHANSTQPDSQALGADSVAVGPAAIAAGASGIAIGNAANAAANGAVAIGQAAV
AKGGLAVSIGVSNTASGDGAVAIGDPNVATGTGAVALGADNSANGQGAVALGNANIATGTGSLAFGNTSTAAAAGAVALG
AGAIANNANDVALGSASVTAAANPVASALIAGQAYSLAGGAPASVVSVGAPGAERQITNVAAGRISATSTDAVNGSQMNA
MTQALESLSTSTASALSTAQSGLGSLSTGLSSTQSSVSSLSTGLSTTSGNVASLSSGLGTMQSGIASLSTGLSTTNSSLA
SLSTAVSGGGVRTSSLGDTSAGNGANASGGNGTAVGGAASASGTDATALGQASNASGNHSTALGQASSASGSGSTAVGQG
AGAPGDGASAFGQGALASGTDSTALGAHSTAAAPNSAAIGANSVASAPNSVSFGSRGHERRLTNVAPGIDGTDAANMNQL
WGVQSSVDQAARRAYSGVAAATALTMIPEVDPGKTIAVGIGAGSYQGYSASAIGVSVRFSDNLKAKLGVGISAQGSTYGA
GVSYQW

Specific function: Unknown

COG id: COG5295

COG function: function code UW; Autotransporter adhesin

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

Organism=Drosophila melanogaster, GI221472639, Length=760, Percent_Identity=20.9210526315789, Blast_Score=81, Evalue=7e-15,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 162755; Mature: 162755

Theoretical pI: Translated: 4.67; Mature: 4.67

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.1 %Cys     (Translated Protein)
0.6 %Met     (Translated Protein)
0.7 %Cys+Met (Translated Protein)
0.1 %Cys     (Mature Protein)
0.6 %Met     (Mature Protein)
0.7 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MNKIYRKVWNKARGQLVVASELASSRSSVGEASVDAGRSGDRTASAAFASEERNPGSGRM
CCHHHHHHHHHHCCCEEEHHHHHHHHHHCCCHHHCCCCCCCCHHHHHHHHCCCCCCCCCC
IPLAIAVALMFSPYAWAGVGGADNGVTGTSNNGGVGGSSGGGGVQFSDMGVAFVGDGDCS
HHHHHHHHHHHCCCCEECCCCCCCCCCCCCCCCCCCCCCCCCCEEEECCCEEEEECCCCE
MLTSGPGSYAGVYGSGSNYLGGLFGFGAQTSAVGWGTPSNAGANSGIVPYQGAAQTFGNV
EEECCCCCCEEEECCCCCCCCHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHCCE
TYAGNGTQSGNFTQAFGLNSFAVGCGAHATGLSATAIGWGTTASGAGSVALGLYSTASGQ
EEECCCCCCCCEEEECCCCCEEECCCCCCCCCEEEEECCCCCCCCCCCEEEEEEEECCCC
GSLAFGTSATATATDTIALGTLATANAVSGVAIGANTQASAANATAIGGNSSGANLGAQA
CCEEECCCCCCCCCCEEEEHHHHHHHCCCCEEECCCCCCCCCCEEEECCCCCCCCCCCCH
TAAGATAIGGNATAGAAATATNAIAIGGQSSAKDTNDVAVGLGARAGTGSGAGNDLAIGN
HCCCCEECCCCCCCCCHHHCCCEEEECCCCCCCCCCCEEEECCCCCCCCCCCCCCEEECC
GATATGGNSIAQGAGASANAAGAVAIGKSASAAGGQAVSIGVANTASGNGAVAIGDPNVA
CCCCCCCCHHHCCCCCCCCCCCEEEECCCCCCCCCCEEEEEEEECCCCCCEEEECCCCCC
TGTGAVALGNNNTANGQGAVALGNVSTAVGQGSVALGNSSNAAAAGGVALGDTASAVMAG
CCCCEEEECCCCCCCCCCEEEECCCHHHCCCCCEEECCCCCCCCCCCEEECCHHHHHHHC
GLALGSLATASNANDVALGAGSKTAAAVATSTVSVNGANYAVAGSGPASTVSVGAPGSER
CHHHHHHHCCCCCCCEEEECCCCCCEEEEEEEEEECCCCEEEECCCCCCEEEECCCCCCC
TITNVAAGQVSAGSTDAVNGSELYATNQAITTGLSTANSSIASLSTSTSTGLSSANSNIG
EEEEEECCCCCCCCCCCCCCCEEEECCHHHHHCCHHCCCCHHEECCCCCCCCCCCCCCCC
SLSTGLSTANSTVASLSSSTSTGLSSANSAVASLSTSTSTGLSSANSNIGSLSTGLSTAN
CHHCCCCHHHHHHHHHCCCCCCCCCHHCHHHHEECCCCCCCCCCCCCCCCCHHCCCCCCC
STVASLSTSTVAGLNSLSTGLSTTNSNVASLSSSTSTGLSSANSAVASLSTSTSTGLSSA
CHHHHHHHHHHHHHHHHHCCCCCCCCCHHHCCCCCCCCCCHHCHHHHEECCCCCCCCCCC
NSNIGSLSTGLSTTNSTVASLSSSTSTGIGSLSTGVANSVQYDSPAHTSITLGGASATSP
CCCCCCHHCCCCCCCHHHHHHCCCCCCCCCCHHHCCCCCCCCCCCCCCEEEECCCCCCCC
VKITNLAAGANPSDAVNYEQLTSLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTT
EEEEEEECCCCCCCCCCHHHHHHCCCHHHCCCCHHHHHHHCCCCCCCCCCCCHHCCCCCC
NSNVASLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSS
CCCCEEECCCHHCCCCHHHHHHHCCCCCCCCCCCCHHCCCCCCCCCCEEECCCHHCCCCH
ANSAITSLSTSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSSANSAITSLSTSTSTGIG
HHHHHHCCCCCCCCCCCCHHCCCCCCCCCCEEECCCHHCCCCHHHHHHHCCCCCCCCCCC
SLSTGLSTTNSNVASLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTTNSNVASLS
CHHCCCCCCCCCCEEECCCHHCCCCHHHHHHHCCCCCCCCCCCCHHCCCCCCCCCCEEEC
TSASTGLSSAISAITSLSTSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSSANSAITSL
CCHHHHHHHHHHHHHHCCCCCCCCCCCHHCCCCCCCCCCEEECCCHHCCCCHHHHHHHCC
STSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSSAISAITSLSTSTSTGIGSLSTGLST
CCCCCCCCCCHHCCCCCCCCCCEEECCCHHHHHHHHHHHHHHCCCCCCCCCCCHHCCCCC
TNSNVASLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTTNSNLSSLSTSSSTGLS
CCCCCEEECCCHHCCCCHHHHHHHCCCCCCCCCCCCHHCCCCCCCCCHHHCCCCCCCCCC
TANSNISSLSTGLNSLSTAVNGGGTKYFHANSTQPDSQALGADSVAVGPAAIAAGASGIA
CCCCCHHHHHHHHHHHHHHHCCCCEEEEECCCCCCHHHHCCCCCCCCCHHHHHCCCCCEE
IGNAANAAANGAVAIGQAAVAKGGLAVSIGVSNTASGDGAVAIGDPNVATGTGAVALGAD
ECCCCCCCCCCCEEECHHHHHCCCEEEEEECCCCCCCCCEEEECCCCCCCCCCEEEECCC
NSANGQGAVALGNANIATGTGSLAFGNTSTAAAAGAVALGAGAIANNANDVALGSASVTA
CCCCCCCEEEECCCEEECCCCCEEECCCCHHHHHHHHHHCCCHHCCCCCCEEECCCCEEH
AANPVASALIAGQAYSLAGGAPASVVSVGAPGAERQITNVAAGRISATSTDAVNGSQMNA
HCCHHHHHHHHCCCEECCCCCCCCEEEECCCCCHHHHHHHHCCCEECCCCCCCCCHHHHH
MTQALESLSTSTASALSTAQSGLGSLSTGLSSTQSSVSSLSTGLSTTSGNVASLSSGLGT
HHHHHHHHHHHHHHHHHHHHHCCHHHHHCHHHHHHHHHHHHHCCCCCCCCHHHHHHCHHH
MQSGIASLSTGLSTTNSSLASLSTAVSGGGVRTSSLGDTSAGNGANASGGNGTAVGGAAS
HHHHHHHHHCCCCCCCHHHHHHHHHHCCCCEEECCCCCCCCCCCCCCCCCCCCEECCCCC
ASGTDATALGQASNASGNHSTALGQASSASGSGSTAVGQGAGAPGDGASAFGQGALASGT
CCCCCCHHCCCCCCCCCCCCHHCCCCCCCCCCCCCCCCCCCCCCCCCHHHHCCCCCCCCC
DSTALGAHSTAAAPNSAAIGANSVASAPNSVSFGSRGHERRLTNVAPGIDGTDAANMNQL
CCCCCCCCCCCCCCCCCCCCCCHHHCCCCCCCCCCCCCHHHHHHCCCCCCCCCCCCHHHH
WGVQSSVDQAARRAYSGVAAATALTMIPEVDPGKTIAVGIGAGSYQGYSASAIGVSVRFS
HCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCEEEEEECCCCCCCCCCEEEEEEEEEC
DNLKAKLGVGISAQGSTYGAGVSYQW
CCCCEEECCCEECCCCCCCCCCEECC
>Mature Secondary Structure
MNKIYRKVWNKARGQLVVASELASSRSSVGEASVDAGRSGDRTASAAFASEERNPGSGRM
CCHHHHHHHHHHCCCEEEHHHHHHHHHHCCCHHHCCCCCCCCHHHHHHHHCCCCCCCCCC
IPLAIAVALMFSPYAWAGVGGADNGVTGTSNNGGVGGSSGGGGVQFSDMGVAFVGDGDCS
HHHHHHHHHHHCCCCEECCCCCCCCCCCCCCCCCCCCCCCCCCEEEECCCEEEEECCCCE
MLTSGPGSYAGVYGSGSNYLGGLFGFGAQTSAVGWGTPSNAGANSGIVPYQGAAQTFGNV
EEECCCCCCEEEECCCCCCCCHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHCCE
TYAGNGTQSGNFTQAFGLNSFAVGCGAHATGLSATAIGWGTTASGAGSVALGLYSTASGQ
EEECCCCCCCCEEEECCCCCEEECCCCCCCCCEEEEECCCCCCCCCCCEEEEEEEECCCC
GSLAFGTSATATATDTIALGTLATANAVSGVAIGANTQASAANATAIGGNSSGANLGAQA
CCEEECCCCCCCCCCEEEEHHHHHHHCCCCEEECCCCCCCCCCEEEECCCCCCCCCCCCH
TAAGATAIGGNATAGAAATATNAIAIGGQSSAKDTNDVAVGLGARAGTGSGAGNDLAIGN
HCCCCEECCCCCCCCCHHHCCCEEEECCCCCCCCCCCEEEECCCCCCCCCCCCCCEEECC
GATATGGNSIAQGAGASANAAGAVAIGKSASAAGGQAVSIGVANTASGNGAVAIGDPNVA
CCCCCCCCHHHCCCCCCCCCCCEEEECCCCCCCCCCEEEEEEEECCCCCCEEEECCCCCC
TGTGAVALGNNNTANGQGAVALGNVSTAVGQGSVALGNSSNAAAAGGVALGDTASAVMAG
CCCCEEEECCCCCCCCCCEEEECCCHHHCCCCCEEECCCCCCCCCCCEEECCHHHHHHHC
GLALGSLATASNANDVALGAGSKTAAAVATSTVSVNGANYAVAGSGPASTVSVGAPGSER
CHHHHHHHCCCCCCCEEEECCCCCCEEEEEEEEEECCCCEEEECCCCCCEEEECCCCCCC
TITNVAAGQVSAGSTDAVNGSELYATNQAITTGLSTANSSIASLSTSTSTGLSSANSNIG
EEEEEECCCCCCCCCCCCCCCEEEECCHHHHHCCHHCCCCHHEECCCCCCCCCCCCCCCC
SLSTGLSTANSTVASLSSSTSTGLSSANSAVASLSTSTSTGLSSANSNIGSLSTGLSTAN
CHHCCCCHHHHHHHHHCCCCCCCCCHHCHHHHEECCCCCCCCCCCCCCCCCHHCCCCCCC
STVASLSTSTVAGLNSLSTGLSTTNSNVASLSSSTSTGLSSANSAVASLSTSTSTGLSSA
CHHHHHHHHHHHHHHHHHCCCCCCCCCHHHCCCCCCCCCCHHCHHHHEECCCCCCCCCCC
NSNIGSLSTGLSTTNSTVASLSSSTSTGIGSLSTGVANSVQYDSPAHTSITLGGASATSP
CCCCCCHHCCCCCCCHHHHHHCCCCCCCCCCHHHCCCCCCCCCCCCCCEEEECCCCCCCC
VKITNLAAGANPSDAVNYEQLTSLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTT
EEEEEEECCCCCCCCCCHHHHHHCCCHHHCCCCHHHHHHHCCCCCCCCCCCCHHCCCCCC
NSNVASLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSS
CCCCEEECCCHHCCCCHHHHHHHCCCCCCCCCCCCHHCCCCCCCCCCEEECCCHHCCCCH
ANSAITSLSTSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSSANSAITSLSTSTSTGIG
HHHHHHCCCCCCCCCCCCHHCCCCCCCCCCEEECCCHHCCCCHHHHHHHCCCCCCCCCCC
SLSTGLSTTNSNVASLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTTNSNVASLS
CHHCCCCCCCCCCEEECCCHHCCCCHHHHHHHCCCCCCCCCCCCHHCCCCCCCCCCEEEC
TSASTGLSSAISAITSLSTSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSSANSAITSL
CCHHHHHHHHHHHHHHCCCCCCCCCCCHHCCCCCCCCCCEEECCCHHCCCCHHHHHHHCC
STSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSSAISAITSLSTSTSTGIGSLSTGLST
CCCCCCCCCCHHCCCCCCCCCCEEECCCHHHHHHHHHHHHHHCCCCCCCCCCCHHCCCCC
TNSNVASLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTTNSNLSSLSTSSSTGLS
CCCCCEEECCCHHCCCCHHHHHHHCCCCCCCCCCCCHHCCCCCCCCCHHHCCCCCCCCCC
TANSNISSLSTGLNSLSTAVNGGGTKYFHANSTQPDSQALGADSVAVGPAAIAAGASGIA
CCCCCHHHHHHHHHHHHHHHCCCCEEEEECCCCCCHHHHCCCCCCCCCHHHHHCCCCCEE
IGNAANAAANGAVAIGQAAVAKGGLAVSIGVSNTASGDGAVAIGDPNVATGTGAVALGAD
ECCCCCCCCCCCEEECHHHHHCCCEEEEEECCCCCCCCCEEEECCCCCCCCCCEEEECCC
NSANGQGAVALGNANIATGTGSLAFGNTSTAAAAGAVALGAGAIANNANDVALGSASVTA
CCCCCCCEEEECCCEEECCCCCEEECCCCHHHHHHHHHHCCCHHCCCCCCEEECCCCEEH
AANPVASALIAGQAYSLAGGAPASVVSVGAPGAERQITNVAAGRISATSTDAVNGSQMNA
HCCHHHHHHHHCCCEECCCCCCCCEEEECCCCCHHHHHHHHCCCEECCCCCCCCCHHHHH
MTQALESLSTSTASALSTAQSGLGSLSTGLSSTQSSVSSLSTGLSTTSGNVASLSSGLGT
HHHHHHHHHHHHHHHHHHHHHCCHHHHHCHHHHHHHHHHHHHCCCCCCCCHHHHHHCHHH
MQSGIASLSTGLSTTNSSLASLSTAVSGGGVRTSSLGDTSAGNGANASGGNGTAVGGAAS
HHHHHHHHHCCCCCCCHHHHHHHHHHCCCCEEECCCCCCCCCCCCCCCCCCCCEECCCCC
ASGTDATALGQASNASGNHSTALGQASSASGSGSTAVGQGAGAPGDGASAFGQGALASGT
CCCCCCHHCCCCCCCCCCCCHHCCCCCCCCCCCCCCCCCCCCCCCCCHHHHCCCCCCCCC
DSTALGAHSTAAAPNSAAIGANSVASAPNSVSFGSRGHERRLTNVAPGIDGTDAANMNQL
CCCCCCCCCCCCCCCCCCCCCCHHHCCCCCCCCCCCCCHHHHHHCCCCCCCCCCCCHHHH
WGVQSSVDQAARRAYSGVAAATALTMIPEVDPGKTIAVGIGAGSYQGYSASAIGVSVRFS
HCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCEEEEEECCCCCCCCCCEEEEEEEEEC
DNLKAKLGVGISAQGSTYGAGVSYQW
CCCCEEECCCEECCCCCCCCCCEECC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA