| Definition | Burkholderia mallei NCTC 10247 chromosome II, complete genome. |
|---|---|
| Accession | NC_009079 |
| Length | 2,352,693 |
Click here to switch to the map view.
The map label for this gene is 126445992
Identifier: 126445992
GI number: 126445992
Start: 1711646
End: 1716946
Strand: Reverse
Name: 126445992
Synonym: BMA10247_A1776
Alternate gene names: NA
Gene position: 1716946-1711646 (Counterclockwise)
Preceding gene: 126446736
Following gene: 126447448
Centisome position: 72.98
GC content: 67.95
Gene sequence:
>5301_bases GTGAATAAGATTTATCGCAAGGTTTGGAACAAGGCGCGCGGCCAACTGGTCGTCGCGTCGGAACTGGCATCCAGCCGTTC CAGTGTGGGAGAAGCTTCGGTCGACGCGGGGCGATCTGGAGATCGGACAGCCTCGGCGGCATTCGCCAGCGAGGAGCGCA ATCCCGGCTCAGGCCGGATGATTCCGCTTGCAATAGCCGTGGCTCTGATGTTTTCACCCTACGCATGGGCGGGTGTCGGC GGAGCCGACAACGGCGTGACGGGGACGAGCAACAACGGCGGGGTAGGCGGATCGTCCGGCGGCGGCGGTGTCCAGTTCAG CGACATGGGCGTGGCCTTTGTCGGCGATGGCGACTGCTCGATGCTCACGTCCGGGCCGGGATCGTATGCCGGCGTATACG GTTCGGGGAGCAATTATCTGGGCGGCCTGTTCGGCTTCGGCGCACAGACGTCGGCCGTCGGCTGGGGGACGCCCAGCAAC GCCGGCGCCAACAGCGGTATCGTCCCATACCAGGGCGCCGCTCAAACCTTCGGCAACGTCACCTATGCCGGCAACGGCAC GCAGAGCGGCAACTTCACGCAGGCGTTCGGCCTGAATTCCTTTGCGGTCGGCTGCGGCGCTCACGCGACCGGCCTGAGCG CGACGGCGATCGGCTGGGGAACCACCGCGAGCGGCGCCGGAAGCGTCGCGCTCGGGCTGTACAGCACCGCGAGCGGCCAG GGATCGTTGGCGTTCGGCACCAGCGCGACGGCGACGGCCACCGACACCATCGCGCTCGGCACGCTGGCCACGGCCAACGC GGTCAGCGGCGTGGCGATCGGCGCGAACACGCAGGCTTCGGCCGCCAATGCAACCGCGATCGGCGGCAATTCATCCGGCG CCAACCTCGGCGCGCAGGCGACGGCGGCCGGCGCCACCGCGATCGGCGGCAACGCGACGGCCGGGGCCGCCGCGACGGCG ACGAACGCCATCGCGATCGGCGGGCAGTCGTCGGCGAAGGATACGAACGATGTGGCCGTGGGCCTGGGCGCGAGGGCCGG CACGGGAAGCGGCGCGGGCAACGATCTCGCGATCGGCAATGGCGCGACGGCCACGGGCGGCAATTCGATCGCCCAGGGCG CGGGCGCGAGCGCCAATGCGGCCGGCGCGGTGGCCATCGGCAAATCGGCGTCCGCCGCCGGCGGGCAAGCCGTTTCGATC GGCGTGGCCAATACCGCGTCGGGCAACGGCGCGGTGGCGATCGGCGATCCGAACGTCGCGACCGGAACCGGCGCTGTCGC ACTGGGCAACAACAATACGGCCAATGGTCAAGGCGCGGTGGCGCTGGGCAATGTCAGCACGGCGGTCGGCCAAGGCAGCG TGGCGCTCGGCAACAGCAGCAATGCGGCCGCGGCGGGCGGAGTGGCCTTGGGCGATACCGCGAGCGCGGTGATGGCGGGC GGCTTGGCACTCGGCTCGCTCGCGACGGCGAGCAATGCGAACGACGTGGCGCTCGGCGCGGGTTCGAAAACCGCCGCGGC AGTCGCGACGTCCACGGTTTCGGTGAACGGCGCGAACTACGCGGTGGCGGGAAGCGGCCCGGCCAGCACGGTCAGCGTGG GTGCGCCGGGCAGCGAGCGCACGATCACCAATGTGGCCGCGGGTCAAGTAAGCGCCGGTTCCACCGATGCGGTGAATGGT TCGGAACTGTACGCGACGAACCAGGCAATCACGACCGGATTGTCGACAGCGAACAGCAGCATCGCGTCGCTGTCCACGTC GACGTCGACGGGTCTTTCGAGCGCCAACAGCAACATCGGCTCGTTGTCGACGGGTTTGTCGACCGCCAACAGCACGGTTG CGTCGTTGTCGAGTTCCACGTCGACGGGGCTGTCCTCAGCCAATAGCGCGGTGGCGTCACTGTCCACGTCGACGTCGACG GGTCTTTCGAGCGCCAACAGCAACATCGGCTCGTTGTCGACAGGTTTGTCGACCGCCAACAGCACGGTTGCGTCGTTGTC GACGTCCACGGTTGCCGGCCTGAATTCGCTGTCCACCGGATTGAGCACGACCAATAGCAATGTCGCGTCGCTGTCGAGTT CCACGTCGACGGGATTGTCCTCGGCCAATAGCGCGGTGGCGTCGCTGTCCACGTCGACGTCGACGGGTCTTTCGAGCGCC AACAGCAACATCGGCTCGTTGTCGACGGGTTTGTCGACCACGAACAGCACGGTTGCGTCGTTGTCGAGCTCGACGTCGAC CGGTATCGGTTCGTTGTCGACGGGGGTGGCCAATTCTGTCCAGTATGACAGTCCTGCTCATACGTCCATTACCCTGGGTG GCGCCAGTGCAACGTCACCCGTGAAGATCACTAATTTGGCGGCGGGCGCGAACCCGAGCGATGCCGTCAACTATGAGCAA CTGACATCGCTGTCGACGTCGGCGTCGACGGGGCTGTCGTCGGCCAACAGCGCGATCACGTCGCTATCCACCTCGACGTC GACCGGCATCGGCTCGTTGTCCACCGGGTTGAGCACGACCAACAGCAACGTCGCGTCGTTGTCGACGTCGGCGTCGACGG GACTGTCGTCGGCCAACAGCGCGATCACGTCGCTATCCACCTCGACGTCGACCGGCATCGGCTCGCTGTCCACCGGACTG AGCACGACCAACAGCAACGTCGCATCGTTGTCGACGTCGGCGTCGACGGGACTGTCGTCGGCCAACAGCGCGATCACGTC GCTGTCCACCTCGACGTCGACCGGCATCGGCTCGTTGTCCACCGGGTTGAGCACGACCAACAGCAACGTCGCATCGTTGT CGACGTCGGCGTCGACGGGACTGTCGTCGGCCAACAGCGCGATCACGTCGCTGTCCACCTCGACGTCGACCGGCATCGGT TCGCTGTCCACCGGGTTGAGCACGACCAACAGCAACGTCGCGTCGCTGTCGACGTCGGCGTCGACGGGACTGTCGTCGGC CAACAGCGCGATCACATCGCTATCCACCTCGACGTCGACCGGCATCGGTTCGCTGTCCACCGGACTGAGCACGACCAACA GCAACGTCGCGTCGCTGTCGACGTCGGCGTCGACGGGACTGTCGTCGGCCATCAGCGCGATCACGTCGCTGTCCACCTCG ACGTCGACCGGCATCGGTTCGCTGTCCACCGGGTTGAGCACGACCAACAGCAACGTCGCGTCGCTGTCGACGTCGGCGTC GACGGGACTGTCGTCGGCCAACAGCGCGATCACATCGCTATCCACCTCGACGTCGACCGGCATCGGTTCGCTGTCCACCG GACTGAGCACGACCAACAGCAACGTCGCGTCGCTGTCGACGTCGGCGTCGACGGGACTGTCGTCGGCCATCAGCGCGATC ACGTCGCTGTCCACCTCGACGTCGACCGGTATCGGCTCGCTGTCCACCGGGTTGAGCACGACCAACAGCAACGTCGCGTC GTTGTCGACGTCGGCGTCGACGGGACTGTCGTCGGCCAACAGCGCGATCACGTCGCTGTCCACCTCGACGTCGACCGGCA TCGGTTCGCTGTCCACCGGGCTGAGCACGACCAACAGCAACCTGAGCTCCCTGTCCACGTCGAGCTCGACCGGCCTGAGT ACGGCCAACAGCAACATCTCGTCGCTGTCCACCGGGCTGAATTCGTTGTCGACCGCGGTCAACGGCGGCGGGACGAAGTA CTTCCACGCCAACTCGACGCAGCCGGACAGTCAGGCGCTGGGGGCGGATTCCGTCGCGGTCGGGCCGGCGGCCATCGCGG CGGGCGCAAGCGGCATTGCGATCGGCAATGCGGCGAACGCGGCCGCCAACGGCGCCGTCGCGATCGGCCAGGCCGCCGTC GCGAAGGGCGGGCTGGCTGTCTCGATCGGGGTGTCGAACACGGCGAGCGGAGACGGCGCGGTGGCGATCGGCGATCCGAA CGTCGCGACCGGCACCGGCGCGGTCGCGCTTGGCGCGGACAATTCGGCAAACGGCCAGGGCGCCGTCGCGCTCGGCAACG CGAACATCGCAACCGGAACGGGCTCGCTTGCGTTCGGCAACACGTCGACGGCGGCAGCGGCGGGCGCGGTCGCGTTGGGC GCCGGCGCAATCGCGAACAATGCGAACGATGTCGCGCTGGGTTCCGCTAGCGTGACCGCGGCTGCGAATCCGGTGGCCAG CGCGTTGATCGCAGGTCAGGCTTATTCGCTTGCCGGCGGCGCGCCGGCGAGCGTGGTGAGCGTCGGCGCGCCCGGCGCCG AACGGCAAATCACCAACGTCGCGGCCGGGCGGATTTCCGCCACGTCGACCGATGCGGTGAACGGCTCGCAGATGAATGCG ATGACTCAGGCGCTGGAATCGCTGTCGACTTCGACGGCCAGCGCGCTGTCCACGGCGCAAAGCGGTCTGGGTTCGTTGTC GACGGGGCTCAGCTCGACGCAGAGCAGCGTGAGTTCGCTGTCGACGGGGCTCAGCACGACGAGCGGCAATGTGGCGTCGC TGTCGAGCGGTCTGGGCACGATGCAAAGCGGTATCGCGTCGCTGTCCACGGGGCTGAGCACGACGAACAGCAGCCTCGCG TCGCTGTCGACCGCCGTGTCCGGCGGCGGTGTTCGCACCAGCAGCTTGGGCGACACGTCGGCGGGCAATGGCGCGAACGC GTCCGGCGGCAACGGCACGGCGGTCGGCGGCGCCGCGTCCGCTTCGGGAACCGATGCGACCGCGCTGGGCCAGGCGTCGA ACGCGTCGGGCAATCATTCGACCGCATTGGGGCAAGCATCGAGTGCGTCCGGAAGCGGCTCCACCGCGGTGGGACAAGGC GCCGGCGCGCCCGGCGACGGCGCTTCGGCATTCGGCCAAGGGGCACTTGCCTCCGGTACGGACTCGACGGCGCTCGGCGC TCATTCGACGGCTGCGGCGCCGAACTCGGCGGCGATCGGCGCGAATTCGGTGGCGTCCGCGCCGAATTCGGTGTCGTTCG GTTCGCGGGGCCATGAGCGCAGGCTGACGAATGTCGCGCCGGGGATCGACGGCACCGACGCGGCGAACATGAACCAGCTC TGGGGCGTGCAATCGAGCGTCGATCAGGCGGCGCGCCGCGCCTATTCCGGGGTGGCGGCCGCGACCGCGCTGACGATGAT TCCGGAGGTCGACCCCGGCAAGACGATCGCGGTCGGGATCGGCGCGGGCAGCTATCAAGGGTATTCGGCGTCCGCGATCG GCGTGTCCGTGCGGTTCTCCGACAACCTGAAGGCGAAGCTCGGCGTGGGGATCAGCGCTCAGGGCAGCACATATGGCGCA GGCGTCTCGTACCAGTGGTAG
Upstream 100 bases:
>100_bases CCACGCTTGCCGCACGGAGTGGCTGGCGCGGCTCCGTCCACGGAGGTGCGACGTCGAATCCTGGTGCAGCACTGCTTGGG TAGGTGAGACGGAGGGTGTC
Downstream 100 bases:
>100_bases CGCGGTGGCGAGCGCACCGGACGAGGAGCGCATCGTCGCTCCTCGTCCGGGCGGCGACGTATCTCCGGACGGCGAGGCAT CGAATGAATCGGGCGGCGAT
Product: surface-exposed protein
Products: NA
Alternate protein names: Membrane-Anchored Cell Surface Protein; Hemagglutinin Family Protein; Hemagluttinin Domain-Containing Protein; Outer Membrane Protein; Haemagluttinin Family Protein; YadA Domain Protein; Haemagglutinin Family Protein; Haemagglutinin-Related Autotransporter Protein; Surface-Exposed Protein; Hep_Hag Family; Hemagglutinin Domain-Containing Protein; Hep_Hag Family Protein; Autotransporter Adhesin; Hemagluttinin Motif-Containing Protein; Surface Protein; Surface-Exposed Adhesin Protein; YadA-Like C-Terminal Region Protein; Haemagluttinin Domain Protein; Haemagglutinin; Membrane-Anchored Cell Surface Protein Haemagluttinin; Hemagglutinin; Haemagglutinin And Invasin Like Cell Surface Protein; Intracellular Motility Protein A; Outer Membrane Pathogenesis Protein; Hemagglutinin-Related Protein; YadA-Like C-Terminal Domain-Containing; Hemagluttinin Family Protein; YadA/Haemagluttinin Like Protein; Hemaglutinin/Autotransporter Like Protein; Hemagluttinin Like Protein; YadA-Like Protein; Outer Membrane Protein Haemagluttinin-Like
Number of amino acids: Translated: 1766; Mature: 1766
Protein sequence:
>1766_residues MNKIYRKVWNKARGQLVVASELASSRSSVGEASVDAGRSGDRTASAAFASEERNPGSGRMIPLAIAVALMFSPYAWAGVG GADNGVTGTSNNGGVGGSSGGGGVQFSDMGVAFVGDGDCSMLTSGPGSYAGVYGSGSNYLGGLFGFGAQTSAVGWGTPSN AGANSGIVPYQGAAQTFGNVTYAGNGTQSGNFTQAFGLNSFAVGCGAHATGLSATAIGWGTTASGAGSVALGLYSTASGQ GSLAFGTSATATATDTIALGTLATANAVSGVAIGANTQASAANATAIGGNSSGANLGAQATAAGATAIGGNATAGAAATA TNAIAIGGQSSAKDTNDVAVGLGARAGTGSGAGNDLAIGNGATATGGNSIAQGAGASANAAGAVAIGKSASAAGGQAVSI GVANTASGNGAVAIGDPNVATGTGAVALGNNNTANGQGAVALGNVSTAVGQGSVALGNSSNAAAAGGVALGDTASAVMAG GLALGSLATASNANDVALGAGSKTAAAVATSTVSVNGANYAVAGSGPASTVSVGAPGSERTITNVAAGQVSAGSTDAVNG SELYATNQAITTGLSTANSSIASLSTSTSTGLSSANSNIGSLSTGLSTANSTVASLSSSTSTGLSSANSAVASLSTSTST GLSSANSNIGSLSTGLSTANSTVASLSTSTVAGLNSLSTGLSTTNSNVASLSSSTSTGLSSANSAVASLSTSTSTGLSSA NSNIGSLSTGLSTTNSTVASLSSSTSTGIGSLSTGVANSVQYDSPAHTSITLGGASATSPVKITNLAAGANPSDAVNYEQ LTSLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGL STTNSNVASLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSSANSAITSLSTSTSTGIG SLSTGLSTTNSNVASLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSSAISAITSLSTS TSTGIGSLSTGLSTTNSNVASLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSSAISAI TSLSTSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTTNSNLSSLSTSSSTGLS TANSNISSLSTGLNSLSTAVNGGGTKYFHANSTQPDSQALGADSVAVGPAAIAAGASGIAIGNAANAAANGAVAIGQAAV AKGGLAVSIGVSNTASGDGAVAIGDPNVATGTGAVALGADNSANGQGAVALGNANIATGTGSLAFGNTSTAAAAGAVALG AGAIANNANDVALGSASVTAAANPVASALIAGQAYSLAGGAPASVVSVGAPGAERQITNVAAGRISATSTDAVNGSQMNA MTQALESLSTSTASALSTAQSGLGSLSTGLSSTQSSVSSLSTGLSTTSGNVASLSSGLGTMQSGIASLSTGLSTTNSSLA SLSTAVSGGGVRTSSLGDTSAGNGANASGGNGTAVGGAASASGTDATALGQASNASGNHSTALGQASSASGSGSTAVGQG AGAPGDGASAFGQGALASGTDSTALGAHSTAAAPNSAAIGANSVASAPNSVSFGSRGHERRLTNVAPGIDGTDAANMNQL WGVQSSVDQAARRAYSGVAAATALTMIPEVDPGKTIAVGIGAGSYQGYSASAIGVSVRFSDNLKAKLGVGISAQGSTYGA GVSYQW
Sequences:
>Translated_1766_residues MNKIYRKVWNKARGQLVVASELASSRSSVGEASVDAGRSGDRTASAAFASEERNPGSGRMIPLAIAVALMFSPYAWAGVG GADNGVTGTSNNGGVGGSSGGGGVQFSDMGVAFVGDGDCSMLTSGPGSYAGVYGSGSNYLGGLFGFGAQTSAVGWGTPSN AGANSGIVPYQGAAQTFGNVTYAGNGTQSGNFTQAFGLNSFAVGCGAHATGLSATAIGWGTTASGAGSVALGLYSTASGQ GSLAFGTSATATATDTIALGTLATANAVSGVAIGANTQASAANATAIGGNSSGANLGAQATAAGATAIGGNATAGAAATA TNAIAIGGQSSAKDTNDVAVGLGARAGTGSGAGNDLAIGNGATATGGNSIAQGAGASANAAGAVAIGKSASAAGGQAVSI GVANTASGNGAVAIGDPNVATGTGAVALGNNNTANGQGAVALGNVSTAVGQGSVALGNSSNAAAAGGVALGDTASAVMAG GLALGSLATASNANDVALGAGSKTAAAVATSTVSVNGANYAVAGSGPASTVSVGAPGSERTITNVAAGQVSAGSTDAVNG SELYATNQAITTGLSTANSSIASLSTSTSTGLSSANSNIGSLSTGLSTANSTVASLSSSTSTGLSSANSAVASLSTSTST GLSSANSNIGSLSTGLSTANSTVASLSTSTVAGLNSLSTGLSTTNSNVASLSSSTSTGLSSANSAVASLSTSTSTGLSSA NSNIGSLSTGLSTTNSTVASLSSSTSTGIGSLSTGVANSVQYDSPAHTSITLGGASATSPVKITNLAAGANPSDAVNYEQ LTSLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGL STTNSNVASLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSSANSAITSLSTSTSTGIG SLSTGLSTTNSNVASLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSSAISAITSLSTS TSTGIGSLSTGLSTTNSNVASLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSSAISAI TSLSTSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTTNSNLSSLSTSSSTGLS TANSNISSLSTGLNSLSTAVNGGGTKYFHANSTQPDSQALGADSVAVGPAAIAAGASGIAIGNAANAAANGAVAIGQAAV AKGGLAVSIGVSNTASGDGAVAIGDPNVATGTGAVALGADNSANGQGAVALGNANIATGTGSLAFGNTSTAAAAGAVALG AGAIANNANDVALGSASVTAAANPVASALIAGQAYSLAGGAPASVVSVGAPGAERQITNVAAGRISATSTDAVNGSQMNA MTQALESLSTSTASALSTAQSGLGSLSTGLSSTQSSVSSLSTGLSTTSGNVASLSSGLGTMQSGIASLSTGLSTTNSSLA SLSTAVSGGGVRTSSLGDTSAGNGANASGGNGTAVGGAASASGTDATALGQASNASGNHSTALGQASSASGSGSTAVGQG AGAPGDGASAFGQGALASGTDSTALGAHSTAAAPNSAAIGANSVASAPNSVSFGSRGHERRLTNVAPGIDGTDAANMNQL WGVQSSVDQAARRAYSGVAAATALTMIPEVDPGKTIAVGIGAGSYQGYSASAIGVSVRFSDNLKAKLGVGISAQGSTYGA GVSYQW >Mature_1766_residues MNKIYRKVWNKARGQLVVASELASSRSSVGEASVDAGRSGDRTASAAFASEERNPGSGRMIPLAIAVALMFSPYAWAGVG GADNGVTGTSNNGGVGGSSGGGGVQFSDMGVAFVGDGDCSMLTSGPGSYAGVYGSGSNYLGGLFGFGAQTSAVGWGTPSN AGANSGIVPYQGAAQTFGNVTYAGNGTQSGNFTQAFGLNSFAVGCGAHATGLSATAIGWGTTASGAGSVALGLYSTASGQ GSLAFGTSATATATDTIALGTLATANAVSGVAIGANTQASAANATAIGGNSSGANLGAQATAAGATAIGGNATAGAAATA TNAIAIGGQSSAKDTNDVAVGLGARAGTGSGAGNDLAIGNGATATGGNSIAQGAGASANAAGAVAIGKSASAAGGQAVSI GVANTASGNGAVAIGDPNVATGTGAVALGNNNTANGQGAVALGNVSTAVGQGSVALGNSSNAAAAGGVALGDTASAVMAG GLALGSLATASNANDVALGAGSKTAAAVATSTVSVNGANYAVAGSGPASTVSVGAPGSERTITNVAAGQVSAGSTDAVNG SELYATNQAITTGLSTANSSIASLSTSTSTGLSSANSNIGSLSTGLSTANSTVASLSSSTSTGLSSANSAVASLSTSTST GLSSANSNIGSLSTGLSTANSTVASLSTSTVAGLNSLSTGLSTTNSNVASLSSSTSTGLSSANSAVASLSTSTSTGLSSA NSNIGSLSTGLSTTNSTVASLSSSTSTGIGSLSTGVANSVQYDSPAHTSITLGGASATSPVKITNLAAGANPSDAVNYEQ LTSLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGL STTNSNVASLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSSANSAITSLSTSTSTGIG SLSTGLSTTNSNVASLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSSAISAITSLSTS TSTGIGSLSTGLSTTNSNVASLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSSAISAI TSLSTSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTTNSNLSSLSTSSSTGLS TANSNISSLSTGLNSLSTAVNGGGTKYFHANSTQPDSQALGADSVAVGPAAIAAGASGIAIGNAANAAANGAVAIGQAAV AKGGLAVSIGVSNTASGDGAVAIGDPNVATGTGAVALGADNSANGQGAVALGNANIATGTGSLAFGNTSTAAAAGAVALG AGAIANNANDVALGSASVTAAANPVASALIAGQAYSLAGGAPASVVSVGAPGAERQITNVAAGRISATSTDAVNGSQMNA MTQALESLSTSTASALSTAQSGLGSLSTGLSSTQSSVSSLSTGLSTTSGNVASLSSGLGTMQSGIASLSTGLSTTNSSLA SLSTAVSGGGVRTSSLGDTSAGNGANASGGNGTAVGGAASASGTDATALGQASNASGNHSTALGQASSASGSGSTAVGQG AGAPGDGASAFGQGALASGTDSTALGAHSTAAAPNSAAIGANSVASAPNSVSFGSRGHERRLTNVAPGIDGTDAANMNQL WGVQSSVDQAARRAYSGVAAATALTMIPEVDPGKTIAVGIGAGSYQGYSASAIGVSVRFSDNLKAKLGVGISAQGSTYGA GVSYQW
Specific function: Unknown
COG id: COG5295
COG function: function code UW; Autotransporter adhesin
Gene ontology:
Cell location: Cytoplasmic
Metaboloic importance: NA
Operon status: Not Known
Operon components: None
Similarity: NA
Homologues:
Organism=Drosophila melanogaster, GI221472639, Length=760, Percent_Identity=20.9210526315789, Blast_Score=81, Evalue=7e-15,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
NA
Pfam domain/function: NA
EC number: NA
Molecular weight: Translated: 162755; Mature: 162755
Theoretical pI: Translated: 4.67; Mature: 4.67
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.1 %Cys (Translated Protein) 0.6 %Met (Translated Protein) 0.7 %Cys+Met (Translated Protein) 0.1 %Cys (Mature Protein) 0.6 %Met (Mature Protein) 0.7 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MNKIYRKVWNKARGQLVVASELASSRSSVGEASVDAGRSGDRTASAAFASEERNPGSGRM CCHHHHHHHHHHCCCEEEHHHHHHHHHHCCCHHHCCCCCCCCHHHHHHHHCCCCCCCCCC IPLAIAVALMFSPYAWAGVGGADNGVTGTSNNGGVGGSSGGGGVQFSDMGVAFVGDGDCS HHHHHHHHHHHCCCCEECCCCCCCCCCCCCCCCCCCCCCCCCCEEEECCCEEEEECCCCE MLTSGPGSYAGVYGSGSNYLGGLFGFGAQTSAVGWGTPSNAGANSGIVPYQGAAQTFGNV EEECCCCCCEEEECCCCCCCCHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHCCE TYAGNGTQSGNFTQAFGLNSFAVGCGAHATGLSATAIGWGTTASGAGSVALGLYSTASGQ EEECCCCCCCCEEEECCCCCEEECCCCCCCCCEEEEECCCCCCCCCCCEEEEEEEECCCC GSLAFGTSATATATDTIALGTLATANAVSGVAIGANTQASAANATAIGGNSSGANLGAQA CCEEECCCCCCCCCCEEEEHHHHHHHCCCCEEECCCCCCCCCCEEEECCCCCCCCCCCCH TAAGATAIGGNATAGAAATATNAIAIGGQSSAKDTNDVAVGLGARAGTGSGAGNDLAIGN HCCCCEECCCCCCCCCHHHCCCEEEECCCCCCCCCCCEEEECCCCCCCCCCCCCCEEECC GATATGGNSIAQGAGASANAAGAVAIGKSASAAGGQAVSIGVANTASGNGAVAIGDPNVA CCCCCCCCHHHCCCCCCCCCCCEEEECCCCCCCCCCEEEEEEEECCCCCCEEEECCCCCC TGTGAVALGNNNTANGQGAVALGNVSTAVGQGSVALGNSSNAAAAGGVALGDTASAVMAG CCCCEEEECCCCCCCCCCEEEECCCHHHCCCCCEEECCCCCCCCCCCEEECCHHHHHHHC GLALGSLATASNANDVALGAGSKTAAAVATSTVSVNGANYAVAGSGPASTVSVGAPGSER CHHHHHHHCCCCCCCEEEECCCCCCEEEEEEEEEECCCCEEEECCCCCCEEEECCCCCCC TITNVAAGQVSAGSTDAVNGSELYATNQAITTGLSTANSSIASLSTSTSTGLSSANSNIG EEEEEECCCCCCCCCCCCCCCEEEECCHHHHHCCHHCCCCHHEECCCCCCCCCCCCCCCC SLSTGLSTANSTVASLSSSTSTGLSSANSAVASLSTSTSTGLSSANSNIGSLSTGLSTAN CHHCCCCHHHHHHHHHCCCCCCCCCHHCHHHHEECCCCCCCCCCCCCCCCCHHCCCCCCC STVASLSTSTVAGLNSLSTGLSTTNSNVASLSSSTSTGLSSANSAVASLSTSTSTGLSSA CHHHHHHHHHHHHHHHHHCCCCCCCCCHHHCCCCCCCCCCHHCHHHHEECCCCCCCCCCC NSNIGSLSTGLSTTNSTVASLSSSTSTGIGSLSTGVANSVQYDSPAHTSITLGGASATSP CCCCCCHHCCCCCCCHHHHHHCCCCCCCCCCHHHCCCCCCCCCCCCCCEEEECCCCCCCC VKITNLAAGANPSDAVNYEQLTSLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTT EEEEEEECCCCCCCCCCHHHHHHCCCHHHCCCCHHHHHHHCCCCCCCCCCCCHHCCCCCC NSNVASLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSS CCCCEEECCCHHCCCCHHHHHHHCCCCCCCCCCCCHHCCCCCCCCCCEEECCCHHCCCCH ANSAITSLSTSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSSANSAITSLSTSTSTGIG HHHHHHCCCCCCCCCCCCHHCCCCCCCCCCEEECCCHHCCCCHHHHHHHCCCCCCCCCCC SLSTGLSTTNSNVASLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTTNSNVASLS CHHCCCCCCCCCCEEECCCHHCCCCHHHHHHHCCCCCCCCCCCCHHCCCCCCCCCCEEEC TSASTGLSSAISAITSLSTSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSSANSAITSL CCHHHHHHHHHHHHHHCCCCCCCCCCCHHCCCCCCCCCCEEECCCHHCCCCHHHHHHHCC STSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSSAISAITSLSTSTSTGIGSLSTGLST CCCCCCCCCCHHCCCCCCCCCCEEECCCHHHHHHHHHHHHHHCCCCCCCCCCCHHCCCCC TNSNVASLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTTNSNLSSLSTSSSTGLS CCCCCEEECCCHHCCCCHHHHHHHCCCCCCCCCCCCHHCCCCCCCCCHHHCCCCCCCCCC TANSNISSLSTGLNSLSTAVNGGGTKYFHANSTQPDSQALGADSVAVGPAAIAAGASGIA CCCCCHHHHHHHHHHHHHHHCCCCEEEEECCCCCCHHHHCCCCCCCCCHHHHHCCCCCEE IGNAANAAANGAVAIGQAAVAKGGLAVSIGVSNTASGDGAVAIGDPNVATGTGAVALGAD ECCCCCCCCCCCEEECHHHHHCCCEEEEEECCCCCCCCCEEEECCCCCCCCCCEEEECCC NSANGQGAVALGNANIATGTGSLAFGNTSTAAAAGAVALGAGAIANNANDVALGSASVTA CCCCCCCEEEECCCEEECCCCCEEECCCCHHHHHHHHHHCCCHHCCCCCCEEECCCCEEH AANPVASALIAGQAYSLAGGAPASVVSVGAPGAERQITNVAAGRISATSTDAVNGSQMNA HCCHHHHHHHHCCCEECCCCCCCCEEEECCCCCHHHHHHHHCCCEECCCCCCCCCHHHHH MTQALESLSTSTASALSTAQSGLGSLSTGLSSTQSSVSSLSTGLSTTSGNVASLSSGLGT HHHHHHHHHHHHHHHHHHHHHCCHHHHHCHHHHHHHHHHHHHCCCCCCCCHHHHHHCHHH MQSGIASLSTGLSTTNSSLASLSTAVSGGGVRTSSLGDTSAGNGANASGGNGTAVGGAAS HHHHHHHHHCCCCCCCHHHHHHHHHHCCCCEEECCCCCCCCCCCCCCCCCCCCEECCCCC ASGTDATALGQASNASGNHSTALGQASSASGSGSTAVGQGAGAPGDGASAFGQGALASGT CCCCCCHHCCCCCCCCCCCCHHCCCCCCCCCCCCCCCCCCCCCCCCCHHHHCCCCCCCCC DSTALGAHSTAAAPNSAAIGANSVASAPNSVSFGSRGHERRLTNVAPGIDGTDAANMNQL CCCCCCCCCCCCCCCCCCCCCCHHHCCCCCCCCCCCCCHHHHHHCCCCCCCCCCCCHHHH WGVQSSVDQAARRAYSGVAAATALTMIPEVDPGKTIAVGIGAGSYQGYSASAIGVSVRFS HCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCEEEEEECCCCCCCCCCEEEEEEEEEC DNLKAKLGVGISAQGSTYGAGVSYQW CCCCEEECCCEECCCCCCCCCCEECC >Mature Secondary Structure MNKIYRKVWNKARGQLVVASELASSRSSVGEASVDAGRSGDRTASAAFASEERNPGSGRM CCHHHHHHHHHHCCCEEEHHHHHHHHHHCCCHHHCCCCCCCCHHHHHHHHCCCCCCCCCC IPLAIAVALMFSPYAWAGVGGADNGVTGTSNNGGVGGSSGGGGVQFSDMGVAFVGDGDCS HHHHHHHHHHHCCCCEECCCCCCCCCCCCCCCCCCCCCCCCCCEEEECCCEEEEECCCCE MLTSGPGSYAGVYGSGSNYLGGLFGFGAQTSAVGWGTPSNAGANSGIVPYQGAAQTFGNV EEECCCCCCEEEECCCCCCCCHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHCCE TYAGNGTQSGNFTQAFGLNSFAVGCGAHATGLSATAIGWGTTASGAGSVALGLYSTASGQ EEECCCCCCCCEEEECCCCCEEECCCCCCCCCEEEEECCCCCCCCCCCEEEEEEEECCCC GSLAFGTSATATATDTIALGTLATANAVSGVAIGANTQASAANATAIGGNSSGANLGAQA CCEEECCCCCCCCCCEEEEHHHHHHHCCCCEEECCCCCCCCCCEEEECCCCCCCCCCCCH TAAGATAIGGNATAGAAATATNAIAIGGQSSAKDTNDVAVGLGARAGTGSGAGNDLAIGN HCCCCEECCCCCCCCCHHHCCCEEEECCCCCCCCCCCEEEECCCCCCCCCCCCCCEEECC GATATGGNSIAQGAGASANAAGAVAIGKSASAAGGQAVSIGVANTASGNGAVAIGDPNVA CCCCCCCCHHHCCCCCCCCCCCEEEECCCCCCCCCCEEEEEEEECCCCCCEEEECCCCCC TGTGAVALGNNNTANGQGAVALGNVSTAVGQGSVALGNSSNAAAAGGVALGDTASAVMAG CCCCEEEECCCCCCCCCCEEEECCCHHHCCCCCEEECCCCCCCCCCCEEECCHHHHHHHC GLALGSLATASNANDVALGAGSKTAAAVATSTVSVNGANYAVAGSGPASTVSVGAPGSER CHHHHHHHCCCCCCCEEEECCCCCCEEEEEEEEEECCCCEEEECCCCCCEEEECCCCCCC TITNVAAGQVSAGSTDAVNGSELYATNQAITTGLSTANSSIASLSTSTSTGLSSANSNIG EEEEEECCCCCCCCCCCCCCCEEEECCHHHHHCCHHCCCCHHEECCCCCCCCCCCCCCCC SLSTGLSTANSTVASLSSSTSTGLSSANSAVASLSTSTSTGLSSANSNIGSLSTGLSTAN CHHCCCCHHHHHHHHHCCCCCCCCCHHCHHHHEECCCCCCCCCCCCCCCCCHHCCCCCCC STVASLSTSTVAGLNSLSTGLSTTNSNVASLSSSTSTGLSSANSAVASLSTSTSTGLSSA CHHHHHHHHHHHHHHHHHCCCCCCCCCHHHCCCCCCCCCCHHCHHHHEECCCCCCCCCCC NSNIGSLSTGLSTTNSTVASLSSSTSTGIGSLSTGVANSVQYDSPAHTSITLGGASATSP CCCCCCHHCCCCCCCHHHHHHCCCCCCCCCCHHHCCCCCCCCCCCCCCEEEECCCCCCCC VKITNLAAGANPSDAVNYEQLTSLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTT EEEEEEECCCCCCCCCCHHHHHHCCCHHHCCCCHHHHHHHCCCCCCCCCCCCHHCCCCCC NSNVASLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSS CCCCEEECCCHHCCCCHHHHHHHCCCCCCCCCCCCHHCCCCCCCCCCEEECCCHHCCCCH ANSAITSLSTSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSSANSAITSLSTSTSTGIG HHHHHHCCCCCCCCCCCCHHCCCCCCCCCCEEECCCHHCCCCHHHHHHHCCCCCCCCCCC SLSTGLSTTNSNVASLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTTNSNVASLS CHHCCCCCCCCCCEEECCCHHCCCCHHHHHHHCCCCCCCCCCCCHHCCCCCCCCCCEEEC TSASTGLSSAISAITSLSTSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSSANSAITSL CCHHHHHHHHHHHHHHCCCCCCCCCCCHHCCCCCCCCCCEEECCCHHCCCCHHHHHHHCC STSTSTGIGSLSTGLSTTNSNVASLSTSASTGLSSAISAITSLSTSTSTGIGSLSTGLST CCCCCCCCCCHHCCCCCCCCCCEEECCCHHHHHHHHHHHHHHCCCCCCCCCCCHHCCCCC TNSNVASLSTSASTGLSSANSAITSLSTSTSTGIGSLSTGLSTTNSNLSSLSTSSSTGLS CCCCCEEECCCHHCCCCHHHHHHHCCCCCCCCCCCCHHCCCCCCCCCHHHCCCCCCCCCC TANSNISSLSTGLNSLSTAVNGGGTKYFHANSTQPDSQALGADSVAVGPAAIAAGASGIA CCCCCHHHHHHHHHHHHHHHCCCCEEEEECCCCCCHHHHCCCCCCCCCHHHHHCCCCCEE IGNAANAAANGAVAIGQAAVAKGGLAVSIGVSNTASGDGAVAIGDPNVATGTGAVALGAD ECCCCCCCCCCCEEECHHHHHCCCEEEEEECCCCCCCCCEEEECCCCCCCCCCEEEECCC NSANGQGAVALGNANIATGTGSLAFGNTSTAAAAGAVALGAGAIANNANDVALGSASVTA CCCCCCCEEEECCCEEECCCCCEEECCCCHHHHHHHHHHCCCHHCCCCCCEEECCCCEEH AANPVASALIAGQAYSLAGGAPASVVSVGAPGAERQITNVAAGRISATSTDAVNGSQMNA HCCHHHHHHHHCCCEECCCCCCCCEEEECCCCCHHHHHHHHCCCEECCCCCCCCCHHHHH MTQALESLSTSTASALSTAQSGLGSLSTGLSSTQSSVSSLSTGLSTTSGNVASLSSGLGT HHHHHHHHHHHHHHHHHHHHHCCHHHHHCHHHHHHHHHHHHHCCCCCCCCHHHHHHCHHH MQSGIASLSTGLSTTNSSLASLSTAVSGGGVRTSSLGDTSAGNGANASGGNGTAVGGAAS HHHHHHHHHCCCCCCCHHHHHHHHHHCCCCEEECCCCCCCCCCCCCCCCCCCCEECCCCC ASGTDATALGQASNASGNHSTALGQASSASGSGSTAVGQGAGAPGDGASAFGQGALASGT CCCCCCHHCCCCCCCCCCCCHHCCCCCCCCCCCCCCCCCCCCCCCCCHHHHCCCCCCCCC DSTALGAHSTAAAPNSAAIGANSVASAPNSVSFGSRGHERRLTNVAPGIDGTDAANMNQL CCCCCCCCCCCCCCCCCCCCCCHHHCCCCCCCCCCCCCHHHHHHCCCCCCCCCCCCHHHH WGVQSSVDQAARRAYSGVAAATALTMIPEVDPGKTIAVGIGAGSYQGYSASAIGVSVRFS HCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCEEEEEECCCCCCCCCCEEEEEEEEEC DNLKAKLGVGISAQGSTYGAGVSYQW CCCCEEECCCEECCCCCCCCCCEECC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA