The gene/protein map for NC_008253 is currently unavailable.
Definition Escherichia coli 536, complete genome.
Accession NC_008253
Length 4,938,920

Click here to switch to the map view.

The map label for this gene is Not Available

Identifier: 110644687

GI number:

Start: 4782996

End: 4792724

Strand: Reverse

Name: Not Available

Synonym: ECP_4580

Alternate gene names: NA

Gene position: NA

Preceding gene: 110644688

Following gene: 110644686

Centisome position: NA

GC content: NA

Gene sequence:

>9729_bases
ATGCATCAGCCTCCCGTTCGCTTCACTTACCGCCTGCTGAGTTACCTTATCAGTACGATTATCGCCGGGCAGCCGTTGTT
ACCGGCTGTGGGGGCCGTCATCACCCCACAAAACGGGGCCGGAATGGATAAAGCGGCAAATGGTGTGCCGGTCGTGAACA
TTGCCACGCCGAACGGGGCCGGGATTTCGCATAACCGGTTTACGGATTACAACGTCGGGAAGGAAGGGCTGATTCTCAAT
AATGCCACCGGTAAGCTTAATCCGACGCAGCTTGGTGGACTGATACAGAATAACCCGAACCTGAAAGCGGGCGGGGAAGC
GAAGGGTATCATCAACGAAGTGACCGGCGGTAACCGTTCACTGCTGCAGGGCTATACGGAAGTGGCCGGCAAAGCGGCGA
ATGTGATGGTTGCCAACCCGTATGGTATCACCTGTGACGGCTGTGGTTTTATCAACACGCCGCACGCGACGCTCACCACA
GGCAGACCTGTGATGAATGCCGACGGCAGCCTGCAGGCGCTGGAGGTGACTGAAGGCAGTATCACCATCAATGGCGCGGG
CCTGGACGGCACCCGGAGCGATGCCGTATCCATTATTGCCCGTGCAACGGAAGTGAATGCCGCGCTTCATGCGAAGGATT
TAACTGTCACTGCAGGCGCTAACCGGATAACTGCAGATGGTCGCGTCAGTGCCCTGAAGGGCGAAGGTGATGTGCCGAAA
GTTGCCGTTGATACCGGCGCGCTCGGTGGAATGTACGCCAGGCGTATTCATCTGACCTCCACTGAAAGTGGTGTCGGGGT
TAATCTTGGTAACCTTTATGCCCGCGATGGCGATATCATACTGAGCAGTGCCGGAAAACTGGTCCTGAAGAACAGCCTTG
CCGGCGGCAATACCACCGTAACCGGAACGGATGTCTCACTTTCAGGGGATAACAAAGCCGGAGGAAATCTCAGCGTTACC
GGGACAACGGGACTGACACTGAATCAGCCCCGTCTGGTGACGGATAAAAATCTGGTGCTGTCTTCATCCGGGCAGATTGT
ACAGAACGGTGGTGAACTGACTGCCGGACAGAACGCCATGCTCAGTGCACAGCACCTGAACCAGACTTCCGGGACCGTGA
ATGCAGCTGAAAATGTCACCCTTACCACCACCAATGATACCACACTGAAAGGCCGCAGCATTGCCGGGAAAACACTCACT
GTCAGTTCCGGCAGCCTGAACAACGGTGGGACACTGGTTGCCGGGCGCGATGCCACGGTGAAAACCGGGACATTCAGTAA
TACCGGTACCGTCCAGGGGAATGGCCTGAAAGTTACCGCCACTGACCTGACCAGCACCGGCAGTATTAAAAGTGGCAGCA
CACTCGATATCAGCGCCCGCAATGCCACACTGTCCGGTGATGCCGGTGCAAAAGACAGTGCCCGCGTTACCGTCAGCGGT
ACACTCGAAAACCGCGGCAGACTTGTCAGCGATGACGTGCTGACGCTCAGTGCCACGCAGATAAACAACAGCGGTACCCT
CTCCGGGGCAAAGGAACTTGTGGCTTCTGCAGACACACTGACCACCACAGAAAAATCGGTCACAAACAGTGACGGTAACC
TCATGCTGGACAGCGCGTCTTCCACACTGGCGGGTGAAACCAGTGCGGGTGGCACGGTGTCTGTAAAAGGCAACAGTCTG
AAGACCACGACCACTGCGCAGACGCAGGGCAACAGTGTCAGCGTGGATGTGCAGAACGCACAGCTTGACGGAACACAGGC
TGCCAGAGACATCCTTACCCTGAACGCCAGTGAAAAGCTCACCCACAGCGGGAAAAGCAGTGCCCCGTCGCTCAGCCTCA
GTGCGCCGGAACTGACCAGCAGCGGCGTACTTGTTGGTTCCGCCCTGAATACACAGTCACAGACCCTGACCAACAGCGGT
CTGTTGCAGGGGGAGGCCTCACTCACCGTTAACACACAGAGGCTTGATAATCAGCAGAACGGCACGCTGTACAGTGCTGC
AGACCTGACGCTGGATATACCGGACATCCGCAACAGCGGGCTTATCACCGGTGATAATGGTTTAATGTTAAATGCTGTCT
CCCTCAGCAATCCGGGAAAAATCATCGCTGACACGCTGAGCGTCAGGGCGACCACGCTGGATGGTGACGGCCTGTTGCAG
GGCGCCGGTGCACTGGCGCTTGCTGGCGACACCCTCTCACAGGGTAGTCACGGACGCTGGCTGACGGCGGACGACCTCTC
CCTCCGGGGCAAAACACTGAATACCGCAGGGACCACGCAGGGACAGAATATCACCGTGCAGGCGGACAGATGGGCGAACA
GTGGTTCCGTGCTGGCAACCGGTAACCTTACTGCTTCGGCAACCGGTCAGTTGACCAGTACCGGCGATATCATGAGCCAG
GGTGACACCACGCTGAAAGCAGCCACCACGGACAACCGGGGCAGTCTGCTTTCGGCCGGCACGCTCTCCCTTGATGGAAA
CTCACTGGATAACAGCGGCACTGTCCAGGGTGACCATGTCACGATTCGCCAGAACAGTGTCACCAACAGTGGCACGCTCA
CCGGGATCGCCGCGCTGACGCTTGCCGCCCGTATGGTATCCCCTCAACCTGCGCTGATGAATAACGGAGGTTCATTGCTG
ACCAGCGGCGATCTGACAATCACCGCAGGCAGTCTGGTAAACAGCGGGGCGATCCAGGCGGCTGACAGCCTGACTGCACG
TCTGACGGGTGAGCTCGTCAGCACAGCGGGCAGCAAAGTCACCTCGAACGGTGAAATGGCGCTCAGTGCACTGAATTTAA
GCAACAGCGGACAATGGATTGCAAAAAATCTGACCCTGAAGGCGAACTCACTGACCAGTGCGGGTGACATCACCGGTGTG
GATACTCTCACGCTCACGGTGAATCAGACGCTGAACAATCAGGCGAACGGAAAACTGCTCAGTGCAGGTGTGCTGACGCT
GAAGGCAGACAGTGTCACAAACGACGGGCAATTACAGGGAAATGCCACCACCATCACGGCAGGACAACTCACAAACGGCG
GGCATCTGCAGGGCGAAACGCTGACGCTGGCCGCCTCCGGTGGCGTGAACAACCGTTTCGGTGGTGTTCTGATGAGCCGG
AATGCACTGAATGTCAGTACTGCGACCCTGAGTAACCAGGGCACGATACAGGGTGGAGGCGGGGTTTCCCTGAACGTCAC
AGACCGTCTGCAGAACGACAGCAAAATCCTCTCCGGCAGTAACCTCACGCTGACGGCGCAGGTGCTGGCGAATACCGGCA
GTGGACTGGTACAGGCTGCCACCCTGCTGCTGGATGTGGTGAATACTGTCAACGGCGGACGCGTACTTGCCACCGGCAGT
GCCGACGTTAAAGGAACCACGCTGAATAATACCGGTACGCTTCAGGGTGCGGACCTGCTGGTGAATTACCACACATTCAG
CAACAGCGGTACCCTGCTGGGAACCTCCGGGCTTGGCGTCAAGGGCAGTTCACTGCTGCAACATGGTACAGGGCGGCTGT
ACAGTGCAGGCAACCTGCTGCTTGACGCTCAGGACTTCAGTGGTCAGGGGCAGGTGGTGGCCACCGGTGATGTCACACTG
AAACTGATTGCTGCCCTCACGAATCATGGTACCCTGGCCGCAGGGAAAACCCTTTCCGTCACGTCGCAAAATGCCATCAC
CAACGGCGGTGTGATGCAGGGTGATGCCATGGTGCTCGGTGCCGGAGAGGCATTCACCAACAATGGAATGCTGACTGCCG
GTAAAGGCAACAGTGTTTTCAGCGCACAGCGTCTTTTCCTTAACGCACCGGGTTCACTTCAGGCCGGTGGCGATGTGAGT
CTGAACAGCCGGAGTGATATCACCATCAGTGGTTTTACCGGCACGGCAGGCAGTCTGACAATGAATGTGGCCGGTACCCT
GCTGAACAGTGCGCTGATTTATGCGGGGAATAACCTGAAGCTGTTTACAGACCGTCTGCATAACCAGCATGGTGATATCC
TGGCCGGCAACAGTCTGTGGGTACAGAAGGATGCTTCCGGCGGTGCAAACACAGAGATTATCAATACCTCCGGGAATATT
GAGACGCATCAGGGCGATATTGTTGTAAGGACCGGGCATCTTCTGAACCAGCGGGAGGGATTTTCTGCCACAACAACAAC
CCGGACTAACCCCTCATCCATTCAGGGAATGGGAAATGCTCTGGTTGATATTCCCCTTTCCCTTCTTCCTGACGGCAGCT
ATGGCTATTTCACCCGTGAAGTTGAAAATCAGCACGGTACGCCCTGCAACGGGCACGGGGCATGCAATATCACAATGGAT
ACGCTTTATTATTACGCTCCGTTTGCTGACAGTGCCACACAGCGCTTTCTCAGCAGCCAGAACATCACAACAGTAACCGG
TGCTGATAATCCGGCAGGCCGCATTGCGTCAGGGCGTAATCTTTCTGCTGAGGCTGAACGACTGGAAAACCGGGCGTCAT
TTATCCTGGCGAATGGGGATATCGCACTTTCGGGCAGAGAGTTAAGCAATCAGAGCTGGCAGACGGGGACAGAGAATGAA
TATCTGGTATACCGCTACGACCCGAAAACGTTTTACGGTAGCTATGCCACAGGCTCTCTGGATAAACTGCCCCTGCTGTC
ACCGGAATTTGAAAACAATACCATCAGATTTTCACTGGATGGCCGGGAAAAAGATTACACGCCCGGTAAGACGTATTATT
CCGTTATTCAGGCGGGCGGGGATGTTAAGACCCGTTTTACCAGCAGTATCAATAACGGAACAACCACTGCACATGCAGGT
AGTGTCAGTCCGGTGGTCTCTGCACCGGTACTGAATACGTTAAGTCAGCAGACCGGCGGAGACAGTCTGACACAGACAGC
GCTGCAGCAGTATGAGCCGGTGGTGGTTGGCTCTCCGCAATGGCACGATGAACTGGCAGGTGCCCTGAAAAATATTGCCG
GAGGTTCGCCACTGACCGGTCAGACCGGTATCAGTGATGACTGGCCACTGCCTTCCGGCAACAATGGATACCTGGTTCCG
TCCACGGACCCGGACAGTCCGTATCTGATTACGGTGAACCCGAAACTGGATGGTCTCGGACAGGTGGACAGCCATTTGTT
TGCCGGACTGTATGAGCTTCTTGGAGCGAAACCGGGTCAGGCGCCACGTGAAACGGCTCCGTCGTATACCGATGAAAAAC
AGTTTCTGGGCTCATCGTATTTTCTTGACCGCCTCGGGCTGAAACCGGAAAAAGATTATCGTTTCCTGGGGGATGCGGTC
TTTGATACCCGGTATGTCAGTAACGCGGTGCTGAGCCGGACGGGTTCACGTTATCTCAACGGACTGGGTTCAGACACGGA
ACAGATGCGGTATCTGATGGATAACGCGGCCAGACAACAGAAAGGACTGGGATTAGAGTTTGGTGTGGCGCTGACAGCTG
AACAGATTGCTCAGCTTGACGGCAGCATACTGTGGTGGGAGTCAGCCACCATCAACGGACAGACAGTCATGGTCCCGAAA
CTGTATCTGTCGCCGGAAGATATCACCCTGCATAACGGCAGCGTTATCAGCGGGAACAACGTGCAGCTTGCGGGTGGCAA
TATCACCAACAGCGGCAGCAGCATCAACGCACAAAACGGCCTCTCGCTCGACAGTACCGGCTATATCGACAACCTGAATG
CGGGGCTGATAAGCGCGGGCGGTAGCCTAGACCTGAGCGCCATCGGGGATATCAGCAATATCAGCTCAGTCATCAGCGGT
AAAACCGTACAACTGGAAAGCGTGAGTGGCAACATCAGCAATATCACCCGGCGTCAGCAATGGAATGCGGGCAGTGACAG
CCGATATGGTGGTGTGCATCTCAGCGGTACGGACACCGGTCCGGTTGCGACCATTAAAGGCACTGATTCACTTTCACTGG
ATGCAGGGAAAAACATTGATATTACCGGGGCAACGGTCTCGTCCGGTGGAACCCTTGGAATGTCTGCGGGTAATGATATC
AACATTGCCGCAAACCTGATAAGCGGGAGCAAAAGTCAGTCCGGTTTCTGGCACACTGATGACAACAGTGCATCATCCAC
CACCTCACAGGGCAGCAGCATCAGCGCCGGCGGTAACCTGGCGATGGCTGCAGGCCATAATCTGGATGTCACGGCATCCT
CTGTTTCTGCCGGGCACAGCGCCCTGCTTTCTGCAGGTAACGACCTGAGTCTGAATGCAGTCAGGGAAAGCAAAAACAGT
CGCAACGGCAGGTCAGAAAGTCATGAAAGCCACGCAGCAGTGTCCACGGTGACGGCGGGCGATAACCTCCTCCTTGTTGC
CGGTCGTGATGTTGCCAGTCAGGCTGCCGGTGTGGCTGCGGAAAATAACGTGGTCATCCGGGGCGGACGTGATGTGAACC
TGGTGGCAGAGTCTGCCGGTGCAGGCGACAGCTATACGTCGAAGAAAAAGAAAGAGATTAACGAGACAGTCCGTCAGCAG
GGAACGGAAATCGCCAGCGGTGGTGACACCACCGTCAACGCAGGACGGGATATCACCGCTGTTGCGTCATCCGTTACCGC
AACCGGCAATATCAGCGTGAATGCCGGTCGTGATGTTGCCCTGACCACGGCGACAGAAAGTGACTATCACTATCTGGAAA
CGAAGAAAAAAAGCGGAGGTTTTCTCAGTAAGAAAACCACCCACACCATCAGTGAGGACAGTGCCTCCCGTGAAGCAGGC
TCCCTGCTGTCGGGGAACCGCGTGACCGTTAACGCCGGTGATAACCTGACGGTAGAGGGTTCGGATGTGGTGGCTGACCA
GGATGTGTCACTGGCGGCGGGTAACCATGTTGATGTTCTTGCTGCCACCAGTACAGATACGTCCTGGCGCTTTAAGGAAA
CGAAGAAATCCGGTCTGATGGGTACCGGCGGTATTGGTTTCACCATTGGCAGCAGTAAGACAACGCACGACCGGCGCGAG
GCCGGGACAACGCAGAGTCAGAGTGCCAGCACCATCGGCTCCACTGCCGGTAATGTCAGTATTACCGCGGGCAAACAGGC
TCATATCAGCGGTTCGGATGTGATTGCGAACCGGGATATCAGCATTACCGGTGACAGTGTGGTGGTTGACCCGGGGCATG
ACCGTCGTACTGTGGACGAAAAATTTGAGCAGAAGAAAAGCGGGCTGACGGTTGCCCTTTCCGGCACGGTGGGCAGTGCC
ATCAATAATGCGGTTACCAGTGCACAGGAGACGAAGGAGAGCAGTGACAGCCGTCTGAAAGCCCTGCAGGCCACAAAGAC
AGCGCTGTCTGGTGTGCAGGCCGGACAGGCTGCGACAATGGCCTCCGCAACCGGTGACCCGAATGCGACGGGAGTCAGCC
TGTCGCTCACCACCCAGAAATCGAAATCACAGCAACATTCTGAAAGTGACACAGTATCCGGCAGTACGCTGAATGCCGGG
AATAATCTGTCTGTTGTCGCAACCGGTAAAAACAGGGGCGATAACCGCGGAGATATTGTGATTGCCGGAAGCCAGCTTAA
GGTCGGTGGTAACACAAGCCTGGATGCCGCGAATGATATTCTGTTGAGTGGCGCTGCAAACACACAAAAAACAACGGGCA
GGAACAGCAGCAGTGGCGGTGGCGTGGGTGTCAGTATCGGTGCCGGTGGTAACGGTGCCGGTATCAGCGTCTTTGCTGGC
GTTAATGCGGCAAAAGGCAGCGAGAAAGGTAACGGTACTGAGTGGACTGAAACCACAACAGACAGCGGTAAAACCGTCAC
CATCAACAGTGGTCGGGATACGGTACTGAACGGTGCTCAGGTCAACGGCAACAGGATTATCGCCGATGTGGGCCACGACC
TGCTGATAAGCAGCCAGCAGGACACCAGTAAGTACGACAGTAAACAGACCAGCGTGGCTGCCGGCGGCAGTTTTACCTTT
GGCTCCATGACCGGCTCAGGTTACATCGCTGCCTCCCGGGATAAGATGAAGAGCCGCTTTGACTCCGTTGCTGAACAAAC
CGGAATGTTTGCCGGTGACGGCGGCTTCGACATTACAGTGGGCAGACATACCCAACTGGATGGTGCGGTGATTGCCTCCA
CTGCCACACCGGATAAAAACCACCTGGATACCGGAACGCTGGGGTTCAGTGACCTTCACAACGAAGCGGATTATAAAGTC
AGTCACAGTGGAATCAGTCTGAGCGGTGGTGGCAGCTTCGGGGATAAATTTCAGGGTAACATGCCGGGTGGCATGATATC
CGCCGGAGGTCACAGCGGACATGCGGAAGGAACGACTCAGGCCGCAGTGGCTGAAGGCACTATCACCATCCGGGACAGGG
ACAATCAGAAGCAGAATCTGGCGAACCTGAGCCGTGACCCTGCGCACACTAATGACAGTATCAGCCCGATATTTGACAAG
GAGAAAGAGCAGAGGCGTCTGCAGACAGTGGGGCTTATCAGTGACATTGGCAGTCAGGTGGCGGATATCGCGCGGACGCA
GGGGGAACTGAATGCGTTGAAGGCTGCGCAGGATAAATATGGGCCTGTTCCGGCGGATGCGACGGAAGAACAGCGGCAGG
CATATCTGGCAAAACTGCGTGATACGCCGGAATACAAAAAGGAACAGGAAAAGTATGGTACCGGCAGCGATATGCAGCGC
GGTATCCAGGCTGCAACGGCTGCACTTCAGGGCCTGGTGGGCGGCAATATGGCAGGCGCGCTGGCAGGTGCTTCAGCGCC
GGAGCTGGCGAACATCATCGGTCATCACGCGGGTATTGATGACAATACAGCGGCAAAAGCCATTGCCCATGCCATTCTCG
GTGGTGTGACAGCAGCCCTTCAGGGCAACAGTGCGGCAGCAGGCGCAATTGGTGCGGGTACTGGTGAAGTGATCGCGTCA
GCCATTGCGAAAAGCCTCTACCCGGGCGTAGATCCGTCGAAACTGACAGAAGATCAGAAGCAAACTGTAAGCACGCTGGC
AACGCTGTCAGCGGGTATGGCCGGCGGCATTGCCAGTGGCGATGTGGCTGGCGCGGCTGCTGGAGCTGGTGCCGGGAAGA
ACGTTGTTGAGAATAATGCGCTGAGTCTGGTTGCCAGAGGCTGTGCGGTCGCAGCACCTTGCAGGACTAAAGTTGCAGAG
CAGTTGCTAGAAATCGGGGCGAAAGCGGGCATGGCCGGGCTTGCCGGGGCGGCAGTCAAGGATATGGCCGACAGGATGAC
CTCCGATGAACTGGAGCATCTGATTACCCTGCAAATGATGGGTAATGATGAGATCACTACTAAGTATCTCAGTTCGTTGC
ATGATAAGTACGGTTCCGGGGCTGCCTCGAATCCGAATATCGGTAAAGATCTGACCGATGCGGAAAAAGTAGAACTGGGC
GGTTCCGGCTCAGGAACCGGTACACCACCACCATCGGAAAATGATCCTAAGCAGCAAAATGAAAAAACTGTAGATAAGCT
TAATCAGAAGCAAGAAAGTGCGATTAAGAAGATCGATAACACTATAAAAAATGCTCTGAAAGATCATGATATTATTGGAA
CTCTCAAGGATATGGATGGTAAGCCAGTTCCTAAAGAGAATGGAGGATATTGGGATCATATGCAGGAAATGCAAAATACG
CTCAGAGGATTAAGAAATCATGCGGATACGTTGAAAAACGTCAACAATCCTGAAGCTCAGGCTGCGTATGGCAGAGCAAC
AGATGCTATTAATAAAATAGAATCAGCCTTGAAAGGATATGGAATATGA

Upstream 100 bases:

>100_bases
GTTCACTGCCGGACTGCCTCTTGTTTACCCGGACTGGCTTGCCCCTGACCATCTCACGGTTTACTGGCGCGTTGCCGTCG
CGTTTTAAGGGATTATTACC

Downstream 100 bases:

>100_bases
TTACCTTACGTAAATTGATTGGAAACATCAATATGACAAAAGAGCCTGAGCAACAATCACCGCTTGAACTCTGGTTCGAA
CGTATCATAGATGTGCCTCT

Product: hemagglutinin-related protein

Products: NA

Alternate protein names: NA

Number of amino acids: NA

Protein sequence:

>3242_residues
MHQPPVRFTYRLLSYLISTIIAGQPLLPAVGAVITPQNGAGMDKAANGVPVVNIATPNGAGISHNRFTDYNVGKEGLILN
NATGKLNPTQLGGLIQNNPNLKAGGEAKGIINEVTGGNRSLLQGYTEVAGKAANVMVANPYGITCDGCGFINTPHATLTT
GRPVMNADGSLQALEVTEGSITINGAGLDGTRSDAVSIIARATEVNAALHAKDLTVTAGANRITADGRVSALKGEGDVPK
VAVDTGALGGMYARRIHLTSTESGVGVNLGNLYARDGDIILSSAGKLVLKNSLAGGNTTVTGTDVSLSGDNKAGGNLSVT
GTTGLTLNQPRLVTDKNLVLSSSGQIVQNGGELTAGQNAMLSAQHLNQTSGTVNAAENVTLTTTNDTTLKGRSIAGKTLT
VSSGSLNNGGTLVAGRDATVKTGTFSNTGTVQGNGLKVTATDLTSTGSIKSGSTLDISARNATLSGDAGAKDSARVTVSG
TLENRGRLVSDDVLTLSATQINNSGTLSGAKELVASADTLTTTEKSVTNSDGNLMLDSASSTLAGETSAGGTVSVKGNSL
KTTTTAQTQGNSVSVDVQNAQLDGTQAARDILTLNASEKLTHSGKSSAPSLSLSAPELTSSGVLVGSALNTQSQTLTNSG
LLQGEASLTVNTQRLDNQQNGTLYSAADLTLDIPDIRNSGLITGDNGLMLNAVSLSNPGKIIADTLSVRATTLDGDGLLQ
GAGALALAGDTLSQGSHGRWLTADDLSLRGKTLNTAGTTQGQNITVQADRWANSGSVLATGNLTASATGQLTSTGDIMSQ
GDTTLKAATTDNRGSLLSAGTLSLDGNSLDNSGTVQGDHVTIRQNSVTNSGTLTGIAALTLAARMVSPQPALMNNGGSLL
TSGDLTITAGSLVNSGAIQAADSLTARLTGELVSTAGSKVTSNGEMALSALNLSNSGQWIAKNLTLKANSLTSAGDITGV
DTLTLTVNQTLNNQANGKLLSAGVLTLKADSVTNDGQLQGNATTITAGQLTNGGHLQGETLTLAASGGVNNRFGGVLMSR
NALNVSTATLSNQGTIQGGGGVSLNVTDRLQNDSKILSGSNLTLTAQVLANTGSGLVQAATLLLDVVNTVNGGRVLATGS
ADVKGTTLNNTGTLQGADLLVNYHTFSNSGTLLGTSGLGVKGSSLLQHGTGRLYSAGNLLLDAQDFSGQGQVVATGDVTL
KLIAALTNHGTLAAGKTLSVTSQNAITNGGVMQGDAMVLGAGEAFTNNGMLTAGKGNSVFSAQRLFLNAPGSLQAGGDVS
LNSRSDITISGFTGTAGSLTMNVAGTLLNSALIYAGNNLKLFTDRLHNQHGDILAGNSLWVQKDASGGANTEIINTSGNI
ETHQGDIVVRTGHLLNQREGFSATTTTRTNPSSIQGMGNALVDIPLSLLPDGSYGYFTREVENQHGTPCNGHGACNITMD
TLYYYAPFADSATQRFLSSQNITTVTGADNPAGRIASGRNLSAEAERLENRASFILANGDIALSGRELSNQSWQTGTENE
YLVYRYDPKTFYGSYATGSLDKLPLLSPEFENNTIRFSLDGREKDYTPGKTYYSVIQAGGDVKTRFTSSINNGTTTAHAG
SVSPVVSAPVLNTLSQQTGGDSLTQTALQQYEPVVVGSPQWHDELAGALKNIAGGSPLTGQTGISDDWPLPSGNNGYLVP
STDPDSPYLITVNPKLDGLGQVDSHLFAGLYELLGAKPGQAPRETAPSYTDEKQFLGSSYFLDRLGLKPEKDYRFLGDAV
FDTRYVSNAVLSRTGSRYLNGLGSDTEQMRYLMDNAARQQKGLGLEFGVALTAEQIAQLDGSILWWESATINGQTVMVPK
LYLSPEDITLHNGSVISGNNVQLAGGNITNSGSSINAQNGLSLDSTGYIDNLNAGLISAGGSLDLSAIGDISNISSVISG
KTVQLESVSGNISNITRRQQWNAGSDSRYGGVHLSGTDTGPVATIKGTDSLSLDAGKNIDITGATVSSGGTLGMSAGNDI
NIAANLISGSKSQSGFWHTDDNSASSTTSQGSSISAGGNLAMAAGHNLDVTASSVSAGHSALLSAGNDLSLNAVRESKNS
RNGRSESHESHAAVSTVTAGDNLLLVAGRDVASQAAGVAAENNVVIRGGRDVNLVAESAGAGDSYTSKKKKEINETVRQQ
GTEIASGGDTTVNAGRDITAVASSVTATGNISVNAGRDVALTTATESDYHYLETKKKSGGFLSKKTTHTISEDSASREAG
SLLSGNRVTVNAGDNLTVEGSDVVADQDVSLAAGNHVDVLAATSTDTSWRFKETKKSGLMGTGGIGFTIGSSKTTHDRRE
AGTTQSQSASTIGSTAGNVSITAGKQAHISGSDVIANRDISITGDSVVVDPGHDRRTVDEKFEQKKSGLTVALSGTVGSA
INNAVTSAQETKESSDSRLKALQATKTALSGVQAGQAATMASATGDPNATGVSLSLTTQKSKSQQHSESDTVSGSTLNAG
NNLSVVATGKNRGDNRGDIVIAGSQLKVGGNTSLDAANDILLSGAANTQKTTGRNSSSGGGVGVSIGAGGNGAGISVFAG
VNAAKGSEKGNGTEWTETTTDSGKTVTINSGRDTVLNGAQVNGNRIIADVGHDLLISSQQDTSKYDSKQTSVAAGGSFTF
GSMTGSGYIAASRDKMKSRFDSVAEQTGMFAGDGGFDITVGRHTQLDGAVIASTATPDKNHLDTGTLGFSDLHNEADYKV
SHSGISLSGGGSFGDKFQGNMPGGMISAGGHSGHAEGTTQAAVAEGTITIRDRDNQKQNLANLSRDPAHTNDSISPIFDK
EKEQRRLQTVGLISDIGSQVADIARTQGELNALKAAQDKYGPVPADATEEQRQAYLAKLRDTPEYKKEQEKYGTGSDMQR
GIQAATAALQGLVGGNMAGALAGASAPELANIIGHHAGIDDNTAAKAIAHAILGGVTAALQGNSAAAGAIGAGTGEVIAS
AIAKSLYPGVDPSKLTEDQKQTVSTLATLSAGMAGGIASGDVAGAAAGAGAGKNVVENNALSLVARGCAVAAPCRTKVAE
QLLEIGAKAGMAGLAGAAVKDMADRMTSDELEHLITLQMMGNDEITTKYLSSLHDKYGSGAASNPNIGKDLTDAEKVELG
GSGSGTGTPPPSENDPKQQNEKTVDKLNQKQESAIKKIDNTIKNALKDHDIIGTLKDMDGKPVPKENGGYWDHMQEMQNT
LRGLRNHADTLKNVNNPEAQAAYGRATDAINKIESALKGYGI

Sequences:
NA

Specific function: NA

COG id: COG3210

COG function: function code U; Large exoproteins involved in heme utilization or adhesion

Gene ontology:

Cell location: NA

Metaboloic importance: NA

Operon status: NA

Operon components: NA

Similarity: NA

Homologues:

NA

Paralogues:

NA

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: NA

Theoretical pI: NA

Prosite motif: NA

Important sites: NA

Signals:

NA

Transmembrane regions:

NA

Cys/Met content:

NA

Secondary structure: NA

PDB accession: NA

Resolution: NA

Structure class: NA

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: NA

TargetDB status: NA

Availability: NA

References: NA