Definition Yersinia pseudotuberculosis IP 32953, complete genome.
Accession NC_006155
Length 4,744,671

Click here to switch to the map view.

The map label for this gene is rscA

Identifier: 51595230

GI number: 51595230

Start: 1057177

End: 1063347

Strand: Direct

Name: rscA

Synonym: YPTB0880

Alternate gene names: 51595230

Gene position: 1057177-1063347 (Clockwise)

Preceding gene: 51595229

Following gene: 51595231

Centisome position: 22.28

GC content: 46.8

Gene sequence:

>6171_bases
ATGAACAGTAAATTGTACAAACTTATTTTTTGTCGTCGGCTGGGCTGCTTAATTGCCGTGGGAGAATTTACCCGATCATA
TGGCCGAGCCTTTTCGTCGAAAGGCGGTCAAGCCGGCAATAATCAGCGCCGGGCCGTTGGTATCTTAAGCCGTCTGGCGA
TGATGACGGGCTTGGCGCTTGGGATATTCCCCTTGCTGGTTCTGGCCCATCCGGTGTTACCGGTTAATGGCCATGTTGTC
ATCGGGCAAGGGATGTTGGATCAGCAAAGCAGTACGCTTACCGTGACACAGCAAACGGATAAGTTAGCGATTAATTGGGA
CAGTTTTGATATTGCGCACGGACACAGTGTCATTTATGCCCAGCCGGGTAGCCAGAGCATTGCATTGAATCAGGTGCAGG
GGCAGAGCGCATCGCAAATTTATGGCCGCTTACAGGCAAATGGTCAGGTCTTCTTGCTTAACCCGCGCGGGATACTGTTT
GGTAAAGAGGCGCAGGTTAATGTCGGTGGGTTGGTGGCGAGCACGAAATATATGTCAAATCCAGAGTTTCTGTCTGGTGA
CTACCGCCTGATCGGGGGGGAGAGTGAAGGCAATATTATTAATCAGGCGAATTTACGCTCGGCCCCAGGGGGATATATCG
CACTGGTGGGTAACCGGATTGATAACCAGCGTTCAGGGTCTATCACCACCCCACAAGGGAACACTGTGCTGGCAGTCGGT
CACAGCGTGACCTTGAATCTGGACCATGGGAATTTATTAGGGGTACAAATTCAGGGGGAAACCGTTGCTGCACTGATTCA
AAATGGTGGGTTAATCCAGGCTGATGGCGGAGTGATTCAACTGACGGCTAAGGGTAAAGATATGCTGATGGATACGGTGA
TTGATAATACCGGTATCCTGCAAGCTAAAGGGTTGTCAGCGAAAAATGGTGCTATTTATCTTGATGGCGGTGGTGAGGGG
GTTGTCAGCCAGATGGGGACCATCGATGTTAACAATCAGCAGGGGCGTGGAGGACGTGCGGTTGTTGAAGGGAAACGTAT
TTATCTGAATAAGAACAGTAATATTAAAGCGAAGGGCACTGCAGGCGGTGGCACTGTTTTAGTGGGGGGGGGCTGGCAAG
GCAAAGATAATCAGATCAGAAATGCCACGGCTGTGGTGATGGATAAAGGCAGTGATATTGATGTTTCGGCATCTCGCAAC
GGGCCGGGAGGAAGTGCGGTTTTATGGTCTGAGGATTACACCGGTTTTCACGGTAATATCCGAGCCAGAGGCGGGCCTCA
ATCAGGCGATGGCGGTCAGGTTGAAACATCCAGCCAACGCAATTTACAAGCTTTTGGGCAAGTGGATGCCAGTGCCGTTC
GTGGATCCGCAGGCTATTGGTTATTGGACCCTGCGGAGGTAACAATTGTTAGCAGTGGTGCTGAGAGTGGTGTAATGACT
AAAGTGGGTAATATACCCGCAGAGTTTTTTTCTAGCGCCCATATTTTTATTCCAACGGCCAATATTACTCAGATCCTCAA
TAGTAGTATTAATACCCAGCTTAATAGTGGCACTAATGTTACGATAACCACCAGCAACAGTAGTTTAACGGGGTGCCAAT
GGTGCAATATAACTGTACAAGCCGATATCACTAAAACGGCGGGAGCCGATGCGACGCTGACATTACAGGCTGACGGTAAT
ATTGTAGTTAATAATAATATTACCGCTGATGCTGGAAAATTAAATTTAAATTTATTAGCAGGGAATACCACTGCGGATTC
TGCCATCACGCTGAATAATAGCAAGGTTTTATTAAATGGCGGTGATTTTTTAGCTAAACATGCCAATGATAATAATACGG
CACGTATTGGCTTACTGGGCGGGCGATATGATGTTGGCAATTTCACCTTGGATGGGAATACCGCATTAGCCTCACAAGTT
GGGGTGAATATCAGTAATGCGGCTAATATTAGCGTCGCGGGCGAAACCGTTATCTCCGGTGTGAGCAGTAACAGCCGTGG
GCAAGGGTGGCGTGGTATTGATATATCAAATAATTCGATCTTAACGGGCGTGGGGAATATGACTTTCTCGATAGGCTCTA
ACTCCAATGTTTCATGGATGGGGTCATTCACTAATGCAACAATTACCAGTGATAAGAATATAATATTCCAAGGGACGGGG
AGTTCGTCAGGTGGAGTGGACTTTGTTAATAGCCGTATTTTGTCAAAATCTGGCCGTGTTTTATTTGATATAAATGGCAA
TATTGTTGTTAAGAATGTTTATGGGCTTCGGGTCAATAATTCACAGATCAGTGCTAAGGATGTTAAATTTGCAGTCAATG
TCACTGGAGTTGATGGTTTTTTACTAAGAGATAGTCATATTACCGCAACTTCCGGTGATATTAATGCCAATGCTAATACC
ATCAATAAAGGTATTTGGATCTCAGGTAAAACCAATTTAAACGCCAGTGGTAATGTTAATCTGCATGGTGTGACGACTAA
TTCGGCCTATGCGGGTGCTGATGCAATAAAGATCAGCGGTAATTCCAGTAGTAACAATGTCAATATTACCGCTGGTGGTC
ATATCTCTCTGATCGCGGTTAATGAAGGGAAAGAGATTGGAAGCACTGTTTCTGTAGATTACGCCAATATAATAGCTAAG
AATGGAGACTTTAATTTAAATATTACTGGGGTGAAAGGGAGTCCTTTTAATAACGCTACGATAACTGCCAACAATATTTC
AATGAATGGCAATATTACCGCTAATGATGCGGTGTTGATGACTAATACATTCCTCACGGCTAAAGGCGATATCAAAACTG
ATTTAACCTCTCCCACTAAAGGTTTATGGTTTAGGGGAAATGGTGGGATGACCGCGGCTAATAATATACTCTTGGTTGCT
AACAGCACATCGAGTGGAGAAGCAGTGAAAATCAATGCGTCTTCATCGAACAAAATGAATATCACTGCAGGAAAAGATAT
ATCTATAATAGCCGGTAATAGTAAAACAGCTACGGGACCTAACATTAATATTGAAAATGTCAATATAGAAACCAATAATG
GAAACTTTACGACTAACGGCATAACAAGTACATGGCTGTCGGGAGTGAATGTTAGCGCGAATGGTGTTGATATAACCTCT
AATTCTACTGGCACCGGTGGCATAGTATTGGATAATACTAATATCCTGACAACAGTAGGTGATATTAATACAATAGTAAC
CAATTCTTCCGGCAAAGGCATTTGGATTAAATCTAACTCAACATTGAATTCTAATAAAGATATCACCTTGGTTGGAGTAT
CCGCCGGACAGAATGAAGGGGTCATTATTCAAGGTTCTTCAGATGCTTCACGTAACAATATCTCTGCTCAAGGGAATATC
ACCTTAATAGGTAAAATGGGCAATGGCTCTGGTCAGCGTTCATTAATCAATTTGGGTAATGTTAGTCTAACATCAAGCGG
AAGAAATATTGATATTAATGGTTCGTCAGCCGGTACCGGGGATGTTTATTTTACCAATGTAGAGCTTAATGCTACCGCAG
GTAATGTTTCTATTTATGCTGAAACGAAAACCGCTTTATCGACATCATTAAATGCCGTATTAAGCTTGGGGGGTAATAAC
AGTATCAAAGCTCAAAATGGATGGCTTATTGGTAAAGCATTTAATACGACACAAGGGGCGGGTATTGGTTTTAGAGCCAA
TAGTAGCTTATCTGTTGACGGCAATATCATTTTGAAAGGCGAGACCGAAGGGGTTGGGGCCACACGCAAAGGGATTGATT
TCTATGGCGCGAATACACTGAATATTATTAAAGGTAGCCAATTATCTCTCCTCGGTGAAAATAAAGGGGCTCAAGATACC
GCAGGTGGTAATGGCATAAGCTATACCAGCCCAGCTAAATTAACGGTTAATAATAATGGTTCTTTAAAAATGGAGGGGCG
TTCAACCAGCGGTACGGGAATTAACTTCCCAAGCAGCAATAATACGCTGGTATTCAATGGTGATGGTGACACGCTGATTA
AAGGCAGCAGTGTCGCGGGTACGGGGGCCGCTATTTCCGGTGTTGTTAATAATAGTACCGGCCCCATGACGATTGAAGGA
ATCAGTACCGATGGTGCCGGTGTTCACCTTTTCAGTGCAGAACATCGTATTGATCGCATTAATGTCACAGGGAGTTCAAC
TCACGCCGAAGGTTTGCGGATCAGTGGTAATGCAGCGATTGTCGATACCACATTGACCGGAAAGTCGATCAATGGCAGTG
GTGTGAAGATTGATTCATTGCCGGGCTCCAGTGTTGTTACCCGTTCCGTCTTGGATAATGCCACGCTCAATGGCAGCAGT
AGCAGTGGGAAAGGGGTGGAAATTACCAGTGATATCAATGGTATTCATCACAGTTCGATTAACGGAACGGCTACTGGCAC
GGGCTACGGCATTAATATTGGCGAAAATTTAAACGTTACCGGGACCAGTGAAGCTGACTTGTTGATTCTACAAGGTGTGG
CGACAACAGGTACTGGCACCGGAATAAAACTCAATGGTAATAATGATTTAAGTAATACCAGTTTAAATAGCTCTGCGGTT
GATGGTATCGCTTTGGATATCACGGGCCCGCTAGCTAACCAAGGGAATGTGATCCTAAACGGCACGGCTTCTGGTTCGGG
GATTGGTGCGCAGGTCAATGGTTCGCTAAGTGATAGTGTGGTTAACGGTACGTCGACGAATGGTATTGGTGTGCAAATTA
ATGGATCGCTTGAAAACAGCCGCATCAACGGCATTTCGGCCAATGGCAGCGGGGTTAAAGTCGATGGCGAGACCACGCTG
GATAACGCCACGCTCAATGGCAACAGCAGCGAAGGCAAGGGCGTGGATCTGGCGGCCAATCTGTCCGGTAACCATGGCAG
TGCGGTGCATGGCGACACGGTCAATGGCACCGGCATCGACGTGGGTAAAGACGTCACCCTGAGTGGTGGTGGCACGGATG
AACCGTTAACGGTCAGCGGCAATGCCAGCGGTGAGAAAGGTACCGGCGTGCAACTGGGCGGCAATAATACCCTTGATAAC
ACCACGCTGAGCGGTAATGCCACTGACGGCACCGGCGTGGATATCACCGGCCCGCTGACCAATAGCGGCAATACCACCCT
CGGCGGTAAAGCTGAAAAAGGCGATGGCGTGCAACTCGATGGCGCGATTACCGGCGGCACGGTCAACGGCACTTCCGACA
GCGGCGCAGGGATTAAAGTGGATGGCGAGACCACGCTGGATAACGCCACGCTCAATGGCAACAGCAGCGAAGGCAAGGGC
GTGGATCTGGCGGCCAATCTGTCCGGTAACCATGGCAGTGCGGTGCATGGCGACACGGTCAATGGCACCGGCATCGACGT
GGGTAAAGACGTCACTCTGAGTGGCGGTGGTACGGATGAACCGTTAACGGTCAGCGGTAATGCCAGCGGTGAGAAAGGCA
CCGGCGTGCAACTGGGCGGCAATAATACCCTCGATAACACCACGCTGAGCGGTAATGCCACTGACGGCCATGGGGTAGAG
ATTAACAGCCGATTAATCAATAACGGCAATACTACGATTAATGGCAGAACGTCTGATGATGGTCACGGCGTACATATTAA
TGGGGCCATCAGTGGCGGCGAAATCAATGGTCATTCAGACAATAGCCACGGTGTTTTCCTCGATGAAAGTGCGTTACTTA
ATGACATCGTTATCGGAGGAGGGACCGGCTCATATAAACTGCCGGTGTTTATAGCATTACCTGAAACCATCGGTGAGCAC
GTGACTCTTAATGGTAAACCGATTGATAAAACCCAGCCAGAAGGCAGTAAGGCACGTGAAGGTGATAACCTGACAAGGGG
TAAATATACACCTTTGCCACCGGCTACTGACCCTGAATTGCCCCCAGCATCAACCGATGAGGAGAAAAATACAAAACAGA
CCTCGACGCTAACCCCATCTCAGAAAAGAGAGGATCCAGACATGTTGATAATGGCGCGAAACCATATCTTGAGTACCCTT
GAAGGGCGTGATTTATCTTCATCTGTTGTCACTGAATCGGAGCAAAGTGCGGCGGGCGTTACCGGAATTATGGTTTGTCT
CCCTCTGAGTGAGGCCTCTGAACATGAACCTTGCGATACGTATATTTTAGACAAGGGACAACCCCATCTCCCCATGATGG
TCAAGAAGTAA

Upstream 100 bases:

>100_bases
GCAGTGACCCGTCATCAAGATAACGATCAGCTCTGGTTAAGTGCTTATAAGATGTTTTAGTGCTTATCGGCATATTTGTC
AGATTTAATGGACGCGCATA

Downstream 100 bases:

>100_bases
AACACGTTATACCCGTCATATTTCAAGCTGCATGAGCGTTGGCCGCCTTCCTGCAACTCGAATTATTTTGGGTATATTAA
TTTAATACTATTAATGATAC

Product: adhesin; involved in the adherence of host cells

Products: NA

Alternate protein names: Heme:hemopexin utilization protein A [H]

Number of amino acids: Translated: 2056; Mature: 2056

Protein sequence:

>2056_residues
MNSKLYKLIFCRRLGCLIAVGEFTRSYGRAFSSKGGQAGNNQRRAVGILSRLAMMTGLALGIFPLLVLAHPVLPVNGHVV
IGQGMLDQQSSTLTVTQQTDKLAINWDSFDIAHGHSVIYAQPGSQSIALNQVQGQSASQIYGRLQANGQVFLLNPRGILF
GKEAQVNVGGLVASTKYMSNPEFLSGDYRLIGGESEGNIINQANLRSAPGGYIALVGNRIDNQRSGSITTPQGNTVLAVG
HSVTLNLDHGNLLGVQIQGETVAALIQNGGLIQADGGVIQLTAKGKDMLMDTVIDNTGILQAKGLSAKNGAIYLDGGGEG
VVSQMGTIDVNNQQGRGGRAVVEGKRIYLNKNSNIKAKGTAGGGTVLVGGGWQGKDNQIRNATAVVMDKGSDIDVSASRN
GPGGSAVLWSEDYTGFHGNIRARGGPQSGDGGQVETSSQRNLQAFGQVDASAVRGSAGYWLLDPAEVTIVSSGAESGVMT
KVGNIPAEFFSSAHIFIPTANITQILNSSINTQLNSGTNVTITTSNSSLTGCQWCNITVQADITKTAGADATLTLQADGN
IVVNNNITADAGKLNLNLLAGNTTADSAITLNNSKVLLNGGDFLAKHANDNNTARIGLLGGRYDVGNFTLDGNTALASQV
GVNISNAANISVAGETVISGVSSNSRGQGWRGIDISNNSILTGVGNMTFSIGSNSNVSWMGSFTNATITSDKNIIFQGTG
SSSGGVDFVNSRILSKSGRVLFDINGNIVVKNVYGLRVNNSQISAKDVKFAVNVTGVDGFLLRDSHITATSGDINANANT
INKGIWISGKTNLNASGNVNLHGVTTNSAYAGADAIKISGNSSSNNVNITAGGHISLIAVNEGKEIGSTVSVDYANIIAK
NGDFNLNITGVKGSPFNNATITANNISMNGNITANDAVLMTNTFLTAKGDIKTDLTSPTKGLWFRGNGGMTAANNILLVA
NSTSSGEAVKINASSSNKMNITAGKDISIIAGNSKTATGPNINIENVNIETNNGNFTTNGITSTWLSGVNVSANGVDITS
NSTGTGGIVLDNTNILTTVGDINTIVTNSSGKGIWIKSNSTLNSNKDITLVGVSAGQNEGVIIQGSSDASRNNISAQGNI
TLIGKMGNGSGQRSLINLGNVSLTSSGRNIDINGSSAGTGDVYFTNVELNATAGNVSIYAETKTALSTSLNAVLSLGGNN
SIKAQNGWLIGKAFNTTQGAGIGFRANSSLSVDGNIILKGETEGVGATRKGIDFYGANTLNIIKGSQLSLLGENKGAQDT
AGGNGISYTSPAKLTVNNNGSLKMEGRSTSGTGINFPSSNNTLVFNGDGDTLIKGSSVAGTGAAISGVVNNSTGPMTIEG
ISTDGAGVHLFSAEHRIDRINVTGSSTHAEGLRISGNAAIVDTTLTGKSINGSGVKIDSLPGSSVVTRSVLDNATLNGSS
SSGKGVEITSDINGIHHSSINGTATGTGYGINIGENLNVTGTSEADLLILQGVATTGTGTGIKLNGNNDLSNTSLNSSAV
DGIALDITGPLANQGNVILNGTASGSGIGAQVNGSLSDSVVNGTSTNGIGVQINGSLENSRINGISANGSGVKVDGETTL
DNATLNGNSSEGKGVDLAANLSGNHGSAVHGDTVNGTGIDVGKDVTLSGGGTDEPLTVSGNASGEKGTGVQLGGNNTLDN
TTLSGNATDGTGVDITGPLTNSGNTTLGGKAEKGDGVQLDGAITGGTVNGTSDSGAGIKVDGETTLDNATLNGNSSEGKG
VDLAANLSGNHGSAVHGDTVNGTGIDVGKDVTLSGGGTDEPLTVSGNASGEKGTGVQLGGNNTLDNTTLSGNATDGHGVE
INSRLINNGNTTINGRTSDDGHGVHINGAISGGEINGHSDNSHGVFLDESALLNDIVIGGGTGSYKLPVFIALPETIGEH
VTLNGKPIDKTQPEGSKAREGDNLTRGKYTPLPPATDPELPPASTDEEKNTKQTSTLTPSQKREDPDMLIMARNHILSTL
EGRDLSSSVVTESEQSAAGVTGIMVCLPLSEASEHEPCDTYILDKGQPHLPMMVKK

Sequences:

>Translated_2056_residues
MNSKLYKLIFCRRLGCLIAVGEFTRSYGRAFSSKGGQAGNNQRRAVGILSRLAMMTGLALGIFPLLVLAHPVLPVNGHVV
IGQGMLDQQSSTLTVTQQTDKLAINWDSFDIAHGHSVIYAQPGSQSIALNQVQGQSASQIYGRLQANGQVFLLNPRGILF
GKEAQVNVGGLVASTKYMSNPEFLSGDYRLIGGESEGNIINQANLRSAPGGYIALVGNRIDNQRSGSITTPQGNTVLAVG
HSVTLNLDHGNLLGVQIQGETVAALIQNGGLIQADGGVIQLTAKGKDMLMDTVIDNTGILQAKGLSAKNGAIYLDGGGEG
VVSQMGTIDVNNQQGRGGRAVVEGKRIYLNKNSNIKAKGTAGGGTVLVGGGWQGKDNQIRNATAVVMDKGSDIDVSASRN
GPGGSAVLWSEDYTGFHGNIRARGGPQSGDGGQVETSSQRNLQAFGQVDASAVRGSAGYWLLDPAEVTIVSSGAESGVMT
KVGNIPAEFFSSAHIFIPTANITQILNSSINTQLNSGTNVTITTSNSSLTGCQWCNITVQADITKTAGADATLTLQADGN
IVVNNNITADAGKLNLNLLAGNTTADSAITLNNSKVLLNGGDFLAKHANDNNTARIGLLGGRYDVGNFTLDGNTALASQV
GVNISNAANISVAGETVISGVSSNSRGQGWRGIDISNNSILTGVGNMTFSIGSNSNVSWMGSFTNATITSDKNIIFQGTG
SSSGGVDFVNSRILSKSGRVLFDINGNIVVKNVYGLRVNNSQISAKDVKFAVNVTGVDGFLLRDSHITATSGDINANANT
INKGIWISGKTNLNASGNVNLHGVTTNSAYAGADAIKISGNSSSNNVNITAGGHISLIAVNEGKEIGSTVSVDYANIIAK
NGDFNLNITGVKGSPFNNATITANNISMNGNITANDAVLMTNTFLTAKGDIKTDLTSPTKGLWFRGNGGMTAANNILLVA
NSTSSGEAVKINASSSNKMNITAGKDISIIAGNSKTATGPNINIENVNIETNNGNFTTNGITSTWLSGVNVSANGVDITS
NSTGTGGIVLDNTNILTTVGDINTIVTNSSGKGIWIKSNSTLNSNKDITLVGVSAGQNEGVIIQGSSDASRNNISAQGNI
TLIGKMGNGSGQRSLINLGNVSLTSSGRNIDINGSSAGTGDVYFTNVELNATAGNVSIYAETKTALSTSLNAVLSLGGNN
SIKAQNGWLIGKAFNTTQGAGIGFRANSSLSVDGNIILKGETEGVGATRKGIDFYGANTLNIIKGSQLSLLGENKGAQDT
AGGNGISYTSPAKLTVNNNGSLKMEGRSTSGTGINFPSSNNTLVFNGDGDTLIKGSSVAGTGAAISGVVNNSTGPMTIEG
ISTDGAGVHLFSAEHRIDRINVTGSSTHAEGLRISGNAAIVDTTLTGKSINGSGVKIDSLPGSSVVTRSVLDNATLNGSS
SSGKGVEITSDINGIHHSSINGTATGTGYGINIGENLNVTGTSEADLLILQGVATTGTGTGIKLNGNNDLSNTSLNSSAV
DGIALDITGPLANQGNVILNGTASGSGIGAQVNGSLSDSVVNGTSTNGIGVQINGSLENSRINGISANGSGVKVDGETTL
DNATLNGNSSEGKGVDLAANLSGNHGSAVHGDTVNGTGIDVGKDVTLSGGGTDEPLTVSGNASGEKGTGVQLGGNNTLDN
TTLSGNATDGTGVDITGPLTNSGNTTLGGKAEKGDGVQLDGAITGGTVNGTSDSGAGIKVDGETTLDNATLNGNSSEGKG
VDLAANLSGNHGSAVHGDTVNGTGIDVGKDVTLSGGGTDEPLTVSGNASGEKGTGVQLGGNNTLDNTTLSGNATDGHGVE
INSRLINNGNTTINGRTSDDGHGVHINGAISGGEINGHSDNSHGVFLDESALLNDIVIGGGTGSYKLPVFIALPETIGEH
VTLNGKPIDKTQPEGSKAREGDNLTRGKYTPLPPATDPELPPASTDEEKNTKQTSTLTPSQKREDPDMLIMARNHILSTL
EGRDLSSSVVTESEQSAAGVTGIMVCLPLSEASEHEPCDTYILDKGQPHLPMMVKK
>Mature_2056_residues
MNSKLYKLIFCRRLGCLIAVGEFTRSYGRAFSSKGGQAGNNQRRAVGILSRLAMMTGLALGIFPLLVLAHPVLPVNGHVV
IGQGMLDQQSSTLTVTQQTDKLAINWDSFDIAHGHSVIYAQPGSQSIALNQVQGQSASQIYGRLQANGQVFLLNPRGILF
GKEAQVNVGGLVASTKYMSNPEFLSGDYRLIGGESEGNIINQANLRSAPGGYIALVGNRIDNQRSGSITTPQGNTVLAVG
HSVTLNLDHGNLLGVQIQGETVAALIQNGGLIQADGGVIQLTAKGKDMLMDTVIDNTGILQAKGLSAKNGAIYLDGGGEG
VVSQMGTIDVNNQQGRGGRAVVEGKRIYLNKNSNIKAKGTAGGGTVLVGGGWQGKDNQIRNATAVVMDKGSDIDVSASRN
GPGGSAVLWSEDYTGFHGNIRARGGPQSGDGGQVETSSQRNLQAFGQVDASAVRGSAGYWLLDPAEVTIVSSGAESGVMT
KVGNIPAEFFSSAHIFIPTANITQILNSSINTQLNSGTNVTITTSNSSLTGCQWCNITVQADITKTAGADATLTLQADGN
IVVNNNITADAGKLNLNLLAGNTTADSAITLNNSKVLLNGGDFLAKHANDNNTARIGLLGGRYDVGNFTLDGNTALASQV
GVNISNAANISVAGETVISGVSSNSRGQGWRGIDISNNSILTGVGNMTFSIGSNSNVSWMGSFTNATITSDKNIIFQGTG
SSSGGVDFVNSRILSKSGRVLFDINGNIVVKNVYGLRVNNSQISAKDVKFAVNVTGVDGFLLRDSHITATSGDINANANT
INKGIWISGKTNLNASGNVNLHGVTTNSAYAGADAIKISGNSSSNNVNITAGGHISLIAVNEGKEIGSTVSVDYANIIAK
NGDFNLNITGVKGSPFNNATITANNISMNGNITANDAVLMTNTFLTAKGDIKTDLTSPTKGLWFRGNGGMTAANNILLVA
NSTSSGEAVKINASSSNKMNITAGKDISIIAGNSKTATGPNINIENVNIETNNGNFTTNGITSTWLSGVNVSANGVDITS
NSTGTGGIVLDNTNILTTVGDINTIVTNSSGKGIWIKSNSTLNSNKDITLVGVSAGQNEGVIIQGSSDASRNNISAQGNI
TLIGKMGNGSGQRSLINLGNVSLTSSGRNIDINGSSAGTGDVYFTNVELNATAGNVSIYAETKTALSTSLNAVLSLGGNN
SIKAQNGWLIGKAFNTTQGAGIGFRANSSLSVDGNIILKGETEGVGATRKGIDFYGANTLNIIKGSQLSLLGENKGAQDT
AGGNGISYTSPAKLTVNNNGSLKMEGRSTSGTGINFPSSNNTLVFNGDGDTLIKGSSVAGTGAAISGVVNNSTGPMTIEG
ISTDGAGVHLFSAEHRIDRINVTGSSTHAEGLRISGNAAIVDTTLTGKSINGSGVKIDSLPGSSVVTRSVLDNATLNGSS
SSGKGVEITSDINGIHHSSINGTATGTGYGINIGENLNVTGTSEADLLILQGVATTGTGTGIKLNGNNDLSNTSLNSSAV
DGIALDITGPLANQGNVILNGTASGSGIGAQVNGSLSDSVVNGTSTNGIGVQINGSLENSRINGISANGSGVKVDGETTL
DNATLNGNSSEGKGVDLAANLSGNHGSAVHGDTVNGTGIDVGKDVTLSGGGTDEPLTVSGNASGEKGTGVQLGGNNTLDN
TTLSGNATDGTGVDITGPLTNSGNTTLGGKAEKGDGVQLDGAITGGTVNGTSDSGAGIKVDGETTLDNATLNGNSSEGKG
VDLAANLSGNHGSAVHGDTVNGTGIDVGKDVTLSGGGTDEPLTVSGNASGEKGTGVQLGGNNTLDNTTLSGNATDGHGVE
INSRLINNGNTTINGRTSDDGHGVHINGAISGGEINGHSDNSHGVFLDESALLNDIVIGGGTGSYKLPVFIALPETIGEH
VTLNGKPIDKTQPEGSKAREGDNLTRGKYTPLPPATDPELPPASTDEEKNTKQTSTLTPSQKREDPDMLIMARNHILSTL
EGRDLSSSVVTESEQSAAGVTGIMVCLPLSEASEHEPCDTYILDKGQPHLPMMVKK

Specific function: Binds heme/hemopexin complexes [H]

COG id: COG3210

COG function: function code U; Large exoproteins involved in heme utilization or adhesion

Gene ontology:

Cell location: Secreted [H]

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR008638
- InterPro:   IPR012334
- InterPro:   IPR011050
- InterPro:   IPR011102 [H]

Pfam domain/function: PF05860 Haemagg_act [H]

EC number: NA

Molecular weight: Translated: 208827; Mature: 208827

Theoretical pI: Translated: 5.29; Mature: 5.29

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.3 %Cys     (Translated Protein)
1.2 %Met     (Translated Protein)
1.5 %Cys+Met (Translated Protein)
0.3 %Cys     (Mature Protein)
1.2 %Met     (Mature Protein)
1.5 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MNSKLYKLIFCRRLGCLIAVGEFTRSYGRAFSSKGGQAGNNQRRAVGILSRLAMMTGLAL
CCCHHHHHHHHHHHCCEEEEHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHH
GIFPLLVLAHPVLPVNGHVVIGQGMLDQQSSTLTVTQQTDKLAINWDSFDIAHGHSVIYA
HHHHHHHHHCCCCCCCCEEEEECCCCCCCCCEEEEEECCCEEEEEECCEEEECCCEEEEE
QPGSQSIALNQVQGQSASQIYGRLQANGQVFLLNPRGILFGKEAQVNVGGLVASTKYMSN
CCCCCEEEEEECCCCCHHHHHEEEECCCEEEEECCCCEEECCCCEEEECEEEEEEEECCC
PEFLSGDYRLIGGESEGNIINQANLRSAPGGYIALVGNRIDNQRSGSITTPQGNTVLAVG
CCEECCCEEEECCCCCCCEEEECCCCCCCCCEEEEEECCCCCCCCCCEECCCCCEEEEEC
HSVTLNLDHGNLLGVQIQGETVAALIQNGGLIQADGGVIQLTAKGKDMLMDTVIDNTGIL
CEEEEEECCCCEEEEEECCCEEEEEHHCCCEEEECCCEEEEEECCCCEEEEEHCCCCCEE
QAKGLSAKNGAIYLDGGGEGVVSQMGTIDVNNQQGRGGRAVVEGKRIYLNKNSNIKAKGT
EECCCCCCCCEEEEECCCCCHHHCCCEEEECCCCCCCCEEEEECEEEEEECCCCEEEEEC
AGGGTVLVGGGWQGKDNQIRNATAVVMDKGSDIDVSASRNGPGGSAVLWSEDYTGFHGNI
CCCCEEEECCCCCCCCCCCCCEEEEEEECCCCEEEEECCCCCCCEEEEECCCCCCCCCEE
RARGGPQSGDGGQVETSSQRNLQAFGQVDASAVRGSAGYWLLDPAEVTIVSSGAESGVMT
EECCCCCCCCCCEEECCCCCCCHHHCCCCHHHHCCCCCEEEECCCEEEEEECCCCCCCEE
KVGNIPAEFFSSAHIFIPTANITQILNSSINTQLNSGTNVTITTSNSSLTGCQWCNITVQ
ECCCCCHHHHCCCEEEEECCHHHHHHCCCCCCEECCCCEEEEEECCCCCCCEEEEEEEEE
ADITKTAGADATLTLQADGNIVVNNNITADAGKLNLNLLAGNTTADSAITLNNSKVLLNG
EEEEECCCCCEEEEEEECCCEEECCCEECCCCEEEEEEEECCCCCCCEEEECCCEEEEEC
GDFLAKHANDNNTARIGLLGGRYDVGNFTLDGNTALASQVGVNISNAANISVAGETVISG
CCEEEEECCCCCEEEEEEECCEEECCCEEECCCCEEEHHHCCEECCCCEEEEECHHHEEC
VSSNSRGQGWRGIDISNNSILTGVGNMTFSIGSNSNVSWMGSFTNATITSDKNIIFQGTG
CCCCCCCCCEEEEEECCCEEEEEECCEEEEECCCCCEEEEEECCCEEEECCCEEEEEECC
SSSGGVDFVNSRILSKSGRVLFDINGNIVVKNVYGLRVNNSQISAKDVKFAVNVTGVDGF
CCCCCCHHHHHEHCCCCCCEEEEECCCEEEEEEEEEEECCCEECCCEEEEEEEEECCCEE
LLRDSHITATSGDINANANTINKGIWISGKTNLNASGNVNLHGVTTNSAYAGADAIKISG
EEECCEEEEECCCCCCCCCEECCCEEEECCCCCCCCCCEEEEEEECCCCCCCCCEEEEEC
NSSSNNVNITAGGHISLIAVNEGKEIGSTVSVDYANIIAKNGDFNLNITGVKGSPFNNAT
CCCCCEEEEEECCEEEEEEECCCCCCCCEEEEEEEEEEEECCCEEEEEEEECCCCCCCCE
ITANNISMNGNITANDAVLMTNTFLTAKGDIKTDLTSPTKGLWFRGNGGMTAANNILLVA
EEEEEEEECCCEECCCEEEEEEEEEEECCCCEECCCCCCCCEEEECCCCCEECCCEEEEE
NSTSSGEAVKINASSSNKMNITAGKDISIIAGNSKTATGPNINIENVNIETNNGNFTTNG
ECCCCCCEEEEECCCCCEEEEECCCEEEEEECCCCCCCCCCEEEEEEEEEECCCCEEECC
ITSTWLSGVNVSANGVDITSNSTGTGGIVLDNTNILTTVGDINTIVTNSSGKGIWIKSNS
CHHHHHCCCEEECCCEEEECCCCCCCCEEEECCEEEEEECCCEEEEECCCCCEEEEECCC
TLNSNKDITLVGVSAGQNEGVIIQGSSDASRNNISAQGNITLIGKMGNGSGQRSLINLGN
CCCCCCCEEEEEECCCCCCCEEEECCCCCCCCCCCCCCCEEEEEEECCCCCCEEEEEECC
VSLTSSGRNIDINGSSAGTGDVYFTNVELNATAGNVSIYAETKTALSTSLNAVLSLGGNN
EEEECCCCEEEECCCCCCCCCEEEEEEEEEEECCCEEEEEECHHHHHHCCEEEEEECCCC
SIKAQNGWLIGKAFNTTQGAGIGFRANSSLSVDGNIILKGETEGVGATRKGIDFYGANTL
CEEECCCEEEEEECCCCCCCCEEEECCCEEEECCEEEEEECCCCCCCCCCCCEEECCCEE
NIIKGSQLSLLGENKGAQDTAGGNGISYTSPAKLTVNNNGSLKMEGRSTSGTGINFPSSN
EEEECCEEEEEECCCCCCCCCCCCCCEECCCEEEEECCCCEEEECCCCCCCCCEECCCCC
NTLVFNGDGDTLIKGSSVAGTGAAISGVVNNSTGPMTIEGISTDGAGVHLFSAEHRIDRI
CEEEEECCCCEEEECCCCCCCCEEEEEEEECCCCCEEEEEECCCCCEEEEEECCCCEEEE
NVTGSSTHAEGLRISGNAAIVDTTLTGKSINGSGVKIDSLPGSSVVTRSVLDNATLNGSS
EEECCCCCCCCEEEECCEEEEEEEECCCCCCCCCEEEECCCCCHHHHHHHHCCCEECCCC
SSGKGVEITSDINGIHHSSINGTATGTGYGINIGENLNVTGTSEADLLILQGVATTGTGT
CCCCCEEEECCCCCEEECCCCCCCCCCEEEEECCCCCEEECCCCCCEEEEEEEEECCCCC
GIKLNGNNDLSNTSLNSSAVDGIALDITGPLANQGNVILNGTASGSGIGAQVNGSLSDSV
EEEECCCCCCCCCCCCCCCCCCEEEEEECCCCCCCCEEEEECCCCCCCCEEECCCCCCCE
VNGTSTNGIGVQINGSLENSRINGISANGSGVKVDGETTLDNATLNGNSSEGKGVDLAAN
ECCCCCCCEEEEEECCCCCCEECEEECCCCEEEECCCCEECCEEECCCCCCCCCEEEEEE
LSGNHGSAVHGDTVNGTGIDVGKDVTLSGGGTDEPLTVSGNASGEKGTGVQLGGNNTLDN
CCCCCCCEEECCCCCCCCEECCCEEEECCCCCCCCEEEECCCCCCCCCEEEECCCCCCCC
TTLSGNATDGTGVDITGPLTNSGNTTLGGKAEKGDGVQLDGAITGGTVNGTSDSGAGIKV
CEECCCCCCCCCEEEECCCCCCCCEEECCCCCCCCCEEECCEEECCEECCCCCCCCEEEE
DGETTLDNATLNGNSSEGKGVDLAANLSGNHGSAVHGDTVNGTGIDVGKDVTLSGGGTDE
CCCCEECCEEECCCCCCCCCEEEEEECCCCCCCEEECCCCCCCCEECCCEEEECCCCCCC
PLTVSGNASGEKGTGVQLGGNNTLDNTTLSGNATDGHGVEINSRLINNGNTTINGRTSDD
CEEEECCCCCCCCCEEEECCCCCCCCCEECCCCCCCCCEEEEEEEEECCCEEEECCCCCC
GHGVHINGAISGGEINGHSDNSHGVFLDESALLNDIVIGGGTGSYKLPVFIALPETIGEH
CCEEEEEEEEECCEECCCCCCCCCEEEECCCCEEEEEEECCCCCEEEEEEEECCCCCCCE
VTLNGKPIDKTQPEGSKAREGDNLTRGKYTPLPPATDPELPPASTDEEKNTKQTSTLTPS
EEECCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
QKREDPDMLIMARNHILSTLEGRDLSSSVVTESEQSAAGVTGIMVCLPLSEASEHEPCDT
CCCCCCCEEEEEECHHHHHCCCCCCCHHHHCCCCCCCCCCEEEEEEEECCCCCCCCCCCE
YILDKGQPHLPMMVKK
EEECCCCCCCCEEEEC
>Mature Secondary Structure
MNSKLYKLIFCRRLGCLIAVGEFTRSYGRAFSSKGGQAGNNQRRAVGILSRLAMMTGLAL
CCCHHHHHHHHHHHCCEEEEHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHH
GIFPLLVLAHPVLPVNGHVVIGQGMLDQQSSTLTVTQQTDKLAINWDSFDIAHGHSVIYA
HHHHHHHHHCCCCCCCCEEEEECCCCCCCCCEEEEEECCCEEEEEECCEEEECCCEEEEE
QPGSQSIALNQVQGQSASQIYGRLQANGQVFLLNPRGILFGKEAQVNVGGLVASTKYMSN
CCCCCEEEEEECCCCCHHHHHEEEECCCEEEEECCCCEEECCCCEEEECEEEEEEEECCC
PEFLSGDYRLIGGESEGNIINQANLRSAPGGYIALVGNRIDNQRSGSITTPQGNTVLAVG
CCEECCCEEEECCCCCCCEEEECCCCCCCCCEEEEEECCCCCCCCCCEECCCCCEEEEEC
HSVTLNLDHGNLLGVQIQGETVAALIQNGGLIQADGGVIQLTAKGKDMLMDTVIDNTGIL
CEEEEEECCCCEEEEEECCCEEEEEHHCCCEEEECCCEEEEEECCCCEEEEEHCCCCCEE
QAKGLSAKNGAIYLDGGGEGVVSQMGTIDVNNQQGRGGRAVVEGKRIYLNKNSNIKAKGT
EECCCCCCCCEEEEECCCCCHHHCCCEEEECCCCCCCCEEEEECEEEEEECCCCEEEEEC
AGGGTVLVGGGWQGKDNQIRNATAVVMDKGSDIDVSASRNGPGGSAVLWSEDYTGFHGNI
CCCCEEEECCCCCCCCCCCCCEEEEEEECCCCEEEEECCCCCCCEEEEECCCCCCCCCEE
RARGGPQSGDGGQVETSSQRNLQAFGQVDASAVRGSAGYWLLDPAEVTIVSSGAESGVMT
EECCCCCCCCCCEEECCCCCCCHHHCCCCHHHHCCCCCEEEECCCEEEEEECCCCCCCEE
KVGNIPAEFFSSAHIFIPTANITQILNSSINTQLNSGTNVTITTSNSSLTGCQWCNITVQ
ECCCCCHHHHCCCEEEEECCHHHHHHCCCCCCEECCCCEEEEEECCCCCCCEEEEEEEEE
ADITKTAGADATLTLQADGNIVVNNNITADAGKLNLNLLAGNTTADSAITLNNSKVLLNG
EEEEECCCCCEEEEEEECCCEEECCCEECCCCEEEEEEEECCCCCCCEEEECCCEEEEEC
GDFLAKHANDNNTARIGLLGGRYDVGNFTLDGNTALASQVGVNISNAANISVAGETVISG
CCEEEEECCCCCEEEEEEECCEEECCCEEECCCCEEEHHHCCEECCCCEEEEECHHHEEC
VSSNSRGQGWRGIDISNNSILTGVGNMTFSIGSNSNVSWMGSFTNATITSDKNIIFQGTG
CCCCCCCCCEEEEEECCCEEEEEECCEEEEECCCCCEEEEEECCCEEEECCCEEEEEECC
SSSGGVDFVNSRILSKSGRVLFDINGNIVVKNVYGLRVNNSQISAKDVKFAVNVTGVDGF
CCCCCCHHHHHEHCCCCCCEEEEECCCEEEEEEEEEEECCCEECCCEEEEEEEEECCCEE
LLRDSHITATSGDINANANTINKGIWISGKTNLNASGNVNLHGVTTNSAYAGADAIKISG
EEECCEEEEECCCCCCCCCEECCCEEEECCCCCCCCCCEEEEEEECCCCCCCCCEEEEEC
NSSSNNVNITAGGHISLIAVNEGKEIGSTVSVDYANIIAKNGDFNLNITGVKGSPFNNAT
CCCCCEEEEEECCEEEEEEECCCCCCCCEEEEEEEEEEEECCCEEEEEEEECCCCCCCCE
ITANNISMNGNITANDAVLMTNTFLTAKGDIKTDLTSPTKGLWFRGNGGMTAANNILLVA
EEEEEEEECCCEECCCEEEEEEEEEEECCCCEECCCCCCCCEEEECCCCCEECCCEEEEE
NSTSSGEAVKINASSSNKMNITAGKDISIIAGNSKTATGPNINIENVNIETNNGNFTTNG
ECCCCCCEEEEECCCCCEEEEECCCEEEEEECCCCCCCCCCEEEEEEEEEECCCCEEECC
ITSTWLSGVNVSANGVDITSNSTGTGGIVLDNTNILTTVGDINTIVTNSSGKGIWIKSNS
CHHHHHCCCEEECCCEEEECCCCCCCCEEEECCEEEEEECCCEEEEECCCCCEEEEECCC
TLNSNKDITLVGVSAGQNEGVIIQGSSDASRNNISAQGNITLIGKMGNGSGQRSLINLGN
CCCCCCCEEEEEECCCCCCCEEEECCCCCCCCCCCCCCCEEEEEEECCCCCCEEEEEECC
VSLTSSGRNIDINGSSAGTGDVYFTNVELNATAGNVSIYAETKTALSTSLNAVLSLGGNN
EEEECCCCEEEECCCCCCCCCEEEEEEEEEEECCCEEEEEECHHHHHHCCEEEEEECCCC
SIKAQNGWLIGKAFNTTQGAGIGFRANSSLSVDGNIILKGETEGVGATRKGIDFYGANTL
CEEECCCEEEEEECCCCCCCCEEEECCCEEEECCEEEEEECCCCCCCCCCCCEEECCCEE
NIIKGSQLSLLGENKGAQDTAGGNGISYTSPAKLTVNNNGSLKMEGRSTSGTGINFPSSN
EEEECCEEEEEECCCCCCCCCCCCCCEECCCEEEEECCCCEEEECCCCCCCCCEECCCCC
NTLVFNGDGDTLIKGSSVAGTGAAISGVVNNSTGPMTIEGISTDGAGVHLFSAEHRIDRI
CEEEEECCCCEEEECCCCCCCCEEEEEEEECCCCCEEEEEECCCCCEEEEEECCCCEEEE
NVTGSSTHAEGLRISGNAAIVDTTLTGKSINGSGVKIDSLPGSSVVTRSVLDNATLNGSS
EEECCCCCCCCEEEECCEEEEEEEECCCCCCCCCEEEECCCCCHHHHHHHHCCCEECCCC
SSGKGVEITSDINGIHHSSINGTATGTGYGINIGENLNVTGTSEADLLILQGVATTGTGT
CCCCCEEEECCCCCEEECCCCCCCCCCEEEEECCCCCEEECCCCCCEEEEEEEEECCCCC
GIKLNGNNDLSNTSLNSSAVDGIALDITGPLANQGNVILNGTASGSGIGAQVNGSLSDSV
EEEECCCCCCCCCCCCCCCCCCEEEEEECCCCCCCCEEEEECCCCCCCCEEECCCCCCCE
VNGTSTNGIGVQINGSLENSRINGISANGSGVKVDGETTLDNATLNGNSSEGKGVDLAAN
ECCCCCCCEEEEEECCCCCCEECEEECCCCEEEECCCCEECCEEECCCCCCCCCEEEEEE
LSGNHGSAVHGDTVNGTGIDVGKDVTLSGGGTDEPLTVSGNASGEKGTGVQLGGNNTLDN
CCCCCCCEEECCCCCCCCEECCCEEEECCCCCCCCEEEECCCCCCCCCEEEECCCCCCCC
TTLSGNATDGTGVDITGPLTNSGNTTLGGKAEKGDGVQLDGAITGGTVNGTSDSGAGIKV
CEECCCCCCCCCEEEECCCCCCCCEEECCCCCCCCCEEECCEEECCEECCCCCCCCEEEE
DGETTLDNATLNGNSSEGKGVDLAANLSGNHGSAVHGDTVNGTGIDVGKDVTLSGGGTDE
CCCCEECCEEECCCCCCCCCEEEEEECCCCCCCEEECCCCCCCCEECCCEEEECCCCCCC
PLTVSGNASGEKGTGVQLGGNNTLDNTTLSGNATDGHGVEINSRLINNGNTTINGRTSDD
CEEEECCCCCCCCCEEEECCCCCCCCCEECCCCCCCCCEEEEEEEEECCCEEEECCCCCC
GHGVHINGAISGGEINGHSDNSHGVFLDESALLNDIVIGGGTGSYKLPVFIALPETIGEH
CCEEEEEEEEECCEECCCCCCCCCEEEECCCCEEEEEEECCCCCEEEEEEEECCCCCCCE
VTLNGKPIDKTQPEGSKAREGDNLTRGKYTPLPPATDPELPPASTDEEKNTKQTSTLTPS
EEECCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
QKREDPDMLIMARNHILSTLEGRDLSSSVVTESEQSAAGVTGIMVCLPLSEASEHEPCDT
CCCCCCCEEEEEECHHHHHCCCCCCCHHHHCCCCCCCCCCEEEEEEEECCCCCCCCCCCE
YILDKGQPHLPMMVKK
EEECCCCCCCCEEEEC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 7815944 [H]