The gene/protein map for NC_005085 is currently unavailable.
Definition Chromobacterium violaceum ATCC 12472 chromosome, complete genome.
Accession NC_005085
Length 4,751,080

Click here to switch to the map view.

The map label for this gene is fhaB [H]

Identifier: 34498327

GI number: 34498327

Start: 3139314

End: 3146435

Strand: Reverse

Name: fhaB [H]

Synonym: CV_2872

Alternate gene names: 34498327

Gene position: 3146435-3139314 (Counterclockwise)

Preceding gene: 34498328

Following gene: 34498326

Centisome position: 66.23

GC content: 64.42

Gene sequence:

>7122_bases
ATGAACAAACACCTTTATCGGATCATCTTCAACCAATCCCGCGGCCAACTGATGGTGGTGCAGGAGGATGCCTGCGGACA
GGGCAAGGGCAATGGCGCCGAGGGCGTCGCCGCTACGCTGGCGGCGGCGTGCAAGGCATTCTCGCTGCGCCTGAGCGTGC
TGCTGATCGGCCTGGGGCTGGGCAGCAGCGCCTTGGCGGCCGACATCATCGCTGATCCCAACGCCGCGGCAGGCAAGCAA
CCGGGCGTGATCCAGTCGGCCAACGGCTTGCCGGTGGTGCAGATCGCTGCGCCGACCGCCGCCGGCGTATCGCACAACCA
GTACCAGCAGTTCAATGTCGGCCCCGGCGGCGCGCTGCTCAACAACAGCGCCACTCTGGTCAATACCCAGCTGGCCGGCT
ACATCAGCGGCAACCCCAATCTGAAGAACGGCAGCGCCCGCATCATCCTCAACGAAGTGACGCAGCCCAATCCGTCGCAG
CTGCGCGGCTATCTGGAAGTGGCCGGCCAGCGCGCGCAGGTGGTGATCGCCAACCCCTGGGGCATCACCTGCAGCGGCTG
CGGCTTCATCAATACTCAGCAGGCCACGCTGACCACCGGCACGCCGCAACTGAACGCCCAGGGCGAGCTGACCGGCTACC
AGGTGGCCGGCGGCCGCGTTAGCATAGACGGCGCCGGCCTCAACGCCGCCAATGTCGACAGCTTCGCCATCATCAGCCGG
GCGGTGTCGATCAACGCCAATCTGTACGCGCAGAAGCTGGACCTGGTGCTGGGCCGCAACCAGGTGGACACCGCCACGCT
GGCGGCCCAGCCGTTGGCGGCCAGCCCGAGCGACGCCCCGGCTTTCGCGCTGGACGTGGCGCAGCTGGGCGGCATGTACG
CCAACGCGATCAAGCTGGTGGGCACCGAGAAGGGGGTTGGCGTCAACCAGCTGGGCACCATGGCGGCCCAGGCTGGCGAT
CTGCAGCTGACCAGCGCCGGCGACCTGGTCCTGCGCGGCCAGACCCACAGTCAGCAGAACCTGATTCTGCAGGCGGATGG
CCAATTGCGACATGACGGCGTCACCCGCGCCGAGGGTTCGATCCAGGCCGATATCGCCGGCCAGACCGCCCTGCACCAGG
CGCTCAGCGCCGGCGGCGACCTTACGTTGAACACAGGCTCGCTGCAGGGGGACGGCGCGCTGGCGGCGGGGGCCCTGGCC
GATGGCAAGCTGACCGAGCACGGCCGGCTGGCGGTGACCAGCGCCGGCGCACTGCAAGCCAGCGGCCAACTGCTGGCCGG
CGGCGACGTCAGTCTGAAGGCTGGCCAGGCCGACCTGTCCCAAGCCACGGTCAGCGCCAGCCACGGCGCGCTGGACATCC
GCGCCGCCGGCGACGTGAACGCGCAGCAGGCCCGGCTGAGCGCTGCCGGCGCCGCCCGACTCACCATCGATGGCCAGCTC
GACAACCGTAGCGGCCAGCTCGCAGCCACCCAGGTCGACCTGCAACTGGGCGCGCTGGACAACAGCCAGGGCAAGATCGT
GCAGAGCGGGCAAGCCGACTCGGCCTGGCGCATCAACGGTTCCACCGATAACCGCCAGGGCGTGCTTGCCAGCGCCGGCC
ATGATCTGAAGCTGCAAAGCGGCAATCTGGACAACCGCGGCGGCGAGATCAGCCATGCCGGCGCCGGCGCGCTGCGCCTG
AGCGCGGACGCGCTCGACAACCGCGAACAGGGCCGCATCGCCAGCGACGGCCGGCTGGACGCGCAGGCGGCACAACTGGA
CAACCGCCAGGGGCGGCTGGTCGGCGTCCTGTCGGCGTCCGTCGACGCGCGCCAGCAGCTGAATAACGAAGGCGGCGTGC
TGGGCAGCGACGGCGCGGTCAAGCTGGGTGCCGGAGGGCTCGACAACGGTGCCGGCTTGATCCAGTCCGGTCAGGACCTG
CAGCTCACGGCTAATAGCCTCACCAACGCCGACAAAGGCCAAATCCTGGCCCTCGGCAAAGACGCGGCGAGCAAGGTGGA
TGTCAGCGGCGAGCTGCACAACCAGGGCAAAGTCGCCGGCAACGCCGATCTGACCGTCAACGCCGCCAGCATCGACAACA
GCAAGGGCACGCTGCAGGCGGCGGCTGGCTTGAATCTGACCAAGCAAACCAGCCTCACCAACGACGGCGGCCACATTGCA
AGTCAGAGCCTGAAACTGAACGCCGACAGCCTGAGCAACCAGGCGGGCGAGATCTACGCCCAGCAGCAACTGAGCAGCCA
ACTGAAGACCCTCGACAATGCCAAGGGCAGCGTCATCGGCGGCCAAGGCGTCGACCTGACGGTGACCGACCAGTTGCATA
ACGATGGCGTGGTCGGCAGCGACGGCCAAGTGAAGCTGACCGCCGGCGCGCTTGAGAACGCCGCCGGCACCATCCAATCC
GGCAAGGACCTGCAACTGACCGCCGCGTCGCTGACCAACGCCGACAAGGGCCAGATACTGGCCCTCGGCAAAGACGCGGC
GAGCAAGGTGGATGTCAGCGGCGAGCTGCACAACCAGGGCAAGCTGGCCGGTAACGCCGACCTGACCGTCAACGCGGCGA
CGATTGATAACGCCAAGGGCACCTTGCAGGCAGCGAACCATCTGGAGTTGAACAAGCAAAGCAGCCTGACCAACGATGAC
GGCCACATCGCTGGCCAGAGTTTGACGCTGAAGGCCGATTCGCTCAGCAATAAGAGCGGCGAACTGTACGCTCAGGGCCA
GCTCACCAGCCAACTGAAGACGCTCGACAACAGCCAAGGCAGCCTGATCGGCGGCCAAGGCGTCGACCTGACGGTGGCCG
ACAGCCTGCATAACGACGGCGTGGTCGGCAGCGATGGCCAAGTCAAACTCAATGCCGGCGCGCTGGAGAATGCCGCTGGC
ACGATTCAATCGGGGAAAGATTTACAGCTCACGGCGTCAAGTCTGACGAATGCTGACAAAGGCCAGATTCTGGCGCTGGG
CAAGGACGCCGCCAGCACTGTTGACGTCAGCGGCGAGCTGCACAACCAGGGCAAAGTCGCCGGCAACGCCGATCTGACCG
TCAACGCCGCCAGCATCGACAACAGCAAGGGCACGCTGCAGGCGGCGGCTGGCTTGAATCTGACCAAGCAAAGCAGCCTG
ATCAATGACGGCGGCCATATTACCAGCCAGAGCCTGAAACTGAACGCCGACTCGCTCAGCAACCAGGCGGGCGAGATCTA
TGCCCAGCAGCAACTCACCAGCCAGTTGAAGACCCTCGACAATGCCAAGGGCAGCGTCATCGGCGGCCAGGGTGTCGACC
TGACGGTGACCGACAGCCTGCGCAACGACGGCGTGGTCGGCAGCGACGGCCAAGTGAAGCTGACCGCCGGCGCGCTTGAG
AACGCCGCCGGCACCATCCAATCCGGCAAGGACCTGCAACTGACCGCCGCGTCGCTGACCAACGCCAACAAGGGCCAGAT
CCTGGCGTTGGGCAAGGATGCCGCCAGCAAGGTGGACGTCAGCGGTGAGCTGCACAACCAAGGCAAGTTGGCCGGTAACG
CCGACCTGACCGTCAATGCCGCCAGCATCGACAACAGCAAGGGCACGCTGCAGGCGGCCAGCCATCTGGAGTTGAGCAAG
CAAAGCAGCCTCACCAACGATGGCGGCCACATCGCCGGCCAGAGTTTGATGCTGAACGCCGACAGCCTGAGCAACCAGGC
CGGCGAGATCTACGCCCAGCAGCAGCTGAGCAGCACGCTGAAGACGCTGAACAATGCCCAAGGCAGCCTGATCGGCGGCC
AGGGTGTCGACCTGACGGTTTTTGACCAGTTGCATAACGATGGTGTGCTGGGCAGCGACGGCCAAGTGAAGCTGAGCGCC
GGCACGCTGGAGAACGCCGCCGGCACCATCCAGTCCGGCAAGGACCTGCAGCTTACCGCTAGTAGCCTGAGCAACGCCGA
CAAGGGCCAGATCCTGGTGTTGGGTAAGGATGCCGCCAGCAAGGTGGACGTCAGCGGTGAGCTACACAACCAAGGCAAGT
TGGCCGGCAATGCCGATTTGACCGTCAACGCGGCCAGCATCGACAACAGCAAGGGCACGCTGCAGGCGGCGGCTGGCTTG
AATCTGACCAAGCAAAGCAGCCTGATCAATGACGGCGGCCATATTACCAGCCAGAGCCTGAAACTGAACGCCGACTCGCT
CAGCAACCAGGCGGGCGAGATCTATGCCCAGCAGCAACTCACCAGCCAGCTGAAGACCCTCGACAATGCCAAGGGCAGCG
TCATCGGCGGCCAGGGTGTCGACCTGACGGTGACCGACAGCCTGCGCAACGACGGCGTGGTCGGCAGCGACGGCCAAGTG
AAGCTGACCGCCGGCGCGCTTGAGAACGCCGCCGGCACCATCCAATCCGGCAAGGACCTGCAACTGACCGCCGCGTCGCT
GACCAACGCCAACAAGGGCCAGATCCTGGCGTTGGGCAAGGATGCCGCCAGCAAGGTGGACGTCAGCGGTGAGCTGCACA
ACCAAGGCAAGTTGGCCGGTAACGCCGACCTGACCGTCAATGCCGCCAGCATCGACAACAGCAAGGGTACGCTGCAAGCG
GCCAGCCATCTGGAGTTGAGCAAGCAAAGCAGCCTCACCAACGATGGCGGCCACATCGCCGGCCAGAGTTTGATGCTGAA
CGCCGACAGCCTGAGCAACCAGGCCGGCGAGATCTACGCCCAGCAGCAGCTGAGCAGCACGCTGAAGACGCTGAACAATG
CCCAAGGCAGCCTGATCGGCGGCCAGGGTGTCGACCTGACGGTTTTTGACCAGTTGCATAACGATGGTGTGCTGGGCAGC
GACGGCCAAGTGAAGCTGAGCGCCGGCACGCTGGAGAACGCCGCCGGCACCATCCAGTCCGGCAAGGACCTGCAGCTTAC
CGCTAGTAGCCTGAGCAACGCCGACAAGGGCCAGATCCTGGTGTTGGGTAAGGATGCCGCCAGCAAGGTGGACGTCAGCG
GTGAGCTACACAACCAAGGCAAGTTGGCCGGCAATGCCGATTTGACCGTCAACGCGGCCAGCATCGACAACAGCAAGGGC
ACGCTGCAAGCGGCCAGCCATCTGGAGCTGAGCAAGCAAACCAGCTTGATCAACGACGGCGGCCACATTGCAAGTCAGAG
CCTGAAACTGAACGCCGACAGCCTGAGCAACCAGACGGGCGAGATCTACGCCCAGCAGCAACTGAGCAGCCAACTGAAGA
CCCTCGACAATGCCAAGGGCAGCGTCATCGGCGGCCAAGGCGTCGACCTGACGGTGACCGACCAGTTGCATAACGATGGC
GTGGTCGGCAGCGACGGCCAAGTGAAATTGAGCGTCGGCACGCTGGAGAACGCCGCCGGCACCATCCAATCCGGCAAGGA
CCTGCAACTGAGCGCATCGTCGCTGACCAACGCCGATAAAGGCCAGATTCTCGCCCTGGGCAAAGACGCGGCGAGCAAGG
TGGGTGTCAGCGGCGAGCTGCGCAACCAGGGCAAGCTGGCCGGCAATGCCGATCTGACCGTCAACGCGGCGAGCATTGAC
AACAGCAAGGGCACGCTGCAGGCGGCTAGTCATCTGGAGCTGTCGAAACAATCCAGCCTGATCAACGACGGTGGGCATAT
CGCTGGCCAGAGCCTGAAACTGAATGCCGACAGCCTGAGCAACCAGGCCGGCGAGATCTACGCCCAGCAGCAGTTGAGCA
GCACGCTGAAGACGCTGAACAATGCCCAAGGCAGCCTGATCGGCGGCCAAGGCGTCGACCTGACGGTGGCCGACAGCCTG
CATAACGACGGCGTGGTAGGCAGCGATGGCCAAGTCAAACTCAATGCCGGCGCGCTGGAGAATGCCGCTGGCACGATTCA
ATCGGGGAAAGATTTACAGCTCACGGCGTCAAGTCTGACGAATGCTGACAAAGGCCAGATTCTGGCGCTGGGCAAGGACG
CCGCCAGCACTGTTGACGTCAGCGGCGAGCTGCATAACCAGGGCAAAGTCGCCGGCAACGCCGATCTGACCGTCAACGCC
GCCAGCATCGACAACAGCAAGGGCACGCTGCAGGCGGCGGCTGGCTTGAATCTGACCAAGCAAAGCAGCCTGATCAATGA
CGGCGGCCATATTACCAGCCAGAGCCTGAAACTGAACGCCGACTCGCTCAGCAACCAGGCGGGCGAGATCTACGCCCAGC
AGCAACTGAGCAGCCAACTGAAGACCCTCGACAATGCCAAGGGCAGCGTCATCGGCGGCCAAGGCGTCGACCTGACGGTG
ACCGACCAGTTGCATAACGATGGCGTGGTCGGCAGCGACGGCCAAGTGAAGCTGACCGCCGGCGCGCTTGAGAACGCCGC
CGGCACCATCCAATCCGGCAAGGACCTGCAACTGACCGCCGCGTCGCTGACCAATGCCGAAAAAGGCCAGATTCTCGCCC
TGGGCAAAGACGCGGCGAGCAAGGTGGATGTCAGCGGCGAGCTGCACAACCAGGGCAAGCTGGCCGGTAACGCCGACCTG
ACCGTCAACGCGGCGACGATTGATAACGCCAAGGGCACCTTGCAGGCAGCGAACCATCTGGAGTTGAGCAAGCAAAGCAG
CCTGACCAACGATGACGGCCACATCGCTGGCCAGAGTTTGACGCTGAAGGCCGATTCGCTGAGCAATAAGAGCGGCGAAC
TGTACGCTCAGGGCCAGCTCACCAGCCAACTGAAGACGCTCGACAACAGCCAAGGCAGCCTGATCGGCGGCCAAGGCGTC
GACCTGACGGTGGCCGACAGCCTGCATAACGACGGCGTGGTAGGCAGCGACGGCCAAGTGAAGCTGAGCGCCGGCACGCT
GGACAATGCCGCCGGCACCATCCAATCCGGCAAGGACCTGCAACTGACCGCCGCGTCGCTGACCAACGCCGACAAGGGCC
AGATCCTGGCGTTGGGCAAGGATGCCGCCAGCACTGTTGACGTCAGCGGTGAGCTGCACAACCAAGGCAAGTTGGCCGGC
AACGCCGATCTGACCGTCAACGCGGCGAGCATTGACAACAGCAAGGGCACGCTGCAGGCGGCTAGTCATCTGGAGCTGTC
GAAACAATCCAGCCTGATCAACGACGGCGGCCATATCGCCGGCCAGAGTTTGAAGCTGAACGCCGACAGCCTGAGCAACT
AG

Upstream 100 bases:

>100_bases
GCACCAGCCGCAGGGCTGGGATCGTCCCGCCATCACCCATTTCTCGATCACCGCGCAGTGGTGAGCCCGCTGCCCTGTCC
CGTCTTATTGAGCTGACATC

Downstream 100 bases:

>100_bases
GCGGGCGAGATCTACGCCCAGCAGCAACTGACGAGCCAACTGAAGAGCCTGGATAACCGCCAAGGCAGCTTGATCGGCGG
CCAGGGTGTCGACCTCACCG

Product: hemagglutinin

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 2373; Mature: 2373

Protein sequence:

>2373_residues
MNKHLYRIIFNQSRGQLMVVQEDACGQGKGNGAEGVAATLAAACKAFSLRLSVLLIGLGLGSSALAADIIADPNAAAGKQ
PGVIQSANGLPVVQIAAPTAAGVSHNQYQQFNVGPGGALLNNSATLVNTQLAGYISGNPNLKNGSARIILNEVTQPNPSQ
LRGYLEVAGQRAQVVIANPWGITCSGCGFINTQQATLTTGTPQLNAQGELTGYQVAGGRVSIDGAGLNAANVDSFAIISR
AVSINANLYAQKLDLVLGRNQVDTATLAAQPLAASPSDAPAFALDVAQLGGMYANAIKLVGTEKGVGVNQLGTMAAQAGD
LQLTSAGDLVLRGQTHSQQNLILQADGQLRHDGVTRAEGSIQADIAGQTALHQALSAGGDLTLNTGSLQGDGALAAGALA
DGKLTEHGRLAVTSAGALQASGQLLAGGDVSLKAGQADLSQATVSASHGALDIRAAGDVNAQQARLSAAGAARLTIDGQL
DNRSGQLAATQVDLQLGALDNSQGKIVQSGQADSAWRINGSTDNRQGVLASAGHDLKLQSGNLDNRGGEISHAGAGALRL
SADALDNREQGRIASDGRLDAQAAQLDNRQGRLVGVLSASVDARQQLNNEGGVLGSDGAVKLGAGGLDNGAGLIQSGQDL
QLTANSLTNADKGQILALGKDAASKVDVSGELHNQGKVAGNADLTVNAASIDNSKGTLQAAAGLNLTKQTSLTNDGGHIA
SQSLKLNADSLSNQAGEIYAQQQLSSQLKTLDNAKGSVIGGQGVDLTVTDQLHNDGVVGSDGQVKLTAGALENAAGTIQS
GKDLQLTAASLTNADKGQILALGKDAASKVDVSGELHNQGKLAGNADLTVNAATIDNAKGTLQAANHLELNKQSSLTNDD
GHIAGQSLTLKADSLSNKSGELYAQGQLTSQLKTLDNSQGSLIGGQGVDLTVADSLHNDGVVGSDGQVKLNAGALENAAG
TIQSGKDLQLTASSLTNADKGQILALGKDAASTVDVSGELHNQGKVAGNADLTVNAASIDNSKGTLQAAAGLNLTKQSSL
INDGGHITSQSLKLNADSLSNQAGEIYAQQQLTSQLKTLDNAKGSVIGGQGVDLTVTDSLRNDGVVGSDGQVKLTAGALE
NAAGTIQSGKDLQLTAASLTNANKGQILALGKDAASKVDVSGELHNQGKLAGNADLTVNAASIDNSKGTLQAASHLELSK
QSSLTNDGGHIAGQSLMLNADSLSNQAGEIYAQQQLSSTLKTLNNAQGSLIGGQGVDLTVFDQLHNDGVLGSDGQVKLSA
GTLENAAGTIQSGKDLQLTASSLSNADKGQILVLGKDAASKVDVSGELHNQGKLAGNADLTVNAASIDNSKGTLQAAAGL
NLTKQSSLINDGGHITSQSLKLNADSLSNQAGEIYAQQQLTSQLKTLDNAKGSVIGGQGVDLTVTDSLRNDGVVGSDGQV
KLTAGALENAAGTIQSGKDLQLTAASLTNANKGQILALGKDAASKVDVSGELHNQGKLAGNADLTVNAASIDNSKGTLQA
ASHLELSKQSSLTNDGGHIAGQSLMLNADSLSNQAGEIYAQQQLSSTLKTLNNAQGSLIGGQGVDLTVFDQLHNDGVLGS
DGQVKLSAGTLENAAGTIQSGKDLQLTASSLSNADKGQILVLGKDAASKVDVSGELHNQGKLAGNADLTVNAASIDNSKG
TLQAASHLELSKQTSLINDGGHIASQSLKLNADSLSNQTGEIYAQQQLSSQLKTLDNAKGSVIGGQGVDLTVTDQLHNDG
VVGSDGQVKLSVGTLENAAGTIQSGKDLQLSASSLTNADKGQILALGKDAASKVGVSGELRNQGKLAGNADLTVNAASID
NSKGTLQAASHLELSKQSSLINDGGHIAGQSLKLNADSLSNQAGEIYAQQQLSSTLKTLNNAQGSLIGGQGVDLTVADSL
HNDGVVGSDGQVKLNAGALENAAGTIQSGKDLQLTASSLTNADKGQILALGKDAASTVDVSGELHNQGKVAGNADLTVNA
ASIDNSKGTLQAAAGLNLTKQSSLINDGGHITSQSLKLNADSLSNQAGEIYAQQQLSSQLKTLDNAKGSVIGGQGVDLTV
TDQLHNDGVVGSDGQVKLTAGALENAAGTIQSGKDLQLTAASLTNAEKGQILALGKDAASKVDVSGELHNQGKLAGNADL
TVNAATIDNAKGTLQAANHLELSKQSSLTNDDGHIAGQSLTLKADSLSNKSGELYAQGQLTSQLKTLDNSQGSLIGGQGV
DLTVADSLHNDGVVGSDGQVKLSAGTLDNAAGTIQSGKDLQLTAASLTNADKGQILALGKDAASTVDVSGELHNQGKLAG
NADLTVNAASIDNSKGTLQAASHLELSKQSSLINDGGHIAGQSLKLNADSLSN

Sequences:

>Translated_2373_residues
MNKHLYRIIFNQSRGQLMVVQEDACGQGKGNGAEGVAATLAAACKAFSLRLSVLLIGLGLGSSALAADIIADPNAAAGKQ
PGVIQSANGLPVVQIAAPTAAGVSHNQYQQFNVGPGGALLNNSATLVNTQLAGYISGNPNLKNGSARIILNEVTQPNPSQ
LRGYLEVAGQRAQVVIANPWGITCSGCGFINTQQATLTTGTPQLNAQGELTGYQVAGGRVSIDGAGLNAANVDSFAIISR
AVSINANLYAQKLDLVLGRNQVDTATLAAQPLAASPSDAPAFALDVAQLGGMYANAIKLVGTEKGVGVNQLGTMAAQAGD
LQLTSAGDLVLRGQTHSQQNLILQADGQLRHDGVTRAEGSIQADIAGQTALHQALSAGGDLTLNTGSLQGDGALAAGALA
DGKLTEHGRLAVTSAGALQASGQLLAGGDVSLKAGQADLSQATVSASHGALDIRAAGDVNAQQARLSAAGAARLTIDGQL
DNRSGQLAATQVDLQLGALDNSQGKIVQSGQADSAWRINGSTDNRQGVLASAGHDLKLQSGNLDNRGGEISHAGAGALRL
SADALDNREQGRIASDGRLDAQAAQLDNRQGRLVGVLSASVDARQQLNNEGGVLGSDGAVKLGAGGLDNGAGLIQSGQDL
QLTANSLTNADKGQILALGKDAASKVDVSGELHNQGKVAGNADLTVNAASIDNSKGTLQAAAGLNLTKQTSLTNDGGHIA
SQSLKLNADSLSNQAGEIYAQQQLSSQLKTLDNAKGSVIGGQGVDLTVTDQLHNDGVVGSDGQVKLTAGALENAAGTIQS
GKDLQLTAASLTNADKGQILALGKDAASKVDVSGELHNQGKLAGNADLTVNAATIDNAKGTLQAANHLELNKQSSLTNDD
GHIAGQSLTLKADSLSNKSGELYAQGQLTSQLKTLDNSQGSLIGGQGVDLTVADSLHNDGVVGSDGQVKLNAGALENAAG
TIQSGKDLQLTASSLTNADKGQILALGKDAASTVDVSGELHNQGKVAGNADLTVNAASIDNSKGTLQAAAGLNLTKQSSL
INDGGHITSQSLKLNADSLSNQAGEIYAQQQLTSQLKTLDNAKGSVIGGQGVDLTVTDSLRNDGVVGSDGQVKLTAGALE
NAAGTIQSGKDLQLTAASLTNANKGQILALGKDAASKVDVSGELHNQGKLAGNADLTVNAASIDNSKGTLQAASHLELSK
QSSLTNDGGHIAGQSLMLNADSLSNQAGEIYAQQQLSSTLKTLNNAQGSLIGGQGVDLTVFDQLHNDGVLGSDGQVKLSA
GTLENAAGTIQSGKDLQLTASSLSNADKGQILVLGKDAASKVDVSGELHNQGKLAGNADLTVNAASIDNSKGTLQAAAGL
NLTKQSSLINDGGHITSQSLKLNADSLSNQAGEIYAQQQLTSQLKTLDNAKGSVIGGQGVDLTVTDSLRNDGVVGSDGQV
KLTAGALENAAGTIQSGKDLQLTAASLTNANKGQILALGKDAASKVDVSGELHNQGKLAGNADLTVNAASIDNSKGTLQA
ASHLELSKQSSLTNDGGHIAGQSLMLNADSLSNQAGEIYAQQQLSSTLKTLNNAQGSLIGGQGVDLTVFDQLHNDGVLGS
DGQVKLSAGTLENAAGTIQSGKDLQLTASSLSNADKGQILVLGKDAASKVDVSGELHNQGKLAGNADLTVNAASIDNSKG
TLQAASHLELSKQTSLINDGGHIASQSLKLNADSLSNQTGEIYAQQQLSSQLKTLDNAKGSVIGGQGVDLTVTDQLHNDG
VVGSDGQVKLSVGTLENAAGTIQSGKDLQLSASSLTNADKGQILALGKDAASKVGVSGELRNQGKLAGNADLTVNAASID
NSKGTLQAASHLELSKQSSLINDGGHIAGQSLKLNADSLSNQAGEIYAQQQLSSTLKTLNNAQGSLIGGQGVDLTVADSL
HNDGVVGSDGQVKLNAGALENAAGTIQSGKDLQLTASSLTNADKGQILALGKDAASTVDVSGELHNQGKVAGNADLTVNA
ASIDNSKGTLQAAAGLNLTKQSSLINDGGHITSQSLKLNADSLSNQAGEIYAQQQLSSQLKTLDNAKGSVIGGQGVDLTV
TDQLHNDGVVGSDGQVKLTAGALENAAGTIQSGKDLQLTAASLTNAEKGQILALGKDAASKVDVSGELHNQGKLAGNADL
TVNAATIDNAKGTLQAANHLELSKQSSLTNDDGHIAGQSLTLKADSLSNKSGELYAQGQLTSQLKTLDNSQGSLIGGQGV
DLTVADSLHNDGVVGSDGQVKLSAGTLDNAAGTIQSGKDLQLTAASLTNADKGQILALGKDAASTVDVSGELHNQGKLAG
NADLTVNAASIDNSKGTLQAASHLELSKQSSLINDGGHIAGQSLKLNADSLSN
>Mature_2373_residues
MNKHLYRIIFNQSRGQLMVVQEDACGQGKGNGAEGVAATLAAACKAFSLRLSVLLIGLGLGSSALAADIIADPNAAAGKQ
PGVIQSANGLPVVQIAAPTAAGVSHNQYQQFNVGPGGALLNNSATLVNTQLAGYISGNPNLKNGSARIILNEVTQPNPSQ
LRGYLEVAGQRAQVVIANPWGITCSGCGFINTQQATLTTGTPQLNAQGELTGYQVAGGRVSIDGAGLNAANVDSFAIISR
AVSINANLYAQKLDLVLGRNQVDTATLAAQPLAASPSDAPAFALDVAQLGGMYANAIKLVGTEKGVGVNQLGTMAAQAGD
LQLTSAGDLVLRGQTHSQQNLILQADGQLRHDGVTRAEGSIQADIAGQTALHQALSAGGDLTLNTGSLQGDGALAAGALA
DGKLTEHGRLAVTSAGALQASGQLLAGGDVSLKAGQADLSQATVSASHGALDIRAAGDVNAQQARLSAAGAARLTIDGQL
DNRSGQLAATQVDLQLGALDNSQGKIVQSGQADSAWRINGSTDNRQGVLASAGHDLKLQSGNLDNRGGEISHAGAGALRL
SADALDNREQGRIASDGRLDAQAAQLDNRQGRLVGVLSASVDARQQLNNEGGVLGSDGAVKLGAGGLDNGAGLIQSGQDL
QLTANSLTNADKGQILALGKDAASKVDVSGELHNQGKVAGNADLTVNAASIDNSKGTLQAAAGLNLTKQTSLTNDGGHIA
SQSLKLNADSLSNQAGEIYAQQQLSSQLKTLDNAKGSVIGGQGVDLTVTDQLHNDGVVGSDGQVKLTAGALENAAGTIQS
GKDLQLTAASLTNADKGQILALGKDAASKVDVSGELHNQGKLAGNADLTVNAATIDNAKGTLQAANHLELNKQSSLTNDD
GHIAGQSLTLKADSLSNKSGELYAQGQLTSQLKTLDNSQGSLIGGQGVDLTVADSLHNDGVVGSDGQVKLNAGALENAAG
TIQSGKDLQLTASSLTNADKGQILALGKDAASTVDVSGELHNQGKVAGNADLTVNAASIDNSKGTLQAAAGLNLTKQSSL
INDGGHITSQSLKLNADSLSNQAGEIYAQQQLTSQLKTLDNAKGSVIGGQGVDLTVTDSLRNDGVVGSDGQVKLTAGALE
NAAGTIQSGKDLQLTAASLTNANKGQILALGKDAASKVDVSGELHNQGKLAGNADLTVNAASIDNSKGTLQAASHLELSK
QSSLTNDGGHIAGQSLMLNADSLSNQAGEIYAQQQLSSTLKTLNNAQGSLIGGQGVDLTVFDQLHNDGVLGSDGQVKLSA
GTLENAAGTIQSGKDLQLTASSLSNADKGQILVLGKDAASKVDVSGELHNQGKLAGNADLTVNAASIDNSKGTLQAAAGL
NLTKQSSLINDGGHITSQSLKLNADSLSNQAGEIYAQQQLTSQLKTLDNAKGSVIGGQGVDLTVTDSLRNDGVVGSDGQV
KLTAGALENAAGTIQSGKDLQLTAASLTNANKGQILALGKDAASKVDVSGELHNQGKLAGNADLTVNAASIDNSKGTLQA
ASHLELSKQSSLTNDGGHIAGQSLMLNADSLSNQAGEIYAQQQLSSTLKTLNNAQGSLIGGQGVDLTVFDQLHNDGVLGS
DGQVKLSAGTLENAAGTIQSGKDLQLTASSLSNADKGQILVLGKDAASKVDVSGELHNQGKLAGNADLTVNAASIDNSKG
TLQAASHLELSKQTSLINDGGHIASQSLKLNADSLSNQTGEIYAQQQLSSQLKTLDNAKGSVIGGQGVDLTVTDQLHNDG
VVGSDGQVKLSVGTLENAAGTIQSGKDLQLSASSLTNADKGQILALGKDAASKVGVSGELRNQGKLAGNADLTVNAASID
NSKGTLQAASHLELSKQSSLINDGGHIAGQSLKLNADSLSNQAGEIYAQQQLSSTLKTLNNAQGSLIGGQGVDLTVADSL
HNDGVVGSDGQVKLNAGALENAAGTIQSGKDLQLTASSLTNADKGQILALGKDAASTVDVSGELHNQGKVAGNADLTVNA
ASIDNSKGTLQAAAGLNLTKQSSLINDGGHITSQSLKLNADSLSNQAGEIYAQQQLSSQLKTLDNAKGSVIGGQGVDLTV
TDQLHNDGVVGSDGQVKLTAGALENAAGTIQSGKDLQLTAASLTNAEKGQILALGKDAASKVDVSGELHNQGKLAGNADL
TVNAATIDNAKGTLQAANHLELSKQSSLTNDDGHIAGQSLTLKADSLSNKSGELYAQGQLTSQLKTLDNSQGSLIGGQGV
DLTVADSLHNDGVVGSDGQVKLSAGTLDNAAGTIQSGKDLQLTAASLTNADKGQILALGKDAASTVDVSGELHNQGKLAG
NADLTVNAASIDNSKGTLQAASHLELSKQSSLINDGGHIAGQSLKLNADSLSN

Specific function: Evidence for a role in host-cell binding and infection [H]

COG id: COG3210

COG function: function code U; Large exoproteins involved in heme utilization or adhesion

Gene ontology:

Cell location: Cell surface [H]

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR010069
- InterPro:   IPR008619
- InterPro:   IPR008638
- InterPro:   IPR012334
- InterPro:   IPR011050
- InterPro:   IPR011102 [H]

Pfam domain/function: PF05594 Fil_haemagg; PF05860 Haemagg_act [H]

EC number: NA

Molecular weight: Translated: 238797; Mature: 238797

Theoretical pI: Translated: 4.86; Mature: 4.86

Prosite motif: PS00107 PROTEIN_KINASE_ATP

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.2 %Cys     (Translated Protein)
0.3 %Met     (Translated Protein)
0.4 %Cys+Met (Translated Protein)
0.2 %Cys     (Mature Protein)
0.3 %Met     (Mature Protein)
0.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MNKHLYRIIFNQSRGQLMVVQEDACGQGKGNGAEGVAATLAAACKAFSLRLSVLLIGLGL
CCCEEEEEEEECCCCEEEEEECCCCCCCCCCCCCHHHHHHHHHHHHHHHEEEEEEEEECC
GSSALAADIIADPNAAAGKQPGVIQSANGLPVVQIAAPTAAGVSHNQYQQFNVGPGGALL
CCHHHEEHEECCCCCCCCCCCCEEECCCCCEEEEEECCCCCCCCCCCCEEECCCCCCEEE
NNSATLVNTQLAGYISGNPNLKNGSARIILNEVTQPNPSQLRGYLEVAGQRAQVVIANPW
CCCCEEEEEEEEEEECCCCCCCCCCEEEEEECCCCCCHHHHHHHHHHCCCCEEEEEECCC
GITCSGCGFINTQQATLTTGTPQLNAQGELTGYQVAGGRVSIDGAGLNAANVDSFAIISR
CCEECCCCCCCCCCEEEECCCCCCCCCCCCCEEEEECCEEEECCCCCCCCCCCHHEEEEE
AVSINANLYAQKLDLVLGRNQVDTATLAAQPLAASPSDAPAFALDVAQLGGMYANAIKLV
EEEECCEEEEEEEHHEECCCCCCCHHEECCCCCCCCCCCCCCEEEHHHHCCCEEEEEEEE
GTEKGVGVNQLGTMAAQAGDLQLTSAGDLVLRGQTHSQQNLILQADGQLRHDGVTRAEGS
ECCCCCCHHHHHHHHHCCCCEEEECCCCEEEECCCCCCCCEEEEECCCCCCCCCCCCCCC
IQADIAGQTALHQALSAGGDLTLNTGSLQGDGALAAGALADGKLTEHGRLAVTSAGALQA
EEEECCCHHHHHHHHHCCCCEEEECCCCCCCCCEEECCCCCCCCCCCCEEEEEECCCEEC
SGQLLAGGDVSLKAGQADLSQATVSASHGALDIRAAGDVNAQQARLSAAGAARLTIDGQL
CCCEEECCCEEEECCCCCHHHHEEECCCCEEEEEECCCCCHHHHHHHHCCEEEEEEECEE
DNRSGQLAATQVDLQLGALDNSQGKIVQSGQADSAWRINGSTDNRQGVLASAGHDLKLQS
CCCCCCEEEEEEEEEEECCCCCCCCEEECCCCCCEEEECCCCCCCCCEEEECCCCEEEEC
GNLDNRGGEISHAGAGALRLSADALDNREQGRIASDGRLDAQAAQLDNRQGRLVGVLSAS
CCCCCCCCEEECCCCCEEEEEHHHCCCCCCCCCCCCCCCCHHHHHCCCCCCCEEEEEECC
VDARQQLNNEGGVLGSDGAVKLGAGGLDNGAGLIQSGQDLQLTANSLTNADKGQILALGK
HHHHHHHCCCCCEECCCCCEEECCCCCCCCCCHHCCCCCEEEEEHHCCCCCCCCEEEECC
DAASKVDVSGELHNQGKVAGNADLTVNAASIDNSKGTLQAAAGLNLTKQTSLTNDGGHIA
CCCCEEECCCCCCCCCCCCCCCCEEEEEEECCCCCCEEEEECCCCEEECCCCCCCCCCEE
SQSLKLNADSLSNQAGEIYAQQQLSSQLKTLDNAKGSVIGGQGVDLTVTDQLHNDGVVGS
CCEEEEEHHHHCCCHHHHHHHHHHHHHHHHHCCCCCCEECCCCCEEEEECCCCCCCEECC
DGQVKLTAGALENAAGTIQSGKDLQLTAASLTNADKGQILALGKDAASKVDVSGELHNQG
CCCEEEEECCCCCCCCCCCCCCCEEEEEEECCCCCCCCEEEECCCCCCEEECCCCCCCCC
KLAGNADLTVNAATIDNAKGTLQAANHLELNKQSSLTNDDGHIAGQSLTLKADSLSNKSG
CCCCCCCEEEEEEEECCCCCCEEECCEEECCCCCCCCCCCCEECCCEEEEEECCCCCCCC
ELYAQGQLTSQLKTLDNSQGSLIGGQGVDLTVADSLHNDGVVGSDGQVKLNAGALENAAG
CEEECCCHHHHHHHHCCCCCCEECCCCCEEEEECCCCCCCEECCCCEEEEECCCCCCCCC
TIQSGKDLQLTASSLTNADKGQILALGKDAASTVDVSGELHNQGKVAGNADLTVNAASID
CCCCCCCEEEEHHHCCCCCCCCEEEECCCCCCEEECCCCCCCCCCCCCCCCEEEEEEECC
NSKGTLQAAAGLNLTKQSSLINDGGHITSQSLKLNADSLSNQAGEIYAQQQLTSQLKTLD
CCCCEEEEECCCCEEHHCCEECCCCCEECCEEEEEHHHHCCCHHHHHHHHHHHHHHHHHC
NAKGSVIGGQGVDLTVTDSLRNDGVVGSDGQVKLTAGALENAAGTIQSGKDLQLTAASLT
CCCCCEECCCCCEEEEECCCCCCCEECCCCCEEEEECCCCCCCCCCCCCCCEEEEEEECC
NANKGQILALGKDAASKVDVSGELHNQGKLAGNADLTVNAASIDNSKGTLQAASHLELSK
CCCCCEEEEECCCCCCEEECCCCCCCCCCCCCCCCEEEEEEECCCCCCCEEHHHHHHHHH
QSSLTNDGGHIAGQSLMLNADSLSNQAGEIYAQQQLSSTLKTLNNAQGSLIGGQGVDLTV
HCCCCCCCCEEECCEEEEEHHHCCCCHHHHHHHHHHHHHHHHHHCCCCCEECCCCCEEEE
FDQLHNDGVLGSDGQVKLSAGTLENAAGTIQSGKDLQLTASSLSNADKGQILVLGKDAAS
EECCCCCCEECCCCEEEEECCCCCCCCCCCCCCCCEEEEHHHCCCCCCCEEEEEECCCCC
KVDVSGELHNQGKLAGNADLTVNAASIDNSKGTLQAAAGLNLTKQSSLINDGGHITSQSL
EEECCCCCCCCCCCCCCCCEEEEEEECCCCCCEEEEECCCCEEHHCCEECCCCCEECCEE
KLNADSLSNQAGEIYAQQQLTSQLKTLDNAKGSVIGGQGVDLTVTDSLRNDGVVGSDGQV
EEEHHHHCCCHHHHHHHHHHHHHHHHHCCCCCCEECCCCCEEEEECCCCCCCEECCCCCE
KLTAGALENAAGTIQSGKDLQLTAASLTNANKGQILALGKDAASKVDVSGELHNQGKLAG
EEEECCCCCCCCCCCCCCCEEEEEEECCCCCCCEEEEECCCCCCEEECCCCCCCCCCCCC
NADLTVNAASIDNSKGTLQAASHLELSKQSSLTNDGGHIAGQSLMLNADSLSNQAGEIYA
CCCEEEEEEECCCCCCCEEHHHHHHHHHHCCCCCCCCEEECCEEEEEHHHCCCCHHHHHH
QQQLSSTLKTLNNAQGSLIGGQGVDLTVFDQLHNDGVLGSDGQVKLSAGTLENAAGTIQS
HHHHHHHHHHHHCCCCCEECCCCCEEEEEECCCCCCEECCCCEEEEECCCCCCCCCCCCC
GKDLQLTASSLSNADKGQILVLGKDAASKVDVSGELHNQGKLAGNADLTVNAASIDNSKG
CCCEEEEHHHCCCCCCCEEEEEECCCCCEEECCCCCCCCCCCCCCCCEEEEEEECCCCCC
TLQAASHLELSKQTSLINDGGHIASQSLKLNADSLSNQTGEIYAQQQLSSQLKTLDNAKG
CEEHHHHHHHHHHHCEECCCCCEECCEEEEEHHHCCCCCCCEEEHHHHHHHHHHHCCCCC
SVIGGQGVDLTVTDQLHNDGVVGSDGQVKLSVGTLENAAGTIQSGKDLQLSASSLTNADK
CEECCCCCEEEEECCCCCCCEECCCCEEEEEECCCCCCCCCCCCCCCEEEEHHHCCCCCC
GQILALGKDAASKVGVSGELRNQGKLAGNADLTVNAASIDNSKGTLQAASHLELSKQSSL
CCEEEECCCCHHHCCCCCCCCCCCCCCCCCCEEEEEEECCCCCCCEEHHHHHHHHHHHCC
INDGGHIAGQSLKLNADSLSNQAGEIYAQQQLSSTLKTLNNAQGSLIGGQGVDLTVADSL
CCCCCCCCCCEEEEEHHHHCCCHHHHHHHHHHHHHHHHHHCCCCCEECCCCCEEEEECCC
HNDGVVGSDGQVKLNAGALENAAGTIQSGKDLQLTASSLTNADKGQILALGKDAASTVDV
CCCCEECCCCEEEEECCCCCCCCCCCCCCCCEEEEHHHCCCCCCCCEEEECCCCCCEEEC
SGELHNQGKVAGNADLTVNAASIDNSKGTLQAAAGLNLTKQSSLINDGGHITSQSLKLNA
CCCCCCCCCCCCCCCEEEEEEECCCCCCEEEEECCCCEEHHCCEECCCCCEECCEEEEEH
DSLSNQAGEIYAQQQLSSQLKTLDNAKGSVIGGQGVDLTVTDQLHNDGVVGSDGQVKLTA
HHHCCCHHHHHHHHHHHHHHHHHCCCCCCEECCCCCEEEEECCCCCCCEECCCCCEEEEE
GALENAAGTIQSGKDLQLTAASLTNAEKGQILALGKDAASKVDVSGELHNQGKLAGNADL
CCCCCCCCCCCCCCCEEEEEECCCCCCCCEEEEECCCCCCEEECCCCCCCCCCCCCCCCE
TVNAATIDNAKGTLQAANHLELSKQSSLTNDDGHIAGQSLTLKADSLSNKSGELYAQGQL
EEEEEEECCCCCCEECCCHHEEHHHCCCCCCCCEECCCEEEEEECCCCCCCCCEEECCCH
TSQLKTLDNSQGSLIGGQGVDLTVADSLHNDGVVGSDGQVKLSAGTLDNAAGTIQSGKDL
HHHHHHHCCCCCCEECCCCCEEEEECCCCCCCEECCCCEEEEECCCCCCCCCCCCCCCCE
QLTAASLTNADKGQILALGKDAASTVDVSGELHNQGKLAGNADLTVNAASIDNSKGTLQA
EEEEEECCCCCCCCEEEECCCCCCEEECCCCCCCCCCCCCCCCEEEEEEECCCCCCCEEH
ASHLELSKQSSLINDGGHIAGQSLKLNADSLSN
HHHHHHHHHHCCCCCCCCCCCCEEEECHHCCCC
>Mature Secondary Structure
MNKHLYRIIFNQSRGQLMVVQEDACGQGKGNGAEGVAATLAAACKAFSLRLSVLLIGLGL
CCCEEEEEEEECCCCEEEEEECCCCCCCCCCCCCHHHHHHHHHHHHHHHEEEEEEEEECC
GSSALAADIIADPNAAAGKQPGVIQSANGLPVVQIAAPTAAGVSHNQYQQFNVGPGGALL
CCHHHEEHEECCCCCCCCCCCCEEECCCCCEEEEEECCCCCCCCCCCCEEECCCCCCEEE
NNSATLVNTQLAGYISGNPNLKNGSARIILNEVTQPNPSQLRGYLEVAGQRAQVVIANPW
CCCCEEEEEEEEEEECCCCCCCCCCEEEEEECCCCCCHHHHHHHHHHCCCCEEEEEECCC
GITCSGCGFINTQQATLTTGTPQLNAQGELTGYQVAGGRVSIDGAGLNAANVDSFAIISR
CCEECCCCCCCCCCEEEECCCCCCCCCCCCCEEEEECCEEEECCCCCCCCCCCHHEEEEE
AVSINANLYAQKLDLVLGRNQVDTATLAAQPLAASPSDAPAFALDVAQLGGMYANAIKLV
EEEECCEEEEEEEHHEECCCCCCCHHEECCCCCCCCCCCCCCEEEHHHHCCCEEEEEEEE
GTEKGVGVNQLGTMAAQAGDLQLTSAGDLVLRGQTHSQQNLILQADGQLRHDGVTRAEGS
ECCCCCCHHHHHHHHHCCCCEEEECCCCEEEECCCCCCCCEEEEECCCCCCCCCCCCCCC
IQADIAGQTALHQALSAGGDLTLNTGSLQGDGALAAGALADGKLTEHGRLAVTSAGALQA
EEEECCCHHHHHHHHHCCCCEEEECCCCCCCCCEEECCCCCCCCCCCCEEEEEECCCEEC
SGQLLAGGDVSLKAGQADLSQATVSASHGALDIRAAGDVNAQQARLSAAGAARLTIDGQL
CCCEEECCCEEEECCCCCHHHHEEECCCCEEEEEECCCCCHHHHHHHHCCEEEEEEECEE
DNRSGQLAATQVDLQLGALDNSQGKIVQSGQADSAWRINGSTDNRQGVLASAGHDLKLQS
CCCCCCEEEEEEEEEEECCCCCCCCEEECCCCCCEEEECCCCCCCCCEEEECCCCEEEEC
GNLDNRGGEISHAGAGALRLSADALDNREQGRIASDGRLDAQAAQLDNRQGRLVGVLSAS
CCCCCCCCEEECCCCCEEEEEHHHCCCCCCCCCCCCCCCCHHHHHCCCCCCCEEEEEECC
VDARQQLNNEGGVLGSDGAVKLGAGGLDNGAGLIQSGQDLQLTANSLTNADKGQILALGK
HHHHHHHCCCCCEECCCCCEEECCCCCCCCCCHHCCCCCEEEEEHHCCCCCCCCEEEECC
DAASKVDVSGELHNQGKVAGNADLTVNAASIDNSKGTLQAAAGLNLTKQTSLTNDGGHIA
CCCCEEECCCCCCCCCCCCCCCCEEEEEEECCCCCCEEEEECCCCEEECCCCCCCCCCEE
SQSLKLNADSLSNQAGEIYAQQQLSSQLKTLDNAKGSVIGGQGVDLTVTDQLHNDGVVGS
CCEEEEEHHHHCCCHHHHHHHHHHHHHHHHHCCCCCCEECCCCCEEEEECCCCCCCEECC
DGQVKLTAGALENAAGTIQSGKDLQLTAASLTNADKGQILALGKDAASKVDVSGELHNQG
CCCEEEEECCCCCCCCCCCCCCCEEEEEEECCCCCCCCEEEECCCCCCEEECCCCCCCCC
KLAGNADLTVNAATIDNAKGTLQAANHLELNKQSSLTNDDGHIAGQSLTLKADSLSNKSG
CCCCCCCEEEEEEEECCCCCCEEECCEEECCCCCCCCCCCCEECCCEEEEEECCCCCCCC
ELYAQGQLTSQLKTLDNSQGSLIGGQGVDLTVADSLHNDGVVGSDGQVKLNAGALENAAG
CEEECCCHHHHHHHHCCCCCCEECCCCCEEEEECCCCCCCEECCCCEEEEECCCCCCCCC
TIQSGKDLQLTASSLTNADKGQILALGKDAASTVDVSGELHNQGKVAGNADLTVNAASID
CCCCCCCEEEEHHHCCCCCCCCEEEECCCCCCEEECCCCCCCCCCCCCCCCEEEEEEECC
NSKGTLQAAAGLNLTKQSSLINDGGHITSQSLKLNADSLSNQAGEIYAQQQLTSQLKTLD
CCCCEEEEECCCCEEHHCCEECCCCCEECCEEEEEHHHHCCCHHHHHHHHHHHHHHHHHC
NAKGSVIGGQGVDLTVTDSLRNDGVVGSDGQVKLTAGALENAAGTIQSGKDLQLTAASLT
CCCCCEECCCCCEEEEECCCCCCCEECCCCCEEEEECCCCCCCCCCCCCCCEEEEEEECC
NANKGQILALGKDAASKVDVSGELHNQGKLAGNADLTVNAASIDNSKGTLQAASHLELSK
CCCCCEEEEECCCCCCEEECCCCCCCCCCCCCCCCEEEEEEECCCCCCCEEHHHHHHHHH
QSSLTNDGGHIAGQSLMLNADSLSNQAGEIYAQQQLSSTLKTLNNAQGSLIGGQGVDLTV
HCCCCCCCCEEECCEEEEEHHHCCCCHHHHHHHHHHHHHHHHHHCCCCCEECCCCCEEEE
FDQLHNDGVLGSDGQVKLSAGTLENAAGTIQSGKDLQLTASSLSNADKGQILVLGKDAAS
EECCCCCCEECCCCEEEEECCCCCCCCCCCCCCCCEEEEHHHCCCCCCCEEEEEECCCCC
KVDVSGELHNQGKLAGNADLTVNAASIDNSKGTLQAAAGLNLTKQSSLINDGGHITSQSL
EEECCCCCCCCCCCCCCCCEEEEEEECCCCCCEEEEECCCCEEHHCCEECCCCCEECCEE
KLNADSLSNQAGEIYAQQQLTSQLKTLDNAKGSVIGGQGVDLTVTDSLRNDGVVGSDGQV
EEEHHHHCCCHHHHHHHHHHHHHHHHHCCCCCCEECCCCCEEEEECCCCCCCEECCCCCE
KLTAGALENAAGTIQSGKDLQLTAASLTNANKGQILALGKDAASKVDVSGELHNQGKLAG
EEEECCCCCCCCCCCCCCCEEEEEEECCCCCCCEEEEECCCCCCEEECCCCCCCCCCCCC
NADLTVNAASIDNSKGTLQAASHLELSKQSSLTNDGGHIAGQSLMLNADSLSNQAGEIYA
CCCEEEEEEECCCCCCCEEHHHHHHHHHHCCCCCCCCEEECCEEEEEHHHCCCCHHHHHH
QQQLSSTLKTLNNAQGSLIGGQGVDLTVFDQLHNDGVLGSDGQVKLSAGTLENAAGTIQS
HHHHHHHHHHHHCCCCCEECCCCCEEEEEECCCCCCEECCCCEEEEECCCCCCCCCCCCC
GKDLQLTASSLSNADKGQILVLGKDAASKVDVSGELHNQGKLAGNADLTVNAASIDNSKG
CCCEEEEHHHCCCCCCCEEEEEECCCCCEEECCCCCCCCCCCCCCCCEEEEEEECCCCCC
TLQAASHLELSKQTSLINDGGHIASQSLKLNADSLSNQTGEIYAQQQLSSQLKTLDNAKG
CEEHHHHHHHHHHHCEECCCCCEECCEEEEEHHHCCCCCCCEEEHHHHHHHHHHHCCCCC
SVIGGQGVDLTVTDQLHNDGVVGSDGQVKLSVGTLENAAGTIQSGKDLQLSASSLTNADK
CEECCCCCEEEEECCCCCCCEECCCCEEEEEECCCCCCCCCCCCCCCEEEEHHHCCCCCC
GQILALGKDAASKVGVSGELRNQGKLAGNADLTVNAASIDNSKGTLQAASHLELSKQSSL
CCEEEECCCCHHHCCCCCCCCCCCCCCCCCCEEEEEEECCCCCCCEEHHHHHHHHHHHCC
INDGGHIAGQSLKLNADSLSNQAGEIYAQQQLSSTLKTLNNAQGSLIGGQGVDLTVADSL
CCCCCCCCCCEEEEEHHHHCCCHHHHHHHHHHHHHHHHHHCCCCCEECCCCCEEEEECCC
HNDGVVGSDGQVKLNAGALENAAGTIQSGKDLQLTASSLTNADKGQILALGKDAASTVDV
CCCCEECCCCEEEEECCCCCCCCCCCCCCCCEEEEHHHCCCCCCCCEEEECCCCCCEEEC
SGELHNQGKVAGNADLTVNAASIDNSKGTLQAAAGLNLTKQSSLINDGGHITSQSLKLNA
CCCCCCCCCCCCCCCEEEEEEECCCCCCEEEEECCCCEEHHCCEECCCCCEECCEEEEEH
DSLSNQAGEIYAQQQLSSQLKTLDNAKGSVIGGQGVDLTVTDQLHNDGVVGSDGQVKLTA
HHHCCCHHHHHHHHHHHHHHHHHCCCCCCEECCCCCEEEEECCCCCCCEECCCCCEEEEE
GALENAAGTIQSGKDLQLTAASLTNAEKGQILALGKDAASKVDVSGELHNQGKLAGNADL
CCCCCCCCCCCCCCCEEEEEECCCCCCCCEEEEECCCCCCEEECCCCCCCCCCCCCCCCE
TVNAATIDNAKGTLQAANHLELSKQSSLTNDDGHIAGQSLTLKADSLSNKSGELYAQGQL
EEEEEEECCCCCCEECCCHHEEHHHCCCCCCCCEECCCEEEEEECCCCCCCCCEEECCCH
TSQLKTLDNSQGSLIGGQGVDLTVADSLHNDGVVGSDGQVKLSAGTLDNAAGTIQSGKDL
HHHHHHHCCCCCCEECCCCCEEEEECCCCCCCEECCCCEEEEECCCCCCCCCCCCCCCCE
QLTAASLTNADKGQILALGKDAASTVDVSGELHNQGKLAGNADLTVNAASIDNSKGTLQA
EEEEEECCCCCCCCEEEECCCCCCEEECCCCCCCCCCCCCCCCEEEEEEECCCCCCCEEH
ASHLELSKQSSLINDGGHIAGQSLKLNADSLSN
HHHHHHHHHHCCCCCCCCCCCCEEEECHHCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 2388559; 12910271; 2539596; 1696934; 1791761 [H]