Definition Rhodobacter sphaeroides 2.4.1 chromosome 2, complete sequence.
Accession NC_007494
Length 943,016

Click here to switch to the map view.

The map label for this gene is 77465539

Identifier: 77465539

GI number: 77465539

Start: 624206

End: 630388

Strand: Reverse

Name: 77465539

Synonym: RSP_3540

Alternate gene names: NA

Gene position: 630388-624206 (Counterclockwise)

Preceding gene: 77465541

Following gene: 77465538

Centisome position: 66.85

GC content: 68.22

Gene sequence:

>6183_bases
ATGCCGACAGTGAACCTGACCTCTGCCCTGACCTTCTCCGAGGGCGGCGTGCCGCAGCTCGTCGACCCGAACATCACGAT
CACGGGCGGCGGAGCCTTTACCGAAGGCTACATCGAATTCTCGGTCAGTTCGCCCACGGCCGGCGACAACTTCAGCCTGA
CCAGCGCCGCCAATCCGCTGGCCAACGGCGCGATCTCGTTCGAGAACGGCGACGTCTATCTCGGGACCGGCTCGGCCCGC
GAGCGGATCGGCTCGGTCGATGCGACCTTCGACGGCCAGGACGGCCAGCCGCTGCGCATCCTGTTCTCGAGCCCGCTGCC
GAACGCCGGCTTCGAGGAAGGCGAGGCGAACTGGACCATCCGCGACGAGCAATATGGCGACAACGGCAGCGAGCTGAACC
TCGACGGCCTGCAGATCACGCTGGCCAATGACTCGGCCTACAGCGGCGGCACCGGCACGACCAACGTCCAGGCCTCCGCC
GGCATGACCTGGGACGGGTCGGTGCAGGATGGTGCGGGCGTTGACGGATCGCGCGCCCTCTATCTCGGCAGCGGCGGAAA
CATCGTTGCGGGCGATCAGAACCCGGCCGGCGGCTATCAGGTCAACGGCTACGGCTCGATCCACGGCCCCTATGCCACCA
GCTCGGTGATCACCGTCGCGCAGGGTGACTCGATCTCGCTCGACTTTCAGGCCGTGGGCACGAGCGACGACTACGAGGTG
TTCGGCTTCCTGCGTCGCGTCGACGCCAACGGCAACTTCCTGAGCAACAGCGTCAGCAGCCCCGACAACATCCTGCTCTT
CGCCCAGCGGGGCGATGACACCAGCGGGTGGACGACCATCAGCAAGGACGGCCTGCCCGCAGGCAGCTACCGGTTCGAGT
TCGTCGGCGGCACCTATGATGGCACGGGCGGCCTCGCGGTGGGCTCGAACCTCTTTGTCGACAACATCCGCCTGATCTCG
GCCACCTCGGTGAACGACAGCATCGCCCAGGCCATCGCCCGGCAGGTCGCCTACCAGAACGACGCCAATGATGCGCCGGT
CACCCGCCAGATCACGGTCACGGCCGTGGACGGCAACGGCATCAGCGGCTCCTCCTCGAACGGCCTGACCTTCGAAGGCG
AGAACGACGCGCCGAGCCTTGCCAACACCACGCTCACCTCGATCGCCGAGGACAGCAGCCCCGCCGGCCAGACCATCGCC
GCAGCCTTCGGCGGCTCCTTCTCGGATCCCGACAACGCCTATTCCCCCACCGACTCGATGGCGGGCGTCGTCATCACCGG
CAATGCGGCGACCGGCGCCCAAGGCGACTGGCAGTATTCGACCGACGGCGGCACCACCTGGATCTCGGTCGGCAGCGTGA
CCTCGCAGAGCGGGCTCGTGCTTTCCTCGGCCACGCTGATCCGCTTCGAACCCGCGCTGAACTGGAACGGCACGCCCGGC
GCGCTGACGCTCCATGCGCTGGACAGCACCTATGGCGGCAGCTTCACCAGCGGCACGACGGCGGTGAACCTCGACACGAC
CGGCGCCACCGGCACCGGCGCGCTCAGCCAGAACAGCGCCACCGGCTCGATCACCGTCACCCCGGTCAACGACGCCCCCG
TCTTCACCGCGGCCCCGGTCGCGCTGACGGTTGCCGACACCGAGGCCGTGGACACGCCGGCCGCGCTCACCGGCTCGATC
TCGGCCTCCGACCTGCATGGCGGTGCGCCGGGCGAAGGCGGCACGCTCAGCTACGGCGTTCAGGGCGGCGTGTCGGCCAA
CGGCTTCTCGGTTCTGACGCTGCCCTACGGCACGCTGTCGGTGAACCAGTCGACCGGAGCCTACAGCTTCCTGCCGAACC
CCACGGCGCTGAACAGCCTCGCCGAGGGTGCAGAGGCGAACTTCTCCTTCACGCTCACCGTCTCGGACGGGCAGGGCGGC
ACGCAGACCGCGCCGCTCGACATCACCTTCACCGGCGCCAACGACGTGCCGGTCGTCAGCGCCCAGACCGGCACGGCGGT
CGAGGCCTCGGGTCTCAACAACAACGTCGCCGGCAGCGCGGCCACGGGCTCGCTGCTGACCGGTCCGAATGCGGCGACCG
ATATCGACGGCGACGAGATCTCGGTGGTGGGTGTGCGCACCGGCGGCCAGTCCGAGACCGGCACCGAAGGCGTCTGGACC
GACGGCACGATCACGCTTCAGGGCACCTACGGCACGCTGACGCTGAACGAGGACGGCAGCTGGTCCTACGCGGCCGACGA
TGACAACCCGACCGTCGACGGCCTGACCGGGCCGACCGACACGCTGGAGGAGACCTTCACCTACACCGTGACGGACGCGA
ACGGCGCCACCGCGTCGCAGGAGCTGACCGTCACCATCTCGGGCCGCAACGACGCGCTGAACGTGTCGAGCAGCATCGGC
ACCGATATCTCGACGGGCGAGGATGCCGACACGCAGATCGACCTTACCGGCCTCGTGTTCGAAGACCCCGATCTGGGCTC
GGAAATCTACGAATTCGCCGTGGATGCGGGCCAGGGCACGCTCTGGACCGAAGGTGTGGACGGGCTGACCGTCACCGGCA
ACGGAACGGGCCAGCTGGTGCTGACCGGCTCGGCCACCGCGATTTCCGAATGGATCGCGGCCAACGACCTGACCTACCGC
TCGCCCGTGGAAGGCAGCGGCGCCGACACGATCAGCCTCTCCTACAGCGAGGCGGGCGCCGAGGTCCGCACGGCGCTCGA
GTCCATCGACGTCGCGGTGGACATGATCAACGACCCGGCCGTGGTCGATGTGAACGGCTCGGTCACGACCCAGGGCAGCG
CCGGCGTGGCCGAAGTGGCTCAGGTCACCTTCCTGTCGACCGGCACCGCTCAGGTGCTGAATTTCGACGGGGTGCAGATG
CAGATCGCGGCCGGCAGCACTGCCGCCGAGATTGCCGAAGCCTTCGCGGCGCAGGAGTTCCCGAACTGGACCGTCAGCCT
TGACGGCGAGGGCCGGGTGACGCTGACCGCGACCGCCACCGGCGCGCGGCCGGACCTGACGGCGGCCGACTTCACCAACG
GCTCGGGCGCCTTCTCGCCGCTGGTCGAGACCACCGGCGGCACCGACGGCAGCATCAATTTCACCGCGCGCGGACCGGCC
ATCGCCATCCTGCCGACGCTGGAACTGAGCGACGTCGACAGCGCGATGATGTCGGGCGCCAAGGTCAGCATGACCGAAGG
CCTGTTCGACAACGGGTTCGGCACGATCTACGAACGGCTCTCGCTGTCGGCGGAGGCGCGGGAATTCGCGCAGCAGAACG
GCGTGGGCATCAGCATCGTGACGACGGCCGCTGCCGGCTCGGTCATCACCTTCACCGGCATGGCCTCGGCGGAGGTCTAC
GAGACCATCCTGCGCGGCGTGATCTACAGCAACACCAACCCGAATGCGGTGGCGGGCACCCGCCCCGTGAAGATCGAAGT
GACCGACTCTGACGGGCTCGCCTCGAGCCTCTCCAGCGTCAACCTGACAGAGGGCAACACCGACATCGCCGTCGGCCAGC
GCATCTTCATCAACGGCGTGGACAGCGGCCAGGTCGTCTCGATGGTGCGCGACGCCACCAGCTTCGTGGCCAGCGGCCCG
CTGGCCGATCTGGAGCCGGGTGCGGTGCTGAGCTTCCATGACGGCAGCGGTCAGCAGACCACGGCGGTTTCGGCGGGCGA
CGGCACGGCCACGATGGACGTGAACGTGATCTGGGCTCCCGTGATCGACATGAACGGCGCCGGCGCGGGCGATATCCACC
GGACGACCTACATCGAGCAGCATGCCCCGATCGCCATCGCGACCGCCGATGCCCGCATCGTCGATCAGGAAGGTCTGATC
CGCTCGCTCGACGTCGTGCTGACCAACCCGCTCGACAATGTCGAAGGTTCGGCTCCGGTCGAATATCTCGGCATCTCGAA
GGCGGTGCTGGACGTGCTGGCGGCCCGCGGCATCACCATCGGTGCCCATGACGGCCAGTTCGACGCCAACGGCAACCTGA
CCGGCGCCACCTCGATCACCTTCGCGGCGGCCAACGGCGCCAGCGCCACCAGCTTCCAGATTGCGCTGCGGGGCGTGACC
TATGCCAACATGGACGATGCCCCGGACACCGGGACGCGGATCGTGACGGCGCAGGGCACCGACATGGACGGCAACGAGGG
CCTGATCTCGCACACCGAGATCAACCCGATCGCGGTGGGCGACGCGCCGGTGGCGATCGACAGCGGCGTGACCGGCTCCG
AAGATGCGGGCCATGTCTTTGCCGCCGGAGACTTCGGCTTTGCCGATCCGCTGGATGGCGGCGCGAACCAGCTCGCCTCG
ATCACCATCAACAGCCTGCCCGCCACGGGCACGCTGCTCCTGGGCGGGGTCGCGGTCGCCGTGGGCACCGTGGTCACCCT
CGCGCAGCTTCAGGCCGGCGCGCTGACCTATCAGCCGGTGGCCAACGTGAACGGTGAAGGGGTCGCCTCGTTCGACTTCC
TCGTGACCGACAACGGCAGCCTCGCCAACGGCGGCCAGACCACCTCGACCGCTCCGGCAACCATGGTGATCGACCTGACG
CCGGTGAACGATGCTCCGGTCCTGCCGGAAGGCACCTCCGTCACCGGCACCACGATCACCGAAGACCAGCAGCTGAATGC
CGGTGAACTGGTGGCCGATCTGGTCGGCGCCATGACGGATGTCGATACGGGCGTGCACAGCGCCACGAACGGCACCCAGC
AGGGCATCGCGGTTTATGGCGCGGGCTCCGAAGGGTTCGGCGGCGGCACCTGGCAGTATCGTCTCGCCGGCGGCACCGAC
TGGATCGACGTCACCCTCGATCCGGGCGAGGTCCTGCTGCTCGGTGCGGACGACCGCATCCGCTTCTCGCCGGATGGCGA
GAACGCGACCGAGGCGCAGCTGTCCTACTACGCCTGGGACGGGGCGACCGGCACCGCGGGCAACGTGGTCGCAGGCATCG
CGGGGCCGGGCAATGCCTCGAACCGTGGCGGCACCTCGGCCTTCTCCAGCAACGGCGCCTCTGCCACGGTCGAGGTGACA
GCTGTCAACGACGCGCCGTCGATCAGCATGGGCGAGGGCAATACCTTCTATGCTCGCGGCGAGGCGGTGGCGCTGTTCTC
GGACGAGACGCTGCAACTGACCGACCCGGACGAGGGCGCGGCGGTAAGCCAGATTGTCATCACGCTCGATGGCGAGACCA
CGGTCGACAACGCCTTCGGCACCACCTACGAGACGATCTTCTCGGCCAGCGGCTCGACCTTCGTGGCCCAGTCGGGCACC
GAACTGACCATCTCGGGCACCGGTGTGGCGGGCGATCCGCTCACCATCTCGGGGGCCGGGTCGATGGAGGACTACCGTGA
GGCGCTCCTCAGCCTGCGCTACGAGAACACCAACCCGAACGCCTTCGCGGGCGACCGGGCGATCTCGGTCACGGTGACGG
ATGAGACGGGGGCGGGCTCCGCGCCGACGGACTTCATCCTGCCGGTGGAATGGGCAACGGTGGCCGATCTCAACGGTCCG
TCGGGCGAAGGCCGCGACCACTCGATCACCTATCTCGAGGGCAGCGGCAGCCAGGCCATCGCTACGGCCGATGCCGAGAT
GATCGACCAGGACGGCAACACCGTCGAGGTCGTCATCACGCTCGAGGATGCGGTGAACGGCTCGGCCGAGATGCTGTTCG
TCGATCCGGCGGTCCTGCCGGCTCTGGCGGCGCTGAACATCGTGGTCACCGGCAACGGCACCCACGAGATCCGGCTGACG
AGCGAGGAGGGCGTGGATCCCACGAACTTCCAGCTGGCGCTGCGGGCCGTGCGTTACGTCAACAGCTCGACCGCACCCAC
CGCGGCGGAGCGCCATGTCACGGTCTCCTCGACCGATGCCGACGGCAACCCGGGCGTTCCGGCCACCACGGTGATCGGGA
TGGAGCTGGGTGAACGACGCACCGGTTGCGGATCTCTCGATCTCCTACGAGGCGTCCGAGACCCGCAACCCGCTGTCGGG
CGATCAGCTGCTGCTCGACGGCACGCTGGACGATGCCGACGGGCTCGGGCCGAACCCGCCGGTCATCGAATGGCTGCGGG
ACGGTGTGGTGATCGCTTCGGGCAACGGCATGCCGGTCTACACGCTGAAACCGGCGGATGCAGGCCATGTCATCAGCGCC
CGCATCACCTACACCGACGGTGA

Upstream 100 bases:

>100_bases
CGACAGCCGAGTCAAATTCGGCACGAATTTGCCTCAATTTAGACGCCCATTCGACACATCCGATGCGGAAAAGCCGAGTG
CAGCCCTCGTGGAGATTCTC

Downstream 100 bases:

>100_bases
AGGCAACCTCGAGGTCATCAACGTCGATGGCCCCGCCATGGTCGGGCTGAACCTCGAAGGCACCGACGGCGCCGATCTGC
TCATCGGCTCGCGGGGCGCG

Product: putative adhesin or RTX toxin

Products: NA

Alternate protein names: Ig Family Protein; PKD Domain-Containing Protein; Large Exoprotein; MadA Protein; Outer Membrane Adhesin Like Protein; Outer Membrane Adhesin-Like Protein; Fibronectin Type III Domain-Containing Protein; Ig Domain Proteni; RTX xin; VCBS Protein; Cell Wall/Surface Repeat-Containing Protein; Type V Secretory Pathway; Cadherin

Number of amino acids: Translated: 2060; Mature: 2059

Protein sequence:

>2060_residues
MPTVNLTSALTFSEGGVPQLVDPNITITGGGAFTEGYIEFSVSSPTAGDNFSLTSAANPLANGAISFENGDVYLGTGSAR
ERIGSVDATFDGQDGQPLRILFSSPLPNAGFEEGEANWTIRDEQYGDNGSELNLDGLQITLANDSAYSGGTGTTNVQASA
GMTWDGSVQDGAGVDGSRALYLGSGGNIVAGDQNPAGGYQVNGYGSIHGPYATSSVITVAQGDSISLDFQAVGTSDDYEV
FGFLRRVDANGNFLSNSVSSPDNILLFAQRGDDTSGWTTISKDGLPAGSYRFEFVGGTYDGTGGLAVGSNLFVDNIRLIS
ATSVNDSIAQAIARQVAYQNDANDAPVTRQITVTAVDGNGISGSSSNGLTFEGENDAPSLANTTLTSIAEDSSPAGQTIA
AAFGGSFSDPDNAYSPTDSMAGVVITGNAATGAQGDWQYSTDGGTTWISVGSVTSQSGLVLSSATLIRFEPALNWNGTPG
ALTLHALDSTYGGSFTSGTTAVNLDTTGATGTGALSQNSATGSITVTPVNDAPVFTAAPVALTVADTEAVDTPAALTGSI
SASDLHGGAPGEGGTLSYGVQGGVSANGFSVLTLPYGTLSVNQSTGAYSFLPNPTALNSLAEGAEANFSFTLTVSDGQGG
TQTAPLDITFTGANDVPVVSAQTGTAVEASGLNNNVAGSAATGSLLTGPNAATDIDGDEISVVGVRTGGQSETGTEGVWT
DGTITLQGTYGTLTLNEDGSWSYAADDDNPTVDGLTGPTDTLEETFTYTVTDANGATASQELTVTISGRNDALNVSSSIG
TDISTGEDADTQIDLTGLVFEDPDLGSEIYEFAVDAGQGTLWTEGVDGLTVTGNGTGQLVLTGSATAISEWIAANDLTYR
SPVEGSGADTISLSYSEAGAEVRTALESIDVAVDMINDPAVVDVNGSVTTQGSAGVAEVAQVTFLSTGTAQVLNFDGVQM
QIAAGSTAAEIAEAFAAQEFPNWTVSLDGEGRVTLTATATGARPDLTAADFTNGSGAFSPLVETTGGTDGSINFTARGPA
IAILPTLELSDVDSAMMSGAKVSMTEGLFDNGFGTIYERLSLSAEAREFAQQNGVGISIVTTAAAGSVITFTGMASAEVY
ETILRGVIYSNTNPNAVAGTRPVKIEVTDSDGLASSLSSVNLTEGNTDIAVGQRIFINGVDSGQVVSMVRDATSFVASGP
LADLEPGAVLSFHDGSGQQTTAVSAGDGTATMDVNVIWAPVIDMNGAGAGDIHRTTYIEQHAPIAIATADARIVDQEGLI
RSLDVVLTNPLDNVEGSAPVEYLGISKAVLDVLAARGITIGAHDGQFDANGNLTGATSITFAAANGASATSFQIALRGVT
YANMDDAPDTGTRIVTAQGTDMDGNEGLISHTEINPIAVGDAPVAIDSGVTGSEDAGHVFAAGDFGFADPLDGGANQLAS
ITINSLPATGTLLLGGVAVAVGTVVTLAQLQAGALTYQPVANVNGEGVASFDFLVTDNGSLANGGQTTSTAPATMVIDLT
PVNDAPVLPEGTSVTGTTITEDQQLNAGELVADLVGAMTDVDTGVHSATNGTQQGIAVYGAGSEGFGGGTWQYRLAGGTD
WIDVTLDPGEVLLLGADDRIRFSPDGENATEAQLSYYAWDGATGTAGNVVAGIAGPGNASNRGGTSAFSSNGASATVEVT
AVNDAPSISMGEGNTFYARGEAVALFSDETLQLTDPDEGAAVSQIVITLDGETTVDNAFGTTYETIFSASGSTFVAQSGT
ELTISGTGVAGDPLTISGAGSMEDYREALLSLRYENTNPNAFAGDRAISVTVTDETGAGSAPTDFILPVEWATVADLNGP
SGEGRDHSITYLEGSGSQAIATADAEMIDQDGNTVEVVITLEDAVNGSAEMLFVDPAVLPALAALNIVVTGNGTHEIRLT
SEEGVDPTNFQLALRAVRYVNSSTAPTAAERHVTVSSTDADGNPGVPATTVIGMELGERRTGCGSLDLLRGVRDPQPAVG
RSAAARRHAGRCRRARAEPAGHRMAAGRCGDRFGQRHAGLHAETGGCRPCHQRPHHLHRR

Sequences:

>Translated_2060_residues
MPTVNLTSALTFSEGGVPQLVDPNITITGGGAFTEGYIEFSVSSPTAGDNFSLTSAANPLANGAISFENGDVYLGTGSAR
ERIGSVDATFDGQDGQPLRILFSSPLPNAGFEEGEANWTIRDEQYGDNGSELNLDGLQITLANDSAYSGGTGTTNVQASA
GMTWDGSVQDGAGVDGSRALYLGSGGNIVAGDQNPAGGYQVNGYGSIHGPYATSSVITVAQGDSISLDFQAVGTSDDYEV
FGFLRRVDANGNFLSNSVSSPDNILLFAQRGDDTSGWTTISKDGLPAGSYRFEFVGGTYDGTGGLAVGSNLFVDNIRLIS
ATSVNDSIAQAIARQVAYQNDANDAPVTRQITVTAVDGNGISGSSSNGLTFEGENDAPSLANTTLTSIAEDSSPAGQTIA
AAFGGSFSDPDNAYSPTDSMAGVVITGNAATGAQGDWQYSTDGGTTWISVGSVTSQSGLVLSSATLIRFEPALNWNGTPG
ALTLHALDSTYGGSFTSGTTAVNLDTTGATGTGALSQNSATGSITVTPVNDAPVFTAAPVALTVADTEAVDTPAALTGSI
SASDLHGGAPGEGGTLSYGVQGGVSANGFSVLTLPYGTLSVNQSTGAYSFLPNPTALNSLAEGAEANFSFTLTVSDGQGG
TQTAPLDITFTGANDVPVVSAQTGTAVEASGLNNNVAGSAATGSLLTGPNAATDIDGDEISVVGVRTGGQSETGTEGVWT
DGTITLQGTYGTLTLNEDGSWSYAADDDNPTVDGLTGPTDTLEETFTYTVTDANGATASQELTVTISGRNDALNVSSSIG
TDISTGEDADTQIDLTGLVFEDPDLGSEIYEFAVDAGQGTLWTEGVDGLTVTGNGTGQLVLTGSATAISEWIAANDLTYR
SPVEGSGADTISLSYSEAGAEVRTALESIDVAVDMINDPAVVDVNGSVTTQGSAGVAEVAQVTFLSTGTAQVLNFDGVQM
QIAAGSTAAEIAEAFAAQEFPNWTVSLDGEGRVTLTATATGARPDLTAADFTNGSGAFSPLVETTGGTDGSINFTARGPA
IAILPTLELSDVDSAMMSGAKVSMTEGLFDNGFGTIYERLSLSAEAREFAQQNGVGISIVTTAAAGSVITFTGMASAEVY
ETILRGVIYSNTNPNAVAGTRPVKIEVTDSDGLASSLSSVNLTEGNTDIAVGQRIFINGVDSGQVVSMVRDATSFVASGP
LADLEPGAVLSFHDGSGQQTTAVSAGDGTATMDVNVIWAPVIDMNGAGAGDIHRTTYIEQHAPIAIATADARIVDQEGLI
RSLDVVLTNPLDNVEGSAPVEYLGISKAVLDVLAARGITIGAHDGQFDANGNLTGATSITFAAANGASATSFQIALRGVT
YANMDDAPDTGTRIVTAQGTDMDGNEGLISHTEINPIAVGDAPVAIDSGVTGSEDAGHVFAAGDFGFADPLDGGANQLAS
ITINSLPATGTLLLGGVAVAVGTVVTLAQLQAGALTYQPVANVNGEGVASFDFLVTDNGSLANGGQTTSTAPATMVIDLT
PVNDAPVLPEGTSVTGTTITEDQQLNAGELVADLVGAMTDVDTGVHSATNGTQQGIAVYGAGSEGFGGGTWQYRLAGGTD
WIDVTLDPGEVLLLGADDRIRFSPDGENATEAQLSYYAWDGATGTAGNVVAGIAGPGNASNRGGTSAFSSNGASATVEVT
AVNDAPSISMGEGNTFYARGEAVALFSDETLQLTDPDEGAAVSQIVITLDGETTVDNAFGTTYETIFSASGSTFVAQSGT
ELTISGTGVAGDPLTISGAGSMEDYREALLSLRYENTNPNAFAGDRAISVTVTDETGAGSAPTDFILPVEWATVADLNGP
SGEGRDHSITYLEGSGSQAIATADAEMIDQDGNTVEVVITLEDAVNGSAEMLFVDPAVLPALAALNIVVTGNGTHEIRLT
SEEGVDPTNFQLALRAVRYVNSSTAPTAAERHVTVSSTDADGNPGVPATTVIGMELGERRTGCGSLDLLRGVRDPQPAVG
RSAAARRHAGRCRRARAEPAGHRMAAGRCGDRFGQRHAGLHAETGGCRPCHQRPHHLHRR
>Mature_2059_residues
PTVNLTSALTFSEGGVPQLVDPNITITGGGAFTEGYIEFSVSSPTAGDNFSLTSAANPLANGAISFENGDVYLGTGSARE
RIGSVDATFDGQDGQPLRILFSSPLPNAGFEEGEANWTIRDEQYGDNGSELNLDGLQITLANDSAYSGGTGTTNVQASAG
MTWDGSVQDGAGVDGSRALYLGSGGNIVAGDQNPAGGYQVNGYGSIHGPYATSSVITVAQGDSISLDFQAVGTSDDYEVF
GFLRRVDANGNFLSNSVSSPDNILLFAQRGDDTSGWTTISKDGLPAGSYRFEFVGGTYDGTGGLAVGSNLFVDNIRLISA
TSVNDSIAQAIARQVAYQNDANDAPVTRQITVTAVDGNGISGSSSNGLTFEGENDAPSLANTTLTSIAEDSSPAGQTIAA
AFGGSFSDPDNAYSPTDSMAGVVITGNAATGAQGDWQYSTDGGTTWISVGSVTSQSGLVLSSATLIRFEPALNWNGTPGA
LTLHALDSTYGGSFTSGTTAVNLDTTGATGTGALSQNSATGSITVTPVNDAPVFTAAPVALTVADTEAVDTPAALTGSIS
ASDLHGGAPGEGGTLSYGVQGGVSANGFSVLTLPYGTLSVNQSTGAYSFLPNPTALNSLAEGAEANFSFTLTVSDGQGGT
QTAPLDITFTGANDVPVVSAQTGTAVEASGLNNNVAGSAATGSLLTGPNAATDIDGDEISVVGVRTGGQSETGTEGVWTD
GTITLQGTYGTLTLNEDGSWSYAADDDNPTVDGLTGPTDTLEETFTYTVTDANGATASQELTVTISGRNDALNVSSSIGT
DISTGEDADTQIDLTGLVFEDPDLGSEIYEFAVDAGQGTLWTEGVDGLTVTGNGTGQLVLTGSATAISEWIAANDLTYRS
PVEGSGADTISLSYSEAGAEVRTALESIDVAVDMINDPAVVDVNGSVTTQGSAGVAEVAQVTFLSTGTAQVLNFDGVQMQ
IAAGSTAAEIAEAFAAQEFPNWTVSLDGEGRVTLTATATGARPDLTAADFTNGSGAFSPLVETTGGTDGSINFTARGPAI
AILPTLELSDVDSAMMSGAKVSMTEGLFDNGFGTIYERLSLSAEAREFAQQNGVGISIVTTAAAGSVITFTGMASAEVYE
TILRGVIYSNTNPNAVAGTRPVKIEVTDSDGLASSLSSVNLTEGNTDIAVGQRIFINGVDSGQVVSMVRDATSFVASGPL
ADLEPGAVLSFHDGSGQQTTAVSAGDGTATMDVNVIWAPVIDMNGAGAGDIHRTTYIEQHAPIAIATADARIVDQEGLIR
SLDVVLTNPLDNVEGSAPVEYLGISKAVLDVLAARGITIGAHDGQFDANGNLTGATSITFAAANGASATSFQIALRGVTY
ANMDDAPDTGTRIVTAQGTDMDGNEGLISHTEINPIAVGDAPVAIDSGVTGSEDAGHVFAAGDFGFADPLDGGANQLASI
TINSLPATGTLLLGGVAVAVGTVVTLAQLQAGALTYQPVANVNGEGVASFDFLVTDNGSLANGGQTTSTAPATMVIDLTP
VNDAPVLPEGTSVTGTTITEDQQLNAGELVADLVGAMTDVDTGVHSATNGTQQGIAVYGAGSEGFGGGTWQYRLAGGTDW
IDVTLDPGEVLLLGADDRIRFSPDGENATEAQLSYYAWDGATGTAGNVVAGIAGPGNASNRGGTSAFSSNGASATVEVTA
VNDAPSISMGEGNTFYARGEAVALFSDETLQLTDPDEGAAVSQIVITLDGETTVDNAFGTTYETIFSASGSTFVAQSGTE
LTISGTGVAGDPLTISGAGSMEDYREALLSLRYENTNPNAFAGDRAISVTVTDETGAGSAPTDFILPVEWATVADLNGPS
GEGRDHSITYLEGSGSQAIATADAEMIDQDGNTVEVVITLEDAVNGSAEMLFVDPAVLPALAALNIVVTGNGTHEIRLTS
EEGVDPTNFQLALRAVRYVNSSTAPTAAERHVTVSSTDADGNPGVPATTVIGMELGERRTGCGSLDLLRGVRDPQPAVGR
SAAARRHAGRCRRARAEPAGHRMAAGRCGDRFGQRHAGLHAETGGCRPCHQRPHHLHRR

Specific function: Unknown

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 208688; Mature: 208556

Theoretical pI: Translated: 3.74; Mature: 3.74

Prosite motif: PS50268 CADHERIN_2

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.2 %Cys     (Translated Protein)
1.1 %Met     (Translated Protein)
1.3 %Cys+Met (Translated Protein)
0.2 %Cys     (Mature Protein)
1.0 %Met     (Mature Protein)
1.3 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MPTVNLTSALTFSEGGVPQLVDPNITITGGGAFTEGYIEFSVSSPTAGDNFSLTSAANPL
CCCCEEEEEEEECCCCCCCEECCCEEEECCCCEEEEEEEEEECCCCCCCCEEECCCCCCC
ANGAISFENGDVYLGTGSARERIGSVDATFDGQDGQPLRILFSSPLPNAGFEEGEANWTI
CCCEEEECCCCEEEECCHHHHHHCCCCCEECCCCCCEEEEEEECCCCCCCCCCCCCCEEE
RDEQYGDNGSELNLDGLQITLANDSAYSGGTGTTNVQASAGMTWDGSVQDGAGVDGSRAL
ECCCCCCCCCEEEECCEEEEEECCCCCCCCCCCCEEEECCCCCCCCCCCCCCCCCCCCEE
YLGSGGNIVAGDQNPAGGYQVNGYGSIHGPYATSSVITVAQGDSISLDFQAVGTSDDYEV
EEECCCCEEECCCCCCCCEEECCCCCCCCCCCCCEEEEEECCCEEEEEEEEECCCCCHHH
FGFLRRVDANGNFLSNSVSSPDNILLFAQRGDDTSGWTTISKDGLPAGSYRFEFVGGTYD
EEEEEEECCCCCEECCCCCCCCCEEEEEECCCCCCCCEEECCCCCCCCCEEEEEECCCCC
GTGGLAVGSNLFVDNIRLISATSVNDSIAQAIARQVAYQNDANDAPVTRQITVTAVDGNG
CCCCEEECCCEEEEEEEEEEECCCCHHHHHHHHHHHHHCCCCCCCCEEEEEEEEEECCCC
ISGSSSNGLTFEGENDAPSLANTTLTSIAEDSSPAGQTIAAAFGGSFSDPDNAYSPTDSM
CCCCCCCCEEEECCCCCCCHHHHHHHHHHCCCCCCCCEEEEECCCCCCCCCCCCCCCCCC
AGVVITGNAATGAQGDWQYSTDGGTTWISVGSVTSQSGLVLSSATLIRFEPALNWNGTPG
CEEEEECCCCCCCCCCEEEECCCCEEEEEECCCCCCCCEEEEEEEEEEEECCCCCCCCCC
ALTLHALDSTYGGSFTSGTTAVNLDTTGATGTGALSQNSATGSITVTPVNDAPVFTAAPV
EEEEEEECCCCCCCCCCCCEEEEEECCCCCCCCCCCCCCCCCEEEEEECCCCCCEEECCE
ALTVADTEAVDTPAALTGSISASDLHGGAPGEGGTLSYGVQGGVSANGFSVLTLPYGTLS
EEEEECCCCCCCCCCEECCCCCCCCCCCCCCCCCEEEECCCCCCCCCCEEEEEECCCEEE
VNQSTGAYSFLPNPTALNSLAEGAEANFSFTLTVSDGQGGTQTAPLDITFTGANDVPVVS
ECCCCCCEEECCCCHHHHHHHCCCCCCEEEEEEEECCCCCCEECCEEEEEECCCCCEEEE
AQTGTAVEASGLNNNVAGSAATGSLLTGPNAATDIDGDEISVVGVRTGGQSETGTEGVWT
ECCCCEEEECCCCCCCCCCCCCCCEEECCCCCCCCCCCEEEEEEEECCCCCCCCCCCEEC
DGTITLQGTYGTLTLNEDGSWSYAADDDNPTVDGLTGPTDTLEETFTYTVTDANGATASQ
CCEEEEEEEEEEEEECCCCCEEEECCCCCCCCCCCCCCCHHHCCCEEEEEECCCCCCCCE
ELTVTISGRNDALNVSSSIGTDISTGEDADTQIDLTGLVFEDPDLGSEIYEFAVDAGQGT
EEEEEEECCCCEEEECHHCCCCCCCCCCCCCEEEEEEEEEECCCCCHHHHHHHHCCCCCE
LWTEGVDGLTVTGNGTGQLVLTGSATAISEWIAANDLTYRSPVEGSGADTISLSYSEAGA
EEECCCCCEEEECCCCEEEEEECCHHHHHHHHHHCCCEECCCCCCCCCCEEEEEHHHCCH
EVRTALESIDVAVDMINDPAVVDVNGSVTTQGSAGVAEVAQVTFLSTGTAQVLNFDGVQM
HHHHHHHHHEEEEEECCCCEEEECCCCEEECCCCCHHHEEEEEEEECCCEEEEECCCEEE
QIAAGSTAAEIAEAFAAQEFPNWTVSLDGEGRVTLTATATGARPDLTAADFTNGSGAFSP
EEECCCCHHHHHHHHHHHCCCCEEEEECCCCEEEEEEEECCCCCCCCEECCCCCCCCCCC
LVETTGGTDGSINFTARGPAIAILPTLELSDVDSAMMSGAKVSMTEGLFDNGFGTIYERL
CEECCCCCCCEEEEEECCCEEEEEEECCCCCCCHHHHCCCEEEEECCCCCCCHHHHHHHH
SLSAEAREFAQQNGVGISIVTTAAAGSVITFTGMASAEVYETILRGVIYSNTNPNAVAGT
CCCHHHHHHHHHCCCEEEEEEECCCCCEEEEECCCHHHHHHHHHHHEEECCCCCCCCCCC
RPVKIEVTDSDGLASSLSSVNLTEGNTDIAVGQRIFINGVDSGQVVSMVRDATSFVASGP
CEEEEEEECCCCCHHHHCEEEEECCCCEEEECCEEEEEECCCCHHHHHHHHHHHHHHCCC
LADLEPGAVLSFHDGSGQQTTAVSAGDGTATMDVNVIWAPVIDMNGAGAGDIHRTTYIEQ
CCCCCCCCEEEEECCCCCEEEEEECCCCCEEEEEEEEEEEEEECCCCCCCCCCEEEEECC
HAPIAIATADARIVDQEGLIRSLDVVLTNPLDNVEGSAPVEYLGISKAVLDVLAARGITI
CCCEEEEECCCEEECCCCCCEEEEEEEECCCCCCCCCCCEEEECHHHHHHHHHHHCCEEE
GAHDGQFDANGNLTGATSITFAAANGASATSFQIALRGVTYANMDDAPDTGTRIVTAQGT
ECCCCEECCCCCEEECCEEEEEECCCCCCEEEEEEEEEEEEECCCCCCCCCCEEEEEECC
DMDGNEGLISHTEINPIAVGDAPVAIDSGVTGSEDAGHVFAAGDFGFADPLDGGANQLAS
CCCCCCCEEEECCCCEEEECCCCEEEECCCCCCCCCCEEEEECCCCCCCCCCCCCCCEEE
ITINSLPATGTLLLGGVAVAVGTVVTLAQLQAGALTYQPVANVNGEGVASFDFLVTDNGS
EEEECCCCCCEEEHHHHHHHHHHHHHHHHHHCCCEEECCCCCCCCCCEEEEEEEEECCCC
LANGGQTTSTAPATMVIDLTPVNDAPVLPEGTSVTGTTITEDQQLNAGELVADLVGAMTD
CCCCCCCCCCCCEEEEEEEECCCCCCCCCCCCCCCCCEECCCCCCCHHHHHHHHHHHHHH
VDTGVHSATNGTQQGIAVYGAGSEGFGGGTWQYRLAGGTDWIDVTLDPGEVLLLGADDRI
CCCCCCCCCCCCCCCEEEEECCCCCCCCCEEEEEECCCCCEEEEEECCCCEEEEECCCCE
RFSPDGENATEAQLSYYAWDGATGTAGNVVAGIAGPGNASNRGGTSAFSSNGASATVEVT
EECCCCCCCCCEEEEEEEECCCCCCCCCEEEEECCCCCCCCCCCCCCCCCCCCEEEEEEE
AVNDAPSISMGEGNTFYARGEAVALFSDETLQLTDPDEGAAVSQIVITLDGETTVDNAFG
EECCCCCEEECCCCEEEECCCEEEEEECCEEEEECCCCCCEEEEEEEEECCCCEECCCCC
TTYETIFSASGSTFVAQSGTELTISGTGVAGDPLTISGAGSMEDYREALLSLRYENTNPN
CHHHHHHCCCCCEEEEECCCEEEEECCCCCCCCEEEECCCCHHHHHHHHHEEEECCCCCC
AFAGDRAISVTVTDETGAGSAPTDFILPVEWATVADLNGPSGEGRDHSITYLEGSGSQAI
CCCCCEEEEEEEECCCCCCCCCCCEEEEECEEEEEECCCCCCCCCCCEEEEEECCCCCEE
ATADAEMIDQDGNTVEVVITLEDAVNGSAEMLFVDPAVLPALAALNIVVTGNGTHEIRLT
EECCHHHHCCCCCEEEEEEEEHHCCCCCEEEEEECHHHHHHHEEEEEEEECCCCEEEEEE
SEEGVDPTNFQLALRAVRYVNSSTAPTAAERHVTVSSTDADGNPGVPATTVIGMELGERR
CCCCCCCCHHHHHHHHHHHHCCCCCCCCHHCEEEEECCCCCCCCCCCEEEEEEEECCCCC
TGCGSLDLLRGVRDPQPAVGRSAAARRHAGRCRRARAEPAGHRMAAGRCGDRFGQRHAGL
CCCCHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHCCCCCCCCCCCCCHHHHHHHHHCCC
HAETGGCRPCHQRPHHLHRR
CCCCCCCCCHHCCCHHHCCC
>Mature Secondary Structure 
PTVNLTSALTFSEGGVPQLVDPNITITGGGAFTEGYIEFSVSSPTAGDNFSLTSAANPL
CCCEEEEEEEECCCCCCCEECCCEEEECCCCEEEEEEEEEECCCCCCCCEEECCCCCCC
ANGAISFENGDVYLGTGSARERIGSVDATFDGQDGQPLRILFSSPLPNAGFEEGEANWTI
CCCEEEECCCCEEEECCHHHHHHCCCCCEECCCCCCEEEEEEECCCCCCCCCCCCCCEEE
RDEQYGDNGSELNLDGLQITLANDSAYSGGTGTTNVQASAGMTWDGSVQDGAGVDGSRAL
ECCCCCCCCCEEEECCEEEEEECCCCCCCCCCCCEEEECCCCCCCCCCCCCCCCCCCCEE
YLGSGGNIVAGDQNPAGGYQVNGYGSIHGPYATSSVITVAQGDSISLDFQAVGTSDDYEV
EEECCCCEEECCCCCCCCEEECCCCCCCCCCCCCEEEEEECCCEEEEEEEEECCCCCHHH
FGFLRRVDANGNFLSNSVSSPDNILLFAQRGDDTSGWTTISKDGLPAGSYRFEFVGGTYD
EEEEEEECCCCCEECCCCCCCCCEEEEEECCCCCCCCEEECCCCCCCCCEEEEEECCCCC
GTGGLAVGSNLFVDNIRLISATSVNDSIAQAIARQVAYQNDANDAPVTRQITVTAVDGNG
CCCCEEECCCEEEEEEEEEEECCCCHHHHHHHHHHHHHCCCCCCCCEEEEEEEEEECCCC
ISGSSSNGLTFEGENDAPSLANTTLTSIAEDSSPAGQTIAAAFGGSFSDPDNAYSPTDSM
CCCCCCCCEEEECCCCCCCHHHHHHHHHHCCCCCCCCEEEEECCCCCCCCCCCCCCCCCC
AGVVITGNAATGAQGDWQYSTDGGTTWISVGSVTSQSGLVLSSATLIRFEPALNWNGTPG
CEEEEECCCCCCCCCCEEEECCCCEEEEEECCCCCCCCEEEEEEEEEEEECCCCCCCCCC
ALTLHALDSTYGGSFTSGTTAVNLDTTGATGTGALSQNSATGSITVTPVNDAPVFTAAPV
EEEEEEECCCCCCCCCCCCEEEEEECCCCCCCCCCCCCCCCCEEEEEECCCCCCEEECCE
ALTVADTEAVDTPAALTGSISASDLHGGAPGEGGTLSYGVQGGVSANGFSVLTLPYGTLS
EEEEECCCCCCCCCCEECCCCCCCCCCCCCCCCCEEEECCCCCCCCCCEEEEEECCCEEE
VNQSTGAYSFLPNPTALNSLAEGAEANFSFTLTVSDGQGGTQTAPLDITFTGANDVPVVS
ECCCCCCEEECCCCHHHHHHHCCCCCCEEEEEEEECCCCCCEECCEEEEEECCCCCEEEE
AQTGTAVEASGLNNNVAGSAATGSLLTGPNAATDIDGDEISVVGVRTGGQSETGTEGVWT
ECCCCEEEECCCCCCCCCCCCCCCEEECCCCCCCCCCCEEEEEEEECCCCCCCCCCCEEC
DGTITLQGTYGTLTLNEDGSWSYAADDDNPTVDGLTGPTDTLEETFTYTVTDANGATASQ
CCEEEEEEEEEEEEECCCCCEEEECCCCCCCCCCCCCCCHHHCCCEEEEEECCCCCCCCE
ELTVTISGRNDALNVSSSIGTDISTGEDADTQIDLTGLVFEDPDLGSEIYEFAVDAGQGT
EEEEEEECCCCEEEECHHCCCCCCCCCCCCCEEEEEEEEEECCCCCHHHHHHHHCCCCCE
LWTEGVDGLTVTGNGTGQLVLTGSATAISEWIAANDLTYRSPVEGSGADTISLSYSEAGA
EEECCCCCEEEECCCCEEEEEECCHHHHHHHHHHCCCEECCCCCCCCCCEEEEEHHHCCH
EVRTALESIDVAVDMINDPAVVDVNGSVTTQGSAGVAEVAQVTFLSTGTAQVLNFDGVQM
HHHHHHHHHEEEEEECCCCEEEECCCCEEECCCCCHHHEEEEEEEECCCEEEEECCCEEE
QIAAGSTAAEIAEAFAAQEFPNWTVSLDGEGRVTLTATATGARPDLTAADFTNGSGAFSP
EEECCCCHHHHHHHHHHHCCCCEEEEECCCCEEEEEEEECCCCCCCCEECCCCCCCCCCC
LVETTGGTDGSINFTARGPAIAILPTLELSDVDSAMMSGAKVSMTEGLFDNGFGTIYERL
CEECCCCCCCEEEEEECCCEEEEEEECCCCCCCHHHHCCCEEEEECCCCCCCHHHHHHHH
SLSAEAREFAQQNGVGISIVTTAAAGSVITFTGMASAEVYETILRGVIYSNTNPNAVAGT
CCCHHHHHHHHHCCCEEEEEEECCCCCEEEEECCCHHHHHHHHHHHEEECCCCCCCCCCC
RPVKIEVTDSDGLASSLSSVNLTEGNTDIAVGQRIFINGVDSGQVVSMVRDATSFVASGP
CEEEEEEECCCCCHHHHCEEEEECCCCEEEECCEEEEEECCCCHHHHHHHHHHHHHHCCC
LADLEPGAVLSFHDGSGQQTTAVSAGDGTATMDVNVIWAPVIDMNGAGAGDIHRTTYIEQ
CCCCCCCCEEEEECCCCCEEEEEECCCCCEEEEEEEEEEEEEECCCCCCCCCCEEEEECC
HAPIAIATADARIVDQEGLIRSLDVVLTNPLDNVEGSAPVEYLGISKAVLDVLAARGITI
CCCEEEEECCCEEECCCCCCEEEEEEEECCCCCCCCCCCEEEECHHHHHHHHHHHCCEEE
GAHDGQFDANGNLTGATSITFAAANGASATSFQIALRGVTYANMDDAPDTGTRIVTAQGT
ECCCCEECCCCCEEECCEEEEEECCCCCCEEEEEEEEEEEEECCCCCCCCCCEEEEEECC
DMDGNEGLISHTEINPIAVGDAPVAIDSGVTGSEDAGHVFAAGDFGFADPLDGGANQLAS
CCCCCCCEEEECCCCEEEECCCCEEEECCCCCCCCCCEEEEECCCCCCCCCCCCCCCEEE
ITINSLPATGTLLLGGVAVAVGTVVTLAQLQAGALTYQPVANVNGEGVASFDFLVTDNGS
EEEECCCCCCEEEHHHHHHHHHHHHHHHHHHCCCEEECCCCCCCCCCEEEEEEEEECCCC
LANGGQTTSTAPATMVIDLTPVNDAPVLPEGTSVTGTTITEDQQLNAGELVADLVGAMTD
CCCCCCCCCCCCEEEEEEEECCCCCCCCCCCCCCCCCEECCCCCCCHHHHHHHHHHHHHH
VDTGVHSATNGTQQGIAVYGAGSEGFGGGTWQYRLAGGTDWIDVTLDPGEVLLLGADDRI
CCCCCCCCCCCCCCCEEEEECCCCCCCCCEEEEEECCCCCEEEEEECCCCEEEEECCCCE
RFSPDGENATEAQLSYYAWDGATGTAGNVVAGIAGPGNASNRGGTSAFSSNGASATVEVT
EECCCCCCCCCEEEEEEEECCCCCCCCCEEEEECCCCCCCCCCCCCCCCCCCCEEEEEEE
AVNDAPSISMGEGNTFYARGEAVALFSDETLQLTDPDEGAAVSQIVITLDGETTVDNAFG
EECCCCCEEECCCCEEEECCCEEEEEECCEEEEECCCCCCEEEEEEEEECCCCEECCCCC
TTYETIFSASGSTFVAQSGTELTISGTGVAGDPLTISGAGSMEDYREALLSLRYENTNPN
CHHHHHHCCCCCEEEEECCCEEEEECCCCCCCCEEEECCCCHHHHHHHHHEEEECCCCCC
AFAGDRAISVTVTDETGAGSAPTDFILPVEWATVADLNGPSGEGRDHSITYLEGSGSQAI
CCCCCEEEEEEEECCCCCCCCCCCEEEEECEEEEEECCCCCCCCCCCEEEEEECCCCCEE
ATADAEMIDQDGNTVEVVITLEDAVNGSAEMLFVDPAVLPALAALNIVVTGNGTHEIRLT
EECCHHHHCCCCCEEEEEEEEHHCCCCCEEEEEECHHHHHHHEEEEEEEECCCCEEEEEE
SEEGVDPTNFQLALRAVRYVNSSTAPTAAERHVTVSSTDADGNPGVPATTVIGMELGERR
CCCCCCCCHHHHHHHHHHHHCCCCCCCCHHCEEEEECCCCCCCCCCCEEEEEEEECCCCC
TGCGSLDLLRGVRDPQPAVGRSAAARRHAGRCRRARAEPAGHRMAAGRCGDRFGQRHAGL
CCCCHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHCCCCCCCCCCCCCHHHHHHHHHCCC
HAETGGCRPCHQRPHHLHRR
CCCCCCCCCHHCCCHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA