| Definition | Sphingopyxis alaskensis RB2256, complete genome. |
|---|---|
| Accession | NC_008048 |
| Length | 3,345,170 |
Click here to switch to the map view.
The map label for this gene is yfhM [C]
Identifier: 103487863
GI number: 103487863
Start: 2504500
End: 2510277
Strand: Direct
Name: yfhM [C]
Synonym: Sala_2382
Alternate gene names: 103487863
Gene position: 2504500-2510277 (Clockwise)
Preceding gene: 103487862
Following gene: 103487864
Centisome position: 74.87
GC content: 70.13
Gene sequence:
>5778_bases GTGCCGCTGACGCTCGCGATTGCCGCGACCGCCGCCGACACCGTGCCGCAGGTCATCCTCGCGACTCCGGGCAGCAGCGG CACCGGCGAGGGGACGGTCACCCGCTTTACGCTGCGCTTTTCCGAAGACATGGTCGCGCTCGGCGATCCGCGCGCCGCCG CCCCCGCGACCAACGACTGCAAGCGCCCGTCGACCGCCCGCTGGGTCGACACGCGCACCTGGGTGCTCGAGTTCGACGCG CCCTTGCCCGGTGGGTTGCGCTGCCATGTCGAGCTGCGGAGCGGGCTCGTCACCGCGCGCGGCGTCGCGGTCACCGGGAA CGACCGGTTCGCGATCGACACCGGCGGCCCCTCGGCGCGCGCGGTGCTCGCGGGCGGGATCGGCGGCGGGATCGAGGAGG AGCAGGTCTTCCTCGTCGCCACCAATGTCGCCGCCGACCGCGCCTCGGTCGCCCGCTACGGCTATTGCGCGGTTGACGGC ATCGGCGAGAAGATCCCGCTCGACGTGCTGCCGCGCGCGACCGCGACCGAGATCCTGACCGGGCTTGGCGATGCCAACTG GTCGCGCCAGTCCTTCACCTACGACGCCGGACTGCCGCAGCGCCTGCCCGCCGCGGGCGCCGAGCGCGACGCGGCGCTGG GCCGGATCGTCGCGGTCAAGTGCCGCCGCCCGCTGCCGCCGGGGCGCGACATGGCGCTCGTCTGGGACGCGCGCATCAGC CAAGCGGGCGTCCCCGGCCGCACCGCCGGGCGCGACCAGCGCTTCGACTATGACGTGCGCCCCGCCTTCACCGCCAAAAT GACGTGCAGCCGCGTCAATCCGCAGGCGGGGTGCAACCCGATCAAGGATGTTGTGCTGCGCTTCACCGCGCCCGTCGCGC GCGACACCGCGCTCGCGGCGAAGCTGACCACCGCCGACGGCCAGACGATCGCGGCAAAGTTCGACGACGACGACCGGGGC GACACGCATCTGACGCAGGTCCGCTTCGCCGGGCCGCTGCCGCAGAATGTCGACGCGGCGCTGATCCTGCCCGCCGACGT CACCGACCAGAGCGGCCGCGCGCTGCTCAACGCGTCGAACTTCCCGCTCGACTTCCACATCGACCGCACCCCGCCGCTCG TCAAATTCGCCGCCGAATTCGGCATATTGGAGGCGAGCGAGGGCGGCGTGCTGCCCGTCACCGTGCGCGGCGTCGAAGCC TCGCTGGTTCAGAAGAATCTCAAAATGCCCGCCGCAACGCTGCGCATCGGCGACGACGATGCCGCGGTCGCGCGCTGGCT CCGCCGCGTCGCGGATGCCGACGACAGCGATTATCGCGAGGAAAAGGATGCCGCGGGCAAGGAGATCACCGTCAACTACA CCGGCACCAAATCACTGTTCGACGGCGCGCCGCCCGGCGGCGAGCGCCGCGATATGCAGCTCACCCCGCCCGCGGGCGGC AAGGAGTTCGAGGTCGTCGGCATTCCGCTCGCCGAAAAAGGTTTCCACATCGTCGAGGTCGCGAGCCCCGAACTCGGCGC CGCGCTGCTCGGTCGCAAGGCGACGCGCTATGTCGCGACCGCCGCGCTCGTCACCGACATGGCGGTGCATTTCAAATGGG GCCGCGACGGCTCGCTCGCCTGGGTCACATCGCTCGCGACCGGCAAGCCCGTCGCAGGCGCCGAAATCCGCGTTTCCGAC AGCTGCACCGGCCGCCTGCTCGCGCGCGGCACCGCCGACAAGGCGGGCCGCCTCGCCTTCCCCTCGGGCCTGCCGCAGCC CGAAACCTATTCGAACTGCGAAGACGACGCCGACCCCACGAACAGCGAGGGTCATGCGCTGATGGTCAGCGCGCGGTCGG GCGATGATTTCAGCTTCACCCTCACCGACTGGGGCGACGGCATCCGCCCCTATGACTTCGACCTCCCCTATGGCTGGTCG GAGCGCGAGGACATTCTCCACACCGTCTTCGACCGCGCGCTCGTCCAGGCGGGCGAGACGGTGCATATGAAGCATGTGCT GCGCCGCCCCGTCGGCCTCGGCTTTCGCACCCCCGAACCGCTGGCGGGCAAGCTCCGCCTCGTCCACCGCGGCTCCGATA CCGAGTTCGAAATGCCCTTTGCGATTGCCGCCACCGGCAGCGGCGAGAGCGTGTGGAACGTCCCGCAATCGGCGCCGATG GGCGATTATGAACTCGTCTTCGTCACCACAGACAAAAAGGGCGAGGACAGGAGCATCTGGACGGGCCAGAGCGTGCGCGT CGACGAATATCGCCTGCCGACGATGAAGGCCGCGATCACCGGCCCCAAAGGCGCGCTCGTGCGCCCAGCCGCGGTGCCGC TCAGCCTGTTCGTCGGCTATCTGTCGGGCGGCCCCGCGCCGGGCATCCCCGTTGAACTGCGCACCAGTTTCCGCGCCGCC TGGTCGCCGCCAGAGGATTATCGCGACTGGGATTTCGACGGCCGCCCGGTCAGGGAAGGCACCGTCCAGCTCGACGACAG CGGCGAGGAACCCGGCGGCGACCTGCCGCTCGCGCGCTCGGTGCCGCTGACGCTCGGCGCCGACGGCACCGCATCGACCA GCGTCATCGTCGACCAGCCGATCAGCGAGCCCACGGTGATGGCCGCCGAAATGGACTATGCGGATGCCAATGGCGAAACG CTGACCGCGAGCCGCCGCATCACCCTTTATCCCTCCGCCGTCCGCCTCGGCCTCAGGACCGACGGCTGGATGATGCGCGA CGATGATCTGCGCCTCAATTTCATCGCGCTCGACCTGGGCGGCAAGCCGATCCGCGGCCAGCGCGTCGATGTCGCGCTCT ACAGCCGCCAGATCATCACCGCGCGCCGCCGCCTGATCGGCGGCTTCTATGCCTATGACAACCAGATGCGCACCGCGAAG CTGTCGGCGAACTGCACCGCGACGACCGACCGGCTCGGCCGCGCCAGCTGCGCGATGGCGCCCGGCGTCTCGGGCGAAGT CACCGTCGTTGCGACGACGCACGACGCCGACGGCAACGAAGCGCGCGCCGTCCGCTCGGTCTGGCTCGCGGGCGACGACG AATGGTGGTTCGGCGGCGACAATGGCGACCGCATGGACGTGATCGCCGAAGCGCCGCGCTACGCCGCGGGCGACACCGCG CGCTTTCAGGTGCGGATGCCCTTCCGCGAAGCGACCGCGCTCGTCACCGTCGAGCGCGAGGGCGTGCTATCGAGCTTCGT CGTGCCCCTGAAGGGCACCAATCCCGTCGTGACGGTCAAGCTGCCCGCGACCTACGCTCCCGACGTCTATGTCTCGGTGA TGGCGGTGCGCGGGCGCGTCACGGGGCAGGAAAGCTGGTTTCGCAAGATGAAGCGCGCGGTCGGTTTCCAGATCGAGACG AGCGAAGGCGCGCCGCCGACCGCGCTCGTCGATCTTGCCAAGCCCGCCTATCGCATCGGCATCGCGCGCATCAAGGTCGG CTGGGAAGGGCATAAGCTCGACGTCAAGGTCCGCGCCGACAAGGAAAAATATGCGGTGCGCGAAACCGCGAAAGTCGGCA TCGAGGTCAAGGCGCCGGGCGGCAAGGCGCCGAAGAATGCCGACGTCGCCTTCGCCGCGGTCGACGAGGCGTTGCTCCAG CTCGCCCCCAACGAAAGCTGGGACATACTCGCCGCGATGATGGGCGACCGCACCCTCGACGTGCTCACCTCGACCGCGCA GATGCAGGTGGTGGGTAAACGCCATTATGGCCGCAAGGCGCTCGAACCGGGCGGCGGCGGCGGCGGCGACCTCAGCGGGC TGACGCGCGAGGATTTCCGCCCGGTGCTGCTCTGGAAAGGCACTGTCCCGCTCGACGCCAGGGGCCGCGCCTCCATCGAT GTGCCGCTCAGCGACAATCTTTCGGGCTTCCGCCTCGTCGCGATCGCGACCGACGGATCGCAATTTTTCGGCACCGGCGA AACGAGCGTGCGCACCGTGCAGGATCTCGGCGTCTTTGCCGGGCTGCCCGAACTGGTCCGCACCGGCGACGCCTATGACG CGCGCTTCACGCTGCGCAACGGCACCGACAAACCGATGGAGGTCACCGCGACCGCGACGATCTCGCCCGCGATCGCGACC GCGCCGCCCCTGACGGTGACGATCCCCGCGGGCGGCGCGGTGCCGGTGAGCTGGGCGATCACCGCGCCCGATCAGGCGGG GCCGCTGAGCTGGACCGTCGAAGCGGCGACAAGGGACGGCAAGGCGCGCGACCGCCTCGTCTTCGAACAGATCGTCGAAC CCGCGGTGCCGGTCGAAACCTGGGCCGCCAGCCTCTTCCGCGTCGGACCGGCCACGACCTTGCCCATCGCGATTCCCGCA GGCGCGCTGCCCGGCGGCTATGTCGATGTCGCGCTCGCGGGCACGCTCGCGCCGCCGCTCGCGGGGGTGCGCGACTATAT GGCCGCCTATCCCTACACCTGTTTCGAACAACAGACGTCGCGCGCCGTCGCGCTCGGCGACCTTGGGCGGTGGCAGGCGC TGGCGGGTGCGATGCCGACCTATCTCGATGACGACGGGCTGCTGCGCTACTGGCCCAACGAGCGGATGGAAGGGTCGATC GAGCTCACCGCCTATGTCCTCGGCATCAGCGCGGCGAACGGCTTTGCGATCCCCGAAACCTCGCGGGCAAAGATGATCGC CGCGCTGCAAGCGGTGGTCGAGGGGCGGCTGGCGCGCCGCGGCTATGGCCCGTGGGACATTCGCCCCGTGCGCGTCGCCG CGCTCGCCGCGCTCGCGCGCGCCAATGCCGCGAACGCGCGCCTCGTCGCCGCAATCGACATGGCGCCCGCCGACATGACG ACGGGCACGCTCGCCGACTGGCTCGTCGCGATCGAACGGACGCCCGGCGTGCGGGGCGCCGCCGCGCTGCGCACCGCGGC CGAGGCCGAGCTTCGCAAGCGCCTCGTTTACGAAGGCACACGCCTCGACCTCGTCGACGATGCGCGCGCGCCATGGTGGA TGATGGTCAGCGGCGACGAAATGGCGATCAAGGCGCTGGGCGCCGTCCTCGGCCGCAAGGGATGGGAGGATGACGCGGGC AAGCTGATGGTCGGCGTCGCCCAGCGCCAGCGCAAGGGGCATTGGGACACGACTCCCGCAAACGCATGGGGCGCGGTCAC CGTCCGCCGCTTTGCCGAGCTTTATCCGGCGAGCGCGATCACCGGCGTCACGACCATCGGCCTTGCGGGCAATACCGCTT CGCAAAGCTGGCCGCTCCCCGCTGAGCCGCCCTCGCCGCTTCGCGTCGCGCTCAATGCCGCGACGATGAGCCTCAATCAT CGGGGCACGGGATCGCCATGGGCGACCGTCAGCGTCAAGGCCGCGGTGCCTTTGAAGGAGCCGCTCAATGCGGGCTACCG GATCAAACGCTCGGTGAGCATCGTCAAGGCGGCGAACAAGGACCGGCTGACGCGCGGCGACGTCATCAAGATACGGATCG AGGTCGCCGCCGCCGCGGGCCGGACGTGGGTGGTCATCAGCGATCCCGTCGCCCCCGGCGCGACGATCGTCGGCAATCTC GGCGGCCAGTCCGAAATGCTGGGCGCGCAAGCGGGCGGATCGGGCGCGCAGCCCAGCTATGTCGAGCGCGGCAAGGACAG CTGGCGCGGCTATTTCGGCTGGATGCCCGCGGGCACCCACGCGGTCGAATATGTCGTCCGCCTCAATGGCTCGGGCCGCT TCACCCTGCCCCCGACGCGCGTCGAGGCGATGTATTCGCCCGCGATCCGCGGCCAATGGCCGAACGCGCCGCTGACCGTG GCGAATGTGGGGTCGTGA
Upstream 100 bases:
>100_bases AGGATAGACGTGCGGGCCAGCGACGGGAGGCGGGGCGATGACGACAGCGTGGCAAGGGCTCGGTCGATGGCTGGCCGGTC GCGCAAAACTGGCGCTGATC
Downstream 100 bases:
>100_bases TGATCTTTGATCTGTGGGCCGAAAACCAAACCCCTCCCCTTCAGGGGAGGGGCAACGAAGACTTGGCAGCTTGCTGCCTA GTCGTAGTGGGGTGGGGGCC
Product: alpha-2-macroglobulin-like protein
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 1925; Mature: 1924
Protein sequence:
>1925_residues MPLTLAIAATAADTVPQVILATPGSSGTGEGTVTRFTLRFSEDMVALGDPRAAAPATNDCKRPSTARWVDTRTWVLEFDA PLPGGLRCHVELRSGLVTARGVAVTGNDRFAIDTGGPSARAVLAGGIGGGIEEEQVFLVATNVAADRASVARYGYCAVDG IGEKIPLDVLPRATATEILTGLGDANWSRQSFTYDAGLPQRLPAAGAERDAALGRIVAVKCRRPLPPGRDMALVWDARIS QAGVPGRTAGRDQRFDYDVRPAFTAKMTCSRVNPQAGCNPIKDVVLRFTAPVARDTALAAKLTTADGQTIAAKFDDDDRG DTHLTQVRFAGPLPQNVDAALILPADVTDQSGRALLNASNFPLDFHIDRTPPLVKFAAEFGILEASEGGVLPVTVRGVEA SLVQKNLKMPAATLRIGDDDAAVARWLRRVADADDSDYREEKDAAGKEITVNYTGTKSLFDGAPPGGERRDMQLTPPAGG KEFEVVGIPLAEKGFHIVEVASPELGAALLGRKATRYVATAALVTDMAVHFKWGRDGSLAWVTSLATGKPVAGAEIRVSD SCTGRLLARGTADKAGRLAFPSGLPQPETYSNCEDDADPTNSEGHALMVSARSGDDFSFTLTDWGDGIRPYDFDLPYGWS EREDILHTVFDRALVQAGETVHMKHVLRRPVGLGFRTPEPLAGKLRLVHRGSDTEFEMPFAIAATGSGESVWNVPQSAPM GDYELVFVTTDKKGEDRSIWTGQSVRVDEYRLPTMKAAITGPKGALVRPAAVPLSLFVGYLSGGPAPGIPVELRTSFRAA WSPPEDYRDWDFDGRPVREGTVQLDDSGEEPGGDLPLARSVPLTLGADGTASTSVIVDQPISEPTVMAAEMDYADANGET LTASRRITLYPSAVRLGLRTDGWMMRDDDLRLNFIALDLGGKPIRGQRVDVALYSRQIITARRRLIGGFYAYDNQMRTAK LSANCTATTDRLGRASCAMAPGVSGEVTVVATTHDADGNEARAVRSVWLAGDDEWWFGGDNGDRMDVIAEAPRYAAGDTA RFQVRMPFREATALVTVEREGVLSSFVVPLKGTNPVVTVKLPATYAPDVYVSVMAVRGRVTGQESWFRKMKRAVGFQIET SEGAPPTALVDLAKPAYRIGIARIKVGWEGHKLDVKVRADKEKYAVRETAKVGIEVKAPGGKAPKNADVAFAAVDEALLQ LAPNESWDILAAMMGDRTLDVLTSTAQMQVVGKRHYGRKALEPGGGGGGDLSGLTREDFRPVLLWKGTVPLDARGRASID VPLSDNLSGFRLVAIATDGSQFFGTGETSVRTVQDLGVFAGLPELVRTGDAYDARFTLRNGTDKPMEVTATATISPAIAT APPLTVTIPAGGAVPVSWAITAPDQAGPLSWTVEAATRDGKARDRLVFEQIVEPAVPVETWAASLFRVGPATTLPIAIPA GALPGGYVDVALAGTLAPPLAGVRDYMAAYPYTCFEQQTSRAVALGDLGRWQALAGAMPTYLDDDGLLRYWPNERMEGSI ELTAYVLGISAANGFAIPETSRAKMIAALQAVVEGRLARRGYGPWDIRPVRVAALAALARANAANARLVAAIDMAPADMT TGTLADWLVAIERTPGVRGAAALRTAAEAELRKRLVYEGTRLDLVDDARAPWWMMVSGDEMAIKALGAVLGRKGWEDDAG KLMVGVAQRQRKGHWDTTPANAWGAVTVRRFAELYPASAITGVTTIGLAGNTASQSWPLPAEPPSPLRVALNAATMSLNH RGTGSPWATVSVKAAVPLKEPLNAGYRIKRSVSIVKAANKDRLTRGDVIKIRIEVAAAAGRTWVVISDPVAPGATIVGNL GGQSEMLGAQAGGSGAQPSYVERGKDSWRGYFGWMPAGTHAVEYVVRLNGSGRFTLPPTRVEAMYSPAIRGQWPNAPLTV ANVGS
Sequences:
>Translated_1925_residues MPLTLAIAATAADTVPQVILATPGSSGTGEGTVTRFTLRFSEDMVALGDPRAAAPATNDCKRPSTARWVDTRTWVLEFDA PLPGGLRCHVELRSGLVTARGVAVTGNDRFAIDTGGPSARAVLAGGIGGGIEEEQVFLVATNVAADRASVARYGYCAVDG IGEKIPLDVLPRATATEILTGLGDANWSRQSFTYDAGLPQRLPAAGAERDAALGRIVAVKCRRPLPPGRDMALVWDARIS QAGVPGRTAGRDQRFDYDVRPAFTAKMTCSRVNPQAGCNPIKDVVLRFTAPVARDTALAAKLTTADGQTIAAKFDDDDRG DTHLTQVRFAGPLPQNVDAALILPADVTDQSGRALLNASNFPLDFHIDRTPPLVKFAAEFGILEASEGGVLPVTVRGVEA SLVQKNLKMPAATLRIGDDDAAVARWLRRVADADDSDYREEKDAAGKEITVNYTGTKSLFDGAPPGGERRDMQLTPPAGG KEFEVVGIPLAEKGFHIVEVASPELGAALLGRKATRYVATAALVTDMAVHFKWGRDGSLAWVTSLATGKPVAGAEIRVSD SCTGRLLARGTADKAGRLAFPSGLPQPETYSNCEDDADPTNSEGHALMVSARSGDDFSFTLTDWGDGIRPYDFDLPYGWS EREDILHTVFDRALVQAGETVHMKHVLRRPVGLGFRTPEPLAGKLRLVHRGSDTEFEMPFAIAATGSGESVWNVPQSAPM GDYELVFVTTDKKGEDRSIWTGQSVRVDEYRLPTMKAAITGPKGALVRPAAVPLSLFVGYLSGGPAPGIPVELRTSFRAA WSPPEDYRDWDFDGRPVREGTVQLDDSGEEPGGDLPLARSVPLTLGADGTASTSVIVDQPISEPTVMAAEMDYADANGET LTASRRITLYPSAVRLGLRTDGWMMRDDDLRLNFIALDLGGKPIRGQRVDVALYSRQIITARRRLIGGFYAYDNQMRTAK LSANCTATTDRLGRASCAMAPGVSGEVTVVATTHDADGNEARAVRSVWLAGDDEWWFGGDNGDRMDVIAEAPRYAAGDTA RFQVRMPFREATALVTVEREGVLSSFVVPLKGTNPVVTVKLPATYAPDVYVSVMAVRGRVTGQESWFRKMKRAVGFQIET SEGAPPTALVDLAKPAYRIGIARIKVGWEGHKLDVKVRADKEKYAVRETAKVGIEVKAPGGKAPKNADVAFAAVDEALLQ LAPNESWDILAAMMGDRTLDVLTSTAQMQVVGKRHYGRKALEPGGGGGGDLSGLTREDFRPVLLWKGTVPLDARGRASID VPLSDNLSGFRLVAIATDGSQFFGTGETSVRTVQDLGVFAGLPELVRTGDAYDARFTLRNGTDKPMEVTATATISPAIAT APPLTVTIPAGGAVPVSWAITAPDQAGPLSWTVEAATRDGKARDRLVFEQIVEPAVPVETWAASLFRVGPATTLPIAIPA GALPGGYVDVALAGTLAPPLAGVRDYMAAYPYTCFEQQTSRAVALGDLGRWQALAGAMPTYLDDDGLLRYWPNERMEGSI ELTAYVLGISAANGFAIPETSRAKMIAALQAVVEGRLARRGYGPWDIRPVRVAALAALARANAANARLVAAIDMAPADMT TGTLADWLVAIERTPGVRGAAALRTAAEAELRKRLVYEGTRLDLVDDARAPWWMMVSGDEMAIKALGAVLGRKGWEDDAG KLMVGVAQRQRKGHWDTTPANAWGAVTVRRFAELYPASAITGVTTIGLAGNTASQSWPLPAEPPSPLRVALNAATMSLNH RGTGSPWATVSVKAAVPLKEPLNAGYRIKRSVSIVKAANKDRLTRGDVIKIRIEVAAAAGRTWVVISDPVAPGATIVGNL GGQSEMLGAQAGGSGAQPSYVERGKDSWRGYFGWMPAGTHAVEYVVRLNGSGRFTLPPTRVEAMYSPAIRGQWPNAPLTV ANVGS >Mature_1924_residues PLTLAIAATAADTVPQVILATPGSSGTGEGTVTRFTLRFSEDMVALGDPRAAAPATNDCKRPSTARWVDTRTWVLEFDAP LPGGLRCHVELRSGLVTARGVAVTGNDRFAIDTGGPSARAVLAGGIGGGIEEEQVFLVATNVAADRASVARYGYCAVDGI GEKIPLDVLPRATATEILTGLGDANWSRQSFTYDAGLPQRLPAAGAERDAALGRIVAVKCRRPLPPGRDMALVWDARISQ AGVPGRTAGRDQRFDYDVRPAFTAKMTCSRVNPQAGCNPIKDVVLRFTAPVARDTALAAKLTTADGQTIAAKFDDDDRGD THLTQVRFAGPLPQNVDAALILPADVTDQSGRALLNASNFPLDFHIDRTPPLVKFAAEFGILEASEGGVLPVTVRGVEAS LVQKNLKMPAATLRIGDDDAAVARWLRRVADADDSDYREEKDAAGKEITVNYTGTKSLFDGAPPGGERRDMQLTPPAGGK EFEVVGIPLAEKGFHIVEVASPELGAALLGRKATRYVATAALVTDMAVHFKWGRDGSLAWVTSLATGKPVAGAEIRVSDS CTGRLLARGTADKAGRLAFPSGLPQPETYSNCEDDADPTNSEGHALMVSARSGDDFSFTLTDWGDGIRPYDFDLPYGWSE REDILHTVFDRALVQAGETVHMKHVLRRPVGLGFRTPEPLAGKLRLVHRGSDTEFEMPFAIAATGSGESVWNVPQSAPMG DYELVFVTTDKKGEDRSIWTGQSVRVDEYRLPTMKAAITGPKGALVRPAAVPLSLFVGYLSGGPAPGIPVELRTSFRAAW SPPEDYRDWDFDGRPVREGTVQLDDSGEEPGGDLPLARSVPLTLGADGTASTSVIVDQPISEPTVMAAEMDYADANGETL TASRRITLYPSAVRLGLRTDGWMMRDDDLRLNFIALDLGGKPIRGQRVDVALYSRQIITARRRLIGGFYAYDNQMRTAKL SANCTATTDRLGRASCAMAPGVSGEVTVVATTHDADGNEARAVRSVWLAGDDEWWFGGDNGDRMDVIAEAPRYAAGDTAR FQVRMPFREATALVTVEREGVLSSFVVPLKGTNPVVTVKLPATYAPDVYVSVMAVRGRVTGQESWFRKMKRAVGFQIETS EGAPPTALVDLAKPAYRIGIARIKVGWEGHKLDVKVRADKEKYAVRETAKVGIEVKAPGGKAPKNADVAFAAVDEALLQL APNESWDILAAMMGDRTLDVLTSTAQMQVVGKRHYGRKALEPGGGGGGDLSGLTREDFRPVLLWKGTVPLDARGRASIDV PLSDNLSGFRLVAIATDGSQFFGTGETSVRTVQDLGVFAGLPELVRTGDAYDARFTLRNGTDKPMEVTATATISPAIATA PPLTVTIPAGGAVPVSWAITAPDQAGPLSWTVEAATRDGKARDRLVFEQIVEPAVPVETWAASLFRVGPATTLPIAIPAG ALPGGYVDVALAGTLAPPLAGVRDYMAAYPYTCFEQQTSRAVALGDLGRWQALAGAMPTYLDDDGLLRYWPNERMEGSIE LTAYVLGISAANGFAIPETSRAKMIAALQAVVEGRLARRGYGPWDIRPVRVAALAALARANAANARLVAAIDMAPADMTT GTLADWLVAIERTPGVRGAAALRTAAEAELRKRLVYEGTRLDLVDDARAPWWMMVSGDEMAIKALGAVLGRKGWEDDAGK LMVGVAQRQRKGHWDTTPANAWGAVTVRRFAELYPASAITGVTTIGLAGNTASQSWPLPAEPPSPLRVALNAATMSLNHR GTGSPWATVSVKAAVPLKEPLNAGYRIKRSVSIVKAANKDRLTRGDVIKIRIEVAAAAGRTWVVISDPVAPGATIVGNLG GQSEMLGAQAGGSGAQPSYVERGKDSWRGYFGWMPAGTHAVEYVVRLNGSGRFTLPPTRVEAMYSPAIRGQWPNAPLTVA NVGS
Specific function: Unknown
COG id: COG2373
COG function: function code R; Large extracellular alpha-helical protein
Gene ontology:
Cell location: Attached to the membrane by a lipid anchor (Potential) [C]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the UPF0192 family [H]
Homologues:
None
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR002890 - InterPro: IPR011625 - InterPro: IPR021868 - InterPro: IPR001599 - InterPro: IPR008930 [H]
Pfam domain/function: PF00207 A2M; PF01835 A2M_N; PF07703 A2M_N_2; PF11974 MG1 [H]
EC number: NA
Molecular weight: Translated: 204953; Mature: 204821
Theoretical pI: Translated: 6.37; Mature: 6.37
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.6 %Cys (Translated Protein) 2.1 %Met (Translated Protein) 2.6 %Cys+Met (Translated Protein) 0.6 %Cys (Mature Protein) 2.0 %Met (Mature Protein) 2.6 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MPLTLAIAATAADTVPQVILATPGSSGTGEGTVTRFTLRFSEDMVALGDPRAAAPATNDC CCEEEEEEECCCCCCCEEEEECCCCCCCCCCEEEEEEEEECCCEEEECCCCCCCCCCCCC KRPSTARWVDTRTWVLEFDAPLPGGLRCHVELRSGLVTARGVAVTGNDRFAIDTGGPSAR CCCCCCEEEECEEEEEEECCCCCCCEEEEEEECCCEEEECEEEEECCCEEEEECCCCCCE AVLAGGIGGGIEEEQVFLVATNVAADRASVARYGYCAVDGIGEKIPLDVLPRATATEILT EEEECCCCCCCCCCEEEEEEECCCCCHHHHHHCCEEEECCCCCCCCHHHCCCCHHHHHHH GLGDANWSRQSFTYDAGLPQRLPAAGAERDAALGRIVAVKCRRPLPPGRDMALVWDARIS HCCCCCCCCCCEEECCCCCCCCCCCCCCCHHHHCEEEEEEECCCCCCCCCEEEEEECCHH QAGVPGRTAGRDQRFDYDVRPAFTAKMTCSRVNPQAGCNPIKDVVLRFTAPVARDTALAA CCCCCCCCCCCCCCCCCCCCCCEEEEEEECCCCCCCCCCHHHHHHHHHCCCCCCCCEEEE KLTTADGQTIAAKFDDDDRGDTHLTQVRFAGPLPQNVDAALILPADVTDQSGRALLNASN EEEECCCCEEEEECCCCCCCCCEEEEEEECCCCCCCCCEEEEEECCCCCCCCCEEEECCC FPLDFHIDRTPPLVKFAAEFGILEASEGGVLPVTVRGVEASLVQKNLKMPAATLRIGDDD CCEEEEECCCCHHHHHHHHHCEEECCCCCEEEEEEECCHHHHHHHHCCCCEEEEEECCCH AAVARWLRRVADADDSDYREEKDAAGKEITVNYTGTKSLFDGAPPGGERRDMQLTPPAGG HHHHHHHHHHHCCCCCHHHHHHHCCCCEEEEEECCCHHHCCCCCCCCCCCCEEECCCCCC KEFEVVGIPLAEKGFHIVEVASPELGAALLGRKATRYVATAALVTDMAVHFKWGRDGSLA CEEEEEEECCCCCCEEEEEECCCCCCHHHHCCHHHHHHHHHHHHHHEEEEEEECCCCCEE WVTSLATGKPVAGAEIRVSDSCTGRLLARGTADKAGRLAFPSGLPQPETYSNCEDDADPT EEEEECCCCCCCCCEEEECCCCCCEEEECCCCCCCCCEECCCCCCCCCCCCCCCCCCCCC NSEGHALMVSARSGDDFSFTLTDWGDGIRPYDFDLPYGWSEREDILHTVFDRALVQAGET CCCCCEEEEEECCCCCEEEEEECCCCCCCCEECCCCCCCCCHHHHHHHHHHHHHHHCCCE VHMKHVLRRPVGLGFRTPEPLAGKLRLVHRGSDTEFEMPFAIAATGSGESVWNVPQSAPM EHHHHHHHCCCCCCCCCCCCCCCEEEEEECCCCCCEECCEEEEECCCCCCEECCCCCCCC GDYELVFVTTDKKGEDRSIWTGQSVRVDEYRLPTMKAAITGPKGALVRPAAVPLSLFVGY CCEEEEEEEECCCCCCCCEECCCCEEECCEECCEEEEEEECCCCCEECCHHHHHHHHHHH LSGGPAPGIPVELRTSFRAAWSPPEDYRDWDFDGRPVREGTVQLDDSGEEPGGDLPLARS HCCCCCCCCCEEEECCEEECCCCCCCCCCCCCCCCCCCCCEEEECCCCCCCCCCCCCCCC VPLTLGADGTASTSVIVDQPISEPTVMAAEMDYADANGETLTASRRITLYPSAVRLGLRT CCEEECCCCCCCCEEEEECCCCCCEEEEEECCCCCCCCCEEEECCEEEEEHHHEEEEECC DGWMMRDDDLRLNFIALDLGGKPIRGQRVDVALYSRQIITARRRLIGGFYAYDNQMRTAK CCCEEECCCCEEEEEEEECCCCCCCCCEEEEEEHHHHHHHHHHHHHCEEEEECCCEEEEE LSANCTATTDRLGRASCAMAPGVSGEVTVVATTHDADGNEARAVRSVWLAGDDEWWFGGD ECCCCEECHHHCCCCHHHCCCCCCCCEEEEEEECCCCCCHHHEEEEEEEECCCCEEECCC NGDRMDVIAEAPRYAAGDTARFQVRMPFREATALVTVEREGVLSSFVVPLKGTNPVVTVK CCCEEEEEECCCCCCCCCCEEEEEECCCCCCEEEEEEECCCCCCCEEEEECCCCCEEEEE LPATYAPDVYVSVMAVRGRVTGQESWFRKMKRAVGFQIETSEGAPPTALVDLAKPAYRIG ECCCCCCCCEEEEEEECCCCCCHHHHHHHHHHHHCEEEECCCCCCCHHHHHHCCCCCEEE IARIKVGWEGHKLDVKVRADKEKYAVRETAKVGIEVKAPGGKAPKNADVAFAAVDEALLQ EEEEEECCCCCEEEEEEECCCHHHHHHHHHHCCEEEECCCCCCCCCCCEEHHHHHHHHHH LAPNESWDILAAMMGDRTLDVLTSTAQMQVVGKRHYGRKALEPGGGGGGDLSGLTREDFR HCCCCCHHHHHHHHCCCEEEHHHCCHHEEEEHHHHCCCCCCCCCCCCCCCCCCCCHHCCC PVLLWKGTVPLDARGRASIDVPLSDNLSGFRLVAIATDGSQFFGTGETSVRTVQDLGVFA EEEEEECCCCCCCCCCEEEECCCCCCCCCEEEEEEEECCCEEECCCCCHHHHHHHHHHHC GLPELVRTGDAYDARFTLRNGTDKPMEVTATATISPAIATAPPLTVTIPAGGAVPVSWAI CCHHHHHCCCCCEEEEEECCCCCCCEEEEEEEEECCCCCCCCCEEEEECCCCCEEEEEEE TAPDQAGPLSWTVEAATRDGKARDRLVFEQIVEPAVPVETWAASLFRVGPATTLPIAIPA ECCCCCCCEEEEEEECCCCCCHHHHHHHHHHHCCCCCHHHHHHHHHHCCCCCEEEEEECC GALPGGYVDVALAGTLAPPLAGVRDYMAAYPYTCFEQQTSRAVALGDLGRWQALAGAMPT CCCCCCEEEEEEECCCCCCHHHHHHHHHHCCCHHHHHHCCCEEEECCCCHHHHHHCCCCC YLDDDGLLRYWPNERMEGSIELTAYVLGISAANGFAIPETSRAKMIAALQAVVEGRLARR EECCCCEEEECCCCCCCCCEEEEEEEEEEECCCCCCCCCCCHHHHHHHHHHHHHHHHHHC GYGPWDIRPVRVAALAALARANAANARLVAAIDMAPADMTTGTLADWLVAIERTPGVRGA CCCCCCCCHHHHHHHHHHHHCCCCCCEEEEEEECCCCCCCCHHHHHHHEEEECCCCCCCH AALRTAAEAELRKRLVYEGTRLDLVDDARAPWWMMVSGDEMAIKALGAVLGRKGWEDDAG HHHHHHHHHHHHHHHHHCCCEEEEEECCCCCEEEEECCCHHHHHHHHHHHCCCCCCCCCC KLMVGVAQRQRKGHWDTTPANAWGAVTVRRFAELYPASAITGVTTIGLAGNTASQSWPLP CEEEEEHHHHHCCCCCCCCCCCCHHHHHHHHHHHCCCCHHCCEEEEEECCCCCCCCCCCC AEPPSPLRVALNAATMSLNHRGTGSPWATVSVKAAVPLKEPLNAGYRIKRSVSIVKAANK CCCCCCEEEEEEEEEEEECCCCCCCCEEEEEEEEECCCHHHCCCCEEEEEEEEEEEECCC DRLTRGDVIKIRIEVAAAAGRTWVVISDPVAPGATIVGNLGGQSEMLGAQAGGSGAQPSY CCCCCCCEEEEEEEEEECCCCEEEEEECCCCCCCEEEECCCCCHHEEECCCCCCCCCCHH VERGKDSWRGYFGWMPAGTHAVEYVVRLNGSGRFTLPPTRVEAMYSPAIRGQWPNAPLTV HHCCCHHCCEEEECCCCCCCEEEEEEEECCCCEEECCCHHHHHHHCCHHCCCCCCCCEEE ANVGS EECCC >Mature Secondary Structure PLTLAIAATAADTVPQVILATPGSSGTGEGTVTRFTLRFSEDMVALGDPRAAAPATNDC CEEEEEEECCCCCCCEEEEECCCCCCCCCCEEEEEEEEECCCEEEECCCCCCCCCCCCC KRPSTARWVDTRTWVLEFDAPLPGGLRCHVELRSGLVTARGVAVTGNDRFAIDTGGPSAR CCCCCCEEEECEEEEEEECCCCCCCEEEEEEECCCEEEECEEEEECCCEEEEECCCCCCE AVLAGGIGGGIEEEQVFLVATNVAADRASVARYGYCAVDGIGEKIPLDVLPRATATEILT EEEECCCCCCCCCCEEEEEEECCCCCHHHHHHCCEEEECCCCCCCCHHHCCCCHHHHHHH GLGDANWSRQSFTYDAGLPQRLPAAGAERDAALGRIVAVKCRRPLPPGRDMALVWDARIS HCCCCCCCCCCEEECCCCCCCCCCCCCCCHHHHCEEEEEEECCCCCCCCCEEEEEECCHH QAGVPGRTAGRDQRFDYDVRPAFTAKMTCSRVNPQAGCNPIKDVVLRFTAPVARDTALAA CCCCCCCCCCCCCCCCCCCCCCEEEEEEECCCCCCCCCCHHHHHHHHHCCCCCCCCEEEE KLTTADGQTIAAKFDDDDRGDTHLTQVRFAGPLPQNVDAALILPADVTDQSGRALLNASN EEEECCCCEEEEECCCCCCCCCEEEEEEECCCCCCCCCEEEEEECCCCCCCCCEEEECCC FPLDFHIDRTPPLVKFAAEFGILEASEGGVLPVTVRGVEASLVQKNLKMPAATLRIGDDD CCEEEEECCCCHHHHHHHHHCEEECCCCCEEEEEEECCHHHHHHHHCCCCEEEEEECCCH AAVARWLRRVADADDSDYREEKDAAGKEITVNYTGTKSLFDGAPPGGERRDMQLTPPAGG HHHHHHHHHHHCCCCCHHHHHHHCCCCEEEEEECCCHHHCCCCCCCCCCCCEEECCCCCC KEFEVVGIPLAEKGFHIVEVASPELGAALLGRKATRYVATAALVTDMAVHFKWGRDGSLA CEEEEEEECCCCCCEEEEEECCCCCCHHHHCCHHHHHHHHHHHHHHEEEEEEECCCCCEE WVTSLATGKPVAGAEIRVSDSCTGRLLARGTADKAGRLAFPSGLPQPETYSNCEDDADPT EEEEECCCCCCCCCEEEECCCCCCEEEECCCCCCCCCEECCCCCCCCCCCCCCCCCCCCC NSEGHALMVSARSGDDFSFTLTDWGDGIRPYDFDLPYGWSEREDILHTVFDRALVQAGET CCCCCEEEEEECCCCCEEEEEECCCCCCCCEECCCCCCCCCHHHHHHHHHHHHHHHCCCE VHMKHVLRRPVGLGFRTPEPLAGKLRLVHRGSDTEFEMPFAIAATGSGESVWNVPQSAPM EHHHHHHHCCCCCCCCCCCCCCCEEEEEECCCCCCEECCEEEEECCCCCCEECCCCCCCC GDYELVFVTTDKKGEDRSIWTGQSVRVDEYRLPTMKAAITGPKGALVRPAAVPLSLFVGY CCEEEEEEEECCCCCCCCEECCCCEEECCEECCEEEEEEECCCCCEECCHHHHHHHHHHH LSGGPAPGIPVELRTSFRAAWSPPEDYRDWDFDGRPVREGTVQLDDSGEEPGGDLPLARS HCCCCCCCCCEEEECCEEECCCCCCCCCCCCCCCCCCCCCEEEECCCCCCCCCCCCCCCC VPLTLGADGTASTSVIVDQPISEPTVMAAEMDYADANGETLTASRRITLYPSAVRLGLRT CCEEECCCCCCCCEEEEECCCCCCEEEEEECCCCCCCCCEEEECCEEEEEHHHEEEEECC DGWMMRDDDLRLNFIALDLGGKPIRGQRVDVALYSRQIITARRRLIGGFYAYDNQMRTAK CCCEEECCCCEEEEEEEECCCCCCCCCEEEEEEHHHHHHHHHHHHHCEEEEECCCEEEEE LSANCTATTDRLGRASCAMAPGVSGEVTVVATTHDADGNEARAVRSVWLAGDDEWWFGGD ECCCCEECHHHCCCCHHHCCCCCCCCEEEEEEECCCCCCHHHEEEEEEEECCCCEEECCC NGDRMDVIAEAPRYAAGDTARFQVRMPFREATALVTVEREGVLSSFVVPLKGTNPVVTVK CCCEEEEEECCCCCCCCCCEEEEEECCCCCCEEEEEEECCCCCCCEEEEECCCCCEEEEE LPATYAPDVYVSVMAVRGRVTGQESWFRKMKRAVGFQIETSEGAPPTALVDLAKPAYRIG ECCCCCCCCEEEEEEECCCCCCHHHHHHHHHHHHCEEEECCCCCCCHHHHHHCCCCCEEE IARIKVGWEGHKLDVKVRADKEKYAVRETAKVGIEVKAPGGKAPKNADVAFAAVDEALLQ EEEEEECCCCCEEEEEEECCCHHHHHHHHHHCCEEEECCCCCCCCCCCEEHHHHHHHHHH LAPNESWDILAAMMGDRTLDVLTSTAQMQVVGKRHYGRKALEPGGGGGGDLSGLTREDFR HCCCCCHHHHHHHHCCCEEEHHHCCHHEEEEHHHHCCCCCCCCCCCCCCCCCCCCHHCCC PVLLWKGTVPLDARGRASIDVPLSDNLSGFRLVAIATDGSQFFGTGETSVRTVQDLGVFA EEEEEECCCCCCCCCCEEEECCCCCCCCCEEEEEEEECCCEEECCCCCHHHHHHHHHHHC GLPELVRTGDAYDARFTLRNGTDKPMEVTATATISPAIATAPPLTVTIPAGGAVPVSWAI CCHHHHHCCCCCEEEEEECCCCCCCEEEEEEEEECCCCCCCCCEEEEECCCCCEEEEEEE TAPDQAGPLSWTVEAATRDGKARDRLVFEQIVEPAVPVETWAASLFRVGPATTLPIAIPA ECCCCCCCEEEEEEECCCCCCHHHHHHHHHHHCCCCCHHHHHHHHHHCCCCCEEEEEECC GALPGGYVDVALAGTLAPPLAGVRDYMAAYPYTCFEQQTSRAVALGDLGRWQALAGAMPT CCCCCCEEEEEEECCCCCCHHHHHHHHHHCCCHHHHHHCCCEEEECCCCHHHHHHCCCCC YLDDDGLLRYWPNERMEGSIELTAYVLGISAANGFAIPETSRAKMIAALQAVVEGRLARR EECCCCEEEECCCCCCCCCEEEEEEEEEEECCCCCCCCCCCHHHHHHHHHHHHHHHHHHC GYGPWDIRPVRVAALAALARANAANARLVAAIDMAPADMTTGTLADWLVAIERTPGVRGA CCCCCCCCHHHHHHHHHHHHCCCCCCEEEEEEECCCCCCCCHHHHHHHEEEECCCCCCCH AALRTAAEAELRKRLVYEGTRLDLVDDARAPWWMMVSGDEMAIKALGAVLGRKGWEDDAG HHHHHHHHHHHHHHHHHCCCEEEEEECCCCCEEEEECCCHHHHHHHHHHHCCCCCCCCCC KLMVGVAQRQRKGHWDTTPANAWGAVTVRRFAELYPASAITGVTTIGLAGNTASQSWPLP CEEEEEHHHHHCCCCCCCCCCCCHHHHHHHHHHHCCCCHHCCEEEEEECCCCCCCCCCCC AEPPSPLRVALNAATMSLNHRGTGSPWATVSVKAAVPLKEPLNAGYRIKRSVSIVKAANK CCCCCCEEEEEEEEEEEECCCCCCCCEEEEEEEEECCCHHHCCCCEEEEEEEEEEEECCC DRLTRGDVIKIRIEVAAAAGRTWVVISDPVAPGATIVGNLGGQSEMLGAQAGGSGAQPSY CCCCCCCEEEEEEEEEECCCCEEEEEECCCCCCCEEEECCCCCHHEEECCCCCCCCCCHH VERGKDSWRGYFGWMPAGTHAVEYVVRLNGSGRFTLPPTRVEAMYSPAIRGQWPNAPLTV HHCCCHHCCEEEECCCCCCCEEEEEEEECCCCEEECCCHHHHHHHCCHHCCCCCCCCEEE ANVGS EECCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 6.0
TargetDB status: NA
Availability: NA
References: 11759840 [H]