Definition Chloroflexus sp. Y-400-fl chromosome, complete genome.
Accession NC_012032
Length 5,268,950

Click here to switch to the map view.

The map label for this gene is yfbK [C]

Identifier: 222526064

GI number: 222526064

Start: 3477714

End: 3480431

Strand: Reverse

Name: yfbK [C]

Synonym: Chy400_2821

Alternate gene names: 222526064

Gene position: 3480431-3477714 (Counterclockwise)

Preceding gene: 222526065

Following gene: 222526063

Centisome position: 66.06

GC content: 58.46

Gene sequence:

>2718_bases
ATGGTGCTGAGCGTTGTTGAGCCGGCAGCATTATGGCTGTTTGTGCTCGCCATTCCTCTGCTTGGGCTGATCTGGCTGGG
TCGTACTGATCTCCACCGTCGCCTTGGGCGTGTGCGATTATGGTTGCTGGTGGTGGTACGTTGTCTGATCCTGGCAGCGC
TCGTATTGGCCGTGGCCGGCCTTCAGATCGGTCGACCGGTGAATGCTACCGCCACGGTTTTTCTGCTCGATGTTAGCGAC
TCAGTCTCACCTGCCCAACGGGTAGCAACATTCGATTTTATTGAGCAGGCGGTGGCTACCGCCGATCCCGACGACCGTAT
GGCCGTGATCGTGTTTGGCGCACGAGCAATGGTCGAGCGCGTGGCCGAACCGCCCCGTCCACTGAACCGGATCGACGCGC
TGGTAGCCGGTTCACGCACCAATATTGAAGACGCCATCCAATTGGGACTGGCAATTTTGCCCGATGCGATGCATCGACGG
CTGGTGTTGATCTCGGATGGCGGTGAGAATGCAGGTCAGGCGTTAACAGCCGCTCGTTTGGCGGCTGCCCGTGGCGTTCC
GATTGAGGTCGTCATCCTGTCGGCGGAGCGCGGCCCTGATGCGCTGATCACGGCCTTACAGGCACCGACGACGGCTGACA
TCAATCAGAACATTCCGCTAACTGTTCAGATTGAAAGTGAAGTCGAGGGCGCGGCGACGGTGCAGTTGATCGCTGATGGT
CAGTTGCTGGCCGAACAGTCCGTGACGGTGACACCCGGTCGCAATCAGATTGCATTTTCTGTACCGGCACGCGAGAGTGG
GTTTCGCCGCTTTGAAGCGCGTCTGATTGCTCCCTTCGATACCCAGCCGGCCAACAATCGGGCGGTGGCATTTACCTTTG
TCAGTGGCCCACCGCGCGTGTTGTTGTTAACGGTGGGACCGGAACAGGCACTGGCACTGGCCGAAGCATGGCGTGCCGGA
GGGATTGAGGTGACGGTGCAGACACCGATGCAGGCGCCGGCCAATCCACTCGATTTGCGCTCCTTCGATGCGATTGCTCT
AGTTGACACACCGGCGAACGCGGTTTCGCTGGCACTTCAGCGCACCCTGACGACCTACGTGCGCGATCTGGGCGGTGGAC
TGCTGTTCATTGGTGGCCCCCAATCGTTCGGCGCCGGAGGCTGGCGTCGTTCTCTGCTCGAGTCGTTATTTCCGGTTTCG
CTTGATCCGCCATCGCGCGAGGAACGCTTCGATCTGGCGCTGACGCTGGTCATCGACCGCAGCGGGAGTATGAGCGAACT
CGTGGACGGTTTGCGCACCCAACTCGATCTGGCCCGTGAAGCGGCATTTCAAGCGAGCCTTGGGTTATCGCGTCAGGATC
AGCTCTCGATTATCGCCTTCGATAGCGTTGCCGATGTGATTTTACCGTTGCAACCACTCCCTGATCTGGCGACAATTGAA
GATGCGCTGAGTCGATTATCTGCCGGTGGCGGCACAAATATTCGTAGCGGAATGGCACTGGCAGCCGAGACCATTGCCAC
GGCTGATGCCCGGATTCGACATGTGATCCTCTTGACCGATGGTGTCTCCGAGACTGAATATGCCGATCTGGTTGCCAACC
TGCGCGCACAAGGGGTTACGGTCAGTACGGTGGCGATTGGTCTGAATACCGATCCAGAACTCGAACGAGTGGCGCAGATC
GGTGGCGGTAAATACTACGTTGTTCGTCAAGCCGAAGCTCTGCCACAGATTCTGCTGGAAGAGACTGTCCGGGTGGCGAA
TCGCGATCTGGTAGAAGAGCCTTTCACACCTGCACTTGCATTACCGACACCATGGCTGCGCAATTTCAGCGCTTTGCCAC
CACTGCAAGGGCGGAATGTCGTTGCCGAACGGTCAATCAGTCGGGTGCTCCTGGTCGCCGATGACGGATCGCCGCTCCTG
GCGACGGCCCAGATCGGTGTTGGGCGGGTGCTGGCCTGGGCAAGTGATATGACCGGACATTGGGCGACTGCATGGTTATC
CTGGTCAGCATTTCCCCGTTTTGCCGCCGGATTGGTGTCTGAAGTACTCCCACTCAATAGTGATGATTATCTATCGCTCA
GCGCAACGGTAACCGCAGATCGAGTTGAAATTGACCTTCAGGCCCGTGATCGCAGTGGATTGCCTGTTGAATTGGGCGAG
ATTCGCAGTCGCATTAGTGGCCTGGCCGATGAAGTCGTGCCAGATTTTGTGCAGATCGCGCCTGGACGGTATCGTGCGAT
CACCACCATCGATCAGATGGGAGCGTATCTGGTACAGGTGAGTGCAACTGACCGCAACGGGATGCCGCTCGGCACGGTTG
CCACCGGTCTGACGGTGAACTACTCACCGGAGTATGGACAGTTTGCGGCGAATCCTGGCCTCATGACCGAACTTGCAGCA
TTGACCGGTGGTCAGGTTAATCCGCCGCCAGACCTGATCTTTGCTCCAACAGAACGTTCGGTGTACGAGGTCTGGCCGGT
AACCATGCCTCTAATCTGGCTGGCACTGGCATTATTGCCAGTAGACATTGCGCTACGTCGACTCTTTGTCGCAGTGCCCG
ACTGGCGTCCTGTTGTCATCCGCCGACCGCAGCGCAAACCACCGGAGGCGAAACCATCTTCATCAGCGCCAGCCCCAACC
TCTACCTTACCGCAAAGCGACGAAGAGCGGATTGCCGCACTACTGGCAGCGAAACGACGCCGTCGCCGGGATGAGTGA

Upstream 100 bases:

>100_bases
TATCTGCGTCTTCTCAAGCTGTGGGTTCTGTTTACCCGGCGTCATTTCCTCTCAATACGATGGTACGGCATACTGCACTA
CTATCCTGGAACGGAGCTGA

Downstream 100 bases:

>100_bases
TGCTTTATGCTATACTGCCAGAAGGATTTGATGGTACAACAGTAGTTGACGGAGGAGCCCATGTCAACTGAACAACCAGC
AGTCACCGTGCGGCCTGCCG

Product: von Willebrand factor type A

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 905; Mature: 905

Protein sequence:

>905_residues
MVLSVVEPAALWLFVLAIPLLGLIWLGRTDLHRRLGRVRLWLLVVVRCLILAALVLAVAGLQIGRPVNATATVFLLDVSD
SVSPAQRVATFDFIEQAVATADPDDRMAVIVFGARAMVERVAEPPRPLNRIDALVAGSRTNIEDAIQLGLAILPDAMHRR
LVLISDGGENAGQALTAARLAAARGVPIEVVILSAERGPDALITALQAPTTADINQNIPLTVQIESEVEGAATVQLIADG
QLLAEQSVTVTPGRNQIAFSVPARESGFRRFEARLIAPFDTQPANNRAVAFTFVSGPPRVLLLTVGPEQALALAEAWRAG
GIEVTVQTPMQAPANPLDLRSFDAIALVDTPANAVSLALQRTLTTYVRDLGGGLLFIGGPQSFGAGGWRRSLLESLFPVS
LDPPSREERFDLALTLVIDRSGSMSELVDGLRTQLDLAREAAFQASLGLSRQDQLSIIAFDSVADVILPLQPLPDLATIE
DALSRLSAGGGTNIRSGMALAAETIATADARIRHVILLTDGVSETEYADLVANLRAQGVTVSTVAIGLNTDPELERVAQI
GGGKYYVVRQAEALPQILLEETVRVANRDLVEEPFTPALALPTPWLRNFSALPPLQGRNVVAERSISRVLLVADDGSPLL
ATAQIGVGRVLAWASDMTGHWATAWLSWSAFPRFAAGLVSEVLPLNSDDYLSLSATVTADRVEIDLQARDRSGLPVELGE
IRSRISGLADEVVPDFVQIAPGRYRAITTIDQMGAYLVQVSATDRNGMPLGTVATGLTVNYSPEYGQFAANPGLMTELAA
LTGGQVNPPPDLIFAPTERSVYEVWPVTMPLIWLALALLPVDIALRRLFVAVPDWRPVVIRRPQRKPPEAKPSSSAPAPT
STLPQSDEERIAALLAAKRRRRRDE

Sequences:

>Translated_905_residues
MVLSVVEPAALWLFVLAIPLLGLIWLGRTDLHRRLGRVRLWLLVVVRCLILAALVLAVAGLQIGRPVNATATVFLLDVSD
SVSPAQRVATFDFIEQAVATADPDDRMAVIVFGARAMVERVAEPPRPLNRIDALVAGSRTNIEDAIQLGLAILPDAMHRR
LVLISDGGENAGQALTAARLAAARGVPIEVVILSAERGPDALITALQAPTTADINQNIPLTVQIESEVEGAATVQLIADG
QLLAEQSVTVTPGRNQIAFSVPARESGFRRFEARLIAPFDTQPANNRAVAFTFVSGPPRVLLLTVGPEQALALAEAWRAG
GIEVTVQTPMQAPANPLDLRSFDAIALVDTPANAVSLALQRTLTTYVRDLGGGLLFIGGPQSFGAGGWRRSLLESLFPVS
LDPPSREERFDLALTLVIDRSGSMSELVDGLRTQLDLAREAAFQASLGLSRQDQLSIIAFDSVADVILPLQPLPDLATIE
DALSRLSAGGGTNIRSGMALAAETIATADARIRHVILLTDGVSETEYADLVANLRAQGVTVSTVAIGLNTDPELERVAQI
GGGKYYVVRQAEALPQILLEETVRVANRDLVEEPFTPALALPTPWLRNFSALPPLQGRNVVAERSISRVLLVADDGSPLL
ATAQIGVGRVLAWASDMTGHWATAWLSWSAFPRFAAGLVSEVLPLNSDDYLSLSATVTADRVEIDLQARDRSGLPVELGE
IRSRISGLADEVVPDFVQIAPGRYRAITTIDQMGAYLVQVSATDRNGMPLGTVATGLTVNYSPEYGQFAANPGLMTELAA
LTGGQVNPPPDLIFAPTERSVYEVWPVTMPLIWLALALLPVDIALRRLFVAVPDWRPVVIRRPQRKPPEAKPSSSAPAPT
STLPQSDEERIAALLAAKRRRRRDE
>Mature_905_residues
MVLSVVEPAALWLFVLAIPLLGLIWLGRTDLHRRLGRVRLWLLVVVRCLILAALVLAVAGLQIGRPVNATATVFLLDVSD
SVSPAQRVATFDFIEQAVATADPDDRMAVIVFGARAMVERVAEPPRPLNRIDALVAGSRTNIEDAIQLGLAILPDAMHRR
LVLISDGGENAGQALTAARLAAARGVPIEVVILSAERGPDALITALQAPTTADINQNIPLTVQIESEVEGAATVQLIADG
QLLAEQSVTVTPGRNQIAFSVPARESGFRRFEARLIAPFDTQPANNRAVAFTFVSGPPRVLLLTVGPEQALALAEAWRAG
GIEVTVQTPMQAPANPLDLRSFDAIALVDTPANAVSLALQRTLTTYVRDLGGGLLFIGGPQSFGAGGWRRSLLESLFPVS
LDPPSREERFDLALTLVIDRSGSMSELVDGLRTQLDLAREAAFQASLGLSRQDQLSIIAFDSVADVILPLQPLPDLATIE
DALSRLSAGGGTNIRSGMALAAETIATADARIRHVILLTDGVSETEYADLVANLRAQGVTVSTVAIGLNTDPELERVAQI
GGGKYYVVRQAEALPQILLEETVRVANRDLVEEPFTPALALPTPWLRNFSALPPLQGRNVVAERSISRVLLVADDGSPLL
ATAQIGVGRVLAWASDMTGHWATAWLSWSAFPRFAAGLVSEVLPLNSDDYLSLSATVTADRVEIDLQARDRSGLPVELGE
IRSRISGLADEVVPDFVQIAPGRYRAITTIDQMGAYLVQVSATDRNGMPLGTVATGLTVNYSPEYGQFAANPGLMTELAA
LTGGQVNPPPDLIFAPTERSVYEVWPVTMPLIWLALALLPVDIALRRLFVAVPDWRPVVIRRPQRKPPEAKPSSSAPAPT
STLPQSDEERIAALLAAKRRRRRDE

Specific function: Unknown

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 VWFA domain [H]

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR002035 [H]

Pfam domain/function: PF00092 VWA [H]

EC number: NA

Molecular weight: Translated: 96994; Mature: 96994

Theoretical pI: Translated: 4.71; Mature: 4.71

Prosite motif: PS50234 VWFA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.1 %Cys     (Translated Protein)
1.3 %Met     (Translated Protein)
1.4 %Cys+Met (Translated Protein)
0.1 %Cys     (Mature Protein)
1.3 %Met     (Mature Protein)
1.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MVLSVVEPAALWLFVLAIPLLGLIWLGRTDLHRRLGRVRLWLLVVVRCLILAALVLAVAG
CEEEECCHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHC
LQIGRPVNATATVFLLDVSDSVSPAQRVATFDFIEQAVATADPDDRMAVIVFGARAMVER
HHCCCCCCCEEEEEEEECCCCCCHHHHHHHHHHHHHHHHCCCCCCCEEEEEECHHHHHHH
VAEPPRPLNRIDALVAGSRTNIEDAIQLGLAILPDAMHRRLVLISDGGENAGQALTAARL
HCCCCCCHHHHHHHHCCCCCCHHHHHHHHHHHCCHHHCCEEEEEECCCCCHHHHHHHHHH
AAARGVPIEVVILSAERGPDALITALQAPTTADINQNIPLTVQIESEVEGAATVQLIADG
HHHCCCCEEEEEEECCCCCCHHHHHHCCCCCCCCCCCCCEEEEECCCCCCCEEEEEEECC
QLLAEQSVTVTPGRNQIAFSVPARESGFRRFEARLIAPFDTQPANNRAVAFTFVSGPPRV
CEEECCCEEECCCCCEEEEECCCCHHHHHEEEEEEEECCCCCCCCCCEEEEEEECCCCEE
LLLTVGPEQALALAEAWRAGGIEVTVQTPMQAPANPLDLRSFDAIALVDTPANAVSLALQ
EEEEECCHHHHHHHHHHHCCCEEEEEECCCCCCCCCCCCCCCCEEEEEECCCHHHHHHHH
RTLTTYVRDLGGGLLFIGGPQSFGAGGWRRSLLESLFPVSLDPPSREERFDLALTLVIDR
HHHHHHHHHHCCCEEEEECCCCCCCCHHHHHHHHHHCCCCCCCCCCCCCEEEEEEEEEEC
SGSMSELVDGLRTQLDLAREAAFQASLGLSRQDQLSIIAFDSVADVILPLQPLPDLATIE
CCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCEEEEEECCHHHHHCCCCCCCCHHHHH
DALSRLSAGGGTNIRSGMALAAETIATADARIRHVILLTDGVSETEYADLVANLRAQGVT
HHHHHHHCCCCCCCCCCHHHHHHHHHHCCCEEEEEEEEECCCCCHHHHHHHHHHHHCCEE
VSTVAIGLNTDPELERVAQIGGGKYYVVRQAEALPQILLEETVRVANRDLVEEPFTPALA
EEEEEEECCCCHHHHHHHHHCCCEEEEEECHHHHHHHHHHHHHHHHHHHHHHCCCCCCCC
LPTPWLRNFSALPPLQGRNVVAERSISRVLLVADDGSPLLATAQIGVGRVLAWASDMTGH
CCCHHHHCCCCCCCCCCCCHHHHCCCCEEEEEECCCCCEEEEECCCHHHHHHHHCCCCCC
WATAWLSWSAFPRFAAGLVSEVLPLNSDDYLSLSATVTADRVEIDLQARDRSGLPVELGE
CEEEEEEHHHHHHHHHHHHHHHCCCCCCCCEEEEEEEEEEEEEEEEEECCCCCCCEEHHH
IRSRISGLADEVVPDFVQIAPGRYRAITTIDQMGAYLVQVSATDRNGMPLGTVATGLTVN
HHHHHHHHHHHHHHHHHHHCCCCEEEEHHHHHCCEEEEEEEECCCCCCCCCHHHCCCEEE
YSPEYGQFAANPGLMTELAALTGGQVNPPPDLIFAPTERSVYEVWPVTMPLIWLALALLP
ECCCCCCCCCCCCHHHHHHHHCCCCCCCCCCEEECCCCCCEEEECCHHHHHHHHHHHHHH
VDIALRRLFVAVPDWRPVVIRRPQRKPPEAKPSSSAPAPTSTLPQSDEERIAALLAAKRR
HHHHHHHHHHCCCCCCEEEEECCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHH
RRRDE
HCCCC
>Mature Secondary Structure
MVLSVVEPAALWLFVLAIPLLGLIWLGRTDLHRRLGRVRLWLLVVVRCLILAALVLAVAG
CEEEECCHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHC
LQIGRPVNATATVFLLDVSDSVSPAQRVATFDFIEQAVATADPDDRMAVIVFGARAMVER
HHCCCCCCCEEEEEEEECCCCCCHHHHHHHHHHHHHHHHCCCCCCCEEEEEECHHHHHHH
VAEPPRPLNRIDALVAGSRTNIEDAIQLGLAILPDAMHRRLVLISDGGENAGQALTAARL
HCCCCCCHHHHHHHHCCCCCCHHHHHHHHHHHCCHHHCCEEEEEECCCCCHHHHHHHHHH
AAARGVPIEVVILSAERGPDALITALQAPTTADINQNIPLTVQIESEVEGAATVQLIADG
HHHCCCCEEEEEEECCCCCCHHHHHHCCCCCCCCCCCCCEEEEECCCCCCCEEEEEEECC
QLLAEQSVTVTPGRNQIAFSVPARESGFRRFEARLIAPFDTQPANNRAVAFTFVSGPPRV
CEEECCCEEECCCCCEEEEECCCCHHHHHEEEEEEEECCCCCCCCCCEEEEEEECCCCEE
LLLTVGPEQALALAEAWRAGGIEVTVQTPMQAPANPLDLRSFDAIALVDTPANAVSLALQ
EEEEECCHHHHHHHHHHHCCCEEEEEECCCCCCCCCCCCCCCCEEEEEECCCHHHHHHHH
RTLTTYVRDLGGGLLFIGGPQSFGAGGWRRSLLESLFPVSLDPPSREERFDLALTLVIDR
HHHHHHHHHHCCCEEEEECCCCCCCCHHHHHHHHHHCCCCCCCCCCCCCEEEEEEEEEEC
SGSMSELVDGLRTQLDLAREAAFQASLGLSRQDQLSIIAFDSVADVILPLQPLPDLATIE
CCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCEEEEEECCHHHHHCCCCCCCCHHHHH
DALSRLSAGGGTNIRSGMALAAETIATADARIRHVILLTDGVSETEYADLVANLRAQGVT
HHHHHHHCCCCCCCCCCHHHHHHHHHHCCCEEEEEEEEECCCCCHHHHHHHHHHHHCCEE
VSTVAIGLNTDPELERVAQIGGGKYYVVRQAEALPQILLEETVRVANRDLVEEPFTPALA
EEEEEEECCCCHHHHHHHHHCCCEEEEEECHHHHHHHHHHHHHHHHHHHHHHCCCCCCCC
LPTPWLRNFSALPPLQGRNVVAERSISRVLLVADDGSPLLATAQIGVGRVLAWASDMTGH
CCCHHHHCCCCCCCCCCCCHHHHCCCCEEEEEECCCCCEEEEECCCHHHHHHHHCCCCCC
WATAWLSWSAFPRFAAGLVSEVLPLNSDDYLSLSATVTADRVEIDLQARDRSGLPVELGE
CEEEEEEHHHHHHHHHHHHHHHCCCCCCCCEEEEEEEEEEEEEEEEEECCCCCCCEEHHH
IRSRISGLADEVVPDFVQIAPGRYRAITTIDQMGAYLVQVSATDRNGMPLGTVATGLTVN
HHHHHHHHHHHHHHHHHHHCCCCEEEEHHHHHCCEEEEEEEECCCCCCCCCHHHCCCEEE
YSPEYGQFAANPGLMTELAALTGGQVNPPPDLIFAPTERSVYEVWPVTMPLIWLALALLP
ECCCCCCCCCCCCHHHHHHHHCCCCCCCCCCEEECCCCCCEEEECCHHHHHHHHHHHHHH
VDIALRRLFVAVPDWRPVVIRRPQRKPPEAKPSSSAPAPTSTLPQSDEERIAALLAAKRR
HHHHHHHHHHCCCCCCEEEEECCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHH
RRRDE
HCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 8590279; 8905231 [H]