Definition Chloroflexus sp. Y-400-fl chromosome, complete genome.
Accession NC_012032
Length 5,268,950

Click here to switch to the map view.

The map label for this gene is 222525765

Identifier: 222525765

GI number: 222525765

Start: 3162099

End: 3164345

Strand: Direct

Name: 222525765

Synonym: Chy400_2518

Alternate gene names: NA

Gene position: 3162099-3164345 (Clockwise)

Preceding gene: 222525763

Following gene: 222525766

Centisome position: 60.01

GC content: 55.45

Gene sequence:

>2247_bases
ATGACCGCCAGTACATATTCCAGTATATACGTTTTACGGTGTCAACGCACACGTCATGCATTGTACCGAACTGGCGTTAT
AATACGACACACAAACTTTCTGATAGCACACAGGCAACATCAAAATAGTTCAGCTATGGCGAATCTTCCCCTGCCCACGA
CTGAGACACATACACCTGCCGGCCAGGCCTGGTGGCACAAACCTTTATCCGGTACCGGTTGGCTTTCACGCCTGACGTTT
GGTGAACTGTTGCTTCTGGCTGGTAGCCTGCTTCTCTACCTCTATACCCGCCTGACCGATCTGACCAGCTTCCCGATCTA
TTTTTTCTGCGACGAGGCCATCCACAGTGTACTGGCGCGTGATCTGATTGCCAACGGTTTTCGCGATGGTGAGGGCACCC
TATTTCCGACCTACTTTCGCAATGTGGAAAAATGGAACCTGGGTTTGAGTGTTTACCTCCATGCCCTCAGTATCATCCTG
TTCGGGTTTGAGCCATCGGTCTGGATGACCCGTGCCACCTCCGTTATCGCGAGTGTTCTGGCACCGGTGGGCATTGCATT
GCTGTTGCGTTTCGGCTATCACAGCCGGCGCTGGTGGCTGGGAATCCTGGTATTGTGTACGTTGCCGGCCTGGTTTCTCC
ATTCCCGTACCGCCTTTGAAACGGTACTGATGGTCGCCTGTTATGCGGTGTTTCTGGCGACGTATGTGCTCTACCGTTTT
TACGATGATCGCTGGTTGGTTGTGGTGATCCTGTTCGGTGCCGCCACCTTCTACAGCTATGCCAATGGGCAGGGGGTGAT
GCTGGTGAGTGGTGTGCTCTTGCTGATCAGCGATCTCCGCTACCATCTCAGCCGCTCACCGCAACGGATTGGGATTGCTT
CTATCGCGATCCTGCTCGCTGCCATCCCGTGGTTGCGTTTTCGCTGGCTGCATCCTGAAGCGCTGTTTGAGCATTTCCGT
TCCCTCAACTCCTATTGGATACAATCCATCCCACTCACCGAGAAGCTGCAACGCTTTGGGAGCCTGTACCTGCAGGGCCT
TGATCCGCGTTACTGGTTCTGGCCTAACACAGTAGACCTTGATCGGCATCGGTTTCCTGACGCCGGTCATCTCCCGCTCT
TCCTGCTTCCCTTCATCGCTATTGGCCTGGTCGTTTGTCTGTGGCGTTGGCGGGATGTGCGCTACAGACTACCTCTCATT
GCCCTGCTTGCGGCACCTTTCAGCGGTGCGCTGGTTGGGCCGGCCATCACCCGCATGCTGGCGATGGTCATTCCGGCAAC
CCTGCTGGCTGTCATCGGGCTGGATATGCTTCTTGCCTTCCTGAGCCATTCGCGACAACGCTTCGTGACCGTCATCCTCG
GCGTCATCCTCGTCATCAGCAGTCTGACGATGACCCACTATGCCATCCTTGGTGGTCCGCTCTGGTTTCGCGATTACGGC
CTCAACGGGATGCAGTACGGGGCGCAGCAGCTTTTTGGCGAGACGATTCCTGCGCTGCTTGACCGTGATCCGCACATTAT
CCTTCGCATTTCGCCAACGTGGGCGAACAATCCAAACAGTTTTGCCAGCTTTTTTCTCACCCCTGCCCAGCAGCGTCGTA
TCGAATTTATCAACATCGATGCCTACCGCTACCAGCGCCGCGATCTTGATCGGCAACGCGACGTGTTCATTATGACTGCC
GGTGAATACTGGCTGGCCCAGCAGAGTGGGAAGTTTATCCTGTCGCCACCGGAACAGATCATTCCCTACCCCGATGGTCA
GCCAGGGTTCTATGTGGTACGGCTAGAGTACGTTGCCAATATCGACGAGATTCTGGCCGCTGAACGTGCTGAGCGGCAGC
GGTTGGTTGAAATTCCGTACACGCTGGAAGGTCAGTCAGTGGTTGTTGCCCATTCCCCATTCGACATTGGCAGCGTCCCT
AACCTCTTTGATGGTGAGCCGTTGACGCTGGCCCGTGGTTTTGAAGCCAACCCGCTTGTCATTGAACTGCGGTTTACCAA
CCCGCGTCCACTGCGCCAGGTGGGATTGACCCTCGGCAGTATGGATCTCGATCTGCGGGTAACCGTCACCACGCCTGACG
GTGAGACCAAAACCTTCAATCAATCATACCGTGGGCTGCCGCCAGATCCGACGGTGTACCTTGATATACCAGAGCTGCTC
AGCGCACAGCAGGTGCGCCTGGAGATTTTACAGGTGGGAGTTGGTGAACCGGCCCATGTCCATGTCCGGGAAGTGATGCT
GAAATGA

Upstream 100 bases:

>100_bases
GCACAAATGTCTGAAGAGGGGCCTGATCGTTAGAACAGCTTGGGCAGAAACTGTTATCAATCTGATAGCTTTATATAATT
CACTGGTTGTCGAGCCAGTA

Downstream 100 bases:

>100_bases
GGTCAGGTGCAGTGCAGGTGAACAACAGATCTGACAGCATCCGGTAATTGGCTGGTAATTCCGCATTCGTATACTATATC
GCAGCCAGATCGCGGTACAA

Product: hypothetical protein

Products: NA

Alternate protein names: None

Number of amino acids: Translated: 748; Mature: 747

Protein sequence:

>748_residues
MTASTYSSIYVLRCQRTRHALYRTGVIIRHTNFLIAHRQHQNSSAMANLPLPTTETHTPAGQAWWHKPLSGTGWLSRLTF
GELLLLAGSLLLYLYTRLTDLTSFPIYFFCDEAIHSVLARDLIANGFRDGEGTLFPTYFRNVEKWNLGLSVYLHALSIIL
FGFEPSVWMTRATSVIASVLAPVGIALLLRFGYHSRRWWLGILVLCTLPAWFLHSRTAFETVLMVACYAVFLATYVLYRF
YDDRWLVVVILFGAATFYSYANGQGVMLVSGVLLLISDLRYHLSRSPQRIGIASIAILLAAIPWLRFRWLHPEALFEHFR
SLNSYWIQSIPLTEKLQRFGSLYLQGLDPRYWFWPNTVDLDRHRFPDAGHLPLFLLPFIAIGLVVCLWRWRDVRYRLPLI
ALLAAPFSGALVGPAITRMLAMVIPATLLAVIGLDMLLAFLSHSRQRFVTVILGVILVISSLTMTHYAILGGPLWFRDYG
LNGMQYGAQQLFGETIPALLDRDPHIILRISPTWANNPNSFASFFLTPAQQRRIEFINIDAYRYQRRDLDRQRDVFIMTA
GEYWLAQQSGKFILSPPEQIIPYPDGQPGFYVVRLEYVANIDEILAAERAERQRLVEIPYTLEGQSVVVAHSPFDIGSVP
NLFDGEPLTLARGFEANPLVIELRFTNPRPLRQVGLTLGSMDLDLRVTVTTPDGETKTFNQSYRGLPPDPTVYLDIPELL
SAQQVRLEILQVGVGEPAHVHVREVMLK

Sequences:

>Translated_748_residues
MTASTYSSIYVLRCQRTRHALYRTGVIIRHTNFLIAHRQHQNSSAMANLPLPTTETHTPAGQAWWHKPLSGTGWLSRLTF
GELLLLAGSLLLYLYTRLTDLTSFPIYFFCDEAIHSVLARDLIANGFRDGEGTLFPTYFRNVEKWNLGLSVYLHALSIIL
FGFEPSVWMTRATSVIASVLAPVGIALLLRFGYHSRRWWLGILVLCTLPAWFLHSRTAFETVLMVACYAVFLATYVLYRF
YDDRWLVVVILFGAATFYSYANGQGVMLVSGVLLLISDLRYHLSRSPQRIGIASIAILLAAIPWLRFRWLHPEALFEHFR
SLNSYWIQSIPLTEKLQRFGSLYLQGLDPRYWFWPNTVDLDRHRFPDAGHLPLFLLPFIAIGLVVCLWRWRDVRYRLPLI
ALLAAPFSGALVGPAITRMLAMVIPATLLAVIGLDMLLAFLSHSRQRFVTVILGVILVISSLTMTHYAILGGPLWFRDYG
LNGMQYGAQQLFGETIPALLDRDPHIILRISPTWANNPNSFASFFLTPAQQRRIEFINIDAYRYQRRDLDRQRDVFIMTA
GEYWLAQQSGKFILSPPEQIIPYPDGQPGFYVVRLEYVANIDEILAAERAERQRLVEIPYTLEGQSVVVAHSPFDIGSVP
NLFDGEPLTLARGFEANPLVIELRFTNPRPLRQVGLTLGSMDLDLRVTVTTPDGETKTFNQSYRGLPPDPTVYLDIPELL
SAQQVRLEILQVGVGEPAHVHVREVMLK
>Mature_747_residues
TASTYSSIYVLRCQRTRHALYRTGVIIRHTNFLIAHRQHQNSSAMANLPLPTTETHTPAGQAWWHKPLSGTGWLSRLTFG
ELLLLAGSLLLYLYTRLTDLTSFPIYFFCDEAIHSVLARDLIANGFRDGEGTLFPTYFRNVEKWNLGLSVYLHALSIILF
GFEPSVWMTRATSVIASVLAPVGIALLLRFGYHSRRWWLGILVLCTLPAWFLHSRTAFETVLMVACYAVFLATYVLYRFY
DDRWLVVVILFGAATFYSYANGQGVMLVSGVLLLISDLRYHLSRSPQRIGIASIAILLAAIPWLRFRWLHPEALFEHFRS
LNSYWIQSIPLTEKLQRFGSLYLQGLDPRYWFWPNTVDLDRHRFPDAGHLPLFLLPFIAIGLVVCLWRWRDVRYRLPLIA
LLAAPFSGALVGPAITRMLAMVIPATLLAVIGLDMLLAFLSHSRQRFVTVILGVILVISSLTMTHYAILGGPLWFRDYGL
NGMQYGAQQLFGETIPALLDRDPHIILRISPTWANNPNSFASFFLTPAQQRRIEFINIDAYRYQRRDLDRQRDVFIMTAG
EYWLAQQSGKFILSPPEQIIPYPDGQPGFYVVRLEYVANIDEILAAERAERQRLVEIPYTLEGQSVVVAHSPFDIGSVPN
LFDGEPLTLARGFEANPLVIELRFTNPRPLRQVGLTLGSMDLDLRVTVTTPDGETKTFNQSYRGLPPDPTVYLDIPELLS
AQQVRLEILQVGVGEPAHVHVREVMLK

Specific function: Unknown

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 85067; Mature: 84936

Theoretical pI: Translated: 8.88; Mature: 8.88

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.7 %Cys     (Translated Protein)
1.7 %Met     (Translated Protein)
2.4 %Cys+Met (Translated Protein)
0.7 %Cys     (Mature Protein)
1.6 %Met     (Mature Protein)
2.3 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTASTYSSIYVLRCQRTRHALYRTGVIIRHTNFLIAHRQHQNSSAMANLPLPTTETHTPA
CCCCCCCCEEEEEEHHHHHHHHHCCEEEEECCEEEEEECCCCCCCEEECCCCCCCCCCCC
GQAWWHKPLSGTGWLSRLTFGELLLLAGSLLLYLYTRLTDLTSFPIYFFCDEAIHSVLAR
CCHHCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHEEEHHHHHHHHHH
DLIANGFRDGEGTLFPTYFRNVEKWNLGLSVYLHALSIILFGFEPSVWMTRATSVIASVL
HHHHCCCCCCCCCCCHHHHCCCHHHCCHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHH
APVGIALLLRFGYHSRRWWLGILVLCTLPAWFLHSRTAFETVLMVACYAVFLATYVLYRF
HHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHCHHHHHHHHHHHHHHHHHHHHHHHHH
YDDRWLVVVILFGAATFYSYANGQGVMLVSGVLLLISDLRYHLSRSPQRIGIASIAILLA
CCCCCEEEHHHHHHHHHHHHCCCCEEHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHH
AIPWLRFRWLHPEALFEHFRSLNSYWIQSIPLTEKLQRFGSLYLQGLDPRYWFWPNTVDL
HHHHHHEEECCHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHEECCCCCEEECCCCCCC
DRHRFPDAGHLPLFLLPFIAIGLVVCLWRWRDVRYRLPLIALLAAPFSGALVGPAITRML
CCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHCHHHHHHHHHHHHCCCCCCHHHHHHHHHH
AMVIPATLLAVIGLDMLLAFLSHSRQRFVTVILGVILVISSLTMTHYAILGGPLWFRDYG
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEHHCC
LNGMQYGAQQLFGETIPALLDRDPHIILRISPTWANNPNSFASFFLTPAQQRRIEFINID
CCHHHHHHHHHHHHHHHHHHCCCCEEEEEEECCCCCCCCHHHHEEECCCHHCCEEEEEEC
AYRYQRRDLDRQRDVFIMTAGEYWLAQQSGKFILSPPEQIIPYPDGQPGFYVVRLEYVAN
HHHHHHHCCCCCCCEEEEECCCEEEECCCCCEEECCCHHHCCCCCCCCCEEEEEEHHHHC
IDEILAAERAERQRLVEIPYTLEGQSVVVAHSPFDIGSVPNLFDGEPLTLARGFEANPLV
HHHHHHHHHHHHHHEEECCEEECCCEEEEEECCCCCCCCCCCCCCCCEEEECCCCCCCEE
IELRFTNPRPLRQVGLTLGSMDLDLRVTVTTPDGETKTFNQSYRGLPPDPTVYLDIPELL
EEEEECCCCHHHHHCCEECCCCEEEEEEEECCCCCCCCCCCCCCCCCCCCEEEEECHHHH
SAQQVRLEILQVGVGEPAHVHVREVMLK
CHHHHHHHHHHHCCCCCCHHHHHHHHCC
>Mature Secondary Structure 
TASTYSSIYVLRCQRTRHALYRTGVIIRHTNFLIAHRQHQNSSAMANLPLPTTETHTPA
CCCCCCCEEEEEEHHHHHHHHHCCEEEEECCEEEEEECCCCCCCEEECCCCCCCCCCCC
GQAWWHKPLSGTGWLSRLTFGELLLLAGSLLLYLYTRLTDLTSFPIYFFCDEAIHSVLAR
CCHHCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHEEEHHHHHHHHHH
DLIANGFRDGEGTLFPTYFRNVEKWNLGLSVYLHALSIILFGFEPSVWMTRATSVIASVL
HHHHCCCCCCCCCCCHHHHCCCHHHCCHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHH
APVGIALLLRFGYHSRRWWLGILVLCTLPAWFLHSRTAFETVLMVACYAVFLATYVLYRF
HHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHCHHHHHHHHHHHHHHHHHHHHHHHHH
YDDRWLVVVILFGAATFYSYANGQGVMLVSGVLLLISDLRYHLSRSPQRIGIASIAILLA
CCCCCEEEHHHHHHHHHHHHCCCCEEHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHH
AIPWLRFRWLHPEALFEHFRSLNSYWIQSIPLTEKLQRFGSLYLQGLDPRYWFWPNTVDL
HHHHHHEEECCHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHEECCCCCEEECCCCCCC
DRHRFPDAGHLPLFLLPFIAIGLVVCLWRWRDVRYRLPLIALLAAPFSGALVGPAITRML
CCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHCHHHHHHHHHHHHCCCCCCHHHHHHHHHH
AMVIPATLLAVIGLDMLLAFLSHSRQRFVTVILGVILVISSLTMTHYAILGGPLWFRDYG
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEHHCC
LNGMQYGAQQLFGETIPALLDRDPHIILRISPTWANNPNSFASFFLTPAQQRRIEFINID
CCHHHHHHHHHHHHHHHHHHCCCCEEEEEEECCCCCCCCHHHHEEECCCHHCCEEEEEEC
AYRYQRRDLDRQRDVFIMTAGEYWLAQQSGKFILSPPEQIIPYPDGQPGFYVVRLEYVAN
HHHHHHHCCCCCCCEEEEECCCEEEECCCCCEEECCCHHHCCCCCCCCCEEEEEEHHHHC
IDEILAAERAERQRLVEIPYTLEGQSVVVAHSPFDIGSVPNLFDGEPLTLARGFEANPLV
HHHHHHHHHHHHHHEEECCEEECCCEEEEEECCCCCCCCCCCCCCCCEEEECCCCCCCEE
IELRFTNPRPLRQVGLTLGSMDLDLRVTVTTPDGETKTFNQSYRGLPPDPTVYLDIPELL
EEEEECCCCHHHHHCCEECCCCEEEEEEEECCCCCCCCCCCCCCCCCCCCEEEEECHHHH
SAQQVRLEILQVGVGEPAHVHVREVMLK
CHHHHHHHHHHHCCCCCCHHHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA