Definition Chlorobium tepidum TLS, complete genome.
Accession NC_002932
Length 2,154,946

Click here to switch to the map view.

The map label for this gene is fhlA [H]

Identifier: 21672949

GI number: 21672949

Start: 101963

End: 104134

Strand: Direct

Name: fhlA [H]

Synonym: CT0108

Alternate gene names: 21672949

Gene position: 101963-104134 (Clockwise)

Preceding gene: 21672944

Following gene: 21672950

Centisome position: 4.73

GC content: 61.14

Gene sequence:

>2172_bases
ATGAATTCTGAAATTTTCAGAATATTCCGCAAAAAGTATTCTGAAGAGATCAGAAATCCGCCAATGAATGCCACCACCTT
GCCCGAAGCGCTCAAGCTCATGCAGTACATCGGCGACGCCATTGGGACCATCCGCGACCCGCAGGAGCTGTTCCGCACCG
TGACCGACAAGTTGCGTCTTCTCTTTGCGTTCGACTCGGCGGTCATCATCACGATCGACCGGGAGCGGCGCGAGGCGAGC
GTCTTTTTTGAGATGCTTCGTTTCGAGCTGCCTGAGCAGTTGCGCCACCAGACGCGCTCCATTGCGGGTACCTGGCTCGA
AGGGCACCTCGACGACCGCACGGTGACGGTTGCCTCCATTGCTCGCGACATTCCCTCGTTCGGCGCGGACGGCGCCCCGC
TGCTCTGGACGCTGCATGAGCTCGGAATGCGCCAGATCGTGCTCTCTCCGCTCCGTTCCGGCGGGCGGGTGATCGGTTTC
CTCAGCTTTGTTTCCGCAGAAGAGAAGCTGTGGAGTGATGGCGACAAATCGCTGCTTTCGGGGGTCAGCTCCTCCATCGC
CATCGCGGTGAGCAATGCGCTGGCCTACGAAGAGTTGCGCCAGCGCGAGGCCGAAACCTCCATGCAGCTCGCGATAAACA
ATGCGCTGTTCACCATCAAGGATCGAAGCCAGATGCTGCTGACTGTCTGCGAGCAGATCAGCCGCCTTGTGCCTTGCTCG
TTTCTTGGCATCCGCGTGGTTGGTTCGGACGGGCGGTTCCATATTTATGATAACTTCATGCGTGGGTCGGGCAGCAGTTT
CGCCCCCTTTTCGCCACTCGAACATCTTGAAATGTTGCCCGACGACCCCGTTGCGCGGGAGAGCATTGAGGTGATTTCGC
GGCCCGGCATCTATTCCGGCGAGCGCTTCGACGAGCTGTGCCGGGATTTTCGCATTCTCGAACTGGTGCGCGATCGCTTC
GGCATCAGCTCGATCATCGTCTTGCAGCTTTGGGATTTGCCCGGCAGCCGTGCGGGGTTGATTATTTCAGGCGTCGGCGT
TACGCTGGGCGACGAGGAGGCGCGTACGGTCAGCCTCATTGTGCCACAGCTCGCGCTGGCATTGCAGAACTACCTCGCTT
TCGACGAGATCGACCGGCTGCGCCGCAAGCTCGAAGGGGAGCGCACTTACCTCGTCGAGGAGATTCGCGCCGCGCATAAC
TTCGAGGAGATCGTGGGCAACAGCGCACCGCTGGCCGAGGTGTTGCGTCGTGTCAGTCAGGTCGCTCCGACCGATGCAAC
GGTGCTTATCGAGGGCGAAACCGGCACCGGCAAGGAGCTGATCGCCCGCGCAATCCACAACCTCTCGCCGCGCAAGGAGC
GGGTGCTGGTGAAGGTCAACTGCGCGGCGTTGCCCGCTTCGCTCATCGAGTCTGAGCTGTTCGGCCACGAAAAGGGGAGC
TTCACCGGCGCGACTGAGCGGCGTATCGGCAAGTTCGAGCTGGCCGACGGCGGCACCATTTTTCTTGACGAAATTGGCGA
GCTGCCGCTGGAGCTTCAGGCCAAGCTGCTGCGGGTGCTTCAGGAAAAGGAGCTCGAACGCATCGGCGGTCGGCGCGTGA
TTCCGGTCGATGTGCGGGTTATCGCCGCCACCAACCGCGACCTTAAAAAGGAGGTCGCTACCGGTCGCTTCCGTCAGGAT
CTCTACTTTCGGCTCAACGCCTTTCCCCTGTCGGTGCCGCCGCTTCGCGAACGCCGCGACGACATTCCCGTGCTCGCTCT
GCACTTCGCCCGAAAATTCGCCCGCGAGTTTGGCAAGCCGGAACGCGCCATCCGCGAGCGCGATATGAACGAGCTGGTCT
CGCGCGAGTGGCGGGGTAACATCCGCGAACTCTCCCACACCATTGAGCAGGCGGTGATTGTCGCCGAAGGTGACTCGCTC
GACTTTTCCACGGTGCTGCCGCTACGAAATGAATCTGTTCCGCTGTCCGCACCATCGGCGCTCATGACGATGGCGGAGCT
CGAAGAGGAGATGCGAGGCATGGAACGCAAGCTCATTCTTGATGCCCTCGATCGCGCCGGAGGCCGCGTCAGCGGCGAAG
GAGGTGCCGCGGAGCTGCTGAAGATCAACGCCAAGACGCTCTACTCCCGCATCGACAAGCTGGGAATTCGCAAGCGGTAC
GGGGCGGGGTGA

Upstream 100 bases:

>100_bases
AACATCAATTTCCATGCCATAATTTCTTTTTCACGCCAAAGTTGCTTAACTCTTTTTTATTGTTTGACTTATCTGTCATG
ACCCGATTTCGCGGCTTTTG

Downstream 100 bases:

>100_bases
GCAAGGATTTGCTTACATTGACCCATATGCTTCTTTTTTTCAGTCTTATCGTTGCTTCCGGTTCTTTTGAAACAACGCCA
CCCCTAAATCAAAAAGATCA

Product: sigma-54-dependent transcriptional regulator

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 723; Mature: 723

Protein sequence:

>723_residues
MNSEIFRIFRKKYSEEIRNPPMNATTLPEALKLMQYIGDAIGTIRDPQELFRTVTDKLRLLFAFDSAVIITIDRERREAS
VFFEMLRFELPEQLRHQTRSIAGTWLEGHLDDRTVTVASIARDIPSFGADGAPLLWTLHELGMRQIVLSPLRSGGRVIGF
LSFVSAEEKLWSDGDKSLLSGVSSSIAIAVSNALAYEELRQREAETSMQLAINNALFTIKDRSQMLLTVCEQISRLVPCS
FLGIRVVGSDGRFHIYDNFMRGSGSSFAPFSPLEHLEMLPDDPVARESIEVISRPGIYSGERFDELCRDFRILELVRDRF
GISSIIVLQLWDLPGSRAGLIISGVGVTLGDEEARTVSLIVPQLALALQNYLAFDEIDRLRRKLEGERTYLVEEIRAAHN
FEEIVGNSAPLAEVLRRVSQVAPTDATVLIEGETGTGKELIARAIHNLSPRKERVLVKVNCAALPASLIESELFGHEKGS
FTGATERRIGKFELADGGTIFLDEIGELPLELQAKLLRVLQEKELERIGGRRVIPVDVRVIAATNRDLKKEVATGRFRQD
LYFRLNAFPLSVPPLRERRDDIPVLALHFARKFAREFGKPERAIRERDMNELVSREWRGNIRELSHTIEQAVIVAEGDSL
DFSTVLPLRNESVPLSAPSALMTMAELEEEMRGMERKLILDALDRAGGRVSGEGGAAELLKINAKTLYSRIDKLGIRKRY
GAG

Sequences:

>Translated_723_residues
MNSEIFRIFRKKYSEEIRNPPMNATTLPEALKLMQYIGDAIGTIRDPQELFRTVTDKLRLLFAFDSAVIITIDRERREAS
VFFEMLRFELPEQLRHQTRSIAGTWLEGHLDDRTVTVASIARDIPSFGADGAPLLWTLHELGMRQIVLSPLRSGGRVIGF
LSFVSAEEKLWSDGDKSLLSGVSSSIAIAVSNALAYEELRQREAETSMQLAINNALFTIKDRSQMLLTVCEQISRLVPCS
FLGIRVVGSDGRFHIYDNFMRGSGSSFAPFSPLEHLEMLPDDPVARESIEVISRPGIYSGERFDELCRDFRILELVRDRF
GISSIIVLQLWDLPGSRAGLIISGVGVTLGDEEARTVSLIVPQLALALQNYLAFDEIDRLRRKLEGERTYLVEEIRAAHN
FEEIVGNSAPLAEVLRRVSQVAPTDATVLIEGETGTGKELIARAIHNLSPRKERVLVKVNCAALPASLIESELFGHEKGS
FTGATERRIGKFELADGGTIFLDEIGELPLELQAKLLRVLQEKELERIGGRRVIPVDVRVIAATNRDLKKEVATGRFRQD
LYFRLNAFPLSVPPLRERRDDIPVLALHFARKFAREFGKPERAIRERDMNELVSREWRGNIRELSHTIEQAVIVAEGDSL
DFSTVLPLRNESVPLSAPSALMTMAELEEEMRGMERKLILDALDRAGGRVSGEGGAAELLKINAKTLYSRIDKLGIRKRY
GAG
>Mature_723_residues
MNSEIFRIFRKKYSEEIRNPPMNATTLPEALKLMQYIGDAIGTIRDPQELFRTVTDKLRLLFAFDSAVIITIDRERREAS
VFFEMLRFELPEQLRHQTRSIAGTWLEGHLDDRTVTVASIARDIPSFGADGAPLLWTLHELGMRQIVLSPLRSGGRVIGF
LSFVSAEEKLWSDGDKSLLSGVSSSIAIAVSNALAYEELRQREAETSMQLAINNALFTIKDRSQMLLTVCEQISRLVPCS
FLGIRVVGSDGRFHIYDNFMRGSGSSFAPFSPLEHLEMLPDDPVARESIEVISRPGIYSGERFDELCRDFRILELVRDRF
GISSIIVLQLWDLPGSRAGLIISGVGVTLGDEEARTVSLIVPQLALALQNYLAFDEIDRLRRKLEGERTYLVEEIRAAHN
FEEIVGNSAPLAEVLRRVSQVAPTDATVLIEGETGTGKELIARAIHNLSPRKERVLVKVNCAALPASLIESELFGHEKGS
FTGATERRIGKFELADGGTIFLDEIGELPLELQAKLLRVLQEKELERIGGRRVIPVDVRVIAATNRDLKKEVATGRFRQD
LYFRLNAFPLSVPPLRERRDDIPVLALHFARKFAREFGKPERAIRERDMNELVSREWRGNIRELSHTIEQAVIVAEGDSL
DFSTVLPLRNESVPLSAPSALMTMAELEEEMRGMERKLILDALDRAGGRVSGEGGAAELLKINAKTLYSRIDKLGIRKRY
GAG

Specific function: Required for induction of expression of the formate dehydrogenase H and hydrogenase-3 structural genes [H]

COG id: COG3604

COG function: function code KT; Transcriptional regulator containing GAF, AAA-type ATPase, and DNA binding domains

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 sigma-54 factor interaction domain [H]

Homologues:

Organism=Escherichia coli, GI1789087, Length=591, Percent_Identity=38.2402707275804, Blast_Score=349, Evalue=3e-97,
Organism=Escherichia coli, GI87082117, Length=396, Percent_Identity=48.2323232323232, Blast_Score=341, Evalue=1e-94,
Organism=Escherichia coli, GI1790437, Length=311, Percent_Identity=47.2668810289389, Blast_Score=279, Evalue=4e-76,
Organism=Escherichia coli, GI1788550, Length=338, Percent_Identity=45.2662721893491, Blast_Score=272, Evalue=5e-74,
Organism=Escherichia coli, GI87082152, Length=321, Percent_Identity=44.5482866043614, Blast_Score=250, Evalue=2e-67,
Organism=Escherichia coli, GI1790299, Length=333, Percent_Identity=40.5405405405405, Blast_Score=237, Evalue=2e-63,
Organism=Escherichia coli, GI1788905, Length=231, Percent_Identity=49.7835497835498, Blast_Score=234, Evalue=2e-62,
Organism=Escherichia coli, GI1789233, Length=324, Percent_Identity=40.4320987654321, Blast_Score=233, Evalue=2e-62,
Organism=Escherichia coli, GI87081872, Length=232, Percent_Identity=48.2758620689655, Blast_Score=208, Evalue=8e-55,
Organism=Escherichia coli, GI1786524, Length=295, Percent_Identity=42.0338983050847, Blast_Score=201, Evalue=1e-52,
Organism=Escherichia coli, GI1787583, Length=241, Percent_Identity=42.3236514522822, Blast_Score=182, Evalue=7e-47,
Organism=Escherichia coli, GI87081858, Length=327, Percent_Identity=32.4159021406728, Blast_Score=150, Evalue=3e-37,
Organism=Escherichia coli, GI1789828, Length=269, Percent_Identity=36.4312267657993, Blast_Score=144, Evalue=2e-35,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR003593
- InterPro:   IPR003018
- InterPro:   IPR020441
- InterPro:   IPR009057
- InterPro:   IPR002197
- InterPro:   IPR002078 [H]

Pfam domain/function: PF01590 GAF; PF02954 HTH_8; PF00158 Sigma54_activat [H]

EC number: NA

Molecular weight: Translated: 81014; Mature: 81014

Theoretical pI: Translated: 5.96; Mature: 5.96

Prosite motif: PS00012 PHOSPHOPANTETHEINE ; PS00675 SIGMA54_INTERACT_1 ; PS00676 SIGMA54_INTERACT_2 ; PS50045 SIGMA54_INTERACT_4

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.6 %Cys     (Translated Protein)
1.9 %Met     (Translated Protein)
2.5 %Cys+Met (Translated Protein)
0.6 %Cys     (Mature Protein)
1.9 %Met     (Mature Protein)
2.5 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MNSEIFRIFRKKYSEEIRNPPMNATTLPEALKLMQYIGDAIGTIRDPQELFRTVTDKLRL
CCHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHH
LFAFDSAVIITIDRERREASVFFEMLRFELPEQLRHQTRSIAGTWLEGHLDDRTVTVASI
HEEECCEEEEEEECCHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHCCCCCCCHHHHHHH
ARDIPSFGADGAPLLWTLHELGMRQIVLSPLRSGGRVIGFLSFVSAEEKLWSDGDKSLLS
HHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCEEEHHHHHHHHHHHHCCCHHHHHH
GVSSSIAIAVSNALAYEELRQREAETSMQLAINNALFTIKDRSQMLLTVCEQISRLVPCS
CCCHHHHHHHHHHHHHHHHHHHHHHHHHHEEECCEEEEECCHHHHHHHHHHHHHHHCCCC
FLGIRVVGSDGRFHIYDNFMRGSGSSFAPFSPLEHLEMLPDDPVARESIEVISRPGIYSG
EEEEEEECCCCEEEEEECHHCCCCCCCCCCCCHHHHHCCCCCCCHHHHHHHHCCCCCCCC
ERFDELCRDFRILELVRDRFGISSIIVLQLWDLPGSRAGLIISGVGVTLGDEEARTVSLI
HHHHHHHHHHHHHHHHHHHHCCHHEEEEEEECCCCCCCCEEEEECCEEECCCCHHHHHHH
VPQLALALQNYLAFDEIDRLRRKLEGERTYLVEEIRAAHNFEEIVGNSAPLAEVLRRVSQ
HHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHCCHHHHHCCCCCHHHHHHHHHH
VAPTDATVLIEGETGTGKELIARAIHNLSPRKERVLVKVNCAALPASLIESELFGHEKGS
CCCCCCEEEEECCCCCCHHHHHHHHHCCCCCCCEEEEEEEHHHCCHHHHHHHHHCCCCCC
FTGATERRIGKFELADGGTIFLDEIGELPLELQAKLLRVLQEKELERIGGRRVIPVDVRV
CCCHHHHCCCCEEECCCCEEEEHHHCCCCHHHHHHHHHHHHHHHHHHHCCCEEEEEEEEE
IAATNRDLKKEVATGRFRQDLYFRLNAFPLSVPPLRERRDDIPVLALHFARKFAREFGKP
EEECCHHHHHHHHHHHHHHHHHEEEECCCCCCCCHHHHCCCCCHHHHHHHHHHHHHHCCH
ERAIRERDMNELVSREWRGNIRELSHTIEQAVIVAEGDSLDFSTVLPLRNESVPLSAPSA
HHHHHHCCHHHHHHHHHCCCHHHHHHHHHHEEEEECCCCCCCEEECCCCCCCCCCCCHHH
LMTMAELEEEMRGMERKLILDALDRAGGRVSGEGGAAELLKINAKTLYSRIDKLGIRKRY
HHHHHHHHHHHHHHHHHHHHHHHHHCCCEECCCCCCCHHHEEHHHHHHHHHHHHCCCHHC
GAG
CCC
>Mature Secondary Structure
MNSEIFRIFRKKYSEEIRNPPMNATTLPEALKLMQYIGDAIGTIRDPQELFRTVTDKLRL
CCHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHH
LFAFDSAVIITIDRERREASVFFEMLRFELPEQLRHQTRSIAGTWLEGHLDDRTVTVASI
HEEECCEEEEEEECCHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHCCCCCCCHHHHHHH
ARDIPSFGADGAPLLWTLHELGMRQIVLSPLRSGGRVIGFLSFVSAEEKLWSDGDKSLLS
HHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCEEEHHHHHHHHHHHHCCCHHHHHH
GVSSSIAIAVSNALAYEELRQREAETSMQLAINNALFTIKDRSQMLLTVCEQISRLVPCS
CCCHHHHHHHHHHHHHHHHHHHHHHHHHHEEECCEEEEECCHHHHHHHHHHHHHHHCCCC
FLGIRVVGSDGRFHIYDNFMRGSGSSFAPFSPLEHLEMLPDDPVARESIEVISRPGIYSG
EEEEEEECCCCEEEEEECHHCCCCCCCCCCCCHHHHHCCCCCCCHHHHHHHHCCCCCCCC
ERFDELCRDFRILELVRDRFGISSIIVLQLWDLPGSRAGLIISGVGVTLGDEEARTVSLI
HHHHHHHHHHHHHHHHHHHHCCHHEEEEEEECCCCCCCCEEEEECCEEECCCCHHHHHHH
VPQLALALQNYLAFDEIDRLRRKLEGERTYLVEEIRAAHNFEEIVGNSAPLAEVLRRVSQ
HHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHCCHHHHHCCCCCHHHHHHHHHH
VAPTDATVLIEGETGTGKELIARAIHNLSPRKERVLVKVNCAALPASLIESELFGHEKGS
CCCCCCEEEEECCCCCCHHHHHHHHHCCCCCCCEEEEEEEHHHCCHHHHHHHHHCCCCCC
FTGATERRIGKFELADGGTIFLDEIGELPLELQAKLLRVLQEKELERIGGRRVIPVDVRV
CCCHHHHCCCCEEECCCCEEEEHHHCCCCHHHHHHHHHHHHHHHHHHHCCCEEEEEEEEE
IAATNRDLKKEVATGRFRQDLYFRLNAFPLSVPPLRERRDDIPVLALHFARKFAREFGKP
EEECCHHHHHHHHHHHHHHHHHEEEECCCCCCCCHHHHCCCCCHHHHHHHHHHHHHHCCH
ERAIRERDMNELVSREWRGNIRELSHTIEQAVIVAEGDSLDFSTVLPLRNESVPLSAPSA
HHHHHHCCHHHHHHHHHCCCHHHHHHHHHHEEEEECCCCCCCEEECCCCCCCCCCCCHHH
LMTMAELEEEMRGMERKLILDALDRAGGRVSGEGGAAELLKINAKTLYSRIDKLGIRKRY
HHHHHHHHHHHHHHHHHHHHHHHHHCCCEECCCCCCCHHHEEHHHHHHHHHHHHCCCHHC
GAG
CCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: DNA [C]

Specific reaction: Protein + DNA = Protein-DNA [C]

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 2280686; 2118503; 9278503 [H]