Definition Treponema pallidum subsp. pallidum SS14, complete genome.
Accession NC_010741
Length 1,139,457

Click here to switch to the map view.

The map label for this gene is flhA

Identifier: 189025939

GI number: 189025939

Start: 782961

End: 785084

Strand: Reverse

Name: flhA

Synonym: TPASS_0714

Alternate gene names: 189025939

Gene position: 785084-782961 (Counterclockwise)

Preceding gene: 189025940

Following gene: 189025938

Centisome position: 68.9

GC content: 42.98

Gene sequence:

>2124_bases
ATGGCGCACGGTAAGAGTGCCTTTTTCACTACTGACGCTTTTGTTGCGATTTCAGTGTTGGTGGTTGTCTTTTCTATTGT
TGTTCCTCTGCCCACGCAAATTCTCGATGCGTTGATGGCCTTTAATCTTATCTTTAACCTTTTGATATTACTTATGGTGT
TATTTGTTGAAAAACCAACAGATTTTTCTGTATTTCCCTCGCTCTTGTTGACCTCAACCGTTTTTGGACTTGGACTGAAC
GTGTCTTCCACCCGGTTGATTTTAACGTTAGGAGATCGGTTTAGCGGGTATATGATCCGTGCGTTTAGTTCTTTTGTGGT
GGGAGGATCCGGGACGCAAGGTCTAGTAATTGGTTTTACGGTATTCATCATTTTAATTGCAGTGCAAGCTTTTGTTATTA
CTAAGGGTGCGACGCGTATTGCAGAAGTTGCTGCGCGTTTTACCTTAGACTTCAATGCAACCAAAAGCATGTCTATTGAT
GCTGAATATAATGCAGGTGTTATCACCGAAGAAGAAGCGCGAGAGCGTAAGAGGCAAATTCAGCGTGAAGCAGATTTTTT
TGGAGCAATGGATGGAGCGAGTAAGTTCGTATCGGGCAATGTCAAAATTGGTATTTTTATTACCATTGTAAATGTGATTG
CAGGCCTGATAGTGGGTGTCATATTTCGTAGGGAGGGTTTTCAGGCAGCATTGCAGACCTATACAAATTTAACGATAGGA
GATGGGTTGCTTGCACAGCTTCCTTCTTTGTTGTTGTCTGTTGCAACAGGTTTTATTGTCACTCGATCAAGCGATCAAGG
GTCATTTGGTCAAAACGTACAGGAACAATTTTCAAAAAGTGCACTTGTTTATTTTATTGGCTCAGGTGCATTGATCGTTA
TGGCGGTATTGCCGGGTTTTCCCCACAGTATTTTATTTTTTATGGCCGTGTGTTTTGCCTTTGTGGGACTGCAGCTAAGG
AAAAGGGAACGGGTACACGTTCAAGAACATGAGATGCAAAAAAGTTCAGATAAAAAGGGTATGCAACAGACTCAAGATAG
TACTTCTGAAATGGGTCCTATTGTGCCGCTTGATCCACTTTCGCTAGAACTTGGGTATGGATTAATTCCTCTTGTTGATA
AAGAAAAGGGTGCAGAGCTCCTAAGTAGAATTACAGTTATTAGAAAAGATGCCGCGTTGGATCTCGGATTGGTTGCTCCT
AAAATTCGAATTATTGACAATATGCGTTTAGATCCGAGCAGTTATTGTTTCAAAATCCAAGGATTAGAAGTTGCGCGGGG
AAAGCTGCGCTTGGGATGGTTTCTCGCCATAAAGTCTGGTCAAGTTACAGAGGAGGTTCCAGGGGAGCGAACAATTGATC
CTACATTTGGACTCCCTGCTGTGTGGATTTCTGAAGAAAATCGCGATCGTGCTGAGCGTGTCGGTTACACTGTAGTTGCT
CCATCTGCAATCATCGCCACGCACCTGACTCAGGTAATCCGTACCAATGCAGCGGATATTTTAGGTCGGCAAAACGTGCA
AATGATCATCGATGCACTACGCAAGGAATACCCGGCGGTGGTAGATGATGTAACGCAAAAGTGTCCACTCGGAAAGATCC
AAAAGGTGTTACAAGGGTTGTTACGTGAACAAGTGTCTATTAGAAATACAGTTGCGATATTTGAGACACTTGCAGATTTT
GCTTCTACGAGCGACACTGTGCCCGTTCCTATTCTTATTGAAAAAGTTCGTCAGCGATTGGGAAGGCAGATTTGTCTGCA
ATATGCAGATGAACAGAACGTTCTCCATGTTATGAGATTGGACTCCTCGTTGGAAACGTTCCTTTCAGAAAAGATAGCGT
TAACCGTGGATTCGTTATCAATATTGACGCTCTCTCTCGATGAACAAAGACAAGTTCTGCAAGCGGTCCGCACCGTTTTT
GTTCCCACACGACAGGAGGGGTATATTCCCGTGTTGCTAACGACGGATACGATTCGTAGCGCAATGTGGAATTTGTTTTT
TTCAGATCGTATTGAAATCGCAGTTATGTCCTATAAAGAAGTTTCTACCGATATGCGTATTGAAACAGTGGGAGTAGTAA
GGATAGAAGAGAGTGATGTGGATGCTTTTGTGAGAAAGCAGTAG

Upstream 100 bases:

>100_bases
GGAGAGAAGTTCCCTACGAATATTTTAATGCTTTAGTGCTGATTTTTACCAAGCTGGATAAATTTAAAACACATGCACAG
CGTAAGAGGTAACCCATACT

Downstream 100 bases:

>100_bases
TCTTCGGGCACAAGATGGGTGGAGGGTTTGATAGGTGGAGTTATTAGTAGAAGTTGCCCCAACGAAGGAAAAAGCGATAG
AGAAAATTCGGAAAAAGTAT

Product: flagellar biosynthesis protein FlhA

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 707; Mature: 706

Protein sequence:

>707_residues
MAHGKSAFFTTDAFVAISVLVVVFSIVVPLPTQILDALMAFNLIFNLLILLMVLFVEKPTDFSVFPSLLLTSTVFGLGLN
VSSTRLILTLGDRFSGYMIRAFSSFVVGGSGTQGLVIGFTVFIILIAVQAFVITKGATRIAEVAARFTLDFNATKSMSID
AEYNAGVITEEEARERKRQIQREADFFGAMDGASKFVSGNVKIGIFITIVNVIAGLIVGVIFRREGFQAALQTYTNLTIG
DGLLAQLPSLLLSVATGFIVTRSSDQGSFGQNVQEQFSKSALVYFIGSGALIVMAVLPGFPHSILFFMAVCFAFVGLQLR
KRERVHVQEHEMQKSSDKKGMQQTQDSTSEMGPIVPLDPLSLELGYGLIPLVDKEKGAELLSRITVIRKDAALDLGLVAP
KIRIIDNMRLDPSSYCFKIQGLEVARGKLRLGWFLAIKSGQVTEEVPGERTIDPTFGLPAVWISEENRDRAERVGYTVVA
PSAIIATHLTQVIRTNAADILGRQNVQMIIDALRKEYPAVVDDVTQKCPLGKIQKVLQGLLREQVSIRNTVAIFETLADF
ASTSDTVPVPILIEKVRQRLGRQICLQYADEQNVLHVMRLDSSLETFLSEKIALTVDSLSILTLSLDEQRQVLQAVRTVF
VPTRQEGYIPVLLTTDTIRSAMWNLFFSDRIEIAVMSYKEVSTDMRIETVGVVRIEESDVDAFVRKQ

Sequences:

>Translated_707_residues
MAHGKSAFFTTDAFVAISVLVVVFSIVVPLPTQILDALMAFNLIFNLLILLMVLFVEKPTDFSVFPSLLLTSTVFGLGLN
VSSTRLILTLGDRFSGYMIRAFSSFVVGGSGTQGLVIGFTVFIILIAVQAFVITKGATRIAEVAARFTLDFNATKSMSID
AEYNAGVITEEEARERKRQIQREADFFGAMDGASKFVSGNVKIGIFITIVNVIAGLIVGVIFRREGFQAALQTYTNLTIG
DGLLAQLPSLLLSVATGFIVTRSSDQGSFGQNVQEQFSKSALVYFIGSGALIVMAVLPGFPHSILFFMAVCFAFVGLQLR
KRERVHVQEHEMQKSSDKKGMQQTQDSTSEMGPIVPLDPLSLELGYGLIPLVDKEKGAELLSRITVIRKDAALDLGLVAP
KIRIIDNMRLDPSSYCFKIQGLEVARGKLRLGWFLAIKSGQVTEEVPGERTIDPTFGLPAVWISEENRDRAERVGYTVVA
PSAIIATHLTQVIRTNAADILGRQNVQMIIDALRKEYPAVVDDVTQKCPLGKIQKVLQGLLREQVSIRNTVAIFETLADF
ASTSDTVPVPILIEKVRQRLGRQICLQYADEQNVLHVMRLDSSLETFLSEKIALTVDSLSILTLSLDEQRQVLQAVRTVF
VPTRQEGYIPVLLTTDTIRSAMWNLFFSDRIEIAVMSYKEVSTDMRIETVGVVRIEESDVDAFVRKQ
>Mature_706_residues
AHGKSAFFTTDAFVAISVLVVVFSIVVPLPTQILDALMAFNLIFNLLILLMVLFVEKPTDFSVFPSLLLTSTVFGLGLNV
SSTRLILTLGDRFSGYMIRAFSSFVVGGSGTQGLVIGFTVFIILIAVQAFVITKGATRIAEVAARFTLDFNATKSMSIDA
EYNAGVITEEEARERKRQIQREADFFGAMDGASKFVSGNVKIGIFITIVNVIAGLIVGVIFRREGFQAALQTYTNLTIGD
GLLAQLPSLLLSVATGFIVTRSSDQGSFGQNVQEQFSKSALVYFIGSGALIVMAVLPGFPHSILFFMAVCFAFVGLQLRK
RERVHVQEHEMQKSSDKKGMQQTQDSTSEMGPIVPLDPLSLELGYGLIPLVDKEKGAELLSRITVIRKDAALDLGLVAPK
IRIIDNMRLDPSSYCFKIQGLEVARGKLRLGWFLAIKSGQVTEEVPGERTIDPTFGLPAVWISEENRDRAERVGYTVVAP
SAIIATHLTQVIRTNAADILGRQNVQMIIDALRKEYPAVVDDVTQKCPLGKIQKVLQGLLREQVSIRNTVAIFETLADFA
STSDTVPVPILIEKVRQRLGRQICLQYADEQNVLHVMRLDSSLETFLSEKIALTVDSLSILTLSLDEQRQVLQAVRTVFV
PTRQEGYIPVLLTTDTIRSAMWNLFFSDRIEIAVMSYKEVSTDMRIETVGVVRIEESDVDAFVRKQ

Specific function: Involved in the export of flagellum proteins

COG id: COG1298

COG function: function code NU; Flagellar biosynthesis pathway, component FlhA

Gene ontology:

Cell location: Cell membrane; Multi-pass membrane protein (Potential)

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the FHIPEP (flagella/HR/invasion proteins export pore) family

Homologues:

Organism=Escherichia coli, GI1788187, Length=687, Percent_Identity=37.5545851528384, Blast_Score=405, Evalue=1e-114,

Paralogues:

None

Copy number: 10-20 (rich media) [C]

Swissprot (AC and ID): FLHA_TREPA (Q56338)

Other databases:

- EMBL:   U36839
- EMBL:   AE000520
- PIR:   F71290
- RefSeq:   NP_219151.1
- ProteinModelPortal:   Q56338
- IntAct:   Q56338
- MINT:   MINT-6480107
- GeneID:   2610988
- GenomeReviews:   AE000520_GR
- KEGG:   tpa:TP0714
- NMPDR:   fig|243276.1.peg.710
- TIGR:   TP_0714
- HOGENOM:   HBG595253
- OMA:   LVLINFM
- ProtClustDB:   PRK06012
- BioCyc:   TPAL243276:TP_0714-MONOMER
- GO:   GO:0019861
- InterPro:   IPR006301
- InterPro:   IPR001712
- PRINTS:   PR00949
- TIGRFAMs:   TIGR01398

Pfam domain/function: PF00771 FHIPEP

EC number: NA

Molecular weight: Translated: 77945; Mature: 77814

Theoretical pI: Translated: 6.31; Mature: 6.31

Prosite motif: PS00994 FHIPEP

Important sites: NA

Signals:

None

Transmembrane regions:

HASH(0x21311e44)-; HASH(0x21778d4c)-; HASH(0x217b395c)-; HASH(0x20f56de8)-; HASH(0x21460b9c)-; HASH(0x217bffc8)-; HASH(0x21559c40)-;

Cys/Met content:

0.6 %Cys     (Translated Protein)
2.4 %Met     (Translated Protein)
3.0 %Cys+Met (Translated Protein)
0.6 %Cys     (Mature Protein)
2.3 %Met     (Mature Protein)
2.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MAHGKSAFFTTDAFVAISVLVVVFSIVVPLPTQILDALMAFNLIFNLLILLMVLFVEKPT
CCCCCCCEEEHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCC
DFSVFPSLLLTSTVFGLGLNVSSTRLILTLGDRFSGYMIRAFSSFVVGGSGTQGLVIGFT
CHHHHHHHHHHHHHHHCCCCCCCCEEEEEECCCCCCHHHHHHHHHEECCCCCCCHHHHHH
VFIILIAVQAFVITKGATRIAEVAARFTLDFNATKSMSIDAEYNAGVITEEEARERKRQI
HHHHHHHHHHHHHHCCHHHHHHHHHHHEEEECCCCCEEECCCCCCCCCCHHHHHHHHHHH
QREADFFGAMDGASKFVSGNVKIGIFITIVNVIAGLIVGVIFRREGFQAALQTYTNLTIG
HHHHHHHHCCCCHHHHCCCCEEEEHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHCCCEEC
DGLLAQLPSLLLSVATGFIVTRSSDQGSFGQNVQEQFSKSALVYFIGSGALIVMAVLPGF
CCHHHHHHHHHHHHHHCEEEEECCCCCCCCCCHHHHHCCCEEEEEECCCCEEHHHHHCCC
PHSILFFMAVCFAFVGLQLRKRERVHVQEHEMQKSSDKKGMQQTQDSTSEMGPIVPLDPL
CHHHHHHHHHHHHHHCHHHHHHHCCCHHHHHHHHHHHHHHHHHHHCCHHHCCCCCCCCCC
SLELGYGLIPLVDKEKGAELLSRITVIRKDAALDLGLVAPKIRIIDNMRLDPSSYCFKIQ
CEECCCCEEEEECCHHHHHHHHHHHHHHHHCCCCCHHCCCCEEEEECCCCCCCHHEEEEE
GLEVARGKLRLGWFLAIKSGQVTEEVPGERTIDPTFGLPAVWISEENRDRAERVGYTVVA
CCCCCCCCEEEEEEEEEECCCCHHHCCCCCCCCCCCCCCEEEECCCCCCHHHHCCEEEEC
PSAIIATHLTQVIRTNAADILGRQNVQMIIDALRKEYPAVVDDVTQKCPLGKIQKVLQGL
CHHHHHHHHHHHHHCCHHHHHCCCCHHHHHHHHHHHCCHHHHHHHHCCCHHHHHHHHHHH
LREQVSIRNTVAIFETLADFASTSDTVPVPILIEKVRQRLGRQICLQYADEQNVLHVMRL
HHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCEEEEHH
DSSLETFLSEKIALTVDSLSILTLSLDEQRQVLQAVRTVFVPTRQEGYIPVLLTTDTIRS
CHHHHHHHHHHHEEEEECEEEEEEECHHHHHHHHHHHHHCCCCCCCCEEEEEEEHHHHHH
AMWNLFFSDRIEIAVMSYKEVSTDMRIETVGVVRIEESDVDAFVRKQ
HHHHHHHCCCEEEEEEEHHHHCCCCEEEEEEEEEEECCCCCHHHCCH
>Mature Secondary Structure 
AHGKSAFFTTDAFVAISVLVVVFSIVVPLPTQILDALMAFNLIFNLLILLMVLFVEKPT
CCCCCCEEEHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCC
DFSVFPSLLLTSTVFGLGLNVSSTRLILTLGDRFSGYMIRAFSSFVVGGSGTQGLVIGFT
CHHHHHHHHHHHHHHHCCCCCCCCEEEEEECCCCCCHHHHHHHHHEECCCCCCCHHHHHH
VFIILIAVQAFVITKGATRIAEVAARFTLDFNATKSMSIDAEYNAGVITEEEARERKRQI
HHHHHHHHHHHHHHCCHHHHHHHHHHHEEEECCCCCEEECCCCCCCCCCHHHHHHHHHHH
QREADFFGAMDGASKFVSGNVKIGIFITIVNVIAGLIVGVIFRREGFQAALQTYTNLTIG
HHHHHHHHCCCCHHHHCCCCEEEEHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHCCCEEC
DGLLAQLPSLLLSVATGFIVTRSSDQGSFGQNVQEQFSKSALVYFIGSGALIVMAVLPGF
CCHHHHHHHHHHHHHHCEEEEECCCCCCCCCCHHHHHCCCEEEEEECCCCEEHHHHHCCC
PHSILFFMAVCFAFVGLQLRKRERVHVQEHEMQKSSDKKGMQQTQDSTSEMGPIVPLDPL
CHHHHHHHHHHHHHHCHHHHHHHCCCHHHHHHHHHHHHHHHHHHHCCHHHCCCCCCCCCC
SLELGYGLIPLVDKEKGAELLSRITVIRKDAALDLGLVAPKIRIIDNMRLDPSSYCFKIQ
CEECCCCEEEEECCHHHHHHHHHHHHHHHHCCCCCHHCCCCEEEEECCCCCCCHHEEEEE
GLEVARGKLRLGWFLAIKSGQVTEEVPGERTIDPTFGLPAVWISEENRDRAERVGYTVVA
CCCCCCCCEEEEEEEEEECCCCHHHCCCCCCCCCCCCCCEEEECCCCCCHHHHCCEEEEC
PSAIIATHLTQVIRTNAADILGRQNVQMIIDALRKEYPAVVDDVTQKCPLGKIQKVLQGL
CHHHHHHHHHHHHHCCHHHHHCCCCHHHHHHHHHHHCCHHHHHHHHCCCHHHHHHHHHHH
LREQVSIRNTVAIFETLADFASTSDTVPVPILIEKVRQRLGRQICLQYADEQNVLHVMRL
HHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCEEEEHH
DSSLETFLSEKIALTVDSLSILTLSLDEQRQVLQAVRTVFVPTRQEGYIPVLLTTDTIRS
CHHHHHHHHHHHEEEEECEEEEEEECHHHHHHHHHHHHHCCCCCCCCEEEEEEEHHHHHH
AMWNLFFSDRIEIAVMSYKEVSTDMRIETVGVVRIEESDVDAFVRKQ
HHHHHHHCCCEEEEEEEHHHHCCCCEEEEEEEEEEECCCCCHHHCCH

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 9063647; 9665876