Definition Helicobacter pylori HPAG1 chromosome, complete genome.
Accession NC_008086
Length 1,596,366

Click here to switch to the map view.

The map label for this gene is fliD [H]

Identifier: 108563162

GI number: 108563162

Start: 774081

End: 776138

Strand: Direct

Name: fliD [H]

Synonym: HPAG1_0737

Alternate gene names: 108563162

Gene position: 774081-776138 (Clockwise)

Preceding gene: 108563161

Following gene: 108563163

Centisome position: 48.49

GC content: 42.27

Gene sequence:

>2058_bases
ATGGCAATAGGTTCATTAAGCTCATTAGGGCTTGGCAGTAAGGTTTTGAATTACGATGTGATTGACAAGCTTAAGGACGC
CGATGAAAAAGCGTTAATCGCCCCTTTAGACAAGAAAATGGAGCAAAATGTTGAAAAACAAAAAGCCCTTGTAGAAATTA
AAACGCTCCTTTCAACCCTAAAAGGCCCGGTTAAAACGCTTTCAGATTATTCCACTTATATCAGCCGAAAAAGCAATGTT
ACAGGCGATGCGTTGAGCGCGAGCGTGGGGGCTGGCGTGCCTATTCAAGATATTAAAGTGGATGTGCAAAATTTAGCGCA
AGGCGATATTAACGAATTAGGGGCGAAATTTTCTTCAAGAGACGATATTTTTAGCCAAGTGGATACCACGCTCAAATTTT
ACACGCAAAACAAGGACTACGCCGTTGATATTAAAGCAGGAATGACTTTAGGCGATGTGGCTCAAAGCATCACGGACGCT
ACCAATGGCGAAGTGATGGGCATTGTGATGAAAACAGGAGGGAATGACCCCTACCAATTAATGGTGAATACTAAAAACAC
CGGCGAAGACAACCGAGTCTATTTTGGCTCACACCTCCAATCCACGCTCACTAACAAAAACGCCCTTTCTTTGGGGGTTG
ATGGAAGCGGAAAGAGTGAAGTGAGTTTGAATTTAAAGGGGGCTGATGGGAACATGCATGAAGTCCCTATCATGCTAGAG
CTCCCTGAAAGCGCTTCTATCAAACAAAAAAACGCGGCGATCCAAAAGGCTATGGAGCAGGCTTTAGAAAACGACCCTAA
TTTTAAAGATTTGATCGCTAATGGGGATATTTCCATAGACACTCTTCATGGGGGGGAATCTTTAATCATTAATGACAGGC
GTGGGGGAAACATTGAAGTTAAAGGGAGCAAGGCTAAAGAGCTTGGGTTTTTGCAAACCACCACCCAAGAAAGCGATTTA
TTAAAAAGCTCTCGCACCATAAAAGAGGGTAAATTAGAAGGGGTAATTAGCTTGAATGGCCAAAAACTGGATTTAAAAGC
CTTAACCAAAGAGGGCAACACCAGTGAAGAAAACACAGACGCTATCATTCAAGCGATCAACGCTAAAGAAGGCTTGAATG
CGTTTAAAAACGCCGAAGGCAAGCTTGTGATCAATTCTAAAACCGGAATGCTAACGATTAAGGGCGAGGACGCTTTAGGC
AAGGCCAGTTTGAAGGATTTGGGTTTGAGCGCTGGCATGGTGCAATCTTATGAAGCTTCACAAAACACGCTTTTTATGTC
TAAAAACTTACAAAAAGCGAGCGATTCAGAATTCACTTATAATGGGGTGAGCATCACACGCCCCACTAATGAGGTCAATG
ATGTGATCAGCGGGGTTAATATCACTTTAGAGCAAACCACAGAGCCTAATAAACCCGCCATTATCAGCGTGAGCAGAGAC
AATCAAGCCATTATAGACAGCCTTAAGGAATTTGTCAAAGCCTATAATGAGCTTATCCCTAAACTGGATGAAGACACTCG
TTATGACGCTGACACTAAAATCGCTGGGATTTTTAACGGCGTGGGCGATATTCGTGCGATTAGATCCTCTCTTAATAATG
TGTTTTCTTATAGCGTGCATACGGATAATGGGGTAGAAAGCTTGATGAAATACGGGCTTAGTTTAGACGATAAGGGCGTG
ATGAGTTTGGATGAAGCTAAATTATCAAGTGCCTTAAATTCTAACCCTAAAGCGACTCAAGATTTTTTCTATGGGAGCGA
TAGCAAGGATATGGGGGGCAGAGAAATCCACCAAGAGGGCATTTTTTCTAAATTCAATCAAGTTATCGCTAATCTCATAG
ATGGAGGGAACGCTAAATTAAAGATTTATGAAGATTCCCTAGACAGAGACGCTAAAAGCCTGACTAAAGACAAAGAAAAC
GCTCAGGAGCTTTTAAAAACCCGCTACAACATCATGGCGGAGCGCTTTGCAGCTTATGATAGCCAAATTTCTAAAGCCAA
TCAAAAATTCAATTCCGTGCAAATGATGATCGATCAAGCGGCGGCTAAAAAGAATTAA

Upstream 100 bases:

>100_bases
AGAGAAATACCCTCTAAAGAAGCCGTGGAGCTTATGCAAAGAATGCGCGATGTGATAGGCATTATCTTTGATAAGAGAGG
CTAAAAATTAGAGGTAAAAC

Downstream 100 bases:

>100_bases
AAACAGAGAGTTATTAATTTTAAAGGATAAAGGAACATTATGCAATACGCTAACGCTTATCAAGCCTACCAGCATAACCG
AGTGAGTGTGGAATCCCCGG

Product: flagellar capping protein

Products: NA

Alternate protein names: HAP2; Filament cap protein [H]

Number of amino acids: Translated: 685; Mature: 684

Protein sequence:

>685_residues
MAIGSLSSLGLGSKVLNYDVIDKLKDADEKALIAPLDKKMEQNVEKQKALVEIKTLLSTLKGPVKTLSDYSTYISRKSNV
TGDALSASVGAGVPIQDIKVDVQNLAQGDINELGAKFSSRDDIFSQVDTTLKFYTQNKDYAVDIKAGMTLGDVAQSITDA
TNGEVMGIVMKTGGNDPYQLMVNTKNTGEDNRVYFGSHLQSTLTNKNALSLGVDGSGKSEVSLNLKGADGNMHEVPIMLE
LPESASIKQKNAAIQKAMEQALENDPNFKDLIANGDISIDTLHGGESLIINDRRGGNIEVKGSKAKELGFLQTTTQESDL
LKSSRTIKEGKLEGVISLNGQKLDLKALTKEGNTSEENTDAIIQAINAKEGLNAFKNAEGKLVINSKTGMLTIKGEDALG
KASLKDLGLSAGMVQSYEASQNTLFMSKNLQKASDSEFTYNGVSITRPTNEVNDVISGVNITLEQTTEPNKPAIISVSRD
NQAIIDSLKEFVKAYNELIPKLDEDTRYDADTKIAGIFNGVGDIRAIRSSLNNVFSYSVHTDNGVESLMKYGLSLDDKGV
MSLDEAKLSSALNSNPKATQDFFYGSDSKDMGGREIHQEGIFSKFNQVIANLIDGGNAKLKIYEDSLDRDAKSLTKDKEN
AQELLKTRYNIMAERFAAYDSQISKANQKFNSVQMMIDQAAAKKN

Sequences:

>Translated_685_residues
MAIGSLSSLGLGSKVLNYDVIDKLKDADEKALIAPLDKKMEQNVEKQKALVEIKTLLSTLKGPVKTLSDYSTYISRKSNV
TGDALSASVGAGVPIQDIKVDVQNLAQGDINELGAKFSSRDDIFSQVDTTLKFYTQNKDYAVDIKAGMTLGDVAQSITDA
TNGEVMGIVMKTGGNDPYQLMVNTKNTGEDNRVYFGSHLQSTLTNKNALSLGVDGSGKSEVSLNLKGADGNMHEVPIMLE
LPESASIKQKNAAIQKAMEQALENDPNFKDLIANGDISIDTLHGGESLIINDRRGGNIEVKGSKAKELGFLQTTTQESDL
LKSSRTIKEGKLEGVISLNGQKLDLKALTKEGNTSEENTDAIIQAINAKEGLNAFKNAEGKLVINSKTGMLTIKGEDALG
KASLKDLGLSAGMVQSYEASQNTLFMSKNLQKASDSEFTYNGVSITRPTNEVNDVISGVNITLEQTTEPNKPAIISVSRD
NQAIIDSLKEFVKAYNELIPKLDEDTRYDADTKIAGIFNGVGDIRAIRSSLNNVFSYSVHTDNGVESLMKYGLSLDDKGV
MSLDEAKLSSALNSNPKATQDFFYGSDSKDMGGREIHQEGIFSKFNQVIANLIDGGNAKLKIYEDSLDRDAKSLTKDKEN
AQELLKTRYNIMAERFAAYDSQISKANQKFNSVQMMIDQAAAKKN
>Mature_684_residues
AIGSLSSLGLGSKVLNYDVIDKLKDADEKALIAPLDKKMEQNVEKQKALVEIKTLLSTLKGPVKTLSDYSTYISRKSNVT
GDALSASVGAGVPIQDIKVDVQNLAQGDINELGAKFSSRDDIFSQVDTTLKFYTQNKDYAVDIKAGMTLGDVAQSITDAT
NGEVMGIVMKTGGNDPYQLMVNTKNTGEDNRVYFGSHLQSTLTNKNALSLGVDGSGKSEVSLNLKGADGNMHEVPIMLEL
PESASIKQKNAAIQKAMEQALENDPNFKDLIANGDISIDTLHGGESLIINDRRGGNIEVKGSKAKELGFLQTTTQESDLL
KSSRTIKEGKLEGVISLNGQKLDLKALTKEGNTSEENTDAIIQAINAKEGLNAFKNAEGKLVINSKTGMLTIKGEDALGK
ASLKDLGLSAGMVQSYEASQNTLFMSKNLQKASDSEFTYNGVSITRPTNEVNDVISGVNITLEQTTEPNKPAIISVSRDN
QAIIDSLKEFVKAYNELIPKLDEDTRYDADTKIAGIFNGVGDIRAIRSSLNNVFSYSVHTDNGVESLMKYGLSLDDKGVM
SLDEAKLSSALNSNPKATQDFFYGSDSKDMGGREIHQEGIFSKFNQVIANLIDGGNAKLKIYEDSLDRDAKSLTKDKENA
QELLKTRYNIMAERFAAYDSQISKANQKFNSVQMMIDQAAAKKN

Specific function: Required for the morphogenesis and for the elongation of the flagellar filament by facilitating polymerization of the flagellin monomers at the tip of growing filament. Forms a capping structure, which prevents flagellin subunits (transported through the

COG id: COG1345

COG function: function code N; Flagellar capping protein

Gene ontology:

Cell location: Secreted. Bacterial flagellum [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the fliD family [H]

Homologues:

None

Paralogues:

None

Copy number: 10-20 (rich media) [C]

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR010809
- InterPro:   IPR003481 [H]

Pfam domain/function: PF07195 FliD_C; PF02465 FliD_N [H]

EC number: NA

Molecular weight: Translated: 74216; Mature: 74085

Theoretical pI: Translated: 4.92; Mature: 4.92

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.0 %Cys     (Translated Protein)
2.6 %Met     (Translated Protein)
2.6 %Cys+Met (Translated Protein)
0.0 %Cys     (Mature Protein)
2.5 %Met     (Mature Protein)
2.5 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MAIGSLSSLGLGSKVLNYDVIDKLKDADEKALIAPLDKKMEQNVEKQKALVEIKTLLSTL
CCCCCCCCCCCCCHHHHHHHHHHHHCCCCCEEECHHHHHHHHHHHHHHHHHHHHHHHHHH
KGPVKTLSDYSTYISRKSNVTGDALSASVGAGVPIQDIKVDVQNLAQGDINELGAKFSSR
CCHHHHHHHHHHHHHCCCCCCCCHHHHHCCCCCCHHHHHHHHHHHCCCCHHHHCCCCCCH
DDIFSQVDTTLKFYTQNKDYAVDIKAGMTLGDVAQSITDATNGEVMGIVMKTGGNDPYQL
HHHHHHHHHHEEEEECCCCEEEEEECCCCHHHHHHHHHCCCCCCEEEEEEECCCCCCEEE
MVNTKNTGEDNRVYFGSHLQSTLTNKNALSLGVDGSGKSEVSLNLKGADGNMHEVPIMLE
EEECCCCCCCCEEEECHHHHHHHCCCCCEEEECCCCCCCEEEEEEECCCCCCEEEEEEEE
LPESASIKQKNAAIQKAMEQALENDPNFKDLIANGDISIDTLHGGESLIINDRRGGNIEV
CCCCCCCHHHHHHHHHHHHHHHHCCCCHHHHHCCCCEEEEEECCCCEEEEECCCCCEEEE
KGSKAKELGFLQTTTQESDLLKSSRTIKEGKLEGVISLNGQKLDLKALTKEGNTSEENTD
CCCCHHHCCCEEECCCHHHHHHHHCCHHCCCCCEEEEECCCEEEHEEECCCCCCCCCHHH
AIIQAINAKEGLNAFKNAEGKLVINSKTGMLTIKGEDALGKASLKDLGLSAGMVQSYEAS
HHHHHHHHHHHHHHHHCCCCEEEEECCCCEEEEECCCCCCCHHHHHCCCCCCHHHHCCCC
QNTLFMSKNLQKASDSEFTYNGVSITRPTNEVNDVISGVNITLEQTTEPNKPAIISVSRD
CCEEEEECCCCCCCCCCEEECCEEEECCCHHHHHHHCCCEEEEECCCCCCCCEEEEECCC
NQAIIDSLKEFVKAYNELIPKLDEDTRYDADTKIAGIFNGVGDIRAIRSSLNNVFSYSVH
CHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCHHHHHCCHHHHHHHHHHHHHHEEEEEE
TDNGVESLMKYGLSLDDKGVMSLDEAKLSSALNSNPKATQDFFYGSDSKDMGGREIHQEG
CCHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHCCCCCCCHHCCCCCCCCCCCCHHHHHHH
IFSKFNQVIANLIDGGNAKLKIYEDSLDRDAKSLTKDKENAQELLKTRYNIMAERFAAYD
HHHHHHHHHHHHHCCCCCEEEEECCCCCHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHH
SQISKANQKFNSVQMMIDQAAAKKN
HHHHHHHHHHHHHHHHHHHHHHCCC
>Mature Secondary Structure 
AIGSLSSLGLGSKVLNYDVIDKLKDADEKALIAPLDKKMEQNVEKQKALVEIKTLLSTL
CCCCCCCCCCCCHHHHHHHHHHHHCCCCCEEECHHHHHHHHHHHHHHHHHHHHHHHHHH
KGPVKTLSDYSTYISRKSNVTGDALSASVGAGVPIQDIKVDVQNLAQGDINELGAKFSSR
CCHHHHHHHHHHHHHCCCCCCCCHHHHHCCCCCCHHHHHHHHHHHCCCCHHHHCCCCCCH
DDIFSQVDTTLKFYTQNKDYAVDIKAGMTLGDVAQSITDATNGEVMGIVMKTGGNDPYQL
HHHHHHHHHHEEEEECCCCEEEEEECCCCHHHHHHHHHCCCCCCEEEEEEECCCCCCEEE
MVNTKNTGEDNRVYFGSHLQSTLTNKNALSLGVDGSGKSEVSLNLKGADGNMHEVPIMLE
EEECCCCCCCCEEEECHHHHHHHCCCCCEEEECCCCCCCEEEEEEECCCCCCEEEEEEEE
LPESASIKQKNAAIQKAMEQALENDPNFKDLIANGDISIDTLHGGESLIINDRRGGNIEV
CCCCCCCHHHHHHHHHHHHHHHHCCCCHHHHHCCCCEEEEEECCCCEEEEECCCCCEEEE
KGSKAKELGFLQTTTQESDLLKSSRTIKEGKLEGVISLNGQKLDLKALTKEGNTSEENTD
CCCCHHHCCCEEECCCHHHHHHHHCCHHCCCCCEEEEECCCEEEHEEECCCCCCCCCHHH
AIIQAINAKEGLNAFKNAEGKLVINSKTGMLTIKGEDALGKASLKDLGLSAGMVQSYEAS
HHHHHHHHHHHHHHHHCCCCEEEEECCCCEEEEECCCCCCCHHHHHCCCCCCHHHHCCCC
QNTLFMSKNLQKASDSEFTYNGVSITRPTNEVNDVISGVNITLEQTTEPNKPAIISVSRD
CCEEEEECCCCCCCCCCEEECCEEEECCCHHHHHHHCCCEEEEECCCCCCCCEEEEECCC
NQAIIDSLKEFVKAYNELIPKLDEDTRYDADTKIAGIFNGVGDIRAIRSSLNNVFSYSVH
CHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCHHHHHCCHHHHHHHHHHHHHHEEEEEE
TDNGVESLMKYGLSLDDKGVMSLDEAKLSSALNSNPKATQDFFYGSDSKDMGGREIHQEG
CCHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHCCCCCCCHHCCCCCCCCCCCCHHHHHHH
IFSKFNQVIANLIDGGNAKLKIYEDSLDRDAKSLTKDKENAQELLKTRYNIMAERFAAYD
HHHHHHHHHHHHHCCCCCEEEEECCCCCHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHH
SQISKANQKFNSVQMMIDQAAAKKN
HHHHHHHHHHHHHHHHHHHHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9923682 [H]