Definition Vibrio cholerae O395 chromosome 2, complete sequence.
Accession NC_009457
Length 3,024,069

Click here to switch to the map view.

The map label for this gene is flaA

Identifier: 147674518

GI number: 147674518

Start: 1887997

End: 1889136

Strand: Reverse

Name: flaA

Synonym: VC0395_A1780

Alternate gene names: 147674518

Gene position: 1889136-1887997 (Counterclockwise)

Preceding gene: 147673159

Following gene: 147675419

Centisome position: 62.47

GC content: 48.77

Gene sequence:

>1140_bases
ATGACCATTAACGTAAATACCAACGTGTCGGCGATGACCGCACAACGTTATCTGACCAAGGCGACGGGAGAGCTTAACAC
CTCCATGGAACGCCTCTCATCAGGTAATCGCATTAACAGTGCAAAAGATGACGCGGCAGGCCTGCAGATTTCAAACCGTT
TAACGGCGCAATCTCGTGGTTTGGATGTGGCAATGCGTAACGCCAACGATGGTATTTCGATTGCTCAAACCGCAGAAGGT
GCGATGAATGAATCGACCAGCATTTTGCAGCGTATGCGTGACCTCGCCTTACAATCGGCGAACGGTACCAACTCAGCGTC
AGAGCGTCAGGCTCTGAATGAAGAGTCGGTGGCACTGCAAGATGAACTGAACCGTATCGCTGAAACCACGTCATTTGGTG
GTCGTAAGCTACTCAATGGTTCGTTTGGTGAAGCTTCGTTCCAAATCGGTTCTAGCTCGGGTGAAGCGATCATTATGGGA
CTGACCAGTGTACGTGCTGATGATTTCCGCATGGGTGGCCAATCCTTTATTGCCGAACAACCTAAGACTAAAGAGTGGGG
GGTACCACCTACCGCTCGTGACCTGAAGTTTGAATTCACCAAGAAAGACGGTGAGGCAGTCGTGCTTGATATCATTGCCA
AAGATGGTGATGACATTGAAGAGCTGGCCACTTACATCAACGGTCAAACGGATCTGTTCAAAGCTTCGGTTGACCAAGAA
GGCAAACTGCAGATTTTTGTTGCTGAACCCAATATTGAAGGCAACTTCAATATCTCCGGTGGTTTGGCAACCGAACTTGG
CCTCAATGGTGGCCCTGGTGTGAAAACCACAGTTCAAGACATTGATATCACCAGTGTCGGTGGTTCACAGAACGCCGTGG
GTATCATCGATGCCGCATTAAAATACGTCGATTCGCAACGAGCTGACCTCGGTGCTAAACAGAACCGACTCAGTCACAGC
ATCAGTAACCTGTCGAATATTCAGGAGAACGTGGAAGCGTCGAAAAGTCGGATTAAAGATACGGATTTTGCGAAGGAAAC
AACGCAACTTACCAAATCTCAGATTCTGCAACAGGCGGGGACTTCAATTCTTGCCCAAGCGAAACAGTTGCCAAACTCTG
CAATCTCGTTATTGCAGTAG

Upstream 100 bases:

>100_bases
TTGGGCCGATTTGGCAAGTTATTCACGGTCAGTGCTTCCAAAAGAGACCAAAGCTGACCGCTTCGCAAATGAGCTTGCGA
ACTCGATAGGAGAGCAAACT

Downstream 100 bases:

>100_bases
TTCACGGTACCTTCATTAATGAGCTCAGACGTGGGTATGTAATGAAGGGACTTTGGCAAAGTATGGTTATGGAATGTTAG
GCGAGCTCTCTCACTCAAAC

Product: flagellin

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 379; Mature: 378

Protein sequence:

>379_residues
MTINVNTNVSAMTAQRYLTKATGELNTSMERLSSGNRINSAKDDAAGLQISNRLTAQSRGLDVAMRNANDGISIAQTAEG
AMNESTSILQRMRDLALQSANGTNSASERQALNEESVALQDELNRIAETTSFGGRKLLNGSFGEASFQIGSSSGEAIIMG
LTSVRADDFRMGGQSFIAEQPKTKEWGVPPTARDLKFEFTKKDGEAVVLDIIAKDGDDIEELATYINGQTDLFKASVDQE
GKLQIFVAEPNIEGNFNISGGLATELGLNGGPGVKTTVQDIDITSVGGSQNAVGIIDAALKYVDSQRADLGAKQNRLSHS
ISNLSNIQENVEASKSRIKDTDFAKETTQLTKSQILQQAGTSILAQAKQLPNSAISLLQ

Sequences:

>Translated_379_residues
MTINVNTNVSAMTAQRYLTKATGELNTSMERLSSGNRINSAKDDAAGLQISNRLTAQSRGLDVAMRNANDGISIAQTAEG
AMNESTSILQRMRDLALQSANGTNSASERQALNEESVALQDELNRIAETTSFGGRKLLNGSFGEASFQIGSSSGEAIIMG
LTSVRADDFRMGGQSFIAEQPKTKEWGVPPTARDLKFEFTKKDGEAVVLDIIAKDGDDIEELATYINGQTDLFKASVDQE
GKLQIFVAEPNIEGNFNISGGLATELGLNGGPGVKTTVQDIDITSVGGSQNAVGIIDAALKYVDSQRADLGAKQNRLSHS
ISNLSNIQENVEASKSRIKDTDFAKETTQLTKSQILQQAGTSILAQAKQLPNSAISLLQ
>Mature_378_residues
TINVNTNVSAMTAQRYLTKATGELNTSMERLSSGNRINSAKDDAAGLQISNRLTAQSRGLDVAMRNANDGISIAQTAEGA
MNESTSILQRMRDLALQSANGTNSASERQALNEESVALQDELNRIAETTSFGGRKLLNGSFGEASFQIGSSSGEAIIMGL
TSVRADDFRMGGQSFIAEQPKTKEWGVPPTARDLKFEFTKKDGEAVVLDIIAKDGDDIEELATYINGQTDLFKASVDQEG
KLQIFVAEPNIEGNFNISGGLATELGLNGGPGVKTTVQDIDITSVGGSQNAVGIIDAALKYVDSQRADLGAKQNRLSHSI
SNLSNIQENVEASKSRIKDTDFAKETTQLTKSQILQQAGTSILAQAKQLPNSAISLLQ

Specific function: Flagellin is the subunit protein which polymerizes to form the filaments of bacterial flagella. FlaA is required to form a core or scaffold into which the other flagellins are inserted to provide structural integrity. Essential for flagellar synthesis and

COG id: COG1344

COG function: function code N; Flagellin and related hook-associated proteins

Gene ontology:

Cell location: Secreted. Bacterial flagellum

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the bacterial flagellin family

Homologues:

Organism=Escherichia coli, GI1788232, Length=190, Percent_Identity=41.5789473684211, Blast_Score=128, Evalue=7e-31,

Paralogues:

None

Copy number: 200,000-400,000 (rich media) [C]

Swissprot (AC and ID): FLAA_VIBC3 (A5F672)

Other databases:

- EMBL:   AF007121
- EMBL:   CP000627
- EMBL:   CP001235
- ProteinModelPortal:   A5F672
- STRING:   A5F672
- GenomeReviews:   CP000627_GR
- GenomeReviews:   CP001235_GR
- KEGG:   vco:VC0395_A1780
- eggNOG:   COG1344
- HOGENOM:   HBG758847
- OMA:   NSNELDK
- ProtClustDB:   PRK08869
- BioCyc:   VCHO345073:VC0395_A1780-MONOMER
- GO:   GO:0009405
- InterPro:   IPR001492
- InterPro:   IPR001029
- InterPro:   IPR010810
- PRINTS:   PR00207

Pfam domain/function: PF00700 Flagellin_C; PF07196 Flagellin_IN; PF00669 Flagellin_N

EC number: NA

Molecular weight: Translated: 40383; Mature: 40252

Theoretical pI: Translated: 4.58; Mature: 4.58

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.0 %Cys     (Translated Protein)
2.1 %Met     (Translated Protein)
2.1 %Cys+Met (Translated Protein)
0.0 %Cys     (Mature Protein)
1.9 %Met     (Mature Protein)
1.9 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTINVNTNVSAMTAQRYLTKATGELNTSMERLSSGNRINSAKDDAAGLQISNRLTAQSRG
CEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCEEHHHHHHHHCC
LDVAMRNANDGISIAQTAEGAMNESTSILQRMRDLALQSANGTNSASERQALNEESVALQ
CEEEEECCCCCCCHHHHHCCCCCHHHHHHHHHHHHHHHCCCCCCCHHHHHHCCHHHHHHH
DELNRIAETTSFGGRKLLNGSFGEASFQIGSSSGEAIIMGLTSVRADDFRMGGQSFIAEQ
HHHHHHHHHHCCCCCCCCCCCCCCCEEEECCCCCCEEEEEEHHCCCHHHHCCCHHHHCCC
PKTKEWGVPPTARDLKFEFTKKDGEAVVLDIIAKDGDDIEELATYINGQTDLFKASVDQE
CCCCCCCCCCCCCCCEEEEECCCCCEEEEEEEECCCCCHHHHHHHHCCCHHEEEECCCCC
GKLQIFVAEPNIEGNFNISGGLATELGLNGGPGVKTTVQDIDITSVGGSQNAVGIIDAAL
CCEEEEEECCCCCCCEEECCCCCEECCCCCCCCCCEEEEECEEEECCCCCCCHHHHHHHH
KYVDSQRADLGAKQNRLSHSISNLSNIQENVEASKSRIKDTDFAKETTQLTKSQILQQAG
HHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHH
TSILAQAKQLPNSAISLLQ
HHHHHHHHHCCHHHHHHCC
>Mature Secondary Structure 
TINVNTNVSAMTAQRYLTKATGELNTSMERLSSGNRINSAKDDAAGLQISNRLTAQSRG
EEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCEEHHHHHHHHCC
LDVAMRNANDGISIAQTAEGAMNESTSILQRMRDLALQSANGTNSASERQALNEESVALQ
CEEEEECCCCCCCHHHHHCCCCCHHHHHHHHHHHHHHHCCCCCCCHHHHHHCCHHHHHHH
DELNRIAETTSFGGRKLLNGSFGEASFQIGSSSGEAIIMGLTSVRADDFRMGGQSFIAEQ
HHHHHHHHHHCCCCCCCCCCCCCCCEEEECCCCCCEEEEEEHHCCCHHHHCCCHHHHCCC
PKTKEWGVPPTARDLKFEFTKKDGEAVVLDIIAKDGDDIEELATYINGQTDLFKASVDQE
CCCCCCCCCCCCCCCEEEEECCCCCEEEEEEEECCCCCHHHHHHHHCCCHHEEEECCCCC
GKLQIFVAEPNIEGNFNISGGLATELGLNGGPGVKTTVQDIDITSVGGSQNAVGIIDAAL
CCEEEEEECCCCCCCEEECCCCCEECCCCCCCCCCEEEEECEEEECCCCCCCHHHHHHHH
KYVDSQRADLGAKQNRLSHSISNLSNIQENVEASKSRIKDTDFAKETTQLTKSQILQQAG
HHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHH
TSILAQAKQLPNSAISLLQ
HHHHHHHHHCCHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9440520