Definition Francisella tularensis subsp. tularensis WY96-3418, complete genome.
Accession NC_009257
Length 1,898,476

Click here to switch to the map view.

The map label for this gene is wbtH [H]

Identifier: 134301500

GI number: 134301500

Start: 417083

End: 418969

Strand: Direct

Name: wbtH [H]

Synonym: FTW_0419

Alternate gene names: 134301500

Gene position: 417083-418969 (Clockwise)

Preceding gene: 134301499

Following gene: 134301501

Centisome position: 21.97

GC content: 31.85

Gene sequence:

>1887_bases
ATGTGTGGAGTAGTAGGCTTTTACTCATTTAATAAAGAAGAAGGTTTTGACTCAATAATTAATCAATCATTGCTTTCTAT
AAAGCATAGAGGGTCGGATGATAGTGGGTATTGGTGCGACAATCAAGTTACTCTGGGGCATACTAGATTATCAATACACG
ATATAACTAATGCGGGACATCAGCCAATGTTATCTAATAGCGGTAATACTGCTATTGTGTTTAATGGAGAAATATATAAT
TACTTATCCATAAAAAATCAGCTATTAAGTGAATATTCAAATCTTAAATTTAAAAGTAACAGTGATACTGAGGTTTTGGT
CAATGCTATTGAACTTTGGGGTATAGATAAAACTTTAGAAAAATGCATAGGAATGTTTGCTTTTGGAGTTTACAGTAGAA
AAACTAGTTGTTTAATACTAGCTAGAGATAGATTTGGCGAGAAGCCATTATATTTTGGTATCCAAAATGGTATTTTGGGT
TTTGCATCAGAATTGAAGGCACTTAAGCCATTAAAGGAATGTGGCTGGAGGTTTGATATAGATAGAGATGCTTTAGCAAC
ATATATGAGGTATGCTTATGTACCAACACCATACTCTATTTATAAAAATATATCTAAACTAAATGTAGGTAGTTACATAA
AATTTGATGCTAAAGGTAATAGTAAAGAGTATAAATATTGGGATTCTAAAAAAGTACTAGATTCAGAAAAATATAAAGAT
TCGTATGATCAAGCAATCCTAGATTTAGAAATTAAGCTTAAAAGTACACTATCAATACAAATGCAGTCAGATGTTCCTCT
AGGAGCATTTTTATCCGGAGGAATTGACTCAACAACTGTAGTTGCTCTTATGCAAAGTATGTCTAAAGATAAGATAAACA
CTTTTAGTATAGGTTTTAATCAAAAAGAATATAATGAAGCTGAGCATGCAAGAGCAGTAGCAAAACATATAGGTACAAAC
CACACAGATATGTATGTTACAGAAAGAGATGCTCTTGATGTAATACCAAAACTTGCTGGAATATATGACGAGCCCTTTGC
TGATTCATCACAAATACCAACGTATCTTGTGAGTAAAATAGCTAAGTCGAAAGTAACAGTTGCACTATCAGGTGACGCTG
GTGATGAGCTCTTTGGCGGTTATAATAGATACTTTTTAGCACCAAATATTGCTAAAAAAATCAAATTTGCTAAGTTACTT
AAATATGCACCAGATGCTTGGATAAAAAAAGCTGAGATATTAAATTTTGGTAAGTTCGCTTTATTAGCAGATAAACTACT
AAAACTAAAAAGAGTTCTCGAAAAAGCAAAAACAAATAAAGAGCTTTATGTACTACTTTGTTCACAAATAAATGATACTA
GCTTTGTGTTAGGAGCAAAAGAGTATGATATATTAAGAGATAAGAATATTTATGATATTCCACAATTATCTTTCCAAGAG
TGGATGATGTTTGTTGATTCTAATACATATATGATAGATGATATATTGGTTAAGGTTGATAGAGCAGCTATGGCTAACTC
TCTAGAGACAAGAGTGCCATTTTTAGATCATAATATTTATGAATTTGCTTATTCCTTACCAATTGACTATAAAATACAAC
GAGGTAACGGAAAAAGAATTTTGAAAGATTTGTTATATAAATATGTGCCAGAAAGTTTGGTCAATAGGTCTAAGATGGGG
TTTGGTATTCCGCTTGCTAAATGGTTAAGAGAAGATTTACGAGAGTGGGCAGATAATTTACTGGATTATAGTAAAATAGA
CAAGCAAGGTTACTTAAGTCCTGAGGTGGTGCAAAAATATTGGCAAGAGCATTTGAGTGGTAAAAGAAATTGGCAAGCAA
TATTATGGAATATTCTAATTTTTCAGGAGTGGTTAGATAATGAGTAA

Upstream 100 bases:

>100_bases
TAGTCATGAAAAAGCGCATGAGAGAATATATAATAAATAATTTTAGTATAGAAGCTATTTTGGAAAAACACGAAAAACTT
TATCATGAGGGCAGTGTCTA

Downstream 100 bases:

>100_bases
AGTAAATGTAACAAAACCATACTTACCAGATATAAATAAATATAAAAGCTATGTAAATAAAATATACAAAAATGGATGGC
TTACTAATAATGGTCCGTTA

Product: asparagine synthase (glutamine-hydrolyzing)

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 628; Mature: 628

Protein sequence:

>628_residues
MCGVVGFYSFNKEEGFDSIINQSLLSIKHRGSDDSGYWCDNQVTLGHTRLSIHDITNAGHQPMLSNSGNTAIVFNGEIYN
YLSIKNQLLSEYSNLKFKSNSDTEVLVNAIELWGIDKTLEKCIGMFAFGVYSRKTSCLILARDRFGEKPLYFGIQNGILG
FASELKALKPLKECGWRFDIDRDALATYMRYAYVPTPYSIYKNISKLNVGSYIKFDAKGNSKEYKYWDSKKVLDSEKYKD
SYDQAILDLEIKLKSTLSIQMQSDVPLGAFLSGGIDSTTVVALMQSMSKDKINTFSIGFNQKEYNEAEHARAVAKHIGTN
HTDMYVTERDALDVIPKLAGIYDEPFADSSQIPTYLVSKIAKSKVTVALSGDAGDELFGGYNRYFLAPNIAKKIKFAKLL
KYAPDAWIKKAEILNFGKFALLADKLLKLKRVLEKAKTNKELYVLLCSQINDTSFVLGAKEYDILRDKNIYDIPQLSFQE
WMMFVDSNTYMIDDILVKVDRAAMANSLETRVPFLDHNIYEFAYSLPIDYKIQRGNGKRILKDLLYKYVPESLVNRSKMG
FGIPLAKWLREDLREWADNLLDYSKIDKQGYLSPEVVQKYWQEHLSGKRNWQAILWNILIFQEWLDNE

Sequences:

>Translated_628_residues
MCGVVGFYSFNKEEGFDSIINQSLLSIKHRGSDDSGYWCDNQVTLGHTRLSIHDITNAGHQPMLSNSGNTAIVFNGEIYN
YLSIKNQLLSEYSNLKFKSNSDTEVLVNAIELWGIDKTLEKCIGMFAFGVYSRKTSCLILARDRFGEKPLYFGIQNGILG
FASELKALKPLKECGWRFDIDRDALATYMRYAYVPTPYSIYKNISKLNVGSYIKFDAKGNSKEYKYWDSKKVLDSEKYKD
SYDQAILDLEIKLKSTLSIQMQSDVPLGAFLSGGIDSTTVVALMQSMSKDKINTFSIGFNQKEYNEAEHARAVAKHIGTN
HTDMYVTERDALDVIPKLAGIYDEPFADSSQIPTYLVSKIAKSKVTVALSGDAGDELFGGYNRYFLAPNIAKKIKFAKLL
KYAPDAWIKKAEILNFGKFALLADKLLKLKRVLEKAKTNKELYVLLCSQINDTSFVLGAKEYDILRDKNIYDIPQLSFQE
WMMFVDSNTYMIDDILVKVDRAAMANSLETRVPFLDHNIYEFAYSLPIDYKIQRGNGKRILKDLLYKYVPESLVNRSKMG
FGIPLAKWLREDLREWADNLLDYSKIDKQGYLSPEVVQKYWQEHLSGKRNWQAILWNILIFQEWLDNE
>Mature_628_residues
MCGVVGFYSFNKEEGFDSIINQSLLSIKHRGSDDSGYWCDNQVTLGHTRLSIHDITNAGHQPMLSNSGNTAIVFNGEIYN
YLSIKNQLLSEYSNLKFKSNSDTEVLVNAIELWGIDKTLEKCIGMFAFGVYSRKTSCLILARDRFGEKPLYFGIQNGILG
FASELKALKPLKECGWRFDIDRDALATYMRYAYVPTPYSIYKNISKLNVGSYIKFDAKGNSKEYKYWDSKKVLDSEKYKD
SYDQAILDLEIKLKSTLSIQMQSDVPLGAFLSGGIDSTTVVALMQSMSKDKINTFSIGFNQKEYNEAEHARAVAKHIGTN
HTDMYVTERDALDVIPKLAGIYDEPFADSSQIPTYLVSKIAKSKVTVALSGDAGDELFGGYNRYFLAPNIAKKIKFAKLL
KYAPDAWIKKAEILNFGKFALLADKLLKLKRVLEKAKTNKELYVLLCSQINDTSFVLGAKEYDILRDKNIYDIPQLSFQE
WMMFVDSNTYMIDDILVKVDRAAMANSLETRVPFLDHNIYEFAYSLPIDYKIQRGNGKRILKDLLYKYVPESLVNRSKMG
FGIPLAKWLREDLREWADNLLDYSKIDKQGYLSPEVVQKYWQEHLSGKRNWQAILWNILIFQEWLDNE

Specific function: Main asparagine synthetase in vegetative cells [H]

COG id: COG0367

COG function: function code E; Asparagine synthase (glutamine-hydrolyzing)

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 glutamine amidotransferase type-2 domain [H]

Homologues:

Organism=Homo sapiens, GI168229248, Length=424, Percent_Identity=26.8867924528302, Blast_Score=99, Evalue=1e-20,
Organism=Homo sapiens, GI168229252, Length=424, Percent_Identity=26.8867924528302, Blast_Score=99, Evalue=1e-20,
Organism=Homo sapiens, GI168229250, Length=424, Percent_Identity=26.8867924528302, Blast_Score=99, Evalue=1e-20,
Organism=Homo sapiens, GI296010848, Length=397, Percent_Identity=26.9521410579345, Blast_Score=95, Evalue=2e-19,
Organism=Homo sapiens, GI296010852, Length=329, Percent_Identity=25.8358662613982, Blast_Score=80, Evalue=5e-15,
Organism=Homo sapiens, GI296010850, Length=329, Percent_Identity=25.8358662613982, Blast_Score=80, Evalue=5e-15,
Organism=Escherichia coli, GI1786889, Length=412, Percent_Identity=29.3689320388349, Blast_Score=150, Evalue=3e-37,
Organism=Caenorhabditis elegans, GI71993933, Length=374, Percent_Identity=28.3422459893048, Blast_Score=115, Evalue=6e-26,
Organism=Caenorhabditis elegans, GI25147557, Length=374, Percent_Identity=28.3422459893048, Blast_Score=115, Evalue=8e-26,
Organism=Caenorhabditis elegans, GI17560178, Length=358, Percent_Identity=27.6536312849162, Blast_Score=94, Evalue=3e-19,
Organism=Saccharomyces cerevisiae, GI6321563, Length=437, Percent_Identity=27.0022883295195, Blast_Score=112, Evalue=2e-25,
Organism=Saccharomyces cerevisiae, GI6325403, Length=434, Percent_Identity=26.2672811059908, Blast_Score=110, Evalue=9e-25,
Organism=Drosophila melanogaster, GI45553209, Length=415, Percent_Identity=28.9156626506024, Blast_Score=139, Evalue=8e-33,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR006426
- InterPro:   IPR001962
- InterPro:   IPR017932
- InterPro:   IPR014729 [H]

Pfam domain/function: PF00733 Asn_synthase [H]

EC number: =6.3.5.4 [H]

Molecular weight: Translated: 71826; Mature: 71826

Theoretical pI: Translated: 8.06; Mature: 8.06

Prosite motif: PS00443 GATASE_TYPE_II

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.0 %Cys     (Translated Protein)
2.1 %Met     (Translated Protein)
3.0 %Cys+Met (Translated Protein)
1.0 %Cys     (Mature Protein)
2.1 %Met     (Mature Protein)
3.0 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MCGVVGFYSFNKEEGFDSIINQSLLSIKHRGSDDSGYWCDNQVTLGHTRLSIHDITNAGH
CCCEEEEECCCCCCCHHHHHHHHHHHHHHCCCCCCCEEECCEEEECCEEEEEEECCCCCC
QPMLSNSGNTAIVFNGEIYNYLSIKNQLLSEYSNLKFKSNSDTEVLVNAIELWGIDKTLE
CCCCCCCCCEEEEECCCCHHHHHHHHHHHHHHHCCEECCCCCHHHHHHHHHHHCCHHHHH
KCIGMFAFGVYSRKTSCLILARDRFGEKPLYFGIQNGILGFASELKALKPLKECGWRFDI
HHHHHHHHHHHCCCCCEEEEECCCCCCCCEEEEECCCHHHHHHHHHHHCHHHHCCCCCCC
DRDALATYMRYAYVPTPYSIYKNISKLNVGSYIKFDAKGNSKEYKYWDSKKVLDSEKYKD
CHHHHHHHHHHHCCCCCHHHHHCHHHCCCCCEEEECCCCCCCCCEECCCCHHHCCHHHHH
SYDQAILDLEIKLKSTLSIQMQSDVPLGAFLSGGIDSTTVVALMQSMSKDKINTFSIGFN
HHHHEEEEEEEEEECEEEEEEECCCCHHHHHCCCCCHHHHHHHHHHHCCCCCEEEEECCC
QKEYNEAEHARAVAKHIGTNHTDMYVTERDALDVIPKLAGIYDEPFADSSQIPTYLVSKI
HHHHHHHHHHHHHHHHHCCCCCEEEEECCHHHHHHHHHHCCCCCCCCCCCCCHHHHHHHH
AKSKVTVALSGDAGDELFGGYNRYFLAPNIAKKIKFAKLLKYAPDAWIKKAEILNFGKFA
HHCEEEEEECCCCCHHHHCCCCEEEECCCHHHHHHHHHHHHHCCHHHHHHHHHHCCCHHH
LLADKLLKLKRVLEKAKTNKELYVLLCSQINDTSFVLGAKEYDILRDKNIYDIPQLSFQE
HHHHHHHHHHHHHHHHCCCCEEEEEEECCCCCCEEEECCCHHHHHCCCCCCCCCCCCHHH
WMMFVDSNTYMIDDILVKVDRAAMANSLETRVPFLDHNIYEFAYSLPIDYKIQRGNGKRI
HHEEECCCCEEEHHHHHHHHHHHHHHHHHHCCCHHCCCHHHHHEECCCEEEEECCCCHHH
LKDLLYKYVPESLVNRSKMGFGIPLAKWLREDLREWADNLLDYSKIDKQGYLSPEVVQKY
HHHHHHHHCCHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHH
WQEHLSGKRNWQAILWNILIFQEWLDNE
HHHHHCCCCCHHHHHHHHHHHHHHHCCC
>Mature Secondary Structure
MCGVVGFYSFNKEEGFDSIINQSLLSIKHRGSDDSGYWCDNQVTLGHTRLSIHDITNAGH
CCCEEEEECCCCCCCHHHHHHHHHHHHHHCCCCCCCEEECCEEEECCEEEEEEECCCCCC
QPMLSNSGNTAIVFNGEIYNYLSIKNQLLSEYSNLKFKSNSDTEVLVNAIELWGIDKTLE
CCCCCCCCCEEEEECCCCHHHHHHHHHHHHHHHCCEECCCCCHHHHHHHHHHHCCHHHHH
KCIGMFAFGVYSRKTSCLILARDRFGEKPLYFGIQNGILGFASELKALKPLKECGWRFDI
HHHHHHHHHHHCCCCCEEEEECCCCCCCCEEEEECCCHHHHHHHHHHHCHHHHCCCCCCC
DRDALATYMRYAYVPTPYSIYKNISKLNVGSYIKFDAKGNSKEYKYWDSKKVLDSEKYKD
CHHHHHHHHHHHCCCCCHHHHHCHHHCCCCCEEEECCCCCCCCCEECCCCHHHCCHHHHH
SYDQAILDLEIKLKSTLSIQMQSDVPLGAFLSGGIDSTTVVALMQSMSKDKINTFSIGFN
HHHHEEEEEEEEEECEEEEEEECCCCHHHHHCCCCCHHHHHHHHHHHCCCCCEEEEECCC
QKEYNEAEHARAVAKHIGTNHTDMYVTERDALDVIPKLAGIYDEPFADSSQIPTYLVSKI
HHHHHHHHHHHHHHHHHCCCCCEEEEECCHHHHHHHHHHCCCCCCCCCCCCCHHHHHHHH
AKSKVTVALSGDAGDELFGGYNRYFLAPNIAKKIKFAKLLKYAPDAWIKKAEILNFGKFA
HHCEEEEEECCCCCHHHHCCCCEEEECCCHHHHHHHHHHHHHCCHHHHHHHHHHCCCHHH
LLADKLLKLKRVLEKAKTNKELYVLLCSQINDTSFVLGAKEYDILRDKNIYDIPQLSFQE
HHHHHHHHHHHHHHHHCCCCEEEEEEECCCCCCEEEECCCHHHHHCCCCCCCCCCCCHHH
WMMFVDSNTYMIDDILVKVDRAAMANSLETRVPFLDHNIYEFAYSLPIDYKIQRGNGKRI
HHEEECCCCEEEHHHHHHHHHHHHHHHHHHCCCHHCCCHHHHHEECCCEEEEECCCCHHH
LKDLLYKYVPESLVNRSKMGFGIPLAKWLREDLREWADNLLDYSKIDKQGYLSPEVVQKY
HHHHHHHHCCHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHH
WQEHLSGKRNWQAILWNILIFQEWLDNE
HHHHHCCCCCHHHHHHHHHHHHHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9387221; 9384377; 8755891; 10498721 [H]