| Definition | Herpetosiphon aurantiacus ATCC 23779 chromosome, complete genome. |
|---|---|
| Accession | NC_009972 |
| Length | 6,346,587 |
Click here to switch to the map view.
The map label for this gene is asnB [H]
Identifier: 159900518
GI number: 159900518
Start: 5111356
End: 5113224
Strand: Reverse
Name: asnB [H]
Synonym: Haur_4005
Alternate gene names: 159900518
Gene position: 5113224-5111356 (Counterclockwise)
Preceding gene: 159900519
Following gene: 159900517
Centisome position: 80.57
GC content: 53.29
Gene sequence:
>1869_bases ATGTGTGGCATTACGGGCCATCTCGAATGGCATGGCACGGCGCAAACCGCCATTCTTGAGCAGCAAACCGAGGCGATTCG CCATCGTGGGCCGGATAGTGCGGGCTTTTTTTGCGTTGCTCAGGTGGCGTTGGGCATGCGGCGCTTGGCAATTATCGACC TAACCAGTGGCGATCAGCCGATGTTTAGTCGTGATGGCGATTTAGCCTTGGTGTTCAACGGCGAAATTTATAATTTTCAG GCTTTGCGCCAGCAATTGCAGCAACTCGGCCAACATTTCGCCACCAACAGCGATACCGAAGTGATTGTGCGGGGGATTGA GCAATGGGGTATTTTGGGCTGTGTGCAACGCTTGAATGGCATGTTTGCCTTGGCGATTTGGCAGCAACAAGCCCAACGCC TGACTTTGGTGCGCGATCGACTTGGGATCAAGCCTCTCTATTGGTATTCCGATGCTCAGCGCTTGGTGTTTGGCTCGGAA ATCAAGGCAATTTTGGCGCATCCAGCAGTGCCACGCCAAATCAATCTGCAAGGTTTGGCTAATTATCTAAGTTTTGGCCA TAGCCTCGCACCCCAAACCATGCTCCAAGCTATTTATAAAGTCGAGCCAGCCCACATTCTGACATGGGATGTTGCTAGCC GTGCCATGCAAACCCAACGCTATTGGCAATTGCAGCCCAATCCAATCGCGATTGCGCCCGCCGAAGCTGCCGCCGAATGC TATAGCCGTTTGCGCGAAGCTGTGCGGTTGCAACTGATTAGCGATGTGCCGCTGGGTGCGTTTCTTAGTGGCGGGCTTGA TTCAAGTATTATCGTGGGCTTGATGCAGCGCTTGGGAGCAGCACCAATCAACACATTTAGCGTGGGCTTTGAGCATGCAG GCTTCAACGAATTGCCCGATGCAGCACTCGTGGCCCAGCATTTTGGCACTAAACATCATGAACTGCGCCTGAATGCCAAC GATTTGGTTGGCGCTTTGCAAACCTTGGTTTATCACTACGACGAACCATTTGGCGATGCCGCAGGCTTGCCGGTATATCT CGTTTCACGCTTTGCCCGCGAACATGTCAAAGTGGTGCTGACGGGCGAGGGCAGCGATGAGCAATGGGCTGGTTATCGGC GCTATCAAGCCGAATTGATCGCTCGGATGGCGCAGTATTTGCCTGGGCGTAGCGCAATTGCCGCGCTGATTCGCCAGTTG CCCCGTAATCGCCGCCTCAAACAGGCAATTCGCACCTTAGATCAGCGTGATCCCGGGCGGCGTTACGCTGCATGGCTGAC GATTGCCGATGTGCAACAGCGCCAACGCTTGCTGCAACCACATATCAGCGCAGTGCTAGGGGATTATGCGCCTGAGCAAA TCTATGATCAGGTGTATCCGCGCAGCGGCGCAGCCATGACCAACATGGGCTTGGCCGATTTACAAACATGGTTGCCAGAT ACCTATTTGGAAAAAGTTGATAAGGCCTCGATGGCTGCTAGTATCGAGGCGCGGGTGCCATTTCTTGACCATACCTTGGT GGAATGGACGATGAATTTGCCGCCAACACTTAAACTGCGTGGCACAAAAACCAAGTGGTTGCTCCGCCAAGCTTTTGGCG AAATGCTGCCGCAACGCACTTTGCGCAAGCCTAAACATGGCTTTGCAGTGCCAACCGACCCATGGTTTCGCGGAGCATTG AGCAACTGGACTGCCGAAATTTTGTTTGATCAACGCACGCTCAGCCGTGGTTTGTTCAATCCGCACGAAGTCCAACGGAT CTACCAAGCCCATCGCGATGGCAAAGAAACCGCAGATACCGTATTATGGTTACTACTGAACATCGAACTTTGGCAACGGA TCTATCTTGATCGCGAGGAACGGCTATGA
Upstream 100 bases:
>100_bases GAACGATCAAACTTTTACCCTTCTCATCAAGCAGAGAAGGGTTTCGTTAATTTTTGCTCCAGCATTGTTCAATCACTATT ACTCTCATTTGGAGCGTTGT
Downstream 100 bases:
>100_bases ATCAACCTTTAGTGCTGCATATTGCAACTGCCGATATGGGCTTGCGCTTTTTACTGCTCGAACAGATGCAGGCAATTCAT CATGCAGGCTATCAGGTACG
Product: asparagine synthase
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 622; Mature: 622
Protein sequence:
>622_residues MCGITGHLEWHGTAQTAILEQQTEAIRHRGPDSAGFFCVAQVALGMRRLAIIDLTSGDQPMFSRDGDLALVFNGEIYNFQ ALRQQLQQLGQHFATNSDTEVIVRGIEQWGILGCVQRLNGMFALAIWQQQAQRLTLVRDRLGIKPLYWYSDAQRLVFGSE IKAILAHPAVPRQINLQGLANYLSFGHSLAPQTMLQAIYKVEPAHILTWDVASRAMQTQRYWQLQPNPIAIAPAEAAAEC YSRLREAVRLQLISDVPLGAFLSGGLDSSIIVGLMQRLGAAPINTFSVGFEHAGFNELPDAALVAQHFGTKHHELRLNAN DLVGALQTLVYHYDEPFGDAAGLPVYLVSRFAREHVKVVLTGEGSDEQWAGYRRYQAELIARMAQYLPGRSAIAALIRQL PRNRRLKQAIRTLDQRDPGRRYAAWLTIADVQQRQRLLQPHISAVLGDYAPEQIYDQVYPRSGAAMTNMGLADLQTWLPD TYLEKVDKASMAASIEARVPFLDHTLVEWTMNLPPTLKLRGTKTKWLLRQAFGEMLPQRTLRKPKHGFAVPTDPWFRGAL SNWTAEILFDQRTLSRGLFNPHEVQRIYQAHRDGKETADTVLWLLLNIELWQRIYLDREERL
Sequences:
>Translated_622_residues MCGITGHLEWHGTAQTAILEQQTEAIRHRGPDSAGFFCVAQVALGMRRLAIIDLTSGDQPMFSRDGDLALVFNGEIYNFQ ALRQQLQQLGQHFATNSDTEVIVRGIEQWGILGCVQRLNGMFALAIWQQQAQRLTLVRDRLGIKPLYWYSDAQRLVFGSE IKAILAHPAVPRQINLQGLANYLSFGHSLAPQTMLQAIYKVEPAHILTWDVASRAMQTQRYWQLQPNPIAIAPAEAAAEC YSRLREAVRLQLISDVPLGAFLSGGLDSSIIVGLMQRLGAAPINTFSVGFEHAGFNELPDAALVAQHFGTKHHELRLNAN DLVGALQTLVYHYDEPFGDAAGLPVYLVSRFAREHVKVVLTGEGSDEQWAGYRRYQAELIARMAQYLPGRSAIAALIRQL PRNRRLKQAIRTLDQRDPGRRYAAWLTIADVQQRQRLLQPHISAVLGDYAPEQIYDQVYPRSGAAMTNMGLADLQTWLPD TYLEKVDKASMAASIEARVPFLDHTLVEWTMNLPPTLKLRGTKTKWLLRQAFGEMLPQRTLRKPKHGFAVPTDPWFRGAL SNWTAEILFDQRTLSRGLFNPHEVQRIYQAHRDGKETADTVLWLLLNIELWQRIYLDREERL >Mature_622_residues MCGITGHLEWHGTAQTAILEQQTEAIRHRGPDSAGFFCVAQVALGMRRLAIIDLTSGDQPMFSRDGDLALVFNGEIYNFQ ALRQQLQQLGQHFATNSDTEVIVRGIEQWGILGCVQRLNGMFALAIWQQQAQRLTLVRDRLGIKPLYWYSDAQRLVFGSE IKAILAHPAVPRQINLQGLANYLSFGHSLAPQTMLQAIYKVEPAHILTWDVASRAMQTQRYWQLQPNPIAIAPAEAAAEC YSRLREAVRLQLISDVPLGAFLSGGLDSSIIVGLMQRLGAAPINTFSVGFEHAGFNELPDAALVAQHFGTKHHELRLNAN DLVGALQTLVYHYDEPFGDAAGLPVYLVSRFAREHVKVVLTGEGSDEQWAGYRRYQAELIARMAQYLPGRSAIAALIRQL PRNRRLKQAIRTLDQRDPGRRYAAWLTIADVQQRQRLLQPHISAVLGDYAPEQIYDQVYPRSGAAMTNMGLADLQTWLPD TYLEKVDKASMAASIEARVPFLDHTLVEWTMNLPPTLKLRGTKTKWLLRQAFGEMLPQRTLRKPKHGFAVPTDPWFRGAL SNWTAEILFDQRTLSRGLFNPHEVQRIYQAHRDGKETADTVLWLLLNIELWQRIYLDREERL
Specific function: Main asparagine synthetase in vegetative cells [H]
COG id: COG0367
COG function: function code E; Asparagine synthase (glutamine-hydrolyzing)
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 glutamine amidotransferase type-2 domain [H]
Homologues:
Organism=Homo sapiens, GI168229248, Length=399, Percent_Identity=29.3233082706767, Blast_Score=128, Evalue=2e-29, Organism=Homo sapiens, GI168229252, Length=399, Percent_Identity=29.3233082706767, Blast_Score=128, Evalue=2e-29, Organism=Homo sapiens, GI168229250, Length=399, Percent_Identity=29.3233082706767, Blast_Score=128, Evalue=2e-29, Organism=Homo sapiens, GI296010848, Length=371, Percent_Identity=29.6495956873315, Blast_Score=127, Evalue=4e-29, Organism=Homo sapiens, GI296010852, Length=308, Percent_Identity=28.5714285714286, Blast_Score=95, Evalue=2e-19, Organism=Homo sapiens, GI296010850, Length=308, Percent_Identity=28.5714285714286, Blast_Score=95, Evalue=2e-19, Organism=Escherichia coli, GI1786889, Length=395, Percent_Identity=31.1392405063291, Blast_Score=156, Evalue=5e-39, Organism=Caenorhabditis elegans, GI25147557, Length=383, Percent_Identity=30.2872062663185, Blast_Score=123, Evalue=3e-28, Organism=Caenorhabditis elegans, GI71993933, Length=383, Percent_Identity=30.2872062663185, Blast_Score=122, Evalue=4e-28, Organism=Caenorhabditis elegans, GI25147560, Length=331, Percent_Identity=29.9093655589124, Blast_Score=95, Evalue=1e-19, Organism=Saccharomyces cerevisiae, GI6321563, Length=415, Percent_Identity=29.3975903614458, Blast_Score=139, Evalue=2e-33, Organism=Saccharomyces cerevisiae, GI6325403, Length=416, Percent_Identity=29.3269230769231, Blast_Score=135, Evalue=1e-32, Organism=Drosophila melanogaster, GI45553209, Length=397, Percent_Identity=28.463476070529, Blast_Score=143, Evalue=3e-34,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR006426 - InterPro: IPR001962 - InterPro: IPR017932 - InterPro: IPR014729 [H]
Pfam domain/function: PF00733 Asn_synthase [H]
EC number: =6.3.5.4 [H]
Molecular weight: Translated: 70319; Mature: 70319
Theoretical pI: Translated: 8.74; Mature: 8.74
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.6 %Cys (Translated Protein) 2.1 %Met (Translated Protein) 2.7 %Cys+Met (Translated Protein) 0.6 %Cys (Mature Protein) 2.1 %Met (Mature Protein) 2.7 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MCGITGHLEWHGTAQTAILEQQTEAIRHRGPDSAGFFCVAQVALGMRRLAIIDLTSGDQP CCCCCCCEEECCCHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHEEEEEECCCCCC MFSRDGDLALVFNGEIYNFQALRQQLQQLGQHFATNSDTEVIVRGIEQWGILGCVQRLNG CCCCCCCEEEEECCCEECHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHCC MFALAIWQQQAQRLTLVRDRLGIKPLYWYSDAQRLVFGSEIKAILAHPAVPRQINLQGLA CEEHHHHHHHHHHHHHHHHHCCCCEEEEECCCCHHHHHHHHHHHHHCCCCCCEECHHHHH NYLSFGHSLAPQTMLQAIYKVEPAHILTWDVASRAMQTQRYWQLQPNPIAIAPAEAAAEC HHHHHCCCCCHHHHHHHHHHCCCCCEEEHHHHHHHHHHHHHEEECCCCEEEECHHHHHHH YSRLREAVRLQLISDVPLGAFLSGGLDSSIIVGLMQRLGAAPINTFSVGFEHAGFNELPD HHHHHHHHHHHHHHCCCHHHHHHCCCCHHHHHHHHHHHCCCCCCHHCCCCCCCCCCCCCH AALVAQHFGTKHHELRLNANDLVGALQTLVYHYDEPFGDAAGLPVYLVSRFAREHVKVVL HHHHHHHHCCCCCEEEECHHHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHCCEEEEE TGEGSDEQWAGYRRYQAELIARMAQYLPGRSAIAALIRQLPRNRRLKQAIRTLDQRDPGR ECCCCCCHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHCCCCHHHHHHHHHHHCCCCCC RYAAWLTIADVQQRQRLLQPHISAVLGDYAPEQIYDQVYPRSGAAMTNMGLADLQTWLPD HHHHHEEHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHCCCCCCCHHCCCHHHHHHHCCH TYLEKVDKASMAASIEARVPFLDHTLVEWTMNLPPTLKLRGTKTKWLLRQAFGEMLPQRT HHHHHHHHHHHHHHHHHCCCHHHHHHHHHCCCCCCCEEECCCHHHHHHHHHHHHHCCHHH LRKPKHGFAVPTDPWFRGALSNWTAEILFDQRTLSRGLFNPHEVQRIYQAHRDGKETADT HCCCCCCCCCCCCHHHHHHHHCCHHHHHCCHHHHHHCCCCHHHHHHHHHHHCCCHHHHHH VLWLLLNIELWQRIYLDREERL HHHHHHHHHHHHHHHCCHHCCC >Mature Secondary Structure MCGITGHLEWHGTAQTAILEQQTEAIRHRGPDSAGFFCVAQVALGMRRLAIIDLTSGDQP CCCCCCCEEECCCHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHEEEEEECCCCCC MFSRDGDLALVFNGEIYNFQALRQQLQQLGQHFATNSDTEVIVRGIEQWGILGCVQRLNG CCCCCCCEEEEECCCEECHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHCC MFALAIWQQQAQRLTLVRDRLGIKPLYWYSDAQRLVFGSEIKAILAHPAVPRQINLQGLA CEEHHHHHHHHHHHHHHHHHCCCCEEEEECCCCHHHHHHHHHHHHHCCCCCCEECHHHHH NYLSFGHSLAPQTMLQAIYKVEPAHILTWDVASRAMQTQRYWQLQPNPIAIAPAEAAAEC HHHHHCCCCCHHHHHHHHHHCCCCCEEEHHHHHHHHHHHHHEEECCCCEEEECHHHHHHH YSRLREAVRLQLISDVPLGAFLSGGLDSSIIVGLMQRLGAAPINTFSVGFEHAGFNELPD HHHHHHHHHHHHHHCCCHHHHHHCCCCHHHHHHHHHHHCCCCCCHHCCCCCCCCCCCCCH AALVAQHFGTKHHELRLNANDLVGALQTLVYHYDEPFGDAAGLPVYLVSRFAREHVKVVL HHHHHHHHCCCCCEEEECHHHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHCCEEEEE TGEGSDEQWAGYRRYQAELIARMAQYLPGRSAIAALIRQLPRNRRLKQAIRTLDQRDPGR ECCCCCCHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHCCCCHHHHHHHHHHHCCCCCC RYAAWLTIADVQQRQRLLQPHISAVLGDYAPEQIYDQVYPRSGAAMTNMGLADLQTWLPD HHHHHEEHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHCCCCCCCHHCCCHHHHHHHCCH TYLEKVDKASMAASIEARVPFLDHTLVEWTMNLPPTLKLRGTKTKWLLRQAFGEMLPQRT HHHHHHHHHHHHHHHHHCCCHHHHHHHHHCCCCCCCEEECCCHHHHHHHHHHHHHCCHHH LRKPKHGFAVPTDPWFRGALSNWTAEILFDQRTLSRGLFNPHEVQRIYQAHRDGKETADT HCCCCCCCCCCCCHHHHHHHHCCHHHHHCCHHHHHHCCCCHHHHHHHHHHHCCCHHHHHH VLWLLLNIELWQRIYLDREERL HHHHHHHHHHHHHHHCCHHCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 9387221; 9384377; 8755891; 10498721 [H]