| Definition | Mesorhizobium loti MAFF303099 plasmid pMLa, complete sequence. |
|---|---|
| Accession | NC_002679 |
| Length | 351,911 |
Click here to switch to the map view.
The map label for this gene is asnB [C]
Identifier: 13488222
GI number: 13488222
Start: 101956
End: 103518
Strand: Direct
Name: asnB [C]
Synonym: mlr9125
Alternate gene names: 13488222
Gene position: 101956-103518 (Clockwise)
Preceding gene: 13488221
Following gene: 13488223
Centisome position: 28.97
GC content: 55.15
Gene sequence:
>1563_bases ATGACAGGTATTGCGCTTTCCCCAATCGGGGCGCTGTGGGGGATCGTCGGCGCCAAGACACACGGCACCGTGGAGATGGG TGCGGCGCTGACACACCGCGGTTGCTACATGGCCATGGAGGAGGGACCAACATTCTCCTTTGGCGCCCGTCACTCCGCTG AGATCTGGCCTATCTCTGTCGATGACGATATCGCCGTTGTCTATTCCGGTTTCCCATTTGTCGTTGATGAAGAGACACGG ACGCCGCGTTATCTTTCAGCAGAAGATATCAGGACGGAATTCCTCAGATTCGGCGCCGATTTCTTCCGGGTTCTATGCGG TCACTACGCAATCGCAGTCTACTGCTACACTCGTCACCGGCTGATCCTTGTTCGCGATGCGTTCGGCGTGCAGAGCCTTT CGTGGGCGTCGTCGAATGAAAATTTTGCCTTTTCGACGGAGTATAAGGCACTGTTGTCACTGCCGTGGGTCGAACGAAAC CTTGACCACGATGCCGCCCGCGGCTTCGTTGACGACGGCTGGGCGCCAGCGGGGCGAACCTTTCTGCGGCACATTTCCAT GGTGCTGCCGGGATCAATCCTCATATGGCAGAATGGAAATCTTGAGACGATTCACCTGCGTCAAGATTTGTGCAAGACAC GCCCACCGTTCAGACCGATTTCAGTTCGTCACGTAGAAATGACGGTTCGAGAGACGATCGGTTGGCAGGCGAATGATTTT TCACCGAGATATGGGGTGATGCTTAGTAGCGGCGTCGACTCCGCAGTAATAGCGGCGACCCTGAGGCGAATTCGCAGGGA TTCTGAGATTCACACATTCACTGTCGGCTATGGTTACGACGACCCGGAGATTATCGGTGCGAGCGCGACAGCGAGCGTCC TTGGGACACAGCATCATGAAATCATAGTTCGGCCCGACGCCCTCACAGCGCTACTGACCGACACTATTGTCGCTGTGGAC AATCCTGGCGGTTACGAAGAGTTCCCATGCCTTTATGCCCTGCATCAGGAAGCGCGACAATTCGTGGACATCATATTCTC TGGCAATGCCGCTGACACGTTATTTGCAGGCATGCCGTATCATCGGGATTTGCTTTCGACCGATGACGCAATCTATCGGC GGCTATGCAACGATCTAACTGTTCGCGACGAGCGCCTCGCTGCACAGGAACTCTTGGCTGGTAGACATGGTCTCAATTTT AGGATGCCCTATGCGGAACGAATTCTCATAGACTTGGCGCTTGAAATCCCCGATTTTCAGAAACTCAGCCCTGAGAATGA TAAGATTATCTTTCGTGAGGCGGCCCGTCAAATTCTGCCTGACGAAATCACCATGCGTCCCAAGCGGATTCAACACCTCC TCTATGACGACAGCATGTGCTCGTGGCTGGCCGAGCGGATTGAGTGGATTTGCTCGAGCTCCCTTCTCCGGACGCATTCC CTCGGAGAGCTCGAAGGGGCAGCAATCCTCCCGCCTCGTAATCTCGAACTTACGGAAGAGAGCTTCAAAGCCGCCTGGAA CGTCGTCGCGCTTGCGACGTGGGCGAGTATCTACCTCGCCTAG
Upstream 100 bases:
>100_bases TACCATGCCAGTGTTCCGTGTCGTATCAAAGTGAGCTGATGTACGTTGCCATCATTGTTTTCAGTGCGACGGCCTCCATG TCACTCGTTGGAGCACACCT
Downstream 100 bases:
>100_bases GACGGAGCGTCCGAATCTCTATCAACTAAATTCGGCAACGATCAATATCGACTGGAGACGAACCGTGACCGACTACTTCT CCTACTTAGGTCTGCAACCG
Product: hypothetical protein
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 520; Mature: 519
Protein sequence:
>520_residues MTGIALSPIGALWGIVGAKTHGTVEMGAALTHRGCYMAMEEGPTFSFGARHSAEIWPISVDDDIAVVYSGFPFVVDEETR TPRYLSAEDIRTEFLRFGADFFRVLCGHYAIAVYCYTRHRLILVRDAFGVQSLSWASSNENFAFSTEYKALLSLPWVERN LDHDAARGFVDDGWAPAGRTFLRHISMVLPGSILIWQNGNLETIHLRQDLCKTRPPFRPISVRHVEMTVRETIGWQANDF SPRYGVMLSSGVDSAVIAATLRRIRRDSEIHTFTVGYGYDDPEIIGASATASVLGTQHHEIIVRPDALTALLTDTIVAVD NPGGYEEFPCLYALHQEARQFVDIIFSGNAADTLFAGMPYHRDLLSTDDAIYRRLCNDLTVRDERLAAQELLAGRHGLNF RMPYAERILIDLALEIPDFQKLSPENDKIIFREAARQILPDEITMRPKRIQHLLYDDSMCSWLAERIEWICSSSLLRTHS LGELEGAAILPPRNLELTEESFKAAWNVVALATWASIYLA
Sequences:
>Translated_520_residues MTGIALSPIGALWGIVGAKTHGTVEMGAALTHRGCYMAMEEGPTFSFGARHSAEIWPISVDDDIAVVYSGFPFVVDEETR TPRYLSAEDIRTEFLRFGADFFRVLCGHYAIAVYCYTRHRLILVRDAFGVQSLSWASSNENFAFSTEYKALLSLPWVERN LDHDAARGFVDDGWAPAGRTFLRHISMVLPGSILIWQNGNLETIHLRQDLCKTRPPFRPISVRHVEMTVRETIGWQANDF SPRYGVMLSSGVDSAVIAATLRRIRRDSEIHTFTVGYGYDDPEIIGASATASVLGTQHHEIIVRPDALTALLTDTIVAVD NPGGYEEFPCLYALHQEARQFVDIIFSGNAADTLFAGMPYHRDLLSTDDAIYRRLCNDLTVRDERLAAQELLAGRHGLNF RMPYAERILIDLALEIPDFQKLSPENDKIIFREAARQILPDEITMRPKRIQHLLYDDSMCSWLAERIEWICSSSLLRTHS LGELEGAAILPPRNLELTEESFKAAWNVVALATWASIYLA >Mature_519_residues TGIALSPIGALWGIVGAKTHGTVEMGAALTHRGCYMAMEEGPTFSFGARHSAEIWPISVDDDIAVVYSGFPFVVDEETRT PRYLSAEDIRTEFLRFGADFFRVLCGHYAIAVYCYTRHRLILVRDAFGVQSLSWASSNENFAFSTEYKALLSLPWVERNL DHDAARGFVDDGWAPAGRTFLRHISMVLPGSILIWQNGNLETIHLRQDLCKTRPPFRPISVRHVEMTVRETIGWQANDFS PRYGVMLSSGVDSAVIAATLRRIRRDSEIHTFTVGYGYDDPEIIGASATASVLGTQHHEIIVRPDALTALLTDTIVAVDN PGGYEEFPCLYALHQEARQFVDIIFSGNAADTLFAGMPYHRDLLSTDDAIYRRLCNDLTVRDERLAAQELLAGRHGLNFR MPYAERILIDLALEIPDFQKLSPENDKIIFREAARQILPDEITMRPKRIQHLLYDDSMCSWLAERIEWICSSSLLRTHSL GELEGAAILPPRNLELTEESFKAAWNVVALATWASIYLA
Specific function: Asparagine biosynthesis. [C]
COG id: COG0367
COG function: function code E; Asparagine synthase (glutamine-hydrolyzing)
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 glutamine amidotransferase type-2 domain [H]
Homologues:
Organism=Homo sapiens, GI168229248, Length=361, Percent_Identity=22.4376731301939, Blast_Score=69, Evalue=1e-11, Organism=Homo sapiens, GI168229252, Length=361, Percent_Identity=22.4376731301939, Blast_Score=69, Evalue=1e-11, Organism=Homo sapiens, GI168229250, Length=361, Percent_Identity=22.4376731301939, Blast_Score=69, Evalue=1e-11, Organism=Homo sapiens, GI296010848, Length=361, Percent_Identity=22.4376731301939, Blast_Score=69, Evalue=2e-11, Organism=Homo sapiens, GI296010852, Length=361, Percent_Identity=22.4376731301939, Blast_Score=68, Evalue=2e-11, Organism=Homo sapiens, GI296010850, Length=361, Percent_Identity=22.4376731301939, Blast_Score=68, Evalue=2e-11, Organism=Caenorhabditis elegans, GI71993933, Length=305, Percent_Identity=23.2786885245902, Blast_Score=76, Evalue=5e-14, Organism=Caenorhabditis elegans, GI17560178, Length=272, Percent_Identity=27.5735294117647, Blast_Score=76, Evalue=5e-14, Organism=Caenorhabditis elegans, GI25147557, Length=305, Percent_Identity=23.2786885245902, Blast_Score=76, Evalue=5e-14,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR006426 - InterPro: IPR001962 - InterPro: IPR017932 - InterPro: IPR014729 [H]
Pfam domain/function: PF00733 Asn_synthase [H]
EC number: =6.3.5.4 [H]
Molecular weight: Translated: 58414; Mature: 58283
Theoretical pI: Translated: 5.33; Mature: 5.33
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.5 %Cys (Translated Protein) 2.1 %Met (Translated Protein) 3.7 %Cys+Met (Translated Protein) 1.5 %Cys (Mature Protein) 1.9 %Met (Mature Protein) 3.5 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MTGIALSPIGALWGIVGAKTHGTVEMGAALTHRGCYMAMEEGPTFSFGARHSAEIWPISV CCCCCCCHHHHHHHHHCCCCCCCEECCHHHHCCCEEEEECCCCCEECCCCCCCEEEEEEC DDDIAVVYSGFPFVVDEETRTPRYLSAEDIRTEFLRFGADFFRVLCGHYAIAVYCYTRHR CCCEEEEEECCCEEEECCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHEEEEEEEECCE LILVRDAFGVQSLSWASSNENFAFSTEYKALLSLPWVERNLDHDAARGFVDDGWAPAGRT EEEEEECCCCCEEEECCCCCCEEEECCHHHHHCCCHHHCCCCHHHHCCCCCCCCCCHHHH FLRHISMVLPGSILIWQNGNLETIHLRQDLCKTRPPFRPISVRHVEMTVRETIGWQANDF HHHHHHHHCCCEEEEEECCCEEEEEEHHHHHHCCCCCCCCEEEEEEEEHHHHCCCCCCCC SPRYGVMLSSGVDSAVIAATLRRIRRDSEIHTFTVGYGYDDPEIIGASATASVLGTQHHE CCCCCEEEECCCCHHHHHHHHHHHHCCCCEEEEEEEECCCCCCEECCCHHHHHHCCCCCE IIVRPDALTALLTDTIVAVDNPGGYEEFPCLYALHQEARQFVDIIFSGNAADTLFAGMPY EEECCHHHHHHHHCEEEEECCCCCCCCCHHHHHHHHHHHHHHHEEECCCCHHHHEECCCC HRDLLSTDDAIYRRLCNDLTVRDERLAAQELLAGRHGLNFRMPYAERILIDLALEIPDFQ HHHHHCCCHHHHHHHHHCCCCCHHHHHHHHHHHCCCCCCEECCHHHHEEEEHEECCCCCC KLSPENDKIIFREAARQILPDEITMRPKRIQHLLYDDSMCSWLAERIEWICSSSLLRTHS CCCCCCCCEEHHHHHHHHCCHHHCCCHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHCC LGELEGAAILPPRNLELTEESFKAAWNVVALATWASIYLA CCCCCCEEECCCCCCCCCHHHHHHHHHHHHHHHHHHHHCC >Mature Secondary Structure TGIALSPIGALWGIVGAKTHGTVEMGAALTHRGCYMAMEEGPTFSFGARHSAEIWPISV CCCCCCHHHHHHHHHCCCCCCCEECCHHHHCCCEEEEECCCCCEECCCCCCCEEEEEEC DDDIAVVYSGFPFVVDEETRTPRYLSAEDIRTEFLRFGADFFRVLCGHYAIAVYCYTRHR CCCEEEEEECCCEEEECCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHEEEEEEEECCE LILVRDAFGVQSLSWASSNENFAFSTEYKALLSLPWVERNLDHDAARGFVDDGWAPAGRT EEEEEECCCCCEEEECCCCCCEEEECCHHHHHCCCHHHCCCCHHHHCCCCCCCCCCHHHH FLRHISMVLPGSILIWQNGNLETIHLRQDLCKTRPPFRPISVRHVEMTVRETIGWQANDF HHHHHHHHCCCEEEEEECCCEEEEEEHHHHHHCCCCCCCCEEEEEEEEHHHHCCCCCCCC SPRYGVMLSSGVDSAVIAATLRRIRRDSEIHTFTVGYGYDDPEIIGASATASVLGTQHHE CCCCCEEEECCCCHHHHHHHHHHHHCCCCEEEEEEEECCCCCCEECCCHHHHHHCCCCCE IIVRPDALTALLTDTIVAVDNPGGYEEFPCLYALHQEARQFVDIIFSGNAADTLFAGMPY EEECCHHHHHHHHCEEEEECCCCCCCCCHHHHHHHHHHHHHHHEEECCCCHHHHEECCCC HRDLLSTDDAIYRRLCNDLTVRDERLAAQELLAGRHGLNFRMPYAERILIDLALEIPDFQ HHHHHCCCHHHHHHHHHCCCCCHHHHHHHHHHHCCCCCCEECCHHHHEEEEHEECCCCCC KLSPENDKIIFREAARQILPDEITMRPKRIQHLLYDDSMCSWLAERIEWICSSSLLRTHS CCCCCCCCEEHHHHHHHHCCHHHCCCHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHCC LGELEGAAILPPRNLELTEESFKAAWNVVALATWASIYLA CCCCCCEEECCCCCCCCCHHHHHHHHHHHHHHHHHHHHCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 8688087 [H]