| Definition | Rhizobium leguminosarum bv. viciae 3841 plasmid pRL12, complete sequence. |
|---|---|
| Accession | NC_008378 |
| Length | 870,021 |
Click here to switch to the map view.
The map label for this gene is glxA [H]
Identifier: 116249200
GI number: 116249200
Start: 581505
End: 582515
Strand: Direct
Name: glxA [H]
Synonym: pRL120536
Alternate gene names: 116249200
Gene position: 581505-582515 (Clockwise)
Preceding gene: 116249199
Following gene: 116249203
Centisome position: 66.84
GC content: 60.63
Gene sequence:
>1011_bases ATGCGACCCGAGCAGCATCGACGGGCAGATGACGCCGCGAAGTCGGCTGGTCGGCTCAAGGTAGGCTTCGTTCTGGCGCG ATCGTTCACGCTGTCCGCTTTCGCGCTCTTCGTGGACACACTGCGGCTTGCCAGCGACGAGCAGGATCGTTCCGGAAGGG TCCTTGCCGACTGGCAGGTGATTGGCAGCACGCGGCACCTGATCACCGCGAGTTGCGGTGTCCAGGTCGCTCCGACGTCC GATTTCGTCGATCCGTCGAAGTTCGATTACATCGTGGTCGTCGGCGGCCTTCTGACGGTGGAGAACCCTGTCGACCAGGA GACCATCGCTTTTCTCAAGCAGGCGGACGCCAAGAAGGTGCCGCTGATCGGCGTGTGCACGGGGTCGTTCATTCTTGCTG CGGCAGGCCTGATGAACCGGCACGAATGCTGTGTGAGCTGGCTGCATTACAAGGAGTTTCGGGAGCGGTTTCCTGACCTC AGCGTTCGTTCCGACCGGCTCTTCAATCTCGATCGCCAGCGCGGATCCTGCGCAGGCGGCAGCAGTTCCGCCGACATGGC GGCATTGCTGGTCAGGAAATGTATCAGCCGCGACGCCGAACGAAACGCGCTGGAGGTGCTTCAGATCGAAAAGGCCCGGA CTTCAGCGGACATACAGCCCCGGCGTCCGCTCTACGACGACTATGACGACGCCCGCGTCAAGGCGGCAATGATTACGATG GAACAGTTCGTCGATGGCAGCATGTCTATACAGAAGCTTGCCGCCACGGTTGGCCTGTCACGGCGCCAACTGGAGAGGAT TTTCATCGACAAGACGGGGATGTCTCCTGCCAAGGCCTATAATCGTGTTCGCATGGAGCGGGCGAAATCGATCCTTGCCC AGTCGAAGGCGCCGTTGATTGAGATCGCGCTGGATGTCGGCTTTGAAAACGCCTCGCAGTTCACGCGAACGTTCAAGCGC ACATTCGGGCAAACGCCATCGCAGCATCGTGCCGCTTCGAGAGCGCACTGA
Upstream 100 bases:
>100_bases GTTGACGATCGGGATCCGCTAGCGCATGGCTTTCAGATCCGATGAGCGCGTTTCGTCTGAAAAGACGGGCGGCGCGGTAA GAGGCGGCAAGGAGATGACT
Downstream 100 bases:
>100_bases GCCCGCAATCTCGCAACATTTAAGTAAGTCCCTGTTATGCCGGCGTTCAGCGCTCGATGACCAGATCGCTGAGCGGCTTG GAGCAACAGGGCAGGAAGAA
Product: AraC family transcriptional regulator
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 336; Mature: 336
Protein sequence:
>336_residues MRPEQHRRADDAAKSAGRLKVGFVLARSFTLSAFALFVDTLRLASDEQDRSGRVLADWQVIGSTRHLITASCGVQVAPTS DFVDPSKFDYIVVVGGLLTVENPVDQETIAFLKQADAKKVPLIGVCTGSFILAAAGLMNRHECCVSWLHYKEFRERFPDL SVRSDRLFNLDRQRGSCAGGSSSADMAALLVRKCISRDAERNALEVLQIEKARTSADIQPRRPLYDDYDDARVKAAMITM EQFVDGSMSIQKLAATVGLSRRQLERIFIDKTGMSPAKAYNRVRMERAKSILAQSKAPLIEIALDVGFENASQFTRTFKR TFGQTPSQHRAASRAH
Sequences:
>Translated_336_residues MRPEQHRRADDAAKSAGRLKVGFVLARSFTLSAFALFVDTLRLASDEQDRSGRVLADWQVIGSTRHLITASCGVQVAPTS DFVDPSKFDYIVVVGGLLTVENPVDQETIAFLKQADAKKVPLIGVCTGSFILAAAGLMNRHECCVSWLHYKEFRERFPDL SVRSDRLFNLDRQRGSCAGGSSSADMAALLVRKCISRDAERNALEVLQIEKARTSADIQPRRPLYDDYDDARVKAAMITM EQFVDGSMSIQKLAATVGLSRRQLERIFIDKTGMSPAKAYNRVRMERAKSILAQSKAPLIEIALDVGFENASQFTRTFKR TFGQTPSQHRAASRAH >Mature_336_residues MRPEQHRRADDAAKSAGRLKVGFVLARSFTLSAFALFVDTLRLASDEQDRSGRVLADWQVIGSTRHLITASCGVQVAPTS DFVDPSKFDYIVVVGGLLTVENPVDQETIAFLKQADAKKVPLIGVCTGSFILAAAGLMNRHECCVSWLHYKEFRERFPDL SVRSDRLFNLDRQRGSCAGGSSSADMAALLVRKCISRDAERNALEVLQIEKARTSADIQPRRPLYDDYDDARVKAAMITM EQFVDGSMSIQKLAATVGLSRRQLERIFIDKTGMSPAKAYNRVRMERAKSILAQSKAPLIEIALDVGFENASQFTRTFKR TFGQTPSQHRAASRAH
Specific function: Binds To The Right Arm Of The Replication Origin Oric Of The E.Coli Chromosome. Rob Binding May Influence The Formation Of The Nucleoprotein Structure, Required For Oric Function In The Initiation Of Replication. [C]
COG id: COG4977
COG function: function code K; Transcriptional regulator containing an amidase domain and an AraC-type DNA-binding HTH domain
Gene ontology:
Cell location: Cytoplasmic
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 HTH araC/xylS-type DNA-binding domain [H]
Homologues:
Organism=Escherichia coli, GI1790857, Length=98, Percent_Identity=31.6326530612245, Blast_Score=62, Evalue=5e-11,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR009057 - InterPro: IPR012287 - InterPro: IPR018062 - InterPro: IPR020449 - InterPro: IPR018060 - InterPro: IPR002818 [H]
Pfam domain/function: PF01965 DJ-1_PfpI; PF00165 HTH_AraC [H]
EC number: NA
Molecular weight: Translated: 37304; Mature: 37304
Theoretical pI: Translated: 9.82; Mature: 9.82
Prosite motif: PS00041 HTH_ARAC_FAMILY_1 ; PS01124 HTH_ARAC_FAMILY_2
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.8 %Cys (Translated Protein) 2.4 %Met (Translated Protein) 4.2 %Cys+Met (Translated Protein) 1.8 %Cys (Mature Protein) 2.4 %Met (Mature Protein) 4.2 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MRPEQHRRADDAAKSAGRLKVGFVLARSFTLSAFALFVDTLRLASDEQDRSGRVLADWQV CCCHHHHHHHHHHHHCCCEEEHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCEEEEEEE IGSTRHLITASCGVQVAPTSDFVDPSKFDYIVVVGGLLTVENPVDQETIAFLKQADAKKV CCCCCCEEEEECCEEECCCCCCCCCCCCCEEEEECCEEEECCCCCHHHHHHHHHCCCCCC PLIGVCTGSFILAAAGLMNRHECCVSWLHYKEFRERFPDLSVRSDRLFNLDRQRGSCAGG CEEEEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCHHHCCCCCCCCCCCC SSSADMAALLVRKCISRDAERNALEVLQIEKARTSADIQPRRPLYDDYDDARVKAAMITM CCCHHHHHHHHHHHHCCCHHCCHHHHHHHHHHHCCCCCCCCCCCCCCCCHHHHHHHHHHH EQFVDGSMSIQKLAATVGLSRRQLERIFIDKTGMSPAKAYNRVRMERAKSILAQSKAPLI HHHHCCCHHHHHHHHHHCCHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHCCCCEE EIALDVGFENASQFTRTFKRTFGQTPSQHRAASRAH EEEEECCCCCHHHHHHHHHHHHCCCCHHHHHHHCCC >Mature Secondary Structure MRPEQHRRADDAAKSAGRLKVGFVLARSFTLSAFALFVDTLRLASDEQDRSGRVLADWQV CCCHHHHHHHHHHHHCCCEEEHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCEEEEEEE IGSTRHLITASCGVQVAPTSDFVDPSKFDYIVVVGGLLTVENPVDQETIAFLKQADAKKV CCCCCCEEEEECCEEECCCCCCCCCCCCCEEEEECCEEEECCCCCHHHHHHHHHCCCCCC PLIGVCTGSFILAAAGLMNRHECCVSWLHYKEFRERFPDLSVRSDRLFNLDRQRGSCAGG CEEEEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCHHHCCCCCCCCCCCC SSSADMAALLVRKCISRDAERNALEVLQIEKARTSADIQPRRPLYDDYDDARVKAAMITM CCCHHHHHHHHHHHHCCCHHCCHHHHHHHHHHHCCCCCCCCCCCCCCCCHHHHHHHHHHH EQFVDGSMSIQKLAATVGLSRRQLERIFIDKTGMSPAKAYNRVRMERAKSILAQSKAPLI HHHHCCCHHHHHHHHHHCCHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHCCCCEE EIALDVGFENASQFTRTFKRTFGQTPSQHRAASRAH EEEEECCCCCHHHHHHHHHHHHCCCCHHHHHHHCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: DNA [C]
Specific reaction: Protein + DNA = Protein-DNA [C]
General reaction: NA
Inhibitor: NA
Structure determination priority: 10.0
TargetDB status: NA
Availability: NA
References: 11481430 [H]