| Definition | Mycobacterium tuberculosis H37Ra, complete genome. |
|---|---|
| Accession | NC_009525 |
| Length | 4,419,977 |
Click here to switch to the map view.
The map label for this gene is 148661472
Identifier: 148661472
GI number: 148661472
Start: 1901759
End: 1902493
Strand: Reverse
Name: 148661472
Synonym: MRA_1686
Alternate gene names: NA
Gene position: 1902493-1901759 (Counterclockwise)
Preceding gene: 148661482
Following gene: 148661470
Centisome position: 43.04
GC content: 64.63
Gene sequence:
>735_bases ATGGCAGATCGGTCGGTGCGCCCGCTGCGGCATCTCGTTCATGCGGTGACTGGGGGCCAACCGCCTTCCGAGGCCCAGGT CCGACAGGCAGCCTGGATTGCGCGGTGCGTCGGTCGCGGAGGCTCGGCGCCACTGCACCGTGACGATGTGTCGGCATTGG CCGAAACGTTACAAGTCAAGGAGTTTGCCCCCGGGGCAGTGGTATTCCACGCCGATCAAACCGCGGACGGGGTGTGGATT GTGCGACACGGATTAATTGAGCTCGCGGTCGGCTCCAGGCGGCGCCGCGCCGTGGTGAACATCCTTCATCCCGGCGATGT CGATGGCGACATCCCGCTGCTACTGGAGATGCCGATGGTCTACACGGGGCGCGCCTTGACCCAAGCGACCTGCCTGTTCC TGGACCGGCAGGCGTTCGAGCGGCTGCTAGCTACCCACCCGGCCATCGCACGGCGGTGGCTGTCGAGTGTGGCGCAACGG GTGTCGACTGCGCAGATTCGGTTAATGGGCATGCTTGGCCGCCCGCTGCCCGCGCAGGTTGCGCAGCTCCTGCTCGACGA GGCAATCGATGCCCGTATCGAACTTGCCCAACGCACCCTCGCCGCAATGCTTGGAGCGCAGCGCCCATCGATCAACAAGA TTCTCAAGGAGTTCGAGCGCGACCGATTGATCACCGTCGGGTATGCGGTCATCGAGATCACCGACCAACACGGATTACGC GCCCGGGCTCAATGA
Upstream 100 bases:
>100_bases CGACTAATTTCCCATTCAGGGCAAGCCAACCCGCACGCAATCCACGCGCGCTGACAATTGGCAGCACGATGACGGCATCG CCTGCTCTCAAGGAGGGGCC
Downstream 100 bases:
>100_bases CACAGCGCCGGTCCCACGGGCCACAACGACAGCATGTCGGCGCCGAATTCGTGCACTAGTACACCCATAAGCGCGCCGAG CACCAGGTGCGCGAGGCACA
Product: Crp/Fnr family transcriptional regulator
Products: NA
Alternate protein names: Transcriptional Regulatory Protein; Crp/Fnr Family Transcriptional Regulator; Crp Family Transcriptional Regulator; Transcriptional Regulator; Crp/FNR Family Transcriptional Regulator; CRP/FNR Family Transcriptional Regulator; Crp-Family Transcriptional Regulator; CAMP-Bindin Transcriptional Regulator; CAMP-Dependent Transcriptional Regulator; DNR Protein
Number of amino acids: Translated: 244; Mature: 243
Protein sequence:
>244_residues MADRSVRPLRHLVHAVTGGQPPSEAQVRQAAWIARCVGRGGSAPLHRDDVSALAETLQVKEFAPGAVVFHADQTADGVWI VRHGLIELAVGSRRRRAVVNILHPGDVDGDIPLLLEMPMVYTGRALTQATCLFLDRQAFERLLATHPAIARRWLSSVAQR VSTAQIRLMGMLGRPLPAQVAQLLLDEAIDARIELAQRTLAAMLGAQRPSINKILKEFERDRLITVGYAVIEITDQHGLR ARAQ
Sequences:
>Translated_244_residues MADRSVRPLRHLVHAVTGGQPPSEAQVRQAAWIARCVGRGGSAPLHRDDVSALAETLQVKEFAPGAVVFHADQTADGVWI VRHGLIELAVGSRRRRAVVNILHPGDVDGDIPLLLEMPMVYTGRALTQATCLFLDRQAFERLLATHPAIARRWLSSVAQR VSTAQIRLMGMLGRPLPAQVAQLLLDEAIDARIELAQRTLAAMLGAQRPSINKILKEFERDRLITVGYAVIEITDQHGLR ARAQ >Mature_243_residues ADRSVRPLRHLVHAVTGGQPPSEAQVRQAAWIARCVGRGGSAPLHRDDVSALAETLQVKEFAPGAVVFHADQTADGVWIV RHGLIELAVGSRRRRAVVNILHPGDVDGDIPLLLEMPMVYTGRALTQATCLFLDRQAFERLLATHPAIARRWLSSVAQRV STAQIRLMGMLGRPLPAQVAQLLLDEAIDARIELAQRTLAAMLGAQRPSINKILKEFERDRLITVGYAVIEITDQHGLRA RAQ
Specific function: Unknown
COG id: COG0664
COG function: function code T; cAMP-binding proteins - catabolite gene activator and regulatory subunit of cAMP-dependent protein kinases
Gene ontology:
Cell location: Cytoplasmic
Metaboloic importance: NA
Operon status: Not Known
Operon components: None
Similarity: NA
Homologues:
None
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
NA
Pfam domain/function: NA
EC number: NA
Molecular weight: Translated: 26794; Mature: 26662
Theoretical pI: Translated: 10.60; Mature: 10.60
Prosite motif: PS50042 CNMP_BINDING_3 ; PS51063 HTH_CRP_2
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.8 %Cys (Translated Protein) 2.5 %Met (Translated Protein) 3.3 %Cys+Met (Translated Protein) 0.8 %Cys (Mature Protein) 2.1 %Met (Mature Protein) 2.9 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MADRSVRPLRHLVHAVTGGQPPSEAQVRQAAWIARCVGRGGSAPLHRDDVSALAETLQVK CCCCCHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHH EFAPGAVVFHADQTADGVWIVRHGLIELAVGSRRRRAVVNILHPGDVDGDIPLLLEMPMV HCCCCEEEEECCCCCCCEEHHHHHHHHHHHCCCCCHHEEEEECCCCCCCCCHHEEECCHH YTGRALTQATCLFLDRQAFERLLATHPAIARRWLSSVAQRVSTAQIRLMGMLGRPLPAQV HCCHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHH AQLLLDEAIDARIELAQRTLAAMLGAQRPSINKILKEFERDRLITVGYAVIEITDQHGLR HHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHCCEEEEEEEEEEEECCCCCC ARAQ CCCC >Mature Secondary Structure ADRSVRPLRHLVHAVTGGQPPSEAQVRQAAWIARCVGRGGSAPLHRDDVSALAETLQVK CCCCHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHH EFAPGAVVFHADQTADGVWIVRHGLIELAVGSRRRRAVVNILHPGDVDGDIPLLLEMPMV HCCCCEEEEECCCCCCCEEHHHHHHHHHHHCCCCCHHEEEEECCCCCCCCCHHEEECCHH YTGRALTQATCLFLDRQAFERLLATHPAIARRWLSSVAQRVSTAQIRLMGMLGRPLPAQV HCCHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHH AQLLLDEAIDARIELAQRTLAAMLGAQRPSINKILKEFERDRLITVGYAVIEITDQHGLR HHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHCCEEEEEEEEEEEECCCCCC ARAQ CCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 10.0
TargetDB status: NA
Availability: NA
References: NA