| Definition | Frankia sp. EAN1pec chromosome, complete genome. |
|---|---|
| Accession | NC_009921 |
| Length | 8,982,042 |
Click here to switch to the map view.
The map label for this gene is 158317049
Identifier: 158317049
GI number: 158317049
Start: 6366764
End: 6368662
Strand: Reverse
Name: 158317049
Synonym: Franean1_5293
Alternate gene names: NA
Gene position: 6368662-6366764 (Counterclockwise)
Preceding gene: 158317050
Following gene: 158317048
Centisome position: 70.9
GC content: 73.93
Gene sequence:
>1899_bases GTGGGTGAGACGGCGGGTCTGCGCAGCGGTATCCGCGTGCTCGTCACGATCTCCACGATCGCCGTAGCCGTGATGCTCGC GCTCGCCGTGTTCGCCGCGTTGCGCGCGAACAACGCGGCTGCCGAGCGCGGCGAGCGGCTCGACCCGGCGGCGACGACCA CCGCTCTCCTGCTCGCCGACTTCGTCGACCAGGAGAGCGCCGTCCGCGGCTATCTCATTACCGAGGAGCCGAGCTTCCTC GGCCCGTACAACGAGTCCGATCGCACGATTCCCCAGCAGATGAACCGGCTACAGCAACTGCTGGCCGAGTTCCCCGACCT CATCCAGGGCACCGCCGAGATCGAGGCCGCCTATCAGGCGTGGCGCAGTGATGTCGCCGAACCCGAGGTCGCCGCGATGG AGGTCGGCGACGTCCAGATCGCGCGGAACATCGAAAAGGCCGGCGGCAGGGTGCGCTTCAACGAGCTGCGCGGCCGGGTG GCGGATCTCGGGATAGCGATCGACAACGAGCAGACCGCGGCGTCCGGGCGGCTGGAGAGCGCCGCGGTCCTCCTCCTCAG CTCACTGGCGAGCGCCGCGTTTGTGATTCTCGGCGTGGTACTCACGGTGTTGACCGTGCTGCGCAGGTGGCTGCTGCGCC CCATCGACGCCCTGCGCCGGGCGGTGAACGCCGTCGCTGCCGGCCGGTACGACACCAGGATCCCCGAGGTCGGGCCGGAG GAGATCGTCGAGCTCGCCGGCAACATCGAGGCGATGCGCGCGCAGCTCGTCCGGCTCGTGCGGCAGAACGAGCGGTCATG GGAGGCCCTCGCCCAGCAGGGGCCGGCGGTGGTCGCGTTGCGTGACGCGCTCACACCTTCCGTGCTGCGGGCGCCTGGGC TGGTGCTGCGGGGACGGGTCGACCCGGCGCAGGGCGAGCTCGCTGGCGACTGGTACGACTCCTTCGAGCTCCCGGACGGA CGGGTCGGGATCGTGGTCGGTGACGTCTCCGGCCATGGCGCTGTGGCCGGTGTCTTCGCGTTGCGCCTCAAGCAGCTCCT CGACGCCGCGCTGACCCGGGGCGCCGATCCCGGCCAGGCGATCGAGTGGGTCGTCGACAGCCTCGGGGAGACCGACGAGA TGTTCGCGACCGCGGTGGTCGCGGTGGTCGACCCTGCCAGTGGGGAGGTCCGGCTCGCCAACGCGGGCCATCCGGACGCG CTGCTGCTGCGCCGGGCGCGTCGCGCCGGGACCGCGGGCGACGTCGGAGAGGGCGCGCCCAGGGCGGGGGAGCCCGCCGG TCCGCGGACGGTTGTCGCCGTCGCCGGCACGTTCGTCGCCGGTGCCGTCGTCGGCGAGACCATCGAGGGCGAGGCCGTCG AGTGCGATGCCGCCGGGGAGGCGCGGGAGCCAGGACTGGCCTCGGCGGTGGCCCGCGCCGGGTCCGCCGGCGGAGGCGTC GGTGACGGCGCTGGCAGCGGCAGCGGTGGCAGCGGCGCTGGCGCGGGCAGCGGTGGTGGTGGCGGGGCTGGGGGCCCGGG ACTCCCGGAAGCGGGGCCGGGACGGCCACAGGCCGCCGGCCGCCGTGCGGAGGTGGCCTGCCTGGCCGCCACCGGGCCGA TCATGTCGAGCCTGGTCGCCGCCGACGGCGCGTGGCACACCGACGTGCTGCGGCTGGAACCCGGCGACGTGCTGTTCGTG TACACCGACGGGCTGGTGGAGGCCAGGAACGCGGCCCACCAGCAGTTCGGCGTCGATCGGCTCGTCGCCGAGCTGCTGCG CGACCCGCGGCGGGCGCCGGCCGAGCTGTTGGATGACGCGTTCGAGGTCGTGCGGCGCCACGCCCCGGGCCGGCCGAGCG ACGACCGCACCGCGATCGTCGTCGCCCGCACCACCGAGGTCTCCCGCCCGCGCCCCTGA
Upstream 100 bases:
>100_bases CCTGGACGACAATGTCTCCTGAGGACAGTGCGTCGTGGCGGGACGGCCTCCCCGGGGACACCCCCGGGATCACCGCGGTC GTGCGCCGGAGGAGTGACGG
Downstream 100 bases:
>100_bases CCGGCCCTCGCGGCTGGGAAGCGACGCGCGGCACGATCGCGACAACGATTGATCGCAATCTTCGTCGGGTACATGTCCGA CCATGAGTGACGAGTCCGGT
Product: stage II sporulation E family protein
Products: NA
Alternate protein names: PAS/PAC Sensor Protein; Protein Serine/Threonine Phosphatase; Stage II Sporulation E Family Protein; Bacteriophytochrome; GAF Sensor Protein; Stage II Sporulation Protein E; Multi-Sensor Signal Transduction Histidine Kinase; Serine Phosphatase; Phosphoserine Phosphatase; Regulatory Protein; Two-Component Sensor Protein; Serine/Threonine Phosphatase Family Protein; LOW QUALITY PROTEIN Stage II Sporulation Protein E; Serine Phosphatase RsbU Regulator Of Sigma Subunit; Stage II Sporulation E
Number of amino acids: Translated: 632; Mature: 631
Protein sequence:
>632_residues MGETAGLRSGIRVLVTISTIAVAVMLALAVFAALRANNAAAERGERLDPAATTTALLLADFVDQESAVRGYLITEEPSFL GPYNESDRTIPQQMNRLQQLLAEFPDLIQGTAEIEAAYQAWRSDVAEPEVAAMEVGDVQIARNIEKAGGRVRFNELRGRV ADLGIAIDNEQTAASGRLESAAVLLLSSLASAAFVILGVVLTVLTVLRRWLLRPIDALRRAVNAVAAGRYDTRIPEVGPE EIVELAGNIEAMRAQLVRLVRQNERSWEALAQQGPAVVALRDALTPSVLRAPGLVLRGRVDPAQGELAGDWYDSFELPDG RVGIVVGDVSGHGAVAGVFALRLKQLLDAALTRGADPGQAIEWVVDSLGETDEMFATAVVAVVDPASGEVRLANAGHPDA LLLRRARRAGTAGDVGEGAPRAGEPAGPRTVVAVAGTFVAGAVVGETIEGEAVECDAAGEAREPGLASAVARAGSAGGGV GDGAGSGSGGSGAGAGSGGGGGAGGPGLPEAGPGRPQAAGRRAEVACLAATGPIMSSLVAADGAWHTDVLRLEPGDVLFV YTDGLVEARNAAHQQFGVDRLVAELLRDPRRAPAELLDDAFEVVRRHAPGRPSDDRTAIVVARTTEVSRPRP
Sequences:
>Translated_632_residues MGETAGLRSGIRVLVTISTIAVAVMLALAVFAALRANNAAAERGERLDPAATTTALLLADFVDQESAVRGYLITEEPSFL GPYNESDRTIPQQMNRLQQLLAEFPDLIQGTAEIEAAYQAWRSDVAEPEVAAMEVGDVQIARNIEKAGGRVRFNELRGRV ADLGIAIDNEQTAASGRLESAAVLLLSSLASAAFVILGVVLTVLTVLRRWLLRPIDALRRAVNAVAAGRYDTRIPEVGPE EIVELAGNIEAMRAQLVRLVRQNERSWEALAQQGPAVVALRDALTPSVLRAPGLVLRGRVDPAQGELAGDWYDSFELPDG RVGIVVGDVSGHGAVAGVFALRLKQLLDAALTRGADPGQAIEWVVDSLGETDEMFATAVVAVVDPASGEVRLANAGHPDA LLLRRARRAGTAGDVGEGAPRAGEPAGPRTVVAVAGTFVAGAVVGETIEGEAVECDAAGEAREPGLASAVARAGSAGGGV GDGAGSGSGGSGAGAGSGGGGGAGGPGLPEAGPGRPQAAGRRAEVACLAATGPIMSSLVAADGAWHTDVLRLEPGDVLFV YTDGLVEARNAAHQQFGVDRLVAELLRDPRRAPAELLDDAFEVVRRHAPGRPSDDRTAIVVARTTEVSRPRP >Mature_631_residues GETAGLRSGIRVLVTISTIAVAVMLALAVFAALRANNAAAERGERLDPAATTTALLLADFVDQESAVRGYLITEEPSFLG PYNESDRTIPQQMNRLQQLLAEFPDLIQGTAEIEAAYQAWRSDVAEPEVAAMEVGDVQIARNIEKAGGRVRFNELRGRVA DLGIAIDNEQTAASGRLESAAVLLLSSLASAAFVILGVVLTVLTVLRRWLLRPIDALRRAVNAVAAGRYDTRIPEVGPEE IVELAGNIEAMRAQLVRLVRQNERSWEALAQQGPAVVALRDALTPSVLRAPGLVLRGRVDPAQGELAGDWYDSFELPDGR VGIVVGDVSGHGAVAGVFALRLKQLLDAALTRGADPGQAIEWVVDSLGETDEMFATAVVAVVDPASGEVRLANAGHPDAL LLRRARRAGTAGDVGEGAPRAGEPAGPRTVVAVAGTFVAGAVVGETIEGEAVECDAAGEAREPGLASAVARAGSAGGGVG DGAGSGSGGSGAGAGSGGGGGAGGPGLPEAGPGRPQAAGRRAEVACLAATGPIMSSLVAADGAWHTDVLRLEPGDVLFVY TDGLVEARNAAHQQFGVDRLVAELLRDPRRAPAELLDDAFEVVRRHAPGRPSDDRTAIVVARTTEVSRPRP
Specific function: Unknown
COG id: COG2208
COG function: function code TK; Serine phosphatase RsbU, regulator of sigma subunit
Gene ontology:
Cell location: Cytoplasmic
Metaboloic importance: NA
Operon status: Not Known
Operon components: None
Similarity: NA
Homologues:
None
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
NA
Pfam domain/function: NA
EC number: NA
Molecular weight: Translated: 65329; Mature: 65198
Theoretical pI: Translated: 4.60; Mature: 4.60
Prosite motif: PS50885 HAMP
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.3 %Cys (Translated Protein) 1.1 %Met (Translated Protein) 1.4 %Cys+Met (Translated Protein) 0.3 %Cys (Mature Protein) 1.0 %Met (Mature Protein) 1.3 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MGETAGLRSGIRVLVTISTIAVAVMLALAVFAALRANNAAAERGERLDPAATTTALLLAD CCCCHHHHCCCEEEHHHHHHHHHHHHHHHHHHHHHCCCHHHHCCCCCCCHHHHHHHHHHH FVDQESAVRGYLITEEPSFLGPYNESDRTIPQQMNRLQQLLAEFPDLIQGTAEIEAAYQA HHCCHHHHCCEEEECCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHH WRSDVAEPEVAAMEVGDVQIARNIEKAGGRVRFNELRGRVADLGIAIDNEQTAASGRLES HHHHCCCCCHHHHCCCCHHHHHHHHHCCCEEEHHHHHCHHHHHEEEECCCCHHHCCCHHH AAVLLLSSLASAAFVILGVVLTVLTVLRRWLLRPIDALRRAVNAVAAGRYDTRIPEVGPE HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCHH EIVELAGNIEAMRAQLVRLVRQNERSWEALAQQGPAVVALRDALTPSVLRAPGLVLRGRV HHHHHHCCHHHHHHHHHHHHHHCCHHHHHHHHCCCEEEEEHHHCCHHHHHCCCEEEECCC DPAQGELAGDWYDSFELPDGRVGIVVGDVSGHGAVAGVFALRLKQLLDAALTRGADPGQA CCCCCCCCCCCCCCCCCCCCCEEEEEECCCCCCHHHHHHHHHHHHHHHHHHHCCCCCCHH IEWVVDSLGETDEMFATAVVAVVDPASGEVRLANAGHPDALLLRRARRAGTAGDVGEGAP HHHHHHHCCCHHHHHHHHHHHEECCCCCCEEEECCCCCHHHHHHHHHHCCCCCCCCCCCC RAGEPAGPRTVVAVAGTFVAGAVVGETIEGEAVECDAAGEAREPGLASAVARAGSAGGGV CCCCCCCCCEEEEHHHHHHHHHHHCCCCCCCEEEECCCCCCCCCCHHHHHHHCCCCCCCC GDGAGSGSGGSGAGAGSGGGGGAGGPGLPEAGPGRPQAAGRRAEVACLAATGPIMSSLVA CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCEEEEEEECCHHHHHHHH ADGAWHTDVLRLEPGDVLFVYTDGLVEARNAAHQQFGVDRLVAELLRDPRRAPAELLDDA CCCCCCCCEEEECCCCEEEEEECCHHHHHHHHHHHHCHHHHHHHHHHCCCCCHHHHHHHH FEVVRRHAPGRPSDDRTAIVVARTTEVSRPRP HHHHHHCCCCCCCCCCEEEEEEEECCCCCCCC >Mature Secondary Structure GETAGLRSGIRVLVTISTIAVAVMLALAVFAALRANNAAAERGERLDPAATTTALLLAD CCCHHHHCCCEEEHHHHHHHHHHHHHHHHHHHHHCCCHHHHCCCCCCCHHHHHHHHHHH FVDQESAVRGYLITEEPSFLGPYNESDRTIPQQMNRLQQLLAEFPDLIQGTAEIEAAYQA HHCCHHHHCCEEEECCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHH WRSDVAEPEVAAMEVGDVQIARNIEKAGGRVRFNELRGRVADLGIAIDNEQTAASGRLES HHHHCCCCCHHHHCCCCHHHHHHHHHCCCEEEHHHHHCHHHHHEEEECCCCHHHCCCHHH AAVLLLSSLASAAFVILGVVLTVLTVLRRWLLRPIDALRRAVNAVAAGRYDTRIPEVGPE HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCHH EIVELAGNIEAMRAQLVRLVRQNERSWEALAQQGPAVVALRDALTPSVLRAPGLVLRGRV HHHHHHCCHHHHHHHHHHHHHHCCHHHHHHHHCCCEEEEEHHHCCHHHHHCCCEEEECCC DPAQGELAGDWYDSFELPDGRVGIVVGDVSGHGAVAGVFALRLKQLLDAALTRGADPGQA CCCCCCCCCCCCCCCCCCCCCEEEEEECCCCCCHHHHHHHHHHHHHHHHHHHCCCCCCHH IEWVVDSLGETDEMFATAVVAVVDPASGEVRLANAGHPDALLLRRARRAGTAGDVGEGAP HHHHHHHCCCHHHHHHHHHHHEECCCCCCEEEECCCCCHHHHHHHHHHCCCCCCCCCCCC RAGEPAGPRTVVAVAGTFVAGAVVGETIEGEAVECDAAGEAREPGLASAVARAGSAGGGV CCCCCCCCCEEEEHHHHHHHHHHHCCCCCCCEEEECCCCCCCCCCHHHHHHHCCCCCCCC GDGAGSGSGGSGAGAGSGGGGGAGGPGLPEAGPGRPQAAGRRAEVACLAATGPIMSSLVA CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCEEEEEEECCHHHHHHHH ADGAWHTDVLRLEPGDVLFVYTDGLVEARNAAHQQFGVDRLVAELLRDPRRAPAELLDDA CCCCCCCCEEEECCCCEEEEEECCHHHHHHHHHHHHCHHHHHHHHHHCCCCCHHHHHHHH FEVVRRHAPGRPSDDRTAIVVARTTEVSRPRP HHHHHHCCCCCCCCCCEEEEEEEECCCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA