The gene/protein map for NC_009921 is currently unavailable.
Definition Frankia sp. EAN1pec chromosome, complete genome.
Accession NC_009921
Length 8,982,042

Click here to switch to the map view.

The map label for this gene is 158318831

Identifier: 158318831

GI number: 158318831

Start: 8678008

End: 8679396

Strand: Direct

Name: 158318831

Synonym: Franean1_7107

Alternate gene names: NA

Gene position: 8678008-8679396 (Clockwise)

Preceding gene: 158318830

Following gene: 158318832

Centisome position: 96.62

GC content: 66.31

Gene sequence:

>1389_bases
GTGGCGGTGTGGGAGGCGGGGCTGGAGGAGCTGTTCGGCCGGGTGGCGGACTGTTTCCGGTCTGATCAGCCGCGTGCGCA
GGCACGGGCCTATGTGGCAGGGTTGTTGTCTCGGACGGAACGGAAGAACGGGTGGACGCTTGCGGAGTTCACCCGTGAGG
CCGGGCCGCAGAAGATGCAGCGGTTGTTGAACGAGTATGCCTGGGACGCCCACGCGATGCGTGACGTCGTCCAGTCGTAT
GTGGTGGAGAACCTGACCGAGCCGGATGGGGTCCTGGTTGTGGACGAGACCGGGTTTATCAAGAAGGGAAAGTCCTCGGC
CGGGGTGCAGCGGCAGTATAGCGGTACCGCGGGCCGGATTGAGAACTGTCAGATCGGGGTGTTCGCCGCCTATGTTTCCG
GGAAGGGACGGGCTTTCGTCGACCGGGAGCTGTACCTTCCCGCGAGTTGGACCGACGACCGGGCGCGGTGCAAGGCGGCG
GGTGTGCCGGCCAGGGTGGGGTTCGCGACCAAGCCGCTGCTGGCACTGGACATGATCCGCCGGTTCTGGGTGACCCACCG
GCAGTTGGGCTGGGTCGCCGGCGATGAGGTGTACGGCGGCGACCCCGAACTACGCGACTGGCTGGAAGAACACCGGGTCG
GCTATGTTCTGGCTGTCAAGAAGGACACCGAGGTGACCACGACCGTCGGTCGCCGCCGTGTGGACACCCTCGCCGCGAAG
GTCCCCGCGCGTGCCTGGGAGACATATTCCTGCGCCGATGGCTCGAAAGGACCCCGGTTGTATGACTGGGCGCTGGTGGA
CACGACCGACCTCGCCGGCCCGGCGAATCGGCCTCAGCAGGTCCTGATCCGCCGCGCACGCACCGGCAAAAGGGAGCTTG
CGTTCTTTCTCACCCACAGTCCGCGGCCGGTTCCGCTCGCTACCCTCGTCACCGTCGCAGGCCGGCGCTGGGGAATCGAG
GAATGTTTCCAGTCAGCCAAGAACGAGGTCGGTCTCGACCATTACCAGGTTCGGCTCTACCGCGCCTGGTACCGGCACAT
CACCCTGGCGATGCTCGCCCACGCCTGGCTCGCTGTCACCGCGCTGAGAAACCGCGAACAAAACCCACCGGCCGTCCCAC
CAGCGACGACCGCGGTGGGATACCAGCGCCTTCCCGGCGGCCTCCCGATCGCCGAGCAGCCGGAACCGGATAGAGCCATG
ATGGCCCCACTCACCCTCAACGAGATCCGTCACGTCATTGCCCTTTTTGGACAGGCCGCCATCCCATCGGCCGTGATCAC
CTGGTGGTCGGACTGGCGTCGCAGCCACCAGGCACGCGCCCGCCATTACCACTTCCAGACCCGGATCCGCGCCGCTCAAG
TAACCGCCACACCGGCGGCAGCTACATAG

Upstream 100 bases:

>100_bases
GGCGTGTGGCGTGGGGCGGCCACCGCGTGATTCTCCGTAGTCTGTGAGAACAAAAGAAGAAGCCGCGGTGGCCGCGGCAC
GTAGCGTATCCGGGATGAAC

Downstream 100 bases:

>100_bases
AGATCACTGGGGCTGTAGTACTAGACAACTCCTGGTTCCTCGCGATGCAGTATTACCAGCGCTACCAGGTCCCCTCGAAG
GACATGTACGGTTGGAACCA

Product: transposase

Products: NA

Alternate protein names: IS4 Family Transposase; Transposase IS4 Family Protein; ISXo8 Transposase; ISRSO17-Transposase Protein; LOW QUALITY PROTEIN IS4 Family Transposase; FOG Transposase; Transposase IS; Isrso17-Transposase Protein; Transposase ISRS; LOW QUALITY PROTEIN Transposase; Transposase-Like Protein; Transposase Helper Protein B Fragment; Transposase IS4 Protein; Transposase Of; IS Sequence; Transposase Protein

Number of amino acids: Translated: 462; Mature: 461

Protein sequence:

>462_residues
MAVWEAGLEELFGRVADCFRSDQPRAQARAYVAGLLSRTERKNGWTLAEFTREAGPQKMQRLLNEYAWDAHAMRDVVQSY
VVENLTEPDGVLVVDETGFIKKGKSSAGVQRQYSGTAGRIENCQIGVFAAYVSGKGRAFVDRELYLPASWTDDRARCKAA
GVPARVGFATKPLLALDMIRRFWVTHRQLGWVAGDEVYGGDPELRDWLEEHRVGYVLAVKKDTEVTTTVGRRRVDTLAAK
VPARAWETYSCADGSKGPRLYDWALVDTTDLAGPANRPQQVLIRRARTGKRELAFFLTHSPRPVPLATLVTVAGRRWGIE
ECFQSAKNEVGLDHYQVRLYRAWYRHITLAMLAHAWLAVTALRNREQNPPAVPPATTAVGYQRLPGGLPIAEQPEPDRAM
MAPLTLNEIRHVIALFGQAAIPSAVITWWSDWRRSHQARARHYHFQTRIRAAQVTATPAAAT

Sequences:

>Translated_462_residues
MAVWEAGLEELFGRVADCFRSDQPRAQARAYVAGLLSRTERKNGWTLAEFTREAGPQKMQRLLNEYAWDAHAMRDVVQSY
VVENLTEPDGVLVVDETGFIKKGKSSAGVQRQYSGTAGRIENCQIGVFAAYVSGKGRAFVDRELYLPASWTDDRARCKAA
GVPARVGFATKPLLALDMIRRFWVTHRQLGWVAGDEVYGGDPELRDWLEEHRVGYVLAVKKDTEVTTTVGRRRVDTLAAK
VPARAWETYSCADGSKGPRLYDWALVDTTDLAGPANRPQQVLIRRARTGKRELAFFLTHSPRPVPLATLVTVAGRRWGIE
ECFQSAKNEVGLDHYQVRLYRAWYRHITLAMLAHAWLAVTALRNREQNPPAVPPATTAVGYQRLPGGLPIAEQPEPDRAM
MAPLTLNEIRHVIALFGQAAIPSAVITWWSDWRRSHQARARHYHFQTRIRAAQVTATPAAAT
>Mature_461_residues
AVWEAGLEELFGRVADCFRSDQPRAQARAYVAGLLSRTERKNGWTLAEFTREAGPQKMQRLLNEYAWDAHAMRDVVQSYV
VENLTEPDGVLVVDETGFIKKGKSSAGVQRQYSGTAGRIENCQIGVFAAYVSGKGRAFVDRELYLPASWTDDRARCKAAG
VPARVGFATKPLLALDMIRRFWVTHRQLGWVAGDEVYGGDPELRDWLEEHRVGYVLAVKKDTEVTTTVGRRRVDTLAAKV
PARAWETYSCADGSKGPRLYDWALVDTTDLAGPANRPQQVLIRRARTGKRELAFFLTHSPRPVPLATLVTVAGRRWGIEE
CFQSAKNEVGLDHYQVRLYRAWYRHITLAMLAHAWLAVTALRNREQNPPAVPPATTAVGYQRLPGGLPIAEQPEPDRAMM
APLTLNEIRHVIALFGQAAIPSAVITWWSDWRRSHQARARHYHFQTRIRAAQVTATPAAAT

Specific function: Unknown

COG id: COG5659

COG function: function code L; FOG: Transposase

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 51751; Mature: 51620

Theoretical pI: Translated: 9.96; Mature: 9.96

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.1 %Cys     (Translated Protein)
1.5 %Met     (Translated Protein)
2.6 %Cys+Met (Translated Protein)
1.1 %Cys     (Mature Protein)
1.3 %Met     (Mature Protein)
2.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MAVWEAGLEELFGRVADCFRSDQPRAQARAYVAGLLSRTERKNGWTLAEFTREAGPQKMQ
CCHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHCCCCCCHHHHHHHCCHHHHH
RLLNEYAWDAHAMRDVVQSYVVENLTEPDGVLVVDETGFIKKGKSSAGVQRQYSGTAGRI
HHHHHHCCHHHHHHHHHHHHHHHHCCCCCCEEEEECCCCCCCCCCCCCCCHHCCCCCCCC
ENCQIGVFAAYVSGKGRAFVDRELYLPASWTDDRARCKAAGVPARVGFATKPLLALDMIR
CCCEEEEEEEEECCCCCEEECCEEEECCCCCCHHHHHHHCCCCCCCCCCCCHHHHHHHHH
RFWVTHRQLGWVAGDEVYGGDPELRDWLEEHRVGYVLAVKKDTEVTTTVGRRRVDTLAAK
HHHHHHHHHCCEECCCCCCCCHHHHHHHHHCCCCEEEEEECCCCHHHHHHHHHHHHHHHH
VPARAWETYSCADGSKGPRLYDWALVDTTDLAGPANRPQQVLIRRARTGKRELAFFLTHS
CCHHHCCCEECCCCCCCCEEEEEEEEECCCCCCCCCCHHHHHHHHHHCCCCEEEEEEECC
PRPVPLATLVTVAGRRWGIEECFQSAKNEVGLDHYQVRLYRAWYRHITLAMLAHAWLAVT
CCCCCHHHHHHHHCCCCCHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHH
ALRNREQNPPAVPPATTAVGYQRLPGGLPIAEQPEPDRAMMAPLTLNEIRHVIALFGQAA
HHHCCCCCCCCCCCCHHHHHHHHCCCCCCCCCCCCCCCCEECCCCHHHHHHHHHHHHHHH
IPSAVITWWSDWRRSHQARARHYHFQTRIRAAQVTATPAAAT
CCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHEEECCCCCCC
>Mature Secondary Structure 
AVWEAGLEELFGRVADCFRSDQPRAQARAYVAGLLSRTERKNGWTLAEFTREAGPQKMQ
CHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHCCCCCCHHHHHHHCCHHHHH
RLLNEYAWDAHAMRDVVQSYVVENLTEPDGVLVVDETGFIKKGKSSAGVQRQYSGTAGRI
HHHHHHCCHHHHHHHHHHHHHHHHCCCCCCEEEEECCCCCCCCCCCCCCCHHCCCCCCCC
ENCQIGVFAAYVSGKGRAFVDRELYLPASWTDDRARCKAAGVPARVGFATKPLLALDMIR
CCCEEEEEEEEECCCCCEEECCEEEECCCCCCHHHHHHHCCCCCCCCCCCCHHHHHHHHH
RFWVTHRQLGWVAGDEVYGGDPELRDWLEEHRVGYVLAVKKDTEVTTTVGRRRVDTLAAK
HHHHHHHHHCCEECCCCCCCCHHHHHHHHHCCCCEEEEEECCCCHHHHHHHHHHHHHHHH
VPARAWETYSCADGSKGPRLYDWALVDTTDLAGPANRPQQVLIRRARTGKRELAFFLTHS
CCHHHCCCEECCCCCCCCEEEEEEEEECCCCCCCCCCHHHHHHHHHHCCCCEEEEEEECC
PRPVPLATLVTVAGRRWGIEECFQSAKNEVGLDHYQVRLYRAWYRHITLAMLAHAWLAVT
CCCCCHHHHHHHHCCCCCHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHH
ALRNREQNPPAVPPATTAVGYQRLPGGLPIAEQPEPDRAMMAPLTLNEIRHVIALFGQAA
HHHCCCCCCCCCCCCHHHHHHHHCCCCCCCCCCCCCCCCEECCCCHHHHHHHHHHHHHHH
IPSAVITWWSDWRRSHQARARHYHFQTRIRAAQVTATPAAAT
CCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHEEECCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA