Definition Acaryochloris marina MBIC11017 chromosome, complete genome.
Accession NC_009925
Length 6,503,724

Click here to switch to the map view.

The map label for this gene is 158337029

Identifier: 158337029

GI number: 158337029

Start: 3950034

End: 3951527

Strand: Direct

Name: 158337029

Synonym: AM1_3902

Alternate gene names: NA

Gene position: 3950034-3951527 (Clockwise)

Preceding gene: 158337028

Following gene: 158337031

Centisome position: 60.73

GC content: 50.27

Gene sequence:

>1494_bases
ATGAAATTTGGCTATGGAATCCCATCGGTTTTGGTGGGGGCAGCAACAGTCATTGTGGTGCAATCGCAGGCTGTTTTAGC
GCTGTCTGCTTCCCAGGTTGCCAGTATTGCTGAGCAAATTAGCGTCAAGATTGATGGACAAGCTCCAGGTTCAGGCGTGA
TGATTGCCAAGCGAGATAAGACTTACTTTGTGCTGACGGCAGCTCATGTTGTCGAAACGGATGATGAGTACGAAGTGATT
ACGCCGGATAATCAGCGCCATTCATTGAGCTATGCACAGGTCAAAAAACTGCCCGGCGTTGACCTTGCTGTCGTGCAGTT
CAATAGTAATAAGCCCTATCAAATTGCCAATTTGGGTGATTCCAGCCAATCCCAGCGGGGCATGACCACCTATGTCGCCG
GGTGGCCGTTGACGGGAACAGCGATCACGCAACCCACGCTGTTATTTCAGCAGGGGATTATTTCTGCCAATTCCCAGGTG
CAGCAAGATGACGGTTATGGATTAATTTATACCAACAACACCTTGCCAGGAATGTCTGGAGGGCCAGTCTTGAGTGAAGA
GGGAACGTTGGTAGGCATTCATGGCCGTGGCGAAACGGATCGCCAAGCTAGCACTCGCAATCCAGATGTGGTGGTTAAGG
TTGGCTATAACCTGGGCATTCCAATTAGTACGTTTCTGTCCTTAGCACCTCAATCGGGACTTAATCTGGATTTGCAGATT
GCAACCTCTCAAGCAACAGCTCCGAGTACGGAGGCAAAACCTTCAAAGGTGGATGATTTGATTGCCCAAAGCGGGAATCA
ACTCTATCAGGGCAATAATGAAGCCGCTCTGGGCGCTCTCAACCAAGCGATTGAAACGGATCCTAGGGCAGCGGATGCCT
ATCGATTAAGGGCGGATGCTCGCATGGCTTCGATTGGTTGGAGCTTTATGGAGGGCCGATCTAGGAAGAATCGCGATCTA
GTCTTGGCGGCACAACAGGATATCAATGAGGCGATTCGCTTAAACCCGAACTTAAGCGATGCGTATACCATCAGAGCCTA
TCTCAAGTTTGTCTTGCAAGATGGCGCAGGGGCAACAGCCGATATTAACCAAGCCCTGAGGTTAGATCCTCAGAATGCGA
TGCCTTATATCCTGCGTGCCAATCTACTAGCCGATCAGCGGCAGTGGCAGATGGCCATCGCGGATGCCAATCAAGCCTTA
AAGCTGGATGCCAATTCCCCCTATGCAGCCTTTGCCTATAGCGCCCGAGGTCTGGCACGGGCCAGTATCCGAGATATTTC
AGGTGGACTGCAAGATTTGACCAAGGCGATCAATCTATCTCCTGGAAATGCCTTGTTTTATATGAGTCGTGGCACGGTTC
TGGCTCTGAGTGGTAAGAGAAATGAAGGACGGGTGGATCTGGAAAAAAGTGCCAGTTTGGCCCAACAGAAAGGCCGGACT
GAGGTCTACAAAGAGGTCACTAAACGCTTGAATTTACTGAAACGTTTGCCCTAG

Upstream 100 bases:

>100_bases
ACCTAAACCAGATGATATTTGGTAGCTCCGGGTTTTCTGGTAAAGGTTTTGAACATTGGAGTTTGATTGGAGAGTCCCGC
TGGATAGGAGGAGTGGATAG

Downstream 100 bases:

>100_bases
GGGTTGGCGTATTTTGATCGCTGATTTTGGCATGGCCTAATCCTTATATTCCATGATCAAATTCGATTCTGGAATAGAGT
GATTAAACCTGAGTTCGGGA

Product: hypothetical protein

Products: NA

Alternate protein names: TPR Domain-Containing Protein; Peptidase S1 And S6 Chymotrypsin/Hap; Tetratricopeptide TPR_2 Repeat Protein; Tetratricopeptide Repeat Domain Protein; Tetratricopeptide Repeat-Containing Protein; TPR Repeat-Containing Serine/Threonin Protein Kinase; Peptidase; Trypsin Domain Protein; WD-40 Repeat-Containing Protein; Protease; Tetratricopeptide Tpr_1 Repeat-Containing Protein; Trypsin-Like Serine Protease; Tetratricopeptide Repeat Family Protein; Tetratricopeptide TPR_1 Repeat-Containing Protein; Serine Protease; TPR Repeats Containing Protein; TPR Repeat- And Protein Kinase Domain-Containing Protein; Pentapeptide Repeat-Containing Serine/Threonine Kinase; Tfp Pilus Assembly Protein PilF; TPR Repeat-Containing Protein Kinase; O-Linked GlcNAc Transferase

Number of amino acids: Translated: 497; Mature: 497

Protein sequence:

>497_residues
MKFGYGIPSVLVGAATVIVVQSQAVLALSASQVASIAEQISVKIDGQAPGSGVMIAKRDKTYFVLTAAHVVETDDEYEVI
TPDNQRHSLSYAQVKKLPGVDLAVVQFNSNKPYQIANLGDSSQSQRGMTTYVAGWPLTGTAITQPTLLFQQGIISANSQV
QQDDGYGLIYTNNTLPGMSGGPVLSEEGTLVGIHGRGETDRQASTRNPDVVVKVGYNLGIPISTFLSLAPQSGLNLDLQI
ATSQATAPSTEAKPSKVDDLIAQSGNQLYQGNNEAALGALNQAIETDPRAADAYRLRADARMASIGWSFMEGRSRKNRDL
VLAAQQDINEAIRLNPNLSDAYTIRAYLKFVLQDGAGATADINQALRLDPQNAMPYILRANLLADQRQWQMAIADANQAL
KLDANSPYAAFAYSARGLARASIRDISGGLQDLTKAINLSPGNALFYMSRGTVLALSGKRNEGRVDLEKSASLAQQKGRT
EVYKEVTKRLNLLKRLP

Sequences:

>Translated_497_residues
MKFGYGIPSVLVGAATVIVVQSQAVLALSASQVASIAEQISVKIDGQAPGSGVMIAKRDKTYFVLTAAHVVETDDEYEVI
TPDNQRHSLSYAQVKKLPGVDLAVVQFNSNKPYQIANLGDSSQSQRGMTTYVAGWPLTGTAITQPTLLFQQGIISANSQV
QQDDGYGLIYTNNTLPGMSGGPVLSEEGTLVGIHGRGETDRQASTRNPDVVVKVGYNLGIPISTFLSLAPQSGLNLDLQI
ATSQATAPSTEAKPSKVDDLIAQSGNQLYQGNNEAALGALNQAIETDPRAADAYRLRADARMASIGWSFMEGRSRKNRDL
VLAAQQDINEAIRLNPNLSDAYTIRAYLKFVLQDGAGATADINQALRLDPQNAMPYILRANLLADQRQWQMAIADANQAL
KLDANSPYAAFAYSARGLARASIRDISGGLQDLTKAINLSPGNALFYMSRGTVLALSGKRNEGRVDLEKSASLAQQKGRT
EVYKEVTKRLNLLKRLP
>Mature_497_residues
MKFGYGIPSVLVGAATVIVVQSQAVLALSASQVASIAEQISVKIDGQAPGSGVMIAKRDKTYFVLTAAHVVETDDEYEVI
TPDNQRHSLSYAQVKKLPGVDLAVVQFNSNKPYQIANLGDSSQSQRGMTTYVAGWPLTGTAITQPTLLFQQGIISANSQV
QQDDGYGLIYTNNTLPGMSGGPVLSEEGTLVGIHGRGETDRQASTRNPDVVVKVGYNLGIPISTFLSLAPQSGLNLDLQI
ATSQATAPSTEAKPSKVDDLIAQSGNQLYQGNNEAALGALNQAIETDPRAADAYRLRADARMASIGWSFMEGRSRKNRDL
VLAAQQDINEAIRLNPNLSDAYTIRAYLKFVLQDGAGATADINQALRLDPQNAMPYILRANLLADQRQWQMAIADANQAL
KLDANSPYAAFAYSARGLARASIRDISGGLQDLTKAINLSPGNALFYMSRGTVLALSGKRNEGRVDLEKSASLAQQKGRT
EVYKEVTKRLNLLKRLP

Specific function: Unknown

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 53372; Mature: 53372

Theoretical pI: Translated: 8.91; Mature: 8.91

Prosite motif: PS50293 TPR_REGION

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.0 %Cys     (Translated Protein)
1.8 %Met     (Translated Protein)
1.8 %Cys+Met (Translated Protein)
0.0 %Cys     (Mature Protein)
1.8 %Met     (Mature Protein)
1.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKFGYGIPSVLVGAATVIVVQSQAVLALSASQVASIAEQISVKIDGQAPGSGVMIAKRDK
CCCCCCCHHHHHCCEEEEEEECCEEEEECHHHHHHHHHHEEEEECCCCCCCCEEEEECCC
TYFVLTAAHVVETDDEYEVITPDNQRHSLSYAQVKKLPGVDLAVVQFNSNKPYQIANLGD
EEEEEEEEEEEECCCCEEEECCCCCCCCCHHHHHHCCCCCEEEEEEECCCCCEEEEECCC
SSQSQRGMTTYVAGWPLTGTAITQPTLLFQQGIISANSQVQQDDGYGLIYTNNTLPGMSG
CCCCCCCCEEEEECCCCCCCCCCCCHHHHHHCCCCCCCCEECCCCCEEEEECCCCCCCCC
GPVLSEEGTLVGIHGRGETDRQASTRNPDVVVKVGYNLGIPISTFLSLAPQSGLNLDLQI
CCEECCCCCEEEEECCCCCCCCCCCCCCCEEEEECCCCCCCHHHHHHHCCCCCCCEEEEE
ATSQATAPSTEAKPSKVDDLIAQSGNQLYQGNNEAALGALNQAIETDPRAADAYRLRADA
EECCCCCCCCCCCCHHHHHHHHHCCCEEECCCCCHHHHHHHHHHHCCCCCCCCEEECCCC
RMASIGWSFMEGRSRKNRDLVLAAQQDINEAIRLNPNLSDAYTIRAYLKFVLQDGAGATA
CHHHCCCHHHHCCCCCCCCEEEEEHHCCCHHEEECCCCCHHHHHHHHHHHHHHCCCCCCC
DINQALRLDPQNAMPYILRANLLADQRQWQMAIADANQALKLDANSPYAAFAYSARGLAR
CCCHHHEECCCCCCCEEEEHHHHHCCHHHEEEEECCCCEEEEECCCCCEEEEECCCCHHH
ASIRDISGGLQDLTKAINLSPGNALFYMSRGTVLALSGKRNEGRVDLEKSASLAQQKGRT
HHHHHHCCCHHHHHHHHCCCCCCEEEEEECCEEEEEECCCCCCCEEHHHHHHHHHHCCHH
EVYKEVTKRLNLLKRLP
HHHHHHHHHHHHHHHCC
>Mature Secondary Structure
MKFGYGIPSVLVGAATVIVVQSQAVLALSASQVASIAEQISVKIDGQAPGSGVMIAKRDK
CCCCCCCHHHHHCCEEEEEEECCEEEEECHHHHHHHHHHEEEEECCCCCCCCEEEEECCC
TYFVLTAAHVVETDDEYEVITPDNQRHSLSYAQVKKLPGVDLAVVQFNSNKPYQIANLGD
EEEEEEEEEEEECCCCEEEECCCCCCCCCHHHHHHCCCCCEEEEEEECCCCCEEEEECCC
SSQSQRGMTTYVAGWPLTGTAITQPTLLFQQGIISANSQVQQDDGYGLIYTNNTLPGMSG
CCCCCCCCEEEEECCCCCCCCCCCCHHHHHHCCCCCCCCEECCCCCEEEEECCCCCCCCC
GPVLSEEGTLVGIHGRGETDRQASTRNPDVVVKVGYNLGIPISTFLSLAPQSGLNLDLQI
CCEECCCCCEEEEECCCCCCCCCCCCCCCEEEEECCCCCCCHHHHHHHCCCCCCCEEEEE
ATSQATAPSTEAKPSKVDDLIAQSGNQLYQGNNEAALGALNQAIETDPRAADAYRLRADA
EECCCCCCCCCCCCHHHHHHHHHCCCEEECCCCCHHHHHHHHHHHCCCCCCCCEEECCCC
RMASIGWSFMEGRSRKNRDLVLAAQQDINEAIRLNPNLSDAYTIRAYLKFVLQDGAGATA
CHHHCCCHHHHCCCCCCCCEEEEEHHCCCHHEEECCCCCHHHHHHHHHHHHHHCCCCCCC
DINQALRLDPQNAMPYILRANLLADQRQWQMAIADANQALKLDANSPYAAFAYSARGLAR
CCCHHHEECCCCCCCEEEEHHHHHCCHHHEEEEECCCCEEEEECCCCCEEEEECCCCHHH
ASIRDISGGLQDLTKAINLSPGNALFYMSRGTVLALSGKRNEGRVDLEKSASLAQQKGRT
HHHHHHCCCHHHHHHHHCCCCCCEEEEEECCEEEEEECCCCCCCEEHHHHHHHHHHCCHH
EVYKEVTKRLNLLKRLP
HHHHHHHHHHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA