Definition Acaryochloris marina MBIC11017 chromosome, complete genome.
Accession NC_009925
Length 6,503,724

Click here to switch to the map view.

The map label for this gene is 158338098

Identifier: 158338098

GI number: 158338098

Start: 5035285

End: 5037474

Strand: Direct

Name: 158338098

Synonym: AM1_4988

Alternate gene names: NA

Gene position: 5035285-5037474 (Clockwise)

Preceding gene: 158338096

Following gene: 158338099

Centisome position: 77.42

GC content: 52.88

Gene sequence:

>2190_bases
GTGAGAAAAATCCTGATTTTGGCAGCCAATCCTAAGAACACCAATCAGCTCAGATTGGATGAAGAGGTGCGGGAAATTCA
GGAAGGGCTGCAGCGATCGCGCAGTCGAGACCAGTTTGAAATTGTGTCTCGGTGGGCGGTTCGTCCCAGCGATTTACGAC
GGGCGCTGTTGGATTATGAACCGCAAATAGTCCATTTCTGTGGCCATGGGGCTGGGGCTGAGGGATTAGCCCTGGAGAAC
AATGCGGGGCAGATAAAGCTGGTTACTGGGAAGGCGCTGGGCGGACTGTTTAAGCTGGTGCAAGCAAATGTGGAATGTGT
CTTGCTTAATGCCTGCTATTCAGAGGCTCAATCGAAGGCGATCCACAAATATATTAGCTATGTGATTGGTATGAGTAATG
CCATCGGCGACCGGGCGGCCATTGAGTTTGCTGTGGGGTTTTATGATGGCTTGGGCGCAGACCGCTCCTACGAAGATGCC
TTTGAATTTGGGTTGTCGGCCATTGCCCTGGAAGGGATTGACGAGACGGCTACGCCGAAGTTGAAATCGCCAGGACCAGG
CTCCTCCCCAAACTCTGTTCAACGGATTAACCCGTCATCTGCGCAAAAGCCTGAATCTGAGAATAAGACTGCCAACAACC
CTTTGTCGGGGGAGGGAAAAGCCCGGATTTTTATCAGCTATAAACGGGATGCTGTACCGGATGAACAGTTGGCTTTGGCG
ATTTATCAGCATTTGGGCCAAAGCCATGAAGTGTTTATCGATCAGAGCATGGCGGTGGGCACAAAGTGGGCCGAGAAGAT
TGAGCGGGAACTCCGACAGTCGGATTTTTTGATTACGTTATTGTCGGCTTCGGCGGTGGGAAGTGAGATGGTTCAGGGGG
AGGTGGAAACGGCGAATCGGCTGGGAAGTGAATTGGGTAAGCCTGCGATTCTGCCTGTTCGGGTCAATTATCGGGAGCCG
TTTACCTATCCCCTCAGTGCTTACCTAAATCCAATTAACTGGGCGTTTTGGGAGCAGTCGGAAGATACGCCCCAATTATT
GGCAGAACTGGAGCGGGCCATTGCTGGCGAATCCTTGTCGATTGCTTCGGATAGGGCCAAACAAGATCTGGTCCAACTGC
CGACGGCAGATAAGGCTGAGATTCCGCAGCCCCTGCCTTCGGCCCAACCCCCAACGCTGGAAATGCCGGAGGGGTCGATG
GACCCGGAGTCGCAGTTTTATGTGGAGCGCCAGGGGGACCAGATTGCCTTGGCAGCAATTCAGCGGCAGGGAGTGACAGT
GACGATTAAGGGACCGCGCCAGATGGGCAAGAGTTCCTTGCTGCTAAAGACCGTCGATCAGGCGATTCAGGCAGATAAGC
GAGTGGCTTATATTGATTTTCAGTTGTTTGATGATGCGGCTTTGGGGGATGCGGATCGGTTTTATCAGCAGTTTTGCCTG
ACGATTACAGAGCAGTTGGAACTGCCAAACCGAATTGAGGACTTTTGGCAGGATGAGTTGGGGAATAACCAGCGCTGTAC
TCGGTATATGCAGACTTATGTGCTGCGGGAGCTAAAGCATCCGTTTGTGCTGGCGATGGATGAGGTGGATCGGATTTTTG
ATCGCAAGTTTCGGTCGGATTTCTTTGCCATGTTGCGGAATTGGCACAACAATCGGGGGTTACCTTTGCCCGCGATGAAG
GTGTGGAAGCAGTTTGATCTGGTGCTGGTGACAGCGACGGAGCCCTATCACCTGATCGCAGATTTGCACCAGTCGCCCTT
CAACGTGGGGGAAGTGATTTCTCTGAAAGACTTTACGGCGGCGCAGGTGGCGGATTTGAACCAACGGCATGGTTCGCCTT
TAACCGCCGAACAGGAGCGGGCGTTATTTGCTCTGCTGAATGGCCATCCCTATCTAATTCGCAAGGCGCTTTATCTGGTA
GCCAGTGGTCAAAAGTCGATGGATCAGGTGTTGGCGAAGGCAGATCGGGATGATGGACCCTTTGGTGATCATCTGCGGTA
TCACTTATTTCGAATATATGATCGGCCCGAACTGGTGCAGGGGATGTTGGGGGCGGTTCAGAAGAATCGATGCGAGGATG
AGCGGATTGTACGGCTGCTCTGTGCGGCGGGCCTAATTCGCCAGGAGGGGAAAGCAGAGTTGCCCCGCTGTCAGCTTTAT
GGGGACTACTTTAAGGCACATCTGGAATAG

Upstream 100 bases:

>100_bases
ATCTTCTGAAGACTTTAAACGGTCTAGGTTTGCATATATTCTGAAAAAAAGACTGATAAGTCTTGGGTGATGTGACGGAA
CTGGAGGTTGTGGGGACTCG

Downstream 100 bases:

>100_bases
GTAGAGGGAGGGTATGGGGACTGAGATTTATACCGTTGGCGGTACCGTGCAGGCGAATGCCCAGGGGCTGTATATTCCTC
GGCAGGCGGACCAAGACCTG

Product: hypothetical protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 729; Mature: 729

Protein sequence:

>729_residues
MRKILILAANPKNTNQLRLDEEVREIQEGLQRSRSRDQFEIVSRWAVRPSDLRRALLDYEPQIVHFCGHGAGAEGLALEN
NAGQIKLVTGKALGGLFKLVQANVECVLLNACYSEAQSKAIHKYISYVIGMSNAIGDRAAIEFAVGFYDGLGADRSYEDA
FEFGLSAIALEGIDETATPKLKSPGPGSSPNSVQRINPSSAQKPESENKTANNPLSGEGKARIFISYKRDAVPDEQLALA
IYQHLGQSHEVFIDQSMAVGTKWAEKIERELRQSDFLITLLSASAVGSEMVQGEVETANRLGSELGKPAILPVRVNYREP
FTYPLSAYLNPINWAFWEQSEDTPQLLAELERAIAGESLSIASDRAKQDLVQLPTADKAEIPQPLPSAQPPTLEMPEGSM
DPESQFYVERQGDQIALAAIQRQGVTVTIKGPRQMGKSSLLLKTVDQAIQADKRVAYIDFQLFDDAALGDADRFYQQFCL
TITEQLELPNRIEDFWQDELGNNQRCTRYMQTYVLRELKHPFVLAMDEVDRIFDRKFRSDFFAMLRNWHNNRGLPLPAMK
VWKQFDLVLVTATEPYHLIADLHQSPFNVGEVISLKDFTAAQVADLNQRHGSPLTAEQERALFALLNGHPYLIRKALYLV
ASGQKSMDQVLAKADRDDGPFGDHLRYHLFRIYDRPELVQGMLGAVQKNRCEDERIVRLLCAAGLIRQEGKAELPRCQLY
GDYFKAHLE

Sequences:

>Translated_729_residues
MRKILILAANPKNTNQLRLDEEVREIQEGLQRSRSRDQFEIVSRWAVRPSDLRRALLDYEPQIVHFCGHGAGAEGLALEN
NAGQIKLVTGKALGGLFKLVQANVECVLLNACYSEAQSKAIHKYISYVIGMSNAIGDRAAIEFAVGFYDGLGADRSYEDA
FEFGLSAIALEGIDETATPKLKSPGPGSSPNSVQRINPSSAQKPESENKTANNPLSGEGKARIFISYKRDAVPDEQLALA
IYQHLGQSHEVFIDQSMAVGTKWAEKIERELRQSDFLITLLSASAVGSEMVQGEVETANRLGSELGKPAILPVRVNYREP
FTYPLSAYLNPINWAFWEQSEDTPQLLAELERAIAGESLSIASDRAKQDLVQLPTADKAEIPQPLPSAQPPTLEMPEGSM
DPESQFYVERQGDQIALAAIQRQGVTVTIKGPRQMGKSSLLLKTVDQAIQADKRVAYIDFQLFDDAALGDADRFYQQFCL
TITEQLELPNRIEDFWQDELGNNQRCTRYMQTYVLRELKHPFVLAMDEVDRIFDRKFRSDFFAMLRNWHNNRGLPLPAMK
VWKQFDLVLVTATEPYHLIADLHQSPFNVGEVISLKDFTAAQVADLNQRHGSPLTAEQERALFALLNGHPYLIRKALYLV
ASGQKSMDQVLAKADRDDGPFGDHLRYHLFRIYDRPELVQGMLGAVQKNRCEDERIVRLLCAAGLIRQEGKAELPRCQLY
GDYFKAHLE
>Mature_729_residues
MRKILILAANPKNTNQLRLDEEVREIQEGLQRSRSRDQFEIVSRWAVRPSDLRRALLDYEPQIVHFCGHGAGAEGLALEN
NAGQIKLVTGKALGGLFKLVQANVECVLLNACYSEAQSKAIHKYISYVIGMSNAIGDRAAIEFAVGFYDGLGADRSYEDA
FEFGLSAIALEGIDETATPKLKSPGPGSSPNSVQRINPSSAQKPESENKTANNPLSGEGKARIFISYKRDAVPDEQLALA
IYQHLGQSHEVFIDQSMAVGTKWAEKIERELRQSDFLITLLSASAVGSEMVQGEVETANRLGSELGKPAILPVRVNYREP
FTYPLSAYLNPINWAFWEQSEDTPQLLAELERAIAGESLSIASDRAKQDLVQLPTADKAEIPQPLPSAQPPTLEMPEGSM
DPESQFYVERQGDQIALAAIQRQGVTVTIKGPRQMGKSSLLLKTVDQAIQADKRVAYIDFQLFDDAALGDADRFYQQFCL
TITEQLELPNRIEDFWQDELGNNQRCTRYMQTYVLRELKHPFVLAMDEVDRIFDRKFRSDFFAMLRNWHNNRGLPLPAMK
VWKQFDLVLVTATEPYHLIADLHQSPFNVGEVISLKDFTAAQVADLNQRHGSPLTAEQERALFALLNGHPYLIRKALYLV
ASGQKSMDQVLAKADRDDGPFGDHLRYHLFRIYDRPELVQGMLGAVQKNRCEDERIVRLLCAAGLIRQEGKAELPRCQLY
GDYFKAHLE

Specific function: Unknown

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Contains 11 WD repeats [H]

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR020472
- InterPro:   IPR015943
- InterPro:   IPR001680
- InterPro:   IPR011046
- InterPro:   IPR019782
- InterPro:   IPR019775
- InterPro:   IPR017986
- InterPro:   IPR019781 [H]

Pfam domain/function: PF00400 WD40 [H]

EC number: NA

Molecular weight: Translated: 81770; Mature: 81770

Theoretical pI: Translated: 5.39; Mature: 5.39

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.1 %Cys     (Translated Protein)
1.8 %Met     (Translated Protein)
2.9 %Cys+Met (Translated Protein)
1.1 %Cys     (Mature Protein)
1.8 %Met     (Mature Protein)
2.9 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MRKILILAANPKNTNQLRLDEEVREIQEGLQRSRSRDQFEIVSRWAVRPSDLRRALLDYE
CCEEEEEEECCCCCCCEECHHHHHHHHHHHHHHCCCCHHHHHHHHCCCHHHHHHHHHCCC
PQIVHFCGHGAGAEGLALENNAGQIKLVTGKALGGLFKLVQANVECVLLNACYSEAQSKA
CCEEEEECCCCCCCCEEEECCCCEEEEEECHHHHHHHHHHHCCCCEEEEHHHHHHHHHHH
IHKYISYVIGMSNAIGDRAAIEFAVGFYDGLGADRSYEDAFEFGLSAIALEGIDETATPK
HHHHHHHHHHCCCCCCCHHHHEEEEHHHCCCCCCCCHHHHHHHCHHHHEECCCCCCCCCC
LKSPGPGSSPNSVQRINPSSAQKPESENKTANNPLSGEGKARIFISYKRDAVPDEQLALA
CCCCCCCCCCCCCEECCCCCCCCCCCCCCCCCCCCCCCCCEEEEEEECCCCCCHHHHHHH
IYQHLGQSHEVFIDQSMAVGTKWAEKIERELRQSDFLITLLSASAVGSEMVQGEVETANR
HHHHCCCCCEEEEECHHHHHHHHHHHHHHHHHHCCCEEEEHHHHHHHHHHHHCHHHHHHH
LGSELGKPAILPVRVNYREPFTYPLSAYLNPINWAFWEQSEDTPQLLAELERAIAGESLS
HHHHHCCCCEEEEEECCCCCCCCCHHHHCCCCCEEECCCCCCCHHHHHHHHHHHCCCCCC
IASDRAKQDLVQLPTADKAEIPQPLPSAQPPTLEMPEGSMDPESQFYVERQGDQIALAAI
HHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCEEEECCCCEEEEEEH
QRQGVTVTIKGPRQMGKSSLLLKTVDQAIQADKRVAYIDFQLFDDAALGDADRFYQQFCL
HHCCEEEEEECHHHCCHHHHHHHHHHHHHHCCCEEEEEEEEEECCCCCCCHHHHHHHHHH
TITEQLELPNRIEDFWQDELGNNQRCTRYMQTYVLRELKHPFVLAMDEVDRIFDRKFRSD
HHHHHHCCCHHHHHHHHHHCCCCHHHHHHHHHHHHHHHCCCEEEEHHHHHHHHHHHHHHH
FFAMLRNWHNNRGLPLPAMKVWKQFDLVLVTATEPYHLIADLHQSPFNVGEVISLKDFTA
HHHHHHHHCCCCCCCCHHHHHHHCCCEEEEECCCCHHHHHHHHCCCCCCCCEEEECCCHH
AQVADLNQRHGSPLTAEQERALFALLNGHPYLIRKALYLVASGQKSMDQVLAKADRDDGP
HHHHHHHHHCCCCCCCHHHHHEEHHCCCCHHHHHHHHHHHHCCCHHHHHHHHHCCCCCCC
FGDHLRYHLFRIYDRPELVQGMLGAVQKNRCEDERIVRLLCAAGLIRQEGKAELPRCQLY
CCHHHHHHHHHHCCCHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHCCCCCCCCHHHHH
GDYFKAHLE
HHHHHHHCC
>Mature Secondary Structure
MRKILILAANPKNTNQLRLDEEVREIQEGLQRSRSRDQFEIVSRWAVRPSDLRRALLDYE
CCEEEEEEECCCCCCCEECHHHHHHHHHHHHHHCCCCHHHHHHHHCCCHHHHHHHHHCCC
PQIVHFCGHGAGAEGLALENNAGQIKLVTGKALGGLFKLVQANVECVLLNACYSEAQSKA
CCEEEEECCCCCCCCEEEECCCCEEEEEECHHHHHHHHHHHCCCCEEEEHHHHHHHHHHH
IHKYISYVIGMSNAIGDRAAIEFAVGFYDGLGADRSYEDAFEFGLSAIALEGIDETATPK
HHHHHHHHHHCCCCCCCHHHHEEEEHHHCCCCCCCCHHHHHHHCHHHHEECCCCCCCCCC
LKSPGPGSSPNSVQRINPSSAQKPESENKTANNPLSGEGKARIFISYKRDAVPDEQLALA
CCCCCCCCCCCCCEECCCCCCCCCCCCCCCCCCCCCCCCCEEEEEEECCCCCCHHHHHHH
IYQHLGQSHEVFIDQSMAVGTKWAEKIERELRQSDFLITLLSASAVGSEMVQGEVETANR
HHHHCCCCCEEEEECHHHHHHHHHHHHHHHHHHCCCEEEEHHHHHHHHHHHHCHHHHHHH
LGSELGKPAILPVRVNYREPFTYPLSAYLNPINWAFWEQSEDTPQLLAELERAIAGESLS
HHHHHCCCCEEEEEECCCCCCCCCHHHHCCCCCEEECCCCCCCHHHHHHHHHHHCCCCCC
IASDRAKQDLVQLPTADKAEIPQPLPSAQPPTLEMPEGSMDPESQFYVERQGDQIALAAI
HHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCEEEECCCCEEEEEEH
QRQGVTVTIKGPRQMGKSSLLLKTVDQAIQADKRVAYIDFQLFDDAALGDADRFYQQFCL
HHCCEEEEEECHHHCCHHHHHHHHHHHHHHCCCEEEEEEEEEECCCCCCCHHHHHHHHHH
TITEQLELPNRIEDFWQDELGNNQRCTRYMQTYVLRELKHPFVLAMDEVDRIFDRKFRSD
HHHHHHCCCHHHHHHHHHHCCCCHHHHHHHHHHHHHHHCCCEEEEHHHHHHHHHHHHHHH
FFAMLRNWHNNRGLPLPAMKVWKQFDLVLVTATEPYHLIADLHQSPFNVGEVISLKDFTA
HHHHHHHHCCCCCCCCHHHHHHHCCCEEEEECCCCHHHHHHHHCCCCCCCCEEEECCCHH
AQVADLNQRHGSPLTAEQERALFALLNGHPYLIRKALYLVASGQKSMDQVLAKADRDDGP
HHHHHHHHHCCCCCCCHHHHHEEHHCCCCHHHHHHHHHHHHCCCHHHHHHHHHCCCCCCC
FGDHLRYHLFRIYDRPELVQGMLGAVQKNRCEDERIVRLLCAAGLIRQEGKAELPRCQLY
CCHHHHHHHHHHCCCHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHCCCCCCCCHHHHH
GDYFKAHLE
HHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 8905231 [H]