Definition Acaryochloris marina MBIC11017 chromosome, complete genome.
Accession NC_009925
Length 6,503,724

Click here to switch to the map view.

The map label for this gene is ywqD [H]

Identifier: 158337950

GI number: 158337950

Start: 4876703

End: 4879324

Strand: Direct

Name: ywqD [H]

Synonym: AM1_4837

Alternate gene names: 158337950

Gene position: 4876703-4879324 (Clockwise)

Preceding gene: 158337948

Following gene: 158337952

Centisome position: 74.98

GC content: 45.0

Gene sequence:

>2622_bases
TTGGCATCAGTGTTAGCCTCCCAAATCAGTAAATCAAGGAAATTTAGGCTAATCCTTCAACGCCATTGGCTACCATCTTC
AGTAGCGTTCACTTTGGTGCTAACCCTCGGAACACTCGCAATAAAGTTGCTGTACCAGCCTCTCTATGTCGCTGAGGGCC
AATTGCGATTTACAAAAGTGAACCCCATTTCTAAACTCACTACATTAGGTACCGAAATTGGGAATTTAGATCCCCTTGAT
TTAGAGGGCAGGCCCCTGGAGACCGAATCTGCTGTCATCCAGTCCACGCCCCTTCTGCAAACAACCTTAAACAAACTAAG
TACCCAGGAGGATATCGATTACTCACTAGATCTCAAAGGTTTTCGGCAAAATTTTGTTATTTCAGATGTAAAGGGAACAG
ATATTCTCCGAATTACCTATAAATCCATTAATTCTGAGCATGCTGCTGCTGCAGTCAATCTACTCATGCAGGTTTATCTT
GAAAACCATCTTCAAGACAATCGCAATTCTATTGAGACTGCTAGTAAATTTATCTCAGAACGAATTCCTCAATCAGAAAA
GACTGTTCAAAATGCTGAAAGAGCACTCCGACAATTTAAGCAGAAAAATCAGATTGTAGATCTTAGTAACCGGGAGCAAG
ATGCCGAAGCAAAAATTGCTGAATTACAAGGAAAAATCAGTGACGCCCAAGCTCAAATTGCACAACTCCAAACTGAAGCC
AATGTACTAAGTAATCAATTGGGCATGACGCCGCAACAAGCCATGGCAGCAGTTAGCCTAAGCCAATCTGCCGAGATTCG
CGATGTGCTCACCCAGTTACAACAAACTGAGTCTCAGCTCGCCCTACAGACTAACCAGCTTACGGCTACTCACCCTACGG
TTCTTGGTTTAGCCCGGGATGTAAACAAATTAAAAGCTCTATTCCAACAACGTGCTGAGAAAATACTGGGGACAAAAGTA
GCCGCCCCTGAATCCTTGATTGGTTCCCTGCAAGAAGAGTTGACTGCTGATCTCGTCAAATTAGAGGCTCAAAGACAGGG
ATTAGTCAGTCAGGTCATTGCCCAATCAAACACTTTAGAATCCTATAAACAACAACTCAACATTTTCCCTGGCTTGGCAG
AAAAGCAGCGAGAATTAGAGCGAAAACTAGAGGCAGCACAGTCTACCTATGCTTTACTCTTACAAAAACAGCAAGAGATT
TTAGCTGAGGCAAATCAAACAGTAGGGAATGCGAGAGTTTTGGTACCAGCCCAAATTCCAAAGTCGCCAGTTACGCCGAA
TCAAGCAGACTATTTAGCAACCGGATTATTAGGGGTGTTAGCCTTCTTTGCTACTGCCTACATATTGGAAACTCTGGATA
AATCCATTCGGACTGTCGAAGACGCCGTTCATCAATTTGAGTATCCTCTATTGGGGGTCATTCCCGCGTTCGGGAATTCT
AATAATTCACTATTTTACGATGGGGGATTACAACAGTTAGCTCCTAAACTTTTCCTCAGAGATTTTCCTGATTCACCAGT
CAGTAACGCCTTTCGAATGCTACAAGTTAGCCTAAAATCGGTACAAACGGGTCGCCATTGCCAAACTTTAGTGGTGACGA
GTACATCACCCCAAGAGGGTAAATCAACGGTGGTCGCAAATTTGGCTATGGCCCTTGCCCAGGCAGGAAATCAAGTTCTG
GTTGTCGACGGTAATCTTCGAAATCCGTTTCAAGACCGTATGTGGGATGTCCTGAATGAATTCGGTTTAAGCAATGTCTT
GTTTGGACAAGCTGATTTAGATTCAGCGACTCAATCGGTCACTGCCCATGTGGATGTGATGACAGCGGGTAATCTTCATG
CCAATGCCATGGGGACCTTAGAATCCAAACACATGACTGTAATGCTAAATGCAGCAAAGTCCATTTATAACTACATTCTA
ATTGATGCGCCTTCGTTAAATTCAGCTGCAGATGTATCCATTTTGGGAGGGCAAGCGGATGGCATTGTGATTGTGGTTAA
ACCTGGTATTGCTAACCTTCCTAATATAGCTGCCGCAAAAGAGCTATTGATGCGTTCTGGGCAACGAGTCACGGGGCTAA
TTATCAATGGGGCTTTATCACAGGATCAACCCTATGGAGACTTCCAAGTTCACCCCATGAACGGTCAGGTGCCCCCCCAA
CCATTGCCAACCCCATCCCCTAGTATTTCGTTCAATCAAAATCCTTTCCCCAATTACACCCCTGAAGCCCCATCGCAGGT
TTTAGTGCAGTCGAATGGCCCAACCCCAGAAGAACTCCCGTTGCGGGATTTGCAAGATCAAGTTGAACATTTGCGGGCAG
TCTGGATTCGATCGGTTCAGTTTGTAGATGAACAAGAAGAAGAGCTTGTTCAACTGCACCATACAGTGTCTGACCTACAA
GAGCAGATCCGCGACGCAGGAGGTTACTCCCACAGTTCTTCGGCAGCGACGGATCTGATTCGGTTAGAACTTCGGTTGGC
CCATGAAAAAGAACGGTTACGCTTGTTTGAAAAAACTTTGGCTGGGCAACGGCAACGTTTACAGTCCCAGCAGGCGGTTT
TTCAACATCACCTAGGACTACTTCAGCGACGTATAAAACGGATTGTAGGCCATCTCGATTAG

Upstream 100 bases:

>100_bases
ATATATCCGCTTTTTTAAAAGCTAGATAAAAATAAGAGTTAGAGCTGAGGAATTAGAAAATTATTAATGTCTTTTTCTAC
ATTTTTTTGCACAATAGGAG

Downstream 100 bases:

>100_bases
ATATCAGCATTTTTGGGTAACGGCTATATCTTAAGAGAACACTAGGCTGAAGCGCTGAGGCTACCTAAAACAGACGCTAA
TAAACCAGGGAATAGGTTAT

Product: lipopolysaccharide biosynthesis protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 873; Mature: 872

Protein sequence:

>873_residues
MASVLASQISKSRKFRLILQRHWLPSSVAFTLVLTLGTLAIKLLYQPLYVAEGQLRFTKVNPISKLTTLGTEIGNLDPLD
LEGRPLETESAVIQSTPLLQTTLNKLSTQEDIDYSLDLKGFRQNFVISDVKGTDILRITYKSINSEHAAAAVNLLMQVYL
ENHLQDNRNSIETASKFISERIPQSEKTVQNAERALRQFKQKNQIVDLSNREQDAEAKIAELQGKISDAQAQIAQLQTEA
NVLSNQLGMTPQQAMAAVSLSQSAEIRDVLTQLQQTESQLALQTNQLTATHPTVLGLARDVNKLKALFQQRAEKILGTKV
AAPESLIGSLQEELTADLVKLEAQRQGLVSQVIAQSNTLESYKQQLNIFPGLAEKQRELERKLEAAQSTYALLLQKQQEI
LAEANQTVGNARVLVPAQIPKSPVTPNQADYLATGLLGVLAFFATAYILETLDKSIRTVEDAVHQFEYPLLGVIPAFGNS
NNSLFYDGGLQQLAPKLFLRDFPDSPVSNAFRMLQVSLKSVQTGRHCQTLVVTSTSPQEGKSTVVANLAMALAQAGNQVL
VVDGNLRNPFQDRMWDVLNEFGLSNVLFGQADLDSATQSVTAHVDVMTAGNLHANAMGTLESKHMTVMLNAAKSIYNYIL
IDAPSLNSAADVSILGGQADGIVIVVKPGIANLPNIAAAKELLMRSGQRVTGLIINGALSQDQPYGDFQVHPMNGQVPPQ
PLPTPSPSISFNQNPFPNYTPEAPSQVLVQSNGPTPEELPLRDLQDQVEHLRAVWIRSVQFVDEQEEELVQLHHTVSDLQ
EQIRDAGGYSHSSSAATDLIRLELRLAHEKERLRLFEKTLAGQRQRLQSQQAVFQHHLGLLQRRIKRIVGHLD

Sequences:

>Translated_873_residues
MASVLASQISKSRKFRLILQRHWLPSSVAFTLVLTLGTLAIKLLYQPLYVAEGQLRFTKVNPISKLTTLGTEIGNLDPLD
LEGRPLETESAVIQSTPLLQTTLNKLSTQEDIDYSLDLKGFRQNFVISDVKGTDILRITYKSINSEHAAAAVNLLMQVYL
ENHLQDNRNSIETASKFISERIPQSEKTVQNAERALRQFKQKNQIVDLSNREQDAEAKIAELQGKISDAQAQIAQLQTEA
NVLSNQLGMTPQQAMAAVSLSQSAEIRDVLTQLQQTESQLALQTNQLTATHPTVLGLARDVNKLKALFQQRAEKILGTKV
AAPESLIGSLQEELTADLVKLEAQRQGLVSQVIAQSNTLESYKQQLNIFPGLAEKQRELERKLEAAQSTYALLLQKQQEI
LAEANQTVGNARVLVPAQIPKSPVTPNQADYLATGLLGVLAFFATAYILETLDKSIRTVEDAVHQFEYPLLGVIPAFGNS
NNSLFYDGGLQQLAPKLFLRDFPDSPVSNAFRMLQVSLKSVQTGRHCQTLVVTSTSPQEGKSTVVANLAMALAQAGNQVL
VVDGNLRNPFQDRMWDVLNEFGLSNVLFGQADLDSATQSVTAHVDVMTAGNLHANAMGTLESKHMTVMLNAAKSIYNYIL
IDAPSLNSAADVSILGGQADGIVIVVKPGIANLPNIAAAKELLMRSGQRVTGLIINGALSQDQPYGDFQVHPMNGQVPPQ
PLPTPSPSISFNQNPFPNYTPEAPSQVLVQSNGPTPEELPLRDLQDQVEHLRAVWIRSVQFVDEQEEELVQLHHTVSDLQ
EQIRDAGGYSHSSSAATDLIRLELRLAHEKERLRLFEKTLAGQRQRLQSQQAVFQHHLGLLQRRIKRIVGHLD
>Mature_872_residues
ASVLASQISKSRKFRLILQRHWLPSSVAFTLVLTLGTLAIKLLYQPLYVAEGQLRFTKVNPISKLTTLGTEIGNLDPLDL
EGRPLETESAVIQSTPLLQTTLNKLSTQEDIDYSLDLKGFRQNFVISDVKGTDILRITYKSINSEHAAAAVNLLMQVYLE
NHLQDNRNSIETASKFISERIPQSEKTVQNAERALRQFKQKNQIVDLSNREQDAEAKIAELQGKISDAQAQIAQLQTEAN
VLSNQLGMTPQQAMAAVSLSQSAEIRDVLTQLQQTESQLALQTNQLTATHPTVLGLARDVNKLKALFQQRAEKILGTKVA
APESLIGSLQEELTADLVKLEAQRQGLVSQVIAQSNTLESYKQQLNIFPGLAEKQRELERKLEAAQSTYALLLQKQQEIL
AEANQTVGNARVLVPAQIPKSPVTPNQADYLATGLLGVLAFFATAYILETLDKSIRTVEDAVHQFEYPLLGVIPAFGNSN
NSLFYDGGLQQLAPKLFLRDFPDSPVSNAFRMLQVSLKSVQTGRHCQTLVVTSTSPQEGKSTVVANLAMALAQAGNQVLV
VDGNLRNPFQDRMWDVLNEFGLSNVLFGQADLDSATQSVTAHVDVMTAGNLHANAMGTLESKHMTVMLNAAKSIYNYILI
DAPSLNSAADVSILGGQADGIVIVVKPGIANLPNIAAAKELLMRSGQRVTGLIINGALSQDQPYGDFQVHPMNGQVPPQP
LPTPSPSISFNQNPFPNYTPEAPSQVLVQSNGPTPEELPLRDLQDQVEHLRAVWIRSVQFVDEQEEELVQLHHTVSDLQE
QIRDAGGYSHSSSAATDLIRLELRLAHEKERLRLFEKTLAGQRQRLQSQQAVFQHHLGLLQRRIKRIVGHLD

Specific function: May be involved in the regulation of capsular polysaccharide biosynthesis. Autophosphorylates in vitro. Phosphorylates and activates in vitro two UDP-glucose dehydrogenases, YwqF and TuaD, as well as the DNA-binding proteins Ssb and SsbB [H]

COG id: COG3206

COG function: function code M; Uncharacterized protein involved in exopolysaccharide biosynthesis

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the CpsD/CapB family [H]

Homologues:

Organism=Escherichia coli, GI1787216, Length=367, Percent_Identity=25.6130790190736, Blast_Score=116, Evalue=5e-27,
Organism=Escherichia coli, GI87082032, Length=385, Percent_Identity=23.6363636363636, Blast_Score=107, Evalue=3e-24,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR002586
- InterPro:   IPR005702 [H]

Pfam domain/function: PF01656 CbiA [H]

EC number: =2.7.10.2 [H]

Molecular weight: Translated: 96127; Mature: 95996

Theoretical pI: Translated: 6.25; Mature: 6.25

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.1 %Cys     (Translated Protein)
1.5 %Met     (Translated Protein)
1.6 %Cys+Met (Translated Protein)
0.1 %Cys     (Mature Protein)
1.4 %Met     (Mature Protein)
1.5 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MASVLASQISKSRKFRLILQRHWLPSSVAFTLVLTLGTLAIKLLYQPLYVAEGQLRFTKV
CHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEEEC
NPISKLTTLGTEIGNLDPLDLEGRPLETESAVIQSTPLLQTTLNKLSTQEDIDYSLDLKG
CCHHHHHHHHHHHCCCCCCCCCCCCCCCHHHHHHCCCHHHHHHHHHCCCCCCCCEECCCH
FRQNFVISDVKGTDILRITYKSINSEHAAAAVNLLMQVYLENHLQDNRNSIETASKFISE
HHCCCEEECCCCCEEEEEEEHHCCCHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHH
RIPQSEKTVQNAERALRQFKQKNQIVDLSNREQDAEAKIAELQGKISDAQAQIAQLQTEA
HCCCHHHHHHHHHHHHHHHHHCCCEECCCCCCCHHHHHHHHHHCCHHHHHHHHHHHHHHH
NVLSNQLGMTPQQAMAAVSLSQSAEIRDVLTQLQQTESQLALQTNQLTATHPTVLGLARD
HHHHHHCCCCHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHH
VNKLKALFQQRAEKILGTKVAAPESLIGSLQEELTADLVKLEAQRQGLVSQVIAQSNTLE
HHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHH
SYKQQLNIFPGLAEKQRELERKLEAAQSTYALLLQKQQEILAEANQTVGNARVLVPAQIP
HHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEEECCCC
KSPVTPNQADYLATGLLGVLAFFATAYILETLDKSIRTVEDAVHQFEYPLLGVIPAFGNS
CCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHEEEECCCCC
NNSLFYDGGLQQLAPKLFLRDFPDSPVSNAFRMLQVSLKSVQTGRHCQTLVVTSTSPQEG
CCCEEECCCHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHCCCCCCEEEEEECCCCCCC
KSTVVANLAMALAQAGNQVLVVDGNLRNPFQDRMWDVLNEFGLSNVLFGQADLDSATQSV
HHHHHHHHHHHHHHCCCEEEEEECCCCCCHHHHHHHHHHHCCCCCEEECCCCHHHHHHHH
TAHVDVMTAGNLHANAMGTLESKHMTVMLNAAKSIYNYILIDAPSLNSAADVSILGGQAD
EEEEEEEEECCCCCCHHCCCCCCCEEEEHHHHHHHHHEEEEECCCCCCCCCEEEECCCCC
GIVIVVKPGIANLPNIAAAKELLMRSGQRVTGLIINGALSQDQPYGDFQVHPMNGQVPPQ
CEEEEECCCCCCCCCHHHHHHHHHHCCCCEEEEEEECCCCCCCCCCCEEEECCCCCCCCC
PLPTPSPSISFNQNPFPNYTPEAPSQVLVQSNGPTPEELPLRDLQDQVEHLRAVWIRSVQ
CCCCCCCCCCCCCCCCCCCCCCCCCCEEEECCCCCCCCCCHHHHHHHHHHHHHHHHHHHH
FVDEQEEELVQLHHTVSDLQEQIRDAGGYSHSSSAATDLIRLELRLAHEKERLRLFEKTL
HHCHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHH
AGQRQRLQSQQAVFQHHLGLLQRRIKRIVGHLD
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCC
>Mature Secondary Structure 
ASVLASQISKSRKFRLILQRHWLPSSVAFTLVLTLGTLAIKLLYQPLYVAEGQLRFTKV
HHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEEEC
NPISKLTTLGTEIGNLDPLDLEGRPLETESAVIQSTPLLQTTLNKLSTQEDIDYSLDLKG
CCHHHHHHHHHHHCCCCCCCCCCCCCCCHHHHHHCCCHHHHHHHHHCCCCCCCCEECCCH
FRQNFVISDVKGTDILRITYKSINSEHAAAAVNLLMQVYLENHLQDNRNSIETASKFISE
HHCCCEEECCCCCEEEEEEEHHCCCHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHH
RIPQSEKTVQNAERALRQFKQKNQIVDLSNREQDAEAKIAELQGKISDAQAQIAQLQTEA
HCCCHHHHHHHHHHHHHHHHHCCCEECCCCCCCHHHHHHHHHHCCHHHHHHHHHHHHHHH
NVLSNQLGMTPQQAMAAVSLSQSAEIRDVLTQLQQTESQLALQTNQLTATHPTVLGLARD
HHHHHHCCCCHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHH
VNKLKALFQQRAEKILGTKVAAPESLIGSLQEELTADLVKLEAQRQGLVSQVIAQSNTLE
HHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHH
SYKQQLNIFPGLAEKQRELERKLEAAQSTYALLLQKQQEILAEANQTVGNARVLVPAQIP
HHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEEECCCC
KSPVTPNQADYLATGLLGVLAFFATAYILETLDKSIRTVEDAVHQFEYPLLGVIPAFGNS
CCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHEEEECCCCC
NNSLFYDGGLQQLAPKLFLRDFPDSPVSNAFRMLQVSLKSVQTGRHCQTLVVTSTSPQEG
CCCEEECCCHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHCCCCCCEEEEEECCCCCCC
KSTVVANLAMALAQAGNQVLVVDGNLRNPFQDRMWDVLNEFGLSNVLFGQADLDSATQSV
HHHHHHHHHHHHHHCCCEEEEEECCCCCCHHHHHHHHHHHCCCCCEEECCCCHHHHHHHH
TAHVDVMTAGNLHANAMGTLESKHMTVMLNAAKSIYNYILIDAPSLNSAADVSILGGQAD
EEEEEEEEECCCCCCHHCCCCCCCEEEEHHHHHHHHHEEEEECCCCCCCCCEEEECCCCC
GIVIVVKPGIANLPNIAAAKELLMRSGQRVTGLIINGALSQDQPYGDFQVHPMNGQVPPQ
CEEEEECCCCCCCCCHHHHHHHHHHCCCCEEEEEEECCCCCCCCCCCEEEECCCCCCCCC
PLPTPSPSISFNQNPFPNYTPEAPSQVLVQSNGPTPEELPLRDLQDQVEHLRAVWIRSVQ
CCCCCCCCCCCCCCCCCCCCCCCCCCEEEECCCCCCCCCCHHHHHHHHHHHHHHHHHHHH
FVDEQEEELVQLHHTVSDLQEQIRDAGGYSHSSSAATDLIRLELRLAHEKERLRLFEKTL
HHCHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHH
AGQRQRLQSQQAVFQHHLGLLQRRIKRIVGHLD
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9353933; 9384377 [H]