Definition Herpetosiphon aurantiacus ATCC 23779 chromosome, complete genome.
Accession NC_009972
Length 6,346,587

Click here to switch to the map view.

The map label for this gene is tuaB [H]

Identifier: 159900097

GI number: 159900097

Start: 4501316

End: 4502782

Strand: Direct

Name: tuaB [H]

Synonym: Haur_3580

Alternate gene names: 159900097

Gene position: 4501316-4502782 (Clockwise)

Preceding gene: 159900096

Following gene: 159900098

Centisome position: 70.92

GC content: 49.97

Gene sequence:

>1467_bases
ATGGCGAAACAGCCTGAAACGATTGTCCAGAGTGCGGCTCGTAATACATTATGGTCGTATGCCGCCACCTATGGCGGCAA
AATTCTGATCTTTATCACCACGGTGATTCTGGCTTATTTCGTGACCAAAGCTGAATACGGCTTGGTCGGCATGGGCTTGA
CGGTTATCGCCTTTCTTGAGGTGATGCAAGATCTAGGGATCGGCTCGGCAGTAATTTATCGCGAAGGCGAGGATGCTGCT
AACACCGCTTTTTGGCTTGGCTGTGGAATCGCCTTGACGCTCTTTAGCATAACTTGGTTGGCAGCACCCTTAGTTGCCAC
CTATTTCTTGCAAAATAATCCTGATGTGATTCCGATTATTCGGGCCTTGGGCTTGAGCTTTCCCTTGTTTGCCATGCGCA
ATATTCACGATGCCTTGTTGCGCAAACGCATGCAATTCAAAAAACGCTTTATTCCCGATCTGATTCAGGTCAGCAGCAAA
GGCGCAATTTCGATTGGCTGTGCCTTGGCGGGCATGGGCGCTTGGAGCTTGGTTTGGGGCCAATTGGGTGGCTCGGCCTG
TGGCGTGATTGCCTATTGGATGGTCAATCCATGGCGACCTAACTTCAAGATTGATCGAGCCGTGATCAAGCCGCTGTTGA
GCTTTGGTAGCAATATCGTGGCAGTCAATGGTTTGGCTGTCATGTTGGCGCAAACCGATTATCTGCTAGTTGGACGCTAT
CTTGGCGATGCAAACTTAGGTATTTATACCAATGGCTTTCGCTTCCCTGACCTGATGGTGATGCAAGTTTGTATTGCCTT
GGCCAATGTGCTGTATCCCTTGTACAGTCGTTTGCGCGATGATCCTGCTGGGTTGCAACAGGGCTTTTTTATTGCCTCGC
GGTATGTCGCCTTAGTGACTGTGCCGCTTTCATTGGGAATTGCAATTACGGCTGAGCCGTTTGTTTTGACCTTGCTAAGC
GTAAAATGGATTGAAACTGTGCCGATTATGCGCACAATTGCCATTTACACCCTGTTTCTTTCGCTGGGCTACAACGTTGG
TGATGTCTACAAGGCGCAAAATCGCACCAGCATTTTGACCAAGCTTTCAATCGCTCGTTTAATTGTGTTAGTTCCGGCGT
TATGGTTTGCCGCTGCCCAGTTCAAATCGTTGCAGGCAGTCGGCATTACCCATGCAATTGTGGCATTTTTGGGCAGCACA
CTTAATTTGGTGGTTGCCGCCAAAGTGCTGAACATGCCGATTCGCCGAATTTTGAGCGCCTTCCAACCAGCCATAATTGC
TGGCACGGTGATGAGTACTTGTTTGATTTTGACCCTGCTGGCCTTGCAAAACACTCCTGCATGGCTGCAACTCTTGGCGG
CAGTCGTGGTGGGCATCGGCTCCTATGCTGGAACTTTGTGGTTTGGTCAGCGCGAAGTTCTGACCCAAGCAGGCCAAACC
TTACGTGGTGCGGTGGCACGGAGATAA

Upstream 100 bases:

>100_bases
CTATCCTACCCACGCTTTTTCTGGATTTTGATCGCCATCGCCTATGCAATTCCCAATGTTGCCAATAAAGCTTATGAAGA
GTATCGCGAGGCGCTACCAA

Downstream 100 bases:

>100_bases
TATGCACGTTGTTCAGGTGATCGATTCGCTCTATCGTGGTGGAGCACAACAATTGCTGGTAACCTTCGCGATCGAAGCCC
AACGCCGTGGGATCAAAACC

Product: polysaccharide biosynthesis protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 488; Mature: 487

Protein sequence:

>488_residues
MAKQPETIVQSAARNTLWSYAATYGGKILIFITTVILAYFVTKAEYGLVGMGLTVIAFLEVMQDLGIGSAVIYREGEDAA
NTAFWLGCGIALTLFSITWLAAPLVATYFLQNNPDVIPIIRALGLSFPLFAMRNIHDALLRKRMQFKKRFIPDLIQVSSK
GAISIGCALAGMGAWSLVWGQLGGSACGVIAYWMVNPWRPNFKIDRAVIKPLLSFGSNIVAVNGLAVMLAQTDYLLVGRY
LGDANLGIYTNGFRFPDLMVMQVCIALANVLYPLYSRLRDDPAGLQQGFFIASRYVALVTVPLSLGIAITAEPFVLTLLS
VKWIETVPIMRTIAIYTLFLSLGYNVGDVYKAQNRTSILTKLSIARLIVLVPALWFAAAQFKSLQAVGITHAIVAFLGST
LNLVVAAKVLNMPIRRILSAFQPAIIAGTVMSTCLILTLLALQNTPAWLQLLAAVVVGIGSYAGTLWFGQREVLTQAGQT
LRGAVARR

Sequences:

>Translated_488_residues
MAKQPETIVQSAARNTLWSYAATYGGKILIFITTVILAYFVTKAEYGLVGMGLTVIAFLEVMQDLGIGSAVIYREGEDAA
NTAFWLGCGIALTLFSITWLAAPLVATYFLQNNPDVIPIIRALGLSFPLFAMRNIHDALLRKRMQFKKRFIPDLIQVSSK
GAISIGCALAGMGAWSLVWGQLGGSACGVIAYWMVNPWRPNFKIDRAVIKPLLSFGSNIVAVNGLAVMLAQTDYLLVGRY
LGDANLGIYTNGFRFPDLMVMQVCIALANVLYPLYSRLRDDPAGLQQGFFIASRYVALVTVPLSLGIAITAEPFVLTLLS
VKWIETVPIMRTIAIYTLFLSLGYNVGDVYKAQNRTSILTKLSIARLIVLVPALWFAAAQFKSLQAVGITHAIVAFLGST
LNLVVAAKVLNMPIRRILSAFQPAIIAGTVMSTCLILTLLALQNTPAWLQLLAAVVVGIGSYAGTLWFGQREVLTQAGQT
LRGAVARR
>Mature_487_residues
AKQPETIVQSAARNTLWSYAATYGGKILIFITTVILAYFVTKAEYGLVGMGLTVIAFLEVMQDLGIGSAVIYREGEDAAN
TAFWLGCGIALTLFSITWLAAPLVATYFLQNNPDVIPIIRALGLSFPLFAMRNIHDALLRKRMQFKKRFIPDLIQVSSKG
AISIGCALAGMGAWSLVWGQLGGSACGVIAYWMVNPWRPNFKIDRAVIKPLLSFGSNIVAVNGLAVMLAQTDYLLVGRYL
GDANLGIYTNGFRFPDLMVMQVCIALANVLYPLYSRLRDDPAGLQQGFFIASRYVALVTVPLSLGIAITAEPFVLTLLSV
KWIETVPIMRTIAIYTLFLSLGYNVGDVYKAQNRTSILTKLSIARLIVLVPALWFAAAQFKSLQAVGITHAIVAFLGSTL
NLVVAAKVLNMPIRRILSAFQPAIIAGTVMSTCLILTLLALQNTPAWLQLLAAVVVGIGSYAGTLWFGQREVLTQAGQTL
RGAVARR

Specific function: Might be involved in the translocation of teichuronic acid repeating units from the inner to the outer surface of the membrane [H]

COG id: COG2244

COG function: function code R; Membrane protein involved in the export of O-antigen and teichoic acid

Gene ontology:

Cell location: Cell membrane; Multi-pass membrane protein (Potential) [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the polysaccharide synthase family [H]

Homologues:

Organism=Escherichia coli, GI1788359, Length=382, Percent_Identity=24.6073298429319, Blast_Score=118, Evalue=8e-28,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR002797 [H]

Pfam domain/function: PF01943 Polysacc_synt [H]

EC number: NA

Molecular weight: Translated: 52981; Mature: 52849

Theoretical pI: Translated: 10.12; Mature: 10.12

Prosite motif: PS00012 PHOSPHOPANTETHEINE

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.0 %Cys     (Translated Protein)
2.7 %Met     (Translated Protein)
3.7 %Cys+Met (Translated Protein)
1.0 %Cys     (Mature Protein)
2.5 %Met     (Mature Protein)
3.5 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MAKQPETIVQSAARNTLWSYAATYGGKILIFITTVILAYFVTKAEYGLVGMGLTVIAFLE
CCCCHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHH
VMQDLGIGSAVIYREGEDAANTAFWLGCGIALTLFSITWLAAPLVATYFLQNNPDVIPII
HHHHCCCCCEEEEECCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHH
RALGLSFPLFAMRNIHDALLRKRMQFKKRFIPDLIQVSSKGAISIGCALAGMGAWSLVWG
HHHCCCCHHHHHHHHHHHHHHHHHHHHHHHCHHHHHHCCCCCEEEHHHHHCCCHHHHHHH
QLGGSACGVIAYWMVNPWRPNFKIDRAVIKPLLSFGSNIVAVNGLAVMLAQTDYLLVGRY
HCCCCHHHHHHEEHCCCCCCCCEECHHHHHHHHHCCCCEEEECHHEEEEECCCHHEEEHH
LGDANLGIYTNGFRFPDLMVMQVCIALANVLYPLYSRLRDDPAGLQQGFFIASRYVALVT
HCCCCCCEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHEE
VPLSLGIAITAEPFVLTLLSVKWIETVPIMRTIAIYTLFLSLGYNVGDVYKAQNRTSILT
EHHHCCEEEECCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHCCCHHHHHH
KLSIARLIVLVPALWFAAAQFKSLQAVGITHAIVAFLGSTLNLVVAAKVLNMPIRRILSA
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
FQPAIIAGTVMSTCLILTLLALQNTPAWLQLLAAVVVGIGSYAGTLWFGQREVLTQAGQT
HCHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHH
LRGAVARR
HHHHHCCC
>Mature Secondary Structure 
AKQPETIVQSAARNTLWSYAATYGGKILIFITTVILAYFVTKAEYGLVGMGLTVIAFLE
CCCHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHH
VMQDLGIGSAVIYREGEDAANTAFWLGCGIALTLFSITWLAAPLVATYFLQNNPDVIPII
HHHHCCCCCEEEEECCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHH
RALGLSFPLFAMRNIHDALLRKRMQFKKRFIPDLIQVSSKGAISIGCALAGMGAWSLVWG
HHHCCCCHHHHHHHHHHHHHHHHHHHHHHHCHHHHHHCCCCCEEEHHHHHCCCHHHHHHH
QLGGSACGVIAYWMVNPWRPNFKIDRAVIKPLLSFGSNIVAVNGLAVMLAQTDYLLVGRY
HCCCCHHHHHHEEHCCCCCCCCEECHHHHHHHHHCCCCEEEECHHEEEEECCCHHEEEHH
LGDANLGIYTNGFRFPDLMVMQVCIALANVLYPLYSRLRDDPAGLQQGFFIASRYVALVT
HCCCCCCEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHEE
VPLSLGIAITAEPFVLTLLSVKWIETVPIMRTIAIYTLFLSLGYNVGDVYKAQNRTSILT
EHHHCCEEEECCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHCCCHHHHHH
KLSIARLIVLVPALWFAAAQFKSLQAVGITHAIVAFLGSTLNLVVAAKVLNMPIRRILSA
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
FQPAIIAGTVMSTCLILTLLALQNTPAWLQLLAAVVVGIGSYAGTLWFGQREVLTQAGQT
HCHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHH
LRGAVARR
HHHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 10048024; 9384377 [H]