| Definition | Burkholderia sp. 383 chromosome 1, complete genome. |
|---|---|
| Accession | NC_007510 |
| Length | 3,694,126 |
Click here to switch to the map view.
The map label for this gene is kpsC [H]
Identifier: 78065331
GI number: 78065331
Start: 765430
End: 767280
Strand: Reverse
Name: kpsC [H]
Synonym: Bcep18194_A3857
Alternate gene names: 78065331
Gene position: 767280-765430 (Counterclockwise)
Preceding gene: 78065332
Following gene: 78065330
Centisome position: 20.77
GC content: 57.97
Gene sequence:
>1851_bases ATGTCACGTTCACCGACGATCCATACGCACTCTTGGCCGAATGGCATCATGCCACGCAAAAAAGGGCCGGCGCTCTCGTG GTTCACCACTTCCCTCGAATCTGAAACGGCCGATGGATGGATCGGCCGCATCGATGCCGAACTCGCGACCTTATCCGCAA TCGGCTCGGCATTGAATATCACGCGGCTCGTGGAGCGATTCCGTGCCGCCAACGTATTCGATCCATCGAGCTGCGCCACG CGTATTCCGCTCGGCTTGCTCGAGCGCGGCACCGCACAGCGAGTGCTGGTGCTCGACGAGCCCGCATCCGTCTATTTGCA GGCACCGCGCAGAGAAAGGGAAAGGCAGTTTTCCCGAATGCTGGCCGCAGTGCACCGCGAGCAACCAGAGGCAGAAATTT GGTTCGCCCGTAGTGGCATATCGAGTTCAGGAGAATGGCTTTCGTCGTCCCATCCAGGAATCCGCGGTTCGAATCGATAC ATCGACACAAGCGAGTCACTCTGCGCTTCCCTCCCGTATTTCGACCACGTCTATACGCTCTCCGCAGTTGAAGGGATGCA AGCGTTGCTTTGTGGCGTCCCGGTACATGTATTCGGTATGCCGTACTACGCTGGCTGGGGATTGACGCACGACGATGCGC CCCAGCCGGCAAGGCAATCGCACGCGACTCTGGAATCATTGTTCGAAGTTGTGTTCATACGCCTTTCCCGTCATCTCGCC CCTGCAGGAAAGACATCCGATTCGCTCGAAGCACTCCTTGACGCAATCGAAGCTCATCGCGCAACCGTATTACGCTTCGC CGATATACGCCACGTAGCAGGCATCCGTTTCCAGTGGTGGAAACGACCCTTCGCTACTCCTTTCCTGACGGCCGGTGGCG GAACACTGCGCTGGACGGATGACGCAAGCAAGCTTGCGGAAGGAGAGCATGCCGCATTTTGGGGTGCGCGTAGTACAGAG GGCTTGCCACCCGACACACCGGCCGTCCGTATCGAGGACGGCTTCCTGCACTCGATCGGCCTCGGCTCAGACCACGTCGC TCCATGCAGCCAGATAATCGACCGGCGCGGCCTCTATTTCGACCCGAGCCGCCCGAGCGACCTGACGGTGATCCTGAACG AAACGGATTTCAATGAAACTGAACTCGCGCGGGCTGACGCATTGCGCAACGAGATCACCCGCCTAGGGTTGACAAAGTAC AATCTCGGTCGCCGCAAGCCGGCTTGGCACGCGCCGCCGGGCAAGCGCGTTGTGCTCGTGCCGGGACAGGTCGCAGACGA CGCGTCGATTCGACTCGGTACGCGCGGCATCACGACAACCGAAGAATTGCTGCGAACGGTACGCGCCCACAACCCGGACG CATTTATTGTCTATAAACCCCATCCTGACGTCCTGTCGGGCAATCGCCGCGGCTTAATAGAAGCGGCAGCTCTCGCCGAC GTGATGGAGCAGGACTCTGATCTGATTTCGCTGATTGAGATAGCGGATGAAGTGCACACGCTTTCTTCGCTGTCTGGTTT TGAAGCGTTGATTCGCCGGAAAGCTGTCTTCACATATGGACTGCCCTTTTATGCAGGCTGGGGGTTGACACACGATGCGC TCGCACCACCTTGGCGCGATCGCAAGCTCTCGCTCGATATGCTGACGGCAGGTGTATTGCTGCGCTACCCGATCTATTGG GATTGGACTCTTCATCTGTTTACATCGCCCGAAGCCATCGTTCGAAAATTGGCGATACCTGCGAAACGCCCACTCGTGAA AATTCGAGGTAATCGTTTGCGCCCACTTCTAAAAGCAATTCGTTGGAGCAGGAATGGACTCCAGCACCTCGCATGGCGTT GCAGTCAATGA
Upstream 100 bases:
>100_bases CCCAGCTCACGCGCATGGCCCGCTTCCAAGTCCCAACTTGGCAGACACATTTCGAACATGTCGATCGGTTCCTGGAAACC TTGGCCCCGTAAGCGCTTGC
Downstream 100 bases:
>100_bases GTGTGAGAAAATGAGGTATCGCCGTAGAATTTACGATCCTCGATCAGTACAGACACATCGCGCGCTCAATATTGGCGACG CTTTCTTTTAATAACTTACA
Product: capsule polysaccharide biosynthesis
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 616; Mature: 615
Protein sequence:
>616_residues MSRSPTIHTHSWPNGIMPRKKGPALSWFTTSLESETADGWIGRIDAELATLSAIGSALNITRLVERFRAANVFDPSSCAT RIPLGLLERGTAQRVLVLDEPASVYLQAPRRERERQFSRMLAAVHREQPEAEIWFARSGISSSGEWLSSSHPGIRGSNRY IDTSESLCASLPYFDHVYTLSAVEGMQALLCGVPVHVFGMPYYAGWGLTHDDAPQPARQSHATLESLFEVVFIRLSRHLA PAGKTSDSLEALLDAIEAHRATVLRFADIRHVAGIRFQWWKRPFATPFLTAGGGTLRWTDDASKLAEGEHAAFWGARSTE GLPPDTPAVRIEDGFLHSIGLGSDHVAPCSQIIDRRGLYFDPSRPSDLTVILNETDFNETELARADALRNEITRLGLTKY NLGRRKPAWHAPPGKRVVLVPGQVADDASIRLGTRGITTTEELLRTVRAHNPDAFIVYKPHPDVLSGNRRGLIEAAALAD VMEQDSDLISLIEIADEVHTLSSLSGFEALIRRKAVFTYGLPFYAGWGLTHDALAPPWRDRKLSLDMLTAGVLLRYPIYW DWTLHLFTSPEAIVRKLAIPAKRPLVKIRGNRLRPLLKAIRWSRNGLQHLAWRCSQ
Sequences:
>Translated_616_residues MSRSPTIHTHSWPNGIMPRKKGPALSWFTTSLESETADGWIGRIDAELATLSAIGSALNITRLVERFRAANVFDPSSCAT RIPLGLLERGTAQRVLVLDEPASVYLQAPRRERERQFSRMLAAVHREQPEAEIWFARSGISSSGEWLSSSHPGIRGSNRY IDTSESLCASLPYFDHVYTLSAVEGMQALLCGVPVHVFGMPYYAGWGLTHDDAPQPARQSHATLESLFEVVFIRLSRHLA PAGKTSDSLEALLDAIEAHRATVLRFADIRHVAGIRFQWWKRPFATPFLTAGGGTLRWTDDASKLAEGEHAAFWGARSTE GLPPDTPAVRIEDGFLHSIGLGSDHVAPCSQIIDRRGLYFDPSRPSDLTVILNETDFNETELARADALRNEITRLGLTKY NLGRRKPAWHAPPGKRVVLVPGQVADDASIRLGTRGITTTEELLRTVRAHNPDAFIVYKPHPDVLSGNRRGLIEAAALAD VMEQDSDLISLIEIADEVHTLSSLSGFEALIRRKAVFTYGLPFYAGWGLTHDALAPPWRDRKLSLDMLTAGVLLRYPIYW DWTLHLFTSPEAIVRKLAIPAKRPLVKIRGNRLRPLLKAIRWSRNGLQHLAWRCSQ >Mature_615_residues SRSPTIHTHSWPNGIMPRKKGPALSWFTTSLESETADGWIGRIDAELATLSAIGSALNITRLVERFRAANVFDPSSCATR IPLGLLERGTAQRVLVLDEPASVYLQAPRRERERQFSRMLAAVHREQPEAEIWFARSGISSSGEWLSSSHPGIRGSNRYI DTSESLCASLPYFDHVYTLSAVEGMQALLCGVPVHVFGMPYYAGWGLTHDDAPQPARQSHATLESLFEVVFIRLSRHLAP AGKTSDSLEALLDAIEAHRATVLRFADIRHVAGIRFQWWKRPFATPFLTAGGGTLRWTDDASKLAEGEHAAFWGARSTEG LPPDTPAVRIEDGFLHSIGLGSDHVAPCSQIIDRRGLYFDPSRPSDLTVILNETDFNETELARADALRNEITRLGLTKYN LGRRKPAWHAPPGKRVVLVPGQVADDASIRLGTRGITTTEELLRTVRAHNPDAFIVYKPHPDVLSGNRRGLIEAAALADV MEQDSDLISLIEIADEVHTLSSLSGFEALIRRKAVFTYGLPFYAGWGLTHDALAPPWRDRKLSLDMLTAGVLLRYPIYWD WTLHLFTSPEAIVRKLAIPAKRPLVKIRGNRLRPLLKAIRWSRNGLQHLAWRCSQ
Specific function: Unknown
COG id: COG3563
COG function: function code M; Capsule polysaccharide export protein
Gene ontology:
Cell location: Cytoplasm (Potential) [H]
Metaboloic importance: NA
Operon status: Not Known
Operon components: None
Similarity: To R.meliloti lipopolysaccharide processing protein lpsZ [H]
Homologues:
None
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR007833 [H]
Pfam domain/function: PF05159 Capsule_synth [H]
EC number: NA
Molecular weight: Translated: 68555; Mature: 68424
Theoretical pI: Translated: 8.87; Mature: 8.87
Prosite motif: PS01035 PTS_EIIB_TYPE_1_CYS ; PS00178 AA_TRNA_LIGASE_I
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.8 %Cys (Translated Protein) 1.1 %Met (Translated Protein) 1.9 %Cys+Met (Translated Protein) 0.8 %Cys (Mature Protein) 1.0 %Met (Mature Protein) 1.8 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MSRSPTIHTHSWPNGIMPRKKGPALSWFTTSLESETADGWIGRIDAELATLSAIGSALNI CCCCCCEEECCCCCCCCCCCCCCCEEEEECCCCCCCCCCCCEEHHHHHHHHHHHHHHHHH TRLVERFRAANVFDPSSCATRIPLGLLERGTAQRVLVLDEPASVYLQAPRRERERQFSRM HHHHHHHHHCCCCCCHHHHHHCCHHHHCCCCCCEEEEEECCCCEEEECHHHHHHHHHHHH LAAVHREQPEAEIWFARSGISSSGEWLSSSHPGIRGSNRYIDTSESLCASLPYFDHVYTL HHHHHHCCCCCEEEEEECCCCCCCCHHCCCCCCCCCCCCEECCHHHHHHHCCCHHHHHHH SAVEGMQALLCGVPVHVFGMPYYAGWGLTHDDAPQPARQSHATLESLFEVVFIRLSRHLA HHHHHHHHHHHCCCHHHHCCCHHCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHCC PAGKTSDSLEALLDAIEAHRATVLRFADIRHVAGIRFQWWKRPFATPFLTAGGGTLRWTD CCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHCCCCCCCEEECCCCEEEECC DASKLAEGEHAAFWGARSTEGLPPDTPAVRIEDGFLHSIGLGSDHVAPCSQIIDRRGLYF CHHHHHCCCCCEEECCCCCCCCCCCCCEEEEECCCEEECCCCCCCCHHHHHHHHCCCCEE DPSRPSDLTVILNETDFNETELARADALRNEITRLGLTKYNLGRRKPAWHAPPGKRVVLV CCCCCCCEEEEEECCCCCHHHHHHHHHHHHHHHHHCCHHCCCCCCCCCCCCCCCCEEEEE PGQVADDASIRLGTRGITTTEELLRTVRAHNPDAFIVYKPHPDVLSGNRRGLIEAAALAD CCCCCCCCCEEECCCCCCCHHHHHHHHHCCCCCEEEEECCCCCCCCCCCCCHHHHHHHHH VMEQDSDLISLIEIADEVHTLSSLSGFEALIRRKAVFTYGLPFYAGWGLTHDALAPPWRD HHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHEECCHHHCCCCCCCCCCCCCCCC RKLSLDMLTAGVLLRYPIYWDWTLHLFTSPEAIVRKLAIPAKRPLVKIRGNRLRPLLKAI CEEEHHHHHHHHHHHCCEEEEEEEEEECCHHHHHHHHCCCCCCCEEEECCCCHHHHHHHH RWSRNGLQHLAWRCSQ HHHHCCHHHHHHHCCC >Mature Secondary Structure SRSPTIHTHSWPNGIMPRKKGPALSWFTTSLESETADGWIGRIDAELATLSAIGSALNI CCCCCEEECCCCCCCCCCCCCCCEEEEECCCCCCCCCCCCEEHHHHHHHHHHHHHHHHH TRLVERFRAANVFDPSSCATRIPLGLLERGTAQRVLVLDEPASVYLQAPRRERERQFSRM HHHHHHHHHCCCCCCHHHHHHCCHHHHCCCCCCEEEEEECCCCEEEECHHHHHHHHHHHH LAAVHREQPEAEIWFARSGISSSGEWLSSSHPGIRGSNRYIDTSESLCASLPYFDHVYTL HHHHHHCCCCCEEEEEECCCCCCCCHHCCCCCCCCCCCCEECCHHHHHHHCCCHHHHHHH SAVEGMQALLCGVPVHVFGMPYYAGWGLTHDDAPQPARQSHATLESLFEVVFIRLSRHLA HHHHHHHHHHHCCCHHHHCCCHHCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHCC PAGKTSDSLEALLDAIEAHRATVLRFADIRHVAGIRFQWWKRPFATPFLTAGGGTLRWTD CCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHCCCCCCCEEECCCCEEEECC DASKLAEGEHAAFWGARSTEGLPPDTPAVRIEDGFLHSIGLGSDHVAPCSQIIDRRGLYF CHHHHHCCCCCEEECCCCCCCCCCCCCEEEEECCCEEECCCCCCCCHHHHHHHHCCCCEE DPSRPSDLTVILNETDFNETELARADALRNEITRLGLTKYNLGRRKPAWHAPPGKRVVLV CCCCCCCEEEEEECCCCCHHHHHHHHHHHHHHHHHCCHHCCCCCCCCCCCCCCCCEEEEE PGQVADDASIRLGTRGITTTEELLRTVRAHNPDAFIVYKPHPDVLSGNRRGLIEAAALAD CCCCCCCCCEEECCCCCCCHHHHHHHHHCCCCCEEEEECCCCCCCCCCCCCHHHHHHHHH VMEQDSDLISLIEIADEVHTLSSLSGFEALIRRKAVFTYGLPFYAGWGLTHDALAPPWRD HHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHEECCHHHCCCCCCCCCCCCCCCC RKLSLDMLTAGVLLRYPIYWDWTLHLFTSPEAIVRKLAIPAKRPLVKIRGNRLRPLLKAI CEEEHHHHHHHHHHHCCEEEEEEEEEECCHHHHHHHHCCCCCCCEEEECCCCHHHHHHHH RWSRNGLQHLAWRCSQ HHHHCCHHHHHHHCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 8397187; 7875563 [H]