| Definition | Exiguobacterium sp. AT1b, complete genome. |
|---|---|
| Accession | NC_012673 |
| Length | 2,999,895 |
Click here to switch to the map view.
The map label for this gene is 229916833
Identifier: 229916833
GI number: 229916833
Start: 1080124
End: 1083018
Strand: Reverse
Name: 229916833
Synonym: EAT1b_1106
Alternate gene names: NA
Gene position: 1083018-1080124 (Counterclockwise)
Preceding gene: 229916834
Following gene: 229916832
Centisome position: 36.1
GC content: 43.28
Gene sequence:
>2895_bases ATGGCTAAGAAGAAACAATTCGTTACTGCAGCGGCAGCGTTCGCAGTAGCAGCATCAGCAGTAGCGCCTGCAATCACGGC AGACGCAGCATCATCAACGGTCCGTCTTTCATCGGACTACGTACGTGGGGGAGACCTCGACGCAGCGCTTGACAAAGAAT ACAAGGGCAGCGAGATCTACTGGTACAAATCTTCAATCGACATGAACAAACTTGGCGTGTTCCAAACAGCGAAAGGTTTC GTTAAAGGAAAAGGCATCAAAGTTGAGAAGAAACTTCGTGTCTTAAACTACGCACAAGAAATCAAACCTGAATCTGAATT CGTATTCGAGCAAGGCGTTCCTGTTTCAGGAATCCGCGTTCAACCAGTTCTCTTCGCAGACGGCGTTGTATACAACAAGC CACTCTTCGTTGCTGGTTTCAGCACTGAGAAAGTTGGAGAGTTCGAAGGAACACTCACTTACTCAAACAAAGCTTACGGT TCTGTAACAAAAACTGTTAAGTACAAAGTAGTTGCTACTAAAGTAGCATTCTCTGAAGTGAAGCACGAAGTGAAAGACGA CATGTTGTCTGTCTCTGCTGACGTGAAGAACCTCAAAGAAGGCGAAAAAGTTGAACTCGTAATCTTCCCAGGAAAAGACG AGTCGAAAGCACTCGCTCCGATCACAGCTGAAATCAAAGACGGTAAAGTCATGGTTTCTGCAAAAGAAATCCCAGCTGGT ACTCATTCATTCATCCTTCGCTCTGGCGATGTGAAGACTGCAGCTATGGAATTCAAAGTTGAAGATCAAACGCCGATGGT TAAAGAAGTAAAAGCTCTTAACTTGAAGCAAGTTGAAGTTAAATTCAACAAAGATCTTGACAAAGCATCTGCTGAAACAC TTACAAACTATGAGTTGAAAATCGGTTCTGCTGCAGCAACGAACCCAACGGCTGCTGAAGTGACTTCAGAAGGAACAGTT CTTCTTACGTTCGCTGAAAAAGGTCAATCTACAGATGCTAAACTCACTGTTAAAAACGTGAAAACTGCGAAAAACATCGT GGTTGCTGAAACTACTAAAGAAGTTCGTTTCCTCGATGTAGTTGCTCCAACGGTCGGTGAAATCTCGATCGTAGCGCCGC GTGTCATCCGCGTTAACTTCTCTGAACCATTAAAAGAAGCTCCTTCGTTCAAATTGAACAACGGACAGACAGCAATCGTG TCAACTTCTTGGTCTGCAGGTCAAGACTACGCTGACCTCACAATCGGTATTGATCCAGAAAACGGTTCATCACATTCACT TGAAATCTCTGGTGGAGCTGATTACGCTGGATTCAAAATTGATGCTGTAACGAAATCATTTGTTTATCAAACGGATGCTA CTGCACCAAAAGCAATGATTTCAAAAGTTGTGGATAACGACACTGTGGAAATCAAGTTTGATAAAGAAATCAATGCTTCA ACATTGACTTCAAACCTTGAGATCTACCACACAGTTAAAGGTGCATCTGGATACAAAGCATCAGCAGTAACTTCAATTAA ACCAGGTACTACTGATACGATTGTAGTTAACTTCCCAGTAGTCTTCCCTGAAGGCCAAGTGAAATTCTTCTTGGGCTACG CTGATGACAAAGGCACGCTTGTTCAAGACAAGTGGGGTAACAAACTTGCTGCAACTGAATTGTCTGCTGTATACGCGGCT GACACAGTAGCACCGACACTCGTATCGGTAGAAGGCAAAACAAAACGTACAATCGAAGTGAAATTCAACGAAGCAGTAAC AGAAGCTTCAGCTGAATTGGCAGGAAACATTGTTCTTACTGACGCTGACAACAAGGTTGTTGCACAATCTGCAGCACTTG GTGAAGATGGCAAAACAGTAACATTGACTGCAACTGCTGACCTTGCTGGTGGAAACTACAAAGTGACTGTGAAGAATGTT GTCGATGCTTCGAACAACAAGATTGCTGAAGTGTCACGTACGTTCTACGTCAATGACATGGTTGCTCCAACAGTAAATGG AACAGCTGATCTCTTGGCTGGAAATAAGAAAGTAAAAATTAAGTTCAGCGAAGCAATGAACGCTGCTTCAATCACAGACA AGTCGAAATACAAACTTGGTACTGCTGATCTTGATTCGAAAGTTACGATTACAGCTGTTGACGGTAACAAAGCGGTTATC CTTGACTTCTCTGCTACTAACGAAACATCACTTGCCAATGCTGAAATTACAGTTGGACGTGTAGCAGATGCGACTGGTAA CTTAACAGCTGACTTCTCAAACCTTGTTACAGTTGCTTCAGCTCAGTCTACAGTAGCGGCTACAAAAGCAGAAGTAACTG GAAAACGTTCGGTTAAACTTTACTTCGACGAAGTAATCACTGGCGCAGTTGCTGGAGACTTTGTAGTCTATAACGATACT ACACCTGTGACAGTATCGAACTTGGTGAACTCAATCGAAGCTGGTAAATCAGTACTTACATTGACTGTATCTTCTGATCT TCCATTCGATGCTGAGGATATCACAGTAGATTCTGTTGGAACTACAAGTGCGAAAAACAACGATGGCCTTCTTGTGAACT TTGCAGATCTCGAAGCATCTGACAAATATGCTCCAGAAATTTCGACTGCTGTGTTCACAAACGGTGGAACTGCAGACGCA CAAGATAGCTTAGTTCTTACTTTCTCTGAAGCATTGTACGCTCCTTCAGTTCAAGACTCAGACTTCACAGTCGCAGGTCG CGTTGTAGAAGCAATCTCTGTGAATGGTGCTGCTGGAACTGTAACACTTATGCTTAAAGAAGATGGCTCTGCAACAAGTG CTAAACCAGCATCAGTTTCAATCGTAAACATGGTTGAAGATGCAGCGCGTAACGCGAAGTCTTCACAAGTCTTCACAGCA ATCACTCCTGAATAA
Upstream 100 bases:
>100_bases TTAGTACTTTATTCATTGTTATGGATACATGACTCCGAACGAGATCGGTTGGGCAAGGACGGTAGAAAAACCTATCTACC TAAGGGAGGATTTACATCAG
Downstream 100 bases:
>100_bases AAACAAACGAAACGTTGTCCGCTAACTCGAGGTCTAATTGACCTCGAGGATCCGGACCGGATAATTCCGAACTATCATGT TGAATTGAATGGTGTGACTC
Product: hypothetical protein
Products: NA
Alternate protein names: OWP [H]
Number of amino acids: Translated: 964; Mature: 963
Protein sequence:
>964_residues MAKKKQFVTAAAAFAVAASAVAPAITADAASSTVRLSSDYVRGGDLDAALDKEYKGSEIYWYKSSIDMNKLGVFQTAKGF VKGKGIKVEKKLRVLNYAQEIKPESEFVFEQGVPVSGIRVQPVLFADGVVYNKPLFVAGFSTEKVGEFEGTLTYSNKAYG SVTKTVKYKVVATKVAFSEVKHEVKDDMLSVSADVKNLKEGEKVELVIFPGKDESKALAPITAEIKDGKVMVSAKEIPAG THSFILRSGDVKTAAMEFKVEDQTPMVKEVKALNLKQVEVKFNKDLDKASAETLTNYELKIGSAAATNPTAAEVTSEGTV LLTFAEKGQSTDAKLTVKNVKTAKNIVVAETTKEVRFLDVVAPTVGEISIVAPRVIRVNFSEPLKEAPSFKLNNGQTAIV STSWSAGQDYADLTIGIDPENGSSHSLEISGGADYAGFKIDAVTKSFVYQTDATAPKAMISKVVDNDTVEIKFDKEINAS TLTSNLEIYHTVKGASGYKASAVTSIKPGTTDTIVVNFPVVFPEGQVKFFLGYADDKGTLVQDKWGNKLAATELSAVYAA DTVAPTLVSVEGKTKRTIEVKFNEAVTEASAELAGNIVLTDADNKVVAQSAALGEDGKTVTLTATADLAGGNYKVTVKNV VDASNNKIAEVSRTFYVNDMVAPTVNGTADLLAGNKKVKIKFSEAMNAASITDKSKYKLGTADLDSKVTITAVDGNKAVI LDFSATNETSLANAEITVGRVADATGNLTADFSNLVTVASAQSTVAATKAEVTGKRSVKLYFDEVITGAVAGDFVVYNDT TPVTVSNLVNSIEAGKSVLTLTVSSDLPFDAEDITVDSVGTTSAKNNDGLLVNFADLEASDKYAPEISTAVFTNGGTADA QDSLVLTFSEALYAPSVQDSDFTVAGRVVEAISVNGAAGTVTLMLKEDGSATSAKPASVSIVNMVEDAARNAKSSQVFTA ITPE
Sequences:
>Translated_964_residues MAKKKQFVTAAAAFAVAASAVAPAITADAASSTVRLSSDYVRGGDLDAALDKEYKGSEIYWYKSSIDMNKLGVFQTAKGF VKGKGIKVEKKLRVLNYAQEIKPESEFVFEQGVPVSGIRVQPVLFADGVVYNKPLFVAGFSTEKVGEFEGTLTYSNKAYG SVTKTVKYKVVATKVAFSEVKHEVKDDMLSVSADVKNLKEGEKVELVIFPGKDESKALAPITAEIKDGKVMVSAKEIPAG THSFILRSGDVKTAAMEFKVEDQTPMVKEVKALNLKQVEVKFNKDLDKASAETLTNYELKIGSAAATNPTAAEVTSEGTV LLTFAEKGQSTDAKLTVKNVKTAKNIVVAETTKEVRFLDVVAPTVGEISIVAPRVIRVNFSEPLKEAPSFKLNNGQTAIV STSWSAGQDYADLTIGIDPENGSSHSLEISGGADYAGFKIDAVTKSFVYQTDATAPKAMISKVVDNDTVEIKFDKEINAS TLTSNLEIYHTVKGASGYKASAVTSIKPGTTDTIVVNFPVVFPEGQVKFFLGYADDKGTLVQDKWGNKLAATELSAVYAA DTVAPTLVSVEGKTKRTIEVKFNEAVTEASAELAGNIVLTDADNKVVAQSAALGEDGKTVTLTATADLAGGNYKVTVKNV VDASNNKIAEVSRTFYVNDMVAPTVNGTADLLAGNKKVKIKFSEAMNAASITDKSKYKLGTADLDSKVTITAVDGNKAVI LDFSATNETSLANAEITVGRVADATGNLTADFSNLVTVASAQSTVAATKAEVTGKRSVKLYFDEVITGAVAGDFVVYNDT TPVTVSNLVNSIEAGKSVLTLTVSSDLPFDAEDITVDSVGTTSAKNNDGLLVNFADLEASDKYAPEISTAVFTNGGTADA QDSLVLTFSEALYAPSVQDSDFTVAGRVVEAISVNGAAGTVTLMLKEDGSATSAKPASVSIVNMVEDAARNAKSSQVFTA ITPE >Mature_963_residues AKKKQFVTAAAAFAVAASAVAPAITADAASSTVRLSSDYVRGGDLDAALDKEYKGSEIYWYKSSIDMNKLGVFQTAKGFV KGKGIKVEKKLRVLNYAQEIKPESEFVFEQGVPVSGIRVQPVLFADGVVYNKPLFVAGFSTEKVGEFEGTLTYSNKAYGS VTKTVKYKVVATKVAFSEVKHEVKDDMLSVSADVKNLKEGEKVELVIFPGKDESKALAPITAEIKDGKVMVSAKEIPAGT HSFILRSGDVKTAAMEFKVEDQTPMVKEVKALNLKQVEVKFNKDLDKASAETLTNYELKIGSAAATNPTAAEVTSEGTVL LTFAEKGQSTDAKLTVKNVKTAKNIVVAETTKEVRFLDVVAPTVGEISIVAPRVIRVNFSEPLKEAPSFKLNNGQTAIVS TSWSAGQDYADLTIGIDPENGSSHSLEISGGADYAGFKIDAVTKSFVYQTDATAPKAMISKVVDNDTVEIKFDKEINAST LTSNLEIYHTVKGASGYKASAVTSIKPGTTDTIVVNFPVVFPEGQVKFFLGYADDKGTLVQDKWGNKLAATELSAVYAAD TVAPTLVSVEGKTKRTIEVKFNEAVTEASAELAGNIVLTDADNKVVAQSAALGEDGKTVTLTATADLAGGNYKVTVKNVV DASNNKIAEVSRTFYVNDMVAPTVNGTADLLAGNKKVKIKFSEAMNAASITDKSKYKLGTADLDSKVTITAVDGNKAVIL DFSATNETSLANAEITVGRVADATGNLTADFSNLVTVASAQSTVAATKAEVTGKRSVKLYFDEVITGAVAGDFVVYNDTT PVTVSNLVNSIEAGKSVLTLTVSSDLPFDAEDITVDSVGTTSAKNNDGLLVNFADLEASDKYAPEISTAVFTNGGTADAQ DSLVLTFSEALYAPSVQDSDFTVAGRVVEAISVNGAAGTVTLMLKEDGSATSAKPASVSIVNMVEDAARNAKSSQVFTAI TPE
Specific function: The outer wall protein binds to the middle cell wall protein [H]
COG id: NA
COG function: NA
Gene ontology:
Cell location: Secreted, cell wall, S-layer. Note=This bacterium is covered by a S-layer with hexagonal symmetry [H]
Metaboloic importance: NA
Operon status: Not Known
Operon components: None
Similarity: NA
Homologues:
None
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
NA
Pfam domain/function: NA
EC number: NA
Molecular weight: Translated: 101689; Mature: 101558
Theoretical pI: Translated: 4.80; Mature: 4.80
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.0 %Cys (Translated Protein) 1.1 %Met (Translated Protein) 1.1 %Cys+Met (Translated Protein) 0.0 %Cys (Mature Protein) 1.0 %Met (Mature Protein) 1.0 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MAKKKQFVTAAAAFAVAASAVAPAITADAASSTVRLSSDYVRGGDLDAALDKEYKGSEIY CCCHHHHHHHHHHHHHHHHHHCCEEECCCCCCEEEECCCCCCCCCCCHHHCCCCCCCEEE WYKSSIDMNKLGVFQTAKGFVKGKGIKVEKKLRVLNYAQEIKPESEFVFEQGVPVSGIRV EEECCCCHHHCCEEHHCCCCEECCCEEHHHHHHHHHHHHHCCCCHHHHHHCCCCCCCEEE QPVLFADGVVYNKPLFVAGFSTEKVGEFEGTLTYSNKAYGSVTKTVKYKVVATKVAFSEV EEEEEECCEEECCCEEEEECCCCCCCCCCCEEEECCCCCCCEEEEEEEEEEEEHHHHHHH KHEVKDDMLSVSADVKNLKEGEKVELVIFPGKDESKALAPITAEIKDGKVMVSAKEIPAG HHHHHHHHHHHHHHHHHCCCCCEEEEEEECCCCCCCEECEEEEEECCCEEEEEECCCCCC THSFILRSGDVKTAAMEFKVEDQTPMVKEVKALNLKQVEVKFNKDLDKASAETLTNYELK CCEEEEECCCCEEEEEEEEECCCCCHHHHHHHCCEEEEEEEECCCCCHHHHHHEEEEEEE IGSAAATNPTAAEVTSEGTVLLTFAEKGQSTDAKLTVKNVKTAKNIVVAETTKEVRFLDV ECCCCCCCCCHHEECCCCEEEEEEECCCCCCCCEEEEEECCCCCEEEEEECCCCEEEEEE VAPTVGEISIVAPRVIRVNFSEPLKEAPSFKLNNGQTAIVSTSWSAGQDYADLTIGIDPE ECCCCCCEEEECCEEEEEECCHHHHHCCCEEECCCCEEEEEECCCCCCCCEEEEEEECCC NGSSHSLEISGGADYAGFKIDAVTKSFVYQTDATAPKAMISKVVDNDTVEIKFDKEINAS CCCCEEEEECCCCCCCCEEEEEECEEEEEECCCCCHHHHHHHHHCCCEEEEEECCCCCCC TLTSNLEIYHTVKGASGYKASAVTSIKPGTTDTIVVNFPVVFPEGQVKFFLGYADDKGTL CEECCEEEEEEECCCCCCCCEEEEEECCCCCCEEEEEEEEEECCCCEEEEEEEECCCCCE VQDKWGNKLAATELSAVYAADTVAPTLVSVEGKTKRTIEVKFNEAVTEASAELAGNIVLT EECCCCCEEEHHHHHHHEECCCCCCEEEEECCCCEEEEEEEECHHHHHHHHHHCCCEEEE DADNKVVAQSAALGEDGKTVTLTATADLAGGNYKVTVKNVVDASNNKIAEVSRTFYVNDM CCCCCEEEEHHCCCCCCCEEEEEEEEECCCCCEEEEEEEEECCCCCEEEEEEEEEEEECE VAPTVNGTADLLAGNKKVKIKFSEAMNAASITDKSKYKLGTADLDSKVTITAVDGNKAVI ECCCCCCCHHHCCCCEEEEEEEHHCCCCCCCCCCCCEEECCCCCCCEEEEEEECCCEEEE LDFSATNETSLANAEITVGRVADATGNLTADFSNLVTVASAQSTVAATKAEVTGKRSVKL EEECCCCCCCCCCCEEEEEEEECCCCCEEECCHHEEEEECCCCHHEEEEEECCCCCEEEE YFDEVITGAVAGDFVVYNDTTPVTVSNLVNSIEAGKSVLTLTVSSDLPFDAEDITVDSVG EEHHHHHHHEECCEEEECCCCCEEHHHHHHHHHCCCEEEEEEEECCCCCCCCCEEEECCC TTSAKNNDGLLVNFADLEASDKYAPEISTAVFTNGGTADAQDSLVLTFSEALYAPSVQDS CCCCCCCCCEEEEEECCCCCCCCCCCCEEEEEECCCCCCCCCCEEEEEEHHHCCCCCCCC DFTVAGRVVEAISVNGAAGTVTLMLKEDGSATSAKPASVSIVNMVEDAARNAKSSQVFTA CEEEECEEEEEEEECCCCEEEEEEEECCCCCCCCCCCEEEEHHHHHHHHCCCCCCEEEEE ITPE ECCC >Mature Secondary Structure AKKKQFVTAAAAFAVAASAVAPAITADAASSTVRLSSDYVRGGDLDAALDKEYKGSEIY CCHHHHHHHHHHHHHHHHHHCCEEECCCCCCEEEECCCCCCCCCCCHHHCCCCCCCEEE WYKSSIDMNKLGVFQTAKGFVKGKGIKVEKKLRVLNYAQEIKPESEFVFEQGVPVSGIRV EEECCCCHHHCCEEHHCCCCEECCCEEHHHHHHHHHHHHHCCCCHHHHHHCCCCCCCEEE QPVLFADGVVYNKPLFVAGFSTEKVGEFEGTLTYSNKAYGSVTKTVKYKVVATKVAFSEV EEEEEECCEEECCCEEEEECCCCCCCCCCCEEEECCCCCCCEEEEEEEEEEEEHHHHHHH KHEVKDDMLSVSADVKNLKEGEKVELVIFPGKDESKALAPITAEIKDGKVMVSAKEIPAG HHHHHHHHHHHHHHHHHCCCCCEEEEEEECCCCCCCEECEEEEEECCCEEEEEECCCCCC THSFILRSGDVKTAAMEFKVEDQTPMVKEVKALNLKQVEVKFNKDLDKASAETLTNYELK CCEEEEECCCCEEEEEEEEECCCCCHHHHHHHCCEEEEEEEECCCCCHHHHHHEEEEEEE IGSAAATNPTAAEVTSEGTVLLTFAEKGQSTDAKLTVKNVKTAKNIVVAETTKEVRFLDV ECCCCCCCCCHHEECCCCEEEEEEECCCCCCCCEEEEEECCCCCEEEEEECCCCEEEEEE VAPTVGEISIVAPRVIRVNFSEPLKEAPSFKLNNGQTAIVSTSWSAGQDYADLTIGIDPE ECCCCCCEEEECCEEEEEECCHHHHHCCCEEECCCCEEEEEECCCCCCCCEEEEEEECCC NGSSHSLEISGGADYAGFKIDAVTKSFVYQTDATAPKAMISKVVDNDTVEIKFDKEINAS CCCCEEEEECCCCCCCCEEEEEECEEEEEECCCCCHHHHHHHHHCCCEEEEEECCCCCCC TLTSNLEIYHTVKGASGYKASAVTSIKPGTTDTIVVNFPVVFPEGQVKFFLGYADDKGTL CEECCEEEEEEECCCCCCCCEEEEEECCCCCCEEEEEEEEEECCCCEEEEEEEECCCCCE VQDKWGNKLAATELSAVYAADTVAPTLVSVEGKTKRTIEVKFNEAVTEASAELAGNIVLT EECCCCCEEEHHHHHHHEECCCCCCEEEEECCCCEEEEEEEECHHHHHHHHHHCCCEEEE DADNKVVAQSAALGEDGKTVTLTATADLAGGNYKVTVKNVVDASNNKIAEVSRTFYVNDM CCCCCEEEEHHCCCCCCCEEEEEEEEECCCCCEEEEEEEEECCCCCEEEEEEEEEEEECE VAPTVNGTADLLAGNKKVKIKFSEAMNAASITDKSKYKLGTADLDSKVTITAVDGNKAVI ECCCCCCCHHHCCCCEEEEEEEHHCCCCCCCCCCCCEEECCCCCCCEEEEEEECCCEEEE LDFSATNETSLANAEITVGRVADATGNLTADFSNLVTVASAQSTVAATKAEVTGKRSVKL EEECCCCCCCCCCCEEEEEEEECCCCCEEECCHHEEEEECCCCHHEEEEEECCCCCEEEE YFDEVITGAVAGDFVVYNDTTPVTVSNLVNSIEAGKSVLTLTVSSDLPFDAEDITVDSVG EEHHHHHHHEECCEEEECCCCCEEHHHHHHHHHCCCEEEEEEEECCCCCCCCCEEEECCC TTSAKNNDGLLVNFADLEASDKYAPEISTAVFTNGGTADAQDSLVLTFSEALYAPSVQDS CCCCCCCCCEEEEEECCCCCCCCCCCCEEEEEECCCCCCCCCCEEEEEEHHHCCCCCCCC DFTVAGRVVEAISVNGAAGTVTLMLKEDGSATSAKPASVSIVNMVEDAARNAKSSQVFTA CEEEECEEEEEEEECCCCEEEEEEEECCCCCCCCCCCEEEEHHHHHHHHCCCCCCEEEEE ITPE ECCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 2428810; 2828336 [H]