Definition Mycobacterium sp. MCS chromosome, complete genome.
Accession NC_008146
Length 5,705,448

Click here to switch to the map view.

The map label for this gene is espB [H]

Identifier: 108797057

GI number: 108797057

Start: 87765

End: 89366

Strand: Reverse

Name: espB [H]

Synonym: Mmcs_0076

Alternate gene names: 108797057

Gene position: 89366-87765 (Counterclockwise)

Preceding gene: 108797058

Following gene: 108797056

Centisome position: 1.57

GC content: 74.22

Gene sequence:

>1602_bases
ATGGCGGGGGACGAAGTCCGAGTCGAACCTGCGGATCTGCGGGCTCGAGCCACCACCCTGGACGAGGAGATCACCGACGA
GTCACAGCGGCCCACACCGCCGTGCGGCCTCCCGTTCGTCACGGCGTCGGCGGCCGGCATCGCGGCCGGTTCGGACACGC
TGCGCAGCCACCTGATCTCCGGCAACCGCGAAGCCGAACGGCTCGCCGCGGTGCTGTCCGAGGCGGCCGACGTCTACCAG
CAGATCGACAACCGCGCGGCCCAGGCGCTGGAGTACCCCGACGGACCACGCTCGGTGGAGCCGGTCCCGGTCAACCCCAC
ACTGCCGCCGTCGGTCCCGCCGATCGAATTCCCCGCCACGGTGCCCGCGGTCCCGGGCGGCCAGACCGACGCCGGCTTCA
TGGATGTGAAGGCCGCCGCGCAGATCATCCACTCCGGCGACTCGGGCCCGATGCGGACCTACGGGGAACAGGCGAAGAAG
TTCGCCGGGACGCTGCGCGACAGGGCCGCATCCTTCAACCTCGACGGCATCAACTGGGACGGCACCGCCGCCGAGAAGGC
CGGCGACGCGGTCCGTCAGCACAAGGAGTGGCTGGAGAAGCTGGCCGAGAGTTACGAATTCCTCGGCACCGAGGCGATCG
ACATGGCCGATGCGCACGACAAGTGGTCGGGTCAGCACCCGACCGTTGCGGAGGTCGAGGCGGTCGAGGCCAGGGTGGCG
CAGGCCGGTCAGGCGGGCGACAAGGACGCGCTCGCCAGGGCCATGATGGATTACCTTGCGCTGCAGCGGAAGTCCGAAGA
CGTCCGGACCAGCTACAGCGCCGACGTCGCCGGTAAGAGCCTGCCCAAGGTGCTCGACCCGCCACCGGGAGCAGCGCCGG
TACCGCCGATCAGCAGCAACGGCGATCCGCGGAAGGGGAAGATCCAGCCGGCCGGTGAGGGTGCACCTGGTGAACCCGGC
TCCGGCGGCGGCGCCCAACCCGGCGGCCGGCCCGGTGCGCAGCCCGGCGGTCAGGCCGCGGCGGCGCCGATGGGCGGGGG
GTCTCCCGCCGGACAGGGCGGCGCTCAGCCCGCGGGCGCCTCATCCGGCGGCGGCGGTTCACCGTCGGGAGGCGGCGGCT
CTCCCGCCGGTGGCGGTGGCGCCCCGGCCGCACCGGCTGCCGGTGGTGGCCTACCGGGCGGCCTGCCCGGTGGCGGCCCG
GACGGGCTGCCTCCGCTGGACGACCCCGCGCTGAAGCCGGCCGCCGCGAGCGGTGGCGGCGCCGGTGGTGGCTCGGGTGG
TGGAGCCGGCGGCGGTGGCGGCGGGGTCCCACCCTCCCCGCTGCAGCCCGCTGTCGGAGCCGAGACCGTCGCCCCCGGGG
CGGCCGGGACGGGGCGCGCCGGTGCCGCCGCGGCCGGCCCGGCCGGTGCCATGGGTGCGATGGGGGGTATGGGCGGTATG
CCGATGGGTGGCCACGGCGCGGGCCGCGGTCAGGGTGGCGGCGAGAAGAAGCGCACGCCCGGCCTGGCACCGGACGAGGA
TCTCTACGTCGAGGACCGTCCGTTCACCGAATCCGTCATCGGCTACACGCCCAAGCCGCGGGATCGGAAGGACTCGAAGT
GA

Upstream 100 bases:

>100_bases
TGATCAACCCGCGCGAGGAAAGCCGCTACCAGATGGCACTCGAGCAGTGACCACCTGTTGGCCGGCCGCCCCGACACCGC
GGTGACCTGAGGAGGAAGAC

Downstream 100 bases:

>100_bases
GCGGCGAGATGCACCCGCAGGTGGCGGCGGTCCTCGCCCAGGCCCAGCAACTGCAGTCGATCATGGACGAGCAGCTACAC
AAGATGAAGCACCAGACGTT

Product: hypothetical protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 533; Mature: 532

Protein sequence:

>533_residues
MAGDEVRVEPADLRARATTLDEEITDESQRPTPPCGLPFVTASAAGIAAGSDTLRSHLISGNREAERLAAVLSEAADVYQ
QIDNRAAQALEYPDGPRSVEPVPVNPTLPPSVPPIEFPATVPAVPGGQTDAGFMDVKAAAQIIHSGDSGPMRTYGEQAKK
FAGTLRDRAASFNLDGINWDGTAAEKAGDAVRQHKEWLEKLAESYEFLGTEAIDMADAHDKWSGQHPTVAEVEAVEARVA
QAGQAGDKDALARAMMDYLALQRKSEDVRTSYSADVAGKSLPKVLDPPPGAAPVPPISSNGDPRKGKIQPAGEGAPGEPG
SGGGAQPGGRPGAQPGGQAAAAPMGGGSPAGQGGAQPAGASSGGGGSPSGGGGSPAGGGGAPAAPAAGGGLPGGLPGGGP
DGLPPLDDPALKPAAASGGGAGGGSGGGAGGGGGGVPPSPLQPAVGAETVAPGAAGTGRAGAAAAGPAGAMGAMGGMGGM
PMGGHGAGRGQGGGEKKRTPGLAPDEDLYVEDRPFTESVIGYTPKPRDRKDSK

Sequences:

>Translated_533_residues
MAGDEVRVEPADLRARATTLDEEITDESQRPTPPCGLPFVTASAAGIAAGSDTLRSHLISGNREAERLAAVLSEAADVYQ
QIDNRAAQALEYPDGPRSVEPVPVNPTLPPSVPPIEFPATVPAVPGGQTDAGFMDVKAAAQIIHSGDSGPMRTYGEQAKK
FAGTLRDRAASFNLDGINWDGTAAEKAGDAVRQHKEWLEKLAESYEFLGTEAIDMADAHDKWSGQHPTVAEVEAVEARVA
QAGQAGDKDALARAMMDYLALQRKSEDVRTSYSADVAGKSLPKVLDPPPGAAPVPPISSNGDPRKGKIQPAGEGAPGEPG
SGGGAQPGGRPGAQPGGQAAAAPMGGGSPAGQGGAQPAGASSGGGGSPSGGGGSPAGGGGAPAAPAAGGGLPGGLPGGGP
DGLPPLDDPALKPAAASGGGAGGGSGGGAGGGGGGVPPSPLQPAVGAETVAPGAAGTGRAGAAAAGPAGAMGAMGGMGGM
PMGGHGAGRGQGGGEKKRTPGLAPDEDLYVEDRPFTESVIGYTPKPRDRKDSK
>Mature_532_residues
AGDEVRVEPADLRARATTLDEEITDESQRPTPPCGLPFVTASAAGIAAGSDTLRSHLISGNREAERLAAVLSEAADVYQQ
IDNRAAQALEYPDGPRSVEPVPVNPTLPPSVPPIEFPATVPAVPGGQTDAGFMDVKAAAQIIHSGDSGPMRTYGEQAKKF
AGTLRDRAASFNLDGINWDGTAAEKAGDAVRQHKEWLEKLAESYEFLGTEAIDMADAHDKWSGQHPTVAEVEAVEARVAQ
AGQAGDKDALARAMMDYLALQRKSEDVRTSYSADVAGKSLPKVLDPPPGAAPVPPISSNGDPRKGKIQPAGEGAPGEPGS
GGGAQPGGRPGAQPGGQAAAAPMGGGSPAGQGGAQPAGASSGGGGSPSGGGGSPAGGGGAPAAPAAGGGLPGGLPGGGPD
GLPPLDDPALKPAAASGGGAGGGSGGGAGGGGGGVPPSPLQPAVGAETVAPGAAGTGRAGAAAAGPAGAMGAMGGMGGMP
MGGHGAGRGQGGGEKKRTPGLAPDEDLYVEDRPFTESVIGYTPKPRDRKDSK

Specific function: Unknown

COG id: NA

COG function: NA

Gene ontology:

Cell location: Secreted. Note=Secreted via the ESX-1 / type VII secretion system (T7SS) [H]

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 52002; Mature: 51870

Theoretical pI: Translated: 4.62; Mature: 4.62

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.2 %Cys     (Translated Protein)
2.3 %Met     (Translated Protein)
2.4 %Cys+Met (Translated Protein)
0.2 %Cys     (Mature Protein)
2.1 %Met     (Mature Protein)
2.3 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MAGDEVRVEPADLRARATTLDEEITDESQRPTPPCGLPFVTASAAGIAAGSDTLRSHLIS
CCCCCEEECHHHHHHHHHHHHHHHHCCCCCCCCCCCCCHHHHCCHHCCCCHHHHHHHHHC
GNREAERLAAVLSEAADVYQQIDNRAAQALEYPDGPRSVEPVPVNPTLPPSVPPIEFPAT
CCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
VPAVPGGQTDAGFMDVKAAAQIIHSGDSGPMRTYGEQAKKFAGTLRDRAASFNLDGINWD
CCCCCCCCCCCCHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCC
GTAAEKAGDAVRQHKEWLEKLAESYEFLGTEAIDMADAHDKWSGQHPTVAEVEAVEARVA
CCHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHCCCCCCCCCCCCCHHHHHHHHHHHH
QAGQAGDKDALARAMMDYLALQRKSEDVRTSYSADVAGKSLPKVLDPPPGAAPVPPISSN
HHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHCCCCCCCCCCCCCCCC
GDPRKGKIQPAGEGAPGEPGSGGGAQPGGRPGAQPGGQAAAAPMGGGSPAGQGGAQPAGA
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
SSGGGGSPSGGGGSPAGGGGAPAAPAAGGGLPGGLPGGGPDGLPPLDDPALKPAAASGGG
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
AGGGSGGGAGGGGGGVPPSPLQPAVGAETVAPGAAGTGRAGAAAAGPAGAMGAMGGMGGM
CCCCCCCCCCCCCCCCCCCCCCCCCCCHHCCCCCCCCCCCCCCCCCCCHHHHHHCCCCCC
PMGGHGAGRGQGGGEKKRTPGLAPDEDLYVEDRPFTESVIGYTPKPRDRKDSK
CCCCCCCCCCCCCCCCCCCCCCCCCCCCEECCCCCHHHHHCCCCCCCCCCCCC
>Mature Secondary Structure 
AGDEVRVEPADLRARATTLDEEITDESQRPTPPCGLPFVTASAAGIAAGSDTLRSHLIS
CCCCEEECHHHHHHHHHHHHHHHHCCCCCCCCCCCCCHHHHCCHHCCCCHHHHHHHHHC
GNREAERLAAVLSEAADVYQQIDNRAAQALEYPDGPRSVEPVPVNPTLPPSVPPIEFPAT
CCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
VPAVPGGQTDAGFMDVKAAAQIIHSGDSGPMRTYGEQAKKFAGTLRDRAASFNLDGINWD
CCCCCCCCCCCCHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCC
GTAAEKAGDAVRQHKEWLEKLAESYEFLGTEAIDMADAHDKWSGQHPTVAEVEAVEARVA
CCHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHCCCCCCCCCCCCCHHHHHHHHHHHH
QAGQAGDKDALARAMMDYLALQRKSEDVRTSYSADVAGKSLPKVLDPPPGAAPVPPISSN
HHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHCCCCCCCCCCCCCCCC
GDPRKGKIQPAGEGAPGEPGSGGGAQPGGRPGAQPGGQAAAAPMGGGSPAGQGGAQPAGA
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
SSGGGGSPSGGGGSPAGGGGAPAAPAAGGGLPGGLPGGGPDGLPPLDDPALKPAAASGGG
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
AGGGSGGGAGGGGGGVPPSPLQPAVGAETVAPGAAGTGRAGAAAAGPAGAMGAMGGMGGM
CCCCCCCCCCCCCCCCCCCCCCCCCCCHHCCCCCCCCCCCCCCCCCCCHHHHHHCCCCCC
PMGGHGAGRGQGGGEKKRTPGLAPDEDLYVEDRPFTESVIGYTPKPRDRKDSK
CCCCCCCCCCCCCCCCCCCCCCCCCCCCEECCCCCHHHHHCCCCCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA