Definition Geobacillus thermodenitrificans NG80-2 chromosome, complete genome.
Accession NC_009328
Length 3,550,319

Click here to switch to the map view.

The map label for this gene is expZ [H]

Identifier: 138895227

GI number: 138895227

Start: 1651812

End: 1653386

Strand: Direct

Name: expZ [H]

Synonym: GTNG_1567

Alternate gene names: 138895227

Gene position: 1651812-1653386 (Clockwise)

Preceding gene: 138895226

Following gene: 138895228

Centisome position: 46.53

GC content: 44.38

Gene sequence:

>1575_bases
ATGATTCTTCTAGAAGCGTTCAATATCAAACATTATGTGAAAGACCGGTTATTACTTGATGTCGATCGATTGACCATTTA
TAAAAATGACCGCATCGGTTTAGTGGGGCGTAATGGCAGCGGCAAGACGACATTGTTAAACATATTGGCAGGAATGATTG
CCCCAGAAAAGGGAAGCGTGATTCGCCATGCTCGATGCGAATTGTTGCCACAGTTAAAGCAGATGGACACTACGAAAAGC
GGCGGAGAAGTGACACAGGCCTATATTCGCGATTTGATGACTAAAGACCCGGAGCTTTTGTTGGCGGACGAACCAACGAC
CCATTTAGATCAAGAGCATATCGAATGGCTAGAAAAGCAGTTACAGCAATGGAAGGGAGCGTTTATCCTCGTATCACACG
ACCGGGCGTTTCTCGATGCGCTTTGCACCACCATCTGGGAAGTTCATGAAGGGAAGGTCAAAGAGTATAAAGGGCGTTAC
AGCGACTATGTGGAACAAAGAGAACAGGAACGCCGACAGCAACAGTTAGCTTATGAAAATTATGAAAAAAAGAAACAAGC
GCTAGAGAGAGCATTGGAACTAAAAAAGCGAAAAGCGGAAAGAGCCACAAAAGTTTCCGGAAAGAAGGTGAGCCCATCGG
AAGCGAAAATCACCGGGGCGAAGCCGTATTTTGCGAAAAAGCAAAAAAAGTTGCAAAAAGCAGCCAAAGCCATCGAAACA
AGATTAGAGAAACTAGAAAAAGTGGAAAAAATAAAGGAACTGGCTCCCATCAAAATGAACTTGCCTAACGAGGATACGTT
TAAAGATCGAATCATTATTCGAGCGCAAGAGGTCGCAGGCGTGATCGGCCAACGTGTTCTATGGAATAAAGCGAGCTTTC
ATGTACGTGGGGGCGAGAAGCTCGCGATTATCGGCCCGAATGGGAGCGGCAAAACTACTTTAGTGAAAAAGATCGTTGAC
CAAGAAGAAGGAATTATAGTTTCCCCAGCGGTGAAAATGGGGTATTTTAGCCAAAACTTAAATATTTTAGATGTTCATCA
GTCGATTTTGGAGAATGTACGCTCCACATCGAAACAAGATGAAACGCTTATTCGCACCGTCTTGGCGAGGCTGCATTTCT
TCCGAGATGATGTTTATAAACCCGTAGGAGTTTTAAGCGGCGGTGAGCGGGTAAAAGTCGCGCTTGCTAAATTATTCGTC
AGTGATATCAATACGCTCATTTTAGATGAACCGACAAACTTCCTCGATATTGAAGCGATGAGCGCATTGGAATCGCTATT
GCAAGAATACGAAGGAACCGTCATTTTCGTATCCCACGACCGTCGGTTCATTGAGAATGTCGCTACACGTATATTGGTGA
TTCGCCATAAAGAAATTCAACTGTTTGACGGAACATATAAACAATATAAGCAGCAAAAACATCGCGATACGCGCAATACG
ACAGAAGACGAGCGGCTTTTACTTGAGACGAAAATAGCAGAGGTGCTGAGCCGCTTGAGCATTGAGCCAAACGAAGAGCT
TGAACAGGAATTTCAGCGGCTTTTGGCGGAAAAACGAAAACTGGGCATGTCATGA

Upstream 100 bases:

>100_bases
AGTCTCTTTTTTTTGGCGTCCTGCTATAGTTGTGCCTCCTATTCTGAAAATGGATAGGGGGCTTTTTTGTCCCCGTAAAA
TCAAAAATGGGGATGATCAT

Downstream 100 bases:

>100_bases
AGCACATATGGGCAACCACAGGCATTAGGACGATTCCTAATGCCTGTTTACATTTCATTCACATTCGGAACCGATAACAT
CGGAAAAACCGTATATCATA

Product: ATP binding protein VgA

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 524; Mature: 524

Protein sequence:

>524_residues
MILLEAFNIKHYVKDRLLLDVDRLTIYKNDRIGLVGRNGSGKTTLLNILAGMIAPEKGSVIRHARCELLPQLKQMDTTKS
GGEVTQAYIRDLMTKDPELLLADEPTTHLDQEHIEWLEKQLQQWKGAFILVSHDRAFLDALCTTIWEVHEGKVKEYKGRY
SDYVEQREQERRQQQLAYENYEKKKQALERALELKKRKAERATKVSGKKVSPSEAKITGAKPYFAKKQKKLQKAAKAIET
RLEKLEKVEKIKELAPIKMNLPNEDTFKDRIIIRAQEVAGVIGQRVLWNKASFHVRGGEKLAIIGPNGSGKTTLVKKIVD
QEEGIIVSPAVKMGYFSQNLNILDVHQSILENVRSTSKQDETLIRTVLARLHFFRDDVYKPVGVLSGGERVKVALAKLFV
SDINTLILDEPTNFLDIEAMSALESLLQEYEGTVIFVSHDRRFIENVATRILVIRHKEIQLFDGTYKQYKQQKHRDTRNT
TEDERLLLETKIAEVLSRLSIEPNEELEQEFQRLLAEKRKLGMS

Sequences:

>Translated_524_residues
MILLEAFNIKHYVKDRLLLDVDRLTIYKNDRIGLVGRNGSGKTTLLNILAGMIAPEKGSVIRHARCELLPQLKQMDTTKS
GGEVTQAYIRDLMTKDPELLLADEPTTHLDQEHIEWLEKQLQQWKGAFILVSHDRAFLDALCTTIWEVHEGKVKEYKGRY
SDYVEQREQERRQQQLAYENYEKKKQALERALELKKRKAERATKVSGKKVSPSEAKITGAKPYFAKKQKKLQKAAKAIET
RLEKLEKVEKIKELAPIKMNLPNEDTFKDRIIIRAQEVAGVIGQRVLWNKASFHVRGGEKLAIIGPNGSGKTTLVKKIVD
QEEGIIVSPAVKMGYFSQNLNILDVHQSILENVRSTSKQDETLIRTVLARLHFFRDDVYKPVGVLSGGERVKVALAKLFV
SDINTLILDEPTNFLDIEAMSALESLLQEYEGTVIFVSHDRRFIENVATRILVIRHKEIQLFDGTYKQYKQQKHRDTRNT
TEDERLLLETKIAEVLSRLSIEPNEELEQEFQRLLAEKRKLGMS
>Mature_524_residues
MILLEAFNIKHYVKDRLLLDVDRLTIYKNDRIGLVGRNGSGKTTLLNILAGMIAPEKGSVIRHARCELLPQLKQMDTTKS
GGEVTQAYIRDLMTKDPELLLADEPTTHLDQEHIEWLEKQLQQWKGAFILVSHDRAFLDALCTTIWEVHEGKVKEYKGRY
SDYVEQREQERRQQQLAYENYEKKKQALERALELKKRKAERATKVSGKKVSPSEAKITGAKPYFAKKQKKLQKAAKAIET
RLEKLEKVEKIKELAPIKMNLPNEDTFKDRIIIRAQEVAGVIGQRVLWNKASFHVRGGEKLAIIGPNGSGKTTLVKKIVD
QEEGIIVSPAVKMGYFSQNLNILDVHQSILENVRSTSKQDETLIRTVLARLHFFRDDVYKPVGVLSGGERVKVALAKLFV
SDINTLILDEPTNFLDIEAMSALESLLQEYEGTVIFVSHDRRFIENVATRILVIRHKEIQLFDGTYKQYKQQKHRDTRNT
TEDERLLLETKIAEVLSRLSIEPNEELEQEFQRLLAEKRKLGMS

Specific function: Unknown

COG id: COG0488

COG function: function code R; ATPase components of ABC transporters with duplicated ATPase domains

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 2 ABC transporter domains [H]

Homologues:

Organism=Homo sapiens, GI148612853, Length=431, Percent_Identity=29.6983758700696, Blast_Score=172, Evalue=9e-43,
Organism=Homo sapiens, GI27881506, Length=417, Percent_Identity=29.2565947242206, Blast_Score=149, Evalue=8e-36,
Organism=Homo sapiens, GI10947137, Length=417, Percent_Identity=29.2565947242206, Blast_Score=149, Evalue=9e-36,
Organism=Homo sapiens, GI10947135, Length=412, Percent_Identity=27.9126213592233, Blast_Score=145, Evalue=6e-35,
Organism=Homo sapiens, GI69354671, Length=412, Percent_Identity=27.9126213592233, Blast_Score=145, Evalue=7e-35,
Organism=Escherichia coli, GI2367384, Length=427, Percent_Identity=31.615925058548, Blast_Score=194, Evalue=9e-51,
Organism=Escherichia coli, GI1787041, Length=394, Percent_Identity=34.010152284264, Blast_Score=194, Evalue=2e-50,
Organism=Escherichia coli, GI1789751, Length=412, Percent_Identity=28.8834951456311, Blast_Score=177, Evalue=1e-45,
Organism=Escherichia coli, GI1787182, Length=409, Percent_Identity=31.5403422982885, Blast_Score=177, Evalue=2e-45,
Organism=Escherichia coli, GI1788165, Length=200, Percent_Identity=29.5, Blast_Score=75, Evalue=1e-14,
Organism=Escherichia coli, GI1788225, Length=212, Percent_Identity=29.2452830188679, Blast_Score=73, Evalue=5e-14,
Organism=Escherichia coli, GI1787712, Length=208, Percent_Identity=29.3269230769231, Blast_Score=70, Evalue=3e-13,
Organism=Escherichia coli, GI1787029, Length=211, Percent_Identity=28.9099526066351, Blast_Score=67, Evalue=3e-12,
Organism=Escherichia coli, GI1788506, Length=215, Percent_Identity=24.6511627906977, Blast_Score=67, Evalue=4e-12,
Organism=Escherichia coli, GI1789672, Length=205, Percent_Identity=26.8292682926829, Blast_Score=64, Evalue=2e-11,
Organism=Escherichia coli, GI1788897, Length=210, Percent_Identity=30, Blast_Score=62, Evalue=7e-11,
Organism=Escherichia coli, GI1787164, Length=191, Percent_Identity=25.130890052356, Blast_Score=62, Evalue=9e-11,
Organism=Caenorhabditis elegans, GI17559834, Length=401, Percent_Identity=29.426433915212, Blast_Score=164, Evalue=1e-40,
Organism=Caenorhabditis elegans, GI17553372, Length=408, Percent_Identity=29.656862745098, Blast_Score=161, Evalue=7e-40,
Organism=Caenorhabditis elegans, GI17555318, Length=425, Percent_Identity=27.2941176470588, Blast_Score=140, Evalue=2e-33,
Organism=Saccharomyces cerevisiae, GI6320874, Length=418, Percent_Identity=29.4258373205742, Blast_Score=154, Evalue=4e-38,
Organism=Saccharomyces cerevisiae, GI6321121, Length=412, Percent_Identity=27.9126213592233, Blast_Score=142, Evalue=1e-34,
Organism=Saccharomyces cerevisiae, GI6324314, Length=191, Percent_Identity=28.7958115183246, Blast_Score=96, Evalue=1e-20,
Organism=Saccharomyces cerevisiae, GI6323278, Length=188, Percent_Identity=28.1914893617021, Blast_Score=93, Evalue=8e-20,
Organism=Saccharomyces cerevisiae, GI6325030, Length=199, Percent_Identity=31.1557788944724, Blast_Score=89, Evalue=1e-18,
Organism=Drosophila melanogaster, GI24666836, Length=418, Percent_Identity=27.511961722488, Blast_Score=163, Evalue=2e-40,
Organism=Drosophila melanogaster, GI24641342, Length=398, Percent_Identity=30.4020100502513, Blast_Score=157, Evalue=1e-38,
Organism=Drosophila melanogaster, GI24642252, Length=430, Percent_Identity=27.906976744186, Blast_Score=145, Evalue=6e-35,
Organism=Drosophila melanogaster, GI18859989, Length=430, Percent_Identity=27.906976744186, Blast_Score=145, Evalue=6e-35,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR003439
- InterPro:   IPR003593 [H]

Pfam domain/function: PF00005 ABC_tran [H]

EC number: NA

Molecular weight: Translated: 60193; Mature: 60193

Theoretical pI: Translated: 9.72; Mature: 9.72

Prosite motif: PS00211 ABC_TRANSPORTER_1 ; PS50893 ABC_TRANSPORTER_2

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.4 %Cys     (Translated Protein)
1.5 %Met     (Translated Protein)
1.9 %Cys+Met (Translated Protein)
0.4 %Cys     (Mature Protein)
1.5 %Met     (Mature Protein)
1.9 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MILLEAFNIKHYVKDRLLLDVDRLTIYKNDRIGLVGRNGSGKTTLLNILAGMIAPEKGSV
CEEEEECCHHHHHHHHHHEEEHHEEEEECCEEEEEECCCCCHHHHHHHHHHHCCCCCCCH
IRHARCELLPQLKQMDTTKSGGEVTQAYIRDLMTKDPELLLADEPTTHLDQEHIEWLEKQ
HHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHCCCCCEEEECCCCCCCCHHHHHHHHHH
LQQWKGAFILVSHDRAFLDALCTTIWEVHEGKVKEYKGRYSDYVEQREQERRQQQLAYEN
HHHHCCEEEEEECCHHHHHHHHHHHHHHHCCHHHHHCCHHHHHHHHHHHHHHHHHHHHHH
YEKKKQALERALELKKRKAERATKVSGKKVSPSEAKITGAKPYFAKKQKKLQKAAKAIET
HHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCEECCCCCHHHHHHHHHHHHHHHHHH
RLEKLEKVEKIKELAPIKMNLPNEDTFKDRIIIRAQEVAGVIGQRVLWNKASFHVRGGEK
HHHHHHHHHHHHHHCCCEECCCCCCCCHHHHEEEHHHHHHHHHHHHHCCCCCEEEECCCE
LAIIGPNGSGKTTLVKKIVDQEEGIIVSPAVKMGYFSQNLNILDVHQSILENVRSTSKQD
EEEECCCCCCHHHHHHHHHCCCCCEEEECHHHHHHHHCCCCCHHHHHHHHHHHHHCCHHH
ETLIRTVLARLHFFRDDVYKPVGVLSGGERVKVALAKLFVSDINTLILDEPTNFLDIEAM
HHHHHHHHHHHHHHHHHHCCCHHHCCCCCHHHHHHHHHHHHHHHHEEECCCCCEEHHHHH
SALESLLQEYEGTVIFVSHDRRFIENVATRILVIRHKEIQLFDGTYKQYKQQKHRDTRNT
HHHHHHHHHHCCEEEEEECCHHHHHHHHHHEEEEEECEEEEECCHHHHHHHHHHHCCCCC
TEDERLLLETKIAEVLSRLSIEPNEELEQEFQRLLAEKRKLGMS
CHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHCCCC
>Mature Secondary Structure
MILLEAFNIKHYVKDRLLLDVDRLTIYKNDRIGLVGRNGSGKTTLLNILAGMIAPEKGSV
CEEEEECCHHHHHHHHHHEEEHHEEEEECCEEEEEECCCCCHHHHHHHHHHHCCCCCCCH
IRHARCELLPQLKQMDTTKSGGEVTQAYIRDLMTKDPELLLADEPTTHLDQEHIEWLEKQ
HHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHCCCCCEEEECCCCCCCCHHHHHHHHHH
LQQWKGAFILVSHDRAFLDALCTTIWEVHEGKVKEYKGRYSDYVEQREQERRQQQLAYEN
HHHHCCEEEEEECCHHHHHHHHHHHHHHHCCHHHHHCCHHHHHHHHHHHHHHHHHHHHHH
YEKKKQALERALELKKRKAERATKVSGKKVSPSEAKITGAKPYFAKKQKKLQKAAKAIET
HHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCEECCCCCHHHHHHHHHHHHHHHHHH
RLEKLEKVEKIKELAPIKMNLPNEDTFKDRIIIRAQEVAGVIGQRVLWNKASFHVRGGEK
HHHHHHHHHHHHHHCCCEECCCCCCCCHHHHEEEHHHHHHHHHHHHHCCCCCEEEECCCE
LAIIGPNGSGKTTLVKKIVDQEEGIIVSPAVKMGYFSQNLNILDVHQSILENVRSTSKQD
EEEECCCCCCHHHHHHHHHCCCCCEEEECHHHHHHHHCCCCCHHHHHHHHHHHHHCCHHH
ETLIRTVLARLHFFRDDVYKPVGVLSGGERVKVALAKLFVSDINTLILDEPTNFLDIEAM
HHHHHHHHHHHHHHHHHHCCCHHHCCCCCHHHHHHHHHHHHHHHHEEECCCCCEEHHHHH
SALESLLQEYEGTVIFVSHDRRFIENVATRILVIRHKEIQLFDGTYKQYKQQKHRDTRNT
HHHHHHHHHHCCEEEEEECCHHHHHHHHHHEEEEEECEEEEECCHHHHHHHHHHHCCCCC
TEDERLLLETKIAEVLSRLSIEPNEELEQEFQRLLAEKRKLGMS
CHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9384377 [H]