| Definition | Geobacter sulfurreducens PCA chromosome, complete genome. |
|---|---|
| Accession | NC_002939 |
| Length | 3,814,139 |
Click here to switch to the map view.
The map label for this gene is dinB [H]
Identifier: 39996716
GI number: 39996716
Start: 1769602
End: 1770831
Strand: Reverse
Name: dinB [H]
Synonym: GSU1616
Alternate gene names: 39996716
Gene position: 1770831-1769602 (Counterclockwise)
Preceding gene: 39996717
Following gene: 39996715
Centisome position: 46.43
GC content: 54.55
Gene sequence:
>1230_bases ATGAGCAATCATCGAACCATTCTCCATCTGGACATGAACGCCTTTTTTGCCTCGGTTGAGCAACAAGCAGACCCATCCCT CCAAGGAAAGCCAGTTGCGGTCATCGGGTCAGGCGCGCGCACCATCATCACTACCGCATCCTACGAGGCACGCGCCCACG GGGTCGGCACGGGCATGACAACCCACGAAGCAAAACGGCTCTGCCCGGAATTGATCCTCGTTATCGGCAACAACCGGGAA TACACCCGTATTTCAAAACTGATCTTCGAAATGCTCGGGCAATTCACCCCCCTTGTGGAAGTCTTTTCCATTGACGAAGC CTTTCTCGACTTGACCGGTTCGCTTCGACTTTTCGGCCGCGCCGACGTGATTGCCCGCGAGATCAAAGCCCGCATAAGGG ACCGATTCGGCCTCACCTGCTCCATCGGCATCGCTCCCAACAAGCTTTTGGCAAAGCTGGCCTCGGACATGCAAAAGCCC GATGGTCTCACCATCATCCCCCCCGAAAACGTGGCTTCACTCATGAAAACGACCCCGATCCGCAGCCTCTGCGGAATAGG CCCATCCACTGAACAACGACTGAAATACCTCGGCATTTCAACCTGTAACGATCTGGGACACTTCAGCTCCAAGATACTTA CCCGACATTTCGGTGCCATGGGAGCACGACTCAAACAGATGGGACAGGGCATTGACGACTCTCCCGTAATACCGACCACA ACGGAAGAAGAAGTTAAAAGCGTCAGCCACAGTACAACCCTGGACCACGACCTCACCAACAAGGACGACATACATAAGTA CCTGCTTATGTTATCGGAGATGGTAGGACGCCGCGCGCGCCGCTACAAAACCAAAGGGAAAACAGTTACCCTAACAATAC GGTATGCCGATTTCACCACGTTCAGCCGCCAGGAAACCCTCCCCTCCCCATTGAATCGAAGCGGCGACATTTATCGAGCC GTCACTGCACTGCTCGACACACTCCAATTAACGCAACCAATACGACTCCTGGGCGTTGCCATCAGCAACCTTGTACATGC CTCGGAACAGCTCCCCCTCTTCCCGGAAGAACGGCGGCTCACAACCCTCTCGCAAGCCATGGATCAAGTCAATGACCGGT TCGGAGAAACCACCATCACCTTTGGCACCTTGCTGGGACAAGACAACTGCTCGCACGTTATCGCCCCTGCCTGGAGACCC GCTGGCATACGTGACGTAAAAGTAAAATAA
Upstream 100 bases:
>100_bases GAGGCATGGATAATCGGCAAAGTTGTGGGTATTTACCGGCGTATGGATTAACACACAAACTCCTCAGTACACAGGTAAGT AAATATACTGGCACTCAAGC
Downstream 100 bases:
>100_bases TTAAAATATTCAAGCAAGATAGACAACAATATCTCACCTATTAGCACAACACATATCAAACTTACACACATACTCGATTA CCCAGAAGCACCGGTCTCAG
Product: ImpB/MucB/SamB family protein
Products: NA
Alternate protein names: Pol IV [H]
Number of amino acids: Translated: 409; Mature: 408
Protein sequence:
>409_residues MSNHRTILHLDMNAFFASVEQQADPSLQGKPVAVIGSGARTIITTASYEARAHGVGTGMTTHEAKRLCPELILVIGNNRE YTRISKLIFEMLGQFTPLVEVFSIDEAFLDLTGSLRLFGRADVIAREIKARIRDRFGLTCSIGIAPNKLLAKLASDMQKP DGLTIIPPENVASLMKTTPIRSLCGIGPSTEQRLKYLGISTCNDLGHFSSKILTRHFGAMGARLKQMGQGIDDSPVIPTT TEEEVKSVSHSTTLDHDLTNKDDIHKYLLMLSEMVGRRARRYKTKGKTVTLTIRYADFTTFSRQETLPSPLNRSGDIYRA VTALLDTLQLTQPIRLLGVAISNLVHASEQLPLFPEERRLTTLSQAMDQVNDRFGETTITFGTLLGQDNCSHVIAPAWRP AGIRDVKVK
Sequences:
>Translated_409_residues MSNHRTILHLDMNAFFASVEQQADPSLQGKPVAVIGSGARTIITTASYEARAHGVGTGMTTHEAKRLCPELILVIGNNRE YTRISKLIFEMLGQFTPLVEVFSIDEAFLDLTGSLRLFGRADVIAREIKARIRDRFGLTCSIGIAPNKLLAKLASDMQKP DGLTIIPPENVASLMKTTPIRSLCGIGPSTEQRLKYLGISTCNDLGHFSSKILTRHFGAMGARLKQMGQGIDDSPVIPTT TEEEVKSVSHSTTLDHDLTNKDDIHKYLLMLSEMVGRRARRYKTKGKTVTLTIRYADFTTFSRQETLPSPLNRSGDIYRA VTALLDTLQLTQPIRLLGVAISNLVHASEQLPLFPEERRLTTLSQAMDQVNDRFGETTITFGTLLGQDNCSHVIAPAWRP AGIRDVKVK >Mature_408_residues SNHRTILHLDMNAFFASVEQQADPSLQGKPVAVIGSGARTIITTASYEARAHGVGTGMTTHEAKRLCPELILVIGNNREY TRISKLIFEMLGQFTPLVEVFSIDEAFLDLTGSLRLFGRADVIAREIKARIRDRFGLTCSIGIAPNKLLAKLASDMQKPD GLTIIPPENVASLMKTTPIRSLCGIGPSTEQRLKYLGISTCNDLGHFSSKILTRHFGAMGARLKQMGQGIDDSPVIPTTT EEEVKSVSHSTTLDHDLTNKDDIHKYLLMLSEMVGRRARRYKTKGKTVTLTIRYADFTTFSRQETLPSPLNRSGDIYRAV TALLDTLQLTQPIRLLGVAISNLVHASEQLPLFPEERRLTTLSQAMDQVNDRFGETTITFGTLLGQDNCSHVIAPAWRPA GIRDVKVK
Specific function: Poorly processive, error-prone DNA polymerase involved in untargeted mutagenesis. Copies undamaged DNA at stalled replication forks, which arise in vivo from mismatched or misaligned primer ends. These misaligned primers can be extended by polIV. Exhibits
COG id: COG0389
COG function: function code L; Nucleotidyltransferase/DNA polymerase involved in DNA repair
Gene ontology:
Cell location: Cytoplasm [H]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 umuC domain [H]
Homologues:
Organism=Homo sapiens, GI84043967, Length=400, Percent_Identity=31.25, Blast_Score=157, Evalue=1e-38, Organism=Homo sapiens, GI7706681, Length=401, Percent_Identity=31.1720698254364, Blast_Score=157, Evalue=2e-38, Organism=Homo sapiens, GI154350220, Length=368, Percent_Identity=30.7065217391304, Blast_Score=147, Evalue=2e-35, Organism=Homo sapiens, GI7705344, Length=110, Percent_Identity=42.7272727272727, Blast_Score=98, Evalue=2e-20, Organism=Homo sapiens, GI5729982, Length=125, Percent_Identity=37.6, Blast_Score=81, Evalue=2e-15, Organism=Escherichia coli, GI1786425, Length=343, Percent_Identity=33.5276967930029, Blast_Score=188, Evalue=6e-49, Organism=Escherichia coli, GI1787432, Length=397, Percent_Identity=27.9596977329975, Blast_Score=109, Evalue=3e-25, Organism=Caenorhabditis elegans, GI17537959, Length=245, Percent_Identity=27.7551020408163, Blast_Score=107, Evalue=1e-23, Organism=Caenorhabditis elegans, GI193205700, Length=138, Percent_Identity=36.231884057971, Blast_Score=87, Evalue=2e-17, Organism=Caenorhabditis elegans, GI193205702, Length=280, Percent_Identity=29.2857142857143, Blast_Score=82, Evalue=5e-16, Organism=Caenorhabditis elegans, GI115534089, Length=123, Percent_Identity=39.0243902439024, Blast_Score=79, Evalue=5e-15, Organism=Drosophila melanogaster, GI21355641, Length=276, Percent_Identity=32.6086956521739, Blast_Score=135, Evalue=4e-32, Organism=Drosophila melanogaster, GI24644984, Length=276, Percent_Identity=32.6086956521739, Blast_Score=135, Evalue=4e-32, Organism=Drosophila melanogaster, GI19923006, Length=341, Percent_Identity=27.2727272727273, Blast_Score=129, Evalue=3e-30, Organism=Drosophila melanogaster, GI24668444, Length=124, Percent_Identity=37.9032258064516, Blast_Score=78, Evalue=1e-14,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR017962 - InterPro: IPR017961 - InterPro: IPR001126 - InterPro: IPR017963 - InterPro: IPR022880 [H]
Pfam domain/function: PF00817 IMS [H]
EC number: =2.7.7.7 [H]
Molecular weight: Translated: 45173; Mature: 45042
Theoretical pI: Translated: 9.36; Mature: 9.36
Prosite motif: PS50173 UMUC ; PS00216 SUGAR_TRANSPORT_1
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.2 %Cys (Translated Protein) 2.7 %Met (Translated Protein) 3.9 %Cys+Met (Translated Protein) 1.2 %Cys (Mature Protein) 2.5 %Met (Mature Protein) 3.7 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MSNHRTILHLDMNAFFASVEQQADPSLQGKPVAVIGSGARTIITTASYEARAHGVGTGMT CCCCCEEEEEEHHHHHHHHHHHCCCCCCCCCEEEEECCCEEEEEECCCCHHHCCCCCCCC THEAKRLCPELILVIGNNREYTRISKLIFEMLGQFTPLVEVFSIDEAFLDLTGSLRLFGR HHHHHHHHHHEEEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEHHH ADVIAREIKARIRDRFGLTCSIGIAPNKLLAKLASDMQKPDGLTIIPPENVASLMKTTPI HHHHHHHHHHHHHHHCCCEEEECCCCHHHHHHHHHHHCCCCCEEEECCHHHHHHHHHCCH RSLCGIGPSTEQRLKYLGISTCNDLGHFSSKILTRHFGAMGARLKQMGQGIDDSPVIPTT HHHHCCCCCHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCC TEEEVKSVSHSTTLDHDLTNKDDIHKYLLMLSEMVGRRARRYKTKGKTVTLTIRYADFTT CHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEEEEEEECCCC FSRQETLPSPLNRSGDIYRAVTALLDTLQLTQPIRLLGVAISNLVHASEQLPLFPEERRL CCHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHH TTLSQAMDQVNDRFGETTITFGTLLGQDNCSHVIAPAWRPAGIRDVKVK HHHHHHHHHHHHHHCCCEEEEHHHHCCCCCCCEECCCCCCCCCEECCCC >Mature Secondary Structure SNHRTILHLDMNAFFASVEQQADPSLQGKPVAVIGSGARTIITTASYEARAHGVGTGMT CCCCEEEEEEHHHHHHHHHHHCCCCCCCCCEEEEECCCEEEEEECCCCHHHCCCCCCCC THEAKRLCPELILVIGNNREYTRISKLIFEMLGQFTPLVEVFSIDEAFLDLTGSLRLFGR HHHHHHHHHHEEEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEHHH ADVIAREIKARIRDRFGLTCSIGIAPNKLLAKLASDMQKPDGLTIIPPENVASLMKTTPI HHHHHHHHHHHHHHHCCCEEEECCCCHHHHHHHHHHHCCCCCEEEECCHHHHHHHHHCCH RSLCGIGPSTEQRLKYLGISTCNDLGHFSSKILTRHFGAMGARLKQMGQGIDDSPVIPTT HHHHCCCCCHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCC TEEEVKSVSHSTTLDHDLTNKDDIHKYLLMLSEMVGRRARRYKTKGKTVTLTIRYADFTT CHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEEEEEEECCCC FSRQETLPSPLNRSGDIYRAVTALLDTLQLTQPIRLLGVAISNLVHASEQLPLFPEERRL CCHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHH TTLSQAMDQVNDRFGETTITFGTLLGQDNCSHVIAPAWRPAGIRDVKVK HHHHHHHHHHHHHHCCCEEEEHHHHCCCCCCCEECCCCCCCCCEECCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA