Definition Escherichia coli HS, complete genome.
Accession NC_009800
Length 4,643,538

Click here to switch to the map view.

The map label for this gene is sufI

Identifier: 157162493

GI number: 157162493

Start: 3206088

End: 3207500

Strand: Reverse

Name: sufI

Synonym: EcHS_A3195

Alternate gene names: 157162493

Gene position: 3207500-3206088 (Counterclockwise)

Preceding gene: 157162494

Following gene: 157162492

Centisome position: 69.07

GC content: 56.33

Gene sequence:

>1413_bases
ATGTCACTCAGTCGGCGTCAGTTCATTCAGGCATCGGGGATTGCACTTTGTGCAGGCGCTGTTCCCCTGAAGGCCAGCGC
AGCCGGGCAACAGCAACCGCTACCCGTTCCGCCGCTACTTGAATCTCGCCGTGGGCAACCGCTGTTTATGACTGTACAAC
GTGCGCACTGGTCATTTACGCCAGGGACACGCGCGTCGGTCTGGGGAATCAATGGTCGTTACCTGGGGCCGACTATCCGC
GTCTGGAAGGGCGACGATGTTAAGCTTATTTACAGCAACCGCCTGACAGAAAATGTCTCAATGACGGTGGCCGGGCTACA
GGTACCAGGCCCGCTGATGGGCGGTCCGGCACGGATGATGTCGCCAAACGCTGACTGGGCACCCGTACTGCCCATTCGCC
AGAACGCAGCTACTCTGTGGTATCACGCCAATACTCCCAACCGCACGGCTCAGCAGGTCTATAACGGCCTTGCCGGAATG
TGGCTGGTGGAAGATGAAGTCAGCAAGTCGCTGCCTATCCCCAACCATTATGGTGTGGATGATTTTCCGGTCATTATCCA
GGATAAACGGCTGGATAACTTTGGTACGCCAGAATACAACGAACCGGGAAGCGGCGGCTTTGTTGGTGATACGCTGCTGG
TTAACGGTGTACAAAGCCCGTACGTTGAAGTCTCGCGTGGCTGGGTGCGCTTGCGACTGCTGAACGCGTCGAACTCTCGT
CGCTATCAACTACAGATGAACGATGGTCGCCCGTTACATGTGATTTCTGGCGATCAGGGATTCCTGCCTGCTCCTGTATC
GGTGAAGCAACTTTCGCTGGCACCGGGCGAGCGCCGCGAGATTCTGGTGGATATGAGCAACGGCGATGAAGTGTCGATCA
CCTGTGGCGAAGCGGCGAGCATTGTTGATCGTATTCGTGGCTTCTTTGAGCCATCCAGTATTCTGGTTTCTACCCTGGTG
CTAACGCTGCGCCCAACCGGCCTTCTGCCGCTGGTCACAGACAGTCTTCCGATGCGCTTGCTGCCAACTGAAATCATGGC
TGGTTCGCCAATTCGCAGTCGCGATATCAGTCTGGGTGATGACCCGGGTATTAATGGACAGCTGTGGGACGTCAACCGTA
TTGATGTCACCGCGCAGCAAGGAACGTGGGAACGCTGGACGGTACGCGCGGACGAGCCGCAAGCGTTCCATATTGAAGGC
GTAATGTTCCAGATCCGTAACGTGAATGGCGCGATGCCGTTCCCGGAAGACAGAGGCTGGAAAGATACCGTTTGGGTTGA
CGGACAAGTGGAGCTGCTTGTTTATTTCGGTCAGCCTTCCTGGGCGCACTTCCCGTTCTACTTCAACAGTCAGACGCTGG
AAATGGCGGACCGTGGCTCGATTGGGCAACTGTTAGTCAATCCGGTACCGTAA

Upstream 100 bases:

>100_bases
AACGCGAAGCCGCCGGAAAAGTTTAAGTCGGCAATCTGTATTTTTGCGGGGAACACTTTCCTGCACGGTATTACTTTAGC
CAGTTTTACATGGAGCAAAT

Downstream 100 bases:

>100_bases
TCTTCATACTCGCCCGAGGAGGGCGAGTATGGAATACTTTTCGATTTCTCTTTCGTTCCGGCTTATAATCCCCGGCCTTT
GATTATTTTTTTATCATTTC

Product: repressor protein for FtsI

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 470; Mature: 469

Protein sequence:

>470_residues
MSLSRRQFIQASGIALCAGAVPLKASAAGQQQPLPVPPLLESRRGQPLFMTVQRAHWSFTPGTRASVWGINGRYLGPTIR
VWKGDDVKLIYSNRLTENVSMTVAGLQVPGPLMGGPARMMSPNADWAPVLPIRQNAATLWYHANTPNRTAQQVYNGLAGM
WLVEDEVSKSLPIPNHYGVDDFPVIIQDKRLDNFGTPEYNEPGSGGFVGDTLLVNGVQSPYVEVSRGWVRLRLLNASNSR
RYQLQMNDGRPLHVISGDQGFLPAPVSVKQLSLAPGERREILVDMSNGDEVSITCGEAASIVDRIRGFFEPSSILVSTLV
LTLRPTGLLPLVTDSLPMRLLPTEIMAGSPIRSRDISLGDDPGINGQLWDVNRIDVTAQQGTWERWTVRADEPQAFHIEG
VMFQIRNVNGAMPFPEDRGWKDTVWVDGQVELLVYFGQPSWAHFPFYFNSQTLEMADRGSIGQLLVNPVP

Sequences:

>Translated_470_residues
MSLSRRQFIQASGIALCAGAVPLKASAAGQQQPLPVPPLLESRRGQPLFMTVQRAHWSFTPGTRASVWGINGRYLGPTIR
VWKGDDVKLIYSNRLTENVSMTVAGLQVPGPLMGGPARMMSPNADWAPVLPIRQNAATLWYHANTPNRTAQQVYNGLAGM
WLVEDEVSKSLPIPNHYGVDDFPVIIQDKRLDNFGTPEYNEPGSGGFVGDTLLVNGVQSPYVEVSRGWVRLRLLNASNSR
RYQLQMNDGRPLHVISGDQGFLPAPVSVKQLSLAPGERREILVDMSNGDEVSITCGEAASIVDRIRGFFEPSSILVSTLV
LTLRPTGLLPLVTDSLPMRLLPTEIMAGSPIRSRDISLGDDPGINGQLWDVNRIDVTAQQGTWERWTVRADEPQAFHIEG
VMFQIRNVNGAMPFPEDRGWKDTVWVDGQVELLVYFGQPSWAHFPFYFNSQTLEMADRGSIGQLLVNPVP
>Mature_469_residues
SLSRRQFIQASGIALCAGAVPLKASAAGQQQPLPVPPLLESRRGQPLFMTVQRAHWSFTPGTRASVWGINGRYLGPTIRV
WKGDDVKLIYSNRLTENVSMTVAGLQVPGPLMGGPARMMSPNADWAPVLPIRQNAATLWYHANTPNRTAQQVYNGLAGMW
LVEDEVSKSLPIPNHYGVDDFPVIIQDKRLDNFGTPEYNEPGSGGFVGDTLLVNGVQSPYVEVSRGWVRLRLLNASNSRR
YQLQMNDGRPLHVISGDQGFLPAPVSVKQLSLAPGERREILVDMSNGDEVSITCGEAASIVDRIRGFFEPSSILVSTLVL
TLRPTGLLPLVTDSLPMRLLPTEIMAGSPIRSRDISLGDDPGINGQLWDVNRIDVTAQQGTWERWTVRADEPQAFHIEGV
MFQIRNVNGAMPFPEDRGWKDTVWVDGQVELLVYFGQPSWAHFPFYFNSQTLEMADRGSIGQLLVNPVP

Specific function: Involved in cell division, suppresses a ftsI mutation

COG id: COG2132

COG function: function code Q; Putative multicopper oxidases

Gene ontology:

Cell location: Periplasm

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 plastocyanin-like domain

Homologues:

Organism=Escherichia coli, GI1789394, Length=470, Percent_Identity=100, Blast_Score=954, Evalue=0.0,
Organism=Escherichia coli, GI1786314, Length=517, Percent_Identity=31.5280464216634, Blast_Score=239, Evalue=3e-64,

Paralogues:

None

Copy number: 20 Molecules/Cell In: Stationary Phase, Rich Media (Based on E. coli). [C]

Swissprot (AC and ID): SUFI_ECOLI (P26648)

Other databases:

- EMBL:   U28377
- EMBL:   U00096
- EMBL:   AP009048
- EMBL:   M63491
- PIR:   G65088
- RefSeq:   AP_003567.1
- RefSeq:   NP_417489.1
- PDB:   2UXT
- PDB:   2UXV
- PDBsum:   2UXT
- PDBsum:   2UXV
- ProteinModelPortal:   P26648
- SMR:   P26648
- DIP:   DIP-10942N
- STRING:   P26648
- EnsemblBacteria:   EBESCT00000004489
- EnsemblBacteria:   EBESCT00000014718
- GeneID:   944982
- GenomeReviews:   AP009048_GR
- GenomeReviews:   U00096_GR
- KEGG:   ecj:JW2985
- KEGG:   eco:b3017
- EchoBASE:   EB1350
- EcoGene:   EG11376
- eggNOG:   COG2132
- GeneTree:   EBGT00050000010733
- HOGENOM:   HBG655385
- OMA:   GMWIIED
- ProtClustDB:   PRK10883
- BioCyc:   EcoCyc:EG11376-MONOMER
- Genevestigator:   P26648
- InterPro:   IPR001117
- InterPro:   IPR011706
- InterPro:   IPR011707
- InterPro:   IPR008972
- InterPro:   IPR006311
- Gene3D:   G3DSA:2.60.40.420
- TIGRFAMs:   TIGR01409

Pfam domain/function: PF00394 Cu-oxidase; PF07731 Cu-oxidase_2; PF07732 Cu-oxidase_3; SSF49503 Cupredoxin

EC number: NA

Molecular weight: Translated: 51859; Mature: 51728

Theoretical pI: Translated: 6.27; Mature: 6.27

Prosite motif: PS51318 TAT

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.4 %Cys     (Translated Protein)
3.0 %Met     (Translated Protein)
3.4 %Cys+Met (Translated Protein)
0.4 %Cys     (Mature Protein)
2.8 %Met     (Mature Protein)
3.2 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSLSRRQFIQASGIALCAGAVPLKASAAGQQQPLPVPPLLESRRGQPLFMTVQRAHWSFT
CCCCHHHHHHHCCEEEEECCCCEEECCCCCCCCCCCCCHHHHCCCCEEEEEEEECEEEEC
PGTRASVWGINGRYLGPTIRVWKGDDVKLIYSNRLTENVSMTVAGLQVPGPLMGGPARMM
CCCCEEEEECCCEEECCEEEEEECCCEEEEECCCCCCCEEEEEEEEECCCCCCCCCHHHC
SPNADWAPVLPIRQNAATLWYHANTPNRTAQQVYNGLAGMWLVEDEVSKSLPIPNHYGVD
CCCCCCCEECEECCCCEEEEEECCCCCHHHHHHHHCCCCEEEEECHHHHCCCCCCCCCCC
DFPVIIQDKRLDNFGTPEYNEPGSGGFVGDTLLVNGVQSPYVEVSRGWVRLRLLNASNSR
CCEEEEEECCCCCCCCCCCCCCCCCCEECCEEEECCCCCCCEEECCCEEEEEEEECCCCE
RYQLQMNDGRPLHVISGDQGFLPAPVSVKQLSLAPGERREILVDMSNGDEVSITCGEAAS
EEEEEECCCCEEEEEECCCCCCCCCCCEEEEECCCCCCEEEEEECCCCCEEEEECCCHHH
IVDRIRGFFEPSSILVSTLVLTLRPTGLLPLVTDSLPMRLLPTEIMAGSPIRSRDISLGD
HHHHHHHCCCCHHHHHHHHHHEECCCCCCEEEECCCCCEEECHHHHCCCCCCCCCCCCCC
DPGINGQLWDVNRIDVTAQQGTWERWTVRADEPQAFHIEGVMFQIRNVNGAMPFPEDRGW
CCCCCCEEEECEEEEEEECCCCCEEEEEECCCCCEEEEEEEEEEEEECCCCCCCCCCCCC
KDTVWVDGQVELLVYFGQPSWAHFPFYFNSQTLEMADRGSIGQLLVNPVP
CCEEEECCEEEEEEEECCCCCEECCEEECCCEEEECCCCCCCEEEEECCC
>Mature Secondary Structure 
SLSRRQFIQASGIALCAGAVPLKASAAGQQQPLPVPPLLESRRGQPLFMTVQRAHWSFT
CCCHHHHHHHCCEEEEECCCCEEECCCCCCCCCCCCCHHHHCCCCEEEEEEEECEEEEC
PGTRASVWGINGRYLGPTIRVWKGDDVKLIYSNRLTENVSMTVAGLQVPGPLMGGPARMM
CCCCEEEEECCCEEECCEEEEEECCCEEEEECCCCCCCEEEEEEEEECCCCCCCCCHHHC
SPNADWAPVLPIRQNAATLWYHANTPNRTAQQVYNGLAGMWLVEDEVSKSLPIPNHYGVD
CCCCCCCEECEECCCCEEEEEECCCCCHHHHHHHHCCCCEEEEECHHHHCCCCCCCCCCC
DFPVIIQDKRLDNFGTPEYNEPGSGGFVGDTLLVNGVQSPYVEVSRGWVRLRLLNASNSR
CCEEEEEECCCCCCCCCCCCCCCCCCEECCEEEECCCCCCCEEECCCEEEEEEEECCCCE
RYQLQMNDGRPLHVISGDQGFLPAPVSVKQLSLAPGERREILVDMSNGDEVSITCGEAAS
EEEEEECCCCEEEEEECCCCCCCCCCCEEEEECCCCCCEEEEEECCCCCEEEEECCCHHH
IVDRIRGFFEPSSILVSTLVLTLRPTGLLPLVTDSLPMRLLPTEIMAGSPIRSRDISLGD
HHHHHHHCCCCHHHHHHHHHHEECCCCCCEEEECCCCCEEECHHHHCCCCCCCCCCCCCC
DPGINGQLWDVNRIDVTAQQGTWERWTVRADEPQAFHIEGVMFQIRNVNGAMPFPEDRGW
CCCCCCEEEECEEEEEEECCCCCEEEEEECCCCCEEEEEEEEEEEEECCCCCCCCCCCCC
KDTVWVDGQVELLVYFGQPSWAHFPFYFNSQTLEMADRGSIGQLLVNPVP
CCEEEECCEEEEEEEECCCCCEECCEEECCCEEEECCCCCCCEEEEECCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9278503; 1557036; 9298646