Definition Novosphingobium aromaticivorans DSM 12444 chromosome, complete genome.
Accession NC_007794
Length 3,561,584

Click here to switch to the map view.

The map label for this gene is czcC [H]

Identifier: 87200164

GI number: 87200164

Start: 2290448

End: 2291650

Strand: Reverse

Name: czcC [H]

Synonym: Saro_2148

Alternate gene names: 87200164

Gene position: 2291650-2290448 (Counterclockwise)

Preceding gene: 87200166

Following gene: 87200163

Centisome position: 64.34

GC content: 69.24

Gene sequence:

>1203_bases
ATGAAGCTTCGATATTTGATCGCCACCGCCATTCTACTGGCCGGTTCACCCGCCTGGGCGGCCGAGGTCTCACTGACTGA
CGCGCTTTCCCAGGGCGCTCAGAATTCGCCGCGCGTGGCGCAGGCCCGCGCCCAGGCGCAGGCAGCCGAAGCGAGGGCTC
GGCAAGCCGGCGCATCGCCCAACCCGGAGATCTCGCTCGAGGTCGAGAACTTCGCCGGCACCGGGCCCTATCGCGACACG
CGCAGCGCCGAGACGACGCTGGCGCTCAGCCAGCGGATCGAACTGGGGGGCAAGCGCAGTGCGCGCATTGAGGTCGCCGG
AGCCGAACGGGATTTCGCGCTCGTTGCGCTGAAACGCGCGGAAGCCGATCTCGCGCGCGACATTCGGATCGCCTTCGCCG
AATTACGTGCGGCGGAGGATCGGGCGGTTCTTGCCCGCGACAATGTCCGGCAGGCGGAGGAACTGGCGCGCTCTGCCGGA
TTGTTCGTGGAGGTCGGACGCGATCCGCCTTTGCGCAAGCTGCGTGCCGACGCCCTGCTCGCAGACGCCAAGGCAGAACA
GGCACGCACCTTCGGCGAATTGCTTGCCGCCCGCCGCCTGCTCGCGGACCTCATCGGCACCAGCGACCCGGAGCTCTCCG
CAAACGTCGATGGCGATGACACGCGACCTGCGCTGCTGCCGCCCGAAACGCCATCGCTCGACGAGCAATTGGCGGCGGCG
GAACGCGATGCGGCGCGGGCGCGCATTCGGGTGGCCAAGGCAGTTGGCGTCCCTGACGTCACTGCGAGTGGCGGCGTGCG
GCGGATCAACGACGGGCGCGAAACCGCATTCGTGGCGGGCTTCTCGATCCCCCTGCCGATCCGGGACCGTAACCGCGGCA
ACATCGAGGCAGCGAGTGCGGACAGTCTGGCTGCAGAGGCTGCACTGTCGCAGACGCGGCTCGATGCTAGGCGCGCCCAG
CATGACGCCCGAATGCTGCTCGGCGCGGCGGAAGAGCGGGTGGCGGCCTTGTCCGGCCCCGCTTTGACACAGGCCGAGGA
AGCCTTGCGTCTGGCCCAGGTTGGGTACGCCGCCGGCAAGTTCAGCCTCATCGAACTCATCGACGCGCAGGCGGCGCTCA
CCGCCACGCGCAAATCCCTGATCGACGCGCGGCTCGACCGCGCCCGCGCGCTGGCCGCGCTGATCCGCGCCAACGCGCAG
TGA

Upstream 100 bases:

>100_bases
CATGTAATCCATGACCGGGAGAGCGACCGCGCATCAAGCCCGGTGAATGCTTGTTCGAGCCTAGCCGCGCCCACCGAACT
GAACTCCGGTGGTGCGTAGC

Downstream 100 bases:

>100_bases
AGGACTTACACATGGACTTGGAAACTGGAACGGATCCCAAACGTCTCCTGATCGGAGCGGCAGTGGCAACCCTTATCGTC
GGCACTGCGGGTATCATGCT

Product: outer membrane efflux protein

Products: NA

Alternate protein names: Cation efflux system protein CzcC [H]

Number of amino acids: Translated: 400; Mature: 400

Protein sequence:

>400_residues
MKLRYLIATAILLAGSPAWAAEVSLTDALSQGAQNSPRVAQARAQAQAAEARARQAGASPNPEISLEVENFAGTGPYRDT
RSAETTLALSQRIELGGKRSARIEVAGAERDFALVALKRAEADLARDIRIAFAELRAAEDRAVLARDNVRQAEELARSAG
LFVEVGRDPPLRKLRADALLADAKAEQARTFGELLAARRLLADLIGTSDPELSANVDGDDTRPALLPPETPSLDEQLAAA
ERDAARARIRVAKAVGVPDVTASGGVRRINDGRETAFVAGFSIPLPIRDRNRGNIEAASADSLAAEAALSQTRLDARRAQ
HDARMLLGAAEERVAALSGPALTQAEEALRLAQVGYAAGKFSLIELIDAQAALTATRKSLIDARLDRARALAALIRANAQ

Sequences:

>Translated_400_residues
MKLRYLIATAILLAGSPAWAAEVSLTDALSQGAQNSPRVAQARAQAQAAEARARQAGASPNPEISLEVENFAGTGPYRDT
RSAETTLALSQRIELGGKRSARIEVAGAERDFALVALKRAEADLARDIRIAFAELRAAEDRAVLARDNVRQAEELARSAG
LFVEVGRDPPLRKLRADALLADAKAEQARTFGELLAARRLLADLIGTSDPELSANVDGDDTRPALLPPETPSLDEQLAAA
ERDAARARIRVAKAVGVPDVTASGGVRRINDGRETAFVAGFSIPLPIRDRNRGNIEAASADSLAAEAALSQTRLDARRAQ
HDARMLLGAAEERVAALSGPALTQAEEALRLAQVGYAAGKFSLIELIDAQAALTATRKSLIDARLDRARALAALIRANAQ
>Mature_400_residues
MKLRYLIATAILLAGSPAWAAEVSLTDALSQGAQNSPRVAQARAQAQAAEARARQAGASPNPEISLEVENFAGTGPYRDT
RSAETTLALSQRIELGGKRSARIEVAGAERDFALVALKRAEADLARDIRIAFAELRAAEDRAVLARDNVRQAEELARSAG
LFVEVGRDPPLRKLRADALLADAKAEQARTFGELLAARRLLADLIGTSDPELSANVDGDDTRPALLPPETPSLDEQLAAA
ERDAARARIRVAKAVGVPDVTASGGVRRINDGRETAFVAGFSIPLPIRDRNRGNIEAASADSLAAEAALSQTRLDARRAQ
HDARMLLGAAEERVAALSGPALTQAEEALRLAQVGYAAGKFSLIELIDAQAALTATRKSLIDARLDRARALAALIRANAQ

Specific function: CzcC protein appears to modify the specificity of the system, perhaps by acting on the CzcB protein. When the CzcC protein is added to CzcA and CzcB, the efflux system gains specificity for cadmium and cobalt [H]

COG id: COG1538

COG function: function code MU; Outer membrane protein

Gene ontology:

Cell location: Cell outer membrane (Potential) [H]

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the outer membrane factor (OMF) (TC 1.B.17) family [H]

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR003423 [H]

Pfam domain/function: PF02321 OEP [H]

EC number: NA

Molecular weight: Translated: 42371; Mature: 42371

Theoretical pI: Translated: 7.55; Mature: 7.55

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.0 %Cys     (Translated Protein)
0.5 %Met     (Translated Protein)
0.5 %Cys+Met (Translated Protein)
0.0 %Cys     (Mature Protein)
0.5 %Met     (Mature Protein)
0.5 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKLRYLIATAILLAGSPAWAAEVSLTDALSQGAQNSPRVAQARAQAQAAEARARQAGASP
CCHHHHHHHHHHHCCCCCHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHCCCCC
NPEISLEVENFAGTGPYRDTRSAETTLALSQRIELGGKRSARIEVAGAERDFALVALKRA
CCCEEEEECCCCCCCCCCCCCCHHHHHHHHHHHHCCCCCCCEEEEECCCCCEEEEEHHHH
EADLARDIRIAFAELRAAEDRAVLARDNVRQAEELARSAGLFVEVGRDPPLRKLRADALL
HHHHHHHHHHHHHHHHHCCCCHHHHHCCHHHHHHHHHHCCCEEEECCCCCHHHHHHHHHH
ADAKAEQARTFGELLAARRLLADLIGTSDPELSANVDGDDTRPALLPPETPSLDEQLAAA
HHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHH
ERDAARARIRVAKAVGVPDVTASGGVRRINDGRETAFVAGFSIPLPIRDRNRGNIEAASA
HHHHHHHHHHHHHHCCCCCCCCCCCCEECCCCCCEEEEEEEECCCCCCCCCCCCEECCCH
DSLAAEAALSQTRLDARRAQHDARMLLGAAEERVAALSGPALTQAEEALRLAQVGYAAGK
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHCCCC
FSLIELIDAQAALTATRKSLIDARLDRARALAALIRANAQ
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCC
>Mature Secondary Structure
MKLRYLIATAILLAGSPAWAAEVSLTDALSQGAQNSPRVAQARAQAQAAEARARQAGASP
CCHHHHHHHHHHHCCCCCHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHCCCCC
NPEISLEVENFAGTGPYRDTRSAETTLALSQRIELGGKRSARIEVAGAERDFALVALKRA
CCCEEEEECCCCCCCCCCCCCCHHHHHHHHHHHHCCCCCCCEEEEECCCCCEEEEEHHHH
EADLARDIRIAFAELRAAEDRAVLARDNVRQAEELARSAGLFVEVGRDPPLRKLRADALL
HHHHHHHHHHHHHHHHHCCCCHHHHHCCHHHHHHHHHHCCCEEEECCCCCHHHHHHHHHH
ADAKAEQARTFGELLAARRLLADLIGTSDPELSANVDGDDTRPALLPPETPSLDEQLAAA
HHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHH
ERDAARARIRVAKAVGVPDVTASGGVRRINDGRETAFVAGFSIPLPIRDRNRGNIEAASA
HHHHHHHHHHHHHHCCCCCCCCCCCCEECCCCCCEEEEEEEECCCCCCCCCCCCEECCCH
DSLAAEAALSQTRLDARRAQHDARMLLGAAEERVAALSGPALTQAEEALRLAQVGYAAGK
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHCCCC
FSLIELIDAQAALTATRKSLIDARLDRARALAALIRANAQ
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 2678100; 7766206 [H]