| Definition | Methylobacterium chloromethanicum CM4, complete genome. |
|---|---|
| Accession | NC_011757 |
| Length | 5,777,908 |
Click here to switch to the map view.
The map label for this gene is 218532588
Identifier: 218532588
GI number: 218532588
Start: 4983142
End: 4983831
Strand: Reverse
Name: 218532588
Synonym: Mchl_4702
Alternate gene names: NA
Gene position: 4983831-4983142 (Counterclockwise)
Preceding gene: 218532589
Following gene: 218532587
Centisome position: 86.26
GC content: 72.17
Gene sequence:
>690_bases GTGGTGACGGGCGTCTTCCTCGGCCTCGGCACATGGCAGGTCGAGCGCCGGATCTGGAAGCTCGACCTGATCGACCGAGT CGAGGCCCGCATCCGCGCCGAGCCCGCGCTCGCACCGGGCCCGGAGGAATGGGCCGGTCTCACGGCCGCCTCCGCCGAGT ACCGGCGGGTCCAACTCACCGGCCGCTTCGCCTATGATCGCGCCACGCTGGTCCAGGCGGTGACCGCCCGCGGCGCCGGT TTCTGGGTGCTGGTGCCGCTCGTGACCCACCGCGGTTTCACCGTCCTCGTCAACCGCGGCTTCGTGCCGACGGAGGCCCG CGAGCGCACGGCCCGTGCTGCGGGTGAGCCGGACGGGGACGTGACGGTCACGGGCCTGCTGCGCCTGACCGAGCCCGGCG GCGCCTTCCTGCGCCACAACGATCCGGCGGCCGACCGCTGGTACTCCCGCGACGTCGCGGCCATCGCCGCCGCCAGTGGG ATCGACGGCACGCCGAATGAGGTCGCGCCCTATTTCGTGGATGCCGACGCCGCGCCCAATCCCGGCGGTCTCCCGGTCGG CGGCCTCACGGTGGTGGCTTTCCACAACAACCATCTCGTCTACGCGCTGACATGGTACGCCCTCGCGCTGATGACCGCCG CGGCCCTCATCTACGCCCTCAGAGGGTCTCGCAGGATGCCGCGTCGCTGA
Upstream 100 bases:
>100_bases TGACGCGTCCCGCAAACCCGACGCTCCGGCGCCCGCCGCCCCGGCAACGGGTCGGCGGCGCCCATGGCTCGTCCGGCTCG CGCTGATCCTGGCGGGCCTT
Downstream 100 bases:
>100_bases CGGACCGCCCTTTGTCGGTCTGACGGGGCGATGACGCGGGGCATCCGGCCATGACGCCGGGTGAGGCGAGGCGCCCGGAA CCGTTGAAACTATTTTTCAC
Product: Surfeit locus 1 family protein
Products: NA
Alternate protein names: SurF1 Family Protein; SURF1 Family Protein; Surf1 Family Protein; Surfeit Locus; Surfeit 1 Protein; Surfeit Protein; SURF1 Family; Cytochrome Oxidase Complex Biogenesis Factor Protein; Transmembrane Cytochrome Oxidase Complex Biogenesis Protein; SUR1-Like Protein; Cytochrome C Oxidase Assembly Protein; Cytochrome C Oxidase Assembly; Surfeit Locus Protein; Surf1-Like Function; SURF-1 Protein; Surf1 Protein; Exported SurF1-Family Protein; Cytochrome C Oxidase Complex Biogenesis Factor Protein; Transmembrane Cytochrome Oxidase Biogenesis Protein
Number of amino acids: Translated: 229; Mature: 229
Protein sequence:
>229_residues MVTGVFLGLGTWQVERRIWKLDLIDRVEARIRAEPALAPGPEEWAGLTAASAEYRRVQLTGRFAYDRATLVQAVTARGAG FWVLVPLVTHRGFTVLVNRGFVPTEARERTARAAGEPDGDVTVTGLLRLTEPGGAFLRHNDPAADRWYSRDVAAIAAASG IDGTPNEVAPYFVDADAAPNPGGLPVGGLTVVAFHNNHLVYALTWYALALMTAAALIYALRGSRRMPRR
Sequences:
>Translated_229_residues MVTGVFLGLGTWQVERRIWKLDLIDRVEARIRAEPALAPGPEEWAGLTAASAEYRRVQLTGRFAYDRATLVQAVTARGAG FWVLVPLVTHRGFTVLVNRGFVPTEARERTARAAGEPDGDVTVTGLLRLTEPGGAFLRHNDPAADRWYSRDVAAIAAASG IDGTPNEVAPYFVDADAAPNPGGLPVGGLTVVAFHNNHLVYALTWYALALMTAAALIYALRGSRRMPRR >Mature_229_residues MVTGVFLGLGTWQVERRIWKLDLIDRVEARIRAEPALAPGPEEWAGLTAASAEYRRVQLTGRFAYDRATLVQAVTARGAG FWVLVPLVTHRGFTVLVNRGFVPTEARERTARAAGEPDGDVTVTGLLRLTEPGGAFLRHNDPAADRWYSRDVAAIAAASG IDGTPNEVAPYFVDADAAPNPGGLPVGGLTVVAFHNNHLVYALTWYALALMTAAALIYALRGSRRMPRR
Specific function: Unknown
COG id: COG3346
COG function: function code S; Uncharacterized conserved protein
Gene ontology:
Cell location: Cytoplasmic
Metaboloic importance: NA
Operon status: Not Known
Operon components: None
Similarity: NA
Homologues:
Organism=Homo sapiens, GI4507319, Length=225, Percent_Identity=36.8888888888889, Blast_Score=135, Evalue=3e-32, Organism=Caenorhabditis elegans, GI17553856, Length=236, Percent_Identity=27.9661016949153, Blast_Score=99, Evalue=3e-21, Organism=Drosophila melanogaster, GI17864366, Length=246, Percent_Identity=29.2682926829268, Blast_Score=97, Evalue=9e-21,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
NA
Pfam domain/function: NA
EC number: NA
Molecular weight: Translated: 24804; Mature: 24804
Theoretical pI: Translated: 9.69; Mature: 9.69
Prosite motif: PS50895 SURF1
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.0 %Cys (Translated Protein) 1.3 %Met (Translated Protein) 1.3 %Cys+Met (Translated Protein) 0.0 %Cys (Mature Protein) 1.3 %Met (Mature Protein) 1.3 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MVTGVFLGLGTWQVERRIWKLDLIDRVEARIRAEPALAPGPEEWAGLTAASAEYRRVQLT CCEEEEEECCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCHHHCCCEECCCCEEEEEEE GRFAYDRATLVQAVTARGAGFWVLVPLVTHRGFTVLVNRGFVPTEARERTARAAGEPDGD EEEEHHHHHHHHHHHHCCCCEEEEEEHHHCCCEEEEEECCCCCCHHHHHHHHHCCCCCCC VTVTGLLRLTEPGGAFLRHNDPAADRWYSRDVAAIAAASGIDGTPNEVAPYFVDADAAPN EEEEEEEEEECCCCCEEECCCCCHHHHHCCCHHHHHHHCCCCCCCCCCCCEEEECCCCCC PGGLPVGGLTVVAFHNNHLVYALTWYALALMTAAALIYALRGSRRMPRR CCCCCCCCEEEEEEECCCEEEHHHHHHHHHHHHHHHHHHHHCCCCCCCC >Mature Secondary Structure MVTGVFLGLGTWQVERRIWKLDLIDRVEARIRAEPALAPGPEEWAGLTAASAEYRRVQLT CCEEEEEECCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCHHHCCCEECCCCEEEEEEE GRFAYDRATLVQAVTARGAGFWVLVPLVTHRGFTVLVNRGFVPTEARERTARAAGEPDGD EEEEHHHHHHHHHHHHCCCCEEEEEEHHHCCCEEEEEECCCCCCHHHHHHHHHCCCCCCC VTVTGLLRLTEPGGAFLRHNDPAADRWYSRDVAAIAAASGIDGTPNEVAPYFVDADAAPN EEEEEEEEEECCCCCEEECCCCCHHHHHCCCHHHHHHHCCCCCCCCCCCCEEEECCCCCC PGGLPVGGLTVVAFHNNHLVYALTWYALALMTAAALIYALRGSRRMPRR CCCCCCCCEEEEEEECCCEEEHHHHHHHHHHHHHHHHHHHHCCCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 10.0
TargetDB status: NA
Availability: NA
References: NA