| Definition | Corynebacterium diphtheriae NCTC 13129 chromosome, complete genome. |
|---|---|
| Accession | NC_002935 |
| Length | 2,488,635 |
Click here to switch to the map view.
The map label for this gene is smvA [H]
Identifier: 38234508
GI number: 38234508
Start: 1993436
End: 1994935
Strand: Direct
Name: smvA [H]
Synonym: DIP1941
Alternate gene names: 38234508
Gene position: 1993436-1994935 (Clockwise)
Preceding gene: 38234507
Following gene: 38234509
Centisome position: 80.1
GC content: 51.53
Gene sequence:
>1500_bases ATGACTTCGCACAGCACCCCCACAGGAGAAAAGTCTGCAGGACTTAAGTCCCACGACCAGCGGTGGATTTTTCTTGGAAT CATCTCACTTGGCCTGTTCGTCGTCGGCGCAGATAACTCGGTGCTTTATACGGCTCTGCCCGCGCTCCACGTACATCTTC ATACTTCGGAGCTCGAAGGCCTGTGGATCATCAATGCTTACTCGCTGGTGCTCGCAGGACTTCTACTTGGAACTGGCACT CTTGGTGACAAAATTGGTCATCGCCGCATGTTCGAAATCGGACTTTCAGTATTTGCAGGTGCTTCGATCCTGGCAGCTGT ATCGCCCAACGCTGCAACGCTGATTACAGCTCGCGCCCTACTAGGGATAGGCGCATCAACGATGATGCCCGCCTCACTAG CACTACTGAGAATTACTTTTACCGATATTCGTGAACGCAACACTGCCATTGGCATTTGGGGAGCAGTTGCAACACTCGGC GCTGCTTTAGGGCCAGTTCTTGGCGGATTTCTTTTAGAGCATTACTACTGGGGATCGATCTTTCTCATCAACGTTCCGGT CGTCATCATCGCACTGGTAGGTACGTACTTCATGGCACCGAAAAACCGGCCTAATCCACAACGAAGCTGGGATTTCCTTT CCTCAATGTTCGCAATGTTTTTCATGGTGGGACTTGTGCTCCTCATCAAAGAATGTGCTCACACACCAATATCTTTCGCC ATGCTCGCATTGGGGTTTGCTTTTATGGCTGTAGGTGCCGCTCTCTTTTGGTGGCGCCACTCACACCTCGACGAGCCGCT ACTTCGGTTCGGAGTTTTCCGAAATTCCCTCTTCAGTGCGGGAGTATTGGCAGCAACCTGTGCGATGTTAATTCTGTCTG GCACCGAGCTTCTTACCACCCAACGTTTCCAGCTGGCAGAAGGTTTTACGCCACTTCAAGCAGGTCTACTTTCTGCAGCT ACTGCGCTTGCAGCTTTCCCCAGTTCCATTGGCGGTGGCGCAATCGTGCACAAGGTGGGATTCCGTCCCCTTATTAGCGG AGGATTCTTGGTCATGTGTACGGGAGGTGCCCTCACAGCGTTTTCGGTTCCCCACAATATTTTCCCGCTCTTGATCACTG GTTTATTGCTGTGCGGTTTCGGAGCCGGCATGGTGATGTCAGTGTCATCCACGGCTGTGATCGGATCAGCACCATCTCGT GACTCTGGAATGGCCTCTGCAATGGAAGCAGTAAGTTACGAATTTGGTTCCCTCATTTCTGTGGCTCTGTTCGGTTCGCT TTTCAGCTTCTTCTACAGCGTTAACGCTCCAGAAGAAATAGCCGCTTCCTTTGATCAAGGACTCCATCATCCGGAGCTTC ATATCAATGCCCGCCTTTTAATGAACGAGTCCTATGCCACCGTGATCTGGATAGCAGCCGCGATTGGGCTCACCTGCGCC TTAGCTACTGCATGGCTACTTCGCAACAACCCTAAGGAAACTGAATATGCGCACGAATAA
Upstream 100 bases:
>100_bases CCCCCGCCAACCAGCGCCGCCGAAGAAAAACATCGTCCTTGTAGCTTTACTAAACACCCTACCATTGAAACTGTAACGAA CGTTCGGTATTGTTTCAAAC
Downstream 100 bases:
>100_bases GAAACAACAATTACTGGCAACCGCTATGGATATTGTGGAATCCGATGGGTTACAAGGACTCACCTATGATTCCCTGAGTA CGGCTACTGGTACCTCAAAA
Product: hypothetical protein
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 499; Mature: 498
Protein sequence:
>499_residues MTSHSTPTGEKSAGLKSHDQRWIFLGIISLGLFVVGADNSVLYTALPALHVHLHTSELEGLWIINAYSLVLAGLLLGTGT LGDKIGHRRMFEIGLSVFAGASILAAVSPNAATLITARALLGIGASTMMPASLALLRITFTDIRERNTAIGIWGAVATLG AALGPVLGGFLLEHYYWGSIFLINVPVVIIALVGTYFMAPKNRPNPQRSWDFLSSMFAMFFMVGLVLLIKECAHTPISFA MLALGFAFMAVGAALFWWRHSHLDEPLLRFGVFRNSLFSAGVLAATCAMLILSGTELLTTQRFQLAEGFTPLQAGLLSAA TALAAFPSSIGGGAIVHKVGFRPLISGGFLVMCTGGALTAFSVPHNIFPLLITGLLLCGFGAGMVMSVSSTAVIGSAPSR DSGMASAMEAVSYEFGSLISVALFGSLFSFFYSVNAPEEIAASFDQGLHHPELHINARLLMNESYATVIWIAAAIGLTCA LATAWLLRNNPKETEYAHE
Sequences:
>Translated_499_residues MTSHSTPTGEKSAGLKSHDQRWIFLGIISLGLFVVGADNSVLYTALPALHVHLHTSELEGLWIINAYSLVLAGLLLGTGT LGDKIGHRRMFEIGLSVFAGASILAAVSPNAATLITARALLGIGASTMMPASLALLRITFTDIRERNTAIGIWGAVATLG AALGPVLGGFLLEHYYWGSIFLINVPVVIIALVGTYFMAPKNRPNPQRSWDFLSSMFAMFFMVGLVLLIKECAHTPISFA MLALGFAFMAVGAALFWWRHSHLDEPLLRFGVFRNSLFSAGVLAATCAMLILSGTELLTTQRFQLAEGFTPLQAGLLSAA TALAAFPSSIGGGAIVHKVGFRPLISGGFLVMCTGGALTAFSVPHNIFPLLITGLLLCGFGAGMVMSVSSTAVIGSAPSR DSGMASAMEAVSYEFGSLISVALFGSLFSFFYSVNAPEEIAASFDQGLHHPELHINARLLMNESYATVIWIAAAIGLTCA LATAWLLRNNPKETEYAHE >Mature_498_residues TSHSTPTGEKSAGLKSHDQRWIFLGIISLGLFVVGADNSVLYTALPALHVHLHTSELEGLWIINAYSLVLAGLLLGTGTL GDKIGHRRMFEIGLSVFAGASILAAVSPNAATLITARALLGIGASTMMPASLALLRITFTDIRERNTAIGIWGAVATLGA ALGPVLGGFLLEHYYWGSIFLINVPVVIIALVGTYFMAPKNRPNPQRSWDFLSSMFAMFFMVGLVLLIKECAHTPISFAM LALGFAFMAVGAALFWWRHSHLDEPLLRFGVFRNSLFSAGVLAATCAMLILSGTELLTTQRFQLAEGFTPLQAGLLSAAT ALAAFPSSIGGGAIVHKVGFRPLISGGFLVMCTGGALTAFSVPHNIFPLLITGLLLCGFGAGMVMSVSSTAVIGSAPSRD SGMASAMEAVSYEFGSLISVALFGSLFSFFYSVNAPEEIAASFDQGLHHPELHINARLLMNESYATVIWIAAAIGLTCAL ATAWLLRNNPKETEYAHE
Specific function: Unknown
COG id: NA
COG function: NA
Gene ontology:
Cell location: Cell inner membrane; Multi-pass membrane protein (Potential) [H]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the major facilitator superfamily. TCR/tet family [H]
Homologues:
Organism=Escherichia coli, GI87081983, Length=420, Percent_Identity=27.8571428571429, Blast_Score=121, Evalue=1e-28, Organism=Escherichia coli, GI1790195, Length=419, Percent_Identity=27.2076372315036, Blast_Score=110, Evalue=2e-25, Organism=Escherichia coli, GI1788710, Length=470, Percent_Identity=23.6170212765957, Blast_Score=107, Evalue=1e-24, Organism=Escherichia coli, GI1789042, Length=327, Percent_Identity=25.9938837920489, Blast_Score=96, Evalue=4e-21, Organism=Escherichia coli, GI1788392, Length=326, Percent_Identity=31.2883435582822, Blast_Score=89, Evalue=8e-19, Organism=Saccharomyces cerevisiae, GI6324954, Length=292, Percent_Identity=27.3972602739726, Blast_Score=76, Evalue=1e-14,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR020846 - InterPro: IPR011701 - InterPro: IPR016196 - InterPro: IPR001411 [H]
Pfam domain/function: PF07690 MFS_1 [H]
EC number: NA
Molecular weight: Translated: 52945; Mature: 52813
Theoretical pI: Translated: 7.10; Mature: 7.10
Prosite motif: PS50850 MFS
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.0 %Cys (Translated Protein) 3.4 %Met (Translated Protein) 4.4 %Cys+Met (Translated Protein) 1.0 %Cys (Mature Protein) 3.2 %Met (Mature Protein) 4.2 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MTSHSTPTGEKSAGLKSHDQRWIFLGIISLGLFVVGADNSVLYTALPALHVHLHTSELEG CCCCCCCCCCCCCCCCCCCCCEEHHHHHHHHHEEECCCCCEEEEECCCCEEEEEECCCCC LWIINAYSLVLAGLLLGTGTLGDKIGHRRMFEIGLSVFAGASILAAVSPNAATLITARAL EEEEHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHCHHHEEECCCCHHHHHHHHHH LGIGASTMMPASLALLRITFTDIRERNTAIGIWGAVATLGAALGPVLGGFLLEHYYWGSI HHCCCHHHHHHHHHHHHHHHHHHHCCCCEEEHHHHHHHHHHHHHHHHHHHHHHHHHCCEE FLINVPVVIIALVGTYFMAPKNRPNPQRSWDFLSSMFAMFFMVGLVLLIKECAHTPISFA EEHHHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHH MLALGFAFMAVGAALFWWRHSHLDEPLLRFGVFRNSLFSAGVLAATCAMLILSGTELLTT HHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHH QRFQLAEGFTPLQAGLLSAATALAAFPSSIGGGAIVHKVGFRPLISGGFLVMCTGGALTA HHHHHHCCCCHHHHHHHHHHHHHHHCCCCCCCCHHHHHCCCCEECCCCEEEEECCCCEEE FSVPHNIFPLLITGLLLCGFGAGMVMSVSSTAVIGSAPSRDSGMASAMEAVSYEFGSLIS ECCCHHHHHHHHHHHHHHHCCCCCEEEECCCEEECCCCCCCCHHHHHHHHHHHHHHHHHH VALFGSLFSFFYSVNAPEEIAASFDQGLHHPELHINARLLMNESYATVIWIAAAIGLTCA HHHHHHHHHHHHCCCCHHHHHHHHHHCCCCCCEEEEEEEEECCCHHHHHHHHHHHHHHHH LATAWLLRNNPKETEYAHE HHHHHHHCCCCCCCCCCCC >Mature Secondary Structure TSHSTPTGEKSAGLKSHDQRWIFLGIISLGLFVVGADNSVLYTALPALHVHLHTSELEG CCCCCCCCCCCCCCCCCCCCEEHHHHHHHHHEEECCCCCEEEEECCCCEEEEEECCCCC LWIINAYSLVLAGLLLGTGTLGDKIGHRRMFEIGLSVFAGASILAAVSPNAATLITARAL EEEEHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHCHHHEEECCCCHHHHHHHHHH LGIGASTMMPASLALLRITFTDIRERNTAIGIWGAVATLGAALGPVLGGFLLEHYYWGSI HHCCCHHHHHHHHHHHHHHHHHHHCCCCEEEHHHHHHHHHHHHHHHHHHHHHHHHHCCEE FLINVPVVIIALVGTYFMAPKNRPNPQRSWDFLSSMFAMFFMVGLVLLIKECAHTPISFA EEHHHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHH MLALGFAFMAVGAALFWWRHSHLDEPLLRFGVFRNSLFSAGVLAATCAMLILSGTELLTT HHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHH QRFQLAEGFTPLQAGLLSAATALAAFPSSIGGGAIVHKVGFRPLISGGFLVMCTGGALTA HHHHHHCCCCHHHHHHHHHHHHHHHCCCCCCCCHHHHHCCCCEECCCCEEEEECCCCEEE FSVPHNIFPLLITGLLLCGFGAGMVMSVSSTAVIGSAPSRDSGMASAMEAVSYEFGSLIS ECCCHHHHHHHHHHHHHHHCCCCCEEEECCCEEECCCCCCCCHHHHHHHHHHHHHHHHHH VALFGSLFSFFYSVNAPEEIAASFDQGLHHPELHINARLLMNESYATVIWIAAAIGLTCA HHHHHHHHHHHHCCCCHHHHHHHHHHCCCCCCEEEEEEEEECCCHHHHHHHHHHHHHHHH LATAWLLRNNPKETEYAHE HHHHHHHCCCCCCCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 6.0
TargetDB status: NA
Availability: NA
References: 7926834; 11677609 [H]