| Definition | Phenylobacterium zucineum HLK1, complete genome. |
|---|---|
| Accession | NC_011144 |
| Length | 3,996,255 |
Click here to switch to the map view.
The map label for this gene is dctA [H]
Identifier: 197104506
GI number: 197104506
Start: 1165014
End: 1166348
Strand: Direct
Name: dctA [H]
Synonym: PHZ_c1040
Alternate gene names: 197104506
Gene position: 1165014-1166348 (Clockwise)
Preceding gene: 197104505
Following gene: 197104510
Centisome position: 29.15
GC content: 70.41
Gene sequence:
>1335_bases TTGGCGACACTACCGGCGGCCGGCGCGGCGGCGCCCATCAGGCGCACGCCGATCTGGAACCAGCTCTATGTGCAGGTGCT GGTGGCGATCGCCGTCGGCGGGGCGATCGGCCACTTCTGGCCGGAGACCGGCGAGGCGCTGAAGCCGCTGGGCGACGCCT TCATCAAGCTGGTGAAGATGATCATCGCCCCGGTGATCTTCCTGACCGTCACCACGGGCATCGCCGGCATGCGCGACATC GGCAAGGTGGGCGGGGTGGCGGCCAAGGCGTTCGGCTACTTCATCGTGGTGTCCAGCTTCGCCCTGGTGGTGGGGCTGGT GGTGGCCAATGTGGTCCAGCCGGGCGCCGGGATGAACGTCGACCCGGCCACCCTCGACGCCGGGGCGGTGCAGGACTACG CGGCCAAGTCGCACGAGATGACCATCACCGGCTTCCTGATGGACATCATCCCCGCGACGGTCGCCGGGGCCTTCGTCAGC GGCAACATCCTGCAGGTGCTGTTCTTCTCGATCCCGTTCGGCCTGGCGCTGGCGATGATCGGCGAGCGGGGCGAGCCGGC GCTGGCGGTGCTGAACGCCGTGGCCGAGGCGTTCTTCCGGCTGGTGGCGATCTTCATGCGGGCGGCGCCCATCGGGGCGC TGGGGGCGTTCGCCTTCACGGTGGGCCGGTACGGGCTGGAGAGCATCGTCAACCTGGCGGCCCTGGTGGGCACGTTCTAC GCCACCTCGCTGATCTTCGTGCTGGTGGTGCTGGGGGCGATCGCCCGGCTGCACGGCTTCTCGATCCTGCGGCTGATCCG CTACCTGAAGGAGGAGCTGCTGCTGGTGCTGGGGACCTCGTCCTCGGAGGCGGCGCTGCCCAGCCTGCTCGAGAAGATGG AGCGGGCCGGGGCGCCCAAGACGGTGGTCGGGCTGGTGGTGCCCACCGGCTACAGCTTCAACCTCGACGGCACGAACATC TACATGACCCTGGCGGCCCTGTTCATCGCCCAGGCGGTGGGGATCGACCTGCCGCTGGGCGAACAGCTGCTGCTGCTGGC GGTGGCGATGCTGAGCTCGAAGGGGGCGGCGGGCGTCACGGGGGCCGGGTTCATCACCCTGGCCGCGACGCTGTCGGTCG TGCCCAGCGTGCCGGTGGCGGGGATGGCGCTGATCCTGGGCGTCGACCGGTTCATGAGCGAGTGCCGGGCGCTGACCAAC TTCGTCGGCAATGCGGTGGCGACCCTGGTGGTCAGCCGCTGGGAAGGGCAGCTCGACCGGCAGGCGCTGGAGGACGCGCT GTCGGGCGCGCCGCAGCCGATCGCGGCCCCGCCGGTGGAGGCCGACGCGGACTAG
Upstream 100 bases:
>100_bases GGCGGGCGGCGCACGGATCTCGACTGGTTCTGAGGCCGCGGCTGGTTCTGGGGCCGGCGGACCCTTATAGCCTCGCCGCG AGGAAGTTGGGGGACGACAC
Downstream 100 bases:
>100_bases GAGCGGCCTTCGCGGGTTCAGCTCGCGCGGGAGAGCGGCGTGGCGCGGGCGGCCGCGGCGCGGGTGACCGAGGCCATCAG CCCCGAGACCAGGATGGGCT
Product: C4-dicarboxylate transport protein
Products: orotate [Cytoplasm]; fumarate [Cytoplasm]; malate [Cytoplasm]; Na (I) [Cytoplasm]; succinate [Cytoplasm] [C]
Alternate protein names: NA
Number of amino acids: Translated: 444; Mature: 443
Protein sequence:
>444_residues MATLPAAGAAAPIRRTPIWNQLYVQVLVAIAVGGAIGHFWPETGEALKPLGDAFIKLVKMIIAPVIFLTVTTGIAGMRDI GKVGGVAAKAFGYFIVVSSFALVVGLVVANVVQPGAGMNVDPATLDAGAVQDYAAKSHEMTITGFLMDIIPATVAGAFVS GNILQVLFFSIPFGLALAMIGERGEPALAVLNAVAEAFFRLVAIFMRAAPIGALGAFAFTVGRYGLESIVNLAALVGTFY ATSLIFVLVVLGAIARLHGFSILRLIRYLKEELLLVLGTSSSEAALPSLLEKMERAGAPKTVVGLVVPTGYSFNLDGTNI YMTLAALFIAQAVGIDLPLGEQLLLLAVAMLSSKGAAGVTGAGFITLAATLSVVPSVPVAGMALILGVDRFMSECRALTN FVGNAVATLVVSRWEGQLDRQALEDALSGAPQPIAAPPVEADAD
Sequences:
>Translated_444_residues MATLPAAGAAAPIRRTPIWNQLYVQVLVAIAVGGAIGHFWPETGEALKPLGDAFIKLVKMIIAPVIFLTVTTGIAGMRDI GKVGGVAAKAFGYFIVVSSFALVVGLVVANVVQPGAGMNVDPATLDAGAVQDYAAKSHEMTITGFLMDIIPATVAGAFVS GNILQVLFFSIPFGLALAMIGERGEPALAVLNAVAEAFFRLVAIFMRAAPIGALGAFAFTVGRYGLESIVNLAALVGTFY ATSLIFVLVVLGAIARLHGFSILRLIRYLKEELLLVLGTSSSEAALPSLLEKMERAGAPKTVVGLVVPTGYSFNLDGTNI YMTLAALFIAQAVGIDLPLGEQLLLLAVAMLSSKGAAGVTGAGFITLAATLSVVPSVPVAGMALILGVDRFMSECRALTN FVGNAVATLVVSRWEGQLDRQALEDALSGAPQPIAAPPVEADAD >Mature_443_residues ATLPAAGAAAPIRRTPIWNQLYVQVLVAIAVGGAIGHFWPETGEALKPLGDAFIKLVKMIIAPVIFLTVTTGIAGMRDIG KVGGVAAKAFGYFIVVSSFALVVGLVVANVVQPGAGMNVDPATLDAGAVQDYAAKSHEMTITGFLMDIIPATVAGAFVSG NILQVLFFSIPFGLALAMIGERGEPALAVLNAVAEAFFRLVAIFMRAAPIGALGAFAFTVGRYGLESIVNLAALVGTFYA TSLIFVLVVLGAIARLHGFSILRLIRYLKEELLLVLGTSSSEAALPSLLEKMERAGAPKTVVGLVVPTGYSFNLDGTNIY MTLAALFIAQAVGIDLPLGEQLLLLAVAMLSSKGAAGVTGAGFITLAATLSVVPSVPVAGMALILGVDRFMSECRALTNF VGNAVATLVVSRWEGQLDRQALEDALSGAPQPIAAPPVEADAD
Specific function: Responsible for the transport of dicarboxylates such as succinate, fumarate, and malate from the periplasm across the membrane. This transport system plays an important role in the energy supply of rhizobium-legume symbionts [H]
COG id: COG1301
COG function: function code C; Na+/H+-dicarboxylate symporters
Gene ontology:
Cell location: Cell inner membrane; Multi-pass membrane protein [H]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the sodium:dicarboxylate (SDF) symporter (TC 2.A.23) family [H]
Homologues:
Organism=Homo sapiens, GI169790839, Length=430, Percent_Identity=25.8139534883721, Blast_Score=114, Evalue=2e-25, Organism=Homo sapiens, GI21314632, Length=426, Percent_Identity=25.5868544600939, Blast_Score=110, Evalue=4e-24, Organism=Homo sapiens, GI194239697, Length=468, Percent_Identity=23.7179487179487, Blast_Score=109, Evalue=5e-24, Organism=Homo sapiens, GI66773030, Length=425, Percent_Identity=26.5882352941176, Blast_Score=109, Evalue=6e-24, Organism=Homo sapiens, GI4827012, Length=282, Percent_Identity=29.4326241134752, Blast_Score=106, Evalue=4e-23, Organism=Homo sapiens, GI5032093, Length=409, Percent_Identity=28.361858190709, Blast_Score=103, Evalue=3e-22, Organism=Homo sapiens, GI40254478, Length=429, Percent_Identity=25.1748251748252, Blast_Score=100, Evalue=3e-21, Organism=Homo sapiens, GI223468566, Length=330, Percent_Identity=30.3030303030303, Blast_Score=99, Evalue=7e-21, Organism=Homo sapiens, GI223468564, Length=300, Percent_Identity=30.6666666666667, Blast_Score=97, Evalue=4e-20, Organism=Homo sapiens, GI262359914, Length=346, Percent_Identity=24.8554913294798, Blast_Score=81, Evalue=2e-15, Organism=Homo sapiens, GI301601644, Length=166, Percent_Identity=31.3253012048193, Blast_Score=77, Evalue=4e-14, Organism=Escherichia coli, GI1789947, Length=419, Percent_Identity=58.9498806682578, Blast_Score=503, Evalue=1e-143, Organism=Escherichia coli, GI1790514, Length=409, Percent_Identity=41.0757946210269, Blast_Score=308, Evalue=4e-85, Organism=Escherichia coli, GI1788024, Length=395, Percent_Identity=24.5569620253165, Blast_Score=97, Evalue=2e-21, Organism=Caenorhabditis elegans, GI17537407, Length=406, Percent_Identity=26.3546798029557, Blast_Score=116, Evalue=2e-26, Organism=Caenorhabditis elegans, GI71996953, Length=430, Percent_Identity=26.5116279069767, Blast_Score=116, Evalue=3e-26, Organism=Caenorhabditis elegans, GI71983106, Length=429, Percent_Identity=25.8741258741259, Blast_Score=106, Evalue=3e-23, Organism=Caenorhabditis elegans, GI71983099, Length=429, Percent_Identity=25.8741258741259, Blast_Score=106, Evalue=3e-23, Organism=Caenorhabditis elegans, GI193206505, Length=446, Percent_Identity=23.542600896861, Blast_Score=93, Evalue=3e-19, Organism=Caenorhabditis elegans, GI193206654, Length=465, Percent_Identity=22.3655913978495, Blast_Score=82, Evalue=7e-16, Organism=Caenorhabditis elegans, GI17541374, Length=412, Percent_Identity=22.8155339805825, Blast_Score=74, Evalue=2e-13, Organism=Drosophila melanogaster, GI24583025, Length=466, Percent_Identity=24.0343347639485, Blast_Score=116, Evalue=3e-26, Organism=Drosophila melanogaster, GI17137668, Length=466, Percent_Identity=24.0343347639485, Blast_Score=116, Evalue=3e-26, Organism=Drosophila melanogaster, GI24583023, Length=466, Percent_Identity=24.0343347639485, Blast_Score=116, Evalue=3e-26, Organism=Drosophila melanogaster, GI281360483, Length=431, Percent_Identity=25.2900232018561, Blast_Score=77, Evalue=3e-14, Organism=Drosophila melanogaster, GI17137666, Length=431, Percent_Identity=25.2900232018561, Blast_Score=77, Evalue=3e-14, Organism=Drosophila melanogaster, GI281360481, Length=431, Percent_Identity=25.2900232018561, Blast_Score=77, Evalue=3e-14,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR001991 - InterPro: IPR018107 [H]
Pfam domain/function: PF00375 SDF [H]
EC number: NA
Molecular weight: Translated: 45851; Mature: 45720
Theoretical pI: Translated: 5.15; Mature: 5.15
Prosite motif: PS00713 NA_DICARBOXYL_SYMP_1 ; PS00714 NA_DICARBOXYL_SYMP_2
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.2 %Cys (Translated Protein) 2.9 %Met (Translated Protein) 3.2 %Cys+Met (Translated Protein) 0.2 %Cys (Mature Protein) 2.7 %Met (Mature Protein) 2.9 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MATLPAAGAAAPIRRTPIWNQLYVQVLVAIAVGGAIGHFWPETGEALKPLGDAFIKLVKM CCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHH IIAPVIFLTVTTGIAGMRDIGKVGGVAAKAFGYFIVVSSFALVVGLVVANVVQPGAGMNV HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCC DPATLDAGAVQDYAAKSHEMTITGFLMDIIPATVAGAFVSGNILQVLFFSIPFGLALAMI CCCCCCHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHH GERGEPALAVLNAVAEAFFRLVAIFMRAAPIGALGAFAFTVGRYGLESIVNLAALVGTFY CCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHH ATSLIFVLVVLGAIARLHGFSILRLIRYLKEELLLVLGTSSSEAALPSLLEKMERAGAPK HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHEEEECCCCCHHHHHHHHHHHHHCCCCC TVVGLVVPTGYSFNLDGTNIYMTLAALFIAQAVGIDLPLGEQLLLLAVAMLSSKGAAGVT EEEEEEEECCEEECCCCCHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHCCCCCCCC GAGFITLAATLSVVPSVPVAGMALILGVDRFMSECRALTNFVGNAVATLVVSRWEGQLDR CHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHH QALEDALSGAPQPIAAPPVEADAD HHHHHHHCCCCCCCCCCCCCCCCC >Mature Secondary Structure ATLPAAGAAAPIRRTPIWNQLYVQVLVAIAVGGAIGHFWPETGEALKPLGDAFIKLVKM CCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHH IIAPVIFLTVTTGIAGMRDIGKVGGVAAKAFGYFIVVSSFALVVGLVVANVVQPGAGMNV HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCC DPATLDAGAVQDYAAKSHEMTITGFLMDIIPATVAGAFVSGNILQVLFFSIPFGLALAMI CCCCCCHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHH GERGEPALAVLNAVAEAFFRLVAIFMRAAPIGALGAFAFTVGRYGLESIVNLAALVGTFY CCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHH ATSLIFVLVVLGAIARLHGFSILRLIRYLKEELLLVLGTSSSEAALPSLLEKMERAGAPK HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHEEEECCCCCHHHHHHHHHHHHHCCCCC TVVGLVVPTGYSFNLDGTNIYMTLAALFIAQAVGIDLPLGEQLLLLAVAMLSSKGAAGVT EEEEEEEECCEEECCCCCHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHCCCCCCCC GAGFITLAATLSVVPSVPVAGMALILGVDRFMSECRALTNFVGNAVATLVVSRWEGQLDR CHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHH QALEDALSGAPQPIAAPPVEADAD HHHHHHHCCCCCCCCCCCCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: orotate [Periplasm]; fumarate [Periplasm]; malate [Periplasm]; Na (I) [Periplasm]; succinate [Periplasm] [C]
Specific reaction: Na (I) [Periplasm] + orotate [Periplasm] = Na (I) [Cytoplasm] + orotate [Cytoplasm] Na (I) [Periplasm] + fumarate [Periplasm] = Na (I) [Cytoplasm] + fumarate [Cytoplasm] Na (I) [Periplasm] + malate [Periplasm] = Na (I) [Cytoplasm] + malate [Cytoplasm] Na
General reaction: NA
Inhibitor: NA
Structure determination priority: 6.0
TargetDB status: NA
Availability: NA
References: 11214968 [H]