Definition Gluconacetobacter diazotrophicus PAl 5 chromosome, complete genome.
Accession NC_010125
Length 3,944,163

Click here to switch to the map view.

The map label for this gene is yfnA [H]

Identifier: 162147573

GI number: 162147573

Start: 1820650

End: 1822182

Strand: Reverse

Name: yfnA [H]

Synonym: GDI_1789

Alternate gene names: 162147573

Gene position: 1822182-1820650 (Counterclockwise)

Preceding gene: 162147574

Following gene: 162147567

Centisome position: 46.2

GC content: 65.75

Gene sequence:

>1533_bases
ATGTCCCTCATTTCCTTTTCCAGTAAACGCCTCCGGCTTCGGAAATCCATTCAGCAGATTGAATCCGAAAGCCAGAATCA
CGGGCTGCGCCGTACGCTCGGCCCCGTTCAGCTGATGATGCTCGGGATCGGTTCCACCATCGGGGCCGGGATCTATGTCA
TGACCGGAACCGCCGCCGCCACCTACGCAGGGCCGGCCATCCTGCTGTCATTCCTGGTCGCCGGCCTGGCCTGCCTGTTC
ACCGCGTTTTCGTATGGCGAACTGGCCTCGACGATGCCGGTTTCCGGTTCGGCCTACAGCTATGCCTATGTTTCGATGGG
CGAAGGGGTGGCCTGGGCGGTCGGGTGGCTGCTGCTGCTGGAATACGGCATATCCTGCGCCGGCGTGGCTGCCGGATTTT
CCGGATACGCGACCAGCCTGCTGCACGATCTGGGCGTCCATGTGCCGTCCTTCCTGTGCACCACGCTGGTCCAGACCGTG
CCCACCCCCCACGGCGCCAGCCTGCTGGTCGCGCCCCGGATGGGCCTGGTGGGGGCGGTCTCGGTCCTGGTCGTCACGGG
ACTGCTGGTCCTGGGCGTCGAGGAATCGGCGCGGATCAACACCCTGATCGTCTTCGTGAAGGTCGGCGTACTGATGCTGT
TCATGGCGTTCGGCATCCGGTACGTCCACCTGTCCAACCTCAATCCCTTCATCCCGCCGCGCGAAAACGGGTTCCATTAC
GGCGTGCCCGGCATCTTCCGGGCCGCGTCGGTCATCTTCTTCGCCTATGTCGGGTTCGAAACCGTCTCGACCGCGTCGGC
CGAGGCCCGCAATCCCCGCCGCGACGTGCCGCTGGGCATCATCGGGTCACTGCTGATCTGCACGCTGGTCTATATCTGCG
TGGCCACGGTGCTGATCGGGGTCGTGCCGTTCCGGCAACTGGGCGTCGCCGATCCGCTGGCAATAGCCGTGGATGCGATC
GGCCAGCCCTGGCTTGCGATCATGATCAAGGTGGGCGCCGTCGTCGGCCTGTGCTCGGTCATCCTGGGCCTGCTGTACGG
CCAGACGCGGATCTTCTTCACCATTGCGCGCGACGGGCTGCTGCCGCCGATCTTCTGCCGCCTGCACCCGACCTTCCGCA
CGCCATGGGTCGGCACCATCGTGCTGGGTGTCCTCGTCGCCGTGGCTACCGCGACCCTGCCGATCGACATCATCAGCGAC
CTGGTCAGCCTGGGCACCGCGACGGCGTTCGGCATCGTCTGCTTCACCGTGATCTGGCAGCGCAACGCCCGCCCCGACCT
GCACCGGCCGTTCAGCGTGCCGCTGGGCGGGGTCAAGGTCGGCGGGGTATGGATCGGCGTGGCGCCTGCGCTGGGCATCC
TGTTCTGCCTGATCATGGCCGGGCCGCTGTTCGTGGACATGATCCGGGCACTGACCAACGGCGATCCGCTGCCGGCCATC
CTGCTGGGCAGCTACATCGTCCTGGGCGTGCTCAGCTACGCCTTCTACGGCCATTCCCATTCGCGGCTGGGCCGTGAAGA
GGTCGCGCTGTAA

Upstream 100 bases:

>100_bases
GCCCCGTTTCGGTTCGTTCCGTTCGTTTCGCATTCGGTCCGGGCGGCCATGTTCGTTTGGCGCAATACAGCCCTCCCCCC
CTCATGCTATTTTGAAGTTC

Downstream 100 bases:

>100_bases
TCAGCCTGGAGGGCCGGTATAGGCGCCGGGCGGCGGCCGGTCGATCGGGGGGGACAGGATGCCGTGCGGGCCCAGCACGT
CCTGGCCGGCCGGGGACGAG

Product: cationic amino acid transporter

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 510; Mature: 509

Protein sequence:

>510_residues
MSLISFSSKRLRLRKSIQQIESESQNHGLRRTLGPVQLMMLGIGSTIGAGIYVMTGTAAATYAGPAILLSFLVAGLACLF
TAFSYGELASTMPVSGSAYSYAYVSMGEGVAWAVGWLLLLEYGISCAGVAAGFSGYATSLLHDLGVHVPSFLCTTLVQTV
PTPHGASLLVAPRMGLVGAVSVLVVTGLLVLGVEESARINTLIVFVKVGVLMLFMAFGIRYVHLSNLNPFIPPRENGFHY
GVPGIFRAASVIFFAYVGFETVSTASAEARNPRRDVPLGIIGSLLICTLVYICVATVLIGVVPFRQLGVADPLAIAVDAI
GQPWLAIMIKVGAVVGLCSVILGLLYGQTRIFFTIARDGLLPPIFCRLHPTFRTPWVGTIVLGVLVAVATATLPIDIISD
LVSLGTATAFGIVCFTVIWQRNARPDLHRPFSVPLGGVKVGGVWIGVAPALGILFCLIMAGPLFVDMIRALTNGDPLPAI
LLGSYIVLGVLSYAFYGHSHSRLGREEVAL

Sequences:

>Translated_510_residues
MSLISFSSKRLRLRKSIQQIESESQNHGLRRTLGPVQLMMLGIGSTIGAGIYVMTGTAAATYAGPAILLSFLVAGLACLF
TAFSYGELASTMPVSGSAYSYAYVSMGEGVAWAVGWLLLLEYGISCAGVAAGFSGYATSLLHDLGVHVPSFLCTTLVQTV
PTPHGASLLVAPRMGLVGAVSVLVVTGLLVLGVEESARINTLIVFVKVGVLMLFMAFGIRYVHLSNLNPFIPPRENGFHY
GVPGIFRAASVIFFAYVGFETVSTASAEARNPRRDVPLGIIGSLLICTLVYICVATVLIGVVPFRQLGVADPLAIAVDAI
GQPWLAIMIKVGAVVGLCSVILGLLYGQTRIFFTIARDGLLPPIFCRLHPTFRTPWVGTIVLGVLVAVATATLPIDIISD
LVSLGTATAFGIVCFTVIWQRNARPDLHRPFSVPLGGVKVGGVWIGVAPALGILFCLIMAGPLFVDMIRALTNGDPLPAI
LLGSYIVLGVLSYAFYGHSHSRLGREEVAL
>Mature_509_residues
SLISFSSKRLRLRKSIQQIESESQNHGLRRTLGPVQLMMLGIGSTIGAGIYVMTGTAAATYAGPAILLSFLVAGLACLFT
AFSYGELASTMPVSGSAYSYAYVSMGEGVAWAVGWLLLLEYGISCAGVAAGFSGYATSLLHDLGVHVPSFLCTTLVQTVP
TPHGASLLVAPRMGLVGAVSVLVVTGLLVLGVEESARINTLIVFVKVGVLMLFMAFGIRYVHLSNLNPFIPPRENGFHYG
VPGIFRAASVIFFAYVGFETVSTASAEARNPRRDVPLGIIGSLLICTLVYICVATVLIGVVPFRQLGVADPLAIAVDAIG
QPWLAIMIKVGAVVGLCSVILGLLYGQTRIFFTIARDGLLPPIFCRLHPTFRTPWVGTIVLGVLVAVATATLPIDIISDL
VSLGTATAFGIVCFTVIWQRNARPDLHRPFSVPLGGVKVGGVWIGVAPALGILFCLIMAGPLFVDMIRALTNGDPLPAIL
LGSYIVLGVLSYAFYGHSHSRLGREEVAL

Specific function: Probable Amino-Acid Or Metabolite Transport Protein. [C]

COG id: COG0531

COG function: function code E; Amino acid transporters

Gene ontology:

Cell location: Cell membrane; Multi-pass membrane protein (Potential) [H]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the amino acid-polyamine-organocation (APC) superfamily [H]

Homologues:

Organism=Homo sapiens, GI114326544, Length=439, Percent_Identity=33.2574031890661, Blast_Score=195, Evalue=1e-49,
Organism=Homo sapiens, GI114326550, Length=439, Percent_Identity=33.2574031890661, Blast_Score=195, Evalue=1e-49,
Organism=Homo sapiens, GI258614005, Length=433, Percent_Identity=30.715935334873, Blast_Score=193, Evalue=3e-49,
Organism=Homo sapiens, GI258614003, Length=433, Percent_Identity=30.715935334873, Blast_Score=193, Evalue=3e-49,
Organism=Homo sapiens, GI258645169, Length=433, Percent_Identity=31.6397228637413, Blast_Score=193, Evalue=4e-49,
Organism=Homo sapiens, GI4507047, Length=447, Percent_Identity=31.5436241610738, Blast_Score=189, Evalue=7e-48,
Organism=Homo sapiens, GI110347453, Length=418, Percent_Identity=33.7320574162679, Blast_Score=183, Evalue=4e-46,
Organism=Homo sapiens, GI181337167, Length=414, Percent_Identity=30.6763285024155, Blast_Score=171, Evalue=1e-42,
Organism=Homo sapiens, GI7657683, Length=400, Percent_Identity=25, Blast_Score=92, Evalue=1e-18,
Organism=Homo sapiens, GI71979932, Length=426, Percent_Identity=27.4647887323944, Blast_Score=87, Evalue=4e-17,
Organism=Homo sapiens, GI186910308, Length=468, Percent_Identity=25, Blast_Score=86, Evalue=8e-17,
Organism=Homo sapiens, GI186910306, Length=468, Percent_Identity=25, Blast_Score=86, Evalue=8e-17,
Organism=Homo sapiens, GI186910304, Length=468, Percent_Identity=25, Blast_Score=86, Evalue=8e-17,
Organism=Homo sapiens, GI115648063, Length=464, Percent_Identity=23.9224137931034, Blast_Score=78, Evalue=2e-14,
Organism=Homo sapiens, GI115648022, Length=464, Percent_Identity=23.9224137931034, Blast_Score=78, Evalue=2e-14,
Organism=Homo sapiens, GI187423910, Length=440, Percent_Identity=21.5909090909091, Blast_Score=72, Evalue=1e-12,
Organism=Homo sapiens, GI7657591, Length=440, Percent_Identity=21.5909090909091, Blast_Score=72, Evalue=1e-12,
Organism=Escherichia coli, GI87081869, Length=458, Percent_Identity=26.4192139737991, Blast_Score=105, Evalue=7e-24,
Organism=Escherichia coli, GI87081708, Length=484, Percent_Identity=23.7603305785124, Blast_Score=96, Evalue=4e-21,
Organism=Escherichia coli, GI87082250, Length=498, Percent_Identity=24.4979919678715, Blast_Score=93, Evalue=4e-20,
Organism=Escherichia coli, GI1788480, Length=368, Percent_Identity=26.6304347826087, Blast_Score=91, Evalue=1e-19,
Organism=Escherichia coli, GI87082023, Length=471, Percent_Identity=24.203821656051, Blast_Score=88, Evalue=2e-18,
Organism=Escherichia coli, GI87081915, Length=413, Percent_Identity=24.455205811138, Blast_Score=86, Evalue=8e-18,
Organism=Escherichia coli, GI1786694, Length=410, Percent_Identity=23.9024390243902, Blast_Score=83, Evalue=5e-17,
Organism=Escherichia coli, GI1790653, Length=435, Percent_Identity=22.5287356321839, Blast_Score=79, Evalue=9e-16,
Organism=Escherichia coli, GI2367353, Length=380, Percent_Identity=25.5263157894737, Blast_Score=77, Evalue=2e-15,
Organism=Escherichia coli, GI1789017, Length=370, Percent_Identity=21.8918918918919, Blast_Score=76, Evalue=4e-15,
Organism=Escherichia coli, GI1786302, Length=349, Percent_Identity=22.9226361031519, Blast_Score=75, Evalue=1e-14,
Organism=Escherichia coli, GI48994972, Length=349, Percent_Identity=23.7822349570201, Blast_Score=72, Evalue=1e-13,
Organism=Escherichia coli, GI1786602, Length=457, Percent_Identity=24.0700218818381, Blast_Score=72, Evalue=1e-13,
Organism=Caenorhabditis elegans, GI17532491, Length=440, Percent_Identity=30.6818181818182, Blast_Score=209, Evalue=3e-54,
Organism=Caenorhabditis elegans, GI17533459, Length=401, Percent_Identity=32.9177057356608, Blast_Score=193, Evalue=2e-49,
Organism=Caenorhabditis elegans, GI17531343, Length=403, Percent_Identity=29.0322580645161, Blast_Score=175, Evalue=6e-44,
Organism=Caenorhabditis elegans, GI17537453, Length=399, Percent_Identity=24.5614035087719, Blast_Score=82, Evalue=7e-16,
Organism=Caenorhabditis elegans, GI17568033, Length=437, Percent_Identity=20.5949656750572, Blast_Score=67, Evalue=3e-11,
Organism=Caenorhabditis elegans, GI17540018, Length=215, Percent_Identity=23.2558139534884, Blast_Score=66, Evalue=4e-11,
Organism=Caenorhabditis elegans, GI32566699, Length=320, Percent_Identity=24.375, Blast_Score=65, Evalue=8e-11,
Organism=Drosophila melanogaster, GI221512776, Length=434, Percent_Identity=32.7188940092166, Blast_Score=222, Evalue=6e-58,
Organism=Drosophila melanogaster, GI24666159, Length=434, Percent_Identity=32.7188940092166, Blast_Score=221, Evalue=6e-58,
Organism=Drosophila melanogaster, GI24668806, Length=434, Percent_Identity=32.0276497695853, Blast_Score=219, Evalue=4e-57,
Organism=Drosophila melanogaster, GI21356285, Length=434, Percent_Identity=32.0276497695853, Blast_Score=219, Evalue=4e-57,
Organism=Drosophila melanogaster, GI24668802, Length=434, Percent_Identity=32.0276497695853, Blast_Score=219, Evalue=4e-57,
Organism=Drosophila melanogaster, GI24667468, Length=441, Percent_Identity=32.1995464852608, Blast_Score=214, Evalue=1e-55,
Organism=Drosophila melanogaster, GI281366235, Length=424, Percent_Identity=33.9622641509434, Blast_Score=184, Evalue=9e-47,
Organism=Drosophila melanogaster, GI116007820, Length=424, Percent_Identity=33.9622641509434, Blast_Score=184, Evalue=9e-47,
Organism=Drosophila melanogaster, GI116007818, Length=424, Percent_Identity=33.9622641509434, Blast_Score=181, Evalue=2e-45,
Organism=Drosophila melanogaster, GI85725152, Length=424, Percent_Identity=33.9622641509434, Blast_Score=181, Evalue=2e-45,
Organism=Drosophila melanogaster, GI161077963, Length=411, Percent_Identity=29.4403892944039, Blast_Score=165, Evalue=8e-41,
Organism=Drosophila melanogaster, GI45550968, Length=422, Percent_Identity=24.6445497630332, Blast_Score=87, Evalue=3e-17,
Organism=Drosophila melanogaster, GI19921172, Length=422, Percent_Identity=24.6445497630332, Blast_Score=87, Evalue=3e-17,
Organism=Drosophila melanogaster, GI21357367, Length=455, Percent_Identity=22.4175824175824, Blast_Score=82, Evalue=9e-16,
Organism=Drosophila melanogaster, GI24651635, Length=395, Percent_Identity=23.2911392405063, Blast_Score=81, Evalue=2e-15,
Organism=Drosophila melanogaster, GI24651633, Length=395, Percent_Identity=23.2911392405063, Blast_Score=81, Evalue=2e-15,
Organism=Drosophila melanogaster, GI24641993, Length=439, Percent_Identity=23.2346241457859, Blast_Score=71, Evalue=2e-12,
Organism=Drosophila melanogaster, GI24641995, Length=439, Percent_Identity=23.2346241457859, Blast_Score=71, Evalue=2e-12,
Organism=Drosophila melanogaster, GI221331183, Length=430, Percent_Identity=22.5581395348837, Blast_Score=71, Evalue=2e-12,
Organism=Drosophila melanogaster, GI17647653, Length=430, Percent_Identity=22.5581395348837, Blast_Score=71, Evalue=2e-12,
Organism=Drosophila melanogaster, GI24664379, Length=430, Percent_Identity=22.5581395348837, Blast_Score=71, Evalue=2e-12,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR004841
- InterPro:   IPR002293
- InterPro:   IPR015606 [H]

Pfam domain/function: PF00324 AA_permease [H]

EC number: NA

Molecular weight: Translated: 53909; Mature: 53778

Theoretical pI: Translated: 8.75; Mature: 8.75

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.8 %Cys     (Translated Protein)
2.4 %Met     (Translated Protein)
4.1 %Cys+Met (Translated Protein)
1.8 %Cys     (Mature Protein)
2.2 %Met     (Mature Protein)
3.9 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSLISFSSKRLRLRKSIQQIESESQNHGLRRTLGPVQLMMLGIGSTIGAGIYVMTGTAAA
CCCCCCHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHCHHHCCCEEEEECCCHH
TYAGPAILLSFLVAGLACLFTAFSYGELASTMPVSGSAYSYAYVSMGEGVAWAVGWLLLL
HHCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCEEEEEECCCCHHHHHHHHHHH
EYGISCAGVAAGFSGYATSLLHDLGVHVPSFLCTTLVQTVPTPHGASLLVAPRMGLVGAV
HHCCCHHHHHHCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEEECCCCHHHHH
SVLVVTGLLVLGVEESARINTLIVFVKVGVLMLFMAFGIRYVHLSNLNPFIPPRENGFHY
HHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHEEEEECCCCCCCCCCCCCCCC
GVPGIFRAASVIFFAYVGFETVSTASAEARNPRRDVPLGIIGSLLICTLVYICVATVLIG
CCCHHHHHHHHHHHHHHHHHHHHCCCHHCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHH
VVPFRQLGVADPLAIAVDAIGQPWLAIMIKVGAVVGLCSVILGLLYGQTRIFFTIARDGL
HHHHHHHCCCCHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHCCHHEEEEEECCCC
LPPIFCRLHPTFRTPWVGTIVLGVLVAVATATLPIDIISDLVSLGTATAFGIVCFTVIWQ
CCCHHEEECCCCCCCHHHHHHHHHHHHHHHHHCHHHHHHHHHHHHHHHHHHHHHHHHHHH
RNARPDLHRPFSVPLGGVKVGGVWIGVAPALGILFCLIMAGPLFVDMIRALTNGDPLPAI
CCCCCCCCCCCCCCCCCEEECCEEEEHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHH
LLGSYIVLGVLSYAFYGHSHSRLGREEVAL
HHHHHHHHHHHHHHHHCCCHHHCCHHHCCC
>Mature Secondary Structure 
SLISFSSKRLRLRKSIQQIESESQNHGLRRTLGPVQLMMLGIGSTIGAGIYVMTGTAAA
CCCCCHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHCHHHCCCEEEEECCCHH
TYAGPAILLSFLVAGLACLFTAFSYGELASTMPVSGSAYSYAYVSMGEGVAWAVGWLLLL
HHCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCEEEEEECCCCHHHHHHHHHHH
EYGISCAGVAAGFSGYATSLLHDLGVHVPSFLCTTLVQTVPTPHGASLLVAPRMGLVGAV
HHCCCHHHHHHCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEEECCCCHHHHH
SVLVVTGLLVLGVEESARINTLIVFVKVGVLMLFMAFGIRYVHLSNLNPFIPPRENGFHY
HHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHEEEEECCCCCCCCCCCCCCCC
GVPGIFRAASVIFFAYVGFETVSTASAEARNPRRDVPLGIIGSLLICTLVYICVATVLIG
CCCHHHHHHHHHHHHHHHHHHHHCCCHHCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHH
VVPFRQLGVADPLAIAVDAIGQPWLAIMIKVGAVVGLCSVILGLLYGQTRIFFTIARDGL
HHHHHHHCCCCHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHCCHHEEEEEECCCC
LPPIFCRLHPTFRTPWVGTIVLGVLVAVATATLPIDIISDLVSLGTATAFGIVCFTVIWQ
CCCHHEEECCCCCCCHHHHHHHHHHHHHHHHHCHHHHHHHHHHHHHHHHHHHHHHHHHHH
RNARPDLHRPFSVPLGGVKVGGVWIGVAPALGILFCLIMAGPLFVDMIRALTNGDPLPAI
CCCCCCCCCCCCCCCCCEEECCEEEEHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHH
LLGSYIVLGVLSYAFYGHSHSRLGREEVAL
HHHHHHHHHHHHHHHHCCCHHHCCHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 9141694; 9384377 [H]