The gene/protein map for NC_012032 is currently unavailable.
Definition Chloroflexus sp. Y-400-fl chromosome, complete genome.
Accession NC_012032
Length 5,268,950

Click here to switch to the map view.

The map label for this gene is appA [H]

Identifier: 222524535

GI number: 222524535

Start: 1602812

End: 1604635

Strand: Direct

Name: appA [H]

Synonym: Chy400_1259

Alternate gene names: 222524535

Gene position: 1602812-1604635 (Clockwise)

Preceding gene: 222524533

Following gene: 222524536

Centisome position: 30.42

GC content: 57.68

Gene sequence:

>1824_bases
GTGGTTCCCTTTCCGTGCCCCGGTGTTCGGTCGGAATTGTGTTTCTGCATTGCTTTTGTATTGTACCATAAGGTTTCGGT
AGGTGCTGCCCAAGAAAATAAGCGTTGGTATAATATTTCTATGCATAACGATTACAGGCTTCGCCACAACCGATTGCTAT
TCATCTTGATCATGTTGAGCGTCCTCCTGGCTGCATGTGCCACACTCCCCCCACCGACGCCAACGGCAACGATGCTGCCT
ACAGCCACGCTCCCACCAACGGCAACCCCACTTCCCCGTGGTGGTACACTGAGCATACGAATTGCTGCTCCTGTTACCGA
TCTGCGCCCCTGGCAGCCACGTTCTCGTGGTGAAGAACATCTGATCAGTCTGCTCTACAGTGGTTTGATGCGTCTCGATG
CCGATCTGTGGCCAAACCCCGATCTGGCTGAGCGGCTTGACATTGATGTCGATGGACGACGATTGACGTTTACGCTCCGT
CAGAACGTGTACTGGCACGACGGTGAACCGCTGACGGCTGCCGATGTGCTCTTCACATTGGAAGCGCTGCGCAGTCTGCC
CGAAACCAGTACTGCCCTCCTGGCCGACCTGCGCTACATTGCTGCGGCGTCTGCCCCTGATGAACGCACGGTCGTGATTG
AGTTGCGCAGCCGCTATGCGCCGATGCTGAGTCTGCTAGCCGTTCCTATCTTACCCCGTCACCTGTTTGCCGGGCGTGAT
GTGAGTCAGATCAATTTTCTTGATCAGCCGATTGGGAGCGGCCCTTTTCGTCTGCGGGAACGGCAGGCCGATGGCAGTCT
GGTGCTGGAACGACACGATCAGTATCATCACGGCTCACCACTCCTCGATCAGGTGATGCTGACAGTCATGCCGGAAACAG
CGACAGCTCAGCAAGCCCTTCGTGATGGGCAATTGTTGGTGGCCGAACTGCCCTGGGGTGCCCAGGATGCGCTCGTTGAT
GTCACAACCTTGCGTAATGGCAGTATTCCCGAAAATGGGGTCTATTTTCTGGCCTTCAATTTGCGTCCCGGTCGTCCGTT
TGCCGATGTGCGCCTGCGGCAGGCGCTGGCAACGGCTATCGATTTGCCGCGCCTGGTGGAGACGGCAACCAAGGGGGTGG
GGGTGCCGGTCGGCAATGGCGCCTTGCCGGGTAGCTGGGCCGATCTGACGCCGCCACTGCCGGCTGGCGACCTGCCGGCT
GCACGCGAGATACTTGATGCCGCCGGTTGGGTATTGCCTCCCGGTGCAACAATCCGCCAACGGGAGGGAGTACCGCTGAT
CGCCCGCCTCTACGTTCGGAACGATGATGAACGGCGATTGGTGGCTGCCCGTCGCATCGCCGAAATTGCTGCCAGCATCG
GTATCCAGATTGTCGTAGAACCGGCTGATTTCGCAACCGTCATTCTGGCACGCTACGTGGCACCATACGATTTCGACCTC
TTGCTGGGAAGCTGGTTGAACGGCGCCGGTGATCCGAACTTTGCCGATACGATGTTCTACGACCCCGATGATTTTGCGCT
CTTCCATTCCAGTCAGCTTGAACAGGGGCCGGGTGACACCCGTGCTACCCGCAATTTTGTTGGCTTCAACGATCCGGTGT
ACGACGAGCAGGCACTGATTGCCCGTCAGCTCTACGGTCGTGAGGAACGGCGCAGTGCAATTGCCCAGACCCAGGCTCGC
CTGGCCAGTGAATTGCCTTACCTCTACTTATGGGTTGATCGCACCGCAGTCGTGATCAACACACGGGTACAAACGCTTGA
CGGGCCGGTTGATCTGACGACACCGCGCTACTTGTGGAATATTGAACGCTGGTACCTTCAGTAA

Upstream 100 bases:

>100_bases
AGTGTAGATTGTATTGTGCCGGCGAAAGGATTGCGCCTGTCCAAAAGGGCTTAAACGATCCCAGACGATCACTTCCGCTT
CTTGCAGCCGTGAGGTCATT

Downstream 100 bases:

>100_bases
CCCGGTAAACAGGTTAGCGGTGGAGGTCGCATGAAAAATCCCTTCGCTGAGCGCGGACGGATTACCGATCCGGGCAAATT
TGTTGGTCGCTGGCGCGAGC

Product: family 5 extracellular solute-binding protein

Products: ADP; phosphate; dipeptides [Cytoplasm] [C]

Alternate protein names: NA

Number of amino acids: Translated: 607; Mature: 607

Protein sequence:

>607_residues
MVPFPCPGVRSELCFCIAFVLYHKVSVGAAQENKRWYNISMHNDYRLRHNRLLFILIMLSVLLAACATLPPPTPTATMLP
TATLPPTATPLPRGGTLSIRIAAPVTDLRPWQPRSRGEEHLISLLYSGLMRLDADLWPNPDLAERLDIDVDGRRLTFTLR
QNVYWHDGEPLTAADVLFTLEALRSLPETSTALLADLRYIAAASAPDERTVVIELRSRYAPMLSLLAVPILPRHLFAGRD
VSQINFLDQPIGSGPFRLRERQADGSLVLERHDQYHHGSPLLDQVMLTVMPETATAQQALRDGQLLVAELPWGAQDALVD
VTTLRNGSIPENGVYFLAFNLRPGRPFADVRLRQALATAIDLPRLVETATKGVGVPVGNGALPGSWADLTPPLPAGDLPA
AREILDAAGWVLPPGATIRQREGVPLIARLYVRNDDERRLVAARRIAEIAASIGIQIVVEPADFATVILARYVAPYDFDL
LLGSWLNGAGDPNFADTMFYDPDDFALFHSSQLEQGPGDTRATRNFVGFNDPVYDEQALIARQLYGREERRSAIAQTQAR
LASELPYLYLWVDRTAVVINTRVQTLDGPVDLTTPRYLWNIERWYLQ

Sequences:

>Translated_607_residues
MVPFPCPGVRSELCFCIAFVLYHKVSVGAAQENKRWYNISMHNDYRLRHNRLLFILIMLSVLLAACATLPPPTPTATMLP
TATLPPTATPLPRGGTLSIRIAAPVTDLRPWQPRSRGEEHLISLLYSGLMRLDADLWPNPDLAERLDIDVDGRRLTFTLR
QNVYWHDGEPLTAADVLFTLEALRSLPETSTALLADLRYIAAASAPDERTVVIELRSRYAPMLSLLAVPILPRHLFAGRD
VSQINFLDQPIGSGPFRLRERQADGSLVLERHDQYHHGSPLLDQVMLTVMPETATAQQALRDGQLLVAELPWGAQDALVD
VTTLRNGSIPENGVYFLAFNLRPGRPFADVRLRQALATAIDLPRLVETATKGVGVPVGNGALPGSWADLTPPLPAGDLPA
AREILDAAGWVLPPGATIRQREGVPLIARLYVRNDDERRLVAARRIAEIAASIGIQIVVEPADFATVILARYVAPYDFDL
LLGSWLNGAGDPNFADTMFYDPDDFALFHSSQLEQGPGDTRATRNFVGFNDPVYDEQALIARQLYGREERRSAIAQTQAR
LASELPYLYLWVDRTAVVINTRVQTLDGPVDLTTPRYLWNIERWYLQ
>Mature_607_residues
MVPFPCPGVRSELCFCIAFVLYHKVSVGAAQENKRWYNISMHNDYRLRHNRLLFILIMLSVLLAACATLPPPTPTATMLP
TATLPPTATPLPRGGTLSIRIAAPVTDLRPWQPRSRGEEHLISLLYSGLMRLDADLWPNPDLAERLDIDVDGRRLTFTLR
QNVYWHDGEPLTAADVLFTLEALRSLPETSTALLADLRYIAAASAPDERTVVIELRSRYAPMLSLLAVPILPRHLFAGRD
VSQINFLDQPIGSGPFRLRERQADGSLVLERHDQYHHGSPLLDQVMLTVMPETATAQQALRDGQLLVAELPWGAQDALVD
VTTLRNGSIPENGVYFLAFNLRPGRPFADVRLRQALATAIDLPRLVETATKGVGVPVGNGALPGSWADLTPPLPAGDLPA
AREILDAAGWVLPPGATIRQREGVPLIARLYVRNDDERRLVAARRIAEIAASIGIQIVVEPADFATVILARYVAPYDFDL
LLGSWLNGAGDPNFADTMFYDPDDFALFHSSQLEQGPGDTRATRNFVGFNDPVYDEQALIARQLYGREERRSAIAQTQAR
LASELPYLYLWVDRTAVVINTRVQTLDGPVDLTTPRYLWNIERWYLQ

Specific function: This protein is a component of an oligopeptide permease, a binding protein-dependent transport system. This APP system can completely substitute for the OPP system in both sporulation and genetic competence. AppA can bind and transport tetra- and pentapep

COG id: COG0747

COG function: function code E; ABC-type dipeptide transport system, periplasmic component

Gene ontology:

Cell location: Cell membrane; Lipid-anchor (Probable) [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the bacterial solute-binding protein 5 family [H]

Homologues:

Organism=Escherichia coli, GI1789966, Length=418, Percent_Identity=26.7942583732057, Blast_Score=94, Evalue=2e-20,
Organism=Escherichia coli, GI1789887, Length=393, Percent_Identity=26.7175572519084, Blast_Score=91, Evalue=2e-19,
Organism=Escherichia coli, GI1787762, Length=461, Percent_Identity=24.7288503253796, Blast_Score=87, Evalue=4e-18,
Organism=Escherichia coli, GI1787052, Length=320, Percent_Identity=26.875, Blast_Score=80, Evalue=4e-16,
Organism=Escherichia coli, GI1789397, Length=452, Percent_Identity=23.6725663716814, Blast_Score=70, Evalue=3e-13,
Organism=Escherichia coli, GI1786650, Length=202, Percent_Identity=30.1980198019802, Blast_Score=65, Evalue=9e-12,
Organism=Escherichia coli, GI1787551, Length=462, Percent_Identity=25.3246753246753, Blast_Score=65, Evalue=1e-11,

Paralogues:

None

Copy number: 660 Molecules/Cell In: Growth Phase, Minimal Media (Based on E. coli). 2980 Molecules/Cell In: Growth Phase, Minimal Media (Based on E. coli). 40 Molecules/Cell In: Stationary Phase, Rich Media (Based on E. coli). [C]

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR000914 [H]

Pfam domain/function: PF00496 SBP_bac_5 [H]

EC number: NA

Molecular weight: Translated: 67428; Mature: 67428

Theoretical pI: Translated: 5.52; Mature: 5.52

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.7 %Cys     (Translated Protein)
1.5 %Met     (Translated Protein)
2.1 %Cys+Met (Translated Protein)
0.7 %Cys     (Mature Protein)
1.5 %Met     (Mature Protein)
2.1 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MVPFPCPGVRSELCFCIAFVLYHKVSVGAAQENKRWYNISMHNDYRLRHNRLLFILIMLS
CCCCCCCCHHHHHHHHHHHHHHHHHHCCCCCCCCEEEEEEECCCEEEHHCHHHHHHHHHH
VLLAACATLPPPTPTATMLPTATLPPTATPLPRGGTLSIRIAAPVTDLRPWQPRSRGEEH
HHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCEEEEEEECCCCCCCCCCCCCCCHHH
LISLLYSGLMRLDADLWPNPDLAERLDIDVDGRRLTFTLRQNVYWHDGEPLTAADVLFTL
HHHHHHHHHHHHCCCCCCCCCHHHHCCCCCCCCEEEEEEECCEEEECCCCCHHHHHHHHH
EALRSLPETSTALLADLRYIAAASAPDERTVVIELRSRYAPMLSLLAVPILPRHLFAGRD
HHHHCCCCHHHHHHHHHHHHHHCCCCCCCEEEEEEHHHHHHHHHHHHHHHHHHHHHCCCC
VSQINFLDQPIGSGPFRLRERQADGSLVLERHDQYHHGSPLLDQVMLTVMPETATAQQAL
HHHHHHHHCCCCCCCCHHHHCCCCCCEEEECCCCCCCCCHHHHHHHHHHCCCHHHHHHHH
RDGQLLVAELPWGAQDALVDVTTLRNGSIPENGVYFLAFNLRPGRPFADVRLRQALATAI
CCCCEEEEECCCCCCHHEEEEEECCCCCCCCCCEEEEEEECCCCCCHHHHHHHHHHHHHH
DLPRLVETATKGVGVPVGNGALPGSWADLTPPLPAGDLPAAREILDAAGWVLPPGATIRQ
HHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHCCCCCCCCCCCCC
REGVPLIARLYVRNDDERRLVAARRIAEIAASIGIQIVVEPADFATVILARYVAPYDFDL
CCCCCEEEEEEECCCCHHHHHHHHHHHHHHHHCCEEEEECCCHHHHHHHHHHHCCCCHHH
LLGSWLNGAGDPNFADTMFYDPDDFALFHSSQLEQGPGDTRATRNFVGFNDPVYDEQALI
HHHHHHCCCCCCCCCCCEEECCCCCEEEECCHHCCCCCCHHHHCCCCCCCCCCCCHHHHH
ARQLYGREERRSAIAQTQARLASELPYLYLWVDRTAVVINTRVQTLDGPVDLTTPRYLWN
HHHHHCCHHHHHHHHHHHHHHHHCCCEEEEEECCEEEEEEEEEEECCCCCCCCCCHHHEE
IERWYLQ
EEHHCCC
>Mature Secondary Structure
MVPFPCPGVRSELCFCIAFVLYHKVSVGAAQENKRWYNISMHNDYRLRHNRLLFILIMLS
CCCCCCCCHHHHHHHHHHHHHHHHHHCCCCCCCCEEEEEEECCCEEEHHCHHHHHHHHHH
VLLAACATLPPPTPTATMLPTATLPPTATPLPRGGTLSIRIAAPVTDLRPWQPRSRGEEH
HHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCEEEEEEECCCCCCCCCCCCCCCHHH
LISLLYSGLMRLDADLWPNPDLAERLDIDVDGRRLTFTLRQNVYWHDGEPLTAADVLFTL
HHHHHHHHHHHHCCCCCCCCCHHHHCCCCCCCCEEEEEEECCEEEECCCCCHHHHHHHHH
EALRSLPETSTALLADLRYIAAASAPDERTVVIELRSRYAPMLSLLAVPILPRHLFAGRD
HHHHCCCCHHHHHHHHHHHHHHCCCCCCCEEEEEEHHHHHHHHHHHHHHHHHHHHHCCCC
VSQINFLDQPIGSGPFRLRERQADGSLVLERHDQYHHGSPLLDQVMLTVMPETATAQQAL
HHHHHHHHCCCCCCCCHHHHCCCCCCEEEECCCCCCCCCHHHHHHHHHHCCCHHHHHHHH
RDGQLLVAELPWGAQDALVDVTTLRNGSIPENGVYFLAFNLRPGRPFADVRLRQALATAI
CCCCEEEEECCCCCCHHEEEEEECCCCCCCCCCEEEEEEECCCCCCHHHHHHHHHHHHHH
DLPRLVETATKGVGVPVGNGALPGSWADLTPPLPAGDLPAAREILDAAGWVLPPGATIRQ
HHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHCCCCCCCCCCCCC
REGVPLIARLYVRNDDERRLVAARRIAEIAASIGIQIVVEPADFATVILARYVAPYDFDL
CCCCCEEEEEEECCCCHHHHHHHHHHHHHHHHCCEEEEECCCHHHHHHHHHHHCCCCHHH
LLGSWLNGAGDPNFADTMFYDPDDFALFHSSQLEQGPGDTRATRNFVGFNDPVYDEQALI
HHHHHHCCCCCCCCCCCEEECCCCCEEEECCHHCCCCCCHHHHCCCCCCCCCCCCHHHHH
ARQLYGREERRSAIAQTQARLASELPYLYLWVDRTAVVINTRVQTLDGPVDLTTPRYLWN
HHHHHCCHHHHHHHHHHHHHHHHCCCEEEEEECCEEEEEEEEEEECCCCCCCCCCHHHEE
IERWYLQ
EEHHCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: ATP; dipeptides [Periplasm]; H2O [C]

Specific reaction: ATP + dipeptides [Periplasm] + H2O = ADP + phosphate + dipeptides [Cytoplasm] [C]

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 7997159; 9384377 [H]