| Definition | Bacillus licheniformis ATCC 14580, complete genome. |
|---|---|
| Accession | NC_006322 |
| Length | 4,222,645 |
Click here to switch to the map view.
The map label for this gene is ycgO [H]
Identifier: 52787736
GI number: 52787736
Start: 3882604
End: 3884070
Strand: Reverse
Name: ycgO [H]
Synonym: BLi04059
Alternate gene names: 52787736
Gene position: 3884070-3882604 (Counterclockwise)
Preceding gene: 52787737
Following gene: 52787733
Centisome position: 91.98
GC content: 48.81
Gene sequence:
>1467_bases ATGAATTACGGAATTTTAATATCGATAGGTATTTATATGGCGGGAATGCTTTTCATCGGATATTTTGCATATCGCAGGAC ATCAAATTTGACCGATTACATGCTTGGCGGAAGAAATCTGGGTCCCGCCGTTACCGCGTTAAGCGCAGGAGCTTCCGATA TGAGCGGCTGGCTATTAATGGGGCTGCCCGGTGCGATGTTCCTGAACGGATTGAGCAGCGGCTGGATCGTTGTCGGTCTG ACAATCGGCGCTTATTTGAACTGGGTGTATGTCGCGCCGAGGCTAAGGACGTATACGGAAACGGCCGGCAACAGCATTAC TATACCCGATTATTTCGAAAACCGTTTTAAAGACGGTTCAAGACTGTTACGGATGACGTCGGCTTTTGTTATTTTAGTAT TTTTCACTTTTTATACATCATCCGGAATGGTGGCGGGCGGAGAGCTGTTCAGAACCGCATTCCACCTGGATTATCGGATC GGCATCTGGCTGACGGCCGGGGTTGTCATTCTTTATACGCTCTTCGGAGGCTTTTTGGCTGTCAGCTGGACCGATTTTGT TCAAGGGACGATCATGTTTATCGCGCTCATCTTAATGCCGGTAGTCGTGTTTGTTCAACTGGGGGGAATTGCGCCGGCGT TTTCGGAAGTGAACGCGGTTAACCCGGATCTCCTCCGTCCGTTTCAAGGAACAACCGTAATCGGTATCATATCTTTACTG GCATGGGGTCTCGGCTACTTTGGACAGCCTCATATTATTGTCAGGTTTATGGCGATTTCAAGCGTGAAAGAATTGAAGAG TGCCAGAAGAATCGGCATGGGCTGGATGATCTTTTCGATTTGCGGAGCGATGCTGACAGGACTCGTCGGCATTGCCTATT TCAGTGCGAATCATCTTACGTTAAAGAATGCCGAGACGATATTCATTAAGCTTGCCGACCTTTTGTTCCCTTCAATGATT ACGGGGTTCTTGCTGGCCGCCATATTAGCAGCGGTGATGAGCACAATTTCTTCACAGCTTCTTGTAACCTCAAGCGCGCT GACAGAGGATTTTTATAAAGCGTTTATCCGGAAAGGGGCTTCTGATAAAGAACTTGTACTTGTCGGAAGGCTGTCTGTCC TCGCCATTTCACTGATCGCACTCTTGATGGCGCTTCATCCGAATGAAACGATTCTGAATCTTGTCGGCTATGCATGGGCA GGCTTCGGGGCGGCATTTGGCCCTGTCGTTTTGCTGAGCCTGTATTGGAAACGAATGACGAAGTGGGGCGCGCTTGCAGG GATGCTGTCCGGAGCGCTGACCGTTATTGTGTGGGAGCAAGTGAAAGCGTTTGACCCGGTTTATGAAATCATTCCCGGAT TTATTGTTTGTACAGTCGTGATCATCGCCGTCAGCCTGATGACAAAGAAGCCGCGGGCAGAGATTGAAAAGGAATTTGAG ACTGCGGTTGAACAGCTGAAAGGTTGA
Upstream 100 bases:
>100_bases AATGTAAGGCTGGAGAAAAAATTTGCGATAAAAACAATACCTGTCGGTCAATTATTCATGTATATTGATATTACGCAAAT CACACAGGCAGGGGGAAGCT
Downstream 100 bases:
>100_bases GAATCTAGTGATGGCCTTTGTCAAAGTATTGTTGACGACCGCTTTTCTCACAGGGGCTTTCGCAGGATTCCTGTGGGCAT TTTCCAAAGAAAAAGGCGAT
Product: hypothetical protein
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 488; Mature: 488
Protein sequence:
>488_residues MNYGILISIGIYMAGMLFIGYFAYRRTSNLTDYMLGGRNLGPAVTALSAGASDMSGWLLMGLPGAMFLNGLSSGWIVVGL TIGAYLNWVYVAPRLRTYTETAGNSITIPDYFENRFKDGSRLLRMTSAFVILVFFTFYTSSGMVAGGELFRTAFHLDYRI GIWLTAGVVILYTLFGGFLAVSWTDFVQGTIMFIALILMPVVVFVQLGGIAPAFSEVNAVNPDLLRPFQGTTVIGIISLL AWGLGYFGQPHIIVRFMAISSVKELKSARRIGMGWMIFSICGAMLTGLVGIAYFSANHLTLKNAETIFIKLADLLFPSMI TGFLLAAILAAVMSTISSQLLVTSSALTEDFYKAFIRKGASDKELVLVGRLSVLAISLIALLMALHPNETILNLVGYAWA GFGAAFGPVVLLSLYWKRMTKWGALAGMLSGALTVIVWEQVKAFDPVYEIIPGFIVCTVVIIAVSLMTKKPRAEIEKEFE TAVEQLKG
Sequences:
>Translated_488_residues MNYGILISIGIYMAGMLFIGYFAYRRTSNLTDYMLGGRNLGPAVTALSAGASDMSGWLLMGLPGAMFLNGLSSGWIVVGL TIGAYLNWVYVAPRLRTYTETAGNSITIPDYFENRFKDGSRLLRMTSAFVILVFFTFYTSSGMVAGGELFRTAFHLDYRI GIWLTAGVVILYTLFGGFLAVSWTDFVQGTIMFIALILMPVVVFVQLGGIAPAFSEVNAVNPDLLRPFQGTTVIGIISLL AWGLGYFGQPHIIVRFMAISSVKELKSARRIGMGWMIFSICGAMLTGLVGIAYFSANHLTLKNAETIFIKLADLLFPSMI TGFLLAAILAAVMSTISSQLLVTSSALTEDFYKAFIRKGASDKELVLVGRLSVLAISLIALLMALHPNETILNLVGYAWA GFGAAFGPVVLLSLYWKRMTKWGALAGMLSGALTVIVWEQVKAFDPVYEIIPGFIVCTVVIIAVSLMTKKPRAEIEKEFE TAVEQLKG >Mature_488_residues MNYGILISIGIYMAGMLFIGYFAYRRTSNLTDYMLGGRNLGPAVTALSAGASDMSGWLLMGLPGAMFLNGLSSGWIVVGL TIGAYLNWVYVAPRLRTYTETAGNSITIPDYFENRFKDGSRLLRMTSAFVILVFFTFYTSSGMVAGGELFRTAFHLDYRI GIWLTAGVVILYTLFGGFLAVSWTDFVQGTIMFIALILMPVVVFVQLGGIAPAFSEVNAVNPDLLRPFQGTTVIGIISLL AWGLGYFGQPHIIVRFMAISSVKELKSARRIGMGWMIFSICGAMLTGLVGIAYFSANHLTLKNAETIFIKLADLLFPSMI TGFLLAAILAAVMSTISSQLLVTSSALTEDFYKAFIRKGASDKELVLVGRLSVLAISLIALLMALHPNETILNLVGYAWA GFGAAFGPVVLLSLYWKRMTKWGALAGMLSGALTVIVWEQVKAFDPVYEIIPGFIVCTVVIIAVSLMTKKPRAEIEKEFE TAVEQLKG
Specific function: Catalyzes the sodium-dependent uptake of extracellular amino acids [H]
COG id: COG0591
COG function: function code ER; Na+/proline symporter
Gene ontology:
Cell location: Cell membrane; Multi-pass membrane protein (Potential) [H]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the sodium:solute symporter (SSF) (TC 2.A.21) family [H]
Homologues:
Organism=Homo sapiens, GI310128183, Length=493, Percent_Identity=55.578093306288, Blast_Score=537, Evalue=1e-152, Organism=Homo sapiens, GI110835708, Length=545, Percent_Identity=22.7522935779817, Blast_Score=84, Evalue=3e-16, Organism=Homo sapiens, GI11141885, Length=453, Percent_Identity=26.2693156732892, Blast_Score=79, Evalue=7e-15, Organism=Homo sapiens, GI109659836, Length=437, Percent_Identity=22.6544622425629, Blast_Score=75, Evalue=1e-13, Organism=Homo sapiens, GI109659839, Length=453, Percent_Identity=21.6335540838852, Blast_Score=71, Evalue=2e-12, Organism=Escherichia coli, GI1787251, Length=483, Percent_Identity=55.4865424430642, Blast_Score=511, Evalue=1e-146, Organism=Escherichia coli, GI1790503, Length=509, Percent_Identity=28.0943025540275, Blast_Score=153, Evalue=2e-38, Organism=Escherichia coli, GI87082237, Length=448, Percent_Identity=30.1339285714286, Blast_Score=123, Evalue=2e-29, Organism=Escherichia coli, GI1790113, Length=475, Percent_Identity=22.3157894736842, Blast_Score=79, Evalue=9e-16, Organism=Caenorhabditis elegans, GI115533094, Length=481, Percent_Identity=24.3243243243243, Blast_Score=71, Evalue=1e-12, Organism=Drosophila melanogaster, GI221459584, Length=373, Percent_Identity=24.1286863270777, Blast_Score=88, Evalue=1e-17, Organism=Drosophila melanogaster, GI221459588, Length=378, Percent_Identity=26.1904761904762, Blast_Score=82, Evalue=1e-15, Organism=Drosophila melanogaster, GI221459586, Length=375, Percent_Identity=24, Blast_Score=78, Evalue=1e-14, Organism=Drosophila melanogaster, GI24645928, Length=390, Percent_Identity=25.3846153846154, Blast_Score=74, Evalue=3e-13, Organism=Drosophila melanogaster, GI24651739, Length=372, Percent_Identity=22.8494623655914, Blast_Score=69, Evalue=5e-12, Organism=Drosophila melanogaster, GI24640370, Length=356, Percent_Identity=24.1573033707865, Blast_Score=65, Evalue=7e-11,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR011851 - InterPro: IPR001734 - InterPro: IPR018212 - InterPro: IPR019900 [H]
Pfam domain/function: PF00474 SSF [H]
EC number: NA
Molecular weight: Translated: 53116; Mature: 53116
Theoretical pI: Translated: 9.37; Mature: 9.37
Prosite motif: PS50283 NA_SOLUT_SYMP_3
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.4 %Cys (Translated Protein) 4.3 %Met (Translated Protein) 4.7 %Cys+Met (Translated Protein) 0.4 %Cys (Mature Protein) 4.3 %Met (Mature Protein) 4.7 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MNYGILISIGIYMAGMLFIGYFAYRRTSNLTDYMLGGRNLGPAVTALSAGASDMSGWLLM CCCCEEEEHHHHHHHHHHHHHHHHHHCCCCHHHHHCCCCCCHHHHHHHCCCCCCCCEEEE GLPGAMFLNGLSSGWIVVGLTIGAYLNWVYVAPRLRTYTETAGNSITIPDYFENRFKDGS CCCHHHHHHCCCCCCEEEEEHHHHHHHHHHCCCHHHHHHHCCCCEEECCHHHHHHHCCHH RLLRMTSAFVILVFFTFYTSSGMVAGGELFRTAFHLDYRIGIWLTAGVVILYTLFGGFLA HHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH VSWTDFVQGTIMFIALILMPVVVFVQLGGIAPAFSEVNAVNPDLLRPFQGTTVIGIISLL HHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHCCCCCHHHCCCCCCCHHHHHHHHH AWGLGYFGQPHIIVRFMAISSVKELKSARRIGMGWMIFSICGAMLTGLVGIAYFSANHLT HHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHCCCCEE LKNAETIFIKLADLLFPSMITGFLLAAILAAVMSTISSQLLVTSSALTEDFYKAFIRKGA ECCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCC SDKELVLVGRLSVLAISLIALLMALHPNETILNLVGYAWAGFGAAFGPVVLLSLYWKRMT CCCCEEEEHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH KWGALAGMLSGALTVIVWEQVKAFDPVYEIIPGFIVCTVVIIAVSLMTKKPRAEIEKEFE HHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHH TAVEQLKG HHHHHHCC >Mature Secondary Structure MNYGILISIGIYMAGMLFIGYFAYRRTSNLTDYMLGGRNLGPAVTALSAGASDMSGWLLM CCCCEEEEHHHHHHHHHHHHHHHHHHCCCCHHHHHCCCCCCHHHHHHHCCCCCCCCEEEE GLPGAMFLNGLSSGWIVVGLTIGAYLNWVYVAPRLRTYTETAGNSITIPDYFENRFKDGS CCCHHHHHHCCCCCCEEEEEHHHHHHHHHHCCCHHHHHHHCCCCEEECCHHHHHHHCCHH RLLRMTSAFVILVFFTFYTSSGMVAGGELFRTAFHLDYRIGIWLTAGVVILYTLFGGFLA HHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH VSWTDFVQGTIMFIALILMPVVVFVQLGGIAPAFSEVNAVNPDLLRPFQGTTVIGIISLL HHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHCCCCCHHHCCCCCCCHHHHHHHHH AWGLGYFGQPHIIVRFMAISSVKELKSARRIGMGWMIFSICGAMLTGLVGIAYFSANHLT HHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHCCCCEE LKNAETIFIKLADLLFPSMITGFLLAAILAAVMSTISSQLLVTSSALTEDFYKAFIRKGA ECCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCC SDKELVLVGRLSVLAISLIALLMALHPNETILNLVGYAWAGFGAAFGPVVLLSLYWKRMT CCCCEEEEHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH KWGALAGMLSGALTVIVWEQVKAFDPVYEIIPGFIVCTVVIIAVSLMTKKPRAEIEKEFE HHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHH TAVEQLKG HHHHHHCC
PDB accession: NA
Resolution: NA
Structure class: Alpha
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 6.0
TargetDB status: NA
Availability: NA
References: 8969502; 9384377 [H]