| Definition | Thermomicrobium roseum DSM 5159 plasmid unnamed, complete sequence. |
|---|---|
| Accession | NC_011961 |
| Length | 917,738 |
Click here to switch to the map view.
The map label for this gene is yafV [C]
Identifier: 221635917
GI number: 221635917
Start: 501382
End: 502221
Strand: Reverse
Name: yafV [C]
Synonym: trd_A0511
Alternate gene names: 221635917
Gene position: 502221-501382 (Counterclockwise)
Preceding gene: 221635923
Following gene: 221635915
Centisome position: 54.72
GC content: 63.1
Gene sequence:
>840_bases ATGAGCGACCTTCTCCGGATCGGTCTGGTCCAGATGAACTCCCGCTCGGACAAGAGCGAGAACCTCGCCGTCGCTGAACG GCTGATCGAAGAAGCGGCCAGGCAAGGGGCCGAACTCGTCGCTCTGCCCGAGTACGTCAACTTTCTCGGACCCCGCGAAC TCCACGAAGCGAACGCCGAGCCGATTCCCGGTCCGACCACCGAGCGGTTCGCAGCGCTCGCCCGTCGCTACGGCATCTAT CTGCTGGGCGGCTCGATCCTCGAGCGCTCGGCCATCCCCGGCAAGTACTACAACACGAGTGTTCTTTTCGCGCCCGACGG CGAGATCATCGCCAGTTACCGCAAGATCCATCTCTTCGACGTCGATCTCACCGGTAACGTGACCAGCAACGAGTCGGCGA CCATCTTGCCCGGTGACCGGGTGGTAACGGCCGAAGTCGCTGGGCACGTAGTCGGGCTGACCATCTGCTACGACCTGCGC TTCCCCGAACTCTATCGCCTGCTCGCACTCGACGGAGCCGAACTGATCCTCGTCCCTGCCGCTTTCACGCTTTACACCGG TAAGGACCACTGGCACACCCTGCTACGCGCGCGAGCGATCGAGAACCAGTGCTACGTTGCGGCCCCAGCGCAGATCGGCC CACACGATCCAGGGCAACAGTGCTATGGCCACTCCCTCGTCGCCGACCCCTGGGGAACCGTCATCGCCGAGGCGATCAAT CGTGTCGGTGTGGTTGTCACGACGCTGGACTTCGCCTATCTCCGCGAAGTACGAGCCCAGCTACCGTCGCTGGCCAATCG CCGACCGGAAACCTATGGAAGTCTCGCTCTGACACGCTGA
Upstream 100 bases:
>100_bases AGCGAGTCAGCGACCGTCCTCCTGTGCACTGCACAGGTACCGTGTTTCCGCAGTACAATGCGGCGAGTGGATCGCTCGAC GAAGCAGAGAGGAGACCGCC
Downstream 100 bases:
>100_bases ACCGGGTGAGAGACCCGCTGCGTGGGCTGGACCGATCGTACCAGTTCGCCCGGTCCAGCCCACGCGCTCTTCCCGGGTAG TCCAAGACAGATGCGCCGAC
Product: hydrolase, carbon-nitrogen family protein
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 279; Mature: 278
Protein sequence:
>279_residues MSDLLRIGLVQMNSRSDKSENLAVAERLIEEAARQGAELVALPEYVNFLGPRELHEANAEPIPGPTTERFAALARRYGIY LLGGSILERSAIPGKYYNTSVLFAPDGEIIASYRKIHLFDVDLTGNVTSNESATILPGDRVVTAEVAGHVVGLTICYDLR FPELYRLLALDGAELILVPAAFTLYTGKDHWHTLLRARAIENQCYVAAPAQIGPHDPGQQCYGHSLVADPWGTVIAEAIN RVGVVVTTLDFAYLREVRAQLPSLANRRPETYGSLALTR
Sequences:
>Translated_279_residues MSDLLRIGLVQMNSRSDKSENLAVAERLIEEAARQGAELVALPEYVNFLGPRELHEANAEPIPGPTTERFAALARRYGIY LLGGSILERSAIPGKYYNTSVLFAPDGEIIASYRKIHLFDVDLTGNVTSNESATILPGDRVVTAEVAGHVVGLTICYDLR FPELYRLLALDGAELILVPAAFTLYTGKDHWHTLLRARAIENQCYVAAPAQIGPHDPGQQCYGHSLVADPWGTVIAEAIN RVGVVVTTLDFAYLREVRAQLPSLANRRPETYGSLALTR >Mature_278_residues SDLLRIGLVQMNSRSDKSENLAVAERLIEEAARQGAELVALPEYVNFLGPRELHEANAEPIPGPTTERFAALARRYGIYL LGGSILERSAIPGKYYNTSVLFAPDGEIIASYRKIHLFDVDLTGNVTSNESATILPGDRVVTAEVAGHVVGLTICYDLRF PELYRLLALDGAELILVPAAFTLYTGKDHWHTLLRARAIENQCYVAAPAQIGPHDPGQQCYGHSLVADPWGTVIAEAINR VGVVVTTLDFAYLREVRAQLPSLANRRPETYGSLALTR
Specific function: Unknown
COG id: COG0388
COG function: function code R; Predicted amidohydrolase
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 CN hydrolase domain [H]
Homologues:
Organism=Homo sapiens, GI9910460, Length=269, Percent_Identity=42.3791821561338, Blast_Score=224, Evalue=7e-59, Organism=Homo sapiens, GI297632350, Length=282, Percent_Identity=41.8439716312057, Blast_Score=212, Evalue=3e-55, Organism=Homo sapiens, GI297632348, Length=282, Percent_Identity=41.8439716312057, Blast_Score=212, Evalue=3e-55, Organism=Homo sapiens, GI5031947, Length=281, Percent_Identity=41.9928825622776, Blast_Score=212, Evalue=3e-55, Organism=Homo sapiens, GI297632346, Length=197, Percent_Identity=38.0710659898477, Blast_Score=124, Evalue=1e-28, Organism=Escherichia coli, GI1786412, Length=268, Percent_Identity=29.4776119402985, Blast_Score=69, Evalue=3e-13, Organism=Caenorhabditis elegans, GI17556280, Length=269, Percent_Identity=39.7769516728625, Blast_Score=200, Evalue=6e-52, Organism=Saccharomyces cerevisiae, GI6323383, Length=282, Percent_Identity=35.8156028368794, Blast_Score=178, Evalue=1e-45, Organism=Saccharomyces cerevisiae, GI6322335, Length=307, Percent_Identity=33.5504885993485, Blast_Score=155, Evalue=7e-39, Organism=Drosophila melanogaster, GI21355835, Length=278, Percent_Identity=35.9712230215827, Blast_Score=186, Evalue=1e-47, Organism=Drosophila melanogaster, GI17933642, Length=272, Percent_Identity=38.9705882352941, Blast_Score=182, Evalue=2e-46,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR003010 - InterPro: IPR001110 [H]
Pfam domain/function: PF00795 CN_hydrolase [H]
EC number: 3.5.-.- [C]
Molecular weight: Translated: 30568; Mature: 30437
Theoretical pI: Translated: 5.62; Mature: 5.62
Prosite motif: PS50263 CN_HYDROLASE ; PS01227 UPF0012
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.1 %Cys (Translated Protein) 0.7 %Met (Translated Protein) 1.8 %Cys+Met (Translated Protein) 1.1 %Cys (Mature Protein) 0.4 %Met (Mature Protein) 1.4 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MSDLLRIGLVQMNSRSDKSENLAVAERLIEEAARQGAELVALPEYVNFLGPRELHEANAE CCCHHHHHEEEECCCCCCCCHHHHHHHHHHHHHHCCCEEEECHHHHHHCCCHHHHHCCCC PIPGPTTERFAALARRYGIYLLGGSILERSAIPGKYYNTSVLFAPDGEIIASYRKIHLFD CCCCCCHHHHHHHHHHCCEEEECCHHHHHCCCCCCCCCCEEEECCCCHHHCCEEEEEEEE VDLTGNVTSNESATILPGDRVVTAEVAGHVVGLTICYDLRFPELYRLLALDGAELILVPA EEEECCCCCCCCEEEECCCEEEEHHHCCCEEEEEEEEECCCHHHHHHHHCCCCCEEEEEE AFTLYTGKDHWHTLLRARAIENQCYVAAPAQIGPHDPGQQCYGHSLVADPWGTVIAEAIN EEEEECCCHHHHHHHHHHHHCCCEEEEECCCCCCCCCCHHHHCCCEECCCHHHHHHHHHH RVGVVVTTLDFAYLREVRAQLPSLANRRPETYGSLALTR HCEEEEEHHHHHHHHHHHHHHHHHHHCCCCCCCCEEECC >Mature Secondary Structure SDLLRIGLVQMNSRSDKSENLAVAERLIEEAARQGAELVALPEYVNFLGPRELHEANAE CCHHHHHEEEECCCCCCCCHHHHHHHHHHHHHHCCCEEEECHHHHHHCCCHHHHHCCCC PIPGPTTERFAALARRYGIYLLGGSILERSAIPGKYYNTSVLFAPDGEIIASYRKIHLFD CCCCCCHHHHHHHHHHCCEEEECCHHHHHCCCCCCCCCCEEEECCCCHHHCCEEEEEEEE VDLTGNVTSNESATILPGDRVVTAEVAGHVVGLTICYDLRFPELYRLLALDGAELILVPA EEEECCCCCCCCEEEECCCEEEEHHHCCCEEEEEEEEECCCHHHHHHHHCCCCCEEEEEE AFTLYTGKDHWHTLLRARAIENQCYVAAPAQIGPHDPGQQCYGHSLVADPWGTVIAEAIN EEEEECCCHHHHHHHHHHHHCCCEEEEECCCCCCCCCCHHHHCCCEECCCHHHHHHHHHH RVGVVVTTLDFAYLREVRAQLPSLANRRPETYGSLALTR HCEEEEEHHHHHHHHHHHHHHHHHHHCCCCCCCCEEECC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 10.0
TargetDB status: NA
Availability: NA
References: 8590279; 8905231 [H]