| Definition | Halobacterium sp. NRC-1 plasmid pNRC200, complete sequence. |
|---|---|
| Accession | NC_002608 |
| Length | 365,425 |
Click here to switch to the map view.
The map label for this gene is Not Available
Identifier: 16120234
GI number: 16120234
Start: 258585
End: 260117
Strand: Reverse
Name: Not Available
Synonym: VNG6327H
Alternate gene names: NA
Gene position: 260117-258585 (Counterclockwise)
Preceding gene: 16120235
Following gene: 16120233
Centisome position: 71.18
GC content: 60.67
Gene sequence:
>1533_bases ATGATCACCCTCATTGTGCTCTCTATCGGGGGCGGCACCGGCGCATACTTAATTGGGAAGTTGATAGCTCGTGGCGACTT CACACTGCCGGTCAGCGCCATTCAGACCGCAGCAGTTGCGGGGTTCATCACATTTCTTTCGCTGGGAATACAGCGGACGT CAAGCGTGAATGAGCGTCTCGATACGGGCTACCTGTTGACGACGGTCGGCGCGCACGAGGCAGCGCTTGGACTGGTGTTC ACCGTGTACCGCCAAGTGGCTGTCCCGGTGTTCCTCCCAGCTCTCGCTGTCGCCGTTGGGCTCGCACTCGGCTCACAAAC ACCCGCTACGGCCGTTACCGTCGGTGTCGCGGTTGTGGGATTTGTCACGCTCGCCGCCCTGCTCGGTGTTGTCCTCAGTC TGGCCACGAAACTCGCTACGAGCCGGTCGCCGCGCCTCCGGCGATACAAGAATTACACCTACGTCCTCACTTTCATTCTC GGGTTCCTCATCTGGATCACCATACTCCAGGGCCCCCTCTCGAATCAAGGTGCCTGTGACTGGCTTCAAGTAGTCCCACC GGGGTGGTTCGTCGATCTTGCCCTGTTCGGGCTGACAGACGTCCCCACTGAGCCAGCTCGCGGTCTCAGTGCGCTCGGCG TGACTGTTGTGGGATTTCCCGTCCTAATGGGAACCACGATCGCGTTGACTGAGCGTGTCTGGACGGCTGACCGCGTCAGC GGGTCAGTACTTCACCGCTCCCGGTCTCTGGTCGGCACAGGCCTCGCCGAGTGGCTGTTCGCCGGCTGGGTGTCGCGGCC GGTGTTGACGGTCGCACGGAAGCGCTGGCTCCAAGAGCGCCGTGTCCCCATTGGACTCCTCTTCCAGGGCTATCTGCTCA TGCTCGCCCCACTCGTGTTTCTCCCGATCTTCGCCGCTGGCGAGGTGCCTGGCGTGGCACTTGTCGGACTCGTATTTCTG TCTGCGGTCGGAACGGCACTCGCCTTCGGAGCCGAGCTGGTTGGAACCGAATACGCATCGTTACCGATGACGCTCACCTC GGTGTCGGGACGACACTTCATTCGGGGGACCGTATTCGCTGGCATCACGATTAGCGGCCCGTTCACACTGCTGGTGGTTC TCTTGCTGGGCCTTGGGAGTCCACTTGTTGGCGTTGAACTGCTGGTGCTGGGTGTTGTAGGTATCGTGCTCATCGCGTGT AGCGTGGTGGTTTCGGCTATGCTGGGCCTGGATGCGCCGTACTATGCGATCCGAGCAGAGGCAATCCCATTCACCGACAT CACAGCGTACACCGAGAGTGGTGGCGTTTTCAAGTGGGGAAAGGTGTTCGCAGTCGTTGGACTCGTCTGTATTCCGGCAT ACATGGTGTATGGAGCCAGATTCGTCGGCGGGCCAGTAGCGACGGCACTCGGCGCCTCTATGCCAGTAGTTCGAATCGGG GCACTCATCGTGACCAGCCTTTTCGCTATCGCCGTAGCGGCTCTGGCTTATCGACGGGCAGTCGCCCGATTCAACGAGTA CACCCTCCCATGA
Upstream 100 bases:
>100_bases CGTTCGTTCCTGGCTCCGCCACGCCCTCCAAATCGCGCGCATCGAACGCACGCGGAACAAGCGCCAACCCGGCCACTCCG CTACGTGGCGGGCGCTCCGT
Downstream 100 bases:
>100_bases CCACGAGATCCAGCCATGGCGGGATTCTAAACGGTGCGAATGAGAACAGTAACAGTGGTTGCTGGCGCGGTTTCGTCATT CAGACGGTCCTGAAGCTGAA
Product: hypothetical protein
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 510; Mature: 510
Protein sequence:
>510_residues MITLIVLSIGGGTGAYLIGKLIARGDFTLPVSAIQTAAVAGFITFLSLGIQRTSSVNERLDTGYLLTTVGAHEAALGLVF TVYRQVAVPVFLPALAVAVGLALGSQTPATAVTVGVAVVGFVTLAALLGVVLSLATKLATSRSPRLRRYKNYTYVLTFIL GFLIWITILQGPLSNQGACDWLQVVPPGWFVDLALFGLTDVPTEPARGLSALGVTVVGFPVLMGTTIALTERVWTADRVS GSVLHRSRSLVGTGLAEWLFAGWVSRPVLTVARKRWLQERRVPIGLLFQGYLLMLAPLVFLPIFAAGEVPGVALVGLVFL SAVGTALAFGAELVGTEYASLPMTLTSVSGRHFIRGTVFAGITISGPFTLLVVLLLGLGSPLVGVELLVLGVVGIVLIAC SVVVSAMLGLDAPYYAIRAEAIPFTDITAYTESGGVFKWGKVFAVVGLVCIPAYMVYGARFVGGPVATALGASMPVVRIG ALIVTSLFAIAVAALAYRRAVARFNEYTLP
Sequences:
>Translated_510_residues MITLIVLSIGGGTGAYLIGKLIARGDFTLPVSAIQTAAVAGFITFLSLGIQRTSSVNERLDTGYLLTTVGAHEAALGLVF TVYRQVAVPVFLPALAVAVGLALGSQTPATAVTVGVAVVGFVTLAALLGVVLSLATKLATSRSPRLRRYKNYTYVLTFIL GFLIWITILQGPLSNQGACDWLQVVPPGWFVDLALFGLTDVPTEPARGLSALGVTVVGFPVLMGTTIALTERVWTADRVS GSVLHRSRSLVGTGLAEWLFAGWVSRPVLTVARKRWLQERRVPIGLLFQGYLLMLAPLVFLPIFAAGEVPGVALVGLVFL SAVGTALAFGAELVGTEYASLPMTLTSVSGRHFIRGTVFAGITISGPFTLLVVLLLGLGSPLVGVELLVLGVVGIVLIAC SVVVSAMLGLDAPYYAIRAEAIPFTDITAYTESGGVFKWGKVFAVVGLVCIPAYMVYGARFVGGPVATALGASMPVVRIG ALIVTSLFAIAVAALAYRRAVARFNEYTLP >Mature_510_residues MITLIVLSIGGGTGAYLIGKLIARGDFTLPVSAIQTAAVAGFITFLSLGIQRTSSVNERLDTGYLLTTVGAHEAALGLVF TVYRQVAVPVFLPALAVAVGLALGSQTPATAVTVGVAVVGFVTLAALLGVVLSLATKLATSRSPRLRRYKNYTYVLTFIL GFLIWITILQGPLSNQGACDWLQVVPPGWFVDLALFGLTDVPTEPARGLSALGVTVVGFPVLMGTTIALTERVWTADRVS GSVLHRSRSLVGTGLAEWLFAGWVSRPVLTVARKRWLQERRVPIGLLFQGYLLMLAPLVFLPIFAAGEVPGVALVGLVFL SAVGTALAFGAELVGTEYASLPMTLTSVSGRHFIRGTVFAGITISGPFTLLVVLLLGLGSPLVGVELLVLGVVGIVLIAC SVVVSAMLGLDAPYYAIRAEAIPFTDITAYTESGGVFKWGKVFAVVGLVCIPAYMVYGARFVGGPVATALGASMPVVRIG ALIVTSLFAIAVAALAYRRAVARFNEYTLP
Specific function: Unknown
COG id: NA
COG function: NA
Gene ontology:
Cell location: Cytoplasmic
Metaboloic importance: NA
Operon status: Not Known
Operon components: None
Similarity: NA
Homologues:
None
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
NA
Pfam domain/function: NA
EC number: NA
Molecular weight: Translated: 53397; Mature: 53397
Theoretical pI: Translated: 9.96; Mature: 9.96
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.6 %Cys (Translated Protein) 1.4 %Met (Translated Protein) 2.0 %Cys+Met (Translated Protein) 0.6 %Cys (Mature Protein) 1.4 %Met (Mature Protein) 2.0 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MITLIVLSIGGGTGAYLIGKLIARGDFTLPVSAIQTAAVAGFITFLSLGIQRTSSVNERL CEEEEEEEECCCCHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH DTGYLLTTVGAHEAALGLVFTVYRQVAVPVFLPALAVAVGLALGSQTPATAVTVGVAVVG CCCEEEEECCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHH FVTLAALLGVVLSLATKLATSRSPRLRRYKNYTYVLTFILGFLIWITILQGPLSNQGACD HHHHHHHHHHHHHHHHHHHCCCCCHHHHHCCHHHHHHHHHHHHHHHHHHCCCCCCCCCCC WLQVVPPGWFVDLALFGLTDVPTEPARGLSALGVTVVGFPVLMGTTIALTERVWTADRVS HHEECCCCHHHHHHHHCCCCCCCCCCCCHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHH GSVLHRSRSLVGTGLAEWLFAGWVSRPVLTVARKRWLQERRVPIGLLFQGYLLMLAPLVF HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHH LPIFAAGEVPGVALVGLVFLSAVGTALAFGAELVGTEYASLPMTLTSVSGRHFIRGTVFA HHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHCCEEEEECCCCCEEEEEEEE GITISGPFTLLVVLLLGLGSPLVGVELLVLGVVGIVLIACSVVVSAMLGLDAPYYAIRAE EEEECCHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEEC AIPFTDITAYTESGGVFKWGKVFAVVGLVCIPAYMVYGARFVGGPVATALGASMPVVRIG CCCCCCEEEEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHCCCCHHHHHH ALIVTSLFAIAVAALAYRRAVARFNEYTLP HHHHHHHHHHHHHHHHHHHHHHHHHCCCCC >Mature Secondary Structure MITLIVLSIGGGTGAYLIGKLIARGDFTLPVSAIQTAAVAGFITFLSLGIQRTSSVNERL CEEEEEEEECCCCHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH DTGYLLTTVGAHEAALGLVFTVYRQVAVPVFLPALAVAVGLALGSQTPATAVTVGVAVVG CCCEEEEECCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHH FVTLAALLGVVLSLATKLATSRSPRLRRYKNYTYVLTFILGFLIWITILQGPLSNQGACD HHHHHHHHHHHHHHHHHHHCCCCCHHHHHCCHHHHHHHHHHHHHHHHHHCCCCCCCCCCC WLQVVPPGWFVDLALFGLTDVPTEPARGLSALGVTVVGFPVLMGTTIALTERVWTADRVS HHEECCCCHHHHHHHHCCCCCCCCCCCCHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHH GSVLHRSRSLVGTGLAEWLFAGWVSRPVLTVARKRWLQERRVPIGLLFQGYLLMLAPLVF HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHH LPIFAAGEVPGVALVGLVFLSAVGTALAFGAELVGTEYASLPMTLTSVSGRHFIRGTVFA HHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHCCEEEEECCCCCEEEEEEEE GITISGPFTLLVVLLLGLGSPLVGVELLVLGVVGIVLIACSVVVSAMLGLDAPYYAIRAE EEEECCHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEEC AIPFTDITAYTESGGVFKWGKVFAVVGLVCIPAYMVYGARFVGGPVATALGASMPVVRIG CCCCCCEEEEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHCCCCHHHHHH ALIVTSLFAIAVAALAYRRAVARFNEYTLP HHHHHHHHHHHHHHHHHHHHHHHHHCCCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA