| Definition | Trichodesmium erythraeum IMS101 chromosome, complete genome. |
|---|---|
| Accession | NC_008312 |
| Length | 7,750,108 |
Click here to switch to the map view.
The map label for this gene is 113474230
Identifier: 113474230
GI number: 113474230
Start: 536956
End: 538086
Strand: Reverse
Name: 113474230
Synonym: Tery_0347
Alternate gene names: NA
Gene position: 538086-536956 (Counterclockwise)
Preceding gene: 113474231
Following gene: 113474229
Centisome position: 6.94
GC content: 34.31
Gene sequence:
>1131_bases ATGACAAACACTATTTTAAAATCTTCTACTCATCCACTTTCAGCTTATATAAACCGCTTAAAATCTGGTCAAGCTCTGCT CAAGGATAGCCCAGAAAATGTCTTAGAAGTTGTCGGAATTTTAAAAAGTTACGGCATTGTATTAGATGCTTATTCCCAAA ATCTTAATTACATTGCCGAACATCAATTTTTAGAAATGTTTCCCTTTTTCAAATACTTTAATGGTAAAATTTCATTAGGT AAATTACTCAAGTTTTGGTCTCATGACAGAATTAATTATGAATATGCAGAATATTGCATGAGGGGAATGTTATGGCATGG AGGGGGAGGTCTGGATACATATTTAGATTCAGCTGAGTTTAAACAATTAGCAAAAGCAGCAATAGATGCTAAAATTTCCG GGAATTTGATGTTAATGCCACTCAATCAATTATTTCCAGAATTTTTACCAGATATGGTACGTCAACAAGCTTATTACAGT GCCTTAGGTCAATTTTGGCGGGTAATGAGTGATATCTTTATCACCTTATCTGATCAATATGACCAAGGTCAAATAAAATC TATTCCTGAAGTAGTCAATCATATTTTATCAGGGTTAGTCGCAGAAGCAAATTTACCAATTACTTTTGCTGTAAATATTA AAGGTAAACCTCATGATATAATTCCTAAGTCAGTAGGTTTAACGTTTTTAACAGATACAGCGGTTCCTTATGTGGAAGCA ATTTTCTTCCGAGGAACACCATTTTCAGGAACAGTTTCATATAACGCTCAAGCTCAACAAATTGACCCTGATCAAAGTCA ATTTACTTATGGTGCCTTGTATGCAGATCCTTTACCTATTGGTGGTGCAGGAATTCCACCCACATTATTAATGCAAGATA TGCGACATTTTATACCAGATTATCTTCTTGAATTTTATCAAAAAACTAACCGGGGTACAGATAATTTACGAGTGAAAATT TGTGCCACTTTTCAAAAGTCAATGTTTTGTGTAACAACGGCAGCAGTTTTGGGTTTAACACCTCATCCTTTAGATACAGA AAACCTAGAGGAACAAGCAGAAAATCAAGCCTATTTCGAAGGTTGGATGGATAGATTTTTAACATCAAGACTAGAGTTTG TTAATAGTTAG
Upstream 100 bases:
>100_bases AAAGCGCTTAACACTGATGCTAAAGAATCCCTTGCTGTCTCAAGTACAGCAGCGCCGGGAGGATGTCAATTAAGAATTGA ATTTAGGAAACACTAAGCTT
Downstream 100 bases:
>100_bases TATTGTCTCTTATAGCAGCTATGATAAATATTTTCTACAAATATTTACATTATTGTTGGAAGTCATTAGTTAGGACTTAA TTAGGAGAAATATTATCATT
Product: CO2 hydration protein
Products: NA
Alternate protein names: CO2 Hydration Protein ChpX; CO2-Hydration Protein; Carbon Dioxide Hydration Protein; CO2 Hydration; High Affinity CO2 Uptake Protein; Low Affinity CO2 Uptake Protein; Uptake
Number of amino acids: Translated: 376; Mature: 375
Protein sequence:
>376_residues MTNTILKSSTHPLSAYINRLKSGQALLKDSPENVLEVVGILKSYGIVLDAYSQNLNYIAEHQFLEMFPFFKYFNGKISLG KLLKFWSHDRINYEYAEYCMRGMLWHGGGGLDTYLDSAEFKQLAKAAIDAKISGNLMLMPLNQLFPEFLPDMVRQQAYYS ALGQFWRVMSDIFITLSDQYDQGQIKSIPEVVNHILSGLVAEANLPITFAVNIKGKPHDIIPKSVGLTFLTDTAVPYVEA IFFRGTPFSGTVSYNAQAQQIDPDQSQFTYGALYADPLPIGGAGIPPTLLMQDMRHFIPDYLLEFYQKTNRGTDNLRVKI CATFQKSMFCVTTAAVLGLTPHPLDTENLEEQAENQAYFEGWMDRFLTSRLEFVNS
Sequences:
>Translated_376_residues MTNTILKSSTHPLSAYINRLKSGQALLKDSPENVLEVVGILKSYGIVLDAYSQNLNYIAEHQFLEMFPFFKYFNGKISLG KLLKFWSHDRINYEYAEYCMRGMLWHGGGGLDTYLDSAEFKQLAKAAIDAKISGNLMLMPLNQLFPEFLPDMVRQQAYYS ALGQFWRVMSDIFITLSDQYDQGQIKSIPEVVNHILSGLVAEANLPITFAVNIKGKPHDIIPKSVGLTFLTDTAVPYVEA IFFRGTPFSGTVSYNAQAQQIDPDQSQFTYGALYADPLPIGGAGIPPTLLMQDMRHFIPDYLLEFYQKTNRGTDNLRVKI CATFQKSMFCVTTAAVLGLTPHPLDTENLEEQAENQAYFEGWMDRFLTSRLEFVNS >Mature_375_residues TNTILKSSTHPLSAYINRLKSGQALLKDSPENVLEVVGILKSYGIVLDAYSQNLNYIAEHQFLEMFPFFKYFNGKISLGK LLKFWSHDRINYEYAEYCMRGMLWHGGGGLDTYLDSAEFKQLAKAAIDAKISGNLMLMPLNQLFPEFLPDMVRQQAYYSA LGQFWRVMSDIFITLSDQYDQGQIKSIPEVVNHILSGLVAEANLPITFAVNIKGKPHDIIPKSVGLTFLTDTAVPYVEAI FFRGTPFSGTVSYNAQAQQIDPDQSQFTYGALYADPLPIGGAGIPPTLLMQDMRHFIPDYLLEFYQKTNRGTDNLRVKIC ATFQKSMFCVTTAAVLGLTPHPLDTENLEEQAENQAYFEGWMDRFLTSRLEFVNS
Specific function: Unknown
COG id: NA
COG function: NA
Gene ontology:
Cell location: Cytoplasmic
Metaboloic importance: NA
Operon status: Not Known
Operon components: None
Similarity: NA
Homologues:
None
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
NA
Pfam domain/function: NA
EC number: NA
Molecular weight: Translated: 42439; Mature: 42308
Theoretical pI: Translated: 5.38; Mature: 5.38
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.8 %Cys (Translated Protein) 3.2 %Met (Translated Protein) 4.0 %Cys+Met (Translated Protein) 0.8 %Cys (Mature Protein) 2.9 %Met (Mature Protein) 3.7 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MTNTILKSSTHPLSAYINRLKSGQALLKDSPENVLEVVGILKSYGIVLDAYSQNLNYIAE CCCCCCCCCCCHHHHHHHHHHCCCHHHCCCHHHHHHHHHHHHHCCEEEEEHHCCCHHHHH HQFLEMFPFFKYFNGKISLGKLLKFWSHDRINYEYAEYCMRGMLWHGGGGLDTYLDSAEF HHHHHHHHHHHHHCCCCCHHHHHHHHCCCCCCHHHHHHHHHCCEEECCCCHHHHHCHHHH KQLAKAAIDAKISGNLMLMPLNQLFPEFLPDMVRQQAYYSALGQFWRVMSDIFITLSDQY HHHHHHHHHHEECCCEEEEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHEEECCCC DQGQIKSIPEVVNHILSGLVAEANLPITFAVNIKGKPHDIIPKSVGLTFLTDTAVPYVEA CCCHHHHHHHHHHHHHHHHHHCCCCCEEEEEEECCCCCCCCCCCCCCEEEEHHHHHHHHH IFFRGTPFSGTVSYNAQAQQIDPDQSQFTYGALYADPLPIGGAGIPPTLLMQDMRHFIPD HHCCCCCCCCEEECCCCCCCCCCCCCCEEEEEEEECCCCCCCCCCCHHHHHHHHHHHHHH YLLEFYQKTNRGTDNLRVKICATFQKSMFCVTTAAVLGLTPHPLDTENLEEQAENQAYFE HHHHHHHHHCCCCCCEEEEEEEHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHH GWMDRFLTSRLEFVNS HHHHHHHHHHHHHHCC >Mature Secondary Structure TNTILKSSTHPLSAYINRLKSGQALLKDSPENVLEVVGILKSYGIVLDAYSQNLNYIAE CCCCCCCCCCHHHHHHHHHHCCCHHHCCCHHHHHHHHHHHHHCCEEEEEHHCCCHHHHH HQFLEMFPFFKYFNGKISLGKLLKFWSHDRINYEYAEYCMRGMLWHGGGGLDTYLDSAEF HHHHHHHHHHHHHCCCCCHHHHHHHHCCCCCCHHHHHHHHHCCEEECCCCHHHHHCHHHH KQLAKAAIDAKISGNLMLMPLNQLFPEFLPDMVRQQAYYSALGQFWRVMSDIFITLSDQY HHHHHHHHHHEECCCEEEEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHEEECCCC DQGQIKSIPEVVNHILSGLVAEANLPITFAVNIKGKPHDIIPKSVGLTFLTDTAVPYVEA CCCHHHHHHHHHHHHHHHHHHCCCCCEEEEEEECCCCCCCCCCCCCCEEEEHHHHHHHHH IFFRGTPFSGTVSYNAQAQQIDPDQSQFTYGALYADPLPIGGAGIPPTLLMQDMRHFIPD HHCCCCCCCCEEECCCCCCCCCCCCCCEEEEEEEECCCCCCCCCCCHHHHHHHHHHHHHH YLLEFYQKTNRGTDNLRVKICATFQKSMFCVTTAAVLGLTPHPLDTENLEEQAENQAYFE HHHHHHHHHCCCCCCEEEEEEEHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHH GWMDRFLTSRLEFVNS HHHHHHHHHHHHHHCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA