Definition Herpetosiphon aurantiacus ATCC 23779 chromosome, complete genome.
Accession NC_009972
Length 6,346,587

Click here to switch to the map view.

The map label for this gene is 159896865

Identifier: 159896865

GI number: 159896865

Start: 396063

End: 397805

Strand: Direct

Name: 159896865

Synonym: Haur_0332

Alternate gene names: NA

Gene position: 396063-397805 (Clockwise)

Preceding gene: 159896863

Following gene: 159896870

Centisome position: 6.24

GC content: 50.66

Gene sequence:

>1743_bases
ATGGTTCTTCGAAGGATGATGTTTGTTTTGCTGGTTATTTTTAGCTTGAGCACTGTTTCGGCAACGTCGCTGGAAACTCC
CTCTGCTGAGCCACTCGACGCAGCAAGCCCCGCTAGCCCAGCCGCCACCAATGCCTACACCATGCGAGCTGGATTCCCTG
CAACCAAGCCGAATGGTTCATATTTTTCATCACCAACCGTCGTTGATCTATTTAAAGATGGTTCGCCCGAGATTCTTTCA
GCAGATGCAACTGGTTGTATTTGGGGTTACAACATTTATGGTCAATTGTTGCCTGGCTTTCCCTGGATGACTGGCGGTGC
GTGTGCCAATACCCCGCGGATCAATGGTTCGTTGGTGGTCGCTGACATTAACGAAGATGGCTTATTGGAAATTGTGGTTG
GCACACGCGGCAAAGGCACAAGCGTTGGTCAGCGCGGCAAGGTCATTGTTTATCAACGCAATGGAGCCATTTTGAGCGGT
TGGCCCAAAGAAATGGAATGGGCCTACATCACCAACGGCAACTTCCCCGAGGTGGTGCATGTCGCTGTTGACGATATTAT
TGGTGATAGCAAACTTGAGGTGATTGCGACTACCACGAATGAGGCGGGTAGTAATACTGATTATGCACCCAATGTGCATG
CGTGGTATTACACGGGGAATGTCGTTACTGGCTACCCCAAAAGCTCCGATAAAGGCTCGGGCATTTGGGGCCACCCCGCC
TTGGCCGACCTCGACAATAACGGCAAATCGGAGATCTTCGTTGGCCGCGATGAACTCTATTTCTATCGCTATAAAAACGA
TGGAACCCAATATGCAGGCTGGCCAATTCAGACCTATACCCATGTCAACCAAACGACTTGGAATGTTCACGATTATATTG
AGTTTACCCGCTCTGGCCCAGCTATCGCCGATTTAGATAATGATGGCAGTTACGAGGTGATTGCAGCAGGTAAAGTGCGG
ACTCCAGACGGCGATCCGCATAACAACTACGACCCGCAAAGTGCTAGTGCGGTTTTCGTAACTGAGCCAGATGGTACTCG
CCGCCCTGGCTGGACTGATGCCAAACGCGCTGGCGCACCGTTGGATGTCAACTTTACCCCCAATAATCCGATTGTTGTCG
CCGATTTGGATGGCAATGGTGAAAAGGAATTTGTAGTTACCTTCGATGATGGTACAATTCGCGCCTATCGCGAAAACGGC
ACGCAAATCTGGTCGTATTTCTATGCTGAGGAACCAGTCCAAGGTGCGCCAACCCGCAAAGTATTTGGTAGCGAAGTCGT
CATTGCCGATGTTACGGGTGACCGCAAGCTAGATATTGTCTTTGGTACGTATTCATTCGACCGACTTTATGCGGGGATTG
TCGGGTTGTATGCCCTCGATGCCCGCAATGGAGCCTTGCATTCGGGCTTTCCACTGAGTTTGCCCAATGAAGGCACGGCT
AGCGATAACAGTGCTGGCTCGCAGAAAGGGATTCAAGCCGCCCCAACTATCTCCGATATCGATAATAACTGCTATGTCGA
AATTTTGGCCCACAGTCGGGCGGGCAATATTTATGTTTGGGAAACCCTAGGCCGCAATTTGCCTGAATTAATGCCTTGGC
CGATGAGCCGCCAGAACTTACAGCGCACTGCGTGGGTGCAAAATCCACCTGAACCACGCCAACACGTATTTGCCCCCGAG
CAAATTCAAGGCGGTGATTTCAATGTCTATTTGCCAATGACCCGCATGGGTTGCGATTTCTAG

Upstream 100 bases:

>100_bases
ATAGGACTGTTGGCCTATGGTCAATCCAGCGCTAGCATAGCACGATCAACCCATTATTTCCATGGAACTGCCACGTTTGC
AGTCAAGAGGAGTGTCTAGT

Downstream 100 bases:

>100_bases
AGTTGTTGCCAAAGCAGGGATGGTTGCGGCCATCCCTGTTTTGTTAATTATTGCAATGGCAGATTAGGATCAATCTTGTA
GCTCTGAACAATCCGCACAA

Product: hypothetical protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 580; Mature: 580

Protein sequence:

>580_residues
MVLRRMMFVLLVIFSLSTVSATSLETPSAEPLDAASPASPAATNAYTMRAGFPATKPNGSYFSSPTVVDLFKDGSPEILS
ADATGCIWGYNIYGQLLPGFPWMTGGACANTPRINGSLVVADINEDGLLEIVVGTRGKGTSVGQRGKVIVYQRNGAILSG
WPKEMEWAYITNGNFPEVVHVAVDDIIGDSKLEVIATTTNEAGSNTDYAPNVHAWYYTGNVVTGYPKSSDKGSGIWGHPA
LADLDNNGKSEIFVGRDELYFYRYKNDGTQYAGWPIQTYTHVNQTTWNVHDYIEFTRSGPAIADLDNDGSYEVIAAGKVR
TPDGDPHNNYDPQSASAVFVTEPDGTRRPGWTDAKRAGAPLDVNFTPNNPIVVADLDGNGEKEFVVTFDDGTIRAYRENG
TQIWSYFYAEEPVQGAPTRKVFGSEVVIADVTGDRKLDIVFGTYSFDRLYAGIVGLYALDARNGALHSGFPLSLPNEGTA
SDNSAGSQKGIQAAPTISDIDNNCYVEILAHSRAGNIYVWETLGRNLPELMPWPMSRQNLQRTAWVQNPPEPRQHVFAPE
QIQGGDFNVYLPMTRMGCDF

Sequences:

>Translated_580_residues
MVLRRMMFVLLVIFSLSTVSATSLETPSAEPLDAASPASPAATNAYTMRAGFPATKPNGSYFSSPTVVDLFKDGSPEILS
ADATGCIWGYNIYGQLLPGFPWMTGGACANTPRINGSLVVADINEDGLLEIVVGTRGKGTSVGQRGKVIVYQRNGAILSG
WPKEMEWAYITNGNFPEVVHVAVDDIIGDSKLEVIATTTNEAGSNTDYAPNVHAWYYTGNVVTGYPKSSDKGSGIWGHPA
LADLDNNGKSEIFVGRDELYFYRYKNDGTQYAGWPIQTYTHVNQTTWNVHDYIEFTRSGPAIADLDNDGSYEVIAAGKVR
TPDGDPHNNYDPQSASAVFVTEPDGTRRPGWTDAKRAGAPLDVNFTPNNPIVVADLDGNGEKEFVVTFDDGTIRAYRENG
TQIWSYFYAEEPVQGAPTRKVFGSEVVIADVTGDRKLDIVFGTYSFDRLYAGIVGLYALDARNGALHSGFPLSLPNEGTA
SDNSAGSQKGIQAAPTISDIDNNCYVEILAHSRAGNIYVWETLGRNLPELMPWPMSRQNLQRTAWVQNPPEPRQHVFAPE
QIQGGDFNVYLPMTRMGCDF
>Mature_580_residues
MVLRRMMFVLLVIFSLSTVSATSLETPSAEPLDAASPASPAATNAYTMRAGFPATKPNGSYFSSPTVVDLFKDGSPEILS
ADATGCIWGYNIYGQLLPGFPWMTGGACANTPRINGSLVVADINEDGLLEIVVGTRGKGTSVGQRGKVIVYQRNGAILSG
WPKEMEWAYITNGNFPEVVHVAVDDIIGDSKLEVIATTTNEAGSNTDYAPNVHAWYYTGNVVTGYPKSSDKGSGIWGHPA
LADLDNNGKSEIFVGRDELYFYRYKNDGTQYAGWPIQTYTHVNQTTWNVHDYIEFTRSGPAIADLDNDGSYEVIAAGKVR
TPDGDPHNNYDPQSASAVFVTEPDGTRRPGWTDAKRAGAPLDVNFTPNNPIVVADLDGNGEKEFVVTFDDGTIRAYRENG
TQIWSYFYAEEPVQGAPTRKVFGSEVVIADVTGDRKLDIVFGTYSFDRLYAGIVGLYALDARNGALHSGFPLSLPNEGTA
SDNSAGSQKGIQAAPTISDIDNNCYVEILAHSRAGNIYVWETLGRNLPELMPWPMSRQNLQRTAWVQNPPEPRQHVFAPE
QIQGGDFNVYLPMTRMGCDF

Specific function: Unknown

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 63175; Mature: 63175

Theoretical pI: Translated: 4.52; Mature: 4.52

Prosite motif: PS00398 RECOMBINASES_2

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.7 %Cys     (Translated Protein)
1.7 %Met     (Translated Protein)
2.4 %Cys+Met (Translated Protein)
0.7 %Cys     (Mature Protein)
1.7 %Met     (Mature Protein)
2.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MVLRRMMFVLLVIFSLSTVSATSLETPSAEPLDAASPASPAATNAYTMRAGFPATKPNGS
CHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCEEEEECCCCCCCCCCC
YFSSPTVVDLFKDGSPEILSADATGCIWGYNIYGQLLPGFPWMTGGACANTPRINGSLVV
EECCCCEEEEECCCCCCEEECCCCEEEEEECCHHHHCCCCCCCCCCCCCCCCCCCCEEEE
ADINEDGLLEIVVGTRGKGTSVGQRGKVIVYQRNGAILSGWPKEMEWAYITNGNFPEVVH
EECCCCCEEEEEEECCCCCCCCCCCCCEEEEECCCCEEECCCCCCEEEEEECCCCCEEEE
VAVDDIIGDSKLEVIATTTNEAGSNTDYAPNVHAWYYTGNVVTGYPKSSDKGSGIWGHPA
EEEHHHCCCCCEEEEEEECCCCCCCCCCCCCCEEEEEECCEEECCCCCCCCCCCEECCCC
LADLDNNGKSEIFVGRDELYFYRYKNDGTQYAGWPIQTYTHVNQTTWNVHDYIEFTRSGP
EEECCCCCCCEEEEECCEEEEEEECCCCCEECCCCEEEEEECCCEEEEHHHHHHHHCCCC
AIADLDNDGSYEVIAAGKVRTPDGDPHNNYDPQSASAVFVTEPDGTRRPGWTDAKRAGAP
EEEECCCCCCEEEEEECEEECCCCCCCCCCCCCCCCEEEEECCCCCCCCCCCCHHHCCCC
LDVNFTPNNPIVVADLDGNGEKEFVVTFDDGTIRAYRENGTQIWSYFYAEEPVQGAPTRK
EEEEECCCCCEEEEECCCCCCEEEEEEECCCEEEEEECCCCEEEEEEEECCCCCCCCCHH
VFGSEVVIADVTGDRKLDIVFGTYSFDRLYAGIVGLYALDARNGALHSGFPLSLPNEGTA
CCCCEEEEEECCCCEEEEEEEECCCHHHHHHHHHEEEEEECCCCCCCCCCCCCCCCCCCC
SDNSAGSQKGIQAAPTISDIDNNCYVEILAHSRAGNIYVWETLGRNLPELMPWPMSRQNL
CCCCCCCCCCCEECCCHHHCCCCEEEEEEEECCCCCEEEEHHHCCCCHHHCCCCCCHHHH
QRTAWVQNPPEPRQHVFAPEQIQGGDFNVYLPMTRMGCDF
HHHCCCCCCCCHHHHCCCCCCCCCCCEEEEEEHHHCCCCC
>Mature Secondary Structure
MVLRRMMFVLLVIFSLSTVSATSLETPSAEPLDAASPASPAATNAYTMRAGFPATKPNGS
CHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCEEEEECCCCCCCCCCC
YFSSPTVVDLFKDGSPEILSADATGCIWGYNIYGQLLPGFPWMTGGACANTPRINGSLVV
EECCCCEEEEECCCCCCEEECCCCEEEEEECCHHHHCCCCCCCCCCCCCCCCCCCCEEEE
ADINEDGLLEIVVGTRGKGTSVGQRGKVIVYQRNGAILSGWPKEMEWAYITNGNFPEVVH
EECCCCCEEEEEEECCCCCCCCCCCCCEEEEECCCCEEECCCCCCEEEEEECCCCCEEEE
VAVDDIIGDSKLEVIATTTNEAGSNTDYAPNVHAWYYTGNVVTGYPKSSDKGSGIWGHPA
EEEHHHCCCCCEEEEEEECCCCCCCCCCCCCCEEEEEECCEEECCCCCCCCCCCEECCCC
LADLDNNGKSEIFVGRDELYFYRYKNDGTQYAGWPIQTYTHVNQTTWNVHDYIEFTRSGP
EEECCCCCCCEEEEECCEEEEEEECCCCCEECCCCEEEEEECCCEEEEHHHHHHHHCCCC
AIADLDNDGSYEVIAAGKVRTPDGDPHNNYDPQSASAVFVTEPDGTRRPGWTDAKRAGAP
EEEECCCCCCEEEEEECEEECCCCCCCCCCCCCCCCEEEEECCCCCCCCCCCCHHHCCCC
LDVNFTPNNPIVVADLDGNGEKEFVVTFDDGTIRAYRENGTQIWSYFYAEEPVQGAPTRK
EEEEECCCCCEEEEECCCCCCEEEEEEECCCEEEEEECCCCEEEEEEEECCCCCCCCCHH
VFGSEVVIADVTGDRKLDIVFGTYSFDRLYAGIVGLYALDARNGALHSGFPLSLPNEGTA
CCCCEEEEEECCCCEEEEEEEECCCHHHHHHHHHEEEEEECCCCCCCCCCCCCCCCCCCC
SDNSAGSQKGIQAAPTISDIDNNCYVEILAHSRAGNIYVWETLGRNLPELMPWPMSRQNL
CCCCCCCCCCCEECCCHHHCCCCEEEEEEEECCCCCEEEEHHHCCCCHHHCCCCCCHHHH
QRTAWVQNPPEPRQHVFAPEQIQGGDFNVYLPMTRMGCDF
HHHCCCCCCCCHHHHCCCCCCCCCCCEEEEEEHHHCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA