Definition Hyphomonas neptunium ATCC 15444 chromosome, complete genome.
Accession NC_008358
Length 3,705,021

Click here to switch to the map view.

The map label for this gene is 114799165

Identifier: 114799165

GI number: 114799165

Start: 3554003

End: 3556321

Strand: Reverse

Name: 114799165

Synonym: HNE_3412

Alternate gene names: NA

Gene position: 3556321-3554003 (Counterclockwise)

Preceding gene: 114798107

Following gene: 114797973

Centisome position: 95.99

GC content: 64.29

Gene sequence:

>2319_bases
ATGTTGAAACACTACACTGCGAGGACGGCGCGCGCTGCAATCGCCATGGCCCTCGGCGGCGCAGCCCTGCTGACGGGATG
CGACCAGATCGATACGCGAATTGAGCGCGCCCGAGAGATCGCGGACGCCTCCGTTGAACAGATCAACGGCGAGACCGTGA
TCGACCCCACTTACCGCAATCTGGAAAGCGCCTCCCCCGAGGATCGCGCCCTGGCGGGCACCGTCGTGACGGCAGAATTC
GCGATTGATGATGAAGACCGCCCGATGTTCGCCATCGGCTCAATCATCGCCAAGCCGCTCGCCATTCCGGACGCCGAATC
GGTCGATATTGTCGAGGATGCGGAGCAGATGGAGGCCGAGCTCGACTATTTCGACTCGCCAGAAGGCGAAGCGATGATGG
ACGCGGAGGAGGCGCCAGCCGCCGCCCCGCCAGCGCCGGCACCCCTCACGACCCAGGAGCCCGGCTCGGTATTCCTTGAA
GTGCAGCCGGCGCAGGTTATGCCGAAAATCACGCTCGATCCGCGTGATGCCGAGGAATCCCGCGAAGAGATCGCGCAAGC
GAGCCGGAAGTTTGATCAGGTGGTGATCCAGGACGACACCAAGCGCCTGCAGATGCGCAGTCTCTCGAAGCAAGATCTTG
AGGCCATGGCGCCTGAAGATCGCGCCGAGACCCGCAAGCTGGCCCGCCGCGCGCCAATCGAGCGGGAAGTGGTCCGCAAA
CAGCTTGATGCGAACACTGTCATGCTCGACACGATGTCCAAATACGGCGTCGGCGGGGAAGTGGCGCTGTCGCGTCAGGG
GCAGATGGTCATCCAGATCGGCGCCGATGGTGCAAACCCCACCCAGTTTACCGGCCGCAACGGTCCGGCAGACTTCCTCG
CGCGCACGGAAGCCGCAGAATGCCCGGAAGGCGCGGATGCCGCCTCTGTCGGTGACGACCTTGCGGTTGCCACAGCCTGC
GTCGTGCGCGACCTGCGCGCATCAGGCCAGTTCGAATATGTCGAACAGGATTACATTTTCCAGAACCAGTTTGCGCGGAA
ACCCAAAGACACCCCCTACGGCACCCCCGGCGAGACCAAAACTGGGTCCACAGGCTCAACCGGCTCACCCACGGGCCAGC
CGGTCAGCCAGGAGCCGGATGATCCGCTCTGGGCGCTGCAATGGCATTTCCGCGACAAGGGCACGTCCGAAGGCCGCACG
GCTGGCGGAGCGGGCTTTGAAAGCTTTTGGAACCGTCAGGGCGTTAGAGGATCCGACGGCATCGTCGTCGCAGTCGTCGA
TACCGGCCTGCAGATGAGCCATCCCGACATCGCCGCCTCGCCCAACATCATGCAGGGCTATGACATGGTCTCCGATCCCC
GCATGGGCAATGACGGCGACGGGCGCGATATTGATGCAAACGATCCCGGCGATATGTGCGATCCGAACAAGCCCAATGCC
GCAGACAGTTTCCACGGCACGCATGTGGCAGGCACAATTGGCGCGGCCGCCACCAACAACGGTTCCGGCGTTGCCGGCGG
CGCGTGGGACGTGCGCATCGTACCGGTGCGCGCGCTCGGCAAGTGCGGTGGGCGCCTGTCGGACATCAATGATGCGATCC
GCTGGGCAGCGGGGCTGATCCCGGCCGAAGTCAATGAAGGACCACAGGTCTGGACCGAGGTCTGGAACGAGAACCCGGCC
GACATCATCAACCTCTCCATTGGCCTGCTCGGAGCCTGCCCGGCCTCGCTGCAGGACGCCATCGACGCGGTGACCGAAGA
GGGCGTGATCGTTGTTTCGGCGGCGGGCAATGCCCGTATGTCGACAAGCCTCTATGCGCCCGCCGGCTGTCGCAATGTCG
TGACGGTTGCCGCAAGCGATGCCCGTGGCCAGATCGCGCCCTACTCGAACTTCGGTCCCGAAGTCATGGTGCTCGCGCCA
GGCGGCGACCTGACGCGTGACGATAACGGTGACGGTAAACCCGATGGCGTACTCTCCACCAAGGCGGCCACCAACTGCTA
CGATCCTGTCACCGGCGAAGGCGTGGAGAATTGTTTCTACGCGTATGAGCAGGGTACCAGCATGGCCGCGCCACATGTCT
CGGCCGCGCTCGCATTGCTCAAGTCTCGCGATCCGGCCGCCAGCCGCGACGACATCATCAGCACACTGAGGGCGGCGCTG
GACCCGCGCGAGAGCCTGCAATGCGCTGGCCTCTGCACGCAGTATCCCGGCGCTGCGCCCATCGAGGGCAGCCCTGATAT
GTGTGCCCGGCCCTGTGGAGTAGGGCTGCTCAACATGGCCAATGTGCCGCTCAAGGCGACAGACGGAGGCGGTCGCTGA

Upstream 100 bases:

>100_bases
ATTTGCGGATTGGACAGGGCGGCTGCCTCGTCATAATCTCAACACAGCGTTAACCTAATGTGCTGGGGCGTTCATTGGCA
ATCGCATGGGGATATCCGGC

Downstream 100 bases:

>100_bases
GATGAACCGGCCCCGGATTCCCATGGATGCGCGCGGCCCGCTCGGCCTGCTTGGCATCGGCCTTCTCGCCGGCGCTGCAG
GGCTTGCCGTGGTCGGCACG

Product: subtilase family protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 772; Mature: 772

Protein sequence:

>772_residues
MLKHYTARTARAAIAMALGGAALLTGCDQIDTRIERAREIADASVEQINGETVIDPTYRNLESASPEDRALAGTVVTAEF
AIDDEDRPMFAIGSIIAKPLAIPDAESVDIVEDAEQMEAELDYFDSPEGEAMMDAEEAPAAAPPAPAPLTTQEPGSVFLE
VQPAQVMPKITLDPRDAEESREEIAQASRKFDQVVIQDDTKRLQMRSLSKQDLEAMAPEDRAETRKLARRAPIEREVVRK
QLDANTVMLDTMSKYGVGGEVALSRQGQMVIQIGADGANPTQFTGRNGPADFLARTEAAECPEGADAASVGDDLAVATAC
VVRDLRASGQFEYVEQDYIFQNQFARKPKDTPYGTPGETKTGSTGSTGSPTGQPVSQEPDDPLWALQWHFRDKGTSEGRT
AGGAGFESFWNRQGVRGSDGIVVAVVDTGLQMSHPDIAASPNIMQGYDMVSDPRMGNDGDGRDIDANDPGDMCDPNKPNA
ADSFHGTHVAGTIGAAATNNGSGVAGGAWDVRIVPVRALGKCGGRLSDINDAIRWAAGLIPAEVNEGPQVWTEVWNENPA
DIINLSIGLLGACPASLQDAIDAVTEEGVIVVSAAGNARMSTSLYAPAGCRNVVTVAASDARGQIAPYSNFGPEVMVLAP
GGDLTRDDNGDGKPDGVLSTKAATNCYDPVTGEGVENCFYAYEQGTSMAAPHVSAALALLKSRDPAASRDDIISTLRAAL
DPRESLQCAGLCTQYPGAAPIEGSPDMCARPCGVGLLNMANVPLKATDGGGR

Sequences:

>Translated_772_residues
MLKHYTARTARAAIAMALGGAALLTGCDQIDTRIERAREIADASVEQINGETVIDPTYRNLESASPEDRALAGTVVTAEF
AIDDEDRPMFAIGSIIAKPLAIPDAESVDIVEDAEQMEAELDYFDSPEGEAMMDAEEAPAAAPPAPAPLTTQEPGSVFLE
VQPAQVMPKITLDPRDAEESREEIAQASRKFDQVVIQDDTKRLQMRSLSKQDLEAMAPEDRAETRKLARRAPIEREVVRK
QLDANTVMLDTMSKYGVGGEVALSRQGQMVIQIGADGANPTQFTGRNGPADFLARTEAAECPEGADAASVGDDLAVATAC
VVRDLRASGQFEYVEQDYIFQNQFARKPKDTPYGTPGETKTGSTGSTGSPTGQPVSQEPDDPLWALQWHFRDKGTSEGRT
AGGAGFESFWNRQGVRGSDGIVVAVVDTGLQMSHPDIAASPNIMQGYDMVSDPRMGNDGDGRDIDANDPGDMCDPNKPNA
ADSFHGTHVAGTIGAAATNNGSGVAGGAWDVRIVPVRALGKCGGRLSDINDAIRWAAGLIPAEVNEGPQVWTEVWNENPA
DIINLSIGLLGACPASLQDAIDAVTEEGVIVVSAAGNARMSTSLYAPAGCRNVVTVAASDARGQIAPYSNFGPEVMVLAP
GGDLTRDDNGDGKPDGVLSTKAATNCYDPVTGEGVENCFYAYEQGTSMAAPHVSAALALLKSRDPAASRDDIISTLRAAL
DPRESLQCAGLCTQYPGAAPIEGSPDMCARPCGVGLLNMANVPLKATDGGGR
>Mature_772_residues
MLKHYTARTARAAIAMALGGAALLTGCDQIDTRIERAREIADASVEQINGETVIDPTYRNLESASPEDRALAGTVVTAEF
AIDDEDRPMFAIGSIIAKPLAIPDAESVDIVEDAEQMEAELDYFDSPEGEAMMDAEEAPAAAPPAPAPLTTQEPGSVFLE
VQPAQVMPKITLDPRDAEESREEIAQASRKFDQVVIQDDTKRLQMRSLSKQDLEAMAPEDRAETRKLARRAPIEREVVRK
QLDANTVMLDTMSKYGVGGEVALSRQGQMVIQIGADGANPTQFTGRNGPADFLARTEAAECPEGADAASVGDDLAVATAC
VVRDLRASGQFEYVEQDYIFQNQFARKPKDTPYGTPGETKTGSTGSTGSPTGQPVSQEPDDPLWALQWHFRDKGTSEGRT
AGGAGFESFWNRQGVRGSDGIVVAVVDTGLQMSHPDIAASPNIMQGYDMVSDPRMGNDGDGRDIDANDPGDMCDPNKPNA
ADSFHGTHVAGTIGAAATNNGSGVAGGAWDVRIVPVRALGKCGGRLSDINDAIRWAAGLIPAEVNEGPQVWTEVWNENPA
DIINLSIGLLGACPASLQDAIDAVTEEGVIVVSAAGNARMSTSLYAPAGCRNVVTVAASDARGQIAPYSNFGPEVMVLAP
GGDLTRDDNGDGKPDGVLSTKAATNCYDPVTGEGVENCFYAYEQGTSMAAPHVSAALALLKSRDPAASRDDIISTLRAAL
DPRESLQCAGLCTQYPGAAPIEGSPDMCARPCGVGLLNMANVPLKATDGGGR

Specific function: Unknown

COG id: COG1404

COG function: function code O; Subtilisin-like serine proteases

Gene ontology:

Cell location: Secreted [H]

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the peptidase S8 family [H]

Homologues:

Organism=Saccharomyces cerevisiae, GI6319893, Length=299, Percent_Identity=24.7491638795987, Blast_Score=72, Evalue=4e-13,
Organism=Saccharomyces cerevisiae, GI6320775, Length=289, Percent_Identity=28.719723183391, Blast_Score=67, Evalue=1e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR007280
- InterPro:   IPR000209
- InterPro:   IPR022398
- InterPro:   IPR015500 [H]

Pfam domain/function: PF00082 Peptidase_S8; PF04151 PPC [H]

EC number: NA

Molecular weight: Translated: 81283; Mature: 81283

Theoretical pI: Translated: 4.17; Mature: 4.17

Prosite motif: PS00013 PROKAR_LIPOPROTEIN ; PS00136 SUBTILASE_ASP ; PS00137 SUBTILASE_HIS ; PS00138 SUBTILASE_SER

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.7 %Cys     (Translated Protein)
2.8 %Met     (Translated Protein)
4.5 %Cys+Met (Translated Protein)
1.7 %Cys     (Mature Protein)
2.8 %Met     (Mature Protein)
4.5 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MLKHYTARTARAAIAMALGGAALLTGCDQIDTRIERAREIADASVEQINGETVIDPTYRN
CCCCHHHHHHHHHHHHHHCCHHHHHCCHHHHHHHHHHHHHHHHHHHHCCCCEEECCCHHH
LESASPEDRALAGTVVTAEFAIDDEDRPMFAIGSIIAKPLAIPDAESVDIVEDAEQMEAE
HCCCCCCCCEEEEEEEEEEEEECCCCCCHHHHHHHHHCCCCCCCCCCCCHHHHHHHHHHH
LDYFDSPEGEAMMDAEEAPAAAPPAPAPLTTQEPGSVFLEVQPAQVMPKITLDPRDAEES
HCCCCCCCCCEEECHHHCCCCCCCCCCCCCCCCCCCEEEEEEHHHHCCEEEECCCCHHHH
REEIAQASRKFDQVVIQDDTKRLQMRSLSKQDLEAMAPEDRAETRKLARRAPIEREVVRK
HHHHHHHHHHHHEEEECCCHHHHHHHHCCHHHHHHCCCCHHHHHHHHHHHCCHHHHHHHH
QLDANTVMLDTMSKYGVGGEVALSRQGQMVIQIGADGANPTQFTGRNGPADFLARTEAAE
HHCCCEEEEECHHHHCCCCEEEEECCCCEEEEECCCCCCCCCCCCCCCCHHHHHHCCHHC
CPEGADAASVGDDLAVATACVVRDLRASGQFEYVEQDYIFQNQFARKPKDTPYGTPGETK
CCCCCCHHHCCCHHHHHHHHHHHHHHCCCCEEEHHHHHHHHHHHHCCCCCCCCCCCCCCC
TGSTGSTGSPTGQPVSQEPDDPLWALQWHFRDKGTSEGRTAGGAGFESFWNRQGVRGSDG
CCCCCCCCCCCCCCCCCCCCCCEEEEEEEECCCCCCCCCCCCCCCHHHHHHCCCCCCCCC
IVVAVVDTGLQMSHPDIAASPNIMQGYDMVSDPRMGNDGDGRDIDANDPGDMCDPNKPNA
EEEEEEECCCCCCCCCCCCCCCHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
ADSFHGTHVAGTIGAAATNNGSGVAGGAWDVRIVPVRALGKCGGRLSDINDAIRWAAGLI
CCCCCCCEEEECCCCCCCCCCCCCCCCCEEEEEEEHHHHHHCCCCHHHHHHHHHHHHCCC
PAEVNEGPQVWTEVWNENPADIINLSIGLLGACPASLQDAIDAVTEEGVIVVSAAGNARM
CCCCCCCHHHHHHHHCCCCCCEEEEEHHHHHCCCHHHHHHHHHHCCCCEEEEECCCCCEE
STSLYAPAGCRNVVTVAASDARGQIAPYSNFGPEVMVLAPGGDLTRDDNGDGKPDGVLST
CCEEECCCCCCCEEEEEECCCCCCCCCCCCCCCEEEEECCCCCCCCCCCCCCCCCCEEEC
KAATNCYDPVTGEGVENCFYAYEQGTSMAAPHVSAALALLKSRDPAASRDDIISTLRAAL
CCCCCCCCCCCCCCHHHHHHHHHCCCCCCCHHHHHHHHHHHCCCCCCCHHHHHHHHHHHC
DPRESLQCAGLCTQYPGAAPIEGSPDMCARPCGVGLLNMANVPLKATDGGGR
CHHHHHHHHHHHHCCCCCCCCCCCCCHHHCCCCCCCHHHCCCCEEECCCCCC
>Mature Secondary Structure
MLKHYTARTARAAIAMALGGAALLTGCDQIDTRIERAREIADASVEQINGETVIDPTYRN
CCCCHHHHHHHHHHHHHHCCHHHHHCCHHHHHHHHHHHHHHHHHHHHCCCCEEECCCHHH
LESASPEDRALAGTVVTAEFAIDDEDRPMFAIGSIIAKPLAIPDAESVDIVEDAEQMEAE
HCCCCCCCCEEEEEEEEEEEEECCCCCCHHHHHHHHHCCCCCCCCCCCCHHHHHHHHHHH
LDYFDSPEGEAMMDAEEAPAAAPPAPAPLTTQEPGSVFLEVQPAQVMPKITLDPRDAEES
HCCCCCCCCCEEECHHHCCCCCCCCCCCCCCCCCCCEEEEEEHHHHCCEEEECCCCHHHH
REEIAQASRKFDQVVIQDDTKRLQMRSLSKQDLEAMAPEDRAETRKLARRAPIEREVVRK
HHHHHHHHHHHHEEEECCCHHHHHHHHCCHHHHHHCCCCHHHHHHHHHHHCCHHHHHHHH
QLDANTVMLDTMSKYGVGGEVALSRQGQMVIQIGADGANPTQFTGRNGPADFLARTEAAE
HHCCCEEEEECHHHHCCCCEEEEECCCCEEEEECCCCCCCCCCCCCCCCHHHHHHCCHHC
CPEGADAASVGDDLAVATACVVRDLRASGQFEYVEQDYIFQNQFARKPKDTPYGTPGETK
CCCCCCHHHCCCHHHHHHHHHHHHHHCCCCEEEHHHHHHHHHHHHCCCCCCCCCCCCCCC
TGSTGSTGSPTGQPVSQEPDDPLWALQWHFRDKGTSEGRTAGGAGFESFWNRQGVRGSDG
CCCCCCCCCCCCCCCCCCCCCCEEEEEEEECCCCCCCCCCCCCCCHHHHHHCCCCCCCCC
IVVAVVDTGLQMSHPDIAASPNIMQGYDMVSDPRMGNDGDGRDIDANDPGDMCDPNKPNA
EEEEEEECCCCCCCCCCCCCCCHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
ADSFHGTHVAGTIGAAATNNGSGVAGGAWDVRIVPVRALGKCGGRLSDINDAIRWAAGLI
CCCCCCCEEEECCCCCCCCCCCCCCCCCEEEEEEEHHHHHHCCCCHHHHHHHHHHHHCCC
PAEVNEGPQVWTEVWNENPADIINLSIGLLGACPASLQDAIDAVTEEGVIVVSAAGNARM
CCCCCCCHHHHHHHHCCCCCCEEEEEHHHHHCCCHHHHHHHHHHCCCCEEEEECCCCCEE
STSLYAPAGCRNVVTVAASDARGQIAPYSNFGPEVMVLAPGGDLTRDDNGDGKPDGVLST
CCEEECCCCCCCEEEEEECCCCCCCCCCCCCCCEEEEECCCCCCCCCCCCCCCCCCEEEC
KAATNCYDPVTGEGVENCFYAYEQGTSMAAPHVSAALALLKSRDPAASRDDIISTLRAAL
CCCCCCCCCCCCCCHHHHHHHHHCCCCCCCHHHHHHHHHHHCCCCCCCHHHHHHHHHHHC
DPRESLQCAGLCTQYPGAAPIEGSPDMCARPCGVGLLNMANVPLKATDGGGR
CHHHHHHHHHHHHCCCCCCCCCCCCCHHHCCCCCCCHHHCCCCEEECCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 2187155; 12024217 [H]