Definition Helicobacter pylori HPAG1 chromosome, complete genome.
Accession NC_008086
Length 1,596,366

Click here to switch to the map view.

The map label for this gene is bhuA [H]

Identifier: 108563825

GI number: 108563825

Start: 1455355

End: 1457946

Strand: Reverse

Name: bhuA [H]

Synonym: HPAG1_1400

Alternate gene names: 108563825

Gene position: 1457946-1455355 (Counterclockwise)

Preceding gene: 108563826

Following gene: 108563824

Centisome position: 91.33

GC content: 44.91

Gene sequence:

>2592_bases
ATGCTTAGAAATAAATTCCGTATCGTGTTTGTCTCTTGTATTGTCGCTAGCAGTTTGCAAGCTCAAGAAACAACCCACAC
TTTGGGTAAGGTAACCACTAAGGGTGAAAGGACTTTTGAATACAACAATAAAATGTATATTGAAAGGAAAGAGCTCCAAC
AACGCCAAAGCAACCAAATCCGTGATATTTTTAGGACCAGAGCGGATGTGAATGTGGCTAGTGGGGGCTTGATGGCACAA
AAGATCTATGTTAGGGGGATTGAAAGTCGCCTCTTAAGGGTAACAATAGATGGCGTCGCCCAAAATGGTAACATTTTCCA
CCATGACGCTAACACCGTGATCGATCCTAACATGATTAAAGAAGTGGAAGTGATCAAAGGGGCAGCGAACGCTTCAGCGG
GTCCGGGCGCGGTGGCAGGTAAATTGTCTTTCACTACGATTGACGCTAACGACTTCTTAAGAAAGAATCAAACTTATGGG
GCTAAAGCGGAAGCGGGCTTTTATACCAATTTCGGGTATCGCATGAACGCTACTGCAGCCTATCGTGGTAAAAACTGGGA
CATACTCGCTTATTACAACCATCAAAATATCTTTTATTATAGAGACGGAAACAACGCTTTTAGGAATCTCTTCCACCCCA
ACTACGATTTACAAGATCCGAGTAATAGCGACATTGGCGTAGGGACTCCGAGCGAAATCAATAGCGTTTTAGGTAAGGTC
AATGGCTATATCAACGACACGGATACCATTAGCTTAAGCTATAACATGACAAGGGAAAATTCCACTAGGCTTTTACGCCC
TAACACCACTTCAGCGCTCTCTAAAGCTAACGACCCAGGAAGCCAGCCAGCCCCCTTTGTGATTGACTTTGGGAAAGAAT
TAGCCCATACGATCAACTTCAACCACAATTTGAGTCTGAAATACAAGCATGATGGAGGCACTAGTTTTAGTCAGCCGCGC
GTTGAATCCACCGCCTTTTTAGGGGTAAGGGGGGGCGATTATAACCCTGTGGTGAATCCTTTCGCTTACAATTCTAATGA
GCCGGCTAACCCGGATTACATCCCTGAAGTTAAGGATTGGTGTAATAACCCGGATAATATCAGCCAGTGCACGCAAGGGG
CTATTAGGCCTTCTGATGGGGGCTATCAAATAGGTTATGGGCAGCCGGGTTCGATCAATTGGCAAGGTGCTTCTGCAATT
TCCACAGGATCTAATATTTACCATGGGCTTGTTCCTAAAAATCCTGATTATGACATGACCCCCCCTAACGCTCAAAACCC
TAGCGCAAACGATTGGACTTTAGGGAATGCGGACGCTGAGGGGACTTTAGCCAGAAGGATTTTCTTAATCAACTCGGGCG
TTAATTTTAAAGTAACCCACCCCATTAGCGAAGATTATGGGAATGTGTTTGAATACGGCATGATTTATCAAAACCTGAGC
GTTTTCTCTGGATTGGATAAAGGCAAAAACGGCTATTATAAAAACAACATTGACCCTAACGACCCTAACGGGCCGGGCTT
GCCTTATCGCCATTACTACACCGATCAAAGCTCTCAATACCCTCAAAATCTGAACGCGCCCAACCCACTTTATCGTAACA
TGCCCCAAAATTCGCATGCGATTGGGAATATCATCGGTGGGTTTATGCAAGCGAACTACAATCTCTTGAAAAACCTCATC
GTGGGTGCGGGAACTCGTTATGATATTTACACCTTGCTGGACAAAAACGGTCGCACGCATGTAACTTCTGGTTTCTCGCC
TTCTGCAACCGTGCTTTATAACCCCATTGAAAGCATTGGCTTGAAAGTGAGTTATGCGTATGTAACTAAGGGGGCTTTGC
CTGGCGATGGCGTTTTGATGCGCGATCCTACGGTGATTTATCAAAGGAATTTGCGCCCTGCGATCGGTCAAAATGTGGAA
TTCAATGTGGATTACAACAGCAAGTATTTCAATGTGCGCGGGGCAGCGTTCTATCAGGTCATCAATAACTTCATCAACAG
CTACGGGCAAGACACTTCTAAAAACGGAGGGGGTAATGCGACCGCAAAAAACATGTCAGGGAATTTACCCGAAACCATTA
ATATCTATGGTTATGAAGTTTCAGGGAATGTGCAATATAAAAATTTCGTAGGGACTTTCTCGGTGGCTCGCTCTTGGCCA
ACGGCTAGGGGGCATTTGTTAGCGGACACTTACGCTTTAGCTGCAACGACTGGGAATGTGTTTATCCTAAAAGCCGATTA
CAATATCCACAGATGGGGGCTTACTTTAACTTGGCTCTCACGCTTTGTAACTAACATGTTCTATGAAGGTTATTCTATCT
ACTACCCTCAATACGGTTTGATGAGAATCCATAAACCCGGGTATGGCGTGCATAATGTCTTTATCAACTGGACTCCGCCT
TCTAAAAAATGGCAGGGTTTAAGGATTTCAGCCGTGTTTAATAACATCTTAAACAAGCAATATGTCAGCCAAGCTTCGGT
GTGGCAAGCGAGTGCGGACGCTCCAGCAAGCGATATGATCCCTAAAGATAAGCGCATGGCGCTCCCTGCTCCTGGATTTA
ACGCGCGTTTTGAGGTATCCTATCAATTCTAA

Upstream 100 bases:

>100_bases
ACAAATTTAAGGTATTATTAAATAGAATAATGTAATAATAACTTTAGGTTTAAAACTTGACTAAATTTTTAGAAAAAAGT
GAATAGAAAGGCTAAAAGAA

Downstream 100 bases:

>100_bases
AATGAAAGAAATCTTAGGATTTCTTTTTGAATTTTAAACATGGAAACAAACATGAATAAGCCCTATAGAAACCGCCAAAC
TCTATGGAAAAAGTTCCGCT

Product: iron-regulated outer membrane protein

Products: NA

Alternate protein names: Brucella heme uptake protein A [H]

Number of amino acids: Translated: 863; Mature: 863

Protein sequence:

>863_residues
MLRNKFRIVFVSCIVASSLQAQETTHTLGKVTTKGERTFEYNNKMYIERKELQQRQSNQIRDIFRTRADVNVASGGLMAQ
KIYVRGIESRLLRVTIDGVAQNGNIFHHDANTVIDPNMIKEVEVIKGAANASAGPGAVAGKLSFTTIDANDFLRKNQTYG
AKAEAGFYTNFGYRMNATAAYRGKNWDILAYYNHQNIFYYRDGNNAFRNLFHPNYDLQDPSNSDIGVGTPSEINSVLGKV
NGYINDTDTISLSYNMTRENSTRLLRPNTTSALSKANDPGSQPAPFVIDFGKELAHTINFNHNLSLKYKHDGGTSFSQPR
VESTAFLGVRGGDYNPVVNPFAYNSNEPANPDYIPEVKDWCNNPDNISQCTQGAIRPSDGGYQIGYGQPGSINWQGASAI
STGSNIYHGLVPKNPDYDMTPPNAQNPSANDWTLGNADAEGTLARRIFLINSGVNFKVTHPISEDYGNVFEYGMIYQNLS
VFSGLDKGKNGYYKNNIDPNDPNGPGLPYRHYYTDQSSQYPQNLNAPNPLYRNMPQNSHAIGNIIGGFMQANYNLLKNLI
VGAGTRYDIYTLLDKNGRTHVTSGFSPSATVLYNPIESIGLKVSYAYVTKGALPGDGVLMRDPTVIYQRNLRPAIGQNVE
FNVDYNSKYFNVRGAAFYQVINNFINSYGQDTSKNGGGNATAKNMSGNLPETINIYGYEVSGNVQYKNFVGTFSVARSWP
TARGHLLADTYALAATTGNVFILKADYNIHRWGLTLTWLSRFVTNMFYEGYSIYYPQYGLMRIHKPGYGVHNVFINWTPP
SKKWQGLRISAVFNNILNKQYVSQASVWQASADAPASDMIPKDKRMALPAPGFNARFEVSYQF

Sequences:

>Translated_863_residues
MLRNKFRIVFVSCIVASSLQAQETTHTLGKVTTKGERTFEYNNKMYIERKELQQRQSNQIRDIFRTRADVNVASGGLMAQ
KIYVRGIESRLLRVTIDGVAQNGNIFHHDANTVIDPNMIKEVEVIKGAANASAGPGAVAGKLSFTTIDANDFLRKNQTYG
AKAEAGFYTNFGYRMNATAAYRGKNWDILAYYNHQNIFYYRDGNNAFRNLFHPNYDLQDPSNSDIGVGTPSEINSVLGKV
NGYINDTDTISLSYNMTRENSTRLLRPNTTSALSKANDPGSQPAPFVIDFGKELAHTINFNHNLSLKYKHDGGTSFSQPR
VESTAFLGVRGGDYNPVVNPFAYNSNEPANPDYIPEVKDWCNNPDNISQCTQGAIRPSDGGYQIGYGQPGSINWQGASAI
STGSNIYHGLVPKNPDYDMTPPNAQNPSANDWTLGNADAEGTLARRIFLINSGVNFKVTHPISEDYGNVFEYGMIYQNLS
VFSGLDKGKNGYYKNNIDPNDPNGPGLPYRHYYTDQSSQYPQNLNAPNPLYRNMPQNSHAIGNIIGGFMQANYNLLKNLI
VGAGTRYDIYTLLDKNGRTHVTSGFSPSATVLYNPIESIGLKVSYAYVTKGALPGDGVLMRDPTVIYQRNLRPAIGQNVE
FNVDYNSKYFNVRGAAFYQVINNFINSYGQDTSKNGGGNATAKNMSGNLPETINIYGYEVSGNVQYKNFVGTFSVARSWP
TARGHLLADTYALAATTGNVFILKADYNIHRWGLTLTWLSRFVTNMFYEGYSIYYPQYGLMRIHKPGYGVHNVFINWTPP
SKKWQGLRISAVFNNILNKQYVSQASVWQASADAPASDMIPKDKRMALPAPGFNARFEVSYQF
>Mature_863_residues
MLRNKFRIVFVSCIVASSLQAQETTHTLGKVTTKGERTFEYNNKMYIERKELQQRQSNQIRDIFRTRADVNVASGGLMAQ
KIYVRGIESRLLRVTIDGVAQNGNIFHHDANTVIDPNMIKEVEVIKGAANASAGPGAVAGKLSFTTIDANDFLRKNQTYG
AKAEAGFYTNFGYRMNATAAYRGKNWDILAYYNHQNIFYYRDGNNAFRNLFHPNYDLQDPSNSDIGVGTPSEINSVLGKV
NGYINDTDTISLSYNMTRENSTRLLRPNTTSALSKANDPGSQPAPFVIDFGKELAHTINFNHNLSLKYKHDGGTSFSQPR
VESTAFLGVRGGDYNPVVNPFAYNSNEPANPDYIPEVKDWCNNPDNISQCTQGAIRPSDGGYQIGYGQPGSINWQGASAI
STGSNIYHGLVPKNPDYDMTPPNAQNPSANDWTLGNADAEGTLARRIFLINSGVNFKVTHPISEDYGNVFEYGMIYQNLS
VFSGLDKGKNGYYKNNIDPNDPNGPGLPYRHYYTDQSSQYPQNLNAPNPLYRNMPQNSHAIGNIIGGFMQANYNLLKNLI
VGAGTRYDIYTLLDKNGRTHVTSGFSPSATVLYNPIESIGLKVSYAYVTKGALPGDGVLMRDPTVIYQRNLRPAIGQNVE
FNVDYNSKYFNVRGAAFYQVINNFINSYGQDTSKNGGGNATAKNMSGNLPETINIYGYEVSGNVQYKNFVGTFSVARSWP
TARGHLLADTYALAATTGNVFILKADYNIHRWGLTLTWLSRFVTNMFYEGYSIYYPQYGLMRIHKPGYGVHNVFINWTPP
SKKWQGLRISAVFNNILNKQYVSQASVWQASADAPASDMIPKDKRMALPAPGFNARFEVSYQF

Specific function: Heme transporter playing an important role in stationary-phase iron acquisition and required for maintenance of chronic infection in mice [H]

COG id: COG1629

COG function: function code P; Outer membrane receptor proteins, mostly Fe transport

Gene ontology:

Cell location: Cell outer membrane [H]

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the tonB-dependent receptor family [H]

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR012910
- InterPro:   IPR000531 [H]

Pfam domain/function: PF07715 Plug; PF00593 TonB_dep_Rec [H]

EC number: NA

Molecular weight: Translated: 95976; Mature: 95976

Theoretical pI: Translated: 9.29; Mature: 9.29

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.3 %Cys     (Translated Protein)
1.9 %Met     (Translated Protein)
2.2 %Cys+Met (Translated Protein)
0.3 %Cys     (Mature Protein)
1.9 %Met     (Mature Protein)
2.2 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MLRNKFRIVFVSCIVASSLQAQETTHTLGKVTTKGERTFEYNNKMYIERKELQQRQSNQI
CCCCCEEEEEEEEHHHHCCHHHHHHHHHHCEECCCCEEEEECCEEEEEHHHHHHHHHHHH
RDIFRTRADVNVASGGLMAQKIYVRGIESRLLRVTIDGVAQNGNIFHHDANTVIDPNMIK
HHHHHHHCCCEECCCCCEEHHHHHCCCCCEEEEEEEEEEECCCCEEEECCCCEECCHHHH
EVEVIKGAANASAGPGAVAGKLSFTTIDANDFLRKNQTYGAKAEAGFYTNFGYRMNATAA
HHHHHHCCCCCCCCCCCEEEEEEEEEECHHHHHHCCCCCCCCCCCCEEECCCEEECCEEE
YRGKNWDILAYYNHQNIFYYRDGNNAFRNLFHPNYDLQDPSNSDIGVGTPSEINSVLGKV
ECCCCCEEEEEECCCEEEEEECCCHHHHHHCCCCCCCCCCCCCCCCCCCHHHHHHHHHHH
NGYINDTDTISLSYNMTRENSTRLLRPNTTSALSKANDPGSQPAPFVIDFGKELAHTINF
CCEECCCEEEEEEEEECCCCCCEEECCCCHHHHHCCCCCCCCCCCEEEECCHHHHHHCCC
NHNLSLKYKHDGGTSFSQPRVESTAFLGVRGGDYNPVVNPFAYNSNEPANPDYIPEVKDW
CCCEEEEEECCCCCCCCCCCCCCEEEEEEECCCCCCCCCCEECCCCCCCCCCCCCCHHHH
CNNPDNISQCTQGAIRPSDGGYQIGYGQPGSINWQGASAISTGSNIYHGLVPKNPDYDMT
CCCCCCHHHHHCCCCCCCCCCEEECCCCCCCCCCCCCCEECCCCCEEECCCCCCCCCCCC
PPNAQNPSANDWTLGNADAEGTLARRIFLINSGVNFKVTHPISEDYGNVFEYGMIYQNLS
CCCCCCCCCCCCCCCCCCCCCEEEEEEEEEECCCCEEEECCCHHHHHHHHHHHHHHHHHH
VFSGLDKGKNGYYKNNIDPNDPNGPGLPYRHYYTDQSSQYPQNLNAPNPLYRNMPQNSHA
HHHCCCCCCCCCCCCCCCCCCCCCCCCCCEEEECCCCCCCCCCCCCCCHHHHCCCCCCCH
IGNIIGGFMQANYNLLKNLIVGAGTRYDIYTLLDKNGRTHVTSGFSPSATVLYNPIESIG
HHHHHHHHHHHHHHHHHHHHHCCCCCEEEEEEEECCCCEEEECCCCCCCEEEECCHHHHC
LKVSYAYVTKGALPGDGVLMRDPTVIYQRNLRPAIGQNVEFNVDYNSKYFNVRGAAFYQV
EEEEEEEEECCCCCCCCEEEECCEEEEECCCCHHHCCCEEEEEECCCEEEEECHHHHHHH
INNFINSYGQDTSKNGGGNATAKNMSGNLPETINIYGYEVSGNVQYKNFVGTFSVARSWP
HHHHHHHHCCCCCCCCCCCCEECCCCCCCCCEEEEEEEEEECCEEEEEEEEEHHHHHCCC
TARGHLLADTYALAATTGNVFILKADYNIHRWGLTLTWLSRFVTNMFYEGYSIYYPQYGL
CCCCCEEEEEEEEEEECCCEEEEEECCCEEEECCHHHHHHHHHHHHHHCCEEEEECCCCE
MRIHKPGYGVHNVFINWTPPSKKWQGLRISAVFNNILNKQYVSQASVWQASADAPASDMI
EEEECCCCCEEEEEEEECCCCCCCCCEEHHHHHHHHHHHHHHHHHHHEECCCCCCHHHCC
PKDKRMALPAPGFNARFEVSYQF
CCCCCEECCCCCCCCEEEEEECC
>Mature Secondary Structure
MLRNKFRIVFVSCIVASSLQAQETTHTLGKVTTKGERTFEYNNKMYIERKELQQRQSNQI
CCCCCEEEEEEEEHHHHCCHHHHHHHHHHCEECCCCEEEEECCEEEEEHHHHHHHHHHHH
RDIFRTRADVNVASGGLMAQKIYVRGIESRLLRVTIDGVAQNGNIFHHDANTVIDPNMIK
HHHHHHHCCCEECCCCCEEHHHHHCCCCCEEEEEEEEEEECCCCEEEECCCCEECCHHHH
EVEVIKGAANASAGPGAVAGKLSFTTIDANDFLRKNQTYGAKAEAGFYTNFGYRMNATAA
HHHHHHCCCCCCCCCCCEEEEEEEEEECHHHHHHCCCCCCCCCCCCEEECCCEEECCEEE
YRGKNWDILAYYNHQNIFYYRDGNNAFRNLFHPNYDLQDPSNSDIGVGTPSEINSVLGKV
ECCCCCEEEEEECCCEEEEEECCCHHHHHHCCCCCCCCCCCCCCCCCCCHHHHHHHHHHH
NGYINDTDTISLSYNMTRENSTRLLRPNTTSALSKANDPGSQPAPFVIDFGKELAHTINF
CCEECCCEEEEEEEEECCCCCCEEECCCCHHHHHCCCCCCCCCCCEEEECCHHHHHHCCC
NHNLSLKYKHDGGTSFSQPRVESTAFLGVRGGDYNPVVNPFAYNSNEPANPDYIPEVKDW
CCCEEEEEECCCCCCCCCCCCCCEEEEEEECCCCCCCCCCEECCCCCCCCCCCCCCHHHH
CNNPDNISQCTQGAIRPSDGGYQIGYGQPGSINWQGASAISTGSNIYHGLVPKNPDYDMT
CCCCCCHHHHHCCCCCCCCCCEEECCCCCCCCCCCCCCEECCCCCEEECCCCCCCCCCCC
PPNAQNPSANDWTLGNADAEGTLARRIFLINSGVNFKVTHPISEDYGNVFEYGMIYQNLS
CCCCCCCCCCCCCCCCCCCCCEEEEEEEEEECCCCEEEECCCHHHHHHHHHHHHHHHHHH
VFSGLDKGKNGYYKNNIDPNDPNGPGLPYRHYYTDQSSQYPQNLNAPNPLYRNMPQNSHA
HHHCCCCCCCCCCCCCCCCCCCCCCCCCCEEEECCCCCCCCCCCCCCCHHHHCCCCCCCH
IGNIIGGFMQANYNLLKNLIVGAGTRYDIYTLLDKNGRTHVTSGFSPSATVLYNPIESIG
HHHHHHHHHHHHHHHHHHHHHCCCCCEEEEEEEECCCCEEEECCCCCCCEEEECCHHHHC
LKVSYAYVTKGALPGDGVLMRDPTVIYQRNLRPAIGQNVEFNVDYNSKYFNVRGAAFYQV
EEEEEEEEECCCCCCCCEEEECCEEEEECCCCHHHCCCEEEEEECCCEEEEECHHHHHHH
INNFINSYGQDTSKNGGGNATAKNMSGNLPETINIYGYEVSGNVQYKNFVGTFSVARSWP
HHHHHHHHCCCCCCCCCCCCEECCCCCCCCCEEEEEEEEEECCEEEEEEEEEHHHHHCCC
TARGHLLADTYALAATTGNVFILKADYNIHRWGLTLTWLSRFVTNMFYEGYSIYYPQYGL
CCCCCEEEEEEEEEEECCCEEEEEECCCEEEECCHHHHHHHHHHHHHHCCEEEEECCCCE
MRIHKPGYGVHNVFINWTPPSKKWQGLRISAVFNNILNKQYVSQASVWQASADAPASDMI
EEEECCCCCEEEEEEEECCCCCCCCCEEHHHHHHHHHHHHHHHHHHHEECCCCCCHHHCC
PKDKRMALPAPGFNARFEVSYQF
CCCCCEECCCCCCCCEEEEEECC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: NA