Definition Pseudomonas syringae pv. syringae B728a, complete genome.
Accession NC_007005
Length 6,093,698

Click here to switch to the map view.

The map label for this gene is hpuB [H]

Identifier: 66044356

GI number: 66044356

Start: 1250431

End: 1253010

Strand: Reverse

Name: hpuB [H]

Synonym: Psyr_1105

Alternate gene names: 66044356

Gene position: 1253010-1250431 (Counterclockwise)

Preceding gene: 66044357

Following gene: 66044355

Centisome position: 20.56

GC content: 61.98

Gene sequence:

>2580_bases
ATGTCATCCACGTTCACGCCTGTCGCCCGACAACGCGCAAGGCTTACGCTTTCTCTGCTGACGATTGCGGTACTGGGCGC
CAGTCTGCAGCTGACAAACGCCAGTGCTGCCAGTGAAAGTACTCATGCGACCCGCCCGGCGGCCACCTACCCCTTCTCGA
TCAGTCAGCAACCCCTGGTATCGGCGCTGAACGAGTTCAGCCGCGTGACCGGCTGGCAGGTAGGCATGTCGGCGGGCCTG
GCCCAAAACGTCATCTCCCCTGGGGCCAGCGGGGAACTGAGCGCTGCCCAGGCGCTGGACAGCATGCTTTCCGGAAGCTT
GCTGAGCTACCGCAATCTGGGCAACAACAGCGTCGTGCTGGAAAAACGCGCCCCCACCGCTGGCGTCATGGCGCTGGATC
AGATCACTGTCAGCGCCACACGCCAGGCCCAGGATGTCGCCACGGTGCCGAGCACTGTCAGCGTACATTCCCGTGAGGAA
CTGGACCGCGACAACGTCAACACGCTCCGCGACCTGGTGCGTTACGAGCCGGGGGTCTCGGTGGGTGGCGCAGGCCAGCG
TGCGGGCACGACCGGCTATAACATTCGCGGCATCGACGGCAACCGGATCCTGACCCAGGTCGACGGCGTCGAGGTGCCCG
ACAGCTTTTTCACCGGCCCTTATGCGCAAACTCACCGCAACTATGTCGACCCGGAGATCGTCAAGCGCGTGGAAATCCTC
CGCGGTCCCGCTTCGGCCCTCTACGGCAGCAGCGCCATTGGTGGTGTGGTCAGCTATTACACACTGGACCCGGACGACAT
CATCAAGCCCGGCAGGAATGTCGGCGCGCGGCTGAAAACCGGCTACAGCTCGGCAGACGAAAGCTGGCTCAACTCGGCCA
CCGTCGCAGGCCGTCAGGGCGAGTTCGACGGCTTGCTGCACCTCAGCCAGCGCAATGGCCATGAAACCGAATCCTATGGC
AGCACCGGCGGTAGCGGATTGAGCCGCACGCAAGCCAACCCTGAGGATGCGCGCAGTACCAATGTGCTGGGCAAACTGGG
CTGGAATTACGGCGACGGTTCGCGTCTGGCGCTGGCCTATGAAAAGTACAAGGACGACCGCGACAGCAATCTGAAAAGCG
CAGTCGGCGGTCCATTCACCAACGGCACCGGCCTGGGGATGTATCAGTCGCGCGAGGGTAACGACACCATCACCCGCGAA
CGCTTTGGGATCGAAAACAGCTTCGCCCTCGACAGCCTGCTGGTCGACAACGTCAAGTGGAGCTTGAACTATCAGATCGC
GAAAACCGATCAGAGCACCCGGGAACGTTACTTTCCGTTCTCCCGCGATGTCATTCGTGAACGCGACACGCAGTATCAGG
AAAAGCAGTGGGTGTTCGATGCCCAGCTGGACAAGGCATTCTCCGTTGCCAGCACCGACCACGTGCTGACCTACGGGACA
ACGATCAAGCGCCAGAAAGTGACCGGATTGCGCAGCGGCAGCGGCACTTGTGCGCGAGTCTTCGGCTCCTGCCGCGCTGT
CGGTGCAGACAGCCCGAGCGACCGGCTGGCCGCAACGAGTGATTTCCCCGACCCGACCATCACCAGCTACGCGCTGTTCG
CGCAGGATCAGATCAGCTGGAATGACTGGACCTTCCTGCCTGGCGTGCGTTACGACCACACCCGGCTTGATCCGACATTC
ACCTCGCAATTCCTCAGGTCGGTCAGCCTGACCGACCCAGACCAGGCGAACGATGAAACGCGAACCTGGCATCGCCTGTC
GCCCAAGCTGGGCGTGACTTACGCACTCAGCGATGCCTACACGTGGTACGGCCAGTATGCCGAGGGCTTCCGCACGCCTT
CGGCCAAGTCACTTTACGGACGCTTCGAAAACCCGACGGCCGGGTACGTGGTCGAGCCCAATCCGAACCTGAAGCCCGAA
ACGAGCAAAAGTTACGAAACCGGGCTGCGCGGTCGCTTCGAATCCGGCTCGTTCGACATCGCGGTGTTCTACAACAAGTA
CCGCGACTTCATCAACGAGGACGCCATCACACCCGGCTACAGCGAACTCACCTTCCAGTCCAACAACATACGCCACGCCA
CCCTCAAAGGCGCCGAACTCAAAGGCCGTCTGAACCTCGACAGCCTGGGTGCGCCGAACGGCCTCTACAGCCAGGCCTCC
GTCGCCTATCTGCACGGCCGCAACGACGACACGGGCGAGCCGCTCAACAGCGTCAACCCGCTGACCGGTGTCATGGGGCT
CGGTTATGACCGCGATCACTACGGAGGTCTGTTGAGCTGGACCCTGGTCAAGCGCAAGAACCGCGTGGATGACAGCAACT
TCCACACGCCGGATGGCACCTCCAGCCAGTTCAGGACACCGGGCTTCGGCATTCTGGACCTGACCGGCTACTACAAGGTC
AGTGATGACGTGACCGTCAACGCAGGCCTGTACAACCTGACCGATAAAAAATACTGGCGCTGGGACGATGTGCGCGGCTA
CGACGGCGTGGGAGAAGCCGGCGTAACCGCACCCGCCAACCTCGATCGCCTGACCCAGCCGGGACGCAATTTCAGCGTCA
ACGTGGTGTGGGACATCTGA

Upstream 100 bases:

>100_bases
AGCGACTGGCCGTTCGTCTAGTCATAGCCAATGCAACTGATTCTCATTGTGAAACAGCTTGTAAACACTATGACGAGCAA
CACCCCAGGGAGCGCTACCG

Downstream 100 bases:

>100_bases
GCCCGAACGTCTCTGAAAGCCCGCCGCTGGATGATCGAGCGGCAGGCTTTTTTTTACGCTTTCGGGCCTGACTGTTCGTC
TATTCAACAAGCCCTTTTTC

Product: TonB-dependent haemoglobin/transferrin/lactoferrin receptor:TonB-dependent haem/haemoglobin receptor

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 859; Mature: 858

Protein sequence:

>859_residues
MSSTFTPVARQRARLTLSLLTIAVLGASLQLTNASAASESTHATRPAATYPFSISQQPLVSALNEFSRVTGWQVGMSAGL
AQNVISPGASGELSAAQALDSMLSGSLLSYRNLGNNSVVLEKRAPTAGVMALDQITVSATRQAQDVATVPSTVSVHSREE
LDRDNVNTLRDLVRYEPGVSVGGAGQRAGTTGYNIRGIDGNRILTQVDGVEVPDSFFTGPYAQTHRNYVDPEIVKRVEIL
RGPASALYGSSAIGGVVSYYTLDPDDIIKPGRNVGARLKTGYSSADESWLNSATVAGRQGEFDGLLHLSQRNGHETESYG
STGGSGLSRTQANPEDARSTNVLGKLGWNYGDGSRLALAYEKYKDDRDSNLKSAVGGPFTNGTGLGMYQSREGNDTITRE
RFGIENSFALDSLLVDNVKWSLNYQIAKTDQSTRERYFPFSRDVIRERDTQYQEKQWVFDAQLDKAFSVASTDHVLTYGT
TIKRQKVTGLRSGSGTCARVFGSCRAVGADSPSDRLAATSDFPDPTITSYALFAQDQISWNDWTFLPGVRYDHTRLDPTF
TSQFLRSVSLTDPDQANDETRTWHRLSPKLGVTYALSDAYTWYGQYAEGFRTPSAKSLYGRFENPTAGYVVEPNPNLKPE
TSKSYETGLRGRFESGSFDIAVFYNKYRDFINEDAITPGYSELTFQSNNIRHATLKGAELKGRLNLDSLGAPNGLYSQAS
VAYLHGRNDDTGEPLNSVNPLTGVMGLGYDRDHYGGLLSWTLVKRKNRVDDSNFHTPDGTSSQFRTPGFGILDLTGYYKV
SDDVTVNAGLYNLTDKKYWRWDDVRGYDGVGEAGVTAPANLDRLTQPGRNFSVNVVWDI

Sequences:

>Translated_859_residues
MSSTFTPVARQRARLTLSLLTIAVLGASLQLTNASAASESTHATRPAATYPFSISQQPLVSALNEFSRVTGWQVGMSAGL
AQNVISPGASGELSAAQALDSMLSGSLLSYRNLGNNSVVLEKRAPTAGVMALDQITVSATRQAQDVATVPSTVSVHSREE
LDRDNVNTLRDLVRYEPGVSVGGAGQRAGTTGYNIRGIDGNRILTQVDGVEVPDSFFTGPYAQTHRNYVDPEIVKRVEIL
RGPASALYGSSAIGGVVSYYTLDPDDIIKPGRNVGARLKTGYSSADESWLNSATVAGRQGEFDGLLHLSQRNGHETESYG
STGGSGLSRTQANPEDARSTNVLGKLGWNYGDGSRLALAYEKYKDDRDSNLKSAVGGPFTNGTGLGMYQSREGNDTITRE
RFGIENSFALDSLLVDNVKWSLNYQIAKTDQSTRERYFPFSRDVIRERDTQYQEKQWVFDAQLDKAFSVASTDHVLTYGT
TIKRQKVTGLRSGSGTCARVFGSCRAVGADSPSDRLAATSDFPDPTITSYALFAQDQISWNDWTFLPGVRYDHTRLDPTF
TSQFLRSVSLTDPDQANDETRTWHRLSPKLGVTYALSDAYTWYGQYAEGFRTPSAKSLYGRFENPTAGYVVEPNPNLKPE
TSKSYETGLRGRFESGSFDIAVFYNKYRDFINEDAITPGYSELTFQSNNIRHATLKGAELKGRLNLDSLGAPNGLYSQAS
VAYLHGRNDDTGEPLNSVNPLTGVMGLGYDRDHYGGLLSWTLVKRKNRVDDSNFHTPDGTSSQFRTPGFGILDLTGYYKV
SDDVTVNAGLYNLTDKKYWRWDDVRGYDGVGEAGVTAPANLDRLTQPGRNFSVNVVWDI
>Mature_858_residues
SSTFTPVARQRARLTLSLLTIAVLGASLQLTNASAASESTHATRPAATYPFSISQQPLVSALNEFSRVTGWQVGMSAGLA
QNVISPGASGELSAAQALDSMLSGSLLSYRNLGNNSVVLEKRAPTAGVMALDQITVSATRQAQDVATVPSTVSVHSREEL
DRDNVNTLRDLVRYEPGVSVGGAGQRAGTTGYNIRGIDGNRILTQVDGVEVPDSFFTGPYAQTHRNYVDPEIVKRVEILR
GPASALYGSSAIGGVVSYYTLDPDDIIKPGRNVGARLKTGYSSADESWLNSATVAGRQGEFDGLLHLSQRNGHETESYGS
TGGSGLSRTQANPEDARSTNVLGKLGWNYGDGSRLALAYEKYKDDRDSNLKSAVGGPFTNGTGLGMYQSREGNDTITRER
FGIENSFALDSLLVDNVKWSLNYQIAKTDQSTRERYFPFSRDVIRERDTQYQEKQWVFDAQLDKAFSVASTDHVLTYGTT
IKRQKVTGLRSGSGTCARVFGSCRAVGADSPSDRLAATSDFPDPTITSYALFAQDQISWNDWTFLPGVRYDHTRLDPTFT
SQFLRSVSLTDPDQANDETRTWHRLSPKLGVTYALSDAYTWYGQYAEGFRTPSAKSLYGRFENPTAGYVVEPNPNLKPET
SKSYETGLRGRFESGSFDIAVFYNKYRDFINEDAITPGYSELTFQSNNIRHATLKGAELKGRLNLDSLGAPNGLYSQASV
AYLHGRNDDTGEPLNSVNPLTGVMGLGYDRDHYGGLLSWTLVKRKNRVDDSNFHTPDGTSSQFRTPGFGILDLTGYYKVS
DDVTVNAGLYNLTDKKYWRWDDVRGYDGVGEAGVTAPANLDRLTQPGRNFSVNVVWDI

Specific function: Acts as a receptor for hemoglobin or the hemoglobin/haptoglobin complex and is required for heme uptake [H]

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cell outer membrane; Peripheral membrane protein (Potential) [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the tonB-dependent receptor family [H]

Homologues:

Organism=Escherichia coli, GI1788478, Length=137, Percent_Identity=33.5766423357664, Blast_Score=80, Evalue=4e-16,
Organism=Escherichia coli, GI1790405, Length=223, Percent_Identity=28.2511210762332, Blast_Score=77, Evalue=4e-15,
Organism=Escherichia coli, GI1790743, Length=218, Percent_Identity=27.0642201834862, Blast_Score=72, Evalue=2e-13,
Organism=Escherichia coli, GI1786344, Length=563, Percent_Identity=23.4458259325044, Blast_Score=68, Evalue=2e-12,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR012910
- InterPro:   IPR000531
- InterPro:   IPR010949
- InterPro:   IPR010917 [H]

Pfam domain/function: PF07715 Plug; PF00593 TonB_dep_Rec [H]

EC number: NA

Molecular weight: Translated: 93914; Mature: 93782

Theoretical pI: Translated: 6.14; Mature: 6.14

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.2 %Cys     (Translated Protein)
0.7 %Met     (Translated Protein)
0.9 %Cys+Met (Translated Protein)
0.2 %Cys     (Mature Protein)
0.6 %Met     (Mature Protein)
0.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSSTFTPVARQRARLTLSLLTIAVLGASLQLTNASAASESTHATRPAATYPFSISQQPLV
CCCCCCHHHHHHHHHHHHHHHHHHHCCCEEEECCCCCCCCCCCCCCCCCCCCCCCCCHHH
SALNEFSRVTGWQVGMSAGLAQNVISPGASGELSAAQALDSMLSGSLLSYRNLGNNSVVL
HHHHHHHHHCCHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHCCCHHHHHCCCCCCEEE
EKRAPTAGVMALDQITVSATRQAQDVATVPSTVSVHSREELDRDNVNTLRDLVRYEPGVS
EECCCCCCEEEEHHHHHHHHHHHHHHHCCCCEEEECCHHHCCCCCHHHHHHHHHCCCCCC
VGGAGQRAGTTGYNIRGIDGNRILTQVDGVEVPDSFFTGPYAQTHRNYVDPEIVKRVEIL
CCCCCCCCCCCCCEEEECCCCEEEEEECCCCCCHHHCCCCCHHHHCCCCCHHHHHHHHHH
RGPASALYGSSAIGGVVSYYTLDPDDIIKPGRNVGARLKTGYSSADESWLNSATVAGRQG
CCCHHHHHCCHHHCCEEEEEEECHHHHHCCCCCCCCEEECCCCCCHHHHHHHHHCCCCCC
EFDGLLHLSQRNGHETESYGSTGGSGLSRTQANPEDARSTNVLGKLGWNYGDGSRLALAY
CCCCEEEEECCCCCCCHHCCCCCCCCCCCCCCCCHHHHHHCHHHHCCCCCCCCCEEEEEE
EKYKDDRDSNLKSAVGGPFTNGTGLGMYQSREGNDTITRERFGIENSFALDSLLVDNVKW
HHHCCCCCCCHHHHCCCCCCCCCCCCEEECCCCCCCHHHHHCCCCCCHHHHHHHHCCEEE
SLNYQIAKTDQSTRERYFPFSRDVIRERDTQYQEKQWVFDAQLDKAFSVASTDHVLTYGT
EEEEEEECCCCHHHHHCCCCHHHHHHHHCCHHHHHHEEEHHHHHHHHEECCCCEEEEECC
TIKRQKVTGLRSGSGTCARVFGSCRAVGADSPSDRLAATSDFPDPTITSYALFAQDQISW
EEEHHHHCCCCCCCCHHHHHHHHHHCCCCCCCCCCEEECCCCCCCCHHEEEEEECCCCCC
NDWTFLPGVRYDHTRLDPTFTSQFLRSVSLTDPDQANDETRTWHRLSPKLGVTYALSDAY
CCEEECCCCCCCCCCCCHHHHHHHHHHCCCCCCCCCCCCHHHHHHCCCCCCEEEEECCHH
TWYGQYAEGFRTPSAKSLYGRFENPTAGYVVEPNPNLKPETSKSYETGLRGRFESGSFDI
HHHHHHHHHCCCCCHHHHHCCCCCCCCCEEECCCCCCCCCCCCCHHHCCCCCCCCCCEEE
AVFYNKYRDFINEDAITPGYSELTFQSNNIRHATLKGAELKGRLNLDSLGAPNGLYSQAS
EEEEHHHHHHHHHCCCCCCCHHEEEECCCEEEEEECCCEEECCCCCCCCCCCCCCCCCCE
VAYLHGRNDDTGEPLNSVNPLTGVMGLGYDRDHYGGLLSWTLVKRKNRVDDSNFHTPDGT
EEEEECCCCCCCCCCCCCCCHHHHHCCCCCCHHCCCEEEEEEEHHHCCCCCCCCCCCCCC
SSQFRTPGFGILDLTGYYKVSDDVTVNAGLYNLTDKKYWRWDDVRGYDGVGEAGVTAPAN
CCCCCCCCCEEEEECEEEEECCCEEEECCEEECCCCCEEECCCCCCCCCCCCCCCCCCCC
LDRLTQPGRNFSVNVVWDI
HHHHCCCCCCEEEEEEEEC
>Mature Secondary Structure 
SSTFTPVARQRARLTLSLLTIAVLGASLQLTNASAASESTHATRPAATYPFSISQQPLV
CCCCCHHHHHHHHHHHHHHHHHHHCCCEEEECCCCCCCCCCCCCCCCCCCCCCCCCHHH
SALNEFSRVTGWQVGMSAGLAQNVISPGASGELSAAQALDSMLSGSLLSYRNLGNNSVVL
HHHHHHHHHCCHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHCCCHHHHHCCCCCCEEE
EKRAPTAGVMALDQITVSATRQAQDVATVPSTVSVHSREELDRDNVNTLRDLVRYEPGVS
EECCCCCCEEEEHHHHHHHHHHHHHHHCCCCEEEECCHHHCCCCCHHHHHHHHHCCCCCC
VGGAGQRAGTTGYNIRGIDGNRILTQVDGVEVPDSFFTGPYAQTHRNYVDPEIVKRVEIL
CCCCCCCCCCCCCEEEECCCCEEEEEECCCCCCHHHCCCCCHHHHCCCCCHHHHHHHHHH
RGPASALYGSSAIGGVVSYYTLDPDDIIKPGRNVGARLKTGYSSADESWLNSATVAGRQG
CCCHHHHHCCHHHCCEEEEEEECHHHHHCCCCCCCCEEECCCCCCHHHHHHHHHCCCCCC
EFDGLLHLSQRNGHETESYGSTGGSGLSRTQANPEDARSTNVLGKLGWNYGDGSRLALAY
CCCCEEEEECCCCCCCHHCCCCCCCCCCCCCCCCHHHHHHCHHHHCCCCCCCCCEEEEEE
EKYKDDRDSNLKSAVGGPFTNGTGLGMYQSREGNDTITRERFGIENSFALDSLLVDNVKW
HHHCCCCCCCHHHHCCCCCCCCCCCCEEECCCCCCCHHHHHCCCCCCHHHHHHHHCCEEE
SLNYQIAKTDQSTRERYFPFSRDVIRERDTQYQEKQWVFDAQLDKAFSVASTDHVLTYGT
EEEEEEECCCCHHHHHCCCCHHHHHHHHCCHHHHHHEEEHHHHHHHHEECCCCEEEEECC
TIKRQKVTGLRSGSGTCARVFGSCRAVGADSPSDRLAATSDFPDPTITSYALFAQDQISW
EEEHHHHCCCCCCCCHHHHHHHHHHCCCCCCCCCCEEECCCCCCCCHHEEEEEECCCCCC
NDWTFLPGVRYDHTRLDPTFTSQFLRSVSLTDPDQANDETRTWHRLSPKLGVTYALSDAY
CCEEECCCCCCCCCCCCHHHHHHHHHHCCCCCCCCCCCCHHHHHHCCCCCCEEEEECCHH
TWYGQYAEGFRTPSAKSLYGRFENPTAGYVVEPNPNLKPETSKSYETGLRGRFESGSFDI
HHHHHHHHHCCCCCHHHHHCCCCCCCCCEEECCCCCCCCCCCCCHHHCCCCCCCCCCEEE
AVFYNKYRDFINEDAITPGYSELTFQSNNIRHATLKGAELKGRLNLDSLGAPNGLYSQAS
EEEEHHHHHHHHHCCCCCCCHHEEEECCCEEEEEECCCEEECCCCCCCCCCCCCCCCCCE
VAYLHGRNDDTGEPLNSVNPLTGVMGLGYDRDHYGGLLSWTLVKRKNRVDDSNFHTPDGT
EEEEECCCCCCCCCCCCCCCHHHHHCCCCCCHHCCCEEEEEEEHHHCCCCCCCCCCCCCC
SSQFRTPGFGILDLTGYYKVSDDVTVNAGLYNLTDKKYWRWDDVRGYDGVGEAGVTAPAN
CCCCCCCCCEEEEECEEEEECCCEEEECCEEECCCCCEEECCCCCCCCCCCCCCCCCCCC
LDRLTQPGRNFSVNVVWDI
HHHHCCCCCCEEEEEEEEC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 10761919 [H]