Definition Haemophilus influenzae Rd KW20 chromosome, complete genome.
Accession NC_000907
Length 1,830,138

Click here to switch to the map view.

The map label for this gene is 16273315

Identifier: 16273315

GI number: 16273315

Start: 1502127

End: 1503470

Strand: Reverse

Name: 16273315

Synonym: HI1407

Alternate gene names: NA

Gene position: 1503470-1502127 (Counterclockwise)

Preceding gene: 16273316

Following gene: 16273314

Centisome position: 82.15

GC content: 38.47

Gene sequence:

>1344_bases
ATGCTAATGAACTTGCCAGAAATTTTGAAGAACCAGAAGGCGAGAGCACGCAAGTTCAAGCCAGTGAAGATGAGTAAGAG
AACGGAGCTTTGGTATAGACAACAGCTTAAGCAGTTCGTCAAAATGATGACCAATGATGTAGAAAGAGCCCTGCAACAAC
CGCAAGGCTCTTTTTTTATGGATGATGCAAAAGGATTTCAAGCGATTAGTGCGAAAGCACTGATGAAAGTATTAGAAAAG
TACGAAAAATCAGACCGCACTTCACAGGCCGAAAATATCGCCAATGGCTTTGTTAGTCGTGGTGATGCGCAAAACCATGC
TGAAGTATCAACCAATCTAAAAAATCAAACTGGCATCGATTTATCCGCCTATTTACGCAATAGTCCAAATATTACTGAGA
AAGTGAATGCATTGACCGCTGGTAATATCCAGTTAATTAAGTCTATTCGCTCACAATATCTTGATAAAGTGCAAAATGCC
GTCATGCAAGCAATGGTTCGAGGTTCTTTAAATAAAGACCTTGCAGCACAAATAAAAGACTTGGGTAAAACAACCGAAAA
ACGAGCAATGTTTATTGCGCGAGACCAGTCCTCAAAATTAAATGCCGCCTTAACGCAAGCGAGACATGAAGAGGTTGGCA
TAAAAAAATATATGTGGTCAGCATCGCTTGATGAGCGTGTACGCGAAAGCCATGCGGAAAAAGATGGGCAGATATTTGAA
TATGCCAATCCGCCTGCTGATACTGATCATCCTGGTCATGATTTTAATTGTCGGTGTGTTCAGATTCCAGTGCTTGATAA
TAACGAGCAGATAGTGAAAAATAGCCCAATAGTTAGCCAACAGGAAAAACAACAAATGCGCTCAGAATGGTCTGATGATT
TCCCTGATACTATCATTGATAGGAAATTAGGAGATGCAACATCACATCCGCTATATGAAAATGCTAAAAAGGGTAGTATT
GAAGATGCTTATCAACTTGCTAAAGATTTAGTTACAGATGATGCGGTAAATAAATTGAAGCAATTGGTTGGCAATAAAAA
TGCAATTCTAATTCCTGTTCATGCAGAAGAAGCCGTTGGTCAAAATATGATTCCTGTAGCTATTGCTACTGTATTATCTA
AAAAACTCCATATTCCTGTTGATTTATCAATTGTTCAAGCAACAAAAGTATCTAGAACTGGGGGAGATGGATGGCATCGA
TTGGTTTATTCTCCAGCTTTTGATGGCATAGTTCCAAAAGATAAATATGCTATTATTTTAGATGACACACAAACACAAGG
CGGTACATTGGCTAGTCTAAAAGGCTATATAATAAAGGAAAAGTTATTGCATCTTATGCTTTAA

Upstream 100 bases:

>100_bases
ATTCAAAATGGCGTAGTAAATGAATATCAAGTAGCAAACGAACTCCGAGAAAGTGGTTTATTTGCCAATATCTCTGCTGA
TGACATTGAGGAAATGAAAA

Downstream 100 bases:

>100_bases
CCGGCAAACAATATTCTGTACAATTAAGGCTATCTAAACACACATTAGCAGAATTACGGAGTAAATATGGCGAACTTGAA
AGTTGGTGGAAAAAAGAATT

Product: plasmid RP4 TraN-like protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 447; Mature: 447

Protein sequence:

>447_residues
MLMNLPEILKNQKARARKFKPVKMSKRTELWYRQQLKQFVKMMTNDVERALQQPQGSFFMDDAKGFQAISAKALMKVLEK
YEKSDRTSQAENIANGFVSRGDAQNHAEVSTNLKNQTGIDLSAYLRNSPNITEKVNALTAGNIQLIKSIRSQYLDKVQNA
VMQAMVRGSLNKDLAAQIKDLGKTTEKRAMFIARDQSSKLNAALTQARHEEVGIKKYMWSASLDERVRESHAEKDGQIFE
YANPPADTDHPGHDFNCRCVQIPVLDNNEQIVKNSPIVSQQEKQQMRSEWSDDFPDTIIDRKLGDATSHPLYENAKKGSI
EDAYQLAKDLVTDDAVNKLKQLVGNKNAILIPVHAEEAVGQNMIPVAIATVLSKKLHIPVDLSIVQATKVSRTGGDGWHR
LVYSPAFDGIVPKDKYAIILDDTQTQGGTLASLKGYIIKEKLLHLML

Sequences:

>Translated_447_residues
MLMNLPEILKNQKARARKFKPVKMSKRTELWYRQQLKQFVKMMTNDVERALQQPQGSFFMDDAKGFQAISAKALMKVLEK
YEKSDRTSQAENIANGFVSRGDAQNHAEVSTNLKNQTGIDLSAYLRNSPNITEKVNALTAGNIQLIKSIRSQYLDKVQNA
VMQAMVRGSLNKDLAAQIKDLGKTTEKRAMFIARDQSSKLNAALTQARHEEVGIKKYMWSASLDERVRESHAEKDGQIFE
YANPPADTDHPGHDFNCRCVQIPVLDNNEQIVKNSPIVSQQEKQQMRSEWSDDFPDTIIDRKLGDATSHPLYENAKKGSI
EDAYQLAKDLVTDDAVNKLKQLVGNKNAILIPVHAEEAVGQNMIPVAIATVLSKKLHIPVDLSIVQATKVSRTGGDGWHR
LVYSPAFDGIVPKDKYAIILDDTQTQGGTLASLKGYIIKEKLLHLML
>Mature_447_residues
MLMNLPEILKNQKARARKFKPVKMSKRTELWYRQQLKQFVKMMTNDVERALQQPQGSFFMDDAKGFQAISAKALMKVLEK
YEKSDRTSQAENIANGFVSRGDAQNHAEVSTNLKNQTGIDLSAYLRNSPNITEKVNALTAGNIQLIKSIRSQYLDKVQNA
VMQAMVRGSLNKDLAAQIKDLGKTTEKRAMFIARDQSSKLNAALTQARHEEVGIKKYMWSASLDERVRESHAEKDGQIFE
YANPPADTDHPGHDFNCRCVQIPVLDNNEQIVKNSPIVSQQEKQQMRSEWSDDFPDTIIDRKLGDATSHPLYENAKKGSI
EDAYQLAKDLVTDDAVNKLKQLVGNKNAILIPVHAEEAVGQNMIPVAIATVLSKKLHIPVDLSIVQATKVSRTGGDGWHR
LVYSPAFDGIVPKDKYAIILDDTQTQGGTLASLKGYIIKEKLLHLML

Specific function: Unknown

COG id: COG2369

COG function: function code S; Uncharacterized protein, homolog of phage Mu protein gp30

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: To E.coli plasmid IncP-alpha RP4 protein traN

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): Y1407_HAEIN (P71385)

Other databases:

- EMBL:   L42023
- PIR:   B64122
- RefSeq:   NP_439559.1
- GeneID:   950320
- GenomeReviews:   L42023_GR
- KEGG:   hin:HI1407
- NMPDR:   fig|71421.1.peg.1342
- TIGR:   HI_1407
- BioCyc:   HINF71421:HI_1407-MONOMER
- InterPro:   IPR006528
- TIGRFAMs:   TIGR01641

Pfam domain/function: PF04233 Phage_Mu_F

EC number: NA

Molecular weight: Translated: 50115; Mature: 50115

Theoretical pI: Translated: 9.61; Mature: 9.61

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.4 %Cys     (Translated Protein)
3.1 %Met     (Translated Protein)
3.6 %Cys+Met (Translated Protein)
0.4 %Cys     (Mature Protein)
3.1 %Met     (Mature Protein)
3.6 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MLMNLPEILKNQKARARKFKPVKMSKRTELWYRQQLKQFVKMMTNDVERALQQPQGSFFM
CCCCCHHHHHCCHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEE
DDAKGFQAISAKALMKVLEKYEKSDRTSQAENIANGFVSRGDAQNHAEVSTNLKNQTGID
CCCCCHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHCCCCCCCCHHHHHCCCCCCCCC
LSAYLRNSPNITEKVNALTAGNIQLIKSIRSQYLDKVQNAVMQAMVRGSLNKDLAAQIKD
HHHHHCCCCCHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHH
LGKTTEKRAMFIARDQSSKLNAALTQARHEEVGIKKYMWSASLDERVRESHAEKDGQIFE
HCCHHHHHEEEEECCCCCHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHCCCCCCEEE
YANPPADTDHPGHDFNCRCVQIPVLDNNEQIVKNSPIVSQQEKQQMRSEWSDDFPDTIID
CCCCCCCCCCCCCCCCCEEEEEEEECCCCHHHCCCCCCCHHHHHHHHHHCCCCCCHHHHH
RKLGDATSHPLYENAKKGSIEDAYQLAKDLVTDDAVNKLKQLVGNKNAILIPVHAEEAVG
HHCCCCCCCCCHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEEEECCHHHHC
QNMIPVAIATVLSKKLHIPVDLSIVQATKVSRTGGDGWHRLVYSPAFDGIVPKDKYAIIL
CCCHHHHHHHHHHHHCCCCCCEEEHHHHHHCCCCCCHHHHHEECCCCCCCCCCCCEEEEE
DDTQTQGGTLASLKGYIIKEKLLHLML
ECCCCCCCCHHHHHHHHHHHHHHHHHC
>Mature Secondary Structure
MLMNLPEILKNQKARARKFKPVKMSKRTELWYRQQLKQFVKMMTNDVERALQQPQGSFFM
CCCCCHHHHHCCHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEE
DDAKGFQAISAKALMKVLEKYEKSDRTSQAENIANGFVSRGDAQNHAEVSTNLKNQTGID
CCCCCHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHCCCCCCCCHHHHHCCCCCCCCC
LSAYLRNSPNITEKVNALTAGNIQLIKSIRSQYLDKVQNAVMQAMVRGSLNKDLAAQIKD
HHHHHCCCCCHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHH
LGKTTEKRAMFIARDQSSKLNAALTQARHEEVGIKKYMWSASLDERVRESHAEKDGQIFE
HCCHHHHHEEEEECCCCCHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHCCCCCCEEE
YANPPADTDHPGHDFNCRCVQIPVLDNNEQIVKNSPIVSQQEKQQMRSEWSDDFPDTIID
CCCCCCCCCCCCCCCCCEEEEEEEECCCCHHHCCCCCCCHHHHHHHHHHCCCCCCHHHHH
RKLGDATSHPLYENAKKGSIEDAYQLAKDLVTDDAVNKLKQLVGNKNAILIPVHAEEAVG
HHCCCCCCCCCHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEEEECCHHHHC
QNMIPVAIATVLSKKLHIPVDLSIVQATKVSRTGGDGWHRLVYSPAFDGIVPKDKYAIIL
CCCHHHHHHHHHHHHCCCCCCEEEHHHHHHCCCCCCHHHHHEECCCCCCCCCCCCEEEEE
DDTQTQGGTLASLKGYIIKEKLLHLML
ECCCCCCCCHHHHHHHHHHHHHHHHHC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 7542800