The gene/protein map for NC_011750 is currently unavailable.
Definition Escherichia coli IAI39 chromosome, complete genome.
Accession NC_011750
Length 5,132,068

Click here to switch to the map view.

The map label for this gene is A

Identifier: 218699882

GI number: 218699882

Start: 1577290

End: 1579215

Strand: Direct

Name: A

Synonym: ECIAI39_1509

Alternate gene names: 218699882

Gene position: 1577290-1579215 (Clockwise)

Preceding gene: 218699881

Following gene: 218699883

Centisome position: 30.73

GC content: 54.15

Gene sequence:

>1926_bases
GTGAATATATCGAACAGTCAGGTTAACAGGCTGCGGCATTTTGTCCGCGCCGGGCTTCGCTCACTGTTCAGGCCGGAGCC
ACAGACCGCCGTTGAATGGGCGGATGCCAATTACTATCTCCCGAAAGAATCCGCATACCAGGAAGGGCGCTGGGAAACAC
TGCCCTTTCAGCGGGCCATCATGAATGCGATGGGCAGTGACTACATCCGCGAGGTGAATGTGGTGAAGTCTGCCCGTGTT
GGTTATTCCAAAATGCTGCTGGGTGTTTATGCCTACTTCATAGAGCATAAGCAGCGCAACACCCTTATCTGGTTGCCGAC
GGATGGTGATGCCGAGAACTTTATGAAAACCCACGTTGAGCCGACTATTCGTGATATTCCGTCGCTGCTGGCGCTGGCCC
CGTGGTATGGCAAAAAGCACCGGGATAACACGCTCACCATGAAGCGTTTCACCAATGGGCGTGGCTTCTGGTGCCTGGGC
GGTAAAGCGGCAAAAAACTACCGTGAAAAGTCGGTGGATGTGGCGGGTTATGATGAACTTGCTGCTTTTGATGATGATAT
TGAACAGGAAGGCTCTCCGACGTTCCTGGGTGACAAGCGTATTGAAGGCTCGGTCTGGCCAAAGTCCATCCGTGGCTCCA
CGCCCAAAGTGAGAGGCACCTGTCAGATTGAGCGTGCAGCCAGTGAATCCCCGCATTTTATGCGTTTTCATGTTGCCTGC
CCGCACTGCGGGGAGGAGCAGTACCTTAAATTTGGCGATAAAGAGACGCCGTTTGGCCTCAAATGGACGCCGGATGATCC
CTCCAGCGTGTTTTATCTCTGCGAACATAATGCCTGCGTCATCCGCCAGCAGGAGCTGGACTTCACTGATGCCCGTTATA
TCTGCGAAAAGACCGGGATCTGGACCCGTGATGGCATTCTCTGGTTTTCGTCATCCGGTGAAGAGATTGAGCCACCTGAC
AGTGTGACCTTTCACATCTGGACGGCGTACAGCCCGTTCACCACCTGGGTGCAGATTGTCAAAGACTGGATGAAGACGAA
AGGGGATACGGGAAAACGTAAAACCTTCGTGAACACCACGCTCGGTGAGACGTGGGAAGCGAAAATCGGTGAACGTCCGG
ATGCTGAAGTGATGGCAGAGCGGAAAGAGCATTATTCAGCGCCCGTTCCTGACCGTGTGGCTTACCTGACCGCCGGTATC
GACTCCCAGCTGGATCGCTACGAAATGCGCGTATGGGGATGGGGGCCGGGTGAGGAAAGCTGGCTGATTGACCGGCAGAT
TATTATGGGCCGCCACGACGATGAACAGACGCTGCAGCGTGTGGATGAGGCCATCAATAAAACCTATACCCGCCGGAATG
GTGCAGAAATGTCGGTATCCCGTATCTGCTGGGATACTGGCGGGATTGACCCGACTATTGTGTATGAACGCTCGAAAAAG
CATGGGCTGTTCCGGGTGATCCCCATTAAAGGGGCATCCGTCTACGGAAAGCCGGTGGCCAGCATGCCACGTAAGCGAAA
CAAAAACGGGGTTTACCTTACCGAAATCGGTACGGATACCGCGAAAGAGCAGATTTATAACCGCTTCACACTGACGCCGG
AAGGGGATGAACCGCTTCCCGGTGCCGTTCACTTCCCGAATAACCCGGATATTTTTGATCTGACCGAAGCGCAGCAGCTG
ACTGCTGAAGAGCAGGTCGAAAAATGGGTGGATGGCAGGAAAAAAATACTGTGGGACAGCAAAAAGCGACGCAATGAGGC
ACTCGACTGCTTCGTTTATGCGCTGGCGGCGCTGCGCATCAGTATTTCGCGCTGGCAGCTGGATCTTAGTGCACTGCTGG
CGAGCCTGCAGGAAGAGGATGGTGCAGCAACCAACAAGAAAACACTGGCAGATTACGCCCGTGCCTTATCCGGAGAGGAT
GAATGA

Upstream 100 bases:

>100_bases
CCGGAACTGGAAAACCGACATGTTGATTTCCTGAAACGGGATATCATCAAAGCCATGAACAAAGCAGCCGCGCTGGATGA
ACTGATACCGGGGTTGCTGA

Downstream 100 bases:

>100_bases
CGCGACAGGAAGAACTTGCCGCTGCCCGTGCGGCACTGCATGACCTGATGACAGGAAAACGGGTGGCAACGGTACAGAAA
GACGGACGGAGAGTGGAGTT

Product: terminase large subunit from bacteriophage origin

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 641; Mature: 641

Protein sequence:

>641_residues
MNISNSQVNRLRHFVRAGLRSLFRPEPQTAVEWADANYYLPKESAYQEGRWETLPFQRAIMNAMGSDYIREVNVVKSARV
GYSKMLLGVYAYFIEHKQRNTLIWLPTDGDAENFMKTHVEPTIRDIPSLLALAPWYGKKHRDNTLTMKRFTNGRGFWCLG
GKAAKNYREKSVDVAGYDELAAFDDDIEQEGSPTFLGDKRIEGSVWPKSIRGSTPKVRGTCQIERAASESPHFMRFHVAC
PHCGEEQYLKFGDKETPFGLKWTPDDPSSVFYLCEHNACVIRQQELDFTDARYICEKTGIWTRDGILWFSSSGEEIEPPD
SVTFHIWTAYSPFTTWVQIVKDWMKTKGDTGKRKTFVNTTLGETWEAKIGERPDAEVMAERKEHYSAPVPDRVAYLTAGI
DSQLDRYEMRVWGWGPGEESWLIDRQIIMGRHDDEQTLQRVDEAINKTYTRRNGAEMSVSRICWDTGGIDPTIVYERSKK
HGLFRVIPIKGASVYGKPVASMPRKRNKNGVYLTEIGTDTAKEQIYNRFTLTPEGDEPLPGAVHFPNNPDIFDLTEAQQL
TAEEQVEKWVDGRKKILWDSKKRRNEALDCFVYALAALRISISRWQLDLSALLASLQEEDGAATNKKTLADYARALSGED
E

Sequences:

>Translated_641_residues
MNISNSQVNRLRHFVRAGLRSLFRPEPQTAVEWADANYYLPKESAYQEGRWETLPFQRAIMNAMGSDYIREVNVVKSARV
GYSKMLLGVYAYFIEHKQRNTLIWLPTDGDAENFMKTHVEPTIRDIPSLLALAPWYGKKHRDNTLTMKRFTNGRGFWCLG
GKAAKNYREKSVDVAGYDELAAFDDDIEQEGSPTFLGDKRIEGSVWPKSIRGSTPKVRGTCQIERAASESPHFMRFHVAC
PHCGEEQYLKFGDKETPFGLKWTPDDPSSVFYLCEHNACVIRQQELDFTDARYICEKTGIWTRDGILWFSSSGEEIEPPD
SVTFHIWTAYSPFTTWVQIVKDWMKTKGDTGKRKTFVNTTLGETWEAKIGERPDAEVMAERKEHYSAPVPDRVAYLTAGI
DSQLDRYEMRVWGWGPGEESWLIDRQIIMGRHDDEQTLQRVDEAINKTYTRRNGAEMSVSRICWDTGGIDPTIVYERSKK
HGLFRVIPIKGASVYGKPVASMPRKRNKNGVYLTEIGTDTAKEQIYNRFTLTPEGDEPLPGAVHFPNNPDIFDLTEAQQL
TAEEQVEKWVDGRKKILWDSKKRRNEALDCFVYALAALRISISRWQLDLSALLASLQEEDGAATNKKTLADYARALSGED
E
>Mature_641_residues
MNISNSQVNRLRHFVRAGLRSLFRPEPQTAVEWADANYYLPKESAYQEGRWETLPFQRAIMNAMGSDYIREVNVVKSARV
GYSKMLLGVYAYFIEHKQRNTLIWLPTDGDAENFMKTHVEPTIRDIPSLLALAPWYGKKHRDNTLTMKRFTNGRGFWCLG
GKAAKNYREKSVDVAGYDELAAFDDDIEQEGSPTFLGDKRIEGSVWPKSIRGSTPKVRGTCQIERAASESPHFMRFHVAC
PHCGEEQYLKFGDKETPFGLKWTPDDPSSVFYLCEHNACVIRQQELDFTDARYICEKTGIWTRDGILWFSSSGEEIEPPD
SVTFHIWTAYSPFTTWVQIVKDWMKTKGDTGKRKTFVNTTLGETWEAKIGERPDAEVMAERKEHYSAPVPDRVAYLTAGI
DSQLDRYEMRVWGWGPGEESWLIDRQIIMGRHDDEQTLQRVDEAINKTYTRRNGAEMSVSRICWDTGGIDPTIVYERSKK
HGLFRVIPIKGASVYGKPVASMPRKRNKNGVYLTEIGTDTAKEQIYNRFTLTPEGDEPLPGAVHFPNNPDIFDLTEAQQL
TAEEQVEKWVDGRKKILWDSKKRRNEALDCFVYALAALRISISRWQLDLSALLASLQEEDGAATNKKTLADYARALSGED
E

Specific function: Unknown

COG id: COG5525

COG function: function code R; Bacteriophage tail assembly protein

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: To phage lambda terminase large subunit in the N- terminal section [H]

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR003458
- InterPro:   IPR008866 [H]

Pfam domain/function: PF02413 Caudo_TAP; PF05876 Terminase_GpA [H]

EC number: NA

Molecular weight: Translated: 73303; Mature: 73303

Theoretical pI: Translated: 6.46; Mature: 6.46

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.4 %Cys     (Translated Protein)
2.0 %Met     (Translated Protein)
3.4 %Cys+Met (Translated Protein)
1.4 %Cys     (Mature Protein)
2.0 %Met     (Mature Protein)
3.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MNISNSQVNRLRHFVRAGLRSLFRPEPQTAVEWADANYYLPKESAYQEGRWETLPFQRAI
CCCCHHHHHHHHHHHHHHHHHHHCCCCCHHEEECCCCEECCCHHHHCCCCCCCCCHHHHH
MNAMGSDYIREVNVVKSARVGYSKMLLGVYAYFIEHKQRNTLIWLPTDGDAENFMKTHVE
HHHHCHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHCCCCEEEEEECCCCHHHHHHHCCC
PTIRDIPSLLALAPWYGKKHRDNTLTMKRFTNGRGFWCLGGKAAKNYREKSVDVAGYDEL
HHHHHHHHHHHHCCCCCCCCCCCCEEEEEECCCCEEEEECCHHHHHHHHHCCCCCCCHHH
AAFDDDIEQEGSPTFLGDKRIEGSVWPKSIRGSTPKVRGTCQIERAASESPHFMRFHVAC
HHCCCCHHHCCCCCCCCCCCCCCCCCCHHHCCCCCCCCCEEEEEHHCCCCCCEEEEEEEC
PHCGEEQYLKFGDKETPFGLKWTPDDPSSVFYLCEHNACVIRQQELDFTDARYICEKTGI
CCCCCHHHHHCCCCCCCCCCEECCCCCCCEEEEEECCEEEEEECCCCCHHHHHHHHHCCC
WTRDGILWFSSSGEEIEPPDSVTFHIWTAYSPFTTWVQIVKDWMKTKGDTGKRKTFVNTT
EEECCEEEECCCCCCCCCCCCEEEEEEECCCHHHHHHHHHHHHHHCCCCCCCCEEEEECC
LGETWEAKIGERPDAEVMAERKEHYSAPVPDRVAYLTAGIDSQLDRYEMRVWGWGPGEES
CCCCHHHHCCCCCCHHHHHHHHHHCCCCCCCHHEEEECCCHHHHCCEEEEEEECCCCCCC
WLIDRQIIMGRHDDEQTLQRVDEAINKTYTRRNGAEMSVSRICWDTGGIDPTIVYERSKK
EEEEHHHHCCCCCCHHHHHHHHHHHHHHHHCCCCCCCCHHHHEECCCCCCCEEEEECCCC
HGLFRVIPIKGASVYGKPVASMPRKRNKNGVYLTEIGTDTAKEQIYNRFTLTPEGDEPLP
CCCEEEEEECCCCCCCCCHHHCCCCCCCCCEEEEECCCCHHHHHHHHEEECCCCCCCCCC
GAVHFPNNPDIFDLTEAQQLTAEEQVEKWVDGRKKILWDSKKRRNEALDCFVYALAALRI
CEEECCCCCCEEECCHHHHHHHHHHHHHHHCCCHHHHCCCHHHHHHHHHHHHHHHHHHHH
SISRWQLDLSALLASLQEEDGAATNKKTLADYARALSGEDE
HHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHCCCCC
>Mature Secondary Structure
MNISNSQVNRLRHFVRAGLRSLFRPEPQTAVEWADANYYLPKESAYQEGRWETLPFQRAI
CCCCHHHHHHHHHHHHHHHHHHHCCCCCHHEEECCCCEECCCHHHHCCCCCCCCCHHHHH
MNAMGSDYIREVNVVKSARVGYSKMLLGVYAYFIEHKQRNTLIWLPTDGDAENFMKTHVE
HHHHCHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHCCCCEEEEEECCCCHHHHHHHCCC
PTIRDIPSLLALAPWYGKKHRDNTLTMKRFTNGRGFWCLGGKAAKNYREKSVDVAGYDEL
HHHHHHHHHHHHCCCCCCCCCCCCEEEEEECCCCEEEEECCHHHHHHHHHCCCCCCCHHH
AAFDDDIEQEGSPTFLGDKRIEGSVWPKSIRGSTPKVRGTCQIERAASESPHFMRFHVAC
HHCCCCHHHCCCCCCCCCCCCCCCCCCHHHCCCCCCCCCEEEEEHHCCCCCCEEEEEEEC
PHCGEEQYLKFGDKETPFGLKWTPDDPSSVFYLCEHNACVIRQQELDFTDARYICEKTGI
CCCCCHHHHHCCCCCCCCCCEECCCCCCCEEEEEECCEEEEEECCCCCHHHHHHHHHCCC
WTRDGILWFSSSGEEIEPPDSVTFHIWTAYSPFTTWVQIVKDWMKTKGDTGKRKTFVNTT
EEECCEEEECCCCCCCCCCCCEEEEEEECCCHHHHHHHHHHHHHHCCCCCCCCEEEEECC
LGETWEAKIGERPDAEVMAERKEHYSAPVPDRVAYLTAGIDSQLDRYEMRVWGWGPGEES
CCCCHHHHCCCCCCHHHHHHHHHHCCCCCCCHHEEEECCCHHHHCCEEEEEEECCCCCCC
WLIDRQIIMGRHDDEQTLQRVDEAINKTYTRRNGAEMSVSRICWDTGGIDPTIVYERSKK
EEEEHHHHCCCCCCHHHHHHHHHHHHHHHHCCCCCCCCHHHHEECCCCCCCEEEEECCCC
HGLFRVIPIKGASVYGKPVASMPRKRNKNGVYLTEIGTDTAKEQIYNRFTLTPEGDEPLP
CCCEEEEEECCCCCCCCCHHHCCCCCCCCCEEEEECCCCHHHHHHHHEEECCCCCCCCCC
GAVHFPNNPDIFDLTEAQQLTAEEQVEKWVDGRKKILWDSKKRRNEALDCFVYALAALRI
CEEECCCCCCEEECCHHHHHHHHHHHHHHHCCCHHHHCCCHHHHHHHHHHHHHHHHHHHH
SISRWQLDLSALLASLQEEDGAATNKKTLADYARALSGEDE
HHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9278503 [H]