The gene/protein map for NC_004741 is currently unavailable.
Definition Shigella flexneri 2a str. 2457T, complete genome.
Accession NC_004741
Length 4,599,354

Click here to switch to the map view.

The map label for this gene is 30063416

Identifier: 30063416

GI number: 30063416

Start: 2027802

End: 2029751

Strand: Reverse

Name: 30063416

Synonym: S2124

Alternate gene names: NA

Gene position: 2029751-2027802 (Counterclockwise)

Preceding gene: 30063417

Following gene: 30063413

Centisome position: 44.13

GC content: 52.1

Gene sequence:

>1950_bases
ATGGCTGACAGTTTTCAGCTGAAGGCGATCATCACTGCCGTGGATAAGGTATCGGCACCGCTGAAGGGAATGCAGCGCCA
GCTGAAAGGTTTTAAAAAGGAGTTTGCCAGCCTGTCACTGGGCGCAGCGGGTGCCGGAACCGCAGTACTGGGGGCGCTGG
CGCTCCCGGTCAAATCTGCCATTGCCCTTGAATCAAAAATGGCGGATGTCCGGAAAGTGGTGGATGGTCTGGATACGCCG
GAAGCGTTTAAGGCAATGACGGAGCAGGTGCGCGACCTGTCAACAGAACTGCCCATGTCGGCGGAAGGTATCGCCGAAAT
TGTGGCGGCGGGTGGTCAGGCTGGTATCGCCCGTGACGAGCTGATGCAGTTTACTGACGATGCCGTGAAGATGGGCGTGG
CCTTTGACACCACGGCAGAAGAATCCGGTCAGATGATGGCGCAGTGGCGCACTGCCTTTAAACTGACACAGGGAGAGGTG
GCAGGGCTTGCGGATAAGATTAACTATCTTGGCAATACCGGTCCTGCAAGTGCGAAAAAGATTTCTGATGTTGTGACCCG
TATTGGCCCTTTAGGCAGTGTTGCGGGTGTGGCCTCCGGAGAGATTGCCGCAATGGGGGCAACCATTGCCGGAATGGGGG
TGGAGTCAGAAATTGCTGCGACGGGGATAAAGAATTTTATGTTGTCGCTGACAGCGAGGGATTCTGCCACCAAATCGCAG
AAAAAAGTGCTCCGCTCGTTGCGCATTAGCCCGAAAAAACTGGCGGCGGATATGCAGAAAGACGCCCGCGGGGCCATGCT
GCACGTACTGGATTCTCTGGCAAAAGTGCCGAAAGAAAAACAGGCTGCTGTGCTGAAAGCGCTGTTCGGGAAGGAATCCC
TGGGGGCCATTGCGCCGCTGCTCACGAATCTGGATTTGTTGCGAACCAACTTTAATCGTGTGGCGGATGCGCAGCAGTAT
GGCGGCTCAATGCAGAAAGAATATGCCGCCCGTGCCGCGACGACAGAAAATCAGTTGTTGCTGCTGCAGAACCAGATCAA
TGCGATTTCTTCCACGCTGGGGGAAACCTTCCTGCCTTCACTCAATGAAGGCATAAAAGAGATGAAGCCTTTTCTGGAAG
AAGTGCGCACGTTTGTCAGAGAAAATCCTGAGGTCGTAAAAACCATCGCGAAAACTGGTGCGGCATTACTGACGATGGGC
GTGGCGATTGGCACATTGACACGCATAACAAAAATCATGGGTAGCGTGATGAATATGACGCCGGCAAAGGGATTAATTGC
GCTTCTCGTCGGTGGTGCATATCTCATAATTGATAACTGGGAAACGGTCGGTCCGGTTGTGAAAAAAGTCTGGCAGGAGG
TTGATCAGGTTGTCAGAGCAATGGGGGGATGGGAACAGGCAGTAAAAACAATAGCAACGGTTTCTGCCCTGTATATTGGT
GTGAAGGCGGTGGCAAGTATTCGTGCGGCAACAGTCGCCCAGAATCAATGGACAACGGCGGCAGGAAAAACAGGGCTGAA
ATTAAAGGGCCTCGGAAAGATCAGTCTGATTGGTGGATTGCTTGAACTGGGCATGATGGCGCAGGAGTTTGAAAAAGAAC
ATCCCTGGCTTGTTAAAAATTTTGTGGCTGATGCACTGAACAGTGGATTTGGTCTGAATGATAAGTTCGACGAGTGGGGC
AAACAGTTCCATGATTTTGTCTATGACATGACCGGATGGCAGATGCCACGTGGTGATGGGTATTTATCTCCCGATAAACG
CTACACCCCGAATGTATCACTGGAAAGGAATCAGCTGTTAAGCCTTGCATCTTCACCGGCAACCCGCAGCGAACTTAAGG
TGACGTTTGACAACGCGCCGCCTGGAATGCGCGTTATCGATTTGCCGAAAACAGGCGATCCCTTTATGAAAATCACCCAT
GATGTTGGGTATTCTCCATTTAAAAGGTGA

Upstream 100 bases:

>100_bases
TGGTTCTGGAAACTGAATCCACTGGAGCTGCGACGGGTGGCTGTTTCGCAGTTTACAGAACTGGAAGCCGAGGCCGTCCG
CATTAACGAGGAGATGAAGC

Downstream 100 bases:

>100_bases
GTTCTTTTTTTGTGGTGAAAGATGAGGCAAAATTATCGCGTAACATGCTAACAATGGAGTTTGTTTTGTGATAAAGCCAT
TTTTAATGACGGTTGCAATA

Product: putative tail protein

Products: NA

Alternate protein names: Phage-Related Tail Protein; Tail Tape Measure Protein; Tail Protein; Phage Tail Protein; Phage-Related Membrane Protein; Bacteriophage P2 Tail Protein GPT; Fels-2 Prophage Protein; Phage Tail Tape Measure Family Protein; Phage Tail Tape Measure Core Region; Family Phage Tail Tape Measure Protein; Phage Tail-Like Protein; Phage Tape-Measure Protein

Number of amino acids: Translated: 649; Mature: 648

Protein sequence:

>649_residues
MADSFQLKAIITAVDKVSAPLKGMQRQLKGFKKEFASLSLGAAGAGTAVLGALALPVKSAIALESKMADVRKVVDGLDTP
EAFKAMTEQVRDLSTELPMSAEGIAEIVAAGGQAGIARDELMQFTDDAVKMGVAFDTTAEESGQMMAQWRTAFKLTQGEV
AGLADKINYLGNTGPASAKKISDVVTRIGPLGSVAGVASGEIAAMGATIAGMGVESEIAATGIKNFMLSLTARDSATKSQ
KKVLRSLRISPKKLAADMQKDARGAMLHVLDSLAKVPKEKQAAVLKALFGKESLGAIAPLLTNLDLLRTNFNRVADAQQY
GGSMQKEYAARAATTENQLLLLQNQINAISSTLGETFLPSLNEGIKEMKPFLEEVRTFVRENPEVVKTIAKTGAALLTMG
VAIGTLTRITKIMGSVMNMTPAKGLIALLVGGAYLIIDNWETVGPVVKKVWQEVDQVVRAMGGWEQAVKTIATVSALYIG
VKAVASIRAATVAQNQWTTAAGKTGLKLKGLGKISLIGGLLELGMMAQEFEKEHPWLVKNFVADALNSGFGLNDKFDEWG
KQFHDFVYDMTGWQMPRGDGYLSPDKRYTPNVSLERNQLLSLASSPATRSELKVTFDNAPPGMRVIDLPKTGDPFMKITH
DVGYSPFKR

Sequences:

>Translated_649_residues
MADSFQLKAIITAVDKVSAPLKGMQRQLKGFKKEFASLSLGAAGAGTAVLGALALPVKSAIALESKMADVRKVVDGLDTP
EAFKAMTEQVRDLSTELPMSAEGIAEIVAAGGQAGIARDELMQFTDDAVKMGVAFDTTAEESGQMMAQWRTAFKLTQGEV
AGLADKINYLGNTGPASAKKISDVVTRIGPLGSVAGVASGEIAAMGATIAGMGVESEIAATGIKNFMLSLTARDSATKSQ
KKVLRSLRISPKKLAADMQKDARGAMLHVLDSLAKVPKEKQAAVLKALFGKESLGAIAPLLTNLDLLRTNFNRVADAQQY
GGSMQKEYAARAATTENQLLLLQNQINAISSTLGETFLPSLNEGIKEMKPFLEEVRTFVRENPEVVKTIAKTGAALLTMG
VAIGTLTRITKIMGSVMNMTPAKGLIALLVGGAYLIIDNWETVGPVVKKVWQEVDQVVRAMGGWEQAVKTIATVSALYIG
VKAVASIRAATVAQNQWTTAAGKTGLKLKGLGKISLIGGLLELGMMAQEFEKEHPWLVKNFVADALNSGFGLNDKFDEWG
KQFHDFVYDMTGWQMPRGDGYLSPDKRYTPNVSLERNQLLSLASSPATRSELKVTFDNAPPGMRVIDLPKTGDPFMKITH
DVGYSPFKR
>Mature_648_residues
ADSFQLKAIITAVDKVSAPLKGMQRQLKGFKKEFASLSLGAAGAGTAVLGALALPVKSAIALESKMADVRKVVDGLDTPE
AFKAMTEQVRDLSTELPMSAEGIAEIVAAGGQAGIARDELMQFTDDAVKMGVAFDTTAEESGQMMAQWRTAFKLTQGEVA
GLADKINYLGNTGPASAKKISDVVTRIGPLGSVAGVASGEIAAMGATIAGMGVESEIAATGIKNFMLSLTARDSATKSQK
KVLRSLRISPKKLAADMQKDARGAMLHVLDSLAKVPKEKQAAVLKALFGKESLGAIAPLLTNLDLLRTNFNRVADAQQYG
GSMQKEYAARAATTENQLLLLQNQINAISSTLGETFLPSLNEGIKEMKPFLEEVRTFVRENPEVVKTIAKTGAALLTMGV
AIGTLTRITKIMGSVMNMTPAKGLIALLVGGAYLIIDNWETVGPVVKKVWQEVDQVVRAMGGWEQAVKTIATVSALYIGV
KAVASIRAATVAQNQWTTAAGKTGLKLKGLGKISLIGGLLELGMMAQEFEKEHPWLVKNFVADALNSGFGLNDKFDEWGK
QFHDFVYDMTGWQMPRGDGYLSPDKRYTPNVSLERNQLLSLASSPATRSELKVTFDNAPPGMRVIDLPKTGDPFMKITHD
VGYSPFKR

Specific function: Unknown

COG id: COG5283

COG function: function code S; Phage-related tail protein

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 69362; Mature: 69231

Theoretical pI: Translated: 9.83; Mature: 9.83

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.0 %Cys     (Translated Protein)
4.2 %Met     (Translated Protein)
4.2 %Cys+Met (Translated Protein)
0.0 %Cys     (Mature Protein)
4.0 %Met     (Mature Protein)
4.0 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MADSFQLKAIITAVDKVSAPLKGMQRQLKGFKKEFASLSLGAAGAGTAVLGALALPVKSA
CCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHH
IALESKMADVRKVVDGLDTPEAFKAMTEQVRDLSTELPMSAEGIAEIVAAGGQAGIARDE
HHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHCCCCCCCCHHH
LMQFTDDAVKMGVAFDTTAEESGQMMAQWRTAFKLTQGEVAGLADKINYLGNTGPASAKK
HHHHHHHHHHHCCEECCCHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHCCCCCCCHHHH
ISDVVTRIGPLGSVAGVASGEIAAMGATIAGMGVESEIAATGIKNFMLSLTARDSATKSQ
HHHHHHHHCCCCHHHCCCCCCHHHHCHHHHCCCCHHHHHHHHHHHHHHHHHCCCCCHHHH
KKVLRSLRISPKKLAADMQKDARGAMLHVLDSLAKVPKEKQAAVLKALFGKESLGAIAPL
HHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHCCHHHHHHHHH
LTNLDLLRTNFNRVADAQQYGGSMQKEYAARAATTENQLLLLQNQINAISSTLGETFLPS
HHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHCCCCCCEEEHHHHHHHHHHHHHHHHHHH
LNEGIKEMKPFLEEVRTFVRENPEVVKTIAKTGAALLTMGVAIGTLTRITKIMGSVMNMT
HHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCC
PAKGLIALLVGGAYLIIDNWETVGPVVKKVWQEVDQVVRAMGGWEQAVKTIATVSALYIG
CHHHHHHHHHCCEEEEEECCHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHH
VKAVASIRAATVAQNQWTTAAGKTGLKLKGLGKISLIGGLLELGMMAQEFEKEHPWLVKN
HHHHHHHHHHHHHCCCCCCCCCCCCCEECCCCHHHHHHHHHHHHHHHHHHHHCCCHHHHH
FVADALNSGFGLNDKFDEWGKQFHDFVYDMTGWQMPRGDGYLSPDKRYTPNVSLERNQLL
HHHHHHHCCCCCCCCHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCHHHHH
SLASSPATRSELKVTFDNAPPGMRVIDLPKTGDPFMKITHDVGYSPFKR
HHHCCCCCCCCEEEEECCCCCCCEEEECCCCCCCHHHHHHHCCCCCCCC
>Mature Secondary Structure 
ADSFQLKAIITAVDKVSAPLKGMQRQLKGFKKEFASLSLGAAGAGTAVLGALALPVKSA
CCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHH
IALESKMADVRKVVDGLDTPEAFKAMTEQVRDLSTELPMSAEGIAEIVAAGGQAGIARDE
HHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHCCCCCCCCHHH
LMQFTDDAVKMGVAFDTTAEESGQMMAQWRTAFKLTQGEVAGLADKINYLGNTGPASAKK
HHHHHHHHHHHCCEECCCHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHCCCCCCCHHHH
ISDVVTRIGPLGSVAGVASGEIAAMGATIAGMGVESEIAATGIKNFMLSLTARDSATKSQ
HHHHHHHHCCCCHHHCCCCCCHHHHCHHHHCCCCHHHHHHHHHHHHHHHHHCCCCCHHHH
KKVLRSLRISPKKLAADMQKDARGAMLHVLDSLAKVPKEKQAAVLKALFGKESLGAIAPL
HHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHCCHHHHHHHHH
LTNLDLLRTNFNRVADAQQYGGSMQKEYAARAATTENQLLLLQNQINAISSTLGETFLPS
HHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHCCCCCCEEEHHHHHHHHHHHHHHHHHHH
LNEGIKEMKPFLEEVRTFVRENPEVVKTIAKTGAALLTMGVAIGTLTRITKIMGSVMNMT
HHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCC
PAKGLIALLVGGAYLIIDNWETVGPVVKKVWQEVDQVVRAMGGWEQAVKTIATVSALYIG
CHHHHHHHHHCCEEEEEECCHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHH
VKAVASIRAATVAQNQWTTAAGKTGLKLKGLGKISLIGGLLELGMMAQEFEKEHPWLVKN
HHHHHHHHHHHHHCCCCCCCCCCCCCEECCCCHHHHHHHHHHHHHHHHHHHHCCCHHHHH
FVADALNSGFGLNDKFDEWGKQFHDFVYDMTGWQMPRGDGYLSPDKRYTPNVSLERNQLL
HHHHHHHCCCCCCCCHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCHHHHH
SLASSPATRSELKVTFDNAPPGMRVIDLPKTGDPFMKITHDVGYSPFKR
HHHCCCCCCCCEEEEECCCCCCCEEEECCCCCCCHHHHHHHCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA