Definition Shewanella baltica OS195 chromosome, complete genome.
Accession NC_009997
Length 5,347,283

Click here to switch to the map view.

The map label for this gene is ygiQ [C]

Identifier: 160877280

GI number: 160877280

Start: 4942796

End: 4945219

Strand: Reverse

Name: ygiQ [C]

Synonym: Sbal195_4177

Alternate gene names: 160877280

Gene position: 4945219-4942796 (Counterclockwise)

Preceding gene: 160877281

Following gene: 160877279

Centisome position: 92.48

GC content: 51.07

Gene sequence:

>2424_bases
ATGCAAGTTGAATCCACACTCTTTAGTCATCCCAAGTATTGGGCTACAGGCGACAGCACTGCGCCTTTCTTACCTATGTC
CCGCAAGGAGATGGATAAGCTTGGCTGGGATAGCTGTGACATTATCATAGTCACAGGCGACGCTTATGTGGATCACCCAA
GCTTTGGCATGGCAGTGATCGGCCGTATGTTAGAGGCCCAAGGTTACCGAGTCGGCATTATTTCCCAACCTGATTGGTCG
AGCAAAGACGCCTTTATGCAATTGGGTCGTCCAAACCTGTTTTTTGGCGTCACCGCCGGCAACATGGATTCGATGATCAA
CCGTTACACCGCTGACCGTCGTTTACGTTCTGACGATGCTTATACTGCGGGAGATATTGGCGGTAAGCGCCCAGATCGCG
CTGTGACTGTGTACACCCAGCGCTGTAAAGAAGCCTTTAAAGATGTGCCTGTGATCATTGGCGGTATTGAAGCCAGTTTA
CGCCGCATCGCCCATTACGATTATTGGTCGGACAAAGTGCGTCGCAGTGTGATTTTCGATGCCAAGGCCGACATTCTGAT
GTATGGCAACGCCGAGCGTCCTTTAGTTGAAGTGGCACGCCGCTTAGCTGCCGGCGAACCCATTAGCTCGCTGCACGATG
TACGCGGCACTGCTGTTATCCGTAAAGAGCCGCTGCCCGAATGGCGCGGTATGGACTCGCGCAAGATTGACCAACTACAC
AAGATAGAGCCGTTGCCGAATCCTTACGGCGCCGATGATGTGGGTTGTGCAAACTTGTCTGGCCCGTCGGATGTGAAGAT
ATTCGATAACGAAGCACCTAAGCCAATTAGCGTTCAGCCGCCTAAACCTAAGCCATGGGATAAAACCTATGTGCTGCTGC
CAGCGTTTGAAAAAGTCTCTGAAGACAAATATTTATATGCCCATGCTTCACGGATTTTGCACCAAGAGCAAAATCCAGGT
TGTGCCCGTGCGTTATTCCAACCCCATGGCGATCGCGCCGTTTGGGTGAATCCGCCCGCATGGCCGCTTAATACCGATGA
GATGGATGCCGTATTCGATTTACCTTACCAGCGCATTCCTCATCCTATCTATGGCAAGGAAAAAATCCCTGCCTATGACA
TGATCAAGACTTCTATTAACATCATGCGCGGCTGCTTTGGTGGTTGTTCTTTCTGTTCGATTACCGAACATGAAGGCCGC
ATCATTCAGAGTCGTTCACAAGAGTCGATTGTTAAAGAAATCAAAGATATTCAGGAAAAAGTGCCAGGCTTTACTGGGGT
GATTTCCGATTTAGGCGGCCCAACCGCCAATATGTATCGTTTAGGTTGTACTAGCGAAAAGGCCGAAAAAACCTGTCGTC
GTCTTTCTTGTGTGTTTCCATCGATTTGCGGTCACTTAGGCACAGATCATAAACACACTATCGACCTGTACCGCGCGGCG
CGTGCTGTACCTGGCATCAAGAAAGTATTGATCGCCTCTGGCGTGCGTTACGACTTGGCGATCGAAGATCCGGCTTATGT
TAAAGAGTTAGTGCAGCACCATGTGGGCGGCTACTTAAAAATAGCCCCTGAGCATACCGAAGAAGGTCCGCTCAGCAAGA
TGATGAAACCCGGCATGGGCGCCTACGATAAGTTTAAAGAATTGTTCGATAAGTTTTCGAAGGAAGCGGGCAAAGAACAG
TTCCTTATCCCTTACTTTATTTCGGCGCATCCGGGCACGACCGACGAAGACATGGTGAACTTAGCGCTGTGGTTGAAGGA
ACGTAAGTTCAAGCTCGACCAAGTGCAGAACTTCTATCCGTCACCGATGGCGAATGCGACCACGATTTATCATACCGAGT
TAAACTCGCTGAAAAACGTCAAGCACACCAGTGAAGTGGTCTCTGTGCCGAAGAAAGGGCGCCAACGTCGTCTGCACAAA
GCATTGCTGCGTTATCACGATCCTGCGGGTTGGCCATTGATCCGTGAAGGGTTAACCGCAATGGGGCGTGAAGACTTGAT
CGGCAATAGCCCACATCAATTAGTGCCGCCAGAAGGTCGAAATGAGCGCGGACCTAAGTGGATGAAAGATGCCAACCAAG
GCCAAAAAGCCTTTACGCGCTTCTCGGGTAATCAGTTTGATGACCGCAAGGGCGATGGCAAATCTAAAGGTGTGGCGAAA
GGCGGCGCGCAAGCTCAGGCTGGTGCTGAATCGAAACCTGCCGCTAAAGGTGGAAAACCCGCAGCGAATGGGGCTAAGCC
AACCGGAGCTAAACCAACCGGCTCTAAACCTAGCGGAGCCCATTCGAGCCGTCCGGGAGCAAAAGCGCCCTTCGGTCAGT
CTGGTTTTAAGGCCAGCGGCTCTCAGGCTAAAGGTGGAAGTCCATCAAAAAGTGGTGGTAAACCAGCAGGTAAGCCCGCT
CAGGGTCGCCAACAGGCTAAGTAA

Upstream 100 bases:

>100_bases
CACTTATCCCTTGTTGCCTGCTATACTCCGCGTCCCTAAATTGGTGTAACTTATTTTCAGTGACGCCTTTATTTGACATT
ACGTTTTCGGGTCATAATCG

Downstream 100 bases:

>100_bases
TCACTTTTAGCTATCACAATAATGTACAAAGGCCGCTCCAGACATGAGCTTGGAGTGGCCTAGTTAGCACGATCATCCTG
CGATACTCTCCTTTTTTACA

Product: hypothetical protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 807; Mature: 807

Protein sequence:

>807_residues
MQVESTLFSHPKYWATGDSTAPFLPMSRKEMDKLGWDSCDIIIVTGDAYVDHPSFGMAVIGRMLEAQGYRVGIISQPDWS
SKDAFMQLGRPNLFFGVTAGNMDSMINRYTADRRLRSDDAYTAGDIGGKRPDRAVTVYTQRCKEAFKDVPVIIGGIEASL
RRIAHYDYWSDKVRRSVIFDAKADILMYGNAERPLVEVARRLAAGEPISSLHDVRGTAVIRKEPLPEWRGMDSRKIDQLH
KIEPLPNPYGADDVGCANLSGPSDVKIFDNEAPKPISVQPPKPKPWDKTYVLLPAFEKVSEDKYLYAHASRILHQEQNPG
CARALFQPHGDRAVWVNPPAWPLNTDEMDAVFDLPYQRIPHPIYGKEKIPAYDMIKTSINIMRGCFGGCSFCSITEHEGR
IIQSRSQESIVKEIKDIQEKVPGFTGVISDLGGPTANMYRLGCTSEKAEKTCRRLSCVFPSICGHLGTDHKHTIDLYRAA
RAVPGIKKVLIASGVRYDLAIEDPAYVKELVQHHVGGYLKIAPEHTEEGPLSKMMKPGMGAYDKFKELFDKFSKEAGKEQ
FLIPYFISAHPGTTDEDMVNLALWLKERKFKLDQVQNFYPSPMANATTIYHTELNSLKNVKHTSEVVSVPKKGRQRRLHK
ALLRYHDPAGWPLIREGLTAMGREDLIGNSPHQLVPPEGRNERGPKWMKDANQGQKAFTRFSGNQFDDRKGDGKSKGVAK
GGAQAQAGAESKPAAKGGKPAANGAKPTGAKPTGSKPSGAHSSRPGAKAPFGQSGFKASGSQAKGGSPSKSGGKPAGKPA
QGRQQAK

Sequences:

>Translated_807_residues
MQVESTLFSHPKYWATGDSTAPFLPMSRKEMDKLGWDSCDIIIVTGDAYVDHPSFGMAVIGRMLEAQGYRVGIISQPDWS
SKDAFMQLGRPNLFFGVTAGNMDSMINRYTADRRLRSDDAYTAGDIGGKRPDRAVTVYTQRCKEAFKDVPVIIGGIEASL
RRIAHYDYWSDKVRRSVIFDAKADILMYGNAERPLVEVARRLAAGEPISSLHDVRGTAVIRKEPLPEWRGMDSRKIDQLH
KIEPLPNPYGADDVGCANLSGPSDVKIFDNEAPKPISVQPPKPKPWDKTYVLLPAFEKVSEDKYLYAHASRILHQEQNPG
CARALFQPHGDRAVWVNPPAWPLNTDEMDAVFDLPYQRIPHPIYGKEKIPAYDMIKTSINIMRGCFGGCSFCSITEHEGR
IIQSRSQESIVKEIKDIQEKVPGFTGVISDLGGPTANMYRLGCTSEKAEKTCRRLSCVFPSICGHLGTDHKHTIDLYRAA
RAVPGIKKVLIASGVRYDLAIEDPAYVKELVQHHVGGYLKIAPEHTEEGPLSKMMKPGMGAYDKFKELFDKFSKEAGKEQ
FLIPYFISAHPGTTDEDMVNLALWLKERKFKLDQVQNFYPSPMANATTIYHTELNSLKNVKHTSEVVSVPKKGRQRRLHK
ALLRYHDPAGWPLIREGLTAMGREDLIGNSPHQLVPPEGRNERGPKWMKDANQGQKAFTRFSGNQFDDRKGDGKSKGVAK
GGAQAQAGAESKPAAKGGKPAANGAKPTGAKPTGSKPSGAHSSRPGAKAPFGQSGFKASGSQAKGGSPSKSGGKPAGKPA
QGRQQAK
>Mature_807_residues
MQVESTLFSHPKYWATGDSTAPFLPMSRKEMDKLGWDSCDIIIVTGDAYVDHPSFGMAVIGRMLEAQGYRVGIISQPDWS
SKDAFMQLGRPNLFFGVTAGNMDSMINRYTADRRLRSDDAYTAGDIGGKRPDRAVTVYTQRCKEAFKDVPVIIGGIEASL
RRIAHYDYWSDKVRRSVIFDAKADILMYGNAERPLVEVARRLAAGEPISSLHDVRGTAVIRKEPLPEWRGMDSRKIDQLH
KIEPLPNPYGADDVGCANLSGPSDVKIFDNEAPKPISVQPPKPKPWDKTYVLLPAFEKVSEDKYLYAHASRILHQEQNPG
CARALFQPHGDRAVWVNPPAWPLNTDEMDAVFDLPYQRIPHPIYGKEKIPAYDMIKTSINIMRGCFGGCSFCSITEHEGR
IIQSRSQESIVKEIKDIQEKVPGFTGVISDLGGPTANMYRLGCTSEKAEKTCRRLSCVFPSICGHLGTDHKHTIDLYRAA
RAVPGIKKVLIASGVRYDLAIEDPAYVKELVQHHVGGYLKIAPEHTEEGPLSKMMKPGMGAYDKFKELFDKFSKEAGKEQ
FLIPYFISAHPGTTDEDMVNLALWLKERKFKLDQVQNFYPSPMANATTIYHTELNSLKNVKHTSEVVSVPKKGRQRRLHK
ALLRYHDPAGWPLIREGLTAMGREDLIGNSPHQLVPPEGRNERGPKWMKDANQGQKAFTRFSGNQFDDRKGDGKSKGVAK
GGAQAQAGAESKPAAKGGKPAANGAKPTGAKPTGSKPSGAHSSRPGAKAPFGQSGFKASGSQAKGGSPSKSGGKPAGKPA
QGRQQAK

Specific function: Unknown

COG id: COG1032

COG function: function code C; Fe-S oxidoreductase

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the UPF0313 family [H]

Homologues:

Organism=Escherichia coli, GI48994917, Length=744, Percent_Identity=68.010752688172, Blast_Score=1050, Evalue=0.0,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR006638
- InterPro:   IPR020612
- InterPro:   IPR007197
- InterPro:   IPR013704
- InterPro:   IPR022946 [H]

Pfam domain/function: PF04055 Radical_SAM; PF08497 Radical_SAM_N [H]

EC number: NA

Molecular weight: Translated: 88863; Mature: 88863

Theoretical pI: Translated: 9.71; Mature: 9.71

Prosite motif: PS01278 UPF0004

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.4 %Cys     (Translated Protein)
2.6 %Met     (Translated Protein)
4.0 %Cys+Met (Translated Protein)
1.4 %Cys     (Mature Protein)
2.6 %Met     (Mature Protein)
4.0 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MQVESTLFSHPKYWATGDSTAPFLPMSRKEMDKLGWDSCDIIIVTGDAYVDHPSFGMAVI
CCCCHHHHCCCCEEECCCCCCCCCCCCHHHHHHCCCCCCCEEEEECCCEECCCCHHHHHH
GRMLEAQGYRVGIISQPDWSSKDAFMQLGRPNLFFGVTAGNMDSMINRYTADRRLRSDDA
HHHHHCCCCEEEEECCCCCCCCHHHHHCCCCCEEEEECCCCHHHHHHHHHHHHHHCCCCC
YTAGDIGGKRPDRAVTVYTQRCKEAFKDVPVIIGGIEASLRRIAHYDYWSDKVRRSVIFD
EECCCCCCCCCCCEEHHHHHHHHHHHCCCCEEEECHHHHHHHHHHCCHHHHHHHHHHHCC
AKADILMYGNAERPLVEVARRLAAGEPISSLHDVRGTAVIRKEPLPEWRGMDSRKIDQLH
CCCCEEEECCCCCHHHHHHHHHHCCCCHHHHHHHCCCEEEECCCCHHHCCCCHHHHHHHH
KIEPLPNPYGADDVGCANLSGPSDVKIFDNEAPKPISVQPPKPKPWDKTYVLLPAFEKVS
HCCCCCCCCCCCCCCCCCCCCCCCEEEECCCCCCCCCCCCCCCCCCCCCEEEEECHHHHC
EDKYLYAHASRILHQEQNPGCARALFQPHGDRAVWVNPPAWPLNTDEMDAVFDLPYQRIP
CCCCHHHHHHHHHHCCCCCCHHHHHHCCCCCEEEEECCCCCCCCCCCHHHHHCCCHHHCC
HPIYGKEKIPAYDMIKTSINIMRGCFGGCSFCSITEHEGRIIQSRSQESIVKEIKDIQEK
CCCCCCCCCCHHHHHHHHHHHHHHHCCCCCEEEEECCCCHHHHCCCHHHHHHHHHHHHHH
VPGFTGVISDLGGPTANMYRLGCTSEKAEKTCRRLSCVFPSICGHLGTDHKHTIDLYRAA
CCCHHHHHHHCCCCCCCEEEECCCCHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHH
RAVPGIKKVLIASGVRYDLAIEDPAYVKELVQHHVGGYLKIAPEHTEEGPLSKMMKPGMG
HHCCHHHHHHHHCCCEEEEEECCHHHHHHHHHHHCCCEEEECCCCCCCCCHHHHHCCCCC
AYDKFKELFDKFSKEAGKEQFLIPYFISAHPGTTDEDMVNLALWLKERKFKLDQVQNFYP
HHHHHHHHHHHHHHHCCCCCEEEEEEEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCC
SPMANATTIYHTELNSLKNVKHTSEVVSVPKKGRQRRLHKALLRYHDPAGWPLIREGLTA
CCCCCCEEEEEEHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHCCCCCCHHHHHHHHH
MGREDLIGNSPHQLVPPEGRNERGPKWMKDANQGQKAFTRFSGNQFDDRKGDGKSKGVAK
CCHHHHCCCCCCCCCCCCCCCCCCCHHHHHCCCHHHHHHHCCCCCCCCCCCCCCCCCCCC
GGAQAQAGAESKPAAKGGKPAANGAKPTGAKPTGSKPSGAHSSRPGAKAPFGQSGFKASG
CCCHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
SQAKGGSPSKSGGKPAGKPAQGRQQAK
CCCCCCCCCCCCCCCCCCCCCCCCCCC
>Mature Secondary Structure
MQVESTLFSHPKYWATGDSTAPFLPMSRKEMDKLGWDSCDIIIVTGDAYVDHPSFGMAVI
CCCCHHHHCCCCEEECCCCCCCCCCCCHHHHHHCCCCCCCEEEEECCCEECCCCHHHHHH
GRMLEAQGYRVGIISQPDWSSKDAFMQLGRPNLFFGVTAGNMDSMINRYTADRRLRSDDA
HHHHHCCCCEEEEECCCCCCCCHHHHHCCCCCEEEEECCCCHHHHHHHHHHHHHHCCCCC
YTAGDIGGKRPDRAVTVYTQRCKEAFKDVPVIIGGIEASLRRIAHYDYWSDKVRRSVIFD
EECCCCCCCCCCCEEHHHHHHHHHHHCCCCEEEECHHHHHHHHHHCCHHHHHHHHHHHCC
AKADILMYGNAERPLVEVARRLAAGEPISSLHDVRGTAVIRKEPLPEWRGMDSRKIDQLH
CCCCEEEECCCCCHHHHHHHHHHCCCCHHHHHHHCCCEEEECCCCHHHCCCCHHHHHHHH
KIEPLPNPYGADDVGCANLSGPSDVKIFDNEAPKPISVQPPKPKPWDKTYVLLPAFEKVS
HCCCCCCCCCCCCCCCCCCCCCCCEEEECCCCCCCCCCCCCCCCCCCCCEEEEECHHHHC
EDKYLYAHASRILHQEQNPGCARALFQPHGDRAVWVNPPAWPLNTDEMDAVFDLPYQRIP
CCCCHHHHHHHHHHCCCCCCHHHHHHCCCCCEEEEECCCCCCCCCCCHHHHHCCCHHHCC
HPIYGKEKIPAYDMIKTSINIMRGCFGGCSFCSITEHEGRIIQSRSQESIVKEIKDIQEK
CCCCCCCCCCHHHHHHHHHHHHHHHCCCCCEEEEECCCCHHHHCCCHHHHHHHHHHHHHH
VPGFTGVISDLGGPTANMYRLGCTSEKAEKTCRRLSCVFPSICGHLGTDHKHTIDLYRAA
CCCHHHHHHHCCCCCCCEEEECCCCHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHH
RAVPGIKKVLIASGVRYDLAIEDPAYVKELVQHHVGGYLKIAPEHTEEGPLSKMMKPGMG
HHCCHHHHHHHHCCCEEEEEECCHHHHHHHHHHHCCCEEEECCCCCCCCCHHHHHCCCCC
AYDKFKELFDKFSKEAGKEQFLIPYFISAHPGTTDEDMVNLALWLKERKFKLDQVQNFYP
HHHHHHHHHHHHHHHCCCCCEEEEEEEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCC
SPMANATTIYHTELNSLKNVKHTSEVVSVPKKGRQRRLHKALLRYHDPAGWPLIREGLTA
CCCCCCEEEEEEHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHCCCCCCHHHHHHHHH
MGREDLIGNSPHQLVPPEGRNERGPKWMKDANQGQKAFTRFSGNQFDDRKGDGKSKGVAK
CCHHHHCCCCCCCCCCCCCCCCCCCHHHHHCCCHHHHHHHCCCCCCCCCCCCCCCCCCCC
GGAQAQAGAESKPAAKGGKPAANGAKPTGAKPTGSKPSGAHSSRPGAKAPFGQSGFKASG
CCCHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
SQAKGGSPSKSGGKPAGKPAQGRQQAK
CCCCCCCCCCCCCCCCCCCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 12368813 [H]