Definition Sodalis glossinidius str. 'morsitans', complete genome.
Accession NC_007712
Length 4,171,146

Click here to switch to the map view.

The map label for this gene is invF [H]

Identifier: 85060070

GI number: 85060070

Start: 3598304

End: 3599110

Strand: Reverse

Name: invF [H]

Synonym: SG2092

Alternate gene names: 85060070

Gene position: 3599110-3598304 (Counterclockwise)

Preceding gene: 85060072

Following gene: 85060069

Centisome position: 86.29

GC content: 52.04

Gene sequence:

>807_bases
ATGGCTATGAATATTAAGCAAAAGCGAAATGAGATAATGATTAGCAAAGAAATCATTGTCTCTTCCGCTTCGCTGCTGAA
CGAGCACCATCAGCAGGATATCTCGGAACCCAAATGCTGGTTGCTGGAAATTCCCGACGGTGATTGCGATATTCATATTC
GCTGGGCAAATGAATCGGCACGTCTGACATTATCCGCCGGCTGGCGCGGCATGCTATTAATGCAGCGCCTGAGTTTGGCG
CTGCGCGCCGGCACGGTGCGGTATCAGGAATTACCCCTGTTCGCGCTGGCGAAATTACAGGTATTTATCGACGAGTCCCG
CGGCGTACAGGTCGATTACGCCCAGCAACAATGGATACAGGTCGAGCTTGATGATTACCCGAATATTGGTACTTGCGCCG
ATATAGAGCAGTGGATGCTGGGGAATTACCAAAGCGCGCTAACCCAGATGAACGCGCTGGCGGTATTTTTACGCCAGACG
GAGTGCTATTGGCTAATACGTTTTTTGTTAAATGAATCTGTCAATAACGGGAAGTTGAATGTTCTGGGCGCGCGTTACGG
CTTGTCCTATTCTCATTTCCGCCGCCTGTGCCGCAATGCTCTGGGAAACTCGGCTAAAAATGAGCTGCGCGGCTGGCGTA
TCGCCAGAGCGCTGCTGGATATGGTCGAAGAGCGGCAAAGCCTTACCGAGGTCGCCATGCGCTATGGCTATGCCTCGTCC
TCGCACCTCTCCAACGATGTCAGGGACGCCTTTGGGGTTTCCCCCCGCGGGATATGGAATATGATCAACAAGAAAGCGGA
ACAATGA

Upstream 100 bases:

>100_bases
GGCATGCTGTGAAGCGATTAGACAATAAGCAGCTTTTGCAATTATTTCTCACCGTGAGTCATATTTTCATCATGATTTCT
TCAAAAGAGATAGGTAATGT

Downstream 100 bases:

>100_bases
ATAACATCGCTCTGATAGGCCGCGGCTTGCTCTGCGTTATGTTACTGGCCTGCACCGGCCTTCTTGCAGGCGCGCGGGCG
GCGGAGTTACCCCGACAAGG

Product: putative type III secretion apparatus transcriptional regulator

Products: NA

Alternate protein names: Transcriptional regulator invF [H]

Number of amino acids: Translated: 268; Mature: 267

Protein sequence:

>268_residues
MAMNIKQKRNEIMISKEIIVSSASLLNEHHQQDISEPKCWLLEIPDGDCDIHIRWANESARLTLSAGWRGMLLMQRLSLA
LRAGTVRYQELPLFALAKLQVFIDESRGVQVDYAQQQWIQVELDDYPNIGTCADIEQWMLGNYQSALTQMNALAVFLRQT
ECYWLIRFLLNESVNNGKLNVLGARYGLSYSHFRRLCRNALGNSAKNELRGWRIARALLDMVEERQSLTEVAMRYGYASS
SHLSNDVRDAFGVSPRGIWNMINKKAEQ

Sequences:

>Translated_268_residues
MAMNIKQKRNEIMISKEIIVSSASLLNEHHQQDISEPKCWLLEIPDGDCDIHIRWANESARLTLSAGWRGMLLMQRLSLA
LRAGTVRYQELPLFALAKLQVFIDESRGVQVDYAQQQWIQVELDDYPNIGTCADIEQWMLGNYQSALTQMNALAVFLRQT
ECYWLIRFLLNESVNNGKLNVLGARYGLSYSHFRRLCRNALGNSAKNELRGWRIARALLDMVEERQSLTEVAMRYGYASS
SHLSNDVRDAFGVSPRGIWNMINKKAEQ
>Mature_267_residues
AMNIKQKRNEIMISKEIIVSSASLLNEHHQQDISEPKCWLLEIPDGDCDIHIRWANESARLTLSAGWRGMLLMQRLSLAL
RAGTVRYQELPLFALAKLQVFIDESRGVQVDYAQQQWIQVELDDYPNIGTCADIEQWMLGNYQSALTQMNALAVFLRQTE
CYWLIRFLLNESVNNGKLNVLGARYGLSYSHFRRLCRNALGNSAKNELRGWRIARALLDMVEERQSLTEVAMRYGYASSS
HLSNDVRDAFGVSPRGIWNMINKKAEQ

Specific function: Transcriptional regulator required for the expression of several genes encoding type III secretion system SPI1 effector proteins. The interaction with sicA is necessary for the activation of sigDE (sopB pipC), sicAsipBCDA, and sopE [H]

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 HTH araC/xylS-type DNA-binding domain [H]

Homologues:

None

Paralogues:

None

Copy number: 10-20 Molecules/Cell [C]

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR009057
- InterPro:   IPR012287
- InterPro:   IPR018062
- InterPro:   IPR018060 [H]

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 30772; Mature: 30641

Theoretical pI: Translated: 7.88; Mature: 7.88

Prosite motif: PS00041 HTH_ARAC_FAMILY_1 ; PS01124 HTH_ARAC_FAMILY_2

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.9 %Cys     (Translated Protein)
3.7 %Met     (Translated Protein)
5.6 %Cys+Met (Translated Protein)
1.9 %Cys     (Mature Protein)
3.4 %Met     (Mature Protein)
5.2 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MAMNIKQKRNEIMISKEIIVSSASLLNEHHQQDISEPKCWLLEIPDGDCDIHIRWANESA
CCCCCHHHHHHHEEHHHHHHHHHHHHHHHHHHCCCCCCEEEEECCCCCEEEEEEECCCCC
RLTLSAGWRGMLLMQRLSLALRAGTVRYQELPLFALAKLQVFIDESRGVQVDYAQQQWIQ
EEEEECCCHHHHHHHHHHHHHHHCCEEHHHCCHHHHHHHHHEEECCCCCEEEECCCCEEE
VELDDYPNIGTCADIEQWMLGNYQSALTQMNALAVFLRQTECYWLIRFLLNESVNNGKLN
EEECCCCCCCCHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEE
VLGARYGLSYSHFRRLCRNALGNSAKNELRGWRIARALLDMVEERQSLTEVAMRYGYASS
EEEHHHCCCHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCC
SHLSNDVRDAFGVSPRGIWNMINKKAEQ
HHHHHHHHHHHCCCCHHHHHHHHHHCCC
>Mature Secondary Structure 
AMNIKQKRNEIMISKEIIVSSASLLNEHHQQDISEPKCWLLEIPDGDCDIHIRWANESA
CCCCHHHHHHHEEHHHHHHHHHHHHHHHHHHCCCCCCEEEEECCCCCEEEEEEECCCCC
RLTLSAGWRGMLLMQRLSLALRAGTVRYQELPLFALAKLQVFIDESRGVQVDYAQQQWIQ
EEEEECCCHHHHHHHHHHHHHHHCCEEHHHCCHHHHHHHHHEEECCCCCEEEECCCCEEE
VELDDYPNIGTCADIEQWMLGNYQSALTQMNALAVFLRQTECYWLIRFLLNESVNNGKLN
EEECCCCCCCCHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEE
VLGARYGLSYSHFRRLCRNALGNSAKNELRGWRIARALLDMVEERQSLTEVAMRYGYASS
EEEHHHCCCHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCC
SHLSNDVRDAFGVSPRGIWNMINKKAEQ
HHHHHHHHHHHCCCCHHHHHHHHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: DNA [C]

Specific reaction: Protein + DNA = Protein-DNA [C]

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: 11677608; 12644504 [H]