| Definition | Sodalis glossinidius str. 'morsitans', complete genome. |
|---|---|
| Accession | NC_007712 |
| Length | 4,171,146 |
Click here to switch to the map view.
The map label for this gene is invF [H]
Identifier: 85060070
GI number: 85060070
Start: 3598304
End: 3599110
Strand: Reverse
Name: invF [H]
Synonym: SG2092
Alternate gene names: 85060070
Gene position: 3599110-3598304 (Counterclockwise)
Preceding gene: 85060072
Following gene: 85060069
Centisome position: 86.29
GC content: 52.04
Gene sequence:
>807_bases ATGGCTATGAATATTAAGCAAAAGCGAAATGAGATAATGATTAGCAAAGAAATCATTGTCTCTTCCGCTTCGCTGCTGAA CGAGCACCATCAGCAGGATATCTCGGAACCCAAATGCTGGTTGCTGGAAATTCCCGACGGTGATTGCGATATTCATATTC GCTGGGCAAATGAATCGGCACGTCTGACATTATCCGCCGGCTGGCGCGGCATGCTATTAATGCAGCGCCTGAGTTTGGCG CTGCGCGCCGGCACGGTGCGGTATCAGGAATTACCCCTGTTCGCGCTGGCGAAATTACAGGTATTTATCGACGAGTCCCG CGGCGTACAGGTCGATTACGCCCAGCAACAATGGATACAGGTCGAGCTTGATGATTACCCGAATATTGGTACTTGCGCCG ATATAGAGCAGTGGATGCTGGGGAATTACCAAAGCGCGCTAACCCAGATGAACGCGCTGGCGGTATTTTTACGCCAGACG GAGTGCTATTGGCTAATACGTTTTTTGTTAAATGAATCTGTCAATAACGGGAAGTTGAATGTTCTGGGCGCGCGTTACGG CTTGTCCTATTCTCATTTCCGCCGCCTGTGCCGCAATGCTCTGGGAAACTCGGCTAAAAATGAGCTGCGCGGCTGGCGTA TCGCCAGAGCGCTGCTGGATATGGTCGAAGAGCGGCAAAGCCTTACCGAGGTCGCCATGCGCTATGGCTATGCCTCGTCC TCGCACCTCTCCAACGATGTCAGGGACGCCTTTGGGGTTTCCCCCCGCGGGATATGGAATATGATCAACAAGAAAGCGGA ACAATGA
Upstream 100 bases:
>100_bases GGCATGCTGTGAAGCGATTAGACAATAAGCAGCTTTTGCAATTATTTCTCACCGTGAGTCATATTTTCATCATGATTTCT TCAAAAGAGATAGGTAATGT
Downstream 100 bases:
>100_bases ATAACATCGCTCTGATAGGCCGCGGCTTGCTCTGCGTTATGTTACTGGCCTGCACCGGCCTTCTTGCAGGCGCGCGGGCG GCGGAGTTACCCCGACAAGG
Product: putative type III secretion apparatus transcriptional regulator
Products: NA
Alternate protein names: Transcriptional regulator invF [H]
Number of amino acids: Translated: 268; Mature: 267
Protein sequence:
>268_residues MAMNIKQKRNEIMISKEIIVSSASLLNEHHQQDISEPKCWLLEIPDGDCDIHIRWANESARLTLSAGWRGMLLMQRLSLA LRAGTVRYQELPLFALAKLQVFIDESRGVQVDYAQQQWIQVELDDYPNIGTCADIEQWMLGNYQSALTQMNALAVFLRQT ECYWLIRFLLNESVNNGKLNVLGARYGLSYSHFRRLCRNALGNSAKNELRGWRIARALLDMVEERQSLTEVAMRYGYASS SHLSNDVRDAFGVSPRGIWNMINKKAEQ
Sequences:
>Translated_268_residues MAMNIKQKRNEIMISKEIIVSSASLLNEHHQQDISEPKCWLLEIPDGDCDIHIRWANESARLTLSAGWRGMLLMQRLSLA LRAGTVRYQELPLFALAKLQVFIDESRGVQVDYAQQQWIQVELDDYPNIGTCADIEQWMLGNYQSALTQMNALAVFLRQT ECYWLIRFLLNESVNNGKLNVLGARYGLSYSHFRRLCRNALGNSAKNELRGWRIARALLDMVEERQSLTEVAMRYGYASS SHLSNDVRDAFGVSPRGIWNMINKKAEQ >Mature_267_residues AMNIKQKRNEIMISKEIIVSSASLLNEHHQQDISEPKCWLLEIPDGDCDIHIRWANESARLTLSAGWRGMLLMQRLSLAL RAGTVRYQELPLFALAKLQVFIDESRGVQVDYAQQQWIQVELDDYPNIGTCADIEQWMLGNYQSALTQMNALAVFLRQTE CYWLIRFLLNESVNNGKLNVLGARYGLSYSHFRRLCRNALGNSAKNELRGWRIARALLDMVEERQSLTEVAMRYGYASSS HLSNDVRDAFGVSPRGIWNMINKKAEQ
Specific function: Transcriptional regulator required for the expression of several genes encoding type III secretion system SPI1 effector proteins. The interaction with sicA is necessary for the activation of sigDE (sopB pipC), sicAsipBCDA, and sopE [H]
COG id: NA
COG function: NA
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 HTH araC/xylS-type DNA-binding domain [H]
Homologues:
None
Paralogues:
None
Copy number: 10-20 Molecules/Cell [C]
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR009057 - InterPro: IPR012287 - InterPro: IPR018062 - InterPro: IPR018060 [H]
Pfam domain/function: NA
EC number: NA
Molecular weight: Translated: 30772; Mature: 30641
Theoretical pI: Translated: 7.88; Mature: 7.88
Prosite motif: PS00041 HTH_ARAC_FAMILY_1 ; PS01124 HTH_ARAC_FAMILY_2
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.9 %Cys (Translated Protein) 3.7 %Met (Translated Protein) 5.6 %Cys+Met (Translated Protein) 1.9 %Cys (Mature Protein) 3.4 %Met (Mature Protein) 5.2 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MAMNIKQKRNEIMISKEIIVSSASLLNEHHQQDISEPKCWLLEIPDGDCDIHIRWANESA CCCCCHHHHHHHEEHHHHHHHHHHHHHHHHHHCCCCCCEEEEECCCCCEEEEEEECCCCC RLTLSAGWRGMLLMQRLSLALRAGTVRYQELPLFALAKLQVFIDESRGVQVDYAQQQWIQ EEEEECCCHHHHHHHHHHHHHHHCCEEHHHCCHHHHHHHHHEEECCCCCEEEECCCCEEE VELDDYPNIGTCADIEQWMLGNYQSALTQMNALAVFLRQTECYWLIRFLLNESVNNGKLN EEECCCCCCCCHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEE VLGARYGLSYSHFRRLCRNALGNSAKNELRGWRIARALLDMVEERQSLTEVAMRYGYASS EEEHHHCCCHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCC SHLSNDVRDAFGVSPRGIWNMINKKAEQ HHHHHHHHHHHCCCCHHHHHHHHHHCCC >Mature Secondary Structure AMNIKQKRNEIMISKEIIVSSASLLNEHHQQDISEPKCWLLEIPDGDCDIHIRWANESA CCCCHHHHHHHEEHHHHHHHHHHHHHHHHHHCCCCCCEEEEECCCCCEEEEEEECCCCC RLTLSAGWRGMLLMQRLSLALRAGTVRYQELPLFALAKLQVFIDESRGVQVDYAQQQWIQ EEEEECCCHHHHHHHHHHHHHHHCCEEHHHCCHHHHHHHHHEEECCCCCEEEECCCCEEE VELDDYPNIGTCADIEQWMLGNYQSALTQMNALAVFLRQTECYWLIRFLLNESVNNGKLN EEECCCCCCCCHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEE VLGARYGLSYSHFRRLCRNALGNSAKNELRGWRIARALLDMVEERQSLTEVAMRYGYASS EEEHHHCCCHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCC SHLSNDVRDAFGVSPRGIWNMINKKAEQ HHHHHHHHHHHCCCCHHHHHHHHHHCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: DNA [C]
Specific reaction: Protein + DNA = Protein-DNA [C]
General reaction: NA
Inhibitor: NA
Structure determination priority: 10.0
TargetDB status: NA
Availability: NA
References: 11677608; 12644504 [H]