| Definition | Nocardioides sp. JS614 chromosome, complete genome. |
|---|---|
| Accession | NC_008699 |
| Length | 4,985,871 |
Click here to switch to the map view.
The map label for this gene is whiG [H]
Identifier: 119715356
GI number: 119715356
Start: 1184642
End: 1185376
Strand: Reverse
Name: whiG [H]
Synonym: Noca_1118
Alternate gene names: 119715356
Gene position: 1185376-1184642 (Counterclockwise)
Preceding gene: 119715357
Following gene: 119715355
Centisome position: 23.77
GC content: 72.52
Gene sequence:
>735_bases GTGCGCGTGCAGACCGACAACACCGTCGACGGCCTGTGGGAACGGTTCAAGCAGGACGGCGACCGCGAGGCCCGCGACCG CCTGGTCGTGCACTACTCACCGCTGGTCAAGTTCGTCGCCGGCCGCGTCCGCTCGGGCCTCCCGCCCGCGGTCGAGCACG CCGACCTGGTCTCCGACGGGGTGATCGGCCTGCTGGACGCGCTGGACAAGTTCGACCCCGAGCGCGGCCTGCAGTTCCAG ACCTACGCCGTCTCCCGGATCCGCGGCGCGATGGTCGACGGGCTCCGCGCCGCGGACTGGGTGCCGCGCTCGGTGCGCGA GAAGATCCGCGACATCAACACCGCCCAGACCGAGCTCGAGCGGCGCCTGGGACGCGCACCCAAGGACGCCGAGGTGGCCG ACCGGCTCGGCATCAGTGTCGGGGACCTCCGCAAGATCTACAGCCAGACGGCGCACACCAGCGTCGTCAGCTTCGAGACG GTGCTCGACGAGGAGGACACGCCGCGGGCCACCACCGACCTGCCCGGCGCCGACGACGACATCCCGCCGGGCTTCCTGGC CGCGGTCCGGGAGCTGCCCGAGCGCGACCAGGTGGTCGTGGCGCTGTACTACTGGGAGCGGCTCACCCTCGCGGAGATCG GCCAGGTGCTCGGGGTGAGCGAGTCGCGGGTCAGCCAGCTGCACAGCCGGGCGACGCTCGCGCTGCGGCGCAAGCTGCTC CAGGTCGCCGGCTGA
Upstream 100 bases:
>100_bases GGCAGCCGCCCGGAGCCGTGGCACTTCGAGTACGCCGGCGGGGTGGCCTGAGCCGAGATCGGCGGGGCAGCCGATAGCCT GTCCAGCACGACCACCGGAG
Downstream 100 bases:
>100_bases TCCGGGGCGACGTGTCCGACTCGCAGTTCCGCGATCTCGGGTCCGCATATCCCAGGGCTCGACCGGTTGCCGGCCGATAG GCTCCCCCGAGAGGGGGAAC
Product: FliA/WhiG family RNA polymerase sigma factor
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 244; Mature: 244
Protein sequence:
>244_residues MRVQTDNTVDGLWERFKQDGDREARDRLVVHYSPLVKFVAGRVRSGLPPAVEHADLVSDGVIGLLDALDKFDPERGLQFQ TYAVSRIRGAMVDGLRAADWVPRSVREKIRDINTAQTELERRLGRAPKDAEVADRLGISVGDLRKIYSQTAHTSVVSFET VLDEEDTPRATTDLPGADDDIPPGFLAAVRELPERDQVVVALYYWERLTLAEIGQVLGVSESRVSQLHSRATLALRRKLL QVAG
Sequences:
>Translated_244_residues MRVQTDNTVDGLWERFKQDGDREARDRLVVHYSPLVKFVAGRVRSGLPPAVEHADLVSDGVIGLLDALDKFDPERGLQFQ TYAVSRIRGAMVDGLRAADWVPRSVREKIRDINTAQTELERRLGRAPKDAEVADRLGISVGDLRKIYSQTAHTSVVSFET VLDEEDTPRATTDLPGADDDIPPGFLAAVRELPERDQVVVALYYWERLTLAEIGQVLGVSESRVSQLHSRATLALRRKLL QVAG >Mature_244_residues MRVQTDNTVDGLWERFKQDGDREARDRLVVHYSPLVKFVAGRVRSGLPPAVEHADLVSDGVIGLLDALDKFDPERGLQFQ TYAVSRIRGAMVDGLRAADWVPRSVREKIRDINTAQTELERRLGRAPKDAEVADRLGISVGDLRKIYSQTAHTSVVSFET VLDEEDTPRATTDLPGADDDIPPGFLAAVRELPERDQVVVALYYWERLTLAEIGQVLGVSESRVSQLHSRATLALRRKLL QVAG
Specific function: The level of this sigma factor may be crucial in determining the developmental fate of hyphae [H]
COG id: COG1191
COG function: function code K; DNA-directed RNA polymerase specialized sigma subunit
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the sigma-70 factor family [H]
Homologues:
Organism=Escherichia coli, GI1788231, Length=217, Percent_Identity=44.2396313364055, Blast_Score=169, Evalue=1e-43, Organism=Escherichia coli, GI1789098, Length=246, Percent_Identity=29.6747967479675, Blast_Score=68, Evalue=4e-13, Organism=Escherichia coli, GI1789448, Length=206, Percent_Identity=28.1553398058252, Blast_Score=64, Evalue=1e-11,
Paralogues:
None
Copy number: 10-20 (rich media) [C]
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR014284 - InterPro: IPR000943 - InterPro: IPR007627 - InterPro: IPR007624 - InterPro: IPR007630 - InterPro: IPR012845 - InterPro: IPR013325 - InterPro: IPR013324 - InterPro: IPR011991 [H]
Pfam domain/function: PF04542 Sigma70_r2; PF04539 Sigma70_r3; PF04545 Sigma70_r4 [H]
EC number: NA
Molecular weight: Translated: 27180; Mature: 27180
Theoretical pI: Translated: 5.45; Mature: 5.45
Prosite motif: PS00715 SIGMA70_1
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.0 %Cys (Translated Protein) 0.8 %Met (Translated Protein) 0.8 %Cys+Met (Translated Protein) 0.0 %Cys (Mature Protein) 0.8 %Met (Mature Protein) 0.8 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MRVQTDNTVDGLWERFKQDGDREARDRLVVHYSPLVKFVAGRVRSGLPPAVEHADLVSDG CCCCCCCCHHHHHHHHHHCCCHHHHHCEEHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHH VIGLLDALDKFDPERGLQFQTYAVSRIRGAMVDGLRAADWVPRSVREKIRDINTAQTELE HHHHHHHHHHCCHHHCCCHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHCHHHHHHHH RRLGRAPKDAEVADRLGISVGDLRKIYSQTAHTSVVSFETVLDEEDTPRATTDLPGADDD HHHCCCCCCHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCC IPPGFLAAVRELPERDQVVVALYYWERLTLAEIGQVLGVSESRVSQLHSRATLALRRKLL CCHHHHHHHHHCCCCCCEEEEEHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHH QVAG HHCC >Mature Secondary Structure MRVQTDNTVDGLWERFKQDGDREARDRLVVHYSPLVKFVAGRVRSGLPPAVEHADLVSDG CCCCCCCCHHHHHHHHHHCCCHHHHHCEEHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHH VIGLLDALDKFDPERGLQFQTYAVSRIRGAMVDGLRAADWVPRSVREKIRDINTAQTELE HHHHHHHHHHCCHHHCCCHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHCHHHHHHHH RRLGRAPKDAEVADRLGISVGDLRKIYSQTAHTSVVSFETVLDEEDTPRATTDLPGADDD HHHCCCCCCHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCC IPPGFLAAVRELPERDQVVVALYYWERLTLAEIGQVLGVSESRVSQLHSRATLALRRKLL CCHHHHHHHHHCCCCCCEEEEEHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHH QVAG HHCC
PDB accession: NA
Resolution: NA
Structure class: Alpha
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: DNA [C]
Specific reaction: Protein + DNA = Protein-DNA [C]
General reaction: NA
Inhibitor: NA
Structure determination priority: 10.0
TargetDB status: NA
Availability: NA
References: 2507166; 12000953 [H]