Definition Rhodobacter sphaeroides 2.4.1 chromosome 2, complete sequence.
Accession NC_007494
Length 943,016

Click here to switch to the map view.

The map label for this gene is 77465675

Identifier: 77465675

GI number: 77465675

Start: 779082

End: 785318

Strand: Direct

Name: 77465675

Synonym: RSP_3667

Alternate gene names: NA

Gene position: 779082-785318 (Clockwise)

Preceding gene: 77465674

Following gene: 77465676

Centisome position: 82.62

GC content: 69.86

Gene sequence:

>6237_bases
GTGACCAACGGCGGCGTGGCCCCCCTCACCGACGTGACGCTCACCGATGCGGTGCCGGGCGTGCAGGTGACGGGCGGGCC
GATCTCGCTGGCAGGCGGGGCTTCGGACACGACGAGCTTCACCGCGACCTATGAGCTGACCCAGGCCGACGTCGATGCGG
GCAGCTTCACCAACGACGCGAGCGTGACGGGCTTCGTTCAGGTTCAGGGCGGCGGCCGGGTGCCGGTCACGGCCGATGAC
AGCGTGACCACGCCACTCGCGCTTGCGCCCGCCATCACCCTGGTGAAGGAGGTCGACACGACCGGCCTCTCCTCTCCGGC
GGCGGTGGGTGACGTGCTCGCCTACAGCTTCACCGTGACGAACGCGGGCAACGTGACGCTTACCGACGTGACCGTGACCG
ACGACAGCCTTCCGGGTCTCGTGCTGACGGGCGGGCCGATCGCGACCCTCGCGCCGGGCGACAGCGACAGCACCACCTTC
ACCGCCTCCTACAGCCTGAAGCAGGAGGATCTCGACCGCGGCTTCGTCGAGAACACCGCACTGGCGACCGGCACCTATGC
CGGGCCCGGCGGCACGCCCGCCGAAGTGACCGACAGGTCCGGGACGGACACCTCCAACGACACGCCCACCGTGGCGACCG
TGCCCCCTGCCCCGGCCATCACGCTGGTCAAGGCGGTGGATGCGAGCGGCATCTCCAGCCCCGCGGCGGTCGGCGAGCAG
CTCAGCTACAGCTTCACGGTGACGAACACCGGCAACGTGACGCTGACGGATGTGACGGTCACGGACACGAGCCTGCCGGG
CCTCGTCCTGTCGGGCGGGCCGATCACCCTCGCGCCGGGAGCGAGCGACGCTGCCACCTTCACCGCCACCTATGCGCTGA
AGCAGGCCGACATCGACCGCGGGTTTGTCGAAAACACGGCGCTCGTCACCGGGACCCATGTCGACGGGAACGGCGACAAG
ACCGAGGTCGAGGACGTCTCCGGCACCGACGCCGCGAACGACCTTCCGACCCGCAGCGACGTCGAGGCCGCGCCCGCCAT
CGCGCTGGTGAAGACCGTCGACCTCTCGGCCCTCTCGAGCCCGGTCGCGGCGGGCGACGTGCTAAGCTACGGCTTCGCCG
TGACCAACACGGGCAACGTCACGCTCACGAATGTGACCGTGACCGACGACAGCCTCGCGGATCTCGTGCTGACGGGCGGC
CCCATCGCCTCGCTCGCGCCGAACGCCACCGACAGCACGAGCTACAGCGCGAGCTACACGCTGACCCAGGCCGACATCGA
CCGCGGCTTCGTCGAGAACACGGCGCTTTCCACCGGCACCTACACCGACGGCGCAGGGGTCGAGACGGAGGTCGAGGACG
CGTCGGGCACCGACACGAGCAACGACCTGCCCACGCGCGCCGATCTCGACGCCCTGCCCTCCATCGCACTGGTCAAGACG
GTCGACGCCTCGGCGGTCTCCTCTCCGGCGGCGGTGGGCGATCTGCTCAGCTACAGCTTCACGGTGACGAACACCGGCAA
CGTGACGCTGACCGACGTGACGGTGACGGACGACAGCCTTGCCGACCTCGTGCTCGCGGGGGATCCGATCCCGACGCTCG
CGCCGGGTGCGGCGGACGCCACCACCTACACCGCGACCTATGCGCTGAAACAGGCCGACATCGACCGCGGCTACGTCGAG
AACACGGCACTTGTCACCGGCACCCACACCGATGGCGCGGGCGTCGAGACGGAGGTCGAGGATATCTCCGGCACCGAGGC
CACCAACGATACGGCGACGCGCGCCGATCTGGGGACCACTCCCTCGATCGCGCTGGTGAAGGCCGTCGATCTTTCGGCCG
TCTCCTCTCCGGCGGCGGTGGGCGACCTGCTCACCTACAGCTTCACGGTGACGAACACCGGCAACGTGACGCTGACCGAC
GTGACGGTGAGCGACGACAGCCTCGCCGATCTGATCCTCGCCGGCGACCCGATCCCGTCGCTCGCGCCGGGTGCGACCGA
TGCCACCGCCTACAGCGCCACCTATGCGCTGAAGCAGGCCGACATCGACCGCGGCTTCGTCGAGAACACCGCGCTCGTCA
CCGGCATCCACACCGATGGCGCAGGCGTCGAGACCGAGGTCGAGGACATCTCCGGCACCGAGGCCACCAACGACACGCTG
ACACGCGCCGATCTCGAGACCGCGCCCGCCCTCGCGCTGGTGAAGACTGTCGATGCTTCGGCCGTCTCCTCGCCGGCGGC
GGTGGGTGAGCTGCTGACCTACAGCTTTGCCGTGACCAACACCGGCAACGTGACCCTGACCGGCGTCACCGTGACGGACG
ACAGCCTCGCGGGTCTCGTGCTCGCGGGAAGCCCTGTCCCGACGCTCGCGCCGGGTGCGACCGATGCCACCGCCTACACC
GCGACCTATGCGCTGACGCAGGCGGACATCGACCGCGGCTTCGTCGAGAACACCGCGCTCGCCACCGGCACCTACACCGA
TGGCGCGGGGATCGAGACCGAGGTCGAGGACATCTCCGGCACCGAGGCCACCAACGACACGCCGACCCGCGCCGATCTGG
ACACCACGCCCTCCATCGCGCTGGTGAAGACGGTCGATGCTTCGGCGGTCTCCTCTCCGGCGGCGGTGGGCGATCTGCTC
AGCTACAGCTTCACGGTGACGAACACCGGCAACGTGACCCTGACCGACGTGACCCTGAACGACGACAGCCTCGCGGATCT
CGTGCTCACCGGCGGCCCGATCCCGTCGCTGGCACCGGGCGCGGCGGACGCCACGACCTACACGGCGAGCTATGCGCTGA
AACAGGCGGACATCGACCGCGGCTATGTCGAGAACACGGCGCTCGTTACCGGCACCCATACCGACGGCGCAGGGGTCGAG
ACCGAGGTCGAGGACATCTCCGGCACCGAGGCCACCAACGACACGGTGACCCGCGCCGATCTGGGCACCGCGCCGGCCAT
CGTTCTGGTCAAGACGGTCGACGCCTCGGCGGTCTCCTCGCCGGCGGCGGTGGGCGATCTGCTCAGCTACAGCTTCACCG
TGACCAACACCGGCAACGTGACGCTGACCGATGTGACCGTCACCGACGACAGCCTGCCGGGTCTCGTGCTCACCGGCGAC
CCGATCCCGTCGCTCGCACCGAATGCGACCGATGCCACCACCTACACGGCGAGCTATGCGCTGAAGCAGGCGGACATCGA
CCGCGGCTATGTCGAGAACACCGCGCTCGTCACCGGCACTCATACGGATGGCGCAGGGGTCGAGACCGAGGTCGAGGATA
TTTCCGGCACGGAGGCCACCAACGACACGCTGACGCGCGCCGATCTCGACGCCCTGCCCTCCATCGCGCTGGTCAAGGAG
GTCGATGTCTCGGCCGTCTCCTCTCCGGCAGCGGTGGGCGACCTGCTCACCTACAGCTTCACGGTGACGAACACCGGCAA
CGTGACGCTGACGGATGTCACGGTGACGGACACGAGCCTGCCGGGCCTCACCCTCACGGGCGGGACCATTGCCAGCCTCG
CTCCGAAGGCAAGCGACACCGCCACCTACACGGCGAGCTATGCGCTCACTCAGGAGGATCTCGACCGGGGCTTCGTCGAG
AATACCGCGCGTGTGACCGGCACCTATACCGACGGCACGGGCGGCGAAACCGAAGTCGAGGACATCTCCGGCACCGACGC
GGGCAATGACACTCCCACCGAAGCCCTGATCGAGCCGGCCCCGGCCCTCGCGCTGGTGAAGACGGTTGATCTCTCGGGTC
TCGGCACGCCGGCGGAAGTGGGCGAGGCGCTCACCTACAGCTTCACGGTGACCAACACCGGCAATGTGACGCTGACGGAT
GTGACCGTGACGGACACGAGCCTGCCGGGCCTCGTCCTTACCGGCAGCCCGATCGCCCGCCTCGCCCCCGGCGAGAGCGA
CAGCACCGCCTACAGCGCGCGCTATGCCCTGACGCAGGAGGATCTCGACCGCGGCTTCGTCGAGAACACGGCGCTGGCCA
CCGGCCTCCATACGGACGGCACCGGGCGGGAGACGCAGGTCGAGGATGTCTCGGGCACCGACGTCGGTCGCGACGATCCG
ACCGTGGCTCCGGTGGGGCAGGCGCCGGCCGTGGCGCTGGTCAAGGCGGTGGACGCTTCGGCCGTCTCCTCGCCGCCGGC
GGTGGGCGACCCGCTGACCTACAGCTTCACCGTGACGAACACGGGCAGCGTGACGCTGACGGACGTGACCGTCACCGACG
ACAGCCTTCCGGGCCTCGTGCTGGCGGGCAGTCCCATCCCGCGCCTTGCGCCGGGCGAGAGCGACAGCACGACCTACAGC
GCCCGCTACCTGCTGACGCAGGAGGATCTCGATCAGGGTCGGGTGTCGAACACGGCGCGCGTCACCGGCAGCTACCGGGC
GCCCGACGGCTCGGCCGACACCGTCACCGACATCTCGGGCACCGAGATCGAGAACGACGATCCGACCGACACCGAGTTCG
CGCCCGTCCCCGGCATCGCGCTCGTGAAGACGGCCGATGTCTCGGGCATCGGCAGCCCGGCGGCCATCGGCGAATTGGTC
CGCTACAGCTTCACCGTGACGAACACGGGCAACGTGACGCTCGCGGATGTGACGGTGAGCGACACGAGCCTGCCGGGCCT
CGTCCTGAGCGGCAGCCCGATCGGGCGGCTTGCTCCGGGCGAGAGCGACAGCGTGACCTACAGTGCCGCCTATGCGCTGA
CGCAGGCAGACCTCGACCGCGGCGTCATCGAGAACACGGCCCGGGCCACGGGCGCGTATCGCGGGCCGGATGGCGAACCG
GGCACGGTCGAGGACATCTCGGGCACCGAGGCGGAGAACGATGATCCGACCCTGTCGCTCGTGCCGCAGACGCCCGGGAT
CGCCCTCGTCAAGGAGGTGGCGGACGAGTCCGTCAGCACGCGCCCGGCCCTGGGCGACGAGCTTCTCTACCGCTTCACGG
TGACGAACACCGGCAACGTGACCCTCACCGACGTCACCCTGACCGACGATCTGGCGGGCGCGGTGGTCTCGGGCGGCCCC
ATCGCCGCACTGGCGCCGGGCGAGACCGACAGCACCACCTTCACGGCACGCTATGCGCTGACGGCGGCGGATCTCGAGCG
GGGGCAGGTCGCGAACACGGCCCGCGTCAGCGGGACCAATCCGGGCGATCCCGACACGCCGGTGACGGATGTCTCGGGCA
CCGAGGTGGGCAATGACACGCCGACCGTGGTCGAGCTCGACGTGCCCACGGATGTGACGGCCACCAAGACCGCCAGCCCC
GAGCGCGTGGTCATCGGCGAGACCGTCTCCTATGTGCTGGCCTTCACCAACGACGCGCCGCGCTCGATGCGCGAGGTGGT
GCTGGTCGACCGGATGCCCGACGGCCTCGTCTATACGCCCGGCAGCGCCACGCTCGACGGCACGCCTCTGGAGCCCGAAG
TCAGCGGCCGCTTCCTGCGCTGGCAGGCGGACACCCTGCCCGCGGGCGGCACGATCACCGTGCGCTTCGCCGCGCGCGTG
CTGGGGGCTGCGCCCTACGGGCCGCTCACCAACAAGACCTGGCTCCTCGACCGCACGGGCCAGCGCTCCTCGAACGTGGC
GGAGGCCGTGGTGATCCGCGAGCCCGAGCATGTGTTCGAATGCGCCGACATCATCGGGAAGGTCTTCGACGACCGGAACA
TGAACGGCTATCAGGATCCGATCGACGGCGCGGCCCACGGCCGCGGCGCCGAGGCCGAAGAGCCGGGCATCCCCGATGTG
CGTCTCGCGACGCCGAACGGGACCCTGATCCAGACCGACAAGTTCGGCCGCTTCCACGTCCCCTGCGCCGAGCTACCCGG
CCAGACCGGCGCGAACTTCACGCTGAAGCTCGACACCCGCTCCCTGCCCTCGGGCTACCGGGTGACGACCGAGAACCCGC
GCACGATCCGCGTCACGCCGGGCAAGATGGCCAAGCTGAACTTCGGCGCGGCTCTGGGCCGGGTGGTGCGGCTCGACCTG
ACGGCGGCGGCCTTCGCGGACGGCCGGCCGACCGCGGCCTTCGCCCGGGCGCTCGAGCAGACGGCGGCAAGCCTCGGCGA
TGCGCCGGTGGTGGTGCGGATCAGCACCCGGCAGGACGCCGGCGGCGCGGGCGCGGCAAAAGCGCGGCTCGATGCGGCCG
AGGCGCTGGTGCGCAAGGCCTGGAAGGGTCGGGCCGGGCCGGTGCTCATCGAACGCACGATCCAGCGGGACCAGTAA

Upstream 100 bases:

>100_bases
GACGGTGCAGATCGGAGCGATCTCGCTCGTGAAGACCGCCGATGAGAGCGGCCTCTCCTCGCCGCCGCTGGCGGGCGAGA
CCATCCGCTACAGCTTCACC

Downstream 100 bases:

>100_bases
GAGGATGACCAGAATGTTCGGAATGAACGTGCGCGCGCTCGCGGGCCTCTCGGTCTCGCTGCTGGCCCTCGGCGCAGGCA
GCGCGCTGGCGGAGGACTGC

Product: parallel beta-helix repeat-containing transcriptional regulator AraC

Products: NA

Alternate protein names: Conserved Repeat Protein; Hemagglutinin/Hemolysin-Like Protein; Conserved Repeat Domain

Number of amino acids: Translated: 2078; Mature: 2077

Protein sequence:

>2078_residues
MTNGGVAPLTDVTLTDAVPGVQVTGGPISLAGGASDTTSFTATYELTQADVDAGSFTNDASVTGFVQVQGGGRVPVTADD
SVTTPLALAPAITLVKEVDTTGLSSPAAVGDVLAYSFTVTNAGNVTLTDVTVTDDSLPGLVLTGGPIATLAPGDSDSTTF
TASYSLKQEDLDRGFVENTALATGTYAGPGGTPAEVTDRSGTDTSNDTPTVATVPPAPAITLVKAVDASGISSPAAVGEQ
LSYSFTVTNTGNVTLTDVTVTDTSLPGLVLSGGPITLAPGASDAATFTATYALKQADIDRGFVENTALVTGTHVDGNGDK
TEVEDVSGTDAANDLPTRSDVEAAPAIALVKTVDLSALSSPVAAGDVLSYGFAVTNTGNVTLTNVTVTDDSLADLVLTGG
PIASLAPNATDSTSYSASYTLTQADIDRGFVENTALSTGTYTDGAGVETEVEDASGTDTSNDLPTRADLDALPSIALVKT
VDASAVSSPAAVGDLLSYSFTVTNTGNVTLTDVTVTDDSLADLVLAGDPIPTLAPGAADATTYTATYALKQADIDRGYVE
NTALVTGTHTDGAGVETEVEDISGTEATNDTATRADLGTTPSIALVKAVDLSAVSSPAAVGDLLTYSFTVTNTGNVTLTD
VTVSDDSLADLILAGDPIPSLAPGATDATAYSATYALKQADIDRGFVENTALVTGIHTDGAGVETEVEDISGTEATNDTL
TRADLETAPALALVKTVDASAVSSPAAVGELLTYSFAVTNTGNVTLTGVTVTDDSLAGLVLAGSPVPTLAPGATDATAYT
ATYALTQADIDRGFVENTALATGTYTDGAGIETEVEDISGTEATNDTPTRADLDTTPSIALVKTVDASAVSSPAAVGDLL
SYSFTVTNTGNVTLTDVTLNDDSLADLVLTGGPIPSLAPGAADATTYTASYALKQADIDRGYVENTALVTGTHTDGAGVE
TEVEDISGTEATNDTVTRADLGTAPAIVLVKTVDASAVSSPAAVGDLLSYSFTVTNTGNVTLTDVTVTDDSLPGLVLTGD
PIPSLAPNATDATTYTASYALKQADIDRGYVENTALVTGTHTDGAGVETEVEDISGTEATNDTLTRADLDALPSIALVKE
VDVSAVSSPAAVGDLLTYSFTVTNTGNVTLTDVTVTDTSLPGLTLTGGTIASLAPKASDTATYTASYALTQEDLDRGFVE
NTARVTGTYTDGTGGETEVEDISGTDAGNDTPTEALIEPAPALALVKTVDLSGLGTPAEVGEALTYSFTVTNTGNVTLTD
VTVTDTSLPGLVLTGSPIARLAPGESDSTAYSARYALTQEDLDRGFVENTALATGLHTDGTGRETQVEDVSGTDVGRDDP
TVAPVGQAPAVALVKAVDASAVSSPPAVGDPLTYSFTVTNTGSVTLTDVTVTDDSLPGLVLAGSPIPRLAPGESDSTTYS
ARYLLTQEDLDQGRVSNTARVTGSYRAPDGSADTVTDISGTEIENDDPTDTEFAPVPGIALVKTADVSGIGSPAAIGELV
RYSFTVTNTGNVTLADVTVSDTSLPGLVLSGSPIGRLAPGESDSVTYSAAYALTQADLDRGVIENTARATGAYRGPDGEP
GTVEDISGTEAENDDPTLSLVPQTPGIALVKEVADESVSTRPALGDELLYRFTVTNTGNVTLTDVTLTDDLAGAVVSGGP
IAALAPGETDSTTFTARYALTAADLERGQVANTARVSGTNPGDPDTPVTDVSGTEVGNDTPTVVELDVPTDVTATKTASP
ERVVIGETVSYVLAFTNDAPRSMREVVLVDRMPDGLVYTPGSATLDGTPLEPEVSGRFLRWQADTLPAGGTITVRFAARV
LGAAPYGPLTNKTWLLDRTGQRSSNVAEAVVIREPEHVFECADIIGKVFDDRNMNGYQDPIDGAAHGRGAEAEEPGIPDV
RLATPNGTLIQTDKFGRFHVPCAELPGQTGANFTLKLDTRSLPSGYRVTTENPRTIRVTPGKMAKLNFGAALGRVVRLDL
TAAAFADGRPTAAFARALEQTAASLGDAPVVVRISTRQDAGGAGAAKARLDAAEALVRKAWKGRAGPVLIERTIQRDQ

Sequences:

>Translated_2078_residues
MTNGGVAPLTDVTLTDAVPGVQVTGGPISLAGGASDTTSFTATYELTQADVDAGSFTNDASVTGFVQVQGGGRVPVTADD
SVTTPLALAPAITLVKEVDTTGLSSPAAVGDVLAYSFTVTNAGNVTLTDVTVTDDSLPGLVLTGGPIATLAPGDSDSTTF
TASYSLKQEDLDRGFVENTALATGTYAGPGGTPAEVTDRSGTDTSNDTPTVATVPPAPAITLVKAVDASGISSPAAVGEQ
LSYSFTVTNTGNVTLTDVTVTDTSLPGLVLSGGPITLAPGASDAATFTATYALKQADIDRGFVENTALVTGTHVDGNGDK
TEVEDVSGTDAANDLPTRSDVEAAPAIALVKTVDLSALSSPVAAGDVLSYGFAVTNTGNVTLTNVTVTDDSLADLVLTGG
PIASLAPNATDSTSYSASYTLTQADIDRGFVENTALSTGTYTDGAGVETEVEDASGTDTSNDLPTRADLDALPSIALVKT
VDASAVSSPAAVGDLLSYSFTVTNTGNVTLTDVTVTDDSLADLVLAGDPIPTLAPGAADATTYTATYALKQADIDRGYVE
NTALVTGTHTDGAGVETEVEDISGTEATNDTATRADLGTTPSIALVKAVDLSAVSSPAAVGDLLTYSFTVTNTGNVTLTD
VTVSDDSLADLILAGDPIPSLAPGATDATAYSATYALKQADIDRGFVENTALVTGIHTDGAGVETEVEDISGTEATNDTL
TRADLETAPALALVKTVDASAVSSPAAVGELLTYSFAVTNTGNVTLTGVTVTDDSLAGLVLAGSPVPTLAPGATDATAYT
ATYALTQADIDRGFVENTALATGTYTDGAGIETEVEDISGTEATNDTPTRADLDTTPSIALVKTVDASAVSSPAAVGDLL
SYSFTVTNTGNVTLTDVTLNDDSLADLVLTGGPIPSLAPGAADATTYTASYALKQADIDRGYVENTALVTGTHTDGAGVE
TEVEDISGTEATNDTVTRADLGTAPAIVLVKTVDASAVSSPAAVGDLLSYSFTVTNTGNVTLTDVTVTDDSLPGLVLTGD
PIPSLAPNATDATTYTASYALKQADIDRGYVENTALVTGTHTDGAGVETEVEDISGTEATNDTLTRADLDALPSIALVKE
VDVSAVSSPAAVGDLLTYSFTVTNTGNVTLTDVTVTDTSLPGLTLTGGTIASLAPKASDTATYTASYALTQEDLDRGFVE
NTARVTGTYTDGTGGETEVEDISGTDAGNDTPTEALIEPAPALALVKTVDLSGLGTPAEVGEALTYSFTVTNTGNVTLTD
VTVTDTSLPGLVLTGSPIARLAPGESDSTAYSARYALTQEDLDRGFVENTALATGLHTDGTGRETQVEDVSGTDVGRDDP
TVAPVGQAPAVALVKAVDASAVSSPPAVGDPLTYSFTVTNTGSVTLTDVTVTDDSLPGLVLAGSPIPRLAPGESDSTTYS
ARYLLTQEDLDQGRVSNTARVTGSYRAPDGSADTVTDISGTEIENDDPTDTEFAPVPGIALVKTADVSGIGSPAAIGELV
RYSFTVTNTGNVTLADVTVSDTSLPGLVLSGSPIGRLAPGESDSVTYSAAYALTQADLDRGVIENTARATGAYRGPDGEP
GTVEDISGTEAENDDPTLSLVPQTPGIALVKEVADESVSTRPALGDELLYRFTVTNTGNVTLTDVTLTDDLAGAVVSGGP
IAALAPGETDSTTFTARYALTAADLERGQVANTARVSGTNPGDPDTPVTDVSGTEVGNDTPTVVELDVPTDVTATKTASP
ERVVIGETVSYVLAFTNDAPRSMREVVLVDRMPDGLVYTPGSATLDGTPLEPEVSGRFLRWQADTLPAGGTITVRFAARV
LGAAPYGPLTNKTWLLDRTGQRSSNVAEAVVIREPEHVFECADIIGKVFDDRNMNGYQDPIDGAAHGRGAEAEEPGIPDV
RLATPNGTLIQTDKFGRFHVPCAELPGQTGANFTLKLDTRSLPSGYRVTTENPRTIRVTPGKMAKLNFGAALGRVVRLDL
TAAAFADGRPTAAFARALEQTAASLGDAPVVVRISTRQDAGGAGAAKARLDAAEALVRKAWKGRAGPVLIERTIQRDQ
>Mature_2077_residues
TNGGVAPLTDVTLTDAVPGVQVTGGPISLAGGASDTTSFTATYELTQADVDAGSFTNDASVTGFVQVQGGGRVPVTADDS
VTTPLALAPAITLVKEVDTTGLSSPAAVGDVLAYSFTVTNAGNVTLTDVTVTDDSLPGLVLTGGPIATLAPGDSDSTTFT
ASYSLKQEDLDRGFVENTALATGTYAGPGGTPAEVTDRSGTDTSNDTPTVATVPPAPAITLVKAVDASGISSPAAVGEQL
SYSFTVTNTGNVTLTDVTVTDTSLPGLVLSGGPITLAPGASDAATFTATYALKQADIDRGFVENTALVTGTHVDGNGDKT
EVEDVSGTDAANDLPTRSDVEAAPAIALVKTVDLSALSSPVAAGDVLSYGFAVTNTGNVTLTNVTVTDDSLADLVLTGGP
IASLAPNATDSTSYSASYTLTQADIDRGFVENTALSTGTYTDGAGVETEVEDASGTDTSNDLPTRADLDALPSIALVKTV
DASAVSSPAAVGDLLSYSFTVTNTGNVTLTDVTVTDDSLADLVLAGDPIPTLAPGAADATTYTATYALKQADIDRGYVEN
TALVTGTHTDGAGVETEVEDISGTEATNDTATRADLGTTPSIALVKAVDLSAVSSPAAVGDLLTYSFTVTNTGNVTLTDV
TVSDDSLADLILAGDPIPSLAPGATDATAYSATYALKQADIDRGFVENTALVTGIHTDGAGVETEVEDISGTEATNDTLT
RADLETAPALALVKTVDASAVSSPAAVGELLTYSFAVTNTGNVTLTGVTVTDDSLAGLVLAGSPVPTLAPGATDATAYTA
TYALTQADIDRGFVENTALATGTYTDGAGIETEVEDISGTEATNDTPTRADLDTTPSIALVKTVDASAVSSPAAVGDLLS
YSFTVTNTGNVTLTDVTLNDDSLADLVLTGGPIPSLAPGAADATTYTASYALKQADIDRGYVENTALVTGTHTDGAGVET
EVEDISGTEATNDTVTRADLGTAPAIVLVKTVDASAVSSPAAVGDLLSYSFTVTNTGNVTLTDVTVTDDSLPGLVLTGDP
IPSLAPNATDATTYTASYALKQADIDRGYVENTALVTGTHTDGAGVETEVEDISGTEATNDTLTRADLDALPSIALVKEV
DVSAVSSPAAVGDLLTYSFTVTNTGNVTLTDVTVTDTSLPGLTLTGGTIASLAPKASDTATYTASYALTQEDLDRGFVEN
TARVTGTYTDGTGGETEVEDISGTDAGNDTPTEALIEPAPALALVKTVDLSGLGTPAEVGEALTYSFTVTNTGNVTLTDV
TVTDTSLPGLVLTGSPIARLAPGESDSTAYSARYALTQEDLDRGFVENTALATGLHTDGTGRETQVEDVSGTDVGRDDPT
VAPVGQAPAVALVKAVDASAVSSPPAVGDPLTYSFTVTNTGSVTLTDVTVTDDSLPGLVLAGSPIPRLAPGESDSTTYSA
RYLLTQEDLDQGRVSNTARVTGSYRAPDGSADTVTDISGTEIENDDPTDTEFAPVPGIALVKTADVSGIGSPAAIGELVR
YSFTVTNTGNVTLADVTVSDTSLPGLVLSGSPIGRLAPGESDSVTYSAAYALTQADLDRGVIENTARATGAYRGPDGEPG
TVEDISGTEAENDDPTLSLVPQTPGIALVKEVADESVSTRPALGDELLYRFTVTNTGNVTLTDVTLTDDLAGAVVSGGPI
AALAPGETDSTTFTARYALTAADLERGQVANTARVSGTNPGDPDTPVTDVSGTEVGNDTPTVVELDVPTDVTATKTASPE
RVVIGETVSYVLAFTNDAPRSMREVVLVDRMPDGLVYTPGSATLDGTPLEPEVSGRFLRWQADTLPAGGTITVRFAARVL
GAAPYGPLTNKTWLLDRTGQRSSNVAEAVVIREPEHVFECADIIGKVFDDRNMNGYQDPIDGAAHGRGAEAEEPGIPDVR
LATPNGTLIQTDKFGRFHVPCAELPGQTGANFTLKLDTRSLPSGYRVTTENPRTIRVTPGKMAKLNFGAALGRVVRLDLT
AAAFADGRPTAAFARALEQTAASLGDAPVVVRISTRQDAGGAGAAKARLDAAEALVRKAWKGRAGPVLIERTIQRDQ

Specific function: Unknown

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 211073; Mature: 210942

Theoretical pI: Translated: 3.76; Mature: 3.76

Prosite motif: PS00041 HTH_ARAC_FAMILY_1 ; PS00144 ASN_GLN_ASE_1

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.1 %Cys     (Translated Protein)
0.2 %Met     (Translated Protein)
0.3 %Cys+Met (Translated Protein)
0.1 %Cys     (Mature Protein)
0.2 %Met     (Mature Protein)
0.3 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTNGGVAPLTDVTLTDAVPGVQVTGGPISLAGGASDTTSFTATYELTQADVDAGSFTNDA
CCCCCCCCCCCEEECCCCCCEEECCCCEEECCCCCCCCEEEEEEEEEECCCCCCCCCCCC
SVTGFVQVQGGGRVPVTADDSVTTPLALAPAITLVKEVDTTGLSSPAAVGDVLAYSFTVT
CEEEEEEECCCCEEEEECCCCCCCCHHHHHHHHHHHHHCCCCCCCCHHHHCEEEEEEEEE
NAGNVTLTDVTVTDDSLPGLVLTGGPIATLAPGDSDSTTFTASYSLKQEDLDRGFVENTA
CCCCEEEEEEEEECCCCCEEEEECCCEEEECCCCCCCEEEEEEECCCHHHHHCCCCCCCE
LATGTYAGPGGTPAEVTDRSGTDTSNDTPTVATVPPAPAITLVKAVDASGISSPAAVGEQ
EEECCCCCCCCCCCCCCCCCCCCCCCCCCEEEECCCCCCEEEEEECCCCCCCCHHHHCCC
LSYSFTVTNTGNVTLTDVTVTDTSLPGLVLSGGPITLAPGASDAATFTATYALKQADIDR
EEEEEEEECCCCEEEEEEEEECCCCCCEEEECCCEEECCCCCCCEEEEEEEEEECCCCCC
GFVENTALVTGTHVDGNGDKTEVEDVSGTDAANDLPTRSDVEAAPAIALVKTVDLSALSS
CCCCCCEEEEEEEECCCCCCCEECCCCCCCCCCCCCCCCCCCCCCEEEEEEEECHHHHCC
PVAAGDVLSYGFAVTNTGNVTLTNVTVTDDSLADLVLTGGPIASLAPNATDSTSYSASYT
CCCCCHHHHCCEEEECCCCEEEEEEEECCCCCEEEEEECCCHHHCCCCCCCCCCCCEEEE
LTQADIDRGFVENTALSTGTYTDGAGVETEVEDASGTDTSNDLPTRADLDALPSIALVKT
EEHHHCCCCHHHCCCCCCCCCCCCCCCEEECCCCCCCCCCCCCCCCCCHHHCCCEEEEEE
VDASAVSSPAAVGDLLSYSFTVTNTGNVTLTDVTVTDDSLADLVLAGDPIPTLAPGAADA
CCHHHCCCCHHHHHHHEEEEEEECCCCEEEEEEEECCCCCEEEEEECCCCCCCCCCCCCC
TTYTATYALKQADIDRGYVENTALVTGTHTDGAGVETEVEDISGTEATNDTATRADLGTT
EEEEEEEEEECCCCCCCEECCCEEEEECCCCCCCCEEEHHHCCCCCCCCCCCCCCCCCCC
PSIALVKAVDLSAVSSPAAVGDLLTYSFTVTNTGNVTLTDVTVSDDSLADLILAGDPIPS
CCEEEEEEECHHHCCCCHHHCCEEEEEEEEECCCCEEEEEEEECCCCCEEEEEECCCCCC
LAPGATDATAYSATYALKQADIDRGFVENTALVTGIHTDGAGVETEVEDISGTEATNDTL
CCCCCCCCHHHHEEEEEECCCCCCCCCCCCEEEEEEECCCCCCEEEHHHCCCCCCCCCCE
TRADLETAPALALVKTVDASAVSSPAAVGELLTYSFAVTNTGNVTLTGVTVTDDSLAGLV
EECCCCCCCCEEEEEECCHHHCCCCHHHHHHHEEEEEEECCCCEEEEEEEEECCCCCEEE
LAGSPVPTLAPGATDATAYTATYALTQADIDRGFVENTALATGTYTDGAGIETEVEDISG
EECCCCCCCCCCCCCCCEEEEEEEEEHHHHCCCCCCCCEEEECCCCCCCCCEEEHHHCCC
TEATNDTPTRADLDTTPSIALVKTVDASAVSSPAAVGDLLSYSFTVTNTGNVTLTDVTLN
CCCCCCCCCCCCCCCCCCEEEEEECCHHHCCCCHHHHHHHEEEEEEECCCCEEEEEEEEC
DDSLADLVLTGGPIPSLAPGAADATTYTASYALKQADIDRGYVENTALVTGTHTDGAGVE
CCCCEEEEEECCCCCCCCCCCCCCEEEEHHHEEECCCCCCCEECCCEEEEECCCCCCCCE
TEVEDISGTEATNDTVTRADLGTAPAIVLVKTVDASAVSSPAAVGDLLSYSFTVTNTGNV
EEHHHCCCCCCCCCCEEECCCCCCCEEEEEEECCHHHCCCCHHHHHHHEEEEEEECCCCE
TLTDVTVTDDSLPGLVLTGDPIPSLAPNATDATTYTASYALKQADIDRGYVENTALVTGT
EEEEEEEECCCCCEEEEECCCCCCCCCCCCCCEEEEHHHEEECCCCCCCEECCCEEEEEC
HTDGAGVETEVEDISGTEATNDTLTRADLDALPSIALVKEVDVSAVSSPAAVGDLLTYSF
CCCCCCCEEEHHHCCCCCCCCCCHHHHHHHHCCCEEEEEECCHHHCCCCHHHCCEEEEEE
TVTNTGNVTLTDVTVTDTSLPGLTLTGGTIASLAPKASDTATYTASYALTQEDLDRGFVE
EEECCCCEEEEEEEEECCCCCCEEECCCCHHHCCCCCCCCEEEEEEEEECHHHHHHHHHC
NTARVTGTYTDGTGGETEVEDISGTDAGNDTPTEALIEPAPALALVKTVDLSGLGTPAEV
CCEEEEEEEECCCCCCCCHHHCCCCCCCCCCCHHHHHCCCCCEEEEEEECCCCCCCHHHH
GEALTYSFTVTNTGNVTLTDVTVTDTSLPGLVLTGSPIARLAPGESDSTAYSARYALTQE
CCEEEEEEEEECCCCEEEEEEEEECCCCCCEEEECCCHHEECCCCCCCCEEEEEEEECHH
DLDRGFVENTALATGLHTDGTGRETQVEDVSGTDVGRDDPTVAPVGQAPAVALVKAVDAS
HHHCCHHHCCEEEECCCCCCCCCCEEECCCCCCCCCCCCCCCCCCCCCCHHHHHHHHCHH
AVSSPPAVGDPLTYSFTVTNTGSVTLTDVTVTDDSLPGLVLAGSPIPRLAPGESDSTTYS
HCCCCCCCCCCEEEEEEEECCCCEEEEEEEEECCCCCCEEEECCCCCCCCCCCCCCCEEE
ARYLLTQEDLDQGRVSNTARVTGSYRAPDGSADTVTDISGTEIENDDPTDTEFAPVPGIA
EEEEEECCCCCCCCCCCEEEEEECEECCCCCCCEEECCCCCCCCCCCCCCCCCCCCCCEE
LVKTADVSGIGSPAAIGELVRYSFTVTNTGNVTLADVTVSDTSLPGLVLSGSPIGRLAPG
EEEECCCCCCCCHHHHHHHHEEEEEEECCCCEEEEEEEECCCCCCEEEECCCCCCCCCCC
ESDSVTYSAAYALTQADLDRGVIENTARATGAYRGPDGEPGTVEDISGTEAENDDPTLSL
CCCCEEEEEEEEEEHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCEEE
VPQTPGIALVKEVADESVSTRPALGDELLYRFTVTNTGNVTLTDVTLTDDLAGAVVSGGP
ECCCCCHHHHHHHHHCCCCCCCCCCCCEEEEEEEECCCCEEEEEEEECCCCCCCEECCCC
IAALAPGETDSTTFTARYALTAADLERGQVANTARVSGTNPGDPDTPVTDVSGTEVGNDT
EEEECCCCCCCCEEEEEEEEEEHHCCCCCCCCEEEECCCCCCCCCCCCCCCCCCCCCCCC
PTVVELDVPTDVTATKTASPERVVIGETVSYVLAFTNDAPRSMREVVLVDRMPDGLVYTP
CEEEEEECCCCCCCCCCCCCCEEEEECCEEEEEEECCCCCHHHHEEEEEECCCCCEEECC
GSATLDGTPLEPEVSGRFLRWQADTLPAGGTITVRFAARVLGAAPYGPLTNKTWLLDRTG
CCCCCCCCCCCCCCCCCEEEEECCCCCCCCEEEEEEEHHHHCCCCCCCCCCCEEEEECCC
QRSSNVAEAVVIREPEHVFECADIIGKVFDDRNMNGYQDPIDGAAHGRGAEAEEPGIPDV
CCCCCCEEEEEEECCHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCE
RLATPNGTLIQTDKFGRFHVPCAELPGQTGANFTLKLDTRSLPSGYRVTTENPRTIRVTP
EEECCCCCEEEECCCCEEECCHHHCCCCCCCEEEEEEECCCCCCCCEEECCCCCEEEECC
GKMAKLNFGAALGRVVRLDLTAAAFADGRPTAAFARALEQTAASLGDAPVVVRISTRQDA
CCEEEEEHHHHHCEEEEEEEEEHCCCCCCCHHHHHHHHHHHHHHCCCCCEEEEEECCCCC
GGAGAAKARLDAAEALVRKAWKGRAGPVLIERTIQRDQ
CCCCCHHHHHHHHHHHHHHHHCCCCCCEEEEEHHCCCC
>Mature Secondary Structure 
TNGGVAPLTDVTLTDAVPGVQVTGGPISLAGGASDTTSFTATYELTQADVDAGSFTNDA
CCCCCCCCCCEEECCCCCCEEECCCCEEECCCCCCCCEEEEEEEEEECCCCCCCCCCCC
SVTGFVQVQGGGRVPVTADDSVTTPLALAPAITLVKEVDTTGLSSPAAVGDVLAYSFTVT
CEEEEEEECCCCEEEEECCCCCCCCHHHHHHHHHHHHHCCCCCCCCHHHHCEEEEEEEEE
NAGNVTLTDVTVTDDSLPGLVLTGGPIATLAPGDSDSTTFTASYSLKQEDLDRGFVENTA
CCCCEEEEEEEEECCCCCEEEEECCCEEEECCCCCCCEEEEEEECCCHHHHHCCCCCCCE
LATGTYAGPGGTPAEVTDRSGTDTSNDTPTVATVPPAPAITLVKAVDASGISSPAAVGEQ
EEECCCCCCCCCCCCCCCCCCCCCCCCCCEEEECCCCCCEEEEEECCCCCCCCHHHHCCC
LSYSFTVTNTGNVTLTDVTVTDTSLPGLVLSGGPITLAPGASDAATFTATYALKQADIDR
EEEEEEEECCCCEEEEEEEEECCCCCCEEEECCCEEECCCCCCCEEEEEEEEEECCCCCC
GFVENTALVTGTHVDGNGDKTEVEDVSGTDAANDLPTRSDVEAAPAIALVKTVDLSALSS
CCCCCCEEEEEEEECCCCCCCEECCCCCCCCCCCCCCCCCCCCCCEEEEEEEECHHHHCC
PVAAGDVLSYGFAVTNTGNVTLTNVTVTDDSLADLVLTGGPIASLAPNATDSTSYSASYT
CCCCCHHHHCCEEEECCCCEEEEEEEECCCCCEEEEEECCCHHHCCCCCCCCCCCCEEEE
LTQADIDRGFVENTALSTGTYTDGAGVETEVEDASGTDTSNDLPTRADLDALPSIALVKT
EEHHHCCCCHHHCCCCCCCCCCCCCCCEEECCCCCCCCCCCCCCCCCCHHHCCCEEEEEE
VDASAVSSPAAVGDLLSYSFTVTNTGNVTLTDVTVTDDSLADLVLAGDPIPTLAPGAADA
CCHHHCCCCHHHHHHHEEEEEEECCCCEEEEEEEECCCCCEEEEEECCCCCCCCCCCCCC
TTYTATYALKQADIDRGYVENTALVTGTHTDGAGVETEVEDISGTEATNDTATRADLGTT
EEEEEEEEEECCCCCCCEECCCEEEEECCCCCCCCEEEHHHCCCCCCCCCCCCCCCCCCC
PSIALVKAVDLSAVSSPAAVGDLLTYSFTVTNTGNVTLTDVTVSDDSLADLILAGDPIPS
CCEEEEEEECHHHCCCCHHHCCEEEEEEEEECCCCEEEEEEEECCCCCEEEEEECCCCCC
LAPGATDATAYSATYALKQADIDRGFVENTALVTGIHTDGAGVETEVEDISGTEATNDTL
CCCCCCCCHHHHEEEEEECCCCCCCCCCCCEEEEEEECCCCCCEEEHHHCCCCCCCCCCE
TRADLETAPALALVKTVDASAVSSPAAVGELLTYSFAVTNTGNVTLTGVTVTDDSLAGLV
EECCCCCCCCEEEEEECCHHHCCCCHHHHHHHEEEEEEECCCCEEEEEEEEECCCCCEEE
LAGSPVPTLAPGATDATAYTATYALTQADIDRGFVENTALATGTYTDGAGIETEVEDISG
EECCCCCCCCCCCCCCCEEEEEEEEEHHHHCCCCCCCCEEEECCCCCCCCCEEEHHHCCC
TEATNDTPTRADLDTTPSIALVKTVDASAVSSPAAVGDLLSYSFTVTNTGNVTLTDVTLN
CCCCCCCCCCCCCCCCCCEEEEEECCHHHCCCCHHHHHHHEEEEEEECCCCEEEEEEEEC
DDSLADLVLTGGPIPSLAPGAADATTYTASYALKQADIDRGYVENTALVTGTHTDGAGVE
CCCCEEEEEECCCCCCCCCCCCCCEEEEHHHEEECCCCCCCEECCCEEEEECCCCCCCCE
TEVEDISGTEATNDTVTRADLGTAPAIVLVKTVDASAVSSPAAVGDLLSYSFTVTNTGNV
EEHHHCCCCCCCCCCEEECCCCCCCEEEEEEECCHHHCCCCHHHHHHHEEEEEEECCCCE
TLTDVTVTDDSLPGLVLTGDPIPSLAPNATDATTYTASYALKQADIDRGYVENTALVTGT
EEEEEEEECCCCCEEEEECCCCCCCCCCCCCCEEEEHHHEEECCCCCCCEECCCEEEEEC
HTDGAGVETEVEDISGTEATNDTLTRADLDALPSIALVKEVDVSAVSSPAAVGDLLTYSF
CCCCCCCEEEHHHCCCCCCCCCCHHHHHHHHCCCEEEEEECCHHHCCCCHHHCCEEEEEE
TVTNTGNVTLTDVTVTDTSLPGLTLTGGTIASLAPKASDTATYTASYALTQEDLDRGFVE
EEECCCCEEEEEEEEECCCCCCEEECCCCHHHCCCCCCCCEEEEEEEEECHHHHHHHHHC
NTARVTGTYTDGTGGETEVEDISGTDAGNDTPTEALIEPAPALALVKTVDLSGLGTPAEV
CCEEEEEEEECCCCCCCCHHHCCCCCCCCCCCHHHHHCCCCCEEEEEEECCCCCCCHHHH
GEALTYSFTVTNTGNVTLTDVTVTDTSLPGLVLTGSPIARLAPGESDSTAYSARYALTQE
CCEEEEEEEEECCCCEEEEEEEEECCCCCCEEEECCCHHEECCCCCCCCEEEEEEEECHH
DLDRGFVENTALATGLHTDGTGRETQVEDVSGTDVGRDDPTVAPVGQAPAVALVKAVDAS
HHHCCHHHCCEEEECCCCCCCCCCEEECCCCCCCCCCCCCCCCCCCCCCHHHHHHHHCHH
AVSSPPAVGDPLTYSFTVTNTGSVTLTDVTVTDDSLPGLVLAGSPIPRLAPGESDSTTYS
HCCCCCCCCCCEEEEEEEECCCCEEEEEEEEECCCCCCEEEECCCCCCCCCCCCCCCEEE
ARYLLTQEDLDQGRVSNTARVTGSYRAPDGSADTVTDISGTEIENDDPTDTEFAPVPGIA
EEEEEECCCCCCCCCCCEEEEEECEECCCCCCCEEECCCCCCCCCCCCCCCCCCCCCCEE
LVKTADVSGIGSPAAIGELVRYSFTVTNTGNVTLADVTVSDTSLPGLVLSGSPIGRLAPG
EEEECCCCCCCCHHHHHHHHEEEEEEECCCCEEEEEEEECCCCCCEEEECCCCCCCCCCC
ESDSVTYSAAYALTQADLDRGVIENTARATGAYRGPDGEPGTVEDISGTEAENDDPTLSL
CCCCEEEEEEEEEEHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCEEE
VPQTPGIALVKEVADESVSTRPALGDELLYRFTVTNTGNVTLTDVTLTDDLAGAVVSGGP
ECCCCCHHHHHHHHHCCCCCCCCCCCCEEEEEEEECCCCEEEEEEEECCCCCCCEECCCC
IAALAPGETDSTTFTARYALTAADLERGQVANTARVSGTNPGDPDTPVTDVSGTEVGNDT
EEEECCCCCCCCEEEEEEEEEEHHCCCCCCCCEEEECCCCCCCCCCCCCCCCCCCCCCCC
PTVVELDVPTDVTATKTASPERVVIGETVSYVLAFTNDAPRSMREVVLVDRMPDGLVYTP
CEEEEEECCCCCCCCCCCCCCEEEEECCEEEEEEECCCCCHHHHEEEEEECCCCCEEECC
GSATLDGTPLEPEVSGRFLRWQADTLPAGGTITVRFAARVLGAAPYGPLTNKTWLLDRTG
CCCCCCCCCCCCCCCCCEEEEECCCCCCCCEEEEEEEHHHHCCCCCCCCCCCEEEEECCC
QRSSNVAEAVVIREPEHVFECADIIGKVFDDRNMNGYQDPIDGAAHGRGAEAEEPGIPDV
CCCCCCEEEEEEECCHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCE
RLATPNGTLIQTDKFGRFHVPCAELPGQTGANFTLKLDTRSLPSGYRVTTENPRTIRVTP
EEECCCCCEEEECCCCEEECCHHHCCCCCCCEEEEEEECCCCCCCCEEECCCCCEEEECC
GKMAKLNFGAALGRVVRLDLTAAAFADGRPTAAFARALEQTAASLGDAPVVVRISTRQDA
CCEEEEEHHHHHCEEEEEEEEEHCCCCCCCHHHHHHHHHHHHHHCCCCCEEEEEECCCCC
GGAGAAKARLDAAEALVRKAWKGRAGPVLIERTIQRDQ
CCCCCHHHHHHHHHHHHHHHHCCCCCCEEEEEHHCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA