Definition Xanthobacter autotrophicus Py2 chromosome, complete genome.
Accession NC_009720
Length 5,308,934

Click here to switch to the map view.

The map label for this gene is 154245672

Identifier: 154245672

GI number: 154245672

Start: 1941185

End: 1942390

Strand: Direct

Name: 154245672

Synonym: Xaut_1728

Alternate gene names: NA

Gene position: 1941185-1942390 (Clockwise)

Preceding gene: 154245671

Following gene: 154245673

Centisome position: 36.56

GC content: 72.06

Gene sequence:

>1206_bases
ATGTCGCGCGTTTCCTTGTGGTTCCTTTTGCCTGCGCTGCTCCTCGCAGTCGCGCTCACCGGCTGCCGTTTCGGGCTCGA
AACGCGCGATCCCTGGCGCGTGGAGGCCGAGGAGCAATGTATCGCCCAGAAGGGCGTCATTCCCTCCGCTTTCATGGAGC
CCATCCCGGCCATCGACGGGCCGGGCATGTGCGGCATGGAGCATCCCTTCCGCGTCACCGCCCTCGCCGAGGGCAATGTG
GTGCTGGAACCCGCCGGCAAGCTCGCCTGCCCGGTGATCCACCAGGTGGACATGTGGGTGCAGGACGTGGTCCAGCCCGC
CGCACTGGCTTGGTTCGGCCAGCCGGTGGTGGCGATCAGCCAGATGTCGGCCTATTCCTGCCGCGGCATGAACGGGCAGG
CCGGCGCCAAGATTTCCGAGCACGCCTTCGGCAACGCCCTGGACGTGGGCGCCTTCCGCATCGCCGACGGGCGTTGGGTC
ACCGTGAAGAACGGCTGGAAGGGCACCCAGGAGGAGCGCGGCTTCCTGCTCCAGGTGCAGGCCGGGGCCTGCGAGCGCTT
CACCACCGTGCTGGCGCCGGGCTCCAACGTCTTCCATTACGACCACATCCATGTGGACCTGATGCGCCACGAGAAGGGCC
GCACCATCTGCAAGCCGGCGCCCCGGCCCATGCCGGCGCCGCTCATCGCCAAGGCGCCGCCGATGGGCGCGCCGCAGCCC
GAGTTCGCCCCGGCCAGCGCCCCGGCGGAGGCGCCGTCCTATACCCCGGCAGTCTACACGCCCCAGCCGCAGGCCGCCCC
GCCGCCGCCCGCGCCGGAGCCGCAGCCCTCGTTCCTGTCCAACCTGTTCGGACCGCGCCCGGCCCCCGCCCCGGTGGCGG
AGCCGCCGCCGCCACCGCCGCCGGCTGCGACCCTGCAGCGGCCGGCCGGTGTCATCACCTCGTCGCCGCTGCCGCCACCG
CCATCCTCCCTGCCGCCCGCAACGGTGTCCTCGGGCCGGGCGCCGCAGCCCTATCCCGCCGCGCAGCAGCCTCCATCGCC
GCAGGGCGTGCCCCCCGGCTGGCAGGTGGGTCCGCAGGGCGTGCCCATGTCCTATGCGCCGTCCAGCAACCCCGAGACCG
GCTCGGTGAAGCGCAAGTATTACACCGCGCCGATCCCCCAGGCCTCCACCCTGCCCCTGCCCAAGGCAAAGGCGGGAGAG
GATTGA

Upstream 100 bases:

>100_bases
CGCGCGCGCCCCATCCCATCGCGGATTTCACCCCTACTTTCTCAATCGCTGCGGCGCACTTTAACCCGTTCGCAACGCAG
CCCTCGGCAAGGTGCGGCGC

Downstream 100 bases:

>100_bases
GGTGACGCCCGCCCTGCCGTTCGCCGGCATCGACGGATGCCGCGGCGGCTGGATCGTGGCGCGATGGGACGGGGCGGGCA
CCCTGCACCTGACCCGCGTC

Product: extensin family protein

Products: NA

Alternate protein names: Extensin-Like Protein; Extensin-Like; Extensin-Like Protein C-Terminus; Inner Membrane Protein; Extensin Domain Protein; Conserved Protein; Extensin Domain-Containing Protein

Number of amino acids: Translated: 401; Mature: 400

Protein sequence:

>401_residues
MSRVSLWFLLPALLLAVALTGCRFGLETRDPWRVEAEEQCIAQKGVIPSAFMEPIPAIDGPGMCGMEHPFRVTALAEGNV
VLEPAGKLACPVIHQVDMWVQDVVQPAALAWFGQPVVAISQMSAYSCRGMNGQAGAKISEHAFGNALDVGAFRIADGRWV
TVKNGWKGTQEERGFLLQVQAGACERFTTVLAPGSNVFHYDHIHVDLMRHEKGRTICKPAPRPMPAPLIAKAPPMGAPQP
EFAPASAPAEAPSYTPAVYTPQPQAAPPPPAPEPQPSFLSNLFGPRPAPAPVAEPPPPPPPAATLQRPAGVITSSPLPPP
PSSLPPATVSSGRAPQPYPAAQQPPSPQGVPPGWQVGPQGVPMSYAPSSNPETGSVKRKYYTAPIPQASTLPLPKAKAGE
D

Sequences:

>Translated_401_residues
MSRVSLWFLLPALLLAVALTGCRFGLETRDPWRVEAEEQCIAQKGVIPSAFMEPIPAIDGPGMCGMEHPFRVTALAEGNV
VLEPAGKLACPVIHQVDMWVQDVVQPAALAWFGQPVVAISQMSAYSCRGMNGQAGAKISEHAFGNALDVGAFRIADGRWV
TVKNGWKGTQEERGFLLQVQAGACERFTTVLAPGSNVFHYDHIHVDLMRHEKGRTICKPAPRPMPAPLIAKAPPMGAPQP
EFAPASAPAEAPSYTPAVYTPQPQAAPPPPAPEPQPSFLSNLFGPRPAPAPVAEPPPPPPPAATLQRPAGVITSSPLPPP
PSSLPPATVSSGRAPQPYPAAQQPPSPQGVPPGWQVGPQGVPMSYAPSSNPETGSVKRKYYTAPIPQASTLPLPKAKAGE
D
>Mature_400_residues
SRVSLWFLLPALLLAVALTGCRFGLETRDPWRVEAEEQCIAQKGVIPSAFMEPIPAIDGPGMCGMEHPFRVTALAEGNVV
LEPAGKLACPVIHQVDMWVQDVVQPAALAWFGQPVVAISQMSAYSCRGMNGQAGAKISEHAFGNALDVGAFRIADGRWVT
VKNGWKGTQEERGFLLQVQAGACERFTTVLAPGSNVFHYDHIHVDLMRHEKGRTICKPAPRPMPAPLIAKAPPMGAPQPE
FAPASAPAEAPSYTPAVYTPQPQAAPPPPAPEPQPSFLSNLFGPRPAPAPVAEPPPPPPPAATLQRPAGVITSSPLPPPP
SSLPPATVSSGRAPQPYPAAQQPPSPQGVPPGWQVGPQGVPMSYAPSSNPETGSVKRKYYTAPIPQASTLPLPKAKAGED

Specific function: Unknown

COG id: COG3921

COG function: function code S; Uncharacterized protein conserved in bacteria

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 42284; Mature: 42153

Theoretical pI: Translated: 7.79; Mature: 7.79

Prosite motif: PS00013 PROKAR_LIPOPROTEIN

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.7 %Cys     (Translated Protein)
2.7 %Met     (Translated Protein)
4.5 %Cys+Met (Translated Protein)
1.8 %Cys     (Mature Protein)
2.5 %Met     (Mature Protein)
4.2 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSRVSLWFLLPALLLAVALTGCRFGLETRDPWRVEAEEQCIAQKGVIPSAFMEPIPAIDG
CCCCHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCHHHHHHHHHCCCCHHHHCCCCCCCC
PGMCGMEHPFRVTALAEGNVVLEPAGKLACPVIHQVDMWVQDVVQPAALAWFGQPVVAIS
CCCCCCCCCEEEEEEECCCEEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHH
QMSAYSCRGMNGQAGAKISEHAFGNALDVGAFRIADGRWVTVKNGWKGTQEERGFLLQVQ
HHHHHHCCCCCCCCCCCHHHHHCCCEECCCEEEECCCEEEEECCCCCCCHHHCCEEEEEC
AGACERFTTVLAPGSNVFHYDHIHVDLMRHEKGRTICKPAPRPMPAPLIAKAPPMGAPQP
CCCCCHHEEEECCCCCEEEECEEEEEEEECCCCCCCCCCCCCCCCCCCEECCCCCCCCCC
EFAPASAPAEAPSYTPAVYTPQPQAAPPPPAPEPQPSFLSNLFGPRPAPAPVAEPPPPPP
CCCCCCCCCCCCCCCCEEECCCCCCCCCCCCCCCCHHHHHHHCCCCCCCCCCCCCCCCCC
PAATLQRPAGVITSSPLPPPPSSLPPATVSSGRAPQPYPAAQQPPSPQGVPPGWQVGPQG
CCHHHCCCCCCEECCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
VPMSYAPSSNPETGSVKRKYYTAPIPQASTLPLPKAKAGED
CCCCCCCCCCCCCCCCEEEEEECCCCCCCCCCCCCCCCCCC
>Mature Secondary Structure 
SRVSLWFLLPALLLAVALTGCRFGLETRDPWRVEAEEQCIAQKGVIPSAFMEPIPAIDG
CCCHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCHHHHHHHHHCCCCHHHHCCCCCCCC
PGMCGMEHPFRVTALAEGNVVLEPAGKLACPVIHQVDMWVQDVVQPAALAWFGQPVVAIS
CCCCCCCCCEEEEEEECCCEEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHH
QMSAYSCRGMNGQAGAKISEHAFGNALDVGAFRIADGRWVTVKNGWKGTQEERGFLLQVQ
HHHHHHCCCCCCCCCCCHHHHHCCCEECCCEEEECCCEEEEECCCCCCCHHHCCEEEEEC
AGACERFTTVLAPGSNVFHYDHIHVDLMRHEKGRTICKPAPRPMPAPLIAKAPPMGAPQP
CCCCCHHEEEECCCCCEEEECEEEEEEEECCCCCCCCCCCCCCCCCCCEECCCCCCCCCC
EFAPASAPAEAPSYTPAVYTPQPQAAPPPPAPEPQPSFLSNLFGPRPAPAPVAEPPPPPP
CCCCCCCCCCCCCCCCEEECCCCCCCCCCCCCCCCHHHHHHHCCCCCCCCCCCCCCCCCC
PAATLQRPAGVITSSPLPPPPSSLPPATVSSGRAPQPYPAAQQPPSPQGVPPGWQVGPQG
CCHHHCCCCCCEECCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
VPMSYAPSSNPETGSVKRKYYTAPIPQASTLPLPKAKAGED
CCCCCCCCCCCCCCCCEEEEEECCCCCCCCCCCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA