Definition Azoarcus sp. BH72 chromosome, complete genome.
Accession NC_008702
Length 4,376,040

Click here to switch to the map view.

The map label for this gene is 119898208

Identifier: 119898208

GI number: 119898208

Start: 2103072

End: 2105108

Strand: Reverse

Name: 119898208

Synonym: azo1917

Alternate gene names: NA

Gene position: 2105108-2103072 (Counterclockwise)

Preceding gene: 119898209

Following gene: 119898207

Centisome position: 48.11

GC content: 67.89

Gene sequence:

>2037_bases
ATGACTACCTCCGTCTCCGAACCGCTCGCCGCCGGCGGGCGAACCATGCTGCGCGTCGTCTTCTGGGCCGCCATCGCGTT
CTCCACCTTCCAGATCGTCACCTCGGCCTTCAGCCCGCTGTCCAGCACGGTGGTGCGCGCGCTGCACGTCGGCTTCCTGC
TGCTGCTCACCTTCCTGCTCTTTCCGCTGCGCGGCGGCGAGGGCAAGCCCACTCATCTGCTGACCAAGCTGATCGGCTTC
GCGGCGCTCGGCCTCGCGTGCTACCACTGGCTGTTCGAAGCCGACCTGGTGCAGCGTGCGGGCGAACTCACCACCGCCGA
CATGGCCGTCGGCATCGTCACGCTGGTGCTGGTATTCGAGGCCGCGCGCCGCATCATGGGCCTGGCGCTGCCGCTGATCT
GCCTCGGTTTTCTCGCCTACGCGCTGTTCGGCGAACACCTGCCGGGCGCGTTCGCCCATCGCGGCTACGGGCTCGATCAG
GTGATCGGCCAACTGGCCTTCGGCACCGAGGGCATCTACGGCACGCCCACCTACGTGTCGTCGAGTTACATCTTCCTGTT
CATCCTGTTCGGCGCCTTCCTGGAGCAGGCCGGGATGATCCAGCTGTTCACCGACTTCTCGCTCGGCACCGTGGGCCACA
CCAAGGGCGGCCCGGCGAAGGTGGCGGTGGTGTCGTCGGGGCTGATGGGTACGATCAACGGCTCGGGCGTCGCCAACGTG
GTCACCACCGGGCAGTTCACGATTCCGCTGATGAAGCGCTTCGGCTACCAGCCGGCCTTTGCCGGCGCGGTGGAGGCGAC
CAGCTCGATGGGCGGCCAGATCATGCCGCCGGTGATGGGCGCGGTGGCCTTCATCATGGCCGAGACCATCAACGTGCCCT
ACGTCGAGATTGCCAAGGCGGCGGCGATTCCCGCCCTGTTGTACTTCTTCACGGTGTTCTGGATGGTGCACCTCGAAGCC
GGCAAGCGCGGTCTGGTCGGCCTGCCTAAGGCGGAGTGCCCCGACCCCTGGGCTGCGCTGAAAGCGCGCTGGTTCCTGCT
GCTGCCCTTGATCGCGCTGGTGTACCTGCTGTTTGCCGGCTTTACGCCGATGTTCTCCGGCATGGTCGGCCTTGCGCTCA
CGGTGGTGCTGATCTTCGGCAGCGCGGTGGCGGGATGGCTCAACGGCACCTCGCTGCGGCTGCTGTTCTGGATCGCGCTC
GGGCTGGCGTGCTCCGCATTCGCCAAGGTCGGCATCGTCTCCGTGATGGCGGCCATCGCTGTGCTGGTCGTCCTGCTGCT
GCCCCGCCGCGACGGCCGCGCCACGCTGGCCCTCGCGGTGCGCGCGCTGGTCGATGGCGCGCTGCATGCACTGCCGGTCG
GGGTGGCGTGCGCGCTGGTCGGCGTCATCATCGGCTCGCTCACGCTCACCGGGGGCGCCACCGCCTTCGCCGGTTACATC
ATCCAGTTGGGCGGGCACAGCATGTTCCTGTCGCTGGTGCTGACGATGCTGACCTGCCTGGTGCTCGGCATGGGCATTCC
GACCATCCCGAACTACATCATCACCAGCTCGATCGCCGCCCCTGCGCTACTGGAGCTGGGCGTGCCGCTGATCGTGTCGC
ACATGTTCGTGTTCTATTTCGGGATCATGGCCGACCTGACCCCGCCGGTGGCGCTGGCCGCCTTCGCCGCCGCACCGATC
GCCAAGACGTCCGGTCTCAGGATCGGCATCCGCGCCGTGCAGATCGCCGCAGCGGGCTTCGTCGTGCCCTACATGGCGGT
GTACGCGCCGGAGTTGATGCTGCAAGGCGACAAGGGGCTGGCGGCGACGCTCTACGTGGTATTCAAGGCTGCGCTGGCCG
TCCTGCTGTGGGGCAGCACGGTGATCGGCCACTTCCGCTCGCCGATGAACCTGGTCGAACGGGCGCTCGCCTTCATCGCC
GCGGCGCTGCTGGTGATCGCGGCGCCGATCACCGATGAGCTGGGCTTCCTGCTCGCCGCCGCGGTGATCGGCGGCCACCT
GTGGCGGGCGCGCCGGATGGCACCGGTGACGCTCTGA

Upstream 100 bases:

>100_bases
CCGCTCCCGCTTCGGTCCTTCGTGAGCGCCCGCCGCGGTCTTGCCGCGCCGGCGCCCCCATTCCAGCCGCTCACTTGCAG
CGGTATTCCGCGGAGTCTCC

Downstream 100 bases:

>100_bases
TGGCGGTCTGTCTGGCGACGGCCGCGGCGACCGCGGTCGTCGCGGTCCACAGCTTCACGCTCGCCTGGACGCACTCCATC
GAAAAGCAGCGCTGGGAGGA

Product: hypothetical protein

Products: NA

Alternate protein names: Trap Transporter 4tm/12tm Fusion Protein; TRAP Transporter; TRAP-Type Transport System Fused Permease Component; TRAP-Type Transport System Permease Component; TRAP-Type Transporter 4TM/12TM Fusion Protein; TRAP-Type Transport System Permease Protein; TRAP-T Family Transporter With Fused DctQ/DctM Subunits; Inner Membrane Protein; TRAP-Type Transporter Permease Component; Permease; TRAP-Type Transport System Permease; TRAP-Type Transporter Fused Permease Components; TRAP Transporter Large Permease; TRAP Transporter 4TM/12TM Fusion Family; TRAP-Type Transporter Fused Permeases; C4-Dicarboxylate Transporter; TRAP Type Transporter Protein; TRAP-T Family Transporter Fused Inner Membrane Subunits; TRAP Transporter Transmembrane Protein; TRAP Transporter Permease; Integral Membrane Protein; Trap Family Transporter; N-Carbamoyl-L-Amino Acid Hydrolase; TRAP-Type Transporter; TRAP-Type Transport System Fused Permease Components; 4TM/12TM TRAP Transporter; TRAP Transporter Membrane-Spanning Component; TRAP-Type Transport System

Number of amino acids: Translated: 678; Mature: 677

Protein sequence:

>678_residues
MTTSVSEPLAAGGRTMLRVVFWAAIAFSTFQIVTSAFSPLSSTVVRALHVGFLLLLTFLLFPLRGGEGKPTHLLTKLIGF
AALGLACYHWLFEADLVQRAGELTTADMAVGIVTLVLVFEAARRIMGLALPLICLGFLAYALFGEHLPGAFAHRGYGLDQ
VIGQLAFGTEGIYGTPTYVSSSYIFLFILFGAFLEQAGMIQLFTDFSLGTVGHTKGGPAKVAVVSSGLMGTINGSGVANV
VTTGQFTIPLMKRFGYQPAFAGAVEATSSMGGQIMPPVMGAVAFIMAETINVPYVEIAKAAAIPALLYFFTVFWMVHLEA
GKRGLVGLPKAECPDPWAALKARWFLLLPLIALVYLLFAGFTPMFSGMVGLALTVVLIFGSAVAGWLNGTSLRLLFWIAL
GLACSAFAKVGIVSVMAAIAVLVVLLLPRRDGRATLALAVRALVDGALHALPVGVACALVGVIIGSLTLTGGATAFAGYI
IQLGGHSMFLSLVLTMLTCLVLGMGIPTIPNYIITSSIAAPALLELGVPLIVSHMFVFYFGIMADLTPPVALAAFAAAPI
AKTSGLRIGIRAVQIAAAGFVVPYMAVYAPELMLQGDKGLAATLYVVFKAALAVLLWGSTVIGHFRSPMNLVERALAFIA
AALLVIAAPITDELGFLLAAAVIGGHLWRARRMAPVTL

Sequences:

>Translated_678_residues
MTTSVSEPLAAGGRTMLRVVFWAAIAFSTFQIVTSAFSPLSSTVVRALHVGFLLLLTFLLFPLRGGEGKPTHLLTKLIGF
AALGLACYHWLFEADLVQRAGELTTADMAVGIVTLVLVFEAARRIMGLALPLICLGFLAYALFGEHLPGAFAHRGYGLDQ
VIGQLAFGTEGIYGTPTYVSSSYIFLFILFGAFLEQAGMIQLFTDFSLGTVGHTKGGPAKVAVVSSGLMGTINGSGVANV
VTTGQFTIPLMKRFGYQPAFAGAVEATSSMGGQIMPPVMGAVAFIMAETINVPYVEIAKAAAIPALLYFFTVFWMVHLEA
GKRGLVGLPKAECPDPWAALKARWFLLLPLIALVYLLFAGFTPMFSGMVGLALTVVLIFGSAVAGWLNGTSLRLLFWIAL
GLACSAFAKVGIVSVMAAIAVLVVLLLPRRDGRATLALAVRALVDGALHALPVGVACALVGVIIGSLTLTGGATAFAGYI
IQLGGHSMFLSLVLTMLTCLVLGMGIPTIPNYIITSSIAAPALLELGVPLIVSHMFVFYFGIMADLTPPVALAAFAAAPI
AKTSGLRIGIRAVQIAAAGFVVPYMAVYAPELMLQGDKGLAATLYVVFKAALAVLLWGSTVIGHFRSPMNLVERALAFIA
AALLVIAAPITDELGFLLAAAVIGGHLWRARRMAPVTL
>Mature_677_residues
TTSVSEPLAAGGRTMLRVVFWAAIAFSTFQIVTSAFSPLSSTVVRALHVGFLLLLTFLLFPLRGGEGKPTHLLTKLIGFA
ALGLACYHWLFEADLVQRAGELTTADMAVGIVTLVLVFEAARRIMGLALPLICLGFLAYALFGEHLPGAFAHRGYGLDQV
IGQLAFGTEGIYGTPTYVSSSYIFLFILFGAFLEQAGMIQLFTDFSLGTVGHTKGGPAKVAVVSSGLMGTINGSGVANVV
TTGQFTIPLMKRFGYQPAFAGAVEATSSMGGQIMPPVMGAVAFIMAETINVPYVEIAKAAAIPALLYFFTVFWMVHLEAG
KRGLVGLPKAECPDPWAALKARWFLLLPLIALVYLLFAGFTPMFSGMVGLALTVVLIFGSAVAGWLNGTSLRLLFWIALG
LACSAFAKVGIVSVMAAIAVLVVLLLPRRDGRATLALAVRALVDGALHALPVGVACALVGVIIGSLTLTGGATAFAGYII
QLGGHSMFLSLVLTMLTCLVLGMGIPTIPNYIITSSIAAPALLELGVPLIVSHMFVFYFGIMADLTPPVALAAFAAAPIA
KTSGLRIGIRAVQIAAAGFVVPYMAVYAPELMLQGDKGLAATLYVVFKAALAVLLWGSTVIGHFRSPMNLVERALAFIAA
ALLVIAAPITDELGFLLAAAVIGGHLWRARRMAPVTL

Specific function: Unknown

COG id: COG4666

COG function: function code R; TRAP-type uncharacterized transport system, fused permease components

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 71101; Mature: 70970

Theoretical pI: Translated: 9.35; Mature: 9.35

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.9 %Cys     (Translated Protein)
3.5 %Met     (Translated Protein)
4.4 %Cys+Met (Translated Protein)
0.9 %Cys     (Mature Protein)
3.4 %Met     (Mature Protein)
4.3 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTTSVSEPLAAGGRTMLRVVFWAAIAFSTFQIVTSAFSPLSSTVVRALHVGFLLLLTFLL
CCCCCCCHHHHCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
FPLRGGEGKPTHLLTKLIGFAALGLACYHWLFEADLVQRAGELTTADMAVGIVTLVLVFE
HHCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHH
AARRIMGLALPLICLGFLAYALFGEHLPGAFAHRGYGLDQVIGQLAFGTEGIYGTPTYVS
HHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHCCCCHHHHHHHHHCCCCCCCCCCCHHH
SSYIFLFILFGAFLEQAGMIQLFTDFSLGTVGHTKGGPAKVAVVSSGLMGTINGSGVANV
HHHHHHHHHHHHHHHHCCCEEEEECCCCCCCCCCCCCCEEEEEEECCCEEECCCCCCCCE
VTTGQFTIPLMKRFGYQPAFAGAVEATSSMGGQIMPPVMGAVAFIMAETINVPYVEIAKA
EECCCHHHHHHHHCCCCCCHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHCCCCHHHHHHH
AAIPALLYFFTVFWMVHLEAGKRGLVGLPKAECPDPWAALKARWFLLLPLIALVYLLFAG
HHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHC
FTPMFSGMVGLALTVVLIFGSAVAGWLNGTSLRLLFWIALGLACSAFAKVGIVSVMAAIA
HHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
VLVVLLLPRRDGRATLALAVRALVDGALHALPVGVACALVGVIIGSLTLTGGATAFAGYI
HHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHH
IQLGGHSMFLSLVLTMLTCLVLGMGIPTIPNYIITSSIAAPALLELGVPLIVSHMFVFYF
HHHCCHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHCCHHHHHHHHHHHHH
GIMADLTPPVALAAFAAAPIAKTSGLRIGIRAVQIAAAGFVVPYMAVYAPELMLQGDKGL
HHHHHCCCHHHHHHHHHCCHHHCCCCEEHHHHHHHHHHHHHHHHHHHHHHHHHEECCCCH
AATLYVVFKAALAVLLWGSTVIGHFRSPMNLVERALAFIAAALLVIAAPITDELGFLLAA
HHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHH
AVIGGHLWRARRMAPVTL
HHHHHHHHHHHCCCCCCC
>Mature Secondary Structure 
TTSVSEPLAAGGRTMLRVVFWAAIAFSTFQIVTSAFSPLSSTVVRALHVGFLLLLTFLL
CCCCCCHHHHCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
FPLRGGEGKPTHLLTKLIGFAALGLACYHWLFEADLVQRAGELTTADMAVGIVTLVLVFE
HHCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHH
AARRIMGLALPLICLGFLAYALFGEHLPGAFAHRGYGLDQVIGQLAFGTEGIYGTPTYVS
HHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHCCCCHHHHHHHHHCCCCCCCCCCCHHH
SSYIFLFILFGAFLEQAGMIQLFTDFSLGTVGHTKGGPAKVAVVSSGLMGTINGSGVANV
HHHHHHHHHHHHHHHHCCCEEEEECCCCCCCCCCCCCCEEEEEEECCCEEECCCCCCCCE
VTTGQFTIPLMKRFGYQPAFAGAVEATSSMGGQIMPPVMGAVAFIMAETINVPYVEIAKA
EECCCHHHHHHHHCCCCCCHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHCCCCHHHHHHH
AAIPALLYFFTVFWMVHLEAGKRGLVGLPKAECPDPWAALKARWFLLLPLIALVYLLFAG
HHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHC
FTPMFSGMVGLALTVVLIFGSAVAGWLNGTSLRLLFWIALGLACSAFAKVGIVSVMAAIA
HHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
VLVVLLLPRRDGRATLALAVRALVDGALHALPVGVACALVGVIIGSLTLTGGATAFAGYI
HHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHH
IQLGGHSMFLSLVLTMLTCLVLGMGIPTIPNYIITSSIAAPALLELGVPLIVSHMFVFYF
HHHCCHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHCCHHHHHHHHHHHHH
GIMADLTPPVALAAFAAAPIAKTSGLRIGIRAVQIAAAGFVVPYMAVYAPELMLQGDKGL
HHHHHCCCHHHHHHHHHCCHHHCCCCEEHHHHHHHHHHHHHHHHHHHHHHHHHEECCCCH
AATLYVVFKAALAVLLWGSTVIGHFRSPMNLVERALAFIAAALLVIAAPITDELGFLLAA
HHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHH
AVIGGHLWRARRMAPVTL
HHHHHHHHHHHCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA