Definition Rhizobium etli CIAT 652 plasmid pC, complete sequence.
Accession NC_010997
Length 1,091,523

Click here to switch to the map view.

The map label for this gene is virB4c [H]

Identifier: 190895235

GI number: 190895235

Start: 996759

End: 999125

Strand: Reverse

Name: virB4c [H]

Synonym: RHECIAT_PC0000908

Alternate gene names: 190895235

Gene position: 999125-996759 (Counterclockwise)

Preceding gene: 190895236

Following gene: 190895234

Centisome position: 91.53

GC content: 61.98

Gene sequence:

>2367_bases
TTGGCTAATATCGCGACGCTGCGGTCGCGCGAGCTCGGGCCGGAGACCTTCATCCCCTATGTCAGGCATGTCGACGAAAC
GACCATCGCGCTCGAGTCCCGAGCGTTGATGACGATGATCGCTCTCGACGGCGTTTCCTTCGAAACATCAGACATCAGGG
ACCTTAACGGCCTGCACCGCAATCTGAACACACTCTACCGCAATATCGCCGACGAGCGGCTGGCGCTCTGGACGCATGTC
GTGCGCCGCCGTGACAATGCCTATCCAGATGGCCGCTTCGCCAACGCCTTCTCCGACGGACTCAATGCCAAATACCGCCA
CCGGATGGTGCGCGAAGATCTGTTTCGCAACGATCTCTACCTGACCCTCGTCTGGCACCCCGGCCGGGATCCTGCCGAAA
GGGCGGCCAACCTTCTCTCCCGGCTGCGCAAGGCGCGCCGATCCGGTATCGAACTCGACGAACATGCCCTGAAGCATCTC
CGCGACCGCGTGGCGGACCTTGTCGCCGGCCTGCAGCGCTTCGAGCCGCGGCTGCTGAGCCTTCATGAACAGGACGGTAT
CCTGTTCTCCGAACCGAGCGAGGTTCTCCACCAGTTGGTCGGCGGCCGTCAGGAACCGATCGCGTTGACGGAGGGACGGA
TTTCCTCGGCGATCTATTCCGACCGGGTCATTTTCGGGCGCGAGACCGTCGAGATCCGTCACGAGGCCGACAGCCGTTAC
GCCGGCATGTTCGGCCTCAAGGAATATCCGGCGACCACGCGCAGCGGCATGCTCGACGCTATCCTGACCGCACCCTTCGA
ACTCATCCTGACGCAATCCTTCGCCTTCGCCTCAAAAGCCGATGCCCGCACGATCATGGGCCGCAAGCAGAACCAGATGG
TCAGCGCCGGTGACAAGGCGGCCTCGCAGATCGAGGAACTCGGCGACGCGATGGACGATCTCGAATCCAATCGCTTTGCG
CTCGGAGAGCATCATTTGGCACTTGCCGTTTTCGCGCCGTCGGTCAAGCAACTGACCGACCACATGGCGAAGGCGCGCGC
GTATCTCACCAGCGGCGGCGCGGTCGTCGCCCGCGAGGATCTCGGGCTCGAGGCTGCCTGGTGGGCGCAGCTGCCGGGCA
ATTTCCGCTATCGGGCGCGCTCGGGAGCAATCACGTCCCGCAACTTCGCAGCCCTTGCTCCCTATCATTCCTATCCCACC
GGCCAGAAGGACGGCAACGAGTGGGGACCGGCGGTCGCCATGCTGAAGACCGCATCGGGTTCGCCCTTCTATTTCAATTT
CCATCACGGCGACCTCGGCAACACCTTCGTTTGCGGCCCATCGGGTGCTGGCAAGACAGTGCTGTTGAACTTCATGCTGT
CCCAGCTCGAAAAGCACGATGCGCATATGGTCTTCTTCGACAAGGACCGCGGCGCCGATCTCTTCGTACGCGCGGCCGGC
GGCACCTATCTCCCGCTGAAGAATGGTGCTGCCACCGGCTGCGCGCCGTTGAAAGCTCTGGAACTCACTGCGGAAAACAA
GGTATTCCTCACCGGTTGGATCGCCAAGCTGGTCGGATCCGCATCCGGCGAACTATCGATCACCGAGTTGCGCGACATCG
CCTCGGCGATCGACGGGGTGGCGGACCTGCCGGTGGAGCATCGCTCCATCGGCGCCCTGCGCGCCTTCCTCAACAATACC
GATCCCGAGGGCATTGCCTCACGTCTGAGACGCTGGGAGAGGGGCGAGCAACTTGGCTGGGTCTTCGACAACGAAGCCGA
CGATATCGGCATCGGCGCCAGGTTCATCGGCTACGACATGACCGATTTCCTTGATAACGAGGAAATCCGCACGCCGTTGA
TGGCTTACCTGTTCTATCGCATCGAGCAACTGATTGACGGGCGCCGTATCATCATCGTCATCGACGAGTTTTGGAAGGCG
CTGCAGGACGAAGGTTTTCGTGATCTCGCCCAGAACAAGCTGAAGACGATCCGCAAGCAGAACGGTCTCATGCTGTTTGC
GACCCAGAGCCCGCGCGACGCCATCGTATCGCCGATCGCCCACACGATCATCGAGCAGTGCCCGACCCAGATCTTTCTGC
CGAACCCGCGCGGCGACCGGGCCGACTACGTCGACGGTTTCAAGCTGACCGAACGTGAATTCGAGCTCGTCTCGCGCGAG
CTCTCCGTCGAGAGCCGCCGGTTCATCGTCAAGCAGGGGCACAACAGCGTTGTTGCCGAATTGAACCTCAGCGGCTTCGA
CGACGAGCTCGCCATCCTCTCCGGCCGGACGGCCAATGTCGAGCTCGCCGATGCGATCCGATCGGAGATCGGCGAGGGAC
CGGAGGACTGGCTCACCGTGTTTCATCAGAGGAGGAAGACAGCATGA

Upstream 100 bases:

>100_bases
ATCGAGACCCGCGGCCGCTCGCGCAATTCCGCTTACTGGGGCGGCTCCACACTCTCGCCCCTGACGCTCACCAGGCGCTA
TGACGAACGGGATTTGAGCC

Downstream 100 bases:

>100_bases
TCCGAACAGGAACGATGCGCCCATTGTCTGTATCTGCCGCTCTTTTGGCGTCGGCGATGCTGGCATCGGCCCAGGGCATC
CCGGTCATCGATCAGACATC

Product: transport secretion system IV protein, VirB4

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 788; Mature: 787

Protein sequence:

>788_residues
MANIATLRSRELGPETFIPYVRHVDETTIALESRALMTMIALDGVSFETSDIRDLNGLHRNLNTLYRNIADERLALWTHV
VRRRDNAYPDGRFANAFSDGLNAKYRHRMVREDLFRNDLYLTLVWHPGRDPAERAANLLSRLRKARRSGIELDEHALKHL
RDRVADLVAGLQRFEPRLLSLHEQDGILFSEPSEVLHQLVGGRQEPIALTEGRISSAIYSDRVIFGRETVEIRHEADSRY
AGMFGLKEYPATTRSGMLDAILTAPFELILTQSFAFASKADARTIMGRKQNQMVSAGDKAASQIEELGDAMDDLESNRFA
LGEHHLALAVFAPSVKQLTDHMAKARAYLTSGGAVVAREDLGLEAAWWAQLPGNFRYRARSGAITSRNFAALAPYHSYPT
GQKDGNEWGPAVAMLKTASGSPFYFNFHHGDLGNTFVCGPSGAGKTVLLNFMLSQLEKHDAHMVFFDKDRGADLFVRAAG
GTYLPLKNGAATGCAPLKALELTAENKVFLTGWIAKLVGSASGELSITELRDIASAIDGVADLPVEHRSIGALRAFLNNT
DPEGIASRLRRWERGEQLGWVFDNEADDIGIGARFIGYDMTDFLDNEEIRTPLMAYLFYRIEQLIDGRRIIIVIDEFWKA
LQDEGFRDLAQNKLKTIRKQNGLMLFATQSPRDAIVSPIAHTIIEQCPTQIFLPNPRGDRADYVDGFKLTEREFELVSRE
LSVESRRFIVKQGHNSVVAELNLSGFDDELAILSGRTANVELADAIRSEIGEGPEDWLTVFHQRRKTA

Sequences:

>Translated_788_residues
MANIATLRSRELGPETFIPYVRHVDETTIALESRALMTMIALDGVSFETSDIRDLNGLHRNLNTLYRNIADERLALWTHV
VRRRDNAYPDGRFANAFSDGLNAKYRHRMVREDLFRNDLYLTLVWHPGRDPAERAANLLSRLRKARRSGIELDEHALKHL
RDRVADLVAGLQRFEPRLLSLHEQDGILFSEPSEVLHQLVGGRQEPIALTEGRISSAIYSDRVIFGRETVEIRHEADSRY
AGMFGLKEYPATTRSGMLDAILTAPFELILTQSFAFASKADARTIMGRKQNQMVSAGDKAASQIEELGDAMDDLESNRFA
LGEHHLALAVFAPSVKQLTDHMAKARAYLTSGGAVVAREDLGLEAAWWAQLPGNFRYRARSGAITSRNFAALAPYHSYPT
GQKDGNEWGPAVAMLKTASGSPFYFNFHHGDLGNTFVCGPSGAGKTVLLNFMLSQLEKHDAHMVFFDKDRGADLFVRAAG
GTYLPLKNGAATGCAPLKALELTAENKVFLTGWIAKLVGSASGELSITELRDIASAIDGVADLPVEHRSIGALRAFLNNT
DPEGIASRLRRWERGEQLGWVFDNEADDIGIGARFIGYDMTDFLDNEEIRTPLMAYLFYRIEQLIDGRRIIIVIDEFWKA
LQDEGFRDLAQNKLKTIRKQNGLMLFATQSPRDAIVSPIAHTIIEQCPTQIFLPNPRGDRADYVDGFKLTEREFELVSRE
LSVESRRFIVKQGHNSVVAELNLSGFDDELAILSGRTANVELADAIRSEIGEGPEDWLTVFHQRRKTA
>Mature_787_residues
ANIATLRSRELGPETFIPYVRHVDETTIALESRALMTMIALDGVSFETSDIRDLNGLHRNLNTLYRNIADERLALWTHVV
RRRDNAYPDGRFANAFSDGLNAKYRHRMVREDLFRNDLYLTLVWHPGRDPAERAANLLSRLRKARRSGIELDEHALKHLR
DRVADLVAGLQRFEPRLLSLHEQDGILFSEPSEVLHQLVGGRQEPIALTEGRISSAIYSDRVIFGRETVEIRHEADSRYA
GMFGLKEYPATTRSGMLDAILTAPFELILTQSFAFASKADARTIMGRKQNQMVSAGDKAASQIEELGDAMDDLESNRFAL
GEHHLALAVFAPSVKQLTDHMAKARAYLTSGGAVVAREDLGLEAAWWAQLPGNFRYRARSGAITSRNFAALAPYHSYPTG
QKDGNEWGPAVAMLKTASGSPFYFNFHHGDLGNTFVCGPSGAGKTVLLNFMLSQLEKHDAHMVFFDKDRGADLFVRAAGG
TYLPLKNGAATGCAPLKALELTAENKVFLTGWIAKLVGSASGELSITELRDIASAIDGVADLPVEHRSIGALRAFLNNTD
PEGIASRLRRWERGEQLGWVFDNEADDIGIGARFIGYDMTDFLDNEEIRTPLMAYLFYRIEQLIDGRRIIIVIDEFWKAL
QDEGFRDLAQNKLKTIRKQNGLMLFATQSPRDAIVSPIAHTIIEQCPTQIFLPNPRGDRADYVDGFKLTEREFELVSREL
SVESRRFIVKQGHNSVVAELNLSGFDDELAILSGRTANVELADAIRSEIGEGPEDWLTVFHQRRKTA

Specific function: The type IV secretion system VirB/VirD4 is a major virulence determinant for subversion of human endothelial cell (HEC) function. VirB-dependent changes of HEC include massive cytoskeletal rearrangements, a proinflammatory activation by nuclear factor NF-

COG id: COG3451

COG function: function code U; Type IV secretory pathway, VirB4 components

Gene ontology:

Cell location: Cell inner membrane (Potential) [H]

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the trbE/virB4 family [H]

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR003593
- InterPro:   IPR004346
- InterPro:   IPR018145 [H]

Pfam domain/function: PF03135 CagE_TrbE_VirB [H]

EC number: NA

Molecular weight: Translated: 88029; Mature: 87898

Theoretical pI: Translated: 6.30; Mature: 6.30

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.4 %Cys     (Translated Protein)
2.0 %Met     (Translated Protein)
2.4 %Cys+Met (Translated Protein)
0.4 %Cys     (Mature Protein)
1.9 %Met     (Mature Protein)
2.3 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MANIATLRSRELGPETFIPYVRHVDETTIALESRALMTMIALDGVSFETSDIRDLNGLHR
CCCCHHHHHCCCCCHHHHHHHHHCCCHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHH
NLNTLYRNIADERLALWTHVVRRRDNAYPDGRFANAFSDGLNAKYRHRMVREDLFRNDLY
HHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHCCCHHHHHHHHHHHHHCCCEE
LTLVWHPGRDPAERAANLLSRLRKARRSGIELDEHALKHLRDRVADLVAGLQRFEPRLLS
EEEEECCCCCHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHCCHHHH
LHEQDGILFSEPSEVLHQLVGGRQEPIALTEGRISSAIYSDRVIFGRETVEIRHEADSRY
HHCCCCEEECCHHHHHHHHHCCCCCCEEEECCHHHHHHHCCCEEECCCEEEEEECCCCCH
AGMFGLKEYPATTRSGMLDAILTAPFELILTQSFAFASKADARTIMGRKQNQMVSAGDKA
HCCCCCHHCCCCHHHHHHHHHHHCCHHHHHHHHHHHHCCCCHHHHHCCCCCHHHHCCHHH
ASQIEELGDAMDDLESNRFALGEHHLALAVFAPSVKQLTDHMAKARAYLTSGGAVVARED
HHHHHHHHHHHHHHCCCCEEECCCCEEEEEECCCHHHHHHHHHHHHHHHCCCCEEEEECC
LGLEAAWWAQLPGNFRYRARSGAITSRNFAALAPYHSYPTGQKDGNEWGPAVAMLKTASG
CCCCEEEHHHCCCCEEEEECCCCCCCCCCEEECCCCCCCCCCCCCCCCCCHHHEEEECCC
SPFYFNFHHGDLGNTFVCGPSGAGKTVLLNFMLSQLEKHDAHMVFFDKDRGADLFVRAAG
CCEEEEEECCCCCCEEEECCCCCCHHHHHHHHHHHHHHCCCEEEEEECCCCCEEEEEECC
GTYLPLKNGAATGCAPLKALELTAENKVFLTGWIAKLVGSASGELSITELRDIASAIDGV
CEEEEECCCCCCCCCHHHHEEECCCCCEEEHHHHHHHHCCCCCCEEHHHHHHHHHHHCCH
ADLPVEHRSIGALRAFLNNTDPEGIASRLRRWERGEQLGWVFDNEADDIGIGARFIGYDM
HCCCCCHHHHHHHHHHHCCCCHHHHHHHHHHHHCCCCCCEEECCCCCCCCCCHHEECCCH
TDFLDNEEIRTPLMAYLFYRIEQLIDGRRIIIVIDEFWKALQDEGFRDLAQNKLKTIRKQ
HHHCCCHHHHHHHHHHHHHHHHHHHCCCEEEEEHHHHHHHHHCCCHHHHHHHHHHHHHHC
NGLMLFATQSPRDAIVSPIAHTIIEQCPTQIFLPNPRGDRADYVDGFKLTEREFELVSRE
CCEEEEEECCCHHHHHHHHHHHHHHHCCCEEECCCCCCCCCCCCCCCHHHHHHHHHHHHH
LSVESRRFIVKQGHNSVVAELNLSGFDDELAILSGRTANVELADAIRSEIGEGPEDWLTV
HHHHHHHHHEECCCCCEEEEEECCCCCCCCCEECCCCCCCHHHHHHHHHHCCCHHHHHHH
FHQRRKTA
HHHHHCCC
>Mature Secondary Structure 
ANIATLRSRELGPETFIPYVRHVDETTIALESRALMTMIALDGVSFETSDIRDLNGLHR
CCCHHHHHCCCCCHHHHHHHHHCCCHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHH
NLNTLYRNIADERLALWTHVVRRRDNAYPDGRFANAFSDGLNAKYRHRMVREDLFRNDLY
HHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHCCCHHHHHHHHHHHHHCCCEE
LTLVWHPGRDPAERAANLLSRLRKARRSGIELDEHALKHLRDRVADLVAGLQRFEPRLLS
EEEEECCCCCHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHCCHHHH
LHEQDGILFSEPSEVLHQLVGGRQEPIALTEGRISSAIYSDRVIFGRETVEIRHEADSRY
HHCCCCEEECCHHHHHHHHHCCCCCCEEEECCHHHHHHHCCCEEECCCEEEEEECCCCCH
AGMFGLKEYPATTRSGMLDAILTAPFELILTQSFAFASKADARTIMGRKQNQMVSAGDKA
HCCCCCHHCCCCHHHHHHHHHHHCCHHHHHHHHHHHHCCCCHHHHHCCCCCHHHHCCHHH
ASQIEELGDAMDDLESNRFALGEHHLALAVFAPSVKQLTDHMAKARAYLTSGGAVVARED
HHHHHHHHHHHHHHCCCCEEECCCCEEEEEECCCHHHHHHHHHHHHHHHCCCCEEEEECC
LGLEAAWWAQLPGNFRYRARSGAITSRNFAALAPYHSYPTGQKDGNEWGPAVAMLKTASG
CCCCEEEHHHCCCCEEEEECCCCCCCCCCEEECCCCCCCCCCCCCCCCCCHHHEEEECCC
SPFYFNFHHGDLGNTFVCGPSGAGKTVLLNFMLSQLEKHDAHMVFFDKDRGADLFVRAAG
CCEEEEEECCCCCCEEEECCCCCCHHHHHHHHHHHHHHCCCEEEEEECCCCCEEEEEECC
GTYLPLKNGAATGCAPLKALELTAENKVFLTGWIAKLVGSASGELSITELRDIASAIDGV
CEEEEECCCCCCCCCHHHHEEECCCCCEEEHHHHHHHHCCCCCCEEHHHHHHHHHHHCCH
ADLPVEHRSIGALRAFLNNTDPEGIASRLRRWERGEQLGWVFDNEADDIGIGARFIGYDM
HCCCCCHHHHHHHHHHHCCCCHHHHHHHHHHHHCCCCCCEEECCCCCCCCCCHHEECCCH
TDFLDNEEIRTPLMAYLFYRIEQLIDGRRIIIVIDEFWKALQDEGFRDLAQNKLKTIRKQ
HHHCCCHHHHHHHHHHHHHHHHHHHCCCEEEEEHHHHHHHHHCCCHHHHHHHHHHHHHHC
NGLMLFATQSPRDAIVSPIAHTIIEQCPTQIFLPNPRGDRADYVDGFKLTEREFELVSRE
CCEEEEEECCCHHHHHHHHHHHHHHHCCCEEECCCCCCCCCCCCCCCHHHHHHHHHHHHH
LSVESRRFIVKQGHNSVVAELNLSGFDDELAILSGRTANVELADAIRSEIGEGPEDWLTV
HHHHHHHHHEECCCCCEEEEEECCCCCCCCCEECCCCCCCHHHHHHHHHHCCCHHHHHHH
FHQRRKTA
HHHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 10749166; 10882236; 7494028 [H]