BRPI0614869A2 - polipeptìdeos funcionais, polipeptìdeo maduro funcional isolado, enzima, composição, método para preparar uma composição, construto de ácido nucleico, vetor de expressão recombinante, célula hospedeira recombinante, método para produzir o polipeptìdeo, meio de armazenagem, e , processo - Google Patents
polipeptìdeos funcionais, polipeptìdeo maduro funcional isolado, enzima, composição, método para preparar uma composição, construto de ácido nucleico, vetor de expressão recombinante, célula hospedeira recombinante, método para produzir o polipeptìdeo, meio de armazenagem, e , processo Download PDFInfo
- Publication number
- BRPI0614869A2 BRPI0614869A2 BRPI0614869-7A BRPI0614869A BRPI0614869A2 BR PI0614869 A2 BRPI0614869 A2 BR PI0614869A2 BR PI0614869 A BRPI0614869 A BR PI0614869A BR PI0614869 A2 BRPI0614869 A2 BR PI0614869A2
- Authority
- BR
- Brazil
- Prior art keywords
- seq
- polypeptide
- glu
- gly
- bacillus
- Prior art date
Links
- 108090000765 processed proteins & peptides Proteins 0.000 title claims abstract description 250
- 229920001184 polypeptide Polymers 0.000 title claims abstract description 241
- 102000004196 processed proteins & peptides Human genes 0.000 title claims abstract description 240
- 102000004190 Enzymes Human genes 0.000 title claims description 106
- 108090000790 Enzymes Proteins 0.000 title claims description 106
- 238000000034 method Methods 0.000 title claims description 78
- 239000000203 mixture Substances 0.000 title claims description 73
- 238000004519 manufacturing process Methods 0.000 title claims description 17
- 239000013604 expression vector Substances 0.000 title claims description 11
- 102000039446 nucleic acids Human genes 0.000 title claims description 11
- 108020004707 nucleic acids Proteins 0.000 title claims description 11
- 150000007523 nucleic acids Chemical class 0.000 title claims description 11
- 230000008569 process Effects 0.000 title claims description 9
- 238000003259 recombinant expression Methods 0.000 title claims description 9
- 238000003860 storage Methods 0.000 title claims description 9
- 241000194110 Bacillus sp. (in: Bacteria) Species 0.000 claims abstract description 72
- 241000894006 Bacteria Species 0.000 claims abstract description 5
- 125000003729 nucleotide group Chemical group 0.000 claims description 123
- 239000002773 nucleotide Substances 0.000 claims description 122
- 108090000623 proteins and genes Proteins 0.000 claims description 102
- 108090000209 Carbonic anhydrases Proteins 0.000 claims description 64
- 102000003846 Carbonic anhydrases Human genes 0.000 claims description 64
- 108091033319 polynucleotide Proteins 0.000 claims description 52
- 102000040430 polynucleotide Human genes 0.000 claims description 52
- 239000002157 polynucleotide Substances 0.000 claims description 52
- 239000000523 sample Substances 0.000 claims description 39
- 125000003275 alpha amino acid group Chemical group 0.000 claims description 34
- 102000012479 Serine Proteases Human genes 0.000 claims description 30
- 108010022999 Serine Proteases Proteins 0.000 claims description 30
- 239000003599 detergent Substances 0.000 claims description 30
- 101710152845 Arabinogalactan endo-beta-1,4-galactanase Proteins 0.000 claims description 27
- 101710121765 Endo-1,4-beta-xylanase Proteins 0.000 claims description 27
- 101710147028 Endo-beta-1,4-galactanase Proteins 0.000 claims description 27
- FWMNVWWHGCHHJJ-SKKKGAJSSA-N 4-amino-1-[(2r)-6-amino-2-[[(2r)-2-[[(2r)-2-[[(2r)-2-amino-3-phenylpropanoyl]amino]-3-phenylpropanoyl]amino]-4-methylpentanoyl]amino]hexanoyl]piperidine-4-carboxylic acid Chemical compound C([C@H](C(=O)N[C@H](CC(C)C)C(=O)N[C@H](CCCCN)C(=O)N1CCC(N)(CC1)C(O)=O)NC(=O)[C@H](N)CC=1C=CC=CC=1)C1=CC=CC=C1 FWMNVWWHGCHHJJ-SKKKGAJSSA-N 0.000 claims description 24
- 241000193830 Bacillus <bacterium> Species 0.000 claims description 23
- 230000000295 complement effect Effects 0.000 claims description 17
- 239000012634 fragment Substances 0.000 claims description 16
- 239000002299 complementary DNA Substances 0.000 claims description 12
- 102000004317 Lyases Human genes 0.000 claims description 11
- 108090000856 Lyases Proteins 0.000 claims description 11
- 230000003248 secreting effect Effects 0.000 claims description 11
- 239000000546 pharmaceutical excipient Substances 0.000 claims description 6
- 230000007850 degeneration Effects 0.000 claims description 4
- 230000002068 genetic effect Effects 0.000 claims description 4
- 150000004676 glycans Chemical class 0.000 claims description 4
- 235000011868 grain product Nutrition 0.000 claims description 4
- 229920001282 polysaccharide Polymers 0.000 claims description 4
- 239000005017 polysaccharide Substances 0.000 claims description 4
- 239000004094 surface-active agent Substances 0.000 claims description 4
- 238000012258 culturing Methods 0.000 claims description 3
- 235000013305 food Nutrition 0.000 claims description 3
- 241000428714 Bacillus plakortidis Species 0.000 abstract description 4
- 210000004027 cell Anatomy 0.000 description 130
- 229940088598 enzyme Drugs 0.000 description 87
- 241000196324 Embryophyta Species 0.000 description 52
- 108020004414 DNA Proteins 0.000 description 42
- 241000282326 Felis catus Species 0.000 description 38
- 239000013598 vector Substances 0.000 description 38
- 235000001014 amino acid Nutrition 0.000 description 32
- 230000014509 gene expression Effects 0.000 description 32
- 239000013612 plasmid Substances 0.000 description 30
- 102000004169 proteins and genes Human genes 0.000 description 30
- 229940024606 amino acid Drugs 0.000 description 29
- 150000001413 amino acids Chemical class 0.000 description 28
- WHUUTDBJXJRKMK-UHFFFAOYSA-N Glutamic acid Natural products OC(=O)C(N)CCC(O)=O WHUUTDBJXJRKMK-UHFFFAOYSA-N 0.000 description 27
- 230000000694 effects Effects 0.000 description 27
- 235000018102 proteins Nutrition 0.000 description 27
- -1 aromatic amino acids Chemical class 0.000 description 24
- 108090000204 Dipeptidase 1 Proteins 0.000 description 22
- DHMQDGOQFOQNFH-UHFFFAOYSA-N Glycine Chemical compound NCC(O)=O DHMQDGOQFOQNFH-UHFFFAOYSA-N 0.000 description 22
- 230000006870 function Effects 0.000 description 22
- 239000002609 medium Substances 0.000 description 22
- WHUUTDBJXJRKMK-VKHMYHEASA-N L-glutamic acid Chemical compound OC(=O)[C@@H](N)CCC(O)=O WHUUTDBJXJRKMK-VKHMYHEASA-N 0.000 description 19
- 240000004808 Saccharomyces cerevisiae Species 0.000 description 19
- 235000014680 Saccharomyces cerevisiae Nutrition 0.000 description 19
- 102000006635 beta-lactamase Human genes 0.000 description 18
- 239000000872 buffer Substances 0.000 description 17
- 239000003999 initiator Substances 0.000 description 17
- LFQSCWFLJHTTHZ-UHFFFAOYSA-N Ethanol Chemical compound CCO LFQSCWFLJHTTHZ-UHFFFAOYSA-N 0.000 description 16
- AYFVYJQAPQTCCC-GBXIJSLDSA-N L-threonine Chemical compound C[C@@H](O)[C@H](N)C(O)=O AYFVYJQAPQTCCC-GBXIJSLDSA-N 0.000 description 16
- 108091028043 Nucleic acid sequence Proteins 0.000 description 16
- 241000588724 Escherichia coli Species 0.000 description 15
- 230000002538 fungal effect Effects 0.000 description 15
- MTCFGRXMJLQNBG-REOHCLBHSA-N (2S)-2-Amino-3-hydroxypropansäure Chemical compound OC[C@H](N)C(O)=O MTCFGRXMJLQNBG-REOHCLBHSA-N 0.000 description 14
- AVKUERGKIZMTKX-NJBDSQKTSA-N ampicillin Chemical compound C1([C@@H](N)C(=O)N[C@H]2[C@H]3SC([C@@H](N3C2=O)C(O)=O)(C)C)=CC=CC=C1 AVKUERGKIZMTKX-NJBDSQKTSA-N 0.000 description 14
- 229960000723 ampicillin Drugs 0.000 description 14
- 244000005700 microbiome Species 0.000 description 14
- 238000003752 polymerase chain reaction Methods 0.000 description 13
- 238000006467 substitution reaction Methods 0.000 description 13
- 235000014469 Bacillus subtilis Nutrition 0.000 description 12
- FAPWRFPIFSIZLT-UHFFFAOYSA-M Sodium chloride Chemical compound [Na+].[Cl-] FAPWRFPIFSIZLT-UHFFFAOYSA-M 0.000 description 12
- 230000001580 bacterial effect Effects 0.000 description 12
- 239000000047 product Substances 0.000 description 12
- 230000010076 replication Effects 0.000 description 12
- 239000000463 material Substances 0.000 description 11
- 230000009466 transformation Effects 0.000 description 11
- 244000063299 Bacillus subtilis Species 0.000 description 10
- 108010084185 Cellulases Proteins 0.000 description 10
- 102000005575 Cellulases Human genes 0.000 description 10
- DCXYFEDJOCDNAF-REOHCLBHSA-N L-asparagine Chemical compound OC(=O)[C@@H](N)CC(N)=O DCXYFEDJOCDNAF-REOHCLBHSA-N 0.000 description 10
- ZDXPYRJPNDTMRX-VKHMYHEASA-N L-glutamine Chemical compound OC(=O)[C@@H](N)CCC(N)=O ZDXPYRJPNDTMRX-VKHMYHEASA-N 0.000 description 10
- 108090001060 Lipase Proteins 0.000 description 10
- 102000004882 Lipase Human genes 0.000 description 10
- KDXKERNSBIXSRK-UHFFFAOYSA-N Lysine Natural products NCCCCC(N)C(O)=O KDXKERNSBIXSRK-UHFFFAOYSA-N 0.000 description 10
- 102000035195 Peptidases Human genes 0.000 description 10
- 108091005804 Peptidases Proteins 0.000 description 10
- 239000000654 additive Substances 0.000 description 10
- 108010069205 aspartyl-phenylalanine Proteins 0.000 description 10
- 239000007788 liquid Substances 0.000 description 10
- 238000002360 preparation method Methods 0.000 description 10
- 239000013615 primer Substances 0.000 description 10
- 241000894007 species Species 0.000 description 10
- 230000009261 transgenic effect Effects 0.000 description 10
- 241000233866 Fungi Species 0.000 description 9
- KDXKERNSBIXSRK-YFKPBYRVSA-N L-lysine Chemical compound NCCCC[C@H](N)C(O)=O KDXKERNSBIXSRK-YFKPBYRVSA-N 0.000 description 9
- 239000004367 Lipase Substances 0.000 description 9
- 235000019421 lipase Nutrition 0.000 description 9
- 241000223218 Fusarium Species 0.000 description 8
- 241000880493 Leptailurus serval Species 0.000 description 8
- 241001465754 Metazoa Species 0.000 description 8
- 239000004365 Protease Substances 0.000 description 8
- 230000000996 additive effect Effects 0.000 description 8
- 235000019441 ethanol Nutrition 0.000 description 8
- 239000008187 granular material Substances 0.000 description 8
- 238000009396 hybridization Methods 0.000 description 8
- 238000000746 purification Methods 0.000 description 8
- UHPMCKVQTMMPCG-UHFFFAOYSA-N 5,8-dihydroxy-2-methoxy-6-methyl-7-(2-oxopropyl)naphthalene-1,4-dione Chemical compound CC1=C(CC(C)=O)C(O)=C2C(=O)C(OC)=CC(=O)C2=C1O UHPMCKVQTMMPCG-UHFFFAOYSA-N 0.000 description 7
- 108010065511 Amylases Proteins 0.000 description 7
- 102000013142 Amylases Human genes 0.000 description 7
- 125000003412 L-alanyl group Chemical group [H]N([H])[C@@](C([H])([H])[H])(C(=O)[*])[H] 0.000 description 7
- CKLJMWTZIZZHCS-REOHCLBHSA-N L-aspartic acid Chemical compound OC(=O)[C@@H](N)CC(O)=O CKLJMWTZIZZHCS-REOHCLBHSA-N 0.000 description 7
- AGPKZVBTJJNPAG-WHFBIAKZSA-N L-isoleucine Chemical compound CC[C@H](C)[C@H](N)C(O)=O AGPKZVBTJJNPAG-WHFBIAKZSA-N 0.000 description 7
- 102000003992 Peroxidases Human genes 0.000 description 7
- 108010076504 Protein Sorting Signals Proteins 0.000 description 7
- 235000019418 amylase Nutrition 0.000 description 7
- 239000000499 gel Substances 0.000 description 7
- 239000003550 marker Substances 0.000 description 7
- 229920000936 Agarose Polymers 0.000 description 6
- 241000194108 Bacillus licheniformis Species 0.000 description 6
- SJPMNHCEWPTRBR-BQBZGAKWSA-N Glu-Glu-Gly Chemical compound OC(=O)CC[C@H](N)C(=O)N[C@@H](CCC(O)=O)C(=O)NCC(O)=O SJPMNHCEWPTRBR-BQBZGAKWSA-N 0.000 description 6
- PEDCQBHIVMGVHV-UHFFFAOYSA-N Glycerine Chemical compound OCC(O)CO PEDCQBHIVMGVHV-UHFFFAOYSA-N 0.000 description 6
- ROHFNLRQFUQHCH-YFKPBYRVSA-N L-leucine Chemical compound CC(C)C[C@H](N)C(O)=O ROHFNLRQFUQHCH-YFKPBYRVSA-N 0.000 description 6
- OUYCCCASQSFEME-QMMMGPOBSA-N L-tyrosine Chemical compound OC(=O)[C@@H](N)CC1=CC=C(O)C=C1 OUYCCCASQSFEME-QMMMGPOBSA-N 0.000 description 6
- YBAFDPFAUTYYRW-UHFFFAOYSA-N N-L-alpha-glutamyl-L-leucine Natural products CC(C)CC(C(O)=O)NC(=O)C(N)CCC(O)=O YBAFDPFAUTYYRW-UHFFFAOYSA-N 0.000 description 6
- SITLTJHOQZFJGG-UHFFFAOYSA-N N-L-alpha-glutamyl-L-valine Natural products CC(C)C(C(O)=O)NC(=O)C(N)CCC(O)=O SITLTJHOQZFJGG-UHFFFAOYSA-N 0.000 description 6
- 108010002311 N-glycylglutamic acid Proteins 0.000 description 6
- DNIAPMSPPWPWGF-UHFFFAOYSA-N Propylene glycol Chemical compound CC(O)CO DNIAPMSPPWPWGF-UHFFFAOYSA-N 0.000 description 6
- 238000004458 analytical method Methods 0.000 description 6
- 108010038633 aspartylglutamate Proteins 0.000 description 6
- 229960005091 chloramphenicol Drugs 0.000 description 6
- WIIZWVCIJKGZOK-RKDXNWHRSA-N chloramphenicol Chemical compound ClC(Cl)C(=O)N[C@H](CO)[C@H](O)C1=CC=C([N+]([O-])=O)C=C1 WIIZWVCIJKGZOK-RKDXNWHRSA-N 0.000 description 6
- 238000010367 cloning Methods 0.000 description 6
- 239000000194 fatty acid Substances 0.000 description 6
- 230000004927 fusion Effects 0.000 description 6
- 108010089804 glycyl-threonine Proteins 0.000 description 6
- 238000002744 homologous recombination Methods 0.000 description 6
- 230000006801 homologous recombination Effects 0.000 description 6
- 230000010354 integration Effects 0.000 description 6
- 239000011780 sodium chloride Substances 0.000 description 6
- 239000000243 solution Substances 0.000 description 6
- 239000000758 substrate Substances 0.000 description 6
- 210000001519 tissue Anatomy 0.000 description 6
- 108091026890 Coding region Proteins 0.000 description 5
- COLNVLDHVKWLRT-QMMMGPOBSA-N L-phenylalanine Chemical compound OC(=O)[C@@H](N)CC1=CC=CC=C1 COLNVLDHVKWLRT-QMMMGPOBSA-N 0.000 description 5
- 241000209510 Liliopsida Species 0.000 description 5
- 240000007594 Oryza sativa Species 0.000 description 5
- 235000007164 Oryza sativa Nutrition 0.000 description 5
- 102000004316 Oxidoreductases Human genes 0.000 description 5
- 108090000854 Oxidoreductases Proteins 0.000 description 5
- 108700020962 Peroxidase Proteins 0.000 description 5
- 108010056079 Subtilisins Proteins 0.000 description 5
- 102000005158 Subtilisins Human genes 0.000 description 5
- KZSNJWFQEVHDMF-UHFFFAOYSA-N Valine Natural products CC(C)C(N)C(O)=O KZSNJWFQEVHDMF-UHFFFAOYSA-N 0.000 description 5
- 229940025131 amylases Drugs 0.000 description 5
- 101150049515 bla gene Proteins 0.000 description 5
- 239000007844 bleaching agent Substances 0.000 description 5
- 229910052799 carbon Inorganic materials 0.000 description 5
- 239000005018 casein Substances 0.000 description 5
- 239000013592 cell lysate Substances 0.000 description 5
- 238000006243 chemical reaction Methods 0.000 description 5
- 239000012531 culture fluid Substances 0.000 description 5
- 238000012217 deletion Methods 0.000 description 5
- 230000037430 deletion Effects 0.000 description 5
- 235000014113 dietary fatty acids Nutrition 0.000 description 5
- 230000002255 enzymatic effect Effects 0.000 description 5
- 229930195729 fatty acid Natural products 0.000 description 5
- 125000001475 halogen functional group Chemical group 0.000 description 5
- 230000005764 inhibitory process Effects 0.000 description 5
- 238000003780 insertion Methods 0.000 description 5
- 230000037431 insertion Effects 0.000 description 5
- 238000012986 modification Methods 0.000 description 5
- 230000004048 modification Effects 0.000 description 5
- 230000037039 plant physiology Effects 0.000 description 5
- 108010079317 prolyl-tyrosine Proteins 0.000 description 5
- 238000011160 research Methods 0.000 description 5
- 235000009566 rice Nutrition 0.000 description 5
- 230000002194 synthesizing effect Effects 0.000 description 5
- 108010061238 threonyl-glycine Proteins 0.000 description 5
- XLYOFNOQVPJJNP-UHFFFAOYSA-N water Substances O XLYOFNOQVPJJNP-UHFFFAOYSA-N 0.000 description 5
- 241001328119 Bacillus gibsonii Species 0.000 description 4
- OKTJSMMVPCPJKN-UHFFFAOYSA-N Carbon Chemical compound [C] OKTJSMMVPCPJKN-UHFFFAOYSA-N 0.000 description 4
- 238000001712 DNA sequencing Methods 0.000 description 4
- 108700008625 Reporter Genes Proteins 0.000 description 4
- 244000061456 Solanum tuberosum Species 0.000 description 4
- 235000002595 Solanum tuberosum Nutrition 0.000 description 4
- 238000002105 Southern blotting Methods 0.000 description 4
- BBPCSGKKPJUYRB-UVOCVTCTSA-N Thr-Thr-Leu Chemical compound [H]N[C@@H]([C@@H](C)O)C(=O)N[C@@H]([C@@H](C)O)C(=O)N[C@@H](CC(C)C)C(O)=O BBPCSGKKPJUYRB-UVOCVTCTSA-N 0.000 description 4
- 239000007983 Tris buffer Substances 0.000 description 4
- JXGWQYWDUOWQHA-DZKIICNBSA-N Val-Gln-Phe Chemical compound CC(C)[C@@H](C(=O)N[C@@H](CCC(=O)N)C(=O)N[C@@H](CC1=CC=CC=C1)C(=O)O)N JXGWQYWDUOWQHA-DZKIICNBSA-N 0.000 description 4
- BZKPWHYZMXOIDC-UHFFFAOYSA-N acetazolamide Chemical compound CC(=O)NC1=NN=C(S(N)(=O)=O)S1 BZKPWHYZMXOIDC-UHFFFAOYSA-N 0.000 description 4
- 229960000571 acetazolamide Drugs 0.000 description 4
- 108090000637 alpha-Amylases Proteins 0.000 description 4
- KOSRFJWDECSPRO-UHFFFAOYSA-N alpha-L-glutamyl-L-glutamic acid Natural products OC(=O)CCC(N)C(=O)NC(CCC(O)=O)C(O)=O KOSRFJWDECSPRO-UHFFFAOYSA-N 0.000 description 4
- 108010068265 aspartyltyrosine Proteins 0.000 description 4
- 238000003556 assay Methods 0.000 description 4
- 230000027455 binding Effects 0.000 description 4
- 238000010276 construction Methods 0.000 description 4
- 150000004665 fatty acids Chemical class 0.000 description 4
- 108010063718 gamma-glutamylaspartic acid Proteins 0.000 description 4
- 108010055341 glutamyl-glutamic acid Proteins 0.000 description 4
- 230000001939 inductive effect Effects 0.000 description 4
- 150000002500 ions Chemical class 0.000 description 4
- JVTAAEKCZFNVCJ-UHFFFAOYSA-N lactic acid Chemical compound CC(O)C(O)=O JVTAAEKCZFNVCJ-UHFFFAOYSA-N 0.000 description 4
- 239000011159 matrix material Substances 0.000 description 4
- 230000035772 mutation Effects 0.000 description 4
- 235000015097 nutrients Nutrition 0.000 description 4
- 229920001223 polyethylene glycol Polymers 0.000 description 4
- 229920000642 polymer Polymers 0.000 description 4
- 210000001938 protoplast Anatomy 0.000 description 4
- 238000012163 sequencing technique Methods 0.000 description 4
- 239000011734 sodium Substances 0.000 description 4
- LENZDBCJOHFCAS-UHFFFAOYSA-N tris Chemical compound OCC(N)(CO)CO LENZDBCJOHFCAS-UHFFFAOYSA-N 0.000 description 4
- 108091032973 (ribonucleotides)n+m Proteins 0.000 description 3
- OZRFYUJEXYKQDV-UHFFFAOYSA-N 2-[[2-[[2-[(2-amino-3-carboxypropanoyl)amino]-3-carboxypropanoyl]amino]-3-carboxypropanoyl]amino]butanedioic acid Chemical compound OC(=O)CC(N)C(=O)NC(CC(O)=O)C(=O)NC(CC(O)=O)C(=O)NC(CC(O)=O)C(O)=O OZRFYUJEXYKQDV-UHFFFAOYSA-N 0.000 description 3
- QKNYBSVHEMOAJP-UHFFFAOYSA-N 2-amino-2-(hydroxymethyl)propane-1,3-diol;hydron;chloride Chemical compound Cl.OCC(N)(CO)CO QKNYBSVHEMOAJP-UHFFFAOYSA-N 0.000 description 3
- HZYFHQOWCFUSOV-IMJSIDKUSA-N Asn-Asp Chemical compound NC(=O)C[C@H](N)C(=O)N[C@@H](CC(O)=O)C(O)=O HZYFHQOWCFUSOV-IMJSIDKUSA-N 0.000 description 3
- GADKFYNESXNRLC-WDSKDSINSA-N Asn-Pro Chemical compound NC(=O)C[C@H](N)C(=O)N1CCC[C@H]1C(O)=O GADKFYNESXNRLC-WDSKDSINSA-N 0.000 description 3
- YZQCXOFQZKCETR-UWVGGRQHSA-N Asp-Phe Chemical compound OC(=O)C[C@H](N)C(=O)N[C@H](C(O)=O)CC1=CC=CC=C1 YZQCXOFQZKCETR-UWVGGRQHSA-N 0.000 description 3
- 241000228212 Aspergillus Species 0.000 description 3
- 241001328122 Bacillus clausii Species 0.000 description 3
- 108010059892 Cellulase Proteins 0.000 description 3
- 108020004635 Complementary DNA Proteins 0.000 description 3
- 241000206602 Eukaryota Species 0.000 description 3
- 241000193385 Geobacillus stearothermophilus Species 0.000 description 3
- TUTIHHSZKFBMHM-WHFBIAKZSA-N Glu-Asn Chemical compound OC(=O)CC[C@H](N)C(=O)N[C@@H](CC(N)=O)C(O)=O TUTIHHSZKFBMHM-WHFBIAKZSA-N 0.000 description 3
- IRXNJYPKBVERCW-DCAQKATOSA-N Glu-Leu-Glu Chemical compound [H]N[C@@H](CCC(O)=O)C(=O)N[C@@H](CC(C)C)C(=O)N[C@@H](CCC(O)=O)C(O)=O IRXNJYPKBVERCW-DCAQKATOSA-N 0.000 description 3
- YQAQQKPWFOBSMU-WDCWCFNPSA-N Glu-Thr-Leu Chemical compound [H]N[C@@H](CCC(O)=O)C(=O)N[C@@H]([C@@H](C)O)C(=O)N[C@@H](CC(C)C)C(O)=O YQAQQKPWFOBSMU-WDCWCFNPSA-N 0.000 description 3
- OLIFSFOFKGKIRH-WUJLRWPWSA-N Gly-Thr Chemical compound C[C@@H](O)[C@@H](C(O)=O)NC(=O)CN OLIFSFOFKGKIRH-WUJLRWPWSA-N 0.000 description 3
- 241000223198 Humicola Species 0.000 description 3
- 241001480714 Humicola insolens Species 0.000 description 3
- 125000000570 L-alpha-aspartyl group Chemical group [H]OC(=O)C([H])([H])[C@]([H])(N([H])[H])C(*)=O 0.000 description 3
- CSFVADKICPDRRF-KKUMJFAQSA-N Leu-His-Leu Chemical compound CC(C)C[C@H]([NH3+])C(=O)N[C@H](C(=O)N[C@@H](CC(C)C)C([O-])=O)CC1=CN=CN1 CSFVADKICPDRRF-KKUMJFAQSA-N 0.000 description 3
- XMBSYZWANAQXEV-UHFFFAOYSA-N N-alpha-L-glutamyl-L-phenylalanine Natural products OC(=O)CCC(N)C(=O)NC(C(O)=O)CC1=CC=CC=C1 XMBSYZWANAQXEV-UHFFFAOYSA-N 0.000 description 3
- 241000223259 Trichoderma Species 0.000 description 3
- STTYIMSDIYISRG-UHFFFAOYSA-N Valyl-Serine Chemical compound CC(C)C(N)C(=O)NC(CO)C(O)=O STTYIMSDIYISRG-UHFFFAOYSA-N 0.000 description 3
- 108010048241 acetamidase Proteins 0.000 description 3
- 108010005233 alanylglutamic acid Proteins 0.000 description 3
- 108010047495 alanylglycine Proteins 0.000 description 3
- 125000000217 alkyl group Chemical group 0.000 description 3
- 102000004139 alpha-Amylases Human genes 0.000 description 3
- 125000000539 amino acid group Chemical group 0.000 description 3
- 230000003321 amplification Effects 0.000 description 3
- 238000013459 approach Methods 0.000 description 3
- 239000012736 aqueous medium Substances 0.000 description 3
- 108010062796 arginyllysine Proteins 0.000 description 3
- 108010077245 asparaginyl-proline Proteins 0.000 description 3
- 150000001540 azides Chemical class 0.000 description 3
- 239000011230 binding agent Substances 0.000 description 3
- 230000003115 biocidal effect Effects 0.000 description 3
- 230000015572 biosynthetic process Effects 0.000 description 3
- KGBXLFKZBHKPEV-UHFFFAOYSA-N boric acid Chemical compound OB(O)O KGBXLFKZBHKPEV-UHFFFAOYSA-N 0.000 description 3
- 210000000170 cell membrane Anatomy 0.000 description 3
- 229940106157 cellulase Drugs 0.000 description 3
- 239000001913 cellulose Substances 0.000 description 3
- 229920002678 cellulose Polymers 0.000 description 3
- 230000008859 change Effects 0.000 description 3
- 238000012512 characterization method Methods 0.000 description 3
- 239000003153 chemical reaction reagent Substances 0.000 description 3
- 239000003795 chemical substances by application Substances 0.000 description 3
- 238000004587 chromatography analysis Methods 0.000 description 3
- 239000003593 chromogenic compound Substances 0.000 description 3
- 210000000349 chromosome Anatomy 0.000 description 3
- 150000001875 compounds Chemical class 0.000 description 3
- 238000004520 electroporation Methods 0.000 description 3
- 238000001952 enzyme assay Methods 0.000 description 3
- 241001233957 eudicotyledons Species 0.000 description 3
- 238000000855 fermentation Methods 0.000 description 3
- 230000004151 fermentation Effects 0.000 description 3
- 239000006260 foam Substances 0.000 description 3
- 238000010353 genetic engineering Methods 0.000 description 3
- 108010042598 glutamyl-aspartyl-glycine Proteins 0.000 description 3
- 108010092114 histidylphenylalanine Proteins 0.000 description 3
- 230000028993 immune response Effects 0.000 description 3
- 230000005847 immunogenicity Effects 0.000 description 3
- 239000003112 inhibitor Substances 0.000 description 3
- 108010009298 lysylglutamic acid Proteins 0.000 description 3
- 108010064235 lysylglycine Proteins 0.000 description 3
- 238000005259 measurement Methods 0.000 description 3
- 230000001404 mediated effect Effects 0.000 description 3
- 230000000813 microbial effect Effects 0.000 description 3
- 238000002156 mixing Methods 0.000 description 3
- 238000003199 nucleic acid amplification method Methods 0.000 description 3
- 239000002245 particle Substances 0.000 description 3
- 229920001277 pectin Polymers 0.000 description 3
- 238000001556 precipitation Methods 0.000 description 3
- 230000008707 rearrangement Effects 0.000 description 3
- 230000001105 regulatory effect Effects 0.000 description 3
- 238000012552 review Methods 0.000 description 3
- 238000012216 screening Methods 0.000 description 3
- 230000028327 secretion Effects 0.000 description 3
- 238000000926 separation method Methods 0.000 description 3
- 108010026333 seryl-proline Proteins 0.000 description 3
- 238000002741 site-directed mutagenesis Methods 0.000 description 3
- 239000003381 stabilizer Substances 0.000 description 3
- 238000010561 standard procedure Methods 0.000 description 3
- BDHFUVZGWQCTTF-UHFFFAOYSA-M sulfonate Chemical compound [O-]S(=O)=O BDHFUVZGWQCTTF-UHFFFAOYSA-M 0.000 description 3
- YBJHBAHKTGYVGT-ZKWXMUAHSA-N (+)-Biotin Chemical compound N1C(=O)N[C@@H]2[C@H](CCCCC(=O)O)SC[C@@H]21 YBJHBAHKTGYVGT-ZKWXMUAHSA-N 0.000 description 2
- 108020004465 16S ribosomal RNA Proteins 0.000 description 2
- WIIZWVCIJKGZOK-IUCAKERBSA-N 2,2-dichloro-n-[(1s,2s)-1,3-dihydroxy-1-(4-nitrophenyl)propan-2-yl]acetamide Chemical compound ClC(Cl)C(=O)N[C@@H](CO)[C@@H](O)C1=CC=C([N+]([O-])=O)C=C1 WIIZWVCIJKGZOK-IUCAKERBSA-N 0.000 description 2
- BTJIUGUIPKRLHP-UHFFFAOYSA-N 4-nitrophenol Chemical compound OC1=CC=C([N+]([O-])=O)C=C1 BTJIUGUIPKRLHP-UHFFFAOYSA-N 0.000 description 2
- QTBSBXVTEAMEQO-UHFFFAOYSA-M Acetate Chemical compound CC([O-])=O QTBSBXVTEAMEQO-UHFFFAOYSA-M 0.000 description 2
- ROWKJAVDOGWPAT-UHFFFAOYSA-N Acetoin Chemical compound CC(O)C(C)=O ROWKJAVDOGWPAT-UHFFFAOYSA-N 0.000 description 2
- 241001019659 Acremonium <Plectosphaerellaceae> Species 0.000 description 2
- 229920002126 Acrylic acid copolymer Polymers 0.000 description 2
- 239000004382 Amylase Substances 0.000 description 2
- 101100163849 Arabidopsis thaliana ARS1 gene Proteins 0.000 description 2
- NKBQZKVMKJJDLX-SRVKXCTJSA-N Arg-Glu-Leu Chemical compound [H]N[C@@H](CCCNC(N)=N)C(=O)N[C@@H](CCC(O)=O)C(=O)N[C@@H](CC(C)C)C(O)=O NKBQZKVMKJJDLX-SRVKXCTJSA-N 0.000 description 2
- XUUXCWCKKCZEAW-YFKPBYRVSA-N Arg-Gly Chemical compound OC(=O)CNC(=O)[C@@H](N)CCCN=C(N)N XUUXCWCKKCZEAW-YFKPBYRVSA-N 0.000 description 2
- NKNILFJYKKHBKE-WPRPVWTQSA-N Arg-Gly-Val Chemical compound [H]N[C@@H](CCCNC(N)=N)C(=O)NCC(=O)N[C@@H](C(C)C)C(O)=O NKNILFJYKKHBKE-WPRPVWTQSA-N 0.000 description 2
- IIFDPDVJAHQFSR-WHFBIAKZSA-N Asn-Glu Chemical compound NC(=O)C[C@H](N)C(=O)N[C@H](C(O)=O)CCC(O)=O IIFDPDVJAHQFSR-WHFBIAKZSA-N 0.000 description 2
- HCAUEJAQCXVQQM-ACZMJKKPSA-N Asn-Glu-Asp Chemical compound [H]N[C@@H](CC(N)=O)C(=O)N[C@@H](CCC(O)=O)C(=O)N[C@@H](CC(O)=O)C(O)=O HCAUEJAQCXVQQM-ACZMJKKPSA-N 0.000 description 2
- GFFRWIJAFFMQGM-NUMRIWBASA-N Asn-Glu-Thr Chemical compound [H]N[C@@H](CC(N)=O)C(=O)N[C@@H](CCC(O)=O)C(=O)N[C@@H]([C@@H](C)O)C(O)=O GFFRWIJAFFMQGM-NUMRIWBASA-N 0.000 description 2
- DPSUVAPLRQDWAO-YDHLFZDLSA-N Asn-Tyr-Val Chemical compound CC(C)[C@@H](C(=O)O)NC(=O)[C@H](CC1=CC=C(C=C1)O)NC(=O)[C@H](CC(=O)N)N DPSUVAPLRQDWAO-YDHLFZDLSA-N 0.000 description 2
- MYRLSKYSMXNLLA-LAEOZQHASA-N Asn-Val-Glu Chemical compound [H]N[C@@H](CC(N)=O)C(=O)N[C@@H](C(C)C)C(=O)N[C@@H](CCC(O)=O)C(O)=O MYRLSKYSMXNLLA-LAEOZQHASA-N 0.000 description 2
- CELPEWWLSXMVPH-CIUDSAMLSA-N Asp-Asp-Lys Chemical compound NCCCC[C@@H](C(O)=O)NC(=O)[C@H](CC(O)=O)NC(=O)[C@@H](N)CC(O)=O CELPEWWLSXMVPH-CIUDSAMLSA-N 0.000 description 2
- CKAJHWFHHFSCDT-WHFBIAKZSA-N Asp-Glu Chemical compound OC(=O)C[C@H](N)C(=O)N[C@H](C(O)=O)CCC(O)=O CKAJHWFHHFSCDT-WHFBIAKZSA-N 0.000 description 2
- LTXGDRFJRZSZAV-CIUDSAMLSA-N Asp-Glu-Met Chemical compound CSCC[C@@H](C(=O)O)NC(=O)[C@H](CCC(=O)O)NC(=O)[C@H](CC(=O)O)N LTXGDRFJRZSZAV-CIUDSAMLSA-N 0.000 description 2
- PSLSTUMPZILTAH-BYULHYEWSA-N Asp-Gly-Ile Chemical compound CC[C@H](C)[C@@H](C(O)=O)NC(=O)CNC(=O)[C@@H](N)CC(O)=O PSLSTUMPZILTAH-BYULHYEWSA-N 0.000 description 2
- ICZWAZVKLACMKR-CIUDSAMLSA-N Asp-His-Ser Chemical compound OC(=O)C[C@H](N)C(=O)N[C@H](C(=O)N[C@@H](CO)C(O)=O)CC1=CN=CN1 ICZWAZVKLACMKR-CIUDSAMLSA-N 0.000 description 2
- KLYPOCBLKMPBIQ-GHCJXIJMSA-N Asp-Ile-Ser Chemical compound CC[C@H](C)[C@@H](C(=O)N[C@@H](CO)C(=O)O)NC(=O)[C@H](CC(=O)O)N KLYPOCBLKMPBIQ-GHCJXIJMSA-N 0.000 description 2
- USNJAPJZSGTTPX-XVSYOHENSA-N Asp-Phe-Thr Chemical compound [H]N[C@@H](CC(O)=O)C(=O)N[C@@H](CC1=CC=CC=C1)C(=O)N[C@@H]([C@@H](C)O)C(O)=O USNJAPJZSGTTPX-XVSYOHENSA-N 0.000 description 2
- GGRSYTUJHAZTFN-IHRRRGAJSA-N Asp-Pro-Tyr Chemical compound C1C[C@H](N(C1)C(=O)[C@H](CC(=O)O)N)C(=O)N[C@@H](CC2=CC=C(C=C2)O)C(=O)O GGRSYTUJHAZTFN-IHRRRGAJSA-N 0.000 description 2
- NALWOULWGHTVDA-UWVGGRQHSA-N Asp-Tyr Chemical compound OC(=O)C[C@H](N)C(=O)N[C@H](C(O)=O)CC1=CC=C(O)C=C1 NALWOULWGHTVDA-UWVGGRQHSA-N 0.000 description 2
- OTKUAVXGMREHRX-CFMVVWHZSA-N Asp-Tyr-Ile Chemical compound CC[C@H](C)[C@@H](C(O)=O)NC(=O)[C@@H](NC(=O)[C@@H](N)CC(O)=O)CC1=CC=C(O)C=C1 OTKUAVXGMREHRX-CFMVVWHZSA-N 0.000 description 2
- BJDHEININLSZOT-KKUMJFAQSA-N Asp-Tyr-Lys Chemical compound [H]N[C@@H](CC(O)=O)C(=O)N[C@@H](CC1=CC=C(O)C=C1)C(=O)N[C@@H](CCCCN)C(O)=O BJDHEININLSZOT-KKUMJFAQSA-N 0.000 description 2
- 241000351920 Aspergillus nidulans Species 0.000 description 2
- 240000006439 Aspergillus oryzae Species 0.000 description 2
- 235000002247 Aspergillus oryzae Nutrition 0.000 description 2
- IJGRMHOSHXDMSA-UHFFFAOYSA-N Atomic nitrogen Chemical compound N#N IJGRMHOSHXDMSA-UHFFFAOYSA-N 0.000 description 2
- 101000775727 Bacillus amyloliquefaciens Alpha-amylase Proteins 0.000 description 2
- 241000193422 Bacillus lentus Species 0.000 description 2
- 241000193388 Bacillus thuringiensis Species 0.000 description 2
- 241000283690 Bos taurus Species 0.000 description 2
- 101000583086 Bunodosoma granuliferum Delta-actitoxin-Bgr2b Proteins 0.000 description 2
- 244000025254 Cannabis sativa Species 0.000 description 2
- 108010053835 Catalase Proteins 0.000 description 2
- 102000016938 Catalase Human genes 0.000 description 2
- 108010035563 Chloramphenicol O-acetyltransferase Proteins 0.000 description 2
- KRKNYBCHXYNGOX-UHFFFAOYSA-K Citrate Chemical compound [O-]C(=O)CC(O)(CC([O-])=O)C([O-])=O KRKNYBCHXYNGOX-UHFFFAOYSA-K 0.000 description 2
- ZGERHCJBLPQPGV-ACZMJKKPSA-N Cys-Ser-Gln Chemical compound C(CC(=O)N)[C@@H](C(=O)O)NC(=O)[C@H](CO)NC(=O)[C@H](CS)N ZGERHCJBLPQPGV-ACZMJKKPSA-N 0.000 description 2
- FBPFZTCFMRRESA-KVTDHHQDSA-N D-Mannitol Chemical compound OC[C@@H](O)[C@@H](O)[C@H](O)[C@H](O)CO FBPFZTCFMRRESA-KVTDHHQDSA-N 0.000 description 2
- WQZGKKKJIJFFOK-QTVWNMPRSA-N D-mannopyranose Chemical compound OC[C@H]1OC(O)[C@@H](O)[C@@H](O)[C@@H]1O WQZGKKKJIJFFOK-QTVWNMPRSA-N 0.000 description 2
- 239000003155 DNA primer Substances 0.000 description 2
- 238000007900 DNA-DNA hybridization Methods 0.000 description 2
- IAYPIBMASNFSPL-UHFFFAOYSA-N Ethylene oxide Chemical group C1CO1 IAYPIBMASNFSPL-UHFFFAOYSA-N 0.000 description 2
- 241000567163 Fusarium cerealis Species 0.000 description 2
- 241000223221 Fusarium oxysporum Species 0.000 description 2
- 241000567178 Fusarium venenatum Species 0.000 description 2
- 108700028146 Genetic Enhancer Elements Proteins 0.000 description 2
- RKAQZCDMSUQTSS-FXQIFTODSA-N Gln-Asp-Gln Chemical compound C(CC(=O)N)[C@@H](C(=O)N[C@@H](CC(=O)O)C(=O)N[C@@H](CCC(=O)N)C(=O)O)N RKAQZCDMSUQTSS-FXQIFTODSA-N 0.000 description 2
- XEYMBRRKIFYQMF-GUBZILKMSA-N Gln-Asp-Leu Chemical compound [H]N[C@@H](CCC(N)=O)C(=O)N[C@@H](CC(O)=O)C(=O)N[C@@H](CC(C)C)C(O)=O XEYMBRRKIFYQMF-GUBZILKMSA-N 0.000 description 2
- VTTSANCGJWLPNC-ZPFDUUQYSA-N Glu-Arg-Ile Chemical compound [H]N[C@@H](CCC(O)=O)C(=O)N[C@@H](CCCNC(N)=N)C(=O)N[C@@H]([C@@H](C)CC)C(O)=O VTTSANCGJWLPNC-ZPFDUUQYSA-N 0.000 description 2
- GLWXKFRTOHKGIT-ACZMJKKPSA-N Glu-Asn-Asn Chemical compound [H]N[C@@H](CCC(O)=O)C(=O)N[C@@H](CC(N)=O)C(=O)N[C@@H](CC(N)=O)C(O)=O GLWXKFRTOHKGIT-ACZMJKKPSA-N 0.000 description 2
- FYYSIASRLDJUNP-WHFBIAKZSA-N Glu-Asp Chemical compound OC(=O)CC[C@H](N)C(=O)N[C@@H](CC(O)=O)C(O)=O FYYSIASRLDJUNP-WHFBIAKZSA-N 0.000 description 2
- DSPQRJXOIXHOHK-WDSKDSINSA-N Glu-Asp-Gly Chemical compound OC(=O)CC[C@H](N)C(=O)N[C@@H](CC(O)=O)C(=O)NCC(O)=O DSPQRJXOIXHOHK-WDSKDSINSA-N 0.000 description 2
- ALCAUWPAMLVUDB-FXQIFTODSA-N Glu-Gln-Asn Chemical compound [H]N[C@@H](CCC(O)=O)C(=O)N[C@@H](CCC(N)=O)C(=O)N[C@@H](CC(N)=O)C(O)=O ALCAUWPAMLVUDB-FXQIFTODSA-N 0.000 description 2
- KUTPGXNAAOQSPD-LPEHRKFASA-N Glu-Glu-Pro Chemical compound C1C[C@@H](N(C1)C(=O)[C@H](CCC(=O)O)NC(=O)[C@H](CCC(=O)O)N)C(=O)O KUTPGXNAAOQSPD-LPEHRKFASA-N 0.000 description 2
- UHVIQGKBMXEVGN-WDSKDSINSA-N Glu-Gly-Asn Chemical compound [H]N[C@@H](CCC(O)=O)C(=O)NCC(=O)N[C@@H](CC(N)=O)C(O)=O UHVIQGKBMXEVGN-WDSKDSINSA-N 0.000 description 2
- GGJOGFJIPPGNRK-JSGCOSHPSA-N Glu-Gly-Trp Chemical compound C1=CC=C2C(C[C@H](NC(=O)CNC(=O)[C@H](CCC(O)=O)N)C(O)=O)=CNC2=C1 GGJOGFJIPPGNRK-JSGCOSHPSA-N 0.000 description 2
- YBAFDPFAUTYYRW-YUMQZZPRSA-N Glu-Leu Chemical compound CC(C)C[C@@H](C(O)=O)NC(=O)[C@@H](N)CCC(O)=O YBAFDPFAUTYYRW-YUMQZZPRSA-N 0.000 description 2
- OFIHURVSQXAZIR-SZMVWBNQSA-N Glu-Lys-Trp Chemical compound [H]N[C@@H](CCC(O)=O)C(=O)N[C@@H](CCCCN)C(=O)N[C@@H](CC1=CNC2=C1C=CC=C2)C(O)=O OFIHURVSQXAZIR-SZMVWBNQSA-N 0.000 description 2
- BXSZPACYCMNKLS-AVGNSLFASA-N Glu-Ser-Phe Chemical compound [H]N[C@@H](CCC(O)=O)C(=O)N[C@@H](CO)C(=O)N[C@@H](CC1=CC=CC=C1)C(O)=O BXSZPACYCMNKLS-AVGNSLFASA-N 0.000 description 2
- MWTGQXBHVRTCOR-GLLZPBPUSA-N Glu-Thr-Gln Chemical compound [H]N[C@@H](CCC(O)=O)C(=O)N[C@@H]([C@@H](C)O)C(=O)N[C@@H](CCC(N)=O)C(O)=O MWTGQXBHVRTCOR-GLLZPBPUSA-N 0.000 description 2
- QCMVGXDELYMZET-GLLZPBPUSA-N Glu-Thr-Glu Chemical compound [H]N[C@@H](CCC(O)=O)C(=O)N[C@@H]([C@@H](C)O)C(=O)N[C@@H](CCC(O)=O)C(O)=O QCMVGXDELYMZET-GLLZPBPUSA-N 0.000 description 2
- SITLTJHOQZFJGG-XPUUQOCRSA-N Glu-Val Chemical compound CC(C)[C@@H](C(O)=O)NC(=O)[C@@H](N)CCC(O)=O SITLTJHOQZFJGG-XPUUQOCRSA-N 0.000 description 2
- QXUPRMQJDWJDFR-NRPADANISA-N Glu-Val-Ser Chemical compound CC(C)[C@H](NC(=O)[C@@H](N)CCC(O)=O)C(=O)N[C@@H](CO)C(O)=O QXUPRMQJDWJDFR-NRPADANISA-N 0.000 description 2
- SOEATRRYCIPEHA-BQBZGAKWSA-N Gly-Glu-Glu Chemical compound [H]NCC(=O)N[C@@H](CCC(O)=O)C(=O)N[C@@H](CCC(O)=O)C(O)=O SOEATRRYCIPEHA-BQBZGAKWSA-N 0.000 description 2
- CUYLIWAAAYJKJH-RYUDHWBXSA-N Gly-Glu-Tyr Chemical compound NCC(=O)N[C@@H](CCC(O)=O)C(=O)N[C@H](C(O)=O)CC1=CC=C(O)C=C1 CUYLIWAAAYJKJH-RYUDHWBXSA-N 0.000 description 2
- QSVMIMFAAZPCAQ-PMVVWTBXSA-N Gly-His-Thr Chemical compound [H]NCC(=O)N[C@@H](CC1=CNC=N1)C(=O)N[C@@H]([C@@H](C)O)C(O)=O QSVMIMFAAZPCAQ-PMVVWTBXSA-N 0.000 description 2
- DENRBIYENOKSEX-PEXQALLHSA-N Gly-Ile-His Chemical compound NCC(=O)N[C@@H]([C@@H](C)CC)C(=O)N[C@H](C(O)=O)CC1=CN=CN1 DENRBIYENOKSEX-PEXQALLHSA-N 0.000 description 2
- FJWSJWACLMTDMI-WPRPVWTQSA-N Gly-Met-Val Chemical compound [H]NCC(=O)N[C@@H](CCSC)C(=O)N[C@@H](C(C)C)C(O)=O FJWSJWACLMTDMI-WPRPVWTQSA-N 0.000 description 2
- ABPRMMYHROQBLY-NKWVEPMBSA-N Gly-Ser-Pro Chemical compound C1C[C@@H](N(C1)C(=O)[C@H](CO)NC(=O)CN)C(=O)O ABPRMMYHROQBLY-NKWVEPMBSA-N 0.000 description 2
- WCORRBXVISTKQL-WHFBIAKZSA-N Gly-Ser-Ser Chemical compound NCC(=O)N[C@@H](CO)C(=O)N[C@@H](CO)C(O)=O WCORRBXVISTKQL-WHFBIAKZSA-N 0.000 description 2
- CUVBTVWFVIIDOC-YEPSODPASA-N Gly-Thr-Val Chemical compound CC(C)[C@@H](C(O)=O)NC(=O)[C@H]([C@@H](C)O)NC(=O)CN CUVBTVWFVIIDOC-YEPSODPASA-N 0.000 description 2
- RIYIFUFFFBIOEU-KBPBESRZSA-N Gly-Tyr-Leu Chemical compound CC(C)C[C@@H](C(O)=O)NC(=O)[C@@H](NC(=O)CN)CC1=CC=C(O)C=C1 RIYIFUFFFBIOEU-KBPBESRZSA-N 0.000 description 2
- BAYQNCWLXIDLHX-ONGXEEELSA-N Gly-Val-Leu Chemical compound CC(C)C[C@@H](C(O)=O)NC(=O)[C@H](C(C)C)NC(=O)CN BAYQNCWLXIDLHX-ONGXEEELSA-N 0.000 description 2
- AFMOTCMSEBITOE-YEPSODPASA-N Gly-Val-Thr Chemical compound NCC(=O)N[C@@H](C(C)C)C(=O)N[C@@H]([C@@H](C)O)C(O)=O AFMOTCMSEBITOE-YEPSODPASA-N 0.000 description 2
- JBCLFWXMTIKCCB-UHFFFAOYSA-N H-Gly-Phe-OH Natural products NCC(=O)NC(C(O)=O)CC1=CC=CC=C1 JBCLFWXMTIKCCB-UHFFFAOYSA-N 0.000 description 2
- VUUFXXGKMPLKNH-BZSNNMDCSA-N His-Phe-His Chemical compound C1=CC=C(C=C1)C[C@@H](C(=O)N[C@@H](CC2=CN=CN2)C(=O)O)NC(=O)[C@H](CC3=CN=CN3)N VUUFXXGKMPLKNH-BZSNNMDCSA-N 0.000 description 2
- NBJAAWYRLGCJOF-UGYAYLCHSA-N Ile-Asp-Asn Chemical compound CC[C@H](C)[C@@H](C(=O)N[C@@H](CC(=O)O)C(=O)N[C@@H](CC(=O)N)C(=O)O)N NBJAAWYRLGCJOF-UGYAYLCHSA-N 0.000 description 2
- NKRJALPCDNXULF-BYULHYEWSA-N Ile-Asp-Gly Chemical compound [H]N[C@@H]([C@@H](C)CC)C(=O)N[C@@H](CC(O)=O)C(=O)NCC(O)=O NKRJALPCDNXULF-BYULHYEWSA-N 0.000 description 2
- GLYJPWIRLBAIJH-UHFFFAOYSA-N Ile-Lys-Pro Natural products CCC(C)C(N)C(=O)NC(CCCCN)C(=O)N1CCCC1C(O)=O GLYJPWIRLBAIJH-UHFFFAOYSA-N 0.000 description 2
- SIKJAQJRHWYJAI-UHFFFAOYSA-N Indole Chemical compound C1=CC=C2NC=CC2=C1 SIKJAQJRHWYJAI-UHFFFAOYSA-N 0.000 description 2
- 102100027612 Kallikrein-11 Human genes 0.000 description 2
- 125000003440 L-leucyl group Chemical group O=C([*])[C@](N([H])[H])([H])C([H])([H])C(C([H])([H])[H])([H])C([H])([H])[H] 0.000 description 2
- 125000002842 L-seryl group Chemical group O=C([*])[C@](N([H])[H])([H])C([H])([H])O[H] 0.000 description 2
- REPPKAMYTOJTFC-DCAQKATOSA-N Leu-Arg-Asp Chemical compound [H]N[C@@H](CC(C)C)C(=O)N[C@@H](CCCNC(N)=N)C(=O)N[C@@H](CC(O)=O)C(O)=O REPPKAMYTOJTFC-DCAQKATOSA-N 0.000 description 2
- JYOAXOMPIXKMKK-YUMQZZPRSA-N Leu-Gln Chemical compound CC(C)C[C@H]([NH3+])C(=O)N[C@H](C([O-])=O)CCC(N)=O JYOAXOMPIXKMKK-YUMQZZPRSA-N 0.000 description 2
- KAFOIVJDVSZUMD-UHFFFAOYSA-N Leu-Gln-Gln Natural products CC(C)CC(N)C(=O)NC(CCC(N)=O)C(=O)NC(CCC(N)=O)C(O)=O KAFOIVJDVSZUMD-UHFFFAOYSA-N 0.000 description 2
- NFNVDJGXRFEYTK-YUMQZZPRSA-N Leu-Glu Chemical compound CC(C)C[C@H](N)C(=O)N[C@H](C(O)=O)CCC(O)=O NFNVDJGXRFEYTK-YUMQZZPRSA-N 0.000 description 2
- VGPCJSXPPOQPBK-YUMQZZPRSA-N Leu-Gly-Ser Chemical compound CC(C)C[C@H](N)C(=O)NCC(=O)N[C@@H](CO)C(O)=O VGPCJSXPPOQPBK-YUMQZZPRSA-N 0.000 description 2
- RXGLHDWAZQECBI-SRVKXCTJSA-N Leu-Leu-Ser Chemical compound CC(C)C[C@H](N)C(=O)N[C@@H](CC(C)C)C(=O)N[C@@H](CO)C(O)=O RXGLHDWAZQECBI-SRVKXCTJSA-N 0.000 description 2
- XOWMDXHFSBCAKQ-SRVKXCTJSA-N Leu-Ser-Leu Chemical compound CC(C)C[C@H](N)C(=O)N[C@@H](CO)C(=O)N[C@H](C(O)=O)CC(C)C XOWMDXHFSBCAKQ-SRVKXCTJSA-N 0.000 description 2
- SBANPBVRHYIMRR-UHFFFAOYSA-N Leu-Ser-Pro Natural products CC(C)CC(N)C(=O)NC(CO)C(=O)N1CCCC1C(O)=O SBANPBVRHYIMRR-UHFFFAOYSA-N 0.000 description 2
- SVBJIZVVYJYGLA-DCAQKATOSA-N Leu-Ser-Val Chemical compound [H]N[C@@H](CC(C)C)C(=O)N[C@@H](CO)C(=O)N[C@@H](C(C)C)C(O)=O SVBJIZVVYJYGLA-DCAQKATOSA-N 0.000 description 2
- LFSQWRSVPNKJGP-WDCWCFNPSA-N Leu-Thr-Glu Chemical compound CC(C)C[C@H](N)C(=O)N[C@@H]([C@@H](C)O)C(=O)N[C@H](C(O)=O)CCC(O)=O LFSQWRSVPNKJGP-WDCWCFNPSA-N 0.000 description 2
- CGHXMODRYJISSK-NHCYSSNCSA-N Leu-Val-Asp Chemical compound CC(C)C[C@H](N)C(=O)N[C@@H](C(C)C)C(=O)N[C@H](C(O)=O)CC(O)=O CGHXMODRYJISSK-NHCYSSNCSA-N 0.000 description 2
- GVKINWYYLOLEFQ-XIRDDKMYSA-N Lys-Trp-Ser Chemical compound [H]N[C@@H](CCCCN)C(=O)N[C@@H](CC1=CNC2=C1C=CC=C2)C(=O)N[C@@H](CO)C(O)=O GVKINWYYLOLEFQ-XIRDDKMYSA-N 0.000 description 2
- OLWAOWXIADGIJG-AVGNSLFASA-N Met-Arg-Lys Chemical compound CSCC[C@H](N)C(=O)N[C@@H](CCCNC(N)=N)C(=O)N[C@@H](CCCCN)C(O)=O OLWAOWXIADGIJG-AVGNSLFASA-N 0.000 description 2
- OOSPRDCGTLQLBP-NHCYSSNCSA-N Met-Glu-Val Chemical compound [H]N[C@@H](CCSC)C(=O)N[C@@H](CCC(O)=O)C(=O)N[C@@H](C(C)C)C(O)=O OOSPRDCGTLQLBP-NHCYSSNCSA-N 0.000 description 2
- VSJAPSMRFYUOKS-IUCAKERBSA-N Met-Pro-Gly Chemical compound CSCC[C@H](N)C(=O)N1CCC[C@H]1C(=O)NCC(O)=O VSJAPSMRFYUOKS-IUCAKERBSA-N 0.000 description 2
- WHNWPMSKXPGLAX-UHFFFAOYSA-N N-Vinyl-2-pyrrolidone Chemical compound C=CN1CCCC1=O WHNWPMSKXPGLAX-UHFFFAOYSA-N 0.000 description 2
- AJHCSUXXECOXOY-UHFFFAOYSA-N N-glycyl-L-tryptophan Natural products C1=CC=C2C(CC(NC(=O)CN)C(O)=O)=CNC2=C1 AJHCSUXXECOXOY-UHFFFAOYSA-N 0.000 description 2
- 238000005481 NMR spectroscopy Methods 0.000 description 2
- 241000233654 Oomycetes Species 0.000 description 2
- 108700026244 Open Reading Frames Proteins 0.000 description 2
- DZVXMMSUWWUIQE-ACRUOGEOSA-N Phe-His-Tyr Chemical compound C1=CC=C(C=C1)C[C@@H](C(=O)N[C@@H](CC2=CN=CN2)C(=O)N[C@@H](CC3=CC=C(C=C3)O)C(=O)O)N DZVXMMSUWWUIQE-ACRUOGEOSA-N 0.000 description 2
- JXQVYPWVGUOIDV-MXAVVETBSA-N Phe-Ser-Ile Chemical compound [H]N[C@@H](CC1=CC=CC=C1)C(=O)N[C@@H](CO)C(=O)N[C@@H]([C@@H](C)CC)C(O)=O JXQVYPWVGUOIDV-MXAVVETBSA-N 0.000 description 2
- JMCOUWKXLXDERB-WMZOPIPTSA-N Phe-Trp Chemical compound C([C@H](N)C(=O)N[C@@H](CC=1C2=CC=CC=C2NC=1)C(O)=O)C1=CC=CC=C1 JMCOUWKXLXDERB-WMZOPIPTSA-N 0.000 description 2
- 241000235648 Pichia Species 0.000 description 2
- ZKQOUHVVXABNDG-IUCAKERBSA-N Pro-Leu Chemical compound CC(C)C[C@@H](C(O)=O)NC(=O)[C@@H]1CCCN1 ZKQOUHVVXABNDG-IUCAKERBSA-N 0.000 description 2
- OIDKVWTWGDWMHY-RYUDHWBXSA-N Pro-Tyr Chemical compound C([C@@H](C(=O)O)NC(=O)[C@H]1NCCC1)C1=CC=C(O)C=C1 OIDKVWTWGDWMHY-RYUDHWBXSA-N 0.000 description 2
- ZAUHSLVPDLNTRZ-QXEWZRGKSA-N Pro-Val-Asn Chemical compound [H]N1CCC[C@H]1C(=O)N[C@@H](C(C)C)C(=O)N[C@@H](CC(N)=O)C(O)=O ZAUHSLVPDLNTRZ-QXEWZRGKSA-N 0.000 description 2
- 241000589774 Pseudomonas sp. Species 0.000 description 2
- 239000004373 Pullulan Substances 0.000 description 2
- 229920001218 Pullulan Polymers 0.000 description 2
- RWRDLPDLKQPQOW-UHFFFAOYSA-N Pyrrolidine Chemical compound C1CCNC1 RWRDLPDLKQPQOW-UHFFFAOYSA-N 0.000 description 2
- 101100097319 Schizosaccharomyces pombe (strain 972 / ATCC 24843) ala1 gene Proteins 0.000 description 2
- HQTKVSCNCDLXSX-BQBZGAKWSA-N Ser-Arg-Gly Chemical compound [H]N[C@@H](CO)C(=O)N[C@@H](CCCNC(N)=N)C(=O)NCC(O)=O HQTKVSCNCDLXSX-BQBZGAKWSA-N 0.000 description 2
- CXBFHZLODKPIJY-AAEUAGOBSA-N Ser-Gly-Trp Chemical compound C1=CC=C2C(=C1)C(=CN2)C[C@@H](C(=O)O)NC(=O)CNC(=O)[C@H](CO)N CXBFHZLODKPIJY-AAEUAGOBSA-N 0.000 description 2
- UGTZYIPOBYXWRW-SRVKXCTJSA-N Ser-Phe-Asp Chemical compound [H]N[C@@H](CO)C(=O)N[C@@H](CC1=CC=CC=C1)C(=O)N[C@@H](CC(O)=O)C(O)=O UGTZYIPOBYXWRW-SRVKXCTJSA-N 0.000 description 2
- XQJCEKXQUJQNNK-ZLUOBGJFSA-N Ser-Ser-Ser Chemical compound OC[C@H](N)C(=O)N[C@@H](CO)C(=O)N[C@@H](CO)C(O)=O XQJCEKXQUJQNNK-ZLUOBGJFSA-N 0.000 description 2
- NADLKBTYNKUJEP-KATARQTJSA-N Ser-Thr-Leu Chemical compound [H]N[C@@H](CO)C(=O)N[C@@H]([C@@H](C)O)C(=O)N[C@@H](CC(C)C)C(O)=O NADLKBTYNKUJEP-KATARQTJSA-N 0.000 description 2
- VVKVHAOOUGNDPJ-SRVKXCTJSA-N Ser-Tyr-Ser Chemical compound [H]N[C@@H](CO)C(=O)N[C@@H](CC1=CC=C(O)C=C1)C(=O)N[C@@H](CO)C(O)=O VVKVHAOOUGNDPJ-SRVKXCTJSA-N 0.000 description 2
- CDBYLPFSWZWCQE-UHFFFAOYSA-L Sodium Carbonate Chemical compound [Na+].[Na+].[O-]C([O-])=O CDBYLPFSWZWCQE-UHFFFAOYSA-L 0.000 description 2
- UIIMBOGNXHQVGW-UHFFFAOYSA-M Sodium bicarbonate Chemical compound [Na+].OC([O-])=O UIIMBOGNXHQVGW-UHFFFAOYSA-M 0.000 description 2
- 229920002472 Starch Polymers 0.000 description 2
- 108090000787 Subtilisin Proteins 0.000 description 2
- KDYFGRWQOYBRFD-UHFFFAOYSA-N Succinic acid Natural products OC(=O)CCC(O)=O KDYFGRWQOYBRFD-UHFFFAOYSA-N 0.000 description 2
- QAOWNCQODCNURD-UHFFFAOYSA-L Sulfate Chemical compound [O-]S([O-])(=O)=O QAOWNCQODCNURD-UHFFFAOYSA-L 0.000 description 2
- NHUHCSRWZMLRLA-UHFFFAOYSA-N Sulfisoxazole Chemical compound CC1=NOC(NS(=O)(=O)C=2C=CC(N)=CC=2)=C1C NHUHCSRWZMLRLA-UHFFFAOYSA-N 0.000 description 2
- BGRWYDHXPHLNKA-UHFFFAOYSA-N Tetraacetylethylenediamine Chemical compound CC(=O)N(C(C)=O)CCN(C(C)=O)C(C)=O BGRWYDHXPHLNKA-UHFFFAOYSA-N 0.000 description 2
- 241000223258 Thermomyces lanuginosus Species 0.000 description 2
- 241001313536 Thermothelomyces thermophila Species 0.000 description 2
- 241001494489 Thielavia Species 0.000 description 2
- PZVGOVRNGKEFCB-KKHAAJSZSA-N Thr-Asn-Val Chemical compound C[C@H]([C@@H](C(=O)N[C@@H](CC(=O)N)C(=O)N[C@@H](C(C)C)C(=O)O)N)O PZVGOVRNGKEFCB-KKHAAJSZSA-N 0.000 description 2
- BECPPKYKPSRKCP-ZDLURKLDSA-N Thr-Glu Chemical compound C[C@@H](O)[C@H](N)C(=O)N[C@H](C(O)=O)CCC(O)=O BECPPKYKPSRKCP-ZDLURKLDSA-N 0.000 description 2
- MSIYNSBKKVMGFO-BHNWBGBOSA-N Thr-Gly-Pro Chemical compound C[C@H]([C@@H](C(=O)NCC(=O)N1CCC[C@@H]1C(=O)O)N)O MSIYNSBKKVMGFO-BHNWBGBOSA-N 0.000 description 2
- WPAKPLPGQNUXGN-OSUNSFLBSA-N Thr-Ile-Arg Chemical compound [H]N[C@@H]([C@@H](C)O)C(=O)N[C@@H]([C@@H](C)CC)C(=O)N[C@@H](CCCNC(N)=N)C(O)=O WPAKPLPGQNUXGN-OSUNSFLBSA-N 0.000 description 2
- VTVVYQOXJCZVEB-WDCWCFNPSA-N Thr-Leu-Glu Chemical compound [H]N[C@@H]([C@@H](C)O)C(=O)N[C@@H](CC(C)C)C(=O)N[C@@H](CCC(O)=O)C(O)=O VTVVYQOXJCZVEB-WDCWCFNPSA-N 0.000 description 2
- MXDOAJQRJBMGMO-FJXKBIBVSA-N Thr-Pro-Gly Chemical compound C[C@@H](O)[C@H](N)C(=O)N1CCC[C@H]1C(=O)NCC(O)=O MXDOAJQRJBMGMO-FJXKBIBVSA-N 0.000 description 2
- AAZOYLQUEQRUMZ-GSSVUCPTSA-N Thr-Thr-Asn Chemical compound C[C@@H](O)[C@H](N)C(=O)N[C@@H]([C@@H](C)O)C(=O)N[C@H](C(O)=O)CC(N)=O AAZOYLQUEQRUMZ-GSSVUCPTSA-N 0.000 description 2
- WCRFXRIWBFRZBR-GGVZMXCHSA-N Thr-Tyr Chemical compound C[C@@H](O)[C@H](N)C(=O)N[C@H](C(O)=O)CC1=CC=C(O)C=C1 WCRFXRIWBFRZBR-GGVZMXCHSA-N 0.000 description 2
- CKHWEVXPLJBEOZ-VQVTYTSYSA-N Thr-Val Chemical compound CC(C)[C@@H](C([O-])=O)NC(=O)[C@@H]([NH3+])[C@@H](C)O CKHWEVXPLJBEOZ-VQVTYTSYSA-N 0.000 description 2
- UYXTWWCETRIEDR-UHFFFAOYSA-N Tributyrin Chemical compound CCCC(=O)OCC(OC(=O)CCC)COC(=O)CCC UYXTWWCETRIEDR-UHFFFAOYSA-N 0.000 description 2
- 239000007984 Tris EDTA buffer Substances 0.000 description 2
- YXONONCLMLHWJX-SZMVWBNQSA-N Trp-Glu-Leu Chemical compound C1=CC=C2C(C[C@H](N)C(=O)N[C@@H](CCC(O)=O)C(=O)N[C@@H](CC(C)C)C(O)=O)=CNC2=C1 YXONONCLMLHWJX-SZMVWBNQSA-N 0.000 description 2
- 101710152431 Trypsin-like protease Proteins 0.000 description 2
- SDNVRAKIJVKAGS-LKTVYLICSA-N Tyr-Ala-His Chemical compound C[C@@H](C(=O)N[C@@H](CC1=CN=CN1)C(=O)O)NC(=O)[C@H](CC2=CC=C(C=C2)O)N SDNVRAKIJVKAGS-LKTVYLICSA-N 0.000 description 2
- JWHOIHCOHMZSAR-QWRGUYRKSA-N Tyr-Asp-Gly Chemical compound OC(=O)CNC(=O)[C@H](CC(O)=O)NC(=O)[C@@H](N)CC1=CC=C(O)C=C1 JWHOIHCOHMZSAR-QWRGUYRKSA-N 0.000 description 2
- NJLQMKZSXYQRTO-FHWLQOOXSA-N Tyr-Glu-Tyr Chemical compound C([C@H](N)C(=O)N[C@@H](CCC(O)=O)C(=O)N[C@@H](CC=1C=CC(O)=CC=1)C(O)=O)C1=CC=C(O)C=C1 NJLQMKZSXYQRTO-FHWLQOOXSA-N 0.000 description 2
- PMDWYLVWHRTJIW-STQMWFEESA-N Tyr-Gly-Arg Chemical compound NC(N)=NCCC[C@@H](C(O)=O)NC(=O)CNC(=O)[C@@H](N)CC1=CC=C(O)C=C1 PMDWYLVWHRTJIW-STQMWFEESA-N 0.000 description 2
- SINRIKQYQJRGDQ-MEYUZBJRSA-N Tyr-Lys-Thr Chemical compound C[C@@H](O)[C@@H](C(O)=O)NC(=O)[C@H](CCCCN)NC(=O)[C@@H](N)CC1=CC=C(O)C=C1 SINRIKQYQJRGDQ-MEYUZBJRSA-N 0.000 description 2
- LRHBBGDMBLFYGL-FHWLQOOXSA-N Tyr-Phe-Glu Chemical compound C([C@H](N)C(=O)N[C@@H](CC=1C=CC=CC=1)C(=O)N[C@@H](CCC(O)=O)C(O)=O)C1=CC=C(O)C=C1 LRHBBGDMBLFYGL-FHWLQOOXSA-N 0.000 description 2
- OKDNSNWJEXAMSU-IRXDYDNUSA-N Tyr-Phe-Gly Chemical compound C([C@H](N)C(=O)N[C@@H](CC=1C=CC=CC=1)C(=O)NCC(O)=O)C1=CC=C(O)C=C1 OKDNSNWJEXAMSU-IRXDYDNUSA-N 0.000 description 2
- SDSCOOZQQGUQFC-GVXVVHGQSA-N Val-His-Gln Chemical compound CC(C)[C@@H](C(=O)N[C@@H](CC1=CN=CN1)C(=O)N[C@@H](CCC(=O)N)C(=O)O)N SDSCOOZQQGUQFC-GVXVVHGQSA-N 0.000 description 2
- CKTMJBPRVQWPHU-JSGCOSHPSA-N Val-Phe-Gly Chemical compound CC(C)[C@@H](C(=O)N[C@@H](CC1=CC=CC=C1)C(=O)NCC(=O)O)N CKTMJBPRVQWPHU-JSGCOSHPSA-N 0.000 description 2
- YKNOJPJWNVHORX-UNQGMJICSA-N Val-Phe-Thr Chemical compound CC(C)[C@H](N)C(=O)N[C@H](C(=O)N[C@@H]([C@@H](C)O)C(O)=O)CC1=CC=CC=C1 YKNOJPJWNVHORX-UNQGMJICSA-N 0.000 description 2
- GIAZPLMMQOERPN-YUMQZZPRSA-N Val-Pro Chemical compound CC(C)[C@H](N)C(=O)N1CCC[C@H]1C(O)=O GIAZPLMMQOERPN-YUMQZZPRSA-N 0.000 description 2
- GVRKWABULJAONN-VQVTYTSYSA-N Val-Thr Chemical compound CC(C)[C@H](N)C(=O)N[C@@H]([C@@H](C)O)C(O)=O GVRKWABULJAONN-VQVTYTSYSA-N 0.000 description 2
- 240000006677 Vicia faba Species 0.000 description 2
- 235000010749 Vicia faba Nutrition 0.000 description 2
- 241000700605 Viruses Species 0.000 description 2
- 238000002835 absorbance Methods 0.000 description 2
- 108010030291 alpha-Galactosidase Proteins 0.000 description 2
- 102000005840 alpha-Galactosidase Human genes 0.000 description 2
- 229940024171 alpha-amylase Drugs 0.000 description 2
- 150000001408 amides Chemical class 0.000 description 2
- 230000000890 antigenic effect Effects 0.000 description 2
- 229920000617 arabinoxylan Polymers 0.000 description 2
- 108010091092 arginyl-glycyl-proline Proteins 0.000 description 2
- 108010093581 aspartyl-proline Proteins 0.000 description 2
- 229940097012 bacillus thuringiensis Drugs 0.000 description 2
- 230000008901 benefit Effects 0.000 description 2
- 230000000903 blocking effect Effects 0.000 description 2
- 239000004327 boric acid Substances 0.000 description 2
- 238000004422 calculation algorithm Methods 0.000 description 2
- 239000003489 carbonate dehydratase inhibitor Substances 0.000 description 2
- BECPQYXYKAMYBN-UHFFFAOYSA-N casein, tech. Chemical compound NCCCCC(C(O)=O)N=C(O)C(CC(O)=O)N=C(O)C(CCC(O)=N)N=C(O)C(CC(C)C)N=C(O)C(CCC(O)=O)N=C(O)C(CC(O)=O)N=C(O)C(CCC(O)=O)N=C(O)C(C(C)O)N=C(O)C(CCC(O)=N)N=C(O)C(CCC(O)=N)N=C(O)C(CCC(O)=N)N=C(O)C(CCC(O)=O)N=C(O)C(CCC(O)=O)N=C(O)C(COP(O)(O)=O)N=C(O)C(CCC(O)=N)N=C(O)C(N)CC1=CC=CC=C1 BECPQYXYKAMYBN-UHFFFAOYSA-N 0.000 description 2
- 235000021240 caseins Nutrition 0.000 description 2
- 230000015556 catabolic process Effects 0.000 description 2
- 230000003197 catalytic effect Effects 0.000 description 2
- 230000036978 cell physiology Effects 0.000 description 2
- 230000002759 chromosomal effect Effects 0.000 description 2
- 238000004140 cleaning Methods 0.000 description 2
- 239000013599 cloning vector Substances 0.000 description 2
- 239000011248 coating agent Substances 0.000 description 2
- 238000000576 coating method Methods 0.000 description 2
- 108010005400 cutinase Proteins 0.000 description 2
- 238000001514 detection method Methods 0.000 description 2
- 238000011161 development Methods 0.000 description 2
- 230000018109 developmental process Effects 0.000 description 2
- 229940079919 digestives enzyme preparation Drugs 0.000 description 2
- VHJLVAABSRFDPM-QWWZWVQMSA-N dithiothreitol Chemical compound SC[C@@H](O)[C@H](O)CS VHJLVAABSRFDPM-QWWZWVQMSA-N 0.000 description 2
- 235000013399 edible fruits Nutrition 0.000 description 2
- 238000005516 engineering process Methods 0.000 description 2
- 230000009088 enzymatic function Effects 0.000 description 2
- 230000001747 exhibiting effect Effects 0.000 description 2
- 238000000605 extraction Methods 0.000 description 2
- 239000004744 fabric Substances 0.000 description 2
- 239000002979 fabric softener Substances 0.000 description 2
- 150000002191 fatty alcohols Chemical class 0.000 description 2
- 238000009472 formulation Methods 0.000 description 2
- 108010078144 glutaminyl-glycine Proteins 0.000 description 2
- 108010049041 glutamylalanine Proteins 0.000 description 2
- VPZXBVLAVMBEQI-UHFFFAOYSA-N glycyl-DL-alpha-alanine Natural products OC(=O)C(C)NC(=O)CN VPZXBVLAVMBEQI-UHFFFAOYSA-N 0.000 description 2
- XKUKSGPZAADMRA-UHFFFAOYSA-N glycyl-glycyl-glycine Natural products NCC(=O)NCC(=O)NCC(O)=O XKUKSGPZAADMRA-UHFFFAOYSA-N 0.000 description 2
- 108010050848 glycylleucine Proteins 0.000 description 2
- 108010015792 glycyllysine Proteins 0.000 description 2
- 108010081551 glycylphenylalanine Proteins 0.000 description 2
- 108010084389 glycyltryptophan Proteins 0.000 description 2
- 108010025306 histidylleucine Proteins 0.000 description 2
- 230000007062 hydrolysis Effects 0.000 description 2
- 238000006460 hydrolysis reaction Methods 0.000 description 2
- 230000002209 hydrophobic effect Effects 0.000 description 2
- BJRNKVDFDLYUGJ-RMPHRYRLSA-N hydroquinone O-beta-D-glucopyranoside Chemical compound O[C@@H]1[C@@H](O)[C@H](O)[C@@H](CO)O[C@H]1OC1=CC=C(O)C=C1 BJRNKVDFDLYUGJ-RMPHRYRLSA-N 0.000 description 2
- 238000000338 in vitro Methods 0.000 description 2
- 238000010348 incorporation Methods 0.000 description 2
- 230000001965 increasing effect Effects 0.000 description 2
- 238000011534 incubation Methods 0.000 description 2
- 239000000411 inducer Substances 0.000 description 2
- 230000006698 induction Effects 0.000 description 2
- 239000004615 ingredient Substances 0.000 description 2
- 108010044374 isoleucyl-tyrosine Proteins 0.000 description 2
- SBUJHOSQTJFQJX-NOAMYHISSA-N kanamycin Chemical compound O[C@@H]1[C@@H](O)[C@H](O)[C@@H](CN)O[C@@H]1O[C@H]1[C@H](O)[C@@H](O[C@@H]2[C@@H]([C@@H](N)[C@H](O)[C@@H](CO)O2)O)[C@H](N)C[C@@H]1N SBUJHOSQTJFQJX-NOAMYHISSA-N 0.000 description 2
- 229930027917 kanamycin Natural products 0.000 description 2
- 229960000318 kanamycin Drugs 0.000 description 2
- 229930182823 kanamycin A Natural products 0.000 description 2
- 239000004310 lactic acid Substances 0.000 description 2
- 235000014655 lactic acid Nutrition 0.000 description 2
- 108010034529 leucyl-lysine Proteins 0.000 description 2
- 108010003700 lysyl aspartic acid Proteins 0.000 description 2
- 108010054155 lysyllysine Proteins 0.000 description 2
- 108010017391 lysylvaline Proteins 0.000 description 2
- 229910021645 metal ion Inorganic materials 0.000 description 2
- 125000001360 methionine group Chemical group N[C@@H](CCSC)C(=O)* 0.000 description 2
- 108010020132 microbial serine proteinases Proteins 0.000 description 2
- 238000001823 molecular biology technique Methods 0.000 description 2
- 238000010369 molecular cloning Methods 0.000 description 2
- 229920000847 nonoxynol Polymers 0.000 description 2
- 230000003287 optical effect Effects 0.000 description 2
- 239000001814 pectin Substances 0.000 description 2
- 235000010987 pectin Nutrition 0.000 description 2
- 108040007629 peroxidase activity proteins Proteins 0.000 description 2
- 108010012581 phenylalanylglutamate Proteins 0.000 description 2
- 108010051242 phenylalanylserine Proteins 0.000 description 2
- 108010083476 phenylalanyltryptophan Proteins 0.000 description 2
- 238000013492 plasmid preparation Methods 0.000 description 2
- 229920005862 polyol Polymers 0.000 description 2
- 150000003077 polyols Chemical class 0.000 description 2
- 229920002451 polyvinyl alcohol Polymers 0.000 description 2
- 239000000843 powder Substances 0.000 description 2
- 125000002924 primary amino group Chemical group [H]N([H])* 0.000 description 2
- 108010020755 prolyl-glycyl-glycine Proteins 0.000 description 2
- 108010070643 prolylglutamic acid Proteins 0.000 description 2
- 108010029020 prolylglycine Proteins 0.000 description 2
- 108010090894 prolylleucine Proteins 0.000 description 2
- 101150054232 pyrG gene Proteins 0.000 description 2
- 238000004153 renaturation Methods 0.000 description 2
- 108010071207 serylmethionine Proteins 0.000 description 2
- 150000004760 silicates Chemical class 0.000 description 2
- 239000002002 slurry Substances 0.000 description 2
- MWNQXXOSWHCCOZ-UHFFFAOYSA-L sodium;oxido carbonate Chemical compound [Na+].[O-]OC([O-])=O MWNQXXOSWHCCOZ-UHFFFAOYSA-L 0.000 description 2
- 239000007787 solid Substances 0.000 description 2
- 230000000087 stabilizing effect Effects 0.000 description 2
- 239000008107 starch Substances 0.000 description 2
- 235000019698 starch Nutrition 0.000 description 2
- 239000000126 substance Substances 0.000 description 2
- 235000000346 sugar Nutrition 0.000 description 2
- 150000005846 sugar alcohols Chemical class 0.000 description 2
- 229940124530 sulfonamide Drugs 0.000 description 2
- 239000006228 supernatant Substances 0.000 description 2
- 238000003786 synthesis reaction Methods 0.000 description 2
- 238000012360 testing method Methods 0.000 description 2
- 238000013518 transcription Methods 0.000 description 2
- 230000035897 transcription Effects 0.000 description 2
- 230000001131 transforming effect Effects 0.000 description 2
- 238000013519 translation Methods 0.000 description 2
- 108700004896 tripeptide FEG Proteins 0.000 description 2
- 108010017949 tyrosyl-glycyl-glycine Proteins 0.000 description 2
- 108010020532 tyrosyl-proline Proteins 0.000 description 2
- 108010003137 tyrosyltyrosine Proteins 0.000 description 2
- 230000008511 vegetative development Effects 0.000 description 2
- 229920001221 xylan Polymers 0.000 description 2
- 239000010457 zeolite Substances 0.000 description 2
- HDTRYLNUVZCQOY-UHFFFAOYSA-N α-D-glucopyranosyl-α-D-glucopyranoside Natural products OC1C(O)C(O)C(CO)OC1OC1C(O)C(O)C(O)C(CO)O1 HDTRYLNUVZCQOY-UHFFFAOYSA-N 0.000 description 1
- GJLXVWOMRRWCIB-MERZOTPQSA-N (2S)-2-[[(2S)-2-[[(2S)-2-[[(2S)-2-[[(2S)-2-[[(2S)-2-[[(2S)-2-[[(2S)-2-[[(2S)-2-[[(2S)-2-[[(2S)-2-[[(2S)-2-acetamido-5-(diaminomethylideneamino)pentanoyl]amino]-3-(4-hydroxyphenyl)propanoyl]amino]-3-(4-hydroxyphenyl)propanoyl]amino]-5-(diaminomethylideneamino)pentanoyl]amino]-3-(1H-indol-3-yl)propanoyl]amino]-6-aminohexanoyl]amino]-6-aminohexanoyl]amino]-6-aminohexanoyl]amino]-6-aminohexanoyl]amino]-6-aminohexanoyl]amino]-6-aminohexanoyl]amino]-6-aminohexanamide Chemical compound C([C@H](NC(=O)[C@H](CCCN=C(N)N)NC(=O)C)C(=O)N[C@@H](CC=1C=CC(O)=CC=1)C(=O)N[C@@H](CCCN=C(N)N)C(=O)N[C@@H](CC=1C2=CC=CC=C2NC=1)C(=O)N[C@@H](CCCCN)C(=O)N[C@@H](CCCCN)C(=O)N[C@@H](CCCCN)C(=O)N[C@@H](CCCCN)C(=O)N[C@@H](CCCCN)C(=O)N[C@@H](CCCCN)C(=O)N[C@@H](CCCCN)C(N)=O)C1=CC=C(O)C=C1 GJLXVWOMRRWCIB-MERZOTPQSA-N 0.000 description 1
- CWFMWBHMIMNZLN-NAKRPEOUSA-N (2s)-1-[(2s)-2-[[(2s,3s)-2-amino-3-methylpentanoyl]amino]propanoyl]pyrrolidine-2-carboxylic acid Chemical compound CC[C@H](C)[C@H](N)C(=O)N[C@@H](C)C(=O)N1CCC[C@H]1C(O)=O CWFMWBHMIMNZLN-NAKRPEOUSA-N 0.000 description 1
- VXWBQOJISHAKKM-UHFFFAOYSA-N (4-formylphenyl)boronic acid Chemical compound OB(O)C1=CC=C(C=O)C=C1 VXWBQOJISHAKKM-UHFFFAOYSA-N 0.000 description 1
- 102000040650 (ribonucleotides)n+m Human genes 0.000 description 1
- IEORSVTYLWZQJQ-UHFFFAOYSA-N 2-(2-nonylphenoxy)ethanol Chemical compound CCCCCCCCCC1=CC=CC=C1OCCO IEORSVTYLWZQJQ-UHFFFAOYSA-N 0.000 description 1
- HZAXFHJVJLSVMW-UHFFFAOYSA-N 2-Aminoethan-1-ol Chemical compound NCCO HZAXFHJVJLSVMW-UHFFFAOYSA-N 0.000 description 1
- IQUPABOKLQSFBK-UHFFFAOYSA-N 2-nitrophenol Chemical compound OC1=CC=CC=C1[N+]([O-])=O IQUPABOKLQSFBK-UHFFFAOYSA-N 0.000 description 1
- MHKLKWCYGIBEQF-UHFFFAOYSA-N 4-(1,3-benzothiazol-2-ylsulfanyl)morpholine Chemical compound C1COCCN1SC1=NC2=CC=CC=C2S1 MHKLKWCYGIBEQF-UHFFFAOYSA-N 0.000 description 1
- 101710163881 5,6-dihydroxyindole-2-carboxylic acid oxidase Proteins 0.000 description 1
- 108010011619 6-Phytase Proteins 0.000 description 1
- 108010013043 Acetylesterase Proteins 0.000 description 1
- 101710197633 Actin-1 Proteins 0.000 description 1
- 229930024421 Adenine Natural products 0.000 description 1
- GFFGJBXGBJISGV-UHFFFAOYSA-N Adenine Chemical compound NC1=NC=NC2=C1N=CN2 GFFGJBXGBJISGV-UHFFFAOYSA-N 0.000 description 1
- PLXMOAALOJOTIY-FPTXNFDTSA-N Aesculin Natural products OC[C@@H]1[C@@H](O)[C@H](O)[C@@H](O)[C@H](O)[C@H]1Oc2cc3C=CC(=O)Oc3cc2O PLXMOAALOJOTIY-FPTXNFDTSA-N 0.000 description 1
- 229920001817 Agar Polymers 0.000 description 1
- 241000589158 Agrobacterium Species 0.000 description 1
- 241000589155 Agrobacterium tumefaciens Species 0.000 description 1
- 241000743339 Agrostis Species 0.000 description 1
- SVBXIUDNTRTKHE-CIUDSAMLSA-N Ala-Arg-Glu Chemical compound [H]N[C@@H](C)C(=O)N[C@@H](CCCNC(N)=N)C(=O)N[C@@H](CCC(O)=O)C(O)=O SVBXIUDNTRTKHE-CIUDSAMLSA-N 0.000 description 1
- GFBLJMHGHAXGNY-ZLUOBGJFSA-N Ala-Asn-Asp Chemical compound [H]N[C@@H](C)C(=O)N[C@@H](CC(N)=O)C(=O)N[C@@H](CC(O)=O)C(O)=O GFBLJMHGHAXGNY-ZLUOBGJFSA-N 0.000 description 1
- NXSFUECZFORGOG-CIUDSAMLSA-N Ala-Asn-Leu Chemical compound [H]N[C@@H](C)C(=O)N[C@@H](CC(N)=O)C(=O)N[C@@H](CC(C)C)C(O)=O NXSFUECZFORGOG-CIUDSAMLSA-N 0.000 description 1
- XCVRVWZTXPCYJT-BIIVOSGPSA-N Ala-Asn-Pro Chemical compound C[C@@H](C(=O)N[C@@H](CC(=O)N)C(=O)N1CCC[C@@H]1C(=O)O)N XCVRVWZTXPCYJT-BIIVOSGPSA-N 0.000 description 1
- OILNWMNBLIHXQK-ZLUOBGJFSA-N Ala-Cys-Ser Chemical compound [H]N[C@@H](C)C(=O)N[C@@H](CS)C(=O)N[C@@H](CO)C(O)=O OILNWMNBLIHXQK-ZLUOBGJFSA-N 0.000 description 1
- BEMGNWZECGIJOI-WDSKDSINSA-N Ala-Gly-Glu Chemical compound [H]N[C@@H](C)C(=O)NCC(=O)N[C@@H](CCC(O)=O)C(O)=O BEMGNWZECGIJOI-WDSKDSINSA-N 0.000 description 1
- PCIFXPRIFWKWLK-YUMQZZPRSA-N Ala-Gly-Leu Chemical compound CC(C)C[C@@H](C(O)=O)NC(=O)CNC(=O)[C@H](C)N PCIFXPRIFWKWLK-YUMQZZPRSA-N 0.000 description 1
- CBCCCLMNOBLBSC-XVYDVKMFSA-N Ala-His-Ser Chemical compound [H]N[C@@H](C)C(=O)N[C@@H](CC1=CNC=N1)C(=O)N[C@@H](CO)C(O)=O CBCCCLMNOBLBSC-XVYDVKMFSA-N 0.000 description 1
- NYDBKUNVSALYPX-NAKRPEOUSA-N Ala-Ile-Arg Chemical compound C[C@H](N)C(=O)N[C@@H]([C@@H](C)CC)C(=O)N[C@H](C(O)=O)CCCN=C(N)N NYDBKUNVSALYPX-NAKRPEOUSA-N 0.000 description 1
- RZZMZYZXNJRPOJ-BJDJZHNGSA-N Ala-Ile-Lys Chemical compound CC[C@H](C)[C@@H](C(=O)N[C@@H](CCCCN)C(=O)O)NC(=O)[C@H](C)N RZZMZYZXNJRPOJ-BJDJZHNGSA-N 0.000 description 1
- MDNAVFBZPROEHO-UHFFFAOYSA-N Ala-Lys-Val Natural products CC(C)C(C(O)=O)NC(=O)C(NC(=O)C(C)N)CCCCN MDNAVFBZPROEHO-UHFFFAOYSA-N 0.000 description 1
- NLOMBWNGESDVJU-GUBZILKMSA-N Ala-Met-Arg Chemical compound [H]N[C@@H](C)C(=O)N[C@@H](CCSC)C(=O)N[C@@H](CCCNC(N)=N)C(O)=O NLOMBWNGESDVJU-GUBZILKMSA-N 0.000 description 1
- BFMIRJBURUXDRG-DLOVCJGASA-N Ala-Phe-Asp Chemical compound OC(=O)C[C@@H](C(O)=O)NC(=O)[C@@H](NC(=O)[C@@H](N)C)CC1=CC=CC=C1 BFMIRJBURUXDRG-DLOVCJGASA-N 0.000 description 1
- NCQMBSJGJMYKCK-ZLUOBGJFSA-N Ala-Ser-Ser Chemical compound [H]N[C@@H](C)C(=O)N[C@@H](CO)C(=O)N[C@@H](CO)C(O)=O NCQMBSJGJMYKCK-ZLUOBGJFSA-N 0.000 description 1
- IOFVWPYSRSCWHI-JXUBOQSCSA-N Ala-Thr-Leu Chemical compound CC(C)C[C@@H](C(O)=O)NC(=O)[C@H]([C@@H](C)O)NC(=O)[C@H](C)N IOFVWPYSRSCWHI-JXUBOQSCSA-N 0.000 description 1
- ZXKNLCPUNZPFGY-LEWSCRJBSA-N Ala-Tyr-Pro Chemical compound C[C@@H](C(=O)N[C@@H](CC1=CC=C(C=C1)O)C(=O)N2CCC[C@@H]2C(=O)O)N ZXKNLCPUNZPFGY-LEWSCRJBSA-N 0.000 description 1
- OMSKGWFGWCQFBD-KZVJFYERSA-N Ala-Val-Thr Chemical compound [H]N[C@@H](C)C(=O)N[C@@H](C(C)C)C(=O)N[C@@H]([C@@H](C)O)C(O)=O OMSKGWFGWCQFBD-KZVJFYERSA-N 0.000 description 1
- 108010088751 Albumins Proteins 0.000 description 1
- 102000009027 Albumins Human genes 0.000 description 1
- 102000004400 Aminopeptidases Human genes 0.000 description 1
- 108090000915 Aminopeptidases Proteins 0.000 description 1
- 229920000856 Amylose Polymers 0.000 description 1
- 108010037870 Anthranilate Synthase Proteins 0.000 description 1
- 241000219195 Arabidopsis thaliana Species 0.000 description 1
- OMLWNBVRVJYMBQ-YUMQZZPRSA-N Arg-Arg Chemical compound NC(N)=NCCC[C@H](N)C(=O)N[C@@H](CCCN=C(N)N)C(O)=O OMLWNBVRVJYMBQ-YUMQZZPRSA-N 0.000 description 1
- SIFXMYAHXJGAFC-WDSKDSINSA-N Arg-Asp Chemical compound NC(=N)NCCC[C@H](N)C(=O)N[C@@H](CC(O)=O)C(O)=O SIFXMYAHXJGAFC-WDSKDSINSA-N 0.000 description 1
- OZNSCVPYWZRQPY-CIUDSAMLSA-N Arg-Asp-Glu Chemical compound [H]N[C@@H](CCCNC(N)=N)C(=O)N[C@@H](CC(O)=O)C(=O)N[C@@H](CCC(O)=O)C(O)=O OZNSCVPYWZRQPY-CIUDSAMLSA-N 0.000 description 1
- PBSOQGZLPFVXPU-YUMQZZPRSA-N Arg-Glu-Gly Chemical compound [H]N[C@@H](CCCNC(N)=N)C(=O)N[C@@H](CCC(O)=O)C(=O)NCC(O)=O PBSOQGZLPFVXPU-YUMQZZPRSA-N 0.000 description 1
- GOWZVQXTHUCNSQ-NHCYSSNCSA-N Arg-Glu-Val Chemical compound [H]N[C@@H](CCCNC(N)=N)C(=O)N[C@@H](CCC(O)=O)C(=O)N[C@@H](C(C)C)C(O)=O GOWZVQXTHUCNSQ-NHCYSSNCSA-N 0.000 description 1
- PHHRSPBBQUFULD-UWVGGRQHSA-N Arg-Gly-Lys Chemical compound C(CCN)C[C@@H](C(=O)O)NC(=O)CNC(=O)[C@H](CCCN=C(N)N)N PHHRSPBBQUFULD-UWVGGRQHSA-N 0.000 description 1
- YKBHOXLMMPZPHQ-GMOBBJLQSA-N Arg-Ile-Asp Chemical compound [H]N[C@@H](CCCNC(N)=N)C(=O)N[C@@H]([C@@H](C)CC)C(=O)N[C@@H](CC(O)=O)C(O)=O YKBHOXLMMPZPHQ-GMOBBJLQSA-N 0.000 description 1
- GNYUVVJYGJFKHN-RVMXOQNASA-N Arg-Ile-Pro Chemical compound CC[C@H](C)[C@@H](C(=O)N1CCC[C@@H]1C(=O)O)NC(=O)[C@H](CCCN=C(N)N)N GNYUVVJYGJFKHN-RVMXOQNASA-N 0.000 description 1
- YBZMTKUDWXZLIX-UWVGGRQHSA-N Arg-Leu-Gly Chemical compound [H]N[C@@H](CCCNC(N)=N)C(=O)N[C@@H](CC(C)C)C(=O)NCC(O)=O YBZMTKUDWXZLIX-UWVGGRQHSA-N 0.000 description 1
- NOZYDJOPOGKUSR-AVGNSLFASA-N Arg-Leu-Met Chemical compound [H]N[C@@H](CCCNC(N)=N)C(=O)N[C@@H](CC(C)C)C(=O)N[C@@H](CCSC)C(O)=O NOZYDJOPOGKUSR-AVGNSLFASA-N 0.000 description 1
- JQFZHHSQMKZLRU-IUCAKERBSA-N Arg-Lys Chemical compound NCCCC[C@@H](C(O)=O)NC(=O)[C@@H](N)CCCN=C(N)N JQFZHHSQMKZLRU-IUCAKERBSA-N 0.000 description 1
- CLICCYPMVFGUOF-IHRRRGAJSA-N Arg-Lys-Leu Chemical compound [H]N[C@@H](CCCNC(N)=N)C(=O)N[C@@H](CCCCN)C(=O)N[C@@H](CC(C)C)C(O)=O CLICCYPMVFGUOF-IHRRRGAJSA-N 0.000 description 1
- GRRXPUAICOGISM-RWMBFGLXSA-N Arg-Lys-Pro Chemical compound C1C[C@@H](N(C1)C(=O)[C@H](CCCCN)NC(=O)[C@H](CCCN=C(N)N)N)C(=O)O GRRXPUAICOGISM-RWMBFGLXSA-N 0.000 description 1
- QBQVKUNBCAFXSV-ULQDDVLXSA-N Arg-Lys-Tyr Chemical compound NC(N)=NCCC[C@H](N)C(=O)N[C@@H](CCCCN)C(=O)N[C@H](C(O)=O)CC1=CC=C(O)C=C1 QBQVKUNBCAFXSV-ULQDDVLXSA-N 0.000 description 1
- IJYZHIOOBGIINM-WDSKDSINSA-N Arg-Ser Chemical compound OC[C@@H](C(O)=O)NC(=O)[C@@H](N)CCCN=C(N)N IJYZHIOOBGIINM-WDSKDSINSA-N 0.000 description 1
- XNSKSTRGQIPTSE-ACZMJKKPSA-N Arg-Thr Chemical compound C[C@@H]([C@@H](C(=O)O)NC(=O)[C@H](CCCN=C(N)N)N)O XNSKSTRGQIPTSE-ACZMJKKPSA-N 0.000 description 1
- NVPHRWNWTKYIST-BPNCWPANSA-N Arg-Tyr-Ala Chemical compound NC(N)=NCCC[C@H](N)C(=O)N[C@H](C(=O)N[C@@H](C)C(O)=O)CC1=CC=C(O)C=C1 NVPHRWNWTKYIST-BPNCWPANSA-N 0.000 description 1
- CTAPSNCVKPOOSM-KKUMJFAQSA-N Arg-Tyr-Gln Chemical compound [H]N[C@@H](CCCNC(N)=N)C(=O)N[C@@H](CC1=CC=C(O)C=C1)C(=O)N[C@@H](CCC(N)=O)C(O)=O CTAPSNCVKPOOSM-KKUMJFAQSA-N 0.000 description 1
- ISVACHFCVRKIDG-SRVKXCTJSA-N Arg-Val-Arg Chemical compound NC(N)=NCCC[C@H](N)C(=O)N[C@@H](C(C)C)C(=O)N[C@@H](CCCN=C(N)N)C(O)=O ISVACHFCVRKIDG-SRVKXCTJSA-N 0.000 description 1
- 239000004475 Arginine Substances 0.000 description 1
- 241000235349 Ascomycota Species 0.000 description 1
- BDMIFVIWCNLDCT-CIUDSAMLSA-N Asn-Arg-Glu Chemical compound [H]N[C@@H](CC(N)=O)C(=O)N[C@@H](CCCNC(N)=N)C(=O)N[C@@H](CCC(O)=O)C(O)=O BDMIFVIWCNLDCT-CIUDSAMLSA-N 0.000 description 1
- JEPNYDRDYNSFIU-QXEWZRGKSA-N Asn-Arg-Val Chemical compound CC(C)[C@H](NC(=O)[C@H](CCCN=C(N)N)NC(=O)[C@@H](N)CC(N)=O)C(O)=O JEPNYDRDYNSFIU-QXEWZRGKSA-N 0.000 description 1
- XVVOVPFMILMHPX-ZLUOBGJFSA-N Asn-Asp-Asp Chemical compound [H]N[C@@H](CC(N)=O)C(=O)N[C@@H](CC(O)=O)C(=O)N[C@@H](CC(O)=O)C(O)=O XVVOVPFMILMHPX-ZLUOBGJFSA-N 0.000 description 1
- BGINHSZTXRJIPP-FXQIFTODSA-N Asn-Asp-Met Chemical compound CSCC[C@@H](C(=O)O)NC(=O)[C@H](CC(=O)O)NC(=O)[C@H](CC(=O)N)N BGINHSZTXRJIPP-FXQIFTODSA-N 0.000 description 1
- JZRLLSOWDYUKOK-SRVKXCTJSA-N Asn-Asp-Phe Chemical compound C1=CC=C(C=C1)C[C@@H](C(=O)O)NC(=O)[C@H](CC(=O)O)NC(=O)[C@H](CC(=O)N)N JZRLLSOWDYUKOK-SRVKXCTJSA-N 0.000 description 1
- UEONJSPBTSWKOI-CIUDSAMLSA-N Asn-Gln-Met Chemical compound [H]N[C@@H](CC(N)=O)C(=O)N[C@@H](CCC(N)=O)C(=O)N[C@@H](CCSC)C(O)=O UEONJSPBTSWKOI-CIUDSAMLSA-N 0.000 description 1
- OLGCWMNDJTWQAG-GUBZILKMSA-N Asn-Glu-Lys Chemical compound NCCCC[C@@H](C(O)=O)NC(=O)[C@H](CCC(O)=O)NC(=O)[C@@H](N)CC(N)=O OLGCWMNDJTWQAG-GUBZILKMSA-N 0.000 description 1
- KLKHFFMNGWULBN-VKHMYHEASA-N Asn-Gly Chemical compound NC(=O)C[C@H](N)C(=O)NCC(O)=O KLKHFFMNGWULBN-VKHMYHEASA-N 0.000 description 1
- GJFYPBDMUGGLFR-NKWVEPMBSA-N Asn-Gly-Pro Chemical compound C1C[C@@H](N(C1)C(=O)CNC(=O)[C@H](CC(=O)N)N)C(=O)O GJFYPBDMUGGLFR-NKWVEPMBSA-N 0.000 description 1
- MQLZLIYPFDIDMZ-HAFWLYHUSA-N Asn-Ile Chemical compound CC[C@H](C)[C@@H](C(O)=O)NC(=O)[C@@H](N)CC(N)=O MQLZLIYPFDIDMZ-HAFWLYHUSA-N 0.000 description 1
- LTZIRYMWOJHRCH-GUDRVLHUSA-N Asn-Ile-Pro Chemical compound CC[C@H](C)[C@@H](C(=O)N1CCC[C@@H]1C(=O)O)NC(=O)[C@H](CC(=O)N)N LTZIRYMWOJHRCH-GUDRVLHUSA-N 0.000 description 1
- IBLAOXSULLECQZ-IUKAMOBKSA-N Asn-Ile-Thr Chemical compound C[C@@H](O)[C@@H](C(O)=O)NC(=O)[C@H]([C@@H](C)CC)NC(=O)[C@@H](N)CC(N)=O IBLAOXSULLECQZ-IUKAMOBKSA-N 0.000 description 1
- YVXRYLVELQYAEQ-SRVKXCTJSA-N Asn-Leu-Lys Chemical compound CC(C)C[C@@H](C(=O)N[C@@H](CCCCN)C(=O)O)NC(=O)[C@H](CC(=O)N)N YVXRYLVELQYAEQ-SRVKXCTJSA-N 0.000 description 1
- NYGILGUOUOXGMJ-YUMQZZPRSA-N Asn-Lys-Gly Chemical compound [H]N[C@@H](CC(N)=O)C(=O)N[C@@H](CCCCN)C(=O)NCC(O)=O NYGILGUOUOXGMJ-YUMQZZPRSA-N 0.000 description 1
- IQTUDDBANZYMAR-WDSKDSINSA-N Asn-Met Chemical compound CSCC[C@@H](C(O)=O)NC(=O)[C@@H](N)CC(N)=O IQTUDDBANZYMAR-WDSKDSINSA-N 0.000 description 1
- YUOXLJYVSZYPBJ-CIUDSAMLSA-N Asn-Pro-Glu Chemical compound [H]N[C@@H](CC(N)=O)C(=O)N1CCC[C@H]1C(=O)N[C@@H](CCC(O)=O)C(O)=O YUOXLJYVSZYPBJ-CIUDSAMLSA-N 0.000 description 1
- QUMKPKWYDVMGNT-NUMRIWBASA-N Asn-Thr-Gln Chemical compound C[C@H]([C@@H](C(=O)N[C@@H](CCC(=O)N)C(=O)O)NC(=O)[C@H](CC(=O)N)N)O QUMKPKWYDVMGNT-NUMRIWBASA-N 0.000 description 1
- KZYSHAMXEBPJBD-JRQIVUDYSA-N Asn-Thr-Tyr Chemical compound [H]N[C@@H](CC(N)=O)C(=O)N[C@@H]([C@@H](C)O)C(=O)N[C@@H](CC1=CC=C(O)C=C1)C(O)=O KZYSHAMXEBPJBD-JRQIVUDYSA-N 0.000 description 1
- QIRJQYQOIKBPBZ-IHRRRGAJSA-N Asn-Tyr-Arg Chemical compound [H]N[C@@H](CC(N)=O)C(=O)N[C@@H](CC1=CC=C(O)C=C1)C(=O)N[C@@H](CCCNC(N)=N)C(O)=O QIRJQYQOIKBPBZ-IHRRRGAJSA-N 0.000 description 1
- DATSKXOXPUAOLK-KKUMJFAQSA-N Asn-Tyr-Leu Chemical compound [H]N[C@@H](CC(N)=O)C(=O)N[C@@H](CC1=CC=C(O)C=C1)C(=O)N[C@@H](CC(C)C)C(O)=O DATSKXOXPUAOLK-KKUMJFAQSA-N 0.000 description 1
- KWBQPGIYEZKDEG-FSPLSTOPSA-N Asn-Val Chemical compound CC(C)[C@@H](C(O)=O)NC(=O)[C@@H](N)CC(N)=O KWBQPGIYEZKDEG-FSPLSTOPSA-N 0.000 description 1
- XLDMSQYOYXINSZ-QXEWZRGKSA-N Asn-Val-Arg Chemical compound CC(C)[C@@H](C(=O)N[C@@H](CCCN=C(N)N)C(=O)O)NC(=O)[C@H](CC(=O)N)N XLDMSQYOYXINSZ-QXEWZRGKSA-N 0.000 description 1
- ZAESWDKAMDVHLL-RCOVLWMOSA-N Asn-Val-Gly Chemical compound [H]N[C@@H](CC(N)=O)C(=O)N[C@@H](C(C)C)C(=O)NCC(O)=O ZAESWDKAMDVHLL-RCOVLWMOSA-N 0.000 description 1
- WSWYMRLTJVKRCE-ZLUOBGJFSA-N Asp-Ala-Asp Chemical compound OC(=O)C[C@H](N)C(=O)N[C@@H](C)C(=O)N[C@@H](CC(O)=O)C(O)=O WSWYMRLTJVKRCE-ZLUOBGJFSA-N 0.000 description 1
- UGKZHCBLMLSANF-CIUDSAMLSA-N Asp-Asn-Leu Chemical compound [H]N[C@@H](CC(O)=O)C(=O)N[C@@H](CC(N)=O)C(=O)N[C@@H](CC(C)C)C(O)=O UGKZHCBLMLSANF-CIUDSAMLSA-N 0.000 description 1
- VPSHHQXIWLGVDD-ZLUOBGJFSA-N Asp-Asp-Asp Chemical compound OC(=O)C[C@H](N)C(=O)N[C@@H](CC(O)=O)C(=O)N[C@@H](CC(O)=O)C(O)=O VPSHHQXIWLGVDD-ZLUOBGJFSA-N 0.000 description 1
- WCFCYFDBMNFSPA-ACZMJKKPSA-N Asp-Asp-Glu Chemical compound OC(=O)C[C@H](N)C(=O)N[C@@H](CC(O)=O)C(=O)N[C@H](C(O)=O)CCC(O)=O WCFCYFDBMNFSPA-ACZMJKKPSA-N 0.000 description 1
- TVVYVAUGRHNTGT-UGYAYLCHSA-N Asp-Asp-Ile Chemical compound CC[C@H](C)[C@@H](C(O)=O)NC(=O)[C@H](CC(O)=O)NC(=O)[C@@H](N)CC(O)=O TVVYVAUGRHNTGT-UGYAYLCHSA-N 0.000 description 1
- KGAJCJXBEWLQDZ-UBHSHLNASA-N Asp-Asp-Trp Chemical compound C1=CC=C2C(=C1)C(=CN2)C[C@@H](C(=O)O)NC(=O)[C@H](CC(=O)O)NC(=O)[C@H](CC(=O)O)N KGAJCJXBEWLQDZ-UBHSHLNASA-N 0.000 description 1
- VZNOVQKGJQJOCS-SRVKXCTJSA-N Asp-Asp-Tyr Chemical compound [H]N[C@@H](CC(O)=O)C(=O)N[C@@H](CC(O)=O)C(=O)N[C@@H](CC1=CC=C(O)C=C1)C(O)=O VZNOVQKGJQJOCS-SRVKXCTJSA-N 0.000 description 1
- LJRPYAZQQWHEEV-FXQIFTODSA-N Asp-Gln-Gln Chemical compound [H]N[C@@H](CC(O)=O)C(=O)N[C@@H](CCC(N)=O)C(=O)N[C@@H](CCC(N)=O)C(O)=O LJRPYAZQQWHEEV-FXQIFTODSA-N 0.000 description 1
- ZSJFGGSPCCHMNE-LAEOZQHASA-N Asp-Gln-Val Chemical compound CC(C)[C@@H](C(=O)O)NC(=O)[C@H](CCC(=O)N)NC(=O)[C@H](CC(=O)O)N ZSJFGGSPCCHMNE-LAEOZQHASA-N 0.000 description 1
- XAJRHVUUVUPFQL-ACZMJKKPSA-N Asp-Glu-Asp Chemical compound OC(=O)C[C@H](N)C(=O)N[C@@H](CCC(O)=O)C(=O)N[C@@H](CC(O)=O)C(O)=O XAJRHVUUVUPFQL-ACZMJKKPSA-N 0.000 description 1
- VFUXXFVCYZPOQG-WDSKDSINSA-N Asp-Glu-Gly Chemical compound [H]N[C@@H](CC(O)=O)C(=O)N[C@@H](CCC(O)=O)C(=O)NCC(O)=O VFUXXFVCYZPOQG-WDSKDSINSA-N 0.000 description 1
- QCLHLXDWRKOHRR-GUBZILKMSA-N Asp-Glu-His Chemical compound C1=C(NC=N1)C[C@@H](C(=O)O)NC(=O)[C@H](CCC(=O)O)NC(=O)[C@H](CC(=O)O)N QCLHLXDWRKOHRR-GUBZILKMSA-N 0.000 description 1
- XDGBFDYXZCMYEX-NUMRIWBASA-N Asp-Glu-Thr Chemical compound C[C@H]([C@@H](C(=O)O)NC(=O)[C@H](CCC(=O)O)NC(=O)[C@H](CC(=O)O)N)O XDGBFDYXZCMYEX-NUMRIWBASA-N 0.000 description 1
- HAFCJCDJGIOYPW-WDSKDSINSA-N Asp-Gly-Gln Chemical compound OC(=O)C[C@H](N)C(=O)NCC(=O)N[C@H](C(O)=O)CCC(N)=O HAFCJCDJGIOYPW-WDSKDSINSA-N 0.000 description 1
- PZXPWHFYZXTFBI-YUMQZZPRSA-N Asp-Gly-Lys Chemical compound NCCCC[C@@H](C(O)=O)NC(=O)CNC(=O)[C@@H](N)CC(O)=O PZXPWHFYZXTFBI-YUMQZZPRSA-N 0.000 description 1
- AYFVRYXNDHBECD-YUMQZZPRSA-N Asp-Leu-Gly Chemical compound [H]N[C@@H](CC(O)=O)C(=O)N[C@@H](CC(C)C)C(=O)NCC(O)=O AYFVRYXNDHBECD-YUMQZZPRSA-N 0.000 description 1
- UMHUHHJMEXNSIV-CIUDSAMLSA-N Asp-Leu-Ser Chemical compound OC[C@@H](C(O)=O)NC(=O)[C@H](CC(C)C)NC(=O)[C@@H](N)CC(O)=O UMHUHHJMEXNSIV-CIUDSAMLSA-N 0.000 description 1
- RRUWMFBLFLUZSI-LPEHRKFASA-N Asp-Met-Pro Chemical compound CSCC[C@@H](C(=O)N1CCC[C@@H]1C(=O)O)NC(=O)[C@H](CC(=O)O)N RRUWMFBLFLUZSI-LPEHRKFASA-N 0.000 description 1
- RPUYTJJZXQBWDT-SRVKXCTJSA-N Asp-Phe-Ser Chemical compound C1=CC=C(C=C1)C[C@@H](C(=O)N[C@@H](CO)C(=O)O)NC(=O)[C@H](CC(=O)O)N RPUYTJJZXQBWDT-SRVKXCTJSA-N 0.000 description 1
- UKGGPJNBONZZCM-WDSKDSINSA-N Asp-Pro Chemical compound OC(=O)C[C@H](N)C(=O)N1CCC[C@H]1C(O)=O UKGGPJNBONZZCM-WDSKDSINSA-N 0.000 description 1
- KGHLGJAXYSVNJP-WHFBIAKZSA-N Asp-Ser-Gly Chemical compound OC(=O)C[C@H](N)C(=O)N[C@@H](CO)C(=O)NCC(O)=O KGHLGJAXYSVNJP-WHFBIAKZSA-N 0.000 description 1
- QSFHZPQUAAQHAQ-CIUDSAMLSA-N Asp-Ser-Leu Chemical compound [H]N[C@@H](CC(O)=O)C(=O)N[C@@H](CO)C(=O)N[C@@H](CC(C)C)C(O)=O QSFHZPQUAAQHAQ-CIUDSAMLSA-N 0.000 description 1
- QOCFFCUFZGDHTP-NUMRIWBASA-N Asp-Thr-Gln Chemical compound [H]N[C@@H](CC(O)=O)C(=O)N[C@@H]([C@@H](C)O)C(=O)N[C@@H](CCC(N)=O)C(O)=O QOCFFCUFZGDHTP-NUMRIWBASA-N 0.000 description 1
- GWWSUMLEWKQHLR-NUMRIWBASA-N Asp-Thr-Glu Chemical compound C[C@H]([C@@H](C(=O)N[C@@H](CCC(=O)O)C(=O)O)NC(=O)[C@H](CC(=O)O)N)O GWWSUMLEWKQHLR-NUMRIWBASA-N 0.000 description 1
- JJQGZGOEDSSHTE-FOHZUACHSA-N Asp-Thr-Gly Chemical compound [H]N[C@@H](CC(O)=O)C(=O)N[C@@H]([C@@H](C)O)C(=O)NCC(O)=O JJQGZGOEDSSHTE-FOHZUACHSA-N 0.000 description 1
- XAPPCWUWHNWCPQ-PBCZWWQYSA-N Asp-Thr-His Chemical compound N[C@@H](CC(=O)O)C(=O)N[C@@H]([C@H](O)C)C(=O)N[C@@H](CC1=CNC=N1)C(=O)O XAPPCWUWHNWCPQ-PBCZWWQYSA-N 0.000 description 1
- JDDYEZGPYBBPBN-JRQIVUDYSA-N Asp-Thr-Tyr Chemical compound [H]N[C@@H](CC(O)=O)C(=O)N[C@@H]([C@@H](C)O)C(=O)N[C@@H](CC1=CC=C(O)C=C1)C(O)=O JDDYEZGPYBBPBN-JRQIVUDYSA-N 0.000 description 1
- BOXNGMVEVOGXOJ-UBHSHLNASA-N Asp-Trp-Ser Chemical compound C1=CC=C2C(=C1)C(=CN2)C[C@@H](C(=O)N[C@@H](CO)C(=O)O)NC(=O)[C@H](CC(=O)O)N BOXNGMVEVOGXOJ-UBHSHLNASA-N 0.000 description 1
- NJLLRXWFPQQPHV-SRVKXCTJSA-N Asp-Tyr-Asn Chemical compound [H]N[C@@H](CC(O)=O)C(=O)N[C@@H](CC1=CC=C(O)C=C1)C(=O)N[C@@H](CC(N)=O)C(O)=O NJLLRXWFPQQPHV-SRVKXCTJSA-N 0.000 description 1
- SQIARYGNVQWOSB-BZSNNMDCSA-N Asp-Tyr-Phe Chemical compound [H]N[C@@H](CC(O)=O)C(=O)N[C@@H](CC1=CC=C(O)C=C1)C(=O)N[C@@H](CC1=CC=CC=C1)C(O)=O SQIARYGNVQWOSB-BZSNNMDCSA-N 0.000 description 1
- CZIVKMOEXPILDK-SRVKXCTJSA-N Asp-Tyr-Ser Chemical compound [H]N[C@@H](CC(O)=O)C(=O)N[C@@H](CC1=CC=C(O)C=C1)C(=O)N[C@@H](CO)C(O)=O CZIVKMOEXPILDK-SRVKXCTJSA-N 0.000 description 1
- CPMKYMGGYUFOHS-FSPLSTOPSA-N Asp-Val Chemical compound CC(C)[C@@H](C(O)=O)NC(=O)[C@@H](N)CC(O)=O CPMKYMGGYUFOHS-FSPLSTOPSA-N 0.000 description 1
- WAEDSQFVZJUHLI-BYULHYEWSA-N Asp-Val-Asp Chemical compound [H]N[C@@H](CC(O)=O)C(=O)N[C@@H](C(C)C)C(=O)N[C@@H](CC(O)=O)C(O)=O WAEDSQFVZJUHLI-BYULHYEWSA-N 0.000 description 1
- DCXYFEDJOCDNAF-UHFFFAOYSA-N Asparagine Natural products OC(=O)C(N)CC(N)=O DCXYFEDJOCDNAF-UHFFFAOYSA-N 0.000 description 1
- 241000228215 Aspergillus aculeatus Species 0.000 description 1
- 241001513093 Aspergillus awamori Species 0.000 description 1
- 241000892910 Aspergillus foetidus Species 0.000 description 1
- 241001480052 Aspergillus japonicus Species 0.000 description 1
- 241000228245 Aspergillus niger Species 0.000 description 1
- 241000020089 Atacta Species 0.000 description 1
- 241000972773 Aulopiformes Species 0.000 description 1
- 235000007319 Avena orientalis Nutrition 0.000 description 1
- 244000075850 Avena orientalis Species 0.000 description 1
- 108090001008 Avidin Proteins 0.000 description 1
- 241000193744 Bacillus amyloliquefaciens Species 0.000 description 1
- 241000193749 Bacillus coagulans Species 0.000 description 1
- 108010029675 Bacillus licheniformis alpha-amylase Proteins 0.000 description 1
- 241000194107 Bacillus megaterium Species 0.000 description 1
- 241001328127 Bacillus pseudofirmus Species 0.000 description 1
- 241000194103 Bacillus pumilus Species 0.000 description 1
- 108091005658 Basic proteases Proteins 0.000 description 1
- 241000221198 Basidiomycota Species 0.000 description 1
- 241000738452 Bembidion clarkii Species 0.000 description 1
- 235000016068 Berberis vulgaris Nutrition 0.000 description 1
- 241000335053 Beta vulgaris Species 0.000 description 1
- 102100030981 Beta-alanine-activating enzyme Human genes 0.000 description 1
- BVKZGUZCCUSVTD-UHFFFAOYSA-M Bicarbonate Chemical compound OC([O-])=O BVKZGUZCCUSVTD-UHFFFAOYSA-M 0.000 description 1
- 240000002791 Brassica napus Species 0.000 description 1
- 108700011823 Brassica napus napin Proteins 0.000 description 1
- 235000011299 Brassica oleracea var botrytis Nutrition 0.000 description 1
- 240000003259 Brassica oleracea var. botrytis Species 0.000 description 1
- 235000004977 Brassica sinapistrum Nutrition 0.000 description 1
- 241000219193 Brassicaceae Species 0.000 description 1
- 241000193764 Brevibacillus brevis Species 0.000 description 1
- 241000589513 Burkholderia cepacia Species 0.000 description 1
- 108091028026 C-DNA Proteins 0.000 description 1
- 101100520142 Caenorhabditis elegans pin-2 gene Proteins 0.000 description 1
- 101100368700 Caenorhabditis elegans tac-1 gene Proteins 0.000 description 1
- OYPRJOBELJOOCE-UHFFFAOYSA-N Calcium Chemical compound [Ca] OYPRJOBELJOOCE-UHFFFAOYSA-N 0.000 description 1
- 241000222120 Candida <Saccharomycetales> Species 0.000 description 1
- UGFAIRIUMAVXCW-UHFFFAOYSA-N Carbon monoxide Chemical compound [O+]#[C-] UGFAIRIUMAVXCW-UHFFFAOYSA-N 0.000 description 1
- OKTJSMMVPCPJKN-OUBTZVSYSA-N Carbon-13 Chemical compound [13C] OKTJSMMVPCPJKN-OUBTZVSYSA-N 0.000 description 1
- BVKZGUZCCUSVTD-UHFFFAOYSA-L Carbonate Chemical compound [O-]C([O-])=O BVKZGUZCCUSVTD-UHFFFAOYSA-L 0.000 description 1
- 229940122072 Carbonic anhydrase inhibitor Drugs 0.000 description 1
- 229920002134 Carboxymethyl cellulose Polymers 0.000 description 1
- 108010006303 Carboxypeptidases Proteins 0.000 description 1
- 102000005367 Carboxypeptidases Human genes 0.000 description 1
- 102000030523 Catechol oxidase Human genes 0.000 description 1
- 108010031396 Catechol oxidase Proteins 0.000 description 1
- 102100037633 Centrin-3 Human genes 0.000 description 1
- 229920002101 Chitin Polymers 0.000 description 1
- 108010022172 Chitinases Proteins 0.000 description 1
- 102000012286 Chitinases Human genes 0.000 description 1
- 229920001661 Chitosan Polymers 0.000 description 1
- 241000701248 Chlorella virus Species 0.000 description 1
- 241000233652 Chytridiomycota Species 0.000 description 1
- 108020004705 Codon Proteins 0.000 description 1
- 241000222511 Coprinus Species 0.000 description 1
- 244000251987 Coprinus macrorhizus Species 0.000 description 1
- 235000019750 Crude protein Nutrition 0.000 description 1
- 108010025880 Cyclomaltodextrin glucanotransferase Proteins 0.000 description 1
- HKALUUKHYNEDRS-GUBZILKMSA-N Cys-Leu-Gln Chemical compound SC[C@H](N)C(=O)N[C@@H](CC(C)C)C(=O)N[C@@H](CCC(N)=O)C(O)=O HKALUUKHYNEDRS-GUBZILKMSA-N 0.000 description 1
- WZJLBUPPZRZNTO-CIUDSAMLSA-N Cys-Ser-Lys Chemical compound C(CCN)C[C@@H](C(=O)O)NC(=O)[C@H](CO)NC(=O)[C@H](CS)N WZJLBUPPZRZNTO-CIUDSAMLSA-N 0.000 description 1
- PCRVDEANNSYGTA-IHRRRGAJSA-N Cys-Tyr-Met Chemical compound CSCC[C@@H](C(O)=O)NC(=O)[C@@H](NC(=O)[C@@H](N)CS)CC1=CC=C(O)C=C1 PCRVDEANNSYGTA-IHRRRGAJSA-N 0.000 description 1
- 102000004127 Cytokines Human genes 0.000 description 1
- 108090000695 Cytokines Proteins 0.000 description 1
- RFSUNEUAIZKAJO-VRPWFDPXSA-N D-Fructose Natural products OC[C@H]1OC(O)(CO)[C@@H](O)[C@@H]1O RFSUNEUAIZKAJO-VRPWFDPXSA-N 0.000 description 1
- 102000053602 DNA Human genes 0.000 description 1
- 102000016559 DNA Primase Human genes 0.000 description 1
- 108010092681 DNA Primase Proteins 0.000 description 1
- 238000007399 DNA isolation Methods 0.000 description 1
- 239000003298 DNA probe Substances 0.000 description 1
- 108010053770 Deoxyribonucleases Proteins 0.000 description 1
- 102000016911 Deoxyribonucleases Human genes 0.000 description 1
- 239000004375 Dextrin Substances 0.000 description 1
- 229920001353 Dextrin Polymers 0.000 description 1
- KCXVZYZYPLLWCC-UHFFFAOYSA-N EDTA Chemical compound OC(=O)CN(CC(O)=O)CCN(CC(O)=O)CC(O)=O KCXVZYZYPLLWCC-UHFFFAOYSA-N 0.000 description 1
- 108090000371 Esterases Proteins 0.000 description 1
- 241000234642 Festuca Species 0.000 description 1
- 241000192125 Firmicutes Species 0.000 description 1
- 244000182067 Fraxinus ornus Species 0.000 description 1
- 235000002917 Fraxinus ornus Nutrition 0.000 description 1
- RFSUNEUAIZKAJO-ARQDHWQXSA-N Fructose Chemical compound OC[C@H]1O[C@](O)(CO)[C@@H](O)[C@@H]1O RFSUNEUAIZKAJO-ARQDHWQXSA-N 0.000 description 1
- 241000145614 Fusarium bactridioides Species 0.000 description 1
- 241000223195 Fusarium graminearum Species 0.000 description 1
- 241000146406 Fusarium heterosporum Species 0.000 description 1
- 241000221779 Fusarium sambucinum Species 0.000 description 1
- 241001014439 Fusarium sarcochroum Species 0.000 description 1
- 241000223192 Fusarium sporotrichioides Species 0.000 description 1
- 241001465753 Fusarium torulosum Species 0.000 description 1
- 241001200922 Gagata Species 0.000 description 1
- 108010010803 Gelatin Proteins 0.000 description 1
- 108700007698 Genetic Terminator Regions Proteins 0.000 description 1
- RZSLYUUFFVHFRQ-FXQIFTODSA-N Gln-Ala-Glu Chemical compound [H]N[C@@H](CCC(N)=O)C(=O)N[C@@H](C)C(=O)N[C@@H](CCC(O)=O)C(O)=O RZSLYUUFFVHFRQ-FXQIFTODSA-N 0.000 description 1
- LMPBBFWHCRURJD-LAEOZQHASA-N Gln-Asn-Val Chemical compound CC(C)[C@@H](C(=O)O)NC(=O)[C@H](CC(=O)N)NC(=O)[C@H](CCC(=O)N)N LMPBBFWHCRURJD-LAEOZQHASA-N 0.000 description 1
- NVEASDQHBRZPSU-BQBZGAKWSA-N Gln-Gln-Gly Chemical compound [H]N[C@@H](CCC(N)=O)C(=O)N[C@@H](CCC(N)=O)C(=O)NCC(O)=O NVEASDQHBRZPSU-BQBZGAKWSA-N 0.000 description 1
- IKFZXRLDMYWNBU-YUMQZZPRSA-N Gln-Gly-Arg Chemical compound NC(=O)CC[C@H](N)C(=O)NCC(=O)N[C@H](C(O)=O)CCCN=C(N)N IKFZXRLDMYWNBU-YUMQZZPRSA-N 0.000 description 1
- MFJAPSYJQJCQDN-BQBZGAKWSA-N Gln-Gly-Glu Chemical compound NC(=O)CC[C@H](N)C(=O)NCC(=O)N[C@@H](CCC(O)=O)C(O)=O MFJAPSYJQJCQDN-BQBZGAKWSA-N 0.000 description 1
- XSBGUANSZDGULP-IUCAKERBSA-N Gln-Gly-Lys Chemical compound [H]N[C@@H](CCC(N)=O)C(=O)NCC(=O)N[C@@H](CCCCN)C(O)=O XSBGUANSZDGULP-IUCAKERBSA-N 0.000 description 1
- YRWWJCDWLVXTHN-LAEOZQHASA-N Gln-Ile-Gly Chemical compound CC[C@H](C)[C@@H](C(=O)NCC(=O)O)NC(=O)[C@H](CCC(=O)N)N YRWWJCDWLVXTHN-LAEOZQHASA-N 0.000 description 1
- CLSDNFWKGFJIBZ-YUMQZZPRSA-N Gln-Lys Chemical compound NCCCC[C@@H](C(O)=O)NC(=O)[C@@H](N)CCC(N)=O CLSDNFWKGFJIBZ-YUMQZZPRSA-N 0.000 description 1
- XUZQMPGBGFQJMY-SRVKXCTJSA-N Gln-Met-His Chemical compound CSCC[C@@H](C(=O)N[C@@H](CC1=CN=CN1)C(=O)O)NC(=O)[C@H](CCC(=O)N)N XUZQMPGBGFQJMY-SRVKXCTJSA-N 0.000 description 1
- AQPZYBSRDRZBAG-AVGNSLFASA-N Gln-Phe-Asn Chemical compound C1=CC=C(C=C1)C[C@@H](C(=O)N[C@@H](CC(=O)N)C(=O)O)NC(=O)[C@H](CCC(=O)N)N AQPZYBSRDRZBAG-AVGNSLFASA-N 0.000 description 1
- XZUUUKNKNWVPHQ-JYJNAYRXSA-N Gln-Phe-Leu Chemical compound [H]N[C@@H](CCC(N)=O)C(=O)N[C@@H](CC1=CC=CC=C1)C(=O)N[C@@H](CC(C)C)C(O)=O XZUUUKNKNWVPHQ-JYJNAYRXSA-N 0.000 description 1
- PDXIOFXRBVDSHD-JBACZVJFSA-N Gln-Phe-Trp Chemical compound C1=CC=C(C=C1)C[C@@H](C(=O)N[C@@H](CC2=CNC3=CC=CC=C32)C(=O)O)NC(=O)[C@H](CCC(=O)N)N PDXIOFXRBVDSHD-JBACZVJFSA-N 0.000 description 1
- VLOLPWWCNKWRNB-LOKLDPHHSA-N Gln-Thr-Pro Chemical compound C[C@H]([C@@H](C(=O)N1CCC[C@@H]1C(=O)O)NC(=O)[C@H](CCC(=O)N)N)O VLOLPWWCNKWRNB-LOKLDPHHSA-N 0.000 description 1
- STHSGOZLFLFGSS-SUSMZKCASA-N Gln-Thr-Thr Chemical compound [H]N[C@@H](CCC(N)=O)C(=O)N[C@@H]([C@@H](C)O)C(=O)N[C@@H]([C@@H](C)O)C(O)=O STHSGOZLFLFGSS-SUSMZKCASA-N 0.000 description 1
- VDMABHYXBULDGN-LAEOZQHASA-N Gln-Val-Asp Chemical compound [H]N[C@@H](CCC(N)=O)C(=O)N[C@@H](C(C)C)C(=O)N[C@@H](CC(O)=O)C(O)=O VDMABHYXBULDGN-LAEOZQHASA-N 0.000 description 1
- 108010044091 Globulins Proteins 0.000 description 1
- 102000006395 Globulins Human genes 0.000 description 1
- WZZSKAJIHTUUSG-ACZMJKKPSA-N Glu-Ala-Asp Chemical compound OC(=O)C[C@@H](C(O)=O)NC(=O)[C@H](C)NC(=O)[C@@H](N)CCC(O)=O WZZSKAJIHTUUSG-ACZMJKKPSA-N 0.000 description 1
- MPZWMIIOPAPAKE-BQBZGAKWSA-N Glu-Arg Chemical compound OC(=O)CC[C@H](N)C(=O)N[C@H](C(O)=O)CCCNC(N)=N MPZWMIIOPAPAKE-BQBZGAKWSA-N 0.000 description 1
- NLKVNZUFDPWPNL-YUMQZZPRSA-N Glu-Arg-Gly Chemical compound [H]N[C@@H](CCC(O)=O)C(=O)N[C@@H](CCCNC(N)=N)C(=O)NCC(O)=O NLKVNZUFDPWPNL-YUMQZZPRSA-N 0.000 description 1
- GCYFUZJHAXJKKE-KKUMJFAQSA-N Glu-Arg-Tyr Chemical compound [H]N[C@@H](CCC(O)=O)C(=O)N[C@@H](CCCNC(N)=N)C(=O)N[C@@H](CC1=CC=C(O)C=C1)C(O)=O GCYFUZJHAXJKKE-KKUMJFAQSA-N 0.000 description 1
- SBYVDRJAXWSXQL-AVGNSLFASA-N Glu-Asn-Phe Chemical compound [H]N[C@@H](CCC(O)=O)C(=O)N[C@@H](CC(N)=O)C(=O)N[C@@H](CC1=CC=CC=C1)C(O)=O SBYVDRJAXWSXQL-AVGNSLFASA-N 0.000 description 1
- PCBBLFVHTYNQGG-LAEOZQHASA-N Glu-Asn-Val Chemical compound CC(C)[C@@H](C(=O)O)NC(=O)[C@H](CC(=O)N)NC(=O)[C@H](CCC(=O)O)N PCBBLFVHTYNQGG-LAEOZQHASA-N 0.000 description 1
- IESFZVCAVACGPH-PEFMBERDSA-N Glu-Asp-Ile Chemical compound CC[C@H](C)[C@@H](C(O)=O)NC(=O)[C@H](CC(O)=O)NC(=O)[C@@H](N)CCC(O)=O IESFZVCAVACGPH-PEFMBERDSA-N 0.000 description 1
- PAQUJCSYVIBPLC-AVGNSLFASA-N Glu-Asp-Phe Chemical compound OC(=O)CC[C@H](N)C(=O)N[C@@H](CC(O)=O)C(=O)N[C@H](C(O)=O)CC1=CC=CC=C1 PAQUJCSYVIBPLC-AVGNSLFASA-N 0.000 description 1
- OXEMJGCAJFFREE-FXQIFTODSA-N Glu-Gln-Ala Chemical compound [H]N[C@@H](CCC(O)=O)C(=O)N[C@@H](CCC(N)=O)C(=O)N[C@@H](C)C(O)=O OXEMJGCAJFFREE-FXQIFTODSA-N 0.000 description 1
- XHUCVVHRLNPZSZ-CIUDSAMLSA-N Glu-Gln-Glu Chemical compound [H]N[C@@H](CCC(O)=O)C(=O)N[C@@H](CCC(N)=O)C(=O)N[C@@H](CCC(O)=O)C(O)=O XHUCVVHRLNPZSZ-CIUDSAMLSA-N 0.000 description 1
- WPLGNDORMXTMQS-FXQIFTODSA-N Glu-Gln-Ser Chemical compound OC(=O)CC[C@H](N)C(=O)N[C@@H](CCC(N)=O)C(=O)N[C@@H](CO)C(O)=O WPLGNDORMXTMQS-FXQIFTODSA-N 0.000 description 1
- HNVFSTLPVJWIDV-CIUDSAMLSA-N Glu-Glu-Gln Chemical compound OC(=O)CC[C@H](N)C(=O)N[C@@H](CCC(O)=O)C(=O)N[C@@H](CCC(N)=O)C(O)=O HNVFSTLPVJWIDV-CIUDSAMLSA-N 0.000 description 1
- OGNJZUXUTPQVBR-BQBZGAKWSA-N Glu-Gly-Glu Chemical compound OC(=O)CC[C@H](N)C(=O)NCC(=O)N[C@@H](CCC(O)=O)C(O)=O OGNJZUXUTPQVBR-BQBZGAKWSA-N 0.000 description 1
- KRGZZKWSBGPLKL-IUCAKERBSA-N Glu-Gly-Lys Chemical compound C(CCN)C[C@@H](C(=O)O)NC(=O)CNC(=O)[C@H](CCC(=O)O)N KRGZZKWSBGPLKL-IUCAKERBSA-N 0.000 description 1
- ZWQVYZXPYSYPJD-RYUDHWBXSA-N Glu-Gly-Phe Chemical compound OC(=O)CC[C@H](N)C(=O)NCC(=O)N[C@H](C(O)=O)CC1=CC=CC=C1 ZWQVYZXPYSYPJD-RYUDHWBXSA-N 0.000 description 1
- OPAINBJQDQTGJY-JGVFFNPUSA-N Glu-Gly-Pro Chemical compound C1C[C@@H](N(C1)C(=O)CNC(=O)[C@H](CCC(=O)O)N)C(=O)O OPAINBJQDQTGJY-JGVFFNPUSA-N 0.000 description 1
- WDTAKCUOIKHCTB-NKIYYHGXSA-N Glu-His-Thr Chemical compound C[C@H]([C@@H](C(=O)O)NC(=O)[C@H](CC1=CN=CN1)NC(=O)[C@H](CCC(=O)O)N)O WDTAKCUOIKHCTB-NKIYYHGXSA-N 0.000 description 1
- GRHXUHCFENOCOS-ZPFDUUQYSA-N Glu-Ile-Met Chemical compound CC[C@H](C)[C@@H](C(=O)N[C@@H](CCSC)C(=O)O)NC(=O)[C@H](CCC(=O)O)N GRHXUHCFENOCOS-ZPFDUUQYSA-N 0.000 description 1
- NWOUBJNMZDDGDT-AVGNSLFASA-N Glu-Leu-His Chemical compound OC(=O)CC[C@H](N)C(=O)N[C@@H](CC(C)C)C(=O)N[C@H](C(O)=O)CC1=CN=CN1 NWOUBJNMZDDGDT-AVGNSLFASA-N 0.000 description 1
- UGSVSNXPJJDJKL-SDDRHHMPSA-N Glu-Leu-Pro Chemical compound CC(C)C[C@@H](C(=O)N1CCC[C@@H]1C(=O)O)NC(=O)[C@H](CCC(=O)O)N UGSVSNXPJJDJKL-SDDRHHMPSA-N 0.000 description 1
- GJBUAAAIZSRCDC-GVXVVHGQSA-N Glu-Leu-Val Chemical compound [H]N[C@@H](CCC(O)=O)C(=O)N[C@@H](CC(C)C)C(=O)N[C@@H](C(C)C)C(O)=O GJBUAAAIZSRCDC-GVXVVHGQSA-N 0.000 description 1
- ILWHFUZZCFYSKT-AVGNSLFASA-N Glu-Lys-Leu Chemical compound [H]N[C@@H](CCC(O)=O)C(=O)N[C@@H](CCCCN)C(=O)N[C@@H](CC(C)C)C(O)=O ILWHFUZZCFYSKT-AVGNSLFASA-N 0.000 description 1
- XMBSYZWANAQXEV-QWRGUYRKSA-N Glu-Phe Chemical compound OC(=O)CC[C@H](N)C(=O)N[C@H](C(O)=O)CC1=CC=CC=C1 XMBSYZWANAQXEV-QWRGUYRKSA-N 0.000 description 1
- UERORLSAFUHDGU-AVGNSLFASA-N Glu-Phe-Asn Chemical compound C1=CC=C(C=C1)C[C@@H](C(=O)N[C@@H](CC(=O)N)C(=O)O)NC(=O)[C@H](CCC(=O)O)N UERORLSAFUHDGU-AVGNSLFASA-N 0.000 description 1
- CQAHWYDHKUWYIX-YUMQZZPRSA-N Glu-Pro-Gly Chemical compound OC(=O)CC[C@H](N)C(=O)N1CCC[C@H]1C(=O)NCC(O)=O CQAHWYDHKUWYIX-YUMQZZPRSA-N 0.000 description 1
- NNQDRRUXFJYCCJ-NHCYSSNCSA-N Glu-Pro-Val Chemical compound [H]N[C@@H](CCC(O)=O)C(=O)N1CCC[C@H]1C(=O)N[C@@H](C(C)C)C(O)=O NNQDRRUXFJYCCJ-NHCYSSNCSA-N 0.000 description 1
- UQHGAYSULGRWRG-WHFBIAKZSA-N Glu-Ser Chemical compound OC(=O)CC[C@H](N)C(=O)N[C@@H](CO)C(O)=O UQHGAYSULGRWRG-WHFBIAKZSA-N 0.000 description 1
- MRWYPDWDZSLWJM-ACZMJKKPSA-N Glu-Ser-Asp Chemical compound [H]N[C@@H](CCC(O)=O)C(=O)N[C@@H](CO)C(=O)N[C@@H](CC(O)=O)C(O)=O MRWYPDWDZSLWJM-ACZMJKKPSA-N 0.000 description 1
- RFTVTKBHDXCEEX-WDSKDSINSA-N Glu-Ser-Gly Chemical compound [H]N[C@@H](CCC(O)=O)C(=O)N[C@@H](CO)C(=O)NCC(O)=O RFTVTKBHDXCEEX-WDSKDSINSA-N 0.000 description 1
- DMYACXMQUABZIQ-NRPADANISA-N Glu-Ser-Val Chemical compound [H]N[C@@H](CCC(O)=O)C(=O)N[C@@H](CO)C(=O)N[C@@H](C(C)C)C(O)=O DMYACXMQUABZIQ-NRPADANISA-N 0.000 description 1
- BDISFWMLMNBTGP-NUMRIWBASA-N Glu-Thr-Asp Chemical compound [H]N[C@@H](CCC(O)=O)C(=O)N[C@@H]([C@@H](C)O)C(=O)N[C@@H](CC(O)=O)C(O)=O BDISFWMLMNBTGP-NUMRIWBASA-N 0.000 description 1
- GPSHCSTUYOQPAI-JHEQGTHGSA-N Glu-Thr-Gly Chemical compound [H]N[C@@H](CCC(O)=O)C(=O)N[C@@H]([C@@H](C)O)C(=O)NCC(O)=O GPSHCSTUYOQPAI-JHEQGTHGSA-N 0.000 description 1
- DTLLNDVORUEOTM-WDCWCFNPSA-N Glu-Thr-Lys Chemical compound [H]N[C@@H](CCC(O)=O)C(=O)N[C@@H]([C@@H](C)O)C(=O)N[C@@H](CCCCN)C(O)=O DTLLNDVORUEOTM-WDCWCFNPSA-N 0.000 description 1
- UQULNJAARAXSPO-ZCWPNWOLSA-N Glu-Thr-Thr-Tyr Chemical compound OC(=O)CC[C@H](N)C(=O)N[C@@H]([C@H](O)C)C(=O)N[C@@H]([C@@H](C)O)C(=O)N[C@H](C(O)=O)CC1=CC=C(O)C=C1 UQULNJAARAXSPO-ZCWPNWOLSA-N 0.000 description 1
- YSWHPLCDIMUKFE-QWRGUYRKSA-N Glu-Tyr Chemical compound OC(=O)CC[C@H](N)C(=O)N[C@H](C(O)=O)CC1=CC=C(O)C=C1 YSWHPLCDIMUKFE-QWRGUYRKSA-N 0.000 description 1
- NTHIHAUEXVTXQG-KKUMJFAQSA-N Glu-Tyr-Arg Chemical compound C1=CC(=CC=C1C[C@@H](C(=O)N[C@@H](CCCN=C(N)N)C(=O)O)NC(=O)[C@H](CCC(=O)O)N)O NTHIHAUEXVTXQG-KKUMJFAQSA-N 0.000 description 1
- PMSDOVISAARGAV-FHWLQOOXSA-N Glu-Tyr-Phe Chemical compound C([C@H](NC(=O)[C@H](CCC(O)=O)N)C(=O)N[C@@H](CC=1C=CC=CC=1)C(O)=O)C1=CC=C(O)C=C1 PMSDOVISAARGAV-FHWLQOOXSA-N 0.000 description 1
- 229920001503 Glucan Polymers 0.000 description 1
- WQZGKKKJIJFFOK-GASJEMHNSA-N Glucose Natural products OC[C@H]1OC(O)[C@H](O)[C@@H](O)[C@@H]1O WQZGKKKJIJFFOK-GASJEMHNSA-N 0.000 description 1
- 108010068370 Glutens Proteins 0.000 description 1
- LJPIRKICOISLKN-WHFBIAKZSA-N Gly-Ala-Ser Chemical compound NCC(=O)N[C@@H](C)C(=O)N[C@@H](CO)C(O)=O LJPIRKICOISLKN-WHFBIAKZSA-N 0.000 description 1
- DWUKOTKSTDWGAE-BQBZGAKWSA-N Gly-Asn-Arg Chemical compound NCC(=O)N[C@@H](CC(N)=O)C(=O)N[C@H](C(O)=O)CCCN=C(N)N DWUKOTKSTDWGAE-BQBZGAKWSA-N 0.000 description 1
- JVWPPCWUDRJGAE-YUMQZZPRSA-N Gly-Asn-Leu Chemical compound [H]NCC(=O)N[C@@H](CC(N)=O)C(=O)N[C@@H](CC(C)C)C(O)=O JVWPPCWUDRJGAE-YUMQZZPRSA-N 0.000 description 1
- JVACNFOPSUPDTK-QWRGUYRKSA-N Gly-Asn-Phe Chemical compound NCC(=O)N[C@@H](CC(N)=O)C(=O)N[C@H](C(O)=O)CC1=CC=CC=C1 JVACNFOPSUPDTK-QWRGUYRKSA-N 0.000 description 1
- BYYNJRSNDARRBX-YFKPBYRVSA-N Gly-Gln-Gly Chemical compound NCC(=O)N[C@@H](CCC(N)=O)C(=O)NCC(O)=O BYYNJRSNDARRBX-YFKPBYRVSA-N 0.000 description 1
- YYPFZVIXAVDHIK-IUCAKERBSA-N Gly-Glu-Leu Chemical compound CC(C)C[C@@H](C(O)=O)NC(=O)[C@H](CCC(O)=O)NC(=O)CN YYPFZVIXAVDHIK-IUCAKERBSA-N 0.000 description 1
- ZQIMMEYPEXIYBB-IUCAKERBSA-N Gly-Glu-Lys Chemical compound NCCCC[C@@H](C(O)=O)NC(=O)[C@H](CCC(O)=O)NC(=O)CN ZQIMMEYPEXIYBB-IUCAKERBSA-N 0.000 description 1
- LHRXAHLCRMQBGJ-RYUDHWBXSA-N Gly-Glu-Phe Chemical compound C1=CC=C(C=C1)C[C@@H](C(=O)O)NC(=O)[C@H](CCC(=O)O)NC(=O)CN LHRXAHLCRMQBGJ-RYUDHWBXSA-N 0.000 description 1
- QSVCIFZPGLOZGH-WDSKDSINSA-N Gly-Glu-Ser Chemical compound NCC(=O)N[C@@H](CCC(O)=O)C(=O)N[C@@H](CO)C(O)=O QSVCIFZPGLOZGH-WDSKDSINSA-N 0.000 description 1
- INLIXXRWNUKVCF-JTQLQIEISA-N Gly-Gly-Tyr Chemical compound NCC(=O)NCC(=O)N[C@H](C(O)=O)CC1=CC=C(O)C=C1 INLIXXRWNUKVCF-JTQLQIEISA-N 0.000 description 1
- HHSOPSCKAZKQHQ-PEXQALLHSA-N Gly-His-Ile Chemical compound CC[C@H](C)[C@@H](C(=O)O)NC(=O)[C@H](CC1=CN=CN1)NC(=O)CN HHSOPSCKAZKQHQ-PEXQALLHSA-N 0.000 description 1
- HKSNHPVETYYJBK-LAEOZQHASA-N Gly-Ile-Glu Chemical compound CC[C@H](C)[C@@H](C(=O)N[C@@H](CCC(=O)O)C(=O)O)NC(=O)CN HKSNHPVETYYJBK-LAEOZQHASA-N 0.000 description 1
- UESJMAMHDLEHGM-NHCYSSNCSA-N Gly-Ile-Leu Chemical compound NCC(=O)N[C@@H]([C@@H](C)CC)C(=O)N[C@@H](CC(C)C)C(O)=O UESJMAMHDLEHGM-NHCYSSNCSA-N 0.000 description 1
- PAWIVEIWWYGBAM-YUMQZZPRSA-N Gly-Leu-Ala Chemical compound NCC(=O)N[C@@H](CC(C)C)C(=O)N[C@@H](C)C(O)=O PAWIVEIWWYGBAM-YUMQZZPRSA-N 0.000 description 1
- TWTPDFFBLQEBOE-IUCAKERBSA-N Gly-Leu-Gln Chemical compound [H]NCC(=O)N[C@@H](CC(C)C)C(=O)N[C@@H](CCC(N)=O)C(O)=O TWTPDFFBLQEBOE-IUCAKERBSA-N 0.000 description 1
- CLNSYANKYVMZNM-UWVGGRQHSA-N Gly-Lys-Arg Chemical compound NCCCC[C@H](NC(=O)CN)C(=O)N[C@H](C(O)=O)CCCN=C(N)N CLNSYANKYVMZNM-UWVGGRQHSA-N 0.000 description 1
- CVFOYJJOZYYEPE-KBPBESRZSA-N Gly-Lys-Tyr Chemical compound [H]NCC(=O)N[C@@H](CCCCN)C(=O)N[C@@H](CC1=CC=C(O)C=C1)C(O)=O CVFOYJJOZYYEPE-KBPBESRZSA-N 0.000 description 1
- OQQKUTVULYLCDG-ONGXEEELSA-N Gly-Lys-Val Chemical compound CC(C)[C@H](NC(=O)[C@H](CCCCN)NC(=O)CN)C(O)=O OQQKUTVULYLCDG-ONGXEEELSA-N 0.000 description 1
- IFHJOBKVXBESRE-YUMQZZPRSA-N Gly-Met-Gln Chemical compound CSCC[C@@H](C(=O)N[C@@H](CCC(=O)N)C(=O)O)NC(=O)CN IFHJOBKVXBESRE-YUMQZZPRSA-N 0.000 description 1
- ZWRDOVYMQAAISL-UWVGGRQHSA-N Gly-Met-Lys Chemical compound CSCC[C@H](NC(=O)CN)C(=O)N[C@H](C(O)=O)CCCCN ZWRDOVYMQAAISL-UWVGGRQHSA-N 0.000 description 1
- GGAPHLIUUTVYMX-QWRGUYRKSA-N Gly-Phe-Ser Chemical compound OC[C@@H](C([O-])=O)NC(=O)[C@@H](NC(=O)C[NH3+])CC1=CC=CC=C1 GGAPHLIUUTVYMX-QWRGUYRKSA-N 0.000 description 1
- WNZOCXUOGVYYBJ-CDMKHQONSA-N Gly-Phe-Thr Chemical compound C[C@H]([C@@H](C(=O)O)NC(=O)[C@H](CC1=CC=CC=C1)NC(=O)CN)O WNZOCXUOGVYYBJ-CDMKHQONSA-N 0.000 description 1
- WDXLKVQATNEAJQ-BQBZGAKWSA-N Gly-Pro-Asp Chemical compound NCC(=O)N1CCC[C@H]1C(=O)N[C@@H](CC(O)=O)C(O)=O WDXLKVQATNEAJQ-BQBZGAKWSA-N 0.000 description 1
- JJGBXTYGTKWGAT-YUMQZZPRSA-N Gly-Pro-Glu Chemical compound NCC(=O)N1CCC[C@H]1C(=O)N[C@@H](CCC(O)=O)C(O)=O JJGBXTYGTKWGAT-YUMQZZPRSA-N 0.000 description 1
- BCCRXDTUTZHDEU-VKHMYHEASA-N Gly-Ser Chemical compound NCC(=O)N[C@@H](CO)C(O)=O BCCRXDTUTZHDEU-VKHMYHEASA-N 0.000 description 1
- SOEGEPHNZOISMT-BYPYZUCNSA-N Gly-Ser-Gly Chemical compound NCC(=O)N[C@@H](CO)C(=O)NCC(O)=O SOEGEPHNZOISMT-BYPYZUCNSA-N 0.000 description 1
- VNNRLUNBJSWZPF-ZKWXMUAHSA-N Gly-Ser-Ile Chemical compound [H]NCC(=O)N[C@@H](CO)C(=O)N[C@@H]([C@@H](C)CC)C(O)=O VNNRLUNBJSWZPF-ZKWXMUAHSA-N 0.000 description 1
- LCRDMSSAKLTKBU-ZDLURKLDSA-N Gly-Ser-Thr Chemical compound C[C@@H](O)[C@@H](C(O)=O)NC(=O)[C@H](CO)NC(=O)CN LCRDMSSAKLTKBU-ZDLURKLDSA-N 0.000 description 1
- FKYQEVBRZSFAMJ-QWRGUYRKSA-N Gly-Ser-Tyr Chemical compound NCC(=O)N[C@@H](CO)C(=O)N[C@H](C(O)=O)CC1=CC=C(O)C=C1 FKYQEVBRZSFAMJ-QWRGUYRKSA-N 0.000 description 1
- NVTPVQLIZCOJFK-FOHZUACHSA-N Gly-Thr-Asp Chemical compound [H]NCC(=O)N[C@@H]([C@@H](C)O)C(=O)N[C@@H](CC(O)=O)C(O)=O NVTPVQLIZCOJFK-FOHZUACHSA-N 0.000 description 1
- FFALDIDGPLUDKV-ZDLURKLDSA-N Gly-Thr-Ser Chemical compound [H]NCC(=O)N[C@@H]([C@@H](C)O)C(=O)N[C@@H](CO)C(O)=O FFALDIDGPLUDKV-ZDLURKLDSA-N 0.000 description 1
- AJHCSUXXECOXOY-NSHDSACASA-N Gly-Trp Chemical compound C1=CC=C2C(C[C@H](NC(=O)CN)C(O)=O)=CNC2=C1 AJHCSUXXECOXOY-NSHDSACASA-N 0.000 description 1
- RJVZMGQMJOQIAX-GJZGRUSLSA-N Gly-Trp-Met Chemical compound [H]NCC(=O)N[C@@H](CC1=CNC2=C1C=CC=C2)C(=O)N[C@@H](CCSC)C(O)=O RJVZMGQMJOQIAX-GJZGRUSLSA-N 0.000 description 1
- NGBGZCUWFVVJKC-IRXDYDNUSA-N Gly-Tyr-Tyr Chemical compound C([C@H](NC(=O)CN)C(=O)N[C@@H](CC=1C=CC(O)=CC=1)C(O)=O)C1=CC=C(O)C=C1 NGBGZCUWFVVJKC-IRXDYDNUSA-N 0.000 description 1
- ZVXMEWXHFBYJPI-LSJOCFKGSA-N Gly-Val-Ile Chemical compound [H]NCC(=O)N[C@@H](C(C)C)C(=O)N[C@@H]([C@@H](C)CC)C(O)=O ZVXMEWXHFBYJPI-LSJOCFKGSA-N 0.000 description 1
- FNXSYBOHALPRHV-ONGXEEELSA-N Gly-Val-Lys Chemical compound NCC(=O)N[C@@H](C(C)C)C(=O)N[C@H](C(O)=O)CCCCN FNXSYBOHALPRHV-ONGXEEELSA-N 0.000 description 1
- IZVICCORZOSGPT-JSGCOSHPSA-N Gly-Val-Tyr Chemical compound [H]NCC(=O)N[C@@H](C(C)C)C(=O)N[C@@H](CC1=CC=C(O)C=C1)C(O)=O IZVICCORZOSGPT-JSGCOSHPSA-N 0.000 description 1
- 239000004471 Glycine Substances 0.000 description 1
- 244000068988 Glycine max Species 0.000 description 1
- 235000010469 Glycine max Nutrition 0.000 description 1
- RVKIPWVMZANZLI-UHFFFAOYSA-N H-Lys-Trp-OH Natural products C1=CC=C2C(CC(NC(=O)C(N)CCCCN)C(O)=O)=CNC2=C1 RVKIPWVMZANZLI-UHFFFAOYSA-N 0.000 description 1
- 101150009006 HIS3 gene Proteins 0.000 description 1
- 241001235200 Haemophilus influenzae Rd KW20 Species 0.000 description 1
- 101100295959 Halobacterium salinarum (strain ATCC 700922 / JCM 11081 / NRC-1) arcB gene Proteins 0.000 description 1
- 101100246753 Halobacterium salinarum (strain ATCC 700922 / JCM 11081 / NRC-1) pyrF gene Proteins 0.000 description 1
- 241000590002 Helicobacter pylori Species 0.000 description 1
- 241000238631 Hexapoda Species 0.000 description 1
- KYMUEAZVLPRVAE-GUBZILKMSA-N His-Asn-Glu Chemical compound [H]N[C@@H](CC1=CNC=N1)C(=O)N[C@@H](CC(N)=O)C(=O)N[C@@H](CCC(O)=O)C(O)=O KYMUEAZVLPRVAE-GUBZILKMSA-N 0.000 description 1
- RXVOMIADLXPJGW-GUBZILKMSA-N His-Asp-Glu Chemical compound [H]N[C@@H](CC1=CNC=N1)C(=O)N[C@@H](CC(O)=O)C(=O)N[C@@H](CCC(O)=O)C(O)=O RXVOMIADLXPJGW-GUBZILKMSA-N 0.000 description 1
- VHOLZZKNEBBHTH-YUMQZZPRSA-N His-Glu Chemical compound OC(=O)CC[C@@H](C(O)=O)NC(=O)[C@@H](N)CC1=CNC=N1 VHOLZZKNEBBHTH-YUMQZZPRSA-N 0.000 description 1
- SDTPKSOWFXBACN-GUBZILKMSA-N His-Glu-Asp Chemical compound [H]N[C@@H](CC1=CNC=N1)C(=O)N[C@@H](CCC(O)=O)C(=O)N[C@@H](CC(O)=O)C(O)=O SDTPKSOWFXBACN-GUBZILKMSA-N 0.000 description 1
- NTXIJPDAHXSHNL-ONGXEEELSA-N His-Gly-Val Chemical compound [H]N[C@@H](CC1=CNC=N1)C(=O)NCC(=O)N[C@@H](C(C)C)C(O)=O NTXIJPDAHXSHNL-ONGXEEELSA-N 0.000 description 1
- JSQIXEHORHLQEE-MEYUZBJRSA-N His-Phe-Thr Chemical compound [H]N[C@@H](CC1=CNC=N1)C(=O)N[C@@H](CC1=CC=CC=C1)C(=O)N[C@@H]([C@@H](C)O)C(O)=O JSQIXEHORHLQEE-MEYUZBJRSA-N 0.000 description 1
- ZHHLTWUOWXHVQJ-YUMQZZPRSA-N His-Ser-Gly Chemical compound C1=C(NC=N1)C[C@@H](C(=O)N[C@@H](CO)C(=O)NCC(=O)O)N ZHHLTWUOWXHVQJ-YUMQZZPRSA-N 0.000 description 1
- WRPDZHJNLYNFFT-GEVIPFJHSA-N His-Thr Chemical compound C[C@@H]([C@@H](C(=O)O)NC(=O)[C@H](CC1=CN=CN1)N)O WRPDZHJNLYNFFT-GEVIPFJHSA-N 0.000 description 1
- XVZJRZQIHJMUBG-TUBUOCAGSA-N His-Thr-Ile Chemical compound CC[C@H](C)[C@@H](C(=O)O)NC(=O)[C@H]([C@@H](C)O)NC(=O)[C@H](CC1=CN=CN1)N XVZJRZQIHJMUBG-TUBUOCAGSA-N 0.000 description 1
- HTOOKGDPMXSJSY-STQMWFEESA-N His-Tyr Chemical compound C([C@H](N)C(=O)N[C@@H](CC=1C=CC(O)=CC=1)C(O)=O)C1=CN=CN1 HTOOKGDPMXSJSY-STQMWFEESA-N 0.000 description 1
- CSTDQOOBZBAJKE-BWAGICSOSA-N His-Tyr-Thr Chemical compound C[C@H]([C@@H](C(=O)O)NC(=O)[C@H](CC1=CC=C(C=C1)O)NC(=O)[C@H](CC2=CN=CN2)N)O CSTDQOOBZBAJKE-BWAGICSOSA-N 0.000 description 1
- KFQDSSNYWKZFOO-LSJOCFKGSA-N His-Val-Ala Chemical compound [H]N[C@@H](CC1=CNC=N1)C(=O)N[C@@H](C(C)C)C(=O)N[C@@H](C)C(O)=O KFQDSSNYWKZFOO-LSJOCFKGSA-N 0.000 description 1
- 101000773364 Homo sapiens Beta-alanine-activating enzyme Proteins 0.000 description 1
- 101000880522 Homo sapiens Centrin-3 Proteins 0.000 description 1
- 240000005979 Hordeum vulgare Species 0.000 description 1
- 235000007340 Hordeum vulgare Nutrition 0.000 description 1
- 206010020649 Hyperkeratosis Diseases 0.000 description 1
- WKXVAXOSIPTXEC-HAFWLYHUSA-N Ile-Asp Chemical compound CC[C@H](C)[C@H](N)C(=O)N[C@H](C(O)=O)CC(O)=O WKXVAXOSIPTXEC-HAFWLYHUSA-N 0.000 description 1
- QSPLUJGYOPZINY-ZPFDUUQYSA-N Ile-Asp-Lys Chemical compound CC[C@H](C)[C@@H](C(=O)N[C@@H](CC(=O)O)C(=O)N[C@@H](CCCCN)C(=O)O)N QSPLUJGYOPZINY-ZPFDUUQYSA-N 0.000 description 1
- NPROWIBAWYMPAZ-GUDRVLHUSA-N Ile-Asp-Pro Chemical compound CC[C@H](C)[C@@H](C(=O)N[C@@H](CC(=O)O)C(=O)N1CCC[C@@H]1C(=O)O)N NPROWIBAWYMPAZ-GUDRVLHUSA-N 0.000 description 1
- ZDNORQNHCJUVOV-KBIXCLLPSA-N Ile-Gln-Ala Chemical compound CC[C@H](C)[C@H](N)C(=O)N[C@@H](CCC(N)=O)C(=O)N[C@@H](C)C(O)=O ZDNORQNHCJUVOV-KBIXCLLPSA-N 0.000 description 1
- KTGFOCFYOZQVRJ-ZKWXMUAHSA-N Ile-Glu Chemical compound CC[C@H](C)[C@H](N)C(=O)N[C@H](C(O)=O)CCC(O)=O KTGFOCFYOZQVRJ-ZKWXMUAHSA-N 0.000 description 1
- UBHUJPVCJHPSEU-GRLWGSQLSA-N Ile-Glu-Ile Chemical compound CC[C@H](C)[C@@H](C(=O)N[C@@H](CCC(=O)O)C(=O)N[C@@H]([C@@H](C)CC)C(=O)O)N UBHUJPVCJHPSEU-GRLWGSQLSA-N 0.000 description 1
- XLCZWMJPVGRWHJ-KQXIARHKSA-N Ile-Glu-Pro Chemical compound CC[C@H](C)[C@@H](C(=O)N[C@@H](CCC(=O)O)C(=O)N1CCC[C@@H]1C(=O)O)N XLCZWMJPVGRWHJ-KQXIARHKSA-N 0.000 description 1
- UCGDDTHMMVWVMV-FSPLSTOPSA-N Ile-Gly Chemical compound CC[C@H](C)[C@H](N)C(=O)NCC(O)=O UCGDDTHMMVWVMV-FSPLSTOPSA-N 0.000 description 1
- LWWILHPVAKKLQS-QXEWZRGKSA-N Ile-Gly-Met Chemical compound CC[C@H](C)[C@@H](C(=O)NCC(=O)N[C@@H](CCSC)C(=O)O)N LWWILHPVAKKLQS-QXEWZRGKSA-N 0.000 description 1
- LBRCLQMZAHRTLV-ZKWXMUAHSA-N Ile-Gly-Ser Chemical compound CC[C@H](C)[C@H](N)C(=O)NCC(=O)N[C@@H](CO)C(O)=O LBRCLQMZAHRTLV-ZKWXMUAHSA-N 0.000 description 1
- VNDQNDYEPSXHLU-JUKXBJQTSA-N Ile-His-Tyr Chemical compound CC[C@H](C)[C@@H](C(=O)N[C@@H](CC1=CN=CN1)C(=O)N[C@@H](CC2=CC=C(C=C2)O)C(=O)O)N VNDQNDYEPSXHLU-JUKXBJQTSA-N 0.000 description 1
- BCVIOZZGJNOEQS-XKNYDFJKSA-N Ile-Ile Chemical compound CC[C@H](C)[C@H](N)C(=O)N[C@H](C(O)=O)[C@@H](C)CC BCVIOZZGJNOEQS-XKNYDFJKSA-N 0.000 description 1
- BBQABUDWDUKJMB-LZXPERKUSA-N Ile-Ile-Ile Chemical compound CC[C@H](C)[C@H]([NH3+])C(=O)N[C@@H]([C@@H](C)CC)C(=O)N[C@@H]([C@@H](C)CC)C([O-])=O BBQABUDWDUKJMB-LZXPERKUSA-N 0.000 description 1
- PFPUFNLHBXKPHY-HTFCKZLJSA-N Ile-Ile-Ser Chemical compound CC[C@H](C)[C@@H](C(=O)N[C@@H]([C@@H](C)CC)C(=O)N[C@@H](CO)C(=O)O)N PFPUFNLHBXKPHY-HTFCKZLJSA-N 0.000 description 1
- GAZGFPOZOLEYAJ-YTFOTSKYSA-N Ile-Leu-Ile Chemical compound CC[C@H](C)[C@@H](C(=O)N[C@@H](CC(C)C)C(=O)N[C@@H]([C@@H](C)CC)C(=O)O)N GAZGFPOZOLEYAJ-YTFOTSKYSA-N 0.000 description 1
- OVDKXUDMKXAZIV-ZPFDUUQYSA-N Ile-Lys-Asn Chemical compound CC[C@H](C)[C@@H](C(=O)N[C@@H](CCCCN)C(=O)N[C@@H](CC(=O)N)C(=O)O)N OVDKXUDMKXAZIV-ZPFDUUQYSA-N 0.000 description 1
- GLYJPWIRLBAIJH-FQUUOJAGSA-N Ile-Lys-Pro Chemical compound CC[C@H](C)[C@@H](C(=O)N[C@@H](CCCCN)C(=O)N1CCC[C@@H]1C(=O)O)N GLYJPWIRLBAIJH-FQUUOJAGSA-N 0.000 description 1
- CEPIAEUVRKGPGP-DSYPUSFNSA-N Ile-Lys-Trp Chemical compound C1=CC=C2C(C[C@H](NC(=O)[C@H](CCCCN)NC(=O)[C@@H](N)[C@@H](C)CC)C(O)=O)=CNC2=C1 CEPIAEUVRKGPGP-DSYPUSFNSA-N 0.000 description 1
- LRAUKBMYHHNADU-DKIMLUQUSA-N Ile-Phe-Lys Chemical compound NCCCC[C@@H](C(O)=O)NC(=O)[C@@H](NC(=O)[C@@H](N)[C@@H](C)CC)CC1=CC=CC=C1 LRAUKBMYHHNADU-DKIMLUQUSA-N 0.000 description 1
- AKQFLPNANHNTLP-VKOGCVSHSA-N Ile-Pro-Trp Chemical compound CC[C@H](C)[C@@H](C(=O)N1CCC[C@H]1C(=O)N[C@@H](CC2=CNC3=CC=CC=C32)C(=O)O)N AKQFLPNANHNTLP-VKOGCVSHSA-N 0.000 description 1
- PXKACEXYLPBMAD-JBDRJPRFSA-N Ile-Ser-Ser Chemical compound CC[C@H](C)[C@@H](C(=O)N[C@@H](CO)C(=O)N[C@@H](CO)C(=O)O)N PXKACEXYLPBMAD-JBDRJPRFSA-N 0.000 description 1
- SAEWJTCJQVZQNZ-IUKAMOBKSA-N Ile-Thr-Asn Chemical compound CC[C@H](C)[C@@H](C(=O)N[C@@H]([C@@H](C)O)C(=O)N[C@@H](CC(=O)N)C(=O)O)N SAEWJTCJQVZQNZ-IUKAMOBKSA-N 0.000 description 1
- COWHUQXTSYTKQC-RWRJDSDZSA-N Ile-Thr-Glu Chemical compound CC[C@H](C)[C@@H](C(=O)N[C@@H]([C@@H](C)O)C(=O)N[C@@H](CCC(=O)O)C(=O)O)N COWHUQXTSYTKQC-RWRJDSDZSA-N 0.000 description 1
- QHUREMVLLMNUAX-OSUNSFLBSA-N Ile-Thr-Val Chemical compound CC[C@H](C)[C@@H](C(=O)N[C@@H]([C@@H](C)O)C(=O)N[C@@H](C(C)C)C(=O)O)N QHUREMVLLMNUAX-OSUNSFLBSA-N 0.000 description 1
- MUFXDFWAJSPHIQ-XDTLVQLUSA-N Ile-Tyr Chemical compound CC[C@H](C)[C@H]([NH3+])C(=O)N[C@H](C([O-])=O)CC1=CC=C(O)C=C1 MUFXDFWAJSPHIQ-XDTLVQLUSA-N 0.000 description 1
- DTPGSUQHUMELQB-GVARAGBVSA-N Ile-Tyr-Ala Chemical compound CC[C@H](C)[C@H](N)C(=O)N[C@H](C(=O)N[C@@H](C)C(O)=O)CC1=CC=C(O)C=C1 DTPGSUQHUMELQB-GVARAGBVSA-N 0.000 description 1
- FXJLRZFMKGHYJP-CFMVVWHZSA-N Ile-Tyr-Asn Chemical compound CC[C@H](C)[C@@H](C(=O)N[C@@H](CC1=CC=C(C=C1)O)C(=O)N[C@@H](CC(=O)N)C(=O)O)N FXJLRZFMKGHYJP-CFMVVWHZSA-N 0.000 description 1
- ZGKVPOSSTGHJAF-HJPIBITLSA-N Ile-Tyr-Ser Chemical compound CC[C@H](C)[C@@H](C(=O)N[C@@H](CC1=CC=C(C=C1)O)C(=O)N[C@@H](CO)C(=O)O)N ZGKVPOSSTGHJAF-HJPIBITLSA-N 0.000 description 1
- RQZFWBLDTBDEOF-RNJOBUHISA-N Ile-Val-Pro Chemical compound CC[C@H](C)[C@@H](C(=O)N[C@@H](C(C)C)C(=O)N1CCC[C@@H]1C(=O)O)N RQZFWBLDTBDEOF-RNJOBUHISA-N 0.000 description 1
- QSXSHZIRKTUXNG-STECZYCISA-N Ile-Val-Tyr Chemical compound CC[C@H](C)[C@H](N)C(=O)N[C@@H](C(C)C)C(=O)N[C@H](C(O)=O)CC1=CC=C(O)C=C1 QSXSHZIRKTUXNG-STECZYCISA-N 0.000 description 1
- 108060003951 Immunoglobulin Proteins 0.000 description 1
- PWWVAXIEGOYWEE-UHFFFAOYSA-N Isophenergan Chemical compound C1=CC=C2N(CC(C)N(C)C)C3=CC=CC=C3SC2=C1 PWWVAXIEGOYWEE-UHFFFAOYSA-N 0.000 description 1
- 241000235649 Kluyveromyces Species 0.000 description 1
- 241001138401 Kluyveromyces lactis Species 0.000 description 1
- PMGDADKJMCOXHX-UHFFFAOYSA-N L-Arginyl-L-glutamin-acetat Natural products NC(=N)NCCCC(N)C(=O)NC(CCC(N)=O)C(O)=O PMGDADKJMCOXHX-UHFFFAOYSA-N 0.000 description 1
- HHSJMSCOLJVTCX-ZDLURKLDSA-N L-Glutaminyl-L-threonine Chemical compound C[C@@H](O)[C@@H](C(O)=O)NC(=O)[C@@H](N)CCC(N)=O HHSJMSCOLJVTCX-ZDLURKLDSA-N 0.000 description 1
- QNAYBMKLOCPYGJ-REOHCLBHSA-N L-alanine Chemical compound C[C@H](N)C(O)=O QNAYBMKLOCPYGJ-REOHCLBHSA-N 0.000 description 1
- ODKSFYDXXFIFQN-BYPYZUCNSA-P L-argininium(2+) Chemical compound NC(=[NH2+])NCCC[C@H]([NH3+])C(O)=O ODKSFYDXXFIFQN-BYPYZUCNSA-P 0.000 description 1
- HNDVDQJCIGZPNO-YFKPBYRVSA-N L-histidine Chemical compound OC(=O)[C@@H](N)CC1=CN=CN1 HNDVDQJCIGZPNO-YFKPBYRVSA-N 0.000 description 1
- LHSGPCFBGJHPCY-UHFFFAOYSA-N L-leucine-L-tyrosine Natural products CC(C)CC(N)C(=O)NC(C(O)=O)CC1=CC=C(O)C=C1 LHSGPCFBGJHPCY-UHFFFAOYSA-N 0.000 description 1
- KFKWRHQBZQICHA-STQMWFEESA-N L-leucyl-L-phenylalanine Natural products CC(C)C[C@H](N)C(=O)N[C@H](C(O)=O)CC1=CC=CC=C1 KFKWRHQBZQICHA-STQMWFEESA-N 0.000 description 1
- 125000001176 L-lysyl group Chemical group [H]N([H])[C@]([H])(C(=O)[*])C([H])([H])C([H])([H])C([H])([H])C(N([H])[H])([H])[H] 0.000 description 1
- FFEARJCKVFRZRR-BYPYZUCNSA-N L-methionine Chemical compound CSCC[C@H](N)C(O)=O FFEARJCKVFRZRR-BYPYZUCNSA-N 0.000 description 1
- 125000000769 L-threonyl group Chemical group [H]N([H])[C@]([H])(C(=O)[*])[C@](O[H])(C([H])([H])[H])[H] 0.000 description 1
- 125000003798 L-tyrosyl group Chemical group [H]N([H])[C@]([H])(C(=O)[*])C([H])([H])C1=C([H])C([H])=C(O[H])C([H])=C1[H] 0.000 description 1
- KZSNJWFQEVHDMF-BYPYZUCNSA-N L-valine Chemical compound CC(C)[C@H](N)C(O)=O KZSNJWFQEVHDMF-BYPYZUCNSA-N 0.000 description 1
- 125000003580 L-valyl group Chemical group [H]N([H])[C@]([H])(C(=O)[*])C(C([H])([H])[H])(C([H])([H])[H])[H] 0.000 description 1
- LZDNBBYBDGBADK-UHFFFAOYSA-N L-valyl-L-tryptophan Natural products C1=CC=C2C(CC(NC(=O)C(N)C(C)C)C(O)=O)=CNC2=C1 LZDNBBYBDGBADK-UHFFFAOYSA-N 0.000 description 1
- BQSLGJHIAGOZCD-CIUDSAMLSA-N Leu-Ala-Ser Chemical compound CC(C)C[C@H](N)C(=O)N[C@@H](C)C(=O)N[C@@H](CO)C(O)=O BQSLGJHIAGOZCD-CIUDSAMLSA-N 0.000 description 1
- GRZSCTXVCDUIPO-SRVKXCTJSA-N Leu-Arg-Gln Chemical compound [H]N[C@@H](CC(C)C)C(=O)N[C@@H](CCCNC(N)=N)C(=O)N[C@@H](CCC(N)=O)C(O)=O GRZSCTXVCDUIPO-SRVKXCTJSA-N 0.000 description 1
- KKXDHFKZWKLYGB-GUBZILKMSA-N Leu-Asn-Glu Chemical compound CC(C)C[C@@H](C(=O)N[C@@H](CC(=O)N)C(=O)N[C@@H](CCC(=O)O)C(=O)O)N KKXDHFKZWKLYGB-GUBZILKMSA-N 0.000 description 1
- KAFOIVJDVSZUMD-DCAQKATOSA-N Leu-Gln-Gln Chemical compound [H]N[C@@H](CC(C)C)C(=O)N[C@@H](CCC(N)=O)C(=O)N[C@@H](CCC(N)=O)C(O)=O KAFOIVJDVSZUMD-DCAQKATOSA-N 0.000 description 1
- BOFAFKVZQUMTID-AVGNSLFASA-N Leu-Gln-His Chemical compound CC(C)C[C@@H](C(=O)N[C@@H](CCC(=O)N)C(=O)N[C@@H](CC1=CN=CN1)C(=O)O)N BOFAFKVZQUMTID-AVGNSLFASA-N 0.000 description 1
- DZQMXBALGUHGJT-GUBZILKMSA-N Leu-Glu-Ala Chemical compound [H]N[C@@H](CC(C)C)C(=O)N[C@@H](CCC(O)=O)C(=O)N[C@@H](C)C(O)=O DZQMXBALGUHGJT-GUBZILKMSA-N 0.000 description 1
- HQUXQAMSWFIRET-AVGNSLFASA-N Leu-Glu-Lys Chemical compound CC(C)C[C@H](N)C(=O)N[C@@H](CCC(O)=O)C(=O)N[C@H](C(O)=O)CCCCN HQUXQAMSWFIRET-AVGNSLFASA-N 0.000 description 1
- YFBBUHJJUXXZOF-UWVGGRQHSA-N Leu-Gly-Pro Chemical compound CC(C)C[C@H](N)C(=O)NCC(=O)N1CCC[C@H]1C(O)=O YFBBUHJJUXXZOF-UWVGGRQHSA-N 0.000 description 1
- POZULHZYLPGXMR-ONGXEEELSA-N Leu-Gly-Val Chemical compound CC(C)C[C@H](N)C(=O)NCC(=O)N[C@@H](C(C)C)C(O)=O POZULHZYLPGXMR-ONGXEEELSA-N 0.000 description 1
- IAJFFZORSWOZPQ-SRVKXCTJSA-N Leu-Leu-Asn Chemical compound CC(C)C[C@H](N)C(=O)N[C@@H](CC(C)C)C(=O)N[C@@H](CC(N)=O)C(O)=O IAJFFZORSWOZPQ-SRVKXCTJSA-N 0.000 description 1
- QNBVTHNJGCOVFA-AVGNSLFASA-N Leu-Leu-Glu Chemical compound CC(C)C[C@H](N)C(=O)N[C@@H](CC(C)C)C(=O)N[C@H](C(O)=O)CCC(O)=O QNBVTHNJGCOVFA-AVGNSLFASA-N 0.000 description 1
- UBZGNBKMIJHOHL-BZSNNMDCSA-N Leu-Leu-Phe Chemical compound CC(C)C[C@H]([NH3+])C(=O)N[C@@H](CC(C)C)C(=O)N[C@H](C([O-])=O)CC1=CC=CC=C1 UBZGNBKMIJHOHL-BZSNNMDCSA-N 0.000 description 1
- IEWBEPKLKUXQBU-VOAKCMCISA-N Leu-Leu-Thr Chemical compound [H]N[C@@H](CC(C)C)C(=O)N[C@@H](CC(C)C)C(=O)N[C@@H]([C@@H](C)O)C(O)=O IEWBEPKLKUXQBU-VOAKCMCISA-N 0.000 description 1
- OTXBNHIUIHNGAO-UWVGGRQHSA-N Leu-Lys Chemical compound CC(C)C[C@H](N)C(=O)N[C@H](C(O)=O)CCCCN OTXBNHIUIHNGAO-UWVGGRQHSA-N 0.000 description 1
- ZGUMORRUBUCXEH-AVGNSLFASA-N Leu-Lys-Gln Chemical compound [H]N[C@@H](CC(C)C)C(=O)N[C@@H](CCCCN)C(=O)N[C@@H](CCC(N)=O)C(O)=O ZGUMORRUBUCXEH-AVGNSLFASA-N 0.000 description 1
- GCXGCIYIHXSKAY-ULQDDVLXSA-N Leu-Phe-Arg Chemical compound [H]N[C@@H](CC(C)C)C(=O)N[C@@H](CC1=CC=CC=C1)C(=O)N[C@@H](CCCNC(N)=N)C(O)=O GCXGCIYIHXSKAY-ULQDDVLXSA-N 0.000 description 1
- KWLWZYMNUZJKMZ-IHRRRGAJSA-N Leu-Pro-Leu Chemical compound CC(C)C[C@H](N)C(=O)N1CCC[C@H]1C(=O)N[C@@H](CC(C)C)C(O)=O KWLWZYMNUZJKMZ-IHRRRGAJSA-N 0.000 description 1
- SBANPBVRHYIMRR-GARJFASQSA-N Leu-Ser-Pro Chemical compound CC(C)C[C@@H](C(=O)N[C@@H](CO)C(=O)N1CCC[C@@H]1C(=O)O)N SBANPBVRHYIMRR-GARJFASQSA-N 0.000 description 1
- PPGBXYKMUMHFBF-KATARQTJSA-N Leu-Ser-Thr Chemical compound [H]N[C@@H](CC(C)C)C(=O)N[C@@H](CO)C(=O)N[C@@H]([C@@H](C)O)C(O)=O PPGBXYKMUMHFBF-KATARQTJSA-N 0.000 description 1
- ZJZNLRVCZWUONM-JXUBOQSCSA-N Leu-Thr-Ala Chemical compound CC(C)C[C@H](N)C(=O)N[C@@H]([C@@H](C)O)C(=O)N[C@@H](C)C(O)=O ZJZNLRVCZWUONM-JXUBOQSCSA-N 0.000 description 1
- VDIARPPNADFEAV-WEDXCCLWSA-N Leu-Thr-Gly Chemical compound CC(C)C[C@H](N)C(=O)N[C@@H]([C@@H](C)O)C(=O)NCC(O)=O VDIARPPNADFEAV-WEDXCCLWSA-N 0.000 description 1
- LHSGPCFBGJHPCY-STQMWFEESA-N Leu-Tyr Chemical compound CC(C)C[C@H](N)C(=O)N[C@H](C(O)=O)CC1=CC=C(O)C=C1 LHSGPCFBGJHPCY-STQMWFEESA-N 0.000 description 1
- ISSAURVGLGAPDK-KKUMJFAQSA-N Leu-Tyr-Asp Chemical compound [H]N[C@@H](CC(C)C)C(=O)N[C@@H](CC1=CC=C(O)C=C1)C(=O)N[C@@H](CC(O)=O)C(O)=O ISSAURVGLGAPDK-KKUMJFAQSA-N 0.000 description 1
- LMDVGHQPPPLYAR-IHRRRGAJSA-N Leu-Val-His Chemical compound N[C@@H](CC(C)C)C(=O)N[C@@H](C(C)C)C(=O)N[C@@H](CC1=CNC=N1)C(=O)O LMDVGHQPPPLYAR-IHRRRGAJSA-N 0.000 description 1
- ROHFNLRQFUQHCH-UHFFFAOYSA-N Leucine Natural products CC(C)CC(N)C(O)=O ROHFNLRQFUQHCH-UHFFFAOYSA-N 0.000 description 1
- 241000209082 Lolium Species 0.000 description 1
- 241000219745 Lupinus Species 0.000 description 1
- 235000007688 Lycopersicon esculentum Nutrition 0.000 description 1
- BTSXLXFPMZXVPR-DLOVCJGASA-N Lys-Ala-His Chemical compound C[C@@H](C(=O)N[C@@H](CC1=CN=CN1)C(=O)O)NC(=O)[C@H](CCCCN)N BTSXLXFPMZXVPR-DLOVCJGASA-N 0.000 description 1
- WSXTWLJHTLRFLW-SRVKXCTJSA-N Lys-Ala-Lys Chemical compound NCCCC[C@H](N)C(=O)N[C@@H](C)C(=O)N[C@@H](CCCCN)C(O)=O WSXTWLJHTLRFLW-SRVKXCTJSA-N 0.000 description 1
- IRNSXVOWSXSULE-DCAQKATOSA-N Lys-Ala-Val Chemical compound CC(C)[C@@H](C(O)=O)NC(=O)[C@H](C)NC(=O)[C@@H](N)CCCCN IRNSXVOWSXSULE-DCAQKATOSA-N 0.000 description 1
- NPBGTPKLVJEOBE-IUCAKERBSA-N Lys-Arg Chemical compound NCCCC[C@H](N)C(=O)N[C@H](C(O)=O)CCCNC(N)=N NPBGTPKLVJEOBE-IUCAKERBSA-N 0.000 description 1
- SJNZALDHDUYDBU-IHRRRGAJSA-N Lys-Arg-Lys Chemical compound NCCCC[C@H](N)C(=O)N[C@@H](CCCN=C(N)N)C(=O)N[C@@H](CCCCN)C(O)=O SJNZALDHDUYDBU-IHRRRGAJSA-N 0.000 description 1
- QYOXSYXPHUHOJR-GUBZILKMSA-N Lys-Asn-Glu Chemical compound [H]N[C@@H](CCCCN)C(=O)N[C@@H](CC(N)=O)C(=O)N[C@@H](CCC(O)=O)C(O)=O QYOXSYXPHUHOJR-GUBZILKMSA-N 0.000 description 1
- CIOWSLJGLSUOME-BQBZGAKWSA-N Lys-Asp Chemical compound NCCCC[C@H](N)C(=O)N[C@H](C(O)=O)CC(O)=O CIOWSLJGLSUOME-BQBZGAKWSA-N 0.000 description 1
- IRRZDAIFYHNIIN-JYJNAYRXSA-N Lys-Gln-Tyr Chemical compound [H]N[C@@H](CCCCN)C(=O)N[C@@H](CCC(N)=O)C(=O)N[C@@H](CC1=CC=C(O)C=C1)C(O)=O IRRZDAIFYHNIIN-JYJNAYRXSA-N 0.000 description 1
- GRADYHMSAUIKPS-DCAQKATOSA-N Lys-Glu-Gln Chemical compound [H]N[C@@H](CCCCN)C(=O)N[C@@H](CCC(O)=O)C(=O)N[C@@H](CCC(N)=O)C(O)=O GRADYHMSAUIKPS-DCAQKATOSA-N 0.000 description 1
- DCRWPTBMWMGADO-AVGNSLFASA-N Lys-Glu-Leu Chemical compound [H]N[C@@H](CCCCN)C(=O)N[C@@H](CCC(O)=O)C(=O)N[C@@H](CC(C)C)C(O)=O DCRWPTBMWMGADO-AVGNSLFASA-N 0.000 description 1
- HGNRJCINZYHNOU-LURJTMIESA-N Lys-Gly Chemical compound NCCCC[C@H](N)C(=O)NCC(O)=O HGNRJCINZYHNOU-LURJTMIESA-N 0.000 description 1
- LCMWVZLBCUVDAZ-IUCAKERBSA-N Lys-Gly-Glu Chemical compound [NH3+]CCCC[C@H]([NH3+])C(=O)NCC(=O)N[C@H](C([O-])=O)CCC([O-])=O LCMWVZLBCUVDAZ-IUCAKERBSA-N 0.000 description 1
- ISHNZELVUVPCHY-ZETCQYMHSA-N Lys-Gly-Gly Chemical compound NCCCC[C@H](N)C(=O)NCC(=O)NCC(O)=O ISHNZELVUVPCHY-ZETCQYMHSA-N 0.000 description 1
- KEPWSUPUFAPBRF-DKIMLUQUSA-N Lys-Ile-Phe Chemical compound [H]N[C@@H](CCCCN)C(=O)N[C@@H]([C@@H](C)CC)C(=O)N[C@@H](CC1=CC=CC=C1)C(O)=O KEPWSUPUFAPBRF-DKIMLUQUSA-N 0.000 description 1
- ATIPDCIQTUXABX-UWVGGRQHSA-N Lys-Leu Chemical compound CC(C)C[C@@H](C(O)=O)NC(=O)[C@@H](N)CCCCN ATIPDCIQTUXABX-UWVGGRQHSA-N 0.000 description 1
- MYZMQWHPDAYKIE-SRVKXCTJSA-N Lys-Leu-Ala Chemical compound [H]N[C@@H](CCCCN)C(=O)N[C@@H](CC(C)C)C(=O)N[C@@H](C)C(O)=O MYZMQWHPDAYKIE-SRVKXCTJSA-N 0.000 description 1
- MUXNCRWTWBMNHX-SRVKXCTJSA-N Lys-Leu-Asp Chemical compound [H]N[C@@H](CCCCN)C(=O)N[C@@H](CC(C)C)C(=O)N[C@@H](CC(O)=O)C(O)=O MUXNCRWTWBMNHX-SRVKXCTJSA-N 0.000 description 1
- NVGBPTNZLWRQSY-UWVGGRQHSA-N Lys-Lys Chemical compound NCCCC[C@H](N)C(=O)N[C@H](C(O)=O)CCCCN NVGBPTNZLWRQSY-UWVGGRQHSA-N 0.000 description 1
- ZCWWVXAXWUAEPZ-SRVKXCTJSA-N Lys-Met-Glu Chemical compound [H]N[C@@H](CCCCN)C(=O)N[C@@H](CCSC)C(=O)N[C@@H](CCC(O)=O)C(O)=O ZCWWVXAXWUAEPZ-SRVKXCTJSA-N 0.000 description 1
- WGILOYIKJVQUPT-DCAQKATOSA-N Lys-Pro-Asp Chemical compound [H]N[C@@H](CCCCN)C(=O)N1CCC[C@H]1C(=O)N[C@@H](CC(O)=O)C(O)=O WGILOYIKJVQUPT-DCAQKATOSA-N 0.000 description 1
- XFANQCRHTMOEAP-WDSOQIARSA-N Lys-Pro-Trp Chemical compound [H]N[C@@H](CCCCN)C(=O)N1CCC[C@H]1C(=O)N[C@@H](CC1=CNC2=C1C=CC=C2)C(O)=O XFANQCRHTMOEAP-WDSOQIARSA-N 0.000 description 1
- ZOKVLMBYDSIDKG-CSMHCCOUSA-N Lys-Thr Chemical compound C[C@@H](O)[C@@H](C(O)=O)NC(=O)[C@@H](N)CCCCN ZOKVLMBYDSIDKG-CSMHCCOUSA-N 0.000 description 1
- QVTDVTONTRSQMF-WDCWCFNPSA-N Lys-Thr-Glu Chemical compound OC(=O)CC[C@@H](C(O)=O)NC(=O)[C@H]([C@H](O)C)NC(=O)[C@@H](N)CCCCN QVTDVTONTRSQMF-WDCWCFNPSA-N 0.000 description 1
- YQAIUOWPSUOINN-IUCAKERBSA-N Lys-Val Chemical compound CC(C)[C@@H](C(O)=O)NC(=O)[C@@H](N)CCCCN YQAIUOWPSUOINN-IUCAKERBSA-N 0.000 description 1
- QLFAPXUXEBAWEK-NHCYSSNCSA-N Lys-Val-Asp Chemical compound [H]N[C@@H](CCCCN)C(=O)N[C@@H](C(C)C)C(=O)N[C@@H](CC(O)=O)C(O)=O QLFAPXUXEBAWEK-NHCYSSNCSA-N 0.000 description 1
- QFSYGUMEANRNJE-DCAQKATOSA-N Lys-Val-Cys Chemical compound CC(C)[C@@H](C(=O)N[C@@H](CS)C(=O)O)NC(=O)[C@H](CCCCN)N QFSYGUMEANRNJE-DCAQKATOSA-N 0.000 description 1
- UGCIQUYEJIEHKX-GVXVVHGQSA-N Lys-Val-Glu Chemical compound [H]N[C@@H](CCCCN)C(=O)N[C@@H](C(C)C)C(=O)N[C@@H](CCC(O)=O)C(O)=O UGCIQUYEJIEHKX-GVXVVHGQSA-N 0.000 description 1
- 239000004472 Lysine Substances 0.000 description 1
- 101150068888 MET3 gene Proteins 0.000 description 1
- 108010054377 Mannosidases Proteins 0.000 description 1
- 102000001696 Mannosidases Human genes 0.000 description 1
- DRXODWRPPUFIAY-DCAQKATOSA-N Met-Asn-Lys Chemical compound CSCC[C@H](N)C(=O)N[C@@H](CC(N)=O)C(=O)N[C@H](C(O)=O)CCCCN DRXODWRPPUFIAY-DCAQKATOSA-N 0.000 description 1
- HDNOQCZWJGGHSS-VEVYYDQMSA-N Met-Asn-Thr Chemical compound CSCC[C@H](N)C(=O)N[C@@H](CC(N)=O)C(=O)N[C@@H]([C@@H](C)O)C(O)=O HDNOQCZWJGGHSS-VEVYYDQMSA-N 0.000 description 1
- DJDFBVNNDAUPRW-GUBZILKMSA-N Met-Glu-Gln Chemical compound CSCC[C@H](N)C(=O)N[C@@H](CCC(O)=O)C(=O)N[C@@H](CCC(N)=O)C(O)=O DJDFBVNNDAUPRW-GUBZILKMSA-N 0.000 description 1
- SJDQOYTYNGZZJX-SRVKXCTJSA-N Met-Glu-Leu Chemical compound CSCC[C@H](N)C(=O)N[C@@H](CCC(O)=O)C(=O)N[C@@H](CC(C)C)C(O)=O SJDQOYTYNGZZJX-SRVKXCTJSA-N 0.000 description 1
- QZPXMHVKPHJNTR-DCAQKATOSA-N Met-Leu-Asn Chemical compound CSCC[C@H](N)C(=O)N[C@@H](CC(C)C)C(=O)N[C@@H](CC(N)=O)C(O)=O QZPXMHVKPHJNTR-DCAQKATOSA-N 0.000 description 1
- HSJIGJRZYUADSS-IHRRRGAJSA-N Met-Lys-Leu Chemical compound [H]N[C@@H](CCSC)C(=O)N[C@@H](CCCCN)C(=O)N[C@@H](CC(C)C)C(O)=O HSJIGJRZYUADSS-IHRRRGAJSA-N 0.000 description 1
- WTHGNAAQXISJHP-AVGNSLFASA-N Met-Lys-Val Chemical compound [H]N[C@@H](CCSC)C(=O)N[C@@H](CCCCN)C(=O)N[C@@H](C(C)C)C(O)=O WTHGNAAQXISJHP-AVGNSLFASA-N 0.000 description 1
- DZMGFGQBRYWJOR-YUMQZZPRSA-N Met-Pro Chemical compound CSCC[C@H](N)C(=O)N1CCC[C@H]1C(O)=O DZMGFGQBRYWJOR-YUMQZZPRSA-N 0.000 description 1
- JZXKNNOWPBVZEV-XIRDDKMYSA-N Met-Trp-Glu Chemical compound CSCC[C@@H](C(=O)N[C@@H](CC1=CNC2=CC=CC=C21)C(=O)N[C@@H](CCC(=O)O)C(=O)O)N JZXKNNOWPBVZEV-XIRDDKMYSA-N 0.000 description 1
- IIHMNTBFPMRJCN-RCWTZXSCSA-N Met-Val-Thr Chemical compound CSCC[C@H](N)C(=O)N[C@@H](C(C)C)C(=O)N[C@@H]([C@@H](C)O)C(O)=O IIHMNTBFPMRJCN-RCWTZXSCSA-N 0.000 description 1
- 102000005741 Metalloproteases Human genes 0.000 description 1
- 108010006035 Metalloproteases Proteins 0.000 description 1
- 108060004795 Methyltransferase Proteins 0.000 description 1
- 241000235395 Mucor Species 0.000 description 1
- 241000226677 Myceliophthora Species 0.000 description 1
- 101500006448 Mycobacterium bovis (strain ATCC BAA-935 / AF2122/97) Endonuclease PI-MboI Proteins 0.000 description 1
- WUGMRIBZSVSJNP-UHFFFAOYSA-N N-L-alanyl-L-tryptophan Natural products C1=CC=C2C(CC(NC(=O)C(N)C)C(O)=O)=CNC2=C1 WUGMRIBZSVSJNP-UHFFFAOYSA-N 0.000 description 1
- WYBVBIHNJWOLCJ-UHFFFAOYSA-N N-L-arginyl-L-leucine Natural products CC(C)CC(C(O)=O)NC(=O)C(N)CCCN=C(N)N WYBVBIHNJWOLCJ-UHFFFAOYSA-N 0.000 description 1
- KZNQNBZMBZJQJO-UHFFFAOYSA-N N-glycyl-L-proline Natural products NCC(=O)N1CCCC1C(O)=O KZNQNBZMBZJQJO-UHFFFAOYSA-N 0.000 description 1
- 108010079364 N-glycylalanine Proteins 0.000 description 1
- 108010066427 N-valyltryptophan Proteins 0.000 description 1
- BQVUABVGYYSDCJ-UHFFFAOYSA-N Nalpha-L-Leucyl-L-tryptophan Natural products C1=CC=C2C(CC(NC(=O)C(N)CC(C)C)C(O)=O)=CNC2=C1 BQVUABVGYYSDCJ-UHFFFAOYSA-N 0.000 description 1
- 241000221960 Neurospora Species 0.000 description 1
- 241000221961 Neurospora crassa Species 0.000 description 1
- 101100022915 Neurospora crassa (strain ATCC 24698 / 74-OR23-1A / CBS 708.71 / DSM 1257 / FGSC 987) cys-11 gene Proteins 0.000 description 1
- 244000061176 Nicotiana tabacum Species 0.000 description 1
- 235000002637 Nicotiana tabacum Nutrition 0.000 description 1
- 108090000913 Nitrate Reductases Proteins 0.000 description 1
- 239000000020 Nitrocellulose Substances 0.000 description 1
- 102000007981 Ornithine carbamoyltransferase Human genes 0.000 description 1
- 101710113020 Ornithine transcarbamylase, mitochondrial Proteins 0.000 description 1
- 238000012408 PCR amplification Methods 0.000 description 1
- 241000194109 Paenibacillus lautus Species 0.000 description 1
- 241000228143 Penicillium Species 0.000 description 1
- 108010002747 Pfu DNA polymerase Proteins 0.000 description 1
- 244000046052 Phaseolus vulgaris Species 0.000 description 1
- 235000010627 Phaseolus vulgaris Nutrition 0.000 description 1
- JIYJYFIXQTYDNF-YDHLFZDLSA-N Phe-Asn-Val Chemical compound CC(C)[C@@H](C(=O)O)NC(=O)[C@H](CC(=O)N)NC(=O)[C@H](CC1=CC=CC=C1)N JIYJYFIXQTYDNF-YDHLFZDLSA-N 0.000 description 1
- CSYVXYQDIVCQNU-QWRGUYRKSA-N Phe-Asp-Gly Chemical compound [H]N[C@@H](CC1=CC=CC=C1)C(=O)N[C@@H](CC(O)=O)C(=O)NCC(O)=O CSYVXYQDIVCQNU-QWRGUYRKSA-N 0.000 description 1
- SWZKMTDPQXLQRD-XVSYOHENSA-N Phe-Asp-Thr Chemical compound [H]N[C@@H](CC1=CC=CC=C1)C(=O)N[C@@H](CC(O)=O)C(=O)N[C@@H]([C@@H](C)O)C(O)=O SWZKMTDPQXLQRD-XVSYOHENSA-N 0.000 description 1
- WFDAEEUZPZSMOG-SRVKXCTJSA-N Phe-Cys-Ser Chemical compound [H]N[C@@H](CC1=CC=CC=C1)C(=O)N[C@@H](CS)C(=O)N[C@@H](CO)C(O)=O WFDAEEUZPZSMOG-SRVKXCTJSA-N 0.000 description 1
- NKLDZIPTGKBDBB-HTUGSXCWSA-N Phe-Gln-Thr Chemical compound C[C@H]([C@@H](C(=O)O)NC(=O)[C@H](CCC(=O)N)NC(=O)[C@H](CC1=CC=CC=C1)N)O NKLDZIPTGKBDBB-HTUGSXCWSA-N 0.000 description 1
- ABQFNJAFONNUTH-FHWLQOOXSA-N Phe-Gln-Tyr Chemical compound C1=CC=C(C=C1)C[C@@H](C(=O)N[C@@H](CCC(=O)N)C(=O)N[C@@H](CC2=CC=C(C=C2)O)C(=O)O)N ABQFNJAFONNUTH-FHWLQOOXSA-N 0.000 description 1
- JXWLMUIXUXLIJR-QWRGUYRKSA-N Phe-Glu Chemical compound OC(=O)CC[C@@H](C(O)=O)NC(=O)[C@@H](N)CC1=CC=CC=C1 JXWLMUIXUXLIJR-QWRGUYRKSA-N 0.000 description 1
- KYYMILWEGJYPQZ-IHRRRGAJSA-N Phe-Glu-Glu Chemical compound OC(=O)CC[C@@H](C(O)=O)NC(=O)[C@H](CCC(O)=O)NC(=O)[C@@H](N)CC1=CC=CC=C1 KYYMILWEGJYPQZ-IHRRRGAJSA-N 0.000 description 1
- FIRWJEJVFFGXSH-RYUDHWBXSA-N Phe-Glu-Gly Chemical compound OC(=O)CNC(=O)[C@H](CCC(O)=O)NC(=O)[C@@H](N)CC1=CC=CC=C1 FIRWJEJVFFGXSH-RYUDHWBXSA-N 0.000 description 1
- GLUBLISJVJFHQS-VIFPVBQESA-N Phe-Gly Chemical compound OC(=O)CNC(=O)[C@@H](N)CC1=CC=CC=C1 GLUBLISJVJFHQS-VIFPVBQESA-N 0.000 description 1
- JEBWZLWTRPZQRX-QWRGUYRKSA-N Phe-Gly-Asp Chemical compound [H]N[C@@H](CC1=CC=CC=C1)C(=O)NCC(=O)N[C@@H](CC(O)=O)C(O)=O JEBWZLWTRPZQRX-QWRGUYRKSA-N 0.000 description 1
- OHUXOEXBXPZKPT-STQMWFEESA-N Phe-His Chemical compound C([C@H](N)C(=O)N[C@@H](CC=1N=CNC=1)C(O)=O)C1=CC=CC=C1 OHUXOEXBXPZKPT-STQMWFEESA-N 0.000 description 1
- SPXWRYVHOZVYBU-ULQDDVLXSA-N Phe-His-Val Chemical compound CC(C)[C@@H](C(=O)O)NC(=O)[C@H](CC1=CN=CN1)NC(=O)[C@H](CC2=CC=CC=C2)N SPXWRYVHOZVYBU-ULQDDVLXSA-N 0.000 description 1
- RORUIHAWOLADSH-HJWJTTGWSA-N Phe-Ile-Val Chemical compound CC(C)[C@@H](C(O)=O)NC(=O)[C@H]([C@@H](C)CC)NC(=O)[C@@H](N)CC1=CC=CC=C1 RORUIHAWOLADSH-HJWJTTGWSA-N 0.000 description 1
- INHMISZWLJZQGH-ULQDDVLXSA-N Phe-Leu-Val Chemical compound CC(C)[C@@H](C(O)=O)NC(=O)[C@H](CC(C)C)NC(=O)[C@@H](N)CC1=CC=CC=C1 INHMISZWLJZQGH-ULQDDVLXSA-N 0.000 description 1
- DMEYUTSDVRCWRS-ULQDDVLXSA-N Phe-Lys-Arg Chemical compound NC(=N)NCCC[C@@H](C(O)=O)NC(=O)[C@H](CCCCN)NC(=O)[C@@H](N)CC1=CC=CC=C1 DMEYUTSDVRCWRS-ULQDDVLXSA-N 0.000 description 1
- WLYPRKLMRIYGPP-JYJNAYRXSA-N Phe-Lys-Glu Chemical compound OC(=O)CC[C@@H](C(O)=O)NC(=O)[C@H](CCCCN)NC(=O)[C@@H](N)CC1=CC=CC=C1 WLYPRKLMRIYGPP-JYJNAYRXSA-N 0.000 description 1
- GPSMLZQVIIYLDK-ULQDDVLXSA-N Phe-Lys-Val Chemical compound [H]N[C@@H](CC1=CC=CC=C1)C(=O)N[C@@H](CCCCN)C(=O)N[C@@H](C(C)C)C(O)=O GPSMLZQVIIYLDK-ULQDDVLXSA-N 0.000 description 1
- JKJSIYKSGIDHPM-WBAXXEDZSA-N Phe-Phe-Ala Chemical compound C[C@H](NC(=O)[C@H](Cc1ccccc1)NC(=O)[C@@H](N)Cc1ccccc1)C(O)=O JKJSIYKSGIDHPM-WBAXXEDZSA-N 0.000 description 1
- XDMMOISUAHXXFD-SRVKXCTJSA-N Phe-Ser-Asp Chemical compound [H]N[C@@H](CC1=CC=CC=C1)C(=O)N[C@@H](CO)C(=O)N[C@@H](CC(O)=O)C(O)=O XDMMOISUAHXXFD-SRVKXCTJSA-N 0.000 description 1
- FGWUALWGCZJQDJ-URLPEUOOSA-N Phe-Thr-Ile Chemical compound [H]N[C@@H](CC1=CC=CC=C1)C(=O)N[C@@H]([C@@H](C)O)C(=O)N[C@@H]([C@@H](C)CC)C(O)=O FGWUALWGCZJQDJ-URLPEUOOSA-N 0.000 description 1
- PTDAGKJHZBGDKD-OEAJRASXSA-N Phe-Thr-Lys Chemical compound C[C@H]([C@@H](C(=O)N[C@@H](CCCCN)C(=O)O)NC(=O)[C@H](CC1=CC=CC=C1)N)O PTDAGKJHZBGDKD-OEAJRASXSA-N 0.000 description 1
- KIQUCMUULDXTAZ-HJOGWXRNSA-N Phe-Tyr-Tyr Chemical compound N[C@@H](Cc1ccccc1)C(=O)N[C@@H](Cc1ccc(O)cc1)C(=O)N[C@@H](Cc1ccc(O)cc1)C(O)=O KIQUCMUULDXTAZ-HJOGWXRNSA-N 0.000 description 1
- JSGWNFKWZNPDAV-YDHLFZDLSA-N Phe-Val-Asp Chemical compound OC(=O)C[C@@H](C(O)=O)NC(=O)[C@H](C(C)C)NC(=O)[C@@H](N)CC1=CC=CC=C1 JSGWNFKWZNPDAV-YDHLFZDLSA-N 0.000 description 1
- YUPRIZTWANWWHK-DZKIICNBSA-N Phe-Val-Glu Chemical compound CC(C)[C@@H](C(=O)N[C@@H](CCC(=O)O)C(=O)O)NC(=O)[C@H](CC1=CC=CC=C1)N YUPRIZTWANWWHK-DZKIICNBSA-N 0.000 description 1
- 241001495084 Phylo Species 0.000 description 1
- 240000004713 Pisum sativum Species 0.000 description 1
- 235000010582 Pisum sativum Nutrition 0.000 description 1
- 241000209504 Poaceae Species 0.000 description 1
- 241000276498 Pollachius virens Species 0.000 description 1
- 229920003171 Poly (ethylene oxide) Polymers 0.000 description 1
- 229920002504 Poly(2-vinylpyridine-N-oxide) Polymers 0.000 description 1
- 108010059820 Polygalacturonase Proteins 0.000 description 1
- 229920001213 Polysorbate 20 Polymers 0.000 description 1
- WWAQEUOYCYMGHB-FXQIFTODSA-N Pro-Asn-Asn Chemical compound NC(=O)C[C@@H](C(O)=O)NC(=O)[C@H](CC(N)=O)NC(=O)[C@@H]1CCCN1 WWAQEUOYCYMGHB-FXQIFTODSA-N 0.000 description 1
- HQVPQXMCQKXARZ-FXQIFTODSA-N Pro-Cys-Ser Chemical compound C1C[C@H](NC1)C(=O)N[C@@H](CS)C(=O)N[C@@H](CO)C(=O)O HQVPQXMCQKXARZ-FXQIFTODSA-N 0.000 description 1
- MGDFPGCFVJFITQ-CIUDSAMLSA-N Pro-Glu-Asp Chemical compound [H]N1CCC[C@H]1C(=O)N[C@@H](CCC(O)=O)C(=O)N[C@@H](CC(O)=O)C(O)=O MGDFPGCFVJFITQ-CIUDSAMLSA-N 0.000 description 1
- FRKBNXCFJBPJOL-GUBZILKMSA-N Pro-Glu-Glu Chemical compound [H]N1CCC[C@H]1C(=O)N[C@@H](CCC(O)=O)C(=O)N[C@@H](CCC(O)=O)C(O)=O FRKBNXCFJBPJOL-GUBZILKMSA-N 0.000 description 1
- WFHYFCWBLSKEMS-KKUMJFAQSA-N Pro-Glu-Phe Chemical compound N([C@@H](CCC(=O)O)C(=O)N[C@@H](CC=1C=CC=CC=1)C(O)=O)C(=O)[C@@H]1CCCN1 WFHYFCWBLSKEMS-KKUMJFAQSA-N 0.000 description 1
- UEHYFUCOGHWASA-HJGDQZAQSA-N Pro-Glu-Thr Chemical compound C[C@@H](O)[C@@H](C(O)=O)NC(=O)[C@H](CCC(O)=O)NC(=O)[C@@H]1CCCN1 UEHYFUCOGHWASA-HJGDQZAQSA-N 0.000 description 1
- VPEVBAUSTBWQHN-NHCYSSNCSA-N Pro-Glu-Val Chemical compound [H]N1CCC[C@H]1C(=O)N[C@@H](CCC(O)=O)C(=O)N[C@@H](C(C)C)C(O)=O VPEVBAUSTBWQHN-NHCYSSNCSA-N 0.000 description 1
- DMKWYMWNEKIPFC-IUCAKERBSA-N Pro-Gly-Arg Chemical compound [H]N1CCC[C@H]1C(=O)NCC(=O)N[C@@H](CCCNC(N)=N)C(O)=O DMKWYMWNEKIPFC-IUCAKERBSA-N 0.000 description 1
- UIMCLYYSUCIUJM-UWVGGRQHSA-N Pro-Gly-Lys Chemical compound NCCCC[C@@H](C(O)=O)NC(=O)CNC(=O)[C@@H]1CCCN1 UIMCLYYSUCIUJM-UWVGGRQHSA-N 0.000 description 1
- DXTOOBDIIAJZBJ-BQBZGAKWSA-N Pro-Gly-Ser Chemical compound [H]N1CCC[C@H]1C(=O)NCC(=O)N[C@@H](CO)C(O)=O DXTOOBDIIAJZBJ-BQBZGAKWSA-N 0.000 description 1
- HAEGAELAYWSUNC-WPRPVWTQSA-N Pro-Gly-Val Chemical compound [H]N1CCC[C@H]1C(=O)NCC(=O)N[C@@H](C(C)C)C(O)=O HAEGAELAYWSUNC-WPRPVWTQSA-N 0.000 description 1
- IBGCFJDLCYTKPW-NAKRPEOUSA-N Pro-Ile-Ala Chemical compound OC(=O)[C@H](C)NC(=O)[C@H]([C@@H](C)CC)NC(=O)[C@@H]1CCCN1 IBGCFJDLCYTKPW-NAKRPEOUSA-N 0.000 description 1
- FKYKZHOKDOPHSA-DCAQKATOSA-N Pro-Leu-Ser Chemical compound [H]N1CCC[C@H]1C(=O)N[C@@H](CC(C)C)C(=O)N[C@@H](CO)C(O)=O FKYKZHOKDOPHSA-DCAQKATOSA-N 0.000 description 1
- SUENWIFTSTWUKD-AVGNSLFASA-N Pro-Leu-Val Chemical compound [H]N1CCC[C@H]1C(=O)N[C@@H](CC(C)C)C(=O)N[C@@H](C(C)C)C(O)=O SUENWIFTSTWUKD-AVGNSLFASA-N 0.000 description 1
- RVQDZELMXZRSSI-IUCAKERBSA-N Pro-Lys Chemical compound NCCCC[C@@H](C(O)=O)NC(=O)[C@@H]1CCCN1 RVQDZELMXZRSSI-IUCAKERBSA-N 0.000 description 1
- PCWLNNZTBJTZRN-AVGNSLFASA-N Pro-Pro-Lys Chemical compound NCCCC[C@@H](C(O)=O)NC(=O)[C@@H]1CCCN1C(=O)[C@H]1NCCC1 PCWLNNZTBJTZRN-AVGNSLFASA-N 0.000 description 1
- FNGOXVQBBCMFKV-CIUDSAMLSA-N Pro-Ser-Glu Chemical compound [H]N1CCC[C@H]1C(=O)N[C@@H](CO)C(=O)N[C@@H](CCC(O)=O)C(O)=O FNGOXVQBBCMFKV-CIUDSAMLSA-N 0.000 description 1
- ITUDDXVFGFEKPD-NAKRPEOUSA-N Pro-Ser-Ile Chemical compound [H]N1CCC[C@H]1C(=O)N[C@@H](CO)C(=O)N[C@@H]([C@@H](C)CC)C(O)=O ITUDDXVFGFEKPD-NAKRPEOUSA-N 0.000 description 1
- BNUKRHFCHHLIGR-JYJNAYRXSA-N Pro-Trp-Asp Chemical compound C1C[C@H](NC1)C(=O)N[C@@H](CC2=CNC3=CC=CC=C32)C(=O)N[C@@H](CC(=O)O)C(=O)O BNUKRHFCHHLIGR-JYJNAYRXSA-N 0.000 description 1
- CWZUFLWPEFHWEI-IHRRRGAJSA-N Pro-Tyr-Asp Chemical compound [H]N1CCC[C@H]1C(=O)N[C@@H](CC1=CC=C(O)C=C1)C(=O)N[C@@H](CC(O)=O)C(O)=O CWZUFLWPEFHWEI-IHRRRGAJSA-N 0.000 description 1
- SHTKRJHDMNSKRM-ULQDDVLXSA-N Pro-Tyr-His Chemical compound C1C[C@H](NC1)C(=O)N[C@@H](CC2=CC=C(C=C2)O)C(=O)N[C@@H](CC3=CN=CN3)C(=O)O SHTKRJHDMNSKRM-ULQDDVLXSA-N 0.000 description 1
- FIODMZKLZFLYQP-GUBZILKMSA-N Pro-Val-Ser Chemical compound [H]N1CCC[C@H]1C(=O)N[C@@H](C(C)C)C(=O)N[C@@H](CO)C(O)=O FIODMZKLZFLYQP-GUBZILKMSA-N 0.000 description 1
- OFOBLEOULBTSOW-UHFFFAOYSA-N Propanedioic acid Natural products OC(=O)CC(O)=O OFOBLEOULBTSOW-UHFFFAOYSA-N 0.000 description 1
- 241000589516 Pseudomonas Species 0.000 description 1
- 241000168225 Pseudomonas alcaligenes Species 0.000 description 1
- 241000589540 Pseudomonas fluorescens Species 0.000 description 1
- 241000589630 Pseudomonas pseudoalcaligenes Species 0.000 description 1
- 241000589614 Pseudomonas stutzeri Species 0.000 description 1
- 241000577556 Pseudomonas wisconsinensis Species 0.000 description 1
- 108020004518 RNA Probes Proteins 0.000 description 1
- 239000003391 RNA probe Substances 0.000 description 1
- 108020004511 Recombinant DNA Proteins 0.000 description 1
- 241000235403 Rhizomucor miehei Species 0.000 description 1
- 101100394989 Rhodopseudomonas palustris (strain ATCC BAA-98 / CGA009) hisI gene Proteins 0.000 description 1
- 108010083644 Ribonucleases Proteins 0.000 description 1
- 102000006382 Ribonucleases Human genes 0.000 description 1
- 235000003534 Saccharomyces carlsbergensis Nutrition 0.000 description 1
- 235000001006 Saccharomyces cerevisiae var diastaticus Nutrition 0.000 description 1
- 244000206963 Saccharomyces cerevisiae var. diastaticus Species 0.000 description 1
- 241000204893 Saccharomyces douglasii Species 0.000 description 1
- 241001123227 Saccharomyces pastorianus Species 0.000 description 1
- 241000235343 Saccharomycetales Species 0.000 description 1
- NGFMICBWJRZIBI-JZRPKSSGSA-N Salicin Natural products O([C@H]1[C@H](O)[C@@H](O)[C@@H](O)[C@H](CO)O1)c1c(CO)cccc1 NGFMICBWJRZIBI-JZRPKSSGSA-N 0.000 description 1
- 241000235346 Schizosaccharomyces Species 0.000 description 1
- 101100022918 Schizosaccharomyces pombe (strain 972 / ATCC 24843) sua1 gene Proteins 0.000 description 1
- 241000209056 Secale Species 0.000 description 1
- 235000007238 Secale cereale Nutrition 0.000 description 1
- 229920002684 Sepharose Polymers 0.000 description 1
- QVOGDCQNGLBNCR-FXQIFTODSA-N Ser-Arg-Ser Chemical compound [H]N[C@@H](CO)C(=O)N[C@@H](CCCNC(N)=N)C(=O)N[C@@H](CO)C(O)=O QVOGDCQNGLBNCR-FXQIFTODSA-N 0.000 description 1
- MESDJCNHLZBMEP-ZLUOBGJFSA-N Ser-Asp-Asp Chemical compound [H]N[C@@H](CO)C(=O)N[C@@H](CC(O)=O)C(=O)N[C@@H](CC(O)=O)C(O)=O MESDJCNHLZBMEP-ZLUOBGJFSA-N 0.000 description 1
- FTVRVZNYIYWJGB-ACZMJKKPSA-N Ser-Asp-Glu Chemical compound [H]N[C@@H](CO)C(=O)N[C@@H](CC(O)=O)C(=O)N[C@@H](CCC(O)=O)C(O)=O FTVRVZNYIYWJGB-ACZMJKKPSA-N 0.000 description 1
- OLIJLNWFEQEFDM-SRVKXCTJSA-N Ser-Asp-Phe Chemical compound OC[C@H](N)C(=O)N[C@@H](CC(O)=O)C(=O)N[C@H](C(O)=O)CC1=CC=CC=C1 OLIJLNWFEQEFDM-SRVKXCTJSA-N 0.000 description 1
- CRZRTKAVUUGKEQ-ACZMJKKPSA-N Ser-Gln-Ala Chemical compound [H]N[C@@H](CO)C(=O)N[C@@H](CCC(N)=O)C(=O)N[C@@H](C)C(O)=O CRZRTKAVUUGKEQ-ACZMJKKPSA-N 0.000 description 1
- ULVMNZOKDBHKKI-ACZMJKKPSA-N Ser-Gln-Asp Chemical compound [H]N[C@@H](CO)C(=O)N[C@@H](CCC(N)=O)C(=O)N[C@@H](CC(O)=O)C(O)=O ULVMNZOKDBHKKI-ACZMJKKPSA-N 0.000 description 1
- LALNXSXEYFUUDD-GUBZILKMSA-N Ser-Glu-Leu Chemical compound [H]N[C@@H](CO)C(=O)N[C@@H](CCC(O)=O)C(=O)N[C@@H](CC(C)C)C(O)=O LALNXSXEYFUUDD-GUBZILKMSA-N 0.000 description 1
- GZFAWAQTEYDKII-YUMQZZPRSA-N Ser-Gly-Leu Chemical compound CC(C)C[C@@H](C(O)=O)NC(=O)CNC(=O)[C@@H](N)CO GZFAWAQTEYDKII-YUMQZZPRSA-N 0.000 description 1
- SFTZWNJFZYOLBD-ZDLURKLDSA-N Ser-Gly-Thr Chemical compound C[C@@H](O)[C@@H](C(O)=O)NC(=O)CNC(=O)[C@@H](N)CO SFTZWNJFZYOLBD-ZDLURKLDSA-N 0.000 description 1
- BXLYSRPHVMCOPS-ACZMJKKPSA-N Ser-Ile Chemical compound CC[C@H](C)[C@@H](C(O)=O)NC(=O)[C@@H](N)CO BXLYSRPHVMCOPS-ACZMJKKPSA-N 0.000 description 1
- BKZYBLLIBOBOOW-GHCJXIJMSA-N Ser-Ile-Asp Chemical compound [H]N[C@@H](CO)C(=O)N[C@@H]([C@@H](C)CC)C(=O)N[C@@H](CC(O)=O)C(O)=O BKZYBLLIBOBOOW-GHCJXIJMSA-N 0.000 description 1
- DJACUBDEDBZKLQ-KBIXCLLPSA-N Ser-Ile-Glu Chemical compound [H]N[C@@H](CO)C(=O)N[C@@H]([C@@H](C)CC)C(=O)N[C@@H](CCC(O)=O)C(O)=O DJACUBDEDBZKLQ-KBIXCLLPSA-N 0.000 description 1
- IFPBAGJBHSNYPR-ZKWXMUAHSA-N Ser-Ile-Gly Chemical compound [H]N[C@@H](CO)C(=O)N[C@@H]([C@@H](C)CC)C(=O)NCC(O)=O IFPBAGJBHSNYPR-ZKWXMUAHSA-N 0.000 description 1
- NFDYGNFETJVMSE-BQBZGAKWSA-N Ser-Leu Chemical compound CC(C)C[C@@H](C(O)=O)NC(=O)[C@@H](N)CO NFDYGNFETJVMSE-BQBZGAKWSA-N 0.000 description 1
- YUJLIIRMIAGMCQ-CIUDSAMLSA-N Ser-Leu-Ser Chemical compound [H]N[C@@H](CO)C(=O)N[C@@H](CC(C)C)C(=O)N[C@@H](CO)C(O)=O YUJLIIRMIAGMCQ-CIUDSAMLSA-N 0.000 description 1
- JWOBLHJRDADHLN-KKUMJFAQSA-N Ser-Leu-Tyr Chemical compound [H]N[C@@H](CO)C(=O)N[C@@H](CC(C)C)C(=O)N[C@@H](CC1=CC=C(O)C=C1)C(O)=O JWOBLHJRDADHLN-KKUMJFAQSA-N 0.000 description 1
- SBMNPABNWKXNBJ-BQBZGAKWSA-N Ser-Lys Chemical compound NCCCC[C@@H](C(O)=O)NC(=O)[C@@H](N)CO SBMNPABNWKXNBJ-BQBZGAKWSA-N 0.000 description 1
- HJAXVYLCKDPPDF-SRVKXCTJSA-N Ser-Phe-Cys Chemical compound C1=CC=C(C=C1)C[C@@H](C(=O)N[C@@H](CS)C(=O)O)NC(=O)[C@H](CO)N HJAXVYLCKDPPDF-SRVKXCTJSA-N 0.000 description 1
- FBLNYDYPCLFTSP-IXOXFDKPSA-N Ser-Phe-Thr Chemical compound [H]N[C@@H](CO)C(=O)N[C@@H](CC1=CC=CC=C1)C(=O)N[C@@H]([C@@H](C)O)C(O)=O FBLNYDYPCLFTSP-IXOXFDKPSA-N 0.000 description 1
- WBAXJMCUFIXCNI-WDSKDSINSA-N Ser-Pro Chemical compound OC[C@H](N)C(=O)N1CCC[C@H]1C(O)=O WBAXJMCUFIXCNI-WDSKDSINSA-N 0.000 description 1
- PJIQEIFXZPCWOJ-FXQIFTODSA-N Ser-Pro-Asp Chemical compound [H]N[C@@H](CO)C(=O)N1CCC[C@H]1C(=O)N[C@@H](CC(O)=O)C(O)=O PJIQEIFXZPCWOJ-FXQIFTODSA-N 0.000 description 1
- WNDUPCKKKGSKIQ-CIUDSAMLSA-N Ser-Pro-Gln Chemical compound OC[C@H](N)C(=O)N1CCC[C@H]1C(=O)N[C@@H](CCC(N)=O)C(O)=O WNDUPCKKKGSKIQ-CIUDSAMLSA-N 0.000 description 1
- BSXKBOUZDAZXHE-CIUDSAMLSA-N Ser-Pro-Glu Chemical compound [H]N[C@@H](CO)C(=O)N1CCC[C@H]1C(=O)N[C@@H](CCC(O)=O)C(O)=O BSXKBOUZDAZXHE-CIUDSAMLSA-N 0.000 description 1
- CKDXFSPMIDSMGV-GUBZILKMSA-N Ser-Pro-Val Chemical compound [H]N[C@@H](CO)C(=O)N1CCC[C@H]1C(=O)N[C@@H](C(C)C)C(O)=O CKDXFSPMIDSMGV-GUBZILKMSA-N 0.000 description 1
- SRSPTFBENMJHMR-WHFBIAKZSA-N Ser-Ser-Gly Chemical compound OC[C@H](N)C(=O)N[C@@H](CO)C(=O)NCC(O)=O SRSPTFBENMJHMR-WHFBIAKZSA-N 0.000 description 1
- ILZAUMFXKSIUEF-SRVKXCTJSA-N Ser-Ser-Phe Chemical compound OC[C@H](N)C(=O)N[C@@H](CO)C(=O)N[C@H](C(O)=O)CC1=CC=CC=C1 ILZAUMFXKSIUEF-SRVKXCTJSA-N 0.000 description 1
- SOACHCFYJMCMHC-BWBBJGPYSA-N Ser-Thr-Cys Chemical compound C[C@H]([C@@H](C(=O)N[C@@H](CS)C(=O)O)NC(=O)[C@H](CO)N)O SOACHCFYJMCMHC-BWBBJGPYSA-N 0.000 description 1
- FLMYSKVSDVHLEW-SVSWQMSJSA-N Ser-Thr-Ile Chemical compound [H]N[C@@H](CO)C(=O)N[C@@H]([C@@H](C)O)C(=O)N[C@@H]([C@@H](C)CC)C(O)=O FLMYSKVSDVHLEW-SVSWQMSJSA-N 0.000 description 1
- SNXUIBACCONSOH-BWBBJGPYSA-N Ser-Thr-Ser Chemical compound OC[C@H](N)C(=O)N[C@@H]([C@H](O)C)C(=O)N[C@@H](CO)C(O)=O SNXUIBACCONSOH-BWBBJGPYSA-N 0.000 description 1
- FHXGMDRKJHKLKW-QWRGUYRKSA-N Ser-Tyr-Gly Chemical compound OC[C@H](N)C(=O)N[C@H](C(=O)NCC(O)=O)CC1=CC=C(O)C=C1 FHXGMDRKJHKLKW-QWRGUYRKSA-N 0.000 description 1
- JZRYFUGREMECBH-XPUUQOCRSA-N Ser-Val-Gly Chemical compound [H]N[C@@H](CO)C(=O)N[C@@H](C(C)C)C(=O)NCC(O)=O JZRYFUGREMECBH-XPUUQOCRSA-N 0.000 description 1
- ANOQEBQWIAYIMV-AEJSXWLSSA-N Ser-Val-Pro Chemical compound CC(C)[C@@H](C(=O)N1CCC[C@@H]1C(=O)O)NC(=O)[C@H](CO)N ANOQEBQWIAYIMV-AEJSXWLSSA-N 0.000 description 1
- MTCFGRXMJLQNBG-UHFFFAOYSA-N Serine Natural products OCC(N)C(O)=O MTCFGRXMJLQNBG-UHFFFAOYSA-N 0.000 description 1
- VMHLLURERBWHNL-UHFFFAOYSA-M Sodium acetate Chemical compound [Na+].CC([O-])=O VMHLLURERBWHNL-UHFFFAOYSA-M 0.000 description 1
- 240000003768 Solanum lycopersicum Species 0.000 description 1
- 240000006394 Sorghum bicolor Species 0.000 description 1
- 235000011684 Sorghum saccharatum Nutrition 0.000 description 1
- 241000187747 Streptomyces Species 0.000 description 1
- 101100370749 Streptomyces coelicolor (strain ATCC BAA-471 / A3(2) / M145) trpC1 gene Proteins 0.000 description 1
- 101100242848 Streptomyces hygroscopicus bar gene Proteins 0.000 description 1
- 241000187398 Streptomyces lividans Species 0.000 description 1
- 241001468239 Streptomyces murinus Species 0.000 description 1
- 208000037065 Subacute sclerosing leukoencephalitis Diseases 0.000 description 1
- 206010042297 Subacute sclerosing panencephalitis Diseases 0.000 description 1
- 229930006000 Sucrose Natural products 0.000 description 1
- CZMRCDWAGMRECN-UGDNZRGBSA-N Sucrose Chemical compound O[C@H]1[C@H](O)[C@@H](CO)O[C@@]1(CO)O[C@@H]1[C@H](O)[C@@H](O)[C@H](O)[C@@H](CO)O1 CZMRCDWAGMRECN-UGDNZRGBSA-N 0.000 description 1
- 241001540751 Talaromyces ruber Species 0.000 description 1
- 239000004098 Tetracycline Substances 0.000 description 1
- 244000152045 Themeda triandra Species 0.000 description 1
- 241000223257 Thermomyces Species 0.000 description 1
- 241001495429 Thielavia terrestris Species 0.000 description 1
- VPZKQTYZIVOJDV-LMVFSUKVSA-N Thr-Ala Chemical compound C[C@@H](O)[C@H](N)C(=O)N[C@@H](C)C(O)=O VPZKQTYZIVOJDV-LMVFSUKVSA-N 0.000 description 1
- HYLXOQURIOCKIH-VQVTYTSYSA-N Thr-Arg Chemical compound C[C@@H](O)[C@H](N)C(=O)N[C@H](C(O)=O)CCCNC(N)=N HYLXOQURIOCKIH-VQVTYTSYSA-N 0.000 description 1
- UQTNIFUCMBFWEJ-IWGUZYHVSA-N Thr-Asn Chemical compound C[C@@H](O)[C@H](N)C(=O)N[C@H](C(O)=O)CC(N)=O UQTNIFUCMBFWEJ-IWGUZYHVSA-N 0.000 description 1
- IOWJRKAVLALBQB-IWGUZYHVSA-N Thr-Asp Chemical compound C[C@@H](O)[C@H](N)C(=O)N[C@H](C(O)=O)CC(O)=O IOWJRKAVLALBQB-IWGUZYHVSA-N 0.000 description 1
- APIQKJYZDWVOCE-VEVYYDQMSA-N Thr-Asp-Met Chemical compound [H]N[C@@H]([C@@H](C)O)C(=O)N[C@@H](CC(O)=O)C(=O)N[C@@H](CCSC)C(O)=O APIQKJYZDWVOCE-VEVYYDQMSA-N 0.000 description 1
- DCLBXIWHLVEPMQ-JRQIVUDYSA-N Thr-Asp-Tyr Chemical compound C[C@@H](O)[C@H](N)C(=O)N[C@@H](CC(O)=O)C(=O)N[C@H](C(O)=O)CC1=CC=C(O)C=C1 DCLBXIWHLVEPMQ-JRQIVUDYSA-N 0.000 description 1
- KZUJCMPVNXOBAF-LKXGYXEUSA-N Thr-Cys-Asp Chemical compound [H]N[C@@H]([C@@H](C)O)C(=O)N[C@@H](CS)C(=O)N[C@@H](CC(O)=O)C(O)=O KZUJCMPVNXOBAF-LKXGYXEUSA-N 0.000 description 1
- UHBPFYOQQPFKQR-JHEQGTHGSA-N Thr-Gln-Gly Chemical compound [H]N[C@@H]([C@@H](C)O)C(=O)N[C@@H](CCC(N)=O)C(=O)NCC(O)=O UHBPFYOQQPFKQR-JHEQGTHGSA-N 0.000 description 1
- OQCXTUQTKQFDCX-HTUGSXCWSA-N Thr-Glu-Phe Chemical compound C[C@H]([C@@H](C(=O)N[C@@H](CCC(=O)O)C(=O)N[C@@H](CC1=CC=CC=C1)C(=O)O)N)O OQCXTUQTKQFDCX-HTUGSXCWSA-N 0.000 description 1
- XOTBWOCSLMBGMF-SUSMZKCASA-N Thr-Glu-Thr Chemical compound [H]N[C@@H]([C@@H](C)O)C(=O)N[C@@H](CCC(O)=O)C(=O)N[C@@H]([C@@H](C)O)C(O)=O XOTBWOCSLMBGMF-SUSMZKCASA-N 0.000 description 1
- AQAMPXBRJJWPNI-JHEQGTHGSA-N Thr-Gly-Glu Chemical compound [H]N[C@@H]([C@@H](C)O)C(=O)NCC(=O)N[C@@H](CCC(O)=O)C(O)=O AQAMPXBRJJWPNI-JHEQGTHGSA-N 0.000 description 1
- MPUMPERGHHJGRP-WEDXCCLWSA-N Thr-Gly-Lys Chemical compound C[C@H]([C@@H](C(=O)NCC(=O)N[C@@H](CCCCN)C(=O)O)N)O MPUMPERGHHJGRP-WEDXCCLWSA-N 0.000 description 1
- LUMXICQAOKVQOB-YWIQKCBGSA-N Thr-Ile Chemical compound CC[C@H](C)[C@@H](C(O)=O)NC(=O)[C@@H](N)[C@@H](C)O LUMXICQAOKVQOB-YWIQKCBGSA-N 0.000 description 1
- ZBKDBZUTTXINIX-RWRJDSDZSA-N Thr-Ile-Gln Chemical compound [H]N[C@@H]([C@@H](C)O)C(=O)N[C@@H]([C@@H](C)CC)C(=O)N[C@@H](CCC(N)=O)C(O)=O ZBKDBZUTTXINIX-RWRJDSDZSA-N 0.000 description 1
- XTCNBOBTROGWMW-RWRJDSDZSA-N Thr-Ile-Glu Chemical compound CC[C@H](C)[C@@H](C(=O)N[C@@H](CCC(=O)O)C(=O)O)NC(=O)[C@H]([C@@H](C)O)N XTCNBOBTROGWMW-RWRJDSDZSA-N 0.000 description 1
- GXUWHVZYDAHFSV-FLBSBUHZSA-N Thr-Ile-Thr Chemical compound [H]N[C@@H]([C@@H](C)O)C(=O)N[C@@H]([C@@H](C)CC)C(=O)N[C@@H]([C@@H](C)O)C(O)=O GXUWHVZYDAHFSV-FLBSBUHZSA-N 0.000 description 1
- AMXMBCAXAZUCFA-RHYQMDGZSA-N Thr-Leu-Arg Chemical compound [H]N[C@@H]([C@@H](C)O)C(=O)N[C@@H](CC(C)C)C(=O)N[C@@H](CCCNC(N)=N)C(O)=O AMXMBCAXAZUCFA-RHYQMDGZSA-N 0.000 description 1
- KZSYAEWQMJEGRZ-RHYQMDGZSA-N Thr-Leu-Val Chemical compound [H]N[C@@H]([C@@H](C)O)C(=O)N[C@@H](CC(C)C)C(=O)N[C@@H](C(C)C)C(O)=O KZSYAEWQMJEGRZ-RHYQMDGZSA-N 0.000 description 1
- UUSQVWOVUYMLJA-PPCPHDFISA-N Thr-Lys-Ile Chemical compound [H]N[C@@H]([C@@H](C)O)C(=O)N[C@@H](CCCCN)C(=O)N[C@@H]([C@@H](C)CC)C(O)=O UUSQVWOVUYMLJA-PPCPHDFISA-N 0.000 description 1
- QFEYTTHKPSOFLV-OSUNSFLBSA-N Thr-Met-Ile Chemical compound CC[C@H](C)[C@@H](C(=O)O)NC(=O)[C@H](CCSC)NC(=O)[C@H]([C@@H](C)O)N QFEYTTHKPSOFLV-OSUNSFLBSA-N 0.000 description 1
- SIEZEMFJLYRUMK-YTWAJWBKSA-N Thr-Met-Pro Chemical compound C[C@H]([C@@H](C(=O)N[C@@H](CCSC)C(=O)N1CCC[C@@H]1C(=O)O)N)O SIEZEMFJLYRUMK-YTWAJWBKSA-N 0.000 description 1
- PZSDPRBZINDEJV-HTUGSXCWSA-N Thr-Phe-Gln Chemical compound [H]N[C@@H]([C@@H](C)O)C(=O)N[C@@H](CC1=CC=CC=C1)C(=O)N[C@@H](CCC(N)=O)C(O)=O PZSDPRBZINDEJV-HTUGSXCWSA-N 0.000 description 1
- NZRUWPIYECBYRK-HTUGSXCWSA-N Thr-Phe-Glu Chemical compound [H]N[C@@H]([C@@H](C)O)C(=O)N[C@@H](CC1=CC=CC=C1)C(=O)N[C@@H](CCC(O)=O)C(O)=O NZRUWPIYECBYRK-HTUGSXCWSA-N 0.000 description 1
- VGYVVSQFSSKZRJ-OEAJRASXSA-N Thr-Phe-Lys Chemical compound NCCCC[C@@H](C(O)=O)NC(=O)[C@@H](NC(=O)[C@@H](N)[C@H](O)C)CC1=CC=CC=C1 VGYVVSQFSSKZRJ-OEAJRASXSA-N 0.000 description 1
- VTMGKRABARCZAX-OSUNSFLBSA-N Thr-Pro-Ile Chemical compound CC[C@H](C)[C@@H](C(O)=O)NC(=O)[C@@H]1CCCN1C(=O)[C@@H](N)[C@@H](C)O VTMGKRABARCZAX-OSUNSFLBSA-N 0.000 description 1
- KERCOYANYUPLHJ-XGEHTFHBSA-N Thr-Pro-Ser Chemical compound C[C@@H](O)[C@H](N)C(=O)N1CCC[C@H]1C(=O)N[C@@H](CO)C(O)=O KERCOYANYUPLHJ-XGEHTFHBSA-N 0.000 description 1
- DSGIVWSDDRDJIO-ZXXMMSQZSA-N Thr-Thr Chemical compound C[C@@H](O)[C@H](N)C(=O)N[C@@H]([C@@H](C)O)C(O)=O DSGIVWSDDRDJIO-ZXXMMSQZSA-N 0.000 description 1
- UQCNIMDPYICBTR-KYNKHSRBSA-N Thr-Thr-Gly Chemical compound [H]N[C@@H]([C@@H](C)O)C(=O)N[C@@H]([C@@H](C)O)C(=O)NCC(O)=O UQCNIMDPYICBTR-KYNKHSRBSA-N 0.000 description 1
- KAFKKRJQHOECGW-JCOFBHIZSA-N Thr-Trp Chemical compound C1=CC=C2C(C[C@H](NC(=O)[C@@H](N)[C@H](O)C)C(O)=O)=CNC2=C1 KAFKKRJQHOECGW-JCOFBHIZSA-N 0.000 description 1
- REJRKTOJTCPDPO-IRIUXVKKSA-N Thr-Tyr-Glu Chemical compound [H]N[C@@H]([C@@H](C)O)C(=O)N[C@@H](CC1=CC=C(O)C=C1)C(=O)N[C@@H](CCC(O)=O)C(O)=O REJRKTOJTCPDPO-IRIUXVKKSA-N 0.000 description 1
- LVRFMARKDGGZMX-IZPVPAKOSA-N Thr-Tyr-Thr Chemical compound C[C@@H](O)[C@H](N)C(=O)N[C@H](C(=O)N[C@@H]([C@@H](C)O)C(O)=O)CC1=CC=C(O)C=C1 LVRFMARKDGGZMX-IZPVPAKOSA-N 0.000 description 1
- QGVBFDIREUUSHX-IFFSRLJSSA-N Thr-Val-Gln Chemical compound [H]N[C@@H]([C@@H](C)O)C(=O)N[C@@H](C(C)C)C(=O)N[C@@H](CCC(N)=O)C(O)=O QGVBFDIREUUSHX-IFFSRLJSSA-N 0.000 description 1
- SPIFGZFZMVLPHN-UNQGMJICSA-N Thr-Val-Phe Chemical compound [H]N[C@@H]([C@@H](C)O)C(=O)N[C@@H](C(C)C)C(=O)N[C@@H](CC1=CC=CC=C1)C(O)=O SPIFGZFZMVLPHN-UNQGMJICSA-N 0.000 description 1
- AYFVYJQAPQTCCC-UHFFFAOYSA-N Threonine Natural products CC(O)C(N)C(O)=O AYFVYJQAPQTCCC-UHFFFAOYSA-N 0.000 description 1
- 239000004473 Threonine Substances 0.000 description 1
- 241001149964 Tolypocladium Species 0.000 description 1
- 102100033663 Transforming growth factor beta receptor type 3 Human genes 0.000 description 1
- 108060008539 Transglutaminase Proteins 0.000 description 1
- 102000008579 Transposases Human genes 0.000 description 1
- 108010020764 Transposases Proteins 0.000 description 1
- 241000223260 Trichoderma harzianum Species 0.000 description 1
- 235000021307 Triticum Nutrition 0.000 description 1
- 244000098338 Triticum aestivum Species 0.000 description 1
- LHHDBONOFZDWMW-AAEUAGOBSA-N Trp-Asp-Gly Chemical compound C1=CC=C2C(=C1)C(=CN2)C[C@@H](C(=O)N[C@@H](CC(=O)O)C(=O)NCC(=O)O)N LHHDBONOFZDWMW-AAEUAGOBSA-N 0.000 description 1
- WACMTVIJWRNVSO-CWRNSKLLSA-N Trp-Asp-Pro Chemical compound C1C[C@@H](N(C1)C(=O)[C@H](CC(=O)O)NC(=O)[C@H](CC2=CNC3=CC=CC=C32)N)C(=O)O WACMTVIJWRNVSO-CWRNSKLLSA-N 0.000 description 1
- RERIQEJUYCLJQI-QRTARXTBSA-N Trp-Asp-Val Chemical compound CC(C)[C@@H](C(=O)O)NC(=O)[C@H](CC(=O)O)NC(=O)[C@H](CC1=CNC2=CC=CC=C21)N RERIQEJUYCLJQI-QRTARXTBSA-N 0.000 description 1
- PKUJMYZNJMRHEZ-XIRDDKMYSA-N Trp-Glu-Arg Chemical compound [H]N[C@@H](CC1=CNC2=C1C=CC=C2)C(=O)N[C@@H](CCC(O)=O)C(=O)N[C@@H](CCCNC(N)=N)C(O)=O PKUJMYZNJMRHEZ-XIRDDKMYSA-N 0.000 description 1
- OENGVSDBQHHGBU-QEJZJMRPSA-N Trp-Glu-Asn Chemical compound [H]N[C@@H](CC1=CNC2=C1C=CC=C2)C(=O)N[C@@H](CCC(O)=O)C(=O)N[C@@H](CC(N)=O)C(O)=O OENGVSDBQHHGBU-QEJZJMRPSA-N 0.000 description 1
- BEWOXKJJMBKRQL-AAEUAGOBSA-N Trp-Gly-Asp Chemical compound C1=CC=C2C(=C1)C(=CN2)C[C@@H](C(=O)NCC(=O)N[C@@H](CC(=O)O)C(=O)O)N BEWOXKJJMBKRQL-AAEUAGOBSA-N 0.000 description 1
- DZIKVMCFXIIETR-JSGCOSHPSA-N Trp-Gly-Glu Chemical compound [H]N[C@@H](CC1=CNC2=C1C=CC=C2)C(=O)NCC(=O)N[C@@H](CCC(O)=O)C(O)=O DZIKVMCFXIIETR-JSGCOSHPSA-N 0.000 description 1
- KBUBZAMBIVEFEI-ZFWWWQNUSA-N Trp-His Chemical compound C([C@H](NC(=O)[C@H](CC=1C2=CC=CC=C2NC=1)N)C(O)=O)C1=CNC=N1 KBUBZAMBIVEFEI-ZFWWWQNUSA-N 0.000 description 1
- OGZRZMJASKKMJZ-XIRDDKMYSA-N Trp-Leu-Asp Chemical compound CC(C)C[C@@H](C(=O)N[C@@H](CC(=O)O)C(=O)O)NC(=O)[C@H](CC1=CNC2=CC=CC=C21)N OGZRZMJASKKMJZ-XIRDDKMYSA-N 0.000 description 1
- DZHDVYLBNKMLMB-ZFWWWQNUSA-N Trp-Lys Chemical compound C1=CC=C2C(C[C@H](N)C(=O)N[C@@H](CCCCN)C(O)=O)=CNC2=C1 DZHDVYLBNKMLMB-ZFWWWQNUSA-N 0.000 description 1
- XGFOXYJQBRTJPO-PJODQICGSA-N Trp-Pro-Ala Chemical compound [H]N[C@@H](CC1=CNC2=C1C=CC=C2)C(=O)N1CCC[C@H]1C(=O)N[C@@H](C)C(O)=O XGFOXYJQBRTJPO-PJODQICGSA-N 0.000 description 1
- ABRICLFKFRFDKS-IHPCNDPISA-N Trp-Ser-Tyr Chemical compound C([C@H](NC(=O)[C@H](CO)NC(=O)[C@H](CC=1C2=CC=CC=C2NC=1)N)C(O)=O)C1=CC=C(O)C=C1 ABRICLFKFRFDKS-IHPCNDPISA-N 0.000 description 1
- HIZDHWHVOLUGOX-BPUTZDHNSA-N Trp-Ser-Val Chemical compound [H]N[C@@H](CC1=CNC2=C1C=CC=C2)C(=O)N[C@@H](CO)C(=O)N[C@@H](C(C)C)C(O)=O HIZDHWHVOLUGOX-BPUTZDHNSA-N 0.000 description 1
- ICPRIGUXAFULPH-ILWGZMRPSA-N Trp-Tyr-Pro Chemical compound C1C[C@@H](N(C1)C(=O)[C@H](CC2=CC=C(C=C2)O)NC(=O)[C@H](CC3=CNC4=CC=CC=C43)N)C(=O)O ICPRIGUXAFULPH-ILWGZMRPSA-N 0.000 description 1
- 108090000631 Trypsin Proteins 0.000 description 1
- 102000004142 Trypsin Human genes 0.000 description 1
- JBBYKPZAPOLCPK-JYJNAYRXSA-N Tyr-Arg-Met Chemical compound [H]N[C@@H](CC1=CC=C(O)C=C1)C(=O)N[C@@H](CCCNC(N)=N)C(=O)N[C@@H](CCSC)C(O)=O JBBYKPZAPOLCPK-JYJNAYRXSA-N 0.000 description 1
- CRWOSTCODDFEKZ-HRCADAONSA-N Tyr-Arg-Pro Chemical compound C1C[C@@H](N(C1)C(=O)[C@H](CCCN=C(N)N)NC(=O)[C@H](CC2=CC=C(C=C2)O)N)C(=O)O CRWOSTCODDFEKZ-HRCADAONSA-N 0.000 description 1
- SGFIXFAHVWJKTD-KJEVXHAQSA-N Tyr-Arg-Thr Chemical compound [H]N[C@@H](CC1=CC=C(O)C=C1)C(=O)N[C@@H](CCCNC(N)=N)C(=O)N[C@@H]([C@@H](C)O)C(O)=O SGFIXFAHVWJKTD-KJEVXHAQSA-N 0.000 description 1
- QYSBJAUCUKHSLU-JYJNAYRXSA-N Tyr-Arg-Val Chemical compound [H]N[C@@H](CC1=CC=C(O)C=C1)C(=O)N[C@@H](CCCNC(N)=N)C(=O)N[C@@H](C(C)C)C(O)=O QYSBJAUCUKHSLU-JYJNAYRXSA-N 0.000 description 1
- OEVJGIHPQOXYFE-SRVKXCTJSA-N Tyr-Asn-Asp Chemical compound [H]N[C@@H](CC1=CC=C(O)C=C1)C(=O)N[C@@H](CC(N)=O)C(=O)N[C@@H](CC(O)=O)C(O)=O OEVJGIHPQOXYFE-SRVKXCTJSA-N 0.000 description 1
- AYHSJESDFKREAR-KKUMJFAQSA-N Tyr-Asn-Leu Chemical compound CC(C)C[C@@H](C(O)=O)NC(=O)[C@H](CC(N)=O)NC(=O)[C@@H](N)CC1=CC=C(O)C=C1 AYHSJESDFKREAR-KKUMJFAQSA-N 0.000 description 1
- WPVGRKLNHJJCEN-BZSNNMDCSA-N Tyr-Asp-Phe Chemical compound C([C@H](N)C(=O)N[C@@H](CC(O)=O)C(=O)N[C@@H](CC=1C=CC=CC=1)C(O)=O)C1=CC=C(O)C=C1 WPVGRKLNHJJCEN-BZSNNMDCSA-N 0.000 description 1
- CKHQKYHIZCRTAP-SOUVJXGZSA-N Tyr-Gln-Pro Chemical compound C1C[C@@H](N(C1)C(=O)[C@H](CCC(=O)N)NC(=O)[C@H](CC2=CC=C(C=C2)O)N)C(=O)O CKHQKYHIZCRTAP-SOUVJXGZSA-N 0.000 description 1
- HZZKQZDUIKVFDZ-AVGNSLFASA-N Tyr-Gln-Ser Chemical compound C1=CC(=CC=C1C[C@@H](C(=O)N[C@@H](CCC(=O)N)C(=O)N[C@@H](CO)C(=O)O)N)O HZZKQZDUIKVFDZ-AVGNSLFASA-N 0.000 description 1
- WVRUKYLYMFGKAN-IHRRRGAJSA-N Tyr-Glu-Glu Chemical compound OC(=O)CC[C@@H](C(O)=O)NC(=O)[C@H](CCC(O)=O)NC(=O)[C@@H](N)CC1=CC=C(O)C=C1 WVRUKYLYMFGKAN-IHRRRGAJSA-N 0.000 description 1
- HIINQLBHPIQYHN-JTQLQIEISA-N Tyr-Gly-Gly Chemical compound OC(=O)CNC(=O)CNC(=O)[C@@H](N)CC1=CC=C(O)C=C1 HIINQLBHPIQYHN-JTQLQIEISA-N 0.000 description 1
- QJKMCQRFHJRIPU-XDTLVQLUSA-N Tyr-Ile Chemical compound CC[C@H](C)[C@@H](C(O)=O)NC(=O)[C@@H](N)CC1=CC=C(O)C=C1 QJKMCQRFHJRIPU-XDTLVQLUSA-N 0.000 description 1
- GGXUDPQWAWRINY-XEGUGMAKSA-N Tyr-Ile-Gly Chemical compound OC(=O)CNC(=O)[C@H]([C@@H](C)CC)NC(=O)[C@@H](N)CC1=CC=C(O)C=C1 GGXUDPQWAWRINY-XEGUGMAKSA-N 0.000 description 1
- DWAMXBFJNZIHMC-KBPBESRZSA-N Tyr-Leu-Gly Chemical compound [H]N[C@@H](CC1=CC=C(O)C=C1)C(=O)N[C@@H](CC(C)C)C(=O)NCC(O)=O DWAMXBFJNZIHMC-KBPBESRZSA-N 0.000 description 1
- AOLHUMAVONBBEZ-STQMWFEESA-N Tyr-Lys Chemical compound NCCCC[C@@H](C(O)=O)NC(=O)[C@@H](N)CC1=CC=C(O)C=C1 AOLHUMAVONBBEZ-STQMWFEESA-N 0.000 description 1
- YSGAPESOXHFTQY-IHRRRGAJSA-N Tyr-Met-Asp Chemical compound CSCC[C@@H](C(=O)N[C@@H](CC(=O)O)C(=O)O)NC(=O)[C@H](CC1=CC=C(C=C1)O)N YSGAPESOXHFTQY-IHRRRGAJSA-N 0.000 description 1
- VNYDHJARLHNEGA-RYUDHWBXSA-N Tyr-Pro Chemical compound C([C@H](N)C(=O)N1[C@@H](CCC1)C(O)=O)C1=CC=C(O)C=C1 VNYDHJARLHNEGA-RYUDHWBXSA-N 0.000 description 1
- PYJKETPLFITNKS-IHRRRGAJSA-N Tyr-Pro-Asn Chemical compound N[C@@H](Cc1ccc(O)cc1)C(=O)N1CCC[C@H]1C(=O)N[C@@H](CC(N)=O)C(O)=O PYJKETPLFITNKS-IHRRRGAJSA-N 0.000 description 1
- ZSXJENBJGRHKIG-UWVGGRQHSA-N Tyr-Ser Chemical compound OC[C@@H](C(O)=O)NC(=O)[C@@H](N)CC1=CC=C(O)C=C1 ZSXJENBJGRHKIG-UWVGGRQHSA-N 0.000 description 1
- MDXLPNRXCFOBTL-BZSNNMDCSA-N Tyr-Ser-Tyr Chemical compound [H]N[C@@H](CC1=CC=C(O)C=C1)C(=O)N[C@@H](CO)C(=O)N[C@@H](CC1=CC=C(O)C=C1)C(O)=O MDXLPNRXCFOBTL-BZSNNMDCSA-N 0.000 description 1
- MFEVVAXTBZELLL-GGVZMXCHSA-N Tyr-Thr Chemical compound C[C@@H](O)[C@@H](C(O)=O)NC(=O)[C@@H](N)CC1=CC=C(O)C=C1 MFEVVAXTBZELLL-GGVZMXCHSA-N 0.000 description 1
- ZZDYJFVIKVSUFA-WLTAIBSBSA-N Tyr-Thr-Gly Chemical compound [H]N[C@@H](CC1=CC=C(O)C=C1)C(=O)N[C@@H]([C@@H](C)O)C(=O)NCC(O)=O ZZDYJFVIKVSUFA-WLTAIBSBSA-N 0.000 description 1
- PWKMJDQXKCENMF-MEYUZBJRSA-N Tyr-Thr-Leu Chemical compound [H]N[C@@H](CC1=CC=C(O)C=C1)C(=O)N[C@@H]([C@@H](C)O)C(=O)N[C@@H](CC(C)C)C(O)=O PWKMJDQXKCENMF-MEYUZBJRSA-N 0.000 description 1
- WQOHKVRQDLNDIL-YJRXYDGGSA-N Tyr-Thr-Ser Chemical compound [H]N[C@@H](CC1=CC=C(O)C=C1)C(=O)N[C@@H]([C@@H](C)O)C(=O)N[C@@H](CO)C(O)=O WQOHKVRQDLNDIL-YJRXYDGGSA-N 0.000 description 1
- GAKBTSMAPGLQFA-JNPHEJMOSA-N Tyr-Thr-Tyr Chemical compound C([C@H](N)C(=O)N[C@@H]([C@H](O)C)C(=O)N[C@@H](CC=1C=CC(O)=CC=1)C(O)=O)C1=CC=C(O)C=C1 GAKBTSMAPGLQFA-JNPHEJMOSA-N 0.000 description 1
- JAQGKXUEKGKTKX-HOTGVXAUSA-N Tyr-Tyr Chemical compound C([C@H](N)C(=O)N[C@@H](CC=1C=CC(O)=CC=1)C(O)=O)C1=CC=C(O)C=C1 JAQGKXUEKGKTKX-HOTGVXAUSA-N 0.000 description 1
- GZWPQZDVTBZVEP-BZSNNMDCSA-N Tyr-Tyr-Asn Chemical compound [H]N[C@@H](CC1=CC=C(O)C=C1)C(=O)N[C@@H](CC1=CC=C(O)C=C1)C(=O)N[C@@H](CC(N)=O)C(O)=O GZWPQZDVTBZVEP-BZSNNMDCSA-N 0.000 description 1
- KSGKJSFPWSMJHK-JNPHEJMOSA-N Tyr-Tyr-Thr Chemical compound [H]N[C@@H](CC1=CC=C(O)C=C1)C(=O)N[C@@H](CC1=CC=C(O)C=C1)C(=O)N[C@@H]([C@@H](C)O)C(O)=O KSGKJSFPWSMJHK-JNPHEJMOSA-N 0.000 description 1
- SQUMHUZLJDUROQ-YDHLFZDLSA-N Tyr-Val-Asp Chemical compound [H]N[C@@H](CC1=CC=C(O)C=C1)C(=O)N[C@@H](C(C)C)C(=O)N[C@@H](CC(O)=O)C(O)=O SQUMHUZLJDUROQ-YDHLFZDLSA-N 0.000 description 1
- 101150050575 URA3 gene Proteins 0.000 description 1
- 108010064997 VPY tripeptide Proteins 0.000 description 1
- WITCOKQIPFWQQD-FSPLSTOPSA-N Val-Asn Chemical compound CC(C)[C@H](N)C(=O)N[C@H](C(O)=O)CC(N)=O WITCOKQIPFWQQD-FSPLSTOPSA-N 0.000 description 1
- ZMDCGGKHRKNWKD-LAEOZQHASA-N Val-Asn-Glu Chemical compound CC(C)[C@@H](C(=O)N[C@@H](CC(=O)N)C(=O)N[C@@H](CCC(=O)O)C(=O)O)N ZMDCGGKHRKNWKD-LAEOZQHASA-N 0.000 description 1
- LIQJSDDOULTANC-QSFUFRPTSA-N Val-Asn-Ile Chemical compound CC[C@H](C)[C@@H](C(=O)O)NC(=O)[C@H](CC(=O)N)NC(=O)[C@H](C(C)C)N LIQJSDDOULTANC-QSFUFRPTSA-N 0.000 description 1
- IDKGBVZGNTYYCC-QXEWZRGKSA-N Val-Asn-Pro Chemical compound CC(C)[C@H](N)C(=O)N[C@@H](CC(N)=O)C(=O)N1CCC[C@H]1C(O)=O IDKGBVZGNTYYCC-QXEWZRGKSA-N 0.000 description 1
- XQVRMLRMTAGSFJ-QXEWZRGKSA-N Val-Asp-Arg Chemical compound CC(C)[C@@H](C(=O)N[C@@H](CC(=O)O)C(=O)N[C@@H](CCCN=C(N)N)C(=O)O)N XQVRMLRMTAGSFJ-QXEWZRGKSA-N 0.000 description 1
- QHDXUYOYTPWCSK-RCOVLWMOSA-N Val-Asp-Gly Chemical compound CC(C)[C@@H](C(=O)N[C@@H](CC(=O)O)C(=O)NCC(=O)O)N QHDXUYOYTPWCSK-RCOVLWMOSA-N 0.000 description 1
- ZQGPWORGSNRQLN-NHCYSSNCSA-N Val-Asp-His Chemical compound CC(C)[C@@H](C(=O)N[C@@H](CC(=O)O)C(=O)N[C@@H](CC1=CN=CN1)C(=O)O)N ZQGPWORGSNRQLN-NHCYSSNCSA-N 0.000 description 1
- TZVUSFMQWPWHON-NHCYSSNCSA-N Val-Asp-Leu Chemical compound CC(C)C[C@@H](C(=O)O)NC(=O)[C@H](CC(=O)O)NC(=O)[C@H](C(C)C)N TZVUSFMQWPWHON-NHCYSSNCSA-N 0.000 description 1
- COSLEEOIYRPTHD-YDHLFZDLSA-N Val-Asp-Tyr Chemical compound CC(C)[C@H](N)C(=O)N[C@@H](CC(O)=O)C(=O)N[C@H](C(O)=O)CC1=CC=C(O)C=C1 COSLEEOIYRPTHD-YDHLFZDLSA-N 0.000 description 1
- VFOHXOLPLACADK-GVXVVHGQSA-N Val-Gln-Leu Chemical compound CC(C)C[C@@H](C(=O)O)NC(=O)[C@H](CCC(=O)N)NC(=O)[C@H](C(C)C)N VFOHXOLPLACADK-GVXVVHGQSA-N 0.000 description 1
- XGJLNBNZNMVJRS-NRPADANISA-N Val-Glu-Ala Chemical compound CC(C)[C@H](N)C(=O)N[C@@H](CCC(O)=O)C(=O)N[C@@H](C)C(O)=O XGJLNBNZNMVJRS-NRPADANISA-N 0.000 description 1
- URIRWLJVWHYLET-ONGXEEELSA-N Val-Gly-Leu Chemical compound CC(C)C[C@@H](C(O)=O)NC(=O)CNC(=O)[C@@H](N)C(C)C URIRWLJVWHYLET-ONGXEEELSA-N 0.000 description 1
- BNQVUHQWZGTIBX-IUCAKERBSA-N Val-His Chemical compound CC(C)[C@H]([NH3+])C(=O)N[C@H](C([O-])=O)CC1=CN=CN1 BNQVUHQWZGTIBX-IUCAKERBSA-N 0.000 description 1
- JZWZACGUZVCQPS-RNJOBUHISA-N Val-Ile-Pro Chemical compound CC[C@H](C)[C@@H](C(=O)N1CCC[C@@H]1C(=O)O)NC(=O)[C@H](C(C)C)N JZWZACGUZVCQPS-RNJOBUHISA-N 0.000 description 1
- DJQIUOKSNRBTSV-CYDGBPFRSA-N Val-Ile-Val Chemical compound CC[C@H](C)[C@@H](C(=O)N[C@@H](C(C)C)C(=O)O)NC(=O)[C@H](C(C)C)N DJQIUOKSNRBTSV-CYDGBPFRSA-N 0.000 description 1
- XCTHZFGSVQBHBW-IUCAKERBSA-N Val-Leu Chemical compound CC(C)C[C@@H](C([O-])=O)NC(=O)[C@@H]([NH3+])C(C)C XCTHZFGSVQBHBW-IUCAKERBSA-N 0.000 description 1
- LYERIXUFCYVFFX-GVXVVHGQSA-N Val-Leu-Glu Chemical compound CC(C)C[C@@H](C(=O)N[C@@H](CCC(=O)O)C(=O)O)NC(=O)[C@H](C(C)C)N LYERIXUFCYVFFX-GVXVVHGQSA-N 0.000 description 1
- UMPVMAYCLYMYGA-ONGXEEELSA-N Val-Leu-Gly Chemical compound CC(C)[C@H](N)C(=O)N[C@@H](CC(C)C)C(=O)NCC(O)=O UMPVMAYCLYMYGA-ONGXEEELSA-N 0.000 description 1
- JKHXYJKMNSSFFL-IUCAKERBSA-N Val-Lys Chemical compound CC(C)[C@H](N)C(=O)N[C@H](C(O)=O)CCCCN JKHXYJKMNSSFFL-IUCAKERBSA-N 0.000 description 1
- CXWJFWAZIVWBOS-XQQFMLRXSA-N Val-Lys-Pro Chemical compound CC(C)[C@@H](C(=O)N[C@@H](CCCCN)C(=O)N1CCC[C@@H]1C(=O)O)N CXWJFWAZIVWBOS-XQQFMLRXSA-N 0.000 description 1
- WSUWDIVCPOJFCX-TUAOUCFPSA-N Val-Met-Pro Chemical compound CC(C)[C@@H](C(=O)N[C@@H](CCSC)C(=O)N1CCC[C@@H]1C(=O)O)N WSUWDIVCPOJFCX-TUAOUCFPSA-N 0.000 description 1
- YLRAFVVWZRSZQC-DZKIICNBSA-N Val-Phe-Glu Chemical compound CC(C)[C@@H](C(=O)N[C@@H](CC1=CC=CC=C1)C(=O)N[C@@H](CCC(=O)O)C(=O)O)N YLRAFVVWZRSZQC-DZKIICNBSA-N 0.000 description 1
- USLVEJAHTBLSIL-CYDGBPFRSA-N Val-Pro-Ile Chemical compound CC[C@H](C)[C@@H](C(O)=O)NC(=O)[C@@H]1CCCN1C(=O)[C@@H](N)C(C)C USLVEJAHTBLSIL-CYDGBPFRSA-N 0.000 description 1
- NHXZRXLFOBFMDM-AVGNSLFASA-N Val-Pro-Leu Chemical compound CC(C)C[C@@H](C(O)=O)NC(=O)[C@@H]1CCCN1C(=O)[C@@H](N)C(C)C NHXZRXLFOBFMDM-AVGNSLFASA-N 0.000 description 1
- SSYBNWFXCFNRFN-GUBZILKMSA-N Val-Pro-Ser Chemical compound CC(C)[C@H](N)C(=O)N1CCC[C@H]1C(=O)N[C@@H](CO)C(O)=O SSYBNWFXCFNRFN-GUBZILKMSA-N 0.000 description 1
- MIKHIIQMRFYVOR-RCWTZXSCSA-N Val-Pro-Thr Chemical compound C[C@H]([C@@H](C(=O)O)NC(=O)[C@@H]1CCCN1C(=O)[C@H](C(C)C)N)O MIKHIIQMRFYVOR-RCWTZXSCSA-N 0.000 description 1
- RYHUIHUOYRNNIE-NRPADANISA-N Val-Ser-Gln Chemical compound CC(C)[C@@H](C(=O)N[C@@H](CO)C(=O)N[C@@H](CCC(=O)N)C(=O)O)N RYHUIHUOYRNNIE-NRPADANISA-N 0.000 description 1
- GBIUHAYJGWVNLN-UHFFFAOYSA-N Val-Ser-Pro Natural products CC(C)C(N)C(=O)NC(CO)C(=O)N1CCCC1C(O)=O GBIUHAYJGWVNLN-UHFFFAOYSA-N 0.000 description 1
- HWNYVQMOLCYHEA-IHRRRGAJSA-N Val-Ser-Tyr Chemical compound CC(C)[C@@H](C(=O)N[C@@H](CO)C(=O)N[C@@H](CC1=CC=C(C=C1)O)C(=O)O)N HWNYVQMOLCYHEA-IHRRRGAJSA-N 0.000 description 1
- PQSNETRGCRUOGP-KKHAAJSZSA-N Val-Thr-Asn Chemical compound CC(C)[C@H](N)C(=O)N[C@@H]([C@@H](C)O)C(=O)N[C@H](C(O)=O)CC(N)=O PQSNETRGCRUOGP-KKHAAJSZSA-N 0.000 description 1
- JAIZPWVHPQRYOU-ZJDVBMNYSA-N Val-Thr-Thr Chemical compound C[C@H]([C@@H](C(=O)N[C@@H]([C@@H](C)O)C(=O)O)NC(=O)[C@H](C(C)C)N)O JAIZPWVHPQRYOU-ZJDVBMNYSA-N 0.000 description 1
- HVRRJRMULCPNRO-BZSNNMDCSA-N Val-Trp-Arg Chemical compound C1=CC=C2C(C[C@H](NC(=O)[C@@H](N)C(C)C)C(=O)N[C@@H](CCCN=C(N)N)C(O)=O)=CNC2=C1 HVRRJRMULCPNRO-BZSNNMDCSA-N 0.000 description 1
- UFCHCOKFAGOQSF-BQFCYCMXSA-N Val-Trp-Glu Chemical compound CC(C)[C@@H](C(=O)N[C@@H](CC1=CNC2=CC=CC=C21)C(=O)N[C@@H](CCC(=O)O)C(=O)O)N UFCHCOKFAGOQSF-BQFCYCMXSA-N 0.000 description 1
- QHSSPPHOHJSTML-HOCLYGCPSA-N Val-Trp-Gly Chemical compound CC(C)[C@@H](C(=O)N[C@@H](CC1=CNC2=CC=CC=C21)C(=O)NCC(=O)O)N QHSSPPHOHJSTML-HOCLYGCPSA-N 0.000 description 1
- VTIAEOKFUJJBTC-YDHLFZDLSA-N Val-Tyr-Asp Chemical compound CC(C)[C@@H](C(=O)N[C@@H](CC1=CC=C(C=C1)O)C(=O)N[C@@H](CC(=O)O)C(=O)O)N VTIAEOKFUJJBTC-YDHLFZDLSA-N 0.000 description 1
- 208000027418 Wounds and injury Diseases 0.000 description 1
- 241000235013 Yarrowia Species 0.000 description 1
- 241000235015 Yarrowia lipolytica Species 0.000 description 1
- 240000008042 Zea mays Species 0.000 description 1
- 235000005824 Zea mays ssp. parviglumis Nutrition 0.000 description 1
- 235000002017 Zea mays subsp mays Nutrition 0.000 description 1
- 229910021536 Zeolite Inorganic materials 0.000 description 1
- 241000758405 Zoopagomycotina Species 0.000 description 1
- 108020002494 acetyltransferase Proteins 0.000 description 1
- 102000005421 acetyltransferase Human genes 0.000 description 1
- 230000002378 acidificating effect Effects 0.000 description 1
- 239000012190 activator Substances 0.000 description 1
- 229960000643 adenine Drugs 0.000 description 1
- 239000008272 agar Substances 0.000 description 1
- 239000011543 agarose gel Substances 0.000 description 1
- 238000000246 agarose gel electrophoresis Methods 0.000 description 1
- 238000013019 agitation Methods 0.000 description 1
- 235000004279 alanine Nutrition 0.000 description 1
- 238000012867 alanine scanning Methods 0.000 description 1
- 108010086434 alanyl-seryl-glycine Proteins 0.000 description 1
- 150000001298 alcohols Chemical class 0.000 description 1
- 150000001335 aliphatic alkanes Chemical group 0.000 description 1
- 229930013930 alkaloid Natural products 0.000 description 1
- 150000003797 alkaloid derivatives Chemical class 0.000 description 1
- 150000004996 alkyl benzenes Chemical class 0.000 description 1
- 150000008051 alkyl sulfates Chemical class 0.000 description 1
- HDTRYLNUVZCQOY-LIZSDCNHSA-N alpha,alpha-trehalose Chemical compound O[C@@H]1[C@@H](O)[C@H](O)[C@@H](CO)O[C@@H]1O[C@@H]1[C@H](O)[C@@H](O)[C@H](O)[C@@H](CO)O1 HDTRYLNUVZCQOY-LIZSDCNHSA-N 0.000 description 1
- NGFMICBWJRZIBI-UHFFFAOYSA-N alpha-salicin Natural products OC1C(O)C(O)C(CO)OC1OC1=CC=CC=C1CO NGFMICBWJRZIBI-UHFFFAOYSA-N 0.000 description 1
- 238000012870 ammonium sulfate precipitation Methods 0.000 description 1
- RNLQIBCLLYYYFJ-UHFFFAOYSA-N amrinone Chemical compound N1C(=O)C(N)=CC(C=2C=CN=CC=2)=C1 RNLQIBCLLYYYFJ-UHFFFAOYSA-N 0.000 description 1
- 229960002105 amrinone Drugs 0.000 description 1
- 239000003674 animal food additive Substances 0.000 description 1
- 125000000129 anionic group Chemical group 0.000 description 1
- 239000003945 anionic surfactant Substances 0.000 description 1
- 230000000844 anti-bacterial effect Effects 0.000 description 1
- 230000000845 anti-microbial effect Effects 0.000 description 1
- 230000000433 anti-nutritional effect Effects 0.000 description 1
- 229940006133 antiglaucoma drug and miotics carbonic anhydrase inhibitors Drugs 0.000 description 1
- 239000003963 antioxidant agent Substances 0.000 description 1
- 230000003078 antioxidant effect Effects 0.000 description 1
- 229960000271 arbutin Drugs 0.000 description 1
- 101150008194 argB gene Proteins 0.000 description 1
- ODKSFYDXXFIFQN-UHFFFAOYSA-N arginine Natural products OC(=O)C(N)CCCNC(N)=N ODKSFYDXXFIFQN-UHFFFAOYSA-N 0.000 description 1
- 108010013835 arginine glutamate Proteins 0.000 description 1
- 108010008355 arginyl-glutamine Proteins 0.000 description 1
- 108010038850 arginyl-isoleucyl-tyrosine Proteins 0.000 description 1
- 108010043240 arginyl-leucyl-glycine Proteins 0.000 description 1
- 108010068380 arginylarginine Proteins 0.000 description 1
- 108010060035 arginylproline Proteins 0.000 description 1
- 210000004507 artificial chromosome Anatomy 0.000 description 1
- 235000009582 asparagine Nutrition 0.000 description 1
- 229960001230 asparagine Drugs 0.000 description 1
- 235000003704 aspartic acid Nutrition 0.000 description 1
- 108010040443 aspartyl-aspartic acid Proteins 0.000 description 1
- 108010047857 aspartylglycine Proteins 0.000 description 1
- 238000003149 assay kit Methods 0.000 description 1
- 239000012752 auxiliary agent Substances 0.000 description 1
- 229940054340 bacillus coagulans Drugs 0.000 description 1
- 239000003899 bactericide agent Substances 0.000 description 1
- 230000009286 beneficial effect Effects 0.000 description 1
- 229940077388 benzenesulfonate Drugs 0.000 description 1
- WQZGKKKJIJFFOK-VFUOTHLCSA-N beta-D-glucose Chemical compound OC[C@H]1O[C@@H](O)[C@H](O)[C@@H](O)[C@@H]1O WQZGKKKJIJFFOK-VFUOTHLCSA-N 0.000 description 1
- 108010051210 beta-Fructofuranosidase Proteins 0.000 description 1
- 108010005774 beta-Galactosidase Proteins 0.000 description 1
- 102000005936 beta-Galactosidase Human genes 0.000 description 1
- 108010047754 beta-Glucosidase Proteins 0.000 description 1
- 102000006995 beta-Glucosidase Human genes 0.000 description 1
- OQFSQFPPLPISGP-UHFFFAOYSA-N beta-carboxyaspartic acid Natural products OC(=O)C(N)C(C(O)=O)C(O)=O OQFSQFPPLPISGP-UHFFFAOYSA-N 0.000 description 1
- 108010079292 betaglycan Proteins 0.000 description 1
- 230000033558 biomineral tissue development Effects 0.000 description 1
- 229960002685 biotin Drugs 0.000 description 1
- 235000020958 biotin Nutrition 0.000 description 1
- 239000011616 biotin Substances 0.000 description 1
- 235000010338 boric acid Nutrition 0.000 description 1
- 229910052791 calcium Inorganic materials 0.000 description 1
- 239000011575 calcium Substances 0.000 description 1
- 238000004364 calculation method Methods 0.000 description 1
- 108010089934 carbohydrase Proteins 0.000 description 1
- 150000001720 carbohydrates Chemical class 0.000 description 1
- 235000014633 carbohydrates Nutrition 0.000 description 1
- 125000004432 carbon atom Chemical group C* 0.000 description 1
- 125000003178 carboxy group Chemical group [H]OC(*)=O 0.000 description 1
- 239000001768 carboxy methyl cellulose Substances 0.000 description 1
- 235000010948 carboxy methyl cellulose Nutrition 0.000 description 1
- 239000008112 carboxymethyl-cellulose Substances 0.000 description 1
- 239000000969 carrier Substances 0.000 description 1
- 239000003054 catalyst Substances 0.000 description 1
- 125000002091 cationic group Chemical group 0.000 description 1
- 230000034303 cell budding Effects 0.000 description 1
- 210000002421 cell wall Anatomy 0.000 description 1
- 238000005119 centrifugation Methods 0.000 description 1
- 235000013339 cereals Nutrition 0.000 description 1
- 239000002962 chemical mutagen Substances 0.000 description 1
- 239000003638 chemical reducing agent Substances 0.000 description 1
- 210000003763 chloroplast Anatomy 0.000 description 1
- 239000013611 chromosomal DNA Substances 0.000 description 1
- 230000000052 comparative effect Effects 0.000 description 1
- 239000008139 complexing agent Substances 0.000 description 1
- 230000021615 conjugation Effects 0.000 description 1
- 238000010924 continuous production Methods 0.000 description 1
- 238000007796 conventional method Methods 0.000 description 1
- 230000027326 copulation Effects 0.000 description 1
- 235000005822 corn Nutrition 0.000 description 1
- 238000005260 corrosion Methods 0.000 description 1
- 238000009295 crossflow filtration Methods 0.000 description 1
- 239000012228 culture supernatant Substances 0.000 description 1
- 210000000805 cytoplasm Anatomy 0.000 description 1
- 230000001086 cytosolic effect Effects 0.000 description 1
- 230000003247 decreasing effect Effects 0.000 description 1
- 238000013461 design Methods 0.000 description 1
- 238000002050 diffraction method Methods 0.000 description 1
- HNPSIPDUKPIQMN-UHFFFAOYSA-N dioxosilane;oxo(oxoalumanyloxy)alumane Chemical compound O=[Si]=O.O=[Al]O[Al]=O HNPSIPDUKPIQMN-UHFFFAOYSA-N 0.000 description 1
- 239000001177 diphosphate Substances 0.000 description 1
- XPPKVPWEQAFLFU-UHFFFAOYSA-J diphosphate(4-) Chemical compound [O-]P([O-])(=O)OP([O-])([O-])=O XPPKVPWEQAFLFU-UHFFFAOYSA-J 0.000 description 1
- 235000011180 diphosphates Nutrition 0.000 description 1
- 108010054813 diprotin B Proteins 0.000 description 1
- 238000004851 dishwashing Methods 0.000 description 1
- GMSCBRSQMRDRCD-UHFFFAOYSA-N dodecyl 2-methylprop-2-enoate Chemical compound CCCCCCCCCCCCOC(=O)C(C)=C GMSCBRSQMRDRCD-UHFFFAOYSA-N 0.000 description 1
- 238000005008 domestic process Methods 0.000 description 1
- 239000003814 drug Substances 0.000 description 1
- 238000009509 drug development Methods 0.000 description 1
- 239000000975 dye Substances 0.000 description 1
- 238000010828 elution Methods 0.000 description 1
- 239000012149 elution buffer Substances 0.000 description 1
- 210000002257 embryonic structure Anatomy 0.000 description 1
- 239000003623 enhancer Substances 0.000 description 1
- 230000007613 environmental effect Effects 0.000 description 1
- XHCADAYNFIFUHF-TVKJYDDYSA-N esculin Chemical compound O[C@@H]1[C@@H](O)[C@H](O)[C@@H](CO)O[C@H]1OC(C(=C1)O)=CC2=C1OC(=O)C=C2 XHCADAYNFIFUHF-TVKJYDDYSA-N 0.000 description 1
- 239000003797 essential amino acid Substances 0.000 description 1
- 210000003527 eukaryotic cell Anatomy 0.000 description 1
- 238000001704 evaporation Methods 0.000 description 1
- 230000008020 evaporation Effects 0.000 description 1
- 230000007717 exclusion Effects 0.000 description 1
- 108010093305 exopolygalacturonase Proteins 0.000 description 1
- 238000001914 filtration Methods 0.000 description 1
- 238000005189 flocculation Methods 0.000 description 1
- 230000016615 flocculation Effects 0.000 description 1
- 235000013312 flour Nutrition 0.000 description 1
- 239000003546 flue gas Substances 0.000 description 1
- 239000012530 fluid Substances 0.000 description 1
- 235000013373 food additive Nutrition 0.000 description 1
- 239000002778 food additive Substances 0.000 description 1
- 239000003205 fragrance Substances 0.000 description 1
- 235000015203 fruit juice Nutrition 0.000 description 1
- 108020001507 fusion proteins Proteins 0.000 description 1
- 102000037865 fusion proteins Human genes 0.000 description 1
- 239000007789 gas Substances 0.000 description 1
- 239000008273 gelatin Substances 0.000 description 1
- 229920000159 gelatin Polymers 0.000 description 1
- 235000019322 gelatine Nutrition 0.000 description 1
- 235000011852 gelatine desserts Nutrition 0.000 description 1
- 238000010359 gene isolation Methods 0.000 description 1
- 238000012268 genome sequencing Methods 0.000 description 1
- 239000011521 glass Substances 0.000 description 1
- 239000008103 glucose Substances 0.000 description 1
- 235000013922 glutamic acid Nutrition 0.000 description 1
- 239000004220 glutamic acid Substances 0.000 description 1
- ZDXPYRJPNDTMRX-UHFFFAOYSA-N glutamine Natural products OC(=O)C(N)CCC(N)=O ZDXPYRJPNDTMRX-UHFFFAOYSA-N 0.000 description 1
- 108010057083 glutamyl-aspartyl-leucine Proteins 0.000 description 1
- 150000002337 glycosamines Chemical class 0.000 description 1
- XBGGUPMXALFZOT-UHFFFAOYSA-N glycyl-L-tyrosine hemihydrate Natural products NCC(=O)NC(C(O)=O)CC1=CC=C(O)C=C1 XBGGUPMXALFZOT-UHFFFAOYSA-N 0.000 description 1
- 108010010096 glycyl-glycyl-tyrosine Proteins 0.000 description 1
- 108010079413 glycyl-prolyl-glutamic acid Proteins 0.000 description 1
- 108010008671 glycyl-tryptophyl-methionine Proteins 0.000 description 1
- 108010087823 glycyltyrosine Proteins 0.000 description 1
- 108010037850 glycylvaline Proteins 0.000 description 1
- PCHJSUWPFVWCPO-UHFFFAOYSA-N gold Chemical compound [Au] PCHJSUWPFVWCPO-UHFFFAOYSA-N 0.000 description 1
- 229910052737 gold Inorganic materials 0.000 description 1
- 239000010931 gold Substances 0.000 description 1
- 230000005484 gravity Effects 0.000 description 1
- 229910001385 heavy metal Inorganic materials 0.000 description 1
- 229940037467 helicobacter pylori Drugs 0.000 description 1
- 108010002430 hemicellulase Proteins 0.000 description 1
- HNDVDQJCIGZPNO-UHFFFAOYSA-N histidine Natural products OC(=O)C(N)CC1=CN=CN1 HNDVDQJCIGZPNO-UHFFFAOYSA-N 0.000 description 1
- 108010040030 histidinoalanine Proteins 0.000 description 1
- 239000003752 hydrotrope Substances 0.000 description 1
- 229910052588 hydroxylapatite Inorganic materials 0.000 description 1
- GFAZHVHNLUBROE-UHFFFAOYSA-N hydroxymethyl propionaldehyde Natural products CCC(=O)CO GFAZHVHNLUBROE-UHFFFAOYSA-N 0.000 description 1
- 108010002685 hygromycin-B kinase Proteins 0.000 description 1
- 150000003949 imides Chemical class 0.000 description 1
- 230000002163 immunogen Effects 0.000 description 1
- 102000018358 immunoglobulin Human genes 0.000 description 1
- 230000001976 improved effect Effects 0.000 description 1
- 238000001727 in vivo Methods 0.000 description 1
- 238000011065 in-situ storage Methods 0.000 description 1
- 230000002779 inactivation Effects 0.000 description 1
- PZOUSPYUWWUPPK-UHFFFAOYSA-N indole Natural products CC1=CC=CC2=C1C=CN2 PZOUSPYUWWUPPK-UHFFFAOYSA-N 0.000 description 1
- RKJUIXBNRJVNHR-UHFFFAOYSA-N indolenine Natural products C1=CC=C2CC=NC2=C1 RKJUIXBNRJVNHR-UHFFFAOYSA-N 0.000 description 1
- 238000011090 industrial biotechnology method and process Methods 0.000 description 1
- 239000003262 industrial enzyme Substances 0.000 description 1
- 208000014674 injury Diseases 0.000 description 1
- 230000003993 interaction Effects 0.000 description 1
- 238000001990 intravenous administration Methods 0.000 description 1
- 239000001573 invertase Substances 0.000 description 1
- 235000011073 invertase Nutrition 0.000 description 1
- 238000005342 ion exchange Methods 0.000 description 1
- 238000001155 isoelectric focusing Methods 0.000 description 1
- 238000002955 isolation Methods 0.000 description 1
- 229960000310 isoleucine Drugs 0.000 description 1
- AGPKZVBTJJNPAG-UHFFFAOYSA-N isoleucine Natural products CCC(C)C(N)C(O)=O AGPKZVBTJJNPAG-UHFFFAOYSA-N 0.000 description 1
- 108010060857 isoleucyl-valyl-tyrosine Proteins 0.000 description 1
- BPHPUYQFMNQIOC-NXRLNHOXSA-N isopropyl beta-D-thiogalactopyranoside Chemical compound CC(C)S[C@@H]1O[C@H](CO)[C@H](O)[C@H](O)[C@H]1O BPHPUYQFMNQIOC-NXRLNHOXSA-N 0.000 description 1
- 238000002372 labelling Methods 0.000 description 1
- 235000021374 legumes Nutrition 0.000 description 1
- 108010044311 leucyl-glycyl-glycine Proteins 0.000 description 1
- 108010044056 leucyl-phenylalanine Proteins 0.000 description 1
- 108010012058 leucyltyrosine Proteins 0.000 description 1
- 238000007834 ligase chain reaction Methods 0.000 description 1
- 230000002479 lignolytic effect Effects 0.000 description 1
- 239000012160 loading buffer Substances 0.000 description 1
- 238000011068 loading method Methods 0.000 description 1
- 101150039489 lysZ gene Proteins 0.000 description 1
- 108010044348 lysyl-glutamyl-aspartic acid Proteins 0.000 description 1
- VZCYOOQTPOCHFL-UPHRSURJSA-N maleic acid Chemical compound OC(=O)\C=C/C(O)=O VZCYOOQTPOCHFL-UPHRSURJSA-N 0.000 description 1
- 239000011976 maleic acid Substances 0.000 description 1
- 235000010355 mannitol Nutrition 0.000 description 1
- 238000013507 mapping Methods 0.000 description 1
- 239000012528 membrane Substances 0.000 description 1
- 108010003855 mesentericopeptidase Proteins 0.000 description 1
- 108020004999 messenger RNA Proteins 0.000 description 1
- 230000002503 metabolic effect Effects 0.000 description 1
- 229930182817 methionine Natural products 0.000 description 1
- 108010056582 methionylglutamic acid Proteins 0.000 description 1
- 108010034507 methionyltryptophan Proteins 0.000 description 1
- 238000000520 microinjection Methods 0.000 description 1
- 210000003470 mitochondria Anatomy 0.000 description 1
- 238000002703 mutagenesis Methods 0.000 description 1
- 231100000350 mutagenesis Toxicity 0.000 description 1
- 230000007935 neutral effect Effects 0.000 description 1
- 101150095344 niaD gene Proteins 0.000 description 1
- 150000002825 nitriles Chemical class 0.000 description 1
- 229920001220 nitrocellulos Polymers 0.000 description 1
- 229910052757 nitrogen Inorganic materials 0.000 description 1
- 239000002736 nonionic surfactant Substances 0.000 description 1
- SNQQPOLDUKLAAF-UHFFFAOYSA-N nonylphenol Chemical class CCCCCCCCCC1=CC=CC=C1O SNQQPOLDUKLAAF-UHFFFAOYSA-N 0.000 description 1
- 230000031787 nutrient reservoir activity Effects 0.000 description 1
- 235000016709 nutrition Nutrition 0.000 description 1
- 229920002113 octoxynol Polymers 0.000 description 1
- 235000019198 oils Nutrition 0.000 description 1
- 210000000056 organ Anatomy 0.000 description 1
- 239000003960 organic solvent Substances 0.000 description 1
- KYOBSHFOBAOFBF-XVFCMESISA-N orotidine 5'-phosphate Chemical compound O[C@@H]1[C@H](O)[C@@H](COP(O)(O)=O)O[C@H]1N1C(=O)NC(=O)C=C1C(O)=O KYOBSHFOBAOFBF-XVFCMESISA-N 0.000 description 1
- 230000002018 overexpression Effects 0.000 description 1
- 230000003647 oxidation Effects 0.000 description 1
- 238000007254 oxidation reaction Methods 0.000 description 1
- BJRNKVDFDLYUGJ-UHFFFAOYSA-N p-hydroxyphenyl beta-D-alloside Natural products OC1C(O)C(O)C(CO)OC1OC1=CC=C(O)C=C1 BJRNKVDFDLYUGJ-UHFFFAOYSA-N 0.000 description 1
- 235000019629 palatability Nutrition 0.000 description 1
- 239000006072 paste Substances 0.000 description 1
- 230000037361 pathway Effects 0.000 description 1
- 230000002351 pectolytic effect Effects 0.000 description 1
- 239000008188 pellet Substances 0.000 description 1
- XYJRXVWERLGGKC-UHFFFAOYSA-D pentacalcium;hydroxide;triphosphate Chemical compound [OH-].[Ca+2].[Ca+2].[Ca+2].[Ca+2].[Ca+2].[O-]P([O-])([O-])=O.[O-]P([O-])([O-])=O.[O-]P([O-])([O-])=O XYJRXVWERLGGKC-UHFFFAOYSA-D 0.000 description 1
- 239000002304 perfume Substances 0.000 description 1
- 210000002824 peroxisome Anatomy 0.000 description 1
- 150000004965 peroxy acids Chemical class 0.000 description 1
- UHGWBEXBBNLGCZ-UHFFFAOYSA-N phenyl nonanoate Chemical compound CCCCCCCCC(=O)OC1=CC=CC=C1 UHGWBEXBBNLGCZ-UHFFFAOYSA-N 0.000 description 1
- COLNVLDHVKWLRT-UHFFFAOYSA-N phenylalanine Natural products OC(=O)C(N)CC1=CC=CC=C1 COLNVLDHVKWLRT-UHFFFAOYSA-N 0.000 description 1
- 235000008729 phenylalanine Nutrition 0.000 description 1
- 229960005190 phenylalanine Drugs 0.000 description 1
- 108010064486 phenylalanyl-leucyl-valine Proteins 0.000 description 1
- HXITXNWTGFUOAU-UHFFFAOYSA-N phenylboronic acid Chemical class OB(O)C1=CC=CC=C1 HXITXNWTGFUOAU-UHFFFAOYSA-N 0.000 description 1
- 239000008363 phosphate buffer Substances 0.000 description 1
- UEZVMMHDMIWARA-UHFFFAOYSA-M phosphonate Chemical compound [O-]P(=O)=O UEZVMMHDMIWARA-UHFFFAOYSA-M 0.000 description 1
- 238000005222 photoaffinity labeling Methods 0.000 description 1
- 229940085127 phytase Drugs 0.000 description 1
- 229920002006 poly(N-vinylimidazole) polymer Polymers 0.000 description 1
- 229920000196 poly(lauryl methacrylate) Polymers 0.000 description 1
- 229920002401 polyacrylamide Polymers 0.000 description 1
- 238000002264 polyacrylamide gel electrophoresis Methods 0.000 description 1
- 229920000058 polyacrylate Polymers 0.000 description 1
- 229920005646 polycarboxylate Polymers 0.000 description 1
- 229920002704 polyhistidine Polymers 0.000 description 1
- 239000000256 polyoxyethylene sorbitan monolaurate Substances 0.000 description 1
- 235000010486 polyoxyethylene sorbitan monolaurate Nutrition 0.000 description 1
- 239000013641 positive control Substances 0.000 description 1
- ZNNZYHKDIALBAK-UHFFFAOYSA-M potassium thiocyanate Chemical compound [K+].[S-]C#N ZNNZYHKDIALBAK-UHFFFAOYSA-M 0.000 description 1
- 235000012015 potatoes Nutrition 0.000 description 1
- 238000011533 pre-incubation Methods 0.000 description 1
- 239000002244 precipitate Substances 0.000 description 1
- 210000001236 prokaryotic cell Anatomy 0.000 description 1
- 108010031719 prolyl-serine Proteins 0.000 description 1
- 108010053725 prolylvaline Proteins 0.000 description 1
- 230000001737 promoting effect Effects 0.000 description 1
- 230000001902 propagating effect Effects 0.000 description 1
- 230000004952 protein activity Effects 0.000 description 1
- 230000012846 protein folding Effects 0.000 description 1
- 230000004853 protein function Effects 0.000 description 1
- 238000001742 protein purification Methods 0.000 description 1
- 239000012460 protein solution Substances 0.000 description 1
- 230000012743 protein tagging Effects 0.000 description 1
- 235000019423 pullulan Nutrition 0.000 description 1
- 235000021251 pulses Nutrition 0.000 description 1
- 239000010453 quartz Substances 0.000 description 1
- 238000002708 random mutagenesis Methods 0.000 description 1
- 108020003175 receptors Proteins 0.000 description 1
- 238000010188 recombinant method Methods 0.000 description 1
- 230000006798 recombination Effects 0.000 description 1
- 238000005215 recombination Methods 0.000 description 1
- 230000008929 regeneration Effects 0.000 description 1
- 238000011069 regeneration method Methods 0.000 description 1
- 238000005067 remediation Methods 0.000 description 1
- 230000003362 replicative effect Effects 0.000 description 1
- 230000000241 respiratory effect Effects 0.000 description 1
- 230000029058 respiratory gaseous exchange Effects 0.000 description 1
- 108091008146 restriction endonucleases Proteins 0.000 description 1
- 230000000717 retained effect Effects 0.000 description 1
- 238000004007 reversed phase HPLC Methods 0.000 description 1
- 239000011435 rock Substances 0.000 description 1
- 238000005096 rolling process Methods 0.000 description 1
- NGFMICBWJRZIBI-UJPOAAIJSA-N salicin Chemical compound O[C@@H]1[C@@H](O)[C@H](O)[C@@H](CO)O[C@H]1OC1=CC=CC=C1CO NGFMICBWJRZIBI-UJPOAAIJSA-N 0.000 description 1
- 229940120668 salicin Drugs 0.000 description 1
- 235000019515 salmon Nutrition 0.000 description 1
- 150000003839 salts Chemical class 0.000 description 1
- 238000002864 sequence alignment Methods 0.000 description 1
- VYPSYNLAJGMNEJ-UHFFFAOYSA-N silicon dioxide Inorganic materials O=[Si]=O VYPSYNLAJGMNEJ-UHFFFAOYSA-N 0.000 description 1
- RYMZZMVNJRMUDD-HGQWONQESA-N simvastatin Chemical compound C([C@H]1[C@@H](C)C=CC2=C[C@H](C)C[C@@H]([C@H]12)OC(=O)C(C)(C)CC)C[C@@H]1C[C@@H](O)CC(=O)O1 RYMZZMVNJRMUDD-HGQWONQESA-N 0.000 description 1
- 235000020183 skimmed milk Nutrition 0.000 description 1
- 239000010802 sludge Substances 0.000 description 1
- 239000000344 soap Substances 0.000 description 1
- 239000001632 sodium acetate Substances 0.000 description 1
- 235000017281 sodium acetate Nutrition 0.000 description 1
- 229910000030 sodium bicarbonate Inorganic materials 0.000 description 1
- 235000017557 sodium bicarbonate Nutrition 0.000 description 1
- 229910000029 sodium carbonate Inorganic materials 0.000 description 1
- FQENQNTWSFEDLI-UHFFFAOYSA-J sodium diphosphate Chemical compound [Na+].[Na+].[Na+].[Na+].[O-]P([O-])(=O)OP([O-])([O-])=O FQENQNTWSFEDLI-UHFFFAOYSA-J 0.000 description 1
- 238000002415 sodium dodecyl sulfate polyacrylamide gel electrophoresis Methods 0.000 description 1
- 239000001488 sodium phosphate Substances 0.000 description 1
- 229910000162 sodium phosphate Inorganic materials 0.000 description 1
- 229940048086 sodium pyrophosphate Drugs 0.000 description 1
- 239000002689 soil Substances 0.000 description 1
- 239000008247 solid mixture Substances 0.000 description 1
- 238000010563 solid-state fermentation Methods 0.000 description 1
- 239000002904 solvent Substances 0.000 description 1
- 238000002798 spectrophotometry method Methods 0.000 description 1
- 238000001694 spray drying Methods 0.000 description 1
- 238000012289 standard assay Methods 0.000 description 1
- 239000007858 starting material Substances 0.000 description 1
- 239000012536 storage buffer Substances 0.000 description 1
- 239000001384 succinic acid Substances 0.000 description 1
- 239000005720 sucrose Substances 0.000 description 1
- 150000003456 sulfonamides Chemical class 0.000 description 1
- 150000003457 sulfones Chemical class 0.000 description 1
- 239000000375 suspending agent Substances 0.000 description 1
- 239000000725 suspension Substances 0.000 description 1
- 239000003826 tablet Substances 0.000 description 1
- 108010075550 termamyl Proteins 0.000 description 1
- 229960002180 tetracycline Drugs 0.000 description 1
- 229930101283 tetracycline Natural products 0.000 description 1
- 235000019364 tetracycline Nutrition 0.000 description 1
- 150000003522 tetracyclines Chemical class 0.000 description 1
- 235000019818 tetrasodium diphosphate Nutrition 0.000 description 1
- 239000001577 tetrasodium phosphonato phosphate Substances 0.000 description 1
- 108010033670 threonyl-aspartyl-tyrosine Proteins 0.000 description 1
- 231100000331 toxic Toxicity 0.000 description 1
- 230000002588 toxic effect Effects 0.000 description 1
- VZCYOOQTPOCHFL-UHFFFAOYSA-N trans-butenedioic acid Natural products OC(=O)C=CC(O)=O VZCYOOQTPOCHFL-UHFFFAOYSA-N 0.000 description 1
- 238000012546 transfer Methods 0.000 description 1
- 238000011426 transformation method Methods 0.000 description 1
- 102000003601 transglutaminase Human genes 0.000 description 1
- 230000014616 translation Effects 0.000 description 1
- 230000032258 transport Effects 0.000 description 1
- ILJSQTXMGCGYMG-UHFFFAOYSA-N triacetic acid Chemical compound CC(=O)CC(=O)CC(O)=O ILJSQTXMGCGYMG-UHFFFAOYSA-N 0.000 description 1
- 150000003626 triacylglycerols Chemical class 0.000 description 1
- 239000001226 triphosphate Substances 0.000 description 1
- 235000011178 triphosphate Nutrition 0.000 description 1
- UNXRWKVEANCORM-UHFFFAOYSA-N triphosphoric acid Chemical compound OP(O)(=O)OP(O)(=O)OP(O)(O)=O UNXRWKVEANCORM-UHFFFAOYSA-N 0.000 description 1
- RYFMWSXOAZQYPI-UHFFFAOYSA-K trisodium phosphate Chemical compound [Na+].[Na+].[Na+].[O-]P([O-])([O-])=O RYFMWSXOAZQYPI-UHFFFAOYSA-K 0.000 description 1
- 101150016309 trpC gene Proteins 0.000 description 1
- 239000012588 trypsin Substances 0.000 description 1
- 108010080629 tryptophan-leucine Proteins 0.000 description 1
- 108010029384 tryptophyl-histidine Proteins 0.000 description 1
- 108010045269 tryptophyltryptophan Proteins 0.000 description 1
- WFKWXMTUELFFGS-UHFFFAOYSA-N tungsten Chemical compound [W] WFKWXMTUELFFGS-UHFFFAOYSA-N 0.000 description 1
- 229910052721 tungsten Inorganic materials 0.000 description 1
- 239000010937 tungsten Substances 0.000 description 1
- OUYCCCASQSFEME-UHFFFAOYSA-N tyrosine Natural products OC(=O)C(N)CC1=CC=C(O)C=C1 OUYCCCASQSFEME-UHFFFAOYSA-N 0.000 description 1
- 108010051110 tyrosyl-lysine Proteins 0.000 description 1
- 238000005199 ultracentrifugation Methods 0.000 description 1
- 238000009281 ultraviolet germicidal irradiation Methods 0.000 description 1
- 238000011144 upstream manufacturing Methods 0.000 description 1
- 210000003934 vacuole Anatomy 0.000 description 1
- 239000004474 valine Substances 0.000 description 1
- IBIDRSSEHFLGSD-UHFFFAOYSA-N valinyl-arginine Natural products CC(C)C(N)C(=O)NC(C(O)=O)CCCN=C(N)N IBIDRSSEHFLGSD-UHFFFAOYSA-N 0.000 description 1
- 108010036320 valylleucine Proteins 0.000 description 1
- 108010073969 valyllysine Proteins 0.000 description 1
- 108010009962 valyltyrosine Proteins 0.000 description 1
- 235000015112 vegetable and seed oil Nutrition 0.000 description 1
- 235000013311 vegetables Nutrition 0.000 description 1
- 238000012795 verification Methods 0.000 description 1
- 230000003612 virological effect Effects 0.000 description 1
- 238000005406 washing Methods 0.000 description 1
- 238000012070 whole genome sequencing analysis Methods 0.000 description 1
- 210000005253 yeast cell Anatomy 0.000 description 1
- 239000011701 zinc Substances 0.000 description 1
- NWONKYPBYAMBJT-UHFFFAOYSA-L zinc sulfate Chemical compound [Zn+2].[O-]S([O-])(=O)=O NWONKYPBYAMBJT-UHFFFAOYSA-L 0.000 description 1
- 229960001763 zinc sulfate Drugs 0.000 description 1
- 229910000368 zinc sulfate Inorganic materials 0.000 description 1
- 239000004711 α-olefin Substances 0.000 description 1
Classifications
-
- C—CHEMISTRY; METALLURGY
- C12—BIOCHEMISTRY; BEER; SPIRITS; WINE; VINEGAR; MICROBIOLOGY; ENZYMOLOGY; MUTATION OR GENETIC ENGINEERING
- C12N—MICROORGANISMS OR ENZYMES; COMPOSITIONS THEREOF; PROPAGATING, PRESERVING, OR MAINTAINING MICROORGANISMS; MUTATION OR GENETIC ENGINEERING; CULTURE MEDIA
- C12N9/00—Enzymes; Proenzymes; Compositions thereof; Processes for preparing, activating, inhibiting, separating or purifying enzymes
- C12N9/14—Hydrolases (3)
- C12N9/48—Hydrolases (3) acting on peptide bonds (3.4)
- C12N9/50—Proteinases, e.g. Endopeptidases (3.4.21-3.4.25)
- C12N9/52—Proteinases, e.g. Endopeptidases (3.4.21-3.4.25) derived from bacteria or Archaea
- C12N9/54—Proteinases, e.g. Endopeptidases (3.4.21-3.4.25) derived from bacteria or Archaea bacteria being Bacillus
-
- C—CHEMISTRY; METALLURGY
- C12—BIOCHEMISTRY; BEER; SPIRITS; WINE; VINEGAR; MICROBIOLOGY; ENZYMOLOGY; MUTATION OR GENETIC ENGINEERING
- C12N—MICROORGANISMS OR ENZYMES; COMPOSITIONS THEREOF; PROPAGATING, PRESERVING, OR MAINTAINING MICROORGANISMS; MUTATION OR GENETIC ENGINEERING; CULTURE MEDIA
- C12N9/00—Enzymes; Proenzymes; Compositions thereof; Processes for preparing, activating, inhibiting, separating or purifying enzymes
- C12N9/14—Hydrolases (3)
- C12N9/24—Hydrolases (3) acting on glycosyl compounds (3.2)
- C12N9/2402—Hydrolases (3) acting on glycosyl compounds (3.2) hydrolysing O- and S- glycosyl compounds (3.2.1)
- C12N9/2468—Hydrolases (3) acting on glycosyl compounds (3.2) hydrolysing O- and S- glycosyl compounds (3.2.1) acting on beta-galactose-glycoside bonds, e.g. carrageenases (3.2.1.83; 3.2.1.157); beta-agarase (3.2.1.81)
-
- C—CHEMISTRY; METALLURGY
- C12—BIOCHEMISTRY; BEER; SPIRITS; WINE; VINEGAR; MICROBIOLOGY; ENZYMOLOGY; MUTATION OR GENETIC ENGINEERING
- C12N—MICROORGANISMS OR ENZYMES; COMPOSITIONS THEREOF; PROPAGATING, PRESERVING, OR MAINTAINING MICROORGANISMS; MUTATION OR GENETIC ENGINEERING; CULTURE MEDIA
- C12N9/00—Enzymes; Proenzymes; Compositions thereof; Processes for preparing, activating, inhibiting, separating or purifying enzymes
- C12N9/14—Hydrolases (3)
- C12N9/24—Hydrolases (3) acting on glycosyl compounds (3.2)
- C12N9/2402—Hydrolases (3) acting on glycosyl compounds (3.2) hydrolysing O- and S- glycosyl compounds (3.2.1)
- C12N9/2477—Hemicellulases not provided in a preceding group
- C12N9/248—Xylanases
-
- C—CHEMISTRY; METALLURGY
- C12—BIOCHEMISTRY; BEER; SPIRITS; WINE; VINEGAR; MICROBIOLOGY; ENZYMOLOGY; MUTATION OR GENETIC ENGINEERING
- C12N—MICROORGANISMS OR ENZYMES; COMPOSITIONS THEREOF; PROPAGATING, PRESERVING, OR MAINTAINING MICROORGANISMS; MUTATION OR GENETIC ENGINEERING; CULTURE MEDIA
- C12N9/00—Enzymes; Proenzymes; Compositions thereof; Processes for preparing, activating, inhibiting, separating or purifying enzymes
- C12N9/88—Lyases (4.)
-
- C—CHEMISTRY; METALLURGY
- C12—BIOCHEMISTRY; BEER; SPIRITS; WINE; VINEGAR; MICROBIOLOGY; ENZYMOLOGY; MUTATION OR GENETIC ENGINEERING
- C12Y—ENZYMES
- C12Y302/00—Hydrolases acting on glycosyl compounds, i.e. glycosylases (3.2)
- C12Y302/01—Glycosidases, i.e. enzymes hydrolysing O- and S-glycosyl compounds (3.2.1)
- C12Y302/01008—Endo-1,4-beta-xylanase (3.2.1.8)
-
- C—CHEMISTRY; METALLURGY
- C12—BIOCHEMISTRY; BEER; SPIRITS; WINE; VINEGAR; MICROBIOLOGY; ENZYMOLOGY; MUTATION OR GENETIC ENGINEERING
- C12Y—ENZYMES
- C12Y305/00—Hydrolases acting on carbon-nitrogen bonds, other than peptide bonds (3.5)
- C12Y305/02—Hydrolases acting on carbon-nitrogen bonds, other than peptide bonds (3.5) in cyclic amides (3.5.2)
- C12Y305/02006—Beta-lactamase (3.5.2.6)
-
- C—CHEMISTRY; METALLURGY
- C12—BIOCHEMISTRY; BEER; SPIRITS; WINE; VINEGAR; MICROBIOLOGY; ENZYMOLOGY; MUTATION OR GENETIC ENGINEERING
- C12Y—ENZYMES
- C12Y402/00—Carbon-oxygen lyases (4.2)
- C12Y402/01—Hydro-lyases (4.2.1)
- C12Y402/01001—Carbonate dehydratase (4.2.1.1), i.e. carbonic anhydrase
Landscapes
- Chemical & Material Sciences (AREA)
- Life Sciences & Earth Sciences (AREA)
- Health & Medical Sciences (AREA)
- Organic Chemistry (AREA)
- Genetics & Genomics (AREA)
- Engineering & Computer Science (AREA)
- Bioinformatics & Cheminformatics (AREA)
- Zoology (AREA)
- Wood Science & Technology (AREA)
- General Health & Medical Sciences (AREA)
- Biochemistry (AREA)
- General Engineering & Computer Science (AREA)
- Microbiology (AREA)
- Biotechnology (AREA)
- Biomedical Technology (AREA)
- Molecular Biology (AREA)
- Medicinal Chemistry (AREA)
- Micro-Organisms Or Cultivation Processes Thereof (AREA)
- Enzymes And Modification Thereof (AREA)
- Peptides Or Proteins (AREA)
- Preparation Of Compounds By Using Micro-Organisms (AREA)
Abstract
POLIPEPTìDEOS FUNCIONAIS, POLIPEPTìDEO MADURO FUNCIONAL ISOLADO, ENZIMA, COMPOSIçãO, MéTODO PARA PREPARAR UMA COMPOSIçãO, CONSTRUTO DE áCIDO NUCLEICO, VETOR DE EXPRESSãO RECOMBINANTE, CéLULA HOSPEDEIRA RECOMBINANTE, MéTODO PARA PRODUZIR O POLIPEPTìDEO, MEIO DE ARMAZENAGEM, E, PROCESSO. Uma cepa nova de Bacillus sp. P203 (Bacillus Plakortiensis) é descrita. é descrito polipeptídeo funcional maduro isolado que é obtenível da cepa de bactéria Bacillus sp. P203 depositada sob o número de acesso DSM 17419.
Description
"POLIPEPTÍDEOS FUNCIONAIS, POLIPEPTÍDEO MADURO FUNCIONAL ISOLADO, ENZIMA, COMPOSIÇÃO, MÉTODO PARA PREPARAR UMA COMPOSIÇÃO, CONSTRUTO DE ÁCIDO NUCLEICO, VETOR DE EXPRESSÃO RECOMBINANTE, CÉLULA HOSPEDEIRA RECOMBINANTE, MÉTODO PARA PRODUZIR O POLIPEPTÍDEO, MEIO DE ARMAZENAGEM, E, PROCESSO"
CAMPO DA INVENÇÃO
A presente invenção refere-se aos polipeptídeos funcionais codificados pelos polinucleotídeos compreendidos no genoma de cepas de uma nova espécie de Bacillus, Bacillus plankortiensis. A cepa de referência desta espécie é Bacillus sp. P203 depositada sob DSM 17419. A invenção refere-se em adição aos polinucleotídeos e aos construtos de tais polinucleotídeos codificadores de tais polipeptídeos ou facilita sua expressão bem como ao método para preparar o polipeptídeo. Ainda mais a invenção refere-se às composições compreendendo os polipeptídeos e os polinucleotídeos e aos usos do polipeptídeo. Ainda mais a invenção refere-se a uma bactéria Bacillus sp. P203 conforme depositada sob o número de
acesso DSM 17419. FUNDAMENTOS DA INVENÇÃO
Cepas alcalifílicas de Bacillus estão em foco na biotecnologia industrial. Cepas alcalifílicas e especialmente enzimas daquelas espécies possuem potencial grande em aplicações bioquímicas onde atividade enzimática (ou até mesmo atividade máxima) em valores altos de pH é requerida para processos biotécnicos (Horikoshi: "Alkaliphiles: Some Applications of Their Products for Biotechnology", Microbiology and Molecular Biology Reviews, Vol. 63, No. 4, 1999). Exemplos de cepas alcalifílicas de Bacillus como fonte de novos catalisadores são B. clausii, B. pseudofirmus, B. clarkii, B. gibsonii. Em busca de novas enzimas também é conhecida a triagem de tais novas enzimas pela sujeição das candidatas aos ensaios enzimáticos específicos. Esta abordagem é limitada à disponibilidade dos ensaios enzimáticos e não permite a identificação de enzimas funcionais ou de polipeptídeos funcionais para os quais a atividade ainda é desconhecida.
Ademais, seqüenciamento de genoma inteiro é um método conhecido para obter a informação sobre todos os genes de um dado microorganismo e.g. como descrito em Fleischmann et ai; " Whole genome sequences and assembly of Haemophilus influenzae Rd"; Nature 269: 496- .512; (1995).
As enzimas para uso industrial são em sua maioria enzimas que são secretadas para o meio por um microorganismo. Contudo, apenas uns poucos percentuais de um genoma de microorganismo codifica proteínas secretadas. Por exemplo apenas aproximadamente 4% do genoma de Bacillus subtilis ou deus parentes mais próximos codificam proteínas secretadas (Van Dijl et ai: "Protein transport pathways in Bacillus subtilis: a genome-based road map"; em aBacillus subtilis and its closest relatives - From genes to cells"; p.337-355; A. L. Sonenshein (ed.); ASM Press 2002).
Uma desvantagem do seqüenciamento do genoma é que a vasta maioria das seqüências obtidas codifica proteínas não secretadas.
Uma desvantagem adicional do seqüenciamento genômico particular a eucariotos tais como fungos é que o tamanho do genoma é muitas vezes maior do que um genoma bacteriano tornando a descoberta de gene por este método muito custosa e consumidora de tempo.
O seqüenciamento randômico de cDNAs (etiquetas de seqüência expressada ou ESTs) é uma outra abordagem que permite a descoberta de proteínas secretadas. Em geral, abordagens de EST sofrem de duas desvantagens com relação à identificação de proteína secretada: 1) dependência das condições de indução usadas para a biblioteca de cDNA seqüenciada, muito poucos, tipicamente entre 0,5% e 15% ou até mesmo 1% e 5% dos cDNAs codificam proteínas secretadas, 2) os clones provêm todos de uma coleção de cDNAs derivada de mRNAs que estão presentes no organismo em proporção ao nível de indução de cada gene particular.
Também é conhecida a captação de sinal que é um método para identificar genes incluindo nucleotídeos codificadores de um peptídeo de sinal usando uma fusão de tradução em um gene repórter extracelular faltante de seu próprio sinal (WO 01/77315).
SUMÁRIO DA INVENÇÃO
Os presentes inventores têm encontrado uma cepa de uma nova espécie de Bacillus5 Bacillus plankortiensis. A cepa de referência/tipo desta espécie é Bacillus sp. P203 depositada sob DSM 17419. A cepa desenvolve em pH (7-11) e em temperaturas baixas (4-3 O0C). Esta cepa é interessante porque a distância filogenética entre as cepas publicamente conhecidas e a cepa DSM17419 é significativa e porque as condições de desenvolvimento são similares às condições para várias aplicações para enzimas industriais.
O genoma de um microorganismo contém milhares de genes diferentes; alguns codificando polipeptídeos alguns codificando RNAs. Apenas um número limitado dos genes no genoma de um microorganismo codificam polipeptídeos funcionais que são secretados pelo microorganismo para o meio circundante servindo com um propósito externo para o microorganismo. Tais polipeptídeos são interessantes para a indústria do ponto de vista de que tais polipeptídeos podem ser produzidos em quantidades consideráveis em processos contínuos sem destruir as células produtoras dos polipeptídeos.
Um objetivo da presente invenção é identificar e proporcionar polipeptídeos secretados da cepa Bacillus sp. P203 depositada sob o número de acesso DSM 17419 que possuem propósito funcional para a cepa Bacillus sp. P203 porque tais polipeptídeos podem não apenas ser usados para propósitos industriais mas também podem ser produzidos em quantidades e processos industrialmente relevantes.
Em um primeiro aspecto a invenção proporcionam polipeptídeos funcionais codificados por polinucleotídeos compreendidos no genoma de cepas de Bacillus species Bacillus plankortiensis depositada sob o número de acesso DSM 17419, e um polipeptídeo funcional maduro isolado que é pelo menos 70 % idêntico ao e exibe a mesma função de um polipeptídeo secretado correspondente obtenível da cepa de bactéria Bacillus sp. P203.
Em . outros aspectos a invenção proporciona um polinucleotídeo codificador do polipeptídeo da invenção; um construto de nucleotídeos compreendendo o polinucleotídeo codificador do polipeptídeo da invenção, operacionalmente ligado em uma ou mais seqüências de controle que dirigem a produção do polipeptídeo em uma célula hospedeira; um vetor de expressão recombinante compreendendo o construto de nucleotídeos da invenção e uma célula hospedeira recombinante compreendendo o construto de nucleotídeos da invenção.
Em ainda outros aspectos a invenção proporciona um método de preparar um polipeptídeo da invenção compreendendo:
(a) cultivar uma cepa compreendendo uma seqüência de nucleotídeos codificadora de um polipeptídeo da invenção cuja cepa é capaz de expressar e de secretar o polipeptídeo e
(b) recuperar o polipeptídeo.
Em um outro aspecto a invenção proporciona uma composição compreendendo um polipeptídeo da invenção e um método para preparar uma tal composição compreendendo misturar o polipeptídeo da invenção com um excipiente.
Em um outro aspecto a invenção proporciona uma composição compreendendo um polinucleotídeo da invenção e um método para preparar uma tal composição compreendendo misturar o polinucleotídeo da invenção com um excipiente.
Em outros aspectos a invenção proporciona o uso do polipeptídeo da invenção ou de uma composição compreendendo o citado poiipeptídeo em várias aplicações.
Em um aspecto final a invenção proporciona um meio de armazenagem eletrônica compreendendo informação da seqüência de aminoácidos de polipeptídeos da invenção ou das seqüências de nucleotídeos do polinucleotídeo da invenção.
LISTAGEM DE SEQÜÊNCIAS
o presente pedido contém informação na forma de uma listagem de seqüências, que está anexada ao pedido e também submetida a um portador de dados acompanhando este pedido. Os conteúdos do portador de dados são aqui totalmente incorporados como referência.
SEQ ID NO: 1 codifica serina protease compreendida em SEQ ID NO: 2; SEQ ID NO: 3 codifica a anidrase carbônica compreendida em SEQ ID NO: 4; SEQ ID NO: 5 codifica a anidrase carbônica compreendida em SEQ ID NO:6; SEQ ID NO: 7 codifica xilanase compreendida em SEQ ID NO: 8; SEQ ID NO: 9 codifica ramnogalacturonana liase compreendida em SEQ ID NO: 10; SEQ ID NO: 11 codifica galactanase compreendida em SEQID NO: 12.
BREVE DESCRIÇÃO DOS DESENHOS
Figura 1 mostra as características de desenvolvimento de Bacillus sp. P203.
Figura 2 mostra a estabilidade de anidrase carbônica de Bacillus sp. P203.
Figura 3 mostra a inibição de anidrase carbônica com acetazolamida.
Figura 4 mostra a inibição de anidrase carbônica com íons de metal, azida e outros reagentes. DESCRIÇÃO DETALHADA DA INVENÇÃO
Definições *
O termo "identidade" como aqui usado, é para ser entendido como a homologia entre duas seqüências de aminoácidos ou entre duas seqüências de nucleotídeos. Para os propósitos da presente invenção, o grau de identidade entre as duas seqüências de aminoácidos foi determinado pelo uso de AlignX no programa de Vector NTI ver. 7.1 (Informax inc., 7600 Wisconsin Avenue5 Suite #1100, Bethesda, MD 20814, USA). Alinhamento, de aminoácidos foi criado usando o algoritmo Clustal W (Nucleic Acid
Research, 22 (22): 4673-4680, 1994). Os seguintes parâmetros adicionais são usados: penalidade de abertura de lacuna de 10, penalidade de extensão de lacuna de 0,05, faixa de penalidade de separação de lacuna de 8. Parâmetros de alinhamentos pareados foram Ktuple - 1, penalidade de lacuna = 3, penalidade de abertura de comprimento de lacuna = 10, penalidade de comprimento de lacuna = 0,1, tamanho de janela = 5 e diagonais = 5. O grau de identidade entre duas seqüências de nucleotídeos é determinado usando o mesmos algoritmo e pacote de programas de como descritos acima com òs seguintes ajustes: penalidade de lacuna de 10, e penalidade de comprimento de lacuna de 10. Parâmetros de alinhamento pareado são Ktuple=3, penalidade de lacuna =3 e janelas =20.
O termo "polipeptídeo funcional" como aqui usado no contexto da presente invenção significa um polipeptídeo que pode ser expressado e secretado por uma célula e que constitui uma unidade operacional capaz de operar de acordo com a função para qual ele é planejado cumprir pela célula. Opcionalmente, cofatores podem ser requeridos para o polipeptídeo para adotar a função intencional. Um exemplo de polipeptídeos funcionais é polipeptídeos cataliticamente ativos ou enzimas que ajudam a célula catalisando reações no ambiente circundando a célula. Outro exemplo poderia ser polipeptídeos que servem como substância de sinal. Exemplos adicionais são polipeptídeos que funcionam como sensores (receptores) para parâmetros ambientais (compostos químicos no ambiente circundando a célula) ou polipeptídeos, que são ativos contra outros organismos ((poli)peptídeos antimicrobianos) ou polipeptídeos, que contribuem para a
integridade estrutural da célula.
O termo "região madura" como aqui usado sobre a porção de uma seqüência de aminoácidos ou de um polipeptídeo significa a porção ou o domínio ou a seção das seqüências de aminoácidos ou do polipeptídeo que é o
polipeptídeo funcional maduro.
O termo "região de seqüência de nucleotídeos codificadora
de um polipeptídeo maduro" como aqui usado significa a região de uma seqüência de nucleotídeos contando do triplete codificador do primeiro aminoácido de um polipeptídeo maduro ao último triplete codificador do último aminoácido de um polipeptídeo maduro.
O termo " polipeptídeo secretado" como aqui usado é para ser entendido como um polipeptídeo que após expressão em uma célula quer é transportado para e liberado para o meio extracelular circundante quer é associado/embebido na membrana celular de modo que pelo menos uma parte do polipeptídeo é exposta ao meio extracelular circundante.
Polipeptídeos da invenção
A presente invenção refere-se aos polipeptídeos similares
àqueles polipeptídeos secretados obteníveis da cepa Bacillus sp. P203 depositada sob o número de acesso DSM 17419. Em particular a invenção proporciona um polipeptídeo funcional maduro isolado ique é pelo menos70%, preferivelmente80% ou mais, tal como90%,95%,96%, 97%, 98% ou99% idêntico ao e exibe a mesma função de um polipeptídeo secretado correspondente obtenível da cepa Bacillus sp. P203 depositada sob o número
de acesso DSM 17419.
Polipeptídeos da invenção são, em particular, secretados pela cepa Bacillus sp. P203 depositada sob o número de acesso DSM 17419 com o propósito de servirem com uma função para aquela célula particular.
Dentre os milhares de genes potenciais no genoma da cepa Bacillus sp. P203 depositada sob o número de acesso DSM 17419 os polinucleotídeos deste genoma codificaram 6 polipeptídeos maduros funcionais secretados compreendidos em SEQ ID NO: 2, SEQ ID NO: 4, SEQ ID NO: 6, SEQ ID NO: 8, SEQ ID NO: 10 e SEQ ID NO: 12, que forma determinados funcionais, isto é traduzidos em polipeptídeos funcionais pela célula hospedeira escolhida. Ademais em uma modalidade particular os genes codificadores
de citados polipeptídeos maduros podem ser todos expressados e seus polipeptídeos maduros correspondentes podem ser secretados quando se cultiva um hospedeiro E. coli transformado com polinucleotídeos compreendendo aquelas regiões de SEQ ID NO: 1, SEQ ID NO: 3, SEQ ID
NO: 5, SEQ ID NO: 7, SEQ ID NO: 9 e SEQ ID NO: 11 codificadoras de um polipeptídeo maduro. Pela comparação de homologia ou identidade das seqüências das 6 seqüências de polipeptídeo com seqüências conhecidas a função particular dos polipeptídeos foi anotada. Todos os 6 polipeptídeos funcionais secretados foram determinados como enzimas.
Em particular o polipeptídeo isolado é selecionado do grupo
consistindo de:
(a) um polipeptídeo possuindo uma seqüência de aminoácidos que possui pelo menos 70% de identidade com uma seqüência de aminoácidos selecionada do grupo consistindo dos polipeptídeos maduros
compreendidos em SEQ ID NO: 2, SEQ ID NO: 4, SEQ ID NO: 6, SEQ ID NO: 8, SEQID NO: 10 e SEQID NO: 12, e
(b) um polipeptídeo que é codificado por uma seqüência de nucleotídeos que hibridiza sob condições de estringência alta com uma sonda de polinucleotídeo selecionada do grupo consistindo de (i) a fita complementar a uma seqüência de nucleotídeos selecionada do grupo consistindo de regiões de SEQ ID NO: I5 SEQ ID NO: 3, SEQ ID NO: 5, SEQ ID NO: 7, SEQ ID NO: 9 e SEQ ID NO: 11 codificando um polipeptídeo maduro,
(ii) a fita complementar à seqüência de cDNA contida em uma seqüência de nucleotídeos selecionada de regiões de SEQ ID NO: 1, SEQ ID NO: 3, SEQ ID NO: 5, SEQ ID NO: 7, SEQ ID NO: 9 e SEQ ID NO: 11 codificando um polipeptídeo maduro;
no qual o polipeptídeo exibe a função do polipeptídeo maduro correspondente de SEQ ID NO: 2, SEQ ID NO: 4, SEQ ID NO: 6, SEQ ID NO: 8, SEQID NO: 10 e SEQID NO: 12.
Em uma modalidade particular o polipeptídeo da invenção é selecionado dentre as enzimas secretadas pela cepa Bacillus sp. P203 depositada sob o número de acesso 17419 e isolado pelos presentes inventores, i.e. o grupo de enzimas consistindo de xilanase, serina protease, anidrase carbônica, ramnogalacturonana liase e galactanase.
A invenção também proporciona uma enzima isolada selecionada do grupo consistindo de.
(a) uma enzima compreendendo uma seqüência de aminoácidos que possui pelo menos 70% de identidade com a seqüência de aminoácidos de uma enzima madura selecionada do grupo consistindo de xilanase, serina protease, anidrase carbônica, ramnogalacturonana liase e galactanase secretada da cepa Bacillus sp. P203 depositada sob o número de acesso 17419 e
(b) uma enzima que é codificada por uma seqüência de nucleotídeos que hibridiza sob condições de estringência alta com uma sonda de polinucleotídeo selecionada do grupo consistindo de
(i) a fita complementar a uma seqüência de nucleotídeos compreendida na cepa Bacillus sp. P203 depositada sob o número de acesso .17419 codificando uma enzima madura selecionada do grupo consistindo de xilanase, serina protease, anidrase carbônica, ramnogalacturonana liase e galactanase secretada daquela cepa;
(ii) a fita complementar à seqüência de cDNA contida em uma seqüência de nucleotídeos compreendida na cepa Bacillus sp. P203 depositada sob o número de acesso DSM 17419 codificando uma enzima madura selecionada do grupo consistindo de xilanase, serina protease, anidrase carbônica, ramnogalacturonana liase e galactanase secretada daquela cepa e
na qual a enzima possui uma função selecionada de xilanase, serina protease, anidrase carbônica, ramnogalacturonana liase e galactanase.
O polipeptídeo da invenção é um polipeptídeo isolado, preferivelmente a preparação do polipeptídeo da invenção contém no máximo 90% em peso de outro material de polipeptídeo com o qual pode estar nativamente associado (percentagens menores de outro material de polipeptídeo são preferidas, e.g. no máximo 80% em peso, no máximo 60% em peso, no máximo 50% em peso, no máximo 40% no máximo 30% em peso, no máximo 20% em peso, no máximo 10% em peso, no máximo 9% em peso,no máximo 8% em peso, no máximo 6% em peso, no máximo 5% em peso, no máximo 4% no máximo 3% em peso, no máximo 2% em peso, no máximo 1% em peso e no máximo 0,5% em peso). Assim, é preferido que o polipeptídeo isolado da invenção seja pelo menos 92% puro, i.e. que o polipeptídeo da invenção constitua pelo menos 92% em peso do material de polipeptídeo total presente na preparação, e percentagens maiores são preferidas tal como pelo menos 94% puro, pelo menos 95% puro, pelo menos 96% puro, pelo menos 96% puro, pelo menos 97% puro, pelo menos 98% puro, pelo menos 99%, e no máximo 99.5% puro. Em particular, é preferido que o polipeptídeo da invenção esteja "na forma essencialmente pura, i.e. que a preparação de polipeptídeo esteja essencialmente livre de outro material de polipeptídeo com o qual está nativamente associada. Isto pode ser conseguido, .33
Stg-." ^
por exemplo, pela preparação do polipeptídeo da invenção por meio de métodos recombinantes bem conhecidos. O polipeptídeo da invenção da invenção pode ser sinteticamente preparado, ser naturalmente ocorrente ou uma combinação das mesmas. Em uma modalidade particular o polipeptídeo da invenção pode ser obtido de um microorganismo tal como uma célula procariótica, uma célula archaea ou uma célula eucariótica. A célula pode ser sido adicionalmente modificada por engenharia genética.
Em uma célula particular, o polipeptídeo da invenção é uma enzima exibindo atividade enzimática ótima em uma temperatura dentro da faixa de IO0C a cerca de 80°C, particularmente dentro da faixa de cerca de20°C a cerca de 60°C.
Em uma célula particular o polipeptídeo da invenção é uma enzima, que é funcionalmente estável em uma temperatura de até 100°C, em particular até 80°C, mais particularmente de até 60°C. Em uma célula particular o polipeptídeo da invenção é uma enzima exibindo pelo menos20%, em particular pelo menos 40%, tal como pelo menos 50%, em particular pelo menos 60%, tal como pelo menos 70%, mais particularmente pelo menos80%, tal como pelo menos 90%, muito mais particularmente pelo menos 95%, tal como cerca de ou pelo menos 100% da atividade enzimática de uma enzima selecionada de enzimas naturais compreendidas em SEQ ID NO: 2, SEQ ID NO: 4, SEQ ID NO: 6, SEQ ID NO: 8, SEQ ID NO: 10 e SEQ ID NO: 12.
Em particular o polipeptídeo funcional maduro isolado é pelo menos 70 % idêntico ao e exibe a mesma função de um polipeptídeo secretado correspondente obtenível da cepa bacteriana Bacillus sp. P203 depositada sob o número de acesso DSM 17419 e especificamente o polipeptídeo da invenção compreende, contém ou consiste de uma seqüência de aminoácidos que possui pelo menos 70% de identidade com uma seqüência de polipeptídeo selecionada do grupo consistindo de polipeptídeos maduros compreendidos em SEQ ID NO: 2, SEQ ID NO: 4, SEQ ID NO: 6, SEQ ID NO: 8, SEQ ID NO: 10 e SEQ ID NO: 12. A identidade percentual é particularmente pelo menos 95%, e.g. pelo menos 96%, tal como pelo menos 97%, e ainda mais particularmente pelo menos 98%, tal como pelo menos 99% ou ainda 100% de identidade.
Em outra modalidade particular a identidade percentual é pelo menos 50%; particularmente pelo menos 60%, particularmente pelo menos 65%, particularmente pelo menos 70%, particularmente pelo menos 75%, particularmente pelo menos 80%, e ainda mais particularmente pelo menos 85% de identidade. Em uma célula particular, a seqüência de aminoácidos do polipeptídeo da invenção difere em no máximo dez aminoácidos (e.g. em dez aminoácidos), em particular em no máximo cinco aminoácidos (e.g. em cinco aminoácidos), tal como em no máximo quatro aminoácidos (e.g. em quatro aminoácidos), e.g. em no máximo três aminoácidos (e.g. em três aminoácidos), em particular em no máximo dois aminoácidos (e.g. em dois aminoácidos), tal como em um aminoácido dos polipeptídeos maduros compreendidos em SEQ ID NO: 2, SEQ ID NO: 4, SEQ ID NO: 6, SEQ ID NO: 8, SEQID NO: 10 e SEQID NO: 12.
O polipeptídeo da invenção pode ser um polipeptídeo de tipo selvagem isolado de uma fonte natural tal como a cepa Bacillus sp. P203, número de depósito DSM 17419, ou outra cepa de tipo selvagem, contudo a presente invenção também inclui variantes, onde um polipeptídeo da invenção tem sido mutado por exemplo pela adição e/ou deleção de um ou mais aminoácidos do citado polipeptídeo simultaneamente retendo a função do polipeptídeo e/ou outras propriedades. Conseqüentemente, o polipeptídeo da invenção pode ser uma variante artificial, na qual pelo menos uma substituição, deleção e/ou inserção de um aminoácido tem sido feita em uma seqüência de aminoácidos compreendendo ou consistindo do polipeptídeo maduro compreendido em SEQ ID NO: 2, SEQ ID NO: 4, SEQ ID NO: 6, SEQID NO: 8, SEQ ID NO: 10 e SEQ ID NO: 12.
Os polipeptídeos da invenção também incluem fragmentos funcionais das seqüências de aminoácidos aqui descritas e ácidos nucleicos codificando fragmentos funcionais das seqüências de aminoácidos aqui descritas, incluindo fragmentos das enzimas maduras secretadas da cepa Bacillus sp. P203, depositada sob o número de acesso DSM 17419, como aqui descritas, incluindo fragmento de uma enzima selecionada do grupo consistindo de xilanase, serina protease, anidrase carbônica, ramnogalacturonana liase e galactanase secretada da cepa Bacillus sp. P203 depositada sob o número de acesso DSM 17419. Variantes artificiais podem ser construídas por técnicas padrão conhecidas na arte normalmente seguidas por triagem e/ou caracterização. Técnicas padrão incluem mutagênese clássica, e.g. por irradiação UV das células ou tratamento das células com mutagenes químicos como descritos por Gerhardt et ai. (1994); rearranjo de gene in vivo como descrito em WO 97/07205; rearranjo in vitro como descrito por Stemmer, (1994) ou WO 95/17413, mutagênese randômica como descrita por Eisenstadt E. et ai., (1994); técnicas de PCR como descritas por Poulsen et ai. (1991); rearranjo de família como descrito por J. E. Ness, et al, Nature Biotechnology, vol. 17, pp. 893-896 (1999); mutagênese sítio-direcionada como descrita por Sambrook et al. (1989), Sambrook et al., Molecular Cloning, A Laboratory Manual, Cold Spring Harbor, NY. Uma descrição geral de substituição de nucleotídeo pode ser encontrado em e.g. Ford et al., 1991, Protein Expression and Purification 2, p. 95-107.
Tais métodos de engenharia genética padrão também podem ser usados para preparar uma biblioteca diversificada de seqüências de nucleotídeos variantes a partir dos genes codificando uma ou mais enzimas parentais da invenção, expressando as variantes de enzima em uma célula hospedeira adequada e selecionando a(s) variante(s) preferida(s). Uma biblioteca diversificada pode ser estabelecida por uma variedade de técnicas conhecidas na arte (Reetz MT; Jaeger KE, em Biocatalysis - from Discovery to Application editado por Fessner WD, Vol. 200, pp. 31-57 (1999); Stemmer, Nature, vol. 370, p.389-391, 1994; Zhao e Arnold, Proc. Natl. Acad. ScL, USA, vol. 94, pp. 7997-8000, 1997; ou Yano et al., Proc. Natl. A- cad. ScL, USA, vol. 95, pp 5511-5515, 1998).
Em uma célula particular da invenção, mudanças de aminoácido (na variante artificial bem como na enzima de tipo selvagem) são de uma natureza menor, isto é substituições de aminoácido conservativas que não afetam significativamente o dobramento e/ou a atividade da proteína; deleções pequenas, tipicamente de um a cerca de 30 aminoácidos; extensões amino- ou carboxil-terminais pequenas, tal como um resíduo de metionina amino-terminal; um peptídeo linker pequeno de até cerca de 20-25 resíduos; ou uma extensão pequena que facilita a purificação pela mudança da carga efetiva ou de outra função, tal como um trato de poli-histidina, um epítopo antigênico ou um domínio de ligação.
Exemplos de substituições conservativas estão dentro do grupo de aminoácidos básicos s (arginina, lisina e histidina), aminoácidos ácidos (ácido glutâmico e ácido aspártico), aminoácidos polares (glutamina e asparagina), aminoácidos hidrofóbicos (leucina, isoleucina, valina e metionina), aminoácidos aromáticos (fenil-alanina, triptofeno e tirosina), e aminoácidos pequenos (glicina, alanina, serina e treonina). Substituições de aminoácido que geralmente não alteram e/ou prejudicam a função da proteína são conhecidas na arte e são descritas, por exemplo, por H. Neurath e R.L. Hills 1979, em, The Proteins, Academic Press, Nova Iorque. As trocas mais comumente ocorrentes são Ala/Ser, Val/Ile, Asp/Glu, Thr/Ser, Ala/Gly, Ala/Thr, Ser/Asn, Ala/Vai, Ser/Gly, Tyr/Phe, Ala/Pro, Lys/Arg, Asp/Asn, Leu/lle, Leu/Vai, Ala/Glu, e Asp/Gly bem como estas ao inverso.
Em uma célula particular as trocas de aminoácido são de uma tal natureza que as propriedades físico-químicas dos polipeptídeos são alteradas. Por exemplo, podem ser relizadas mudanças de aminoácido que melhoram a estabilidade térmica da enzima, que alteram a especificidade por substrato, que muda o pH ótimo, e semelhantes.
Particularmente, o número de tais substituições, deleções e/ou inserções nopolipeptídeo da invenção, particularmente naqueles polipeptídeos selecionados do grupo consistindo de polipeptídeos maduros compreendidos em SEQ ID NO: 2, SEQ ID NO: 4, SEQ ID NO: 6, SEQ ID NO: 8, SEQ ID NO: 10 e SEQ ID NO: 12 para produzir uma variante artificial é no máximo 10, tal como no máximo 9, e.g. no máximo 8, mais preferivelmente no máximo 7, e.g. no máximo 6, tal como no máximo 5, muito mais preferivelmente no máximo 4, e.g. no máximo 3, tal como no máximo 2, em particular no máximo 1.
Em uma célula particular a variante artificial é uma variante, que possui uma imunogenicidade especialmente alergenicidade alterada, preferivelmente reduzida, em animais incluindo homem em comparação com uma enzima parental. O termo "imunogenicidade" no contexto é para ser entendido como uma capacidade da variante artificial de invocar uma resposta imunológica, em particular reduzida quando administrada a um animal, incluindo administração intravenosa, cutânea, oral e intratraqueal. O termo "resposta imunológica" neste contexto significa que a administração da variante artificial causa uma alteração nos níveis de imunoglobulina no corpo animal, tal como em IgE, IgG e IgM ou uma alteração no nível de citocina no corpo animal. Métodos para mapeamento de epítopos imunogênicos/antigênicos de uma proteína, preparação de variantes com imunogenicidade alterada e métodos para medição de uma resposta imunológica são bem conhecidos na arte e são descritos e.g. em WO 92/10755, WO 00/26230, WO 00/26354 e WO 01/31989. O termo "alergenicidade" neste contexto é para ser entendido como uma capacidade da variante artificial de invocar uma produção alterada, em particular reduzida, de IgE em um animal bem como a capacidade de ligar IgE do citado animal. Particularmente aiergenicidade decorrente de administração intratraqueal da variante de polipeptídeo ao animal é particularmente de interesse (também conhecida como aiergenicidade respiratória).
Em uma modalidade adicional, o polipeptídeo da invenção é um polipeptídeo que é codificado por seqüências de nucleotídeos que hibridizam sob condições de estringência pelo menos alta, particularmente sob condições de estringência muito alta com uma sonda de polinucleotídeo selecionada do grupo consistindo de
(i) a fita complementar a uma seqüência de nucleotídeos selecionada do grupo de regiões de SEQ ID NO: 1, SEQ ID NO: 3, SEQ ID NO: 5, SEQ ID NO: 7, SEQ ID NO: 9 e SEQ ID NO: 11 codificando um polipeptídeo maduro,
(ii) a fita complementar à seqüência de cDNA contida em uma seqüência de nucleotídeos selecionada de regiões de SEQ ID NO: SEQ ID
NO: 1, SEQ ID NO: 3, SEQ ID NO: 5, SEQ ID NO: 7, SEQ ID NO: 9 e SEQ ID NO: 11 codificando um polipeptídeo maduro
(iii) um fragmento de (i) ou (ii) codificando um polipeptídeo secretado possuindo a função do polipeptídeo maduro correspondente compreendido em SEQ ID NO: 2, SEQ ID NO: 4, SEQ ID NO: 6, SEQ ID NO: 8, SEQ ID NO: 10 e SEQ ID NO: 12 (J. Sambrook, E.F. Fritsch, e T. Maniatus, 1989, Molecular Cloning5 A Laboratory Manual, 2nd edition, Cold Spring Harbor, Nova Iorque).
Em particular, o polipeptídeo da invenção é codificado por um polinucleotídeo compreendendo uma seqüência de nucleotídeos selecionada do grupo de regiões de SEQ ID NO: 1, SEQ ID NO: 3, SEQ ID NO: 5, SEQ ID NO: 7, SEQ ID NO: 9 e SEQ ID NO: 11 codificando um polipeptídeo maduro ou uma seqüência diferindo do mesmo em virtude da degeneração do código genético. Mais particularmente, o polipeptídeo da invenção é codificado por um polinucleotídeo consistindo de uma seqüência de nucleotídeos selecionada do grupo de regiões de SEQ ID NO: 1, SEQ ID NO: .3, SEQ ID NO: 5, SEQ ID NO: 7, SEQ ID NO: 9 e SEQ ID NO: 11 codificando um polipeptídeo maduro ou uma seqüência diferindo do mesmo em virtude da degeneração do código genético. As seqüências de nucleotídeos de regiões de SEQ ID NO: 1, SEQ ID NO: 3, SEQ ID NO: 5, SEQ ID NO: 7, SEQ ID NO: 9 e SEQ ID NO: 11 codificando um polipeptídeo maduro ou uma sua subseqüência, bem como as seqüências de aminoácidos dos polipeptídeos maduros compreendidos em SEQ ID NO: 2, SEQ ID NO: 4, SEQ ID NO: 6, SEQ ID NO: 8, SEQ ID NO: 10 e SEQ ID NO: 12 ou um seu fragmento, podem ser usadas para planejar uma sonda de polinucleotídeo para identificar e clonar DNA codificando enzimas da invenção de cepas de gêneros ou espécies diferentes de acordo com métodos bem conhecidos na arte. Em particular, tais sondas podem ser usadas para hibridização com o DNA genômico ou cDNA do gênero ou da espécie diferente, seguindo procedimentos de Southern blotting padrão, com o objetivo de identificar e isolar o gene correspondente no mesmo. Tais sondas podem ser consideravelmente mais curtas do que a seqüência inteira, mas devem ser de pelo menos 15, preferivelmente pelo menos 25, mais preferivelmente pelo menos 35 nucleotídeos em comprimento, tal como pelo menos 70 nucleotídeos em comprimento. Contudo, é preferido que a sonda de polinucleotídeo seja de pelo menos 100 nucleotídeos em comprimento. Por exemplo, a sonda de polinucleotídeo pode ser de pelo menos 200 nucleotídeos em comprimento, pelo menos 300 nucleotídeos em comprimento, pelo menos .400 nucleotídeos em comprimento ou pelo menos 500 nucleotídeos em comprimento. Sondas ainda mais longas podem ser usadas, e.g., sondas de polinucleotídeo que são de pelo menos 600 nucleotídeos em comprimento, pelo menos 700 nucleotídeos em comprimento, pelo menos 800 nucleotídeos em comprimento, ou pelo menos 900 nucleotídeos em comprimento. Ambas as sondas de DNA e RNA podem ser usadas. As sondas são tipicamente marcadas para detecção do gene correspondente (por exemplo, com 32Ρ, 3H, 35Si biotina, ou avidina). Assim, uma biblioteca de cDNA ou DNA genômico preparada de tais outros organismos pode ser tríada para DNA, que hibridiza com as sondas descritas acima e que codifica enzimas da invenção. DNA genômico ou outro DNA de tais outros organismos pode ser separado por eletroforese em gel de agarose ou de poliacrilamida, ou por outras técnicas de separação. DNA das bibliotecas ou DNA separado pode ser transferido para, e imobilizado sobre nitrocelulose ou outros materiais adequados. Com o objetivo de identificar um clone ou DNA que possui a homologia e/ou identidade requerida com os nucleotídeos selecionados de regiões de SEQ ID NO: 1, SEQ ID NO: 3, SEQ ID NO: 5, SEQ ID NO: 7, SEQ ID NO: 9 e SEQ ID NO: 11 codificando um polipeptídeo maduro, o material de suporte com o DNA imobilizado é usado em um Southern blot.
Para os propósitos da presente invenção, hibridização indica que a seqüência de nucleotídeos hibridiza com uma sonda de polinucleotídeo marcada que de novo hibridiza com uma seqüência de nucleotídeos selecionada de regiões de SEQ ID NO: 1, SEQ ID NO: 3, SEQ ID NO: 5, SEQ ID NO: 7, SEQ ID NO: 9 e SEQ ID NO: 11 codificando um polipeptídeo maduro sob condições de estringência alta a muito alta. Moléculas nas quais a sonda de polinucleotídeo hibridiza sob estas condições podem ser detectadas usando filme de raios-X ou por qualquer outro método conhecido na arte. Sempre que o termo "sonda de polinucleotídeo" for usado no presente contexto, é para ser entendido que uma tal sonda contém pelo menos 15 nucleotídeos.
Em uma modalidade interessante, a sonda de polinucleotídeo é a fita complementar de uma seqüência de nucleotídeos selecionada de regiões de SEQ ID NO: 1, SEQ ID NO: 3, SEQ ID NO: 5, SEQ ID NO: 7, SEQ ID NO: 9 e SEQ ID NO: 11 codificando um polipeptídeo maduro. Em outra modalidade interessante, a sonda de polinucleotídeo é a fita complementar de uma seqüência de nucleotídeos que codifica uma enzima selecionada do grupo de SEQ ID NO: Ij SEQID NO: 3, SEQ ID NO: 5, SEQ ID NO: 7, SEQ ID NO: 9 e SEQ ID NO: 11. Em uma modalidade adicional interessante, a sonda de polinucleotídeo é a fita complementar de uma região codificadora de um polipeptídeo maduro de uma seqüência de nucleotídeos selecionada de regiões de SEQ ID NO: 1, SEQ ID NO: 3, SEQ ID NO: 5, SEQ ID NO: 7, SEQID NO: 9 e SEQID NO: 11 codificando um polipeptídeo maduro.
Para sondas longas de pelo menos 100 nucleotídeos em comprimento, condições de estringência alta a muito alta são definidas como pré-hibridização e hibridização a 42°C em 5X SSPE, 1,0% SDS, 5X solução de Denhardt5 100 microgramas/mL de DNA de esperma de salmão cisalhado e desnaturado, seguido por procedimentos padrão de Southern blotting. Preferivelmente, as sondas longas de pelo menos 100 nucleotídeos não contêm mais do que 1.000 nucleotídeos. Para sondas longas de pelo menos 100 nucleotídeos em comprimento, o material de suporte é finalmente lavado três vezes cada por 15 minutos usando 0,1 χ SSCi 0,1 % SDS a 60°C (estringência alta), em particular lavado três vezes cada por 15 minutos usando 0,1 χ SSC, SDS 1% a 68°C (estringência muito alta).
Embora não particularmente preferido, é contemplado que sondas mais curtas, e.g. sondas que são de cerca de 15 a 99 nucleotídeos em comprimento, tal como de cerca de 15 a cerca de 70 nucleotídeos em comprimento, também podem ser usadas. Para sondas curtas, condições de estringências são definidas como pré-hibridização, hibridização, e lavagem pós-hibridização a 5°C a IO0C abaixo da Tm calculada usando o cálculo de acordo com Bolton e McCarthy (1962, Proceedings of the National Academy of Sciences USA 48:1390) em NaCl 0,9 M, Tris-HCl 0,09 M pH 7,6, EDTA 6 mM, 0,5% NP-40, IX solução de Denhardt, 1 mM pirofosfato de sódio, fosfato de sódio monobásico 1 mM, ATP 0,1 mM, e 0,2 mg de RNA de levedura por mL seguindo os procedimentos padrão de Southern blotting.
Para sondas curtas que são cerca de 15 nucleotídeos a 99 nucleotídeos em comprimento, o material de suporte é lavado uma vez em 6X SCC mais SDS 1% por 15 minutos e duas vezes cada por 15 minutos usando 6X SSC a 50C a IO0C abaixo da Tm calculada. SEO IP NO: 2. Serina protease
Em uma célula particular o polipeptídeo da invenção é uma serina protease compreendendo ou consistindo de uma seqüência de aminoácidos que possui pelo menos 70%, tal como pelo menos 80% ou 85%, particularmente pelo menos 95%, mais particularmente pelo menos 96%, mais particularmente pelo menos 97%, mais particularmente pelo menos 98%, mais particularmente pelo menos 99% ou muito mais particularmente 100% de identidade com uma serina protease obtenível da cepa Bacillus sp. P203, em particular daquela cepa Bacillus sp. P203 depositada sob o número de acesso DSM 17419, mais particularmente a serina protease madura compreendida em SEQ ID NO: 2. A serina protease da presente invenção é adicionalmente descrita em Exemplo 4. SEO ID NO: 4, Anidrase carbônica
Em uma célula particular o polipeptídeo da invenção é uma anidrase carbônica compreendendo ou consistindo de uma seqüência de aminoácidos que possui pelo menos 70%, tal como pelo menos 80% ou 85%, particularmente pelo menos 95%, mais particularmente pelo menos 96%, mais particularmente pelo menos 97%, mais particularmente pelo menos 98%, mais particularmente pelo menos 99% ou muito mais particularmente 100% de identidade com a anidrase carbônica obtenível da cepa Bacillus sp. P203, em particular daquela cepa Bacillus sp. P203 depositada sob o número de acesso DSM 17419, mais particularmente a anidrase carbônica madura compreendida em SEQ ID NO: 4. A anidrase carbônica da presente invenção é adicionalmente descrita em Exemplo 8. SEOID NO: 6, Anidrase carbônica
Em uma célula particular o polipeptídeo da invenção é uma anidrase carbônica compreendendo ou consistindo de uma seqüência de aminoácidos que possui pelo menos 70%, tal como pelo menos 80% ou 85%, particularmente pelo menos 95%, mais particularmente pelo menos 96%, mais particularmente pelo menos 97%, mais particularmente pelo menos .98%, mais particularmente pelo menos 99% ou muito mais particularmente .100% de identidade com a anidrase carbônica obtenível da cepa Bacillus sp. P203, em particular daquela cepa Bacillus sp. P203 depositada sob o número de acesso DSM 17419, mais particularmente a anidrase carbônica madura compreendida em SEQID NO: 6. SEO ID NO: 8. Xilanase
Em uma célula particular o polipeptídeo da invenção é uma xilanase compreendendo ou consistindo de uma seqüência de aminoácidos que possui pelo menos 70%, tal como pelo menos 80% ou 85%, particularmente pelo menos 95%, mais particularmente pelo menos 96%, mais particularmente pelo menos 97%, mais particularmente pelo menos .98%, mais particularmente pelo menos 99% ou muito mais particularmente .100% de identidade com a xilanase obtenível da cepa Bacillus sp. P203, em particular daquela cepa Bacillus sp. P203 depositada sob o número de acesso DSM 17419, mais particularmente a xilanase madura compreendida em SEQ ID NO: 8. A xilanase da presente invenção é adicionalmente descrita em Exemplo 6.
SEOID NO: 10. Ramnogalacturonana liase
Em uma célula particular o polipeptídeo da invenção é uma Ramnogalacturonana liase compreendendo ou consistindo de uma seqüência de aminoácidos que possui pelo menos 70%, tal como pelo menos 80% ou .85%, particularmente pelo menos 95%, mais particularmente pelo menos .96%, mais particularmente pelo menos 97%, mais particularmente pelo menos 98%, mais particularmente pelo menos 99% ou muito mais particularmente 100% de identidade com a Ramnogalacturonana liase obtenível da cepa Bacillus sp. P203, em particular daquela cepa Bacillus sp. P203 depositada sob o número de acesso DSM 17419, mais particularmente a Ramnogalacturonana liase madura compreendida em SEQ ID NO: 8. A Ramnogalacturonana liase da presente invenção é adicionalmente descrita em Exemplo 5.
SEO ID NO: 12. Galactanase
Em uma célula particular o polipeptídeo da invenção é uma Galactanase compreendendo ou consistindo de uma seqüência de aminoácidos que possui pelo menos 70%, tal como pelo menos 80% ou 85%, particularmente pelo menos 95%, mais particularmente pelo menos 96%, mais particularmente pelo menos 97%, mais particularmente pelo menos 98%), mais particularmente pelo menos 99%» ou muito mais particularmente 100% de identidade com a Galactanase obtenível da cepa Bacillus sp. P203, em particular daquela cepa Bacillus sp. P203 depositada sob o número de acesso DSM 17419, mais particularmente a Galactanase madura compreendida em SEQ ID NO: 8. A Galactanase da presente invenção é adicionalmente descrita em Exemplo 7. Polinucleotídeos
A presente invenção também se refere aos polinucleotídeos, particularmente polinucleotídeos isolados, compreendendo ou consistindo de uma seqüência de nucleotídeos codificadora de um polipeptídeo da invenção. Em uma célula particular, a seqüência de nucleotídeos é como apresentada em SEQ ID NO: 1, SEQ ID NO: 3, SEQ ID NO: 5, SEQ ID NO: 7, SEQ ID NO: 9 e SEQ ID NO: 11 incluindo seqüências de nucleotídeos diferindo da mesma em virtude da degeneração do código genético. Em uma modalidade adicional o polinucleotídeo da invenção é uma seqüência de nucleotídeos modificada que compreende ou consiste de uma seqüência de nucleotídeos selecionada das regiões de SEQID NO: Ii SEQ ID NO: 3, SEQ ID NO: 5, SEQID NO: 7, SEQ ID NO: 9 e SEQ ID NO: 11 codificando um polipeptídeo maduro e que compreende pelo menos uma modificação/mutação comparada com a seqüência de nucleotídeos parental compreendida em SEQ ID NO: 1, SEQ ID NO: 3, SEQ ID NO: 5, SEQ ID NO: 7, SEQID NO: 9 e SEQ ID NO: 11.
As técnicas usadas para isolar e/ou clonar uma seqüência de nucleotídeos codificadora de uma enzima são conhecidas na arte e incluem isolamento de DNA genômico, preparação de cDNA, ou uma sua combinação. Á clonagem das seqüências de nucleotídeos da presente invenção de tal DNA genômico pode ser efetuada, e.g., pelo uso de bem conhecida reação em cadeia de polimerase (PCR) ou triagem por anticorpo das bibliotecas de expressão para detectar fragmentos de DNA clonado com características estruturais compartilhadas. Veja, e.g., Innis et ai., 1990, PCR: A Guide to Methods and Application, Academic Press5 Nova Iorque. Outros procedimentos de amplificação tais como reação em cadeia da ligase (LCR), transcrição ativada ligada (LAT) e amplificação baseada em seqüências de nucleotídeos (NASBA) podem ser usados. A seqüência de nucleotídeos pode ser obtida por procedimentos de clonagem padrão usados em engenharia genética para relocar a seqüência de nucleotídeos de sua localização natural para um sítio diferente onde ela será reproduzida. Os procedimentos de clonagem podem envolver excisão e isolamento de um fragmento desejado compreendendo a seqüência de nucleotídeos codificando o polipeptídeo, inserção do fragmento em uma molécula de vetor, e incorporação do vetor recombinante em uma célula hospedeira onde cópias múltiplas ou clones da seqüência de nucleotídeos serão replicadas(os). A seqüência de nucleotídeos pode ser de origem sintética, semi-sintética, genômica, cDNA, RNA, ou qualquer uma de suas combinações.
Em particular o polinucleotídeo compreende, preferivelmente consiste de, uma seqüência de nucleotídeos que possui pelo menos 50% de identidade com uma seqüência de nucleotídeos selecionada das regiões de SEQ ID NO: 1, SEQ ID NO: 3, SEQ ID NO: 5, SEQ ID NO: 7, SEQ ID NO: 9 e SEQ ID NO: 11 codificando um poiipeptídeo maduro. Particularmente, a seqüência de nucleotídeos possui pelo menos 65% de identidade, mais particularmente pelo menos 70% de identidade, mais particularmente pelo menos 80% de identidade, mais particularmente pelo menos 90% de identidade, mais particularmente pelo menos 95% de identidade, mais particularmente pelo menos 96% de identidade, mais particularmente pelo menos 97% de identidade, mais particularmente pelo menos 98% de identidade, mais particularmente pelo menos 99% de identidade ou muito mais particularmente 100% de identidade com uma seqüência de nucleotídeos selecionada das regiões de SEQ ID NO: 1, SEQ ID NO: 3, SEQ ID NO: 5, SEQ ID NO: 7, SEQ ID NO: 9 e SEQ ID NO: 11 codificando um poiipeptídeo maduro. Particularmente, a seqüência de nucleotídeos compreende uma seqüência de nucleotídeos selecionada das regiões de SEQ ID NO: 1, SEQ ID NO: 3, SEQ ID NO: 5, SEQ ID NO: 7, SEQ ID NO: 9 e SEQ ID NO: 11 codificando um poiipeptídeo maduro. Em uma modalidade ainda mais particular, a seqüência de nucleotídeos consiste de uma seqüência de nucleotídeos selecionada das regiões de SEQ ID NO: 1, SEQ ID NO: 3, SEQ ID NO: 5, SEQ ID NO: 7, SEQ ID NO: 9 e SEQ ID NO: 11 codificando um poiipeptídeo maduro.
Em particular o polinucleotídeo compreende, preferivelmente consiste de, uma seqüência de nucleotídeos codificando uma enzima madura selecionada de xilanase, serina protease, anidrase carbônica, ramnogalacturonana liase e galactanase e que possui pelo menos 50% de identidade, particularmente pelo menos 65% de identidade, mais particularmente pelo menos 70% de identidade, mais particularmente pelo menos 80% de identidade, mais particularmente pelo menos 90% de identidade, mais particularmente pelo menos 95% de identidade, mais particularmente pelo menos 96% de identidade, mais particularmente pelo menos 97% de identidade, mais particularmente pelo menos 98% de identidade, mais particularmente pelo menos 99% de identidade ou muito mais particularmente 100% de identidade com uma seqüência de nucleotídeos codificadora de uma enzima madura selecionada de xilanase, serina protease, anidrase carbônica, ramnogalacturonana liase e galactanase secretada da cepa Bacillus sp. P203 depositada sob o número de acesso 17419. SEQID NO: 1
Em uma célula particular o polinucleotídeo da invenção codifica uma serina protease e compreende ou consiste de uma seqüência de nucleotídeos que possui pelo menos 70% de identidade, mais particularmente pelo menos 80% de identidade, mais particularmente pelo menos 90% de identidade, mais particularmente pelo menos 95% de identidade, mais particularmente pelo menos 96% de identidade, mais particularmente pelo menos 97% de identidade, mais particularmente pelo menos 98% de identidade, mais particularmente pelo menos 99% de identidade ou muito mais particularmente 100% de identidade com a seqüência de nucleotídeos de SEQID NO: 1 codificando uma serina protease madura. SEO ID NO: 3
Em uma célula particular o polinucleotídeo da invenção codifica uma serina protease e compreende ou consiste de uma seqüência de nucleotídeos que possui pelo menos 70% de identidade, mais particularmente pelo menos 80% de identidade, mais particularmente pelo menos 90% de identidade, mais particularmente pelo menos 95% de identidade, mais particularmente pelo menos 96% de identidade, mais particularmente pelo menos 97% de identidade, mais particularmente pelo menos 98% de identidade, mais particularmente pelo menos 99% de identidade ou muito mais particularmente 100% de identidade com a seqüência de nucleotídeos de SEQ ID NO: 3 codificando uma anidrase carbônica madura. SEO ID NO: 5
Em uma célula particular o polinucleotídeo da invenção codifica uma serina protease e compreende ou consiste de uma seqüência de nucleotídeos que possui pelo menos 70% de identidade, mais particularmente pelo menos 80% de identidade, mais particularmente pelo menos 90%» de identidade, mais particularmente pelo menos 95% de identidade, mais particularmente pelo menos 96% de identidade, mais particularmente pelo menos 97% de identidade, mais particularmente pelo menos 98% de identidade, mais particularmente pelo menos 99% de identidade ou muito mais particularmente 100% de identidade com a seqüência de nucleotídeos de SEQ ID NO: 5 codificando uma anidrase carbônica madura. SEOID NO: 7
Em uma célula particular o polinucleotídeo da invenção codifica uma serina protease e compreende ou consiste de uma seqüência de nucleotídeos que possui pelo menos 70% de identidade, mais particularmente pelo menos 80% de identidade, mais particularmente pelo menos 90% de identidade, mais particularmente pelo menos 95% de identidade, mais particularmente pelo menos 96% de identidade, mais particularmente pelo menos 97%» de identidade, mais particularmente pelo menos 98% de identidade, mais particularmente pelo menos 99% de identidade ou muito mais particularmente 100% de identidade com a seqüência de nucleotídeos de SEQID NO: 7 codificando uma xilanase madura. SEOID NO: 9
Em uma célula particular o polinucleotídeo da invenção codifica uma serina protease e compreende ou consiste de uma seqüência de nucleotídeos que possui pelo menos 70%» de identidade, mais particularmente pelo menos 80% de identidade, mais particularmente pelo menos 90% de identidade, mais particularmente pelo menos 95% de identidade, mais particularmente pelo menos 96% de identidade, mais particularmente pelo Jfs
menos 97% de identidade, mais particularmente pelo menos 98% de identidade, mais particularmente pelo menos 99% de identidade ou muito mais particularmente 100%» de identidade com a seqüência de nucleotídeos de SEQID NO: 9 codificando a ramnogalacturonana liase madura.
SEO ID NO: 11
Em uma célula particular o polinucleotídeo da invenção codifica uma serina protease e compreende ou consiste de uma seqüência de nucleotídeos que possui pelo menos 70% de identidade, mais particularmente pelo menos 80% de identidade, mais particularmente pelo menos 90% de identidade, mais particularmente pelo menos 95% de identidade, mais particularmente pelo menos 96% de identidade, mais particularmente pelo menos 97% de identidade, mais particularmente pelo menos 98% de identidade, mais particularmente pelo menos 99% de identidade ou muito mais particularmente 100% de identidade com a seqüência de nucleotídeos de SEQID NO: 11 codificando uma galactanase madura.
Modificação de uma seqüência de nucleotídeos codificadora de um polipeptídeo da presente invenção pode ser necessária para a síntese de um polipeptídeo que compreende uma seqüência de aminoácidos que possui pelo menos uma substituição, deleção e/ou inserção em comparação com uma seqüência de aminoácidos selecionada de polipeptídeo maduro compreendida em SEQ ID NO: 2, SEQ ID NO: 4, SEQ ID. NO: 6, SEQ ID NO: 8, SEQ ID NO: IOeSEQ ID NO: 12.
Será evidente para aquelas pessoas experientes na arte que tais modificações podem ser feitas para conservar a função da enzima i.e. feitas fora das regiões críticas para a função da enzima. Resíduos de aminoácido que são essenciais para a função são portanto preferivelmente não submetidos à modificação, tal como substituição. Resíduos de aminoácido essenciais para a função podem ser identificados de acordo com procedimentos conhecidos na arte, tal como mutagênese sítio-direcionada ou mutagênese de varredura de alanina (veja, e.g., Cunningham e Wells, 1989, Science 244: 1081- 1085). Sítios de interação de substrato-enzima podem ser determinados por análise da estrutura tridimensional conforme determinada por técnicas tais como análise de ressonância nuclear magnética, cristalografia ou marcação de fotoafinidade (veja, e.g., de Vos et ai., 1992, Science 255: 306-312; Smith et al., 1992, Journal of Molecular Biology 224: 899-904; Wlodaver et al., 1992, FEBS Letters 309: 59-64). Além disso, uma seqüência de nucleotídeos codificadora de uma enzima da invenção pode ser modificada pela introdução de substituições de nucleotídeo que não ocasionam outra seqüência de aminoácidos da enzima codificada pela seqüência de nucleotídeos, mas que corresponde à utilização de códons do organismo hospedeiro intencionada
para a produção da enzima.
A introdução de uma mutação em uma seqüência de
nucleotídeos para substituir um nucleotídeo por outro nucleotídeo pode ser realizada por mutagênese sítio-direcionada usando qualquer um dos métodos conhecidos na arte. Particularmente útil é o procedimento, que utiliza um vetor de DNA de fita dupla, super enrolado com um inserto de interesse e dois iniciadores sintéticos contendo a mutação desejada. Os iniciadores de oligonucleotídeo, complementam cada um as fitas opostas do vetor, se estendem durante o ciclo de temperatura por meio de Pfu DNA polimerase. Sob incorporação dos iniciadores, é gerado um plasmídeo mutado contendo falhas alternadas. Após o ciclo de temperatura, o produto é tratado com DpnI, que é específica para DNA metilado e semi-metilado para digerir o modelo de DNA parental e para selecionar DNA sintetizado contendo mutação. Outros procedimentos conhecidos na arte também podem ser usados. Para uma descrição geral de substituição de nucleotídeo, pode-se consultar e.g., Ford et al., 1991, Protein Expression and Purification 2: 95-107. A presente invenção também se refere a um polinucleotídeo compreendendo, preferivelmente consistindo de, uma seqüência de nucleotídeos que codifica um polipeptídeo da invenção e que hibridiza sob condições de estringência alta, preferivelmente sob condições de estringência muito alta com uma sonda de polinucleotídeo selecionada do grupo consistindo de:
(i) a fita complementar a uma seqüência de nucleotídeos selecionada das regiões de SEQ ID NO: 1, SEQ ID NO: 3, SEQ ID NO: 5, SEQ ID NO: 7, SEQ ID NO: 9 e SEQ ID NO: 11 codificando um polipeptídeo maduro,
(ii) a fita complementar à seqüência de cDNA contida em uma seqüência de nucleotídeos selecionada das regiões de SEQ ID NO: 1, SEQ ID NO: 3, SEQ ID NO: 5, SEQ ID NO: 7, SEQ ID NO: 9 e SEQ ID NO: 11 codificando um polipeptídeo maduro e,
(iii) um fragmento de (i) ou (ii) codificando um polipeptídeo maduro secretado possuindo a função dos polipeptídeos maduros correspondentes compreendidos em SEQ ID NO: 2, SEQ ID NO: 4, SEQ ID NO: 6, SEQID NO: 8, SEQ ID NO: 10 e SEQ ID NO: 12
Como será entendido, detalhes e particularidades referentes à hibridização das seqüências de nucleotídeos serão iguais ou análogas aos aspectos de hibridização discutidos em seção intitulada aqui como "polipeptídeos da invenção".
A presente invenção também inclui um meio de armazenagem adequado para uso em um dispositivo eletrônico, preferivelmente digital, compreendendo informação da seqüência de aminoácidos de polipeptídeos da invenção ou das seqüências de nucleotídeos do polinucleotídeo da invenção, em particular de qualquer uma das seqüências de polipeptídeo ou polinucleotídeo da invenção em uma forma eletrônica ou digital, tal como código binário ou outro código digital. O meio de armazenagem pode ser adequadamente um disco magnético ou óptico e o dispositivo eletrônico um dispositivo de computador e a informação pode ser em particular armazenada no meio de armazenagem em uma forma digital. Vetores de expressão recombinantes
A presente invenção também se refere aos vetores de expressão recombinantes compreendendo o construto de ácido nucleico da invenção. As várias seqüências de controle e de nucleotídeos descritas acima podem ser unidas juntas para produzir um vetor de expressão recombinante, que pode incluir um ou mais sítios de restrição convenientes para permitir inserção ou substituição da seqüência de nucleotídeos codificando o polipeptídeo em tais sítios. Alternativamente, a seqüência de nucleotídeos da presente invenção pode ser expressada pela inserção da seqüência de nucleotídeos ou de um construto de ácido nucleico compreendendo a seqüência em um vetor de expressão apropriado. Na criação do vetor de expressão, a seqüência codificadora está localizada no vetor de modo que a seqüência codificadora seja operacionalmente ligada com as seqüências de controle apropriadas para expressão. O vetor de expressão recombinante pode ser qualquer vetor
(e.g., um plasmídeo ou vírus) que pode ser convenientemente submetido aos procedimentos de DNA recombinante e pode produzir a expressão da seqüência de nucleotídeos. A escolha do vetor tipicamente dependerá da compatibilidade do vetor com a célula hospedeira dentro da qual o vetor é para ser introduzido. Os vetores podem ser plasmídeos lineares ou circulares fechados.
O vetor pode ser um vetor autonomamente replicante, i.e., um vetor que existe como uma entidade extracromossômica, cuja replicação é independente da replicação cromossômica, e.g. um plasmídeo, um elemento extracromossômico, um minicromossomo, ou um cromossomo artificial.
O vetor pode conter qualquer meio para garantir auto- replicação. Alternativamente, o vetor pode ser um que, quando introduzido na célula hospedeira, é integrado no genoma e replicado junto com o(s) cromossomo(s) no(s) qual (quais) ele tem sido integrado. Ademais, um vetor ou plasmídeo único ou dois ou mais vetores ou plasmídeos que juntos contêm o DNA total a ser introduzido no genoma da célula hospedeira, ou um transposon podem ser usados.
Os vetores da presente invenção preferivelmente contêm um ou mais marcadores selecionáveis que permitem fácil seleção das células transformadas. Um marcador selecionável é um gene cujo produto proporciona resistência viral ou a biocida, resistência a metais pesados, prototrofia a auxótrofos, e semelhantes.
Exemplos de marcadores bacterianos selecionáveis são os genes dal de Bacillus subtilis ou Bacillus licheniformis, ou marcadores que conferem resistência a antibiótico tal como resistência a ampicilina, canamicina, cloranfenicol ou tetraciclina. Marcadores adequados para células hospedeiras de levedura são ADE2, HIS3, LEU2, LYS2, MET3, TRP1, e URA3. Marcadores selecionáveis para uso em célula hospedeira de fungo filamentoso incluem, mas não são limitados a, amdS (acetamidase), argB (ornitina carbamoiltransferase), bar (fosfmotricina acetiltransferase), hygB (higromicina fosfotransferase), niaD (nitrato redutase), pyrG (orotidina-5'- fosfato descarboxilase), sC (sulfato adeniltransferase), trpC (antranilato sintase), bem como seus equivalentes. Preferidos para uso em uma célula de Aspergillus são os genes amdS e pyrG de Aspergillus nidulans ou Aspergillus oryzae e o gene bar de Streptomyces hygroscopicus.
Os vetores da presente invenção preferivelmente contêm um elemento(s) que permite(m) a integração estável do vetor no genoma da célula hospedeira ou replicação autônoma do vetor na célula independente do genoma.
Para integração no genoma da célula hospedeira, o vetor pode depender da seqüência de nucleotídeos codificando o polipeptídeo ou qualquer outro elemento do vetor para integração estável do vetor no genoma por recombinação homóloga ou não-homóloga. Alternativamente, o vetor pode conter seqüências de nucleotídeos adicionais para dirigir a integração por recombinação homóloga no genoma da célula hospedeira. As seqüências de nucleotídeos adicionais permitem que o vetor seja integrado no genoma da célula hospedeira em uma localização(ões) precisa(s) no(s) cromossomo(s). Para aumentar a possibilidade de integração em uma localização precisa, os elementos de integração devem preferivelmente conter um número suficiente de nucleotídeos, tal como 100 a 1.500 pares de base, preferivelmente de 400 a1.500 pares de base, e mais preferivelmente 800 a 1.500 pares de base, que são elevadamente homólogos com a seqüência alvo correspondente para aumentar a probabilidade de recombinação homóloga. Os elementos de integração podem ser qualquer seqüência que é homóloga com a seqüência alvo no genoma da célula hospedeira. Ademais, os elementos de integração podem ser seqüência de nucleotídeos não-codificadora ou codificadora. Por outro lado, o vetor pode ser integrado no genoma da célula hospedeira por recombinação não-homóloga.
Para replicação autônoma, o vetor pode adicionalmente compreender uma origem de replicação permitindo que o vetor replique autonomamente na célula hospedeira em questão. Exemplos de origens de replicação bacterianas são origens de replicação de plasmídeos pBR322, pUC19, pACYC177, e pACYC184 permitindo replicação em E. coli, e pUBllO, pE194, pTA1060, e ρΑΜβΙ permitindo replicação em Bacillus. Exemplos de origens de replicação para uso em uma célula hospedeira de levedura são as origens de replicação de 2 micrômetros, ARS1, ARS4, a combinação de ARSl e CEN3, e a combinação de ARS4 e CEN6. A origem de replicação pode ser uma possuindo uma mutação que torna seu funcionamento sensível à temperatura na célula hospedeira (veja, e.g., Ehrlich, 1978, Proceedings of the National Academy of Sciences USA 75:1433).
Mais do que uma cópia de uma seqüência de nucleotídeos da presente invenção pode ser inserida na célula hospedeira para aumentar a produção do produto de gene. Um aumento no número de cópias da seqüência de nucleotídeos pode ser obtido pela integração de pelo menos uma cópia adicional da seqüência no genoma da célula hospedeira ou pela inclusão de um gene marcador selecionável amplificável com a seqüência de nucleotídeos onde células contendo cópias amplificadas do gene marcador selecionável, e deste modo cópias adicionais da seqüência de nucleotídeos, podem ser selecionados por cultivo das células na presença de agente selecionável apropriado.
Os procedimentos usados para ligar os elementos descritos acima para construir os vetores de expressão recombinante da presente invenção são bem conhecidos por uma pessoa experiente na arte (veja, e.g., Sambrook et ai., 1989, supra). Células hospedeiras recombinantes
A presente invenção também se refere a uma célula hospedeira recombinante compreendendo o construto de ácido nucleico da invenção, que são vantajosamente usados na produção recombinante dos polipeptídeos. Um vetor compreendendo uma seqüência de nucleotídeos da presente invenção é introduzido em uma célula hospedeira de modo que o vetor seja mantido como um integrante cromossômico ou como um vetor extracromossômico auto-replicante como descrito no início.
A célula hospedeira pode ser um microorganismo unicelular, e.g., um procarioto ou um microorganismo não-unicelular, e.g., um eucarioto.
Células unicelulares são células bacterianas tais como bactérias gram-positivas incluindo, mas não se limitando a, uma célula de Bacillus, e.g., Bacillus alkalophilus, Bacillus amyloliquefaciens, Bacillus brevis, Bacillus circulans, Bacillus clausii, Bacillus coagulans, Bacillus lautus, Bacillus lentus, Bacillus licheniformis, Bacillus megaterium, Bacillus stearothermophilus, Bacillus subtilis, e Bacillus thuringiensis; ou uma célula de Streptomyces, e.g., Streptomyces lividans ou Streptomyces murinus, ou bactérias gram-negativas tais como E. coli e Pseudomonas sp. Em uma modalidade preferida, a célula hospedeira bacteriana é uma célula de Bacillus lentus, Bacillus licheniformis, Bacillus stearothermophilus, ou Bacillus subtilis. Em outra modalidade preferida, a célula de Bacillus é um Bacillus alcalifílico.
A introdução de um vetor em uma célula hospedeira bacteriana pode, por exemplo, ser efetuada por transformação de protoplasto (veja, e.g., Chang e Cohen, 1979, Molecular General Genetics 168: 111-115), usando células competentes (veja, e.g., Young e Spizizin, 1961, Journal of Bacteriology 81: 823-829, ou Dubnau e Davidoff-Abelson, 1971, Journal of Molecular Biology 56: 209-221), eletroporação (veja, e.g., Shigekawa e Dower, 1988, Biotechniques 6: 742-751), ou conjugação (veja, e.g., Koehler e Thorne, 1987, Journal of Bacteriology 169: 5771-5278).
A célula hospedeira pode ser um eucarioto, tal como uma célula de mamífero, de inseto, de planta, ou de fungo.
Em uma modalidade preferida, a célula hospedeira é uma célula de fungo. "Fungos" como aqui usado inclui os filos Ascomycota, Basidiomycota, Chytridiomycota, e Zygomycota (como definidos por Hawksworth et a., em, Ainsworth and Bisby's Dictionary of The Fungi, 8a edição, 1995, CAB International, University Press, Cambridge, UK) bem como os Oomycota (como citados em Hawksworth et al., 1995, supra, página171) e todos os fungos mitospóricos (Hawksworth et al.,1995, supra). Em uma modalidade mais preferida, a célula hospedeira fungica é uma célula de levedura. "Levedura" como aqui usado inclui levedura ascosporogena (Endomycetales), levedura basidiosporogena, e levedura pertencente ao Fungi Imperfecti (Blastomycetes). Visto que a classificação de levedura pode mudar no futuro, para os propósitos desta invenção, levedura deve ser definida como descrito em Biology and Activities of Yeast (Skinner, F.A., Passmore, S. M., e Davenport5 R.R., eds, Soe. App. Bacteriol. Symposium Series No. 9, 1980).
Em uma modalidade ainda mais preferida, a célula hospedeira de levedura é uma célula de Candida, Hansenula, Kluyveromyces, Pichia, Saccharomycesi Schizosaccharomyces, ou Yarrowia.
Em uma modalidade mais preferida, a célula hospedeira de levedura é uma célula de Saccharomyces carlsbergensis, Saccharomyces cerevisiae, Saccharomyces diastaticus, Saccharomyces douglasii, Saccharomyees kluyveri, Saccharomyees norbensis ou Saccharomyees oviformis. Em outra modalidade mais preferida, a célula hospedeira de levedura é uma célula de Kluyveromyces lactis. Em outra modalidade mais preferida, a célula hospedeira de levedura é uma célula de Yarrowia lipolytica cell.
Em outra modalidade mais preferida, a célula hospedeira fungica é uma célula fungica filamentosa. "Fungos filamentosos" incluem todas as formas filamentosas da subdivisão Eumycota e Oomycota (como definido por Hawksworth et ai., 1995, supra). Os fungos filamentosos são caracterizados por uma parede micelar composta de quitina, celulose, glucano, quitosana, manana, e outros polissacarídeos complexos. Desenvolvimento vegetativo é pelo alongamento hifal e catabolismo de carbono é obrigatoriamente aeróbico. Em contraste, desenvolvimento vegetativo por leveduras tal como Saccharomyces cerevisiae é por brotamento de um talo unicelular e catabolismo de carbono pode ser fermentativo.
Em uma modalidade mais preferida, a célula hospedeira fungica filamentosa é uma célula de uma espécie de, mas não limitada a, Acremonium, Aspergillus, Fusarium, Humicola, Mucor, Myceliophthora, Neurospora, Penicillium, Thielavia, Tolypocladium, ou Trichoderma.
Em uma modalidade mais preferida, a célula hospedeira fungica filamentosa é uma célula de Aspergillus awamori, Aspergillus foetidus, Aspergillus japonicus, Aspergillus nidulans, Aspergillus niger ou Aspergillus oryzae. Em outra modalidade mais preferida, a célula hospedeira fungica filamentosa uma célula de Fusarium bactridioides, Fusarium cerealis, Fusarium crookwellense, Fusarium culmoram, Fusarium graminearum, Fusarium graminum, Fusarium heterosporum, Fusarium negundi, Fusarium oxysporum, Fusarium reticulatum, Fusarium roseum, Fusarium sambucinum, Fusarium sarcochroum, Fusarium sporotrichioides, Fusarium sulphureum, Fusarium torulosum, Fusarium trichothecioides, ou Fusarium venenatum. Em uma modalidade ainda mais preferida, a célula parental fungica filamentosa é uma célula de Fusarium venenatum (Nirenberg sp. nov.). Em outra modalidade mais preferida, a célula hospedeira fungica filamentosa é uma célula de Humicola insolens, Humicola lanuginosa, Mucor miehei, Myceliophthora thermophila, Neurospora crassa, Penicillium purpurogenum, Thielavia terrestris, Trichoderma harzianum, Trichoderma koningn, Trichoderma longibrachiatum, Trichoderma reesei, ou Trichoderma viride.
Células fungicas podem ser transformadas por um processo envolvendo formação de protoplasto, transformação dos protoplastos, e regeneração da parede celular em uma maneira por si conhecida. Procedimentos adequados para transformação de células hospedeiras de Aspergillus são descritos em EP 238.023 e Yelton et al., 1984, Proceedings of the National Academy of Sciences USA 81: 1470-1474. Métodos adequados para a transformação de espécie Fusarium são descritos por Malardier et al, 1989, Gene 78: 147-156 e WO 96/00787. Levedura pode ser transformada usando os procedimentos descritos por Becker e Guarente, em Abelson, J.N. e Simon, M.I., editors, Guide to Yeast Genetics and Molecular Biology, Methods in Enzymology, Volume 194, pp 182-187, Academic Press, Inc., Nova Iorque; Ito et al., 1983, Journal of Bacteriology 153: 163; e Hinnen et al., 1978, Proceedings of the National Academy of Sciences USA 75: 1920.
A cepa doadora
A invenção também proporciona a cepa Bacillus sp. P203, como depositada sob o número de acesso DSM 17419, e composições compreendendo este microorganismo. A invenção também proporciona cepas do gênero Bacillus consistindo de uma espécie nova (Bacillus plakortiensis). A espécie nova compreende cepas de Bacillus álcali- e halo-tolerantes que desenvolvem de pH 7-11 e em concentração de NaCl de 0-12% nos meios em temperaturas variando de 4-3 O0C. Condições ótimas foram de 4-20°C, em pH7,5 e em NaCl 10%. Cepas de espéice nova podem ser adicionalmente distinguidas das cepas relacionadas pelos seguintes parâmetros: as cepas poderia utilizar glicerol, glicose, D-frutose, D-manose, D-manitol, arbutina, aesculina, salicina, gelatina, citrato, tributirato de glicerol, D-maltose, D- trealose, leite desnatado, AZCL-caseína, AZCL-arabinana e AZCL-galactana mas não amido, Tween 20, AZCL-xiloglicano, AZCL-pululana, AZCL- arabinoxilana, AZCL-dextrina, AZCL-celulose, AZCL-beta-glicano, AZCL- xilano, amilose vermelha, pululana vermelha e amido vermelho. Hidrólise de ONPG foi observada. Produção de indol (usando reagente de Kovacs) foi negativa, reação de Voges Proskauer (produção de acetoína) e teste para atividade de catalase e de oxidase foram positivos.
Cepa P203 teve 98% de identidade de nucleotídeos da seqüência de 16S rDNA para a cepa tipo de Bacillus gibsonii (número de depósito DSM8722). Características de desenvolvimento de cepa P203 são mostradas em figura 1. Bacillus plakortiensis está mais relacionado com Bacillus gibsonii do que com qualquer outra espécie de Bacillus conhecida, baseado em análise comparativa de 16S rDNA. Contudo, homologia de DNA entre Bacillus plakortiensis, cepa P203, e a espécie de Bacillus mais proximamente conhecida cepa tipo B. gibsonii é (25,8-29,5%) hibridização de DNA-DNA e conteúdo de G+C DNA, determinado por HPLC em fase reversa em DSMZ, Braunschweig, Alemanha. DNA foi isolado usando uma prensa French (Thermo Spectronic™) e purificado por cromatografia sobre hidróxiapatita como descrito por (Cashion, et al., 1977). Hibridização DNA- DNA foi realizada como descrito por Ley, J. D., Cattoir, H. & Reynaerts, A. (1970): "The quantitative measurement of DNA hybridization from renaturation rates". Eur J Biochem 12, 133-42, com as modificações descritas por Huss, V. A. R., Festl, H. & Schleifer, Κ. H. (1983): "Studies on the spectrophotometry determination of DNA hybridization from renaturation rates". Syst Appl Microbiol 4, 184-192, usando um espectrofotômetro UV- VIS modelo Gary 100 Bio equipado com um trocador de multicélulas 6x6 termostatizado Peltier e um controlador de temperatura com sonda de temperatura in situ (Varian).
Métodos para preparação de polipeptídeos de enzima
A presente invenção também se refere aos métodos para produzir uma enzima da invenção compreendendo (a) cultivar uma cepa compreendendo uma seqüência de nucleotídeos codificadora de uma enzima da invenção cuja cepa é capaz de expressar e de secretar a enzima e (b) recuperar a enzima. Em uma célula particular a cepa uma cepa de tipo selvagem tal como a cepa Bacillus sp. P203 DSM 17419, enquanto que em outra modalidade a cepa é uma célula hospedeira recombinante como descrito, supra.
Nestes métodos da invenção, as células são cultivadas em um meio nutriente adequado para a produção da enzima usando métodos conhecidos na arte. Por exemplo, a célula pode ser cultivada por cultivo em frasco agitado, fermentação em escala pequena ou em escala grande (incluindo fermentações contínua, em batelada, em batelada alimentada, ou no estado sólido) em fermentadores laboratoriais ou industriais realizada em um meio adequado e sob condições que permitem que o polipeptídeo seja expressado e/ou isolado. O cultivo ocorre em um meio nutriente apropriado compreendendo fontes de carbono e de nitrogênio e sais inorgânicos, usando procedimentos conhecidos na arte. Meios adequados estão disponíveis em fornecedores comerciais ou podem ser preparados de acordo com composições publicadas (e.g., em catálogos da American Type Culture Collection). Como a enzima é secretada no meio nutriente, a enzima pode ser
recuperada diretamente do meio.
A enzima resultante pode ser recuperada por métodos conhecidos na arte. Por exemplo, a enzima pode ser recuperada por do meio nutriente por procedimentos convencionais incluindo, mas não limitados a, centrifugação, fütração, extração, secagem por pulverização, evaporação, ou precipitação.
Os polipeptídeos da presente invenção podem ser purificados por uma variedade de procedimentos conhecidos na arte incluindo, mas não limitados a, cromatografia (e.g., troca iônica, afinidade, hidrofóbica, cromatofocalização, e exclusão de tamanho), procedimentos eletroforéticos (e.g., focalização isoelétrica preparativa), solubilidade diferencial (e.g. precipitação com sulfato de amônio), SDS- PAGE, ou extração (veja, e.g., Protein Purification, J. -C. Janson e Lars Ryden, editors, VCH Publishers, Nova Iorque, 1989).
Os métodos da invenção também incluem o método TAST de WO 01/77315 Al em uma amostra da cepa Bacillus sp. P203 depositada sob o número de acesso 17419, i.e. por fusão de genes (e.g. de uma biblioteca de gene) do genoma da cepa Bacillus sp. P203 depositada sob o número de acesso DSM 17419 com um gene codificando um gene repórter sem sinal, tal como uma beta-lactamase, via uma etiqueta transposon, desenvolvimento de clones de célula hospedeira compreendendo os genes da cepa Bacillus sp. P203 DSM 17419 fundidos com um gene codificando um repórteres sem sinal, tal como uma beta-lactamase, via uma etiqueta transposon em um meio revelando a presença do repórter, tal como um meio contendo ampicilina, detecção de clones secretando o repórter e isolamento de gene e de polipeptídeo da cepa Bacillus sp. P203 depositada sob o número de acesso DSM 17419 compreendida naquele clone. Quando em desenvolvimento os clones de célula hospedeira compreendendo os genes da cepa Bacillus sp. P203 depositada sob o número de acesso 17419 fundido com um gene codificando um repórter sem sinal, tal como uma beta-lactamase, via uma etiqueta transposon em um meio revelando a presença do repórter, tal como um meio contendo ampicilina, apenas aqueles clones expressando e secretando o repórter (e.g. beta- lactamase) serão detectados (e.g. sobreviverão). Contudo o repórter apenas será secretado se o gene no qual o gene repórter está fundido tiver um promotor e sítio dè ligação de ribossomo intactos (i.e. um gene que é expressado pela célula para produzir um polipeptídeo em vida real), que pode ser reconhecido na cepa hospedeira, e se o repórter for traduzido de modo que o polipeptídeo sintetizado seja transportado através da membrana citoplasmática e dobrado corretamente. Conseqüentemente, quando se insere o gene fundido em uma célula hospedeira selecionada, aqueles clones, para os quais uma presença de repórter é detectada (e.g. resistência à ampicilina), conterão um gene da cepa Bacillus sp. P203 depositada sob o número de acesso DSM 17419, que codifica um polipeptídeo funcional secretado.
Plantas transgênicas
A presente invenção também se refere a uma planta transgênica, parte de planta transgênica, ou célula de planta transgênica que tem sido transformada com uma seqüência de nucleotídeos codificadora de uma enzima da invenção de modo a expressar e produzir a enzima. Em uma modalidade a planta poderia ser usada como hospedeira para a produção da enzima em quantidades recuperáveis. A enzima pode ser recuperada da planta ou parte de planta. Alternativamente, a planta ou parte de planta contendo a enzima recombinante pode ser usada como tal para melhorar a qualidade de um alimento ou de uma ração, e.g., melhorando o valor nutricional, a palatabilidade, e as propriedades reológicas, ou para destruir um fator antinutritivo. Em particular a planta ou as partes de planta expressando a enzima podem ser usadas como um material inicial melhorado para a produção de bio-etanol ou álcoois combustíveis.
A planta transgênica pode ser dicotiledônea (uma dicot) ou monocotiledônea (uma monocot). Exemplos de plantas monocot são gramíneas, tais como grama do prado (blue grass, Poa), capim de forragem tal como festuca, lolium, capim temperado, tal como Agrostis, e cereais, e.g., trigo, aveia, centeio, cevada, arroz, sorgo, e milho.
Exemplos, de plantas dicot são tabaco, legumes, tais como tremoços, batateiras, beterraba, ervilha, feijão e feijão-soja, e plantas crucíferas (família Brassicaceae), tal como couve-flor, colza, e o organismo modelo proximamente relacionado Arabidopsis thaliana.
Exemplos de partes de planta são caule, calo, folhas, raiz, frutas, sementes, e tubérculos. Também tecidos de planta específicos, tais como cloroplasto, apoplasto, mitocôndria, vacúolo, peroxissomos, e citoplasma são considerados como uma parte e planta. Ademais, qualquer célula de planta, seja qual for a origem, é considerada como sendo uma parte de planta.
Também estão incluídas dentro do escopo da presente invenção as progênies de tais plantas, partes de planta e células de planta.
A planta ou célula de planta transgênica expressando uma enzima da invenção pode ser construída de acordo com métodos conhecidos na arte. Resumidamente, a planta ou célula de planta é construída pela incorporação de um ou mais construtos de expressão codificando uma enzima da invenção no genoma hospedeiro da planta e propagação da planta ou célula de planta em uma planta ou célula de planta transgênica.
Convenientemente, o construto de expressão é um construto de ácido nucleico que compreende uma seqüência de nucleotídeos codificadora de uma enzima da presente invenção operacionalmente ligada com seqüências regulatórias apropriadas requeridas para expressão da seqüência de nucleotídeos na planta ou parte de planta de escolha. Ademais, o construto de expressão pode compreender um marcador selecionável útil para identificar células hospedeiras nas quais o construto de expressão tem sido integrado e seqüências de DNA necessárias para introdução do construto na planta em questão (as últimas dependem do método de introdução de DNA a ser usado).
A escolha de seqüências regulatórias, tais como seqüências de promotor e de terminador e opcionalmente seqüências de trânsito ou de sinal, é determinada, por exemplo, baseando-se quando, onde, e como a enzima é desejada para ser expressada. Por exemplo, a expressão do gene codificando uma enzima da invenção pode ser constitutiva ou induzível, ou pode ser específica de desenvolvimento, estágio ou tecido, e o produto de gene pode ser selecionado para uma parte de planta ou um tecido específica(o) tal como sementes ou folhas. Seqüências regulatórias são, por exemplo, descritas por Tague et ai, 1988, Plant Physiology 86: 506. Para expressão constitutiva, o promotor 35S-CaMV pode ser usado (Franck et al., 1980, Cell 21: 285-294). Promotores específicos de órgão podem ser, por exemplo, um promotor de tecidos de escoamento de armazenagem tais como sementes, tubérculos de batata, e frutas (Edwards & Coruzzi, 1990, Ann. Rev. Genet. 24: 275-303), ou de tecidos de escoamento metabólico tais como meristemas (Ito et al., 1994, Plant MoI. BioL 24: 863-878), um promotor específico de semente tal como o promotor de glutelina, de prolamina, de globulina, ou de albumina do arroz (Wu et al., 1998, Plant and Cell Physiology 39: 885-889), um promotor de Vicia faba de legumina B4 e o gene de proteína de semente desconhecido de Vicia faba (Conrad et al., 1998, Journal of Plant Physiology 152: 708-711), um promotor de uma proteína de corpo oleoso de semente (Chen et al., 1998, Plant and Cell Physiology 39: 935-941), o promotor de proteína de armazenagem napA de Brassica napus, ou qualquer outro promotor específico de semente conhecido na arte, e.g., como descrito em WO 91/14772. Ademais, o promotor pode ser um promotor específico de folha tal como o promotor rbcs de arroz e de tomateiro (Kyozuka et aL, 1993, Plant Physiology 102: 991- 1000, o promotor de gene de adenina metil-transferase de vírus de chlorella (Mitra e Higgins, 1994, Plant Molecular Biology 26: 85-93), ou o promotor de gene aldP do arroz (Kagaya et al., 1995, Molecular and General Genetics 248: 668-674), ou promotor induzível por ferimento tal como o promotor pin2 de batateira (Xu et aL, 1993, Plant Molecular Biology 22: 573-588).
Um elemento intensificador de promotor também pode ser usado para alcançar expressão maior da enzima da invenção na planta. Por exemplo, o elemento intensificador de promotor pode ser um íntron que está posicionado entre o promotor e a seqüência de nucleotídeos codificando uma enzima da presente invenção. Por exemplo, Xu et al., 1993, supra descrevem o uso de primeiro íntron do gene de actina 1 de arroz para intensificar expressão.
O gene marcador selecionável e quaisquer outras partes do construto de expressão podem ser escolhidos daqueles disponíveis na arte. O construto de ácido nucleico é incorporado no genoma da planta de acordo com técnicas convencionais conhecidas na arte, incluindo transformação mediada por Agrobacterium, transformação mediada por vírus, microinjeção, bombardeio de partículas, transformação biolística, e eletroporação (Gasser et al., 1990, Science 244: 1293; Potrykus, 1990, Bio/Technology 8: 535; Shimamoto et al., 1989, Nature 338: 274). Presentemente, transferência de gene mediada por Agrobacterium tumefaciens é o método de escolha para geração de dicots transgênicas (para uma revisão, veja Hooykas e Schilperoort, 1992, Plant Molecular Biology 19: 15-38). Contudo também pode ser usada para transformação de monocots, embora outros métodos de transformação sejam geralmente preferidos para estas plantas. Presentemente, o método de escolha para gerar monocots transgênicas é bombardeio de partículas (partículas microscópicas de ouro ou de tungstênio revestidas com ο DNA transformante) de caules embriônicos ou embriões em desenvolvimento (Christou, 1992, Plant Journal 2: 275-281; Shimamotoi1994, Current Opinion Biotechnology 5: 158-162; Vasil et ai., 1992, Bio/Technology 10: 667-674). Um método alternativo para transformação de monocots é baseado em transformação de protoplasto como descrito por Omirulleh et ai., 1993, Plant Molecular Biology 21: 415-428. Após transformação, os transformantes possuindo incorporado neles o construto de expressão são selecionados e regenerados em plantas inteiras de acordo com métodos bem estabelecidos na arte.
A presente invenção também se refere aos métodos para produzir uma enzima da invenção compreendendo (a) cultivar uma planta ou parte de planta transgênica compreendendo uma seqüência de nucleotídeos codificadora de uma enzima da invenção sob condições que conduzem à produção da enzima e (b) recuperar a enzima.
Composições compreendendo polipeptídeos e métodos para a sua preparação
A invenção proporciona uma composição compreendendo um polipeptídeo da invenção e preferivelmente um excipiente e um método para preparar uma tal composição compreendendo misturar o polipeptídeo da invenção com um excipiente. Em particular a composição compreende pelo menos dois polipeptídeos da invenção diferentes, preferivelmente pelo menos3, mais preferivelmente pelo menos 4, mais preferivelmente pelo menos 5, mais preferivelmente pelo menos 6. Mais a composição compreende todos os polipeptídeos secretados quando se fermenta uma amostra de cepa Bacillus sp. P203 depositada sob o número de acesso DSM 17419 ou um seu mutante na qual um ou mais genes têm sido deletados ou adicionados.
Em uma célula particular o polipeptídeo da invenção é o maior componente (polipeptídeo) da composição, e.g., uma composição de mono- componente. O excipiente neste contexto é para ser entendido como qualquer agente ou composto auxiliar usado para formular a composição e inclui solvente, veículos, estabilizadores e semelhantes.
A composição pode compreender adicionalmente uma ou mais enzimas adicionais, tais como uma aminopeptidase, amilase, carboidrase, carboxipeptidase, catalase, celulase, quitinase, cutinase, ciclodextrina glicosiltransferase, desoxirribonuclease, esterase, alfa-galactosidase, beta- galactosidase, glicoamilase, alfa-glicosidase, beta-glicosidase, haloperoxidase, invertase, Iacase5 lipase, manosidase, oxidase, enzima pectinolítica, peptidoglutaminase, peroxidase, fitase, polifenoloxidase, enzima proteolítica, ribonuclease, transglutaminase, ou xilanase.
As composições podem ser preparadas de acordo com métodos conhecidos na arte e podem estar na forma de uma composição líquida ou sólida. Por exemplo, a composição de enzima pode ser formulada usando métodos conhecidos na arte de formulação de polipeptídeos e/ou produtos farmacêuticos, e.g. em grânulos ou microgrânulos revestidos ou não revestidos. O polipeptídeo da invenção pode ser assim proporcionado na forma de um grânulo, preferivelmente um grânulo não-pulverulento, um líquido, em particular um líquido estabilizado, uma lama ou um polipeptídeo protegido. Para certas aplicações, imobilização do polipeptídeo sobre uma matriz sólida pode ser preferida.
O polipeptídeo a ser incluído na composição pode ser estabilizado de acordo com métodos conhecidos na arte e.g. por estabilização do polipeptídeo na composição pela adição de antioxidante ou agente redutor para limitar a oxidação do polipeptídeo ou pode ser estabilizada pela adição de polímeros tais como PVP, PVA, PEG ou outros polímeros adequados conhecidos como sendo benéficos para a estabilidade dos polipeptídeos em composições sólidas ou líquidas.
Em uma outra modalidade a composição da invenção é uma composição de detergente que, em adição ao polipeptídeo da invenção, compreende um tensoativo e opcionalmente compostos selecionados do grupo consistindo de reforçadores tal como zeólitas, agentes alvejantes tal como percarbonato, intensificadores de alvejamento tal como TAED ou NOBS, supressores de espumas, fragrâncias, etc.
Em uma outra modalidade a composição da invenção é uma composição de ração que em adição ao polipeptídeo da invenção compreende um produto de cereal ou grão.
Em uma outra modalidade a composição da invenção é uma composição de alimento tal como uma composição de farinha de padeiro, um produto fermentado, um suco de frutas, um produto de óleo ou lardo compreendendo o polipeptídeo da invenção.
Em uma outra modalidade a composição da invenção uma composição de polpa, que em adição ao polipeptídeo da invenção, compreende polpa.
Uso de polipeptídeos ou composições compreendendo-os
Em ainda outros aspectos a invenção proporciona o uso dos polipeptídeos ou polinucleotídeos da invenção ou de uma composição compreendendo citados polipeptídeos ou polinucleotídeos em várias aplicações, particularmente processos (técnicos) tais como processos realizados em indústria ou ambiente doméstico, aqui sob os propósitos de pesquisa comercial. Conseqüentemente a invenção inclui um processo compreendendo o emprego de um polipeptídeo da invenção ou de um polinucleotídeo da invenção em um processo industrial (técnico), de pesquisa ou doméstico.
Em uma modalidade o polipeptídeo ou a composição da invenção é usado(a) para limpeza de tecido celulósico.
Em outra modalidade o polipeptídeo ou a composição da invenção é usado(a) para preparar um aditivo de ração ou alimento.
Em ainda outra modalidade o polipeptídeo ou a composição da invenção é usado(a) para tratamento de materiais lignolíticos e de polpa. Em particular anidrase carbônica pode ser usada para fixação de carbono a partir de correntes de emissão de CO2, e.g. em reatores de membrana para separação de CO2 de correntes gasosas usando anidrase carbônica para aplicações em e.g. chaminés de gás de combustão de geração elétrica, gases de estufa, mas também aplicações não convencionais tais como cabinas de piloto e roupas espaciais de astronauta para manter o ar de respiração livre de níveis tóxicos de CO2. Em outra modalidade anidrases carbônicas podem ser úteis para promover purificação de água ou mineralização de meios aquosos pela produção de bicarbonato que pode complexar com íons dissolvidos nos meios aquosos, especialmente íons divalentes tal como cálcio, e auxiliar floculação ou precipitação destes íons dos meios aquosos. Tal precipitação pode em algumas aplicações ser usada para reduzir dureza da água, e em outras aplicações pode ter um benefício adicional de aumento de peso, volume, ou opacidade de certos produtos, tais como em processo de fabricação de papel, ou em remediação de solos e rochas.
Ademais anidrase carbônica também pode ser usada como alvos para o desenvolvimento de droga tais como inibidores de anidrase carbônica (e.g. derivados de sulfonamida). DESCRIÇÃO DE DETERGENTE
O polipeptídeo da invenção pode ser adicionado em e portanto se tornar um componente de uma composição de detergente.
A composição de detergente da invenção pode ser por exemplo formulada como uma composição de detergente para lavagem de roupas manual ou à máquina incluindo uma composição de aditivo para lavagem de roupas adequada para pré-tratamento de tecidos manchados e uma composição de amaciante de tecido adicionada no enxágüe, ou ser formulada como uma composição de detergente para uso em operações de limpeza de superfície dura doméstica em geral, ou ser formulada para operações de lavagem de louça manual ou à máquina.
Em um aspecto específico, a invenção proporciona um aditivo de detergente compreendendo o polipeptídeo da invenção. O aditivo de detergente bem como a composição de detergente podem compreender uma ou mais enzimas tais como uma protease, uma Iipasej uma cutinase, uma amilase, uma carboidrase, uma celulase, uma pectinase, uma mananase, uma arabinase, uma galactanase, uma xilanase, uma oxidase, e.g., a Iacase5 e/ou uma peroxidase.
Em geral as propriedades da(s) enzima(s) escolhida(s) devem ser compatíveis com o detergente selecionado, (i.e. pH-ótimo, compatibilidade com outros ingredientes enzimáticos e não-enzimáticos, etc.), e a(s) enzima(s) deve(m) estar presente(s) em quantidades efetivas.
Proteases: proteases adequadas incluem aquelas de origem animal, vegetal ou microbiana. Origem microbiana é preferida. Mutantes engenhados de proteína ou quimicamente modificados estão incluídos.
A protease pode ser uma serina protease ou uma metalo protease, preferivelmente uma protease microbiana ou uma protease semelhante à tripsina. Exemplos de proteases alcalinas são subtilisinas, especialmente aquelas derivadas de Bacillus, e.g., subtilisina Novo, subtilisina Carlsberg, subtilisina 309, subtilisina 147 e subtilisina 168 (descritas em WO89/06279). Exemplos de proteases semelhantes à tripsina são tripsina (e.g. de origem porcina ou bovina) e a protease de Fusarium descrita em WO89/06270 e WO 94/25583.
Exemplos de proteases úteis são as variantes descritas em WO92/19729, WO 98/20115, WO 98/20116, e WO 98/34946, especialmente as variantes com substituições em uma ou mais das seguintes posições: 27, 36,57, 76, 87, 97, 101, 104, 120, 123, 167, 170, 194, 206, 218, 222, 224, 235 e274.
Enzimas protease comercialmente disponíveis preferidas incluem Alcalase®, Savinase®, Primase®, Duralase®, Esperase®, e Kannase® (Novozymes AIS), Maxatase®, Maxacal®, Maxapem®, Properase®, Purafect®, Purafect OxP®, FN2®, e FN3® (Genencor International Inc.).
Lipases: lipases adequadas incluem aquelas de origem bacteriana ou fungica. Mutantes engenhados de proteína ou quimicamente modificados estão incluídos. Exemplos de lipases úteis incluem lipases de Humicola (sinônimo Thermomyces), e.g. de H. Ianuginosa (T. lanuginosus) como descrito em EP 258 068 e EP 305 216 ou de H. insolens como descrito em WO 96/13580, uma lipase de Pseudomonas5 e.g. de P. alcaligenes ou P. pseudoalcaligenes (EP 218 272), P. cepacia (EP 331 376), P. stutzeri (GB1,372,034), P. fluorescens, Pseudomonas sp. cepa SD 705 (WO 95/06720 e WO 96/27002), P. wisconsinensis (WO 96/12012), uma lipase de Bacillus, e.g. de B. subtilis (Dartois et al. (1993), Biochemica et Biophysica Acta,1131, 253-360), B. stearothermophilus (JP 64/744992) ou B. pumilus (WO91/16422).
Outros exemplos são variantes de lipase tais como aquelas descritas em WO 92/05249, WO 94/01541, EP 407 225, EP 260 105, WO95/35381, WO 96/00292, WO 95/30744, WO 94/25578, WO 95/14783, WO95/22615, WO 97/04079 e WO 97/07202.
Enzimas lipase comercialmente disponíveis preferidas incluem Lipolase™, Lipolase Ultra™ e Lipex (Novozymes A/S).
Amilases: amilases adequadas (alfa e/ou beta) incluem aquelas de origem bacteriana ou fúngica. Mutantes engenhados de proteína ou quimicamente modificados estão incluídos. Amilases incluem, por exemplo, alfa-amilases obtidas de Bacillus, e.g. uma cepa especial de B. licheniformis, descritos com mais detalhe em GB 1.296.839.
Exemplos de amilases úteis são as variantes descritas em WO94/02597, WO 94/18314, WO 96/23873, e WO 97/43424, especialmente as variantes com substituições em uma ou mais das seguintes posições: 15, 23, .105, 106, 124, 128, 133, 154, 156, 181, 188, 190, 197, 202, 208, 209, 243, .264, 304, 305, 391, 408, e 444. Amilases comercialmente disponíveis são Duramyl™, Termamyl™, Fungamyl™ e ΒΑΝ™ (Novozymes A/S), Rapidase™ e Purastar™ (de Genencor International Inc.).
Celulases: celulases adequadas incluem aquelas de origem fungica ou bacteriana. Mutantes engenhados de proteína ou quimicamente modificados estão incluídos. Celulases adequadas incluem celulases dos gêneros Bacillus, Pseudomonas, Humicola, Fusarium, Thielavia, Acremonium, e.g. como celulases fungicas produzidas de Humicola insolens, Myceliophthora thermophila e Fusarium oxysporum descritas em US .4,435,307, US 5,648,263, US 5,691,178, US 5,776,757 e WO 89/09259.
Celulases especialmente adequadas são celulases alcalinas ou neutras possuindo benefícios para o cuidado da cor. Exemplos de tais celulases são celulases descritas EP 0495 257, EP 0 531 372, WO 96/11262, WO 96/29397, WO 98/08940. Outros exemplos são variantes de celulase tais como aquelas descritas em WO 94/07998, EP 0 531 315, US 5,457,046, US .5,686,593, US 5,763,254, WO 95/24471, WO 98/12307 e PCT/DK98/00299.
Celulases comercialmente disponíveis incluem Celluzyme®, e Carezyme® (Novozymes), Clazinase®, e Puradax HA® (Genencor International Inc.), e KAC-5 OO(B) © (Kao Corporation).
Peroxidases/Oxidases: peroxidases/oxidases adequadas incluem aquelas de origem vegetal, bacteriana ou fungica. Mutantes engenhados de proteína ou quimicamente modificados estão incluídos. Exemplos de peroxidases úteis incluem peroxidases de Coprinus, e.g. de C. cinereus, e suas variantes aquelas descritas em WO 93/24618, WO 95/10602, e WO 98/15257.
Peroxidases comercialmente disponíveis incluem Guardzyme® (Novozymes A/S). A(s) enzima(s) pode(m) de detergente pode(m) ser incluída(s) em uma composição de detergente pela adição de aditivos separados contendo uma ou mais enzimas, ou pela adição de um aditivo combinado compreendendo todas estas enzimas. Um aditivo de detergente da invenção, i.e. um aditivo separado ou um aditivo combinado, pode ser formulado e.g. com um granulado, um líquido, uma lama, etc. Formulações de aditivo de detergente preferidas são granulados, em particular granulados não- pulverulentos, líquidos, em particular líquidos estabilizados, ou lamas.
Granulados não-pulverulentos podem ser produzidos, e.g., como descrito em US 4.106.991 e 4.661.452 e podem ser opcionalmente revestidos por métodos conhecidos na arte. Exemplos de materiais de revestimento ceroso são produtos de poli(óxido de etileno) (poli(etileno- glicol), PEG) com pesos moleculares médios de 1.000 a 20.000; nonil-fenóis etoxilados possuindo de 16 a 50 unidades de óxido de etileno; álcoois graxos etoxilados nos quais o álcool contém de 12 a 20 átomos de carbono e nos quais há 15 a 80 unidades de óxido de etileno; álcoois graxos; ácidos graxos; e mono- e di- e triglicerídeos de ácidos graxos. Exemplos de materiais de revestimento formadores de filme adequados para aplicação por técnicas de leito fluidizado são dados em GB 1483591. Preparações líquidas de enzima podem, por exemplo, ser estabilizadas pela adição de um poliol tal como propileno-glicol, um açúcar ou álcool de açúcar, ácido lático ou ácido bórico de acordo com métodos estabelecidos. Enzimas protegidas podem ser preparadas de acordo com o método descrito em EP 238,216.
A composição de detergente da invenção pode estar em qualquer forma conveniente, e.g., uma barra, um tablete, um pó, um grânulo, uma pasta ou um líquido. Um detergente líquido pode ser aquoso, tipicamente contendo até 70% de água e 0-30% de solvente orgânico, ou não-aquoso.
A composição de detergente compreende um ou mais tensoativos, que podem ser não-iônicos incluindo semi-polares e/ou aniônicos e/ou catiônicos e/ou zwiteriônicos. Os tensoativos estão tipicamente presentes em um nível de 0,1% a 60% em peso.
Quando incluído no mesmo o detergente normalmente conterá de cerca de 1% a cerca de 40% de um tensoativo aniônico tal como alquil- benzeno-sulfonato Iinear5 alfa-olefma-sulfonato, alquil-sulfato (sulfato de álcool graxo), álcool-etóxi-sulfato, alcano-sulfonato secundário, metil-éster de ácido alfa-sulfo-graxo, ácido alquil- ou alquenil-succínico ou sabão. Quando incluído no mesmo o detergente normalmente conterá de cerca de 0,2% a cerca de 40% de um tensoativo não-iônico tal como etoxilato de álcool, etoxilato de nonil-fenol, alquil-poliglicosídeo, alquil-dimetil-amina-óxido, monoetanol-amina de ácido graxo etoxilado, monoetanol-amida de ácido graxo, amida de ácido poli-hidróxi-alquil-graxo, ou N-acil N-alquil derivados de glicosamina ("glicamidas"). O detergente pode conter 0-65 % de um reforçador de detergente ou agente complexante tal como zeólita, difosfato, trifosfato, fosfonato, carbonato, citrato, ácido nitrilo-triacético, ácido etileno- diamino-tetraacético, ácido alquil- ou alquenil-succínico, silicatos solúveis ou silicatos em camadas (e.g. SKS-6 da Hoechst).
O detergente pode compreender um ou mais polímeros. Exemplos são carbóxi-metil-celulose, poli(vinil-pirrolidona), poli(etileno- glicol), poli(vinil-álcool), poli(vinilpiridina-N- oxido), poli(vinil-imidazol), policarboxilatos tais como poliacrilatos, copolímeros de ácido maleico/ácido acrílico e copolímero de metacrilato de laurila/ácido acrílico.
O detergente pode conter um sistema de alvejamento que pode compreender uma fonte de H2O2 tal como perborato ou percarbonato que pode estar combinada com um ativador de alvejante formador de perácido tal como tetraacetil-etileno-diamina ou nonanoil-óxi-benzeno-sulfonato. Alternativamente, o sistema alvejante pode compreender peróxi-ácidos de e.g. tipo amida, imida, ou sulfona.
A(s) enzima(s) da composição de detergente da invenção pode(m) ser estabilizada(s) usando agentes estabilizadores convencionais, e.g., um poliol tal como propileno-glicol ou glicerol, um açúcar ou álcool de açúcar, ácido lático, ácido bórico, ou um derivado de ácido bórico, e.g., um éster de borato aromático, ou um derivado de ácido fenil-borônico tal como ácido 4-formil-fenil-borônico, e a composição pode ser formulada como descrito em e.g. WO 92/19709 e WO 92/19708.
O detergente também pode conter outros ingredientes de detergente convencionais tais como e.g. condicionadores de tecido incluindo argilas, reforçadores de espuma, supressores de espuma, agentes anti- corrosão, agentes de suspensão de sujeira, agentes de anti-redeposição de sujeira, corantes, bactericidas, abrilhantadores ópticos, hidrótropos, inibidores de mancha, ou perfumes.
Atualmente é contemplado que nas composições de detergente qualquer enzima, em particular a enzima da invenção, pode ser adicionada em uma quantidade correspondendo a 0,01-100 mg de proteína enzima por litro de licor de lavagem, preferivelmente 0,05-5 mg de proteína enzima por litro de licor de lavagem, em particular 0,1-1 mg de proteína enzima por litro de licor de lavagem.
A enzima da invenção pode ser adicionalmente incorporada nas formulações de detergente descritas em WO 97/07202 que é por isto incorporada como referência. MICROORGANISMOS DEPOSITADOS
O seguinte microorganismo foi depositado pelo requerente de acordo com o Tratado de Budapeste sobre Reconhecimento Internacional de depósitos de Microorganismos para o Propósito de Procedimentos de Patente na Deutsche Sammlung von Mikroorganismen und Zellkulturen GmbH5 Mascheroder Weg lb, D-38124 Braunschweig, Alemanha:
.23 de junho de 2005; cepa Bacillus sp. P203; número de acesso em DSM: DSM 17419. EXEMPLOS
Exemplo 1: Identificação de polipeptídeos funcionais secretados pela
cepa Bacillus sp. P203, DSM 17419
A. Construção de biblioteca genômica
DNA cromossômico da cepa Bacillus sp. P203 (DSM 17419) foi preparado pelo uso de técnicas de biologia molecular padrão (Ausuble et ai. 1995 "Current protocols in molecular biology Publ: John Wiley and Sons). O DNA preparado foi parcialmente clivado com MboI e separado em um gradiente de sacarose por ultracentrifugação. Fragmentos de 3 a 10 quilobases foram extraídos, precipitados e ressuspensos em um tampão adequado.
Uma biblioteca genômica foi preparada pelo uso de Stratagene ZAP Express™ predigested Vetor kit e Stratagene ZAP Express ™predigested Gigapack ® cloning kit (BamH I pré-digerida) (Stratagene Inc., USA) seguindo as instruções/recomendações do vendedor. A biblioteca lambdaZAP resultante compreendeu l,25xl06 pfu dos quais 40.000 foram coletados para excisão de massa. As 10.000 colônias de E. coli resultantes foram reunidas e os plasmídeos foram preparados pelo uso de Qiagen Spin Mini prep kit (Qiagen, Alemanha). O eluato de aproximadamente 1 mL contendo o DNA plasmídeo foi precipitado em uma centrífuga com 1 parte em volume de acetato de Na de pH 5 e 2 partes em volume de etanol 96% a20.000 rpm a 4°C, lavado com etanol 70% (v/v), seco na temperatura ambiente e ressuspenso em 200 microlitros de tampão TE. A concentração de DNA do DNA de plasmídeo de coleção da biblioteca genômica de cepa Bacillus sp. P203 foi de 0,7 micrograma/microlitro.
B. Preparação e construção de transposon
A base lógica por trás da metodologia da Captação de Sinal Auxiliada por Transposon (TAST) como descrito em WO 01/77315 Al é a fusão de todos os genes dentro de um genoma selecionado com um gene codificando uma beta-lactamase sem sinal via uma etiqueta transposon. Conseqüentemente clones de célula hospedeira em desenvolvimento compreendendo os genes de um genoma fundido com um gene codificando uma beta-lactamase sem sinal via uma etiqueta transposon em um meio contendo ampicilina apenas aqueles clones expressando e secretando uma beta-lactamase sobreviverão. Contudo a beta-lactamase apenas será secretada se o gene ao qual o gene de beta-lactamase está fundido possuir um promotor e um sítio de ligação de ribossomo intactos (i.e. um gene que é expressado pela célula para produzir um polipeptídeo em vida real), que pode ser reconhecido na cepa hospedeira, e se a beta-lactamase for traduzida de modo que o polipeptídeo sintetizado seja transportado através da membrana citoplasmática e dobrado corretamente. Conseqüentemente, quando se insere o gene fundido em uma célula hospedeira selecionada, aqueles clones, que são resistentes à ampicilina contêm um gene que codifica um polipeptídeo funcional secretado.
Normalmente, quando se emprega a metodologia de TAST até
mesmo não é necessário expressar o gene inteiro. Quando se etiquetam os genes com um transposon, expressão da parte N-terminal dos genes como proteína de fusão mostra que os genes contêm seqüências de transcrição, de tradução e de secreção intactas. Conseqüentemente a expressão da parte N- terminal dos genes como fusão de proteína é normalmente considerada como suficiente para garantir expressão e secreção do gene inteiro.
Assim pode ser concluído que os genes obtidos pelo método de TAST realmente codificam polipeptídeos funcionais secretados. Construção de um transposon SigA4 contendo o gene repórter de beta- lactamase:
Seguindo as instruções de WO 01/77315 Al, a construção de um transposon contendo um gene de beta-lactamase sem sinal foi realizada usando técnicas de biologia molecular padrão. O gene de beta-lactamase sem sinal foi inicialmente amplificado por PCR a partir do vetor pUC19) usando uma polimerase revisora (Pfu Turbo, Stratagene, USA). O fragmento de PCR resultante continha os sítios de restrição NotI e EcoRI com o objetivo de auxiliar a clonagem. O plasmídeo pEntranceposon(Camr) contendo o Entranceposon e os marcadores de resistência a antibiótico CAT (codificando resistência a cloranfenicol no transposon) foi obtido de Finnzymes, OY (Espoo Finlância). O plasmídeo foi digerido com as enzimas de restrição NotI e EcoRIs purificado em gel e ligado com fragmento contendo beta-lactamase sem sinal. A ligação foi transformada em células DHlOB eletrocompetentes e o clone de E.coli contendo o plasmídeo recombinante com a beta-lactamase sem sinal foi identificado por análise de restrição e chamado de SigA2.
Para preparação de transposon, foi construído um derivado menor de SigA2, que foi faltante do gene bla codificando beta-lactamase: dois iniciadores de oligonucleotídeo SigA2NotU-P 5'-TCG CGA TCC GTT TTC GCA TTT ATC GTG AAA CGC T-3* (SEQ ID NO: 15) e SigA2NotD-P 5*- CCG CAA ACG CTG GTG AAA GTA AAA GAT GCT GAA-3' (SEQ ID NO: 16), que se ligam para iniciar e terminar o gene bla de SigA2 direcionando para foram usados para amplificar por PCR SigA2 sem o gene bla. Um amplificado de aproximadamente 3,6 kb gerado nesta reação de PCR foi relegado e transformado em uma cepa de E. coli adequada. Foi isolado um plasmídeo de 3,6 kb de um transformante que foi capaz de desenvolver sobre cloranfenicol LB mas não sobre ampicilina LB. Este plasmídeo manteve ambos os sítios BgIII e foi faltante de gene bla ativo e foi chamado de pSig4 (veja o pedido de patente PA 2004000010).
.60 microlitros de preparação de pSigA4 plasmídeo DNA com uma concentração de 0,3 micrograma/microlitro foram digeridos com BgIII e separados sobre um gel de agarose. A banda de SigA2 transposon DNA de 2 kb foi eluída e purificada pelo uso de "GFX™PCR, DNA e Gel Band Purification Kit" (Amersham Pharmacia Biotech Inc.USA) de acordo com as instruções do vendedor e eluída em 200 microlitros de tampão EB. C. Etiquetação de transposon
O transposon preparado de pSigA4 traz um gene bla 5'- truncado codificando uma beta-lactamase da qual o sinal de secreção foi removido. A beta-lactamase transmite resistência à ampicilina em E. coli apenas quando a proteína é secretada para o periplasma, enquanto que expressão citoplásmica de beta-lactamase não confere resistência à ampicilina. Sem uma seqüência de sinal, a enzima beta-lactamase não será transportada para o periplasma e portando o clone não desenvolverá sobre meio contendo ampicilina. O gene de beta-lactamase sem sinal estava contido no transposon em um tal modo que houve uma matriz de leitura aberta contínua entre a borda de transposon e a região codificadora de beta- lactamase. Nesta maneira o transposon modificado, quando transpõe para dentro de um gene codificando uma proteína que é secretada, poderia causar uma fusão em matriz com o gene alvo. Isto resultou em um produto de gene de fusão que é secretado para o periplasma de E. coli e transmite resistência à ampicilina. Se o transposon integrado até mesmo em matriz para dentro de um gene codificando uma proteína não-secretada, o respectivo hospedeiro não se tornará resistente à ampicilina.
Para a etiquetação de transposon in vitro da biblioteca de cepa Bacillus sp. P203, 250 nanogramas de transposon SigA2 foram misturados com 2,5 microgramas da concentração de DNA plasmídeo de coleção da biblioteca genômica de cepa Bacillus sp. P203, 2,5 microlitros de Finn-zymes MuA Transposase (0,22 micrograma/microlitro) e 10 microlitros de 5x tampão de Finn-zymes OY5 Espoo, Finlândia) em um volume total de 50 microlitros e incubados a 30°C por 3 h e seguido por inativação por calor a75°C por 10 min. O DNA foi precipitado pela adição de 5 microlitros acetato de Na 3M de pH 5 e 110 microlitros de etanol 96%, incubado a -20°C por 20 h e centrifugado por 30 min a 20.000 rpm. A pelota foi lavada com etanol70%, seca e ressuspensa em 10 microlitros de tampão TE. D. Transformação e seleção
Células de E. coli DHlOB eletrocompetentes foram transformadas por eletroporação em um dispositivo Biorad Gene Pulse (50 pF, 25 mAmp, 1,8 kV) com 5 microlitros da coleção de plasmídeo etiquetado com transposon, misturados com 1 mL de meio SOC, pré-incubadas por 1 h a37°C e plaqueadas sobre LB com 25 microlitros/mililitro de ampicilina, 50 microlitros/mililitro de canamicina, 10 microlitros/mililitro de cloranfenicol e incubadas por 2-3 dias a 30°C. Dos transformantes resistentes 1152 colônias foram selecionadas. Modelos para seqüenciamento de DNA da biblioteca captada de sinal foram preparados por amplifícação de ciclo rolante usando o Templyphi 500 kit (Amersham Biosciences) de acordo com as instruções do fabricante.
E. Preparação e seqüenciamento de plasmídeo
Aproximadamente 500 plasmídeos etiquetados com transposon foram seqüenciados com o iniciador A2up AGCGTTTGCGGCCGCGATCC (SEQ ID NO: 13) que leu a montante no sentido do gene etiquetado com transposon, e, em uma segunda reação, com iniciador B TTATTCGGTCGAAAAGGATCC (SEQ ID NO: 14) que leu a jusante no sentido do gene etiquetado com transposon. F. Anotação e montagem de seqüência
As seqüências obtidas foram montadas em contíguos pelo uso do programa PhredPhrap (Brent Ewing, LaDeana Hillier, Michael C. Wendl, e Phil Green, "Base-calling of automated sequencer traces using phred I. Accuracy assessment" (1998) Genome Research 8:175-185; Brent Ewing e Phil Green, "Base-calling of automated sequencer traces using phred II. Error probabilities" (1998) Genome Research 8:186-194). Os contíguos obtidos foram subseqüentemente comparados com seqüências disponíveis em bancos de dados de seqüências de proteína e de DNA públicos padrão pelo uso do programa BLASTX 2.0al9MP-WashU [14-Jul-1998] [Build linux-x86 .18:51:44 30- Jul-I 998] (Gish5 Warren (1994-1997). Ν; Gish, Warren e David J. States (1993). "Identification of protein coding regions by database similarity search". Nat. Genet. 3:266-72). As seqüências obtidas foram genes funcionais que codificaram polipeptídeos funcionais e intactos, porque foram obtidos como clones resistentes à ampicilina como explicado supra. Exemplo 2: Determinação de função por homologia.
As funções dos polipeptídeos SEQ ID NO: 2, SEQ ID NO: 4, SEQ ID NO: 6, SEQ ID NO: 8, SEQ ID NO: 10 e SEQ ID NO: 12 foram anotadas por comparação de seqüências com genes ou polipeptídeos de função conhecida. Os polipeptídeos da invenção foram comparados com uma lista de seqüências proximamente relacionadas dos bancos de dados públicos e de casa de contíguos. Os contíguos foram subseqüentemente comparados com seqüências disponíveis em bancos de dados de seqüências de proteína e de DNA públicos e padrão pelo uso do programa BLASTX 2.0al9MP- WashU [ 14-Jul-1998]. Uma análise cuidadosa dos alinhamentos de seqüências de SEQ ID NO: 2, SEQ ID NO: 4, SEQ ID NO: 6, SEQ ID NO: 8, SEQ ID NO: 10 e SEQ ID NO: 12 com suas seqüências relacionadas mais próximas com função conhecida de outros bancos de dados tornou possível predizer a função destes polipeptídeos tendo por base o grau de identidade de aminoácido. Até mesmo quando a identidade de aminoácido total esteve abaixo de 40%, que normalmente torna difícil fazer uma predição boa, fomos capazes de predizer a função de SEQ ID NO: 2, SEQ ID NO: 4, SEQ ID NO: 6, SEQ ID NO: 8, SEQ ID NO: 10 e SEQ ID NO: 12 pelas análise e interpretação cuidadosas dos resíduos de aminoácido nos sítios catalíticos ou em regiões importantes das seqüências de polipeptídeo. Se os aminoácidos do sítio catalítico de seqüências conhecidas também estavam presentes no polipeptídeo da invenção, combinados com uma identidade de aminoácido total suficiente, foi concluído que o polipeptídeo de Bacillus sp. P203 (DSM 17419) tinha a mesma função que a da seqüência conhecida. Exemplo 3: Preparação de polipeptídeos de SEQ ID NO: 2, SEQ ID NO:4, SEQID NO: 6, SEQID NO: 8, SEQID NO: 10 e SEQ ID NO:12.
Para preparar os polipeptídeos de SEQ ID NO: 2, SEQ ID NO:4, SEQ ID NO: 6, SEQ ID NO: 8, SEQ ID NO: 10 e SEQ ID NO: 12, os genes compreendidos em SEQ ID NO: 1, SEQ ID NO: 3, SEQ ID NO: 5, SEQ ID NO: 7, SEQ ID NO: 9 e SEQ ID NO: 11 codificando estes polipeptídeos são expressados pela fusão do DNA codificando a matriz de leitura aberta no DNA um promotor, sítio de ligação de ribossomo e terminador adequados para expressão de genes em uma cepa hospedeira apropriada, por exemplo Escherichia coli, Bacillus subtilis, Bacillus licheniformis ou Bacillus clausii ou um derivado de cepa Bacillus sp. P203. O promotor pode ser quer um promotor induzível quer um promotor constitutivo. Quaisquer seqüências de sinal podem ser trocadas com um peptídeo de sinal adequado de outra bactéria. O construto de expressão pode ser quer parte de um plasmídeo ou de um DNA linear. Pode ser integrado no cromossomo da cepa hospedeira por recombinação ou pode estar presente na célula hospedeira em um plasmídeo. Então as células transformadas trazendo o gene de interesse são desenvolvidas em um meio adequado no volume desejado. Se um promotor induzível for usado, a expressão de gene é iniciada pela adição de indutor. De outro modo nenhum indutor é necessário e as células serão desenvolvidas até que seja produzida uma quantidade adequada de proteína do gene de interesse. Então a cultura é colhida e as proteínas são recuperadas por métodos padrão.
Exemplo 4: PROTEASE
O fluido de cultura ou um lisado de células de uma cepa
hospedeira sintetizando e secretando uma serina protease em um tampão adequado pode ser ensaiado para aquela atividade. Um volume adequado de uma tal amostra é pontualmente aplicada sobre placas de agarose que contêm o substrato cromogênico insolúvel AZCL-caseína (Megazyme ™) e um tampão adequado em pH apropriado. A placa é incubada por um tempo apropriado, e.g. um dia, em uma temperatura adequada, e.g. 55°C. A atividade é visível como halos azuis ao redor dos pontos. Como uma alternativa à AZCL-caseína, caseína não marcada pode ser usada. Sobre caseína não marcada pontualmente aplicadas sobre placas de agarose, zonas claras formam na presença de uma serina protease. Exemplo 5: RAMNOGALACTURONANA LIASE.
Ramnogalacturonana é um polissacarídeo maior encontrado nas regiões ramificadas de pectina. Ramnogalacturonana liase (PL4 e PLl 1) e ramnogalacturonase (GH28) são enzimas que podem degradar a estrutura principal de ramnogalacturonana de pectina mas não possuem especificidade para homoga-lacturonana. Um volume adequado do fluido de cultura ou de um lisado celular de uma cepa hospedeira sintetizando e secretando uma ramnogalacturonana liase em um tampão adequado em uma temperatura apropriada, e.g. 30°C é usado para medir a atividade. Um volume adequado de uma tal amostra é pontualmente aplicado sobre placas de agarose que contêm o substrato cromogênico insolúvel AZCL- ramnogalacturonana I (Megazyme). A placa é incubada por um tempo apropriado, e.g. um dia em uma temperatura apropriada, e.g. 30°C. A atividade é visível como halos azuis ao redor de pontos. Como uma alternativa AZCL-galactana ou AZCL-arabinada desramificada ou galactana péctica de batata não marcada ou ramnogalacturonana é adicionada nas placas de ágar ou como solução de substrato no ensaio de enzima. Atividade de enzima pode ser detectada como halos azuis ao redor de pontos zonas claras ou por métodos publicados por Mutter, M. et al., "Characterization of Recombinant Rhamnogalacturonan alpha-L- Rhamnopyranosyl-(l,4)-alpha-D-Galactopyranosyluronide Lyase of
Aspergillus aculeatus", Plant Physiol. (1998) 117: 141-152 e de McKie, V. et al., "A new family of rhamnogalacturonan liases contains a enzyme that binds to cellulose", Biochem. J. (2001) 355, 167-177.
Exemplo 6: XILANASE
Xilanases são enzimas endo-atuantes que clivam polímeros de beta-l,4-xilose. Para a medição de endo-1,4-beta-D-xilanase em preparações de enzima o Xylanase Assay Kit (Megazyme) pode ser usado. Alternativamente, um volume adequado do fluido de cultura ou de um lisado celular de uma cepa hospedeira sintetizando e secretando uma xilanase em um tampão adequado em uma temperatura apropriada, e.g. 3 O0C é usado para medir a atividade Um volume apropriado de uma tal amostra é pontualmente aplicado sobre placas de agarose que contém o substrato cromogênico insolúvel AZCL-xilana ou AZCL-arabinoxilana (Megazyme). A placa é incubada por um tempo apropriado, e.g. um dia em uma temperatura adequada, e.g. 30°C. A atividade é visível como halos azuis ao redor de pontos.
Exemplo 7: GALACTANASE
Proteínas deste tipo são hemicelulases que podem hidrolisar xilo-oligossacarídeos curtos, e.g. arabinana. O fluido de cultura ou um lisado de célula de uma cepa hospedeira sintetizando ou secretando uma xilosidase em um tampão adequado pode ser ensaiado para aquela atividade. Um volume adequado do fluido de cultura ou de um lisado de célula de uma cepa hospedeira sintetizando e secretando uma xilanase em um tampão apropriado em uma temperatura adequada, e.g. 30°C é usado para medir a atividade. Um volume apropriado de uma tal amostra é pontualmente aplicado sobre placas de agarose que contém o substrato cromogênico insolúvel AZCL-arabinana (Megazyme). A placa é incubada por um tempo apropriado, e.g. um dia em uma temperatura adequada, e.g. 30°C. A atividade é visível como halos azuis ao redor de pontos..
Exemplo 8: Expressão de anidrase carbônica de cepa Bacillus sp. P203 em B. subtilis O peptídeo de sinal da alfa-amilase de B. Iicheniformis (AmyL) foi fundido por PCR em matriz no gene codificando a anidrase carbônica (SEQ ID NO: 3). O DNA codificando a seqüência codificadora resultante foi integrado por recombinação homóloga no genoma de cepa hospedeira Bacillus subtilis. O construto de gene foi expressado sob o controle de um sistema de promotor triplo (como descrito em WO 99/43835), consistindo dos promotores de gene de alfa-amilase de Bacillus licheniformis (amyL), gene de alfa-amilase de Bacillus amyloliquefaciens (amyQ), e promotor crylIIA de Bacillus thuringiensis incluindo seqüência estabilizadora. O gene codificador de Cloranfenicol acetil-transferase foi usado como marcador. (Descrito e.g em Diderichsen et ai, "A useful cloning vetor for Bacillus subtilis". Plasmid, 30, p. 312, 1993).
Transformantes resistentes a cloranfenicol foram analisados por seqüenciamento de DNA para verificar a seqüência de DNA correta do construto. Um tal clone foi selecionado.
Fermentações de uma clone de expressão de anidrase carbônica (SEQ ID NO: 4) foram realizadas em uma mesa agitadora rotativa em frascos Erlenmeyer de 1 L com defletores cada um contendo 400 mL de meio LB suplementado com 34 mg/l de cloranfenicol. O clone foi fermentado por 3 dias a 25-30°C. Uma atividade de anidrase carbônica foi determinada de acordo com Wilbur, K.M. e Anderson, N. G., "Electrometric and colorimetric determination of carbonic anhydrase", J Biol Chem5 1948, 176, p.147-154. Alternativamente, a atividade de anidrase carbônica pode ser medida como atividade de esterase com para-nitro-fenol-acetato como substrato de acordo com Chirica, L. C. et al., "Cloning, expression and some properties of alpha- carbonic anhydrase from Helicobacter pylori", Biochim. Biophys. Acta, 2001,1544, p. 55-63. Um ensaio padrão continha 900 microlitros de PNPA, 10 microlitros de Tris 300 mM pH 7,5 e 90 microlitros de solução de proteína anidrase carbônica. Após uma pré-incubação por 5 min, a enzima foi adicionada na mistura de tampão PNPA e o aumento em absorbância (devido à hidrólise do substrato e à liberação de p-nitro-fenol) a 348 nm foi monitorado fotometricamente em uma cubeta de quartzo durante um período de 10 min. Como um controle positivo para ambos os ensaios de atividade, pode ser usada uma solução de anidrase carbônica bovina (Calbiochem, 1 mg por mL).
Exemplo 9: Expressão de anidrase carbônica de cepa Baciilus sp. P203 em E. coli
Alternativamente ao exemplo 8, uma anidrase carbônica pode ser expressada em E. coli. Plasmídeo pEG131377-9 foi gerado pela ligação do vetor pGEM-T (Promega) com um produto de PCR anidrase carbônica (SEQ NO. 3) amplificado de DNA genômico de Bacillus sp. P203 (extraído com Qiagen Genomic DNA Kit, 19060) usando iniciadores específicos de gene BOCAfwd (5' TAGTCCGTACATATGAGAAAAACAA 31) (SEQ ID NO:17) e BOCArev (5' TTCAAAGCTTATAGTGAAATCCAACT 31) (SEQ ID NO: 18). O plasmídeo foi usado como modelo para geração de plasmídeo pETBlueCA. O plasmídeo pETBlueCA para expressão de uma anidrase carbônica em E. coli foi construído por amplificação por PCR com os iniciadores específicos de gene pQECAfwd (5' ATC C G CATG CTGAG AAAAACAAA 31) (SEQ ID NO: 19) e pQE-CArev (5' AATTAAG CTTAATAGTGAAATCCAACT 31) (SEQ ID NO: 20) do modelo de plasmídeo pEGl 31377-9 seguido por uma ligação do produto de PCR com o linear pETBlue-1 AccepTor™ vetor system (Novagen) de acordo com as instruções do fabricante. Plasmídeos foram transformados em células competentes de E. coli NovaBlue Singles™ (Novagen) para triagem azul- branca. Insertos de três plasmídeos foram verificados por seqüenciamento de DNA usando iniciadores pET-BlueUP, pETB IueDOWN (Novagen, iniciadores flanqueando a região de inserto) e iniciador CAmit- SEQrev (51 CACTTG GTGAATG GAAATG 3') (SEQ ID NO: 21). O plasmídeo de clone pETBlueCA no. 8 (pETBlueCA8) foi verificado correto e foi transformado em células competentes de E. coli Tuner(DE3)pLacl para sobre-expressão de anidrase carbônica de Bacillus sp. P203 sob controle do promotor Iac
(induzível por IPTG). Exemplo 10: Purificação e caracterização de anidrase carbônica (SEQ ID
NO: 4) de cepa Bacillus sp. P203
Purificação
Caldo de cultura foi centrifugado (lO.OOOg, 15 minutos) e os sobrenadantes foram cuidadosamente decantados dos precipitados. O sobrenadante de cultura reunido foi concentrado para 1/10 do volume por filtração de fluxo cruzado (corte de MW de 10.000 Da) e purificado em uma coluna de cromatografia específica para anidrase carbônica. Para purificação de anidrase carbônica recombinante de Bacillus plankortiensis, uma coluna de afinidade elevadamente seletiva foi preparada. Em princípio, a coluna de afinidade foi preparada como descrito antes (Khalifah5 R.G. et ai., aCarbon-13 nuclear magnetic resonance probe of active-site ionizations in human carbonic anhydrase", B. Biochem. 1977, 16, p. 2241-7) com as seguintes modificações: O ligante sulfonamida 4-amino-metil-benzeno-sulfonamida (0,2 g, Sigma) foi dissolvido em 12 mL de tampão de copulação (NaHCO3 0,1 M, pH 8, NaCl 0,5 Μ). 1 g de CH Sepharose 4B™ ativado (Amersham Biosciences) foi dissolvido em aproximadamente 20 mL de HCl 1 mM e intensamente lavado com 250 mL de HCl 1 mM sobre um filtro de vidro sinterizado. O gel foi eluído com o filtro com 6 mL de HCl 1 mM e deu o ligante dissolvido em um tubo Falcon de 50 mL. A mistura foi cuidadosamente girada extremidade-sobre-extremidade por 1 h na temperatura ambiente. Para remover ligante em excesso, o gel foi lavado com 250 mL de tampão de copulação. Bloqueio de quaisquer grupos ativos restantes foi realizado por lavagem do gel com Tris-HCl 0,1 M, pH 8 e incubação naquele tampão por 1 hora. Três ciclos de a) 250 mL de Tris 0,1 M, pH 8, NaCl 0,5 M e b) acetato de sódio O5I Mj pH 4, NaCl 0,5 M foram usados para lavagem do gel após bloqueio. O gel foi transferido para um béquer e extensivamente lavado com tampão de carregamento D (Na2SO4 0,25 M, Tris 25 mM pH 8,3) antes do uso.
.5 mL de meio de afinidade foram adicionados quer em 50 mL de caldo de cultura concentrado de exemplo no. 8 quer no extrato de proteína bruta livre de células de exemplo no. 9. A suspensão foi suavemente agitada na temperatura ambiente por uma hora e então derramada em uma coluna deixando a gravidade rechear a coluna. A coluna foi lavada intensivamente com 10 volumes de volume de carregamento com tampão D até proteína não ser mais detectável. Eluição de anidrase carbônica foi iniciada por fechamento da saída e pela adição de 10 mL de tampão de eluição E (KSCN 0,4 M, Tris 25 mM pH 8,3). Após 10 min de incubação com agitação moderada da coluna, frações de 500 microlitros foram coletadas. As frações contendo atividade de anidrase carbônica foram reunidas após a primeira fração ativa (normalmente frações 4-10). As frações reunidas foram retamponadas intensivamente em um dispositivo Centricon (Millipore, a 4.000xg) com um corte de MW de 10.000 Da usando 10 volumes de tampão de armazenagem F de anidrase carbônica (Tris-HCl 100 mM pH 8,0, sulfato de zinco 50 micromolar). Alíquotas de anidrase carbônica purificada foram armazenadas a -20°C até uso posterior. A anidrase carbônica recombinante purificada mostrou uma única banda de proteína sobre geles de poliacrilamida SDS. Caracterização
A atividade de anidrase carbônica foi determinada de acordo com Wilbur, K.M. e Anderson, N. G., "Electrometric and colorimetric determination of carbonic anhydrase", J Biol Chem, 1948, 176, p.147-154. A anidrase carbônica recombinante purificada foi testada para estabilidade de temperatura a 4-60°C por 1 e 17 h. Foi verificado que a proteína é estável a 4°C em tampão F por uma semana com perda mínima de atividade (97±4% da atividade original) e na temperatura ambiente (20 C, 95±4%). Não foi detectada perda de atividade (99±4%) após armazenagem da proteína a -20°C por uma semana em tampão F. A estabilidade de anidrase carbônica rapidamente diminuiu em temperaturas acima de 37°C (veja figura 2). Foi verificado que armazenagem de anidrase carbônica recombinante em tampão F suplementado com ditiotreitol (DTT) 1 mM estabiliza a enzima. Estudos de inibição de anidrase carbônica recombinante foram realizados com íons azida e inibidor de anidrase carbônica específico acetazolamida (Sigma). Os valores de IC50 foram de 500 micromolar para azida e 0,09 micromolar para acetazolamida, inibição completa foi observada na presença de acetazolamida 7,5 micromolar (veja figura 3).
Inibição de anidrase carbônica por íons de metal divalentes e trivalentes, azida e outros reagentes comumente usados em ciência de proteína (veja figura 4).
Os seguintes inibidores foram usados:
Tabela 1: Inibidores
<table>table see original document page 68</column></row><table>
A enzima foi pré-incubada com 1 mM de substâncias por 1 h sobre gelo em um volume total de 50 microlitros antes de testar a atividade com 10 microlitros da mistura com o método de Wilbur e Andersonj 1948. O controle sem aditivos (água) foi ajustado em atividade de 100%. O detergente Triton X 100 e os íons Fe3+ e Cr2+ (marcados com asteriscos em tabela 1) alteraram o ensaio quando em concentração dada de 1 mM no volume de ensaio total. Em vez disso é dada atividade com concentração de 25 micromolar.
Exemplo 11: Expressão de galactanase.
O peptídeo de sinal de alfa-amilase de B. Iicheniformis
(AmyL) foi fundida por PCR em matriz com o gene codificando a galactanase (SEQ ID NO: 12). O DNA codificando a seqüência codificadora resultante foi integrado por recombinação homóloga no genoma da cepa hospedeira Bacillus subtilis. O construto de gene foi expressado sob o controle de um sistema de promotor triplo (como descrito em WO 99/43835), consistindo de promotores de gene de alfa-amilase de Bacillus licheniformis e (amyL), gene de alfa-amilase de Bacillus amyloliquefaciens amyQ), e promotor crylIIA de BaciUus thuringiensis incluindo a seqüência estabilizadora. O gene codificador para cloranfenicol acetil-transferase foi usado como marcador. (Descrito e.g em Diderichsen et ai., "A useful cloning vetor for Bacillus subtilis". Plasmid, 30, p. 312, 1993).
Transformantes resistentes a cloranfenicol foram analisados para seqüenciamento de DNA para verificar a seqüência de DNA. Um tal clone foi selecionado. Fermentações do clone de expressão de galactanase (SEQ ID NO: 12) foi realizada em uma mesa agitadora rotativa em frascos Erlenmeyer de 500 mL com defletores cada um contendo 100 mL de meio LB suplementado com 34 mg/l de cloranfenicol. O clone foi fermentado por 3 dias a 30°C. A atividade foi determinada com OPNG como substrato.
Exemplo 12: Verificação de atividade de galactanase de cepa Bacillus sp.
P203 Ensaio:
.50 microlitros de sobrenadante livre de células de exemplo no. 17 foram adicionados em 750 microlitros de uma solução 4,5 mM de orto- nitro-fenil-galactopiranosídeo (ONPG)s em tampão fosfato 50 mM de pH 7,6. A mistura foi incubada a 40°C por 15 min e a reação foi interrompida pela adição de 300 microlitros de carbonato de sódiol M. As soluções foram centrifugadas a 13.000 rpm antes das medições espectrométricas e diluídas com água se necessário. A absorbância de o-nitro-fenol é medida opticamente a 420 nm. T .TSTAfiFM DE SEQÜÊNCIAS
<110> Novozymes A/S
<1.20> Polqieptideos da cepa Bacillus sp. 203
«130> 10S07.204-WQ
<160> 21
<170> PatentIn versão 3.3
c2Í0> 1
<2ll> 1053
<212> Dm
<213> Bacillus sp. P 203
<220>
<221> CDS <222> « · {1953)
<223> serinaprotease
<220>
<221> sig^peptídeo <222> (1) , . (111)
<22 O >
<221> mafc_ peptídeo <222> (112)♦. (1953)
<400> 1
atg aat asa caa aat aça caa tat ttt gag agg age gct gcg atg aat 48
Met Asn Lys Qln Asn Thr Gln Tyr Phe Glu Arg Ser Ala Ala Net Asti -35 -30 -25
ate gafe aaa aag aaa caa aaa ccg tgg aac gfca atg gta tta acc gea 96
Ile Asp Lys Lys Lys Oln Lys Pro Trp Asn Val Net Val Leu Hir Ala
-20 -15 -10
ctg toa aca agt ttg gta ttc gga ggg ttt ggc tat tet cca caa caa Leu Ser Thr Ser Leu Val Phe Gly Gly Phe Gly Tyr Ser Pro Gln Gln -S -11 5 10
gta tca gct gaa aca aaa act ggt tca etc aat cta toa gat gac ate
Val Ser Ala Glu Thr Lys Thr Gly Ser Leu Asn Leu Ser Asp Asp Ile
Lys Leu Asp Ser Thr Glu Thr Val Ser Val Ile Val Glu Leu Glu Glu
tet ccc gag cat tta gcg att gea gaa gea ett gaa aaa ggt gag gat Ser Pro Glu His Leu Ala Ile Ala Glu Ala Leu Glu Lys Gly GXu Asp
cta aca gaa tcg caa gea aaa gea aag gta gaa gcg tet cag gat tca Leu Thr Glu Ser Gln Ala Lys Ala Lys Val Glu Ala Ser Gln Asp Ser 60 65 70 75
336 ttt gag gaa gac tta tct act aaa caa tca tct tat aca atfc aca cat Phe Glu Glu Asp Leu Ser Thr
acg tat caa tcc gtt ttt aat ggt tfcfc acc att gaa tta cct gca aat Tyr Gln Ser Val Phe Asa Qly Phe Thr Ile Glu Leu Pro Ala Asn
caa tta gaa gca ctt tca gag att gac ggt gtfc aaa acc
Ile Asp Gly Val Lye Thr IlS 120
aac gaa gag gtt caa etc att gat cct gta tta gaa gaa agt gtt cta Asn Glu 01 u Val Gln Leu Ile Asp Pro Val Leu Glu Glu Ser Val Leu 125 130 135
gaa gcg att gaa ccc tat atg gca gat agt gtg cct tat cta
Glu Ala Ile Glu Pro Tyr Met Ala Asp Ser Val Pro Tyr Leu Gly
145 150 155
gtt gat cga ctc cat att gat ggg ate act ggt gaa ggg gta aaa gtc
Val Asp Arg Leu Hie Ile Asp Gly lie Thr Gly Glu Gly Val Lys Val
160 ISS 17 0
gtc att gat act ggt gtt gat tac aca cac cct gac ctt aca gca Gly Val Ile Asp Thr Gly Val Asp Tyr Thr Hls Pro Aep Leu Thr Ala
gaa aca acc tac gat gat tgg tta gca tca gga atg ccg gaa ttt aat Glu Thr Thr Tyr Asp Asp Trp Leu Ala Ser Gly Ket Pro Glu Phe Asa 205 210 215
ate aat gga agt tcg tat tat aca tca cat ggt aca cat gtt gct ggc Ile Asa Gly Ser Ser Tyr Tyr Thr Ser His Gly Thr His Val Ala Gly
220 225
acc att gct gga caa ggt gat aac gaa tct gat ttt gcc aca aca ggt Thr Ile Ala Gly Gln Gly Agp Asa Glu Ser Asp Phe Ala Thr Thr Gly 240 345 250
att gca cct gac gct gac att tat tcc tat cga gta tta ggt cct tat Ile Ala Pro Asp Ala Asp Ile Tyr Ser Tyr Arg Val Leu Gly Pro Tyr 255 260 265
gga tca ggt aca aca gca aat gta ctt ggt ggt att gaa ctt tct gtt Gly Ser Gly Thr Thr Ala Asn Val Leu Gly Gly Ile Glu Leu Ser Val 270 275 290
gat oca cta tac cct act agt gtt gca gfca aat aat gct gtt tta
gcc tac aaa ggt gga tat gac ttt gtc gat aat gat gat gat gca caa 720
Ala Tyr Lys Gly Gly Tyr Aep Phe Val Asp Asn Asp Asp Asp Ala Gln gtt acg gct gtt gtt tca gca ggt aac agt ggt aga gat ggt ctt Gly Val Thr Ala Val Val Ser Ala Gly Asn Ser Qly Arg Asp Gly Leu 320 325
aca ctt ggfc tca cca ggfc acc tct cca ctt gcc att acg Tyr Tbr Leu Gly Ser Pro Gly Thr Ser Pro Leu Ala Ile Thr Val Gly 335 340 345
gcc aac gat gtg ccg tta gtg ttc act gac fcfct act ggc tat ctt gat Ala Asn Asp Val Pro Leu Val Phe Thr Asp Phe Thr Gly Tyr Leu Asp
350 355
gat ttt gat gaa tta gaa gcg ggt gaa tat ggc att gtt tat gcc ggc Asp Phe Aap Glu Leu Glu Ala Gly Glu Tyr GIy Ile Val Tyr Ala Gly
ctt ggt tca gtt gca gag ttt aat cag gtt gat gca gaa gga aaa gtt Leu Gly Ser Val Ala Gln Phe Asn Gln Val Aep Ala Glu Gly Lys Val
400 405
gct aaa gcc gct ggt gca gaa gcg att att ate tat aac aac ata ccg Ala Lys Ala Ala Gly Ala Glu Ala Ile Ile Ile Tyr As η Asn Ile Prc
gct gga cac ate cct aac tac ttt gga gaa ggc gtg aat ttt gtc His IIg Pro Asa Tyr Phe Gly Olu
att acc gat gaa age tca ttc tcg ttt ggt gac cga age gaa tca caa He Thr Asp Qlu Ser Ser Phe ser Phe Gly Asp Arg Ser Glu Smt Gln 480 485
act cca ggt ggt gta cta gct gat ttc agt tct cgt ggt cca gtt aat Thr Pro Gly Gly Val Leu Ala Asp Phe Ser Ser Arg Gly Pro Val Asn
gaa tca ttt gca att aaa cct gaa gta agt gca cca ggt gtc aat acg Pbe Ala Ile Lys Pro Glu Val ser Ala
tta tca cct gtt cct act tat atg aac ggt cct gac tat att ggc Leu Ser Pro Val Pro Thr Tyr Ket Aan Gly Pro Asp Tyr Ile Gly
530 535
gaa tca ttc tca gct ggc ctt gtg aat ate tca age ggg ttt gat act 1248 GlU Ser Phe Sex Ala Gly Leu Val Asn Ile Ser Ser Gly Phe Asp Thr
370 375
gct ctt gtt gct cgt gga gaa ttg gcg ttt gta gat aaa att gca aat 1392 Ala Leu Val Ala Arg Gly Glu Leu Ala. Phe Val Asp Lys Ile Ala Asn
gct ggt ttc tct tta acc tat gag gat ggt att gct cta aga gat gcg 1536 Ala Gly Phe Ser Leu Thr Tyx Glu Asp Gly Ile Ala Leu Arg Asp Ala
470 475
tac gag tac gcg tat ggg cgt aaa tca ggt aca tca atg tca gca cca 1775 <formula>formula see original document page 74</formula> <formula>formula see original document page 75</formula> Tyr Thr Leu Gly Ser Pro Gly Thr Ser Pro Leu Ala Ile Thr Val Oly 335 340 345
Ala Asn Asp Vai Pro Leu Val Phe Thr Asp Phe Thr Gly Tyr Leu Asp
3S5
Ala Oly Leu Val
Ile Ser Ser Gly 375
Asp Olu Leu Glu Ala Gly Glu Tyr Oly
Ile Val Tyr Ala Oly 395
Leu Gly Ser Val Ala Glu Phe Asm Gln Val Asp Ala Glu Gly Lys Val
Ala Arg Gly
4IS
Glu Leu Ala Phe Val Asp Lys Ile Ala Asn
Lys Ala Ala Gly Ala Glu Ala Ile Xle Ile Tyr Asn Asn Ile Pro
Gly His Ile Pro Asa Tyr Phe Gly Glu
450 45 5
Ala Gly Phe Ser Leu Thr Tyr Glu Asp Gly Ile Ala Leu Arg Asp Ala
Glu Ser
480
Thr Pro Gly Gly Val Leu Ala Asp Phe Ser Ser Arg Gly Pro Val Asn
Glu Ser Phe Ala Ile Lys Pro Glu Val Ser Ala Pro Gly Val Asn.
525
Asn Gly Pro Asp Tyr Ile Gly 535
Tyr Glu Tyr Ala Tyr Gly Arg Lys Ser Gly Thr Ser Met Ser Ala Pro
550
555
Hie vai Ala Gly Thr Ala Ala Leu Leu Leu Glu Val Lys Pro Asp Leu 560 565 570 Ser Pro Ala Asp lie Bys Thr Thr Leu Met Asn Thr Ala Asn Pro
Leu Asp Tyr Ser Val Phe Glu Ile Gly Ala
SSS
Arg Leu Leu Leu Leu ser Phe Asp His Val Ser
<210> 3
<211> 828
<212> Om
<213> Bacillus Bp. P 203
<220>
<221> CDS
<222> (1)..(S28)
<223> anidrase cartònica
<220>
<;221> Bigi^ peptídeo
<222> (1) .. (87)
<22 0>
<22l> peptídeo
<222> (88)..(B28)
aaa aca aac gtt cta ctg aaa tca act atg att aca aca cta Met Arg Lys Thr Asn Val Leu Leu Lye Ser Thr Met Ile Thr Thr Leu -25 -20 -15
tta cta tca agt acg cta cta gta acc act ccg ate tat gea cac Leu Leu Ser Ser Thr Leu Leu Val Thr Thr Pro rie Tyr Ala His Thr -10 -5 -I 1
96
acc cag caa ctt tcc tac aag act ctt aat gat ttg cta acg gaa 144
Glu Thr Gln Gln Leu Ser Tyr Lys Thr Leu Asn Asp Leu Leu Thr Glu 5 10 15
gat gga cac agt ggt tgg tet tat tcc ggt cta act ggt ccfc gag tat Asp Glv His Ser Gly Trp Ser Tyr Ser Gly Leu Thr Gly Pro Glu Tyr 20 * 25 30 35
tgg gga gag tta aat gaa gac tac aag gcc tgc tet aaa ggg gag gaa Trp Gly Glu Leu Asn Glu Asp Tyr Lys Ala Cys Ser Lys Gly Glu Glu
àõ 45 50
caa tca cct ate gct tta caa aat gaa gat ate gat aat gaa aag Qln ser Pro Ile Ala Leu Qln Asn Glu Asp Ile Asp Asn Glu Lys Trp .55 €0 65
tet ttc gat cta gac tat gaa gaa act gag ttfc tca att gaa aac aat 336 ttg gtg cat caa gat gaa cat gca aat tta gct gtt cta ggt gtc tta Leu Val His Qln Asp Glu His Ala Asn Leu Ala Val Leu Sly Val Leu
tct gaa tta gtg cct agt gat cta tca aca fctc caa tat gat ggt tcc Ser Glu Leu Val Pro Ser Asp Leu Ssr Thr Fhe Qln Tyr Asp Gly Ser
IBS ISO 19S
ctt act act cca cct tgc tca gaa gat gtg aaa tgg agt gtg agt u Thr Thr Fro Pro Cys Ser Qlu Asp Val Lye Trp Ser Val Ser 200 205 210
teg aca att age cta tct cct gaa cag ctc gag gea ttt caa gac cta Ser Thr Ile Ser Leu Ser Pro Glu Gln Leu Glu Ala Fhe Gln Asp Leu 215 220
tac cca aat aac tat cgc cct att caa gac tta ggt aat aga gaa gtt Pro Asn Asn Tyr Arg Pro Ila Gln Asp Leu Gly Asn Arg Glu Val
gga ttt cac tat
8
Ser Phe Asp Leu Aep Tyr Glu Glu Thr Glu Phe Ser Ile Glu Asn Asn 70 75 SQ
ggc cat aca ate caa gcg aat gta gaa ggt tca tca tct aat acg tta Gly Kis Thr Ile Gln Ala Asn Val Glu Gly Ser Ser Ser Asn Thr Leu 85 SO 35
ctt tta aat gat act gaa tat aac ctt gtc caa ttt cat ttc cat tca 432
Leu Leu Asn Asp Thr Glu Tyr Asn Leu Val Gln Phe His Phe His Ser 100 105 110 115
cca agt gag cac acc tta gat gac gaa tac ttt gag atg gaa gta cat Pro Ser Glu Hie Thr Leu Asp Asp Glu Tyr Phe Glu Met Glu Val His 120 125
att gaa gaa ggc gaa cag aat gag acg ctt aca gat atg tgg gaa cta 57$
Glu Glu Gly Glu Gln Asn Glu Thr Leu Thr Asp Met Trp Glu Leu
150 ISS
atg cct ggg cag caa ggt gaa gct gct gaa aga att act ctt aac cca 624
Met Pro Gly Gln Gln Gly Glu Ala Ala Glu Arg Ile Thr Leu Asn Pro
<210> 4
<311> 276
<212? PET
<213> Bacillus sp. P 203
<400> 4
Met Arg Lys Thr Asn Val Leu Leu Lys Ser Thr Met Ile Thr Thr Leu -25 -20 -15 Leu Leu ser Ser Thr Leu Lau Val Ttor Thr Pro Ile Tyr Ala His Thr
Glu Thr Gln Oln Leu Ser Tyr Lys Thr Leu Asn Asp Leu Leu Tfcx Olu 5 10 15
20
Ser Gly Trp Ser Tyr Ser
Gly Pro GlU Tyr
Asp Tyr Lys Ala Cys Ser Lys Gly Glu Glu
Qln Ser Pro Sle Ala Leu Gln Aan Glu Aap Ile Asp Asn Glu Lys Trp 55 60 65
Ser Phe Asp Leu Asp Tyr Giu Glu Thr Glu Phe Ser Ile Glu Asn Asn 70 75 80
Gly HIs Thr Ile Gln Ala Asn Val Glu Gly Ser Ser Ser Asa Thr Leu 85 SO 95
100
Leu Val Gln Phe His Phe His Ser
Pro Ser Glu His Thr Leu Asp Asp Glu Tyr Phe Glu
Met Glu Val
13 0
Leu Val His Gln Asp
X35
14 U
Glu Glu Gly Glu Gln Asn Glu Thr Leu Thr Aep Mefc Trp Glu Leu
Met Pro Gly Gla Gln Gly Glu Ala Ala Glu Arg Ile Thr Leu Asn Pro 165 170 175
Ser Glu Leu Val Pro Ser Asp Leu Ser Thr Phe Gln Tyr Asp Gly Ser Tyr Pro Asn Asn Tyr Arg Pro Iie GIa Asp Leu Gly Asn Arg Glu Val
Gly PJie His Tyr 245
<210> 5
<211> 7 02
<212 > DNA
<213> BacillUS sp. P2Q3
<220>
<221> CDS
<222> (1) . . (702)
<223 > anidrase carbônica
<220> '
<221 > SÍg_ peptídeo-
<222> (I)T- (90)
<22 O >
C 2 21 > mat_peptideo-
<222> (91).. (702)
<400 > S
ttg tca aaa atg aag aca ctt agá aaa
Leu. Ser ^ys Het Lys Thr Leu Arg Lys -3 0 -25
aca ctt tca age age tcg atg gfcc acc
Thr Leu Ser Ser Ser Ser Met Va1 Thr -10
gat aca cat caa cca ctt ate ccg tat Asp Thr His Gln Pro Leu Xle Pro Tyr 5 10
ttg tca ttg tat gct gea ttt 48
Leu Ser Leu Tyr Ala Ala Phe -20 -15
gct cct ctc fctt gea cag aca 96
Ala Pro Leu Phe Ala Gln Thr
-5 -1 1
cac tca ctc cac ctc ttg cta 144
His ser Leu His Leu Leu Leu
15
cat tet aat gag aaa gaa ggc tgg tet tat tet ggc tca act ggc ccg 132
His Ser Asn Glu Lys Glu Gly Trp Ser Tyr Ser Gly Ser Thr Gly Pro
fcic tgg gea gac cta cat gat gaa tac ata gea tgc tca caa Phe Trp Ala Asp Leu His Asp Glu Tyr Ele Ala Cys Ser Gln Gly
35 40 45 50
aaa gaa caa tcg cct gta gcc tta cat aat gaa gac gea tca gat gaa 288
Lys Glu Gln Ser Pro Val Ala Leu His Asn Glu Asp Ala. Ser Asp Glu 55 60 65
aaa tgg tca tta gat ctt gac tat aac gaa aca gat ttc tcc att 336
Lys Trp Ser Leu Asp Leu Asp Tyr Asn Glu Thr Asp Phe Ser Ile
gag aat aac ggt cat acc att caa gea aat gta ggt gat cat tca tca Glu Asn Asn Gly His Thr Ile Gln Ala Asn Val Gly Asp His Ser Ser
384 aat aaa ttg att gta aat gga acc gat tac aag ttg gcg cag ttc cat LY8 Leu Ile vai Asn Oly Thr Asp Tyr Lys Leu Ala Qln Phe His
105 11°
ttc cat tct caa aqt gag cat acc tta gac gat gat tat tac gag
Ss Ser Gl» Ser Ilu His Thr Leu Aep Asp Asp Tyr TYr Glu Ket
125 1^u
ctt cat tta gtt cat cag gat gag gaa gat aac ttg gcc 0tc tta Leu His Leu Val His Gln Asp Qlu Qlu Asp Asn Leu Ala Val Leu 135
aac gag act cta gca aac at SW vai Hl Xle Glu Glu Gly Glu Lya Asn Glu THr Leu Ala Asn 150 155 160
y.y ata CCC gaa act gaa gga gaa gcc gat gaa acc att tct Val Ile Pro Glu Thr Glu Gly Glu Ala Asp Glu Thr Ile Ser 165 170 1«
■~s-f sat Gcc tca aaa cta gta cct aaa gat cca cta
Zl Pro ser Su Leu vai Pro Lys Aap Pro Leu Val Ser Thr cys
180 IBS 130
cgc gcg age tcc age ttt tgt tcc ctt AÍg Arg Ala Ser Ser Ser Phe Cys Ser Leu
200
<2X9> € <211> 2:
5>
<213> Bacillua sp. P203
> 6
■30
Thr Leu Arg Lys Leu Ser Leu Tyr Ala Ala Thr Leu Ser Ser Ser Sar Met Val Thr Ala Pro Leu Phe
-5
GIej Pro Leu He Pro Tyr His Ser Leu His Leu Leu Leu
XO 15
His ser Asn Glu Lye Glu Gly Trp Ser Tyr Ser Gly Ser Thr Gly Pro
20 ^5 30
Gln Phe Trp Ala Asp Leu His Aap <31* Tyr Ile Ala Cys Ser Gln Gly
m - JV
35 40
432
€72
Glu Gln Ser Pro Val Ala Leu Sis Asn Glu Asp Ala Ser Asp Glu Gly Lys Trp Sêr Leu Asp Leu Asp Tyr Aan Glu Tkr Asp Flse Ser Ile
Asn Gly Eis Thr lie Sln Ala Ass Val Oly Asp His Ser Sar
Asa Lys Leu
Val Asn Giy Thr Aep IOB
Tyr Lye Leu Ala Glη
115
Ser Glu 12 &
125
Glu Leu His Leu
Val His 135
Val Leu
Gly Glu Lys 15S
Asn Glu Thr Leu Ala Asn Met
Asp Val
165
Iie Pro Glu Thr Glu Gly
Ala Asp Gln 175
Leu Asn Pro Ser Glu Leu
Pro Leu
Arg Arg
195
Ala Ser Ser Ser Phe Cys Ser Leu
<2!0> 7
<212 > <213>
<22Q>
<221> CDS
<222> (1)..(1080)
<223 > xilanase
<220>
<221> pepüdeo
<m> (i> Π2) <220>
<221> mat pepüdeo
<222> (73) .. (1080) Ill
atg sitt ate agg agg cat atg ttg aat siga aaa ttg ttc aag gtt tta Met IIe Ile Arg Arg Hia Met Leu Asn Arg Lys Leu Phe Lys Val Leu.
ggt agt ata ctt ate att fccfc gct ggg gtg tat ggt tgg atg aag ata
Gly Ser Xle Leu Ile Xle Ser Ala Gly Val Tyr Gly Trp Met Lys Ile
-S -1 1 5
cag gat caa cat aca ata cga tca atg gct gaa gat gaa cag atg ttg Gln Asp Gln Hls Thr Ile Arg Ser Met Ala Gflu Asp Glu GIti Met Leu 10 15 20
ggc aca gct atg cgc tat cag cca ttt tca gat gat tcg ggc tat Phe Gly Tfcr Ala Met Arg Tyr Gln Pro Phe Ser Asp Asp Ser Gly Tyr 25 30 35 40
cga gag ttg att aaa aat gag ttt aat gea gtg acc att gaa aat Arg Glu Leu Ile Lys Asn Glu Phe Asn Ala Val Thr Ile Glu Asa Glu 45 50 55
atg aaa atg gaa cta gtt atg cct gaa cga ggc aag tat gat ttc Het Lys Met Glu Leu Val Met Pro Qlu Arg Gly Lys Tyr Asp Piae 60 65 70
caa gea gat gag atg gtg caa ttt gct gat gaa aat gga ctt caa gta 336
Gln Ala Asp Glu Met Val Gln Phe Ala Asp Glu Asa Gly Leu Gln Val 75 80 85
aga ggc cac act ctc gta tgg gaa cgt ate cct tgg tgg ctc gat aag 384
Arg Gly Hie Thr Leu Val Trp Glu Arg Ile Pro Trp Trp Leu Asp Gln 90 95 100
ggc aat ttt acc aga gat gaa ata acc aac cta tta aaa gag tat gtc 432
Gly Asn Phe Tlir Arg Asp Glu Ile Thr Asn. Lau Leu Lys Glu Tyr Val
105 110
caa aca acg gta aag caa tac caa ggt cga ate tat gcc tgg gat gta Gln Thr Thr Val Lys Gln Tyr Gln Gly Arg Ile Tyr Ala Trp Asp Val 125 130 135
gta aat gaa gcg ttt gat aac aaa gga aat ctg aaa gag aac ttc Val Asn Glu Ala Phe Asp Asn Lys Gly Asn Leu Lys Glu Asn Phe
ctg cag cat ate ggt tca gat tac att gaa ctt gct ttt cga tgg gea Leu Gln His Ile Gly Ser Asp Tyr Ile Giu Leu Ala Phe Arg Trp Ala
160 165
aaa gaa gea gat cca gat gct tta ctg ttt tat aac gat tat gag aac Glu Ala Asp Pro Asp Ala 170 175
gaa gta ccc tet gct aaa act gaa gea acg ata aaa tgg ttg tca
Val Pro Ser Ala Lys Thr Glu Ala Thr Ile Lys Trp Leu Ser Glu
Leu Arg Gln Lys Gly Val Pro Ile Asp Gly Ile Gly Met Gln aca tgc gac tcc ttc acg gtg fcgg ggt gcg gct gat cca tat agt Thr Cys Asp Ser Phe Thr Val Trp Gly Ala Ala Asp Pro Tyr Ser Trp 285 290
att ggg ttt aca gag gag cca gga gcg agt gtfc gcc tac cca ctt ctt He Gly Phe Thr Glu Glu Pro Gly Ala Ser Val Ala Tyr Pro Leu Leu
ttt gat gat aaa fcfcg aaa cgg aag ccg gca tat aag gcg att aaa gct Asp Asp Lys Leu Iiys Arg Lys Pro Ala Tyr Lya Ala Xle Lye Ala
315 320
ata ttt aaa gaa gat att cgt aaa Ile Phe Lys Glu Asp Ile Arg Lya
<210> 8 <2X1> 360 <212>
<4 oo> a
Mdt Ile Ile Arg Arg His Met Leu Asn Arg Lys Leu Phe Lys Val Leu
Gly Ser Ile Leu Ile Ile Ser Ala
-S -ι 1
14
aat gat ttt cat gtt gat cag gta caa. aat gta atg Asn Asp Phe Hle Val Asp Oln Val Gla Asn Val Ket 220 225 230
aat caa atg gag cag gaa gga ttt tta gta cat att aca gaa cfca gac Sie
Asn Gln Met Glu Gln Glu Oly Phe Leu Val Hia Ile Thr Glu Leu Asp 235 240 245
ata aag etc caa cat agt ggg gag gat ctg gag acg aaa caa cag cta He Lys Beu Gln His Ser Gly Glu Asp Leu Glu Thr Lys Gln Gln Leu 250 255 260
cag gca gaa cga tat gca gaa ata atg aag gtc tgfc tta cag caa gca Gln Ala Glu Arg Tyr Ala Glu Ile Met Lys Val Cys Leu Gln Gln Ala
265 270
Gln Asp Gln His Thr Ile Arg Ser
Ala Glu Asp Glu Gln Met Leu
10
15
Arg Tyr Gln Pro Phe
35
Arg Glu Leu lie Lys Asn Glu Phe Asn Ala Val Thr Ile Glu Asn Glu 45 50 55 Met Glu Leu Val
SO
Glu Arg Gly fcys Tyr Asp PHe ser
fiR 70
Asp Glu Met Val Gln Phe Ala Asp Glii JMm Qly Ls-u Glu Val
Val Trp Glu Arg Ile Pro Tarp Trp Leu Asp 95
115
120
Gln
Arg Ile Tyr Ala
125
Trp Asp Val
135
140
Gly Asn Leu Lys Glu 145
ISS
hya Glu Ala Asp Pro Aep Ala Leu Leu PHe Tyr Asn Asp Tyr
Ile
Lys Gly vai Pro Ile Asp 205
Ile Gly Met Gln Met His
He Ala Aôii Aap Phe His Val Asp Gln Val Gln Asn Val
225
Met Glu Gln Glu Gly Phe Leu
235
Val Eis Ile Tfar Glu Leu ABp
Leu Gln Eis Ser
Gln Ala Glu Arg Tyr Ala Glu lie Met Lys Val Cys Leu Gln Gln
Ala Asp Pro Tyr ser Ile Qly Phe Thsr Glu Glu Pro Gly 3 QO
Asp Asp Lys Iieu Lys Arg Lys
Ala Ser Val Ala Tyr Pro Leu Leu
^ia
Ile pbe Lys Qlu Asp Xle Arq Lys
<210> 9
c2ÍX> 2712
<212> DKA
<213> Bacillus sp. P2 03
<220>
<221> CDS
<222> (1)..Í2712)
<233> RhamnogalactuTOMn liase
<220>
<221> SÍg_peptideo
<222> U) „·<87) <22Ü>
<221> inat ^peptideo
<222> (88).. (2712) aaa Gafe aaa c?tq gtc gct gtc tca aca tct gaa ggt gta ttt
Sp tag IlY 1! Ial La Val Ser ftr Ser Olu Gly VaI Phe Leu 105 110 1
aav ^yy ctg tta aag cag gaa gta gat ggt cafc tct gag aca ggc
Zr Sp Arg Leu Leu Lys Gln Glu Val Mg Oly Kis ser Glu Thr Gly 120 125 13 0
tta acc ggt gtt gat ttt tat gtt tac cga gat gga age aaa att gca Leu Thr Gly Val Aep Phe Tyr Val Tyr Arg Asp Gly Ser — a1sa
ttt gaa tat acg att aga gcc gtg gat cat ggt aag gag ctg gat gaa Phe Gln Tyr Thr Ile Arg Ala Val Asp His Qly Lys Glu Leu Asp Glu
165
agt gag cca gta agt ccg tgg gca gac ggt tat tat gat ttg ccg ttg Ser Qiu Pro Val Ser Pro Trp Ala Asp Gly Tyr Tyr Aep Leu Pro Leu 3.80 185
_ ™ cca gcg gat ggg gta act cca gct ggc gag feec tat acg tac
GlTi Lys Pro Ala Asp Gly Val Thr Pro Ala Gly Glu Ser Tyr Thr Tyr
205 210
Ala Asn Asp Met Ser Val Gly Asp Val Asp Gly Asp Gly Gln Tyr
gaa ttt ate gtt aaa tgg gat cca tca aat tca aag gac gtc tct caa Glu Phe Xle Val Bys Trp Asp Pro Ser Asrx Ser Lys Aap Val Ser Gln
235 240
aaa ggc tac aca gga aat acg tat att gac acg tat acg ttt gaa gga Lys Iiy Tyr Thr Gly Asn Thr Tyr lie Asp Thr Tyr Thr Phe Glu Gly 245 250 255
tta ctt tat cga att gat tta ggt gta aafc gtt cgc tct gga gca.
Tvr Arg Ile Asp Leu Gly Val Asn Val Arg Ser Gly Ala 270 275
cat tat act caa ttt tta gtc tat gac ttt gat gga gat gga aaa gcg His Tyr Thr Gln Phe Leu Val Tyr Asp Phe Asp Gly Asp Gly Lys Ala 265 290
ate atg ttt aag aca gca cet gga aca aag ata cta aca ttt aat
GXy Thr Lys Ile Leu Thr
300 305
Λ±Β>
17
™ att gtt cca gta aca a&t gga gaa gaa ggt gaa ttt tca aat 335
Lvs Ile Val Pro Val Thr Asn Gly Glu Glu Gly Glu Phe Ser Asa 70 75 ao
act gtt caa act gat att aaa aaa ata ttt gac caa cag ctt gag gat Thr Val Gln Thr Aap lie Lye Lys Ile Phe Asp Gln Gln Lsu Glu Asp
a* 90
agt 576
IlZ vil 2Ξ Ili sll Xi Asn Tyr Leu Ãep Glu Glu Gly Thr Ala Ser ggt aat gga gag att gaa acc gaa gag tac ate acg atg cca gaa gag £ Ln. Ily Ilu Xle Olu Thr Glu Olu Tyr II* Thr Met Pro Qlu Olu
aat cta tet aaa ggc tat agt cat gaa gat gac tac cga atg agt tca Cta ser tyt Iy Tyr ser His Glu Asp Aep Tyr Arg Met Ser Ser
330 335
IS Sp s s SS ^ s: IS S s «» ^ s.
Glu Tyr Lau Thr vai Pne yw ^y — ^ ^---" 435
420 430
att est tat aag cet gga aga age gat gat gga ttg atg tgg gga gat Ile His Tyr Lya Pro Gly Arg Ser Asp Asp Gxy Leu mt Trp Gly Asp
tat acq atg gct cgc att gag cet gga aac cgc gtt gat cgt ttt Tyr SS Het Ila Arg He Glu Pro Gly Asn Arg Val Aep Arg Phe * 460 465
_ cta aat agt gag aat cca tac gct gta ttt gct
S Sy vaí Sa Leu Sp Sy Ill Pro Tyr Ala Val Pha Ala 470 475 «0
acta m tac tac aca aga aca aca ctt gtt tca tat gat tgg gac gga Ill Hy ££ Tyr Thr A?g Thr Thr Leu Val Ser Tyr A0p Trp Asp Gly
490
ca{J aqc tta. aat gaa cac tgg tac gta gat agt ggt tgg aca cca at;g S Ser Itu Asn Ilu Hi. Tr| Tyr Val Asp Ser Gly Trp Ttr Pro Met
SOO
fr^fc aat cca ttt aat gat ggt cca cat gga gta gat ggg act gac gaa
Ser Zl Trl Phe Asb Ld Sy Fro His Gly Val Aflp Gly Thr Asp Glu 520 525 5
aaa ttt gga aca att aca aca caa ggt gct eac tet ttg agt gtt gct SE P^ Sv Thr Ile Thr Thr Gln Gly Ala His Ser Leu Ser Val Ala
1104
325
cat gaa 1152
1200
cat qag gaa gta gtg gat ggt aat tgg cca gea aca ctt ga* His 15 Su Ial Iaf Lp Gly Aan Trp Pro Ala Thr Leu Glu Glu Ser
360 355 9
fctt gat att gac gtt caa tat gaa tat cca ctt tet aaa gag gat gct Phe Sy Ile Lp Val Gla Tyr Glu Tyr Pro Leu Ser Ly6 Glu Asp Ala 375 380 38b
gag tcg tta gct gat tat ttt atg gaa gag tat gcg Cct tet cgc age 1296 15 Ser Leu Kla Asp Tyr Phe Met Asp Slu Tyr Ala. Fro Ser Arg Ser
390 3^S
ggg cgt aat gac cta cga gac ttt gaa ggc ttt att gtt gaa. gga cca Ilv Arg Aan Asp Leu Arg Asp Phe Glu Gly Phe Ile Val Glu Gly Pro
gaa tat tta acc gta ttt gaa gga gag aca ggc aag gag tta gaa acc 1392 Su Tvr Lau THr Val Phe Glu Gly Glu Thr Gly Lys Glu Leu Glu Thr
1536
aca cca atg 1632 535 540
afet" aat «Λ qat age aag cac gaa att ate tac ggt gga gct acg IW VU Isp Sy Sp «T ^ His Glu Xle Ile Tyr Oly Gly Wa Thr
att gac cac gát ggc tcc ttg tta tat age tcc ttt gac aca atg cca 1824 Ile Sp SS Lp lír Ser Leu Leu Tyr Ser Ser Phe Aep Xhr Het Fro
cca «yu gct aac cct gga gaa gaa gea aga ctt gga cac ggg gat Pro Gly Ser Ala Asn Pro <3ly Glu Gln Ala Arg Leu Gly Hxa Oly Aep
aac aqc atg ccg ggt aca aat ttt aat att aaa tgg tet gga gat tta Xp Sr Met Pro Sy Thr A511 Ph* Asu He Lys Trp Ser Gly Asp ^u 680 68S **
acc aca caa ata gtg aat ggt tcc att gat caa acg cct toe att gat Sr to Iln Ile Vai Aan Qly Ser Ile Asp Gln Thr Pro Ser He Asp
700 705
ttt aaa qaa gag ttg cta gtt aga aca aca gat age tca gcc ata cgt Ht Sg Su Gll LeS Leu Ial Arg Thr ttr Aep Ser Ser Ala Ile Arg
740 745 750 ;bí>
ate tac aca agt aca gag gtc acg gag cat aag ctt tac aca ttg Ile Tyr Thr Ser Thr Glu Val Thr Olu His Lys Leu Tyr Thr Leu 760 765 "*'7Λ
oca tgg caa aat gfca acc tac
„σ ett cat cta gcc gat gtg ate ctg ata gac cag gtt tgg aga gct 1920 K Su Hie Val Sa Lp vaí Ile Leu Ile Aap Gla Val Trp Arg Ala 600 605 610
fera tat tta aag gcg gtc aat ggg cgc ctt atg gat atg cct tac 1% Leu Lys Ill Sil Asn Oly Arg Leu Met Asp Met Pro Tyr
620 625
ata ata ctg aat ctg gag atg tgt tat atg gcg gga tac ggt cga gat 2016 ml S Zn Leu Ilu Me? Cys Tyr Met Ala OIy Tyr Gly Arg Asp
.et aat ccf0 aat atg gtt ggt gat gtg aat cca gac aag cga ggc ctt 2064 Sr Ily 2g Sy Mef Ial SIy Lp Val Asn Pro Aep Lys Arg Oly Leu
gaa aca tgg gct gta gga cta tgg aca gct gac gga gag aaa etc agt 2112 Olu Thr Trp Ala Val Gly Leu Trp Thr Ala Asp GXy Glu Lys Leu ser
660
aat toa cag aaa gga cga tta ctt acg gea gaa ggc act aga acc Zt SS Ly8 Qly A?g Leu Leu Thr Ala Glu Qly Thr Arg Thx 710 715
aat tac aca aaa ggt aca cct tca ctc gtt gea gat gtg ttt ggg gat 2304 Zl Tyr ΚΪ Lys Iy Thr Pro Ser Leu Val Ala W Val Phe Gly Asp
730
Jl^ Asp Thr Gln Tyr Arg Thr Gly lie AXa τ*ρ 01, Aen Val Thr Tyx
775 730
™ tw tat ccq qqc ttt tat tat gca tct gat atg gat tgg
Γη Si «o S £ Γ/ο Iy Pte Tyr Tyr Al. S.r *.p Het ^P ^
7§Q 7^5
tct att aac tca
815
aacr tat ata cct gtt cca gtt gat caa cag aaa gat Ill ££ vai pro ?al Fro Vai Aap 31a OliI Lys Asp
act aga aga tcc act agt gtc gac ctg cag gcg cgc gag ctc cag att Sr Sg Jteg Ser Thr Ser Val Asp Leu Gl* Ala Arg Glu Leu Glxi Leu
ttg ttc cct tta gtg agg gtt aat ^ ^ — — ^ Ile vai
aso
aat att tcc tgt gtg aaa ttg tta tcc gct cac aafc tcc ada caa S: AXa Val Ser Vaf Ly5 Leu Leu Ser Ala Hl, Asm. ser Thx Gln
tat acg age cgg aag tat aaa gtg Tyr Thr Ser Arg Lys Tyr Lye Val
> 10
<212 > <213 >
Phe Lys Arg Gln Gly Lys Gly Ile Leu Phe Gly Leu Lau -25 "20
Trp Lys Qli^ Val Lys Oly Ala Ser Tyr
20
30
Glu Asn Ket Glu Tyr Arg Leu
50
Ser Glu
Thr Tyr Thr Tyr 55
<3lu Arg Ser SO
65 <formula>formula see original document page 91</formula> <formula>formula see original document page 92</formula> <formula>formula see original document page 93</formula> <formula>formula see original document page 94</formula> aat ggg atg aaa cta tta gta gac ttc cat tac tcc gac Isl Ily Met Lys Leu Leu Val Asp Phe His Tyr Ser Asp Phe Trp
IOO 105
o-ac cca ggg aaa cag ttc ccc cct aaa gca tgg gag aat tta agt ctt Sp pro S? LyS GlS Ph* Pro Pro Lys Ala Trp Glu Asn Leu Ser Leu
nfl 125
115
120
aaa aaa aaa qct gag cta tat gac ttt acg aag gat agt
IS IS Lys Lys Sa Ilu Leu Tyr Asp Phe Thr Lys Asp Ser Leu
««ι·-
13 0
150
g&a aca aca aat ggg ctg gcc ggt gaa tat gat tgg bct aat ate acg Ilu Thr Thr Asn Gly Leu Ala Gly Glu Tyr Asp Trp Ser Asn Ile Thr
170 175
rea fcta acc aat gaa gga agt aag gcg gta agg gaa gtg gac gag gat sã Leu lll Sn Ilu ISy bL Lys Ala Val Arg Glu Val Asp Glu Asp
19 0.
aca ttc ttt gct caa aca tta gac gag cag aat gta gat tat gat gtc Sa Phe Phe Ala Glu Thr Leu Aep Glu Gln Asn Val A5p Tyr Aap Val
210
215 220 225
fctfc aca age tca tgg tac ccg aat fcgg cac gga aca tta gag aat ctg pS IS Sr Ser T^ Tyr Pro Asa Trp His Oly Thr Leu Glu Asn Leu
aca acfc att ttt aac gag ata gcg gag acc cac gar aaa aaa
acs _______ ti. m» Riu Tiir Tvr Asis Lvs Lys Val
25
atg 192
gat gaa gat ttt att aga ggg gta gat ata tcg agt gtg att gct atg Lp Glu Asp Phe Ue Arg Gly Val Asp Ile Ser Ser Val He Ala Met 20 25 30
aaa aat age gga acg gtc tat tac aac gaa gaa ggg gaa gag caa gat 240
Su Zl Xr l!y Thl Val Tyr Tyx AS* Glu Glu Gly Glu Glu Gln Asp
35 45
gtg ttt cag act ttt aag gag gea gga gcc aa.t tac gtg cga gtg cgt 288
TJ p*e QU Thr Phe Lys Glu Ala Gly Ala Asn Tyr Val Arg Val Arg
SO 60
5ta tgg aat gat cca tac gat gct gaa ggg aac age tat S3& 336
?al S Aan Lp Pro Tyr Asp Ala Glu Gly Asn ser Tyr Gly Gly Gly 70 15 80
aat aat gat efea gaa acg gcg att gaa att gga aaa cga gcc aca gaa Sn Zl Lp Leu Ilu Th? Ala Ile Glu Ile Gly Lys Axg Ala Thr Glu
on
384
432
523
aaa ata ctt qct gaa gga ata cac att ggg atg gtt cag ate ggt aat 576
Su SS Leu fia IlU Gly Ile His He Gly Met Val Gla He Gly Aan
672
Stt Ctc ato qct tta cac ttt aca aac cct gaa aga gaa ggg aga tac 720
iX Ilu S Ila Leu His Phe Thr Asn Pro Glu Arg Glu Gly Arg Tyr
200 <formula>formula see original document page 96</formula> <:210·» 12 <211> 534
<213? Bacillus sp. Ρ203 <400> 12
MBt Ile Gln Met Ly* Arg Met Pfce Gly Thr Cy* Leu Ala Val
-25
-20
Leli Qiy He Pro Tfcr Ile Gly Oly Gln Ala Oly Val Ala Asn Ala Ala
„15 -10 -5 1
Ser Glu Pro Val Gln Ser Glu Lau Phe Val Glu Lys Val Glu Gly S 10
Olu Asp Phe lie Arg Gly Val Asp Ile Ser Ser Val
Glu Asn Ser Gly Thr Val Tyr Tyr Asn Glu Glu Gly
40
45
vai Phe Gln Thr Phe Lys Glu Ala Gly Ala Asn Tyr Val Arg
55
65
Pro Tyr Aep Ala Glu Gly Asn Ser Tyr Gly Gly Gly 70 75 80
Leu Glu Tfir Ala Ile Glu Xle Gly Lys Arg Ala Thr
Gly Met Lys Leu Leu Val Asp Phe His Tyr Sar Aap Phe Trp Ala
105 110
Hbp Pro Gly Lys Gln Phe Pr0 Pro Lya Ala Tsp Glu A*n Leu Ser Leu 115 125
Iieu Ala Glu Gly Ile His He Gly Met Val Gln Ile Gly Asu 155
160
c TUr Asa Gly l*eu Ala Qly GSln ^ep
175
Gln Gly Ser Xtf* Ala Val Arg Glu Val Asp
His Plie Thr Asn Firo Olu Arg
205
y Arg Tyr
jaa Gln Thr Leu Aep GUi Asix V*1 Se» Tyr
ser Trp Tyr Pro Asa Trp Eis Gly Thr X>eu
235
Glu Asn
Phe Aan Clu Xle Ala CXu Thr Tyr Aap Lya Lye Val
Glu Val Ser Tyr Ser Tyr Tlir Asn Glu Asp
265
lie Cly Thr Glu ®ln Val Pro Oly Tyr Ser
Els Val 11« Arg Asp Ala 295
Ser Ile Gly Asp Ala Gly 310
320
is Qly Ser Gly Trp Ala Ser Ser Tyr Ala Al* Thr Tyr
Pro Glu Asp Ala Gly Lys Tyr
355
Pro Ser Ile Asn Val
385 vai Tyr Ito Gly Ala Val Thr Qlu Ε-m Lys Val Asp Arg
395
VaX Híb Leu Gln Xle Ser I** CSly Gla Thr Ala *ys ^u 405 415
vai Thr Val Ser Phe Aan mp Arg Ser Thr Gla Glu Val 420 425
Pro vai Ser Trp A** Olu Clu Ala Fhe Gln Gln Al, Beu Glu Ser Gly
fceu Gly Ser Tyr vai Xle Asm Gly Thr Val Glu Asp Gly Gln Gln
LyS Ala His Leu Glu Ilfc 'rnr «*«· -- — Val ^ys %°0
Phe Glu Aap Ser Glu Arg Ala Met Trp Glu Ile Gin Arg Xle Gln Lys 485
<21C> 13
<2I1> 20
<212 > DNA
<213 > Artificial
<22Q=>
<223> Inkiadei
<220>
<221> Inwiaier
<222> íll-■^
<223? Iniciador A2up
<4 QO 13
agcgtttgcg gccgcgatcc
<210> 14
<211> 21
<2.12 > DHA
<213> Artificial
<c220>
<223> Iniciador <222 > (1).-(21) <223>
<400> 14 21
ttattcggtc gaaaaggatc c
<210> 15
<2115» 34
<212> DKA
<213> Artificial
<220>
<223> Iniciador
<22 0>
<221> Iniciador
<222> (D-.Í34)
<220> <221>
<222> (1) * - <34)
<223> SigA2NotU-P
<400> 15 ^ 34
tcgcgatccg ttttcgcatt tatcgtgaaa cgct
<210> XS
<211> 33
<212> SKA
<213> artificial
<220>
<223> Iniciador
<220>
<221> Iniciador
<222> il) ■■ C33)
<22 0>
<221> Inieiador <22Z> (I).· (33)
<223> SÍgA2KotO-P
<40D> 16 33
ccgcaaacgc tggtgaaagt aaaagatgct gaa
<210> 17
<211> 2S
<212> DWA
<213> artificial <223> Iniciador
<22Q> IniciadoT <221>
<222> U)- (255 <220>
<221> Iniciador <222> U)..(25)
<223 > BOCAfwd
<400 > 17 25
tagtccgtac afcatgagaaa aacaa
<210> I8
<211> 26
<212> DKA
<213> artificial
<220>
<223> Iniciador
<220>
<221> Iniciador
<222> (1) ·. US)
<220>
<221 > Inwiador
<222 > Vl).-(26)
<223> BOCArev
<210> 19
<211> 23
<212> DNft
<213 > artificial
<220 >
<223 > Inieiador
<220>
<221> Iniciador
<222> (1)··<235
<220>
<221> ^iador
<222> (1)- - (23)
<223> PQECAfwd
<400>
atccgcatgc tgagaaaaac aaa 23 <21.0 > 20
<211> 27
<212> DKA <
<223 > Iniciador
<220 >
<221> Iniciador
«222> (U ■· (27)
<22Õ>
<221> bdci^or
<222> {!>.-(27)
<223 > pQECAreV
<210> <211> <212> <213 3
<220>
<223 > Iniefedor
<220>
<221> Iniciador
<222> (D ♦-(19)
<22 0>
<221> Iniciador
<222> (1)··US»
<223> CAmltSEQrev
<400> 21
cacttggtga atggaaatg
Claims (26)
1. Polipeptídeos funcionais, caracterizados pelo fato de serem codificados por polinucleotídeos compreendidos no genoma de cepas de espécie Bacillus, Bacillus plankortiensis depositada sob o número de acesso DSM17419.
2. Polipeptídeo maduro funcional isolado, caracterizado pelo fato de ser obtenível da bactéria de cepa Bacillus sp. P203 depositada sob o número de acesso DSM 17419.
3. Polipeptídeo de acordo com a reivindicação 2, caracterizado pelo fato de ser selecionado do grupo consistindo de: (a) um polipeptídeo compreendendo uma seqüência de aminoácidos que possui pelo menos 70% de identidade com uma seqüência de um polipeptídeo maduro compreendida no grupo de SEQ ID NO: 2, SEQ ID NO: 4, SEQID NO: 6, SEQID NO: 8, SEQ ID NO: 10 e SEQID NO: 12; (b) um polipeptídeo que é codificado por uma seqüência de nucleotídeos que hibridiza sob condições de estringência alta com uma sonda de polinucleotídeo selecionada do grupo consistindo de (i) a fita complementar a uma seqüência de nucleotídeos selecionada do grupo de regiões de SEQ ID NO: 1, SEQ ID NO: 3, SEQ ID NO: 5, SEQ ID NO: 7, SEQ ID NO: 9 e SEQID NO: 11 codificando um polipeptídeo maduro. (ii) a fita complementar à seqüência de cDNA contida em uma seqüência de nucleotídeos selecionada do grupo de SEQ ID NO: 1, SEQ ID NO: 3, SEQ ID NO: 5, SEQ ID NO: 7, SEQ ID NO: 9 e SEQ ID NO: 11 codificando um polipeptídeo maduro. (c) um fragmento de um polipeptídeo maduro compreendido em SEQ ID NO: 2, SEQ ID NO: 4, SEQ ID NO: 6, SEQ ID NO: 8, SEQ ID NO: IOe SEQ ID NO: 12 em que o polipeptídeo possui uma função dos polipeptídeos maduros correspondentes compreendidos em SEQ ID NO: 2, SEQ ID NO: 4, SEQID NO: 6, SEQ ID NO: 8, SEQ ID NO: 10 e SEQID NO: 12.
4. Polipeptídeo de acordo com a reivindicação 2, caracterizado pelo fato de que o polipeptídeo é uma enzima possuindo uma função selecionada do grupo consistindo de xilanase, serina protease, anidrase carbônica, ramnogalacturonana liase e galactanase.
5. Enzima de acordo com a reivindicação 4, caracterizada pelo fato de selecionada do grupo consistindo de: (a) uma enzima possuindo uma seqüência de aminoácidos que possui pelo menos 70% de identidade com uma seqüência de aminoácidos selecionada de enzimas naturais compreendidas em SEQ ID NO: 2, SEQ ID NO: 4, SEQID NO: 6, SEQID NO: 8, SEQID NO: 10 e SEQID NO: 12; (b) uma enzima que é codificada por uma seqüência de nucleotídeos que hibridiza sob condições de estringência alta com uma sonda de polinucleotídeo selecionada do grupo consistindo de (i) a fita complementar a uma seqüência de nucleotídeos selecionada do grupo de regiões de SEQ ID NO: I5 SEQ ID NO: 3, SEQ ID NO: 5, SEQ ID NO: 7, SEQ ID NO: 9 e SEQ ID NO: 11 codificando a enzima madura, (ii) a fita complementar à seqüência de cDNA contida em uma seqüência de nucleotídeos selecionada de regiões de SEQ ID NO: 1, SEQ ID NO: 3, SEQ ID NO: 5, SEQ ID NO: 7, SEQ ID NO: 9 e SEQ ID NO: 11 codificando o polipeptídeo maduro; (c) um fragmento da enzima matura compreendido em SEQ ID NO: 2, SEQ ID NO: 4, SEQ ID NO: 6, SEQ ID NO: 8, SEQ ID NO: 10 e SEQ ID NO: 12, e em que a enzima possui uma função dos polipeptídeos maduros correspondentes compreendidos em SEQ ID NO: 2, SEQ ID NO: 4, SEQ ID NO: 6, SEQ ID NO: 8, SEQ ID NO: 10 e SEQ ID NO: 12.
6. Polipeptídeo de acordo com a reivindicação 2, caracterizado pelo fato de que o polinucleotídeo codificando o polipeptídeo consiste de uma seqüência de nucleotídeos selecionada do grupo de regiões de SEQ ID NO: 1, SEQID NO: 3, SEQ ID NO: 5, SEQ ID NO: 7, SEQ ID NO: 9 e SEQ ID NO: 11 codificando um polipeptídeo maduro ou uma seqüência diferindo do mesmo em virtude da degeneração do código genético.
7. Enzima isolada, caracterizada pelo fato de ser selecionada do grupo consistindo de: (a) uma enzima compreendendo uma seqüência de aminoácidos que possui pelo menos 70% de identidade com a seqüência de aminoácidos de uma enzima madura selecionada do grupo consistindo de xilanase, serina protease, anidrase carbônica, ramnogalacturonana liase e galactanase secretada da cepa Bacillus sp. P203 depositado sob DSM 17419; (b) um polipeptídeo que é codificado por uma seqüência de nucleotídeos que hibridiza sob condições de estringência alta com uma sonda de polinucleotídeo selecionada do grupo consistindo de: (i) a fita complementar a uma seqüência de nucleotídeos compreendida na cepa Bacillus sp. P203 depositada sob o número de acesso DSM 17419 codificando uma enzima madura selecionada do grupo consistindo de xilanase, serina protease, anidrase carbônica, ramnogalacturonana liase e galactanase secretada daquela cepa; (ii) a fita complementar à seqüência de cDNA contida em uma seqüência de nucleotídeos compreendida na cepa Bacillus sp. P203 depositada sob o número de acesso DSM 17419 codificando uma enzima madura selecionada do grupo consistindo de xilanase, serina protease, anidrase carbônica, ramnogalacturonana liase e galactanase secretada daquela cepa; (c) um fragmento de uma enzima madura selecionada do grupo consistindo de xilanase, serina protease, anidrase carbônica, ramnogalacturonana liase e galactanase secretada da cepa Bacillus sp. P203 depositada sob o número de acesso DSM 17419; em que a enzima possui uma função selecionada de xilanase, serina protease, anidrase carbônica, ramnogalacturonana liase e galactanase.
8. Composição, caracterizada pelo fato de compreender o polipeptídeo como definido nas reivindicações 1 a 7.
9. Composição de acordo com a reivindicação 8, caracterizado pelo fato de que pelo menos dois polipeptídeos diferentes como definidos nas reivindicações 1 a 7, preferivelmente pelo menos 3, mais preferivelmente pelo menos 5, mais preferivelmente pelo menos 10, mais preferivelmente pelo menos 15, mais preferivelmente pelo menos 20 polipeptídeos diferentes como definidos nas reivindicações 1 a 7.
10. Composição de acordo com a reivindicação 8, caracterizada pelo fato de compreender todos os polipeptídeos secretados quando se fermenta uma amostra de cepa Bacillus sp. P203 DSM 17419 ou um seu mutante na qual um ou mais genes têm sido deletados ou adicionados.
11. Composição de acordo com a reivindicação 8, caracterizada pelo fato de adicionalmente compreender uma ou mais enzimas adicionais.
12. Composição de acordo com a reivindicação 8, caracterizada pelo fato de ser uma composição de detergente que, em adição ao polipeptídeo, compreende um tensoativo.
13. Composição de acordo com a reivindicação 8, caracterizada pelo fato de ser uma composição de ração que em adição ao polipeptídeo compreende um produto de cereal ou de grão.
14. Composição de acordo com a reivindicação 8, caracterizada pelo fato de ser uma composição de alimento.
15. Composição de acordo com a reivindicação 8, caracterizada pelo fato de adicionalmente compreender um polissacarídeo ou uma mistura de polissacarídeos.
16. Método para preparar uma composição como definida na reivindicação 8, caracterizado pelo fato de compreender misturar o polipeptídeo como definido nas reivindicações 1 a 7 com um excipiente.
17. Polinucleotídeo, caracterizado pelo fato de possuir uma seqüência de nucleotídeos que codifica o polipeptídeo definido como definido em qualquer uma das reivindicações 1 a 7.
18. Composição, caracterizada pelo fato de compreender o polinucleotídeo como definido na reivindicação 17.
19. Construto de ácido nucleico, caracterizado pelo fato de compreender a seqüência de nucleotídeos como definida na reivindicação 17 operacionalmente ligada em uma ou mais seqüências de controle que dirigem a produção de polipeptídeo em uma célula hospedeira.
20. Vetor de expressão recombinante, caracterizado pelo fato de compreender o construto de ácido nucleico como definido na reivindicação 19.
21. Célula hospedeira recombinante, caracterizada pelo fato de compreender o construto de ácido nucleico como definido na reivindicação 19.
22. Método para produzir o polipeptídeo como definido nas reivindicações 1 a 7, caracterizado pelo fato de compreender: (a) cultivar uma cepa, que em sua forma de tipo selvagem é capaz de produzir o polipeptídeo, para produzir o polipeptídeo; e (b) recuperar o polipeptídeo.
23. Método para produzir um polipeptídeo como definido nas reivindicações 1 a 7, caracterizado pelo fato de compreender: (a) cultivar uma célula hospedeira recombinante como definida na reivindicação 22 sob condições que conduzem à produção do polipeptídeo; e (b) recuperar o polipeptídeo.
24. Método de acordo com a reivindicação 23, caracterizado pelo fato de compreender: (i) fundir genes do genoma da cepa Bacillus sp. P203 depositada sob o número de acesso DSM 17419 com um gene codificando um repórter sem sinal, via uma etiqueta de transposon, (ii) desenvolver os clones de célula hospedeira compreendendo um gene fundido da cepa Bacillus sp. P203 (DSM 17419) em um meio revelando a presença do repórter, (iii) detectar clones secretando o repórter e (iv) isolar o gene e o polipeptídeo da cepa Bacillus sp. P203 (DSM 17419) compreendida naquele clone.
25. Meio de armazenagem, caracterizado pelo fato de ser adequado para uso em um dispositivo eletrônico compreendendo informação da seqüência de aminoácidos do polipeptídeo como definida nas reivindicações 1 a 7 ou a seqüência de nucleotídeos do polinucleotídeo como definida na reivindicação 17.
26. Processo, caracterizado pelo fato de compreender empregar um polipeptídeo como definido nas reivindicações 1 a 7 ou um polinucleotídeo como definido na reivindicação 17 em um processo técnico industrial ou doméstico.
Applications Claiming Priority (3)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| DKPA200501156 | 2005-08-16 | ||
| DKPA200501156 | 2005-08-16 | ||
| PCT/DK2006/000447 WO2007019859A2 (en) | 2005-08-16 | 2006-08-15 | Polypeptides of strain bacillus sp. p203 |
Publications (1)
| Publication Number | Publication Date |
|---|---|
| BRPI0614869A2 true BRPI0614869A2 (pt) | 2012-12-04 |
Family
ID=37398972
Family Applications (1)
| Application Number | Title | Priority Date | Filing Date |
|---|---|---|---|
| BRPI0614869-7A BRPI0614869A2 (pt) | 2005-08-16 | 2006-08-15 | polipeptìdeos funcionais, polipeptìdeo maduro funcional isolado, enzima, composição, método para preparar uma composição, construto de ácido nucleico, vetor de expressão recombinante, célula hospedeira recombinante, método para produzir o polipeptìdeo, meio de armazenagem, e , processo |
Country Status (7)
| Country | Link |
|---|---|
| US (2) | US8119387B2 (pt) |
| EP (3) | EP1920052A2 (pt) |
| CN (1) | CN101243181A (pt) |
| AT (1) | ATE503010T1 (pt) |
| BR (1) | BRPI0614869A2 (pt) |
| DE (1) | DE602006020923D1 (pt) |
| WO (1) | WO2007019859A2 (pt) |
Families Citing this family (8)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| EP2126090B1 (en) | 2007-01-31 | 2015-04-01 | Novozymes A/S | Heat-stable carbonic anhydrases and their use |
| US7674608B2 (en) | 2007-02-23 | 2010-03-09 | The University Of Toledo | Saccharifying cellulose |
| JP5563313B2 (ja) * | 2007-03-14 | 2014-07-30 | ザ・ユニバーシティ・オブ・トレド | バイオマス前処理 |
| US7999355B2 (en) * | 2008-07-11 | 2011-08-16 | Air Products And Chemicals, Inc. | Aminosilanes for shallow trench isolation films |
| CN102257148A (zh) * | 2008-12-19 | 2011-11-23 | 诺维信公司 | 具有二氧化硅酶活性的酶的用途 |
| US9012186B2 (en) | 2009-04-27 | 2015-04-21 | The Board Of Trustees Of The University Of Illinois | Hemicellulose-degrading enzymes |
| US9410140B2 (en) | 2011-05-10 | 2016-08-09 | Danisco Us Inc | Thermostable carbonic anhydrases and methods of use thereof |
| CN110295133A (zh) * | 2019-08-02 | 2019-10-01 | 长春理工大学 | 一种细菌纤维素合成菌的筛选方法 |
Family Cites Families (72)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| GB1296839A (pt) | 1969-05-29 | 1972-11-22 | ||
| GB1372034A (en) | 1970-12-31 | 1974-10-30 | Unilever Ltd | Detergent compositions |
| GB1483591A (en) | 1973-07-23 | 1977-08-24 | Novo Industri As | Process for coating water soluble or water dispersible particles by means of the fluid bed technique |
| GB1590432A (en) | 1976-07-07 | 1981-06-03 | Novo Industri As | Process for the production of an enzyme granulate and the enzyme granuate thus produced |
| DK187280A (da) | 1980-04-30 | 1981-10-31 | Novo Industri As | Ruhedsreducerende middel til et fuldvaskemiddel fuldvaskemiddel og fuldvaskemetode |
| DK263584D0 (da) | 1984-05-29 | 1984-05-29 | Novo Industri As | Enzymholdige granulater anvendt som detergentadditiver |
| WO1987000859A1 (en) | 1985-08-09 | 1987-02-12 | Gist-Brocades N.V. | Novel lipolytic enzymes and their use in detergent compositions |
| EG18543A (en) | 1986-02-20 | 1993-07-30 | Albright & Wilson | Protected enzyme systems |
| DK122686D0 (da) | 1986-03-17 | 1986-03-17 | Novo Industri As | Fremstilling af proteiner |
| EP0258068B1 (en) | 1986-08-29 | 1994-08-31 | Novo Nordisk A/S | Enzymatic detergent additive |
| NZ221627A (en) | 1986-09-09 | 1993-04-28 | Genencor Inc | Preparation of enzymes, modifications, catalytic triads to alter ratios or transesterification/hydrolysis ratios |
| DE3854249T2 (de) | 1987-08-28 | 1996-02-29 | Novonordisk As | Rekombinante Humicola-Lipase und Verfahren zur Herstellung von rekombinanten Humicola-Lipasen. |
| JPS6474992A (en) | 1987-09-16 | 1989-03-20 | Fuji Oil Co Ltd | Dna sequence, plasmid and production of lipase |
| DK6488D0 (da) | 1988-01-07 | 1988-01-07 | Novo Industri As | Enzymer |
| EP0394352B1 (en) | 1988-01-07 | 1992-03-11 | Novo Nordisk A/S | Enzymatic detergent |
| JP3079276B2 (ja) | 1988-02-28 | 2000-08-21 | 天野製薬株式会社 | 組換え体dna、それを含むシュードモナス属菌及びそれを用いたリパーゼの製造法 |
| US5648263A (en) | 1988-03-24 | 1997-07-15 | Novo Nordisk A/S | Methods for reducing the harshness of a cotton-containing fabric |
| JP2728531B2 (ja) | 1988-03-24 | 1998-03-18 | ノボ ノルディスク アクティーゼルスカブ | セルラーゼ調製品 |
| GB8915658D0 (en) | 1989-07-07 | 1989-08-23 | Unilever Plc | Enzymes,their production and use |
| IL97645A (en) | 1990-03-23 | 1997-03-18 | Gist Brocades Nv | Production of enzymes in seeds and their use |
| DK0528828T4 (da) | 1990-04-14 | 1998-08-31 | Genencor Internat Gmbh | Alkaliske bacillus-lipaser, DNA-sekvenser, der koder herfor, og bacilli der producerer sådanne lipaser |
| DK115890D0 (da) | 1990-05-09 | 1990-05-09 | Novo Nordisk As | Enzym |
| CA2082279C (en) | 1990-05-09 | 2007-09-04 | Grethe Rasmussen | Cellulase preparation comprising an endoglucanase enzyme |
| DK0548228T3 (da) | 1990-09-13 | 1999-05-10 | Novo Nordisk As | Lipasevarianter |
| CA2095852C (en) | 1990-12-05 | 2001-05-08 | Uffe Lovborg | Proteins with changed epitopes and methods for the production thereof |
| DE69133035T2 (de) | 1991-01-16 | 2003-02-13 | The Procter & Gamble Company, Cincinnati | Kompakte Waschmittelzusammensetzungen mit hochaktiven Cellulasen |
| AU666660B2 (en) | 1991-04-30 | 1996-02-22 | Procter & Gamble Company, The | Built liquid detergents with boric-polyol complex to inhibit proteolytic enzyme |
| EP0511456A1 (en) | 1991-04-30 | 1992-11-04 | The Procter & Gamble Company | Liquid detergents with aromatic borate ester to inhibit proteolytic enzyme |
| ES2121014T3 (es) | 1991-05-01 | 1998-11-16 | Novo Nordisk As | Enzimas estabilizadas y composiciones detergentes. |
| DK72992D0 (da) | 1992-06-01 | 1992-06-01 | Novo Nordisk As | Enzym |
| DK88892D0 (da) | 1992-07-06 | 1992-07-06 | Novo Nordisk As | Forbindelse |
| KR100294361B1 (ko) | 1992-07-23 | 2001-09-17 | 피아 스타르 | 돌연변이체알파-아밀라제,세정제,접시세척제,및액화제 |
| US5792641A (en) | 1992-10-06 | 1998-08-11 | Novo Nordisk A/S | Cellulase variants and detergent compositions containing cellulase variants |
| HU219675B (hu) | 1993-02-11 | 2001-06-28 | Genencor International Inc. | Oxidatívan stabil alfa-amiláz |
| DE69434242T2 (de) | 1993-04-27 | 2006-01-12 | Genencor International, Inc., Palo Alto | Neuartige Lipasevarianten zur Verwendung in Reinigungsmitteln |
| DK52393D0 (pt) | 1993-05-05 | 1993-05-05 | Novo Nordisk As | |
| JP2859520B2 (ja) | 1993-08-30 | 1999-02-17 | ノボ ノルディスク アクティーゼルスカブ | リパーゼ及びそれを生産する微生物及びリパーゼ製造方法及びリパーゼ含有洗剤組成物 |
| EP0724631A1 (en) | 1993-10-13 | 1996-08-07 | Novo Nordisk A/S | H 2?o 2?-stable peroxidase variants |
| JPH07143883A (ja) | 1993-11-24 | 1995-06-06 | Showa Denko Kk | リパーゼ遺伝子及び変異体リパーゼ |
| DE4343591A1 (de) | 1993-12-21 | 1995-06-22 | Evotec Biosystems Gmbh | Verfahren zum evolutiven Design und Synthese funktionaler Polymere auf der Basis von Formenelementen und Formencodes |
| MX9603542A (es) | 1994-02-22 | 1997-03-29 | Novo Nordisk As | Metodo para preparar una variante de una enzima lipolitica. |
| DE69536145D1 (de) | 1994-03-08 | 2011-04-07 | Novozymes As | Neuartige alkalische Zellulasen |
| WO1995030744A2 (en) | 1994-05-04 | 1995-11-16 | Genencor International Inc. | Lipases with improved surfactant resistance |
| AU2884595A (en) | 1994-06-20 | 1996-01-15 | Unilever Plc | Modified pseudomonas lipases and their use |
| AU2884695A (en) | 1994-06-23 | 1996-01-19 | Unilever Plc | Modified pseudomonas lipases and their use |
| ATE294871T1 (de) | 1994-06-30 | 2005-05-15 | Novozymes Biotech Inc | Nicht-toxisches, nicht-toxigenes, nicht- pathogenes fusarium expressionssystem und darin zu verwendende promotoren und terminatoren |
| US5919691A (en) | 1994-10-06 | 1999-07-06 | Novo Nordisk A/S | Enzyme and enzyme preparation with endoglucanase activity |
| BE1008998A3 (fr) | 1994-10-14 | 1996-10-01 | Solvay | Lipase, microorganisme la produisant, procede de preparation de cette lipase et utilisations de celle-ci. |
| CN1167503A (zh) | 1994-10-26 | 1997-12-10 | 诺沃挪第克公司 | 一种具有脂解活性的酶 |
| AR000862A1 (es) | 1995-02-03 | 1997-08-06 | Novozymes As | Variantes de una ó-amilasa madre, un metodo para producir la misma, una estructura de adn y un vector de expresion, una celula transformada por dichaestructura de adn y vector, un aditivo para detergente, composicion detergente, una composicion para lavado de ropa y una composicion para la eliminacion del |
| JPH08228778A (ja) | 1995-02-27 | 1996-09-10 | Showa Denko Kk | 新規なリパーゼ遺伝子及びそれを用いたリパーゼの製造方法 |
| CN1182451A (zh) | 1995-03-17 | 1998-05-20 | 诺沃挪第克公司 | 新的内切葡聚糖酶 |
| EP0839186B1 (en) | 1995-07-14 | 2004-11-10 | Novozymes A/S | A modified enzyme with lipolytic activity |
| JP4068142B2 (ja) | 1995-08-11 | 2008-03-26 | ノボザイムス アクティーゼルスカブ | 新規の脂肪分解酵素 |
| DK0843725T3 (da) | 1995-08-11 | 2002-08-12 | Novozymes As | Fremgangmåde til fremstilling af polypeptidvarianter |
| US5763385A (en) | 1996-05-14 | 1998-06-09 | Genencor International, Inc. | Modified α-amylases having altered calcium binding properties |
| AU3938997A (en) | 1996-08-26 | 1998-03-19 | Novo Nordisk A/S | A novel endoglucanase |
| BR9711479B1 (pt) | 1996-09-17 | 2009-08-11 | variante de celulase tendo uma resistência aumentada a tensìdeo de ánion. | |
| AU730286B2 (en) | 1996-10-08 | 2001-03-01 | Novo Nordisk A/S | Diaminobenzoic acid derivatives as dye precursors |
| CN1530443A (zh) | 1996-11-04 | 2004-09-22 | ŵ����÷������˾ | 枯草杆菌酶变异体和组合物 |
| AU4772697A (en) | 1996-11-04 | 1998-05-29 | Novo Nordisk A/S | Subtilase variants and compositions |
| WO1999046281A2 (en) | 1998-03-10 | 1999-09-16 | Genentech, Inc. | Novel polypeptides and nucleic acids encoding the same |
| WO1998034946A1 (en) | 1997-02-12 | 1998-08-13 | Massachusetts Institute Of Technology | Daxx, a novel fas-binding protein that activates jnk and apoptosis |
| EP1002061A1 (en) | 1997-07-04 | 2000-05-24 | Novo Nordisk A/S | FAMILY 6 ENDO-1,4-$g(b)-GLUCANASE VARIANTS AND CLEANING COMPOSIT IONS CONTAINING THEM |
| US5955310A (en) | 1998-02-26 | 1999-09-21 | Novo Nordisk Biotech, Inc. | Methods for producing a polypeptide in a bacillus cell |
| JP2003500003A (ja) | 1998-10-30 | 2003-01-07 | ノボザイムス アクティーゼルスカブ | 低いアレルゲン性のタンパク質変異型 |
| ATE365210T1 (de) | 1998-10-30 | 2007-07-15 | Novozymes As | Glykosylierte proteine mit reduzierter allergenität |
| WO2001031989A2 (en) | 1999-12-09 | 2001-05-10 | Novozymes A/S | High throughput screening (hts) assays for protein variants with reduced antibody binding capacity |
| CN1288244C (zh) | 2000-04-07 | 2006-12-06 | 诺沃奇梅兹有限公司 | 信号序列捕获 |
| AU2003243748A1 (en) | 2002-06-21 | 2004-01-06 | The Regents Of The University Of California | Animal models of prostate cancer and methods for their use |
| BR0314558A (pt) | 2002-10-10 | 2005-08-09 | Diversa Corp | Proteases, ácidos nucléicos codificando as mesmas e processos para preparar e usar as mesmas |
| JP4324365B2 (ja) | 2002-11-01 | 2009-09-02 | 花王株式会社 | アルカリプロテアーゼ |
-
2006
- 2006-08-15 WO PCT/DK2006/000447 patent/WO2007019859A2/en not_active Ceased
- 2006-08-15 BR BRPI0614869-7A patent/BRPI0614869A2/pt not_active IP Right Cessation
- 2006-08-15 EP EP06761858A patent/EP1920052A2/en not_active Withdrawn
- 2006-08-15 US US12/063,599 patent/US8119387B2/en not_active Expired - Fee Related
- 2006-08-15 EP EP11158884A patent/EP2360246A1/en not_active Withdrawn
- 2006-08-15 CN CNA2006800300118A patent/CN101243181A/zh active Pending
- 2006-08-15 DE DE602006020923T patent/DE602006020923D1/de active Active
- 2006-08-15 AT AT08154306T patent/ATE503010T1/de not_active IP Right Cessation
- 2006-08-15 EP EP08154306A patent/EP1967584B1/en not_active Not-in-force
-
2012
- 2012-01-26 US US13/359,207 patent/US20120122184A1/en not_active Abandoned
Also Published As
| Publication number | Publication date |
|---|---|
| US8119387B2 (en) | 2012-02-21 |
| DE602006020923D1 (de) | 2011-05-05 |
| US20120122184A1 (en) | 2012-05-17 |
| US20100151111A1 (en) | 2010-06-17 |
| CN101243181A (zh) | 2008-08-13 |
| EP1920052A2 (en) | 2008-05-14 |
| EP1967584A1 (en) | 2008-09-10 |
| ATE503010T1 (de) | 2011-04-15 |
| WO2007019859A2 (en) | 2007-02-22 |
| WO2007019859A3 (en) | 2007-05-18 |
| EP2360246A1 (en) | 2011-08-24 |
| EP1967584B1 (en) | 2011-03-23 |
Similar Documents
| Publication | Publication Date | Title |
|---|---|---|
| US7910348B2 (en) | Polypeptides of Alicyclobacillus sp. having glutamic peptidase activity | |
| US9303248B2 (en) | Polypeptides having lipase activity and polynucleotides encoding same | |
| US8263824B2 (en) | Polypeptides having lipase activity and polynucleotides encoding same | |
| EP1709165B1 (en) | Polypeptides of alicyclobacillus | |
| US8143047B2 (en) | Polypeptides of botryosphaeria rhodina | |
| US7960160B2 (en) | Polypeptides having xylanase activity from Aspergillus fumigatus | |
| US20120122184A1 (en) | Polypeptides of strain Bacillus sp. P203 | |
| CN1930285B (zh) | 脂环酸芽孢杆菌的多肽 |
Legal Events
| Date | Code | Title | Description |
|---|---|---|---|
| B06G | Technical and formal requirements: other requirements [chapter 6.7 patent gazette] |
Free format text: SOLICITA-SE A REGULARIZACAO DA PROCURACAO, UMA VEZ QUE BASEADO NO ARTIGO 216 1O DA LPI, O DOCUMENTO DE PROCURACAO DEVE SER APRESENTADO NO ORIGINAL, TRASLADO OU FOTOCOPIA AUTENTICADA. |
|
| B08F | Application dismissed because of non-payment of annual fees [chapter 8.6 patent gazette] |
Free format text: REFERENTE A 7A ANUI DADE. |
|
| B08K | Patent lapsed as no evidence of payment of the annual fee has been furnished to inpi [chapter 8.11 patent gazette] |
Free format text: REFERENTE AO DESPACHO 8.6 PUBLICADO NA RPI 2214 DE 11/06/2013. |