来源:FEBS Open Bio | 编译:DNA Lab Space
酶是生物体内最精巧的分子机器,但天然酶往往无法满足工业催化和医学应用的需求。如何让酶更快、更稳、更专一?科学家给出的答案是——定向进化。一篇发表于 FEBS Open Bio 的综述,系统梳理了这一领域的核心技术演进,并直言不讳地指出了当前方法面临的深层困境。
研究背景
定向进化的核心逻辑并不复杂:模仿自然选择的迭代过程,在实验室中人为加速蛋白质的变异与筛选。每一次循环都包含两步——制造基因多样性,再从突变库中挑出功能更优的变体。这种策略的最大优势在于,它不需要研究者事先掌握蛋白质的结构细节或催化机制。换句话说,哪怕你对酶如何工作一无所知,也能通过反复的“变异-筛选”循环,把它的性能推向新的高度。
这项方法论并非新鲜事物,但它的应用边界正在被快速拓展。从生物技术到医学治疗,再到合成化学,定向进化已经渗透进多个产业领域。然而,酶进化与结合蛋白(binder)进化之间存在显著的方法学差异。结合蛋白的筛选可以依赖物理结合力——例如噬菌体展示技术能从包含数十亿变体的文库中直接“钓”出目标分子;而酶的进化则必须测量催化活性,这要求更精细的筛选策略。
正是这种差异,构成了本综述的核心切入点。作者以结合蛋白进化为参照系,剖析酶定向进化中独有的技术挑战与突破路径。
研究方法
本综述采用文献分析与方法学比较的策略,聚焦于酶定向进化领域的技术演进脉络。作者从三个维度展开论述:筛选平台的类型学分析、关键性技术突破的梳理、以及失败模式的系统性归纳。
在筛选平台层面,综述区分了展示型筛选与定量筛选两大体系。展示型筛选(如噬菌体展示、核糖体展示)依赖物理结合力,能够高效处理超大文库,但其应用场景主要局限于结合蛋白。酶进化则依赖定量筛选策略,此类方法必须严格维持基因型-表型关联——即确保每个突变体蛋白的基因序列与其催化活性能够被一一对应。综述指出,区室化(compartmentalization)是实现这种关联的核心手段,通过将单个基因及其编码蛋白封装在独立的微环境中,研究者可以追溯每个变体的性能。
技术突破层面的分析覆盖了五项关键进展:体外乳液系统、液滴微流控、超高通量分选、基因编码生物传感器以及替代性检测模式。体外乳液技术能够将传统的试管反应体系拆分为数百万个独立的皮升级微反应器;液滴微流控则实现了对液滴的精确操控与分选;超高通量分选系统每秒可处理数千至数万个液滴;基因编码生物传感器将代谢物浓度转化为荧光信号,使得催化活性的实时监测成为可能;替代性检测模式则包括吸光度、化学发光、质谱等多种非荧光读出方式。
在失败模式分析部分,作者归纳了五类典型的定向进化陷阱:替代底物偏差(surrogate-substrate bias)、液滴渗漏、追踪错误、以及过拟合的机器学习模型。替代底物偏差指的是研究者使用模型底物代替真实底物进行筛选,导致进化出的酶对真实底物无效;液滴渗漏则指小分子产物在液滴间扩散,破坏了基因型-表型对应的严格性;追踪错误涉及液滴合并、分裂或错位导致的数据错配;过拟合的机器学习模型则可能在预测突变效应时给出过于乐观的结果。
原文摘要未详述具体实验参数(如液滴尺寸、流速、荧光阈值等),但综述对各技术平台的操作原理进行了系统阐述。作者特别强调了液滴微流控体系中“单液滴-单基因-单酶”的封装逻辑,以及流式分选技术在定量读出方面的核心地位。
研究结果
综述的核心发现可以概括为三个层面:技术能力的量级提升、稳定性约束的结构性瓶颈、以及方法论反思的深化。
在技术能力层面,体外乳液与液滴微流控的结合将筛选通量推升至前所未有的水平。传统微孔板筛选的极限约为每天十万个样本,而液滴微流控系统的分选速度可达每秒数千液滴,相当于将筛选通量提升两到三个数量级。原文摘要未提供具体数值,但综述明确指出,这种通量提升使得研究者能够探索更大规模的序列空间——文库规模从传统的10^4-10^6扩展至10^8甚至更大。基因编码生物传感器的引入进一步改变了筛选的逻辑:不再是“反应后检测”,而是“实时监测”,这使得动力学参数的筛选成为可能,而不仅仅是对终产物的终点分析。
然而,技术突破并未消解一个根本性约束——蛋白质稳定性。综述指出,稳定性始终是酶可进化性的核心限制因素。原因在于,功能增益型突变往往以牺牲稳定性为代价。一个酶在获得新催化活性时,其三维结构可能变得松散,导致热稳定性或溶剂耐受性下降。这意味着,定向进化不仅是在优化功能,更是在一种“功能-稳定性”的权衡中寻找平衡点。综述将这一现象称为“稳定性的中心约束”,并强调它贯穿所有筛选平台,无论通量多高都无法绕过。
在方法学反思层面,综述对五类失败模式进行了深入剖析。替代底物偏差是最常见的陷阱——当研究者使用易于检测的底物类似物代替真实底物时,进化出的酶可能对模型底物高度特异,却对工业应用中的真实底物几乎无活性。液滴渗漏则是一个技术性难题:荧光产物若在液滴间自由扩散,将导致筛选信号失真,使“最优”变体的选择失去可靠性。追踪错误通常出现在多轮筛选中,液滴的合并或分裂会导致基因型与表型记录的错配,累积误差可能使整个进化轨迹偏离预期方向。过拟合的机器学习模型则代表了数据驱动方法的新风险——训练集过小或特征选择偏差可能导致模型对未知突变效应做出错误预测,进而误导后续的突变设计。
这些失败模式并非孤立存在,它们往往相互交织。例如,液滴渗漏会加剧替代底物偏差的效应,因为渗漏导致信号模糊,研究者可能更倾向于选择信号更强的替代底物体系。同样,追踪错误会污染训练数据,使得机器学习模型的预测更加不可靠。
综述还对比了酶进化与结合蛋白进化的关键差异。结合蛋白的筛选依赖物理结合力,其表型读出是二元的——结合或不结合;而酶的筛选依赖催化活性,其表型读出是连续的——活性高低。这种差异导致了筛选策略的根本不同:结合蛋白可以依赖展示平台的高通量物理分选,而酶进化必须依赖定量检测,这通常需要更复杂的区室化策略。综述指出,这种分野正在逐渐模糊——新技术如液滴微流控已被应用于结合蛋白筛选,而展示平台也在尝试引入活性探针以拓展至酶进化领域。
![定向进化里程碑时间线。关键进展从首次体外RNA达尔文进化[1]、PCR和噬菌体展示[2,15]、早期定向进化与诱变策略[4,5,11]、展示与区室化技术[12,13,16,17],到智能文库、高通量筛选、连续进化、深度突变扫描和机器学习辅助定向进化[18,19,20,21,22,23,60]。使用BioRender创建。Tomkova, M.(2026)https://BioRender.com/zg5z0a9。](/d/file/research/202608/art_49_1786437807_0.webp)

讨论与展望
这篇综述的价值不仅在于技术盘点,更在于它揭示了定向进化领域的一个深层张力:通量提升并不自动等同于成功率提升。当筛选速度从每天十万样本跃升至每秒数千液滴时,真正限制进化的瓶颈已经转移——从“筛得不够多”变成了“筛得不够准”。
稳定性约束的存在提醒我们,酶的进化并非无代价的探索。每一个功能增益都在消耗结构稳健性的储备。未来的策略可能需要将稳定性作为筛选的并行标准,而非事后补救。
作者对连续进化与数据驱动方法的整合抱有审慎的乐观。机器学习模型的引入确实可能提升预测能力,但前提是训练数据的质量足够高。综述对过拟合风险的警示,恰恰指向了当前AI辅助蛋白质设计热潮中的一个盲区——模型的预测能力永远不可能超越实验数据的真实性。

定向进化正在从“暴力筛选”走向“智能引导”。这条道路的十字路口,一边是积累了数十年的经典方法学,另一边是自动化、连续化、数据驱动的新范式。综述没有给出简单的答案,但它清晰地标示了路标:任何新技术的引入,都必须经过实验可靠性的检验,否则通量的提升只会加速错误的积累。
参考来源
Tomkova M, Mirossay A, Sedlak E. Directed evolution of enzymes at the crossroads of tradition and innovation. FEBS Open Bio. PMID: 42124363.
PMID: 42124363