定向进化启示录:破解酶分子设计的协同密码

来源:Semantic Scholar | 编译:DNA Lab Space

导语

蛋白质工程已迈入“设计”时代,但如何理性获得性能卓越的酶仍是巨大挑战。定向进化通过模拟自然选择,在实验室中快速创制高性能酶,却常被视为“黑箱”操作。Bunzel 等人在《Current Opinion in Structural Biology》发表的综述文章系统梳理了定向进化背后的分子机制,从适应性景观、远程协同到构象动力学,揭示出隐藏的普适规律。这些新见解正推动定向进化从盲目筛选走向理性设计,为合成生物学与绿色生物制造注入强大算力。

1. 研究背景

酶作为生物催化的核心,凭借其极高的专一性、温和的反应条件和环境友好等特点,在现代工业、医药与环境治理中占据不可替代的地位。然而,天然酶的稳定性差、底物谱窄、对非天然底物活力低等缺点严重制约其应用。蛋白质工程的两大经典策略——理性设计与定向进化——长期相辅相成。理性设计依赖高精度三维结构和催化机理,通过定点突变精确改造活性位点,但受限于人们对蛋白质结构-功能关系的认知边界。定向进化则不依赖结构信息,通过反复的随机突变和筛选,在巨大的人工序列空间中“盲选”出性能提升的变体,最终实现功能跨越。2018年诺贝尔化学奖授予 Arnold 的定向进化方法,充分肯定了其在酶工程中的开创性贡献。

然而,定向进化背后的分子逻辑至今模糊不清。为什么某些突变组合能引发性能跃迁?适应性景观在地貌上究竟呈现怎样的崎岖程度?单个突变、协同突变乃至整段插入/缺失在进化过程中扮演怎样的角色?若无深层机理的解析,定向进化容易沦为碰运气的“分子博彩”。Bunzel 等发表在《Current Opinion in Structural Biology》(DOI: 10.1016/j.sbi.2020.12.015)的综述,正是围绕这些问题,整合了近年来深度突变扫描、高通量筛选、分子动力学模拟和机器学习等交叉手段所获得的关键洞见,试图勾勒出定向进化的通用设计原理。

2. 研究方法

Bunzel 等人的综述并非传统实验论文,而是对一类“分析性定向进化”研究路线的系统总结。其核心方法学可拆解为三个环节:

**(1)深度突变扫描与适应性景观绘图。**

传统的定向进化每轮只挑选最优克隆,遗漏了大量适应度信息。深度突变扫描技术通过在每个位点上系统引入所有可能的单个氨基酸替换,结合高通量测序或分选手段,一次性绘制出基于“序列-功能”的大规模适应度图谱。将单个位点的效应连结成网络,便可在计算机上重构出完整的局部适应性景观。作者重点讨论了适应性景观的“崎岖度”——即存在大量上位效应导致的局部最优与非加和性。这种崎岖程度决定了定向进化是否容易陷入次优陷阱。

**(2)时间分辨晶体学与分子动力学模拟。**

为了捕捉突变介导的构象动力学变化,研究人员借助时间分辨串行飞秒晶体学和长时间尺度全原子分子动力学模拟。这些技术能揭示酶在催化循环中各中间态的构象分布,并量化突变对构象系综的扰动。文中强调,很多有益突变并非直接参与化学转化,而是通过“动态变构”调控活性位点残基的精确排布,甚至改变蛋白质整体柔性。

**(3)机器学习辅助的模式挖掘。**

随着序列-功能数据集的膨胀,统计学习与深度学习模型被用于提取有益突变的序列特征和结构特征。作者集中讨论了随机森林、变分自编码器和图神经网络等在预测协同突变中的表现。这些模型可以从有限的实验数据中泛化出“可突变性”评分,并用于指导半理性的迭代设计,显著压缩实验筛选量。

上述方法不再是独立的,而是彼此印证:适应性景观反映突变结果,动力学模拟提供物理诠释,机器学习则实现知识聚合和前瞻预测。由此,定向进化逐渐从单纯的高通量实验科学,转变为“实验+计算+模型”三位一体的理性工程学。

3. 研究结果

Bunzel 等梳理出以下核心发现,这些发现共同指向一个更精确的“可设计性”框架:

**(1)适应性景观的全局崎岖与局部平滑并存。**

多个酶系的深度突变扫描一致表明,单点突变的适应度分布大致呈指数型衰减:绝大多数突变中性或有害,极少数有利,且有利突变的概率通常低于1%。当同时引入两个或多个突变时,上位效应普遍存在——约30%~50%的双突变组合表现为显著的非加和性,即协同或拮抗。然而,在不完全远离天然序列的区域内,适应性景观往往呈现一定的平滑性,使得渐进式进化可行的概率远高于完全随机漫步。

**(2)远程上位效应与别构网络。**

最令人惊讶的发现是,许多强协同突变在空间上远离活性位点,甚至位于非结构化的环区或结构域界面。通过对上百个有益突变的统计分析,作者揭示这些远程突变往往依赖于蛋白质内部的物理别构网络,通过微调整体动力学模式传递到活性中心。例如,部分突变能够优先稳定催化有利的闭合构象,或者降低产物释放的能量势垒,从而提升催化周转数。这些发现颠覆了“只在活性位点周围突变”的传统直觉,提示酶骨架的全局振动模式同样值得改造。

**(3)构象动力学作为可调谐的功能手柄。**

通过比较同一酶系不同催化步骤的限速变化,综述指出蛋白质的构象采样往往比化学步骤本身更敏感于突变。换句话说,提升酶活的突变更多是加速了构象重排而非直接降低活化能垒。某些高活性突变体并非拥有全新的催化构象,而是将原本稀有的活性构象的概率密度提升数倍。这意味着,针对构象动力学的定向进化可看作一种“构象工程”,通过优化亚稳态的相对稳定性来调节功能。

**(4)序列空间的路径连通性与模块化。**

定向进化的成功强烈依赖于序列空间中是否存在连续的向上阶梯。综述中的多个案例表明,即便是高度崎岖的景观,也常隐藏着“隧穿”路径——即需要通过中性漂移或稍微有害的中间态才能到达的更高适应度区域。与此同时,酶的不同功能属性(如热稳定性与催化效率)在序列编码上常常部分可解耦,形成模块化结构。这一特性使得我们可以分别优化不同功能,再通过重组将它们整合,从而极大加快多性状共优化的进程。

**(5)设计规则的可转移性。**

通过横向对比水解酶、氧化还原酶和转移酶等不同超家族的定向进化实验,作者发现了一些跨家族的通用规律:如柔性环区的趋向刚性化可提升整体稳定性,而活性位点周围环区适度增加柔性往往利于底物接纳;带电残基的重新分布能重塑活性位点静电势,优化过渡态稳定化;疏水核心的二次壳层突变对热稳定性的贡献尤为突出。这些普适设计规则已经开始以知识库的形式沉淀,并成功应用于指导新酶的设计。

4. 讨论与展望

Bunzel 等人的工作清晰地指明,定向进化正从“黑箱”走向“半透明”,我们对有益突变的来源、协同模式和作用机制有了前所未有的理解。然而,当前的知识仍集中在回顾性解释,前瞻性预测能力依然不足。最大挑战在于,适应性景观的维度极高,即便是深度突变扫描也只能覆盖序列空间的一小部分,而实际工业应用往往要求同时优化若干个相关性很弱的性质,这使得景观的协同形貌更为复杂。

未来的酶设计将更强烈地依赖物理启发型机器学习模型。将分子动力学模拟得到的构象系综与突变效应映射到核方法或图神经网络中,有望在未实验测量的序列上实现较为可靠的适应度预测。此外,生成式计算在蛋白质设计中的初步成功,提示我们可以直接“幻想”出满足特定功能约束的全新序列,并用定向进化的视角进行过滤和验证。在实验维度,基于微流控的超高通量筛选与连续定向进化系统的成熟,将使我们在获得有益突变的同时实时收集海量序列-功能数据,形成“设计-构建-测试-学习”的闭环。

值得强调的是,酶设计正处于范式转换的节点:我们不再仅仅问“这个突变是否有益”,而是开始追问“为什么有益,以及它在全局景观中扮演什么角色”。这种从唯象到机理的跨越,将使人类真正成为酶分子的“设计师”而非“驯化师”,在绿色合成、碳固定和生物医药等领域释放出巨大潜力。

5. 参考来源

H. Bunzel, J. Anderson, A. Mulholland. Designing better enzymes: Insights from directed evolution. *Current Opinion in Structural Biology*, 2021. DOI: 10.1016/j.sbi.2020.12.015

DOI: 10.1016/j.sbi.2020.12.015

延伸阅读:更多代谢通路设计、多基因组装等合成生物学工具,可访问 DNA Lab Space

📎 相关文章

大肠杆菌代谢工程实现O-琥珀酰-L-高丝氨酸高效生产 09-12 从Gibson组装到无细胞表达 09-12 整合代谢工程与生物过程优化实现枯草芽孢杆菌表面活性素高产 09-12 基于染色质可及性的酿酒酵母基因表达水平多机器学习模型预测 09-12