返回列表

蛋白质定向进化技术解析与应用

发布于 2026年7月28日

蛋白质定向进化技术解析与应用

在自然界中,蛋白质进化往往以百万年为时间尺度:随机基因突变经自然选择缓慢积累,使蛋白逐步适应环境,造就了地球多样生命。但对产业端快速获取高性能蛋白的需求而言,自然进化速度远远不足。

为此科学家将进化过程搬入实验室,人为制造突变、施加定向选择压力,仅用数月乃至数周就能完成自然界百万年量级的蛋白功能迭代,这项技术即为蛋白质定向进化。2018年诺贝尔化学奖对半分配奖金:一半授予弗朗西斯・阿诺德,表彰其酶定向进化开创性工作;另一半由乔治・史密斯、格雷格・温特共享,表彰噬菌体展示技术的发明。该奖项不仅认可两项生物技术,更确立了全新研发思路:无需完全解析蛋白质全部原子相互作用,依靠模拟自然进化,即可人为引导蛋白向目标性能快速优化。


一、蛋白质定向进化的核心定义与底层逻辑

蛋白质定向进化是在实验室环境下,人为引入突变或基因重组构建蛋白突变文库,依据目标性能设置选择压力,筛选优势突变体,循环开展"突变-筛选-扩增",最终获得符合生产、科研需求蛋白的成套技术。

其底层逻辑与自然进化同源:变异产生分子多样性,选择筛选优势性状,多轮迭代累积有益突变;但二者存在本质区别。自然进化无预设目标,突变随机发生、环境被动筛选,进化方向不可控;定向进化拥有明确改造目标,科研人员围绕高活性、强稳定性、广底物谱等需求设计筛选条件,主动牵引蛋白进化路径。若将自然进化比作无固定终点的漫长马拉松,定向进化便是划定路线、锁定终点的定向越野,同等进化机制下,人工干预让进化效率提升百万倍。


二、定向进化核心技术体系


Core Technical Framework for Directed Evolution

Core Technical Framework for Directed Evolution

定向进化由突变建库、高通量筛选两大模块构成,经过三十余年发展形成成熟技术工具库。

(一)随机突变:构建分子多样性基础

突变文库是定向进化的起点,文库多样性直接决定蛋白优化潜力。

易错PCR:领域内最通用的随机突变手段。通过调整镁离子、添加锰离子、并调整四种dNTP的浓度比例低保真聚合酶降低PCR保真度,在基因中随机引入单点碱基错配。操作简便、适用范围广,但突变类型单一,难以产生大幅序列改造。

饱和突变:靶向定点改造手段。针对蛋白活性中心、底物结合界面等关键功能区域,借助NNK/NNB简并密码子设计,NNK简并策略以32种密码子组合覆盖20种氨基酸,同时避免了2种终止密码子的出现,系统性挖掘位点突变潜力。饱和突变的有益突变富集效率通常高于易错PCR等随机突变策略,但需要提前掌握蛋白结构与功能信息定位关键位点。

(二)重组突变:优势性状模块化重组

DNA改组是典型重组突变技术。将多条同源、序列存在差异的优质蛋白基因切割为短片段,经PCR重新拼接形成嵌合基因,实现不同亲本蛋白优势模块重组,突破单点突变的性能上限,适合在多个优良亲本基础上筛选综合性能更优的突变体。其中StEP(交错延伸PCR)适用于同源序列重组,ITCHY(递增截短杂交法)可实现非同源序列的优势片段重组,共同构成了重组突变的丰富工具箱。

(三)展示技术:突破高通量筛选瓶颈

筛选是传统定向进化的主要效率短板,海量文库中快速富集优质突变体依赖展示技术实现基因型与蛋白功能耦合,大幅提升筛选通量。

噬菌体展示:高通量展示技术的奠基方法,将蛋白变体展示于噬菌体表面,通过亲和富集循环筛选高亲和力蛋白,目前广泛用于抗体亲和力成熟。

酵母表面展示:蛋白表达于酵母细胞表面,搭配流式分选可每小时处理数百万样本,同步检测蛋白表达量与结合能力。

无细胞展示系统(核糖体、mRNA展示):无需活细胞,mRNA展示文库容量可达10¹²~10¹⁴(百万亿级),核糖体展示可达10¹²级,远高于细胞展示系统,拓展序列探索边界。

依托各类展示技术,筛选通量从传统千级样本提升至亿、万亿级,极大拓宽定向进化应用边界。


三、定向进化多元应用场景


Application Landscapes of Directed Evolution

Application Landscapes of Directed Evolution

定向进化通用性强,医药、工业制造、基础科研中所有蛋白相关场景均可落地应用。

(一)生物医药领域

该领域是定向进化商业化落地最成熟赛道。抗体研发中,通过可变区突变搭配展示技术筛选,可数十至百倍提升抗原亲和力,降低给药剂量、减少副作用。

各类治疗蛋白同样依靠定向进化优化:改造胰岛素得到长效、速效剂型适配不同糖尿病人群;凝血因子、干扰素、生长因子经突变优化后稳定性提升、体内作用周期延长、免疫排斥风险降低。

(二)工业酶与绿色生物制造

工业酶是定向进化最早实现产业化的方向。天然酶仅适配体内温和环境,难以耐受工业高温、极端酸碱、高有机溶剂环境。经多轮定向进化改造,淀粉酶、蛋白酶、纤维素酶等工业酶耐受能力与催化效率显著提升。

低温洗涤蛋白酶是标志性案例,低温催化活性改善,减少洗涤热水能耗、保护织物面料。在合成生物学中,进化改造通路关键酶可提升人工代谢通路运转效率,支撑化学品、生物材料、天然产物的绿色生物合成。

(三)生命科学基础研究工具开发

各类科研工具蛋白均经过定向进化迭代优化:荧光蛋白亮度提升、光谱类型更加丰富;光遗传蛋白响应速度、灵敏度优化;基因编辑Cas9靶向精度提升、适配更多PAM序列,脱靶风险下降。优化后的工具蛋白持续推动基础实验技术革新,形成科研与技术双向促进的正向循环。


四、传统定向进化固有瓶颈

传统定向进化虽大幅缩短蛋白改造周期,但随产业需求精细化,三重核心局限逐步凸显。

第一,序列空间探索存在通量上限。 300个氨基酸组成的蛋白理论突变组合高达20³⁰⁰,即便百亿级文库,在全部突变可能性中占比极低,实验手段难以覆盖完整序列空间,容易错过最优突变组合。

第二,多指标同步优化难以实现。 筛选条件决定进化方向,单一性能优化设计简单,但产业通常要求蛋白同时兼顾活性、稳定性、表达量等多项指标,难以搭建同步量化多维度性状的筛选体系,只能分轮分步优化,易出现性状互相抑制、顾此失彼的情况。

第三,迭代周期长、试错成本偏高。 一轮完整的建库、筛选、验证流程耗时数周至数月,完整蛋白研发项目往往需要十几轮迭代,整体周期可达1至2年,难以匹配产业快速开发需求。

传统定向进化整体呈现"目标清晰、探索路径盲目"的特点:研究者明确优化方向,但无法预判突变组合功能效果,每一轮迭代均依靠大量随机试错,研发不确定性较高,人工智能与蛋白质大模型成为破解该困境的核心方案。


Bottlenecks of Conventional Directed Evolution

Bottlenecks of Conventional Directed Evolution


五、AI赋能重构定向进化研发范式

想要解决传统定向进化文库设计盲目、多性状优化困难、迭代周期冗长等痛点,需要依托蛋白质大模型实现突变位点智能预判、虚拟预筛选、多目标协同寻优等定向进化全链条计算赋能能力。市场中已形成成熟落地的工业化解决方案,天鹜科技自研MatwingsVenus™(晓鹜™)对话式蛋白质研发智能体便是代表性产品,该平台已形成成熟的技术服务能力,可面向药企、合成生物企业、科研机构提供全流程定制化蛋白进化研发服务。该智能体搭建独有的对话式干湿闭环体系,打通计算设计与实体实验的数据通路;整套模式可大幅压缩研发周期,已有抗体配基改造项目顺利完成5000升工业化放大验证。

文库设计阶段,依托蛋白结构预测、突变效应计算评估,筛选高潜力突变位点,将百万~亿级随机文库压缩至千级甚至百级高精准文库,大幅降低实验耗材成本,同时提升阳性突变检出率;

筛选优化阶段,通过数字模拟完成虚拟预筛选,提前剔除大量无效突变,把有限实验通量集中于优质候选变体,减少无效实验消耗;

多性状优化阶段,同步评估上百组突变对多重性能的综合影响,在高维序列空间快速找到平衡多项指标的帕累托最优解(即各项性能都不劣于其他方案的最优平衡点),打破传统"一轮一目标"的迭代局限,实现多性能同步协同进化;

产业化落地层面已有成熟案例验证优势:针对一款耐碱性不足的单域抗体配基,仅4个月便将耐碱性提升4倍、使用寿命延长一倍,并完成5000升规模化放大生产。相比传统1至2年研发周期,AI驱动方案可大幅压缩项目时长,适配抗体亲和力成熟、工业酶耐逆改造、功能蛋白表达提升等各类定向进化研发需求。


六、结语

蛋白质定向进化第一次让人类能够主动引导蛋白进化,把自然百万年演化周期压缩至实验室数周,是生物技术领域重要变革。但传统方案受文库规模、筛选能力、人工经验限制,本质仍属于高试错成本的研发模式。

AI与蛋白质大模型的融合,推动定向进化完成自身技术迭代:从人工盲筛转向智能精准筛选,从随机试错转向模型预测驱动。三十余年间,从阿诺德开创酶定向进化,到AI智能体依靠干湿闭环实现全流程辅助蛋白改造,该技术持续自我革新。

定向进化是人类借鉴、超越自然进化规律的典型技术,而人工智能的深度赋能,正开启功能蛋白研发的全新阶段,为医药升级、绿色工业、环境治理等领域提供低成本、高效率的解决方案。