多年来,AI驱动的药物开发中最引人注目的合作涉及专业公司,它们专注于靶点识别、蛋白质结构预测、分子生成、虚拟筛选或实验室自动化。制药集团也严重依赖云服务商、芯片公司和数据平台供应商来提供这些项目背后的基础设施。

人工智能与制药研究之间的关系正在发生变化。
多年来,AI驱动的药物开发中最引人注目的合作涉及专业公司,它们专注于靶点识别、蛋白质结构预测、分子生成、虚拟筛选或实验室自动化。制药集团也严重依赖云服务商、芯片公司和数据平台供应商来提供这些项目背后的基础设施。
现在,第二类供应商正在深入这一行业。OpenAI、Anthropic和Google不再仅仅被视为通用聊天机器人或办公助手的提供者。它们的模型正在进入科学研究、临床开发、医学写作、监管事务、编码、数据分析、生产调查和企业决策领域。
因此,制药公司面临的战略问题已不仅仅是"员工应该使用哪个聊天机器人?"
真正的问题是:
什么样的模型、数据系统、科学工具、安全控制措施和人工审核流程组合,能够成为公司可靠的情报层?
Big Pharma Sharma在2026年5月发布的一项分析追踪了27项已确认的战略合作,涉及21家大型制药公司和三个前沿AI生态系统:OpenAI、Anthropic和Google Gemini。
该数据集报告了以下大致分布:
| 发现 | 报告结果 |
|---|---|
| 追踪到的已确认合作 | 27项 |
| 涉及的大型制药公司 | 21家 |
| 涉及Anthropic的合作 | 约52% |
| 涉及OpenAI的合作 | 约41% |
| 涉及Gemini的合作 | 2项 |
| 同时与OpenAI和Anthropic合作的公司 | 至少6家 |
| 涉及研究或发现的合作 | 约82% |
这些数据可作为市场快照,但并非所有制药AI项目的官方统计。私人试点项目、云合同、内部模型部署、专业模型合作以及未公开的实验可能未纳入数据集。
这些数字也不意味着制药行业已明确划分为OpenAI阵营、Claude阵营和Gemini阵营。
更重要的模式是多模型实验。大型公司正在针对不同任务测试不同的系统,同时围绕专有数据、验证工具、企业权限和人工监督构建更广泛的技术栈。
对于个人用户而言,前沿模型可用于写作、搜索、总结、头脑风暴或编码。
制药部署有额外要求。
该模型可能需要:
由此形成至少三个采用层级。
在该层级,企业向大量员工开放AI助手。
典型应用场景包括:
莫德纳是该模式的早期实践者。该公司自2023年起与OpenAI合作,先搭建内部助手mChat,随后将ChatGPT Enterprise部署到数千名跨职能员工。
百时美施贵宝在2026年采取类似广泛策略,宣布将Claude部署至研发、临床开发、生产制造、商业及企业职能部门,覆盖超3万名员工并接入数千个内部数据源。
该层级超越通用助手范畴。
模型被整合到明确流程中,例如:
在此阶段,AI系统不再仅是提高写作效率的工具,而是成为流程本身的组成部分。
有效部署需具备:经批准的模板、可靠来源检索、结构化输出、版本控制、质量核查及专家评审。
该层级为智能体平台,可协调多种工具与信息源。
智能体可执行以下操作:
默克公司与谷歌云的长年合作体现该方向。这项价值数十亿美元的合作计划,旨在通过Gemini Enterprise在研发、生产、商业运营及企业职能中部署智能体平台。
在此层级,竞争焦点不再是员工浏览器标签页上显示哪个品牌标识,而是哪个平台能协调企业新一代科学及运营工作流。
Anthropic在合作伙伴中占据最大份额
在大型制药公司夏尔马数据集中被统计。
这一早期定位与克劳德的企业及生命科学战略相契合。
制药团队通常需要一个模型来处理:
这些需求与Antropic对克劳德的定位高度吻合。
Antropic于2025年推出克劳德生命科学版,增加了针对科学平台和信息源的集成与连接器。
该生态系统已宣布的服务包括:
其目标是让克劳德更贴近科学家现有工具,而不是要求每项任务都从手动复制文本开始。
Antropic在2026年通过推出克劳德科学版扩展了这一方法。这是一个集研究工具、计算资源和可审计成果于一体的科学工作平台。
百时美施贵宝于2026年5月宣布与Antropic达成战略协议。
该公司表示,克劳德企业版将部署到其全球运营中,包括:
百时美施贵宝将克劳德描述为一个共享智能平台,而非单一用途的应用程序。其目标是连接员工和代理与内部数据,同时在不同工作流程中创建通用的交互层。
此类协议有助于解释Antropic的合作伙伴数量。该产品不仅作为模型API销售,更是一个安全的企业环境、编码工具、代理框架和知识接口。
诺和诺德的NovoScribe是克劳德在受监管文档工作流程中使用的最清晰的例子之一。
该系统结合了:
Antropic报告称,以前需要超过十周的临床研究文档,现在通过该平台大约十分钟即可生成。
该数字是公司报告的案例结果,并非针对每份临床文档的保证。即便如此,该工作流程展示了为何大语言模型在监管写作中具有吸引力。
临床报告及相关文件通常:
模型可以协助信息提取、初稿生成、格式化和一致性检查。而科学判断、监管责任、审批和最终责任仍由合格的专业人员承担。
这是一个重要的区别。克劳德的早期
在制药领域的成功,并不必然证明它在发明新药方面更胜一筹。它说明的是,Anthropic 找到了能够快速衡量价值的企业工作流程:编码、文档生成、知识检索和结构化分析。
OpenAI 进入制药行业的路径则略有不同。
其早期优势来自于:
Moderna 于 2023 年开始与 OpenAI 合作。
这家公司最初创建了一个名为 mChat 的内部聊天机器人。随后,它在多个业务职能领域推广了 ChatGPT Enterprise 的使用,并鼓励员工为重复性任务构建专门的 GPT。
这是一种自下而上的生产力模式。研发、法务、制造、商业和行政团队的员工可以识别高频使用场景,并围绕这些场景创建内部助手。
这样做的好处是广泛尝试。风险则在于如果每个部门都在缺乏统一治理、评估标准和数据管控的情况下构建工具,可能导致碎片化。
赛诺菲于 2024 年宣布与 OpenAI 和 Formation Bio 合作,共同开发用于药物研发的人工智能软件。
该合作整合了:
这些公司后来推出了 Muse,一款旨在支持临床试验患者招募的工具。
这标志着从通用员工辅助迈向明确的药物开发工作流程。
OpenAI 于 2026 年推出了 GPT-Rosalind,这是一个专门为生命科学研究构建的模型系列。
该系统旨在对以下领域进行推理:
OpenAI 还开发了用于文献分析、下一代测序、单细胞分析和分子结构审查等工作流程的生命科学插件和科学查看器。
GPT-Rosalind 标志着一项战略转变。
OpenAI 不再仅仅为制药公司提供通用型企业助手。它正在为生命科学研究构建独立的模型系列、评估框架、工具层和受控访问计划。
该公司自身的 LifeSciBench 结果也表明,谨慎行事仍然必要。GPT-Rosalind 在评估的模型集中处于领先地位,但其整体任务通过率远未达到完美,尤其是在对工件、设计要求高且操作受限的工作中。
领域模型能够提升性能,但并不能取代专家验证的必要性。
OpenAI 的生命科学战略还包括将模型连接到实验平台的工作,从而实现自动化的实验设计和执行。
实验系统。
原文重点提及了涉及Ginkgo Bioworks和Retro Biosciences的项目。
重要的方向并非某个孤立的结果,而是构建一个闭环的尝试:
如果这个闭环变得可靠,AI的角色将超越总结科学信息,它能参与迭代式的实验设计。
这是一个比文档生成要求更高的标准。系统必须应对嘈杂数据、不完整的生物学认知、失败的实验、设备限制以及安全约束。
因此,对科学进步的宣称应通过可重复的实验和真实的研发成果来评估,而非仅仅基于模型基准测试或新闻稿。
在大型制药公司Sharma的数据集中,Google Gemini仅出现在两个合作关系中。
这个数字并未反映Google在生命科学领域的全部布局。
Google的解决方案包括:
采用Gemini的制药公司可能购买的是一个集成的云和数据架构,而非单一的模型。
默克公司与Google Cloud于2026年4月宣布了一项多年期合作伙伴关系,价值高达10亿美元。
此次合作旨在将Gemini Enterprise和Google Cloud技术应用于:
预计Google Cloud工程师将与默克团队合作进行部署。
这是一种大型的、基础设施层面的协议,这类协议可能会使合作数量统计产生误导。谷歌可能公开宣布的交易较少,但仍能获得广泛的战略承诺。
谷歌还受益于Google DeepMind的科学信誉。
AlphaFold改变了蛋白质结构预测的实际格局,并已成为重要的研究资源。Google DeepMind和Isomorphic Labs继续致力于生物学和药物设计系统。
在制药架构中,Gemini可以作为自然语言和任务编排层,而专门的科学模型则执行结构、化学或生物学预测。
因此,谷歌的长期优势可能来自于集成:
在被追踪数据集中,至少有六家制药公司与OpenAI和Anthropic都有合作。
这是其中一项最...
重要发现。
大型制药公司不太可能将所有关键工作流程交给单一模型供应商,因为能力、价格、延迟、产品设计和法规仍在快速变化。
多模型架构使企业能够将工具与任务相匹配。
输入一句想法,We0 AI 即可生成展示站、页面与 CMS。发布上线后并帮你获取客户和流量。
用户注册赠送一次完整项目生成
适合先体验一次完整生成流程,快速看到项目初稿。
例如:
这并不意味着每家公司都会使用所有供应商。
这意味持久的资产不太可能是模型品牌本身。
持久的资产是控制以下内容的内部平台:
成熟的制药人工智能平台可能包含多个层级。
| 层级 | 作用 |
|---|---|
| 用户与代理界面 | 接收目标、问题和审核决策 |
| 编排层 | 规划任务并将工作路由至模型和工具 |
| 前沿语言模型 | 处理推理、写作、编码和协调 |
| 领域模型 | 执行生物学、化学、结构、成像或基因组学任务 |
| 数据层 | 提供对内部和外部信息的受控访问 |
| 科学工具 | 运行经过验证的计算、分析和模拟 |
| 企业系统 | 连接临床、监管、制造和业务工作流程 |
| 评估层 | 衡量准确性、遗漏、引用、可复现性和风险 |
| 治理层 | 控制权限、审计日志、留存和审批 |
| 人类专家 | 审查证据、做出决策并保留问责权 |
这种架构还能减少供应商锁定。
如果模型质量下降、成本上升或可用性发生变化,编排层可将部分工作负载路由到其他地方——前提是公司已建立标准化的接口和评估机制。
追踪分析报告显示,约82%的合作涉及研究或发现阶段。
这种集中反映了当前大语言模型的优势领域。
研究和临床开发包含大量模型可处理的信息:
在早期研究中,模型可辅助:
在临床开发中,它们可支持:
可行性。
这些任务信息密集,通常在决策影响患者或产品之前,允许专家进行审核。
生产与化学、制造和控制(通常称为CMC)领域,公开披露的前沿模型部署案例较少。
原因并非缺乏潜在价值。
可能的用例包括:
差异在于风险。
错误的研究假设可以通过后续实验推翻;但错误的生产指令可能影响产品质量、供应、合规性或患者安全。
生产环境还依赖于:
在此环境下,AI系统需要更强的验证、更窄的行动边界以及更严格的人工监督。
这解释了为什么生产领域可能先从文档检索和偏差分析等受控用例入手,再逐步扩展到自主过程控制。
GSK与公开合作模式形成重要对比。
该公司开发了JulesOS,这是一种内部基于智能体的操作系统,可访问一个由智能体和专用模型组成的社区。
GSK对该平台的描述是,它整合了:
这种方法使GSK在编排、数据访问、验证和用户界面方面拥有更强控制力。
同时,它可能帮助公司从其专有数据集(包括内部实验结果、组学信息、临床证据和靶点知识)中获取更大价值。
内部平台并不意味着所有组件都从零开始构建。
GSK仍可能使用外部云基础设施、开源软件、第三方模型或专业工具。区别在于,公司掌控集成层,并决定这些组件如何向员工开放。
两种策略各有优势。
| 外部前沿AI合作 | 内部智能体平台 |
|---|---|
| 更快获取新模型能力 | 对架构和数据拥有更强控制 |
| 供应商工程与支持 | 对内部工作流进行深度定制 |
| 企业部署更简便 | 减少对单一供应商的依赖 |
| 模型快速迭代改进 | 对编排与评估有更强自主权 |
| 可能存在供应商锁定风险 | 较高的工程和运维成本 |
许多公司会采取两者结合的方式。
他们可能一边构建内部平台,同时——
以下是翻译成简体中文的结果:
使用其底层的Claude、GPT-Rosalind、Gemini、开源模型以及专业科学系统。
目前,医药领域部署LLM所能带来的最可测量的价值来自知识工作。
例如:
这些好处能相对较快地被观察到。
但要证明某个前沿模型做到了以下几点则要困难得多:
药物开发需要数年时间。最终结果取决于生物学、实验质量、毒理学、生产制造、患者个体差异、试验设计、临床运营以及监管审查。
模型无法绕开物理验证。
这并不意味着文档和编码生产力就不重要。更快的知识工作可以缩短整个开发过程中的周期。它只是意味着行业应将工作流效率与科学成功区分开来。
一个前沿模型可能在语言、推理和规划方面很强,但仍可能缺少解决特定医药问题所需的完整数据。
长尾药物资产、历史临床项目、专有实验结果、已终止研发的化合物以及内部决策记录可能不会出现在公开训练数据中。
因此,一个现实的生命科学AI架构需要结合以下要素:
通过经批准的工具将模型连接到专业数据库,可能比从一个前沿模型切换到另一个更有价值。
数据与工具接口的质量可能与模型的推理能力一样决定着最终结果。
新的合作格局正迫使制药公司提升那些本就困难的能力。
大多数大型制药公司都拥有海量数据。
挑战在于这些数据可能:
如果组织没有建立清晰的标准和访问控制机制,模型就无法可靠地使用信息。
购买一个企业级聊天机器人相对简单。
将AI嵌入到
一份临床报告、监管申报、药物警戒流程、质量体系或实验室工作流需要流程重新设计。
团队必须决定:
公开基准测试无法回答模型是否对一个公司的药物研发工作流安全有用这一问题。
制药评估应使用真实的内部任务,并衡量:
一个能生成令人印象深刻的草稿但创造更多审核工作的人工智能系统可能提供的实际价值很小。
Claude、OpenAI 和 Gemini 正在进入制药领域的不同路径。
Anthropic 正在强调:
OpenAI 正在结合:
谷歌正在结合:
可能的结果不是在所有制药工作流中只有一个赢家。
更现实的未来是一个平台,其中多个模型共存,并根据任务进行路由。
一个模型可能审阅文献。另一个可能生成代码。一个专用模型可能预测分子特性。一个企业代理可能协调数据库、软件和审批。一个实验室平台可能测试结果。
在这种架构中,模型只是一层。
价值来自完成一个可靠的循环:
许多公司正在使用不止一个。2026 年 5 月的一项合作分析发现,至少六家大型制药公司与 OpenAI 和 Anthropic 都有合作,表明多模型策略已经常见。
Claude 的定位围绕长文档、结构化写作、编码、企业安全、引用和科学集成。这些功能适合受监管的知识工作流,如临床写作、内部研究、编码和文档审查。
GPT-Rosalind 是
OpenAI的生命科学模型系列,用于生物学、化学、药物发现、基因组学、证据及科学工具的推理。该模型通过受控的研究预览和企业访问结构进行部署。
谷歌将Gemini定位为更大规模云与智能体基础设施的一部分。默克公司与谷歌云在2026年达成合作,计划将Gemini Enterprise应用于研发、制造、商业及企业工作流程。
JulesOS是葛兰素史克自主研发的智能体操作系统。它通过统一环境整合专业模型、编码工具、数据分析系统及公司知识库,供研究人员使用。
人工智能可协助进行源数据提取、初稿生成、格式统一、一致性检查及结构化文档生成。但最终的科学判断、合规审查、审批与责任归属必须由合格专业人员负责。
相较于提高临床成功率,现有公开证据更偏向证实其可提升研发效率。对靶点质量、候选药物筛选、安全性及试验结果的实际影响仍需更长时间验证。
不同模型在性能、成本、响应速度、工具生态及部署方案上各有优势。多模型平台既能降低对单一供应商的依赖,也能将不同任务分配给最适配的系统。
Anthropic 关于受监管文件流程及生产力提升的报告。
大型制药公司不再将 ChatGPT、Claude 和 Gemini 视为孤立的聊天工具,而是将其作为企业 AI 基础设施的组件进行测试——这些组件能够连接内部数据、科学工具、受监管流程及代理系统。
目前,Anthropic 在公开合作数据集中占据最大份额;OpenAI 正从通用企业应用扩展至专用生命科学模型;Google 则通过更广泛的云服务、数据、科学模型及代理平台展开竞争。与此同时,葛兰素史克的 JulesOS 表明,大型药企可能选择自行控制编排层。
近期最显著的收益在于加速文档处理、代码编写、知识检索及数据分析。关于前沿模型能提升药物质量或临床成功率的论断,仍需长期实验和临床证据验证。
决定性优势并非来自选择某个模型品牌,而是构建一个可靠、可审计的闭环系统——将模型、专有数据、已验证工具、实验及可问责的人类决策紧密相连。
从一句话开始,几分钟内拿到完整网站。