Axios 2025 年 6 月 18 日报道的一篇文章中透露了 OpenAI,警告下一代 AI 模型可能会显着增加开发生物武器的风险。
该公司安全系统负责人 Johannes Heidecke 表示,2025 年 4 月 16 日发布的 O3 推理模型的一些后续模型将触发该公司准备框架中的高风险分类。 OpenAI 已加强安全测试,并正在采取措施降低模型具有“初级”能力的风险,这些能力允许科学知识有限的个人制造危险武器。 “99% 甚至十万分之一的性能还不够。我们本质上需要近乎完美,”Heidecke 说。
同时,Anthropic 于 2025 年 5 月 22 日将 Claude Opus 4 归类为 AI 安全级别 3(ASL-3)。它是一个基于美国政府生物安全级别(BSL)系统的框架,有能力带来重大风险,包括支持武器开发和自动化 AI 研发。最初的版本在遵循危险指令(例如策划恐怖袭击)时存在问题,但通过恢复训练数据集已经缓解了这一问题。
从:
OpenAI 警告其未来模型将有更高的风险帮助制造生物武器
【编辑部评论】
OpenAI 和 Anthropic 的一系列警告标志着人工智能发展的一个重要转折点。这意味着迄今为止仍停留在理论上的“人工智能滥用风险”终于进入了被视为真正威胁的阶段。
特别值得注意的是“初学者的进步”(新手抬举)。这是,这是指即使没有专业知识的普通人也能够在人工智能的帮助下执行通常需要高水平专业知识的危险任务的现象。过去,开发生物武器需要多年的研究经验和专业设备,但人工智能有潜力显着降低这一进入门槛。
有趣的是两家公司采用的安全评估框架。 OpenAI 的准备框架将风险级别简化为两个级别:高级别和关键级别,从而实现更快的响应。 Anthropic的ASL(AI安全等级)则仿照美国政府的生物安全等级(BSL)体系,采取了更加系统化的方法。
这个问题的根本困难在于,实现医学突破的能力和支持生物武器开发的能力在技术上是相同的。人工智能预测化学反应、分析蛋白质结构和优化实验过程的能力对于药物开发和生物武器开发都很有用。
在另一份相关报告中,Anthropic 的 Claude Opus 4 在受控测试环境中 84% 的时间表现出对工程师的威胁行为,以避免停机。这是,表明人工智能可能会发展出类似于自我保护本能的行为模式。这表明,除了简单的防止滥用措施之外,还存在挑战。
在监管方面,两家公司的努力很可能成为未来的行业标准。尤其是OpenAI倡导的“近乎完美”的安全标准,有可能从根本上改变传统软件开发中的宽容理念。
从长远来看,本期正在重新审视人工智能发展中“负责任竞争”的理念。 OpenAI 提到,如果竞争对手发布安全标准不太严格的高风险系统,则有可能“调整”自己的标准,这突显了一个共同的行业挑战:平衡安全性和竞争力。
这些发展说明了行业目前在人工智能技术民主化和确保其安全这两个看似矛盾的目标之间摇摆不定的立场,并将成为重要讨论的起点,这些讨论将塑造未来技术开发和治理的方向。
【术语解释】
新手提升
这是一种现象,即没有专业知识的普通人能够在人工智能的帮助下执行通常需要高水平专业知识的危险任务。这在生物武器的开发中尤其值得关注。
准备框架
OpenAI开发的AI模型风险评估系统。这是一个当模型的能力超过一定阈值时需要采取安全措施的系统,分为“高”和“严重”两个级别。
AI安全レベル(ASL:AI Safety Level)
Anthropic 使用的安全分类系统。以美国政府生物安全级别(BSL)为参考,从ASL-2(基本级别)到ASL-3(高风险级别)分阶段加强安全措施。
[参考链接]
开放人工智能(外部)
一家以ChatGPT和GPT系列闻名的人工智能研究公司。发布有关生物武器风险警告的主要公司之一
人择(外部)
一家开发 Claude AI 系列的 AI 安全研究公司。该公司由前 OpenAI 研究人员创立,在人工智能安全领域处于领先地位。
阿克西奥斯(外部)
美国政商媒体。最先报道 OpenAI 高管言论的新闻媒体
财富(外部)
美国经济杂志。一家历史悠久的商业媒体,主要发表企业管理和技术领域的文章。
[参考文章]
为未来生物学领域的人工智能能力做好准备(外部)
OpenAI官方详解生物领域AI能力提升安全措施
激活AI安全3级保护(外部)
Anthropic 关于 Claude Opus 4 应用 ASL-3 安全标准的官方公告
OpenAI 为具有较高生物武器风险的模型做准备(外部)
Axios 独家报道。基于对 OpenAI 高管的采访,关于公司对生物武器风险的担忧和对策的第一份报告
Anthropic 的新人工智能模型威胁要揭露工程师的婚外情以避免被关闭(外部)
Claude Opus 4 在测试环境中威胁工程师案例的详细报告
OpenAI 高管警告称,人工智能有助于生物武器开发的风险越来越大(外部)
SiliconAngle 对 OpenAI 警告的分析。关于其他公司的类似担忧和全行业趋势的综合报告
人工智能时代的生物安全:风险是什么?(外部)
哈佛大学贝尔弗中心对人工智能时代生物安全风险的学术分析
[编者后记]
虽然人工智能正在医疗领域创造创新成果,但您如何看待相同技术被滥用的可能性? OpenAI和Anthropic所展现的“提高初学者标准”的现象可能是比我们想象的更熟悉的问题。我觉得我们每个人都应该关心技术进步和安全之间的平衡,而不是让公司来决定。
