Sakana Fugu公布了捆绑多个AI的新思路——出口管制时代的“AI主权”是什么?

“我应该如何捆绑它?”而不是“我应该使用哪种人工智能?” - 提出问题四月 Beta 测试起源于日本的编排人工智能终于开始作为正式版本运行。依赖单一公司的模式可能会导致访问突然暂停,业务可能会结束。既然这样的风险已经成为现实,东京研究机构 Sakana AI 给出的答案是“团结并引导全世界的人工智能”。新产品“Fugu”拥有通过单一窗口控制多个模型的机制,并将以“人工智能主权”这一挑衅性的措辞向公众开放。我们将解读不可忽视的目标和保留点。


2026 年 6 月 22 日,Sakana AI 开始全面推出新产品“Sakana Fugu”,该产品提供多代理编排系统作为单一平台模型。有两种模型:Fugu 和 Fugu Ultra,这两种模型都可以从单个 OpenAI 兼容 API 中使用。 Fugu本身是一个语言模型,可以动态调用代理池中的LLM来处理多步骤任务。

据称,Fugu Ultra 的基准测试性能与 Anthropic 的《神鬼寓言 5》和《Mythos Preview》相当,但这两种型号均未普遍上市,也不包含在 Fugu 的池中。它是通过大约 500 名测试人员参与的 Beta 计划提供的。基础研究是Trinity和Conductor,被ICLR 2026采纳。

提供日常使用的订阅和即用即付计划。

从: Sakana Fugu:一款统领所有的模型

【编辑部评论】

我现在提出这个问题的原因是发布日期本身位于东京的研究机构 Sakana AI 承诺“在没有出口限制风险的情况下提供前沿级能力”背后的故事在于最近发生的事件。 2026 年 6 月 12 日,根据美国政府的出口管制令(据美国商务部/BIS 报道),Anthropic 在全球范围内暂停了其顶级游戏《神鬼寓言 5》和《神话 5》。据称,这是美国前沿人工智能公司出于安全原因在全球范围内停止提供特定模型的第一例,而此次发布是在其影响尚未平息之际进行的。

技术核心在于“编排模型”的思想。传统的多智能体系统需要人类提前设计角色和程序。 Fugu 的不同之处在于何时将工作委托给其他模型、如何与它们交互以及如何总结结果。Fugu自己正在学习什么是。学生们不是预先指定角色和如何进行,而是自己学习人类永远不会想到的组织和合作模式。对于用户来说,接触点被整合到一个 API 中,他们不需要意识到内部的复杂性。

这里起作用的不仅仅是对单个问题给出一个好的答案;能够彻底完成长期且复杂的任务是。它的真正价值体现在需要数十次阅读、实现、验证和修改步骤的任务中,例如复制论文、安全评估和专利研究。它应该被视为与基于设计理念的一次性问答方式不同的东西。

积极的方面是显而易见的。独立于一家公司不再是一个偏好问题,而是一个业务连续性风险管理问题。即使提供商限制使用,Fugu 也可以通过替换池中的模型来绕过此限制。“动态切换”然而,它为组织和国家提供保险的论点是有说服力的。 Sakana AI 做到了这一点“人工智能主权”当我说这句话时,我确实意识到了上述规定。

另一方面,我想冷静地保留一些保留。首先,许多公布的基准都是每个提供商自我报告的值,并没有在相同条件下经过第三方验证。事实上,虽然 GPQA-D 显示了 95.5 和 LiveCodeBench 93.2 等数字,但《神鬼寓言 5》的表现优于 SWE-Bench Pro 和 Humanity 的 Last Exam (53.3),因此结果并不统一。更讽刺的是,基准测试中对比的《神鬼寓言5》于6月9日全面上市,但于6月12日停产(《神话5》也同时停产),目前无法访问,因此两者均未纳入Fugu的代理池中。一些研究人员认为,该系统对未公开的前沿模型组合的依赖夸大了其独特性。尽管它声称已为出口限制做好了准备,但其实力得到了其他公司模型的动态使用的支持。结构扭曲作为读者,这是不可忽视的一点。

监管影响的角度也很重要。 Fugu 的政策是通过一组不依赖于监管模型的可互换模型来追求前沿性能,这本身就是监管改写竞争规则这表明公司开始被鼓励“在设计时考虑到合规性”。可用性有不同程度,目前在欧盟/欧洲经济区内尚不可用,虽然订阅价格是公开的,但您需要联系我们了解企业的​​详细条款和条件。应该记住,并非每个人都能够在相同条件下使用它。

从长远来看,衡量人工智能进步的标准将是从“更大的单一模式”到“更智能的监管机构”这一宣布象征着这一转变。换句话说,我们已经进入了一个地缘政治影响技术架构本身形式的时代。我认为,一个日本本土的研究机构向世界展示这个问题的意义是相当大的。我们将带着期待和担忧继续关注这一趋势的走向。

【术语解释】

多代理编排
将角色分配给多个人工智能模型(代理)、进行协作并协调它们以产生单一结果的系统。 Sakana Fugu 的独特之处在于它本身就提供了这种协调作用作为模型。

基础模型(基础模型)
它是用大量数据预先训练的、可应用于多种用途的通用大规模人工智能模型的总称。

LLM(大规模语言模型)
一种学习大量文本并执行句子生成和推理的语言模型。 Fugu 本人是一名法学硕士,并接受过向其他法学硕士求助的培训。

代理池
一组作为编排目标的可调用模型。 Fugu 使用该池中的模型,并根据需要替换它们。

AI主権(AI主权)
这个概念是指人工智能可以自主使用和控制的状态,而不依赖于单一公司或国家。这是Sakana AI提出的作为Fugu存在理由的关键词。

输出规制(输出管理)
政府出于安全原因限制向海外提供某些技术和产品的制度。 Anthropic 的最新订单是根据 2018 年出口管制改革法案 (ECRA) 进行分析的。

微调
出于特定目的对现有模型进行额外学习和调整。它被广泛用作一种可以用少量数据针对特定应用进行优化的方法。

基准
一组使用常见任务衡量模型性能的评估指标和测试。此次公布的数据主要是各提供商自行报告的数值,尚待独立第三方验证。

ICLR
International Conference on Learning Representations 的缩写,机器学习领域的大型国际会议。 Fugu 基于 ICLR 2026 接受的论文“Trinity”和“Conductor”。

[参考链接]

Sakana AI(官方网站)(外部)
东京一家人工智能研发公司的官方网站。包含进化模型融合和AI科学家的研究,以及与Fugu相关的信息。

Sakana Fugu(产品页面)(外部)
Fugu 和 Fugu Ultra 的官方介绍页面。它还包括技术概述、基础研究、定价计划以及它在欧盟/欧洲经济区不可用的事实。

扫描AI控制台(外部)
实际使用 Fugu API 的控制台。作为订阅和即用即付计划联系点的官方网站。

Anthropic“关于暂停访问《神鬼寓言 5/神话 5》的声明”(外部)
这是Anthropic关于美国政府出口管制令的官方声明页面,这是这一地缘政治背景的起点。

[参考文章]

Sakana Fugu:多智能体人工智能编排模型 2026(DigitalApplied)(外部)
批判性地审视演示文稿的评论。它认为应该整理价格和基准数据,并通过第三方验证仔细审查竞争性主张。

美国出口令后,Anthropic 禁用《克劳德寓言 5》和《神话 5》(Quartz)(外部)
报告出口法规细节的文章。它还分享了 Anthropic 的数据,包括 9650 亿美元的估值和 470 亿美元的销售运行率。

商务部限制使用 Anthropic 的最新型号。接下来会发生什么?(CSIS)(外部)
分析监管法律框架的评论。相信涉及商务部/BIS、ECRA等权威机构的参与。

Anthropic 受到没人理解的出口规则的打击(The Verge)(外部)
报告包括专家的观点。其指出,这是首次以这种方式利用出口管制来限制对人工智能模型的访问。

Sakana AI 推出 Fugu Ultra,一款编排代理 (digg)(外部)
从多个角度聚合反应。它介绍了优点和缺点,例如对夸大其独特性的怀疑以及目前主要在欧盟以外提供的事实。

[相关文章]

Sakana Fugu beta 测试开始 |来自日本的 Orchestration AI,捆绑了多个基础模型(内部)
beta测试阶段的报告,这是本文的第一部分。这是一本与“指挥者级别”和“AI主权”同题的必读书籍,并作为后续报道直连。

人为《神话》《神鬼寓言5》全面停播,白宫出口限制详解及中国准入疑点(内部)
出口法规的详细信息,这是Fugu存在的前提,商务部的框架和进入中国的怀疑。补充本文地缘政治部分的背景。

《人择寓言5/神话5》停服将影响日本金融防御 | AI主权作业(内部)
从日本的角度讨论与“人工智能主权”相同的规定的文章。这是一本与本文核心主题最能产生深刻共鸣的续集式书籍。

[编者后记]

它不是“选择最强的一个”,而是“结合多个”。 Fugu提出的可能是思维的转变。在写这篇文章时,当我们宣布四月份开始 Beta 测试时我正在回忆。它花了大约两个月的时间,经过了大约 500 人的手中,才成为正式版本——我觉得它的开发速度充分说明了当前人工智能世界正在发生的事情。

如果在您的工作或生活中存在完全依赖某项特定服务的情况,那会是什么?你是否在不知不觉中付出了太多来换取便利?我自己也在问自己这个问题。现在已经开始用“主权”这个词来谈论如何选择技术,如果我们能一起思考一下,我会很高兴。