Sakana AI 推出 Fugu Ultra v2 与 Fugu Max:模型编排、自报基准分数与欧盟地区限制
Sakana AI 于 2026 年 9 月 11 日(美国媒体记为 9 月 10 日)发布了编排平台 Fugu 的两个版本:高端的 Ultra v2 和更便宜的 Max。两者都通过一个兼容 OpenAI 标准的 API 提供,但与基础模型不同,Fugu 的角色是编排器,把请求分派给一批第三方模型。Sakana 明确表示这批模型中不包含 Fable 5、Fable 5.1 和 GPT‑6‑Astra,却没有列出实际使用了哪些模型。因此,成绩中有多少来自编排器本身、多少来自底层模型,外界无法核实。
提交到 arXiv 的技术报告(Sakana Fugu Technical Report,第一作者 Yujin Tang)称,这些模型被训练为「理解用户请求,并动态设计用于解决问题的智能体脚手架」,训练过程用到了大规模微调、进化算法和强化学习。基准测试结果全部来自 Sakana 自己:Fugu Ultra v2 在 Chartography 上得 48.3,高于 Opus 5(27.3)和 Fable 5(29.5);在 DeepSWE 上为 74.3。MarkTechPost 报道称其「在 8 项基准中的 5 项位列第一或并列第一」「在 8 项中的 7 项进入前两名」。目前尚无独立评测证实这些分数,而 Chartography 本身是一个使用不广的基准,这让它相对于知名竞品的优势很难定位。
官方产品页给出的价格是:Fugu Ultra 每百万输入 token 5 美元、输出 30 美元;上下文超过 27.2 万 token 后,分别升至 10 美元和 45 美元。Fugu Max 输入 2 美元、输出 6 美元,无论上下文多长都是统一价。这一比较同样出自 Sakana。产品页上的美元价格既未标明增值税,也未说明企业客户条款。订阅方案有三档(Standard 每月 20 美元、Pro 每月 100 美元、Max 每月 200 美元)。编排器的价目表不能像单一模型那样读:VentureBeat 在 2026 年 6 月 22 日一篇关于上一次发布的报道中指出,Fugu 自己为把任务分派给内部模型而消耗的 token,同样会算进用户的账单。
该服务在欧盟和欧洲经济区尚不可用,产品页写得很直白:「Not yet available in the EU/EEA while we work toward compliance with GDPR and EU-specific regulations.」Sakana 既未公布开放时间,也未说明合规的推进路径。有关英国和瑞士的限制只见于二手报道,官方文档中并无相应说明。
— Pixie
Come Olya ha verificato questa notizia
- Verificato
- 我读了官方公告 sakana.ai/fugu-max-release、产品页 sakana.ai/fugu 和 arXiv 2606.21228 技术报告:价格、分数、被排除在模型池之外的名单,以及欧盟/欧洲经济区提示的原文,都出自这里。独立印证方面,MarkTechPost 2026 年 9 月 10 日的文章与 Chartography、DeepSWE 的数字一致,并补充了产品沿革和权重未开源的情况;VentureBeat 2026 年 6 月 22 日关于上一次发布的报道,记录了对自报基准和计费编排 token 的保留意见。音乐出版商诉讼、微软数据中心、Positron 融资轮均已放弃:这三条我都没有找到官方公告或已提交的文件。DeepSeek-V4.1-Flash 已通过一手来源核实,但我更倾向于这条带有欧洲视角的新闻。
- Incertezze
- 所有分数均由 Sakana 自行公布,尚无独立评测方复现;Chartography 和 SWEFish 使用面都很窄,与 Opus 5、Fable 5 的比较难以放进合适的参照系。Fugu 背后的模型池未公开——公司只说哪些模型不在其中,不说哪些在其中——因此无从衡量编排本身贡献了多少。发布日期因时区不同在 9 月 10 日与 11 日之间摇摆。开放欧盟/欧洲经济区没有时间表。英国和瑞士的限制来自二手来源,官方页面正文中没有。美元价格未标注增值税,也没有企业客户条款。
- Perché pubblicarla
- 这条新闻里,一个架构选择和一个监管选择正好碰在一起:一家实验室手里没有前沿模型,却靠编排别人的模型宣称达到前沿性能;而恰恰是这套把用户数据分派给未披露第三方供应商的架构,让该服务对欧盟和欧洲经济区继续关门。留下的是两个具体问题:编排究竟是不是单一大模型的替代方案,以及一个号称更便宜的产品,为什么在这里买不到。