未接入 Fable 5 却能将其超越?Sakana AI 发布 Fugu Ultra v1.1 路由模型
type
status
date
slug
summary
tags
category
icon
password
网址
日本人工智能初创公司 Sakana AI 近日宣布推出其大模型路由系统(AI Model Router)的最新升级版本——**Fugu Ultra v1.1**。该系统通过将用户的实时查询分发至当前市场上最优秀的公开顶级大模型池,以实现性能与效率的最优解。
令人瞩目的是,Sakana AI 声称,在完全没有将 Anthropic 的最新模型 Fable 5 纳入路由池的情况下,Fugu Ultra v1.1 的综合表现已经超越了 Fable 5。这一声明引发了 AI 业界的广泛关注。
性能突破与基准测试
根据 Sakana AI 官方发布的技术报告,Fugu Ultra v1.1 相比此前的 v1.0 版本实现了显著的性能跨越,其综合测试得分最高提升了 7.9 分。其中,提升幅度最大的测试集为 ProgramBench(编程能力测试)和 TerminalBench 2.1(终端指令基准测试)。
Fugu 的核心逻辑是通过算法在多个开源或托管的顶级大模型之间进行动态路由。Sakana AI 表示,即使不依赖 Fable 5,动态路由策略也能通过互补不同模型的优势,在多数基准测试中跑赢 Fable 5。不过需要指出的是,目前所有数据均来自 Sakana AI 的内部评测,尚未有独立的第三方机构提供客观的评测验证。
开发者集成与定价机制
在费用方面,Fugu Ultra v1.1 保持了与前代相同的定价标准:每百万输入 Token(Input Tokens)收费 5 美元,每百万输出 Token(Output Tokens)收费 30 美元。
对于开发者而言,Sakana AI 提供了以下更新和集成方式:
- **新模型接入周期**:Sakana AI 指出,当市面上出现新的顶级模型时,系统需要约两周的训练与评估周期,才能将其正式部署并整合进路由选择池中。
- **终端集成支持**:此次更新新增了一个与 Claude Code 兼容的 API 端点(Endpoint),开发者可以直接通过本地终端命令行调用 Fugu 路由服务。
- **主流平台可用性**:目前,Fugu Ultra v1.1 已在 OpenRouter 和 Vercel 等平台上线,开发者可以非常便捷地进行 API 接入。
潜在风险、限制与前代争议
尽管 v1.1 版本的数据看起来非常优异,但 Fugu 路由系统依然面临不少挑战:
- **前代口碑不佳**:Fugu 路由器的第一代版本发布时,市场的反馈较为冷淡。不少早期尝鲜的开发者指出其存在 Token 消耗过大、响应速度慢以及生成质量不稳定等问题。v1.1 能否彻底解决这些痛点仍待观察。
- **区域合规性限制**:目前该服务明确不向欧盟(EU)和欧洲经济区(EEA)的用户开放。官方给出的解释是由于需要遵守欧盟《通用数据保护条例》(GDPR)及其他欧洲本地的特定监管政策。
结论
大模型路由(Model Routing)作为降低企业 AI 调用成本、规避单一模型“单点故障”的有效方案,正逐渐成为主流研究方向。Sakana AI 的 Fugu Ultra v1.1 展示了无需绑定最强单体模型即可实现超常表现的可能性。然而,面对曾经的效率质疑与当前的区域合规限制,开发者在实际业务中接入该服务时,仍需在成本、延迟和地域合规性上做好全面的权衡。
Loading...
.png?table=collection&id=cbe6506e-1263-8358-a4d7-07ce62fcbb3f&t=cbe6506e-1263-8358-a4d7-07ce62fcbb3f)