Claude Fable 5 平替指南突然爆火,真能一句话「复活」? 文章

36kr 资讯2026-06-15NEWSzh作者: 爱范儿

详细信息

来源站点
36kr 资讯
作者
爱范儿
文章类型
NEWS
语言
zh
发布日期
2026-06-15

摘要

Claude Fable 5 周末被停用之后,成了不少人心中逝去的白月光。连原本定好的 Claude Fable 5 开发者大会,主角也被临时调整为 Opus 4.8。 可 Fable 的悼念帖还没刷完,知名 AI 模型聚合平台 OpenRouter 带着 Fusion API 闪亮登场。 它自称是市面上最聪明的「拼盘模型」,智力接近 Fable,且价格只要一半。 截至发稿前,OpenRouter 这条推文已经冲到 518.5 万阅读。某种程度上,Fusion API 展示了一种新思路:模型能力不一定只能靠参数的力大飞砖,协作本身也能产生增益。 AI 也讲究群殴战术? Fusion 本质上是一套「多模型协作」机制。 与传统大模型由单个模型完成思考、搜索和回答不同,Fusion 会把同一个问题同时交给多个模型独立研究,再对结果进行综合。 整个流程分为三步: 1. 并行研究:多个参与模型(Panel Models)在相同工具权限下独立完成搜索、资料整理和答案生成; 2. 交叉评审:裁判模型(Judge Model)阅读所有答案,分析共识、分歧、遗漏、独特观点以及潜在错误和风险; 3. 生成结论:主模型根据评审结果完成信息整合,输出最终答案。 因此,Fusion 的核心并非简单拼接多个回答,而是通过独立研究、交叉验证和统一综合来提升结果质量。 为了验证这种协作模式是否有效,OpenRouter 采用了 Perplexity AI 发布的 DRACO 作为测试基准。 DRACO 专门评估深度研究能力,共包含 100 道任务,覆盖学术、金融、法律、医疗、技术、UX 设计、产品比较等 10 个领域。与传统问答测试不同,它不仅考察知识储备,还会评估推理能力、工具使用能力、资料检索能力以及最终报告质量。 每道题接近 40 条评分标准,主要关注事实准确性、分析完整性、信息整合能力、引用可靠性和表达清晰度。同时还设置了负分项,例如给出危险医疗建议或引用明显错误信息都会被扣分,因此模型很难依靠堆字数来刷成绩。 🔗 https://openrouter.ai/blog/announcements/fusion-beats-frontier/ 在这套测试里,Gemini 3 Flash、Kimi K2.

相关事件

暂无数据

相关公司查看全部 (2)

O
OpenRouterCOMPANY

相关人物

暂无数据

相关技术

暂无数据