热点事件 持续更新
OpenRouter 报告自测 Fusion 在 DRACO 基准上的成绩:Opus 4.8 配对 65.5% 对单跑 58.8%,预算面板 64.7% 对 Fable 5 约 65.3%,前沿面板 69.0%,且 Fable 成绩因内容过滤仅含 93/100 任务
先了解这件事
报道摘要OpenRouter 发布 Fusion 复合推理系统,将一个提示词并行发给 1 到 8 个面板模型,由 judge 比较共识与分歧后由调用模型写出最终答案。默认三模型面板成本约为单次完成的四到五倍、延迟两到三倍,在 DRACO 深度研究基准上预算面板得 64.7%、前沿面板得 69.0%。
报道时间线
沿着报道,了解事件的不同侧面。
- OpenRouter 发布 Fusion 复合模型,让多个模型辩论后合成最终答案
OpenRouter 发布 Fusion 复合推理系统,将一个提示词并行发给 1 到 8 个面板模型,由 judge 比较共识与分歧后由调用模型写出最终答案。默认三模型面板成本约为单次完成的四到五倍、延迟两到三倍,在 DRACO 深度研究基准上预算面板得 64.7%、前沿面板得 69.0%。