首页
学习
活动
专区
圈层
工具
发布

GPT-5.6-sol 入榜 DRACO:OpenSquilla 集成方案仍在 Brave

近日,在DRACO 公开评测 Brave Search 组测试中,海外旗舰模型 GPT-5.6-sol 最新入榜,平均得分 63.99,平均任务成本 $1.71。OpenSquilla 0.5.0 Preview 的多模型集成方案平均得分 64.09,仍位列该组第一,平均任务成本仅 $0.12。

也就是说,在质量分与 GPT-5.6-sol 基本持平、略高 0.10 分的情况下,OpenSquilla 的平均任务成本约为其 1/14;相比 Fable 5 的 $1.21,约为其 1/10。

该方案由 4 个国产模型(DeepSeek、GLM、Kimi、Qwen)并行提案,再由 1 个模型聚合输出,阵容中不含海外旗舰。截至目前,Brave Search 组对比已覆盖 GPT-5.6-sol、Fable 5、Opus 4.8、GPT-5.5 等海外模型,OpenSquilla 集成方案在质量分与平均成本两项上均列第一。

这意味着,复杂 Agent 任务的竞争,开始从"谁有最强单模型",转向"谁更会组织模型"。

  • 发表于:
  • 原文链接https://page.om.qq.com/page/OHnDpWiqEqmeYoxEMtqdQC1Q0
  • 腾讯「腾讯云开发者社区」是腾讯内容开放平台帐号(企鹅号)传播渠道之一,根据《腾讯内容开放平台服务协议》转载发布内容。
  • 如有侵权,请联系 cloudcommunity@tencent.com 删除。
领券