OpenRouter 推出实时网页搜索基准测试:如何为智能体选择引擎、深度与模型
1
55分钟前·Hubei📱 产品发布/更新 · 19 小时前
OpenRouter 发布实时排行榜,系统评测模型、搜索引擎、搜索方法与预算四类配置组合。数据显示,将搜索预算从 1 轮增至 25 轮可使 BrowseComp 得分近乎翻倍,成本仅增 2.5-7 倍;模型选择比引擎更重要,平均分差 15 分 vs 10 分。失败率高的任务应降低搜索深度以控制成本。
📎 来源:OpenRouter:Announcements(RSS) | https://openrouter.ai/blog/announcements/web-search-benchmark
🔗 原文:AI大事件- 暂无回复