铭鸿体育资讯网

同一个AI,只换搜索接口,成绩最高从33分冲到75分 很多人觉得 AI 答得好

同一个AI,只换搜索接口,成绩最高从33分冲到75分

很多人觉得 AI 答得好不好,主要看背后用了什么大模型,但 Artificial Analysis 最新测试发现,搜索可能同样重要。
他们把模型固定成 GPT 5.6 Luna medium,Agent、任务和参数也全部固定,只更换背后的搜索 API,结果 Search Index 从 65 分一直拉开到 75 分。
更明显的差距是,同一个模型完全不给联网搜索时只有 33 分,接上搜索后,最高直接做到 75 分。
这次一共测试了 7 家搜索服务商的 11 种方案,Parallel advanced 得到 75 分,Exa auto 74 分,Firecrawl 和 Parallel basic 都是 73 分,但速度和成本差距也不小。
如果搜索结果质量高一点,还可能让 AI 少搜几次、少读几十万 token,最后反而更省钱。
所以两个 AI 明明用了差不多的模型,回答质量却差很多,问题可能不只出在模型本身,搜索能力已经成为了 Agent 真正拉开差距的一部分。