OpenAI开源BrowseComp，重塑Agent浏览器评测 – Fastdata极数

OpenAI开源BrowseComp，重塑Agent浏览器评测

2025年4月11日

今日凌晨，OpenAI开源了专门用于智能体浏览器功能的测试基准——BrowseComp。这个测试基准非常有难度，连OpenAI自己的GPT-4o、GPT-4.5准确率只有0.6%和0.9%几乎为0，即便使用带浏览器功能的GPT-4o也只有1.9%。但OpenAI最新发布的Agent模型Deep Research准确率高达51.5%，在自主搜索、信息整合、准确性校准方面非常优秀。

最新资讯

Fastdata极数是一家具备全球服务与竞争力能力的数字技术服务与数据研究分析公司

18510809459

guoliang@ifastdata.com

北京市经济技术开发区凯王共和商务花园

Copyright © Fastdata极数津ICP备2020008040号-1