AI 【新芒xAI】OpenAI开源BrowseComp，重塑Agent浏览器评测

【新芒xAI】OpenAI开源BrowseComp，重塑Agent浏览器评测

作者: 新芒Group 发布: 2025年4月11日 14,385

新芒xAI 4月11日消息今日凌晨，OpenAI开源了专门用于智能体浏览器功能的测试基准——BrowseComp。

这个测试基准非常有难度，连OpenAI自己的GPT-4o、GPT-4.5准确率只有0.6%和0.9%几乎为0，即便使用带浏览器功能的GPT-4o也只有1.9%。

但OpenAI最新发布的Agent模型Deep Research准确率高达51.5%，在自主搜索、信息整合、准确性校准方面非常优秀。

文章来源信息声明：本文信息出自权威媒体、企业官方及网络，并经新芒X编辑，转载请注明源出处、作者和链接。图片部分来源于网络，在此表示感谢，如有侵权请联系我方处理。文章发布日期后方火形图标后的数字，为文章热度，谨代表受欢迎程度。新芒X平台仅对用户提供信息及决策参考，本文不构成投资建议。

新芒出品，专注专业。兼具内容品质和传播影响力