OpenAI Web Search 在 Artificial Analysis 搜索指数上以74分首次亮相,是排名第5的提供商,仅次于 Perplexity、Octen、Parallel 和 Brave
@OpenAI Web Search 是我们平台上首个集成的一方搜索工具。在我们的 Stirrup 框架中,代理不再调用 Search API,而是由 GPT-5.6 Luna(中等推理)调用 OpenAI 内置的 web_search 工具,并且 OpenAI 在一次 Responses API 调用中运行整个搜索循环。所有设置都使用相同的基础模型 GPT-5.6 Luna(中等推理)。
按每任务约0.05美元计,OpenAI Web Search 的成本低于 Parallel(advanced,0.06美元)和 Perplexity(medium,0.07美元),但约为 Octen(0.024美元)的两倍,后者得分高出3分。
OpenAI Web Search(medium 搜索上下文)的关键基准测试结果:
➤ 在 Artificial Analysis Search Index 上排名第5的提供商:OpenAI Web Search 得分为74,比同一模型无搜索时(33)提升了41分。它在26个产品中排第7,与 You . com(highlights)、Nimble(standard)和 Exa(auto)同为74分,落后于三个 Perplexity 变体(77到80)、Octen(77)、Parallel(advanced)和 Brave(LLM context)(75分)
➤ OpenAI Web Search 在 AA-Omniscience——我们专有的事实性回答基准——上表现最佳,达到72%的准确率。这在26个搜索提供商变体中排第3,与领先者 Firecrawl(73%)相差不到1分。需要跨多次搜索进行多跳推理的 BrowseComp 是其最弱的基准:73.5%的得分在26个变体中排第13,远落后于 Perplexity 变体和 Octen(85%到87%)
➤ OpenAI Web Search 在相同任务下使用更少的 token:OpenAI 对每个任务计费约40k输入 token(含搜索结果),而榜上最精简的 Search API Perplexity(low)为125k。其模型成本在榜上处于最低水平,每任务约0.009美元
➤ 内置搜索的每任务成本低于大多数 Search API:按每任务约0.05美元计,OpenAI Web Search 比榜上25个 Search API 产品中的17个(中位数0.067美元)更便宜,包括 Parallel(advanced,0.06美元)和 Perplexity(medium,0.07美元)。Octen 的成本约为其一半(0.024美元),且得分高出3分
关键细节:
➤ 设置:GPT-5.6 Luna(medium 推理)配合 OpenAI 的 web_search 工具,search_context_size 设为 medium,在单次 Responses API 调用中完成
➤ 定价:每1k次 web_search 调用10美元,外加搜索内容,OpenAI 将其计为模型输入 token
➤ 污染防护:我们通过该工具的域名过滤器屏蔽已知的污染源

