OpenAI Web SearchがArtificial Analysis Search Indexで74を記録してデビュー、Perplexity、Octen、Parallel、Braveに次ぐ5番目のプロバイダーに
@OpenAI Web Searchは、当社のボードに登場する初の統合型ファーストパーティ検索ツールです。当社のStirrupハーネス内でエージェントがSearch APIを呼び出す代わりに、GPT-5.6 Luna (medium reasoning)がOpenAIの組み込みweb_searchツールを呼び出し、OpenAIが1回のResponses APIコール内で検索ループ全体を実行します。すべてのセットアップは同じ基盤モデルGPT-5.6 Luna (medium reasoning)を使用しています。
1タスクあたり約$0.05で、OpenAI Web SearchはParallel (advanced、$0.06)やPerplexity (medium、$0.07)より安価ですが、3ポイント高いスコアを出すOcten($0.024)の約2倍のコストです。
OpenAI Web Search (medium search context)の主要ベンチマーク結果:
➤ Artificial Analysis Search Indexで5番目に優れたプロバイダー: OpenAI Web Searchは74をスコアし、検索なしの同一モデル(33)から41ポイントの向上。26製品中7位に位置し、74のYou . com (highlights)、Nimble (standard)、Exa (auto)と同水準で、3つのPerplexityバリアント(77〜80)、Octen(77)、Parallel (advanced)、Brave (LLM context)の75には及ばない
➤ OpenAI Web Searchは、当社独自の事実的正解ベンチマークAA-Omniscienceで最も優れた成績を収め、72%の精度を達成。これは26の検索プロバイダーバリアント中3位で、首位のFirecrawl(73%)と1ポイント差です。複数の検索にわたるマルチホップ推論を要するBrowseCompは最も弱いベンチマークで、73.5%では26中13位、PerplexityバリアントやOcten(85%〜87%)を大きく下回っています
➤ OpenAI Web Searchは同じタスクでより少ないトークンを使用: OpenAIは検索結果を含めタスクあたり約40k入力トークンを課金するのに対し、ボード上で最も軽量なSearch APIであるPerplexity (low)は125kです。モデルコストはタスクあたり約$0.009で、ボード上で最も安価な部類に入ります
➤ 組み込み検索はほとんどのSearch APIよりタスクあたりのコストが安い: 1タスクあたり約$0.05で、OpenAI Web Searchはボード上の25のSearch API製品のうち17製品(中央値$0.067)より安く、Parallel (advanced、$0.06)やPerplexity (medium、$0.07)もこれに含まれます。Octenはその約半分($0.024)で、3ポイント高いスコアを出しています
主な詳細:
➤ セットアップ: GPT-5.6 Luna (medium reasoning)にOpenAIのweb_searchツールを使用し、search_context_sizeをmediumに設定、1回のResponses APIコールで実行
➤ 価格設定: web_searchコール1kあたり$10、加えて検索コンテンツの料金。OpenAIはこれをモデル入力トークンとして課金
➤ 汚染(コンタミネーション): 当社はツールのドメインフィルターを通じて既知の汚染ソースをブロックしています

