OpenAI Web Search debütiert auf dem Artificial Analysis Search Index mit 74 als 5. bester Anbieter hinter Perplexity, Octen, Parallel und Brave
@OpenAI Web Search ist das erste integrierte First-Party-Suchtool auf unserem Board. Statt dass ein Agent eine Search API in unserem Stirrup-Harness aufruft, ruft GPT-5.6 Luna (medium reasoning) OpenAIs eingebautes web_search-Tool auf, und OpenAI führt die gesamte Suchschleife innerhalb eines einzigen Responses-API-Aufrufs aus. Alle Setups verwenden dasselbe zugrunde liegende Modell, GPT-5.6 Luna (medium reasoning).
Mit etwa $0.05 pro Task kostet OpenAI Web Search weniger als Parallel (advanced, $0.06) und Perplexity (medium, $0.07), aber etwa doppelt so viel wie Octen ($0.024), das 3 Punkte höher abschneidet.
Wichtigste Benchmarking-Ergebnisse für OpenAI Web Search (medium search context):
➤ 5. bester Anbieter auf dem Artificial Analysis Search Index: OpenAI Web Search erzielt 74, eine Verbesserung um 41 Punkte gegenüber demselben Modell ohne Suche (33). Es belegt Platz 7 von 26 Produkten, gleichauf mit You . com (highlights), Nimble (standard) und Exa (auto) bei 74, hinter den drei Perplexity-Varianten (77 bis 80), Octen (77), Parallel (advanced) und Brave (LLM context) bei 75
➤ OpenAI Web Search schneidet am besten bei AA-Omniscience ab, unserem proprietären Benchmark für faktische Antworten, und erreicht eine Genauigkeit von 72%. Damit belegt es Platz 3 von 26 Suchanbieter-Varianten, innerhalb von 1 Punkt zum Spitzenreiter Firecrawl (73%). BrowseComp, das mehrstufiges Reasoning über mehrere Suchen hinweg erfordert, ist sein schwächster Benchmark: Mit 73.5% liegt es auf Platz 13 von 26, deutlich hinter den Perplexity-Varianten und Octen (85% bis 87%)
➤ OpenAI Web Search verwendet weniger Tokens für dieselben Aufgaben: OpenAI berechnet etwa 40k Input-Tokens pro Task, Suchergebnisse eingeschlossen, gegenüber 125k für die sparsamste Search API auf dem Board, Perplexity (low). Seine Modellkosten gehören zu den niedrigsten auf dem Board, bei etwa $0.009 pro Task
➤ Eingebaute Suche kostet pro Task weniger als die meisten Search APIs: Mit etwa $0.05 pro Task ist OpenAI Web Search günstiger als 17 der 25 Search-API-Produkte auf dem Board (Median $0.067), darunter Parallel (advanced, $0.06) und Perplexity (medium, $0.07). Octen kostet etwa halb so viel ($0.024) und schneidet 3 Punkte höher ab
Wichtige Details:
➤ Setup: GPT-5.6 Luna (medium reasoning) mit OpenAIs web_search-Tool und search_context_size auf medium eingestellt, in einem einzigen Responses-API-Aufruf
➤ Preisgestaltung: $10 pro 1k web_search-Aufrufen, zuzüglich des Suchinhalts, den OpenAI als Modell-Input-Tokens abrechnet
➤ Kontamination: Wir blockieren bekannte Kontaminationsquellen über den Domänenfilter des Tools

