Artificial Analysis · X

OpenAI Web Search debütiert auf dem Artificial Analysis Search Index mit 74 als 5. bester Anbieter hinter Perplexity, Octen, Parallel und…

OpenAI Web Search debütiert auf dem Artificial Analysis Search Index mit 74 als 5. bester Anbieter hinter Perplexity, Octen, Parallel und Brave @OpenAI Web Search ist das erste integrierte First-Party-Suchtool auf…

Bildquelle · Artificial Analysis · X

OpenAI Web Search debütiert auf dem Artificial Analysis Search Index mit 74 als 5. bester Anbieter hinter Perplexity, Octen, Parallel und Brave

@OpenAI Web Search ist das erste integrierte First-Party-Suchtool auf unserem Board. Statt dass ein Agent eine Search API in unserem Stirrup-Harness aufruft, ruft GPT-5.6 Luna (medium reasoning) OpenAIs eingebautes web_search-Tool auf, und OpenAI führt die gesamte Suchschleife innerhalb eines einzigen Responses-API-Aufrufs aus. Alle Setups verwenden dasselbe zugrunde liegende Modell, GPT-5.6 Luna (medium reasoning).

Mit etwa $0.05 pro Task kostet OpenAI Web Search weniger als Parallel (advanced, $0.06) und Perplexity (medium, $0.07), aber etwa doppelt so viel wie Octen ($0.024), das 3 Punkte höher abschneidet.

Wichtigste Benchmarking-Ergebnisse für OpenAI Web Search (medium search context):

➤ 5. bester Anbieter auf dem Artificial Analysis Search Index: OpenAI Web Search erzielt 74, eine Verbesserung um 41 Punkte gegenüber demselben Modell ohne Suche (33). Es belegt Platz 7 von 26 Produkten, gleichauf mit You . com (highlights), Nimble (standard) und Exa (auto) bei 74, hinter den drei Perplexity-Varianten (77 bis 80), Octen (77), Parallel (advanced) und Brave (LLM context) bei 75

➤ OpenAI Web Search schneidet am besten bei AA-Omniscience ab, unserem proprietären Benchmark für faktische Antworten, und erreicht eine Genauigkeit von 72%. Damit belegt es Platz 3 von 26 Suchanbieter-Varianten, innerhalb von 1 Punkt zum Spitzenreiter Firecrawl (73%). BrowseComp, das mehrstufiges Reasoning über mehrere Suchen hinweg erfordert, ist sein schwächster Benchmark: Mit 73.5% liegt es auf Platz 13 von 26, deutlich hinter den Perplexity-Varianten und Octen (85% bis 87%)

➤ OpenAI Web Search verwendet weniger Tokens für dieselben Aufgaben: OpenAI berechnet etwa 40k Input-Tokens pro Task, Suchergebnisse eingeschlossen, gegenüber 125k für die sparsamste Search API auf dem Board, Perplexity (low). Seine Modellkosten gehören zu den niedrigsten auf dem Board, bei etwa $0.009 pro Task

➤ Eingebaute Suche kostet pro Task weniger als die meisten Search APIs: Mit etwa $0.05 pro Task ist OpenAI Web Search günstiger als 17 der 25 Search-API-Produkte auf dem Board (Median $0.067), darunter Parallel (advanced, $0.06) und Perplexity (medium, $0.07). Octen kostet etwa halb so viel ($0.024) und schneidet 3 Punkte höher ab

Wichtige Details:

➤ Setup: GPT-5.6 Luna (medium reasoning) mit OpenAIs web_search-Tool und search_context_size auf medium eingestellt, in einem einzigen Responses-API-Aufruf

➤ Preisgestaltung: $10 pro 1k web_search-Aufrufen, zuzüglich des Suchinhalts, den OpenAI als Modell-Input-Tokens abrechnet

➤ Kontamination: Wir blockieren bekannte Kontaminationsquellen über den Domänenfilter des Tools

Originalquelle

Artificial Analysis · X

Hinweise zum Inhalt

Originalveröffentlichung und Rechte liegen bei der Quelle.

Maschinelle Übersetzung · Original beachten