La recherche web d’OpenAI fait son apparition sur l’Indice de recherche d’analyse artificielle en position 74, étant le 5e meilleur fournisseur derrière Perplexity, Octen, Parallel et Brave
@OpenAI Web Search est le premier outil de recherche intégré de première partie sur notre plateforme. Au lieu d’un agent appelant une API de recherche dans notre dispositif Stirrup, GPT-5.6 Luna (raisonnement moyen) utilise l’outil web_search intégré d’OpenAI, et OpenAI exécute tout le cycle de recherche dans une seule appel à la API Responses. Toutes les configurations utilisent le même modèle sous-jacent, GPT-5.6 Luna (raisonnement moyen).
À environ 0,05 $ par tâche, OpenAI Web Search coûte moins que Parallel (avancé, 0,06 $) et Perplexity (moyen, 0,07 $), mais environ deux fois plus que Octen (0,024 $), qui obtient 3 points de plus.
Résultats clés de benchmark pour OpenAI Web Search (contexte de recherche moyen) :
➤ 5e meilleur fournisseur dans l’Indice de recherche d’analyse artificielle : OpenAI Web Search obtient une note de 74, soit une amélioration de 41 points par rapport au même modèle sans recherche (33). Il se place 7e sur 26 produits, à égalité avec You.com (highlights), Nimble (standard) et Exa (auto) à 74, derrière les trois variantes de Perplexity (77 à 80), Octen (77), Parallel (avancé) et Brave (contexte LLM) à 75
➤ La recherche web d’OpenAI se performances le mieux sur AA-Omniscience, notre évaluation propriétaire de la précision des réponses factuelles, atteignant 72 % de précision. Cela lui permet de se classer 3e parmi 26 variantes de fournisseurs de recherche, à 1 point du leader, Firecrawl (73 %). BrowseComp, qui nécessite une raisonnement multi-hops lors de plusieurs recherches, est son évaluation la plus faible : à 73,5 %, elle se classe 13e parmi 26, bien en retrait des variantes Perplexity et Octen (85 % à 87 %)
➤ OpenAI Web Search utilise moins de tokens pour les mêmes tâches : OpenAI facture environ 40k tokens d’entrée par tâche, y compris les résultats de recherche, contre 125k pour la API de recherche la plus simple du marché, Perplexity (bas). Le coût de son modèle est parmi les plus bas du marché, à environ 0,009 $ par tâche
➤ La recherche intégrée coûte moins par tâche que la plupart des API de recherche : à environ 0,05 $ par tâche, OpenAI Web Search est moins cher que 17 des 25 produits d’API de recherche en liste (moyenne de 0,067 $), y compris Parallel (avancé, 0,06 $) et Perplexity (moyen, 0,07 $). Octen coûte environ la moitié moins cher (0,024 $) et obtient 3 points de plus.
Détails clés :
➤ Configuration : GPT-5.6 Luna (raisonnement moyen) avec l’outil web_search d’OpenAI et un taux de contexte de recherche réglé sur moyen, dans une seule appel à la API Responses
➤ Tarif : 10 $ par 1 000 appels de recherche web, plus le contenu de recherche, que OpenAI facture comme tokens d’entrée du modèle
➤ Contamination : nous bloquons les sources de contamination connues via le filtre de domaine de l’outil

