Artificial Analysis · X

OpenAI Web Search debuta en el Artificial Analysis Search Index con 74, el 5.º mejor proveedor detrás de Perplexity, Octen, Parallel y Brave

OpenAI Web Search debuta en el Artificial Analysis Search Index con 74, el 5.º mejor proveedor detrás de Perplexity, Octen, Parallel y Brave @OpenAI Web Search es la primera herramienta de búsqueda integrada de primera…

Fuente de la imagen · Artificial Analysis · X

OpenAI Web Search debuta en el Artificial Analysis Search Index con 74, el 5.º mejor proveedor detrás de Perplexity, Octen, Parallel y Brave

@OpenAI Web Search es la primera herramienta de búsqueda integrada de primera parte en nuestro tablero. En lugar de un agente que llama a una Search API en nuestro harness Stirrup, GPT-5.6 Luna (razonamiento medio) llama a la herramienta web_search integrada de OpenAI, y OpenAI ejecuta todo el bucle de búsqueda dentro de una sola llamada a la Responses API. Todas las configuraciones usan el mismo modelo subyacente, GPT-5.6 Luna (razonamiento medio).

A ~$0.05 por tarea, OpenAI Web Search cuesta menos que Parallel (advanced, $0.06) y Perplexity (medium, $0.07), pero aproximadamente el doble que Octen ($0.024), que obtiene 3 puntos más.

Resultados clave del benchmarking para OpenAI Web Search (contexto de búsqueda medio):

➤ 5.º mejor proveedor en el Artificial Analysis Search Index: OpenAI Web Search obtiene 74, una mejora de 41 puntos sobre el mismo modelo sin búsqueda (33). Queda en el puesto 7 de 26 productos, al nivel de You . com (highlights), Nimble (standard) y Exa (auto) con 74, detrás de las tres variantes de Perplexity (77 a 80), Octen (77), Parallel (advanced) y Brave (LLM context) con 75

➤ OpenAI Web Search rinde mejor en AA-Omniscience, nuestro benchmark propietario de respuestas factuales, alcanzando un 72% de precisión. Esto lo sitúa en el puesto 3 de 26 variantes de proveedores de búsqueda, a menos de 1 punto del líder, Firecrawl (73%). BrowseComp, que requiere razonamiento de múltiples saltos a través de varias búsquedas, es su benchmark más débil: con un 73.5% ocupa el puesto 13 de 26, muy por detrás de las variantes de Perplexity y Octen (85% a 87%)

➤ OpenAI Web Search usa menos tokens para las mismas tareas: OpenAI factura alrededor de 40k tokens de entrada por tarea, resultados de búsqueda incluidos, frente a 125k para la Search API más ligera del tablero, Perplexity (low). Su coste de modelo está entre los más bajos del tablero, unos $0.009 por tarea

➤ La búsqueda integrada cuesta menos por tarea que la mayoría de las Search APIs: A ~$0.05 por tarea, OpenAI Web Search es más barato que 17 de los 25 productos Search API del tablero (mediana $0.067), incluyendo Parallel (advanced, $0.06) y Perplexity (medium, $0.07). Octen cuesta aproximadamente la mitad ($0.024) y obtiene 3 puntos más

Detalles clave:

➤ Configuración: GPT-5.6 Luna (razonamiento medio) con la herramienta web_search de OpenAI y search_context_size establecido en medium, en una sola llamada a la Responses API

➤ Precios: $10 por 1k llamadas a web_search, más el contenido de la búsqueda, que OpenAI factura como tokens de entrada del modelo

➤ Contaminación: bloqueamos fuentes conocidas de contaminación mediante el filtro de dominios de la herramienta

Fuente original

Artificial Analysis · X

Notas sobre el contenido

La publicación original y los derechos pertenecen a la fuente.

Traducción automática · Consulte el original