OpenAI 웹 검색이 인공 분석 검색 인덱스에서 74번째로 시작되었으며, 이는 Perplexity, Octen, Parallel, Brave에 이어 5번째로 좋은 제공자입니다.
@OpenAI Web Search는 우리 플랫폼上 첫 번째 통합된 1자리 검색 도구입니다. Stirrup 하네스 내에서 검색 API를 호출하는 에이전트 대신, GPT-5.6 Luna(중간 추론 능력)는 OpenAI의 내장된 web_search 도구를 호출하며, OpenAI는 한 번의 Responses API 호출 안에 전체 검색 루프를 실행합니다. 모든 설정은 동일한 기반 모델인 GPT-5.6 Luna(중간 추론 능력)을 사용합니다.
작업당 약 0.05달러인 OpenAI 웹 검색은 Parallel(고급, 0.06달러)과 Perplexity(중간, 0.07달러)보다 저렴지만, Octen(0.024달러)의 두 배 정도의 비용이며, Octen은 3점 더 높은 점수를 받습니다.
OpenAI 웹 검색의 주요 벤치마킹 결과 (중간 검색 컨텍스트):
➤ 인공 분석 검색 인덱스에서 5번째로 좋은 제공자: OpenAI Web Search는 74점을 얻었으며, 검색 없이 같은 모델(33점)보다 41점 상승했습니다. 이는 26개 제품 중 7위로, You.com(하이라이트), Nimble(표준), Exa(자동)와 동등한 74점을 기록했습니다. 이는 Perplexity 세 가지 버전(77~80점), Octen(77점), Parallel(고급), Brave(LLM 컨텍스트)가 75점인 것보다 뒤에 위치합니다.
➤ OpenAI Web Search는 우리의 독자적인 사실적 답변 기준인 AA-Omniscience에서 가장 좋은 성능을 보여주며 72%의 정확도를 달성했습니다. 이는 26개의 검색 제공자 중 3위로, 선두 업체인 Firecrawl(73%)와 1점 차이입니다. 여러 검색을 거치는 다단계 추론이 필요한 BrowseComp는 가장 약한 기준으로, 73.5%의 성능을 보여 26개 중 13위에 올랐으며 Perplexity 및 Octen(85%에서 87%)보다 훨씬 낮습니다.
➤ OpenAI 웹 검색은 동일한 작업에 더 적은 토큰을 사용합니다: OpenAI는 각 작업에 약 40k 개의 입력 토큰을 요구하며, 검색 결과도 포함됩니다. 반면 최소한의 검색 API인 Perplexity는 125k 개의 입력 토큰이 필요합니다(낮은 수준). 그 모델 비용은 시장에서 가장 낮은 편으로, 작업당 약 $0.009입니다.
➤ 내장 검색 기능은 대부분의 검색 API보다 한 건당 비용이 적습니다: OpenAI 웹 검색은 약 0.05달러/건으로, 25개의 검색 API 제품 중 17개(중앙값 0.067달러)보다 저렴합니다. 여기에는 고급 기능인 Parallel(0.06달러)과 중간 수준의 Perplexity(0.07달러)도 포함됩니다. Octen은 약 절반의 비용($0.024)으로, 점수는 3점 높습니다.
주요 세부 사항:
➤ 설정: GPT-5.6 Luna (중간 추론 능력)을 사용하며, OpenAI의 web_search 도구를 이용하고 search_context_size를 중간으로 설정하여 하나의 Responses API 호출로 검색합니다.
➤ 가격: 1k 웹 검색 요청당 $10, 검색 콘텐츠 포함. 이는 OpenAI가 모델 입력 토큰으로 계산함
➤ 오염: 도구의 도메인 필터를 통해 알려진 오염원을 차단합니다.

