IT之家 AI

DeepSeek V4.1 Flash의 맹 활약, 중미 최고 모델 LiveBench 점수 격차 3%로 축소

베이징 시간 10월 5일, 블룸버그 인더스트리 리서치에 따르면, 지난 몇 달 동안 DeepSeek 등 중국 AI 연구소의 모델이 끊임없이 발전함에 따라 미국 AI 기업의 중국 동종 업체 대비 성능 우위가 급격히 축소되어 사상 최저 수준으로 떨어졌으며, 이는 미국의 기술 주도권에 위협이 되고 있다. DeepSeek 블룸버그 인더스트리 리서치 수석 애널리스트 로버트 리아(Robert Lea)는…

DeepSeek
이미지 출처 · IT之家 AI

베이징 시간 10월 5일, 블룸버그 인더스트리 리서치에 따르면, 지난 몇 달 동안 DeepSeek 등 중국 AI 연구소의 모델이 끊임없이 발전함에 따라 미국 AI 기업의 중국 동종 업체 대비 성능 우위가 급격히 축소되어 사상 최저 수준으로 떨어졌으며, 이는 미국의 기술 주도권에 위협이 되고 있다.

DeepSeek

DeepSeek

블룸버그 인더스트리 리서치 수석 애널리스트 로버트 리아(Robert Lea)는 월요일 보고서에서, DeepSeek이 9월 V4.1 Flash를 출시한 이후 중국 최고 모델이 벤치마크 점수에서 미국 경쟁사에 불과 3% 뒤처져 있다고 썼다. 이 격차는 5월의 약 9%, 연초의 15%보다 축소된 것이다.

그는 이러한 성능의 지속적인 향상은 중국 경쟁자들이 시장 점유율을 더욱 확대할 것임을 의미한다고 밝혔다.

블룸버그는 중국 모델 기술의 부상이 AI 전문 역량의 지속적인 심화와 연구자들의 국산 하드웨어에 맞춘 모델 최적화 능력에 힘입은 것이라고 지적했다. 이러한 진전은 미국의 기술 수출 제한 조치가 효과적인지에 대한 의문도 불러일으키고 있다.

리아는 중국이 이룩한 진전이 “미국의 AI 분야 기술 주도권이 장기적으로 유지될 수 있는지에 대한 의문을 더욱 키운다”고 말했다.

DeepSeek의 V4.1 Flash는 지난달 LiveBench 글로벌 순위에서 6위를 차지하며, 이 스타트업이 2025년 추론 모델 R1으로 돌파구를 마련한 이래 가장 높은 순위를 기록한 중국 모델이 되었다. LiveBench는 AI 모델의 질문, 퍼즐 또는 과제에 대한 답변과 분석을 바탕으로 점수를 매기며, 이 과정은 인간의 IQ 측정과 유사하다.

DeepSeek의 최근 LiveBench 점수는 81.1점으로, Anthropic의 최고 점수 83.4점에 미치지 못했다. 리아는 이것이 DeepSeek 모델의 성능이 이미 “Anthropic, OpenAI의 선도적인 AI 시스템과 견줄 만하다”는 것을 의미한다고 밝혔다. 다만 양측의 점수 격차가 불과 3%로 축소되었음에도, LiveBench가 선정한 상위 15개 모델 중 중국산은 3개뿐이다.

리아는 이러한 순위는 끊임없이 변하며, 모델의 순위와 무관하게 수익화는 어려울 수 있다고 경고했다.

원문 출처

IT之家 AI

내용 안내

원문 발행 및 권리는 출처에 있습니다.

기계 번역 · 원문을 참고하세요