北京時間 10 月 5 日、ブルームバーグ・インテリジェンスによると、ここ数か月、DeepSeek など中国の AI 研究所のモデルが進歩を続けるにつれ、中国の競合各社に対する米国 AI 企業の性能面での優位は急速に縮まり、史上最低水準まで低下しており、米国のテクノロジー主導の地位が脅かされている。

ブルームバーグ・インテリジェンスのシニアアナリスト、ロバート・リア (Robert Lea) 氏は月曜のレポートで、DeepSeek が 9 月に V4.1 Flash を発表した後、中国のトップモデルのベンチマークスコアは米国の競合をわずか 3% 下回るだけになったと記した。この差は 5 月の約 9%、そして今年初めの 15% から縮小している。
同氏は、こうした性能の持続的な向上は、中国の競合各社がさらに市場シェアを拡大することを意味すると述べた。
ブルームバーグは、中国のモデル技術の台頭は、AI 専門能力の絶え間ない深化と、研究者が国産ハードウェア向けにモデルを最適化する能力によるものだと指摘した。こうした進展は、米国の技術輸出規制が有効かどうかへの疑問も生じさせている。
リア氏は、中国が達成した進展は「AI 分野における米国のテクノロジー主導の地位が長期的に維持できるかという疑問をさらに深めるものだ」と述べた。
DeepSeek の V4.1 Flash は先月、LiveBench の世界ランキングで第 6 位となり、この新興企業が 2025 年に推論モデル R1 で躍進して以来、最も高い順位の中国モデルとなった。LiveBench は、AI モデルによる問題・パズル・タスクへの回答と分析を採点するもので、人間の知能指数の測定に類似したプロセスである。
DeepSeek の最新の LiveBench スコアは 81.1 点で、Anthropic の最高の 83.4 点を下回った。リア氏は、これは DeepSeek モデルの性能がすでに「Anthropic、OpenAI の最先端 AI システムに匹敵できる」ことを意味すると述べた。ただし、両者のスコア差はわずか 3% まで縮まったものの、LiveBench が選出した上位 15 モデルのうち中国製はわずか 3 つにとどまる。
リア氏は、こうしたランキングは常に変動すること、そしてモデルがランキングでどの順位であっても収益化は困難な可能性があると注意を促した。
