グーグルは公式にサポートページを更新し、10月9日から個人アカウントのGeminiモデルのアクセス権限と使用制限を調整し、下位ユーザーのモデル構成を全面的に厳格化すると発表した。
新規定によると、未課金の無料ユーザーはGemini3.5-Flash-Liteバージョンのみアクセス可能となり、Gemini3.6Flashおよびそれ以降のモデルを呼び出す権限は失われる。月額4.99ドルのAI Plusサブスクリプションユーザーの利用範囲はFlashとFlash-Liteの軽量モデルに圧縮され、Gemini3.1Proなどの高度な推論モデルは利用できなくなる。
今回の調整は、月額19.99ドルから始まるGoogle AI ProおよびUltraの上位サブスクリプションユーザーには影響せず、引き続きディープシンク(Deep Think)オプションや上位モデルの利用権限を享受できる。
モデルのランク引き下げに加え、グーグルは低・中・高の3種類のワークロード(Effort)モードオプションを導入した。システムはタスクで呼び出される計算の複雑さに応じて使用量をリアルタイムで差し引き、より高いワークロードモードはより早くクォータ制限を消費する。背景情報によると、グーグルは近年、クローズド環境で次世代のGemini4「Argon」モデルのテストを開始しており、Gemini3.8Flashなどの軽量モデルについても頻繁な反復改善を続けている。
フロンティアモデルの推論コスト増大と高同時実行の計算負荷に直面し、大手AI企業は「高構成の無料トライアル」段階を徐々に終えつつある。グーグルが今回、段階的できめ細かいクォータ管理を通じて高演算モデルを高価値の有料ユーザーに傾けたことは、商用大規模モデルアプリケーションが「ユーザー規模の拡大」から「計算資源の経済効果に基づくきめ細かい運用」の新段階へ正式に移行したことを示している。