Google a récemment mis à jour sa page d'assistance pour annoncer qu'à partir du 9 octobre, les droits d'accès et les limites d'utilisation des modèles Gemini pour les comptes individuels seront ajustés, resserrant de manière globale la configuration des modèles pour les utilisateurs de niveau inférieur.
Selon les nouvelles règles, les utilisateurs gratuits non abonnés n'auront accès qu'à la version Gemini3.5-Flash-Lite et ne pourront plus utiliser Gemini3.6Flash ni les modèles plus récents ; les abonnés AI Plus à 4,99 dollars par mois verront leur périmètre d'utilisation réduit aux modèles légers Flash et Flash-Lite, sans plus de prise en charge des modèles de raisonnement avancés comme Gemini3.1Pro.
Cet ajustement n'affecte pas les abonnés Google AI Pro et Ultra, dont les offres commencent à 19,99 dollars par mois ; ceux-ci conservent l'option Deep Think (réflexion approfondie) ainsi que les droits d'utilisation des modèles avancés.
Outre la rétrogradation de certains modèles, Google a également introduit trois modes de travail (Effort) : bas, moyen et élevé ; le système déduira en temps réel les quotas en fonction de la complexité de calcul requise par la tâche, et un mode de travail plus élevé consommera plus rapidement les limites de quota. Selon les informations disponibles, Google a récemment commencé à tester en environnement fermé son nouveau modèle Gemini4 « Argon », tout en procédant à des itérations fréquentes sur des modèles légers comme Gemini3.8Flash.
Face à la hausse des coûts d'inférence des modèles de pointe et à la charge de calcul élevée due à la forte concurrence d'utilisateurs simultanés, les grands acteurs de l'IA mettent progressivement fin à la phase d'« essai gratuit haut de gamme ». Avec cette gestion par paliers et affinée des quotas, Google oriente les modèles à forte puissance de calcul vers les utilisateurs payants de grande valeur, marquant le passage des applications commerciales de grands modèles de « l'expansion de la base d'utilisateurs » à une nouvelle étape d'« exploitation fine de l'efficacité économique de la puissance de calcul ».