A partir de 9 de outubro de 2026, o Google implementará mudanças significativas na disponibilidade e nos limites de acesso aos modelos do Gemini para contas pessoais. Conforme apurado, os usuários da versão gratuita ficarão restritos ao Gemini 3.5 Flash-Lite, enquanto os assinantes da modalidade de entrada AI Plus perderão o acesso à variante Pro.
Quem utiliza o assistente sem uma assinatura paga do ecossistema da empresa deixará de ter acesso ao Gemini 3.6 Flash e às versões mais recentes da família Pro. O uso ficará condicionado estritamente ao Flash-Lite, obedecendo aos parâmetros padrão de computação. No caso do plano AI Plus, comercializado por R$ 24,99 mensais, o suporte continuará abrangendo o Flash-Lite e o Flash, mas sem contemplar o modelo Pro.
Enquanto o dia 9 de outubro de 2026 marcará o início das restrições imediatas para contas sem assinatura, as alterações para os clientes do AI Plus serão aplicadas de maneira progressiva. Nesses casos, a companhia notificará individualmente os usuários por correio eletrônico com a data exata da transição.
Por outro lado, as categorias de maior investimento não sofrerão reduções. Os assinantes do plano AI Pro, tabelado em R$ 96,99 por mês, e do AI Ultra, cujas opções iniciam em R$ 779,90 mensais, manterão o acesso integral ao Flash-Lite, Flash e Pro. Além disso, o nível AI Pro passará a contemplar o Deep Think, mecanismo de raciocínio avançado voltado para resolução de problemas complexos que antes era restrito exclusivamente ao AI Ultra.
Paralelamente, a empresa revelou o Gemini 4 Argon, modelo que fará sua estreia direcionada aos assinantes do AI Ultra. Até o momento, a organização não confirmou se a tecnologia será estendida futuramente ao nível Pro.
O aplicativo do Gemini também passará a incorporar três níveis de esforço de raciocínio para os modelos compatíveis: baixo (low), médio (medium) e alto (high). A implementação expande o recurso de reflexão estendida, alinhando a experiência às ferramentas já presentes no Google AI Studio e no Antigravity. Configurações elevadas de esforço otimizam a resolução de demandas complexas, embora consumam a cota disponível de forma acelerada.
O cálculo das cotas opera com base na demanda computacional, sofrendo atualizações a cada cinco horas até que o teto semanal seja atingido. O monitoramento considera variáveis como a complexidade das solicitações, a extensão das interações e a utilização de ferramentas avançadas, a exemplo do modelo Pro, Deep Research e os recursos de criação de mídias visuais, sonoras e audiovisuais.
Com informações: Canaltech — ver matéria original
Esta matéria foi produzida com apoio de inteligência artificial e revisada por um jornalista antes da publicação.
