O Google apresentou nesta terça-feira, 21, três novos modelos de inteligência artificial focados em deixar seus agentes mais rápidos e inteligentes, mas também com um consumo menor de tokens e, logo, mais baratos. São eles:
- Gemini 3.6 Flash que utiliza 17% menos tokens que o Flash 3.5, mas entrega a mesma qualidade de trabalho;
- Gemini 3.5 Flash-lite que é um modelo mais rápido, 350 respostas (outputs) por segundo, com custo reduzido para tarefas mais corriqueiras, como processar documentos e fazer buscas com agentes;
- Gemini 3.5 Flash Cyber, um modelo voltado para cibersegurança com a missão de achar e corrigir falhas críticas e vulnerabilidades em softwares.
Valores dos novos modelos Gemini
O 3.6 Flash custa US$ 1,5 por milhão de tokens de entrada (input) e US$ 7,50 por 1 milhão de tokens de saída. Por sua vez, o 3.5 Flash-lite custa US$ 0,30 por milhão de input tokens e US$ 2,50 por milhão de ouput tokens. Para efeito de comparação, o Gemini 3.5 Flash custa US$ 1,50 por milhão de tokens de entrada e US$ 9 por milhão de saída.
Disponibilidade
Para consumidores, o Gemini 3.6 Flash e 3.5 Flash Lite já estão disponíveis no app do Gemini (Android, iOS). Os desenvolvedores que desejarem já podem usar esses modelos via API Google AI Studio e/ou Android Studio.
Por sua vez, o Gemini 3.5 Flash Cyber estará exclusivo e com acesso limitado via CodeMender, o agente de segurança do Google. Seus valores de input e output não foram revelados.
A companhia confirmou ainda que o próximo modelo principal do Gemini, o 3.5 Pro, está em fase de testes com parceiros. E o Gemini 4 está em pré-treino.




