O Gemini 3.6 Flash (gemini-3.6-flash) e o Gemini 3.5 Flash-Lite (gemini-3.5-flash-lite) estão em disponibilidade geral (GA, na sigla em inglês) e prontos para uso na produção.
- Gemini 3.6 Flash: performance mais forte em tarefas agênticas e multimodais complexas, reduzindo o uso de tokens, com um preço mais baixo do que o 3.5 Flash.
- Gemini 3.5 Flash-Lite: o modelo mais rápido e de menor custo da família 3.5. Supera as gerações anteriores do Flash-Lite para execução de alta capacidade.
Este guia explica as novidades de cada modelo, quais mudanças na API afetam seu código e como migrar.
Gemini 3.6 Flash
Instale a habilidade:
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --globalAplique a habilidade:
/gemini-interactions-api migrate my app to Gemini 3.6 Flash
Gemini 3.5 Flash-Lite
Instale a habilidade:
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --globalAplique a habilidade:
/gemini-interactions-api migrate my app to Gemini 3.5 Flash-Lite
Novos modelos
| Modelo | ID do modelo | Nível de pensamento padrão | Preços | Descrição |
|---|---|---|---|---|
| Gemini 3.6 Flash | gemini-3.6-flash |
medium |
US$ 1,50/1 milhão de tokens de entrada e US $7,50/1 milhão de tokens de saída | Equilibra velocidade e inteligência para tarefas agênticas e multimodais. |
| Gemini 3.5 Flash-Lite | gemini-3.5-flash-lite |
minimal |
US$ 0,30/1 milhão de tokens de entrada e US $2,50/1 milhão de tokens de saída | O modelo 3.5 mais rápido e de menor custo para execução de alta capacidade. |
Os dois modelos oferecem suporte à janela de contexto de 1 milhão de tokens, 64 mil tokens de saída máximos, pensamento e o conjunto completo de ferramentas integradas, incluindo Uso do computador.
Para conferir as especificações completas, consulte as páginas do modelo:
Para conferir os preços detalhados, consulte a página de preços.
Guia de início rápido
Python
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.6-flash",
input="Write a three.js script that renders an interactive 3D robot."
)
print(interaction.output_text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const ai = new GoogleGenAI({});
async function main() {
const interaction = await ai.interactions.create({
model: "gemini-3.6-flash",
input: "Write a three.js script that renders an interactive 3D robot.",
});
console.log(interaction.outputText);
}
main();
REST
curl "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H 'Content-Type: application/json' \
-X POST \
-d '{
"model": "gemini-3.6-flash",
"input": {
"parts": [{"text": "Write a three.js script that renders an interactive 3D robot."}]
}
}'
Novidades do Gemini 3.6 Flash
- Redução de tokens e turnos:conclui fluxos de trabalho de várias etapas com menos etapas de raciocínio, turnos de conversa e chamadas de ferramentas do que o Gemini 3.5. Ele também reduz a espiral de loop de execução.
- Geração de código aprimorada:produz código pronto para produção de maior qualidade, com menos edições indesejadas e menos loops de depuração.
- Melhor acompanhamento de instruções: reduz mudanças de arquivo indesejadas durante tarefas de diagnóstico.
- Raciocínio multimodal e espacial forte:performance aprimorada na interpretação de gráficos, conversão de projetos visuais e geração de layouts da Web com vários elementos.
- Inspeção programática antecipada:prefere executar scripts de código de diagnóstico antes de fazer mudanças com mais frequência do que o Gemini 3.5 Flash. Isso melhora a precisão em tarefas complexas, mas pode adicionar etapas exploratórias extras em trabalhos simples de front-end.
- Suporte ao uso do computador:com suporte como ferramenta nativa para automação de interface agêntica.
- Preferência de estilo de interface: melhor na criação de código funcional, embora os avaliadores humanos tenham preferido modelos anteriores para layout visual e estilo. É possível mitigar isso fornecendo diretrizes de design explícitas.
- Esforço de pensamento padrão (médio) : usa o mesmo nível de pensamento padrão
mediumdo Gemini 3.5 Flash. - Preços reduzidos: custos de token de saída mais baixos (US$ 7,50/1 milhão em comparação com US$ 9,00/1 milhão para o 3.5 Flash). Os tokens de entrada permanecem em US $1,50/1 milhão.
Novidades do Gemini 3.5 Flash-Lite
- Latência de execução de tarefas reduzida:maior capacidade de processamento na família 3.5 para análise de dados de alto volume e extração de documentos.
- Raciocínio e performance multimodal aprimorados:caminho de migração forte do Gemini 2.5 Flash, com pontuações mais altas em tarefas de raciocínio, como HLE (18,0% em comparação com 11,0%) e benchmarks multimodais, como CharXIV (74,5% em comparação com 63,7%).
- Orquestração de subagentes e confiabilidade de ferramentas:melhora a confiabilidade da execução de ferramentas para execução de código, pesquisa e fluxos de trabalho de MCP. Aumente o nível de pensamento para planejamento autônomo e tarefas complexas de subagentes.
- Melhor compreensão de documentos:melhora a acurácia na análise de documentos e na extração de dados estruturados. Teste níveis de pensamento mínimos e altos, dependendo da complexidade do documento.
- Programação interativa da Web e processamento de dados tabulares:tem um bom desempenho no JavaScript de front-end e no processamento de dados tabulares, planejando a execução de código leve.
- Chatbot e persistência de persona:acompanhamento de instruções multiturno e consistência de persona mais fortes do que o Gemini 3.1 Flash-Lite.
- Suporte ao uso do computador:com suporte como ferramenta nativa para automação de interface agêntica.
Como escolher o modelo Flash ou Flash-Lite certo
Use esta tabela para selecionar o modelo e o caminho de migração certos para suas cargas de trabalho.
Os dois modelos exigem a remoção de parâmetros de amostragem descontinuados (temperature, top_p, top_k) e turnos de modelo pré-preenchidos. Consulte Mudanças na API para mais detalhes.
| Modelo | Principais casos de uso | Destino de migração recomendado |
|---|---|---|