Como usar os modelos mais recentes do Gemini

Esta página 3.5 Flash

O Gemini 3.6 Flash (gemini-3.6-flash) e o Gemini 3.5 Flash-Lite (gemini-3.5-flash-lite) estão em disponibilidade geral (GA, na sigla em inglês) e prontos para uso na produção.

  • Gemini 3.6 Flash: performance mais forte em tarefas agênticas e multimodais complexas, reduzindo o uso de tokens, com um preço mais baixo do que o 3.5 Flash.
  • Gemini 3.5 Flash-Lite: o modelo mais rápido e de menor custo da família 3.5. Supera as gerações anteriores do Flash-Lite para execução de alta capacidade.

Este guia explica as novidades de cada modelo, quais mudanças na API afetam seu código e como migrar.

Gemini 3.6 Flash

  1. Instale a habilidade:

    npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --global
  2. Aplique a habilidade:

    /gemini-interactions-api migrate my app to Gemini 3.6 Flash

Gemini 3.5 Flash-Lite

  1. Instale a habilidade:

    npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --global
  2. Aplique a habilidade:

    /gemini-interactions-api migrate my app to Gemini 3.5 Flash-Lite

Novos modelos

Modelo ID do modelo Nível de pensamento padrão Preços Descrição
Gemini 3.6 Flash gemini-3.6-flash medium US$ 1,50/1 milhão de tokens de entrada e US $7,50/1 milhão de tokens de saída Equilibra velocidade e inteligência para tarefas agênticas e multimodais.
Gemini 3.5 Flash-Lite gemini-3.5-flash-lite minimal US$ 0,30/1 milhão de tokens de entrada e US $2,50/1 milhão de tokens de saída O modelo 3.5 mais rápido e de menor custo para execução de alta capacidade.

Os dois modelos oferecem suporte à janela de contexto de 1 milhão de tokens, 64 mil tokens de saída máximos, pensamento e o conjunto completo de ferramentas integradas, incluindo Uso do computador.

Para conferir as especificações completas, consulte as páginas do modelo:

Para conferir os preços detalhados, consulte a página de preços.

Guia de início rápido

Python

from google import genai

client = genai.Client()

interaction = client.interactions.create(
    model="gemini-3.6-flash",
    input="Write a three.js script that renders an interactive 3D robot."
)

print(interaction.output_text)

JavaScript

import { GoogleGenAI } from "@google/genai";

const ai = new GoogleGenAI({});

async function main() {
  const interaction = await ai.interactions.create({
    model: "gemini-3.6-flash",
    input: "Write a three.js script that renders an interactive 3D robot.",
  });
  console.log(interaction.outputText);
}

main();

REST

curl "https://generativelanguage.googleapis.com/v1beta/interactions" \
  -H "x-goog-api-key: $GEMINI_API_KEY" \
  -H 'Content-Type: application/json' \
  -X POST \
  -d '{
    "model": "gemini-3.6-flash",
    "input": {
      "parts": [{"text": "Write a three.js script that renders an interactive 3D robot."}]
    }
  }'

Novidades do Gemini 3.6 Flash

  • Redução de tokens e turnos:conclui fluxos de trabalho de várias etapas com menos etapas de raciocínio, turnos de conversa e chamadas de ferramentas do que o Gemini 3.5. Ele também reduz a espiral de loop de execução.
  • Geração de código aprimorada:produz código pronto para produção de maior qualidade, com menos edições indesejadas e menos loops de depuração.
  • Melhor acompanhamento de instruções: reduz mudanças de arquivo indesejadas durante tarefas de diagnóstico.
  • Raciocínio multimodal e espacial forte:performance aprimorada na interpretação de gráficos, conversão de projetos visuais e geração de layouts da Web com vários elementos.
  • Inspeção programática antecipada:prefere executar scripts de código de diagnóstico antes de fazer mudanças com mais frequência do que o Gemini 3.5 Flash. Isso melhora a precisão em tarefas complexas, mas pode adicionar etapas exploratórias extras em trabalhos simples de front-end.
  • Suporte ao uso do computador:com suporte como ferramenta nativa para automação de interface agêntica.
  • Preferência de estilo de interface: melhor na criação de código funcional, embora os avaliadores humanos tenham preferido modelos anteriores para layout visual e estilo. É possível mitigar isso fornecendo diretrizes de design explícitas.
  • Esforço de pensamento padrão (médio) : usa o mesmo nível de pensamento padrão medium do Gemini 3.5 Flash.
  • Preços reduzidos: custos de token de saída mais baixos (US$ 7,50/1 milhão em comparação com US$ 9,00/1 milhão para o 3.5 Flash). Os tokens de entrada permanecem em US $1,50/1 milhão.

Novidades do Gemini 3.5 Flash-Lite

  • Latência de execução de tarefas reduzida:maior capacidade de processamento na família 3.5 para análise de dados de alto volume e extração de documentos.
  • Raciocínio e performance multimodal aprimorados:caminho de migração forte do Gemini 2.5 Flash, com pontuações mais altas em tarefas de raciocínio, como HLE (18,0% em comparação com 11,0%) e benchmarks multimodais, como CharXIV (74,5% em comparação com 63,7%).
  • Orquestração de subagentes e confiabilidade de ferramentas:melhora a confiabilidade da execução de ferramentas para execução de código, pesquisa e fluxos de trabalho de MCP. Aumente o nível de pensamento para planejamento autônomo e tarefas complexas de subagentes.
  • Melhor compreensão de documentos:melhora a acurácia na análise de documentos e na extração de dados estruturados. Teste níveis de pensamento mínimos e altos, dependendo da complexidade do documento.
  • Programação interativa da Web e processamento de dados tabulares:tem um bom desempenho no JavaScript de front-end e no processamento de dados tabulares, planejando a execução de código leve.
  • Chatbot e persistência de persona:acompanhamento de instruções multiturno e consistência de persona mais fortes do que o Gemini 3.1 Flash-Lite.
  • Suporte ao uso do computador:com suporte como ferramenta nativa para automação de interface agêntica.

Como escolher o modelo Flash ou Flash-Lite certo

Use esta tabela para selecionar o modelo e o caminho de migração certos para suas cargas de trabalho.

Os dois modelos exigem a remoção de parâmetros de amostragem descontinuados (temperature, top_p, top_k) e turnos de modelo pré-preenchidos. Consulte Mudanças na API para mais detalhes.

Modelo Principais casos de uso Destino de migração recomendado