Menggunakan model Gemini terbaru

Halaman ini 3.5 Flash

Gemini 3.6 Flash (gemini-3.6-flash) dan Gemini 3.5 Flash-Lite (gemini-3.5-flash-lite) tersedia secara umum (GA) dan siap digunakan untuk produksi.

  • Gemini 3.6 Flash: Performa yang lebih baik untuk tugas multimodal dan agentik yang kompleks sekaligus mengurangi penggunaan token, dengan titik harga yang lebih rendah daripada 3.5 Flash.
  • Gemini 3.5 Flash-Lite: Model tercepat dan paling hemat biaya dalam rangkaian 3.5. Mengungguli generasi Flash-Lite sebelumnya untuk eksekusi throughput tinggi.

Panduan ini menjelaskan hal-hal baru di setiap model, perubahan API yang memengaruhi kode Anda, dan cara melakukan migrasi.

Gemini 3.6 Flash

  1. Instal skill:

    npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --global
  2. Terapkan keahlian:

    /gemini-interactions-api migrate my app to Gemini 3.6 Flash

Gemini 3.5 Flash-Lite

  1. Instal skill:

    npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --global
  2. Terapkan keahlian:

    /gemini-interactions-api migrate my app to Gemini 3.5 Flash-Lite

Model baru

Model ID Model Tingkat penalaran default Harga Deskripsi
Gemini 3.6 Flash gemini-3.6-flash medium $1,50/1 Juta token input dan $7,50/1 Juta token output Menyeimbangkan kecepatan dengan kecerdasan untuk tugas agentic dan multimodal.
Gemini 3.5 Flash-Lite gemini-3.5-flash-lite minimal $0,30/1 Juta token input dan $2,50/1 Juta token output Model 3.5 tercepat dan berbiaya terendah untuk eksekusi throughput tinggi.

Kedua model mendukung jendela konteks 1 juta token, token output maksimum 64 ribu, kemampuan berpikir, dan rangkaian lengkap alat bawaan termasuk Penggunaan Komputer.

Untuk melihat spesifikasi lengkap, lihat halaman model:

Untuk mengetahui harga mendetail, lihat halaman harga.

Panduan memulai

Python

from google import genai

client = genai.Client()

interaction = client.interactions.create(
    model="gemini-3.6-flash",
    input="Write a three.js script that renders an interactive 3D robot."
)

print(interaction.output_text)

JavaScript

import { GoogleGenAI } from "@google/genai";

const ai = new GoogleGenAI({});

async function main() {
  const interaction = await ai.interactions.create({
    model: "gemini-3.6-flash",
    input: "Write a three.js script that renders an interactive 3D robot.",
  });
  console.log(interaction.outputText);
}

main();

REST

curl "https://generativelanguage.googleapis.com/v1beta/interactions" \
  -H "x-goog-api-key: $GEMINI_API_KEY" \
  -H 'Content-Type: application/json' \
  -X POST \
  -d '{
    "model": "gemini-3.6-flash",
    "input": {
      "parts": [{"text": "Write a three.js script that renders an interactive 3D robot."}]
    }
  }'

Yang baru di Gemini 3.6 Flash

  • Pengurangan token dan giliran: Menyelesaikan alur kerja multi-langkah dengan lebih sedikit langkah penalaran, giliran percakapan, dan panggilan alat dibandingkan Gemini 3.5. Hal ini juga mengurangi spiral loop eksekusi.
  • Peningkatan pembuatan kode: Menghasilkan kode siap produksi berkualitas lebih tinggi dengan lebih sedikit pengeditan yang tidak diinginkan dan lebih sedikit loop proses debug.
  • Kualitas mengikuti perintah yang lebih baik: Mengurangi perubahan file yang tidak diinginkan selama tugas diagnostik.
  • Kemampuan penalaran multimodal dan spasial yang kuat: Peningkatan performa dalam interpretasi diagram, konversi cetak biru visual, dan pembuatan tata letak web multi-elemen.
  • Pemeriksaan terprogram di awal: Lebih sering menjalankan skrip kode diagnostik sebelum melakukan perubahan daripada Gemini 3.5 Flash. Hal ini meningkatkan akurasi pada tugas yang kompleks, tetapi dapat menambahkan langkah eksplorasi ekstra pada pekerjaan frontend yang sederhana.
  • Dukungan Penggunaan Komputer: Didukung sebagai alat native untuk otomatisasi UI berbasis agen.
  • Preferensi gaya UI: Lebih baik dalam membuat kode fungsional, meskipun evaluator manusia lebih menyukai model sebelumnya untuk tata letak visual dan gaya. Anda dapat memitigasi hal ini dengan memberikan panduan desain yang jelas.
  • Upaya penalaran default (sedang): Menggunakan tingkat penalaran default medium yang sama dengan Gemini 3.5 Flash.
  • Harga yang lebih rendah: Biaya token output yang lebih rendah ($7,50/1 juta vs. $9,00/1 juta untuk 3.5 Flash). Token input tetap $1,50/1M.

Yang baru di Gemini 3.5 Flash-Lite

  • Latensi eksekusi tugas yang lebih rendah: Throughput tertinggi dalam keluarga 3.5 untuk penguraian data dan ekstraksi dokumen dalam volume tinggi.
  • Performa multimodal dan penalaran yang ditingkatkan: Jalur migrasi yang kuat dari Gemini 2.5 Flash, dengan skor yang lebih tinggi pada tugas penalaran seperti HLE (18,0% vs. 11,0%) dan tolok ukur multimodal seperti CharXIV (74,5% vs. 63,7%).
  • Orkestrasi sub-agen dan keandalan alat: Meningkatkan keandalan eksekusi alat untuk eksekusi kode, penelusuran, dan alur kerja MCP. Meningkatkan tingkat pemikiran untuk perencanaan otonom dan tugas sub-agen yang kompleks.
  • Peningkatan pemahaman dokumen: Meningkatkan akurasi penguraian dokumen dan ekstraksi data terstruktur. Bereksperimenlah dengan tingkat penalaran minimal dan tinggi, bergantung pada kompleksitas dokumen.
  • Pemrosesan data tabular dan coding web interaktif: Berperforma baik dalam pemrosesan data tabular dan JavaScript frontend dengan merencanakan melalui eksekusi kode ringan.
  • Ketekunan chatbot dan persona: Mengikuti petunjuk multi-turn yang lebih kuat dan konsistensi persona dibandingkan Gemini 3.1 Flash-Lite.
  • Dukungan Penggunaan Komputer: Didukung sebagai alat native untuk otomatisasi UI berbasis agen.

Memilih model Flash atau Flash-Lite yang tepat

Gunakan tabel ini untuk memilih model dan jalur migrasi yang tepat untuk workload Anda.

Kedua model memerlukan penghapusan parameter pengambilan sampel yang tidak digunakan lagi (temperature, top_p, top_k) dan giliran model yang telah diisi sebelumnya. Lihat Perubahan API untuk mengetahui detailnya.

Model Kasus penggunaan utama Target migrasi yang direkomendasikan
Gemini 3.6 Flash
gemini-3.6-flash
Pembuatan kode, penalaran spasial/multimodal, alur kerja agentic multi-langkah Gemini 3.5 Flash, Gemini 3 Flash (Pratinjau), atau Gemini 3.1 Pro
Gemini 3.5 Flash-Lite
gemini-3.5-flash-lite
Eksekusi sub-agen otonom, analisis data dan ekstraksi dokumen dalam volume tinggi, penguraian JSON terstruktur Gemini 3.1 Flash-Lite atau Gemini 2.5 Flash

Agen Antigravity yang diperbarui

Berkat peningkatan performanya, Gemini 3.6 Flash kini menjadi model default baru yang mendukung agen Antigravity di Agen Terkelola Gemini. Hal ini dapat diubah dengan menyetel kolom baru di API.

Python

from google import genai

client = genai.Client()

interaction = client.interactions.create(
    agent="antigravity-preview-05-2026",
    input="Read Hacker News, summarize the top 10 stories, and save the results as a PDF.",
    environment="remote",
)

print(interaction