Model penalaran menghasilkan proses "penalaran" internal sebelum menampilkan respons. Kemampuan ini membantu model melakukan perencanaan multi-langkah yang kompleks, menyelesaikan masalah matematika, dan membuat kode yang akurat.
Halaman ini menjelaskan cara:
- Mengonfigurasi tingkat penalaran dan anggaran token
- Melihat ringkasan pemikiran
- Mempertahankan status penalaran di seluruh percakapan multi-turn menggunakan tanda tangan pemikiran
Model yang didukung
Kemampuan berpikir didukung di model berikut:
Klik untuk meluaskan model yang didukung
- Gemini Omni Flash
- Gemini Omni 1.1 Flash
- Gemini 3.8 Flash Cyber
- Gemini 3.8 Flash
- Gemini 3.7 Flash
- Gemini 3.6 Flash
- Gemini 3.5 Flash-Lite
- Gemini 3.5 Flash
- Gemini 3.1 Pro
- Gemini 3.1 Flash-Lite Image (Nano Banana 2 Lite)
- Gemini 3.1 Flash-Lite
- Gambar Gemini 3.1 Flash
- Gambar Gemini 3 Pro
- Gemini 3 Flash
- Gemini 2.5 Pro
- Gemini 2.5 Flash-Lite
- Gemini 2.5 Flash
Mengontrol pemikiran model
Penalaran diaktifkan secara default di model Gemini yang didukung. Di Agent Studio, Anda dapat memeriksa seluruh proses berpikir bersama dengan respons yang dihasilkan.
Cara Anda mengonfigurasi pemikiran bergantung pada versi model:
Model Gemini 3 dan yang lebih baru
Model Gemini 3 menggunakan parameter thinking_level. Parameter
ini menetapkan tingkat penalaran diskrit sehingga Anda dapat mengoptimalkan antara latensi dan
kedalaman penalaran.
Konsol
-
Buka Agent Studio, pilih New > Chat, lalu perluas panel model.
- Di panel Model settings, pilih model yang didukung dari menu Model.
- Pilih nilai dari menu drop-down Tingkat pemikiran.
Python
from google import genai
from google.genai import types
client = genai.Client()
response = client.models.generate_content(
model="gemini-3.5-flash",
contents="How does AI work?",
config=types.GenerateContentConfig(
thinking_config=types.ThinkingConfig(
# Options: MINIMAL, LOW, MEDIUM, HIGH
thinking_level=types.ThinkingLevel.THINKING_LEVEL_VALUE
)
),
)
print(response.text)Nilai tingkat penalaran
Anda dapat menyetel thinking_level ke salah satu nilai berikut:
MINIMAL: Menggunakan token sesedikit mungkin untuk penalaran. Paling cocok untuk tugas sederhana yang tidak memerlukan penalaran yang panjang.MINIMALmemerlukan tanda tangan pemikiran dalam percakapan multi-giliran; jika tidak ada, model akan menampilkan error400: INVALID_ARGUMENT.LOW: Menggunakan lebih sedikit token penalaran untuk respons yang lebih cepat. Paling cocok untuk aplikasi dengan throughput tinggi dan kompleksitas tugas rendah.MEDIUM: Menyeimbangkan kualitas penalaran dan latensi. Cocok untuk tugas dengan kompleksitas sedang yang memanfaatkan langkah-langkah penalaran perantara.HIGH: Menggunakan kapasitas berpikir maksimum. Terbaik untuk perintah kompleks yang memerlukan penalaran mendalam, pemecahan masalah multi-langkah, verifikasi kode formal, atau eksekusi alat multi-giliran.
Tingkat penalaran yang didukung menurut model
Tabel berikut mencantumkan nilai thinking_level yang didukung dan konfigurasi default menurut model:
| Model | Nilai thinking_level yang didukung |
Default |
|---|---|---|
| Gemini 3.8 Flash Cyber | LOW, MEDIUM, HIGH |
MEDIUM |
| Gemini 3.8 Flash | LOW, MEDIUM, HIGH |
MEDIUM |
| Gemini 3.7 Flash | LOW, MEDIUM, HIGH |
MEDIUM |
| Gemini 3.6 Flash | MINIMAL, LOW, MEDIUM, HIGH |
MEDIUM |
| Gemini 3.5 Flash-Lite | MINIMAL, LOW, MEDIUM, HIGH |
MINIMAL |
| Gemini 3.5 Flash | MINIMAL, LOW, MEDIUM, HIGH |
MEDIUM |
| Gemini 3.1 Pro | LOW, MEDIUM, HIGH |
HIGH |
| Gemini 3.1 Flash-Lite Image (Nano Banana 2 Lite) | MINIMAL, HIGH |
MINIMAL |
| Gemini 3.1 Flash-Lite | MINIMAL, LOW, MEDIUM, HIGH |
MINIMAL |
| Gambar Gemini 3.1 Flash | MINIMAL, HIGH |
MINIMAL |
| Gambar Gemini 3 Pro | HIGH |
HIGH |
| Gemini 3 Flash | MINIMAL, LOW, MEDIUM, HIGH |
HIGH |
Model Gemini 2.5 dan yang lebih lama
Untuk model Gemini 2.5 dan yang lebih lama, konfigurasi kemampuan berpikir menggunakan parameter thinking_budget. Parameter ini menetapkan batas lunak pada jumlah token yang dapat digunakan model selama penalaran internal.
Konsol
-
Buka Agent Studio, lalu pilih New > Chat.
- Di panel Model settings, pilih model yang didukung dari menu Model.
- Di pemilih Anggaran token, pilih Manual dan gunakan penggeser untuk menyesuaikan batas token.
Python
Instal
pip install --upgrade google-genai
Untuk mempelajari lebih lanjut, lihat dokumentasi referensi SDK.
Tetapkan variabel lingkungan untuk menggunakan Google Gen AI SDK dengan Vertex AI:
# Replace the `GOOGLE_CLOUD_PROJECT` and `GOOGLE_CLOUD_LOCATION` values # with appropriate values for your project. export GOOGLE_CLOUD_PROJECT=GOOGLE_CLOUD_PROJECT export GOOGLE_CLOUD_LOCATION=global export GOOGLE_GENAI_USE_ENTERPRISE=True
Node.js
Instal
npm install @google/genai
Untuk mempelajari lebih lanjut, lihat dokumentasi referensi SDK.
Tetapkan variabel lingkungan untuk menggunakan Google Gen AI SDK dengan Vertex AI:
# Replace the `GOOGLE_CLOUD_PROJECT` and `GOOGLE_CLOUD_LOCATION` values # with appropriate values for your project. export GOOGLE_CLOUD_PROJECT=GOOGLE_CLOUD_PROJECT export GOOGLE_CLOUD_LOCATION=global export GOOGLE_GENAI_USE_ENTERPRISE=True
Go
Pelajari cara menginstal atau mengupdate Go.
Untuk mempelajari lebih lanjut, lihat dokumentasi referensi SDK.
Tetapkan variabel lingkungan untuk menggunakan Google Gen AI SDK dengan Vertex AI:
# Replace the `GOOGLE_CLOUD_PROJECT` and `GOOGLE_CLOUD_LOCATION` values # with appropriate values for your project. export GOOGLE_CLOUD_PROJECT=GOOGLE_CLOUD_PROJECT export GOOGLE_CLOUD_LOCATION=global export GOOGLE_GENAI_USE_ENTERPRISE=True
Java
Pelajari cara menginstal atau mengupdate Java.
Untuk mempelajari lebih lanjut, lihat dokumentasi referensi SDK.
Tetapkan variabel lingkungan untuk menggunakan Google Gen AI SDK dengan Vertex AI:
# Replace the `GOOGLE_CLOUD_PROJECT` and `GOOGLE_CLOUD_LOCATION` values # with appropriate values for your project. export GOOGLE_CLOUD_PROJECT=GOOGLE_CLOUD_PROJECT export GOOGLE_CLOUD_LOCATION=global export GOOGLE_GENAI_USE_ENTERPRISE=True
Jika Anda tidak menentukan anggaran, model akan menetapkan anggaran token secara dinamis hingga 8.192 token. Untuk mengaktifkan anggaran dinamis secara eksplisit di API, tetapkan
thinking_budget ke -1.
Anggaran penalaran yang didukung menurut model
Tabel berikut mencantumkan batas token minimum, maksimum, dan default untuk setiap model:
| Model | Token minimum | Token maksimum | Default |
|---|---|---|---|
| Gemini 2.5 Flash | 1 | 24.576 | Otomatis (hingga 8.192 token) |
| Gemini 2.5 Pro | 128 | 32.768 | Otomatis (hingga 8.192 token) |
| Gemini 2.5 Flash-Lite | 512 | 24.576 | Otomatis (hingga 8.192 token) |
Menonaktifkan penalaran
Anda dapat menonaktifkan kemampuan berpikir untuk Gemini 2.5 Flash dan Gemini 2.5 Flash-Lite dengan menyetel thinking_budget ke 0. Meskipun konten pemikiran tidak ditampilkan dalam respons, teks yang dihasilkan mungkin masih menampilkan output gaya penalaran.
Anda tidak dapat menonaktifkan proses berpikir untuk Gemini 2.5 Pro.
Melihat ringkasan pemikiran
Thought summaries menampilkan langkah-langkah penalaran menengah bersama dengan respons akhir model. Ringkasan pemikiran didukung di model Gemini 2.5 dan yang lebih baru.
Konsol
Ringkasan pemikiran diaktifkan secara default di Agent Studio. Untuk melihat langkah-langkah penalaran yang diringkas, luaskan panel Pemikiran.
Python
Instal
pip install --upgrade google-genai
Untuk mempelajari lebih lanjut, lihat dokumentasi referensi SDK.
Tetapkan variabel lingkungan untuk menggunakan Google Gen AI SDK dengan Vertex AI:
# Replace the `GOOGLE_CLOUD_PROJECT` and `GOOGLE_CLOUD_LOCATION` values # with appropriate values for your project. export GOOGLE_CLOUD_PROJECT=GOOGLE_CLOUD_PROJECT export GOOGLE_CLOUD_LOCATION=global export GOOGLE_GENAI_USE_ENTERPRISE=True
Node.js
Instal
npm install @google/genai
Untuk mempelajari lebih lanjut, lihat dokumentasi referensi SDK.
Tetapkan variabel lingkungan untuk menggunakan Google Gen AI SDK dengan Vertex AI:
# Replace the `GOOGLE_CLOUD_PROJECT` and `GOOGLE_CLOUD_LOCATION` values # with appropriate values for your project. export GOOGLE_CLOUD_PROJECT=GOOGLE_CLOUD_PROJECT export GOOGLE_CLOUD_LOCATION=global export GOOGLE_GENAI_USE_ENTERPRISE=True
Go
Pelajari cara menginstal atau mengupdate Go.
Untuk mempelajari lebih lanjut, lihat dokumentasi referensi SDK.
Tetapkan variabel lingkungan untuk menggunakan Google Gen AI SDK dengan Vertex AI:
# Replace the `GOOGLE_CLOUD_PROJECT` and `GOOGLE_CLOUD_LOCATION` values # with appropriate values for your project. export GOOGLE_CLOUD_PROJECT=GOOGLE_CLOUD_PROJECT export GOOGLE_CLOUD_LOCATION=global export GOOGLE_GENAI_USE_ENTERPRISE=True
Java
Pelajari cara menginstal atau mengupdate Java.
Untuk mempelajari lebih lanjut, lihat dokumentasi referensi SDK.
Tetapkan variabel lingkungan untuk menggunakan Google Gen AI SDK dengan Vertex AI:
# Replace the `GOOGLE_CLOUD_PROJECT` and `GOOGLE_CLOUD_LOCATION` values # with appropriate values for your project. export GOOGLE_CLOUD_PROJECT=GOOGLE_CLOUD_PROJECT export GOOGLE_CLOUD_LOCATION=global export GOOGLE_GENAI_USE_ENTERPRISE=True
Respons dapat menampilkan tanda tangan pemikiran tanpa teks ringkasan pemikiran dalam situasi berikut:
- Permintaan kompleksitas rendah: Permintaan memerlukan langkah-langkah penalaran minimal.
- Ringkasan dinonaktifkan: Ringkasan pemikiran tidak diminta atau dinonaktifkan.
- Modalitas non-teks: Penalaran atas modalitas tertentu (seperti analisis gambar) mungkin tidak menghasilkan ringkasan teks.
Aplikasi Anda harus menangani kolom ringkasan pemikiran yang kosong atau tidak ada dengan baik sambil mempertahankan tanda tangan pemikiran yang menyertainya.
Tanda tangan penalaran
Tanda tangan pemikiran adalah representasi terenkripsi dari status penalaran internal model. Agen ini mempertahankan konteks di seluruh percakapan multi-turn, terutama saat menggunakan panggilan fungsi.
Untuk mempertahankan konteks penalaran di seluruh interaksi multi-giliran, teruskan tanda tangan pemikiran yang ditampilkan dalam respons sebelumnya kembali ke permintaan berikutnya, terlepas dari tingkat pemikiran yang dikonfigurasi.
Jika Anda menggunakan Google Gen AI SDK resmi (Python, Node.js, Go, atau Java), tanda tangan pemikiran akan dikelola secara otomatis saat menggunakan sesi chat standar atau saat menambahkan objek respons lengkap ke histori pesan Anda.
Untuk pola, persyaratan, dan contoh implementasi, lihat Tanda tangan pemikiran.
Harga
Anda akan ditagih untuk token yang dihasilkan selama proses berpikir. Untuk model yang mengaktifkan penalaran secara default—seperti Gemini 3 Pro dan Gemini 2.5 Pro—token penalaran ini disertakan dalam penggunaan yang dapat ditagih.
Untuk mengetahui detail tarif selengkapnya, lihat Harga.
Langkah berikutnya
Tanda tangan penalaran
Pelajari cara mempertahankan status penalaran Gemini selama percakapan multi-turn dan multi-langkah menggunakan tanda tangan pemikiran.
Panduan pembuatan perintah penalaran
Pelajari teknik dan praktik terbaik rekayasa perintah yang disesuaikan untuk model penalaran Gemini.