Baca online, atau dapetin di inbox tiap minggu.

Gemini 3.8 Flash: Harga Sama, Reasoning Naik
AI Update

Gemini 3.8 Flash Rilis: Ngoding Makin Encer, Harga Tetap

2 September 20263 min read

Tiga rilis Flash dalam enam minggu itu bukan gimmick marketing — itu tanda Google lagi ngebut ngejar celah antara harga murah dan kualitas model yang biasanya cuma dipegang model mahal.

Apa yang baru

  • Rilis ketiga dalam enam minggu: Gemini 3.8 Flash muncul cuma tiga minggu setelah 3.7 Flash, menurut pengumuman resmi Google DeepMind.
  • Harga tetap, kemampuan naik: model ini dibanderol $0.75 per juta token input dan $3.75 per juta token output — persis sama dengan harga 3.7 Flash, gak ada kenaikan sepeser pun.
  • Skor 54.9% di HLE-Verified: Gemini 3.8 Flash mencatat 54.9% pada benchmark reasoning multi-langkah yang mencakup STEM, humaniora, dan bidang profesional.
  • Varian khusus keamanan siber: Gemini 3.8 Flash Cyber cuma bisa diakses "trusted defenders" lewat Fairwind Program yang baru, bukan untuk publik umum.
  • Bisa diatur seberapa keras mikirnya: developer bisa milih effort level model buat mengontrol pemakaian token, atau tetap pakai 3.7 Flash kalau prioritasnya efisiensi.

Cara kerjanya

Bayangin effort level di 3.8 Flash kayak gigi transmisi mobil manual. Gigi rendah dipakai buat jalan datar — hemat bensin, cepat, cukup buat tugas ringan. Gigi tinggi dipakai pas nanjak — model mengeksekusi lebih banyak langkah reasoning dan memanggil tools berulang kali, makan lebih banyak token, tapi hasilnya lebih akurat buat tugas rumit.

Google bilang lonjakan kemampuan ini datang dari "long-running agentic loop" — model dilatih lewat siklus panjang yang terus mengevaluasi dan memperbaiki dirinya sendiri, termasuk lewat pelatihan intensif di domain keamanan siber yang menuntut presisi tinggi. Efek sampingnya ikut mengalir ke kemampuan coding dan reasoning umum di versi Flash biasa.

Suka artikel ini? Kalian bakal suka newsletter mingguan gw.

Kenapa ini penting

Buat tim yang bikin chatbot, automasi n8n, atau agent yang jalan otomatis semalaman, model dengan harga stabil tapi kemampuan reasoning naik itu langsung mengubah kalkulasi biaya. Kalian gak perlu upgrade ke tier yang lebih mahal cuma buat dapat hasil yang lebih bisa diandalkan di tugas multi-langkah.

Ini juga soal siapa yang bisa "kerja sendirian" tanpa diawasi ketat. Kemampuan menyelesaikan masalah engineering end-to-end secara otonom — bukan cuma jawab satu prompt — itu yang bikin model kelas Flash makin realistis dipakai buat agentic workflow harian, bukan cuma demo. Kalau kalian masih bingung milih model mana yang pas buat agent tanpa bikin tagihan meledak, prinsipnya mirip cara milih tier model GPT-5.6 biar agent gak bakar duit — makin banyak pilihan model murah-tapi-mampu kayak 3.8 Flash, makin penting punya kriteria jelas kapan pakai yang murah dan kapan naik level.

Varian Cyber-nya sendiri gak relevan buat kebanyakan tim lokal — itu akses terbatas buat tim keamanan lewat program tertutup. Tapi fakta bahwa hasil riset keamanan siber itu nyasar ke Flash versi umum, artinya model murah yang bisa dipakai semua orang makin cepat kebagian peningkatan yang dulu cuma milik model paling mahal.

Buat kalian

  • Yang harus peduli: kalian yang lagi bangun automation, agent, atau tools coding dengan budget terbatas — model reasoning yang lebih kuat di harga yang sama artinya ROI per dolar naik tanpa kalian ngapa-ngapain.
  • Yang boleh santai: kalau workload kalian ringan dan 3.7 Flash udah cukup cepat dan murah, gak ada urgensi migrasi — 3.7 Flash tetap didukung penuh buat kebutuhan efisiensi.
  • Langkah kecil pertama: coba jalankan satu tugas coding atau agentic yang selama ini "hampir berhasil" di model lama, lewat effort level lebih tinggi di 3.8 Flash, dan bandingin hasilnya sebelum memutuskan pindah permanen.

Model baru datang tiap beberapa minggu, tapi yang beneran menentukan hasil kerja kalian bukan model mana yang dipakai — melainkan seberapa jelas kalian mendefinisikan tugas dan standar kualitasnya sebelum diserahkan ke agent mana pun. Itu yang gw latih bareng murid-murid di kelas gw.

Sumber primer: pengumuman resmi Google DeepMind (deepmind.google/blog/introducing-gemini-3-8-flash-and-38-flash-cyber).

Build 2ndbrain kalian, tingkatin produktivitas 10x lipat

Mulai Belajar