Lewati ke konten utama
Kami berdiri bersama rakyat Palestina — Free Palestine.

Dipublikasikan: 3 September 2026 · ~387 kata · ~2 menit baca

Ditulis oleh: Eve

Gemini 3.8 Flash 'kerja lebih keras', tapi dompet lo juga harus siap

Google baru aja rilis Gemini 3.8 Flash yang diklaim 'kerja lebih keras' lewat reasoning lebih dalam dan tool calling berulang. Harga per token masih sama kayak pendahulunya, tapi tagihan API lo bisa bengkak.

Google nggak pernah lama-lama kasih napas. Belum lama Gemini 3.7 Flash rilis, mereka udah lempar Gemini 3.8 Flash ke publik. Klaim utamanya jelas, model ini "bekerja lebih keras" dari pendahulunya.

Maksudnya bukan cuma nambah pintar di atas kertas. Gemini 3.8 Flash ngelakuin lebih banyak langkah reasoning buat tugas kompleks dan bisa manggil tools secara berulang sampai masalahnya kelar. Kedengeran keren, tapi ada ongkos yang harus dibayar, dan itu soal token.

Kenapa Google bilang 'kerja lebih keras'

Alih-alih langsung jawab dari satu kali inferensi, model ini milih jalur yang lebih panjang. Dia ngurai masalah, ngelakuin reasoning ekstra, dan kalau perlu manggil tools beberapa kali buat dapet hasil yang paling akurat. Buat tugas sederhana ini bisa keliatan berlebihan, tapi buat use case yang butuh konteks atau aksi eksternal, hasilnya jauh lebih bisa diandalkan.

Ini arah yang sebenernya udah ditebak banyak orang. Kompetisi model AI sekarang bukan cuma soal siapa yang jawab paling cerdas, tapi siapa yang paling bisa dipercaya buat nyelesaiin kerjaan yang ribet. Jawaban Google atas tantangan itu ya bikin modelnya mau repot dulu.

Harga per token sama, tagihan bisa beda

Ini bagian yang bikin developer harus baca dua kali. Google masih naruh harga intro yang sama dengan 3.7 Flash, sekitar US$0,75 per juta input token dan US$3,75 per juta output token. Tapi ada peringatan halus yang gampang kelewat, model ini bisa aja ngabisin token lebih banyak demi performa maksimal, terutama di level effort yang tinggi.

Buat lo yang ngerjain aplikasi dengan volume request gede, selisih ini nggak bisa dianggap remeh. Token ekstra buat reasoning yang nggak terlalu perlu bakal kelihatan banget pas invoice API bulanan datang. Jadi jangan cuma lihat angka harga di halaman pricing, ukur juga rata-rata token per request di workload lo sendiri.

Gemini 3.8 Flash ngasih gambaran jelas soal arah industri, performa maksimal nggak pernah gratis. Model makin rajin mikir, dan rajin itu selalu ada biayanya. Jadi keputusan paling cerdas bukan milih model paling baru, tapi milih model yang paling efisien buat masalah lo.

Sumber: Google says its new Gemini 3.8 Flash model 'works harder' but might cost more