Google Luncurkan Gemini 3.6 Flash untuk Tekan Biaya Token AI Agen

Google DeepMind memperkenalkan tiga model AI baru yang dirancang untuk meningkatkan efisiensi penggunaan token pada aplikasi agen cerdas. Ketiga model tersebut adalah Gemini 3.6 Flash, Gemini 3.5 Flash-Lite, dan Gemini 3.5 Flash Cyber. Peluncuran ini menekankan pada pengurangan biaya operasional sekaligus peningkatan kecepatan pemrosesan untuk tugas-tugas rekayasa perangkat lunak yang kompleks.

Gemini 3.6 Flash ditawarkan dengan harga 1,50 dolar AS per satu juta token input dan 7,50 dolar AS per satu juta token output melalui API. Sementara itu, Gemini 3.5 Flash-Lite dibanderol lebih rendah yaitu 0,30 dolar AS untuk input dan 2,50 dolar AS untuk output per juta token. Harga ini memberikan penghematan signifikan dibandingkan generasi sebelumnya, meskipun Gemini 3.1 Flash-Lite tetap menjadi model termurah dengan harga 0,25 dolar AS per juta token input.

Efisiensi token yang dicapai Gemini 3.6 Flash mencapai pengurangan hingga 65 persen pada benchmark DeepSWE untuk tugas rekayasa jangka panjang. Model ini juga mencatat skor 49 persen pada benchmark tersebut, naik dari 37 persen pada versi sebelumnya. Peningkatan serupa terlihat pada MLE-Bench dengan skor 63,9 persen dan OSWorld-Verified mencapai 83,0 persen.

Dalam konteks persaingan industri, langkah Google ini memperkuat posisinya di segmen model berbiaya rendah yang tetap kompetitif terhadap penawaran dari Xiaomi, DeepSeek, dan Alibaba Cloud yang mendominasi daftar harga termurah. Pengurangan langkah penalaran dan pemanggilan alat secara internal memungkinkan perusahaan mengadopsi agen AI dalam skala besar tanpa lonjakan biaya komputasi yang berlebihan.

Gemini 3.5 Flash-Lite menonjol sebagai model tercepat dalam seri 3.5 dengan kecepatan 350 token output per detik. Model ini cocok untuk pemrosesan dokumen masif dan pencarian agenik yang membutuhkan latensi minimal. Sementara Gemini 3.5 Flash Cyber dikhususkan untuk penelitian keamanan siber dan akan tersedia terbatas bagi pemerintah serta mitra terpercaya melalui CodeMender.

Pengembangan model-model ini mencerminkan tren industri menuju sistem AI agenik yang otonom dalam jangka waktu panjang. Efisiensi token yang lebih baik tidak hanya menekan biaya langsung, tetapi juga mempercepat integrasi ke dalam alur kerja perusahaan yang sensitif terhadap waktu dan anggaran.

Google mengonfirmasi bahwa Gemini 3.5 Pro masih dalam tahap pengujian dengan mitra dan akan dirilis secara luas setelah siap. Sementara itu, pra-pelatihan untuk Gemini 4 telah dimulai. Hingga rilis model andalan berikutnya, pengembang diharapkan memanfaatkan arsitektur Flash yang efisien namun tetap memiliki keterbatasan tertentu dalam hal akses terbuka.

Related posts