← Все статьи

Gemini 3.8 Flash: jendela konteks sejuta token dan fokus pada agen

Gemini 3.8 Flash: jendela konteks sejuta token dan fokus pada agen

Gemini 3.8 Flash diluncurkan pada tanggal 2 September sebagai model cepat untuk pemrograman, pekerjaan multi-langkah, dan agen otonom. Ia menerima hingga 1,048,576 token masukan dan dapat mengembalikan 65,536 token; teks, gambar, audio, video, dan PDF didukung sebagai input. Dokumentasinya juga dengan jelas mencatat kemungkinan halusinasi dan penurunan kecepatan sesekali.

Lebih dari model obrolan cepat

Label Flash sering kali menyarankan trade-off: kecepatan sebagai ganti kerja keras. Rilis ini menunjuk pada hal lain—rantai tindakan yang panjang. Ini mendukung pemanggilan fungsi, pekerjaan file, eksekusi kode, pencarian, dan pratinjau penggunaan komputer. Hal ini penting ketika agen harus membaca spesifikasi, membagi tugas menjadi beberapa langkah, mengedit proyek, dan kemudian memeriksa hasilnya.

Abstract illustration of a fast model for programming and agent tasks

Angka patokan perlu sedikit jarak

Evaluasi yang dipublikasikan menyebutkan DeepSWE v1.1, Vals Finance Agent v2, Tolok Ukur Agen Hukum Harvey, dan HLE-Terverifikasi. Itu adalah sinyal yang berguna, bukan janji bahwa model tanpa pengawasan akan menangani repositori atau kontrak Anda dengan benar. Kartu model juga mengatakan bahwa mereka mungkin menghabiskan lebih banyak token untuk meningkatkan jawaban, dan kesegaran pengetahuan bervariasi berdasarkan domain.

Tes pertama yang masuk akal

Cobalah satu tugas kecil pada materi Anda sendiri: satu dokumen, satu alat, dan definisi yang jelas tentang selesai. Tambahkan tindakan hanya setelah itu. Konteks jutaan token memang berguna, tetapi lampiran besar tidak menggantikan pemeriksaan fakta atau pemeriksaan izin.

Referensi: itukartu modelDandokumentasi API. Untuk obrolan kerja dengan model publik, kunjungiObrolan NeuralSpace.