← Tutti gli articoli

Gemini 3.8 Flash: una finestra di contesto da un milione di token e un focus sugli agenti

Gemini 3.8 Flash: una finestra di contesto da un milione di token e un focus sugli agenti

Gemini 3.8 Flash è stato lanciato il 2 settembre come modello veloce per la programmazione, il lavoro in più fasi e gli agenti autonomi. Accetta fino a 1.048.576 token di input e può restituire 65.536 token; testo, immagini, audio, video e PDF sono supportati come input. La sua documentazione segnala chiaramente anche possibili allucinazioni e rallentamenti occasionali.

Più di un modello di chat veloce

L’etichetta Flash spesso suggerisce un compromesso: velocità in cambio di un lavoro più duro. Questo rilascio punta altrove: lunghe catene di azioni. Supporta la chiamata di funzioni, il lavoro sui file, l'esecuzione di codice, la ricerca e l'utilizzo in anteprima del computer. Ciò è importante quando un agente deve leggere una specifica, suddividere un'attività in passaggi, modificare un progetto e quindi verificare il risultato.

Abstract illustration of a fast model for programming and agent tasks

I numeri di riferimento richiedono una certa distanza

La valutazione pubblicata menziona DeepSWE v1.1, Vals Finance Agent v2, Harvey's Legal Agent Benchmark e HLE-Verified. Questi sono segnali utili, non una promessa che un modello automatico gestirà correttamente il tuo repository o contratto. La scheda modello afferma inoltre che potrebbe spendere più token per migliorare una risposta e che l'aggiornamento della conoscenza varia in base al dominio.

Un primo test sensato

Prova un piccolo compito sul tuo materiale: un documento, uno strumento e una chiara definizione di fatto. Aggiungi azioni solo dopo. Un contesto da un milione di token è utile, ma un allegato di grandi dimensioni non sostituisce il controllo dei fatti o i controlli delle autorizzazioni.

Riferimenti: ilscheda modelloEDocumentazione dell'API. Per una chat di lavoro con modelli pubblici, visitaChat sullo spazio neurale.