← Alla artiklar

Gemini 3.8 Flash: ett sammanhangsfönster med miljoner token och fokus på agenter

Gemini 3.8 Flash: ett sammanhangsfönster med miljoner token och fokus på agenter

Gemini 3.8 Flash lanserades den 2 september som en snabb modell för programmering, flerstegsarbete och autonoma agenter. Den accepterar upp till 1 048 576 inmatade tokens och kan returnera 65 536 tokens; text, bilder, ljud, video och PDF-filer stöds som indata. Dess dokumentation noterar också tydligt möjliga hallucinationer och enstaka avmattningar.

Mer än en snabb chattmodell

Flash-etiketten föreslår ofta en avvägning: hastighet i utbyte mot hårdare arbete. Den här utgåvan pekar på någon annanstans – långa kedjor av åtgärder. Den stöder funktionsanrop, filarbete, kodexekvering, sökning och förhandsgranskning av datoranvändning. Det spelar roll när en agent måste läsa en specifikation, dela upp en uppgift i steg, redigera ett projekt och sedan kontrollera resultatet.

Abstract illustration of a fast model for programming and agent tasks

Benchmarksiffror behöver lite avstånd

Den publicerade utvärderingen nämner DeepSWE v1.1, Vals Finance Agent v2, Harvey's Legal Agent Benchmark och HLE-Verified. Det är användbara signaler, inte ett löfte om att en oövervakad modell kommer att hantera ditt förvar eller kontrakt korrekt. Modellkortet säger också att det kan spendera fler tokens för att förbättra ett svar, och att kunskapens färskhet varierar beroende på domän.

Ett vettigt första test

Prova en liten uppgift på ditt eget material: ett dokument, ett verktyg och en tydlig definition av klart. Lägg till åtgärder först efter det. En miljon-token-kontext är praktiskt, men en stor bilaga ersätter inte fakta- eller tillståndskontroller.

Referenser: denmodellkortochAPI dokumentation. För en fungerande chatt med offentliga modeller, besökNeuralSpace Chat.