← Все статьи

Gemini 3.8 Flash: et million-tokens kontekstvindue og fokus på agenter

Gemini 3.8 Flash: et million-tokens kontekstvindue og fokus på agenter

Gemini 3.8 Flash blev lanceret den 2. september som en hurtig model til programmering, flertrinsarbejde og autonome agenter. Den accepterer op til 1.048.576 input-tokens og kan returnere 65.536 tokens; tekst, billeder, lyd, video og PDF'er understøttes som input. Dens dokumentation noterer også tydeligt mulige hallucinationer og lejlighedsvise opbremsninger.

Mere end en hurtig chat-model

Flash-etiketten foreslår ofte en afvejning: hastighed i bytte for hårdere arbejde. Denne udgivelse peger et andet sted hen - lange kæder af handlinger. Det understøtter funktionsopkald, filarbejde, kodeudførelse, søgning og forhåndsvisning af computerbrug. Det betyder noget, når en agent skal læse en specifikation, opdele en opgave i trin, redigere et projekt og derefter kontrollere resultatet.

Abstract illustration of a fast model for programming and agent tasks

Benchmark-tal har brug for lidt afstand

Den offentliggjorte evaluering nævner DeepSWE v1.1, Vals Finance Agent v2, Harvey's Legal Agent Benchmark og HLE-Verified. Det er nyttige signaler, ikke et løfte om, at en uovervåget model vil håndtere dit lager eller kontrakt korrekt. Modelkortet siger også, at det kan bruge flere tokens for at forbedre et svar, og at videns friskhed varierer efter domæne.

En fornuftig første test

Prøv én lille opgave på dit eget materiale: ét dokument, ét værktøj og en klar definition af udført. Tilføj først handlinger derefter. En million-token kontekst er praktisk, men en stor vedhæftet fil erstatter ikke faktatjek eller tilladelsestjek.

Referencer: denmodelkortogAPI dokumentation. For en arbejdschat med offentlige modeller, besøgNeuralSpace Chat.