← Alle artikler

Gemini 3.8 Flash: et kontekstvindu med millioner token og fokus på agenter

Gemini 3.8 Flash: et kontekstvindu med millioner token og fokus på agenter

Gemini 3.8 Flash ble lansert 2. september som en rask modell for programmering, flertrinnsarbeid og autonome agenter. Den aksepterer opptil 1 048 576 inndatasymboler og kan returnere 65 536 tokens; tekst, bilder, lyd, video og PDF-filer støttes som input. Dokumentasjonen noterer også tydelig mulige hallusinasjoner og sporadiske nedganger.

Mer enn en rask chat-modell

Flash-etiketten foreslår ofte en avveining: hastighet i bytte mot hardere arbeid. Denne utgivelsen peker andre steder – lange kjeder av handlinger. Den støtter funksjonskall, filarbeid, kodekjøring, søk og forhåndsvisning av datamaskinbruk. Det betyr noe når en agent må lese en spesifikasjon, dele opp en oppgave i trinn, redigere et prosjekt og deretter kontrollere resultatet.

Abstract illustration of a fast model for programming and agent tasks

Benchmark-tall trenger litt avstand

Den publiserte evalueringen nevner DeepSWE v1.1, Vals Finance Agent v2, Harvey's Legal Agent Benchmark og HLE-Verified. Dette er nyttige signaler, ikke et løfte om at en uovervåket modell vil håndtere depotet eller kontrakten din på riktig måte. Modellkortet sier også at det kan bruke flere tokens for å forbedre et svar, og at kunnskapens ferskhet varierer etter domene.

En fornuftig første test

Prøv én liten oppgave på ditt eget materiale: ett dokument, ett verktøy og en klar definisjon av ferdig. Legg til handlinger først etter det. En million-token kontekst er praktisk, men et stort vedlegg erstatter ikke faktasjekking eller tillatelsessjekker.

Referanser: denmodellkortogAPI-dokumentasjon. For en arbeidsprat med offentlige modeller, besøkNeuralSpace Chat.