← Összes cikk

Gemini 3.8 Flash: millió token kontextusablak és az ügynökökre összpontosít

Gemini 3.8 Flash: millió token kontextusablak és az ügynökökre összpontosít

A Gemini 3.8 Flash szeptember 2-án jelent meg gyors modellként a programozáshoz, a többlépéses munkához és az autonóm ügynökökhöz. Legfeljebb 1 048 576 bemeneti tokent fogad el, és 65 536 tokent tud visszaadni; Szöveg, kép, hang, videó és PDF beviteli mód támogatott. Dokumentációja egyértelműen megjegyzi a lehetséges hallucinációkat és az időnkénti lassulásokat is.

Több, mint egy gyors chat modell

A Flash címke gyakran kompromisszumot sugall: sebességet a keményebb munkáért cserébe. Ez a kiadás máshová mutat – a cselekvések hosszú láncolatára. Támogatja a függvényhívást, a fájlmunkát, a kódvégrehajtást, a keresést és a számítógépes előnézeti használatot. Ez számít, amikor az ügynöknek el kell olvasnia egy specifikációt, lépésekre kell osztania a feladatot, szerkesztenie kell egy projektet, majd ellenőriznie kell az eredményt.

Abstract illustration of a fast model for programming and agent tasks

A benchmark számokhoz kis távolságra van szükség

A közzétett értékelés említést tesz a DeepSWE v1.1-ről, a Vals Finance Agent v2-ről, a Harvey’s Legal Agent Benchmarkról és a HLE-Verifiedről. Ezek hasznos jelzések, nem pedig annak ígérete, hogy egy felügyelet nélküli modell megfelelően kezeli az adattárat vagy a szerződést. A modellkártya azt is mondja, hogy több tokent költhet a válasz javítására, és a tudás frissessége tartományonként változik.

Értelmes első teszt

Próbáljon ki egy kis feladatot a saját anyagán: egy dokumentum, egy eszköz és a kész definíciója. Csak ezután adjon hozzá műveleteket. A millió tokenből álló kontextus hasznos, de egy nagy melléklet nem helyettesíti a tény- és engedélyellenőrzést.

Hivatkozások: amodell kártyaésAPI dokumentáció. Ha nyilvános modellekkel szeretne beszélgetni, látogasson el ideNeuralSpace Chat.