← Все статьи

Gemini 3.8 Flash: okno kontekstowe z milionem tokenów i skupienie się na agentach

Gemini 3.8 Flash: okno kontekstowe z milionem tokenów i skupienie się na agentach

Gemini 3.8 Flash wystartował 2 września jako szybki model do programowania, wieloetapowej pracy i autonomicznych agentów. Akceptuje do 1 048 576 tokenów wejściowych i może zwrócić 65 536 tokenów; Jako dane wejściowe obsługiwany jest tekst, obrazy, dźwięk, wideo i pliki PDF. W jego dokumentacji wyraźnie odnotowuje się również możliwe halucynacje i sporadyczne spowolnienia.

Więcej niż model szybkiego czatu

Etykieta Flash często sugeruje kompromis: szybkość w zamian za cięższą pracę. To wydanie wskazuje gdzie indziej – na długie łańcuchy działań. Obsługuje wywoływanie funkcji, pracę z plikami, wykonywanie kodu, wyszukiwanie i podgląd użycia komputera. Ma to znaczenie, gdy agent musi przeczytać specyfikację, podzielić zadanie na etapy, edytować projekt, a następnie sprawdzić wynik.

Abstract illustration of a fast model for programming and agent tasks

Liczby porównawcze wymagają trochę dystansu

W opublikowanej ocenie wspomniano o DeepSWE v1.1, Vals Finance Agent v2, Harvey’s Legal Agent Benchmark i HLE-Verified. Są to przydatne sygnały, a nie obietnica, że ​​model bez nadzoru będzie poprawnie obsługiwał Twoje repozytorium lub kontrakt. Karta modelu mówi również, że może wydać więcej żetonów, aby ulepszyć odpowiedź, a aktualność wiedzy różni się w zależności od domeny.

Rozsądny pierwszy test

Wypróbuj jedno małe zadanie na własnym materiale: jeden dokument, jedno narzędzie i jasna definicja wykonania. Dopiero potem dodaj akcje. Kontekst zawierający milion tokenów jest przydatny, ale duży załącznik nie zastępuje sprawdzania faktów ani sprawdzania uprawnień.

Referencje:karta modeluIDokumentacja API. Aby odbyć roboczy czat z modelkami publicznymi, odwiedź stronęCzat NeuralSpace.