Gemini 3.8 Flash: миллион токенов контекста и акцент на агентные задачи
Gemini 3.8 Flash вышла 2 сентября как новая быстрая модель для программирования, многошаговых задач и автономных агентов. У неё контекст до 1 048 576 токенов, ответ до 65 536 токенов и поддержка текста, изображений, аудио, видео и PDF на входе; при этом в документации прямо предупреждают о возможных галлюцинациях и задержках.
Не только «быстрая версия»
Название Flash обычно заставляет ждать компромисса: скорость вместо сложной работы. Здесь фокус другой — длинные цепочки действий. Модель умеет вызывать функции, работать с файлами, исполнять код, пользоваться поиском и управлением компьютером в режиме preview. Такой набор нужен не для одного вопроса в чате, а, например, когда агенту надо прочитать спецификацию, разложить задачу на шаги, внести правки в проект и проверить результат.

Цифры стоит читать спокойно
В опубликованных оценках упоминаются DeepSWE v1.1, Vals Finance Agent v2, Harvey’s Legal Agent Benchmark и HLE-Verified. Это полезные ориентиры, но не гарантия, что модель без присмотра справится с вашим репозиторием или договором. Особенно важна оговорка из карточки: на некоторых запросах она может тратить больше токенов ради качества, а знания по разным областям имеют разную свежесть.
Что проверить разработчику
Если вы выбираете модель для реальной задачи, начните с маленького прогона на своих данных: дайте ей один документ, один инструмент и чёткий критерий готовности. Потом добавляйте действия. Миллионный контекст удобен, но большой входной файл не заменяет проверку фактов и прав доступа.
Справка: карточка модели и документация API. Если нужен привычный рабочий чат с разными публичными моделями, откройте чат NeuralSpace.