← Todos os artigos

Gemini 3.8 Flash: uma janela de contexto de um milhão de tokens e foco em agentes

Gemini 3.8 Flash: uma janela de contexto de um milhão de tokens e foco em agentes

Gemini 3.8 Flash lançado em 2 de setembro como um modelo rápido para programação, trabalho em várias etapas e agentes autônomos. Aceita até 1.048.576 tokens de entrada e pode retornar 65.536 tokens; texto, imagens, áudio, vídeo e PDFs são suportados como entrada. Sua documentação também observa claramente possíveis alucinações e lentidão ocasional.

Mais do que um modelo de chat rápido

O rótulo Flash geralmente sugere uma compensação: velocidade em troca de trabalho mais árduo. Esta versão aponta para outro lugar – longas cadeias de ações. Ele suporta chamada de função, trabalho de arquivo, execução de código, pesquisa e visualização do uso do computador. Isso é importante quando um agente precisa ler uma especificação, dividir uma tarefa em etapas, editar um projeto e depois verificar o resultado.

Ilustração abstrata de um modelo rápido para tarefas de programação e agente

Os números de referência precisam de um pouco de distância

A avaliação publicada menciona DeepSWE v1.1, Vals Finance Agent v2, Harvey’s Legal Agent Benchmark e HLE-Verified. Esses são sinais úteis, não uma promessa de que um modelo autônomo manipulará seu repositório ou contrato corretamente. O cartão modelo também diz que pode gastar mais tokens para melhorar uma resposta e que a atualização do conhecimento varia de acordo com o domínio.

Um primeiro teste sensato

Experimente uma pequena tarefa em seu próprio material: um documento, uma ferramenta e uma definição nítida de concluído. Adicione ações somente depois disso. Um contexto de um milhão de tokens é útil, mas um anexo grande não substitui a verificação de fatos ou de permissão.

Referências: o cartão modelo e Documentação da API. Para um bate-papo de trabalho com modelos públicos, visite NeuralSpace Bate-papo.