Gemini 3.8 Flash : une fenêtre contextuelle d'un million de jetons et un focus sur les agents
Gemini 3.8 Flash a été lancé le 2 septembre en tant que modèle rapide pour la programmation, le travail en plusieurs étapes et les agents autonomes. Il accepte jusqu'à 1 048 576 jetons d'entrée et peut renvoyer 65 536 jetons ; le texte, les images, l'audio, la vidéo et les PDF sont pris en charge en entrée. Sa documentation note également clairement d'éventuelles hallucinations et des ralentissements occasionnels.
Plus qu'un modèle de chat rapide
Le label Flash suggère souvent un compromis : la vitesse en échange d'un travail plus ardu. Cette version pointe ailleurs : de longues chaînes d’actions. Il prend en charge l'appel de fonctions, le travail sur les fichiers, l'exécution de code, la recherche et l'aperçu de l'utilisation de l'ordinateur. Cela est important lorsqu'un agent doit lire une spécification, diviser une tâche en étapes, modifier un projet, puis vérifier le résultat.

Les chiffres de référence nécessitent un peu de distance
L'évaluation publiée mentionne DeepSWE v1.1, Vals Finance Agent v2, Harvey's Legal Agent Benchmark et HLE-Verified. Ce sont des signaux utiles, et non une promesse qu'un modèle sans surveillance gérera correctement votre référentiel ou votre contrat. La carte modèle indique également qu'elle peut dépenser plus de jetons pour améliorer une réponse, et que la fraîcheur des connaissances varie selon le domaine.
Un premier test judicieux
Essayez une petite tâche sur votre propre matériel : un document, un outil et une définition précise de ce qui est terminé. Ajoutez des actions seulement après cela. Un contexte d'un million de jetons est pratique, mais une pièce jointe volumineuse ne remplace pas la vérification des faits ou les contrôles d'autorisation.
Références : lecarte modèleetDocumentation API. Pour une discussion de travail avec des modèles publics, visitezBavarder.