← すべての記事

Gemini 3.8 Flash: 100 万トークンのコンテキスト ウィンドウとエージェントに焦点を当てる

Gemini 3.8 Flash: 100 万トークンのコンテキスト ウィンドウとエージェントに焦点を当てる

Gemini 3.8 Flash は、プログラミング、複数ステップの作業、自律エージェントの高速モデルとして 9 月 2 日に発売されました。最大 1,048,576 個の入力トークンを受け入れ、65,536 個のトークンを返すことができます。テキスト、画像、オーディオ、ビデオ、PDF が入力としてサポートされます。そのドキュメントには、幻覚の可能性や時折の速度低下についても明確に記載されています。

単なる高速チャットモデル以上のもの

Flash というラベルは、多くの場合、ハードワークと引き換えにスピードを高めるというトレードオフを示唆しています。このリリースは、アクションの長いチェーンという別の場所を指します。関数呼び出し、ファイル作業、コード実行、検索、およびコンピューターの使用のプレビューをサポートします。これは、エージェントが仕様を読み、タスクをステップに分割し、プロジェクトを編集し、結果を確認する必要がある場合に重要です。

プログラミングとエージェント タスクの高速モデルの抽象的なイラスト

ベンチマークの数値には少し距離を置く必要があります

公開された評価では、DeepSWE v1.1、Vals Finance Agent v2、Harvey's Legal Agent Benchmark、および HLE-Verified について言及しています。これらは有用なシグナルであり、無人モデルがリポジトリやコントラクトを正しく処理することを保証するものではありません。モデル カードには、回答を改善するためにより多くのトークンが費やされる可能性があること、知識の鮮度はドメインによって異なることも記載されています。

賢明な最初のテスト

自分の資料で小さなタスクを 1 つ試してください。つまり、1 つのドキュメント、1 つのツール、そして完了の明確な定義です。その後にのみアクションを追加してください。 100 万トークンのコンテキストは便利ですが、大きな添付ファイルはファクト チェックや権限チェックに代わるものではありません。

参考文献: モデルカード そして APIドキュメント。公開モデルとの作業チャットについては、次のサイトにアクセスしてください。 NeuralSpace チャット.