Gemini 3.8 Flash: 백만 개의 토큰 컨텍스트 창 및 에이전트에 초점
Gemini 3.8 Flash는 프로그래밍, 다단계 작업 및 자율 에이전트를 위한 빠른 모델로 9월 2일에 출시되었습니다. 최대 1,048,576개의 입력 토큰을 허용하고 65,536개의 토큰을 반환할 수 있습니다. 텍스트, 이미지, 오디오, 비디오 및 PDF가 입력으로 지원됩니다. 해당 문서에는 환각 가능성과 간헐적인 속도 저하도 명시되어 있습니다.
빠른 채팅 모델 그 이상
Flash 라벨은 종종 더 열심히 일하는 대신 속도를 높이는 트레이드오프를 제안합니다. 이 릴리스는 다른 곳, 즉 긴 작업 체인을 가리킵니다. 함수 호출, 파일 작업, 코드 실행, 검색, 미리보기 컴퓨터 사용 등을 지원합니다. 상담원이 사양을 읽고, 작업을 여러 단계로 나누고, 프로젝트를 편집한 다음 결과를 확인해야 하는 경우 이는 중요합니다.

벤치마크 수치에는 약간의 거리가 필요합니다.
게시된 평가에는 DeepSWE v1.1, Vals Finance Agent v2, Harvey's Legal Agent Benchmark 및 HLE-Verified가 언급되어 있습니다. 이는 무인 모델이 저장소나 계약을 올바르게 처리할 것이라는 약속이 아니라 유용한 신호입니다. 또한 모델 카드에는 답변을 개선하기 위해 더 많은 토큰을 사용할 수 있으며 지식의 신선도는 도메인에 따라 다르다고 나와 있습니다.
합리적인 첫 번째 테스트
자신의 자료에 대해 하나의 작은 작업을 시도해 보십시오. 하나의 문서, 하나의 도구 및 명확한 완료 정의가 가능합니다. 그 후에만 작업을 추가하세요. 백만 개의 토큰 컨텍스트가 편리하지만 대용량 첨부 파일이 사실 확인이나 권한 확인을 대체할 수는 없습니다.
참고자료:모델 카드그리고API 문서. 공개 모델과의 작업 채팅을 원하시면 다음을 방문하세요.NeuralSpace 채팅.