Gemini 3.5 Flash (Batch) 是由 Google DeepMind 开发的新一代高性能 Flash 系列 AI 模型,定位为兼具速度、智能水平和成本效率的通用型模型。该模型基于 Gemini 3 Flash 推理基础模型进行了优化,重点提升了 AI Agent 执行能力、代码能力、多步骤任务处理和长时间工作流支持能力。
Gemini 3.5 Flash 支持最大 100万 Tokens 上下文窗口,以及最高 65K Tokens 输出长度,能够处理大型文档、代码仓库、复杂项目资料和长期任务记录。
该模型支持原生多模态输入,包括文本、图片、视频、音频和 PDF,可用于复杂信息理解、内容分析、智能搜索和企业知识处理等场景。
相比传统 Flash 模型,Gemini 3.5 Flash 更加强调实际生产环境中的 AI Agent 应用能力,支持工具调用、代码执行、函数调用、结构化输出、文件搜索以及搜索增强等功能,可帮助开发者构建更智能的自动化应用。
Batch 版本针对大规模请求处理进行了优化,通过批量推理方式帮助企业降低 AI 调用成本,提高大量任务处理效率,适合数据处理、内容生成、企业自动化和 AI 工作流场景。
Gemini 3.5 Flash 的核心定位是打造一款高速、高智能、低成本、面向 AI Agent 时代的多模态模型,适用于开发下一代智能助手、自动化系统和企业级 AI 应用
Gemini 3.1 Flash Lite
52 谷歌轻量级多模态模型,支持图文音视频及PDF,主打低延迟、高吞吐,适用于规模化Agent场景。
Google




评论(0)