Gemini 3.5 Flash-Lite (Batch) 是由 Google DeepMind 开发的新一代轻量级 AI 模型,定位为 Gemini 系列中注重速度、成本效率和大规模部署能力的模型。相比旗舰级 Gemini 模型,Flash-Lite 并不追求最高复杂推理能力,而是针对大量重复任务和高并发场景进行了优化,适用于批量数据处理、文档解析、信息提取、AI Agent 子任务和自动化工作流。Batch 版本支持异步批量推理,可帮助企业一次性处理大量 AI 请求,在降低成本的同时提升处理效率。
Gemini 3.5 Flash-Lite 支持多模态输入,包括文本、图片、视频、音频和 PDF 文件,并支持 Function Calling(函数调用)、Structured Output(结构化输出)、Code Execution(代码执行)、File Search(文件搜索)、Search Grounding(搜索增强)以及 URL Context(网页内容理解)等开发能力。模型拥有 1,048,576 Tokens 输入上下文窗口(约100万 Tokens),最大输出支持 65,536 Tokens,能够处理长文档、大型资料库、技术文档和复杂信息提取任务。
Gemini 3.5 Flash-Lite 的核心定位是以更低成本提供接近高级模型的 AI 能力,适合大规模商业 AI 应用、自动化系统和 AI Agent 工作流。
Gemini 3.1 Flash Lite
52 谷歌轻量级多模态模型,支持图文音视频及PDF,主打低延迟、高吞吐,适用于规模化Agent场景。
Google




评论(0)