Gemini 3.1 Flash-Lite (Batch) 是由 Google DeepMind 开发的新一代轻量级高性能 AI 模型,属于 Gemini 3 系列中的 Flash-Lite 产品线。该模型主要针对高速响应、低成本运行和大规模 AI 应用场景进行优化。
相比更高性能的 Gemini Pro 系列,Gemini 3.1 Flash-Lite 更注重效率与成本控制,适用于需要大量请求处理、低延迟响应以及高吞吐量的 AI 应用。
该模型支持最大 1,048,576 Tokens 上下文窗口(约100万 Tokens),最大输出 65,536 Tokens,能够处理长文档、数据资料、代码文件以及复杂信息提取任务。
Gemini 3.1 Flash-Lite 支持原生多模态输入,包括文本、图片、视频、音频和 PDF,适用于内容理解、翻译、分类、文档分析、智能搜索和自动化处理等任务。
该模型针对高频任务进行了优化,特别适合大规模 AI Agent 工作流、数据提取、内容审核、自动化服务以及企业级 AI 应用部署。
Batch 版本进一步优化批量推理能力,可以帮助企业以更低成本处理大量 AI 请求,提高数据处理效率,适用于后台任务、批量生成和自动化业务流程。
Gemini 3.1 Flash-Lite 定位为一款快速、经济、高效的企业级 AI 模型,适合开发者和企业构建大规模 AI 应用
Gemini 3.1 Flash Lite
52 谷歌轻量级多模态模型,支持图文音视频及PDF,主打低延迟、高吞吐,适用于规模化Agent场景。
Google




评论(0)