Ling-3.0-flash (free) 是由 InclusionAI(蚂蚁集团旗下 AI 团队) 推出的新一代高效大语言模型,定位为面向 AI Agent 和生产级推理场景 的高速执行模型。
该模型采用 Mixture-of-Experts(MoE)混合专家架构,拥有约 124B 总参数,每个 Token 激活约 5.1B 参数,通过稀疏计算方式降低推理成本,同时提升运行效率。
Ling-3.0-flash 专注于低延迟、高吞吐量和 Agent 工作流执行能力,支持复杂任务规划、工具调用、多步骤任务执行以及稳定的指令跟随能力。
模型支持最大约 262K Tokens 上下文窗口,适合处理大型文档、长文本分析、知识检索和复杂对话场景。
Ling-3.0-flash 支持推理模式切换,可根据任务需求选择更快响应或更深入分析模式,适用于 AI 助手、自动化 Agent、代码辅助和企业应用开发。
作为免费开放 API 模型,Ling-3.0-flash (free) 当前可通过 OpenRouter 等平台免费调用,适合开发者进行测试、原型开发和 AI 应用集成。
Ring-2.6-1T
54 Ring-2.6-1T 是一个拥有 1万亿(1T)参数规模的思考型模型,其中包含 630亿(63B)活跃参数。它专为真实世界中的智能体(Agent)工作流程打造……
Inclusionai
评论(0)