Ling-2.6-Flash 是由 InclusionAI 推出的新一代开源指令模型,专为 AI Agent、复杂任务执行和高效率推理场景 设计。该模型强调快速响应、更强执行能力以及更低 Token 消耗。
模型采用高效的 Mixture-of-Experts(MoE)架构,拥有约 104B 总参数,激活参数约 7.4B,在保持较强智能水平的同时降低推理成本。
Ling-2.6-Flash 引入混合注意力架构,将 Lightning Attention 与 MLA(Multi-head Latent Attention) 结合,提高长上下文处理效率和推理速度。
该模型支持最高约 262K Tokens 上下文窗口,适用于长文档分析、代码开发、知识问答、工具调用以及自动化 Agent 工作流。
Ling-2.6-Flash 针对真实 Agent 应用进行了优化,在工具使用、多步骤规划、任务执行等场景中表现突出,可用于 Claude Code、Kilo Code、Qwen Code 等开发框架中的 AI 编程工作流。
Ling 3.0 Flash Fin (free)
62 蚂蚁百灵这周上线了 Ling 3.0 Flash Fin,一款专门做金融任务的模型。
OpenRouter 限时免费一个月,输入输出都是 0 美元。
做投研、财务分析、金融 Agent 的,这个月很适合拿真实数据去试。
Inclusionai
评论(0)