Laguna M.1 是 Poolside 在 2026 年 4 月发布的开源 MoE 基础模型,目标很明确:做长周期、能自己执行任务的编程 Agent。
它有 2250 亿总参数,单次推理激活约 230 亿参数。
MoE 的好处就是模型可以做得很大,但不需要每次把全部参数都跑一遍。Laguna M.1 一共有 70 层,前 3 层是密集层,后面 67 层是稀疏 MoE。内部放了 256 个专家,每次只调用其中 16 个。
对部署端来说,这比 2250 亿参数全激活现实得多,但它依然不是轻量模型。完整权重很大,本地运行的硬件门槛也不低。
上下文窗口是 256K tokens,最大输出大约 3.2 万 tokens。它支持推理模式,也能在多次工具调用之间继续思考。
这一点对编程 Agent 很关键。它不是问一次、答一次,而是要读代码、改文件、执行命令、看报错,再决定下一步。如果每次工具调用后思路都断掉,任务很容易越跑越偏。
模型权重采用 Apache 2.0 协议开放,可以直接从 Hugging Face 下载。
Laguna M.1 只处理文本输入和文本输出。
它的定位也很窄:就是编程 Agent。
拿它做普通聊天没太大意义,也别指望它去看截图、图片或视频。
评论(0)