对程序员来说,最麻烦的事情之一,是把一个庞大的代码项目反复拆开,再一点点交给AI理解。对普通上班族来说,几十页的报告、合同和会议记录,同样让人头疼。

MiniMax近日发布的新一代模型M3,瞄准的正是这些费时间、费精力的工作。

按照MiniMax公布的信息,M3最多可以处理100万Token的上下文。通俗地说,就是它一次能读进去的内容更多。程序员可以把更完整的代码交给它检查,办公室工作人员也能用它整理长篇报告、合同和会议材料,不用再把文件切成很多段。

除了文字,M3还可以识别图片和视频。在获得用户授权后,它也能调用工具、操作电脑,完成搜索资料、填写信息、整理表格等任务。过去,这些事情往往需要人在不同软件之间来回切换,现在模型可以帮忙完成其中一部分重复操作。

为了处理这么多内容,MiniMax为M3加入了稀疏注意力技术。简单来说,模型不会平均处理所有信息,而是尽量把精力放在更有用的部分,从而减少计算压力。不过,这些技术效果目前主要来自研发团队和企业公布的测试,真正用起来是否稳定,还要看不同设备和实际任务。

目前,M3已经通过API和编程工具开放,模型权重也已公开。MiniMax公布的案例显示,它可以修改代码、调用工具,还能连续执行时间较长的任务。

不过,跑分高不等于每次都好用。对大多数人来说,模型有多少参数并不重要。真正有用的是,当一份几十页的材料摆在面前,或者一个复杂任务迟迟理不清时,它能不能少出错,能不能真的帮人省下时间。