用过 AI 的人,多半都遇到过这种情况:问题发出去,屏幕上的字半天才开始往外蹦。问得越复杂,等得越久。写代码、整理长文档、做数据分析时,这种等待尤其明显。
OpenAI 最近做了一件很直接的事:把 GPT-5.6 Sol 的速度拉上去了。
新推出的 Ultrafast 超高速模式,最高能让 GPT-5.6 Sol 的运行速度达到标准模式的 14 倍,输出速度最高约 750 tokens/秒。
这些数字看起来有点专业,放到日常使用里其实很好理解。
以前让 AI 改一大段代码,可能还能去喝口水;速度提起来以后,很多回答几乎是问题刚发出去,内容就跟着出来了。对每天频繁使用 AI 的人来说,这种变化比“跑分又涨了多少”更容易感受到。
更关键的是,这次提速的不是一个专门追求速度的小模型,而是 GPT-5.6 Sol。
也就是说,你不需要为了快,换成一个能力弱一点的模型。复杂代码、研究资料、长文本分析这些原本比较吃算力的工作,也有机会获得更快的响应。
这背后还有一家叫 Cerebras 的公司。OpenAI 使用了它的计算基础设施,让模型生成答案时少一些等待时间。用户不需要理解芯片和推理架构,只要记住一件事:AI 回答问题的速度,正在从“等它生成”,慢慢变成“接近实时”。
这件事为什么值得关注?
因为很多时候,我们不是嫌 AI 不够聪明,而是嫌它打断节奏。
写代码写到一半,等回答;改文案改到一半,等回答;查资料刚有思路,又要盯着屏幕等。一次十几秒不算什么,一天用几十次,体验上的差距就出来了。
Ultrafast 目前还是限量预览,主要先放在 API 场景,并不是打开 ChatGPT 就能看到一个“14 倍速”开关。
但方向已经很清楚了。
AI 以前拼的是谁更聪明,接下来还要拼谁反应更快。对用户来说,模型名字有多复杂其实没那么重要。真正有感觉的变化只有一个:
你问完,它就答。
