Mercury 2.5 Previewは、2026年8月31日に公開されたdLLM(Diffusion Large Language Model)です。OpenRouterなどを通じてAPIで利用できます。
GPTやClaudeのような一般的なLLMは、Tokenを1つずつ順番に生成します。Mercuryはそこが違います。
最初に大まかな出力を並列で作り、それを何度か修正しながら文章を仕上げていく方式です。
画像生成で使われてきた拡散モデルに近い考え方を、テキスト生成に持ち込んでいます。
コンテキスト長は256K〜260K Token、最大出力は約65K Token。推論レベルの調整、並列ツール呼び出し、JSON形式の構造化出力にも対応しています。
画像や音声、動画は扱えず、入出力はテキストのみです。
Inceptionが比較対象として挙げているのは、GPT-5.6 Lunaの低推論設定、Gemini 3.5 Flash-Lite、Claude Haiku 4.5あたり。
最上位モデルと正面から殴り合うというより、そこそこ賢くて、安くて、とにかく速いという立ち位置です。
ただし、ここは少し慎重に見たいところ。
モデルはクローズドで、独立した第三者ベンチマークもまだ出ていません。 今の性能評価は、ほぼInception側の数字に頼っています。
つまり、今はまだ「実証済み」というより「かなり面白そう」という段階です。
コメント(0件)