Qwen3.8 27B

1.70
AlibabaのQwenチームが、オープンソース界隈で注目されていた Qwen3.8-27B を公開しました。今回いちばん気になったのは、やはり 27Bというサイズ感 です。 量子化すればハイエンドなコンシューマーGPUでも現実的に動かせる一方、コーディング、Agent、マルチモーダル性能はかなり高いところまで来ています。
Advertisement 728 × 90
会社Alibaba
コンテキスト262K
リリース2026-08
更新日2026-08-17

Qwen3.8 27B 概要

Qwen3.8-27Bは、Alibabaが公開した 270億パラメータのネイティブ・マルチモーダルDenseモデル です。
27Bという規模は、今のLLMとしては絶妙です。十分な性能を狙える一方で、「試すだけでも複数GPU必須」というサイズにはなっていません。
対応範囲もかなり広く、テキスト、画像、コード、グラフ、PDFをそのまま扱えます。コンテキスト長はネイティブで 262K Token、YaRNを使えば 100万Token まで拡張可能です。
ライセンスは Apache 2.0。
個人利用はもちろん、改変、ファインチューニング、商用サービスへの組み込みまで比較的扱いやすい条件です。
社内コード、契約書、顧客資料、社内ナレッジのように外部クラウドへ出しにくいデータを扱う企業にとっては、ローカル運用できること自体が大きなメリットになります。

Qwen3.8 27B 料金プラン

プラン価格説明
オープンソース / セルフホスト 無料 Apache 2.0のフルウェイト。量子化版なら24GBクラスのVRAMを持つハイエンドGPUでも現実的。開発者、研究者、機密データを扱う企業向け。
公式API 入力 12元 / 100万Token、出力 36元 / 100万Token ハードウェア不要ですぐ使える。たまに利用する人、小規模アプリ、推論環境を管理したくないチーム向け。
APIキャッシュヒット 1.5元 / 100万Token 同じ長文、固定プロンプト、ナレッジベースを繰り返し参照する用途でコストを抑えやすい。

RTX 4090やRTX 3090、高メモリのApple Silicon環境をすでに持っているなら、セルフホストの魅力はかなり大きいです。

Token課金を気にせず使えますし、データも自分の環境から出ません。

逆に、たまにしか使わないならAPIのほうが楽です。

量子化、推論エンジン、VRAM管理、環境構築にも手間はかかります。API料金がゼロだからといって、ローカル運用のコストまでゼロになるわけではありません。

Qwen3.8 27B 主な機能

1. 画像理解が最初から組み込まれている

ローカルLLMの中には、画像処理だけ別のVisionモデルを組み合わせる構成もまだ多くあります。

Qwen3.8-27Bは最初からマルチモーダル対応です。

画像、グラフ、PDF、コードのスクリーンショットを直接読み取れ、動画フレームの内容も理解できます。

PC操作能力を見るOSWorld-Verifiedでは 84.3点 を記録し、Claude Opus 4.6 Maxの72.7点を上回っています。

Agent用途では、単に画像を認識できるだけでは足りません。

画面の状態を理解して、次にどこをクリックするのか、何を入力するのかまで判断する必要があります。Qwen3.8-27Bは、この「見てから動く」部分までかなり強くなっています。

2. 262K Tokenあれば、普段使いではかなり余裕がある

ネイティブで 262K Token

大規模なコードベース、論文、契約書、長い社内資料などをまとめて扱うには十分なサイズです。

さらにYaRNを使えば、最大 100万Token まで拡張できます。

開発者にとって分かりやすいメリットは、ファイルを細かく分割して何度も読み込ませる手間が減ることです。

大きなプロジェクトでも、より広い範囲を一度にモデルへ渡し、依存関係を含めて見てもらいやすくなります。

ただし、100万Tokenはスペック表としては魅力的でも、ローカル環境で常用するとなると話は別です。

コンテキストを伸ばすほどメモリ消費と推論時間は増えます。個人的には、まず 262Kを無理なく使えること のほうが実用上は重要だと思います。

3. 今回いちばん伸びたのはコード

SWE-bench Proは、前世代の 53.5から61.7 まで上がりました。

今回のアップデートで、かなり注目していい数字です。

SWE-benchは、単純に「この関数を書いて」というタイプのテストではありません。

既存のコードベースを読み、問題箇所を探し、複数のファイルを修正し、その変更で別の部分が壊れていないかまで確認する必要があります。

つまり、61.7というスコアは、コード生成そのものより ソフトウェア開発全体に近い能力 が伸びたことを示しています。

Coding Agent、バグ修正、既存リポジトリのメンテナンス用途では、かなり期待できそうです。

もちろん、ベンチマーク1つだけで最上位のクラウドモデルを全部置き換えられるとは言えません。

依存関係が複雑な大型プロジェクトや、何十ステップも続くタスクでは、実際のコードベースで試したほうがいいでしょう。

4. reasoning_effort:簡単な質問まで全力で考えさせない

個人的にかなり実用的だと感じるのが reasoning_effort です。

タスクに応じて、モデルがどれくらい深く考えるかを調整できます。

要約、書式変換、簡単な質問なら低めにして、時間と計算量を節約。

コード解析、複雑なロジック、Agentの計画などでは高めにする。

ローカルLLMでは、この調整がかなり重要です。使っているGPUも、電気代も自分持ちだからです。

海外の開発者によるテストでは、「自転車に乗るペリカン」のSVGを作らせたところ、デフォルトの高い推論設定で約 2.2万Token を使い、完成まで約21分かかった例もあります。

ちゃんと答えにはたどり着く。ただ、ちょっと真面目すぎます。

reasoning_effort は常に最大にするのではなく、普段は低め、難しい仕事だけ上げる使い方が合いそうです。

5. Qwen3.6-27Bからどこが変わった?

面白いのは、モデルサイズを大きく変えずに、任せられる仕事がかなり増えたことです。

分かりやすいのはコード性能。

SWE-bench Proは 53.5 → 61.7 まで上昇しました。

Officeや専門業務系も改善しており、JobBench関連では前世代比で約 50%向上 しています。文書、表計算、業務資料の処理ではかなり使いやすくなっています。

すでに27Bクラスを動かせる環境がある人にとっては、かなり理想的なアップデートです。

GPUを買い替えて巨大モデルへ移行しなくても、同じくらいのハードウェアで、コード、Agent、業務処理を一段上のレベルまで持っていけます。

ローカルLLMでは、こういう進化のほうが単純なパラメータ数の増加よりありがたいです。

まとめ

メリット

Qwen3.8-27Bの最大の魅力は、やはり27Bというサイズです。

個人開発者や中小チームでもまだ現実的に扱える範囲にいながら、マルチモーダル、長いコンテキスト、コーディング、Agent、推論深度の調整まで一通り揃っています。

Apache 2.0なので、社内利用、ファインチューニング、商用サービスへの組み込みもしやすいです。

機密データを外部のAIサービスへ送りたくない企業にとっては、ベンチマーク以上に大きな価値があります。

デメリット

「ローカルで動く」と「快適に動く」は別の話です。

reasoning_effort を高くしたまま使うと、簡単なタスクでも推論時間が長くなります。数十万Tokenのコンテキストを使えば、メモリ消費やレイテンシも当然増えます。

実運用では、量子化方式、コンテキスト長、reasoning_effort の調整がかなり重要です。

デフォルト設定のまま使うのがベストとは限りません。

おすすめできる人

すでにRTX 4090や3090など24GBクラスのGPUを持っている人、ローカルLLMを普段から使っている人、Coding Agentや社内向けAIを作っている開発者なら、かなり試す価値があります。

フルウェイトを使ってファインチューニングしたい研究者にも向いています。

おすすめしにくい人

用途がチャット、文章作成、たまのPDF要約くらいなら、クラウド型のAIサービスを使ったほうが圧倒的に楽です。

対応できるGPUを持っておらず、API料金も払いたくないという場合も、このモデルの良さを活かしにくいでしょう。

Qwen3.8-27Bを動かすためだけに高価なGPUを新しく買うとなると、コスト的には微妙なケースもあります。

コメント(0件)

コメントを書く

Advertisement 728 × 90

Alibaba モデル比較

モデル コンテキスト 料金 API リリース グローバル熱度
Qwen3.8 27B
262K YES 2026-08
60/100
1M YES 2026-08
88/100
262K YES 2026-08
90/100
1M YES 2026-07
79/100
1M 有料 YES 2026-06
81/100

類似モデル

関連ツール

関連ニュース