Qwen3.7-Plusは、アリババが2026年6月2日に発表したマルチモーダルエージェントモデルです。ビジョンと言語を統合したエージェント基盤として位置付けられており、世界的に権威あるビジョンベンチマーク「Vision Arena」において、世界トップ5、中国国内第1位を獲得しています。
Qwen3.7-Plusは、アリババが2026年6月2日に発表したマルチモーダルエージェントモデルです。ビジョンと言語を統合したエージェント基盤として位置付けられており、世界的に権威あるビジョンベンチマーク「Vision Arena」において、世界トップ5、中国国内第1位を獲得しています。
| プラン | 価格 | 説明 |
|---|---|---|
| API 国際版(標準コンテキスト) | Input:$0.40 / Output:$1.60(100万Tokensあたり) | 最大100万Tokensのコンテキストウィンドウに対応。テキスト・画像・動画入力のマルチモーダル機能を提供し、Implicit Cache(キャッシュ機能)にも対応しています。キャッシュ入力料金は$0.08/100万Tokensです。日常的なAIアプリケーション開発やマルチモーダル処理に適しています。 |
| API 国際版(ロングコンテキスト) | Input:$1.20 / Output:$4.80(100万Tokensあたり) | 256K〜100万Tokensの長文コンテキスト処理向けプラン。利用するコンテキスト量に応じた段階的な料金体系を採用し、長文解析、複雑な推論、大規模なナレッジ処理に適しています。 |
| 新規ユーザー向け無料クレジット | 無料(100万Tokens) | Alibaba Cloudの新規ユーザーは、登録後90日間利用できる100万Tokens分の無料クレジットを利用できます。モデル検証、プロトタイプ開発、初期テストに適しています。 |
• GUIエージェント
スマートフォンやパソコンのGUIを理解し、人間のようにクリックやテキスト入力などの操作を実行できます。例えば、株式アプリを起動して画面を観察し、その機能を完全に再現したアプリを一から作成することが可能です。
• ビジュアルプログラミング
画像、スケッチ、さらには動画から、実行可能なWebページ、SVGアニメーション、アプリケーションコードを直接生成できます。デザイン案を渡すだけで、フロントエンドページを自動生成することもできます。
ビジュアルエージェント
ツールを連携させて複雑な問題を解決できます。例えば、コードインタプリタを呼び出して画像の「違い探し」や迷路の解析を行ったり、ネット検索を活用して機械図面から機器の機能やパラメータを正確に特定することが可能です。
• マルチモーダル推論と理解
画像や動画に対する理解力に優れており、視覚推論ベンチマークではGemini 3.1 Proを上回るスコアを記録。自動運転などの現実世界の複雑なシーンも高い精度で理解できます。
• 長期的なタスクの自律完結
「見る・考える・書く・実行する・検証する」を一貫したワークフローとして統合しています。公式デモでは、11時間以上にわたって自律的に稼働し、英語学習アプリの要件定義からコーディング、テスト、リリースまでの開発プロセスを完遂した実績があります。
• 個人開発者・プログラミング愛好家:低コストでAPIを利用し、日常的なコーディング、プロトタイプ開発、技術学習に活用。
• 中小企業・スタートアップ:低予算でAIを導入し、業務自動化、カスタマーサポート、コンテンツ制作を実現。
• ビジネスパーソン・コンテンツクリエイター:文章作成、レポート処理、画像・テキスト素材の編集など、日常業務の効率化に貢献。
• 学生・研究者:学習補助、論文の校正、資料整理など、中程度の複雑な論理タスクに対応。
| モデル | コンテキスト | 料金 | API | リリース | グローバル熱度 |
|---|---|---|---|---|---|
![]()
Qwen3.7 Plus
|
1M | 有料 | YES | 2026-06 |
81/100
|
| 1M | — | YES | 2026-08 |
88/100
|
|
| 262K | — | YES | 2026-08 |
90/100
|
|
| 262K | — | YES | 2026-08 |
60/100
|
|
| 1M | — | YES | 2026-07 |
79/100
|
コメント(0件)