Qwen3.7-Plus 是阿里巴巴于2026年6月2日发布的多模态智能体模型,定位为视觉与语言统一的智能体基座,在全球权威视觉榜单Vision Arena中位列全球前五、中国第一。
Qwen3-235B
99 阿里巴巴 MoE 模型,以 220 亿激活参数实现高质量低成本推理。
Alibaba
Qwen3.7-Plus 是阿里巴巴于2026年6月2日发布的多模态智能体模型,定位为视觉与语言统一的智能体基座,在全球权威视觉榜单Vision Arena中位列全球前五、中国第一。
| 套餐 | 价格 | 说明 |
|---|---|---|
| API 国际版(标准上下文) | 输入 $0.40 / 输出 $1.60 每百万 Tokens | 支持 100 万 Token 上下文窗口。支持文本、图片、视频多模态输入,并提供隐式缓存(Implicit Cache),缓存读取价格为 $0.08/百万 Tokens。适合日常 AI 应用开发和多模态任务。 |
| API 国际版(长上下文模式) | 输入 $1.20 / 输出 $4.80 每百万 Tokens | 适用于 256K–1M Tokens 超长上下文场景,采用阶梯定价方式,适合长文档分析、复杂推理和大规模知识处理任务。 |
| 新用户免费额度 | 免费(100 万 Tokens) | Alibaba Cloud 新用户可获得 100 万 Token 免费使用额度,注册后 90 天内有效,适合模型测试和开发体验。 |
GUI智能体:能看懂手机和电脑的图形界面,像人一样进行点击、输入等操作。比如,它能自己打开一个股票应用观察界面,然后一比一复刻出一个功能一模一样的应用。
视觉编程:能根据一张图片、草图甚至视频,直接生成可运行的网页、SVG动画或应用代码。你可以给它一张设计图,它就能帮你生成一个前端页面。
视觉Agent:可以结合工具来解决复杂问题。例如,它能调用代码解释器来分析图像“找不同”或解迷宫,也能联网搜索,根据一张机械图纸准确说出设备的功能和参数。
多模态推理与理解:对图像和视频的理解能力很强。它在视觉推理测试中得分超过了Gemini 3.1 Pro,并且能理解自动驾驶等真实世界的复杂场景。
长程任务自动闭环:它能把“看、想、写、做、验”整合成一个完整的工作流。在官方演示中,它曾连续自主运行超过11个小时,完成了一个英语学习App从需求分析、编写代码到测试上线的全部研发工作。
• 个人开发者 & 编程爱好者:低成本调用API,用于日常编码、原型开发、学习新技术。
• 中小企业 & 创业团队:以较低成本接入AI能力,实现自动化办公、客服、内容生产。
• 职场办公 & 内容创作者:写文案、做报表、处理图文素材,提升日常工作效率。
• 学生 & 科研工作者:辅助学习、论文润色、整理资料,应对中等复杂度逻辑任务。
| 模型 | 上下文 | 定价 | API | 发布 | 全球热度 |
|---|---|---|---|---|---|
![]()
Qwen3.7 Plus
|
1M | 付费 | YES | 2026-06 |
81/100
|
| 1M | $2.000 / $6.000 per 1M | YES | 2026-08 |
88/100
|
|
| 262K | $2.000 / $6.000 per 1M | YES | 2026-08 |
90/100
|
|
| 262K | $0.450 / $3.200 per 1M | YES | 2026-08 |
60/100
|
|
| 1M | $0.030 / $0.130 per 1M | YES | 2026-07 |
79/100
|
评论(0)