QW
Qwen3.7 Plus
模型简介
Qwen3.7 Plus 延续 Qwen3.7 面向 Agent 的设计方向,但更偏性价比。三方模型卡描述它支持文本和图片输入,并强化视觉语言能力,以及 GUI、移动端导航、视觉参考等混合 Agent 任务。它适合需要 Qwen3.7 新一代能力,但不一定需要 Max 档位成本的场景。
规格与价格
- 上下文窗口
- 1M Token
- 最大输出
- 64K Token
- 输入价格
- ¥2/M
- 输出价格
- ¥8/M
- 缓存读取
- ¥0.4/M
- 发布日期
- 2026年6月2日
- Token 阶梯
- <=256K
- 输入价格
- ¥2/M
- 输出价格
- ¥8/M
- 缓存读取
- ¥0.4/M
- 缓存创建 5m
- ¥2.5/M
- 缓存读取 5m
- ¥0.2/M
API 能力
- 推理
- 支持
- 工具调用
- 支持
- Temperature 参数
- 支持
- 附件
- 不支持
- 知识库
- 2025-04-01
- Endpoint 协议
- Messages API
模型亮点
Qwen3.7 Plus 结合多模态理解、Agent 级编程与生产力能力以及百万 Token 上下文,适合构建综合型应用。
Qwen3.7 Plus 模型亮点
Qwen3.7 Plus 结合多模态理解、Agent 级编程与生产力能力以及百万 Token 上下文,适合构建综合型应用。
多模态理解
模型可综合处理文本、图像和视频,对文档、界面和现实场景进行视觉推理。
交互式 Agent 能力
模型能够理解屏幕和视觉参考并规划交互,将环境感知与后续操作衔接起来。
长上下文生产力
百万 Token 上下文可处理大型代码库、长篇文档和长视频,减少拆分原始资料的需要。
适用场景
Qwen3.7 Plus 适合视觉辅助开发、面向 GUI 的 Agent,以及长篇视觉文档或视频分析。
Qwen3.7 Plus 使用场景
Qwen3.7 Plus 适合视觉辅助开发、面向 GUI 的 Agent,以及长篇视觉文档或视频分析。
视觉辅助开发
分析截图、设计稿或界面录屏,为对应的应用组件生成实现建议和代码。
GUI Agent 工作流
读取界面状态、判断下一步操作,并引导完成网站或移动应用中的多步骤导航。
长视频与文档审阅
审阅长视频和图像密集型文档,识别重要事件或细节,并输出条理清晰的文本摘要。
调用示例
from openai import OpenAI
client = OpenAI(
base_url="https://api.tokiway.com/v1",
api_key="YOUR_TOKIWAY_KEY",
)
resp = client.chat.completions.create(
model="qwen3-7-plus",
messages=[{"role": "user", "content": "你好"}],
)
print(resp.choices[0].message.content)
Qwen 的其他模型
QW
Qwen3.5 35B-A3B
Qwen
Qwen3.5 35B A3B 是一个原生视觉语言 MoE 模型,目标是在较小激活参数下接近更大模型的效果。模型卡强调混合线性注意力、稀疏专家,以及与更大 Qwen3.5 dense 版本相近的表现。它最适合被描述为兼顾效率、多模态推理和代码能力的轻量高效模型。
262.1K Token 上下文
65.5K Token 输出
2026年2月23日
输入¥0.4/M
输出¥3.2/M
QW
Qwen3.5 Flash
Qwen
Qwen3.5 Flash 是 Qwen3.5 原生视觉语言系列中的高效版本。阿里云模型列表将 Flash 定位为面向简单任务的快速、低成本选项,同时继承了 3.5 一代的多模态方向。它适合信息抽取、请求路由、轻量内容生成和高频调用。
262.1K Token 上下文
65.5K Token 输出
2026年2月23日
输入¥0.2/M
输出¥2/M
QW
Qwen3.5 Plus
Qwen
Qwen3.5 Plus 是 Qwen3.5 系列中的均衡版本,通常被介绍为原生视觉语言模型,并在托管服务中提供较强效率和较大上下文能力。官方和三方资料将它与图像/视频理解、通用文本任务和内置工具能力联系在一起。它处在 Flash 的速度取向和 Max 的能力取向之间。
1M Token 上下文
65.5K Token 输出
2026年2月16日
输入¥0.8/M
输出¥4.8/M
QW
Qwen3.6 35B-A3B
Qwen
Qwen3.6 35B A3B 是一个激活参数较小的 MoE 模型:相关来源描述为 35B 总参数、约 3B 激活参数,并具备可扩展到接近 1M token 的长上下文能力。官方资料还提到它在代码任务上可以与更大的 dense 模型竞争。它的核心价值是部署效率高,同时保留不错的代码和长上下文能力。
262.1K Token 上下文
65.5K Token 输出
2026年4月17日
输入¥1.8/M
输出¥10.8/M
QW
Qwen3.6 Flash
Qwen
Qwen3.6 Flash 是 Qwen3.6 系列中更强调速度的版本。相关来源提到它支持文本、图片和视频输入、Prompt Caching,以及 1M token 上下文窗口,这让它在快速模型里有较强的长上下文和多模态特征。它更适合高并发、多模态和长上下文任务中对速度与成本敏感的场景。
1M Token 上下文
65.5K Token 输出
2026年4月27日
输入¥1.2/M
输出¥7.2/M
QW
Qwen3.6 Max Preview
Qwen
Qwen3.6 Max 通常被视为 Qwen3.6 一代中更高能力的档位。可参考的三方资料强调大规模稀疏 MoE 架构、更强的 Agentic Coding,以及面向工具调用的行为。它的描述应聚焦软件工程、推理和自主工作流执行,而不是只写“更好的文本生成”。
262.1K Token 上下文
65.5K Token 输出
2026年4月20日
输入¥9/M
输出¥54/M