模型广场

共 46 个模型,覆盖 8 家厂商。按厂商筛选或按价格、上下文排序,找到适合你任务的那一档。

共 10 个模型
QW
Qwen3.5 35B-A3B
Qwen
Qwen3.5 35B A3B 是一个原生视觉语言 MoE 模型,目标是在较小激活参数下接近更大模型的效果。模型卡强调混合线性注意力、稀疏专家,以及与更大 Qwen3.5 dense 版本相近的表现。它最适合被描述为兼顾效率、多模态推理和代码能力的轻量高效模型。
262.1K Token 上下文 65.5K Token 输出 2026年2月23日
输入¥0.4/M
输出¥3.2/M
QW
Qwen3.5 Flash
Qwen
Qwen3.5 Flash 是 Qwen3.5 原生视觉语言系列中的高效版本。阿里云模型列表将 Flash 定位为面向简单任务的快速、低成本选项,同时继承了 3.5 一代的多模态方向。它适合信息抽取、请求路由、轻量内容生成和高频调用。
262.1K Token 上下文 65.5K Token 输出 2026年2月23日
输入¥0.2/M
输出¥2/M
QW
Qwen3.5 Plus
Qwen
Qwen3.5 Plus 是 Qwen3.5 系列中的均衡版本,通常被介绍为原生视觉语言模型,并在托管服务中提供较强效率和较大上下文能力。官方和三方资料将它与图像/视频理解、通用文本任务和内置工具能力联系在一起。它处在 Flash 的速度取向和 Max 的能力取向之间。
1M Token 上下文 65.5K Token 输出 2026年2月16日
输入¥0.8/M
输出¥4.8/M
QW
Qwen3.6 35B-A3B
Qwen
Qwen3.6 35B A3B 是一个激活参数较小的 MoE 模型:相关来源描述为 35B 总参数、约 3B 激活参数,并具备可扩展到接近 1M token 的长上下文能力。官方资料还提到它在代码任务上可以与更大的 dense 模型竞争。它的核心价值是部署效率高,同时保留不错的代码和长上下文能力。
262.1K Token 上下文 65.5K Token 输出 2026年4月17日
输入¥1.8/M
输出¥10.8/M
QW
Qwen3.6 Flash
Qwen
Qwen3.6 Flash 是 Qwen3.6 系列中更强调速度的版本。相关来源提到它支持文本、图片和视频输入、Prompt Caching,以及 1M token 上下文窗口,这让它在快速模型里有较强的长上下文和多模态特征。它更适合高并发、多模态和长上下文任务中对速度与成本敏感的场景。
1M Token 上下文 65.5K Token 输出 2026年4月27日
输入¥1.2/M
输出¥7.2/M
QW
Qwen3.6 Max Preview
Qwen
Qwen3.6 Max 通常被视为 Qwen3.6 一代中更高能力的档位。可参考的三方资料强调大规模稀疏 MoE 架构、更强的 Agentic Coding,以及面向工具调用的行为。它的描述应聚焦软件工程、推理和自主工作流执行,而不是只写“更好的文本生成”。
262.1K Token 上下文 65.5K Token 输出 2026年4月20日
输入¥9/M
输出¥54/M
QW
Qwen3.6 Plus
Qwen
Qwen3.6 Plus 的介绍重点在混合线性注意力与稀疏 MoE 架构,并强调 Agentic Coding、前端开发和推理任务的提升。公开模型卡提到仓库级任务、交互式前端生成,以及 SWE 类评测表现。它的定位更接近开发者与生产力模型,而不只是普通对话助手。
1M Token 上下文 65.5K Token 输出 2026年4月2日
输入¥2/M
输出¥12/M
QW
Qwen3.7 Max
Qwen
Qwen3.7 Max 被定位为 Qwen3.7 一代的旗舰模型,官方叙事重点是面向 Agent 时代。相关模型卡强调 Agent 工作流、代码、办公/生产力任务,以及长周期自主执行能力。它不应该只被写成“更大的聊天模型”,而应该描述为面向复杂工作的高能力通用模型。
1M Token 上下文 65.5K Token 输出 2026年5月21日
输入¥12/M
输出¥36/M
缓存¥2.4/M
QW
Qwen3.7 Plus
Qwen
Qwen3.7 Plus 延续 Qwen3.7 面向 Agent 的设计方向,但更偏性价比。三方模型卡描述它支持文本和图片输入,并强化视觉语言能力,以及 GUI、移动端导航、视觉参考等混合 Agent 任务。它适合需要 Qwen3.7 新一代能力,但不一定需要 Max 档位成本的场景。
1M Token 上下文 64K Token 输出 2026年6月2日
输入¥2/M
输出¥8/M
缓存¥0.4/M
QW
Qwen3.8 Max
Qwen
Qwen3.8-Max 是通义千问一款拥有 2.4 万亿参数的 MoE 旗舰模型,面向高级推理、编程、企业生产力和 Agent 工作流。它能够处理从软件开发到专业工作流的复杂长期任务,适用于法律、金融和设计等生产场景;其原生多模态能力可理解长上下文中的文本、图像和视频,并支持复杂工作流中的规划、执行、验证和持续迭代。你可以通过 Tokiway 调用 Qwen API,查看当前 Qwen3.8 Max 的价格、模型 ID、上下文与最大输出限制、支持模态、端点和基准测试结果,再决定是否用于生产环境。
1M Token 上下文 128K Token 输出 2026年8月3日
输入¥14/M
输出¥42/M
缓存¥1.75/M