QW

Qwen3.8 Max

Qwen 发布 2026年8月3日 ImageTextVideoAudio qwen3-8-max

模型简介

Qwen3.8-Max 是通义千问一款拥有 2.4 万亿参数的 MoE 旗舰模型,面向高级推理、编程、企业生产力和 Agent 工作流。它能够处理从软件开发到专业工作流的复杂长期任务,适用于法律、金融和设计等生产场景;其原生多模态能力可理解长上下文中的文本、图像和视频,并支持复杂工作流中的规划、执行、验证和持续迭代。你可以通过 Tokiway 调用 Qwen API,查看当前 Qwen3.8 Max 的价格、模型 ID、上下文与最大输出限制、支持模态、端点和基准测试结果,再决定是否用于生产环境。

规格与价格

上下文窗口
1M Token
最大输出
128K Token
输入价格
¥14/M
输出价格
¥42/M
缓存读取
¥1.75/M
发布日期
2026年8月3日
输入价格
¥14/M
输出价格
¥42/M
缓存读取
¥1.75/M
缓存创建 5m
¥17.5/M
缓存读取 5m
¥1.19/M

API 能力

推理
支持
工具调用
支持
Temperature 参数
不支持
附件
支持
知识库
—
Endpoint 协议
Completions API

模型亮点

Qwen3.8 Max 结合推理、原生视觉理解、长程任务规划和百万 Token 上下文,面向复杂专业工作负载。

Qwen3.8 Max 模型亮点
Qwen3.8 Max 结合推理、原生视觉理解、长程任务规划和百万 Token 上下文,面向复杂专业工作负载。
专业任务推理
这款旗舰推理模型面向要求较高的编程、办公、法律、金融和设计类任务。
原生视觉理解
模型可接收文本、图像和视频,用于理解视觉文档、图表以及长视频中的语义信息。
长程上下文处理
百万 Token 上下文窗口与自主规划能力,可支持需要反复分析和迭代的长程任务。

适用场景

Qwen3.8 Max 适合工程级编程、专业文档分析以及持续运行的多模态工作流。

Qwen3.8 Max 使用场景
Qwen3.8 Max 适合工程级编程、专业文档分析以及持续运行的多模态工作流。
工程级编程
分析大型代码库,协调多个组件之间的改动,并通过迭代完成复杂的软件工程任务。
专业文档分析
审阅长篇法律、金融或商业资料,提取相关依据,并生成结构化结论。
视觉媒体分析
理解图表、文档图像和长视频,提取事件与关系,并生成简洁的文本摘要。

调用示例

from openai import OpenAI

client = OpenAI(
    base_url="https://api.tokiway.com/v1",
    api_key="YOUR_TOKIWAY_KEY",
)

resp = client.chat.completions.create(
    model="qwen3-8-max",
    messages=[{"role": "user", "content": "你好"}],
)
print(resp.choices[0].message.content)

更多说明

Alibaba

Qwen3.7 Plus

qwen3.7-plus
TextImage
Text

最大上下文

1M

最大输出

64K

发布日期

暂无

输入¥2 / 百万 Token
输出¥8 / 百万 Token

Qwen 的其他模型

QW
Qwen3.5 35B-A3B
Qwen
Qwen3.5 35B A3B 是一个原生视觉语言 MoE 模型,目标是在较小激活参数下接近更大模型的效果。模型卡强调混合线性注意力、稀疏专家,以及与更大 Qwen3.5 dense 版本相近的表现。它最适合被描述为兼顾效率、多模态推理和代码能力的轻量高效模型。
262.1K Token 上下文 65.5K Token 输出 2026年2月23日
输入¥0.4/M
输出¥3.2/M
QW
Qwen3.5 Flash
Qwen
Qwen3.5 Flash 是 Qwen3.5 原生视觉语言系列中的高效版本。阿里云模型列表将 Flash 定位为面向简单任务的快速、低成本选项,同时继承了 3.5 一代的多模态方向。它适合信息抽取、请求路由、轻量内容生成和高频调用。
262.1K Token 上下文 65.5K Token 输出 2026年2月23日
输入¥0.2/M
输出¥2/M
QW
Qwen3.5 Plus
Qwen
Qwen3.5 Plus 是 Qwen3.5 系列中的均衡版本,通常被介绍为原生视觉语言模型,并在托管服务中提供较强效率和较大上下文能力。官方和三方资料将它与图像/视频理解、通用文本任务和内置工具能力联系在一起。它处在 Flash 的速度取向和 Max 的能力取向之间。
1M Token 上下文 65.5K Token 输出 2026年2月16日
输入¥0.8/M
输出¥4.8/M
QW
Qwen3.6 35B-A3B
Qwen
Qwen3.6 35B A3B 是一个激活参数较小的 MoE 模型:相关来源描述为 35B 总参数、约 3B 激活参数,并具备可扩展到接近 1M token 的长上下文能力。官方资料还提到它在代码任务上可以与更大的 dense 模型竞争。它的核心价值是部署效率高,同时保留不错的代码和长上下文能力。
262.1K Token 上下文 65.5K Token 输出 2026年4月17日
输入¥1.8/M
输出¥10.8/M
QW
Qwen3.6 Flash
Qwen
Qwen3.6 Flash 是 Qwen3.6 系列中更强调速度的版本。相关来源提到它支持文本、图片和视频输入、Prompt Caching,以及 1M token 上下文窗口,这让它在快速模型里有较强的长上下文和多模态特征。它更适合高并发、多模态和长上下文任务中对速度与成本敏感的场景。
1M Token 上下文 65.5K Token 输出 2026年4月27日
输入¥1.2/M
输出¥7.2/M
QW
Qwen3.6 Max Preview
Qwen
Qwen3.6 Max 通常被视为 Qwen3.6 一代中更高能力的档位。可参考的三方资料强调大规模稀疏 MoE 架构、更强的 Agentic Coding,以及面向工具调用的行为。它的描述应聚焦软件工程、推理和自主工作流执行,而不是只写“更好的文本生成”。
262.1K Token 上下文 65.5K Token 输出 2026年4月20日
输入¥9/M
输出¥54/M