Qwen3.8-Max 价格全解析:API 定价、缓存计费与性价比分析
Qwen3.8-Max 是阿里于 2026 年 8 月 3 日正式发布的旗舰级大模型。它采用 MoE 架构,总参数量高达 2.4 万亿(激活参数 950 亿),是目前国内参数规模最大的大模型之一。本文详细介绍 Qwen3.8-Max 的 API 价格体系,并分析其性价比。
需要说明的是,实在Agent 已经接入了 Qwen3.8-Max 模型,用户可以在实在 Agent 的工作流中直接调用该模型的能力。
一、API 定价:国内与国际双轨制
Qwen3.8-Max 的 API 服务已上线千问 AI 平台,全球开发者均可调用。其定价分为国内和国际两套标准:
| 计费项 | 国内价格(人民币) | 国际价格(美元) |
|---|---|---|
| 模型输入 | ¥12 / 百万 tokens | $2 / 百万 tokens |
| 模型输出 | ¥36 / 百万 tokens | $6 / 百万 tokens |
| 隐式缓存命中 | ¥1.5 / 百万 tokens | $0.25 / 百万 tokens |
二、缓存计费:进一步降低调用成本
Qwen3.8-Max 支持上下文缓存功能,除了上述 "隐式缓存命中" 价格外,还有更详细的缓存计费项:
| 计费项 | 国内价格(人民币) |
|---|---|
| 显式缓存创建 | ¥15 / 百万 tokens |
| 显式缓存命中 | ¥1 / 百万 tokens |
三、内置工具与额外服务收费
除了模型调用本身,Qwen3.8-Max 特别提供多种内置工具,部分工具需要额外付费:
| 工具 | 价格 |
|---|---|
| code_interpreter(代码解释器) | 免费 |
| web_extractor(网页提取器) | 免费 |
| web_search(联网搜索) | ¥4 / 千次调用 |
| t2i_search(文生图搜索) | ¥24 / 千次调用 |
| i2i_search(图生图搜索) | ¥48 / 千次调用 |
| pdf_parsing(PDF 解析) | ¥0.02 / 每页 |
四、性价比分析
与海外前沿模型相比,Qwen3.8-Max 的定价有明显优势:
- 国际价格仅为 Claude Opus 5 的 40%(输入)和 24%(输出)
- 在国产头部模型中处于 中间价位
- 在多项基准测试中,Qwen3.8-Max 的表现已逼近 Claude Fable 5、GPT-5.6 Sol 等国际旗舰模型
以一次完整的对话为例(输入 1M tokens + 输出 1M tokens):
- 国内调用成本:¥12 + ¥36 = ¥48
- 国际调用成本:$2 + $6 = $8
如果输入内容命中了缓存,成本可进一步降低至 ¥1.5 + ¥36 = ¥37.5(国内)。
五、如何接入 Qwen3.8-Max
开发者可通过以下方式调用 Qwen3.8-Max:
- 千问 AI 平台:
https://www.qianwenai.com/models/qwen3.8-max - 阿里云百炼平台:
https://www.aliyun.com/product/bailian - DashScope API:通过 Python/Java SDK 调用
模型还支持 100 万 Token 的超长上下文,可一次性处理整本白皮书、长篇合同或整套代码工程。
总结
Qwen3.8-Max 的 API 定价为 国内输入 ¥12/百万 tokens、输出 ¥36/百万 tokens,国际输入 $2/百万 tokens、输出 $6/百万 tokens。缓存命中可进一步将输入成本降至 ¥1.5/百万 tokens。国际价格仅为 Claude Opus 5 的 24%-40%,在相近智能水平下具备较高性价比。模型支持 1M 超长上下文和多模态输入,适合编程、办公、科研等复杂长程任务。如果你使用实在 Agent,该模型已经接入,可以直接在 Agent 工作流中调用 Qwen3.8-Max 的能力。



