跳转到主要内容
快速入门

最新模型:Qwen3.8-Max

了解千问旗舰模型 Qwen3.8-Max 的能力、规格与接入方式

Qwen3.8-Max 是千问系列最新旗舰模型,基于 2.4 万亿参数 MoE 架构。编程与办公能力全面跃升,可自主编程十数天交付完整项目;胜任法律、金融、设计等数百种专业任务,一次对话端到端交付生产级成果。原生视觉理解贯穿规划、执行与验证全流程,支持超长文档与长视频的深度语义解析。长程任务中自主规划与闭环迭代,持续进化。 Model ID:qwen3.8-max

核心亮点

编程能力 — 从空仓库独立完成跨越数天的真实项目:能自主搭建并迭代一套自进化编程工具,独立复现学术论文并在其基础上自我进化改进。 办公助手 — 覆盖法律、金融、UI 设计、医疗等数百种专业场景。可单次通读大量文档完成合规审阅,或仅凭一句需求调度多个子智能体完成量化回测,一次对话端到端交付生产级成果。 长程任务 — 在数千轮交互中持续规划与闭环迭代,而非死守固定策略。从零完成芯片逻辑重构并通过验证,长周期电商经营模拟中收益大幅领先上一代旗舰。 多模态智能体 — 原生视觉理解贯穿规划、执行与验证全流程:跨页理解超长财报与 PDF,将超长视频组织为可检索的记忆,并能在执行中自主发现并修正界面与视觉问题。 以上案例与完整评测数据详见发布博客

模型能力与规格

参数参数
上下文长度1,000,000 token最大思维链长度262,144 token
最大输入长度991,808 token最大输出长度131,072 token
最大输入长度(思考模式)983,616 token最大输出长度(思考模式)131,072 token
定价详情见模型市场

快速接入

import os
from openai import OpenAI

client = OpenAI(
  api_key=os.getenv("DASHSCOPE_API_KEY"),
  base_url="https://dashscope.aliyuncs.com/compatible-mode/v1"
)

response = client.chat.completions.create(
  model="qwen3.8-max",
  messages=[
    {"role": "user", "content": "用动态规划解决最长递增子序列问题,给出时间复杂度分析。"}
  ]
)
print(response.choices[0].message.content)

使用说明

深度思考

默认开启思考模式,通过 reasoning_effort 调节推理力度:
说明适用场景
xhigh(默认)最大推理深度数学证明、架构设计、复杂编程
medium平衡推理与速度日常开发、文档生成
low快速响应简单问答、信息提取
maxhigh 会自动映射为 xhigh。思考模式下 temperature 默认 0.6,传入更小值会自动调整为 0.6。如需整体关闭思考,可设置 enable_thinking=false,模型将直接作答、不再返回 reasoning_content

多模态理解

Qwen3.8-Max 支持图片、视频和文本的联合理解,适合需要视觉信息参与决策的 Agent 场景。
  • 图片理解:在消息中传入 image_url 类型内容,模型直接分析图片内容。支持截图分析、设计稿还原、文档 OCR 等任务。高分辨率图像默认会被压缩,可通过 vl_high_resolution_imagesmax_pixels 调整视觉 token 上限以保留更多细节。
  • 视频理解:传入视频 URL,模型自动抽帧分析。通过 fps 控制抽帧频率,在细节捕获与成本间取得平衡。适合视频内容审核、教程摘要、会议记录等场景。
  • PDF 理解:以 file_url 或 Base64 file_data 传入 PDF,模型解析其中文字与图片。
详细用法参见图像与视频理解PDF 理解

工具调用与思考链

开启思考后进行工具调用,模型会先推理应调用哪些工具、如何使用返回结果,再生成回答;响应中工具调用前会包含 reasoning_content,多轮工具调用时需将其一并回传,省略会降低准确性。 多轮对话中,模型默认不读取历史消息里的 reasoning_content;qwen3.8-max 的 preserve_thinking 默认开启,会将思考过程拼接到下一轮输入。 详细规则参见思考模式函数调用

上下文缓存

上下文缓存将重叠请求的公共前缀进行缓存,避免重复计算,在不影响回答质量的前提下降低成本、加快响应:
模式说明
隐式缓存自动开启,系统识别公共前缀缓存,不保证命中
显式缓存手动创建,确定性命中,更低延迟
会话缓存Responses API 专用,请求头添加 x-dashscope-session-cache: enable
详细用法与计费参见上下文缓存

在编程工具中使用

在 Claude Code、Codex、OpenCode 等编程工具中使用 Qwen3.8-Max,推荐订阅 Token Plan——以 Credits 统一计量、支持 Qwen3.8-Max 及其他多种模型,较按量计费更优惠。