Qwen 系列覆盖通用与多模态任务。本页重点介绍 qwen3.8-max:最大输入 983,616 token、最大输出 131,072 token,支持强制推理、上下文缓存及 Responses API 内置工具。
您在想什么?
询问 APIMart
qwen3.8-max-0902
透明定价,无隐藏费用。按量付费,用多少付多少。
每 100 万 token
| 计费项 | 黄金价当前价格 | 铂金价 | 钻石价 | 官方价 | 为你节省 |
|---|---|---|---|---|---|
| 输入 | 13.7143~$1.3714 | 13.0286~$1.3029 | 12.3429~$1.2343 | 17.1429~$1.7143 | 20% |
| 缓存输入 | 1.7143~$0.1714 | 1.6286~$0.1629 | 1.5429~$0.1543 | 2.1429~$0.2143 | 20% |
| 显式缓存输入 | 1.1429~$0.1143 | 1.0857~$0.1086 | 1.0286~$0.1029 | 1.4286~$0.1429 | 20% |
| 缓存写入 | 17.1429~$1.7143 | 16.2857~$1.6286 | 15.4286~$1.5429 | 21.4286~$2.1429 | 20% |
| 输出 | 41.1429~$4.1143 | 39.0857~$3.9086 | 37.0286~$3.7029 | 51.4286~$5.1429 | 20% |
使用 qwen3.8-max 构建长上下文推理应用。普通对话和 PDF 使用 Chat Completions;联网、网页提取、代码执行与图片搜索工具使用 Responses API。
50K+
活跃用户
99.9%
在线率
2x
更快
70%
成本节省
接入前需要了解的端点差异、上下文限制、推理、缓存和工具能力
根据长上下文、文档或工具增强任务选择正确端点
发送第一个请求前,请明确选择模型和端点
创建 APIMart 账户并充值 API 使用余额。
生成用于 Qwen 鉴权请求的 API Key。
将模型设为 qwen3.8-max:对话或 PDF 使用 Chat Completions,内置工具使用 Responses;Chat 请求需显式设置 stream。
开发者对 Qwen API 的评价
“Qwen-Max 是我们中文内容生成的首选,语言质量无可匹敌。”
Wei Zhang
内容负责人
“Qwen-Coder 出色地处理了我们的代码审查流程,速度和准确性兼顾。”
Alex Chen
工程经理
“Qwen-VL 模型阅读中文文档和表单的精确度令人印象深刻,为我们节省了数月的开发时间。”
Sarah Li
产品经理
“Qwen-Turbo 在我们的高并发聊天应用中性价比极高。”
Mike Wang
后端开发
“Qwen3 是一次巨大的飞跃,思维链变体能处理之前模型无法应对的复杂查询。”
Emily Zhou
AI 研究员
“我们找到的最好的中英翻译 API。Qwen-MT 对语境和习语的理解非常出色。”
David Liu
本地化经理
qwen3.8-max 与 Qwen 模型系列的接入要点
这是 Qwen 系列页面,重点模型为 qwen3.8-max。其他 Qwen 模型可能具有不同的限制、端点和能力。
普通对话和 PDF 输入使用 Chat Completions;网页搜索、网页提取、代码执行和图片搜索等内置工具使用 Responses API。
接口支持通过 OpenAI SDK 接入,但不能假设所有默认行为完全一致。Chat Completions 的默认流式行为不同,请显式传入 stream。
qwen3.8-max 强制启用推理,无法关闭。推理 token 计入输出 token 用量和费用。
qwen3.8-max 最大支持 983,616 个输入 token 和 131,072 个输出 token。
价格区会动态读取当前模型的实际价格,包括适用的输入、输出、缓存与工具费用。模型支持隐式和显式缓存。
有。Qwen API 按百万 token 计费。本页价格表列出全部规格,展示的是黄金会员价(8 折,立省 20%);铂金、钻石会员更省,最高立省 28%。只为成功的请求付费。
注册 APIMart 账号,在控制台的 API Keys 页面创建密钥即可。同一个 key 可调用 Alibaba Qwen API 及平台上的全部模型,按量付费,无需订阅。
使用 APIMart API Key 调用 OpenAI 兼容的 Chat Completions 接口,将 model 设为 qwen3.8-max 即可。如需联网搜索等内置工具,请改用 Responses API。完整参数和代码示例见 APIMart 文档(docs.apimart.ai)。
你可以通过页面右下角的在线客服、发送邮件至 [email protected],或在 Discord 社区中联系我们。我们的团队会尽快回复你的问题。
探索同类型的其他模型。
Claude Haiku 5.5
Claude Haiku 5.5 API on APIMart delivers fast, cost-efficient AI, offering responsive conversations, capable coding assistance, and reliable performance for high-volume workflows.
Kimi K3
Kimi-K3 is a next-generation large language model launched by Moonshot AI. It features ultra-long context, multimodal understanding, and strong coding capabilities, making it suitable for complex reasoning, software development, knowledge analysis, and agent automation tasks.
Claude Opus 5
Claude Opus 5 is Anthropic’s next-generation flagship large language model, featuring enhanced capabilities in code development, complex reasoning, knowledge analysis, and agent execution, making it ideal for large-scale project development and professional work scenarios.
Gemini 3.5 Flash Lite
A lightweight multimodal model launched by Google that emphasizes low cost, low latency, and high throughput. It is suitable for document parsing, data extraction, structured output, and large-scale agent workflows, delivering faster response times while maintaining core reasoning capabilities.