Qwen

Qwen3.8 MAX API

千问当前能力最强的旗舰多模态推理模型,适合长程编程、专业工作与多阶段智能体任务。它可处理文本、图片和视频,提供 1M 上下文、最长 128K 输出,并支持函数调用、结构化输出、联网搜索与代码解释器;更适合作为高质量复杂任务主力,而不是追求最低成本和最低延迟的批量调用。

  • 推理
  • 联网搜索
  • 工具调用
  • 函数调用
  • 结构化输出
  • 长上下文
  • 代码执行

USD

价格

default
标准费率
输入$1.775/1M tokens补全价格$5.32997/1M tokens缓存读$0.176968/1M tokens缓存写$2.219993/1M tokens

展示价格为美元公开价,实际费用可能因账户分组和用量阶梯而变化。

API

代码示例

curl --location --request POST 'https://api.tokenhot.ai/v1/chat/completions' \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data-raw '{
    "model": "qwen3.8-max",
    "messages": [
        {
            "role": "user",
            "content": "What model are you"
        }
    ]
}'

Qwen

相关模型

FAQ

常见问题

Qwen3.8 MAX 适合哪些场景?

Qwen3.8 MAX 适合本页所列的输入、输出与能力类型。用于关键业务前,建议先用真实负载进行验证。

Qwen3.8 MAX 如何计费?

价格见上方价格部分,实际成本取决于使用量、账户分组和请求内容。

如何调用 Qwen3.8 MAX?

使用上方模型 ID,通过受支持的 API 协议调用;有调用数据时,本页会展示代码示例。

开始使用

使用 Qwen3.8 MAX 构建

在控制台使用