Qwen
Qwen3.6 Flash API
面向代理式工作负载、代码和办公生产力,相比 Qwen3.5 更强调长上下文、工具调用和结构化输出的稳定组合;对比 GPT、Claude、Gemini 等旗舰模型,它更适合作为中文、代码和多步工具任务里的高性价比替代。
- 推理
- 工具调用
- 结构化输出
- 长上下文
在控制台使用
qwen3.6-flashUSD
价格
default
input<256K
输入$0.1785/1M tokens补全价格$1.0605/1M tokens缓存读$0.018/1M tokens缓存写$0.22/1M tokens
input>=272K
输入$0.714/1M tokens补全价格$4.263/1M tokens缓存读$0.07/1M tokens缓存写$0.89/1M tokens
展示价格为美元公开价,实际费用可能因账户分组和用量阶梯而变化。
API
代码示例
curl --location --request POST 'https://api.tokenhot.ai/v1/chat/completions' \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data-raw '{
"model": "qwen3.6-flash",
"messages": [
{
"role": "user",
"content": "What model are you"
}
]
}'Qwen
相关模型
FAQ
常见问题
Qwen3.6 Flash 适合哪些场景?
Qwen3.6 Flash 适合本页所列的输入、输出与能力类型。用于关键业务前,建议先用真实负载进行验证。
Qwen3.6 Flash 如何计费?
价格见上方价格部分,实际成本取决于使用量、账户分组和请求内容。
如何调用 Qwen3.6 Flash?
使用上方模型 ID,通过受支持的 API 协议调用;有调用数据时,本页会展示代码示例。
开始使用