Qwen

Qwen3.6 MAX Preview API

Alibaba Qwen 3.6 Max Preview, một mô hình gồm nhiều chuyên gia thưa thớt với ~1 nghìn tỷ thông số. Được tối ưu hóa cho mã hóa tác nhân, sử dụng công cụ và lý luận theo ngữ cảnh dài với chế độ tư duy tích hợp giúp duy trì dấu vết lý luận trong các cuộc hội thoại nhiều lượt. Cửa sổ ngữ cảnh 262K, có sẵn thông qua API Alibaba Cloud Model Studio.

  • Suy luận
  • Sử dụng công cụ
  • Đầu ra có cấu trúc
  • Ngữ cảnh dài
Dùng trong Consoleqwen3.6-max-preview

USD

Bảng giá

default
input <128K
Đầu vào$1.33/1M tokensGiá hoàn thiện$8/1M tokensĐọc cache$0.1268/1M tokensGhi cache$1.585/1M tokens
Input>128K
Đầu vào$2.21/1M tokensGiá hoàn thiện$13.3/1M tokensĐọc cache$0.22/1M tokensGhi cache$2.77/1M tokens

Giá niêm yết bằng USD. Chi phí cuối có thể thay đổi theo nhóm tài khoản và mức sử dụng.

API

Ví dụ mã

curl --location --request POST 'https://api.tokenhot.ai/v1/chat/completions' \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data-raw '{
    "model": "qwen3.6-max-preview",
    "messages": [
        {
            "role": "user",
            "content": "What model are you"
        }
    ]
}'

Qwen

Mô hình liên quan

QwenQwenQwen3.6 Plus

Được thiết kế cho khối lượng công việc tác nhân, mã hóa và năng suất văn phòng, với sự tập trung kết hợp mạnh mẽ hơn vào ngữ cảnh dài, cách gọi công cụ và đầu ra có cấu trúc so với Qwen3.5. So với các mô hình hàng đầu như GPT, Claude và Gemini, đây là một giải pháp thay thế hiệu quả về mặt chi phí cho quy trình làm việc của công cụ tiếng Trung, mã hóa và nhiều bước.

$1.14/1M tokens
QwenQwenQwen3.6 Flash

Được thiết kế cho khối lượng công việc tác nhân, mã hóa và năng suất văn phòng, với sự tập trung kết hợp mạnh mẽ hơn vào ngữ cảnh dài, cách gọi công cụ và đầu ra có cấu trúc so với Qwen3.5. So với các mô hình hàng đầu như GPT, Claude và Gemini, đây là một giải pháp thay thế hiệu quả về mặt chi phí cho quy trình làm việc của công cụ tiếng Trung, mã hóa và nhiều bước.

$0.1785/1M tokens
QwenQwenQwen3.7 MAX

Được thiết kế cho khối lượng công việc tác nhân, mã hóa và năng suất văn phòng, với sự tập trung kết hợp mạnh mẽ hơn vào ngữ cảnh dài, cách gọi công cụ và đầu ra có cấu trúc so với Qwen3.6. So với các mô hình hàng đầu như GPT, Claude và Gemini, đây là một giải pháp thay thế hiệu quả về mặt chi phí cho quy trình làm việc của công cụ tiếng Trung, mã hóa và nhiều bước.

$1.8/1M tokens
QwenQwenQwen3.8 MAX

Qwen's most capable flagship multimodal reasoning model, built for long-horizon coding, professional work, and multi-stage agent tasks. It accepts text, images, and video, offers a 1M-token context window with up to 128K output, and supports function calling, structured outputs, web search, and a code interpreter. It is best used as a high-quality workhorse for complex tasks rather than for the lowest-cost, lowest-latency batch workloads.

$1.775/1M tokens

FAQ

Câu hỏi thường gặp

Qwen3.6 MAX Preview phù hợp nhất với trường hợp nào?

Qwen3.6 MAX Preview phù hợp với các loại đầu vào, đầu ra và khả năng được liệt kê trên trang. Hãy kiểm thử tải thực tế trước khi dùng cho hệ thống quan trọng.

Qwen3.6 MAX Preview được tính phí thế nào?

Giá được hiển thị ở phần trên. Chi phí thực tế phụ thuộc vào lưu lượng, nhóm tài khoản và nội dung yêu cầu.

Làm sao gọi Qwen3.6 MAX Preview?

Dùng ID mô hình phía trên với giao thức API được hỗ trợ. Ví dụ mã sẽ hiển thị khi có dữ liệu sử dụng.

Bắt đầu

Xây dựng với Qwen3.6 MAX Preview

Dùng trong Console