Qwen

Qwen3.6 MAX Preview API

Alibaba Qwen 3.6 Max Preview, un modèle mixte d'experts avec environ 1 000 milliards de paramètres. Optimisé pour le codage agent, l'utilisation d'outils et le raisonnement en contexte long avec un mode de réflexion intégré qui préserve les traces de raisonnement au cours des conversations à plusieurs tours. Fenêtre contextuelle 262K, disponible via l'API Alibaba Cloud Model Studio.

  • Raisonnement
  • Utilisation d’outils
  • Sortie structurée
  • Contexte long
Utiliser dans la consoleqwen3.6-max-preview

USD

Tarifs

default
input <128K
Entrée$1.33/1M tokensPrix de complétion$8/1M tokensLecture cache$0.1268/1M tokensÉcriture cache$1.585/1M tokens
Input>128K
Entrée$2.21/1M tokensPrix de complétion$13.3/1M tokensLecture cache$0.22/1M tokensÉcriture cache$2.77/1M tokens

Prix publics en dollars US. Le coût final peut varier selon le groupe de compte et le volume d’utilisation.

API

Exemples de code

curl --location --request POST 'https://api.tokenhot.ai/v1/chat/completions' \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data-raw '{
    "model": "qwen3.6-max-preview",
    "messages": [
        {
            "role": "user",
            "content": "What model are you"
        }
    ]
}'

Qwen

Modèles associés

QwenQwenQwen3.6 Plus

Conçu pour les charges de travail agents, le codage et la productivité bureautique, avec un accent combiné plus fort sur le contexte long, les appels d'outils et la sortie structurée que Qwen3.5. Comparé aux modèles phares tels que GPT, Claude et Gemini, il s'agit d'une alternative rentable pour les flux de travail en chinois, en codage et en outils en plusieurs étapes.

$1.14/1M tokens
QwenQwenQwen3.6 Flash

Conçu pour les charges de travail agents, le codage et la productivité bureautique, avec un accent combiné plus fort sur le contexte long, les appels d'outils et la sortie structurée que Qwen3.5. Comparé aux modèles phares tels que GPT, Claude et Gemini, il s'agit d'une alternative rentable pour les flux de travail en chinois, en codage et en outils en plusieurs étapes.

$0.1785/1M tokens
QwenQwenQwen3.7 MAX

Conçu pour les charges de travail agents, le codage et la productivité bureautique, avec un accent combiné plus fort sur le contexte long, les appels d'outils et la sortie structurée que Qwen3.6. Comparé aux modèles phares tels que GPT, Claude et Gemini, il s'agit d'une alternative rentable pour les flux de travail en chinois, en codage et en outils en plusieurs étapes.

$1.8/1M tokens
QwenQwenQwen3.8 MAX

Qwen's most capable flagship multimodal reasoning model, built for long-horizon coding, professional work, and multi-stage agent tasks. It accepts text, images, and video, offers a 1M-token context window with up to 128K output, and supports function calling, structured outputs, web search, and a code interpreter. It is best used as a high-quality workhorse for complex tasks rather than for the lowest-cost, lowest-latency batch workloads.

$1.775/1M tokens

FAQ

Questions fréquentes

À quels usages Qwen3.6 MAX Preview convient-il ?

Qwen3.6 MAX Preview convient aux types d’entrée, de sortie et de capacités indiqués sur cette page. Testez vos charges réelles avant un usage critique.

Comment Qwen3.6 MAX Preview est-il facturé ?

Les tarifs figurent ci-dessus. Le coût réel dépend du volume, du groupe de compte et du contenu de la requête.

Comment appeler Qwen3.6 MAX Preview ?

Utilisez l’identifiant du modèle ci-dessus avec un protocole API pris en charge. Des exemples sont affichés lorsqu’ils sont disponibles.

Commencer

Créez avec Qwen3.6 MAX Preview

Utiliser dans la console
TokenHot

La passerelle d'intelligence de frontière. Une API. 127 modèles. Latence de 0.2s. Payez uniquement ce que vous utilisez.

Tous les systèmes normaux · 99.997% de disponibilité

Entreprise

© 2026 TokenHot Inc. — Conçu pour les créateurs.