Qwen

Qwen3.6 Flash API

Conçu pour les charges de travail agents, le codage et la productivité bureautique, avec un accent combiné plus fort sur le contexte long, les appels d'outils et la sortie structurée que Qwen3.5. Comparé aux modèles phares tels que GPT, Claude et Gemini, il s'agit d'une alternative rentable pour les flux de travail en chinois, en codage et en outils en plusieurs étapes.

  • Raisonnement
  • Utilisation d’outils
  • Sortie structurée
  • Contexte long

USD

Tarifs

default
input<256K
Entrée$0.1785/1M tokensPrix de complétion$1.0605/1M tokensLecture cache$0.018/1M tokensÉcriture cache$0.22/1M tokens
input>=272K
Entrée$0.714/1M tokensPrix de complétion$4.263/1M tokensLecture cache$0.07/1M tokensÉcriture cache$0.89/1M tokens

Prix publics en dollars US. Le coût final peut varier selon le groupe de compte et le volume d’utilisation.

API

Exemples de code

curl --location --request POST 'https://api.tokenhot.ai/v1/chat/completions' \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data-raw '{
    "model": "qwen3.6-flash",
    "messages": [
        {
            "role": "user",
            "content": "What model are you"
        }
    ]
}'

Qwen

Modèles associés

QwenQwenQwen3.6 Plus

Conçu pour les charges de travail agents, le codage et la productivité bureautique, avec un accent combiné plus fort sur le contexte long, les appels d'outils et la sortie structurée que Qwen3.5. Comparé aux modèles phares tels que GPT, Claude et Gemini, il s'agit d'une alternative rentable pour les flux de travail en chinois, en codage et en outils en plusieurs étapes.

$1.14/1M tokens
QwenQwenQwen3.6 MAX Preview

Alibaba Qwen 3.6 Max Preview, un modèle mixte d'experts avec environ 1 000 milliards de paramètres. Optimisé pour le codage agent, l'utilisation d'outils et le raisonnement en contexte long avec un mode de réflexion intégré qui préserve les traces de raisonnement au cours des conversations à plusieurs tours. Fenêtre contextuelle 262K, disponible via l'API Alibaba Cloud Model Studio.

$1.33/1M tokens
QwenQwenQwen3.7 MAX

Conçu pour les charges de travail agents, le codage et la productivité bureautique, avec un accent combiné plus fort sur le contexte long, les appels d'outils et la sortie structurée que Qwen3.6. Comparé aux modèles phares tels que GPT, Claude et Gemini, il s'agit d'une alternative rentable pour les flux de travail en chinois, en codage et en outils en plusieurs étapes.

$1.8/1M tokens
QwenQwenQwen3.8 MAX

Qwen's most capable flagship multimodal reasoning model, built for long-horizon coding, professional work, and multi-stage agent tasks. It accepts text, images, and video, offers a 1M-token context window with up to 128K output, and supports function calling, structured outputs, web search, and a code interpreter. It is best used as a high-quality workhorse for complex tasks rather than for the lowest-cost, lowest-latency batch workloads.

$1.775/1M tokens

FAQ

Questions fréquentes

À quels usages Qwen3.6 Flash convient-il ?

Qwen3.6 Flash convient aux types d’entrée, de sortie et de capacités indiqués sur cette page. Testez vos charges réelles avant un usage critique.

Comment Qwen3.6 Flash est-il facturé ?

Les tarifs figurent ci-dessus. Le coût réel dépend du volume, du groupe de compte et du contenu de la requête.

Comment appeler Qwen3.6 Flash ?

Utilisez l’identifiant du modèle ci-dessus avec un protocole API pris en charge. Des exemples sont affichés lorsqu’ils sont disponibles.

Commencer

Créez avec Qwen3.6 Flash

Utiliser dans la console