Qwen

Qwen3.8 MAX API

Qwen's most capable flagship multimodal reasoning model, built for long-horizon coding, professional work, and multi-stage agent tasks. It accepts text, images, and video, offers a 1M-token context window with up to 128K output, and supports function calling, structured outputs, web search, and a code interpreter. It is best used as a high-quality workhorse for complex tasks rather than for the lowest-cost, lowest-latency batch workloads.

  • Raisonnement
  • Recherche web
  • Utilisation d’outils
  • Appel de fonctions
  • Sortie structurée
  • Contexte long
  • Exécution de code

La description n’est pas encore disponible dans cette langue ; elle est affichée en anglais.

USD

Tarifs

default
Tarif standard
Entrée$1.775/1M tokensPrix de complétion$5.32997/1M tokensLecture cache$0.176968/1M tokensÉcriture cache$2.219993/1M tokens

Prix publics en dollars US. Le coût final peut varier selon le groupe de compte et le volume d’utilisation.

API

Exemples de code

curl --location --request POST 'https://api.tokenhot.ai/v1/chat/completions' \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data-raw '{
    "model": "qwen3.8-max",
    "messages": [
        {
            "role": "user",
            "content": "What model are you"
        }
    ]
}'

Qwen

Modèles associés

QwenQwenQwen3.7 MAX

Conçu pour les charges de travail agents, le codage et la productivité bureautique, avec un accent combiné plus fort sur le contexte long, les appels d'outils et la sortie structurée que Qwen3.6. Comparé aux modèles phares tels que GPT, Claude et Gemini, il s'agit d'une alternative rentable pour les flux de travail en chinois, en codage et en outils en plusieurs étapes.

$1.8/1M tokens
QwenQwenQwen3.6 Plus

Conçu pour les charges de travail agents, le codage et la productivité bureautique, avec un accent combiné plus fort sur le contexte long, les appels d'outils et la sortie structurée que Qwen3.5. Comparé aux modèles phares tels que GPT, Claude et Gemini, il s'agit d'une alternative rentable pour les flux de travail en chinois, en codage et en outils en plusieurs étapes.

$1.14/1M tokens
QwenQwenQwen3.6 Flash

Conçu pour les charges de travail agents, le codage et la productivité bureautique, avec un accent combiné plus fort sur le contexte long, les appels d'outils et la sortie structurée que Qwen3.5. Comparé aux modèles phares tels que GPT, Claude et Gemini, il s'agit d'une alternative rentable pour les flux de travail en chinois, en codage et en outils en plusieurs étapes.

$0.1785/1M tokens
QwenQwenQwen3.7 Plus

Conçu pour les charges de travail agents, le codage et la productivité bureautique, avec un accent combiné plus fort sur le contexte long, les appels d'outils et la sortie structurée que Qwen3.6. Comparé aux modèles phares tels que GPT, Claude et Gemini, il s'agit d'une alternative rentable pour les flux de travail en chinois, en codage et en outils en plusieurs étapes.

$0.3/1M tokens

FAQ

Questions fréquentes

À quels usages Qwen3.8 MAX convient-il ?

Qwen3.8 MAX convient aux types d’entrée, de sortie et de capacités indiqués sur cette page. Testez vos charges réelles avant un usage critique.

Comment Qwen3.8 MAX est-il facturé ?

Les tarifs figurent ci-dessus. Le coût réel dépend du volume, du groupe de compte et du contenu de la requête.

Comment appeler Qwen3.8 MAX ?

Utilisez l’identifiant du modèle ci-dessus avec un protocole API pris en charge. Des exemples sont affichés lorsqu’ils sont disponibles.

Commencer

Créez avec Qwen3.8 MAX

Utiliser dans la console
TokenHot

La passerelle d'intelligence de frontière. Une API. 127 modèles. Latence de 0.2s. Payez uniquement ce que vous utilisez.

Tous les systèmes normaux · 99.997% de disponibilité

Entreprise

© 2026 TokenHot Inc. — Conçu pour les créateurs.