Tarifs API LLM

Modèles Qwen

Découvrez les 15 modèles Qwen disponibles sur TokenHot.

Une seule clé API donne accès à 15 modèles Qwen, avec des tarifs en temps réel et sans compte fournisseur séparé.

Contexte1M
Entrée$0.1492/M
Sortie$0.4476/M
An efficient multimodal workhorse in the Qwen family, with a native million-token context window and strong support for coding assistance, agentic workflows, and visual understanding such as charts. It fits long documents, codebases, high-concurrency applications, and tool-assisted tasks.
Type d'entrée:
Type de sortie:
ReasoningTool UseStructured OutputLong Context
Essayer le modèle
PAR SEC$0.0675/s
The speed-first variant of Alibaba's Wan 3.0 line (early access). It shortens generation latency while retaining high-quality video output, making it a good fit for low-latency previews, batch drafts and fast-iterating short-video workflows. If ultimate visual control matters more than speed, the standard version is a better choice.
Type d'entrée:
Type de sortie:
Multimodal Output
Essayer le modèle
Qwen
PAR SEC$0.0450/s
The standard video generation model of Alibaba's Wan 3.0 line (early access). It supports text-to-video, image-to-video and multi-modal reference inputs, generating clips up to roughly 30 seconds with synchronized audio in a single pass — suitable for ads, short drama and narrative content. Official release date not yet announced.
Type d'entrée:
Type de sortie:
Multimodal Output
Qwen
Contexte1M
Entrée
$1.4200/M$1.7750/M
Sortie
$4.2640/M$5.3300/M
Qwen's most capable flagship multimodal reasoning model, built for long-horizon coding, professional work, and multi-stage agent tasks. It accepts text, images, and video, offers a 1M-token context window with up to 128K output, and supports function calling, structured outputs, web search, and a code interpreter. It is best used as a high-quality workhorse for complex tasks rather than for the lowest-cost, lowest-latency batch workloads.
Type d'entrée:
Type de sortie:
ReasoningWeb SearchTool UseFunction CallingStructured OutputLong ContextCode Execution
Essayer le modèle
PAR SEC
$0.0024/s$0.0030/s
A quality-first image generation and editing model: it supports text-to-image and edits from 1–3 reference images, accepts prompts of up to about 4.5K tokens, and is aimed at dense layouts, fine 10px-scale text, 12 languages, and multiple fonts. Choose it over the standard variant when complex composition and detail fidelity matter more than speed or cost; use the standard variant for a faster, more economical workflow.
Type d'entrée:
Type de sortie:
PAR SEC
$0.0024/s$0.0030/s
The balanced standard tier of Qwen-Image 3.0 for image generation and editing: it supports text-to-image and edits from 1–3 reference images, prompts of up to about 4.5K tokens, up to six outputs, and 2K-class resolution. It fits everyday posters, interfaces, infographics, and repeated creative work; move to Pro when complex layouts and fine text fidelity matter more, and use this tier when speed and cost efficiency are the priority.
Type d'entrée:
Type de sortie:
PAR SEC$0.1350/s
Conçu pour la conversion texte-vidéo, avec un flux de travail audio natif plus puissant que HappyHorse 1.0, générant des dialogues, des effets sonores et une musique de fond en un seul passage. Par rapport à Veo, Kling et Runway, son différenciateur réside dans la génération audiovisuelle synchronisée et les flux de travail cohérents avec les personnages pour les courts métrages, les publicités, le commerce électronique et le marketing de marque.
Type d'entrée:
Type de sortie:
Multimodal Output
PAR SEC$0.1350/s
Conçu pour la référence à la vidéo, avec un flux de travail audio natif plus puissant que HappyHorse 1.0, générant des dialogues, des effets sonores et une musique de fond en un seul passage. Par rapport à Veo, Kling et Runway, son différenciateur réside dans la génération audiovisuelle synchronisée et les flux de travail cohérents avec les personnages pour les courts métrages, les publicités, le commerce électronique et le marketing de marque.
Type d'entrée:
Type de sortie:
Multimodal Output
PAR SEC$0.1350/s
Conçu pour la conversion d'image en vidéo, avec un flux de travail audio natif plus puissant que HappyHorse 1.0, générant des dialogues, des effets sonores et une musique de fond en un seul passage. Par rapport à Veo, Kling et Runway, son différenciateur réside dans la génération audiovisuelle synchronisée et les flux de travail cohérents avec les personnages pour les courts métrages, les publicités, le commerce électronique et le marketing de marque.
Type d'entrée:
Type de sortie:
Multimodal Output
Qwen
Contexte1M
Entrée
$0.2400/M$0.3000/M
Sortie
$0.9600/M$1.2000/M
Conçu pour les charges de travail agents, le codage et la productivité bureautique, avec un accent combiné plus fort sur le contexte long, les appels d'outils et la sortie structurée que Qwen3.6. Comparé aux modèles phares tels que GPT, Claude et Gemini, il s'agit d'une alternative rentable pour les flux de travail en chinois, en codage et en outils en plusieurs étapes.
Type d'entrée:
Type de sortie:
ReasoningTool UseFunction CallingStructured OutputLong Context
Essayer le modèle
Qwen
Contexte1M
Entrée
$1.4400/M$1.8000/M
Sortie
$4.3200/M$5.4000/M
Conçu pour les charges de travail agents, le codage et la productivité bureautique, avec un accent combiné plus fort sur le contexte long, les appels d'outils et la sortie structurée que Qwen3.6. Comparé aux modèles phares tels que GPT, Claude et Gemini, il s'agit d'une alternative rentable pour les flux de travail en chinois, en codage et en outils en plusieurs étapes.
Type d'entrée:
Type de sortie:
ReasoningTool UseFunction CallingStructured OutputLong Context
Essayer le modèle
Contexte8K
PAR SEC$0.1350/s
Pour le montage vidéo, par rapport aux premiers modèles vidéo, il met davantage l'accent sur la génération audio native, complétant les dialogues, les effets sonores et la musique de fond en une seule fois ; par rapport à Veo, Kling et Runway, ses avantages différenciés résident dans la synchronisation sono-visuelle et dans le flux de travail de cohérence des personnages. Convient aux courtes dramatiques, aux publicités, aux vidéos de commerce électronique et de marketing de marque.
Type d'entrée:
Type de sortie:
Multimodal Output
Contexte8K
PAR SEC$0.1350/s
Pour les vidéos Wensheng, par rapport aux premiers modèles vidéo, l'accent est mis davantage sur la génération audio native, complétant simultanément les dialogues, les effets sonores et la musique de fond ; par rapport à Veo, Kling et Runway, ses avantages différenciés résident dans la synchronisation sono-visuelle et dans le flux de travail de cohérence des personnages. Convient aux courtes dramatiques, aux publicités, aux vidéos de commerce électronique et de marketing de marque.
Type d'entrée:
Type de sortie:
Multimodal Output
Contexte8K
PAR SEC$0.1350/s
La génération de vidéos à titre de référence, par rapport aux premiers modèles vidéo, est plus importante dans la génération audio native et complète les dialogues, les effets sonores et la musique de fond en une seule fois ; par rapport à Veo, Kling et Runway, ses avantages différenciés résident dans la synchronisation sono-visuelle et dans le flux de travail de cohérence des personnages. Convient aux courtes dramatiques, aux publicités, aux vidéos de commerce électronique et de marketing de marque.
Type d'entrée:
Type de sortie:
Multimodal Output
Contexte8K
PAR SEC$0.1350/s
Pour les vidéos Tusheng, par rapport aux premiers modèles vidéo, l'accent est mis davantage sur la génération audio native, complétant simultanément les dialogues, les effets sonores et la musique de fond ; par rapport à Veo, Kling et Runway, ses avantages différenciés résident dans la synchronisation sono-visuelle et dans le flux de travail de cohérence des personnages. Convient aux courtes dramatiques, aux publicités, aux vidéos de commerce électronique et de marketing de marque.
Type d'entrée:
Type de sortie:
Multimodal Output