Zhipu
glm-5.3
Zhipu AI
Contexte1M
Entrée
$1.0115/M$1.1900/M
Sortie
$3.5275/M$4.1500/M
A flagship workhorse for complex software engineering and long-horizon agent tasks. It uses the same base model as GLM-5.2, with improvements driven by post-training, delivering a 50% gain on Z.ai Code Bench alongside stronger terminal-operation and vulnerability-discovery capabilities. It offers a 1M-token context window, up to 128K output, always-on reasoning with low, high, and max effort levels, function calling, and structured outputs. It currently accepts text only and is not intended for tasks requiring visual understanding.
Type d'entrée:
Type de sortie:
ReasoningTool UseFunction CallingStructured OutputLong Context
Qwen
qwen3.8-max
Qwen
Contexte1M
Entrée
$1.4200/M$1.7750/M
Sortie
$4.2640/M$5.3300/M
Qwen's most capable flagship multimodal reasoning model, built for long-horizon coding, professional work, and multi-stage agent tasks. It accepts text, images, and video, offers a 1M-token context window with up to 128K output, and supports function calling, structured outputs, web search, and a code interpreter. It is best used as a high-quality workhorse for complex tasks rather than for the lowest-cost, lowest-latency batch workloads.
Type d'entrée:
Type de sortie:
ReasoningWeb SearchTool UseFunction CallingStructured OutputLong ContextCode Execution
MoonshotAI
kimi-k3
Moonshot
Contexte1.05M
Entrée
$2.7000/M$3.0000/M
Sortie
$13.5000/M$15.0000/M
Modèle phare Moonshot avec vision native et fenêtre contextuelle jusqu'à 1 million de jetons. Il fonctionne actuellement avec un effort de raisonnement maximal et convient au codage à long terme, au travail de connaissances et aux tâches complexes qui coordonnent les outils des terminaux. Pour une utilisation stable, conservez l'historique complet du raisonnement et démarrez une nouvelle session dans un harnais d'agent compatible.
Type d'entrée:
Type de sortie:
ReasoningTool UseLong Context
OpenAI
gpt-5.6-terra
OpenAI
Contexte1.05M
Entrée
$0.4000/M$2.0000/M
Sortie
$2.4000/M$12.0000/M
The balanced workhorse tier of GPT-5.6, combining capability and cost. Well suited to production work involving image understanding, tool use, and large source material; choose Sol for the hardest quality-first work or Luna for cost-controlled high volume.
Type d'entrée:
Type de sortie:
ReasoningFunction CallingStructured OutputLong Context
OpenAI
gpt-5.6-sol
OpenAI
Contexte1.05M
Entrée
$1.0000/M$5.0000/M
Sortie
$6.0000/M$30.0000/M
The flagship GPT-5.6 tier for complex professional work and quality-first delivery. It supports image input, function calling, structured outputs, and an exceptionally large context window; consider Terra or Luna when latency or unit cost is the primary constraint.
Type d'entrée:
Type de sortie:
ReasoningFunction CallingStructured OutputLong Context
OpenAI
gpt-5.6-luna
OpenAI
Contexte1.05M
Entrée
$0.0400/M$0.2000/M
Sortie
$0.2400/M$1.2000/M
The cost-sensitive, high-volume tier of GPT-5.6. A good fit for summarization, classification, rewriting, and batch automation; choose the Sol sibling for complex professional judgment or quality-first multi-step work.
Type d'entrée:
Type de sortie:
ReasoningFunction CallingStructured OutputLong Context
Grok
grok-4.5
xAI
Contexte500K
Entrée$2.1000/M
Sortie$6.3000/M
Un modèle de raisonnement frontalier pour le codage, le travail de connaissances et les tâches STEM. Il prend en charge l'entrée d'image, l'appel de fonction et les sorties structurées ; son contexte de 500 000 jetons convient à l'analyse multi-fichiers et aux sources longues. Préférez un modèle à moindre coût lorsque le raisonnement frontalier n’est pas nécessaire.
Type d'entrée:
Type de sortie:
ReasoningFunction CallingStructured OutputLong Context
Claude
claude-fable-5
Anthropic
Contexte1M
Entrée
$3.4000/M$10.0000/M
Sortie
$17.0000/M$50.0000/M
Le modèle Anthropic le plus performant et largement diffusé, conçu pour le raisonnement les plus exigeants et le travail agent à long terme. Offre une fenêtre contextuelle de 1 million de jetons avec une sortie maximale de 128 000 et une pensée adaptative permanente, excellant dans l'exploration autonome de tâches sous-spécifiées, la planification et la poursuite du codage de longue durée et de l'orchestration multi-agents avant de nécessiter une intervention humaine.
Type d'entrée:
Type de sortie:
ReasoningTool UseStructured OutputLong Context
Claude
claude-sonnet-5
Anthropic
Contexte1M
Entrée
$0.6800/M$2.0000/M
Sortie
$3.4000/M$10.0000/M
Un modèle de niveau Sonnet à pilote quotidien visant à apporter des capacités d'agent, de codage et de travail de connaissances proches des frontières à un coût d'exploitation inférieur. Son contexte de jeton 1M par défaut et sa pensée adaptative s'adaptent aux longs documents, aux bases de code et aux flux de travail d'outils en plusieurs étapes ; pour le raisonnement le plus approfondi ou les travaux de sécurité restreints à haut risque, évaluez des modèles de niveau supérieur ou spécialisés.
Type d'entrée:
Type de sortie:
ReasoningTool UseStructured OutputLong Context
LongCat
LongCat-2.0
美团
Contexte1M
Entrée$0.3000/M
Sortie$1.2000/M
Un outil de travail LongCat 2.0 pour le codage à l'échelle d'un projet et les tâches d'agent de longue durée, avec un contexte natif de jeton 1M ainsi que des appels d'outils et un raisonnement en plusieurs étapes. C'est mieux lorsque vous devez conserver des référentiels volumineux, des documents longs ou des flux de travail d'automatisation dans la portée ; pour des questions et réponses légères ou des discussions à faible latence, un modèle plus petit de style Flash/Lite est généralement moins cher.
Type d'entrée:
Type de sortie:
ReasoningTool UseFunction CallingLong Context
Doubao
doubao-seed-2-1-pro
Doubao
Contexte256K
Entrée$0.9700/M
Sortie$4.8800/M
Conçu pour le codage, les agents et les tâches de productivité complexes, dépassant Doubao Seed 2.0 dans un contexte long, une sortie longue et des flux de travail orientés outils. Comparé aux pairs de Qwen, GLM et DeepSeek, il s'agit d'une option rentable pour le travail de bureau chinois, le codage et l'automatisation en plusieurs étapes.
Type d'entrée:
Type de sortie:
ReasoningTool UseFunction CallingStructured OutputLong Context
Qwen
happyhorse-1.1-t2v
阿里巴巴
PAR SEC$0.1350/s
Conçu pour la conversion texte-vidéo, avec un flux de travail audio natif plus puissant que HappyHorse 1.0, générant des dialogues, des effets sonores et une musique de fond en un seul passage. Par rapport à Veo, Kling et Runway, son différenciateur réside dans la génération audiovisuelle synchronisée et les flux de travail cohérents avec les personnages pour les courts métrages, les publicités, le commerce électronique et le marketing de marque.
Type d'entrée:
Type de sortie:
Multimodal Output
Qwen
happyhorse-1.1-r2v
阿里巴巴
PAR SEC$0.1350/s
Conçu pour la référence à la vidéo, avec un flux de travail audio natif plus puissant que HappyHorse 1.0, générant des dialogues, des effets sonores et une musique de fond en un seul passage. Par rapport à Veo, Kling et Runway, son différenciateur réside dans la génération audiovisuelle synchronisée et les flux de travail cohérents avec les personnages pour les courts métrages, les publicités, le commerce électronique et le marketing de marque.
Type d'entrée:
Type de sortie:
Multimodal Output
Qwen
happyhorse-1.1-i2v
阿里巴巴
PAR SEC$0.1350/s
Conçu pour la conversion d'image en vidéo, avec un flux de travail audio natif plus puissant que HappyHorse 1.0, générant des dialogues, des effets sonores et une musique de fond en un seul passage. Par rapport à Veo, Kling et Runway, son différenciateur réside dans la génération audiovisuelle synchronisée et les flux de travail cohérents avec les personnages pour les courts métrages, les publicités, le commerce électronique et le marketing de marque.
Type d'entrée:
Type de sortie:
Multimodal Output
Doubao
doubao-seedance-2-0-mini
Doubao
Entrée
$0.7560/M$1.5120/M
Sortie
$0.7560/M$1.5120/M
Built for video generation and multi-asset video creation, improving on Seedance 1.x with more complete motion stability, audiovisual generation, and reference inputs. Compared with Veo, Kling, and Runway, it is better suited to Chinese creative workflows driven by mixed text, image, audio, and video inputs. The Mini tier is positioned for lower-cost, high-frequency testing compared with standard Seedance 2.0. Useful for short drama, ads, e-commerce, and social assets.
Type d'entrée:
Type de sortie:
Multimodal Output
Doubao
dreamina-seedance-2-0-mini-filter-off
Doubao
Entrée$1.5750/M
Sortie$1.5750/M
Conçu pour la génération vidéo et la création vidéo multi-actifs, améliorant Seedance 1.x avec une stabilité de mouvement, une génération audiovisuelle et des entrées de référence plus complètes. Comparé à Veo, Kling et Runway, il est mieux adapté aux flux de travail créatifs chinois pilotés par des entrées mixtes de texte, d'image, d'audio et de vidéo. Cette variante sans filtre conserve le même niveau de capacité de génération que Seedance 2.0 standard tout en appliquant un filtrage de contenu plus souple. Utile pour les courts métrages dramatiques, les publicités, le commerce électronique et les ressources sociales.
Type d'entrée:
Type de sortie:
Multimodal Output
Zhipu
glm-5.2
Zhipu AI
Contexte1M
Entrée
$0.9690/M$1.1400/M
Sortie
$3.4000/M$4.0000/M
Conçu pour le raisonnement, le codage et les tâches d'agent à contexte long, améliorant par rapport à GLM-5.1 en termes de longueur de contexte, d'utilisation des outils et de flux de travail complexes en plusieurs étapes. Comparé à ses homologues chinois phares tels que Qwen, DeepSeek et Kimi, il s'adapte à l'automatisation d'entreprise, à l'analyse de code au niveau du projet et au travail de connaissances en chinois.
Type d'entrée:
Type de sortie:
ReasoningTool UseFunction CallingStructured OutputLong Context
MoonshotAI
kimi-k2.7-code
Moonshot
Contexte256K
Entrée
$0.8775/M$0.9750/M
Sortie
$3.6450/M$4.0500/M
Conçu pour une utilisation d'outils en plusieurs étapes et dans un contexte long, ainsi que pour les flux de travail de code/document, avec une stabilité des tâches d'ingénierie et une capacité de contexte plus élevées que Kimi K2.6. Comparé à Qwen, GLM et DeepSeek, il est bien adapté à l'analyse de documents longs en chinois, aux questions et réponses sur les projets et à la programmation agent quotidienne.
Type d'entrée:
Type de sortie:
Tool UseFunction CallingStructured OutputLong Context
Grok
grok-imagine-video-1-5-preview
xAI
PAR SEC$0.1400/s
Conçu pour la génération, l'édition et l'extension d'images/vidéos, avec une cohérence de mouvement plus forte et une production rapide de contenu social que Grok Imagine 1.0. Comparé à Veo, Kling et Runway, il s'adapte aux vidéos courtes, aux concepts publicitaires et aux actifs axés sur les tendances dans l'écosystème xAI.
Type d'entrée:
Type de sortie:
Multimodal Output
Minimax
MiniMax-M3
MiniMax
Contexte1M
Entrée$1.2600/M
Sortie$5.0400/M
Conçu pour le codage à long terme, l'utilisation d'outils et la collaboration de production multi-tours, s'étendant au-delà de MiniMax M2.7 avec des entrées multimodales tout en conservant une fenêtre contextuelle de 1 million de jetons. Par rapport aux modèles d'agents à contexte long Claude, Gemini et GLM-5.2, il est préférable de regrouper du texte, des images et des vidéos dans un seul flux de travail.
Type d'entrée:
Type de sortie:
ReasoningTool UseFunction CallingStructured OutputLong Context
Claude
claude-opus-4-8
Anthropic
Contexte1M
Entrée
$1.7000/M$5.0000/M
Sortie
$8.5000/M$25.0000/M
Pour le raisonnement phare et les tâches complexes des agents, il va plus loin que Claude Opus 4.7 en termes de contexte long, de code, d'utilisation des outils et de planification complexe ; par rapport aux modèles phares tels que GPT, Gemini et Qwen, il est plus adapté aux agents de haute fiabilité, à la maintenance de la base de code et aux flux de travail de recherche approfondis.
Type d'entrée:
Type de sortie:
ReasoningTool UseStructured OutputLong Context
Gemini
gemini-omni-video
Google
PAR SEC$0.2450/s
Conçu pour la création multimodale de n'importe quelle entrée dans la vidéo, en mettant davantage l'accent que les flux de travail vidéo Gemini précédents sur l'orchestration unifiée du texte, de l'image, de l'audio et du matériel vidéo. Par rapport à Veo, Kling et Runway, il est préférable d'intégrer des actifs multimodaux complexes dans un seul flux de travail créatif.
Type d'entrée:
Type de sortie:
Multimodal Output
Gemini
gemini-3.5-flash
Google
Contexte1M
Entrée$1.5000/M
Sortie$9.0000/M
Conçu pour la compréhension multimodale, le codage et les tâches à contexte long, améliorant par rapport à Gemini 3.1 en termes de débit, de contexte et de capacités d'outils. Comparé aux modèles GPT, Claude et Qwen, il est puissant pour les flux de travail d'analyse unifiés du texte, des images, de l'audio, de la vidéo et des documents.
Type d'entrée:
Type de sortie:
ReasoningWeb SearchTool UseFunction CallingStructured OutputLong ContextCode Execution
Qwen
qwen3.7-max
Qwen
Contexte1M
Entrée
$1.4400/M$1.8000/M
Sortie
$4.3200/M$5.4000/M
Conçu pour les charges de travail agents, le codage et la productivité bureautique, avec un accent combiné plus fort sur le contexte long, les appels d'outils et la sortie structurée que Qwen3.6. Comparé aux modèles phares tels que GPT, Claude et Gemini, il s'agit d'une alternative rentable pour les flux de travail en chinois, en codage et en outils en plusieurs étapes.
Type d'entrée:
Type de sortie:
ReasoningTool UseFunction CallingStructured OutputLong Context
Qwen
qwen3.6-max-preview
Qwen
Contexte262K
Entrée$1.3300/M
Sortie$8.0000/M
Alibaba Qwen 3.6 Max Preview, un modèle mixte d'experts avec environ 1 000 milliards de paramètres. Optimisé pour le codage agent, l'utilisation d'outils et le raisonnement en contexte long avec un mode de réflexion intégré qui préserve les traces de raisonnement au cours des conversations à plusieurs tours. Fenêtre contextuelle 262K, disponible via l'API Alibaba Cloud Model Studio.
Type d'entrée:
Type de sortie:
ReasoningTool UseStructured OutputLong Context
Qwen
happyhorse-1.0-video-edit
Qwen
Contexte8K
PAR SEC$0.1350/s
Pour le montage vidéo, par rapport aux premiers modèles vidéo, il met davantage l'accent sur la génération audio native, complétant les dialogues, les effets sonores et la musique de fond en une seule fois ; par rapport à Veo, Kling et Runway, ses avantages différenciés résident dans la synchronisation sono-visuelle et dans le flux de travail de cohérence des personnages. Convient aux courtes dramatiques, aux publicités, aux vidéos de commerce électronique et de marketing de marque.
Type d'entrée:
Type de sortie:
Qwen
happyhorse-1.0-t2v
Qwen
Contexte8K
PAR SEC$0.1350/s
Pour les vidéos Wensheng, par rapport aux premiers modèles vidéo, l'accent est mis davantage sur la génération audio native, complétant simultanément les dialogues, les effets sonores et la musique de fond ; par rapport à Veo, Kling et Runway, ses avantages différenciés résident dans la synchronisation sono-visuelle et dans le flux de travail de cohérence des personnages. Convient aux courtes dramatiques, aux publicités, aux vidéos de commerce électronique et de marketing de marque.
Type d'entrée:
Type de sortie:
Qwen
happyhorse-1.0-r2v
Qwen
Contexte8K
PAR SEC$0.1350/s
La génération de vidéos à titre de référence, par rapport aux premiers modèles vidéo, est plus importante dans la génération audio native et complète les dialogues, les effets sonores et la musique de fond en une seule fois ; par rapport à Veo, Kling et Runway, ses avantages différenciés résident dans la synchronisation sono-visuelle et dans le flux de travail de cohérence des personnages. Convient aux courtes dramatiques, aux publicités, aux vidéos de commerce électronique et de marketing de marque.
Type d'entrée:
Type de sortie:
Qwen
happyhorse-1.0-i2v
Qwen
Contexte8K
PAR SEC$0.1350/s
Pour les vidéos Tusheng, par rapport aux premiers modèles vidéo, l'accent est mis davantage sur la génération audio native, complétant simultanément les dialogues, les effets sonores et la musique de fond ; par rapport à Veo, Kling et Runway, ses avantages différenciés résident dans la synchronisation sono-visuelle et dans le flux de travail de cohérence des personnages. Convient aux courtes dramatiques, aux publicités, aux vidéos de commerce électronique et de marketing de marque.
Type d'entrée:
Type de sortie:
DeepSeek
deepseek-v4-pro
DeepSeek
Contexte1M
Entrée
$1.5390/M$1.7100/M
Sortie
$3.0869/M$3.4299/M
Conçu pour le raisonnement, le codage et l'utilisation d'outils agentiques, avec une exécution de contexte long, de mode de réflexion et de tâches complexes plus puissante que DeepSeek V3.2. Comparé à ses pairs chinois tels que Qwen, GLM et Kimi, il est particulièrement compétitif pour les tâches de mathématiques, de programmation et de raisonnement logique.
Type d'entrée:
Type de sortie:
Long ContextTool UseReasoningStructured Output
DeepSeek
deepseek-v4-flash
DeepSeek
Contexte1M
Entrée
$0.1278/M$0.1420/M
Sortie
$0.2574/M$0.2860/M
Conçu pour le raisonnement, le codage et l'utilisation d'outils agentiques, avec une exécution de contexte long, de mode de réflexion et de tâches complexes plus puissante que DeepSeek V3.2. Comparé à ses pairs chinois tels que Qwen, GLM et Kimi, il est particulièrement compétitif pour les tâches de mathématiques, de programmation et de raisonnement logique.
Type d'entrée:
Type de sortie:
Long ContextTool UseReasoningStructured Output
OpenAI
gpt-5.5
OpenAI
Contexte1M
Entrée
$1.0000/M$5.0000/M
Sortie
$6.0000/M$30.0000/M
Conçu pour le raisonnement, le codage, la compréhension visuelle et les tâches d'agent, avec un contexte long, une utilisation des outils et une sortie fiable et évolutive plus forts que GPT-5.4. Comparé aux modèles phares Claude, Gemini et Qwen, il s'agit d'une base polyvalente solide pour une automatisation fiable et des flux de connaissances complexes.
Type d'entrée:
Type de sortie:
XiaomiMiMo
mimo-v2.5-tts-voicedesign
Xiaomi MiMo
Entrée$0.0000/M
Sortie$0.0000/M
Conçu pour la conception vocale d'une phrase et la synthèse vocale, avec une création vocale en langage naturel de la série V2.5 plus puissante, un contrôle plus fin du rythme/des émotions/de la tonalité et une production vocale à faible friction que le MiMo V2 TTS. Comparé à ElevenLabs, OpenAI TTS et Azure Speech, il est utile pour la conception de voix de personnages sans référence, les voix off publicitaires, la narration vidéo courte et l'exploration vocale multistyle.
Type d'entrée:
Type de sortie:
Multimodal Output
XiaomiMiMo
mimo-v2.5-tts-voiceclone
Xiaomi MiMo
Entrée$0.0000/M
Sortie$0.0000/M
Conçu pour le clonage de voix de quelques échantillons, avec une reproduction du timbre haute fidélité de la série V2.5 plus forte, une cohérence des caractères vocaux et une généralisation du texte croisé que le MiMo V2 TTS. Comparé à ElevenLabs, OpenAI TTS et Azure Speech, il est bien adapté au doublage de caractères chinois, à la narration de courtes vidéos, à la réplication vocale de podcast et à la production vocale multilingue qui doit préserver une voix cible.
Type d'entrée:
Type de sortie:
Multimodal Output
XiaomiMiMo
mimo-v2.5-tts
Xiaomi MiMo
Entrée$0.0000/M
Sortie$0.0000/M
Conçu pour la synthèse vocale, la conception vocale et le clonage vocal, avec une synthèse vocale naturelle de la série V2.5 plus puissante, un contrôle précis du rythme/des émotions/de la tonalité et une création vocale à faible friction que le MiMo V2 TTS. Comparé à ElevenLabs, OpenAI TTS et Azure Speech, il est bien adapté à la narration chinoise, au doublage de personnages, à l'audio de courtes vidéos et à la production vocale multilingue.
Type d'entrée:
Type de sortie:
Multimodal Output
OpenAI
gpt-image-2-text-to-image
OpenAI
Contexte128K
PAR IMG$0.0300/image
Il s'agit d'un itinéraire d'essai à prix réduit. La génération peut prendre plus de temps et a environ 10 % de chances d’échouer. Il est préférable de réaliser des essais de génération d'images sensibles aux coûts, où les files d'attente et les échecs occasionnels sont acceptables ; pour une utilisation en production plus stable, choisissez un itinéraire régulier.
Type d'entrée:
Type de sortie:
Multimodal Output
OpenAI
gpt-image-2-image-to-image
OpenAI
Contexte128K
PAR IMG$0.0200/image
Il s'agit d'un itinéraire d'essai à prix réduit. La génération peut prendre plus de temps et a environ 10 % de chances d’échouer. Il est préférable de réaliser des essais de génération d'images sensibles aux coûts, où les files d'attente et les échecs occasionnels sont acceptables ; pour une utilisation en production plus stable, choisissez un itinéraire régulier.
Type d'entrée:
Type de sortie:
Multimodal Output
OpenAI
gpt-image-2
OpenAI
Contexte128K
PAR IMG$0.0670/image
Conçu pour la génération et l'édition d'images de haute qualité, améliorant par rapport à GPT Image 1.x le rendu du texte, l'édition locale et la cohérence multi-tours. Comparé aux modèles d'image Gemini, Qwen Image et Seedream, il est bien adapté aux visuels de marque, à la conception publicitaire, à l'imagerie de produits et aux flux de travail créatifs étroitement contrôlés.
Type d'entrée:
Type de sortie:
Multimodal Output
MoonshotAI
kimi-k2.6
Moonshot
Entrée
$0.8370/M$0.9300/M
Sortie
$3.4740/M$3.8600/M
Conçu pour une utilisation d'outils en plusieurs étapes et dans un contexte long, ainsi que pour les flux de travail de code/document, avec une stabilité des tâches d'ingénierie et une capacité de contexte plus élevées que Kimi K2.5. Comparé à Qwen, GLM et DeepSeek, il est bien adapté à l'analyse de documents longs en chinois, aux questions et réponses sur les projets et à la programmation agent quotidienne.
Type d'entrée:
Type de sortie:
Tool UseReasoning
Claude
claude-opus-4-7
Anthropic
Contexte1M
Entrée
$1.7000/M$5.0000/M
Sortie
$8.5000/M$25.0000/M
Pour le raisonnement phare et les tâches complexes des agents, il va plus loin que Claude Opus 4.6 en termes de contexte long, de code, d'utilisation des outils et de planification complexe ; par rapport aux modèles phares tels que GPT, Gemini et Qwen, il est plus adapté aux agents de haute fiabilité, à la maintenance de la base de code et aux flux de travail de recherche approfondis.
Type d'entrée:
Type de sortie:
ReasoningWeb SearchTool UseFunction CallingStructured OutputLong ContextCode Execution
Minimax
MiniMax-M2.7-highspeed
MiniMax
Contexte200K
Entrée$0.6300/M
Sortie$2.5200/M
Conçu pour la génération de texte, le raisonnement et l'utilisation d'outils, avec une stabilité de flux de travail agent et en contexte long de 200 Ko plus forte que les versions précédentes de MiniMax M2.x. Comparé à ses homologues chinois tels que Kimi, GLM et Qwen, il s'adapte à la productivité, à l'assistance au codage et au traitement de documents longs.
Type d'entrée:
Type de sortie:
Reasoning
Minimax
MiniMax-M2.7
MiniMax
Contexte200K
Entrée$0.3150/M
Sortie$1.2600/M
Conçu pour la génération de texte, le raisonnement et l'utilisation d'outils, avec une stabilité de flux de travail agent et en contexte long de 200 Ko plus forte que les versions précédentes de MiniMax M2.x. Comparé à ses homologues chinois tels que Kimi, GLM et Qwen, il s'adapte à la productivité, à l'assistance au codage et au traitement de documents longs.
Type d'entrée:
Type de sortie:
Reasoning
OpenAI
gpt-5.4-mini
OpenAI
Contexte400K
Entrée
$0.1500/M$0.7500/M
Sortie
$0.9000/M$4.5000/M
Conçu pour le raisonnement, le codage, la compréhension visuelle et les tâches d'agent, avec un contexte long, une utilisation des outils et une sortie fiable et évolutive plus forts que GPT-5.3. Comparé aux modèles phares Claude, Gemini et Qwen, il s'agit d'une base polyvalente solide pour une automatisation fiable et des flux de connaissances complexes.
Type d'entrée:
Type de sortie:
Long ContextTool UseReasoningStructured Output
OpenAI
gpt-5.4
OpenAI
Contexte1.05M
Entrée
$0.5000/M$2.5000/M
Sortie
$3.0000/M$15.0000/M
Conçu pour le raisonnement, le codage, la compréhension visuelle et les tâches d'agent, avec un contexte long, une utilisation des outils et une sortie fiable et évolutive plus forts que GPT-5.3. Comparé aux modèles phares Claude, Gemini et Qwen, il s'agit d'une base polyvalente solide pour une automatisation fiable et des flux de connaissances complexes.
Type d'entrée:
Type de sortie:
Long ContextTool UseReasoningStructured Output
Gemini
gemini-3.1-flash-image-preview
Google
Contexte131K
PAR IMG$0.0672/image
Conçu pour la génération et l'édition d'images, avec une compréhension multimodale, des modifications conversationnelles et un prototypage visuel plus rapides que les fonctionnalités d'image Gemini antérieures. Comparé à GPT Image, Qwen Image et Seedream, il est utile pour combiner des documents, des images et des invites dans un seul flux de travail visuel.
Type d'entrée:
Type de sortie:
ReasoningMultimodal Output
Gemini
gemini-3.1-pro-preview
Google
Contexte1.05M
Entrée$2.0000/M
Sortie$12.0000/M
Conçu pour la compréhension multimodale, le codage et les tâches à contexte long, améliorant par rapport à Gemini 3.0/2.5 en termes de débit, de contexte et de capacités d'outils. Comparé aux modèles GPT, Claude et Qwen, il est puissant pour les flux de travail d'analyse unifiés du texte, des images, de l'audio, de la vidéo et des documents.
Type d'entrée:
Type de sortie:
Long Context
Claude
claude-sonnet-4-6-thinking
Anthropic
Contexte1M
Entrée$3.0000/M
Sortie$15.0000/M
La variante de pensée étendue d'Anthropic Claude Sonnet 4.6, permettant un raisonnement en chaîne de pensée pour des problèmes complexes. Excelle dans le codage, la navigation dans la base de code, la gestion de projet, la création de documents et les tâches agents avec saisie de texte et d'images. La fenêtre contextuelle 1M surpasse la version standard sur les tâches nécessitant un raisonnement approfondi, idéale pour l'ingénierie logicielle complexe et la planification en plusieurs étapes.
Type d'entrée:
Type de sortie:
ReasoningTool UseStructured OutputLong Context
Claude
claude-sonnet-4-6
Anthropic
Contexte1M
Entrée
$1.0200/M$3.0000/M
Sortie
$5.1000/M$15.0000/M
Pour des tâches de codage et d'agent efficaces, il va plus loin que la version précommande de Claude 4.5/4.6 en termes de contexte long, de code, d'utilisation des outils et de planification complexe ; par rapport aux modèles phares tels que GPT, Gemini et Qwen, il est plus adapté aux agents de haute fiabilité, à la maintenance de la base de code et aux flux de travail de recherche approfondis.
Type d'entrée:
Type de sortie:
ReasoningWeb SearchTool UseFunction CallingStructured OutputLong ContextCode Execution
Minimax
MiniMax-M2.5
MiniMax
Contexte205K
Entrée$0.3020/M
Sortie$1.2077/M
Un modèle rentable pour les vrais agents de productivité, les plus performants en matière de codage, d'utilisation d'outils, de recherche et de livrables de type bureautique plutôt que de simple conversation informelle. Il convient aux agents qui planifient et exécutent les modifications inter-fichiers, la récupération de recherche et les flux de travail de documents/feuilles de calcul/présentations ; Par rapport aux produits phares plus chers, le principal compromis est un coût inférieur pour une efficacité d'exécution proche des frontières.
Type d'entrée:
Type de sortie:
ReasoningTool UseFunction CallingStructured OutputLong Context
Doubao
doubao-seedance-2-0-filter-off
Doubao
Contexte13K
Entrée$3.1500/M
Sortie$3.1500/M
Conçu pour la génération vidéo et la création vidéo multi-actifs, améliorant Seedance 1.x avec une stabilité de mouvement, une génération audiovisuelle et des entrées de référence plus complètes. Comparé à Veo, Kling et Runway, il est mieux adapté aux flux de travail créatifs chinois pilotés par des entrées mixtes de texte, d'image, d'audio et de vidéo. Cette variante sans filtre conserve le même niveau de capacité de génération que Seedance 2.0 standard tout en appliquant un filtrage de contenu plus souple. Utile pour les courts métrages dramatiques, les publicités, le commerce électronique et les ressources sociales.
Type d'entrée:
Type de sortie:
Multimodal Output
Doubao
doubao-seedance-2-0-fast-filter-off
Doubao
Contexte13K
Entrée$2.5200/M
Sortie$2.5200/M
Conçu pour la génération vidéo et la création vidéo multi-actifs, améliorant Seedance 1.x avec une stabilité de mouvement, une génération audiovisuelle et des entrées de référence plus complètes. Comparé à Veo, Kling et Runway, il est mieux adapté aux flux de travail créatifs chinois pilotés par des entrées mixtes de texte, d'image, d'audio et de vidéo. Cette variante sans filtre conserve le même niveau de capacité de génération que Seedance 2.0 standard tout en appliquant un filtrage de contenu plus souple. Utile pour les courts métrages dramatiques, les publicités, le commerce électronique et les ressources sociales.
Type d'entrée:
Type de sortie:
Multimodal Output
Claude
claude-opus-4-6
Anthropic
Contexte1M
Entrée
$1.7000/M$5.0000/M
Sortie
$8.5000/M$25.0000/M
Pour le raisonnement phare et les tâches complexes des agents, il va plus loin que la version précommande de Claude 4.5/4.6 en termes de contexte long, de code, d'utilisation des outils et de planification complexe ; par rapport aux modèles phares tels que GPT, Gemini et Qwen, il est plus adapté aux agents de haute fiabilité, à la maintenance de la base de code et aux flux de travail de recherche approfondis.
Type d'entrée:
Type de sortie:
ReasoningWeb SearchTool UseFunction CallingStructured OutputLong ContextCode Execution
Kling
kling-v3-omni
kling
PAR SEC$0.0900/s
Conçu pour la création de texte/image en vidéo et de prises de vue multiples, améliorant par rapport à Kling 2.x la stabilité du mouvement, le langage de la caméra et la cohérence des références. Comparé à Veo, Runway et Seedance, il est bien adapté aux courts métrages dramatiques chinois, aux ressources publicitaires et à la production de vidéos sociales de haute qualité.
Type d'entrée:
Type de sortie:
Multimodal Output
Kling
kling-v3
kling
PAR SEC$0.0900/s
Conçu pour la création de texte/image en vidéo et de prises de vue multiples, améliorant par rapport à Kling 2.x la stabilité du mouvement, le langage de la caméra et la cohérence des références. Comparé à Veo, Runway et Seedance, il est bien adapté aux courts métrages dramatiques chinois, aux ressources publicitaires et à la production de vidéos sociales de haute qualité.
Type d'entrée:
Type de sortie:
Multimodal Output
Doubao
doubao-seedream-5.0-lite
Doubao
PAR IMG$0.0350/image
Conçu pour la génération et l'édition d'images, avec un suivi des instructions en chinois, un raisonnement visuel et une production créative à haute fréquence plus solides que Seedream 4.x. Comparé à GPT Image, aux modèles d'image Gemini et à Qwen Image, il est bien adapté à la conception publicitaire de l'écosystème ByteDance, aux actifs de commerce électronique et à la production visuelle multi-scénarios.
Type d'entrée:
Type de sortie:
Web SearchMultimodal Output
Doubao
doubao-seedance-2-0-fast
Doubao
Contexte8K
Entrée$2.4192/M
Sortie$2.4192/M
Conçu pour la génération vidéo et la création vidéo multi-actifs, améliorant Seedance 1.x avec une stabilité de mouvement, une génération audiovisuelle et des entrées de référence plus complètes. Comparé à Veo, Kling et Runway, il est mieux adapté aux flux de travail créatifs chinois pilotés par des entrées mixtes de texte, d'image, d'audio et de vidéo. La variante rapide est meilleure pour les itérations rapides et la production par lots que le niveau standard. Utile pour les courts métrages dramatiques, les publicités, le commerce électronique et les ressources sociales.
Type d'entrée:
Type de sortie:
Doubao
doubao-seedance-2-0
Doubao
Contexte8K
Entrée
$2.5927/M$2.7292/M
Sortie
$2.5927/M$2.7292/M
Conçu pour la génération vidéo et la création vidéo multi-actifs, améliorant Seedance 1.x avec une stabilité de mouvement, une génération audiovisuelle et des entrées de référence plus complètes. Comparé à Veo, Kling et Runway, il est mieux adapté aux flux de travail créatifs chinois pilotés par des entrées mixtes de texte, d'image, d'audio et de vidéo. Utile pour les courts métrages dramatiques, les publicités, le commerce électronique et les ressources sociales.
Type d'entrée:
Type de sortie:
MoonshotAI
kimi-k2.5
Moonshot
Contexte256K
Entrée
$0.5400/M$0.6000/M
Sortie
$2.8350/M$3.1500/M
Conçu pour une utilisation d'outils en plusieurs étapes et dans un contexte long, ainsi que pour les flux de travail de code/document, avec une stabilité des tâches d'ingénierie et une capacité de contexte plus élevées que Kimi K2. Comparé à Qwen, GLM et DeepSeek, il est bien adapté à l'analyse de documents longs en chinois, aux questions et réponses sur les projets et à la programmation agent quotidienne.
Type d'entrée:
Type de sortie:
Long ContextTool UseReasoning
Gemini
gemini-3-flash-preview
Google
Contexte1M
Entrée$0.5000/M
Sortie$3.0000/M
Modèle de réflexion rapide de Google conçu pour les flux de travail agents, le chat multi-tours et l'assistance au codage. Prend en charge la saisie de texte, d'image, d'audio, de vidéo et de PDF avec une fenêtre contextuelle de jeton de 1 M. Comprend des niveaux de réflexion configurables, l’utilisation d’outils et une sortie structurée. Améliorations apportées à la qualité par rapport à Gemini 2.5 Flash en termes de raisonnement, de compréhension multimodale et de fiabilité.
Type d'entrée:
Type de sortie:
ReasoningTool UseFunction CallingStructured OutputLong Context
DeepSeek
DeepSeek-V3.2-Thinking
DeepSeek
Contexte128K
Entrée$0.3100/M
Sortie$0.4700/M
Conçu pour le raisonnement, le codage et l'utilisation d'outils agentiques, avec une exécution de contexte long, de mode de réflexion et de tâches complexes plus puissante que DeepSeek V3.1. Comparé à ses pairs chinois tels que Qwen, GLM et Kimi, il est particulièrement compétitif pour les tâches de mathématiques, de programmation et de raisonnement logique.
Type d'entrée:
Type de sortie:
Long ContextTool UseReasoningStructured Output
Gemini
gemini-3-pro-image-preview
Google
Contexte66K
PAR IMG$0.1340/image
Conçu pour la génération et l'édition d'images, avec une compréhension multimodale, des modifications conversationnelles et un prototypage visuel plus rapides que les fonctionnalités d'image Gemini antérieures. Comparé à GPT Image, Qwen Image et Seedream, il est utile pour combiner des documents, des images et des invites dans un seul flux de travail visuel.
Type d'entrée:
Type de sortie:
ReasoningMultimodal Output
Claude
claude-opus-4-5
Anthropic
Contexte200K
Entrée$5.0000/M
Sortie$25.0000/M
Destiné au raisonnement phare et aux tâches complexes des agents, il va plus loin que les versions en précommande de la série Claude 4 en termes de contexte long, de code, d'utilisation des outils et de planification complexe ; par rapport aux modèles phares tels que GPT, Gemini et Qwen, il est plus adapté aux agents de haute fiabilité, à la maintenance de la base de code et aux flux de travail de recherche approfondis.
Type d'entrée:
Type de sortie:
ReasoningTool UseStructured OutputLong Context
Gemini
veo3.1-lite
Google
PAR APPEL$0.1100/call
Conçu pour la génération vidéo haute fidélité, avec un flux de travail d'audio natif, de contrôle de caméra et d'entrée de référence plus mature que celui du Veo 2/3. Comparé à Kling, Runway et Seedance, il est mieux adapté aux courts métrages cinématographiques, aux storyboards publicitaires et aux vidéos nécessitant un mouvement physique stable. Le niveau Lite privilégie les brouillons à haut débit et à moindre coût par rapport au niveau standard.
Type d'entrée:
Type de sortie:
Multimodal Output
Gemini
veo3.1-fast
Google
PAR APPEL$0.2211/call
Conçu pour la génération vidéo haute fidélité, avec un flux de travail d'audio natif, de contrôle de caméra et d'entrée de référence plus mature que celui du Veo 2/3. Comparé à Kling, Runway et Seedance, il est mieux adapté aux courts métrages cinématographiques, aux storyboards publicitaires et aux vidéos nécessitant un mouvement physique stable. Le niveau Rapide est meilleur pour une validation rapide du concept que le niveau standard.
Type d'entrée:
Type de sortie:
Multimodal Output
Gemini
veo3.1
Google
PAR APPEL$1.6544/call
Conçu pour la génération vidéo haute fidélité, avec un flux de travail d'audio natif, de contrôle de caméra et d'entrée de référence plus mature que celui du Veo 2/3. Comparé à Kling, Runway et Seedance, il est mieux adapté aux courts métrages cinématographiques, aux storyboards publicitaires et aux vidéos nécessitant un mouvement physique stable.
Type d'entrée:
Type de sortie:
Multimodal Output
Gemini
gemini-2.5-flash-image
Google
Contexte66K
PAR IMG$0.0585/image
Conçu pour la génération et l'édition d'images, avec une compréhension multimodale, des modifications conversationnelles et un prototypage visuel plus rapides que les fonctionnalités d'image Gemini antérieures. Comparé à GPT Image, Qwen Image et Seedream, il est utile pour combiner des documents, des images et des invites dans un seul flux de travail visuel.
Type d'entrée:
Type de sortie:
Structured OutputMultimodal Output
Claude
claude-haiku-4-5
Anthropic
Contexte200K
Entrée
$0.3400/M$1.0000/M
Sortie
$1.7000/M$5.0000/M
Pour des tâches de codage et d'agent efficaces, il va plus loin que Claude Haiku 3.5 en termes de contexte long, de code, d'utilisation d'outils et de planification complexe ; par rapport aux modèles phares tels que GPT, Gemini et Qwen, il est plus adapté aux agents de haute fiabilité, à la maintenance de la base de code et aux flux de travail de recherche approfondis.
Type d'entrée:
Type de sortie:
ReasoningTool UseStructured OutputLong Context
Gemini
gemini-3.6-flash
Google
Entrée$1.5000/M
Sortie$7.5000/M
Gemini
gemini-3.5-flash-lite
Google
Entrée$0.3000/M
Sortie$2.5000/M
Gemini
gemini-3.1-flash-lite-image
Google
PAR APPEL
$0.0120/call$0.0200/call
Gemini
gemini-3.1-flash-image
Google
PAR IMG
$0.0198/image$0.0330/image
Gemini
gemini-3-pro-image
Google
PAR IMG
$0.0318/image$0.0530/image
Claude
claude-opus-5
Anthropic
Entrée
$1.7000/M$5.0000/M
Sortie
$8.5000/M$25.0000/M
Claude
claude-opus-4-7-thinking
Anthropic
Contexte1M
Entrée$5.0000/M
Sortie$25.0000/M
Pour le raisonnement phare et les tâches complexes des agents, il va plus loin que Claude Opus 4.6 en termes de contexte long, de code, d'utilisation des outils et de planification complexe ; par rapport aux modèles phares tels que GPT, Gemini et Qwen, il est plus adapté aux agents de haute fiabilité, à la maintenance de la base de code et aux flux de travail de recherche approfondis.
Type d'entrée:
Type de sortie:
ReasoningTool UseStructured OutputLong Context
Doubao
doubao-seedream-5-0-pro
Doubao
PAR SEC$0.0450/s
Un modèle de génération d'images multimodal pour la création visuelle professionnelle. Il peut générer des images à partir de texte et effectuer des modifications précises avec des images de référence et des annotations spatiales, avec des atouts en matière d'infographie dense, de typographie, d'éclairage réaliste et de rendu de texte multilingue.
Type d'entrée:
Type de sortie:
ReasoningMultimodal Output
Doubao
doubao-seedance-2.5
Doubao
Entrée
$3.4200/M$3.6000/M
Sortie
$3.4200/M$3.6000/M
Conçu pour le travail vidéo professionnel tel que les publicités, le contenu de marque et les courts métrages narratifs, en mettant l'accent sur les scènes plus longues, la direction multi-actifs et le raffinement itératif. Il prend en charge la génération basée sur le texte et les images ainsi que le contrôle de référence R2V, combine des ressources multimodales, produit jusqu'à 30 secondes en mode standard et peut réviser les régions sélectionnées sans régénérer le clip complet. Les principales raisons de le choisir par rapport à Seedance 2.0 sont des prises de vue continues plus longues, une entrée de référence plus riche et des correctifs post-génération plus contrôlables.
Doubao
doubao-seed-2-0-pro
Doubao
Contexte256K
Entrée$0.5000/M
Sortie$2.5300/M
Conçu pour le codage, les agents et les tâches de productivité complexes, dépassant Doubao Seed 2.0 dans un contexte long, une sortie longue et des flux de travail orientés outils. Comparé aux pairs de Qwen, GLM et DeepSeek, il s'agit d'une option rentable pour le travail de bureau chinois, le codage et l'automatisation en plusieurs étapes.
Type d'entrée:
Type de sortie:
ReasoningWeb SearchTool UseFunction CallingStructured OutputLong Context
Qwen
qwen3.7-plus
Qwen
Contexte1M
Entrée
$0.2400/M$0.3000/M
Sortie
$0.9600/M$1.2000/M
Conçu pour les charges de travail agents, le codage et la productivité bureautique, avec un accent combiné plus fort sur le contexte long, les appels d'outils et la sortie structurée que Qwen3.6. Comparé aux modèles phares tels que GPT, Claude et Gemini, il s'agit d'une alternative rentable pour les flux de travail en chinois, en codage et en outils en plusieurs étapes.
Type d'entrée:
Type de sortie:
ReasoningTool UseFunction CallingStructured OutputLong Context
Qwen
qwen3.6-plus
Qwen
Contexte1M
Entrée
$0.9120/M$1.1400/M
Sortie
$5.4880/M$6.8599/M
Conçu pour les charges de travail agents, le codage et la productivité bureautique, avec un accent combiné plus fort sur le contexte long, les appels d'outils et la sortie structurée que Qwen3.5. Comparé aux modèles phares tels que GPT, Claude et Gemini, il s'agit d'une alternative rentable pour les flux de travail en chinois, en codage et en outils en plusieurs étapes.
Type d'entrée:
Type de sortie:
ReasoningTool UseStructured OutputLong Context
Qwen
qwen3.6-flash
Qwen
Contexte1M
Entrée$0.1785/M
Sortie$1.0605/M
Conçu pour les charges de travail agents, le codage et la productivité bureautique, avec un accent combiné plus fort sur le contexte long, les appels d'outils et la sortie structurée que Qwen3.5. Comparé aux modèles phares tels que GPT, Claude et Gemini, il s'agit d'une alternative rentable pour les flux de travail en chinois, en codage et en outils en plusieurs étapes.
Type d'entrée:
Type de sortie:
ReasoningTool UseStructured OutputLong Context
Qwen
qwen-image-2.0-pro
Qwen
Entrée$2.2000/M
Sortie$2.2000/M
Conçu pour la génération et l'édition d'images, améliorant par rapport à Qwen Image 1.x le rendu du texte chinois, le suivi des instructions et les mises en page complexes. Comparé à GPT Image, aux modèles d'images Gemini et à Seedream, il est bien adapté aux affiches chinoises, aux images de commerce électronique, aux infographies et à la création visuelle itérative.
Type d'entrée:
Type de sortie:
Multimodal Output
Qwen
qwen-image-2.0
Qwen
Entrée$2.2000/M
Sortie$2.2000/M
Conçu pour la génération et l'édition d'images, améliorant par rapport à Qwen Image 1.x le rendu du texte chinois, le suivi des instructions et les mises en page complexes. Comparé à GPT Image, aux modèles d'images Gemini et à Seedream, il est bien adapté aux affiches chinoises, aux images de commerce électronique, aux infographies et à la création visuelle itérative.
Type d'entrée:
Type de sortie:
Multimodal Output
Minimax
MiniMax-H3
MiniMax
PAR SEC$0.0800/s
XiaomiMiMo
mimo-v2.5-pro
Xiaomi MiMo
Contexte1M
Entrée$1.1700/M
Sortie$3.5000/M
Conçu pour les agents, le codage et les tâches à long contexte, offrant une compréhension multimodale plus complète, une fenêtre contextuelle d'un million de jetons et un raisonnement à long terme que MiMo V2. Par rapport à ses pairs chinois tels que Qwen, GLM et DeepSeek, ses atouts résident dans l'adéquation à l'écosystème Xiaomi et les scénarios d'automatisation de l'ingénierie.
Type d'entrée:
Type de sortie:
ReasoningTool UseStructured OutputLong Context
XiaomiMiMo
mimo-v2.5
Xiaomi MiMo
Contexte1M
Entrée$0.4700/M
Sortie$2.3600/M
Conçu pour les agents, le codage et les tâches à long contexte, offrant une compréhension multimodale plus complète, une fenêtre contextuelle d'un million de jetons et un raisonnement à long terme que MiMo V2. Par rapport à ses pairs chinois tels que Qwen, GLM et DeepSeek, ses atouts résident dans l'adéquation à l'écosystème Xiaomi et les scénarios d'automatisation de l'ingénierie.
Type d'entrée:
Type de sortie:
ReasoningTool UseStructured OutputLong Context
MoonshotAI
kimi-k2.7-code-highspeed
Moonshot
Contexte256K
Entrée$1.9000/M
Sortie$7.9999/M
Conçu pour une utilisation d'outils en plusieurs étapes et dans un contexte long, ainsi que pour les flux de travail de code/document, avec une stabilité des tâches d'ingénierie et une capacité de contexte plus élevées que Kimi K2.6. Comparé à Qwen, GLM et DeepSeek, il est bien adapté à l'analyse de documents longs en chinois, aux questions et réponses sur les projets et à la programmation agent quotidienne.
Type d'entrée:
Type de sortie:
Tool UseFunction CallingStructured OutputLong Context
Grok
grok-4.3
xAI
Contexte1M
Entrée$1.3100/M
Sortie$2.6200/M
Conçu pour le raisonnement en temps réel, le codage et les tâches à contexte long, avec une gestion de contexte long plus efficace et des réponses rapides que les versions précédentes de Grok 4.x. Comparé à GPT, Claude et Gemini, il est utile pour l'analyse des tendances, l'assistance au codage et les flux de travail d'informations connectées dans l'écosystème xAI.
Type d'entrée:
Type de sortie:
ReasoningTool UseStructured OutputLong Context
Zhipu
glm-image
Zhipu AI
Entrée$0.8800/M
Sortie$3.5500/M
Conçu pour la génération et l'édition d'images, avec une concentration plus forte que les capacités de vision GLM antérieures sur les invites chinoises, la compréhension du texte image et la génération contrôlable. Comparé à GPT Image, aux modèles d'image Gemini et à Qwen Image, il s'adapte aux actifs marketing chinois, aux visuels explicatifs et aux modifications visuelles itératives.
Type d'entrée:
Type de sortie:
Multimodal Output
Doubao
dreamina-seedance-2-0-mini
Doubao
Entrée$75.0000/M
Sortie$75.0000/M
Un niveau Seedance 2.0 plus léger pour la création vidéo, utile pour transformer rapidement du texte ou des images de référence en courtes ressources vidéo pour les brouillons sociaux, de commerce électronique et créatifs. Il est orienté vers une itération et une production d’actifs rapides ; examinez le mouvement, le comportement de la caméra et la cohérence du sujet avant la sélection finale.
Type d'entrée:
Type de sortie:
Multimodal Output
DeepSeek
deepseek-v4-flash-vision-exp
DeepSeek
Entrée$0.1490/M
Sortie$0.2980/M
An experimental multimodal variant of DeepSeek-V4-Flash for image understanding alongside text. A practical choice for visual Q&A, screenshot and document analysis, while its experimental status makes it better suited to evaluation and flexible workflows than strict production-critical paths.
DeepSeek
deepseek-v3.2
DeepSeek
Entrée$0.2100/M
Sortie$0.3200/M
Conçu pour le raisonnement, le codage et l'utilisation d'outils agentiques, avec une exécution de contexte long, de mode de réflexion et de tâches complexes plus puissante que DeepSeek V3.1. Comparé à ses pairs chinois tels que Qwen, GLM et Kimi, il est particulièrement compétitif pour les tâches de mathématiques, de programmation et de raisonnement logique.
Type d'entrée:
Type de sortie:
ReasoningTool Use
WhatsApp