Claude
Contexte1M
Entrée
$0.1700/M$0.5000/M
Sortie
$0.8500/M$2.5000/M
The Claude option for high-volume, latency-sensitive work such as classification, extraction, routing, and subagent tasks. Compared with Haiku 4.5, it expands the context window to 1M tokens and adds adaptive thinking; consider Sonnet or Opus for harder work.
Type d'entrée:
Type de sortie:
ReasoningTool UseStructured OutputLong Context
Essayer le modèle
Contexte131K
PAR SEC$0.0530/s
A fast choice for image creation and conversational editing. Compared with Nano Banana 2, it improves visual quality, text and infographic layout, wide-format images, and character consistency across edits. It supports multiple reference images and 1K, 2K, or 4K output; consider Nano Banana Pro for the most demanding brand and precision work.
Type d'entrée:
Type de sortie:
ReasoningWeb SearchLong ContextMultimodal Output
OpenAI
Contexte1.05M
Entrée
$0.4000/M$2.0000/M
Sortie
$2.0000/M$10.0000/M
For complex coding, computer use, and professional document work. It improves on GPT-6 Sol in demanding tasks and approaches Astra at a lower cost; choose Astra when maximum quality is the priority.
Type d'entrée:
Type de sortie:
ReasoningWeb SearchTool UseFunction CallingStructured OutputLong ContextCode Execution
Essayer le modèle
Claude
Contexte1M
Entrée
$0.6800/M$2.0000/M
Sortie
$3.4000/M$10.0000/M
A strong workhorse balancing speed and intelligence: a 1M-token context window, text and image input, text output, adaptive thinking, and tool use for project-level coding, multi-step tasks, and knowledge work. Its main advantage over Sonnet 5 is faster, more token-efficient execution; choose Opus 5.5 when maximum quality for harder tasks matters more.
Type d'entrée:
Type de sortie:
ReasoningTool UseLong Context
Essayer le modèle
Claude
Contexte1M
Entrée
$1.3600/M$4.0000/M
Sortie
$6.8000/M$20.0000/M
Built for long-running agentic coding and knowledge work, especially cross-file refactors, codebase audits, and complex multi-step tasks. Its 1M-token context, always-on adaptive thinking, and text/image input favor high-quality long-horizon execution; compared with Sonnet 5, it prioritizes depth at higher cost and latency.
Type d'entrée:
Type de sortie:
ReasoningTool UseLong Context
Essayer le modèle
OpenAI
OpenAI
Contexte1.05M
Entrée
$0.4000/M$2.0000/M
Sortie
$2.0000/M$10.0000/M
Built for complex coding and agentic workflows, including project-level programming, long-horizon planning, and multi-step tool use. Its 1.05M-token context, text/image input, reasoning, function calling, and structured outputs make it the workhorse choice; it costs more than GPT-6 Luna when quality and execution stability matter most.
Type d'entrée:
Type de sortie:
ReasoningWeb SearchTool UseFunction CallingStructured OutputLong ContextCode Execution
Essayer le modèle
OpenAI
Contexte1.05M
Entrée
$0.0200/M$0.1000/M
Sortie
$0.1000/M$0.5000/M
Designed for focused, high-volume work such as batch summarization, classification, rewriting, and frequent agent calls. It still offers a 1.05M-token context, text/image input, reasoning, function calling, and structured outputs, but trades depth for much lower cost; prefer GPT-6 Sol for the hardest long-horizon tasks.
Type d'entrée:
Type de sortie:
ReasoningWeb SearchTool UseFunction CallingStructured OutputLong ContextCode Execution
Essayer le modèle
DeepSeek
Contexte1M
Entrée
$0.2700/M$0.3000/M
Sortie
$1.0800/M$1.2000/M
A strong high-throughput, lower-cost default for general and agentic work: it natively understands images and supports a 1M-token context, optional thinking and non-thinking modes, tool calls, and JSON output. Compared with the higher-tier V4 Pro, it is positioned around speed, throughput, and cost efficiency, making it practical for long documents, coding/agents, and image-text analysis; enable thinking when deeper reasoning is needed.
Type d'entrée:
Type de sortie:
ReasoningTool UseStructured OutputLong Context
Essayer le modèle
Contexte400K
PAR IMG$0.0080/image
The discounted-price route for GPT Image 2.5 Sunburst, mapped by the current channel to Sunburst. Sale indicates a special-price route and does not change Sunbursts role in high-precision image generation and editing. Best for cost-sensitive professional visual work that still needs reference-image editing and detail control; use regular gpt-image-2.5-sunburst when you want the standard route.
Type d'entrée:
Type de sortie:
Multimodal OutputLong Context
Essayer le modèle
Contexte400K
PAR IMG
$0.0336/image$0.0480/image
Built for premium visual workflows where editing precision and finished-image quality matter most: a better fit for production campaign creative, polished product imagery, and multi-turn edits that need to preserve the subject, composition, and visual treatment. It accepts text and reference-image inputs and produces images, with longer generation times than Flare.
Type d'entrée:
Type de sortie:
Multimodal OutputLong Context
Essayer le modèle
Contexte400K
PAR IMG$0.0080/image
The discounted-price route for GPT Image 2.5 Flare, mapped by the current channel to Flare. Sale indicates a special-price route and does not change Flares role in fast, high-quality everyday image generation and editing. Best for cost-sensitive, frequent image tasks; use regular gpt-image-2.5-flare when you want the standard route.
Type d'entrée:
Type de sortie:
Multimodal OutputLong Context
Essayer le modèle
Contexte400K
PAR IMG
$0.0336/image$0.0480/image
A strong default for high-quality image generation and editing: optimized for faster iteration across creator and social content, product experiences, visual search, rapid prototyping, and high-volume generation. It accepts text and reference-image inputs and produces images; choose Sunburst when tighter editing control matters more than speed.
Type d'entrée:
Type de sortie:
Multimodal OutputLong Context
Essayer le modèle
OpenAI
Contexte1.05M
Entrée
$2.0000/M$10.0000/M
Sortie
$10.0000/M$50.0000/M
A flagship end-to-end model for complex reasoning, software engineering, computer use, deep research, and document work. It offers about a 1.05M-token context window, accepts text, images, and documents, returns text, and supports reasoning, search, function calling, structured outputs, code execution, and tool orchestration. Choose it over lower-tier models for long-horizon task quality and execution stability, with higher usage cost as the trade-off.
Type d'entrée:
Type de sortie:
ReasoningWeb SearchTool UseFunction CallingStructured OutputLong ContextCode Execution
Essayer le modèle
Gemini
Contexte1.05M
Entrée$0.7874/M
Sortie$3.9370/M
The flagship Flash model for long-horizon software engineering, autonomous agents, and complex enterprise workflows. It keeps the speed and cost profile of Flash while adding stronger reasoning and tool orchestration. It accepts text, images, video, audio, and PDF input, with about a 1.05M-token context window, search grounding, function calling, code execution, structured outputs, and tunable thinking. Prefer it over Flash-Lite for harder tasks, at higher usage cost.
Type d'entrée:
Type de sortie:
ReasoningWeb SearchTool UseFunction CallingStructured OutputLong ContextCode Execution
Essayer le modèle
Claude
Contexte1M
Entrée
$3.4000/M$10.0000/M
Sortie
$17.0000/M$50.0000/M
A flagship long-context model for demanding, long-running knowledge work, coding projects, and multi-step agentic tasks. It accepts text, images, and PDFs, making it a strong fit for cross-file analysis, complex research, and sustained tool use. It prioritizes reasoning depth and long-horizon execution over speed and cost, so it is best reserved for tasks where reliable completion matters.
Type d'entrée:
Type de sortie:
ReasoningWeb SearchTool UseFunction CallingLong Context
Essayer le modèle
Contexte1M
Entrée$0.1492/M
Sortie$0.4476/M
An efficient multimodal workhorse in the Qwen family, with a native million-token context window and strong support for coding assistance, agentic workflows, and visual understanding such as charts. It fits long documents, codebases, high-concurrency applications, and tool-assisted tasks.
Type d'entrée:
Type de sortie:
ReasoningTool UseStructured OutputLong Context
Essayer le modèle
Zhipu
Contexte1.31M
Entrée$0.1190/M
Sortie$0.4200/M
The efficiency-focused Flash model in the GLM-5 family, with native multimodal support and a design aimed at long-context, high-frequency execution. It is a strong fit for coding, agentic workflows, and complex tasks that require image-and-text understanding, especially when production cost matters.
Type d'entrée:
Type de sortie:
ReasoningTool UseStructured OutputLong Context
Essayer le modèle
Contexte1.05M
Entrée$0.1490/M
Sortie$0.2980/M
An experimental multimodal variant of DeepSeek-V4-Flash for image understanding alongside text. A practical choice for visual Q&A, screenshot and document analysis, while its experimental status makes it better suited to evaluation and flexible workflows than strict production-critical paths.
Type d'entrée:
Type de sortie:
ReasoningTool UseLong Context
Essayer le modèle
PAR SEC$0.0675/s
The speed-first variant of Alibaba's Wan 3.0 line (early access). It shortens generation latency while retaining high-quality video output, making it a good fit for low-latency previews, batch drafts and fast-iterating short-video workflows. If ultimate visual control matters more than speed, the standard version is a better choice.
Type d'entrée:
Type de sortie:
Multimodal Output
Essayer le modèle
Zhipu
Zhipu AI
Contexte1M
Entrée
$1.0115/M$1.1900/M
Sortie
$3.5275/M$4.1500/M
A flagship workhorse for complex software engineering and long-horizon agent tasks. It uses the same base model as GLM-5.2, with improvements driven by post-training, delivering a 50% gain on Z.ai Code Bench alongside stronger terminal-operation and vulnerability-discovery capabilities. It offers a 1M-token context window, up to 128K output, always-on reasoning with low, high, and max effort levels, function calling, and structured outputs. It currently accepts text only and is not intended for tasks requiring visual understanding.
Type d'entrée:
Type de sortie:
ReasoningTool UseFunction CallingStructured OutputLong Context
Essayer le modèle
Gemini
Contexte1.05M
Entrée$0.0000/M
Sortie$0.0000/M
Free models are for learning and trial purposes only and may be removed at any time. Premium models have limited quotas with 5 requests per minute, and their availability is not guaranteed.
Type d'entrée:
Type de sortie:
ReasoningTool UseLong Context
Essayer le modèle
Gemini
Contexte1.05M
Entrée$0.7500/M
Sortie$3.7500/M
A new fast multimodal model in the Gemini 3 family, released in August 2026, built for low-cost, high-throughput multimodal understanding. It accepts text, image, video, audio and document inputs with a 1M-token context, suited to large-scale processing, batch workloads and real-time interactions.
Type d'entrée:
Type de sortie:
ReasoningTool UseLong Context
Essayer le modèle
Grok
Contexte500K
Entrée$0.8400/M
Sortie$2.5200/M
A flagship general-purpose model for high-quality coding, agentic execution, and knowledge work. It fits tasks that need sustained planning, tool collaboration, and complex problem solving; for simple calls where latency or cost matters most, choose a lighter model.
Type d'entrée:
Type de sortie:
ReasoningTool UseStructured OutputLong Context
Essayer le modèle
Qwen
PAR SEC$0.0450/s
The standard video generation model of Alibaba's Wan 3.0 line (early access). It supports text-to-video, image-to-video and multi-modal reference inputs, generating clips up to roughly 30 seconds with synchronized audio in a single pass — suitable for ads, short drama and narrative content. Official release date not yet announced.
Type d'entrée:
Type de sortie:
Multimodal Output
Qwen
Contexte1M
Entrée
$1.4200/M$1.7750/M
Sortie
$4.2640/M$5.3300/M
Qwen's most capable flagship multimodal reasoning model, built for long-horizon coding, professional work, and multi-stage agent tasks. It accepts text, images, and video, offers a 1M-token context window with up to 128K output, and supports function calling, structured outputs, web search, and a code interpreter. It is best used as a high-quality workhorse for complex tasks rather than for the lowest-cost, lowest-latency batch workloads.
Type d'entrée:
Type de sortie:
ReasoningWeb SearchTool UseFunction CallingStructured OutputLong ContextCode Execution
Essayer le modèle
Entrée
$3.0865/M$3.2490/M
Sortie
$3.0865/M$3.2490/M
A better fit for moving from a single clip toward a complete audiovisual story: it can generate up to 30 seconds in one pass, supports multiple extensions, accepts image, video, and audio references, and adds timestamp-level editing, green-screen, and camera control. It suits ads and short films that need continuity, while complex multi-subject motion still deserves human review.
Type d'entrée:
Type de sortie:
Multimodal Output
Essayer le modèle
Minimax
MiniMax
PAR SEC$0.0800/s
An omni-modal video generation model that can combine text with image, video, and audio references to create video assets with synchronized audio. It is suited to short-form video, advertising, and reference-driven character or camera work; it is not a general chat model, so prioritize visual consistency, motion, and audio-visual quality.
Type d'entrée:
Type de sortie:
Multimodal Output
Entrée$3.3042/M
Sortie$3.3042/M
A route variant of Seedance 2.5; evaluate it by the underlying model rather than the route suffix. It is suited to ads, branded content, and narrative shorts, with up to 30-second audio-video generation, multi-round extension, text/image/audio/video references, R2V control, and timestamp-level editing. Complex motion and multi-subject physical consistency still benefit from human review.
Type d'entrée:
Type de sortie:
Multimodal Output
Essayer le modèle
Claude
Anthropic
Contexte1M
Entrée
$1.7000/M$5.0000/M
Sortie
$8.5000/M$25.0000/M
A premium model for complex agentic coding and enterprise knowledge work, emphasizing long-horizon planning, sustained execution, self-checking, and reliable delivery. With a million-token context window, it is suited to large codebases, complex documents, and multi-step projects that need limited human oversight.
Type d'entrée:
Type de sortie:
ReasoningTool UseStructured OutputLong Context
Essayer le modèle
Contexte1.05M
Entrée$0.3000/M
Sortie$2.5000/M
The fastest and most cost-effective model in the Gemini 3.5 line, built for high-throughput, low-latency work such as translation, classification, document processing, and lightweight agentic workflows. It supports multimodal inputs and up to a 1M-token context, while demanding reasoning, long-horizon planning, or high-quality code changes are better handled by a higher-tier Flash model.
Type d'entrée:
Type de sortie:
Long Context
Essayer le modèle
PAR SEC
$0.0024/s$0.0030/s
A quality-first image generation and editing model: it supports text-to-image and edits from 1–3 reference images, accepts prompts of up to about 4.5K tokens, and is aimed at dense layouts, fine 10px-scale text, 12 languages, and multiple fonts. Choose it over the standard variant when complex composition and detail fidelity matter more than speed or cost; use the standard variant for a faster, more economical workflow.
Type d'entrée:
Type de sortie:
PAR SEC
$0.0024/s$0.0030/s
The balanced standard tier of Qwen-Image 3.0 for image generation and editing: it supports text-to-image and edits from 1–3 reference images, prompts of up to about 4.5K tokens, up to six outputs, and 2K-class resolution. It fits everyday posters, interfaces, infographics, and repeated creative work; move to Pro when complex layouts and fine text fidelity matter more, and use this tier when speed and cost efficiency are the priority.
Type d'entrée:
Type de sortie:
MoonshotAI
Moonshot
Contexte1.05M
Entrée
$2.7000/M$3.0000/M
Sortie
$13.5000/M$15.0000/M
Modèle phare Moonshot avec vision native et fenêtre contextuelle jusqu'à 1 million de jetons. Il fonctionne actuellement avec un effort de raisonnement maximal et convient au codage à long terme, au travail de connaissances et aux tâches complexes qui coordonnent les outils des terminaux. Pour une utilisation stable, conservez l'historique complet du raisonnement et démarrez une nouvelle session dans un harnais d'agent compatible.
Type d'entrée:
Type de sortie:
ReasoningTool UseLong Context
Essayer le modèle
OpenAI
Contexte1.05M
Entrée
$0.4000/M$2.0000/M
Sortie
$2.4000/M$12.0000/M
The balanced workhorse tier of GPT-5.6, combining capability and cost. Well suited to production work involving image understanding, tool use, and large source material; choose Sol for the hardest quality-first work or Luna for cost-controlled high volume.
Type d'entrée:
Type de sortie:
ReasoningFunction CallingStructured OutputLong Context
Essayer le modèle
OpenAI
Contexte1.05M
Entrée
$1.0000/M$5.0000/M
Sortie
$6.0000/M$30.0000/M
The flagship GPT-5.6 tier for complex professional work and quality-first delivery. It supports image input, function calling, structured outputs, and an exceptionally large context window; consider Terra or Luna when latency or unit cost is the primary constraint.
Type d'entrée:
Type de sortie:
ReasoningFunction CallingStructured OutputLong Context
Essayer le modèle
OpenAI
Contexte1.05M
Entrée$0.2000/M
Sortie$1.2000/M
The cost-sensitive, high-volume tier of GPT-5.6. A good fit for summarization, classification, rewriting, and batch automation; choose the Sol sibling for complex professional judgment or quality-first multi-step work.
Type d'entrée:
Type de sortie:
ReasoningFunction CallingStructured OutputLong Context
Essayer le modèle
PAR SEC$0.0450/s
Un modèle de génération d'images multimodal pour la création visuelle professionnelle. Il peut générer des images à partir de texte et effectuer des modifications précises avec des images de référence et des annotations spatiales, avec des atouts en matière d'infographie dense, de typographie, d'éclairage réaliste et de rendu de texte multilingue.
Type d'entrée:
Type de sortie:
ReasoningMultimodal Output
Essayer le modèle
Grok
Contexte500K
Entrée$2.1000/M
Sortie$6.3000/M
Un modèle de raisonnement frontalier pour le codage, le travail de connaissances et les tâches STEM. Il prend en charge l'entrée d'image, l'appel de fonction et les sorties structurées ; son contexte de 500 000 jetons convient à l'analyse multi-fichiers et aux sources longues. Préférez un modèle à moindre coût lorsque le raisonnement frontalier n’est pas nécessaire.
Type d'entrée:
Type de sortie:
ReasoningFunction CallingStructured OutputLong Context
Essayer le modèle
Claude
Contexte1M
Entrée
$3.4000/M$10.0000/M
Sortie
$17.0000/M$50.0000/M
Le modèle Anthropic le plus performant et largement diffusé, conçu pour le raisonnement les plus exigeants et le travail agent à long terme. Offre une fenêtre contextuelle de 1 million de jetons avec une sortie maximale de 128 000 et une pensée adaptative permanente, excellant dans l'exploration autonome de tâches sous-spécifiées, la planification et la poursuite du codage de longue durée et de l'orchestration multi-agents avant de nécessiter une intervention humaine.
Type d'entrée:
Type de sortie:
ReasoningTool UseStructured OutputLong Context
Essayer le modèle
Claude
Contexte1M
Entrée
$0.6800/M$2.0000/M
Sortie
$3.4000/M$10.0000/M
Un modèle de niveau Sonnet à pilote quotidien visant à apporter des capacités d'agent, de codage et de travail de connaissances proches des frontières à un coût d'exploitation inférieur. Son contexte de jeton 1M par défaut et sa pensée adaptative s'adaptent aux longs documents, aux bases de code et aux flux de travail d'outils en plusieurs étapes ; pour le raisonnement le plus approfondi ou les travaux de sécurité restreints à haut risque, évaluez des modèles de niveau supérieur ou spécialisés.
Type d'entrée:
Type de sortie:
ReasoningTool UseStructured OutputLong Context
Essayer le modèle
Contexte256K
Entrée$0.9700/M
Sortie$4.8800/M
Conçu pour le codage, les agents et les tâches de productivité complexes, dépassant Doubao Seed 2.0 dans un contexte long, une sortie longue et des flux de travail orientés outils. Comparé aux pairs de Qwen, GLM et DeepSeek, il s'agit d'une option rentable pour le travail de bureau chinois, le codage et l'automatisation en plusieurs étapes.
Type d'entrée:
Type de sortie:
ReasoningTool UseFunction CallingStructured OutputLong Context
Essayer le modèle
PAR SEC$0.1350/s
Conçu pour la conversion texte-vidéo, avec un flux de travail audio natif plus puissant que HappyHorse 1.0, générant des dialogues, des effets sonores et une musique de fond en un seul passage. Par rapport à Veo, Kling et Runway, son différenciateur réside dans la génération audiovisuelle synchronisée et les flux de travail cohérents avec les personnages pour les courts métrages, les publicités, le commerce électronique et le marketing de marque.
Type d'entrée:
Type de sortie:
Multimodal Output
PAR SEC$0.1350/s
Conçu pour la référence à la vidéo, avec un flux de travail audio natif plus puissant que HappyHorse 1.0, générant des dialogues, des effets sonores et une musique de fond en un seul passage. Par rapport à Veo, Kling et Runway, son différenciateur réside dans la génération audiovisuelle synchronisée et les flux de travail cohérents avec les personnages pour les courts métrages, les publicités, le commerce électronique et le marketing de marque.
Type d'entrée:
Type de sortie:
Multimodal Output
PAR SEC$0.1350/s
Conçu pour la conversion d'image en vidéo, avec un flux de travail audio natif plus puissant que HappyHorse 1.0, générant des dialogues, des effets sonores et une musique de fond en un seul passage. Par rapport à Veo, Kling et Runway, son différenciateur réside dans la génération audiovisuelle synchronisée et les flux de travail cohérents avec les personnages pour les courts métrages, les publicités, le commerce électronique et le marketing de marque.
Type d'entrée:
Type de sortie:
Multimodal Output
Entrée$0.6300/M
Sortie$0.6300/M
Conçu pour la génération vidéo et la création vidéo multi-actifs, améliorant Seedance 1.x avec une stabilité de mouvement, une génération audiovisuelle et des entrées de référence plus complètes. Comparé à Veo, Kling et Runway, il est mieux adapté aux flux de travail créatifs chinois pilotés par des entrées mixtes de texte, d'image, d'audio et de vidéo. Cette variante sans filtre conserve le même niveau de capacité de génération que Seedance 2.0 standard tout en appliquant un filtrage de contenu plus souple. Utile pour les courts métrages dramatiques, les publicités, le commerce électronique et les ressources sociales.
Type d'entrée:
Type de sortie:
Multimodal Output
Essayer le modèle
Zhipu
Zhipu AI
Contexte1M
Entrée
$0.9690/M$1.1400/M
Sortie
$3.4000/M$4.0000/M
Conçu pour le raisonnement, le codage et les tâches d'agent à contexte long, améliorant par rapport à GLM-5.1 en termes de longueur de contexte, d'utilisation des outils et de flux de travail complexes en plusieurs étapes. Comparé à ses homologues chinois phares tels que Qwen, DeepSeek et Kimi, il s'adapte à l'automatisation d'entreprise, à l'analyse de code au niveau du projet et au travail de connaissances en chinois.
Type d'entrée:
Type de sortie:
ReasoningTool UseFunction CallingStructured OutputLong Context
Essayer le modèle
MoonshotAI
Contexte256K
Entrée$1.9000/M
Sortie$7.9999/M
Conçu pour une utilisation d'outils en plusieurs étapes et dans un contexte long, ainsi que pour les flux de travail de code/document, avec une stabilité des tâches d'ingénierie et une capacité de contexte plus élevées que Kimi K2.6. Comparé à Qwen, GLM et DeepSeek, il est bien adapté à l'analyse de documents longs en chinois, aux questions et réponses sur les projets et à la programmation agent quotidienne.
Type d'entrée:
Type de sortie:
Tool UseFunction CallingStructured OutputLong Context
Essayer le modèle
MoonshotAI
Contexte256K
Entrée
$0.8775/M$0.9750/M
Sortie
$3.6450/M$4.0500/M
Conçu pour une utilisation d'outils en plusieurs étapes et dans un contexte long, ainsi que pour les flux de travail de code/document, avec une stabilité des tâches d'ingénierie et une capacité de contexte plus élevées que Kimi K2.6. Comparé à Qwen, GLM et DeepSeek, il est bien adapté à l'analyse de documents longs en chinois, aux questions et réponses sur les projets et à la programmation agent quotidienne.
Type d'entrée:
Type de sortie:
Tool UseFunction CallingStructured OutputLong Context
Essayer le modèle
PAR SEC$0.1400/s
Conçu pour la génération, l'édition et l'extension d'images/vidéos, avec une cohérence de mouvement plus forte et une production rapide de contenu social que Grok Imagine 1.0. Comparé à Veo, Kling et Runway, il s'adapte aux vidéos courtes, aux concepts publicitaires et aux actifs axés sur les tendances dans l'écosystème xAI.
Type d'entrée:
Type de sortie:
Multimodal Output
Qwen
Contexte1M
Entrée
$0.2400/M$0.3000/M
Sortie
$0.9600/M$1.2000/M
Conçu pour les charges de travail agents, le codage et la productivité bureautique, avec un accent combiné plus fort sur le contexte long, les appels d'outils et la sortie structurée que Qwen3.6. Comparé aux modèles phares tels que GPT, Claude et Gemini, il s'agit d'une alternative rentable pour les flux de travail en chinois, en codage et en outils en plusieurs étapes.
Type d'entrée:
Type de sortie:
ReasoningTool UseFunction CallingStructured OutputLong Context
Essayer le modèle
Minimax
Free channel
Contexte1M
Entrée$0.0000/M
Sortie$0.0000/M
Free models are for learning and trial purposes only and may be removed at any time. Premium models have limited quotas with 5 requests per minute, and their availability is not guaranteed.
Type d'entrée:
Type de sortie:
ReasoningTool UseFunction CallingStructured OutputLong Context
Essayer le modèle
Minimax
MiniMax
Contexte1M
Entrée$0.3150/M
Sortie$1.2600/M
Conçu pour le codage à long terme, l'utilisation d'outils et la collaboration de production multi-tours, s'étendant au-delà de MiniMax M2.7 avec des entrées multimodales tout en conservant une fenêtre contextuelle de 1 million de jetons. Par rapport aux modèles d'agents à contexte long Claude, Gemini et GLM-5.2, il est préférable de regrouper du texte, des images et des vidéos dans un seul flux de travail.
Type d'entrée:
Type de sortie:
ReasoningTool UseFunction CallingStructured OutputLong Context
Essayer le modèle
Claude
Contexte1M
Entrée
$1.7000/M$5.0000/M
Sortie
$8.5000/M$25.0000/M
Pour le raisonnement phare et les tâches complexes des agents, il va plus loin que Claude Opus 4.7 en termes de contexte long, de code, d'utilisation des outils et de planification complexe ; par rapport aux modèles phares tels que GPT, Gemini et Qwen, il est plus adapté aux agents de haute fiabilité, à la maintenance de la base de code et aux flux de travail de recherche approfondis.
Type d'entrée:
Type de sortie:
ReasoningTool UseStructured OutputLong Context
Essayer le modèle
Gemini
PAR SEC$0.2450/s
Conçu pour la création multimodale de n'importe quelle entrée dans la vidéo, en mettant davantage l'accent que les flux de travail vidéo Gemini précédents sur l'orchestration unifiée du texte, de l'image, de l'audio et du matériel vidéo. Par rapport à Veo, Kling et Runway, il est préférable d'intégrer des actifs multimodaux complexes dans un seul flux de travail créatif.
Type d'entrée:
Type de sortie:
Multimodal Output
Essayer le modèle
Qwen
Contexte1M
Entrée
$1.4400/M$1.8000/M
Sortie
$4.3200/M$5.4000/M
Conçu pour les charges de travail agents, le codage et la productivité bureautique, avec un accent combiné plus fort sur le contexte long, les appels d'outils et la sortie structurée que Qwen3.6. Comparé aux modèles phares tels que GPT, Claude et Gemini, il s'agit d'une alternative rentable pour les flux de travail en chinois, en codage et en outils en plusieurs étapes.
Type d'entrée:
Type de sortie:
ReasoningTool UseFunction CallingStructured OutputLong Context
Essayer le modèle
Contexte8K
PAR SEC$0.1350/s
Pour le montage vidéo, par rapport aux premiers modèles vidéo, il met davantage l'accent sur la génération audio native, complétant les dialogues, les effets sonores et la musique de fond en une seule fois ; par rapport à Veo, Kling et Runway, ses avantages différenciés résident dans la synchronisation sono-visuelle et dans le flux de travail de cohérence des personnages. Convient aux courtes dramatiques, aux publicités, aux vidéos de commerce électronique et de marketing de marque.
Type d'entrée:
Type de sortie:
Multimodal Output
Contexte8K
PAR SEC$0.1350/s
Pour les vidéos Wensheng, par rapport aux premiers modèles vidéo, l'accent est mis davantage sur la génération audio native, complétant simultanément les dialogues, les effets sonores et la musique de fond ; par rapport à Veo, Kling et Runway, ses avantages différenciés résident dans la synchronisation sono-visuelle et dans le flux de travail de cohérence des personnages. Convient aux courtes dramatiques, aux publicités, aux vidéos de commerce électronique et de marketing de marque.
Type d'entrée:
Type de sortie:
Multimodal Output
Contexte8K
PAR SEC$0.1350/s
La génération de vidéos à titre de référence, par rapport aux premiers modèles vidéo, est plus importante dans la génération audio native et complète les dialogues, les effets sonores et la musique de fond en une seule fois ; par rapport à Veo, Kling et Runway, ses avantages différenciés résident dans la synchronisation sono-visuelle et dans le flux de travail de cohérence des personnages. Convient aux courtes dramatiques, aux publicités, aux vidéos de commerce électronique et de marketing de marque.
Type d'entrée:
Type de sortie:
Multimodal Output
Contexte8K
PAR SEC$0.1350/s
Pour les vidéos Tusheng, par rapport aux premiers modèles vidéo, l'accent est mis davantage sur la génération audio native, complétant simultanément les dialogues, les effets sonores et la musique de fond ; par rapport à Veo, Kling et Runway, ses avantages différenciés résident dans la synchronisation sono-visuelle et dans le flux de travail de cohérence des personnages. Convient aux courtes dramatiques, aux publicités, aux vidéos de commerce électronique et de marketing de marque.
Type d'entrée:
Type de sortie:
Multimodal Output
DeepSeek
Contexte1M
Entrée
$1.5390/M$1.7100/M
Sortie
$3.0869/M$3.4299/M
Conçu pour le raisonnement, le codage et l'utilisation d'outils agentiques, avec une exécution de contexte long, de mode de réflexion et de tâches complexes plus puissante que DeepSeek V3.2. Comparé à ses pairs chinois tels que Qwen, GLM et Kimi, il est particulièrement compétitif pour les tâches de mathématiques, de programmation et de raisonnement logique.
Type d'entrée:
Type de sortie:
Long ContextTool UseReasoningStructured Output
Essayer le modèle
DeepSeek
Contexte1M
Entrée
$0.1278/M$0.1420/M
Sortie
$0.2574/M$0.2860/M
Conçu pour le raisonnement, le codage et l'utilisation d'outils agentiques, avec une exécution de contexte long, de mode de réflexion et de tâches complexes plus puissante que DeepSeek V3.2. Comparé à ses pairs chinois tels que Qwen, GLM et Kimi, il est particulièrement compétitif pour les tâches de mathématiques, de programmation et de raisonnement logique.
Type d'entrée:
Type de sortie:
Long ContextTool UseReasoningStructured Output
Essayer le modèle
OpenAI
OpenAI
Contexte1M
Entrée
$1.0000/M$5.0000/M
Sortie
$6.0000/M$30.0000/M
Conçu pour le raisonnement, le codage, la compréhension visuelle et les tâches d'agent, avec un contexte long, une utilisation des outils et une sortie fiable et évolutive plus forts que GPT-5.4. Comparé aux modèles phares Claude, Gemini et Qwen, il s'agit d'une base polyvalente solide pour une automatisation fiable et des flux de connaissances complexes.
Type d'entrée:
Type de sortie:
ReasoningTool UseStructured OutputLong Context
Essayer le modèle
XiaomiMiMo
Entrée$0.0000/M
Sortie$0.0000/M
Conçu pour la conception vocale d'une phrase et la synthèse vocale, avec une création vocale en langage naturel de la série V2.5 plus puissante, un contrôle plus fin du rythme/des émotions/de la tonalité et une production vocale à faible friction que le MiMo V2 TTS. Comparé à ElevenLabs, OpenAI TTS et Azure Speech, il est utile pour la conception de voix de personnages sans référence, les voix off publicitaires, la narration vidéo courte et l'exploration vocale multistyle.
Type d'entrée:
Type de sortie:
Multimodal Output
XiaomiMiMo
Entrée$0.0000/M
Sortie$0.0000/M
Conçu pour le clonage de voix de quelques échantillons, avec une reproduction du timbre haute fidélité de la série V2.5 plus forte, une cohérence des caractères vocaux et une généralisation du texte croisé que le MiMo V2 TTS. Comparé à ElevenLabs, OpenAI TTS et Azure Speech, il est bien adapté au doublage de caractères chinois, à la narration de courtes vidéos, à la réplication vocale de podcast et à la production vocale multilingue qui doit préserver une voix cible.
Type d'entrée:
Type de sortie:
Multimodal Output
XiaomiMiMo
Xiaomi MiMo
Entrée$0.0000/M
Sortie$0.0000/M
Conçu pour la synthèse vocale, la conception vocale et le clonage vocal, avec une synthèse vocale naturelle de la série V2.5 plus puissante, un contrôle précis du rythme/des émotions/de la tonalité et une création vocale à faible friction que le MiMo V2 TTS. Comparé à ElevenLabs, OpenAI TTS et Azure Speech, il est bien adapté à la narration chinoise, au doublage de personnages, à l'audio de courtes vidéos et à la production vocale multilingue.
Type d'entrée:
Type de sortie:
Multimodal Output
XiaomiMiMo
Xiaomi MiMo
Contexte1M
Entrée$1.1700/M
Sortie$3.5000/M
Conçu pour les agents, le codage et les tâches à long contexte, offrant une compréhension multimodale plus complète, une fenêtre contextuelle d'un million de jetons et un raisonnement à long terme que MiMo V2. Par rapport à ses pairs chinois tels que Qwen, GLM et DeepSeek, ses atouts résident dans l'adéquation à l'écosystème Xiaomi et les scénarios d'automatisation de l'ingénierie.
Type d'entrée:
Type de sortie:
ReasoningTool UseStructured OutputLong Context
Essayer le modèle
XiaomiMiMo
Xiaomi MiMo
Contexte1M
Entrée$0.4700/M
Sortie$2.3600/M
Conçu pour les agents, le codage et les tâches à long contexte, offrant une compréhension multimodale plus complète, une fenêtre contextuelle d'un million de jetons et un raisonnement à long terme que MiMo V2. Par rapport à ses pairs chinois tels que Qwen, GLM et DeepSeek, ses atouts résident dans l'adéquation à l'écosystème Xiaomi et les scénarios d'automatisation de l'ingénierie.
Type d'entrée:
Type de sortie:
ReasoningTool UseStructured OutputLong Context
Essayer le modèle
OpenAI
Contexte400K
PAR IMG$0.0080/image
The discounted-price route for GPT Image 2, mapped by the current channel to the same underlying model. Sale indicates a special-price route, not a separate capability tier. A good fit for cost-sensitive everyday generation and reference-image editing; choose regular gpt-image-2 when route consistency matters more.
Type d'entrée:
Type de sortie:
Multimodal OutputLong Context
Essayer le modèle
OpenAI
Contexte128K
PAR IMG
$0.0196/image$0.0280/image
Conçu pour la génération et l'édition d'images de haute qualité, améliorant par rapport à GPT Image 1.x le rendu du texte, l'édition locale et la cohérence multi-tours. Comparé aux modèles d'image Gemini, Qwen Image et Seedream, il est bien adapté aux visuels de marque, à la conception publicitaire, à l'imagerie de produits et aux flux de travail créatifs étroitement contrôlés.
Type d'entrée:
Type de sortie:
Multimodal Output
Essayer le modèle
Claude
Contexte1M
Entrée
$1.7000/M$5.0000/M
Sortie
$8.5000/M$25.0000/M
Pour le raisonnement phare et les tâches complexes des agents, il va plus loin que Claude Opus 4.6 en termes de contexte long, de code, d'utilisation des outils et de planification complexe ; par rapport aux modèles phares tels que GPT, Gemini et Qwen, il est plus adapté aux agents de haute fiabilité, à la maintenance de la base de code et aux flux de travail de recherche approfondis.
Type d'entrée:
Type de sortie:
ReasoningWeb SearchTool UseFunction CallingStructured OutputLong ContextCode Execution
Essayer le modèle
Contexte200K
Entrée$0.6300/M
Sortie$2.5200/M
Conçu pour la génération de texte, le raisonnement et l'utilisation d'outils, avec une stabilité de flux de travail agent et en contexte long de 200 Ko plus forte que les versions précédentes de MiniMax M2.x. Comparé à ses homologues chinois tels que Kimi, GLM et Qwen, il s'adapte à la productivité, à l'assistance au codage et au traitement de documents longs.
Type d'entrée:
Type de sortie:
Minimax
Contexte200K
Entrée$0.3150/M
Sortie$1.2600/M
Conçu pour la génération de texte, le raisonnement et l'utilisation d'outils, avec une stabilité de flux de travail agent et en contexte long de 200 Ko plus forte que les versions précédentes de MiniMax M2.x. Comparé à ses homologues chinois tels que Kimi, GLM et Qwen, il s'adapte à la productivité, à l'assistance au codage et au traitement de documents longs.
Type d'entrée:
Type de sortie:
OpenAI
Contexte400K
Entrée$0.2000/M
Sortie$1.2500/M
Built for reasoning, coding, visual understanding, and agent tasks, with stronger long context, tool use, and scalable reliable output than GPT-5.3. Compared with Claude, Gemini, and Qwen flagship models, it is a strong general-purpose base for reliable automation and complex knowledge workflows.
Type d'entrée:
Type de sortie:
Tool UseStructured OutputLong Context
Essayer le modèle
OpenAI
Contexte400K
Entrée$0.7500/M
Sortie$4.5000/M
Conçu pour le raisonnement, le codage, la compréhension visuelle et les tâches d'agent, avec un contexte long, une utilisation des outils et une sortie fiable et évolutive plus forts que GPT-5.3. Comparé aux modèles phares Claude, Gemini et Qwen, il s'agit d'une base polyvalente solide pour une automatisation fiable et des flux de connaissances complexes.
Type d'entrée:
Type de sortie:
Long ContextTool UseReasoningStructured Output
Essayer le modèle
OpenAI
OpenAI
Contexte1.05M
Entrée
$0.5000/M$2.5000/M
Sortie
$3.0000/M$15.0000/M
Conçu pour le raisonnement, le codage, la compréhension visuelle et les tâches d'agent, avec un contexte long, une utilisation des outils et une sortie fiable et évolutive plus forts que GPT-5.3. Comparé aux modèles phares Claude, Gemini et Qwen, il s'agit d'une base polyvalente solide pour une automatisation fiable et des flux de connaissances complexes.
Type d'entrée:
Type de sortie:
Long ContextTool UseReasoningStructured Output
Essayer le modèle
Contexte131K
PAR IMG
$0.0280/image$0.0400/image
Conçu pour la génération et l'édition d'images, avec une compréhension multimodale, des modifications conversationnelles et un prototypage visuel plus rapides que les fonctionnalités d'image Gemini antérieures. Comparé à GPT Image, Qwen Image et Seedream, il est utile pour combiner des documents, des images et des invites dans un seul flux de travail visuel.
Type d'entrée:
Type de sortie:
ReasoningMultimodal Output
Essayer le modèle
Contexte1.05M
Entrée
$1.4000/M$2.0000/M
Sortie
$8.4000/M$12.0000/M
Conçu pour la compréhension multimodale, le codage et les tâches à contexte long, améliorant par rapport à Gemini 3.0/2.5 en termes de débit, de contexte et de capacités d'outils. Comparé aux modèles GPT, Claude et Qwen, il est puissant pour les flux de travail d'analyse unifiés du texte, des images, de l'audio, de la vidéo et des documents.
Type d'entrée:
Type de sortie:
Long Context
Essayer le modèle
Claude
Contexte1M
Entrée
$1.0200/M$3.0000/M
Sortie
$5.1000/M$15.0000/M
Pour des tâches de codage et d'agent efficaces, il va plus loin que la version précommande de Claude 4.5/4.6 en termes de contexte long, de code, d'utilisation des outils et de planification complexe ; par rapport aux modèles phares tels que GPT, Gemini et Qwen, il est plus adapté aux agents de haute fiabilité, à la maintenance de la base de code et aux flux de travail de recherche approfondis.
Type d'entrée:
Type de sortie:
ReasoningWeb SearchTool UseFunction CallingStructured OutputLong ContextCode Execution
Essayer le modèle
Contexte256K
Entrée$0.5000/M
Sortie$2.5300/M
Conçu pour le codage, les agents et les tâches de productivité complexes, dépassant Doubao Seed 2.0 dans un contexte long, une sortie longue et des flux de travail orientés outils. Comparé aux pairs de Qwen, GLM et DeepSeek, il s'agit d'une option rentable pour le travail de bureau chinois, le codage et l'automatisation en plusieurs étapes.
Type d'entrée:
Type de sortie:
ReasoningWeb SearchTool UseFunction CallingStructured OutputLong Context
Essayer le modèle
PAR IMG$0.0350/image
Conçu pour la génération et l'édition d'images, avec un suivi des instructions en chinois, un raisonnement visuel et une production créative à haute fréquence plus solides que Seedream 4.x. Comparé à GPT Image, aux modèles d'image Gemini et à Qwen Image, il est bien adapté à la conception publicitaire de l'écosystème ByteDance, aux actifs de commerce électronique et à la production visuelle multi-scénarios.
Type d'entrée:
Type de sortie:
Web SearchMultimodal Output
Essayer le modèle
Minimax
Contexte205K
Entrée$0.3020/M
Sortie$1.2077/M
Un modèle rentable pour les vrais agents de productivité, les plus performants en matière de codage, d'utilisation d'outils, de recherche et de livrables de type bureautique plutôt que de simple conversation informelle. Il convient aux agents qui planifient et exécutent les modifications inter-fichiers, la récupération de recherche et les flux de travail de documents/feuilles de calcul/présentations ; Par rapport aux produits phares plus chers, le principal compromis est un coût inférieur pour une efficacité d'exécution proche des frontières.
Type d'entrée:
Type de sortie:
ReasoningTool UseFunction CallingStructured OutputLong Context
Essayer le modèle
Contexte13K
Entrée$2.1606/M
Sortie$2.1606/M
Conçu pour la génération vidéo et la création vidéo multi-actifs, améliorant Seedance 1.x avec une stabilité de mouvement, une génération audiovisuelle et des entrées de référence plus complètes. Comparé à Veo, Kling et Runway, il est mieux adapté aux flux de travail créatifs chinois pilotés par des entrées mixtes de texte, d'image, d'audio et de vidéo. Cette variante sans filtre conserve le même niveau de capacité de génération que Seedance 2.0 standard tout en appliquant un filtrage de contenu plus souple. Utile pour les courts métrages dramatiques, les publicités, le commerce électronique et les ressources sociales.
Type d'entrée:
Type de sortie:
Multimodal Output
Essayer le modèle
Contexte13K
Entrée$1.5465/M
Sortie$1.5465/M
Conçu pour la génération vidéo et la création vidéo multi-actifs, améliorant Seedance 1.x avec une stabilité de mouvement, une génération audiovisuelle et des entrées de référence plus complètes. Comparé à Veo, Kling et Runway, il est mieux adapté aux flux de travail créatifs chinois pilotés par des entrées mixtes de texte, d'image, d'audio et de vidéo. Cette variante sans filtre conserve le même niveau de capacité de génération que Seedance 2.0 standard tout en appliquant un filtrage de contenu plus souple. Utile pour les courts métrages dramatiques, les publicités, le commerce électronique et les ressources sociales.
Type d'entrée:
Type de sortie:
Multimodal Output
Essayer le modèle
Claude
Contexte1M
Entrée
$1.7000/M$5.0000/M
Sortie
$8.5000/M$25.0000/M
Pour le raisonnement phare et les tâches complexes des agents, il va plus loin que la version précommande de Claude 4.5/4.6 en termes de contexte long, de code, d'utilisation des outils et de planification complexe ; par rapport aux modèles phares tels que GPT, Gemini et Qwen, il est plus adapté aux agents de haute fiabilité, à la maintenance de la base de code et aux flux de travail de recherche approfondis.
Type d'entrée:
Type de sortie:
ReasoningWeb SearchTool UseFunction CallingStructured OutputLong ContextCode Execution
Essayer le modèle
Kling
PAR SEC$0.0900/s
Conçu pour la création de texte/image en vidéo et de prises de vue multiples, améliorant par rapport à Kling 2.x la stabilité du mouvement, le langage de la caméra et la cohérence des références. Comparé à Veo, Runway et Seedance, il est bien adapté aux courts métrages dramatiques chinois, aux ressources publicitaires et à la production de vidéos sociales de haute qualité.
Type d'entrée:
Type de sortie:
Multimodal Output
Kling
PAR SEC$0.0900/s
Conçu pour la création de texte/image en vidéo et de prises de vue multiples, améliorant par rapport à Kling 2.x la stabilité du mouvement, le langage de la caméra et la cohérence des références. Comparé à Veo, Runway et Seedance, il est bien adapté aux courts métrages dramatiques chinois, aux ressources publicitaires et à la production de vidéos sociales de haute qualité.
Type d'entrée:
Type de sortie:
Multimodal Output
Contexte8K
Entrée
$1.7039/M$2.0046/M
Sortie
$1.7039/M$2.0046/M
Conçu pour la génération vidéo et la création vidéo multi-actifs, améliorant Seedance 1.x avec une stabilité de mouvement, une génération audiovisuelle et des entrées de référence plus complètes. Comparé à Veo, Kling et Runway, il est mieux adapté aux flux de travail créatifs chinois pilotés par des entrées mixtes de texte, d'image, d'audio et de vidéo. La variante rapide est meilleure pour les itérations rapides et la production par lots que le niveau standard. Utile pour les courts métrages dramatiques, les publicités, le commerce électronique et les ressources sociales.
Type d'entrée:
Type de sortie:
Multimodal Output
Essayer le modèle
Contexte8K
Entrée
$2.0309/M$2.1378/M
Sortie
$2.0309/M$2.1378/M
Conçu pour la génération vidéo et la création vidéo multi-actifs, améliorant Seedance 1.x avec une stabilité de mouvement, une génération audiovisuelle et des entrées de référence plus complètes. Comparé à Veo, Kling et Runway, il est mieux adapté aux flux de travail créatifs chinois pilotés par des entrées mixtes de texte, d'image, d'audio et de vidéo. Utile pour les courts métrages dramatiques, les publicités, le commerce électronique et les ressources sociales.
Type d'entrée:
Type de sortie:
Multimodal Output
Essayer le modèle
Zhipu
Zhipu AI
Entrée$0.8800/M
Sortie$3.5500/M
Conçu pour la génération et l'édition d'images, avec une concentration plus forte que les capacités de vision GLM antérieures sur les invites chinoises, la compréhension du texte image et la génération contrôlable. Comparé à GPT Image, aux modèles d'image Gemini et à Qwen Image, il s'adapte aux actifs marketing chinois, aux visuels explicatifs et aux modifications visuelles itératives.
Type d'entrée:
Type de sortie:
Multimodal Output
Contexte1M
Entrée$0.5000/M
Sortie$3.0000/M
Modèle de réflexion rapide de Google conçu pour les flux de travail agents, le chat multi-tours et l'assistance au codage. Prend en charge la saisie de texte, d'image, d'audio, de vidéo et de PDF avec une fenêtre contextuelle de jeton de 1 M. Comprend des niveaux de réflexion configurables, l’utilisation d’outils et une sortie structurée. Améliorations apportées à la qualité par rapport à Gemini 2.5 Flash en termes de raisonnement, de compréhension multimodale et de fiabilité.
Type d'entrée:
Type de sortie:
ReasoningTool UseFunction CallingStructured OutputLong Context
Essayer le modèle
Contexte66K
PAR IMG
$0.0938/image$0.1340/image
Conçu pour la génération et l'édition d'images, avec une compréhension multimodale, des modifications conversationnelles et un prototypage visuel plus rapides que les fonctionnalités d'image Gemini antérieures. Comparé à GPT Image, Qwen Image et Seedream, il est utile pour combiner des documents, des images et des invites dans un seul flux de travail visuel.
Type d'entrée:
Type de sortie:
ReasoningMultimodal Output
Essayer le modèle
Claude
Contexte200K
Entrée
$3.5000/M$5.0000/M
Sortie
$17.5000/M$25.0000/M
Destiné au raisonnement phare et aux tâches complexes des agents, il va plus loin que les versions en précommande de la série Claude 4 en termes de contexte long, de code, d'utilisation des outils et de planification complexe ; par rapport aux modèles phares tels que GPT, Gemini et Qwen, il est plus adapté aux agents de haute fiabilité, à la maintenance de la base de code et aux flux de travail de recherche approfondis.
Type d'entrée:
Type de sortie:
ReasoningTool UseStructured OutputLong Context
Essayer le modèle
Gemini
PAR APPEL$0.1100/call
Conçu pour la génération vidéo haute fidélité, avec un flux de travail d'audio natif, de contrôle de caméra et d'entrée de référence plus mature que celui du Veo 2/3. Comparé à Kling, Runway et Seedance, il est mieux adapté aux courts métrages cinématographiques, aux storyboards publicitaires et aux vidéos nécessitant un mouvement physique stable. Le niveau Lite privilégie les brouillons à haut débit et à moindre coût par rapport au niveau standard.
Type d'entrée:
Type de sortie:
Multimodal Output
Essayer le modèle
Gemini
PAR APPEL$0.2211/call
Conçu pour la génération vidéo haute fidélité, avec un flux de travail d'audio natif, de contrôle de caméra et d'entrée de référence plus mature que celui du Veo 2/3. Comparé à Kling, Runway et Seedance, il est mieux adapté aux courts métrages cinématographiques, aux storyboards publicitaires et aux vidéos nécessitant un mouvement physique stable. Le niveau Rapide est meilleur pour une validation rapide du concept que le niveau standard.
Type d'entrée:
Type de sortie:
Multimodal Output
Essayer le modèle
Gemini
Google
PAR APPEL$1.6544/call
Conçu pour la génération vidéo haute fidélité, avec un flux de travail d'audio natif, de contrôle de caméra et d'entrée de référence plus mature que celui du Veo 2/3. Comparé à Kling, Runway et Seedance, il est mieux adapté aux courts métrages cinématographiques, aux storyboards publicitaires et aux vidéos nécessitant un mouvement physique stable.
Type d'entrée:
Type de sortie:
Multimodal Output
Essayer le modèle
Claude
Contexte200K
Entrée
$0.3400/M$1.0000/M
Sortie
$1.7000/M$5.0000/M
Pour des tâches de codage et d'agent efficaces, il va plus loin que Claude Haiku 3.5 en termes de contexte long, de code, d'utilisation d'outils et de planification complexe ; par rapport aux modèles phares tels que GPT, Gemini et Qwen, il est plus adapté aux agents de haute fiabilité, à la maintenance de la base de code et aux flux de travail de recherche approfondis.
Type d'entrée:
Type de sortie:
ReasoningTool UseStructured OutputLong Context
Essayer le modèle
Entrée
$0.5922/M$1.1844/M
Sortie
$0.5922/M$1.1844/M
A lighter, throughput-oriented variant in the Seedance 2.0 family for short-video drafts, batch assets, and cost-sensitive iteration. Its value is the lighter generation tier; choose the standard model when maximum fidelity, complex motion, or higher output specifications matter more.
Type d'entrée:
Type de sortie:
Multimodal Output
Essayer le modèle
Gemini
PAR IMG$0.0300/image
Il s'agit d'un itinéraire d'essai à prix réduit. La génération peut prendre plus de temps et a environ 10 % de chances d’échouer. Il est préférable de réaliser des essais de génération d'images sensibles aux coûts, où les files d'attente et les échecs occasionnels sont acceptables ; pour une utilisation en production plus stable, choisissez un itinéraire régulier.
Type d'entrée:
Type de sortie:
Multimodal Output
Gemini
PAR APPEL$0.0200/call
Il s'agit d'un itinéraire d'essai à prix réduit. La génération peut prendre plus de temps et a environ 10 % de chances d’échouer. Il est préférable de réaliser des essais de génération d'images sensibles aux coûts, où les files d'attente et les échecs occasionnels sont acceptables ; pour une utilisation en production plus stable, choisissez un itinéraire régulier.
Type d'entrée:
Type de sortie:
Multimodal Output
Gemini
PAR IMG$0.0300/image
Il s'agit d'un itinéraire d'essai à prix réduit. La génération peut prendre plus de temps et a environ 10 % de chances d’échouer. Il est préférable de réaliser des essais de génération d'images sensibles aux coûts, où les files d'attente et les échecs occasionnels sont acceptables ; pour une utilisation en production plus stable, choisissez un itinéraire régulier.
Type d'entrée:
Type de sortie:
Multimodal Output