Claude
claude-fable-5-1
Anthropic
Контекст1M
Вход
$3.4000/M$10.0000/M
Вывод
$17.0000/M$50.0000/M
A flagship long-context model for demanding, long-running knowledge work, coding projects, and multi-step agentic tasks. It accepts text, images, and PDFs, making it a strong fit for cross-file analysis, complex research, and sustained tool use. It prioritizes reasoning depth and long-horizon execution over speed and cost, so it is best reserved for tasks where reliable completion matters.
Тип входа:
Тип выхода:
ReasoningWeb SearchTool UseFunction CallingLong Context
Qwen
qwen3.8-flash
Qwen
Контекст1M
Вход$0.1492/M
Вывод$0.4476/M
An efficient multimodal workhorse in the Qwen family, with a native million-token context window and strong support for coding assistance, agentic workflows, and visual understanding such as charts. It fits long documents, codebases, high-concurrency applications, and tool-assisted tasks.
Тип входа:
Тип выхода:
ReasoningTool UseStructured OutputLong Context
Zhipu
glm-5.3-flash
Zhipu AI
Контекст1.31M
Вход$0.1190/M
Вывод$0.4200/M
The efficiency-focused Flash model in the GLM-5 family, with native multimodal support and a design aimed at long-context, high-frequency execution. It is a strong fit for coding, agentic workflows, and complex tasks that require image-and-text understanding, especially when production cost matters.
Тип входа:
Тип выхода:
ReasoningTool UseStructured OutputLong Context
DeepSeek
deepseek-v4-flash-vision-exp
DeepSeek
Контекст1.05M
Вход$0.1490/M
Вывод$0.2980/M
An experimental multimodal variant of DeepSeek-V4-Flash for image understanding alongside text. A practical choice for visual Q&A, screenshot and document analysis, while its experimental status makes it better suited to evaluation and flexible workflows than strict production-critical paths.
Тип входа:
Тип выхода:
ReasoningTool UseLong Context
Z.ai
coding-glm-5.3-free
Free channel
Контекст1M
Вход$0.0000/M
Вывод$0.0000/M
Free models are for learning and trial purposes only and may be removed at any time. Premium models have limited quotas with 5 requests per minute, and their availability is not guaranteed.
Тип входа:
Тип выхода:
ReasoningTool UseFunction CallingStructured OutputLong Context
Zhipu
glm-5.3
Zhipu AI
Контекст1M
Вход
$1.0115/M$1.1900/M
Вывод
$3.5275/M$4.1500/M
A flagship workhorse for complex software engineering and long-horizon agent tasks. It uses the same base model as GLM-5.2, with improvements driven by post-training, delivering a 50% gain on Z.ai Code Bench alongside stronger terminal-operation and vulnerability-discovery capabilities. It offers a 1M-token context window, up to 128K output, always-on reasoning with low, high, and max effort levels, function calling, and structured outputs. It currently accepts text only and is not intended for tasks requiring visual understanding.
Тип входа:
Тип выхода:
ReasoningTool UseFunction CallingStructured OutputLong Context
Gemini
gemini-3.7-flash-free
Free channel
Контекст1.05M
Вход$0.0000/M
Вывод$0.0000/M
Free models are for learning and trial purposes only and may be removed at any time. Premium models have limited quotas with 5 requests per minute, and their availability is not guaranteed.
Тип входа:
Тип выхода:
ReasoningTool UseLong Context
Gemini
gemini-3.7-flash
Google
Контекст1.05M
Вход$0.7500/M
Вывод$3.7500/M
A new fast multimodal model in the Gemini 3 family, released in August 2026, built for low-cost, high-throughput multimodal understanding. It accepts text, image, video, audio and document inputs with a 1M-token context, suited to large-scale processing, batch workloads and real-time interactions.
Тип входа:
Тип выхода:
ReasoningTool UseLong Context
Grok
grok-4.6
xAI
Контекст500K
Вход$0.8400/M
Вывод$2.5200/M
A flagship general-purpose model for high-quality coding, agentic execution, and knowledge work. It fits tasks that need sustained planning, tool collaboration, and complex problem solving; for simple calls where latency or cost matters most, choose a lighter model.
Тип входа:
Тип выхода:
ReasoningTool UseStructured OutputLong Context
Qwen
qwen3.8-max
Qwen
Контекст1M
Вход
$1.4200/M$1.7750/M
Вывод
$4.2640/M$5.3300/M
Qwen's most capable flagship multimodal reasoning model, built for long-horizon coding, professional work, and multi-stage agent tasks. It accepts text, images, and video, offers a 1M-token context window with up to 128K output, and supports function calling, structured outputs, web search, and a code interpreter. It is best used as a high-quality workhorse for complex tasks rather than for the lowest-cost, lowest-latency batch workloads.
Тип входа:
Тип выхода:
ReasoningWeb SearchTool UseFunction CallingStructured OutputLong ContextCode Execution
Minimax
MiniMax-H3
MiniMax
ЗА СЕКУНДУ$0.0800/s
An omni-modal video generation model that can combine text with image, video, and audio references to create video assets with synchronized audio. It is suited to short-form video, advertising, and reference-driven character or camera work; it is not a general chat model, so prioritize visual consistency, motion, and audio-visual quality.
Тип входа:
Тип выхода:
Multimodal Output
Claude
claude-opus-5
Anthropic
Контекст1M
Вход
$1.7000/M$5.0000/M
Вывод
$8.5000/M$25.0000/M
A premium model for complex agentic coding and enterprise knowledge work, emphasizing long-horizon planning, sustained execution, self-checking, and reliable delivery. With a million-token context window, it is suited to large codebases, complex documents, and multi-step projects that need limited human oversight.
Тип входа:
Тип выхода:
ReasoningTool UseStructured OutputLong Context
Gemini
gemini-3.6-flash
Google
Контекст1.05M
Вход$1.5000/M
Вывод$7.5000/M
The workhorse of the Gemini Flash line, balancing efficiency with coding, knowledge work, and multimodal understanding. Compared with 3.5 Flash, it is designed to complete multi-step tasks with fewer output tokens, reasoning steps, and tool calls, making it a good fit for production agents, document and chart analysis, and frequent complex workflows.
Тип входа:
Тип выхода:
ReasoningTool UseLong Context
Gemini
gemini-3.5-flash-lite
Google
Контекст1.05M
Вход$0.3000/M
Вывод$2.5000/M
The fastest and most cost-effective model in the Gemini 3.5 line, built for high-throughput, low-latency work such as translation, classification, document processing, and lightweight agentic workflows. It supports multimodal inputs and up to a 1M-token context, while demanding reasoning, long-horizon planning, or high-quality code changes are better handled by a higher-tier Flash model.
Тип входа:
Тип выхода:
Long Context
MoonshotAI
kimi-k3
Moonshot
Контекст1.05M
Вход
$2.7000/M$3.0000/M
Вывод
$13.5000/M$15.0000/M
Флагманская модель Moonshot с собственным видением и контекстным окном до 1 миллиона токенов. В настоящее время он работает с максимальными логическими усилиями и подходит для долгосрочного кодирования, научной работы и сложных задач, которые координируют инструменты терминала. Для стабильного использования сохраните полную историю рассуждений и начните новый сеанс с использованием совместимого агента.
Тип входа:
Тип выхода:
ReasoningTool UseLong Context
MoonshotAI
coding-kimi-k3-free
Free channel
Контекст1.05M
Вход$0.0000/M
Вывод$0.0000/M
Free models are for learning and trial purposes only and may be removed at any time. Premium models have limited quotas with 5 requests per minute, and their availability is not guaranteed.
Тип входа:
Тип выхода:
ReasoningTool UseLong Context
OpenAI
gpt-5.6-terra
OpenAI
Контекст1.05M
Вход
$0.4000/M$2.0000/M
Вывод
$2.4000/M$12.0000/M
The balanced workhorse tier of GPT-5.6, combining capability and cost. Well suited to production work involving image understanding, tool use, and large source material; choose Sol for the hardest quality-first work or Luna for cost-controlled high volume.
Тип входа:
Тип выхода:
ReasoningFunction CallingStructured OutputLong Context
OpenAI
gpt-5.6-sol
OpenAI
Контекст1.05M
Вход
$1.0000/M$5.0000/M
Вывод
$6.0000/M$30.0000/M
The flagship GPT-5.6 tier for complex professional work and quality-first delivery. It supports image input, function calling, structured outputs, and an exceptionally large context window; consider Terra or Luna when latency or unit cost is the primary constraint.
Тип входа:
Тип выхода:
ReasoningFunction CallingStructured OutputLong Context
Doubao
doubao-seedream-5-0-pro
Doubao
ЗА СЕКУНДУ$0.0450/s
Мультимодальная модель генерации изображений для профессионального визуального создания. Он может генерировать изображения из текста и выполнять точное редактирование с использованием эталонных изображений и пространственных аннотаций, обладая преимуществами в плотной инфографике, типографике, реалистичном освещении и многоязычном рендеринге текста.
Тип входа:
Тип выхода:
ReasoningMultimodal Output
Grok
grok-4.5
xAI
Контекст500K
Вход$2.1000/M
Вывод$6.3000/M
Передовая модель рассуждения для кодирования, работы с знаниями и задач STEM. Он поддерживает ввод изображений, вызов функций и структурированный вывод; его контекст из 500 тысяч токенов подходит для межфайлового анализа и длинных исходных материалов. Отдавайте предпочтение более дешевой модели, когда нет необходимости в граничных рассуждениях.
Тип входа:
Тип выхода:
ReasoningFunction CallingStructured OutputLong Context
Claude
claude-fable-5
Anthropic
Контекст1M
Вход
$3.4000/M$10.0000/M
Вывод
$17.0000/M$50.0000/M
Самая мощная и широко распространенная модель Anthropic, созданная для самых требовательных рассуждений и долгосрочной агентурной работы. Предлагает контекстное окно размером 1 миллион токенов с максимальным выходом 128 тысяч и постоянно включенным адаптивным мышлением, превосходно справляется с автономным исследованием недостаточно определенных задач, планированием и дальнейшим выполнением длительного кодирования и многоагентной оркестровки, прежде чем потребуется человеческий вклад.
Тип входа:
Тип выхода:
ReasoningTool UseStructured OutputLong Context
Gemini
gemini-3.1-flash-lite-image
Google
ЗА ВЫЗОВ
$0.0120/call$0.0200/call
A high-efficiency image generation and editing model for frequent visual drafts, social assets, posters, and iterative revisions. It supports multimodal inputs and a million-token context, favoring speed and scaled usage; choose Pro Image when complex creative control is the priority.
Тип входа:
Тип выхода:
Multimodal Output
Claude
claude-sonnet-5
Anthropic
Контекст1M
Вход
$0.6800/M$2.0000/M
Вывод
$3.4000/M$10.0000/M
Модель уровня Sonnet с ежедневными драйверами, направленная на предоставление передовых возможностей агентов, кодирования и работы со знаниями при меньших эксплуатационных расходах. Его стандартный контекст токена 1M и адаптивное мышление подходят для длинных документов, баз кода и многоэтапных рабочих процессов инструментов; для более глубоких рассуждений или ограниченной работы по обеспечению безопасности с высоким уровнем риска оцените модели более высокого уровня или специализированные модели.
Тип входа:
Тип выхода:
ReasoningTool UseStructured OutputLong Context
Doubao
doubao-seedance-2.5-260628
Doubao
Вход
$3.6594/M$3.8520/M
Вывод
$3.6594/M$3.8520/M
A next-generation Seedance model for long-form storytelling and complex creative workflows, with more flexible multimodal references, video extension, and precise editing. It is well suited to advertising, short films, and production work that must preserve character, scene, and audio-visual continuity.
Тип входа:
Тип выхода:
Multimodal Output
Doubao
doubao-seed-2-1-pro
Doubao
Контекст256K
Вход$0.9700/M
Вывод$4.8800/M
Создан для кодирования, агентов и сложных задач повышения производительности, выходя за рамки Doubao Seed 2.0 в длинном контексте, длительном выводе и рабочих процессах, ориентированных на инструменты. По сравнению с аналогами Qwen, GLM и DeepSeek, это экономически эффективный вариант для китайской офисной работы, кодирования и многоэтапной автоматизации.
Тип входа:
Тип выхода:
ReasoningTool UseFunction CallingStructured OutputLong Context
Qwen
happyhorse-1.1-t2v
阿里巴巴
ЗА СЕКУНДУ$0.1350/s
Создан для преобразования текста в видео, имеет более мощный рабочий процесс со звуком, чем HappyHorse 1.0, генерирующий диалоги, звуковые эффекты и фоновую музыку за один проход. По сравнению с Veo, Kling и Runway его отличительной особенностью является синхронизированная генерация аудиовизуальных данных и согласованные с персонажами рабочие процессы для короткометражных драм, рекламы, электронной коммерции и бренд-маркетинга.
Тип входа:
Тип выхода:
Multimodal Output
Qwen
happyhorse-1.1-r2v
阿里巴巴
ЗА СЕКУНДУ$0.1350/s
Создан для сравнения с видео, имеет более мощный рабочий процесс со звуком, чем HappyHorse 1.0, генерирующий диалоги, звуковые эффекты и фоновую музыку за один проход. По сравнению с Veo, Kling и Runway его отличительной особенностью является синхронизированная генерация аудиовизуальных данных и согласованные с персонажами рабочие процессы для короткометражных драм, рекламы, электронной коммерции и бренд-маркетинга.
Тип входа:
Тип выхода:
Multimodal Output
Qwen
happyhorse-1.1-i2v
阿里巴巴
ЗА СЕКУНДУ$0.1350/s
Создан для преобразования изображения в видео, имеет более мощный рабочий процесс со звуком, чем HappyHorse 1.0, генерирующий диалоги, звуковые эффекты и фоновую музыку за один проход. По сравнению с Veo, Kling и Runway его отличительной особенностью является синхронизированная генерация аудиовизуальных данных и согласованные с персонажами рабочие процессы для короткометражных драм, рекламы, электронной коммерции и бренд-маркетинга.
Тип входа:
Тип выхода:
Multimodal Output
Doubao
dreamina-seedance-2-0-mini-filter-off
Doubao
Вход$1.5750/M
Вывод$1.5750/M
Создан для генерации видео и создания видео с несколькими объектами, улучшен Seedance 1.x с более полной стабильностью движения, созданием аудиовизуальных данных и эталонными входами. По сравнению с Veo, Kling и Runway он лучше подходит для творческих рабочих процессов в Китае, основанных на смешанных входах текста, изображений, аудио и видео. Этот вариант с отключением фильтра сохраняет тот же уровень возможностей генерации, что и стандартный Seedance 2.0, но применяет более слабую фильтрацию контента. Полезно для короткометражных драм, рекламы, электронной коммерции и социальных ресурсов.
Тип входа:
Тип выхода:
Multimodal Output
Zhipu
glm-5.2
Zhipu AI
Контекст1M
Вход
$0.9690/M$1.1400/M
Вывод
$3.4000/M$4.0000/M
Создан для рассуждений, кодирования и задач агента с длинным контекстом, улучшен по сравнению с GLM-5.1 по длине контекста, использованию инструментов и сложным многоэтапным рабочим процессам. По сравнению с ведущими китайскими аналогами, такими как Qwen, DeepSeek и Kimi, он подходит для автоматизации предприятия, анализа кода на уровне проекта и работы с знаниями на китайском языке.
Тип входа:
Тип выхода:
ReasoningTool UseFunction CallingStructured OutputLong Context
Doubao
doubao-seedance-2.0-mini-260615
Doubao
Вход
$0.3150/M$0.6300/M
Вывод
$0.3150/M$0.6300/M
A lightweight Seedance 2.0 variant that retains reference-driven video generation with text, images, and video. It is better suited to rapid iteration, batch drafts, and cost-sensitive workflows; choose the standard model when complex motion control, camera work, or final quality matters more.
Тип входа:
Тип выхода:
Multimodal Output
MoonshotAI
kimi-k2.7-code-highspeed
Moonshot
Контекст256K
Вход$1.9000/M
Вывод$7.9999/M
Создан для длительного контекстного, многоэтапного использования инструментов и рабочих процессов кода/документа, обладает более высокой стабильностью при выполнении инженерных задач и контекстной емкостью, чем Kimi K2.6. По сравнению с Qwen, GLM и DeepSeek он хорошо подходит для анализа длинных документов на китайском языке, вопросов и ответов по проектам и повседневного агентного программирования.
Тип входа:
Тип выхода:
Tool UseFunction CallingStructured OutputLong Context
MoonshotAI
kimi-k2.7-code
Moonshot
Контекст256K
Вход
$0.8775/M$0.9750/M
Вывод
$3.6450/M$4.0500/M
Создан для длительного контекстного, многоэтапного использования инструментов и рабочих процессов кода/документа, обладает более высокой стабильностью при выполнении инженерных задач и контекстной емкостью, чем Kimi K2.6. По сравнению с Qwen, GLM и DeepSeek он хорошо подходит для анализа длинных документов на китайском языке, вопросов и ответов по проектам и повседневного агентного программирования.
Тип входа:
Тип выхода:
Tool UseFunction CallingStructured OutputLong Context
Grok
grok-imagine-video-1-5-preview
xAI
ЗА СЕКУНДУ$0.1400/s
Создан для создания, редактирования и расширения изображений и видео, с более высокой согласованностью движения и более быстрым созданием социального контента, чем Grok Imagine 1.0. По сравнению с Veo, Kling и Runway он подходит для коротких видеороликов, рекламных концепций и трендовых активов в экосистеме xAI.
Тип входа:
Тип выхода:
Multimodal Output
Qwen
qwen3.7-plus
Qwen
Контекст1M
Вход
$0.2400/M$0.3000/M
Вывод
$0.9600/M$1.2000/M
Разработан для агентских рабочих нагрузок, кодирования и офисной производительности, с более сильным комбинированным акцентом на длинный контекст, вызов инструментов и структурированный вывод, чем Qwen3.6. По сравнению с флагманскими моделями, такими как GPT, Claude и Gemini, это экономически эффективная альтернатива для китайского языка, кодирования и многоэтапных рабочих процессов с инструментами.
Тип входа:
Тип выхода:
ReasoningTool UseFunction CallingStructured OutputLong Context
Minimax
minimax-m3-free
Free channel
Контекст1M
Вход$0.0000/M
Вывод$0.0000/M
Free models are for learning and trial purposes only and may be removed at any time. Premium models have limited quotas with 5 requests per minute, and their availability is not guaranteed.
Тип входа:
Тип выхода:
ReasoningTool UseFunction CallingStructured OutputLong Context
Minimax
MiniMax-M3
MiniMax
Контекст1M
Вход$0.3150/M
Вывод$1.2600/M
Создан для долгосрочного кодирования, использования инструментов и многоэтапного производственного сотрудничества, выходит за рамки MiniMax M2.7 с мультимодальными входами, сохраняя при этом контекстное окно размером 1 М токенов. По сравнению с моделями агентов с длинным контекстом Claude, Gemini и GLM-5.2 лучше помещать текст, изображения и видеоматериалы в один рабочий процесс.
Тип входа:
Тип выхода:
ReasoningTool UseFunction CallingStructured OutputLong Context
Claude
claude-opus-4-8
Anthropic
Контекст1M
Вход
$1.7000/M$5.0000/M
Вывод
$8.5000/M$25.0000/M
Для основных рассуждений и сложных задач агента он идет дальше, чем Claude Opus 4.7, с точки зрения длинного контекста, кода, использования инструментов и сложного планирования; по сравнению с флагманскими моделями, такими как GPT, Gemini и Qwen, он больше подходит для высоконадежных агентов, обслуживания кодовой базы и рабочих процессов углубленных исследований.
Тип входа:
Тип выхода:
ReasoningTool UseStructured OutputLong Context
Gemini
gemini-omni-video
Google
ЗА СЕКУНДУ$0.2450/s
Создан для мультимодального создания любых входных данных и видео, уделяя больше внимания, чем предыдущие рабочие процессы видео Gemini, унифицированной оркестровке текста, изображений, аудио и видео материалов. По сравнению с Veo, Kling и Runway он лучше интегрирует сложные мультимодальные ресурсы в один творческий рабочий процесс.
Тип входа:
Тип выхода:
Multimodal Output
Gemini
gemini-3.5-flash
Google
Контекст1M
Вход$1.5000/M
Вывод$9.0000/M
Создан для мультимодального понимания, кодирования и задач с длинным контекстом, улучшен по сравнению с Gemini 3.1 по пропускной способности, контексту и возможностям инструментов. По сравнению с моделями GPT, Claude и Qwen он обеспечивает унифицированные рабочие процессы анализа текста, изображений, аудио, видео и документов.
Тип входа:
Тип выхода:
ReasoningWeb SearchTool UseFunction CallingStructured OutputLong ContextCode Execution
Qwen
qwen3.7-max
Qwen
Контекст1M
Вход
$1.4400/M$1.8000/M
Вывод
$4.3200/M$5.4000/M
Разработан для агентских рабочих нагрузок, кодирования и офисной производительности, с более сильным комбинированным акцентом на длинный контекст, вызов инструментов и структурированный вывод, чем Qwen3.6. По сравнению с флагманскими моделями, такими как GPT, Claude и Gemini, это экономически эффективная альтернатива для китайского языка, кодирования и многоэтапных рабочих процессов с инструментами.
Тип входа:
Тип выхода:
ReasoningTool UseFunction CallingStructured OutputLong Context
Qwen
happyhorse-1.0-video-edit
Qwen
Контекст8K
ЗА СЕКУНДУ$0.1350/s
При редактировании видео, по сравнению с ранними моделями видео, в нем больше внимания уделяется генерации собственного звука, завершению диалогов, звуковых эффектов и фоновой музыки за один раз; по сравнению с Veo, Kling и Runway его отличительные преимущества заключаются в звуковой и визуальной синхронизации и согласованности рабочего процесса. Подходит для коротких драм, рекламы, видеороликов об электронной коммерции и бренд-маркетинге.
Тип входа:
Тип выхода:
Multimodal Output
Qwen
happyhorse-1.0-t2v
Qwen
Контекст8K
ЗА СЕКУНДУ$0.1350/s
В видео Wensheng, по сравнению с ранними моделями видео, больше внимания уделяется генерации собственного звука, одновременному завершению диалогов, звуковых эффектов и фоновой музыки; по сравнению с Veo, Kling и Runway его отличительные преимущества заключаются в звуковой и визуальной синхронизации и согласованности рабочего процесса. Подходит для коротких драм, рекламы, видеороликов об электронной коммерции и бренд-маркетинге.
Тип входа:
Тип выхода:
Multimodal Output
Qwen
happyhorse-1.0-r2v
Qwen
Контекст8K
ЗА СЕКУНДУ$0.1350/s
Генерация видео для справки по сравнению с ранними моделями видео более важна при создании собственного звука и завершает диалоги, звуковые эффекты и фоновую музыку за один раз; по сравнению с Veo, Kling и Runway его отличительные преимущества заключаются в звуковой и визуальной синхронизации и согласованности рабочего процесса. Подходит для коротких драм, рекламы, видеороликов об электронной коммерции и бренд-маркетинге.
Тип входа:
Тип выхода:
Multimodal Output
Qwen
happyhorse-1.0-i2v
Qwen
Контекст8K
ЗА СЕКУНДУ$0.1350/s
В видео Tusheng, по сравнению с ранними моделями видео, больше внимания уделяется генерации собственного звука, одновременному завершению диалогов, звуковых эффектов и фоновой музыки; по сравнению с Veo, Kling и Runway его отличительные преимущества заключаются в звуковой и визуальной синхронизации и согласованности рабочего процесса. Подходит для коротких драм, рекламы, видеороликов об электронной коммерции и бренд-маркетинге.
Тип входа:
Тип выхода:
Multimodal Output
DeepSeek
deepseek-v4-pro
DeepSeek
Контекст1M
Вход
$1.5390/M$1.7100/M
Вывод
$3.0869/M$3.4299/M
Создан для рассуждений, кодирования и использования агентских инструментов, с более сильным длинным контекстом, режимом мышления и выполнением сложных задач, чем DeepSeek V3.2. По сравнению с китайскими аналогами, такими как Qwen, GLM и Kimi, он особенно конкурентоспособен в решении задач по математике, программированию и логическому рассуждению.
Тип входа:
Тип выхода:
Long ContextTool UseReasoningStructured Output
DeepSeek
deepseek-v4-flash
DeepSeek
Контекст1M
Вход
$0.1278/M$0.1420/M
Вывод
$0.2574/M$0.2860/M
Создан для рассуждений, кодирования и использования агентских инструментов, с более сильным длинным контекстом, режимом мышления и выполнением сложных задач, чем DeepSeek V3.2. По сравнению с китайскими аналогами, такими как Qwen, GLM и Kimi, он особенно конкурентоспособен в решении задач по математике, программированию и логическому рассуждению.
Тип входа:
Тип выхода:
Long ContextTool UseReasoningStructured Output
OpenAI
gpt-5.5
OpenAI
Контекст1M
Вход
$1.0000/M$5.0000/M
Вывод
$6.0000/M$30.0000/M
Создан для рассуждений, кодирования, визуального понимания и задач агента, с более длинным контекстом, использованием инструментов и масштабируемым надежным выводом, чем GPT-5.4. По сравнению с флагманскими моделями Claude, Gemini и Qwen, это мощная универсальная база для надежной автоматизации и сложных рабочих процессов.
Тип входа:
Тип выхода:
ReasoningTool UseStructured OutputLong Context
XiaomiMiMo
mimo-v2.5-tts-voicedesign
Xiaomi MiMo
Вход$0.0000/M
Вывод$0.0000/M
Создан для голосового оформления одним предложением и преобразования текста в речь, с более сильным созданием голоса на естественном языке серии V2.5, детальным контролем темпа, эмоций и тона, а также воспроизведением голоса с меньшими трениями, чем у MiMo V2 TTS. По сравнению с ElevenLabs, OpenAI TTS и Azure Speech, он полезен для создания голоса персонажей без ссылок, озвучивания рекламных объявлений, повествования в коротких видеороликах и исследования голоса в нескольких стилях.
Тип входа:
Тип выхода:
Multimodal Output
XiaomiMiMo
mimo-v2.5-tts-voiceclone
Xiaomi MiMo
Вход$0.0000/M
Вывод$0.0000/M
Создан для клонирования голоса с несколькими сэмплами, с более точным воспроизведением тембра серии V2.5, согласованностью голосовых символов и межтекстовым обобщением, чем у MiMo V2 TTS. По сравнению с ElevenLabs, OpenAI TTS и Azure Speech он хорошо подходит для дублирования китайских иероглифов, повествования в коротких видеороликах, репликации голоса в подкастах и ​​создания многоязычной речи, при которой необходимо сохранить целевой голос.
Тип входа:
Тип выхода:
Multimodal Output
XiaomiMiMo
mimo-v2.5-tts
Xiaomi MiMo
Вход$0.0000/M
Вывод$0.0000/M
Создан для преобразования текста в речь, голосового оформления и клонирования голоса, с более мощным синтезом естественной речи серии V2.5, детальным контролем темпа, эмоций и тона, а также созданием голоса с меньшими трудностями, чем у MiMo V2 TTS. По сравнению с ElevenLabs, OpenAI TTS и Azure Speech он хорошо подходит для озвучивания на китайском языке, дублирования персонажей, короткометражного аудио и многоязычного озвучивания.
Тип входа:
Тип выхода:
Multimodal Output
XiaomiMiMo
mimo-v2.5-pro
Xiaomi MiMo
Контекст1M
Вход$1.1700/M
Вывод$3.5000/M
Создан для агентов, кодирования и задач с длинным контекстом, предлагает более полное мультимодальное понимание, контекстное окно с миллионом токенов и долгосрочное мышление, чем MiMo V2. По сравнению с китайскими аналогами, такими как Qwen, GLM и DeepSeek, его сильными сторонами являются соответствие экосистеме Xiaomi и сценарии автоматизации проектирования.
Тип входа:
Тип выхода:
ReasoningTool UseStructured OutputLong Context
XiaomiMiMo
mimo-v2.5
Xiaomi MiMo
Контекст1M
Вход$0.4700/M
Вывод$2.3600/M
Создан для агентов, кодирования и задач с длинным контекстом, предлагает более полное мультимодальное понимание, контекстное окно с миллионом токенов и долгосрочное мышление, чем MiMo V2. По сравнению с китайскими аналогами, такими как Qwen, GLM и DeepSeek, его сильными сторонами являются соответствие экосистеме Xiaomi и сценарии автоматизации проектирования.
Тип входа:
Тип выхода:
ReasoningTool UseStructured OutputLong Context
OpenAI
gpt-image-2-text-to-image
OpenAI
Контекст128K
ЗА ИЗОБР.$0.0300/image
Это пробный маршрут со скидкой. Генерация может занять больше времени и имеет примерно 10% вероятность сбоя. Лучше всего подходит для экономичных испытаний создания изображений, где допустимы очереди и случайные сбои; для более стабильного производственного использования выберите обычный маршрут.
Тип входа:
Тип выхода:
Multimodal Output
OpenAI
gpt-image-2-image-to-image
OpenAI
Контекст128K
ЗА ИЗОБР.$0.0200/image
Это пробный маршрут со скидкой. Генерация может занять больше времени и имеет примерно 10% вероятность сбоя. Лучше всего подходит для экономичных испытаний создания изображений, где допустимы очереди и случайные сбои; для более стабильного производственного использования выберите обычный маршрут.
Тип входа:
Тип выхода:
Multimodal Output
OpenAI
gpt-image-2
OpenAI
Контекст128K
ЗА ИЗОБР.$0.0670/image
Создан для высококачественного создания и редактирования изображений, улучшен по сравнению с GPT Image 1.x в рендеринге текста, локальном редактировании и многошаговой согласованности. По сравнению с моделями изображений Gemini, Qwen Image и Seedream, он хорошо подходит для визуальных эффектов бренда, дизайна рекламы, изображений продуктов и строго контролируемых творческих рабочих процессов.
Тип входа:
Тип выхода:
Multimodal Output
Claude
claude-opus-4-7
Anthropic
Контекст1M
Вход
$1.7000/M$5.0000/M
Вывод
$8.5000/M$25.0000/M
Для основных рассуждений и сложных задач агента он идет дальше, чем Claude Opus 4.6, с точки зрения длинного контекста, кода, использования инструментов и сложного планирования; по сравнению с флагманскими моделями, такими как GPT, Gemini и Qwen, он больше подходит для высоконадежных агентов, обслуживания кодовой базы и рабочих процессов углубленных исследований.
Тип входа:
Тип выхода:
ReasoningWeb SearchTool UseFunction CallingStructured OutputLong ContextCode Execution
Minimax
MiniMax-M2.7-highspeed
MiniMax
Контекст200K
Вход$0.6300/M
Вывод$2.5200/M
Создан для генерации текста, рассуждений и использования инструментов, с более высокой стабильностью длинного контекста 200 тыс. и агентным рабочим процессом, чем в предыдущих версиях MiniMax M2.x. По сравнению с китайскими аналогами, такими как Kimi, GLM и Qwen, он обеспечивает производительность, помощь в кодировании и обработку длинных документов.
Тип входа:
Тип выхода:
Reasoning
Minimax
MiniMax-M2.7
MiniMax
Контекст200K
Вход$0.3150/M
Вывод$1.2600/M
Создан для генерации текста, рассуждений и использования инструментов, с более высокой стабильностью длинного контекста 200 тыс. и агентным рабочим процессом, чем в предыдущих версиях MiniMax M2.x. По сравнению с китайскими аналогами, такими как Kimi, GLM и Qwen, он обеспечивает производительность, помощь в кодировании и обработку длинных документов.
Тип входа:
Тип выхода:
Reasoning
OpenAI
gpt-5.4-mini
OpenAI
Контекст400K
Вход$0.7500/M
Вывод$4.5000/M
Создан для рассуждений, кодирования, визуального понимания и задач агента, с более сильным длинным контекстом, использованием инструментов и масштабируемым надежным выводом, чем GPT-5.3. По сравнению с флагманскими моделями Claude, Gemini и Qwen, это мощная универсальная база для надежной автоматизации и сложных рабочих процессов.
Тип входа:
Тип выхода:
Long ContextTool UseReasoningStructured Output
OpenAI
gpt-5.4
OpenAI
Контекст1.05M
Вход
$0.5000/M$2.5000/M
Вывод
$3.0000/M$15.0000/M
Создан для рассуждений, кодирования, визуального понимания и задач агента, с более сильным длинным контекстом, использованием инструментов и масштабируемым надежным выводом, чем GPT-5.3. По сравнению с флагманскими моделями Claude, Gemini и Qwen, это мощная универсальная база для надежной автоматизации и сложных рабочих процессов.
Тип входа:
Тип выхода:
Long ContextTool UseReasoningStructured Output
Qwen
qwen-image-2.0-pro
Qwen
Вход$2.2000/M
Вывод$2.2000/M
Создан для создания и редактирования изображений, улучшен по сравнению с Qwen Image 1.x в рендеринге текста на китайском языке, выполнении инструкций и сложных макетах. По сравнению с изображениями GPT, моделями изображений Gemini и Seedream, он хорошо подходит для китайских плакатов, изображений для электронной коммерции, инфографики и итеративного визуального создания.
Тип входа:
Тип выхода:
Multimodal Output
Qwen
qwen-image-2.0
Qwen
Вход$2.2000/M
Вывод$2.2000/M
Создан для создания и редактирования изображений, улучшен по сравнению с Qwen Image 1.x в рендеринге текста на китайском языке, выполнении инструкций и сложных макетах. По сравнению с изображениями GPT, моделями изображений Gemini и Seedream, он хорошо подходит для китайских плакатов, изображений для электронной коммерции, инфографики и итеративного визуального создания.
Тип входа:
Тип выхода:
Multimodal Output
Gemini
gemini-3.1-flash-image-preview
Google
Контекст131K
ЗА ИЗОБР.$0.0672/image
Создан для создания и редактирования изображений, с более глубоким пониманием мультимодальности, интерактивным редактированием и быстрым визуальным прототипированием, чем предыдущие возможности изображений Gemini. По сравнению с GPT Image, Qwen Image и Seedream он удобен для объединения документов, изображений и подсказок в одном визуальном рабочем процессе.
Тип входа:
Тип выхода:
ReasoningMultimodal Output
Gemini
gemini-3.1-flash-image
Google
ЗА ИЗОБР.
$0.0198/image$0.0330/image
An efficient Gemini image tier that balances quality and speed for text-to-image generation, image editing, multi-image composition, and workflows that need fast, scalable output. It offers flexible composition and text rendering, while complex professional design may be better served by Gemini 3 Pro Image.
Тип входа:
Тип выхода:
Multimodal Output
Gemini
gemini-3.1-pro-preview
Google
Контекст1.05M
Вход$2.0000/M
Вывод$12.0000/M
Создан для мультимодального понимания, кодирования и задач с длинным контекстом, улучшен по сравнению с Gemini 3.0/2.5 по пропускной способности, контексту и возможностям инструментов. По сравнению с моделями GPT, Claude и Qwen он обеспечивает унифицированные рабочие процессы анализа текста, изображений, аудио, видео и документов.
Тип входа:
Тип выхода:
Long Context
Claude
claude-sonnet-4-6
Anthropic
Контекст1M
Вход
$1.0200/M$3.0000/M
Вывод
$5.1000/M$15.0000/M
Для эффективного кодирования и задач агента он идет дальше, чем предзаказная версия Claude 4.5/4.6 с точки зрения длинного контекста, кода, использования инструментов и сложного планирования; по сравнению с флагманскими моделями, такими как GPT, Gemini и Qwen, он больше подходит для высоконадежных агентов, обслуживания кодовой базы и рабочих процессов углубленных исследований.
Тип входа:
Тип выхода:
ReasoningWeb SearchTool UseFunction CallingStructured OutputLong ContextCode Execution
Doubao
doubao-seed-2-0-pro
Doubao
Контекст256K
Вход$0.5000/M
Вывод$2.5300/M
Создан для кодирования, агентов и сложных задач повышения производительности, выходя за рамки Doubao Seed 2.0 в длинном контексте, длительном выводе и рабочих процессах, ориентированных на инструменты. По сравнению с аналогами Qwen, GLM и DeepSeek, это экономически эффективный вариант для китайской офисной работы, кодирования и многоэтапной автоматизации.
Тип входа:
Тип выхода:
ReasoningWeb SearchTool UseFunction CallingStructured OutputLong Context
Doubao
doubao-seedream-5.0-lite
Doubao
ЗА ИЗОБР.$0.0350/image
Создан для создания и редактирования изображений, с более строгими инструкциями на китайском языке, визуальным мышлением и высокой частотой творческого творчества, чем Seedream 4.x. По сравнению с изображениями GPT, моделями изображений Gemini и Qwen Image, он хорошо подходит для дизайна рекламы экосистемы ByteDance, активов электронной коммерции и многосценарного визуального производства.
Тип входа:
Тип выхода:
Web SearchMultimodal Output
Minimax
MiniMax-M2.5
MiniMax
Контекст205K
Вход$0.3020/M
Вывод$1.2077/M
Экономически эффективная модель для реальных агентов по повышению производительности, наиболее мощная в программировании, использовании инструментов, поиске и офисных результатах, а не просто в обычном чате. Он подходит для агентов, которые планируют и выполняют межфайловые изменения, поиск результатов исследований и рабочие процессы документов/таблиц/презентаций; по сравнению с более дорогими флагманами, основным компромиссом является более низкая стоимость для достижения почти граничной эффективности исполнения.
Тип входа:
Тип выхода:
ReasoningTool UseFunction CallingStructured OutputLong Context
Doubao
doubao-seedance-2-0-filter-off
Doubao
Контекст13K
Вход$3.1500/M
Вывод$3.1500/M
Создан для генерации видео и создания видео с несколькими объектами, улучшен Seedance 1.x с более полной стабильностью движения, созданием аудиовизуальных данных и эталонными входами. По сравнению с Veo, Kling и Runway он лучше подходит для творческих рабочих процессов в Китае, основанных на смешанных входах текста, изображений, аудио и видео. Этот вариант с отключением фильтра сохраняет тот же уровень возможностей генерации, что и стандартный Seedance 2.0, но применяет более слабую фильтрацию контента. Полезно для короткометражных драм, рекламы, электронной коммерции и социальных ресурсов.
Тип входа:
Тип выхода:
Multimodal Output
Doubao
doubao-seedance-2-0-fast-filter-off
Doubao
Контекст13K
Вход$2.5200/M
Вывод$2.5200/M
Создан для генерации видео и создания видео с несколькими объектами, улучшен Seedance 1.x с более полной стабильностью движения, созданием аудиовизуальных данных и эталонными входами. По сравнению с Veo, Kling и Runway он лучше подходит для творческих рабочих процессов в Китае, основанных на смешанных входах текста, изображений, аудио и видео. Этот вариант с отключением фильтра сохраняет тот же уровень возможностей генерации, что и стандартный Seedance 2.0, но применяет более слабую фильтрацию контента. Полезно для короткометражных драм, рекламы, электронной коммерции и социальных ресурсов.
Тип входа:
Тип выхода:
Multimodal Output
Claude
claude-opus-4-6
Anthropic
Контекст1M
Вход
$1.7000/M$5.0000/M
Вывод
$8.5000/M$25.0000/M
Для основных рассуждений и сложных задач агента он идет дальше, чем версия предварительного заказа Claude 4.5/4.6 с точки зрения длинного контекста, кода, использования инструментов и сложного планирования; по сравнению с флагманскими моделями, такими как GPT, Gemini и Qwen, он больше подходит для высоконадежных агентов, обслуживания кодовой базы и рабочих процессов углубленных исследований.
Тип входа:
Тип выхода:
ReasoningWeb SearchTool UseFunction CallingStructured OutputLong ContextCode Execution
Kling
kling-v3-omni
kling
ЗА СЕКУНДУ$0.0900/s
Создан для преобразования текста/изображения в видео и создания серийных изображений, улучшен по сравнению с Kling 2.x по стабильности движения, языку камеры и согласованности ссылок. По сравнению с Veo, Runway и Seedance он хорошо подходит для китайских короткометражных драм, рекламных материалов и высококачественного социального видео.
Тип входа:
Тип выхода:
Multimodal Output
Kling
kling-v3
kling
ЗА СЕКУНДУ$0.0900/s
Создан для преобразования текста/изображения в видео и создания серийных изображений, улучшен по сравнению с Kling 2.x по стабильности движения, языку камеры и согласованности ссылок. По сравнению с Veo, Runway и Seedance он хорошо подходит для китайских короткометражных драм, рекламных материалов и высококачественного социального видео.
Тип входа:
Тип выхода:
Multimodal Output
Doubao
doubao-seedance-2.0-fast-260128
Doubao
Вход
$1.4566/M$1.7136/M
Вывод
$1.4566/M$1.7136/M
The speed-prioritized Seedance 2.0 variant for low-latency generation and rapid iteration. It fits batch look development, creative exploration, and workflows that need usable video drafts quickly; choose the standard model when complex reference fusion, motion stability, and final polish are the priority.
Тип входа:
Тип выхода:
Multimodal Output
Doubao
doubao-seedance-2.0-260128
Doubao
Вход
$2.1606/M$2.2743/M
Вывод
$2.1606/M$2.2743/M
The standard Seedance 2.0 model for controllable video creation from combined text, image, audio, and video references. It balances complex motion, multi-subject interaction, camera control, and joint audio-video generation, making it a solid default for ads, short films, and high-quality production assets.
Тип входа:
Тип выхода:
Multimodal Output
Gemini
gemini-3-flash-preview
Google
Контекст1M
Вход$0.5000/M
Вывод$3.0000/M
Модель высокоскоростного мышления Google, предназначенная для агентских рабочих процессов, многоходового чата и помощи в кодировании. Поддерживает ввод текста, изображений, аудио, видео и PDF с контекстным окном токена 1M. Особенности настраиваемых уровней мышления, использования инструментов и структурированного вывода. Значительные улучшения качества по сравнению с Gemini 2.5 Flash в отношении рассуждений, мультимодального понимания и надежности.
Тип входа:
Тип выхода:
ReasoningTool UseFunction CallingStructured OutputLong Context
Gemini
gemini-3-pro-image-preview
Google
Контекст66K
ЗА ИЗОБР.$0.1340/image
Создан для создания и редактирования изображений, с более глубоким пониманием мультимодальности, интерактивным редактированием и быстрым визуальным прототипированием, чем предыдущие возможности изображений Gemini. По сравнению с GPT Image, Qwen Image и Seedream он удобен для объединения документов, изображений и подсказок в одном визуальном рабочем процессе.
Тип входа:
Тип выхода:
ReasoningMultimodal Output
Gemini
gemini-3-pro-image
Google
ЗА ИЗОБР.
$0.0318/image$0.0530/image
A reasoning-driven image generation and editing model for professional creative work, including complex graphic design, high-fidelity product mockups, infographics, and visuals that require accurate text rendering. Compared with the faster Flash Image tier, it prioritizes fine control, grounded content, and polished output.
Тип входа:
Тип выхода:
Multimodal Output
Claude
claude-opus-4-5
Anthropic
Контекст200K
Вход$5.0000/M
Вывод$25.0000/M
Направленный на основные рассуждения и сложные задачи агента, он идет дальше, чем предварительные версии серии Claude 4 с точки зрения длинного контекста, кода, использования инструментов и сложного планирования; по сравнению с флагманскими моделями, такими как GPT, Gemini и Qwen, он больше подходит для высоконадежных агентов, обслуживания кодовой базы и рабочих процессов углубленных исследований.
Тип входа:
Тип выхода:
ReasoningTool UseStructured OutputLong Context
Gemini
veo3.1-lite
Google
ЗА ВЫЗОВ$0.1100/call
Создан для создания высококачественного видео и имеет более совершенный рабочий процесс обработки звука, управления камерой и эталонного ввода, чем Veo 2/3. По сравнению с Kling, Runway и Seedance он лучше подходит для короткометражных фильмов, рекламных раскадровок и видеороликов, требующих стабильного физического движения. Уровень Lite предпочитает высокопроизводительные и недорогие проекты по сравнению со стандартным уровнем.
Тип входа:
Тип выхода:
Multimodal Output
Gemini
veo3.1-fast
Google
ЗА ВЫЗОВ$0.2211/call
Создан для создания высококачественного видео и имеет более совершенный рабочий процесс обработки звука, управления камерой и эталонного ввода, чем Veo 2/3. По сравнению с Kling, Runway и Seedance он лучше подходит для короткометражных фильмов, рекламных раскадровок и видеороликов, требующих стабильного физического движения. Уровень «Быстрый» лучше подходит для быстрой проверки концепции, чем уровень «Стандартный».
Тип входа:
Тип выхода:
Multimodal Output
Gemini
veo3.1
Google
ЗА ВЫЗОВ$1.6544/call
Создан для создания высококачественного видео и имеет более совершенный рабочий процесс обработки звука, управления камерой и эталонного ввода, чем Veo 2/3. По сравнению с Kling, Runway и Seedance он лучше подходит для короткометражных фильмов, рекламных раскадровок и видеороликов, требующих стабильного физического движения.
Тип входа:
Тип выхода:
Multimodal Output
Gemini
gemini-2.5-flash-image
Google
Контекст66K
ЗА ИЗОБР.$0.0585/image
Создан для создания и редактирования изображений, с более глубоким пониманием мультимодальности, интерактивным редактированием и быстрым визуальным прототипированием, чем предыдущие возможности изображений Gemini. По сравнению с GPT Image, Qwen Image и Seedream он удобен для объединения документов, изображений и подсказок в одном визуальном рабочем процессе.
Тип входа:
Тип выхода:
Structured OutputMultimodal Output
Claude
claude-haiku-4-5
Anthropic
Контекст200K
Вход
$0.3400/M$1.0000/M
Вывод
$1.7000/M$5.0000/M
Для эффективного кодирования и задач агента он идет дальше, чем Claude Haiku 3.5, с точки зрения длинного контекста, кода, использования инструментов и сложного планирования; по сравнению с флагманскими моделями, такими как GPT, Gemini и Qwen, он больше подходит для высоконадежных агентов, обслуживания кодовой базы и рабочих процессов углубленных исследований.
Тип входа:
Тип выхода:
ReasoningTool UseStructured OutputLong Context
Qwen
wan3.0-video-prime
Qwen
ЗА СЕКУНДУ$0.4500/s
The speed-first variant of Alibaba's Wan 3.0 line (early access). It shortens generation latency while retaining high-quality video output, making it a good fit for low-latency previews, batch drafts and fast-iterating short-video workflows. If ultimate visual control matters more than speed, the standard version is a better choice.
Тип входа:
Тип выхода:
Multimodal Output
Qwen
wan3.0-video
Qwen
ЗА СЕКУНДУ$0.3000/s
The standard video generation model of Alibaba's Wan 3.0 line (early access). It supports text-to-video, image-to-video and multi-modal reference inputs, generating clips up to roughly 30 seconds with synchronized audio in a single pass — suitable for ads, short drama and narrative content. Official release date not yet announced.
Тип входа:
Тип выхода:
Multimodal Output
Zhipu
glm-image
Zhipu AI
Вход$0.8800/M
Вывод$3.5500/M
Создан для создания и редактирования изображений, с более сильным акцентом, чем предыдущие возможности GLM Vision, на подсказках на китайском языке, понимании текста и изображений и управляемом создании. По сравнению с изображением GPT, моделями изображений Gemini и изображением Qwen оно соответствует китайским маркетинговым ресурсам, пояснительным визуальным элементам и итеративным визуальным редактированиям.
Тип входа:
Тип выхода:
Multimodal Output
Doubao
dreamina-seedance-2-5-filter-off
Doubao
Вход$75.0000/M
Вывод$75.0000/M
WhatsApp