Zhipu
glm-5.3
Zhipu AI
Контекст1M
Вход
$1.0115/M$1.1900/M
Вывод
$3.5275/M$4.1500/M
A flagship workhorse for complex software engineering and long-horizon agent tasks. It uses the same base model as GLM-5.2, with improvements driven by post-training, delivering a 50% gain on Z.ai Code Bench alongside stronger terminal-operation and vulnerability-discovery capabilities. It offers a 1M-token context window, up to 128K output, always-on reasoning with low, high, and max effort levels, function calling, and structured outputs. It currently accepts text only and is not intended for tasks requiring visual understanding.
Тип входа:
Тип выхода:
ReasoningTool UseFunction CallingStructured OutputLong Context
Qwen
qwen3.8-max
Qwen
Контекст1M
Вход
$1.4200/M$1.7750/M
Вывод
$4.2640/M$5.3300/M
Qwen's most capable flagship multimodal reasoning model, built for long-horizon coding, professional work, and multi-stage agent tasks. It accepts text, images, and video, offers a 1M-token context window with up to 128K output, and supports function calling, structured outputs, web search, and a code interpreter. It is best used as a high-quality workhorse for complex tasks rather than for the lowest-cost, lowest-latency batch workloads.
Тип входа:
Тип выхода:
ReasoningWeb SearchTool UseFunction CallingStructured OutputLong ContextCode Execution
MoonshotAI
kimi-k3
Moonshot
Контекст1.05M
Вход
$2.7000/M$3.0000/M
Вывод
$13.5000/M$15.0000/M
Флагманская модель Moonshot с собственным видением и контекстным окном до 1 миллиона токенов. В настоящее время он работает с максимальными логическими усилиями и подходит для долгосрочного кодирования, научной работы и сложных задач, которые координируют инструменты терминала. Для стабильного использования сохраните полную историю рассуждений и начните новый сеанс с использованием совместимого агента.
Тип входа:
Тип выхода:
ReasoningTool UseLong Context
OpenAI
gpt-5.6-terra
OpenAI
Контекст1.05M
Вход
$0.4000/M$2.0000/M
Вывод
$2.4000/M$12.0000/M
The balanced workhorse tier of GPT-5.6, combining capability and cost. Well suited to production work involving image understanding, tool use, and large source material; choose Sol for the hardest quality-first work or Luna for cost-controlled high volume.
Тип входа:
Тип выхода:
ReasoningFunction CallingStructured OutputLong Context
OpenAI
gpt-5.6-sol
OpenAI
Контекст1.05M
Вход
$1.0000/M$5.0000/M
Вывод
$6.0000/M$30.0000/M
The flagship GPT-5.6 tier for complex professional work and quality-first delivery. It supports image input, function calling, structured outputs, and an exceptionally large context window; consider Terra or Luna when latency or unit cost is the primary constraint.
Тип входа:
Тип выхода:
ReasoningFunction CallingStructured OutputLong Context
OpenAI
gpt-5.6-luna
OpenAI
Контекст1.05M
Вход
$0.0400/M$0.2000/M
Вывод
$0.2400/M$1.2000/M
The cost-sensitive, high-volume tier of GPT-5.6. A good fit for summarization, classification, rewriting, and batch automation; choose the Sol sibling for complex professional judgment or quality-first multi-step work.
Тип входа:
Тип выхода:
ReasoningFunction CallingStructured OutputLong Context
Grok
grok-4.5
xAI
Контекст500K
Вход$2.1000/M
Вывод$6.3000/M
Передовая модель рассуждения для кодирования, работы с знаниями и задач STEM. Он поддерживает ввод изображений, вызов функций и структурированный вывод; его контекст из 500 тысяч токенов подходит для межфайлового анализа и длинных исходных материалов. Отдавайте предпочтение более дешевой модели, когда нет необходимости в граничных рассуждениях.
Тип входа:
Тип выхода:
ReasoningFunction CallingStructured OutputLong Context
Claude
claude-fable-5
Anthropic
Контекст1M
Вход
$3.4000/M$10.0000/M
Вывод
$17.0000/M$50.0000/M
Самая мощная и широко распространенная модель Anthropic, созданная для самых требовательных рассуждений и долгосрочной агентурной работы. Предлагает контекстное окно размером 1 миллион токенов с максимальным выходом 128 тысяч и постоянно включенным адаптивным мышлением, превосходно справляется с автономным исследованием недостаточно определенных задач, планированием и дальнейшим выполнением длительного кодирования и многоагентной оркестровки, прежде чем потребуется человеческий вклад.
Тип входа:
Тип выхода:
ReasoningTool UseStructured OutputLong Context
Claude
claude-sonnet-5
Anthropic
Контекст1M
Вход
$0.6800/M$2.0000/M
Вывод
$3.4000/M$10.0000/M
Модель уровня Sonnet с ежедневными драйверами, направленная на предоставление передовых возможностей агентов, кодирования и работы со знаниями при меньших эксплуатационных расходах. Его стандартный контекст токена 1M и адаптивное мышление подходят для длинных документов, баз кода и многоэтапных рабочих процессов инструментов; для более глубоких рассуждений или ограниченной работы по обеспечению безопасности с высоким уровнем риска оцените модели более высокого уровня или специализированные модели.
Тип входа:
Тип выхода:
ReasoningTool UseStructured OutputLong Context
LongCat
LongCat-2.0
美团
Контекст1M
Вход$0.3000/M
Вывод$1.2000/M
Рабочая лошадка LongCat 2.0 для кодирования в масштабе проекта и длительных задач агента с собственным контекстом токена 1M, а также вызовом инструментов и многоэтапным рассуждением. Это лучше всего, когда вам нужно держать под контролем большие репозитории, длинные документы или рабочие процессы автоматизации; для облегченных вопросов и ответов или чата с малой задержкой обычно дешевле обходится меньшая модель в стиле Flash/Lite.
Тип входа:
Тип выхода:
ReasoningTool UseFunction CallingLong Context
Doubao
doubao-seed-2-1-pro
Doubao
Контекст256K
Вход$0.9700/M
Вывод$4.8800/M
Создан для кодирования, агентов и сложных задач повышения производительности, выходя за рамки Doubao Seed 2.0 в длинном контексте, длительном выводе и рабочих процессах, ориентированных на инструменты. По сравнению с аналогами Qwen, GLM и DeepSeek, это экономически эффективный вариант для китайской офисной работы, кодирования и многоэтапной автоматизации.
Тип входа:
Тип выхода:
ReasoningTool UseFunction CallingStructured OutputLong Context
Qwen
happyhorse-1.1-t2v
阿里巴巴
ЗА СЕКУНДУ$0.1350/s
Создан для преобразования текста в видео, имеет более мощный рабочий процесс со звуком, чем HappyHorse 1.0, генерирующий диалоги, звуковые эффекты и фоновую музыку за один проход. По сравнению с Veo, Kling и Runway его отличительной особенностью является синхронизированная генерация аудиовизуальных данных и согласованные с персонажами рабочие процессы для короткометражных драм, рекламы, электронной коммерции и бренд-маркетинга.
Тип входа:
Тип выхода:
Multimodal Output
Qwen
happyhorse-1.1-r2v
阿里巴巴
ЗА СЕКУНДУ$0.1350/s
Создан для сравнения с видео, имеет более мощный рабочий процесс со звуком, чем HappyHorse 1.0, генерирующий диалоги, звуковые эффекты и фоновую музыку за один проход. По сравнению с Veo, Kling и Runway его отличительной особенностью является синхронизированная генерация аудиовизуальных данных и согласованные с персонажами рабочие процессы для короткометражных драм, рекламы, электронной коммерции и бренд-маркетинга.
Тип входа:
Тип выхода:
Multimodal Output
Qwen
happyhorse-1.1-i2v
阿里巴巴
ЗА СЕКУНДУ$0.1350/s
Создан для преобразования изображения в видео, имеет более мощный рабочий процесс со звуком, чем HappyHorse 1.0, генерирующий диалоги, звуковые эффекты и фоновую музыку за один проход. По сравнению с Veo, Kling и Runway его отличительной особенностью является синхронизированная генерация аудиовизуальных данных и согласованные с персонажами рабочие процессы для короткометражных драм, рекламы, электронной коммерции и бренд-маркетинга.
Тип входа:
Тип выхода:
Multimodal Output
Doubao
doubao-seedance-2-0-mini
Doubao
Вход
$0.7560/M$1.5120/M
Вывод
$0.7560/M$1.5120/M
Built for video generation and multi-asset video creation, improving on Seedance 1.x with more complete motion stability, audiovisual generation, and reference inputs. Compared with Veo, Kling, and Runway, it is better suited to Chinese creative workflows driven by mixed text, image, audio, and video inputs. The Mini tier is positioned for lower-cost, high-frequency testing compared with standard Seedance 2.0. Useful for short drama, ads, e-commerce, and social assets.
Тип входа:
Тип выхода:
Multimodal Output
Doubao
dreamina-seedance-2-0-mini-filter-off
Doubao
Вход$1.5750/M
Вывод$1.5750/M
Создан для генерации видео и создания видео с несколькими объектами, улучшен Seedance 1.x с более полной стабильностью движения, созданием аудиовизуальных данных и эталонными входами. По сравнению с Veo, Kling и Runway он лучше подходит для творческих рабочих процессов в Китае, основанных на смешанных входах текста, изображений, аудио и видео. Этот вариант с отключением фильтра сохраняет тот же уровень возможностей генерации, что и стандартный Seedance 2.0, но применяет более слабую фильтрацию контента. Полезно для короткометражных драм, рекламы, электронной коммерции и социальных ресурсов.
Тип входа:
Тип выхода:
Multimodal Output
Zhipu
glm-5.2
Zhipu AI
Контекст1M
Вход
$0.9690/M$1.1400/M
Вывод
$3.4000/M$4.0000/M
Создан для рассуждений, кодирования и задач агента с длинным контекстом, улучшен по сравнению с GLM-5.1 по длине контекста, использованию инструментов и сложным многоэтапным рабочим процессам. По сравнению с ведущими китайскими аналогами, такими как Qwen, DeepSeek и Kimi, он подходит для автоматизации предприятия, анализа кода на уровне проекта и работы с знаниями на китайском языке.
Тип входа:
Тип выхода:
ReasoningTool UseFunction CallingStructured OutputLong Context
MoonshotAI
kimi-k2.7-code
Moonshot
Контекст256K
Вход
$0.8775/M$0.9750/M
Вывод
$3.6450/M$4.0500/M
Создан для длительного контекстного, многоэтапного использования инструментов и рабочих процессов кода/документа, обладает более высокой стабильностью при выполнении инженерных задач и контекстной емкостью, чем Kimi K2.6. По сравнению с Qwen, GLM и DeepSeek он хорошо подходит для анализа длинных документов на китайском языке, вопросов и ответов по проектам и повседневного агентного программирования.
Тип входа:
Тип выхода:
Tool UseFunction CallingStructured OutputLong Context
Grok
grok-imagine-video-1-5-preview
xAI
ЗА СЕКУНДУ$0.1400/s
Создан для создания, редактирования и расширения изображений и видео, с более высокой согласованностью движения и более быстрым созданием социального контента, чем Grok Imagine 1.0. По сравнению с Veo, Kling и Runway он подходит для коротких видеороликов, рекламных концепций и трендовых активов в экосистеме xAI.
Тип входа:
Тип выхода:
Multimodal Output
Minimax
MiniMax-M3
MiniMax
Контекст1M
Вход$1.2600/M
Вывод$5.0400/M
Создан для долгосрочного кодирования, использования инструментов и многоэтапного производственного сотрудничества, выходит за рамки MiniMax M2.7 с мультимодальными входами, сохраняя при этом контекстное окно размером 1 М токенов. По сравнению с моделями агентов с длинным контекстом Claude, Gemini и GLM-5.2 лучше помещать текст, изображения и видеоматериалы в один рабочий процесс.
Тип входа:
Тип выхода:
ReasoningTool UseFunction CallingStructured OutputLong Context
Claude
claude-opus-4-8
Anthropic
Контекст1M
Вход
$1.7000/M$5.0000/M
Вывод
$8.5000/M$25.0000/M
Для основных рассуждений и сложных задач агента он идет дальше, чем Claude Opus 4.7, с точки зрения длинного контекста, кода, использования инструментов и сложного планирования; по сравнению с флагманскими моделями, такими как GPT, Gemini и Qwen, он больше подходит для высоконадежных агентов, обслуживания кодовой базы и рабочих процессов углубленных исследований.
Тип входа:
Тип выхода:
ReasoningTool UseStructured OutputLong Context
Gemini
gemini-omni-video
Google
ЗА СЕКУНДУ$0.2450/s
Создан для мультимодального создания любых входных данных и видео, уделяя больше внимания, чем предыдущие рабочие процессы видео Gemini, унифицированной оркестровке текста, изображений, аудио и видео материалов. По сравнению с Veo, Kling и Runway он лучше интегрирует сложные мультимодальные ресурсы в один творческий рабочий процесс.
Тип входа:
Тип выхода:
Multimodal Output
Gemini
gemini-3.5-flash
Google
Контекст1M
Вход$1.5000/M
Вывод$9.0000/M
Создан для мультимодального понимания, кодирования и задач с длинным контекстом, улучшен по сравнению с Gemini 3.1 по пропускной способности, контексту и возможностям инструментов. По сравнению с моделями GPT, Claude и Qwen он обеспечивает унифицированные рабочие процессы анализа текста, изображений, аудио, видео и документов.
Тип входа:
Тип выхода:
ReasoningWeb SearchTool UseFunction CallingStructured OutputLong ContextCode Execution
Qwen
qwen3.7-max
Qwen
Контекст1M
Вход
$1.4400/M$1.8000/M
Вывод
$4.3200/M$5.4000/M
Разработан для агентских рабочих нагрузок, кодирования и офисной производительности, с более сильным комбинированным акцентом на длинный контекст, вызов инструментов и структурированный вывод, чем Qwen3.6. По сравнению с флагманскими моделями, такими как GPT, Claude и Gemini, это экономически эффективная альтернатива для китайского языка, кодирования и многоэтапных рабочих процессов с инструментами.
Тип входа:
Тип выхода:
ReasoningTool UseFunction CallingStructured OutputLong Context
Qwen
qwen3.6-max-preview
Qwen
Контекст262K
Вход$1.3300/M
Вывод$8.0000/M
Alibaba Qwen 3.6 Max Preview, модель, созданная редкими экспертами, с примерно 1 триллионом параметров. Оптимизирован для агентного кодирования, использования инструментов и рассуждений в длинном контексте благодаря интегрированному режиму мышления, который сохраняет следы рассуждений во время многоходовых разговоров. Контекстное окно размером 262 КБ, доступное через API Alibaba Cloud Model Studio.
Тип входа:
Тип выхода:
ReasoningTool UseStructured OutputLong Context
Qwen
happyhorse-1.0-video-edit
Qwen
Контекст8K
ЗА СЕКУНДУ$0.1350/s
При редактировании видео, по сравнению с ранними моделями видео, в нем больше внимания уделяется генерации собственного звука, завершению диалогов, звуковых эффектов и фоновой музыки за один раз; по сравнению с Veo, Kling и Runway его отличительные преимущества заключаются в звуковой и визуальной синхронизации и согласованности рабочего процесса. Подходит для коротких драм, рекламы, видеороликов об электронной коммерции и бренд-маркетинге.
Тип входа:
Тип выхода:
Qwen
happyhorse-1.0-t2v
Qwen
Контекст8K
ЗА СЕКУНДУ$0.1350/s
В видео Wensheng, по сравнению с ранними моделями видео, больше внимания уделяется генерации собственного звука, одновременному завершению диалогов, звуковых эффектов и фоновой музыки; по сравнению с Veo, Kling и Runway его отличительные преимущества заключаются в звуковой и визуальной синхронизации и согласованности рабочего процесса. Подходит для коротких драм, рекламы, видеороликов об электронной коммерции и бренд-маркетинге.
Тип входа:
Тип выхода:
Qwen
happyhorse-1.0-r2v
Qwen
Контекст8K
ЗА СЕКУНДУ$0.1350/s
Генерация видео для справки по сравнению с ранними моделями видео более важна при создании собственного звука и завершает диалоги, звуковые эффекты и фоновую музыку за один раз; по сравнению с Veo, Kling и Runway его отличительные преимущества заключаются в звуковой и визуальной синхронизации и согласованности рабочего процесса. Подходит для коротких драм, рекламы, видеороликов об электронной коммерции и бренд-маркетинге.
Тип входа:
Тип выхода:
Qwen
happyhorse-1.0-i2v
Qwen
Контекст8K
ЗА СЕКУНДУ$0.1350/s
В видео Tusheng, по сравнению с ранними моделями видео, больше внимания уделяется генерации собственного звука, одновременному завершению диалогов, звуковых эффектов и фоновой музыки; по сравнению с Veo, Kling и Runway его отличительные преимущества заключаются в звуковой и визуальной синхронизации и согласованности рабочего процесса. Подходит для коротких драм, рекламы, видеороликов об электронной коммерции и бренд-маркетинге.
Тип входа:
Тип выхода:
DeepSeek
deepseek-v4-pro
DeepSeek
Контекст1M
Вход
$1.5390/M$1.7100/M
Вывод
$3.0869/M$3.4299/M
Создан для рассуждений, кодирования и использования агентских инструментов, с более сильным длинным контекстом, режимом мышления и выполнением сложных задач, чем DeepSeek V3.2. По сравнению с китайскими аналогами, такими как Qwen, GLM и Kimi, он особенно конкурентоспособен в решении задач по математике, программированию и логическому рассуждению.
Тип входа:
Тип выхода:
Long ContextTool UseReasoningStructured Output
DeepSeek
deepseek-v4-flash
DeepSeek
Контекст1M
Вход
$0.1278/M$0.1420/M
Вывод
$0.2574/M$0.2860/M
Создан для рассуждений, кодирования и использования агентских инструментов, с более сильным длинным контекстом, режимом мышления и выполнением сложных задач, чем DeepSeek V3.2. По сравнению с китайскими аналогами, такими как Qwen, GLM и Kimi, он особенно конкурентоспособен в решении задач по математике, программированию и логическому рассуждению.
Тип входа:
Тип выхода:
Long ContextTool UseReasoningStructured Output
OpenAI
gpt-5.5
OpenAI
Контекст1M
Вход
$1.0000/M$5.0000/M
Вывод
$6.0000/M$30.0000/M
Создан для рассуждений, кодирования, визуального понимания и задач агента, с более длинным контекстом, использованием инструментов и масштабируемым надежным выводом, чем GPT-5.4. По сравнению с флагманскими моделями Claude, Gemini и Qwen, это мощная универсальная база для надежной автоматизации и сложных рабочих процессов.
Тип входа:
Тип выхода:
XiaomiMiMo
mimo-v2.5-tts-voicedesign
Xiaomi MiMo
Вход$0.0000/M
Вывод$0.0000/M
Создан для голосового оформления одним предложением и преобразования текста в речь, с более сильным созданием голоса на естественном языке серии V2.5, детальным контролем темпа, эмоций и тона, а также воспроизведением голоса с меньшими трениями, чем у MiMo V2 TTS. По сравнению с ElevenLabs, OpenAI TTS и Azure Speech, он полезен для создания голоса персонажей без ссылок, озвучивания рекламных объявлений, повествования в коротких видеороликах и исследования голоса в нескольких стилях.
Тип входа:
Тип выхода:
Multimodal Output
XiaomiMiMo
mimo-v2.5-tts-voiceclone
Xiaomi MiMo
Вход$0.0000/M
Вывод$0.0000/M
Создан для клонирования голоса с несколькими сэмплами, с более точным воспроизведением тембра серии V2.5, согласованностью голосовых символов и межтекстовым обобщением, чем у MiMo V2 TTS. По сравнению с ElevenLabs, OpenAI TTS и Azure Speech он хорошо подходит для дублирования китайских иероглифов, повествования в коротких видеороликах, репликации голоса в подкастах и ​​создания многоязычной речи, при которой необходимо сохранить целевой голос.
Тип входа:
Тип выхода:
Multimodal Output
XiaomiMiMo
mimo-v2.5-tts
Xiaomi MiMo
Вход$0.0000/M
Вывод$0.0000/M
Создан для преобразования текста в речь, голосового оформления и клонирования голоса, с более мощным синтезом естественной речи серии V2.5, детальным контролем темпа, эмоций и тона, а также созданием голоса с меньшими трудностями, чем у MiMo V2 TTS. По сравнению с ElevenLabs, OpenAI TTS и Azure Speech он хорошо подходит для озвучивания на китайском языке, дублирования персонажей, короткометражного аудио и многоязычного озвучивания.
Тип входа:
Тип выхода:
Multimodal Output
OpenAI
gpt-image-2-text-to-image
OpenAI
Контекст128K
ЗА ИЗОБР.$0.0300/image
Это пробный маршрут со скидкой. Генерация может занять больше времени и имеет примерно 10% вероятность сбоя. Лучше всего подходит для экономичных испытаний создания изображений, где допустимы очереди и случайные сбои; для более стабильного производственного использования выберите обычный маршрут.
Тип входа:
Тип выхода:
Multimodal Output
OpenAI
gpt-image-2-image-to-image
OpenAI
Контекст128K
ЗА ИЗОБР.$0.0200/image
Это пробный маршрут со скидкой. Генерация может занять больше времени и имеет примерно 10% вероятность сбоя. Лучше всего подходит для экономичных испытаний создания изображений, где допустимы очереди и случайные сбои; для более стабильного производственного использования выберите обычный маршрут.
Тип входа:
Тип выхода:
Multimodal Output
OpenAI
gpt-image-2
OpenAI
Контекст128K
ЗА ИЗОБР.$0.0670/image
Создан для высококачественного создания и редактирования изображений, улучшен по сравнению с GPT Image 1.x в рендеринге текста, локальном редактировании и многошаговой согласованности. По сравнению с моделями изображений Gemini, Qwen Image и Seedream, он хорошо подходит для визуальных эффектов бренда, дизайна рекламы, изображений продуктов и строго контролируемых творческих рабочих процессов.
Тип входа:
Тип выхода:
Multimodal Output
MoonshotAI
kimi-k2.6
Moonshot
Вход
$0.8370/M$0.9300/M
Вывод
$3.4740/M$3.8600/M
Создан для длительного контекстного, многоэтапного использования инструментов и рабочих процессов кода/документа, обладает более высокой стабильностью при выполнении инженерных задач и контекстной емкостью, чем Kimi K2.5. По сравнению с Qwen, GLM и DeepSeek он хорошо подходит для анализа длинных документов на китайском языке, вопросов и ответов по проектам и повседневного агентного программирования.
Тип входа:
Тип выхода:
Tool UseReasoning
Claude
claude-opus-4-7
Anthropic
Контекст1M
Вход
$1.7000/M$5.0000/M
Вывод
$8.5000/M$25.0000/M
Для основных рассуждений и сложных задач агента он идет дальше, чем Claude Opus 4.6, с точки зрения длинного контекста, кода, использования инструментов и сложного планирования; по сравнению с флагманскими моделями, такими как GPT, Gemini и Qwen, он больше подходит для высоконадежных агентов, обслуживания кодовой базы и рабочих процессов углубленных исследований.
Тип входа:
Тип выхода:
ReasoningWeb SearchTool UseFunction CallingStructured OutputLong ContextCode Execution
Minimax
MiniMax-M2.7-highspeed
MiniMax
Контекст200K
Вход$0.6300/M
Вывод$2.5200/M
Создан для генерации текста, рассуждений и использования инструментов, с более высокой стабильностью длинного контекста 200 тыс. и агентным рабочим процессом, чем в предыдущих версиях MiniMax M2.x. По сравнению с китайскими аналогами, такими как Kimi, GLM и Qwen, он обеспечивает производительность, помощь в кодировании и обработку длинных документов.
Тип входа:
Тип выхода:
Reasoning
Minimax
MiniMax-M2.7
MiniMax
Контекст200K
Вход$0.3150/M
Вывод$1.2600/M
Создан для генерации текста, рассуждений и использования инструментов, с более высокой стабильностью длинного контекста 200 тыс. и агентным рабочим процессом, чем в предыдущих версиях MiniMax M2.x. По сравнению с китайскими аналогами, такими как Kimi, GLM и Qwen, он обеспечивает производительность, помощь в кодировании и обработку длинных документов.
Тип входа:
Тип выхода:
Reasoning
OpenAI
gpt-5.4-mini
OpenAI
Контекст400K
Вход
$0.1500/M$0.7500/M
Вывод
$0.9000/M$4.5000/M
Создан для рассуждений, кодирования, визуального понимания и задач агента, с более сильным длинным контекстом, использованием инструментов и масштабируемым надежным выводом, чем GPT-5.3. По сравнению с флагманскими моделями Claude, Gemini и Qwen, это мощная универсальная база для надежной автоматизации и сложных рабочих процессов.
Тип входа:
Тип выхода:
Long ContextTool UseReasoningStructured Output
OpenAI
gpt-5.4
OpenAI
Контекст1.05M
Вход
$0.5000/M$2.5000/M
Вывод
$3.0000/M$15.0000/M
Создан для рассуждений, кодирования, визуального понимания и задач агента, с более сильным длинным контекстом, использованием инструментов и масштабируемым надежным выводом, чем GPT-5.3. По сравнению с флагманскими моделями Claude, Gemini и Qwen, это мощная универсальная база для надежной автоматизации и сложных рабочих процессов.
Тип входа:
Тип выхода:
Long ContextTool UseReasoningStructured Output
Gemini
gemini-3.1-flash-image-preview
Google
Контекст131K
ЗА ИЗОБР.$0.0672/image
Создан для создания и редактирования изображений, с более глубоким пониманием мультимодальности, интерактивным редактированием и быстрым визуальным прототипированием, чем предыдущие возможности изображений Gemini. По сравнению с GPT Image, Qwen Image и Seedream он удобен для объединения документов, изображений и подсказок в одном визуальном рабочем процессе.
Тип входа:
Тип выхода:
ReasoningMultimodal Output
Gemini
gemini-3.1-pro-preview
Google
Контекст1.05M
Вход$2.0000/M
Вывод$12.0000/M
Создан для мультимодального понимания, кодирования и задач с длинным контекстом, улучшен по сравнению с Gemini 3.0/2.5 по пропускной способности, контексту и возможностям инструментов. По сравнению с моделями GPT, Claude и Qwen он обеспечивает унифицированные рабочие процессы анализа текста, изображений, аудио, видео и документов.
Тип входа:
Тип выхода:
Long Context
Claude
claude-sonnet-4-6-thinking
Anthropic
Контекст1M
Вход$3.0000/M
Вывод$15.0000/M
Расширенный вариант мышления Антропного сонета Клода 4.6, позволяющий рассуждать по цепочке мыслей для решения сложных проблем. Отличается кодированием, навигацией по кодовой базе, управлением проектами, созданием документов и агентскими задачами с вводом текста и изображений. Контекстное окно 1M превосходит стандартную версию при выполнении задач, требующих глубоких рассуждений, идеально подходит для комплексной разработки программного обеспечения и многоэтапного планирования.
Тип входа:
Тип выхода:
ReasoningTool UseStructured OutputLong Context
Claude
claude-sonnet-4-6
Anthropic
Контекст1M
Вход
$1.0200/M$3.0000/M
Вывод
$5.1000/M$15.0000/M
Для эффективного кодирования и задач агента он идет дальше, чем предзаказная версия Claude 4.5/4.6 с точки зрения длинного контекста, кода, использования инструментов и сложного планирования; по сравнению с флагманскими моделями, такими как GPT, Gemini и Qwen, он больше подходит для высоконадежных агентов, обслуживания кодовой базы и рабочих процессов углубленных исследований.
Тип входа:
Тип выхода:
ReasoningWeb SearchTool UseFunction CallingStructured OutputLong ContextCode Execution
Minimax
MiniMax-M2.5
MiniMax
Контекст205K
Вход$0.3020/M
Вывод$1.2077/M
Экономически эффективная модель для реальных агентов по повышению производительности, наиболее мощная в программировании, использовании инструментов, поиске и офисных результатах, а не просто в обычном чате. Он подходит для агентов, которые планируют и выполняют межфайловые изменения, поиск результатов исследований и рабочие процессы документов/таблиц/презентаций; по сравнению с более дорогими флагманами, основным компромиссом является более низкая стоимость для достижения почти граничной эффективности исполнения.
Тип входа:
Тип выхода:
ReasoningTool UseFunction CallingStructured OutputLong Context
Doubao
doubao-seedance-2-0-filter-off
Doubao
Контекст13K
Вход$3.1500/M
Вывод$3.1500/M
Создан для генерации видео и создания видео с несколькими объектами, улучшен Seedance 1.x с более полной стабильностью движения, созданием аудиовизуальных данных и эталонными входами. По сравнению с Veo, Kling и Runway он лучше подходит для творческих рабочих процессов в Китае, основанных на смешанных входах текста, изображений, аудио и видео. Этот вариант с отключением фильтра сохраняет тот же уровень возможностей генерации, что и стандартный Seedance 2.0, но применяет более слабую фильтрацию контента. Полезно для короткометражных драм, рекламы, электронной коммерции и социальных ресурсов.
Тип входа:
Тип выхода:
Multimodal Output
Doubao
doubao-seedance-2-0-fast-filter-off
Doubao
Контекст13K
Вход$2.5200/M
Вывод$2.5200/M
Создан для генерации видео и создания видео с несколькими объектами, улучшен Seedance 1.x с более полной стабильностью движения, созданием аудиовизуальных данных и эталонными входами. По сравнению с Veo, Kling и Runway он лучше подходит для творческих рабочих процессов в Китае, основанных на смешанных входах текста, изображений, аудио и видео. Этот вариант с отключением фильтра сохраняет тот же уровень возможностей генерации, что и стандартный Seedance 2.0, но применяет более слабую фильтрацию контента. Полезно для короткометражных драм, рекламы, электронной коммерции и социальных ресурсов.
Тип входа:
Тип выхода:
Multimodal Output
Claude
claude-opus-4-6
Anthropic
Контекст1M
Вход
$1.7000/M$5.0000/M
Вывод
$8.5000/M$25.0000/M
Для основных рассуждений и сложных задач агента он идет дальше, чем версия предварительного заказа Claude 4.5/4.6 с точки зрения длинного контекста, кода, использования инструментов и сложного планирования; по сравнению с флагманскими моделями, такими как GPT, Gemini и Qwen, он больше подходит для высоконадежных агентов, обслуживания кодовой базы и рабочих процессов углубленных исследований.
Тип входа:
Тип выхода:
ReasoningWeb SearchTool UseFunction CallingStructured OutputLong ContextCode Execution
Kling
kling-v3-omni
kling
ЗА СЕКУНДУ$0.0900/s
Создан для преобразования текста/изображения в видео и создания серийных изображений, улучшен по сравнению с Kling 2.x по стабильности движения, языку камеры и согласованности ссылок. По сравнению с Veo, Runway и Seedance он хорошо подходит для китайских короткометражных драм, рекламных материалов и высококачественного социального видео.
Тип входа:
Тип выхода:
Multimodal Output
Kling
kling-v3
kling
ЗА СЕКУНДУ$0.0900/s
Создан для преобразования текста/изображения в видео и создания серийных изображений, улучшен по сравнению с Kling 2.x по стабильности движения, языку камеры и согласованности ссылок. По сравнению с Veo, Runway и Seedance он хорошо подходит для китайских короткометражных драм, рекламных материалов и высококачественного социального видео.
Тип входа:
Тип выхода:
Multimodal Output
Doubao
doubao-seedream-5.0-lite
Doubao
ЗА ИЗОБР.$0.0350/image
Создан для создания и редактирования изображений, с более строгими инструкциями на китайском языке, визуальным мышлением и высокой частотой творческого творчества, чем Seedream 4.x. По сравнению с изображениями GPT, моделями изображений Gemini и Qwen Image, он хорошо подходит для дизайна рекламы экосистемы ByteDance, активов электронной коммерции и многосценарного визуального производства.
Тип входа:
Тип выхода:
Web SearchMultimodal Output
Doubao
doubao-seedance-2-0-fast
Doubao
Контекст8K
Вход$2.4192/M
Вывод$2.4192/M
Создан для генерации видео и создания видео с несколькими объектами, улучшен Seedance 1.x с более полной стабильностью движения, созданием аудиовизуальных данных и эталонными входами. По сравнению с Veo, Kling и Runway он лучше подходит для творческих рабочих процессов в Китае, основанных на смешанных входах текста, изображений, аудио и видео. Быстрый вариант лучше подходит для быстрой итерации и серийного производства, чем стандартный уровень. Полезно для короткометражных драм, рекламы, электронной коммерции и социальных ресурсов.
Тип входа:
Тип выхода:
Doubao
doubao-seedance-2-0
Doubao
Контекст8K
Вход
$2.5927/M$2.7292/M
Вывод
$2.5927/M$2.7292/M
Создан для генерации видео и создания видео с несколькими объектами, улучшен Seedance 1.x с более полной стабильностью движения, созданием аудиовизуальных данных и эталонными входами. По сравнению с Veo, Kling и Runway он лучше подходит для творческих рабочих процессов в Китае, основанных на смешанных входах текста, изображений, аудио и видео. Полезно для короткометражных драм, рекламы, электронной коммерции и социальных ресурсов.
Тип входа:
Тип выхода:
MoonshotAI
kimi-k2.5
Moonshot
Контекст256K
Вход
$0.5400/M$0.6000/M
Вывод
$2.8350/M$3.1500/M
Создан для длительного контекстного, многоэтапного использования инструментов и рабочих процессов кода/документа, обладает более высокой стабильностью при выполнении инженерных задач и контекстной емкостью, чем Kimi K2. По сравнению с Qwen, GLM и DeepSeek он хорошо подходит для анализа длинных документов на китайском языке, вопросов и ответов по проектам и повседневного агентного программирования.
Тип входа:
Тип выхода:
Long ContextTool UseReasoning
Gemini
gemini-3-flash-preview
Google
Контекст1M
Вход$0.5000/M
Вывод$3.0000/M
Модель высокоскоростного мышления Google, предназначенная для агентских рабочих процессов, многоходового чата и помощи в кодировании. Поддерживает ввод текста, изображений, аудио, видео и PDF с контекстным окном токена 1M. Особенности настраиваемых уровней мышления, использования инструментов и структурированного вывода. Значительные улучшения качества по сравнению с Gemini 2.5 Flash в отношении рассуждений, мультимодального понимания и надежности.
Тип входа:
Тип выхода:
ReasoningTool UseFunction CallingStructured OutputLong Context
DeepSeek
DeepSeek-V3.2-Thinking
DeepSeek
Контекст128K
Вход$0.3100/M
Вывод$0.4700/M
Создан для рассуждений, кодирования и использования агентских инструментов, с более сильным длинным контекстом, режимом мышления и выполнением сложных задач, чем DeepSeek V3.1. По сравнению с китайскими аналогами, такими как Qwen, GLM и Kimi, он особенно конкурентоспособен в решении задач по математике, программированию и логическому рассуждению.
Тип входа:
Тип выхода:
Long ContextTool UseReasoningStructured Output
Gemini
gemini-3-pro-image-preview
Google
Контекст66K
ЗА ИЗОБР.$0.1340/image
Создан для создания и редактирования изображений, с более глубоким пониманием мультимодальности, интерактивным редактированием и быстрым визуальным прототипированием, чем предыдущие возможности изображений Gemini. По сравнению с GPT Image, Qwen Image и Seedream он удобен для объединения документов, изображений и подсказок в одном визуальном рабочем процессе.
Тип входа:
Тип выхода:
ReasoningMultimodal Output
Claude
claude-opus-4-5
Anthropic
Контекст200K
Вход$5.0000/M
Вывод$25.0000/M
Направленный на основные рассуждения и сложные задачи агента, он идет дальше, чем предварительные версии серии Claude 4 с точки зрения длинного контекста, кода, использования инструментов и сложного планирования; по сравнению с флагманскими моделями, такими как GPT, Gemini и Qwen, он больше подходит для высоконадежных агентов, обслуживания кодовой базы и рабочих процессов углубленных исследований.
Тип входа:
Тип выхода:
ReasoningTool UseStructured OutputLong Context
Gemini
veo3.1-lite
Google
ЗА ВЫЗОВ$0.1100/call
Создан для создания высококачественного видео и имеет более совершенный рабочий процесс обработки звука, управления камерой и эталонного ввода, чем Veo 2/3. По сравнению с Kling, Runway и Seedance он лучше подходит для короткометражных фильмов, рекламных раскадровок и видеороликов, требующих стабильного физического движения. Уровень Lite предпочитает высокопроизводительные и недорогие проекты по сравнению со стандартным уровнем.
Тип входа:
Тип выхода:
Multimodal Output
Gemini
veo3.1-fast
Google
ЗА ВЫЗОВ$0.2211/call
Создан для создания высококачественного видео и имеет более совершенный рабочий процесс обработки звука, управления камерой и эталонного ввода, чем Veo 2/3. По сравнению с Kling, Runway и Seedance он лучше подходит для короткометражных фильмов, рекламных раскадровок и видеороликов, требующих стабильного физического движения. Уровень «Быстрый» лучше подходит для быстрой проверки концепции, чем уровень «Стандартный».
Тип входа:
Тип выхода:
Multimodal Output
Gemini
veo3.1
Google
ЗА ВЫЗОВ$1.6544/call
Создан для создания высококачественного видео и имеет более совершенный рабочий процесс обработки звука, управления камерой и эталонного ввода, чем Veo 2/3. По сравнению с Kling, Runway и Seedance он лучше подходит для короткометражных фильмов, рекламных раскадровок и видеороликов, требующих стабильного физического движения.
Тип входа:
Тип выхода:
Multimodal Output
Gemini
gemini-2.5-flash-image
Google
Контекст66K
ЗА ИЗОБР.$0.0585/image
Создан для создания и редактирования изображений, с более глубоким пониманием мультимодальности, интерактивным редактированием и быстрым визуальным прототипированием, чем предыдущие возможности изображений Gemini. По сравнению с GPT Image, Qwen Image и Seedream он удобен для объединения документов, изображений и подсказок в одном визуальном рабочем процессе.
Тип входа:
Тип выхода:
Structured OutputMultimodal Output
Claude
claude-haiku-4-5
Anthropic
Контекст200K
Вход
$0.3400/M$1.0000/M
Вывод
$1.7000/M$5.0000/M
Для эффективного кодирования и задач агента он идет дальше, чем Claude Haiku 3.5, с точки зрения длинного контекста, кода, использования инструментов и сложного планирования; по сравнению с флагманскими моделями, такими как GPT, Gemini и Qwen, он больше подходит для высоконадежных агентов, обслуживания кодовой базы и рабочих процессов углубленных исследований.
Тип входа:
Тип выхода:
ReasoningTool UseStructured OutputLong Context
Gemini
gemini-3.6-flash
Google
Вход$1.5000/M
Вывод$7.5000/M
Gemini
gemini-3.5-flash-lite
Google
Вход$0.3000/M
Вывод$2.5000/M
Gemini
gemini-3.1-flash-lite-image
Google
ЗА ВЫЗОВ
$0.0120/call$0.0200/call
Gemini
gemini-3.1-flash-image
Google
ЗА ИЗОБР.
$0.0198/image$0.0330/image
Gemini
gemini-3-pro-image
Google
ЗА ИЗОБР.
$0.0318/image$0.0530/image
Claude
claude-opus-5
Anthropic
Вход
$1.7000/M$5.0000/M
Вывод
$8.5000/M$25.0000/M
Claude
claude-opus-4-7-thinking
Anthropic
Контекст1M
Вход$5.0000/M
Вывод$25.0000/M
Для основных рассуждений и сложных задач агента он идет дальше, чем Claude Opus 4.6, с точки зрения длинного контекста, кода, использования инструментов и сложного планирования; по сравнению с флагманскими моделями, такими как GPT, Gemini и Qwen, он больше подходит для высоконадежных агентов, обслуживания кодовой базы и рабочих процессов углубленных исследований.
Тип входа:
Тип выхода:
ReasoningTool UseStructured OutputLong Context
Doubao
doubao-seedream-5-0-pro
Doubao
ЗА СЕКУНДУ$0.0450/s
Мультимодальная модель генерации изображений для профессионального визуального создания. Он может генерировать изображения из текста и выполнять точное редактирование с использованием эталонных изображений и пространственных аннотаций, обладая преимуществами в плотной инфографике, типографике, реалистичном освещении и многоязычном рендеринге текста.
Тип входа:
Тип выхода:
ReasoningMultimodal Output
Doubao
doubao-seedance-2.5
Doubao
Вход
$3.4200/M$3.6000/M
Вывод
$3.4200/M$3.6000/M
Создан для профессиональной работы с видео, такой как реклама, фирменный контент и короткометражки, с упором на более длинные сцены, управление несколькими объектами и итеративную доработку. Он поддерживает генерацию текста и изображений, а также контроль ссылок R2V, объединяет мультимодальные ресурсы, производит до 30 секунд в стандартном режиме и может пересматривать выбранные регионы без регенерации всего клипа. Основные причины, по которым стоит выбрать его вместо Seedance 2.0, — это более продолжительные непрерывные снимки, более богатые исходные данные и более контролируемые исправления после генерации.
Doubao
doubao-seed-2-0-pro
Doubao
Контекст256K
Вход$0.5000/M
Вывод$2.5300/M
Создан для кодирования, агентов и сложных задач повышения производительности, выходя за рамки Doubao Seed 2.0 в длинном контексте, длительном выводе и рабочих процессах, ориентированных на инструменты. По сравнению с аналогами Qwen, GLM и DeepSeek, это экономически эффективный вариант для китайской офисной работы, кодирования и многоэтапной автоматизации.
Тип входа:
Тип выхода:
ReasoningWeb SearchTool UseFunction CallingStructured OutputLong Context
Qwen
qwen3.7-plus
Qwen
Контекст1M
Вход
$0.2400/M$0.3000/M
Вывод
$0.9600/M$1.2000/M
Разработан для агентских рабочих нагрузок, кодирования и офисной производительности, с более сильным комбинированным акцентом на длинный контекст, вызов инструментов и структурированный вывод, чем Qwen3.6. По сравнению с флагманскими моделями, такими как GPT, Claude и Gemini, это экономически эффективная альтернатива для китайского языка, кодирования и многоэтапных рабочих процессов с инструментами.
Тип входа:
Тип выхода:
ReasoningTool UseFunction CallingStructured OutputLong Context
Qwen
qwen3.6-plus
Qwen
Контекст1M
Вход
$0.9120/M$1.1400/M
Вывод
$5.4880/M$6.8599/M
Разработан для агентских рабочих нагрузок, кодирования и офисной производительности, с более сильным комбинированным акцентом на длинный контекст, вызов инструментов и структурированный вывод, чем Qwen3.5. По сравнению с флагманскими моделями, такими как GPT, Claude и Gemini, это экономически эффективная альтернатива для китайского языка, кодирования и многоэтапных рабочих процессов с инструментами.
Тип входа:
Тип выхода:
ReasoningTool UseStructured OutputLong Context
Qwen
qwen3.6-flash
Qwen
Контекст1M
Вход$0.1785/M
Вывод$1.0605/M
Разработан для агентских рабочих нагрузок, кодирования и офисной производительности, с более сильным комбинированным акцентом на длинный контекст, вызов инструментов и структурированный вывод, чем Qwen3.5. По сравнению с флагманскими моделями, такими как GPT, Claude и Gemini, это экономически эффективная альтернатива для китайского языка, кодирования и многоэтапных рабочих процессов с инструментами.
Тип входа:
Тип выхода:
ReasoningTool UseStructured OutputLong Context
Qwen
qwen-image-2.0-pro
Qwen
Вход$2.2000/M
Вывод$2.2000/M
Создан для создания и редактирования изображений, улучшен по сравнению с Qwen Image 1.x в рендеринге текста на китайском языке, выполнении инструкций и сложных макетах. По сравнению с изображениями GPT, моделями изображений Gemini и Seedream, он хорошо подходит для китайских плакатов, изображений для электронной коммерции, инфографики и итеративного визуального создания.
Тип входа:
Тип выхода:
Multimodal Output
Qwen
qwen-image-2.0
Qwen
Вход$2.2000/M
Вывод$2.2000/M
Создан для создания и редактирования изображений, улучшен по сравнению с Qwen Image 1.x в рендеринге текста на китайском языке, выполнении инструкций и сложных макетах. По сравнению с изображениями GPT, моделями изображений Gemini и Seedream, он хорошо подходит для китайских плакатов, изображений для электронной коммерции, инфографики и итеративного визуального создания.
Тип входа:
Тип выхода:
Multimodal Output
Minimax
MiniMax-H3
MiniMax
ЗА СЕКУНДУ$0.0800/s
XiaomiMiMo
mimo-v2.5-pro
Xiaomi MiMo
Контекст1M
Вход$1.1700/M
Вывод$3.5000/M
Создан для агентов, кодирования и задач с длинным контекстом, предлагает более полное мультимодальное понимание, контекстное окно с миллионом токенов и долгосрочное мышление, чем MiMo V2. По сравнению с китайскими аналогами, такими как Qwen, GLM и DeepSeek, его сильными сторонами являются соответствие экосистеме Xiaomi и сценарии автоматизации проектирования.
Тип входа:
Тип выхода:
ReasoningTool UseStructured OutputLong Context
XiaomiMiMo
mimo-v2.5
Xiaomi MiMo
Контекст1M
Вход$0.4700/M
Вывод$2.3600/M
Создан для агентов, кодирования и задач с длинным контекстом, предлагает более полное мультимодальное понимание, контекстное окно с миллионом токенов и долгосрочное мышление, чем MiMo V2. По сравнению с китайскими аналогами, такими как Qwen, GLM и DeepSeek, его сильными сторонами являются соответствие экосистеме Xiaomi и сценарии автоматизации проектирования.
Тип входа:
Тип выхода:
ReasoningTool UseStructured OutputLong Context
MoonshotAI
kimi-k2.7-code-highspeed
Moonshot
Контекст256K
Вход$1.9000/M
Вывод$7.9999/M
Создан для длительного контекстного, многоэтапного использования инструментов и рабочих процессов кода/документа, обладает более высокой стабильностью при выполнении инженерных задач и контекстной емкостью, чем Kimi K2.6. По сравнению с Qwen, GLM и DeepSeek он хорошо подходит для анализа длинных документов на китайском языке, вопросов и ответов по проектам и повседневного агентного программирования.
Тип входа:
Тип выхода:
Tool UseFunction CallingStructured OutputLong Context
Grok
grok-4.3
xAI
Контекст1M
Вход$1.3100/M
Вывод$2.6200/M
Создан для рассуждений, кодирования и задач с длинным контекстом в реальном времени, с более мощной обработкой длинного контекста и более быстрым откликом, чем в предыдущих версиях Grok 4.x. По сравнению с GPT, Claude и Gemini он полезен для анализа тенденций, помощи в кодировании и рабочих процессов с подключенной информацией в экосистеме xAI.
Тип входа:
Тип выхода:
ReasoningTool UseStructured OutputLong Context
Zhipu
glm-image
Zhipu AI
Вход$0.8800/M
Вывод$3.5500/M
Создан для создания и редактирования изображений, с более сильным акцентом, чем предыдущие возможности GLM Vision, на подсказках на китайском языке, понимании текста и изображений и управляемом создании. По сравнению с изображением GPT, моделями изображений Gemini и изображением Qwen оно соответствует китайским маркетинговым ресурсам, пояснительным визуальным элементам и итеративным визуальным редактированиям.
Тип входа:
Тип выхода:
Multimodal Output
Doubao
dreamina-seedance-2-0-mini
Doubao
Вход$75.0000/M
Вывод$75.0000/M
Более легкий уровень Seedance 2.0 для создания видео, полезный для быстрого преобразования текста или справочных изображений в короткие видеоресурсы для социальных сетей, электронной коммерции и творческих проектов. Он ориентирован на быструю итерацию и производство активов; Прежде чем сделать окончательный выбор, просмотрите движение, поведение камеры и согласованность объекта.
Тип входа:
Тип выхода:
Multimodal Output
DeepSeek
deepseek-v4-flash-vision-exp
DeepSeek
Вход$0.1490/M
Вывод$0.2980/M
An experimental multimodal variant of DeepSeek-V4-Flash for image understanding alongside text. A practical choice for visual Q&A, screenshot and document analysis, while its experimental status makes it better suited to evaluation and flexible workflows than strict production-critical paths.
DeepSeek
deepseek-v3.2
DeepSeek
Вход$0.2100/M
Вывод$0.3200/M
Создан для рассуждений, кодирования и использования агентских инструментов, с более сильным длинным контекстом, режимом мышления и выполнением сложных задач, чем DeepSeek V3.1. По сравнению с китайскими аналогами, такими как Qwen, GLM и Kimi, он особенно конкурентоспособен в решении задач по математике, программированию и логическому рассуждению.
Тип входа:
Тип выхода:
ReasoningTool Use
WhatsApp