Цены на LLM API

Модели Qwen

Все модели Qwen, доступные в TokenHot: 15.

Один API-ключ открывает доступ к 15 моделям Qwen с актуальными ценами и без отдельной учётной записи провайдера.

Контекст1M
Вход$0.1492/M
Вывод$0.4476/M
An efficient multimodal workhorse in the Qwen family, with a native million-token context window and strong support for coding assistance, agentic workflows, and visual understanding such as charts. It fits long documents, codebases, high-concurrency applications, and tool-assisted tasks.
Тип входа:
Тип выхода:
ReasoningTool UseStructured OutputLong Context
Попробовать модель
ЗА СЕКУНДУ$0.0675/s
The speed-first variant of Alibaba's Wan 3.0 line (early access). It shortens generation latency while retaining high-quality video output, making it a good fit for low-latency previews, batch drafts and fast-iterating short-video workflows. If ultimate visual control matters more than speed, the standard version is a better choice.
Тип входа:
Тип выхода:
Qwen
ЗА СЕКУНДУ$0.0450/s
The standard video generation model of Alibaba's Wan 3.0 line (early access). It supports text-to-video, image-to-video and multi-modal reference inputs, generating clips up to roughly 30 seconds with synchronized audio in a single pass — suitable for ads, short drama and narrative content. Official release date not yet announced.
Тип входа:
Тип выхода:
Multimodal Output
Qwen
Контекст1M
Вход
$1.4200/M$1.7750/M
Вывод
$4.2640/M$5.3300/M
Qwen's most capable flagship multimodal reasoning model, built for long-horizon coding, professional work, and multi-stage agent tasks. It accepts text, images, and video, offers a 1M-token context window with up to 128K output, and supports function calling, structured outputs, web search, and a code interpreter. It is best used as a high-quality workhorse for complex tasks rather than for the lowest-cost, lowest-latency batch workloads.
Тип входа:
Тип выхода:
ReasoningWeb SearchTool UseFunction CallingStructured OutputLong ContextCode Execution
Попробовать модель
ЗА СЕКУНДУ
$0.0024/s$0.0030/s
A quality-first image generation and editing model: it supports text-to-image and edits from 1–3 reference images, accepts prompts of up to about 4.5K tokens, and is aimed at dense layouts, fine 10px-scale text, 12 languages, and multiple fonts. Choose it over the standard variant when complex composition and detail fidelity matter more than speed or cost; use the standard variant for a faster, more economical workflow.
Тип входа:
Тип выхода:
ЗА СЕКУНДУ
$0.0024/s$0.0030/s
The balanced standard tier of Qwen-Image 3.0 for image generation and editing: it supports text-to-image and edits from 1–3 reference images, prompts of up to about 4.5K tokens, up to six outputs, and 2K-class resolution. It fits everyday posters, interfaces, infographics, and repeated creative work; move to Pro when complex layouts and fine text fidelity matter more, and use this tier when speed and cost efficiency are the priority.
Тип входа:
Тип выхода:
ЗА СЕКУНДУ$0.1350/s
Создан для преобразования текста в видео, имеет более мощный рабочий процесс со звуком, чем HappyHorse 1.0, генерирующий диалоги, звуковые эффекты и фоновую музыку за один проход. По сравнению с Veo, Kling и Runway его отличительной особенностью является синхронизированная генерация аудиовизуальных данных и согласованные с персонажами рабочие процессы для короткометражных драм, рекламы, электронной коммерции и бренд-маркетинга.
Тип входа:
Тип выхода:
Multimodal Output
ЗА СЕКУНДУ$0.1350/s
Создан для сравнения с видео, имеет более мощный рабочий процесс со звуком, чем HappyHorse 1.0, генерирующий диалоги, звуковые эффекты и фоновую музыку за один проход. По сравнению с Veo, Kling и Runway его отличительной особенностью является синхронизированная генерация аудиовизуальных данных и согласованные с персонажами рабочие процессы для короткометражных драм, рекламы, электронной коммерции и бренд-маркетинга.
Тип входа:
Тип выхода:
Multimodal Output
ЗА СЕКУНДУ$0.1350/s
Создан для преобразования изображения в видео, имеет более мощный рабочий процесс со звуком, чем HappyHorse 1.0, генерирующий диалоги, звуковые эффекты и фоновую музыку за один проход. По сравнению с Veo, Kling и Runway его отличительной особенностью является синхронизированная генерация аудиовизуальных данных и согласованные с персонажами рабочие процессы для короткометражных драм, рекламы, электронной коммерции и бренд-маркетинга.
Тип входа:
Тип выхода:
Multimodal Output
Qwen
Контекст1M
Вход
$0.2400/M$0.3000/M
Вывод
$0.9600/M$1.2000/M
Разработан для агентских рабочих нагрузок, кодирования и офисной производительности, с более сильным комбинированным акцентом на длинный контекст, вызов инструментов и структурированный вывод, чем Qwen3.6. По сравнению с флагманскими моделями, такими как GPT, Claude и Gemini, это экономически эффективная альтернатива для китайского языка, кодирования и многоэтапных рабочих процессов с инструментами.
Тип входа:
Тип выхода:
ReasoningTool UseFunction CallingStructured OutputLong Context
Попробовать модель
Qwen
Контекст1M
Вход
$1.4400/M$1.8000/M
Вывод
$4.3200/M$5.4000/M
Разработан для агентских рабочих нагрузок, кодирования и офисной производительности, с более сильным комбинированным акцентом на длинный контекст, вызов инструментов и структурированный вывод, чем Qwen3.6. По сравнению с флагманскими моделями, такими как GPT, Claude и Gemini, это экономически эффективная альтернатива для китайского языка, кодирования и многоэтапных рабочих процессов с инструментами.
Тип входа:
Тип выхода:
ReasoningTool UseFunction CallingStructured OutputLong Context
Попробовать модель
Контекст8K
ЗА СЕКУНДУ$0.1350/s
При редактировании видео, по сравнению с ранними моделями видео, в нем больше внимания уделяется генерации собственного звука, завершению диалогов, звуковых эффектов и фоновой музыки за один раз; по сравнению с Veo, Kling и Runway его отличительные преимущества заключаются в звуковой и визуальной синхронизации и согласованности рабочего процесса. Подходит для коротких драм, рекламы, видеороликов об электронной коммерции и бренд-маркетинге.
Тип входа:
Тип выхода:
Multimodal Output
Контекст8K
ЗА СЕКУНДУ$0.1350/s
В видео Wensheng, по сравнению с ранними моделями видео, больше внимания уделяется генерации собственного звука, одновременному завершению диалогов, звуковых эффектов и фоновой музыки; по сравнению с Veo, Kling и Runway его отличительные преимущества заключаются в звуковой и визуальной синхронизации и согласованности рабочего процесса. Подходит для коротких драм, рекламы, видеороликов об электронной коммерции и бренд-маркетинге.
Тип входа:
Тип выхода:
Multimodal Output
Контекст8K
ЗА СЕКУНДУ$0.1350/s
Генерация видео для справки по сравнению с ранними моделями видео более важна при создании собственного звука и завершает диалоги, звуковые эффекты и фоновую музыку за один раз; по сравнению с Veo, Kling и Runway его отличительные преимущества заключаются в звуковой и визуальной синхронизации и согласованности рабочего процесса. Подходит для коротких драм, рекламы, видеороликов об электронной коммерции и бренд-маркетинге.
Тип входа:
Тип выхода:
Multimodal Output
Контекст8K
ЗА СЕКУНДУ$0.1350/s
В видео Tusheng, по сравнению с ранними моделями видео, больше внимания уделяется генерации собственного звука, одновременному завершению диалогов, звуковых эффектов и фоновой музыки; по сравнению с Veo, Kling и Runway его отличительные преимущества заключаются в звуковой и визуальной синхронизации и согласованности рабочего процесса. Подходит для коротких драм, рекламы, видеороликов об электронной коммерции и бренд-маркетинге.
Тип входа:
Тип выхода:
Multimodal Output