Qwen

Qwen3.6 Flash API

Разработан для агентских рабочих нагрузок, кодирования и офисной производительности, с более сильным комбинированным акцентом на длинный контекст, вызов инструментов и структурированный вывод, чем Qwen3.5. По сравнению с флагманскими моделями, такими как GPT, Claude и Gemini, это экономически эффективная альтернатива для китайского языка, кодирования и многоэтапных рабочих процессов с инструментами.

  • Рассуждение
  • Инструменты
  • Структурированный вывод
  • Длинный контекст

USD

Цены

default
input<256K
Ввод$0.1785/1M tokensЦена завершения$1.0605/1M tokensЧтение кэша$0.018/1M tokensЗапись кэша$0.22/1M tokens
input>=272K
Ввод$0.714/1M tokensЦена завершения$4.263/1M tokensЧтение кэша$0.07/1M tokensЗапись кэша$0.89/1M tokens

Показаны публичные цены в долларах США. Итоговая стоимость зависит от группы аккаунта и объёма использования.

API

Примеры кода

curl --location --request POST 'https://api.tokenhot.ai/v1/chat/completions' \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data-raw '{
    "model": "qwen3.6-flash",
    "messages": [
        {
            "role": "user",
            "content": "What model are you"
        }
    ]
}'

Qwen

Похожие модели

QwenQwenQwen3.6 MAX Preview

Alibaba Qwen 3.6 Max Preview, модель, созданная редкими экспертами, с примерно 1 триллионом параметров. Оптимизирован для агентного кодирования, использования инструментов и рассуждений в длинном контексте благодаря интегрированному режиму мышления, который сохраняет следы рассуждений во время многоходовых разговоров. Контекстное окно размером 262 КБ, доступное через API Alibaba Cloud Model Studio.

$1.33/1M tokens
QwenQwenQwen3.6 Plus

Разработан для агентских рабочих нагрузок, кодирования и офисной производительности, с более сильным комбинированным акцентом на длинный контекст, вызов инструментов и структурированный вывод, чем Qwen3.5. По сравнению с флагманскими моделями, такими как GPT, Claude и Gemini, это экономически эффективная альтернатива для китайского языка, кодирования и многоэтапных рабочих процессов с инструментами.

$1.14/1M tokens
QwenQwenQwen3.7 MAX

Разработан для агентских рабочих нагрузок, кодирования и офисной производительности, с более сильным комбинированным акцентом на длинный контекст, вызов инструментов и структурированный вывод, чем Qwen3.6. По сравнению с флагманскими моделями, такими как GPT, Claude и Gemini, это экономически эффективная альтернатива для китайского языка, кодирования и многоэтапных рабочих процессов с инструментами.

$1.8/1M tokens
QwenQwenQwen3.7 Plus

Разработан для агентских рабочих нагрузок, кодирования и офисной производительности, с более сильным комбинированным акцентом на длинный контекст, вызов инструментов и структурированный вывод, чем Qwen3.6. По сравнению с флагманскими моделями, такими как GPT, Claude и Gemini, это экономически эффективная альтернатива для китайского языка, кодирования и многоэтапных рабочих процессов с инструментами.

$0.3/1M tokens

FAQ

Частые вопросы

Для чего лучше всего подходит Qwen3.6 Flash?

Qwen3.6 Flash подходит для указанных на странице типов ввода, вывода и возможностей. Перед критическим использованием проверьте реальную нагрузку.

Как рассчитывается цена Qwen3.6 Flash?

Цены указаны выше. Фактическая стоимость зависит от объёма, группы аккаунта и содержимого запроса.

Как вызвать Qwen3.6 Flash?

Используйте идентификатор модели и поддерживаемый протокол API. Примеры кода показаны, когда доступны данные использования.

Начать

Создавайте с Qwen3.6 Flash

Открыть в консоли