Google

Gemini 3.8 Flash API

The flagship Flash model for long-horizon software engineering, autonomous agents, and complex enterprise workflows. It keeps the speed and cost profile of Flash while adding stronger reasoning and tool orchestration. It accepts text, images, video, audio, and PDF input, with about a 1.05M-token context window, search grounding, function calling, code execution, structured outputs, and tunable thinking. Prefer it over Flash-Lite for harder tasks, at higher usage cost.

  • Рассуждение
  • Веб-поиск
  • Инструменты
  • Вызов функций
  • Структурированный вывод
  • Длинный контекст
  • Выполнение кода

Описание на выбранном языке пока недоступно, поэтому показана английская версия.

USD

Цены

default
Стандартный тариф
Ввод$0.7874/1M tokensЦена завершения$3.937/1M tokensЧтение кэша$0.078661/1M tokensЗапись кэша$0.999998/1M tokensИзображение$0.7874/1M tokensАудиоввод$0.7874/1M tokens

Показаны публичные цены в долларах США. Итоговая стоимость зависит от группы аккаунта и объёма использования.

API

Примеры кода

curl --location --request POST 'https://api.tokenhot.ai/v1beta/models/gemini-3.8-flash:generateContent' \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data-raw '{
    "contents": [
        {
            "role": "user",
            "parts": [
                {
                    "text": "Hello"
                }
        }
    ]
}'

Google

Похожие модели

GeminiGoogleGemini 2.5 Flash Image

Создан для создания и редактирования изображений, с более глубоким пониманием мультимодальности, интерактивным редактированием и быстрым визуальным прототипированием, чем предыдущие возможности изображений Gemini. По сравнению с GPT Image, Qwen Image и Seedream он удобен для объединения документов, изображений и подсказок в одном визуальном рабочем процессе.

$0.0585/image
GeminiGoogleGemini 3.1 PRO Preview

Создан для мультимодального понимания, кодирования и задач с длинным контекстом, улучшен по сравнению с Gemini 3.0/2.5 по пропускной способности, контексту и возможностям инструментов. По сравнению с моделями GPT, Claude и Qwen он обеспечивает унифицированные рабочие процессы анализа текста, изображений, аудио, видео и документов.

$2/1M tokens
GeminiGoogleGemini 3.5 Flash Lite

The fastest and most cost-effective model in the Gemini 3.5 line, built for high-throughput, low-latency work such as translation, classification, document processing, and lightweight agentic workflows. It supports multimodal inputs and up to a 1M-token context, while demanding reasoning, long-horizon planning, or high-quality code changes are better handled by a higher-tier Flash model.

$0.3/1M tokens
GeminiGoogleGemini 3 PRO Image Preview

Создан для создания и редактирования изображений, с более глубоким пониманием мультимодальности, интерактивным редактированием и быстрым визуальным прототипированием, чем предыдущие возможности изображений Gemini. По сравнению с GPT Image, Qwen Image и Seedream он удобен для объединения документов, изображений и подсказок в одном визуальном рабочем процессе.

$0.134/image

FAQ

Частые вопросы

Для чего лучше всего подходит Gemini 3.8 Flash?

Gemini 3.8 Flash подходит для указанных на странице типов ввода, вывода и возможностей. Перед критическим использованием проверьте реальную нагрузку.

Как рассчитывается цена Gemini 3.8 Flash?

Цены указаны выше. Фактическая стоимость зависит от объёма, группы аккаунта и содержимого запроса.

Как вызвать Gemini 3.8 Flash?

Используйте идентификатор модели и поддерживаемый протокол API. Примеры кода показаны, когда доступны данные использования.

Начать

Создавайте с Gemini 3.8 Flash

Открыть в консоли
WhatsApp