Google

Gemini 3.8 Flash API

The flagship Flash model for long-horizon software engineering, autonomous agents, and complex enterprise workflows. It keeps the speed and cost profile of Flash while adding stronger reasoning and tool orchestration. It accepts text, images, video, audio, and PDF input, with about a 1.05M-token context window, search grounding, function calling, code execution, structured outputs, and tunable thinking. Prefer it over Flash-Lite for harder tasks, at higher usage cost.

  • Raisonnement
  • Recherche web
  • Utilisation d’outils
  • Appel de fonctions
  • Sortie structurée
  • Contexte long
  • Exécution de code

La description n’est pas encore disponible dans cette langue ; elle est affichée en anglais.

Utiliser dans la consolegemini-3.8-flash

USD

Tarifs

default
Tarif standard
Entrée$0.7874/1M tokensPrix de complétion$3.937/1M tokensLecture cache$0.078661/1M tokensÉcriture cache$0.999998/1M tokensImage$0.7874/1M tokensEntrée audio$0.7874/1M tokens

Prix publics en dollars US. Le coût final peut varier selon le groupe de compte et le volume d’utilisation.

API

Exemples de code

curl --location --request POST 'https://api.tokenhot.ai/v1beta/models/gemini-3.8-flash:generateContent' \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data-raw '{
    "contents": [
        {
            "role": "user",
            "parts": [
                {
                    "text": "Hello"
                }
        }
    ]
}'

Google

Modèles associés

GeminiGoogleGemini 2.5 Flash Image

Conçu pour la génération et l'édition d'images, avec une compréhension multimodale, des modifications conversationnelles et un prototypage visuel plus rapides que les fonctionnalités d'image Gemini antérieures. Comparé à GPT Image, Qwen Image et Seedream, il est utile pour combiner des documents, des images et des invites dans un seul flux de travail visuel.

$0.0585/image
GeminiGoogleGemini 3.1 PRO Preview

Conçu pour la compréhension multimodale, le codage et les tâches à contexte long, améliorant par rapport à Gemini 3.0/2.5 en termes de débit, de contexte et de capacités d'outils. Comparé aux modèles GPT, Claude et Qwen, il est puissant pour les flux de travail d'analyse unifiés du texte, des images, de l'audio, de la vidéo et des documents.

$2/1M tokens
GeminiGoogleGemini 3.5 Flash Lite

The fastest and most cost-effective model in the Gemini 3.5 line, built for high-throughput, low-latency work such as translation, classification, document processing, and lightweight agentic workflows. It supports multimodal inputs and up to a 1M-token context, while demanding reasoning, long-horizon planning, or high-quality code changes are better handled by a higher-tier Flash model.

$0.3/1M tokens
GeminiGoogleGemini 3 PRO Image Preview

Conçu pour la génération et l'édition d'images, avec une compréhension multimodale, des modifications conversationnelles et un prototypage visuel plus rapides que les fonctionnalités d'image Gemini antérieures. Comparé à GPT Image, Qwen Image et Seedream, il est utile pour combiner des documents, des images et des invites dans un seul flux de travail visuel.

$0.134/image

FAQ

Questions fréquentes

À quels usages Gemini 3.8 Flash convient-il ?

Gemini 3.8 Flash convient aux types d’entrée, de sortie et de capacités indiqués sur cette page. Testez vos charges réelles avant un usage critique.

Comment Gemini 3.8 Flash est-il facturé ?

Les tarifs figurent ci-dessus. Le coût réel dépend du volume, du groupe de compte et du contenu de la requête.

Comment appeler Gemini 3.8 Flash ?

Utilisez l’identifiant du modèle ci-dessus avec un protocole API pris en charge. Des exemples sont affichés lorsqu’ils sont disponibles.

Commencer

Créez avec Gemini 3.8 Flash

Utiliser dans la console
WhatsApp