Google

Gemini 3.7 Flash API

A new fast multimodal model in the Gemini 3 family, released in August 2026, built for low-cost, high-throughput multimodal understanding. It accepts text, image, video, audio and document inputs with a 1M-token context, suited to large-scale processing, batch workloads and real-time interactions.

  • Raisonnement
  • Utilisation d’outils
  • Contexte long

La description n’est pas encore disponible dans cette langue ; elle est affichée en anglais.

Utiliser dans la consolegemini-3.7-flash

USD

Tarifs

default
Tarif standard
Entrée$0.75/1M tokensPrix de complétion$3.75/1M tokensLecture cache$0.144975/1M tokensÉcriture cache$0.999975/1M tokensImage$0.999975/1M tokensEntrée audio$0.999975/1M tokens

Prix publics en dollars US. Le coût final peut varier selon le groupe de compte et le volume d’utilisation.

API

Exemples de code

curl --location --request POST 'https://api.tokenhot.ai/v1beta/models/gemini-3.7-flash:generateContent' \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data-raw '{
    "contents": [
        {
            "role": "user",
            "parts": [
                {
                    "text": "Hello"
                }
        }
    ]
}'

Google

Modèles associés

GeminiGoogleGemini 3.5 Flash Lite

The fastest and most cost-effective model in the Gemini 3.5 line, built for high-throughput, low-latency work such as translation, classification, document processing, and lightweight agentic workflows. It supports multimodal inputs and up to a 1M-token context, while demanding reasoning, long-horizon planning, or high-quality code changes are better handled by a higher-tier Flash model.

$0.3/1M tokens
GeminiGoogleGemini 2.5 Flash Image

Conçu pour la génération et l'édition d'images, avec une compréhension multimodale, des modifications conversationnelles et un prototypage visuel plus rapides que les fonctionnalités d'image Gemini antérieures. Comparé à GPT Image, Qwen Image et Seedream, il est utile pour combiner des documents, des images et des invites dans un seul flux de travail visuel.

$0.0585/image
GeminiGoogleGemini 3 Flash Preview

Modèle de réflexion rapide de Google conçu pour les flux de travail agents, le chat multi-tours et l'assistance au codage. Prend en charge la saisie de texte, d'image, d'audio, de vidéo et de PDF avec une fenêtre contextuelle de jeton de 1 M. Comprend des niveaux de réflexion configurables, l’utilisation d’outils et une sortie structurée. Améliorations apportées à la qualité par rapport à Gemini 2.5 Flash en termes de raisonnement, de compréhension multimodale et de fiabilité.

$0.5/1M tokens
GeminiGoogleGemini 3.6 Flash

The workhorse of the Gemini Flash line, balancing efficiency with coding, knowledge work, and multimodal understanding. Compared with 3.5 Flash, it is designed to complete multi-step tasks with fewer output tokens, reasoning steps, and tool calls, making it a good fit for production agents, document and chart analysis, and frequent complex workflows.

$1.5/1M tokens

FAQ

Questions fréquentes

À quels usages Gemini 3.7 Flash convient-il ?

Gemini 3.7 Flash convient aux types d’entrée, de sortie et de capacités indiqués sur cette page. Testez vos charges réelles avant un usage critique.

Comment Gemini 3.7 Flash est-il facturé ?

Les tarifs figurent ci-dessus. Le coût réel dépend du volume, du groupe de compte et du contenu de la requête.

Comment appeler Gemini 3.7 Flash ?

Utilisez l’identifiant du modèle ci-dessus avec un protocole API pris en charge. Des exemples sont affichés lorsqu’ils sont disponibles.

Commencer

Créez avec Gemini 3.7 Flash

Utiliser dans la console
WhatsApp