DeepSeek

V4 Flash API

Conçu pour le raisonnement, le codage et l'utilisation d'outils agentiques, avec une exécution de contexte long, de mode de réflexion et de tâches complexes plus puissante que DeepSeek V3.2. Comparé à ses pairs chinois tels que Qwen, GLM et Kimi, il est particulièrement compétitif pour les tâches de mathématiques, de programmation et de raisonnement logique.

  • Contexte long
  • Utilisation d’outils
  • Raisonnement
  • Sortie structurée
Utiliser dans la consoledeepseek-v4-flash

USD

Tarifs

default
Tarif standard
Entrée$0.142/1M tokensPrix de complétion$0.286002/1M tokensLecture cache$0.019994/1M tokens

Prix publics en dollars US. Le coût final peut varier selon le groupe de compte et le volume d’utilisation.

API

Exemples de code

curl --location --request POST 'https://api.tokenhot.ai/v1/chat/completions' \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data-raw '{
    "model": "deepseek-v4-flash",
    "messages": [
        {
            "role": "user",
            "content": "What model are you"
        }
    ]
}'

DeepSeek

Modèles associés

DeepSeekDeepSeekV4 PRO

Conçu pour le raisonnement, le codage et l'utilisation d'outils agentiques, avec une exécution de contexte long, de mode de réflexion et de tâches complexes plus puissante que DeepSeek V3.2. Comparé à ses pairs chinois tels que Qwen, GLM et Kimi, il est particulièrement compétitif pour les tâches de mathématiques, de programmation et de raisonnement logique.

$1.71/1M tokens
DeepSeekDeepSeekV3.2

Conçu pour le raisonnement, le codage et l'utilisation d'outils agentiques, avec une exécution de contexte long, de mode de réflexion et de tâches complexes plus puissante que DeepSeek V3.1. Comparé à ses pairs chinois tels que Qwen, GLM et Kimi, il est particulièrement compétitif pour les tâches de mathématiques, de programmation et de raisonnement logique.

$0.21/1M tokens
DeepSeekDeepSeekV3.2 Thinking

Conçu pour le raisonnement, le codage et l'utilisation d'outils agentiques, avec une exécution de contexte long, de mode de réflexion et de tâches complexes plus puissante que DeepSeek V3.1. Comparé à ses pairs chinois tels que Qwen, GLM et Kimi, il est particulièrement compétitif pour les tâches de mathématiques, de programmation et de raisonnement logique.

$0.31/1M tokens
MinimaxMiniMaxM2.5

Un modèle rentable pour les vrais agents de productivité, les plus performants en matière de codage, d'utilisation d'outils, de recherche et de livrables de type bureautique plutôt que de simple conversation informelle. Il convient aux agents qui planifient et exécutent les modifications inter-fichiers, la récupération de recherche et les flux de travail de documents/feuilles de calcul/présentations ; Par rapport aux produits phares plus chers, le principal compromis est un coût inférieur pour une efficacité d'exécution proche des frontières.

$0.302/1M tokens

FAQ

Questions fréquentes

À quels usages V4 Flash convient-il ?

V4 Flash convient aux types d’entrée, de sortie et de capacités indiqués sur cette page. Testez vos charges réelles avant un usage critique.

Comment V4 Flash est-il facturé ?

Les tarifs figurent ci-dessus. Le coût réel dépend du volume, du groupe de compte et du contenu de la requête.

Comment appeler V4 Flash ?

Utilisez l’identifiant du modèle ci-dessus avec un protocole API pris en charge. Des exemples sont affichés lorsqu’ils sont disponibles.

Commencer

Créez avec V4 Flash

Utiliser dans la console