美团

LongCat 2.0 API

Un outil de travail LongCat 2.0 pour le codage à l'échelle d'un projet et les tâches d'agent de longue durée, avec un contexte natif de jeton 1M ainsi que des appels d'outils et un raisonnement en plusieurs étapes. C'est mieux lorsque vous devez conserver des référentiels volumineux, des documents longs ou des flux de travail d'automatisation dans la portée ; pour des questions et réponses légères ou des discussions à faible latence, un modèle plus petit de style Flash/Lite est généralement moins cher.

  • Raisonnement
  • Utilisation d’outils
  • Appel de fonctions
  • Contexte long

USD

Tarifs

default
Tarif standard
Entrée$0.3/1M tokensPrix de complétion$1.2/1M tokensLecture cache$0.006/1M tokens

Prix publics en dollars US. Le coût final peut varier selon le groupe de compte et le volume d’utilisation.

美团

Modèles associés

QwenQwenQwen3.7 MAX

Conçu pour les charges de travail agents, le codage et la productivité bureautique, avec un accent combiné plus fort sur le contexte long, les appels d'outils et la sortie structurée que Qwen3.6. Comparé aux modèles phares tels que GPT, Claude et Gemini, il s'agit d'une alternative rentable pour les flux de travail en chinois, en codage et en outils en plusieurs étapes.

$1.8/1M tokens
GrokxAIGrok 4.3

Conçu pour le raisonnement en temps réel, le codage et les tâches à contexte long, avec une gestion de contexte long plus efficace et des réponses rapides que les versions précédentes de Grok 4.x. Comparé à GPT, Claude et Gemini, il est utile pour l'analyse des tendances, l'assistance au codage et les flux de travail d'informations connectées dans l'écosystème xAI.

$1.31/1M tokens
GrokxAIGrok 4.5

Un modèle de raisonnement frontalier pour le codage, le travail de connaissances et les tâches STEM. Il prend en charge l'entrée d'image, l'appel de fonction et les sorties structurées ; son contexte de 500 000 jetons convient à l'analyse multi-fichiers et aux sources longues. Préférez un modèle à moindre coût lorsque le raisonnement frontalier n’est pas nécessaire.

$2.1/1M tokens
GeminiGoogleGemini 3 Flash Preview

Modèle de réflexion rapide de Google conçu pour les flux de travail agents, le chat multi-tours et l'assistance au codage. Prend en charge la saisie de texte, d'image, d'audio, de vidéo et de PDF avec une fenêtre contextuelle de jeton de 1 M. Comprend des niveaux de réflexion configurables, l’utilisation d’outils et une sortie structurée. Améliorations apportées à la qualité par rapport à Gemini 2.5 Flash en termes de raisonnement, de compréhension multimodale et de fiabilité.

$0.5/1M tokens

FAQ

Questions fréquentes

À quels usages LongCat 2.0 convient-il ?

LongCat 2.0 convient aux types d’entrée, de sortie et de capacités indiqués sur cette page. Testez vos charges réelles avant un usage critique.

Comment LongCat 2.0 est-il facturé ?

Les tarifs figurent ci-dessus. Le coût réel dépend du volume, du groupe de compte et du contenu de la requête.

Comment appeler LongCat 2.0 ?

Utilisez l’identifiant du modèle ci-dessus avec un protocole API pris en charge. Des exemples sont affichés lorsqu’ils sont disponibles.

Commencer

Créez avec LongCat 2.0

Utiliser dans la console
TokenHot

La passerelle d'intelligence de frontière. Une API. 127 modèles. Latence de 0.2s. Payez uniquement ce que vous utilisez.

Tous les systèmes normaux · 99.997% de disponibilité

Entreprise

© 2026 TokenHot Inc. — Conçu pour les créateurs.