DeepSeek
V4.1 Flash
适合作为高吞吐、低成本的通用与 Agent 主力:原生支持图像理解和 1M 上下文,并可在思考与非思考模式间切换,支持工具调用与 JSON 输出。相比更高档的 V4 Pro,定位更偏向速度、吞吐和成本效率,适合长文档、代码/Agent 及图文分析;需要更深推理时再开启思考模式。
- 推理
- 工具呼叫
- 結構化輸出
- 長上下文
此模型暫無目前語言的介紹,以下顯示英文內容。
在控制台使用
deepseek-v4.1-flashAI 對話
輸入提示詞,在這裡查看模型回覆。
deepseek-v4.1-flash有什麼可以幫你?
向這個模型提問,也可以結合上下文繼續追問。
USD /1M tokens
價格
| 分組 | 輸入 | 輸出 |
|---|---|---|
| default | $0.3 | $1.2 |
default
輸入$0.3輸出$1.2
顯示價格為美元公開價,實際費用可能因帳戶群組與用量級別而異。
API
程式碼範例
curl --location --request POST 'https://api.tokenhot.ai/v1/chat/completions' \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data-raw '{
"model": "deepseek-v4.1-flash",
"messages": [
{
"role": "user",
"content": "What model are you"
}
]
}'Blog
相關文章
FAQ
常見問題
V4.1 Flash 適合哪些場景?
V4.1 Flash 適合本頁所列的輸入、輸出與能力類型。用於關鍵業務前,建議以真實負載驗證。
V4.1 Flash 如何計費?
價格請見上方,實際成本取決於用量、帳戶群組與請求內容。
如何呼叫 V4.1 Flash?
使用上方模型 ID,透過支援的 API 協議呼叫;有使用資料時會顯示程式碼範例。
開始使用
使用 V4.1 Flash 建構
API