DeepSeek

V4 Flash API

Được xây dựng để sử dụng công cụ lý luận, mã hóa và tác nhân, với bối cảnh dài, chế độ tư duy và thực thi tác vụ phức tạp mạnh hơn DeepSeek V3.2. So với các công ty cùng ngành của Trung Quốc như Qwen, GLM và Kimi, nó đặc biệt cạnh tranh trong các nhiệm vụ toán học, lập trình và suy luận logic.

  • Ngữ cảnh dài
  • Sử dụng công cụ
  • Suy luận
  • Đầu ra có cấu trúc
Dùng trong Consoledeepseek-v4-flash

USD

Bảng giá

default
Giá tiêu chuẩn
Đầu vào$0.142/1M tokensGiá hoàn thiện$0.286002/1M tokensĐọc cache$0.019994/1M tokens

Giá niêm yết bằng USD. Chi phí cuối có thể thay đổi theo nhóm tài khoản và mức sử dụng.

API

Ví dụ mã

curl --location --request POST 'https://api.tokenhot.ai/v1/chat/completions' \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data-raw '{
    "model": "deepseek-v4-flash",
    "messages": [
        {
            "role": "user",
            "content": "What model are you"
        }
    ]
}'

DeepSeek

Mô hình liên quan

DeepSeekDeepSeekV4 PRO

Được xây dựng để sử dụng công cụ lý luận, mã hóa và tác nhân, với bối cảnh dài, chế độ tư duy và thực thi tác vụ phức tạp mạnh hơn DeepSeek V3.2. So với các công ty cùng ngành của Trung Quốc như Qwen, GLM và Kimi, nó đặc biệt cạnh tranh trong các nhiệm vụ toán học, lập trình và suy luận logic.

$1.71/1M tokens
DeepSeekDeepSeekV3.2

Được xây dựng để sử dụng công cụ lý luận, mã hóa và tác nhân, với bối cảnh dài, chế độ tư duy và thực thi tác vụ phức tạp mạnh hơn DeepSeek V3.1. So với các công ty cùng ngành của Trung Quốc như Qwen, GLM và Kimi, nó đặc biệt cạnh tranh trong các nhiệm vụ toán học, lập trình và suy luận logic.

$0.21/1M tokens
DeepSeekDeepSeekV3.2 Thinking

Được xây dựng để sử dụng công cụ lý luận, mã hóa và tác nhân, với bối cảnh dài, chế độ tư duy và thực thi tác vụ phức tạp mạnh hơn DeepSeek V3.1. So với các công ty cùng ngành của Trung Quốc như Qwen, GLM và Kimi, nó đặc biệt cạnh tranh trong các nhiệm vụ toán học, lập trình và suy luận logic.

$0.31/1M tokens
MinimaxMiniMaxM2.5

Một mô hình tiết kiệm chi phí dành cho các tác nhân có năng suất thực sự, mạnh mẽ nhất về mã hóa, sử dụng công cụ, tìm kiếm và cung cấp các sản phẩm theo phong cách văn phòng thay vì chỉ trò chuyện thông thường. Nó phù hợp với các tác nhân lập kế hoạch và thực hiện các thay đổi trên nhiều tệp, truy xuất nghiên cứu và quy trình làm việc về tài liệu/bảng tính/trình bày; so với những chiếc điện thoại cao cấp đắt tiền hơn, sự đánh đổi chính là chi phí thấp hơn để đạt được hiệu quả thực thi gần biên giới.

$0.302/1M tokens

FAQ

Câu hỏi thường gặp

V4 Flash phù hợp nhất với trường hợp nào?

V4 Flash phù hợp với các loại đầu vào, đầu ra và khả năng được liệt kê trên trang. Hãy kiểm thử tải thực tế trước khi dùng cho hệ thống quan trọng.

V4 Flash được tính phí thế nào?

Giá được hiển thị ở phần trên. Chi phí thực tế phụ thuộc vào lưu lượng, nhóm tài khoản và nội dung yêu cầu.

Làm sao gọi V4 Flash?

Dùng ID mô hình phía trên với giao thức API được hỗ trợ. Ví dụ mã sẽ hiển thị khi có dữ liệu sử dụng.

Bắt đầu

Xây dựng với V4 Flash

Dùng trong Console
TokenHot

The frontier intelligence gateway. One API. 127 models. 0.2s latency. Pay only for what you use.

All systems normal · 99.997% uptime

Company

© 2026 TokenHot Inc. — Built for builders.