Google

Gemini 3.8 Flash API

The flagship Flash model for long-horizon software engineering, autonomous agents, and complex enterprise workflows. It keeps the speed and cost profile of Flash while adding stronger reasoning and tool orchestration. It accepts text, images, video, audio, and PDF input, with about a 1.05M-token context window, search grounding, function calling, code execution, structured outputs, and tunable thinking. Prefer it over Flash-Lite for harder tasks, at higher usage cost.

  • Suy luận
  • Tìm kiếm web
  • Sử dụng công cụ
  • Gọi hàm
  • Đầu ra có cấu trúc
  • Ngữ cảnh dài
  • Thực thi mã

Mô tả chưa có ở ngôn ngữ này nên nội dung tiếng Anh đang được hiển thị.

Dùng trong Consolegemini-3.8-flash

USD

Bảng giá

default
Giá tiêu chuẩn
Đầu vào$0.7874/1M tokensGiá hoàn thiện$3.937/1M tokensĐọc cache$0.078661/1M tokensGhi cache$0.999998/1M tokensHình ảnh$0.7874/1M tokensĐầu vào âm thanh$0.7874/1M tokens

Giá niêm yết bằng USD. Chi phí cuối có thể thay đổi theo nhóm tài khoản và mức sử dụng.

API

Ví dụ mã

curl --location --request POST 'https://api.tokenhot.ai/v1beta/models/gemini-3.8-flash:generateContent' \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data-raw '{
    "contents": [
        {
            "role": "user",
            "parts": [
                {
                    "text": "Hello"
                }
        }
    ]
}'

Google

Mô hình liên quan

GeminiGoogleGemini 2.5 Flash Image

Được xây dựng để tạo và chỉnh sửa hình ảnh, với khả năng hiểu đa phương thức mạnh mẽ hơn, chỉnh sửa đàm thoại và tạo nguyên mẫu trực quan nhanh chóng so với các khả năng hình ảnh trước đây của Gemini. So với GPT Image, Qwen Image và Seedream, nó rất hữu ích khi kết hợp các tài liệu, hình ảnh và lời nhắc trong một quy trình làm việc trực quan.

$0.0585/image
GeminiGoogleGemini 3.1 PRO Preview

Được xây dựng để hiểu đa phương thức, mã hóa và các tác vụ có ngữ cảnh dài, cải thiện so với Gemini 3.0 / 2.5 về thông lượng, ngữ cảnh và khả năng của công cụ. So với các mô hình GPT, Claude và Qwen, nó mạnh mẽ cho quy trình phân tích thống nhất trên văn bản, hình ảnh, âm thanh, video và tài liệu.

$2/1M tokens
GeminiGoogleGemini 3.5 Flash Lite

The fastest and most cost-effective model in the Gemini 3.5 line, built for high-throughput, low-latency work such as translation, classification, document processing, and lightweight agentic workflows. It supports multimodal inputs and up to a 1M-token context, while demanding reasoning, long-horizon planning, or high-quality code changes are better handled by a higher-tier Flash model.

$0.3/1M tokens
GeminiGoogleGemini 3 PRO Image Preview

Được xây dựng để tạo và chỉnh sửa hình ảnh, với khả năng hiểu đa phương thức mạnh mẽ hơn, chỉnh sửa đàm thoại và tạo nguyên mẫu trực quan nhanh chóng so với các khả năng hình ảnh trước đây của Gemini. So với GPT Image, Qwen Image và Seedream, nó rất hữu ích khi kết hợp các tài liệu, hình ảnh và lời nhắc trong một quy trình làm việc trực quan.

$0.134/image

FAQ

Câu hỏi thường gặp

Gemini 3.8 Flash phù hợp nhất với trường hợp nào?

Gemini 3.8 Flash phù hợp với các loại đầu vào, đầu ra và khả năng được liệt kê trên trang. Hãy kiểm thử tải thực tế trước khi dùng cho hệ thống quan trọng.

Gemini 3.8 Flash được tính phí thế nào?

Giá được hiển thị ở phần trên. Chi phí thực tế phụ thuộc vào lưu lượng, nhóm tài khoản và nội dung yêu cầu.

Làm sao gọi Gemini 3.8 Flash?

Dùng ID mô hình phía trên với giao thức API được hỗ trợ. Ví dụ mã sẽ hiển thị khi có dữ liệu sử dụng.

Bắt đầu

Xây dựng với Gemini 3.8 Flash

Dùng trong Console
WhatsApp