Giá API LLM

Mô hình Google

Xem tất cả 15 mô hình Google có trên TokenHot.

Một API key cho phép truy cập 15 mô hình Google, với giá theo thời gian thực và không cần tài khoản nhà cung cấp riêng.

Gemini
gemini-omni-video
Google
MỖI GIÂY$0.2450/s
Được xây dựng để tạo đa phương thức từ bất kỳ đầu vào vào video nào, nhấn mạnh hơn quy trình làm việc video của Gemini trước đó vào việc phối hợp thống nhất các tài liệu văn bản, hình ảnh, âm thanh và video. So với Veo, Kling và Runway, việc tích hợp các nội dung đa phương thức phức tạp vào một quy trình làm việc sáng tạo sẽ tốt hơn.
Kiểu đầu vào:
Kiểu đầu ra:
Multimodal Output
Gemini
gemini-3.5-flash
Google
Ngữ cảnh1M
Giá đầu vào$1.5000/Tr
Giá đầu ra$9.0000/Tr
Được xây dựng để hiểu đa phương thức, mã hóa và các tác vụ theo ngữ cảnh dài, cải thiện so với Gemini 3.1 về thông lượng, ngữ cảnh và khả năng của công cụ. So với các mô hình GPT, Claude và Qwen, nó mạnh mẽ cho quy trình phân tích thống nhất trên văn bản, hình ảnh, âm thanh, video và tài liệu.
Kiểu đầu vào:
Kiểu đầu ra:
ReasoningWeb SearchTool UseFunction CallingStructured OutputLong ContextCode Execution
Gemini
gemini-3.1-flash-image-preview
Google
Ngữ cảnh131K
MỖI ẢNH$0.0672/image
Được xây dựng để tạo và chỉnh sửa hình ảnh, với khả năng hiểu đa phương thức mạnh mẽ hơn, chỉnh sửa đàm thoại và tạo nguyên mẫu trực quan nhanh chóng so với các khả năng hình ảnh trước đây của Gemini. So với GPT Image, Qwen Image và Seedream, nó rất hữu ích khi kết hợp các tài liệu, hình ảnh và lời nhắc trong một quy trình làm việc trực quan.
Kiểu đầu vào:
Kiểu đầu ra:
ReasoningMultimodal Output
Gemini
gemini-3.1-pro-preview
Google
Ngữ cảnh1.05M
Giá đầu vào$2.0000/Tr
Giá đầu ra$12.0000/Tr
Được xây dựng để hiểu đa phương thức, mã hóa và các tác vụ có ngữ cảnh dài, cải thiện so với Gemini 3.0 / 2.5 về thông lượng, ngữ cảnh và khả năng của công cụ. So với các mô hình GPT, Claude và Qwen, nó mạnh mẽ cho quy trình phân tích thống nhất trên văn bản, hình ảnh, âm thanh, video và tài liệu.
Kiểu đầu vào:
Kiểu đầu ra:
Long Context
Gemini
gemini-3-flash-preview
Google
Ngữ cảnh1M
Giá đầu vào$0.5000/Tr
Giá đầu ra$3.0000/Tr
Mô hình tư duy tốc độ cao của Google được thiết kế cho quy trình làm việc tổng thể, trò chuyện nhiều lượt và hỗ trợ mã hóa. Hỗ trợ đầu vào văn bản, hình ảnh, âm thanh, video và PDF với cửa sổ ngữ cảnh mã thông báo 1M. Có các cấp độ tư duy có thể định cấu hình, cách sử dụng công cụ và kết quả đầu ra có cấu trúc. Cải tiến chất lượng rộng rãi so với Gemini 2.5 Flash về lý luận, hiểu biết đa phương thức và độ tin cậy.
Kiểu đầu vào:
Kiểu đầu ra:
ReasoningTool UseFunction CallingStructured OutputLong Context
Gemini
gemini-3-pro-image-preview
Google
Ngữ cảnh66K
MỖI ẢNH$0.1340/image
Được xây dựng để tạo và chỉnh sửa hình ảnh, với khả năng hiểu đa phương thức mạnh mẽ hơn, chỉnh sửa đàm thoại và tạo nguyên mẫu trực quan nhanh chóng so với các khả năng hình ảnh trước đây của Gemini. So với GPT Image, Qwen Image và Seedream, nó rất hữu ích khi kết hợp các tài liệu, hình ảnh và lời nhắc trong một quy trình làm việc trực quan.
Kiểu đầu vào:
Kiểu đầu ra:
ReasoningMultimodal Output
Gemini
veo3.1-lite
Google
MỖI LẦN$0.1100/call
Được xây dựng để tạo video có độ trung thực cao, với quy trình làm việc về âm thanh gốc, điều khiển máy ảnh và đầu vào tham chiếu hoàn thiện hơn Veo 2/3. So với Kling, Runway và Seedance, nó phù hợp hơn với phim ngắn, bảng phân cảnh quảng cáo và video yêu cầu chuyển động vật lý ổn định. Cấp Lite ưu tiên các bản nháp có thông lượng cao, chi phí thấp hơn so với cấp tiêu chuẩn.
Kiểu đầu vào:
Kiểu đầu ra:
Multimodal Output
Gemini
veo3.1-fast
Google
MỖI LẦN$0.2211/call
Được xây dựng để tạo video có độ trung thực cao, với quy trình làm việc về âm thanh gốc, điều khiển máy ảnh và đầu vào tham chiếu hoàn thiện hơn Veo 2/3. So với Kling, Runway và Seedance, nó phù hợp hơn với phim ngắn, bảng phân cảnh quảng cáo và video yêu cầu chuyển động vật lý ổn định. Bậc Nhanh phù hợp để xác thực khái niệm nhanh hơn bậc tiêu chuẩn.
Kiểu đầu vào:
Kiểu đầu ra:
Multimodal Output
Gemini
veo3.1
Google
MỖI LẦN$1.6544/call
Được xây dựng để tạo video có độ trung thực cao, với quy trình làm việc về âm thanh gốc, điều khiển máy ảnh và đầu vào tham chiếu hoàn thiện hơn Veo 2/3. So với Kling, Runway và Seedance, nó phù hợp hơn với phim ngắn, bảng phân cảnh quảng cáo và video yêu cầu chuyển động vật lý ổn định.
Kiểu đầu vào:
Kiểu đầu ra:
Multimodal Output
Gemini
gemini-2.5-flash-image
Google
Ngữ cảnh66K
MỖI ẢNH$0.0585/image
Được xây dựng để tạo và chỉnh sửa hình ảnh, với khả năng hiểu đa phương thức mạnh mẽ hơn, chỉnh sửa đàm thoại và tạo nguyên mẫu trực quan nhanh chóng so với các khả năng hình ảnh trước đây của Gemini. So với GPT Image, Qwen Image và Seedream, nó rất hữu ích khi kết hợp các tài liệu, hình ảnh và lời nhắc trong một quy trình làm việc trực quan.
Kiểu đầu vào:
Kiểu đầu ra:
Structured OutputMultimodal Output
Gemini
gemini-3.6-flash
Google
Giá đầu vào$1.5000/Tr
Giá đầu ra$7.5000/Tr
Gemini
gemini-3.5-flash-lite
Google
Giá đầu vào$0.3000/Tr
Giá đầu ra$2.5000/Tr
Gemini
gemini-3.1-flash-lite-image
Google
MỖI LẦN$0.0200/call
Gemini
gemini-3.1-flash-image
Google
MỖI ẢNH$0.0330/image
Gemini
gemini-3-pro-image
Google
MỖI ẢNH$0.0530/image