Google

Gemini 3.5 Flash Lite

Gemini 3.5 系列中速度最快、成本最低的模型,适合高并发、低延迟任务,以及翻译、分类、文档处理和轻量智能体工作流;支持多模态输入和最高 1M 上下文,但复杂推理、长链路规划或高质量代码修改应优先选择更高档 Flash 模型。

  • 长上下文

AI 对话

输入提示词,在这里查看模型回复。

gemini-3.5-flash-lite
当前会话
有什么可以帮你?

向这个模型提问,也可以结合上下文继续追问。

按模型当前价格消耗账户余额。

账户余额不足

当前账户余额不足,无法完成本次生成。请充值后返回此页面重试。

前往充值

USD /1M tokens

价格

分组输入输出缓存读图片音频输入
default$0.3$2.49999$0.03$0.3$0.3
default
输入$0.3输出$2.49999缓存读$0.03图片$0.3音频输入$0.3

展示价格为美元公开价,实际费用可能因账户分组和用量阶梯而变化。

API

代码示例

curl --location --request POST 'https://api.tokenhot.ai/v1beta/models/gemini-3.5-flash-lite:generateContent' \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data-raw '{
    "contents": [
        {
            "role": "user",
            "parts": [
                {
                    "text": "Hello"
                }
        }
    ]
}'

FAQ

常见问题

Gemini 3.5 Flash Lite 适合哪些场景?

Gemini 3.5 Flash Lite 适合本页所列的输入、输出与能力类型。用于关键业务前,建议先用真实负载进行验证。

Gemini 3.5 Flash Lite 如何计费?

价格见上方价格部分,实际成本取决于使用量、账户分组和请求内容。

如何调用 Gemini 3.5 Flash Lite?

使用上方模型 ID,通过受支持的 API 协议调用;有调用数据时,本页会展示代码示例。

开始使用

使用 Gemini 3.5 Flash Lite 构建

在控制台使用