Claude
上下文1M
輸入價格
$0.1700/M$0.5000/M
輸出
$0.8500/M$2.5000/M
Claude 系列中面向高频、低延迟调用的选择,适合分类、信息抽取、请求路由和子智能体任务。相比 Haiku 4.5,上下文扩至 100 万 token,并支持自适应思考;复杂任务可考虑 Sonnet 或 Opus。
輸入模態:
輸出模態:
深度思考工具调用结构化输出长上下文
試用模型
上下文131K
按秒$0.0530/s
适合需要快速出图和反复对话修改的设计工作。相较 Nano Banana 2,它提升了画面质量、文字与信息图排版、宽幅图像及多轮角色一致性;支持多张参考图和 1K、2K、4K 输出。复杂品牌视觉和最高精度控制可考虑 Nano Banana Pro。
輸入模態:
輸出模態:
深度思考联网搜索长上下文多模态输出
OpenAI
上下文1.05M
輸入價格
$0.4000/M$2.0000/M
輸出
$2.0000/M$10.0000/M
适合复杂编程、计算机操作和专业文档工作。相比 GPT-6 Sol,复杂任务能力更强;接近 Astra 的表现,调用成本更低。需要最高质量时仍可选择 Astra。
輸入模態:
輸出模態:
深度思考联网搜索工具调用函数调用结构化输出长上下文代码执行
試用模型
Claude
上下文1M
輸入價格
$0.6800/M$2.0000/M
輸出
$3.4000/M$10.0000/M
更适合作为速度与智能的均衡主力:1M 上下文、文本与图像输入、文本输出,支持自适应思考和工具调用,适合项目级代码、多步任务和知识工作。相比 Sonnet 5,重点优势是更快、更省 token;若追求最高质量或更复杂任务,可考虑 Opus 5.5。
輸入模態:
輸出模態:
深度思考工具调用长上下文
試用模型
Claude
上下文1M
輸入價格
$1.3600/M$4.0000/M
輸出
$6.8000/M$20.0000/M
面向长时程智能体编程和知识工作,适合跨文件重构、代码库审计与复杂多步任务;1M 上下文、始终开启的自适应思考和文本/图像输入使它偏向高质量长链路执行,相比 Sonnet 5 更重质量,代价是更高的成本与延迟。
輸入模態:
輸出模態:
深度思考工具调用长上下文
試用模型
OpenAI
OpenAI
上下文1.05M
輸入價格
$0.4000/M$2.0000/M
輸出
$2.0000/M$10.0000/M
面向复杂代码与智能体工作流,适合项目级编程、长链路规划和多步工具执行;1.05M 上下文、文本/图像输入、推理、函数调用与结构化输出构成完整主力能力,代价是比 GPT-6 Luna 更高的调用成本,适合质量与执行稳定性优先的任务。
輸入模態:
輸出模態:
深度思考联网搜索工具调用函数调用结构化输出长上下文代码执行
試用模型
OpenAI
上下文1.05M
輸入價格
$0.0200/M$0.1000/M
輸出
$0.1000/M$0.5000/M
面向聚焦型、高吞吐任务,适合批量摘要、分类、改写和高频智能体调用;同样提供 1.05M 上下文、文本/图像输入、推理、函数调用与结构化输出,但以显著更低的成本换取与 Sol 不同的质量/深度取舍,复杂长链路任务优先考虑 GPT-6 Sol。
輸入模態:
輸出模態:
深度思考联网搜索工具调用函数调用结构化输出长上下文代码执行
試用模型
DeepSeek
上下文1M
輸入價格
$0.2700/M$0.3000/M
輸出
$1.0800/M$1.2000/M
适合作为高吞吐、低成本的通用与 Agent 主力:原生支持图像理解和 1M 上下文,并可在思考与非思考模式间切换,支持工具调用与 JSON 输出。相比更高档的 V4 Pro,定位更偏向速度、吞吐和成本效率,适合长文档、代码/Agent 及图文分析;需要更深推理时再开启思考模式。
輸入模態:
輸出模態:
深度思考工具调用结构化输出长上下文
試用模型
上下文400K
按張$0.0080/image
GPT Image 2.5 Sunburst 的特价模型,按当前渠道映射使用 Sunburst;sale 仅表示特价线路,不改变其高精度生图与编辑的定位。适合价格敏感、仍需要参考图编辑和细节控制的专业视觉任务;需要常规线路时选择 gpt-image-2.5-sunburst。
輸入模態:
輸出模態:
多模态输出长上下文
試用模型
上下文400K
按張
$0.0336/image$0.0480/image
面向对编辑精度和成片质量要求更高的高级视觉工作流:适合生产级活动创意、精修产品图,以及需要在多轮修改中保持主体、构图和视觉处理一致的任务;支持文本与参考图输入、图像输出,但生成时间通常比 Flare 更长。
輸入模態:
輸出模態:
多模态输出长上下文
試用模型
上下文400K
按張$0.0080/image
GPT Image 2.5 Flare 的特价模型,按当前渠道映射使用 Flare;sale 仅表示特价线路,不改变其高质量、快速日常生图与编辑的定位。适合价格敏感的高频图片任务;需要常规线路时选择 gpt-image-2.5-flare。
輸入模態:
輸出模態:
多模态输出长上下文
試用模型
上下文400K
按張
$0.0336/image$0.0480/image
更适合作为高质量图像生成与编辑的默认主力:速度更快,适合创作者与社媒内容、产品体验、视觉搜索、快速原型和高频批量生成;支持文本与参考图输入、图像输出。若更看重精细编辑控制并能接受更长等待,可选 Sunburst。
輸入模態:
輸出模態:
多模态输出长上下文
試用模型
OpenAI
上下文1.05M
輸入價格
$2.0000/M$10.0000/M
輸出
$10.0000/M$50.0000/M
旗舰级端到端模型,适合复杂推理、软件工程、计算机操作、深度研究与文档工作;约 105 万 token 上下文、文本/图像/文档输入和文本输出,并支持推理、搜索、函数调用、结构化输出、代码执行与工具编排。相比更低档位模型,选择它主要是为了长链路任务的完成质量与执行稳定性,代价是更高的调用成本。
輸入模態:
輸出模態:
深度思考联网搜索工具调用函数调用结构化输出长上下文代码执行
試用模型
Gemini
上下文1.05M
輸入價格$0.7874/M
輸出$3.9370/M
Flash 档旗舰,面向长链路软件工程、自治智能体和复杂企业工作流,在保持 Flash 速度与成本取向的同时提供更强推理和工具编排。支持文本、图像、视频、音频与 PDF 输入、约 105 万 token 上下文、搜索 grounding、函数调用、代码执行、结构化输出和可调思考;相比 Flash-Lite,更适合复杂任务,但调用成本更高。
輸入模態:
輸出模態:
深度思考联网搜索工具调用函数调用结构化输出长上下文代码执行
試用模型
Claude
上下文1M
輸入價格
$3.4000/M$10.0000/M
輸出
$17.0000/M$50.0000/M
旗舰级长上下文模型,面向高难度、长周期的知识工作、代码项目和多步智能体任务;支持文本、图像与 PDF 输入,适合跨文件分析、复杂研究和持续工具调用。它更偏向质量、推理深度与长链路执行,速度较慢、成本较高,适合需要稳定完成复杂任务的场景。
輸入模態:
輸出模態:
深度思考联网搜索工具调用函数调用长上下文
試用模型
上下文1M
輸入價格$0.1492/M
輸出$0.4476/M
Qwen 系列的高效多模态主力模型,原生支持百万级上下文,并兼顾代码辅助、智能体工作流和图表等视觉理解;适合长文档、代码库、高并发应用与需要工具协作的任务。
輸入模態:
輸出模態:
深度思考工具调用结构化输出长上下文
試用模型
Zhipu
上下文1.31M
輸入價格$0.1190/M
輸出$0.4200/M
GLM-5 系列中兼顾前沿能力与调用效率的 Flash 模型:原生支持多模态,面向长上下文和高频执行,适合代码、智能体以及需要图文理解的复杂任务;相比更大档位,更适合作为成本敏感的生产主力。
輸入模態:
輸出模態:
深度思考工具调用结构化输出长上下文
試用模型
上下文1.05M
輸入價格$0.1490/M
輸出$0.2980/M
DeepSeek-V4-Flash 的实验性多模态变体,支持在文本交互中理解图像。适合视觉问答、截图和文档分析;由于处于实验阶段,更适合评估和灵活工作流,关键生产链路需谨慎使用。
輸入模態:
輸出模態:
深度思考工具调用长上下文
試用模型
按秒$0.0675/s
通义万相 3.0 系列的速度优先版本(早期访问阶段),在保持高质量视频生成的同时缩短出片等待,适合低延迟预览、批量试做和需要快速迭代的短视频工作流;若更看重极致画面控制而非出片速度,可选择标准版。
輸入模態:
輸出模態:
多模态输出
試用模型
Zhipu
Zhipu AI
上下文1M
輸入價格
$1.0115/M$1.1900/M
輸出
$3.5275/M$4.1500/M
面向复杂软件工程和长周期智能体任务的旗舰主力模型:沿用 GLM-5.2 基座,能力提升来自后训练,官方 Z.ai Code Bench 相比 GLM-5.2 提升 50%,并强化终端操作与漏洞发现。它提供 1M 上下文、最长 128K 输出,始终启用推理并支持 low、high、max 三档强度、函数调用和结构化输出;当前仅支持文本输入,不适合需要图像理解的任务。
輸入模態:
輸出模態:
深度思考工具调用函数调用结构化输出长上下文
試用模型
Gemini
上下文1.05M
輸入價格$0.0000/M
輸出$0.0000/M
免费模型仅供学习和体验,随时可能下架,高级模型设有每分钟5次请求的限制,且其可用性不作保证。
輸入模態:
輸出模態:
深度思考工具调用长上下文
試用模型
Gemini
上下文1.05M
輸入價格$0.7500/M
輸出$3.7500/M
Gemini 3 系列的新一代快速多模态模型,2026 年 8 月发布,主打低成本、高吞吐与多模态理解;支持文本、图像、视频、音频和文档输入,百万级上下文,适合大规模信息处理、批量任务和实时交互场景。
輸入模態:
輸出模態:
深度思考工具调用长上下文
試用模型
Grok
上下文500K
輸入價格$0.8400/M
輸出$2.5200/M
旗舰级通用模型,优先用于高质量代码、智能体执行和知识工作;适合需要持续规划、工具协作与复杂问题处理的任务。若只追求低延迟或低成本的简单调用,应优先选更轻量的模型。
輸入模態:
輸出模態:
深度思考工具调用结构化输出长上下文
試用模型
Qwen
按秒$0.0450/s
阿里通义万相 3.0 系列的标准视频生成模型(早期访问阶段),支持文生视频、图生视频及多模态参考输入,单次可生成最长约 30 秒的视频并同步生成音频,适合广告、短剧和叙事短片的快速出片;正式发布日期尚未公布,规格以官方为准。
輸入模態:
輸出模態:
多模态输出
Qwen
上下文1M
輸入價格
$1.4200/M$1.7750/M
輸出
$4.2640/M$5.3300/M
千问当前能力最强的旗舰多模态推理模型,适合长程编程、专业工作与多阶段智能体任务。它可处理文本、图片和视频,提供 1M 上下文、最长 128K 输出,并支持函数调用、结构化输出、联网搜索与代码解释器;更适合作为高质量复杂任务主力,而不是追求最低成本和最低延迟的批量调用。
輸入模態:
輸出模態:
深度思考联网搜索工具调用函数调用结构化输出长上下文代码执行
試用模型
輸入價格
$3.0865/M$3.2490/M
輸出
$3.0865/M$3.2490/M
更适合从单个片段走向完整叙事的音视频模型:单次可生成最长 30 秒并支持多轮延长,还能参考多张图片、视频和音频,提供时间戳级编辑、绿幕和镜头控制;适用于广告、短片和需要连续镜头的创作,但复杂多主体运动仍需人工检查。
輸入模態:
輸出模態:
多模态输出
試用模型
Minimax
MiniMax
按秒$0.0800/s
面向视频创作的全模态生成模型,可结合文本、图像、视频和音频参考生成带同步音频的视频素材;适合短视频、广告和参考驱动的角色与镜头创作。它不是通用聊天模型,选择时应重点看视频一致性、运动表现与音画效果。
輸入模態:
輸出模態:
多模态输出
輸入價格$3.3042/M
輸出$3.3042/M
这是 Seedance 2.5 的站内路由变体,能力判断按底层模型而不是后缀:适合广告、品牌内容和叙事短片,支持最长 30 秒单次音视频生成、多轮延长、文本/图像/音频/视频参考、R2V 与时间戳级编辑;复杂运动和多主体物理一致性仍需人工复核。
輸入模態:
輸出模態:
多模态输出
試用模型
Claude
Anthropic
上下文1M
輸入價格
$1.7000/M$5.0000/M
輸出
$8.5000/M$25.0000/M
面向复杂智能体编程和企业级知识工作的高端模型,强调长链路规划、持续执行、自我校验和稳定交付;拥有百万级上下文,适合大型代码库、复杂文档以及需要较少人工监督的多步骤项目。
輸入模態:
輸出模態:
深度思考工具调用结构化输出长上下文
試用模型
上下文1.05M
輸入價格$0.3000/M
輸出$2.5000/M
Gemini 3.5 系列中速度最快、成本最低的模型,适合高并发、低延迟任务,以及翻译、分类、文档处理和轻量智能体工作流;支持多模态输入和最高 1M 上下文,但复杂推理、长链路规划或高质量代码修改应优先选择更高档 Flash 模型。
輸入模態:
輸出模態:
长上下文
試用模型
按秒
$0.0024/s$0.0030/s
质量优先的专业生图与编辑模型:支持文生图和基于 1–3 张参考图的图像编辑,最长可接收约 4.5K token 指令,适合报纸、故事板、菜单、试卷等复杂版面,以及 10px 级细小文字、12 种语言和多字体渲染。相较标准版,更适合把复杂布局和细节还原放在首位;若更看重速度与成本,选标准版。
輸入模態:
輸出模態:
按秒
$0.0024/s$0.0030/s
兼顾质量与速度的 Qwen-Image 3.0 标准档,支持文生图与基于 1–3 张参考图的图像编辑,最长约 4.5K token 指令、最多 6 张输出和 2K 级分辨率,适合日常海报、界面、信息图与批量创作。复杂版面、细小文字和质量优先的成片可切换到 Pro;高频调用则优先选标准版。
輸入模態:
輸出模態:
MoonshotAI
Moonshot
上下文1.05M
輸入價格
$2.7000/M$3.0000/M
輸出
$13.5000/M$15.0000/M
月之暗面的旗艦模型,原生支援視覺理解和最高 100 萬 token 上下文;目前以 max 推理強度運行,適合長鏈路編碼、知識工作及需要終端工具協作的複雜任務。為保持穩定性,建議保留完整推理歷史,並在相容的 Agent 框架中新開會話使用。
輸入模態:
輸出模態:
深度思考工具调用长上下文
試用模型
OpenAI
上下文1.05M
輸入價格
$0.4000/M$2.0000/M
輸出
$2.4000/M$12.0000/M
GPT-5.6 中兼顾能力与成本的主力档位。适合需要图像理解、工具调用和较长材料处理的生产任务;若任务难度和交付质量优先,选择 Sol;若重在高并发成本控制,选择 Luna。
輸入模態:
輸出模態:
深度思考函数调用结构化输出长上下文
試用模型
OpenAI
上下文1.05M
輸入價格
$1.0000/M$5.0000/M
輸出
$6.0000/M$30.0000/M
GPT-5.6 系列的旗舰档位,面向复杂专业工作与高质量交付。支持图像输入、函数调用和结构化输出,并可承载超长上下文;对时延或单位成本敏感的高频任务,可考虑 Terra 或 Luna。
輸入模態:
輸出模態:
深度思考函数调用结构化输出长上下文
試用模型
OpenAI
上下文1.05M
輸入價格$0.2000/M
輸出$1.2000/M
GPT-5.6 的高并发、成本敏感档位。适合摘要、分类、改写和批量自动化;需要复杂专业判断或质量优先的多步任务时,优先选同系列 Sol。
輸入模態:
輸出模態:
深度思考函数调用结构化输出长上下文
試用模型
按秒$0.0450/s
專業視覺創作的多模態影像產生模型,支援從文字產生影像,並結合參考圖和空間標註進行精準編輯;擅長高密度資訊圖、文字排版、真實光影與多語言圖文生成。
輸入模態:
輸出模態:
深度思考多模态输出
試用模型
Grok
上下文500K
輸入價格$2.1000/M
輸出$6.3000/M
程式碼、知識工作和 STEM 議題的旗艦推理模型。支援影像輸入、函數呼叫和結構化輸出,50 萬 token 上下文適合跨文件分析與長材料處理;不需要高難度推理時可選成本更低的模型。
輸入模態:
輸出模態:
深度思考函数调用结构化输出长上下文
試用模型
Claude
上下文1M
輸入價格
$3.4000/M$10.0000/M
輸出
$17.0000/M$50.0000/M
Anthropic 迄今最強的公開發布模型,專為高難度推理與長週期智能體(agentic)任務打造。原生支援 100 萬 token 超長上下文與 128k 輸出,自適應思考預設常開;擅長在任務欠明確時自主探索環境、制定計劃並持續推進長程編碼與多智能體編排,需要人工介入前能把任務推進得更遠。
輸入模態:
輸出模態:
深度思考工具调用结构化输出长上下文
試用模型
Claude
上下文1M
輸入價格
$0.6800/M$2.0000/M
輸出
$3.4000/M$10.0000/M
Sonnet 檔位的日常主力模型,重點是在較低成本下提供接近旗艦的智能體、編碼和知識工作能力。預設 100 萬 token 上下文與自適應思考適合長文件、程式碼庫和多步驟工具任務;需要最深推理或受限高風險安全研究時,仍應評估更高檔或專用模型。
輸入模態:
輸出模態:
深度思考工具调用结构化输出长上下文
試用模型
上下文256K
輸入價格$0.9700/M
輸出$4.8800/M
程式碼、代理程式和複雜生產力任務,相比 Doubao Seed 2.0 在長上下文、長輸出和工具任務上更進一步;對比 Qwen、GLM、DeepSeek 等同類國產旗艦,它適合作為中文辦公室、程式碼和多步驟自動化場景的高性價比選擇。
輸入模態:
輸出模態:
深度思考工具调用函数调用结构化输出长上下文
試用模型
按秒$0.1350/s
面向文生視頻,相比 HappyHorse 1.0 更突出音頻原生生成,一次完成對白、音效和背景音樂;對比 Veo、Kling、Runway,它的差異化優勢在聲畫同步和角色一致性工作流。適合短劇、廣告、電商和品牌行銷影片。
輸入模態:
輸出模態:
多模态输出
按秒$0.1350/s
面向參考生成視頻,相比 HappyHorse 1.0 更突出音頻原生生成,一次完成對白、音效和背景音樂;對比 Veo、Kling、Runway,它的差異化優勢在聲畫同步和角色一致性工作流。適合短劇、廣告、電商和品牌行銷影片。
輸入模態:
輸出模態:
多模态输出
按秒$0.1350/s
面向圖生視頻,相比 HappyHorse 1.0 更突出音頻原生生成,一次完成對白、音效和背景音樂;對比 Veo、Kling、Runway,它的差異化優勢在聲畫同步和角色一致性工作流。適合短劇、廣告、電商和品牌行銷影片。
輸入模態:
輸出模態:
多模态输出
輸入價格$0.6300/M
輸出$0.6300/M
面向視訊生成和多素材視訊創作,相較於 Seedance 1.x 在運動穩定性、音訊視訊聯合生成和參考輸入上更完整;對比 Veo、Kling、Runway,它更適合需要文字、影像、音訊、視訊混音驅動的中文創意工作流程。該 filter-off 版本相比普通 Seedance 2.0 保持同檔生成能力,但內容過濾更寬鬆;適合短劇、廣告、電商和社交素材。
輸入模態:
輸出模態:
多模态输出
試用模型
Zhipu
Zhipu AI
上下文1M
輸入價格
$0.9690/M$1.1400/M
輸出
$3.4000/M$4.0000/M
面向推理、程式碼和長上下文代理任務,相比 GLM-5.1 在上下文長度、工具調用和複雜多步驟任務上更進一步;對比 Qwen、DeepSeek、Kimi 等國產旗艦,它更適合中文企業自動化、專案級程式碼分析和知識工作流。
輸入模態:
輸出模態:
深度思考工具调用函数调用结构化输出长上下文
試用模型
MoonshotAI
上下文256K
輸入價格$1.9000/M
輸出$7.9999/M
面向長上下文、多步驟工具呼叫和程式碼/文件工作流程,相較於 Kimi K2.6 更強調工程任務穩定性和上下文承載能力;對比 Qwen、GLM、DeepSeek,它更適合中文長文件分析、專案問答和日常智能程式設計。
輸入模態:
輸出模態:
工具调用函数调用结构化输出长上下文
試用模型
MoonshotAI
上下文256K
輸入價格
$0.8775/M$0.9750/M
輸出
$3.6450/M$4.0500/M
面向長上下文、多步驟工具呼叫和程式碼/文件工作流程,相較於 Kimi K2.6 更強調工程任務穩定性和上下文承載能力;對比 Qwen、GLM、DeepSeek,它更適合中文長文件分析、專案問答和日常智能程式設計。
輸入模態:
輸出模態:
工具调用函数调用结构化输出长上下文
試用模型
按秒$0.1400/s
以影像/視訊為導向的生成、編輯和延展,相較於 Grok Imagine 1.0 更強調運動一致性和快速社交內容產出;對比 Veo、Kling、Runway,它更適合 xAI 生態裡的短影片、廣告創意和即時趨勢素材。
輸入模態:
輸出模態:
多模态输出
Qwen
上下文1M
輸入價格
$0.2400/M$0.3000/M
輸出
$0.9600/M$1.2000/M
面向代理式工作負載、程式碼和辦公室生產力,相較於 Qwen3.6 更強調長上下文、工具呼叫和結構化輸出的穩定組合;對比 GPT、Claude、Gemini 等旗艦模型,它更適合作為中文、程式碼和多步驟工具任務裡的高性價比替代。
輸入模態:
輸出模態:
深度思考工具调用函数调用结构化输出长上下文
試用模型
Minimax
Free channel
上下文1M
輸入價格$0.0000/M
輸出$0.0000/M
免费模型仅供学习和体验,随时可能下架,高级模型设有每分钟5次请求的限制,且其可用性不作保证。
輸入模態:
輸出模態:
深度思考工具调用函数调用结构化输出长上下文
試用模型
Minimax
MiniMax
上下文1M
輸入價格$0.3150/M
輸出$1.2600/M
以長週期編碼、工具使用和多輪生產協作,相較於 MiniMax M2.7 進一步擴展到多模態輸入並保留 100 萬 token 上下文;對比 Claude、Gemini、GLM-5.2 等長上下文代理模型,它更適合將文字、圖像、視訊資料放入同一工作流程。
輸入模態:
輸出模態:
深度思考工具调用函数调用结构化输出长上下文
試用模型
Claude
上下文1M
輸入價格
$1.7000/M$5.0000/M
輸出
$8.5000/M$25.0000/M
面向旗艦推理與複雜代理任務,相比 Claude Opus 4.7 在長上下文、程式碼、工具使用和複雜規劃上更進一步;對比 GPT、Gemini、Qwen 等旗艦模型,它更適合高可靠代理、程式碼庫維護和深度研究工作流程。
輸入模態:
輸出模態:
深度思考工具调用结构化输出长上下文
試用模型
Gemini
按秒$0.2450/s
面向任意輸入到視訊的多模態創作,相較於 Gemini 早期視訊能力更強調文字、影像、音訊和視訊資料的統一編排;對比 Veo、Kling、Runway,它更適合將複雜多模態素材整合進同一創意工作流程。
輸入模態:
輸出模態:
多模态输出
試用模型
Qwen
上下文1M
輸入價格
$1.4400/M$1.8000/M
輸出
$4.3200/M$5.4000/M
面向代理式工作負載、程式碼和辦公室生產力,相較於 Qwen3.6 更強調長上下文、工具呼叫和結構化輸出的穩定組合;對比 GPT、Claude、Gemini 等旗艦模型,它更適合作為中文、程式碼和多步驟工具任務裡的高性價比替代。
輸入模態:
輸出模態:
深度思考工具调用函数调用结构化输出长上下文
試用模型
上下文8K
按秒$0.1350/s
面向視訊編輯,相較於 早期視訊模型 更突出音訊原生生成,一次完成對白、音效和背景音樂;對比 Veo、Kling、Runway,它的差異化優勢在聲畫同步和角色一致性工作流程。適合短劇、廣告、電商和品牌行銷影片。
輸入模態:
輸出模態:
多模态输出
上下文8K
按秒$0.1350/s
面向文生視頻,相比 早期視頻模型 更突出音頻原生生成,一次完成對白、音效和背景音樂;對比 Veo、Kling、Runway,它的差異化優勢在聲畫同步和角色一致性工作流。適合短劇、廣告、電商和品牌行銷影片。
輸入模態:
輸出模態:
多模态输出
上下文8K
按秒$0.1350/s
面向參考生成視頻,相比 早期視頻模型 更突出音頻原生生成,一次完成對白、音效和背景音樂;對比 Veo、Kling、Runway,它的差異化優勢在聲畫同步和角色一致性工作流。適合短劇、廣告、電商和品牌行銷影片。
輸入模態:
輸出模態:
多模态输出
上下文8K
按秒$0.1350/s
面向圖生視頻,相比 早期視頻模型 更突出音頻原生生成,一次完成對白、音效和背景音樂;對比 Veo、Kling、Runway,它的差異化優勢在聲畫同步和角色一致性工作流。適合短劇、廣告、電商和品牌行銷影片。
輸入模態:
輸出模態:
多模态输出
DeepSeek
上下文1M
輸入價格
$1.5390/M$1.7100/M
輸出
$3.0869/M$3.4299/M
面向推理、程式碼和智能體工具使用,相比 DeepSeek V3.2 更強調長上下文、思考模式和複雜任務執行;對比 Qwen、GLM、Kimi 等國產模型,它在數學、程式設計和邏輯推理場景中更具競爭力,適合嚴肅程式碼與分析任務。
輸入模態:
輸出模態:
长上下文工具调用深度思考结构化输出
試用模型
DeepSeek
上下文1M
輸入價格
$0.1278/M$0.1420/M
輸出
$0.2574/M$0.2860/M
面向推理、程式碼和智能體工具使用,相比 DeepSeek V3.2 更強調長上下文、思考模式和複雜任務執行;對比 Qwen、GLM、Kimi 等國產模型,它在數學、程式設計和邏輯推理場景中更具競爭力,適合嚴肅程式碼與分析任務。
輸入模態:
輸出模態:
长上下文工具调用深度思考结构化输出
試用模型
OpenAI
OpenAI
上下文1M
輸入價格
$1.0000/M$5.0000/M
輸出
$6.0000/M$30.0000/M
面向推理、程式碼、視覺理解和智能體任務,相比 GPT-5.4 更強調長上下文、工具調用和規模化穩定輸出;對比 Claude、Gemini、Qwen 等旗艦模型,它更適合作為通用高可靠自動化和複雜知識工作流程底座。
輸入模態:
輸出模態:
深度思考工具调用结构化输出长上下文
試用模型
XiaomiMiMo
輸入價格$0.0000/M
輸出$0.0000/M
面向一句話音色設計和文字轉語音,相比 MiMo V2 TTS 更強調 V2.5 系列的自然語言音色創建、語速/情緒/語氣細粒度控制和低門檻聲音生產;對比 ElevenLabs、OpenAI TTS 和 Azure Speech,它更適合無需參考音頻的角色設計、廣告配音、短片旁白和多風格語音旁白。
輸入模態:
輸出模態:
多模态输出
XiaomiMiMo
輸入價格$0.0000/M
輸出$0.0000/M
面向少量樣本聲音克隆,相比 MiMo V2 TTS 更強調 V2.5 系列的高保真音色復刻、音色特徵一致性和跨文本泛化穩定性;對比 ElevenLabs、OpenAI TTS 和 Azure Speech,它更適合中文角色配音、短視頻旁白、播客復刻和需要保留目標音色的多語言語音生產。
輸入模態:
輸出模態:
多模态输出
XiaomiMiMo
Xiaomi MiMo
輸入價格$0.0000/M
輸出$0.0000/M
以文字轉語音、Voice Design 和聲音克隆,相較於 MiMo V2 TTS 更強調 V2.5 系列的自然語音合成、細粒度語速/情緒/音調控制和低門檻音色創建;對比 ElevenLabs、OpenAI TTS 和 Azure Speech,它更適合中文音訊旁白、角色配音、短視訊音訊和多語言語音生產。
輸入模態:
輸出模態:
多模态输出
XiaomiMiMo
Xiaomi MiMo
上下文1M
輸入價格$1.1700/M
輸出$3.5000/M
面向代理、程式碼和長上下文任務,相比 MiMo V2 在多模態理解、百萬級上下文和長程推理上更完整;對比 Qwen、GLM、DeepSeek 等國產模型,它的優勢在小米生態適配和工程自動化場景。
輸入模態:
輸出模態:
深度思考工具调用结构化输出长上下文
試用模型
XiaomiMiMo
Xiaomi MiMo
上下文1M
輸入價格$0.4700/M
輸出$2.3600/M
面向代理、程式碼和長上下文任務,相比 MiMo V2 在多模態理解、百萬級上下文和長程推理上更完整;對比 Qwen、GLM、DeepSeek 等國產模型,它的優勢在小米生態適配和工程自動化場景。
輸入模態:
輸出模態:
深度思考工具调用结构化输出长上下文
試用模型
OpenAI
上下文400K
按張$0.0080/image
GPT Image 2 的特价模型,按当前渠道映射使用同一底层模型;sale 仅表示特价线路,不代表独立的能力差异。适合价格敏感、可接受特价线路差异的日常生图与参考图编辑;更看重常规线路一致性时选择 gpt-image-2。
輸入模態:
輸出模態:
多模态输出长上下文
試用模型
OpenAI
上下文128K
按張
$0.0196/image$0.0280/image
面向高品質影像生成與編輯,相較於 GPT Image 1.x 在文字渲染、局部編輯和多輪一致性上更進一步;對比 Gemini 影像模型、Qwen Image 和 Seedream,它更適合品牌視覺、廣告設計、產品圖和需要精細控制的創意工作流程。
輸入模態:
輸出模態:
多模态输出
試用模型
Claude
上下文1M
輸入價格
$1.7000/M$5.0000/M
輸出
$8.5000/M$25.0000/M
面向旗艦推理與複雜代理任務,相比 Claude Opus 4.6 在長上下文、程式碼、工具使用和複雜規劃上更進一步;對比 GPT、Gemini、Qwen 等旗艦模型,它更適合高可靠代理、程式碼庫維護和深度研究工作流程。
輸入模態:
輸出模態:
深度思考联网搜索工具调用函数调用结构化输出长上下文代码执行
試用模型
上下文200K
輸入價格$0.6300/M
輸出$2.5200/M
面向文本生成、推理和工具調用,相比 MiniMax M2.x 早期版本更強調 200K 長上下文和代理式工作流程穩定性;對比 Kimi、GLM、Qwen 等同類中文模型,它適合辦公室、程式碼輔助和長文檔處理。
輸入模態:
輸出模態:
深度思考
試用模型
Minimax
上下文200K
輸入價格$0.3150/M
輸出$1.2600/M
面向文本生成、推理和工具調用,相比 MiniMax M2.x 早期版本更強調 200K 長上下文和代理式工作流程穩定性;對比 Kimi、GLM、Qwen 等同類中文模型,它適合辦公室、程式碼輔助和長文檔處理。
輸入模態:
輸出模態:
深度思考
試用模型
OpenAI
上下文400K
輸入價格$0.2000/M
輸出$1.2500/M
面向推理、代码、视觉理解和智能体任务,相比 GPT-5.3 更强调长上下文、工具调用和规模化稳定输出;对比 Claude、Gemini、Qwen 等旗舰模型,它更适合作为通用高可靠自动化和复杂知识工作流底座。
輸入模態:
輸出模態:
工具调用结构化输出长上下文
試用模型
OpenAI
上下文400K
輸入價格$0.7500/M
輸出$4.5000/M
面向推理、程式碼、視覺理解和智能體任務,相比 GPT-5.3 更強調長上下文、工具調用和規模化穩定輸出;對比 Claude、Gemini、Qwen 等旗艦模型,它更適合作為通用高可靠自動化和複雜知識工作流程底座。
輸入模態:
輸出模態:
长上下文工具调用深度思考结构化输出
試用模型
OpenAI
OpenAI
上下文1.05M
輸入價格
$0.5000/M$2.5000/M
輸出
$3.0000/M$15.0000/M
面向推理、程式碼、視覺理解和智能體任務,相比 GPT-5.3 更強調長上下文、工具調用和規模化穩定輸出;對比 Claude、Gemini、Qwen 等旗艦模型,它更適合作為通用高可靠自動化和複雜知識工作流程底座。
輸入模態:
輸出模態:
长上下文工具调用深度思考结构化输出
試用模型
上下文131K
按張
$0.0280/image$0.0400/image
以影像產生與編輯,相較於 Gemini 早期影像能力更強調多模態理解、對話式修改和快速視覺原型;對比 GPT Image、Qwen Image 和 Seedream,它更適合把文件、圖片和提示詞合併到同一視覺工作流程中。
輸入模態:
輸出模態:
深度思考多模态输出
試用模型
上下文1.05M
輸入價格
$1.4000/M$2.0000/M
輸出
$8.4000/M$12.0000/M
面向多模態理解、程式碼和長上下文任務,相較於 Gemini 3.0 / 2.5 在吞吐、上下文和工具能力上更進一步;對比 GPT、Claude、Qwen 等模型,它更適合把文字、圖像、音訊、視訊和文件放進統一分析工作流程。
輸入模態:
輸出模態:
长上下文
試用模型
Claude
上下文1M
輸入價格
$1.0200/M$3.0000/M
輸出
$5.1000/M$15.0000/M
面向高效編碼與代理任務,相比 Claude 4.5/4.6 前序版本 在長上下文、程式碼、工具使用和複雜規劃上更進一步;對比 GPT、Gemini、Qwen 等旗艦模型,它更適合高可靠代理、程式碼庫維護和深度研究工作流程。
輸入模態:
輸出模態:
深度思考联网搜索工具调用函数调用结构化输出长上下文代码执行
試用模型
上下文256K
輸入價格$0.5000/M
輸出$2.5300/M
程式碼、代理程式和複雜生產力任務,相比 Doubao Seed 2.0 在長上下文、長輸出和工具任務上更進一步;對比 Qwen、GLM、DeepSeek 等同類國產旗艦,它適合作為中文辦公室、程式碼和多步驟自動化場景的高性價比選擇。
輸入模態:
輸出模態:
深度思考联网搜索工具调用函数调用结构化输出长上下文
試用模型
按張$0.0350/image
影像生成與編輯,相較於 Seedream 4.x 更強調中文指令理解、視覺推理和高頻創意產出;對比 GPT Image、Gemini 圖像模型和 Qwen Image,它更適合字節生態內的廣告設計、電器素材和多場景視覺生產。
輸入模態:
輸出模態:
联网搜索多模态输出
試用模型
Minimax
上下文205K
輸入價格$0.3020/M
輸出$1.2077/M
面向真實生產力智能體的高性價比模型,強項在程式碼、工具呼叫、搜尋和辦公室交付,而不只是聊天。它適合讓代理商規劃並執行跨文件修改、研究檢索、文件/表格/演示類任務;相比更貴的旗艦模型,核心取捨是用更低成本換取接近前沿的執行效率。
輸入模態:
輸出模態:
深度思考工具调用函数调用结构化输出长上下文
試用模型
上下文13K
輸入價格$2.1606/M
輸出$2.1606/M
面向視訊生成和多素材視訊創作,相較於 Seedance 1.x 在運動穩定性、音訊視訊聯合生成和參考輸入上更完整;對比 Veo、Kling、Runway,它更適合需要文字、影像、音訊、視訊混音驅動的中文創意工作流程。該 filter-off 版本相比普通 Seedance 2.0 保持同檔生成能力,但內容過濾更寬鬆;適合短劇、廣告、電商和社交素材。
輸入模態:
輸出模態:
多模态输出
試用模型
上下文13K
輸入價格$1.5465/M
輸出$1.5465/M
面向視訊生成和多素材視訊創作,相較於 Seedance 1.x 在運動穩定性、音訊視訊聯合生成和參考輸入上更完整;對比 Veo、Kling、Runway,它更適合需要文字、影像、音訊、視訊混音驅動的中文創意工作流程。該 filter-off 版本相比普通 Seedance 2.0 保持同檔生成能力,但內容過濾更寬鬆;適合短劇、廣告、電商和社交素材。
輸入模態:
輸出模態:
多模态输出
試用模型
Claude
上下文1M
輸入價格
$1.7000/M$5.0000/M
輸出
$8.5000/M$25.0000/M
面向旗艦推理與複雜代理任務,相比 Claude 4.5/4.6 前序版本 在長上下文、程式碼、工具使用和複雜規劃上更進一步;對比 GPT、Gemini、Qwen 等旗艦模型,它更適合高可靠代理、程式碼庫維護和深度研究工作流程。
輸入模態:
輸出模態:
深度思考联网搜索工具调用函数调用结构化输出长上下文代码执行
試用模型
Kling
按秒$0.0900/s
以文字/影像為導向影片和多鏡頭創作,相較於 Kling 2.x 在運動穩定性、鏡頭語言和參考圖一致性上更進一步;對比 Veo、Runway、Seedance,它更適合中文短劇、廣告素材和高品質社群影片生產。
輸入模態:
輸出模態:
多模态输出
Kling
按秒$0.0900/s
以文字/影像為導向影片和多鏡頭創作,相較於 Kling 2.x 在運動穩定性、鏡頭語言和參考圖一致性上更進一步;對比 Veo、Runway、Seedance,它更適合中文短劇、廣告素材和高品質社群影片生產。
輸入模態:
輸出模態:
多模态输出
上下文8K
輸入價格
$1.7039/M$2.0046/M
輸出
$1.7039/M$2.0046/M
面向視訊生成和多素材視訊創作,相較於 Seedance 1.x 在運動穩定性、音訊視訊聯合生成和參考輸入上更完整;對比 Veo、Kling、Runway,它更適合需要文字、影像、音訊、視訊混音驅動的中文創意工作流程。高速版本相比標準檔更適合快速迭代和大量產出;適合短劇、廣告、電商和社群素材。
輸入模態:
輸出模態:
多模态输出
試用模型
上下文8K
輸入價格
$2.0309/M$2.1378/M
輸出
$2.0309/M$2.1378/M
面向視訊生成和多素材視訊創作,相較於 Seedance 1.x 在運動穩定性、音訊視訊聯合生成和參考輸入上更完整;對比 Veo、Kling、Runway,它更適合需要文字、影像、音訊、視訊混音驅動的中文創意工作流程。適合短劇、廣告、電商和社群素材。
輸入模態:
輸出模態:
多模态输出
試用模型
Zhipu
Zhipu AI
輸入價格$0.8800/M
輸出$3.5500/M
以影像產生與編輯,相較於早期 GLM 視覺能力更專注於中文提示詞、圖文理解和可控生成;對比 GPT Image、Gemini 圖像模型和 Qwen Image,它更適合中文行銷素材、知識圖解和多輪視覺修改。
輸入模態:
輸出模態:
多模态输出
上下文1M
輸入價格$0.5000/M
輸出$3.0000/M
Google 高速推理模型,專為 Agent 工作流程、多輪對話和程式碼輔助而設計。支援文字、圖像、音訊、視訊和 PDF 輸入,100 萬 token 上下文視窗。支援可配置推理等級、工具呼叫和結構化輸出。比前代 Gemini 2.5 Flash 在推理、多模態理解和可靠性方面全面提升。
輸入模態:
輸出模態:
深度思考工具调用函数调用结构化输出长上下文
試用模型
上下文66K
按張
$0.0938/image$0.1340/image
以影像產生與編輯,相較於 Gemini 早期影像能力更強調多模態理解、對話式修改和快速視覺原型;對比 GPT Image、Qwen Image 和 Seedream,它更適合把文件、圖片和提示詞合併到同一視覺工作流程中。
輸入模態:
輸出模態:
深度思考多模态输出
試用模型
Claude
上下文200K
輸入價格
$3.5000/M$5.0000/M
輸出
$17.5000/M$25.0000/M
面向旗艦推理與複雜代理任務,相比 Claude 4 系列前序版本 在長上下文、程式碼、工具使用和複雜規劃上更進一步;對比 GPT、Gemini、Qwen 等旗艦模型,它更適合高可靠代理、程式碼庫維護和深度研究工作流程。
輸入模態:
輸出模態:
深度思考工具调用结构化输出长上下文
試用模型
Gemini
按次$0.1100/call
面向高保真視訊生成,相比 Veo 2/3 在原生音訊、鏡頭控制和參考輸入工作流程上更成熟;對比 Kling、Runway、Seedance,它更適合電影感短片、廣告分鏡和需要穩定物理運動的視訊創作。 Lite 檔相較標準檔更偏向高吞吐和低成本草稿。
輸入模態:
輸出模態:
多模态输出
試用模型
Gemini
按次$0.2211/call
面向高保真視訊生成,相比 Veo 2/3 在原生音訊、鏡頭控制和參考輸入工作流程上更成熟;對比 Kling、Runway、Seedance,它更適合電影感短片、廣告分鏡和需要穩定物理運動的視訊創作。 Fast 檔相較標準檔較適合快速概念驗證。
輸入模態:
輸出模態:
多模态输出
試用模型
Gemini
Google
按次$1.6544/call
面向高保真視訊生成,相比 Veo 2/3 在原生音訊、鏡頭控制和參考輸入工作流程上更成熟;對比 Kling、Runway、Seedance,它更適合電影感短片、廣告分鏡和需要穩定物理運動的視訊創作。
輸入模態:
輸出模態:
多模态输出
試用模型
Claude
上下文200K
輸入價格
$0.3400/M$1.0000/M
輸出
$1.7000/M$5.0000/M
面向高效編碼與代理任務,相比 Claude Haiku 3.5 在長上下文、程式碼、工具使用和複雜規劃上更進一步;對比 GPT、Gemini、Qwen 等旗艦模型,它更適合高可靠代理、程式碼庫維護和深度研究工作流程。
輸入模態:
輸出模態:
深度思考工具调用结构化输出长上下文
試用模型
輸入價格
$0.5922/M$1.1844/M
輸出
$0.5922/M$1.1844/M
偏轻量与高吞吐的 Seedance 2.0 变体:适合短视频草稿、批量素材和成本敏感的快速迭代;它的价值在于更轻量的生成档位,若任务强调最高画质、复杂运动或更高规格输出,优先标准版。
輸入模態:
輸出模態:
多模态输出
試用模型
Gemini
按張$0.0300/image
這是特價體驗線路,生成等待時間較長,大概有 10% 的機率生成失敗。適合對成本敏感、可以接受排隊和偶發失敗的圖片生成體驗;如需更穩定的生產使用,建議選擇常規線路。
輸入模態:
輸出模態:
多模态输出
Gemini
按次$0.0200/call
這是特價體驗線路,生成等待時間較長,大概有 10% 的機率生成失敗。適合對成本敏感、可以接受排隊和偶發失敗的圖片生成體驗;如需更穩定的生產使用,建議選擇常規線路。
輸入模態:
輸出模態:
多模态输出
Gemini
按張$0.0300/image
這是特價體驗線路,生成等待時間較長,大概有 10% 的機率生成失敗。適合對成本敏感、可以接受排隊和偶發失敗的圖片生成體驗;如需更穩定的生產使用,建議選擇常規線路。
輸入模態:
輸出模態:
多模态输出