Claude
claude-fable-5-1
Anthropic
上下文1M
輸入價格
$3.4000/M$10.0000/M
輸出
$17.0000/M$50.0000/M
旗舰级长上下文模型,面向高难度、长周期的知识工作、代码项目和多步智能体任务;支持文本、图像与 PDF 输入,适合跨文件分析、复杂研究和持续工具调用。它更偏向质量、推理深度与长链路执行,速度较慢、成本较高,适合需要稳定完成复杂任务的场景。
輸入模態:
輸出模態:
深度思考联网搜索工具调用函数调用长上下文
Qwen
qwen3.8-flash
Qwen
上下文1M
輸入價格$0.1492/M
輸出$0.4476/M
Qwen 系列的高效多模态主力模型,原生支持百万级上下文,并兼顾代码辅助、智能体工作流和图表等视觉理解;适合长文档、代码库、高并发应用与需要工具协作的任务。
輸入模態:
輸出模態:
深度思考工具调用结构化输出长上下文
Zhipu
glm-5.3-flash
Zhipu AI
上下文1.31M
輸入價格$0.1190/M
輸出$0.4200/M
GLM-5 系列中兼顾前沿能力与调用效率的 Flash 模型:原生支持多模态,面向长上下文和高频执行,适合代码、智能体以及需要图文理解的复杂任务;相比更大档位,更适合作为成本敏感的生产主力。
輸入模態:
輸出模態:
深度思考工具调用结构化输出长上下文
DeepSeek
deepseek-v4-flash-vision-exp
DeepSeek
上下文1.05M
輸入價格$0.1490/M
輸出$0.2980/M
DeepSeek-V4-Flash 的实验性多模态变体,支持在文本交互中理解图像。适合视觉问答、截图和文档分析;由于处于实验阶段,更适合评估和灵活工作流,关键生产链路需谨慎使用。
輸入模態:
輸出模態:
深度思考工具调用长上下文
Z.ai
coding-glm-5.3-free
Free channel
上下文1M
輸入價格$0.0000/M
輸出$0.0000/M
免费模型仅供学习和体验,随时可能下架,高级模型设有每分钟5次请求的限制,且其可用性不作保证。
輸入模態:
輸出模態:
深度思考工具调用函数调用结构化输出长上下文
Zhipu
glm-5.3
Zhipu AI
上下文1M
輸入價格
$1.0115/M$1.1900/M
輸出
$3.5275/M$4.1500/M
面向复杂软件工程和长周期智能体任务的旗舰主力模型:沿用 GLM-5.2 基座,能力提升来自后训练,官方 Z.ai Code Bench 相比 GLM-5.2 提升 50%,并强化终端操作与漏洞发现。它提供 1M 上下文、最长 128K 输出,始终启用推理并支持 low、high、max 三档强度、函数调用和结构化输出;当前仅支持文本输入,不适合需要图像理解的任务。
輸入模態:
輸出模態:
深度思考工具调用函数调用结构化输出长上下文
Gemini
gemini-3.7-flash-free
Free channel
上下文1.05M
輸入價格$0.0000/M
輸出$0.0000/M
免费模型仅供学习和体验,随时可能下架,高级模型设有每分钟5次请求的限制,且其可用性不作保证。
輸入模態:
輸出模態:
深度思考工具调用长上下文
Gemini
gemini-3.7-flash
Google
上下文1.05M
輸入價格$0.7500/M
輸出$3.7500/M
Gemini 3 系列的新一代快速多模态模型,2026 年 8 月发布,主打低成本、高吞吐与多模态理解;支持文本、图像、视频、音频和文档输入,百万级上下文,适合大规模信息处理、批量任务和实时交互场景。
輸入模態:
輸出模態:
深度思考工具调用长上下文
Grok
grok-4.6
xAI
上下文500K
輸入價格$0.8400/M
輸出$2.5200/M
旗舰级通用模型,优先用于高质量代码、智能体执行和知识工作;适合需要持续规划、工具协作与复杂问题处理的任务。若只追求低延迟或低成本的简单调用,应优先选更轻量的模型。
輸入模態:
輸出模態:
深度思考工具调用结构化输出长上下文
Qwen
qwen3.8-max
Qwen
上下文1M
輸入價格
$1.4200/M$1.7750/M
輸出
$4.2640/M$5.3300/M
千问当前能力最强的旗舰多模态推理模型,适合长程编程、专业工作与多阶段智能体任务。它可处理文本、图片和视频,提供 1M 上下文、最长 128K 输出,并支持函数调用、结构化输出、联网搜索与代码解释器;更适合作为高质量复杂任务主力,而不是追求最低成本和最低延迟的批量调用。
輸入模態:
輸出模態:
深度思考联网搜索工具调用函数调用结构化输出长上下文代码执行
Minimax
MiniMax-H3
MiniMax
按秒$0.0800/s
面向视频创作的全模态生成模型,可结合文本、图像、视频和音频参考生成带同步音频的视频素材;适合短视频、广告和参考驱动的角色与镜头创作。它不是通用聊天模型,选择时应重点看视频一致性、运动表现与音画效果。
輸入模態:
輸出模態:
多模态输出
Claude
claude-opus-5
Anthropic
上下文1M
輸入價格
$1.7000/M$5.0000/M
輸出
$8.5000/M$25.0000/M
面向复杂智能体编程和企业级知识工作的高端模型,强调长链路规划、持续执行、自我校验和稳定交付;拥有百万级上下文,适合大型代码库、复杂文档以及需要较少人工监督的多步骤项目。
輸入模態:
輸出模態:
深度思考工具调用结构化输出长上下文
Gemini
gemini-3.6-flash
Google
上下文1.05M
輸入價格$1.5000/M
輸出$7.5000/M
Gemini Flash 系列的主力模型,强调效率、代码、知识工作和多模态理解;相比 3.5 Flash,它用更少的输出 token、推理步骤和工具调用完成多步任务,适合生产级智能体、文档与图表分析以及高频复杂工作流。
輸入模態:
輸出模態:
深度思考工具调用长上下文
Gemini
gemini-3.5-flash-lite
Google
上下文1.05M
輸入價格$0.3000/M
輸出$2.5000/M
Gemini 3.5 系列中速度最快、成本最低的模型,适合高并发、低延迟任务,以及翻译、分类、文档处理和轻量智能体工作流;支持多模态输入和最高 1M 上下文,但复杂推理、长链路规划或高质量代码修改应优先选择更高档 Flash 模型。
輸入模態:
輸出模態:
长上下文
MoonshotAI
kimi-k3
Moonshot
上下文1.05M
輸入價格
$2.7000/M$3.0000/M
輸出
$13.5000/M$15.0000/M
月之暗面的旗艦模型,原生支援視覺理解和最高 100 萬 token 上下文;目前以 max 推理強度運行,適合長鏈路編碼、知識工作及需要終端工具協作的複雜任務。為保持穩定性,建議保留完整推理歷史,並在相容的 Agent 框架中新開會話使用。
輸入模態:
輸出模態:
深度思考工具调用长上下文
MoonshotAI
coding-kimi-k3-free
Free channel
上下文1.05M
輸入價格$0.0000/M
輸出$0.0000/M
免费模型仅供学习和体验,随时可能下架,高级模型设有每分钟5次请求的限制,且其可用性不作保证。
輸入模態:
輸出模態:
深度思考工具调用长上下文
OpenAI
gpt-5.6-terra
OpenAI
上下文1.05M
輸入價格
$0.4000/M$2.0000/M
輸出
$2.4000/M$12.0000/M
GPT-5.6 中兼顾能力与成本的主力档位。适合需要图像理解、工具调用和较长材料处理的生产任务;若任务难度和交付质量优先,选择 Sol;若重在高并发成本控制,选择 Luna。
輸入模態:
輸出模態:
深度思考函数调用结构化输出长上下文
OpenAI
gpt-5.6-sol
OpenAI
上下文1.05M
輸入價格
$1.0000/M$5.0000/M
輸出
$6.0000/M$30.0000/M
GPT-5.6 系列的旗舰档位,面向复杂专业工作与高质量交付。支持图像输入、函数调用和结构化输出,并可承载超长上下文;对时延或单位成本敏感的高频任务,可考虑 Terra 或 Luna。
輸入模態:
輸出模態:
深度思考函数调用结构化输出长上下文
Doubao
doubao-seedream-5-0-pro
Doubao
按秒$0.0450/s
專業視覺創作的多模態影像產生模型,支援從文字產生影像,並結合參考圖和空間標註進行精準編輯;擅長高密度資訊圖、文字排版、真實光影與多語言圖文生成。
輸入模態:
輸出模態:
深度思考多模态输出
Grok
grok-4.5
xAI
上下文500K
輸入價格$2.1000/M
輸出$6.3000/M
程式碼、知識工作和 STEM 議題的旗艦推理模型。支援影像輸入、函數呼叫和結構化輸出,50 萬 token 上下文適合跨文件分析與長材料處理;不需要高難度推理時可選成本更低的模型。
輸入模態:
輸出模態:
深度思考函数调用结构化输出长上下文
Claude
claude-fable-5
Anthropic
上下文1M
輸入價格
$3.4000/M$10.0000/M
輸出
$17.0000/M$50.0000/M
Anthropic 迄今最強的公開發布模型,專為高難度推理與長週期智能體(agentic)任務打造。原生支援 100 萬 token 超長上下文與 128k 輸出,自適應思考預設常開;擅長在任務欠明確時自主探索環境、制定計劃並持續推進長程編碼與多智能體編排,需要人工介入前能把任務推進得更遠。
輸入模態:
輸出模態:
深度思考工具调用结构化输出长上下文
Gemini
gemini-3.1-flash-lite-image
Google
按次
$0.0120/call$0.0200/call
偏高效率和快速迭代的图像生成与编辑模型,适合高频视觉草稿、社媒素材、海报和多轮改图;支持多模态输入与百万级上下文,在速度和规模化调用上更有优势,但复杂创作控制优先选择 Pro Image。
輸入模態:
輸出模態:
多模态输出
Claude
claude-sonnet-5
Anthropic
上下文1M
輸入價格
$0.6800/M$2.0000/M
輸出
$3.4000/M$10.0000/M
Sonnet 檔位的日常主力模型,重點是在較低成本下提供接近旗艦的智能體、編碼和知識工作能力。預設 100 萬 token 上下文與自適應思考適合長文件、程式碼庫和多步驟工具任務;需要最深推理或受限高風險安全研究時,仍應評估更高檔或專用模型。
輸入模態:
輸出模態:
深度思考工具调用结构化输出长上下文
Doubao
doubao-seedance-2.5-260628
Doubao
輸入價格
$3.6594/M$3.8520/M
輸出
$3.6594/M$3.8520/M
Seedance 系列面向长叙事和复杂创作工作流的新一代模型:支持更灵活的多模态参考、视频延展与精细编辑,适合广告、影视短片和需要保持角色、场景与音画连续性的内容生产。
輸入模態:
輸出模態:
多模态输出
Doubao
doubao-seed-2-1-pro
Doubao
上下文256K
輸入價格$0.9700/M
輸出$4.8800/M
程式碼、代理程式和複雜生產力任務,相比 Doubao Seed 2.0 在長上下文、長輸出和工具任務上更進一步;對比 Qwen、GLM、DeepSeek 等同類國產旗艦,它適合作為中文辦公室、程式碼和多步驟自動化場景的高性價比選擇。
輸入模態:
輸出模態:
深度思考工具调用函数调用结构化输出长上下文
Qwen
happyhorse-1.1-t2v
阿里巴巴
按秒$0.1350/s
面向文生視頻,相比 HappyHorse 1.0 更突出音頻原生生成,一次完成對白、音效和背景音樂;對比 Veo、Kling、Runway,它的差異化優勢在聲畫同步和角色一致性工作流。適合短劇、廣告、電商和品牌行銷影片。
輸入模態:
輸出模態:
多模态输出
Qwen
happyhorse-1.1-r2v
阿里巴巴
按秒$0.1350/s
面向參考生成視頻,相比 HappyHorse 1.0 更突出音頻原生生成,一次完成對白、音效和背景音樂;對比 Veo、Kling、Runway,它的差異化優勢在聲畫同步和角色一致性工作流。適合短劇、廣告、電商和品牌行銷影片。
輸入模態:
輸出模態:
多模态输出
Qwen
happyhorse-1.1-i2v
阿里巴巴
按秒$0.1350/s
面向圖生視頻,相比 HappyHorse 1.0 更突出音頻原生生成,一次完成對白、音效和背景音樂;對比 Veo、Kling、Runway,它的差異化優勢在聲畫同步和角色一致性工作流。適合短劇、廣告、電商和品牌行銷影片。
輸入模態:
輸出模態:
多模态输出
Doubao
dreamina-seedance-2-0-mini-filter-off
Doubao
輸入價格$1.5750/M
輸出$1.5750/M
面向視訊生成和多素材視訊創作,相較於 Seedance 1.x 在運動穩定性、音訊視訊聯合生成和參考輸入上更完整;對比 Veo、Kling、Runway,它更適合需要文字、影像、音訊、視訊混音驅動的中文創意工作流程。該 filter-off 版本相比普通 Seedance 2.0 保持同檔生成能力,但內容過濾更寬鬆;適合短劇、廣告、電商和社交素材。
輸入模態:
輸出模態:
多模态输出
Zhipu
glm-5.2
Zhipu AI
上下文1M
輸入價格
$0.9690/M$1.1400/M
輸出
$3.4000/M$4.0000/M
面向推理、程式碼和長上下文代理任務,相比 GLM-5.1 在上下文長度、工具調用和複雜多步驟任務上更進一步;對比 Qwen、DeepSeek、Kimi 等國產旗艦,它更適合中文企業自動化、專案級程式碼分析和知識工作流。
輸入模態:
輸出模態:
深度思考工具调用函数调用结构化输出长上下文
Doubao
doubao-seedance-2.0-mini-260615
Doubao
輸入價格
$0.3150/M$0.6300/M
輸出
$0.3150/M$0.6300/M
Seedance 2.0 的轻量版本,保留文本、图像、视频等参考驱动的视频生成能力,更适合快速试做、批量草稿和对成本敏感的工作流;需要更复杂的运动控制、镜头表现或更高完成度时,优先选择标准版。
輸入模態:
輸出模態:
多模态输出
MoonshotAI
kimi-k2.7-code-highspeed
Moonshot
上下文256K
輸入價格$1.9000/M
輸出$7.9999/M
面向長上下文、多步驟工具呼叫和程式碼/文件工作流程,相較於 Kimi K2.6 更強調工程任務穩定性和上下文承載能力;對比 Qwen、GLM、DeepSeek,它更適合中文長文件分析、專案問答和日常智能程式設計。
輸入模態:
輸出模態:
工具调用函数调用结构化输出长上下文
MoonshotAI
kimi-k2.7-code
Moonshot
上下文256K
輸入價格
$0.8775/M$0.9750/M
輸出
$3.6450/M$4.0500/M
面向長上下文、多步驟工具呼叫和程式碼/文件工作流程,相較於 Kimi K2.6 更強調工程任務穩定性和上下文承載能力;對比 Qwen、GLM、DeepSeek,它更適合中文長文件分析、專案問答和日常智能程式設計。
輸入模態:
輸出模態:
工具调用函数调用结构化输出长上下文
Grok
grok-imagine-video-1-5-preview
xAI
按秒$0.1400/s
以影像/視訊為導向的生成、編輯和延展,相較於 Grok Imagine 1.0 更強調運動一致性和快速社交內容產出;對比 Veo、Kling、Runway,它更適合 xAI 生態裡的短影片、廣告創意和即時趨勢素材。
輸入模態:
輸出模態:
多模态输出
Qwen
qwen3.7-plus
Qwen
上下文1M
輸入價格
$0.2400/M$0.3000/M
輸出
$0.9600/M$1.2000/M
面向代理式工作負載、程式碼和辦公室生產力,相較於 Qwen3.6 更強調長上下文、工具呼叫和結構化輸出的穩定組合;對比 GPT、Claude、Gemini 等旗艦模型,它更適合作為中文、程式碼和多步驟工具任務裡的高性價比替代。
輸入模態:
輸出模態:
深度思考工具调用函数调用结构化输出长上下文
Minimax
minimax-m3-free
Free channel
上下文1M
輸入價格$0.0000/M
輸出$0.0000/M
免费模型仅供学习和体验,随时可能下架,高级模型设有每分钟5次请求的限制,且其可用性不作保证。
輸入模態:
輸出模態:
深度思考工具调用函数调用结构化输出长上下文
Minimax
MiniMax-M3
MiniMax
上下文1M
輸入價格$0.3150/M
輸出$1.2600/M
以長週期編碼、工具使用和多輪生產協作,相較於 MiniMax M2.7 進一步擴展到多模態輸入並保留 100 萬 token 上下文;對比 Claude、Gemini、GLM-5.2 等長上下文代理模型,它更適合將文字、圖像、視訊資料放入同一工作流程。
輸入模態:
輸出模態:
深度思考工具调用函数调用结构化输出长上下文
Claude
claude-opus-4-8
Anthropic
上下文1M
輸入價格
$1.7000/M$5.0000/M
輸出
$8.5000/M$25.0000/M
面向旗艦推理與複雜代理任務,相比 Claude Opus 4.7 在長上下文、程式碼、工具使用和複雜規劃上更進一步;對比 GPT、Gemini、Qwen 等旗艦模型,它更適合高可靠代理、程式碼庫維護和深度研究工作流程。
輸入模態:
輸出模態:
深度思考工具调用结构化输出长上下文
Gemini
gemini-omni-video
Google
按秒$0.2450/s
面向任意輸入到視訊的多模態創作,相較於 Gemini 早期視訊能力更強調文字、影像、音訊和視訊資料的統一編排;對比 Veo、Kling、Runway,它更適合將複雜多模態素材整合進同一創意工作流程。
輸入模態:
輸出模態:
多模态输出
Gemini
gemini-3.5-flash
Google
上下文1M
輸入價格$1.5000/M
輸出$9.0000/M
面向多模態理解、程式碼和長上下文任務,相較於 Gemini 3.1 在吞吐、上下文和工具能力上更進一步;對比 GPT、Claude、Qwen 等模型,它更適合把文字、圖像、音訊、視訊和文件放進統一分析工作流程。
輸入模態:
輸出模態:
深度思考联网搜索工具调用函数调用结构化输出长上下文代码执行
Qwen
qwen3.7-max
Qwen
上下文1M
輸入價格
$1.4400/M$1.8000/M
輸出
$4.3200/M$5.4000/M
面向代理式工作負載、程式碼和辦公室生產力,相較於 Qwen3.6 更強調長上下文、工具呼叫和結構化輸出的穩定組合;對比 GPT、Claude、Gemini 等旗艦模型,它更適合作為中文、程式碼和多步驟工具任務裡的高性價比替代。
輸入模態:
輸出模態:
深度思考工具调用函数调用结构化输出长上下文
Qwen
happyhorse-1.0-video-edit
Qwen
上下文8K
按秒$0.1350/s
面向視訊編輯,相較於 早期視訊模型 更突出音訊原生生成,一次完成對白、音效和背景音樂;對比 Veo、Kling、Runway,它的差異化優勢在聲畫同步和角色一致性工作流程。適合短劇、廣告、電商和品牌行銷影片。
輸入模態:
輸出模態:
多模态输出
Qwen
happyhorse-1.0-t2v
Qwen
上下文8K
按秒$0.1350/s
面向文生視頻,相比 早期視頻模型 更突出音頻原生生成,一次完成對白、音效和背景音樂;對比 Veo、Kling、Runway,它的差異化優勢在聲畫同步和角色一致性工作流。適合短劇、廣告、電商和品牌行銷影片。
輸入模態:
輸出模態:
多模态输出
Qwen
happyhorse-1.0-r2v
Qwen
上下文8K
按秒$0.1350/s
面向參考生成視頻,相比 早期視頻模型 更突出音頻原生生成,一次完成對白、音效和背景音樂;對比 Veo、Kling、Runway,它的差異化優勢在聲畫同步和角色一致性工作流。適合短劇、廣告、電商和品牌行銷影片。
輸入模態:
輸出模態:
多模态输出
Qwen
happyhorse-1.0-i2v
Qwen
上下文8K
按秒$0.1350/s
面向圖生視頻,相比 早期視頻模型 更突出音頻原生生成,一次完成對白、音效和背景音樂;對比 Veo、Kling、Runway,它的差異化優勢在聲畫同步和角色一致性工作流。適合短劇、廣告、電商和品牌行銷影片。
輸入模態:
輸出模態:
多模态输出
DeepSeek
deepseek-v4-pro
DeepSeek
上下文1M
輸入價格
$1.5390/M$1.7100/M
輸出
$3.0869/M$3.4299/M
面向推理、程式碼和智能體工具使用,相比 DeepSeek V3.2 更強調長上下文、思考模式和複雜任務執行;對比 Qwen、GLM、Kimi 等國產模型,它在數學、程式設計和邏輯推理場景中更具競爭力,適合嚴肅程式碼與分析任務。
輸入模態:
輸出模態:
长上下文工具调用深度思考结构化输出
DeepSeek
deepseek-v4-flash
DeepSeek
上下文1M
輸入價格
$0.1278/M$0.1420/M
輸出
$0.2574/M$0.2860/M
面向推理、程式碼和智能體工具使用,相比 DeepSeek V3.2 更強調長上下文、思考模式和複雜任務執行;對比 Qwen、GLM、Kimi 等國產模型,它在數學、程式設計和邏輯推理場景中更具競爭力,適合嚴肅程式碼與分析任務。
輸入模態:
輸出模態:
长上下文工具调用深度思考结构化输出
OpenAI
gpt-5.5
OpenAI
上下文1M
輸入價格
$1.0000/M$5.0000/M
輸出
$6.0000/M$30.0000/M
面向推理、程式碼、視覺理解和智能體任務,相比 GPT-5.4 更強調長上下文、工具調用和規模化穩定輸出;對比 Claude、Gemini、Qwen 等旗艦模型,它更適合作為通用高可靠自動化和複雜知識工作流程底座。
輸入模態:
輸出模態:
深度思考工具调用结构化输出长上下文
XiaomiMiMo
mimo-v2.5-tts-voicedesign
Xiaomi MiMo
輸入價格$0.0000/M
輸出$0.0000/M
面向一句話音色設計和文字轉語音,相比 MiMo V2 TTS 更強調 V2.5 系列的自然語言音色創建、語速/情緒/語氣細粒度控制和低門檻聲音生產;對比 ElevenLabs、OpenAI TTS 和 Azure Speech,它更適合無需參考音頻的角色設計、廣告配音、短片旁白和多風格語音旁白。
輸入模態:
輸出模態:
多模态输出
XiaomiMiMo
mimo-v2.5-tts-voiceclone
Xiaomi MiMo
輸入價格$0.0000/M
輸出$0.0000/M
面向少量樣本聲音克隆,相比 MiMo V2 TTS 更強調 V2.5 系列的高保真音色復刻、音色特徵一致性和跨文本泛化穩定性;對比 ElevenLabs、OpenAI TTS 和 Azure Speech,它更適合中文角色配音、短視頻旁白、播客復刻和需要保留目標音色的多語言語音生產。
輸入模態:
輸出模態:
多模态输出
XiaomiMiMo
mimo-v2.5-tts
Xiaomi MiMo
輸入價格$0.0000/M
輸出$0.0000/M
以文字轉語音、Voice Design 和聲音克隆,相較於 MiMo V2 TTS 更強調 V2.5 系列的自然語音合成、細粒度語速/情緒/音調控制和低門檻音色創建;對比 ElevenLabs、OpenAI TTS 和 Azure Speech,它更適合中文音訊旁白、角色配音、短視訊音訊和多語言語音生產。
輸入模態:
輸出模態:
多模态输出
XiaomiMiMo
mimo-v2.5-pro
Xiaomi MiMo
上下文1M
輸入價格$1.1700/M
輸出$3.5000/M
面向代理、程式碼和長上下文任務,相比 MiMo V2 在多模態理解、百萬級上下文和長程推理上更完整;對比 Qwen、GLM、DeepSeek 等國產模型,它的優勢在小米生態適配和工程自動化場景。
輸入模態:
輸出模態:
深度思考工具调用结构化输出长上下文
XiaomiMiMo
mimo-v2.5
Xiaomi MiMo
上下文1M
輸入價格$0.4700/M
輸出$2.3600/M
面向代理、程式碼和長上下文任務,相比 MiMo V2 在多模態理解、百萬級上下文和長程推理上更完整;對比 Qwen、GLM、DeepSeek 等國產模型,它的優勢在小米生態適配和工程自動化場景。
輸入模態:
輸出模態:
深度思考工具调用结构化输出长上下文
OpenAI
gpt-image-2-text-to-image
OpenAI
上下文128K
按張$0.0300/image
這是特價體驗線路,生成等待時間較長,大概有 10% 的機率生成失敗。適合對成本敏感、可以接受排隊和偶發失敗的圖片生成體驗;如需更穩定的生產使用,建議選擇常規線路。
輸入模態:
輸出模態:
多模态输出
OpenAI
gpt-image-2-image-to-image
OpenAI
上下文128K
按張$0.0200/image
這是特價體驗線路,生成等待時間較長,大概有 10% 的機率生成失敗。適合對成本敏感、可以接受排隊和偶發失敗的圖片生成體驗;如需更穩定的生產使用,建議選擇常規線路。
輸入模態:
輸出模態:
多模态输出
OpenAI
gpt-image-2
OpenAI
上下文128K
按張$0.0670/image
面向高品質影像生成與編輯,相較於 GPT Image 1.x 在文字渲染、局部編輯和多輪一致性上更進一步;對比 Gemini 影像模型、Qwen Image 和 Seedream,它更適合品牌視覺、廣告設計、產品圖和需要精細控制的創意工作流程。
輸入模態:
輸出模態:
多模态输出
Claude
claude-opus-4-7
Anthropic
上下文1M
輸入價格
$1.7000/M$5.0000/M
輸出
$8.5000/M$25.0000/M
面向旗艦推理與複雜代理任務,相比 Claude Opus 4.6 在長上下文、程式碼、工具使用和複雜規劃上更進一步;對比 GPT、Gemini、Qwen 等旗艦模型,它更適合高可靠代理、程式碼庫維護和深度研究工作流程。
輸入模態:
輸出模態:
深度思考联网搜索工具调用函数调用结构化输出长上下文代码执行
Minimax
MiniMax-M2.7-highspeed
MiniMax
上下文200K
輸入價格$0.6300/M
輸出$2.5200/M
面向文本生成、推理和工具調用,相比 MiniMax M2.x 早期版本更強調 200K 長上下文和代理式工作流程穩定性;對比 Kimi、GLM、Qwen 等同類中文模型,它適合辦公室、程式碼輔助和長文檔處理。
輸入模態:
輸出模態:
深度思考
Minimax
MiniMax-M2.7
MiniMax
上下文200K
輸入價格$0.3150/M
輸出$1.2600/M
面向文本生成、推理和工具調用,相比 MiniMax M2.x 早期版本更強調 200K 長上下文和代理式工作流程穩定性;對比 Kimi、GLM、Qwen 等同類中文模型,它適合辦公室、程式碼輔助和長文檔處理。
輸入模態:
輸出模態:
深度思考
OpenAI
gpt-5.4-mini
OpenAI
上下文400K
輸入價格$0.7500/M
輸出$4.5000/M
面向推理、程式碼、視覺理解和智能體任務,相比 GPT-5.3 更強調長上下文、工具調用和規模化穩定輸出;對比 Claude、Gemini、Qwen 等旗艦模型,它更適合作為通用高可靠自動化和複雜知識工作流程底座。
輸入模態:
輸出模態:
长上下文工具调用深度思考结构化输出
OpenAI
gpt-5.4
OpenAI
上下文1.05M
輸入價格
$0.5000/M$2.5000/M
輸出
$3.0000/M$15.0000/M
面向推理、程式碼、視覺理解和智能體任務,相比 GPT-5.3 更強調長上下文、工具調用和規模化穩定輸出;對比 Claude、Gemini、Qwen 等旗艦模型,它更適合作為通用高可靠自動化和複雜知識工作流程底座。
輸入模態:
輸出模態:
长上下文工具调用深度思考结构化输出
Qwen
qwen-image-2.0-pro
Qwen
輸入價格$2.2000/M
輸出$2.2000/M
影像生成與編輯,相較於 Qwen Image 1.x 在中文文字渲染、指令遵循和複雜版式上更進一步;對比 GPT Image、Gemini 圖像模型和 Seedream,它更適合中文海報、電商圖、資訊圖和多輪視覺創作。
輸入模態:
輸出模態:
多模态输出
Qwen
qwen-image-2.0
Qwen
輸入價格$2.2000/M
輸出$2.2000/M
影像生成與編輯,相較於 Qwen Image 1.x 在中文文字渲染、指令遵循和複雜版式上更進一步;對比 GPT Image、Gemini 圖像模型和 Seedream,它更適合中文海報、電商圖、資訊圖和多輪視覺創作。
輸入模態:
輸出模態:
多模态输出
Gemini
gemini-3.1-flash-image-preview
Google
上下文131K
按張$0.0672/image
以影像產生與編輯,相較於 Gemini 早期影像能力更強調多模態理解、對話式修改和快速視覺原型;對比 GPT Image、Qwen Image 和 Seedream,它更適合把文件、圖片和提示詞合併到同一視覺工作流程中。
輸入模態:
輸出模態:
深度思考多模态输出
Gemini
gemini-3.1-flash-image
Google
按張
$0.0198/image$0.0330/image
Gemini 图像模型中兼顾质量与速度的高效档位,适合文本生图、图像编辑、多图融合和需要快速规模化产出的工作流;支持更灵活的构图与文字渲染,复杂专业设计可考虑 Gemini 3 Pro Image。
輸入模態:
輸出模態:
多模态输出
Gemini
gemini-3.1-pro-preview
Google
上下文1.05M
輸入價格$2.0000/M
輸出$12.0000/M
面向多模態理解、程式碼和長上下文任務,相較於 Gemini 3.0 / 2.5 在吞吐、上下文和工具能力上更進一步;對比 GPT、Claude、Qwen 等模型,它更適合把文字、圖像、音訊、視訊和文件放進統一分析工作流程。
輸入模態:
輸出模態:
长上下文
Claude
claude-sonnet-4-6
Anthropic
上下文1M
輸入價格
$1.0200/M$3.0000/M
輸出
$5.1000/M$15.0000/M
面向高效編碼與代理任務,相比 Claude 4.5/4.6 前序版本 在長上下文、程式碼、工具使用和複雜規劃上更進一步;對比 GPT、Gemini、Qwen 等旗艦模型,它更適合高可靠代理、程式碼庫維護和深度研究工作流程。
輸入模態:
輸出模態:
深度思考联网搜索工具调用函数调用结构化输出长上下文代码执行
Doubao
doubao-seed-2-0-pro
Doubao
上下文256K
輸入價格$0.5000/M
輸出$2.5300/M
程式碼、代理程式和複雜生產力任務,相比 Doubao Seed 2.0 在長上下文、長輸出和工具任務上更進一步;對比 Qwen、GLM、DeepSeek 等同類國產旗艦,它適合作為中文辦公室、程式碼和多步驟自動化場景的高性價比選擇。
輸入模態:
輸出模態:
深度思考联网搜索工具调用函数调用结构化输出长上下文
Doubao
doubao-seedream-5.0-lite
Doubao
按張$0.0350/image
影像生成與編輯,相較於 Seedream 4.x 更強調中文指令理解、視覺推理和高頻創意產出;對比 GPT Image、Gemini 圖像模型和 Qwen Image,它更適合字節生態內的廣告設計、電器素材和多場景視覺生產。
輸入模態:
輸出模態:
联网搜索多模态输出
Minimax
MiniMax-M2.5
MiniMax
上下文205K
輸入價格$0.3020/M
輸出$1.2077/M
面向真實生產力智能體的高性價比模型,強項在程式碼、工具呼叫、搜尋和辦公室交付,而不只是聊天。它適合讓代理商規劃並執行跨文件修改、研究檢索、文件/表格/演示類任務;相比更貴的旗艦模型,核心取捨是用更低成本換取接近前沿的執行效率。
輸入模態:
輸出模態:
深度思考工具调用函数调用结构化输出长上下文
Doubao
doubao-seedance-2-0-filter-off
Doubao
上下文13K
輸入價格$3.1500/M
輸出$3.1500/M
面向視訊生成和多素材視訊創作,相較於 Seedance 1.x 在運動穩定性、音訊視訊聯合生成和參考輸入上更完整;對比 Veo、Kling、Runway,它更適合需要文字、影像、音訊、視訊混音驅動的中文創意工作流程。該 filter-off 版本相比普通 Seedance 2.0 保持同檔生成能力,但內容過濾更寬鬆;適合短劇、廣告、電商和社交素材。
輸入模態:
輸出模態:
多模态输出
Doubao
doubao-seedance-2-0-fast-filter-off
Doubao
上下文13K
輸入價格$2.5200/M
輸出$2.5200/M
面向視訊生成和多素材視訊創作,相較於 Seedance 1.x 在運動穩定性、音訊視訊聯合生成和參考輸入上更完整;對比 Veo、Kling、Runway,它更適合需要文字、影像、音訊、視訊混音驅動的中文創意工作流程。該 filter-off 版本相比普通 Seedance 2.0 保持同檔生成能力,但內容過濾更寬鬆;適合短劇、廣告、電商和社交素材。
輸入模態:
輸出模態:
多模态输出
Claude
claude-opus-4-6
Anthropic
上下文1M
輸入價格
$1.7000/M$5.0000/M
輸出
$8.5000/M$25.0000/M
面向旗艦推理與複雜代理任務,相比 Claude 4.5/4.6 前序版本 在長上下文、程式碼、工具使用和複雜規劃上更進一步;對比 GPT、Gemini、Qwen 等旗艦模型,它更適合高可靠代理、程式碼庫維護和深度研究工作流程。
輸入模態:
輸出模態:
深度思考联网搜索工具调用函数调用结构化输出长上下文代码执行
Kling
kling-v3-omni
kling
按秒$0.0900/s
以文字/影像為導向影片和多鏡頭創作,相較於 Kling 2.x 在運動穩定性、鏡頭語言和參考圖一致性上更進一步;對比 Veo、Runway、Seedance,它更適合中文短劇、廣告素材和高品質社群影片生產。
輸入模態:
輸出模態:
多模态输出
Kling
kling-v3
kling
按秒$0.0900/s
以文字/影像為導向影片和多鏡頭創作,相較於 Kling 2.x 在運動穩定性、鏡頭語言和參考圖一致性上更進一步;對比 Veo、Runway、Seedance,它更適合中文短劇、廣告素材和高品質社群影片生產。
輸入模態:
輸出模態:
多模态输出
Doubao
doubao-seedance-2.0-fast-260128
Doubao
輸入價格
$1.4566/M$1.7136/M
輸出
$1.4566/M$1.7136/M
Seedance 2.0 的速度优先版本,面向低延迟生成和快速迭代;适合批量试镜、素材探索和需要尽快得到可用视频草稿的场景。若更看重复杂参考融合、动作稳定性和最终画面完成度,应选择标准版。
輸入模態:
輸出模態:
多模态输出
Doubao
doubao-seedance-2.0-260128
Doubao
輸入價格
$2.1606/M$2.2743/M
輸出
$2.1606/M$2.2743/M
Seedance 2.0 标准版,适合把文本、图像、音频和视频参考组合成可控的视频创作;在复杂运动、多主体互动、镜头控制和音画联合生成之间取得平衡,适合作为广告、短片和高质量素材生产的常规主力。
輸入模態:
輸出模態:
多模态输出
Gemini
gemini-3-flash-preview
Google
上下文1M
輸入價格$0.5000/M
輸出$3.0000/M
Google 高速推理模型,專為 Agent 工作流程、多輪對話和程式碼輔助而設計。支援文字、圖像、音訊、視訊和 PDF 輸入,100 萬 token 上下文視窗。支援可配置推理等級、工具呼叫和結構化輸出。比前代 Gemini 2.5 Flash 在推理、多模態理解和可靠性方面全面提升。
輸入模態:
輸出模態:
深度思考工具调用函数调用结构化输出长上下文
Gemini
gemini-3-pro-image-preview
Google
上下文66K
按張$0.1340/image
以影像產生與編輯,相較於 Gemini 早期影像能力更強調多模態理解、對話式修改和快速視覺原型;對比 GPT Image、Qwen Image 和 Seedream,它更適合把文件、圖片和提示詞合併到同一視覺工作流程中。
輸入模態:
輸出模態:
深度思考多模态输出
Gemini
gemini-3-pro-image
Google
按張
$0.0318/image$0.0530/image
面向专业创作的推理型图像生成与编辑模型,适合复杂平面设计、高保真产品样机、信息图和需要准确文字渲染的视觉内容;相比更快的 Flash Image 档位,更强调精细控制、事实依据与成片质量。
輸入模態:
輸出模態:
多模态输出
Claude
claude-opus-4-5
Anthropic
上下文200K
輸入價格$5.0000/M
輸出$25.0000/M
面向旗艦推理與複雜代理任務,相比 Claude 4 系列前序版本 在長上下文、程式碼、工具使用和複雜規劃上更進一步;對比 GPT、Gemini、Qwen 等旗艦模型,它更適合高可靠代理、程式碼庫維護和深度研究工作流程。
輸入模態:
輸出模態:
深度思考工具调用结构化输出长上下文
Gemini
veo3.1-lite
Google
按次$0.1100/call
面向高保真視訊生成,相比 Veo 2/3 在原生音訊、鏡頭控制和參考輸入工作流程上更成熟;對比 Kling、Runway、Seedance,它更適合電影感短片、廣告分鏡和需要穩定物理運動的視訊創作。 Lite 檔相較標準檔更偏向高吞吐和低成本草稿。
輸入模態:
輸出模態:
多模态输出
Gemini
veo3.1-fast
Google
按次$0.2211/call
面向高保真視訊生成,相比 Veo 2/3 在原生音訊、鏡頭控制和參考輸入工作流程上更成熟;對比 Kling、Runway、Seedance,它更適合電影感短片、廣告分鏡和需要穩定物理運動的視訊創作。 Fast 檔相較標準檔較適合快速概念驗證。
輸入模態:
輸出模態:
多模态输出
Gemini
veo3.1
Google
按次$1.6544/call
面向高保真視訊生成,相比 Veo 2/3 在原生音訊、鏡頭控制和參考輸入工作流程上更成熟;對比 Kling、Runway、Seedance,它更適合電影感短片、廣告分鏡和需要穩定物理運動的視訊創作。
輸入模態:
輸出模態:
多模态输出
Gemini
gemini-2.5-flash-image
Google
上下文66K
按張$0.0585/image
以影像產生與編輯,相較於 Gemini 早期影像能力更強調多模態理解、對話式修改和快速視覺原型;對比 GPT Image、Qwen Image 和 Seedream,它更適合把文件、圖片和提示詞合併到同一視覺工作流程中。
輸入模態:
輸出模態:
结构化输出多模态输出
Claude
claude-haiku-4-5
Anthropic
上下文200K
輸入價格
$0.3400/M$1.0000/M
輸出
$1.7000/M$5.0000/M
面向高效編碼與代理任務,相比 Claude Haiku 3.5 在長上下文、程式碼、工具使用和複雜規劃上更進一步;對比 GPT、Gemini、Qwen 等旗艦模型,它更適合高可靠代理、程式碼庫維護和深度研究工作流程。
輸入模態:
輸出模態:
深度思考工具调用结构化输出长上下文
Qwen
wan3.0-video-prime
Qwen
按秒$0.4500/s
通义万相 3.0 系列的速度优先版本(早期访问阶段),在保持高质量视频生成的同时缩短出片等待,适合低延迟预览、批量试做和需要快速迭代的短视频工作流;若更看重极致画面控制而非出片速度,可选择标准版。
輸入模態:
輸出模態:
多模态输出
Qwen
wan3.0-video
Qwen
按秒$0.3000/s
阿里通义万相 3.0 系列的标准视频生成模型(早期访问阶段),支持文生视频、图生视频及多模态参考输入,单次可生成最长约 30 秒的视频并同步生成音频,适合广告、短剧和叙事短片的快速出片;正式发布日期尚未公布,规格以官方为准。
輸入模態:
輸出模態:
多模态输出
Zhipu
glm-image
Zhipu AI
輸入價格$0.8800/M
輸出$3.5500/M
以影像產生與編輯,相較於早期 GLM 視覺能力更專注於中文提示詞、圖文理解和可控生成;對比 GPT Image、Gemini 圖像模型和 Qwen Image,它更適合中文行銷素材、知識圖解和多輪視覺修改。
輸入模態:
輸出模態:
多模态输出
Doubao
dreamina-seedance-2-5-filter-off
Doubao
輸入價格$75.0000/M
輸出$75.0000/M
WhatsApp