Zhipu
glm-5.3
Zhipu AI
上下文1M
輸入價格
$1.0115/M$1.1900/M
輸出
$3.5275/M$4.1500/M
面向复杂软件工程和长周期智能体任务的旗舰主力模型:沿用 GLM-5.2 基座,能力提升来自后训练,官方 Z.ai Code Bench 相比 GLM-5.2 提升 50%,并强化终端操作与漏洞发现。它提供 1M 上下文、最长 128K 输出,始终启用推理并支持 low、high、max 三档强度、函数调用和结构化输出;当前仅支持文本输入,不适合需要图像理解的任务。
輸入模態:
輸出模態:
深度思考工具调用函数调用结构化输出长上下文
Qwen
qwen3.8-max
Qwen
上下文1M
輸入價格
$1.4200/M$1.7750/M
輸出
$4.2640/M$5.3300/M
千问当前能力最强的旗舰多模态推理模型,适合长程编程、专业工作与多阶段智能体任务。它可处理文本、图片和视频,提供 1M 上下文、最长 128K 输出,并支持函数调用、结构化输出、联网搜索与代码解释器;更适合作为高质量复杂任务主力,而不是追求最低成本和最低延迟的批量调用。
輸入模態:
輸出模態:
深度思考联网搜索工具调用函数调用结构化输出长上下文代码执行
MoonshotAI
kimi-k3
Moonshot
上下文1.05M
輸入價格
$2.7000/M$3.0000/M
輸出
$13.5000/M$15.0000/M
月之暗面的旗艦模型,原生支援視覺理解和最高 100 萬 token 上下文;目前以 max 推理強度運行,適合長鏈路編碼、知識工作及需要終端工具協作的複雜任務。為保持穩定性,建議保留完整推理歷史,並在相容的 Agent 框架中新開會話使用。
輸入模態:
輸出模態:
深度思考工具调用长上下文
OpenAI
gpt-5.6-terra
OpenAI
上下文1.05M
輸入價格
$0.4000/M$2.0000/M
輸出
$2.4000/M$12.0000/M
GPT-5.6 中兼顾能力与成本的主力档位。适合需要图像理解、工具调用和较长材料处理的生产任务;若任务难度和交付质量优先,选择 Sol;若重在高并发成本控制,选择 Luna。
輸入模態:
輸出模態:
深度思考函数调用结构化输出长上下文
OpenAI
gpt-5.6-sol
OpenAI
上下文1.05M
輸入價格
$1.0000/M$5.0000/M
輸出
$6.0000/M$30.0000/M
GPT-5.6 系列的旗舰档位,面向复杂专业工作与高质量交付。支持图像输入、函数调用和结构化输出,并可承载超长上下文;对时延或单位成本敏感的高频任务,可考虑 Terra 或 Luna。
輸入模態:
輸出模態:
深度思考函数调用结构化输出长上下文
OpenAI
gpt-5.6-luna
OpenAI
上下文1.05M
輸入價格
$0.0400/M$0.2000/M
輸出
$0.2400/M$1.2000/M
GPT-5.6 的高并发、成本敏感档位。适合摘要、分类、改写和批量自动化;需要复杂专业判断或质量优先的多步任务时,优先选同系列 Sol。
輸入模態:
輸出模態:
深度思考函数调用结构化输出长上下文
Grok
grok-4.5
xAI
上下文500K
輸入價格$2.1000/M
輸出$6.3000/M
程式碼、知識工作和 STEM 議題的旗艦推理模型。支援影像輸入、函數呼叫和結構化輸出,50 萬 token 上下文適合跨文件分析與長材料處理;不需要高難度推理時可選成本更低的模型。
輸入模態:
輸出模態:
深度思考函数调用结构化输出长上下文
Claude
claude-fable-5
Anthropic
上下文1M
輸入價格
$3.4000/M$10.0000/M
輸出
$17.0000/M$50.0000/M
Anthropic 迄今最強的公開發布模型,專為高難度推理與長週期智能體(agentic)任務打造。原生支援 100 萬 token 超長上下文與 128k 輸出,自適應思考預設常開;擅長在任務欠明確時自主探索環境、制定計劃並持續推進長程編碼與多智能體編排,需要人工介入前能把任務推進得更遠。
輸入模態:
輸出模態:
深度思考工具调用结构化输出长上下文
Claude
claude-sonnet-5
Anthropic
上下文1M
輸入價格
$0.6800/M$2.0000/M
輸出
$3.4000/M$10.0000/M
Sonnet 檔位的日常主力模型,重點是在較低成本下提供接近旗艦的智能體、編碼和知識工作能力。預設 100 萬 token 上下文與自適應思考適合長文件、程式碼庫和多步驟工具任務;需要最深推理或受限高風險安全研究時,仍應評估更高檔或專用模型。
輸入模態:
輸出模態:
深度思考工具调用结构化输出长上下文
LongCat
LongCat-2.0
美团
上下文1M
輸入價格$0.3000/M
輸出$1.2000/M
專案層級程式碼和長週期智能體任務的 LongCat 2.0 主力模型,原生 100 萬 token 上下文,支援工具呼叫和多步驟推理。更適合裝下大型倉庫、長文件和自動化工作流程後持續推進;如果只是輕量問答或低延遲閒聊,選擇較小的 Flash/Lite 類別模型會更省。
輸入模態:
輸出模態:
深度思考工具调用函数调用长上下文
Doubao
doubao-seed-2-1-pro
Doubao
上下文256K
輸入價格$0.9700/M
輸出$4.8800/M
程式碼、代理程式和複雜生產力任務,相比 Doubao Seed 2.0 在長上下文、長輸出和工具任務上更進一步;對比 Qwen、GLM、DeepSeek 等同類國產旗艦,它適合作為中文辦公室、程式碼和多步驟自動化場景的高性價比選擇。
輸入模態:
輸出模態:
深度思考工具调用函数调用结构化输出长上下文
Qwen
happyhorse-1.1-t2v
阿里巴巴
按秒$0.1350/s
面向文生視頻,相比 HappyHorse 1.0 更突出音頻原生生成,一次完成對白、音效和背景音樂;對比 Veo、Kling、Runway,它的差異化優勢在聲畫同步和角色一致性工作流。適合短劇、廣告、電商和品牌行銷影片。
輸入模態:
輸出模態:
多模态输出
Qwen
happyhorse-1.1-r2v
阿里巴巴
按秒$0.1350/s
面向參考生成視頻,相比 HappyHorse 1.0 更突出音頻原生生成,一次完成對白、音效和背景音樂;對比 Veo、Kling、Runway,它的差異化優勢在聲畫同步和角色一致性工作流。適合短劇、廣告、電商和品牌行銷影片。
輸入模態:
輸出模態:
多模态输出
Qwen
happyhorse-1.1-i2v
阿里巴巴
按秒$0.1350/s
面向圖生視頻,相比 HappyHorse 1.0 更突出音頻原生生成,一次完成對白、音效和背景音樂;對比 Veo、Kling、Runway,它的差異化優勢在聲畫同步和角色一致性工作流。適合短劇、廣告、電商和品牌行銷影片。
輸入模態:
輸出模態:
多模态输出
Doubao
doubao-seedance-2-0-mini
Doubao
輸入價格
$0.7560/M$1.5120/M
輸出
$0.7560/M$1.5120/M
面向视频生成和多素材视频创作,相比 Seedance 1.x 在运动稳定性、音视频联合生成和参考输入上更完整;对比 Veo、Kling、Runway,它更适合需要文本、图像、音频、视频混合驱动的中文创意工作流。Mini 档相比标准 Seedance 2.0 更偏向低成本和高频测试;适合短剧、广告、电商和社交素材。
輸入模態:
輸出模態:
多模态输出
Doubao
dreamina-seedance-2-0-mini-filter-off
Doubao
輸入價格$1.5750/M
輸出$1.5750/M
面向視訊生成和多素材視訊創作,相較於 Seedance 1.x 在運動穩定性、音訊視訊聯合生成和參考輸入上更完整;對比 Veo、Kling、Runway,它更適合需要文字、影像、音訊、視訊混音驅動的中文創意工作流程。該 filter-off 版本相比普通 Seedance 2.0 保持同檔生成能力,但內容過濾更寬鬆;適合短劇、廣告、電商和社交素材。
輸入模態:
輸出模態:
多模态输出
Zhipu
glm-5.2
Zhipu AI
上下文1M
輸入價格
$0.9690/M$1.1400/M
輸出
$3.4000/M$4.0000/M
面向推理、程式碼和長上下文代理任務,相比 GLM-5.1 在上下文長度、工具調用和複雜多步驟任務上更進一步;對比 Qwen、DeepSeek、Kimi 等國產旗艦,它更適合中文企業自動化、專案級程式碼分析和知識工作流。
輸入模態:
輸出模態:
深度思考工具调用函数调用结构化输出长上下文
MoonshotAI
kimi-k2.7-code
Moonshot
上下文256K
輸入價格
$0.8775/M$0.9750/M
輸出
$3.6450/M$4.0500/M
面向長上下文、多步驟工具呼叫和程式碼/文件工作流程,相較於 Kimi K2.6 更強調工程任務穩定性和上下文承載能力;對比 Qwen、GLM、DeepSeek,它更適合中文長文件分析、專案問答和日常智能程式設計。
輸入模態:
輸出模態:
工具调用函数调用结构化输出长上下文
Grok
grok-imagine-video-1-5-preview
xAI
按秒$0.1400/s
以影像/視訊為導向的生成、編輯和延展,相較於 Grok Imagine 1.0 更強調運動一致性和快速社交內容產出;對比 Veo、Kling、Runway,它更適合 xAI 生態裡的短影片、廣告創意和即時趨勢素材。
輸入模態:
輸出模態:
多模态输出
Minimax
MiniMax-M3
MiniMax
上下文1M
輸入價格$1.2600/M
輸出$5.0400/M
以長週期編碼、工具使用和多輪生產協作,相較於 MiniMax M2.7 進一步擴展到多模態輸入並保留 100 萬 token 上下文;對比 Claude、Gemini、GLM-5.2 等長上下文代理模型,它更適合將文字、圖像、視訊資料放入同一工作流程。
輸入模態:
輸出模態:
深度思考工具调用函数调用结构化输出长上下文
Claude
claude-opus-4-8
Anthropic
上下文1M
輸入價格
$1.7000/M$5.0000/M
輸出
$8.5000/M$25.0000/M
面向旗艦推理與複雜代理任務,相比 Claude Opus 4.7 在長上下文、程式碼、工具使用和複雜規劃上更進一步;對比 GPT、Gemini、Qwen 等旗艦模型,它更適合高可靠代理、程式碼庫維護和深度研究工作流程。
輸入模態:
輸出模態:
深度思考工具调用结构化输出长上下文
Gemini
gemini-omni-video
Google
按秒$0.2450/s
面向任意輸入到視訊的多模態創作,相較於 Gemini 早期視訊能力更強調文字、影像、音訊和視訊資料的統一編排;對比 Veo、Kling、Runway,它更適合將複雜多模態素材整合進同一創意工作流程。
輸入模態:
輸出模態:
多模态输出
Gemini
gemini-3.5-flash
Google
上下文1M
輸入價格$1.5000/M
輸出$9.0000/M
面向多模態理解、程式碼和長上下文任務,相較於 Gemini 3.1 在吞吐、上下文和工具能力上更進一步;對比 GPT、Claude、Qwen 等模型,它更適合把文字、圖像、音訊、視訊和文件放進統一分析工作流程。
輸入模態:
輸出模態:
深度思考联网搜索工具调用函数调用结构化输出长上下文代码执行
Qwen
qwen3.7-max
Qwen
上下文1M
輸入價格
$1.4400/M$1.8000/M
輸出
$4.3200/M$5.4000/M
面向代理式工作負載、程式碼和辦公室生產力,相較於 Qwen3.6 更強調長上下文、工具呼叫和結構化輸出的穩定組合;對比 GPT、Claude、Gemini 等旗艦模型,它更適合作為中文、程式碼和多步驟工具任務裡的高性價比替代。
輸入模態:
輸出模態:
深度思考工具调用函数调用结构化输出长上下文
Qwen
qwen3.6-max-preview
Qwen
上下文262K
輸入價格$1.3300/M
輸出$8.0000/M
阿里通義千問 3.6 Max 預覽版,約 1 兆參數的稀疏混合專家模型。針對智能體程式設計、工具呼叫和長上下文推理深度優化,內建思考模式可在多輪對話中保持推理連貫性。 262K 上下文窗口,僅透過阿里雲模型服務 API 提供。
輸入模態:
輸出模態:
深度思考工具调用结构化输出长上下文
Qwen
happyhorse-1.0-video-edit
Qwen
上下文8K
按秒$0.1350/s
面向視訊編輯,相較於 早期視訊模型 更突出音訊原生生成,一次完成對白、音效和背景音樂;對比 Veo、Kling、Runway,它的差異化優勢在聲畫同步和角色一致性工作流程。適合短劇、廣告、電商和品牌行銷影片。
輸入模態:
輸出模態:
Qwen
happyhorse-1.0-t2v
Qwen
上下文8K
按秒$0.1350/s
面向文生視頻,相比 早期視頻模型 更突出音頻原生生成,一次完成對白、音效和背景音樂;對比 Veo、Kling、Runway,它的差異化優勢在聲畫同步和角色一致性工作流。適合短劇、廣告、電商和品牌行銷影片。
輸入模態:
輸出模態:
Qwen
happyhorse-1.0-r2v
Qwen
上下文8K
按秒$0.1350/s
面向參考生成視頻,相比 早期視頻模型 更突出音頻原生生成,一次完成對白、音效和背景音樂;對比 Veo、Kling、Runway,它的差異化優勢在聲畫同步和角色一致性工作流。適合短劇、廣告、電商和品牌行銷影片。
輸入模態:
輸出模態:
Qwen
happyhorse-1.0-i2v
Qwen
上下文8K
按秒$0.1350/s
面向圖生視頻,相比 早期視頻模型 更突出音頻原生生成,一次完成對白、音效和背景音樂;對比 Veo、Kling、Runway,它的差異化優勢在聲畫同步和角色一致性工作流。適合短劇、廣告、電商和品牌行銷影片。
輸入模態:
輸出模態:
DeepSeek
deepseek-v4-pro
DeepSeek
上下文1M
輸入價格
$1.5390/M$1.7100/M
輸出
$3.0869/M$3.4299/M
面向推理、程式碼和智能體工具使用,相比 DeepSeek V3.2 更強調長上下文、思考模式和複雜任務執行;對比 Qwen、GLM、Kimi 等國產模型,它在數學、程式設計和邏輯推理場景中更具競爭力,適合嚴肅程式碼與分析任務。
輸入模態:
輸出模態:
长上下文工具调用深度思考结构化输出
DeepSeek
deepseek-v4-flash
DeepSeek
上下文1M
輸入價格
$0.1278/M$0.1420/M
輸出
$0.2574/M$0.2860/M
面向推理、程式碼和智能體工具使用,相比 DeepSeek V3.2 更強調長上下文、思考模式和複雜任務執行;對比 Qwen、GLM、Kimi 等國產模型,它在數學、程式設計和邏輯推理場景中更具競爭力,適合嚴肅程式碼與分析任務。
輸入模態:
輸出模態:
长上下文工具调用深度思考结构化输出
OpenAI
gpt-5.5
OpenAI
上下文1M
輸入價格
$1.0000/M$5.0000/M
輸出
$6.0000/M$30.0000/M
面向推理、程式碼、視覺理解和智能體任務,相比 GPT-5.4 更強調長上下文、工具調用和規模化穩定輸出;對比 Claude、Gemini、Qwen 等旗艦模型,它更適合作為通用高可靠自動化和複雜知識工作流程底座。
輸入模態:
輸出模態:
XiaomiMiMo
mimo-v2.5-tts-voicedesign
Xiaomi MiMo
輸入價格$0.0000/M
輸出$0.0000/M
面向一句話音色設計和文字轉語音,相比 MiMo V2 TTS 更強調 V2.5 系列的自然語言音色創建、語速/情緒/語氣細粒度控制和低門檻聲音生產;對比 ElevenLabs、OpenAI TTS 和 Azure Speech,它更適合無需參考音頻的角色設計、廣告配音、短片旁白和多風格語音旁白。
輸入模態:
輸出模態:
多模态输出
XiaomiMiMo
mimo-v2.5-tts-voiceclone
Xiaomi MiMo
輸入價格$0.0000/M
輸出$0.0000/M
面向少量樣本聲音克隆,相比 MiMo V2 TTS 更強調 V2.5 系列的高保真音色復刻、音色特徵一致性和跨文本泛化穩定性;對比 ElevenLabs、OpenAI TTS 和 Azure Speech,它更適合中文角色配音、短視頻旁白、播客復刻和需要保留目標音色的多語言語音生產。
輸入模態:
輸出模態:
多模态输出
XiaomiMiMo
mimo-v2.5-tts
Xiaomi MiMo
輸入價格$0.0000/M
輸出$0.0000/M
以文字轉語音、Voice Design 和聲音克隆,相較於 MiMo V2 TTS 更強調 V2.5 系列的自然語音合成、細粒度語速/情緒/音調控制和低門檻音色創建;對比 ElevenLabs、OpenAI TTS 和 Azure Speech,它更適合中文音訊旁白、角色配音、短視訊音訊和多語言語音生產。
輸入模態:
輸出模態:
多模态输出
OpenAI
gpt-image-2-text-to-image
OpenAI
上下文128K
按張$0.0300/image
這是特價體驗線路,生成等待時間較長,大概有 10% 的機率生成失敗。適合對成本敏感、可以接受排隊和偶發失敗的圖片生成體驗;如需更穩定的生產使用,建議選擇常規線路。
輸入模態:
輸出模態:
多模态输出
OpenAI
gpt-image-2-image-to-image
OpenAI
上下文128K
按張$0.0200/image
這是特價體驗線路,生成等待時間較長,大概有 10% 的機率生成失敗。適合對成本敏感、可以接受排隊和偶發失敗的圖片生成體驗;如需更穩定的生產使用,建議選擇常規線路。
輸入模態:
輸出模態:
多模态输出
OpenAI
gpt-image-2
OpenAI
上下文128K
按張$0.0670/image
面向高品質影像生成與編輯,相較於 GPT Image 1.x 在文字渲染、局部編輯和多輪一致性上更進一步;對比 Gemini 影像模型、Qwen Image 和 Seedream,它更適合品牌視覺、廣告設計、產品圖和需要精細控制的創意工作流程。
輸入模態:
輸出模態:
多模态输出
MoonshotAI
kimi-k2.6
Moonshot
輸入價格
$0.8370/M$0.9300/M
輸出
$3.4740/M$3.8600/M
面向長上下文、多步驟工具呼叫和程式碼/文件工作流程,比較 Kimi K2.5 更強調工程任務穩定性和情境承載能力;對比 Qwen、GLM、DeepSeek,它更適合中文長文件分析、專案問答和日常智能程式設計。
輸入模態:
輸出模態:
工具调用深度思考
Claude
claude-opus-4-7
Anthropic
上下文1M
輸入價格
$1.7000/M$5.0000/M
輸出
$8.5000/M$25.0000/M
面向旗艦推理與複雜代理任務,相比 Claude Opus 4.6 在長上下文、程式碼、工具使用和複雜規劃上更進一步;對比 GPT、Gemini、Qwen 等旗艦模型,它更適合高可靠代理、程式碼庫維護和深度研究工作流程。
輸入模態:
輸出模態:
深度思考联网搜索工具调用函数调用结构化输出长上下文代码执行
Minimax
MiniMax-M2.7-highspeed
MiniMax
上下文200K
輸入價格$0.6300/M
輸出$2.5200/M
面向文本生成、推理和工具調用,相比 MiniMax M2.x 早期版本更強調 200K 長上下文和代理式工作流程穩定性;對比 Kimi、GLM、Qwen 等同類中文模型,它適合辦公室、程式碼輔助和長文檔處理。
輸入模態:
輸出模態:
深度思考
Minimax
MiniMax-M2.7
MiniMax
上下文200K
輸入價格$0.3150/M
輸出$1.2600/M
面向文本生成、推理和工具調用,相比 MiniMax M2.x 早期版本更強調 200K 長上下文和代理式工作流程穩定性;對比 Kimi、GLM、Qwen 等同類中文模型,它適合辦公室、程式碼輔助和長文檔處理。
輸入模態:
輸出模態:
深度思考
OpenAI
gpt-5.4-mini
OpenAI
上下文400K
輸入價格
$0.1500/M$0.7500/M
輸出
$0.9000/M$4.5000/M
面向推理、程式碼、視覺理解和智能體任務,相比 GPT-5.3 更強調長上下文、工具調用和規模化穩定輸出;對比 Claude、Gemini、Qwen 等旗艦模型,它更適合作為通用高可靠自動化和複雜知識工作流程底座。
輸入模態:
輸出模態:
长上下文工具调用深度思考结构化输出
OpenAI
gpt-5.4
OpenAI
上下文1.05M
輸入價格
$0.5000/M$2.5000/M
輸出
$3.0000/M$15.0000/M
面向推理、程式碼、視覺理解和智能體任務,相比 GPT-5.3 更強調長上下文、工具調用和規模化穩定輸出;對比 Claude、Gemini、Qwen 等旗艦模型,它更適合作為通用高可靠自動化和複雜知識工作流程底座。
輸入模態:
輸出模態:
长上下文工具调用深度思考结构化输出
Gemini
gemini-3.1-flash-image-preview
Google
上下文131K
按張$0.0672/image
以影像產生與編輯,相較於 Gemini 早期影像能力更強調多模態理解、對話式修改和快速視覺原型;對比 GPT Image、Qwen Image 和 Seedream,它更適合把文件、圖片和提示詞合併到同一視覺工作流程中。
輸入模態:
輸出模態:
深度思考多模态输出
Gemini
gemini-3.1-pro-preview
Google
上下文1.05M
輸入價格$2.0000/M
輸出$12.0000/M
面向多模態理解、程式碼和長上下文任務,相較於 Gemini 3.0 / 2.5 在吞吐、上下文和工具能力上更進一步;對比 GPT、Claude、Qwen 等模型,它更適合把文字、圖像、音訊、視訊和文件放進統一分析工作流程。
輸入模態:
輸出模態:
长上下文
Claude
claude-sonnet-4-6-thinking
Anthropic
上下文1M
輸入價格$3.0000/M
輸出$15.0000/M
Anthropic Claude Sonnet 4.6 的擴展思考變體,啟用鍊式推理以解決複雜問題。在程式設計、程式碼庫導航、專案管理、文件創作和智能體任務方面表現出色,支援文字和圖像輸入。 1M 情境窗口,相較於標準版在需要深度推理的場景中表現更優,適合複雜軟體工程和多步驟規劃任務。
輸入模態:
輸出模態:
深度思考工具调用结构化输出长上下文
Claude
claude-sonnet-4-6
Anthropic
上下文1M
輸入價格
$1.0200/M$3.0000/M
輸出
$5.1000/M$15.0000/M
面向高效編碼與代理任務,相比 Claude 4.5/4.6 前序版本 在長上下文、程式碼、工具使用和複雜規劃上更進一步;對比 GPT、Gemini、Qwen 等旗艦模型,它更適合高可靠代理、程式碼庫維護和深度研究工作流程。
輸入模態:
輸出模態:
深度思考联网搜索工具调用函数调用结构化输出长上下文代码执行
Minimax
MiniMax-M2.5
MiniMax
上下文205K
輸入價格$0.3020/M
輸出$1.2077/M
面向真實生產力智能體的高性價比模型,強項在程式碼、工具呼叫、搜尋和辦公室交付,而不只是聊天。它適合讓代理商規劃並執行跨文件修改、研究檢索、文件/表格/演示類任務;相比更貴的旗艦模型,核心取捨是用更低成本換取接近前沿的執行效率。
輸入模態:
輸出模態:
深度思考工具调用函数调用结构化输出长上下文
Doubao
doubao-seedance-2-0-filter-off
Doubao
上下文13K
輸入價格$3.1500/M
輸出$3.1500/M
面向視訊生成和多素材視訊創作,相較於 Seedance 1.x 在運動穩定性、音訊視訊聯合生成和參考輸入上更完整;對比 Veo、Kling、Runway,它更適合需要文字、影像、音訊、視訊混音驅動的中文創意工作流程。該 filter-off 版本相比普通 Seedance 2.0 保持同檔生成能力,但內容過濾更寬鬆;適合短劇、廣告、電商和社交素材。
輸入模態:
輸出模態:
多模态输出
Doubao
doubao-seedance-2-0-fast-filter-off
Doubao
上下文13K
輸入價格$2.5200/M
輸出$2.5200/M
面向視訊生成和多素材視訊創作,相較於 Seedance 1.x 在運動穩定性、音訊視訊聯合生成和參考輸入上更完整;對比 Veo、Kling、Runway,它更適合需要文字、影像、音訊、視訊混音驅動的中文創意工作流程。該 filter-off 版本相比普通 Seedance 2.0 保持同檔生成能力,但內容過濾更寬鬆;適合短劇、廣告、電商和社交素材。
輸入模態:
輸出模態:
多模态输出
Claude
claude-opus-4-6
Anthropic
上下文1M
輸入價格
$1.7000/M$5.0000/M
輸出
$8.5000/M$25.0000/M
面向旗艦推理與複雜代理任務,相比 Claude 4.5/4.6 前序版本 在長上下文、程式碼、工具使用和複雜規劃上更進一步;對比 GPT、Gemini、Qwen 等旗艦模型,它更適合高可靠代理、程式碼庫維護和深度研究工作流程。
輸入模態:
輸出模態:
深度思考联网搜索工具调用函数调用结构化输出长上下文代码执行
Kling
kling-v3-omni
kling
按秒$0.0900/s
以文字/影像為導向影片和多鏡頭創作,相較於 Kling 2.x 在運動穩定性、鏡頭語言和參考圖一致性上更進一步;對比 Veo、Runway、Seedance,它更適合中文短劇、廣告素材和高品質社群影片生產。
輸入模態:
輸出模態:
多模态输出
Kling
kling-v3
kling
按秒$0.0900/s
以文字/影像為導向影片和多鏡頭創作,相較於 Kling 2.x 在運動穩定性、鏡頭語言和參考圖一致性上更進一步;對比 Veo、Runway、Seedance,它更適合中文短劇、廣告素材和高品質社群影片生產。
輸入模態:
輸出模態:
多模态输出
Doubao
doubao-seedream-5.0-lite
Doubao
按張$0.0350/image
影像生成與編輯,相較於 Seedream 4.x 更強調中文指令理解、視覺推理和高頻創意產出;對比 GPT Image、Gemini 圖像模型和 Qwen Image,它更適合字節生態內的廣告設計、電器素材和多場景視覺生產。
輸入模態:
輸出模態:
联网搜索多模态输出
Doubao
doubao-seedance-2-0-fast
Doubao
上下文8K
輸入價格$2.4192/M
輸出$2.4192/M
面向視訊生成和多素材視訊創作,相較於 Seedance 1.x 在運動穩定性、音訊視訊聯合生成和參考輸入上更完整;對比 Veo、Kling、Runway,它更適合需要文字、影像、音訊、視訊混音驅動的中文創意工作流程。高速版本相比標準檔更適合快速迭代和大量產出;適合短劇、廣告、電商和社群素材。
輸入模態:
輸出模態:
Doubao
doubao-seedance-2-0
Doubao
上下文8K
輸入價格
$2.5927/M$2.7292/M
輸出
$2.5927/M$2.7292/M
面向視訊生成和多素材視訊創作,相較於 Seedance 1.x 在運動穩定性、音訊視訊聯合生成和參考輸入上更完整;對比 Veo、Kling、Runway,它更適合需要文字、影像、音訊、視訊混音驅動的中文創意工作流程。適合短劇、廣告、電商和社群素材。
輸入模態:
輸出模態:
MoonshotAI
kimi-k2.5
Moonshot
上下文256K
輸入價格
$0.5400/M$0.6000/M
輸出
$2.8350/M$3.1500/M
面向長上下文、多步驟工具呼叫和程式碼/文件工作流程,相較於 Kimi K2 更強調工程任務穩定性和上下文承載能力;對比 Qwen、GLM、DeepSeek,它更適合中文長文件分析、專案問答和日常智能程式設計。
輸入模態:
輸出模態:
长上下文工具调用深度思考
Gemini
gemini-3-flash-preview
Google
上下文1M
輸入價格$0.5000/M
輸出$3.0000/M
Google 高速推理模型,專為 Agent 工作流程、多輪對話和程式碼輔助而設計。支援文字、圖像、音訊、視訊和 PDF 輸入,100 萬 token 上下文視窗。支援可配置推理等級、工具呼叫和結構化輸出。比前代 Gemini 2.5 Flash 在推理、多模態理解和可靠性方面全面提升。
輸入模態:
輸出模態:
深度思考工具调用函数调用结构化输出长上下文
DeepSeek
DeepSeek-V3.2-Thinking
DeepSeek
上下文128K
輸入價格$0.3100/M
輸出$0.4700/M
面向推理、程式碼和智能體工具使用,相比 DeepSeek V3.1 更強調長上下文、思考模式和複雜任務執行;對比 Qwen、GLM、Kimi 等國產模型,它在數學、程式設計和邏輯推理場景中更具競爭力,適合嚴肅程式碼與分析任務。
輸入模態:
輸出模態:
长上下文工具调用深度思考结构化输出
Gemini
gemini-3-pro-image-preview
Google
上下文66K
按張$0.1340/image
以影像產生與編輯,相較於 Gemini 早期影像能力更強調多模態理解、對話式修改和快速視覺原型;對比 GPT Image、Qwen Image 和 Seedream,它更適合把文件、圖片和提示詞合併到同一視覺工作流程中。
輸入模態:
輸出模態:
深度思考多模态输出
Claude
claude-opus-4-5
Anthropic
上下文200K
輸入價格$5.0000/M
輸出$25.0000/M
面向旗艦推理與複雜代理任務,相比 Claude 4 系列前序版本 在長上下文、程式碼、工具使用和複雜規劃上更進一步;對比 GPT、Gemini、Qwen 等旗艦模型,它更適合高可靠代理、程式碼庫維護和深度研究工作流程。
輸入模態:
輸出模態:
深度思考工具调用结构化输出长上下文
Gemini
veo3.1-lite
Google
按次$0.1100/call
面向高保真視訊生成,相比 Veo 2/3 在原生音訊、鏡頭控制和參考輸入工作流程上更成熟;對比 Kling、Runway、Seedance,它更適合電影感短片、廣告分鏡和需要穩定物理運動的視訊創作。 Lite 檔相較標準檔更偏向高吞吐和低成本草稿。
輸入模態:
輸出模態:
多模态输出
Gemini
veo3.1-fast
Google
按次$0.2211/call
面向高保真視訊生成,相比 Veo 2/3 在原生音訊、鏡頭控制和參考輸入工作流程上更成熟;對比 Kling、Runway、Seedance,它更適合電影感短片、廣告分鏡和需要穩定物理運動的視訊創作。 Fast 檔相較標準檔較適合快速概念驗證。
輸入模態:
輸出模態:
多模态输出
Gemini
veo3.1
Google
按次$1.6544/call
面向高保真視訊生成,相比 Veo 2/3 在原生音訊、鏡頭控制和參考輸入工作流程上更成熟;對比 Kling、Runway、Seedance,它更適合電影感短片、廣告分鏡和需要穩定物理運動的視訊創作。
輸入模態:
輸出模態:
多模态输出
Gemini
gemini-2.5-flash-image
Google
上下文66K
按張$0.0585/image
以影像產生與編輯,相較於 Gemini 早期影像能力更強調多模態理解、對話式修改和快速視覺原型;對比 GPT Image、Qwen Image 和 Seedream,它更適合把文件、圖片和提示詞合併到同一視覺工作流程中。
輸入模態:
輸出模態:
结构化输出多模态输出
Claude
claude-haiku-4-5
Anthropic
上下文200K
輸入價格
$0.3400/M$1.0000/M
輸出
$1.7000/M$5.0000/M
面向高效編碼與代理任務,相比 Claude Haiku 3.5 在長上下文、程式碼、工具使用和複雜規劃上更進一步;對比 GPT、Gemini、Qwen 等旗艦模型,它更適合高可靠代理、程式碼庫維護和深度研究工作流程。
輸入模態:
輸出模態:
深度思考工具调用结构化输出长上下文
Gemini
gemini-3.6-flash
Google
輸入價格$1.5000/M
輸出$7.5000/M
Gemini
gemini-3.5-flash-lite
Google
輸入價格$0.3000/M
輸出$2.5000/M
Gemini
gemini-3.1-flash-lite-image
Google
按次
$0.0120/call$0.0200/call
Gemini
gemini-3.1-flash-image
Google
按張
$0.0198/image$0.0330/image
Gemini
gemini-3-pro-image
Google
按張
$0.0318/image$0.0530/image
Claude
claude-opus-5
Anthropic
輸入價格
$1.7000/M$5.0000/M
輸出
$8.5000/M$25.0000/M
Claude
claude-opus-4-7-thinking
Anthropic
上下文1M
輸入價格$5.0000/M
輸出$25.0000/M
面向旗艦推理與複雜代理任務,相比 Claude Opus 4.6 在長上下文、程式碼、工具使用和複雜規劃上更進一步;對比 GPT、Gemini、Qwen 等旗艦模型,它更適合高可靠代理、程式碼庫維護和深度研究工作流程。
輸入模態:
輸出模態:
深度思考工具调用结构化输出长上下文
Doubao
doubao-seedream-5-0-pro
Doubao
按秒$0.0450/s
專業視覺創作的多模態影像產生模型,支援從文字產生影像,並結合參考圖和空間標註進行精準編輯;擅長高密度資訊圖、文字排版、真實光影與多語言圖文生成。
輸入模態:
輸出模態:
深度思考多模态输出
Doubao
doubao-seedance-2.5
Doubao
輸入價格
$3.4200/M$3.6000/M
輸出
$3.4200/M$3.6000/M
以廣告、品牌內容及敘事短片等專業影片創作,重點在於解決長鏡頭、多素材約束與重複精修:支援文字/影像產生及 R2V 參考控制,可組合多模態素材,標準模式最長 30 秒,並能局部修改畫面而不整段重生成。相較於 Seedance 2.0,選擇它的主要理由是更長的連續鏡頭、更豐富的參考輸入,以及更可控的後期修正。
Doubao
doubao-seed-2-0-pro
Doubao
上下文256K
輸入價格$0.5000/M
輸出$2.5300/M
程式碼、代理程式和複雜生產力任務,相比 Doubao Seed 2.0 在長上下文、長輸出和工具任務上更進一步;對比 Qwen、GLM、DeepSeek 等同類國產旗艦,它適合作為中文辦公室、程式碼和多步驟自動化場景的高性價比選擇。
輸入模態:
輸出模態:
深度思考联网搜索工具调用函数调用结构化输出长上下文
Qwen
qwen3.7-plus
Qwen
上下文1M
輸入價格
$0.2400/M$0.3000/M
輸出
$0.9600/M$1.2000/M
面向代理式工作負載、程式碼和辦公室生產力,相較於 Qwen3.6 更強調長上下文、工具呼叫和結構化輸出的穩定組合;對比 GPT、Claude、Gemini 等旗艦模型,它更適合作為中文、程式碼和多步驟工具任務裡的高性價比替代。
輸入模態:
輸出模態:
深度思考工具调用函数调用结构化输出长上下文
Qwen
qwen3.6-plus
Qwen
上下文1M
輸入價格
$0.9120/M$1.1400/M
輸出
$5.4880/M$6.8599/M
面向代理式工作負載、程式碼和辦公室生產力,相較於 Qwen3.5 更強調長上下文、工具呼叫和結構化輸出的穩定組合;對比 GPT、Claude、Gemini 等旗艦模型,它更適合作為中文、程式碼和多步驟工具任務裡的高性價比替代。
輸入模態:
輸出模態:
深度思考工具调用结构化输出长上下文
Qwen
qwen3.6-flash
Qwen
上下文1M
輸入價格$0.1785/M
輸出$1.0605/M
面向代理式工作負載、程式碼和辦公室生產力,相較於 Qwen3.5 更強調長上下文、工具呼叫和結構化輸出的穩定組合;對比 GPT、Claude、Gemini 等旗艦模型,它更適合作為中文、程式碼和多步驟工具任務裡的高性價比替代。
輸入模態:
輸出模態:
深度思考工具调用结构化输出长上下文
Qwen
qwen-image-2.0-pro
Qwen
輸入價格$2.2000/M
輸出$2.2000/M
影像生成與編輯,相較於 Qwen Image 1.x 在中文文字渲染、指令遵循和複雜版式上更進一步;對比 GPT Image、Gemini 圖像模型和 Seedream,它更適合中文海報、電商圖、資訊圖和多輪視覺創作。
輸入模態:
輸出模態:
多模态输出
Qwen
qwen-image-2.0
Qwen
輸入價格$2.2000/M
輸出$2.2000/M
影像生成與編輯,相較於 Qwen Image 1.x 在中文文字渲染、指令遵循和複雜版式上更進一步;對比 GPT Image、Gemini 圖像模型和 Seedream,它更適合中文海報、電商圖、資訊圖和多輪視覺創作。
輸入模態:
輸出模態:
多模态输出
Minimax
MiniMax-H3
MiniMax
按秒$0.0800/s
XiaomiMiMo
mimo-v2.5-pro
Xiaomi MiMo
上下文1M
輸入價格$1.1700/M
輸出$3.5000/M
面向代理、程式碼和長上下文任務,相比 MiMo V2 在多模態理解、百萬級上下文和長程推理上更完整;對比 Qwen、GLM、DeepSeek 等國產模型,它的優勢在小米生態適配和工程自動化場景。
輸入模態:
輸出模態:
深度思考工具调用结构化输出长上下文
XiaomiMiMo
mimo-v2.5
Xiaomi MiMo
上下文1M
輸入價格$0.4700/M
輸出$2.3600/M
面向代理、程式碼和長上下文任務,相比 MiMo V2 在多模態理解、百萬級上下文和長程推理上更完整;對比 Qwen、GLM、DeepSeek 等國產模型,它的優勢在小米生態適配和工程自動化場景。
輸入模態:
輸出模態:
深度思考工具调用结构化输出长上下文
MoonshotAI
kimi-k2.7-code-highspeed
Moonshot
上下文256K
輸入價格$1.9000/M
輸出$7.9999/M
面向長上下文、多步驟工具呼叫和程式碼/文件工作流程,相較於 Kimi K2.6 更強調工程任務穩定性和上下文承載能力;對比 Qwen、GLM、DeepSeek,它更適合中文長文件分析、專案問答和日常智能程式設計。
輸入模態:
輸出模態:
工具调用函数调用结构化输出长上下文
Grok
grok-4.3
xAI
上下文1M
輸入價格$1.3100/M
輸出$2.6200/M
面向即時推理、程式碼和長上下文任務,相比 Grok 4.x 早期版本更強調長上下文和快速響應;對比 GPT、Claude、Gemini,它更適合 xAI 生態裡的趨勢分析、程式碼輔助和聯網資訊工作流程。
輸入模態:
輸出模態:
深度思考工具调用结构化输出长上下文
Zhipu
glm-image
Zhipu AI
輸入價格$0.8800/M
輸出$3.5500/M
以影像產生與編輯,相較於早期 GLM 視覺能力更專注於中文提示詞、圖文理解和可控生成;對比 GPT Image、Gemini 圖像模型和 Qwen Image,它更適合中文行銷素材、知識圖解和多輪視覺修改。
輸入模態:
輸出模態:
多模态输出
Doubao
dreamina-seedance-2-0-mini
Doubao
輸入價格$75.0000/M
輸出$75.0000/M
Seedance 2.0 的輕量影片創作檔位,適合把文字或參考圖快速轉成短影片素材,用於社媒、電商與創意草稿。它更偏向高頻試錯和素材產出;對最終成片仍應關注動作、鏡頭和主體一致性,並進行人工篩選。
輸入模態:
輸出模態:
多模态输出
DeepSeek
deepseek-v4-flash-vision-exp
DeepSeek
輸入價格$0.1490/M
輸出$0.2980/M
An experimental multimodal variant of DeepSeek-V4-Flash for image understanding alongside text. A practical choice for visual Q&A, screenshot and document analysis, while its experimental status makes it better suited to evaluation and flexible workflows than strict production-critical paths.
DeepSeek
deepseek-v3.2
DeepSeek
輸入價格$0.2100/M
輸出$0.3200/M
面向推理、程式碼和智能體工具使用,相比 DeepSeek V3.1 更強調長上下文、思考模式和複雜任務執行;對比 Qwen、GLM、Kimi 等國產模型,它在數學、程式設計和邏輯推理場景中更具競爭力,適合嚴肅程式碼與分析任務。
輸入模態:
輸出模態:
深度思考工具调用
WhatsApp