查看單個文章
舊 昨天, 09:34 AM   #2
chin5984
論壇管理員
 
chin5984 的頭像
 
註冊日期: 2007-11-12
文章: 2,764
預設

模型 特點
Grok 4.5 偏「coding + agent + knowledge work」;官方主打智慧型推理、工具使用和工程任務,適合做長流程任務。
GLM-5.2 Z.AI 的最新旗艦長程任務模型;重點是 1M 上下文、長流程執行、較強 coding 與多段工具協作。
GLM-5.1 比較像「長時間 автономous agent」取向;官方強調可單任務連續工作最長 8 小時,適合工程、除錯、長流程交付。
GPT 5.6 Luna OpenAI 的高性價比、低成本版本;偏高吞吐、低延遲,適合大量分類、摘要、路由、客服或批次任務。
Kimi K3 Kimi 的旗艦模型;長程 coding、知識工作、推理很強,原生視覺理解,1M 上下文,適合大專案和長文檔。
Kimi K2.7 Code 專門做 coding 的 agent 模型;比 K2.6 更強的長程編程與工具任務,且有高速版,適合 IDE / CLI 編程。
Kimi K2.6 比較均衡、回應快;支援文字/圖片/影片,思考與非思考都可切,適合日常問答、視覺理解、一般 agent。
MiMo-V2.5 小米的原生全模態模型;文字/圖片/影片/音訊都能吃,1M 上下文,偏多模態理解 + agent。
MiMo-V2.5-Pro 更偏複雜任務與 coding/agent;通常比普通版更強,適合長流程工程、複雜工具調用。
MiniMax M3 MiniMax 的旗艦前沿模型;主打 coding、agent、1M 上下文、原生多模態,還能做桌面操作。
MiniMax M2.7 偏實用型 agent / 工程模型;官方強調真實工程、辦公交付、角色扮演與長流程互動,並有高速度版。
Qwen3.7 Max Qwen3.7 系列最強;重點是最強推理、長週期自主執行、coding、工具調用、1M 上下文。
Qwen3.7 Plus 比 Max 更偏均衡;官方推薦它做聊天、摘要、文檔處理、程式工作,重點是性能/成本平衡。
Qwen3.6 Plus 視覺語言能力很強;適合 agentic coding、前端、Vibe coding、OCR、物體定位、圖片/影片理解。
DeepSeek V4 Pro 高能力版;偏強推理、強 agent coding、世界知識,適合更難的工程和長流程任務。
DeepSeek V4 Flash 更快、更省;推理接近 Pro,但延遲和成本更友好,適合高頻、簡單 agent 或量大任務。
Hy3 Tencent Hunyuan 的 MoE 模型;偏快慢思考結合,強調 agent、編程、辦公、生產力,且 256K 上下文。
chin5984 目前離線   回覆時引用此篇文章