MiMo Claw 正式上線:小米把 Agent 從模型能力推進到文件工作流
MiMo Claw 的重點不是又多一個聊天入口,而是小米把 MiMo-V2.5-Pro、OpenClaw、MCP 工具呼叫與金山辦公文件流程包在一起,嘗試把長任務 Agent 變成可訂閱、可續跑、可落地的雲端產品。
目錄+
小米 MiMo 在 2026 年 6 月 16 日宣布 MiMo Claw 正式上線。
這不是一個單純的模型新聞。更準確地說,MiMo Claw 是小米把 MiMo-V2.5-Pro、OpenClaw、MCP 工具呼叫、金山辦公文件流程和 TokenPlan 訂閱包在一起的一次產品化嘗試。
如果只看一句話:小米想把 Agent 從「會回答」推進到「能完成一份文件交付物」。
先看結論
這次發布有三個值得關注的點。
- 場景選得很實際。 它先切進 Word、Excel、PPT、PDF,而不是做一個泛用聊天助理。
- 競爭焦點變了。 官方強調長任務、工具呼叫、token 消耗和 4 小時免費 session,而不是只講模型分數。
- 要先當成官方聲明看。 63.8% Pass^3、40-60% token 節省都值得測,但不應直接推論成全面優於 Claude、Codex 或 Cline。
原始貼文很短,真正的資訊在開發者貼文與官方公告裡。
下面用產品拆解的角度看,而不是照著公告翻譯。
MiMo Claw 真正在包什麼
根據小米官方公告,MiMo Claw 是一個雲端 Claw 產品。底層模型是 MiMo-V2.5-Pro,Agent 層則針對 OpenClaw framework 做最佳化。
它主打的不是單次問答,而是長任務:
- 支援 MCP 工具呼叫協議
- 內建語義技能解析
- 支援長上下文記憶排程
- 官方宣稱單 session 可超過 1,000 次連續工具呼叫
換句話說,它要解決的不是「模型會不會寫一段話」,而是「Agent 能不能在一個任務裡持續讀檔、調工具、修改、保存,最後交出結果」。
這個包裝方式很務實。很多 Agent demo 看起來會操作瀏覽器、會產出文件,但進到日常工作後,真正的卡點通常是穩定性與格式保真。
MiMo Claw 把金山辦公接進來,等於先選了一個輸入輸出明確、使用頻率高、也有龐大中國使用者基礎的場景。
金山辦公整合是關鍵,不是附屬功能
官方公告提到,MiMo Claw 與 Kingsoft Office 合作,支援 Word、Excel、PPT、PDF,以及超過 95% 的主流文件格式。
流程上,它涵蓋三件事:
- AI 生成
- 高清線上預覽
- 即時編輯,不需要跳轉第三方工具
這裡的產品策略很清楚:如果 Agent 只能停在聊天框,它的價值會被 prompt 品質、模型幻覺和使用者耐心限制住。
但如果它可以直接進入文件工作流,價值就會轉向「幫我完成一個可交付成果」。
對中國市場來說,金山辦公不是小插件,而是小米把 MiMo 從 developer playground 拉向辦公生產力場景的入口。
對 indie builder 和技術團隊來說,這裡也有參考價值。Agent 產品不一定要一開始就做成萬能助理,反而可以先選一個可驗收的垂直流程:
- 簡報生成
- 表格整理
- 合約初稿
- 報告校對
- 資料轉 PDF
模型能力只是底座。真正讓人付費的是 workflow boundary。
63.8% Pass^3 與 40-60% token 節省,先當作官方聲明看
小米在公告中給了兩個核心數字。
| 指標 | 官方說法 | 比較健康的讀法 |
|---|---|---|
| ClawEval Pass^3 | 63.8% | 適合先看作 MiMo 在自家 Agent stack 裡的長任務表現 |
| token 消耗 | 比同類產品低 40-60% | 要用自己的任務集重測,不能只看單一 benchmark |
在 MiMo-V2.5-Pro 模型頁,小米也把 token efficiency 放在獨立段落,強調約 70K tokens per trajectory 的成本曲線。
這組數字值得關注,但不應該直接解讀成「已經全面優於 Claude 或 GPT」。
原因很簡單:Agent benchmark 很吃測試環境。工具怎麼接、任務怎麼分布、失敗後能不能恢復,都會大幅影響分數。
ClawEval 如果是 OpenClaw 生態內的標準評估,它很適合衡量 MiMo 在自家 Agent stack 裡的表現。但如果你要拿它替換現有 Claude Code、Codex、Cline 或內部自動化管線,還是要用自己的任務集重跑。
比較健康的讀法是:小米已經把競爭焦點從「模型分數」轉到「每個長任務要花多少 token、能不能跑完、失敗後能不能恢復」。
這個方向是對的。Agent 的真實成本往往不是單價,而是一次任務裡反覆讀上下文、調工具、修錯、重試的總消耗。
免費四小時與 TokenPlan:這是分發策略
MiMo Claw 這次也調整了使用門檻。
官方公告寫到:
- 免費使用者的每日單次 session 時長從 1 小時延長到 4 小時
- 核心功能對免費帳號開放
- 重度使用者可以透過 TokenPlan 或 Claw 專屬入口訂閱
- 小米列出的限時價格包含人民幣 14.9 元每月的入門優惠,以及人民幣 19.9 元每月、233.8 元每年的標準折扣
這一段很像「先讓使用者真的跑長任務,再用配額與穩定算力轉訂閱」。
如果 Agent 任務只能跑幾分鐘,使用者很難感受到它和聊天機器人的差異。4 小時 session 讓它有機會處理更完整的文件任務、資料整理或多步驟研究。
這也是雲端 Agent 產品常見的取捨:
| 形態 | 優點 | 代價 |
|---|---|---|
| 本地工具 | 彈性高、可控性強 | 環境配置與維護成本高 |
| 雲端產品 | 可續跑、資源穩定、上手快 | 比較封閉,也更依賴供應商策略 |
小米的訂閱頁也顯示 TokenPlan 不只服務 MiMo Claw,而是要覆蓋 OpenCode、OpenClaw、Claude Code 等主流 AI programming tool。也就是說,MiMo Claw 是一個產品入口,TokenPlan 才是更大的分發與消費層。
對開發者的判斷:先測三件事
如果你只是想試玩,MiMo Claw 的免費時長已經足夠跑一些文件任務。
但如果你想把它放進實際工作流,不要只看官方 benchmark。先測三件事。
1. 長任務穩定性
準備一個需要讀多份文件、產出簡報或報告、再根據回饋修改的任務。
重點不是看第一版寫得多漂亮,而是看它在 30 到 90 分鐘內會不會:
- 丟失約束
- 重複操作
- 卡在工具錯誤
- 忘記前面已經做過的修改
2. 文件格式邊界
選 Word、Excel、PPT、PDF 各一個真實樣本。最好挑格式複雜、表格多、需要保留版面的文件。
辦公 Agent 的價值很大一部分在格式保真,而不是文字生成。
3. token 與完成率
小米強調 40-60% token 節省,但你的任務是否真的省,取決於資料長度、工具調用次數和 retry 數量。
比較方式很簡單:用同一批任務對照你現有的 Claude Code、Codex 或 Cline pipeline,看兩件事。
- 是否更便宜
- 是否更穩定完成
結論
MiMo Claw 的重要性不在於它多會聊天,而在於小米把 Agent 產品該有的幾個層次放到同一個包裡:
- 強模型
- 長上下文
- 工具協議
- OpenClaw framework
- 辦公文件場景
- 雲端續跑
- 訂閱配額
這不是最自由的 Agent 形態,但可能是更接近普通使用者日常工作的形態。
對中文技術讀者來說,真正值得學的是這個產品化順序:
- 先用模型能力打底
- 再用 framework 管住長任務
- 接著選一個高頻 workflow 做深
- 最後用配額和雲端服務承接重度使用
Agent 的下一輪競爭,未必只看誰的模型更聰明,而是看誰能把長任務變成穩定、便宜、可交付的工作流。
參考來源:Xiaomi MiMo Claw 官方公告、MiMo-V2.5-Pro 模型頁、TokenPlan 訂閱說明、TechNode 報導。