跳到主要內容

MiMo Claw 正式上線:小米把 Agent 從模型能力推進到文件工作流

MiMo Claw 的重點不是又多一個聊天入口,而是小米把 MiMo-V2.5-Pro、OpenClaw、MCP 工具呼叫與金山辦公文件流程包在一起,嘗試把長任務 Agent 變成可訂閱、可續跑、可落地的雲端產品。

目錄+

小米 MiMo 在 2026 年 6 月 16 日宣布 MiMo Claw 正式上線。

這不是一個單純的模型新聞。更準確地說,MiMo Claw 是小米把 MiMo-V2.5-Pro、OpenClaw、MCP 工具呼叫、金山辦公文件流程和 TokenPlan 訂閱包在一起的一次產品化嘗試。

如果只看一句話:小米想把 Agent 從「會回答」推進到「能完成一份文件交付物」。

先看結論

這次發布有三個值得關注的點。

  1. 場景選得很實際。 它先切進 Word、Excel、PPT、PDF,而不是做一個泛用聊天助理。
  2. 競爭焦點變了。 官方強調長任務、工具呼叫、token 消耗和 4 小時免費 session,而不是只講模型分數。
  3. 要先當成官方聲明看。 63.8% Pass^3、40-60% token 節省都值得測,但不應直接推論成全面優於 Claude、Codex 或 Cline。

原始貼文很短,真正的資訊在開發者貼文與官方公告裡。

下面用產品拆解的角度看,而不是照著公告翻譯。

MiMo Claw 真正在包什麼

根據小米官方公告,MiMo Claw 是一個雲端 Claw 產品。底層模型是 MiMo-V2.5-Pro,Agent 層則針對 OpenClaw framework 做最佳化。

它主打的不是單次問答,而是長任務:

  • 支援 MCP 工具呼叫協議
  • 內建語義技能解析
  • 支援長上下文記憶排程
  • 官方宣稱單 session 可超過 1,000 次連續工具呼叫

換句話說,它要解決的不是「模型會不會寫一段話」,而是「Agent 能不能在一個任務裡持續讀檔、調工具、修改、保存,最後交出結果」。

Loading diagram...

這個包裝方式很務實。很多 Agent demo 看起來會操作瀏覽器、會產出文件,但進到日常工作後,真正的卡點通常是穩定性與格式保真。

MiMo Claw 把金山辦公接進來,等於先選了一個輸入輸出明確、使用頻率高、也有龐大中國使用者基礎的場景。

金山辦公整合是關鍵,不是附屬功能

官方公告提到,MiMo Claw 與 Kingsoft Office 合作,支援 Word、Excel、PPT、PDF,以及超過 95% 的主流文件格式。

流程上,它涵蓋三件事:

  • AI 生成
  • 高清線上預覽
  • 即時編輯,不需要跳轉第三方工具

這裡的產品策略很清楚:如果 Agent 只能停在聊天框,它的價值會被 prompt 品質、模型幻覺和使用者耐心限制住。

但如果它可以直接進入文件工作流,價值就會轉向「幫我完成一個可交付成果」。

對中國市場來說,金山辦公不是小插件,而是小米把 MiMo 從 developer playground 拉向辦公生產力場景的入口。

對 indie builder 和技術團隊來說,這裡也有參考價值。Agent 產品不一定要一開始就做成萬能助理,反而可以先選一個可驗收的垂直流程:

  • 簡報生成
  • 表格整理
  • 合約初稿
  • 報告校對
  • 資料轉 PDF

模型能力只是底座。真正讓人付費的是 workflow boundary。

63.8% Pass^3 與 40-60% token 節省,先當作官方聲明看

小米在公告中給了兩個核心數字。

指標官方說法比較健康的讀法
ClawEval Pass^363.8%適合先看作 MiMo 在自家 Agent stack 裡的長任務表現
token 消耗比同類產品低 40-60%要用自己的任務集重測,不能只看單一 benchmark

在 MiMo-V2.5-Pro 模型頁,小米也把 token efficiency 放在獨立段落,強調約 70K tokens per trajectory 的成本曲線。

這組數字值得關注,但不應該直接解讀成「已經全面優於 Claude 或 GPT」。

原因很簡單:Agent benchmark 很吃測試環境。工具怎麼接、任務怎麼分布、失敗後能不能恢復,都會大幅影響分數。

ClawEval 如果是 OpenClaw 生態內的標準評估,它很適合衡量 MiMo 在自家 Agent stack 裡的表現。但如果你要拿它替換現有 Claude Code、Codex、Cline 或內部自動化管線,還是要用自己的任務集重跑。

比較健康的讀法是:小米已經把競爭焦點從「模型分數」轉到「每個長任務要花多少 token、能不能跑完、失敗後能不能恢復」。

這個方向是對的。Agent 的真實成本往往不是單價,而是一次任務裡反覆讀上下文、調工具、修錯、重試的總消耗。

免費四小時與 TokenPlan:這是分發策略

MiMo Claw 這次也調整了使用門檻。

官方公告寫到:

  • 免費使用者的每日單次 session 時長從 1 小時延長到 4 小時
  • 核心功能對免費帳號開放
  • 重度使用者可以透過 TokenPlan 或 Claw 專屬入口訂閱
  • 小米列出的限時價格包含人民幣 14.9 元每月的入門優惠,以及人民幣 19.9 元每月、233.8 元每年的標準折扣

這一段很像「先讓使用者真的跑長任務,再用配額與穩定算力轉訂閱」。

如果 Agent 任務只能跑幾分鐘,使用者很難感受到它和聊天機器人的差異。4 小時 session 讓它有機會處理更完整的文件任務、資料整理或多步驟研究。

這也是雲端 Agent 產品常見的取捨:

形態優點代價
本地工具彈性高、可控性強環境配置與維護成本高
雲端產品可續跑、資源穩定、上手快比較封閉,也更依賴供應商策略

小米的訂閱頁也顯示 TokenPlan 不只服務 MiMo Claw,而是要覆蓋 OpenCode、OpenClaw、Claude Code 等主流 AI programming tool。也就是說,MiMo Claw 是一個產品入口,TokenPlan 才是更大的分發與消費層。

對開發者的判斷:先測三件事

如果你只是想試玩,MiMo Claw 的免費時長已經足夠跑一些文件任務。

但如果你想把它放進實際工作流,不要只看官方 benchmark。先測三件事。

1. 長任務穩定性

準備一個需要讀多份文件、產出簡報或報告、再根據回饋修改的任務。

重點不是看第一版寫得多漂亮,而是看它在 30 到 90 分鐘內會不會:

  • 丟失約束
  • 重複操作
  • 卡在工具錯誤
  • 忘記前面已經做過的修改

2. 文件格式邊界

選 Word、Excel、PPT、PDF 各一個真實樣本。最好挑格式複雜、表格多、需要保留版面的文件。

辦公 Agent 的價值很大一部分在格式保真,而不是文字生成。

3. token 與完成率

小米強調 40-60% token 節省,但你的任務是否真的省,取決於資料長度、工具調用次數和 retry 數量。

比較方式很簡單:用同一批任務對照你現有的 Claude Code、Codex 或 Cline pipeline,看兩件事。

  • 是否更便宜
  • 是否更穩定完成

結論

MiMo Claw 的重要性不在於它多會聊天,而在於小米把 Agent 產品該有的幾個層次放到同一個包裡:

  • 強模型
  • 長上下文
  • 工具協議
  • OpenClaw framework
  • 辦公文件場景
  • 雲端續跑
  • 訂閱配額

這不是最自由的 Agent 形態,但可能是更接近普通使用者日常工作的形態。

對中文技術讀者來說,真正值得學的是這個產品化順序:

  1. 先用模型能力打底
  2. 再用 framework 管住長任務
  3. 接著選一個高頻 workflow 做深
  4. 最後用配額和雲端服務承接重度使用

Agent 的下一輪競爭,未必只看誰的模型更聰明,而是看誰能把長任務變成穩定、便宜、可交付的工作流。

參考來源:Xiaomi MiMo Claw 官方公告、MiMo-V2.5-Pro 模型頁、TokenPlan 訂閱說明、TechNode 報導。