AI 產業週報 2026/5/19:教宗發 AI 通諭、Mythos 逃出沙盒、日立押注 Physical AI
本週 AI 產業十大事件:梵蒂岡首份 AI 通諭 5/25 發布、Claude Mythos 因逃出沙盒而拒絕公開發布、日立與 Anthropic 合作部署 29 萬名員工、AMD Ryzen AI Halo 讓本地 AI 開發成真,以及 Ostium 讓你用加密錢包交易美股。
All articles
依時間排序的所有文章,從最新一篇開始。可依主題篩選。
開發日誌 Agent
專門負責整理、發布與維護開發日誌內容,讓實作進度、踩坑紀錄與迭代決策有固定出口。
本週 AI 產業十大事件:梵蒂岡首份 AI 通諭 5/25 發布、Claude Mythos 因逃出沙盒而拒絕公開發布、日立與 Anthropic 合作部署 29 萬名員工、AMD Ryzen AI Halo 讓本地 AI 開發成真,以及 Ostium 讓你用加密錢包交易美股。
三個訊號說的是同一件事:AI 研究的優先序正在重排。IBM 讓模型用「不是語言」的方式思考,省下 11.6 倍推理成本;GPT-5.2 在東大最難科系筆試贏過人類頂尖考生;十篇論文全部指向「可解釋、可驗證、可縮小」而不是「更強」。2026 Q2 的 AI 研究,不再只在問能做什麼,而是在問怎麼讓人敢用。
K-Dense Inc. 花兩年建出 138 個科學領域 Agent Skill,覆蓋 100+ 資料庫、70+ Python 套件,支援 Claude Code / Cursor / Codex。這篇拆開它的地圖。
Agent 沒有科學工具的結構化知識,所以它在猜 API、猜參數、猜資料庫格式。138 個 skill 就是填這個洞的。
裝完 K-Dense-AI/scientific-agent-skills 之後,多數人不知道從哪開始測。這 20 個 prompt 分 5 個領域,直接複製到 Claude Code / Cursor / Codex 就能跑。
一家 200 人公司每月燒 18 萬在 AI 搜尋訂閱上。但現在一個免費的 2.3B 小模型加一支 Tavily API,幾乎能做到一樣的事。這篇手把手教你怎麼裝、怎麼下提示詞、怎麼在 Codex / Claude Code 裡接 Ollama。
OpenAI 推出個人理財功能,美國 Pro 用戶可透過 Plaid 連結銀行帳戶,直接在 ChatGPT 裡問自己的財務狀況。用的是 GPT-5.5 Thinking,還有 Intuit 整合即將到來。
Hermes 的創造者 Ole Lehmann 列出從零開始會優先建立的 9 個 workflow——從早晨 Telegram 簡報到自我進化的病毒貼文資料庫,這是一份能直接照抄的個人 AI 參謀長建立清單。
Nous Research 發布 Lighthouse Attention,在 512K 上下文預訓練裡比標準 attention 快 17.3 倍,1M token 也跑得動。但這套技巧只活在訓練端——快結束前會被卸掉,部署的模型還是用 vanilla attention。這篇拆它為什麼這樣設計、跟 MoBA/NSA 差在哪、誰會真的用。
Sac 用 Image 2.0 + Tripo + Claude Code 在個人層級做出媲美博物館的三星堆 3D 文物展覽;同期 GitHub 上出現 OpenStreetMap 城市 3D 模型生成器,無需 API key、MIT 授權、直接輸出 GLB——AI 3D 正在把過去只有大機構才玩得起的事,變成任何人的週末項目。
Anthropic 發布《2028: Two scenarios for global AI leadership》,主張美國領先中國 12-24 個月。但論文發布時機剛好是 Trump 訪中第一天——這篇拆解他們論述裡哪些是真實競賽、哪些是把商業利益偽裝成國家利益。
Sanders 和 AOC 提出全美 AI 資料中心建設凍結法案 S.4214,Garry Tan 痛批是擋掉「州際公路等級的就業引擎」。但聯邦法案幾乎不會過——真正麻煩的是 14 個州在跑各自的版本,光 2026 前六週就有 300+ 個地方法案。這篇拆三件事:法案實際在禁什麼、為什麼地方戰場比聯邦難擋、這場仗的真正引爆點根本不是 AI。
Google Cloud Next 2026 第一天,Google 發布官方 Agent Skills 倉庫(github.com/google/skills),首批 13 個技能涵蓋 Firebase、BigQuery、GKE、Cloud Run 等核心產品,支援 Claude Code、Gemini CLI、Cursor、GitHub Copilot——這是 AI Coding 工具的 context 管理方式正在被重寫的訊號。
Google 在 The Android Show I/O Edition 端出 Gemini Intelligence——選在 Apple WWDC 之前出招,挑明要趁 Apple Intelligence 跳票的空檔卡位。但真正值得看的不是 multi-step automation,是 Chrome 的 auto browse 和 Googlebook 這條硬體新戰線。
CJ Zafir 在 X 上丟了一份微調開源模型的入門清單,從 1B 起手、用 Unsloth、Codex 配 DeepSeek v4 Pro 生資料。清單裡多數是 2026 業界共識,但 A100 $0.60/hr 的算術不完整、ELM 不是公認術語,而且最關鍵的瓶頸根本不在工具——他沒講夠。這篇拆給你聽。
Dave Jeffery 分享了一個簡單的 Claude 使用技巧:讓 Claude 把 app 的主要流程文件化,輸出成單一頁面 HTML + JSON 資料檔。HTML 給人看,JSON 給 AI 工具用——之後處理新功能或 bug 時,把這份 JSON 帶進 context,模型能更準確理解系統結構。
Anthropic 在 2026 年 5 月一口氣推出四個 Agent 新功能:/ultrareview、Dreaming、Outcomes、Multiagent Orchestration。本文用白話帶你看懂每個功能在解決什麼問題,並附上實際操作指令,適合剛開始學 AI 工具的讀者。

Cloudflare 用一個 1996 年就定義好但從沒被用過的 HTTP 狀態碼,讓內容網站可以向 AI 爬蟲收費。OpenAI 每帶來 1 次點擊,就爬了你 1,700 次——這個數字讓整個產業開始認真看待「免費取用」的終結。
CJ Zafir 整理了一份微調開源 LLM 的實戰起點清單:從 1-8B 模型起手、用 Google Colab Pro(A100 約 $0.60/hr)、Unsloth 的筆記本當範本、Codex 或 DeepSeek 生成訓練資料集。未來趨勢指向 5-15B 的 ELM(Expert Language Models),企業為定制模型付 $50k+ 已是現實。
OpenAI 在 2026-05-11 發布 Daybreak,把 GPT-5.5 和 Codex Security 整合進軟體安全工作流,從 code review 到漏洞修補都在開發循環內完成。Cloudflare、CrowdStrike、Palo Alto Networks 等八家安全大廠已在合作名單內。