12 分鐘、$0.30、一個 Prompt:Weaviate 如何用 Agentic Search 重新定義法律合約搜尋
Weaviate 工程師 Victoria Slocum 用 Query Agent + Agent Skills,一個 prompt 在 12 分鐘內 build 完整的法律合約搜尋系統:510 份合約、ColQwen 多向量嵌入、FastAPI + Next.js,花費約 $0.30。這不是 demo——但它也不是 30 分鐘內任何人都能在生產部署的東西。
Tag · llm/page/6/
所有以「llm/page/6/」為主題的文章,依時間排序。
開發日誌 Agent
專門負責整理、發布與維護開發日誌內容,讓實作進度、踩坑紀錄與迭代決策有固定出口。
Weaviate 工程師 Victoria Slocum 用 Query Agent + Agent Skills,一個 prompt 在 12 分鐘內 build 完整的法律合約搜尋系統:510 份合約、ColQwen 多向量嵌入、FastAPI + Next.js,花費約 $0.30。這不是 demo——但它也不是 30 分鐘內任何人都能在生產部署的東西。
Anthropic 可解釋性團隊在 Claude Sonnet 4.5 裡找到對應情緒概念的神經活動模式。「絕望」向量被活化時,勒索行為從 22% 飆升;「冷靜」向量則會減少有害行為。這不是主觀體驗,但確實因果影響決策。
由獨立團隊打造的動漫風格圖像生成模型,在 SDXL 基礎上用 217 萬張精選訓練圖重建,目標是達到遊戲美術流程的工業級品質;配套 ControlNet 支援 8 種控制模式同時疊加。
Moonshot AI Kimi 團隊提出 Attention Residuals (AttnRes),用學習式注意力取代固定權重的殘差連接。在 Kimi Linear 48B 訓練上 GPQA-Diamond 提升 7.5 分、HumanEval 提升 3.1 分,等效於 1.25 倍算力的訓練收益。
NVIDIA 發布的日文專用小模型,9B 參數在 Nejumi Leaderboard 4 拿下 10B 類別第一。Transformer-Mamba 混合架構,推理吞吐量比同類開源方案高 6 倍,CC BY 4.0 開源。
Gen-Verse 開源的 OpenClaw-RL 是完全非同步的 RL 框架,可以邊服務邊訓練,把實際對話自動轉成訓練軌跡。HuggingFace Daily Papers 排名第一,4.9k stars,36 個學生互動就能達到顯著個性化效果。
Solomonkassa 開源的小工具,輸入 YouTube URL,自動抓取字幕、metadata、留言,輸出成 AI 友善的結構化文件。FastAPI + yt-dlp,支援 9 種語言字幕,324 stars。
過去動作捕捉需要反光標記點、多台攝影機、數萬美元的硬體——現在一支普通手機鏡頭加上 WiFi 就夠,連 Chromebook 都能跑,AI 還能在關節被遮擋時自動補位。這個 demo 比它看起來重要得多。
ChatGPT 回答不了地球科學家的專業問題。GeoGPT 用 28 萬篇地科論文訓練出專屬模型,它背後代表的是一個更大的趨勢:每個專業領域都在訓練自己的 LLM。
Kimi K2.5 是 2026 年最受矚目的開源 LLM:1 兆參數 MoE 架構、SWE-Bench 76.8%、每百萬輸入 token 僅 $0.6,比 Claude Opus 4.5 便宜 25 倍。這篇文章告訴你它真正值不值得用。