標籤: 本地 LLM
-
為什麼 AI Agent 讓 GPU 需求暴增?以前不會、現在會的兩個原因
為什麼現在 GPU 需求爆成這樣、以前不會?不是硬體變快,是兩件事相乘:模型變大(以前 n…
-
別動不動就上 120B:用甜蜜點階梯找剛好夠用的最小模型
企業自動化選模型別無腦丟最大的 120B。用甜蜜點測試:定門檻、固定評測集,由小往大爬(3…
-
五層 AI 開發體系:SPEC、Harness、Agent 到正道腦與 A2A
把會失憶、沒紀律的 AI 實習生,改造成有規格、有工具、有記憶的團隊。用廚房比喻拆解 SP…
-
本地 Agent 踩坑實錄:Claude Code 接 Ollama 為何要換輕量 Harness
一台裝不了獨顯的筆電上跑本地 coding agent 的完整實錄:Claude Code…
-
GraphRAG vs RAG + A2A:後端工程師的請假流程 AI 實作
後端/DBA 視角,一個下午從不懂 RAG/LLM 到蓋出 HR 請假流程的 GraphR…
-
Claude Code 換腦記:雲端便宜但要未雨綢繆,5 萬內路徑
雲端 LLM 現在便宜,但 Anthropic 改價、限額、變心隨時可能發生。用 clau…
-
Claude Code 訂閱 6/15 拆分:一個 Max 用戶的 evidence-based 評估與本地化反轉
Anthropic 6/15 把訂閱拆兩半。一個 Max 用戶用 21 個 transcr…
-
腦子系統 7-prompt 驗證篇:routing 跟 sanitize 真的會做事嗎
本地 LLM 驗證 harness:12 條 prompt 跑 routing + san…
-
腦子系統小白指南:10 步驟從零做到完整 AI 工作流
前 9 篇是給做過的人看的。本篇給「沒做過、想做到那樣」的人:10 步驟從零到完整 AI …