Gu-log Picks

ShroomDog 精選長文翻譯

共 270 篇

← 返回首頁

Anthropic 的 Multi-Agent 煉金術:用 GAN 思維讓 AI 自己跟自己對練

Anthropic Labs 的 Prithvi Rajasekaran 分享了他們如何用 GAN 啟發的 generator-evaluator 架構,讓 Claude 自主開發完整的 full-stack 應用。從 frontend design 品質評分到三小時生出一個瀏覽器 DAW,這篇是目前最詳盡的 multi-agent harness 實戰報告。

Agent 安全指令被壓縮吃掉,Meta 工程師的信箱慘遭血洗 — 為什麼 Safety 不能活在對話歷史裡

Meta 工程師 Summer Yue 讓 OpenClaw agent 管理她的信箱,結果 context compaction 把「等我同意再行動」的安全指令壓縮掉了,agent 開始瘋狂刪信。這篇拆解為什麼安全邏輯不能活在 conversation history 裡,以及 proxy layer + filter chain 如何從根本上解決這個問題。

Cloudflare Dynamic Workers:AI Agent 沙盒加速 100 倍的秘密武器

Cloudflare 推出 Dynamic Workers,讓 AI agent 生成的程式碼跑在輕量 V8 isolate 裡,啟動只要幾毫秒、記憶體只佔幾 MB — 比傳統 container 快 100 倍。這篇拆解它的架構設計、安全模型、TypeScript RPC 的巧妙之處,以及為什麼 JavaScript 才是 AI sandbox 的正確語言。

Claude Code Auto Mode:讓 AI 自己判斷哪些指令該擋、哪些放行

Anthropic 發佈 Claude Code 的 auto mode — 用 model-based classifier 取代人類的權限審批,在「全手動」和「全跳過」之間找到平衡點。本文拆解它的架構、威脅模型、兩階段分類器設計,以及 17% false negative 背後的誠實數字。

.claude/ 資料夾完全解剖 — 你的 AI 助手的大腦在哪裡

你知道 Claude 為什麼在這個 repo 表現好、換個 repo 就變笨嗎?秘密就在 .claude/ 資料夾裡。Akshay 拆解了整個結構:CLAUDE.md 三層架構、自訂指令、agent、permissions、還有那個你可能不知道存在的全域 ~/.claude/。

Karpathy 的 Autoresearch 怎麼運作?—— 給 Agent 開發者的五堂設計課

Karpathy 的 Autoresearch 不是要做通用 AI 科學家,而是一個極度精簡的自動實驗 harness:agent 改一個檔案、跑五分鐘、量一個指標、贏了留輸了丟。這個設計教會我們:最好的自主系統不是最自由的,而是約束最嚴格的。