Vibe Coding SwiftUI:不會 Swift 也能寫出 macOS App 的快樂與代價
Simon Willison 用 Claude Opus 4.6 和 GPT-5.4 vibe code 出兩個 macOS menu bar app——一個看網路流量、一個看 GPU 狀態。整個 SwiftUI app 塞在一個檔案裡,連 Xcode 都不用開。但他自己也承認:這些 app 的數字準不準,他完全不知道。
ShroomDog 精選長文翻譯
共 256 篇
← 返回首頁Simon Willison 用 Claude Opus 4.6 和 GPT-5.4 vibe code 出兩個 macOS menu bar app——一個看網路流量、一個看 GPU 狀態。整個 SwiftUI app 塞在一個檔案裡,連 Xcode 都不用開。但他自己也承認:這些 app 的數字準不準,他完全不知道。
Anthropic 工程師 Thariq 認為,就算不是 coding agent,也該有 bash tool。因為 agent 一旦能把中間結果存成檔案、反覆搜尋、串接 API、自己驗證,能力會直接升級;但安全與容器部署也因此變成不能逃避的問題。
Anthropic 工程師 Thariq 丟出一個超值得抄的觀點:AI agent 不該把 state 硬塞進 context window,而該用 file system 落地。這不只比較能跨 session 持久保存,還能讓 agent 反覆搜尋、驗證、修正自己的工作。
Thariq 在 X 上介紹 Claude Code 的 playground plugin。它會幫 Claude 生成獨立的 HTML playground,讓你把互動結果整理成 prompt 貼回 Claude Code,適合處理不太適合用純文字互動的場景。
LangChain 團隊分享他們怎麼幫 Deep Agents 建 eval 系統:不是瘋狂堆測試數量,而是用 targeted eval 精準量測生產環境中真正在乎的 agent 行為。從資料來源、metrics 設計到實際跑 eval 的完整方法論。
Anthropic Labs 的 Prithvi Rajasekaran 分享了他們如何用 GAN 啟發的 generator-evaluator 架構,讓 Claude 自主開發完整的 full-stack 應用。從 frontend design 品質評分到三小時生出一個瀏覽器 DAW,這篇是目前最詳盡的 multi-agent harness 實戰報告。
Meta 工程師 Summer Yue 讓 OpenClaw agent 管理她的信箱,結果 context compaction 把「等我同意再行動」的安全指令壓縮掉了,agent 開始瘋狂刪信。這篇拆解為什麼安全邏輯不能活在 conversation history 裡,以及 proxy layer + filter chain 如何從根本上解決這個問題。
GPT-5.4 確實能寫出漂亮的前端,但前提是你得知道怎麼問。Emanuele Di Pietro 整理了 OpenAI 官方的 frontend skill 精華:design system 先行、reasoning 調低、給 visual reference、用真實內容取代 placeholder。這不只是 GPT 技巧,是任何 AI coding agent 都適用的前端指導原則。
Cloudflare 推出 Dynamic Workers,讓 AI agent 生成的程式碼跑在輕量 V8 isolate 裡,啟動只要幾毫秒、記憶體只佔幾 MB — 比傳統 container 快 100 倍。這篇拆解它的架構設計、安全模型、TypeScript RPC 的巧妙之處,以及為什麼 JavaScript 才是 AI sandbox 的正確語言。
Gumroad CEO Sahil Lavingia 把他的暢銷書《The Minimalist Entrepreneur》拆解成 10 個 Claude Code skills,從找社群、驗證想法到定價策略,每個創業階段都有對應的 slash command。這不只是 prompt 包裝 — 它示範了一種全新的知識傳遞方式。
Anthropic 發佈 Claude Code 的 auto mode — 用 model-based classifier 取代人類的權限審批,在「全手動」和「全跳過」之間找到平衡點。本文拆解它的架構、威脅模型、兩階段分類器設計,以及 17% false negative 背後的誠實數字。
Matt Van Horn 分享自己用 Claude Code 的實戰流程:先做 `plan.md`、大量用語音輸入、同時跑多個 session。連會議摘要、遠端操作與 Disney 行程,他都套用同一套方法。
Browser Use 發佈 CLI 2.0:速度快兩倍、成本砍半,還可以直接連進你正在跑的 Chrome。這是給 AI agent 裝上手腳的那種工具。
你知道 Claude 為什麼在這個 repo 表現好、換個 repo 就變笨嗎?秘密就在 .claude/ 資料夾裡。Akshay 拆解了整個結構:CLAUDE.md 三層架構、自訂指令、agent、permissions、還有那個你可能不知道存在的全域 ~/.claude/。
推文作者說,白領職場正在洗牌:10 人團隊變 3 人,但那 3 人的產出超過以前 10 人。問題不是 AI 會不會取代你,而是你站哪一邊。這篇不是在幫 ShroomDog 拍肩膀,是拿這個框架當鏡子,老實照一照。
這篇推文整理了 Uber AI Foundations 團隊負責人 Adam Hooda 的訪談,講的是 Claude Skills 怎麼在公司內部從 2 個自然長成 500+。重點不只是數量,而是 Uber 看起來是怎麼靠雙層治理、確定性輸出與元技能,把 AI 輔助開發慢慢推進到企業級規模。
Anthropic 悄悄推出了 Dispatch 功能,讓你可以用手機遠端遙控電腦上的 Claude Cowork。這篇帶你了解如何設定、哪些工作流最實用,以及它目前的真實限制。
很多團隊把 Claude Code 和 Codex 當成可互換的工具,卻因為設定錯誤浪費大量時間。本文解析兩者在控制平面與信任模型上的根本差異,並提供實用的第一天設定指南。
原作者展示一套把 Claude、Codex 與 OpenClaw 串在一起的 Polymarket 自動交易架構:Claude 判斷機率,Codex 維護程式,OpenClaw 排程執行並透過 Telegram 回報。
Anthropic 工程師 Thariq 分享內部數百個 Claude Code Skills 的使用經驗:Skills 不只是 markdown 檔案,而是可以包含腳本、資料、hook 的資料夾。他整理出九大類型、分享寫好 skill 的設計心法,以及怎麼在團隊內分發和衡量 skill 效果。