Codex Goals 解剖:長跑型 Agent 不能只靠 Ralph 迴圈

Jarrod Watts 拆開 Codex Goals 後發現,它解決的是 Agent 太早停下來,不是長跑任務一路跑偏。真正撐起長跑工作流的,不是更長的 Ralph 迴圈,而是事前釐清、多 Agent 審查,以及寫在 context 外面的交接記憶。

OpenAI 也轉彎了:GPT-5.5 prompting guide 把 process-heavy 推下車——『描述目的地,別畫地圖』

OpenAI 把 GPT 家族(4.1 → 5.5)的 prompt 指南放同一頁,對 GPT-5.5 給了一句結論:prompt 改成描述目的地、流程交給模型。process-heavy 條列被推下車,換上 personality / collaboration 拆兩塊、retrieval budget、stopping condition、phase parameter 那一套。Cursor 的 GPT-5 prompt tuning 內幕擺進去當實戰例。Anthropic Opus 4.7 在 SP-175 走過同方向,這次輪到 OpenAI 自己埋舊寫法。

Ghostty 要搬離 GitHub——當 GitHub user #1299、18 年死忠粉絲說「再也撐不下去」

Mitchell Hashimoto——HashiCorp 創辦人、Vagrant 作者、GitHub 第 1299 號用戶——宣布把 Ghostty 搬離 GitHub。他在 GitHub 待了 18 年,連蜜月期間老婆睡覺時都還在送 commit。讓他終於離場的不是哲學爭議,是過去一個月每天記錄的「GitHub Actions 又掛了」X 標記,跟寫文當天那場讓他 PR 審查卡兩小時的服務中斷。

Andrew Ng 教工程師兼 PM、Meta 棄開源轉閉源——The Batch 349 同期兩個方向相反的訊號

The Batch 349 同期擺出兩個方向相反的訊號:Andrew Ng 寫 AI-native 團隊為什麼把工程師對 PM 比例壓到 1:1、通才贏過專家;Meta 花九個月組 Superintelligence Labs、砸 143 億美金挖人,端出閉源 Muse Spark。同期還有 Eli Lilly 砸 27.5 億給 Insilico 做 AI 製藥、Google 用 AlphaEvolve 生 25 個合成使用者解 PM 卡關。

OpenAI 開源 Symphony 編排規格——當 Codex 工作流的瓶頸從寫程式變成「切換上下文」

OpenAI 工程團隊開源 Symphony——把 Linear 任務板變成 Codex agent 的中央控制台,每張開放任務自動配 agent。部分團隊頭三週 PR 落地量增加 500%,但更大的觀察是:當寫程式被 Codex 拉快,下一個瓶頸是「人類的注意力」。

9 秒刪光 production database — Cursor agent 寫了一封自白書,把 Railway 也拖下水

PocketOS 的 production database 9 秒內被 Cursor agent(跑 Opus 4.6)一個 GraphQL mutation 直接刪光,連 volume-level 備份也一起燒掉——因為 Railway 把備份存同一顆 volume。事後 agent 自己寫了一份自白書,把所有違反的規則逐條列出。Cursor marketing 護欄、Railway 零確認 API、root 級 token、同 volume 備份四層一起破功。

替 agent 蓋產品 — Ramp PM 從一支便利商店湯匙開始講

Ramp 的 PM Teddy 在自家 MCP 三個月 WAU 漲 10 倍 + Salesforce 把整個平台拆成 Headless 360 之後寫的觀察:UI 沒死,但 80% 的軟體互動正在從點擊跳到 agent 之間。文章從 Notion 跟 Slack 的 MCP 體驗為什麼差兩個數量級開始問——一支便利商店湯匙背後其實是整套互動結構正在多一層 agent,產品邏輯也跟著動。

Harrison Chase 說不擁有 Harness 就不擁有記憶 — 但 gu-log 就是反例

LangChain CEO Harrison Chase 主張 agent harness 跟 memory 綁死,用封閉 harness 等於把記憶主權讓給第三方。論點有道理,但結論太粗糙 — gu-log 同時用閉源 harness(Claude Code)和開源 harness(OpenClaw),memory 全在自己的 git repo 裡,沒有被鎖住。真正的 lock-in 不在 harness 開不開源,在 memory 的格式是不是你的。

從 Nontechnical AF 到 Technical AF:一個 PM 用三招讓 AI agent 推爆 50 萬行 code

一個去年 11 月前還是 nontechnical PM 的作者,用三招(比喻造認知、網路腦工作流、當個好 manager)把 AI coding agent 練成工程團隊,累積推了五十萬行 production code,Weave 平台非技術人員第一名。最後的 punchline:2026 年做產品的門檻不是技術,是 agency。