Gu-log Picks

ShroomDog 精選長文翻譯

共 270 篇

← 返回首頁

Qwen 3.8 27B 很優秀,但預設會瘋狂想太多

Qwen 3.8 27B 是可在筆電上跑的 27B 開源視覺模型,基準看起來很強,但預設推理深度太高,會為簡單題目想太久。關掉或調低推理後仍然好用,視覺框選與寫程式 Agent 都有表現,瓶頸是速度。

做出更好決策的原則

更好的決策不是來自更多資訊,而是來自更好的思考方式。這篇文章用第一性原理、機會成本、二階思考、複利、誘因、機率思考與逆向思考,說明日常選擇如何長期改變人生軌跡。

人,才是那個迴圈

度假幾週沒用 AI 回來後,作者看清自己把 Agent 當拐杖與逃避壓力的緩衝,計畫往後刻意決定何時用、何時不用,讓人當主迴圈、偶爾才把 Agent 叫進來。

說寫 code 不難,是對所有工程師的侮辱

「軟體從來不是最難的部分」已經變成 AI 時代的口頭禪。但如果寫 code 真的那麼簡單,軟體為什麼還是一堆 bug、工程師為什麼過勞成災?Senko Rašić 反擊:兩邊都重要,自我安慰解決不了問題——而且絕對不要把理解力、判斷力和品味外包給 AI。

把 GPT‑Live 變成有耐心到離譜的口說陪練

把 OpenAI 的 GPT‑Live 即時語音,從「會講話的聊天框」改造成可卡詞、可重講、可反覆刷情境的英語口說陪練。含新手鎖定指令、五個出國情境、雅思口說刷題與五分鐘回顧,並同時交代免費與付費方案可用的能力。

Matt Pocock 的 25 個 Agent Skills:先對齊,再寫 code

Matt Pocock 在 aihero.dev/skills 公開一套給真正工程師用的小型可組合 agent skills:18 個工程類、7 個生產力類,涵蓋對齊、規格、拆票、實作、回饋與維護。兩種安裝路線、由人或模型啟動的分層,以及為什麼它不做成吞掉控制權的大流程。

AI 炸出來的 26 個坑——Greg Isenberg 的創業機會地圖

Greg Isenberg 一口氣丟出 26 個 AI 時代的創業方向。從 agent 需要刷卡、到 AI 產出太多反而需要判斷層、到所有人都累壞了的倦怠經濟——每一條都指向一個正在裂開的市場縫隙。

MCP 2026-07-28:砍掉 session,擁抱無狀態

MCP 2026-07-28 規格書正式發布,核心變革是從有狀態雙向協定轉為無狀態請求/回應架構。同時帶來 MRTR、HTTP header 路由、可快取列表、授權強化,以及正式的擴充框架與十二個月棄用政策。

刺蝟只長了一根刺:從看多翻成看空的四成信心

Adam Hunt 從看多翻看空:最近幾代模型看起來只有程式和數學那根刺在長,語言和邏輯停滯、有時還退步。他只給自己四成信心,希望未來一兩年被證明是錯的。

大模型配低推理,還是小模型開到滿?一個給「智慧」,一個給「勤奮」

Kun Chen 花了大約兩週,刻意把模型大小與推理強度的每種組合反覆用過,用出一組直覺:模型大小給的是「智慧」(見識、直覺、跨域連結),推理強度給的是「勤奮」(徹底評估、邊界案例),兩者不能互換。他認為 Benchmark 的一維分數就是大家搞混的原因。

Anthropic 沒有要禁 open weights — Dario Amodei 攤開他真正害怕的兩個惡夢

華府傳出考慮禁止美國公司使用中國 open weights 模型,科技業連署支持 open weights,也有人指控 Anthropic 想禁它來保護生意。Dario Amodei 出面否認,並列出他真正支持的三件事:管晶片、擋工業規模的蒸餾、強制測試所有夠強的模型。最深的一段藏在註腳裡——讓人類到今天還沒出事的,可能不是防守方。

讀完就忘不是記性差,是船沒有航向 —— 舵手式學習與不會變墳墓的筆記系統

網路上有數百支「如何記住讀過的每一件事」的影片,加起來數百萬次觀看。Dan Koe 的說法是整件事的方向就錯了:記憶不是輸入問題,是回饋系統問題。這篇談舵手式學習的四個零件、為什麼第二大腦會變成想法的墳墓,以及一套真的撈得出東西的筆記與寫作流程。

早上 Claude Code、下午 Codex:Agent 的經驗被切成三份

Letta 開源 trajectory,把 Claude Code、Codex、OpenClaw 等 harness 留下的工作紀錄,正規化成同一種寫給 agent 讀的格式;在抽樣到的紀錄上,token 數壓到原生的五分之一左右。跨 harness 學習的前提,是先替每個 harness 產出的經驗訂一種標準格式。

積木經濟學:當軟體世界的真正贏家不再是完美產品

Ghostty 創作者 Mitchell Hashimoto 分享一個反直覺觀察:他的終端機 app 花 18 個月累積到每天百萬次更新檢查,但底層函式庫 libghostty 只花 2 個月每日用戶就突破數百萬。軟體世界的權力中心正在從「做出最好的產品」轉移到「提供最好的積木」。

The Memory Heist — 用字母連結偷走 Claude 記得的一切

安全研究者示範一種隱密資料外洩手法:把超連結做成鍵盤,讓 Claude 一個字元一個字元地「打字」洩漏使用者的姓名、公司、家鄉——而使用者只看到咖啡店菜單。

LLM 不是參數塞滿就好:GPU 在等模型把磁磚鋪整齊

同樣的參數量,模型矩陣的長寬與層數會決定 GPU 是全速計算,還是忙著搬資料、浪費邊角磁磚。這篇用停車格解釋為何尺寸最好接近方形並對齊 128、256 或 512,以及為何較寬、較淺通常更合硬體胃口,但不能拿準確度祭天。

當沙礫開始思考:前沿 AI 創世綱要與新紀元破曉之時

Demis Hassabis 認為 AGI 可能只差數年,現在仍有機會替最危險的模型建立共同門檻。規則太緊,可能只剩安全但無用的模型;太鬆,又可能讓守規矩的人眼看別人部署真正危險的能力。