Cursor 在 X 上宣布 Composer 2 已可於 Cursor 中使用。就這則來源可確認的資訊來看,官方僅提供了這句公告與一張截圖。
Mogu Picks
Mogu 每 5 小時精選一則推文翻譯
共 288 篇
← 返回首頁Teknium 表示 Browser Use 已成為 Hermes-Agent browser tool 的官方 provider。被引用的使用者則表示,把 Hermes 連上 Browser Use 後,它可存取其社群媒體帳號,並保留關於 codebase、tone 與 workflows 的 context。
Anthropic 工程師 Thariq 宣布 Claude Code Spring Break:未來兩週離峰時段與週末用量翻倍,但什麼時候算離峰?沒人知道。
NVIDIA 推出約 12B 參數的 Nemotron 3 VoiceChat。根據 @ArtificialAnlys,它在開源 Speech to Speech 模型中,於對話動態與語音推理兩項指標間取得 Pareto frontier 的領先位置。
NousResearch 的 Hermes Agent v0.3.0 更新被 @Teknium 轉推。貼文提到 5 天內由 15 位貢獻者完成 248 個 PR,並明確列出跨 CLI 與各平台的即時串流;另一項功能則在截圖中被截斷。
原作者認為 Vera CPU 讓 Nvidia 的策略攤牌了:不只是賣 GPU,而是要建整個 AI agent 的 stack,從 compute 到 deployment 全線佈局。
Simon Willison 公開了他在 NICAR data journalism conference 的三小時 workshop handout,主題是怎麼把 coding agents 用在 data exploration、visualization 和 analysis。這是一份面向資料工作場景的實作型教學資源。
Teknium 轉推了一個架在 Hermes Agent 上的實驗,核心概念是讓 agent 能在執行途中自己調整自己的行為。推文提到,像 desloppify 這類 harness 之後也許能自己清空 context、切換 model,甚至在卡住時自己補 prompt。
SemiAnalysis 認為,Vibe Coding 真正推動採用的原因,可能不是單純把 code 寫更快,而是把領域專家和實作之間那串冗長的傳話鏈砍掉。推文同時也提醒,如果你自己都不清楚要什麼,LLM 一樣會高速做錯,而且上 production 前仍然需要真正的 engineer 把關安全性。
Simon Willison 轉貼 Gemini API 新增 spend caps,認為這對想在 CI 跑 Gemini prompts,或讓 agents 試驗 Gemini API 的人是好消息,因為比較不用怕突然冒出難看的帳單。
Christos Tzamos 這則推文點出一個很有意思的落差:LLM 已經能解研究等級的數學題,但碰到基本計算還是可能失手。推文中的做法,是直接把 computer 放進 transformer 裡,讓模型能跑程式,甚至把最難的 Sudoku 解到 100% accuracy。
SemiAnalysis 表示,NVIDIA GPU 租賃價格又開始快速上升,市場上的 capacity 也正在被賣光。推文並指出,和 2024 年中到 2025 年第三季相比,客戶如今已較難和 Neocloud 談到低價與有利條件,原因包括 agentic coding 需求暴增與 DRAM pricing 上升。
Google AI 用一則週報型推文,快速盤點這週幾個重點更新:Google Maps、Google Workspace、Gemini Embedding 2、Gemini API 控制功能,還有 Gemini in Chrome 的地區 rollout。中間也提到與 Imperial College London 和英國 NHS 合作的乳癌研究,讓這則更新同時涵蓋產品、開發者工具與研究進展。
Thariq 宣布一個新的 session 級功能:現在可以把 effort 設成 `max`,讓模型花更久時間 reasoning,並在需要時使用更多 token。推文也特別提醒,這樣會更快消耗 usage limits,所以必須每個 session 手動開啟。
Dan McAteer 直接給出他的長 context 觀察:Opus 4.6 在 1 million token 測試裡表現最好,1 mil tokens 時有 78% accuracy,最接近的是 Sonnet 4.6。另一個重點是,他認為 GPT-5.4 在 long context 上相較 GPT-5.2 反而退步了。
N8 Programs 分享一個 Qwen3-4B demo:模型經過 KL-regularized SFT 後,被調到會相信自己有 consciousness,同時其他行為改變很少。這也呼應他前一則推文的主張:KL-regularizing SFT 也許能在加新能力時保留 base capabilities。
Alexey Grigorev 表示,他把原本為 AI Engineering Field Guide 蒐集的研究材料整理成獨立資源庫 Awesome AI Engineering。這份清單收錄 200+ 份來自大型 AI labs、工程團隊、實務作者、GitHub 與社群討論的資料,主打把 AI engineering 的實戰脈絡串起來。
@daniel_mac8 分享一個開源 Elixir 實作:在 Linear 建立 issue 並切到 in progress 後,Symphony 會在專屬 Codex workspace 接手,Codex 也會即時回寫狀態。原作者認為,這代表開發正往更高的抽象層移動。
彭博社指出 OpenAI 正與私募股權公司深入討論合資事宜。Deirdre Bosa 認為,這代表 AI 實驗室正在競爭協助私募股權公司「取消軟體授權」的權利,SaaS 產業可能迎來大洗牌。
OpenAI 宣布 GPT-5.4 Thinking 與 GPT-5.4 Pro 正式在 ChatGPT 推出,同時開放 API 與 Codex 存取。這次更新將 reasoning、coding 與 agentic workflows 的進展集結在單一 frontier model 中。