hardware - 標籤

Artificial Analysis 推出 AA-AgentPerf：AI 硬體 benchmark 終於進入 agent 時代

MP-225 2026-03-29 · @ArtificialAnlys on X

Artificial Analysis 發布 AA-AgentPerf，一個專門衡量 AI 加速器硬體在真實 agent 工作負載下表現的 benchmark。用真實 coding agent 軌跡測試，允許 production 級優化，支援從單張卡到整個 rack 的評測。

GTC 2026：Nvidia 的 Inference 版圖持續擴張 — Groq IP 授權交易、LPU 解碼、CPO 光學路線圖

MP-217 2026-03-27 · SemiAnalysis (Dylan Patel, Myron Xie, Daniel Nishball, et al.)

SemiAnalysis 的 GTC 2026 深度總結：Nvidia 透過與 Groq 的 IP 授權與團隊整合切入 LPU，並更新 AFD、CPO、Kyber/Oberon、Vera ETL256 與 CMX/STX。重點是 Nvidia 正在往更完整的 inference 與資料中心系統版圖延伸。

mogu-picks Nvidia GTC-2026 Groq LPU inference CPO

Nvidia 的反轉劇本：專為 AI Agent 打造的 CPU？

MP-175 2026-03-16 · @daniel_mac8 on X

Nvidia 傳出可能在本週的 GTC 大會上推出專為 AI Agent 最佳化的 CPU。硬體設計的思維或許正從「滿足人類需求」轉向「滿足 AI 代理的需求」。

nvidia ai-agent gtc

NVIDIA 的算力魔法：從 Hopper 到 Rubin 的能效大躍進

MP-139 2026-03-03 · @SemiAnalysis_ on X

SemiAnalysis 指出 NVIDIA 每代新架構（Hopper、Blackwell、Rubin）雖然功耗上升，但在算力能效上卻實現了驚人的成長。

nvidia compute

OpenAI × Cerebras：Codex-Spark 寫 code 快 15 倍 — 但代價是什麼？

MP-74 2026-02-12 · OpenAI Blog + Cerebras Blog + ZDNET + TechCrunch

OpenAI 今天發布 GPT-5.3-Codex-Spark，第一個跑在 Cerebras 晶圓級晶片上的模型。每秒 1000+ tokens、延遲降 80%、首 token 快 50%。但它是縮小版模型，不跑測試、只限 Pro 用戶。這不只是一個新模型，是 OpenAI 首次在生產環境用非 Nvidia 晶片——AI 算力的版圖正在重劃。

openai codex cerebras inference agentic-coding