LLM
3 篇文章
Qwen 3.8 27B 很優秀,但預設會瘋狂想太多
Qwen 3.8 27B 是可在筆電上跑的 27B 開源視覺模型,基準看起來很強,但預設推理深度太高,會為簡單題目想太久。關掉或調低推理後仍然好用,視覺框選與寫程式 Agent 都有表現,瓶頸是速度。
Karpathy:花四小時用 LLM 打磨論點,結果叫它反駁就被自己說服了
Andrej Karpathy 花四小時用 LLM 打磨一篇文章的論點,覺得超有說服力,結果叫 LLM 反駁就被徹底擊潰。LLM 的 sycophancy 是真實的陷阱,但反過來利用也是 alpha。
分離式規劃:為什麼最強的推理模型不一定是最好的寫扣仔?
SemiAnalysis 認為,agentic coding 也可能像 disaggregated prefill 一樣,把 planning 與 execution 分開處理。若 spec 寫得夠好,較便宜的模型或許就能負責 execution,降低成本。