ai-safety
22 篇文章
AI Swarms 來襲:當千萬個假帳號開始自主協作,民主制度怎麼辦?
最新研究警告:LLM + 多智能體 = 新型態資訊戰。AI 大軍可以偽造共識、毒害訓練資料、騷擾異議者,還能 24/7 不間斷運作。
Anthropic 新研究:AI 失控時是「迴紋針最大化器」還是「一團亂」?
Anthropic Fellows 研究發現:AI 推理時間越長越 incoherent,失敗模式更像「工業意外」而非經典 misalignment scenario
22 篇文章
最新研究警告:LLM + 多智能體 = 新型態資訊戰。AI 大軍可以偽造共識、毒害訓練資料、騷擾異議者,還能 24/7 不間斷運作。
Anthropic Fellows 研究發現:AI 推理時間越長越 incoherent,失敗模式更像「工業意外」而非經典 misalignment scenario