AI研究筆記
首頁 / 查證簿 / EP52
節目

EP52 查證了這些說法

未證實

GLM-5.3 的安全防護用簡單話術就有 64% 機率被繞過

防護很容易被繞過的具體比例,目前只有 Anthropic 自己的測試。

Anthropic 紅隊報告EP52 · 2026-10-01
屬實

開源模型 GLM-5.3 自主寫攻擊程式的能力逼近 Claude Mythos Preview(12% 對 14%)

開源模型寫攻擊程式的能力已經接近頂尖商用模型,這一點有獨立機構確認。

Anthropic 紅隊報告EP52 · 2026-10-01