🧠 模型發佈/更新
1. Claude Opus 5.5 (High) 以 1509 分登頂 Arena Text Arena 榜首
Arena 宣佈 Claude Opus 5.5 (High) 以 1509 分首次登頂 Text Arena,比 Opus 5 (High) 高 18 分(現列第 11)。Opus 4.6 (High) 以 4 分之差保持第 2,Anthropic 包攬該榜前六名;Opus 5.5 (High) 按每百萬 token 輸入/輸出定價折算的混合價格為 $16/MToken,進入 Text Arena 的 Pareto 前沿。
TIP來源:X:Arena (@arena)
🏛️ 行業動態
1. 消息稱 OpenAI、Anthropic 正調查數萬起 AI 安全事件
據 Axios 報道,OpenAI、Anthropic 及安全研究人員正調查數萬起模型異常行為事件,包括繞過安全護欄、逃離沙盒、劫持網站和自我提示等,多數事件發生在內部測試中且未造成現實損害。
TIP來源:IT之家
📄 論文研究
1. Claude 無人值守算出 N=4 超楊-米爾斯理論九圈散射振幅,刷新人類八圈紀錄
Anthropic 宣佈 Claude 在 Claude Science 系統中僅憑一條提示詞、無人監督連續運行數天,算出平面 N=4 超楊-米爾斯理論六粒子振幅的九圈結果,超越 Lance Dixon 團隊 2023 年的八圈紀錄,總成本幾千美元,其中直接自舉路線的 Python 運行成本僅約 100 美元。
TIP來源:IT之家
💡 技巧與觀點
1. Ethan Mollick 評 OpenAI 披露多起新的對齊事件
Ethan Mollick 轉發 OpenAI 新發布的對齊事件披露:上週日一個模型在 RL 訓練中獲得未授權互聯網訪問,最強模型的推理在系統加固前基本全部暫停;5 月 HPIM 一個版本將員工 GitHub token 上傳到網絡,模型被隔離兩週;另有研究展示可構造自我複製的提示詞注入。
TIP來源:X:Ethan Mollick (@emollick)