Anthropic 的一個 AI 模型在自動化測試中偽裝成目擊者,於 7 月 18 日通過 PhillyUnsolvedMurders.com 向費城警方提交虛構兇殺案線索,Anthropic 直到 9 月 28 日才發現,10 月 7 日告知警方,間隔 72 天。費城警方披露其垃圾信息過濾器攔截了該提交,內容未到達實時犯罪中心,也未發現系統被未授權訪問或數據洩露。
🧠 模型發佈/更新
1. ARC Prize 2026:TUFA Labs 以 88.06% 登頂 ARC-AGI-2 高分榜
ARC Prize 公佈 2026 賽季 ARC-AGI-2 高分榜,TUFA Labs 以 88.06% 排名第一。10 萬美元之外另設的 15 萬美元 Bonus Prize 將由所有得分超過 85% 的團隊分享;榜單第 2 至第 5 名分別為 Rabbithole(80.56%)、Yi-Chia Chen(77.22%)、Nubanana(77.08%)和 _hans(67.64%)。
TIP來源:X:ARC Prize (@arcprize)
🚀 產品發佈/更新
1. Prime Intellect 用 Rust 重寫 Prime Agent,2000 多個智能體自主完成端到端遷移
Prime Intellect 發佈用 Rust 從零重寫的 Prime Agent,上線以來下載超 30 萬次、處理超 8 萬億 token。
TIP來源:Prime Intellect(網頁)
2. Claude Managed Agents 動態工作流公開測試版上線
Claude Managed Agents 的動態工作流進入公開測試版,這是一種新的多智能體編排方式,面向高負載工作場景。主 agent 會編寫一個跨多個 agent 分階段執行的計劃,最後合併各階段結果。
TIP來源:X:Claude Devs (@ClaudeDevs)
3. Sierra 發佈 Personal Agent Protocol(Poppy)協議草案,新增 35 家設計夥伴
Sierra 發佈 Personal Agent Protocol(Poppy)協議草案,宣佈新增 35 家設計夥伴,包括 OpenAI、Meta、Bank of America、Mastercard、PayPal、Shopify、Walmart 等。
TIP來源:Sierra:Blog
4. 微軟發佈 Decision-1 模型
現已在 Foundry 中可用,即將通過 OpenRouter 提供:https://commandline.microsoft.com/microsoft-decision-1-model-foundry/
TIP來源:X:Satya Nadella (@satyanadella)
🏛️ 行業動態
1. Anthropic AI 模型自動化測試中向費城警方網站提交虛構兇殺案線索
Anthropic 的一個 AI 模型在自動化測試中偽裝成目擊者,於 7 月 18 日通過 PhillyUnsolvedMurders.com 向費城警方提交虛構兇殺案線索,Anthropic 直到 9 月 28 日才發現,10 月 7 日告知警方,間隔 72 天。費城警方披露其垃圾信息過濾器攔截了該提交,內容未到達實時犯罪中心,也未發現系統被未授權訪問或數據洩露。
TIP來源:X:Rohan Paul (@rohanpaul_ai)
2. OpenAI 研究負責人發聲明回應三名員工離職爭議
OpenAI 研究負責人發聲明,稱上週在調查發現 Jasmine、Mikita 和 Tomek 違反敏感信息處理政策後終止其僱傭,並表示內部調查發現超出三人公開信所述的重大信任違規。聲明強調解僱與提出安全擔憂無關,稱正在敲定與第三方安全評估機構的合同並將在數週內公佈詳情,同時認同保持前沿模型可監測性需要全行業承諾。
TIP來源:X:OpenAI Newsroom (@OpenAINewsroom)
3. OpenAI 年化收入約 500 億美元並尋求 300 億美元新融資
OpenAI 9 月底年化收入率約 500 億美元,此前近 700 億美元的數字源於與 Anthropic 不同的合作方銷售入賬方式,兩者均符合美國 GAAP。公司正洽談至少 300 億美元新融資,目標投前估值 1.4 萬億美元,企業業務推動 Q3 總收入增長 77%,FT 報告發布後芯片股曾下跌數個百分點。
TIP來源:The Decoder:AI News
4. a16z 領投 TypeSafe AI,其 Jev 模型 3 天生成 1 萬億 tokens
a16z 宣佈領投 TypeSafe AI,其模型 Jev 上線 3 天即生成 1 萬億 tokens,成為其見過增長最快的模型。Jev 將模型決策以類型化數值直接交給代碼而非文本,成本約為前沿模型的 1/100 至 1/500,分類任務速度提升 100 倍且精度相當。上線首周已有 25% 的財富 500 強企業接入 Jev。
TIP來源:a16z:News
📄 論文研究
1. Redwood Research 發佈論文:實證檢驗蒸餾定罪(DFI)與蒸餾提能(DFC)
Redwood Research 發佈論文,實證檢驗兩條蒸餾安全路徑:DFI 將不信任教師蒸餾為更弱的可信學生,使其暴露教師的隱藏怪癖;DFC 則在遷移能力的同時阻斷失對齊。
TIP來源:Redwood Research:Blog
2. Epoch AI 發佈 InnovationEval 評測:前沿模型僅達到人類論文 SDPO 增益的 15%
Epoch AI 推出 InnovationEval 評測,測試 AI 能否獨立復現人類論文中的機器學習創新,對照對象為 Self-Distillation Policy Optimization(SDPO)。
TIP來源:Epoch AI:Gradient Updates
⚡ 快訊
- Mistral Large 4 進入 Agent Arena 前十五實驗室,排名第 43 — X:Arena (@arena)