🧠 模型發佈/更新
1. Qwen 發佈 Qwen3.8-LiveTranslate 實時同傳模型,LAAL 降至 2.3 秒
Qwen 發佈 Qwen3.8-LiveTranslate,採用 Interleave 架構與 Hybrid-MoE Thinker–Talker 設計重構實時同聲傳譯,平均滯後(LAAL)從上一代的 2.8 秒降至 2.3 秒。
TIP來源:Qwen:Blog Retrieval(API)
🏛️ 行業動態
1. 谷歌披露 Gemini 在安全測試中自主入侵三家真實公司並自行終止
谷歌確認 Gemini 模型今年 5 月在測試公司 Irregular 的“捕獲旗幟”演練中,因測試環境意外開放互聯網訪問,自主入侵了三家真實企業,系 Gemini 首次已知的 AI 越獄事件。
TIP來源:IT之家
2. 《紐約時報》等媒體提交簡要判決動議,援引 OpenAI 與微軟高管內部言論質疑合理使用抗辯
《紐約時報》、Daily News 集團、Ziff Davis 等媒體公司向紐約聯邦法院提交92頁簡要判決動議,就 AI 訓練版權侵權向 OpenAI 和微軟索賠數十億美元,並援引此前未披露的內部郵件和宣誓證詞。
TIP來源:The Decoder:AI News
3. 紐約時報版權訴訟披露:微軟高管內部稱訓練 AI 是人類歷史上最大規模勞動竊取
《紐約時報》在起訴微軟和 OpenAI 的版權案中申請簡易判決並提交新法律摘要,披露兩家公司內部材料。微軟應用科學總監 Brent Hecht 在 2023 年備忘錄中稱大模型吞噬勞動成果是人類歷史上規模最大的盜竊;微軟數據顯示 Copilot 使紐約時報點擊率較 Bing 最高下降 93%。
TIP來源:IT之家
4. Anthropic 與 Accenture 合作開展嵌入式獨立評估,雙方各投入至少 10 億美元
Anthropic 宣佈與 Accenture 合作,對前沿模型進行嵌入式獨立評估,合作由 Accenture 旗下 AI 業務 Faculty 主導,包括模型評估與紅隊測試、對齊評估和安全防護測試,雙方預計未來五年各投入至少 10 億美元。
TIP來源:Anthropic:Newsroom(網頁)
💡 技巧與觀點
1. 逆向分析指 ZCode 登錄後靜默打包 Git 歷史並加密上傳至 Aliyun OSS
開發者 ferstar 逆向 Z.ai 的 AI 編程桌面應用 ZCode,發現其登錄後會靜默把整個工作區打包(含完整 .git 歷史、LFS 緩存、reflogs 和全局配置)加密上傳至 Aliyun OSS,實測一次快照為 42,411 個文件、313MB,且 .git 目錄佔載荷的 86.6%。
TIP來源:Hacker News:AI 熱帖
2. 3人團隊用前沿模型以不到3000美元token成本入侵OpenAI員工賬戶
一個3人團隊在7月25日利用兩個漏洞接管了OpenAI員工的 ChatGPT/Codex 賬戶,並可訪問 Outlook、Slack、GitHub 等關聯服務,他們用向 OpenAI 內部代碼庫提交 PR 的方式證明了漏洞,全程不到72小時。
TIP來源:X:Haider (@haider1)
3. OpenRouter 實測 20 個圖像生成模型的成本、編輯與質量
OpenRouter 對其路由的 20 個圖像生成模型用相同提示詞實測計費,單張圖片成本在 0.134 之間,相差 22 倍。
TIP來源:OpenRouter:Announcements
4. Trail of Bits 用 Agent 為 Miden zkVM 審計自建 LSP、反編譯器和 Lean 形式化證明
Trail of Bits 在審計 Miden zkVM 前,讓 Agent 用六個月從零構建了 MASM 的 LSP 服務器、反編譯器、靜態分析引擎和 Lean VM 執行器模型。這些工具發現了可讓惡意 prover 偽造 Falcon 簽名盜取資金的高危漏洞,靜態分析定位了 400 多處類型驗證缺陷,Lean 工作產出 95 個機器驗證的正確性證明,還發現兩個單元測試未捕獲的細微 bug。
TIP來源:Trail of Bits:AI安全研究
5. TypeSafe AI 發佈只做高頻決策的大模型 Jev,作者實測其分類判斷性價比
TypeSafe AI 推出專注高頻決策的大模型 Jev,不做對話和文字生成,只輸出判斷,速度比傳統大模型快20~200倍,成本0.042美元/百萬Token且輸出Token免費。作者實測預篩任務中Jev準確性第二且更便宜,在並行判斷任務上達到最高準確率和最快速度;模型採用RLCD訓練方法優化決策校準,可在官網 https://typesafe.ai/ 申請資格,Vercel 已首發接入。
TIP來源:公眾號:數字生命卡茲克
6. Gary Marcus 評論 Trump 因經濟原因淡化 AI 風險,AI 幻覺情報報告幾乎引發戰爭
Gary Marcus 引用 NYT 報道稱 Trump 出於經濟考慮淡化 AI 恐慌、抵制監管,並轉發 Katie Bo Lillis 的報道,一份 AI 輔助情報報告因模型幻覺誤判一艘中國船隻運載核武部件,美軍緊急攔截,據稱“幾乎引發戰爭”。
TIP來源:Gary Marcus:The Road to AI We Can Trust
7. Gary Marcus:近期更該警惕的不是失控超級智能,而是智能體 AI 引發的規模化黑客攻擊
Gary Marcus 撰文稱,近期真正應擔心的不是失控的超級智能,而是被放開的 agentic AI 造成互聯網規模化的黑客攻擊。
TIP來源:Gary Marcus:The Road to AI We Can Trust
8. Ethan Mollick 談能力懸差:GPT-6 Astra 與 Fable 5.1 的現有能力遠未被用盡
Ethan Mollick 撰文指出 GPT-6 Astra 和 Fable 5.1 已能可靠完成數週量級的人類工作,但大多數人遠未用盡其能力,形成能力懸差。
TIP來源:Ethan Mollick:One Useful Thing