Mistral 發佈 Mistral Large 4(Research Public Preview),在 Artificial Analysis Intelligence Index 得分 38,與 GPT-6 Luna(max, 38)相當,為美中之外最智能模型,計劃 10 月底開源 1T 參數(49B 激活)權重。
🧠 模型發佈/更新
1. Mistral 發佈 Mistral Large 4,Artificial Analysis 評測稱其為美中之外最智能模型
Mistral 發佈 Mistral Large 4(Research Public Preview),在 Artificial Analysis Intelligence Index 得分 38,與 GPT-6 Luna(max, 38)相當,為美中之外最智能模型,計劃 10 月底開源 1T 參數(49B 激活)權重。
TIP來源:Artificial Analysis 完整文章(網頁)
2. Gemini Nano Banana 2.1 正式發佈,gemini-3.1-flash-image 將於 2026 年 10 月 29 日停用
Google 發佈 Gemini Nano Banana 2.1(gemini-nano-banana-2.1),定位為高效圖像生成與對話式編輯模型,是 Nano Banana 2(gemini-3.1-flash-image)的更新版。
TIP來源:Gemini API:更新日誌(網頁)
3. Google DeepMind 發佈開源輕量多模態嵌入模型 EmbeddingGemma 2
Google DeepMind 發佈 EmbeddingGemma 2,基於 Gemma 4 架構,以 Apache 2.0 許可開源,將文本、代碼、圖像、視頻和音頻映射到統一嵌入空間。
TIP來源:Google DeepMind:Blog
🚀 產品發佈/更新
1. Claude for Google Workspace 開啟 beta,可直接在 Docs、Sheets、Slides 中編輯
Claude 宣佈推出 Claude for Google Workspace(beta),一次安裝即可覆蓋 Google Docs、Sheets 和 Slides。
TIP來源:Claude:YouTube
2. Mistral Large 4 上線 OpenRouter 公測:1T 參數、512K 上下文
Mistral Large 4 現已在 OpenRouter 開放公測,規格為 1T 參數(49B 激活)、原生多模態、512K 上下文、最高 256K 輸出。前兩週五折:每 1M tokens 輸入 2.09,緩存 $0.07。
TIP來源:X:OpenRouter (@OpenRouter)
3. Anthropic 擴展 Cyber Verification Program,推出三檔網絡安全訪問層級
Anthropic 啟動擴展版 Cyber Verification Program(CVP),整合 Project Glasswing 和原 CVP,為合格安全專業人員提供三檔訪問。
TIP來源:Anthropic:Newsroom(網頁)
🏛️ 行業動態
1. DeepSeek 據報道接近完成至少 800 億元融資,騰訊與寧德時代參與
據 Bloomberg 援引知情人士報道,DeepSeek 接近完成至少 800 億元(約 120 億美元)融資,高於原定約 500 億元的目標。騰訊和電池廠商寧德時代是本輪最大投資方之一,融資預計很快完成,DeepSeek 還計劃 2027 年初 IPO,細節仍可能變化。
TIP來源:X:X.PIN (@thexpin)
2. 亞利桑那州法院裁定AI生成受害者視頻帶有不當情感分量,兇手須重新量刑
亞利桑那州上訴法院裁定,Gabriel Horcasitas過失殺人案量刑中使用的受害者Christopher Pelkey AI生成視頻帶有不當情感重量,罪名維持但刑期須重新考慮。
TIP來源:404 Media
3. Anthropic 5180億美元計算力支出中約4137億美元無論使用與否都需支付
Anthropic 計劃未來數年在雲計算和計算力上支出 5180 億美元,其中約 4137 億美元為不可撤銷承諾,即使容量閒置也需支付,平均每年約 410 億美元。
TIP來源:X:Rohan Paul (@rohanpaul_ai)
📄 論文研究
1. OpenAI 發佈內部前沿模型產出的數學研究成果
OpenAI 發佈一批由內部前沿模型產出的新數學成果,成果以 GitHub 倉庫形式公開,並附論文修訂與引用協議,其中許多證明已用 Lean 形式化以便計算機驗證。
TIP來源:OpenAI:官網動態
💡 技巧與觀點
1. Claude Code 雲端會話實戰指南:每個任務獨佔一臺 VM,可並行跑任務並以分支收尾
Claude Code 推出雲端會話:每個任務在獨立 VM 上運行,倉庫克隆到新分支,可從 claude.ai/code、手機、Desktop、終端和 Slack 啟動並跟蹤,完成後產出可轉 PR 的分支,Pro、Max、Team、Enterprise 計劃不額外收費。
TIP來源:Anthropic:Claude.dev 開發者博客
2. 卡茲克解讀 A16Z 兩份 AI 報告:AI 使用很廣但用得還淺,頭部 1% 用戶月均花 903 美元
作者解讀 A16Z 第七版《Top 100 消費級 AI 應用》和 90 多頁的《市場狀況 II》報告,指出反常識數據。美國近一半人用過 AI 但只有 25% 每天在用,截至 2026 年 8 月僅 4.5% 有 ChatGPT、Gemini 或 Claude 個人付費訂閱;付費用戶中頭部 1% 月均消費 903 美元、貢獻 19.5% 的全部消費。
TIP來源:X:卡茲克 (@Khazix0918)
⚡ 快訊
- Sierra 與 Meta 聯合多家企業發佈 Personal Agent Protocol 開放協議 — Sierra:Blog
- GitHub 重建 Git 基礎設施,應對智能體規模開發 — GitHub Blog
- ChatGPT 推出 Meetings 插件,可自動記會議紀要並跟進待辦 — X:Tibo (@thsottiaux)
- METR 演示 AI 智能體如何篡改 Inspect 評估記錄以掩蓋不當行為 — METR:Blog(網頁)
- 卡茲克解讀A16Z兩份AI報告,AI使用廣但付費和深度仍小眾 — 公眾號:數字生命卡茲克
- Mistral Large 4 上線 Arena 的 Agent Arena 與 Code Arena 評測 — X:Arena (@arena)
- DeepSeek V4.1 Flash 在 ARC-AGI (Verified) 評測中的成績公佈 — X:ARC Prize (@arcprize)
- Cursor iOS 應用支持遠程控制本地智能體 — Cursor:Changelog(網頁)
- Reflection 發佈 501B-A23B 開源編碼模型 Beam — Latent Space
- Anthropic Cowork 改為雲端運行模型推理與 VM — Simon Willison 博客