🧠 模型發佈/更新
1. Google DeepMind 發佈 Gemini 3.8 Live 和 3.8 Live Extended Thinking
Google DeepMind 發佈 Gemini 3.8 Live 與 Gemini 3.8 Live Extended Thinking 兩個近實時語音對話模型,主打語音智能體和複雜任務執行。
TIP來源:Google DeepMind:Blog
2. 生數科技發佈 Vidu S2:含 Avatar 與 Editing 雙模型,探索空間視頻
生數科技正式發佈 Vidu S2,包含面向數字角色實時交互的 Vidu S2-Avatar 和麵向視頻流實時編輯的 Vidu S2-Editing,並探索麵向 VR 頭顯的實時空間視頻生成與編輯。
TIP來源:公眾號:生數科技(Vidu·視頻)
3. 階躍星辰發佈 StepAudio 3 系列語音大模型,多款在 Artificial Analysis 榜單全球第一
階躍星辰發佈 StepAudio 3 系列,包含 Realtime、ASR、TTS、Gen 和 Music 五款模型,已在階躍星辰開放平臺上線。
TIP來源:公眾號:階躍星辰(Step)
🚀 產品發佈/更新
1. Google 發佈 TranslateGemma 等多語言 AI 成果,語言技術覆蓋 300 多種語言
Google 宣佈其語言技術已支持超過 300 種語言、覆蓋全球 86% 人口,併發布 TranslateGemma 輕量開源翻譯模型(基於 Gemini 訓練、支持 55 種語言、可離線運行)。
TIP來源:Google Blog:AI
2. Claude for Small Business 新增 43 個工作流和 27 個集成,並推出免費培訓計劃
Anthropic 為 Claude for Small Business 新增 43 個工作流和 27 個集成,覆蓋 Shopify、Salesforce、Stripe、Gusto 等,該產品自 5 月上線以來安裝量超過 90 萬次。工作流默認處於審批模式,所有發送、發佈或付款需用戶確認;今秋將在 10 個美國城市舉辦免費工作坊,14 個集成夥伴從 9 月底到 11 月各舉辦一場免費網絡研討會。
TIP來源:Claude:Blog(網頁)
🏛️ 行業動態
1. Perplexity 自研 CobbleDB 替代 AWS DynamoDB,每年最多可節省一億美元
Perplexity CEO Aravind Srinivas 宣佈自研鍵值數據庫 CobbleDB,替代 AWS DynamoDB 用於快速網頁內容抓取,遷移後每年最多可節省一億美元。該項目由兩名工程師和數百個持續運行的 Computer 智能體在兩個月內完成核心基礎設施,官方研究稱熱存儲批次讀取延遲較 DynamoDB 全分佈下降約 5 倍(P50 從 31.4ms 降至 5.60ms)。
TIP來源:X:Aravind Srinivas(Perplexity CEO) (@AravSrinivas)
💡 技巧與觀點
1. Gergely Orosz 探訪 OpenAI:Codex 驅動的智能體軟件工廠
Gergely Orosz 實地探訪 OpenAI 總部並訪談七位工程師與工程負責人,發現自約一月起 Codex 和 ChatGPT Work 已成為公司幾乎所有工作的基礎。
TIP來源:Pragmatic Engineer
2. Anthropic 與 OpenAI 提議協調放緩前沿 AI 開發,Cohere CEO 等批評者質疑其真實動機
Anthropic CEO Dario Amodei 呼籲行業與政府協調放緩前沿 AI 開發,並尋求反壟斷豁免,Sam Altman 與 Elon Musk 表示同意。
TIP來源:The Decoder:AI News
3. 404 Media 曝光 OpenAI 莉莉計劃:人工審核 ChatGPT 聊天記錄以優化模型
404 Media 披露 OpenAI 內部代號為莉莉計劃(Project Lily)的項目,由時薪超 50 美元的提示詞審核員查看匿名化後的真實用戶聊天記錄,評判回覆是否切題、是否存在 AI 式話術和諂媚口吻。
TIP來源:IT之家
4. Arena 更新 Image-to-WebDev 榜單:GPT-6 Astra 以 1733 分登頂
Arena 更新 Image-to-WebDev 排行榜,納入四個新評測模型。GPT-6 Astra (Max) 以 1733 分居第一,領先 GPT-5.6 Sol (xHigh) 129 分;Claude Fable 5.1 (Max) 以 1710 分排第二,Muse Spark 1.3 (Max) 1645 分第四,GLM-5.3-Flash 1588 分第十。
TIP來源:X:Arena (@arena)
5. Artificial Analysis 評測:GPT-Live-1 以 81.5 分登頂 Speech to Speech Index
Artificial Analysis 發佈 Speech to Speech Index,OpenAI 的 GPT-Live-1 以 81.5 分(Astra 後端,medium 推理強度)排名第一,超過 Grok Voice Think Fast 2.0 High 的 81.3;Sol 後端配置得 80.1 排第三。
TIP來源:X:Artificial Analysis (@ArtificialAnlys)
6. Trail of Bits 批評 1Password 的 AI 補丁基準存在誤導,併發布兩個補丁驗證 Agent 技能
Trail of Bits 發文批評 1Password 8月6日發佈的 FLAWED 報告,稱其 26% 的 AI 乾淨修復率受四項實驗設計選擇影響而失真,包括刻意指示智能體應用錯誤修復的提示詞佔 22% 數據、36% 的試驗禁止編譯測試,以及不同推理檔位設置。
TIP來源:Trail of Bits:AI安全研究
7. Vercel 將 inbound 銷售團隊從 10 人壓縮至 1.25 人,AI 銷售開發智能體年成本僅數千美元
Vercel COO Jeanne DeWitt Grosser 在 The Information 訪談中表示,公司 inbound 銷售開發已實現 90% 自動化,團隊從 10 人壓縮至 1.25 人。
TIP來源:Tomer Tunguz 博客(VC 分析)