2910 字
5 分鐘
最後更新於 剛剛
📰 科技風向標 · 2026-08-05
Cover image for 📰 科技風向標 · 2026-08-05

🧠 模型發佈/更新#

1. NVIDIA Alpamayo 2 Super 開放商用,面向 Robotaxi 與自動駕駛的前沿開源模型#

NVIDIA Alpamayo 2 Super 現已開放商用,基於 Cosmos 3 Super Reasoner 構建,採用強化學習後訓練,支持軌跡預測、因果鏈推理、元動作、自動標註及視覺問答等多任務輸出。

TIP

來源:NVIDIA Blog

2. 商湯 SenseNova U1 開源:統一推理與圖像生成#

商湯發佈開源模型 SenseNova U1,可在統一流程中同時進行推理與圖像生成。其信息圖模式可將單條提示詞轉為結構化幻燈片,交錯模式則逐步生成圖文內容,如演示六步畫龍教程。模型已上線 SenseNova Studio、HuggingFace 及 GitHub。

TIP

來源:X:商湯 SenseTime (@SenseTime_AI)

3. OpenRouter 上線 FLUX 3 Video 統一多模態模型#

@bfl_ai 的 FLUX 3 Video 現已在 OpenRouter 上向所有人開放。 一個統一的視頻、音頻、圖像和動作預測多模態模型家族。嚴肅、有趣、創意、真實、電影感,隨你所需。基於統一架構聯合訓練。

TIP

來源:X:OpenRouter (@OpenRouter)

4. 螞蟻百靈發佈Ling-3.0-flash開源權重#

今天,我們發佈了 Ling-3.0-flash 的開源權重。🎉 官方 BF16 和 FP8 量化版本現已可用,您可以根據自己的硬件、性能要求和部署需求選擇最合適的版本。

TIP

來源:X:螞蟻百靈 (@AntLingAGI)

5. 騰訊混元發佈 Hy ASR 3.0 preview:真正懂上下文的語音識別#

騰訊混元發佈新一代語音識別模型 Hy ASR 3.0 preview,基於大語言模型 Hy3 與 MoE 架構,融合高精度識別與語義理解。其在開源評測集中中文普通話 WER 3.34%、英語 WER 2.62%、粵語 WER 3.12%,並支持上下文糾錯、熱詞注入及高噪耳語等場景。該模型已上線騰訊雲 API,元寶 App 首發並免費開放。

TIP

來源:公眾號:騰訊混元

6. FLUX 3 Video, Part 1: Generation FLUX 3 Video, Part 1 August 4, 2026 Read more#

TIP

來源:Black Forest Labs:Blog(網頁)


🚀 產品發佈/更新#

1. Swiftlet:在 Mac 上運行 80B 版 Qwen(內存 4.3 GB),在 iPhone 上運行 35B 版#

Swiftlet 是一個 Swift + Metal 運行時,可在普通 Apple 設備上運行 Qwen3-Next 和 Qwen3.5/3.6 MoE 混合模型,僅將小型稠密核心駐留內存,按需從存儲流式加載路由專家權重。

TIP

來源:Hacker News 熱門(buzzing.cc 中文翻譯)

2. Reflex 開源 XY:基於 Rust 的超快 Python 繪圖庫,可保持 1 億點圖表交互流暢#

Reflex AI 發佈 Apache-2.0 許可的 Python 交互式 2D 繪圖庫 XY,通過 Rust 原生核心、二進制緩衝傳輸和 WebGL2 渲染,在 1 萬至 1 億點範圍內保持約 0.08 秒的渲染時間。

TIP

來源:MarkTechPost

3. 面壁智能開源 ForgeStencil:一週自動優化 100+ 工業與科學軟件,全程零人工介入#

面壁智能聯合 OpenBMB 開源全球首個支持 Stencil 自動研究、自動部署的 AI 優化系統 ForgeStencil,由 Kernel Agent 與 App Agent 閉環協作,實現從算子優化到應用集成的全自動流程。

TIP

來源:公眾號:面壁智能(MiniCPM)

4. Soup v0.72.4:在4 GB顯存筆記本GPU上微調8B模型#

Soup 推出 v0.72.4,支持在配備 4 GB 顯存的筆記本 GPU 上通過 QLoRA 微調 8B 模型,無需 SSH 或雲服務。

TIP

來源:Hacker News 熱門(buzzing.cc 中文翻譯)

5. OpenRouter 推出 ori CLI:為 Claude Code 等 Harness 提供開箱即用的優化配置#

OpenRouter 發佈 ori CLI,用戶安裝並登錄後即可獲得針對 Claude Code、Codex、OpenCode、Hermes 等 harness 的優化配置,省去手動設置大量環境變量的麻煩。

TIP

來源:OpenRouter:Announcements

6. SpecForge v0.3.0 發佈:統一解耦與共置投機解碼棧,新增開放 SpecBundle 草稿模型#

SpecForge v0.3.0 將目標模型推理與草稿模型訓練分離,支持 EAGLE3、EAGLE3.1、P-EAGLE、DFlash、Domino、DSpark 等多種投機解碼算法,並統一在線、離線與解耦工作流。

TIP

來源:LMSYS:Blog(Chatbot Arena 團隊)

7. Replit 環境智能:免提示詞自動生成設計#

你無需提示詞,也無需設計語言。 環境智能(Ambient Intelligence)會在每個畫面旁顯示建議卡片,每張卡片都指向你的設計的一個不同方向。點擊你喜歡的那張,即可看到它生成一個新的畫面。 你再也不必糾結下一步該做什麼。 立即在 http://replit.com/design 體驗。

TIP

來源:X:Replit (@Replit)

8. Cloudflare 讓智能體通過本地追蹤調試 Workers#

Cloudflare 即日起在 wrangler dev 和 vite dev 中自動為本地 Worker 調用捕獲 OpenTelemetry 追蹤,無需安裝 SDK 或配置智能體。智能體可通過 Local Explorer API 查詢追蹤數據,定位失敗操作、修復本地環境並驗證結果。開發者也可在瀏覽器界面 Local Explorer 中可視化查看 spans、時序、錯誤及關聯控制檯日誌。

TIP

來源:Cloudflare Blog


🏛️ 行業動態#

1. Anthropic 與成立僅數月的雲初創公司 Volta 簽署 100 億美元算力協議#

Anthropic 與成立僅數月的雲初創公司 Volta 簽署 100 億美元算力協議,約合每年 17 億美元。Volta 估值 24 億美元,硬件幾乎全為租用:算力來自比特幣礦商 Bitdeer 挪威 121MW 站點,芯片由 Nvidia 供應、Dell 組裝。Anthropic 買的是交付速度,代價是承擔超大規模雲廠商合同從未有過的交易對手風險。

TIP

來源:X:Rohan Paul (@rohanpaul_ai)

2. 工信部發布首部L3/L4自動駕駛系統安全要求強制性國標,2027年7月實施#

工信部組織制定的《智能網聯汽車 自動駕駛系統安全要求》(GB 44721—2026)強制性國家標準獲批發布,擬於2027年7月1日起實施。這是我國首部針對L3級有條件自動駕駛和L4級高度自動駕駛系統的強制性國標,由2024年推薦性國標GB/T 44721—2024升級而來,為自動駕駛產品明確了統一的安全准入基線。

TIP

來源:IT之家

3. GPT-5.6 Luna降價80%永久生效#

有些人顯然誤解了,但 GPT-5.6 Luna 降價 80% 不是臨時噱頭,而是永久的。效率提升不會消失。幸運的是。

TIP

來源:X:Tibo (@thsottiaux)

4. Mariano-Florentino (Tino) Cuéllar 加入 Anthropic 出任首席全球事務官#

Anthropic 任命 Mariano-Florentino (Tino) Cuéllar 為首任首席全球事務官,負責全球政策、國際戰略參與及政府關係事務。Cuéllar 曾任卡內基國際和平基金會主席、加州最高法院法官,並自 2026 年 1 月起擔任 Anthropic 長期利益信託受託人,現已卸任該職務加入公司。

TIP

來源:Anthropic:Newsroom(網頁)

5. OpenAI 說明第三方網絡安全評估事件並公佈新保障措施#

OpenAI 就近期第三方網絡安全評估事件作出說明,並公佈新的保障措施以強化 AI 模型測試與評估流程。相關措施旨在提升模型評估的安全性與可靠性,確保第三方測試在受控環境下進行。

TIP

來源:OpenAI:官網動態

6. AI 領袖提出 SAFE 指南,強化智能體網絡安全透明度#

Linux 基金會發布共享 AI 事件交換(SAFE)指南征求意見稿,旨在將智能體網絡安全事件轉化為全生態共享防護。

TIP

來源:NVIDIA Blog

7. Google 發佈 Gemini 3.6 Flash 等三款新模型及 Gemini Robotics ER 2#

Google 在 7 月推出三款新 Gemini 模型——Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber,面向生產級 AI 智能體,主打更高 token 效率、更低延遲和更可靠性能。

TIP

來源:Google Blog:AI


💡 技巧與觀點#

1. 在單顆 AMD MI300X 上運行 DeepSeek V4 Flash#

一個開源倉庫提供了在單顆 AMD MI300X 上生產運行 DeepSeek-V4-Flash-0731 的完整配置與補丁,無需額外量化或權重卸載。該 304B 參數模型在 192 GB HBM 上實現單流 168.6 tok/s 解碼、8 併發流 542 tok/s 聚合吞吐,並驗證了 256K 上下文。

TIP

來源:Hacker News 熱門(buzzing.cc 中文翻譯)

2. MiniMax-H3 通過 MLX 移植可在 Apple Silicon 上運行#

MiniMax 發佈 MiniMax-H3,一個可接受文本、圖像、音頻和視頻並生成最長 15 秒帶音頻視頻片段的通用全模態生成系統。Python 包 PipeNetwork/minimax-h3-mlx 將其移植到 MLX,支持 Apple Silicon 運行。作者在 M5 Max MacBook Pro 上實測,下載約 115 GB 模型文件,視頻生成耗時不到 45 分鐘。

TIP

來源:Simon Willison 博客

3. 用 NVIDIA SkillSpector、LangGraph、YARA 規則、SARIF 與 CI 策略門構建高級 AI 技能安全審計流水線#

本教程演示如何用 NVIDIA SkillSpector 評估 AI 技能的安全態勢,構建包含乾淨、風險、惡意及 MCP 示例的合成技能市場,並通過 LangGraph 檢查流水線掃描每個技能。

TIP

來源:MarkTechPost

4. Cloudflare 如何用軟件工廠將 Astro 的 GitHub issue 數降至零#

Cloudflare 在 Astro 倉庫上運行自動化 triage 流水線,通過隔離的 AI 子代理復現、診斷並修復 bug,將開放 issue 從 200 多個降至約 30 個,預計下月歸零。該流水線由 issue 標籤驅動,修復後自動發佈預覽版本供用戶驗證。其底層引擎已發展為 Flue,一個開源的平臺無關框架,用於構建持久化智能體與工作流。

TIP

來源:Cloudflare Blog

5. GitHub 如何用堆疊式 Pull Request 拆解 AI 生成的巨型代碼#

GitHub 介紹用堆疊式 Pull Request(stacked PR)解決 AI 編碼智能體生成巨型代碼難以審查的問題。通過將 1,000+ 行的大 diff 按數據、API、接線、UI 拆成 L1-L4 四個獨立分層,每層可分配不同審查者。

TIP

來源:GitHub Blog

6. 如何用 LangSmith 評估語音智能體#

LangChain 官方博客介紹如何用 LangSmith 評估語音智能體,覆蓋執行、結果與來電者體驗三個層面。評估手段包括 LangSmith traces、代碼評估器、LLM judges 和人工審查,幫助開發者系統化驗證語音智能體的實際表現。

TIP

來源:LangChain:Blog

7. 從零開始,教你用Codex搓出屬於你自己的第一個硬件#

作者以零基礎身份,全程通過與Codex對話,從需求討論、電路搭建、代碼燒錄到3D打印組裝,5天內做出一個能提醒久坐的貓爪硬件。文中還介紹了用Agent調試宏鍵盤、以及OpenAI與Work Louder聯名發佈的Codex Micro鍵盤(13個機械按鍵,售價230美元)等案例,強調“幹中學”的AI開發方式。

TIP

來源:公眾號:數字生命卡茲克

8. 傑文斯悖論還能持續嗎:AI 定價分層如何支撐算力需求增長#

科技巨頭高管普遍表示算力供應仍無法滿足需求,但 AI 定價卻在上漲:Anthropic 7 月 24 日發佈的 Fable 5 定價每百萬輸出 token 50 美元,較 Opus 5 翻倍;OpenAI 則在 Fable 5 發佈五天後將 GPT-5.6 Luna 價格下調 80%。

TIP

來源:Tomer Tunguz 博客(VC 分析)

📰 科技風向標 · 2026-08-05
https://illumi.love/posts/日報向/2026-08-05/
作者
𝑰𝒍𝒍𝒖𝒎𝒊糖糖
發布於
2026-08-05
許可協議
🔒CC BY-NC-ND 4.0
分享

如果這篇文章對你有幫助,歡迎分享給更多人!

💬 參與討論
使用 GitHub 帳號登入參與討論