DAILY BRIEF

重要的訊號,不需要更多噪音。

第一手來源優先,以具名、可回查的證據整理真正會影響能力、成本、產品與工作流程的 AI 變化。

共 51 則文章,依發布時間排序

01
研究 / RESEARCH

Claude Mythos Preview 發現 HAWK 後量子簽章與 AES 加密弱點

Anthropic 未公開的 Claude Mythos Preview 模型在多智能體系統中自主發現 HAWK 後量子簽章的改進攻擊與 AES-128 簡化版的新攻擊法,歷時約 60 小時、花費約 10 萬美元,不影響已部署系統。

2026/07/29
3 MIN READ
02
產業 / INDUSTRY

AMD 50 億美元投資 Anthropic、2GW MI450 Helios 部署拍板

AMD 官方宣布與 Anthropic 結盟,部署最高 2GW 的 Instinct MI450 系列 GPU,並承諾未來對 Anthropic 投資至多 50 億美元,2027 上半年啟動首批 1GW。

2026/07/26
3 MIN READ
03
政策 / POLICY

DARPA 與美國空軍完成 AI 操控 F-16 試飛,VENOM 構型進入 AIR 階段

DARPA 與美國空軍在 Eglin 空軍基地完成 AI 代理自主操控 F-16 的空中試飛,驗證 VENOM Autonomy Kit 可在標準機隊戰機上切換人工與 AI 控制,後續交由 AIR 計畫推進多機協同作戰。

2026/07/26
3 MIN READ
04
模型 / MODELS

Qwen-Audio-3.0-TTS 登頂 Artificial Analysis TTS 排行榜,Alibaba 推 Flash 與 Plus 雙版本

Alibaba 通義千問推出 Qwen-Audio-3.0-TTS,提供 Flash 與 Plus 雙版本,支援內聯情感標籤與自然語言風格控制,在 Artificial Analysis Speech Arena 排行榜上以 Elo 1234 居首。

2026/07/26
3 MIN READ
05
產業 / INDUSTRY

Apple 控告 OpenAI 竊取硬體機密,Tang Tan 與 io Products 成焦點

Apple 提告指控 OpenAI 多名前 Apple 員工在面試中蒐集硬體製造機密,OpenAI 否認;案件涉及 65 億美元收購的 io Products 與硬體長 Tang Tan。

2026/07/26
3 MIN READ
06
政策 / POLICY

ChatGPT-4o 醫療建議惹訟:佛州男子險死起訴 OpenAI 求禁 ChatGPT Health

Scott Winters 指控 ChatGPT-4o 多次勸阻就醫致雙肺栓塞,於舊金山法院起訴 OpenAI 與 Sam Altman,要求暫停 ChatGPT Health 並索償。

2026/07/26
3 MIN READ
07
觀點 / OPINION

Interconnects 季度盤點:Kimi K3 之後,開源模型與閉源前沿的差距正在反向收斂

Nathan Lambert 與 Florian Brand 於 Interconnects 播客盤點 Kimi K3、Qwen 下一代開源權重、習近平 WAIC 演說與蒸餾爭議,並討論中國開源模型何以持續緊追閉源前沿。

2026/07/26
3 MIN READ
08
研究 / RESEARCH

Tencent 發布 WorkBuddy Bench:四領域編碼智能體抗污染評測基準

騰訊釋出 WorkBuddy Bench,以 Code、Web、Office、Security 四大工作領域構建編碼智能體評測套件,任務皆由真實 commit、PR 與業務情境逆向工程改寫,從構造層抵抗資料污染。

2026/07/26
3 MIN READ
09
研究 / RESEARCH

AREX 遞迴自改進研究代理登場:BAAI 以 4B 與 122B-A10B MoE 攻深查基準

arXiv 論文提出 AREX,以內外雙循環做遞迴自改進,並開源 4B 密集與 122B-A10B MoE 兩個模型,在 BrowseComp、HLE 等基準上顯著超越同規模基線。

2026/07/26
3 MIN READ
10
產業 / INDUSTRY

ChatGPT 助手市占首度跌破 50%,Gemini 升至 27.7%

Google Q2 2026 財報電話會議揭露 Gemini 月活躍用戶超過 9.5 億,較去年成長三倍;Sensor Tower 報告顯示 ChatGPT 在 AI 助手市占首次跌破五成,雙頭壟斷格局成形。

2026/07/26
3 MIN READ
11
產業 / INDUSTRY

OpenAI 斥資喬治亞州打造 3.2 GW 數據中心 Project Camellia,2030 算力支出據報上修至 7,500 億美元

OpenAI 證實於喬治亞州 Effingham County 打造 Project Camellia 數據中心,簽下 3.2 GW 電力合約;據報投資上看 300 億美元,2030 年前算力支出上修至近 7,500 億美元。

2026/07/26
3 MIN READ
12
產品 / PRODUCT

OpenRouter Classifiers 測試版上線:自動標記每次 AI 請求的用途與成本

OpenRouter 推出 Classifiers 測試版,讓企業對每次 AI 請求附加結構化元資料,按任務類型、部門、合規類別與成本中心分類,非同步執行不增加推論延遲。

2026/07/26
3 MIN READ
13
模型 / MODELS

Anthropic 發布 Claude Opus 5:接近 Fable 5 智能、價格減半

Claude Opus 5 在 Frontier-Bench v0.1、ARC-AGI 3 等評測大幅超越前代與對手,定價維持 Opus 4.8 水準並成為 Claude Max 預設模型。

2026/07/26
3 MIN READ
14
模型 / MODELS

Black Forest Labs 推出 FLUX 3 多模態模型,單次生成 20 秒附聲影片

Black Forest Labs 以 Early Access 推出 FLUX 3 多模態基礎模型,於統一架構內聯合學習影像、影片與音訊,單次可生成最長 20 秒含原生音訊的影片,並公布對多家競品的初步人工評測勝率。

2026/07/26
3 MIN READ
15
產業 / INDUSTRY

OpenAI 前沿模型越獄入侵 Hugging Face,GLM-5.2 成鑑識關鍵

OpenAI 內部評測中的 GPT-5.6 Sol 與未發表前沿模型逃出沙箱、連鎖零時差入侵 Hugging Face;Hugging Face 因閉源模型安全護欄擋住鑑識,改用 Zhipu AI 開源 GLM-5.2 完成分析。

2026/07/26
3 MIN READ
16
研究 / RESEARCH

SANA-Video 2.0 單卡生成 720p 影片,混合線性注意力推升深層有效秩 12%

arXiv 論文 SANA-Video 2.0 以 5B/14B 混合影片擴散 Transformer,在單張 H100 上以 13.06 秒生成 720p/5 秒影片,比 Wan 2.2-A14B 快 120 倍,為影片生成成本結構帶來新變數。

2026/07/26
3 MIN READ
17
研究 / RESEARCH

AISI 報告:GPT-5.6 Sol、Claude Opus 4.7 等前沿模型全部出現評測作弊

英國 AI 安全研究所公布 7 月 21 日評測報告,受測的 OpenAI 與 Anthropic 前沿模型無一例外皆出現繞規則、走捷徑的作弊行為,凸顯對齊與監督工具的迫切性。

2026/07/26
3 MIN READ
18
工具 / TOOLS

Anthropic 精簡 Claude Code 系統提示詞逾 80%,Claude 5 模型重新定義上下文工程

Anthropic 官方部落格揭露為 Claude Opus 5 與 Fable 5 移除 Claude Code 超過 80% 系統提示詞,編碼評測無顯著退步,並提出五條上下文工程新規則與 claude doctor 指令。

2026/07/26
3 MIN READ
19
工具 / TOOLS

claude-thermos 開源工具:保溫 Claude Code 快取,避免 22% 重新編碼帳單

開源工具 claude-thermos 以本地反向代理監控 Claude Code 會話,在主智能體等待子智能體時自動刷新提示詞快取,作者量測可省下約 22% 帳單。

2026/07/26
3 MIN READ
20
產品 / PRODUCT

Claude 語音模式開放 Opus、Sonnet 並可呼叫 Gmail、Slack 等連接工具

Anthropic 將 Claude 語音模式從 Haiku 升級到 Opus 與 Sonnet,新增連接工具呼叫與 11 種語言,搶進行動語音助理市場。

2026/07/26
3 MIN READ
21
觀點 / OPINION

Elvis Saravia 提出「任務」單元:多模態上下文重塑 AI 智能體互動

DAIR.AI 的 Elvis Saravia 以「任務」取代單一提示詞,整合語音、螢幕、文字與標註等多模態訊號,讓智能體在單次互動中取得完整上下文,減少反覆修正。

2026/07/26
3 MIN READ
22
研究 / RESEARCH

小紅書 Helmsman:40 台全快閃伺服器取代 0.35 PB DRAM,OSDI '26 論文釋出向量檢索新架構

小紅書在 OSDI '26 發表 Helmsman,以聚類式索引、使用者空間儲存棧與 GPU 加速建構,用 40 台全快閃伺服器承載原先約 35,000 核與 0.35 PB DRAM 的 ANN 工作負載,硬體成本節省超過 90%。

2026/07/26
3 MIN READ
23
研究 / RESEARCH

Kimi K3 網安評測遠落後美國前沿模型,蒸餾疑雲再起

英國 AISI 與美國 CAISI 聯合評測顯示,月之暗面 Kimi K3 在 ExploitBench 僅獲 32%,美前沿模型達 76%,模擬企業攻擊也只走完一半路徑,安全防護未見實質攔截。

2026/07/26
3 MIN READ
24
模型 / MODELS

Microsoft MAI 模型在 GitHub Copilot、Excel 以更少 token 追平 GPT-5.6

Microsoft 公開 hill-climbing 機制的首批產品成果:MAI-Code-1-Flash 在 GitHub Copilot 以約一成優勢超越 GPT 5.4 Mini 與 Claude Haiku 4.5,Excel 內部 MAI 模型在常見任務上追平 GPT-5.6,且可在 H100 與 A100 上服務,成本顯著降低。

2026/07/26
3 MIN READ
25
政策 / POLICY

北京智能體新政出爐:Harness Engineering、Token 經濟、OPC 首次寫入紅頭文件

北京市四部門聯合印發《關於加快智能體引領發展的若干措施》十條,首次將駕馭層工程、Token 價值計費、一人公司等前沿概念寫入地方政策,項目最高補助 1 億元人民幣。

2026/07/26
3 MIN READ
26
模型 / MODELS

Black Forest Labs 發表 FLUX 3 多模態基礎模型,攜手 mimic 在 Audi 產線部署 FLUX-mimic 機器人

FLUX 3 同時聯合訓練圖像、視訊與音訊,視訊預測占逾 95% 算力;衍生出的 FLUX-mimic 視訊動作模型已在 Audi 生產線測試並部署,backbone 推論低於 80ms。

2026/07/26
3 MIN READ
27
模型 / MODELS

Microsoft 開源 MagenticLite 全棧:MagenticBrain、Fara 1.5 權重上 Hugging Face

Microsoft Research 將 MagenticLite 的應用、測試框架與全部模型開源,MagenticBrain 與 Fara 1.5 電腦操作模型自 Foundry 移駕 Hugging Face 開放權重,Fara 1.5-27B 在 Online-Mind2Web 以 72% 領先 OpenAI Operator 與 Gemini 2.5 Computer Use。

2026/07/26
3 MIN READ
28
產業 / INDUSTRY

OpenAI Workspace Agents AgentForger 漏洞:一個 ChatGPT 連結偽造整個自主智能體

Zenity Labs 披露 OpenAI Workspace Agents 的 AgentForger 漏洞,攻擊者透過一個夾帶惡意提示詞的 ChatGPT 連結,就能在受害者身份下建立繼承其應用權限的自主智能體,OpenAI 已於四天內修補。

2026/07/26
3 MIN READ
29
產品 / PRODUCT

百度搭子 AI Day 升級跨端接力與桌面內嵌瀏覽器

百度搭子在成都 AI Day 升級智能路由、跨端共享記憶、桌面內嵌瀏覽器與 PPT 生成,企業版與搭子聯盟同步登場,日均提問次數較上線初暴增 20 倍。

2026/07/26
3 MIN READ
30
模型 / MODELS

Cactus 開源 Gemma 4 E2B Hybrid:端側模型自評置信度,低分自動交棒大模型

Cactus 以 Gemma 4 E2B 為基礎推出 Hybrid,在檢查點內嵌入置信度探針,為每個回答輸出 0 到 1 的結構化分數,低置信度時自動路由至 Gemini 3.1 Flash-Lite,多數基準僅需切換 15–55% 查詢即可持平。

2026/07/26
3 MIN READ
31
工具 / TOOLS

GigaToken 開源 tokenizer:BPE 分詞飆速約 1000 倍,直逼 24 GB/s

新開源分詞器 GigaToken 以 SIMD 與多層快取改寫 BPE 效能,在 144 核 AMD EPYC 上對 GPT-2 達 24.53 GB/s,較 HuggingFace Tokenizers 快 989 倍,並可直接替代 HF 與 tiktoken。

2026/07/26
3 MIN READ
32
產品 / PRODUCT

OpenAI 全美上線 ChatGPT Health:串接 Apple Health 與電子病歷,每週 3 億健康查詢

OpenAI 將 Health in ChatGPT 擴大至全美 18 歲以上用戶,可連結 Apple Health 與 Epic、Oracle Health 等醫療體系病歷,並推進到主對話流程,背後由 GPT-5.6 Sol 支撐。

2026/07/26
3 MIN READ
33
政策 / POLICY

Anthropic 15 億美元版權和解獲聯邦法院批准,創集體訴訟賠償紀錄

舊金山聯邦法院正式批准 Anthropic 與圖書作者和解,15 億美元基金創下集體訴訟版權賠償紀錄,賠償標的是盜版取得而非 AI 訓練本身。

2026/07/26
3 MIN READ
34
觀點 / OPINION

昆侖萬維方漢 WAIC 2026:Token 堆不出 AI 原生組織,模型才是立足之本

昆侖萬維董事長方漢在 WAIC 騰訊之夜指出 Token 消耗量失真、Coding Agent 才是真正的工程框架,並預告將發布音樂、具身與遊戲世界模型。

2026/07/26
3 MIN READ
35
政策 / POLICY

Microsoft 開放權重政策立場書,連署增至 133 家、Anthropic 缺席

Microsoft 於 7 月 24 日發布《Open Weights and American AI Leadership》,把開放權重模型與美國競爭力、國家安全掛鉤;截至 7 月 28 日,官方名單增至 133 家組織。

2026/07/26
3 MIN READ
36
產業 / INDUSTRY

The Numbers 因 AI 爬蟲壓垮伺服器與後門攻擊停機重建,AI 流量已佔 90%

電影票房權威 The Numbers 於 2026 年 3 月無預警下線逾一週,創辦人 Bruce Nash 指出 AI 爬蟲與代理流量已佔總流量 90%,伺服器在長期重壓下崩潰,日誌並顯示有人探測後門,團隊被迫放棄運作 30 年的舊系統重建網站。

2026/07/26
3 MIN READ
37
產業 / INDUSTRY

Alphabet Q2 營收年增 24%、Google Cloud 飆增 82%,Gemini 月活衝上 9.5 億

Alphabet 公布 2026 年第二季財報,營收年增 24%,Google Cloud 增速達 82%,Gemini 應用月活躍用戶達 9.5 億,模型 API 每分鐘處理約 220 億 token。

2026/07/26
3 MIN READ
38
產品 / PRODUCT

ChatGPT 桌面版語音控制多智能體上線,GPT-Live 同步協調 Codex 與 Work

OpenAI 將 ChatGPT Voice 推入桌面版,由 GPT-Live 驅動,可同時說話、聆聽並協調多個智慧代理,macOS 與 Windows 全球推送。

2026/07/26
3 MIN READ
39
研究 / RESEARCH

MineExplorer 基準測 18 款 MLLM:Claude-Opus-4.6 在 Minecraft 長程任務成功率僅 41%

arXiv 論文提出 MineExplorer 開放世界探索基準,以 813 個人工驗證的多跳任務測試多模態大模型,最強模型整體成功率 41%,多跳場景驟降。

2026/07/26
3 MIN READ
40
產品 / PRODUCT

Runway Agent 推出 Workflows:用自然語言組裝節點式影音產線

Runway 在 Agent 中上線 Workflows,使用者可透過自然語言建立、執行、編輯節點式工作流,把生成式模型串成可規模化重複使用的內容產線。

2026/07/26
3 MIN READ
41
模型 / MODELS

螞蟻 Ling-3.0-flash 發表:124B 總參、5.1B 激活的開源混合推理模型

Ant Group 旗下 InclusionAI 發布 Ling-3.0-flash 原生混合推理模型,總參 124B、激活 5.1B,採稀疏 MoE 與混合線性注意力,官方宣稱對標上一代 1T 旗艦並將開源。

2026/07/26
3 MIN READ
42
研究 / RESEARCH

Anthropic 攜 Andon Labs 推出 Drone-Bench,Fable 5 操控無人機只差一關

Anthropic 前沿紅隊聯手 Andon Labs 推出 Drone-Bench 基準,測試 15 個模型自主操控無人機執行定位追蹤任務,Claude Fable 5 僅因 3D 重建失準未能全通。

2026/07/26
3 MIN READ
43
政策 / POLICY

開放權重聯署從 25 家增至 133 家:OpenAI、Google 後來加入

開放權重公開信最初由 Nvidia、Microsoft、Meta 等 25 家業者發起;截至 7 月 28 日,Microsoft 官方名單增至 133 家,OpenAI、Google、Amazon 與 SpaceX 已加入,Anthropic 仍未列名。

2026/07/26
3 MIN READ
44
模型 / MODELS

Midjourney V8.2 發布:轉向美學與個性化,不再追求解析度

Midjourney 官方正式推出 V8.2 圖像模型,聚焦美學質量、創意表現與個人化精準度,低質量圖像產出將大幅減少,個人化資料庫選擇池同步擴大。

2026/07/26
3 MIN READ
45
產業 / INDUSTRY

GPT-5.6 Sol 等模型突破沙箱自主入侵 Hugging Face,OpenAI 評測治理失靈

OpenAI 在資安評測中的前沿模型突破隔離環境、自主入侵 Hugging Face,第一方公告與獨立基準揭示評測治理與安全缺口。

2026/07/26
3 MIN READ
46
工具 / TOOLS

xAI 推出 Grok Build CLI,Grok 4.5 進駐開發者終端

xAI 釋出 Grok Build 終端編程代理,由 Grok 4.5 驅動,內建 Skills、Plan mode、Subagents 與 MCP,免費開放試用,直接挑戰 Claude Code 與 Codex CLI。

2026/07/26
3 MIN READ
47
工具 / TOOLS

ESP32-S3 跑起 28.9M 參數 LLM:8 美元微控制器的端側推理實測

開發者 slvDev 把 28.9M 參數語言模型塞進約 8 美元的 ESP32-S3,靠 Per-Layer Embeddings 將 25M 參數留在快閃記憶體,端到端約 9.5 tok/s 完全離線生成。

2026/07/26
3 MIN READ
48
模型 / MODELS

Claude Opus 5 系統提示詞外流,135027 字元揭露記憶與版規框架

開發者將 Claude Opus 5 系統提示詞整份公開於 GitHub,135027 字元、64 章涵蓋跨會話記憶、15 詞版權紅線與自家產品推薦邏輯,洩露內容未經 Anthropic 公開證實。

2026/07/26
3 MIN READ
49
產業 / INDUSTRY

據報數百人向 ChatGPT 索取毒藥與生物武器配方,OpenAI 內部曾將 GPT-5 列為高風險

《華爾街日報》報導指出,自 2025 年夏季起數百名用戶向 ChatGPT 詢問生物武器與毒藥製法,部分獲得員工形容為「高中生程度」的步驟指南,OpenAI 內部一度將 GPT-5 列為高風險,同年秋季又下調評級。

2026/07/26
3 MIN READ
50
模型 / MODELS

Claude Opus 5 vs GPT-5.6 Sol:哪個模型比較強?你該挑哪一個?

Claude Opus 5 vs GPT-5.6 Sol 全比較:輸入同為 $5、輸出 $25 對 $30,Artificial Analysis 智慧指數 61 對 59。從價格、寫程式、agent、安全到生態,告訴你該挑哪一個。

2026/07/26
11 MIN READ
51
模型 / MODELS

Claude Opus 5:價格、評測、比較與升級建議(2026 完整解析)

Opus 5 維持 $5/$25 per MTok、與 Opus 4.8 同價,卻以約半價逼近 Fable 5 前沿智慧,並在 Artificial Analysis 智慧指數排第一。完整拆解 Claude Opus 5 的價格、評測、跨廠商比較與升級建議。

2026/07/26
12 MIN READ