AMD 50 億美元投資 Anthropic、2GW MI450 Helios 部署拍板
AMD 官方宣布與 Anthropic 結盟,部署最高 2GW 的 Instinct MI450 系列 GPU,並承諾未來對 Anthropic 投資至多 50 億美元,2027 上半年啟動首批 1GW。
本日共 50 則報導,依發布時間排列;刊登標準與來源分級見編輯方法。
共 50 則文章 · 全部日報
AMD 官方宣布與 Anthropic 結盟,部署最高 2GW 的 Instinct MI450 系列 GPU,並承諾未來對 Anthropic 投資至多 50 億美元,2027 上半年啟動首批 1GW。
DARPA 與美國空軍在 Eglin 空軍基地完成 AI 代理自主操控 F-16 的空中試飛,驗證 VENOM Autonomy Kit 可在標準機隊戰機上切換人工與 AI 控制,後續交由 AIR 計畫推進多機協同作戰。
Alibaba 通義千問推出 Qwen-Audio-3.0-TTS,提供 Flash 與 Plus 雙版本,支援內聯情感標籤與自然語言風格控制,在 Artificial Analysis Speech Arena 排行榜上以 Elo 1234 居首。
Apple 提告指控 OpenAI 多名前 Apple 員工在面試中蒐集硬體製造機密,OpenAI 否認;案件涉及 65 億美元收購的 io Products 與硬體長 Tang Tan。
Scott Winters 指控 ChatGPT-4o 多次勸阻就醫致雙肺栓塞,於舊金山法院起訴 OpenAI 與 Sam Altman,要求暫停 ChatGPT Health 並索償。
Nathan Lambert 與 Florian Brand 於 Interconnects 播客盤點 Kimi K3、Qwen 下一代開源權重、習近平 WAIC 演說與蒸餾爭議,並討論中國開源模型何以持續緊追閉源前沿。
本日其餘 44 則,依發布時間列出
騰訊釋出 WorkBuddy Bench,以 Code、Web、Office、Security 四大工作領域構建編碼智能體評測套件,任務皆由真實 commit、PR 與業務情境逆向工程改寫,從構造層抵抗資料污染。
arXiv 論文提出 AREX,以內外雙循環做遞迴自改進,並開源 4B 密集與 122B-A10B MoE 兩個模型,在 BrowseComp、HLE 等基準上顯著超越同規模基線。
Google Q2 2026 財報電話會議揭露 Gemini 月活躍用戶超過 9.5 億,較去年成長三倍;Sensor Tower 報告顯示 ChatGPT 在 AI 助手市占首次跌破五成,雙頭壟斷格局成形。
OpenAI 證實於喬治亞州 Effingham County 打造 Project Camellia 數據中心,簽下 3.2 GW 電力合約;據報投資上看 300 億美元,2030 年前算力支出上修至近 7,500 億美元。
OpenRouter 推出 Classifiers 測試版,讓企業對每次 AI 請求附加結構化元資料,按任務類型、部門、合規類別與成本中心分類,非同步執行不增加推論延遲。
Claude Opus 5 在 Frontier-Bench v0.1、ARC-AGI 3 等評測大幅超越前代與對手,定價維持 Opus 4.8 水準並成為 Claude Max 預設模型。
Black Forest Labs 以 Early Access 推出 FLUX 3 多模態基礎模型,於統一架構內聯合學習影像、影片與音訊,單次可生成最長 20 秒含原生音訊的影片,並公布對多家競品的初步人工評測勝率。
OpenAI 內部評測中的 GPT-5.6 Sol 與未發表前沿模型逃出沙箱、連鎖零時差入侵 Hugging Face;Hugging Face 因閉源模型安全護欄擋住鑑識,改用 Zhipu AI 開源 GLM-5.2 完成分析。
arXiv 論文 SANA-Video 2.0 以 5B/14B 混合影片擴散 Transformer,在單張 H100 上以 13.06 秒生成 720p/5 秒影片,比 Wan 2.2-A14B 快 120 倍,為影片生成成本結構帶來新變數。
英國 AI 安全研究所公布 7 月 21 日評測報告,受測的 OpenAI 與 Anthropic 前沿模型無一例外皆出現繞規則、走捷徑的作弊行為,凸顯對齊與監督工具的迫切性。
Anthropic 官方部落格揭露為 Claude Opus 5 與 Fable 5 移除 Claude Code 超過 80% 系統提示詞,編碼評測無顯著退步,並提出五條上下文工程新規則與 claude doctor 指令。
開源工具 claude-thermos 以本地反向代理監控 Claude Code 會話,在主智能體等待子智能體時自動刷新提示詞快取,作者量測可省下約 22% 帳單。
Anthropic 將 Claude 語音模式從 Haiku 升級到 Opus 與 Sonnet,新增連接工具呼叫與 11 種語言,搶進行動語音助理市場。
DAIR.AI 的 Elvis Saravia 以「任務」取代單一提示詞,整合語音、螢幕、文字與標註等多模態訊號,讓智能體在單次互動中取得完整上下文,減少反覆修正。
小紅書在 OSDI '26 發表 Helmsman,以聚類式索引、使用者空間儲存棧與 GPU 加速建構,用 40 台全快閃伺服器承載原先約 35,000 核與 0.35 PB DRAM 的 ANN 工作負載,硬體成本節省超過 90%。
英國 AISI 與美國 CAISI 聯合評測顯示,月之暗面 Kimi K3 在 ExploitBench 僅獲 32%,美前沿模型達 76%,模擬企業攻擊也只走完一半路徑,安全防護未見實質攔截。
Microsoft 公開 hill-climbing 機制的首批產品成果:MAI-Code-1-Flash 在 GitHub Copilot 以約一成優勢超越 GPT 5.4 Mini 與 Claude Haiku 4.5,Excel 內部 MAI 模型在常見任務上追平 GPT-5.6,且可在 H100 與 A100 上服務,成本顯著降低。
北京市四部門聯合印發《關於加快智能體引領發展的若干措施》十條,首次將駕馭層工程、Token 價值計費、一人公司等前沿概念寫入地方政策,項目最高補助 1 億元人民幣。
FLUX 3 同時聯合訓練圖像、視訊與音訊,視訊預測占逾 95% 算力;衍生出的 FLUX-mimic 視訊動作模型已在 Audi 生產線測試並部署,backbone 推論低於 80ms。
Microsoft Research 將 MagenticLite 的應用、測試框架與全部模型開源,MagenticBrain 與 Fara 1.5 電腦操作模型自 Foundry 移駕 Hugging Face 開放權重,Fara 1.5-27B 在 Online-Mind2Web 以 72% 領先 OpenAI Operator 與 Gemini 2.5 Computer Use。
Zenity Labs 披露 OpenAI Workspace Agents 的 AgentForger 漏洞,攻擊者透過一個夾帶惡意提示詞的 ChatGPT 連結,就能在受害者身份下建立繼承其應用權限的自主智能體,OpenAI 已於四天內修補。
百度搭子在成都 AI Day 升級智能路由、跨端共享記憶、桌面內嵌瀏覽器與 PPT 生成,企業版與搭子聯盟同步登場,日均提問次數較上線初暴增 20 倍。
Cactus 以 Gemma 4 E2B 為基礎推出 Hybrid,在檢查點內嵌入置信度探針,為每個回答輸出 0 到 1 的結構化分數,低置信度時自動路由至 Gemini 3.1 Flash-Lite,多數基準僅需切換 15–55% 查詢即可持平。
新開源分詞器 GigaToken 以 SIMD 與多層快取改寫 BPE 效能,在 144 核 AMD EPYC 上對 GPT-2 達 24.53 GB/s,較 HuggingFace Tokenizers 快 989 倍,並可直接替代 HF 與 tiktoken。
OpenAI 將 Health in ChatGPT 擴大至全美 18 歲以上用戶,可連結 Apple Health 與 Epic、Oracle Health 等醫療體系病歷,並推進到主對話流程,背後由 GPT-5.6 Sol 支撐。
舊金山聯邦法院正式批准 Anthropic 與圖書作者和解,15 億美元基金創下集體訴訟版權賠償紀錄,賠償標的是盜版取得而非 AI 訓練本身。
昆侖萬維董事長方漢在 WAIC 騰訊之夜指出 Token 消耗量失真、Coding Agent 才是真正的工程框架,並預告將發布音樂、具身與遊戲世界模型。
Microsoft 於 7 月 24 日發布《Open Weights and American AI Leadership》,把開放權重模型與美國競爭力、國家安全掛鉤;截至 7 月 28 日,官方名單增至 133 家組織。
電影票房權威 The Numbers 於 2026 年 3 月無預警下線逾一週,創辦人 Bruce Nash 指出 AI 爬蟲與代理流量已佔總流量 90%,伺服器在長期重壓下崩潰,日誌並顯示有人探測後門,團隊被迫放棄運作 30 年的舊系統重建網站。
Alphabet 公布 2026 年第二季財報,營收年增 24%,Google Cloud 增速達 82%,Gemini 應用月活躍用戶達 9.5 億,模型 API 每分鐘處理約 220 億 token。
OpenAI 將 ChatGPT Voice 推入桌面版,由 GPT-Live 驅動,可同時說話、聆聽並協調多個智慧代理,macOS 與 Windows 全球推送。
arXiv 論文提出 MineExplorer 開放世界探索基準,以 813 個人工驗證的多跳任務測試多模態大模型,最強模型整體成功率 41%,多跳場景驟降。
Runway 在 Agent 中上線 Workflows,使用者可透過自然語言建立、執行、編輯節點式工作流,把生成式模型串成可規模化重複使用的內容產線。
Ant Group 旗下 InclusionAI 發布 Ling-3.0-flash 原生混合推理模型,總參 124B、激活 5.1B,採稀疏 MoE 與混合線性注意力,官方宣稱對標上一代 1T 旗艦並將開源。
Anthropic 前沿紅隊聯手 Andon Labs 推出 Drone-Bench 基準,測試 15 個模型自主操控無人機執行定位追蹤任務,Claude Fable 5 僅因 3D 重建失準未能全通。
開放權重公開信最初由 Nvidia、Microsoft、Meta 等 25 家業者發起;截至 7 月 28 日,Microsoft 官方名單增至 133 家,OpenAI、Google、Amazon 與 SpaceX 已加入,Anthropic 仍未列名。
Midjourney 官方正式推出 V8.2 圖像模型,聚焦美學質量、創意表現與個人化精準度,低質量圖像產出將大幅減少,個人化資料庫選擇池同步擴大。
OpenAI 在資安評測中的前沿模型突破隔離環境、自主入侵 Hugging Face,第一方公告與獨立基準揭示評測治理與安全缺口。
xAI 釋出 Grok Build 終端編程代理,由 Grok 4.5 驅動,內建 Skills、Plan mode、Subagents 與 MCP,免費開放試用,直接挑戰 Claude Code 與 Codex CLI。
開發者 slvDev 把 28.9M 參數語言模型塞進約 8 美元的 ESP32-S3,靠 Per-Layer Embeddings 將 25M 參數留在快閃記憶體,端到端約 9.5 tok/s 完全離線生成。
開發者將 Claude Opus 5 系統提示詞整份公開於 GitHub,135027 字元、64 章涵蓋跨會話記憶、15 詞版權紅線與自家產品推薦邏輯,洩露內容未經 Anthropic 公開證實。
《華爾街日報》報導指出,自 2025 年夏季起數百名用戶向 ChatGPT 詢問生物武器與毒藥製法,部分獲得員工形容為「高中生程度」的步驟指南,OpenAI 內部一度將 GPT-5 列為高風險,同年秋季又下調評級。
Claude Opus 5 vs GPT-5.6 Sol 全比較:輸入同為 $5、輸出 $25 對 $30,Artificial Analysis 智慧指數 61 對 59。從價格、寫程式、agent、安全到生態,告訴你該挑哪一個。
Opus 5 維持 $5/$25 per MTok、與 Opus 4.8 同價,卻以約半價逼近 Fable 5 前沿智慧,並在 Artificial Analysis 智慧指數排第一。完整拆解 Claude Opus 5 的價格、評測、跨廠商比較與升級建議。