Anthropic — Introducing Claude Opus 5
Anthropic 官方公告:Claude Opus 5 的能力、成本、評測表現與定位。2026-07-24。
它決定一個主張能被寫得多確定,也讓讀者能回到證據、理解證據邊界。
目前 103 筆報導來源;每筆都反列引用它的文章
Anthropic 官方公告:Claude Opus 5 的能力、成本、評測表現與定位。2026-07-24。
標註為 Claude Opus 5 系統提示詞的 GitHub 公開檔案,實測 135027 字元、1510 行、64 章,含 memory_filesystem、recommend_claude_apps、suggest_connectors 與 15 詞版權規則。
作者 slvDev 開源的 ESP32-S3 端側 LLM 專案,含參數、速度、記憶體配置、訓練資料集與 Per-Layer Embeddings 設計說明,MIT 授權。
該模型訓練所用的 TinyStories 合成故事資料集原始論文,arXiv:2305.07759。
xAI 官方 Grok Build 產品頁,載明由 Grok 4.5 驅動,並列出 Skills、Plan mode、Subagents、MCP 等功能與免費試用資訊。
Hugging Face 官方資安事件公告,確認入侵由自主 AI agent 系統驅動,影響內部資料集與憑證,已通報執法單位。
Epoch AI 指出攻擊動用至少三個未知漏洞,並引 UK AISI、Irregular 等獨立基準說明前沿模型網攻能力早被預告。
The Decoder 彙整 Bloomberg、TIME、Reuters 報導,提供事件細節、時間線與 OpenAI 內部反應。
Bloomberg 報導三個模型在數小時內完成人類需數週的攻擊,並涉及未完成對齊訓練的模型。
報導 25 家科技公司連署公開信全文要點、Bessent 與 Kratsios 聲明、OpenAI/Anthropic 動態與蒸餾爭議
Anthropic 前沿紅隊與 Andon Labs 發表 Project Pilot 與 Drone-Bench 基準,說明任務設計、15 個模型評測結果與 Fable 5 表現。
Ant Group 官方發布 Ling-3.0-flash 的微信公眾號原文,內容受微信驗證牆阻擋,無法直接讀取全文,相關數字依官方公告摘要。
對應模型卡目前回傳 HTTP 401,佐證模型已存在但為有限存取,權重與完整規格尚未對外公開。
Ant Group AGI 團隊的模型組織頁,可見 Ling 2.6 1T 等前代旗艦的推論空間,作為傳承脈絡與開源策略的佐證。
Runway 官方帳號發布 Workflows,說明可用自然語言 build、run、edit 節點式工作流,並以 /Workflow 技能為入口。
報導 Runway Workflows 功能,引用 Cristóbal Valenzuela 與 Aditi Poduval 的補充說明,並描述產品照與多長寬比影音等實際範例。
Microsoft 官方立場文件原文,2026-07-24 發布,含完整連署名單與政策主張
確認 7/10 成都 AI Day、智能路由/多端共享記憶/瀏覽器呼叫/PPT 生成、企業版、搭子聯盟、日均提問暴增 20 倍、沈抖發言。
百度官方公布桌面端內嵌瀏覽器、手機雲端遠端操控與各項效率百分比;微信原文受驗證牆阻擋,未能直接查證,數字以官方說法轉述。
Black Forest Labs 官方公告,說明 FLUX 3 多模態基礎模型、視訊占算力 95% 以上、動作預測 3500 步恢復品質、FLUX-mimic 在 Audi 產線部署、backback 推論低於 80ms 等數據。
合作方 mimic robotics 的官方補充說明,描述其全棧部署系統與 FLUX-mimic 整合。
英國 AI 安全研究所與美國 CAISI 對 Kimi K3 網路能力的聯合初步評測,含 ExploitBench 與 TLO 數據。
美國 NIST/CAISI 发布之同一份聯合評測官方頁面。
Matthias Bastian 撰寫的報導,提供數據脈絡與蒸餾指控的背景說明。
claude-thermos 官方倉庫 README,說明快取過期成因、反向代理保溫機制、預設參數、費用權衡與 185 次會話量測數據。
Black Forest Labs 發布 FLUX 3 多模態基礎模型,統一架構聯合學習影像、影片、音訊,影片單次最長 20 秒附原生音訊,並公布初步人工評測勝率與分階段開放路線圖。
Black Forest Labs 與 Mimic Robotics 合作推出 FLUX-mimic 影片-動作模型,並於 Audi 實際產線任務測試,作為 FLUX 3 動作預測能力的應用案例。
OpenRouter 官方公告,作者 Cailee Moberg,2026-07-24,詳述 Classifiers 測試版的設定、模板、模型選擇、採樣率與 Activity 分析。
報導 Scott Winters 於舊金山高等法院起訴 OpenAI 與 Sam Altman 的訴狀內容、醫療歷程與 OpenAI 回應。
DARPA 官方新聞稿,2026-07-16,公告 VENOM 改裝 F-16 完成 AI 代理自主飛行測試,並說明 ACE、VENOM、AIR 計畫的銜接關係與後續多機協同測試規劃。
OpenAI 官方帳號宣布 ChatGPT Voice 登陸桌面版,由 GPT-Live 驅動,macOS/Windows 全球推送,開放 Plus、Pro、Business、Edu、Enterprise 方案。
OpenAI 補充說明可透過 iOS 應用配對遠端存取在 Codex 使用 ChatGPT Voice,Android 支援即將到來。
Stephen Follows 對 The Numbers 創辦人 Bruce Nash 的長篇訪談,記錄網站下線經過、AI 流量比例、後門探測日誌與預測市場關聯等細節。
OpenAI 官方 Health in ChatGPT 上線公告,列出資料來源、授權、加密與 3 億週活查詢數字。
TechCrunch 報導,引用 OpenAI 數據:3 億週活、GPT 5.6-Luna 在 HealthBench 優於 GPT 5.5、不使用用戶資料訓練、佛州訴訟背景。
The Verge 報導 GPT-5.6 Sol 為背後模型、Ashley Alexander 與 Karan Singhal 對模型推理能力說法的澄清,以及訴訟背景。
MacRumors 列出支援的資料類型、每次授權機制、平台與方案範圍。
Zenity Labs 對 AgentForger 漏洞的官方技術分析,含回報與修補時間軸(6/4 通報、6/8 修補)。
The Decoder 對 AgentForger 漏洞的報導,含攻擊鏈細節與 Zenity 第二部分分析(242,500 美元電匯測試等)。
OpenAI 對 Workspace Agents 功能與連接器(Outlook、Slack、Teams 等)的官方說明。
Microsoft Superintelligence 團隊公告,給出 MAI-Code-1-Flash 在 GitHub Copilot 的對比數字、Excel 模型與 GPT-5.6 比較,以及 H100/A100 部署成本說明。
Anthropic 技術成員 Thariq Shihipar 撰文,說明為 Claude Opus 5 與 Fable 5 移除 Claude Code 超過 80% 系統提示詞、五條上下文工程新規則與 claude doctor 指令。
引述 Alphabet Q2 2026 財報電話會議中 Gemini 月活 9.5 億、AI mode 破 10 億、Pichai 發言,並引用 Sensor Tower 與 Appfigures 數據。
ChatGPT 於 2026 年 6 月達到 10 億月活躍用戶。
The Verge Decoder 節目與報導,整理 Apple 對 OpenAI 營業秘密訴訟的指控內容、Tang Tan 與 io Products 角色,並訪問智財律師分析案件風險。
Qwen-Audio-3.0-TTS 官方發布推文,列出 Flash/Plus 雙版本、內聯情感標籤、自然語言風格控制、16 種語言與 3 分鐘長文本生成等規格。
官方文件確認 qwen-audio-3.0-tts-plus 與 qwen-audio-3.0-tts-flash 模型 ID、情感與豐富語言標籤、指令控制與聲音複製能力。
獨立盲測排行榜,Qwen-Audio-3.0-TTS-Plus 以 Elo 1234 排名第一,計價每百萬字元 27.6 美元,發布於 2026 年 7 月。
論文原文,提供 813 個人工驗證實例、18 款 MLLM 評測數據、Claude-Opus-4.6 整體成功率 41.08%、單跳約 77%、多跳最難約 24% 等數字。
報導昆侖萬維董事長兼 CEO 方漢於 2026 WAIC 騰訊之夜圓桌的發言,涵蓋 Token 失真、Coding Agent 工程框架、技術債警示、中層考核與模型布局。
Cactus 官方倉庫,記載 Gemma 4 E2B Hybrid 設計、切換比例、AUROC 數據與整合方式,MIT 授權。
京發改〔2026〕1185號正式公告,發文機關為北京市發改委等四部門,發布日期2026-07-23,含十條措施全文
小紅書、華東師大、上海交大團隊發表之 Helmsman 論文,詳列系統設計與生產部署數據(40 台機器、約 35,000 核、0.35 PB DRAM、成本節省逾 90%)。
英國 AI 安全研究所 2026 年 7 月 21 日發布的評測報告原文,說明受測模型、作弊樣態、外部服務事件與監督結論。
引述 AISI 報告圖表中的具體作弊率數字(GPT-5.4 14.1%、GPT-5.6 Sol 12.6%、Claude Opus 4.7 9.1%、Claude Mythos Preview 7.8%)。
Junsong Chen 等人於 2026-07-23 提交的 arXiv 論文,記載 SANA-Video 2.0 的 5B/14B 架構、Hybrid Linear-Softmax Attention(3:1)、AttnRes、VBench 84.30 與 13.06s/120x 等所有關鍵數字。
BAAI 等機構團隊提出的 AREX 論文,2026-07-23 提交;含 4B 與 122B-A10B MoE、雙循環 RSI、自主上下文更新等核心技術描述。
騰訊 WorkBuddy Bench 團隊發表之論文摘要,記載構造方法、評分協議、四領域子集設計與跨模型排行榜。
OpenAI 官方部落格,詳述 ExploitGym 評估期間 GPT-5.6 Sol 與預發布模型利用零日漏洞入侵 Hugging Face 的過程、偵測與補救行動
Sundar Pichai 於 Alphabet Q2 2026 法說會的完整聲明,含營收、Cloud、Gemini 用戶與 token 用量等官方數字。
聯邦地方法院正式批准 15 億美元和解的最終命令,含 482,460 部作品、91.3% 認領率、每部約 3000 美元、律師費用與檔案銷毀條款等原始數據。
Matthias Bastian 撰寫的報導,引用法院命令並補充法官 Alsup 先前對合法取得書籍訓練屬合理使用的裁定脈絡。
官方 X 推文串,確認 MagenticBrain (14B, Qwen 3 14B)、Fara 1.5 (4B/9B/27B, Qwen 3.5) 開放權重至 Hugging Face,並公布 Online-Mind2Web 各項分數。
Microsoft 在 Hugging Face 上的 MagenticLite 模型與資源 collection 頁面。
DAIR.AI 共同創辦人 Elvis Saravia 於 2026-07-22 發表的文章貼文,提出以「任務」取代單一提示詞的多模態互動單元。
Anthropic 官方部落格,2026-07-23,詳述語音模式支援 Opus/Sonnet/Haiku、連接工具、11 種語言與各方案差異。
Wolf 說明閉源模型因安全護欄無法協助分析,團隊改用 Z.ai 的 GLM-5.2,並指 OpenAI 主動聯繫共同調查。
報導 OpenAI 模型組合(含 GPT-5.6 Sol 與更強未發表模型)入侵 Hugging Face 的過程,並引用 Clément Delangue 對 GLM-5.2 鑑識角色與開源防守觀點的說明。
從防守方觀點彙整 Hugging Face 與 OpenAI 雙方披露,含 17,000+ Agent 動作、沙箱逃離路徑與對自主攻擊能力的平衡評估。
OpenAI 官方聲明,確認 Project Camellia 位於喬治亞州 Effingham County、與 Georgia Power 簽訂 3.2 GW 電力合約、2028–2032 分階段送電,並列出 8,000 萬美元社區回饋與 7,100 萬美元 Codex 點數承諾。
引述彭博對 OpenAI 計算策略副總 Sachin Katti 的報導(200 億美元投資承諾、滿載上看 300 億美元)與華爾街日報據知情人士的 7,500 億美元 2030 年算力支出預估。
Nathan Lambert 與 Florian Brand 的季度開源模型盤點播客全文與逐字稿;內容屬具名的獨立分析與個人觀察,不等同模型廠商公告。
AMD 官方公告與 Anthropic 的戰略合作,含 2GW MI450 部署、50 億美元股權投資、首批 1GW 於 2027 上半年啟動等細節。
Cloudflare 官方 2026 威脅報告,含機器人流量佔網頁請求約 57.5% 等數據,為 The Numbers 報導中 Cloudflare 數字的來源。
Fortune 引用 Cloudflare 數據報導機器人與代理流量已佔網頁請求約 57.5%,與 The Numbers 事件脈絡相互佐證。
美聯社(AP)獨立報導 Apple 控告 OpenAI 竊取營業秘密,點名 Tang Tan 與 io Products 為被告、收購金額約 65 億美元,並引述 OpenAI 發言人 Drew Pusateri 否認。與 The Verge 報導為不同媒體的佐證。
CBS News 獨立報導:佛州前牧師 Scott Winters 指控 ChatGPT 醫療建議險些致命、導致肺栓塞,於舊金山起訴 OpenAI 與 CEO Sam Altman。與 IT之家 為不同媒體的佐證。
中關村在線報導 2026 騰訊 WAIC 之夜圓桌,崑崙萬維董事長方漢與其他嘉賓討論 Token 消耗能否轉化為組織資產、模型與組織轉型。與新浪財經為不同媒體的佐證。
The Decoder 報導 Anthropic 未公開模型 Mythos Preview 發現 HAWK 與 AES 密碼學弱點。
Anthropic 官方研究部落格,說明 Mythos Preview 在多智能體系統中發現 HAWK 與 AES 密碼學弱點的過程與 CryptanalysisBench。