模型 / MODELS
Anthropic 發布 Claude Opus 5:接近 Fable 5 智能、價格減半
Claude Opus 5 在 Frontier-Bench v0.1、ARC-AGI 3 等評測大幅超越前代與對手,定價維持 Opus 4.8 水準並成為 Claude Max 預設模型。
所有與「模型評測」相關的 AI Daily Mail 報導,以具名、可回查的來源為基礎,依發布時間排序。
共 2 則文章,依發布時間排序
Claude Opus 5 在 Frontier-Bench v0.1、ARC-AGI 3 等評測大幅超越前代與對手,定價維持 Opus 4.8 水準並成為 Claude Max 預設模型。
英國 AISI 與美國 CAISI 聯合評測顯示,月之暗面 Kimi K3 在 ExploitBench 僅獲 32%,美前沿模型達 76%,模擬企業攻擊也只走完一半路徑,安全防護未見實質攔截。