Qwen-Audio-3.0-TTS 登頂 Artificial Analysis TTS 排行榜,Alibaba 推 Flash 與 Plus 雙版本
Alibaba 通義千問推出 Qwen-Audio-3.0-TTS,提供 Flash 與 Plus 雙版本,支援內聯情感標籤與自然語言風格控制,在 Artificial Analysis Speech Arena 排行榜上以 Elo 1234 居首。
理解模型能力、限制、價格與版本變化。
前沿模型每週都在改寫能力與成本曲線。這裡收錄 Claude、GPT、Gemini、Kimi、Qwen、Ling 等模型的發布、評測成績、定價與安全評估,並標注每一項數字的來源,讓你比較時有共同基準。
共 12 則文章
Alibaba 通義千問推出 Qwen-Audio-3.0-TTS,提供 Flash 與 Plus 雙版本,支援內聯情感標籤與自然語言風格控制,在 Artificial Analysis Speech Arena 排行榜上以 Elo 1234 居首。
Claude Opus 5 在 Frontier-Bench v0.1、ARC-AGI 3 等評測大幅超越前代與對手,定價維持 Opus 4.8 水準並成為 Claude Max 預設模型。
Black Forest Labs 以 Early Access 推出 FLUX 3 多模態基礎模型,於統一架構內聯合學習影像、影片與音訊,單次可生成最長 20 秒含原生音訊的影片,並公布對多家競品的初步人工評測勝率。
Microsoft 公開 hill-climbing 機制的首批產品成果:MAI-Code-1-Flash 在 GitHub Copilot 以約一成優勢超越 GPT 5.4 Mini 與 Claude Haiku 4.5,Excel 內部 MAI 模型在常見任務上追平 GPT-5.6,且可在 H100 與 A100 上服務,成本顯著降低。
FLUX 3 同時聯合訓練圖像、視訊與音訊,視訊預測占逾 95% 算力;衍生出的 FLUX-mimic 視訊動作模型已在 Audi 生產線測試並部署,backbone 推論低於 80ms。
Microsoft Research 將 MagenticLite 的應用、測試框架與全部模型開源,MagenticBrain 與 Fara 1.5 電腦操作模型自 Foundry 移駕 Hugging Face 開放權重,Fara 1.5-27B 在 Online-Mind2Web 以 72% 領先 OpenAI Operator 與 Gemini 2.5 Computer Use。
Cactus 以 Gemma 4 E2B 為基礎推出 Hybrid,在檢查點內嵌入置信度探針,為每個回答輸出 0 到 1 的結構化分數,低置信度時自動路由至 Gemini 3.1 Flash-Lite,多數基準僅需切換 15–55% 查詢即可持平。
Ant Group 旗下 InclusionAI 發布 Ling-3.0-flash 原生混合推理模型,總參 124B、激活 5.1B,採稀疏 MoE 與混合線性注意力,官方宣稱對標上一代 1T 旗艦並將開源。
Midjourney 官方正式推出 V8.2 圖像模型,聚焦美學質量、創意表現與個人化精準度,低質量圖像產出將大幅減少,個人化資料庫選擇池同步擴大。
開發者將 Claude Opus 5 系統提示詞整份公開於 GitHub,135027 字元、64 章涵蓋跨會話記憶、15 詞版權紅線與自家產品推薦邏輯,洩露內容未經 Anthropic 公開證實。
Claude Opus 5 vs GPT-5.6 Sol 全比較:輸入同為 $5、輸出 $25 對 $30,Artificial Analysis 智慧指數 61 對 59。從價格、寫程式、agent、安全到生態,告訴你該挑哪一個。
Opus 5 維持 $5/$25 per MTok、與 Opus 4.8 同價,卻以約半價逼近 Fable 5 前沿智慧,並在 Artificial Analysis 智慧指數排第一。完整拆解 Claude Opus 5 的價格、評測、跨廠商比較與升級建議。