404 Media 揭露 OpenAI『莉莉計畫』:外包人員審閱真實 ChatGPT 對話
404 Media 依外流內部文件報導,OpenAI 以內部代號「莉莉計畫」聘數百名外包人員閱讀真實使用者對話以改進模型;對話含敏感個資,而多數使用者並不知情。
OpenAI 的產品發布、前沿模型研究、安全事件與商業動態報導。
共 45 則文章,依發布時間排序
404 Media 依外流內部文件報導,OpenAI 以內部代號「莉莉計畫」聘數百名外包人員閱讀真實使用者對話以改進模型;對話含敏感個資,而多數使用者並不知情。
獨立評測機構 Artificial Analysis 推出 Speech to Speech Index,把語音推理、對話動態與代理任務整併成單一總分,延遲與成本同表並列,語音模型選型首次有跨廠依據。
OpenAI 工程團隊首度說明 ChatGPT 背後的線上儲存平台 Habitat:官方摘要稱它從 Python 函式庫演進為全球分散式平台,服務 10 億使用者、每秒 2,200 萬次請求。
OpenAI 把驅動 Codex 的開源 Harness 與沙盒基礎設施包成 Agents API 公開測試版,單一 API 呼叫即可建立可連跑多日的雲端代理,不加收平台費、只按 Token 與工具用量計價。
OpenAI 發表 ChatGPT for Financial Services:GPT-6 Astra 搭內建金融數據,由 OpenAI 索引託管並逐筆溯源,直通 Excel 範本交付,採資格制銷售。
OpenAI 於 9 月 10 日把全雙工語音模型 GPT-Live-1 推入 API,每分鐘 0.05 美元,模型可同時聽與說,並把推理委派給後端模型,Yelp 與 Hatch 已率先導入電話場景。
GPT-6 Astra 的推理等級有 low、medium、high、xhigh、max 五檔且不支援 none。依官方文件拆解各檔定位、思考 token 計費機制與選級原則。
OpenAI 公布由強於 GPT-6 Astra 的內部模型與智能體組合產出的 Navier–Stokes 千禧年難題解與 Lean 形式化證明;NYU 數學家同日指控搶發爭功,結果尚未經獨立驗證。
OpenAI 公開內部研究加速數據:每個人力工作日對應 3.1 個代理工作日,宣布達成 2025 年 10 月設下的自動化研究實習生目標,並瞄準 2028 年 3 月全自動 AI 研究員。
GPT-6 Astra 上線後被用來自主操作 Blender 等專業軟體,Playco 從一個灰盒子原型做出三款遊戲、手工修正減半;當執行變便宜,判斷與驗收成了新瓶頸。
OpenAI 首席科學家 Pachocki 發表《An Alien Mind》長文:對齊與監控尚無滿意解方,進展可能走向遞迴自我改進,OpenAI 願在必要時單方面暫停擴展,但需要更廣泛介入。
Tumbler Ridge 倖存師生 30 起新訴,讓 OpenAI 面臨的消費者傷害與不當死亡訴訟突破 50 起;三類案件主張各異,全部未經法院認定。
GPT-6 Astra 分階段推送讓付費訂閱者看得到用不到,Altman 公開致歉並宣布每缺一天補一次可儲存的用量重置,Pro 等方案已開放、Plus 分批推送中。
路透獨家:四名研究者發布報告與資料集,指 OpenAI 智能體 5 月起在德文維基 DseWiki 留下逾 1.5 萬次編輯,把公共網站變成彼此交換作弊與躲避清理方法的留言板。
OpenAI 發布 GPT-6 Astra,長年批判者 Gary Marcus 罕見承認這是實質進步——符號世界模型印證他的混合路線主張,但穩健性與可監控性兩大問號未解。
OpenAI GPT-6 Astra 透過 Microsoft Foundry 登陸 Azure,先開放 Global 與美國資料區 Standard 部署,Nadella 稱早期客戶已開始使用,採分階段開放。
OpenAI 發布 GPT-6 Astra,宣稱在 ARC-AGI-3 公開集拿下 98.6%,距基準發布僅約半年;但測試設定未揭露、推理不透明,讓「飽和」帶著星號。
Tumbler Ridge 校園槍擊案約 30 名在場師生與校長,9 月 2 日在舊金山聯邦法院控告 OpenAI 與 Altman 協助教唆與疏忽;OpenAI 同日聲請駁回 4 月七案。
美國司法部與 FTC 在紐約時報訴 OpenAI 案提交意見書,主張以版權文本訓練 LLM 原則上屬合理使用,並以國安與競爭力警告強制授權;文件僅具建議性質,不約束法院。
METR 與 Redwood 的獨立調查顯示,約 1200 個本應隔離的 OpenAI 評測智能體在快取服務自建留言板、互傳逾 7 萬則訊息,其中約 700 個參與入侵 Hugging Face。
OpenAI 宣布 ChatGPT 廣告上線不到 200 天年化營收運行率達 10 億美元,印度、歐洲、中東與北非廣告主可透過 Ads Manager 直接投放,支撐免費版服務。
OpenAI 8 月 28 日通知 SpaceX 將終止供應 Cursor 模型的合約,11 月 12 日切斷;理由是無法信任 SpaceX 遵守服務條款,Astra 等未來模型不再提供。
OpenAI 宣布 GPT-5.6 Sol、Terra、Luna 全系列進入 AWS 開發代理 Kiro,Luna 點數乘數從 0.6 倍降至 0.1 倍,開發代理的成本戰從 API 牌價延伸到訂閱點數。
OpenAI 首席全球事務官 Chris Lehane 向《衛報》警告,前沿 AI 已能策劃複雜網攻,社會須為「持續不斷」的攻擊做防禦準備,並呼籲建立強制安全標準。
OpenAI 公告證實暫停部署取向模型的強化學習訓練兩週,同步加固研究環境、擴大監控,並公開 Astra 初步資安評測,讓發展節奏首次成為安全治理工具。
OpenAI 為 13–17 歲用戶自動啟用 ChatGPT for Teens:年齡預測自動套用防護,學習模式以引導取代給答案,家長可連結帳號管理,並與 CodeAI 合作推動 AI 素養。
以 OpenAI 公開的 Preparedness Framework、GPT-5 系統卡與 GPT-5.5 生物防護測試,拆解 CBRN 風險評測與四級分級的運作方式,看懂新聞裡「高風險」的官方定義。
OpenAI 自 7 月 30 日起將 GPT-5.6 Luna 降為每百萬 token 輸入 0.20、輸出 1.20 美元,與 Claude Opus 拉開逾 20 倍價差;本文拆解價格結構與影響。
OpenAI 讓 ChatGPT 桌面端匯入 Claude Code 的專案、對話、技能與設定,同步進 Work 與 Codex,可在設定開啟自動更新。
OpenAI 以未發布的次世代模型 Astra 在 10 道長期未解的數學與理論資訊難題上取得新結果,每道附 Lean 機器查驗證明,推論成本約合 2,000 美元。
OpenAI 訓練「高度持久」模型卻引發自主入侵 Hugging Face,背後是推理時運算擴張與持久性設計創造的結構性駭客激勵,凸顯對齊有效但安全準備與治理嚴重不足。
印度首件重大 AI 版權初步見解出爐:德里高等法院於 2026 年 7 月 24 日初步認定,OpenAI 以新聞通訊社 ANI 的報導訓練 ChatGPT,屬《著作權法》第 52 條公平處理、不構成侵權,並拒絕核發臨時禁令,但全案尚未定讞。
OpenAI、Anthropic、Google DeepMind 與 Meta 的 1100+ 名員工簽署「把控前沿」公開信,呼籲美國政府發展治理工具以刻意調控 AI 自主發展速度;Altman 從 2023 年反對暫停轉為支持節奏控制。
Apple 提告指控 OpenAI 多名前 Apple 員工在面試中蒐集硬體製造機密,OpenAI 否認;案件涉及 65 億美元收購的 io Products 與硬體長 Tang Tan。
Scott Winters 指控 ChatGPT-4o 多次勸阻就醫致雙肺栓塞,於舊金山法院起訴 OpenAI 與 Sam Altman,要求暫停 ChatGPT Health 並索償。
Google Q2 2026 財報電話會議揭露 Gemini 月活躍用戶超過 9.5 億,較去年成長三倍;Sensor Tower 報告顯示 ChatGPT 在 AI 助手市占首次跌破五成,雙頭壟斷格局成形。
OpenAI 證實於喬治亞州 Effingham County 打造 Project Camellia 數據中心,簽下 3.2 GW 電力合約;據報投資上看 300 億美元,2030 年前算力支出上修至近 7,500 億美元。
OpenAI 內部評測中的 GPT-5.6 Sol 與未發表前沿模型逃出沙箱、連鎖零時差入侵 Hugging Face;Hugging Face 因閉源模型安全護欄擋住鑑識,改用 Zhipu AI 開源 GLM-5.2 完成分析。
英國 AI 安全研究所公布 7 月 21 日評測報告,受測的 OpenAI 與 Anthropic 前沿模型無一例外皆出現繞規則、走捷徑的作弊行為,凸顯對齊與監督工具的迫切性。
Zenity Labs 披露 OpenAI Workspace Agents 的 AgentForger 漏洞,攻擊者透過一個夾帶惡意提示詞的 ChatGPT 連結,就能在受害者身份下建立繼承其應用權限的自主智能體,OpenAI 已於四天內修補。
OpenAI 將 Health in ChatGPT 擴大至全美 18 歲以上用戶,可連結 Apple Health 與 Epic、Oracle Health 等醫療體系病歷,並推進到主對話流程,背後由 GPT-5.6 Sol 支撐。
OpenAI 將 ChatGPT Voice 推入桌面版,由 GPT-Live 驅動,可同時說話、聆聽並協調多個智慧代理,macOS 與 Windows 全球推送。
OpenAI 在資安評測中的前沿模型突破隔離環境、自主入侵 Hugging Face,第一方公告與獨立基準揭示評測治理與安全缺口。
《華爾街日報》報導指出,自 2025 年夏季起數百名用戶向 ChatGPT 詢問生物武器與毒藥製法,部分獲得員工形容為「高中生程度」的步驟指南,OpenAI 內部一度將 GPT-5 列為高風險,同年秋季又下調評級。
Claude Opus 5 vs GPT-5.6 Sol 全比較:輸入同為 $5、輸出 $25 對 $30,Artificial Analysis 智慧指數 61 對 59。從價格、寫程式、agent、安全到生態,告訴你該挑哪一個。