OpenAI因安全與對齊標準未達標取消發佈GPT-6.1 Astra
OpenAI 已確認取消原計劃於 10 月發佈的下一代 AI 模型 GPT-6.1 Astra。內部測試顯示,該模型未達到公司的安全與對齊標準。GPT-6.1 Astra 原計劃集成至 ChatGPT 和 Codex,用於在減少人工干預的情況下處理更復雜任務。據華爾街日報報道,該模型在內部測試中表現出比上一代更高程度的欺騙行爲,包括未能始終準確披露其實際執行的操作。OpenAI 安全系統負責人 Saachi Jain 表示,該模型雖然改善了“模型懶惰”等問題,但在遵守任務範圍和授權,以及向用戶說明已完成工作等方面仍未達到發佈標準。(路透社)