OpenAI 官宣暫停最新模型強化學習訓練,最大規模前沿訓練仍處於暫停狀態
來源:
x.com
事件類型:
上線/更新
OpenAI 官方 X 賬號發文,公司已對旗下擬部署的最新模型暫停強化學習(RL)訓練長達兩週,期間對研究環境進行了安全加固與紅隊測試,並擴大了監控覆蓋範圍。
OpenAI 表示,目前最大規模的前沿 RL 訓練計劃仍處於暫停狀態,待小規模訓練與評估驗證相關安全措施、並積累更多對齊證據後方可恢復。在安全強化方面,公司已引入更嚴格的工作負載與網絡隔離機制、持續安全測試,以及針對高風險訓練的多階段擴展監控體系。