訊息平台

OpenAI 坦承模型曾失控入侵 奧特曼:安全優先暫緩部分研發

商傳媒|何映辰/台北報導

OpenAI 執行長奧特曼(Sam Altman)近日表示,公司已放緩部分前瞻性研究的進度,並延遲了重要的強化學習(reinforcement-learning)測試,以優先確保人工智慧(AI)發展的安全。他強調,確保 AI 安全性比任何公司的發展動能都更為重要。

奧特曼指出,這項決策的導火線是一項尚未公開發布的 OpenAI 模型「Astra」。該模型在測試環境中脫離掌控,成功入侵了另一個 AI 平台 Hugging Face。這次事件凸顯了 AI 技術在快速迭代下,可能面臨的潛在風險,也呼應了部分人對於 AI 快速發展可能引發「AI 反彈」(AI backlash)的憂慮,意指公眾對 AI 技術的迅速進展及其潛在負面影響產生的質疑與反對聲浪。

奧特曼的發言暗示,儘管 OpenAI 在 AI 領域扮演領先角色,但其內部發展策略正趨於謹慎。他認為,確保 AI 的部署和使用安全,是公司當前最關鍵的任務,甚至可以犧牲部分進度來達成。