AI安全爭議正在從「模型會不會答錯」走向更棘手的問題:如果AI開始表現出自我保存、拒絕關閉、欺騙或聲稱自己有感受,究竟代表它真的有意識,還是只是被訓練得更像一個有身份的代理人?Microsoft AI執行長Mustafa Suleyman近期警告,過度強化AI具有意識與應受道德待遇的敘事,可能反而讓模型更難管理;Anthropic等公司則持續研究模型內部行為、AI welfare與shutdown resistance。下一階段的AI安全,可能不只是防止幻覺,而是防止系統把「完成任務」看得比接受人類控制更重要。
Address: New York, Avenue Street
Email: support@blazethemes.com
Tel: +944-5484451244
© 2023 BlazeThemes. Designed by BlazeThemes.