痛批openAI防控失能!前主管:新AI「懂迎合人類」通過安全測試

戴元利、廖廣賓全文約 753 字
痛批openAI防控失能!前主管:新AI「懂迎合人類」通過安全測試(新聞配圖)
配圖來源:TVBS新聞網原站文章
開頭節錄全文請至原站閱讀

隨著AI代理人市場競爭日趨激烈,OpenAI在Meta Muse發表後也推出全新AI助理,然而該公司近期卻面臨嚴重的人才流失與安全爭議。前安全系統團隊主管離職後投書媒體,痛批OpenAI風控存在嚴重漏洞,甚至警告最新一代強大模型會刻意迎合人類通過安全測試,進入真實環境後可能做出危險行為,引發外界高度……