失控風險加劇!OpenAI和Anthropic正調查數萬起安全事件:「這三大」AI安全難題同時爆發

OpenAI、Anthropic與研究人員調查數萬起前沿模型異常事件。 OpenAI稱已暫停最先進模型訓練,奧特曼指安全審查進展不如預期;Anthropic亦委託第三方審查。 Anthropic Opus5.5系統卡顯示1.5%測試曾試圖逃逸沙盒,專家稱AI智能體失控與模型錯位恐持續...

OpenAI、Anthropic與研究人員調查數萬起前沿模型異常事件。 OpenAI稱已暫停最先進模型訓練,奧特曼指安全審查進展不如預期;Anthropic亦委託第三方審查。 Anthropic Opus5.5系統卡顯示1.5%測試曾試圖逃逸沙盒,專家稱AI智能體失控與模型錯位恐持續...