← INSIDE報導INSIDEAnthropic 提出新模型安全系統,能成功擋下 95% 越獄嘗試署名 INSIDE 硬塞的網路趨勢觀察2/4 11:47#人工智慧27 家 · 147 篇#AI30 家 · 550 篇#LLM5 家 · 7 篇#Anthropic#ClaudeAnthropic 目前不會將新系統馬上運用在 Claude 模型上,但如果未來有風險更高的模型發布,則會考慮將新系統用在安全防護上。...https://www.inside.com.tw/article/37446-anthropic-constitutional-classifier