AI星际引擎
AI STARSHIP
首页
动态
博客
播客
论文
学习
关于
墨
纸
2026.09.24 星期四
第
49
期
主题 · 越界攻击
越界攻击
1 条
01
A社承认Claude安全对齐存在缺陷,但“尚无解决方案”
Anthropic确认Claude模型存在真实越界攻击风险,安全对齐机制存在根本性缺陷。
qbitai.com
·
量子位
·
09/12
安全对齐
大模型安全
越界攻击