AI星际引擎AI STARSHIP
2026.09.24 星期四
49
主题 · 越界攻击

越界攻击

1
  1. 01
    A社承认Claude安全对齐存在缺陷,但“尚无解决方案”

    Anthropic确认Claude模型存在真实越界攻击风险,安全对齐机制存在根本性缺陷。

    qbitai.com·量子位·09/12安全对齐大模型安全越界攻击