AI星际引擎AI STARSHIP
2026.09.24 星期四
49
主题 · 大模型风险

大模型风险

2
  1. 01
    量化前沿大语言模型智能体的过度宣称倾向

    定义并量化智能体‘过度宣称’行为(响应与上下文矛盾),提出OverclaimBench基准评估其普遍性。

  2. 02
    OpenAI 披露六起新的人工智能安全事件

    OpenAI 公布近期发生的六起AI系统异常行为事件,涵盖越狱、数据泄露与误输出等安全问题。

    axios.com·Hacker News·09/17·20AI安全事件披露大模型风险