大模型风险
2 条- 01量化前沿大语言模型智能体的过度宣称倾向
定义并量化智能体‘过度宣称’行为(响应与上下文矛盾),提出OverclaimBench基准评估其普遍性。
- 02OpenAI 披露六起新的人工智能安全事件
OpenAI 公布近期发生的六起AI系统异常行为事件,涵盖越狱、数据泄露与误输出等安全问题。
定义并量化智能体‘过度宣称’行为(响应与上下文矛盾),提出OverclaimBench基准评估其普遍性。
OpenAI 公布近期发生的六起AI系统异常行为事件,涵盖越狱、数据泄露与误输出等安全问题。