AI星际引擎
AI STARSHIP
首页
动态
博客
播客
论文
学习
关于
墨
纸
2026.09.24 星期四
第
49
期
主题 · 模型安全
模型安全
2 条
01
我们的模型错位行为报告框架
OpenAI发布模型错位行为的追踪、调查与披露框架,并公开6例异常行为报告
openai.com
·
OpenAI
·
09/17
模型安全
可解释性
AI治理
02
Strengthening safeguards with US CAISI and UK AISI
anthropic.com
·
Anthropic
·
09/11