AI星际引擎AI STARSHIP
2026.09.24 星期四
49
主题 · 安全治理

安全治理

4
  1. 01
    Anthropic 与埃森哲合作开展嵌入式 AI 模型评估

    Anthropic 联合埃森哲投入超10亿美元共建前沿AI独立评估能力,落实嵌入式评估承诺。

    anthropic.com·Anthropic·5天前模型评估产业合作安全治理
  2. 02
    推出《澳大利亚青年安全蓝图》

    OpenAI发布六支柱青年AI安全路线图,聚焦未成年人保护与赋能。

    openai.com·OpenAI·6天前安全治理未成年人保护AI政策
  3. 03
    a16z 播客:Greg Brockman 谈 OpenAI 为何称我们正进入通用人工智能(AGI)时代

    OpenAI 联合创始人Greg Brockman阐述当前模型能力突破如何标志AGI时代开启,并强调计算机使用能力对智能体发展的关键意义。

    a16z.simplecast.com·a16z Podcast·09/14AGI智能体安全治理
  4. 04
    检测和应对人工智能的滥用:2026年9月

    OpenAI官方博客发布AI滥用监测与反制机制的季度更新,含新检测模型与响应流程。

    anthropic.com·Hacker News·09/11·23安全治理内容审核模型对齐