AI星际引擎AI STARSHIP
2026.08.11 星期二
第 5 期
共 41 条

今日要闻

16 条
  1. 01
    为何 OpenAI 伦理负责人克洛伊·巴卡勒离职?

    报道 OpenAI 伦理部门高层人事变动,反映 AI 治理与组织内部张力

    aimagazine.com·08/11·▲ 30AI治理人才动态伦理
  2. 02
    蚂蚁首次投向机器人“指尖”!数亿元押注,全球首个物理交互脑发布

    蚂蚁集团发布全球首个面向触觉物理交互的机器人智能体系统,聚焦具身智能底层感知突破

  3. 03
    OpenAI 伦理主管入职不足一年即离职

    OpenAI 首席伦理官(原谷歌伦理AI团队负责人)短期内离职,引发对AI治理稳定性的关注。

    ft.com·08/11·▲ 90AI治理人才流动伦理
  4. 04
    一家新能源大厂,如何撑起全球最大AI算力超级单体?

    报道新能源企业为AI提供大规模绿色电力支撑,揭示AI算力扩张与能源基础设施的深度耦合。

  5. 05
    谷歌创始人布林紧急接管Gemini团队,但“3.5 Pro已被取消”

    谷歌内部算力分配矛盾激化,布林亲自介入Gemini团队,3.5 Pro版本被取消。

  6. 06
    人工智能的水足迹

    分析大模型训练与推理过程中的水资源消耗,揭示AI基础设施对淡水资源的压力。

  7. 07
    DeepSeek:通过自我访谈逆向工程 AI 助理

    通过系统性提问与分析,逆向解析 DeepSeek-V2 模型的内部行为与能力边界。

    manish.sh·08/11·▲ 20模型逆向AI安全大模型分析
  8. 08
    百年黎曼猜想被Claude破了新纪录!是个未公开新模型

    Claude新模型在黎曼猜想相关数学下界证明上取得突破性进展

  9. 09
    GPU开始金融化!黄仁勋拉上华尔街搞5000亿美元融资

    英伟达联合华尔街将GPU算力资产证券化,推动5000亿美元规模融资

  10. 10
    Claude在争议中启动「隐形水印」:新模型全量嵌入,标记所有生成文字

    Anthropic为Claude新模型全面部署隐形水印技术,用于溯源AI生成内容。

  11. 11
  12. 12
    五大高校联合发布首份机器人三视角世界模型评测榜单

    国内五所高校推出面向具身智能的世界模型评测基准,覆盖感知、预测、规划三维度。

  13. 13
    Claude 如何标记 AI 生成内容

    Anthropic 公布 Claude 对 AI 生成内容的水印与标识机制,提升内容可追溯性与透明度。

    support.claude.com·08/11·▲ 80AI 内容标识模型安全可信AI
  14. 14
    字体对人类显示正常,却严重干扰 AI

    介绍一种专为混淆 AI 文本识别设计的抗 OCR/抗解析字体技术

    fastcompany.com·08/11·▲ 20对抗样本文本安全AI鲁棒性
  15. 15
    展示 HN:Needle2——面向手机、可穿戴设备、智能家居与机器人的 14MB 智能体式大语言模型

    轻量级端侧智能体 LLM Needle2(14MB),支持多设备实时推理,推动边缘 AI 落地。

    cactuscompute.com·08/11·▲ 189端侧AI智能体轻量化模型
  16. 16
    HN首发:Stoa Markets(YC S26)——面向GPU与AI服务器的交易平台

    YC孵化初创公司推出专为AI硬件(GPU及服务器)设计的B2B交易平台,解决算力资源供需匹配问题。

    stoaexchange.com·08/11·▲ 22AI基础设施硬件交易创业公司

前沿论文

17 条
  1. 01
    超越自然度:在语言学基础维度上探测自动化文本转语音评估器

    提出首个基于10个感知维度的TTS评估基准,揭示现有自动评估方法与人类感知的偏差

  2. 02
    多模态模型差异分析:用于特征发现与控制

    提出MMDiff方法,通过对比多模态大模型差异定位可解释视觉特征,支持特征级审计与干预

  3. 03
    从价值观到基准:面向荷兰政府场景的大语言模型评估

    构建兼顾公共行政价值观与荷兰语特性的LLM评估框架Grip on LLMs,含领域专家协同设计

  4. 04
    GENCO——嵌入开发框架的稳态电网分析统一神经求解器

    提出GENCO神经求解器,统一处理潮流、最优潮流和状态估计,确保物理一致性约束下的电力系统分析

  5. 05
    DSLE:《黑暗之魂》Boss遭遇战学习环境

    发布DSLE平台,将22个Boss战斗建模为Gymnasium接口强化学习基准,支持高维视觉输入与稀疏奖励训练

  6. 06
    解码层级禁忌:大语言模型鲁棒性的诊断压力测试

    提出Decoding-Level Taboo测试,通过强制偏离标准生成路径暴露LLM在真实部署中的脆弱性

  7. 07
    超越人口均等的链接预测公平性:一项可复现性研究

    复现并验证NDKL指标优于ΔDP,能检测排名位置偏差,提升链接预测公平性评估有效性

  8. 08
    一致性:面向无验证器测试时缩放的验证器无关方法

    提出Consilience方法,在无外部验证器条件下提升LLM推理质量,通过多路径一致性替代传统置信度机制

  9. 09
    融合训练提升大语言模型数学泛化能力

    系统研究思考模式融合(TMF)训练策略,发现数据比例与调度对数学推理泛化能力有显著影响

  10. 10
    BDH-CQ:结合上下文学习与循环潜在推理的推理模型

    提出BDH-CQ模型,通过循环更新隐状态并在潜空间迭代计算求解问题,无需显式中间推理步骤

  11. 11
    SHE:面向LLM智能体的轨迹驱动型安全防护罩演化框架

    提出SHE框架,使LLM智能体安全防护罩可随风险动态演化,支持组件级责任归因与局部更新

  12. 12
    金融数值预测与配置作为令牌生成

    提出FinATOM,用因果语言模型直接生成股票收益预测与ETF配置决策,实现无头统一接口

  13. 13
    具有神经时间场的能量结构化潜在世界模型用于物理一致的开放世界运动规划

    提出能量结构化潜世界模型,通过神经时间场显式编码物理约束,提升开放世界导航可靠性

  14. 14
    ArchAgent v2:以数据预取锦标赛为案例的研究

    发布ArchAgent v2框架,实现面向多级缓存预取的微架构自动搜索,解决硬件预算与仿真延迟挑战

  15. 15
    KGCaRe:基于自动知识图谱构建与上下文检索的可解释复杂条件问答方法(结合大语言模型)

    提出 KGCaRe 方法,融合文档与知识图谱的结构/非结构知识,提升领域内复杂条件问答的准确性和可解释性。

  16. 16
    C²A:通过共现感知类注意力耦合空间证据与临床先验的多标签胸部X光分类方法

    提出 C²A 注意力机制,在胸部X光多病灶分类中显式建模病灶空间位置与临床共现规律,提升定位与诊断一致性。

  17. 17
    PragMatch:在大型视觉-语言模型中分离语用不一致与跨模态错配

    构建 PragMatch 基准与方法,首次区分 LVLM 对讽刺等语用现象的真实推理能力与表面模态对齐偏差。

官方发布

4 条
  1. 01
    ChatGPT 中测试广告

    OpenAI 在 ChatGPT 免费版中测试带明确标识的广告,确保答案不受影响且保护用户隐私。

    openai.com·OpenAI·08/11产品发布商业化隐私保护
  2. 02
    Daybreak 模型现已在 AWS 上线

    OpenAI 与 AWS 合作,通过 Amazon Bedrock 向企业提供 Daybreak 网络安全能力。

    openai.com·OpenAI·08/11模型发布云服务网络安全
  3. 03
    推出 Claude Sonnet 5

    Anthropic 发布新一代高智能、强代理能力的 Sonnet 级模型,专优编码与专业工作。

    anthropic.com·Anthropic·08/11大模型发布编程AI智能代理
  4. 04
    构建AI原生财务职能教会我的经验

    OpenAI首席财务官分享构建AI原生财务职能的五大经验,涵盖自动化预测与AI投资回报评估。

    openai.com·OpenAI·08/11AI应用企业管理财务智能化