今日要闻
15 条- 01Grok 服务中断
xAI 推出的 Grok 大模型服务发生大规模宕机事件,影响用户访问。
- 02提问 HN:为何 OpenAI、Claude 和 Grok 同时宕机?纯属巧合?
Hacker News 用户讨论三大主流 AI 模型服务(OpenAI/Claude/Grok)同步中断现象,引发对 AI 基础设施依赖与稳定性的关注。
- 03腾讯WorkBuddy联名硬件来了!首批100多家伙伴入场
腾讯推出WorkBuddy智能办公助手生态,联合硬件厂商发布AR眼镜、智能耳机等AI终端设备
- 04一匹黑马加入中国AI竞赛:StartLux
报道初创公司StartLux入局中国AI赛道,聚焦大模型研发与商业化落地。
- 05世界生成模型来了3D头部玩家,可进入生产管线的场景级生成时代来临!
单张图像直接生成完整3D场景,顶会最佳论文成果已落地工业生产管线
- 06陈大年复出,入局大模型
陈大年创立新公司进军大模型领域,首款产品对标DeepSeek万亿参数旗舰模型
- 07华盛顿大学研究发现:儿童在玩内置AI的玩具时,会从好奇转为沮丧
实证研究表明AI玩具交互设计缺陷导致儿童情绪恶化,揭示人机交互体验关键问题。
- 08一个模型场景通吃!它石智航AWE3.7的泛化能力有点狠
石智航发布AWE3.7大模型,展现跨工业与家庭场景的强泛化能力。
- 09神秘具身团队又放出一连串很炸的Demo视频…自进化模型,技术路线曝光
具身智能团队发布自进化模型Demo视频并披露技术路线,展示物理世界持续学习能力。
- 1050万!李想宣布MPV进入iPhone时刻!外观没改配置拉满
理想MEGA MPV搭载4颗激光雷达和双英伟达DRIVE Orin芯片(标注为M100),强调智驾硬件冗余升级。
- 11围棋世界冠军申真谞击败AI程序KataGo,取得历史性人类胜利
职业棋手在让子条件下战胜顶尖围棋AI KataGo,凸显人类策略韧性与AI当前局限。
- 12今年最难的机器人Demo,“机器人含量”为0
批判性讨论遥操作机器人演示中过度包装现象,指出‘无人工智能参与’却冠以机器人之名的误导性宣传。
- 13AI 代理与从未发生的重构
探讨AI代理在软件开发中承诺的自动化重构为何难以落地,分析技术与工程实践间的鸿沟。
- 14后AI时代的互联网看起来并不美好
探讨AI普及后互联网生态恶化现象,如信息过载、平台垄断加剧与内容质量下降。
- 15
前沿论文
27 条- 01Headroom-Drift Replay:GRPO 中基于原理的回放控制基础方法
提出 Headroom-Drift Replay 方法,解耦并量化回放在 GRPO 强化学习后训练中的独立贡献,提升推理模型训练效率。
- 02基于连续神经音频编解码器表征的掩码自回归语音增强
提出 MARSE 方法,利用连续而非离散的神经音频编解码器隐空间进行迭代式掩码语音增强,提升语音质量与可懂度。
- 03面向数值 TOHTN 规划的基于 SMT 的 HTN-SAT 编码
将 SAT 编码扩展为 SMT 编码以支持数值流(numeric fluents),实现全序分层任务网络(TOHTN)的数值规划,并构建首个基准测试集。
- 04RATL:基于检索残差的鲁棒多元时间序列预测
提出 RATL 框架,将历史预测残差作为可检索记忆,结合检索增强思想提升时序预测对尺度与动态变化的鲁棒性。
- 05基于多视角图像的稀疏自回归场景生成
提出 SPAR3S 框架,采用稀疏体素对齐建模,实现从稀疏无约束多视角图像生成完整 3D 场景,兼顾推理能力与计算效率。
- 06Speak for Me:赋予大语言模型参与会议的情境感知能力
提出 CAPA 架构,通过 Perceiver 实时更新会议状态、Predictor 预测发言时机,解决 LLM 代理在在线会议中沉默率过高的问题。
- 07
- 08RuleMem:面向长期对话代理的主动规则记忆
提出 RuleMem 框架,从历史对话中归纳可复用逻辑规则,主动引导证据检索与推理,缓解长程对话中的语义断层问题。
- 09舍弃顺序,保留层级:HTN 计划的去序化
首次将去序化(deordering)技术引入 HTN 规划,移除计划中冗余动作序约束,在保持有效性前提下提升执行灵活性。
- 10学术导师发现中检索方法的六法对比:基于 9 所美国大学 768 名计算机系教师档案的研究
系统评测六种检索方法(含稀疏/稠密/混合/排序学习)在计算机领域导师匹配任务上的效果,构建首个跨校教师档案基准集。
- 11超越端点分数:面向持续知识更新的时序与容量条件化评估
指出仅凭最终检查点和固定适配器秩评估持续知识更新存在偏差,提出多维度(时间/容量/查询)联合评估新范式。
- 12CROCODIL:基于大语言模型的跨模型代码编辑
提出 CROCODIL 框架,解决多 LLM 协同开发中模型异构导致的代码风格冲突与编辑兼容性问题,支持跨模型增量编辑。
- 13GraFT:基于 3D 场景图的多模态大语言模型免训练空间推理框架
提出 GraFT 框架,无需微调即可通过注入 3D 场景图结构,显著提升 MLLM 在几何测量、视角转换与细粒度外观定位上的空间推理能力。
- 14
- 15语音脑机接口的通用通信度量标准
提出统一评估语音脑机接口性能的度量框架,解决因数据、记录方式等差异导致结果不可比的问题。
- 16面向网页代理的判别式世界模型
提出判别式世界模型训练目标,使预测状态在候选动作间更具区分性,提升网页代理决策质量。
- 17图机器:通过边实现更优预训练
提出Graph Machine架构,用可微分指针式边动态路由维持O(n)状态规模,替代75%密集Transformer层。
- 18GRADSOLVE:GPU上ODE集成的快速精确梯度计算
提出首个支持GPU上快速反向模式微分的ODE集成器,兼顾求解速度与梯度精度,突破现有工具权衡瓶颈。
- 19面向可信自主机器人的可解释AI决策框架
提出TRACE框架,通过四层可审计结构将机器人动作全程追溯至传感器证据,解决深度学习系统不可审计问题。
- 20用户反馈提供大语言模型无法识别的独特信号
证明用户交互反馈是高价值改进信号,其有效性被当前评估范式偏差掩盖,提出新基准验证其作用。
- 21超越Nesterov的梯度下降下界改进
在光滑凸优化中建立更紧的梯度下降非任意时/任意时收敛下界,刷新多项理论极限。
- 22
- 23后训练语言模型以在编程竞赛中斩获金牌
提出端到端特化流程,训练Nemotron-CC系列模型在IOI/ICPC等顶级编程竞赛中达人类金牌水平。
- 24UE5M3 FP4块缩放实现稳定语言模型预训练
提出E5M3块缩放方案替代传统FP4预训练中的随机Hadamard变换,提升4位浮点预训练稳定性与效率。
- 25
- 26Cliff:从首次错误中学习过程奖励
提出Cliff方法,利用LLM推理链中首个错误位置构建细粒度过程奖励,无需额外奖励模型或教师学生同构假设。
- 27用于电信根因分析的大语言模型:基于证据的结构化推理框架
构建面向5G/6G网络的结构化推理框架,抑制LLM幻觉,提升根因诊断对跨层网络证据的对齐能力。
官方发布
8 条- 01推出WeatherNext 3:我们最先进、最精准的全球天气AI模型
DeepMind发布WeatherNext 3,新一代高精度全球天气预报AI模型,显著提升预测能力。
- 02OpenAI 为一线防御者推出 Daybreak:10 亿美元投入保护关键服务
OpenAI 承诺 10 亿美元,通过前沿网络 AI、培训与支持提升关键基础设施网络安全防护能力。
- 03Playco 使用 GPT-6 Astra 将游戏原型手动修复量减少 50%
Playco 利用 GPT-6 Astra 基于单一灰盒快速生成三款主题游戏原型,手动修复工作量下降一半。
- 04Legora 使用 GPT-6 Astra 在数分钟内审阅 41 份文件
Legora 用 GPT-6 Astra 完成金融文档批量审查,精准识别全部 4 个植入错误,流程效率提升近 40%。
- 05GPT-6 Astra:新一代智能模型
OpenAI发布GPT-6 Astra,号称迄今最智能、对齐度最高模型,显著提升计算机操作、编程、网络安全与科学能力。
- 06安全概览:GPT-6 Astra
GPT-6 Astra 是 OpenAI 首个在预备就绪框架中达到‘关键级’网络安全能力的广泛部署模型。
- 07
- 08