今日要闻
25 条- 01陆川手搓历史现场,王珞丹熬夜抽卡,阿里全模态开始兜底生产
阿里宣布三年内将推出原生全模态统一生成模型,打破文本、图像、视频等模态边界。
- 02Agent时代,CPU的价值该重估了
在AI Agent架构下,CPU与GPU算力需求趋近1:1,传统CPU角色正被重新定义。
- 03直播预告:未来两三年,哪些工业AI场景会率先爆发?
探讨工业AI从试点落地到规模化应用的关键路径与首批高潜力落地场景。
- 04讲真,我没看出这图是AI做的,更没想到是国产AI做的
商汤科技发布全新文生图大模型U1 Pro,强调高保真与国产自主生成能力
- 05
- 06Show HN:仅通过网页结构训练模型识别 AI 生成内容
提出仅依赖 HTML 结构特征检测 AI 生成网页内容的新方法,无需文本分析,具轻量部署潜力。
- 07WebArena作者Shuyan Zhou入职Meta超级智能实验室
AI研究者Shuyan Zhou加入Meta超级智能实验室,聚焦具身智能与实用AI浏览器研发
- 086天烧光2000多万,拿下开源第一!小米史无前例「炼丹直播」收官
小米公开直播大模型训练全过程,6天投入超2000万元,获Hugging Face CEO高度评价
- 09JetBrains Air:面向智能体软件开发的产品体系
JetBrains 推出新开发范式产品套件 Air,支持以智能体(Agentic)方式构建软件。
- 10基元律动韩凯:从多模型调度到反馈闭环,探索Agent持续进化
基元律动CTO在云栖大会分享Agent系统架构演进,提出Harness到RSI飞轮的持续进化方法论。
- 11别让一部片子倒在交付前:SkyProduction 抢先首发短剧质检
SkyProduction发布AI驱动的短剧自动化质检系统,支持字幕、音画、内容底线三维度批量检测并生成结构化报告。
- 12研究:9至18岁青少年弃用谷歌转向AI,后果未知
调查显示青少年正将AI工具作为主要信息检索替代方案,引发对认知习惯与信息质量影响的担忧。
- 13虎鲸文娱推出“鲸锐AI”影视制作与管理平台,打造文娱产业新基建
虎鲸文娱在云栖大会发布首个AI影视制作与管理平台“鲸锐AI”,聚焦AIGC与流程智能化。
- 14阿里研究员透露Qwen4.5后模型将扩展至5-10T参数
Qwen系列大模型下一代版本参数规模将达5–10万亿,标志超大规模模型持续演进。
- 15阿里公布全模态模型新进展,Qwen4和下代视频模型均在训练中
阿里巴巴在云栖大会宣布Qwen4及新一代视频生成模型正在训练,推进全模态AI能力落地。
- 16阿里巴巴:机器智能时代,坚定投入AI模型、AI芯片、AI云三大基石
阿里CEO吴泳铭宣布将长期战略投入AI模型、AI芯片和AI云三大基础设施建设。
- 17阿里吴泳铭最新演讲:未来机器思考的总量将达到人类的1000倍以上
吴泳铭在云栖大会提出‘机器思考总量超人类千倍’的强AI演进判断,属AI战略前瞻观点。
- 18AI算力之争不靠堆卡!浪潮信息捅破智算「能力天花板」,还瓦解了「产能焦虑」
浪潮信息通过架构创新提升AI算力效率,缓解芯片供应紧张下的智算性能与产能瓶颈。
- 19罗宾·威廉姆斯女儿致制作AI视频的粉丝:‘请有点羞耻心’
演员罗宾·威廉姆斯之女公开谴责未经许可使用其父形象生成AI视频的行为,引发关于数字遗产与AI伦理的讨论。
- 20
- 21
- 22AI 编程使持续集成(CI)成为瓶颈,因此我们重构了 CI 系统以跟上节奏
针对AI编程引发的CI高频、细粒度提交问题,团队重构CI流程提升吞吐与反馈速度。
- 23在您自己的硬件上运行前沿 AI
探讨本地部署大模型的技术路径与硬件要求,对私有化AI应用有实践参考价值。
- 24
- 25亚马逊阻止Meta新推出的Muse AI代理在amazon.com上购物
亚马逊封禁Meta的Muse AI自动化购物代理,反映AI代理在电商场景的实际落地冲突与平台治理问题。
前沿论文
29 条- 01OMatG-flash:一种用于可扩展材料发现的全原子流图,结合强化伴随匹配
提出OMatG-flash模型,通过全原子流图加速无机晶体结构预测与从头生成,属AI驱动的材料科学前沿研究。
- 02结合分层认知过程与过程监督以实现可解释的场景安全理解
提出融合人类认知过程建模与过程监督的方法,提升场景安全理解的可解释性与可靠性,属AI可解释性研究。
- 03扩散模型中的双重下降与恶性过拟合
揭示扩散模型中过参数化导致恶性而非良性过拟合,挑战传统双下降假设,属基础模型理论重要发现。
- 04TimeInteract:面向流式时间序列的实时交互式智能
提出TimeInteract范式,支持模型在持续接收时序数据的同时与用户实时交互,突破静态TSLM局限。
- 05大语言模型代码理解中的词汇迷信:在低词汇质量代码上的再评估
发现LLM过度依赖标识符名称等词汇线索进行代码理解,提出Face/Off框架验证语义鲁棒性缺陷。
- 06基于真实世界医疗数据的带引导学习延迟决策
在真实医疗影像数据上验证学习延迟(L2D)方法,实现AI与医生协同决策,提升临床部署安全性。
- 07面向GROBID的布局引导掩码:大规模学术PDF解析中的轻量级结构增益
改进开源PDF解析器GROBID,引入CPU轻量布局检测模块,提升学术文献结构化解析精度与效率。
- 08MAVP:面向移动操作的图感知视觉运动策略
提出MAVP框架,通过地图感知预测基座位姿并闭环跟踪,显著提升移动机械臂空间定位与操作可靠性。
- 09
- 10HySparse2:两级KV共享的混合稀疏注意力机制
设计HySparse2架构,通过两级KV共享优化长上下文预填充与缓存效率,适配长程多轮智能体场景。
- 11GitScholar:基于GitHub参与度预测AI研究影响力的数据库
构建GitScholar数据集,首次系统验证GitHub活跃度可作为AI论文影响力的有效早期预测指标。
- 12PACT:从信用分配到批评者对齐
形式化定义LLM强化学习中token级信用分配的三大公理,为RLHF等算法提供统一数学基础。
- 13
- 14TransBERT:面向领域特定语言建模的合成翻译框架
提出TransBERT框架,仅用合成翻译文本预训练法语生命科学领域语言模型,达SOTA性能。
- 15GameHorizon Suite:游戏玩法中的多时间尺度数据与评测
提出GameHorizon统一评测套件,解决现有游戏AI基准覆盖窄、缺语言指令、依赖高方差在线 rollout等问题。
- 16Critical-State RL:面向多轮工具调用的可训练状态诊断方法
提出Critical-State RL方法,精准识别多轮交互中真正需优化的关键模型调用状态,避免奖励噪声干扰训练信号。
- 17WorldCrafter:具备隐式3D感知记忆的一致性视频世界模型
提出WorldCrafter视频世界模型,通过视角驱动的隐式3D记忆压缩机制,提升长时序与跨视角下的观测一致性。
- 18onPanda:基于词元级修正的LLM对齐数据与智能体轨迹高效标注工具
提出onPanda交互式标注工具,支持词元级实时修正与截断重生成,显著提升对齐数据和智能体轨迹标注效率。
- 19面向端侧大语言模型生成式个性化适配的LoRA生成超网络
提出LoRA生成超网络,在移动端有限算力下动态生成轻量LoRA适配器,实现用户行为模式驱动的高效个性化。
- 20DexTacWAM:面向灵巧操作的视触觉世界-动作模型
提出DexTacWAM模型,融合独立指尖触觉编码与姿态感知压缩,首次在世界-动作模型中显式建模不可见接触动力学。
- 21Harness-Zero:基于代理即测试台的代理测试台蒸馏方法
提出Harness-Zero框架,将领域定制化代理测试台(harness)的知识蒸馏至通用代理中,解耦部署性能与专用测试台依赖。
- 22RRSI:面向代理测试台的正则化递归自我改进方法
提出RRSI方法,在代理测试台组件级递归优化中引入正则化,缓解任务过拟合,提升跨任务泛化鲁棒性。
- 23DolphinBench:代理记忆帕累托前沿测绘基准
发布DolphinBench基准,首次在真实动作序列约束下评估代理长期记忆的成本-精度-时延三维权衡。
- 24基于迭代失准的稀有事件概率估计方法
提出迭代失准算法,高效估计智能体随机策略下灾难性稀有事件的发生概率,突破轨迹空间组合爆炸瓶颈。
- 25
- 26Jev用于科学决策:语义选择及其后果评估
将Jev作为语义决策组件嵌入科学工作流,评估不同模型配置在12种科学场景中对关系选择的语义准确性影响。
- 27生成式教程:面向物理任务的实时上下文化视觉指导
提出生成式教程框架,利用实时环境感知生成适配用户当前工具/空间的视觉操作指引,弥补静态教程泛化不足。
- 28JAREX:面向多目标算法化工艺表征的采集函数
提出JAREX采集函数,提升贝叶斯优化在制药工艺多维参数空间中识别合格边界(pass/fail)的效率与精度。
- 29从不完美先祖中学习物理规律
提出神经算子(NO)与物理信息神经网络(PINN)联合范式:用降质NO初始化PINN,克服其局部极小与物理误收敛问题。
官方发布
2 条- 01使用 GPT-6 Astra 将研究时间与成本减半
Parallel 公司利用 GPT-6 Astra 显著提升劳动力市场数据分析效率,耗时和成本均降低50%。
- 02有效第三方评估的优先事项与原则
OpenAI 发布前沿AI模型及安全机制第三方评估的严格性、安全性与独立性原则。