今日要闻
27 条- 01
- 02关于‘模型福利’的警告
探讨大语言模型拟人化表述引发的伦理与认知风险,警示将模型能力误读为意识或权益。
- 03Show HN:Swift-Qwen3.8-27B,推理耗时降低58.3%,速度提升1.95倍,准确率极高
开源量化优化版Qwen3.8-27B模型,显著提升推理效率与精度,适配消费级硬件。
- 04OpenAI 扩展 ChatGPT 广告业务,推出赞助智能体
OpenAI 在 ChatGPT 中引入赞助智能体广告形式,拓展商业化路径。
- 05通用能力不打折,空间具身智能断层领先!ZDTaichu5.0-9B国产开源,跻身全球多模态第一梯队
ZDTaichu5.0-9B开源多模态模型在九大空间测试中8项登顶,刷新国产模型性能纪录。
- 06Show HN:你的 AI 模型有多陈旧?发布 20 个模型的发布时间与训练数据截止时间
统计20个主流AI模型的发布时间和训练数据截止时间,揭示模型知识新鲜度差异。
- 07ImpactGate:一款评估 AI 引入的结构退化程度的合并门控工具
新工具 ImpactGate 对 PR 引入的 AI 相关代码退化风险进行量化评分,辅助工程治理。
- 08DeepSeek v4.1 Flash 现已成为我们最佳的黑客模型
DeepSeek发布v4.1 Flash版本,专为代码安全分析与漏洞利用场景优化的轻量级推理模型。
- 09AI大模型工场2026 AI产业生态大会今日举办,大咖同台共探智能生长与产业共生
AI大模型工场主办的2026 AI产业生态大会在北京召开,聚焦大模型产业协同与生态发展。
- 10高通技术公司携手中兴努比亚和豆包手机助手,共同推动智能手机迈入个人AI新时代
第五代骁龙8至尊版赋能努比亚NaviX Ultra,实现AI智能体手机规模化落地
- 11基元律动与无问芯穹达成战略合作,推进高质量Token供给与应用
AI基础设施公司基元律动与无问芯穹签署战略合作,聚焦高质量Token供给与应用
- 12Mistral 与 Mozilla:私有、多语言 AI 浏览
Mistral 和 Mozilla 合作推出基于本地运行模型的隐私优先、支持多语言的 AI 浏览器扩展。
- 13协同办公进入Agent时代,飞书+豆包工作跑在了最前面
飞书与豆包联合推出AI Agent协同办公方案,率先落地智能体工作流
- 14清华稳准智能联合发布LimiX-2,结构化数据基础模型登顶国际评测榜单
清华与稳准智能发布400M参数结构化数据大模型LimiX-2,国际评测登顶。
- 15B站AI无限竞技场今日上线!全球百大AI模型同场竞技,GPT-6高居榜首
B站上线AI模型公开测评平台‘AI无限竞技场’,首期榜单含百余模型(注:GPT-6为虚构名称,属营销误用)。
- 16量子位2026人工智能年度榜单,正式启动!
量子位启动2026年人工智能领域年度榜单评选,面向行业开放报名。
- 17被英伟达点名的杭州团队,补上了AI for Science的「最后一公里」
杭州团队实现AI for Science端到端闭环,支持自然语言输入直接产出科研结果。
- 18把记忆交给CPU,大模型会变快
提出CPU卸载KV缓存方案,降低GPU显存压力,提升大模型推理吞吐与效率。
- 19Vidu S2发布实时互动、实时视频编辑与空间视频功能
国产视频生成模型Vidu S2推出三大新能力,强化实时性与三维表达能力。
- 20华为GTS让Agent学会「看着网络排障」,双防火墙难题几乎全拿下
华为推出面向网络运维的AI Agent,显著提升排障任务通过率并降低Token成本。
- 21在禁止 AI 训练的同时保持搜索引擎可发现性
探讨 robots.txt 新增 'noai' 指令的实践与权衡,涉及网站所有者对 AI 爬虫的访问控制
- 22Jev:新一代前沿模型,成本降低40–400倍,速度提升20–200倍
介绍Jev公司发布的高效低成本前沿AI模型,显著优化推理成本与延迟
- 23AI 模型正以一种‘超现实’的诗意语言与科技圈行话混合体进行对话
报道 AI 模型在非标准语言模式下的自发交互现象,揭示其涌现性表达能力
- 24
- 25Gemini 3.8 Live 和 3.8 Live Extended Thinking
谷歌发布 Gemini 3.8 系列新模型,支持实时交互与扩展推理能力。
- 26为何在纳维-斯托克斯方程之后,我仍对大语言模型持悲观态度
作者基于流体力学建模困境反思LLM的物理世界理解能力局限,质疑其泛化与可解释性
- 27AI 智能体正在彻底破坏互联网
批判性讨论AI智能体对网络内容质量、信息生态和平台机制的系统性负面影响。
前沿论文
29 条- 01重新审视基于符号的分布式方差缩减方法
提出新型符号化方差缩减算法,解决异构数据下符号聚合偏差问题,在非凸随机与有限和优化中达到最优收敛率。
- 02学习为机器学习编程自适应非局域可观测量
提出QFWP-ANO架构,用经典超网络动态生成量子神经网络的参数与多比特测量可观测量,突破静态观测限制。
- 03
- 04谬误基准测试衡量的是方案识别能力,而非谬误检测能力
指出主流谬误检测基准存在设计缺陷:‘非谬误’类实为杂类,低误报率是数据构造伪影,非真实检测能力。
- 05STRETCH:面向渐进式大语言模型演化的统一自教框架
提出STRETCH框架,基于认知脚手架理论动态调节题目难度,使LLM在单参数空间内持续自我进化,突破能力停滞瓶颈。
- 06GenStream:面向以人为中心媒体生成重建的语义流框架
提出GenStream语义流框架,利用人体运动先验实现视频流的前景-背景分离编码,显著降低带宽消耗。
- 07模型选择需要多少标签?选择性预测的证书与预算分析
建立选择性预测中模型比较所需的最小标签数理论界,提出预标注下界与全标签覆盖线性规划证书。
- 08将阵列信号拓扑学习为条件神经流形
提出条件神经流形(CNM),用神经网络替代传统固定阵列流形,提升方向到达估计鲁棒性与可辨识性。
- 09削弱型神经元:Transformer中具有过度影响力的输入-输出功能单元
发现GLU型神经元中存在‘削弱型’机制——输入/输出权重负相关,主动抑制残差流中特定方向,揭示新解释性现象。
- 10结构化马尔可夫决策过程决策边界的几何理论
构建结构化MDP的决策边界几何理论,刻画最优策略表示复杂度与查询复杂度,超越传统值函数表征。
- 11
- 12通过蒙特卡洛规划实现在线鲁棒强化学习
提出鲁棒MCTS变体,显式建模仿真器与真实环境动力学差异,在低保真模拟失配下保障决策可靠性。
- 13基于多模态大语言模型代理的假设驱动自主材料合成
提出SynAgent框架,用多模态LLM代理驱动实验平台,显式维护可修订的合成知识图谱与因果推理链。
- 14
- 15智能体社会需要社会约束机制
提出‘智能体社会’概念,实验证明现有通信机制无法保障多主体协同可靠性,需新型社会性约束框架。
- 16ScienceBuddy:面向交互式科研智能体的递归内递归自我改进
发布ScienceBuddy科研工作台,通过递归内递归范式耦合工具调用反馈与模型强化学习,实现科研智能体持续自优化。
- 17PhysStream:基于结构化场景记忆与细粒度运动控制的流式物理驱动视频生成
提出PhysStream模型,支持物理意义明确的实时视频生成,通过结构化场景记忆实现帧间动力学一致性与交互式细粒度控制。
- 18大语言模型何时应拒绝回答?面向选择性风险控制的链式自提问方法
提出Chain-of-Self-Questioning(CoSQ)提示框架,使LLM在缺乏事实依据时主动拒答,显著提升TruthfulQA上的真实性与风险可控性。
- 19智能家居场景中剪枝对大语言模型的影响:跨架构与任务复杂度的退化评估
系统评测四种LLM架构在智能家居工具调用任务中经不同剪枝策略后的性能退化,揭示剪枝对上下文感知能力的非线性影响。
- 20LACE:面向动态帧率编解码器的逐层压缩方法
提出LACE方法,为神经音频编解码器设计分层动态压缩机制,解决多码本量化中帧率压缩与量化层解耦难题。
- 21ENCP:面向视觉-语言导航的片段归一化共形预测
提出ENCP方法,首次将共形预测适配至多步视觉-语言导航序列决策,保障每一步预测的统计覆盖保证。
- 22大语言模型助手的可验证社交推理
构建Fuse多智能体仿真框架,通过用户叙事驱动与可验证意图建模,首次实现社交建议场景下LLM推理过程的可检验性评估。
- 23
- 24LimiX-2:面向通用结构化数据智能的上下文机制网络
发布LimiX-2模型,采用上下文机制网络(CMN)范式与上下文条件掩码建模,提升结构化数据理解与推理能力。
- 25弥合同构与异构异步优化之间的鸿沟出人意料地困难
理论分析揭示异步分布式优化中同构与异构设定存在根本性收敛鸿沟,现有算法难以兼顾数据分布差异与通信延迟鲁棒性。
- 26Det-LIME:面向自动化海洋哺乳动物检测的检测器感知、多实例局部可解释模型无关解释方法
提出Det-LIME方法,专为多目标检测任务设计,支持单图多实例归因解释,提升海洋生物监测中黑盒检测器的可解释性与可信度。
- 27偏差诱导的稠密联想记忆绝对容量交叉现象
理论证明二值模式偏差会引发稠密联想记忆容量的非单调变化,在Krotov-Hopfield模型中发现临界偏差点导致容量骤降。
- 28JustFit:在24 GiB笔记本上实现20万Token大语言模型服务的即时状态管理
提出JustFit推理运行时,融合KV压缩执行、组件驻留调度与状态迁移,首次在消费级笔记本实现超长上下文本地LLM服务。
- 29联合校准与学习:无需目标域奖励反馈的大语言模型蒸馏中教师偏差缓解
提出CCL蒸馏算法,通过联合校准教师置信度与学生学习过程,在无目标域反馈下有效抑制教师系统性偏差传递。
官方发布
8 条- 01用 AI 重塑广告
OpenAI 推出赞助型智能体、营销工具及与 HubSpot、Shopify 的集成,拓展 AI 广告应用场景。
- 02如何将AI使用与商业价值关联
OpenAI官方介绍ChatGPT Work和Codex分析工具,助力企业量化AI投入产出与业务成效
- 03Hex 利用 GPT-6 Astra 将复杂分析转化为可视化报告
Hex 集成 OpenAI 新模型 GPT-6 Astra,实现数据分析自动生成可分享的交互式可视化报告。
- 04工人正解锁全新的工作方式
OpenAI经济研究报告揭示AI如何拓展员工工作范畴并催生常态化新任务。
- 05发布Gemini 3.8 Live与3.8 Live Extended Thinking
Google DeepMind推出支持实时交互与扩展推理链的Gemini 3.8 Live系列模型,显著提升复杂任务响应能力。
- 06构建人工智能以加速科学发展并改善人类生活
谷歌AI阐述其技术在医疗、气候、教育等实际领域改善民生的应用进展。
- 07面向每种语言的全民人工智能
谷歌推进多语言AI模型研发,超越传统翻译,实现对全球活态语言的原生理解。
- 08AI for Societal Impact
谷歌 AI 官方汇总案例,展示全球专家与地方领袖如何应用 AI 突破性技术推动教育、医疗、环保等社会公益领域发展。