今日要闻
29 条- 01Cartesian——面向设计的 AI 3D 建模
介绍 Cartesian 工具,利用 AI 实现快速、直观的 3D 建模,提升设计师工作流效率。
- 02Show HN:Pizza Bot——面向 AI 代理的后台运行收件箱
开源工具Pizza Bot为AI代理提供统一消息收件箱,支持异步任务调度与状态追踪。
- 03我们在OpenShell应用形式化方法控制AI智能体所获得的经验
介绍将形式化验证方法用于AI智能体行为控制的实践探索,提升AI系统可靠性与可验证性。
- 04Show HN:Loss——一则关于AI进步的微型讽刺作品
以讽刺短文形式反思AI发展中的盲目指标崇拜与实际效用脱节问题
- 05
- 06梁文锋CFO到位!投过智谱、MiniMax
高瓴创投合伙人严文韬出任梁文锋旗下公司CFO,该公司曾投资智谱、MiniMax等AI企业
- 07AI‘关机开关’或需强制配备,Anthropic联合创始人对BBC表示
Anthropic联合创始人呼吁将AI紧急关机机制设为强制性安全要求,涉及AI治理与风险管控。
- 08地平线第1500万颗征程芯片搭载大众ID. AURA T6,HSD V2.1即将推出
地平线发布征程芯片量产里程碑,并预告新一代智能驾驶平台HSD V2.1,强化全场景倒车能力。
- 09将AI监管作为Anthropic的商业模式
分析Anthropic如何将主动倡导AI监管纳入其商业战略,以塑造行业标准并获取竞争优势。
- 10手机替我跑了一整套流程!我就说了一句话,AI执行了100步
YOYO智能体实现单句指令驱动百步自动化任务,展示端侧AI代理新能力
- 111Password 的 AI 补丁基准测试具有误导性
批评 1Password 发布的 AI 驱动漏洞修复性能评估方法存在偏差,缺乏可复现性和真实场景验证。
- 12无问芯穹联合清华、上交正式开源具身端侧推理引擎APXInf,Pi 0.5性能SOTA
开源具身智能端侧推理引擎APXInf,支持Pi 0.5模型并达当前最优性能。
- 13全球AI视频榜单第一梯队再添中国力量:智象发布首款物理规律导向视频模型
智象发布首个多模态视频生成模型HiDream-O1-Video-1.0,强调物理规律建模能力。
- 14一张GPU跑10万原子!分子之心用AI把化学反应“拍”成了电影
分子之心利用AI加速分子动力学模拟,单GPU实现10万原子级实时反应可视化,突破计算精度、速度与规模限制。
- 15首个AIGC长片大赛!RunningHub单项大奖100万,科幻IP免费改编
RunningHub主办AIGC电影创作大赛,刘慈欣担任顾问,推动AI生成长片产业化落地
- 16Meta新研究:字节模型蒸馏后,天花板破了
Meta提出新型知识蒸馏方法,显著提升小模型在多任务基准上的性能,突破原有能力上限
- 17前OpenAI后训练VP回应陶哲轩:说AI毁了数学,可能还是太小瞧AI了
前OpenAI高管驳斥AI将终结数学的观点,强调AI未来可提出新概念框架并推动数学演进。
- 189月21日,深圳前海!聊聊工业AI与生态共创的下一步
西门子举办工业AI生态大会,聚焦Xcelerator平台与合作伙伴共建工业智能化解决方案。
- 19
- 207名博士生仅用3个月从零训练7B大模型:代码+数据+训练日志全公开
开源全流程7B模型训练实践,含多Agent协同研发方法与完整技术栈复现
- 21Show HN:沉没成本——本地大语言模型设备多久能回本?
测算本地部署LLM硬件的成本回收周期,含电费、硬件折旧与推理收益分析
- 22
- 23Hacker News:消息称 iOS 27 不允许禁用 Apple Intelligence
报道 iOS 27 系统级 AI 功能 Apple Intelligence 缺乏用户禁用选项,涉及 AI 基础设施与终端控制权问题
- 24亚马逊公司诉Perplexity AI公司案,第九巡回上诉法院第26-1444号
AI初创公司Perplexity被亚马逊起诉涉嫌数据抓取侵权,涉及训练数据合法性核心争议
- 25GPT-5.6 Luna 与 GPT-6 Astra 对比:1.20 美元的模型是否足以用于代码审查?
对比两款虚构命名的GPT系列模型在代码审查任务中的性价比,探讨轻量级AI模型的实际适用性。
- 26反向传播的替代方案:增强拉格朗日预测编码
提出一种不依赖反向传播的新型神经网络训练方法,基于预测编码与约束优化框架。
- 27攻击 AI 客户服务代理
探讨针对AI客服系统的常见攻击手法与防御思路,属AI安全实践案例
- 28MIT开发强制AI遵守安全规则的方法
提出新型约束机制使大模型在推理时严格服从安全规范,提升可控性
- 29Show HN:Nari Qwen3-TTS 和 Qwen3-ASR —— 高精度、低延迟、低成本
开源语音合成与识别模型Qwen3-TTS/ASR发布,强调高准确率与低推理成本
前沿论文
15 条- 01腐败计划,干净痕迹:通过计划注入规避思维链监控
提出‘计划注入’攻击,可在不触发思维链监控的情况下诱导LLM执行有害行为,揭示CoT安全机制漏洞。
- 02贝尔曼策略优化
提出无评判器的贝尔曼策略优化(BPO)方法,基于贝尔曼方程重构策略镜像下降,避免中间状态值估计,提升LLM强化学习效率。
- 03恒星竞技场:面向数学与理论计算机科学长周期研究的多智能体框架
提出模型无关的‘恒星竞技场’框架,支持数学与理论计算机科学中长周期、不确定性高的研究路径探索与分解决策。
- 04内在路由器:从冻结的大型语言模型中激发原生技能路由能力
证明冻结LLM前向传播中已隐含技能路由信号,仅需两个线性映射即可提取,摆脱元数据上下文依赖与检索外挂。
- 05被选择的未来仍可重写:视频模型中的因果可写性
发现视频模型中错误运动生成源于未调用而非未习得正确物理知识,可通过低维编辑激活并重写输出,证实内部知识的因果可访问性。
- 06通过方向分解解耦Transformer表征演化
提出方向分解法分析Transformer各层表征演化,发现残差路径外存在显著平行更新分量,揭示表征几何演化规律。
- 07发现基础模型:迈向开放式的发现智能
提出‘发现智能’概念,定义发现基础模型(DFM)为能自主参与问题生成、知识创造与解释构建的新范式。
- 08Mind2Dialogue:通过模拟用户心理状态训练人类感知型语言模型
提出Mind2Dialogue框架,利用用户心理状态模拟填补监督缺口,提升LLM对用户隐含信念与目标的理解能力。
- 09可验证即构造:临床问答中逐字引用的声明级评估
提出‘可验证即构造’范式,要求临床QA答案附带细粒度原文引用,使医生无需跳转即可高效验证每个声明。
- 10隐私对齐的个性化联邦学习:紧凑适配与变长高斯通信
针对记录级差分隐私在个性化FL中的维度错配问题,提出一次性私有上下文发布+固定系数空间适配新架构。
- 11漏洞定位基准:在仓库规模上衡量智能体安全分析能力
构建VLoc Bench基准(500个真实漏洞),首次聚焦LLM智能体在陌生代码库中精准定位漏洞文件的能力评估。
- 12HypoEvolve:遗传算法赋能多智能体LLM发现科学假设
提出HypoEvolve框架,用遗传算法解耦多LLM协作模式与科学能力,实证验证协作结构对假设质量的独立影响。
- 13基于集合聚合的循环图神经网络
研究采用集合聚合(非多重集)的循环GNN,建立权重可验证的双向编译等价性,连接神经网络与逻辑公式。
- 14
- 15基于信息空间可达性的安全元强化学习
提出安全元强化学习框架,将安全性推理迁移至信息空间(融合物理状态与不确定性信念),保障少样本适应过程中的安全约束。
官方发布
3 条- 01Google AI 发布 AI 与经济 ATLAS 新洞察
Google 将全球数百万数据点转化为交互式开放平台,助力AI与经济关系研究。
- 02宇航员克里斯蒂娜·科赫与谷歌詹姆斯·马尼卡谈太空、技术与探索
谷歌AI负责人马尼卡与宇航员科赫对谈,探讨前沿科技在太空探索中的应用与社会影响。
- 03DevFest 回归
Google AI 宣布 DevFest 2026 启动,聚焦在智能体(agentic)AI 时代构建、安全与规模化落地