今日要闻
19 条- 01发布 HN:Almanac(YC S26)——了解你公司的 AI
YC 孵化项目 Almanac 推出企业知识库增强型 AI 助手,可深度理解内部文档与流程。
- 02发布 HN:赫布式机器人(YC S26)——构建可扩展的机器人数据管道
YC 孵化新创公司推出面向机器人领域的数据采集与处理基础设施,聚焦具身智能底层数据闭环。
- 03
- 04HN 提问:如果贵公司明天起全面停用所有 AI,会发生什么?
开发者社区探讨企业级 AI 依赖现状与退出成本,反映 AI 已深度嵌入实际业务流程。
- 05VC疯了!200万现金冠军奖,又花4000万造了一座AI「创业乌托邦」
国内风投重金打造AI创业加速生态,含高额奖金与实体孵化基地。
- 06苹果因 Mac Mini 和 Mac Studio 的 AI 需求激增而措手不及
报道苹果硬件因AI工作负载需求(如本地大模型推理、AI开发)出现供应紧张,反映AI对终端算力的拉动效应。
- 07AI 编写的代码仍然是你的代码。你接受这一点吗?
探讨开发者对 AI 生成代码的法律与责任归属认知,涉及版权、责任划分等现实问题。
- 08从调和超1000亿笔交易中,我学到的关于AI信任的经验
探讨大规模金融交易系统中AI可信性构建的关键实践与挑战。
- 09DeepSeek-V4-Flash-Vision-Exp
疑似 DeepSeek V4 多模态模型的轻量级视觉推理能力泄露与实验分析。
- 10滴滴自动驾驶新一代车型开启载客测试服务
滴滴新一代Robotaxi R2正式开展无人载客测试,标志L4级自动驾驶商业化落地关键进展
- 11范式与华为达成重磅算力战略合作,成为首批拥抱国产最高端算力底座的AI企业
范式科技联合华为昇腾AI芯片及CANN生态,共建国产化AI算力基础设施,加速大模型训练与推理
- 12Meta 安全研究员的 AI 代理意外删除了她的电子邮件
Meta 研究员在测试自主 AI 代理时发生误操作,导致个人邮箱被清空,暴露AI代理权限与安全边界风险
- 13
- 14欧盟已开始执行《人工智能法案》:首批向模型提供商发出正式问询函(RFI)
欧盟依据《人工智能法案》首次向AI模型提供商发出合规问询,标志法案进入实质执法阶段。
- 15OpenAI 购买数万台 Mac 进行强化学习训练!英伟达的活被苹果抢了
OpenAI 大规模采购 Mac 设备用于 AI 强化学习训练,探索非传统硬件加速路径
- 16全国第三,公司第二,“初创黑马”灵犀智涌用ROSS Harness把机器人送进工业具身智能第一梯队
国产初创公司灵犀智涌依托ROSS Harness系统,以Demo级本体实现在工业具身智能赛道跻身全国前三
- 17AQuA:让量化研究Agent持续进化,也让回测结果经得起检验
推出AQuA系统,赋予量化研究Agent自主识别新证据能力,提升回测稳健性与研究迭代可靠性
- 18Show HN:Academa——由大语言模型生成的长篇 STEM 讲座视频
开源项目Academa利用LLM自动生成高质量STEM领域教学视频,含语音、字幕与可视化,推动AI教育内容生产。
- 19连续扩散语言模型(CDLM)
提出将扩散模型范式扩展至语言建模,实现连续隐空间中的文本生成与编辑。
前沿论文
12 条- 01MURANO:将机制可解释性实验设计为可组合的流水线
提出开源框架Murano,统一LLM机制可解释性研究中加载、归因、干预等多环节工作流,提升可复现性。
- 02SwarmBench:大语言模型能否担任智能体群组协调者?
提出首个面向动态智能体群组(Agent Swarm)的多维评测基准SwarmBench,评估协调能力的准确性、效率与过程质量。
- 03细粒度多图像物体幻觉评测基准
构建首个系统诊断MLLM在多图像跨视觉推理中物体幻觉成因的细粒度基准,聚焦视觉复杂性与推理负荷触发机制。
- 04PyKEEN-NSX:PyKEEN中静态、动态及模式感知负采样模块化框架
为知识图谱嵌入训练提供统一负采样框架,支持结构/语义/嵌入感知的多样化策略,提升链接预测鲁棒性。
- 05发散几何学:通过隐状态轨迹追踪实现自适应多轮推理
将LLM多轮推理建模为隐状态轨迹,利用双信号监测表征漂移,提出资源约束下保持目标一致性的新范式。
- 06
- 07组合、重建与修正预计算记忆的成本
实证分析LLM预计算记忆(KV缓存/压缩)在跨请求复用中的正确性衰减规律及重建开销,揭示其工程适用边界。
- 08BiG-SURE:面向大语言模型与视觉语言模型的二分图语义不确定性与可靠性估计
提出黑盒场景下LLM/VLM不确定性估计器BiG-SURE,基于跨温度语义一致性量化输出可靠性。
- 09三步一走:从动作序列中学习表征的对比强化学习
将对比强化学习扩展至动作块建模,在离线/在线RL中显著提升表征质量,验证多步动作建模的有效性。
- 10GMTS:基于梯度幅值的令牌选择提升LLM推理的RLVR训练效果
提出GMTS方法,通过梯度幅值筛选关键令牌优化RLVR训练,揭示高熵令牌对LLM推理能力提升的内在机制。
- 11REER-PT:面向困惑度引导的预训练数据增强的逆向推理
提出REER-PT框架,从原始预训练文本中逆向挖掘难预测但可推断的续写片段,缓解高质量数据瓶颈。
- 12面向指代表达分割与定位的低成本主动学习
提出仅需原始图像的主动学习方法,自动识别歧义区域以降低指代表达标注成本,推动视觉定位数据高效构建。
官方发布
3 条- 01Polimill 构建日本下一代公共 AI 基础设施
Polimill 基于 OpenAI GPT 和 Codex 构建面向日本地方政府的行政知识检索与开发加速平台。
- 02OpenAI 支持加州推进青少年 AI 安全的法案
OpenAI 公开支持加州SB1119法案,推动面向青少年的适龄AI安全保护机制。
- 03扩大AI可及性的一个里程碑
ChatGPT广告年化营收达10亿美元,并全球扩展,推动免费及低价AI服务普及。