今日要闻
18 条- 01谷歌正通过同态加密使私有 AI 变得实用
谷歌提出基于同态加密的隐私保护AI推理框架,支持在加密数据上直接运行模型,兼顾隐私与实用性。
- 02刚刚,Qwen3.8-27B 开源了!家用显卡也能跑
通义千问新模型 Qwen3.8-27B 开源,支持消费级显卡(如 RTX 4090)本地部署,免费商用。
- 03
- 04
- 05AI 模型图谱——将机器学习模型群体可视化为互连的 3D 图
开源工具 AI Model Atlas 以三维图谱形式可视化全球 ML 模型关系与演进路径,支持模型谱系分析。
- 06HashAgent——通过 URL 共享 AI 代理,基于 WebGPU 在本地运行
开源 AI 代理框架,支持通过链接共享并在浏览器中利用 WebGPU 本地运行,降低部署门槛。
- 07太初元碁助力国家级“AI+教育”大赛 “AI+加速卡模型适配赛道”开启招募
国产AI芯片厂商太初元碁支持国家级AI教育赛事,设立加速卡与大模型适配专项赛道。
- 08刚刚,GLM-5.3发布:Coding更接近Fable 5!潜伏40年的bug都被揪出来了
GLM-5.3大模型发布,提升代码生成能力并修复长期遗留缺陷,同时获评最强开源安全模型。
- 09百度文库网盘「库库AI」AI办公MAU超2500万,新推办公独立端
百度「库库AI」办公产品月活超2500万,上线独立客户端,属AI办公产业化落地进展。
- 10算力需求两年涨10倍,机器人为了走进真实物理世界,正在疯狂「吃算力」
机器人落地需巨量算力,新方案可降本50%、提效80%,推动硬件与AI协同部署。
- 11德塔智能与舞肌科技达成战略合作,联合规范全身协同灵巧操作数据采集
两家AI驱动的机器人公司合作制定全身协同灵巧操作的数据采集标准,推动具身智能训练数据规范化。
- 12GLM-5.3:具备涌现网络能力的前沿编码模型
智谱发布GLM-5.3大模型,显著提升代码生成与网络安全任务能力,支持多语言及复杂推理。
- 13AI 文本水印技术的工作原理
详解AI生成文本水印的嵌入与检测机制,对内容溯源和版权保护具有实践意义。
- 14组织如何使用 AI:来自 ChatGPT 的证据
基于企业用户数据的实证研究,揭示 ChatGPT 在实际工作场景中的采用模式与生产力影响。
- 15
- 16AI正威胁数十亿人的自然资源
分析大模型训练与AI基础设施扩张对电力、水、稀土等自然资源的消耗及环境影响
- 17AI 在家:第一部分——一堆废料
讲述用二手硬件(如旧GPU、树莓派)搭建家庭AI推理/训练环境的实践过程与挑战。
- 18深度体验 DeepSeek Harness,我原谅它涨价了
用户实测 DeepSeek 推出的模型部署平台 Harness,认可其功能升级与定价调整合理性。
前沿论文
15 条- 01AutoDesign:面向长周期智能体设计的元-框架优化
提出AutoDesign框架,通过模型-框架系统实现人类设计先验对齐与经验复用驱动的递归自改进。
- 02OmniScientist:全模态、全学科AI科学家
构建支持跨模态、跨学科科学发现的AI科学家系统,覆盖假设生成到论文撰写的全流程并整合空间/时序等关键科学关系。
- 03HumanTracker:面向全面且符合人类认知的运动追踪基准
提出HumanTracker基准,聚焦接触动力学与长期行为,解决现有运动追踪评估忽略物理合理性(如足部滑动)的问题。
- 04面向在线概率预测的防御性提升方法
提出新型在线提升算法,兼顾Brier分数竞争性与弱假设类失效时的鲁棒性,适用于对抗性二元预测场景。
- 05多标签Jaccard度量的指数凸校准维度
证明Jaccard损失矩阵的仿射维度为2^s−1,结合MinHash与Möbius反演给出严格理论刻画。
- 06QuoteBench:匹配得分如何掩盖命令路径失效
揭示LLM编码代理中命令生成与执行传输环节的失效边界,通过精确终态验证暴露接口解析导致的隐性错误。
- 07LittleLearner:在教学法控制的知识暴露下训练语言模型
构建小学知识限定语料库LITTLECURRICULUM,训练5B参数模型以可控方式研究语言模型知识习得机制。
- 08SAEVerbalizer:通过表征口语化生成稀疏自编码器特征解释
提出SAEVerbalizer框架,将SAE解码方向注入LLM表征并微调,直接生成可解释的特征描述,避免外部行为观察。
- 09DARTree:基于自回归草稿树的推测式扩散解码
提出DARTree,融合扩散建模与自回归树结构,在并行生成中保持路径条件依赖,提升推测解码效率与准确性。
- 10Vero:AI智能体能否构建形式化验证的软件仓库?
提出首个端到端评测基准Vero,检验AI智能体是否能同步生成代码及机器可验证证明,推动可信AI编程。
- 11掩蔽扩散的数据几何:基于解掩蔽增长复杂度的认证最优调度
提出解掩蔽增长复杂度(UGC)度量,统一分析离散采样中掩蔽扩散的KL离散误差,导出最优调度策略。
- 12干预感知型临床世界模型用于心内科术后结局预测
构建动态临床世界模型,显式建模术后异步干预、用药调整与生理变化,提升风险评估时序建模能力。
- 13DFM Mimir v1:仅使用合规后训练数据实现前沿性能的开源HRM模型
发布10亿参数开源模型Mimir v1,基于HRM架构,仅用合规数据集训练,在英语和丹麦语任务上达SOTA。
- 14跨语言模型预训练的任务无关训练数据影响度量
提出无需下游任务或验证集的训练数据影响度量方法,基于模型内部表征稳定性进行归因。
- 15Bagging 可稳健学习 VC 类,样本复杂度为线性
证明 Bagging 方法可实现对抗鲁棒学习,样本复杂度仅线性依赖 VC 维,较此前指数界显著提升。
官方发布
2 条- 01推出 Gemini 3.7 Flash
Google DeepMind 发布轻量级高性能 Gemini 3.7 Flash 模型,面向低延迟实时场景。
- 02用 Sheets 画布让电子表格数据生动起来
Sheets 画布支持通过自然语言提示生成交互式仪表盘、学习追踪器等可视化工具。