AI星际引擎AI STARSHIP
2026.08.14 星期五
8
共 39 条

今日要闻

18
  1. 01
    谷歌正通过同态加密使私有 AI 变得实用

    谷歌提出基于同态加密的隐私保护AI推理框架,支持在加密数据上直接运行模型,兼顾隐私与实用性。

    blog.google·08/14·21隐私计算同态加密AI安全
  2. 02
    刚刚,Qwen3.8-27B 开源了!家用显卡也能跑

    通义千问新模型 Qwen3.8-27B 开源,支持消费级显卡(如 RTX 4090)本地部署,免费商用。

  3. 03
  4. 04
  5. 05
    AI 模型图谱——将机器学习模型群体可视化为互连的 3D 图

    开源工具 AI Model Atlas 以三维图谱形式可视化全球 ML 模型关系与演进路径,支持模型谱系分析。

    run.cosmograph.app·08/14·21模型可视化开源工具机器学习
  6. 06
    HashAgent——通过 URL 共享 AI 代理,基于 WebGPU 在本地运行

    开源 AI 代理框架,支持通过链接共享并在浏览器中利用 WebGPU 本地运行,降低部署门槛。

    hashagent.pages.dev·08/14·24AI代理WebGPU开源框架
  7. 07
    太初元碁助力国家级“AI+教育”大赛 “AI+加速卡模型适配赛道”开启招募

    国产AI芯片厂商太初元碁支持国家级AI教育赛事,设立加速卡与大模型适配专项赛道。

  8. 08
    刚刚,GLM-5.3发布:Coding更接近Fable 5!潜伏40年的bug都被揪出来了

    GLM-5.3大模型发布,提升代码生成能力并修复长期遗留缺陷,同时获评最强开源安全模型。

  9. 09
    百度文库网盘「库库AI」AI办公MAU超2500万,新推办公独立端

    百度「库库AI」办公产品月活超2500万,上线独立客户端,属AI办公产业化落地进展。

  10. 10
    算力需求两年涨10倍,机器人为了走进真实物理世界,正在疯狂「吃算力」

    机器人落地需巨量算力,新方案可降本50%、提效80%,推动硬件与AI协同部署。

  11. 11
    德塔智能与舞肌科技达成战略合作,联合规范全身协同灵巧操作数据采集

    两家AI驱动的机器人公司合作制定全身协同灵巧操作的数据采集标准,推动具身智能训练数据规范化。

  12. 12
    GLM-5.3:具备涌现网络能力的前沿编码模型

    智谱发布GLM-5.3大模型,显著提升代码生成与网络安全任务能力,支持多语言及复杂推理。

  13. 13
    AI 文本水印技术的工作原理

    详解AI生成文本水印的嵌入与检测机制,对内容溯源和版权保护具有实践意义。

    declaude.org·08/14·33AI安全内容溯源水印技术
  14. 14
    组织如何使用 AI:来自 ChatGPT 的证据

    基于企业用户数据的实证研究,揭示 ChatGPT 在实际工作场景中的采用模式与生产力影响。

    cdn.openai.com·08/14·29AI应用实证研究企业落地
  15. 15
  16. 16
    AI正威胁数十亿人的自然资源

    分析大模型训练与AI基础设施扩张对电力、水、稀土等自然资源的消耗及环境影响

    unric.org·08/14·46AI能耗可持续发展资源消耗
  17. 17
    AI 在家:第一部分——一堆废料

    讲述用二手硬件(如旧GPU、树莓派)搭建家庭AI推理/训练环境的实践过程与挑战。

    jdagostino.github.io·08/14·30DIY边缘AI硬件部署
  18. 18
    深度体验 DeepSeek Harness,我原谅它涨价了

    用户实测 DeepSeek 推出的模型部署平台 Harness,认可其功能升级与定价调整合理性。

前沿论文

15
  1. 01
    AutoDesign:面向长周期智能体设计的元-框架优化

    提出AutoDesign框架,通过模型-框架系统实现人类设计先验对齐与经验复用驱动的递归自改进。

  2. 02
    OmniScientist:全模态、全学科AI科学家

    构建支持跨模态、跨学科科学发现的AI科学家系统,覆盖假设生成到论文撰写的全流程并整合空间/时序等关键科学关系。

  3. 03
    HumanTracker:面向全面且符合人类认知的运动追踪基准

    提出HumanTracker基准,聚焦接触动力学与长期行为,解决现有运动追踪评估忽略物理合理性(如足部滑动)的问题。

  4. 04
    面向在线概率预测的防御性提升方法

    提出新型在线提升算法,兼顾Brier分数竞争性与弱假设类失效时的鲁棒性,适用于对抗性二元预测场景。

  5. 05
    多标签Jaccard度量的指数凸校准维度

    证明Jaccard损失矩阵的仿射维度为2^s−1,结合MinHash与Möbius反演给出严格理论刻画。

  6. 06
    QuoteBench:匹配得分如何掩盖命令路径失效

    揭示LLM编码代理中命令生成与执行传输环节的失效边界,通过精确终态验证暴露接口解析导致的隐性错误。

  7. 07
    LittleLearner:在教学法控制的知识暴露下训练语言模型

    构建小学知识限定语料库LITTLECURRICULUM,训练5B参数模型以可控方式研究语言模型知识习得机制。

  8. 08
    SAEVerbalizer:通过表征口语化生成稀疏自编码器特征解释

    提出SAEVerbalizer框架,将SAE解码方向注入LLM表征并微调,直接生成可解释的特征描述,避免外部行为观察。

  9. 09
    DARTree:基于自回归草稿树的推测式扩散解码

    提出DARTree,融合扩散建模与自回归树结构,在并行生成中保持路径条件依赖,提升推测解码效率与准确性。

  10. 10
    Vero:AI智能体能否构建形式化验证的软件仓库?

    提出首个端到端评测基准Vero,检验AI智能体是否能同步生成代码及机器可验证证明,推动可信AI编程。

  11. 11
    掩蔽扩散的数据几何:基于解掩蔽增长复杂度的认证最优调度

    提出解掩蔽增长复杂度(UGC)度量,统一分析离散采样中掩蔽扩散的KL离散误差,导出最优调度策略。

  12. 12
    干预感知型临床世界模型用于心内科术后结局预测

    构建动态临床世界模型,显式建模术后异步干预、用药调整与生理变化,提升风险评估时序建模能力。

  13. 13
    DFM Mimir v1:仅使用合规后训练数据实现前沿性能的开源HRM模型

    发布10亿参数开源模型Mimir v1,基于HRM架构,仅用合规数据集训练,在英语和丹麦语任务上达SOTA。

  14. 14
    跨语言模型预训练的任务无关训练数据影响度量

    提出无需下游任务或验证集的训练数据影响度量方法,基于模型内部表征稳定性进行归因。

  15. 15
    Bagging 可稳健学习 VC 类,样本复杂度为线性

    证明 Bagging 方法可实现对抗鲁棒学习,样本复杂度仅线性依赖 VC 维,较此前指数界显著提升。

官方发布

2
  1. 01
    推出 Gemini 3.7 Flash

    Google DeepMind 发布轻量级高性能 Gemini 3.7 Flash 模型,面向低延迟实时场景。

    deepmind.google·Google DeepMind·08/14大模型发布轻量化多模态
  2. 02
    用 Sheets 画布让电子表格数据生动起来

    Sheets 画布支持通过自然语言提示生成交互式仪表盘、学习追踪器等可视化工具。

    blog.google·Google AI·08/14办公AI数据分析低代码