AI星际引擎AI STARSHIP
2026.08.21 星期五
15
共 37 条

今日要闻

20
  1. 01
    AI 提升家庭作业成绩 18%,但考试成绩下降 20%——研究显示

    研究发现学生使用 AI 完成作业后考试表现反而下滑,揭示学习效果与工具依赖间的矛盾

    canews24.online·08/21·30教育应用实证研究学习效果
  2. 02
    编码智能体摧毁了我的身份认同。你有何感受?

    探讨编程类AI代理普及对开发者自我认知与职业身份的冲击,反映人机协作下的心理与社会影响

    news.ycombinator.com·08/21·20AI代理职业身份人机关系
  3. 03
    一名德克萨斯州学生如何揭发一起恶意AI黑客攻击企图

    揭露利用AI工具实施网络攻击的实操案例,凸显AI安全风险与伦理响应机制

    reuters.com·08/21·21AI安全网络攻防伦理监管
  4. 04
    最大运力自动驾驶轻卡落地,来自无人车巨头

    L4级自动驾驶轻卡量产落地,载重4.2吨、容积19.32m³,属AI驱动的智能驾驶基础设施进展

  5. 05
    明略科技携手海康机器人亮相世界机器人大会,以“Agent+具身”联合进入商业机器人场景

    明略科技与海康机器人联合展示具身智能在商业服务机器人中的落地应用,聚焦Agent与物理执行融合。

  6. 06
    雷鸟iO发布:两天续航、全天候主动式AI,轻至34g

    雷鸟创新发布AR眼镜iO,主打全天候主动式AI功能、34克超轻设计与两天续航。

  7. 07
    机器人的GPT-3时刻真·来了!卡卡西上身,看3秒就学会新动作

    机器人通过3秒视频演示即可模仿学习新动作,属具身智能与视觉-动作策略迁移的重要进展。

  8. 08
    美国年轻人日益担忧人工智能将取代他们的工作

    调查显示年轻群体对AI就业冲击存在显著焦虑,反映社会认知与劳动力市场关切。

    pewresearch.org·08/21·20社会影响就业公众认知
  9. 09
    科学家只管提问题,AI负责跑实验:深势科技把科研全流程搬进桌面

    深势科技推出AI驱动的桌面科研平台,实现从问题提出到实验执行的全流程自动化。

  10. 10
    科学家只管提问题,AI负责跑实验:深势科技把科研全流程搬进一个桌面

    深势科技推出AI驱动的科研自动化平台,实现从问题输入到实验模拟的一站式闭环

  11. 11
    设计无边界!中坚科技旗下子公司桦之坚携巨型概念机器人ZERO惊艳2026世界机器人大会

    桦之坚发布人形机器人ZERO,集成多模态感知与具身智能架构,面向通用任务场景

  12. 12
    Jeff Dean离职后首次公开访谈火力有点猛。。。

    Jeff Dean谈及离开谷歌原因:小团队更利于极致聚焦AI基础研究与工程落地。

  13. 13
    WRC最忙机器人:猛干15分钟家务,收纳、补货、叠衣服…

    墨奇机器人在WRC赛事中完成15分钟全流程家务任务,展示具身智能在真实家庭场景的实用化进展。

  14. 14
    国产“预制算力”来了:工厂预制率超90%,24小时内投运,交付效率提升70%

    国内推出面向AI训练与推理的模块化预制算力基础设施,显著缩短部署周期

  15. 15
    首批!优必选行者具身智能大模型完成生成式人工智能服务备案

    优必选‘行者’具身智能大模型通过中国国家网信办生成式AI服务备案,系首批获批模型之一

  16. 16
    三箭齐发!优必选WRC2026全方位展示人形机器人工业、商用、家庭消费应用成果

    优必选在世界机器人大会2026展示人形机器人在工业、商业及家庭场景的落地应用进展

  17. 17
    网易有道2026Q2财报:Q2净收入14.7亿元,AI原生战略加速兑现商业价值

    网易有道2026年Q2财报显示AI原生产品驱动收入增长,验证AI商业化路径

  18. 18
    欧盟版权法不保护AI生成内容

    欧盟法院裁定AI生成内容因缺乏人类作者而不受版权保护,影响AI内容权属与商业化路径。

    mathstodon.xyz·08/21·49版权法律监管AI生成内容
  19. 19
    Show HN:Huzzah——一种新颖的 AI 编程方法

    开源工具 Huzzah 将自然语言指令实时转为可执行代码,支持多语言交互与上下文感知调试。

    danielvaughn.dev·08/21·38AI编程开发者工具开源
  20. 20
    家用 AI 第二部分:多 GPU 漂移

    探讨在家庭环境中使用多 GPU 运行 AI 模型时出现的硬件性能漂移问题及调优实践。

    jdagostino.github.io·08/21·20AI硬件分布式训练家庭计算

前沿论文

11
  1. 01
    ConceptGuard:面向上下文敏感的大语言模型遗忘能力评测基准

    提出首个评估大模型在保留相关知识前提下精准遗忘有害/敏感内容能力的基准,强调上下文依赖的行为级遗忘效果。

  2. 02
    G-CARL:面向患者导向医学报告解读的接地式清单对齐奖励学习

    提出PMRI新任务及G-CARL方法,联合建模医学事实准确性与患者可理解性,通过结构化检查清单对齐奖励实现接地生成。

  3. 03
    TCPα:面向可靠音乐信息检索的边界控制置信度估计

    提出TCPα方法,通过边界控制的后处理置信度估计缓解深度模型过度自信问题,在音乐检索中提供可信预测信号。

  4. 04
    一种面向主动数据采集、出行行为建模与天气敏感需求预测的智能体方法

    构建三智能体工作流,融合聊天机器人问卷采集、结构化处理与行为预测,实现天气情境下的出行模式建模。

  5. 05
    从计算机使用痕迹中诱导任务模型

    利用屏幕截图与操作日志等自然痕迹,构建可审计、可复用的符号化任务模型,支撑真实工作场景中AI智能体的学习与组织治理。

  6. 06
  7. 07
    潘多拉AI模型路由盒:高成本价值估计下的高效分配

    提出异构AI系统查询路由框架,权衡价值估计精度与计算开销,在多模型协同中实现质量-成本最优分配。

  8. 08
    面向结构化电子健康记录临床预测任务的可解释Transformer模型

    提出BERT-LER模型,将实验室检验结果离散化为token并保留分级信息,在EHR预测中兼顾性能与临床事件级可解释性。

  9. 09
    MidTool:面向智能体工具使用的中期训练数据合成

    提出MidTool开源数据构造流程,支持大模型在中期训练阶段专项提升通用工具调用能力。

  10. 10
    幻影增益:基于实测零假设的自我改进审计

    通过冻结对照组严格审计Qwen3-8B的LoRA自训练,发现七类测量伪影,揭示无对照时‘自我改进’结论不可靠。

  11. 11
    注入、对齐、恢复:面向无检索文档知识内化的分阶段后训练

    提出IAR三阶段后训练框架,将固定文档集合转化为参数化知识,实现无需检索的问答。

官方发布

1
  1. 01
    从Atari到《EVE Online》:游戏领域15年AI研究积淀

    DeepMind联合游戏工作室将15年游戏AI研究成果落地,实现实时策略与复杂虚拟世界中的突破性AI玩法。

    deepmind.google·Google DeepMind·08/21游戏AI强化学习产业应用