AI星际引擎AI STARSHIP
2026.10.02 星期五
第 57 期
共 34 条

今日要闻

14 条
  1. 01
    Mozilla 关停 Solo AI 网站生成器

    Mozilla 官方终止其基于AI的低代码网站构建工具 Solo,反映AI原生应用商业化收缩

    support.soloist.ai·5小时前·▲ 27产品发布产业动态
  2. 02
    在多数信息被隐藏的情况下,游戏《战略棋》(Stratego)曾长期难倒人工智能,直至如今

    AI首次在完全信息不透明的经典博弈游戏Stratego中实现超人类水平,突破不完全信息博弈技术瓶颈

    arstechnica.com·6小时前·▲ 36游戏AI不完全信息博弈技术突破
  3. 03
    决策模型(如 Jev)无法超越大语言模型作为评判器或传统分类器

    实证比较显示专用决策模型在判别任务上未优于LLM-as-a-judge或传统分类器。

    developers.redhat.com·7小时前·▲ 20模型评估LLM评测决策模型
  4. 04
    在混乱的真实企业知识上对智能体的检索能力进行基准测试

    评估RAG与智能体在真实企业非结构化文档中的检索性能,揭示现有方法在噪声数据下的局限性

    kapa.ai·7小时前·▲ 20智能体检索增强基准测试
  5. 05
    openJiuwen X-Router自演进模型路由技术首发,昇腾亲和,Agent越跑越省,实测减少50+% Token消耗

    openJiuwen发布自演进模型路由技术X-Router,适配昇腾硬件,显著降低Agent推理Token消耗。

    qbitai.com·13小时前模型路由推理优化Agent
  6. 06
    丘成桐新论文致谢了GPT和Claude

    数学家丘成桐在新论文中公开致谢GPT与Claude等AI模型辅助研究,反映大模型在基础科研中的实际应用。

    qbitai.com·13小时前学术应用大模型科研辅助
  7. 07
    arXiv最严新规!每人每月最多提交2篇,拒稿不退额度

    arXiv平台实施投稿限额新规,每人每月限2篇且拒稿不返还配额,旨在遏制低质灌水,影响AI等领域预印本发布节奏。

  8. 08
    AI教父杨立昆:Anthropic首席执行官妄想,不理解网络安全

    Yann LeCun公开批评Anthropic CEO对网络安全的认知存在根本性误解,涉及AI安全理念分歧。

    fortune.com·14小时前·▲ 21AI安全行业争议专家观点
  9. 09
    Aweb——面向 AI 智能体的通信协议

    提出专为AI智能体间通信设计的轻量级协议Aweb,解决多智能体协作中的互操作性问题。

    aweb.ai·22小时前·▲ 22AI智能体通信协议多智能体系统
  10. 10
    不要被这个夏天的AI炒作所蒙蔽

    批判当前AI领域过度宣传与实际能力脱节的现象,呼吁理性看待技术进展。

    technologyreview.com·23小时前·▲ 24AI炒作技术反思产业观察
  11. 11
  12. 12
    Show HN:Breadcrumb——记录 Mac 上所有操作的工具 + AI 上下文管理器

    一款 macOS 应用,自动记录用户所有操作并为 AI 提供实时上下文支持,提升 Agent 工作流效率。

    innerloop.works·1天前·▲ 20AI Agent开发工具桌面应用
  13. 13
    Show HN:投票选出 Hacker News 提出的 AI 挑战中哪些已被实现

    Hacker News 社区发起投票,评估其历史上提出的 AI 挑战(如通用问答、代码生成等)当前完成情况。

    stoppels.ch·1天前·▲ 29社区评估AI能力进展基准测试
  14. 14
    消费者对 AI 的疲劳感已压倒一切,本地企业应重新考虑使用

    分析当前用户对消费级AI产品产生倦怠的原因,并建议本地企业基于实际场景审慎评估AI应用价值。

    residentnewsnetwork.com·1天前·▲ 21AI应用用户体验商业策略

前沿论文

14 条
  1. 01
    一个基底驱动全部动画:面向实时虚拟形象的高斯混合形变蒸馏

    提出GALA方法,用线性组合身份无关混合形变替代每帧神经解码,实现高斯虚拟形象实时动画。

  2. 02
  3. 03
    重建、练习、进入真实:具身智能体的引导式自我提升

    提出RPG框架,通过离线数据识别操作能力、在仿真中构建练习任务,实现无需权重更新的机器人系统自主改进。

  4. 04
    嵌入预测助力图像生成

    提出NEPA方法,用Transformer预测连续嵌入序列,以动态条件替代扩散Transformer中静态文本/标签嵌入,提升生成质量。

  5. 05
    ScholarCatalyst:检索激发新研究论文的基准

    构建首个基于真实科研者引用溯源的基准,评估AI检索能启发原创研究的先驱论文的能力。

  6. 06
    SILSA:用于保持拓扑结构的高分辨率3D生成的滑动窗口切片隐变量

    提出SILSA框架,用紧凑滑动窗口切片隐变量表征形状,解决高分辨率3D生成中拓扑不一致与计算碎片化问题。

  7. 07
    VISTA:面向交互世界的视觉推理评测框架

    提出VISTA视觉评测框架,赋予多模态模型长视野与无损视觉记忆,解锁其在多样化交互环境中的推理潜力。

  8. 08
    TACO:面向大语言模型微调的三值绝对最大列稀疏优化器

    提出TACO优化器,通过三值化与列稀疏设计大幅降低LLM全参数微调的优化器状态内存开销。

  9. 09
    FERPO:前向熵正则化策略优化

    提出FERPO算法,通过前向熵正则化改进策略梯度更新,提升连续控制中在线强化学习的策略稳定性与性能。

  10. 10
    图上成本增强型薛定谔桥精确可解:费曼-卡茨倾斜替代学习控制

    证明图上成本增强薛定谔桥可通过费曼-卡茨倾斜转化为无惩罚标准桥,实现精确解析求解,避免学习控制率。

  11. 11
    分层连续扩散语言模型

    提出分层连续扩散架构,在共享连续隐状态上建模token依赖,克服离散扩散中并行采样导致的边际独立缺陷。

  12. 12
    缺失的原始单元:诊断与修复大语言模型的数学推理能力

    提出‘数学原始单元’概念诊断LLM数学理解结构缺陷,并据此设计后训练修复方法提升推理鲁棒性。

  13. 13
    信任方向,搜索步长:面向大语言模型微调的零阶与一阶联合优化方法

    提出ZFO框架,分离方向选择(一阶)与步长搜索(零阶),兼顾收敛速度与训练稳定性。

  14. 14
    DMAD:作为对抗蒸馏的分布匹配用于快速视觉生成

    提出DMAD方法,将分布匹配重构为分类任务,用双判别器头直接学习对数密度比,替代传统分布匹配蒸馏的额外内存开销。

官方发布

4 条
  1. 01
    Google AI:2026年9月发布的最新AI新闻

    Google官方汇总2026年9月AI领域重要进展,涵盖模型、工具及应用更新。

    blog.google·Google AI·5小时前厂商动态技术发布谷歌AI
  2. 02
    Chatham 利用 OpenAI 提升资本市场专业能力

    Chatham Financial 使用 Codex 和 GPT-5.6 重构交易验证流程,耗时从30分钟降至4分钟内。

    openai.com·OpenAI·20小时前企业应用流程自动化大模型落地
  3. 03
    永恒的补充

    OpenAI探讨先进AI对突破性创意背后常规工作的关键作用,强调执行能力将重塑经济与进步速度。

    openai.com·OpenAI·1天前AI影响生产力技术经济
  4. 04
    Albertsons 公司如何从内部重塑零售业

    Albertsons 利用 ChatGPT Enterprise 和 OpenAI API 提升团队效率并优化顾客购物体验。