AI星际引擎AI STARSHIP
2026.09.24 星期四
49
共 28 条

今日要闻

6
  1. 01
    出海Agent“小元AI”入驻腾讯WorkBuddy:找买家写开发信谈生意

    小元AI作为出海场景智能体接入腾讯WorkBuddy,具备记忆与自进化能力,可自动撰写开发信并洽谈业务。

    qbitai.com·27分钟前智能体出海应用企业办公
  2. 02
    Meta靠自研Manus翻身!股价一夜暴涨11%,登顶苹果商店,增速反超ChatGPT

    摘要内容与AI无关(‘全民养虾狂潮’为明显误抓或戏谑表述),标题中Manus疑似误写(应为Meta AI或Manus AI?),但来源为量子位且含‘ChatGPT’对比,属AI产业动态误标事件,按规则来源强相关即判相关。

    qbitai.com·2小时前AI产品产业动态
  3. 03
    成立九年,中科类脑把积累装进Token工厂

    中科类脑推出‘Token工厂’平台,整合多年AI算法与行业知识,支持大模型轻量化部署与领域适配

  4. 04
    Mercury 2.5 大语言模型达到每秒 770 个 token

    新发布的 Mercury 2.5 LLM 推理速度达 770 tokens/s,属显著性能提升。

    artificialanalysis.ai·6小时前·22大语言模型推理性能
  5. 05
    我们如何在两周内将 claude.ai 的速度提升 3 倍

    Anthropic 工程团队分享 claude.ai 前端性能优化实践,含具体技术路径与量化效果

    claude.dev·9小时前·51性能优化Web工程Claude
  6. 06
    Cloud Agents Are Inevitable AI Prisons
    normanponte.io·10小时前·30

前沿论文

15
  1. 01
    高维潜在表示的可扩散性研究

    提出Representation Autoencoders(RAEs)改进扩散模型在预训练视觉编码器特征空间中的表现,揭示微调会降低表征有效维度。

  2. 02
    用于作者身份验证的对比学习

    基于对比学习的ModernBERT双编码器在PAN21任务上达98.4%准确率,优于分类方法,并系统分析关键训练因素。

  3. 03
    StudentBench:AI与人类辅导在GRE学习增益上效果相当

    通过StudentBench平台收集17.5万条学生-AI交互数据,实证验证LLM辅导在量化推理上产生与人类相当的学习增益。

  4. 04
    我该加入哪里?基于语言引导目标预测的机器人群体加入

    提出语言接地的机器人群体加入任务,要求模型根据自然语言描述和实时观测预测加入位置,支撑导盲机器人等社会导航应用。

  5. 05
    更紧致的归纳式学习界及其应用

    提出Sharper Transductive Local Complexity(STLC)方法,基于交换行走的对数Sobolev不等式,给出无放回抽样下的紧致泛化误差界。

  6. 06
    大语言模型能否推理运行时行为?一个仓库级动态基准

    提出SWE-Flux基准,含480个真实Python仓库级执行推理实例,首次支持LLM对完整代码库动态行为的评估。

  7. 07
    排斥性自注意力的非平衡相:混沌、注意力凝聚与涌现局域性

    理论分析极简循环Transformer中负值映射引发的非平衡动力学,发现混沌、注意力凝聚及几何局域性等新相变现象。

  8. 08
    数学推理中的序不变答案与序敏感表征

    在合成函数组合问题中发现:答案可序不变,但模型内部表征对规则顺序高度敏感,SNR量化其秩序编码强度。

  9. 09
    单变量两层ReLU分类的最小范数解:含跳跃连接的精确解与全局最优性

    完全刻画单变量两层ReLU网络在ℓ₂正则与插值下的最优分类器几何结构,阐明偏置是否惩罚对解性质的关键影响。

  10. 10
  11. 11
    面向外骨骼个性化的上下文连续偏好学习

    提出CCPL高斯过程模型,在操作条件连续空间中共享用户偏好反馈,以极少标注实现外骨骼辅助策略个性化。

  12. 12
    机器学习递归状态估计中不精确求解器的可修复性

    在固定线性卡尔曼模型下,刻画子空间内修正的可行性条件,并分析缺陷实施对有限时域协方差响应的影响。

  13. 13
    代理编辑世界模型:为大语言模型代理重新思考世界建模

    提出Agent-Editing World Model,聚焦预测执行依赖型工具响应而非环境观测,缓解任务状态污染问题。

    arxiv.org·11小时前世界模型LLM代理工具调用
  14. 14
    冻结流会遗忘:诊断并恢复潜在流世界模型中丢失的运动

    发现冻结自监督潜在空间中的流模型因锚点稀疏监督而丧失运动建模能力,提出解码增强rollout恢复时序一致性。

  15. 15
    使用Clifford变分自编码器学习全息约简表示

    提出Clifford-VAE,将数据投影至任意维Clifford环面,首次实现对非结构化数据的超维向量符号嵌入。

官方发布

6
  1. 01
    Ringg 的 AI 智能体利用 OpenAI 解决高达 65% 的客户来电

    Ringg 基于 GPT-5.6 构建多模态多语种客服智能体,成本降至 GPT-4.1 的 10%,显著提升自动化率

    openai.com·OpenAI·7小时后AI 智能体客服自动化大模型应用
  2. 02
    Claude 发现一种具有类似 CRISPR 重复序列的新型酶系统

    Anthropic 利用 Claude 在生物信息学中发现新型酶系统,展示大模型在科学发现中的实际应用能力。

    anthropic.com·Anthropic·11小时前科学发现生物AI大模型应用
  3. 03
    Google Beam 扩展至新地区、新增合作伙伴与客户

    Google AI 宣布其 Beam(AI 驱动的实时协作基础设施)扩展至五国并新增企业合作,强化全球 AI 应用部署能力。

    blog.google·Google AI·11小时前AI基础设施产品发布产业动态
  4. 04
    Google Beam 扩展至新地区、新增合作伙伴与客户

    Google Beam(AI驱动的实时协作通信平台)新增5个国家覆盖,并与Industrious合作扩展网络。

    blog.google·Google AI·11小时前产品发布基础设施产业动态
  5. 05
    Google DeepMind:通过安全的服务器端内存推进私有 AI 计算

    DeepMind 为个人 AI 推出私有服务器端内存,提升本地化计算的数据隐私保护能力。

    deepmind.google·Google DeepMind·13小时前隐私计算AI基础设施模型部署
  6. 06
    OpenAI 学院两周年

    OpenAI 官方宣布 OpenAI 学院成立两周年,持续向全球社区普及 AI 技能

    openai.com·OpenAI·13小时前教育政策监管产业动态