AI星际引擎AI STARSHIP
2026.09.22 星期二
47
共 61 条

今日要闻

25
  1. 01
    陆川手搓历史现场,王珞丹熬夜抽卡,阿里全模态开始兜底生产

    阿里宣布三年内将推出原生全模态统一生成模型,打破文本、图像、视频等模态边界。

  2. 02
    Agent时代,CPU的价值该重估了

    在AI Agent架构下,CPU与GPU算力需求趋近1:1,传统CPU角色正被重新定义。

    qbitai.com·2天前AI硬件CPU智能体
  3. 03
    直播预告:未来两三年,哪些工业AI场景会率先爆发?

    探讨工业AI从试点落地到规模化应用的关键路径与首批高潜力落地场景。

  4. 04
    讲真,我没看出这图是AI做的,更没想到是国产AI做的

    商汤科技发布全新文生图大模型U1 Pro,强调高保真与国产自主生成能力

  5. 05
  6. 06
    Show HN:仅通过网页结构训练模型识别 AI 生成内容

    提出仅依赖 HTML 结构特征检测 AI 生成网页内容的新方法,无需文本分析,具轻量部署潜力。

    arxiv.org·2天前·23AI检测网页分析轻量模型
  7. 07
    WebArena作者Shuyan Zhou入职Meta超级智能实验室

    AI研究者Shuyan Zhou加入Meta超级智能实验室,聚焦具身智能与实用AI浏览器研发

  8. 08
    6天烧光2000多万,拿下开源第一!小米史无前例「炼丹直播」收官

    小米公开直播大模型训练全过程,6天投入超2000万元,获Hugging Face CEO高度评价

  9. 09
    JetBrains Air:面向智能体软件开发的产品体系

    JetBrains 推出新开发范式产品套件 Air,支持以智能体(Agentic)方式构建软件。

    blog.jetbrains.com·2天前·38开发工具智能体JetBrains
  10. 10
    基元律动韩凯:从多模型调度到反馈闭环,探索Agent持续进化

    基元律动CTO在云栖大会分享Agent系统架构演进,提出Harness到RSI飞轮的持续进化方法论。

  11. 11
    别让一部片子倒在交付前:SkyProduction 抢先首发短剧质检

    SkyProduction发布AI驱动的短剧自动化质检系统,支持字幕、音画、内容底线三维度批量检测并生成结构化报告。

  12. 12
    研究:9至18岁青少年弃用谷歌转向AI,后果未知

    调查显示青少年正将AI工具作为主要信息检索替代方案,引发对认知习惯与信息质量影响的担忧。

    norwegianscitechnews.com·2天前·25用户行为青少年搜索技术
  13. 13
    虎鲸文娱推出“鲸锐AI”影视制作与管理平台,打造文娱产业新基建

    虎鲸文娱在云栖大会发布首个AI影视制作与管理平台“鲸锐AI”,聚焦AIGC与流程智能化。

    qbitai.com·2天前AIGC影视AI产业应用
  14. 14
    阿里研究员透露Qwen4.5后模型将扩展至5-10T参数

    Qwen系列大模型下一代版本参数规模将达5–10万亿,标志超大规模模型持续演进。

    qbitai.com·2天前大模型参数规模Qwen
  15. 15
    阿里公布全模态模型新进展,Qwen4和下代视频模型均在训练中

    阿里巴巴在云栖大会宣布Qwen4及新一代视频生成模型正在训练,推进全模态AI能力落地。

    qbitai.com·2天前全模态视频生成Qwen
  16. 16
    阿里巴巴:机器智能时代,坚定投入AI模型、AI芯片、AI云三大基石

    阿里CEO吴泳铭宣布将长期战略投入AI模型、AI芯片和AI云三大基础设施建设。

  17. 17
    阿里吴泳铭最新演讲:未来机器思考的总量将达到人类的1000倍以上

    吴泳铭在云栖大会提出‘机器思考总量超人类千倍’的强AI演进判断,属AI战略前瞻观点。

  18. 18
    AI算力之争不靠堆卡!浪潮信息捅破智算「能力天花板」,还瓦解了「产能焦虑」

    浪潮信息通过架构创新提升AI算力效率,缓解芯片供应紧张下的智算性能与产能瓶颈。

  19. 19
    罗宾·威廉姆斯女儿致制作AI视频的粉丝:‘请有点羞耻心’

    演员罗宾·威廉姆斯之女公开谴责未经许可使用其父形象生成AI视频的行为,引发关于数字遗产与AI伦理的讨论。

    variety.com·2天前·42AI伦理数字遗产内容生成
  20. 20
    Do not fear AI. Fear AI companies
    df7sc6o35ljoz.cloudfront.net·2天前·20
  21. 21
  22. 22
    AI 编程使持续集成(CI)成为瓶颈,因此我们重构了 CI 系统以跟上节奏

    针对AI编程引发的CI高频、细粒度提交问题,团队重构CI流程提升吞吐与反馈速度。

    linear.app·2天前·36AI编程DevOps基础设施
  23. 23
    在您自己的硬件上运行前沿 AI

    探讨本地部署大模型的技术路径与硬件要求,对私有化AI应用有实践参考价值。

    timdettmers.com·2天前·24本地部署硬件适配大模型
  24. 24
  25. 25
    亚马逊阻止Meta新推出的Muse AI代理在amazon.com上购物

    亚马逊封禁Meta的Muse AI自动化购物代理,反映AI代理在电商场景的实际落地冲突与平台治理问题。

    forbes.com·2天前·28AI代理平台治理电商

前沿论文

29
  1. 01
    OMatG-flash:一种用于可扩展材料发现的全原子流图,结合强化伴随匹配

    提出OMatG-flash模型,通过全原子流图加速无机晶体结构预测与从头生成,属AI驱动的材料科学前沿研究。

  2. 02
    结合分层认知过程与过程监督以实现可解释的场景安全理解

    提出融合人类认知过程建模与过程监督的方法,提升场景安全理解的可解释性与可靠性,属AI可解释性研究。

  3. 03
    扩散模型中的双重下降与恶性过拟合

    揭示扩散模型中过参数化导致恶性而非良性过拟合,挑战传统双下降假设,属基础模型理论重要发现。

  4. 04
    TimeInteract:面向流式时间序列的实时交互式智能

    提出TimeInteract范式,支持模型在持续接收时序数据的同时与用户实时交互,突破静态TSLM局限。

  5. 05
    大语言模型代码理解中的词汇迷信:在低词汇质量代码上的再评估

    发现LLM过度依赖标识符名称等词汇线索进行代码理解,提出Face/Off框架验证语义鲁棒性缺陷。

  6. 06
    基于真实世界医疗数据的带引导学习延迟决策

    在真实医疗影像数据上验证学习延迟(L2D)方法,实现AI与医生协同决策,提升临床部署安全性。

  7. 07
    面向GROBID的布局引导掩码:大规模学术PDF解析中的轻量级结构增益

    改进开源PDF解析器GROBID,引入CPU轻量布局检测模块,提升学术文献结构化解析精度与效率。

  8. 08
    MAVP:面向移动操作的图感知视觉运动策略

    提出MAVP框架,通过地图感知预测基座位姿并闭环跟踪,显著提升移动机械臂空间定位与操作可靠性。

  9. 09
  10. 10
    HySparse2:两级KV共享的混合稀疏注意力机制

    设计HySparse2架构,通过两级KV共享优化长上下文预填充与缓存效率,适配长程多轮智能体场景。

  11. 11
    GitScholar:基于GitHub参与度预测AI研究影响力的数据库

    构建GitScholar数据集,首次系统验证GitHub活跃度可作为AI论文影响力的有效早期预测指标。

  12. 12
    PACT:从信用分配到批评者对齐

    形式化定义LLM强化学习中token级信用分配的三大公理,为RLHF等算法提供统一数学基础。

  13. 13
  14. 14
    TransBERT:面向领域特定语言建模的合成翻译框架

    提出TransBERT框架,仅用合成翻译文本预训练法语生命科学领域语言模型,达SOTA性能。

  15. 15
    GameHorizon Suite:游戏玩法中的多时间尺度数据与评测

    提出GameHorizon统一评测套件,解决现有游戏AI基准覆盖窄、缺语言指令、依赖高方差在线 rollout等问题。

  16. 16
    Critical-State RL:面向多轮工具调用的可训练状态诊断方法

    提出Critical-State RL方法,精准识别多轮交互中真正需优化的关键模型调用状态,避免奖励噪声干扰训练信号。

  17. 17
    WorldCrafter:具备隐式3D感知记忆的一致性视频世界模型

    提出WorldCrafter视频世界模型,通过视角驱动的隐式3D记忆压缩机制,提升长时序与跨视角下的观测一致性。

  18. 18
    onPanda:基于词元级修正的LLM对齐数据与智能体轨迹高效标注工具

    提出onPanda交互式标注工具,支持词元级实时修正与截断重生成,显著提升对齐数据和智能体轨迹标注效率。

  19. 19
    面向端侧大语言模型生成式个性化适配的LoRA生成超网络

    提出LoRA生成超网络,在移动端有限算力下动态生成轻量LoRA适配器,实现用户行为模式驱动的高效个性化。

    arxiv.org·2天前端侧AI模型个性化LoRA
  20. 20
    DexTacWAM:面向灵巧操作的视触觉世界-动作模型

    提出DexTacWAM模型,融合独立指尖触觉编码与姿态感知压缩,首次在世界-动作模型中显式建模不可见接触动力学。

  21. 21
    Harness-Zero:基于代理即测试台的代理测试台蒸馏方法

    提出Harness-Zero框架,将领域定制化代理测试台(harness)的知识蒸馏至通用代理中,解耦部署性能与专用测试台依赖。

  22. 22
    RRSI:面向代理测试台的正则化递归自我改进方法

    提出RRSI方法,在代理测试台组件级递归优化中引入正则化,缓解任务过拟合,提升跨任务泛化鲁棒性。

  23. 23
    DolphinBench:代理记忆帕累托前沿测绘基准

    发布DolphinBench基准,首次在真实动作序列约束下评估代理长期记忆的成本-精度-时延三维权衡。

  24. 24
    基于迭代失准的稀有事件概率估计方法

    提出迭代失准算法,高效估计智能体随机策略下灾难性稀有事件的发生概率,突破轨迹空间组合爆炸瓶颈。

  25. 25
  26. 26
    Jev用于科学决策:语义选择及其后果评估

    将Jev作为语义决策组件嵌入科学工作流,评估不同模型配置在12种科学场景中对关系选择的语义准确性影响。

  27. 27
    生成式教程:面向物理任务的实时上下文化视觉指导

    提出生成式教程框架,利用实时环境感知生成适配用户当前工具/空间的视觉操作指引,弥补静态教程泛化不足。

  28. 28
    JAREX:面向多目标算法化工艺表征的采集函数

    提出JAREX采集函数,提升贝叶斯优化在制药工艺多维参数空间中识别合格边界(pass/fail)的效率与精度。

  29. 29
    从不完美先祖中学习物理规律

    提出神经算子(NO)与物理信息神经网络(PINN)联合范式:用降质NO初始化PINN,克服其局部极小与物理误收敛问题。

官方发布

2
  1. 01
    使用 GPT-6 Astra 将研究时间与成本减半

    Parallel 公司利用 GPT-6 Astra 显著提升劳动力市场数据分析效率,耗时和成本均降低50%。

    openai.com·OpenAI·2天前大模型应用效率优化GPT-6
  2. 02
    有效第三方评估的优先事项与原则

    OpenAI 发布前沿AI模型及安全机制第三方评估的严格性、安全性与独立性原则。

    openai.com·OpenAI·2天前AI安全第三方评估治理规范