AI星际引擎AI STARSHIP
2026.09.19 星期六
44
共 37 条

今日要闻

17
  1. 01
  2. 02
    27B模型分分钟交付网页,Qwen 3.8还是太能了

    通义千问3.8实现端到端网页生成(含设计与前端),后端需人工补全

  3. 03
    Nature:AI重生到1900,这一世抢先爱因斯坦提出光量子

    研究用AI模拟历史科学发现过程,成功复现光量子假说,验证AI科学推理潜力

  4. 04
  5. 05
    AI 生成的海报不必糟糕透顶

    探讨如何通过设计原则与提示工程提升 AI 生成海报的视觉质量与可用性。

    john.hartnup.uk·4天前·73AI生成设计提示图像生成
  6. 06
    千万奖池找“鲸锐”!单项奖金200万,只等一个最会用AI讲故事的你

    面向AI内容创作者的百万级创意竞赛,总奖池1000万元。

    qbitai.com·4天前AI创作赛事活动
  7. 07
    华为汪涛:华为要打造AI算力底座,只做好一颗芯片远远不够

    华为强调构建完整AI算力底座,CANN软件生态已迈过关键拐点。

    qbitai.com·4天前AI芯片AI基础设施华为
  8. 08
  9. 09
    埃利亚斯·索恩事件:AI聊天机器人痴迷的虚构人物

    分析多个AI聊天机器人持续生成并坚信‘虚构人物埃利亚斯·索恩’真实存在的现象,揭示大模型幻觉与角色固化问题

  10. 10
    陶哲轩代表SAIR Foundation宣布正式启动“开放数学模型计划”

    陶哲轩发起开放数学模型计划,推动开源AI模型与低成本算力支持数学研究。

  11. 11
    AI离“理解万物”还有多远?先拿癌细胞和行星轨道试试水

    同一AI预测框架跨癌细胞动力学、行星轨道等七类物理系统验证泛化能力。

  12. 12
  13. 13
    NASA-IBM 月球基础模型开源地理空间 AI 模型

    NASA 与 IBM 联合开源面向月球探测的地理空间AI模型,支持遥感影像分析与地形建模。

    newsroom.usra.edu·4天前·21开源模型航天AI地理空间
  14. 14
    Google AI Studio 的‘删除’功能是骗局:你的提示词并未被删除,只是被隐藏

    揭露 Google AI Studio 删除功能实际未清除用户提示数据,存在隐私泄露风险。

    medium.com·4天前·24隐私安全AI平台数据治理
  15. 15
    阿里巴巴开源可检测癌症及近150种疾病的AI模型

    阿里巴巴开源多疾病医学影像AI诊断模型,支持癌症等近150种病症检测。

    scmp.com·5天前·22医疗AI开源模型医学影像
  16. 16
    Grok Voice Transcribe 2.0

    xAI 推出 Grok 语音转录 2.0,提升多语种实时语音识别准确率与低延迟性能。

    x.ai·5天前·20语音识别模型更新xAI
  17. 17

前沿论文

14
  1. 01
    Designer-RSI:从用户流量中演化程序性记忆以实现智能体图形设计

    提出冻结大模型+外部程序性记忆架构,通过230+工具操作专业设计软件,从真实用户行为中持续提炼可复用设计流程。

  2. 02
    CodeMidas:基于源代码本身规模化构建智能编码强化学习环境

    提出CodeMidas流水线,直接从现有代码库功能生成可执行RL环境,突破依赖issue/commit的局限,显著扩展编码智能体训练任务规模。

  3. 03
  4. 04
    BrainWideBench:面向大规模预训练与跨动物迁移的多脑区神经记录基准

    构建首个支持跨动物迁移评估的神经表征基准,统一多区域、多动物电生理数据评测协议,推动通用神经解码模型发展。

  5. 05
    多跳检索中的可预测失败:基于分数分布的置信度评分与拒绝机制

    证明多跳检索失败具有结构化聚集性,提出分数分布置信度评分法,为LLM裁判流水线提供理论依据并解释AUC-AC性能差距。

  6. 06
    面向组合任务持续学习的世界模型基准

    提出新基准评估世界模型在组合任务上的持续学习能力,解耦知识保留与环境适应,强调物理世界机制复用对高效泛化的重要性。

  7. 07
    基于粒子竞争与合作的鲁棒图卷积网络学习方法(应对标签噪声)

    提出PCC+GCN框架,利用粒子动力学识别可疑节点并进行标签精炼,提升GCN在标签噪声下的鲁棒性。

  8. 08
    可用护栏:面向各类机器学习系统的可认证选择性预测

    提出可认证的选择性预测框架,确保在子群体(如患者组、策略标签)上达到目标精度,解决有限校准数据下的证书可行性问题。

  9. 09
    基于三信号互补性的可解释记忆决策控制器:解耦置信度与一致性

    提出新记忆控制器,显式解耦检索记忆的置信度与一致性信号,有效抑制RAG在冲突记忆下的幻觉放大问题。

  10. 10
    λ-控制的GRPO:将流匹配比率不稳定性转化为预算化资源

    提出λ-GRPO方法稳定流匹配模型的强化学习训练,通过预算化重要性比率抑制多步去噪中的梯度发散。

  11. 11
    Gricea:面向对话AI研究的开放科学平台

    发布Gricea开放平台,将对话AI研究建模为可配置、可部署、可复用的研究构件,解决实验碎片化与不可复现问题。

  12. 12
  13. 13
    DiaVLo:视觉语言模型行为诊断框架

    提出DiaVLo诊断框架,结合人工标注与VLM生成能力,构建期望/实际行为规范,定位VLM跨模态对齐偏差。

  14. 14
    RecreationWorld:面向混合计算机使用智能体的可扩展且可验证环境

    构建五平台RecreationWorld环境,支持智能体在GUI交互与命令行编程间自主切换,并通过视觉验证运行结果,推动真实数字工作流建模。

官方发布

1
  1. 01
    Anthropic 与埃森哲合作开展嵌入式 AI 模型评估

    Anthropic 联合埃森哲投入超10亿美元共建前沿AI独立评估能力,落实嵌入式评估承诺。

    anthropic.com·Anthropic·5天前模型评估产业合作安全治理