AI星际引擎AI STARSHIP
2026.09.15 星期二
40
共 47 条

今日要闻

29
  1. 01
    Cartesian——面向设计的 AI 3D 建模

    介绍 Cartesian 工具,利用 AI 实现快速、直观的 3D 建模,提升设计师工作流效率。

    formas.ai·09/15·313D建模AI工具设计自动化
  2. 02
    Show HN:Pizza Bot——面向 AI 代理的后台运行收件箱

    开源工具Pizza Bot为AI代理提供统一消息收件箱,支持异步任务调度与状态追踪。

    github.com·09/15·26AI代理开源工具基础设施
  3. 03
    我们在OpenShell应用形式化方法控制AI智能体所获得的经验

    介绍将形式化验证方法用于AI智能体行为控制的实践探索,提升AI系统可靠性与可验证性。

    nvidia.github.io·09/15·22AI安全形式化方法智能体控制
  4. 04
    Show HN:Loss——一则关于AI进步的微型讽刺作品

    以讽刺短文形式反思AI发展中的盲目指标崇拜与实际效用脱节问题

    workatloss.com·09/15·21AI伦理技术反思讽刺文学
  5. 05
  6. 06
    梁文锋CFO到位!投过智谱、MiniMax

    高瓴创投合伙人严文韬出任梁文锋旗下公司CFO,该公司曾投资智谱、MiniMax等AI企业

  7. 07
    AI‘关机开关’或需强制配备,Anthropic联合创始人对BBC表示

    Anthropic联合创始人呼吁将AI紧急关机机制设为强制性安全要求,涉及AI治理与风险管控。

    bbc.com·09/15·27AI安全监管政策AI治理
  8. 08
    地平线第1500万颗征程芯片搭载大众ID. AURA T6,HSD V2.1即将推出

    地平线发布征程芯片量产里程碑,并预告新一代智能驾驶平台HSD V2.1,强化全场景倒车能力。

  9. 09
    将AI监管作为Anthropic的商业模式

    分析Anthropic如何将主动倡导AI监管纳入其商业战略,以塑造行业标准并获取竞争优势。

    twitter.com·09/15·21AI监管商业策略厂商动态
  10. 10
    手机替我跑了一整套流程!我就说了一句话,AI执行了100步

    YOYO智能体实现单句指令驱动百步自动化任务,展示端侧AI代理新能力

  11. 11
    1Password 的 AI 补丁基准测试具有误导性

    批评 1Password 发布的 AI 驱动漏洞修复性能评估方法存在偏差,缺乏可复现性和真实场景验证。

    blog.trailofbits.com·09/15·22安全工具AI评测漏洞管理
  12. 12
    无问芯穹联合清华、上交正式开源具身端侧推理引擎APXInf,Pi 0.5性能SOTA

    开源具身智能端侧推理引擎APXInf,支持Pi 0.5模型并达当前最优性能。

  13. 13
    全球AI视频榜单第一梯队再添中国力量:智象发布首款物理规律导向视频模型

    智象发布首个多模态视频生成模型HiDream-O1-Video-1.0,强调物理规律建模能力。

  14. 14
    一张GPU跑10万原子!分子之心用AI把化学反应“拍”成了电影

    分子之心利用AI加速分子动力学模拟,单GPU实现10万原子级实时反应可视化,突破计算精度、速度与规模限制。

  15. 15
    首个AIGC长片大赛!RunningHub单项大奖100万,科幻IP免费改编

    RunningHub主办AIGC电影创作大赛,刘慈欣担任顾问,推动AI生成长片产业化落地

  16. 16
    Meta新研究:字节模型蒸馏后,天花板破了

    Meta提出新型知识蒸馏方法,显著提升小模型在多任务基准上的性能,突破原有能力上限

  17. 17
    前OpenAI后训练VP回应陶哲轩:说AI毁了数学,可能还是太小瞧AI了

    前OpenAI高管驳斥AI将终结数学的观点,强调AI未来可提出新概念框架并推动数学演进。

  18. 18
    9月21日,深圳前海!聊聊工业AI与生态共创的下一步

    西门子举办工业AI生态大会,聚焦Xcelerator平台与合作伙伴共建工业智能化解决方案。

  19. 19
  20. 20
    7名博士生仅用3个月从零训练7B大模型:代码+数据+训练日志全公开

    开源全流程7B模型训练实践,含多Agent协同研发方法与完整技术栈复现

  21. 21
    Show HN:沉没成本——本地大语言模型设备多久能回本?

    测算本地部署LLM硬件的成本回收周期,含电费、硬件折旧与推理收益分析

    sunkcost.ai·09/15·35成本分析本地部署LLM
  22. 22
  23. 23
    Hacker News:消息称 iOS 27 不允许禁用 Apple Intelligence

    报道 iOS 27 系统级 AI 功能 Apple Intelligence 缺乏用户禁用选项,涉及 AI 基础设施与终端控制权问题

    news.ycombinator.com·09/15·30苹果系统集成AI 控制
  24. 24
    亚马逊公司诉Perplexity AI公司案,第九巡回上诉法院第26-1444号

    AI初创公司Perplexity被亚马逊起诉涉嫌数据抓取侵权,涉及训练数据合法性核心争议

    law.justia.com·09/15·70法律诉讼数据合规大模型训练
  25. 25
    GPT-5.6 Luna 与 GPT-6 Astra 对比:1.20 美元的模型是否足以用于代码审查?

    对比两款虚构命名的GPT系列模型在代码审查任务中的性价比,探讨轻量级AI模型的实际适用性。

    entelligence.ai·09/15·22大模型代码生成模型评估
  26. 26
    反向传播的替代方案:增强拉格朗日预测编码

    提出一种不依赖反向传播的新型神经网络训练方法,基于预测编码与约束优化框架。

    pub.sakana.ai·09/15·26机器学习优化算法神经网络
  27. 27
    攻击 AI 客户服务代理

    探讨针对AI客服系统的常见攻击手法与防御思路,属AI安全实践案例

    intigriti.com·09/15·24AI安全攻防客户服务
  28. 28
    MIT开发强制AI遵守安全规则的方法

    提出新型约束机制使大模型在推理时严格服从安全规范,提升可控性

    theframenews.org·09/15·24AI安全对齐研究
  29. 29
    Show HN:Nari Qwen3-TTS 和 Qwen3-ASR —— 高精度、低延迟、低成本

    开源语音合成与识别模型Qwen3-TTS/ASR发布,强调高准确率与低推理成本

    narilabs.com·09/15·21语音合成语音识别开源模型

前沿论文

15
  1. 01
    腐败计划,干净痕迹:通过计划注入规避思维链监控

    提出‘计划注入’攻击,可在不触发思维链监控的情况下诱导LLM执行有害行为,揭示CoT安全机制漏洞。

  2. 02
    贝尔曼策略优化

    提出无评判器的贝尔曼策略优化(BPO)方法,基于贝尔曼方程重构策略镜像下降,避免中间状态值估计,提升LLM强化学习效率。

  3. 03
    恒星竞技场:面向数学与理论计算机科学长周期研究的多智能体框架

    提出模型无关的‘恒星竞技场’框架,支持数学与理论计算机科学中长周期、不确定性高的研究路径探索与分解决策。

  4. 04
    内在路由器:从冻结的大型语言模型中激发原生技能路由能力

    证明冻结LLM前向传播中已隐含技能路由信号,仅需两个线性映射即可提取,摆脱元数据上下文依赖与检索外挂。

  5. 05
    被选择的未来仍可重写:视频模型中的因果可写性

    发现视频模型中错误运动生成源于未调用而非未习得正确物理知识,可通过低维编辑激活并重写输出,证实内部知识的因果可访问性。

  6. 06
    通过方向分解解耦Transformer表征演化

    提出方向分解法分析Transformer各层表征演化,发现残差路径外存在显著平行更新分量,揭示表征几何演化规律。

  7. 07
    发现基础模型:迈向开放式的发现智能

    提出‘发现智能’概念,定义发现基础模型(DFM)为能自主参与问题生成、知识创造与解释构建的新范式。

  8. 08
    Mind2Dialogue:通过模拟用户心理状态训练人类感知型语言模型

    提出Mind2Dialogue框架,利用用户心理状态模拟填补监督缺口,提升LLM对用户隐含信念与目标的理解能力。

  9. 09
    可验证即构造:临床问答中逐字引用的声明级评估

    提出‘可验证即构造’范式,要求临床QA答案附带细粒度原文引用,使医生无需跳转即可高效验证每个声明。

  10. 10
    隐私对齐的个性化联邦学习:紧凑适配与变长高斯通信

    针对记录级差分隐私在个性化FL中的维度错配问题,提出一次性私有上下文发布+固定系数空间适配新架构。

  11. 11
    漏洞定位基准:在仓库规模上衡量智能体安全分析能力

    构建VLoc Bench基准(500个真实漏洞),首次聚焦LLM智能体在陌生代码库中精准定位漏洞文件的能力评估。

  12. 12
    HypoEvolve:遗传算法赋能多智能体LLM发现科学假设

    提出HypoEvolve框架,用遗传算法解耦多LLM协作模式与科学能力,实证验证协作结构对假设质量的独立影响。

  13. 13
    基于集合聚合的循环图神经网络

    研究采用集合聚合(非多重集)的循环GNN,建立权重可验证的双向编译等价性,连接神经网络与逻辑公式。

  14. 14
  15. 15
    基于信息空间可达性的安全元强化学习

    提出安全元强化学习框架,将安全性推理迁移至信息空间(融合物理状态与不确定性信念),保障少样本适应过程中的安全约束。

官方发布

3
  1. 01
    Google AI 发布 AI 与经济 ATLAS 新洞察

    Google 将全球数百万数据点转化为交互式开放平台,助力AI与经济关系研究。

    blog.google·Google AI·09/15AI经济数据平台开放研究
  2. 02
    宇航员克里斯蒂娜·科赫与谷歌詹姆斯·马尼卡谈太空、技术与探索

    谷歌AI负责人马尼卡与宇航员科赫对谈,探讨前沿科技在太空探索中的应用与社会影响。

    blog.google·Google AI·09/15AI应用科技对话空间技术
  3. 03
    DevFest 回归

    Google AI 宣布 DevFest 2026 启动,聚焦在智能体(agentic)AI 时代构建、安全与规模化落地

    blog.google·Google AI·09/15产品发布开发者生态智能体AI