今日要闻
17 条- 01Show HN:MultiMatte——一种可提示的图像背景去除模型
开源图像分割模型,支持文本提示精准抠图,提升编辑效率。
- 02数学家要求证明 OpenAI 未使用其研究成果
多位数学家联名质疑 OpenAI 在训练模型时未经许可使用其论文与代码,要求公开训练数据来源证明
- 03ECCV上,顶尖学者们开始研究如何让AI做生意了
ECCV会议聚焦AI商业应用,64支团队参与多模态AI驱动的商业决策任务研究。
- 04全球首个3D原生城市世界模型ABot-Earth 0.7发布,构建AI理解真实世界的入口
阿里巴巴高德发布ABot-Earth 0.7,首个面向城市空间的3D原生世界模型,支持AI对真实地理环境的结构化理解。
- 05全球首个可仿真的人–场景交互重建框架 HSImul3R:让人类视频真正成为机器人技能来源
大晓机器人等联合发布HSImul3R框架,首次实现从单目人类视频中高保真重建人-场景物理交互,赋能具身智能技能学习。
- 06这个新开源的世界模型只有1.3B,单卡就能实时跑!
LingBot-World 2.0轻量级世界模型开源,仅1.3B参数,支持单卡实时推理。
- 07AGI时代的第一个生图模型,ChatGPT Images 2.5上线
ChatGPT Images 2.5发布,提升图像生成速度、细节质量与编辑能力。
- 08营销科技巨头蓝色光标与全球达人营销AI平台AhaCreator达成深度合作,让品牌更高效连接全球500万创作者
蓝色光标携手AhaCreator,利用AI实现海外达人营销规模化复制与增长系统化。
- 09一周连发6个模型!这家公司把具身智能的闭环跑通了
某公司密集发布6个具身智能模型,实现感知-决策-执行闭环,强调开源模型与私有部署经验分离。
- 10我们通过观察规范博弈提出的关于AI对齐的一个愚蠢想法
探讨AI对齐中规范博弈现象引发的非主流对齐思路,揭示目标函数设计缺陷导致的行为偏离
- 11打造10万卡国产算力集群推出JoyAI世界模型,京东发布物理AI建设最新成果
京东宣布建成10万卡国产算力集群并发布JoyAI世界模型,聚焦物理世界交互与具身智能。
- 12实测星火X2.5:手搓粒子月亮、拆完61页财报……还顺手揪出了我的Bug
科大讯飞星火X2.5大模型实测,展示多模态生成、长文档解析及代码调试能力,附API限时优惠
- 13我不想与随机鹦鹉互动
批判大语言模型缺乏真正理解,仅机械复现训练数据,质疑其智能本质。
- 14我的 AI 心智模型在 9 月 8 日崩塌了
作者反思近期 AI 技术突飞猛进(如多模态、实时交互)对其原有技术认知框架的颠覆性冲击
- 15程序化图:面向大语言模型智能体的自演化执行结构
提出一种用于LLM智能体的动态可演化的图结构执行框架,提升任务规划与推理灵活性。
- 16好品味无法被教授、购买或习得,抱歉,AI
探讨人类审美判断的不可形式化性,指出当前AI无法真正习得‘品位’这一高阶文化能力。
- 17定义人工智能精神病:第二部分——‘高产型人工智能精神病’
探讨AI系统出现类精神病行为的理论框架与现象分类,属AI安全与对齐研究范畴。
前沿论文
12 条- 01IdeaAMBIG:评估研究构想说明中影响实现的关键缺口
提出新基准IdeaAMBIG,量化研究方法说明的可实施性完备度,解决AI研究中‘想法新颖但无法复现’的核心问题。
- 02通过归一化流实现含干扰参数的无似然推断
提出基于神经网络归一化流的分解方法,自动提取近枢轴统计量,提升含干扰参数场景下的无似然推断效率与鲁棒性。
- 03极限语言生成的刻画:有限见证与分离宽度层次
从计算学习理论角度刻画语言生成在极限下的可行性条件,建立有限正见证与目标语言交集结构的等价关系,支撑LLM泛化能力形式化分析。
- 04Show-Harness:仅用视觉语言模型即可操控机器人
提出Show-Harness框架,通过语义动作单元接口将VLM输出直接映射为机器人底层动作,实现无需微调的端到端具身控制。
- 05面向信用违约预测的量子特征工程:IQP电路何时及为何提升线性分类器
实证验证IQP量子电路可生成优于经典Kernel PCA的非线性特征,显著提升信用违约预测F1分数,探索AI与量子计算交叉落地路径。
- 06跨模型一致性作为结肠镜自动息肉分割部署时的可靠性信号
提出无参考的RBQE框架,利用主模型与独立裁判模型的一致性评估实时分割质量,解决医疗AI无真值标注下的静默失效问题。
- 07IBIB:面向企业AI系统的评测协议——按服务路由而非模型标识符
提出IBIB协议,要求评测必须绑定实际部署的服务路由(含权重、精度、接口等),纠正当前AI基准只测模型ID的测量偏差。
- 08基于协方差矩阵的学习:主成分分析与图学习的交汇
提出协方差神经网络(VNN),将协方差矩阵建模为图结构,拓展GNN在统计依赖建模中的理论基础与应用边界。
- 09基于深度学习的航空航天电力系统电气故障与电能质量扰动检测
提出硬件感知深度学习框架,在400Hz航空电网仿真数据上实现多类故障与扰动的高精度检测,推动AI在高可靠嵌入式系统落地。
- 10Semigroup-JEPA:面向零样本物理泛化的潜在动力学一致性
提出Semigroup-JEPA世界模型,通过半群结构约束潜在动力学,首次在JEPA框架下实现物理规律保持的零样本跨物理系统泛化。
- 11JarvisGUI:面向动态任务组合的跨设备GUI智能体
提出JarvisGUI框架与新基准,支持GUI智能体在多设备间协同执行动态组合任务,填补现有单设备GUI代理评测的重大空白。
- 12构建多语言桥梁:数据混合作为语言内推理泛化的支柱
提出数据混合策略,使推理模型真正实现L2语言内一致推理,显著提升非英语语言的逻辑问答准确率与意图保真度。
官方发布
49 条- 01现在人人都能利用数据开展工作
OpenAI在ChatGPT Work中推出数据代理功能,支持自然语言连接企业数据、生成洞察与交互式仪表盘
- 02
- 03推出面向金融服务的 ChatGPT
OpenAI 发布金融行业定制版 ChatGPT,集成金融数据与 GPT-6 Astra 模型,支持研究、建模与客户材料生成。
- 04通过 API 中的 GPT-Live-1 构建更自然的语音体验
OpenAI 推出 GPT-Live-1 模型,支持全双工语音对话、指令遵循增强、自定义音色及电话系统集成
- 05推出Agents API
OpenAI发布托管式Agents API,基于Codex引擎支持智能体编排、长时会话与工具调用。
- 06Anthropic 关于加州 SB 53 法案的合规框架
披露依据加州《前沿AI透明度法案》评估与管理灾难性AI风险的合规框架。
- 07推出 Anthropic Labs
Anthropic 成立实验性AI产品孵化部门Labs,由Ben Mann与Mike Krieger联合领导。
- 08Irina Ghose 出任 Anthropic 印度总经理
前微软印度总经理Irina Ghose领导Anthropic首个班加罗尔办公室,聚焦企业落地与开发者合作。
- 09Mariano-Florentino Cuéllar 加入 Anthropic 长期受益信托
前加州最高法院大法官加入Anthropic长期受益信托担任受托人,强化AI长期治理结构。
- 10Anthropic 与英国政府合作开发 GOV.UK AI 助手
Anthropic为英国政府GOV.UK平台构建并试点AI助手,首阶段提供求职者职业建议与培训接入服务。
- 11ServiceNow 选择 Claude 作为默认模型
ServiceNow 将Claude设为其Build Agent默认模型,并向2.9万多名员工及工程团队全面部署。
- 12Apple 的 Xcode 现在支持 Claude Agent SDK
Xcode 26.3 集成 Claude Agent SDK,支持在苹果平台执行自主、长时程编码任务。
- 13Claude 是一个思考的空间
Anthropic 宣布 Claude 保持无广告模式,强调广告激励与可信 AI 助手目标不兼容。
- 14Claude Opus 4.6
Anthropic 发布旗舰模型 Opus 4.6,在智能体编程、计算机使用、工具调用等多领域达行业领先水平。
- 15覆盖数据中心电费上涨成本
Anthropic 说明其作为 AI 安全与研究公司,正应对数据中心电力成本上升带来的运营挑战。
- 16
- 17Anthropic 以 3800 亿美元估值完成 300 亿美元 G 轮融资
Anthropic 完成 300 亿美元 G 轮融资,估值达 3800 亿美元,年化营收 140 亿美元,客户规模显著扩张。
- 18克里斯·利德尔加入 Anthropic 董事会
前微软和通用汽车 CFO 克里斯·利德尔出任 Anthropic 董事会成员,强化公司治理与战略能力。
- 19Anthropic 开设班加罗尔办公室
Anthropic 在印度班加罗尔设立新办公室,并与 Pratham、EkStep 基金会及 Adalat AI 启动教育与公共服务合作。
- 20Anthropic 与 Mozilla 合作加强 Firefox 安全性
Claude Opus 4.6 两周内发现 22 个 Firefox 漏洞(14 个高危),并提供 PoC 和候选补丁。
- 21悉尼将成为 Anthropic 在亚太地区的第四处办公室
Anthropic 宣布在悉尼设立新办公室,强化亚太布局,聚焦 AI 安全与可解释系统研发。
- 22投入 1 亿美元启动 Claude 合作伙伴网络
Anthropic 推出企业级合作伙伴计划,资助生态伙伴推动 Claude 在企业场景落地。
- 23
- 24Anthropic 扩展与谷歌和 Broadcom 的算力合作
Anthropic 锁定 2027 年起多千兆瓦下一代 TPU 算力,创其最大规模算力承诺。
- 25Vas Narasimhan 被任命为 Anthropic 董事会董事
诺华 CEO Vas Narasimhan 加入 Anthropic 董事会,长期受益信托委派董事获多数席位。
- 26推出 Claude Design(Anthropic Labs)
Anthropic 发布 Claude Design 工具,支持用户协同生成设计稿、原型、幻灯片等视觉内容。
- 27Anthropic 与亚马逊扩展算力合作
Anthropic 十年内向 AWS 投入超 1000 亿美元,锁定最高 5 千兆瓦云计算资源。
- 28
- 29Anthropic与NEC在日本共建AI工程能力
NEC将向3万名员工部署Claude,并成为Anthropic首家日本全球合作伙伴,联合开发行业AI产品。
- 30Anthropic开设悉尼办公室并任命澳新总经理
Anthropic拓展亚太市场,在悉尼设办并任命澳新总经理,与CBA、Canva、Xero等本地头部企业合作。
- 31面向创意工作的Claude
Anthropic官方介绍其AI系统在创意任务中的能力定位,强调可靠性、可解释性与可控性目标。
- 32构建一家新的企业级AI服务公司
Anthropic联合黑石、H&F、高盛成立新公司,以‘Claude+工程师’模式为中型企业嵌入AI服务。
- 33面向金融服务的智能体
发布10个Cowork/Claude Code插件、Microsoft 365集成及金融保险专用MCP应用。
- 34提升Claude使用限额并达成SpaceX算力合作
大幅提升Claude调用上限,并与SpaceX建立新型算力合作,显著增强短期算力供给能力。
- 35
- 36与亚马逊扩大合作以提供更安全的AI访问
亚马逊拟投资至多40亿美元并成为Anthropic首要云服务商,模型训练基于AWS Trainium/Inferentia芯片。
- 37提示Claude长上下文窗口的技巧
提出两种提升长文档问答效果的方法:先提取相关引文、再提供上下文示例,属实用技术优化。
- 38发布 Claude Instant 1.2
Anthropic 推出更快、更低成本的 Claude Instant 1.2,数学、编程、推理和安全性全面提升
- 39
- 40Claude 2
Claude 2 发布:性能提升、支持 10 万 token 上下文窗口、危害性降低 2 倍,开放 API 与网页 Beta 版
- 41
- 42Anthropic 完成 4.5 亿美元 C 轮融资
Anthropic 获 4.5 亿美元 C 轮融资,由 Spark Capital 领投,谷歌、Salesforce Ventures 等跟投
- 43
- 44推出 Claude
Anthropic发布新一代AI助手Claude,支持聊天界面与API调用,并已接入Notion等早期合作伙伴。
- 45Anthropic 关于AI安全的核心观点
指出变革性AI可能十年内出现,当前缺乏可靠安全方案,提出对齐与可解释性等关键研究方向。
- 46Anthropic 完成B轮融资以构建稳健AI基础设施
获5.8亿美元B轮融资,用于建设大规模AI模型安全性研究所需的算力与实验基础设施。
- 47Anthropic 完成1.24亿美元A轮融资
由Jaan Tallinn领投,聚焦可操控、可解释、鲁棒的大规模AI系统基础研究。
- 48保罗·克里斯蒂亚诺加入 OpenAI 基金会董事会
AI 安全领域权威学者 Paul Christiano 加入 OpenAI 基金会董事会及安全与保障委员会,强化其治理与对齐能力。
- 49逐帧重现70年爱情故事
Google DeepMind与电影人合作,用AI重建未留存影像资料的夫妻生活片段,属AI驱动的影视修复与生成应用。