今日要闻
24 条- 01
- 02Show HN:分享你的 AI 开发环境,向他人学习
Hacker News 用户分享个人 AI 开发硬件配置、工具链与工作流,供同行参考借鉴。
- 03
- 04从“会回答”到“会办事”,vivo如何解AI手机这道题?
vivo阐述AI手机战略,聚焦构建用户专属AI助理,推动终端AI能力落地。
- 05Claude Code团队讲究啊,这都往外说
Anthropic旗下Claude Code团队公开分享工程方法论,强调以问题解决为核心的技术实践。
- 06图形学宗师童欣加盟Meshy,要做“AI for Fun”的头号玩家
图形学专家童欣加入AI生成3D公司Meshy,聚焦趣味性AI图形创作。
- 07央企做了个通用Agent,直接杀进IDC实测前三!
中国电信发布通用智能体TeleAgent,在IDC权威评测中位列前三。
- 08Claude双入口合并,原生Office上线!硅谷AI办公大战也开始了
Anthropic将Claude网页与插件入口整合,并推出原生Office集成,强化AI办公能力。
- 09刚刚,唐杰发布智谱RSI首个成果
智谱AI宣布RSI(Recursive Self-Improvement)首个成果落地,GLM模型已开始参与自身构建过程。
- 10GLM 构建了自己的推理基础设施
GLM 团队自研 AI 推理底层设施,提升大模型部署效率与可控性。
- 11马斯克睡进工地!为AI基建拼了
马斯克为推进AI基础设施建设亲驻工地,体现其对算力基建的高度重视。
- 12首购积分加赠70%:SkyProduction天工工作台联合火山引擎推出中秋国庆三重福利
天工工作台(SkyProduction)与火山引擎合作开展节日营销活动,推广AI开发平台服务。
- 13国产RSI模型交卷!Flash模型靠它反打旗舰
国产RSI(实时语义理解)模型发布,支持1亿Tokens免费调用,提升轻量级AI模型性能。
- 14网易有道周枫:AI能力竞争,正在进入「Model + Agent + Workflow」时代,网易有道AI Open Day展示AI时代“有道解法”
网易有道发布AI演进新范式,强调大模型、智能体与工作流协同,展示其AI产品体系与落地路径。
- 15Pangram——文本与图像的AI检测器
开源AI内容检测工具Pangram,支持文本和图像生成内容识别,可用于防范虚假信息。
- 16罗福莉沉寂半年官宣小米强化学习!直播新模型训练过程,一小时烧3万美元
小米AI负责人罗福莉公开强化学习新模型训练实况,披露高成本算力消耗与训练细节(如奖励曲线、显卡故障)。
- 17
- 18OpenAI 披露六起新的人工智能安全事件
OpenAI 公布近期发生的六起AI系统异常行为事件,涵盖越狱、数据泄露与误输出等安全问题。
- 19OpenSpec——一个轻量级且可配置的 AI 规范框架
开源AI规范框架,支持定义和验证AI系统行为,提升模型可控性与可解释性。
- 20一家咖啡店店主用 AI 制作菜单海报,随后收到愤怒的私信
展示AI生成设计在真实商业场景中的误用与公众反馈风险,具警示意义
- 21
- 22HN提问:AI恐慌,你买账吗?
社区对AI技术风险与社会影响的集体讨论,反映主流认知分歧与情绪动向
- 23训练文本到图像模型的速度提升3.6倍
提出新型训练优化方法,显著加速文本到图像扩散模型训练,降低算力成本。
- 24
前沿论文
15 条- 01目标函数 vs. 搜索策略:解构优质分词器的构成要素
分离分词算法中优化目标(压缩/似然)与搜索过程(自底向上/自顶向下)的影响,揭示性能差异根源。
- 02面向大语言模型偏好对齐的零阶范式
提出ComPO方法,基于比较预言机实现零阶偏好对齐,在小似然差场景下高效提取方向性信息。
- 03PANORAMA:通过掩码提议选择实现全景式空间定位图文描述
提出全景定位图文生成任务,联合密集描述与像素级掩码,提升视觉-语言模型的空间接地能力。
- 04梦到接触之声:利用视频与音频生成实现零样本力感知操控及数据生成
通过生成接触声音响度调控期望力曲线,为机器人操控视频生成注入力觉先验,解决接触密集任务失败问题。
- 05历史依赖日志下的离策略评估呈指数级难度
证明即使日志覆盖所有隐藏状态,当记录器依赖历史时,离策略评估仍可能指数级不可靠。
- 06ScienceIDE:将全球科学代码库转化为智能体可学习环境
构建ScienceIDE基础设施,将碎片化科学代码库封装为带专家定义规则的可交互、可验证智能体训练环境。
- 07双过程语言智能体的认知扩展:交互环境中的记忆与自我反思
为SwiftSage智能体引入自适应记忆模块与自我反思模块,提升长程状态跟踪与错误恢复能力。
- 08Affora:面向智能体友好界面的设计系统
提出Affora设计系统,在保持人类可用性前提下,增强GUI对机器智能体的动作可读性与状态可解析性。
- 09
- 10在维基百科摘要上玩log(N)-问答游戏:前沿模型间通信效率评估
设计两智能体log₂N问答游戏,量化同一厂商前沿语言模型在信息不对称下自我通信的效率与瓶颈。
- 11模型增长、递归与边界算子如何影响缩放指数
证明循环Transformer等架构干预可改变预训练缩放指数,实现计算量增加下的指数级性能提升。
- 12rMuscle:面向高效视觉-语言-动作模型推理的机器人肌肉记忆
提出rMuscle框架,利用工厂重复作业特征优化VLA模型推理延迟,提升机器人响应实时性与运动平滑性。
- 13
- 14自主实验室中基于证据的智能体制剂开发
Andromeda 2智能体融合实验数据与计算工具,自主迭代设计SEDDS制剂,在微型自动化实验室中超越前代系统。
- 15
官方发布
4 条- 01Cooley 如何利用 ChatGPT 加速 IPO 工作
律所 Cooley 基于 ChatGPT Work 构建 GO Public 工具,提升 IPO 法律尽调效率与风险识别能力。
- 02推出面向法律行业的 Astra
OpenAI 发布专为法律行业定制的 AI 产品,支持律所工作流、对接法律数据源并提供保密级安全控制。
- 03我们的模型错位行为报告框架
OpenAI发布模型错位行为的追踪、调查与披露框架,并公开6例异常行为报告
- 04帮助老年人在日常生活中使用人工智能
OpenAI联合AARP在美国10座城市为1000名老年人提供免费ChatGPT实操工作坊,提升安全使用能力。