今日要闻
17 条- 01
- 0227B模型分分钟交付网页,Qwen 3.8还是太能了
通义千问3.8实现端到端网页生成(含设计与前端),后端需人工补全
- 03Nature:AI重生到1900,这一世抢先爱因斯坦提出光量子
研究用AI模拟历史科学发现过程,成功复现光量子假说,验证AI科学推理潜力
- 04
- 05AI 生成的海报不必糟糕透顶
探讨如何通过设计原则与提示工程提升 AI 生成海报的视觉质量与可用性。
- 06千万奖池找“鲸锐”!单项奖金200万,只等一个最会用AI讲故事的你
面向AI内容创作者的百万级创意竞赛,总奖池1000万元。
- 07华为汪涛:华为要打造AI算力底座,只做好一颗芯片远远不够
华为强调构建完整AI算力底座,CANN软件生态已迈过关键拐点。
- 08
- 09埃利亚斯·索恩事件:AI聊天机器人痴迷的虚构人物
分析多个AI聊天机器人持续生成并坚信‘虚构人物埃利亚斯·索恩’真实存在的现象,揭示大模型幻觉与角色固化问题
- 10陶哲轩代表SAIR Foundation宣布正式启动“开放数学模型计划”
陶哲轩发起开放数学模型计划,推动开源AI模型与低成本算力支持数学研究。
- 11AI离“理解万物”还有多远?先拿癌细胞和行星轨道试试水
同一AI预测框架跨癌细胞动力学、行星轨道等七类物理系统验证泛化能力。
- 12
- 13NASA-IBM 月球基础模型开源地理空间 AI 模型
NASA 与 IBM 联合开源面向月球探测的地理空间AI模型,支持遥感影像分析与地形建模。
- 14Google AI Studio 的‘删除’功能是骗局:你的提示词并未被删除,只是被隐藏
揭露 Google AI Studio 删除功能实际未清除用户提示数据,存在隐私泄露风险。
- 15阿里巴巴开源可检测癌症及近150种疾病的AI模型
阿里巴巴开源多疾病医学影像AI诊断模型,支持癌症等近150种病症检测。
- 16Grok Voice Transcribe 2.0
xAI 推出 Grok 语音转录 2.0,提升多语种实时语音识别准确率与低延迟性能。
- 17
前沿论文
14 条- 01Designer-RSI:从用户流量中演化程序性记忆以实现智能体图形设计
提出冻结大模型+外部程序性记忆架构,通过230+工具操作专业设计软件,从真实用户行为中持续提炼可复用设计流程。
- 02CodeMidas:基于源代码本身规模化构建智能编码强化学习环境
提出CodeMidas流水线,直接从现有代码库功能生成可执行RL环境,突破依赖issue/commit的局限,显著扩展编码智能体训练任务规模。
- 03
- 04BrainWideBench:面向大规模预训练与跨动物迁移的多脑区神经记录基准
构建首个支持跨动物迁移评估的神经表征基准,统一多区域、多动物电生理数据评测协议,推动通用神经解码模型发展。
- 05多跳检索中的可预测失败:基于分数分布的置信度评分与拒绝机制
证明多跳检索失败具有结构化聚集性,提出分数分布置信度评分法,为LLM裁判流水线提供理论依据并解释AUC-AC性能差距。
- 06面向组合任务持续学习的世界模型基准
提出新基准评估世界模型在组合任务上的持续学习能力,解耦知识保留与环境适应,强调物理世界机制复用对高效泛化的重要性。
- 07基于粒子竞争与合作的鲁棒图卷积网络学习方法(应对标签噪声)
提出PCC+GCN框架,利用粒子动力学识别可疑节点并进行标签精炼,提升GCN在标签噪声下的鲁棒性。
- 08可用护栏:面向各类机器学习系统的可认证选择性预测
提出可认证的选择性预测框架,确保在子群体(如患者组、策略标签)上达到目标精度,解决有限校准数据下的证书可行性问题。
- 09基于三信号互补性的可解释记忆决策控制器:解耦置信度与一致性
提出新记忆控制器,显式解耦检索记忆的置信度与一致性信号,有效抑制RAG在冲突记忆下的幻觉放大问题。
- 10λ-控制的GRPO:将流匹配比率不稳定性转化为预算化资源
提出λ-GRPO方法稳定流匹配模型的强化学习训练,通过预算化重要性比率抑制多步去噪中的梯度发散。
- 11Gricea:面向对话AI研究的开放科学平台
发布Gricea开放平台,将对话AI研究建模为可配置、可部署、可复用的研究构件,解决实验碎片化与不可复现问题。
- 12
- 13DiaVLo:视觉语言模型行为诊断框架
提出DiaVLo诊断框架,结合人工标注与VLM生成能力,构建期望/实际行为规范,定位VLM跨模态对齐偏差。
- 14RecreationWorld:面向混合计算机使用智能体的可扩展且可验证环境
构建五平台RecreationWorld环境,支持智能体在GUI交互与命令行编程间自主切换,并通过视觉验证运行结果,推动真实数字工作流建模。
官方发布
1 条- 01Anthropic 与埃森哲合作开展嵌入式 AI 模型评估
Anthropic 联合埃森哲投入超10亿美元共建前沿AI独立评估能力,落实嵌入式评估承诺。