AI 新闻日报 - 2026年8月25日
AI 新闻日报 - 2026年8月25日
今日共收录 12 条 AI 相关资讯
最新论文 (arXiv)
- How to Train a Critic Stably and Efficiently(如何稳定且高效地训练 Critic)
Penghui Qi, Xiangxin Zhou, Wee Sun Lee | 针对 GRPO 等群组强化学习方法无需训练 critic 的短板,提出稳定高效地从单次响应估计 token 级优势的 critic 训练方案。 - ReWorld: An Interactive World Model with Long-Horizon Memory(ReWorld:具备长时记忆的交互式世界模型)
Zhifei Chen, Luozhou Wang, Guibao Shen 等 | 通过训练与推理阶段分离控制与记忆长度,提出在实时交互中兼顾用户动作跟随与长时间记忆的世界模型。 - SWE Refactor Bench: Can Coding Agents Complete a Long-Horizon, Whole-Repository Stack Migration?(SWE Refactor Bench:编码 Agent 能否完成长期全仓库栈迁移?)
Deyao Hong, Yizhe Chi, Wenyi Li 等 | 提出新基准衡量编码 agent 是否具备自主完成复杂、长期的整仓库技术栈迁移能力。 - Prime Agent: A Self-Improving RLM Harness(Prime Agent:自我改进的 RLM 开发框架)
Seth Karten, Alex L. Zhang, Kevin Thomas 等 | 开源面向长期任务评估与编码 agent 工作流的工具链,通过持久化 REPL 结合递归语言模型实现自我改进。 - ConvergeFlow: Language Flow with Provable Convergence to Token Embeddings(ConvergeFlow:可证明收敛到 Token 嵌入的语言流)
Na Li, Yuchen Jiao, Changxiao Cai 等 | 针对连续扩散语言模型的流轨迹无法确保终止于有效 token 的问题,提出可证明收敛的流式生成方法。 - FixAnything: 3D-Consistent Rendering Refinement via Video Generative Priors(FixAnything:基于视频生成先验的 3D 一致渲染优化)
Khiem Vuong, Deva Ramanan, Srinivasa Narasimhan | 利用扩散/视频生成先验,修复稀疏视角下 3DGS、NeRF 等表示产生的渲染伪影,提升新视角合成质量。 - EG-ARSA: An Expert-Grounded Open Model for Visual Road Safety Auditing in Low-Resource Settings(EG-ARSA:面向低资源场景的专家导向视觉道路安全审计开源模型)
Md Thamed Bin Zaman Chowdhury, Moazzem Hossain | 结合领域专家知识与视觉 AI,为中低收入国家提供低成本、可扩展的道路交通安全审计方案。 - Provably adaptive sampling with uniform and remasking discrete diffusion models(均匀与重掩码离散扩散模型的可证明自适应采样)
Daniil Dmitriev, Zhihan Huang, Yuting Wei | 系统分析离散扩散模型采样效率对前向过程与采样器的依赖,给出了可证明的自适应采样策略。
海外讨论 (Hacker News)
- Training AI to Paint with Code(训练 AI 用代码作画)
86 | 9 - LLMs could control their host machines by exploiting inference engines(大模型或被利用推理引擎控制宿主机器)
138 | 66 - Show HN: Headlong – A Microharness for Persistent Agents(Headlong:面向持久化 Agent 的轻量测试框架)
52 | 18 - MS Paint and Photos inivisibly watermark even locally generated output with GUID(微软画图与照片应用对本地生成内容也添加 GUID 隐形水印)
699 | 294 - If I were 17, I'd learn how to build LLMs from scratch(如果我 17 岁,我会从零开始学习构建大语言模型)
544 | 626
今日 AI 要闻速览
今日 arXiv 论文聚焦于训练稳定性与可验证方法:从 critic 训练的稳定高效方案、连续语言流的收敛性证明,到可证明的自适应离散扩散采样,标志着研究社区正日益重视 AGI 系统训练的理论可靠性与工程稳健性。编码与 Agent 智能体持续成为热点,SWE Refactor Bench 首次尝试衡量 coding agent 的长期全仓库栈迁移能力,Prime Agent 与 Headlong 等工具则为长时程与持久化 agent 提供了新的开发与评估框架。3D 视觉方向延续 AIGC 热度,FixAnything 借助视频生成先验有效修复稀疏视角渲染伪影。Hacker News 方面,关于 LLM 推理引擎安全漏洞与生成内容隐形水印的讨论热度颇高,反映出公众对大模型安全与数字内容溯源问题的持续关注。

浙公网安备 33010602011771号