AI 新闻日报 - 2026-05-25
AI 新闻日报 - 2026-05-25
今日共收录 20 条 AI 相关资讯
最新论文 (arXiv)
- SkillOpt: Executive Strategy for Self-Evolving Agent Skills(SkillOpt:自我进化智能体技能的执行策略)
Yifan Yang, Ziyang Gong, Weiquan Huang 等 | 提出 SkillOpt 框架,将智能体技能优化类比为深度学习优化器,通过执行策略使技能在反馈下持续改进,超越当前一次性生成或松散自修正的方法。 - Geo-Align: Video Generation Alignment via Metric Geometry Reward(Geo-Align:通过度量几何奖励实现视频生成对齐)
Zizun Li, Haoyu Guo, Runzhe Teng 等 | 针对相机可控视频生成,提出基于度量几何奖励的对齐方法,解决真实世界多视角视频数据稀缺问题。 - PiD: Fast and High-Resolution Latent Decoding with Pixel Diffusion(PiD:基于像素扩散的快速高分辨率潜空间解码)
Yifan Lu, Qi Wu, Jay Zhangjie Wu 等 | 提出新型潜空间到像素的解码方法,显著提升高分辨率文生图系统中解码器的速度与质量。 - LLMs as Noisy Channels: A Shannon Perspective on Model Capacity and Scaling Laws(大语言模型作为噪声信道:从香农视角看模型容量与缩放定律)
Xu Ouyang, Deyi Liu, Yuhang Cai 等 | 提出"香农缩放定律"(Shannon Scaling Law),从信息论角度解释了灾难性过训练和量化退化等非单调现象,挑战了传统的单调幂律缩放定律。 - From Raw Experience to Skill Consumption: A Systematic Study of Model-Generated Agent Skills(从原始经验到技能消费:模型生成智能体技能的系统性研究)
Zisu Huang, Jingwen Xu, Yifan Yang 等 | 系统研究了语言智能体从原始经验中蒸馏出领域级技能的过程,评估了模型生成技能的效率与可复用性。 - SPACENUM: Revisiting Spatial Numerical Understanding in VLMs(SPACENUM:重新审视视觉语言模型的空间数值理解能力)
Jianshu Zhang, Yijiang Li, Huifeixin Chen 等 | 深入分析 VLM 在具身环境下输出的数值是否真正基于空间理解,揭示了当前模型的局限性。 - Complete-muE: Optimal Hyperparameter Transfer and Scaling for MoE Models(Complete-muE:混合专家模型的最优超参数迁移与缩放)
Hongwu Peng, Ohiremen Dibua, Yuanjun Xiong 等 | 提出 Complete-muE 框架,解决了稠密 FFN 与混合专家(MoE)架构间超参数迁移的难题。 - ETCHR: Editing To Clarify and Harness Reasoning(ETCHR:通过编辑来澄清和利用推理能力)
Beichen Zhang, Yuhong Liu, Jinsong Li 等 | 提出多模态大语言模型中的"用图像思考"新范式,通过视觉编辑辅助推理,突破纯文本思维链的瓶颈。
热门开源项目 (GitHub)
- romanyn36/agentic-ai-roadmap(智能体 AI 学习路线图)
⭐ 98 | 无特定语言 | 涵盖 Python 基础到智能体系统的综合性 AI 学习路线图,注重动手实践和真实部署。 - Marktechpost/AI-Guides-Reports(AI 指南与报告合集)
⭐ 15 | 无特定语言 | 汇集 AI、机器学习、智能体 AI、深度学习、LLM 等领域的技术指南和行业报告。
海外讨论 (Hacker News)
- DeepSeek reasonix, DeepSeek native coding agent with high caching and low cost(DeepSeek Reasonix:高缓存、低成本的 DeepSeek 原生编码智能体)
564 | 233 | DeepSeek 发布原生编码智能体 Reasonix,以高缓存命中率和低成本为特点。 - Constraint Decay: The Fragility of LLM Agents in Back End Code Generation(约束衰减:LLM 智能体在后端代码生成中的脆弱性)
241 | 137 | 研究发现 LLM 智能体在生成长序列后端代码时会逐渐偏离原始约束条件。 - Memory has grown to nearly two-thirds of AI chip component costs(内存成本已占 AI 芯片组件成本的近三分之二)
387 | 397 | AI 芯片成本结构中内存占比已接近 2/3,HBM 成为主要成本驱动因素。 - DeepSeek makes the V4 Pro price discount permanent(DeepSeek 将 V4 Pro 折扣永久化)
587 | 519 | DeepSeek 宣布 V4 Pro 模型 API 永久降价,持续保持定价竞争力。 - Microsoft starts canceling Claude Code licenses(微软开始取消 Claude Code 许可证)
480 | 464 | 微软取消部分 Claude Code 许可证,引发关于 AI 编码工具商业模式的讨论。 - An OpenAI model has disproved a central conjecture in discrete geometry(OpenAI 模型推翻了一个离散几何的核心猜想)
1422 | 1048 | OpenAI 的 AI 模型成功推翻离散几何领域核心猜想,展示 AI 在数学研究中的突破性能力。
掘金热门 (中文技术文章)
⚠️ 掘金 API 暂时无法获取数据,以上为其他渠道信息。
今日 AI 要闻速览
- OpenAI 模型推翻数学猜想:OpenAI 的 AI 模型成功推翻了一个离散几何领域的核心猜想,成为今日最受关注的 AI 新闻,展示了 AI 在基础数学研究中的巨大潜力,HN 热度高达 1422 分。
- DeepSeek 持续发力:DeepSeek 今日双喜临门——发布原生编码智能体 Reasonix(高缓存低成本),同时宣布 V4 Pro API 永久降价,进一步巩固其在 AI 推理和编码领域的竞争力。
- AI 芯片成本结构变革:Epoch AI 报告显示内存已占 AI 芯片成本的近 2/3,HBM 高带宽内存成为算力瓶颈之外的新焦点,可能影响下一代 AI 硬件设计方向。
- LLM 智能体可靠性挑战:新研究揭示 LLM 智能体在长序列后端代码生成中面临"约束衰减"问题,提示 Agent 系统在生产环境落地仍需克服稳定性挑战。
- AI 编码工具商业博弈:微软开始取消 Claude Code 许可证,反映出科技巨头在 AI 编码助手市场的竞争日趋激烈,商业模式仍在探索中。

浙公网安备 33010602011771号