AIGC标识 2026-07-23 AI 新闻汇总

1. 白宫正式指控 Moonshot AI 蒸馏 Anthropic Fable 开发 Kimi K3,财政部威胁制裁

7 月 22 日,白宫科技政策办公室(OSTP)主任 Michael Kratsios 在 X 平台发帖,声称美方"掌握信息表明"Moonshot AI 在开发 Kimi K3 过程中蒸馏了 Anthropic 的 Fable 模型,并搭建了"一套精密内部平台,针对美国模型开展大规模蒸馏,可快速切换多种访问渠道以规避侦测"。Kratsios 同时指控 Moonshot 通过泰国服务器获取了 NVIDIA GB300 芯片,推测用于 AI 模型训练,这可能违反了美国出口管制。

同一天,美国财政部长 Scott Bessent 在 Fox Business 采访中表示,美国"有能力制裁"涉及"隐蔽工业规模蒸馏攻击"的外国 AI 模型,并称已在多个中国模型中"发现了美国大语言模型的水印"。这与 7 月 19 日 Axios 报道的特朗普政府正考虑以行政令等方式封禁中国开源模型的动向一脉相承。

Kratsios 在帖中区分了"合法蒸馏"(用于创建更小、更高效的模型)与"大规模隐蔽工业蒸馏"(旨在窃取专有技术),但 15 天的时间窗口(Fable 5 于 7 月 1 日发布,K3 于 7 月 16 日发布)在技术社区引发了广泛质疑。社区回应以讽刺为主——热门评论包括"我方掌握情报:Anthropic 为研发 Fable 5,'蒸馏'了整个人类互联网的数据"。Moonshot 工程师 Nathan Chen 发帖称"我每天都要在 X 上学习了解本公司的新知识",随后删除。

与此同时,约 200 家美国初创公司组成的 Little Tech Association(含 Y Combinator)致信特朗普政府,呼吁不要封禁中国开源权重模型,称一刀切禁令将损害依赖开源模型做产品开发的美国初创企业。该游说暴露了美国科技界在"安全管控"与"开源生态利益"之间的内部分裂。

来源: Reuters | Kyodo News | 钛媒体 Edge AI Daily | 新浪财经 | 商派 ShopeX AI 日报 | 2026-07-22


2. 微软测试 Kimi K3 接入 Copilot,年省最高 6 亿美元,AI 编程工具经济学面临重构

7 月 22-23 日,据 The Information 报道,微软正准备在 Copilot 中测试月之暗面 Kimi K3 模型,若运行顺利可节省高达 6 亿美元的年推理成本。微软工程师正在评估 K3 是否能在部分 Copilot 功能中替代 OpenAI GPT 和 Anthropic Claude 模型,同时 Azure 云平台也在推进 K3 的上架流程。

报道披露了几个关键细节:微软 CEO Satya Nadella 已在内部多次强调"成本效率"和"供应商多样性"——这被解读为对 OpenAI 日益强势地位的制衡。分析人士认为即使最终采用,K3 仅会覆盖非核心、低敏感度的推理负载,占比不超过 Copilot 总流量的 \(20\%\)。微软此前已在 GitHub Copilot 中正式上线 Kimi K2.7 Code(7 月 1 日 GA),此次测试是其多模型策略向旗舰产品的延伸。

K3 的推理成本优势来自其 MoE 架构的硬件效率——896 个专家中每 token 仅激活 16 个,KV 缓存大幅缩减,优化了单位 token 的显存占用。但在实际 Copilot 工作负载中,K3 的推理 token 产出量可能远超 Sol 等模型,价格优势能否转化为净成本节省仍不确定。前微软高管的一则评论直指风险:"6 亿美元的数字很诱人,但如果质量下降 \(1\%\),导致用户流失,那省下的钱就不值得了。"

从 AI 编程工具赛道看,这一动向折射出两个趋势:一是企业客户正从"唯性能论"转向"性价比优先",尤其在推理侧;二是多模型路由策略正在成为标配——不再将全部流量押注单一供应商。

来源: The Information | WCCFTech | 鞭牛士 | ExplainX | 2026-07-22 ~ 07-23


3. Claude Code 桌面版集成 iOS 模拟器:AI 编程工具向全栈闭环演进

7 月 22 日,Anthropic 宣布 Mac 桌面版 Claude Code 公测集成 iOS 模拟器(需 v1.24012.0 及以上版本)。开发者指示"构建并运行应用检查引导流程"后,Claude 可直接在专属面板中启动模拟器、安装应用、交互测试并读取屏幕反馈——无需 macOS 辅助功能和屏幕录制权限。

与 Claude Code 此前的 Computer Use 模式(控制物理屏幕,会遮挡其他窗口)不同,iOS 模拟器集成通过直接驱动模拟器 API 实现,不与用户屏幕抢占。模拟器面板实时流式传输设备画面,开发者可随时手动点按交互,Claude 的操作状态通过"Claude is using this device"标识提示。每个会话可最多开启 4 个模拟器面板,会话结束或归档 10 分钟后自动关闭。

该功能的意义不限于 iOS 开发便利性。从工具演进角度看,它实现了"代码生成 → 构建 → 运行 → UI 测试 → 修复"的完整闭环在同一界面内完成,无需在 IDE 和模拟器之间来回切换。这使 Claude Code 从代码生成工具向全栈应用开发平台迈出了一步。目前仅限 Pro、Max、Team 订阅用户,Enterprise 计划未覆盖,仅支持本地会话。

来源: Claude Code Docs | ClaudeKit | IT之家 | 2026-07-22


4. Claude Cowork 新增"录制技能":屏幕录制 + 语音讲解直接生成可复用 Agent Skill

7 月 21 日,Anthropic 为 Claude Cowork 桌面协作环境新增"Record a Skill"功能,面向 Pro、Max、Team 用户。用户点击 Cowork 界面的 + 菜单选择录制后,在屏幕上执行完整工作流并同步语音讲解操作逻辑,Claude 会自动分析录屏中的点击序列、导航路径和语音决策信息,将其转化为可重复调用的结构化 Agent Skill。

此前创建 Skill 需要开发者手动编写 SKILL.md 文件,用 Markdown 描述步骤、触发条件和元数据。非技术人员面临的主要障碍在于将隐性经验知识翻译为明确的可执行指令。"录制技能"跳过了这个翻译步骤——语音讲解中自然流露的决策逻辑(哪些场景跳过、哪些格式不可妥协、哪些数值异常需人工复核)是传统操作手册难以覆盖但录制可以完整保留的。

早期用户案例包括:交易提醒、LinkedIn 任务处理、邮件分类和费用报销等重复性流程。这项功能的技术风险在于 UI 变更和异常分支处理:录制中未覆盖的分支可能导致 Skill 静默失败。Anthropic 尚未发布关于录制内容的隐私和数据留存政策的详细文档,建议用户在录制时避免暴露敏感信息(密码、API Key、客户数据等)。

从自动化民主化的角度看,将知识传递的载体从"撰写文档"变为"做一遍并讲出来",大幅降低了 AI 工作流自动化的使用门槛。

来源: Claude AI X 官方 | ExplainX | 36氪 | CNMO科技 | 2026-07-21 ~ 07-22


5. DeepSeek Coding Agent 实现目标编排闭环,PaperBench 达 \(84.8\%\) 超越 Claude Code

7 月 22 日,DeepSeek 推出新版 Coding Agent,支持 Goal 目标编排与 Workflow 工作流固化能力。实测中,Agent 可在自主模式下完成查找替换、创建分支、编写测试并提交 PR 的完整闭环。在 PaperBench 基准测试中,DeepSeek Agent 得分 \(84.8\%\),大幅领先 Claude Code 的 \(58.7\%\)——这是国产 AI 编程代理首次实现端到端任务闭环。

这套系统的设计思路与其他 Agent 工具存在差异:Goal 模式允许开发者设定高层目标而非逐步指令,Agent 自行分解任务并编排执行顺序;Workflow 模式则将成功的任务执行路径固化为可重复模板。两者结合,使 Agent 从"单次代码生成工具"向"持续参与开发流程的自动化成员"转变。

横向对比来看,Cursor 的 Agent Swarm 侧重多代理并行(Planner + Worker 树状分解),Claude Code 侧重单代理深度推理,Codex 侧重 OpenAI 生态整合。DeepSeek 的差异化在于将目标编排和工作流固化作为核心设计理念,而非事后叠加的能力。但 PaperBench 作为相对较新的基准,其结果在不同工具间的可比性仍需更多独立验证。

来源: 喵一眼AI / 腾讯新闻 | 2026-07-22

posted @ 2026-07-23 15:05  nuo534202  阅读(1)  评论(0)    收藏  举报