Cursor 会自己选模型,OpenAI 全系产品宕机近 2 小时,百川联合创始团队离场
这期的「周一上线」,一边是继续上新模型和开发工具,一边是 Agent 背后的协议、算力与安全问题开始集中冒头。
Qwen 更新了 3.0 版本的图像、语音模型,Anthropic 带来 Claude Opus 5,Cursor 把模型选择权交给 Router,ACP v2 则让 Agent 会话可以跑得更久,持续处理后台任务。
另一边,Hugging Face 复盘了一场由自主 Agent 推进的安全入侵。与此同时,上周末 OpenAI 经历了一次波及 ChatGPT、API 和 Codex 的大面积故障。
下面,开始一周回顾。
有点新鲜
「有点新鲜」收录本周 AI / 开发者圈里那些不算大新闻,但挺值得看一眼的新鲜事。
Codex 重置的专属日历
不少人在意 Codex 的使用额度什么时候重置?距离上次重置过去多久了?@hzlzh 做了一个 Codex 重置日历:

日历板上最长的 reset 的时间一目了然,当然,还有热心群众,发现 Codex 24 小时没重置了,跑去关心官方人员的情况:

DeepSeek:我先去吃饭,测完告诉我

连 DeepSeek 这种硅基生物都知道要吃饭,身为碳基生物的我们,平时工作再忙,也得好好吃饭才行。
Claude 和 ChatGPT 的增长曲线重叠了
本周 ChatGPT 发了一张图庆祝周活过千万:

随后有才的 @quanruzhuoxiu 发现了 Claude 封号增长曲线也类似。虽然是类似的增长曲线,一个令人欢喜一个让人愁(狗头

让 Agent 7x24 小时打工的神器

有了这个 199 刀的神之托举,你的 Agent 就能 7x24 小时打工了。虽说如此,这神之手似乎和怡宝瓶盖差距不大?
做个能撕的贴纸
本周社媒上掀起了一股帖子特效风,就是用代码来实现如下这种撕下贴纸的效果:

周五发版
「周五发版」是一个程序梗:一旦版本上线,我们就要开始祈祷一切如期运行。这个模块寓意,所有模型、产品版本更新,都能大吉大利。
Qwen-Image-3.0、Qwen-Audio-3.0-TTS 发布

阿里发布第三代图像生成基础模型 Qwen-Image-3.0,重点在于提升复杂内容的组织、真实细节和知识表达能力。
模型最高支持约 4.5K Token 输入,可以处理报纸、故事板、试卷和信息图等多元素版式。官方还特别强调了小字生成能力,即便生成的图片采用 10px 左右的文字,它依旧保持着可读性之余,还原生支持 12 种语言的文字渲染。

同时,阿里还发布了 Qwen-Audio-3.0-TTS,并提供 Flash 和 Plus 两个版本。
Flash 面向实时交互,首个音频包延迟约为 300 毫秒;Plus 更侧重自然度、情绪表现和音色还原。Qwen-Audio-3.0-TTS 模型支持 16 种语言,可以用自然语言控制语速、语气和表达风格,也支持 [gasp]、[giggles]、[angry] 等非语言标签,来为语言增加细节。
Ling-3.0-flash:面向生产环境的混合推理模型
蚂蚁发布 Ling-3.0-flash。这是一个 124B 参数的混合推理 MoE 模型,主要面向生产级 Agent、多步骤任务和工具调用场景。

模型可以根据任务需要切换推理方式,并提供面向主流 Agent 框架的接入能力。官方 API 目前处于限时免费开放阶段。
Cursor Router:让 Cursor 自动选择模型
Cursor 推出模型智能路由功能 Cursor Router。用户提交任务后,Router 会根据请求内容自动选择更合适的模型,来减少手动切换模型的步骤。
Cursor 表示,这套方案基于超过 60 万条真实请求训练,并在数百万次请求中进行了在线测试。在测试结果中,自动路由可以维持接近前沿模型的效果,同时将成本降低约 60%。

目前,该功能覆盖桌面端、Web、iOS、CLI 和 SDK,并已默认向团队版用户开放。
Claude Opus 5:更主动,也更重视工作验证
Anthropic 发布 Claude Opus 5。新模型继续强化编码和知识工作能力,同时更强调主动推进任务、检查工作结果和根据反馈持续修正。

Anthropic 表示,Opus 5 的能力接近此前的 Fable 5,价格约为后者的一半。标准 API 价格为每百万输入 Token 5 美元、每百万输出 Token 25 美元,这和 Opus 4.8 保持一致。Claude Max 用户会默认使用 Opus 5,Pro 用户也可以将其作为当前最高能力模型使用。
ACP v2:Agent 会话开始跨越单轮对话
Agent Client Protocol 发布 ACP v2 Draft,开始公开征求开发者测试和反馈。

新版本的重要变化是将 Agent 会话扩展到单轮请求之外。Agent 可以在会话中持续更新状态,执行更长时间的任务或后台工作;消息、工具调用和文件修改也获得了稳定 ID,方便客户端持续更新同一项内容。
ACP v2 还增加了结构化文件变更、流式工具调用和更灵活的权限请求机制。当前版本仍处于草案阶段,官方建议开发者同时保留 v1 支持,暂时不要将 v2 作为生产环境的默认协议。
开源雷达
周榜速递
周榜主要根据新增 star 数进行排名,下面的单项目讲解则偏向新晋项目、实用老项目,标星并非单项目讲解的唯一指标:

oMLX:让 Mac 变成本地 AI 推理平台
oMLX 是一个面向 Apple Silicon Mac 的本地大模型推理工具。

它针对 M 系列芯片进行了优化,可以直接在 Mac 上运行语言模型、视觉语言模型、OCR、Embedding 和重排序模型。
除了模型运行,它还提供了连续批处理、KV Cache 管理以及兼容 OpenAI / Anthropic API 的接口,可以接入现有的 AI 客户端和 Agent 工作流。
img2threejs:把图片转换成可编辑的 3D 场景
img2threejs 是一个面向 Three.js 的 AI 生成工具。

它可以根据一张参考图片,生成对应的 Three.js 场景代码,将图片中的物体、布局和视觉效果转换成可以继续编辑的 3D 页面。
生成后的代码可以继续交给 Claude Code、Codex 等编程 Agent 修改,也可以加入动画、交互效果,直接用于网页项目。
对于想快速制作 3D 展示页面、产品 Demo 或交互作品的开发者来说,它提供了一条从图片到代码的路径。
OpenWorker:运行在桌面上的 AI 工作助手
OpenWorker 是一个开源桌面 AI Agent,目标是让 AI 直接参与日常工作流程。

它可以连接邮件、日历、文档等外部服务,帮助用户完成信息整理、任务执行和重复性工作。
项目支持接入自己的模型 API,也可以使用本地模型运行。当涉及发送消息、修改日程等操作时,OpenWorker 会请求用户确认,避免 Agent 直接执行敏感操作。
除了聊天,它更接近一个可以持续工作的桌面助手,适合用来探索 AI Agent 在办公自动化中的实际应用。
Bento:一个 HTML 文件里的完整演示工具
Bento 是一个轻量级的单文件演示文稿工具。

它把内容、编辑器、播放器和演讲模式全部集成到一个 HTML 文件中,不需要安装软件,打开浏览器即可编辑和展示。
相比传统演示工具,Bento 更强调文件独立和本地控制,一个文件就可以保存完整演示内容,方便分享、归档和部署。
它还支持图表、动画效果以及协作能力,适合制作技术分享、项目展示和快速 Demo。
这周有事
「这周有事」收录本周值得记一下的行业动态、事故、融资、人员流动和基础设施变化。
Hugging Face:Agent 攻防进入实战
Hugging Face 披露了一场由自主 Agent 推进的安全事件。攻击方通过恶意数据集利用漏洞,完成代码执行、权限提升和内部横向移动。后续调查显示,相关攻击测试涉及 OpenAI 的 GPT-5.6 Sol 等模型。
在防守阶段,Hugging Face 使用 AI Agent 分析超过 1.7 万条日志,但部分商业模型因安全限制无法处理真实攻击载荷,团队随后切换到自部署的开源模型 GLM-5.2 完成分析。
这次事件显示,Agent 能力提升后,攻击和防守都会进入机器速度,模型权限、运行隔离和本地部署能力也成为安全体系的重要组成部分。
百川智能联合创始人茹立云离职
近日,多家媒体报道称,百川智能联合创始人、前搜狗 COO 茹立云已离职,并出任慧辰股份总裁,负责 AI 应用落地与算力资源布局。茹立云曾与王小川共同创办百川智能,是公司早期核心管理成员之一。
随着茹立云离开,百川智能最初的联合创始团队已基本退出。此前,商业化负责人洪涛、模型研发负责人陈炜鹏、技术联合创始人谢剑等多位核心成员也先后离职。
百川智能曾是国内大模型创业公司的第一梯队之一,在 2023 年成立后快速推出 Baichuan 系列模型,并完成多轮融资。不过随着通义、豆包、DeepSeek、智谱等模型厂商持续推进,通用大模型竞争进入规模化阶段,百川的市场声量逐渐下降。
过去一年,百川开始调整方向,将更多资源投入医疗 AI。王小川曾表示,公司未来会减少多线探索,聚焦 AI 医生和精准医疗,并推出相关模型与产品。
Etched 完成 3 亿美元融资
AI 芯片公司 Etched 宣布完成 3 亿美元融资,估值达到 103 亿美元。本轮融资由红杉资本领投,a16z、Jane Street、Diffusion、Argo 和 SK 海力士等机构参与。
Etched 正在建设面向大规模推理的芯片和集群,并已经在办公地点附近搭建一座 10MW 实验设施,用于测试第一代硬件和整套推理系统。
AMD 与 Anthropic 签下最高 2GW 算力合作
AMD 与 Anthropic 宣布建立战略合作关系,计划部署最高 2GW 的 AMD Instinct MI450 系列 GPU。
首个 1GW 部署预计在 2027 年上半年启动,整套系统将采用 MI455X GPU、EPYC Venice 处理器、Pensando 网络技术和 ROCm 软件栈。双方还会利用 Claude 协助优化工作负载和 ROCm 开发。
作为合作的一部分,AMD 还计划向 Anthropic 进行最高 50 亿美元的战略股权投资。
Stripe 据称正在洽购 OpenRouter
据知情人士透露,Stripe 正在与 OpenRouter 洽谈收购事宜,交易估值接近 100 亿美元,并可能在一个月内公布。
目前谈判仍可能发生变化,Stripe 拒绝对此置评,OpenRouter 也尚未正式确认。
OpenAI 31 个组件同时出现故障
7 月25 日,OpenAI 的 API、ChatGPT 和 Codex 同时出现服务异常。
OpenAI 状态页面显示,这次事故从调查到完全恢复持续约 1 小时 51 分钟,共涉及 12 个 API 组件、15 个 ChatGPT 组件和 4 个 Codex 组件,合计 31 个组件。
本期「周一上线」聚焦AI前沿动态:Qwen发布图像/语音3.0模型,Claude Opus 5强化任务推进能力,Cursor Router实现智能模型路由,ACP v2支持长时Agent会话;Hugging Face披露自主Agent入侵事件,OpenAI遭遇31组件大规模故障。技术跃进与风险并存。
浙公网安备 33010602011771号