2026年9月8日
摘要: AI API 返回 HTTP 200,为什么流式任务还是失败?从连接到完成事件的排查方法 请求日志是 200,界面也出现过几个字,但客户端最后提示失败。这种情况不能仅凭 HTTP 状态码判断任务已经完成。 流式请求需要分开看三件事:HTTP 响应是否正常开始、事件是否被正确解析、模型响应是否到达协议定义的完成状态。即便模型响应完成,文件修改、工具执行等业务任务也仍需单独验收。 本文由 N 阅读全文
posted @ 2026-09-08 13:51 wangjjj1122 阅读(37) 评论(0) 推荐(0)
  2026年9月1日
摘要: 企业级长文档 AI 服务的稳定性设计:从单一调用到专属账号池 企业将 AI 用于知识库问答、合同审阅、研报摘要和批量文档结构化后,系统的主要矛盾通常会从“模型能否回答”转向“长任务能否稳定完成”。 短问答失败后重新发送,成本相对有限;长文档任务则可能已经经过文件解析、文本切分、检索召回和多轮生成。任何一次中途失败,都可能让整条处理链重新排队。 这也是为什么生产 阅读全文
posted @ 2026-09-01 14:52 wangjjj1122 阅读(22) 评论(0) 推荐(0)
  2026年8月21日
摘要: 项目地址:Agent Doctor by NexoToken 最近一年,AI 编程工具的单次任务越来越长。过去我们关心的是模型能不能生成正确代码,现在更常遇到的问题却是:任务跑了很久,它究竟是在推进,还是只是在重复? 终端日志无法直接回答这个问题。 日志能告诉我们执行过什么,却很难解释目标是否仍然一 阅读全文
posted @ 2026-08-21 17:00 wangjjj1122 阅读(15) 评论(0) 推荐(0)
  2026年8月16日
摘要: 最近在整理一个我们自己反复遇到的问题:Codex、Claude Code 这类 Agent 跑短任务很方便,但任务一长,就很难回答“它到底推进了多少”“是不是在循环”“验证有没有真的跑”“这次到底花了多少”。 聊天记录能看到原文,却不等于有一条可核对的证据链。于是我们把内部原型整理成了 Agent 阅读全文
posted @ 2026-08-16 16:25 wangjjj1122 阅读(7) 评论(0) 推荐(0)
  2026年8月14日
摘要: 很多人第一次统计 AI 编程成本,会用一个很直觉的公式: 任务成本 ≈ 用户输入 Token + 最终回答 Token 这个公式对一次简单问答勉强够用,放到 Codex 这类编程 Agent 上却会严重低估。 你在界面里只输入了一句话,背后可能已经发生多轮模型推理、文件读取、命令执行、工具结果回传和 阅读全文
posted @ 2026-08-14 18:08 wangjjj1122 阅读(31) 评论(0) 推荐(0)