摘要: LLM输出存在幻觉、结果不稳定时,靠什么判断Agent的结果是否合格? 前言: 当大语言模型(LLM)天生存在幻觉、且每次输出结果具有不可预期的不稳定性时,我们靠什么来客观判定 Agent 的结果是否“合格”? 答案是:绝不能依赖模型自身的承诺或内部逻辑,必须依赖外部的、客观的、可量化的物理约束与工程边界来做判定。 我们通过建立以下两道防线(共6重机制),将“模型的主观 阅读全文
posted @ 2026-07-02 18:23 莲(LIT) 阅读(63) 评论(0) 推荐(0)