源于注意力机制的一个本质特性:上下文学更像检索而非推理—一模型擅长从已 之所以有效 容中查找信息,但不擅长主动归纳和总结。这里里说的是模型在单次前向传播中如何消费已经在上下文里的信息, 否定模型可以通过生成思维链来完成多步思考。 在每个电话的工具调用结果中直接加入重复呼叫次数(如"本次是第3次呼叫该商家”),模型就能立即 现已达到限制,不再继续呼叫,错误率大幅降低。