晓辉博士 - 不是...而是...Harness工程与AI对齐

晓辉博士 - 不是...而是...Harness工程与AI对齐

项目 内容
来源 https://www.douyin.com/video/7630882768608925371
时长 3分3秒
转录时间 2026-08-08 18:58
字数 1068
分段方式 AI智能分段(含Markdown标题)

章节标题由AI根据内容结构生成,非原文内容

** AI摘要**:大模型常使用“不是…而是”的句式,通过排除与确认来清晰界定概念。在驾驭大模型时,我们也可以用这种方式明确指令边界(如规定不要做什么),从而在可控的底线内让模型自由发挥上限。此外,确定性任务应交给代码执行,不确定性任务则由模型自主判断,这正是驾驭工程“在不确定性中寻找确定性”的核心。


一、开场与引入

Hello,下班啦。今天我来北京出差啊,然后我最近一直在看 harness engineering 相关的一些进展,突然联想到一个非常有意思的事情,就是说我们在大模型的应用中,经常会看到它给我们的回答是“不是,而是”这样的句子。我看到很多这个生成的文章都是这样的一些表述,然后我就很好奇,为什么大模型喜欢这样说。

二、分析“不是,而是”句式的功能

其实也比较好理解,因为“不是”是排除了一些事情,“而是”是确认了一些事情,相当于把一些事情排除,把一些事情做确认,这样的话你能更好地理解这个概念。比如说我们在说 agent 这个概念的时候,就会把一些它不具备工具调用能力的这样一些模型,它就不是 agent,就是类似的这样的一些界定,那它就可以帮助我们更好地理解到底 agent 是什么。然后我就意外地发现,如果你把这样的一套句式用在 harness engineering 这个里面的话,其实也是非常有效果的。

三、句式应用:驾驭大模型的意图表达

3.1 有效方案(告诉不要做什么)

什么意思呢?就是我们希望驾驭大模型的时候,我们往往会要告诉它你应该做什么,我需要的结果是什么。很多时候我们都需要去很明确地表达我们的意图。

但是其实一个非常有效的方案是告诉它不要做什么,其实叫护栏或者叫安全的一个合规的底线是什么。那比如说你不能去做特定的事情,比如说不要去扫描我的整个目录,而是扫描特定文件夹的目录就可以了。或者说你哎,这个 bad case 我想的想的不太多,但是。

就是程序员们他们很多时候是这样用的,就是约束它到底哪些事情不能做,它的边界在哪儿,其实这个就是它的底线。

3.2 方法总结(定底线,探上限)

那我们如果把底线告诉模型,那么上限它又能够去自己去判断,去摸高的话,那就相对来说这个结果我们就是可控的。那所以呢,这个也挺有意思,就是不是而是,既可以是模型输出给人类的一个结果,也可以是我们为了驾驭模型的产出给它的一套做我们意图表达的一种方式,我觉得也是非常高效的。

四、第二个原则:确定性与不确定性交付

当然还有一个原则就是做 harness engineering 里面,就是把这些确定性交付的事情交给代码,因为大模型是可以写代码的。

那所以如果有一些工作你是希望它做确定性的交付,不能有幻觉的话,你是可以让它帮你把这个代码写出来,百分之百做对。那不确定性的事情呢,就不要写代码,就交给模型自己判断就好了。对,所以这也是一套方法。

五、总结升华

其实我们整个驾驭工程的这个理念就是在不确定性中寻找确定性,我们希望它给我们交付的结果是可控的。

所以用这种不是而是的方案,虽然我们看起来很多啊,很讨厌,但是确实有效,因为它对概念的正反面都做了一个对比和论证。

所以这是今天想跟大家分享的一点吧。拜拜。

posted @ 2026-08-08 18:58  fph418  阅读(29)  评论(0)    收藏  举报