老师您好!我是最近在学习agent的学生,最近在 DSH 上做了一个很小的 Runtime 插件实验,过程中发现了一条和 Life-Harness 很有意思的交叉点。
目前观察到:有些原本看起来需要 Model 决策的步骤,如果当前 Event 已经提供了足够确定的事实,其实可以直接从 ReAct loop 里消掉 不出现这一轮;而另一些行为虽然在很多 trajectory 中反复出现,却未必应该直接被固化成 Harness 行为。
所以想请教一个很具体的问题:
在 Life-Harness 里,你们是如何区分“环境本身稳定存在的结构”和“某个模型反复出现的行为模式”的?
尤其是随着模型能力快速变化,一些过去需要 Skill / Prompt / Harness intervention 的行为,后来可能已经被模型本身吸收了。
我们最近的实验在这里:
https://github.com/goatliamia/dsh-runtime-react
很想听听老师您对这个边界的看法。
老师您好!我是最近在学习agent的学生,最近在 DSH 上做了一个很小的 Runtime 插件实验,过程中发现了一条和 Life-Harness 很有意思的交叉点。
目前观察到:有些原本看起来需要 Model 决策的步骤,如果当前 Event 已经提供了足够确定的事实,其实可以直接从 ReAct loop 里消掉 不出现这一轮;而另一些行为虽然在很多 trajectory 中反复出现,却未必应该直接被固化成 Harness 行为。
所以想请教一个很具体的问题:
尤其是随着模型能力快速变化,一些过去需要 Skill / Prompt / Harness intervention 的行为,后来可能已经被模型本身吸收了。
我们最近的实验在这里:
https://github.com/goatliamia/dsh-runtime-react
很想听听老师您对这个边界的看法。