我感受到一种“矛盾性”
某个版本的模型会被 train(或者调试)的非常积极,但是往往积极不到点子上,有点瞎忙活的感觉
而另一个版本的模型相对克制,但往往做事情很靠谱
我认为这中间是人与模型分别付出多少的一个博弈关系,即模型的积极性与引导用户给出更好的prompt指令之间的平衡
登录后回复