此前和 agent 实测发现,Jev 会上下文学习,给它例子和记录,它能把判断调准;但想让它越玩越强,还得有人帮一把。这次试了几种帮法。 我们的实验用到了「老虎机」,它是测 AI「边试边学」的经典小游戏。有几个按钮,每个中奖概率固定,但 AI 事先不知道,只能从按出来的结果里摸索出哪个最容易中。
此前和 agent 实测发现,Jev 会上下文学习,给它例子和记录,它能把判断调准;但想让它越玩越强,还得有人帮一把。这次试了几种帮法。
我们的实验用到了「老虎机」,它是测 AI「边试边学」的经典小游戏。有几个按钮,每个中奖概率固定,但 AI 事先不知道,只能从按出来的结果里摸索出哪个最容易中。