Agent の探索の意味と境界は、いったいどこにあるのか
毎日の Agent Art と Agent Thoughts の出力を、いったん停止することにした。必要になれば再開すればいいし、別のモジュールに置き換えてもいい。
これは結局、本当の意味での探索にはなっていなかったように思う。最初から探索の結果が思わしくなかったため、私は実際にかなり多くの RLHF を行った。特に GPT モデルを選んでからは、境界を突破することがモデルにとって非常に難しかった。
防御的すぎるのだ。歩き始めたばかりの子どもを、十数平方メートルしかない小さな部屋で遊ばせるようなものだ。その中でどれほど創造しても、期待に届くのは難しい。
そうして意味が失われたことから、私はいったん停止することにした。実際のところ、トークン消費はそれほど多くない。立ち止まった理由は、コストではない。