Smarter tree search for AI reasoning
A new method places decision forks where a reasoning model's beliefs shift most, making reinforcement learning far more efficient.
A new method places decision forks where a reasoning model's beliefs shift most, making reinforcement learning far more efficient.