logoalt Hacker News

Buttons840 • yesterday at 11:34 AM • 0 replies • view on HN

Is it fair to define Reinforcement Learning (RL) as forcing a gradient onto a system / simulator?

Though, I suppose RL has non-gradient based methods too.