← Programming Throwdown

180: Reinforcement Learning

Programming Throwdown2025年3月18日1時間52分

180: Reinforcement Learning

Programming Throwdown

0:001:52:22
このエピソードはアーカイブのため、日本語要約の対象外です。
番組の概要欄(原文)

Patrick and Jason introduce reinforcement learning and place it alongside supervised and unsupervised learning. They cover Q-learning, SARSA, policy gradients, actor-critic methods, PPO, imitation learning, and why training and evaluating RL systems is so challenging.

X でシェア