| ★ | Episode 4 - Deep Q Network | CNRS - Formation FIDLE @cnrs-fidle | 688 | Francia | |
| 15 | Comment l'IA Apprend Sans Supervision ? SSL Expliqué | Deep Learner, One Step at a Time @deeplearneronestepatatime | — | Francia | 55 |
| 14 | LE PERCEPTRON - DEEP LEARNING (02) | Machine Learnia @machinelearnia | 12.0K | Reino Unido | 57 |
| 19 | PROGRAMMATION d'un NEURONE ARTIFICIEL (DEEP LEARNING 5) | Machine Learnia @machinelearnia | 5.4K | Reino Unido | 54 |
| 11 | RÉSEAU DE NEURONES (2 COUCHES) - DEEP LEARNING 7 | Machine Learnia @machinelearnia | 3.1K | Reino Unido | 59 |
| 16 | PINNs - Physics Informed Neural Networks (épisode 16) | CNRS - Formation FIDLE @cnrs-fidle | 3.0K | Francia | 55 |
| 12 | RÉSEAU DE NEURONES PROFOND - DEEP LEARNING 10 | Machine Learnia @machinelearnia | 2.5K | Reino Unido | 58 |
| 17 | PROGRAMMER UN RÉSEAU DE NEURONES à 2 COUCHES - DEEP LEARNING 9 | Machine Learnia @machinelearnia | 2.2K | Reino Unido | 54 |
| 4 | Episode 0 - Introduction | CNRS - Formation FIDLE @cnrs-fidle | 1.6K | Francia | 84 |
| 18 | How to Reprogram a Brain Cell | SciShow Psych @scishowpsych | 1.0K | Estados Unidos | 54 |
| 2 | Episode 3 - SARSA et Q-Learning | CNRS - Formation FIDLE @cnrs-fidle | 904 | Francia | 85 |
| 13 | Reinforcement Learning | Algorithms | ML | Machine Learning | AI | Btech | BSc | Diploma | BCA | | 827 | India | 57 |
| 9 | Episode 9 - Inverse Reinforcement Learning | CNRS - Formation FIDLE @cnrs-fidle | 727 | Francia | 69 |
| 5 | Episode 2 - Les équations de Bellman | CNRS - Formation FIDLE @cnrs-fidle | 440 | Francia | 83 |
| 3 | Episode 7 - Aujourd'hui, où et quand utiliser le Reinforcement Learning | CNRS - Formation FIDLE @cnrs-fidle | 409 | Francia | 84 |
| 1 | Episode 1 - RL, de quoi parlons nous ? | CNRS - Formation FIDLE @cnrs-fidle | 354 | Francia | 89 |
| 6 | Episode 6 - Off-Policy Gradient (DDPG, TD3, SAC) | CNRS - Formation FIDLE @cnrs-fidle | 289 | Francia | 81 |
| 10 | An Introduction to Reinforcement Learning | | 247 | Estados Unidos | 63 |
| 7 | Episode 5 - On-Policy Gradient (VPG, A2C, TRPO, PPO) | CNRS - Formation FIDLE @cnrs-fidle | 159 | Francia | 79 |
| 8 | Episode 8 - RLHF, RLAIF et Reward Model | CNRS - Formation FIDLE @cnrs-fidle | 129 | Francia | 74 |
| 20 | Lecture 5.1 | Reinforcement learning | Reinforcement learning in practice | #mlt #aktu #unit5 | Tech Master Edu @techmasteredu | 67 | India | 54 |