| ★ | Episode 2 - Les équations de Bellman | CNRS - Formation FIDLE @cnrs-fidle | 440 | Francia | |
| 16 | AI Spiegata Semplice ✅ Come creare e addestrare Reti Neurali da zero - Corso AI e Deep Learning. | PitoneProgrammatore @pitoneprogrammatoreofficial | 6.4K | Italia | 51 |
| 19 | LES GRADIENTS D'UN NEURONE - DEEP LEARNING (03) | Machine Learnia @machinelearnia | 6.0K | Reino Unido | 50 |
| 17 | NEURONE ARTIFICIEL - CHAT VS CHIEN - DEEP LEARNING 6 | Machine Learnia @machinelearnia | 3.1K | Reino Unido | 51 |
| 13 | Représentation du réel : Data, embedding et espace latent (épisode 9) | CNRS - Formation FIDLE @cnrs-fidle | 2.6K | Francia | 55 |
| 18 | RÉSEAU DE NEURONES PROFOND - DEEP LEARNING 10 | Machine Learnia @machinelearnia | 2.5K | Reino Unido | 51 |
| 2 | Episode 0 - Introduction | CNRS - Formation FIDLE @cnrs-fidle | 1.6K | Francia | 85 |
| 15 | LLM Tuning Competiion - First Look Live Stream | | 1.5K | Estados Unidos | 51 |
| 20 | "Attention Is All You Need", quand les Transformers changent la donne (épisode 12) | CNRS - Formation FIDLE @cnrs-fidle | 1.5K | Francia | 50 |
| 14 | Inférence et déploiement de serveurs IA : Do It Yourself ! (épisode 19) | CNRS - Formation FIDLE @cnrs-fidle | 1.1K | Francia | 51 |
| 3 | Episode 3 - SARSA et Q-Learning | CNRS - Formation FIDLE @cnrs-fidle | 904 | Francia | 83 |
| 11 | Reinforcement Learning | Algorithms | ML | Machine Learning | AI | Btech | BSc | Diploma | BCA | | 827 | India | 56 |
| 9 | Episode 9 - Inverse Reinforcement Learning | CNRS - Formation FIDLE @cnrs-fidle | 727 | Francia | 66 |
| 4 | Episode 4 - Deep Q Network | CNRS - Formation FIDLE @cnrs-fidle | 688 | Francia | 83 |
| 5 | Episode 7 - Aujourd'hui, où et quand utiliser le Reinforcement Learning | CNRS - Formation FIDLE @cnrs-fidle | 409 | Francia | 81 |
| 1 | Episode 1 - RL, de quoi parlons nous ? | CNRS - Formation FIDLE @cnrs-fidle | 354 | Francia | 85 |
| 6 | Episode 6 - Off-Policy Gradient (DDPG, TD3, SAC) | CNRS - Formation FIDLE @cnrs-fidle | 289 | Francia | 80 |
| 10 | An Introduction to Reinforcement Learning | | 247 | Estados Unidos | 58 |
| 7 | Episode 5 - On-Policy Gradient (VPG, A2C, TRPO, PPO) | CNRS - Formation FIDLE @cnrs-fidle | 159 | Francia | 79 |
| 8 | Episode 8 - RLHF, RLAIF et Reward Model | CNRS - Formation FIDLE @cnrs-fidle | 129 | Francia | 75 |
| 12 | Lecture 5.1 | Reinforcement learning | Reinforcement learning in practice | #mlt #aktu #unit5 | Tech Master Edu @techmasteredu | 67 | India | 56 |