{"product_id":"139974","title":"apprentissage par renforcement ","description":"\u003ccenter\u003e\u003cdiv style=\"text-align:center\"\u003e\u003cimg src=\"https:\/\/tmgdisk01.cafe24.com\/images\/vs\/4172\/sv\/3jXOZV81rkizzu1h0DIGQk11o97IhZ.png?v=1765077525\" style=\"max-width:100%;max-height:10px\"\u003e\u003c\/div\u003e\u003c\/center\u003e\n\u003ccenter\u003e\u003ctable\u003e\u003ctr\u003e\u003ctd style=\"height:10px\"\u003e\u003c\/td\u003e\u003c\/tr\u003e\u003c\/table\u003e\u003c\/center\u003e\n\u003ccenter\u003e\u003ctable\u003e\u003ctr\u003e\u003ctd style=\"height:10px\"\u003e\u003c\/td\u003e\u003c\/tr\u003e\u003c\/table\u003e\u003c\/center\u003e\n\u003ccenter\u003e\n\n\u003cdiv style=\"width:95%\"\u003e\n\n\u003cdiv style=\"text-align:center;font-size:30px;font-weight:bolder;line-height:1.6em\"\u003e apprentissage par renforcement \u003c\/div\u003e\n\n\u003ccenter\u003e\u003ctable\u003e\u003ctr\u003e\u003ctd style=\"height:10px\"\u003e\u003c\/td\u003e\u003c\/tr\u003e\u003c\/table\u003e\u003c\/center\u003e\n\n\u003ccenter\u003e\u003ctable\u003e\u003ctr\u003e\u003ctd style=\"height:10px\"\u003e\u003c\/td\u003e\u003c\/tr\u003e\u003c\/table\u003e\u003c\/center\u003e\n\n\u003ccenter\u003e\u003ctable\u003e\u003ctr\u003e\u003ctd style=\"height:10px\"\u003e\u003c\/td\u003e\u003c\/tr\u003e\u003c\/table\u003e\u003c\/center\u003e\n\n\u003ccenter\u003e\u003ctable\u003e\u003ctr\u003e\u003ctd style=\"height:10px\"\u003e\u003c\/td\u003e\u003c\/tr\u003e\u003c\/table\u003e\u003c\/center\u003e\n\n\u003cdiv style=\"border-bottom:1px;border-bottom-style:dotted;border-color:;padding-bottom:20px\"\u003e\u003ccenter\u003e\u003ctable align=\"center\" width=\"100%\"\u003e\u003ctbody style=\"border:0px\"\u003e\n\n\u003ctr\u003e\u003ctd align=\"center\" style=\"line-height:1.2em;text-align:center;font-size:18px;color:black;font-weight:bold;padding-bottom:20px;\"\u003e\u003c\/td\u003e\u003c\/tr\u003e\n\n\u003ctr\u003e\u003ctd style=\"text-align:center\"\u003e\u003cimg src=\"https:\/\/image.yes24.com\/goods\/149677992\/XL\" style=\"max-width:100%;height:auto\"\u003e\u003c\/td\u003e\u003c\/tr\u003e\n\n\n\u003c\/tbody\u003e\u003c\/table\u003e\u003c\/center\u003e\u003c\/div\u003e\n\n\u003ccenter\u003e\u003ctable\u003e\u003ctr\u003e\u003ctd style=\"height:10px\"\u003e\u003c\/td\u003e\u003c\/tr\u003e\u003c\/table\u003e\u003c\/center\u003e\n\n\u003ccenter\u003e\u003ctable\u003e\u003ctr\u003e\u003ctd style=\"height:10px\"\u003e\u003c\/td\u003e\u003c\/tr\u003e\u003c\/table\u003e\u003c\/center\u003e\n\n\u003cdiv style=\"width:95%;{split_style6}padding-top:20px;padding-bottom:20px\"\u003e\n\n\u003cdiv style=\"text-align:left;font-size:16px;font-weight:bold;padding-bottom:20px\"\u003e Description \u003c\/div\u003e\n\n\u003cdiv style=\"text-align:left;word-break:break-all;font-size:14px;line-height:1.6em;\"\u003e\n\n\u003cdiv\u003e\u003ch5\u003e \u003cb\u003eIntroduction au livre\u003c\/b\u003e\n\u003c\/h5\u003e\u003c\/div\u003e\n\u003cdiv\u003e\n\u003cdiv\u003e\u003cdiv\u003e \u003cb\u003eComprendre les concepts et algorithmes clés\u003c\/b\u003e \u003cbr\u003eUn manuel sur l'apprentissage par renforcement mis en œuvre par la pratique\u003cbr\u003e\u003cbr\u003e « Apprentissage par renforcement » s’adresse aux lecteurs qui souhaitent apprendre systématiquement l’apprentissage par renforcement, des principes de base à ses applications.\u003cbr\u003e Nous présentons tout d'abord une nouvelle idée pour résoudre le problème et expliquons les principes de base qui la sous-tendent.\u003cbr\u003e Ensuite, nous présentons un algorithme basé sur une formule et organisons le contenu de manière à ce que les étudiants puissent implémenter l'algorithme dans un environnement réel et évaluer ses performances d'apprentissage en pratiquant des programmes utilisant TensorFlow et Gymnasium.\u003cbr\u003e Il couvre également tout, de la programmation dynamique traditionnelle aux algorithmes les plus récents tels que DQN, PPO et SAC, et reflète fidèlement des domaines d'application avancés tels que la conduite autonome, les robots intelligents et l'AGI, ainsi que les dernières tendances de la recherche.\u003cbr\u003e\u003cbr\u003e ※ Ce livre a été conçu comme manuel pour les cours universitaires, il ne fournit donc pas de réponses aux exercices pratiques.\u003cbr\u003e\n\n\u003c\/div\u003e\u003c\/div\u003e\n\u003cdiv\u003e\u003cul\u003e\u003cli\u003e Vous pouvez consulter un aperçu du contenu du livre.\u003cbr\u003e \u003cspan\u003eAperçu\u003c\/span\u003e\n\n\u003c\/li\u003e\u003c\/ul\u003e\u003c\/div\u003e\n\u003c\/div\u003e\n\u003cbr\u003e\u003cdiv\u003e\u003ch5\u003e \u003cb\u003eindice\u003c\/b\u003e\n\u003c\/h5\u003e\u003c\/div\u003e\n\u003cdiv\u003e  \u003cdiv\u003eCHAPITRE 01 Introduction\u003cbr\u003e 1 Qu'est-ce que l'apprentissage par renforcement ?\u003cbr\u003e 2. Apprentissage automatique = Apprentissage supervisé + Apprentissage non supervisé + Apprentissage par renforcement\u003cbr\u003e 3 témoignages de réussite et applications\u003cbr\u003e 4. Bref historique\u003cbr\u003e 5 lectures\u003cbr\u003e Problèmes pratiques\u003cbr\u003e\u003cbr\u003e CHAPITRE 02 Établir les bases de l'apprentissage par renforcement\u003cbr\u003e 1. Agents qui interagissent avec l'environnement\u003cbr\u003e 2. Programmation MDP avec Python\u003cbr\u003e 3. Comparaison des gains attendus entre les politiques aléatoires et optimales\u003cbr\u003e 4 Fonctions de politique et de valeur\u003cbr\u003e 5. Comprendre la difficulté et les approches de l'apprentissage par renforcement\u003cbr\u003e Problèmes pratiques\u003cbr\u003e\u003cbr\u003e CHAPITRE 03 Programmation dynamique\u003cbr\u003e 1. Principe\u003cbr\u003e 2. Équation de Bellman et algorithme d'itération de politique\u003cbr\u003e 3. Équation d'optimalité de Bellman et algorithme d'itération de valeur\u003cbr\u003e 4. Programmation dynamique des tâches stochastiques\u003cbr\u003e 5 Caractéristiques et limites de la programmation dynamique\u003cbr\u003e Problèmes pratiques\u003cbr\u003e\u003cbr\u003e CHAPITRE 04 Méthode de Monte Carlo\u003cbr\u003e Générateur d'épisodes\u003cbr\u003e 2. Équilibre entre exploration et exploration\u003cbr\u003e 3. Évaluation des politiques publiques par la méthode de Monte-Carlo\u003cbr\u003e 4. Apprentissage des politiques par la méthode de Monte Carlo\u003cbr\u003e 5 techniques d'amélioration des performances\u003cbr\u003e Problèmes pratiques\u003cbr\u003e\u003cbr\u003e CHAPITRE 05 Apprentissage différentiel dans le temps\u003cbr\u003e 1. Principe\u003cbr\u003e 2. Évaluation des politiques\u003cbr\u003e 3 Sarsa\u003cbr\u003e 4. Apprentissage par renforcement (Q-Learning)\u003cbr\u003e Apprendre le blackjack avec l'apprentissage par renforcement (Q-Learning) \u003cbr\u003e6 Entraînement CartPole avec Q-Learning\u003cbr\u003e 7 techniques d'amélioration des performances\u003cbr\u003e 8. Élargir la perspective\u003cbr\u003e Problèmes pratiques\u003cbr\u003e\u003cbr\u003e CHAPITRE 06 Méthodes d'approximation utilisant des réseaux de neurones\u003cbr\u003e 1. Notions de base des réseaux de neurones\u003cbr\u003e 2. Implémentation du réseau neuronal\u003cbr\u003e Apprentissage par renforcement (Q-learning) utilisant 3 réseaux de neurones\u003cbr\u003e 4. Implémentation de l'apprentissage par renforcement Q basé sur un réseau neuronal : tâche CartPole\u003cbr\u003e 5. Implémentation de l'apprentissage par renforcement Q basé sur un réseau neuronal : tâche de Blackjack\u003cbr\u003e 6 Controverses et nouvelles pistes pour les réseaux neuronaux\u003cbr\u003e Problèmes pratiques\u003cbr\u003e\u003cbr\u003e CHAPITRE 07 Méthodes d'apprentissage profond\u003cbr\u003e 1 Un changement majeur vers l'apprentissage profond\u003cbr\u003e 2DQNs\u003cbr\u003e 3 Replay Memory\u003cbr\u003e 4 notions de base de l'apprentissage profond\u003cbr\u003e 5 Environnement de jeu Atari\u003cbr\u003e Jeu Atari 6 Pong utilisant DQN\u003cbr\u003e 7 Remarques supplémentaires\u003cbr\u003e Problèmes pratiques\u003cbr\u003e\u003cbr\u003e CHAPITRE 08 Méthode du gradient de politique\u003cbr\u003e 1. Apprentissage axé sur les politiques\u003cbr\u003e 2 Algorithme RENFORCE\u003cbr\u003e 3. RENFORCER la programmation : tâches discrètes\u003cbr\u003e Gradient de politique pour 4 tâches consécutives\u003cbr\u003e 5. RENFORCER la programmation : Tâches continues\u003cbr\u003e 6. Accélérer les opérations sur les tableaux en Python\u003cbr\u003e Problèmes pratiques\u003cbr\u003e\u003cbr\u003e CHAPITRE 09 La méthode de l'activiste-critique\u003cbr\u003e 1. Collaboration entre militants et critiques\u003cbr\u003e 2. Compromis biais-variance\u003cbr\u003e 3. Fonction de profit\u003cbr\u003e 4 A2C et A3C\u003cbr\u003e 5 Programmation A2C : Tâches discrètes \u003cbr\u003e6 Programmation A2C : Tâches continues\u003cbr\u003e Problèmes pratiques\u003cbr\u003e\u003cbr\u003e CHAPITRE 10 MÉTHODE DE LA RÉGION DE CONFIDENTIALITÉ\u003cbr\u003e 1. Amélioration de la politique relative aux billets uniques\u003cbr\u003e 2 Algorithme TRPO\u003cbr\u003e 3 Algorithme PPO\u003cbr\u003e 4. Améliorer l'efficacité du PPO\u003cbr\u003e 5 Programmation PPO : Tâches continues\u003cbr\u003e Problèmes pratiques\u003cbr\u003e\u003cbr\u003e CHAPITRE 11 Combinaison de l'optimisation des politiques et du DQN\u003cbr\u003e 1. Motivation et développement\u003cbr\u003e 2. Algorithme d'apprentissage DDPG\u003cbr\u003e 3. Exercice de programmation : Apprentissage des tâches de type « hopper » à l’aide de DDPG\u003cbr\u003e 4 Algorithme d'apprentissage TD3\u003cbr\u003e 5 Exercices de programmation : Apprentissage de la tâche du sauteur à l’aide de TD3\u003cbr\u003e 6 algorithmes d'apprentissage SAC\u003cbr\u003e 7 Exercices de programmation : Apprentissage des tâches de type « hopper » avec SAC\u003cbr\u003e 8. Analyse comparative\u003cbr\u003e Problèmes pratiques\u003cbr\u003e\u003cbr\u003e CHAPITRE 12 L'apprentissage par mimétisme\u003cbr\u003e 1. Idée et développement\u003cbr\u003e 2. Actions en double\u003cbr\u003e 3. Apprentissage par renforcement inverse\u003cbr\u003e 4. Apprentissage par mimétisme adverse\u003cbr\u003e 5. Mimétisme par observation\u003cbr\u003e Problèmes pratiques\u003cbr\u003e\u003cbr\u003e CHAPITRE 13 APPLICATIONS AVANCÉES\u003cbr\u003e 1 Produits avancés conçus grâce à l'apprentissage par renforcement : opportunités et défis\u003cbr\u003e 2 jeux vidéo\u003cbr\u003e 3 jeux de société\u003cbr\u003e 4 Modèles de langage à grande échelle\u003cbr\u003e 5. Conduite autonome\u003cbr\u003e 6 robots\u003cbr\u003e 7 Vers une intelligence artificielle générale\u003cbr\u003e Problèmes pratiques\u003cbr\u003e\u003cbr\u003e Références\u003cbr\u003e Recherche\u003c\/div\u003e\n\u003cdiv\u003e\u003c\/div\u003e\n\u003c\/div\u003e\n\u003cbr\u003e\u003cdiv\u003e\u003ch5\u003e \u003cb\u003eImage détaillée\u003c\/b\u003e \u003c\/h5\u003e\u003c\/div\u003e\n\u003cdiv\u003e\u003cdiv\u003e\u003cimg src=\"https:\/\/image.yes24.com\/momo\/TopCate5459\/MidCate1\/545803459.jpg\" border=\"0\" alt=\"Image détaillée 1\"\u003e\u003c\/div\u003e\u003c\/div\u003e\n\u003c\/div\u003e\n\n\n\u003c\/div\u003e\n\n\u003ccenter\u003e\u003ctable\u003e\u003ctr\u003e\u003ctd style=\"height:10px\"\u003e\u003c\/td\u003e\u003c\/tr\u003e\u003c\/table\u003e\u003c\/center\u003e\n\n\u003ccenter\u003e\u003ctable\u003e\u003ctr\u003e\u003ctd style=\"height:10px\"\u003e\u003c\/td\u003e\u003c\/tr\u003e\u003c\/table\u003e\u003c\/center\u003e\n\n\u003cdiv style=\"width:95%;padding-top:20px;padding-bottom:20px\"\u003e\n\n\u003cdiv style=\"text-align:left;font-size:16px;font-weight:bold;padding-bottom:20px\"\u003e SPÉCIFICATIONS DES PRODUITS\u003c\/div\u003e\n\n\u003cdiv style=\"text-align:left;font-size:14px;line-height:1.6em;\"\u003e\n\n \u003cdiv style=\"width:100%;margin-bottom:5px;line-height:1.6em;font-size:14px\"\u003e- \u003cstrong\u003eDate d'émission :\u003c\/strong\u003e 24 juillet 2025\u003c\/div\u003e\n\n\u003cdiv style=\"width:100%;margin-bottom:5px;line-height:1.6em;font-size:14px\"\u003e \u003cstrong\u003eNombre de pages, poids, dimensions :\u003c\/strong\u003e 536 pages | 1 059 g | 188 × 257 × 21 mm\u003c\/div\u003e\n\n\u003cdiv style=\"width:100%;margin-bottom:5px;line-height:1.6em;font-size:14px\"\u003e - \u003cstrong\u003eISBN13 :\u003c\/strong\u003e 9791173400070 \u003c\/div\u003e\n\n\n\u003c\/div\u003e\n\n\n\u003c\/div\u003e\n\n\n\u003c\/div\u003e\n\n\u003ccenter\u003e\n\n\u003ccenter\u003e\u003ctable\u003e\u003ctr\u003e\u003ctd style=\"height:10px\"\u003e\u003c\/td\u003e\u003c\/tr\u003e\u003c\/table\u003e\u003c\/center\u003e\n\n\u003ccenter\u003e\u003ctable\u003e\u003ctr\u003e\u003ctd style=\"height:10px\"\u003e\u003c\/td\u003e\u003c\/tr\u003e\u003c\/table\u003e\u003c\/center\u003e\n\n\u003cspan\u003e\u003c\/span\u003e\n\n\u003c\/center\u003e\n\n\n\u003c\/center\u003e","brand":"LIBRAIRIE COREENNE","offers":[{"title":"Default Title","offer_id":43893389688874,"sku":"139974","price":54.0,"currency_code":"EUR","in_stock":true}],"thumbnail_url":"\/\/cdn.shopify.com\/s\/files\/1\/0683\/2750\/5962\/files\/9471fa89dff7670203d501dfb7dceee2.jpg?v=1765399807","url":"https:\/\/librairie.coreenne.fr\/products\/139974","provider":"LIBRAIRIE COREENNE","version":"1.0","type":"link"}