{"product_id":"138151","title":"밑바닥부터 시작하는 딥러닝 4","description":"\u003ccenter\u003e\u003cdiv style=\"text-align:center\"\u003e\u003cimg src=\"https:\/\/tmgdisk01.cafe24.com\/images\/vs\/4172\/sv\/3jXPCfJfoP9wfAQSYu86CUe72Pp6hf.png?v=1765060751\" style=\"max-width:100%;max-height:10px\"\u003e\u003c\/div\u003e\u003c\/center\u003e\u003ccenter\u003e\u003ctable\u003e\u003ctr\u003e\u003ctd style=\"height:10px\"\u003e\u003c\/td\u003e\u003c\/tr\u003e\u003c\/table\u003e\u003c\/center\u003e\u003ccenter\u003e\u003ctable\u003e\u003ctr\u003e\u003ctd style=\"height:10px\"\u003e\u003c\/td\u003e\u003c\/tr\u003e\u003c\/table\u003e\u003c\/center\u003e\u003ccenter\u003e\n\u003cdiv style=\"width:95%\"\u003e\n\u003cdiv style=\"text-align:center;font-size:30px;font-weight:bolder;line-height:1.6em\"\u003e밑바닥부터 시작하는 딥러닝 4\u003c\/div\u003e\n\u003ccenter\u003e\u003ctable\u003e\u003ctr\u003e\u003ctd style=\"height:10px\"\u003e\u003c\/td\u003e\u003c\/tr\u003e\u003c\/table\u003e\u003c\/center\u003e\n\u003ccenter\u003e\u003ctable\u003e\u003ctr\u003e\u003ctd style=\"height:10px\"\u003e\u003c\/td\u003e\u003c\/tr\u003e\u003c\/table\u003e\u003c\/center\u003e\n\u003ccenter\u003e\u003ctable\u003e\u003ctr\u003e\u003ctd style=\"height:10px\"\u003e\u003c\/td\u003e\u003c\/tr\u003e\u003c\/table\u003e\u003c\/center\u003e\n\u003ccenter\u003e\u003ctable\u003e\u003ctr\u003e\u003ctd style=\"height:10px\"\u003e\u003c\/td\u003e\u003c\/tr\u003e\u003c\/table\u003e\u003c\/center\u003e\n\u003cdiv style=\"border-bottom:1px;border-bottom-style:dotted;border-color:;padding-bottom:20px\"\u003e\u003ccenter\u003e\u003ctable align=\"center\" width=\"100%\"\u003e\u003ctbody style=\"border:0px\"\u003e\n\u003ctr\u003e\u003ctd align=\"center\" style=\"line-height:1.2em;text-align:center;font-size:18px;color:black;font-weight:bold;padding-bottom:20px;\"\u003e\u003c\/td\u003e\u003c\/tr\u003e\n\u003ctr\u003e\u003ctd style=\"text-align:center\"\u003e\u003cimg src=\"https:\/\/image.yes24.com\/goods\/124640233\/XL\" style=\"max-width:100%;height:auto\"\u003e\u003c\/td\u003e\u003c\/tr\u003e\n\u003c\/tbody\u003e\u003c\/table\u003e\u003c\/center\u003e\u003c\/div\u003e\n\u003ccenter\u003e\u003ctable\u003e\u003ctr\u003e\u003ctd style=\"height:10px\"\u003e\u003c\/td\u003e\u003c\/tr\u003e\u003c\/table\u003e\u003c\/center\u003e\n\u003ccenter\u003e\u003ctable\u003e\u003ctr\u003e\u003ctd style=\"height:10px\"\u003e\u003c\/td\u003e\u003c\/tr\u003e\u003c\/table\u003e\u003c\/center\u003e\n\u003cdiv style=\"width:95%;{split_style6}padding-top:20px;padding-bottom:20px\"\u003e\n\u003cdiv style=\"text-align:left;font-size:16px;font-weight:bold;padding-bottom:20px\"\u003eDescription\u003c\/div\u003e\n\u003cdiv style=\"text-align:left;word-break:break-all;font-size:14px;line-height:1.6em;\"\u003e\n\u003cdiv\u003e \u003ch5\u003e\u003cb\u003e책소개\u003c\/b\u003e\u003c\/h5\u003e \u003c\/div\u003e \u003cdiv\u003e \u003cdiv\u003e \u003cdiv\u003e  \u003cb\u003e『밑바닥부터 시작하는 딥러닝』 시리즈, 이번엔 강화 학습이다! \u003cbr\u003e강화 학습 핵심 이론부터 문제 풀이, 심층 강화 학습까지 한 권에!\u003c\/b\u003e\u003cbr\u003e\u003cbr\u003e이 책의 특징은 제목 그대로 ‘밑바닥부터 만들어가는 것’이다.\u003cbr\u003e속을 알 수 없는 외부 라이브러리에 의존하지 않고 강화 학습 알고리즘을 처음부터 구현하면서 배운다.\u003cbr\u003e그림으로 원리를 이해하고 수학으로 강화 학습 문제를 풀어본 다음, 코드로 구현해 배운 내용을 되짚어본다.\u003cbr\u003e코드는 최대한 간결하면서도 강화 학습에서 중요한 아이디어가 명확하게 드러나도록 짰다.\u003cbr\u003e단계적으로 수준을 높이면서 다양한 문제에 접할 수 있도록 구성하였으니 강화 학습의 어려움과 재미를 모두 느낄 수 있을 것이다.\u003cbr\u003e \u003c\/div\u003e \u003c\/div\u003e \u003cdiv\u003e \u003cul\u003e \u003cli\u003e 책의 일부 내용을 미리 읽어보실 수 있습니다.\u003cbr\u003e\u003cspan\u003e미리보기\u003c\/span\u003e\n\u003c\/li\u003e \u003c\/ul\u003e \u003c\/div\u003e \u003c\/div\u003e \u003cbr\u003e\u003cdiv\u003e \u003ch5\u003e\u003cb\u003e목차\u003c\/b\u003e\u003c\/h5\u003e \u003c\/div\u003e \u003cdiv\u003e \u003cdiv\u003e  \u003cb\u003eCHAPTER 1 밴디트 문제\u003c\/b\u003e\u003cbr\u003e\u003cbr\u003e_1.1 머신러닝 분류와 강화 학습\u003cbr\u003e_1.2 밴디트 문제\u003cbr\u003e_1.3 밴디트 알고리즘\u003cbr\u003e_1.4 밴디트 알고리즘 구현\u003cbr\u003e_1.5 비정상 문제\u003cbr\u003e_1.6 정리\u003cbr\u003e\u003cbr\u003e\u003cb\u003eCHAPTER 2 마르코프 결정 과정\u003c\/b\u003e\u003cbr\u003e\u003cbr\u003e_2.1 마르코프 결정 과정(MDP)이란?\u003cbr\u003e_2.2 환경과 에이전트를 수식으로\u003cbr\u003e_2.3 MDP의 목표\u003cbr\u003e_2.4 MDP 예제\u003cbr\u003e_2.5 정리\u003cbr\u003e\u003cbr\u003e\u003cb\u003eCHAPTER 3 벨만 방정식\u003c\/b\u003e\u003cbr\u003e\u003cbr\u003e_3.1 벨만 방정식 도출\u003cbr\u003e_3.2 벨만 방정식의 예\u003cbr\u003e_3.3 행동 가치 함수(Q 함수)와 벨만 방정식\u003cbr\u003e_3.4 벨만 최적 방정식\u003cbr\u003e_3.5 벨만 최적 방정식의 예\u003cbr\u003e_3.6 정리\u003cbr\u003e\u003cbr\u003e\u003cb\u003eCHAPTER 4 동적 프로그래밍\u003c\/b\u003e\u003cbr\u003e\u003cbr\u003e_4.1 동적 프로그래밍과 정책 평가\u003cbr\u003e_4.2 더 큰 문제를 향해\u003cbr\u003e_4.3 정책 반복법\u003cbr\u003e_4.4 정책 반복법 구현\u003cbr\u003e_4.5 가치 반복법\u003cbr\u003e_4.6 정리\u003cbr\u003e\u003cbr\u003e\u003cb\u003eCHAPTER 5 몬테카를로법\u003c\/b\u003e\u003cbr\u003e\u003cbr\u003e_5.1 몬테카를로법 기초\u003cbr\u003e_5.2 몬테카를로법으로 정책 평가하기\u003cbr\u003e_5.3 몬테카를로법 구현\u003cbr\u003e_5.4 몬테카를로법으로 정책 제어하기\u003cbr\u003e_5.5 오프-정책과 중요도 샘플링\u003cbr\u003e_5.6 정리\u003cbr\u003e\u003cbr\u003e\u003cb\u003eCHAPTER 6 TD법\u003c\/b\u003e\u003cbr\u003e\u003cbr\u003e_6.1 TD법으로 정책 평가하기\u003cbr\u003e_6.2 SARSA\u003cbr\u003e_6.3 오프-정책 SARSA\u003cbr\u003e_6.4 Q 러닝\u003cbr\u003e_6.5 분포 모델과 샘플 모델\u003cbr\u003e_6.6 정리\u003cbr\u003e\u003cbr\u003e\u003cb\u003eCHAPTER 7 신경망과 Q 러닝\u003c\/b\u003e\u003cbr\u003e\u003cbr\u003e_7.1 DeZero 기초\u003cbr\u003e_7.2 선형 회귀\u003cbr\u003e_7.3 신경망\u003cbr\u003e_7.4 Q 러닝과 신경망\u003cbr\u003e_7.5 정리\u003cbr\u003e\u003cbr\u003e\u003cb\u003eCHAPTER 8 DQN\u003c\/b\u003e\u003cbr\u003e\u003cbr\u003e_8.1 OpenAI Gym\u003cbr\u003e_8.2 DQN의 핵심 기술\u003cbr\u003e_8.3 DQN과 아타리\u003cbr\u003e_8.4 DQN 확장\u003cbr\u003e_8.5 정리\u003cbr\u003e\u003cbr\u003e\u003cb\u003eCHAPTER 9 정책 경사법\u003c\/b\u003e\u003cbr\u003e\u003cbr\u003e_9.1 가장 간단한 정책 경사법\u003cbr\u003e_9.2 REINFORCE\u003cbr\u003e_9.3 베이스라인\u003cbr\u003e_9.4 행위자-비평자\u003cbr\u003e_9.5 정책 기반 기법의 장점\u003cbr\u003e_9.6 정리\u003cbr\u003e\u003cbr\u003e\u003cb\u003eCHAPTER 10 한 걸음 더\u003c\/b\u003e\u003cbr\u003e\u003cbr\u003e_10.1 심층 강화 학습 알고리즘 분류\u003cbr\u003e_10.2 정책 경사법 계열의 고급 알고리즘\u003cbr\u003e_10.3 DQN 계열의 고급 알고리즘\u003cbr\u003e_10.4 사례 연구\u003cbr\u003e_10.5 심층 강화 학습이 풀어야 할 숙제와 가능성\u003cbr\u003e_10.6 정리\u003cbr\u003e\u003cbr\u003eAPPENDIX A 오프-정책 몬테카를로법\u003cbr\u003eA.1 오프-정책 몬테카를로법 이론\u003cbr\u003eA.2 오프-정책 몬테카를로법 구현\u003cbr\u003e\u003cbr\u003eAPPENDIX B n단계 TD법\u003cbr\u003e\u003cbr\u003eAPPENDIX C Double DQN 이해하기\u003cbr\u003eC.1 DQN에서의 과대적합이란?\u003cbr\u003eC.2 과대적합 해결 방법\u003cbr\u003e\u003cbr\u003eAPPENDIX D 정책 경사법 증명\u003cbr\u003eD.1 정책 경사법 도출\u003cbr\u003eD.2 베이스라인 도출 \u003c\/div\u003e \u003cdiv\u003e\u003c\/div\u003e \u003c\/div\u003e \u003cbr\u003e\u003cdiv\u003e \u003ch5\u003e\u003cb\u003e상세 이미지\u003c\/b\u003e\u003c\/h5\u003e \u003c\/div\u003e \u003cdiv\u003e \u003cdiv\u003e \u003cimg src=\"https:\/\/image.yes24.com\/momo\/TopCate4414\/MidCate003\/441326102.jpg\" border=\"0\" alt=\"상세 이미지 1\"\u003e \u003c\/div\u003e \u003c\/div\u003e \u003cbr\u003e\u003cdiv\u003e \u003ch5\u003e\u003cb\u003e출판사 리뷰\u003c\/b\u003e\u003c\/h5\u003e \u003c\/div\u003e \u003cdiv\u003e \u003cdiv\u003e  \u003cb\u003e강화 학습 마스터의 지름길은 기초를 다지는 것!\u003c\/b\u003e\u003cbr\u003e\u003cbr\u003e딥러닝은 매우 핫한 분야여서 하루가 멀다 하고 새로운 알고리즘과 응용 사례가 발표되고 있습니다.\u003cbr\u003e엄청난 발전 속도에 따라 관련 기술과 서비스도 빠르게 진화해서, 이전에는 유행이었던 것들이 지금은 사라지기도 합니다.\u003cbr\u003e하지만 한편으로는 변하지 않고 전해져 내려오는 것도 있죠.\u003cbr\u003e이 책에서는 배우는 지식이 바로 그 변하지 않는 것입니다.\u003cbr\u003e강화 학습의 기초를 이루는 아이디어와 기술은 예나 지금이나 변함이 없습니다.\u003cbr\u003e최신 알고리즘도 오래전부터 존재해온 아이디어를 토대로 합니다.\u003cbr\u003e강화 학습의 기본 원리, 마르코프 결정 과정, 벨만 방정식, Q 러닝, 신경망 등과 같은 주제는 앞으로도 변함없이 중요하게 여겨질 것입니다.\u003cbr\u003e따라서 현재의 강화 학습, 나아가 심층 강화 학습까지 이해하려면 강화 학습의 기초부터 차근차근 학습하는 것이 오히려 지름길입니다.\u003cbr\u003e파이썬과 수학에 대한 기초만 있다면 읽을 수 있도록 수식 기호 하나하나, 코드 한 줄 한 줄 친절히 설명합니다.\u003cbr\u003e이 책으로 강화 학습의 기초를 제대로 배우고 ‘변하지 않는 것’의 아름다움을 맛보기 바랍니다.\u003cbr\u003e여러분 곁에 포스가 함께 하기를…\u003cbr\u003e\u003cbr\u003e\u003cb\u003e대상 독자\u003c\/b\u003e\u003cbr\u003e\u003cbr\u003e- 강화 학습의 원리를 제대로 배우고자 하는 독자\u003cbr\u003e- 딥러닝을 더 깊게 이해하고 싶은 개발자 \u003cbr\u003e- 파이썬 지식이 있으며 딥러닝과 강화 학습에 흥미가 있는 데이터 과학 입문자 \u003cbr\u003e\u003cbr\u003e\u003cb\u003e주요 내용 \u003c\/b\u003e\u003cbr\u003e\u003cbr\u003e- 여러 후보 가운데 가장 좋은 것을 순차적으로 찾는 '밴디트 문제' 풀어보기(1장)\u003cbr\u003e- 일반적인 강화 학습 문제를 ‘마르코프 결정 과정’으로 정의하기(2장)\u003cbr\u003e- 마르코프 결정 과정에서 최적의 답을 찾는 데 핵심이 되는 ‘벨만 방정식’ 도출하기(3장)\u003cbr\u003e- 벨만 방정식을 풀기 위한 방법: 동적 프로그래밍(4장), 몬테카를로법(5장), TD법(6장)\u003cbr\u003e- 딥러닝에 대해 알아보고 딥러닝을 강화 학습 알고리즘에 적용하기(7장)\u003cbr\u003e- DQN을 구현하고 DQN을 확장한 방법 알아보기(8장)\u003cbr\u003e- DQN과는 다른 접근법: ‘정책 경사법’ 알고리즘(9장)\u003cbr\u003e- A3C\/DDPG\/TRPO\/레인보우 알고리즘과 심층 강화 학습(10장) \u003c\/div\u003e \u003cdiv\u003e\u003c\/div\u003e \u003c\/div\u003e \u003c\/div\u003e\n\u003c\/div\u003e\n\u003ccenter\u003e\u003ctable\u003e\u003ctr\u003e\u003ctd style=\"height:10px\"\u003e\u003c\/td\u003e\u003c\/tr\u003e\u003c\/table\u003e\u003c\/center\u003e\n\u003ccenter\u003e\u003ctable\u003e\u003ctr\u003e\u003ctd style=\"height:10px\"\u003e\u003c\/td\u003e\u003c\/tr\u003e\u003c\/table\u003e\u003c\/center\u003e\n\u003cdiv style=\"width:95%;padding-top:20px;padding-bottom:20px\"\u003e\n\u003cdiv style=\"text-align:left;font-size:16px;font-weight:bold;padding-bottom:20px\"\u003eGOODS SPECIFICS\u003c\/div\u003e\n\u003cdiv style=\"text-align:left;font-size:14px;line-height:1.6em;\"\u003e\n\u003cdiv style=\"width:100%;margin-bottom:5px;line-height:1.6em;font-size:14px\"\u003e- \u003cstrong\u003e발행일 : \u003c\/strong\u003e2024년 01월 26일\u003c\/div\u003e\n\u003cdiv style=\"width:100%;margin-bottom:5px;line-height:1.6em;font-size:14px\"\u003e- \u003cstrong\u003e쪽수, 무게, 크기 : \u003c\/strong\u003e372쪽 | 684g | 183*235*15mm\u003c\/div\u003e\n\u003cdiv style=\"width:100%;margin-bottom:5px;line-height:1.6em;font-size:14px\"\u003e- \u003cstrong\u003eISBN13 : \u003c\/strong\u003e9791169211956\u003c\/div\u003e\n\u003cdiv style=\"width:100%;margin-bottom:5px;line-height:1.6em;font-size:14px\"\u003e- \u003cstrong\u003eISBN10 : \u003c\/strong\u003e116921195X\u003c\/div\u003e\n\u003c\/div\u003e\n\u003c\/div\u003e\n\u003c\/div\u003e\n\u003ccenter\u003e\n\u003ccenter\u003e\u003ctable\u003e\u003ctr\u003e\u003ctd style=\"height:10px\"\u003e\u003c\/td\u003e\u003c\/tr\u003e\u003c\/table\u003e\u003c\/center\u003e\n\u003ccenter\u003e\u003ctable\u003e\u003ctr\u003e\u003ctd style=\"height:10px\"\u003e\u003c\/td\u003e\u003c\/tr\u003e\u003c\/table\u003e\u003c\/center\u003e\n\u003cspan\u003e\u003c\/span\u003e\n\u003c\/center\u003e\n\u003c\/center\u003e","brand":"LIBRAIRIE COREENNE","offers":[{"title":"Default Title","offer_id":43893204549674,"sku":"138151","price":38.0,"currency_code":"EUR","in_stock":true}],"thumbnail_url":"\/\/cdn.shopify.com\/s\/files\/1\/0683\/2750\/5962\/files\/08bb159a68bb5e7e849f2bfc9379b189.jpg?v=1765391885","url":"https:\/\/librairie.coreenne.fr\/ko\/products\/138151","provider":"LIBRAIRIE COREENNE","version":"1.0","type":"link"}