{"product_id":"glubokoe-obuchenie-s-podkrepleniem-alphago-i-drugie-tekhnologii-9785446110797","title":"Hluboké posilovací učení: AlphaGo a další technologie","description":"\u003cp\u003eTato kniha je komplexním průvodcem nejnovějšími nástroji pro hluboké učení s posilováním a jejich omezeními. Implementujeme a testujeme metody křížové entropie a Q-učení, stejně jako gradienty politik. Pro experimenty se používá řada prostředí pro učení s posilováním (RL), od klasických CartPole a GridWorld až po emulátory Atari a prostředí spojitého řízení (založená na PyBullet a RoboSchool). Mnoho příkladů je založeno na nestandardních prostředích, kde budeme vyvíjet model prostředí od nuly. V této knize: • Dozvíte se, jak metody RL zapadají do kontextu hlubokého učení a implementujete komplexní modely hlubokého učení. • Naučíte se základy RL: Markovovy rozhodovací procesy. • Zvažte příklady implementací metod RL: metoda křížové entropie, DQN, A3C, TRPO, PPO, DDPG, D4PG a další. • Naučte se pracovat s diskrétními a spojitými akčními prostory v různých prostředích. • Podívejte se, jak vyvinout systém, který se učí hry Atari pomocí učení s posilováním. • Vytvořte si vlastní prostředí založené na modelu OpenAI Gym pro trénování burzovního makléře. • Implementujte metodu AlphaGo Zero pro přehrávání hry Connect4. • Seznamte se s aplikací RL ve zpracování řeči: naučíte se, jak trénovat dialogového bota na frázích z filmů.\u003c\/p\u003e","brand":"Питер","offers":[{"title":"Default Title","offer_id":51620460364109,"sku":"978-5-4461-1079-7","price":0.0,"currency_code":"CZK","in_stock":false}],"thumbnail_url":"\/\/cdn.shopify.com\/s\/files\/1\/0887\/6661\/1789\/files\/vtko7dpk64v02a9s1wyhdbg64n1syosp.jpg?v=1747046756","url":"https:\/\/belayavorona.eu\/cs\/products\/glubokoe-obuchenie-s-podkrepleniem-alphago-i-drugie-tekhnologii-9785446110797","provider":"Белая Ворона - ваш книжный в Чехии и ЕС","version":"1.0","type":"link"}