Fundamentos de Aprendizagem por Reforço-Reference-Cited by-同舟云学术

Fundamentos de Aprendizagem por Reforço

Published:2023-01-09 Issue: Volume: Page:
ISSN:
Container-title:
language:
Short-container-title:

Author:

Ris-Ala Rafael

Abstract

Descubra como projetar sistemas inteligentes. Os aplicativos de Inteligência Artificial (IA) trazem agilidade e modernidade para nossas vidas e a técnica de Aprendizagem por Reforço está no ápice dessa tecnologia. Ela é capaz de superar competidores humanos em jogos de estratégia, composições criativas e movimentação autônoma. E só começou a transformar nossa civilização. Esta obra apresenta uma introdução à IA, especifica as técnicas de Aprendizagem de Máquina e explora diversos aspectos da Aprendizagem por Reforço, abordando os conceitos mais recentes de forma didática e ilustrada. É destinado a estudantes que querem fazer parte dos avanços tecnológicos e a professores engajados com o desenvolvimento de aplicações inovadoras, auxiliando em desafios acadêmicos e industriais. Entender os “Fundamentos de Aprendizagem por Reforço” permite a você: - compreender os conceitos essenciais de IA; - tornar-se um profissional experimente; - interpretar problemas de decisão sequencial e resolvê-los com Aprendizagem por Reforço; - aprender como funciona o algoritmo Q-Learning; - praticar com o código comentado em Python; e - encontrar orientações vantajosas.

Publisher

Edição independente

Reference82 articles.

1. Alibay, F., Koch, J., Verma, V., Bean, K., Toupet, O., Petrizzo, D., Chamberlain-Simon, B., Lange, R., & Hogg, R. (2022). On the Operational Challenges of Coordinating a Helicopter and Rover Mission on Mars. 2022 IEEE Aerospace Conference (AERO), 1-17. https://doi.org/10.1109/AERO53065.2022.9843670

2. Badia, A. P., Piot, B., Kapturowski, S., Sprechmann, P., Vitvitskyi, A., Guo, D., & Blundell, C. (2020). Agent57: Outperforming the Atari Human Benchmark. 37th International Conference on Machine Learning, ICML 2020, PartF168147-1, 484-494.

3. Balaji, Y., Nah, S., Huang, X., Vahdat, A., Song, J., Kreis, K., Aittala, M., Aila, T., Laine, S., Catanzaro, B., Karras, T., & Liu, M.-Y. (2022). eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers. https://doi.org/https://doi.org/10.48550/arXiv.2211.01324

4. Barto, A. G., Bradtke, S. J., & Singh, S. P. (1995). Learning to act using real-time dynamic programming. Artificial Intelligence, 72(1-2), 81-138. https://doi.org/10.1016/0004-3702(94)00011-O

5. Beattie, C., Leibo, J. Z., Teplyashin, D., Ward, T., Wainwright, M., Küttler, H., Lefrancq, A., Green, S., Valdés, V., Sadik, A., Schrittwieser, J., Anderson, K., York, S., Cant, M., Cain, A., Bolton, A., Gaffney, S., King, H., Hassabis, D., … Petersen, S. (2016). DeepMind Lab.

Cited by 1 articles. 订阅此论文施引文献订阅此论文施引文献，注册后可以免费订阅5篇论文的施引文献，订阅后可以查看论文全部施引文献

1. CuraZone: The tool to care for populated areas;Software Impacts;2023-11