✍️ 🧑‍🦱 💚 Autor:innen verdienen bei uns doppelt. Dank euch haben sie so schon 472.549 € mehr verdient. → Mehr erfahren 💪 📚 🙏

Aprendizagem por reforço

Aprendizagem por reforço

von N V Madhu Bindu, Satyanarayana S und Thayyaba Khatoon Md
Softcover - 9786206403371
68,90 €
  • Versandkostenfrei
Auf meine Merkliste
  • Hinweis: Print on Demand. Lieferbar in 5 Tagen.
  • Lieferzeit nach Versand: ca. 1-2 Tage
  • inkl. MwSt. & Versandkosten (innerhalb Deutschlands)

Autorenfreundlich Bücher kaufen?!

Beschreibung

Este livro está estruturado em cinco unidades, oferecendo uma experiência de aprendizagem holística. A viagem começa com uma introdução aos algoritmos bandit, explorando conceitos fundamentais como os algoritmos Upper Confidence Bound (UCB) e Probably Approximately Correct (PAC). A unidade seguinte introduz a estrutura completa da Aprendizagem por Reforço (RL), indo além dos algoritmos bandit para considerar as interacções agente-ambiente ao longo de vários passos de tempo. Os processos de decisão de Markov (MDP) são introduzidos como um quadro fundamental para modelar tarefas de tomada de decisão sequenciais. A quarta unidade abrange métodos de programação dinâmica, métodos de diferença temporal (TD) e a equação de optimalidade de Bellman em RL. Estes conceitos permitem aos agentes planear, aprender e otimizar eficazmente as suas acções. A unidade final explora técnicas avançadas de RL, como traços de elegibilidade, aproximação de funções, métodos de mínimos quadrados, Q-learning ajustado, Deep Q-Network (DQN) e algoritmos de gradiente de política.

Livro da nova geração

Details

Verlag Edições Nosso Conhecimento
Ersterscheinung 29. August 2023
Maße 22 cm x 15 cm x 0.9 cm
Gewicht 227 Gramm
Format Softcover
ISBN-13 9786206403371
Seiten 140