Renforcement de l'apprentissage
Apprendre par machine pour des décisions séquentielles dans lesquelles un agent améliore le comportement à partir de récompenses générées par l'interaction.
A living academic reference written, refined and transparently versioned by the Sciendia community.
Collaborative knowledgeRechercher
3 résultats
Wiki pages are public to read. Every signed-in member can create and improve them.
Clear searchApprendre par machine pour des décisions séquentielles dans lesquelles un agent améliore le comportement à partir de récompenses générées par l'interaction.
La résolution collective de problèmes qui se dégage des interactions locales entre de nombreux agents autonomes relativement simples.
L'apprentissage automatique distribué qui coordonne la formation des modèles entre les détenteurs de données sans centraliser leurs enregistrements bruts.