BEGIN:VCALENDAR
VERSION:2.0
PRODID:-//UNIFR/WEBMASTER//NONSGML v1.0//EN
CALSCALE:GREGORIAN
BEGIN:VEVENT
DTSTART;VALUE=DATE:20241211T170000
DTEND;VALUE=DATE:20241211T170000
UID:17030@agenda.unifr.ch
DESCRIPTION:Leçon d'essai dans le cadre d'une procédure d'habilitation en Machine Learning\n\nRésumé: Les bandits manchots (Multi-Armed Bandits, MABs) constituent un modèle mathématiques fondamental pour la prise de décision en situation d’incertitude, combinant exploration et exploitation afin de maximiser les récompenses au fil du temps. Cette présentation introduira les concepts de base des MABs stochastiques et montrera qu’ils apparaissent naturellement dans de nombreuses situations réelles, comme la publicité en ligne, les essais cliniques et les systèmes de recommandation. Nous explorerons ensuite les principaux algorithmes, tels que epsilon-greedy, UCB (Upper Confidence Bound) et Thompson Sampling, en mettant en évidence leurs forces respectives. Enfin, la présentation abordera la richesse du cadre des MABs en mettant en lumière plusieurs extensions du problème original, notamment les Restless bandits, les bandits contextuels et les Dueling bandits. L’objectif de cette leçon est de fournir aux participants une compréhension intuitive des problèmes de MAB, ainsi qu’une analyse théorique et des pistes pratiques pour concevoir des solutions efficaces.
SUMMARY:An introduction to Multi-armed Bandits - Leçon d'essai du Dr Julien Audiffren
CATEGORIES:Conférence
LOCATION:PER 10\, 0.014\, Chemin du Musée 9\, 1700 Fribourg
URL;VALUE=URI:https://agenda.unifr.ch/e/fr/17030
END:VEVENT
END:VCALENDAR