Technologie cycle 4

3ème - Intelligence Artificielle - Partie 1 - 3ème : Apprentissage par renforcement d'une IA - Deap Learning

Par PASCAL CANCEILL, publié le lundi 15 septembre 2025 11:59 - Mis à jour le mardi 16 septembre 2025 22:13

Introduction :

Cette séance a pour but de rappeler ce qu'est l'Intelligence Artificielle et la technologie d'apprentissage automatique ("Machine Learning) et notamment la phase d'apprentissage profond ou par renforcement (Deep Learning)

On va travailler pour cela sur une version particulière du Jeux de NIM

1ère Partie :

1.1 - Grace à la technique de l'apprentissage par renforcement des IA, on va comprendre  comment apprend une IA.

1.2 - Ensuite on écrira la Stratégie à mettre en place pour gagner au jeu 

séquence complète de 3ième

           2ème Partie : (autre séance de TD de Ecriture de l'Algorithme et du Logigramme associé

            3ème Partie : Codage et Programmation sous Scratch du jeu suivant deux versions

________________________

1ère Partie : Déroulement

- Règle du jeu de NIM : on joue avec 9 bâtonnets, chaque joueur à son tour enlève 1, 2 ou 3 bâtonnets et le perdant est celui qui récupère la dernière allumette.

Découverte des règles du jeu de NIM version adaptée à l'apprentissage d'une IA :

- 1ère Vidéo - Cliquer sur le lien suivant pour voir la 1ère vidéo explicative de la règle du jeu de NIM ci-dessus en entière

Préparation du jeu : Variante du jeu de Nim

Placer 9 bâtonnets sur la table espacé de 2 cm, les joueurs se font face, placer devant celui qui jouera l'IA, 9 gobelets numérotés de 1 à 9, dans chaque gobelet mettre 3 jetons numérotés avec les chiffres 1, 2 et 3, c'est à dire le nombre des bâtonnets à retirer par le joueur qui prend le jeton. Le perdant est celui qui récupère la dernière allumette.

Début de la partie :

Travail à faire : Il faut jouer par groupe table et faire apprendre ainsi à l'IA en jouant plusieurs parties successives. C'est ce que l'on appelle l'apprentissage par renforcement ou Deep Learning. Et ceci jusqu'à ce que l'on trouve la stratégie pour retirer les jetons et gagner la partie.

- Le premier joueur choisit un nombre entre 1,2 et 3 de bâtonnets à retirer,

- Le deuxième joueur c'est l'IA. Dans le gobelet numéroté au nombre de bâtonnets restants, Choisir aléatoirement un jeton, au début les chiffres peuvent être : 1, 2 ou 3 qui correspondent au nombre de bâtonnets à retirer, etc...

- A la fin de la partie ATTENTION ! 

ATTENDRE AVANT DE REMETTRE LES JETONS dans les gobelets, si le joueur au gobelet à Perdu, il enlève le dernier Jeton seulement et remet des autres si il en avait.

Donc à la fin de chaque partie vous devrez analyser le jeu et en fonction du gagnant, il faudra agir sur le contenu des gobelets et ainsi de suite par essai successif ou itération jusqu'à tester toutes les combinaisons possibles ou la réalisation d'un maximum de solutions possibles qui permettra statistiquement de finir la stratégie pour gagner au jeu.

1.1 -  Comprendre le fonctionnement de l'apprentissage d'une IA par renforcement :

Travail à faire : Décrire par quelle méthode on fait apprendre l'IA en s'appuyant sur la vidéo

.........

1.2 -  Pour finir : Ecrire la Stratégie gagnante déduite par le joueur soit ici l'IA

Travail à faire :  Ecrire les modalités du jeu, l'organisation des joueurs pour faire gagner l'IA donc la Stratégie gagnante pour le premier joueur

....

Pièces jointes

À télécharger

 / 1