Technologie cycle 4

4ème - Intelligence Artificielle - Partie 1 - 4ième : Apprentissage par renforcement d'une IA - Deap Learning

Par PASCAL CANCEILL, publié le jeudi 11 septembre 2025 11:47 - Mis à jour le mardi 16 septembre 2025 22:12

Introduction :

Cette séance a pour but de rappeler ce qu'est l'Intelligence Artificielle et la technologie d'apprentissage automatique ("Machine Learning) et notamment la phase d'apprentissage profond ou par renforcement (Deep Learning)

On va travailler pour cela sur une version particulière du Jeux de NIM

1ère Partie : résumé

1.1 - Grace à la technique de l'apprentissage par renforcement des IA, on va comprendre ainsi comprend le apprend une IA.

1.2 - Ensuite on écrira la Stratégie à mettre en place pour gagner au jeu qui permettra de gagner au jeu. 

séquence complète :

           2ème Partie : (autre séance de TD de Ecriture de l'Algorithme et du Logigramme associé

            3ème Partie : Codage et Programmation sous Scratch du jeu suivant deux versions

________________________

1ère Partie : Déroulement

- Règle du jeu de NIM : on joue avec 8 bâtonnets, chaque joueur à son tour enlève 1, 2 ou 3 bâtonnets et le gagnant est celui qui récupère la dernière allumette.

Découverte des règles du jeu de NIM version adaptée à l'apprentissage d'une IA :

- 1ère Vidéo - Cliquer sur le lien suivant pour voir la 1ère vidéo explicative de la règle du jeu de NIM ci-dessus en entière

- 2ème Vidéo (début) - Regarder le début de la 2ième Vidéo jusqu'à 2 min 30 : soit la préparation du jeu et la première partie

Préparation du jeu : 

Placer 8 bâtonnets sur la table espacé de 2 cm, les joueurs se font face, placer devant celui qui jouera l'IA, 7 gobelets numérotés de 1 à 7, dans chaque gobelet mettre 3 jetons numérotés avec les chiffres 1, 2 et 3, c'est à dire le nombre des bâtonnets à retirer par le joueur qui prend le jeton.

Début de la partie :

Travail à faire : Il faut jouer par groupe table et faire apprendre ainsi à l'IA en jouant plusieurs parties successives. C'est ce que l'on appelle l'apprentissage par renforcement ou Deep Learning. Et ceci jusqu'à ce que l'on trouve la stratégie pour retirer les jetons et gagner la partie.

- Le premier joueur choisit un nombre entre 1,2 et 3 de bâtonnets à retirer,

- Le deuxième joueur c'est l'IA. Dans le gobelet numéroté au nombre de bâtonnets restants, Choisir aléatoirement un jeton, au début les chiffres peuvent être : 1, 2 ou 3 qui correspondent au nombre de bâtonnets à retirer, etc...

- A la fin de la partie ATTENTION ! 

ATTENDRE AVANT DE REMETTRE LES JETONS dans les gobelets de bien regarder la vidéo suivante pour comptabilisé l'apprentissage de l'IA

- 3 Vidéo - Regarder la suite et fin de la 2ième Vidéo de 2 min 30 jusqu'à 11 min 30, C'est à dire du début de la deuxième partie à la fin des tests

 

A la fin de chaque partie vous devrez donc :

Analyser le jeu et en fonction du gagnant, il faudra agir sur le contenu des gobelets et ainsi de suite par essai successif ou itération jusqu'à tester toutes les combinaisons possibles ou la réalisation d'un maximum de solutions possibles qui permettra statistiquement de finir la stratégie pour gagner au jeu.

1.1 -  Comprendre le fonctionnement de l'apprentissage d'une IA par renforcement :

Travail à faire : Décrire par quelle méthode on fait apprendre l'IA en s'appuyant sur les 2 vidéos

.........

1.2 -  Pour finir : Ecrire la Stratégie gagnante déduite par le deuxième joueur soit ici l'IA

Travail à faire :  Ecrire les modalités du jeu, l'organisation des joueurs pour faire gagner l'IA et la Stratégie gagnante pour le deuxième joueur

....

Pièces jointes

À télécharger

 / 1