Discussions et questions-réponses concernant ASL > Forum général Advanced Squad Leader

Jouer en solo avec IA comme adversaire

<< < (2/2)

mont santo:

--- Citation de: Tobruk le 09 Août 2026, 23:58 ---Rien de très original. Nous avons joué « la Garde contre attaque » , scénario d’initiation avec les règles du starter kit. Le problème, c’est la durée de la partie… Claude version payante.

Voici par exemple ce que me dit mon IA :

 je tire depuis J2 sur K5 :
3× escouades 4-4-7 = 12 FP
MMG = 4 FP
Total : 16 FP
Leader 9-1 dirige le tir → DRM -1
Cible en bâtiment pierre → DRM +3
DRM total : +2
Donc il comprend bien les règles. Peu ou quasiment pas d’erreur d’interprétation.

J’utilise un outil de jet de dés aléatoires. Ensuite il faut lui expliquer ce qui se passe de mon côté…
Puis, lors de mon tour, je lui demande à chaque hexagone si il réagit….
Bref, tout cela est long, très long.
C’était intéressant mais je ne pense pas renouveler l’expérience. C’est chronophage (temps au moins * 4 par rapport à une partie solo classique).
L’IA était très agressive et j’étais un peu surpris.

--- Fin de citation ---
Est ce cela que l'on appelle la partie "apprentissage"? Peut-être qu'à partir d'un certain seuil de parties jouées, il ne faudra plus lui expliquer quoi que ce soit?
As-tu pensé à le faire jouer contre lui même, c'est ce que font les informaticiens qu'en ils veulent que leurs ia apprennent, c'est ce que l'on appelle le "Deep learning".
Sinon comment penses-tu lui faire intégrer les notions de victoire, point de victoire, de cartes, de gains territoriaux, d'élévation...?

Phil D:

--- Citation de: mont santo le 11 Août 2026, 22:46 ---As-tu pensé à le faire jouer contre lui même, c'est ce que font les informaticiens qu'en ils veulent que leurs ia apprennent, c'est ce que l'on appelle le "Deep learning".

--- Fin de citation ---

Sans vouloir être trop pointilliste, ce n'est pas ce qu'on appelle "deep learning" (apprentissage profond), plutôt "reinforcement learning" (apprentissage par renforcement) - en l'occurrence, c'est le principe utilisé d'abord pour Alpha Go Zero (qui a effectivement été entraîné en jouant contre lui-même sans "voir" de parties humaines, avec un algorithme qui encourage les coups qui réussissent et pénalise ceux qui échouent).

L'apprentissage profond, c'est le fait d'utiliser des réseaux de neurones "profonds" (avec de nombreuses couches), c'est assez indépendant de la méthode utilisée pour entraîner (le "learning") le réseau.

mont santo:
Merci Phil D, mais en au bout du bout de la question, il reste que la machine choisira ou privilégiera des séquences quasiment scénarisées, bon certains joueurs font de même  :-$.

Navigation

[0] Index des messages

[*] Page précédente

Utiliser la version classique