Forum FFL-ASL
ASL pour les nuls … et les autres !

Jouer en solo avec IA comme adversaire

Hors ligne Tobruk

  • 6+1
  • *
    • Messages: 2
    • +0/-0
Bonjour,
J’ai téléchargé les règles du starter kit, la carte 1 , la fiche scénario, le tout en PDF sur « claude AI », (Version payante pour ma part). J’ai installé le matériel physique sur la table. Mon IA a joué russes avec beaucoup de conviction. J’ai perdu


Hors ligne PierreProust

  • 9-1
  • *
    • Messages: 179
    • +3/-0
Bonjour,

C'est intéressant, peux tu partager les prompts que tu as utilisés pour initialiser la partie ? 


Hors ligne Tobruk

  • 6+1
  • *
    • Messages: 2
    • +0/-0
Rien de très original. Nous avons joué « la Garde contre attaque » , scénario d’initiation avec les règles du starter kit. Le problème, c’est la durée de la partie… Claude version payante.

Voici par exemple ce que me dit mon IA :

 je tire depuis J2 sur K5 :
3× escouades 4-4-7 = 12 FP
MMG = 4 FP
Total : 16 FP
Leader 9-1 dirige le tir → DRM -1
Cible en bâtiment pierre → DRM +3
DRM total : +2
Donc il comprend bien les règles. Peu ou quasiment pas d’erreur d’interprétation.

J’utilise un outil de jet de dés aléatoires. Ensuite il faut lui expliquer ce qui se passe de mon côté…
Puis, lors de mon tour, je lui demande à chaque hexagone si il réagit….
Bref, tout cela est long, très long.
C’était intéressant mais je ne pense pas renouveler l’expérience. C’est chronophage (temps au moins * 4 par rapport à une partie solo classique).
L’IA était très agressive et j’étais un peu surpris.




Hors ligne X

  • Rédac Chef du LFT
  • Franc-Tireur Staff
  • 1-4-9
  • *
    • Messages: 3 587
    • +70/-1
  • Noli facere nautam cacare
    • Le Franc Tireur, le magazine des fanatiques d'ASL
L’IA était très agressive et j’étais un peu surpris.

Le concept du "zéro mort" pourrit tout...

De l'audace, toujours de l'audace!

X
Le Franc-Tireur:  http://www.lefranctireur.org


Hors ligne ThidalASLSK

  • 8-1
  • *
    • Messages: 129
    • +3/-0
    • Thidal ad bellum (YouTube)
C’était intéressant mais je ne pense pas renouveler l’expérience. C’est chronophage (temps au moins * 4 par rapport à une partie solo classique).

On peut estimer que ce défaut sera vite réglé, à la vitesse où les IA évoluent !


Hors ligne mont santo

  • 10-3
  • *
    • Messages: 896
    • +6/-0
Rien de très original. Nous avons joué « la Garde contre attaque » , scénario d’initiation avec les règles du starter kit. Le problème, c’est la durée de la partie… Claude version payante.

Voici par exemple ce que me dit mon IA :

 je tire depuis J2 sur K5 :
3× escouades 4-4-7 = 12 FP
MMG = 4 FP
Total : 16 FP
Leader 9-1 dirige le tir → DRM -1
Cible en bâtiment pierre → DRM +3
DRM total : +2
Donc il comprend bien les règles. Peu ou quasiment pas d’erreur d’interprétation.

J’utilise un outil de jet de dés aléatoires. Ensuite il faut lui expliquer ce qui se passe de mon côté…
Puis, lors de mon tour, je lui demande à chaque hexagone si il réagit….
Bref, tout cela est long, très long.
C’était intéressant mais je ne pense pas renouveler l’expérience. C’est chronophage (temps au moins * 4 par rapport à une partie solo classique).
L’IA était très agressive et j’étais un peu surpris.
Est ce cela que l'on appelle la partie "apprentissage"? Peut-être qu'à partir d'un certain seuil de parties jouées, il ne faudra plus lui expliquer quoi que ce soit?
As-tu pensé à le faire jouer contre lui même, c'est ce que font les informaticiens qu'en ils veulent que leurs ia apprennent, c'est ce que l'on appelle le "Deep learning".
Sinon comment penses-tu lui faire intégrer les notions de victoire, point de victoire, de cartes, de gains territoriaux, d'élévation...?


Hors ligne Phil D

  • De moins en moins bleu, de moins en moins en reprise
  • 1-4-9
  • *
    • Messages: 2 982
    • +12/-0
As-tu pensé à le faire jouer contre lui même, c'est ce que font les informaticiens qu'en ils veulent que leurs ia apprennent, c'est ce que l'on appelle le "Deep learning".

Sans vouloir être trop pointilliste, ce n'est pas ce qu'on appelle "deep learning" (apprentissage profond), plutôt "reinforcement learning" (apprentissage par renforcement) - en l'occurrence, c'est le principe utilisé d'abord pour Alpha Go Zero (qui a effectivement été entraîné en jouant contre lui-même sans "voir" de parties humaines, avec un algorithme qui encourage les coups qui réussissent et pénalise ceux qui échouent).

L'apprentissage profond, c'est le fait d'utiliser des réseaux de neurones "profonds" (avec de nombreuses couches), c'est assez indépendant de la méthode utilisée pour entraîner (le "learning") le réseau.