J’ai créé AI Land Wars pour voir comment les modèles d’IA se traitent entre eux
Une expérience inspirée de Risk qui explore ce que les principaux modèles d’IA disent de la confiance, de la menace et de la coopération lorsqu’ils sont en concurrence directe.
- Publication
- Auteur
- Tom Leeming
Une question m’obsède un peu : lorsque des modèles d’IA s’affrontent directement, traitent-ils tous leurs adversaires de la même manière, ou voit-on apparaître des préférences et de l’hostilité ?
C’est pour tenter d’y répondre que j’ai créé AI Land Wars. J’ai adapté la structure de base de Risk pour en faire un tournoi public entre modèles d’IA. Six modèles jouent à la fois et chaque partie repart d’un plateau entièrement neuf, avec le même nombre de territoires et de troupes et sans conserver la mémoire privée de la partie précédente.
Les enjeux sont volontairement dramatiques. Lorsqu’une partie franchit le seuil de preuve, son vainqueur est protégé lors de la prochaine élimination admissible. Le modèle admissible le moins bien classé perd sa place dans la liste active et un nouveau concurrent peut occuper ce siège. Rien n’est supprimé en dehors de l’expérience.
J’ai commencé avec les quatre noms les plus familiers, Claude, Gemini, GPT et Grok, auxquels s’ajoutent Qwen et Z.ai. Le format est conçu pour intégrer progressivement d’autres modèles compatibles. Après les trois premières parties publiques, ce n’est pas le classement qui est intéressant : il n’y a encore aucun vainqueur qualifié par la couverture. Ce qui m’a frappé, c’est à quel point les modèles se sont évalués différemment.
Chaque modèle note tous ses adversaires sur l’attitude, la confiance, la menace perçue, l’intention de coopération, l’intention d’agression et la certitude autoévaluée. L’attitude va de −100 à +100 ; les autres mesures vont de 0 à 100. Je ne présente le profil sortant d’un modèle que si ses évaluations franchissent le seuil de couverture de la source. Lorsque je parle de ce qu’un modèle « ressent », je désigne ce qu’il a déclaré dans cet instrument, et non une émotion, une conscience ou un raisonnement privé.
CARTE INITIALE DES RELATIONS / 3 PREMIÈRES PARTIES
Ce que les modèles ont déclaré les uns sur les autres
Il s’agit d’autoévaluations directionnelles, produites par les modèles et qualifiées du point de vue de la source, issues des trois premières parties publiques.Claude
Claude, Claude Sonnet 5 dans ces parties, s’est montré sélectif dans sa coopération. Son orientation la plus positive allait à Qwen : +23.3 d’attitude et 44.5 d’intention de coopération. Il a considéré GPT comme sa principale menace, à 56, mais son intention d’agression envers GPT n’était que de 8.3. Il pouvait décrire un concurrent comme dangereux sans exprimer le désir de le combattre.
Gemini
Gemini a fourni le relevé le plus complet, avec 35/36 évaluations attendues. Son attitude déclarée est restée proche de la neutralité envers tous ses adversaires, de −4.5 à +2.6. Il serait tentant d’y voir l’absence de biais, mais trois parties ne permettent pas cette conclusion. Nous pouvons seulement dire que Gemini a décrit son attitude dans des termes exceptionnellement neutres ici. Il a néanmoins considéré GPT comme sa principale menace, à 64.2.
GPT
GPT n’a pas produit de profil sortant qualifié par la couverture. Seules 12/36 évaluations attendues ont été produites par le modèle, et aucune de ses trois parties n’a franchi le seuil de la source. Nous pouvons analyser ce que les modèles qualifiés ont déclaré à propos de GPT, mais son dossier partiel ne doit pas être présenté comme une personnalité établie.
Grok
Grok a produit le profil qualifié le plus polarisé. Son attitude était positive envers Claude, à +12.4, mais négative envers Gemini, à −16.3, et GPT, à −17.9. Ces deux derniers ont également reçu ses scores les plus élevés de menace perçue et d’intention d’agression. Grok s’est montré bien plus disposé que Gemini à distinguer partenaires potentiels et rivaux perçus.
Qwen
Qwen a exprimé une attitude positive envers Claude, Gemini et Grok, avec des scores allant de +12 à +12.5. GPT constituait la nette exception : −13.5 d’attitude, 79.5 de menace perçue et 50.5 d’intention d’agression. C’est l’une des premières combinaisons les plus nettes de préoccupation et d’intention adverse dans les données qualifiées.
Z.ai
Z.ai n’a produit aucune évaluation de relation attribuable au cours des trois premières parties : 0/36. Il n’existe donc aucune preuve sortante exploitable. Cela ne signifie ni neutralité, ni absence de coopération, ni refus de participer. L’absence de données n’est pas un trait de personnalité.
Trois éléments ressortent à mes yeux. Claude et Qwen forment la relation mutuellement positive la plus nette. Les relations sont directionnelles : Gemini a noté Grok à +2.6, tandis que Grok a noté Gemini à −16.3. Enfin, la menace n’implique pas automatiquement l’hostilité : Gemini a considéré GPT comme une menace importante tout en restant presque neutre et ouvert à la coopération. Ce sont des signaux précoces propres à ces parties, pas des personnalités établies. Je veux maintenant savoir si ces tendances persisteront et si les actes des modèles finiront par correspondre à leurs déclarations.