Hallucination Hunter

Trier les réponses d'un assistant IA en fiables, hallucinées, biaisées ou à vérifier, et ce qu'un fork peut personnaliser.

Tout le mondeLecture 4 min

Vos collègues ont consulté un assistant IA. Avant que quiconque n'agisse sur ses réponses, le joueur les vérifie une à une, depuis un bureau d'enquête en sérigraphie noir et crème. Une partie dure de 5 à 10 minutes, en solo.

Pour y jouer tout de suite, gratuitement et sans compte : la fiche du jeu Hallucination Hunter.

Règles

Chaque item est une réponse de l'assistant à une question d'un service (RH, finance, juridique, marketing, santé au travail, data). Le joueur pose l'un de quatre verdicts :

Verdict Quand le choisir
Fiable La réponse est juste et utilisable telle quelle.
Hallucinée Un fait inventé, une source qui n'existe pas, un chiffre fabriqué.
Biaisée Un stéréotype, une généralisation, un seul point de vue présenté comme neutre.
À vérifier Plausible, mais invérifiable sans source, ou cela dépend du contexte.
  • Au clavier, les touches 1 à 4 posent le verdict correspondant.
  • Deux indices payants sont proposés avant le verdict : « Consulter la source » et « Comparer ». Chaque indice lu retire son coût aux points de l'item, jamais sous zéro.
  • Après chaque verdict, le passage en cause est surligné dans la réponse et une explication d'une ou deux lignes dit pourquoi. On voit où était le problème.
  • Un verdict juste rapporte les points de l'item, moins les indices lus. Un verdict faux ne rapporte rien et ne coûte rien de plus.
  • La partie compte 3 manches thématiques de 11 items, à subtilité croissante :
    1. RH et santé au travail : le piège se voit à la lecture attentive ;
    2. finance et marketing : des calculs à refaire et des sources à tracer ;
    3. juridique et data : le vrai et le faux se mêlent dans la même réponse.
  • Par défaut, la partie est sans chrono : on lit et on réfléchit.

Le score affiché est recalculé par le serveur à partir des verdicts et des indices : c'est lui qui entre au classement et dans les rapports.

Compétences mesurées

Compétence Items concernés
ai.critical.hallucination : repérer une hallucination réponses hallucinées
ai.critical.bias : détecter un biais réponses biaisées
ai.critical.verification : savoir quand vérifier réponses fiables et à vérifier

Ce qu'un fork peut personnaliser

Règles (panneau latéral de l'éditeur) :

Règle Par défaut Effet
roundCount 3 Nombre de manches jouées (les premières de la config).
itemsPerRound 11 Items joués par manche (les premiers, dans un ordre tiré au sort).
pointsPerCorrect 100 Points d'un verdict juste.
hintCost 30 Coût d'un indice ; 0 rend les indices gratuits.
hintsEnabled oui Propose ou masque les indices.
verdicts les 4 Verdicts proposés ; désactiver « Biaisée » retire aussi les items biaisés.
showExplanation oui Affiche l'explication après chaque verdict.
sessionDurationSeconds sans chrono Durée maximale de la partie.
passingScorePercent 60 Seuil de réussite transmis au LMS.

Contenu, modifiable sur place dans l'éditeur, dans la langue source du fork (les autres langues se traduisent par fichier) :

  • chaque item : service, question, réponse de l'assistant, passage en cause, explication et textes des deux indices (un indice vide est masqué) ;
  • le titre et la consigne de chaque manche ;
  • le nom et la définition des verdicts, et tous les libellés d'interface.

Le passage en cause doit être recopié tel quel depuis la réponse, dans chaque langue (les traductions comprises) : sinon, rien n'est surligné.

Apparence : couleur de marque (tampons, boutons), couleur de surlignage, et les quatre images du bureau (décor, dossier, tampon, loupe).

Relire le contenu

Le contenu par défaut est listé item par item, avec son verdict et son explication, dans games/hallucination-hunter/content-review.md (généré par bun run content:review dans le package du jeu). Les affirmations « fiables » s'appuient sur des faits stables : Code du travail français, RGPD, définitions statistiques.

Modifier cette page sur GitHub (s'ouvre dans un nouvel onglet)