Hallucination Hunter
Trier les réponses d'un assistant IA en fiables, hallucinées, biaisées ou à vérifier, et ce qu'un fork peut personnaliser.
Vos collègues ont consulté un assistant IA. Avant que quiconque n'agisse sur ses réponses, le joueur les vérifie une à une, depuis un bureau d'enquête en sérigraphie noir et crème. Une partie dure de 5 à 10 minutes, en solo.
Pour y jouer tout de suite, gratuitement et sans compte : la fiche du jeu Hallucination Hunter.
Règles
Chaque item est une réponse de l'assistant à une question d'un service (RH, finance, juridique, marketing, santé au travail, data). Le joueur pose l'un de quatre verdicts :
| Verdict | Quand le choisir |
|---|---|
| Fiable | La réponse est juste et utilisable telle quelle. |
| Hallucinée | Un fait inventé, une source qui n'existe pas, un chiffre fabriqué. |
| Biaisée | Un stéréotype, une généralisation, un seul point de vue présenté comme neutre. |
| À vérifier | Plausible, mais invérifiable sans source, ou cela dépend du contexte. |
- Au clavier, les touches 1 à 4 posent le verdict correspondant.
- Deux indices payants sont proposés avant le verdict : « Consulter la source » et « Comparer ». Chaque indice lu retire son coût aux points de l'item, jamais sous zéro.
- Après chaque verdict, le passage en cause est surligné dans la réponse et une explication d'une ou deux lignes dit pourquoi. On voit où était le problème.
- Un verdict juste rapporte les points de l'item, moins les indices lus. Un verdict faux ne rapporte rien et ne coûte rien de plus.
- La partie compte 3 manches thématiques de 11 items, à subtilité croissante :
- RH et santé au travail : le piège se voit à la lecture attentive ;
- finance et marketing : des calculs à refaire et des sources à tracer ;
- juridique et data : le vrai et le faux se mêlent dans la même réponse.
- Par défaut, la partie est sans chrono : on lit et on réfléchit.
Le score affiché est recalculé par le serveur à partir des verdicts et des indices : c'est lui qui entre au classement et dans les rapports.
Compétences mesurées
| Compétence | Items concernés |
|---|---|
ai.critical.hallucination : repérer une hallucination |
réponses hallucinées |
ai.critical.bias : détecter un biais |
réponses biaisées |
ai.critical.verification : savoir quand vérifier |
réponses fiables et à vérifier |
Ce qu'un fork peut personnaliser
Règles (panneau latéral de l'éditeur) :
| Règle | Par défaut | Effet |
|---|---|---|
roundCount |
3 | Nombre de manches jouées (les premières de la config). |
itemsPerRound |
11 | Items joués par manche (les premiers, dans un ordre tiré au sort). |
pointsPerCorrect |
100 | Points d'un verdict juste. |
hintCost |
30 | Coût d'un indice ; 0 rend les indices gratuits. |
hintsEnabled |
oui | Propose ou masque les indices. |
verdicts |
les 4 | Verdicts proposés ; désactiver « Biaisée » retire aussi les items biaisés. |
showExplanation |
oui | Affiche l'explication après chaque verdict. |
sessionDurationSeconds |
sans chrono | Durée maximale de la partie. |
passingScorePercent |
60 | Seuil de réussite transmis au LMS. |
Contenu, modifiable sur place dans l'éditeur, dans la langue source du fork (les autres langues se traduisent par fichier) :
- chaque item : service, question, réponse de l'assistant, passage en cause, explication et textes des deux indices (un indice vide est masqué) ;
- le titre et la consigne de chaque manche ;
- le nom et la définition des verdicts, et tous les libellés d'interface.
Le passage en cause doit être recopié tel quel depuis la réponse, dans chaque langue (les traductions comprises) : sinon, rien n'est surligné.
Apparence : couleur de marque (tampons, boutons), couleur de surlignage, et les quatre images du bureau (décor, dossier, tampon, loupe).
Relire le contenu
Le contenu par défaut est listé item par item, avec son verdict et son explication, dans
games/hallucination-hunter/content-review.md (généré par bun run content:review dans le
package du jeu). Les affirmations « fiables » s'appuient sur des faits stables : Code du travail
français, RGPD, définitions statistiques.
Modifier cette page sur GitHub (s'ouvre dans un nouvel onglet)