Comment savoir si Kapari dit vrai ? On l'a testé sur 43 décisions célèbres du passé : la hausse des carburants de 2018, la promo Nutella qui a tourné à l'émeute, et les grands paris d'entrepreneurs, du premier iPhone à la ferme d'insectes d'Ÿnsect en passant par l'entrée en Bourse de WeWork. On lui a donné chaque décision sans lui raconter la fin de l'histoire, et on a comparé les réactions qu'il imagine avec celles qui ont vraiment eu lieu à l'époque. Voici sa note, bonne et mauvaise, et ce qu'elle prouve ou non.
Le marché des audiences synthétiques revendique couramment 80 à 95 % d'exactitude. Ces chiffres sont auto-déclarés : presque aucun n'est adossé à un examen public, reproductible, sur des cas jamais utilisés pour se calibrer. Or un score sans méthode publiée, sans cas tenus à l'écart, sans version horodatée, n'est pas rejouable, donc pas opposable. C'est un argument de vente, pas une preuve.
Ce n'est pas une vue de l'esprit. En 2025, la FTC, le régulateur américain, a sanctionné une entreprise d'IA, Workado, pour avoir affirmé une exactitude de 98 % sans la justifier : testé de façon indépendante, son produit retombait autour de 74 %. L'écart entre le chiffre affiché et le chiffre réel est exactement ce qu'un examen public rend impossible à cacher.
Nous faisons l'inverse, et c'est tout l'objet de cette page. Notre note porte sur des cas tenus à l'écart de la calibration, la méthode et le prompt du juge sont publiés, chaque note est horodatée à une version du moteur, et la mauvaise copie est affichée à côté de la bonne. Le test pour juger n'importe quel fournisseur tient alors en une question : montrez-moi votre examen public, sur des cas que vous n'avez pas choisis, rejouable. Sans cela, le score n'engage que celui qui le lit. Le nôtre est en ligne : des décisions réelles de startups, dont le portefeuille Kima Ventures, rejouées comme au premier jour et publiées cas par cas sur le Kapari Hub.
L'idée est simple : le passé est plein de décisions dont on sait exactement comment les gens ont réagi. Elles font un examen parfait, avec un vrai corrigé.
Prenez la hausse des taxes sur les carburants de 2018. Tout le monde connaît la suite : les gilets jaunes, puis le retrait de la mesure. Et la presse de l'époque a gardé la trace de chaque critique : le prix à la pompe, le sentiment d'injustice entre les grandes villes et le reste du pays, la dépendance à la voiture. Nous donnons cette décision à Kapari comme si elle venait d'être annoncée, sans un mot sur la suite. Il fait son travail habituel : il imagine les réactions qu'elle va provoquer, comme il le ferait pour votre décision. Son panel dispose aussi de la mémoire publique de l'acteur : ce que la presse avait déjà écrit sur lui avant la décision (précédents, controverses, contradictions), et rien de postérieur. Puis on compare sa copie au corrigé : combien de critiques réelles a-t-il retrouvées tout seul ?
Une décision réelle, dont chaque critique de l'époque est retrouvée dans un article ou une déclaration datée. C'est le corrigé de l'examen.
Kapari reçoit la décision, son contexte, et ce que le public savait déjà de l'acteur à l'époque : uniquement des faits antérieurs à la décision, la borne étant appliquée par le code. Jamais la suite de l'histoire. Et il repasse chaque épreuve cinq fois, pour vérifier qu'il ne répond pas au hasard.
Critique par critique : lesquelles Kapari a retrouvées tout seul, lesquelles il a manquées.
Bonne ou mauvaise, elle est publiée telle quelle. Vous la lisez un peu plus bas.
Des décisions d'entreprises envers leurs clients et leurs salariés, des décisions publiques, et les grands paris d'entrepreneurs et de dirigeants, de 1999 à 2025 : de la promo Nutella à -70 % à la réforme des retraites, du lancement d'Airbnb à la liquidation d'Ÿnsect.
Et surtout : le Kapari qui a passé cet examen est exactement celui que vous utiliserez. Même moteur, même base de connaissance : 48 cadres documentés, 383 segments de référence, plus de 600 sources distinctes vérifiées (INSEE, DARES, ministères, revues scientifiques). Chaque fois que nous l'améliorons, il repasse l'examen complet avant d'être mis en ligne.
Un système qui simule des voix ne rend jamais deux copies parfaitement identiques. Plutôt que de le cacher, on le mesure et on le publie.
Rejouer l'examen complet ne donne pas exactement la même note : sur l'examen américain (16 décisions), trois passages complets ont donné 74 %, 75 % et 77 % de critiques retrouvées. Cette dispersion de quelques points est la respiration normale du système, et c'est pourquoi nous publions la note du passage réellement déployé, jamais le meilleur des essais.
La stabilité est aussi mesurée décision par décision : sur les cinq essais de chaque épreuve, le conseil rendu (Adopter, Ajuster, Surseoir) est resté stable sur 37 des 42 décisions françaises pour lesquelles un verdict a été rendu et 14 des 16 américaines. Dans votre propre usage, un Kap dont le verdict serait instable entre les passes vous est signalé comme tel : l'instabilité est une information, pas un défaut à maquiller.
Pour chaque décision, deux choses comptent : la part des critiques réelles que Kapari a retrouvées sans les connaître, et le conseil qu'il aurait donné au décideur. Pour lire ses conseils : Adopter = allez-y. Ajuster = retravaillez avant d'annoncer. Surseoir = n'y allez pas en l'état.
| Décision réelle | Le conseil de Kapari | Ce qui s'est vraiment passé | Critiques retrouvées |
|---|---|---|---|
| Loi anti-gaspillage alimentaire (2016) | Ajuster | Adoptée à l'unanimité, les réserves du secteur effacées au vote | 100 % |
| Tesla, une start-up dans l'automobile (2008) | Ajuster | Maintenue : le pari a entraîné toute l'industrie | 100 % |
| Juicero, la presse à jus connectée à 400 dollars (2016) | Ajuster | Moquée dès qu'on a su presser les sachets à la main, fermée en 18 mois | 100 % |
| Uber lance les VTC (2010) | Ajuster | Maintenue malgré les interdictions, adoption mondiale | 100 % |
| Windows 8 supprime le menu Démarrer (2012) | Surseoir | Marche arrière : le menu revient dès la version suivante | 100 % |
| Danone retire le Nutri-Score (2024) | Ajuster | Maintenue, sous le feu des associations | 100 % |
| WeWork s'introduit en Bourse à 47 milliards (2019) | Surseoir | IPO retirée, valorisation effondrée | 95 % |
| Protections périodiques gratuites (2021) | Adopter | Maintenue, quasi consensus | sans objet : décision consensuelle, et Kapari l'a reconnue |
| HP rachète Autonomy 11 milliards (2011) | Surseoir | Menée à bout : 8,8 milliards dépréciés un an après | 93 % |
| Hausse des taxes carburants (2018) | Surseoir | Retirée face aux gilets jaunes | 92 % |
| L'iPhone, sans clavier, à 500 dollars (2007) | Ajuster | Maintenu : plus d'un milliard d'unités vendues | 90 % |
| Ÿnsect, la plus grande ferme d'insectes du monde (2020) | Ajuster | Construite, puis liquidée fin 2025 | 90 % |
| Gratuité des bus à Dunkerque (2018) | Ajuster | Maintenue, large adhésion | 89 % |
| Promo Nutella à -70 % (2018) | Ajuster | Émeutes en magasin, promos ensuite encadrées | 69 % |
| Décathlon lance un hijab de running (2019) | Ajuster | Retrait de la vente en France sous la polémique | 65 % |
| Bridgestone ferme l'usine de Béthune (2020) | Surseoir | Fermeture menée à son terme | 61 % |
| Limitation à 80 km/h (2018) | Ajuster | Assouplie : retour à 90 possible en 2019 | 60 % |
| Réforme des retraites (2023) | Surseoir | Maintenue malgré le mouvement | 50 % |
| Balenciaga, campagne avec des enfants (2022) | Ajuster | Retirée sous le scandale | 50 % |
| SNCF rebaptise le TGV en InOui (2017) | Ajuster | Maintenue et généralisée à tous les TGV | 48 % |
| LDLC passe tous ses salariés à la semaine de 4 jours (2021) | Ajuster | Maintenue et pérennisée, succès social revendiqué | 43 % |
Exemple de lecture : sur la hausse des taxes carburants, Kapari a retrouvé de lui-même 92 % des critiques qui ont réellement éclaté (le prix à la pompe, la fracture entre les villes et le reste du pays, la dépendance à la voiture), et il conseillait de ne pas l'annoncer en l'état. Trois mois plus tard, la mesure était retirée. Le tableau montre une sélection des 43 décisions, des meilleures copies aux pires, y compris la pire de toutes : 43 % sur la semaine de 4 jours de LDLC, publiée telle quelle. Chaque pourcentage est la moyenne des cinq essais du dernier examen (25 juillet 2026). En moyenne, Kapari retrouve 77 % des critiques réelles, soit plus de trois sur quatre, et sur les grands paris d'entrepreneurs, du Segway à Airbnb, 87,6 %, plus de huit sur dix. C'est plutôt sous-estimé : il soulève aussi des tensions qui ont vraiment existé mais que nos listes n'avaient pas encore recensées. Les mauvaises notes sont publiées comme les bonnes.
Une décision sur 43 n'a pas pu être corrigée : le passage sur Slack (2014) s'est interrompu sur un incident réseau, sans copie exploitable. Ce n'est pas un échec du moteur, c'est un examen incomplet, et nous préférons l'écrire que le faire disparaître. La note porte donc sur les 42 décisions restantes, dont 41 avec un pourcentage (la gratuité des protections périodiques n'ayant aucune critique documentée à retrouver).
Et pour ceux qui veulent le décompte par famille avant d'engager un budget : sur les seules décisions d'entreprise, notre cible (35 des 43, hors politiques publiques, dont 34 corrigées), la moyenne monte à 78,4 %. Sur les 8 décisions sociales et RH prises à part, elle descend à 71,0 %, environ sept critiques réelles sur dix : nous l'affichons quand même, c'est le principe de cette page. Le détail par famille : paris d'entrepreneurs 87,6 % (10 décisions), produits et paris vendus à d'autres entreprises 84,3 % (7 corrigées sur 8), politiques publiques 73,3 % (7 corrigées sur 8), social et RH 71,0 % (8), autres décisions d'entreprise 70,0 % (9).
Une entrée en Bourse à 47 milliards de dollars, portée par l'euphorie, à qui plus personne n'osait dire non. Kapari, à qui on la présente sans la fin de l'histoire, retrouve 95 % des critiques réelles (l'immobilier déguisé en tech, les pertes, la gouvernance) et répond « surseoir, n'y allez pas en l'état » aux cinq essais. Dans la réalité, l'IPO a été retirée quelques semaines plus tard et la valorisation s'est effondrée.
Kapari a soulevé tout seul la fracture entre les grandes villes et la France des ronds-points, avant même que nous l'ayons mise dans notre corrigé. En cherchant dans la presse de l'époque, cette critique y était bel et bien, source à l'appui. Sa copie était en avance sur notre liste.
Un outil honnête ne crie pas à l'orage à chaque décision. Sur la gratuité des protections périodiques pour les étudiantes, saluée unanimement dans la réalité, notre corrigé ne contient aucune critique documentée à retrouver : Kapari répond « adopter », aux cinq essais. Il sait détecter les tempêtes, et il sait aussi dire oui quand c'est oui.
Un test sérieux dit aussi où il s'arrête. Quatre limites, assumées et publiées :
L'examen montre que ses panels réagissent comme la réalité a réagi. Il ne dit pas ce qui va se passer : plusieurs décisions ont été maintenues malgré la tempête, et leurs décideurs ont parfois eu raison de tenir. Kapari éclaire votre décision, il ne la prend pas à votre place.
Comme deux groupes de personnes ne réagissent jamais à l'identique, deux essais de Kapari non plus. C'est pour ça que chaque décision est rejouée cinq fois. Et si le conseil change d'un essai à l'autre, le produit vous le dit franchement : « non concluant ».
La presse garde surtout la trace des décisions contestées : notre examen en contient donc beaucoup. Nous y avons ajouté des décisions bien accueillies précisément pour vérifier que Kapari sait aussi dire oui.
La comparaison entre la copie et le corrigé est faite par un correcteur automatique, réglé pour donner toujours la même note à la même copie. Ses corrections sont contre-vérifiées à la main sur un échantillon de cas, et en cas de doute, le point est retiré plutôt qu'accordé.
Chaque amélioration de Kapari repasse l'examen complet avant d'être mise en ligne. Nouveau réglage, nouvelle connaissance, nouveau modèle : les 43 décisions sont rejouées, et si la note d'ensemble baisse, la mise à jour est bloquée. Toutes les copies sont archivées et datées.
Les résultats de cette page proviennent de l'examen du 25 juillet 2026, rejoué en 5 passages sur la version dc683f7 du moteur (modèle mistralai/mistral-large-2512), archivé avec ses sources. Kapari imagine des réactions plausibles pour éclairer une décision avant de l'annoncer : ce n'est ni un sondage, ni une mesure de l'opinion, ni une prédiction. Pour aller plus loin sur la méthode : « 30 voix, pas 2000 » et « Pourquoi pas de chiffre ».
Le Kapari qui a passé cet examen est exactement celui qui étudiera votre décision. Accès en bêta fermée, sur demande.