Chaque entrée indique la décision de conception, les travaux qui l’ont guidée, et ce que ces travaux ne permettent pas d’affirmer. La dernière ligne compte autant que les deux premières.
Un score global accompagné de sous-scores, plutôt qu’un chiffre unique
Selon la théorie du chevauchement des processus, un facteur général peut émerger de plusieurs processus partiellement communs. Le M.I. combine donc cinq dimensions au lieu de prétendre mesurer une capacité mentale unique.
- Kovács, K., & Conway, A. R. A. (2016). Process Overlap Theory: A Unified Account of the General Factor of Intelligence. Psychological Inquiry, 27(3), 151–177.DOI 10.1080/1047840X.2016.1153946
- Hao, H., Conway, A. R. A., Kovács, K., & Snijder, J.-P. (2025). Simulating the process overlap theory of intelligence. Personality and Individual Differences, 233, 112865.DOI 10.1016/j.paid.2024.112865
- WAIS-5, Pearson (2024) — documentation officielle, non universitaire.
Ce que cela ne permet pas d’affirmerLa séparation des domaines s’inspire du WAIS-5 mais le M.I. n’en reprend ni les questions, ni les normes, et ne prétend à aucune équivalence avec lui.
Des questions qui demandent de retenir, manipuler, inhiber et changer de règle
Les modèles de la mémoire de travail distinguent le stockage, l’attention exécutive et l’actualisation. Les deux dernières sont les plus liées aux mesures d’intelligence. Les questions d’intelligence de travail s’appuient sur ces trois opérations plutôt que sur le seul empan.
- Hao, H. et al. (2025). The latent structure of working memory: A large sample factor model of working memory capacity. Cognitive, Affective, & Behavioral Neuroscience, 25, 1378–1399.DOI 10.3758/s13415-025-01310-3
- Past reflections, present insights: A systematic review and new empirical research into the working memory capacity–fluid intelligence relationship (2025). Intelligence, 108, 101874.DOI 10.1016/j.intell.2024.101874
Ce que cela ne permet pas d’affirmerMémoire de travail et intelligence fluide sont fortement liées sans être réductibles l’une à l’autre : les tâches de manipulation immédiate restent séparées des tâches de raisonnement.
Séparer la mémorisation du rappel par des questions intermédiaires
La séquence — exposition, tâche intermédiaire, rappel libre, puis reconnaissance — vient des méthodes classiques de neuropsychologie cognitive. Elle distingue l’encodage, la conservation et la récupération de l’information au lieu de réduire la mémoire à un seul score.
- Méthodes classiques d’évaluation de la mémoire épisodique (encodage, interférence, rappel, reconnaissance).
- Documentation WAIS-5 / WMS-5 (Pearson, 2024) pour la séparation intelligence / mémoire.
Ce que cela ne permet pas d’affirmerReprendre une structure de tâche ne transfère aucune norme clinique : le M.I. ne produit pas d’indice de mémoire interprétable au sens neuropsychologique.
Des séquences où l’on apprend d’un retour, pas seulement où l’on réussit
Les tests dynamiques mesurent la performance initiale, l’effet d’une aide ou d’un retour, puis la progression. C’est la logique des séquences d’adaptation : découverte d’une règle, retour après erreur, nouvelle tentative, transfert vers une variante, changement imprévu.
- Boosman, H. et al. (2016). Dynamic testing of learning potential in adults with cognitive impairments. Journal of Neuropsychology, 10(2), 186–210.DOI 10.1111/jnp.12063
- Dixon, C., Oxley, E., Gellert, A. S., & Nash, H. (2023). Dynamic assessment as a predictor of reading development. Reading and Writing, 36, 673–698.DOI 10.1007/s11145-022-10312-3
Ce que cela ne permet pas d’affirmerLes méthodes d’évaluation dynamique restent très hétérogènes, et l’étude de Dixon porte sur la lecture chez l’enfant : son application ici est conceptuelle, pas une validation.
Un rythme comparé au temps de référence de chaque question
Le temps de réponse dépend à la fois de la capacité, de la prudence, de la perception et de la vitesse d’exécution. Lorsque le temps est pertinent, la valeur de la réponse est multipliée par un coefficient compris entre 0,75 et 1,25, centré sur le temps de référence de la question. Aucun ajustement n’est appliqué lorsque l’interface impose déjà le rythme.
- Kyllonen, P. C., & Zu, J. (2016). Use of Response Time for Measuring Cognitive Ability. Journal of Intelligence, 4(4), 14.DOI 10.3390/jintelligence4040014
- Theisen, M. et al. (2021). Age differences in diffusion model parameters: A meta-analysis. Psychological Research, 85, 2012–2021.
Ce que cela ne permet pas d’affirmerSans modèle de diffusion ajusté sur les données, le test ne sait pas encore distinguer lenteur, prudence et difficulté réelle. Le facteur ±25 % est un choix expérimental à valider, pas une propriété psychométrique établie.
Enregistrer la correction d’une réponse, pas seulement le premier clic
Ne regarder que le premier choix fait perdre l’information contenue dans les corrections. Le test enregistre la première sélection, les changements d’avis, le délai de correction et la confiance déclarée. La confiance modifie le score selon une règle quadratique conçue pour rendre l’estimation honnête optimale.
- Markovitch, B., Evans, N. J., & Birk, M. V. (2024). The value of error-correcting responses for cognitive assessment in games. Scientific Reports, 14, 20657.DOI 10.1038/s41598-024-71762-z
Ce que cela ne permet pas d’affirmerLe poids de la confiance et l’interprétation des changements d’avis n’ont pas encore été étalonnés sur des données humaines. Le fait que la règle soit mathématiquement cohérente ne valide ni son poids dans le score ni la capacité qu’elle est censée mesurer.
Un contrôle « aucune réponse correcte n’est proposée »
Des modèles de langage reconnaissent moins bien qu’une bonne réponse manque qu’ils ne sélectionnent une réponse ordinaire. Ce constat a motivé le contrôle permettant de signaler qu’une question est mal posée plutôt que d’y répondre quand même.
- Groot & Colombo (2024). Large Language Models lack essential metacognition for reliable medical reasoning.
Ce que cela ne permet pas d’affirmerL’étude porte sur le raisonnement médical de modèles de langage, pas sur l’intelligence humaine. Le mécanisme reste expérimental dans ce test.
Un format bref, visuel et interactif
L’évaluation gamifiée peut produire des données cognitives utiles à grande échelle, avec une validité convergente et une fidélité test-retest mesurables.
- Leutner, F., Codreanu, S.-C., Brink, S., & Bitsakis, T. (2023). Game based assessments of cognitive ability in recruitment. Frontiers in Psychology, 13, 942662.DOI 10.3389/fpsyg.2022.942662
- Bhargava, Y., Kottapalli, A., & Baths, V. (2024). Validation and comparison of virtual reality and 3D mobile games for cognitive assessment against ACE-III. Scientific Reports, 14, 23918.DOI 10.1038/s41598-024-75065-1
Ce que cela ne permet pas d’affirmerLa gamification ne transforme pas un test en instrument valide. Ces travaux rappellent au contraire que des normes par âge et une validation restent indispensables.
Un score affiché en 100 ± 15, calculé sur des scores standardisés
On ne peut pas moyenner directement un temps de réponse, un nombre de bonnes réponses et un score de mémoire. Chaque mesure est d’abord ramenée en score z, puis combinée. L’affichage suit la convention M.I. = 100 + 15z.
- Andrade, C. (2021). Z Scores, Standard Scores, and Composite Test Scores Explained. Indian Journal of Psychological Medicine, 43(6), 555–557.DOI 10.1177/02537176211046525
Ce que cela ne permet pas d’affirmerCette méthode justifie la mise à l’échelle, pas la pondération des domaines. Les poids sont aujourd’hui égaux par défaut et devront être estimés sur les données du test.