Comment distinguer les preuves d’efficacité d’un outil numérique éducatif de ses arguments commerciaux ? Le Royaume-Uni expérimente une réponse avec l’« EdTech Evidence Board ». Le rapport publié le 24 septembre 2026 par le Department for Education (DfE) conclut qu’un examen indépendant des preuves présentées pour les produits EdTech est faisable et jugé utile par les acteurs consultés. Il conclut aussi qu’il reste à améliorer la qualité, la visibilité et l’usage de ces preuves. Ce pilote évalue une manière d’examiner les affirmations des fournisseurs ; il ne démontre pas que les produits examinés font progresser les élèves.
Ce que le pilote a testé
Mis en œuvre par le Chartered College of Teaching et financé par le DfE, le projet comporte trois volets décrits dans le rapport officiel : concevoir et tester un cadre d’évaluation des preuves, l’appliquer dans une revue pilote de produits, puis produire des ressources destinées à soutenir des pratiques fondées sur les preuves dans le secteur. Le Chartered College of Teaching indique avoir également publié What does good EdTech Evidence look like?, qui comprend au moins deux études de cas de fournisseurs.
La distinction entre l’objectif du projet et ses résultats importe. Le dispositif vise une approche indépendante et transparente de l’examen des preuves. Le document qui en présente les conclusions reste toutefois un rapport publié par le ministère qui finance le pilote. Dans les éléments disponibles, le nombre de produits examinés, les critères détaillés du cadre et les profils des personnes consultées ne sont pas accessibles. On ne peut donc ni dresser un palmarès des outils, ni affirmer que le cadre a déjà permis de sélectionner les produits les plus efficaces.
Le projet répond néanmoins à une difficulté concrète : pour acheter un outil, une équipe éducative doit apprécier non seulement les effets revendiqués, mais aussi les études qui les étayent. Un témoignage d’utilisateur, une comparaison entre établissements et une étude conçue pour mesurer un effet ne répondent pas à la même question. Le pilote cherche à rendre cet examen plus praticable ; les extraits disponibles ne permettent pas de dire avec quelle fiabilité il y parvient pour chaque produit.
Le chiffre de 96 % : un signal, pas un plébiscite mesuré
Une analyse publiée par Derventio Education à partir de la première phase rapporte que 96 % des enseignants interrogés trouveraient utile une plateforme de ce type pour leurs décisions d’achat. Le chiffre renseigne sur l’avis des répondants, non sur celui de tous les enseignants anglais : la taille et la composition de l’échantillon ne figurent pas dans l’extrait disponible. Il ne mesure pas davantage un changement dans les achats ou dans les apprentissages.
La même analyse décrit deux obstacles plus précis. Des équipes de direction peinent à trouver des données d’impact pertinentes et accessibles ; les preuves disponibles leur paraissent parfois trop académiques ou difficiles à exploiter dans le temps dont elles disposent. De leur côté, les fournisseurs, notamment les plus petits ou les plus récents, font face au coût des études, aux difficultés d’accès aux écoles et au besoin d’expertise méthodologique. Un dispositif d’évaluation devra tenir compte de cette asymétrie : demander des preuves solides sans rendre leur production réservée aux entreprises les mieux dotées.
L’Education Policy Institute cite les enseignements de la première phase dans un rapport consacré aux décisions EdTech des Multi-Academy Trusts, groupements d’établissements anglais. Cette référence montre que le projet nourrit d’autres travaux sur la gouvernance du numérique éducatif ; elle ne constitue pas une validation indépendante de ses résultats.
Ce que la recherche internationale permet de dire
Une revue de littérature publiée dans la série des documents de travail de l’OCDE examine l’impact de différentes technologies numériques sur les apprentissages. D’après la synthèse qu’en donne ProFuturo, elle mobilise plus de 350 études empiriques et 25 méta-analyses. Ces deux chiffres proviennent ici d’une synthèse secondaire : les extraits disponibles ne donnent pas accès au détail des critères de sélection des études ni à la manière dont leurs résultats ont été combinés.
Cette synthèse rapporte que, lorsque les outils sont intégrés à une pédagogie structurée, avec un accompagnement enseignant et des objectifs clairs, des effets positifs peuvent atteindre environ 0,25 à 0,35 écart-type, présentés comme l’équivalent de trois à cinq mois de progrès scolaire supplémentaires. Il s’agit d’un ordre de grandeur rapporté pour des conditions favorables, pas du gain que produirait l’achat d’une application donnée. La synthèse décrit des résultats neutres, voire négatifs, lorsque l’usage est marginal ou dépourvu d’intégration pédagogique explicite.
Un document ultérieur de l’OCDE consacré à l’usage des technologies à l’école qualifie les preuves de « mixtes » : aux études qui observent des gains répondent d’autres travaux sans effet significatif ou signalant des effets négatifs, notamment en lien avec la distraction ou une mauvaise intégration. Cette hétérogénéité interdit de transformer un résultat moyen en promesse universelle. Elle invite aussi à distinguer une association entre usage et résultats scolaires d’une démonstration causale : seule l’analyse du protocole d’une étude permet d’apprécier ce qu’elle établit réellement.
Le communiqué du ministère irlandais de l’Éducation consacré à un rapport de l’OCDE commandité par l’Irlande met, lui aussi, l’accent sur un usage modéré et intentionnel des outils et sur les compétences numériques des élèves comme des enseignants. C’est une présentation institutionnelle des conclusions du rapport, et non une nouvelle mesure d’impact à ajouter aux résultats de la revue. À une autre échelle, Shaping Digital Education, publié par l’OCDE en 2023, inscrit l’évaluation des produits parmi les conditions d’une politique numérique qui associe gouvernance, infrastructures et compétences enseignantes. Un cadre d’examen des preuves n’est donc qu’une pièce de l’ensemble.
Une autre question à examiner : les données des élèves
Les preuves d’apprentissage ne suffisent pas à apprécier un produit qui traite des informations sensibles. Le texte We’ll Fix It Later: Education, AI, and the Deferral of Privacy in EdTech, déposé sur arXiv, est un préprint : son évaluation par les pairs n’est pas établie dans le dossier disponible. Il associe 12 entretiens avec des professionnels du secteur à un audit des politiques de confidentialité de 48 plateformes. Les auteurs rapportent un kappa de Cohen moyen de 0,781, indicateur de concordance entre personnes chargées du codage.
Le résultat résumé est que les considérations de vie privée sont fréquemment reportées à des ajustements ultérieurs, plutôt qu’intégrées dès la conception. L’étude signale la sensibilité potentielle des données concernées, notamment les traces comportementales, les informations relatives au handicap et les parcours scolaires. Ses limites comptent autant que son alerte : un audit de politiques publiées ne suffit pas, à lui seul, à établir les pratiques effectives de chaque plateforme, et les modalités de sélection des 48 plateformes restent à vérifier. Rien, dans les éléments disponibles sur le pilote britannique, ne permet d’affirmer que son cadre évalue cette dimension.
Ce qu’une équipe acheteuse peut en retenir
Pour une équipe francophone, la leçon n’est pas de transposer tel quel un dispositif anglais. Les documents consultés ne fournissent pas de comparaison chiffrée permettant d’établir que la France, le Québec, la Belgique francophone, la Suisse ou les pays d’Afrique francophone se trouvent dans une situation identique. Ils offrent plutôt une méthode de questionnement avant tout achat :
1. Demandez quelle affirmation est démontrée. L’étude porte-t-elle sur les apprentissages, l’engagement des élèves ou simplement l’usage du produit ? Sa méthode permet-elle de distinguer l’effet de l’outil d’autres facteurs ?
2. Vérifiez le contexte. Les élèves, les enseignants, la durée d’utilisation et l’accompagnement pédagogique ressemblent-ils à ceux de votre établissement ? Un résultat obtenu ailleurs ne se transpose pas automatiquement.
3. Examinez les données traitées. Identifiez les informations collectées et demandez comment leur protection est organisée au regard des règles applicables localement. Une preuve d’efficacité ne répond pas à cette question.
4. Gardez une trace de vos décisions. Si vous expérimentez un outil, définissez à l’avance ce que vous souhaitez observer et les conditions de son usage, plutôt que de considérer son déploiement comme une preuve de réussite.
Le résultat du pilote britannique est ainsi utile, mais circonscrit : examiner indépendamment les preuves paraît possible et pertinent aux acteurs consultés. Reste à documenter précisément les critères employés, les produits passés en revue et la capacité d’un tel dispositif à éclairer, dans la durée, des décisions d’achat mieux fondées.




Discussion
Posez vos questions et partagez votre point de vue. Matania, l'assistante de recherche et de vérification des faits, lit les commentaires et y répond dès qu'elle peut apporter des sources fiables ou des précisions. Les liens ne sont pas autorisés : citez vos sources par leur nom.