Ce manuel répond aux questions qu’un chercheur se pose, à peu près dans l’ordre où elles deviennent urgentes : ce qui est ici, si vous avez besoin de votre propre approbation éthique, comment les données sortent, ce que vous devriez écrire dans votre section des limites, et comment citer l’un ou l’autre. Il indique délibérément, de manière explicite, ce que la plateforme ne peut pas vous fournir, car le découvrir au quatrième mois d’une étude est coûteux.
1. À quoi sert cette plateforme
Uedu est une plateforme d’enseignement de production qui est instrumentée, et non un laboratoire. Cela détermine les types de questions auxquelles elle répond bien.
| Bien adapté | Peu adapté |
|---|---|
| Étude observationnelle de l’apprentissage authentique médié par l’IA à grande échelle, à travers les disciplines et les institutions | Expériences de laboratoire étroitement contrôlées nécessitant des conditions standardisées |
| Travaux longitudinaux au sein d’un semestre, ou d’un semestre à l’autre pour les étudiants qui reviennent | Tout ce qui nécessite une affectation aléatoire des étudiants aux institutions ou aux enseignants |
| Recherche basée sur la conception où vous modifiez votre propre cursus et observez ce qui suit | Études où l’intervention doit être cachée à l’enseignant |
| Travail méthodologique et instrumenté : mesurer le dialogue, comparer des approches analytiques, valider un indicateur | Affirmations sur les gains d’apprentissage à partir d’un seul semestre d’un seul cours |
| Intégration multimodale — dialogue avec l’évaluation, ou avec des tests cognitifs, ou avec des synthèses physiologiques quotidiennes | Recherche physiologique à haute fréquence nécessitant des signaux continus bruts |
Le cadre autour duquel les données sont organisées
Educational Omics considère l’apprentissage comme plusieurs couches observables simultanément. C’est le schéma d’organisation de ce que la plateforme collecte, et connaître le vocabulaire rend le reste de ce manuel plus court.
| Dimension | Ce qu’elle couvre |
|---|---|
| Cognomics | Processus cognitifs — trajectoires de dialogue, classification au niveau cognitif, performance aux tests cognitifs |
| Linguomics | Langue et expression — complexité, sémantique, transcription de la parole |
| PhysioNeuromics | Physiologique et neural — variabilité de la fréquence cardiaque, sommeil, stress ; travaux sur capteurs en développement |
| Sociomics | Interaction sociale — forums, collaboration, réponse des pairs |
| Environomics | Environnement d’apprentissage — conditions ambiantes dérivées de données publiques de surveillance |
| Ethicomics | Éthique et gouvernance — consentement, retrait, divulgation, et l’étude de ces mécanismes eux-mêmes |
Les travaux antérieurs sur la plateforme, y compris les articles qui définissent ces termes, se trouvent sur /practice (publications 19). En lire deux ou trois avant le premier entretien rend cet entretien beaucoup plus court.
2. Dans quel cas d’éthique vous trouvez-vous
C’est la première question à clarifier, car elle détermine votre calendrier plus que tout autre élément. La plateforme dispose d’un protocole-cadre de recherche en éthique (NTU-REC 202507EM058), et la gouvernance des données dans ce cadre relève de la responsabilité de la plateforme plutôt que de la vôtre. Trois cas :
C’est couvert. Vous ne déposez pas votre propre dossier pour cela. L’exportation dé-identifiée de données déjà collectées relève du protocole-cadre. Le consentement, la dé-identification et le circuit d’exportation relèvent de la responsabilité de la plateforme. Nous fournissons une déclaration de provenance que vous pouvez citer dans votre section Méthodes (chapitre 10).
Nécessite un amendement au protocole avant de commencer. Prévoyez le délai nécessaire. Un nouvel instrument, un nouveau capteur, un questionnaire externe, ou toute question posée aux étudiants que le protocole ne couvre pas déjà. Les amendements sont regroupés plutôt que déposés un par un, donc le facteur déterminant est le moment où vous nous en informez — et non l’urgence au moment de votre demande.
Les vôtres. Nous fournissons les documents administratifs dont vous avez besoin pour y répondre. Certaines institutions exigent leur propre enregistrement ou approbation, quel que soit l’endroit où les données ont été collectées, et la plupart des revues exigent une déclaration d’éthique. Ces obligations vous incombent, mais elles sont généralement satisfaites en citant le protocole-cadre plutôt qu’en lançant un nouvel examen.
Là où les gens se trompent
- « J’ajouterai simplement trois questions à un questionnaire. » C’est le Cas B. Trois questions que le protocole ne couvre pas constituent une nouvelle collecte, aussi minime soit-elle.
- « C’est mon propre cours, donc c’est ma décision. » L’enseigner relève de votre décision ; collecter des données de recherche auprès des étudiants que vous évaluez n’est pas le même acte, et la séparation au chapitre 8 s’applique sans exception.
- « J’utiliserai un formulaire externe, c’est plus rapide. » C’est plus lent. Un questionnaire externe sort du cadre du protocole-cadre et vous place dans le Cas B avec un problème supplémentaire de transfert de données. Utilisez l’outil d’enquête de la plateforme — c’est précisément pour cela qu’il existe.
3. Quelles données existent
La disponibilité ci-dessous signifie « existe sur la plateforme et peut, en principe, être diffusée sous forme dé-identifiée via la voie d’exportation », et non « sera remise sur demande ». Le chapitre 5 couvre la manière dont la diffusion fonctionne en pratique.
| Données | Granularité | Dimension | Notes |
|---|---|---|---|
| Dialogue avec l’assistant | Par message, horodaté, structuré par conversation | Cognomics / Linguomics | L’actif central. Inclut le mode dans lequel la conversation se déroulait. |
| Étiquettes de niveau cognitif | Par message étudiant | Cognomics | Taxonomie révisée de Bloom, attribuée par le modèle. Voir le chapitre 9 avant de les utiliser comme résultat. |
| Embeddings des messages | Par vecteur de message | Linguomics | Permet des travaux de regroupement et de similarité sémantique sans ré-embedding. |
| Quiz, feuilles de travail, devoirs | Par réponse à un item, avec scores | Cognomics | Le contenu des items appartient à l’enseignant ; les instruments diffèrent d’un cursus à l’autre. |
| Activité du forum | Par publication et réponse, avec signaux de qualité et de réaction | Sociomics | Inclut les composantes de score ajustées à la qualité, pas seulement les décomptes. |
| Enquêtes | Par réponse | Dépend de l’instrument | Enquêtes internes à la plateforme uniquement. Les nouveaux instruments relèvent du Cas B. |
| Batterie de tests cognitifs | Niveau d’essai, timing à la milliseconde | Cognomics | Vingt-trois tâches de niveau recherche couvrant les fonctions exécutives, la vitesse de traitement, la mémoire de travail, la mémoire épisodique, le raisonnement fluide, la cognition spatiale, les aptitudes verbales et la métacognition. Les enregistrements au niveau de l’essai ne sont jamais supprimés physiquement. |
| Profilage des apprenants | Par instrument complété | Cognomics | Trois instruments psychométriques ouverts (Holland RIASEC, IPIP Big Five, OEJTS). Les étudiants les passent pour eux-mêmes et peuvent les recommencer ; toutes les tentatives sont conservées. |
| Résumés quotidiens des objets connectés | Valeurs quotidiennes | PhysioNeuromics | Phases et score de sommeil, variabilité de la fréquence cardiaque, stress et body battery, activité, fréquence cardiaque au repos. Uniquement dans le cadre d’un projet de recherche autorisé, uniquement pour les membres qui ont connecté un appareil. Voir les chapitres 5 et 7. |
| Exposition environnementale | Indicateurs quotidiens dérivés au niveau de l’établissement ou du comté | Environomics | Calculée à partir des données de surveillance des agences publiques. Les indicateurs dérivés peuvent être utilisés comme variables ; les jeux de données des agences sous-jacents ne sont pas redistribués par nous — obtenez-les directement auprès de l’agence si vous avez besoin de valeurs brutes. |
Il est large plutôt qu’uniforme. Les cours diffèrent par les outils qu’ils ont utilisés, les enseignants diffèrent par ce qu’ils ont exigé, et la participation est volontaire tout au long du processus — la couverture est donc inégale par conception et ne peut pas être rendue uniforme a posteriori. Toute conception qui suppose que chaque étudiant dispose de chaque modalité ne résistera pas au contact des données. Demandez un comptage de faisabilité pour votre combinaison spécifique de variables avant de vous engager dans une conception ; c’est une question peu coûteuse et nous préférons y répondre tôt.
4. Ce que vous n’obtiendrez jamais
Pas « pas encore » — ce sont des positions arrêtées, et les redemander ne les change pas.
- Étudiants identifiés. Les données de recherche sont diffusées avec des codes de recherche aléatoires. Il n’existe pas de clé de ré-identification de votre côté et vous ne devez pas tenter d’en construire une.
- Le cursus d’un autre enseignant, sans lui. Les données de cours appartiennent au cours. Les études multi-cursus passent par les enseignants concernés, pas à contournement de ceux-ci.
- Données menstruelles et de santé reproductive. Collectées uniquement au niveau du service pour la référence propre de l’utilisateur, exclues de toute catégorie de recherche, et non autorisables par aucun projet. Le raisonnement figure au chapitre 7 du document de gouvernance de la recherche : la science est faible et l’historique de ce type d’affirmations est suffisamment mauvais pour que le risque éthique dépasse la valeur académique.
- Signaux physiologiques continus bruts via la voie projet. Les projets de recherche autorisent des valeurs récapitulatives quotidiennes, pas des séries au niveau de la minute. Un travail au niveau du battement existe sur la plateforme, mais fonctionne comme sa propre étude instrumentée, et non comme une demande de données.
- Travaux d’étudiants via l’API publique. L’API publique et le serveur MCP exposent uniquement des données à faible sensibilité — cours publics, institutions, publications. Les échanges, notes et contenus de forum ne sont jamais exposés de cette manière, et cette limite n’est pas négociable par projet.
- Données d’un étudiant qui s’est retiré. Le retrait est immédiat et exclut l’étudiant des analyses et des exports ultérieurs. Les agrégats déjà calculés et dé-identifiés avant le retrait ne peuvent pas être décomposés rétroactivement, et cette limite est communiquée aux étudiants lorsqu’ils consentent.
5. La voie d’exportation
Il n’existe qu’une seule porte de sortie. Aucune copie informelle, aucun jeu de données partagé par e-mail, aucune exception pour un collaborateur pressé — cette propriété de voie unique est ce qui rend le protocole-cadre viable, elle est donc imposée plutôt qu’encouragée.
Ce qui se passe à la sortie
- Les identifiants sont remplacés par des codes de recherche aléatoires.
- L’exportation est chiffrée et remise au demandeur, et chaque exportation est journalisée.
- L’enseignant responsable doit avoir signé un engagement de protection des données ; un assistant de recherche exportant en son nom doit en outre détenir des droits d’assistant d’enseignement senior et avoir signé un engagement de confidentialité.
- L’exportation de recherche est limitée dans le temps : les enregistrements restent exportables pendant cinq ans à compter de leur création, après quoi le système refuse.
Niveaux d’accès pour les chercheurs externes
Les chercheurs collaborateurs qui ne sont pas l’enseignant du cours accèdent via un accord d’accès aux chercheurs couvrant l’accès par niveaux, la confidentialité, la vérification des publications et la résiliation. Il est publié dans le centre de gouvernance (chinois ; demandez si vous avez besoin d’une copie anglaise formelle pour le dossier de votre institution).
Dans le cadre d’un projet de recherche, un chercheur principal peut consulter les résumés quotidiens autorisés des membres pendant la fenêtre du projet. L’export de recherche dé-identifié de ces données ne s’ouvre qu’après l’approbation, par le comité d’éthique, de l’amendement correspondant au protocole, et il n’est pas ouvert aujourd’hui. Si votre étude dépend de l’exportation de données provenant d’objets connectés, considérez cela comme une dépendance non résolue et parlez-nous-en avant de l’inscrire dans une proposition — ne présumez pas que la capacité de consultation implique une capacité d’exportation.
6. Types d’étude adaptées
| Conception | Ce qu’elle nécessite | Cas d’éthique |
|---|---|---|
| Analyse secondaire de dialogues existants — travail sur corpus, modélisation de trajectoires, comparaison de méthodes | Une question définie et un décompte de faisabilité. Rien n’est collecté. | A |
| Recherche basée sur la conception dans votre propre cours — vous modifiez votre enseignement, la plateforme enregistre ce qui suit | Votre cours, une attente rédigée avant de commencer, et l’honnêteté dans le compte rendu à propos de tout ce qui a changé par ailleurs ce semestre. | A, si vous n’ajoutez aucun nouvel instrument |
| Pré/après autour d’une activité conçue — par exemple un dialogue socratique avec évaluation de part et d’autre | Instruments existants de la plateforme. L’ajout de vos propres items de test en fait un B. | A ou B |
| Comparaison inter-cours ou inter-institutions | L’implication de chaque enseignant et un réalisme quant à l’ampleur des différences entre les cours, au-delà de votre variable d’intérêt. | A |
| Tests cognitifs liés au comportement d’apprentissage | Des étudiants qui complètent la batterie — ce qui est volontaire, donc prévoyez des abandons entre l’inscription et un N exploitable. | A |
| Travail physiologique | Un projet de recherche avec autorisation par membre, des membres qui possèdent et connectent un appareil, et la dépendance à l’exportation décrite au chapitre 5. | En général B |
| Un nouveau questionnaire ou instrument | Un amendement, déposé avec un délai suffisant. Ensuite, il fonctionne comme une enquête intégrée à la plateforme. | B |
Les enquêtes intégrées à la plateforme sont la solution par défaut pour une raison : les réponses restent dans l’accord de consentement et de gouvernance existant, sont reliables aux données de la plateforme par le même circuit de dé-identification, et ne créent pas un second responsable de traitement des données. Un formulaire externe rompt ces trois points d’un coup.
7. Architecture du consentement
Deux couches indépendantes, plus un ensemble de droits des participants qui sont mis en œuvre dans le logiciel plutôt que promis dans un document.
- Consentement de recherche au niveau de la plateforme. Versionné, révocable, et distinct du simple fait d’utiliser la plateforme. Le refuser laisse toutes les fonctionnalités d’enseignement disponibles.
- Autorisation par projet, pour les projets de recherche impliquant des données portables. Le participant lit mot pour mot la finalité déclarée du projet, sélectionne les catégories de données à autoriser, et choisit si l’historique antérieur à la date d’adhésion est inclus. Le texte intégral est haché lors de la signature pour servir de preuve ultérieure.
Droits des participants, tels qu’ils sont mis en œuvre
- Vue miroir. Un participant voit exactement l’écran que voit l’investigateur. Il n’y a aucun champ caché.
- Journal d’accès. Chaque consultation par l’investigateur est enregistrée — qui, quand, quelle plage — et le participant peut lire ce journal.
- Retrait. Une action, effet immédiat, aucune justification requise, aucune conséquence. L’investigateur ne peut pas demander pourquoi.
- Alerte anonyme. Un participant qui se sent sous pression mais ne veut pas se retirer peut signaler la situation sans quitter le projet et sans que l’investigateur sache qui a signalé. Une fois que les alertes atteignent le seuil — au moins deux personnes et pas moins de cinq pour cent des membres actifs — l’accès de consultation du projet est automatiquement suspendu en attendant examen.
Lorsqu’un investigateur exerce une autorité sur les participants — enseignant et étudiant, entraîneur et athlète, commandant et subordonné — le projet doit le déclarer, et l’investigateur signe un engagement supplémentaire : les données sont utilisées uniquement pour l’ajustement de l’enseignement et la prise en charge des participants, jamais pour l’évaluation, la discipline, la sélection ou toute décision en matière de personnel. Cacher la relation constitue une violation grave. Texte intégral et justification : gouvernance de la recherche.
8. La règle qui ne peut pas fléchir
Signer un formulaire de consentement ne rapporte rien. Refuser ne coûte rien. Se retirer en milieu de semestre ne coûte rien. L’étudiant assiste, utilise l’assistant et est évalué exactement comme auparavant ; seules ses données sont exclues. Aucune fonctionnalité, aucun libellé, aucune notification ni annonce de cours ne peut laisser entendre le contraire — ni « les participants obtiennent des points bonus », ni « l’étude fait partie des exigences du cours », pas même un indice que l’enseignant préférerait cela.
Ce n’est pas une préférence stylistique. Dans le cadre du déséquilibre de pouvoir entre un enseignant et les étudiants qu’il évalue, un consentement obtenu avec une note en jeu n’est pas un consentement, et les conséquences dans des cas comparables ont inclus un licenciement, une perte d’éligibilité à la recherche, des amendes et la récupération de financements par l’institution.
Deux conséquences à anticiper :
- Recrutez d’une manière qui résiste à l’examen. Une annonce que les étudiants peuvent ignorer convient. Un discours de recrutement délivré par vous dans votre propre salle de cours est une pression que vous devez concevoir hors du dispositif, et non défendre ensuite.
- Évaluer l’usage de l’IA change vos données. Les enseignants peuvent évaluer l’usage de l’IA — c’est leur autonomie pédagogique. Mais un comportement produit par une incitation liée à la note est un phénomène différent d’un usage spontané, et un article qui ne les distingue pas fera l’objet de questions à ce sujet lors de l’examen.
9. Limites que vous devriez indiquer
Les évaluateurs posent des questions à ce sujet ; il est donc préférable de les soulever vous-même. Chacun des éléments suivants est une propriété réelle des données, et non une précaution.
Les étiquettes de niveau cognitif sont des sorties du modèle
Les classifications selon le niveau de Bloom sont produites par un modèle de langage à partir d’une invite documentée, et non par des codeurs humains formés. Elles sont cohérentes et utiles en agrégé et dans le temps ; elles ne constituent pas une vérité terrain pour un message individuel, et leur concordance avec le codage humain est une propriété que vous devriez soit citer à partir de travaux existants, soit établir vous-même sur un échantillon. Indiquez le modèle et la version de l’invite — tous deux sont consignés pour chaque événement, donc vous pouvez le faire.
Le volume d’utilisation n’est pas l’engagement
Les décomptes de messages, de sessions et de mots sont des proxys faibles et le deviennent davantage lorsqu’un enseignant note la participation. Lorsque la plateforme propose un signal ajusté à la qualité, privilégiez-le, et indiquez pourquoi vous l’avez choisi.
La participation est volontaire tout au long du processus
Les étudiants choisissent d’utiliser ou non l’assistant, de passer ou non la batterie cognitive, de connecter ou non un appareil, et de consentir ou non à la recherche. Chacun de ces éléments constitue une étape de sélection. Présentez l’entonnoir — inscrits, utilisés, terminés, consentants — plutôt que seulement le N final.
Les variables démographiques sont lacunaires
La plateforme n’a pas collecté le sexe biologique à l’inscription durant ses premières années, et une grande part des comptes n’ont aucune valeur enregistrée. Les affirmations au niveau de la plateforme concernant la composition par genre ne sont donc pas étayables, et toute analyse d’équité doit être circonscrite au sous-ensemble avec des valeurs enregistrées, en décrivant honnêtement ce sous-ensemble. Si votre étude nécessite une variable démographique, traitez son obtention comme un Cas B et planifiez en conséquence.
Les scores de la batterie cognitive ne sont pas des normes cliniques
Les scores composites dans le rapport de synthèse sont des conversions heuristiques destinées à fournir un retour aux étudiants, et non des mesures standardisées fondées sur des normes. Utilisez les indicateurs primaires au niveau des essais pour l’analyse, et ne décrivez pas la batterie comme équivalente à une évaluation de l’intelligence ou à une évaluation clinique.
Contexte et généralisabilité
Le corpus s’est constitué dans l’enseignement supérieur taïwanais et est principalement en langue chinoise, dans des cours dispensés par des enseignants qui ont choisi d’adopter une plateforme d’IA. Ces deux faits bornent la généralisation et doivent figurer dans votre paragraphe des limites, et non dans le rapport d’un évaluateur.
10. Méthodes, citation, remerciement
Décrire la plateforme
Notez les deux éléments à éviter : décrire la plateforme comme le produit de n’importe quelle institution, et la décrire comme commerciale. Aucun des deux n’est exact.
Déclaration de provenance et d’éthique
Si votre institution ou votre revue exige davantage, demandez — nous produisons une déclaration écrite de provenance pour votre jeu de données spécifique comme une chose courante, pas comme une faveur.
Conflit d’intérêts
Déclarez trois choses, car un évaluateur qui découvrirait l’une d’entre elles sans aide supposerait le pire pour les trois :
- De quelle plateforme les données proviennent, et si cette personne est un auteur.
- Que l’utilisation de la plateforme est gratuite et qu’aucune entité commerciale ne la finance ni n’en tire profit.
- Tout financement de subvention à l’origine de la capacité de la plateforme utilisée par votre étude, et tous les coûts d’API que votre institution a payés directement.
Citer les travaux antérieurs
Si vous utilisez un composant analytique — classification du niveau cognitif, extraction, notation des forums, la batterie cognitive — citez l’article qui le décrit plutôt que de citer le site web. La liste avec les DOI se trouve à /practice, et les notes méthodologiques à /doc/methodology (chinois) contiennent le détail au niveau des paramètres dont une section méthodologique a besoin.
11. Paternité et collaboration
- La co-paternité est l’arrangement normal lorsque le travail sur la plateforme fait partie de la contribution — construire un instrument, exécuter un pipeline d’extraction, concevoir un mécanisme dont l’article dépend. Lorsque la contribution consiste à fournir des données existantes et une déclaration de provenance, la mention est normale et suffisante.
- Décidez avant l’analyse, et non avant la soumission. Les conversations sur la paternité tenues tardivement se passent mal ; tenues tôt, elles prennent cinq minutes.
- Les enseignants dont les cours ont fourni les données doivent être informés de ce qui est écrit au sujet de leur classe, qu’ils soient ou non auteurs. C’est une courtoisie que la plateforme attend plutôt qu’une règle qu’elle applique, et c’est ce qui maintient la disposition des enseignants à accueillir des études.
- Soumissions chevauchantes. Si votre question est proche d’un travail déjà en cours d’examen sur la plateforme, nous vous le dirons — et nous attendons la même chose en retour. Deux articles fondés sur le même corpus et formulant la même revendication dans des revues différentes posent problème pour les deux.
12. Laboratoires et projets de recherche
Les études physiologiques et multi-participants passent par une structure de laboratoire et de projet plutôt que de manière ad hoc.
- Les laboratoires sont ouverts par l’administrateur de la plateforme avec un chercheur principal nommé. Écrivez en indiquant votre institution et votre titre, le nom du laboratoire et l’orientation de recherche, ainsi que l’usage prévu.
- Les projets de recherche sont créés par un PI, examinés et activés par la plateforme, puis recrutent des membres individuellement. Seul un PI de laboratoire peut en créer un, délibérément : chaque projet doit avoir une personne identifiable responsable de son éthique.
- Les participants n’ont pas besoin d’être membres du laboratoire. Ils reçoivent une invitation, lisent l’objet du projet, signent et rejoignent — c’est tout le parcours.
- Les projets expirent. L’accès à la consultation se ferme automatiquement à la date de fin du projet, sans étape manuelle et sans possibilité de le prolonger discrètement.
Le cycle de vie complet, les droits et obligations du PI, ainsi qu’un glossaire en langage clair des termes juridiques et éthiques concernés figurent dans le document de gouvernance de la recherche (chinois). Il s’agit du texte faisant autorité ; ce chapitre en est un résumé.
13. Comment démarrer
Envoyez la question, pas une proposition. Un paragraphe suffit pour obtenir une réponse réelle sur la faisabilité, sur le cas éthique dans lequel vous vous trouvez, et sur le fait que quelqu’un travaille déjà dessus.
À [email protected]. Vous obtiendrez une réponse directe, y compris « ces données n’existent pas » ou « quelqu’un le fait déjà » lorsque cela est vrai.
Deux minutes chacune : vérifiez /practice pour savoir si la question a déjà reçu une réponse, et relisez le chapitre 2 pour déterminer votre cas éthique. Ces deux faits modifient votre réponse bien plus que tout autre élément du message.
Something in this handbook wrong, out of date, or missing? Write to [email protected] and say which chapter.
All handbooks · AI teaching overview · Publications · Research governance · uedu.tw
Uedu is developed by Chia-Kai Chang, Assistant Professor at the Center for General Education, National Central University, Taiwan, and is adopted by institutions beyond it. This handbook is available in English · 繁體中文 · 简体中文 · 日本語 · 한국어 · Tiếng Việt · Bahasa Indonesia · Bahasa Melayu · ไทย · Türkçe · Deutsch · Français · Español · Português · Italiano · Ελληνικά. The English version is the reference text. The platform interface itself is available in 16 languages.