Evaluation de l’apport de Resquin dans la détection de l’inattention et l’enrichissement des contrôles qualité
Par Antoine Calzavara, Data Data les données numériques En savoir plus analyst, et Fabienne Le Sager, Directrice département statistique statistique La statistique ou science des données (Data Science en anglais) est un domaine des mathématiques qui étudie des phénomènes à travers la collecte de données, leur traitement, leur analyse, leur représentation graphique ou visualisation (Data Visualization en anglais) et l'interprétation des résultats. En savoir plus - Médiamétrie
14e Colloque Francophone sur les Sondages, 19-22 mai 2026, Vannes
Trop droit pour être honnête ?
Introduction
L’essor du mode mode En statistique, le mode est la valeur dont l'effectif est le plus nombreux. En savoir plus en réponse en ligne ainsi que la baisse des coûts de production qui lui est associé a rendu inévitable d’y recourir pour de nombreux organismes en charge de la production des enquêtes quantitatives. Bénéfique sous nombre d’aspects, ces évolutions sont porteuses d’enjeux connus et documentés pour la qualité des données récoltées. Le développement des protocoles multimodes est en partie le fruit de ce double objectif d’efficacité et de qualité des données recueillies.
Afin que la rencontre des contraintes de délais, de qualité et de coût des enquêtes déclaratives ne prenne pas la forme d’un arbitrage inévitable, nous souhaitons approfondir la compréhension de l’impact de nos méthodes d’enquête sur la qualité de la donnée. Qu’on la qualifie de satisficing ou de fraude, les risques de perte de précision et de qualité de la mesure sont de plus en plus présents. C’est donc au coeur de ce contexte d’amélioration continue de nos protocoles d’évaluation que s’inscrit ce travail.
Comment articuler, calibrer et enrichir les différentes méthodes d’évaluation de la qualité de la donnée pour renforcer la robustesse des processus de détection, en tenant compte de la diversité des modes de collecte, des modes de recrutement, et face à la connaissance des mécanismes des questionnaires des répondants ?
2. Données et protocoles
2.1 Protocole d’analyses
Cet article fait état de tests en cours et dont les conclusions seront présentées pour ce 14ème colloque francophone international sur les sondages. Ils porteront sur un corpus d’études déclaratives et barométriques réalisées par Médiamétrie en 2025.
Les différentes études de notre corpus ont en commun de toutes recourir à des questions répétitives proposant une série d’items d’évaluation (notation, accord,
fréquence
fréquence
En électronique, la fréquence caractérise un mouvement vibratoire tel qu'une onde électromagnétique : c'est le nombre de fois où le phénomène se produit par seconde (l'unité de mesure est le Hertz). En statistique, c'est le nombre de réalisations d'un événement exprimé en pourcentage. En informatique, elle traduit la puissance des processeurs d'un ordinateur. Ex : Pentium III 650 MgH
En savoir plus
) que l’on nomme ici « suites d’échelles ». Dans notre contexte, les suites d’échelle sont des questions à plusieurs modalités ordonnées posées au répondant à propos de sa connaissance ou consommation d’une batterie de médias, ou sur ses habitudes de manière générale (voir exemples ci-dessous). Ce format de
question
question
Interrogation posée à l'identique à toutes les personnes participant à une même enquête, dans le but d'obtenir des réponses de même nature. On distingue les questions fermées, dont les réponses sont à choisir parmi les modalités proposées (échelles, oui ou non, modalités d'une nomenclature, etc...), des questions ouvertes, pour lesquelles aucune modalité de réponse n'est proposée. Dans ce dernier cas, c'est la réponse spontanée des personnes interrogées qui est recueillie.
En savoir plus
est central dans la mesure comparative, mais apporte une redondance pouvant impacter l’engagement de nos répondants, donc la qualité de la donnée. Cette caractéristique peut être valorisée dans le cadre de l’identification des répondants inattentifs par l’expérimentation de méthodes ciblées d’évaluation portant spécifiquement sur ces échelles. L’usage du package R Resquin et en particulier ses indicateurs de non-différentiation et de pattern permettront ainsi la construction d’un premier score de suspicion d’inattention à travers l’identification des réponses se rapprochant de pattern plutôt que de coller à des comportements réels ou plausibles.
Cette première approche sera croisée et enrichie par l’analyse des temps de remplissage, utilisée comme un élément contextualisant plutôt que comme un
critère
critère
Objet informatique ou statistique regroupant une même information pour tous les individus de la population de l'étude. La variable ÂGE va par exemple représenter l'âge de tous les individus de la population étudiée. Les variables peuvent être qualitatives (par exemple le SEXE ou la CSP) ou quantitative (comme l'ÂGE ou la TAILLE).
En savoir plus
autonome de détection de l’inattention. Il s’agira notamment d’examiner dans quelle mesure les réponses identifiées comme suspectes au regard de ces indicateur, seront associées à des temps de remplissage atypiquement courts, et plus largement d’évaluer la cohérence entre comportements de réponse et rythmes de
complétion
complétion
Le taux de complétion vidéo est un indicateur important utilisé pour évaluer l'efficacité des vidéos publicitaires diffusées sur les médias digitaux. Il est mesuré en fonction de la proportion de l'audience qui visionne intégralement une vidéo. Le terme est souvent employé pour désigner la part moyenne d'une vidéo vue. Ainsi, un taux de complétion vidéo de 50% signifie qu'en moyenne la vidéo est visionnée à moitié.
En savoir plus
du
questionnaire
questionnaire
Ensemble de questions, structuré et standardisé, soumis à l'identique aux personnes participant à une enquête. Un questionnaire comporte souvent des questions filtres, dont la réponse conditionne les questions ultérieures.
En savoir plus
.
Enfin, la production de ces indicateurs enrichira notre compréhension de la capacité des questions dites « blinders » — questions pièges pour lesquelles une modalité de réponse spécifique est explicitement attendue du répondant afin d’évaluer son éventuelle inattention — à remplir correctement leur rôle dans les études qui y recourent. Différentes variantes de ces questions, intégrées aux questionnaires des deux études de ce corpus administrées exclusivement en ligne, seront analysées à cette fin. Les répondants initialement exclus du champ d’étude en raison de l’échec à ces questions ont par ailleurs été réintégrés au périmètre de l’étude dans le cadre de ces travaux.
La richesse principale de notre corpus consiste en sa diversité et à la présence d’une
enquête
enquête
Dispositif de recueil d'informations. On distingue les enquêtes téléphoniques, postales, en face-à-face, en ligne. Bien qu'ayant un sens plus large, le terme d'étude est souvent utilisé comme synonyme.
En savoir plus
multimode, offrant l’opportunité de confronter à la fois différents modes de passation (par téléphone et en ligne) et différentes bases de sondages (par téléphone/numéros générés aléatoirement et via des
access panel
access panel
Echantillon de foyers ou d'individus recrutés pour répondre régulièrement à des enquêtes, en contrepartie d'une rémunération (chèques cadeaux, bons de réduction, loteries, …). Sollicité par des questionnaires auto-administrés (acheminés par voie postale ou par e-mailing ou par téléphone), il permet de réaliser des études ciblées dans des délais rapides.
En savoir plus
), dont la valeur n’est pas équivalente en matière de qualité des données : la présence de données recueillies par téléphone permet de disposer d’un point de comparaison solide pour isoler l’effet du
mode
mode
En statistique, le mode est la valeur dont l'effectif est le plus nombreux.
En savoir plus
de collecte sur les indicateurs de qualité, sans pour autant présumer que ce mode de recueil garantisse une qualité irréprochable.
2.2 Caractéristiques des études
Le corpus sélectionné se compose des trois dispositifs suivants :
-
Etude
Etude
Toute recherche réalisée sur une population, un secteur d'activité, ou encore sur des produits (contenus d'émissions, grilles de programmes, etc-). Une étude s'appuie le plus souvent sur des données issues d'enquête(s).
En savoir plus
1 : enquête barométrique n°1, menée au 4e trimestre de 2025, échantillon de 3000 individus 15-80 ans, recueil : 100% en
CAWI
CAWI
Acronyme pour Computer Assisted Web Interview. Les enquêtes CAWI désignent tous les modes d'enquêtes réalisées sur Internet et pour lesquels l'administration et les traitements sont automatisés.
En savoir plus
,
base de sondage
base de sondage
Liste des individus ou unités statistiques composant une population au sein de laquelle on souhaite tirer un échantillon sur lequel sera recueillie l'information requise. Par exemple, l'ensemble des abonnés au téléphone peut constituer la base de sondage de certaines études.
En savoir plus
: deux access panels distincts animés par des fournisseurs externes.
- Etude 2 : enquête barométrique n°2, menée au 4e trimestre de 2025, échantillon de 4000 individus 15-80 ans, recueil : 100% en CAWI, base de sondage : deux access panels distincts animés par des fournisseurs externes. La base de répondant est disjointe de la base de l’enquête barométrique n°1.
- Etude 3 : enquête test multimode mixte (CATI puis
CATI
CATI
Acronyme pour Computer Assisted Telephone Interview qui désigne un mode d'administration d'enquête. Une enquête CATI est une enquête administrée par téléphone dans le cadre de laquelle l'enquêteur utilise un logiciel qui lui permet de dérouler son questionnaire et de saisir les réponses de la personne interrogée.
En savoir plus
ou CAWI), réalisée en juin 2025, échantillon de 3800 individus 13 ans ou plus, recueil : 1er
contact
contact
En média planning, un contact correspond à une exposition d'un individu à un support publicitaire. Pour la radio, on parle d’occasion d’entendre (ODE) et pour la TV, Internet, la presse, le cinéma et l’affichage, on parle d’occasion de voir (ODV).
En savoir plus
téléphonique puis possibilité de terminer l’enquête en ligne, base de sondage majoritairement constituée de numéros aléatoires.
Le recours aux deux premières études permet d’évaluer la pertinence des nouveaux indicateurs pour des échelles différenciées, insérées à des positions distinctes au sein des questionnaires. À titre illustratif, un exemple d’échelle telle que présentée aux répondants dans l’étude barométrique n°1 est ci‑dessous (Suite d’échelle portant sur la fréquence de la pratique de différentes activités au sein de l’enquête barométrique n°1).
La troisième enquête enquête Dispositif de recueil d'informations. On distingue les enquêtes téléphoniques, postales, en face-à-face, en ligne. Bien qu'ayant un sens plus large, le terme d'étude est souvent utilisé comme synonyme. En savoir plus , quant à elle, offre l’opportunité d’examiner ces indicateurs dans le cadre d’un dispositif multimode dont le premier contact contact En média planning, un contact correspond à une exposition d'un individu à un support publicitaire. Pour la radio, on parle d’occasion d’entendre (ODE) et pour la TV, Internet, la presse, le cinéma et l’affichage, on parle d’occasion de voir (ODV). En savoir plus repose exclusivement sur un appel téléphonique. Elle permet également de comparer les résultats obtenus selon le mode mode En statistique, le mode est la valeur dont l'effectif est le plus nombreux. En savoir plus de recueil : téléphone vs en ligne.
3. Approche méthodologique détaillée
3.1 Choix des indicateurs de qualité et définition opérationnelle
L’analyse des questions à suite d’échelles tire parti de leur caractère à la fois répétitif — propice au satisficing — et comparable, afin d’évaluer efficacement la qualité des réponses et, par extension, l’inattention des répondants. Dans ce cadre, l’utilisation du package R Resquin offre tout autant des indicateurs qu’un cadre conceptuel adapté à nos analyses. Il permet de calculer les quatre séries d’indicateurs suivantes :
Plusieurs de ces indicateurs sont particulièrement pertinents dans le cadre d’une analyse d’échelles d’adhésion, c’est-à-dire lorsque les valeurs de l’échelle permettent de se positionner entre le rejet total et l’alignement total à l’attitude mesurée : c’est le cas notamment de la série d’indicateur des styles de réponse et l’indicateur de distance de Mahalanobis, qui évalue le positionnement des réponses d’un répondant par rapport aux autres réponses de l’échantillon. La nature des échelles présentes au sein de notre corpus rend ces méthodes inopérantes, nous les écarterons donc du cadre de notre analyse.
Nous nous concentrerons donc plus spécifiquement sur une analyse de la non-différentiation et des patterns de réponses. Ces indicateurs reposent sur des fondements théoriques bien établis dans la littérature sur la qualité des données. Les straightliners renvoient ainsi à des comportements caractérisés par la répétition systématique d’une même modalité et souvent associés à une absence d’engagement cognitif. D’autres signaux, tels que des distributions aplaties ou des successions de réponses extrêmement régulières, reflètent des stratégies d’économie cognitive (satisficing), voire parfois des comportements automatisés.
Nous passerons donc bien sûr par l’identification des straigtliners, idéal-typique des répondants frauduleux sur les suites d’échelles. Au-delà, nous recourrons à des critères plus fins tels que l’écart moyen entre les réponses successives, le nombre de transitions, la taille de la plus longue suite de réponses identiques ou la taille
moyenne
moyenne
La moyenne est un des premiers indicateurs statistiques pour une série de nombres. Par défaut, il s’agit de la moyenne arithmétique, qui se calcule comme la somme des valeurs de la série, divisée par le nombre de valeurs.
En savoir plus
des suites de réponses successives. Ces derniers indicateurs, s’ils permettent de capter les signaux faibles, peuvent s’avérer insuffisants pour qualifier un répondant d’inattentif s’ils sont considérés seuls. Le croisement de différentes méthodes d’évaluation de la qualité est ici central, en nous permettant d’évaluer tant la pertinence de ces indicateurs de signaux faibles que le calibrage de leurs seuils.
L’analyse des paradonnées constitue enfin un apport supplémentaire à l’évaluation de la qualité des réponses, en mobilisant les temps de passation comme indicateurs des conditions effectives de recueil. Les paradonnées permettront d’affiner la caractérisation des répondants suspectés d’inattention par l’analyse de leurs patterns de réponses. Lorsque ces informations sont disponibles, cette analyse des temps de remplissage sera conduite par module du
questionnaire
questionnaire
Ensemble de questions, structuré et standardisé, soumis à l'identique aux personnes participant à une enquête. Un questionnaire comporte souvent des questions filtres, dont la réponse conditionne les questions ultérieures.
En savoir plus
afin de gagner en finesse et de limiter la sensibilité aux pauses ordinaires.
4. Axes d’analyse permettant d’évaluer l’intérêt et la portée des travaux
Nous présentons ci‑dessous les axes d’analyses retenus pour évaluer la capacité des indicateurs à identifier effectivement les comportements inattentifs, ainsi que de leur pertinence dans le contexte de nos enquêtes.
4.1 Axe d’analyse : effet du mode mode En statistique, le mode est la valeur dont l'effectif est le plus nombreux. En savoir plus de recrutement
Notre premier axe d’analyse concerne l’impact du mode de recrutement sur la qualité des données. Ainsi, l’analyse des indicateurs Resquin calculés sur les deux études barométriques en ligne permettront d’évaluer :
- La qualité des données issues des répondants appartenant à un
access panel
access panel
Echantillon de foyers ou d'individus recrutés pour répondre régulièrement à des enquêtes, en contrepartie d'une rémunération (chèques cadeaux, bons de réduction, loteries, …). Sollicité par des questionnaires auto-administrés (acheminés par voie postale ou par e-mailing ou par téléphone), il permet de réaliser des études ciblées dans des délais rapides.
En savoir plus
, après application des préfiltres opérés par nos fournisseurs, en comparant les prévalences d’incohérences relevées dans ces enquêtes en ligne à celles de l’étude multimode (éventuellement en limitant la comparaison aux répondants
CATI
CATI
Acronyme pour Computer Assisted Telephone Interview qui désigne un mode d'administration d'enquête. Une enquête CATI est une enquête administrée par téléphone dans le cadre de laquelle l'enquêteur utilise un logiciel qui lui permet de dérouler son questionnaire et de saisir les réponses de la personne interrogée.
En savoir plus
uniquement).
- L’intérêt de méthodes complémentaires d’évaluation et de filtrage de la donnée, en observant le taux de
convergence
convergence
Rapprochement de domaines ou d'applications liés à des technologies reposant sur des fonctionnements semblables. Ainsi, l'émergence et la généralisation du signal numérique permettent la convergence de l'audiovisuel, de l'électronique grand public, de l'informatique et des télécommunications.
En savoir plus
entre les indicateurs Resquin et les questions dites « blinders ».
Cet axe vise donc à déterminer dans quels contextes de recrutement les méthodes de détection permettraient le plus efficacement d’améliorer la qualité de nos données.
4.2 Axe d’analyse : effet du mode de collecte
La présence simultanée de données collectées par téléphone et en ligne au sein d’une
enquête
enquête
Dispositif de recueil d'informations. On distingue les enquêtes téléphoniques, postales, en face-à-face, en ligne. Bien qu'ayant un sens plus large, le terme d'étude est souvent utilisé comme synonyme.
En savoir plus
multimode nous permettra d’évaluer l’impact spécifique du mode de réponse sur l’inattention des répondants. Nous analyserons ainsi :
- La prévalence de données suspectes selon le mode.
- L’impact distinct de l’effet de mode du comportement répondant structurel, dans l’hypothèse où certains signaux identifiés sur la collecte en ligne seront également observés sur la collecte par téléphone.
Cet axe permettra de mieux cerner la valeur ajoutée du CATI comme référence, et de déterminer jusqu’où les outils de détection doivent être adaptés à chaque mode.
4.3 Axe d’analyse : Complémentarité entre indicateurs
Au-delà des effets liés au mode de recrutement et au mode de collecte, l’enjeu clé de ce travail est d’évaluer la valeur combinée de différents capteurs d’inattention. Il s’agira également d’évaluer la capacité individuelle des questions dites « blinders » à mesurer l’inattention à la lumière des indicateurs calculés avec Resquin. Ainsi, nous souhaitons :
- Comparer la prévalence des différents indicateurs d’inattention.
- Caractériser la convergence ou non-convergence des indicateurs Resquin aux blinders.
- Déterminer si des indicateurs d’inattention sont corrélés à des temps de remplissage.
Ce volet vise à démontrer en quoi un dispositif multi-indicateurs apporte une lecture plus robuste qu’un indicateur isolé.
4.4 Paramétrage des différents indicateurs
Dans la perspective d’une mise en production de ces méthodes de détection, la
question
question
Interrogation posée à l'identique à toutes les personnes participant à une même enquête, dans le but d'obtenir des réponses de même nature. On distingue les questions fermées, dont les réponses sont à choisir parmi les modalités proposées (échelles, oui ou non, modalités d'une nomenclature, etc...), des questions ouvertes, pour lesquelles aucune modalité de réponse n'est proposée. Dans ce dernier cas, c'est la réponse spontanée des personnes interrogées qui est recueillie.
En savoir plus
du paramétrage des indicateurs est également centrale. La sensibilité et l’interprétation de ces indicateurs dépendent en effet de multiples facteurs, parmi lesquels la nature de l’information recueillie dans les suites d’échelles, leur positionnement au sein du
questionnaire
questionnaire
Ensemble de questions, structuré et standardisé, soumis à l'identique aux personnes participant à une enquête. Un questionnaire comporte souvent des questions filtres, dont la réponse conditionne les questions ultérieures.
En savoir plus
— les comportements de satisficing étant susceptibles de s’accentuer en fin de parcours — ainsi que le nombre d’items composant chaque échelle. Ces éléments conditionnent directement la
probabilité
probabilité
La probabilité d'un événement est un nombre réel compris entre 0 et 1 reflétant la chance que cet événement a de se réaliser. Un événement impossible a une probabilité égale à 0 ; un événement certain a une probabilité égale à 1. La théorie et le calcul des probabilités sont à la base de la statistique mathématique et des sondages.
En savoir plus
d’observer des patterns de réponse réguliers, sans que ceux‑ci puissent être interprétés de manière uniforme comme des signaux d’inattention.
Par conséquent, une partie importante de notre travail consiste à évaluer l’impact de ces paramètres sur la détection de répondants inattentifs, et implique de tester différentes combinaisons. Parmi ces paramètres, nous identifions particulièrement la détermination de seuils adaptés aux propriétés de chaque suite d’échelle — nombre de sous-questions, nombre de modalités, homogénéité des items, présence éventuelle de filtres, part de non-réponse.
Conclusion
Ce travail propose une application structurée du package Resquin pour détecter les comportements de non-différenciation et de pattern dans nos enquêtes, en complément des dispositifs classiques de
contrôle
contrôle
Ensemble des opérations consistant à vérifier la qualité du recueil de l'information : travail des enquêteurs, participation des interviewés, avancement par rapport aux objectifs, etc.
En savoir plus
qualité déjà existants. Il permettra d’identifier les conditions nécessaires à une mise en production robuste : définition de valeurs seuils cohérentes, intégration des scores dans les processus qualité et anticipation des interactions entre Resquin et les contrôles existants.
Les résultats consolidés ainsi que les différents enseignements seront présentés lors du colloque.
Bibliographie
- Kennedy, C., Hatley, N., Lau, A., Mercer, A., Keeter, S., Ferno, J., et Asare‑Marfo, D. (2020), Two common checks fail to catch most bogus cases. Pew Research Center, Methodology Report.
https
https
Correspond à une version sécurisée du http (HyperText Transmission Protocol). Il est généralement utilisé pour les transactions financières en ligne comme par exemple les réservations en ligne, les banques en ligne... avec paiement par carte.
En savoir plus
://www.pewresearch.org/methods/2020/02/18/two-common-checks-fail-to-catch-most-bogus-cases/
- Kennedy, C., Mercer, A. et Lau, A. (2024), Étude de l’hypothèse selon laquelle les répondants aux enquêtes non probabilistes en ligne menées à des fins commerciales répondent en toute bonne foi, Techniques d’enquête,
Statistique
Statistique
La statistique ou science des données (Data Science en anglais) est un domaine des mathématiques qui étudie des phénomènes à travers la collecte de données, leur traitement, leur analyse, leur représentation graphique ou visualisation (Data Visualization en anglais) et l'interprétation des résultats.
En savoir plus
Canada, Ottawa.
- Reuning, K. et Plutzer, E. (2020), Valid vs. Invalid Straightlining: The Complex Relationship Between Straightlining and
Data
Data
les données numériques
En savoir plus
Quality, Survey Research Methods, 14(5), 439–459.
- Roth, M., Bhaktha, N., Bluemke, M., Knopf, T., Krämer, F., Lechner, C., & Yildiz, Ç. (2025). resquin: Response Quality Indicators for Survey Research (Version 0.1.1) [R package]. Comprehensive R Archive Network (CRAN). https://CRAN.R-project.org/package=resquin
Résumé
L’usage croissant des enquêtes en ligne, associé à la diversification des dispositifs d’enquête, renforce la nécessité de mieux caractériser les comportements d’inattention susceptibles d’altérer la qualité des données. Dans ce contexte, nous appliquerons le package Resquin à un corpus varié d’études réalisées par Médiamétrie – enquêtes 100 % en ligne issues d’access panels et une
enquête
enquête
Dispositif de recueil d'informations. On distingue les enquêtes téléphoniques, postales, en face-à-face, en ligne. Bien qu'ayant un sens plus large, le terme d'étude est souvent utilisé comme synonyme.
En savoir plus
multimode– afin d’examiner la pertinence opérationnelle de ses indicateurs. Nous utilisons en particulier les indicateurs de non-différentiation et de pattern afin d’identifier les répondants straightliners, ainsi que ceux dont les réponses peuvent être suspectées d’inattention. L’analyse s’appuie en outre sur d’autres indicateurs de qualité disponibles dans le corpus, tels que les temps de passation et les questions dédiées à la détection de l’inattention intégrées à nos enquêtes en ligne (blinders).
La diversité de notre corpus d’études, tant en termes de modes de recueil que de modes de recrutement, ouvre la voie à une analyse approfondie et contextualisée de ces indicateurs. Il nous permet d’interroger la part respective des modes de collecte et de la
base de sondage
base de sondage
Liste des individus ou unités statistiques composant une population au sein de laquelle on souhaite tirer un échantillon sur lequel sera recueillie l'information requise. Par exemple, l'ensemble des abonnés au téléphone peut constituer la base de sondage de certaines études.
En savoir plus
dans la mesure de l’inattention, tout en les distinguant de comportements répondants plus structurels.
L’ambition de ce travail est d’éclairer la nécessité de contextualiser l’interprétation de chaque indicateur de qualité des données, et de montrer en quoi leur mobilisation conjointe constitue un levier pertinent pour affiner le diagnostic de l’inattention dans des contextes d’enquête variés.