Reconnaissance automatique de contenu
La reconnaissance automatique de contenu permet d’identifier les flux et programmes réellement consommés à partir du signal audio capté. En mesure d’audience, elle s’appuie sur des technologies complémentaires pour reconnaître les usages TV, radio, streaming, replay ou podcast.
Comment l’audio permet d’identifier les flux et les programmes consommés
Dans un paysage média où les usages se fragmentent entre télévision, radio, streaming streaming Procédé technique de transmission numérique de données qui permet la lecture de flux vidéos et/ou de sons en continu. Contrairement à la diffusion de télévision par voie hertzienne ou satellite, cette technologie requiert un réseau bidirectionnel (Internet) pour envoyer des requêtes périodiques au serveur de streaming afin de recevoir des micro-fichiers vidéo ou audio. En savoir plus , live, replay replay Replay ou catch up, anglicisme désignant une technologie permettant aux téléspectateurs de visionner ou revisionner un programme de télévision après sa diffusion live. En savoir plus et podcast podcast Programme audio sous forme d'épisodes ou de séries disponible en ligne pour une écoute à la demande. Cette terminologie est issue de la contraction des mots Ipod et Broadcast. En savoir plus , l’identification automatique des flux et des contenus est devenue un enjeu central pour la mesure d’audience. En s’appuyant sur le signal audio capté par les audimètres, les technologies d’ACR (Automatic Content Recognition) permettent de reconnaître les contenus réellement consommés, quel que soit leur mode mode En statistique, le mode est la valeur dont l'effectif est le plus nombreux. En savoir plus de diffusion diffusion Passage d'une émission ou d'un programme à la télévision ou à la radio. Ce terme fait référence à un programme "live" par opposition à la consultation à la demande. En savoir plus .
Cette reconnaissance automatique de contenu repose principalement sur deux approches : le watermarking watermarking Technologie utilisée pour la mesure d'audience de la télévision et de la radio. Le watermarking consiste à insérer une marque (un son) inaudible à l'oreille humaine, dans les émissions. Cette marque contient l'identification de la chaîne qui diffuse le programme et des repères réguliers sur l'heure de diffusion. Les audimètres installés chez les panélistes reconnaissent ces informations. En savoir plus audio et le fingerprinting fingerprinting Technologie d'identification de contenus audiovisuels. Elle consiste à "prélever" un morceau de contenu visionné ou entendu sur une plateforme quelle qu'elle soit, puis de le comparer avec une base de données de référence contenant tous les extraits des programmes d'une chaîne ou d'un catalogue de programmes. Si ce "prélèvement" s'avère appartenir à cette base de données, alors le contenu dont il provient est identifié. En savoir plus audio. Elles poursuivent le même objectif — identifier un contenu de manière fiable, précise et exploitable pour la mesure d’audience — mais répondent à des contraintes différentes selon qu’il s’agit de flux linéaires, de contenus non linéaires ou de détection en environnement réel d’écoute (cas de l’audimétrie portée notamment).
Qu’est-ce que l’ACR audio et quelles technologies sont utilisées ?
L’ACR audio, ou reconnaissance automatique de contenu à partir du signal sonore, regroupe ici deux grandes approches technologiques. Toutes deux visent à identifier automatiquement un flux et/ou un contenu diffusé, mais elles ne reposent pas sur les mêmes principes de fonctionnement.
- Le watermarking watermarking Technologie utilisée pour la mesure d'audience de la télévision et de la radio. Le watermarking consiste à insérer une marque (un son) inaudible à l'oreille humaine, dans les émissions. Cette marque contient l'identification de la chaîne qui diffuse le programme et des repères réguliers sur l'heure de diffusion. Les audimètres installés chez les panélistes reconnaissent ces informations. En savoir plus audio consiste à insérer un marqueur marqueur Le marqueur (ou "tag") permet de mesurer la fréquentation d'un site internet. Cela consiste en l'ajout d'un code informatique dans les pages du site à mesurer. Lorsqu'une page est appelée par un navigateur, le code envoie une requête à un serveur de comptage qui comptabilise le trafic ainsi généré. La technologie par marqueur s'adapte aussi à la mesure des contenus vidéo et audio en streaming, des applications mobiles, des podcasts etc. En savoir plus inaudible directement dans le signal audio. On parle aussi de tatouage audio. Ce marqueur permet une identification déterministe déterministe Le terme de donnée ou data déterministe désigne un processus d'identification d'un individu reposant sur un identifiant unique qui peut par exemple être un numéro d'identifiant d'un appareil mobile ou un numéro d'abonné à un opérateur téléphonique. En savoir plus , précise et à faible latence (en quelques secondes après la captation du signal audio).
- Le fingerprinting fingerprinting Technologie d'identification de contenus audiovisuels. Elle consiste à "prélever" un morceau de contenu visionné ou entendu sur une plateforme quelle qu'elle soit, puis de le comparer avec une base de données de référence contenant tous les extraits des programmes d'une chaîne ou d'un catalogue de programmes. Si ce "prélèvement" s'avère appartenir à cette base de données, alors le contenu dont il provient est identifié. En savoir plus audio repose sur l’analyse des caractéristiques propres du signal afin de produire une empreinte sonore, ensuite comparée (en back office) à un référentiel d’empreintes de programmes connus.
Le watermarking audio est particulièrement adapté aux contextes qui exigent rapidité et précision, notamment pour les flux live. Le fingerprinting audio est, quant à lui, pertinent lorsqu’il s’agit d’identifier des contenus déjà catalogués, sans insertion préalable d’informations dans le signal.
Comment fonctionne le watermarking audio avec SNAP ?
Médiamétrie s’appuie sur SNAP, une solution de watermarking watermarking Technologie utilisée pour la mesure d'audience de la télévision et de la radio. Le watermarking consiste à insérer une marque (un son) inaudible à l'oreille humaine, dans les émissions. Cette marque contient l'identification de la chaîne qui diffuse le programme et des repères réguliers sur l'heure de diffusion. Les audimètres installés chez les panélistes reconnaissent ces informations. En savoir plus audio développée par Fifty5Blue. Cette technologie repose sur l’insertion de manière inaudible d’informations dans le signal audio, de façon à permettre une reconnaissance rapide et fiable du flux et du contenu visualisé et/ou écouté.
Le principe technique repose sur une modulation de phase du signal audio. Concrètement, des informations sont insérées dans des bandes fréquentielles contrôlées sans aucune altération de l’écoute pour l’utilisateur. Cette approche vise donc à concilier discrétion du marquage, robustesse du tatouage inséré et sa rapidité de détection.
Pourquoi le watermarking audio est-il particulièrement adapté à la détection rapide ?
Le watermarking watermarking Technologie utilisée pour la mesure d'audience de la télévision et de la radio. Le watermarking consiste à insérer une marque (un son) inaudible à l'oreille humaine, dans les émissions. Cette marque contient l'identification de la chaîne qui diffuse le programme et des repères réguliers sur l'heure de diffusion. Les audimètres installés chez les panélistes reconnaissent ces informations. En savoir plus audio présente plusieurs atouts pour la mesure d’audience :
- une transparence perceptuelle élevée du marquage audio ;
- une très bonne robustesse face aux traitements audio des chaînes de diffusion diffusion Passage d'une émission ou d'un programme à la télévision ou à la radio. Ce terme fait référence à un programme "live" par opposition à la consultation à la demande. En savoir plus ;
- une compatibilité avec des environnements comportant du bruit ambiant et une captation par microphone (cas de l’audimètre portée).
Le watermark transporte généralement deux informations principales
- un identifiant unique attribué à la chaîne, la station ou la plateforme à mesurer ;
- un timestamp temporel.
Cette architecture permet d’identifier les flux et les contenus de façon fiable, aussi bien dans les usages linéaires que non linéaires :
- en linéaire linéaire Désigne le fait de regarder un programme de télévision en live, en timeshifting (contrôle du direct) ou en différé privé (avec un enregistrement personnel). En savoir plus , grâce à une référence temporelle portée par le timestamp inséré ;
- en non linéaire, via la reconaissance du contenu via son identifiant et son timecode relatif.
Les algorithmes de détection de Fifty5Blue ont été conçus nativement pour concilier qualité et robustesse d’identification et compatibilité avec des audimètres portables aux ressources (CPU, mémoire et énergie) limitées.
Comment fonctionne le fingerprinting audio avec UNITAM ?
Médiamétrie utilise également UNITAM, une technologie de fingerprinting fingerprinting Technologie d'identification de contenus audiovisuels. Elle consiste à "prélever" un morceau de contenu visionné ou entendu sur une plateforme quelle qu'elle soit, puis de le comparer avec une base de données de référence contenant tous les extraits des programmes d'une chaîne ou d'un catalogue de programmes. Si ce "prélèvement" s'avère appartenir à cette base de données, alors le contenu dont il provient est identifié. En savoir plus audio fournie par Nielsen. Contrairement au watermarking watermarking Technologie utilisée pour la mesure d'audience de la télévision et de la radio. Le watermarking consiste à insérer une marque (un son) inaudible à l'oreille humaine, dans les émissions. Cette marque contient l'identification de la chaîne qui diffuse le programme et des repères réguliers sur l'heure de diffusion. Les audimètres installés chez les panélistes reconnaissent ces informations. En savoir plus , cette approche ne nécessite aucune insertion préalable dans le signal audio à mesurer.
L’identification s’effectue à partir de l’empreinte sonore du contenu capté. Le système analyse les caractéristiques du signal audio, génère une signature signature Code électronique inséré dans un signal numérique ou analogique, qui permet d'authentifier la source émettrice. En savoir plus la plus compacte possible, puis la compare à un référentiel centralisé d’empreintes de contenus de référence
Dans quels cas le fingerprinting audio est-il pertinent, et quelles sont ses limites ?
Les algorithmes de fingerprinting fingerprinting Technologie d'identification de contenus audiovisuels. Elle consiste à "prélever" un morceau de contenu visionné ou entendu sur une plateforme quelle qu'elle soit, puis de le comparer avec une base de données de référence contenant tous les extraits des programmes d'une chaîne ou d'un catalogue de programmes. Si ce "prélèvement" s'avère appartenir à cette base de données, alors le contenu dont il provient est identifié. En savoir plus s’appuient généralement sur des fenêtres d’observation plus longues afin d’améliorer la robustesse statistique statistique La statistique ou science des données (Data Science en anglais) est un domaine des mathématiques qui étudie des phénomènes à travers la collecte de données, leur traitement, leur analyse, leur représentation graphique ou visualisation (Data Visualization en anglais) et l'interprétation des résultats. En savoir plus du rapprochement entre les empreintes (celles observées par les audimètres et celles en référence) et de limiter ainsi les faux positifs.
Cette approche est particulièrement adaptée à l’identification de contenus déjà catalogués et préalablement référencés.
Elle présente en revanche certaines limites notamment pour identifier notamment les flux live identiques ou les situations de zapping zapping Opération consistant à changer fréquemment de chaîne de télévision. Au sens étroit, ce changement s'effectue pour éviter les écrans publicitaires (les Canadiens emploient le mot " pitonnage "). Seule l'audimétrie, parmi les différentes techniques de mesure de l'audience, permet de saisir ce phénomène. On distingue le flipping (changer de chaîne en cours d'émission) et le switching (changer de chaîne en cours d'émission afin de regarder une émission préalablement choisie). En savoir plus rapides.
Comme tout système de fingerprinting, ses performances dépendent étroitement de la qualité du signal capté, de l’environnement acoustique de mesure, de l’exhaustivité du catalogue de référence et de la fraîcheur de ce catalogue.
L’identification repose sur un rapprochement côté serveur serveur Système composé de matériel informatique et de logiciels, mettant à disposition de ses utilisateurs des bases de données ou des programmes. En savoir plus , selon une logique probabiliste probabiliste Le terme de donnée ou data probabiliste désigne un processus d'identification d'un individu qui se base sur un modèle probabiliste plutôt que sur un identifiant considéré comme "infaillible" grâce à son unicité. En savoir plus , entre les empreintes observées par les audimètres et celles déjà calculées dans le référentiel.
Dans la mesure d’audience, le watermarking watermarking Technologie utilisée pour la mesure d'audience de la télévision et de la radio. Le watermarking consiste à insérer une marque (un son) inaudible à l'oreille humaine, dans les émissions. Cette marque contient l'identification de la chaîne qui diffuse le programme et des repères réguliers sur l'heure de diffusion. Les audimètres installés chez les panélistes reconnaissent ces informations. En savoir plus audio et le fingerprinting audio ne s’opposent pas : ils répondent à des besoins différents et souvent complémentaires. Leur mobilisation permet d’adapter l’identification automatique des contenus à la diversité des environnements de diffusion diffusion Passage d'une émission ou d'un programme à la télévision ou à la radio. Ce terme fait référence à un programme "live" par opposition à la consultation à la demande. En savoir plus , des temporalités d’usage et des contraintes de mesure. C’est cette articulation entre précision technologique, robustesse opérationnelle et intégration méthodologique qui permet de suivre au plus près les contenus réellement consommés.
FAQ — Comprendre la reconnaissance automatique de contenu audio
Qu’est-ce que la captation automatique de la donnée dans la mesure d’audience ?
Il s’agit d’identifier automatiquement les contenus réellement consommés à partir du signal audio capté par les audimètres.
Quelle différence entre watermarking audio et fingerprinting audio ?
Le watermarking watermarking Technologie utilisée pour la mesure d'audience de la télévision et de la radio. Le watermarking consiste à insérer une marque (un son) inaudible à l'oreille humaine, dans les émissions. Cette marque contient l'identification de la chaîne qui diffuse le programme et des repères réguliers sur l'heure de diffusion. Les audimètres installés chez les panélistes reconnaissent ces informations. En savoir plus audio repose sur l’insertion d’un marqueur marqueur Le marqueur (ou "tag") permet de mesurer la fréquentation d'un site internet. Cela consiste en l'ajout d'un code informatique dans les pages du site à mesurer. Lorsqu'une page est appelée par un navigateur, le code envoie une requête à un serveur de comptage qui comptabilise le trafic ainsi généré. La technologie par marqueur s'adapte aussi à la mesure des contenus vidéo et audio en streaming, des applications mobiles, des podcasts etc. En savoir plus inaudible dans le signal et le contenu à mesurer, tandis que le fingerprinting fingerprinting Technologie d'identification de contenus audiovisuels. Elle consiste à "prélever" un morceau de contenu visionné ou entendu sur une plateforme quelle qu'elle soit, puis de le comparer avec une base de données de référence contenant tous les extraits des programmes d'une chaîne ou d'un catalogue de programmes. Si ce "prélèvement" s'avère appartenir à cette base de données, alors le contenu dont il provient est identifié. En savoir plus audio repose sur le calcul et l’analyse de l’empreinte sonore du contenu mesuré.
Pourquoi le fingerprinting audio est-il moins adapté au live ou au zapping ?
Parce qu’il s’appuie généralement sur des fenêtres d’observation plus longues et sur un rapprochement probabiliste probabiliste Le terme de donnée ou data probabiliste désigne un processus d'identification d'un individu qui se base sur un modèle probabiliste plutôt que sur un identifiant considéré comme "infaillible" grâce à son unicité. En savoir plus avec un référentiel de contenus. C’est une technique nativement contenu centrique
Pourquoi le watermarking audio est-il utile pour la mesure des flux live ?
Parce qu’il permet une détection rapide et déterministe déterministe Le terme de donnée ou data déterministe désigne un processus d'identification d'un individu reposant sur un identifiant unique qui peut par exemple être un numéro d'identifiant d'un appareil mobile ou un numéro d'abonné à un opérateur téléphonique. En savoir plus , particulièrement adaptée aux usages en direct et aux changements rapides de flux et contenu (zapping par exemple).