Vitrine Démocratique
Comment nous mesurons la saillance médiatique et parlementaire dans l'espace public québécois.
§ 01
La saillance est définie comme la prépondérance relative d'un enjeu, d'un acteur ou d'une institution dans une sphère d'activité publique donnée, à un moment précis. Ce concept s'inscrit dans la tradition de la théorie de l'agenda-setting (McCombs & Shaw, 1972; Iyengar & Kinder, 1987), selon laquelle les médias et les élus se co-influencent mutuellement dans la construction de l'agenda public.
La Vitrine Démocratique mesure deux dimensions complémentaires de la saillance :
Ces deux mesures sont indépendantes et ne sont pas agrégées en un indice composite. Leur rapprochement sur une même interface vise à offrir une vue croisée de l'espace public québécois, sans présumer d'une hiérarchie entre ces sphères.
§ 02
Le système Radar+, développé et opéré par l'équipe Ellipse Sciences du Centre d'analyse des politiques publiques (CAPP), effectue une capture automatique des pages d'accueil de 13 sources d'information toutes les dix minutes environ, de manière ininterrompue depuis septembre 2018. Pour chaque capture sont enregistrés : la structure HTML de la page, la position verticale et le gabarit visuel de chaque manchette, ainsi que le moment précis de l'extraction (horodatage UTC).
| Code | Source | Langue | Temps moyen en Une (min) |
|---|---|---|---|
| JDM | Journal de Montréal | Français | 143 |
| LAP | La Presse | Français | 121 |
| LED | Le Devoir | Français | 242 |
| RCI | Radio-Canada Info | Français | 160 |
| TVA | TVA Nouvelles | Français | 125 |
| MG | Montreal Gazette | Anglais | 241 |
| CBC | CBC News | Anglais | 159 |
| CTV | CTV News | Anglais | 228 |
| GAM | Globe & Mail | Anglais | 326 |
| GN | Global News | Anglais | 375 |
| NP | National Post | Anglais | 249 |
| TTS | Toronto Star | Anglais | 221 |
| VS | Vancouver Sun | Anglais | 505 |
Le temps moyen en Une est calculé sur trois mois glissants et sert à pondérer l'indice de saillance inter-médias (§ 03).
TVA Nouvelles et le Journal de Montréal appartiennent au même groupe de presse (Québecor) et publient parfois la même manchette à l'identique. Pour ne pas compter deux fois une même décision éditoriale, une manchette syndiquée, c'est-à-dire le même titre publié par les deux sources dans le même bloc de quatre heures (l'unité temporelle de l'analyse, § 03), n'est comptée qu'une seule fois dans les mesures de saillance; les manchettes propres à chaque source comptent normalement.
En parallèle des captures de pages frontales, le système extrait le contenu textuel (titre, corps, auteur·e, source) des articles publiés par ces mêmes médias. Ces articles alimentent les modules de couverture par enjeux et par partis politiques.
Les objets présents dans les manchettes (personnes, enjeux, institutions, lieux) sont identifiés par un grand modèle de langage, GPT-4o, appliqué au texte des manchettes. C'est cette extraction qui alimente l'indice de saillance publié sur ce site.
Une seconde chaîne est en développement pour la remplacer, fondée sur des modèles ouverts que nous hébergeons nous-mêmes : GLiNER pour la reconnaissance d'entités nommées, et Gemma 3 pour normaliser les entités en français et en anglais (ex. : « Trudeau » et « Justin Trudeau » renvoient au même objet). Elle est évaluée, mais elle n'est pas en service : aucune donnée publiée ici n'en provient. (État vérifié le 27 août 2026.)
La performance des modèles est évaluée régulièrement par comparaison à environ 1 500 phrases annotées manuellement.
§ 03
La saillance est mesurée en blocs de quatre heures ancrés sur l'heure de Montréal (03–07h, 07–11h, 11–15h, 15–19h, 19–23h, 23–03h), qui constituent l'unité temporelle de base de l'analyse. L'ancrage sur l'heure locale plutôt que sur UTC garantit qu'un bloc reste la même tranche de journée toute l'année, y compris aux changements d'heure.
Une nouvelle peut s'imposer de trois manières différentes, et l'indice les mesure séparément avant de les combiner. Chacune est ramenée sur une échelle de 0 à 1.
| Facette | Question | Mesure |
|---|---|---|
| Visibilité | Combien de médias en ont fait leur Une? | Part des médias suivis de la région qui ont mis l'histoire en Une, en plus du premier. |
| Intensité | Chaque média y consacre-t-il un article ou plusieurs? | Nombre moyen d'articles par média couvrant l'histoire. Un même média ne compte que jusqu'à trois articles : au-delà, un site qui décline abondamment un sujet gonflerait la mesure sans que l'histoire occupe plus de place ailleurs. |
| Durée | Combien de temps est-elle restée en Une? | Temps passé en Une, rapporté au rythme habituel de chaque média : une heure sur une page frontale renouvelée en continu ne vaut pas une heure sur une page qui change deux fois par jour. |
Les trois facettes sont réunies par une moyenne géométrique, et non par une addition. La différence est de fond : une addition serait compensatoire, c'est-à-dire qu'une facette très forte pourrait masquer une facette absente. Un seul média qui laisserait un sujet toute la journée en Une obtiendrait alors un score élevé, alors qu'aucun autre média ne l'a jugé digne de sa page frontale. La moyenne géométrique refuse cette compensation : une histoire doit exister sur les trois plans à la fois pour monter, et le plus faible des trois tire l'ensemble vers le bas. Un plancher empêche toutefois qu'une facette nulle annule tout le reste.
L'indice est calculé séparément pour chaque région (les médias québécois d'un côté, les médias canadiens de l'autre), parce qu'une histoire ne se compare qu'aux Unes du même ensemble de médias. C'est ce qui permet au module « Deux solitudes? » de situer chaque camp chez lui plutôt que dans un panier commun.
Le résultat vaut entre 0 et 1; il est affiché sur 100, avec une décimale. Les deux mesures de volume, l'intensité et la durée, saturent : le troisième article d'un même média et la dixième heure en Une comptent moins que le premier article et la première heure, parce qu'au-delà d'un certain point, en faire plus n'occupe pas plus d'espace dans l'actualité. Cent correspond à un plafond théorique : tous les médias, plusieurs articles chacun, sans interruption.
Une manchette n'est pas un instantané : la nouvelle la plus forte du moment est absente de la tranche de quatre heures en cours près de quatre fois sur dix, parce qu'elle a fait sa journée plus tôt. Ce que le site affiche, ce sont donc les points d'attention sur 24 heures : la moyenne des six dernières tranches, les plus récentes comptant davantage (le poids d'une tranche diminue de moitié toutes les dix heures). Les points sont sur la même échelle que l'indice d'une tranche, de 0 à 100 : 100 points correspondraient à une nouvelle en Une de tous les médias, à plusieurs articles, sans interruption pendant 24 heures. Une nouvelle qui n'est plus en Une garde des points pendant quelques heures, puis les perd progressivement.
Un exemple réel, celui d'un sursis accordé par Washington sur des droits de douane, dans la tranche de 23h à 3h du 18 au 19 août 2026 : quatre médias québécois sur six l'avaient en Une, avec sept articles en tout, pendant l'équivalent de cinq Unes de durée normale. Visibilité 0,60, intensité 0,58, durée 0,93 : l'indice de la tranche vaut 68,8. En moyennant les six dernières tranches (20,7, 42,1, 63,8, 62,9, 73,6 et 68,8, de la plus ancienne à la plus récente) avec leur poids de récence, la nouvelle affiche 62,0 points d'attention sur 24 heures, ce qui la place dans le niveau « Exceptionnelle ».
Toutes les nouvelles présentées dans le module « La Une des Unes » ont fait la Une d'au moins un média : elles sont déjà saillantes. L'étiquette de saillance ne dit donc pas si une nouvelle est importante, mais où elle se situe parmi les autres Unes. Ce qui est classé, ce sont les points d'attention sur 24 heures décrits ci-dessus. C'est la même grandeur qui détermine l'ordre des manchettes, de sorte que le niveau affiché et le rang racontent la même chose. Ces points sont comparés à la distribution des mêmes points sur toutes les Unes d'une année, puis classés en six niveaux par percentiles symétriques.
| Niveau | Position (percentile des points d'attention 24h) | Part des Unes | À partir de (points, Unes québécoises) |
|---|---|---|---|
| Très faible | sous le 5e percentile | 5 % | moins de 10,1 |
| Faible | du 5e au 20e percentile | 15 % | 10,1 |
| Modérée | du 20e au 50e percentile | 30 % | 12,5 |
| Élevée | du 50e au 80e percentile | 30 % | 17,7 |
| Très élevée | du 80e au 95e percentile | 15 % | 28,8 |
| Exceptionnelle | au-dessus du 95e percentile | 5 % | 46,9 |
Les bandes sont symétriques : autant de « Très faible » que d'« Exceptionnelle », l'essentiel au centre. La médiane tombe entre « Modérée » et « Élevée », de sorte qu'aucune bande ne représente « la moyenne ». Les seuils sont fixes : ils sont mesurés une fois, sur une année complète de Unes, et ne bougent pas d'une mise à jour à l'autre. Ils ne suivent donc pas l'actualité récente, et c'est délibéré : une même valeur doit porter la même étiquette aujourd'hui et le mois prochain.
Cette référence est provisoire, et il faut le savoir pour lire les niveaux. L'année sur laquelle elle est mesurée n'est pas une année civile, et le panel de médias suivis y a changé en cours de route : elle décrit donc bien la distribution des Unes, mais pas encore une période qu'on puisse nommer proprement. L'indice lui-même, lui, ne bouge pas : il est absolu par construction, et deux valeurs égales mesurent la même chose quelle que soit l'année. C'est la lentille qui est encore à régler, pas l'instrument. Une référence datée et versionnée, mesurée sur une année civile complète, est à l'étude pour la remplacer. Le jour où elle sera posée, le changement sera annoncé : ou bien les niveaux déjà publiés resteront rattachés à la référence sous laquelle ils ont été calculés, ou bien tout sera recalculé sous la nouvelle et ce sera dit. Jamais un mélange des deux, et jamais en silence.
Une propriété mérite d'être signalée, parce qu'elle ne vient d'aucune règle ajoutée : une histoire portée par un seul média reste très bas sur l'échelle. La facette Visibilité y est presque nulle, et comme les trois facettes se multiplient au lieu de s'additionner, aucune des deux autres ne peut compenser : ni le nombre d'articles, ni le temps passé en Une. C'est la traduction d'un principe simple : la saillance décrit une attention collective, et un média seul, aussi insistant soit-il, ne fait pas un agenda. Ce plafond est un constat de mesure et non une impossibilité : un média qui garderait seul une histoire en Une pendant près d'une journée entière peut le franchir. Sur quatorze mois, le cas s'est présenté une fois : un dossier de fond qu'un quotidien a tenu seul en Une une vingtaine d'heures, un samedi d'été, à l'occasion d'une commémoration. Cette histoire a tout juste atteint le bas du niveau « Élevée », loin des valeurs qu'atteignent les nouvelles suivies par l'ensemble des médias : vingt heures de Une continue, chez un seul journal, ne pèsent guère plus qu'une histoire ordinaire suivie par tous. La vérification est refaite à chaque recalibration.
§ 04
Ce module identifie les événements qui dominent l'agenda médiatique québécois au moment de la consultation, en distinguant l'importance relative accordée par les médias francophones québécois et les médias canadiens anglophones.
Le système regroupe les articles qui traitent d'un même fait d'actualité, à partir des captures des pages d'accueil des médias et des articles qui y figurent. Chaque regroupement, appelé « événement », reçoit un enjeu principal et un score de saillance (son importance médiatique), mesuré à la fois à l'échelle de l'ensemble des médias suivis et spécifiquement pour les médias québécois.
Ce regroupement est fait par un modèle de langue, Claude Sonnet 5 (Anthropic) depuis le 30 août 2026, retenu après un banc comparatif de quatre modèles sur trois jours de Unes (23 août 2026) et appliqué rétroactivement à toute la série publiée depuis le 17 mai 2025; GPT-4o, qui l'assurait auparavant, ne subsiste que dans l'extraction des objets décrite au § 02. On lui soumet, toutes les quatre heures, les articles passés en Une pendant la période ainsi que la liste des histoires déjà suivies depuis 24 heures. Il répond à deux questions d'un seul tenant : quels articles forment une même histoire, et laquelle poursuit une histoire de la veille. La consigne définit une histoire comme un dossier d'actualité : l'annonce et la réaction politique, la gestion d'un événement et ses conséquences, la version française et la version anglaise d'un même fait vont ensemble. Elle précise aussi ce qui ne suffit pas à faire un même dossier (un personnage commun, un thème commun, une région commune), pour éviter que deux affaires distinctes soient présentées comme une seule.
Cette méthode a remplacé un regroupement fondé sur la similarité statistique du vocabulaire, qui découpait une même actualité en plusieurs morceaux : chacun paraissait alors moins important qu'il ne l'était, et les médias qui la couvraient se retrouvaient répartis entre ces morceaux. Sur onze semaines d'archives rejouées, le nouveau regroupement reconnaît la suite d'une histoire dans 64 % des cas contre 40 % auparavant, et le nombre d'histoires portées par au moins trois médias québécois passe de 159 à 218.
Le système suit aussi chaque histoire au fil de la journée. Sur une fenêtre glissante de 24 heures, il rassemble l'ensemble des médias qui l'ont mise en Une, le dernier article mis en Une par chacun d'eux, et le moment où elle est apparue pour la première fois parmi les Unes saillantes.
Ce panneau compare, sur les 24 dernières heures, ce que mettent de l'avant les médias québécois et les médias canadiens (hors Québec). Il mesure dans quelle mesure les deux espaces médiatiques couvrent les mêmes histoires, et non les mêmes articles.
Un radar à deux formes superposées (le Québec en bleu, le Canada en rouge) montre d'un coup d'œil qui parle de quoi : chaque forme dessine où sa région porte son attention. Le degré de convergence se lit dans le grand chiffre et la jauge, pas dans le recouvrement des formes (voir « Limites et honnêteté »). Autour, chaque sujet porte les logos des médias qui l'ont couvert, cliquables vers leur dernier article. Sur un écran étroit, où les titres ne tiendraient pas autour du radar, les axes sont numérotés et les sujets se lisent dans une liste sous le radar, avec les mêmes logos. Un grand pourcentage indique l'écart avec le niveau habituel de convergence, et le libellé qui l'accompagne en donne le sens et l'intensité (plus divergent ou plus convergent que d'habitude); une bulle d'information en détaille la lecture. Sur l'axe fleur-de-lys/érable, la distance entre les deux symboles encode la convergence : ils se rapprochent quand les deux agendas se recoupent, s'éloignent quand ils divergent. La jauge situe le moment sur l'échelle complète, de la divergence totale à la convergence totale; le survol de son marqueur donne les niveaux absolus du moment et de l'habituel.
§ 05
Anciennement « De quoi parle-t-on? ».
Ce module représente la distribution de la couverture médiatique par grand enjeu de société sur la période sélectionnée (Jour · Semaine · Campagne).
| Grand enjeu de société |
|---|
| Économie et travail |
| Gouvernements |
| Santé |
| Environnement |
| Droits et libertés |
| Culture |
| Éducation |
| Aff. internationales |
| Loi et crime |
| Terres publiques |
| Immigration |
| Technologie |
Ces douze enjeux regroupent les 21 grands thèmes du Comparative Agendas Project, une grille internationale de codage des politiques publiques, selon la classification établie par la CLESSN pour le Polimètre. Quelques regroupements méritent d'être nommés : le transport et le logement comptent dans « Économie et travail », avec la macroéconomie, le travail, le commerce intérieur et le commerce extérieur; la santé et l'aide sociale forment « Santé »; l'environnement et l'énergie, « Environnement »; les affaires internationales et la défense, « Aff. internationales »; les terres publiques et l'agriculture, « Terres publiques ». « Culture » ne contient que la culture et le nationalisme.
Le système produit, pour chaque fenêtre temporelle et chaque bloc de collecte (matin, midi, après-midi), un score de couverture pour chacun des 12 grands enjeux.
Chacun des douze enjeux porte un symbole qui lui est propre, en plus de sa couleur. Un enjeu donné garde son symbole et sa couleur partout où il apparaît : sur la rubrique de l'actualité saillante, sur les rubriques du radar des Deux solitudes, sur les tuiles de ce module, à côté des promesses du Polimètre+ et sur les sujets abordés à l'Assemblée. Un même enjeu se reconnaît donc d'un module à l'autre sans avoir à relire son nom.
Le symbole n'est pas un ornement : il reste lisible là où le nom ne l'est plus. Sur les plus petites tuiles, le nom de l'enjeu était rogné jusqu'à ne plus désigner personne; c'est désormais le symbole seul qui l'identifie, le nom complet restant accessible au survol et dans la tuile dépliée. Sur les tuiles les plus plates, où le symbole et le pourcentage ne tiennent pas ensemble, c'est le pourcentage qui est conservé.
Deux réglages indépendants : la fenêtre temporelle (Jour, Semaine, Campagne) et la représentation (Répartition ou Évolution). Les six combinaisons existent. La vue affichée par défaut est Campagne, en Répartition : c'est la fenêtre où le plus grand nombre d'enjeux portent des actualités, et sa variation se compare à la veille plutôt qu'au traitement précédent. Auparavant, la répartition n'était offerte que pour le jour et l'évolution que pour la semaine et la campagne, ce qui interdisait de comparer une même fenêtre des deux façons.
§ 06
Anciennement « Couverture médiatique des partis politiques ».
État actuel : la mesure a repris. Le modèle qui reconnaît les partis a été réentraîné : à la place d'un classifieur unique, neuf modèles binaires jugent chacun d'un seul parti. Sur notre jeu de validation annoté par quatre personnes, la justesse passe de 0,61 à 0,94.
Deux réserves demeurent, et nous les affichons plutôt que de les taire. Le Parti conservateur du Québec n'est plus reconnu du tout : il ne comptait que 18 exemples d'entraînement, dont la majorité désignaient en réalité des conservateurs d'une autre province. Sa colonne restera donc à zéro, et ce zéro dit notre incapacité à le mesurer, pas son absence des médias. Par ailleurs, quatre partis reposent sur peu d'exemples positifs : leurs chiffres sont à lire comme des ordres de grandeur. Voir le point 10 du § 10.
Ce module mesure la part de voix des partis politiques québécois (la portion du temps de une qui revient à chacun, lorsque les médias parlent d'un parti) ainsi que le ton de ce traitement, dans la couverture des six médias québécois suivis : TVA Nouvelles, La Presse, Le Journal de Montréal, Le Devoir, Radio-Canada et le Montreal Gazette. Les partis fédéraux, eux, restent mesurés sur les 13 sources : deux paniers différents pour deux questions différentes. La part de voix ne dit donc pas quelle place les partis occupent dans l'actualité en général, où elle est bien plus modeste : elle répartit entre eux l'attention qui leur est consacrée.
| Parti provincial suivi |
|---|
| Coalition avenir Québec (CAQ) |
| Parti québécois (PQ) |
| Parti libéral du Québec (PLQ) |
| Québec solidaire (QS) |
| Parti conservateur du Québec (PCQ) |
Le système produit, pour chaque parti et chaque date, deux mesures : une part de voix et un ton, sur trois fenêtres (la journée, la semaine et l'ensemble de la période conservée). Les compteurs sont mis à jour six fois par jour, au fil des collectes.
Chaque parti occupe une colonne dont la hauteur donne sa part de voix. Trois onglets (Jour, Semaine et Campagne) font varier la fenêtre observée. Un repère signale le niveau habituel de chaque parti, ce qui permet de voir s'il est au-dessus ou en dessous de son ordinaire, et une courbe retrace l'évolution récente.
Le parti dont les médias parlent le moins sur la période est mis en « sourdine » : sa colonne affiche quand même sa part, en gris, car un parti peu présent est une information en soi. Ce n'est pas un seuil sur la part de voix, mais un rang : le dernier du classement y passe toujours, quelle que soit sa part; en cas d'égalité au plus bas, les partis à égalité y passent tous. Un parti n'est retiré des données elles-mêmes qu'en deçà de 2 %, seuil distinct de la sourdine d'affichage.
Lorsque la répartition par média est disponible, un curseur permet de passer de l'ensemble des médias à un média en particulier. Les couleurs indiquent alors si ce média accorde à un parti plus ou moins de place que la moyenne des autres.
§ 07
Ce module suit la couverture médiatique des promesses électorales de la Coalition avenir Québec (CAQ) : il identifie chaque jour, sur une semaine glissante, les promesses les plus saillantes (les plus présentes dans l'actualité) et celles en plus forte progression par rapport à la semaine précédente.
Le module croise la couverture médiatique avec la liste officielle des promesses de la CAQ. L'appariement entre un article et une promesse est fait par un modèle : un classifieur détermine si un paragraphe contient une promesse, puis un modèle de langage (Gemma 3) détermine laquelle, parmi la liste officielle. Les expressions régulières validées manuellement demeurent dans le pipeline comme méthode de repli et comme étalon de comparaison.
Réserve explicite. La concordance entre l'identification par modèle et l'identification par règles a été mesurée sur un échantillon indépendant (micro-F1 de 0,324). Ce chiffre mesure un accord avec les règles, pas une exactitude : une promesse réellement mentionnée qu'aucune règle ne couvre y compte comme une erreur du modèle. L'arbitrage humain des désaccords est en cours. La bascule a été faite pour observer le comportement du modèle en conditions réelles; le module est servi par un environnement de développement.
En complément de l'identification décrite ci-dessus, et sans intervenir dans le calcul de l'indice, un modèle de langage génératif (Gemma 3) produit deux éléments d'affichage : un libellé court pour chaque promesse et un résumé journalistique (2 à 3 phrases) décrivant comment la promesse a été couverte pendant la période, à partir des titres des articles qui l'ont mentionnée (résumé hebdomadaire, puis synthèse mensuelle des résumés hebdomadaires). Un résumé déjà rédigé est repris tel quel tant que la couverture qu'il décrit n'a pas changé, et la synthèse mensuelle est renouvelée une fois par semaine; elle n'est rédigée que si le résumé de la semaine en cours existe. Cet enrichissement est optionnel : si le service n'est pas disponible, le résumé affiché est le dernier rédigé il y a moins de sept jours pour cette promesse; à défaut, la synthèse mensuelle reprend le résumé de la semaine, et sinon le champ reste vide. Le reste du module est publié normalement.
Classement des promesses de la CAQ les plus saillantes de la semaine, avec l'indication de leur progression et, lorsque disponible, un libellé court et un résumé de la couverture médiatique récente.
Le repli sur les règles vaut pour une semaine entière, jamais pour une partie de semaine. La vue d'un mois cumulant quatre semaines, elle peut donc réunir des semaines identifiées par le modèle et des semaines identifiées par les règles : les deux méthodes ne repèrent pas les mêmes promesses, et les volumes ne se comparent pas d'une semaine à l'autre lorsque la méthode change.
Pendant la campagne électorale de 2026, le module se dote d'un second volet, affiché au-dessus des promesses de 2022 et mis en service au fil de la campagne : les promesses formulées par les partis dans leurs communiqués et leurs plateformes, classées selon l'écho qu'elles reçoivent dans les Unes. Ce volet n'apparaît qu'à partir du moment où au moins une promesse a été reprise en Une; avant, le module ne montre que les promesses de 2022. Il ne porte pas sur la liste officielle des promesses du mandat précédent, mais sur ce que les partis annoncent au fil de la campagne. Une promesse qui vient d'être formulée n'a pas d'état de réalisation : la pastille indique le parti, pas un verdict.
Source des données. Les communiqués publiés par les cinq partis reconnus sur leurs sites officiels et les sections de leurs plateformes électorales, depuis le 1er août 2026. Chaque document est examiné une seule fois. Un modèle de langage (Gemma 3) détermine d'abord s'il contient une promesse électorale (un engagement de faire quelque chose s'il est élu, et non une annonce de candidature ni une annonce gouvernementale), puis en extrait le texte, cité tel quel. Le titre affiché est un libellé court écrit par le modèle; le texte de la promesse, cité en dessous, est un verbatim du document. La consigne de repérage écarte les engagements pris par un candidat en son nom propre pour sa seule circonscription : seul ce que le parti promet compte.
Réserve explicite. L'extraction des promesses fonctionne; l'appariement d'une promesse à sa couverture est le maillon le moins sûr. Mesuré hors campagne, où presque aucun communiqué ne contient de promesse, il produisait surtout des faux positifs. Ce volet est publié pendant la campagne précisément pour être mesuré sur des données réelles, et sa méthode peut changer en cours de route.
§ 08
Ce module mesure la présence des partis politiques dans les débats de l'Assemblée nationale du Québec (ANQ) selon trois fenêtres : la dernière journée de débats publiée, la session en cours et la législature complète.
Le système traite les transcriptions officielles des débats de l'ANQ. Chaque intervention est découpée en phrases, puis chaque phrase reçoit un ou plusieurs enjeux (même taxonomie qu'au § 05) et une valeur de ton. De là viennent, pour chaque parti et chaque période : le nombre d'interventions, le volume de mots prononcés, la richesse lexicale (diversité du vocabulaire), le ton moyen, la répartition par enjeu, un concept distinctif et un angle éditorial. Les mêmes mesures sont calculées par député, sauf l'angle éditorial, qui reste au niveau du parti.
Les segments vides ou sans aucune lettre, produits par le découpage automatique, sont écartés avant toute analyse. Les passages de pure procédure (« je cède la parole à… », les préambules de motion, les formules d'ouverture de séance) sont retirés du corpus servant au concept distinctif et à l'angle éditorial : ils sont très caractéristiques du rôle de qui préside ou lit une motion, pas de son propos politique.
Le nom affiché d'un député provient de l'Assemblée nationale, qui en conserve la graphie officielle, et non du référentiel d'appariement, qui stocke les noms sans accents ni traits d'union. Deux élus homonymes restent deux entrées distinctes, départagées par leur circonscription. Le même référentiel daté détermine le parti auquel chaque intervention est attribuée et fournit les bornes des affiliations affichées sous les cartes.
Le module ne couvre que les cinq partis reconnus. Les interventions prononcées sans affiliation à un parti en sont absentes : elles sont écartées avant l'agrégation, et aucun casier ne leur est consacré. Neuf sièges étaient dans cette situation au 5 août 2026. Les totaux affichés par parti ne décrivent donc pas l'ensemble de la chambre.
Les nouvelles séances sont traitées chaque mardi. Lorsque l'Assemblée ne siège pas (relâche estivale ou parlementaire), les chiffres affichés restent ceux de la dernière séance connue.
Une phrase peut porter plusieurs enjeux à la fois : un propos sur le financement des hôpitaux compte à la fois en santé et en économie. La répartition affichée rapporte donc le nombre d'attributions d'un enjeu au total des attributions de la période, de sorte que les douze parts forment un ensemble de 100 %. Elle se lit comme la part de l'attention thématique, pas comme la part des phrases prononcées.
Cette répartition porte sur les phrases auxquelles au moins un enjeu a été attribué. Une part appréciable du discours parlementaire n'en reçoit aucun : environ 56 % des phrases au 30 juillet 2026, l'essentiel étant des interventions courtes, procédurales ou trop peu explicites pour être classées. La répartition décrit donc ce dont il a été question quand un sujet identifiable était abordé, et non l'intégralité de ce qui a été dit en chambre.
Le concept distinctif est l'expression, d'un ou deux mots, qui sépare le plus un parti (ou un député) des autres sur la période. Le calcul établit d'abord une liste de candidats en combinant trois signaux : la fréquence de l'expression chez cette personne ou ce parti, le fait qu'une seule d'entre elles l'emploie, et sa rareté dans l'ensemble du corpus. Ce dernier signal est ce qui distingue un mot d'usage courant en chambre d'un terme employé de façon insistante par une seule voix.
Les candidats sont extraits phrase par phrase, ce qui évite d'assembler des expressions à cheval sur deux phrases. Sont exclus les mots outils français et anglais, le vocabulaire de procédure parlementaire, ainsi que les noms des élus et les noms et sigles de partis : un député n'est pas caractérisé par son propre nom, ni un parti d'opposition par le sigle de celui qu'il critique. Quand une expression de deux mots porte une part substantielle des emplois du mot seul, c'est elle qui est retenue.
Un modèle de langage tranche ensuite entre les soixante meilleurs candidats. Il ne rédige rien : il reçoit la liste calculée et en désigne une seule entrée, celle qui décrit un enjeu de politique publique plutôt que le fonctionnement de la chambre. Sa réponse est vérifiée contre la liste, si bien qu'aucune expression absente du corpus ne peut être publiée. Cette étape existe parce que la statistique seule ne fait pas la différence entre le vocabulaire des travaux parlementaires et celui des politiques débattues : la fréquence, la rareté et la répartition entre élus classent « salle » ou « affaires courantes » aussi haut que « logement abordable ». Quand aucun candidat ne décrit un enjeu substantiel, aucun concept n'est affiché pour cette entité.
L'extrait placé sous le concept n'est publié que s'il contient tous les mots de l'expression retenue, dans le même ordre. Les mots peuvent être séparés par un déterminant, comme dans « lanceurs d'alerte ». Lorsque le contexte disponible a été coupé avant le concept, le module signale que l'extrait n'est pas disponible plutôt que d'afficher une citation hors sujet.
Chaque phrase reçoit un ton favorable, défavorable ou neutre, pondéré par la confiance du classement. Le ton d'un parti est la moyenne de ces valeurs, calculée sur les seules phrases porteuses d'un enjeu. Les formules d'ouverture, les remerciements et les civilités de séance en sont écartés : le classificateur les juge favorables, et comme elles représentent une large part des interventions, elles tiraient la mesure vers le haut au point d'afficher des partis d'opposition au ton favorable.
Le ton mesuré reste resserré autour de zéro, si bien qu'une valeur brute ne dirait pas grand-chose. L'échelle affichée place donc un repère sur une règle calée sur l'étendue réellement observée pendant la période : la voix la plus défavorable en occupe la gauche, la plus favorable la droite, et le point neutre reste au centre. Une position se lit par comparaison avec les autres élus de la même période, jamais comme une note absolue. Le sens du ton est la partie fiable de cette mesure; son intensité l'est beaucoup moins.
L'angle éditorial est la seule phrase du module rédigée par un modèle de langage. Il résume ce sur quoi un parti a insisté pendant la période. Le modèle ne reçoit ni statistiques seules ni extraits tirés au hasard : il lit les interventions les plus centrées sur l'enjeu dominant du parti, sur toute la fenêtre de la période, retenues selon leur degré de concentration sur cet enjeu et leur substance, avec un plafond par élu pour qu'une seule voix ne fournisse pas toute la matière.
Deux garde-fous encadrent la rédaction. Le modèle ne peut jamais attribuer à un parti la paternité d'une mesure ou d'un projet de loi : en débattre, même longuement, n'est pas la proposer, et l'angle décrit ce que le parti défend, dénonce ou réclame. Le modèle doit ensuite fournir une citation recopiée des extraits qu'il a lus, et le système vérifie que cette citation figure bien dans les propos de ce parti. Si la vérification échoue, aucun angle n'est publié pour cette période : un espace vide vaut mieux qu'une affirmation invérifiable.
La législature complète est la vue affichée par défaut. L'onglet « dernière journée de débats » couvre le jour le plus récent pour lequel une transcription est disponible, « cette session » la session parlementaire en cours. L'onglet « cette législature » remonte à la première séance présente dans nos données, qui n'est pas nécessairement la première séance de la législature : la profondeur de l'historique dépend de la date de mise en service de la collecte.
Le module se présente comme un vestiaire : un casier par parti actif, alignés côte à côte. Les casiers sont rangés du plus bavard au moins bavard, selon le volume de mots prononcés sur la période : c'est le chiffre que porte la porte elle-même, de sorte que l'ordre de la rangée se vérifie d'un coup d'œil. Le premier casier est ouvert d'entrée de jeu. Les battants de chaque casier portent le bilan du parti : volume de mots, nombre de député.es ayant pris la parole et position du parti sur l'échelle de ton. Cliquer un casier écarte ses battants et déroule, sous la rangée, un tiroir relié au casier ouvert. L'intérieur du casier montre alors ce que les portes cachaient : le nombre d'interventions, les trois principaux sujets abordés et l'élu qui a le plus parlé. Le tiroir porte l'angle éditorial du parti, son concept distinctif et le présentoir de ses cartes.
Chaque député ayant pris la parole a sa carte, au format d'une carte de collection (63,5 × 88,9 mm). Le recto porte son portrait, son nom, sa circonscription, le sigle du parti auquel ses interventions sont attribuées et son enjeu dominant. La retourner d'un clic révèle le verso statistique : volume de mots, nombre d'interventions, richesse lexicale, ton en chambre, répartition par enjeu, concept distinctif et un extrait qui l'illustre. Dans la vue de la législature, un avis repliable apparaît sous la carte lorsqu'un parcours demande une précision. Il date les changements d'affiliation, l'entrée à l'Assemblée lors d'une élection partielle et la fin d'un mandat par démission. Une même personne peut donc apparaître dans plusieurs casiers, puisque ses interventions restent associées à l'affiliation détenue au moment où elles ont été prononcées.
Les portraits proviennent du site de l'Assemblée nationale du Québec, qui en autorise la reproduction pour un usage non commercial à condition d'en indiquer la source. Ils sont retraités en bichromie pour s'accorder à la mise en page. Ce retraitement est calculé image par image, de façon à ce que le rendu d'un visage ne dépende pas de sa carnation.
Trois onglets permettent de basculer entre la législature, la dernière journée de débats et la session en cours. Les partis sans siège à la législature courante sont affichés à part, sous l'intitulé « Hors chambre ».
§ 09
Les modules de couverture médiatique sont disponibles selon trois fenêtres temporelles distinctes : le jour, la semaine et la campagne.
| Fenêtre | Portée | Fréquence de mise à jour |
|---|---|---|
| Jour | Blocs de 4h du jour courant | 6 fois par jour (00h, 04h, 08h, 12h, 16h, 20h, heure de Montréal) |
| Semaine | Les sept derniers jours : le jour de l'édition et les six qui le précèdent, heure de Montréal | 6 fois par jour, avec chaque édition |
| Campagne | Depuis le déclenchement du scrutin, le 27 août 2026 | 6 fois par jour, avec chaque édition |
Le système applique une pondération décroissante à l'intérieur de chaque fenêtre : les événements récents contribuent davantage au score final que les événements anciens.
§ 10
Aucune mesure n'est neutre. La Vitrine revendique sa rigueur en exposant aussi ses limites.
Le corpus couvre 13 sources d'information générale établies. Les médias alternatifs, hyperlocalaux, spécialisés et les plateformes de médias sociaux ne sont pas inclus. Ce choix sur-représente les acteurs médiatiques nationaux et les formats de presse traditionnelle.
Les pages d'accueil ne constituent qu'une fraction de la production journalistique. Certains sujets font l'objet d'une couverture approfondie sans jamais atteindre la une. L'indice mesure la visibilité frontale, pas l'ensemble de la couverture.
Le modèle d'extraction peut produire des erreurs sur les homonymes, les entités émergentes et les personnalités peu connues. Des validations humaines régulières réduisent ces erreurs, sans les éliminer.
L'approche par dictionnaire ne capte pas l'ironie, le sarcasme ou les nuances contextuelles. La valence d'un mot peut varier fortement selon la phrase qui l'entoure.
Les indices calculés séparément pour les médias francophones et anglophones ne sont pas directement comparables en valeur absolue, en raison des différences stylistiques entre les deux groupes.
Les données publiées sont des instantanés (snapshots) mis à jour automatiquement six fois par jour par un pipeline AWS. Les scores affichés correspondent au dernier cycle de collecte et d'analyse, non à un flux continu en temps réel.
Le module « L'alignement de l'Assemblée » ne traite que les cinq partis reconnus. Les député.es qui siègent sans affiliation à un parti en sont absent.es, alors que neuf sièges étaient dans cette situation au 5 août 2026, dont d'ancien.nes ministres. Une personne qui change d'affiliation garde, dans les totaux, la parole prononcée sous sa bannière précédente. L'avis repliable sous sa carte permet de dater ce changement et, selon le cas, une élection partielle ou une démission. Les interventions prononcées sans affiliation à un parti ne sont toujours pas représentées dans un casier.
Le regroupement des articles en histoires est confié à un modèle de langue. Deux exécutions sur les mêmes articles s'accordent à environ 97 %, sans être identiques : recalculer une journée passée ne redonnerait donc pas exactement les mêmes histoires. Le découpage publié est une décision datée, figée au moment de la publication. Les indices de saillance des objets, eux, restent calculés de façon déterministe et sont reproductibles (§ 03).
Certaines pages ne sont jamais des nouvelles mais occupent parfois la une : flux vidéo continu, page de chaîne. Une page qui ne change jamais accumule du temps‑en‑une sans rien raconter, ce qui gonfle artificiellement la durée mesurée. Ces pages sont donc exclues du calcul, à partir d'une liste d'adresses tenue à la main et révisée par un humain. Le critère est la durée de vie et non le libellé : les pages « en direct » consacrées à un événement réel, qui portent un titre propre et disparaissent en quelques jours, sont conservées. Au 8 août 2026, la liste compte deux adresses.
Une vidéo placée à la Une pose un problème voisin : la page n'a pas de texte à analyser. Chez CNN, quand la Une est une vidéo de reportage, la collecte retient le premier article du même bloc, qui traite du même sujet; quand c'est un épisode de l'offre vidéo payante de CNN, la capture est exclue, comme une page permanente.
Le modèle a été réentraîné en août 2026 : neuf modèles binaires remplacent le classifieur unique, chacun ne jugeant que d'un seul parti. La justesse mesurée sur un jeu annoté par quatre personnes passe de 0,61 à 0,94. La mesure a donc repris.
Deux limites subsistent. Le Parti conservateur du Québec n'est plus reconnu : ses 18 exemples d'entraînement désignaient en majorité des conservateurs d'une autre province, et nous avons préféré ne pas le détecter du tout plutôt que de le détecter à tort. Sa colonne reste à zéro : ce zéro dit notre incapacité à le mesurer, non son absence des médias. Quatre autres partis reposent sur moins de dix exemples positifs, et deux d'entre eux sur un seul : leurs chiffres sont des ordres de grandeur, pas des mesures fines.
Les valeurs publiées avant la bascule viennent de l'ancien modèle et ne sont pas comparables aux suivantes.
L'historique n'a pas été recalculé. La mesure ne porte donc que sur les articles annotés depuis le 21 août 2026, et les périodes « semaine » et « campagne » sont tronquées d'autant : elles affichent pour l'instant à peu près la même fenêtre que la journée. Elles s'étofferont jour après jour. Nous avons préféré une fenêtre courte et juste à une fenêtre longue mêlant deux modèles, dont les valeurs ne se comparent pas.
§ 11
Rapport de validation des modèles · 30 août 2026
Distillation. Les 30 modèles servis à la Vitrine sont des encodeurs légers (mDeBERTa), un par thème et un par parti, entraînés sur un corpus de 99 997 phrases bilingues tirées de la presse et des débats parlementaires. Ce corpus a été annoté par un grand modèle de langue (gpt-5.4), puis les modèles légers ont été distillés à partir de ces annotations. Chaque modèle répond à une seule question (« ce thème est-il présent dans cette phrase? »), ce qui permet de le mesurer, de le remplacer ou de le retirer sans toucher aux autres.
Calibration. Le seuil de décision de chaque tête thématique a été réglé sur des phrases annotées à la main, par validation croisée répétée deux cents fois, pour que le modèle ne dise « oui » ni trop souvent ni trop rarement. Les têtes de partis sont servies au seuil de 0,5, sans calibration.
Validation. Les modèles ont été confrontés à 2 273 phrases annotées par des humains, hors du corpus d'entraînement. Le F1 moyen de la classe positive est de 0,656 pour les thèmes (13 têtes sur 21 dépassent 0,65; domestic_commerce et public_lands sont les moins sûrs), de 0,934 à 0,994 pour les quatre partis fédéraux disposant d'assez de cas de référence, et de 0,653 pour le sentiment, contre un accord entre annotateurs humains de 0,669. Les cinq partis provinciaux ne sont pas encore validés faute de cas de référence, et le Parti conservateur du Québec n'a pas de modèle. Aucun chiffre du rapport n'est saisi à la main : les tableaux sont régénérés depuis les journaux d'entraînement versionnés.
Une page dédiée résume nos valeurs, notre usage scientifique de l'IA et ses limites : Nos modèles d'intelligence artificielle. Le parcours de la donnée, de la collecte à la publication, est décrit sur la page Notre infrastructure de données.
Lire le rapport de validation complet (PDF) ↓
Réalisé avec
§ 12
Si vous utilisez les données ou les indices de la Vitrine Démocratique dans vos travaux, veuillez citer :
Pour toute demande d'accès aux données brutes ou pour établir une collaboration de recherche, utilisez le formulaire d'accès aux données ou écrivez à [email protected].
§ 13 · Module expérimental
Ce module est expérimental : sa présentation peut encore évoluer. Il décrit l'activité des candidates et des candidats aux élections générales québécoises de 2026 sur Facebook, Instagram et TikTok, ainsi que celle des comptes officiels des cinq partis.
Le point de départ est la liste des candidatures officielles des cinq partis publiée par Élections Québec, close le 25 septembre 2026 : 635 candidatures, soit 127 par parti. Les comptes de chaque personne ont été cherchés sur les trois plateformes, puis vérifiés un à un par l'équipe avant d'entrer dans la collecte. S'y ajoutent les comptes officiels des partis, un par parti et par plateforme.
La collecte passe plusieurs fois par jour sur chaque compte. Elle relève le nombre d'abonnés et les publications, avec leur texte, leur date et leurs nombres de j'aime et de commentaires. L'historique remonte au 1er avril 2026. Au 30 septembre 2026, 1 003 comptes étaient suivis et 602 des 635 candidatures avaient au moins un compte collecté.
Le module propose quatre indicateurs. Le nombre d'abonnés est celui du dernier relevé de chaque compte : il ne dépend pas de la période choisie. Les publications, les j'aime et les commentaires sont comptés par jour de publication, puis additionnés sur la période.
La collecte relit une publication à chaque passage, et ses compteurs continuent de grimper pendant des jours. Seule la dernière observation est retenue : chaque publication compte une fois, avec ses chiffres les plus récents. Une publication signée par deux comptes compte pour chacun d'eux. La date retenue est le jour de mise en ligne en temps universel; Facebook ne fournit que le jour, sans l'heure.
Le module s'ouvre sur la campagne, depuis le déclenchement des élections le 27 août 2026; la période se règle ensuite à volonté. Les filtres par plateforme et par parti s'appliquent à toutes les vues.
La vue Par parti additionne l'indicateur choisi pour chaque parti. Chaque barre se découpe par plateforme, et un second graphique en suit l'évolution par jour, ou par semaine quand la période dépasse 45 jours. La vue Par candidat classe les 20 comptes de candidates et de candidats en tête pour l'indicateur choisi; les comptes officiels des partis n'y figurent pas. Un clic sur un compte affiche ses dernières publications, avec un lien vers chacune sur sa plateforme.
La vue Par publication montre les 10 publications les plus aimées ou les plus commentées de la période. Elles sont choisies parmi les publications les plus aimées de chaque jour des 60 derniers jours : une publication très commentée mais peu aimée peut donc y manquer. Sur la carte de la vue Par circonscription, chaque circonscription prend la couleur du parti dont les candidates et les candidats arrivent en tête pour l'indicateur et la période choisis; plus la couleur est soutenue, plus le total est élevé.