aperçuPressemblée
Méthodologie et limites

Ce que les chiffres peuvent dire, et ne peuvent pas dire

Un dictionnaire en langage clair pour chaque label du site. Chacun est un mot posé sur un nombre — deux couches de mesure, chacune avec son contrôle de fiabilité, et rien laissé en boîte noire.

L’échelle de ton

Six mots pour un nombre

Chaque label de ton est un mot posé sur un nombre : le score de ton dirigé, de −1 (hostile) à +1 (favorable). Les six bandes sont absolues, ancrées à zéro : un mot signifie la même chose sur toutes les pages. Sur la page d'un seul député, ce nombre est le même score ajusté pour la fiabilité que celui des classements (voir Comment les députés sont classés) ; un groupe parlementaire, avec des milliers de mentions, est affiché comme la moyenne simple.

Échelle de ton :Glacial−1-0.35Froid-0.35-0.15Frais-0.15-0.05Mitigé-0.050.05Chaleureux0.050.20Élogieux0.20+1

Froid = hostile, chaleureux = favorable. Nous évitons « chaud », qui inverse le sens (« sous le feu » contre « élogieux »). L’infobulle d’une pastille affiche toujours le nombre exact et la bande — le mot ne remplace jamais la donnée.

Absolu et relatif

Deux questions honnêtes

La bande répond à une question — la couverture de cette personne est-elle hostile ? Une seconde formule en pose une autre — est-elle moins bien traitée que ses pairs ? — en la comparant à la moyenne de tous les députés (-0.18), car la presse est négative envers presque tout le monde. Les deux sont vraies ; elles mesurent simplement des choses différentes.

Couche 1 · Rôle et ton dirigé

Le ton se lit en deux temps

Le ton est lu en deux temps, pour qu’un score reflète le ton envers le député, et non l’humeur de l’actualité. 1er temps, le rôle : le député est-il celui qui agit ou s’exprime, la cible de l’action, ou simplement mentionné ? 2e temps, le ton selon ce rôle : positif, neutre ou négatif. C’est pourquoi le panneau « Comment la presse les présente » compte : être une cible paraît bien plus négatif que prendre la parole.

C’est important car un score unique mélange les rôles. Sur l’ensemble du corpus, la même position se lit très différemment selon le rôle — être l’objet d’un récit est bien plus dur que d’y être cité en train d’agir :

RôlePartTon dirigé
Visé·e6%-0.51
Mentionné·e74%-0.17
S’exprime19%-0.10

Dans la phrase de synthèse, un rôle n’est nommé que lorsque ce député y est présenté significativement plus que la moyenne (z ≥ 1.64). « Mentionné », environ 74% de la couverture, est le cas par défaut et n’est jamais mis en avant.

Accord sur le ton (α)
0.657 (IC 0.65–0.67, ordinal)
Accord sur le rôle (α)
0.642 (nominal)
Couche 2 · Cadrages

Cinq cadrages, chacun avec son niveau de fiabilité

Les cadrages sont les cinq cadrages génériques de l’actualité de Semetko & Valkenburg (2000). Chacun porte son propre score de fiabilité — l’accord sur le label majoritaire — qui détermine la confiance à lui accorder.

VALIDÉ fiable (α ≥ .70)UTILISABLE utilisable avec prudence (.50 à .70)EXPLORATOIRE le moins fiable (α < .50), affiché estompé
Cadrageα (nominal)Accord brutPrévalenceVerdict
Conflit0.65173.9%52.8%UTILISABLE
Intérêt humain0.49683.8%10.7%EXPLORATOIRE
Économie0.80694.6%10.8%VALIDÉ
Morale0.46789.5%5.7%EXPLORATOIRE
Responsabilité0.49764.4%38.6%EXPLORATOIRE

La négativité se loge dans les récits de conflit et de morale

Ton net selon qu’un cadrage est présent ou absent.

Conflit-0.30-0.03Intérêt humain-0.13-0.18Économie-0.10-0.18Morale-0.37-0.16Responsabilité-0.21-0.16
Visibilité et présence

À quel point, et avec quelle constance

Les bandes de visibilité viennent du percentile de volume de couverture d’un député parmi les députés couverts. Une couverture concentrée sur un seul mois est un pic, pas une présence durable : elle est rétrogradée d’une bande et signalée.

MotPercentile de volume
Sous le feu des projecteurs≥ 99
Très visible96–99
Régulièrement couvert·e90–96
Couvert·e par moments75–90
Rarement couvert·e< 75
Sous les radars

L’étiquette pic ponctuel signale une couverture quasi entièrement concentrée sur un mois ; l’étiquette discret depuis signale un député sans titre récent. 209 des 577 députés en exercice n’apparaissent jamais — l’absence de couverture est elle-même une donnée, pas une donnée manquante.

Comment les députés sont classés

Six classements, filtrés pour la robustesse

Un député doit avoir au moins 30 mentions dans les titres pour figurer dans un classement, de quoi éviter qu’une moyenne soit un hasard (erreur maximale ≤ 0,18). Les députés sont ensuite classés sur un score ajusté pour la fiabilité — un ton rétréci (empirical-Bayes) qui ramène un député peu couvert vers la moyenne de l’ensemble, afin qu’un classement ne soit pas dominé par une ou deux mentions quasi unanimes ; les députés bien couverts bougent à peine, et la moyenne brute et le nombre de mentions figurent à côté. Le même rétrécissement régit les classements cible et conflit. Les groupes parlementaires sont en revanche classés sur la moyenne simple pondérée par paires : chacun porte des milliers de mentions, si bien que le rétrécissement les déplacerait de moins de 0,03 et ne ferait que brouiller les écarts entre groupes.

ClassementClassé par
Sous le feuton le plus bas
Les mieux traitéston le plus élevé
Dans le viseurplus forte part « cible »
Dans l’arèneplus forte part de cadrage conflit
Sous les projecteursle plus de mentions
Les plus clivantsplus grand écart de ton entre médias

Le classement Les plus clivants ajoute un second filtre : seuls les médias qui le mentionnent au moins 16 fois comptent, pour qu’une cellule de trois mentions ne fabrique pas un faux écart (erreur ≤ 0,25, environ une bande de ton).

Lire d’un média à l’autre

L’écart gauche–droite

L’écart G–D d’un média est son ton envers la gauche moins son ton envers la droite. Positif : il couvre la gauche plus chaleureusement — plus dur avec la droite ; négatif : plus dur avec la gauche. D’un média à l’autre, cet écart suit étroitement l’idéologie (ρ = −0.79 sur 25 médias) — le résultat phare de l’étude.

Sur la carte des biais, l’axe morale sépare encore les médias (ρ = +0.57) même si ce cadrage est exploratoire par titre : le bruit par titre se moyenne sur des centaines de titres.

L’axe horizontal

D’où vient le score idéologique d’un média

La position gauche–droite de chaque média est FrIdéo, une échelle publiée d’orientation des médias français, construite en fusionnant neuf familles de preuves indépendantes : actionnariat, équilibre des invités à l’antenne, sondages, réseau d’hyperliens entre médias, notations de biais tierces, ligne éditoriale déclarée, profilage encyclopédique, lexique de distanciation et Ad Fontes. C’est un score standardisé avec intervalles de confiance bootstrap, et il place les 29 médias de ce corpus.

Point essentiel : aucune famille de preuves de FrIdéo n’utilise les annotations de ton ou de cadrage présentées ici. La corrélation ci-dessus est donc une mesure contre une grandeur extérieure, et non une échelle vérifiée contre elle-même. Les médias dont l’intervalle de crédibilité contient zéro sont signalés, car l’échelle elle-même ne tranche pas leur camp.

Ce site tourne sur un corpus glissant qui dépasse la fenêtre figée de l’article : ses chiffres suivent la méthode de l’article sans en reproduire exactement les valeurs publiées. Sur la fenêtre de l’article, la même corrélation vaut ρ = −0.83 sur 25 médias.

La couche en direct

Ce qui bouge d’une semaine à l’autre

Quand de nouveaux titres arrivent, la page d’accueil signale les mouvements — nouvelles arrivées sous les projecteurs, fortes variations de ton — et chaque profil affiche des écarts d’une semaine à l’autre, l’en-tête indiquant en direct. Cette couche est indicative : à environ 80 titres par semaine, elle est trop mince pour être un résultat de recherche, et reste un signal de démo en direct, pas une conclusion de l’étude.

La phrase de synthèse

Comment la phrase est construite

La phrase de chaque profil assemble les mêmes éléments dans un ordre fixe — le mot de visibilité, la bande de ton, la formule relative, puis une mention de rôle lorsqu’elle passe le test de significativité. Rien n’y est écrit à la main : changez un nombre en amont et la phrase change avec lui.

Réserves assumées

À garder à l’esprit

  • Des labels automatisés. Le ton et les cadrages sont attribués par un modèle de langage à partir de chaque titre : chaque score est une mesure indicative, pas un jugement éditorial vérifié à la main.
  • Les titres seulement. Nous lisons le titre, pas le corps de l’article. C’est le titre que voient la plupart des lecteurs.
  • La fiabilité varie selon le cadrage. L’économie (validé) et le conflit (utilisable) portent l’essentiel. La morale et l’intérêt humain obtiennent un score faible surtout parce qu’ils sont rares, donc peu mesurables, et non parce qu’ils seraient aléatoires. La responsabilité est le vrai point faible : les codeurs divergent sur près d’un titre sur trois. Les cadrages exploratoires sont estompés (~) partout où ils apparaissent.
  • Les absents. 209 députés en exercice n’apparaissent jamais. L’absence de couverture est en soi une donnée, pas une donnée manquante.
Source

D’après l’article

Chaque mesure de ce site applique la méthode introduite dans :

Baromètre Médiatique de l’Assemblée: How French News Outlets Cover Deputies of the Seventeenth National Assembly — Headline-Level Directed Sentiment and Framing at Scale

Amr Sobhy · Le French News Lab

Informations sur les députés issues de Civix, qui s’appuie sur les données ouvertes de l’Assemblée nationale.

Pressemblée mesure, titre par titre, le ton et le cadrage de la presse française envers chaque député·e.Réalisé par @amrsobhy au French News Lab.
21 715 titres analysés · Législature 17 · Mis à jour il y a 3 minutes