Aller au contenu
PoliMap

Axes posés, axes déduits

Cinquante curseurs, personne ne les remplit. Le questionnaire en pose une partie et calcule le reste, à partir des régularités du corpus. Le prix de ce raccourci est chiffré ici, et affiché à l'utilisateur.

17 axes posés, 5 déduits, sur un corpus de 54 observations. Seuil de R² retenu : 0.6.

Les axes déduits, et ce que vaut chaque formule

Le R² est calculé en validation croisée « un contre tous » : chaque observation est prédite par un modèle ajusté sans elle. Un R² mesuré sur les données ayant servi à l'ajustement serait flatteur et faux.

Axe déduitR² validéPrédit à partir de
Redistribution des richesses0.86Rapport de force travail / capital, Étendue des missions de l'État, Moyens de la transition écologique
Source de légitimité de la loi0.86Normes sociales — conservation ou transformation, Reconnaissance politique des appartenances, Force des contre-pouvoirs
Légitimité des hiérarchies sociales0.82Rapport de force travail / capital, Normes sociales — conservation ou transformation
Ouverture commerciale0.76Coordination économique, Moyens de la transition écologique, Conception de l'appartenance nationale
Ouverture aux migrations0.67Conception de l'appartenance nationale, Intervention de l'État dans le fait religieux

Les formules, en clair

Elles sont affichées dans le questionnaire à côté de chaque estimation. Une formule à trois ou quatre termes peut être montrée ; une formule à seize termes ne serait qu’une boîte noire de plus, exactement ce que ce projet reproche aux tests existants.

Axe déduitFormuleR²
Redistribution des richesses+8.1 +0.46·eco-travail-capital +0.41·etat-etendue-mission +0.22·eco2-moyens-transition -0.18·cul-identite-nationale0.86
Source de légitimité de la loi+19.3 +1.04·cul-tradition-progres -0.28·cul-universalisme-particularisme +0.27·etat-contrepouvoirs0.86
Légitimité des hiérarchies sociales-3.0 +0.59·eco-travail-capital +0.57·cul-tradition-progres0.82
Ouverture commerciale+5.3 +0.58·eco-coordination +0.47·eco2-moyens-transition +0.33·cul-identite-nationale +0.18·int-souverainete0.76
Ouverture aux migrations+2.2 +0.59·cul-identite-nationale +0.35·cul-intervention-religieuse0.67

Où s’arrêter : le gain marginal

À chaque axe ajouté au questionnaire, de combien la prédiction des axes restants s’améliore-t-elle ? Le point où la courbe s’aplatit est le budget raisonnable.

Axes posésAxe ajoutéR² moyen des déduitsGain
3Libertés individuelles et ordre public+0.366—
4Moyens de la transition écologique+0.430+0.064
5Souveraineté et intégration supranationale+0.483+0.053
6Reconnaissance politique des appartenances+0.511+0.028
7Conception de l'appartenance nationale+0.537+0.027
8Normes sociales — conservation ou transformation+0.554+0.017

Les axes que le modèle refuse de déduire

Sous R² = 0.6, une déduction n’est pas sérieuse. Ces axes sont reversés au questionnaire quel que soit le budget — c’est le garde-fou du dispositif.

Une exception éditoriale, assumée. L’algorithme, laissé seul, déduisait les deux axes de la décomposition propriété × coordination, qui est la démonstration centrale du projet. Techniquement défendable, pédagogiquement absurde : les déduire priverait l’utilisateur de l’expérience même que le site existe pour produire. Ils sont donc posés par défaut, et le questionnaire prévient avant de les laisser déduire — Propriété des moyens de production, Coordination économique. Il prévient, il n’interdit pas : le découpage appartient à l’utilisateur, axe par axe. C’est un jugement, pas un résultat, et il est écrit en clair dans le code comme ici.

Les axes posés

Méthode, exception éditoriale et limites

La validation CHES a établi que plusieurs axes du référentiel sont fortement corrélés. Les poser tous revient à mesurer la même chose plusieurs fois. Ce texte décrit comment on tranche — sur données, pas à la main — et ce que ça coûte. Les chiffres sont produits par outils/deduction.py, écrits dans data/deduction.json, et insérés dans la page Analyses → Axes déduits à la construction du site.

Reproduire : python outils/deduction.py 8


Le principe#

  1. Sélection gloutonne d'un sous-ensemble d'axes à poser, maximisant la prédiction

des axes restants.

  1. Seuil d'honnêteté : un axe dont la prédiction tombe sous R² = 0,60 ne peut

pas être déduit sérieusement — il est reversé dans le questionnaire, quel que soit le budget.

  1. Passe d'élagage : après élargissement, on vérifie qu'aucun axe posé n'est

devenu déductible depuis les autres.

Toute la sélection et tous les R² sont calculés en validation croisée leave-one-out, jamais en ajustement. À cet effectif et avec une quinzaine de prédicteurs possibles, le R² d'ajustement serait proche de 1 et ne voudrait rien dire.

Ce que l'élargissement du corpus a changé#

Le premier élargissement, l'ajout des positionnements de personnages, a augmenté la part déductible : sur les 25 doctrines seules, le modèle ne déduisait que six axes, puis sept avec les personnages.

Le second, en septembre 2026, a eu l'effet inverse. Sept doctrines, trois présidents de plus et une révision de plusieurs fiches ont porté le corpus à 54 observations, et le modèle ne déduit plus que cinq axes. Les nouvelles doctrines occupent des combinaisons que le corpus laissait vides : une Nouvelle Droite écologiste et régionaliste, un fédéralisme européen à programme social, un trotskysme attaché aux libertés. Plus le corpus est varié, moins les axes se prédisent les uns les autres, ce qui est exactement la thèse du projet. Le tableau des axes déduits et de leurs R² est produit à partir de data/deduction.json et figure plus haut sur cette page.

Avec les trois axes empiriques, que le questionnaire propose dans une section à cocher, il compte vingt questions au lieu de vingt-cinq ; dix-sept sans eux.

Une exception éditoriale, assumée#

L'algorithme, laissé seul, déduit volontiers eco-propriete ou eco-coordination, que les autres axes prédisent bien. Techniquement défendable, pédagogiquement absurde : ce sont les deux axes de la décomposition qui constitue la démonstration centrale du projet — celle qui montre que le gaullisme planifie sans collectiviser et que le titisme collectivise sans planifier. Les déduire aurait privé l'utilisateur de l'expérience même que le site existe pour produire.

Ils sont donc posés par défaut (constante TOUJOURS_POSES), et le questionnaire prévient avant de les laisser déduire. Il prévient, il n'interdit pas : imposer un choix pédagogique à quelqu'un qui a compris ce qu'il fait serait le même paternalisme que le projet reproche ailleurs. Coût : deux questions. C'est un jugement, pas un résultat — d'où sa présence en clair dans le code et ici, plutôt que dans un ajustement discret des seuils.

Pourquoi 3 ou 4 prédicteurs et pas 16#

Une première version de ce script réajustait chaque axe déduit sur les 16 axes posés. C'était une faute, et le résultat le montre sans ambiguïté :

Axe déduitavec 16 prédicteursavec 3-4 prédicteurs
cul-hierarchie-egalite0,1790,887
cul-intervention-religieuse0,1480,868
int-migration0,6720,878
etat-contrepouvoirs0,8230,912

À cet effectif, ajouter des prédicteurs dégrade la prédiction hors échantillon — jusqu'à la diviser par cinq dans le cas le plus net. Le modèle final sélectionne donc, axe par axe, le petit sous-ensemble de prédicteurs qui améliore réellement le R² LOO (au plus 4, gain minimal de 0,01 par ajout).

Bénéfice secondaire, décisif pour l'interface : une formule à 3 ou 4 termes peut être montrée à l'utilisateur. Une formule à 16 termes n'aurait été qu'une boîte noire de plus — exactement ce que ce projet reproche aux tests existants.

Deux observations intéressantes :

int-migration sont la paire à r = +0,90 confirmée sur CHES. Sur le corpus de 41 observations, le modèle posait le premier et déduisait le second avec cul-identite-nationale et etat-liberte-ordre pour principaux prédicteurs. Sur celui de 54, int-migration est toujours déduit, mais de cul-identite-nationale et cul-intervention-religieuse : des doctrines comme le trotskysme ou la Nouvelle Droite dissocient l'ordre public de la migration.

L'axe que la validation CHES avait le plus malmené se révèle l'un des plus informatifs pour prédire les autres. Il est conservé et posé.

Le plateau, et ce que l’élargissement du corpus y a changé#

Le gain marginal de chaque axe ajouté est publié plus haut sur cette page. Il s'effondre après les premiers axes : c'est ce plateau qui fixe le budget de questions, et non un choix d'ergonomie.

Sur les 25 doctrines seules, le gain devenait carrément négatif au-delà de sept axes posés — ajouter un prédicteur dégradait la prédiction croisée, signature du surajustement à faible effectif. L'élargissement du corpus a fait disparaître ce retournement, ce qui est en soi un argument pour continuer à l'élargir.

Le découpage appartient à l'utilisateur#

Ce que décrit ce qui précède est une proposition, pas un verdict. Dans le questionnaire, chaque axe porte un bouton : répondre soi-même, ou laisser estimer. Le partage de départ est celui que calcule outils/deduction.py ; tout est rebasculable, axe par axe, y compris les deux axes de l'exception éditoriale.

Conséquence directe : les coefficients ne peuvent pas être figés. Ils dépendent de l'ensemble des axes réellement répondus, qui change à chaque bascule. Le R² d'un axe n'est donc pas une propriété de cet axe.

Mesuré sur une version antérieure du corpus :

AxeDéduit des 21 autresAprès 13 déductions
eco-redistribution0,8690,651
eco-travail-capital0,7870,423
cul-intervention-religieuse0,7110,512

Un tableau de R² figé afficherait donc des valeurs systématiquement flatteuses. L'ajustement est refait sur place, dans le navigateur (outils/assets/modele.js), à partir du corpus embarqué avec la page.

Ce qui rend le recalcul possible dans un clic est la formule PRESS : le résidu de validation croisée s'obtient du résidu ordinaire par e_i,loo = e_i / (1 - h_ii), donc en un seul ajustement au lieu d'un par observation. Le résultat est exact, et non approché : comparé à la boucle de deduction.py sur 200 tirages, l'écart maximal est de l'ordre de 1e-14, c'est-à-dire la précision machine. Un recalcul complet des 22 axes prend environ 7 millisecondes.

Deux garde-fous sont dans le code parce qu'ils ne sont pas négociables :

sortent exclusivement des axes répondus. Sinon les erreurs se composent, et deux axes peuvent finir par se définir l'un l'autre.

de regarder le seuil. En pratique le procédé s'arrête bien plus tôt : en déduisant à chaque fois l'axe le mieux prédit, plus rien ne passe le seuil de 0,60 après six déductions, soit seize axes répondus sur le corpus de 54 observations, contre quinze sur celui de 41. Une version antérieure de cette page annonçait neuf, chiffre qu'aucun des deux corpus ne reproduit : le questionnaire peut perdre quelques questions, pas descendre à neuf.

Pourquoi l'interface n'affiche pas le R²#

Le R² est une moyenne sur le corpus. Il ne borne pas l'erreur individuelle. Mesuré en prédiction croisée sur les axes déduits par défaut :

Erreur absolue, échelle de −100 à +100Points
Médiane13
90e centile35
Maximum72

Mesures faites sur le corpus de septembre 2026 ; sur le précédent, le maximum était de 91 points. Il est atteint sur la contre-révolution catholique, pour l'ouverture aux migrations. Autrement dit, un axe annoncé à R² = 0,67 peut se tromper de 72 points sur un profil atypique — c'est-à-dire exactement sur les profils que ce site existe pour rendre visibles. Affiché à côté d'un curseur, « R² = 0,67 » se lit à tort comme « sûr à 67 % ».

L'interface annonce donc l'erreur en points, qui est l'unité du curseur : « erreur typique ± 13 points, jusqu'à ± 35 sur un profil atypique ». Le R² reste ici, sur cette page, où il est expliqué.

Effet plus discret, à connaître : une valeur déduite est une prédiction, donc tirée vers la moyenne. Les axes déduits perdent environ 10 % d'amplitude. Beaucoup déduire vous rend plus modéré, et plus ressemblant à une doctrine du corpus, que vous ne l'êtes.

D’où viennent les formules#

Le partage de départ et les R² publiés sont régénérés par outils/deduction.py et publiés dans data/deduction.json. Les formules effectivement utilisées dans le questionnaire sont recalculées dans le navigateur, pour le découpage que l'utilisateur a choisi, et affichées à côté de chaque estimation.

Règles d'affichage — non négociables#

Une déduction n'est pas une mesure. Dans l'interface :

  1. Une position déduite est toujours signalée comme telle, visuellement

distincte d'une position renseignée.

  1. Sa formule est affichée : les deux ou trois axes qui y contribuent le plus,

avec leur coefficient.

  1. Son coût est affiché, en points de l'échelle et non en R² : « erreur

typique ± 13 points, jusqu'à ± 35 sur un profil atypique ».

  1. Elle est reprise en un clic. Le bouton reste sur la carte de l'axe : un

axe déduit est grisé et non modifiable, jamais verrouillé.

  1. Les positions déduites sont exclues du calcul des distances aux doctrines

de référence — sans quoi on mesurerait la ressemblance entre le corpus et lui-même.

Limites — et elles sont sérieuses#

  1. Le modèle est ajusté sur notre corpus. Les coefficients encodent nos

propres positionnements. Déduire la position migratoire de quelqu'un depuis sa position sur les libertés publiques, c'est lui appliquer la structure idéologique de notre corpus. C'est défendable comme estimation par défaut, et indéfendable comme mesure — d'où la règle 4.

  1. La sélection et l'évaluation partagent les mêmes données. Même en

leave-one-out, le R² reste optimiste parce que le choix des axes a été fait sur ce corpus. Une validation nichée demanderait un corpus plus large.

  1. Le corpus est surtout composé de doctrines, pas de personnes. Les individus sont

généralement moins cohérents idéologiquement que les doctrines : les corrélations qui rendent la déduction possible sont probablement plus faibles chez les gens réels. La déduction est donc vraisemblablement moins fiable en usage qu'en test.

  1. L'effectif reste faible, sous le ratio observations/variables généralement

recommandé. C'est pourquoi chaque modèle final se limite à trois ou quatre prédicteurs : au-delà, la prédiction hors échantillon s'effondre.

À faire quand le corpus aura grandi : réajuster, et comparer les coefficients obtenus sur CHES pour les 17 axes qu'il couvre.

Pour aller plus loin

  • Party Policy in Modern Democracies
    Benoit, Kenneth, Laver, Michael · 2006 · papier · fiche
    Une discussion méthodologique frontale de la question centrale de ce projet : combien de dimensions faut-il pour décrire l'espace politique, et comment savoir qu'on n'en a pas invente. Les auteurs montrent que le nombre dépend du pays, ce qui doit rendre prudent sur toute réponse universelle.
  • Rovny, Jan, Bakker, Ryan, Hooghe, Liesbet, Jolly, Seth, Marks, Gary, Polk, Jonathan, Steenbergen, Marco, Vachudova, Milada Anna · 2025 · libre · fiche
    Le jeu de données qui sert de contre-test externe a tout le référentiel : des experts nationaux positionnent les partis européens sur une cinquantaine de variables, de 1999 a 2024. C'est ce qui permet de vérifier que les axes du projet ne sont pas une construction interne — et, dans deux cas, de constater qu'ils l'étaient. Diffusé sous licence CC-BY 4.0.