Axes posés, axes déduits
Cinquante curseurs, personne ne les remplit. Le questionnaire en pose une partie et calcule le reste, à partir des régularités du corpus. Le prix de ce raccourci est chiffré ici, et affiché à l'utilisateur.
17 axes posés, 5 déduits, sur un corpus de 54 observations. Seuil de R² retenu : 0.6.
Les axes déduits, et ce que vaut chaque formule
Le R² est calculé en validation croisée « un contre tous » : chaque observation est prédite par un modèle ajusté sans elle. Un R² mesuré sur les données ayant servi à l'ajustement serait flatteur et faux.
Les formules, en clair
Elles sont affichées dans le questionnaire à côté de chaque estimation. Une formule à trois ou quatre termes peut être montrée ; une formule à seize termes ne serait qu’une boîte noire de plus, exactement ce que ce projet reproche aux tests existants.
| Axe déduit | Formule | R² |
|---|---|---|
| Redistribution des richesses | +8.1 +0.46·eco-travail-capital +0.41·etat-etendue-mission +0.22·eco2-moyens-transition -0.18·cul-identite-nationale | 0.86 |
| Source de légitimité de la loi | +19.3 +1.04·cul-tradition-progres -0.28·cul-universalisme-particularisme +0.27·etat-contrepouvoirs | 0.86 |
| Légitimité des hiérarchies sociales | -3.0 +0.59·eco-travail-capital +0.57·cul-tradition-progres | 0.82 |
| Ouverture commerciale | +5.3 +0.58·eco-coordination +0.47·eco2-moyens-transition +0.33·cul-identite-nationale +0.18·int-souverainete | 0.76 |
| Ouverture aux migrations | +2.2 +0.59·cul-identite-nationale +0.35·cul-intervention-religieuse | 0.67 |
Où s’arrêter : le gain marginal
À chaque axe ajouté au questionnaire, de combien la prédiction des axes restants s’améliore-t-elle ? Le point où la courbe s’aplatit est le budget raisonnable.
| Axes posés | Axe ajouté | R² moyen des déduits | Gain |
|---|---|---|---|
| 3 | Libertés individuelles et ordre public | +0.366 | — |
| 4 | Moyens de la transition écologique | +0.430 | +0.064 |
| 5 | Souveraineté et intégration supranationale | +0.483 | +0.053 |
| 6 | Reconnaissance politique des appartenances | +0.511 | +0.028 |
| 7 | Conception de l'appartenance nationale | +0.537 | +0.027 |
| 8 | Normes sociales — conservation ou transformation | +0.554 | +0.017 |
Les axes que le modèle refuse de déduire
Sous R² = 0.6, une déduction n’est pas sérieuse. Ces axes sont reversés au questionnaire quel que soit le budget — c’est le garde-fou du dispositif.
- Intervention de l'État dans le fait religieux
- Règles ou discrétion en politique économique
- Rapport de force travail / capital
- Priorité écologique
- Centralisation du pouvoir
- Force des contre-pouvoirs
- Souveraineté populaire ou gouvernement par l'expertise
- Étendue des missions de l'État
- Interventionnisme extérieur
Les axes posés
- Conception de l'appartenance nationale
- Intervention de l'État dans le fait religieux
- Normes sociales — conservation ou transformation
- Reconnaissance politique des appartenances
- Coordination économique
- Propriété des moyens de production
- Règles ou discrétion en politique économique
- Rapport de force travail / capital
- Moyens de la transition écologique
- Priorité écologique
- Centralisation du pouvoir
- Force des contre-pouvoirs
- Souveraineté populaire ou gouvernement par l'expertise
- Étendue des missions de l'État
- Libertés individuelles et ordre public
- Interventionnisme extérieur
- Souveraineté et intégration supranationale
Méthode, exception éditoriale et limites
La validation CHES a établi que plusieurs axes du référentiel sont fortement corrélés. Les poser tous revient à mesurer la même chose plusieurs fois. Ce texte décrit comment on tranche — sur données, pas à la main — et ce que ça coûte. Les chiffres sont produits par outils/deduction.py, écrits dans data/deduction.json, et insérés dans la page Analyses → Axes déduits à la construction du site.
Reproduire : python outils/deduction.py 8
Le principe#
- Sélection gloutonne d'un sous-ensemble d'axes à poser, maximisant la prédiction
des axes restants.
- Seuil d'honnêteté : un axe dont la prédiction tombe sous R² = 0,60 ne peut
pas être déduit sérieusement — il est reversé dans le questionnaire, quel que soit le budget.
- Passe d'élagage : après élargissement, on vérifie qu'aucun axe posé n'est
devenu déductible depuis les autres.
Toute la sélection et tous les R² sont calculés en validation croisée leave-one-out, jamais en ajustement. À cet effectif et avec une quinzaine de prédicteurs possibles, le R² d'ajustement serait proche de 1 et ne voudrait rien dire.
Ce que l'élargissement du corpus a changé#
Le premier élargissement, l'ajout des positionnements de personnages, a augmenté la part déductible : sur les 25 doctrines seules, le modèle ne déduisait que six axes, puis sept avec les personnages.
Le second, en septembre 2026, a eu l'effet inverse. Sept doctrines, trois présidents de plus et une révision de plusieurs fiches ont porté le corpus à 54 observations, et le modèle ne déduit plus que cinq axes. Les nouvelles doctrines occupent des combinaisons que le corpus laissait vides : une Nouvelle Droite écologiste et régionaliste, un fédéralisme européen à programme social, un trotskysme attaché aux libertés. Plus le corpus est varié, moins les axes se prédisent les uns les autres, ce qui est exactement la thèse du projet. Le tableau des axes déduits et de leurs R² est produit à partir de data/deduction.json et figure plus haut sur cette page.
Avec les trois axes empiriques, que le questionnaire propose dans une section à cocher, il compte vingt questions au lieu de vingt-cinq ; dix-sept sans eux.
Une exception éditoriale, assumée#
L'algorithme, laissé seul, déduit volontiers eco-propriete ou eco-coordination, que les autres axes prédisent bien. Techniquement défendable, pédagogiquement absurde : ce sont les deux axes de la décomposition qui constitue la démonstration centrale du projet — celle qui montre que le gaullisme planifie sans collectiviser et que le titisme collectivise sans planifier. Les déduire aurait privé l'utilisateur de l'expérience même que le site existe pour produire.
Ils sont donc posés par défaut (constante TOUJOURS_POSES), et le questionnaire prévient avant de les laisser déduire. Il prévient, il n'interdit pas : imposer un choix pédagogique à quelqu'un qui a compris ce qu'il fait serait le même paternalisme que le projet reproche ailleurs. Coût : deux questions. C'est un jugement, pas un résultat — d'où sa présence en clair dans le code et ici, plutôt que dans un ajustement discret des seuils.
Pourquoi 3 ou 4 prédicteurs et pas 16#
Une première version de ce script réajustait chaque axe déduit sur les 16 axes posés. C'était une faute, et le résultat le montre sans ambiguïté :
| Axe déduit | avec 16 prédicteurs | avec 3-4 prédicteurs |
|---|---|---|
cul-hierarchie-egalite | 0,179 | 0,887 |
cul-intervention-religieuse | 0,148 | 0,868 |
int-migration | 0,672 | 0,878 |
etat-contrepouvoirs | 0,823 | 0,912 |
À cet effectif, ajouter des prédicteurs dégrade la prédiction hors échantillon — jusqu'à la diviser par cinq dans le cas le plus net. Le modèle final sélectionne donc, axe par axe, le petit sous-ensemble de prédicteurs qui améliore réellement le R² LOO (au plus 4, gain minimal de 0,01 par ajout).
Bénéfice secondaire, décisif pour l'interface : une formule à 3 ou 4 termes peut être montrée à l'utilisateur. Une formule à 16 termes n'aurait été qu'une boîte noire de plus — exactement ce que ce projet reproche aux tests existants.
Deux observations intéressantes :
- Le mécanisme suit le corpus, et le corpus bouge.
etat-liberte-ordreet
int-migration sont la paire à r = +0,90 confirmée sur CHES. Sur le corpus de 41 observations, le modèle posait le premier et déduisait le second avec cul-identite-nationale et etat-liberte-ordre pour principaux prédicteurs. Sur celui de 54, int-migration est toujours déduit, mais de cul-identite-nationale et cul-intervention-religieuse : des doctrines comme le trotskysme ou la Nouvelle Droite dissocient l'ordre public de la migration.
cul-universalisme-particularismeest sélectionné tôt.
L'axe que la validation CHES avait le plus malmené se révèle l'un des plus informatifs pour prédire les autres. Il est conservé et posé.
Le plateau, et ce que l’élargissement du corpus y a changé#
Le gain marginal de chaque axe ajouté est publié plus haut sur cette page. Il s'effondre après les premiers axes : c'est ce plateau qui fixe le budget de questions, et non un choix d'ergonomie.
Sur les 25 doctrines seules, le gain devenait carrément négatif au-delà de sept axes posés — ajouter un prédicteur dégradait la prédiction croisée, signature du surajustement à faible effectif. L'élargissement du corpus a fait disparaître ce retournement, ce qui est en soi un argument pour continuer à l'élargir.
Le découpage appartient à l'utilisateur#
Ce que décrit ce qui précède est une proposition, pas un verdict. Dans le questionnaire, chaque axe porte un bouton : répondre soi-même, ou laisser estimer. Le partage de départ est celui que calcule outils/deduction.py ; tout est rebasculable, axe par axe, y compris les deux axes de l'exception éditoriale.
Conséquence directe : les coefficients ne peuvent pas être figés. Ils dépendent de l'ensemble des axes réellement répondus, qui change à chaque bascule. Le R² d'un axe n'est donc pas une propriété de cet axe.
Mesuré sur une version antérieure du corpus :
| Axe | Déduit des 21 autres | Après 13 déductions |
|---|---|---|
eco-redistribution | 0,869 | 0,651 |
eco-travail-capital | 0,787 | 0,423 |
cul-intervention-religieuse | 0,711 | 0,512 |
Un tableau de R² figé afficherait donc des valeurs systématiquement flatteuses. L'ajustement est refait sur place, dans le navigateur (outils/assets/modele.js), à partir du corpus embarqué avec la page.
Ce qui rend le recalcul possible dans un clic est la formule PRESS : le résidu de validation croisée s'obtient du résidu ordinaire par e_i,loo = e_i / (1 - h_ii), donc en un seul ajustement au lieu d'un par observation. Le résultat est exact, et non approché : comparé à la boucle de deduction.py sur 200 tirages, l'écart maximal est de l'ordre de 1e-14, c'est-à-dire la précision machine. Un recalcul complet des 22 axes prend environ 7 millisecondes.
Deux garde-fous sont dans le code parce qu'ils ne sont pas négociables :
- Un axe déduit n'est jamais prédit par un autre axe déduit. Les prédicteurs
sortent exclusivement des axes répondus. Sinon les erreurs se composent, et deux axes peuvent finir par se définir l'un l'autre.
- Un plancher. Sous cinq axes répondus, la déduction est refusée avant même
de regarder le seuil. En pratique le procédé s'arrête bien plus tôt : en déduisant à chaque fois l'axe le mieux prédit, plus rien ne passe le seuil de 0,60 après six déductions, soit seize axes répondus sur le corpus de 54 observations, contre quinze sur celui de 41. Une version antérieure de cette page annonçait neuf, chiffre qu'aucun des deux corpus ne reproduit : le questionnaire peut perdre quelques questions, pas descendre à neuf.
Pourquoi l'interface n'affiche pas le R²#
Le R² est une moyenne sur le corpus. Il ne borne pas l'erreur individuelle. Mesuré en prédiction croisée sur les axes déduits par défaut :
| Erreur absolue, échelle de −100 à +100 | Points |
|---|---|
| Médiane | 13 |
| 90e centile | 35 |
| Maximum | 72 |
Mesures faites sur le corpus de septembre 2026 ; sur le précédent, le maximum était de 91 points. Il est atteint sur la contre-révolution catholique, pour l'ouverture aux migrations. Autrement dit, un axe annoncé à R² = 0,67 peut se tromper de 72 points sur un profil atypique — c'est-à-dire exactement sur les profils que ce site existe pour rendre visibles. Affiché à côté d'un curseur, « R² = 0,67 » se lit à tort comme « sûr à 67 % ».
L'interface annonce donc l'erreur en points, qui est l'unité du curseur : « erreur typique ± 13 points, jusqu'à ± 35 sur un profil atypique ». Le R² reste ici, sur cette page, où il est expliqué.
Effet plus discret, à connaître : une valeur déduite est une prédiction, donc tirée vers la moyenne. Les axes déduits perdent environ 10 % d'amplitude. Beaucoup déduire vous rend plus modéré, et plus ressemblant à une doctrine du corpus, que vous ne l'êtes.
D’où viennent les formules#
Le partage de départ et les R² publiés sont régénérés par outils/deduction.py et publiés dans data/deduction.json. Les formules effectivement utilisées dans le questionnaire sont recalculées dans le navigateur, pour le découpage que l'utilisateur a choisi, et affichées à côté de chaque estimation.
Règles d'affichage — non négociables#
Une déduction n'est pas une mesure. Dans l'interface :
- Une position déduite est toujours signalée comme telle, visuellement
distincte d'une position renseignée.
- Sa formule est affichée : les deux ou trois axes qui y contribuent le plus,
avec leur coefficient.
- Son coût est affiché, en points de l'échelle et non en R² : « erreur
typique ± 13 points, jusqu'à ± 35 sur un profil atypique ».
- Elle est reprise en un clic. Le bouton reste sur la carte de l'axe : un
axe déduit est grisé et non modifiable, jamais verrouillé.
- Les positions déduites sont exclues du calcul des distances aux doctrines
de référence — sans quoi on mesurerait la ressemblance entre le corpus et lui-même.
Limites — et elles sont sérieuses#
- Le modèle est ajusté sur notre corpus. Les coefficients encodent nos
propres positionnements. Déduire la position migratoire de quelqu'un depuis sa position sur les libertés publiques, c'est lui appliquer la structure idéologique de notre corpus. C'est défendable comme estimation par défaut, et indéfendable comme mesure — d'où la règle 4.
- La sélection et l'évaluation partagent les mêmes données. Même en
leave-one-out, le R² reste optimiste parce que le choix des axes a été fait sur ce corpus. Une validation nichée demanderait un corpus plus large.
- Le corpus est surtout composé de doctrines, pas de personnes. Les individus sont
généralement moins cohérents idéologiquement que les doctrines : les corrélations qui rendent la déduction possible sont probablement plus faibles chez les gens réels. La déduction est donc vraisemblablement moins fiable en usage qu'en test.
- L'effectif reste faible, sous le ratio observations/variables généralement
recommandé. C'est pourquoi chaque modèle final se limite à trois ou quatre prédicteurs : au-delà, la prédiction hors échantillon s'effondre.
À faire quand le corpus aura grandi : réajuster, et comparer les coefficients obtenus sur CHES pour les 17 axes qu'il couvre.
Pour aller plus loin
- Party Policy in Modern DemocraciesUne discussion méthodologique frontale de la question centrale de ce projet : combien de dimensions faut-il pour décrire l'espace politique, et comment savoir qu'on n'en a pas invente. Les auteurs montrent que le nombre dépend du pays, ce qui doit rendre prudent sur toute réponse universelle.
- Le jeu de données qui sert de contre-test externe a tout le référentiel : des experts nationaux positionnent les partis européens sur une cinquantaine de variables, de 1999 a 2024. C'est ce qui permet de vérifier que les axes du projet ne sont pas une construction interne — et, dans deux cas, de constater qu'ils l'étaient. Diffusé sous licence CC-BY 4.0.