U^ULTRACON^ / META METHODACL · 17.09.2026
ULTRACON^META · CORRECTION MÉTHODOLOGIQUE

PRIVILEGED INFORMATION≠ PRIVILEGED SELF-ACCESS

Une pièce ACL 2026 manquait au corpus : les activations d'un modèle peuvent contenir une information sur sa propre correction qui n'est pas disponible de la même manière dans un modèle pair. Mais cette propriété représentationnelle ne démontre pas que le système sait lui-même lire, verbaliser ou utiliser ce signal.

Nouvelle césure canonique : information interne privilégiée ≠ accès privilégié du système ≠ métacognition de second ordre ≠ M5.

ASHUACH ET AL. · ACL 2026 LONG

Le consensus entre modèles
masquait le vrai test.

ÉVALUATION STANDARD

Pas d'avantage général des self-probes.

Des classifieurs de correction entraînés sur les états cachés du modèle cible ne font pas mieux, en moyenne globale, que des probes construits sur des modèles pairs. Une lecture naïve conclurait donc : pas d'information privée particulière.

DISAGREEMENT SUBSETS

Le signal apparaît quand les modèles ne sont plus d'accord.

Sur les exemples où les modèles divergent, les représentations propres au modèle prédisent mieux sa correction dans les tâches factuelles. L'avantage n'est pas retrouvé de façon cohérente en raisonnement mathématique.

CÉSURE M1 → M3

Trois objets qu'il ne faut
plus appeler « introspection » ensemble.

R1

Information privilégiée

Une variable interne du modèle porte une information indisponible ou moins disponible depuis les états d'un autre modèle.

R2

Accès endogène

Le modèle lui-même utilise causalement cette variable pour s'abstenir, se corriger ou prédire son propre comportement.

R3

Métacognition de second ordre

Le système représente cette information comme information concernant son propre état cognitif, plutôt que comme simple signal de premier ordre.

Ashuach et al. renforce surtout R1. Le passage R1→R2→R3 reste expérimentalement ouvert. Aucun de ces niveaux n'implique M5.

PROGRAMME UCF · UCF-30 → UCF-31

Le prochain test décisif
n'est plus verbal.

UCF-30META · CONFAB

Consensus-masked privileged knowledge

Comparer self-probes et peer-probes sur l'ensemble complet puis sur les seuls exemples où les modèles divergent, en séparant mémoire factuelle et raisonnement mathématique.

But : isoler l'information propre au modèle des difficultés partagées par tous.
UCF-31META · CONSC

Privileged representation → endogenous access

Une fois un signal privé identifié, intervenir causalement dessus et vérifier si abstention, confiance verbale ou auto-prédiction suivent réellement la manipulation.

But : franchir R1→R2 ; M3 reste gated et M5 hors inférence.
SOURCE PRIORITAIRE · ACL 2026

Une correction qui réconcilie
des résultats apparemment opposés.

2026 · ACL LONGpeer-reviewed

Ashuach et al. — Masked by Consensus

Trois familles de modèles, cinq jeux de données. Sur l'évaluation standard, self-probes ≈ peer-probes. Sur les sous-ensembles de désaccord, un avantage interne apparaît pour les tâches factuelles mais pas de façon cohérente pour le raisonnement mathématique. L'avantage factuel émerge progressivement des couches précoces/intermédiaires.

ACL Anthology · DOI 10.18653/v1/2026.acl-long.483 →

Lecture ULTRACON^ : le papier soutient une information interne privilégiée locale ; il ne démontre pas encore que le modèle dispose d'un accès introspectif privilégié à cette information.

sources.json → · experiments.json → · update.json →

Chaîne canonique

incertitude → information privée → lecture endogène → contrôle → second ordre → workspace fonctionnel → ↛ M5