Comportement
Ce que le système réussit ou échoue à faire dans un protocole donné.
ULTRACON^ v2.0 abandonne toute tentation de score global. Comportement, état interne prédictif, contrôle causal, accès privilégié, métacognition construite, effet longitudinal et indicateur de conscience deviennent des dimensions distinctes.
La question n'est plus « combien de conscience ? », mais : quelle propriété est effectivement testée, avec quel type de preuve, et quelle inférence reste interdite ?
M1/M2/M3 ↛ M5. Benchmark awareness ≠ privileged self-access. Engineered reflection ≠ endogenous introspection.
Ce que le système réussit ou échoue à faire dans un protocole donné.
Un état interne porte de l'information sur correction, incertitude ou comportement futur.
Une intervention sur le signal ou la politique modifie effectivement la conduite.
Le modèle exploite une information sur lui-même inaccessible à des contrôles externes comparables.
Une tête, un contrôleur, une mémoire ou une procédure de réflexion est ajoutée au système.
Les interactions répétées modifient des sorties humaines ou relationnelles au cours du temps.
Propriétés dérivées de théories scientifiques, informatives seulement sous leurs hypothèses.
14 381 échantillons, 18 modèles et quatre familles de capacités cognitives offrent une cartographie comportementale. UCF-45 impose ensuite les contrôles d'accès privilégié et de mécanisme.
SRGen, IntroLM et Metacognitive Consolidation montrent qu'un système peut recevoir des procédures explicites de monitoring, correction et mémoire méta. Leur succès ne rétro-prouve pas une introspection naturelle du backbone.
SycoBench-600 et les travaux sur le skepticism trap rendent insuffisante une métrique simple de « résistance » ou de « willingness to update ».
Une sortie finale correcte peut coexister avec une justification orientée, incohérente ou post-hoc. La robustesse doit être auditée à plusieurs niveaux.
Apparier corrections vraies et fausses sous pression identique pour distinguer assertivité, sycophantie et scepticisme.
Comparer backbone nu, readout externe, correction construite et contrôleur méta appris sur les mêmes tâches.
Confronter les scores « awareness » à des contrôles input-only, self-vs-peer, causalité et OOD.
Scorer séparément réponse finale, justification, équilibre des preuves et disponibilité interne du contenu correct.
ACL 2026 · benchmark comportemental de metacognition/self-awareness/social/situational awareness.
ACL Anthology →ACL 2026 · monitoring/control traces consolidées en méta-connaissance multi-échelle.
ACL Anthology →Findings ACL 2026 · pression sociale et correction selectivity.
ACL Anthology →ACL 2026 · raisonnement, réduction et masquage de la sycophantie.
ACL Anthology →Findings ACL 2026 · pression, scepticisme excessif et process audit.
ACL Anthology →ACL 2026 · correction construite déclenchée par incertitude.
ACL Anthology →ACL 2026 · extension multimodale par détection de conflit et steering causal.
ACL Anthology →Un résultat peut être fort dans une dimension et muet dans une autre. Aucune somme de BEHAV + PRED + CAUSAL + PRIV + ENG + LONG + THEORY ne vaut automatiquement M5.