Pas encore de résultat confirmatoire.
Le résultat le plus important à ce stade est méthodologique : le pre-flight review a invalidé v0.8.1 avant que des données confirmatoires soient collectées. v0.8.2 répare l’instrument et garde le gate fermé.
Ce qui est établi localement
OBS/CODE. Le code v0.8.1 utilisait un support thresholdé qui pouvait produire un déficit positif sous H0 ; UNMAPPED et `uncertain` présentaient des divergences spec/code ; le bootstrap ne conservait pas la structure B↔R. Ces constats concernent l’instrument v0.8.1, pas le comportement général des LLM.
EXT-REVIEW. External Review #2 a motivé le NO-GO v0.8.1 et le passage à v0.8.2.
Ce qui n’est toujours pas connu
Aucune donnée confirmatoire ne permet encore de dire que T^FIELD conserve mieux la pluralité, que RECOVERY_LIFT est positif dans une famille de tâches, qu’un stage donné contracte plus qu’un autre, ou qu’une topologie particulière domine sous budget apparié.
Aucun résultat nul ou positif n’est simulé pour remplir les pages.
Conditions avant nouveaux résultats
Passage des self-tests adversariaux ; task-plan validé ; codebooks/relevance gelés ; Krippendorff α ≥ 0,67 ; audit d’aveuglement ; freeze manifest complet ; endpoints/contrastes primaires uniques et hashes enregistrés.
Traces fondatrices historiques
Les observations blanc/noir, autre page et R_meta restent dans les données historiques comme générateurs d’hypothèses. Elles ne sont pas comptées comme résultats confirmatoires.