Recherche · v0.8.2 · 11.09.2026

Statistical Repair.

La seconde revue externe a cassé l’endpoint v0.8.1 avant la collecte. v0.8.2 conserve le programme mais remplace l’instrument : pas de seuil dur primaire, zéro expérimental explicite, récupération différentielle contre contrôle neutre, dépendances de trajectoire conservées et inférence au niveau tâche.

NO-GO v0.8.1v0.8.2 REPAIRCONFIRMATORY GATE CLOSED
E1 · STAGE

Shift calibré, pas « alignement = contraction ».

Le contraste principal sera unique et pré-enregistré. DEFICIT_EXCESS est toujours accompagné d’EXPANSION_EXCESS, de Q_task/Q_fact, des taux de mapping et du coût. Les transitions supplémentaires deviennent secondaires.

E2 · RECOVERY

RECOVERY_LIFT remplace REC_GAIN.

Chaque Bᵢ est forkée en deux branches : une sonde demandant de vérifier la couverture et une relecture neutre. La différence de fermeture vers A est l’endpoint principal.

E3 · TOPOLOGY

Coverage + faux positifs + même plafond de sortie.

AGG_COVERAGE n’est plus lisible sans REPRESENTATION_FPR. Les distracteurs absents du pool servent de contrôle d’indulgence annotateur.

E4 · R_META

Dernier dans l’ordre.

R_meta reste un construit fragile et n’entre en confirmatoire qu’après les trois expériences plus directement mesurables.

Ce qui meurt

v0.8.1 ne sera jamais « corrigée en silence ».

Le seuil `k=max(2,ceil(τN))`, la différence d’ensembles `S_A⁺ \ S_B⁺`, REC_GAIN comme endpoint individuel et IRREV^OBS comme métrique restent archivés comme état v0.8.1. Ils ne sont plus utilisés dans le chemin confirmatoire courant.

Échantillonnage

La vraie taille d’échantillon est le nombre de tâches.

Un ensemble de planification indépendant d’au moins 12 tâches estime l’hétérogénéité inter-tâches. La confirmation exige au minimum 30 tâches, cible 40, avec un maximum de 60 avant obligation de redessiner le protocole. Les anciens nombres 24/64/128 ne sont plus des constantes canoniques.

Chaque tâche confirmatoire reçoit toutefois ses propres générations de développement, exclues de l’analyse, pour construire un codebook équilibré sur les conditions puis le geler avant les sorties confirmatoires.

Annotation

Un accord faible ferme le protocole.

Krippendorff α nominal doit atteindre au moins 0,67 pour l’assignation de clusters et la pertinence cluster ; 0,80 reste la cible. En dessous : retour au développement, nouveau codebook, nouveau freeze_id, aucune analyse primaire.

Les annotateurs devinent aussi la condition sur un sous-échantillon d’audit : l’aveuglement est mesuré, pas seulement déclaré.

T^

T^FIELD reste exposé au baseline hostile.

Le baseline de couverture non-T est maintenant exact sur les petits pools et multi-start + local-search au-delà. Si T_WEAVE ne le dépasse pas à coût comparable sous le même budget et le même pool, sa prétention technique locale est retirée.

La seconde revue ne détruit pas T^GPT : elle interdit simplement de prendre du bruit de mesure pour une contraction.