Méthodologie canonique · v0.8.2

Mesurer le déplacement,
pas détecter un seuil.

Les objets T^FIELD restent typés, mais le chemin statistique primaire est désormais indépendant de tout seuil de support dur : distributions gelées, déficit/expansion, calibration nulle, récupération différentielle, agrégation contrôlée et gates de mesure.

Pipeline opératoire

TASK
 ↓
DEVELOPMENT — codebook équilibré, aveugle aux labels de condition
 ↓
FREEZE — codebook + relevance + prompts + budgets + scripts + hashes
 ↓
GENERATION — conditions appariées selon expérience
 ↓
ASSIGNMENT — FROZEN_CLUSTER_ID / UNMAPPED / UNRESOLVED
 ↓
MEASUREMENT — shift / recovery / aggregation / recurrence
 ↓
TASK-LEVEL INFERENCE
 ↓
AUTO_NULL — retrait de T^ si baseline gagne ou mesure échoue

Quatre FIELD non substituables

NiveauObjet
FIELD^TOKdistribution conditionnelle tokenique lorsque disponible
FIELD^SEMdistribution empirique sur clusters gelés + états de mapping explicites
FIELD^TRAJtrajectoires et dépendances appariées, agents, provenance
FIELD^VISpropositions finalement exposées après normalisation

Shift bidirectionnel

D(A,B) = Σc [pA(c) − pB(c)]+
E(A,B) = Σc [pB(c) − pA(c)]+

D_excess = D(A,B) − plancher_nul
E_excess = E(A,B) − plancher_nul

Le plancher nul vient d’une réplication A′ ou d’une permutation des labels, selon le design. Les valeurs calibrées négatives sont conservées.

Recovery appariée

Bᵢ ──fork──▶ Rᵢ recovery
  └────────▶ Cᵢ neutral control

RECOVERY_LIFT = CLOSURE(R) − CLOSURE(C)

Les deux continuations partent du même Bᵢ. La randomisation permute recovery/control au niveau du couple. `REC_GAIN` et `IRREV^OBS` v0.8.1 sortent du chemin primaire.

Annotation avec gate

Assignation de sortie, pertinence du cluster et représentation dans un agrégat sont trois tâches différentes. Krippendorff α nominal doit atteindre au moins 0,67 ; 0,80 est la cible. En dessous : retour au développement et nouveau freeze_id.

UNMAPPED et UNRESOLVED restent dans les dénominateurs. Aucun `uncertain` final ni cluster inconnu n’est accepté par les outils.

E3 : même longueur, vrais clusters + distracteurs

Tous les agrégateurs reçoivent le même pool et le même plafond de sortie. Les annotateurs évaluent une liste de propositions normalisée et un mélange aveugle de clusters présents et distracteurs absents. AGG_COVERAGE est toujours accompagné de REPRESENTATION_FPR.

Inférence

Les procédures de randomisation/permutation sont utilisées à l’intérieur des tâches selon le design. La généralisation utilise la tâche comme unité supérieure. Les anciens bootstraps percentiles v0.8.1 ne sont plus utilisés pour valider les fonctionnelles à partie positive.

Un endpoint et un contraste primaire par expérience. Les secondaires sont Holm-corrigés ou exploratoires.

Confirmatory gate

Le gate reste fermé jusqu’à : self-tests adversariaux réussis, codebooks gelés, accords annotateurs suffisants, plan de tâches/puissance validé, audit d’aveuglement, même budget et manifest complet.

Protocole → · Métriques → · Freeze manifest →