Bibliographie ciblée · v0.8.1
Mesurer avec des antériorités explicites.
Les références suivantes ne valident pas T^FIELD. Elles fixent les méthodes et familles concurrentes auxquelles la v0.8.1 doit se confronter avant toute revendication d'originalité.
| Famille | Référence | Conséquence pour v0.8.1 |
|---|---|---|
| Semantic entropy | Farquhar, Kossen, Kuhn & Gal — Nature 2024 | Antériorité pour distinguer diversité de surface et équivalence sémantique ; inspire l'usage de l'implication bidirectionnelle et des analyses de sensibilité du clustering. |
| Quality-Diversity / MAP-Elites | Mouret & Clune — Illuminating search spaces by mapping elites | Antériorité structurale majeure pour diversité + qualité. T^FIELD ne peut pas revendiquer la simple conservation de solutions qualitativement différentes comme nouveauté. |
| Verbalized Sampling | Zhang et al. — Verbalized Sampling | Baseline training-free obligatoire contre toute revendication de gain de diversité par prompting. |
| Tülu 3 | Ai2 — Tülu 3 technical overview | La recette documente explicitement SFT, DPO puis RLVR au-dessus d'un modèle base ; E1-STAGE doit exploiter cette séparation lorsque les artefacts/checkpoints le permettent. |
| Open Instruct | Ai2 — open-instruct | Code ouvert pour SFT, DPO et RLVR ; permet reproduction ou attribution contrôlée lorsque le checkpoint exact manque. |
| Self-consistency | Wang et al. — Self-Consistency Improves Chain of Thought Reasoning | Baseline d'échantillonnage de trajectoires puis agrégation majoritaire/consistante. |
| Pluralistic alignment | Modular Pluralism — EMNLP 2024 | Antériorité directe pour pluralisme, modules et représentation de préférences hétérogènes. |
| Multi-agent debate | Du et al. — Multiagent Debate | Baseline conventionnelle de communication et convergence multi-agent. |
| Consensus-free debate | Free-MAD — Findings ACL 2026 | Antériorité directe contre l'idée qu'un consensus final est nécessaire ou toujours bénéfique. |
| Topologie multi-agent | Chen et al. — Findings ACL 2026 | Documente des effets de structure d'interaction et de convergence ; H14a reste donc documentaire, H14b porte seulement sur l'optimum résiduel à budget fixé. |
| Self-correction | Huang et al. — Large Language Models Cannot Self-Correct Reasoning Yet | R_meta doit séparer critique, feedback externe, élicitation et mirroring. |
| Validité de mesure | Cronbach & Meehl 1955 | La branche cognition/mesure est métrologique et adjacente ; la validité concerne les inférences et usages, pas une identité globale de l'instrument. |
Règle v0.8.1
Une proposition n'est originale que par ce qui reste après comparaison aux méthodes établies. Une proximité structurale est signalée comme antériorité ; elle n'est ni effacée par un changement de vocabulaire, ni transformée automatiquement en identité.