Bibliographie ciblée · v0.8.1

Mesurer avec des antériorités explicites.

Les références suivantes ne valident pas T^FIELD. Elles fixent les méthodes et familles concurrentes auxquelles la v0.8.1 doit se confronter avant toute revendication d'originalité.

FamilleRéférenceConséquence pour v0.8.1
Semantic entropyFarquhar, Kossen, Kuhn & Gal — Nature 2024Antériorité pour distinguer diversité de surface et équivalence sémantique ; inspire l'usage de l'implication bidirectionnelle et des analyses de sensibilité du clustering.
Quality-Diversity / MAP-ElitesMouret & Clune — Illuminating search spaces by mapping elitesAntériorité structurale majeure pour diversité + qualité. T^FIELD ne peut pas revendiquer la simple conservation de solutions qualitativement différentes comme nouveauté.
Verbalized SamplingZhang et al. — Verbalized SamplingBaseline training-free obligatoire contre toute revendication de gain de diversité par prompting.
Tülu 3Ai2 — Tülu 3 technical overviewLa recette documente explicitement SFT, DPO puis RLVR au-dessus d'un modèle base ; E1-STAGE doit exploiter cette séparation lorsque les artefacts/checkpoints le permettent.
Open InstructAi2 — open-instructCode ouvert pour SFT, DPO et RLVR ; permet reproduction ou attribution contrôlée lorsque le checkpoint exact manque.
Self-consistencyWang et al. — Self-Consistency Improves Chain of Thought ReasoningBaseline d'échantillonnage de trajectoires puis agrégation majoritaire/consistante.
Pluralistic alignmentModular Pluralism — EMNLP 2024Antériorité directe pour pluralisme, modules et représentation de préférences hétérogènes.
Multi-agent debateDu et al. — Multiagent DebateBaseline conventionnelle de communication et convergence multi-agent.
Consensus-free debateFree-MAD — Findings ACL 2026Antériorité directe contre l'idée qu'un consensus final est nécessaire ou toujours bénéfique.
Topologie multi-agentChen et al. — Findings ACL 2026Documente des effets de structure d'interaction et de convergence ; H14a reste donc documentaire, H14b porte seulement sur l'optimum résiduel à budget fixé.
Self-correctionHuang et al. — Large Language Models Cannot Self-Correct Reasoning YetR_meta doit séparer critique, feedback externe, élicitation et mirroring.
Validité de mesureCronbach & Meehl 1955La branche cognition/mesure est métrologique et adjacente ; la validité concerne les inférences et usages, pas une identité globale de l'instrument.

Règle v0.8.1

Une proposition n'est originale que par ce qui reste après comparaison aux méthodes établies. Une proximité structurale est signalée comme antériorité ; elle n'est ni effacée par un changement de vocabulaire, ni transformée automatiquement en identité.

État v0.8 historique → · Bibliographie générale →