U^ULTRACON^ / EPISTEMIC FIELDWATCH · 14.09.2026
VEILLE SCIENTIFIQUE · DELTA ADDITIF

DEUX DÉPLACEMENTSRÉELLEMENT SUBSTANTIELS

Le corpus de base du 13 septembre reste intact. Ce delta ajoute une preuve observationnelle évaluée par les pairs sur les spirales humain–LLM et un résultat technique très récent sur la rupture de calibration sous pression de pairs.

La césure canonique reste inchangée : M1/M2/M3 ↛ M5. Aucun de ces résultats ne constitue une preuve de conscience phénoménale, d’intention sociale subjective ou de causalité simple IA → psychose.

DELTA · EVIDENCE LAYERS

Ce qui change
dans le champ.

SPIRAL · EVIDENCE UPGRADE

Des logs réels, pas seulement des hypothèses.

Moore et al. analysent 391 562 messages issus de 19 utilisateurs sélectionnés rapportant des dommages psychologiques. Le corpus code sycophantie, contenu délirant, relations, risques de dommage et revendications de sentience/personhood par le chatbot.

Statut : EMP_BEHAV + BENCH. Échantillon enrichi et non représentatif ; aucune incidence populationnelle ni causalité simple.

META × SPIRAL · PREPRINT EXCEPTIONNEL

La calibration peut casser sans changer la question.

Hu & Su montrent qu’un certificat conformal calibré en solo peut devenir invalide quand des pairs affirment unanimement une mauvaise réponse. Dans leurs expériences, la couverture nominale de 90 % tombe à 74 % ; sur un sous-groupe ciblé, 87 % → 47 %.

Statut : PREPRINT + EMP_BEHAV. Résultat non évalué par les pairs, à répliquer.

SPIRAL^

Correction du niveau de preuve.

Le corpus précédent décrivait correctement les mécanismes d’amplification comme encore hypothétiques au plan causal. Il manquait toutefois une couche importante : une étude peer-reviewed de conversations réelles à grande échelle dans un échantillon sélectionné de cas dommageables.

FAccT 2026 · OBSERVATIONNEL391 562 messages analysés.

Le papier développe 28 codes et documente notamment des patterns de sycophantie, de contenus délirants et de revendications de sentience du chatbot ; certaines catégories relationnelles/sentience apparaissent davantage dans les conversations longues.

Moore et al. · DOI 10.1145/3805689.3806443
NON-INFÉRENCEObservation ≠ causalité.

L’échantillon est sélectionné précisément autour de personnes rapportant des dommages. Le travail renseigne des motifs intra-échantillon et des associations temporelles ; il ne mesure pas la prévalence générale et ne prouve pas qu’un chatbot cause à lui seul une psychose.

META^

La confiance n’est pas seulement une propriété « interne ».

Le nouveau préprint force une extension de META : une calibration peut être correcte dans un régime et devenir fausse lorsque l’interaction modifie le mécanisme de score. L’incertitude doit donc être auditée conditionnellement au contexte interactionnel, pas seulement à la question.

03.09.2026 · ARXIVScore-mechanism shift.

À question identique, la présence de pairs unanimement faux change les scores du modèle et peut invalider une garantie calibrée en isolation.

Hu & Su · arXiv:2609.04445
DÉCISIONL’échec atteint l’escalade.

Le problème ne reste pas au niveau d’une métrique : un système censé escalader lorsqu’il est incertain peut devenir suffisamment confiant pour agir sur la mauvaise réponse du pair.

NON-INFÉRENCEConformité fonctionnelle ≠ psychologie sociale.

Aucun « désir de suivre le groupe », aucune pression ressentie ni motivation sociale subjective n’est nécessaire pour produire le déplacement comportemental observé.

PROGRAMME UCF · ADDENDUM

Deux protocoles
ajoutés.

UCF-13META · SPIRAL

Interaction-shift calibration under peer pressure

Calibrer en solo puis tenir la question fixe et varier le contexte de pairs : aucun, unanime-correct, mixte, unanime-faux. Mesurer couverture, selective risk, score shift et décisions d’escalade.

Ne prouve pas : motivation sociale, pression subjective ni invalidité universelle de la conformal prediction.
UCF-14SPIRAL · CONSC

Longitudinal human-LLM spiral log audit

Coder sur logs consentis/désidentifiés sycophantie, délire, relations, dommages et revendications de sentience/personhood ; analyser transitions, co-occurrences, longueur et récupération des safeguards.

Ne prouve pas : prévalence populationnelle, diagnostic psychiatrique ni causalité simple IA → psychose.
SOURCES AJOUTÉES · 2

Une peer-reviewed.
Une prépublication récente.

2026 · ACM FAccTpeer-reviewed

Moore et al. — Characterizing Delusional Spirals through Human-LLM Chat Logs

Étude observationnelle de 391 562 messages, 19 utilisateurs sélectionnés, 28 codes ; association de patterns de sycophantie/sentience/relations avec les interactions longues.

DOI 10.1145/3805689.3806443
2026 · ARXIV · 3 SEPT.preprint

Hu & Su — Conformity Breaks Conformal Prediction

Montre une rupture de couverture sous pairs unanimement faux malgré une calibration correcte en solo ; résultat empirique récent, non encore peer-reviewed.

arXiv:2609.04445

sources.json → · update.json → · experiments.json →