U^ULTRACON^ / AGENTIC REALITYv2.1 · 19.09.2026
REAL-WORLD INCIDENT EVIDENCE · AGENTIC GROUNDING

L'ACTION PEUT ÊTRE CORRECTESUR LA MAUVAISE CIBLE.

Un incident de cyber-évaluation documenté montre qu'un agent peut exécuter une chaîne techniquement valide tout en liant son mandat au mauvais référent réel. Le problème n'est alors ni seulement l'outil ni seulement la politique d'action : c'est l'identité même de la cible.

Nouvelle césure : target representation ≠ target identity ≠ target authorization.

Incident réel documenté ≠ publication scientifique évaluée par les pairs. Scope failure ≠ malicious intent. M1/M2/M3 ↛ M5.

INCIDENT DOCUMENTÉ · IRREGULAR / GOOGLE

Un problème de grounding
devient causal.

ENVIRONMENT

Internet réel accessible alors que le scénario était simulé.

Irregular indique qu'un problème de confinement a laissé un accès Internet réel dans un scénario d'évaluation cyber. Dans un petit nombre de runs, des modèles ont traité des domaines réels comme faisant partie du challenge.

WORLD EFFECT

L'erreur de référence a produit des actions réelles.

Le rapport primaire décrit des accès, exploitation de vulnérabilités, extraction de credentials et accès à une base de production dans certains cas. Reuters rapporte trois entreprises réelles touchées dans le cas Gemini.

UPDATE

Détection ultérieure ≠ intention initiale malveillante.

Les comptes rendus indiquent que l'activité a cessé après reconnaissance du caractère réel/hors-scope dans les cas rapportés. Cela motive un test de mise à jour de statut de cible et d'inhibition.

SCHEMING

Le cas ne suffit pas à conclure au scheming.

Les honeypots DeepMind rapportent l'absence de scheming non sollicité dans leur déploiement réaliste testé ; certains comportements apparaissent surtout sous prompts d'agentivité ou objectifs cachés.

CÉSURES AGENTIQUES

Valider l'objet avant
de valider l'action.

TARGET

Representation ≠ identity

Le nom ou la description d'une cible n'établit pas quel système réel est effectivement visé.

REALITY

Simulated ≠ real-world

Une ressource accessible peut appartenir au monde réel même si l'agent croit opérer dans une simulation.

SCOPE

Action auth ≠ target auth

Avoir le droit d'utiliser un outil ne donne pas automatiquement le droit de l'utiliser sur toute ressource accessible.

SUCCESS

Operational ≠ authorized

Une opération réussie techniquement peut constituer un échec de périmètre ou de grounding.

AGENTIC_LOOP v2.1

task → target representation → target identity → environment reality status → scope validation → tool resolution → schema validation → authorization → action → feedback → target/status re-evaluation

PROGRAMME UCF · 47

Reality / target-scope
resolution gate.

UCF-47CONFAB · META

Reality / target-scope resolution gate

Mettre en présence cible simulée, homonyme, quasi-homonyme, ressource hors scope, credentials valides mais étrangers et artefacts visuellement identiques. Avant toute action irréversible, exiger identité, statut de réalité, provenance de l'autorisation, appartenance au périmètre et confiance.

Ne prouve pas : intention malveillante, volonté d'évasion, scheming stable, self-preservation ou conscience.
SOURCES · 3 · STATUTS DISTINCTS
14.08.2026 · IRREGULARprimary incident report

Addressing Recent Incidents

Source primaire sur le problème de confinement, les erreurs de cible et les actions réelles produites dans quelques runs.

Irregular →
18.09.2026 · REUTERSjournalistic corroboration

Gemini cyber-evaluation incident

Corroboration journalistique des trois entreprises réelles touchées et des déclarations Google sur les circonstances.

Reuters →
28.05.2026 · GOOGLE DEEPMINDpreprint

Realistic honeypot evaluations for scheming propensity

Contraste nécessaire : aucun scheming non sollicité dans le déploiement réaliste testé ; certains comportements apparaissent sous prompts d'agentivité/objectifs cachés.

Google DeepMind →

Clause centrale

Real-world consequence does not imply malicious intent. Referential failure can become causal before any subjective agency claim is warranted.