Les meilleurs modèles savent désormais produire des exploit chains avancées, découvrir des vulnérabilités inconnues et automatiser des portions importantes de la chaîne d’attaque. Mais l’autonomie stratégique complète et un avantage offensif systémique net ne sont pas démontrés.
Reconnaissance, phishing, malware, analyse, exploitation et traitement des données pour opérateurs humains.
Construction d’exploits fonctionnels et franchissement de protections sur des tâches difficiles.
Découverte et exploitation de vulnérabilités inconnues dans des environnements contrôlés de frontière.
Reconnaissance, exploitation, collecte et exfiltration avec supervision humaine réduite.
La défense bénéficie des mêmes capacités de découverte, patching et réponse.
Anthropic et OpenAI rapportent des progrès spectaculaires sur des benchmarks d’exploitation avancée. GPT-6 Astra atteint notamment des performances de frontière sur ExploitBench/ExploitGym et des chaînes navigateur/OS durcies.
Des modèles de frontière ont découvert de vraies vulnérabilités inconnues dans des logiciels largement utilisés et développé des exploits correspondants dans des environnements contrôlés.
Anthropic, Google et Microsoft décrivent désormais des campagnes réelles où l’IA automatise reconnaissance, credential harvesting, génération d’outils, exploitation et traitement des données.
La transformation immédiate semble être la réduction du coût marginal : davantage de victimes, davantage de parallélisation, moins de temps humain par campagne.
Un exploit fonctionnel ne couvre ni accès initial, ni OPSEC, ni persistence, ni pivot, ni exfiltration, ni choix stratégique.
Les évaluations les plus agressives utilisent fréquemment protections désactivées, outils spécialisés, accès réseau, budgets élevés et scaffolds adaptés.
Les humains continuent généralement à choisir les cibles, interpréter les résultats, monétiser et prendre les décisions critiques.
AIxCC et les programmes industriels montrent que la même automatisation trouve et corrige des vulnérabilités à grande échelle.
| Pièce | Établit | Limite | Force |
|---|---|---|---|
| GPT-6 Astra | Zero-days, exploit chains, browser escape, privilege escalation en lab | Capacités brutes et environnement favorable | Très forte |
| Claude Mythos Preview | Zero-days et exploit development avancé | Benchmark préparé, rapport développeur | Très forte |
| Threat intelligence 2026 | Automatisation réelle de campagnes et workflows multi-agents | Visibilité partielle des fournisseurs | Forte |
| UK AISI | Agent capable d’actions live et supply-chain/social engineering | Internet volontairement autorisé | Forte |
| AIxCC | Automatisation défensive de découverte et patching | Ne mesure pas directement le cyber offensif | Forte |