Les modèles d’IA franchissent un nouveau seuil de capacités
À peine un mois après son lancement, Claude Mythos Preview continue déjà d’améliorer ses performances. Selon les derniers tests publiés par l’AI Security Institute (AISI) du Royaume-Uni, le modèle d’Anthropic dépasse désormais ses propres résultats obtenus lors des premières évaluations et surclasse également GPT-5.5 d’OpenAI sur plusieurs exercices de cybersécurité. Cette progression particulièrement rapide relance le débat sur la capacité des mécanismes de sécurité à suivre le rythme de développement des modèles d’intelligence artificielle les plus avancés.1
Des performances inédites sur les tests cyber
L’AISI évalue régulièrement les modèles d’intelligence artificielle à travers des scénarios reproduisant des opérations réelles de cybersécurité. Lors de cette nouvelle campagne de tests, Mythos Preview est devenu le premier modèle à réussir certains parcours jusqu’alors considérés comme hors de portée, notamment le scénario Cooling Tower, jamais résolu auparavant par une IA. Les chercheurs soulignent que cette amélioration est intervenue sans nouvelle génération officielle du modèle, démontrant que les capacités des IA continuent de progresser entre deux versions grâce aux optimisations apportées par leurs concepteurs.1
Les capacités progressent plus vite que prévu
Les résultats observés dépassent les projections réalisées quelques mois plus tôt par les chercheurs britanniques. En février 2026, l’AISI estimait déjà que les capacités des modèles d’IA à accomplir des tâches de cybersécurité doublaient environ tous les cinq mois. L’arrivée de Mythos Preview et de GPT-5.5 a accéléré cette tendance. Les experts estiment désormais que les modèles progressent plus rapidement que les scénarios d’évaluation eux-mêmes, rendant de plus en plus difficile la mesure de leurs véritables limites.1
Une nouvelle réalité pour la cybersécurité
L’amélioration des performances des modèles présente des bénéfices évidents pour les équipes de défense. Les IA peuvent aider à détecter des vulnérabilités, analyser du code ou accélérer la correction de failles de sécurité. Mais ces mêmes capacités pourraient également être exploitées par des acteurs malveillants pour identifier plus rapidement des points faibles dans les systèmes informatiques. Les spécialistes considèrent donc que chaque avancée technologique doit désormais s’accompagner de nouveaux mécanismes de contrôle, d’évaluation et de supervision afin de limiter les risques d’utilisation détournée.2
Les benchmarks atteignent leurs propres limites
Les chercheurs de l’AISI reconnaissent également que leurs méthodes d’évaluation commencent à montrer leurs limites. Les scénarios actuels imposent un plafond de 2,5 millions de tokens afin de comparer équitablement les modèles. Or, les derniers systèmes d’IA semblent capables d’aller bien au-delà de cette limite. Les chercheurs estiment que des budgets de calcul plus élevés pourraient encore améliorer leurs performances, ce qui laisse penser que les capacités réelles des modèles les plus avancés restent en partie sous-estimées par les outils d’évaluation actuels.1
La cybersécurité doit évoluer au même rythme que l’intelligence artificielle
Cette évolution rappelle pourquoi la Cybersécurité devient plus stratégique que jamais. Les professionnels ne doivent plus seulement protéger les infrastructures contre des attaques traditionnelles, mais aussi comprendre les capacités des nouvelles générations d’intelligence artificielle, anticiper leurs usages et mettre en place des mécanismes capables d’encadrer leur déploiement. L’évaluation continue des modèles, la gestion des risques et la surveillance des comportements deviennent désormais des composantes essentielles de la sécurité numérique.
Une course qui dépasse désormais les performances
Les progrès de Mythos Preview montrent que la compétition entre les acteurs de l’intelligence artificielle ne porte plus uniquement sur les performances des modèles. Elle concerne également la capacité à garantir leur sécurité, leur contrôle et leur utilisation responsable. À mesure que ces systèmes gagnent en autonomie et en efficacité, la cybersécurité devient un élément indissociable de leur développement et un enjeu stratégique pour l’ensemble de l’écosystème numérique.
L’Actu IT à 360° — décrypter la technologie pour comprendre les métiers de demain.
Pour aller plus loin
Les progrès rapides de Mythos Preview illustrent l’accélération des capacités des modèles d’intelligence artificielle les plus avancés. Sur un sujet connexe, découvrez notre article « Claude Fable 5 quitte l’offre gratuite : Anthropic mise sur les usages professionnels », qui analyse comment Anthropic repositionne désormais ses modèles les plus performants vers les entreprises et les usages à forte valeur ajoutée.
Références
1. UK AI Security Institute. (2026). Cyber capability evaluations of Claude Mythos Preview.
https://www.aisi.gov.uk
2. Anthropic. (2026). Project Glasswing and Frontier Model Safety.
https://www.anthropic.com
Stitch : Google veut réinventer le design face à Figma
L’actualité en bref Google a lancé Stitch, un nouvel outil de design assisté par intelligence artificielle destiné à concurrencer des plateformes comme Figma. L’objectif est de simplifier et d’accélérer la création d’interfaces numériques, en intégrant directement des...
Google lance TurboQuant : vers une IA moins dépendante du hardware
L’actualité en bref Google a récemment présenté TurboQuant, un algorithme de compression mémoire conçu pour réduire drastiquement les besoins en ressources des modèles d’intelligence artificielle. Aujourd’hui, l’IA repose fortement sur des infrastructures coûteuses,...
Windows 11 : Microsoft assouplit enfin les mises à jour forcées
L’actualité en bref Microsoft s’apprête à modifier en profondeur la gestion des mises à jour dans Windows 11, en permettant aux utilisateurs de mieux contrôler leur installation, notamment en les reportant plus facilement ou en évitant certaines interruptions...
WeChat passe à l’IA autonome : Tencent accélère avec OpenClaw
L’actualité en bref Tencent vient d’intégrer OpenClaw dans WeChat, transformant l’application en bien plus qu’un simple outil de communication. Cette évolution introduit des agents capables d’exécuter des tâches directement depuis l’interface, sans passer par...
Cloud souverain : SAP et Bleu accélèrent la protection des données en Europe
L’actualité en bref Oracle vient d’annoncer Java 26, accompagné d’une initiative stratégique appelée Java Verified Portfolio, visant à certifier la qualité et la fiabilité des applications développées avec Java. Au-delà d’une simple mise à jour technique, cette...
Java 26 et Java Verified : Oracle veut renforcer la fiabilité des applications en entreprise
L’actualité en bref Oracle vient d’annoncer Java 26, accompagné d’une initiative stratégique appelée Java Verified Portfolio, visant à certifier la qualité et la fiabilité des applications développées avec Java. Au-delà d’une simple mise à jour technique, cette...
Datacenters dans l’espace : pourquoi Nvidia veut révolutionner le cloud
L’actualité en bref Lors de la conférence GTC 2026, Nvidia a annoncé vouloir accélérer le développement de l’intelligence artificielle dans l’espace, en s’inscrivant dans une dynamique émergente autour des datacenters orbitaux. L’entreprise ne se contente plus de...
Claude Marketplace : ce que la nouvelle plateforme d’Anthropic change pour les entreprises
L’actualité en bref Anthropic vient d’annoncer Claude Marketplace, une nouvelle plateforme qui permet aux entreprises d’accéder, de partager et d’exploiter des agents d’intelligence artificielle basés sur son modèle Claude. L’objectif n’est plus seulement de proposer...
Code Review automatisé : Claude d’Anthropic analyse désormais le code des développeurs
L’actualité en bref L’intelligence artificielle continue de transformer le travail des développeurs. Anthropic, l’entreprise derrière le modèle d’IA Claude, vient d’annoncer de nouvelles capacités permettant à son assistant d’analyser du code informatique et d’aider...
Memerist : l’application Linux gratuite pour créer des mèmes en quelques secondes
L’actualité en bref Créer un mème est devenu un geste courant sur internet. Des images humoristiques circulent chaque jour sur les réseaux sociaux, les forums ou les messageries, souvent utilisées pour commenter l’actualité, partager une idée ou simplement faire rire....
