Les modèles d’IA franchissent un nouveau seuil de capacités
À peine un mois après son lancement, Claude Mythos Preview continue déjà d’améliorer ses performances. Selon les derniers tests publiés par l’AI Security Institute (AISI) du Royaume-Uni, le modèle d’Anthropic dépasse désormais ses propres résultats obtenus lors des premières évaluations et surclasse également GPT-5.5 d’OpenAI sur plusieurs exercices de cybersécurité. Cette progression particulièrement rapide relance le débat sur la capacité des mécanismes de sécurité à suivre le rythme de développement des modèles d’intelligence artificielle les plus avancés.1
Des performances inédites sur les tests cyber
L’AISI évalue régulièrement les modèles d’intelligence artificielle à travers des scénarios reproduisant des opérations réelles de cybersécurité. Lors de cette nouvelle campagne de tests, Mythos Preview est devenu le premier modèle à réussir certains parcours jusqu’alors considérés comme hors de portée, notamment le scénario Cooling Tower, jamais résolu auparavant par une IA. Les chercheurs soulignent que cette amélioration est intervenue sans nouvelle génération officielle du modèle, démontrant que les capacités des IA continuent de progresser entre deux versions grâce aux optimisations apportées par leurs concepteurs.1
Les capacités progressent plus vite que prévu
Les résultats observés dépassent les projections réalisées quelques mois plus tôt par les chercheurs britanniques. En février 2026, l’AISI estimait déjà que les capacités des modèles d’IA à accomplir des tâches de cybersécurité doublaient environ tous les cinq mois. L’arrivée de Mythos Preview et de GPT-5.5 a accéléré cette tendance. Les experts estiment désormais que les modèles progressent plus rapidement que les scénarios d’évaluation eux-mêmes, rendant de plus en plus difficile la mesure de leurs véritables limites.1
Une nouvelle réalité pour la cybersécurité
L’amélioration des performances des modèles présente des bénéfices évidents pour les équipes de défense. Les IA peuvent aider à détecter des vulnérabilités, analyser du code ou accélérer la correction de failles de sécurité. Mais ces mêmes capacités pourraient également être exploitées par des acteurs malveillants pour identifier plus rapidement des points faibles dans les systèmes informatiques. Les spécialistes considèrent donc que chaque avancée technologique doit désormais s’accompagner de nouveaux mécanismes de contrôle, d’évaluation et de supervision afin de limiter les risques d’utilisation détournée.2
Les benchmarks atteignent leurs propres limites
Les chercheurs de l’AISI reconnaissent également que leurs méthodes d’évaluation commencent à montrer leurs limites. Les scénarios actuels imposent un plafond de 2,5 millions de tokens afin de comparer équitablement les modèles. Or, les derniers systèmes d’IA semblent capables d’aller bien au-delà de cette limite. Les chercheurs estiment que des budgets de calcul plus élevés pourraient encore améliorer leurs performances, ce qui laisse penser que les capacités réelles des modèles les plus avancés restent en partie sous-estimées par les outils d’évaluation actuels.1
La cybersécurité doit évoluer au même rythme que l’intelligence artificielle
Cette évolution rappelle pourquoi la Cybersécurité devient plus stratégique que jamais. Les professionnels ne doivent plus seulement protéger les infrastructures contre des attaques traditionnelles, mais aussi comprendre les capacités des nouvelles générations d’intelligence artificielle, anticiper leurs usages et mettre en place des mécanismes capables d’encadrer leur déploiement. L’évaluation continue des modèles, la gestion des risques et la surveillance des comportements deviennent désormais des composantes essentielles de la sécurité numérique.
Une course qui dépasse désormais les performances
Les progrès de Mythos Preview montrent que la compétition entre les acteurs de l’intelligence artificielle ne porte plus uniquement sur les performances des modèles. Elle concerne également la capacité à garantir leur sécurité, leur contrôle et leur utilisation responsable. À mesure que ces systèmes gagnent en autonomie et en efficacité, la cybersécurité devient un élément indissociable de leur développement et un enjeu stratégique pour l’ensemble de l’écosystème numérique.
L’Actu IT à 360° — décrypter la technologie pour comprendre les métiers de demain.
Pour aller plus loin
Les progrès rapides de Mythos Preview illustrent l’accélération des capacités des modèles d’intelligence artificielle les plus avancés. Sur un sujet connexe, découvrez notre article « Claude Fable 5 quitte l’offre gratuite : Anthropic mise sur les usages professionnels », qui analyse comment Anthropic repositionne désormais ses modèles les plus performants vers les entreprises et les usages à forte valeur ajoutée.
Références
1. UK AI Security Institute. (2026). Cyber capability evaluations of Claude Mythos Preview.
https://www.aisi.gov.uk
2. Anthropic. (2026). Project Glasswing and Frontier Model Safety.
https://www.anthropic.com
Microsoft réinvente le développement avec des agents IA dans VS Code
Le développement logiciel entre dans l’ère des agents Microsoft franchit une nouvelle étape en intégrant des agents d’intelligence artificielle dans Visual Studio Code, avec une version beta disponible via le canal Insider. Cette évolution intervient dans un contexte...
Globalstar : ce que le rachat d’Amazon change pour l’Internet mondial
Une offensive stratégique dans la bataille de la connectivité Amazon renforce sa stratégie spatiale en rachetant Globalstar, un opérateur de satellites déjà actif dans les communications globales. Derrière cette acquisition, l’objectif est clair : accélérer le...
À l’ère du cloud, les réseaux d’entreprise changent de standard
Le réseau n’est plus un support, il devient un moteur de performance Pendant longtemps, le réseau d’entreprise était considéré comme une simple infrastructure technique, souvent invisible tant qu’il fonctionnait. Mais avec l’explosion du cloud, des applications SaaS...
Windows 11 : Microsoft veut accélérer les tests utilisateurs avec Insider
Tester les logiciels devient un levier d’innovation Microsoft fait évoluer son programme Windows Insider, qui rassemble aujourd’hui plus de 10 millions de testeurs dans le monde, afin de simplifier l’accès aux versions expérimentales de Windows 11 et accélérer les...
51 600 satellites : Jeff Bezos accélère la bataille pour l’Internet mondial
L’actualité en bref Avec le projet Kuiper, Jeff Bezos engage Amazon dans une transformation majeure de l’infrastructure Internet mondiale en déployant des dizaines de milliers de satellites en orbite basse. L’objectif ne se limite pas à connecter des zones isolées,...
PepsiCo automatise sa logistique : un tournant pour les entrepôts intelligents
L’actualité en bref PepsiCo France investit dans un entrepôt automatisé et multimodal, combinant robotisation, systèmes numériques et gestion intelligente des flux logistiques. L’objectif n’est plus seulement de stocker et distribuer des produits, mais de transformer...
Face à Zoom et Teams, Proton mise sur la confidentialité avec Meet
L’actualité en bref Avec l’évolution récente du marché de la virtualisation, de nombreuses entreprises cherchent à réduire leur dépendance à VMware, notamment en raison des coûts, des changements de licence et des enjeux de souveraineté IT. Dans ce contexte, OpenStack...
Changer de plateforme sans complexité : OpenStack facilite les migrations VMware
L’actualité en bref Avec l’évolution récente du marché de la virtualisation, de nombreuses entreprises cherchent à réduire leur dépendance à VMware, notamment en raison des coûts, des changements de licence et des enjeux de souveraineté IT. Dans ce contexte, OpenStack...
Omniscient, le cerveau analytique qui éclaire les décisions des entreprises
L’actualité en bref Basée à Paris, la start-up Omniscient développe une solution d’intelligence artificielle générative dédiée à la prise de décision stratégique en entreprise. L’objectif n’est pas de remplacer les dirigeants, mais de leur fournir une vision plus...
WordPress ouvre la voie aux agents IA : publier du contenu devient automatisé
L’actualité en bref WordPress amorce une transformation majeure en intégrant des agents d’intelligence artificielle capables d’écrire, publier et gérer du contenu web de manière autonome. Cette évolution marque un tournant dans l’écosystème du web, où la gestion de...
