Les modèles d’IA franchissent un nouveau seuil de capacités
À peine un mois après son lancement, Claude Mythos Preview continue déjà d’améliorer ses performances. Selon les derniers tests publiés par l’AI Security Institute (AISI) du Royaume-Uni, le modèle d’Anthropic dépasse désormais ses propres résultats obtenus lors des premières évaluations et surclasse également GPT-5.5 d’OpenAI sur plusieurs exercices de cybersécurité. Cette progression particulièrement rapide relance le débat sur la capacité des mécanismes de sécurité à suivre le rythme de développement des modèles d’intelligence artificielle les plus avancés.1
Des performances inédites sur les tests cyber
L’AISI évalue régulièrement les modèles d’intelligence artificielle à travers des scénarios reproduisant des opérations réelles de cybersécurité. Lors de cette nouvelle campagne de tests, Mythos Preview est devenu le premier modèle à réussir certains parcours jusqu’alors considérés comme hors de portée, notamment le scénario Cooling Tower, jamais résolu auparavant par une IA. Les chercheurs soulignent que cette amélioration est intervenue sans nouvelle génération officielle du modèle, démontrant que les capacités des IA continuent de progresser entre deux versions grâce aux optimisations apportées par leurs concepteurs.1
Les capacités progressent plus vite que prévu
Les résultats observés dépassent les projections réalisées quelques mois plus tôt par les chercheurs britanniques. En février 2026, l’AISI estimait déjà que les capacités des modèles d’IA à accomplir des tâches de cybersécurité doublaient environ tous les cinq mois. L’arrivée de Mythos Preview et de GPT-5.5 a accéléré cette tendance. Les experts estiment désormais que les modèles progressent plus rapidement que les scénarios d’évaluation eux-mêmes, rendant de plus en plus difficile la mesure de leurs véritables limites.1
Une nouvelle réalité pour la cybersécurité
L’amélioration des performances des modèles présente des bénéfices évidents pour les équipes de défense. Les IA peuvent aider à détecter des vulnérabilités, analyser du code ou accélérer la correction de failles de sécurité. Mais ces mêmes capacités pourraient également être exploitées par des acteurs malveillants pour identifier plus rapidement des points faibles dans les systèmes informatiques. Les spécialistes considèrent donc que chaque avancée technologique doit désormais s’accompagner de nouveaux mécanismes de contrôle, d’évaluation et de supervision afin de limiter les risques d’utilisation détournée.2
Les benchmarks atteignent leurs propres limites
Les chercheurs de l’AISI reconnaissent également que leurs méthodes d’évaluation commencent à montrer leurs limites. Les scénarios actuels imposent un plafond de 2,5 millions de tokens afin de comparer équitablement les modèles. Or, les derniers systèmes d’IA semblent capables d’aller bien au-delà de cette limite. Les chercheurs estiment que des budgets de calcul plus élevés pourraient encore améliorer leurs performances, ce qui laisse penser que les capacités réelles des modèles les plus avancés restent en partie sous-estimées par les outils d’évaluation actuels.1
La cybersécurité doit évoluer au même rythme que l’intelligence artificielle
Cette évolution rappelle pourquoi la Cybersécurité devient plus stratégique que jamais. Les professionnels ne doivent plus seulement protéger les infrastructures contre des attaques traditionnelles, mais aussi comprendre les capacités des nouvelles générations d’intelligence artificielle, anticiper leurs usages et mettre en place des mécanismes capables d’encadrer leur déploiement. L’évaluation continue des modèles, la gestion des risques et la surveillance des comportements deviennent désormais des composantes essentielles de la sécurité numérique.
Une course qui dépasse désormais les performances
Les progrès de Mythos Preview montrent que la compétition entre les acteurs de l’intelligence artificielle ne porte plus uniquement sur les performances des modèles. Elle concerne également la capacité à garantir leur sécurité, leur contrôle et leur utilisation responsable. À mesure que ces systèmes gagnent en autonomie et en efficacité, la cybersécurité devient un élément indissociable de leur développement et un enjeu stratégique pour l’ensemble de l’écosystème numérique.
L’Actu IT à 360° — décrypter la technologie pour comprendre les métiers de demain.
Pour aller plus loin
Les progrès rapides de Mythos Preview illustrent l’accélération des capacités des modèles d’intelligence artificielle les plus avancés. Sur un sujet connexe, découvrez notre article « Claude Fable 5 quitte l’offre gratuite : Anthropic mise sur les usages professionnels », qui analyse comment Anthropic repositionne désormais ses modèles les plus performants vers les entreprises et les usages à forte valeur ajoutée.
Références
1. UK AI Security Institute. (2026). Cyber capability evaluations of Claude Mythos Preview.
https://www.aisi.gov.uk
2. Anthropic. (2026). Project Glasswing and Frontier Model Safety.
https://www.anthropic.com
La guerre des tokens commence : Headroom veut rendre l’IA moins coûteuse
L’intelligence artificielle se heurte à un nouveau défi : son coût L’adoption massive de l’intelligence artificielle générative transforme les entreprises, mais elle fait également émerger une nouvelle préoccupation : la maîtrise des coûts. Derrière chaque interaction...
Le WiFi 8 arrive plus vite que prévu : ce que cela change pour les entreprises
Une nouvelle génération de réseau se profile déjà Alors que le WiFi 7 commence à peine à se démocratiser dans les entreprises et chez les particuliers, l’industrie prépare déjà la prochaine étape. TP-Link vient de dévoiler le premier routeur compatible WiFi 8,...
Webedia-Elephant mise sur Gemini Enterprise pour industrialiser l’IA générative
Les interruptions IT deviennent un enjeu de direction générale Longtemps considérées comme de simples incidents techniques, les interruptions de service prennent aujourd’hui une tout autre dimension. Selon une étude menée par Oxford Economics pour Splunk, les...
600 milliards de dollars perdus : les pannes informatiques changent de dimension
Les interruptions IT deviennent un enjeu de direction générale Longtemps considérées comme de simples incidents techniques, les interruptions de service prennent aujourd’hui une tout autre dimension. Selon une étude menée par Oxford Economics pour Splunk, les...
Lightwell : IBM et Red Hat s’attaquent au casse-tête des patchs open source
L’IA découvre les failles plus vite que les entreprises ne peuvent les corriger L’intelligence artificielle transforme profondément la cybersécurité. Si elle permet de détecter plus rapidement les vulnérabilités, elle crée également un nouveau défi : la capacité à...
AWS renforce OpenSearch pour connecter l’IA aux données d’entreprise
Les agents IA obligent le cloud à évoluer L’essor de l’IA agentique transforme profondément les infrastructures cloud. Contrairement aux assistants conversationnels classiques, les agents intelligents doivent accéder à des données, interagir avec plusieurs systèmes et...
Avec Stainless, Anthropic veut intégrer Claude au cœur du développement logiciel
La bataille de l’IA se déplace vers les outils développeurs Anthropic poursuit sa montée en puissance dans l’intelligence artificielle avec le rachat de Stainless, une startup spécialisée dans les outils de développement et l’automatisation des API. Derrière cette...
Bousculé par la concurrence, Anthropic contre-attaque avec Claude Opus 4.8
La pression monte dans la course aux modèles d’IA Le marché de l’intelligence artificielle générative n’a jamais été aussi compétitif. Entre GPT-5 d’OpenAI, Gemini de Google, les avancées de Mistral et l’émergence de nouveaux acteurs comme DeepSeek, chaque évolution...
Dell Spark : Google prépare une IA capable d’agir à votre place
L’ère de l’assistant IA personnel commence Google franchit une nouvelle étape dans l’intelligence artificielle avec Spark, un agent IA personnel conçu pour agir de manière autonome dans la vie numérique des utilisateurs. Après les moteurs de recherche, les assistants...
Dell World 2026 : Dell prépare une nouvelle génération de serveurs PowerEdge pour l’IA
Les serveurs entrent dans une nouvelle phase de leur évolution À l’occasion de Dell World 2026 à Las Vegas, Dell a dévoilé la 18ᵉ génération de ses serveurs PowerEdge, une gamme conçue pour répondre à l’explosion des besoins liés à l’intelligence artificielle....
