Les modèles d’IA franchissent un nouveau seuil de capacités
À peine un mois après son lancement, Claude Mythos Preview continue déjà d’améliorer ses performances. Selon les derniers tests publiés par l’AI Security Institute (AISI) du Royaume-Uni, le modèle d’Anthropic dépasse désormais ses propres résultats obtenus lors des premières évaluations et surclasse également GPT-5.5 d’OpenAI sur plusieurs exercices de cybersécurité. Cette progression particulièrement rapide relance le débat sur la capacité des mécanismes de sécurité à suivre le rythme de développement des modèles d’intelligence artificielle les plus avancés.1
Des performances inédites sur les tests cyber
L’AISI évalue régulièrement les modèles d’intelligence artificielle à travers des scénarios reproduisant des opérations réelles de cybersécurité. Lors de cette nouvelle campagne de tests, Mythos Preview est devenu le premier modèle à réussir certains parcours jusqu’alors considérés comme hors de portée, notamment le scénario Cooling Tower, jamais résolu auparavant par une IA. Les chercheurs soulignent que cette amélioration est intervenue sans nouvelle génération officielle du modèle, démontrant que les capacités des IA continuent de progresser entre deux versions grâce aux optimisations apportées par leurs concepteurs.1
Les capacités progressent plus vite que prévu
Les résultats observés dépassent les projections réalisées quelques mois plus tôt par les chercheurs britanniques. En février 2026, l’AISI estimait déjà que les capacités des modèles d’IA à accomplir des tâches de cybersécurité doublaient environ tous les cinq mois. L’arrivée de Mythos Preview et de GPT-5.5 a accéléré cette tendance. Les experts estiment désormais que les modèles progressent plus rapidement que les scénarios d’évaluation eux-mêmes, rendant de plus en plus difficile la mesure de leurs véritables limites.1
Une nouvelle réalité pour la cybersécurité
L’amélioration des performances des modèles présente des bénéfices évidents pour les équipes de défense. Les IA peuvent aider à détecter des vulnérabilités, analyser du code ou accélérer la correction de failles de sécurité. Mais ces mêmes capacités pourraient également être exploitées par des acteurs malveillants pour identifier plus rapidement des points faibles dans les systèmes informatiques. Les spécialistes considèrent donc que chaque avancée technologique doit désormais s’accompagner de nouveaux mécanismes de contrôle, d’évaluation et de supervision afin de limiter les risques d’utilisation détournée.2
Les benchmarks atteignent leurs propres limites
Les chercheurs de l’AISI reconnaissent également que leurs méthodes d’évaluation commencent à montrer leurs limites. Les scénarios actuels imposent un plafond de 2,5 millions de tokens afin de comparer équitablement les modèles. Or, les derniers systèmes d’IA semblent capables d’aller bien au-delà de cette limite. Les chercheurs estiment que des budgets de calcul plus élevés pourraient encore améliorer leurs performances, ce qui laisse penser que les capacités réelles des modèles les plus avancés restent en partie sous-estimées par les outils d’évaluation actuels.1
La cybersécurité doit évoluer au même rythme que l’intelligence artificielle
Cette évolution rappelle pourquoi la Cybersécurité devient plus stratégique que jamais. Les professionnels ne doivent plus seulement protéger les infrastructures contre des attaques traditionnelles, mais aussi comprendre les capacités des nouvelles générations d’intelligence artificielle, anticiper leurs usages et mettre en place des mécanismes capables d’encadrer leur déploiement. L’évaluation continue des modèles, la gestion des risques et la surveillance des comportements deviennent désormais des composantes essentielles de la sécurité numérique.
Une course qui dépasse désormais les performances
Les progrès de Mythos Preview montrent que la compétition entre les acteurs de l’intelligence artificielle ne porte plus uniquement sur les performances des modèles. Elle concerne également la capacité à garantir leur sécurité, leur contrôle et leur utilisation responsable. À mesure que ces systèmes gagnent en autonomie et en efficacité, la cybersécurité devient un élément indissociable de leur développement et un enjeu stratégique pour l’ensemble de l’écosystème numérique.
L’Actu IT à 360° — décrypter la technologie pour comprendre les métiers de demain.
Pour aller plus loin
Les progrès rapides de Mythos Preview illustrent l’accélération des capacités des modèles d’intelligence artificielle les plus avancés. Sur un sujet connexe, découvrez notre article « Claude Fable 5 quitte l’offre gratuite : Anthropic mise sur les usages professionnels », qui analyse comment Anthropic repositionne désormais ses modèles les plus performants vers les entreprises et les usages à forte valeur ajoutée.
Références
1. UK AI Security Institute. (2026). Cyber capability evaluations of Claude Mythos Preview.
https://www.aisi.gov.uk
2. Anthropic. (2026). Project Glasswing and Frontier Model Safety.
https://www.anthropic.com
Azure Linux 4.0 : Microsoft prépare l’après Windows Server ?
Microsoft fait évoluer Linux bien au-delà du cloud Pendant longtemps, Azure Linux était une distribution conçue exclusivement pour faire fonctionner les infrastructures cloud de Microsoft. Avec la sortie d'Azure Linux 4.0, l'entreprise franchit une nouvelle étape en...
Claude Fable 5 quitte l’offre gratuite : Anthropic mise sur les usages professionnels
Anthropic réserve désormais son modèle le plus avancé À peine une semaine après la réouverture de Claude Fable 5, Anthropic change déjà de stratégie. L'entreprise met fin à son accès gratuit et réserve désormais son modèle le plus performant aux offres payantes...
Djinn Stealer : le malware qui s’attaque aux identifiants cloud et IA des entreprises
Les cybercriminels changent de cible Les cyberattaques ne visent plus uniquement les données ou les postes de travail. Les identifiants permettant d'accéder aux plateformes cloud, aux environnements d'intelligence artificielle et aux outils de développement sont...
Claude Tag transforme Slack en véritable espace de travail agentique
Les agents IA s'installent au cœur du travail collaboratif L'intelligence artificielle ne se limite plus aux assistants accessibles dans une fenêtre de discussion. Avec Claude Tag, Anthropic franchit une nouvelle étape en intégrant directement un agent IA dans Slack....
IBM et OpenAI veulent armer les entreprises contre les cyberattaques à vitesse machine
Les défenseurs doivent désormais combattre l'IA avec l'IA Les cyberattaques évoluent à une vitesse inédite. Grâce aux modèles d'intelligence artificielle, les attaquants sont capables d'automatiser la recherche de vulnérabilités, d'analyser du code en quelques...
La sécurité de l’open source change d’échelle : IBM, Red Hat et Palo Alto s’allient
Les cyberattaques poussent les géants de l'IT à unir leurs forces Les composants open source sont présents dans la quasi-totalité des applications modernes, des plateformes cloud aux logiciels métiers. Cette dépendance s'accompagne toutefois d'un risque croissant :...
Avec Lambda, AWS prépare l’infrastructure du cloud aux agents IA autonomes
Le serverless entre dans une nouvelle phase Le cloud évolue pour répondre aux besoins d'une nouvelle génération d'applications fondées sur l'intelligence artificielle agentique. À mesure que les agents IA deviennent capables d'exécuter des tâches complexes pendant...
La course aux semi-conducteurs s’accélère : IBM présente une architecture 0,7 nm
IBM veut repousser les limites des processeurs La compétition mondiale autour des semi-conducteurs franchit une nouvelle étape. IBM a dévoilé une architecture expérimentale baptisée Nanostack, capable d'empiler des transistors en trois dimensions à l'échelle de 0,7...
Avec les Code Layers, Figma rapproche définitivement le design du développement
Une nouvelle étape vers la création d'applications sans frontière Le design et le développement logiciel ont longtemps suivi deux trajectoires distinctes. Les designers imaginaient les interfaces, les développeurs les traduisaient ensuite en code, avec de nombreux...
Google Chrome voit ce que vous voyez : Gemini analyse désormais votre écran
Chrome franchit une nouvelle étape vers le navigateur intelligent Les navigateurs web ne se contentent plus d’afficher des pages Internet. Ils deviennent progressivement de véritables assistants capables de comprendre le contexte dans lequel évoluent les utilisateurs....
