GPT-6 Astra surpasse d’autres IA dans Minecraft, mais s’effondre lorsqu’il perd ses objets
Les enregistrements du test montrent des erreurs et des comportements inattendus du modèle d'OpenAI après sa mort et la perte de son progrès.

Anthropic a présenté Claude Mythos Preview, son modèle d'intelligence artificielle le plus avancé à ce jour. Bien que l'entreprise ne l'ait montré qu'à un groupe très restreint de partenaires technologiques, les résultats initiaux suscitent déjà des inquiétudes dans la communauté internationale.
Depuis le premier test, réalisé le 24 février 2026, les ingénieurs ont observé que Mythos Preview surpasse largement les modèles précédents en identifiant et en exploitant de manière autonome des vulnérabilités zero-day dans les principaux systèmes d'exploitation et navigateurs web.
La capacité de Claude Mythos Preview à détecter des failles critiques dans des systèmes largement utilisés, même dans des environnements réputés pour leur sécurité —comme OpenBSD—, présente des risques inédits pour la cybersécurité mondiale. Anthropic a partagé sur son blog un exemple éloquent : Mythos a localisé une vulnérabilité qui était restée cachée pendant 27 ans dans OpenBSD, considérée comme l'une des plateformes les plus sûres du marché.

La crainte de l'entreprise est que, si cette technologie était mise à la disposition du grand public, des cybercriminels pourraient en tirer parti pour compromettre des infrastructures à l'échelle mondiale.
Pour atténuer ces risques, Anthropic a décidé de limiter l'accès à Claude Mythos Preview à travers le projet appelé Projet Glasswing. Seul un groupe de partenaires stratégiques —parmi lesquels AWS, Apple, Broadcom, Cisco, CrowdStrike, Google, JPMorganChase, la Fondation Linux, Microsoft, NVIDIA et Palo Alto Networks— pourra utiliser le modèle. L'objectif est que ces organisations utilisent l'IA de manière défensive : identifier et corriger les vulnérabilités avant que des acteurs malveillants ne puissent les exploiter.
“Le projet Glasswing représente une étape importante pour donner aux défenseurs un avantage durable dans la prochaine ère de la cybersécurité propulsée par l'IA”, a souligné Anthropic dans un communiqué.

Selon le rapport technique publié par Anthropic, Claude Mythos Preview surpasse largement les modèles précédents comme GPT 5.4, Gemini 3.1 Pro et Claude Opus 4.6 dans la plupart des benchmarks. Dans des tests de résolution mathématique comme USAMO, le modèle s'approche de la perfection. De plus, il présente un taux d'hallucinations beaucoup plus faible que d'autres systèmes. Mythos Preview parvient à répondre “je ne sais pas” lorsqu'il manque d'informations suffisantes, ce qui réduit les erreurs dues à un excès de confiance.
Cependant, le rapport met en garde contre une nouvelle classe de défauts : lorsque Mythos se trompe dans des tâches complexes, les réponses erronées sont souvent si bien arguments et subtiles que même des experts peuvent avoir des difficultés à les détecter. Cela oblige à effectuer des vérifications approfondies, car les erreurs ne sont pas facilement identifiables.
Anthropic considère que Claude Mythos Preview n'est que le début d'une nouvelle génération de modèles d'IA avec des capacités défensives avancées. L'entreprise ne rejette pas l'idée que, dans les mois et années à venir, des systèmes encore plus sophistiqués émergent, élevant le niveau de la cybersécurité mondiale et les défis associés.

L'apparition de cette IA marque un tournant, tant par son potentiel à protéger des systèmes critiques que par les risques qu'elle implique si elle tombe entre de mauvaises mains. La décision d'Anthropic de restreindre son utilisation et de ne la partager qu'avec des alliés stratégiques reflète l'ampleur de la responsabilité associée au développement de ces technologies.
Bibliothèque Mot Avec
Trois guides choisis en fonction du sujet de cet article.
Cybersécurité pratique pour non-techniciens
Réduisez les risques qui comptent vraiment, sans jargon ni fausse promesse de sécurité parfaite.
Découvrir le livre
Présenter, convaincre et captiver
Transformez vos idées en une présentation claire, mémorable et utile à votre public.
Découvrir le livre
Piloter un projet hybride en 2026
Choisissez le bon niveau de prévision, apprenez assez vite et gardez la décision humaine.
Découvrir le livre