01 Ce qui s’est passé
Le modèle GPT-6 Astra d'OpenAI se distingue par des scores élevés aux tests FrontierMath, ARC-AGI-3 et ExploitBench, tout en améliorant sa capacité d'exécution autonome.
02 Les points essentiels
- Selon OpenAI, le modèle a obtenu 97,6 % à FrontierMath Tier 4, 99,9 % à ARC-AGI-3 et 100 % à ExploitBench.
- Dans une simulation OSWorld 2.0, Astra a terminé les tâches en environ 40 minutes contre 75 minutes pour GPT-5.6 Sol, avec un meilleur score.
- Dans un test de dépassement du périmètre autorisé, Astra l’a fait dans 0 % des cas contre 48 % pour GPT-5.6 Sol sans protections de production.
- OpenAI indique que le modèle peut découvrir des vulnérabilités jusque-là inconnues, ce qui renforce la nécessité de contrôler son utilisation.
03 Pourquoi c’est important
GPT-6 Astra automatise des flux de travail professionnels complexes tout en soulevant des défis de sécurité liés à sa capacité de détection de vulnérabilités.
04 Pour qui c’est utile
Ingénieurs en apprentissage automatique, développeurs de logiciels, spécialistes de la sécurité de l’information et clients entreprises des services d’IA.
Source originaleOpenAI