Anthropic annonce que son modèle Claude a généré une preuve formelle vérifiée par ordinateur du théorème de Fermat en 11 jours.
Cette réussite illustre l'utilité potentielle de l'IA pour la vérification rigoureuse de preuves mathématiques complexes, réduisant ainsi le travail manuel nécessaire à la validation scientifique.
OpenAI présente GPT-6 Astra, un modèle affichant des records sur plusieurs benchmarks et une efficacité renforcée pour les tâches informatiques.
GPT-6 Astra automatise des flux de travail professionnels complexes tout en soulevant des défis de sécurité liés à sa capacité de détection de vulnérabilités.
Google lance WeatherNext 3, un modèle d'IA produisant des prévisions météorologiques horaires à haute résolution via des données satellites.
Ces prévisions haute résolution permettent d'améliorer la gestion des ressources agricoles et la production d'énergie. L'accessibilité via Google Cloud permet aux développeurs d'exploiter ces données dans leurs applications.
Google lance Gemini 3.8 Flash pour les tâches d'agent et une version Cyber dédiée à la détection automatique des vulnérabilités logicielles.
Ces modèles permettent aux entreprises de déployer des agents autonomes et des systèmes de correction de sécurité automatisés à un coût inférieur à celui des modèles de pointe les plus volumineux.
Les modèles Gemini 3.7, 3.6 et 3.5 Flash intègrent désormais l'analyse agentique, réduisant ainsi les coûts et la consommation de jetons.
Cette mise à jour offre aux développeurs un moyen plus économique de traiter des vidéos de longue durée. En ciblant uniquement les segments pertinents, elle optimise les performances pour des tâches complexes comme la détection d'anomalies ou le suivi d'objets.
Anthropic dévoile Claude Fable 5.1, un modèle conçu pour les flux de travail autonomes longs, avec analyse visuelle et protocoles de sécurité.
Ce lancement offre un outil spécialisé pour la recherche multi-étapes et l'automatisation. Le système de redirection sécurisée permet de gérer les risques dans les domaines sensibles.
OpenAI consacre 1 milliard de dollars pour fournir des outils de cybersécurité par IA aux organisations gérant des services essentiels.
Cette initiative répond au besoin critique de protéger les infrastructures essentielles face à des cyberattaques sophistiquées. En facilitant l'adoption de technologies d'IA, le programme renforce les capacités de défense des organisations contre les menaces numériques.
CrowdStrike lance SafeMind, une solution de sécurité autonome exploitant les modèles NVIDIA Nemotron pour automatiser la détection des menaces.
Cette approche permet aux équipes de sécurité de bénéficier d'une défense capable d'évoluer en continu face aux menaces, améliorant ainsi la rapidité et l'efficacité des réponses aux incidents.
Basis, Clay et Exa Labs automatisent l'intégration, la gestion de comptes et le développement, avec une validation humaine obligatoire des résultats.
La réussite des flux de travail automatisés repose sur la définition stricte du périmètre, des permissions et des points de contrôle humains pour garantir la fiabilité des opérations.
Salesforce intègre le support du protocole MCP pour permettre aux agents IA d'accéder aux données et aux fonctions de l'entreprise de manière sécurisée.
Cette extension simplifie l'intégration des agents IA dans les flux de travail existants en exposant la logique métier et les données via des standards ouverts, évitant ainsi le développement d'intégrations sur mesure.
Le routeur NVIDIA Personal AI permet de répartir les tâches d'IA sur plusieurs machines locales pour accélérer les workflows multi-agents.
PAIR permet aux utilisateurs de mutualiser leurs ressources informatiques locales pour accroître les performances de leurs modèles. Cette approche réduit la latence et les temps d'attente, facilitant l'exécution de tâches d'IA complexes sans infrastructure coûteuse.