OpenAI déploie Dots, propulsé par GPT-6 Astra, auprès des utilisateurs Pro, Business Premium et Enterprise dans les régions éligibles ; les agents se connectent à plus de 4 000 applications, tandis que la recherche proactive utilise des outils en lecture seule.
Portée pratique
Dots sont conçus pour gérer des tâches persistantes et effectuer des recherches en arrière-plan dans les applications connectées.
OpenAI a présenté GPT-6.1 Sol et affirme que le modèle atteint le niveau de GPT-6 Astra sur DeepSWE v1.1 pour environ un cinquième du coût par tâche.
Portée pratique
Les développeurs peuvent l’évaluer pour le codage et les tâches professionnelles en comparant les résultats et les coûts sur leurs propres cas d’usage.
L’outil permet aux agents d’interagir avec des sites web dans un environnement hébergé par OpenAI et exige l’accord de l’utilisateur avant tout accès à une nouvelle origine de site.
Portée pratique
Les développeurs devraient limiter l’accès aux ressources où les actions lourdes de conséquences sont impossibles : l’API ne les bloque pas d’elle-même, et l’autorisation d’accéder à un site ne vaut pas approbation de chaque action.
Google a annoncé Gemini 4 Argon pour les tâches complexes. Le modèle est déployé auprès de cyberdéfenseurs de confiance via le programme Fairwind.
La limite de sortie d’un million de jetons, contre 64 000 auparavant, vise à soutenir un raisonnement approfondi sur des tâches complexes et de longue durée.
Quine est un projet de recherche de Microsoft Research reliant un modèle du vivant à des outils scientifiques ; l’accès initial est limité à son programme Fellows et à certaines collaborations.
Quine vise à aider les chercheurs à prioriser des hypothèses et des expériences grâce aux prédictions informatiques, sans remplacer les essais en laboratoire.
OpenAI introduit GPT-6.1 Sol, un modèle offrant des performances professionnelles similaires à GPT-6 Astra avec une structure tarifaire optimisée.
Cette mise à disposition permet aux développeurs de maintenir des standards élevés de performance pour le développement logiciel tout en optimisant leurs dépenses API.
Anthropic rapporte que GLM-5.3 peut générer des exploits complets, soulignant des limites importantes dans les protocoles de sécurité du modèle.
La sortie d'un modèle puissant à poids ouverts capable d'exploitation autonome modifie le paysage des menaces, obligeant les défenseurs et les développeurs de logiciels à prendre en compte la recherche de vulnérabilités automatisée à haute vitesse.
Anthropic positionne Claude Sonnet 5.5 pour le travail quotidien. Voici les nouveautés et les raisons pour lesquelles cela pourrait intéresser les équipes travaillant sur l'IA.
Pour les équipes gérant un volume important de tâches routinières, la vitesse et le coût peuvent modifier l'économie de l'automatisation. Ces chiffres émanant du fournisseur, les équipes devraient comparer les résultats sur leurs propres charges de travail avant de migrer.
GitHub propose en préversion publique une fonctionnalité permettant à Copilot d'opérer directement sur les applications macOS et Windows.
Cette mise à jour permet d'automatiser des processus complexes dans des logiciels dépourvus d'API, incluant les outils legacy ou les interfaces purement graphiques.
NVIDIA propose la version 3.3 de VSS, introduisant l'outil vss-build-vision-ai pour concevoir des agents d'analyse vidéo via des invites textuelles.
Cette mise à jour simplifie la création de systèmes d'analyse vidéo en permettant aux ingénieurs de générer des agents opérationnels par simple requête textuelle.
OpenAI déploie Dots, des agents IA capables de gérer des applications tierces et d'effectuer des recherches proactives pour les utilisateurs professionnels.
L'arrivée des Dots permet aux utilisateurs de déléguer des processus complexes et répétitifs à un agent capable d'interagir avec divers logiciels de façon indépendante, transformant ainsi la gestion des flux de travail quotidiens.
Salesforce présente des exemples d’agents IA dans le service, dont les taux de résolution rapportés par Canada Goose et les briefings de conseillers chez AT&T.
Ces exemples montrent que l’automatisation du service peut s’accompagner de la préparation des équipes et de contrôles du comportement des modèles. Les résultats sont déclarés par les entreprises, sans méthode ni valeurs de référence, et ne sont pas vérifiés indépendamment.
Barclays élargit l’usage de Claude. Anthropic décrit un assistant pour le personnel et le traitement des e-mails. La banque s’attend à ce qu’une majorité de ses ingénieurs logiciels utilisent Claude Code en 2027.
L’annonce décrit l’usage de Claude dans le développement logiciel et les opérations internes d’une banque. Les chiffres sur l’assistant et le traitement des e-mails sont rapportés par Anthropic ; ceux concernant Claude Code sont des attentes de Barclays, pas des résultats acquis.
Un système de machine learning évalue les risques liés à la météo spatiale pour 66 935 postes électriques aux États-Unis continentaux et produit des estimations localisées 30 à 60 minutes avant des effets possibles.
Après une validation supplémentaire avec les services publics et des données opérationnelles, ces estimations pourraient aider les opérateurs à prioriser les examens techniques et à envisager des mesures de protection ciblées.
Après un test réussi, Whitbread étend l'accès à Microsoft Copilot à 1 650 employés pour optimiser ses opérations.
Cette extension vise à accroître l'efficacité opérationnelle et à permettre au personnel de se concentrer sur des prises de décision à plus forte valeur ajoutée.
Salesforce a présenté Koa, un modèle basé sur NVIDIA Nemotron 3, ainsi qu'une infrastructure Enterprise AI Harness pour sécuriser et gouverner les agents IA.
Ces outils permettent aux entreprises de déployer des modèles spécialisés tout en gardant un contrôle strict sur la conformité, les données et les actions exécutées par les agents IA.
Meta ajoute de nouvelles fonctionnalités à l'agent IA Muse pour aider les petites entreprises à automatiser leurs tâches de gestion.
En centralisant la gestion opérationnelle et les communications au sein d'un seul assistant IA, Meta cherche à simplifier les flux de travail quotidiens des petites structures.
La société Basis a publié une étude interne comparant l'efficacité des modèles GPT-6 Astra et GPT-5.6 Sol sur des fichiers fiscaux de 50 onglets.
Ce retour d'expérience illustre l'impact de l'ajustement dynamique des ressources informatiques sur la rapidité et la précision des processus comptables automatisés.
Les utilisateurs de Copilot Pro, Pro+, Max, Business et Enterprise peuvent demander des revues via les API REST et GraphQL prises en charge et régler facultativement l’effort pour chaque demande.
Les équipes disposant de l’une des offres concernées peuvent demander des revues via les API prises en charge depuis leurs propres scripts, processus et outils internes. Elles peuvent définir le niveau d’effort pour chaque demande ; la valeur par défaut Balanced ne remplace pas un choix explicite de Lite.
Le changement concerne toutes les fonctions de Copilot. GitHub indique trois alternatives ; les administrateurs Copilot Enterprise devront peut-être en activer l’accès via les règles de modèles.
Le changement concerne le choix des modèles dans toutes les fonctions de Copilot. Les utilisateurs devraient vérifier leurs flux de travail et intégrations ; les administrateurs Enterprise devront peut-être contrôler l’accès aux alternatives dans les paramètres.
Microsoft Foundry propose la transcription en flux dans 60 langues et deux modèles de synthèse vocale. Microsoft a également publié les tarifs et cité des plateformes prévues.
Les développeurs peuvent associer la transcription en flux, dont les premières hypothèses arrivent dans les premières centaines de millisecondes, à l’un des deux modèles de synthèse vocale. Les tarifs publiés par heure d’audio et par million de caractères aident à estimer les coûts. Les performances annoncées par Microsoft ne sont pas vérifiées indépendamment ici.
Le Data Agent Kit est désormais disponible, permettant aux agents IA de se connecter aux services Google Cloud via le protocole MCP.
Cette mise à jour offre aux développeurs un accès direct aux bases de données analytiques et opérationnelles pour leurs agents, sans nécessiter de pipelines d'ingestion complexes.
CoreWeave propose un accès anticipé aux systèmes NVIDIA Vera Rubin NVL72 avec réseau Spectrum-X, optimisés pour le développement d'IA agentique.
Ces nouvelles options matérielles et logicielles permettent aux entreprises de quantifier les gains en performance lors de l'entraînement et de l'exécution de modèles d'IA complexes.
L’Open TTS Leaderboard de Hugging Face compare les modèles TTS ouverts avec le WER/CER, le RTFx, le TTFA et la similarité de locuteur. Ces scores complètent les préférences humaines sans les remplacer.
Pour les développeurs, le leaderboard offre une comparaison plus rapide et plus reproductible que la collecte de votes sur plusieurs semaines. Mais le WER et la similarité de locuteur restent des proxys : ils ne mesurent ni le naturel, ni l’expressivité, ni les préférences des auditeurs, et le classement ne les remplace pas.
Les développeurs peuvent désormais créer des agents IA capables de naviguer sur le Web dans un environnement géré par OpenAI.
Cette mise à jour facilite l'automatisation des tests web et de la collecte d'informations, tout en responsabilisant les développeurs quant au contrôle de sécurité des actions effectuées par les agents.
OpenAI décrit Ultrafast comme le niveau de service le plus rapide de son API. Il est accessible à tous les utilisateurs de l’API pour GPT-6 Astra, avec des limites basses ; GPT-5.6 Sol est disponible en avant-première.
Les développeurs peuvent choisir le niveau de service API le plus rapide d’OpenAI pour GPT-6 Astra, tout en tenant compte du coût supérieur, des limites basses et des restrictions de traitement régional.
La documentation de l’API GPT-6.1 Sol précise les limites de contexte et de sortie, les niveaux de raisonnement, les tarifs et les restrictions en UE.
Ces caractéristiques aident les développeurs à estimer les coûts de l’API et les contraintes de déploiement. L’annonce du modèle fait l’objet d’un article distinct.
Amazon intègre Grok 4.7 à sa plateforme Bedrock, offrant une fenêtre de contexte de 500 000 jetons et des niveaux de raisonnement configurables.
La possibilité d'ajuster l'effort de raisonnement et de gérer de vastes contextes permet d'adapter précisément les performances du modèle aux besoins spécifiques des applications professionnelles.
Le service Amazon Bedrock propose désormais Claude Sonnet 5.5, un modèle optimisé pour réduire les coûts et accélérer les tâches de programmation et d'analyse.
L'ajout de ce modèle permet aux entreprises d'optimiser leurs charges de travail liées à l'IA générative. En améliorant le rapport performance-prix, AWS facilite l'automatisation à grande échelle de tâches techniques complexes au sein des environnements de développement.
NVIDIA annonce une plateforme logicielle ouverte et un système de référence pour encadrer les agents d’IA, des tests au déploiement, sur l’ensemble de l’infrastructure.
La plateforme ajoute des mécanismes de gouvernance au-delà du modèle et de l’environnement logiciel de l’agent, notamment au niveau de l’infrastructure. Les organisations peuvent ainsi définir et faire respecter des limites d’action.