Les principaux changements concernant les modèles, les produits, les usages et les outils de développement. Chaque sujet renvoie à notre article et à la source originale.
Google présente Gemini 4 Argon, doté d'une limite de sortie d'un million de jetons. Les experts accèdent au modèle sans barrières de sécurité via le programme Fairwind.
Cette limite étendue facilite l'automatisation de processus complexes, de l'analyse vidéo à la correction de vulnérabilités logicielles.
OpenAI introduit GPT-6.1 Sol, un modèle offrant des performances professionnelles similaires à GPT-6 Astra avec une structure tarifaire optimisée.
Cette mise à disposition permet aux développeurs de maintenir des standards élevés de performance pour le développement logiciel tout en optimisant leurs dépenses API.
Anthropic positionne Claude Sonnet 5.5 pour le travail quotidien. Voici les nouveautés et les raisons pour lesquelles cela pourrait intéresser les équipes travaillant sur l'IA.
Pour les équipes gérant un volume important de tâches routinières, la vitesse et le coût peuvent modifier l'économie de l'automatisation. Ces chiffres émanant du fournisseur, les équipes devraient comparer les résultats sur leurs propres charges de travail avant de migrer.
OpenAI enrichit son écosystème GPT-6 avec les modèles Sol et Luna, combinant tarification API réduite et mise en cache optimisée.
Cette mise à jour permet aux développeurs et aux entreprises d'optimiser leurs coûts opérationnels tout en bénéficiant de capacités de traitement plus fluides pour les tâches récurrentes.
La plateforme fournit des prédictions sur 9 milliards de variantes génétiques, facilitant l'interprétation des données de l'ADN humain.
Cette ressource aide les chercheurs à identifier les variantes causales dans les maladies rares et à mieux cerner les associations génétiques, accélérant ainsi les découvertes en génomique.
OpenAI présente GPT-6 Astra, un modèle affichant des records sur plusieurs benchmarks et une efficacité renforcée pour les tâches informatiques.
GPT-6 Astra automatise des flux de travail professionnels complexes tout en soulevant des défis de sécurité liés à sa capacité de détection de vulnérabilités.
Google lance Gemini 3.8 Flash pour les tâches d'agent et une version Cyber dédiée à la détection automatique des vulnérabilités logicielles.
Ces modèles permettent aux entreprises de déployer des agents autonomes et des systèmes de correction de sécurité automatisés à un coût inférieur à celui des modèles de pointe les plus volumineux.
OpenAI déploie Dots, des agents IA capables de gérer des applications tierces et d'effectuer des recherches proactives pour les utilisateurs professionnels.
L'arrivée des Dots permet aux utilisateurs de déléguer des processus complexes et répétitifs à un agent capable d'interagir avec divers logiciels de façon indépendante, transformant ainsi la gestion des flux de travail quotidiens.
Microsoft lance Home, Code et Autopilot pour Copilot, transformant son assistant en une plateforme capable de gérer des flux de travail autonomes.
Ces ajouts permettent à Copilot de passer d'un rôle d'assistant conversationnel à celui de moteur d'automatisation. Les entreprises peuvent désormais confier des workflows complexes et le développement de solutions personnalisées à une infrastructure gérée par Microsoft.
Salesforce présente AIforce, une interface permettant d'accéder aux données CRM via Slack et Claude tout en garantissant la non-rétention des données.
Cette intégration aide les entreprises à centraliser leurs actions CRM dans leurs flux de travail quotidiens, limitant ainsi la fragmentation des outils.
OpenAI propose une version spécialisée de ChatGPT intégrant le modèle GPT-6 Astra et des données financières pour l'analyse professionnelle.
Cette solution permet aux institutions financières d'automatiser la recherche et la modélisation tout en garantissant la sécurité des données, répondant ainsi au besoin de précision dans l'analyse.
Meta ajoute de nouvelles fonctionnalités à l'agent IA Muse pour aider les petites entreprises à automatiser leurs tâches de gestion.
En centralisant la gestion opérationnelle et les communications au sein d'un seul assistant IA, Meta cherche à simplifier les flux de travail quotidiens des petites structures.
L'application Google Vids propose désormais la génération de vidéos via Gemini Omni 1.1 Flash, incluant l'upscaling 1080p et des outils de contrôle temporel.
Cette mise à jour apporte une flexibilité accrue pour le montage vidéo assisté par IA, permettant d'aligner le contenu visuel avec précision sur les besoins narratifs.
Google utilise le framework Mantis pour analyser le code en temps réel avant validation et corriger automatiquement les vulnérabilités détectées.
L'utilisation d'agents intelligents permet une détection continue et une remédiation rapide des failles, réduisant significativement la fenêtre d'exposition avant que le code n'atteigne la production.
Basis, Clay et Exa Labs automatisent l'intégration, la gestion de comptes et le développement, avec une validation humaine obligatoire des résultats.
La réussite des flux de travail automatisés repose sur la définition stricte du périmètre, des permissions et des points de contrôle humains pour garantir la fiabilité des opérations.
NVIDIA dévoile l'Open Agent Safety Platform, une solution matérielle et logicielle pour surveiller et contrôler les agents AI autonomes en temps réel.
Cette plateforme permet aux organisations de mettre en œuvre un contrôle hors bande et appliqué par le matériel. Cela empêche les agents autonomes de contourner les mesures de sécurité au niveau des applications.
Google met à jour Private AI Compute avec un stockage sécurisé utilisant des clés sur l'appareil pour préserver le contexte utilisateur.
Jusqu'à présent, la plateforme fonctionnait de manière sans état, effaçant tout contexte après chaque tâche. Cette nouvelle architecture permet une continuité de l'expérience utilisateur tout en maintenant une sécurité stricte des données personnelles.
Le nouveau système de cache pour GPT-6 permet des réductions de 90% sur les tokens et une gestion flexible de l'effort de raisonnement.
Ces améliorations réduisent les coûts opérationnels et accélèrent le temps de réponse pour les agents persistants. La modulation des paramètres tout en conservant le cache offre davantage de souplesse aux développeurs.
AWS introduit AgentCore, un runtime utilisant des snapshots et une gestion mémoire dynamique pour stabiliser les temps de démarrage des agents IA.
Ces améliorations permettent d'obtenir une exécution plus prévisible des agents et de réduire potentiellement les coûts grâce à une gestion dynamique des ressources.
Google Cloud déploie Agent Substrate sur GKE, une solution open-source visant à optimiser la densité et l'exécution sécurisée des agents IA autonomes.
Cette technologie répond aux besoins de mise à l'échelle des agents autonomes sur Kubernetes en résolvant les problèmes de consommation de ressources liés aux instances inactives. Elle assure une isolation nécessaire tout en réduisant la latence grâce à un plan de données spécialisé.
L'API GPT-Live-1 permet aux développeurs de concevoir des agents vocaux full-duplex capables d'écouter et de parler simultanément avec une gestion native des interruptions.
Cette architecture permet aux développeurs de créer des agents vocaux réactifs et des systèmes téléphoniques capables de maintenir un flux naturel en gérant nativement les interruptions.
OpenAI introduit l'Agents API, une infrastructure gérée pour les sessions persistantes, la compression du contexte et l'exécution d'agents autonomes.
Cette interface simplifie l'orchestration des sessions complexes et la gestion des environnements d'exécution pour les agents nécessitant une persistance.