OpenAI führt die von GPT-6 Astra angetriebenen Dots für Pro-, Business-Premium- und Enterprise-Nutzer in verfügbaren Regionen ein; die Agenten verbinden sich mit mehr als 4.000 Apps, während die proaktive Recherche nur lesende Werkzeuge nutzt.
Praktische Bedeutung
Dots sind für dauerhafte Aufgaben und Hintergrundrecherchen über verbundene Apps hinweg gedacht.
OpenAI hat GPT-6.1 Sol vorgestellt und gibt an, dass das Modell bei DeepSWE v1.1 das Niveau von GPT-6 Astra zu etwa einem Fünftel der Kosten pro Aufgabe erreicht.
Praktische Bedeutung
Entwickler können das Modell für Programmier- und berufliche Arbeitsabläufe prüfen und Ergebnisse sowie Kosten mit eigenen Aufgaben vergleichen.
Das Tool ermöglicht Agenten die Interaktion mit Websites in einer von OpenAI gehosteten Umgebung und verlangt vor dem Zugriff auf jeden neuen Website-Ursprung die Zustimmung des Nutzers.
Praktische Bedeutung
Entwickler sollten den Zugriff auf Ressourcen beschränken, bei denen keine folgenreichen Aktionen möglich sind: Die API blockiert solche Aktionen nicht automatisch, und die Freigabe einer Website ist keine Zustimmung zu jeder Handlung.
Google hat Gemini 4 Argon für komplexe Aufgaben angekündigt. Das Modell wird über das Fairwind-Programm für vertrauenswürdige Cyberabwehrteams bereitgestellt.
Das Output-Limit von einer Million Token, zuvor 64.000, soll tiefgehendes Denken bei komplexen, langwierigen Arbeitsabläufen ermöglichen.
Quine ist ein Forschungsvorhaben von Microsoft Research, das ein biologisches Weltmodell mit wissenschaftlichen Werkzeugen verbindet; der Zugang ist zunächst begrenzt.
Quine soll Forschenden helfen, mithilfe computergestützter Vorhersagen Hypothesen und Experimente zu priorisieren, nicht aber Labortests ersetzen.
Anthropic berichtet, dass GLM-5.3 End-to-End-Exploits generieren kann, was erhebliche Sicherheitslücken im Modell aufzeigt.
Die Veröffentlichung eines leistungsstarken Modells mit offenen Gewichten, das zu autonomen Angriffen fähig ist, verändert die Bedrohungslage und zwingt Entwickler sowie Sicherheitsexperten, automatisierte Hochgeschwindigkeits-Schwachstellenforschung in ihre Abwehrstrategien einzubeziehen.
Anthropic positioniert Claude Sonnet 5.5 für die tägliche Arbeit. Hier erfahren Sie, was sich geändert hat und warum dies für KI-Teams von Bedeutung sein könnte.
Für Teams, die eine hohe Anzahl an Routineaufgaben abwickeln, können Geschwindigkeit und Kosten die Wirtschaftlichkeit der Automatisierung verändern. Da diese Zahlen vom Anbieter stammen, sollten Teams die Ergebnisse anhand ihrer eigenen Arbeitslasten vergleichen, bevor sie zu dem Modell wechseln.
NVIDIA hat Metropolis Blueprint VSS 3.3 veröffentlicht, das mit dem neuen Tool vss-build-vision-ai die Erstellung von Videoanalyse-Agenten per Prompt ermöglicht.
Das Update reduziert den Aufwand bei der Entwicklung von Videoanalyse-Pipelines, da Entwickler KI-Agenten direkt über Prompts konfigurieren können.
OpenAI führt mit Dots intelligente Agenten ein, die Aufgaben in Drittanwendungen autonom ausführen und im Hintergrund proaktiv agieren.
Dots ermöglichen es Nutzern, komplexe und wiederkehrende Aufgaben an ein System auszulagern, das eigenständig mit externer Software interagiert. Dies reduziert den manuellen Aufwand bei der Arbeit in verschiedenen digitalen Umgebungen.
Salesforce berichtet über KI-Agenten im Kundenservice: Canada Goose nennt Lösungsquoten, AT&T nutzt Kundenkontext für Briefings seiner Fachkräfte.
Die Beispiele zeigen, dass automatisierter Service mit der Vorbereitung von Beschäftigten und Kontrollen des Modellverhaltens einhergehen kann. Die Ergebnisse sind Unternehmensangaben; Methoden und Ausgangswerte fehlen, eine unabhängige Prüfung gibt es nicht.
Barclays setzt Claude breiter ein. Anthropic beschreibt einen Assistenten für Beschäftigte und die E-Mail-Verarbeitung. Die Bank erwartet, dass 2027 eine Mehrheit ihrer Softwareingenieure Claude Code nutzt.
Die Mitteilung beschreibt den Einsatz von Claude in der Softwareentwicklung und in internen Bankabläufen. Angaben zur Nutzung und E-Mail-Verarbeitung stammen von Anthropic; die Zahlen zur Claude-Code-Nutzung sind Erwartungen von Barclays und noch keine erreichten Ergebnisse.
Ein Machine-Learning-System bewertet Weltraumwetterrisiken für 66.935 Umspannwerke in den kontinentalen USA und erstellt standortspezifische Prognosen 30 bis 60 Minuten vor möglichen Auswirkungen.
Nach weiterer Validierung mit Versorgungsunternehmen und Betriebsdaten könnten die Schätzungen helfen, technische Prüfungen zu priorisieren und gezielte Schutzmaßnahmen zu erwägen.
Salesforce hat das auf NVIDIA Nemotron 3 basierende Modell Koa sowie ein neues Framework namens Enterprise AI Harness zur KI-Governance eingeführt.
Unternehmen erhalten damit eine kontrollierte Umgebung, um spezialisierte KI-Modelle in bestehende Arbeitsabläufe zu integrieren und dabei Sicherheits- und Qualitätsvorgaben einzuhalten.
Meta stattet den KI-Agenten Muse mit neuen Schnittstellen aus, um die Automatisierung von Geschäftsabläufen für kleine Unternehmen zu erleichtern.
Die Zentralisierung administrativer und kommunikativer Aufgaben in einem KI-gestützten Tool soll Kleinunternehmern helfen, den täglichen operativen Aufwand zu reduzieren.
Das auf Buchhaltungs-KI spezialisierte Unternehmen Basis hat einen internen Test zur Effizienz der Modelle Astra und Sol bei Steuer-Workbooks veröffentlicht.
Der Test zeigt, wie eine adaptive Steuerung der Rechenkapazität während der Bearbeitung komplexer Buchhaltungsaufgaben die Effizienz steigern kann.
Nutzer von Copilot Pro, Pro+, Max, Business und Enterprise können Code-Reviews über unterstützte REST- und GraphQL-APIs anfordern und den Prüfaufwand je Anfrage optional festlegen.
Teams mit einem der genannten Tarife können über die unterstützten APIs aus eigenen Skripten, Workflows und internen Werkzeugen Reviews anfordern. Der Prüfaufwand lässt sich pro Anfrage festlegen; die Balanced-Vorgabe lässt eine ausdrücklich ausgewählte Lite-Einstellung bestehen.
Die Änderung gilt für alle Copilot-Funktionen. GitHub nennt drei Alternativen; Administratoren von Copilot Enterprise müssen den Zugriff möglicherweise über Modellrichtlinien freischalten.
Die Änderung betrifft die Modellauswahl in allen Copilot-Funktionen. Nutzer sollten Arbeitsabläufe und Integrationen prüfen; Enterprise-Administratoren müssen gegebenenfalls den Zugriff auf Alternativen in den Einstellungen kontrollieren.
Microsoft Foundry bietet Streaming-Transkription in 60 Sprachen und zwei Sprachsynthese-Modelle. Microsoft hat außerdem Preise veröffentlicht und weitere geplante Plattformen genannt.
Entwickler können Streaming-Transkription mit ersten Teilergebnissen innerhalb der ersten wenigen hundert Millisekunden mit einem von zwei Sprachsynthese-Modellen kombinieren. Die veröffentlichten Preise pro Audio-Stunde und pro 1 Million Zeichen helfen bei der Kostenplanung. Microsofts Leistungsangaben sind hier nicht unabhängig überprüft.
Das Data Agent Kit von Google Cloud ist nun allgemein verfügbar und ermöglicht die Anbindung von KI-Coding-Agenten via Model Context Protocol.
Entwickler können ihre KI-Tools nun direkt mit operativen Datenbanken und Analytics-Umgebungen verknüpfen, was den Workflow bei der Datenverarbeitung vereinfacht.
CoreWeave bietet frühen Zugang zu NVIDIA Vera Rubin NVL72-Systemen mit Spectrum-X-Netzwerktechnik und neuen Werkzeugen für agentische KI.
Die neuen Hardware-Optionen und Software-Workflows bieten Entwicklern konkrete Leistungsdaten, um Inferenz-Workloads und Entwicklungszyklen für KI-Agenten effizienter zu gestalten.
Das Open TTS Leaderboard von Hugging Face vergleicht offene TTS-Modelle anhand von WER/CER, RTFx, TTFA und Sprecherähnlichkeit. Die Kennzahlen ergänzen menschliche Präferenzen, ersetzen sie aber nicht.
Für Entwickler bietet das Leaderboard einen schnelleren und reproduzierbareren Modellvergleich als das Sammeln von Stimmen über mehrere Wochen. WER und Sprecherähnlichkeit sind jedoch nur Näherungswerte: Sie messen weder Natürlichkeit, Ausdruck noch Zuhörerpräferenzen, und das Leaderboard ersetzt keine menschliche Rangliste.
Entwickler können nun KI-Agenten zur Web-Navigation und Interaktion mit Browser-Oberflächen in einer OpenAI-Umgebung erstellen.
Die Funktion ermöglicht die Automatisierung von Web-Aufgaben und Tests. Entwickler müssen jedoch Sicherheitsvorkehrungen treffen, da das System nicht automatisch zwischen sicherem Surfen und risikobehafteten Aktionen unterscheidet.
OpenAI bezeichnet Ultrafast als die schnellste Service-Stufe seiner API. Sie ist für GPT-6 Astra allen API-Nutzern zugänglich, allerdings mit niedrigen Limits; für GPT-5.6 Sol gibt es Vorschauzugang.
Entwicklungsteams können für GPT-6 Astra OpenAIs schnellste API-Service-Stufe auswählen und dabei höhere Kosten, niedrige Limits und Einschränkungen bei der regionalen Verarbeitung berücksichtigen.
Die API-Dokumentation zu GPT-6.1 Sol nennt Kontext- und Ausgabelimits, Reasoning-Stufen, Tokenpreise und Einschränkungen für EU-Datenresidenz.
Damit können Entwickler API-Kosten und Anforderungen an den Datenstandort einschätzen. Die Ankündigung des Modells wird in einem eigenen Artikel behandelt.
Amazon hat die Integration von Grok 4.7 in Amazon Bedrock bekannt gegeben. Die neue Modellversion bietet ein Kontextfenster von 500.000 Token.
Durch die Skalierbarkeit des Kontextfensters und die anpassbare Rechenleistung ermöglicht AWS Entwicklern eine präzisere Steuerung bei der Umsetzung agentengestützter Workflows.
AWS integriert das neue KI-Modell Claude Sonnet 5.5 in Amazon Bedrock. Laut Anbieter bietet es schnellere Abläufe und geringere Kosten für Programmieraufgaben.
Die Verfügbarkeit einer kosteneffizienteren Modellvariante ermöglicht es Unternehmen, KI-gestützte Workflows in der Cloud wirtschaftlicher zu skalieren. Dies ist besonders relevant für technische Teams, die automatisierte Analysen und Dokumentationen in bestehende Prozesse einbinden.
GitHub integriert das Anthropic-Modell Claude Sonnet 5.5 in Copilot. Es ist für Pro-, Pro+-, Max-, Business- und Enterprise-Pläne mit nutzungsbasierter Abrechnung verfügbar.
Durch die Einbindung erhalten Entwickler direkten Zugriff auf die Technologie von Anthropic innerhalb der Copilot-Umgebung.
NVIDIA kündigt eine offene Softwareplattform und ein Referenzsystemdesign an, um KI-Agenten vom Test bis zur Bereitstellung über Software und Infrastruktur hinweg zu steuern.
Die Plattform ergänzt die Steuerung über das Modell und das Agenten-Framework hinaus um Kontrollen auf Infrastrukturebene. So können Unternehmen Grenzen für autonome Agenten festlegen und durchsetzen.