2026-W40 · 31 Beiträge

Die KI-Woche im Überblick: 28. September 2026 – 4. Oktober 2026

Die wichtigsten Entwicklungen der Woche, nach dem Datum der Originalquelle geordnet. Jeder Eintrag verlinkt auf unseren Beitrag und die Quelle.

Ausgabedatum: ·Woche: 28. September 2026 – 4. Oktober 2026

Was sich diese Woche geändert hat

Drei wichtige Änderungen

  1. OpenAI beginnt mit der Einführung der persistenten Dots-Agenten

    Was sich geändert hat
    OpenAI führt die von GPT-6 Astra angetriebenen Dots für Pro-, Business-Premium- und Enterprise-Nutzer in verfügbaren Regionen ein; die Agenten verbinden sich mit mehr als 4.000 Apps, während die proaktive Recherche nur lesende Werkzeuge nutzt.
    Praktische Bedeutung
    Dots sind für dauerhafte Aufgaben und Hintergrundrecherchen über verbundene Apps hinweg gedacht.
    Zum Beitrag ↗
  2. OpenAI veröffentlicht GPT-6.1 Sol

    Was sich geändert hat
    OpenAI hat GPT-6.1 Sol vorgestellt und gibt an, dass das Modell bei DeepSWE v1.1 das Niveau von GPT-6 Astra zu etwa einem Fünftel der Kosten pro Aufgabe erreicht.
    Praktische Bedeutung
    Entwickler können das Modell für Programmier- und berufliche Arbeitsabläufe prüfen und Ergebnisse sowie Kosten mit eigenen Aufgaben vergleichen.
    Zum Beitrag ↗
  3. Computer-Use-Tool für die OpenAI Agents API

    Was sich geändert hat
    Das Tool ermöglicht Agenten die Interaktion mit Websites in einer von OpenAI gehosteten Umgebung und verlangt vor dem Zugriff auf jeden neuen Website-Ursprung die Zustimmung des Nutzers.
    Praktische Bedeutung
    Entwickler sollten den Zugriff auf Ressourcen beschränken, bei denen keine folgenreichen Aktionen möglich sind: Die API blockiert solche Aktionen nicht automatisch, und die Freigabe einer Website ist keine Zustimmung zu jeder Handlung.
    Zum Beitrag ↗

Modelle

6

Microsoft Research stellt das Forschungssystem Quine vor

Quine ist ein Forschungsvorhaben von Microsoft Research, das ein biologisches Weltmodell mit wissenschaftlichen Werkzeugen verbindet; der Zugang ist zunächst begrenzt.

Quine soll Forschenden helfen, mithilfe computergestützter Vorhersagen Hypothesen und Experimente zu priorisieren, nicht aber Labortests ersetzen.

Zum Beitrag ↗Originalquelle ↗

KI-Modell GLM-5.3 zeigt Fähigkeiten zu autonomen Cyberangriffen

Anthropic berichtet, dass GLM-5.3 End-to-End-Exploits generieren kann, was erhebliche Sicherheitslücken im Modell aufzeigt.

Die Veröffentlichung eines leistungsstarken Modells mit offenen Gewichten, das zu autonomen Angriffen fähig ist, verändert die Bedrohungslage und zwingt Entwickler sowie Sicherheitsexperten, automatisierte Hochgeschwindigkeits-Schwachstellenforschung in ihre Abwehrstrategien einzubeziehen.

Zum Beitrag ↗Originalquelle ↗

Claude Sonnet 5.5: Anthropic meldet schnellere Antworten und niedrigere Kosten

Anthropic positioniert Claude Sonnet 5.5 für die tägliche Arbeit. Hier erfahren Sie, was sich geändert hat und warum dies für KI-Teams von Bedeutung sein könnte.

Für Teams, die eine hohe Anzahl an Routineaufgaben abwickeln, können Geschwindigkeit und Kosten die Wirtschaftlichkeit der Automatisierung verändern. Da diese Zahlen vom Anbieter stammen, sollten Teams die Ergebnisse anhand ihrer eigenen Arbeitslasten vergleichen, bevor sie zu dem Modell wechseln.

Zum Beitrag ↗Originalquelle ↗

Produkte

3

NVIDIA veröffentlicht Metropolis Blueprint VSS 3.3

NVIDIA hat Metropolis Blueprint VSS 3.3 veröffentlicht, das mit dem neuen Tool vss-build-vision-ai die Erstellung von Videoanalyse-Agenten per Prompt ermöglicht.

Das Update reduziert den Aufwand bei der Entwicklung von Videoanalyse-Pipelines, da Entwickler KI-Agenten direkt über Prompts konfigurieren können.

Zum Beitrag ↗Originalquelle ↗

OpenAI stellt Dots vor: Autonome KI-Agenten auf Basis von GPT-6 Astra

OpenAI führt mit Dots intelligente Agenten ein, die Aufgaben in Drittanwendungen autonom ausführen und im Hintergrund proaktiv agieren.

Dots ermöglichen es Nutzern, komplexe und wiederkehrende Aufgaben an ein System auszulagern, das eigenständig mit externer Software interagiert. Dies reduziert den manuellen Aufwand bei der Arbeit in verschiedenen digitalen Umgebungen.

Zum Beitrag ↗Originalquelle ↗

Anwendung

7

Salesforce zeigt Beispiele für Agentforce im Kundenservice

Salesforce berichtet über KI-Agenten im Kundenservice: Canada Goose nennt Lösungsquoten, AT&T nutzt Kundenkontext für Briefings seiner Fachkräfte.

Die Beispiele zeigen, dass automatisierter Service mit der Vorbereitung von Beschäftigten und Kontrollen des Modellverhaltens einhergehen kann. Die Ergebnisse sind Unternehmensangaben; Methoden und Ausgangswerte fehlen, eine unabhängige Prüfung gibt es nicht.

Zum Beitrag ↗Originalquelle ↗

Barclays weitet den Claude-Einsatz aus und erwartet mehr Claude-Code-Nutzung bis 2027

Barclays setzt Claude breiter ein. Anthropic beschreibt einen Assistenten für Beschäftigte und die E-Mail-Verarbeitung. Die Bank erwartet, dass 2027 eine Mehrheit ihrer Softwareingenieure Claude Code nutzt.

Die Mitteilung beschreibt den Einsatz von Claude in der Softwareentwicklung und in internen Bankabläufen. Angaben zur Nutzung und E-Mail-Verarbeitung stammen von Anthropic; die Zahlen zur Claude-Code-Nutzung sind Erwartungen von Barclays und noch keine erreichten Ergebnisse.

Zum Beitrag ↗Originalquelle ↗

Microsoft Research entwickelt KI zur Bewertung von Weltraumwetterrisiken für Stromnetze

Ein Machine-Learning-System bewertet Weltraumwetterrisiken für 66.935 Umspannwerke in den kontinentalen USA und erstellt standortspezifische Prognosen 30 bis 60 Minuten vor möglichen Auswirkungen.

Nach weiterer Validierung mit Versorgungsunternehmen und Betriebsdaten könnten die Schätzungen helfen, technische Prüfungen zu priorisieren und gezielte Schutzmaßnahmen zu erwägen.

Zum Beitrag ↗Originalquelle ↗

Salesforce stellt Koa CRM-KI-Modell vor

Salesforce hat das auf NVIDIA Nemotron 3 basierende Modell Koa sowie ein neues Framework namens Enterprise AI Harness zur KI-Governance eingeführt.

Unternehmen erhalten damit eine kontrollierte Umgebung, um spezialisierte KI-Modelle in bestehende Arbeitsabläufe zu integrieren und dabei Sicherheits- und Qualitätsvorgaben einzuhalten.

Zum Beitrag ↗Originalquelle ↗

Für Entwickler

15

GitHub gibt Copilot-Code-Reviews per API für fünf Tarife frei; Balanced ist der Standard

Nutzer von Copilot Pro, Pro+, Max, Business und Enterprise können Code-Reviews über unterstützte REST- und GraphQL-APIs anfordern und den Prüfaufwand je Anfrage optional festlegen.

Teams mit einem der genannten Tarife können über die unterstützten APIs aus eigenen Skripten, Workflows und internen Werkzeugen Reviews anfordern. Der Prüfaufwand lässt sich pro Anfrage festlegen; die Balanced-Vorgabe lässt eine ausdrücklich ausgewählte Lite-Einstellung bestehen.

Zum Beitrag ↗Originalquelle ↗

GitHub stuft vier Modelle in allen Copilot-Funktionen zum 2. Oktober 2026 als veraltet ein

Die Änderung gilt für alle Copilot-Funktionen. GitHub nennt drei Alternativen; Administratoren von Copilot Enterprise müssen den Zugriff möglicherweise über Modellrichtlinien freischalten.

Die Änderung betrifft die Modellauswahl in allen Copilot-Funktionen. Nutzer sollten Arbeitsabläufe und Integrationen prüfen; Enterprise-Administratoren müssen gegebenenfalls den Zugriff auf Alternativen in den Einstellungen kontrollieren.

Zum Beitrag ↗Originalquelle ↗

Microsoft stellt drei MAI-Sprachmodelle in Microsoft Foundry vor

Microsoft Foundry bietet Streaming-Transkription in 60 Sprachen und zwei Sprachsynthese-Modelle. Microsoft hat außerdem Preise veröffentlicht und weitere geplante Plattformen genannt.

Entwickler können Streaming-Transkription mit ersten Teilergebnissen innerhalb der ersten wenigen hundert Millisekunden mit einem von zwei Sprachsynthese-Modellen kombinieren. Die veröffentlichten Preise pro Audio-Stunde und pro 1 Million Zeichen helfen bei der Kostenplanung. Microsofts Leistungsangaben sind hier nicht unabhängig überprüft.

Zum Beitrag ↗Originalquelle ↗

Hugging Face stellt Open TTS Leaderboard für objektive TTS-Bewertung vor

Das Open TTS Leaderboard von Hugging Face vergleicht offene TTS-Modelle anhand von WER/CER, RTFx, TTFA und Sprecherähnlichkeit. Die Kennzahlen ergänzen menschliche Präferenzen, ersetzen sie aber nicht.

Für Entwickler bietet das Leaderboard einen schnelleren und reproduzierbareren Modellvergleich als das Sammeln von Stimmen über mehrere Wochen. WER und Sprecherähnlichkeit sind jedoch nur Näherungswerte: Sie messen weder Natürlichkeit, Ausdruck noch Zuhörerpräferenzen, und das Leaderboard ersetzt keine menschliche Rangliste.

Zum Beitrag ↗Originalquelle ↗

OpenAI integriert Computer-Use-Funktion in die Agents API

Entwickler können nun KI-Agenten zur Web-Navigation und Interaktion mit Browser-Oberflächen in einer OpenAI-Umgebung erstellen.

Die Funktion ermöglicht die Automatisierung von Web-Aufgaben und Tests. Entwickler müssen jedoch Sicherheitsvorkehrungen treffen, da das System nicht automatisch zwischen sicherem Surfen und risikobehafteten Aktionen unterscheidet.

Zum Beitrag ↗Originalquelle ↗

OpenAI: Ultrafast ist für GPT-6 Astra verfügbar – mit niedrigen Limits

OpenAI bezeichnet Ultrafast als die schnellste Service-Stufe seiner API. Sie ist für GPT-6 Astra allen API-Nutzern zugänglich, allerdings mit niedrigen Limits; für GPT-5.6 Sol gibt es Vorschauzugang.

Entwicklungsteams können für GPT-6 Astra OpenAIs schnellste API-Service-Stufe auswählen und dabei höhere Kosten, niedrige Limits und Einschränkungen bei der regionalen Verarbeitung berücksichtigen.

Zum Beitrag ↗Originalquelle ↗

GPT-6.1 Sol Modell auf Amazon Bedrock verfügbar

Das Modell GPT-6.1 Sol ist ab sofort in Amazon Bedrock verfügbar. Es ermöglicht Entwicklern effizientere Abläufe bei reduzierten Kosten.

Die Neuerung erlaubt eine kostengünstigere Abwicklung komplexer Geschäftsprozesse bei gleichzeitiger Steigerung der analytischen Leistung.

Zum Beitrag ↗Originalquelle ↗

Grok 4.7 ist ab sofort auf Amazon Bedrock verfügbar

Amazon hat die Integration von Grok 4.7 in Amazon Bedrock bekannt gegeben. Die neue Modellversion bietet ein Kontextfenster von 500.000 Token.

Durch die Skalierbarkeit des Kontextfensters und die anpassbare Rechenleistung ermöglicht AWS Entwicklern eine präzisere Steuerung bei der Umsetzung agentengestützter Workflows.

Zum Beitrag ↗Originalquelle ↗

Claude Sonnet 5.5 ab sofort in Amazon Bedrock verfügbar

AWS integriert das neue KI-Modell Claude Sonnet 5.5 in Amazon Bedrock. Laut Anbieter bietet es schnellere Abläufe und geringere Kosten für Programmieraufgaben.

Die Verfügbarkeit einer kosteneffizienteren Modellvariante ermöglicht es Unternehmen, KI-gestützte Workflows in der Cloud wirtschaftlicher zu skalieren. Dies ist besonders relevant für technische Teams, die automatisierte Analysen und Dokumentationen in bestehende Prozesse einbinden.

Zum Beitrag ↗Originalquelle ↗

GitHub Copilot integriert Modell Claude Sonnet 5.5

GitHub integriert das Anthropic-Modell Claude Sonnet 5.5 in Copilot. Es ist für Pro-, Pro+-, Max-, Business- und Enterprise-Pläne mit nutzungsbasierter Abrechnung verfügbar.

Durch die Einbindung erhalten Entwickler direkten Zugriff auf die Technologie von Anthropic innerhalb der Copilot-Umgebung.

Zum Beitrag ↗Originalquelle ↗

NVIDIA kündigt Open Agent Safety Platform an

NVIDIA kündigt eine offene Softwareplattform und ein Referenzsystemdesign an, um KI-Agenten vom Test bis zur Bereitstellung über Software und Infrastruktur hinweg zu steuern.

Die Plattform ergänzt die Steuerung über das Modell und das Agenten-Framework hinaus um Kontrollen auf Infrastrukturebene. So können Unternehmen Grenzen für autonome Agenten festlegen und durchsetzen.

Zum Beitrag ↗Originalquelle ↗