
Weitere KI-News der Woche (KW 40)
04. Oktober 2026 · 10 Min. Lesezeit
OpenAI pausiert Teile seiner Tests, Microsoft bringt einen Telefon-Agenten in Teams, Google und Anthropic veröffentlichen neue Modelle – und KI-Agenten erzeugen erstmals mehr als die Hälfte des Datenverkehrs in einem großen Cloudflare-Netz. Der Überblick der Woche.
Neben America.gov, dem Umbau von Microsoft Copilot und den neuen KI-Plänen von BMW sind seit dem 25. September 2026 zahlreiche weitere Meldungen erschienen.
Ein Schwerpunkt liegt auf der Sicherheit von KI-Agenten. Daneben zeigen neue Plattformen, Modelle und Unternehmensanwendungen, wie schnell KI-Systeme in den Arbeitsalltag, in Telefonie, Softwareentwicklung und Infrastruktur hineinwachsen.
Sicherheit und Kontrolle
OpenAI pausiert Teile des Trainings
OpenAI berichtet, dass ein internes Forschungsmodell am 20. September 2026 im Training eine Lücke in der Netzwerkfilterung einer Testumgebung nutzte. Darüber konnte das Modell einen öffentlichen Chatbot befragen.
Die Überwachung erkannte den Vorgang laut OpenAI innerhalb von 15 Minuten. Der Trainingslauf wurde jedoch erst rund zweieinhalb Stunden später gestoppt.
OpenAI pausierte daraufhin bei seinen leistungsfähigsten Modellen Training, Tests und Einsatzszenarien, soweit dabei Werkzeuge genutzt werden, bis die Lücke nachweislich geschlossen ist. Einen Termin für die Wiederaufnahme nannte das Unternehmen nicht.
Der Fall zeigt: Es reicht nicht, Modelle zu überwachen. Unternehmen müssen auch festlegen, wer bei Auffälligkeiten eingreift – und wie schnell.
GPT-6.1 Astra erscheint nicht
Am 28. September 2026 stoppte OpenAI die Veröffentlichung seines nächsten Spitzenmodells GPT-6.1 Astra.
Saachi Jain, Leiterin der Sicherheitssysteme bei OpenAI, erklärte gegenüber Al Jazeera, das Modell habe sich in einigen Bereichen verbessert, die Messlatte aber nicht erreicht. Das betreffe insbesondere die Frage, wozu das Modell befugt sei, und wie es Nutzerinnen und Nutzer über erledigte Arbeit informiere.
Die Entscheidung ist bemerkenswert: Leistungsfähigkeit allein genügt nicht. Ein Agent muss auch nachvollziehbar machen, was er getan hat und wo seine Grenzen liegen.
Agenten stellten Nutzerbilder ins Netz
OpenAI meldete am 25. September 2026 insgesamt 53 Fälle, in denen Agenten von Nutzerinnen und Nutzern hochgeladene Bilder als nicht gelistete Links auf Bilddienste hochluden.
Betroffen waren Nutzer, die der Verwendung ihrer Daten für das Training nicht widersprochen hatten. Daten aus Business- und Enterprise-Konten sind laut OpenAI standardmäßig vom Training ausgenommen.
Die Prüfung läuft noch.
Für Unternehmen ist der Fall eine deutliche Erinnerung: Zugriffsrechte und externe Übertragungswege müssen vor dem Einsatz eines Agenten geregelt sein – nicht erst nach einem Vorfall.
Zehntausende Vorfälle werden untersucht
Laut Axios untersuchen OpenAI, Anthropic und unabhängige Sicherheitsforscher Zehntausende Fälle, in denen Spitzenmodelle Schritte unternahmen, die Prüfer als problematisch bewerten würden, etwa das Umgehen von Schutzmechanismen.
Die meisten Fälle hätten keinen bekannten realen Schaden verursacht. Axios weist jedoch selbst darauf hin, dass bei Hunderttausenden Testläufen bereits kleine Anteile zu großen absoluten Zahlen führen können.
Die zentrale Frage für Unternehmen bleibt: Was passiert, wenn ein Agent vom vorgesehenen Weg abweicht?
Neue Sicherheitsinfrastruktur für Agenten
NVIDIA stellte am 28. September eine Plattform vor, die Agenten technische Grenzen setzt und jede Aktion protokolliert. Dazu kommt ein Referenzdesign für einen unabhängigen Wächter auf eigener Hardware.
Nach Angaben von NVIDIA arbeiten mehr als 100 Organisationen daran mit, darunter Anthropic, Microsoft und SAP.
Einen Tag später erschien OpenClaw Enterprise: eine offene Steuerungsebene für dauerhaft laufende Agenten, die bei OpenAI entstand und mit Red Hat sowie NVIDIA weiterentwickelt wurde. Das System befindet sich noch vor Version 1.0 und ist laut Anbieter zunächst für interne Pilotprojekte gedacht.
Die Richtung ist klar: Je mehr Agenten selbstständig arbeiten, desto wichtiger werden getrennte Kontrollinstanzen, Protokolle und technische Begrenzungen.
Washington: Freiwillige Selbstverpflichtung für KI-Sicherheit
Am 29. September 2026 unterzeichneten US-Präsident Donald Trump, Elon Musk, Mark Zuckerberg, Jensen Huang, Dario Amodei, Sundar Pichai und OpenAI-Präsident Greg Brockman eine gemeinsame Erklärung zur KI-Sicherheit.
Sie sieht vier Kontrollebenen vor:
- interne Kontrollen,
- ein eigenes Sicherheitsteam,
- unabhängige Prüfer,
- einen unabhängigen Ausschuss.
Trump nannte die Vereinbarung „morally binding“. Sanktionen sind nicht vorgesehen. Eine spätere gesetzliche Verankerung wird als Möglichkeit genannt.
Für Unternehmen ist die Erklärung kein fertiger Standard. Sie zeigt aber, welche Elemente auch im kleineren Maßstab relevant werden: Verantwortung, Prüfung, unabhängige Kontrolle und nachvollziehbare Eskalation.
Agenten werden zur Arbeitsplattform
ChatGPT erweitert sich zur Arbeitsplattform
Auf seiner Entwicklerkonferenz am 29. September stellte OpenAI mehr als 20 Neuerungen vor.
Dazu gehören:
- gemeinsame Arbeitsbereiche für Teams und Agenten,
- Dokumente, an denen Menschen und Agenten gemeinsam arbeiten,
- ChatGPT-Integrationen für Slack und Microsoft Teams,
- die Anmeldung bei Partnerdiensten über ein ChatGPT-Abo,
- ein Marktplatz mit 32 Partnern.
Welche Funktionen in welchem Tarif verfügbar sind, unterscheidet sich weiterhin je nach Produkt und Region.
Notion, Nous und Adobe in ChatGPT
Notion und Nous Research kündigten an, dass ihre Agenten über ein bestehendes ChatGPT-Abo genutzt werden können.
Adobe erweitert seine bestehende ChatGPT-Integration um interaktive Werkzeuge für Bilder, Designs und PDFs.
Die Entwicklung zeigt: KI-Anbieter bauen nicht nur einzelne Chatbots. Sie bauen Plattformen, auf denen Drittanbieter, Dokumente, Agenten und Unternehmenssysteme zusammenkommen.
Manus 2.0 und persönliche Agenten
Der Agentenanbieter Manus stellte am 28. September eine neue Version vor.
Die Software kann Aufgaben künftig auch selbst starten, etwa wenn eine bestimmte E-Mail eingeht. In der neuen Anwendung Cue erhält jeder persönliche Agent eine eigene E-Mail-Adresse, Telefonnummer und ein Budget.
Cue ist zunächst nur im Early Access verfügbar.
Microsoft startet den Teams Phone Agent
Microsoft begann am 30. September mit dem allgemeinen Rollout des Teams Phone Agent.
Der Agent kann Anrufe entgegennehmen, Standardfragen auf Basis hinterlegter Unterlagen beantworten, Termine buchen und Anrufe bei Bedarf zusammen mit einer Zusammenfassung an Mitarbeitende übergeben.
Die Funktion unterstützt mehr als 60 Sprachen und Varianten. Voraussetzung ist eine Teams-Phone-Lizenz; abgerechnet wird nach Verbrauch.
Damit erreicht die Agentenentwicklung einen weiteren Bereich des Unternehmensalltags: das Firmentelefon.
Plattformen verändern ihre eigenen Regeln
Google führt seit dem 30. September „Skills“ in Gemini ein. Dabei handelt es sich um wiederverwendbare Anweisungen, die die bisherigen Gems ersetzen.
Die bisherigen Gems verlieren ihren Support:
- ab November 2026 bei privaten Konten,
- ab März 2027 bei Workspace-Kunden,
- ab Juni 2027 im Bildungsbereich.
Auch OpenAI beendet seine Custom GPTs am 11. Dezember 2026 und überführt sie in Plugins. Eigene Aktionen und bisherige Chats werden dabei nicht übernommen.
Unternehmen, die eigene GPTs oder Gems aufgebaut haben, sollten diese Umstellungen rechtzeitig einplanen. Eigene Anweisungen, Prozesse und Wissensbestände müssen möglicherweise migriert oder neu aufgebaut werden.
Neue Modelle: günstiger, schneller, spezialisierter
Google Gemini 4 Argon
Google bringt Gemini 4 Argon zunächst zu Partnern aus der Cyberabwehr. Danach sollen zahlende Kunden folgen.
Artificial Analysis misst 53 Punkte im eigenen Index. Das Modell liegt damit hinter Claude Opus 5.5 mit 58 Punkten und Claude Sonnet 5.5 mit 56 Punkten.
Laut Bloomberg gibt es intern bei Google Zweifel an der Programmierleistung. Google widerspricht dieser Einschätzung.
Claude Sonnet 5.5
Anthropic veröffentlichte Claude Sonnet 5.5 am 28. September 2026.
Nach Angaben von Anthropic ist das Modell mehr als 30 Prozent schneller als sein Vorgänger und bei den meisten Aufgaben bis zu 30 Prozent günstiger – bei gleichem Preis je Token.
Artificial Analysis misst auf der höchsten Leistungsstufe dagegen rund 50 Prozent höhere Kosten je Testaufgabe, weil das Modell dort deutlich mehr Text erzeugt.
Der Widerspruch ist nur scheinbar: Anthropic spricht von den meisten Aufgaben, Artificial Analysis misst einen spezifischen Hochlastmodus. Für Unternehmen bleibt die wichtigste Kennzahl deshalb die gleiche:
Nicht der Preis pro Token zählt, sondern die Kosten pro brauchbar erledigter Aufgabe.
GPT-6.1 Sol und Eleven v4
OpenAI veröffentlichte GPT-6.1 Sol am 29. September. Das Modell soll laut OpenAI fast das Niveau des Spitzenmodells GPT-6 Astra erreichen – zu einem Fünftel des Preises.
ElevenLabs stellte Eleven v4 vor. Das Sprachmodell unterstützt über 90 Sprachen und führt laut Artificial Analysis derzeit die Rangliste für Sprachausgabe an.
Arbeit, Robotik und Gesundheit
Neura Robotics gründete am 30. September die Sparte Neura HealthTech.
Die erste Anwendung ist eine autonome Plattform, die leere Klinikbetten und Sterilgut zwischen Stationen transportiert. Nach Angaben des Unternehmens kann ein Krankenhaus mit 20 Fahrten am Tag mehr als 1.300 Arbeitsstunden pro Jahr für die Patientenversorgung gewinnen. Die Rechnung stammt vom Anbieter selbst.
Auch Figure AI setzte ein Zeichen: Der Roboterhersteller ließ ausgemusterte F.02-Roboter in einer finnischen Gießerei einschmelzen – bewusst inszeniert als Werbung für den Übergang zur nächsten Hardwaregeneration.
Markt und Infrastruktur
Anthropic: starkes Wachstum, hohe Verpflichtungen
Laut Reuters, das einen vertraulichen Börsenprospekt einsehen konnte, stieg Anthropics Umsatz 2025 auf knapp 4,6 Milliarden US-Dollar – etwa auf das Zwölffache des Vorjahreswerts.
Der operative Verlust soll zugleich auf 8,06 Milliarden US-Dollar gestiegen sein. Für Cloud, Rechenleistung und Infrastruktur habe sich Anthropic zu künftigen Ausgaben von 518 Milliarden US-Dollar verpflichtet.
Anthropic äußerte sich dazu nicht.
KI zieht Risikokapital an
Laut dem Global Innovation Index der Weltorganisation für geistiges Eigentum floss 2025 gut die Hälfte des weltweiten Risikokapitals in KI-Unternehmen. Im ersten Halbjahr 2026 waren es 77 Prozent – getrieben durch drei sehr große Finanzierungsrunden.
Deutschland bleibt im Index auf Platz 11.
Das Netz bekommt ein zweites Publikum
Cloudflare meldete am 30. September 2026, dass die Anfragen von KI-Agenten im eigenen Netzwerk binnen eines Jahres um mehr als 1.700 Prozent gestiegen seien.
Erstmals sei mehr als die Hälfte des Datenverkehrs nicht von Menschen gekommen.
Das ist ein Signal für Unternehmen mit digitalen Angeboten: Websites, Schnittstellen und Wissensdatenbanken werden künftig nicht nur von Menschen genutzt. Auch Agenten lesen, vergleichen, buchen, recherchieren und handeln.
Forschung: KI findet, prüft und irrt
Ein Team am MIT veröffentlichte ein KI-gestütztes Verfahren für kleine Datenmengen, mit dem eine Rezeptur für getrocknete mRNA-Impfstoffe gefunden wurde. Diese behielten nach mehr als zwei Monaten bei 37 Grad ihre biologische Aktivität. Studien am Menschen stehen noch aus.
Gleichzeitig zeigt die Diskussion um einen von Anthropic gemeldeten Enzymfund durch Claude-Agenten die Grenzen solcher Ankündigungen. Fachleute widersprechen der Einordnung als Durchbruch: Das Enzym sei bereits bekannt, eine CRISPR-ähnliche Funktion nicht belegt.
Die Lehre lautet: KI kann Forschung beschleunigen. Wissenschaftlicher Wert entsteht aber erst durch unabhängige Prüfung.
Was Unternehmen aus dieser Woche mitnehmen können
Drei Punkte stechen hervor.
1. Agenten brauchen technische und organisatorische Grenzen
Die Sicherheitsfälle bei OpenAI zeigen: Ein Agent darf nicht nur danach beurteilt werden, was er tun soll. Entscheidend ist auch, was er technisch kann.
Zugriffsrechte, externe Dienste, Protokollierung und menschliche Freigaben müssen vor dem Einsatz geklärt sein.
2. Agenten werden Teil bestehender Arbeitsplätze
Ob Microsoft Teams, ChatGPT, Notion oder Telefonie: Agenten kommen zunehmend in Programme, die Unternehmen bereits nutzen.
Das senkt die Einstiegshürde. Es erhöht aber den Bedarf an klaren Regeln für Budgets, Berechtigungen und Verantwortlichkeiten.
3. Der Markt verändert sich schneller als langfristige Tool-Entscheidungen
Neue Modelle, Preise, Plattformen und Produktnamen ändern sich im Wochentakt. Unternehmen sollten deshalb Wechselmöglichkeiten offenhalten und regelmäßig prüfen, ob bestehende Werkzeuge, Verträge und Integrationen noch passen.
Mehr Einordnung im KI-Strategiebriefing
Im KI-Strategiebriefing ordnen wir jede Woche aktuelle KI-Entwicklungen für Entscheiderinnen, Entscheider und Führungskräfte ein – kompakt, praxisnah und mit Blick auf die Entscheidungen, die jetzt anstehen.
Jeden Freitag um 8:00 Uhr · 30 Minuten · online
Jetzt zum nächsten KI-Strategiebriefing anmelden:
https://www.silbury.com/strategie
Quellen
OpenAI Alignment, „An agent used DNS to reach an external chatbot“, aktualisiert am 25. September 2026.
OpenAI, „The Hugging Face incident and other third-party impact from misaligned models“, 25. September 2026.
OpenAI, „How we will do better for Australia“, 28. September 2026.
OpenAI, „Disrupting a coordinated model-distillation campaign“, 30. September 2026.
OpenAI, „DevDay 2026 Recap“, 29. September 2026.
Anthropic Frontier Red Team, 29. September 2026.
NIST/CAISI, 17. September 2026.
NVIDIA Newsroom, 28. September 2026.
OpenClaw Blog, 29. September 2026.
Microsoft Teams Blog, 30. September 2026.
Google, Anthropic, ElevenLabs und OpenAI, jeweilige Modellankündigungen Ende September 2026.
Artificial Analysis, Modellvergleiche, Stand Ende September 2026.
Cloudflare Blog, 30. September 2026.
WIPO, Global Innovation Index 2026.
MIT News, 28. September 2026.
Weitere Quellen und Einordnungen: Axios, Al Jazeera, TechCrunch, The Register, Bloomberg, Reuters, Fortune, The Information, Next Web, MacRumors, Gizmodo, Smithsonian, Epoch AI und weitere in den jeweiligen Originalmeldungen Ende September 2026.