OpenAI DevDay 2026 im Rückblick: Persönlicher Agent, Sol 6.1 und das fehlende Astra
Originaltitel: „OpenAI DevDay 2026 im Rückblick: Persönlicher Agent, Sol 6.1 und das fehlende Astra“; Originalautor: Dongcha Beating
Am 29. September 2026 fand in San Francisco trotz des Wettbewerbs mit dem langjährigen Rivalen Anthropic das OpenAI DevDay 2026 wie geplant statt.
Auf dieser Launch-Veranstaltung fehlte jedoch das neue Flaggschiffmodell.
Das für Oktober geplante GPT-6.1 Astra wurde vom Unternehmen 24 Stunden vor Eröffnung kurzfristig zurückgezogen. Stattdessen rückte der von OpenAI „Dot“ genannte persönliche Agent ins Rampenlicht.
Die Veranstaltung kündigte 25 Updates an, zusammengestellt von Dongcha Beating.

Modelle und Dot
Dot
Ein persönlicher Agent auf Basis von GPT-6 Astra mit eigenem Cloud-Sandbox-Computer und dediziertem Browser; Anbindung an über 4.000 externe Apps; proaktive Recherche möglich, Hintergrundnutzung von Apps mit Nur-Lese-Berechtigung zum Aufgabenfinden; Pro- und Business-Premium-Nutzer erhalten ihren ersten Dot kostenlos; Gespräche zählen nicht zur ChatGPT-Grundkontingent.
Fachspezifische Dots
Vorschauversion digitaler Mitarbeiter für Unternehmen mit eigenständiger Identität, Zugangsdaten und Mitarbeiternummer innerhalb der Organisation.
GPT-6.1 Sol
Fokussiert auf Agent-Codierung, Computerbedienung und Fachaufgaben. Eingabe: 2 $ pro Million Tokens, Ausgabe: 10 $ (nur ein Fünftel von Astra); zwischengespeicherte Eingabe: 0,10 $; DeepSWE v1.1-Wert entspricht Astra, Terminal-Bench-Wert über doppelt so hoch wie bei der vorherigen Sol-Generation.
Astra Ultrafast & Sol Ultrafast
Hochdurchsatz-Ultrafast-Stufe. Geschwindigkeit bis zu 8-mal höher, Codex-Durchsatz ca. 300 Tokens/s. Preis: das 6-Fache der Standard-Astra-Version (Eingabe 60 $, Ausgabe 300 $).
Datenschutz-Intelligenz
Alle Stufen unterstützen „keine Datenspeicherung“ mit Offline-Sicherheitsprüfung; Partnerschaft mit Cisco, Databricks und Snowflake für datenschutzkonforme Inferenz basierend auf vertraulicher Rechenarchitektur.
Codex und API
Codex Cloud
Vollständig verwaltete Cloud-Entwicklungsumgebung. Unterstützt Offline-Betrieb; Prozesse laufen weiter, auch bei geschlossenem Laptop; Teams können vorkonfigurierte Container teilen.
Neue Codex-CLI
Neugestaltete Terminal-Interaktion mit Echtzeit-Sprachbefehlen, nativer Worktree-Unterstützung und neuem /agents-Bereich für Multi-Agenten-Orchestrierung und Fortschrittsverfolgung.
Code-Review
In den Desktop-Client integriert; unterstützt GitHub-Pull-Requests und GitLab-Merge-Requests; führt erste Reviews und Diff-Analysen automatisch per Cloud durch – auch offline.
Codex Security Cloud
Produktivierung des internen Sicherheitsprojekts Defense Factory; Integration mit dem Cybersicherheits-Großmodell Daybreak Blue; bietet kontinuierliches Schwachstellen-Scanning und automatisierte Behebung für Code-Repositories.
Decisions-API
OpenAIs Version von Jev: dedizierte Entscheidungsschnittstelle, die GPT-6 Luna in einem festen Q&A-Bereich fixiert. Speziell für Intent-Klassifizierung und Agenten-Pfad-Routing konzipiert; Antwortzeit ca. 150 ms; Aufrufgeschwindigkeit 10× höher als bei herkömmlichen Aufrufen.
Agents-API öffnet Computer-Nutzung
Ermöglicht vollständigen Zugriff auf Codex-Harness-Kernfunktionen (Multi-Agenten-Orchestrierung, Kontextkompression, Tool-Abruf, Bildschirmsteuerung). Framework-Code ist Open Source; zudem verfügbar als vollständig verwaltete Option.
Amazon Bedrock Managed Agents
Tiefe Integration mit AWS: Unternehmen können OpenAIs Agentensysteme direkt in ihrer eigenen AWS-VPC und auf eigenen Rechenressourcen betreiben.
Plugin-System
Plugin-Seitenleiste und Datei-Interaktion
Entwickler können im ChatGPT-Seitenbereich maßgeschneiderte interaktive Panels oder Dateianzeiger erstellen und Produkte direkt in den Konversationsfluss einbetten.
Verzeichnis-Umstrukturierung und passive Entdeckung
Überarbeiteter Plugin-Einreichungs- und -Prüfungsprozess; kontextbasierte, proaktive Plugin-Empfehlungen während natürlicher Nutzerdialoge.
Plugin-Site-Integration
Unterstützt Unternehmen dabei, selbstgebaute Websites direkt mit Plugins zu verbinden, sodass Mitglieder je nach ihren Berechtigungen auf interne Unternehmensdaten zugreifen können.
MCP ereignisgesteuert
Integriert die von Anthropic geförderte MCP-Ereignisspezifikation und ermöglicht das automatische Hintergrund-Aktivieren von Plugins, um bei Statusänderungen externer Kollaborationstools (z. B. Projektboards) Vorschläge zu erstellen.
Zusammenarbeit
ChatGPT-Wissensraum
Ersetzt die ursprüngliche Wissensbasis als langfristiger Kollaborations-Hub, in dem Teammitglieder, Codex und dot denselben Kontext teilen.
Dynamische Seiten
Mehrfach bearbeitete Rich-Text-Dokumente durch Personen und Agenten mit dynamischen Komponenten, Echtzeit-To-dos und Daten-Dashboards; zudem möglich: Textauswahl zum @-Aufruf bestimmter Agenten für gezielte Änderungen.
Kollaborative Folien
Präsentations-Engine mit Echtzeit-Mehrnutzer-Kollaboration, die innerhalb von ChatGPT generiert und präsentiert werden kann sowie nahtlos nach PowerPoint oder Google Slides exportiert.
Teamaufgaben und geplante Zuweisung
Erstellung wiederkehrender Aufgabenabläufe im Unternehmen, auslösbar per E-Mail, IM oder Zeitplan.
Office-IM-Integration
Tief integriert in Slack und Teams: Unternehmensmitglieder können @-Befehle in Kanälen nutzen, um Zusammenfassungen abzurufen oder Fehler zu beheben – ohne persönliche Konten.
Meeting-Plugin
Erstmals für macOS: lokale Audioaufzeichnung kombiniert mit Kontextanalyse zur Generierung zentraler Entscheidungen und Folge-To-dos; Audio wird offline analysiert und sofort gelöscht.
Persönliche und teamweite Kompetenzübersicht
Ermöglicht zentrale externe Darstellung und Wiederverwendung eigener Websites, Plugins und geteilter Fähigkeiten.
Monetarisierung und Abonnements
Mit ChatGPT anmelden
Einheitliche Identitätsauthentifizierung im gesamten Netzwerk. Plus- und Pro-Nutzer können ihr Abonnement-Tokens-Kontingent direkt in Drittanbieter-Produkten nutzen; zur ersten Gruppe zählen 16 Unternehmen wie Devin, Notion und Vercel.
Ganz neue Pro-Stufe für 500 $
Bietet höchste Priorität beim Parallelitätskontingent sowie exklusiven Zugang zu Astra Ultrafast.
Anpassungen des ursprünglichen 200-$-Pro-Kontingents
Nach 20-tägiger Unterbrechung wieder geöffnet, doch ab 30. Oktober wurde das Rechenkontingent für Codex- und ChatGPT-Arbeiten von 20× Plus auf 10× reduziert; die wöchentliche Obergrenze für GPT-6 Pro halbierte sich auf 100 Nachrichten. Bestehende Nutzer erhalten einen 2.500-$-Guthaben, der vor Jahresende verfällt.
OpenAI-Software-Marktplatz
Zunächst Partnerschaft mit 32 Softwareanbietern wie Adobe, Figma, Salesforce, ServiceNow und Harvey: Unternehmen können ihr vorab vereinbartes OpenAI-Ausgabenkontingent nutzen, um Drittanbieter-SaaS-Produkte rückwirkend zu bezahlen.
Das einzige echte Produkt dieses DevDay ist Dot.

Alle anderen Ankündigungen – ob Sol, Ultrafast, Codex-Harness, Space, Pages oder MCP-Ereignisse – sind, einzeln betrachtet, bloße Einzelkomponenten; zusammengesetzt bilden sie jedoch Dots Knochen, Fleisch und Nerven.
Dot denkt mit Astra, steuert das System über den Codex-Harness, verbindet sich via Plugins mit über 4.000 externen Softwareprodukten, aktiviert sich selbst bei Dashboard-Änderungen über MCP-Ereignisse und speichert fertige Arbeiten in Pages sowie Teams-Kanälen.
In den letzten drei Jahren blieb das stillschweigende Verständnis der Mensch-Computer-Interaktion in diesem kleinen Feld stecken.
Zuerst hieß es „Sie stellen eine Frage, es antwortet“; später „Sie weisen eine Aufgabe zu, es führt sie aus und liefert das Ergebnis.“
Dot wartet nicht mehr, bis Sie vor dem Cursor die Eingabetaste drücken. Es verfügt über einen eigenen Cloud-Computer und Browser und durchsucht nach Bildschirmabschaltung im Hintergrund weiterhin verschiedene Anwendungen – mit eingeschränkten Leseberechtigungen – auf offene Rechnungen oder unbehobene Fehler.
Offiziellen Angaben zufolge erledigt es die Arbeit so, wie Sie es möchten – noch bevor Sie danach fragen.
Früher konkurrierten ChatGPT oder verschiedene Copilots um Sitzlizenzen auf Softwareebene und berechneten monatlich pro Kopf – quasi als praktischer Schraubenschlüssel für Mitarbeiter.
Dot und Spezial-Dots gehen weiter: Spezial-Dots besitzen eigenständige Domänenkonten, Systemzugangsdaten und Mitarbeiternummern innerhalb des Unternehmens und sind in Microsofts Agent-365-Governance-System integriert – mit bekannten IT-Prozessen für Onboarding, Audit und Deaktivierung.
Unternehmen kaufen kein Werkzeugkonto mehr, sondern engagieren einen Maschinenmitarbeiter – ohne Sozialversicherungspflicht und stets online.
Hier trennen sich auch die Wege der beiden Silicon-Valley-Giganten: Meta bringt sein ähnlich gestaltetes Muse Milliarden gewöhnlicher Nutzer nahe – nutzt die Spitzenposition in Gratis-Charts, um die Verbraucherreichweite zu steigern; OpenAI hält Dot strikt hinter den hohen Mauern von Pro- und Unternehmensabonnements – künftig werden weitere Dots zusätzliche monatliche Gebühren erfordern.
Der eine ergreift Nutzerzeit, der andere ergreift Unternehmensarbeitsplätze.
Beschleunigung
Oberflächlich betrachtet sind es KI-Mitarbeiter, doch im Hintergrund verbirgt sich eine Rechenrechnung voller Sorge.
GPT-6.1 Sol kostet nur ein Fünftel von Astra, erreicht aber bei den meisten Benchmarks nahezu dessen Leistung; Astra Ultrafast ist mit dem 6-fachen Standardpreis gelistet und liefert blitzschnell 300 Tokens pro Sekunde; kurz darauf wird Sol Ultrafast als „nahezu Astras Gehirn mit dem 8-fachen Tempo zum Original-Astra-Preis“ vermarktet.

Dies war in früheren Modellnarrativen selten. Die Branche betrachtete bisher nur Benchmark-Werte, nun stehen Latenz und Durchsatz im Vordergrund – als klar preisgekennzeichnete Luxusmerkmale.
Warum?
Denn für Entwickler, die Agenten zum Codieren einsetzen, kann eine Verzögerung von wenigen Sekunden den hart erarbeiteten Flow-Zustand völlig zerstören.
Geschwindigkeit ist zur teuersten Premiumfunktion geworden.
OpenAI hingegen leidet unter massivem Rechenkapazitätsengpass.
Die 200-Dollar-Pro-Stufe wurde am 10. September aufgrund von Rechenkapazitätsengpässen von Behörden direkt abgeschaltet – neue Käufe waren bis zu 20 Tage lang nicht möglich; am ersten Wiedereröffnungstag wurde verkündet, dass der inkludierte Nutzungsumfang halbiert wird – von ursprünglich 20 Mal (Plus) auf nun 10 Mal. Gleichzeitig erschien eine neue Stufe für 500 Dollar monatlich, exklusiv mit dem schnellsten Modell.
Dies ist ein Lehrbuchbeispiel für Rechenkapazitätsrationierung: Die knappsten Ressourcen werden für jene reserviert, denen der Preis am wenigsten wichtig ist, während ausreichend günstige Sub-Flagship-Modelle den Massenmarkt verteidigen.
Von Astra am 3., über Sol am 22. bis hin zu 6.1 Sol am 29. September – drei Modellstarts innerhalb eines Monats. Jeder Launch zieht im Kern eine neue Kostenbasis für Rechenzentren nach sich.
Kleine-Modell-Startups sind Kollateralschäden. Die Decisions-API senkt die kleinste Luna auf 150 Millisekunden pro Entscheidung – speziell für Klassifizierung und Routing konzipiert. Manche sehen darin einen gezielten Schlag gegen TypeSafes Entscheidungsmodell Jev.
Universalkonto
Space, Pages, Präsentationen, Teamaufgaben, Meeting-Plugins sowie @ChatGPT direkt in Slack und Teams.
Fügt man diese Komponenten zusammen, wirkt ChatGPT plötzlich gar nicht mehr wie ein Chatbot.
Es wirkt vielmehr wie ein sich formender Desktop-Betriebssystem.

Direkt vor ihm steht eine lange Liste namhafter Konkurrenten: Notion, Google Workspace, Slack und Microsoft Office. Die Präsentationsfunktion betont besonders den verlustfreien Export nach PowerPoint und Google Slides.
Noch interessanter sind jedoch die Partner auf den VIP-Plätzen.
Notion gehört zu den ersten 16 Partnern für „Anmeldung mit ChatGPT“, sodass Nutzer ChatGPT-Abonnementguthaben direkt in Notion verrechnen können; doch noch am selben Tag startete OpenAI Pages und Space – beides direkte Konkurrenten zu Notion in nahezu allen Funktionen.
Figma, Adobe und Salesforce schafften es auf die große Liste des OpenAI-Softwaremarktplatzes, sodass Unternehmen ihre im Voraus bezahlten OpenAI-Vertragsguthaben auch für deren Produkte nutzen können; doch noch am selben Tag wandelt ChatGPT zunehmend grafisches Design, Layout und Kunden-Ticketbearbeitung – Aufgaben, die ursprünglich ihnen gehörten – in eigene native Funktionen um.
„Mit ChatGPT anmelden“ wirkt auf den ersten Blick wie ein passwortloses Login-Plugin, ist aber im Kern eine universelle Identität für das KI-Zeitalter. 1,2 Milliarden wöchentliche aktive Nutzer müssen nicht in jeder App separat ihre Brieftasche zücken – Gutschriften stammen von OpenAI, und nachgelagerte Entwickler begleichen ihre Rechnungen direkt bei OpenAI.
Wer zuerst das Geld erhält, ist der eigentliche Vermieter.

Das Chassis
In der ersten Jahreshälfte war das Wort, das die KI-Startup-Community am häufigsten zitierte, um Mut zu schöpfen, „Harnisch“.
Unternehmer und Investoren nutzten es, um ein wachsendes Gefühl der Unsicherheit zu besänftigen. Egal wie leistungsfähig das Modell ist – es ist lediglich ein Motor; die gesamte äußere Schicht – Session-Orchestrierung, Kontextkompression, Tool-Retrieval und fehlertolerante Wiederherstellung, die Agenten tatsächlich Arbeit verrichten lassen – das ist die wahre Schutzbarriere.
Damals war man sich sicher: Große Technologieunternehmen waren zu sehr mit dem Aufbau von Rechenkapazität beschäftigt, um sich um diese mühsame Arbeit zu kümmern.
Dieser DevDay widerlegte diese Annahme. Mit der offiziellen Integration von Computer-Nutzung in die Agents-API enthüllte OpenAI den gesamten unter Codex, ChatGPT und dot laufenden Harnisch – bis ins letzte Detail. Der Quellcode wurde freigegeben, Hosting angeboten, und sogar AWS wurde eingebunden, um ihn in Bedrock zu integrieren.
Die Großen haben es nicht nur getan – sie machten es zur branchenweiten Standardkomponente. Die allgemeinstverwendbare, am stärksten standardisierte Ebene des Agenten-Frameworks wurde vom ursprünglichen Anbieter selbst übernommen. Damit rückte auch die ökologische Nische der Entwickler in eine prekäre Lage.
Codex Cloud ermöglicht es Ihnen, Ihren Laptop zu schließen und offline in der Cloud zu arbeiten; Code-Reviews können über Nacht für Sie durchgeführt werden; Security Cloud scannt und patcht Repositories rund um die Uhr automatisch; die neue CLI bietet unter /agents eine Übersicht, mit der eine Person mehrere parallel arbeitende Agenten steuern kann.
Die reine Tipp-Tätigkeit verschwindet zunehmend. Entwickler schreiben nicht länger Code – sie sitzen am Schreibtisch und drücken lediglich Enter, um zu bestätigen.
Wenn allgemeinverwendbare Frameworks keine Schutzbarriere mehr darstellen, wo können Startups dann noch tätig werden?
Entweder vertiefen sie sich in branchenspezifische Domänen, die große Technologieunternehmen nicht erreichen können, oder sie gehen in regulatorisch sensible Bereiche, die Großkonzerne aus Compliance-Gründen meiden.
Doch OpenAI plant offenbar, kaum Lücken zu hinterlassen: Am selben Tag wie die Launch-Veranstaltung wurden Null-Datenhaltung und private Inferenz gemeinsam eingeführt.
Die für Zwischenhändler offengehaltenen Türen schließen sich nacheinander.
Die Balance
Am Tag vor der Launch-Veranstaltung blieb vielen, die auf GPT-6.1 Astra warteten, die Erwartung unerfüllt.

OpenAI stoppte freiwillig dieses Flaggschiffmodell, das ursprünglich im Oktober debütieren sollte. Saachi Jain, verantwortlich für das Sicherheitssystem, erklärte, das Modell habe die Freigabekriterien hinsichtlich „Nicht-Überschreitung autorisierter Grenzen und wahrheitsgemäßer Berichterstattung über das Betriebsverhalten gegenüber Menschen“ noch nicht vollständig erfüllt.
Dies ist eine seltene Notbremse.
Im Rennen um große Modelle hat sich mittlerweile jeder daran gewöhnt, vorschnell zu starten, GPUs zu ergattern und um Launch-Termine zu konkurrieren. Zu einer Zeit, in der fast die gesamte Branche von FOMO erfasst wird und kopfüber sprintet, bedarf es beträchtlichen Willens, ein fertiges Flaggschiffmodell kurzfristig vom Programm zu nehmen.
Zurückzutreten erfordert oft mehr Entschlossenheit als vorwärtszustürmen.
Doch gerade das macht Dot auf der Bühne so natürlich.
Sobald ein Agent über einen eigenen, unabhängigen Cloud-Computer verfügt, rund um die Uhr autonom im Web surfen und Tools aufrufen kann, liegt die eigentliche technische Schwelle nicht mehr darin, bei einem Benchmark noch zwei Prozentpunkte mehr herauszuholen.
Schwierig ist vielmehr, Vertrauen zu schaffen.
In jedem Produkt-Feature von Dot zeigt sich die Schichtung an Abwägungen, die die Entwickler getroffen haben.
Lesezugriff-only-proaktive Recherche eliminiert Risiken unbeabsichtigter Aktionen; besonders sensible Schritte erfordern stets menschliche Freigabe; Zugangsdaten für Drittdienste werden über einen System-Proxy verwaltet – Passwörter werden dem Modell niemals im Klartext zugänglich gemacht.
Diese Regeln sind äußerst detailliert definiert, wirken sogar etwas vorsichtig.
Doch genau dies ist die Voraussetzung dafür, ob Unternehmen tatsächlich Rechnungen, Verträge und Code-Repositories wirklich anvertrauen.
Als Altman auf der Bühne über diese Schutzlinie sprach, wirkte er ruhig. Er betonte, dass Alignment rein als Ingenieursproblem zu betrachten wichtige, tiefere Fragen verdecke; zu den zahlreichen Witzen aus der Außenwelt bemerkte er, dass er es durchaus in Ordnung finde, wenn Menschen ihre Ängste auf jemanden projizierten oder ihn verspotteten, um sich etwas zu entlasten.
Nach drei Jahren Sprint erkennt die Branche zunehmend: Was bestimmt, wie weit ein Modell kommt, ist nie nur der Durchsatz innerhalb eines Rechenclusters, sondern sein Gespür für Verhältnismäßigkeit im Umgang mit der realen Welt.
Alle Berechtigungen wurden sorgfältig aufgeteilt: Welche werden Maschinen überlassen, welche bleiben beim Menschen?
Genau wie jene schlichte Regel am Ende des Systemhandbuchs: Dot kann Verträge entwerfen, Code fehlerfrei analysieren und 4.000 Apps verbinden – doch beim Ändern eines Passworts hält es still und wartet geduldig darauf, dass der Mensch selbst eingreift.
Das ist der Beginn der Reife.
Original-Link


