Riepilogo OpenAI DevDay 2026: Agente Personale, Sol 6.1 e l’assenza di Astra
Titolo originale: «Riepilogo OpenAI DevDay 2026: Agente Personale, Sol 6.1, l’assenza di Astra». Autore originale: Dongcha Beating
Il 29 settembre 2026 a San Francisco, nonostante la pressione dell’antico rivale Anthropic nella competizione sui modelli, OpenAI DevDay 2026 si è svolto regolarmente.
Tuttavia, in questo evento di lancio, il nuovo modello di punta era ancora assente.
GPT-6.1 Astra, previsto per ottobre, è stato ritirato con urgenza dall’azienda 24 ore prima dell’apertura. Il nuovo protagonista al centro dell’attenzione è diventato l’Agente Personale, chiamato da OpenAI Dot.
L’evento ha annunciato 25 aggiornamenti, riassunti da Dongcha Beating come segue.

Modelli e Dot
Dot
Un Agente Personale basato su GPT-6 Astra. Dispone di un computer sandbox cloud indipendente e di un browser dedicato, collegato a oltre 4.000 app esterne; supporta ricerche proattive, navigando in background nelle app con permessi in sola lettura per individuare compiti da svolgere; gli utenti Pro e Business Premium ricevono il primo Dot gratuitamente, e le conversazioni non contano nel quota base di ChatGPT.
Dot Specialistici
Versione in anteprima di dipendenti digitali per aziende. Hanno identità, credenziali e matricole aziendali indipendenti.
GPT-6.1 Sol
Orientato alla codifica agente, all’operatività su computer e ai compiti professionali. Input $2 per milione di token, output $10 (un quinto rispetto ad Astra); input memorizzato nella cache $0,10; punteggio DeepSWE v1.1 equivalente ad Astra, punteggio Terminal-Bench oltre il doppio rispetto alla precedente generazione Sol.
Astra Ultrafast & Sol Ultrafast
Livello ultra-veloce ad alta capacità. Velocità fino a 8 volte superiore, throughput Codex di circa 300 token al secondo. Prezzo 6 volte quello della versione standard di Astra (input $60, output $300).
Intelligenza sulla Privacy
Tutti i livelli supportano la «conservazione zero dati» con revisione offline della sicurezza; collaborazione con Cisco, Databricks e Snowflake per lanciare inferenze sulla privacy basate su architetture di computing confidenziale.
Codice e API
Codex Cloud
Ambiente di sviluppo cloud completamente gestito. Supporta l'operatività offline, i processi proseguono anche con il laptop chiuso e i team possono condividere contenitori preconfigurati.
Nuova CLI Codex
Interazione terminale ridisegnata, supporta comandi vocali in tempo reale, worktree nativi e una nuova vista /agents per l'orchestrazione multi-agente e il monitoraggio dei progressi.
Revisione del codice
Integrata nel client desktop, supporta le PR di GitHub e le MR di GitLab e può completare automaticamente la revisione iniziale e la diagnosi delle differenze tramite cloud, anche in modalità offline.
Codex Security Cloud
Progetto interno di sicurezza Defense Factory trasformato in prodotto, integrato con il modello di cybersicurezza Daybreak Blue, fornisce scansione continua delle vulnerabilità e correzione automatica dei repository di codice.
API Decisioni
Versione OpenAI di Jev: interfaccia decisionale dedicata che limita GPT-6 Luna a un ambito Q&A fisso. Progettata specificamente per classificazione delle intenzioni e instradamento dei percorsi degli agenti, con tempo di risposta di circa 150 ms e velocità di invocazione 10x superiore rispetto alle chiamate convenzionali.
API Agenti: apertura dell'uso del computer
Apertura completa delle funzionalità principali di Codex (orchestrazione multi-agente, compressione del contesto, recupero strumenti e operazioni sullo schermo). Il codice del framework è open source; disponibile anche l'opzione completamente gestita.
Agenti gestiti Amazon Bedrock
Integrazione approfondita con AWS, che consente alle aziende di eseguire direttamente nei propri VPC e risorse di calcolo AWS i sistemi di agenti OpenAI.
Sistema plugin
Barra laterale plugin e interazione con file
Gli sviluppatori possono personalizzare pannelli interattivi o visualizzatori di file dedicati nella barra laterale di ChatGPT, integrando direttamente i prodotti nel flusso della conversazione.
Ristrutturazione directory e scoperta passiva
Flusso di invio e revisione plugin rivisto; raccomandazione proattiva di plugin pertinenti in base al contesto durante conversazioni utente naturali.
Integrazione sito plugin
Supporta le aziende nel collegare direttamente i propri siti interni ai plugin, consentendo ai membri di accedere ai dati aziendali interni in base ai rispettivi permessi.
MCP basato su eventi
Integra la specifica MCP per eventi promossa da Anthropic, consentendo il risveglio automatico in background dei plugin per redigere proposte quando strumenti esterni di collaborazione (es. bacheca progetti) subiscono cambiamenti di stato.
Lavoro collaborativo
Spazio conoscenze ChatGPT
Sostituisce la precedente knowledge base, fungendo da hub collaborativo a lungo termine in cui membri del team, Codex e dot condividono lo stesso contesto.
Pagine dinamiche
Testo formattato collaborativamente modificato da più persone e agenti, con componenti dinamici, to-do in tempo reale e dashboard dati; consente di selezionare testo specifico per @-menzionare agenti e richiedere modifiche mirate.
Presentazioni collaborative
Motore presentazioni con collaborazione multiutente in tempo reale, in grado di generare e presentare direttamente in ChatGPT ed esportare senza perdite in PowerPoint o Google Slides.
Task di squadra e assegnazione programmata
Crea flussi di task periodici aziendali attivabili tramite email, messaggistica istantanea o eventi pianificati.
Integrazione IM aziendale
Integrazione profonda con Slack e Teams, che permette ai membri aziendali di @-chiamare riassunti o risolvere bug direttamente nei canali, senza account personali.
Plugin riunioni
Debutto su macOS: registra localmente l’audio e combina il contesto per generare decisioni chiave e to-do successivi; l’audio viene analizzato offline e immediatamente eliminato.
Homepage competenze personali e di squadra
Consente la visualizzazione centralizzata e il riutilizzo esterno di siti, plugin e competenze condivise creati personalmente.
Monetizzazione e abbonamenti
Accedi con ChatGPT
Autenticazione unificata su tutta la rete. Gli utenti Plus e Pro possono utilizzare direttamente il proprio quota di token nell’abbonamento all’interno di prodotti di terze parti; la prima ondata include 16 aziende, tra cui Devin, Notion e Vercel.
Nuovo piano Pro da 500 $
Offre la quota di concorrenza con priorità più alta e accesso esclusivo ad Astra Ultrafast.
Aggiustamenti alla quota originale Pro da 200 $
Riaperto dopo una sospensione di 20 giorni, ma dal 30 ottobre la quota computazionale per Codex e i lavori di ChatGPT è ridotta da 20× Plus a 10×, e il tetto settimanale per GPT-6 Pro è dimezzato a 100 messaggi. Gli utenti esistenti ricevono un credito da 2.500 $ che scade entro la fine dell’anno.
Marketplace software OpenAI
Inizialmente in collaborazione con 32 fornitori software, tra cui Adobe, Figma, Salesforce, ServiceNow e Harvey; le aziende possono usare la loro quota di spesa pre-impegnata con OpenAI per compensare e acquistare prodotti SaaS di terze parti in modalità inversa.
L’unico vero prodotto presentato in questo DevDay è Dot.

Tutti gli altri annunci – Sol, Ultrafast, Codex harness, Space, Pages o eventi MCP – presi singolarmente sono semplici componenti sparsi; assemblati insieme, costituiscono in realtà le ossa, la carne e i nervi di Dot.
Dot ragiona con Astra, opera il sistema tramite Codex harness, si connette a oltre 4.000 software esterni tramite plugin, si attiva autonomamente tramite eventi MCP quando i dashboard cambiano e scrive il lavoro completato in Pages, inviandolo ai canali Teams.
Negli ultimi tre anni, la comprensione tacita dell’interazione uomo-macchina è rimasta bloccata in quella piccola casella.
All’inizio era «tu fai una domanda, lui risponde»; poi è diventato «tu assegni un compito, lui lo esegue e consegna».
Dot non attende più che tu prema Invio davanti al cursore. Ha il suo computer cloud e il suo browser, e dopo che l’utente chiude lo schermo continua a navigare in background in varie applicazioni con permessi limitati di sola lettura, cercando le fatture ancora non emesse e i bug ancora senza risolutore.
Secondo gli addetti ai lavori, completerà il lavoro nel tuo modo ancor prima che tu lo chieda.
In passato, sia ChatGPT che vari Copilots competevano per licenze d’uso a livello software, addebitando un canone mensile per utente, equipaggiando di fatto i dipendenti con un pratico cacciavite.
Dot e i Dot Specialist vanno oltre. I Dot Specialist possiedono account aziendali indipendenti, credenziali di sistema e ID dipendente, integrati nel sistema di governance Microsoft Agent 365, seguendo i noti processi IT per onboarding, audit e disattivazione.
Le aziende non acquistano più un account strumento, ma assumono un dipendente macchina che non richiede contributi previdenziali e non va mai offline.
È qui che i due giganti della Silicon Valley divergono: Meta spinge il suo Muse, simile nella forma, verso miliardi di persone comuni, sfruttando la prima posizione nelle classifiche gratuite per ampliare la scala consumatore; OpenAI invece tiene Dot saldamente dietro le alte mura degli abbonamenti Pro e aziendali, con ulteriori Dot che richiederanno pagamenti mensili aggiuntivi in futuro.
Uno mira al tempo degli utenti, l’altro alle postazioni di lavoro delle aziende.
Accelerazione
In superficie sono impiegati automatici, ma dietro le quinte è una bolletta computazionale carica d'ansia.
GPT-6.1 Sol costa solo un quinto di Astra, ma le sue prestazioni su quasi tutti i benchmark sono simili; Astra Ultrafast è quotata a 6 volte il prezzo standard, erogando 300 token al secondo; subito dopo, Sol Ultrafast è presentato come «acquistare qualcosa di vicino al cervello di Astra e con 8 volte la velocità al prezzo originale di Astra».

Questo è raro nelle narrazioni precedenti sui modelli. Un tempo l’industria considerava solo i punteggi dei benchmark, ora invece latenza e throughput sono esposti in vetrina come lussi chiaramente tariffati.
Perché?
Perché per chi usa agenti per scrivere codice, anche pochi secondi di ritardo possono spezzare del tutto lo stato di flusso faticosamente raggiunto.
La velocità è diventata il premium più costoso.
Ma OpenAI è un’azienda con potenza computazionale fortemente limitata.
Il piano Pro da 200 $, a causa di sovraccarico computazionale, ha avuto il cavo di rete staccato direttamente dagli ufficiali il 10 settembre, sospendendo nuovi acquisti per fino a 20 giorni; nel primo giorno di riapertura ha annunciato che l’uso incluso sarebbe stato dimezzato, passando da 20 a 10 volte rispetto al piano Plus. Contemporaneamente è apparso un nuovo piano da 500 $ al mese, offerto esclusivamente con il modello più veloce.
Questo è un esempio testuale di razionamento computazionale: riservare le risorse più scarse a chi meno si preoccupa del prezzo, mentre si distribuiscono modelli sub-top di costo contenuto per difendere il mercato di massa.
Da Astra il 3 settembre, a Sol il 22, a 6.1 Sol il 29: tre lanci di modelli in un solo mese. Ogni lancio ridisegna alla radice il costo base per i data center.
Le startup di modelli leggeri sono danni collaterali. L’API Decisions spinge il modello più piccolo, Luna, a 150 ms per giudizio, progettato appositamente per classificazione e instradamento. Alcuni lo vedono come un attacco mirato al modello decisionale Jev di TypeSafe.
Account universale
Spazio, Pagine, presentazioni, attività di team, plugin per riunioni, più @ChatGPT integrato direttamente in Slack e Teams.
Unendo questi elementi, ChatGPT non assomiglia più affatto a un semplice chatbot.
Assomiglia piuttosto a un sistema operativo desktop in fase di formazione.

Davanti a esso si allinea una lunga lista di nomi: Notion, Google Workspace, Slack e Microsoft Office. Le presentazioni sottolineano in particolare l’esportazione senza perdite in PowerPoint e Google Slides.
Ancora più interessanti sono i partner seduti nei posti VIP.
Notion è uno dei primi 16 partner di «Accedi con ChatGPT», consentendo agli utenti di utilizzare i crediti dell’abbonamento ChatGPT direttamente in Notion; tuttavia nello stesso giorno OpenAI ha lanciato Pagine e Spazio, che competono con Notion su quasi tutti i punti funzionali.
Figma, Adobe e Salesforce sono entrati nella lista principale del marketplace software OpenAI, permettendo alle aziende di acquistare i loro prodotti con crediti contrattuali prepagati a OpenAI; ma nello stesso giorno ChatGPT sta progressivamente trasformando la progettazione grafica, il layout e la gestione dei ticket clienti—attività originariamente loro prerogativa—in proprie funzionalità native.
«Accedi con ChatGPT» sembra essere un plugin per l’accesso senza password, ma in realtà sta costruendo un account universale per l’era dell’IA. I 1,2 miliardi di utenti attivi settimanali non devono estrarre il portafoglio in ogni app: i crediti provengono da OpenAI e gli sviluppatori downstream saldano i conti con OpenAI.
Chi incassa per primo è il vero padrone.

Il telaio
Nel primo semestre di quest’anno, la parola più citata dalla comunità di startup IA per rafforzare il proprio coraggio è stata «controllo».
Imprenditori e investitori la usavano per placare un crescente senso d’insicurezza. Per quanto potente sia il modello, è solo un motore; l’intero strato esterno—orchestrazione delle sessioni, compressione del contesto, recupero degli strumenti e ripristino tollerante ai guasti, che permette effettivamente agli agenti di svolgere compiti—è il vero vantaggio competitivo.
All’epoca tutti erano certi di una cosa: le grandi tech erano troppo impegnate ad accumulare potenza di calcolo per occuparsi di questo lavoro sporco.
Questo DevDay ha smentito tale assunzione. Con l’aggiunta ufficiale dell’uso del computer all’Agents API, OpenAI ha estratto l’intero «controllo» alla base di Codex, ChatGPT e dot—ossa comprese. Ne ha reso pubblico il codice, ne offre l’hosting e ha persino coinvolto AWS per integrarlo in Bedrock.
I grandi giocatori non si sono limitati a farlo: ne hanno fatto un componente standard industriale. Lo strato più generico e standardizzato del framework per agenti è stato impacchettato e riportato in casa dal fornitore originale. Di conseguenza, la nicchia ecologica dello sviluppatore si è ritrovata in una posizione delicata.
Codex Cloud ti permette di chiudere il laptop ed eseguire operazioni offline nel cloud; la revisione del codice può essere fatta per te durante la notte; Security Cloud analizza e corregge automaticamente i repository in tempo reale; la vista /agents nella nuova CLI consente a una persona di coordinare più agenti che lavorano in parallelo.
L’atto di digitare sta scomparendo. Gli sviluppatori non scrivono più codice: sono diventati quelli che, seduti alla scrivania, premono Invio per approvare.
Se i framework generici non costituiscono più un vantaggio competitivo, dove possono ancora andare le startup?
O approfondire domini verticali privati, inaccessibili alle grandi tech, o addentrarsi in nicchie trascurate per motivi di conformità.
OpenAI però non sembra intenzionata a lasciare molti spazi vuoti. Nello stesso giorno dell’evento di lancio, sono stati introdotti contemporaneamente zero conservazione dati e inferenza privata.
Le porte rimaste aperte per gli intermediari si stanno chiudendo una dopo l’altra.
L’equilibrio
Il giorno prima dell’evento di lancio, molti che attendevano GPT-6.1 Astra sono rimasti delusi.

OpenAI ha volontariamente bloccato questo modello flagship, inizialmente previsto per l’ottobre. Saachi Jain, responsabile del sistema di sicurezza, ha dichiarato che il modello non aveva pienamente soddisfatto i criteri di rilascio riguardo «rispetto dei limiti autorizzati e comunicazione fedele del comportamento operativo agli esseri umani».
Si tratta di un raro freno d’emergenza.
Nella corsa ai modelli di grandi dimensioni, tutti si sono abituati a partire anticipatamente, accaparrarsi GPU e competere sulle date di lancio. In un momento in cui quasi tutto il settore è travolto dalla FOMO e corre a testa bassa, ritirare dal palco un modello flagship già pronto richiede grande determinazione.
Fare un passo indietro spesso richiede più determinazione che avanzare.
Ma è proprio questo a rendere Dot sul palco del tutto naturale.
Quando un agente inizia ad avere il proprio computer cloud indipendente, può navigare autonomamente sul web h24 e invocare strumenti: la vera soglia tecnica non riguarda più ottenere due punti percentuali aggiuntivi su un benchmark.
Ciò che è difficile è garantire fiducia.
In ogni dettaglio del prodotto Dot si vedono i compromessi articolati scelti dagli ingegneri.
La ricerca proattiva in sola lettura elimina il rischio di operazioni accidentali; le azioni altamente sensibili richiedono sempre l'approvazione umana; i servizi di terze parti gestiscono le credenziali tramite un proxy di sistema e le password non vengono mai esposte al modello in chiaro.
Queste regole sono definite con grande dettaglio, apparendo persino caute.
Ma è proprio questa la condizione preliminare perché le aziende osino affidare fatture, contratti e repository di codice. La sicurezza non è più un manifesto etico pubblicato su un sito ufficiale, ma un permesso commerciale tangibile.
Quando Altman ha parlato sul palco di questa linea di difesa, il suo atteggiamento era calmo. Ha spiegato che, se l'allineamento viene considerato esclusivamente un problema ingegneristico, si rischia di trascurare questioni più profonde e importanti; riguardo alle varie battute provenienti dall'esterno, ha aggiunto che, se le persone hanno bisogno di proiettare la propria ansia su qualcuno o prenderlo in giro per alleggerire la tensione, non gli dispiace.
Dopo tre anni di corsa sfrenata, il settore sta cominciando a capire che ciò che determina quanto lontano possa arrivare un modello non è mai stato solo il throughput all'interno di un cluster di calcolo, ma il suo senso di proporzione nel confrontarsi con il mondo reale.
Tutti i permessi sono stati accuratamente suddivisi: quali affidare alle macchine e quali lasciare agli esseri umani.
Proprio come quella semplice regola riportata in fondo al manuale di sistema: Dot può redigere contratti, risolvere problemi di codice e connettere 4.000 app, ma quando si tratta di cambiare una password, si ferma silenziosamente in attesa che sia l’utente a farlo.
Questo è l'inizio della maturità.
Link originale


