Rétrospective OpenAI DevDay 2026 : Agent personnel, Sol 6.1 et l’absence d’Astra

Tapbit Wire - Tapbit NewsTapbit Wire·Source :TheBlockBeats·
Partager

Titre original : « Rétrospective OpenAI DevDay 2026 : Agent personnel, Sol 6.1, l’absence d’Astra » Auteur original : Dongcha Beating

Le 29 septembre 2026 à San Francisco, OpenAI DevDay 2026 s’est tenu comme prévu, malgré la pression exercée par son ancien rival Anthropic dans la course aux modèles.

Toutefois, le nouveau modèle phare était absent de cet événement de lancement.

GPT-6.1 Astra, initialement prévu pour une sortie en octobre, a été retiré d’urgence par la société vingt-quatre heures avant l’ouverture. Le nouvel acteur central est devenu l’Agent personnel, baptisé Dot par OpenAI.

Cet événement a annoncé 25 mises à jour, recensées ci-dessous par Dongcha Beating.

Modèles et Dot

Dot

Un agent personnel piloté par GPT-6 Astra. Il dispose d’un ordinateur sandbox cloud indépendant et d’un navigateur dédié, connecté à plus de 4 000 applications externes ; il effectue des recherches proactives et peut naviguer en arrière-plan dans les applications avec des droits lecture seule pour identifier des tâches à accomplir ; les utilisateurs Pro et Business Premium reçoivent leur premier Dot gratuitement, sans que les échanges ne soient comptabilisés dans le quota de base ChatGPT.

Dots spécialisés

Version préliminaire d’employés numériques pour entreprises. Ils possèdent une identité, des identifiants et un numéro de matricule propres au sein de l’organisation.

GPT-6.1 Sol

Spécialisé dans la programmation d’agents, les opérations informatiques et les tâches professionnelles. Coût : 2 $ par million de jetons en entrée, 10 $ en sortie (soit un cinquième d’Astra) ; entrée mise en cache : 0,10 $. Son score DeepSWE v1.1 égale celui d’Astra, tandis que son score Terminal-Bench dépasse de plus de deux fois celui de la génération précédente Sol.

Astra Ultrafast & Sol Ultrafast

Niveau haute capacité ultra-rapide. Vitesse accrue jusqu’à 8×, débit Codex d’environ 300 jetons/seconde. Tarif : 6× celui d’Astra standard (entrée : 60 $, sortie : 300 $).

Intelligence confidentielle

Tous les niveaux prennent en charge la « rétention zéro de données » avec vérification hors ligne de la sécurité ; partenariat avec Cisco, Databricks et Snowflake pour lancer l’inférence confidentielle basée sur une architecture de calcul confidentiel.

Codex et API

Codex Cloud

Environnement de développement cloud entièrement géré. Fonctionne hors ligne, les processus continuent même si l’ordinateur portable est fermé, et les équipes peuvent partager des conteneurs préconfigurés.

Nouvelle CLI Codex

Interaction redessinée dans le terminal, commande vocale en temps réel, prise en charge native des worktrees et nouvelle vue /agents pour l’orchestration multi-agents et le suivi des progrès.

Revue de code

Intégrée au client bureau, compatible avec les PR GitHub et les MR GitLab, et capable d’effectuer automatiquement une revue initiale et un diagnostic des différences via le cloud, même hors ligne.

Codex Security Cloud

Industrialisation du projet interne Defense Factory, intégration au modèle de cybersécurité Daybreak Blue, offrant une analyse continue des vulnérabilités et une correction automatisée des dépôts de code.

API Decisions

Version OpenAI de Jev : interface dédiée aux décisions, verrouillant GPT-6 Luna dans un périmètre Q/R fixe. Conçue spécifiquement pour la classification d’intention et le routage de chemins d’agents, avec un temps de réponse d’environ 150 ms et une vitesse d’appel 10 fois supérieure aux appels classiques.

API Agents – Ouverture à l’utilisation informatique

Ouverture complète des fonctionnalités centrales de Codex (orchestration multi-agents, compression de contexte, récupération d’outils, interaction avec l’écran). Le code du framework est open source ; une option entièrement gérée est également disponible.

Agents gérés Amazon Bedrock

Intégration approfondie avec AWS, permettant aux entreprises d’exécuter directement les systèmes d’agents OpenAI dans leur propre VPC et sur leurs ressources de calcul AWS.

Système de plugins

Barre latérale de plugins et interaction avec les fichiers

Les développeurs peuvent personnaliser des panneaux interactifs ou des visionneuses de fichiers dédiés dans la barre latérale de ChatGPT, intégrant directement leurs produits au flux de conversation.

Restructuration de répertoire et découverte passive

Flux de soumission et d’examen des plugins repensé, avec recommandations proactives de plugins pertinents selon le contexte durant les conversations naturelles des utilisateurs.

Intégration de site avec les plugins

Aide les entreprises à connecter directement leurs sites internes aux plugins, permettant aux membres d’accéder aux données internes selon leurs autorisations respectives.

MCP piloté par les événements

Intègre la spécification d’événements MCP promue par Anthropic, permettant le réveil automatique en arrière-plan des plugins pour rédiger des propositions dès qu’un outil externe de collaboration (ex. tableaux de projet) change d’état.

Travail collaboratif

Espace de connaissances ChatGPT

Remplace l’ancienne base de connaissances et sert de centre collaboratif durable où membres, Codex et dot partagent le même contexte.

Pages dynamiques

Supports riches éditables en temps réel par plusieurs personnes et agents, intégrant des composants dynamiques, des tâches à faire en direct et des tableaux de bord de données, avec possibilité de sélectionner du texte spécifique pour @mentionner des agents et cibler des modifications.

Présentations collaboratives

Moteur de présentation prenant en charge la collaboration multi-utilisateurs en temps réel, capable de générer et présenter directement dans ChatGPT, et d’exporter sans perte vers PowerPoint ou Google Slides.

Tâches d’équipe et affectation planifiée

Créez des flux de tâches périodiques en entreprise déclenchables par e-mail, messagerie instantanée ou événements planifiés.

Intégration avec les messageries professionnelles

Intégration approfondie avec Slack et Teams, permettant aux membres de l’entreprise d’utiliser @ pour demander des synthèses ou diagnostiquer des bogues directement dans les canaux, sans comptes personnels requis.

Plugin de réunion

Disponible dès maintenant sur macOS : enregistre localement l’audio et combine le contexte pour générer décisions clés et tâches à suivre ; l’analyse audio se fait hors ligne et les fichiers sont immédiatement supprimés.

Page d’accueil des compétences personnelles et d’équipe

Permet l’affichage centralisé et la réutilisation externe des sites, plugins et compétences partagées que vous avez créés.

Monétisation et abonnements

Connectez-vous avec ChatGPT

Authentification unifiée sur l’ensemble du réseau. Les utilisateurs Plus et Pro peuvent directement consommer le quota de jetons inclus dans leur abonnement au sein de produits tiers ; la première vague comprend 16 entreprises, dont Devin, Notion et Vercel.

Nouveau forfait Pro à 500 $

Offre le quota de concurrence prioritaire le plus élevé, avec accès exclusif à Astra Ultrafast.

Ajustements du quota Pro initial de 200 $

Réouvert après une suspension de 20 jours, mais à compter du 30 octobre, le quota de calcul pour les travaux Codex et ChatGPT passe de 20× Plus à 10×, et le plafond hebdomadaire pour GPT-6 Pro est divisé par deux (100 messages). Les utilisateurs existants reçoivent un crédit de 2 500 $ expirant avant la fin de l’année.

Marché logiciel OpenAI

Partenariat initial avec 32 éditeurs de logiciels, dont Adobe, Figma, Salesforce, ServiceNow et Harvey : les entreprises peuvent utiliser leur quota de dépenses pré-engagé auprès d’OpenAI pour compenser et acquérir des produits SaaS tiers en sens inverse.

Le seul véritable produit présenté lors de ce DevDay est Dot.

Toutes les autres annonces — Sol, Ultrafast, Codex harness, Space, Pages ou événements MCP — ne sont, prises isolément, que des composants épars ; assemblés, elles constituent en réalité les os, la chair et les nerfs de Dot.

Dot réfléchit avec Astra, pilote le système via Codex harness, se connecte à plus de 4 000 logiciels externes via des plugins, s’active automatiquement via des événements MCP dès qu’un tableau de bord change, puis écrit les tâches accomplies dans Pages et les envoie aux canaux Teams.

Ces trois dernières années, la compréhension tacite de l’interaction homme-machine est restée coincée dans cette petite boîte.

D’abord « vous posez une question, elle y répond » ; ensuite « vous donnez une tâche, elle l’exécute et livre le résultat ».

Dot n’attend plus que vous appuyiez sur Entrée devant le curseur. Elle possède son propre ordinateur cloud et navigateur, et même après que l’utilisateur ferme l’écran, elle continue en arrière-plan à naviguer dans diverses applications avec des autorisations restreintes (lecture seule), cherchant les factures non émises ou les bogues encore non corrigés.

Selon les responsables, elle mène à bien les tâches à votre manière avant même que vous ne demandiez quoi que ce soit.

Par le passé, que ce soit ChatGPT ou divers Copilots, ils se disputaient surtout des licences par poste au niveau logiciel, facturées mensuellement par utilisateur — comme pour équiper chaque employé d’un tournevis pratique.

Dot et les Dots spécialisés vont plus loin : ces derniers disposent de comptes domaine indépendants, d’identifiants système et de matricules employés au sein des entreprises, intégrés au système de gouvernance Microsoft Agent 365, suivant les processus IT habituels (intégration, audit, désactivation).

Les entreprises n’achètent plus un compte outil, mais embauchent un employé-machine qui ne nécessite ni cotisations sociales ni interruption de service.

C’est aussi là que les deux géants de la Silicon Valley divergent : Meta pousse son Muse, similaire en forme, vers des milliards d’utilisateurs ordinaires, tirant profit de sa première place dans les classements gratuits pour étendre son audience grand public ; OpenAI, quant à lui, verrouille Dot derrière les hautes barrières des abonnements Pro et entreprise, avec des coûts mensuels supplémentaires futurs pour davantage de Dots.

L’un capte le temps des utilisateurs, l’autre les postes de travail des entreprises.

Accélération

En apparence, ce sont des employés machines, mais en coulisses, c’est une facture informatique chargée d’anxiété.

GPT-6.1 Sol coûte seulement un cinquième d’Astra, tout en rivalisant presque avec lui sur la plupart des benchmarks ; Astra Ultrafast est affiché à six fois le prix standard, délivrant une vitesse fulgurante de 300 jetons par seconde ; ensuite, Sol Ultrafast est présenté comme « l’achat d’un cerveau proche d’Astra avec une vitesse 8 fois supérieure au prix initial d’Astra ».

Cela est rare dans les récits antérieurs sur les modèles. L’industrie ne considérait auparavant que les scores aux benchmarks, mais désormais latence et débit sont mis en évidence, devenant des luxes clairement tarifés.

Pourquoi ?

Parce que, pour ceux qui font écrire du code par des agents, quelques secondes de latence peuvent briser totalement l’état de concentration laborieusement acquis.

La rapidité est devenue la prime la plus coûteuse.

Or OpenAI est une entreprise souffrant d’une pénurie aiguë de puissance de calcul.

Le forfait Pro à 200 $, en raison de la saturation des ressources, s’est vu coupé directement par les autorités le 10 septembre, suspendant les nouvelles souscriptions pendant jusqu’à 20 jours ; dès la réouverture, il a été annoncé que l’utilisation incluse serait réduite de moitié, passant de 20 à 10 fois celle du forfait Plus. Parallèlement, un nouveau forfait à 500 $ par mois est apparu, offrant exclusivement le modèle le plus rapide.

Il s’agit là d’un exemple classique de rationnement de la puissance de calcul : réserver les ressources les plus rares aux clients les moins sensibles au prix, tout en déployant des modèles sub-phare suffisamment abordables pour défendre le grand public.

D’Astra le 3 septembre, à Sol le 22, puis à 6.1 Sol le 29 — trois lancements de modèles en un seul mois. Chaque lancement redéfinit fondamentalement la base des coûts pour les centres de données.

Les startups spécialisées dans les petits modèles en subissent les contrecoups. L’API Decisions pousse le petit modèle Luna à seulement 150 ms par jugement, conçu spécifiquement pour la classification et le routage. Certains y voient une frappe précise contre le modèle décisionnel Jev de TypeSafe.

Compte universel

Espace, Pages, présentations, tâches d’équipe, plugins de réunion, plus @ChatGPT intégré nativement à Slack et Teams.

Assemblez le tout, et ChatGPT ne ressemble plus du tout à un simple chatbot.

Il ressemble davantage à un système d’exploitation bureautique en cours de formation.

Juste devant lui s’aligne une longue liste de noms : Notion, Google Workspace, Slack et Microsoft Office. La fonctionnalité « présentations » insiste particulièrement sur l’export sans perte vers PowerPoint et Google Slides.

Ce qui est encore plus intéressant, ce sont les partenaires installés dans les sièges VIP.

Notion fait partie des 16 premiers partenaires de « Connexion avec ChatGPT », permettant aux utilisateurs de déduire directement leurs crédits d’abonnement ChatGPT depuis Notion ; or, le même jour, OpenAI lançait Pages et Espace, qui entrent en concurrence frontale avec Notion sur quasiment tous les points fonctionnels.

Figma, Adobe et Salesforce figurent sur la grande liste du marché logiciel OpenAI, permettant aux entreprises d’utiliser leurs crédits contractuels prépayés auprès d’OpenAI pour acheter leurs produits ; or, le même jour, ChatGPT intègre progressivement la conception graphique, la mise en page et la gestion des tickets clients — des tâches qui leur appartenaient initialement — comme fonctionnalités natives.

« Se connecter avec ChatGPT » semble, à première vue, être un plugin d’authentification sans mot de passe, mais en réalité, il construit un compte universel pour l’ère de l’IA. Les 1,2 milliard d’utilisateurs actifs hebdomadaires n’ont pas besoin d’ouvrir leur portefeuille séparément dans chaque application : les crédits proviennent d’OpenAI, et les développeurs tiers règlent leurs factures auprès d’OpenAI.

Celui qui perçoit l’argent en premier est le véritable propriétaire.

Le châssis

Au premier semestre de cette année, le mot le plus souvent invoqué par la communauté des startups IA pour se donner du courage était « maîtrise ».

Les entrepreneurs et investisseurs l’utilisaient pour apaiser une angoisse sourde. Peu importe la puissance du modèle, il n’est qu’un moteur ; la couche externe entière — orchestration des sessions, compression du contexte, recherche d’outils et récupération tolérante aux pannes —, celle qui permet réellement aux agents d’accomplir des tâches, constitue la véritable barrière défensive.

À l’époque, tout le monde était convaincu d’une chose : les grandes entreprises technologiques étaient trop occupées à accumuler de la puissance de calcul pour s’embarrasser de ce travail ingrat.

Cette DevDay a balayé cette hypothèse. Avec l’ajout officiel de l’utilisation informatique à l’API Agents, OpenAI a dévoilé l’intégralité de la « maîtrise » sous-jacente à Codex, ChatGPT et dot — jusqu’à ses fondations. Le code a été publié en open source, un service d’hébergement offert, et AWS même intégré pour l’intégrer à Bedrock.

Les géants ne se sont pas simplement lancés dans ce domaine : ils en ont fait un composant standardisé. La couche la plus générale et la plus normalisée du cadre agent a été empaquetée et internalisée par le fournisseur d’origine. Parallèlement, la niche écologique des développeurs s’est retrouvée dans une position délicate.

Codex Cloud vous permet de fermer votre ordinateur portable et d’exécuter des tâches hors ligne dans le cloud ; les revues de code peuvent être effectuées automatiquement pendant la nuit ; Security Cloud analyse et corrige les dépôts en continu ; la vue /agents dans la nouvelle interface CLI permet à une seule personne de coordonner plusieurs agents travaillant en parallèle.

L’acte de taper disparaît progressivement. Les développeurs ne rédigent plus le code : ils approuvent désormais en appuyant sur Entrée depuis leur bureau.

Si les cadres généralistes ne constituent plus une barrière défensive, où les startups peuvent-elles encore aller ?

Soit creuser profondément dans des domaines sectoriels spécialisés, inaccessibles aux géants technologiques, soit explorer des niches négligées pour des raisons de conformité réglementaire.

Or OpenAI ne semble clairement pas vouloir laisser beaucoup de marges. Le jour même de l’événement de lancement, la rétention zéro de données et l’inférence privée ont été déployées simultanément.

Les portes encore ouvertes aux intermédiaires se ferment une à une.

L’équilibre

La veille de l’événement de lancement, beaucoup de personnes attendant GPT-6.1 Astra sont reparties bredouilles.

OpenAI a volontairement suspendu ce modèle phare, initialement prévu pour une sortie en octobre. Saachi Jain, chargée du système de sécurité, a indiqué que le modèle ne remplissait pas encore pleinement les critères de publication concernant « le respect strict des limites autorisées et la restitution fidèle du comportement opérationnel aux humains ».

Il s’agit d’un frein d’urgence rare.

Dans la course aux grands modèles, chacun s’est habitué à devancer les échéances, à accaparer des GPU et à rivaliser sur les dates de lancement. À une époque où presque toute l’industrie est emportée par le FOMO et court tête baissée, retirer du programme un modèle phare prêt à être lancé exige une grande détermination.

Reculer demande souvent plus de résolution que foncer en avant.

Mais c’est précisément ce qui rend Dot sur scène parfaitement naturel.

Lorsqu’un agent se dote d’un ordinateur cloud autonome, peut naviguer seul sur le web en continu et invoquer des outils, le véritable seuil technique ne réside plus dans l’optimisation de deux points supplémentaires sur une référence.

Ce qui est difficile, c’est d’instaurer la confiance.

Dans chaque détail produit de Dot, on perçoit les compromis échelonnés adoptés par les ingénieurs.

La recherche proactive en lecture seule élimine le risque d’opérations accidentelles ; les actions hautement sensibles requièrent systématiquement une validation humaine ; les services tiers voient leurs identifiants gérés par un proxy système, sans jamais exposer les mots de passe au modèle en clair.

Ces règles sont définies avec une grande précision, voire une certaine prudence.

Or, c’est précisément cette condition préalable qui détermine si les entreprises osent réellement confier à Dot leurs factures, contrats et dépôts de code. La sécurité n’est plus un manifeste éthique affiché sur un site officiel, mais un permis commercial concret.

Lorsqu’Altman a évoqué cette ligne de défense sur scène, son attitude était calme. Il a souligné que traiter l’alignement uniquement comme un problème d’ingénierie ferait passer à côté de propositions plus profondes et essentielles ; quant aux plaisanteries extérieures, il a ajouté qu’il n’y voyait aucun inconvénient si les gens devaient projeter leur anxiété sur quelqu’un ou se moquer de lui pour s’alléger un peu.

Après trois ans de course effrénée, le secteur commence à comprendre que ce qui détermine la portée d’un modèle ne relève jamais uniquement du débit au sein d’un cluster informatique, mais bien de son sens des proportions face au monde réel.

Toutes les autorisations ont été soigneusement réparties : lesquelles sont confiées aux machines, lesquelles restent réservées aux humains.

Comme cette règle simple mentionnée au bas du manuel système : Dot peut rédiger des contrats, diagnostiquer des bugs de code et connecter 4 000 applications, mais lorsqu’il s’agit de modifier un mot de passe, il s’arrête discrètement et attend que l’humain intervienne.

C’est le début de la maturité.

Lien original