OpenAI lancia di prima mattina il nuovo assistente per affrontare Muse: spegni il telefono e continua a funzionare

📅 2026-09-30

Riassunto:

Non appena Meta's Muse è diventato popolare, sono arrivati ​​i prodotti rivali di OpenAI.

La mattina presto del 30 settembre, ora di Pechino, OpenAI ha rilasciato l'agente intelligente per tutte le stagioni Dots durante la conferenza degli sviluppatori. Gli utenti possono creare il proprio Dot direttamente nella pagina Web ChatGPT e consentirgli di utilizzare il computer cloud per navigare sul Web, chiamare applicazioni e gestire più attività contemporaneamente; può continuare a funzionare dopo aver lasciato la finestra di chat e tornare da te quando incontra cose che necessitano di conferma.

La conferenza ha portato anche uno spazio collaborativo, ChatGPT Space, che consente ai membri del team e all'intelligenza artificiale di lavorare insieme su progetti; il nuovo modello GPT-6.1 Sol punta sull'economicità. OpenAI afferma che le sue capacità sono vicine a quelle dell'ammiraglia Astra e che i prezzi di input e output dell'API standard sono circa un quinto di questi ultimi.

Anche lo strumento di programmazione Codex è stato aggiornato: l'ambiente di lavoro cloud può essere utilizzato ripetutamente e gli utenti possono continuare a portare avanti le attività originali quando cambiano dispositivo. Insieme al pacchetto Pro mensile da $ 500 appena aggiunto, OpenAI questa volta ha aggiornato il suo assistente personale, il team office e gli strumenti di sviluppo.


01 Punti: affida continuamente un lavoro all'intelligenza artificiale

Le attività elencate da OpenAI per Dots includono il monitoraggio delle segnalazioni di errori in arrivo, il test delle correzioni o la scoperta del motivo per cui l'applicazione sta diventando più lenta. Mentre gestisce queste attività, gli utenti possono anche segnalare nuove cose senza dover aprire una finestra di chat separata per ciascun progetto.

Nel video promozionale di apertura, un Dot di nome Alfred ha già iniziato a prendersi cura di queste cose per gli utenti: aggiornare le presentazioni del forum sulla base dei dati appena ricevuti, sistemare le notizie notturne e ricordare questioni urgenti prima di andare al lavoro. Il fornitore della torta nuziale ha temporaneamente annullato l'ordine. Ha trovato alternative e ha consentito agli utenti di decidere quando provarle.

Nel film, l'utente controlla il nuovo design del sito web e chiede di scambiare due foto e confermare prima della pubblicazione; i materiali della tavola sono pronti e possono essere modificati prima di essere inviati al team.

Dot conserva lo sfondo dell'attività precedente, quindi gli utenti non devono spiegarlo dall'inizio ogni volta.


Powering Dots è il GPT-6 Astra rilasciato. Dot può utilizzare le applicazioni a cui l'utente si è connesso; dopo aver ottenuto l'autorizzazione, può anche connettersi al computer dell'utente.

Il CEO Sam Altman ha citato un compito più lungo: migrare l'applicazione prima che la vecchia API venga ritirata. Secondo la società, Dot terrà traccia delle dipendenze, identificherà le aree che necessitano di modifiche, scriverà codice, eseguirà test e infine invierà una modifica al codice per la revisione umana.

La dipendente di OpenAI Holly Li ha dato una dimostrazione dal vivo utilizzando l'applicazione musicale fittizia Blossom Music. Il suo Dot si chiama Dotty e può accedere a Slack e mobilitare Codex. Quando l'app sta per essere online, Dotty seguirà le modifiche alla pianificazione e il feedback degli utenti e invierà i progetti che necessitano della sua revisione.

La dimostrazione vocale non è stata fluida come il video promozionale.

Holly ha simulato di chiedere informazioni sulla situazione del test utente della notte precedente mentre andava al lavoro. Dotty rispose che lo stava cercando, ma poi non diede ancora la risposta attesa. Ha quindi modificato le sue istruzioni e ha chiesto a Dotty di inserire le informazioni pertinenti nella Pagina. Anche un'altra demo che chiedeva a Codex di creare un'applicazione ha riscontrato un errore. Ha spiegato la situazione sul palco e ha continuato ad aspettare che l'attività venisse eseguita.

Holly ha anche introdotto un caso d'uso interno di OpenAI: qualcuno ha inviato l'ID di sessione e il problema dell'utente al canale di feedback e Dot di un ingegnere ha ricevuto l'indizio e ha inviato il codice di riparazione. Gli ingegneri di OpenAI hanno già i loro Dots che risolvono dozzine di problemi software ogni giorno, ha detto.

Oltre a ChatGPT, gli utenti possono anche contattare Dot tramite Slack e Microsoft Teams e possono anche effettuare chiamate vocali con esso in ChatGPT. OpenAI prevede inoltre di aggiungere la comunicazione via SMS, consentendo agli utenti di utilizzare messaggi di testo per spiegare cose, ricevere progressi o esprimere la propria posizione su una decisione.

Quante informazioni è possibile accedere e quali strumenti possono essere utilizzati sono determinati dall'autorizzazione dell'utente. Dots rispetta i permessi di accesso delle applicazioni connesse e gli utenti possono specificare come esegue le operazioni con istruzioni personalizzate.

La ricerca attiva in background è di sola lettura per impostazione predefinita e non puoi utilizzarla per inviare messaggi, modificare contenuti o controllare dispositivi; c'è una revisione automatica durante l'esecuzione delle operazioni e le operazioni sensibili come la modifica delle password sono ancora lasciate agli esseri umani.

Dots è disponibile per gli utenti Pro e Business Premium qualificati a livello regionale, mentre gli spazi di lavoro Enterprise, Edu e Healthcare richiedono che gli amministratori abilitino la versione beta.

Il primo punto è incluso nell'abbonamento idoneo e le conversazioni con esso non verranno conteggiate nella quota di utilizzo di ChatGPT; le attività Codex e ChatGPT Work che avvia o gestisce continueranno a consumare la quota corrispondente.

Per le imprese, OpenAI ha lanciato anche un progetto pilota di Dots professionali. Questo tipo di agente è al servizio dell'intero team, ha una propria identità organizzativa, credenziali e autorizzazioni di sistema ed è responsabile di una parte chiara dell'attività. L'azienda ha sperimentato internamente approvvigionamenti, elaborazione fatture, marketing via e-mail, assistenza clienti e contratti commerciali e ha collaborato con i clienti per definire responsabilità, strumenti disponibili e processi di approvazione.

OpenAI sta collaborando con Microsoft per consentire a questi agenti professionali di connettersi a Microsoft Agent 365 e utilizzare i sistemi di gestione e sicurezza esistenti dell'azienda.

02 Spazio ChatGPT: i risultati vengono restituiti e il team continua ad apportare modifiche

Il lavoro svolto da Dot può essere inserito nel ChatGPT Space appena lanciato e consegnato ai colleghi per la revisione e la modifica.

Space sostituirà la Libreria originale degli utenti idonei. I materiali di lavoro del team vengono inseriti in Page. Una pagina può contenere testo, immagini, tabelle, grafici interattivi e strumenti.

I membri possono modificare insieme oppure possono usare @ChatGPT o Dot nei commenti per verificare le dipendenze, aggiungere contenuti e continuare a far avanzare il progetto.

Durante la demo di Blossom Music, Holly ha inserito il feedback del team in Page e ha chiamato Dotty per organizzare i contenuti in un grafico a barre. I grafici possono essere filtrati in base al tipo di feedback, visualizzare punti dati specifici o possono essere lasciati a Dotty per l'aggiornamento ogni ora.

Quando ha bisogno di integrare informazioni, non deve sfogliare i messaggi uno per uno: può chiedere a Dotty di trovare i dati di guida dell'utente menzionati da un ingegnere in un messaggio privato di Slack e aggiungerli alla pagina; può anche chiedere a Dotty di includere ulteriori feedback dalla sua collega Laura.

Questi aggiornamenti possono essere eseguiti ripetutamente in base a una pianificazione. L'utente specifica quali fonti controllare, quali parti della pagina modificare e quanto spesso eseguirla e ChatGPT mantiene la pagina come richiesto. OpenAI ha anche presentato in anteprima funzionalità come presentazioni condivise, consentendo ai team e ai rispettivi Dots di collaborare alla modifica delle diapositive all'interno di ChatGPT.

Una volta condivisa la pagina, cambierà anche la visibilità delle informazioni. Le regole di condivisione per le aree di lavoro esistenti continuano ad applicarsi, i membri possono ottenere autorizzazioni di visualizzazione o modifica e le autorizzazioni possono essere modificate o revocate. I file caricati direttamente sulla Pagina ereditano le autorizzazioni della Pagina.

Inserire un collegamento a un file esterno in Page non garantirà automaticamente ai colleghi l'accesso al file originale; tuttavia, se il testo nel file viene estratto o riepilogato nella pagina, le persone con autorizzazioni per la pagina possono visualizzarne il contenuto.

Lo stesso vale per le chat private e i ricordi personali: la condivisione di una Pagina non aprirà direttamente le conversazioni o i ricordi privati ​​dell'utente, ma se ChatGPT scrive le informazioni nella pagina condivisa, questa parte del contenuto verrà visualizzata ai collaboratori.

Nello stesso progetto, più dipendenti possono modificare la Pagina contemporaneamente, ciascuno chiamando ChatGPT per elaborare lo stesso materiale. Dopo che Dot ha restituito i risultati, i colleghi possono commentare, aggiungere o continuare ad assegnare attività direttamente accanto ai risultati. Non è necessario inserire prima le risposte nella conversazione privata e poi rispiegare i dettagli.

03 Sol riduce i costi, Ultrafast migliora la velocità e Pro ha un nuovo prezzo di $ 500

Dopo che un lavoro è stato affidato a un agente, spesso passa attraverso più cicli di lettura di materiali, strumenti di chiamata e modifiche. Questa volta OpenAI ha anche modificato il prezzo del modello, la velocità di output e l'importo dell'abbonamento.

OpenAI ha dichiarato che le capacità del nuovo GPT-6.1 Sol sono vicine a quelle del GPT-6 Astra rilasciato. Il prezzo standard dell'API è di 2 USD per milione di token di input e di 10 USD per milione di token di output.

L'azienda posiziona Sol come modello di cavallo di battaglia nel lavoro quotidiano, enfatizzando la programmazione, le operazioni informatiche e le attività professionali. Al momento è entrato in ChatGPT Work, Codex e API, ma non è ancora entrato nella normale modalità Chat.

Secondo Bloomberg, il giorno prima della conferenza, OpenAI ha annullato il piano di rilascio di GPT-6.1 Astra a causa di rischi per la sicurezza.

L'Astra Ultrafast è stata lanciata per ridurre i tempi di attesa. Secondo la documentazione ufficiale, nel Codex la velocità di generazione dei token può essere fino a 8 volte quella della modalità standard, raggiungendo circa 300 token al secondo. L'esecuzione dello strumento, i test e l'attesa di risposte esterne richiederanno comunque tempo per l'attività.

Nella dimostrazione live fianco a fianco, entrambe le parti hanno ricevuto lo stesso messaggio. La dimostrazione del razzo generata da Ultrafast era decollata, ma la modalità standard non era ancora stata completata. Il lancio della versione ultraveloce di GPT-6.1 Sol è previsto in un secondo momento.


Le modalità più veloci consumeranno anche il credito più velocemente.

Nel Codex, Ultrafast consuma la quota di utilizzo nel pacchetto a una velocità 8 volte superiore alla modalità standard. Gli utenti possono scegliere la modalità di velocità in base alle esigenze dell'attività.

In termini di abbonamento, il nuovo Pro 500 ha un prezzo di 500 dollari al mese, fornendo 25 volte l'utilizzo di ChatGPT Plus e includendo l'accesso ultraveloce.

Anche Pro 200, che costa US$ 200 al mese, è aperto per l'abbonamento, ma alcuni limiti di utilizzo sono stati ridotti. I vecchi utenti idonei possono mantenere la quota originale fino al 29 ottobre 2026. Successivamente verrà modificata e la tariffa mensile sarà ancora pari a 200 USD.

Per un giudizio rapido, OpenAI ha lanciato anche l'API Decisions. Lo sviluppatore fornisce innanzitutto una serie di opzioni predefinite, che vengono poi selezionate dal modello Luna, eliminando la necessità di generare un'intera risposta. È adatto per compiti ben definiti come triage e triage e l'azienda afferma che le risposte possono essere compresse in una frazione di secondo. Questa API è inizialmente disponibile in anteprima limitata.

Tejal Patwardhan, responsabile della ricerca post-formazione presso OpenAI, ha introdotto sul palco che l'azienda ha già i propri stagisti di ricerca sull'intelligenza artificiale. Ha mostrato esempi di modelli che gestiscono attività legali, progettano risorse di gioco, creano dashboard e compilano informazioni fiscali e ha affermato che i modelli hanno partecipato a miglioramenti della formazione che hanno contribuito a migliorare le operazioni del computer e le prestazioni di rifiuto.

Secondo Patwardhan, da luglio ad agosto di quest'anno, il modello è stato in grado di completare più di un terzo dei compiti di ricerca che, secondo le statistiche, avrebbero richiesto agli esseri umani un giorno per essere completati senza intervento umano.

In precedenza, i modelli fallivano nella maggior parte dei tentativi quando dovevano affrontare compiti più lunghi come questo.

OpenAI ha inoltre affermato che il suo modello ha contribuito a risolvere più di 100 problemi matematici aperti da decenni e ha partecipato alla ricerca su nuovi antibiotici, lingue antiche e robot di produzione.

04 Codex e API degli agenti: gli sviluppatori possono anche creare i propri agenti

Il framework di orchestrazione condiviso da Dots e Codex è responsabile della gestione del contesto, della chiamata degli strumenti e della pianificazione delle attività. Gli sviluppatori possono anche utilizzare questo framework per creare i propri agenti.

Quando il Codex verrà rilasciato nel maggio 2025, sarà già in grado di eseguire attività nella sandbox cloud.

Ciò che DevDay aggiorna ulteriormente questa volta è l'esperienza di lavoro nel cloud: gli utenti possono avviare, seguire e trasferire attività su più dispositivi, riutilizzare l'ambiente di sviluppo e lasciare il lavoro a lungo termine nel cloud.

Romain Huet, responsabile delle relazioni con gli sviluppatori di OpenAI, ha dimostrato sul palco come avviare un compito importante: riscrivere l'intero backend del progetto in Rust. Ha inviato l'attività al cloud, ne ha lasciato continuare l'esecuzione e ha continuato a dimostrare altre funzioni, pianificando di tornare più tardi per controllare e consegnare.

Per attività più brevi, puoi visualizzare il processo di modifica completo. Ha usato la riga di comando per chiedere al Codex di presentare una domanda che selezionasse casualmente tre partecipanti e ha dato ai candidati selezionati i biglietti per il successivo DevDay. Dopo aver generato la domanda, ha modificato il numero dei partecipanti in sei, quindi ha selezionato i candidati selezionati sul posto.

Questa dimostrazione era originariamente prevista per l'uso della voce, ma ha riscontrato difficoltà nell'avviare la voce, quindi ha utilizzato la riga di comando per completarla. In un'altra dimostrazione, ha consegnato uno screenshot dell'app a Codex e ha chiesto di verificarne le prestazioni su schermi di diverse dimensioni. L'agente ha quindi utilizzato il simulatore, ha aperto l'app e ne ha controllato la funzionalità.

Il framework di orchestrazione del Codex che supporta queste operazioni è open source e gli sviluppatori possono visualizzare l'implementazione e crearla da soli.

L'API Agents appena lanciata aggiunge funzionalità quali l'utilizzo del computer, il controllo multi-agente, l'attivazione di strumenti e la gestione del contesto nei servizi di hosting per consentire agli sviluppatori di accedere ai loro prodotti.

Ad esempio, un agente di test di un sito web può aprire un browser, fare clic su pagine diverse e controllare il processo operativo dell'utente. OpenAI sta inoltre collaborando con AWS per fornire funzionalità correlate negli agenti gestiti di Amazon Bedrock, consentendo alle aziende di creare agenti accanto ad applicazioni e dati esistenti.

In termini di velocità di risposta, OpenAI ha anche riferito che il tempo di attesa per il primo token dell'API è stato ridotto del 45%.

L'agente deve accedere alle informazioni aziendali e l'azienda si occuperà anche di come vengono gestiti questi contenuti. La Private Intelligence introdotta questa volta da OpenAI include meccanismi di privacy come la conservazione zero dei dati e il Private Safety Processing; Private Inference, che utilizza l'elaborazione confidenziale, prevede di lanciare un'anteprima questo autunno.

Private Safety Processing archivia i record crittografati pertinenti in un archivio controllato dal cliente, conduce revisioni automatizzate della sicurezza attraverso un ambiente informatico protetto e limita l'accesso del personale ai contenuti.

Il cliente mantiene il controllo dello spazio di archiviazione e OpenAI utilizza segnali di sicurezza limitati per determinare se è necessario adottare misure per evitare di consentire al personale di leggere direttamente il contenuto originale durante la revisione quotidiana.

05 Il credito nell'abbonamento ChatGPT verrà utilizzato per applicazioni di terze parti

Dopo che gli sviluppatori hanno creato un'applicazione, hanno ancora bisogno di persone che la utilizzino. OpenAI ha annunciato alla conferenza che ChatGPT ha più di 1,2 miliardi di utenti attivi settimanali; le nuove modalità di accesso e distribuzione questa volta renderanno più semplice per alcuni utenti provare prodotti di terze parti.

L'accesso con ChatGPT è iniziato con 16 partner editoriali.

Gli utenti Plus e Pro idonei possono utilizzare la quota AI all'interno dell'abbonamento ChatGPT nelle applicazioni partecipanti senza fornire una chiave API aggiuntiva. Questo utilizzo verrà conteggiato nella quota condivisa corrispondente.

Gli utenti possono acquistare un credito di chiamata modello duplicato in meno, ma le applicazioni di terze parti possono comunque addebitare i propri abbonamenti, infrastruttura, servizi o funzionalità premium, come stabilito dallo sviluppatore.

Le estensioni plug-in consentono agli sviluppatori di inserire più interfacce in ChatGPT e Codex. Oltre a consentire a un modello di chiamare un servizio, gli utenti possono aprire direttamente un editor, una dashboard o un'area di lavoro e lavorare sulle cose durante la conversazione.

Esempi di dimostrazioni sul posto includono la visualizzazione delle riunioni nel calendario, la presa di appunti in ChatGPT e l'apertura di file di progettazione, la visualizzazione dei commenti dei colleghi e la richiesta a ChatGPT di modificarli. Adobe è anche uno dei partner presenti alla conferenza e le operazioni di progettazione possono essere completate nell'attuale ambiente di lavoro.

ChatGPT può anche consigliare i plug-in adatti durante la conversazione e l'utente può decidere sul momento se connettersi. Gli sviluppatori non devono riavviare l'intero processo di invio quando richiedono la revisione manuale.

Questi plugin forniscono anche l'accesso ai siti ChatGPT. Secondo Altman sul palco, gli utenti hanno creato milioni di siti web di diverso tipo nei mesi successivi al lancio di Sites. Dopo aver effettuato l'accesso al plug-in, lo stesso sito web può combinare applicazioni e informazioni autorizzate da diversi utenti per fornire la propria esperienza utente.

L'approvvigionamento aziendale viene effettuato da OpenAI Marketplace, con 32 partner nel primo lotto.

I clienti aziendali idonei possono utilizzare una parte dei loro impegni di acquisto OpenAI esistenti per prodotti di terze parti approvati.

Gli sviluppatori potranno anche raggiungere i clienti aziendali che stanno già acquistando servizi da OpenAI.

La conferenza ha menzionato anche la collaborazione con Baseten, che offre agli sviluppatori più canali per accedere a modelli aperti.

06 Muse ha catturato prima gli utenti, poi Dots ha riunito il team

Meta Muse, rilasciato l'8 settembre, funziona anche in una macchina virtuale dedicata, dispone di un browser, può funzionare su più applicazioni connesse, ricorda le preferenze dell'utente e continua a funzionare per l'utente.

Secondo VentureBeat che cita TechCrunch, Sensor Tower stima che Muse sia stato scaricato più di 3,4 milioni di volte al 24 settembre. Le stime di altre agenzie variano: Apptopia ne dà 4,3 milioni, Appfigures circa 2,3 milioni. In meno di tre settimane dal suo lancio, Muse è in testa alle classifiche degli app store statunitensi di Apple e Google.

Meta sta portando questo calore anche nella scena lavorativa. Il 29 settembre ha ampliato le integrazioni per le piccole imprese includendo strumenti come Shopify, QuickBooks, Stripe e Canva. VentureBeat ha citato il Wall Street Journal secondo cui circa un terzo degli utenti di Muse hanno collegato account aziendali e più di 1.500 aziende hanno richiesto l'integrazione di Muse.

Nel sito di rilascio di Dots, i compiti del team sono stati stabiliti fin dall'inizio: seguire il lancio del software, raccogliere feedback dai colleghi, correggere bug e aggiornare le pagine condivise.

I Personal Dots sono responsabili di fare cose per gli utenti, Space consente ai colleghi di unirsi e i piloti professionisti di Dots affidano gli appalti, i contratti e altre attività agli agenti che servono l'intero team.

Anche altre aziende sono in lizza per tale accesso. Instinct collega gli assistenti a e-mail, messaggi e dispositivi, consentendo agli utenti di effettuare telefonate o inviare messaggi di testo; Manus 2.0 offre nuove funzionalità di cloud computing e automazione; Grok Bot di xAI consente inoltre agli agenti di accedere alle applicazioni esistenti e continuare a funzionare; OpenClaw consente agli utenti di trasferire attività in servizi di messaggistica familiari.

Oltre alle attività, gli utenti forniscono a tali assistenti l'accesso alla propria casella di posta, al calendario e alle applicazioni di lavoro. L'agente ricorda gradualmente le abitudini lavorative dell'utente e dà seguito al lavoro non completato.

Quando si passa a un assistente, potrebbe essere necessario migrare anche queste connessioni, autorizzazioni e background lavorativo accumulato.

Le aziende devono inoltre chiarire le autorizzazioni degli assistenti personali e degli agenti aziendali. Un dipendente può far sì che il proprio Dot elabori i dati e il team può anche avere un Dot professionista responsabile dell'approvvigionamento; a quali sistemi possono accedere, con quale identità agiscono e dove vengono collocati i risultati devono rispettare le regole di account e condivisione esistenti.

Al termine della conferenza, Altman ha affermato di sperare che l'intelligenza artificiale porti a una rinascita anziché trasformare le persone in ingranaggi di una macchina industriale. OpenAI spera che, dopo aver consegnato alcuni dei loro passi quotidiani, le persone possano liberare energia per fare cose che prima non avevano tempo di fare.

Attualmente, ogni utente idoneo riceverà prima un punto.

OpenAI prevede di consentire agli utenti di gestire un gruppo di Dots in futuro, ma il prezzo commerciale specifico per Dots aggiuntivi e Dots professionali non è stato ancora annunciato.

Tag correlati

Articoli correlati

Commenti

0/500
Captcha (click to refresh)
Nessun commento