Agente AI autonomo su scrivania minimalista con laptop e tablet, dispositivi con intelligenza artificiale per flussi di lavoro complessi

OpenAI lancia GPT-5.6 e ChatGPT Work: l’agente autonomo che lavora per ore

OpenAI ha ottenuto il via libera del governo statunitense e rilascia oggi al pubblico GPT-5.6, il modello che Sam Altman definisce «il migliore che abbiamo mai prodotto». Il lancio non arriva da solo: insieme al modello debutta ChatGPT Work, un agente basato su tecnologia Codex capace di operare in autonomia su app, file e flussi di lavoro complessi per ore consecutive.

La mossa accorcia i tempi della competizione sugli agenti AI. Anthropic aveva appena convertito Claude Code in Cowork — una riorganizzazione simile, che trasforma strumenti per sviluppatori in assistenti per il lavoro quotidiano. Ma il vero nodo, oggi, non è solo chi arriva primo: è che nessuno sa davvero come funzioni il processo con cui il governo decide se un modello di frontiera è abbastanza sicuro da essere rilasciato.

GPT-5.6 dopo il semaforo verde: un via libera che solleva domande

GPT-5.6 era stato confinato per due settimane a una «anteprima limitata» riservata a organizzazioni selezionate dall'amministrazione Trump. Oggi l'anteprima finisce e il modello esce per tutti gli utenti, dopo colloqui tra OpenAI e figure come il Segretario al Commercio Howard Lutnick, il Segretario al Tesoro Scott Bessent e il direttore nazionale per la cybersicurezza Sean Cairncross.

Come sia maturata quella decisione, però, è tutt'altro che chiaro. «Francamente non ho visibilità su quei processi esatti, quindi non ho abbastanza informazioni per dire se siano adeguati o meno», spiega Mina Narayanan, senior research analyst al Center for Security and Emerging Technology della Georgetown University. «Anthropic ha detto di aver dialogato con il governo, di aver sviluppato un classificatore per rilevare tentativi di jailbreak e strategie difensive per prevenirli. Ma che forma abbia avuto esattamente quel dialogo — con Anthropic e con OpenAI — non è chiaro».

L'ex consigliere politico di Trump Dean W. Ball, oggi in OpenAI, ha scritto nella sua newsletter che «nessuno sa quali siano i requisiti per ottenere la licenza». E Andy Konwinski, co-fondatore di Databricks, Perplexity e del Laude Institute, va oltre: «È un problema esistenziale. Al di là della sicurezza, la questione è chi ha il potere di decidere — chi fa da gatekeeper e decide i permessi».

Il quadro normativo è in costruzione. Un ordine esecutivo pubblicato il mese scorso traccia una tabella di marcia per valutare i modelli di frontiera, ma i dettagli restano da riempire. Sriram Krishnan, ex partner di Andreessen Horowitz e fino al mese scorso senior advisor per l'AI alla Casa Bianca, ha tagliato corto: «Non ci sarà una FDA per l'AI». Per ora il Center for AI Standards and Innovation del Dipartimento del Commercio sembra guidare la partita, ma l'ordine esecutivo incarica sei agenzie di definire un processo definitivo entro i primi di agosto. Nel frattempo gli esperimenti di governance sono, nella migliore delle ipotesi, improvvisati.

A complicare il quadro ci sono i rapporti tra OpenAI e l'amministrazione: Sam Altman avrebbe offerto fino al 5% dell'equity di OpenAI per i cosiddetti «Trump Accounts», mentre il presidente di OpenAI Greg Brockman risulta il più grande donatore noto alla macchina politica trumpiana per le elezioni di metà mandato. Per osservatori esterni è difficile separare queste attività dall'approccio regolatorio morbido riservato al modello.

ChatGPT Work: come funziona l'agente per progetti complessi

ChatGPT Work è descritto da OpenAI come un agente che opera all'interno di ChatGPT, lavora per ore su progetti complessi e restituisce output finiti — un foglio Excel, un documento Word — a partire da un compito assegnato. Si appoggia alla suite di modelli GPT-5.6 (Sol, Terra e Luna) e mette insieme funzioni prima sparse tra ChatGPT e Codex.

Agente AI autonomo su scrivania minimalista con laptop e tablet, dispositivi con intelligenza artificiale per flussi di lavoro complessi
ChatGPT Work è il nuovo agente autonomo di OpenAI basato su tecnologia Codex, capace di operare su app e file per ore consecutive senza supervisione.

La novità principale è una directory unificata di plugin che al lancio include:

  • Produttività e archiviazione: Google Drive, SharePoint, Dropbox
  • Comunicazione: Slack, Microsoft Teams, Gmail, Outlook
  • CRM e marketing: Salesforce
  • Creatività e design: Adobe, Canva
  • Collaborazione e social: Zoom, LinkedIn, GitHub

L'utente può chiamare un plugin specifico con una menzione @ oppure lasciare che sia ChatGPT a individuare la fonte dati rilevante. L'idea ricorda il tentativo fallito dei plugin OpenAI del 2023. Il co-fondatore Greg Brockman lo ha riconosciuto: «Non funzionavano affatto perché i modelli non erano pronti». Con GPT-5.6 sotto il cofano, OpenAI scommette su un esito diverso.

Dal punto di vista della sicurezza, la funzione Auto-Review fa verificare le azioni critiche da modelli avanzati prima che vengano eseguite. OpenAI dichiara che durante il red-teaming avversariale Auto-Review ha bloccato il 100% dei tentativi di estrazione di dati protetti.

Rollout graduale e costi a consumo: chi può usarlo e da quando

La distribuzione segue canali differenziati:

CanaleDisponibilità immediataDisponibilità progressiva
Desktop (Mac e Windows)Tutti i piani, incluso il tier gratuito
Web e mobilePro, Enterprise, EduPlus e Business «nei prossimi giorni»

La fatturazione non è a canone fisso come la chat standard. ChatGPT Work condivide un pool di consumo con Codex, ChatGPT per Excel e Workspace Agents. Il costo di ogni task dipende da dimensioni, complessità e modello selezionato. Gli amministratori Enterprise ed Edu possono impostare limiti di spesa per workspace, gruppi e singoli utenti. Una volta esaurita la quota inclusa, alcuni utenti Codex Plus e Pro possono acquistare crediti extra; gli altri devono aspettare il reset o passare a un piano superiore.

Cosa significa questa accelerazione per il mercato degli agenti AI

C'è un paradosso in quello che succede oggi. OpenAI e Anthropic stanno entrambe convertendo strumenti nati per sviluppatori in prodotti per il lavoro quotidiano — un passaggio commerciale che ha senso, perché il codice è stato il primo banco di prova dove gli agenti hanno dimostrato di funzionare. Ma lo fanno mentre il perimetro regolatorio è così opaco che nemmeno i ricercatori dei laboratori di frontiera, secondo Konwinski, capiscono come funzioni il processo di approvazione.

La velocità del rilascio e la gara sugli agenti autonomi non sono neutre. Remzi Arpaci-Dusseau, professore di informatica all'Università del Wisconsin-Madison, l'ha messa così la scorsa settimana: «Non c'è la percezione che persone responsabili stiano guidando questi cambiamenti». E David Siegel, fondatore del fondo quantitativo Two Sigma, ha chiesto al pubblico di «immaginare una situazione — che io credo sarebbe pessima — in cui un piccolo numero di aziende controlla la tecnologia; il governo, nei suoi laboratori segreti, valuta se la tecnologia è adatta all'uso; e il pubblico e la comunità scientifica non hanno accesso a nulla di tutto questo».

Secondo Siegel non serve immaginare: è già qui.

Fonti

Francesco Leone
Francesco Leone

Francesco Leone è un esperto in Intelligenza Artificiale con una profonda conoscenza in Machine Learning e Deep Learning. Attraverso la sua esperienza, ha contribuito allo sviluppo di soluzioni innovative in ambito di elaborazione del linguaggio naturale e visione artificiale, mirando a trasformare il modo in cui interagiamo con la tecnologia. Attivo nel settore con pubblicazioni e progetti su https://ital-ia.it/, Francesco si dedica alla ricerca e all'applicazione di algoritmi avanzati per rendere i sistemi più intelligenti e accessibili.

Articoli: 553

Lascia una risposta

Il tuo indirizzo email non sarà pubblicato. I campi obbligatori sono contrassegnati *