Apple espande capacità AI con Siri e Image Playground

Apple reinventa Siri con Google Gemini e rilancia Image Playground

Siri è rimasta ferma mentre i rivali correvano. A WWDC 2026, l'8 giugno, Apple ha risposto con la ristrutturazione più radicale del suo assistente vocale dalla nascita del prodotto, integrando una partnership con Google Gemini come motore del modello sottostante e lanciando una nuova app dedicata. La mossa arriva dopo che la mancata consegna delle funzioni AI annunciate a WWDC 2024 ha già costato all'azienda un risarcimento da 250 milioni di dollari per pubblicità ingannevole.

La nuova Siri: app standalone, memoria delle conversazioni e fotocamera attiva

La versione rinnovata abbandona il modello del semplice comando vocale. Arriva una app dedicata a Siri che consente conversazioni a testo libero, caricamento di file e accesso alla cronologia delle sessioni precedenti — un'esperienza analoga a quella di ChatGPT. L'assistente ora legge il contesto personale dell'iPhone: se l'utente vuole comporre un'email, Siri può attingere alle note salvate sul dispositivo per costruire una risposta.

L'integrazione nella fotocamera porta due funzioni concrete. La prima risolve uno dei momenti più scomodi del mangiare fuori: si punta l'iPhone sullo scontrino, ogni voce diventa selezionabile, e Siri genera richieste di pagamento Apple Cash personalizzate in base a chi ha ordinato cosa. «If you're grabbing a bite with friends and point your iPhone at the bill, then [you can] select what you ordered to split the tab with Apple Cash», ha spiegato Sebastien Marineau-Mes, VP of Software di Apple. La seconda funzione mostra stime nutrizionali puntando la fotocamera sul piatto.

«Over the last few years, with the growth of large language models, some of these assistants have gotten tremendously capable — while Siri has remained relatively programmatic and limited in what it can do», ha osservato Avi Greengart, lead analyst e presidente di Techsponential.

Image Playground: generazione da foto reali e maggiore qualità

Image Playground, lo strumento di generazione immagini integrato negli iPhone, viene aggiornato in modo sostanziale. La funzione ora attinge alla libreria Foto dell'utente per generare immagini multi-persona e trasformare scatti in stili diversi tramite prompt in linguaggio naturale: si può aggiungere la torta di compleanno tenuta da un amico, modificarne l'outfit, cambiare lo sfondo. Le immagini create sono esportabili nel formato corretto per ogni utilizzo — orizzontale per un sito di piccole imprese, verticale per un volantino — e integrabili come sfondi di iMessage, lock screen e contact poster.

Il vantaggio dichiarato rispetto ai concorrenti è la privacy: attraverso il Private Cloud Compute, le foto non vengono mai memorizzate né condivise, neppure con Apple.

Apple espande capacità AI con Siri e Image Playground
Uno smart speaker Apple: interfaccia chiave della nuova generazione di assistenti AI dell'azienda. Foto di William Bradshaw su Pexels

I Foundation Models di terza generazione: architettura e numeri

Alla base di tutto ci sono i nuovi Apple Foundation Models (AFM 3), cinque modelli sviluppati in collaborazione con Google che coprono sia i casi d'uso on-device sia quelli server.

ModelloTipoParametri / caratteristiche
AFM 3 CoreOn-device3 miliardi di parametri
AFM 3 Core AdvancedOn-device20B (architettura sparsa: 1–4B attivi)
AFM 3 CloudServer (PCC)Ottimizzato per velocità e multimodalità
ADM 3 Cloud (Image)Server (PCC)Generazione e editing immagini
AFM 3 Cloud ProServer (PCC — GPU NVIDIA)Ragionamento complesso e agentic

AFM 3 Core Advanced è il modello tecnicamente più rilevante: i 20 miliardi di parametri risiedono in memoria flash, ma solo da 1 a 4 miliardi vengono caricati in DRAM per ogni richiesta, grazie a una tecnica chiamata Instruction-Following Pruning. Il risultato è un modello scalabile senza i limiti di memoria tradizionali dei dispositivi consumer.

Nelle valutazioni interne con revisori umani, AFM 3 Core è stato preferito nel 45,6% dei casi contro il 23,3% del modello 2025. Il salto lato server è ancora più netto: AFM 3 Cloud raccoglie il 64,7% delle preferenze contro l'8,7% della versione precedente — un miglioramento relativo del 36% nella soddisfazione complessiva e del 21% nell'instruction following.

Accesso gratuito per i piccoli sviluppatori

Per gli sviluppatori con meno di 2 milioni di download alla prima installazione su App Store, Apple elimina il costo API per accedere ai Foundation Models su Private Cloud Compute. La logica ricalca quella già adottata con lo Small Business Program, che offre commissioni ridotte ai piccoli developer ancora lontani da milioni di ricavi. Il framework Foundation Models si estende quest'anno anche a input immagini e al supporto per modelli server di provider terzi.

Privacy, dati personali e il rischio dell'AI non richiesta

Più Siri sa di noi, più diventa utile — ma anche più divisiva. Serge Egelman, esperto di sicurezza online alla UC Berkeley, sintetizza il problema: «In many cases, they don't want these AI features. At the same time, all of these companies are invested in this. That's why it's getting shoved down everyone's throats.»

Apple punta sulla combinazione di elaborazione on-device e Private Cloud Compute per non memorizzare i dati degli utenti, lo stesso schema adottato con l'integrazione ChatGPT annunciata a WWDC 2024. La differenza strutturale rispetto ai concorrenti è il controllo dell'hardware — chip serie A e M — che consente di mantenere più elaborazione sul dispositivo.

Il divario tra la vecchia e la nuova Siri, stando ai benchmark interni, è reale: un modello server preferito dal 64,7% dei valutatori contro l'8,7% del predecessore non è un aggiornamento incrementale. Il problema non è più il modello: è se gli utenti, scottati dai ritardi del 2024 e dalla class action da 250 milioni, decideranno di credere ad Apple ancora una volta.

Francesco Leone
Francesco Leone

Francesco Leone è un esperto in Intelligenza Artificiale con una profonda conoscenza in Machine Learning e Deep Learning. Attraverso la sua esperienza, ha contribuito allo sviluppo di soluzioni innovative in ambito di elaborazione del linguaggio naturale e visione artificiale, mirando a trasformare il modo in cui interagiamo con la tecnologia. Attivo nel settore con pubblicazioni e progetti su https://ital-ia.it/, Francesco si dedica alla ricerca e all'applicazione di algoritmi avanzati per rendere i sistemi più intelligenti e accessibili.

Articoli: 553

Lascia una risposta

Il tuo indirizzo email non sarà pubblicato. I campi obbligatori sono contrassegnati *