
La sua vetrina annuale I/O dimostra che la frontiera non riguarda più le capacità dei modelli di intelligenza artificiale. Si tratta di trasformarli in prodotti intelligenti.
Se volete sapere dove si dirige l’intelligenza artificiale, il Google I/O di quest’anno vi ha coperto. La vetrina annuale dell’azienda sui prodotti di nuova generazione, che ha preso il via ieri, ha tutto lo sfarzo, i filmati e le apparizioni di celebrità che ci si aspetta da un evento di marketing multimilionario.
Ma ci mostra anche la rapidità con cui questa tecnologia ancora sperimentale viene inserita in una linea progettata per vendere telefoni e abbonamenti. Mai prima d’ora ho visto questa cosa che chiamiamo intelligenza artificiale apparire così normale.
Sì, la gamma di prodotti rivolti ai consumatori di Google è la più elegante in circolazione. L’azienda sta raggruppando la maggior parte dei suoi modelli multimodali nell’app Gemini, compresi il nuovo generatore di immagini Imagen 4 e il nuovo generatore di video Veo 3. Ciò significa che ora è possibile accedere all’intera gamma di modelli generativi di Google attraverso un unico chatbot. È stata inoltre annunciata Gemini Live, una funzione che consente di condividere lo schermo del telefono o la vista della fotocamera con il chatbot e di chiedergli cosa può vedere.
Queste funzioni erano state viste in precedenza solo nelle demo di Project Astra, un “assistente AI universale” a cui sta lavorando Google DeepMind. Ora Google si sta avvicinando a mettere Project Astra nelle mani di chiunque abbia uno smartphone.
Google sta inoltre introducendo l’AI Mode, un front-end per la ricerca alimentato da LLM. Questa modalità può ora raccogliere informazioni personali da Gmail o Google Docs per adattare le ricerche agli utenti. Il programma includerà Deep Search, che può scomporre una query in centinaia di ricerche individuali e poi riassumere i risultati; una versione di Project Mariner, l’agente di Google DeepMind che utilizza il browser; e Search Live, che consente di tenere in mano la fotocamera e chiederle cosa vede.
Questa è la nuova frontiera. Non si tratta più di chi ha i modelli più potenti, ma di chi riesce a trasformarli nei prodotti migliori. ChatGPT di OpenAI include molte funzioni simili a quelle di Gemini. Ma grazie al suo ecosistema di servizi per i consumatori e ai miliardi di utenti esistenti, Google ha un chiaro vantaggio. I power user che desiderano accedere alle versioni più recenti di tutto ciò che viene mostrato possono iscriversi a Google AI Ultra per 250 dollari al mese.
Quando OpenAI ha rilasciato ChatGPT alla fine del 2022, Google è stata colta in contropiede ed è stata costretta a ingranare la marcia superiore per recuperare il ritardo. Con la linea di prodotti di quest’anno, sembra che Google abbia bloccato l’atterraggio.
Durante una telefonata di anteprima, il CEO Sundar Pichai ha affermato che AI Overviews, un precursore di AI Mode che fornisce riepiloghi dei risultati di ricerca generati da LLM, si è rivelato popolare tra centinaia di milioni di utenti. Ha ipotizzato che molti di loro non sapessero (o non si preoccupassero) di utilizzare l’intelligenza artificiale: si trattava solo di un nuovo modo interessante di effettuare ricerche. Google I/O offre una visione più ampia di questo futuro, in cui l’IA è invisibile.
“È disponibile più intelligenza, per tutti, ovunque”, ha detto Pichai al suo pubblico. Credo che ci si aspetti che ci stupiamo. Ma inserendo l’intelligenza artificiale in ogni cosa, Google sta trasformando l’intelligenza artificiale in una tecnologia di cui non ci accorgeremo e a cui forse non daremo nemmeno un nome.





