Innovazione

ChatGPT vs Smartphone: Un Test sulle Funzioni Quotidiane

Un esperimento ha messo ChatGPT alla prova su 12 attività quotidiane, rivelando punti di forza e limiti dell'AI rispetto alle app tradizionali.

In Breve

Quali attività quotidiane sono state testate con ChatGPT?
Sono state testate dodici attività quotidiane, tra cui previsioni meteo, calcoli matematici e suggerimenti di film.
Quali sono stati i punti di forza di ChatGPT nel test?
ChatGPT ha mostrato buone performance in previsioni meteo, calcoli e identificazione di piante.
Quali funzioni hanno mostrato fallimenti?
Funzioni come cronometro, sveglia e supporto al food delivery hanno mostrato significativi fallimenti.

Un recente test ha messo alla prova ChatGPT su dodici attività quotidiane comunemente svolte tramite app su smartphone, rivelando risultati misti. L’esperimento, condotto senza un’integrazione profonda con il sistema operativo del telefono, ha limitato l’accesso dell’AI a email, app di messaggistica e wallet, influenzando alcune prove.

ChatGPT ha mostrato buone performance in attività come previsioni meteorologiche, calcoli matematici, suggerimenti di film e identificazione di piante. Le previsioni meteo si sono dimostrate accurate, i calcoli sono stati esatti, sebbene con qualche ritardo, e le raccomandazioni cinematografiche si sono rivelate ben calibrate sui gusti dell’utente. Inoltre, l’identificazione botanica è risultata efficace dopo verifiche incrociate.

Tuttavia, l’AI ha ottenuto solo risultati parziali in attività come giochi di parole, identificazione del cielo stellato, pianificazione di percorsi e apprendimento di lingue. Sebbene ChatGPT abbia riprodotto la meccanica di alcuni giochi, non ha eguagliato l’esperienza d’uso delle app dedicate. Per quanto riguarda la pianificazione di viaggi, ha fornito opzioni utili, ma il dialogo ha richiesto chiarimenti e ha generato azioni indesiderate, come la creazione di promemoria.

Le funzioni più utilitaristiche, come cronometro, sveglia, meditazione guidata e supporto al food delivery, hanno mostrato fallimenti significativi. Ad esempio, ChatGPT non è riuscito a misurare il tempo come un cronometro nativo e la sveglia non ha allertato l’utente nonostante la creazione di un avviso. Inoltre, la guida vocale per la meditazione ha presentato intonazioni disturbanti, mentre le raccomandazioni per ristoranti hanno suggerito locali chiusi o non disponibili.

Questo esperimento evidenzia che, nella sua attuale implementazione come app separata, l’AI è più adatta a sostituire app informazionali piuttosto che quelle che richiedono azioni rapide e integrate. Un’eventuale integrazione nativa di ChatGPT nel sistema operativo potrebbe migliorare i risultati, consentendo accesso a calendari e timer, ma è necessaria maggiore attenzione all’accuratezza e alla qualità delle informazioni fornite.