In Breve
- Quali attività ChatGPT ha superato?
- Previsioni meteorologiche, calcoli matematici, suggerimenti di film e identificazione di piante.
- Quali sono stati i fallimenti di ChatGPT?
- Cronometro, sveglia, meditazione guidata e supporto al food delivery.
- Cosa potrebbe migliorare l'efficacia di ChatGPT?
- Un'integrazione nativa nel sistema operativo del dispositivo.
Un recente esperimento ha testato l’efficacia di ChatGPT in 12 attività quotidiane solitamente gestite tramite app su smartphone. I risultati sono stati variabili: quattro successi, quattro parziali e quattro fallimenti. L’AI, non integrata profondamente con il sistema operativo del telefono, non ha avuto accesso a email, app di messaggistica o wallet, limitando alcune prove.
ChatGPT ha superato i test relativi a previsioni meteorologiche, calcoli matematici, suggerimenti di film e identificazione di piante. Le previsioni erano accurate, i calcoli corretti, i suggerimenti cinematografici ben calibrati sui gusti dell’utente e l’identificazione botanica efficace.
Risultati parziali sono stati ottenuti nei giochi di parole, identificazione del cielo stellato, pianificazione di percorsi e apprendimento di una lingua. L’AI ha riprodotto la meccanica dei giochi ma non l’esperienza d’uso delle app dedicate; ha riconosciuto costellazioni da foto singole ma non offre esplorazione AR continua; nella pianificazione dei viaggi ha fornito opzioni utili ma con dialoghi che richiedevano chiarimenti; nelle esercitazioni linguistiche, la conversazione vocale era naturalistica ma soggetta a pause.
Fallimenti sono stati registrati nelle funzioni di utility come cronometro, sveglia, meditazione guidata e food delivery. ChatGPT non può misurare il tempo come un cronometro nativo; la sveglia non ha allertato l’utente; la guida vocale per la meditazione era disturbante; nella scelta di ristoranti, l’assistente ha suggerito locali chiusi o non disponibili.
L’esperimento evidenzia che, attualmente, l’AI è più adatta a sostituire app informazionali piuttosto che quelle che richiedono azioni rapide e integrate. Criticità comuni includono risposte errate ma sicure, mancanza di integrazione con banche dati specialistiche e perdita di usabilità rispetto a interfacce progettate ad hoc.
Un’integrazione nativa dell’AI nel sistema operativo potrebbe migliorare i risultati, consentendo accesso a calendari, timer e navigazione, ma rimangono necessarie garanzie su accuratezza e usabilità.

