ChatGPT e le App per Smartphone: Un Test sulle Funzioni Quotidiane
In Breve
- Quali funzioni ha superato ChatGPT nel test?
- ChatGPT ha superato test su previsioni meteorologiche, calcoli matematici, suggerimenti di film e identificazione di piante.
- Quali funzioni hanno ottenuto un passaggio parziale?
- Passaggi parziali per giochi di parole, identificazione del cielo stellato, pianificazione di percorsi e apprendimento di una lingua.
- In quali funzioni ha fallito ChatGPT?
- Fallimenti in cronometro, sveglia, meditazione guidata e supporto al food delivery.
ChatGPT e le App per Smartphone: Un Test sulle Funzioni Quotidiane
Un recente esperimento ha messo alla prova ChatGPT, l’intelligenza artificiale sviluppata da OpenAI, su dodici attività quotidiane comunemente svolte tramite app su smartphone. I risultati sono stati misti, con l’IA che ha ottenuto quattro successi, quattro passaggi parziali e quattro fallimenti complessivi. È importante notare che il test è stato condotto senza un’integrazione profonda con il sistema operativo del telefono, limitando l’accesso a email, app di messaggistica e wallet.
Punti di Forza di ChatGPT
ChatGPT ha dimostrato di eccellere in alcune aree, superando i test relativi a:
- Previsioni meteorologiche: Le previsioni fornite si sono rivelate accurate e tempestive.
- Calcoli matematici: I risultati sono stati corretti, sebbene con qualche ritardo.
- Consigli cinematografici: Le raccomandazioni sono state ben calibrate sui gusti dell’utente.
- Identificazione botanica: L’IA è stata efficace nel riconoscere piante da foto, dopo verifiche incrociate.
Passaggi Parziali
Alcune funzioni hanno ottenuto un passaggio parziale, tra cui:
- Giochi di parole: ChatGPT ha riprodotto la meccanica, ma non ha offerto l’esperienza d’uso fluida delle app dedicate.
- Identificazione del cielo stellato: Ha riconosciuto costellazioni da singole foto, ma non ha fornito un’esplorazione AR continua.
- Pianificazione di percorsi: Sebbene abbia fornito opzioni utili, il dialogo ha richiesto chiarimenti e ha generato azioni indesiderate, come la creazione di promemoria.
- Apprendimento di una lingua: Le conversazioni vocali sono risultate naturali quando funzionanti, ma soggette a pause e malfunzionamenti.
Fallimenti nelle Funzioni di Utility
Nonostante i successi, ChatGPT ha fallito in alcune funzioni tipiche di utility:
- Cronometro: Non è riuscito a misurare il tempo trascorso come un cronometro nativo.
- Sveglia: Non ha allertato l’utente nonostante la creazione di un avviso.
- Meditazione guidata: La guida vocale ha mostrato intonazioni e esitazioni disturbanti.
- Supporto al food delivery: Ha suggerito ristoranti chiusi o non disponibili sulle piattaforme di consegna.
Conclusioni del Test
Questo esperimento evidenzia che, con l’attuale implementazione di ChatGPT come app separata e senza accesso profondo ai dati e ai servizi del dispositivo, l’IA è più adatta a sostituire app informazionali che forniscono conoscenza o spiegazioni. Tuttavia, fatica a sostituire app che devono eseguire azioni rapide e integrate con il sistema operativo, come timer, navigazione turn-by-turn e gestione di ordini.
Inoltre, emergono criticità comuni, come la generazione di risposte errate ma sicure, la mancanza di integrazione con banche dati specialistiche e la perdita di usabilità rispetto a interfacce progettate ad hoc.
Un’ulteriore osservazione è che un’integrazione nativa dell’IA nel sistema operativo potrebbe modificare i risultati, consentendo accesso a calendari, timer e navigazione. Tuttavia, rimangono richieste garanzie maggiori su accuratezza, fonti affidabili e la possibilità di uscire dall’interfaccia conversazionale quando l’esperienza utente richiede strumenti più diretti.
