In Breve
- Quali attività ha testato ChatGPT?
- ChatGPT è stato testato su 12 attività quotidiane svolte tramite app su smartphone.
- In quali aree ChatGPT ha avuto successo?
- Ha avuto successo in previsioni meteorologiche, calcoli matematici, suggerimenti di film e identificazione di piante.
- Quali funzioni hanno fallito?
- Funzioni come cronometro, sveglia, meditazione guidata e supporto al food delivery hanno mostrato fallimenti.
ChatGPT vs Smartphone: Un Test sulle Funzioni Quotidiane
Un recente esperimento ha messo alla prova ChatGPT, l’intelligenza artificiale sviluppata da OpenAI, su dodici attività quotidiane comunemente svolte tramite app su smartphone. I risultati sono stati misti, con quattro successi, quattro passaggi parziali e quattro fallimenti complessivi. È importante notare che il test è stato condotto senza un’integrazione profonda con il sistema operativo del telefono, limitando così l’accesso dell’AI a email, app di messaggistica e wallet.
Punti di Forza di ChatGPT
ChatGPT ha dimostrato di eccellere in alcune aree. Le previsioni meteorologiche fornite si sono rivelate accurate, i calcoli matematici sono stati corretti, seppur con qualche ritardo, e le raccomandazioni cinematografiche sono risultate ben calibrate sui gusti dell’utente. Inoltre, l’identificazione botanica delle piante tramite foto ha mostrato risultati efficaci dopo verifiche incrociate.
Passaggi Parziali: Un’Analisi Approfondita
Alcune funzioni hanno ottenuto un passaggio parziale. Ad esempio, i giochi di parole e l’identificazione del cielo stellato hanno mostrato delle potenzialità, ma non hanno eguagliato l’esperienza d’uso delle app dedicate. Nella pianificazione dei viaggi, ChatGPT ha fornito opzioni utili, ma il dialogo ha richiesto chiarimenti e ha generato azioni non volute, come la creazione di promemoria. Anche nelle esercitazioni linguistiche, la conversazione vocale si è rivelata naturalistica, ma soggetta a pause e malfunzionamenti.
Fallimenti nelle Funzioni di Utility
Al contrario, alcune funzioni tipiche di utility hanno mostrato evidenti limiti. ChatGPT non è stato in grado di misurare il tempo trascorso come un cronometro nativo; la prova della sveglia ha fallito nel notificare l’utente nonostante la creazione di un avviso. La guida vocale per la meditazione ha presentato intonazioni disturbanti, e nella scelta di ristoranti, l’assistente ha suggerito locali chiusi o non disponibili, evidenziando il divario tra raccomandazioni informative e azioni concrete.
Conclusioni e Riflessioni Finali
Questo esperimento mette in luce che, con l’attuale implementazione come app separata e senza accesso profondo ai dati e ai servizi del dispositivo, l’intelligenza artificiale è più adatta a sostituire app informazionali che forniscono conoscenza o spiegazioni. Tuttavia, fatica a sostituire applicazioni che richiedono azioni rapide e integrate con il sistema operativo, come timer e navigazione turn-by-turn. Inoltre, emergono criticità comuni, come la generazione di risposte errate ma sicure e la mancanza di integrazione con banche dati specialistiche.
Un’ulteriore osservazione è che un’integrazione nativa dell’AI nel sistema operativo potrebbe cambiare significativamente i risultati, permettendo un accesso a calendari, timer e impostazioni. Tuttavia, è fondamentale garantire maggiore accuratezza, fonti affidabili e la possibilità di uscire dall’interfaccia conversazionale quando l’esperienza utente richiede strumenti più diretti.
