In Breve
- Quali sono i punti di forza di ChatGPT nel test?
- ChatGPT ha eccelso in previsioni meteorologiche, calcoli matematici, suggerimenti di film e identificazione di piante.
- Quali funzioni hanno avuto risultati parziali?
- Hanno ottenuto risultati parziali giochi di parole, identificazione del cielo stellato, pianificazione di percorsi e apprendimento linguistico.
- Quali sono stati i fallimenti di ChatGPT?
- ChatGPT ha fallito in funzioni come cronometro, sveglia, meditazione guidata e supporto al food delivery.
ChatGPT vs App di Smartphone: Un Test sulle Funzioni Quotidiane
Un recente esperimento ha messo alla prova ChatGPT, l’intelligenza artificiale di OpenAI, su dodici attività quotidiane che normalmente vengono svolte tramite app su smartphone. I risultati sono stati misti, con quattro successi, quattro parziali e quattro fallimenti. Questo test ha evidenziato i punti di forza e le limitazioni di ChatGPT, soprattutto in assenza di un’integrazione profonda con il sistema operativo del dispositivo.
Punti di Forza di ChatGPT
ChatGPT ha dimostrato di eccellere in alcune funzioni, come:
- Previsioni meteorologiche: Le previsioni fornite dall’AI si sono rivelate accurate e tempestive.
- Calcoli matematici: I risultati sono stati corretti, anche se con qualche ritardo.
- Consigli cinematografici: Le raccomandazioni si sono dimostrate ben calibrate sui gusti dell’utente.
- Identificazione botanica: L’AI ha efficacemente riconosciuto piante da fotografie, confermando i risultati tramite verifiche incrociate.
Risultati Parziali
Alcune funzioni hanno ottenuto risultati parziali, tra cui:
- Giochi di parole: ChatGPT ha riprodotto la meccanica, ma non ha offerto un’esperienza d’uso fluida come le app dedicate.
- Identificazione del cielo stellato: Ha riconosciuto costellazioni da foto, ma non ha fornito un’esperienza di esplorazione AR continua.
- Pianificazione di percorsi: Sebbene siano state fornite opzioni utili, il dialogo ha richiesto chiarimenti e ha generato azioni indesiderate, come la creazione di promemoria.
- Apprendimento linguistico: La conversazione vocale è risultata naturale quando funzionante, ma ha mostrato pause e malfunzionamenti.
Fallimenti nelle Funzioni Utility
Alcune funzioni tipiche di utilità hanno fallito, tra cui:
- Cronometro: ChatGPT non è riuscito a misurare il tempo trascorso come un cronometro nativo.
- Sveglia: Non ha allertato l’utente nonostante la creazione di un avviso.
- Meditazione guidata: La guida vocale ha mostrato intonazioni disturbanti.
- Supporto al food delivery: L’assistente ha suggerito ristoranti chiusi o non disponibili, evidenziando un divario tra raccomandazione informativa e azione concreta.
Conclusioni e Prospettive Future
L’esperimento ha messo in luce che, con l’attuale implementazione di ChatGPT come app separata e senza accesso profondo ai dati e ai servizi del dispositivo, l’AI è più adatta a sostituire app informazionali. Tuttavia, fatica a sostituire app che richiedono azioni rapide e integrate, come timer e navigazione turn-by-turn. Inoltre, emergono criticità comuni, come la generazione di risposte errate ma sicure e la mancanza di integrazione con banche dati specialistiche.
Un’eventuale integrazione nativa dell’AI nel sistema operativo potrebbe modificare i risultati, consentendo accesso a calendari, timer e impostazioni. Tuttavia, è fondamentale garantire maggiore accuratezza, fonti affidabili e la possibilità di uscire dall’interfaccia conversazionale quando l’esperienza utente richiede strumenti più diretti.
