In questo articolo Indice dei contenuti 2 sezioni
Un gruppo di ricercatori ha deciso di affidare il volante di un’auto vera a due degli assistenti di intelligenza artificiale più noti del momento, Grok e ChatGPT. L’esperimento si è chiuso senza vittime e già questa è una notizia. Il risultato però è stato a due facce, perché i chatbot alla guida si sono rivelati notevoli sotto certi aspetti e decisamente meno convincenti sotto altri.
L’idea di base ha qualcosa di provocatorio. Strumenti nati per conversare, rispondere a domande e scrivere testi sono stati messi alla prova in un contesto fisico e reale, lontano dallo schermo di un computer o di uno smartphone. Non una simulazione quindi ma un veicolo reale, con tutto ciò che comporta in termini di imprevisti e di margine d’errore.
Grok e ChatGPT al volante tra luci e ombre
Il bilancio complessivo dell’esperimento con Grok e ChatGPT non si presta a letture semplici. In alcuni momenti i due modelli hanno mostrato capacità impressionanti, tanto da sorprendere chi si aspettava un fallimento immediato. In altri frangenti invece le loro prestazioni sono state ben al di sotto delle aspettative, segno che passare dalle parole all’azione resta un salto tutt’altro che scontato per questi sistemi.
Proprio questa alternanza è l’aspetto più interessante. Gli assistenti conversazionali vengono spesso percepiti come strumenti quasi onniscienti, capaci di affrontare qualsiasi richiesta. Vederli all’opera su una macchina in carne e ossa, per così dire, aiuta a ridimensionare un po’ l’entusiasmo e a capire dove arrivano davvero le loro abilità e dove invece iniziano a mostrare la corda.
C’è poi un dettaglio che non va sottovalutato. Il fatto che la prova si sia conclusa senza feriti viene sottolineato quasi come una buona notizia a sé stante, ed è un modo piuttosto eloquente per descrivere l’esito di un test del genere. Non è esattamente il tipo di valutazione che si darebbe a un sistema pronto per la strada.
Un esperimento che dice molto sull’intelligenza artificiale
Prove di questo tipo servono anche a mettere alla prova il confine tra ciò che l’intelligenza artificiale generativa sa fare bene e ciò che invece le riesce con fatica. Chiedere a ChatGPT di scrivere un testo o a Grok di rispondere a una domanda è una cosa. Chiedere a entrambi di gestire un mezzo in movimento è una sfida di natura completamente diversa.
Dai risultati emerge quindi un quadro sfaccettato, in cui gli spunti positivi convivono con limiti evidenti. I ricercatori hanno di fatto messo i due chatbot davanti a un compito per cui non sono stati pensati, ottenendo prestazioni brillanti in certe situazioni e deludenti in altre. Il tutto, appunto, senza che nessuno si facesse male durante la prova su un’auto vera.
Fonte: TecnoAndroid








