In questo articolo Indice dei contenuti 2 sezioni
Capire come riconoscere un testo scritto dall’AI è diventato quasi uno sport, e un nuovo studio di Graphite offre indizi piuttosto concreti. La società di marketing ha analizzato le abitudini di scrittura dei modelli più avanzati e ha individuato 13.000 espressioni che compaiono almeno due volte più spesso nei testi generati dalle macchine rispetto a quelli firmati da persone. Si tratta di tredicimila piccoli tic, e ognuno funziona come una porticina da cui l’intelligenza artificiale finisce per farsi notare.
Per un certo periodo il colpevole perfetto è stato il trattino lungo. Poi i laboratori si sono accorti che i lettori lo fiutavano e hanno corretto il tiro. I vizi però non spariscono, cambiano semplicemente abito. Il metodo seguito da Graphite è lineare. Si parte da 10.000 articoli pubblicati prima dell’arrivo di ChatGPT, quindi scritti da esseri umani in un’epoca ancora innocente. Ai modelli sono stati consegnati soltanto i riassunti, con la richiesta di riscrivere tutto da capo, così da evitare che si limitassero a copiare l’originale. A quel punto bastava affiancare le due pile e contare quante volte ogni parola o costruzione saltava fuori.
Claude Opus 5.5 e la mania del “questo conta”
Il caso più curioso riguarda Claude Opus 5.5, che ha preso l’abitudine di ripetere fin troppo spesso l’intercalare “questo conta”. Lo fa 116 volte più di un essere umano, un risultato non proprio brillante per un sistema pensato per sembrare naturale. La formula “perché X è importante” arriva a quota 92, mentre la parola “affidabile” compare 23 volte più spesso che nella prosa umana. C’è poi un dettaglio quasi divertente. La vecchia struttura “non è X, è Y” è stata messa al bando e il modello ha trovato subito la scappatoia con “è più di una X, è una Y”. Praticamente la costruzione è rimasta la stessa.
Diverso il carattere di Astra di OpenAI, decisamente più prudente. Ama scoprire un’altra dimensione di qualunque argomento, perfino di una ricetta per i pancake. Quando deve promettere qualcosa si ripara dietro un “può offrire” o un “potrebbe fornire”, in modo da non assumersi mai la responsabilità di nulla. La sua vera specialità consiste nel correggere errori che nessuno ha commesso. Un tema non è semplicemente X, oppure si suggerisce di fare una cosa invece di affidarsi a X. Costruzioni di questo genere compaiono oltre 100 volte più spesso che nei testi scritti da persone.
Il trattino lungo sparisce ma i tic restano
Sul fronte del trattino lungo i laboratori hanno vinto, e con un certo accanimento. Opus 5.5 lo usa il 99% in meno rispetto a Opus 5, mentre Astra lo impiega l’88% in meno rispetto ai campioni umani, quindi con più pudore delle persone stesse. Gemini 3.1 Pro lo ha quasi cancellato dal proprio vocabolario.
C’è poco da festeggiare però. Greg Druck, responsabile dell’intelligenza artificiale di Graphite, spiega che il totale dei tic resta più o meno invariato. Si riesce a eliminare quelli più sfacciati ma ne spuntano altri, e ogni versione porta con sé i propri. Secondo Druck, inoltre, Claude e GPT stanno imboccando strade opposte. I modelli Claude diventano progressivamente più simili agli esseri umani nella scelta e nella frequenza delle parole, mentre i testi dei GPT si allontanano sempre di più dalla distribuzione linguistica tipica delle persone.
Le promesse delle aziende non mancano. Anthropic sostiene che Opus 5.5 comunichi in modo più naturale dei predecessori, e OpenAI non è stata da meno con le versioni GPT 6 di Sol e Luna, presentate all’insegna di più chiarezza, meno gergo e meno giri di parole strani. Druck resta scettico e ritiene che i laboratori controllino questi aspetti molto meno di quanto si immagini. Si parla di modelli giganteschi con miliardi di parametri, sui quali è possibile svolgere soltanto un numero finito di test, e qualcosa finisce sempre per sfuggire.
Fonte: TecnoAndroid








