I segnali utilizzati per riconoscere un testo generato dall’intelligenza artificiale si stanno spostando dai singoli termini e dalla punteggiatura verso strutture sintattiche e formule ricorrenti più complesse. Graphite ha analizzato lo stile di scrittura dei principali modelli AI più recenti e ha individuato circa 13.000 espressioni utilizzate almeno il doppio più spesso rispetto ai testi scritti da persone. Per limitare le distorsioni dovute alle diverse fonti, il confronto è stato costruito utilizzando come gruppo di controllo 10.000 articoli umani pubblicati prima del lancio di ChatGPT e chiedendo successivamente ai modelli di riscrivere articoli partendo dagli stessi riassunti. L’analisi mostra che i vecchi indicatori più evidenti si stanno attenuando, ma vengono sostituiti da nuove abitudini stilistiche altrettanto riconoscibili.
Claude Opus 5.5 presenta soprattutto una tendenza a sottolineare continuamente l’importanza di ciò che sta descrivendo. Rispetto ai testi umani, la formula “this matters” compare 116 volte più frequentemente e “why X matters” 92 volte più spesso, mentre l’aggettivo “dependable” viene utilizzato con una frequenza 23 volte superiore. Anthropic sembra inoltre avere ridotto una costruzione che caratterizzava maggiormente le generazioni precedenti di Claude, quella basata sull’opposizione diretta “non è X, è Y”, ma il modello tende ora a sostituirla con formule del tipo “è più di X, è Y”, mantenendo quindi una struttura retorica di contrasto pur cambiandone la forma. OpenAI Astra mostra invece un’impronta differente: ricorre spesso all’espressione “another dimension” quando introduce un ulteriore aspetto di un argomento, utilizza frequentemente costruzioni prudenti come “may provide” o “can provide” e impiega molto più degli autori umani formule correttive o comparative come “non è semplicemente X” oppure “piuttosto che affidarsi a X”. In alcuni di questi casi, la frequenza riscontrata supera di oltre cento volte quella dei testi umani utilizzati nel confronto.
L’analisi evidenzia anche una differenza nell’evoluzione stilistica dei modelli. Greg Druck, Chief AI Officer di Graphite e responsabile dello studio, osserva che le versioni successive di Claude si sono progressivamente avvicinate alla distribuzione lessicale e al tono della scrittura umana, mentre i modelli OpenAI analizzati mostrerebbero una tendenza opposta, con uno stile che nel tempo si discosta maggiormente da quello umano. Sul fronte della punteggiatura, invece, i miglioramenti sono evidenti per tutti i principali laboratori: Opus 5.5 utilizza l’em dash il 99% in meno rispetto al modello precedente, Astra lo impiega l’88% meno degli autori umani e Gemini 3.1 Pro lo ha praticamente eliminato. È un cambiamento significativo perché proprio l’em dash era diventato negli ultimi anni uno degli indicatori più frequentemente associati ai testi generati dall’AI.
Anthropic, OpenAI e gli altri sviluppatori hanno accompagnato le ultime generazioni di modelli con l’obiettivo di ottenere una scrittura più naturale, chiara e meno carica di formulazioni artificiali o tecniche, ma i risultati di Graphite mostrano quanto sia difficile eliminare completamente le regolarità stilistiche prodotte da sistemi di grandi dimensioni. Druck attribuisce il fenomeno alla difficoltà di controllare modelli composti da miliardi di parametri: quando una determinata abitudine viene corretta o ridotta, possono emergere nuove formule ricorrenti. Il problema del riconoscimento della scrittura AI tende quindi a diventare meno legato a singole parole “sospette” e più dipendente dall’analisi statistica delle strutture sintattiche, delle transizioni retoriche e dei modelli ripetitivi che ciascuna famiglia di modelli continua a sviluppare.
Questo articolo è stato redatto con il supporto di strumenti di intelligenza artificiale (AI)
