Immagine AI

GPT-6 Astra ha decifrato in circa sei ore un cifrario militare dell’epoca napoleonica rimasto irrisolto per 217 anni, partendo da una singola immagine del documento e da un’unica indicazione iniziale sull’obiettivo da raggiungere. Il lavoro è stato condotto da Carter Church, ingegnere di SentinelOne, che ha scelto uno dei documenti presenti nella raccolta di cifrari storici irrisolti di Cryptiana: una lettera destinata al generale Auguste de Marmont e proveniente dal quartier generale di Eugène de Beauharnais, figliastro di Napoleone e viceré d’Italia. Il testo risale in realtà alla fine di marzo del 1809, nelle settimane immediatamente precedenti all’invasione austriaca della Baviera, nonostante fosse stato storicamente catalogato con una data errata. Napoleone aveva ordinato il 16 marzo a Eugène di inviare a Marmont una comunicazione cifrata contenente la disposizione delle forze francesi e alleate, particolarmente importante perché Marmont si trovava in Dalmazia con circa 13.000 uomini, separato dagli altri eserciti francesi dal territorio austriaco. Il documento sopravvissuto presenta una prima riga in francese non cifrata, seguita da 24 righe composte da numeri a due cifre, lettere, simboli tipografici e segni inventati a mano. La riproduzione disponibile deriva da una tavola pubblicata nel 1969 sulla rivista militare francese Revue historique des Armées e digitalizzata successivamente dalla piattaforma accademica Persée; non esisteva una trascrizione completa già pronta da utilizzare e la chiave originale del cifrario non è sopravvissuta.

Il problema era particolarmente complesso perché non si trattava di una semplice sostituzione monoalfabetica. Il documento contiene circa 1.300 unità cifrate e 155 segni distinti ed è costruito come un cifrario omofonico, nel quale le lettere più frequenti possono essere rappresentate da simboli differenti proprio per rendere inefficace la normale analisi statistica delle frequenze. Un precedente lavoro dello storico della crittologia Daniel Tant aveva identificato soltanto 33 valori alfabetici, sufficienti a interpretare 435 delle 1.300 unità, circa il 33% del documento, mentre le restanti 865 unità, pari al 67%, dovevano essere ricostruite ex novo. Astra ha iniziato direttamente dall’immagine di 1.202 x 1.836 pixel, dividendola in righe, leggendo i singoli segni e attribuendo inizialmente etichette differenti anche a simboli che potevano essere semplici variazioni calligrafiche dello stesso carattere. Questa prima trascrizione ha prodotto 1.320 unità e 175 etichette provvisorie, successivamente consolidate attraverso confronti ripetuti tra le diverse occorrenze presenti sulla tavola. Il sistema ha quindi fissato come punti di partenza i 33 valori già noti e alcune lettere lasciate in chiaro, utilizzandoli come ancoraggio per ricostruire progressivamente la chiave restante. La particolarità del lavoro sta proprio nell’aver unificato in un unico flusso attività che normalmente richiederebbero competenze separate: riconoscimento e trascrizione del manoscritto, classificazione dei segni, crittoanalisi, ricerca documentale, verifica linguistica e ricostruzione storica.

Per l’analisi vera e propria Astra ha implementato un solver basato su simulated annealing, assegnando valori alfabetici ai simboli ancora sconosciuti e valutando le possibili soluzioni mediante statistiche linguistiche francesi basate su sequenze di tre, quattro e cinque caratteri. Tra i testi utilizzati per costruire il modello statistico figuravano opere di Victor Hugo e Alexandre Dumas e, in una prima fase, anche le memorie dello stesso Marmont. I simboli che continuavano a produrre sequenze linguisticamente incoerenti sono stati quindi testati non come singole lettere ma come rappresentazioni di parole complete: 29 segni si sono rivelati infatti sostituti di parole ricorrenti come “de”, “que”, “les”, “vous” e “général”, mentre altri segni indicavano particolarità come una doppia “s”, segni di punteggiatura o valori nulli inseriti per confondere l’analisi. Ogni nuova assegnazione è stata verificata sull’immagine originale confrontando tutte le occorrenze dello stesso simbolo, conservando un valore soltanto quando migliorava coerentemente la lettura dell’intero documento. Per verificare che la soluzione non dipendesse dalla presenza di testi napoleonici nel materiale linguistico utilizzato dal solver, Church ha inoltre fatto rieseguire l’analisi eliminando le memorie di Marmont e gli altri testi storici legati al periodo: il sistema ha recuperato nuovamente la stessa lettura, fornendo un controllo indipendente sulla solidità della chiave ricostruita. Il risultato finale comprende una vera e propria tabella cifrante analoga a quella che avrebbe potuto utilizzare un impiegato del quartier generale francese nel 1809, insieme alla trascrizione completa, alla chiave e a uno script che consente di verificare automaticamente la corrispondenza tra le 1.300 unità cifrate e il testo decifrato.

La lettera ricostruita descrive nel dettaglio la disposizione delle forze francesi e alleate alla vigilia della guerra con l’Austria. Vengono indicati circa 40.000 bavaresi del duca di Danzica tra Monaco e Passavia, 30.000 polacchi del principe Józef Poniatowski sulla Vistola in posizione di minaccia verso Cracovia, l’esercito sassone comandato dal principe di Pontecorvo davanti a Dresda, circa 80.000 francesi del duca d’Auerstädt a Bayreuth, 60.000 uomini del duca di Rivoli tra Ulm e Donauwörth e altri 40.000 uomini del corpo d’élite del generale Oudinot ad Augusta e lungo il Lech. Il testo riferisce inoltre che i russi stanno muovendo contro l’Austria, che l’esercito del Friuli dispone di circa 80.000 uomini e che a queste forze deve essere aggiunto il corpo della Dalmazia, oltre alle riserve in formazione nelle retrovie. Da questa situazione Eugène conclude che l’Austria sarebbe stata attaccata simultaneamente da più direzioni e invita Marmont a non lasciarsi intimidire, una volta ricevuto l’ordine di muoversi, da poche truppe o da quella che il testo decifrato definisce una “gathering of rabble”, cioè un’accozzaglia o una massa disordinata di uomini. Proprio questo passaggio ha permesso di completare anche una lacuna presente nell’edizione ottocentesca della corrispondenza di Napoleone: nella raccolta pubblicata nel 1865 una parte dell’istruzione relativa alla preparazione dell’invasione austriaca risultava interrotta, mentre la decifrazione ha restituito il contenuto mancante. La lettera prosegue riferendo la presenza austriaca a Lubiana, Klagenfurt, Villach e Salisburgo, la possibile minaccia verso il Tirolo attraverso Linz, l’ipotesi di uno spostamento di truppe in Galizia per contrastare i russi e la mobilitazione delle milizie, sulle quali viene però espresso scetticismo circa la reale capacità di rafforzare l’esercito austriaco.

La soluzione è stata successivamente verificata da Satoshi Tomokiyo, responsabile di Cryptiana, e il documento è stato spostato dall’elenco dei cifrari irrisolti a quello delle soluzioni confermate. Church ha sottolineato che il risultato più significativo non consiste tanto nella difficoltà matematica del cifrario, che con sufficiente tempo e personale sarebbe probabilmente stato risolvibile anche da crittografi specializzati, quanto nella capacità del modello di eseguire autonomamente l’intera catena di lavoro partendo dalla sola immagine: individuazione della fonte originale, trascrizione dei simboli, riclassificazione delle varianti calligrafiche, costruzione del solver, analisi statistica, ricerca delle fonti storiche, correzione della datazione, ricostruzione del testo e verifica finale della soluzione. È proprio la combinazione di queste operazioni, normalmente distribuite tra paleografi, storici, linguisti e crittoanalisti, ad aver consentito di completare in circa sei ore un lavoro rimasto aperto per oltre due secoli. Il caso segue inoltre altri risultati ottenuti recentemente da GPT-6 Astra su cifrari storici, tra cui un messaggio Enigma tedesco della Seconda guerra mondiale rimasto irrisolto per circa 85 anni e un altro cifrario militare tedesco risalente a 108 anni fa, indicando un impiego sempre più sistematico dei modelli multimodali nella ricostruzione di documenti storici che combinano materiale visivo, linguistico e crittografico.

Questo articolo è stato redatto con il supporto di strumenti di intelligenza artificiale (AI)

Di Fantasy