Nell’interfaccia web di Claude è stata individuata una nuova voce di navigazione denominata Voice, accompagnata dall’etichetta Preview, che suggerisce l’esistenza di una funzionalità vocale in fase di sperimentazione. L’elemento è stato segnalato il 10 ottobre 2026 da TestingCatalog, che ha identificato il menu nascosto durante l’esame dell’interfaccia del servizio di Anthropic. La presenza della dicitura Preview porta a ipotizzare che la funzionalità sia destinata inizialmente a un ambiente di prova interno, anziché a una distribuzione pubblica rivolta agli utenti. Non sono tuttavia emersi dettagli operativi che permettano di stabilire quali caratteristiche siano state implementate, se il nuovo menu dia accesso a una modalità di conversazione differente oppure se rappresenti una revisione dell’esperienza vocale già disponibile. Anthropic non ha confermato ufficialmente le finalità della nuova sezione, non ha comunicato una data di distribuzione e non ha presentato specifiche tecniche relative alle prestazioni. Il ritrovamento costituisce quindi un indizio concreto di attività sull’interfaccia, ma non dimostra che l’azienda abbia sviluppato un nuovo modello proprietario dedicato alla generazione o alla comprensione della voce.
Un secondo elemento emerso nello stesso periodo riguarda l’introduzione di un’opzione con cui gli utilizzatori di Claude possono autorizzare l’impiego delle registrazioni vocali e dei dati delle conversazioni audio per il miglioramento dei modelli di intelligenza artificiale. Secondo le segnalazioni disponibili, ad alcuni utenti è stata mostrata una richiesta esplicita di consenso all’utilizzo di queste informazioni per finalità di addestramento e perfezionamento dei sistemi. L’autorizzazione è facoltativa e l’impostazione risulta disattivata per impostazione predefinita, richiedendo pertanto una scelta volontaria da parte dell’utente. L’introduzione di questo meccanismo potrebbe consentire ad Anthropic di raccogliere dati utili allo sviluppo delle capacità di riconoscimento del parlato, interpretazione degli input vocali o produzione di risposte audio. Non è però possibile stabilire se i dati siano destinati all’addestramento di modelli vocali proprietari, all’ottimizzazione di sistemi già impiegati nel servizio oppure al miglioramento delle interazioni vocali attraverso tecnologie esterne. Le due novità, considerate congiuntamente, indicano un interesse per l’evoluzione delle funzionalità audio, ma non consentono ancora di identificare l’architettura tecnica dei componenti in sviluppo.
Claude dispone già di diverse modalità di interazione attraverso la voce, introdotte progressivamente nel corso dell’evoluzione del prodotto. Le prime funzionalità erano concentrate principalmente sulla dettatura, che permetteva di trasformare il parlato in testo e inserirlo nel campo del prompt, mantenendo sostanzialmente testuale l’interazione con il modello. Nel maggio 2025 Anthropic ha introdotto nell’applicazione mobile una modalità vocale che consentiva di condurre conversazioni con risposte audio, ampliando le possibilità di utilizzo oltre la semplice trascrizione. Successivamente questa esperienza è stata estesa alle interfacce web e desktop. Nel luglio 2026 l’azienda ha inoltre annunciato un aggiornamento che ampliava il supporto linguistico e rendeva disponibili i modelli Opus e Sonnet nella modalità vocale, precedentemente associata al solo Haiku per privilegiare la rapidità delle risposte. L’evoluzione ha quindi interessato sia la varietà dei modelli utilizzabili sia il numero delle lingue supportate, mantenendo la conversazione audio come una delle modalità di accesso alle capacità generali di Claude.
Rimane invece aperta la questione delle tecnologie sottostanti alla generazione vocale. Anthropic non ha finora annunciato pubblicamente un proprio modello specifico di sintesi della voce né una API dedicata alla conversazione audio in tempo reale. Al momento del lancio della modalità vocale nel 2025 erano circolate informazioni relative al possibile impiego delle tecnologie di ElevenLabs, ma l’azienda non aveva identificato ufficialmente il fornitore utilizzato per il servizio. Non è quindi possibile dedurre dall’attuale comparsa del menu Voice Preview che sia avvenuta una sostituzione dei componenti vocali esistenti oppure che Anthropic stia preparando un sistema autonomo di sintesi e riconoscimento del parlato. Il confronto con l’evoluzione delle funzionalità vocali di OpenAI, che aveva introdotto conversazioni vocali nel 2023 e una modalità avanzata basata su GPT-4o nel 2024, evidenzia soprattutto una diversa sequenza temporale di implementazione dei servizi. Per Claude, l’eventuale nuova interfaccia potrebbe riguardare la fluidità della conversazione, l’integrazione delle modalità audio nell’ambiente web oppure una revisione dei processi di elaborazione del parlato. Allo stato attuale, gli unici elementi concretamente individuati sono la presenza del menu sperimentale e la richiesta facoltativa di consenso all’impiego dei dati vocali, mentre caratteristiche funzionali, componenti tecnologici e tempi di disponibilità restano da confermare.
Questo articolo è stato redatto con il supporto di strumenti di intelligenza artificiale (AI)
