Immagine AI

Meta ha sperimentato l’utilizzo di contractor umani per gestire una parte delle telefonate effettuate attraverso Muse, il nuovo agente AI personale lanciato l’8 settembre e progettato per svolgere attività come inviare e-mail, acquistare prodotti, prenotare viaggi e contattare aziende per conto dell’utente. La funzione di chiamata consente a Muse di ricevere una richiesta, telefonare a un’attività commerciale, sostenere la conversazione e restituire successivamente una trascrizione e un riepilogo dell’operazione, ma durante i test interni Meta ha aggiunto un livello definito “human concierge” attraverso il quale alcune richieste potevano essere trasferite a operatori umani addestrati. Il sistema è stato provato inizialmente a partire da agosto e successivamente reso disponibile a circa metà dei dipendenti coinvolti nel dogfooding interno, con possibilità di rinunciare alla funzione. La scelta nasceva anche da un limite molto pratico delle chiamate completamente automatizzate: in alcuni casi le persone o le aziende contattate interrompevano la conversazione quando l’agente dichiarava di essere un sistema AI, riducendo la percentuale di richieste completate. Secondo comunicazioni interne riportate da Reuters, l’intervento umano poteva portare la percentuale di successo delle chiamate nella fascia alta del 90%, mentre le chiamate effettuate soltanto dall’AI registravano risultati inferiori.

Il funzionamento del test prevedeva quindi che Muse potesse iniziare o orchestrare la richiesta, ma affidare materialmente la telefonata a un contractor quando l’intervento umano aumentava la probabilità di portare a termine l’attività. I casi d’uso considerati comprendevano operazioni relativamente ordinarie come prenotare un taglio di capelli, verificare se un negozio disponesse di un determinato prodotto oppure chiedere preventivi a diversi fornitori, ma la stessa capacità avrebbe potuto essere utilizzata anche per richieste contenenti informazioni molto più sensibili. È proprio questo passaggio ad avere sollevato le maggiori obiezioni all’interno dell’azienda, perché un utente che crede di condividere informazioni con un agente AI potrebbe non aspettarsi che quelle stesse informazioni vengano successivamente lette o utilizzate da un essere umano incaricato di effettuare la chiamata. Durante i test alcuni dipendenti hanno segnalato che non era sempre evidente in anticipo quando sarebbe intervenuto un operatore umano e hanno chiesto che l’eventuale utilizzo di contractor fosse comunicato chiaramente e reso opzionale, soprattutto nei casi in cui la richiesta riguardasse dati personali, sanitari, finanziari o altre informazioni che l’utente avrebbe potuto condividere presumendo di interagire esclusivamente con il sistema automatizzato.

Meta ha cercato di affrontare queste preoccupazioni spiegando internamente che gli operatori erano stati sottoposti a formazione specifica per proteggere i dati degli utenti, ma alcuni dipendenti hanno contestato che la formazione non rappresentasse di per sé un meccanismo tecnico di sicurezza. Il problema non riguardava soltanto l’accesso umano alle informazioni, ma anche la trasparenza dell’intero processo: durante una prova, un tester avrebbe scoperto soltanto dopo il completamento della telefonata che la richiesta era stata gestita da una persona invece che dall’AI, circostanza che ha alimentato dubbi sull’effettiva possibilità per l’utente di fornire un consenso consapevole. Le discussioni interne hanno inoltre evidenziato un secondo rischio, legato alla percezione pubblica della funzione: presentare Muse come un agente capace di telefonare autonomamente e utilizzare poi persone in un call center per portare a termine alcune delle conversazioni avrebbe potuto far apparire la tecnologia meno autonoma di quanto suggerito dalla presentazione del prodotto. Meta ha comunque ribadito che si trattava di un test interno e non di una funzione pubblicamente distribuita nella sua forma definitiva, sottolineando che lo scopo del dogfooding consiste proprio nell’individuare problemi di sicurezza, privacy e usabilità prima di un eventuale lancio.

Il test ha incontrato un problema ulteriore quando, secondo le comunicazioni interne esaminate da Reuters, un dipendente che aveva controllato la trascrizione di una telefonata ha segnalato che uno degli operatori umani aveva utilizzato un riferimento razzista. Un vicepresidente di Meta Superintelligence Labs avrebbe successivamente presentato le proprie scuse al dipendente e comunicato che l’azienda non lavorava più con quella persona, riconoscendo inoltre che il modo in cui la funzione era stata sperimentata rappresentava un errore. Meta ha quindi effettuato un rollback del componente human concierge nella configurazione utilizzata durante il test. Il rollback riguarda il livello di intervento umano sperimentato internamente e non implica necessariamente l’abbandono della possibilità per Muse di effettuare chiamate attraverso sistemi AI: Meta ha continuato a indicare la telefonia come una capacità in sviluppo e afferma di lavorare con i commercianti per migliorarne il funzionamento, con l’obiettivo di renderla disponibile soltanto quando saranno presenti adeguate protezioni e meccanismi di disclosure.

La difficoltà tecnica che Meta sta cercando di risolvere riguarda l’interazione tra agenti AI e infrastrutture telefoniche costruite per interlocutori umani. Muse può navigare menu telefonici, attendere in linea e sostenere conversazioni con operatori, ma il funzionamento dipende anche dal comportamento della persona che riceve la chiamata. Nei primi test alcuni utenti hanno riportato esperienze positive, con il sistema capace di attraversare un phone tree, attendere l’operatore e risolvere una richiesta, mentre in altri casi il destinatario avrebbe interrotto la telefonata dopo avere scoperto di stare parlando con un bot. Il livello umano sperimentato da Meta cercava quindi di aumentare l’affidabilità in una fase in cui l’agente non riesce ancora a completare tutte le chiamate autonomamente, utilizzando una persona come fallback invece di far fallire l’intero workflow. Questa soluzione aumenta però la complessità del modello di fiducia: un agente che agisce per conto dell’utente deve non soltanto ottenere l’autorizzazione a utilizzare determinate informazioni, ma anche rendere evidente se tali informazioni possono essere trasferite a un operatore umano durante l’esecuzione della richiesta.

Il test arriva mentre Muse sta registrando una rapida crescita dopo il lancio. L’applicazione ha superato 2,5 milioni di download e ha raggiunto le prime posizioni delle classifiche statunitensi poche settimane dopo il debutto, diventando una componente importante della strategia con cui Meta vuole portare la propria idea di “personal superintelligence” in applicazioni utilizzabili quotidianamente. La capacità di eseguire telefonate rappresenta un passaggio significativo in questa direzione perché sposta l’agente dalla semplice elaborazione di informazioni all’esecuzione di attività nel mondo reale, ma il caso del human concierge mostra anche quanto questa transizione renda più delicata la distinzione tra automazione e intervento umano. Meta sostiene che il feedback raccolto durante i test sia stato nel complesso molto positivo e considera le criticità emerse parte normale dello sviluppo interno; la società afferma inoltre che un eventuale rilascio pubblico avverrà soltanto quando la funzione sarà pronta e accompagnata da disclosure appropriate. L’esperimento mostra quindi che, almeno nella fase attuale, aumentare la percentuale di successo di un agente telefonico attraverso operatori umani può migliorare l’affidabilità operativa, ma richiede contemporaneamente procedure molto più esplicite per informare l’utente su chi sta effettivamente ricevendo e utilizzando le informazioni necessarie a completare la chiamata.

Questo articolo è stato redatto con il supporto di strumenti di intelligenza artificiale (AI)

Di Fantasy