ByteDance presenta SeedRealtime, un modello multimodale full-duplex per interazioni audio-video in tempo reale

ByteDance ha presentato SeedRealtime, un modello linguistico multimodale full-duplex capace di elaborare simultaneamente voce, immagini e testo all’interno di un’unica architettura. Il sistema è stato progettato per superare il funzionamento…