Anthropic introduce J-Lens per analizzare il workspace interno dei modelli Claude
Anthropic ha presentato J-Lens, una nuova tecnica di interpretabilità progettata per osservare come i modelli della famiglia Claude organizzano internamente le informazioni durante l’elaborazione di un compito. La ricerca descrive…