L’RLHF restringe lo spazio espressivo dei modelli linguistici: uno studio su 351.734 narrazioni dimostra che gli LLM usano solo il 59% dell’ampiezza emotiva umana
Il presupposto implicito su cui si basano molti sistemi di allineamento dei modelli linguistici è che una risposta coerente, fluida e calibrata sia una risposta migliore. Un nuovo studio pubblicato…