Bdraft pubblica AX-RAY, benchmark di sicurezza AI che rileva segnali di causal leakage nei modelli linguistici
Bdraft ha pubblicato su Hugging Face AX-RAY, un benchmark accompagnato da dataset di valutazione progettato per individuare vulnerabilità e comportamenti potenzialmente pericolosi nei modelli di intelligenza artificiale general purpose. Il…