Matic Cues controlla il robot domestico con voce e gesti senza utilizzare lo smartphone
Matic ha introdotto Matic Cues, un nuovo sistema di controllo che permette di impartire comandi al robot domestico attraverso voce e gesti, senza utilizzare un’applicazione sullo smartphone. La funzione viene…
Cloudways introduce Managed AI Agents con OpenClaw e Hermes gestiti sulla propria infrastruttura
Cloudways ha reso disponibili Managed AI Agents, una nuova linea di servizi pensata per semplificare il deployment e la gestione di agenti di intelligenza artificiale open source. I primi due…
AxiomProver formalizza in Lean 4 il teorema sui gap tra numeri primi con limite 246
Axiom Math ha completato con il sistema di intelligenza artificiale AxiomProver una dimostrazione formalmente verificata in Lean 4 del risultato attualmente più avanzato sui gap limitati tra numeri primi: esistono…
Il colore e il contrasto del testo possono alterare le risposte dei modelli vision-language
Una modifica puramente grafica del testo, senza cambiare una sola parola, può modificare il modo in cui alcuni modelli vision-language interpretano il contenuto e arrivano alla risposta finale. Un gruppo…
RAG a cascata per classificazioni ad alto rischio: regole deterministiche, recupero mirato e LLM solo sui casi ambigui
Nei sistemi RAG utilizzati per classificazioni ad alto rischio, affidare ogni caso ambiguo direttamente a un modello linguistico può rendere l’architettura semplice da sviluppare, ma introduce problemi rilevanti quando le…
Un sistema di valutazione con ground truth per verificare l’accuratezza degli strumenti aziendali basati su LLM
Nello sviluppo di strumenti aziendali basati su modelli linguistici complessi, la revisione qualitativa degli output permette di individuare risposte palesemente errate, poco pertinenti o formulate male, ma non è sufficiente…
Acoustic AI analizza il comportamento dei clienti in tempo reale e costruisce campagne marketing
Acoustic ha introdotto Acoustic AI, un sistema agentico integrato nella propria piattaforma di customer engagement progettato per analizzare continuamente il comportamento dei clienti attraverso dati first-party e individuare opportunità commerciali…
Bdraft pubblica AX-RAY, benchmark di sicurezza AI che rileva segnali di causal leakage nei modelli linguistici
Bdraft ha pubblicato su Hugging Face AX-RAY, un benchmark accompagnato da dataset di valutazione progettato per individuare vulnerabilità e comportamenti potenzialmente pericolosi nei modelli di intelligenza artificiale general purpose. Il…
Artificial Analysis lancia Optima per creare benchmark AI personalizzati su dati e workflow reali
Artificial Analysis ha lanciato Optima, una piattaforma che permette di costruire benchmark personalizzati per confrontare modelli di intelligenza artificiale direttamente sui dati, sui task e sui criteri di valutazione utilizzati…
Twitch abilita l’uso automatico di video e chat pubbliche per l’addestramento dei modelli AI di Amazon
Twitch ha modificato il proprio regolamento consentendo ad Amazon, proprietaria della piattaforma, di utilizzare i contenuti pubblicati dagli utenti per addestrare i propri modelli di intelligenza artificiale. La nuova impostazione…