DeepSeek lancia V4.1 Flash per ridurre i costi dell’inferenza AI su larga scala
DeepSeek ha rilasciato V4.1 Flash, il modello più piccolo della nuova famiglia architetturale dell’azienda, progettato per aumentare velocità di inferenza, throughput ed efficienza economica nei workload AI su larga scala.…