NVIDIA porta Groq 3 LPX in produzione con inferenza fino a 3.400 token al secondo
NVIDIA ha avviato la produzione su larga scala di Groq 3 LPX, l’acceleratore per l’inferenza AI progettato per estendere la piattaforma Vera Rubin e aumentare la velocità di generazione dei…