Cerebras porta i modelli AI da un trilione di parametri su architettura wafer-scale con velocità nettamente superiori ai cloud GPU
La competizione nell’infrastruttura AI sta entrando in una fase in cui il collo di bottiglia non è più soltanto la potenza di calcolo pura, ma soprattutto la latenza di inferenza,…