Immagine AI

DeepSeek modifica in modo sostanziale la politica tariffaria delle API dei modelli V4 Pro e V4 Flash, abbandonando il prezzo uniforme e introducendo una struttura differenziata tra fasce di picco e fasce non di picco. Le nuove tariffe entreranno in vigore il 17 agosto alle 01:00 ora coreana e, a seconda del modello, del tipo di token e dell’orario di utilizzo, comporteranno aumenti compresi tra circa il 50% e oltre il 1.100% rispetto ai prezzi precedenti. La società collega la modifica alla crescita della domanda da parte di sviluppatori e aziende, che concentra il consumo di capacità di calcolo in determinate fasce orarie, e punta quindi a utilizzare il prezzo come strumento per distribuire i carichi verso i periodi nei quali l’infrastruttura è meno congestionata.

Per DeepSeek V4 Pro, il prezzo degli input con cache miss passa dagli attuali 0,435 dollari per milione di token a 0,66 dollari nelle ore non di punta e 1,32 dollari nelle ore di punta. L’aumento è ancora più evidente per l’output, che sale da 0,87 dollari per milione di token a 1,98 dollari nelle fasce meno congestionate e a 3,96 dollari nei periodi di picco. In quest’ultimo caso il costo dell’output diventa quindi circa 4,6 volte quello precedente. Anche V4 Flash viene interessato dalla revisione: gli input con cache miss salgono da 0,14 dollari per milione di token a 0,22 dollari fuori picco e 0,44 dollari nelle ore di punta, mentre l’output passa da 0,28 dollari rispettivamente a 0,66 e 1,32 dollari per milione di token.

Gli incrementi percentualmente più elevati riguardano però i token di input già presenti nella cache. Per V4 Pro, il prezzo in caso di cache hit aumenta dagli attuali 0,003625 dollari per milione di token a 0,022 dollari nelle ore non di punta e 0,044 dollari nelle fasce di picco. Per V4 Flash la tariffa passa invece da 0,0028 dollari a 0,007 dollari fuori picco e 0,014 dollari durante i periodi di maggiore domanda. È proprio la combinazione tra questa precedente base tariffaria estremamente ridotta e le nuove fasce orarie a determinare, nelle configurazioni più penalizzate, incrementi superiori al 1.100%. La modifica riguarda quindi in maniera particolarmente rilevante le applicazioni che fanno largo uso del caching del contesto, una componente importante nei workflow agentici caratterizzati dalla ripetuta elaborazione delle stesse informazioni.

Nonostante gli aumenti, i prezzi delle API DeepSeek rimangono inferiori a quelli indicati per diversi modelli concorrenti. Il nuovo costo massimo dell’output di V4 Pro, pari a 3,96 dollari per milione di token nelle ore di punta, resta ad esempio nettamente sotto i circa 15 dollari per milione di token riportati per Kimi K3 di Moonshot AI. DeepSeek conserva quindi un posizionamento basato su costi di inferenza relativamente contenuti, ma modifica il modello con cui questi costi vengono distribuiti: il prezzo non dipenderà più soltanto dal modello e dalla tipologia di token elaborati, ma anche dal momento nel quale viene effettuata la richiesta.

La revisione arriva dopo una fase nella quale DeepSeek ha utilizzato prezzi particolarmente bassi per ampliare rapidamente l’adozione dei propri modelli, con la famiglia V4 progettata anche per contenere il costo della gestione ripetuta del contesto nelle attività agentiche su larga scala. L’aumento dell’utilizzo da parte di sviluppatori e imprese ha però accresciuto sia il carico sull’infrastruttura sia il costo necessario per mantenere una politica API estremamente aggressiva. Parallelamente, DeepSeek viene indicata come impegnata nella raccolta di capitali e nella preparazione di una possibile IPO, mentre continua a sostenere gli elevati investimenti richiesti dall’infrastruttura di calcolo AI. La nuova struttura tariffaria permette quindi di aumentare i ricavi nelle fasce di maggiore domanda e, allo stesso tempo, di incentivare lo spostamento dei carichi differibili verso gli orari nei quali la capacità computazionale è meno utilizzata.

Questo articolo è stato redatto con il supporto di strumenti di intelligenza artificiale (AI)

Di Fantasy