Al momento stai visualizzando DeepSeek V4.1 Flash: cosa cambia con il nuovo listino e i nomi legacy ritirati

DeepSeek V4.1 Flash: cosa cambia con il nuovo listino e i nomi legacy ritirati

DeepSeek ha aggiornato la pagina ufficiale di modelli e prezzi della propria API, introducendo alcune indicazioni operative che riguardano direttamente chi sviluppa o integra i suoi modelli. Le informazioni pubblicate riguardano principalmente il modello DeepSeek-V4.1-Flash e il modo in cui vengono gestiti i vecchi nomi utilizzati finora.

Il nome del modello cambia

Secondo quanto riportato nella documentazione, per utilizzare il modello Flash è ora necessario indicare deepseek-flash come nome del modello nelle chiamate API. I nomi precedenti, deepseek-v4-flash e deepseek-v4-flash-vision-exp, restano formalmente accettati, ma i modelli a cui facevano riferimento sono stati ritirati: le richieste inviate con quei nomi vengono servite dal modello DeepSeek-V4.1-Flash e fatturate al prezzo Flash.

In pratica, chi ha codice o configurazioni che puntano ancora ai vecchi identificativi non dovrebbe vedere interruzioni nel servizio, ma sta già utilizzando il nuovo modello. È un dettaglio utile soprattutto per chi gestisce pipeline di produzione e vuole sapere con certezza quale versione sta interrogando.

Come funziona il listino

La pagina chiarisce che i prezzi sono espressi per milione di token, dove un token è l’unità minima di testo riconosciuta dal modello e può corrispondere a una parola, un numero o un segno di punteggiatura. La fatturazione si basa sul totale dei token di input e di output elaborati.

Un elemento rilevante è la distinzione tra tariffe di picco e fuori picco. Le tariffe off-peak sono pari alla metà di quelle di picco. Le ore di picco sono definite come 01:00–04:00 e 06:00–10:00 UTC, dal lunedì al venerdì, esclusi i giorni festivi cinesi. Tutte le altre fasce orarie, compresi i fine settimana e l’intera giornata nei festivi cinesi, rientrano nella fascia off-peak.

Questa struttura può avere un impatto concreto sui costi di chi elabora grandi volumi di richieste e ha la flessibilità di pianificare i job nelle ore più economiche.

Pagamenti e limiti operativi

La spesa viene calcolata moltiplicando il numero di token per il prezzo corrispondente. Gli importi vengono detratti direttamente dal saldo ricaricato o dal saldo concesso, con precedenza a quest’ultimo quando entrambi sono disponibili. DeepSeek precisa inoltre che i prezzi dei prodotti possono variare e che si riserva il diritto di modificarli, consigliando di ricaricare in base all’utilizzo effettivo e di controllare periodicamente la pagina per le informazioni più aggiornate.

Per quanto riguarda i limiti di concorrenza, la pagina rimanda a una sezione dedicata su rate limit e isolamento, senza fornire in questo estratto i valori specifici.

A chi serve saperlo

Le informazioni sono rilevanti per sviluppatori, team di prodotto e chiunque utilizzi l’API DeepSeek in applicazioni reali. In particolare:

  • chi ha integrazioni basate sui vecchi nomi dei modelli, che ora vengono reindirizzate al nuovo Flash;
  • chi pianifica carichi di lavoro sensibili ai costi e può sfruttare le fasce off-peak;
  • chi gestisce budget su saldo ricaricato o concesso e vuole capire l’ordine di detrazione.

Cosa resta da verificare

L’estratto disponibile non riporta i valori numerici delle tariffe per milione di token, né i limiti di concorrenza specifici. Per questi dati è necessario consultare direttamente la pagina ufficiale di modelli e prezzi. Restano inoltre da chiarire eventuali differenze prestazionali tra il modello Flash e le altre versioni della famiglia, informazioni che non emergono dal materiale fornito.

Per chi vuole approfondire il posizionamento del modello all’interno della famiglia DeepSeek, può essere utile rileggere l’analisi pubblicata su Rdc Network: DeepSeek V4.1-Flash: il modello più piccolo della nuova famiglia punta su efficienza e costi.

Fonte: aisecret.us.

Lascia un commento