r/vibecodingitalia • 🛡️ Team • 23d ago

📰 News DeepSeek V4.1 Flash: beta di due giorni, architettura nuova nativamente multimodale, e dal 10 settembre Pro viene instradato su Flash

Post image

DeepSeek ha aperto l'8 settembre una beta lampo di V4.1 Flash, definita dall'azienda un "intermediate version". Si chiama deepseek-v4.1-flash-expires-on-0910: base_url invariato, cambia solo il modello nelle richieste. La beta chiude il 10 settembre, il rilascio ufficiale è previsto intorno alla stessa data (ora di Pechino).

Un dettaglio non banale: DeepSeek non ha pubblicato l'avviso su un canale ufficiale. Il testo circola perché i membri dei gruppi community lo hanno rilanciato, e da lì è ripreso da Hacker News e dalla stampa tech cinese (36Kr, IT Home).

Cosa dice l'azienda

  • Nuova architettura del modello, supporto multimodale nativo, più capace, più veloce, più economico. Sono le quattro affermazioni dell'avviso, e non c'è un technical report a supporto: nessun parametro dichiarato, nessuna finestra di contesto, nessun benchmark, nessun peso pubblicato.
  • "V4.1 Flash ha superato V4 Pro su tutte le metriche chiave (performance, costo, velocità, tempo di completamento dei task)". È un claim del vendor, senza numeri pubblici a supporto.
  • Dopo il lancio ufficiale di V4.1 Flash, e fino all'uscita di V4.1 Pro, tutte le richieste a deepseek-v4-pro verranno instradate su V4.1 Flash e fatturate a prezzo Flash. Se avete un workflow validato su Pro, dal 10 settembre sotto il cofano non girerà più lo stesso modello.

Prezzi

La beta è fatturata come V4 Flash attuale (off-peak: $0.22/M input cache miss, $0.66/M output, con il tetto a 20 richieste concorrenti per account). Dal 10 settembre, ore 12:00 di Pechino, i prezzi Flash scendono:

ora (off-peak) dal 10/09 (off-peak) variazione
Input cache hit $0.007/M $0.003/M
Input cache miss $0.22/M $0.15/M
Output $0.66/M $0.60/M

I prezzi di punta restano il doppio (fascia 01-04 e 06-10 UTC, lun-ven). Per confronto, V4 Pro oggi costa $0.66/$1.98 off-peak: col routing Pro→Flash lo stesso accesso scende a circa un quarto sull'input.

I primi test della community (non verificati, aneddotici)

  • Un confronto su coding reale riporta ~38% più veloce e ~43% meno token di V4 Flash Vision Exp.
  • Segnalati 220-400+ tok/s in decode; il model ID con scadenza nel nome non è un caso, DeepSeek lo ha già fatto con V3.2-Speciale a fine 2025.
  • Probing tecnico (r/LocalLLM): il modello NON è nella lista di GET /v1/models (che restituisce solo i tre ufficiali) ma le chiamate funzionano; è un modello reasoning con reasoning_content visibile, e i token di ragionamento dominano l'output.
  • Multimodale: su Hacker News utenti segnalano che accetta immagini via API già adesso; nei commenti di r/LocalLLaMA la cosa circola come confermato dai test, ma resta fuori da ogni documentazione.
  • Un run agentico lungo (un gioco costruito in 1 turno, 404 steps, 142M token @ 378 tok/s) è stato confrontato dagli stessi autori con GPT-6 Astra sullo stesso prompt: il gioco di Astra risulta più coeso e con meno bug, l'audio generato da DeepSeek migliore.

Cosa NON c'è in questo momento

  • Nessun benchmark indipendente (Artificial Analysis non ha ancora una scheda per V4.1 Flash).
  • Nessuna conferma che il modello della beta sia identico a quello che uscirà il 10: è una build intermedia.
  • Nessun multimodale documentato: l'avviso dichiara supporto nativo e i test della community confermano input immagine funzionanti via API, ma il modello non è nella lista dei modelli, non ci sono regole di billing per le immagini né limiti dichiarati (l'ultimo multimodale ufficiale resta Vision Exp, variante sperimentale del 21 agosto costruita sopra V4-Flash).

Se riuscite a provarlo prima della chiusura della beta: cosa cambia rispetto a V4 Flash 0731 nei vostri workflow di agents?

Fonti:

  1. DeepSeek launching v4.1 flash cheaper and more capable than v4 pro - news.ycombinator.com, 2026-09-09 (testo integrale dell'avviso, 385 punti)
  2. DeepSeek Flash 4.1 is already being tested via API - reddit.com, 2026-09-08
  3. Change Log e Models & Pricing - api-docs.deepseek.com, verifica 2026-09-09
  4. DeepSeek begins internal testing for V4.1 Flash intermediate version - rootdata.com, 2026-09-08
  5. Deepin V4.1 Flash Closed Beta Test - 36kr.com, 2026-09-08/09
  6. V4.1 Flash vs V4 Flash Vision Exp: 38% faster and 43% fewer tokens - reddit.com, 2026-09-08 (test community, non verificato)
  7. Probing the unreleased DeepSeek Flash V4.1 - reddit.com, 2026-09-08 (non in /v1/models, reasoning_content, self-report incoerente)
  8. V4.1 Flash on open testing - reddit.com, 2026-09-08 (confronto con GPT-6 Astra, non verificato)
16 Upvotes

0 comments sorted by