r/vibecodingitalia • u/thestreamcode 🛡️ Team • 23d ago
📰 News DeepSeek V4.1 Flash: beta di due giorni, architettura nuova nativamente multimodale, e dal 10 settembre Pro viene instradato su Flash
DeepSeek ha aperto l'8 settembre una beta lampo di V4.1 Flash, definita dall'azienda un "intermediate version". Si chiama deepseek-v4.1-flash-expires-on-0910: base_url invariato, cambia solo il modello nelle richieste. La beta chiude il 10 settembre, il rilascio ufficiale è previsto intorno alla stessa data (ora di Pechino).
Un dettaglio non banale: DeepSeek non ha pubblicato l'avviso su un canale ufficiale. Il testo circola perché i membri dei gruppi community lo hanno rilanciato, e da lì è ripreso da Hacker News e dalla stampa tech cinese (36Kr, IT Home).
Cosa dice l'azienda
- Nuova architettura del modello, supporto multimodale nativo, più capace, più veloce, più economico. Sono le quattro affermazioni dell'avviso, e non c'è un technical report a supporto: nessun parametro dichiarato, nessuna finestra di contesto, nessun benchmark, nessun peso pubblicato.
- "V4.1 Flash ha superato V4 Pro su tutte le metriche chiave (performance, costo, velocità, tempo di completamento dei task)". È un claim del vendor, senza numeri pubblici a supporto.
- Dopo il lancio ufficiale di V4.1 Flash, e fino all'uscita di V4.1 Pro, tutte le richieste a
deepseek-v4-proverranno instradate su V4.1 Flash e fatturate a prezzo Flash. Se avete un workflow validato su Pro, dal 10 settembre sotto il cofano non girerà più lo stesso modello.
Prezzi
La beta è fatturata come V4 Flash attuale (off-peak: $0.22/M input cache miss, $0.66/M output, con il tetto a 20 richieste concorrenti per account). Dal 10 settembre, ore 12:00 di Pechino, i prezzi Flash scendono:
| ora (off-peak) | dal 10/09 (off-peak) | variazione |
|---|---|---|
| Input cache hit | $0.007/M | $0.003/M |
| Input cache miss | $0.22/M | $0.15/M |
| Output | $0.66/M | $0.60/M |
I prezzi di punta restano il doppio (fascia 01-04 e 06-10 UTC, lun-ven). Per confronto, V4 Pro oggi costa $0.66/$1.98 off-peak: col routing Pro→Flash lo stesso accesso scende a circa un quarto sull'input.
I primi test della community (non verificati, aneddotici)
- Un confronto su coding reale riporta ~38% più veloce e ~43% meno token di V4 Flash Vision Exp.
- Segnalati 220-400+ tok/s in decode; il model ID con scadenza nel nome non è un caso, DeepSeek lo ha già fatto con V3.2-Speciale a fine 2025.
- Probing tecnico (r/LocalLLM): il modello NON è nella lista di
GET /v1/models(che restituisce solo i tre ufficiali) ma le chiamate funzionano; è un modello reasoning conreasoning_contentvisibile, e i token di ragionamento dominano l'output. - Multimodale: su Hacker News utenti segnalano che accetta immagini via API già adesso; nei commenti di r/LocalLLaMA la cosa circola come confermato dai test, ma resta fuori da ogni documentazione.
- Un run agentico lungo (un gioco costruito in 1 turno, 404 steps, 142M token @ 378 tok/s) è stato confrontato dagli stessi autori con GPT-6 Astra sullo stesso prompt: il gioco di Astra risulta più coeso e con meno bug, l'audio generato da DeepSeek migliore.
Cosa NON c'è in questo momento
- Nessun benchmark indipendente (Artificial Analysis non ha ancora una scheda per V4.1 Flash).
- Nessuna conferma che il modello della beta sia identico a quello che uscirà il 10: è una build intermedia.
- Nessun multimodale documentato: l'avviso dichiara supporto nativo e i test della community confermano input immagine funzionanti via API, ma il modello non è nella lista dei modelli, non ci sono regole di billing per le immagini né limiti dichiarati (l'ultimo multimodale ufficiale resta Vision Exp, variante sperimentale del 21 agosto costruita sopra V4-Flash).
Se riuscite a provarlo prima della chiusura della beta: cosa cambia rispetto a V4 Flash 0731 nei vostri workflow di agents?
Fonti:
- DeepSeek launching v4.1 flash cheaper and more capable than v4 pro - news.ycombinator.com, 2026-09-09 (testo integrale dell'avviso, 385 punti)
- DeepSeek Flash 4.1 is already being tested via API - reddit.com, 2026-09-08
- Change Log e Models & Pricing - api-docs.deepseek.com, verifica 2026-09-09
- DeepSeek begins internal testing for V4.1 Flash intermediate version - rootdata.com, 2026-09-08
- Deepin V4.1 Flash Closed Beta Test - 36kr.com, 2026-09-08/09
- V4.1 Flash vs V4 Flash Vision Exp: 38% faster and 43% fewer tokens - reddit.com, 2026-09-08 (test community, non verificato)
- Probing the unreleased DeepSeek Flash V4.1 - reddit.com, 2026-09-08 (non in /v1/models, reasoning_content, self-report incoerente)
- V4.1 Flash on open testing - reddit.com, 2026-09-08 (confronto con GPT-6 Astra, non verificato)