Uso primario dichiarato o dedotto con cautela dalla documentazione ufficiale.
DeepSeek V4.1 Flash
Agenti, codice e distribuzione aperta a costi contenuti.
L'essenziale
Capacità di input massima quando pubblicata dalla fonte.
Limite massimo di generazione documentato.
Canali di disponibilità verificati.
Famiglia funzionale principale e specialità verificate.
Condizioni dichiarate per API, pesi o distribuzione autonoma.
Limiti e integrazione
| ID API | deepseek-flash |
|---|---|
| Tipo di modello | Testo e ragionamento |
| Modalità di accesso | Proprietario a pagamento |
| Licenza | Proprietaria |
| Distribuzione | API ospitata |
| Rilascio | 10 SET 2026 |
| Cutoff della conoscenza | Non pubblicato |
| Entrata | Testo · Immagine |
| Uscita | Testo |
| Finestra di contesto | 1.000.000 token |
| rendimento massimo | 384.000 token |
| Ragionamento | Modalità con e senza ragionamento |
| Strumenti pubblicati | Funzionalità · Responses API · Prefisso di chat · FIM |
| Uscite strutturate | Supportato |
| Elaborazione batch | Non pubblicato |
| Cache dei prompt | Supportato |
| Fine-tuning | Pesi aperti |
| Piattaforme verificate | DeepSeek API · Hugging Face |
Agenti, codice e distribuzione aperta a costi contenuti.
Le condizioni di esecuzione variano tra benchmark; non confrontare solo il numero.
Cosa può fare
Orientamento
Agenti, codice e distribuzione aperta a costi contenuti.
Contesto
1.000.000 token · 384.000 token
Strumenti e integrazione
Funzioni · Responses API · Prefisso di chat · FIM
Accesso
DeepSeek API · pesi aperti
Costo documentato
| Concetto | Di valore | Unità/condizione |
|---|---|---|
| Input standard | 0,30 USD / 1 M token (picco) | Tariffa API standard |
| Input in cache | 0,006 USD / 1 M token (picco) | Lettura di prefissi riutilizzati |
| Scrittura o archiviazione della cache | Non pubblicato | La condizione varia in base al fornitore |
| Output standard | 1,20 USD / 1 M token (picco) | Può includere token di ragionamento |
| Input batch | Non pubblicato | Elaborazione asincrona |
| Output batch | Non pubblicato | Elaborazione asincrona |
Le tariffe fuori picco sono dimezzate; gli orari sono pubblicati in UTC.
i I prezzi cambiano e possono dipendere dal livello, dalla regione o dalla durata del contesto. Controlla la fonte prima di prendere una decisione.
Come leggere i risultati
Un benchmark pubblico orienta, ma non sostituisce una valutazione con i tuoi dati, strumenti, budget e tolleranza all'errore.
| Benchmark | Risultato | Metrica | Fonte |
|---|---|---|---|
| GPQA Diamond | 90,9 % | Accuratezza | Vedi fonte ↗ |
| Terminal-Bench 2.1 | 90,6 % | Accuratezza | Vedi fonte ↗ |
| DeepSWE v1.1 | 74,2 % | Risolto | Vedi fonte ↗ |
Inferama evidenzia un "miglior risultato" solo quando la metrica, il set di test, la configurazione e la data consentono un confronto equivalente. I dati del fornitore sono presentati come affermazioni provenienti dalla propria fonte.
Cronologia
DeepSeek V4.1 Flash
Versione inclusa nel catalogo verificato di Inferama.
Analisi correlate
DeepSeek V4.1 Flash: come verificare se la sua cache compressa riduce il costo reale di un agente
DeepSeek attribuisce a V4.1 Flash una cache KV persistente molto più piccola rispetto a quella del predecessore. Questo dato descrive una proprietà dell’infrastruttura, non il costo o il tempo necessari per completare un’attività. L’analisi propone una prova controllata per misurarli entrambi.
28 set 2026 ↗ COMPARATIVADeepSeek V4.1 Flash + Eleven v3 a confronto con la voce full-duplex: come comparare le architetture
Una pipeline modulare con riconoscimento vocale, DeepSeek V4.1 Flash ed Eleven v3 non equivale a un modello vocale full-duplex. Questa guida propone di confrontare i due sistemi end-to-end, senza dichiarare un vincitore sulla base di specifiche isolate.
26 set 2026 ↗ ANALISISDeepSWE v1.1: cosa misura una patch che supera il suo verificatore e quando il suo pass@1 smette di dimostrare che l’agente ha risolto il compito
DeepSWE v1.1 valuta modifiche al codice prodotte da agenti su compiti originali e di lunga durata. Il suo risultato può offrire un segnale utile, ma una riga della leaderboard è interpretabile soltanto se sono noti l’imbracatura dell’agente, la politica sugli errori, i rollout, il verificatore e la versione esatta del benchmark. Una revisione di Epoch AI aggiunge un’avvertenza concreta: alcune patch che modificano i test possono ricevere un falso negativo in determinate condizioni.
23 set 2026 ↗