Uso primario dichiarato o dedotto con cautela dalla documentazione ufficiale.
DeepSeek R1
Modello di ragionamento aperto e famiglia di modelli distillati, rilevante per seguire l'evoluzione del ragionamento verificabile.
L'essenziale
Capacità di input massima quando pubblicata dalla fonte.
Limite massimo di generazione documentato.
Canali di disponibilità verificati.
Famiglia funzionale principale e specialità verificate.
Condizioni dichiarate per API, pesi o distribuzione autonoma.
Limiti e integrazione
| ID API | deepseek-reasoner |
|---|---|
| Tipo di modello | Testo e ragionamento · Codice |
| Modalità di accesso | API e pesi aperti |
| Licenza | MIT |
| Distribuzione | API, locale o cloud privato |
| Rilascio | 20 ENE 2025 |
| Cutoff della conoscenza | Non pubblicato |
| Entrata | Testo |
| Uscita | Testo |
| Finestra di contesto | 64.000 token nell'API originale |
| rendimento massimo | Non pubblicato |
| Ragionamento | Ragionamento esplicito |
| Strumenti pubblicati | |
| Uscite strutturate | Non applicabile o non pubblicato |
| Elaborazione batch | Non pubblicato |
| Cache dei prompt | Non pubblicato |
| Fine-tuning | Pesi e modelli distillati scaricabili |
| Piattaforme verificate | DeepSeek API · Hugging Face |
Matematica, codice, ricerca e studio di modelli di ragionamento aperti.
È una generazione precedente; confronta latenza e lunghezza del ragionamento con V3.2.
Cosa può fare
Orientamento
Matematica, codice, ricerca e studio di modelli di ragionamento aperti.
Contesto
64.000 token nell'API originale · Non pubblicato
Strumenti e integrazione
Non pubblicato
Accesso
DeepSeek API e pesi
Costo documentato
| Concetto | Di valore | Unità/condizione |
|---|---|---|
| Input standard | Non pubblicato | Tariffa API standard |
| Input in cache | Non pubblicato | Lettura di prefissi riutilizzati |
| Scrittura o archiviazione della cache | Non pubblicato | La condizione varia in base al fornitore |
| Output standard | Non pubblicato | Può includere token di ragionamento |
| Input batch | Non pubblicato | Elaborazione asincrona |
| Output batch | Non pubblicato | Elaborazione asincrona |
Consulta la fonte primaria: l'unità di fatturazione dipende dal tipo di modello e dal canale di accesso.
i I prezzi cambiano e possono dipendere dal livello, dalla regione o dalla durata del contesto. Controlla la fonte prima di prendere una decisione.
Come leggere i risultati
Un benchmark pubblico orienta, ma non sostituisce una valutazione con i tuoi dati, strumenti, budget e tolleranza all'errore.
| Benchmark | Risultato | Metrica | Fonte |
|---|---|---|---|
| AIME 2024 | 79,8 % | Pass@1 pubblicato | Vedi fonte ↗ |
Inferama evidenzia un "miglior risultato" solo quando la metrica, il set di test, la configurazione e la data consentono un confronto equivalente. I dati del fornitore sono presentati come affermazioni provenienti dalla propria fonte.
Cronologia
DeepSeek R1
Versione inclusa nel catalogo verificato di Inferama.
Analisi correlate
DeepSeek R1 in produzione: come testare il template del prompt senza compromettere l’applicazione
Le raccomandazioni ufficiali per la progettazione dei prompt di DeepSeek R1 sono ipotesi da verificare in ogni applicazione. Questo protocollo consente di confrontare la posizione delle istruzioni e il prefisso «<think>», misurando sia la qualità delle risposte sia i problemi di integrazione.
27 set 2026 ↗ COMPARATIVADeepSeek R1 vs. DeepSeek V3.2: come scegliere tra ragionamento esplicito ed efficienza in un flusso sottoposto a revisione
Un confronto utile tra DeepSeek R1 e DeepSeek V3.2 non parte da un benchmark pubblicato, ma da un’attività propria, un corpus congelato e una definizione esplicita di errore materiale. Questo protocollo consente di misurare se la deliberazione aggiuntiva di R1 riduce errori e revisioni umane oppure se V3.2 raggiunge la medesima soglia con minore latenza, consumo e complessità.
22 set 2026 ↗ ANALISISAIME 2024: cosa misura una percentuale di risposte corrette su 30 problemi e perché due risultati apparentemente uguali potrebbero non essere confrontabili
Un dato su AIME 2024 sembra semplice, ma può riassumere protocolli molto diversi. Questa guida spiega cosa rappresenta il set, come il risultato cambia in base al numero di tentativi, alla selezione delle risposte, agli strumenti e all'arnese di valutazione, e quali informazioni richiedere prima di confrontare i modelli.
22 set 2026 ↗