DeepSeek V4-Flash-0731 mostra l'impatto del post-allenamento
Un aggiornamento post-addestramento ha portato il modello Flash più piccolo di DeepSeek a circa 50 nell'indice di intelligenza di analisi artificiale.
DeepSeek-V4-Flash-0731 ha mantenuto la stessa architettura del modello dell'anteprima, ma ha utilizzato una nuova sessione di post-formazione incentrata su codifica, agenti, ragionamento e utilizzo degli strumenti. I rapporti di analisi artificiale indipendente hanno posizionato il risultato del ragionamento massimo a 50, davanti alla più ampia anteprima V4-Pro di DeepSeek. La lezione pratica è che una migliore post-formazione e valutazione possono produrre grandi vantaggi senza semplicemente aggiungere parametri.
DeepSeek, Open-weight models, Fine-tuning, Artificial Analysis
Nederland, Netherlands, NL, TripleZero iT, AI
TripleZero iT, Nederland