DeepSeek a împins, pe 12 august 2026, versiunea completă a modelului V4-Pro-0813 direct pe API, aplicația mobilă și interfața web — fără evenimente de lansare, fără conferință de presă, în stilul minimalist tipic companiei chineze. Cifrele tehnice sunt impresionante pe hârtie: 1,6 trilioane de parametri și un context de 1 milion de tokeni. Problema? La data redactării, niciun evaluator independent nu a reușit să reproducă scorurile de benchmark raportate de companie.
Specificații tehnice
V4-Pro-0813 e un model masiv: 1,6 trilioane de parametri totali, cu aproximativ 49 de miliarde de parametri activi per token — arhitectură de tip mixture-of-experts, antrenată pe peste 32 de trilioane de tokeni. Modelul folosește un sistem hibrid de atenție, conceput special pentru a reduce costurile de inferență la context lung — relevant, pentru că modelul suportă o fereastră de context de 1.048.576 tokeni (1M) și până la 384.000 de tokeni de output.
Benchmark-uri — ce spune DeepSeek
Povestea principală ține de programarea agentică. Conform cifrelor raportate de companie, scorul pe DeepSWE a urcat de la 12,8 la 62,7, pe CyberGym de la 52,7 la 83,3, iar pe Terminal Bench 2.1 de la 72,1 la 87,9, față de versiunea preview. Pe SWE-bench Verified, modelul ar obține 96,40%, poziția a doua la nivel mondial, în spatele doar al lui Claude Opus 5 — dar la aproximativ 1/36 din costul per test al acestuia din urmă. Creșterile raportate ajung până la 49,9 puncte procentuale pe unele teste, față de versiunea anterioară.
Un semnal de avertizare important
Toate cifrele de mai sus vin exclusiv din surse ale companiei sau din analize bazate pe datele publicate de DeepSeek. La data de 12 august 2026, nu exista niciun rezultat de benchmark independent, reprodus de o terță parte, pentru V4-Pro-0813 — toate cifrele erau, la acel moment, fie raportate de vânzător, fie de analiști care preiau cifrele vânzătorului, fără verificare proprie. Practic, scorurile spectaculoase trebuie tratate ca afirmații ale DeepSeek, nu ca fapte confirmate, până la apariția unor teste independente.
Preț
Structura de preț rămâne agresivă față de restul pieței: $0,435 per milion de tokeni de input (la cache miss), doar $0,003625 la cache hit, și $0,87 per milion de tokeni de output, cu fereastra de context de 1M inclusă. DeepSeek a anunțat însă că urmează o creștere de preț semnificativă — deci actualul nivel, deja considerat foarte competitiv față de modelele occidentale echivalente, s-ar putea să nu rămână valabil mult timp.
Concluzie
V4-Pro-0813 continuă tiparul DeepSeek: lansări fără fast, cifre de benchmark spectaculoase și preț mult sub concurența occidentală. Dacă scorurile raportate se confirmă independent, modelul devine una dintre cele mai bune opțiuni pentru programare agentică la nivel mondial, la o fracțiune din costul alternativelor de top. Până atunci însă, rămâne prudent să tratăm cifrele ca marketing până la proba contrarie — un scepticism sănătos, mai ales într-o industrie unde promisiunile de benchmark s-au dovedit, nu o dată, greu de reprodus în practică.
Fii primul care comentează acest articol!