Luna iunie 2026 a adus două anunțuri majore din lumea hardware: NVIDIA și MediaTek au dezvăluit la Computex 2026 platforma RTX Spark — primul superchip care unește CPU și GPU într-un singur pachet pentru categoria „AI PC" — iar NVIDIA a confirmat că rack-urile Vera Rubin NVL72, destinate data centerelor de scară gigawatt, intră în producție în trimestrul al treilea al acestui an.
RTX Spark: primul AI PC cu CPU și GPU unificate
Anunțat la Computex 2026 din Taipei (2–5 iunie), RTX Spark este rezultatul colaborării dintre NVIDIA, MediaTek și Microsoft. Platforma combină un procesor Arm cu până la 20 de nuclee — proiectat de MediaTek pentru eficiență energetică — cu un GPU Blackwell de 6.144 de nuclee CUDA, echivalent cu un RTX 5070 discret, plus 128 GB de memorie LPDDR5X unificată și un bandwidth de 300 GB/s.
Diferența față de un laptop obișnuit: CPU și GPU partajează același pool de memorie, eliminând transferurile costisitoare de date între cele două componente. Rezultatul practic este că modelele AI locale — inclusiv modele de tip LLM de dimensiuni medii — rulează direct pe mașina utilizatorului, fără conexiune la cloud.
Microsoft a ales această platformă ca bază pentru ceea ce compania numește „Windows agentic AI OS": un sistem de operare capabil să execute agenți AI autonomi local, nu doar să apeleze API-uri remote.
| Componentă | Specificație |
|---|---|
| CPU | Până la 20 nuclee Arm (design MediaTek) |
| GPU | Blackwell · 6.144 CUDA cores (≈ RTX 5070) |
| Memorie unificată | 128 GB LPDDR5X · bandwidth 300 GB/s |
| Disponibilitate | Toamna 2026 — 30+ laptopuri, 10+ desktop-uri compacte |
| Producători confirmați | ASUS, Dell, HP, Lenovo, Microsoft Surface, MSI; urmează Acer, GIGABYTE |
Prețurile nu au fost anunțate. NVIDIA a dezvăluit și un roadmap pe trei generații: Blackwell (platforma actuală), Rubin (cu memorie LPDDR6) și Rosa Feynman — ultima fără detalii tehnice deocamdată.
Vera Rubin NVL72: rack-urile de data center de 8,8 milioane de dolari intră în producție
La celălalt capăt al spectrului — hardware pentru data centerele hyperscalerilor — NVIDIA a confirmat că platforma Vera Rubin NVL72 intră în producție în trimestrul al treilea din 2026, cu livrări în volum mare în trimestrul al patrulea.
Fiecare rack NVL72 conține 72 de GPU-uri Rubin și 36 de procesoare Vera, cu răcire lichidă. Memoria totală per rack ajunge la 20,7 TB HBM4 — 288 GB per GPU. Performanța declarată: 3,6 EFLOPS pentru inferență (format NVFP4) și 2,5 EFLOPS pentru antrenament.
Față de platforma Blackwell actuală (GB200 NVL72), NVIDIA promite o inferență de 5 ori mai rapidă și un cost per token de 10 ori mai mic la nivel de rack — o îmbunătățire semnificativă pentru companiile care rulează modele mari la scară.
| Parametru | Valoare |
|---|---|
| GPU per rack | 72 GPU Rubin + 36 CPU Vera (liquid-cooled) |
| Memorie totală | 20,7 TB HBM4 (288 GB per GPU) |
| Inferență | 3,6 EFLOPS (NVFP4) |
| Antrenament | 2,5 EFLOPS |
| Preț estimat per rack | $5–7M (BOM); unele configurații până la $8,8M |
| Cloud pricing estimat | $15–25/oră pe hyperscaleri la lansare |
Primii clienți cloud confirmați pentru livrări în H2 2026: AWS, Google Cloud, Microsoft Azure, Oracle Cloud Infrastructure, CoreWeave și Lambda. Toți marii furnizori de cloud se pregătesc pentru tranziția de la Blackwell la Rubin în a doua jumătate a anului.
Un element care complică tabloul: memoria HBM4 necesară pentru aceste rack-uri a înregistrat o creștere de preț de 435% din cauza constrângerilor de supply chain — fapt care îngustează marjele producătorilor de servere și prelungește timpii de livrare la 36–52 de săptămâni pentru unele configurații personalizate.
Dacă RTX Spark aduce AI-ul pe laptopul utilizatorului obișnuit, Vera Rubin NVL72 ridică ștacheta pentru infrastructura care alimentează modelele frontier. Ambele anunțuri confirmă că 2026 este anul în care accelerarea hardware a AI-ului se produce simultan la ambele capete ale scalei — de la consumer la hyperscaler.
Fii primul care comentează acest articol!