Pe 24 iunie 2026, la Qualcomm Investor Day din New York, CEO-ul Cristiano Amon a anunțat achiziția companiei Modular pentru $3,9 miliarde — plătite exclusiv în acțiuni Qualcomm (19,2 milioane de acțiuni la prețul de $204,13/acțiune). Tranzacția nu este finalizată încă — se așteaptă aprobări de reglementare și închidere în a doua jumătate a lui 2026 — dar semnificația ei este clară: Qualcomm intră direct în bătălia pentru dominanța software-ului AI, atacând monopolul CUDA al NVIDIA.

CUDA — monopolul pe care toată lumea vrea să-l spargă

NVIDIA nu câștigă doar din hardware. Cheia dominanței sale în AI este CUDA — ecosistemul software lansat în 2007 care a transformat GPU-urile în motoare de calcul pentru machine learning. Astăzi, aproape tot codul de antrenare și inferență AI este scris pentru CUDA, ceea ce înseamnă că oricine vrea să ruleze modele AI mari are nevoie de GPU-uri NVIDIA. AMD încearcă să spargă această dependență cu ROCm, Intel cu oneAPI — dar niciunul nu a reușit să creeze o alternativă cu adevărat hardware-agnostică.

Modular pretinde că a rezolvat exact această problemă.

Ce este Modular — Mojo și MAX

Fondată în 2022 de Chris Lattner și Tim Davis, Modular a construit două produse complementare:

Mojo — limbajul care compilează pentru orice chip

Mojo are sintaxă compatibilă cu Python — același cod, aceleași biblioteci — dar se compilează la viteze comparabile cu C++. Diferența esențială față de orice altceva existent: un kernel scris în Mojo poate fi compilat pentru NVIDIA (PTX/CUDA), AMD (AMDGPU/ROCm) și Apple Silicon (Metal) fără nicio modificare a codului sursă. Mojo 1.0 beta1 a fost lansat în mai 2026. Infrastructura din spate se bazează pe MLIR (Multi-Level Intermediate Representation) — un proiect co-creat tot de Lattner la Google.

MAX — inference engine hardware-agnostic

MAX este runtime-ul care gestionează cum rulează modelele AI pe hardware diferit. Suportă CPU, GPU, NPU și ASIC-uri custom fără rescrierea codului per accelerator și nu depinde de PyTorch, CUDA sau ROCm — eliminând dependențele grele și reducând dimensiunea containerelor Docker cu până la . Conform benchmark-urilor din 2026, MAX depășește vLLM pe anumite configurații. Meta și Microsoft sunt primii clienți mari confirmați la Investor Day.

Chris Lattner — omul din spatele limbajelor pe care le folosești deja

Chris Lattner nu este un fondator oarecare de startup. Este creatorul unor proiecte care au modelat industria software modernă:

  • LLVM — infrastructura de compilatoare folosită de Apple, Google, Meta, Microsoft și NVIDIA. Practic tot codul care rulează pe macOS, iOS și Android trece prin LLVM.
  • Clang — compilatorul C/C++ modern, înlocuitorul standard al GCC.
  • Swift — limbajul nativ iOS/macOS, creat la Apple între 2005–2017.
  • MLIR — infrastructura de compilatoare de generație nouă, co-fondată la Google.

Lattner rămâne în companie după achiziție. Declarația sa la anunț: „Alăturarea Qualcomm ne oferă scara și acoperirea de platformă pentru a accelera misiunea noastră."

Strategia Qualcomm — Dragonfly + Modular

La același Investor Day din 24 iunie, Qualcomm a anunțat simultan Dragonfly — o nouă familie de procesoare pentru inferență AI în data center. Logica este clară: Dragonfly este hardware-ul, Modular este software-ul. Împreună formează o alternativă completă la ecosistemul NVIDIA:

  • Antrenezi un model pe NVIDIA (cu CUDA) — codul de inferență rulează pe Dragonfly fără modificări, prin MAX și Mojo
  • Același cod rulează de pe edge (Snapdragon X2 Elite, 85 TOPS NPU, lansat la CES 2026) până în cloud (Dragonfly) — strategia pe care Qualcomm o numește Computing Continuum

Cristiano Amon, CEO Qualcomm, la anunț: „Aceasta este o clipă decisivă nu doar pentru Qualcomm, ci pentru întreaga industrie AI. Industria se îndreaptă spre arhitecturi multi-vendor dezagregate care necesită o fundație software mai deschisă și mai modernă."

Qualcomm și-a ridicat ținta de venituri non-handset la $40 de miliarde până în 2029.

Reacția pieței — investitorii, mai puțin convinși

Acțiunea QCOM a scăzut cu 5,12% pe 26 iunie, la două zile după anunț. Motivul: investitorii sunt îngrijorați de diluție (emiterea a 19,2 milioane de acțiuni noi) și de absența veniturilor imediate din AI. Modular fusese evaluată la $1,6 miliarde în septembrie 2025 (Seria B, $250 milioane) — Qualcomm plătește un premium de 2,4× față de evaluarea de acum 9 luni.

Analiștii rămân optimiști pe termen lung: JPMorgan a ridicat ținta de la $160 la $265, UBS de la $170 la $235, RBC de la $175 la $250. Benchmark a emis cea mai optimistă țintă: $300.

Cât de realistă este alternativa la CUDA?

Sincer: parțial. NVIDIA controlează segmentul de antrenare (H100/B200 + CUDA) și nu va pierde această poziție pe termen scurt — dacă vreodată. Câmpul de luptă real în 2026 este inferența (rularea modelelor deja antrenate), unde costurile contează mai mult decât peak-ul de performanță. Aici Qualcomm + Modular au o șansă reală: Meta și Microsoft au adoptat deja soluții alternative la CUDA la scară, dovadă că marile companii nu vor să fie blocate pe un singur furnizor.

Mojo rămâne în 1.0 beta, suportul pentru arhitecturi mixture-of-experts (DeepSeek V3, Llama 4) este în maturizare, iar tranzacția nu este finalizată. Dar dacă Qualcomm reușește să implementeze strategia, CUDA ar putea pierde pentru prima dată o felie semnificativă din piața inference-ului — segmentul cu cea mai rapidă creștere din întreaga industrie AI.

🖥️ Hardware
← Toate articolele
💬 Comentarii

Fii primul care comentează acest articol!

✍️ Lasă un comentariu
5 + 9 = ?