Pe 3 septembrie 2026, OpenAI a lansat GPT-6 Astra, pe care îl numește „cel mai inteligent și mai aliniat model din lume”, și a titrat: „Bine ați venit în era AGI”. Președintele companiei, Greg Brockman, a spus că modelul ar putea fi văzut, în timp, drept sosirea inteligenței artificiale generale: „Cred că s-ar putea să fie despre acest model.” Clasamentele independente arată însă o imagine mai nuanțată — la programare și la scorul general, Claude Fable 5.1 conduce în continuare.
Ce este Astra
Un model de vârf orientat spre „muncă agentică” — cercetare, inginerie software, sarcini în mai mulți pași. Fereastră de context de 1 milion de tokeni, identificator API gpt-6-astra. Lansarea e eșalonată: întâi testeri de încredere și organizații partenere, apoi utilizatorii ChatGPT Plus, Pro, Business și Enterprise „în zilele următoare”, plus API-ul OpenAI și AWS.
Prețurile
| Cost API (per milion de tokeni, nivel standard) | Preț |
|---|---|
| Text trimis către model (input) | 10 $ |
| Input citit din cache | 1,00 $ |
| Scriere în cache | 12,50 $ |
| Text generat (output) | 50 $ |
| Peste 272.000 de tokeni de intrare — toată cererea | 20 $ intrare / 75 $ ieșire |
| Mod „rapid” | aprox. 2× prețul, pentru aprox. 2,5× viteza |
Per ansamblu, Astra costă de circa 2,5 ori mai mult decât modelul anterior, GPT-5.6 Sol. OpenAI spune că, în schimb, atinge scorul la programare al lui Fable 5 la sub jumătate din costul per sarcină și înjumătățește rata de halucinație.
Ce spun benchmarkurile
Nu domină pe toată linia. Pe testele independente, cele două modele își împart terenul:
| Test independent | GPT-6 Astra | Claude Fable 5.1 |
|---|---|---|
| Artificial Analysis — indice de inteligență generală | 55 | 57 |
| Coding Agent Index (agenți de programare) | 67 | 70 |
| Terminal-Bench 4.0 (lucru în terminal) | 57,9% | 55,8% |
| FrontierMath Tier 4 (matematică de cercetare) | 97,6% | 87,8% |
Astra domină la matematică de nivel cercetare, securitate cibernetică și raționament abstract. Fable 5.1 rămâne în față la programarea agentică, la agenții de cercetare științifică și la economia contextului memorat (cache).
„Era AGI” — cât de serios
Nu există o definiție agreată a inteligenței artificiale generale. Astra „saturează” teste precum FrontierMath și ARC-AGI-3 — obține scoruri aproape maxime — dar acele rezultate sunt înguste și sensibile la felul în care e rulat modelul. Anunțul „era AGI” este, deocamdată, poziționare de marketing, nu un consens al domeniului.
Partea de securitate
Astra este primul model care trece pragul „Critic” pentru capacități cibernetice din cadrul intern de evaluare al OpenAI („Preparedness Framework”). Din acest motiv, capacitățile cibernetice avansate sunt blocate în spatele unui program cu acces de încredere. OpenAI amânase lansarea după incidentul Hugging Face din iulie, ca să adauge protecții. Institutul britanic pentru siguranța AI (UK AISI) a constatat că Astra poate evita monitorizarea sub prompturi adversariale — OpenAI a numit asta o prioritate de cercetare.
Contextul
La numai câteva zile după ce Anthropic a lansat Fable 5.1, OpenAI răspunde cu artileria grea. Cursa nu se mai dă doar pe inteligență brută, ci pe cost per sarcină și pe cine controlează povestea despre AGI. Pentru discuția de fond despre ce ar însemna, de fapt, un asemenea prag, vezi episodul dedicat din seria noastră de AI.
Fii primul care comentează acest articol!