Pe 30 iunie 2026, Anthropic a lansat Claude Sonnet 5 — modelul care schimbă ecuația în cursa pentru dominanța AI agentic. Nu este pur și simplu un Sonnet mai bun: este primul model de nivel mediu care poate planifica autonom, rula terminale, naviga browsere și finaliza sarcini complexe fără supraveghere constantă — capabilități care până acum necesitau modele mari și scumpe precum Opus. Și costă de 5–7 ori mai puțin.
Ce poate face Sonnet 5 — concret
Distincția față de modelele anterioare este agentică, nu conversațională. Sonnet 5 nu răspunde mai bine la întrebări — execută sarcini:
- Terminal: rulează comenzi CLI, execută scripturi, testează rezultatele și corectează erorile singur, fără să ceară confirmare la fiecare pas
- Browser: navighează web, caută informații, completează formulare — scor 84,7% pe BrowseComp, benchmark-ul de referință pentru sarcini de search agentic
- Computer use: controlează interfețe vizuale la rezoluție de până la 2.576px — scor 81,2% pe OSWorld-Verified
- Planificare multi-pas: descompune obiective complexe, execută etapele în ordine și verifică propriile rezultate fără să fie rugat explicit
Testerii independenți au raportat că modelul „termină sarcini complexe unde versiunile anterioare de Sonnet se opreau" și „verifică propriile rezultate fără să i se ceară". Anthropic îl poziționează explicit ca răspuns la cererea din piață pentru agenți AI economici la scară mare — companiile pot rula mii de sesiuni agentice simultan la cost redus.
Benchmark-uri — și un record față de Opus
Sonnet 5 nu atinge Opus 4.8 pe toate testele, dar îl depășește acolo unde contează cel mai mult în practică:
| Benchmark | Sonnet 5 | Opus 4.8 | Sonnet 4.6 |
|---|---|---|---|
| Terminal-Bench 2.1 (CLI/terminale) | 80,4% | 74,6% | — |
| SWE-bench Verified (coding) | 85,2% | — | — |
| BrowseComp (search agentic) | 84,7% | — | — |
| OSWorld-Verified (computer use) | 81,2% | 83,4% | — |
| SWE-bench Pro (coding agentic) | 63,2% | 69,2% | 58,1% |
Cifra remarcabilă: Terminal-Bench 2.1 — 80,4%, față de 74,6% pentru Opus 4.8. Este prima dată când un model Sonnet depășește Opus pe un benchmark major de sarcini tehnice. La cunoștințe generale (GDPval-AA v2), Sonnet 5 îl depășește ușor și acolo (1.618 vs. 1.615 Elo).
Prețuri — democratizarea AI agentic
Aici este schimbarea cu adevărat importantă:
| Perioadă | Input / 1M tokeni | Output / 1M tokeni |
|---|---|---|
| Promoțional (până 31 august 2026) | $2 | $10 |
| Standard (din 1 septembrie 2026) | $3 | $15 |
La prețul promoțional, Sonnet 5 este mai ieftin decât OpenAI GPT-5.5 și Google Gemini 3.1 Pro la performanță comparabilă sau superioară pe sarcini de coding și agentic. Gemini 3.5 Flash este mai ieftin, dar cu capabilități agentice inferioare.
Context de 1 milion de tokeni — ce înseamnă în practică
Un milion de tokeni echivalează cu aproximativ 750.000 de cuvinte — un întreg codebase mediu sau o bibliotecă de documente. Practic, Claude Code poate analiza toate fișierele unui proiect într-o singură sesiune, fără să „uite" context pe parcurs. Output maxim per cerere: 128.000 tokeni (~100.000 de cuvinte per răspuns). Contextul de 1M este disponibil și pe AWS Bedrock și Google Vertex AI.
Unde este disponibil
- Claude.ai Free și Pro: model implicit din 30 iunie
- API Anthropic: model ID
claude-sonnet-5 - Claude Code (CLI): integrat cu context nativ 1M tokeni
- GitHub Copilot: disponibil general din aceeași zi pe planurile Pro, Pro+, Max, Business și Enterprise
- AWS Bedrock și Google Vertex AI: disponibil la lansare
Locul Sonnet 5 în ecosistemul Anthropic
Gama Anthropic se reorganizează în jurul a două roluri clare: Sonnet 5 pentru munca agentică de zi cu zi — cod, automatizări, sarcini cu tool-uri — și Opus 4.8 pentru raționament pur de vârf, cercetare și probleme matematice complexe, unde Opus rămâne superior cu ~6 puncte când nu există tool-uri disponibile.
Logica este clară: Sonnet 5 rulează agenții în volum mare la cost redus; Opus 4.8 este chemat doar pentru subproblemele cu dificultate maximă. Companiile care rulează sute de agenți simultan pot face asta acum cu un model care bate Opus pe terminale — la o fracțiune din preț.
Fii primul care comentează acest articol!