Claude Fable 5.1 vine cu o reducere serioasă a costului real de utilizare, de până la 45% pentru sarcinile complexe bazate pe agenți AI. Noua versiune anunțată de Anthropic, prezentată și de The Verge, nu schimbă tariful de bază pentru tokeni, ci atacă una dintre cheltuielile care se adună rapid în aplicațiile complexe: reutilizarea informațiilor deja procesate.
Ce se ieftinește la Claude Fable 5.1?
Tariful API rămâne la 10 dolari (aproximativ 45 de lei) pentru un milion de tokeni de intrare și 50 de dolari (aproximativ 227 de lei) pentru un milion de tokeni generați. Citirea informațiilor din cache scade însă la numai 0,25 dolari (circa 1,1 lei) pentru un milion de tokeni, cu 75% sub Fable 5. Anthropic estimează efectul astfel:
- aproximativ 25% cost mai mic într-un flux de lucru obișnuit;
- până la 45% mai puțin pentru sarcini puternic bazate pe agenți AI;
- 0,25 dolari / milion de tokeni pentru datele citite din cache.
Reducerea e binevenită, dar cifrele devin mult mai interesante dacă punem Claude lângă câteva modele chinezești.
Cât costă AI-ul occidental lângă cel chinezesc?
| Model | Input / 1 milion tokeni | Output / 1 milion tokeni | Observație |
|---|---|---|---|
| Claude Fable 5.1 | 10 USD (~45 lei) | 50 USD (~227 lei) | tarif API standard |
| DeepSeek V4 Pro | 1,32 USD (~6 lei) | 3,96 USD (~18 lei) | tarif de vârf; în afara orelor de vârf costul se înjumătățește |
| Qwen3 Max | 0,359 USD (~1,6 lei) | 1,434 USD (~6,5 lei) | China, Beijing, solicitări de până la 32K tokeni |
DeepSeek publică pentru V4 Pro tarife de numai 0,66 dolari la input și 1,98 dolari la output în afara intervalelor de vârf, iar Qwen3 Max pornește în China de la 0,359 dolari pentru un milion de tokeni de intrare.
Evident, tabelul nu spune că trei modele sunt perfect echivalente. Performanța, lungimea contextului, infrastructura, securitatea și scenariile de utilizare diferă. Spune însă ceva mult mai simplu despre piață: chinezii au demonstrat că un model AI performant poate fi vândut mult mai ieftin.
China e utilă și dacă nu folosești un model chinezesc
Aici cred că apare unul dintre cele mai sănătoase efecte ale competiției din AI. Nu trebuie să instalezi DeepSeek și nici să-ți muți proiectele pe Qwen pentru a beneficia de existența lor. E suficient ca alternativele chinezești să fie suficient de bune și mult mai ieftine pentru ca tarifele occidentale să înceapă să fie puse sub semnul întrebării.
Am văzut deja această presiune și la companii mari. În iunie scriam că Microsoft analiza folosirea DeepSeek V4 pentru a reduce costurile unor servicii Copilot. Tot atunci, GLM-5.2 era comparat cu Claude Fable 5, inclusiv prin prisma unei diferențe mari de tarif.
Asta este, până la urmă, forma de „democratizare” care contează cel mai repede. Modelele chinezești nu trebuie să ocupe primul loc în fiecare benchmark. Trebuie doar să fie suficient de competitive încât un dezvoltator să poată spune: „alternativa mă costă de câteva ori mai puțin”. Din acel moment, un preț de 50 de dolari pentru un milion de tokeni de output trebuie justificat prin ceva concret, nu doar prin numele companiei.
Claude Fable 5.1 rămâne disponibil prin Claude Platform și pentru utilizatorii Pro, Max, Team și Enterprise. Anthropic spune că noua versiune aduce și performanțe mai bune decât Fable 5, alături de filtre ajustate pentru mai puține blocări nejustificate. Mythos 5.1 are deocamdată acces restricționat prin programele dedicate ale companiei.
