În aprilie 1956, un fost șofer de camion pe nume Malcom McLean a trimis din Newark spre Houston un vas petrolier reconvertit, încărcat cu 58 de cutii metalice identice. Ideea nu era o navă mai rapidă sau un motor mai eficient. Ideea era că marfa nu mai trebuia descărcată, numărată și reîncărcată bucată cu bucată în fiecare port. Cifrele citate în mod obișnuit pentru acel moment sunt brutale: manipularea mărfii vrac costa în jur de 5,83 dolari pe tonă, iar aceeași operațiune în container cobora sub 20 de cenți. Prețul transportului pe mare nu se schimbase. Se schimbase doar cât plăteai pentru a manipula, iar și iar, aceeași încărcătură.
Anunțul făcut de Anthropic pe 1 septembrie 2026 se citește prin aceeași lentilă. Claude Fable 5.1 păstrează tariful predecesorului său la virgulă: 10 dolari per milion de tokens de intrare, 50 de dolari per milion de tokens de ieșire. Nimic nu s-a ieftinit pe eticheta de preț. Ce s-a ieftinit este partea din cerere pe care o trimiți de fiecare dată — instrucțiunile, procedurile, dosarul, istoricul conversației. Citirea din cache a scăzut de la 1 dolar la 25 de cenți per milion de tokens, adică minus 75%.
Pentru o firmă care rulează un asistent pe documentele proprii, asta e o schimbare mai relevantă decât orice punct de benchmark. Mai jos: ce s-a lansat, ce spun cifrele publicate, de unde vine exact reducerea și cine o încasează.
Ce s-a lansat, pe scurt
Claude Fable 5.1 este noul model de vârf al Anthropic, poziționat pentru raționament greu și pentru muncă agentică de lungă durată — sarcini care rulează zeci de pași fără ca cineva să stea în fața ecranului. A fost lansat simultan cu Claude Mythos 5.1, despre care revenim mai jos. Datele care contează la buget și la integrare:
| Parametru | Valoare |
|---|---|
| Tarif API | 10 $ / 1M tokens intrare · 50 $ / 1M tokens ieșire (identic cu Fable 5) |
| Citire din cache | 0,25 $ / 1M tokens (față de 1 $ la Fable 5) |
| Scriere în cache | 12,50 $ / 1M (5 minute) · 20 $ / 1M (1 oră) — neschimbate |
| Procesare în lot (Batch API) | 5 $ / 25 $ per 1M tokens (reducere de 50%) |
| Fereastră de context | 1 milion de tokens |
| Ieșire maximă | 128.000 de tokens per răspuns |
| Gândire | adaptivă, pornită permanent; efort implicit „high” |
| Niveluri de efort | low · medium · high · xhigh · max |
| Identificator API | claude-fable-5-1 |
| Disponibilitate | API, Claude Code, Claude Enterprise, AWS, Google Cloud, Microsoft Azure |
| Cunoștințe la zi până în | iunie 2026 |
Pentru cine folosește deja Claude prin API, trecerea înseamnă schimbarea identificatorului de model. Nu e o rescriere de integrare și nu apar parametri noi obligatorii.
De unde vine, de fapt, reducerea de 25%
Mecanismul se numește prompt caching și există de mai multă vreme la toți furnizorii mari. Ideea: partea stabilă a cererii — promptul de sistem, procedura internă, documentul de referință — se procesează o dată, se ține în memorie și, la apelurile următoare, se plătește la un tarif redus în loc de tariful integral de intrare.
Regula generală la Anthropic este că o citire din cache costă 10% din prețul de intrare. Pe Fable 5.1 și Mythos 5.1, raportul devine 2,5%. Este singura excepție din grilă și explică integral diferența anunțată: aproximativ 25% mai ieftin pe fluxurile obișnuite și până la circa 45% pe cele intens agentice.
Un calcul propriu, cu ipoteze declarate, pentru un agent intern tipic: 100.000 de tokens de context stabil (proceduri plus documentație), 20 de apeluri într-o sesiune de lucru, 2.000 de tokens de răspuns per apel.
| Componentă | Fable 5 | Fable 5.1 |
|---|---|---|
| Scriere în cache (1 dată) | 1,25 $ | 1,25 $ |
| Citiri din cache (19 apeluri) | 1,90 $ | 0,48 $ |
| Tokens de ieșire (20 × 2k) | 2,00 $ | 2,00 $ |
| Total sesiune | 5,15 $ | 3,73 $ (−27,6%) |
Se vede imediat unde e pârghia și unde nu. Ieșirea costă la fel. Prima procesare a contextului costă la fel. Scade doar repetiția — și cu cât un flux repetă mai mult, cu atât încasează mai mult din reducere.
Cifrele publicate de Anthropic
Anunțul pune accentul pe muncă agentică lungă — sarcini de tip „rezolvă asta până la capăt”, nu răspunsuri într-un singur pas. Selecția relevantă, comparativ cu Fable 5 și cu Opus 5:
| Test | Fable 5.1 | Fable 5 | Opus 5 |
|---|---|---|---|
| Terminal-Bench 4.0 (programare agentică) | 55,8% | 42,0% | 52,3% |
| Terminal-Bench-Science 0.1 (cercetare agentică) | 52,6% | 24,7% | 29,0% |
| OSWorld 2.0 — operarea unui calculator (parțial) | 77,9% | 72,9% | — |
| CursorBench 3.2.0 (programare în editor) | 73,4% | 70,5% | — |
| AutomationBench (automatizări) | 31,4% | 17,1% | — |
| GDPval-AA v2 (muncă de birou, scor Elo) | 1853 | 1723 | — |
Două observații care contează mai mult decât cifrele în sine. Prima: saltul cel mai mare nu e la programare, ci la sarcini lungi și neasistate — cercetare agentică și automatizări, unde diferența față de Fable 5 este de peste două ori. A doua: Anthropic declară explicit că modelul „rămâne lizibil” pe sarcini cu mulți pași, adică poți urmări ce a făcut. Pentru o firmă care trebuie să justifice un rezultat, trasabilitatea contează la fel de mult ca acuratețea.
Fable 5.1 sau Opus 5? Întrebarea corectă pentru un IMM
Fable 5.1 costă dublu față de Opus 5 la tariful de bază: 10 $ / 50 $ față de 5 $ / 25 $ per milion de tokens. Pe Terminal-Bench 4.0, diferența dintre ele este de 3,5 puncte procentuale. Pentru majoritatea muncii dintr-o firmă mică sau medie — clasificări, extrageri de date, redactări, răspunsuri la clienți — Opus 5 rămâne alegerea rațională, iar recomandarea Anthropic din documentație spune același lucru.
Fable 5.1 devine justificabil în trei situații concrete:
- Sarcini lungi, fără supraveghere: un agent care rulează 30–60 de minute pe un dosar și trebuie să ajungă singur la rezultat. Aici diferența de 28 de puncte la cercetarea agentică se traduce în muncă terminată versus muncă abandonată la jumătate.
- Fluxuri cu context masiv și repetat: contractul-cadru, manualul de proceduri, arhiva de spețe — trimise la fiecare apel. Aici citirea din cache la 0,25 $ inversează calculul de cost față de orice model anterior.
- Cazuri unde ai testat deja pe Opus 5 la efort ridicat și rezultatul rămâne insuficient. Aceasta este exact ordinea recomandată în documentația Anthropic: întâi Opus 5, apoi urcarea, nu invers.
Mythos 5.1 și problema refuzurilor false
Odată cu Fable 5.1, Anthropic a lansat Claude Mythos 5.1. Este, tehnic, același model, cu un alt set de mecanisme de siguranță: acces limitat, prin programe de verificare, la organizații din securitate cibernetică și științele vieții, momentan doar în Statele Unite. Pentru o firmă din România nu e o opțiune și nu are rost inclus în planuri.
Partea relevantă pentru toată lumea este alta. Anthropic raportează pe Fable 5.1 o reducere de 60% a refuzurilor false pe subiecte de securitate cibernetică și o scădere de 85% a declanșărilor pe întrebări benigne de biologie sau medicină de bază. Modelul permite acum identificarea vulnerabilităților, dar nu construirea de exploituri.
Traducerea în limbaj de firmă: dacă ai încercat vreodată să pui un model să analizeze un raport de audit IT, un jurnal de acces sau o procedură medicală internă și ai primit un refuz politicos, e exact categoria de problemă vizată aici. Refuzul fals nu e o chestiune de etică, ci de fiabilitate — un instrument care refuză imprevizibil nu poate fi pus într-un proces.
Anthropic mai anunță și un pachet de garanții pentru companii mari, cu inferență rulată în infrastructura cloud controlată de client, cu livrare eșalonată începând din toamna aceasta. Nu este disponibil azi și nu schimbă nimic pentru un IMM, dar indică direcția: separarea datelor devine argument comercial, nu doar cerință de conformitate.
La NeuroAI pornim de la un proces repetitiv din firma ta, îl mapăm și construim automatizarea potrivită — cu punctele de control uman incluse din start, nu adăugate ulterior.
Vezi cum automatizăm procese realeCe faci concret, în ordinea asta
- Verifică dacă folosești caching. Dacă în răspunsurile API nu apar tokens citiți din cache, reducerea de 75% nu te atinge deloc — plătești tarif întreg pe fiecare repetare.
- Rearanjează promptul: instrucțiunile și documentele stabile la început, datele care se schimbă la final. Este singura modificare care transformă anunțul de preț în economie reală.
- Alege durata memoriei în funcție de ritm: varianta de 5 minute costă mai puțin la scriere și se amortizează după o singură citire; cea de o oră costă dublu la scriere și are sens doar la sesiuni lungi de lucru.
- Compară pe aceleași sarcini, nu pe altele noi: rulează 2–3 fluxuri reale pe Opus 5 și pe Fable 5.1, la același nivel de efort.
- Măsoară trei lucruri: costul per sarcină, timpul până la un rezultat utilizabil și numărul de corecturi umane necesare. Al treilea e cel care decide, de obicei.
- Păstrează Fable 5.1 doar acolo unde diferența se vede în datele tale. Restul fluxurilor rămân pe modelul mai ieftin.
Un buget de test de 50–100 EUR acoperă confortabil o astfel de evaluare pentru un IMM. Costul deciziei rămâne mult sub costul unei migrări făcute pe încredere.
Concluzie
Claude Fable 5.1 nu este o schimbare de categorie. Este un model mai bun pe muncă lungă și autonomă, la un tarif identic, cu o singură modificare structurală: repetiția s-a ieftinit de patru ori.
Ca la containerele lui McLean, câștigul nu apare în prețul afișat al transportului, ci în felul în care îți împachetezi marfa. Firmele care își structurează cererile ca să reutilizeze contextul vor vedea diferența pe factură luna viitoare. Cele care trimit de fiecare dată totul de la zero vor plăti exact cât plăteau și vor rămâne convinse că anunțul era marketing.
Claude Fable 5.1 costă mai mult decât Fable 5?
Nu. Tariful de bază este identic: 10 dolari per milion de tokens de intrare și 50 de dolari per milion de tokens de ieșire, iar procesarea în lot rămâne la 5 $ / 25 $. Singura schimbare de preț este în favoarea ta: citirea din cache a scăzut de la 1 dolar la 0,25 dolari per milion de tokens.
De unde vine scăderea de 25% dacă tariful nu s-a schimbat?
Din partea repetată a cererilor. Contextul stabil — prompt de sistem, proceduri, documente de referință — se plătea până acum la 1 $ per milion de tokens la fiecare reutilizare, iar acum se plătește 0,25 $. Cu cât un flux repetă mai mult context, cu atât economia e mai mare: circa 25% pe fluxuri obișnuite și până la aproximativ 45% pe cele intens agentice.
Merită să migrez de la Opus 5 la Fable 5.1?
În majoritatea cazurilor, nu. Fable 5.1 costă dublu la tariful de bază, iar pe programare agentică diferența față de Opus 5 este de 3,5 puncte procentuale. Migrarea se justifică pentru sarcini lungi și neasistate, pentru fluxuri cu context foarte mare și repetat, sau atunci când ai testat deja pe Opus 5 la efort ridicat și rezultatul rămâne insuficient.
Ce este Claude Mythos 5.1 și îl pot folosi?
Este același model ca Fable 5.1, cu un set diferit de mecanisme de siguranță, destinat muncii din securitate cibernetică și științele vieții. Accesul se face doar prin programe de verificare și este momentan limitat la organizații din Statele Unite. Pentru o firmă din România nu este o opțiune disponibilă.
Este disponibil în România și pe ce platforme?
Da, lansarea este globală. Modelul este disponibil prin API cu identificatorul claude-fable-5-1, în Claude Code și Claude Enterprise, precum și pe Amazon Web Services, Google Cloud și Microsoft Azure. Facturarea și limitele diferă de la o platformă la alta.
30 de minute cu echipa NeuroAI: identificăm un flux repetitiv din firma ta, evaluăm dacă merită automatizat și cu ce cost. Fără obligații și fără recomandări generice.
Discutăm ce proces merită automatizat la tineNewsletter NeuroAI
AI aplicat pentru firme, de două ori pe săptămână (luni și vineri). Știri filtrate, unelte testate, fără hype.
Servicii NeuroAI relevante
Articole similare
RadarGPT-6 Sol și Luna: ce model pui pe ce sarcină, acum că prețurile au scăzut la jumătate
La mai puțin de trei săptămâni după GPT-6 Astra, OpenAI a lansat GPT-6 Sol și GPT-6 Luna: aceeași generație, prețuri API la jumătate față de modelele pe care le înlocuiesc. În aceeași zi, Anthropic a lansat Claude Opus 5.5, tot mai ieftin. Ce face fiecare model nou, unde apare în ChatGPT și de ce întrebarea utilă devine ce mărime de model îi trebuie fiecărei sarcini.
Citește articolul
RadarClaude Opus 5.5: ce face concret într-o firmă și cum îl pui într-un flux de lucru
Anthropic a lansat Claude Opus 5.5 pe 22 septembrie 2026: pe majoritatea sarcinilor lucrează la nivelul lui Claude Fable 5.1 și costă cu aproximativ 40% mai puțin de rulat decât Opus 5. Pentru o firmă, întrebarea utilă nu e cât de bun e modelul, ci în ce flux de lucru îl pui. Ce face concret, unde e limita, patru fluxuri cu care poți începe și ce trebuie să știe echipa.
Citește articolulCercetătorii Anthropic vorbesc despre extincție. Pentru firma ta contează cealaltă știre, cea din iulie
Un cercetător a demisionat, doi colegi încă angajați i-au dat dreptate, iar unul dintre ei a pus o cifră: peste 10% în următorul deceniu. Presa a comprimat asta în „extincție până în 2030”. Diferența dintre cele două formulări e exact partea care contează pentru cine ia decizii — și e umbrită de un incident real din iulie, în care un agent AI a ieșit din laborator și a spart o companie adevărată.
Citește articolul