Claude Fable 5.1: ce aduce noul model de top al Anthropic

Claude Fable 5.1 a fost lansat pe 1 septembrie 2026. Specificații, preț, ce s-a îmbunătățit față de Fable 5 și de ce Anthropic spune să începi cu Opus 5.

12 minute de lectură

Pe 1 septembrie 2026, Anthropic a lansat Claude Fable 5.1, succesorul lui Fable 5 și modelul cel mai capabil disponibil public din familia Claude. Partea neașteptată nu e nicăieri în titlul anunțului, ci în propria documentație a companiei: pentru majoritatea sarcinilor, recomandarea rămâne să începi tot cu Opus 5, un model de două ori mai ieftin. Articolul de față explică ce s-a schimbat efectiv, cât costă, unde câștigă Fable 5.1 și în ce situații plătești în plus fără să primești nimic în schimb.

Claude Fable 5.1: context de 1 milion de tokeni, 128.000 de tokeni la ieșire, 10 dolari intrare și 50 dolari ieșire per milion, cache read la 0,25 dolari

Ce este, de fapt, Claude Fable 5.1

Fable 5.1 este vârful de gamă al Anthropic: modelul pe care compania îl poziționează explicit pentru „raționament exigent și muncă agentică cu orizont lung". În API se cheamă claude-fable-5-1. Pe Amazon Bedrock apare ca anthropic.claude-fable-5-1, iar pe Google Cloud, pe Microsoft Foundry și pe Claude Platform on AWS păstrează identificatorul simplu, fără sufix de dată.

Este important să înțelegi ce fel de lansare e aceasta. Fable 5.1 nu e o generație nouă, ci o extindere a lui Fable 5, la aceleași prețuri de intrare și de ieșire. Câștigurile sunt concentrate în șase zone, potrivit documentației oficiale a modelului:

  • cod agentic în sesiuni lungi — funcționalități pe mai multe fișiere, refactorizări mari, migrări, depanare și code review în sesiuni care rulează ore;
  • muncă de birou cu documente, foi de calcul și prezentări — de la prima întrebare până la documentul finit, la foaia de calcul cu formule vii sau la deck-ul construit de la zero;
  • cercetare și căutare — acuratețe mai mare pe cercetare web în mai mulți pași, cu revenire asupra a ce a găsit;
  • vedere — grafice dense, situații financiare, tabele îngropate în PDF-uri, inclusiv cu unelte de decupare și mărire;
  • context lung — legarea detaliilor pe toată fereastra de 1 milion de tokeni;
  • computer use — operarea unui browser și a aplicațiilor de desktop, cu revenire mai bună după pași eșuați.

Performanța multilingvă rămâne la nivelul lui Fable 5 — deci pentru lucrul în română nu aștepta o diferență vizibilă doar din schimbarea modelului.

Un lucru pe care merită să îl spun devreme, pentru că economisește bani: alegerea modelului este o decizie de inginerie, nu una de marketing. Se ia pe evaluări proprii, pe sarcinile tale reale, nu pe anunțuri. Metoda — cum construiești setul de comparație, ce măsori, cum eviți concluziile trase din trei prompturi — e tratată pe larg în Comparație Modele AI 2026 (Enterprise Edition).

Specificațiile care contează

Model Contextul Ieșire maximă Preț / MTok Latență Cunoștințe până în
Claude Fable 5.1 1M 128K 10 $ / 50 $ mai lentă iunie 2026
Claude Opus 5 1M 128K 5 $ / 25 $ moderată mai 2026
Claude Sonnet 5 1M 128K 2 $ / 10 $ rapidă ianuarie 2026
Claude Haiku 4.5 200K 64K 1 $ / 5 $ cea mai rapidă februarie 2025

Câteva precizări care schimbă felul în care citești tabelul:

Fereastra de 1 milion de tokeni este și implicită, și maximă, la preț standard pe toată lungimea ei. În cifre pe care le poți folosi la estimări: 1 milion de tokeni înseamnă aproximativ 555.000 de cuvinte pe tokenizatorul actual, cel introdus odată cu Opus 4.7. Dacă vii de la un model mai vechi decât Opus 4.7, același text produce cam cu 30% mai mulți tokeni — o creștere de cost pe care o vezi în factură fără să fi schimbat nimic în prompt. Tokenizatorul lui Fable 5.1 este identic cu al lui Fable 5, deci între aceste două modele numărătoarea nu se mișcă.

Raționamentul (thinking) este mereu pornit și adaptiv. Nu îl poți dezactiva și nu îi poți fixa un buget de tokeni: și thinking: {"type": "disabled"}, și varianta veche cu budget_tokens întorc eroare 400. Singura pârghie este parametrul effort, cu valoarea implicită high și cu trepte de la low până la max.

Latența este declarată „mai lentă" decât a lui Opus 5 — un detaliu banal pe hârtie și foarte concret în produs. Dacă modelul stă în calea unui utilizator care așteaptă un răspuns pe ecran, plătești de două ori: în dolari și în percepția de lentoare.

Modelul acceptă text și imagini la intrare și produce text. Statutul lui este „activ (cel mai recent)", iar Anthropic se angajează că nu îl retrage mai devreme de 1 septembrie 2027 — un an de predictibilitate, util când planifici o integrare care nu se rescrie ușor.

Prețul: identic, cu o excepție care schimbă calculul

Fable 5.1 costă exact cât Fable 5 la intrare și la ieșire. Singura diferență este la citirile din cache — și e o diferență mare.

Poziție Preț per milion de tokeni
Intrare 10 $
Ieșire 50 $
Scriere în cache (5 minute) 12,50 $
Scriere în cache (1 oră) 20 $
Citire din cache 0,25 $
Batch API 5 $ intrare / 25 $ ieșire

Pe celelalte modele Claude, o citire din cache costă 10% din prețul de bază al intrării. Pe Fable 5.1 costă 2,5% — adică un sfert din tariful lui Fable 5 pentru exact aceeași operațiune. Lungimea minimă a promptului care se poate pune în cache rămâne 512 de tokeni, iar prețurile de scriere sunt neschimbate.

De ce contează atât de mult: într-o sesiune agentică lungă, prefixul conversației — promptul de sistem, definițiile uneltelor, primele tururi — se recitește la fiecare cerere. Acolo se duce grosul facturii, nu în textul nou. Reducerea de patru ori a citirilor din cache lovește exact partea care crește liniar cu durata sesiunii. Efectul secundar, pe care documentația îl semnalează explicit, este că strategia de a compacta devreme conversația pentru a economisi bani s-ar putea să nu mai fie compromisul corect pe Fable 5.1: contextul păstrat e acum ieftin de recitit, iar compactarea agresivă costă inteligență. Am detaliat calculul, împreună cu restul deciziilor de arhitectură pentru agenți care rulează ore, în articolul despre configurarea buclei de agent pe Fable 5.1.

Prețurile de mai sus sunt în dolari, conform grilei Anthropic pentru API-ul propriu; Amazon Bedrock și Google Cloud sunt operate de parteneri și au tarife separate.

„Pentru majoritatea sarcinilor, începe cu Opus 5"

Aceasta este, cuvânt cu cuvânt, recomandarea din documentația Anthropic, pusă chiar pe pagina de prezentare a lui Fable 5.1. Regula practică pe care o propune compania e simplă și onestă: folosește Fable 5.1 pentru raționament exigent și lucru agentic cu orizont lung, sau atunci când evaluările tale pe Opus 5, rulate la effort mai mare, tot nu ajung unde ai nevoie.

Tradus în procedură de lucru, asta înseamnă trei pași, în ordinea aceasta:

  1. Rulează sarcina reală pe Opus 5 la effort implicit și măsoară.
  2. Dacă nu trece pragul, urcă effort-ul pe Opus 5 înainte să schimbi modelul. Un model mai puternic la effort mic pierde adesea în fața unuia mai ieftin la effort mare, iar diferența de preț este de 2×.
  3. Abia apoi treci pe Fable 5.1 — și refă măsurătoarea, pentru că numele treptelor de effort nu corespund aceleiași cantități de gândire de la un model la altul.

Merită subliniat și al treilea punct al documentației: la effort medium, Fable 5.1 obține rezultate cam la nivelul lui Fable 5, dar la cost mai mic. Iar la low este adesea competitiv, pe cost per sarcină, cu modelele Opus și Sonnet, scorând totuși mai bine. Cu alte cuvinte, „modelul scump" nu se folosește obligatoriu scump. Dacă întrebarea ta e mai degrabă „Opus 5 sau vârful de gamă", am tratat comparația separat, cu tot cu argumentele de cost și de siguranță, în Claude Opus 5 vs Fable 5 și Mythos 5.

Mythos 5.1 și Project Glasswing

Odată cu Fable 5.1 apare și Claude Mythos 5.1 (claude-mythos-5-1), cu aceleași capabilități, aceleași specificații și același preț. Diferența este exclusiv de acces: Mythos 5.1 e oferit doar participanților aprobați în Project Glasswing, programul Anthropic pentru clienți selectați, iar accesul se obține prin echipa de cont Anthropic, AWS sau Google Cloud.

Există și o diferență tehnică minoră, dar relevantă pentru cine construiește un harness propriu: Mythos 5.1 nu rulează verificarea care leagă blocurile de raționament de conversația exactă în care au fost produse. Pe Fable 5.1, verificarea aceasta există și este partea care sparge cele mai multe integrări la migrare.

Ce se schimbă în comportament, fără nicio linie de cod

Chiar dacă doar schimbi identificatorul modelului, o să observi diferențe. Documentația le enumeră, iar fiecare are o soluție de prompting:

  • Apelurile paralele de unelte sunt mai variabile. În bucle de cod și de computer use, unde următoarele acțiuni sunt implicite, nu cerute explicit, modelul poate face un singur apel pe tur acolo unde Fable 5 grupa mai multe. Calitatea răspunsului nu scade, dar plătești tururi în plus.
  • Mai puține actualizări de progres în timpul rulărilor lungi de unelte, mai ales la effort mare. Pentru utilizator, agentul pare că amuțește minute întregi.
  • La effort low, răspunde mai des din memorie decât apelând o unealtă de căutare.
  • Proză mai densă pe alocuri, cu fraze mai lungi și mai puține pauze de paragraf.
  • Mai puțină formatare în chat — folosește mai rar bold, titluri și liste. Regulile anti-formatare scrise pentru modele mai vechi devin contraproductive.
  • Citate nemarcate în rezumate — când rezumă documente, reproduce mai des pasaje din sursă fără să le marcheze ca citat. Pentru orice flux editorial, e un lucru de verificat.
  • Rescrie fișiere întregi pentru modificări mici, ceea ce costă tokeni de ieșire și timp.

Niciunul dintre punctele acestea nu e un defect de calitate; toate sunt reglaje. Cine trece efectiv codul de pe Fable 5 pe Fable 5.1 are nevoie și de partea care chiar se rupe — trei schimbări incompatibile în API — pe care le-am pus, cu tot cu lista de verificare, în ghidul de migrare Fable 5 → Fable 5.1.

Ce trebuie verificat înainte de producție, într-o firmă din România

Trei aspecte au consecințe dincolo de cod.

Retenția datelor. Fable 5.1 și Mythos 5.1 vin cu retenție de 30 de zile și nu sunt disponibile în regim de zero data retention, decât cu autorizare expresă de la Anthropic. Ambele sunt „Covered Models". Dacă politica internă de protecție a datelor a fost construită pe premisa retenției zero, premisa aceasta nu se mai susține pentru modelul acesta, iar evaluarea de impact trebuie refăcută înainte, nu după.

Marcarea conținutului generat. Textul produs de Fable 5.1 poartă filigranul statistic de text al Anthropic, pe toate platformele unde modelul e disponibil. Fișierele de imagine și video pe care le produce, atunci când le iei prin Files API pe Claude API, poartă Content Credentials semnate C2PA. Filigranul nu schimbă sensul sau calitatea textului, nu adaugă tokeni ori caractere ascunse și nu conține informații despre tine sau despre organizația ta. Practic: ai un semnal de proveniență pe care nu trebuie să îl configurezi, dar care nu te scutește de obligațiile proprii de transparență — marcarea vizibilă acolo unde contextul o cere, informarea utilizatorului că interacționează cu un sistem AI, politica editorială internă. Partea de conformitate, cu obligațiile din articolul 50 al Regulamentului european privind inteligența artificială, e subiectul cursului Transparența conținutului AI (Art. 50).

Gestionarea refuzurilor. Modelul poate întoarce stop_reason: "refusal" cu HTTP 200 și un obiect stop_details care numește zona de politică declanșată. Nu ești facturat pentru un refuz care apare înainte de orice ieșire. Pentru reluare există fallback pe alt model, iar țintele permise pentru Fable 5.1 sunt Opus 4.8 și Opus 5. Dacă răspunsul tău la un refuz este „mai încearcă o dată", ai o eroare de arhitectură, nu una de model.

Cine ar trebui să se uite la Fable 5.1 și cine nu

Da, merită testat, dacă ai una dintre situațiile astea: agenți de cod care rulează ore pe repo-uri mari; cercetare în mai mulți pași, cu revenire pe surse; extragere din PDF-uri dense, grafice și situații financiare; fluxuri care produc documente, foi de calcul sau prezentări de la zero; agenți care operează un browser sau un desktop.

Nu, rămâi pe altceva, dacă: sarcina e clasificare, extragere simplă, rezumat scurt sau chat cu latență mică — acolo Haiku 4.5 și Sonnet 5 câștigă detașat pe cost și pe viteză; ai nevoie de zero data retention; sau nu ai evaluări proprii care să arate un câștig măsurabil față de Opus 5. Ultima situație este, în practică, cea mai frecventă. Cine nu are un set de evaluări nu are cum să justifice diferența de preț, iar disciplina asta — cum construiești un banc de probă înainte de a alege modelul — e primul lucru pe care îl predăm în Introducere în AI Engineering.

Întrebări frecvente

Î: Când a fost lansat Claude Fable 5.1 și cum se numește în API? R: A fost lansat pe 1 septembrie 2026. Identificatorul pe Claude API este claude-fable-5-1; pe Amazon Bedrock este anthropic.claude-fable-5-1, iar pe Google Cloud, Microsoft Foundry și Claude Platform on AWS se folosește tot claude-fable-5-1.

Î: Cât costă Fable 5.1 față de Fable 5? R: Identic la intrare (10 $/MTok) și la ieșire (50 $/MTok). Singura modificare este la citirile din cache, care scad la 0,25 $/MTok — un sfert din tariful anterior. Prin Batch API, tarifele sunt înjumătățite: 5 $ intrare și 25 $ ieșire.

Î: Merită să trec de pe Opus 5 pe Fable 5.1? R: Doar dacă evaluările tale pe sarcinile reale arată un câștig care justifică prețul dublu, iar acest lucru se verifică după ce ai urcat întâi effort-ul pe Opus 5. Documentația Anthropic recomandă explicit ca punct de plecare Opus 5 pentru majoritatea sarcinilor.

Î: Pot să dezactivez raționamentul ca să merg mai repede și mai ieftin? R: Nu. Pe Fable 5.1 raționamentul adaptiv este mereu pornit, iar încercarea de a-l dezactiva sau de a-i fixa un buget de tokeni întoarce eroare 400. Controlul se face exclusiv prin parametrul effort, iar coborârea la medium sau low este calea reală de a reduce costul și latența.

Î: Textul generat cu Fable 5.1 poate fi identificat ca fiind produs de AI? R: Da. Textul poartă filigranul statistic de text al Anthropic pe toate platformele unde modelul e disponibil, iar imaginile și videoclipurile luate prin Files API poartă Content Credentials C2PA. Filigranul nu adaugă tokeni sau caractere ascunse și nu conține date despre tine ori despre organizație.

Î: Fable 5.1 e disponibil cu zero data retention? R: Nu. Modelul are retenție de 30 de zile și nu este disponibil în regim de zero data retention decât cu autorizare expresă din partea Anthropic.

Concluzie

Fable 5.1 este o îmbunătățire reală, dar una îngustă și scumpă: câștigă acolo unde sesiunea e lungă, contextul e mare și munca e agentică, și nu câștigă aproape nimic pe sarcinile scurte, unde plătești de zece ori mai mult decât pe Sonnet 5 pentru un rezultat comparabil. Cele două cifre pe care le reții din tot articolul sunt 0,25 $ per milion de tokeni la citirea din cache — care schimbă economia sesiunilor lungi — și recomandarea Anthropic de a începe totuși cu Opus 5.

Restul e muncă de inginerie: un set de evaluări pe sarcinile tale, o măturare a treptelor de effort și o decizie luată pe cifre. Fără ele, un model de vârf e doar o factură mai mare.


Articol informativ, redactat la 1 septembrie 2026, pe baza documentației oficiale Anthropic disponibile la această dată: prezentarea modelului, noutățile din Fable 5.1 și ghidul de migrare. Prețurile, disponibilitatea pe platforme și politicile de retenție a datelor se pot modifica — verificați sursele oficiale înainte de decizii comerciale sau contractuale.

Autor

Echipa editorială Cursuri AI

Redacție dedicată AI-ului aplicat, în limba română. Actualizăm articolul când se schimbă modelele, prețurile sau legislația la care face referire.

  • Surse oficiale citate în text
  • Revizuit înainte de publicare

Cursul care continuă acest articol

Comparație Modele AI 2026 (Enterprise Edition)

  • 35 lecții
  • ~25h de conținut
  • IT Pro

Ai citit teoria. În curs o aplici: lecții structurate pe module, exerciții și quiz-uri cu feedback imediat, Profesorul AI integrat în fiecare lecție și progres salvat automat. La final primești o atestare privată de finalizare.

Din programa cursului

  1. Fundamente de Evaluare AI
  2. Modele Flagship — Giganții Industriei
  3. Challengeri și Ecosistemul Open-Weight
  4. Comparație Head-to-Head pe Use Case-uri

+ încă 7 module în programa completă

499 lei pe lună pentru acest curs, TVA 21% inclus · sau 1.999 lei pe lună pentru toate cele 25 de cursuri IT Pro.

Abonament lunar, cu reînnoire automată · anulezi oricând din contul tău · conținut digital cu acces imediat, vezi condițiile de retragere. Atestarea confirmă parcurgerea cursului și este privată — nu este diplomă și nu este calificare recunoscută de stat.

Ți-a plăcut articolul? Lasă o apreciere sau salvează-l pentru mai târziu.
Newsletter

Articole noi despre AI, o dată pe săptămână

Fără zgomot: un singur email pe săptămână, cu articolele noi și cursul asociat, când există.

Comunitate

Întrebări & sugestii

Ce au întrebat cititorii despre acest articol — și răspunsurile echipei Cursuri AI.

Mesajele sunt verificate de un moderator înainte de publicare.

Fii primul care lasă o întrebare sau o sugestie pe acest articol.

Catalogul complet

50 de cursuri AI în română, cu exerciții, quiz-uri și Profesor AI

Un curs: 499 lei pe lună · pachet Non-IT: 1.499 lei pe lună · pachet IT Pro: 1.999 lei pe lună. Toate cu TVA inclus, începutul primei lecții se citește fără cont.