Claude Haiku 5.5 vs Sonnet 5.5: preț, cost pe sarcină, ce alegi

Claude Haiku 5.5 vs Sonnet 5.5: la listă diferența e 20×; peste 100.000 de tokeni, 4×; la cache, 10× și 2×. Fișă, calcule și criteriul din date.

15 minute de lectură

Claude Haiku 5.5 vs Sonnet 5.5 este, la 8 octombrie 2026, întrebarea oricui rulează totul pe Sonnet: la preț de listă, Haiku 5.5 costă de 20 de ori mai puțin, 0,10 $ și 0,50 $ față de 2 $ și 10 $ pe milionul de tokeni. Raportul Claude Haiku 5.5 vs Sonnet 5.5 nu rămâne însă 20×: peste 100.000 de tokeni în prompt coboară la 4×, la citirile din cache la 10× și la 2×, iar pe sarcinile lungi de cod din graficul Anthropic cele două costă la fel pe încercare la effort medium. Haiku 5.5 ajunge unde sarcina e scurtă, de volum și verificabilă; pe cod agentic complex și pe fluxuri lungi cu unelte, cifrele publicate arată că nu ajunge.

Claude Haiku 5.5 vs Sonnet 5.5: prețul de listă, pragul de 100.000 de tokeni și citirea din cache

Pe scurt Haiku 5.5 Sonnet 5.5
Intrare / ieșire, pe 1M tokeni 0,10 $ / 0,50 $; peste 100.000 de tokeni în prompt, 0,50 $ / 2,50 $ 2 $ / 10 $
Citire din cache 0,01 $; peste prag, 0,05 $ 0,10 $ (0,20 $ până la 7 octombrie)
Terminal-Bench 4.0, măsurat de Anthropic 39,2 % 70,6 %

Claude Haiku 5.5 vs Sonnet 5.5: de ce comparația are sens acum

Anthropic a lansat Claude Haiku 5.5 la 7 octombrie 2026, la nouă zile după Sonnet 5.5, pentru „high-volume, latency-sensitive tasks such as classification, extraction, and routing”. Pagina de lansare a adus și o veste pentru cei rămași pe Sonnet: citirea din cache la Sonnet 5.5 costă acum 0,10 $ pe milionul de tokeni, jumătate din prețul de până atunci. Întrebarea de aici: ce poți coborî de pe Sonnet 5.5 fără o pierdere măsurabilă.

Ce nu reluăm: lansarea este în analiza Haiku 5.5; modelul mare care conduce subagenți Haiku, în Haiku 5.5 vs Opus 5.5; tot ce e de la Sonnet în sus, inclusiv advisor tool, în Sonnet 5.5 vs Opus 5.5 și Fable 5.1; fișa lui Sonnet, în articolul de lansare.

Alegerea treptei se reface la fiecare lansare: în aceeași zi a apărut un model și s-a schimbat un preț. Rămâne metoda: evaluare de la benchmark la producție, cost real după cache și Batch, rutare pe complexitate, cost și latență, lanțuri de fallback. Ea este materia cursului Comparație Modele AI 2026. Cursul a fost scris înainte de Haiku 5.5 și de Sonnet 5.5: treapta mică din exemplele lui este Haiku 4.5, la 1 $ și 5 $, iar cea mijlocie Sonnet 5.

Fișa comparativă, rând cu rând

Valori citite la 8 octombrie 2026 din pagina de prețuri și din paginile celor două modele, în dolari pe un milion de tokeni. La Haiku 5.5, a doua valoare e pentru prompturi de peste 100.000 de tokeni.

Criteriu Haiku 5.5 Sonnet 5.5
Intrare 0,10 $ · 0,50 $ 2 $
Ieșire, inclusiv thinking 0,50 $ · 2,50 $ 10 $
Citire din cache 0,01 $ · 0,05 $ 0,10 $
Scriere în cache, 5 minute 0,125 $ · 0,625 $ 2,50 $
Batch, intrare / ieșire 0,05 $ / 0,25 $ · 0,25 $ / 1,25 $ 1 $ / 5 $
Context · ieșire maximă 1M · 128.000 la fel
Thinking adaptiv; se poate opri (disabled) până la high adaptiv; minimul e between_tools; disabled întoarce 400
Effort implicit medium high
Latență, eticheta Anthropic „Fastest” „Fast”
tool_choice forțat acceptat, fără thinking eroare 400
Computer use, browser use pe Claude API și Google Cloud la fel
Limite de rată, treapta Start 1.000 de cereri și 2M tokeni de intrare pe minut aceleași, numărate separat
Platforme Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry, Claude Platform on AWS aceleași

La o mutare în jos contează două lucruri. Effort-ul implicit diferă: același cod, cu alt nume de model, rulează la alt nivel dacă nu îl setezi explicit. Iar un refuz (stop_reason: "refusal") rămâne pe Haiku 5.5 în grija clientului; Sonnet 5.5 are, în beta, fallback pe server spre Sonnet 5.

Haiku vs Sonnet la cost: raportul de preț nu e o singură cifră

Linia de preț Raport sub 100.000 de tokeni Raport peste
Intrare, ieșire, scriere în cache, Batch 20× 4×
Citire din cache 10× 2×
  • Pragul. La Haiku 5.5, potrivit paginii de prețuri, „a prompt of over 100,000 tokens pays higher prices”: fiecare linie, inclusiv ieșirea, se înmulțește cu 5, pe cerere. Sonnet 5.5 are același tarif pe tot contextul. Pagina de lansare spune că circa 90 % din cererile către Haiku 4.5 erau sub prag.
  • Ce numără pragul. Paginile citite nu spun explicit dacă tokenii citiți din cache intră în lungimea promptului. Calculele de mai jos îi numără, ca ipoteză prudentă.
  • Citirea din cache. De la 7 octombrie, Sonnet 5.5 plătește 0,05× din prețul de intrare, ca Opus 5.5; Haiku 5.5, multiplicatorul standard de 0,1×. Raportul e 10×; cu o zi înainte era 20×.
  • Tokenizerul este același. Documentația spune că Haiku 5.5 folosește „the same newer tokenizer as Claude 4.7 and later models”, deci și al lui Sonnet 5.5: același text are același număr de tokeni de intrare, iar comparația nu cere conversie.

Costul pe sarcină în trei scenarii

Scenariile țin tokenii egali la ambele modele, ca să izoleze prețul, pragul și cache-ul; în practică, ieșirea diferă, fiindcă thinking-ul se facturează ca ieșire și depinde de model și de effort. Aritmetica este verificată cu un script; rezultatele sunt valabile doar la aceste ipoteze.

Costul pe sarcină pentru Haiku 5.5 și Sonnet 5.5 în trei scenarii, cu ipotezele scrise sub grafic

1. Clasificare de volum cu prompt scurt: 18–20×

100.000 de tichete, fiecare cu 1.500 de tokeni de instrucțiuni, 400 de mesaj și 60 la ieșire.

La 100.000 de cereri Haiku 5.5 Sonnet 5.5 Raport
Fără cache 22 $ 440 $ 20×
Cu instrucțiunile citite din cache 8,50 $ 155 $ 18,2×

Batch înjumătățește ambele sume. Tipurile de sarcini candidate pentru un model din clasa de 0,10 $ sunt în articolul despre GPT-6 Luna.

2. Document de peste 100.000 de tokeni: 4×

Un dosar de 180.000 de tokeni, 2.000 de instrucțiuni și 4.000 la ieșire, într-o singură cerere, fără cache.

  • Haiku 5.5, peste prag: 182.000 × 0,50 $ + 4.000 × 2,50 $ = 0,101 $
  • Sonnet 5.5: 182.000 × 2 $ + 4.000 × 10 $ = 0,404 $

Împărțit în două cereri de câte 92.000 de tokeni, cu 2.500 la ieșire fiecare, dosarul costă 0,021 $ față de 0,418 $ (20×), dar nu mai e citit întreg. Cu dosarul în cache și 50 de întrebări de 500 de tokeni, cu 800 la ieșire, raportul ajunge la 2,7× (0,67 $ față de 1,80 $).

3. Agent cu unelte și prefix în cache: 16×, apoi 5,7×

O sesiune de 25 de pași: prefix de 12.000 de tokeni, cerere de 500, fiecare pas adaugă 2.000 de tokeni în context și produce 400 la ieșire, la mai puțin de 5 minute de pasul anterior. Rezultă 852.000 de tokeni citiți din cache, 60.500 scriși și 10.000 la ieșire: 0,021 $ pe Haiku și 0,336 $ pe Sonnet. Raportul e 16×, fiindcă citirile din cache stau la 10×. Cu prețul de citire dinainte de 7 octombrie, sesiunea costa 0,42 $ pe Sonnet: o scădere de 20 %, cât anunță Anthropic pentru munca agentică.

Dusă la 60 de pași, sesiunea ajunge la 130.500 de tokeni în context. De la pasul 45, fiecare cerere a lui Haiku trece de prag: 0,17 $ față de 0,98 $, raport 5,7×; fără prag ar fi costat 0,07 $. Pe Haiku 5.5, ținerea contextului sub 100.000 de tokeni este prima optimizare de cost.

Benchmark-uri: tabelul Anthropic și măsurătoarea independentă

Tabelul din pagina de lansare, măsurătoarea furnizorului

Redăm coloanele celor două modele. Potrivit system card-ului, rezultatele sunt la effort max, cu excepția marcată; GDPval-AA și AA-Briefcase sunt rulate de Artificial Analysis, FrontierCode de Cognition.

Evaluare Haiku 5.5 Sonnet 5.5
GDPval-AA v2.1 1.620 Elo 1.840 Elo
AA-Briefcase v1.1 1.578 Elo 1.824 Elo
OSWorld 2.1, subsetul offline 72,4 % 83,9 %
Humanity's Last Exam, fără unelte 45,9 % 56,9 %
Humanity's Last Exam, cu unelte 57,4 % 64,5 %
Terminal-Bench 4.0 39,2 % 70,6 %
FrontierCode 1.1 (Main) 46,4 % 52,1 % la xhigh; 46,2 % la max
Chartography, fără unelte 46,4 % 61,6 %

System card-ul adaugă SWE-Bench Pro, 64,8 % față de 81,3 %, și, în sens invers, ProgramBench, pe context de până la 1M tokeni, 82,0 % față de 79,7 %.

Graficele aceleiași pagini dau scorul și costul pe încercare la fiecare nivel de effort. La capătul de sus al lui Haiku, răspunsul depinde de sarcină:

Evaluare Haiku 5.5 la max Sonnet 5.5 la high
OSWorld 2.1 (offline) 72,4 % · 0,61 $ 73,2 % · 1,38 $
GDPval-AA v2.1 1.620 · 0,87 $ 1.551 · 0,62 $
Humanity's Last Exam, fără unelte 45,9 % · 0,21 $ 47,9 % · 0,08 $
Terminal-Bench 4.0 39,2 % · 2,64 $ 43,0 % · 1,46 $

Pe computer use, Haiku ajunge aproape la același scor cu 44 % din cost. Pe raționament fără unelte și pe cod în terminal, Sonnet la high e mai sus și mai ieftin; pe Terminal-Bench 4.0, la medium, cele două costă la fel pe încercare, 0,68 $, cu 20,3 % față de 28,8 %. Anthropic scrie: „Sonnet 5.5 and Opus 5.5 remain better choices for complex agentic coding tasks like those measured by Terminal-Bench 4.0.” Pagina nu descrie cum e calculat costul din grafice; system card-ul notează că, la Humanity's Last Exam, costul lui Sonnet presupune cache perfect.

Artificial Analysis: indice și cost pe sarcină, pe niveluri de effort

Artificial Analysis rulează ambele modele pe aceleași zece evaluări (Intelligence Index v4.3.2), la cele cinci niveluri; Sonnet 5.5 apare în configurația „Default Fallback”.

Effort Haiku 5.5: indice · cost pe sarcină Sonnet 5.5: indice · cost pe sarcină
low 29,4 · 0,024 $ 35,9 · 0,35 $
medium 34,5 · 0,047 $ 40,8 · 0,48 $
high 37,8 · 0,079 $ 46,8 · 0,88 $
xhigh 41,2 · 0,124 $ 51,9 · 2,01 $
max 43,4 · 0,213 $ 56,0 · 5,46 $
  • Scor. La același nivel, Sonnet are între 6,4 și 12,6 puncte în plus. La max conduce pe nouă din zece evaluări; pe AA-LCR, raționament pe context lung, sunt la egalitate, 83 %.
  • Scor egal. Haiku la xhigh (41,2) stă lângă Sonnet la medium (40,8). Peste 43,4 ajunge doar Sonnet, de la high în sus, adică de la setarea lui implicită.
  • Costul lui Haiku 5.5 este aici un minim. Artificial Analysis îl calculează integral la tariful treptei mici: în datele paginii, cei 435 de milioane de tokeni de ieșire de la max costă 217,6 $, adică 0,50 $ pe milion. Pe GDPval-AA la max arată 0,22 $ pe sarcină, iar graficul Anthropic 0,87 $; pentru Sonnet, sursele coincid (6,84 $ și 6,78 $).

Care e mai rapid: Haiku 5.5 sau Sonnet 5.5?

Etichetele Anthropic sunt „Fastest” pentru Haiku 5.5 și „Fast” pentru Sonnet 5.5. Artificial Analysis a măsurat 243 de tokeni de ieșire pe secundă față de 136 la max; pe celelalte niveluri, Haiku a generat de 1,3–1,8 ori mai repede. Viteza pe token nu e totuna cu timpul pe sarcină: la scor egal, Haiku la xhigh a avut nevoie de 291 s de generare pe sarcină, de 2,3 ori mai mult decât Sonnet la medium.

Când ajunge Haiku 5.5 și când nu: criteriul din date

Tip de sarcină Rândul de date Verdict și condiție
Clasificare, extragere, rutare, rezumate scurte destinația declarată de Anthropic; niciun rând dedicat în sursele citite Haiku 5.5 implicit, dacă setul tău de test confirmă acuratețea
Documente și context lung ProgramBench 82,0 % față de 79,7 %; AA-LCR 83 % la ambele ajunge; peste 100.000 de tokeni, avantajul de preț scade la 4×
Muncă de birou cu livrabile GDPval-AA: Haiku la max e peste Sonnet la high ajunge până la acel nivel; peste, nu
Computer use OSWorld 2.1: 72,4 % față de 83,9 %; reușită strictă 37,1 % față de 48,8 % ajunge unde o reluare e acceptabilă
Fluxuri de business cu multe unelte AutomationBench-AA: 35 % la max, sub Sonnet la low (49 %) nu ajunge
Cod agentic în terminal și în depozite mari Terminal-Bench 4.0 și SWE-Bench Pro: 31,4 și 16,5 puncte distanță nu ajunge; excepția e FrontierCode la max
Răspunsuri din cunoștințe, fără căutare AA-Omniscience: 11 față de 32 nu ajunge fără căutare sau documente în prompt

Fiecare rând e testul unui evaluator, la effort-ul ales de el; pe datele tale decide testul propriu.

Rutarea de jos în sus: Haiku 5.5 implicit, escaladare pe criterii măsurabile

1. Modelul se alege la începutul sarcinii. Rutele scurte, cu verificare automată (schemă, teste, regulă de business), pornesc pe Haiku 5.5 la medium; chatul și apelurile scurte de unelte, la low, cum recomandă documentația. Rutele cu verdictul „nu ajunge” pornesc pe Sonnet 5.5.

2. Escaladezi întâi effort-ul, până la high, apoi modelul. Ghidul de prompting al lui Haiku 5.5 cere ca xhigh și max să fie comparate cu Sonnet 5.5 la performanță, cost și viteză.

Semnal măsurabil Acțiune
Verificarea pică reîncercare pe Haiku la high
Pică din nou sau ruta ar cere xhigh ori max sarcina se reia pe Sonnet
Promptul trece de 100.000 de tokeni și nu se poate împărți refaci calculul: avantajul e 4×, nu 20×
Apelurile de unelte trec de pragul fixat din evaluări rutare directă pe Sonnet

3. Reluarea se plătește singură. În scenariul 3, totul pe Haiku, cu 30 % din sarcini reluate pe Sonnet, costă 0,12 $ pe sarcină, cu 64 % sub „totul pe Sonnet”, și rămâne mai ieftin până la 94 % reluări. Ghidul Anthropic de optimizare a costului pune două condiții: un semnal de eșec de încredere și latență dublă pe sarcinile reluate.

Implementarea routerului (clasificator, scor de complexitate, try-cheap-first, metrici de acuratețe a rutării, lanț de fallback) este în modulul de orchestrare multi-model al cursului Integrare Avansată LLM în Aplicații de Producție, scris și el înainte de Haiku 5.5.

Ce se pierde când schimbi modelul în mijlocul conversației

  • Cache-ul. „Prompt caches are per-model”, spune documentația: un context de 60.000 de tokeni se scrie din nou pe Sonnet cu 0,15 $, cât șapte sesiuni din scenariul 3 pe Haiku.
  • Blocurile de thinking, într-un singur sens. Potrivit paginii Preserved thinking, Sonnet 5.5 citește blocurile lui Haiku 5.5 pe Claude API și pe Google Cloud, deci acolo escaladarea păstrează raționamentul. Invers nu: blocurile lui Sonnet 5.5 le citește doar Opus 5.5. Un bloc necitibil e eliminat de API fără eroare și fără semnal, dacă nu trimiți header-ul beta thinking-binding-controls-2026-08-01.

Protocol de test pe sarcinile tale

  1. Alege 30–50 de sarcini din loguri, fiecare cu verificarea scrisă dinainte. Include cea mai grea zecime: ghidul Anthropic cere compararea pe coada distribuției, nu pe sarcina tipică.
  2. Renumără prompturile cu model setat pe claude-haiku-5-5 și marchează-le pe cele de peste 100.000 de tokeni.
  3. Rulează Haiku 5.5 la low, medium și high și Sonnet 5.5 la medium și high, cu effort explicit, fiecare nivel în sesiune separată.
  4. Păstrează usage complet, timpul de răspuns și refuzurile; calculează costul pe sarcină reușită, cu tariful corect pentru fiecare cerere.
  5. Decide după o regulă scrisă înainte de rezultate, de exemplu: „ruta coboară dacă rata de reușită e la cel mult două puncte sub Sonnet și cea mai grea zecime nu pică”.

Construcția setului (golden dataset, rubrici, model-judecător calibrat) și poarta de evaluare la schimbarea modelului sunt materia cursului AI Evals pentru LLM-uri în Producție; varianta scurtă, în cum evaluezi un model AI înainte de producție.

Ce alegi: cinci situații concrete

  1. Clasificare, triere, extragere din texte scurte. Haiku 5.5 la low sau medium, prin Batch dacă nu așteaptă nimeni.
  2. Asistent de suport cu baza de cunoștințe în cache. Haiku, cât timp prefixul stă sub 100.000 de tokeni.
  3. Întrebări repetate pe un document de peste 100.000 de tokeni. Raportul scade spre 2–3×: dacă documentul trebuie citit întreg, decide calitatea, nu prețul.
  4. Agent de cod în sesiuni lungi sau automatizare cu multe unelte. Sonnet. Haiku rămâne pentru pașii pe care îi numește Anthropic: compactare, rezumare, subagenți.
  5. Rute amestecate. Haiku implicit, reluare pe Sonnet la eșec verificat. Ce depășește și Sonnet urcă mai departe, după regulile din articolul despre treptele de sus.

Întrebări frecvente

Care este diferența dintre Claude Haiku 5.5 și Sonnet 5.5? Haiku 5.5 este modelul mic, pentru volum și latență, la 0,10 $ și 0,50 $ pe milionul de tokeni. Sonnet 5.5 costă 2 $ și 10 $ și are scoruri mai mari pe toate rândurile din tabelul paginii de lansare, cel mai clar pe Terminal-Bench 4.0: 70,6 % față de 39,2 %.

Cât costă Haiku 5.5 față de Sonnet 5.5? De 20 de ori mai puțin la intrare și la ieșire și de 10 ori mai puțin la citirea din cache, cât timp promptul are cel mult 100.000 de tokeni. Peste prag, rapoartele scad la 4× și 2×.

Care e mai rapid, Haiku 5.5 sau Sonnet 5.5? Haiku 5.5: Artificial Analysis a măsurat 243 de tokeni pe secundă față de 136 la effort max. Pe sarcină, avantajul dispare dacă urci effort-ul lui Haiku ca să egalezi scorul lui Sonnet.

Au Haiku 5.5 și Sonnet 5.5 aceeași fereastră de context? Da: 1M tokeni de context și 128.000 la ieșire pe amândouă. Diferă prețul: Haiku 5.5 costă de cinci ori mai mult pe cererile cu prompt de peste 100.000 de tokeni.

Consumă Haiku 5.5 mai mulți tokeni decât Sonnet 5.5? La intrare, nu: tokenizerul e același. La ieșire, în măsurătorile Artificial Analysis, Haiku 5.5 a produs la effort medium 32.800 de tokeni pe sarcină față de 20.900 și la max 162.000 față de 197.000.

Concluzie

Între Claude Haiku 5.5 și Sonnet 5.5, lista de prețuri spune 20×. La același consum de tokeni, raportul rămâne 18–20× pe prompturi scurte, coboară la 16× cu mult cache și la 4× peste 100.000 de tokeni. Benchmark-urile publicate arată o distanță mică pe documente și context lung și una mare pe cod agentic și pe fluxuri cu multe unelte. De aici, regula: Haiku implicit pe rutele scurte și verificabile, effort până la high, reluare pe Sonnet la eșec măsurat. Care rute coboară arată doar testul pe sarcinile tale.

Surse

Articol redactat la 8 octombrie 2026. Scorurile provin de la Anthropic și de la Artificial Analysis; nu am rulat modelele. Calculele de cost folosesc volume de tokeni ipotetice, declarate în text. Cursuri-AI.ro este furnizor de cursuri plătite, deci parte interesată.

Autor

Echipa editorială Cursuri AI

Redacție dedicată AI-ului aplicat, în limba română. Actualizăm articolul când se schimbă modelele, prețurile sau legislația la care face referire.

  • Surse oficiale citate în text
  • Revizuit înainte de publicare

Cursul care continuă acest articol

Comparație Modele AI 2026 (Enterprise Edition)

  • 35 lecții
  • ~25h de conținut
  • IT Pro

Ai citit teoria. În curs o aplici: lecții structurate pe module, exerciții și quiz-uri cu feedback imediat, Profesorul AI integrat în fiecare lecție și progres salvat automat. La final primești o atestare privată de finalizare.

Din programa cursului

  1. Fundamente de Evaluare AI
  2. Modele Flagship — Giganții Industriei
  3. Challengeri și Ecosistemul Open-Weight
  4. Comparație Head-to-Head pe Use Case-uri

+ încă 7 module în programa completă

499 lei pe lună pentru acest curs, TVA 21% inclus · sau 1.999 lei pe lună pentru toate cele 25 de cursuri IT Pro (vezi ce înveți în tot parcursul).

Abonament lunar, cu reînnoire automată · anulezi oricând din contul tău · conținut digital cu acces imediat, vezi condițiile de retragere. Atestarea confirmă parcurgerea cursului și este privată — nu este diplomă și nu este calificare recunoscută de stat.

Ți-a plăcut articolul? Lasă o apreciere sau salvează-l pentru mai târziu.
Newsletter

Cele mai recente articole despre AI, pe email

Primești pe loc cele mai recente trei articole și cursul asociat, când există, apoi cel mult trei emailuri în următoarele două săptămâni. Te dezabonezi oricând.

Comunitate

Întrebări & sugestii

Ce au întrebat cititorii despre acest articol — și răspunsurile echipei Cursuri AI.

Mesajele sunt verificate de un moderator înainte de publicare.

Fii primul care lasă o întrebare sau o sugestie pe acest articol.

Catalogul complet

50 de cursuri AI în română, cu exerciții, quiz-uri și Profesor AI

Un curs: 499 lei pe lună · pachet Non-IT: 1.499 lei pe lună · pachet IT Pro: 1.999 lei pe lună. Toate cu TVA inclus, începutul primei lecții se citește fără cont.