Models

Haiku 5.5: la rebaixa s'encongeix a la nota al peu

Anthropic anuncia per a Haiku 5.5 una rebaixa mitjana de prop del 75 %. El descompte per token és del 90 % fins a 100.000 tokens i del 50 % per sobre; la mitjana també compta un tokenitzador que en consumeix més. Simon Willison va mesurar prop d'1,25 vegades més tokens en un mateix prompt llarg, una prova que no permet reconstruir la mitjana del fabricant. El model es va llançar el 7 d'octubre de 2026.

Rep el resum diari d'IA

Cada matí, l'essencial de la intel·ligència artificial al teu correu, sense fum. Al dia amb la IA.

Freqüència:

Vinyeta: un venedor sosté un globus d'Anthropic lligat a un asterisc feixuc, mentre una altra persona observa el contrapès.
📷 Imatge generada amb IA

En resum

  • Anthropic va llançar Claude Haiku 5.5 el 7 d'octubre de 2026, amb l'identificador claude-haiku-5-5. La nota diu que costa «prop d'un 75 % menys» que Haiku 4.5 de mitjana.
  • El 90 % de rebaixa que ha circulat avui és a la nota al peu número 2, amb una condició: val per a peticions de fins a 100.000 tokens. Per sobre és del 50 %.
  • La mitjana de prop del 75 % combina els trams de preu i el canvi de consum de tokens. Anthropic no quantifica aquest últim; Willison va mesurar prop d'1,25 vegades més en un únic prompt llarg.
  • Fins a 100.000 tokens, Haiku 5.5 iguala les tarifes estàndard d'entrada i sortida de GPT-6 Luna: 0,10 i 0,50 dòlars per milió. OpenAI aplica el tram alt a Luna quan el prompt supera els 272.000 tokens d'entrada.
  • Sonnet 5.5 va per davant en les set proves que publica la casa: Anthropic recomana Sonnet 5.5 i Opus 5.5 per a la programació agèntica complexa.

La rebaixa de veritat és a la nota al peu número 2

D'on surt cada percentatge
Tram de la petició Rebaixa respecte de Haiku 4.5
Fins a 100.000 tokens 90 %
Més de 100.000 tokens 50 %
Mitjana publicada per la casa, ja amb el tokenitzador nou descomptat al voltant del 75 %
Les tres xifres són d'Anthropic i surten de la mateixa pàgina: el 75 % és al cos de la nota, i el 90 % i el 50 %, a la seva nota al peu número 2. La mitjana de la casa es basa, a més, en una dada sobre el seu propi trànsit: que en Haiku 4.5 el 90 % de les peticions queien en el primer tram. L'1,25 vegades més tokens del tokenitzador nou NO és xifra d'Anthropic, que només diu «una mica més»: el va mesurar Simon Willison amb la seva eina de recompte de tokens, sobre un mateix prompt llarg.

Anthropic va llançar Claude Haiku 5.5 el 7 d'octubre de 2026, el model petit amb què vol cobrir la feina repetitiva i de molt volum: resums, compactacions, consultes a bases de dades, classificació. A l'API es diu claude-haiku-5-5. Al cos de la nota, la casa escriu que «ara costa prop d'un 75 % menys» que Haiku 4.5 de mitjana, i d'aquí penja una crida a la nota al peu número 2.

La xifra que ha circulat avui és una altra: un 90 %. És a la mateixa nota al peu, amb una condició que ho canvia tot: val «per a peticions de fins a 100.000 tokens»; per sobre, la rebaixa és del 50 %. Per justificar la mitjana, Anthropic afegeix una dada sobre el seu propi trànsit: en Haiku 4.5, «el 90 % de les peticions queien» en el primer tram. És una mesura seva sobre si mateixa, impossible de comprovar des de fora.

El consum de tokens és un altre factor del càlcul d'aquesta mitjana, que Anthropic no desglossa del tot. La nota al peu ho diu: el càlcul «té en compte els canvis entre Haiku 4.5 i Haiku 5.5 en quants tokens s'usen per completar una mateixa feina», perquè Haiku 5.5 porta «un tokenitzador actualitzat (semblant al de Sonnet 5.5 i al d'Opus 5.5), cosa que vol dir que usa una mica més de tokens per tasca». Una mica més. La casa no hi posa xifra.

La xifra la va posar el desenvolupador Simon Willison el mateix 7 d'octubre, amb la seva eina de recompte de tokens: «el mateix prompt llarg usa prop d'1,25 vegades més tokens amb Haiku 5.5 que amb Haiku 4.5, així que aquí hi ha una pujada de preu amagada». Dues cauteles acompanyen aquest número: és un prompt llarg mesurat amb una eina seva, no la mitjana d'una càrrega real, i Anthropic només diu «una mica més». L'1,25 no és de la casa.

Quant costa el milió de tokens

Preu per milió de tokens, en dòlars
Concepte Haiku 5.5 (≤100k / >100k) Haiku 4.5 Sonnet 5.5
Lectura de memòria cau 0,01 / 0,05 0,10 0,10
Escriptura de memòria cau 0,125 / 0,625 1,25 2,50
Tokens d'entrada 0,10 / 0,50 1,00 2,00
Tokens de sortida 0,50 / 2,50 5,00 10,00
Preus publicats per Anthropic, que és qui ven els models. Els dos valors de cada casella de Haiku 5.5 corresponen als seus dos trams: peticions de fins a 100.000 tokens i peticions per sobre d'aquesta mida. El 0,10 de lectura de memòria cau de Sonnet 5.5 ja és el preu rebaixat que entra en vigor amb aquest anunci: abans de l'anunci era de 0,20.

La taula de preus és l'únic lloc on el 90 % es veu sencer. Per sota de 100.000 tokens, Haiku 5.5 costa una desena part del que costava Haiku 4.5 en tokens d'entrada i de sortida: 0,10 i 0,50 dòlars per milió davant d'1,00 i 5,00. Per sobre, es queda a la meitat: 0,50 i 2,50. I la lectura de memòria cau, la línia que pesa més quan treballa un agent, baixa de 0,10 a 0,01: deu vegades menys.

Aquesta és la rebaixa sobre el paper, la que es mesura per token. El que recorda la nota al peu és que ningú no compra tokens: es compra feina feta, i la feina feta ara gasta més tokens que abans. La mitjana de prop del 75 % que publica Anthropic combina aquest canvi de consum amb els dos trams de preu.

El mateix preu que Luna, fins als 100.000 tokens

On s'encareix cadascun, en dòlars per milió de tokens (entrada / sortida)
Model Preu base S'encareix en superar Preu del tram alt
Haiku 5.5 0,10 / 0,50 100.000 tokens 0,50 / 2,50
GPT-6 Luna 0,10 / 0,50 272.000 tokens d'entrada 0,20 / 0,75
Tarifes estàndard d'Anthropic i OpenAI, per milió de tokens. OpenAI aplica a tota la petició el doble de la tarifa d'entrada i de memòria cau i 1,5 vegades la de sortida quan el prompt supera 272.000 tokens d'entrada: d'aquí surten 0,20 i 0,75 dòlars. No es comparen Batch, Flex, Fast ni recàrrecs regionals.

El segon tall del llançament tampoc no és a la nota d'Anthropic. L'assenyala Willison: fins a 100.000 tokens, Haiku 5.5 iguala exactament la tarifa de GPT-6 Luna, el model d'OpenAI per a tasques delimitades de molt volum. Per sobre, Haiku es multiplica per cinc. Luna també s'encareix, però molt més tard i molt menys.

Conclou, literalment: «Si les teves càrregues de feina caben en 100.000 tokens, Haiku costa el mateix que Luna i dona millors resultats als bancs de proves. Per sobre de 100.000 tokens, Luna sembla un tracte molt millor».

Per davant de Luna a les proves, per darrere de Sonnet en totes

Les tres proves en percentatge en què els quatre models tenen xifra
  • Haiku 5.5
  • Haiku 4.5
  • GPT-6 Luna
  • Sonnet 5.5
Haiku 5.5 · OSWorld 2.1: 72,4% Haiku 4.5 · OSWorld 2.1: 15,7% GPT-6 Luna · OSWorld 2.1: 48,9% Sonnet 5.5 · OSWorld 2.1: 83,9% OSWorld 2.1 Haiku 5.5 · Terminal-Bench 4.0: 39,2% Haiku 4.5 · Terminal-Bench 4.0: 0% GPT-6 Luna · Terminal-Bench 4.0: 16,4% Sonnet 5.5 · Terminal-Bench 4.0: 70,6% Terminal-Bench 4.0 Haiku 5.5 · Chartography: 46,4% Haiku 4.5 · Chartography: 6,4% GPT-6 Luna · Chartography: 29,1% Sonnet 5.5 · Chartography: 61,6% Chartography
Veure les dades en una taula
OSWorld 2.1Terminal-Bench 4.0Chartography
Haiku 5.5 72,4%39,2%46,4%
Haiku 4.5 15,7%0%6,4%
GPT-6 Luna 48,9%16,4%29,1%
Sonnet 5.5 83,9%70,6%61,6%
Mesures fetes i publicades per Anthropic, que és qui ven el model. OSWorld 2.1 és el subconjunt offline i Chartography es mesura sense eines. Aquí hi ha només les tres proves en percentatge en què la casa dona xifra dels quatre models. GDPval-AA v2.1 i AA-Briefcase v1.1 també tenen les quatre xifres, però es puntuen en una altra escala; aquestes dues i la resta, amb els seus buits, són a la taula.
Les set proves que publica Anthropic
Prova Haiku 5.5 Haiku 4.5 GPT-6 Luna Sonnet 5.5
GDPval-AA v2.1 (punts) 1620 735 1437 1840
AA-Briefcase v1.1 (punts) 1578 614 1336 1824
OSWorld 2.1, subconjunt offline 72,4 % 15,7 % 48,9 % 83,9 %
Humanity's Last Exam, sense eines 45,9 % 10,2 % — 56,9 %
Humanity's Last Exam, amb eines 57,4 % 18,7 % — 64,5 %
Terminal-Bench 4.0 39,2 % 0,0 % 16,4 % 70,6 %
FrontierCode 1.1 (Main) 46,4 % — 42,4 % 52,1 %
Chartography, sense eines 46,4 % 6,4 % 29,1 % 61,6 %
Mesures fetes i publicades per Anthropic, que és qui ven el model. El guió marca les caselles en què la casa no dona xifra. GDPval-AA v2.1 i AA-Briefcase v1.1 són puntuacions en una altra escala, no percentatges, i per això no entren al gràfic. La xifra de Sonnet 5.5 a FrontierCode 1.1 la dona Anthropic amb l'ajust d'esforç Xhigh.

Anthropic publica vuit línies de resultats sobre set proves, i convé llegir-les sabent qui les ha passat: les mesures són seves, no d'un avaluador independent. Dues proves sí que són alienes: GDPval-AA v2.1 i AA-Briefcase v1.1 són d'Artificial Analysis, una plataforma independent dels fabricants que mesura i publica índexs comparables de models d'IA —qualitat, velocitat i preu—; el seu negoci és mesurar, no vendre models.

Dues coses salten a la vista. La primera, el salt respecte de Haiku 4.5, que a Terminal-Bench 4.0 marcava un 0,0 %: no va completar cap tasca d'aquesta avaluació, segons les xifres publicades per Anthropic. La segona, que Sonnet 5.5 va per davant de Haiku 5.5 en les set proves, sense excepció.

No és un descuit de la nota: ho escriu la mateixa Anthropic. «Sonnet 5.5 i Opus 5.5 continuen sent millors opcions per a tasques complexes de programació agèntica com les que mesura Terminal-Bench 4.0», diu, i situa Haiku 5.5 en «tasques d'abast més estret» que abans sortien massa cares: compactació, resum, feina de subagent. No ve a substituir Sonnet, sinó a fer-li els encàrrecs.

La nota recull, a més, el testimoni de sis clients que van provar el model abans que sortís: xifres del client publicades pel venedor, no avaluacions independents. Asana, que ven un producte propi d'agents, diu haver vist «més d'un 30 % de reducció» en la seva latència. I HubSpot —empresa nord-americana cotitzada de programari de gestió de clients per a pimes— li dona un 92,8 % de mitjana en tres passades de la seva bateria.

El que baixa a més del preu de Haiku

Crèdit mensual d'API per a subscriptors
Pla Crèdit mensual
Max 5x 100 dòlars
Max 20x 200 dòlars
Team fins a 500 dòlars, repartits entre els seus usuaris
Xifres anunciades per Anthropic, que el desplega «aquesta setmana». Willison hi afegeix dos detalls pràctics: els crèdits no s'acumulen d'un mes a l'altre —«o es fan servir o es perden»— i s'activen a Configuració, Facturació, triant l'organització d'API que els rep.

L'anunci porta una rebaixa que no és de Haiku i és diners comptants: la lectura de memòria cau de Sonnet 5.5 costa la meitat des del 7 d'octubre. Anthropic calcula que això abarateix el model «al voltant d'un 20 %» en la major part de la feina agèntica, precisament perquè aquesta línia s'endú una part gran del consum de tokens.

Els subscriptors de pagament tenen, a més, crèdit mensual d'API per gastar en qualsevol dels seus models.

Haiku 5.5 és també el primer model de la seva família amb nivell d'esforç ajustable: cinc posicions —low, medium, high, xhigh i max— per decidir si s'optimitza el cost o la intel·ligència. El raonament no es pot desactivar i per defecte va en medium. Els SDK de Python i TypeScript de Claude estrenen en beta el control de l'ordinador i del navegador, i el model ja és disponible a Amazon Web Services, Google Cloud i Microsoft Azure.

En ciberseguretat, Anthropic descriu les salvaguardes de Haiku 5.5 com a més restrictives que les de Haiku 4.5, però una mica menys que les d'altres models recents: permeten més tasques defensives que les de Sonnet 5.5 i continuen bloquejant les proves d'intrusió.

Conclusió

Que Haiku 5.5 és molt més barat que Haiku 4.5 no es discuteix. El que es discuteix és quant, i això depèn de dues coses que no caben en un titular: quant fa el prompt i quants tokens gasta el tokenitzador nou en la mateixa feina. Fins a 100.000 tokens la tarifa per token baixa un 90 %; per sobre, un 50 %. L'estalvi per tasca depèn, a més, del consum. La mitjana de prop del 75 % és al cos de l'anunci i remet a una nota al peu que explica aquestes condicions.

Fonts primàries

Comentaris

Sigues respectuós. Els comentaris es moderen.

    Rep el resum diari d'IA

    Cada matí, l'essencial de la intel·ligència artificial al teu correu, sense fum. Al dia amb la IA.

    Freqüència:

    ← Torna al blog