Models
Haiku 5.5: la rebaixa s'encongeix a la nota al peu
Anthropic anuncia per a Haiku 5.5 una rebaixa mitjana de prop del 75 %. El descompte per token és del 90 % fins a 100.000 tokens i del 50 % per sobre; la mitjana també compta un tokenitzador que en consumeix més. Simon Willison va mesurar prop d'1,25 vegades més tokens en un mateix prompt llarg, una prova que no permet reconstruir la mitjana del fabricant. El model es va llançar el 7 d'octubre de 2026.
Rep el resum diari d'IA
Cada matí, l'essencial de la intel·ligència artificial al teu correu, sense fum. Al dia amb la IA.
En subscriure-t'hi acceptes rebre el butlletí d'AI Informator. Pots donar-te de baixa quan vulguis.
En resum
- Anthropic va llançar Claude Haiku 5.5 el 7 d'octubre de 2026, amb l'identificador claude-haiku-5-5. La nota diu que costa «prop d'un 75 % menys» que Haiku 4.5 de mitjana.
- El 90 % de rebaixa que ha circulat avui és a la nota al peu número 2, amb una condició: val per a peticions de fins a 100.000 tokens. Per sobre és del 50 %.
- La mitjana de prop del 75 % combina els trams de preu i el canvi de consum de tokens. Anthropic no quantifica aquest últim; Willison va mesurar prop d'1,25 vegades més en un únic prompt llarg.
- Fins a 100.000 tokens, Haiku 5.5 iguala les tarifes estàndard d'entrada i sortida de GPT-6 Luna: 0,10 i 0,50 dòlars per milió. OpenAI aplica el tram alt a Luna quan el prompt supera els 272.000 tokens d'entrada.
- Sonnet 5.5 va per davant en les set proves que publica la casa: Anthropic recomana Sonnet 5.5 i Opus 5.5 per a la programació agèntica complexa.
La rebaixa de veritat és a la nota al peu número 2
| Tram de la petició | Rebaixa respecte de Haiku 4.5 |
|---|---|
| Fins a 100.000 tokens | 90 % |
| Més de 100.000 tokens | 50 % |
| Mitjana publicada per la casa, ja amb el tokenitzador nou descomptat | al voltant del 75 % |
Anthropic va llançar Claude Haiku 5.5 el 7 d'octubre de 2026, el model petit amb què vol cobrir la feina repetitiva i de molt volum: resums, compactacions, consultes a bases de dades, classificació. A l'API es diu claude-haiku-5-5. Al cos de la nota, la casa escriu que «ara costa prop d'un 75 % menys» que Haiku 4.5 de mitjana, i d'aquí penja una crida a la nota al peu número 2.
La xifra que ha circulat avui és una altra: un 90 %. És a la mateixa nota al peu, amb una condició que ho canvia tot: val «per a peticions de fins a 100.000 tokens»; per sobre, la rebaixa és del 50 %. Per justificar la mitjana, Anthropic afegeix una dada sobre el seu propi trànsit: en Haiku 4.5, «el 90 % de les peticions queien» en el primer tram. És una mesura seva sobre si mateixa, impossible de comprovar des de fora.
El consum de tokens és un altre factor del càlcul d'aquesta mitjana, que Anthropic no desglossa del tot. La nota al peu ho diu: el càlcul «té en compte els canvis entre Haiku 4.5 i Haiku 5.5 en quants tokens s'usen per completar una mateixa feina», perquè Haiku 5.5 porta «un tokenitzador actualitzat (semblant al de Sonnet 5.5 i al d'Opus 5.5), cosa que vol dir que usa una mica més de tokens per tasca». Una mica més. La casa no hi posa xifra.
La xifra la va posar el desenvolupador Simon Willison el mateix 7 d'octubre, amb la seva eina de recompte de tokens: «el mateix prompt llarg usa prop d'1,25 vegades més tokens amb Haiku 5.5 que amb Haiku 4.5, així que aquí hi ha una pujada de preu amagada». Dues cauteles acompanyen aquest número: és un prompt llarg mesurat amb una eina seva, no la mitjana d'una càrrega real, i Anthropic només diu «una mica més». L'1,25 no és de la casa.
Quant costa el milió de tokens
| Concepte | Haiku 5.5 (≤100k / >100k) | Haiku 4.5 | Sonnet 5.5 |
|---|---|---|---|
| Lectura de memòria cau | 0,01 / 0,05 | 0,10 | 0,10 |
| Escriptura de memòria cau | 0,125 / 0,625 | 1,25 | 2,50 |
| Tokens d'entrada | 0,10 / 0,50 | 1,00 | 2,00 |
| Tokens de sortida | 0,50 / 2,50 | 5,00 | 10,00 |
La taula de preus és l'únic lloc on el 90 % es veu sencer. Per sota de 100.000 tokens, Haiku 5.5 costa una desena part del que costava Haiku 4.5 en tokens d'entrada i de sortida: 0,10 i 0,50 dòlars per milió davant d'1,00 i 5,00. Per sobre, es queda a la meitat: 0,50 i 2,50. I la lectura de memòria cau, la línia que pesa més quan treballa un agent, baixa de 0,10 a 0,01: deu vegades menys.
Aquesta és la rebaixa sobre el paper, la que es mesura per token. El que recorda la nota al peu és que ningú no compra tokens: es compra feina feta, i la feina feta ara gasta més tokens que abans. La mitjana de prop del 75 % que publica Anthropic combina aquest canvi de consum amb els dos trams de preu.
El mateix preu que Luna, fins als 100.000 tokens
| Model | Preu base | S'encareix en superar | Preu del tram alt |
|---|---|---|---|
| Haiku 5.5 | 0,10 / 0,50 | 100.000 tokens | 0,50 / 2,50 |
| GPT-6 Luna | 0,10 / 0,50 | 272.000 tokens d'entrada | 0,20 / 0,75 |
El segon tall del llançament tampoc no és a la nota d'Anthropic. L'assenyala Willison: fins a 100.000 tokens, Haiku 5.5 iguala exactament la tarifa de GPT-6 Luna, el model d'OpenAI per a tasques delimitades de molt volum. Per sobre, Haiku es multiplica per cinc. Luna també s'encareix, però molt més tard i molt menys.
Conclou, literalment: «Si les teves càrregues de feina caben en 100.000 tokens, Haiku costa el mateix que Luna i dona millors resultats als bancs de proves. Per sobre de 100.000 tokens, Luna sembla un tracte molt millor».
Per davant de Luna a les proves, per darrere de Sonnet en totes
- Haiku 5.5
- Haiku 4.5
- GPT-6 Luna
- Sonnet 5.5
Veure les dades en una taula
| OSWorld 2.1 | Terminal-Bench 4.0 | Chartography | |
|---|---|---|---|
| Haiku 5.5 | 72,4% | 39,2% | 46,4% |
| Haiku 4.5 | 15,7% | 0% | 6,4% |
| GPT-6 Luna | 48,9% | 16,4% | 29,1% |
| Sonnet 5.5 | 83,9% | 70,6% | 61,6% |
| Prova | Haiku 5.5 | Haiku 4.5 | GPT-6 Luna | Sonnet 5.5 |
|---|---|---|---|---|
| GDPval-AA v2.1 (punts) | 1620 | 735 | 1437 | 1840 |
| AA-Briefcase v1.1 (punts) | 1578 | 614 | 1336 | 1824 |
| OSWorld 2.1, subconjunt offline | 72,4 % | 15,7 % | 48,9 % | 83,9 % |
| Humanity's Last Exam, sense eines | 45,9 % | 10,2 % | — | 56,9 % |
| Humanity's Last Exam, amb eines | 57,4 % | 18,7 % | — | 64,5 % |
| Terminal-Bench 4.0 | 39,2 % | 0,0 % | 16,4 % | 70,6 % |
| FrontierCode 1.1 (Main) | 46,4 % | — | 42,4 % | 52,1 % |
| Chartography, sense eines | 46,4 % | 6,4 % | 29,1 % | 61,6 % |
Anthropic publica vuit línies de resultats sobre set proves, i convé llegir-les sabent qui les ha passat: les mesures són seves, no d'un avaluador independent. Dues proves sí que són alienes: GDPval-AA v2.1 i AA-Briefcase v1.1 són d'Artificial Analysis, una plataforma independent dels fabricants que mesura i publica índexs comparables de models d'IA —qualitat, velocitat i preu—; el seu negoci és mesurar, no vendre models.
Dues coses salten a la vista. La primera, el salt respecte de Haiku 4.5, que a Terminal-Bench 4.0 marcava un 0,0 %: no va completar cap tasca d'aquesta avaluació, segons les xifres publicades per Anthropic. La segona, que Sonnet 5.5 va per davant de Haiku 5.5 en les set proves, sense excepció.
No és un descuit de la nota: ho escriu la mateixa Anthropic. «Sonnet 5.5 i Opus 5.5 continuen sent millors opcions per a tasques complexes de programació agèntica com les que mesura Terminal-Bench 4.0», diu, i situa Haiku 5.5 en «tasques d'abast més estret» que abans sortien massa cares: compactació, resum, feina de subagent. No ve a substituir Sonnet, sinó a fer-li els encàrrecs.
La nota recull, a més, el testimoni de sis clients que van provar el model abans que sortís: xifres del client publicades pel venedor, no avaluacions independents. Asana, que ven un producte propi d'agents, diu haver vist «més d'un 30 % de reducció» en la seva latència. I HubSpot —empresa nord-americana cotitzada de programari de gestió de clients per a pimes— li dona un 92,8 % de mitjana en tres passades de la seva bateria.
El que baixa a més del preu de Haiku
| Pla | Crèdit mensual |
|---|---|
| Max 5x | 100 dòlars |
| Max 20x | 200 dòlars |
| Team | fins a 500 dòlars, repartits entre els seus usuaris |
L'anunci porta una rebaixa que no és de Haiku i és diners comptants: la lectura de memòria cau de Sonnet 5.5 costa la meitat des del 7 d'octubre. Anthropic calcula que això abarateix el model «al voltant d'un 20 %» en la major part de la feina agèntica, precisament perquè aquesta línia s'endú una part gran del consum de tokens.
Els subscriptors de pagament tenen, a més, crèdit mensual d'API per gastar en qualsevol dels seus models.
Haiku 5.5 és també el primer model de la seva família amb nivell d'esforç ajustable: cinc posicions —low, medium, high, xhigh i max— per decidir si s'optimitza el cost o la intel·ligència. El raonament no es pot desactivar i per defecte va en medium. Els SDK de Python i TypeScript de Claude estrenen en beta el control de l'ordinador i del navegador, i el model ja és disponible a Amazon Web Services, Google Cloud i Microsoft Azure.
En ciberseguretat, Anthropic descriu les salvaguardes de Haiku 5.5 com a més restrictives que les de Haiku 4.5, però una mica menys que les d'altres models recents: permeten més tasques defensives que les de Sonnet 5.5 i continuen bloquejant les proves d'intrusió.
Conclusió
Que Haiku 5.5 és molt més barat que Haiku 4.5 no es discuteix. El que es discuteix és quant, i això depèn de dues coses que no caben en un titular: quant fa el prompt i quants tokens gasta el tokenitzador nou en la mateixa feina. Fins a 100.000 tokens la tarifa per token baixa un 90 %; per sobre, un 50 %. L'estalvi per tasca depèn, a més, del consum. La mitjana de prop del 75 % és al cos de l'anunci i remet a una nota al peu que explica aquestes condicions.
Fonts primàries
- Anthropic — Introducing Claude Haiku 5.5, amb la taula de preus i la nota al peu núm. 2 (7 d'octubre de 2026) ↗
- Simon Willison — Claude Haiku 5.5: el mesurament del tokenitzador i la comparació amb GPT-6 Luna (7 d'octubre de 2026) ↗
- AI Informator — Sonnet 5.5: la meitat per token i un 28 % més per tasca ↗
- AI Informator — Cost per tasca: la tarifa per token enganya ↗
- AI Informator — Memòria cau de prompts: el preu que de debò compta ↗
- AI Informator — Sol i Sonnet, empatats a 2 i 10 dòlars ↗
- AI Informator — Anthropic i OpenAI es declaren la guerra de preus ↗
- AI Informator — Per què el mateix text costa més tokens? ↗
- OpenAI — GPT-6 Luna: tarifes estàndard i llindar de context llarg ↗
Rep el resum diari d'IA
Cada matí, l'essencial de la intel·ligència artificial al teu correu, sense fum. Al dia amb la IA.
En subscriure-t'hi acceptes rebre el butlletí d'AI Informator. Pots donar-te de baixa quan vulguis.
Comentaris