Salta al contingut principal
onext technology
IA 23 setembre 2026 - 10 min de lectura

Opus 5.5: què canvia de debò i per què el 40% no és la teva xifra

Anthropic va llançar Claude Opus 5.5 el 22 de setembre amb un preu un 20% més baix i un titular que diu «un 40% menys de cost». Totes dues xifres són certes i mesuren coses diferents. Què entra al teu pressupost, què canvia sense avisar i els quatre canvis que trenquen el codi que ja tens a Opus 5.

Jordi García
Tech Lead a onext
Una mà gira un comandament metàl·lic en un panell de control fosc al capvespre, com a metàfora del nivell d'esforç per defecte que canvia a Claude Opus 5.5 i que explica part de la seva reducció de cost

El 22 de setembre, Anthropic va publicar Claude Opus 5.5, el primer model de la seva família 5.5. L'anunci porta el de sempre —millors resultats en programació amb agents i feina de coneixement, més velocitat, millors auditories de seguretat— i dos números que aquell mateix dia circulaven barrejats pertot arreu: el preu baixa un 20% i el model costa un 40% menys d'executar. Molts titulars es van quedar amb el segon.

Hem llegit l'anunci, la fitxa tècnica, la pàgina de novetats i la guia de migració. El model és millor i és més barat; això no està en discussió. El que convé separar és quina part de la rebaixa és preu, quina part és eficiència i quina part és un ajust per defecte que ha canviat. I convé saber, abans de canviar una línia, que la migració des d'Opus 5 no és només canviar el nom del model.

Les xifres que circulen com si fossin una

Totes són en fonts oficials i totes són certes. El que canvia és la pregunta que respon cadascuna:

La xifra Què mesura exactament Entra tal qual al teu pressupost?
−20% de preu Preu de llista per milió de tokens: 4 $ d'entrada i 20 $ de sortida, davant de 5 $ i 25 $ d'Opus 5. L'API per lots continua a meitat de preu Sí, amb el mateix nombre de tokens
−60% en lectures de memòria cau De 0,50 $ a 0,20 $ per milió: la lectura de memòria cau passa a costar el 5% del preu d'entrada, davant del 10% habitual Sí, i pesa molt en agents amb context llarg i repetit
−40% de cost Cost d'execució «amb la configuració per defecte» i «en càrregues típiques», segons Anthropic. Inclou preu, eficiència i el canvi d'esforç per defecte No. Depèn de la teva càrrega i de la teva configuració
+30% de velocitat Genera la sortida més d'un 30% més ràpid que Opus 5 No és cost; afecta la latència i l'experiència d'ús
Menys passos i tokens per tasca Testimonis de clients: Factory iguala Opus 5 en esforç alt amb un 20-25% menys de tokens de sortida; Optiver, amb la meitat de torns, temps i tokens de sortida És una pista, no una mesura: són casos seleccionats pel fabricant

Fonts: anunci d'Anthropic i documentació de la plataforma, 22 de setembre de 2026

L'ajust que explica part del 40%

La frase exacta de l'anunci és que, amb la configuració per defecte, Opus 5.5 costarà un 40% menys que Opus 5 en càrregues típiques. La clau és a «per defecte». Opus 5.5 raona sempre, i la quantitat de raonament es regula amb un únic paràmetre, el nivell d'esforç. A Opus 5, si no s'indicava res, l'esforç era high. A Opus 5.5 és medium.

És a dir: la comparació del titular enfronta Opus 5 raonant en alt amb Opus 5.5 raonant en mitjà. És una comparació legítima —és el que li passa a qui canvia de model sense tocar res més—, però no és la comparació entre dos models en igualtat de condicions. I la documentació hi afegeix un matís en l'altra direcció: a un mateix nivell d'esforç, Opus 5.5 tendeix a raonar més per torn que Opus 5, sobretot als nivells més alts. Anthropic no ha publicat la comparació de cost entre els dos models amb el mateix esforç; la seva guia d'optimització de cost encara no inclou xifres d'Opus 5.5.

El parany pràctic: si el vostre codi no fixa l'esforç, canviar només l'identificador del model canvia dues coses alhora, el model i l'esforç. Qualsevol diferència de qualitat o de cost que veieu després s'atribuirà al model, quan pot venir de l'ajust. Fixeu l'esforç abans de migrar, i compareu amb el mateix.

Tres forces que estiren en direccions diferents

El cost d'una tasca resolta depèn del preu per token i de quants tokens consumeix la tasca. Amb Opus 5.5 es mouen totes dues coses, i no en el mateix sentit:

  • El preu baixa, un 20% en entrada i sortida i un 60% en lectures de memòria cau.
  • Els passos per tasca tendeixen a baixar. És el que expliquen els clients de l'anunci: menys torns, menys crides, menys text de farciment.
  • El raonament per torn tendeix a pujar amb el mateix nivell d'esforç, segons la mateixa documentació.

Per veure quant es mou el resultat, un exemple amb aritmètica nostra, no d'Anthropic. Un agent amb context llarg processa a cada tasca un milió de tokens d'entrada, dels quals 800.000 surten de la memòria cau, i en genera 50.000 de sortida. Amb els mateixos tokens, la tasca costa 2,65 $ a Opus 5 i 1,96 $ a Opus 5.5: un 26% menys, més que el 20% de llista, pel pes de la memòria cau. Sense memòria cau, l'estalvi es queda en el 20% exacte. I si Opus 5.5 generés un 25% més de sortida per raonar més —una hipòtesi, no una dada—, l'estalvi baixaria al 17%. Si, al contrari, resolgués la tasca en menys passos, podria superar el 40%.

Cap d'aquestes xifres no és la vostra. La vostra surt d'executar les vostres tasques amb tots dos models a l'esforç que faríeu servir en producció i dividir el que costa entre les tasques ben resoltes. És la mètrica de cost per tasca útil, i és l'única que un CFO pot pressupostar. Si aquesta conversa us sona, és perquè ja la vam tenir amb el canvi de facturació del 15 de juny: el que canvia la factura no és el preu del token, és quants en gasta cada tasca.

Quatre canvis que trenquen el codi que ja teniu

La guia de migració els enumera sense embuts. Tres retornen un error tan bon punt es desplega; el quart només si el vostre codi edita converses ja començades. N'hi ha un cinquè que no falla i per això és el més traïdor.

El canvi Què passa si no el toqueu Què s'ha de fer
El raonament no es pot desactivar Error 400 si la petició el desactiva o li fixa un pressupost manual de tokens Treure aquest camp i abaixar l'esforç on abans es desactivava per estalviar
No es pot forçar una eina Error 400 amb tool_choice de tipus any o tool, també en comptar tokens Fer servir auto amb ús estricte d'eines o sortides estructurades, i dir al prompt quan s'aplica l'eina
El raonament queda lligat al model i a la conversa Si un router o un fallback passa la conversa a un altre model, aquest continua sense el raonament anterior (excepte Fable 5.1 i Mythos 5.1). En comptes creats des del 31 d'agost, editar missatges anteriors i reenviar-los dona error 400 Converses només d'afegir, sense editar el passat; revisar la lògica d'encaminament i de fallback
L'antic computer use deixa d'acceptar-se Error 400 amb computer_20251124 a l'API de Claude i a Google Cloud (a Amazon Bedrock continua funcionant) Migrar al nou conjunt d'eines i adaptar el bucle de l'agent
Silenciós: el text entre eines canvia de lloc Cap petició no falla, però una interfície que mostrava a l'usuari el progrés entre crides a eines es queda muda Llegir aquestes notes des dels blocs de raonament i configurar-ne la visualització

Resum de la guia de migració d'Anthropic d'Opus 5 a Opus 5.5. Si feu servir Claude Managed Agents, n'hi ha prou amb canviar el nom del model

Dues coses més que no apareixen als titulars. La primera: el model porta classificadors de seguretat en més categories —biologia a més de ciberseguretat, i una de nova per a peticions que intenten extreure el seu raonament intern—. Un rebuig arriba com a resposta correcta, amb codi 200, i un motiu d'aturada propi. Si el vostre codi no el tracta, el rebuig passa per una resposta buida. La segona, per a qui dissenya arquitectures multimodel: la regla del raonament lligat al model canvia els números de l'encaminament entre models. Moure una conversa a un model més barat a mitja tasca estalvia tokens i perd context de raonament, i aquesta pèrdua no dona cap error: només es nota en la qualitat.

El que la mateixa Anthropic diu dels seus benchmarks

L'anunci inclou la taula de benchmarks de rigor, i en gairebé tots Opus 5.5 supera Opus 5 amb marge. Però porta també dues frases que mereixen més atenció que la taula, perquè les escriu el fabricant sobre el seu propi model:

  • A aquest nivell de capacitat, els marges als benchmarks guien cada vegada pitjor les diferències reals. Ho diu a propòsit de la comparació amb Fable 5.1, el seu model més capaç: la distància real és menor que la que suggereixen les puntuacions.
  • Hi ha senyals que Opus 5.5 sospita sovint que l'estan avaluant, cosa que, en paraules de l'anunci, dificulta saber com actuarà en l'enorme varietat de situacions reals.

El primer diu que la taula de l'anunci no decideix per vosaltres. El segon és més incòmode, i convé no exagerar-lo: es refereix a les avaluacions de comportament i seguretat, no a les vostres proves de producte. Però la lliçó és la mateixa que defensem a què vol dir exactament «funciona millor»: l'evidència que compta és la que surt dels vostres casos, amb les vostres dades, mesurats contra una línia base. Els testimonis de clients de l'anunci són valuosos i concrets, i alhora són els que el fabricant va triar publicar.

Com ho migraríem nosaltres

No hi ha pressa. Opus 5 passa a la categoria de model anterior, però Anthropic es compromet a no retirar-lo abans del 24 de juliol de 2027. Amb aquest marge, aquest és l'ordre que seguiríem amb una integració que ja és en producció:

  1. Fixar l'esforç a la integració actual, abans de tocar el model. Si no estava fixat, estava en high: deixeu-ho escrit. Així la comparació posterior és entre models, no entre ajustos.
  2. Buscar al codi els quatre canvis que trenquen i el tractament dels rebutjos. La guia oficial inclou una llista de comprovació, i la mateixa Anthropic ofereix una skill de Claude Code que aplica els canvis mecànics i retorna el que cal revisar a mà. Útil, sempre que algú revisi aquell diff.
  3. Executar el vostre golden set amb tots dos models, i Opus 5.5 a dos o tres nivells d'esforç. Anotar qualitat, tokens per tasca, latència i cost per tasca resolta.
  4. Triar l'esforç per tipus de tasca, no un de global. És molt probable que algunes tasques quedin igual de bé en medium o en low i que d'altres necessitin high. Aquí hi ha la major part de l'estalvi real.
  5. Moure trànsit de manera gradual, amb l'observabilitat que descrivim a el flux de LLMOps, i recalcular la línia base de cost i latència a l'esforç triat. És l'últim punt de la llista de la mateixa guia, i el que més se salta.

Res d'això no és específic d'Opus 5.5. És el que caldrà fer amb Sonnet 5.5 i Haiku 5.5, que Anthropic anuncia com a propers, i amb el que publiqui qualsevol altre laboratori el mes vinent. Els models canvien cada pocs mesos; el que dura és la manera de mesurar-los.

El que ens n'emportem

Opus 5.5 és una bona notícia per a qui treballa amb agents: més capacitat per menys diners i, segons el que expliquen els seus primers usuaris, menys voltes per arribar al mateix lloc. Però el «40% menys» no és una xifra per a un full de pressupost. És el resultat d'una configuració concreta sobre unes càrregues concretes, i la vostra pot quedar per sobre o per sota. La xifra que serveix és la que mesureu vosaltres, a l'esforç que trieu vosaltres, sobre les tasques que resoleu vosaltres. Tenir-la abans de migrar costa pocs dies. Tenir-la després sol costar una conversa incòmoda amb finances.

Preguntes freqüents

Opus 5.5 costa un 40% menys que Opus 5?

El preu de llista baixa un 20%: 4 dòlars per milió de tokens d'entrada i 20 de sortida, davant de 5 i 25. Les lectures de memòria cau baixen un 60%, de 0,50 a 0,20. El 40% és una altra xifra: Anthropic diu que, amb la configuració per defecte, Opus 5.5 costa un 40% menys que Opus 5 en càrregues típiques. Aquesta comparació inclou un canvi de configuració, perquè l'esforç per defecte va passar de high a Opus 5 a medium a Opus 5.5. El que entra al teu pressupost és el que mesuris sobre les teves tasques al nivell d'esforç que triïs.

Què és el nivell d'esforç i per què importa tant en aquesta versió?

És el paràmetre que controla quant raona el model abans de respondre, i amb això la qualitat, la latència i el cost. A Opus 5.5 és l'únic control del raonament, perquè el raonament ja no es pot desactivar. El seu valor per defecte és medium; a Opus 5 era high. Si el vostre codi no fixa l'esforç, canviar només l'identificador del model canvia dues coses alhora, el model i l'esforç, i qualsevol diferència de qualitat o de cost s'atribuirà al model quan pot venir de l'ajust.

Migrar d'Opus 5 a Opus 5.5 és només canviar el nom del model?

No, si el vostre codi fa servir alguna d'aquestes quatre coses: desactivar el raonament o fixar-li un pressupost manual, forçar l'ús d'una eina concreta amb tool_choice, l'antic computer_20251124 de computer use a l'API de Claude o a Google Cloud, o editar missatges anteriors d'una conversa que es reenvia. Les tres primeres retornen un error 400. La quarta retorna un 400 en comptes creats des del 31 d'agost de 2026. Hi ha a més un canvi silenciós: el text que el model escriu entre crides a eines arriba buit si no se'n configura la visualització.

Què passa amb els routers i els fallbacks entre models?

Cal revisar-los. El raonament d'Opus 5.5 queda lligat al model que el va produir: si un router o un fallback passa la conversa d'Opus 5.5 a un altre model, aquest model continua sense el raonament anterior, excepte Fable 5.1 i Mythos 5.1 a l'API de Claude. La petició no falla, així que no salta cap alarma: només canvia la qualitat dels torns següents. Si la vostra arquitectura encamina entre models per estalviar, aquesta pèrdua ha d'entrar a l'avaluació.

Ens podem refiar dels benchmarks de l'anunci?

Com a orientació, sí; com a decisió, no. Ho diu la mateixa Anthropic a l'anunci: amb aquest nivell de capacitat, els marges als benchmarks guien cada vegada pitjor les diferències reals, i el model mostra senyals de sospitar sovint que l'estan avaluant. Els testimonis de clients són útils però seleccionats pel fabricant. El que decideix si us convé és el vostre propi conjunt de casos, executat amb els dos models a l'esforç que faríeu servir en producció.

Per on comencem si ja tenim Opus 5 en producció?

Per fixar l'esforç explícitament a la vostra integració actual, abans de tocar el model, perquè la comparació sigui neta. Després, buscar al codi els quatre canvis que trenquen i el tractament dels rebutjos, que ara inclou categories noves. Amb això resolt, executar el vostre conjunt d'avaluació amb Opus 5.5 a dos o tres nivells d'esforç i comparar el cost per tasca resolta, no el cost per token. Només aleshores es mou trànsit real, de manera gradual. Opus 5 no es retira abans de juliol de 2027, així que no hi ha pressa.

Fonts citades

  • Anthropic — Introducing Claude Opus 5.5 (22 de setembre de 2026; preu, «40% menys amb la configuració per defecte en càrregues típiques», velocitat, benchmarks, testimonis de clients i advertiments sobre els marges dels benchmarks i la consciència d'avaluació)
  • Claude Platform — Claude Opus 5.5 (fitxa tècnica: preus, memòria cau, esforç per defecte medium, context i disponibilitat)
  • Claude Platform — What's new in Claude Opus 5.5 (canvis que trenquen, diferències de comportament i més raonament per torn amb el mateix esforç)
  • Claude Platform — Migrating to Claude Opus 5.5 (llista de comprovació, recomanacions d'esforç i nota sobre Claude Managed Agents)
  • Claude Platform — Claude Opus 5 (esforç per defecte high, preus i compromís de retirada no abans del 24 de juliol de 2027)
Jordi García
Escrit per
Jordi García
Tech Lead a onext

Jordi García és Tech Lead a onext. Treballa a portar la IA a producció governada en equips de desenvolupament i de producte —amb Spec-Driven Development, enginyeria de context i verificació humana a cada pas— i signa els insights tècnics d'onext sobre mètode, qualitat i cost de la IA aplicada.

LinkedIn →

Quant us costa avui una tasca resolta, i quant us costaria amb Opus 5.5?

Ho mesurem sobre els vostres casos: dos models, diversos nivells d'esforç i cost per tasca ben resolta. Revisem el codi contra els canvis que trenquen i deixem l'esforç triat per tipus de tasca.

Veure com treballem

Sense plataforma nova. Sense aturar lliuraments.