Salta al contingut principal
onext technology
IA 24 maig 2026 - 12 min de lectura

La teva factura Claude canvia el 15 de juny: la conversa FinOps que el teu CFO iniciarà (i com arribar-hi preparat)

El 15 de juny Anthropic separa els agents Claude del xat amb crèdits mensuals mirall. Els 6 controls FinOps mínims abans del switch — sense esperar l'overrun del 16 de juny.

Jordi García
Tech Lead a onext
Dos executius — CFO i CTO — en una oficina tecnològica lluminosa de Barcelona revisant dashboards de costos d'agents IA i mètriques d'ús de Claude en pantalles d'anàlisi

El 15 de juny de 2026 Anthropic canvia la manera com cobra els agents Claude. És un canvi de pricing — no un anunci de model, no una keynote, no una peça de màrqueting. Però és probablement el canvi estructural més important del trimestre per a qualsevol equip que tingui Claude Code, Agent SDK o agents Anthropic corrent en producció.

El problema no és el canvi en si. El problema és que la majoria d'equips que pagaran la diferència el 16 de juny encara no sap que té un problema.

El delta exacte del 15 de juny

A partir del 15-juny-2026, Anthropic separa l'ús programmatic de l'ús interactive en totes les seves subscripcions. La frase canònica apareix a la cobertura d'InfoWorld de l'anunci: "the direction will not vary". És un canvi que s'executa primer a Anthropic i que la resta de proveïdors frontier replicarà en 12-24 mesos.

El que canvia:

  • Claude Code en mode agent (la claude -p, headless, programmatic).
  • Claude Agent SDK complet.
  • Claude Code GitHub Actions i qualsevol integració CI/CD via SDK.
  • Apps de tercers construïdes sobre l'Agent SDK.

El que no canvia:

  • L'ús interactive de Claude Code (un humà escrivint prompts, veient respostes, iterant amb el model).
  • Claude.ai en ús de xat normal.

L'estructura del nou cobrament: cada subscripció rep un consumption pool dedicat, separat del límit de xat, amb crèdits mensuals calculats com a mirall del preu de la subscripció.

Pla Preu Crèdits programmatic/mes
Pro $20/mes $20
Max 5x $100/mes $100
Max 20x $200/mes $200
Team Standard $30/seat/mes $20/seat
Team Premium $150/seat/mes $100/seat

Els crèdits es consumeixen a tarifa API completa. Quan s'esgoten, l'agent no s'atura — però el cost surt ja de l'API billing pool, amb tarifa unitària, sense descompte de subscripció. L'equip que el 15-juny mantenia a tope una rutina headless en CI sobre un repo gran, descobreix el 16-juny que la seva factura mensual és de tres xifres per sobre del que el pla financer havia pressupostat.

Això no és un bug. És la nova normalitat.

Tres tipus d'equips arriben al 15 de juny

Quan parlem amb CTO i CFO d'empreses mid-market que ja tenen Claude en producció, veiem tres patrons clars.

Equip A — el que ja mesura per agent i per workflow. Saben quin workflow consumeix quins tokens, tenen el cost per tasca útil pressupostat, i el switch del 15-juny és un esdeveniment operatiu menor: recalibrar el pla amb el nou format de cobrament, ajustar el cap per workflow, comunicar el canvi al CFO amb dues xifres i una decisió. Temps d'adaptació: una tarda.

Equip B — el que pagava "Max 20x unlimited" com si fos il·limitat. Aquesta és la categoria més comuna. Van comprar Max 20x ($200/mes/usuari) perquè la documentació deia "alta intensitat d'ús" i van assumir que el sostre no es tocaria. El 15-juny descobriran que el sostre programmatic és exactament $200 al mes, i que una rutina headless de l'Agent SDK pot consumir aquests $200 en quatre dies. Temps d'adaptació: dues setmanes com a mínim, perquè cal mesurar abans de decidir.

Equip C — el que té rutines headless sense observabilitat. Aquí la conversa no és FinOps — és de governança bàsica. Si ningú de la teva organització et pot dir, aquesta setmana, quines rutines Agent SDK estan corrent en quin compte, contra quins repos, amb quina freqüència i quins outputs produeixen, el problema del 15-juny és secundari. Hi ha un problema previ: el teu equip està delegant execució programàtica a un model sense traçabilitat. El switch del 15-juny ho farà visible via factura. Temps d'adaptació: 4-6 setmanes — i la part cara no és la factura, és muntar l'observabilitat des de zero contra una superfície d'execució que ja està activa.

La pregunta honesta: en quina de les tres categories està el teu equip, ara mateix, sense maquillar la resposta?

Els 6 controls FinOps mínims abans del 15 de juny

Els sis controls són seqüencials — instal·lar el 3 sense l'1 i el 2 no serveix de res — i cadascun està pensat per ser executable per un equip d'1-2 persones en menys d'una setmana.

Control 1 · Mesura per agent i per workflow

Abans del 15-juny, cada workflow programàtic de la teva organització ha de tenir una etiqueta única al log d'ús d'Anthropic. No "Claude usage": etiqueta per workflow (extract-invoice-data, summarize-tickets, generate-rfp-response). Sense això, els cinc controls següents són impossibles perquè no pots assignar cost a la unitat de valor de negoci.

Test d'èxit

El teu dashboard d'ús mostra el top-10 workflows per crèdits consumits en els últims 30 dies, i un humà del teu equip sap explicar què fa cadascun.

Control 2 · Cap per workflow

Cada workflow etiquetat té un cap mensual de crèdits. Si una rutina headless de CI es dispara, no ha de consumir més del 30% del credit pool del compte sense alertar. El cap es configura al codi de l'Agent SDK (max_credits_per_run, alerting hooks) o a l'orchestrator si el fas servir.

Test d'èxit

Si demà llances una rutina mal optimitzada, el sistema et talla o t'alerta abans del 16-juny, no després.

Control 3 · Prioritat per línia de negoci

No tots els workflows valen el mateix. Un agent que genera ofertes comercials és prioritat 1; un agent que transcriu tickets de suport per a anàlisi batch és prioritat 3. El credit pool s'assigna per prioritat, no per ordre d'arribada. Quan el pool s'acabi — i s'acabarà — els workflows que s'aturen són els de baixa prioritat, no els crítics.

Test d'èxit

Cada workflow té un camp business_priority (1-3) i existeix una política documentada de què es mata primer quan el credit pool baixa del 20%.

Control 4 · Alerta de pressupost

Quan el credit pool consumeix el 50%, algú del teu equip rep una notificació. Al 75%, arriba al Slack del CTO. Al 90%, arriba al CFO amb un resum automàtic de quins workflows estan consumint i què s'aturarà si no s'aprova l'ampliació del pool. Això es munta amb un cron + script de 50 línies contra l'API de billing d'Anthropic. No és feina d'un trimestre — és d'una tarda.

Test d'èxit

El primer trimestre post-15-juny, cap factura arriba al CFO sense context previ.

Control 5 · Hedge multi-model

El canvi d'Anthropic del 15-juny no és Anthropic-específic. La frase d'InfoWorld ho diu clar: "the direction will not vary". OpenAI, Google i Microsoft separaran consumption pools en 12-24 mesos. Qualsevol organització que aposti el 100% dels seus workflows crítics a un únic proveïdor està heretant una posició fràgil: el dia que aquest proveïdor canviï el pricing (una altra vegada), tot el teu pla financer es reobre.

El hedge significa que almenys un workflow crític de la teva organització ha de ser portable a un altre model en menys d'una setmana, amb eval reproduïble que validi la qualitat equivalent. Arquitectures multi-model sobre AWS Bedrock (Claude + Llama + Mistral al mateix pipeline, amb switch de proveïdor configurable) són avui la peça més infravalorada del stack agentic enterprise.

Test d'èxit

El CTO pot dir-li al CFO, amb timeline concreta, quant costa migrar el workflow més car a un model alternatiu sense perdre qualitat.

Control 6 · Avaluació amb cost integrat

La mètrica que importa post-15-juny no és accuracy. No és velocitat. És cost per tasca útil verificada. La fórmula: crèdits consumits pel workflow dividit entre el nombre d'outputs que van passar l'eval reproduïble i es van fer servir en producció. Si el workflow consumeix $50 al mes i entrega 200 outputs útils, el cost-per-task-util és $0,25. Si consumeix $200 i entrega 100 outputs útils, és $2. La diferència entre els dos workflows no és de model — és de mètode.

Alguns workflows tindran un cost per tasca útil acceptable dins del credit pool. Altres no. Per a aquests, existeix una via alternativa: contractar l'execució del procés de negoci a un proveïdor que assumeix el risc de model i de pricing al contracte, no a la teva factura. És el model sobre el qual funciona onext Enterprise AI — preu fix per procés de negoci, arquitectura multi-model subjacent (Claude, OpenAI, Gemini sobre AWS Bedrock), sense que el canvi de pricing d'Anthropic del 15-juny ni el que vingui després afecti el que la teva organització paga.

Test d'èxit

Per a cada workflow crític, saps si et convé mantenir el meter (cost variable sota control) o passar a cost fix per procés (cost previsible delegant el risc de model).

"The direction will not vary": per què aquest canvi és estructural

Anthropic separa consumption pools al juny. OpenAI ho farà entre Q4-2026 i Q2-2027. Google seguirà. Microsoft, amb Agent 365 ja en GA, ajustarà el pricing per-agent en pròximes iteracions. En 18-24 mesos, el model "una subscripció il·limitada per a tot" deixa d'existir al frontier model market enterprise.

El que això significa estructuralment:

  • El pla financer passa d'anual a trimestral. El pressupost agentic es recalibra cada 90 dies perquè el pricing del proveïdor es mou cada 90 dies.
  • La unitat de mesura es desplaça de "usuaris" a "workflows". Pagues per workflow executat, no per seat habilitat.
  • L'arquitectura multi-model deixa de ser una decisió "per a més endavant". Passa a ser l'únic hedge real contra l'oscil·lació de pricing del proveïdor únic.
  • FinOps agentic es converteix en una disciplina pròpia, separada de FinOps cloud i FinOps SaaS. Té mètriques diferents (cost-per-task-util), instrumentació diferent (tagging per workflow), i propietari diferent — no és només el CFO, necessita un perfil mixt financer/tècnic que entengui el cost surface del model.

Si la teva organització encara no té algú amb aquest perfil, el 15-juny serà la primera factura que ensenyi per què fa falta.

La trampa silenciosa del Pro $20 + crèdits mirall

Hi ha un matís del nou pricing que ha passat desapercebut en la cobertura inicial i que mereix subratllar-se. Els crèdits mensuals són mirall exacte del preu de la subscripció: Pro $20 → $20 crèdits. La sensació immediata és de neutralitat econòmica — "pago el mateix, rebo crèdits per valor del mateix, sense sorpresa". Però l'efecte real és diferent: opera com un sostre d'ús que canvia els incentius de desenvolupament del teu equip.

Abans del 15-juny, un desenvolupador amb Max 20x podia iterar agressivament amb Claude Code sense pensar en la factura. L'incentiu era experimentar. Post-15-juny, aquest mateix desenvolupador sap que cada rutina headless agressiva acosta el moment en què el seu credit pool s'esgota i la factura entra a l'API billing. L'incentiu canvia: passa d'experimentar a optimitzar.

Per a l'equip ben organitzat, aquest canvi d'incentiu és positiu — força disciplina. Per a l'equip desorganitzat, és un fre a l'experimentació legítima en un moment on l'experimentació és l'únic camí per entendre quins workflows realment entreguen valor. La diferència entre els dos resultats la marca el mètode del teu equip per introduir agents en producció amb cost auditat des del dia u.

La mètrica post-switch que val la pena monitoritzar

Una sola mètrica: % de credit pool consumit per workflow de valor verificat. Si la teva organització consumeix $1.000 al mes en crèdits programàtics i només $300 corresponen a workflows amb valor de negoci verificable (output avaluat, usat en producció, amb impacte mesurable), el teu cost-per-task-util efectiu és $1.000/valor($300), no $1.000/output($800). El 70% de la teva factura està pagant per experimentació útil + soroll + workflows abandonats a mitges.

Està bé — sempre que sàpigues que està bé i sigui decisió conscient. L'equip que el 15-juny arriba amb aquesta mètrica configurada, arriba amb criteri. L'equip que arriba amb un pool habilitat i sense mètrica, arriba amb factura — i amb la conversa de comitè que ve al setembre quan el CFO pregunti pel run-rate.

6 controls. 1 mètrica. I la decisió, per a cada workflow crític, de si et convé el meter o el cost fix per procés.

Preguntes freqüents

Què va canviar el 15 de juny de 2026 en el cost dels agents?

Anthropic separa l'ús programàtic de l'interactiu en totes les seves subscripcions. Afecta Claude Code en mode agent, l'Agent SDK complet, les GitHub Actions i qualsevol app de tercers construïda sobre l'SDK. L'ús interactiu —una persona escrivint prompts i iterant— no canvia.

És un canvi només d'Anthropic?

S'executa primer a Anthropic, però l'article sosté que la resta de proveïdors frontier ho replicarà en 12-24 mesos. La cobertura de l'anunci ho resumeix en una frase: the direction will not vary.

Què cal tenir muntat abans que el cost es dispari?

Sis controls FinOps, i són seqüencials: instal·lar el tercer sense el primer i el segon no serveix de res. El primer és mesurar per agent i per workflow, amb una etiqueta única per flux al log d'ús — sense això, els altres cinc són impossibles perquè no pots assignar cost.

Quant costa muntar aquests controls?

Cadascun està pensat perquè un equip d'una o dues persones l'executi en menys d'una setmana. El problema no és l'esforç tècnic, és fer-ho abans que la despesa agèntica sigui invisible a la factura.

Jordi García
Escrit per
Jordi García
Tech Lead a onext

Jordi García és Tech Lead a onext. Treballa a portar la IA a producció governada en equips de desenvolupament i de producte —amb Spec-Driven Development, enginyeria de context i verificació humana a cada pas— i signa els insights tècnics d'onext sobre mètode, qualitat i cost de la IA aplicada.

LinkedIn →

El teu equip arriba al 15-juny amb els 6 controls instal·lats?

A onext acompanyem equips d'enginyeria mid-market a muntar FinOps agentic operativa abans del switch — observabilitat per workflow, hedge multi-model sobre AWS Bedrock i política de cap per línia de negoci.

Veure com treballem

Sessió de diagnòstic de la teva superfície agentic actual en menys d'una setmana.