Salta al contingut principal
onext technology
IA 17 abril 2026 - 12 min de lectura

SDD + Agentic Orchestration: la combinació que tanca el gap d'Anthropic Managed Agents

Anthropic acaba de resoldre la capa d'infraestructura dels agents IA. El que la mateixa documentació deixa en mans de l'equip — prompts, eines, context strategy i guardrails — és exactament el que Spec-Driven Development estandarditza. Aquesta és l'arquitectura que connecta les dues capes.

Jordi Garcia
Tech Lead a onext
Dos arquitectes de programari col·laborant en una oficina moderna amb llum natural càlida revisant un diagrama d'especificacions connectat amb fluxos d'orquestració agèntica en una pantalla gran

El 8 d'abril de 2026 Anthropic va llançar Claude Managed Agents. No és un model nou. És una capa d'infraestructura que resol tres problemes que fins ara cada equip havia de muntar pel seu compte: sandboxing, orquestració i sessions persistents.

La reacció immediata de bona part de l'ecosistema va ser tractar-ho com una drecera. "Ja no necessito construir la meva pròpia orchestration layer." Això és cert. Però amaga la pregunta que de veritat importa: què passa amb tot el que Managed Agents explícitament no resol?

La mateixa documentació d'Anthropic és transparent en aquest punt. El servei és "intencionadament no opinat" sobre prompt engineering, definició d'eines, estratègia de context, guardrails i modes de fallada de l'agent. Això segueix sent responsabilitat de l'equip. I aquest "això" és precisament on moren avui la majoria d'agents en producció.

Aquí és on Spec-Driven Development deixa de ser una metodologia entre d'altres i es converteix en la capa de política que Managed Agents necessita per no ser una drecera per trencar agents més ràpid.

El moment actual de l'orquestració agèntica

Dades del llançament de Claude Managed Agents i adopció enterprise 2026

8 abr llançament Claude Managed Agents (beta)
~60% menys latència típica al primer token
>90% menys latència en els pitjors casos al primer token
5 responsabilitats que segueixen en mans de l'equip
95% pilots IA sense impacte mesurable en P&L (MIT)
18m → 76d col·lapse de rearquitectures quan SDD entra en joc

El que Anthropic acaba de resoldre

Claude Managed Agents descompon l'agent en tres components independents i els ofereix com a servei gestionat:

🧠
Brain — Claude + harness

Inferència i orquestració stateless. Decideix quina eina fer servir, quan i amb quins inputs. Anthropic ho gestiona per tu.

Hands — sandboxes i eines

Entorns d'execució aïllats. Claude invoca execute(name, input). Els contenidors només s'aixequen quan es fan servir, per això el temps al primer token en els pitjors casos cau més d'un 90%.

💾
Session — log d'esdeveniments persistent

Historial durable fora de la finestra de context. Permet reprendre agents amb wake(sessionId) i sostenir execucions llargues sense perdre estat.

Aquesta arquitectura és elegant. Desacobla el raonament de l'execució de la mateixa manera que els sistemes operatius van desacoblar el programari del maquinari dècades enrere. El que importa per a un CTO és que ara tens una infraestructura llesta per a producció sense haver-la de construir. Latència més baixa, recuperació automàtica davant de fallades, escalat many-to-many i sessions llargues sense desbordar el context.

Per als equips que fa mesos que enganxen amb cinta sessions a Redis, aixecant contenidors a mà i apedaçant l'orquestració entre agents, això és un salt real.

El que és important entendre: Managed Agents resol la capa d'infraestructura. No resol la capa de decisió. Confondre les dues és exactament l'error que fa que el 95% dels pilots d'IA enterprise no generi impacte mesurable en P&L, segons l'estudi del MIT que citem a per què la majoria de projectes amb LLM fracassen.

El que Managed Agents explícitament no resol

Llegint la documentació oficial amb atenció, Anthropic enumera cinc coses que segueixen sent responsabilitat de l'equip que desplega l'agent:

1 Prompt engineering

El harness és agnòstic a les instruccions específiques que li dones a Claude. Si el teu prompt és genèric, el teu agent és genèric — amb o sense Managed Agents al darrere.

2 Definició d'eines (tools, MCP)

Quines eines exposes a l'agent, amb quin contracte i amb quina semàntica segueix sent disseny teu. Managed Agents les invoca; no les pensa per tu.

3 Context strategy

Quan comprimir l'historial, quan resumir, quins esdeveniments conservar. La persistència existeix; decidir què fer-ne és teu.

4 Guardrails i polítiques de scope

Què pot i què no pot fer l'agent, quina validació s'aplica abans d'una acció destructiva, quins circuit breakers l'aturen. Managed Agents no opina — i no ho hauria de fer.

5 Modes de fallada i criteris d'acceptació

Com saps si l'output de l'agent compleix la intenció original del negoci. Si no ho defineixes, l'agent compleix el prompt — però no necessàriament la tasca.

Aquestes cinc responsabilitats són les que separen un agent que "funciona en demo" d'un agent que genera impacte mesurable en producció. I són exactament les que SDD estandarditza.

Per què SDD és la capa de metodologia que falta

Spec-Driven Development, com expliquem en detall a Spec-Driven Development: IA en codi controlat, no és una eina. És una manera d'elevar l'especificació a font de veritat per sobre del codi i, en aquest context, per sobre del prompt.

Quan mapeges les cinc responsabilitats que Managed Agents deixa a l'equip contra els components de SDD, la superposició és gairebé perfecta.

Mapatge SDD → Responsabilitats que Managed Agents deixa a l'equip

Constitució del projecte Guardrails, regles immutables, scope d'eines
Templates d'especificació Prompts estructurats, criteris d'acceptació, contractes de tools
Playbook de prompts Prompt engineering reutilitzable i versionat
Flux de code review per a IA Validació d'outputs, modes de fallada, criteris de qualitat
Context engineering Quins esdeveniments conservar, què comprimir, quina metadata propagar

La lectura operativa és directa: l'equip que fa servir Managed Agents sense una capa d'especificació estructurada està construint sobre la millor infraestructura disponible però sense arquitectura. Funciona fins que no funciona. I quan deixa de funcionar, el debugging en un log d'esdeveniments persistent d'un workflow multi-etapa sense criteris de qualitat explícits és exactament el tipus de problema que consumeix mesos.

És el mateix principi que desenvolupem a multi-stage workflows IA 2026: la qualitat del workflow depèn de la qualitat de l'especificació inicial i del context que flueix entre fases. El model és secundari. La plataforma és secundària. El que marca la diferència és l'arquitectura del procés.

Arquitectura combinada: SDD com a policy layer, Managed Agents com a execution layer

La manera neta de pensar aquesta combinació és separar dues capes que avui la majoria d'equips barreja sense adonar-se'n:

Policy layer

SDD — Spec-Driven Development

Defineix què ha de fer l'agent, sota quines regles i com es valida.

  • Constitució: regles immutables del projecte
  • Templates: specs, criteris d'acceptació, contractes de tools
  • Playbook: prompts versionats i auditables
  • Review flow: validació d'outputs contra la spec

La spec es tradueix en prompts, tools i guardrails

Execution layer

Claude Managed Agents (o alternativa)

Executa el com: sandboxing, orchestration, sessions persistents i recuperació davant de fallades.

  • Brain: harness d'inferència i decisió
  • Hands: sandboxes d'execució i tools
  • Session: log durable i represa
  • Scaling: multi-agent i many-to-many

Aquesta separació té un benefici pràctic important: et protegeix del vendor lock-in.

Una de les crítiques més serioses al llançament de Managed Agents és que la migració no és trivial. Les dades de sessió viuen en infraestructura d'Anthropic, el format del harness és específic de Claude i moure un agent productiu a una altra plataforma implica refer l'orchestration layer.

Si el teu policy layer viu en especificacions versionades, contractes de tools definits en format estàndard i criteris d'acceptació auditables, la capa d'execució es torna substituïble. Managed Agents avui, una altra plataforma demà, un desplegament on-premise amb el teu propi harness quan tinguis un compliance que ho exigeixi. La spec no canvia. El que canvia és només el motor.

L'insight estratègic: els equips que adoptin Managed Agents sense una capa d'especificació paguen dues vegades — una vegada pel lock-in tècnic, una altra pel lock-in metodològic. Els equips que l'adoptin amb SDD per sobre capturen el benefici de la infraestructura sense quedar-hi lligats.

Tres casos on aquesta combinació canvia el ROI

L'abstracte s'entén millor amb casos concrets. Tres patrons on la combinació SDD + Managed Agents canvia materialment el que un equip mid-market pot lliurar.

1. Code-to-deployment autònom amb punts de control

L'agent rep una spec del producte, la descompon en pla, genera el codi, llança els tests, obre el PR i espera validació humana abans del merge. Avui, construir això amb orquestració pròpia implica 6-8 setmanes de plumbing. Amb Managed Agents, el plumbing desapareix. El que queda és la spec, els criteris de review i els guardrails: exactament SDD.

Sense SDD: l'agent improvisa a cada fase, el review es torna un coll d'ampolla humà i el ROI es dilueix en retreball. Amb SDD: l'agent opera dins de límits explícits, el review valida contra criteris auditables i l'equip sosté -75% de temps per feature com a benchmark realista.

2. Processament documental amb validació de negoci

Legal o finances reben contractes, factures o expedients. Un agent extreu, classifica, valida i alimenta els sistemes interns. Managed Agents et dona la sessió persistent i la invocació d'eines de lectura, OCR i escriptura a l'ERP. SDD et dona els criteris de quins camps són crítics, quines excepcions requereixen intervenció humana i com es valida la qualitat de l'output.

Sense una spec del negoci, l'agent fa el que tècnicament li demanes — però el resultat no és fiable per a un departament regulat. Amb una spec, la validació humana es concentra en les excepcions que importen.

3. Agents interns de producte que creuen dominis

El research alimenta un PRD, el PRD genera stories, les stories determinen criteris d'acceptació, els criteris arriben a l'agent d'implementació. Un pipeline així, amb Managed Agents, és senzill de muntar. Sense SDD, produeix artefactes que semblen complets però no connecten amb la intenció original del producte. Amb SDD, cada fase hereta el context estructurat de l'anterior i la traçabilitat arriba fins a la spec arrel.

Lectura relacionada: si aquesta narrativa connecta amb el teu stack, a context engineering: la disciplina per a equips amb IA desenvolupem el bloc tècnic de com flueix el context entre fases, i a multi-stage workflows IA 2026 els tres patrons de workflow agèntic que apareixen consistentment en implementacions reals.

Com començar: stack mínim SDD + orchestration en 30 dies

Si estàs avaluant Managed Agents per a un cas d'ús concret, l'error més car no és trigar massa a adoptar-lo. És adoptar-lo abans de tenir la capa d'especificació resolta. L'ordre correcte és:

1
Setmana 1 · Escriure la constitució del cas d'ús

Regles immutables: què pot fer l'agent, què no, quines eines pot invocar, quines dades toca, quines accions requereixen aprovació humana. Això es tradueix en configuració de scope de tools a Managed Agents.

2
Setmana 2 · Definir templates d'especificació per fase

Quin input espera cada fase, quin output produeix, quins criteris d'acceptació s'apliquen. El template és el contracte que l'agent ha de complir.

3
Setmana 3 · Connectar el playbook de prompts al harness

Els prompts deixen de ser text ad hoc i passen a ser artefactes versionats al repo. Cada prompt referencia la spec que el respalda. Managed Agents els executa però no els inventa.

4
Setmana 4 · Observabilitat i review loop

Cada execució deixa traça al session log i es valida contra els criteris del template. El que falla alimenta la següent iteració de la spec, no del prompt. Així l'aprenentatge s'acumula iteració rere iteració.

Aquest stack mínim és reproduïble. No requereix una transformació organitzativa completa per començar — sí que requereix que algú de l'equip prengui la responsabilitat explícita de sostenir les specs com a font de veritat. És exactament el rol que un Centre d'Excel·lència d'IA compleix quan es dissenya bé, i és el nucli d'onext AI-Accelerated Development: la nostra metodologia per industrialitzar el desenvolupament amb IA combinant SDD, context engineering i govern d'agents en un sol sistema.

Per què aquesta finestra és curta

Managed Agents no és el final de la cursa. És el principi d'una nova fase. La propera iteració del producte inclourà coordinació multi-agent i autoavaluació, avui en research preview. Quan aquestes capacitats entrin en GA, els equips que no tinguin resolta la capa d'especificació desplegaran agents que es coordinen entre si i s'autoavaluen sobre criteris que ningú ha escrit de manera estructurada. El resultat serà un tipus de deute agèntic que avui encara no hem vist a escala.

La bona notícia: el mercat encara no està educat. Pocs vendors estan posicionant explícitament SDD com la capa de política sobre una plataforma d'orquestració. Thoughtworks va incloure SDD al Technology Radar però no l'ha connectat amb plataformes d'orquestració. McKinsey parla d'orquestració però no de spec-driven. Anthropic proporciona la plataforma però és "intencionadament no opinada" sobre com la governes. El gap metodològic segueix obert.

Els equips que cobreixin aquest gap abans que el tanqui el mercat només podran dir, d'aquí a 12 mesos, que van arribar primers a la combinació que ja s'ha tornat estàndard. Els que no, pagaran la factura d'una infraestructura brillant sobre una metodologia improvisada.

Managed Agents et dona el motor. SDD et dona el volant. Conduir sense volant no és anar més ràpid — és anar enlloc, més ràpid.

Fonts principals: "Claude Managed Agents overview" (Anthropic Docs, abr 2026), "Scaling Managed Agents: Decoupling the brain from the hands" (Anthropic Engineering, abr 2026), "Anthropic's Claude Managed Agents gives enterprises a new one-stop shop but raises vendor lock-in risk" (VentureBeat), "Agentic coding at enterprise scale demands spec-driven development" (VentureBeat), "Spec-Driven Development — Adoption at Enterprise Scale" (InfoQ), "The 95% problem" (MIT NANDA / State of AI in Business 2026).

Lectura complementària: Spec-Driven Development: IA en codi controlat | Multi-stage workflows IA 2026 | Context Engineering: la disciplina per a equips amb IA | Agents IA en producció: el gap de qualitat

Metodologia onext: onext AI-Accelerated Development és la metodologia amb què els Centres d'Excel·lència d'IA d'onext implementen SDD com a policy layer sobre plataformes d'orquestració agèntica (Managed Agents, LangGraph, desplegaments propis) perquè la migració entre motors sigui substituïble i el control de l'agent quedi en mans de l'equip. Sense paralitzar lliuraments.

Estàs avaluant Managed Agents o una plataforma d'orquestració agèntica?

En 30 minuts diagnostiquem quin cas d'ús està llest per a agentic orchestration i dissenyem la capa de SDD que el sosté. Amb infraestructura substituïble i control de l'equip. Sense paralitzar lliuraments.

Veure com treballem

12 equips transformats. 0 sprints perduts.