La mayoría de los equipos que construye un asistente o un agente de compras termina rehaciendo el mismo andamiaje: un bucle de agente, una capa de herramientas sobre el catálogo, una compuerta de aprobación y una batería de evaluaciones. Anthropic decidió publicar ese andamiaje como código.

Esta semana la empresa liberó anthropics/commerce-agents, un plano de referencia que contiene un agente de compras y un agente de comercio, junto con cuatro verticales ejecutables: retail, viajes, telecomunicaciones y entretenimiento. Se acompaña de dos textos: el anuncio de producto y un análisis técnico, A guide to the anatomy of effective commerce agents.

¿Se puede desplegar de verdad?

Sí. El repositorio está bajo licencia Apache 2.0, corre localmente con Python 3.11 o superior y Node 22 usando una clave ANTHROPIC_API_KEY, y los entornos de ejecución aceptan cualquier cliente anthropic. Eso significa que el mismo código se despliega sobre la API de Claude, Amazon Bedrock, Microsoft Foundry o Google Cloud Vertex AI, sin reescribir la lógica.

Los dos agentes

El agente de compras vive dentro de la propia aplicación del comercio. Busca en el catálogo, atiende pedidos de varios productos a la vez, compara opciones, arma el carro y responde consultas de pedidos y devoluciones dentro de la misma conversación. Una implementación concreta debe programar un StorefrontBackend sobre sus sistemas de catálogo, carro, pedidos y políticas.

El agente de comercio, en cambio, asiste al personal de la tienda: preguntas sobre rendimiento de ventas, alertas de inventario, recomendaciones de precios y promociones, y borradores de campañas. Trabaja sobre un MerchantBackend.

AgenteDestinatarioHabilidades incluidas
ComprasCliente finalsearch-discovery, purchase-research, planning-goals, customer-care, memory-personalization
ComercioPersonal de la tiendaperformance-insights, catalog-listings, inventory-operations, pricing-promotions, marketing-campaigns

Ambos corren de tres maneras, la Messages API, el Claude Agent SDK y Claude Managed Agents (en beta), a partir de una sola definición de instrucciones, habilidades, contratos de herramientas y compuertas. Un complemento de Claude Code llamado commerce-builder genera el esqueleto de un agente nuevo con /scaffold-commerce-agent o revisa uno existente con /review-commerce-agent.

Habilidades, no subagentes

La afirmación arquitectónica es la parte más aprovechable del trabajo. Anthropic argumenta en contra de un enrutador de intenciones y en contra de asignar un subagente por dominio. Una sesión de comercio es una conversación fuertemente acoplada, y cada traspaso pierde estado: el orquestador es el que sostiene el carro, las preferencias y el historial, y cada traspaso puede costar varias veces los tokens y sumar segundos de latencia. Los dominios además se superponen, porque un flujo de devolución necesita al mismo tiempo el historial de pedidos, el carro y el catálogo.

Las habilidades de agente entregan la misma modularidad sin ese costo, porque las instrucciones se cargan dentro del agente que ya tiene el historial. En varios despliegues empresariales, según Anthropic, un agente único con habilidades superó tanto al diseño de una sola instrucción gigante como al de subagentes, muchas veces con menor costo y menor latencia. Los subagentes conservan su lugar para trabajos acotados y autocontenidos, como la investigación profunda.

El reparto entre instrucción de sistema y habilidad se decide por frecuencia: lo que aparece en un tercio o más del tráfico va en la instrucción de sistema, el resto va como habilidad. Las reglas de seguridad, las restricciones de marca y los datos clave del usuario van siempre en la instrucción.

Los componentes de interfaz son herramientas

La mayoría de las respuestas de comercio son componentes visuales, no prosa. En vez de pedirle al modelo que emita etiquetas propias, el plano convierte cada componente en una herramienta, present_products, present_itinerary, present_plan_comparison, con argumentos tipados que el servidor valida antes de que el cliente los dibuje. Como esas llamadas viven de forma nativa en el arreglo de mensajes, recargar el historial no requiere ningún analizador especial, y el agente puede resolver a qué se refiere el usuario cuando dice "el primer hotel" mirando la última llamada de presentación.

Latencia, caché y memoria

Una respuesta ya dibujada consume entre 500 y 700 tokens de salida, lo que sin transmisión progresiva se traduce en unos cinco segundos de rueda girando. Anthropic separa la latencia real de la latencia percibida, y transmite los componentes a medida que se forman mientras muestra líneas de avance en lenguaje natural. El despacho anticipado de herramientas, que ejecuta cada llamada apenas terminan de llegar sus argumentos y es el comportamiento por omisión del Agent SDK, reduce esperas de varios segundos a unos pocos cientos de milisegundos.

El caché de instrucciones es la principal palanca de costo. Las solicitudes se ordenan de lo global a lo de sesión y de ahí a lo volátil, porque el caché funciona por prefijo y una marca de tiempo puesta al comienzo lo invalida en cada solicitud. Las lecturas desde caché cuestan la décima parte de los tokens frescos, escribir en el caché tiene un recargo cercano a 1,25 veces, y los mejores despliegues alcanzan tasas de acierto de 90% a 99%. La extracción de memoria corre de forma asíncrona en un proceso aparte, y Anthropic midió ahí un 13% más de recuperación de datos que con una herramienta de guardado dentro del turno.

¿Qué implica para una tienda en Chile?

El detalle práctico es que no hace falta infraestructura propia para probarlo: el repositorio corre en un computador de escritorio con Python y Node instalados, y la integración concreta se reduce a implementar las dos interfaces de backend contra el catálogo que la tienda ya tiene. Para un comercio electrónico regional, eso cambia el punto de partida, porque el trabajo deja de ser diseñar la arquitectura del agente y pasa a ser conectar el inventario y las políticas de despacho y devolución que ya existen.

La licencia Apache 2.0 permite uso comercial, modificación y redistribución con atribución, sin la cláusula de reciprocidad de una licencia copyleft. Es el mismo esquema con el que se liberan la mayoría de los marcos de trabajo corporativos, y es lo que habilita a una integradora local a construir sobre esta base sin negociar términos.

Puntos clave del anuncio

  • Plano con licencia Apache 2.0, con agente de compras y de comercio, cuatro verticales y un complemento para Claude Code.
  • Un bucle de agente único con habilidades superó a los diseños de subagentes y de instrucción única en los despliegues de Anthropic.
  • Los componentes de interfaz se entregan como herramientas tipadas, así el historial queda nativo y la disposición visual es resoluble.
  • El caché de instrucciones apunta a tasas de acierto de 90% a 99%, y los datos volátiles van al final, nunca al principio.
  • El dinero, las escrituras y los identificadores quedan controlados en el código: el modelo propone y el entorno aplica.