La nota semanal

La semana en la IA agéntica: 20-25 de julio de 2026

Arkatai

Semana en la que la cadena de valor se ha movido por los dos extremos a la vez: el modelo se abarata y el laboratorio sube a vender la operación montada. Mientras tanto, el AI Act queda a una semana de su fecha más seria hasta ahora. Lo repaso con criterio de operador: qué cambia una decisión y qué es ruido.

Qué ha pasado

Anthropic ha lanzado Claude Opus 5 a mitad de precio. El viernes 24, Anthropic ha puesto en el mercado Claude Opus 5: capacidad cercana a la de su modelo tope, Fable 5, por la mitad de precio (5 dólares por millón de tokens de entrada y 25 el de salida), con un selector de esfuerzo en tres niveles para ajustar coste y profundidad según la tarea. En los benchmarks de la propia casa supera al modelo tope en 8 de las 13 pruebas publicadas.

Para una empresa que opera con agentes, lo relevante es el precio. El escalón de capacidad “suficiente para la mayoría de tareas” acaba de costar la mitad que hace un mes. Quien tiene una arquitectura que elige modelo por tarea captura esa bajada la misma semana, con una evaluación y un cambio de configuración. Quien cableó el proceso a un modelo concreto, no. La oferta de modelos para empresas se mueve a este ritmo desde hace meses y no hay señal de que vaya a parar.

OpenAI ha empezado a vender el despliegue, no solo el modelo. El miércoles 22, OpenAI ha presentado Presence, una plataforma para desplegar agentes de voz y chat en atención al cliente, ventas salientes y soporte interno, con políticas, acciones aprobadas, simulaciones y evaluaciones incluidas. No hay autoservicio: se contrata con despliegue dirigido por forward-deployed engineers del propio laboratorio e integradores seleccionados. Como referencia, OpenAI afirma que su soporte telefónico en inglés corre sobre Presence y resuelve el 75% de las llamadas sin intervención humana.

El movimiento confirma dónde se forma el mercado. El laboratorio ha subido un escalón en la cadena de valor y vende la operación desplegada, además de la inferencia. Es la tesis de service as software ejecutada por el fabricante del modelo. Para el comprador, la pregunta útil sigue siendo la de siempre: quién se queda la arquitectura operativa (reglas, excepciones, escalado, evaluaciones) y qué pasa el día que quieras sustituir el modelo de debajo. Un FDE del fabricante tiene como mandato desplegar el stack de su casa, y eso condiciona esa respuesta desde el primer día.

HubSpot ha abierto su consola de agentes. El jueves 23, beta pública de Agent Hub y Agent Builder para clientes de los planes altos: un lugar único para crear y supervisar agentes de ventas y marketing que comparten el contexto del CRM, con constructor sin código y cobro por créditos cuando el agente ejecuta acciones. El problema que dice atacar es real y lo he visto en operaciones: el agente de prospección que escribe a una cuenta la misma semana en que otro agente le está gestionando una reclamación, sin que ninguno sepa del otro.

Para la empresa mediana, la lectura es que los agentes de ventas llegan embebidos en el software que ya usa, sin proyecto de implantación. La contrapartida es el modelo de coste: pagar por acción ejecutada convierte al agente en un coste variable que hay que medir, y ese coste entra en cuánto cuesta de verdad operar con agentes, no solo en la licencia.

El AI Act llega al 2 de agosto con el calendario partido en dos. A una semana de la fecha, el cuadro queda así. Entra en vigor el artículo 50 del AI Act: avisar de que hay una IA cuando alguien habla con un agente, marcar el contenido generado y etiquetar los deepfakes. Se activan además los poderes de ejecución de la Comisión sobre los modelos de propósito general, con multas de hasta 15 millones de euros o el 3% de la facturación mundial. Y el paquete omnibus, aprobado por el Consejo el 29 de junio y pendiente solo de publicarse en el Diario Oficial, aplaza las obligaciones de alto riesgo a diciembre de 2027 y agosto de 2028. Matiz importante: el marcado técnico del contenido tiene una prórroga de cuatro meses (hasta el 2 de diciembre), pero solo para sistemas que ya estén en el mercado antes del 2 de agosto. Lo que se despliegue después marca desde el primer día.

Lo que implica el AI Act cuando operas con agentes lo desarrollo aparte. En corto, la transparencia va en serio y ya. El alto riesgo se aplaza, pero no desaparece.

Cómo leerlo desde la operación

El patrón de la semana es que el stack se comoditiza por los dos extremos. Por abajo, la capacidad de frontera envejece a utility en meses y cada bajada de precio lo confirma. Por arriba, el laboratorio y el SaaS suben a vender despliegue, control y supervisión. Lo que queda en medio, codificar tu proceso concreto con sus reglas y excepciones, sigue siendo trabajo custom y es donde se decide el resultado.

Qué importa para decidir:

  • La bajada de precio solo la captura quien puede sustituir el modelo. Opus 5 a mitad de precio vale cero si tus prompts, controles y evaluaciones están cableados a otro modelo. La agnosticidad no es una postura, es la palanca de coste.
  • Si el que despliega es el fabricante, negocia la salida antes de la entrada. Con Presence, como con cualquier despliegue dirigido por el proveedor del modelo, el contrato debe decir de quién son las reglas, las trazas y las evaluaciones cuando el acuerdo termine.
  • La transparencia del AI Act ya no tiene margen. Si un agente tuyo habla con clientes o genera contenido, la comprobación es de esta semana. La prórroga del marcado solo cubre lo que ya esté desplegado.

Qué es ruido:

  • La carrera de benchmarks entre laboratorios. Para tu proceso, el benchmark que importa es tu evaluación sobre tus casos, con tus datos y tus umbrales de error.
  • Contar agentes embebidos como si fueran plantilla digital. Un agente en beta que cobra por créditos es un coste variable por acción con supervisión pendiente de definir, no un empleado que ya trabaja.

Qué vigilar

El 2 de agosto es doble: transparencia del artículo 50 y poderes de ejecución sobre los modelos de propósito general. Queda un cabo por cerrar, y es la publicación del omnibus en el Diario Oficial, prevista antes de esa fecha: es el acto que hace jurídicamente firme el aplazamiento del alto riesgo. Si operas agentes de cara al cliente, la lista corta de la semana es concreta: aviso de IA visible, contenido marcado y el inventario de qué sistemas tuyos estaban en mercado antes del día 2, porque de eso depende la prórroga del marcado.