Cuando un agente llama a la herramienta equivocada en el tercer turno, lo único que tienes es un array plano de messages, y la pregunta que necesitas responder es qué estaba viendo el modelo en ese turno. Esta herramienta reconstruye el array en estructura de bucle: cada turno enmarca la entrada que recibió el modelo, la decisión que tomó y los resultados que le devolviste, con el emparejamiento de tool_call_id mostrado en vez de buscado. La instantánea de entrada por turno se reconstruye desde el array final según las reglas estándar de envío, no se captura del tráfico, y la herramienta lo indica en cada instantánea. Todo se analiza localmente en tu navegador.
Cuando un agente llama a la herramienta equivocada en el tercer turno, lo único que tienes es un array plano de messages, y la pregunta que necesitas responder es qué estaba viendo el modelo en ese turno. Esta herramienta reconstruye el array en estructura de bucle: cada turno enmarca la entrada que recibió el modelo, la decisión que tomó y los resultados que le devolviste, con el emparejamiento de tool_call_id mostrado en vez de buscado. La instantánea de entrada por turno se reconstruye desde el array final según las reglas estándar de envío, no se captura del tráfico, y la herramienta lo indica en cada instantánea. Todo se analiza localmente en tu navegador.
Preguntas y respuestas frecuentes sobre este tema.
Cada mensaje assistant abre un turno. Lo que vino antes es la entrada de ese turno, el propio mensaje assistant es la decisión, y los resultados de herramienta que siguen antes del próximo assistant son los resultados de ese turno. Esto refleja cómo corre el bucle en realidad: envías el historial, el modelo decide, ejecutas y devuelves, y el ciclo se repite. Las conversaciones de Anthropic llevan los resultados dentro de mensajes user en lugar de mensajes tool separados, así que cambiar el perfil de API cambia qué mensajes cuentan como resultados.
Esas plataformas están hechas para monitoreo continuo: conectas un SDK, creas una cuenta y las trazas van a sus servidores. Esta herramienta está en el lado opuesto: no toca tu runtime en absoluto. Cuando alguien pega un array en un reporte de bug, cuando sacas una conversación de un log de producción, o cuando miras la traza de un servicio que no es tuyo, no hay nada que instrumentar. Pégalo aquí y aparece la estructura del bucle, sin que nada salga de tu navegador.
No, y la herramienta lo indica en cada instantánea. Se reconstruye desde el array final con la regla estándar de que cada petición lleva el historial hasta ese punto. Los frameworks rompen esa regla con frecuencia: recortan mensajes viejos, inyectan un prefijo de sistema, reescriben descripciones de herramientas, resumen el historial. Así que trata la instantánea como la forma de la entrada, no una copia byte a byte. Si tu framework reescribe mucho, la reconstrucción muestra lo que habría enviado un cliente simple, que sigue siendo la base correcta para detectar dónde dejó de cambiar la vista del modelo.
Sí. El análisis, la segmentación de turnos y el emparejamiento se ejecutan en tu navegador: nada se sube, se almacena ni se envía a analítica. Las trazas de agentes suelen llevar datos de clientes, argumentos de herramientas internas y claves de API en los prompts de sistema, y por eso esta herramienta no tiene lado servidor. Puedes verificarlo abriendo la pestaña de red mientras pegas.