Inicio / Varios agentes y verificación adversa
Verificación adversarial, paneles de jueces y crítica de completitud
Tres roles de verificación sirven ángulos distintos y no se sustituyen entre sí: el subagente verificador solo recibe el artefacto a juzgar, los criterios de éxito y las herramientas para verificar, nunca el diagnóstico ni el historial de quien lo construyó, y su silencio solo es legítimo si de verdad buscó sin encontrar nada, ya que el sesgo por defecto ante una duda se inclina hacia el rechazo; un panel que compara varias soluciones puntuadas es una práctica extendida del sector, no un patrón que Anthropic nombre; y una crítica de completitud, patrón documentado bajo este nombre, busca exclusivamente lo que falta respecto al pliego de condiciones, nunca los errores de lo ya entregado.
Un subagente verificador, patrón documentado por Anthropic, es un agente cuya única responsabilidad es probar o validar el trabajo de otro agente. Recibe el artefacto a juzgar, criterios de éxito claros y las herramientas necesarias para verificar, sin necesidad de comprender por qué ese artefacto se construyó así, ni de conocer el diagnóstico que el autor ya sospechaba antes de lanzar la verificación.
Un informe vacío no es un informe por defecto
Un verificador que no encuentra nada puede decirlo legítimamente, pero solo si de verdad buscó y si cuenta lo que ha controlado. La consigna tipo que la documentación propone para este rol se inclina en cambio hacia el rechazo en caso de duda: ante una incertidumbre, el agente debe concluir en el rechazo antes que en el silencio. El informe vacío no es entonces una respuesta por defecto ante la incertidumbre, solo es aceptable como conclusión de una búsqueda activa y contada.
Artefacto proporcionado : export.csv, 4000 líneas
Criterios de éxito : cada línea corresponde a un pedido existente en la base de datos
Herramientas proporcionadas : lectura del csv, consulta de lectura sobre la base de datos
Informe rendido : ninguna línea divergente encontrada, 4000 líneas controladas una por una
El último campo de este ejemplo, cuatro mil líneas controladas una por una, es lo que hace creíble el informe vacío. Sin ese recuento, la misma frase no demostraría nada más que un control que nunca se ejecutó.
Panel que compara, crítica que busca lo que falta
Un panel de jueces compara varias soluciones propuestas para la misma tarea y las puntúa unas contra otras. Es una práctica extendida en el sector de la evaluación por modelo de lenguaje, pero ninguna de las dos páginas oficiales dedicadas a los sistemas multiagente nombra este patrón: el vocabulario viene del uso corriente, no de Anthropic.
Una crítica de completitud desempeña un papel distinto, documentado bajo este nombre exacto: un agente cuyo único trabajo es comparar lo que pedía el pliego de condiciones con lo que se entregó realmente, para señalar lo que falta. Nunca relee el contenido ya presente en busca de un error, ese trabajo pertenece al subagente verificador o a la revisión adversarial descrita en una premisa no verificada en un prompt vuelve en la conclusión.
Confundir estos tres roles en un mismo pipeline diluye a cada uno de ellos. Un verificador al que también se le pide comparar varias versiones pierde su sesgo útil hacia el rechazo, una crítica de completitud a la que se le pide releer el fondo pierde la única ventaja de su perímetro restringido.
Tres roles de verificación, tres ángulos distintos
| Rol de verificación | Lo que recibe | Lo que busca | Patrón nombrado por Anthropic |
|---|---|---|---|
| Subagente verificador | Artefacto, criterios de éxito, herramientas, nunca el diagnóstico | Desviaciones respecto a los criterios dados, con un sesgo hacia el rechazo en caso de duda | Sí |
| Panel de jueces | Varias soluciones propuestas para la misma tarea | La mejor solución entre las comparadas | No, práctica del sector |
| Crítica de completitud | El pliego de condiciones y el entregable final | El contenido faltante, nunca los errores ya presentes | Sí |
Una persona encarga a un verificador adversarial que controle un informe financiero de doce páginas. Adjunta el archivo y la lista de criterios de éxito a su solicitud. El verificador responde en tres frases que el informe respeta los criterios dados.
Escribe en una frase lo que esta situación establece, y en una frase lo que no establece.
Lo que esto establece: Establece que el verificador recibió el artefacto y los criterios de éxito, y que rindió una conclusión positiva en tres frases sobre el respeto de esos criterios.
Lo que esto no establece: No establece que esta conclusión sea fiable, ya que nada en la respuesta precisa cuántas páginas o líneas se controlaron efectivamente antes de llegar a este veredicto positivo.
Los tres calibrados falsos más frecuentes
- Demasiado amplio Este informe financiero respeta forzosamente el conjunto de las normas contables aplicables, ya que el verificador adversarial lo validó.
- Demasiado estrecho Esta respuesta del verificador no permite afirmar nada en absoluto, ya que un informe de doce páginas nunca puede controlarse en serio en tres frases.
- Fuera de tema Esta situación muestra sobre todo que adjuntar un archivo y una lista de criterios a una solicitud de verificación lleva menos tiempo que redactar un pliego de condiciones completo.
- Un subagente verificador solo recibe el artefacto a juzgar, los criterios de éxito y las herramientas para verificar, nunca el diagnóstico ni el historial de quien construyó el artefacto.
- Un informe vacío solo es creíble si el verificador de verdad buscó y cuenta lo que ha controlado, ya que el sesgo por defecto ante la duda se inclina hacia el rechazo.
- Un panel que compara varias soluciones puntuadas unas contra otras es una práctica extendida del sector de la evaluación, no un patrón que la documentación de Anthropic nombre.
- Una crítica de completitud compara el pliego de condiciones con el entregable para señalar lo que falta, nunca para releer el contenido ya presente en busca de un error.
- Mezclar estos tres roles en un mismo pipeline de verificación debilita a cada uno de ellos en lugar de reforzarlos.
La próxima vez que pidas una verificación adversarial, da solo el artefacto a controlar y los criterios de éxito, sin decir lo que ya sospechas, y precisa explícitamente que el controlador debe contar lo que ha verificado aunque no encuentre nada.
Estos puntos dependen de una interfaz o de una regla que puede haber cambiado desde la redacción. Verifícalos en tu propia pantalla antes de fiarte de ellos.
- Verifica si el último informe de verificación que recibiste cuenta lo que se ha controlado, o si se limita a anunciar un resultado sin ninguna cifra que lo respalde.
Cada afirmación datable de esta lección remite aquí al texto público que la respalda. Una fuente que no se abre no prueba nada.
- Anthropic, blog, construir sistemas multiagente, cuándo y cómo usarlos consultée le 2026-09-02
- Anthropic, modos de orquestación y esfuerzo durante la conversación consultée le 2026-09-02