El blog de Deska

El patrón de la segunda opinión: Un agente revisa a otro

Descubre cómo el patrón de la segunda opinión mejora la fiabilidad de los LLM usando un agente para revisar el código de otro en un espacio de trabajo lateral.

· 10 min de lectura

El patrón de la segunda opinión es un marco de trabajo de fiabilidad donde un agente autónomo revisa el resultado de otro agente para verificar la corrección e identificar posibles casos límite. En el panorama actual del desarrollo asistido por IA, un solo modelo a menudo no logra detectar sus propias alucinaciones o brechas arquitectónicas porque opera dentro de las mismas restricciones probabilísticas que generaron el error. Al introducir un modelo diferente o una nueva instancia del mismo modelo como crítico, los desarrolladores pueden capturar errores antes de que lleguen a la etapa de ejecución.

La arquitectura de la verificación por agentes

El desarrollo de software tradicional depende de las revisiones de código realizadas por humanos para garantizar la calidad. El patrón de la segunda opinión replica esta dinámica al tratar al primer agente como creador y al segundo como revisor. Esto funciona mejor cuando los dos agentes tienen acceso al mismo contexto pero utilizan diferentes prompts subyacentes o rutas de razonamiento.

Cuando un agente primario genera una solicitud de extracción o una función compleja, el agente secundario evalúa la lógica frente a un conjunto de restricciones. Estas restricciones pueden incluir estándares de seguridad, eficiencia de rendimiento o el cumplimiento de las convenciones existentes del proyecto. Este proceso de varios pasos reduce la posibilidad de fallos silenciosos donde el código se ejecuta pero introduce errores sutiles.

Diferenciación de modelos críticos

Elegir al revisor adecuado es esencial para el éxito de este patrón. Si ambos agentes utilizan el mismo modelo, podrían compartir los mismos sesgos. El uso de modelos diversos, como Claude Code para la generación y Codex CLI para la revisión, puede proporcionar una perspectiva más amplia sobre el código.

  1. El agente generador se enfoca en resolver el problema inmediato y pasar las pruebas unitarias.
  2. El agente revisor se enfoca en los casos límite y los olores de código (code smells).
  3. El orquestador (el desarrollador) toma la decisión final basada en la revisión.

Implementación del patrón en un lienzo infinito

Monitorear múltiples agentes simultáneamente es difícil en una interfaz de pestañas estándar. El cambio de contexto entre diferentes terminales o ventanas de chat a menudo conduce a una comprensión fragmentada. Aquí es donde un espacio de trabajo de lienzo infinito se convierte en una ventaja técnica.

En Deska, puedes organizar tu espacio de trabajo para que el generador y el revisor estén uno al lado del otro. Al colocar coding agents en paneles adyacentes, puedes observar cómo el agente primario escribe código en una terminal mientras el agente secundario analiza el archivo en otra. Esta disposición espacial te permite detectar discrepancias de inmediato sin tener que navegar entre pestañas.

Gestión visual del flujo de trabajo

Utilizando el lienzo de Deska, puedes alejar el zoom para ver todo el pipeline. Puedes tener un panel ejecutando un widget de navegador para monitorear registros, un segundo panel con una terminal ejecutando Claude Code y un tercer panel donde Ask Deska te ayuda a gestionar la interacción entre ellos. Este diseño asegura que sigas siendo el orquestador de alto nivel en lugar de un operador manual de copiar y pegar.

Comparación de estrategias multiagente

Diversas herramientas abordan la coordinación de agentes de manera diferente. A continuación, se presenta una comparación de cómo diferentes entornos manejan los flujos de trabajo de agentes de alta densidad.

CaracterísticaIDEs con pestañasSolo CLILienzo de Deska
Visibilidad de agentesOculta en pestañasSalida secuencialPaneles laterales
Persistencia de contextoRestringida al focoHistorial limitadoHistorial visible
Comparación de modelosDifícil de alinearCambio manualPaneles simultáneos
Control de recursosBasado en pluginsBasado en procesosBasado en paneles terminals

Mientras que los IDEs con pestañas son excelentes para la codificación enfocada, a menudo tienen dificultades cuando necesitas observar a dos agentes autónomos interactuar en tiempo real. El enfoque del lienzo permite una vista persistente tanto del actor como del crítico.

Seguridad y ejecución local primero

Una preocupación importante con el patrón de la segunda opinión es la exposición de código fuente sensible a múltiples proveedores externos. Un enfoque local-first garantiza que, incluso cuando múltiples agentes analizan tus archivos, el código permanezca en tu máquina.

Deska mantiene tus archivos, sesiones de terminal y entornos locales contenidos dentro de tu hardware. Cuando usas la aplicación mobile para monitorear estos agentes, la conexión se establece a través de un relé seguro sin exponer puertos. Esto es crítico cuando se ejecutan agentes que tienen la autoridad para modificar archivos o ejecutar comandos. Puedes alejarte de tu escritorio de forma segura mientras tu agente revisor termina su auditoría, verificando el estado final desde tu teléfono.

Configuración del agente revisor

Un agente revisor exitoso necesita un prompt de sistema específico. En lugar de decirle al agente que escriba código, debes indicarle que actúe como un Ingeniero de Seguridad Senior o un Arquitecto de Rendimiento.

  • Instruye al revisor para que busque excepciones no controladas.
  • Pide al agente que compruebe si el nuevo código viola algún patrón existente en la estructura de code-git-files.
  • Usa la terminal para canalizar la salida del primer agente directamente a un archivo de texto, y luego haz que el segundo agente lea ese archivo como su entrada.

Técnicas avanzadas de lienzo

Para proyectos más complejos, el patrón de la segunda opinión puede expandirse a un panel de expertos. Podrías tener tres paneles diferentes: uno para el código, uno para las pruebas unitarias y otro para la documentación.

Puedes usar paneles de notes para llevar un registro de las críticas proporcionadas por diferentes agentes. Esto crea un registro permanente de las decisiones de diseño tomadas durante la sesión. Si el agente revisor señala una posible fuga de memoria, puedes guardar esa nota justo al lado del panel del editor de código para referencia futura.

Gestión de créditos de IA y tokens

Ejecutar múltiples agentes puede ser costoso si no se gestiona correctamente. El uso del modelo BYOK te permite usar tus propias claves de API, dándote control total sobre qué modelo usas para cada tarea. Podrías usar un modelo de razonamiento superior y más caro para el primer borrador y un modelo más rápido y económico para el análisis inicial y la revisión.

Desafíos comunes con las revisiones de agentes

Las revisiones automatizadas no son una solución mágica. Los agentes aún pueden ponerse de acuerdo en una solución errónea si el prompt inicial es engañoso. Esto se conoce como error de consenso. Para mitigar esto, asegúrate de que tus agentes primarios y secundarios se inicien con instrucciones diferentes.

Otro desafío es la gestión de hilos de agentes largos. A medida que la conversación crece, la ventana de contexto puede desordenarse. Usar los agent-threads de manera efectiva significa saber cuándo limpiar el historial y comenzar una nueva sesión de revisión para evitar confundir al modelo con información desactualizada.

FAQ

¿Cómo ejecuto dos agentes uno al lado del otro?

Puedes abrir múltiples paneles de terminals o de agentes dentro del espacio de trabajo de Deska. Simplemente arrástralos para que se sitúen uno al lado del otro en el lienzo infinito e inicia un agente diferente en cada uno.

¿Funciona el patrón de la segunda opinión con modelos locales?

Sí, siempre que los agentes puedan interactuar con tus archivos locales. Herramientas como OpenCode o Codex CLI se pueden configurar para usar inferencia local o puntos finales privados, manteniendo un flujo de trabajo local-first mientras se proporciona una revisión rigurosa.

¿Puedo monitorear las revisiones de los agentes desde mi teléfono?

Puedes usar la aplicación mobile de Deska para ver el lienzo y comprobar el estado de tus sesiones de terminal. Esto te permite monitorear procesos de revisión de larga duración o auditorías de seguridad mientras estás lejos de tu computadora principal.

Comienza con flujos de trabajo multiagente

El patrón de la segunda opinión es más efectivo cuando tienes las herramientas para visualizar la interacción entre los modelos. Al separar las fases de creación y revisión, construyes software más robusto con menos intervenciones manuales.

Para comenzar a construir tu propio espacio de trabajo multiagente, descarga Deska para Mac, Windows o Linux. Puedes comenzar con la versión gratuita y experimentar el lienzo infinito, colocando tus terminales, editores de código y documentación uno al lado del otro para ver la imagen completa de tu proceso de desarrollo.

💡 Ideas+🐛 BugsPropón una feature o reporta un bug