El blog de Deska

Diseño de confirmaciones que los usuarios realmente leen

Aprende estrategias técnicas para el diseño de confirmaciones que los usuarios realmente leen al trabajar con agentes de IA y herramientas de desarrollo.

· 10 min de lectura

El desarrollo de software con agentes autónomos introduce un punto de fricción significativo conocido como la fatiga de confirmación. Al trabajar en el diseño de confirmaciones que los usuarios realmente leen, es fundamental equilibrar la necesidad de seguridad con la velocidad del ciclo de desarrollo. Si una herramienta solicita permiso con demasiada frecuencia, el desarrollador comienza a pulsar "Permitir" sin inspeccionar el comando subyacente. Este comportamiento, a menudo llamado habituación, anula el propósito de mantener al humano en el flujo de trabajo. Un diseño de confirmación efectivo requiere proporcionar el contexto justo para que el usuario tome una decisión informada en menos de dos segundos.

La psicología del bucle de aprobación

El desafío principal en los flujos de trabajo con agentes es el cambio de la escritura activa al monitoreo pasivo. Cuando un desarrollador escribe código, él es el actor principal. Cuando un agente como Claude Code u OpenCode propone un cambio, el desarrollador se convierte en auditor. Los auditores tienen una tendencia natural a confiar en el sistema si este ha acertado las últimas cinco veces.

Para combatir esto, la interfaz debe resaltar la diferencia entre el estado actual y el estado propuesto. Simplemente mostrar un bloque de texto que diga "El agente quiere ejecutar un comando" es insuficiente. Una confirmación bien diseñada debe mostrar el impacto específico en el sistema de archivos o en la red.

Jerarquía de información en la UX de agentes

No todas las acciones de los agentes conllevan el mismo riesgo. Una operación de solo lectura, como listar archivos en un directorio, requiere menos escrutinio que una operación destructiva como borrar una carpeta o realizar un commit en git.

Categorización de acciones

  1. Riesgo bajo: Leer documentación, revisar el directorio actual o listar procesos en ejecución.
  2. Riesgo medio: Crear archivos nuevos, instalar nuevos paquetes de npm o modificar archivos de configuración local.
  3. Riesgo alto: Borrar archivos, ejecutar scripts de shell con privilegios de sudo o realizar llamadas a APIs externas que generen costos.

Los diseñadores deben implementar diferentes patrones de interfaz basados en estos niveles. Para elementos de bajo riesgo, una notificación transitoria o una entrada silenciosa en los logs de los terminales puede ser suficiente. Para elementos de alto riesgo, lo apropiado es un modal interruptivo o un periodo de espera obligatorio.

Contextualización de la confirmación

Una confirmación es tan buena como la información que proporciona. En lugar de un selector genérico de "Aceptar/Rechazar", proporciona un resumen de la intención. Si un agente está usando Ask Deska para manipular el espacio de trabajo, la confirmación debe explicar el porqué. Por ejemplo, "El agente desea abrir un nuevo panel de navegador para verificar el renderizado CSS" es mucho más útil que "El agente solicitó un widget de navegador".

Tipo de informaciónDescripciónImplementación de UX
IntenciónPor qué el agente hace estoEncabezado de texto corto
ComandoEl código exacto ejecutadoBloque de código
ImpactoArchivos o paneles afectadosLista de rutas
SeguridadIndicador de nivel de riesgoCódigo de colores o iconos

Cómo maneja Deska las aprobaciones de agentes

Deska proporciona un entorno donde múltiples agentes pueden ejecutarse lado a lado como paneles en un canvas infinito. Debido a que Deska es una aplicación local-first, la preocupación principal es proteger el sistema de archivos local y la integridad de la máquina del desarrollador.

Cuando ejecutas agentes de programación como Codex CLI dentro de Deska, la herramienta utiliza el sistema de paneles para mantener la salida del agente visible en todo momento. Esta visibilidad es la primera línea de defensa. Al ver el proceso de pensamiento del agente en un panel dedicado del editor Monaco o en la terminal, el usuario ya está preparado para la eventual solicitud de aprobación.

Además, la integración con la aplicación móvil permite un flujo de aprobación único. Si estás lejos de tu escritorio, puedes usar el relevo de la aplicación mobile para monitorear el progreso del agente. Si el agente llega a un paso de alto riesgo, puedes revisar el diff y aprobarlo desde tu teléfono. Esto mantiene el flujo de trabajo en movimiento sin sacrificar la seguridad.

Estrategias para prevenir la habituación

Para asegurar que estás aplicando el diseño de confirmaciones que los usuarios realmente leen, debes introducir variabilidad. Si cada confirmación parece idéntica, el cerebro deja de procesar el contenido.

  • Divulgación progresiva: Muestra el comando primero. Si el usuario desea ver el razonamiento completo, puede expandir una sección de "Justificación".
  • Visualización de Diff: Para cambios de código, nunca muestres el archivo completo. Muestra un diff estándar de git. Esto permite que el ojo se dirija inmediatamente a las líneas verdes y rojas.
  • Agrupación (Batching): En lugar de pedir permiso para diez lecturas de archivos diminutos, permite que el usuario otorgue "Acceso de lectura" para toda la sesión o un directorio específico.
  • Re-autenticación: Para acciones de riesgo extremadamente alto, requiere una interacción física como un atajo de teclado específico o una verificación biométrica.

Integración con el espacio de trabajo

El proceso de aprobación no debe sentirse como una interrupción externa. En Deska, el asistente Ask Deska puede dirigir el espacio de trabajo, abriendo y cerrando paneles según sea necesario. Cuando el asistente necesita ejecutar un comando, lo hace dentro de un panel de terminal que el usuario puede inspeccionar.

Al tratar al agente como un participante más en el espacio de trabajo, la UX se vuelve más fluida. Puedes alejar el zoom en el lienzo para ver al agente trabajando en una esquina mientras tomas notas en otra. Esta conciencia espacial ayuda al usuario a comprender el alcance de la influencia del agente.

FAQ

¿Cómo dejar de hacer clic en permitir sin leer?

La mejor manera es utilizar herramientas que categoricen las acciones por nivel de riesgo. También puedes configurar tus ajustes para auto-aprobar comandos seguros mientras obligas a una revisión manual para los destructivos, lo que preserva tu atención para los elementos que realmente importan.

¿Cuál es la mejor UX para revisiones de código con IA?

Una UX efectiva para revisión de código por IA se basa en diffs claros y la capacidad de editar la sugerencia del agente antes de confirmarla. Una vista de lado a lado, similar a cómo Deska muestra los hilos de agentes, permite comparar el código original con los cambios propuestos instantáneamente.

¿Debo usar el móvil para aprobaciones de agentes?

Usar una aplicación mobile para aprobaciones es muy efectivo para tareas de larga duración. Te permite alejarte de tu computadora sin detener al agente. Siempre que la conexión utilice un relevo seguro y emparejamiento directo, es una forma segura de mantener al humano en el flujo de trabajo.

Experimenta una mejor UX con agentes

El diseño de interfaces para agentes de IA es una disciplina en evolución. El objetivo es crear una relación simbiótica donde el humano proporciona la dirección y el agente se encarga de la implementación. Si quieres ver estos principios de UX en acción, puedes descargar el espacio de trabajo de forma gratuita.

Experimenta una nueva forma de trabajar con agentes de IA en un lienzo infinito. Visita /download para comenzar en Mac, Windows o Linux.

💡 Ideas+🐛 BugsPropón una feature o reporta un bug