El blog de Deska
Redacción de postmortems con un agente mientras el recuerdo está fresco
Aprende una receta técnica para la redacción de postmortems con un agente para capturar el contexto del incidente y la línea de tiempo antes de que el recuerdo se pierda.
· 10 min de lectura
El periodo inmediatamente posterior a una caída de producción es el momento más crítico para la documentación, pero suele ser cuando los equipos de ingeniería están más agotados. La redacción de postmortems con un agente mientras el recuerdo está fresco garantiza que los matices del "por qué" y el "cómo" se capturen antes de que los detalles técnicos se vuelvan difusos o se simplifiquen por el sesgo de retrospectiva. Al aprovechar los modelos de lenguaje extenso y las herramientas autónomas durante el periodo de enfriamiento de un incidente, los equipos pueden transformar logs crudos e historial de comandos en una narrativa estructurada que impulse mejoras arquitectónicas reales.
El deterioro del contexto del incidente
La memoria humana respecto a las secuencias técnicas se degrada sorprendentemente rápido. En las cuatro horas posteriores a la resolución de un error bajo presión, el orden específico de los comandos experimentales y la redacción exacta de los mensajes de error a menudo comienzan a desdibujarse. Esto conduce a postmortems que son demasiado genéricos, perdiendo los factores ambientales sutiles que contribuyeron al fallo.
El registro tradicional de incidentes depende de notas manuales o del historial de chat. Aunque las aplicaciones de chat proporcionan un registro con marca de tiempo, carecen del estado real del sistema durante la investigación. Un agente puede ayudar a cerrar esta brecha sintetizando el estado del espacio de trabajo, la salida del terminal y las intenciones del desarrollador expresadas durante el calor del momento.
Una receta para la recopilación de datos de postmortem
Para ser eficaz, el proceso de redacción de postmortems con un agente debe seguir una receta técnica repetible. Esto garantiza la consistencia entre diferentes tipos de fallos, ya sean relacionados con la infraestructura o errores de lógica de la aplicación.
- Capturar el entorno: Guarda la lista de variables de entorno activas y el hash de commit específico donde ocurrió el fallo.
- Exportar el historial: Extrae los últimos 200 comandos del historial de la shell para reconstruir la ruta de diagnóstico.
- Alimentar el contexto: Proporciona al agente los fragmentos de logs relevantes y el diff del parche de emergencia.
- Solicitar estructura: Pide al agente que genere una línea de tiempo basada en las horas de modificación de archivos y los registros de ejecución de comandos.
Este enfoque estructurado evita que el agente alucine detalles. Cuando proporcionas los datos crudos, el agente actúa como un editor y organizador en lugar de un escritor creativo.
Uso de agentes de IA dentro de tu espacio de trabajo
Las herramientas para desarrolladores están cambiando la forma en que interactuamos con estos agentes. En lugar de copiar y pegar logs en una ventana del navegador, los entornos modernos permiten que los agentes vivan junto al código. Deska proporciona un entorno específico para esto a través de su lienzo infinito. Al colocar terminales y editores de código como paneles en una sola superficie visual, puedes ver todo el historial del incidente de una vez.
Dentro de Deska, puedes ejecutar agentes de programación como Claude Code u OpenCode en paralelo. Mientras el recuerdo está fresco, puedes usar el asistente Ask Deska para reunir las diversas piezas del rompecabezas. Por ejemplo, podrías pedirle al asistente que resuma la salida de la terminal de los últimos treinta minutos o que extraiga todas las consultas SQL ejecutadas durante la fase de remediación.
El valor de este enfoque es que ocurre en un entorno local-first. Los logs sensibles y los fragmentos de código no necesitan ser subidos a una nube de terceros solo para ser analizados. Los datos permanecen en tu máquina, proporcionando una forma segura de iterar en la documentación de incidentes.
Comparación de enfoques de documentación
Diferentes herramientas manejan la redacción de postmortems de diversas maneras. El estándar suele ser un documento compartido, pero esto requiere una entrada manual significativa.
| Característica | Documentación Manual | Plataformas de Incidentes | Agentes en el Workspace |
|---|---|---|---|
| Recolección de Datos | Copiar/pegar manual | Automática vía integración | Contexto del workspace |
| Privacidad | Varía por proveedor | Generalmente en la nube | Opciones local-first |
| Esfuerzo de Configuración | Bajo | Alto (requiere hooks) | Medio (basado en prompts) |
| Flexibilidad | Alta | Plantillas rígidas | Alta (guiada por agente) |
Las plataformas dedicadas son excelentes para organizaciones grandes que necesitan cumplimiento estricto e integraciones pesadas con PagerDuty o Jira. Difieren en enfoque de los agentes de espacio de trabajo al centrarse en el flujo del proceso más que en el entorno técnico. Los agentes de espacio de trabajo suelen ser mejores para el volcado inicial de información donde residen los detalles técnicos crudos.
El papel de la línea de tiempo
La parte más difícil de cualquier postmortem es la línea de tiempo. Rara vez es una secuencia lineal de eventos. A menudo, varios desarrolladores trabajan en diferentes aspectos del problema simultáneamente. Cuando estás realizando la redacción de postmortems con un agente, este puede cruzar referencias de cambios en el sistema de archivos con el historial de la shell para identificar quién hizo qué y cuándo.
Si estás usando la aplicación mobile de Deska, es posible que incluso hayas capturado observaciones mientras estabas lejos de tu escritorio. Estas notas pueden sincronizarse de nuevo al espacio de trabajo principal e incluirse en el contexto del agente. Esto garantiza que la línea de tiempo refleje no solo los cambios de código, sino las observaciones humanas que llevaron a esos cambios.
Integración de agentes de programación en el flujo de trabajo
Usar un agente no se trata de reemplazar el análisis humano. Se trata de eliminar la fricción del primer borrador. Una vez que el agente ha generado un esqueleto basado en tus terminales y notas, el ingeniero líder debe revisarlo para verificar su precisión.
- Revisar la sección de "Detección": ¿Realmente lo encontramos cuando pensamos que lo hicimos?
- Validar la "Causa Raíz": ¿Es la explicación del agente técnicamente sólida?
- Refinar los "Elementos de Acción": ¿Son estas mejoras realistas para la hoja de ruta?
Al comenzar con un borrador generado por un agente, el equipo de ingeniería pasa menos tiempo intentando recordar marcas de tiempo y más tiempo discutiendo cómo evitar que el problema vuelva a ocurrir.
Errores comunes en la documentación con agentes
Un error es confiar demasiado en que el agente interprete los logs sin proporcionar suficiente contexto. Los agentes son buenos en el reconocimiento de patrones, pero no entienden tu lógica de negocio específica a menos que se la expliques.
Otro error es la privacidad. Muchos desarrolladores dudan en alimentar logs propietarios en un LLM público. Es por eso que usar una herramienta que permita BYOK (trae tu propia llave) o ejecución local es vital. Debes asegurarte de que tus políticas de datos y almacenamiento se respeten durante el proceso de redacción.
Preguntas Frecuentes
¿Cómo automatizar líneas de tiempo de incidentes con IA?
Automatizar líneas de tiempo requiere enviar el historial de la shell y los eventos del sistema de archivos a un prompt estructurado. Un agente puede entonces ordenar estos eventos cronológicamente para crear un borrador. El uso de una herramienta como Deska te permite mantener estos hilos de agentes organizados dentro del mismo espacio de trabajo donde ocurrió el trabajo.
¿Cuál es la mejor forma de capturar historial de terminal para postmortems?
La mejor manera es usar un gestor de sesiones persistente o una herramienta de espacio de trabajo que registre toda la salida. Luego puedes entregar estos logs a un agente. En Deska, el panel de terminales mantiene el estado de la sesión, facilitando la extracción del historial de comandos necesario para la documentación.
¿Puede un agente analizar logs para encontrar la causa raíz?
Sí, si se le proporciona suficiente contexto y firmas de error específicas. Los agentes son eficaces identificando picos o patrones recurrentes en archivos de log. Sin embargo, un humano siempre debe verificar la conclusión para asegurar que el agente no haya malinterpretado la arquitectura del sistema.
Comenzando con Deska
Si quieres mejorar cómo tu equipo captura los datos de incidentes, puedes comenzar a usar el lienzo para organizar tu próxima investigación de postmortem. Al ejecutar agentes lado a lado con tus herramientas reales, puedes asegurar que tu documentación sea lo más precisa posible mientras el recuerdo está fresco. Puedes descargar la aplicación para Mac, Windows o Linux para comenzar a construir tu flujo de trabajo impulsado por agentes y local-first.