En el artículo anterior afirmé que el oro está en tus chats: que las correcciones acumuladas en tu histórico con la IA son la materia prima del corpus de un agente personal. Después de publicarlo, sometí la tesis a la prueba de la literatura y la enmendé: el histórico no revela directamente cómo piensas; registra, con mucha más fiabilidad, cómo corriges.
Este artículo es la segunda parte de esa historia y cumple una promesa: el método completo de extracción, tal como lo ejecuté, con números reales, los prompts de trabajo de las dos primeras fases y la formalización reproducible de la tercera, para que cualquiera con un histórico suficiente pueda replicarlo.
El histórico no revela directamente cómo piensas; registra, con mucha más fiabilidad, cómo corriges.
La IA hizo la extracción
La extracción la hizo una IA. No fue una asistente del proceso: fue la herramienta fundamental. La misma IA que acumuló mis correcciones recorrió después el histórico, identificó los turnos donde la corregí y destiló los principios. Yo no leí miles de mensajes a mano; diseñé las instrucciones, validé cada fase y me reservé el juicio final.
Esa división del trabajo no es un detalle: es el método. La IA aporta la capacidad de leer a escala y de estructurar; el humano aporta el diseño del proceso y el juicio sobre el resultado. Si la IA hace también el juicio, el perfil que sale es un personaje coherente inventado por el modelo. Si el humano hace también la lectura masiva, el proyecto muere de puro cansancio antes de terminar.
No hace falta ser programador. Hace falta un histórico de chats en una herramienta que permita buscarlo o exportarlo. Yo usé Claude Projects con la búsqueda de chats habilitada, una función disponible en planes de pago y limitada a las conversaciones de cada proyecto. También hacen falta tiempo y una condición innegociable: revisar personalmente todo lo que el modelo destile.
Antes de empezar: higiene de datos
El histórico de cualquier persona que trabaja en serio contiene secretos, datos de terceros y material que no debe circular. Antes de procesar nada, decide el perímetro: qué proyectos entran, cuáles quedan fuera y qué tipo de información se excluye aunque aparezca. En mi caso, excluí un proyecto completo por su sensibilidad y todo lo que tocara credenciales o datos de personas ajenas al proceso. Esta decisión se toma antes, en frío, no durante la extracción.
Excluir significa dejar ese material fuera del proyecto o del corpus buscable, no confiar en una instrucción para que el modelo lo ignore después de haber accedido a él.
El recorrido de extracción puede resumirse así:
Histórico → turnos críticos → principios → patrones → reglas operativas.
Fase 1: identificar los turnos críticos
Un turno crítico es un momento del histórico donde tu criterio quedó registrado en acción. En mi prompt definí cinco categorías. Las comparto con ajustes editoriales mínimos de forma, sin cambiar la lógica, porque la precisión de estas definiciones determina la calidad de todo lo demás. Este es el núcleo del prompt de trabajo de la Fase 1:
Tu tarea: recorrer las conversaciones de este Project usando tus
herramientas de búsqueda. Identifica los turnos donde yo dije algo
que revela mi razonamiento operativo de forma significativa.
Categorías de turnos críticos:
1. CORRECCIONES EXPLÍCITAS: turnos donde te contradigo, te corrijo
o limito tu enfoque. Marcadores: "no", "te equivocas", "limítate",
"no es así".
2. REENCUADRES: turnos donde reformulo lo que dijiste de manera que
cambia el sentido. No me opongo directamente; propongo otra forma
de ver el mismo objeto.
3. RECHAZOS DE MARCO: rechazo no tu respuesta, sino el enfoque entero.
Marcadores: "hemos perdido el foco", "no es eso lo que quiero".
4. EXIGENCIAS DE EVIDENCIA: pido que justifiques una afirmación o
muestres la fuente. Marcadores: "en qué te basas",
"de dónde sacas eso".
5. AFIRMACIONES DE PRINCIPIO: declaro un valor o una preferencia
profunda. Marcadores: "para mí lo importante es", "yo trabajo así".
Para cada turno, devuelve: conversación de origen, fecha, categoría,
contexto previo, cita literal (textual, sin parafrasear) y resolución.
Reglas:
- NO interpretes ni destiles principios todavía. Solo identifica y cita.
- NO descartes turnos por parecer triviales. El filtrado lo hago yo.
- Si un patrón se repite en distintas conversaciones, incluye todos
los casos. La repetición es dato, no redundancia.
El truco que hace viable esta fase lo aprendí en la práctica: las búsquedas temáticas fallan; las búsquedas de tus propias frases de corrección, en tu idioma y tal como las escribes, aciertan. Cada uno conoce sus muletillas: las frases que repite cuando el modelo le falla. Esas son las llaves del histórico.
En mi primer proyecto procesado, esta fase produjo 48 turnos críticos procedentes de unos tres meses de conversaciones. Y aquí aparece el primer control humano: validé la lista a mano y descarté los falsos positivos antes de pasar a la fase siguiente. La cita literal con su origen no es burocracia: es lo que permite auditar después si el perfil dice la verdad.
Fase 2: destilar y agrupar
En el piloto ejecuté la destilación y la agrupación como fases separadas; después las consolidé en un solo prompt que recibe los turnos ya validados. Sus reglas internas son la parte que más calidad aporta. También las comparto con ajustes editoriales mínimos de forma:
PASO A - Destilación interna.
Para cada turno validado, destila el principio operativo subyacente:
cita disparadora literal, contexto, principio extraído, generalización
y regla operativa para el agente.
Reglas:
- UN PRINCIPIO POR TURNO. Si un turno contiene varios, divídelo en
registros separados.
- NO INVENTES. Si requiere ir más allá del turno, marca la confianza
como LOW.
- DISTINGUE TEMA DE RAZONAMIENTO. Importa CÓMO decide, no qué decidió.
- NO COPIES EL CONTENIDO LITERAL. La cita es textual; el resto es
destilación.
PASO B - Agrupación en patrones.
Agrupa los principios en patrones de mayor nivel con: principios
componentes, fuerza evidencial (`high`, `medium`, `low`) y descripción.
Prefiere una consolidación fuerte y patrones limpios antes que
agrupaciones forzadas.
La regla «distingue tema de razonamiento» es la que separa un corpus útil de un diario técnico. «Corrigió un comando del servidor» no es un principio; «las afirmaciones técnicas requieren verificación contra documentación oficial antes de ejecutarse» sí lo es.
El recorrido simplificado de una ficha se ve así:
Tema observado: corrigió un comando del servidor → principio: las afirmaciones técnicas requieren verificación oficial antes de ejecutarse → patrón: régimen de evidencia técnica → regla: verifica toda afirmación técnica contra documentación oficial antes de recomendar su ejecución.
Una lección operativa que aprendí a la fuerza: guarda la salida de cada fase en un archivo local antes de ejecutar la siguiente. Los chats se pierden, los contextos se llenan y repetir una fase de extracción es trabajo doble. A partir de ese momento, empecé a añadir esa advertencia al inicio de cada ejecución.
Fase 3: consolidar por recurrencia
Este proceso se repite proyecto por proyecto. Al final, la consolidación transversal separa el oro de la arena: Una corrección aislada puede responder a una circunstancia puntual; un principio que aparece una y otra vez en contextos distintos es un criterio tuyo.
La Fase 3 no corrió con un prompt guardado como las fases 1 y 2. La ejecuté como una sesión dirigida y documenté el método en las notas metodológicas del consolidado. El bloque siguiente formaliza ese proceso como un prompt reutilizable y anonimizado: cada regla corresponde a lo que hice; no añade pasos inventados.
Contexto: tienes N archivos de la Fase 2, uno por proyecto procesado.
Cada archivo contiene patrones de razonamiento con: ID, título,
principios componentes, fuerza evidencial (`high`, `medium`, `low`) y
citas disparadoras con su proyecto de origen.
Tu tarea: consolidar todos los patrones en un único documento
transversal del perfil operativo del usuario.
Método:
1. Lee TODOS los patrones de TODOS los proyectos, uno por uno.
No trabajes por resumen ni por muestreo.
2. Agrupa por similitud temática transversal: los patrones de proyectos
distintos con descripciones equivalentes representan el mismo
criterio manifestándose en contextos diferentes.
3. Clasifica cada grupo por recurrencia:
- Presente en 4 o más proyectos: META-PRINCIPIO transversal.
- Presente en 2 o 3 proyectos: PRINCIPIO consistente.
- Presente en 1 proyecto: PATRÓN ESPECÍFICO DE DOMINIO. Es válido
solo en su contexto; NO lo generalices.
Estructura del documento final:
- Parte I: meta-principios transversales, cada uno con los proyectos
donde aparece y una cita representativa por proyecto.
- Parte II: principios consistentes, con el mismo formato.
- Parte III: patrones específicos agrupados por dominio.
- Parte IV: VÍA NEGATIVA Y LÍMITES DEL PERFIL. Registra los
comportamientos o criterios buscados explícitamente que no reciben
apoyo suficiente en el conjunto completo de patrones de la Fase 2.
Trátalos como límites de la extracción, no como afirmaciones sobre
lo que la persona nunca hace.
- Parte V: reglas operativas accionables para la capa de identidad del
agente o, según la arquitectura, su prompt de sistema, derivadas de
las partes I y II. Usa formato imperativo, una regla por línea.
- Apéndice: inventario de patrones fuente y notas metodológicas.
Reglas:
- NO INVENTES. Todo grupo debe remitir a patrones fuente con sus IDs.
- La fuerza evidencial se hereda de la Fase 2. Si los patrones agrupados
traen fuerzas distintas, registra el rango; no lo promedies.
- Prefiere una consolidación fuerte y grupos limpios antes que
agrupaciones forzadas. Un patrón que no encaja se queda solo.
- DOCUMENTA LAS LIMITACIONES al final: proyectos ausentes, sesgo de la
muestra y el hecho de que la agrupación implica interpretación.
- Es un documento vivo, no un contrato cerrado: incluye una sección de
iteración futura con lo pendiente de validar.
Estos umbrales correspondieron a mi corpus de ocho proyectos: son cortes operativos, no fronteras estadísticas ni universales. Con otro número de proyectos, conviene definir y documentar umbrales equivalentes antes de ejecutar la consolidación.
En ese corpus, los 83 patrones extraídos se clasificaron en esos tres niveles: los presentes en 4 o más proyectos se consolidaron como meta-principios transversales (resultaron 9); los presentes en 2 o 3, como principios consistentes (6); y los únicos de un proyecto quedaron como específicos de dominio, válidos solo en su contexto.
Los límites del perfil exigen una precaución: que una conducta no aparezca no demuestra que no sea propia de la persona. Por eso documenté qué comportamientos o criterios no recibían apoyo suficiente en el conjunto completo de patrones de la Fase 2. Son límites de la extracción, no afirmaciones sobre lo que nunca hago. Delimitar lo que el corpus no permite afirmar reduce el riesgo de que el modelo complete los huecos inventando un personaje coherente que no eres tú.
El producto final de mi extracción fue este: 9 meta-principios, 6 principios consistentes, patrones específicos de 6 dominios y 41 reglas operativas listas para convertirse en la capa ligera de identidad del agente. El patrón más fuerte de los 83, sin contradicciones detectadas en el periodo analizado, fue el régimen de evidencia: nunca asumir, nunca inventar, citar siempre la fuente. Que el hallazgo dominante de un método basado en correcciones sea un criterio sobre cómo corregir no es casualidad: es la tesis enmendada confirmándose a sí misma.
Después de la extracción: alimentar a Hermes
Las Fases 1 a 3 terminan en el documento consolidado. Alimentar a Hermes fue una etapa posterior y distinta. No consistió en copiar el consolidado entero dentro del contexto de cada turno, sino en decidir qué debía vivir en la identidad del agente y qué debía permanecer en su biblioteca.
En mi arquitectura, Hermes es el entorno de ejecución y Nova es el agente que opera dentro de él.
1. Las reglas destiladas viven en la identidad
Integré las reglas operativas del consolidado en SOUL.md. En mi instalación de Hermes, Nova carga ese archivo como identidad en cada turno. Es la capa ligera y siempre presente: contiene los criterios que deben orientar la respuesta, no toda la evidencia de la que proceden.
2. El corpus completo vive en una skill consultable
Desplegué el corpus completo como la skill crp/extraction-corpus, con IDs estables para que Nova pudiera consultarlo bajo demanda y responder con trazabilidad. En mayo de 2026 validé el recorrido de extremo a extremo: Nova recuperó el meta-principio M1 y devolvió las citas literales que lo sustentaban junto con sus proyectos de origen.
3. Los documentos fundacionales viven en la biblioteca de referencia
Mi primera integración mezcló esas capas. Los documentos fundacionales completos se inyectaban en cada turno y elevaban el contexto recurrente a unos 72.000 caracteres. En junio de 2026, los archivé en ~/.hermes/reference/ como material de consulta y dejé en la memoria activa únicamente versiones mínimas. El contexto por turno bajó a unos 13.000 caracteres.
El corpus no se inyecta; se consulta.
El agente lleva encima solo las reglas destiladas, ligeras y siempre presentes, y busca en el corpus completo cuando necesita la evidencia. Alimentar a Hermes no fue copiarle un documento; fue diseñar la frontera entre identidad y biblioteca.
El consolidado también conserva un valor independiente del agente: es un documento explícito de tus criterios operativos, algo que la mayoría de las personas nunca ha puesto por escrito.
Las limitaciones
Tres, y conviene conocerlas antes de empezar. La primera es el sesgo de recuperación: buscar tus frases encuentra las correcciones memorables y deja fuera las silenciosas, así que el perfil sobrerrepresenta tus rechazos más visibles. La segunda es que el modelo que destila impone coherencia: los humanos somos inconsistentes y el destilador tenderá a limpiar las contradicciones. Por eso la revisión personal de cada ficha no es opcional y por eso los prompts llevan «NO INVENTES» escrito en mayúsculas.
La tercera es el alcance: la extracción produce un perfil operativo auditable; por sí sola, no demuestra que un agente lo recupere correctamente ni que el perfil prediga tu razonamiento fuera de los chats. La recuperación se valida por separado, como hice con Nova durante la etapa de integración. Yo no he validado la extrapolación fuera del histórico.
Los trabajos que revisé estudian la personalización del razonamiento a partir del histórico, los perfiles dinámicos derivados de interacciones anteriores y las preferencias contextuales reveladas mediante feedback en conversaciones de varios turnos, pero no validan este procedimiento concreto sobre un archivo personal real. Lo que obtienes de la extracción es un perfil operativo de tus criterios de corrección. Para un agente personal, es exactamente lo que hace falta. Para conocerte a ti mismo, es un buen comienzo, no una radiografía.
Muele tu propio oro y comparte
El método de extracción está completo en estas líneas y no requiere infraestructura especializada, pero sí acceso buscable o exportable a tu histórico de conversaciones. La implementación del agente puede variar; el principio arquitectónico no: reglas destiladas en la identidad, evidencia completa en una biblioteca consultable. Si lo aplicas, documenta tus números y comparte lo que encuentres: qué patrones aparecieron, cuáles te sorprendieron y dónde falló el método. Ese acto de compartir no es cortesía; es la parte del sistema que mantiene vivo el conocimiento común. En el próximo artículo de esta serie veremos, con un estudio reciente sobre la mesa, por qué eso importa más de lo que parece.
Por: Cesar Rosa Polanco - Escrito a partir de una experiencia real, con asistencia de inteligencia artificial como herramienta de apoyo editorial.