Marco · Sistemas y empresas que se mejoran

Tu empresa realiza mil tareas con IA. ¿Por qué todo sigue igual?

LOOP-R convierte un proceso de tu negocio en un ciclo: ejecuta, mide, critica, propone y prueba; solo lo comprobado se convierte en la nueva versión. Todo queda registrado y puedes volver atrás.

LOOP-R — ciclo de mejora continua con IA
Qué es

No es un mejor prompt. Es un sistema que aprende con cada ejecución.

Hoy la IA funciona así: solicitud → respuesta → fin. La siguiente propuesta empieza desde cero. LOOP-R cierra el ciclo: cada tarea realizada alimenta la siguiente versión de la forma de trabajar.

🧪 Evidencia, no opinión

Cada ejecución se convierte en una fila de la hoja de cálculo. El sistema solo afirma lo que demuestran los números y avisa cuando aún no hay datos suficientes para concluir.

👥 Nueve asistentes, una función cada uno

Ejecutor, Observador, Crítico, Optimizador, Guardián, Experimentador, Evaluador, Memoria y Metaagente. Ninguno evalúa su propio trabajo: esta separación evita que el sistema se convenza a sí mismo.

↩️ Botón para volver atrás

Cada versión del proceso queda en el historial. Promover es un comando; volver atrás es otro. El sistema nunca sustituye la versión actual por otra peor.

No le pidas a la IA que mejore. Haz que cada ejecución produzca evidencia, que cada evidencia genere una hipótesis y que cada hipótesis se convierta en un experimento; solo lo comprobado entra en la siguiente versión.

Cómo funciona

Cinco etapas que forman un ciclo

Localizar qué mejorar, operar, observar el resultado, proponer una hipótesis y reforzar lo que ganó. Después, repetir. Por dentro hay un ciclo de ocho pasos, cada uno a cargo de un asistente.

Locate→ Operate→ Observe→ Propose→ Reinforce→ ↻
1

Observador y Crítico

Leen y cuentan las filas de la hoja de cálculo, y explican qué funcionó y qué falló, con la solidez de la evidencia marcada como alta, moderada o baja.

2

Optimizador y Guardián

Uno redacta hipótesis comprobables (SI… ENTONCES… PORQUE…). El otro veta lo que incumple aquello que definiste como intocable. El veto es definitivo.

3

Experimentador y Evaluador

Diseñan la prueba A/B con el tamaño de muestra necesario y responden una de tres cosas: ganó B, sigue A o la muestra es insuficiente.

4

Memoria y Metaagente

Registran todo —también lo que perdió, para no volver a probarlo— y vigilan el costo del propio ciclo.

Qué garantiza y qué no

GarantizaNo garantiza
Sin regresiones — una versión peor nunca entra en producciónque el número aumente
Auditabilidad — toda versión, prueba y decisión queda registrada; basta un comando para volver atrásque cada ciclo produzca una buena hipótesis
Constancia — el ciclo se ejecuta igual cada vezque el costo compense sin que lo revises
Límite de costo — se detiene cuando lo alcanza—
Requisitos previos

Una hoja de cálculo y Claude Code

En la versión 0.1, el ciclo se ejecuta en Claude Code y los datos llegan desde una hoja de cálculo exportada a CSV: una fila por ejecución. Sin servidor, base de datos ni integración.

Claude Code

El ejecutor es una skill y los nueve asistentes son archivos de texto. Si tienes Claude Code, clona el repositorio y ejecútalo.

# instalar / comprobar
claude --version

Git

Es el historial con botón para volver: cada versión del proceso es un commit; promocionar y revertir son operaciones de Git.

git --version

Una hoja de cálculo del proceso

Donde ya registras el resultado de cada propuesta, ticket de soporte o publicación. Ejecuta el comando iniciar para generar las columnas para que las rellenes o exportes.

# uma linha por execução
id,data,versao,variante,resposta,resultado,...
Guía de uso · paso a paso

De cero al primer ciclo

Cinco respuestas en lenguaje natural configuran todo el ciclo. Después, un comando por semana.

1

Clona y abre el proyecto en Claude Code

El repositorio ya incluye el ejecutor, los nueve asistentes y un ejemplo completo que se ejecutó de verdad.

git clone https://github.com/inematds/loop-r && cd loop-r
claude
2

Responde las cinco preguntas

Son las únicas cosas que ningún sistema puede deducir de forma segura. LOOP-R propone el resto y tú lo confirmas.

/loop-r iniciar
# 1. ¿Qué proceso y qué número quieres mover, de qué valor a cuál?
# 2. ¿Dónde se registra el resultado de cada ejecución?
# 3. ¿Qué no puede cambiar nunca la IA por su cuenta? ¿Qué no debe empeorar?
# 4. ¿Cuánto puede gastar cada ciclo? ¿Por semana o por mes?
# 5. ¿Apruebas cada cambio (L1) o solo quieres ver propuestas (L0)?
3

Lee la estimación honesta y confirma

Antes de crear nada, el sistema calcula cuántas ejecuciones necesita la prueba y te dice si conviene optimizar primero una métrica más rápida.

"Con 50 propuestas por semana, demostrar el cambio del 3 % al 5 % lleva unas 60 semanas.
 Primero optimizaré la TASA DE RESPUESTA (~12 semanas) y vigilaré la conversión. ¿Confirmas?"
4

Completa la hoja y ejecuta un ciclo

Los nueve asistentes se ejecutan en secuencia y dejan un manifiesto de lo que cada uno leyó, decidió y por qué. Un ciclo sin manifiesto completo no cuenta.

/loop-r ciclo     # → ciclos/0001/ (evidencia, crítica, hipótesis, veto, experimento, veredicto)
5

Decide con la tarjeta de cinco líneas

Cuando la versión B gana con margen y sin empeorar lo que vigilas, recibes una tarjeta. Si no respondes en siete días, la opción predeterminada es no promocionar.

CICLO 0004 — hipótesis: «abrir con algo concreto de la reseña»
Resultado:   tasa de respuesta 19,3 % → 29,3 %  (N = 300 frente a 300)
Vigilado:    margen ok · quejas ok · baja de mensajes ok
Costo:       ~R$ 45 este ciclo (límite R$ 50)
Decisión:    aprobar / rechazar / esperar más datos

/loop-r decidir
6

Promociona o vuelve atrás

Promocionar crea una versión nueva y dirige la producción hacia ella mediante un commit. Revertir vuelve a la anterior. La versión vieja nunca se borra: forma parte de la memoria.

/loop-r promover   # versoes/v2 pasa a ser la oficial · commit «promote v2»
/loop-r reverter   # vuelve a v1 · entrada en el ledger con el motivo
/loop-r status
Ejemplo ejecutado

Cuatro ciclos ejecutados por los asistentes con datos sintéticos

Clínica estética, propuestas por WhatsApp, 1.500 ejecuciones sintéticas. Los asistentes sí se ejecutaron; los datos no: se generaron para reflejar un efecto real, y el README del ejemplo explica qué es real y qué es simulado. Lo ocurrido enseña más que un caso perfecto.

Ciclo 0001 — el Guardián vetó la primera idea

El Optimizador propuso cerrar con «¿prefieres empezar esta semana o la próxima?». El Guardián lo vetó: una elección forzada puede generar presión y quejas. La segunda hipótesis (un mensaje de hasta 80 palabras) pasó a prueba, después de que el Experimentador calculó que la prueba original tardaría 40 semanas.

Ciclo 0002 — ganó en la métrica, falló la barrera

La tasa de respuesta subió del 19 % al 30 % (N=300/300). Pero hubo 6 quejas frente a 1 con tolerancia cero, así que el Evaluador respondió sigue A. La regla era incorrecta (6 frente a 1 de 300 es ruido), no el sistema: una persona ajustó la tolerancia para las siguientes pruebas y la hipótesis quedó registrada como descartada.

Ciclo 0003 — la hipótesis que esperaba

Una hipótesis aprobada en el primer ciclo esperó trece semanas en la cola; solo se puede probar una a la vez. El Metaagente señaló el costo de la espera y propuso un activador automático. Se añadió a la hoja de ruta.

Ciclo 0004 — promoción

Abrir la propuesta con un detalle específico de la reseña de la clienta: la respuesta subió del 19,3 % al 29,3 %, con las barreras dentro de la tolerancia. Tarjeta de decisión, aprobación, versoes/v2. El primer aprendizaje comprobado del ciclo.

# memoria/ledger.md — fragmento (una línea por evento, nunca se borra)
| 2026-02-02 | ciclo 0001 | H1 (fechar com pergunta de escolha forçada) | — | — | — | VETADA |
| 2026-04-27 | ciclo 0002 | H2 (teto de 80 palavras, E0001) | A_SEGUE — resposta A=0,1933 vs B=0,2967, p=0,0033 | reclamacoes Δ+0,0167 tol 0,0 → FALHA | aceito | DESCARTADA |
| 2026-05-04 | ciclo 0003 | H4 (valor logo após a saudação) | — | — | — | VETADA |
| 2026-05-04 | ciclo 0003 | H3 (abrir citando a avaliação, E0002) | AMOSTRA_INSUFICIENTE — N=0/212 | — | — | EM TESTE |
| 2026-07-27 | ciclo 0004 | H3 (abrir citando a avaliação, E0002) | B_GANHOU — resposta A=0,1933 vs B=0,2933, p=0,0043 | todas OK | aprovado | PROMOVIDA v2 |
Hoja de ruta

Empieza por los datos, no por los agentes

Sin evidencia, lo demás es teatro. Cada fase entrega algo que funciona por sí solo y la siguiente no empieza hasta que un usuario real tenga tres ciclos en el historial.

v0.1
Un ciclo, una hoja de cálculo, un ciclo — listoCinco preguntas → ficha del ciclo → nueve asistentes → ciclo con CSV e historial en Git. El Metaagente solo informa. Ejemplo ejecutado.
v0.2
Medir de verdadLista de verificación sí/no para el artefacto, juez con pares mezclados, calibración con 15 ejemplos evaluados por ti. Curso completo (5 rutas).
v1
Funciona sin tiEjecutor independiente de Claude Code, programación, activador al alcanzar la muestra mínima, conectores de Google Sheets y WhatsApp, y promoción automática con reversión (L2) después de cinco promociones correctas.
v2
Varios ciclosVentas, atención al cliente y contenido en el mismo repositorio; un metaciclo lee todos los historiales. Investigación: depende de meses de datos reales.