INEMA.CLUBPROLOOP-R PT · EN · ES

LOOP-R · Ruta 04

Medir de verdad

Aprende a decir cuántas ejecuciones prueban una mejora, redactar una lista de verificación de sí o no y decidir sobre una tarjeta real — aprobar, rechazar o esperar — con la opción de volver atrás.

Ruta 04 · Clase 1

El ciclo que aprende
a hacer trampa

Al terminar esta clase, podrás tomar una meta de tu negocio y escribir, en una línea, qué haría la IA para inflar la cifra sin mejorar nada y qué dos indicadores vigilarás para impedirlo.

Toda meta que se dá a un sistema que aprende se convierte en un objetivo para hacer trampa. «Responder más rápido» se transforma en cerrar tickets sin resolverlos; «vender más», en ofrecer descuentos hasta que desaparece el margen. No es un defecto de la IA: es lo que haría cualquier empleado si se le exigiera una sola cifra. Antes de medir de verdad, debes saber cómo se puede manipular la medida.

↓ desplázate para estudiar

01 Una meta por sí sola enseña a hacer trampa

Hay una regla antigua en toda empresa: cuando una medida se convierte en meta, deja de medir. No porque la gente sea deshonesta, sino porque es inteligente. Si pagas por la cantidad de atenciones, las atenciones se vuelven más breves. Un sistema que aprende hace lo mismo, solo que más rápido y sin culpa.

En LOOP-R, la métrica objetivo es la cifra que le pediste aumentar al ciclo. Si es la única que observa, encontrará el camino más corto para subirla, y ese camino casi nunca consiste en atender mejor.

La dueña de una clínica estética pide: «aumenta la tasa de respuesta a las propuestas». Tres ciclos después, subió del 20 % al 34 %. Revisa las conversaciones y descubre por qué: la nueva versión envía un segundo mensaje al día siguiente y muchas «respuestas» dicen «por favor, deja de enviarme esto». También cuentan como respuesta. La aguja subió; la clínica, no.

02 Las trampas tienen tres formas conocidas

No hace falta imaginar todas las trampas posibles; se repiten. Pide maximizar los clics y el ciclo aprende a crear titulares engañosos. Pide reducir el tiempo de atención y aprende a cerrar rápido sin resolver. Pide maximizar las ventas y aprende a ofrecer descuentos hasta borrar el margen. Pide maximizar las respuestas y aprende a provocar.

Observa el patrón: en todos los casos, la cifra solicitada realmente sube. La trampa no está en la cifra, sino en lo que se quedó fuera.

La responsable de soporte de una pequeña empresa de software fijó la meta de «tiempo medio por ticket: de 18 a 10 minutos». En dos semanas llegó a 9. Pero los tickets cerrados en 2 minutos se reabrían al día siguiente y la satisfacción bajó de 4,3 a 3,6. Nada de eso aparecía en su panel, que solo mostraba el tiempo.

Antes: una meta desnuda

«Tiempo medio por ticket: de 18 a 10 minutos». Un ticket cerrado en 2 minutos que se reabre mañana cuenta a favor de la meta.

Después: una meta con indicadores de seguridad

«De 18 a 10 minutos sin empeorar las reaperturas a 7 días (hoy 9 %) ni la satisfacción (hoy 4,3)». El mismo ticket ahora cuenta en contra.

Balance: la misma meta y el mismo panel, pero «cerrar sin resolver» dejó de ser un atajo y ahora implica un rechazo automático.

03 La forma obligatoria: maximizar X sin empeorar Y, Z, W

En LOOP-R, una meta nunca va sola. Toda métrica objetivo viene acompañada de al menos una cifra que no puede bajar: un indicador de seguridad. La frase completa siempre es «maximizar X sin empeorar Y, Z y W». No es un adorno: es la parte de la meta que impide hacer trampa.

Los indicadores de seguridad habituales dependen del área. Ventas: margen medio, quejas, bajas, descuento medio. Atención: satisfacción, reaperturas en 7 días, esfuerzo del cliente. Contenido: tiempo en la página, bajas, denuncias. No hace falta vigilarlos todos, sino los que probablemente afectaría la trampa.

Un agente inmobiliario que responde a contactos del portal escribe: «maximizar las visitas concertadas por contacto sin empeorar la tasa de ausencias ni el descuento medio ofrecido». Si la nueva versión agenda más visitas prometiendo descuentos durante la conversación, sube el descuento medio y la versión se rechaza, aunque la agenda esté llena.

Dos asistentes del ciclo utilizan esta frase. El Guardián veta cualquier hipótesis que proponga tocar un indicador de seguridad. El Evaluador rechaza toda versión que suba X y empeore un indicador más allá de la tolerancia, aunque X haya subido mucho. Si las respuestas suben un 40 % y el margen cae un 1 % con tolerancia cero, la respuesta es «A sigue». Sin excepciones.

Ponte a prueba

La versión B elevó la tasa de respuesta un 40 %. El margen medio cayó un 1 % y la tolerancia del indicador «margen» es cero. ¿Qué responde el Evaluador?

04 El propio recuento puede hacer trampa

Hay una trampa más silenciosa que las anteriores: la definición de la cifra. ¿Qué cuenta exactamente como «respuesta»? Si cuenta cualquier mensaje de vuelta, «deja de enviarme esto» es una respuesta. Si «resuelto» significa cualquier ticket cerrado, un ticket cerrado a la fuerza cuenta como resuelto.

Por eso la definición de la métrica forma parte de la ficha del ciclo; no es un detalle. «Respuesta» debe excluir las negativas; «resuelto» debe excluir lo que se reabre en 7 días. El Observador —el asistente que cuenta— comprueba que el registro coincida con esa definición antes de sumar nada.

En la clínica, la columna «respondió» del registro añadió una vecina: «respuesta positiva (sí/no)». En la empresa de software, «cerrado el» añadió «reabierto antes de 7 días (sí/no)». Dos columnas adicionales y las dos trampas del comienzo de esta clase desaparecieron del recuento.

Una meta sin indicadores de «sin empeorar» no es una meta. Es una invitación.

Practica ahora 0/4 completados

Encuentra la trampa en tres metas

Para cada meta, escribe la trampa más probable y dos indicadores de seguridad. Unos 10 minutos. Es un análisis, no una ejecución: dejar que un ciclo haga trampa tomaría semanas; el caso resuelto muestra en minutos qué debes reconocer.

Nada cambia en tu negocio hasta que lo apruebes: estás escribiendo en un papel, no en la ficha del ciclo. Si tu respuesta difiere de la clave, compara el razonamiento: puede haber más de una trampa posible y más de un indicador válido para cada meta.

Meta 1: Renata, dueña de una clínica estética. «Quiero duplicar la cantidad de propuestas que reciben respuesta por WhatsApp».

Meta 2: Marcos, agente inmobiliario. «Quiero más visitas concertadas por cada contacto que llega del portal».

Meta 3: Paula, responsable de soporte. «Quiero reducir el tiempo medio de cada ticket».

Clave comentada

Meta 1 (clínica). Trampa: insistir (segundo y tercer mensaje) o provocar, porque «deja de enviarme esto» cuenta como respuesta. Indicadores: quejas y bajas. Extra: definir «respuesta» como respuesta positiva en el registro.

Meta 2 (agente inmobiliario). Trampa: agendar a cualquier costo, prometiendo descuentos o diciendo «solo ven a mirar», lo que llena la agenda de visitas que no se concretan. Indicadores: tasa de ausencias y descuento medio prometido. Alternativa válida: propuestas cerradas por visita.

Meta 3 (soporte). Trampa: cerrar rápido sin resolver. Indicadores: reaperturas a 7 días y satisfacción. Extra: «resuelto» debe excluir lo que se reabre.

Si elegiste otro indicador, pregúntate: «¿La trampa que describí afectaría esta cifra?». Si la respuesta es sí, es válido.

Acabas de ver la trampa antes de que ocurra, en tres negocios distintos y con la misma pregunta.

Resumen

  • Cuando una medida se convierte en meta, deja de medir, y un sistema que aprende encuentra el atajo más rápido que cualquier empleado.
  • Las trampas se repiten: titulares engañosos, cerrar sin resolver, descontar hasta borrar el margen y provocar para «ganar» una respuesta.
  • En LOOP-R, la meta tiene una forma fija: «maximizar X sin empeorar Y, Z y W»; el Guardián veta lo que afecta un indicador de seguridad y el Evaluador rechaza lo que lo empeora.
  • La definición de la cifra también forma parte de la meta: «respuesta» excluye las negativas y «resuelto» excluye lo que se reabre.

Tu siguiente paso

Ahora puedes mirar una meta y ver el atajo antes de que lo encuentre la IA.

Durante los próximos 15 minutos: toma la meta principal del proceso que elegiste en la Ruta 2 y reescríbela como «maximizar X sin empeorar Y ni Z». Envíate la frase por WhatsApp: irá a la ficha del ciclo.

En la próxima clase descubrirás por qué 12 propuestas no demuestran nada, cuántas hacen falta y cuántas semanas tomaría a tu ritmo.

Ruta 04 · Clase 2

La cantidad
que lo demuestra

Al terminar esta clase, podrás mirar una meta como «del 20 % al 30 %» y decir cuántas ejecuciones necesita la prueba por versión y cuántas semanas tomará al ritmo de tu negocio, antes de empezar.

La mayoría de los ciclos muere aquí: alguien compara 12 propuestas nuevas con 12 anteriores, ve «el doble» y cambia la regla del equipo. Tres semanas después la cifra vuelve a la normalidad y nadie sabe por qué. El azar con pocos datos parece un patrón. Hay un cálculo que los distingue y cabe en una tabla de cinco filas.

↓ desplázate para estudiar

01 Con doce, el azar se disfraza de patrón

Lanza una moneda doce veces. Obtener ocho caras o más ocurre en casi uno de cada cinco intentos, sin moneda trucada. Ahora cambia «cara» por «cliente que reservó» y «cruz» por «cliente que no respondió»: con doce clientes, que un mensaje nuevo «gane» al anterior es algo esperable por azar, no una prueba de que sea mejor.

Por eso «lo probé y funcionó» casi nunca es cierto con pocos datos. La persona no se equivoca sobre lo que vio; eso también ocurre cuando no hay ninguna diferencia.

Un agente inmobiliario cambia el primer mensaje que envía a los contactos del portal. De los siguientes 12, 4 reservan una visita. Con el mensaje anterior, lo hicieron 2 de los 12 previos. «Se duplicó», dice en la reunión del lunes, y todos adoptan el mensaje nuevo. Tres semanas después, la tasa vuelve a donde siempre estuvo y nadie sabe si el mensaje nuevo es mejor, peor o igual.

02 La tabla de la cantidad necesaria

La cantidad necesaria para demostrarlo es un cálculo estándar. El Experimentador —el asistente que diseña la prueba— lo hace y te lo muestra antes de empezar. No necesitas conocer la fórmula, sino saber leer la tabla.

de → apor versióntotala 50/semanaa 200/semana
3% → 5%~1.500~3.00060 semanas15 semanas
3% → 6%~700~1.40028 semanas7 semanas
20% → 30%~300~60012 semanas3 semanas
20% → 35%~140~2806 semanas1,5 semana
50% → 65%~170~3407 semanas2 semanas

Observa dos cosas. Primero: cuanto más baja la cifra inicial, más ejecuciones exige; demostrar un 3 % es casi imposible en una empresa pequeña. Segundo: cuanto mayor sea el aumento esperado, menos ejecuciones hacen falta, pero el aumento debe ser real, no un deseo.

La dueña de la clínica envía 50 propuestas por semana y quiere subir la conversión de ventas del 3 % al 5 %. Según la tabla, hacen falta 1.500 propuestas por versión: 60 semanas para una sola prueba. Más de un año para responder una pregunta. El ciclo sí funciona; lo que no se puede responder es esa pregunta a ese ritmo.

03 Tres tipos de cifra, tres velocidades

La solución para la clínica no es dejar de medir, sino medir una cifra más rápida que siga relacionada con el dinero. LOOP-R divide las métricas en tres tipos. Dinero: conversión, importe, margen: el cliente responde semanas después y demostrarlo lleva meses. Señal: tasa de respuesta, reservas, clics útiles: el cliente responde en horas o días; demostrarlo toma semanas. Entregable: ¿la propuesta cumple la lista de comprobación?, ¿tiene errores?, ¿el tono es adecuado? Se responde mirando el texto, en minutos.

La regla del ciclo: probar la cifra más rápida que aún tenga una relación plausible con el dinero. El dinero no desaparece: pasa a ser un indicador («sin empeorar la conversión») mientras no haya volumen para probarlo directamente.

En la empresa de software, la responsable de soporte tiene las tres: dinero es la renovación del contrato (meses); señal es «resuelto en el primer contacto» (días); entregable es «¿la respuesta cumple la lista?» (minutos). Su ciclo gira cada semana con el entregable y la señal, y vigila las renovaciones.

Antes: medir el dinero

Clínica, 50 propuestas/semana. Meta: conversión de ventas del 3 % al 5 %. Cantidad necesaria: 1.500 por versión. 60 semanas hasta la primera respuesta fiable.

Después: medir la señal y vigilar el dinero

La misma clínica, el mismo ritmo. Meta: tasa de respuesta del 20 % al 30 %, sin empeorar la conversión. Cantidad necesaria: 300 por versión. 12 semanas.

Balance: 48 semanas menos para obtener una primera respuesta fiable: el dinero sigue vigilado, pero deja de ser la meta.

04 «Muestra insuficiente» es la respuesta más habitual y hay que aceptarla

El Evaluador, el asistente que juzga la prueba, solo puede dar tres respuestas: B ganó con margen, A sigue, ou muestra insuficiente: continúa la prueba. Si la cantidad de ejecuciones aún no alcanza el tamaño de muestra necesario, la respuesta siempre es la tercera. No existe «pero va ganando».

Detenerse antes porque va ganando es la forma más común de convertir ruido en regla. La tabla anterior indica cuándo termina la prueba; las ganas de ver el resultado, no. Solo se permite detenerla antes si cae un indicador: se para porque está causando daño, no porque vaya bien.

En el caso real de la clínica estética que acompaña este curso, el primer ciclo casi empezó mal: el Optimizador esperaba un efecto pequeño y el Experimentador avisó que la prueba tomaría 40 semanas. La dueña la dimensionó según la meta de la ficha (del 20 % al 30 %): 300 propuestas por versión. La prueba cupo en el calendario antes de enviar el primer mensaje.

Ponte a prueba

Semana 5 de una prueba de 12 semanas del agente inmobiliario: el mensaje B tiene un 31 % de reservas frente al 22 % de A, con 140 contactos por grupo. La cantidad necesaria es 300 por versión. ¿Qué hacer?

05 Segmentar exige treinta por segmento

Después de contar, el Crítico —el asistente que identifica qué funcionó y qué falló— querrá segmentar por tipo de cliente, canal o día de la semana. Cada segmento obedece la misma regla de pocos datos. «Los martes convierten más», con 12 propuestas, no es un patrón. El Crítico solo puede identificar un patrón con al menos 30 ejecuciones en el segmento.

Por eso cada afirmación suya lleva una etiqueta de fuerza. Sólida : 90 ejecuciones o más: se convierte en una hipótesis prioritaria. Moderada : de 30 a 89: se convierte en hipótesis. Débil : menos de 30: pasa a la memoria como «observado, no probado» y se revisa cuando aumenten los datos. Nada se pierde ni se convierte en regla antes de tiempo.

En la clínica, el Crítico observó que respondían más los clientes de tratamientos faciales que los de tratamientos corporales: 14 frente a 11. Etiqueta: débil. La observación quedó guardada y, tres meses después, con 60 en cada grupo, se convirtió en una hipótesis moderada para probar. Si se hubiera vuelto regla el primer mes, habría sido una regla basada en 25 personas.

Doce propuestas no dicen nada. Trescientas empiezan a hablar.

Pratique agora 0/4 feito

Elige la métrica que puedes demostrar

Para cada negocio, elige una métrica realista, indica cuántas ejecuciones necesita cada versión (usa la tabla del paso 02) y cuántas semanas tomará al ritmo indicado. Unos 10 minutos. Es un análisis: una prueba real lleva semanas; aquí haces en minutos el cálculo del Experimentador.

Nada cambia en tu negocio hasta que lo apruebes: solo haces cálculos en papel. Si tu cifra no coincide con la clave, comprueba que leíste la fila correcta; el error más común es mirar «total» en vez de «por versión».

Caso 1: Renata, clínica estética. 50 propuestas por semana. Hoy responden el 20 % y compra el 3 %. Ella quiere «vender más».

Caso 2: Marcos, agente inmobiliario. 200 contactos semanales del portal. Hoy, el 20 % reserva una visita; cree que el mensaje nuevo lo elevará al 35 %.

Caso 3: Paula, soporte. 400 tickets por semana. Hoy, el 50 % se resuelve en el primer contacto; la meta es el 65 %.

Clave comentada

Caso 1. «Vender más» es una métrica de dinero (3 % → 5 %): 1.500 por versión, 60 semanas a 50 por semana. No es viable. Una métrica realista es la tasa de respuesta, del 20 % al 30 %, con la conversión como indicador: 300 por versión, 600 en total, 12 semanas.

Caso 2. La reserva es una señal y ya tiene volumen: del 20 % al 35 % requiere 140 por versión, 280 en total. A 200 por semana: una semana y media. Si el efecto real es menor de lo que espera (solo 30 %), hacen falta 300 por versión y 3 semanas. El Experimentador diseña según la meta de la ficha, no según la esperanza.

Caso 3. Resuelto en el primer contacto es una señal: del 50 % al 65 % requiere 170 por versión, 340 en total. A 400 por semana: menos de una semana. Indicadores: reaperturas a 7 días y satisfacción; si no, «resuelto» se convierte en «cerrado».

Acabas de hacer el cálculo que distingue el azar de un patrón para tres ritmos de negocio distintos.

Resumen

  • Con pocos datos, el azar produce «victorias» continuamente: ocho caras en doce lanzamientos ocurre una de cada cinco veces.
  • El Experimentador calcula y muestra de antemano la cantidad necesaria: del 3 % al 5 % cuesta 1.500 por versión; del 20 % al 30 %, 300.
  • Cuando el dinero tarda demasiado en medirse, el ciclo prueba una señal más rápida relacionada y vigila el dinero como indicador.
  • Antes de la meta, solo existe «muestra insuficiente»; la única parada anticipada es por la caída de un indicador, nunca por ir ganando.
  • Segmentar requiere 30 por segmento; por debajo, la observación queda guardada como «observado, no probado».

Tu siguiente paso

Ahora puedes usar la tabla para saber si una prueba cabe en el calendario de tu negocio.

Durante los próximos 15 minutos: cuenta cuántas ejecuciones tiene tu proceso por semana (propuestas, contactos, tickets) y busca en la tabla la fila de tu meta. Escribe «N por versión, X semanas» junto a la meta que te enviaste por WhatsApp en la clase anterior.

En la próxima clase aprenderás a medir algo que no depende de que responda el cliente: la lista de comprobación de sí o no, que se completa en minutos y donde trabaja el ciclo cada semana.

Ruta 04 · Clase 3

La lista de comprobación:
sí o no

Al terminar esta clase, podrás escribir una lista de 6 preguntas de sí o no sobre el texto que produce tu IA; preguntas que dos personas distintas responderán igual, sin discutir.

Cuando el resultado depende de que responda un cliente, la prueba toma semanas. Pero mucho de lo que quieres saber está en el texto: ¿tiene menos de 80 palabras?, ¿menciona algo que dijo el cliente?, ¿promete un plazo? Eso se comprueba en minutos. Pero «pon una nota del 1 al 10» no sirve: ni dos personas ni la misma IA dos semanas después darán la misma nota.

↓ desplázate para estudiar

01 Una nota del 1 al 10 mide el humor de quien evalúa

Pide a dos personas que puntúen una propuesta comercial. Una le da 7 y otra 8; ambas tienen razón, porque «7» no significa nada que pueda comprobarse. Pídele una nota a una IA y repite la semana siguiente: también cambia. Los jueces de texto, humanos o no, tienen sesgos conocidos: prefieren textos más largos, prefieren el segundo que leen y cambian de opinión entre semanas.

La solución no es encontrar un juez mejor, sino cambiar la pregunta. «¿Esta propuesta es buena?» no se puede comprobar. «¿Esta propuesta tiene exactamente una pregunta de cierre?» sí: se responde sí o no, y cualquiera que lea el texto responderá igual. Una lista de comprobación es eso: preguntas que no dejan espacio para gustos personales.

La dueña de la clínica pasó meses pidiéndole a su asistente «mejora esta propuesta» y recibiendo versiones distintas, sin saber si eran mejores. Cambió la petición por «¿la propuesta menciona algo concreto que dijo la clienta?, ¿tiene como máximo 80 palabras?, ¿promete un plazo?». Por primera vez, ella y la recepcionista respondieron lo mismo sobre la misma propuesta.

02 Modelo de lista: siete preguntas para una propuesta

Lo que sigue parece una ficha de inspección de un auto, y eso es exactamente: cada línea es una pregunta que se responde mirando solo el texto. No hace falta completarla ahora; basta con reconocer el formato, porque tu lista tendrá el mismo aspecto.

R1  ¿Tiene como máximo 80 palabras?                            sí/no
R2  ¿La primera frase menciona algo específico del cliente?    sí/no
R3  ¿Incluye exactamente UNA pregunta de cierre?                sí/no
R4  ¿No promete un plazo? (invariante)                         sí/no
R5  Si hay descuento, ¿es como máximo del 10 %? (invariante)   sí/no
R6  ¿No contiene errores sobre el producto (verificado en la base)? sí/no
R7  Tono: ¿sin doble exclamación, «imperdible» ni MAYÚSCULAS? sí/no

Fíjate en tres cosas. Cada pregunta se puede contar o ver: palabras, frases o algo que está o no está en el texto. Dos preguntas están marcadas como invariante: vienen de la respuesta 3 de la ficha del ciclo: lo que nunca cambia por sí solo. Una versión que falle en una sola ocasión pierde, sin importar lo demás. Ninguna pregunta usa «adecuado», «bueno» o «profesional».

Para el agente inmobiliario, la lista para responder a contactos del portal es parecida, pero con otras preguntas: ¿menciona el inmueble o la dirección que consultó el contacto?, ¿ofrece dos horarios de visita, ni uno ni tres?, ¿evita indicar un precio inferior al de lista (invariante)?, ¿evita «oportunidad única»?

Cómo escribir tu lista

  1. Separa 5 textos que aprobaste y 5 que pediste rehacer. Reales, no imaginarios.
  2. Escribe qué tienen los buenos que no tienen los malos, en forma de pregunta. «¿Menciona algo del cliente?» y no «¿Es personalizado?».
  3. Elimina toda pregunta que requiera responder «depende». Si dudaste al responder, el juez también dudará.
  4. Marca las invariantes. Lo que viene de la respuesta 3 de la ficha se convierte en pregunta con la etiqueta «(invariante)».
  5. Responde tú misma las preguntas en los 10 textos. Si un texto «bueno» obtiene menos síes que uno «malo», la lista mide lo equivocado.
  6. Pide a otra persona que responda sin hablar contigo. Donde no coincidan, reescribe la pregunta.

03 Calibrar al juez: veinte minutos, una vez

En el día a día, quien responde la lista no eres tú, sino el Evaluador. Hay que contrastarlo contigo porque los jueces se desvían. El producto pide una única tarea manual de medición en todo el ciclo: responder sí o no a cada pregunta para 10 a 20 textos. Veinte minutos, una vez. Esos textos y tus respuestas forman el conjunto de calibración.

En cada ciclo, antes de juzgar algo nuevo, el Evaluador responde sobre esos mismos textos. Si coincide contigo en menos del 80 % de las respuestas, se etiqueta como «juez descalibrado»: el ciclo no promueve nada y avisa el Meta-agente, que solo observa e informa sobre el ciclo. Si una pregunta concreta de la lista tiene menos del 80 % de coincidencia, se reescribe o elimina esa pregunta.

Hay dos protecciones más que no tienes que operar, pero conviene conocer: el Evaluador compara las versiones por pares con el orden mezclado, tres veces, y toma la mayoría (así evita preferir la segunda); y, cuando el límite lo permite, usa un modelo de IA distinto al que redactó el texto para no aprobar su propio estilo.

La responsable de soporte eligió 15 respuestas a tickets: habría enviado 8 y devuelto 7. Marcó sí o no en las 6 preguntas de su lista. En la primera calibración, el Evaluador coincidió el 71 % de las veces. Casi toda la discrepancia venía de una pregunta («¿la respuesta es cordial?»). La cambió por «¿la respuesta llama al cliente por su nombre y termina preguntando si se resolvió?». Coincidencia: 93 %.

04 Cómo la lista se convierte en veredicto

La puntuación de un texto es simplemente la cantidad de respuestas «sí». Para comparar la versión actual con la candidata, el ciclo no mira una propuesta aislada: usa un conjunto fijo de 20 a 50 casos guardados y genera ambas versiones para cada caso. La versión B «gana en el entregable» si su promedio de síes supera al de A por al menos un criterio y y no falla ninguna invariante en ningún caso.

Esta prueba se ejecuta en minutos, sin clientes, cada semana. Por eso el ciclo puede avanzar mientras la métrica de señal reúne 300 ejecuciones: mientras el mundo responde despacio, el texto se comprueba rápido.

El agente inmobiliario guardó 30 contactos antiguos con el mensaje que envió cada uno como casos de comprobación. La nueva respuesta obtuvo una media de 5,4 sobre 6 frente a 4,1 de la anterior, pero en uno de los 30 casos indicó un precio por debajo de la lista. Perdió. Una infracción de una invariante pesa más que 1,3 puntos de ventaja media.

Error frecuente

Leer 12 propuestas, creer que la nueva versión es mejor y convertirla en regla. Ocurre porque la mirada selecciona lo que confirma nuestras expectativas y porque 12 es menos que el mínimo incluso para el entregable (20 a 50 casos). Evítalo usando casos fijos guardados antes de que exista la versión nueva y contando los síes, nunca con una lectura informal.

Practica ahora 0/6 completados

Escribe 6 preguntas de sí o no sobre tu texto

Termina con tu lista de comprobación: 6 preguntas, 2 invariantes, respondidas por ti y otra persona en los mismos 6 textos. Unos 15 minutos. Está lista cuando la otra persona completa las 36 casillas sin preguntar «¿depende de qué?».

Nada cambia en tu negocio hasta que lo apruebes: la lista es solo papel hasta que entre en la ficha del ciclo. Incluso entonces, solo comprueba textos; no envía, modifica ni borra nada. Si parece incorrecta, táchala y escríbela de nuevo; una mala versión no cuesta nada.

Ejemplo de resultado aceptable (responsable de soporte): 1. ¿Llama al cliente por su nombre? 2. ¿Repite el problema en una frase antes de responder? 3. ¿Tiene como máximo 120 palabras? 4. ¿No promete una fecha de solución? (invariante) 5. ¿No pide datos que ya están en el ticket? 6. ¿Termina preguntando si se resolvió? (invariante)

Acabas de escribir la regla que el ciclo usará cada semana y comprobaste que dos personas la interpretan igual.

Resumen

  • Una nota del 1 al 10 mide al evaluador, no al texto; una pregunta de sí o no, respondida mirando el texto, mide el texto.
  • La lista contiene preguntas contables o visibles. Las que vienen de la respuesta 3 de la ficha son invariantes: un solo «no» hace perder la versión.
  • El Evaluador se calibra contigo una vez usando de 10 a 20 textos. Por debajo del 80 % de coincidencia no se promueve nada y se reescribe la pregunta que causa discrepancias.
  • El veredicto sale de contar síes en 20 a 50 casos guardados: una prueba que toma minutos mientras el cliente tarda semanas.

Tu siguiente paso

Ahora puedes convertir «¿está bien?» en seis preguntas que cualquier persona de tu equipo responderá igual.

Durante los próximos 15 minutos: guarda en una carpeta los 10 textos usados (los 6 del ejercicio y otros 4 anteriores). Son tus primeros casos de comprobación: la nueva versión de tu IA se juzgará con ellos, no con tu recuerdo.

En la próxima clase llega el momento que determina si el ciclo sirve para algo: la tarjeta de decisión de 5 líneas y el caso real en que la clínica ganó 10 puntos, pero la respuesta correcta fue no aprobar.

Ruta 04 · Clase 4

La tarjeta de decisión
y el botón de retroceso

Al terminar esta clase, podrás leer una tarjeta de decisión de 5 líneas y responder aprobar, rechazar o esperar; además, dejarás escritas las respuestas 4 y 5 de la ficha: cuánto puede costar un ciclo y quién lo aprueba.

Después de la prueba llega el momento que decide si el ciclo sirve: alguien debe decir «sí, que sea la versión oficial». Si esa decisión llega continuamente a tu bandeja, dejarás de leer en el tercer mes. Si se automatiza demasiado pronto, entrará una versión peor sin que nadie lo note. La tarjeta lo resuelve con una regla: una decisión por semana, cinco líneas, tres respuestas y siempre un botón para volver atrás.

↓ desplázate para estudiar

01 Cinco líneas, como máximo una vez por semana

El tarjeta de decisión es lo único del ciclo que requiere tu atención. Llega como máximo una vez por semana y tiene cinco líneas fijas: hipótesis probada; resultado con cantidad y margen; estado de los indicadores; costo frente al límite; y las tres opciones. Nada más. Si hiciera falta más, no cabría en el viernes de nadie.

Lo que sigue parece un recibo, y lo es: cada línea es una cifra que ya sabes leer por las clases anteriores. Esta es la tarjeta que recibió la dueña de la clínica estética en el cuarto ciclo del caso real del curso.

CICLO 0004 — hipótesis: abrir la propuesta mencionando la reseña de la clienta Resultado: tasa de respuesta 19,3 % → 29,3 % (N = 300 frente a 300, margen OK) Indicadores: quejas, bajas y descuento medio; todos dentro de la tolerancia Costo: dentro del límite del ciclo Decisión: [aprobar] [rechazar] [esperar 2 semanas más]

Lee de arriba abajo como un resultado médico: primero qué se probó; después si cambió la cifra principal y con cuántas ejecuciones (300 por grupo era la cantidad necesaria); luego si falló algún indicador; por último, el costo. Solo entonces decides. La conversión de ventas no aparece porque no era el objetivo de la prueba: se vigilaba y no cayó.

02 Tres respuestas, y solo tres

Antes de que te llegue la tarjeta, el Evaluador ya emitió uno de tres veredictos: B ganó con margen, A sigue o la muestra es insuficiente. La tarjeta lo traduce en tus tres opciones. Aprobar: la candidata se convierte en la versión oficial. Rechazar: la versión actual sigue y la hipótesis pasa a la memoria como descartada, con el motivo. Esperar: la prueba continúa durante otro plazo.

¿Y si no respondes? Se aplica la opción segura: no se promueve nada y el historial registra «decisión pendiente». El ciclo no se queda parado: sigue ejecutando la versión actual, pero tampoco decide por ti.

El agente inmobiliario recibió la tarjeta durante su turno del viernes y no la abrió. El lunes, el historial mostraba «ciclo 0003: pendiente desde hace 3 días». La versión anterior siguió respondiendo a los contactos, sin cambios. Cuando abrió la tarjeta el martes, seguía igual: el ciclo no había decidido por él.

Error frecuente

Aprobar porque la nueva versión «parece mejor». Ocurre porque el texto nuevo se ve más bonito o porque tú propusiste la hipótesis. Para evitarlo, solo aprueba cuando la línea 2 indique que B ganó con margen y se alcanzó el mínimo. Si tu preferencia contradice la línea 2, manda la línea 2: la memoria guarda la hipótesis para otra prueba, no para olvidarla.

03 El caso real: ganó diez puntos y no pasó

En el segundo ciclo de la clínica, la hipótesis era «propuestas de hasta 80 palabras». El resultado principal fue excelente: la tasa de respuesta subió del 19,3 % al 29,7 %, con 300 propuestas por grupo: diez puntos de aumento, no suerte. Pero la línea de indicadores mostraba 6 quejas frente a 1 y la tolerancia tolerancia a las quejas estaba en cero. Veredicto: A sigue. La hipótesis se descartó.

El sistema hizo lo que debía: aplicó la regla tal como estaba escrita, no promovió y registró el resultado. El error estaba en la regla. Las quejas son poco frecuentes, cerca del 1 %: en 300 propuestas, tener 6 de un lado y 1 del otro puede ocurrir fácilmente por azar. Era ruido, no una diferencia real. La tolerancia cero convirtió el ruido en rechazo.

La lección no es «ignora el indicador cuando la ganancia sea grande»: eso destruiría la única garantía sólida del ciclo. La tolerancia se calcula, no se decide por gusto: para un evento del 1 % en 300 ejecuciones, la fluctuación normal es de un punto aproximadamente, así que la tolerancia adecuada es 0,01, no cero. La dueña ajustó la ficha para las próximas pruebas. La hipótesis descartada quedó en la memoria con su motivo y, dos ciclos después, ganó otra hipótesis.

04 Respuesta 4 de la ficha: el límite

La cuarta línea de la tarjeta —el costo— existe porque fijaste un límite en la ficha. La respuesta 4 indica cuánto puede costar un ciclo y cuánto tiempo tuyo puede requerir por semana. El Guardián detiene el ciclo al alcanzar el límite. Sin límite, el ciclo puede costar más que la ganancia que busca y nadie lo nota hasta que llega la factura.

El Meta-agente —el asistente que solo observa e informa sobre el ciclo— también vigila desde el primer ciclo una segunda cifra: el costo por hipótesis que se hizo oficial. Si no se promueve nada en cinco ciclos, propone una de tres opciones: ejecutar con menos frecuencia, usar asistentes más baratos para leer o cargar menos memoria. Propone; tú decides.

En la ficha modelo del producto, la línea de costo dice «R$ 41 en este ciclo (límite R$ 50)». La cifra es ilustrativa, pero el formato siempre compara gasto y límite. La responsable de soporte fijó su límite en dos partes: hasta R$ 60 por ciclo y como máximo una hora de su atención semanal para leer la tarjeta y la evidencia, si quiere.

Cómo completar las respuestas 4 y 5 de la ficha

  1. Límite de dinero por ciclo. Un poco por encima del costo de un ciclo típico: el Guardián se detiene al llegar al límite, así que un límite demasiado ajustado interrumpe buenas pruebas.
  2. Límite de tu tiempo por semana. Lo que puedas sostener en el mes 4, no en el mes 1. Una hora es realista; «cuando pueda» no es un límite.
  3. Nivel inicial de aprobación: L1. Apruebas cada tarjeta. Nunca empieces en L2, por mucha confianza que tengas.
  4. Plazo para responder a la tarjeta. Por ejemplo, 7 días. Si vence el plazo, no se promueve nada y queda «pendiente».
  5. Condición para subir a L2. Cinco aprobaciones en L1 sin ningún retroceso. Escribe la cifra; sin ella, la promesa de «más adelante lo automatizo» nunca llega.

05 Respuesta 5: quién aprueba y el botón para volver

La respuesta 5 de la ficha indica quién aprueba y tiene tres niveles. L0: el ciclo solo informa; nada se vuelve oficial. L1: el ciclo propone; tú apruebas cada tarjeta. L2 : cuando el veredicto es B ganó, el ciclo promueve automáticamente y te avisa; solo se desbloquea después de cinco promociones correctas en L1. Existe L3 (que el ciclo se rediseñe a sí mismo), y la última clase de esta ruta explica por qué aún es investigación.

Lo que hace aceptable L2 y seguro L1 es el botón para volver. En el primer ciclo después de una promoción, si la métrica de prueba o algún indicador cae por debajo del valor de la versión anterior más allá de la tolerancia, vuelve la versión anterior. En L1, la tarjeta avisa y pide tu confirmación. En L2, revierte automáticamente y te avisa. En ambos casos, el historial conserva el motivo: nada desaparece ni se sobrescribe.

El agente inmobiliario promovió la nueva respuesta en el ciclo 5. En el ciclo 6, las reservas bajaron del 31 % al 19 %, por debajo del 22 % de la versión anterior. La tarjeta incluía otra línea: «caída más allá de la tolerancia; ¿volver a la versión anterior? [sí] [mantener]». Volvió atrás. La versión promovida quedó en el historial con la fecha, las cifras y la etiqueta «revertida», para no volver a probarla como si fuera nueva.

Practica ahora 0/5 completados

Decide sobre tres tarjetas y escribe tu límite

Para cada tarjeta, escribe aprobar, rechazar o esperar, con el motivo en una línea. Después completa las respuestas 4 y 5 de tu ficha. Unos 12 minutos. Es un análisis porque una decisión real cambia la versión oficial de un negocio; aquí practicas con tarjetas preparadas, dos reales, antes de decidir sobre el tuyo.

Nada cambia en tu negocio hasta que lo apruebes: las tarjetas 1 y 2 son del caso real de la clínica (ya decididas); la 3 se creó para esta práctica. Tus respuestas 4 y 5 irán a la ficha cuando las lleves a la última clase del curso.

TARJETA 1 (real: clínica, ciclo 0002): hipótesis: propuestas de hasta 80 palabras. Resultado: tasa de respuesta 19,3 % → 29,7 % (N = 300 vs. 300, margen correcto). Indicadores: quejas 6 vs. 1; tolerancia 0 · bajas y descuentos dentro del límite. Costo: dentro del límite. Decisión: [aprobar] [rechazar] [esperar]
TARJETA 2 (real: clínica, ciclo 0004): hipótesis: empezar mencionando la evaluación de la clienta. Resultado: tasa de respuesta 19,3 % → 29,3 % (N = 300 vs. 300, margen correcto). Indicadores: quejas, bajas y descuentos, todos dentro del límite · conversión 3,7 % vs. 3,0 % (sin significancia). Costo: dentro del límite. Decisión: [aprobar] [rechazar] [esperar]
TARJETA 3 (construido: agente inmobiliario, ciclo 0002): hipótesis: ofrecer dos horarios de visita en la primera respuesta. Resultado: reservas 22 % → 31 % (N = 140 vs. 138; cantidad necesaria: 300 por versión). Indicadores: ausencias sin cambios · descuento medio sin cambios. Costo: dentro del límite. Decisión: [aprobar] [rechazar] [esperar]
Clave comentada

Tarjeta 1: rechazar (A sigue). La regla escrita indica tolerancia cero y empeoró un indicador; la respuesta correcta es no aprobar. Después, haz lo que hizo la dueña: reconoce que 6 frente a 1 de 300 es ruido para un evento raro, ajusta a 0,01 la tolerancia de quejas en la ficha y conserva la hipótesis como descartada, con el motivo, para volver a probarla con la regla correcta. Ni «aprobar de todos modos» ni «tolerancia cero para siempre».

Tarjeta 2: aprobar. B ganó con margen, se alcanzó la cantidad mínima y ningún indicador cayó. La conversión no cambió de forma significativa, pero era vigilada, no objetivo, y no empeoró. La versión se vuelve oficial y el botón de retroceso queda listo para el siguiente ciclo. Eso fue lo que ocurrió: se promovió como v2.

Tarjeta 3: esperar. 140 es menos de la mitad de la cantidad necesaria. Una ventaja de nueve puntos con esta muestra significa «muestra insuficiente», sin «pero va ganando». Ningún indicador cayó, así que no hay motivo para parar: la prueba sigue hasta 300 por versión.

Respuestas 4 y 5 (ejemplo válido para la clínica). Límite: R$ 50 por ciclo y 1 hora semanal de la dueña. Nivel inicial: L1. Plazo para responder: 7 días; sin respuesta, no se promueve nada. Sube a L2 después de 5 aprobaciones en L1 sin retrocesos. Tu ficha puede tener otras cifras; lo importante es que haya una cifra en cada línea.

Acabas de decidir sobre dos tarjetas reales y una construida, y dejaste por escrito con cifras el límite y quién aprueba en tu ciclo.

Resumen

  • La tarjeta de decisión es lo único que requiere atención: cinco líneas, como máximo una vez por semana, para leer de arriba abajo antes de decidir.
  • Solo hay tres respuestas: aprobar, rechazar y esperar. El silencio significa «nada promovido, pendiente».
  • En el ciclo 0002 de la clínica, el sistema rechazó una ganancia de diez puntos por un indicador con tolerancia cero; la regla se aplicó correctamente, pero había que calcular la tolerancia.
  • El límite (respuesta 4) es lo que usa el Guardián para detener el ciclo; el nivel de aprobación (respuesta 5) empieza en L1 y solo pasa a L2 después de cinco aciertos.
  • El retroceso funciona en todos los niveles: una caída en el ciclo posterior a la promoción restaura la versión anterior y deja el motivo en el historial.

Tu siguiente paso

Ahora puedes decidir sobre una tarjeta real sin dejarte llevar por el tamaño de la ganancia y ya escribiste el límite y quién aprueba en tu ciclo.

Durante los próximos 15 minutos: abre la ficha del ciclo que estás preparando y escribe con cifras, en las líneas 4 y 5, lo que respondiste en la práctica. Solo faltan esas dos para completar la ficha en la Ruta 5.

En la última clase de esta ruta, sobre honestidad, verás qué garantiza el ciclo por diseño, qué no garantiza en absoluto y cómo reconocer cuando alguien vende lo segundo como si fuera lo primero.

Ruta 04 · Clase 5

Lo que LOOP-R
no garantiza

Al terminar esta clase, podrás decir, en una frase cada una, las cuatro cosas que el ciclo garantiza por diseño y las cuatro que no garantiza, y reconocer una promesa falsa cuando alguien la venda.

Toda esta ruta pidió pruebas. Sería extraño terminar prometiendo algo sin ellas. Esta es, entonces, la clase de honestidad: qué garantiza un ciclo de mejora porque fue diseñado para ello y qué depende de tu volumen, tu mercado y la suerte. Saber distinguirlo evita que abandones el ciclo al tercer mes por frustración y que confíes en él más de lo que puede sostener.

↓ desplázate para estudiar

01 Cuatro garantías, y ninguna es «la cifra sube»

Ningún ciclo de aprendizaje garantiza que la cifra suba. Ni siquiera este; la dueña de la clínica estética lo leyó en la primera pantalla del producto, antes de completar la ficha. LOOP-R garantiza cuatro cosas, todas por diseño: se cumplen porque existen las reglas de las clases anteriores, no porque alguien lo haya prometido. Una versión peor nunca sustituye a la actual por decisión del sistema. Todo cambio queda registrado y se puede revertir. El ciclo siempre se ejecuta igual. El costo no supera el límite.

Junto a cada garantía está lo que no cubre. No sustituir una versión por otra peor no significa que la siguiente será mejor. Tener un registro no significa que contenga algo útil: puede decir «sin evidencia» durante diez ciclos seguidos. Ejecutarse siempre no significa que cada ciclo produzca una buena hipótesis. Respetar el límite no significa que el costo compense.

La regla que este producto sigue en todos sus textos: la palabra «garantizar» solo aparece acompañada de no regresión, un registro reversible o la constancia del ciclo. Si lees «garantiza más ventas» en cualquier material sobre ciclos de IA, incluso este, estás leyendo una promesa que nadie puede hacer.

Antes: la promesa que se vende

«La IA aprenderá de cada propuesta y mejorará tus ventas.» Ninguna cifra, condición ni plazo.

Después: lo que sí se garantiza

Para la clínica: ninguna versión con peores respuestas o margen peor se vuelve oficial; cada cambio tiene fecha, cifra y opción de volver atrás; el ciclo se ejecuta cada lunes; el gasto se detiene en R$ 50.

Balance: cuatro frases comprobables en el historial frente a una que no se puede comprobar en ninguna parte.

02 El vínculo aún no demostrado: señal → dinero

En la clase 2 sustituiste el dinero por una señal como objetivo de la prueba porque el dinero tarda demasiado. Eso tiene un costo que hay que decir: subir la señal no demuestra que suba el dinero. Es plausible —quien responde tiene más probabilidades de comprar—, pero lo plausible no está demostrado. Hasta que haya suficiente volumen, el vínculo entre ambos es una apuesta declarada, no un resultado.

El caso real de la clínica lo muestra con claridad. En el ciclo 0004, la tasa de respuesta subió del 19,3 % al 29,3 % y la versión se promovió con razón. La conversión en ventas pasó del 3,0 % al 3,7 %: con 300 propuestas por grupo, esa cifra no se distingue del azar. El informe del ciclo dice exactamente eso: «el vínculo señal → objetivo sigue sin demostrarse». Diez puntos más de respuestas, y todavía no se puede afirmar nada sobre las ventas.

El agente inmobiliario enfrenta el mismo vínculo con otros nombres: más visitas concertadas todavía no han demostrado más ventas cerradas. Su ciclo optimiza las citas y vigila los cierres. Cuando haya 1.500 contactos por grupo, el cierre podrá convertirse en objetivo. Antes de eso, decir «el ciclo aumentó las ventas» sería repetir la promesa sin fundamento.

Ponte a prueba

Ciclo 0004 de la clínica: respuesta 19,3 % → 29,3 % (N = 300 frente a 300, significativo); conversión 3,0 % → 3,7 % (no significativo). ¿Qué se puede afirmar?

03 «Sin evidencia» durante diez ciclos seguidos es un resultado posible

El ciclo garantiza que se ejecute cada semana. No garantiza que la semana traiga una buena idea. Es posible —y común en un negocio pequeño— que el Crítico solo encuentre observaciones débiles durante varios ciclos, que el Optimizador no tenga propuestas y que el historial acumule «evidencia insuficiente» línea tras línea. Eso no significa que el ciclo esté roto. Está diciendo la verdad sobre el volumen disponible.

Dos cosas siguen siendo valiosas durante esas semanas. La memoria de hipótesis descartadas crece y vale tanto como la de las promovidas: evita que tú u otra persona vuelva a probar la misma mala idea. El Meta-agente, que solo observa e informa, calcula el costo por hipótesis promovida. Si no se promueve nada en cinco ciclos, propone ejecutarlo con menos frecuencia en vez de fingir progreso.

La responsable de soporte pasó por seis ciclos así entre marzo y abril: había muy pocos casos por tipo para que el Crítico identificara un patrón. Siguiendo la propuesta del Meta-agente, redujo la frecuencia a quincenal y dejó que la hoja de registro acumulara datos. En junio, con 30 casos del tipo más común, apareció la primera hipótesis moderada. Su historial tiene seis registros de «sin evidencia» y considera honestos los seis.

04 Qué sigue siendo investigación y qué es el cuello de botella

Una parte de la idea de LOOP-R aún no está lista para ningún negocio: que el ciclo se rediseñe a sí mismo, el nivel L3, donde el Meta-agente propone cambiar asistentes, alterar el orden del ciclo o reescribir sus propias reglas. Eso es investigación. En el producto que enseña este curso, el Meta-agente solo informa: costos, hipótesis generadas frente a promovidas, quién recibe más vetos del Guardián y si el juez está calibrado. No ejecuta acciones. Quien prometa un sistema que «se mejora a sí mismo» está vendiendo algo que todavía no existe de forma segura.

Y está el cuello de botella que ningún asistente resuelve: la hoja de registro. Sin pruebas, lo demás es teatro; los datos de tu negocio están en WhatsApp, en el cuaderno de recepción o en la cabeza del vendedor. El producto se conecta a una sola cosa: una hoja con columnas definidas en la ficha. Tú la completas o exportas los datos. Cada integración directa con otro sistema es un proyecto aparte; ninguna viene incluida con las cinco respuestas.

Para la clínica y el agente inmobiliario, la conclusión es la misma y sirve para evaluar cualquier promesa: LOOP-R como disciplina de proceso —registro, pruebas con muestras suficientes y no regresión— ya tiene valor por sí sola. LOOP-R como «sistema que aprende solo» depende de un volumen de datos que la mayoría de los pequeños negocios no tiene. Un producto honesto lo dice desde la primera pantalla.

El ciclo no promete que la cifra suba. Promete que no bajará por decisión del sistema.

Practica ahora 0/3 completados

Verdadero o falso: ocho afirmaciones sobre garantías

Marca V o F en cada afirmación y, en las falsas, escribe en una línea qué garantía real está exagerando. Unos 8 min. Es un ejercicio de análisis: no se puede «practicar» una garantía; se aprende a reconocerla al leer propuestas de venta.

Nada cambia en tu negocio hasta que lo apruebes: aquí solo lees y marcas. Equivocarte es útil; cada afirmación falsa que marques como verdadera es una promesa que alguien podría intentar venderte.

  • 1 Después de cuatro ciclos, la tasa de respuesta necesariamente habrá subido.
  • 2 Una versión peor nunca sustituye a la actual por decisión del sistema.
  • 3 Todo cambio se puede revertir, y queda registrado cuándo, con qué cifras y por qué.
  • 4 Si no se responde la tarjeta a tiempo, el sistema promueve por defecto para que el ciclo no se detenga.
  • 5 El costo de un ciclo nunca supera el límite que anotaste en la ficha.
  • 6 Si el costo quedó dentro del límite, el ciclo compensó.
  • 7 Diez ciclos seguidos con «sin evidencia» significan que el ciclo se rompió.
  • 8 El ciclo se ejecuta igual cada semana, aunque nadie tenga una buena hipótesis.
Clave comentada

1 — F. Exagera la no regresión: el ciclo garantiza que la cifra no caiga por decisión suya, no que suba.

2 — V. Es la garantía central: el Evaluador solo promueve si el margen y los indicadores se mantienen intactos; de lo contrario, «A sigue».

3 — V. Registro con botón para volver atrás. Cada promoción y reversión queda en el historial con fecha, cifras y motivo.

4 — F. Exagera la constancia del ciclo: sigue ejecutándose, pero si no hay respuesta, lo normal es no promover y registrar «pendiente».

5 — V. El Guardián detiene el ciclo al alcanzar el límite.

6 — F. Exagera el límite: respetarlo garantiza el gasto, no el retorno. El costo por hipótesis promovida es otro cálculo, que informa el Meta-agente.

7 — F. Exagera la constancia: se garantiza que el ciclo se ejecute, no que produzca una buena hipótesis cada semana. Diez resultados de «sin evidencia» son honestos, y las ideas descartadas quedan en la memoria.

8 — V. Constancia del ciclo. Es la garantía más sencilla y la que más protege frente a «dejamos de hacerlo en el tercer mes».

Acabas de separar, afirmación por afirmación, lo que el ciclo puede respaldar de lo que nadie puede respaldar; es la misma lectura que aplicarás a la próxima promesa que aparezca.

Resumen

  • Por diseño, el ciclo garantiza cuatro cosas: no elige una versión peor, todo queda registrado y se puede revertir, el ciclo se ejecuta siempre igual y el costo respeta el límite.
  • Cada garantía tiene un límite asociado: ninguna asegura que la próxima versión será mejor, que el registro será útil, que cada ciclo traerá una buena idea o que el costo compensará.
  • Que suba la señal no demuestra que suba el dinero: en el caso real, la respuesta aumentó diez puntos, pero la conversión aún no se distingue del azar.
  • El ciclo que se rediseña a sí mismo sigue siendo investigación, y la hoja de registro es el cuello de botella que ningún asistente puede resolver por ti.

Tu siguiente paso

Ahora puedes analizar una promesa sobre IA y decir, con la tabla en mente, cuál de las cuatro garantías está exagerando.

Durante los próximos 15 minutos: relee la ficha del ciclo que preparaste en las rutas anteriores y tacha cualquier frase que prometa que una cifra subirá. Sustitúyela por una de las cuatro garantías, con una cifra de tu ficha («el sistema no dejará que la respuesta baje del 20 %»).

En la Ruta 5 seguirás de principio a fin los cuatro ciclos reales de la clínica, anticiparás el quinto y entregarás la ficha completa con la primera tarjeta de decisión rellenada.