Formación en Cine con IA · Curso 3
Ocho clases para entrenar el ojo que decide: intención, ancla, composición, luz y profundidad: lo que distingue cualquier imagen de una escena que atrapa.
Lecciones
Sal preparado para evaluar cualquier escena con las cuatro preguntas que sostienen una decisión de dirección.
Descubre qué mantiene la atención en cada tipo de trabajo y elige el ancla antes de generar cualquier cosa.
Arma toda la línea de preproducción: guion, storyboard, personaje, vestuario, entorno y lista de planos.
Convierte el storyboard en una secuencia animada — con un movimiento de cámara claro por plano.
Usa la contradicción, el ambiente y la revelación para crear una pregunta en la mente de quien mira.
Diseña hacia dónde va la mirada, plano a plano: tercios, líneas, espacio vacío y escala, cada uno en el momento adecuado.
Diez maniobras de luz para controlar lo que siente el público, incluido el arte de quitar luz en vez de ponerla.
Arma el primer plano, el plano medio y el fondo en cada encuadre, y cuenta relaciones humanas solo con la posición y la mirada.
Curso 3 · Clase 1
Al final de esta clase, evalúas cualquier escena, tuya o de otras personas, respondiendo las cuatro preguntas que sostienen una decisión de dirección.
La IA ejecuta la dirección; no crea la intención. Si la escena no tiene lógica interna, un punto focal definido y un motivo para la cámara, el resultado será inconsistente, sin importar cuán avanzada sea la herramienta. Todo este curso entrena la parte que la máquina no hace por ti.
ver esta clase en video (inglés · opcional)
↓ desplázate para estudiar
Hay una división del trabajo que este curso no te deja olvidar: la herramienta genera píxeles; quien genera sentido eres tú. Una escena sin lógica interna queda bonita y vacía; ninguna actualización tecnológica puede arreglar el vacío.
Aquí, la intención tiene una definición práctica: poder justificar cada decisión de la escena. Si la respuesta a «¿por qué este ángulo?» es «salió así», la escena pierde fuerza.
La fotógrafa vive esto en la sesión de fotos de graduación: cuando coloca a la familia a contraluz de la ventana, hay un motivo: destacar a quien se gradúa, suavizar los rostros. La IA necesita recibir ese mismo motivo por escrito.
La herramienta no tiene opinión. Toda buena escena es una opinión tuya, ejecutada.
Todo el curso se apoya en cinco leyes. Memoriza sus nombres ahora, porque las próximas clases profundizan en ellas una por una:
El dueño de un bistró probó las cinco leyes en el video de inauguración de su nuevo local: definió que la vista vería primero la puerta abriéndose, después el salón y, por último, el mostrador, y el video dejó de parecer una «grabación de celular».
Antes de cualquier generación, el director interroga a su propia escena: ¿Por qué este ángulo? ¿Por qué este movimiento? ¿Por qué esta duración? ¿Por qué esta luz? Cuatro preguntas, cuatro respuestas — o la escena vuelve a la mesa de trabajo.
El efecto secundario es liberador: las preguntas transforman «no quedó bien» (inútil) en un diagnóstico preciso («la duración no se justifica: corta 2 segundos»). Dejas de rehacer a ciegas.
La social media adoptó las preguntas durante la aprobación con la clienta de la posada: en vez de discutir sobre gustos, ambas responden juntas las cuatro preguntas, y la conversación termina en una decisión, no en una opinión.
Antes
"Genera un video del salón." El ángulo, el movimiento, la duración y la luz quedan al azar, y volver a hacerlo se convierte en una lotería.
Después
"Ángulo bajo para darle imponencia, cámara que avanza despacio porque es una invitación, 8 segundos porque es el tiempo necesario para leer el ambiente, luz del final de la tarde porque la casa vive de las cenas."
Resultado: cuatro respuestas escritas antes de generar, y cada nuevo intento mejora algo concreto, no la suerte.
En los próximos cursos encontrarás varias herramientas: generadores de imágenes, de video y de cámara. Guarda desde ahora la regla de la casa: cada herramienta tiene un papel definido dentro del flujo; ninguna decide por ti. Quien escala la herramienta adecuada para la tarea adecuada es el director.
Es el mismo razonamiento de la fotógrafa con su propio equipo: el teleobjetivo cumple una función, el reflector cumple una función — y ninguno de los dos elige la foto. La jerarquía siempre es: primero la intención, después el instrumento.
Ponte a prueba
Una escena generada quedó técnicamente perfecta, pero «no funciona». Según el marco de esta clase, ¿cuál es el diagnóstico más probable?
Practica ahora 0/3 hecho
Aplicar las cuatro preguntas a un caso concreto y comparar con la respuesta modelo: en ~10 minutos.
Es un ejercicio de lectura y decisión: no hay nada que instalar, generar ni arruinar de forma permanente. Discrepar de la respuesta correcta es parte del ejercicio; el valor está en justificar tu respuesta.
El caso: Regina, encargada de redes sociales, recibió de la pastelería un video generado por IA para el lanzamiento del pastel de exhibición: la cámara gira rápido alrededor del pastel, dura 20 segundos, tiene una luz blanca uniforme de tienda y un ángulo de arriba hacia abajo. A la dueña le pareció «moderno»; Regina sintió que «algo no encaja». El pastel es artesanal y se vende como una muestra de cariño familiar.
Un ángulo desde arriba aplana el pastel y recuerda a la vigilancia — para transmitir afecto, usa la altura de la mesa, como quien se sienta a comer. Un giro rápido vende tecnología, no calidez — un avance lento hacia el pastel invita. Veinte segundos para un solo producto cansan — 8 a 10 bastan. La luz blanca de tienda esteriliza — una luz cálida lateral, como la de una ventana de cocina, cuenta la historia adecuada. El error de la escena no era técnico: era la falta de intención — las cuatro respuestas describían una joyería, no una pastelería familiar.
Diagnosticastes una escena con las cuatro preguntas y la redirigiste por escrito — exactamente el criterio que pedía la promesa de esta clase.
Resumen
Curso 3 · Clase 2
Al final de esta clase, identificas el ancla adecuada para cualquier escena —persona, producto o ritmo— y la nombras antes de escribir el primer pedido para la IA.
En la clase pasada conociste las cinco leyes de toda escena que funciona. El ancla es la más decisiva de las cinco y también la más fácil de pasar por alto. Si no la nombras, la mirada de quien ve la escena vaga por todas partes y no se detiene en ningún lugar, aunque la luz, el ángulo y el movimiento sean técnicamente correctos.
↓ desplázate para estudiar
En esta formación, ancla es el elemento único que la vista encuentra primero en una escena y al que siempre regresa cuando se pierde. Toda escena que funciona tiene uno; toda escena confusa, cuando la analizas, no tiene ninguno: solo candidatos que compiten entre sí.
Sin el ancla nombrada antes de generar, la IA elige por su cuenta — normalmente el elemento técnicamente más llamativo, no el más importante para la narración. Un color intenso, el brillo o el movimiento: cualquiera de ellos gana por accidente si no decides antes.
Una fotógrafa que hace sesiones de embarazo decide esto antes de apretar el botón: enfocarse en las manos entrelazadas sobre la barriga, no en el vestido ni en la pared del estudio detrás. Esa decisión —tomada antes, no corregida después— es lo que la clase de hoy te enseña a repetir.
Cuando el tema son las personas, el ancla suele estar en un detalle humano: la mirada, un gesto de las manos, la curva de una sonrisa. Ese detalle transmite la emoción de toda la escena — lo demás (la ropa, el fondo, la luz ambiental) solo tiene que evitar competir con él.
Volviendo a la sesión de fotos de embarazo: si la solicitud para la IA solo describe «embarazada en estudio, luz suave», la máquina decide por su cuenta qué poner en el centro; a veces el rostro de frente, a veces el cuerpo entero, sin criterio. Nombrar el punto de referencia evita dejar esa decisión al azar.
Antes
"Sesión de fotos de maternidad en estudio, luz suave, fondo neutro." La IA elige el encuadre por su cuenta: a veces un retrato del rostro, a veces el cuerpo entero, sin repetir la elección entre intentos.
Después
"Manos entrelazadas sobre el vientre, en primer plano; luz lateral suave que resalta los dedos; rostro y fondo discretos, fuera del centro de atención."
Resultado: el ancla nombrada —las manos— se convierte en el criterio que debe respetar cualquier nuevo intento, en lugar de empezar de cero en cada generación.
Cuando el tema es un producto o un servicio, el ancla rara vez es el objeto inmóvil — es la transformación que provoca: el antes y el después que el video existe para mostrar. Una tienda entera, un mostrador, una vitrina: ninguno de estos es el ancla; son solo el escenario que la rodea.
El dueño de una heladería que estaba lanzando un sabor nuevo lo decidió en la práctica: en vez de mostrar el local, el congelador y al cliente pagando, el ancla pasó a ser un solo gesto: la cuchara hundiéndose en el pote y el helado escurriéndose por el borde. Todo lo demás del video empezó a servir a ese instante.
Es el mismo razonamiento que distingue un video institucional (lo muestra todo, no muestra nada) de un video de lanzamiento (muestra una sola cosa con claridad).
No todas las escenas tienen un objeto o un rostro que capte la mirada. En un video de baile, de entrenamiento o de cualquier actividad en movimiento continuo, el ancla puede ser el propio ritmo: el pulso, la cadencia, la repetición que crea una expectativa de continuidad.
La social media que gestiona las redes de una academia de danza aprendió esto al grabar los reels del grupo: sin un objeto o rostro fijo en cada corte, empezó a cortar siempre en el momento fuerte del movimiento. Los videos dejaron de parecer fragmentados porque el ancla (el ritmo) se mantuvo constante incluso al cambiar de ángulo.
El ancla no es el elemento más bonito de la escena. Es el elemento sin el cual la escena no existe.
Ponte a prueba
Un reel muestra una secuencia de saltos de un entrenamiento de baile, sin ningún objeto ni rostro que destaque de forma constante. ¿Cuál es el ancla más probable de esta escena?
Practica ahora 0/3 hecho
Lee el caso, elige el ancla entre cuatro candidatos y compara con la respuesta correcta — en ~8 minutos.
Es un ejercicio de lectura y elección: no hay nada que generar ni descargar, ni ningún costo. No existe una respuesta que rompa algo; solo una que enseña más que la otra.
El caso: Otávio, dueño de una tienda de bicicletas, pidió un video de lanzamiento para la nueva bicicleta eléctrica de la tienda. El primer resultado tenía cuatro elementos que competían por la atención: la fachada con luz de neón, el manubrio cromado brillante, el rostro sonriente del modelo contratado y el letrero de la tienda al fondo. En el grupo de prueba, después de ver el video, nadie supo decir cuál era el tema principal.
La bicicleta eléctrica es el ancla adecuada: es el producto que Otávio necesita vender y la transformación que importa —la nueva movilidad que ofrece—. El rostro del modelo compite por ser humano; el letrero y el neón compiten por ser llamativos, pero ninguno de los dos es el motivo de que exista el video. Una vez definida el ancla, la cámara y la luz se organizan en torno a ella: primeros planos del manubrio y de la rueda girando, el modelo aparece apenas como escala humana y la tienda queda reducida a un fondo discreto.
Aplicaste, a un caso que no es tuyo, el mismo razonamiento de esta clase — nombrar el ancla antes de juzgar la escena. Esa es exactamente la habilidad que pedía la promesa de hoy.
Resumen
Curso 3 · Clase 3
Al final de esta clase, preparas para una escena real de tu trabajo los cinco elementos que un estudio profesional decide antes de grabar: emoción objetivo, storyboard, personaje, entorno y lista de planos.
Ya sabes que la IA necesita una intención y sabes nombrar el ancla. Falta el vínculo que transforma esas dos decisiones en una escena completa, coherente de principio a fin: la misma línea de preproducción que recorre un estudio de cine antes de encender cualquier cámara, adaptada para que trabajes por tu cuenta.
ver esta clase en video (inglés · opcional)
↓ desplázate para estudiar
Antes de cualquier imagen, todo director profesional se hace una pregunta sencilla: ¿qué debe sentir el público en este momento? La respuesta es lo que decide después el ángulo, la luz y la composición — nunca al revés. Generar de inmediato sin responder esa pregunta es como cocinar sin saber qué plato estás preparando.
El dueño de una pizzería, mientras planeaba el video de lanzamiento de una pizza nueva para el Día del Padre, decidió esto antes de escribir cualquier pedido: la emoción era «calidez de una familia reunida», no «pizza apetitosa aislada en el plato». Esa única elección cambió el ángulo (mesa llena, no un primer plano aislado), la luz (cálida, de última hora de la tarde) e incluso la duración (más lenta, para dar tiempo a reconocer los rostros).
La emoción no decora la escena. La emoción decide la escena, antes de que exista cualquier imagen.
Un storyboard es la secuencia de cuadros sencillos —trazo tosco, sin color ni detalles— que muestra en qué orden aparecerá la historia en pantalla. Define el encuadre, el punto de vista de la cámara y el ritmo con el que aumenta la tensión, todo antes de que gastes una sola generación costosa.
El dueño de la pizzería dibujó cuatro cuadros sencillos, a mano, antes de abrir cualquier herramienta de imagen: la fachada de la pizzería de noche, el horno abriéndose con la pizza dentro, la pizza saliendo humeante, la mesa de la familia recibiendo el plato. Solo después de comprobar que ese orden tenía sentido en el papel, pasó a generar imágenes de verdad.
Equivocarse en el orden del borrador cuesta un lápiz; equivocarse en el orden de la generación final cuesta tiempo y cuota de la herramienta. Por eso, el storyboard siempre va primero.
Ponte a prueba
Ya sabes cuál es la emoción que buscas en la escena y estás listo para empezar. ¿Cuál es el siguiente paso antes de generar cualquier imagen final?
En la producción profesional, quien lleva la escena —una persona o un producto— se describe una sola vez, en un contexto neutro, y luego se reutiliza en cada escena nueva. Separar «quién es» de «dónde está» evita el problema más común de quienes generan imágenes por su cuenta: que el mismo producto parezca uno diferente en cada intento.
Para la campaña de la pizza nueva, el "personaje" no era una persona, sino la propia pizza, descrita una sola vez y reutilizada en todas las escenas siguientes.
Antes
Escena 1: «pizza margherita, masa fina, borde dorado». Escena 4: «pizza con albahaca y queso derretido». Dos descripciones independientes: las pizzas salen visiblemente distintas.
Después
Una sola descripción, escrita una vez: "pizza margherita, masa fina con el borde dorado, albahaca fresca, queso derritiéndose en los bordes." La misma frase se usa en cada escena nueva, sin volver a escribirla.
Resultado: una descripción reutilizada reemplaza cuatro descripciones sueltas; la pizza del fotograma 1 sigue siendo, visiblemente, la misma pizza del fotograma 4.
El entorno no es un fondo decorativo: define cuánto se intensifica o se expande la emoción del espectador. Un espacio estrecho acerca y crea intimidad o urgencia; un espacio amplio expande y crea generosidad o grandiosidad. La misma escena, en dos entornos diferentes, cuenta dos historias distintas.
En la campaña de la pizzería, la cocina estrecha y llena de vapor, filmada de cerca, creó una sensación de apuro y dedicación en la preparación; mientras que la mesa abundante al aire libre, filmada de lejos, creó una sensación de abundancia y celebración. La misma pizza, dos ambientes, dos emociones; y ambas escenas sirvieron a distintas partes del mismo video.
Con la emoción, el storyboard, el personaje y el entorno definidos, el último paso es traducir todo eso en una lista de planos: para cada uno, el tipo (general, medio, primer plano), la posición de la cámara, el movimiento y el propósito narrativo. Es la misma lógica de las cuatro preguntas de la lección 1, ahora aplicada plano por plano, no a toda la escena de una vez.
Un plano sin un propósito declarado es relleno: córtalo. Un plano con propósito es insustituible, aunque dure dos segundos.
Aplica la misma lógica
Practica ahora 0/5 hecho
Escribir, en papel o en un documento sencillo, los cinco elementos de la línea de preproducción para una escena real tuya — en ~15 minutos.
Es un ejercicio de planificación, sin abrir ninguna herramienta de generación: solo escribes. Nada de esto es definitivo; el objetivo es terminar con un borrador que puedas ajustar después, no con una versión perfecta al primer intento.
Está listo cuando tienes los cinco elementos escritos y puedes justificar cada uno en voz alta: la misma línea de preproducción que sostiene una escena profesional, adaptada a tu ritmo.
Resumen
Curso 3 · Clase 4
Al final de esta clase, escribes un pedido de movimiento de cámara desglosando el sujeto, el entorno, el movimiento y el estilo, en vez de usar un adjetivo vago, y conviertes un plano de tu storyboard en video.
Ya tienes el storyboard estático de la clase pasada. Las herramientas de video con IA entienden la física —posición, dirección, velocidad—, no entienden las sensaciones. Pedir «un movimiento dramático» es como pedirle a un conductor que «conduzca con emoción»: no sabe qué hacer con eso, y el resultado sale genérico o inestable.
ver esta clase en video (inglés · opcional)
↓ desplázate para estudiar
Toda herramienta de video con IA entiende la física, no los adjetivos. «Movimiento dramático» no significa nada para ella; «la cámara avanza despacio hacia el sujeto» significa todo. Elegir un movimiento concreto por plano, en lugar de una sensación vaga, es lo que separa una indicación que funciona de una que sale mal.
Tres movimientos cubren la mayoría de las escenas: el avance (la cámara se acerca al sujeto, crea tensión), el acompañamiento (la cámara sigue al sujeto mientras se mueve, crea fluidez) y el contorno (la cámara gira alrededor del sujeto, revela profundidad y volumen).
La fotógrafa que convirtió el storyboard de una sesión de pareja en un teaser animado eligió un movimiento para cada plano: avance lento en el plano inicial (crea expectativa), seguimiento en el plano de la pareja caminando de la mano (fluidez) y vuelta alrededor en el beso final (los revela a los dos, crea intimidad).
Los tres movimientos y cuándo usar cada uno
Además del movimiento, la distancia de la cámara al sujeto cambia lo que siente quien mira: un plano cerrado, o close-up, transmite emoción y detalle; un plano medio enfoca a la persona y la acción; un plano abierto transmite el entorno y la escala — «dónde estamos», antes que cualquier otra cosa.
En el teaser de la sesión de fotos de la pareja, el plano abierto mostró todo el jardín (establece el lugar), el plano medio mostró a la pareja caminando lado a lado (la acción principal) y el primer plano quedó reservado solo para las manos entrelazadas y el anillo: el instante que lleva la mayor emoción de todo el video.
El mismo movimiento puede tener estilos diferentes, y cada estilo transmite un ambiente propio: una cámara estabilizada, suave y controlada transmite calma; una cámara "en mano", más cruda e inestable, transmite urgencia o realismo; la cámara lenta transmite peso: el instante importa más que los demás.
La fotógrafa mantuvo la cámara estabilizada en todo el teaser, con una sola excepción: cámara lenta en el beso final, el único instante del video que debía pesar más que los demás.
Después de decidir los tres primeros elementos —movimiento, distancia y estilo—, el pedido para la herramienta de video sigue una estructura sencilla, siempre en el mismo orden: primero el sujeto (quién o qué aparece en la escena), luego el entorno (dónde ocurre, con uno o dos detalles de ambiente), después el movimiento de cámara elegido y, por último, el estilo. Este orden fijo evita que olvides algún elemento y mantiene el pedido breve.
Para el plano del beso: tema (la pareja, de perfil, acercándose), ambiente (jardín al atardecer, luz dorada y baja), movimiento (contorno lento), estilo (cámara lenta, suave). Cuatro frases, una escena completa decidida.
Una aclaración que evita frustraciones: el primer video generado rara vez sale perfecto, incluso cuando toda la estructura está bien. Regenerar, ajustar una palabra del pedido y volver a intentarlo es parte del proceso; el error más costoso no es necesitar un segundo intento, sino no saber diagnosticar por qué el primero no funcionó.
Error común
Pedir varios movimientos de cámara en el mismo plano: «rodea, avanza y además haz un paneo». El resultado suele salir borroso y sin una dirección clara, porque la herramienta intenta obedecer a todos al mismo tiempo y nada queda limpio. La fotógrafa lo intentó una vez en el plano del beso; al separarlo en dos planos —el contorno en uno y el acercamiento en el otro—, ambos quedaron limpios.
Practica ahora 0/4 hecho
Escribir un pedido de movimiento con las cuatro partes de la estructura y generar al menos un plano — en ~12 minutos.
Los generadores de video con IA que ofrecen un plan de prueba suelen limitar cuántas generaciones puedes hacer por día, y ese límite cambia con frecuencia. Por eso, escribe y revisa la solicitud completa antes de generar: primero prueba la estructura en papel, sin gastar un intento tras otro en pantalla.
Cinematic video shot, single clear camera movement only, 5-8 seconds. SUBJECT: <describe your subject — person, product, or scene> ENVIRONMENT: <where it happens, 1-2 details that set the mood> CAMERA MOVEMENT (choose exactly one): slow dolly in toward the subject / tracking shot following the subject / slow orbit around the subject STYLE (choose exactly one): smooth steadycam / raw handheld / dramatic slow motion Photorealistic, cinematic lighting, no text, no watermark.
Transformaste un cuadro estático del storyboard en un plano en movimiento, con una decisión nombrada detrás de cada elección: exactamente lo que prometía esta clase.
Resumen
Curso 3 · Clase 5
Al final de esta clase, planeas una escena que deja una pregunta en la mente de quien la ve, usando el entorno, la contradicción y una secuencia que revela las cosas poco a poco, en vez de mostrarlo todo en el primer segundo.
Ya sabes preparar la preproducción y animar un plano con un movimiento definido. Pero un video técnicamente correcto aún puede abandonarse al tercer segundo si no da ningún motivo para seguir mirando. Ese motivo tiene nombre, y esta clase te enseña a construirlo.
↓ desplázate para estudiar
Hasta aquí aprendiste a decidir el ancla, preparar la preproducción y animar un plano. Falta el ingrediente que separa una escena competente de una escena que atrapa: una buena escena no entrega la respuesta de una sola vez; plantea una pregunta en la mente de quien la mira y solo después responde.
El dueño de una hamburguesería de barrio decidió esto antes de grabar el lanzamiento de una hamburguesa secreta, fuera del menú: en vez de mostrar el producto entero en la primera escena, ocultó el resultado hasta el corte final, y la pregunta «¿cómo quedará armado?» mantuvo la atención hasta ese momento.
Una escena que lo muestra todo de una vez no necesita verse hasta el final.
Un entorno bien elegido ya dice mucho por sí solo, sin necesidad de un subtítulo o una narración que explique lo obvio. Desorden, vapor, movimiento, textura: cada detalle del escenario es una pista que quien mira lee sin darse cuenta de que está leyendo.
El mismo dueño de una hamburguesería lo probó en la práctica: una cocina limpia y vacía, filmada en silencio, no decía nada del negocio. La cocina en pleno ajetreo del viernes por la noche —con el humo subiendo, las ollas apiladas y las manos cruzándose— contó por sí sola la historia de "aquí hay gente trabajando en serio", sin una sola frase de texto.
Un elemento fuera de lugar crea curiosidad más rápido que cualquier imagen "bonita y correcta". Cuando algo en la escena contradice lo esperado — delicadeza donde se espera fuerza, cuidado donde se espera prisa — quien mira se detiene para entender por qué.
En el video de la hamburguesa secreta, en vez de mostrar solo el producto terminado de siempre, el dueño filmó las manos llenas de tatuajes de un cocinero corpulento colocando, con extremo cuidado, una sola hoja de lechuga. La contradicción entre la apariencia ruda de las manos y la delicadeza del gesto captó más atención de la que la hamburguesa terminada por sí sola habría captado jamás.
Una escena que atrapa sigue un orden: muestra el mundo (el entorno, sin prisa), se acerca (la cámara se aproxima a lo que importa), revela (el personaje o el producto aparece, pero todavía no por completo), rompe las expectativas (algo cambia o sorprende) y solo entonces muestra la intención final (la emoción o la respuesta que cierra la pregunta planteada al principio).
El video de la hamburguesa secreta siguió exactamente este orden: la fachada de la hamburguesería de noche (el mundo) → la cámara se acerca a la cocina (se acerca) → las manos montan la hamburguesa capa por capa, sin mostrar la parte superior (revela en parte) → la hamburguesa entera aparece de repente, fuera del menú (rompe la expectativa) → el rostro de sorpresa de un cliente al morderla (muestra la intención: generar deseo).
Antes
Un único plano fijo de quince segundos, que muestra desde arriba la hamburguesa lista: la respuesta completa aparece en el primer segundo.
Después
Fachada de noche → cocina acercándose → montaje en capas, sin mostrar la parte superior → hamburguesa completa solo en el corte final, junto con el mordisco.
Resultado: la misma información, reorganizada en cinco partes, transformó un video ignorado en uno que se vio hasta el final.
Ponte a prueba
Un video promocional muestra, en el primer segundo, el producto completo, listo y quieto en primer plano. Según lo que aprendiste en esta clase, ¿cuál es el problema más probable?
Practica ahora 0/3 hecho
Lee el caso, reescribe la secuencia en cinco partes y compara con la respuesta correcta — en ~10 minutos.
Es un ejercicio de lectura y reescritura: no hay nada que generar ni publicar. Discrepar de la respuesta correcta es parte del ejercicio; el valor está en justificar por qué cada parte de tu secuencia va en ese orden.
El caso: Juliana administra una hamburguesería de barrio y grabó un video para el lanzamiento del combo del mes: un solo plano fijo que muestra la hamburguesa completa, desde arriba, durante quince segundos, con el texto «nuestro nuevo combo». En las pruebas, el 90% de quienes lo vieron dejó de ver el video antes del tercer segundo.
El video original lo mostró todo en la primera imagen: el producto completo, de frente, sin dejar ninguna pregunta abierta; por eso nadie tuvo motivos para seguir mirando. Una secuencia que funciona: la cocina en movimiento durante la hora pico (mundo) → la cámara se acerca a la parrilla (acercamiento) → las manos arman el combo capa por capa, sin mostrar la parte superior (revelación parcial) → el combo completo aparece solo en el corte final, junto con la mordida de un cliente (ruptura + intención). La pregunta "¿cómo quedará armado este combo?" mantiene la atención hasta el final.
Aplicaste, a una escena que no es tuya, la misma lógica de esta clase — plantear una pregunta antes de responder. Esa es exactamente la habilidad que pedía la promesa de hoy.
Resumen
Curso 3 · Lección 6
Al final de esta clase, preparas una secuencia de planos usando una herramienta de composición diferente en cada uno —tercios, líneas, espacio vacío, escala— en vez de repetir la misma composición de principio a fin.
Ya sabes plantear una pregunta en la escena. Falta decidir, dentro de cada plano, adónde irá la mirada primero. Sin esa decisión, incluso una secuencia bien planeada cansa, porque todas las fotos o todos los planos usan la misma organización visual, sin variaciones.
↓ desplázate para estudiar
A regla de los tercios es la herramienta de composición más usada: en vez de centrar al sujeto, lo colocas en uno de los puntos donde se cruzan las líneas imaginarias. El encuadre gana aire y la vista tiene adónde moverse.
Las diagonales cumplen el papel opuesto: en lugar de organizar con calma, crean energía y sensación de movimiento; se usan cuando la escena debe parecer viva, no quieta.
Una fotógrafa que hacía un book corporativo en un espacio de coworking aplicó la regla de los tercios al retrato individual: colocó el rostro en el tercio superior derecho y dejó libre el resto del encuadre para que se viera el ambiente de trabajo detrás, sin competir con el rostro.
Centrar es la opción de composición más fácil. Casi nunca es la más acertada.
Las líneas rectas — una mesa larga, un pasillo, el borde de una ventana — guían la mirada hacia el tema principal sin que nadie note que está siendo guiado. El centro, con simetría, hace lo contrario: transmite control y estabilidad, útil cuando la escena pide autoridad serena, no movimiento.
En el plano del equipo reunido en la mesa de reuniones, la fotógrafa usó la propia mesa como línea guía hacia el rostro de la persona que lidera, sentada en la cabecera. En el retrato individual del fundador, centró el rostro con simetría, porque esa escena pedía autoridad inmóvil, no energía.
El espacio vacío alrededor de un tema pequeño lo aísla y lo realza — la mirada no tiene otra opción que posarse en lo que queda. La escala del plano, desde un detalle muy cerrado hasta un ambiente entero, decide si la escena habla de intimidad o de grandiosidad.
Antes
Manos escribiendo, plano medio, mesa llena de objetos alrededor que compiten por la atención con el gesto principal.
Después
Manos escribiendo, encuadre cerrado, mesa casi vacía alrededor: solo se ven el teclado y los dedos dentro del cuadro.
Resultado: el mismo gesto, aislado por el espacio vacío, se convirtió en el único punto posible de atención.
Después de este primer plano aislado, la fotógrafa cerró el portafolio con un plano muy abierto de toda la oficina, mostrando la escala de la empresa: justo lo opuesto al primer plano de las manos.
Cada plano resuelve una tarea de composición distinta; ninguna buena secuencia repite la misma composición de principio a fin. Si todos los planos usan el mismo tercio, el mismo centrado y el mismo espacio vacío, el conjunto cansa antes de terminar, aunque cada plano por separado sea técnicamente correcto.
En el book completo, la fotógrafa alternó cinco composiciones diferentes: regla de los tercios en el retrato individual, líneas guía en la mesa de reunión, simetría en el fundador, espacio vacío en las manos, plano abierto en la oficina; ninguna se repitió dos veces.
Ponte a prueba
Estás armando una secuencia de cuatro fotos para el mismo cliente. ¿Qué elección hace que la secuencia parezca más viva y profesional?
Practica ahora 0/4 hecho
Identifica la herramienta de composición que usaste en cuatro o cinco fotos recientes tuyas y corrige una repetición, en ~10 minutos.
Es un ejercicio de observación de fotos que ya existen: no necesitas tomar fotos nuevas ni descargar ningún programa. Si no encuentras ninguna repetición, el ejercicio también habrá terminado; el objetivo es entrenar la vista, no buscar errores a la fuerza.
Está listo cuando cada una de las 4 o 5 fotos tiene asignada una herramienta de composición y has identificado (o descartado) cualquier repetición entre ellas.
Resumen
Curso 3 · Lección 7
Al final de esta clase, eliges, para una escena real, entre cinco maniobras de luz —quitar luz, acercar la fuente, ocultar el 80%, contrastar el color, contrastar la exposición— pensando en la emoción, no en iluminarlo todo.
Ya decides el ancla, la preproducción, el movimiento y la composición. Falta la variable que más rápido cambia cómo se siente una escena: la luz. Y la mayoría de quienes empiezan se equivoca en la dirección opuesta — lo iluminan todo, cuando el efecto profesional casi siempre nace de quitar luz.
↓ desplázate para estudiar
La cinematografía profesional rara vez consiste en agregar luz: consiste en quitarla a propósito. Cuando eliminas la luz de una parte de la escena, las sombras se vuelven más profundas y el cuadro parece misterioso y vivo, en lugar de plano y uniforme.
Una forma sencilla de aplicarlo: iluminar el sujeto solo desde un lado, dejando una luz de contorno fina en el borde, contra un fondo más oscuro. El ojo sigue el contraste, no el brillo — no hace falta iluminarlo todo para que algo destaque.
El dueño de un salón de belleza que graba un reels del último corte del día, de noche, apagó las luces generales del techo y dejó solo una luz lateral sobre el rostro de la clienta, con el fondo del salón a oscuras. El resultado pareció un video de revista, no una grabación de celular en la oscuridad.
La luz no existe para que veas la escena. Existe para que el público sienta algo.
La luz suave no depende del tamaño de la fuente, sino de la distancia. Una luz pequeña, muy cerca del tema, se dispersa y lo envuelve como si fuera grande; esa misma luz, lejos del tema, se vuelve dura y crea sombras marcadas en los bordes.
Y toda la luz de la escena debe parecer que viene de algún lugar real —el sol, una lámpara, una pantalla. Si quien mira cree en la fuente, cree en toda la escena; la luz sin un origen claro siempre parece artificial, aunque sea técnicamente perfecta.
En el salón de belleza, en vez de pedir una genérica «luz de estudio», el dueño decidió que la luz del video viniera del espejo iluminado de su propio tocador: una fuente que ya existía de verdad allí, y por eso nadie cuestionó si era una luz «falsa».
Solo el 20% de la luz de una escena debe estar visible; el otro 80% queda oculto en las sombras. Esa proporción crea profundidad y hace que la imagen parezca cinematográfica, en vez de plana y uniforme.
La profundidad también nace de las capas — primer plano, plano medio, fondo — y la niebla o el vapor entre ellas hacen visible la propia luz en el aire, no solo en las superficies que toca.
Antes
Salón con todas las luces del techo encendidas, iguales, sin ninguna sombra — el video parece una grabación de vigilancia, no una escena.
Después
Solo la luz de la mesa de trabajo está encendida, el resto del salón queda en sombras; el vapor de una toalla caliente se convierte en una capa visible de luz en el aire.
Resultado: apagar el 80% de la luz del ambiente creó más profundidad de la que habría creado cualquier luz nueva.
Los tonos cálidos y fríos uno al lado del otro crean tensión visual — y la tensión, aquí, es sinónimo de vida en el cuadro. Una escena con la misma temperatura de color en todas partes resulta cómoda, pero también fácil de olvidar.
Mostrar solo lo que importa y dejar que el resto se oscurezca o quede sobreexpuesto crea un enfoque absoluto en un solo punto de la escena, sin necesidad de recortar ni señalar nada con una flecha.
En el salón, la luz cálida del tocador contra la luz fría que entraba desde la calle por el escaparate, de noche, le dio al video un ambiente de «fin de la jornada» sin necesitar ninguna palabra escrita en pantalla.
Ponte a prueba
Una escena tiene luz cálida en la encimera y luz fría que entra por el escaparate de noche, una junto a la otra. Según esta clase, ¿qué efecto crea esta elección?
Una vela, un reflejo tembloroso, la luz que pasa a través de una hoja al viento: la luz en movimiento le da vida al encuadre. La luz completamente quieta, por bien colocada que esté, tiende a parecer muerta después de unos segundos en pantalla.
Aplica la misma lógica
Practica ahora 0/4 hecho
Escribir un pedido de imagen o video desglosando la fuente, la distancia, el contraste y el movimiento de la luz — en ~12 minutos.
Los generadores de imágenes y videos con IA que ofrecen un plan de prueba suelen limitar cuántas generaciones puedes hacer por día, y ese límite cambia con frecuencia. Escribe y revisa la solicitud completa antes de generar: primero prueba la decisión de iluminación en papel.
Cinematic lighting, one clear light source only. SUBJECT: <describe your subject> LIGHT SOURCE: <a real-world source — window, lamp, screen, candle>, positioned <side / behind / close> CONTRAST: mostly in shadow, only 20% of the frame lit; <warm/cool> tones against <the opposite tone> in the background MOVEMENT: <steady light / flickering light / reflection moving> Photorealistic, cinematic, no text, no watermark.
Elegiste la luz pensando en la emoción y en una fuente real, no en «iluminarlo todo» — exactamente el cambio de perspectiva que pedía la promesa de esta clase.
Resumen
Curso 3 · Lección 8
Al final de esta clase, preparas una escena con primer plano, plano medio y fondo definidos, y colocas a dos personas o elementos en capas diferentes para contar una relación solo con la posición y la mirada.
Ya decides el ancla, la preproducción, el movimiento, la composición y la luz. Falta la última capa — literalmente: la profundidad es lo que hace que un cuadro parezca un lugar real, con espacio para entrar, en vez de una superficie plana con cosas pegadas encima.
↓ desplázate para estudiar
La profundidad es la ilusión de espacio tridimensional dentro de un encuadre plano. Nace de organizar la escena en tres capas: el primer plano — donde está quien mira —, el plano medio — donde vive el tema principal — y el fondo, donde respira el contexto. Sin las tres, la imagen queda aplanada: bonita, pero sin espacio para entrar.
Las capas solo funcionan cuando se distinguen visualmente entre sí, por el foco, la luz o el color. Si las tres se mezclan, el ojo no logra separarlas y la sensación de profundidad desaparece, aunque técnicamente estén presentes.
Una fotógrafa que organizaba una sesión familiar en un parque decidió esto antes de tomar cualquier foto: ramas ligeramente desenfocadas en primer plano, la familia en el plano medio y el lago al fondo; tres capas nítidas, cada una con un papel propio en la composición.
Una imagen plana muestra lo que existe. Una imagen en capas muestra dónde está cada cosa con respecto a las demás.
A profundidad de campo controla qué parte de la escena queda nítida a la vez, y eso es lo que guía la mirada. Una profundidad de campo reducida aísla al sujeto y desenfoca el primer plano y el fondo; una profundidad de campo amplia mantiene todo legible, algo útil cuando el entorno importa tanto como la persona.
La elección del lente refuerza este efecto: un lente gran angular expande el espacio y exagera la distancia entre las capas; un teleobjetivo comprime el espacio y acerca visualmente capas que en la vida real están lejos unas de otras.
En el retrato principal de la sesión familiar, la fotógrafa usó poca profundidad de campo para aislar los rostros; en el plano general de todo el parque, cambió a mucha profundidad de campo, porque allí el entorno contaba tanto como la familia.
Colocar personas en diferentes capas del mismo cuadro cuenta una relación sin necesidad de una sola palabra de diálogo. La poca distancia entre dos personas habla de intimidad; la mucha distancia, de aislamiento. El movimiento habla de cambio; la quietud total, de tensión.
En la sesión de fotos familiar, la fotógrafa colocó a los abuelos en primer plano, mirando a la cámara con calma, y a los nietos corriendo al fondo, desenfocados. La composición por sí sola contó «una generación que observa, otra que vive en movimiento», sin que nadie tuviera que decir nada.
Ponte a prueba
En un retrato familiar, los abuelos aparecen nítidos y cerca de la cámara, mirando al objetivo; los nietos aparecen desenfocados y lejos, corriendo al fondo. ¿Qué relación sugiere esta composición, sin ninguna palabra escrita?
La composición, la cámara y el lente, la luz, el movimiento y la posición de los personajes —las cinco decisiones de este curso— no funcionan de manera aislada. En una escena profesional, trabajan como un solo sistema: la luz separa las capas que la composición organizó; el movimiento revela la profundidad que el lente comprimió o expandió; la posición de cada persona transmite la relación que el guion pedía desde la preproducción.
Es esta integración — no el dominio de una técnica aislada — lo que distingue a quien genera imágenes sueltas de quien dirige una escena completa.
Antes
Un video con buena luz, pero sin capas: todos en el mismo plano, con la misma nitidez y a la misma distancia. Técnicamente correcto, fácil de olvidar.
Después
El mismo video con el primer plano, el plano medio y el fondo definidos, la profundidad de campo elegida a propósito y cada persona ubicada en una capa que dice algo sobre ella.
Resultado: la diferencia entre las dos versiones no es técnica, es una decisión. Pasaste todo este curso aprendiendo a tomar esa decisión a propósito, en lugar de aceptar la primera generación de la IA.
Practica ahora 0/4 hecho
Arma, en papel o en una escena real, las tres capas de profundidad con una relación humana contada solo mediante la posición; en ~15 minutos.
Es un ejercicio de planificación y observación: puedes hacerlo en papel, con una foto que ya existe u organizando una escena real; nada de esto depende de generar una imagen nueva ni de ninguna herramienta específica.
Terminaste el curso armando en la práctica la misma escena que resume las ocho clases: profundidad con una relación humana incorporada, decidida por ti — no por casualidad.
Resumen