Offre à Durée Limitée : 50% DE RÉDUCTION sur votre premier mois de Pro & Ultra 🎉

De footcandles a f-stop: cinematografía con IA para cineastas

Sep 15, 2026

Por qué la física de la luz sigue siendo la base de la imagen generada

La cinematografía clásica se apoya en magnitudes medibles. El footcandle mide la luz que llega a una superficie, el lux lo traduce al sistema métrico (1 fc equivale aproximadamente a 10,76 lux), el ISO define la sensibilidad del sensor, el obturador decide cuánto tiempo se acumula esa luz y el f-stop regula cuánta atraviesa el objetivo y con qué profundidad de campo. Ese conjunto de decisiones produce algo que el público percibe como emoción: un rostro recortado contra el fondo, una habitación que respira penumbra, un contraluz que separa la silueta del decorado.

En un flujo de vídeo generativo no hay fotómetro ni diafragma físico. Hay un modelo entrenado para asociar descripciones, imágenes de referencia y parámetros de movimiento con resultados plausibles. Esto no invalida la física: la convierte en vocabulario. El cineasta deja de ajustar un panel de luces y empieza a describir la distribución de energía, el contraste y la separación de planos con suficiente precisión para que el modelo reproduzca una intención concreta.

Los dos errores más comunes van en direcciones opuestas. El primero es pedir un look cinematográfico genérico y esperar que el modelo adivine el resto. El segundo es escribir valores numéricos aislados, como f/1.4 o 800 footcandles, sin explicar la relación entre luz, sujeto y fondo. La solución es una traducción en tres capas: magnitud, dirección y ratio. La magnitud responde a cuánta luz hay; la dirección, a de dónde viene; el ratio, a la diferencia entre la luz principal y el relleno. Los modelos entienden razonablemente bien las tres si se expresan como consecuencias visibles y no como cifras sueltas.

Este artículo propone un método de trabajo para directores de fotografía, realizadores y creadores que quieren conservar su lenguaje visual mientras usan herramientas de generación y edición asistida. No es una colección de trucos, sino un puente entre la medición tradicional y la descripción operativa que funciona en la práctica.

De footcandles a lenguaje: cómo describir la cantidad de luz

El footcandle es una unidad de iluminancia. En un plató se mide con fotómetro y se ajusta moviendo luminarias, difusores y rebotadores. En un modelo de vídeo, el equivalente operativo es la sensación de nivel y caída de luz. La clave no es memorizar equivalencias, sino construir una tabla mental que traduzca niveles a frases útiles.

Nivel aproximado Situación típica Lenguaje útil en el prompt
0,01–0,1 fc Noche cerrada, luz de luna noche sin fuentes prácticas, siluetas apenas legibles, azul profundo, sombras abiertas
1–5 fc Velas, una sola lámpara interior con una única fuente práctica, penumbra dominante, caída rápida hacia los bordes
10–30 fc Sala doméstica con lámparas interior cálido, luz rebotada en paredes, contraste medio, piel suave
50–100 fc Oficina, comercio luz uniforme, sombras cortas, tono neutro, poca direccionalidad
300–1000 fc Exterior nublado luz difusa amplia, sin sombras duras, cielo como difusor gigante
5000–10000 fc Sol directo sol duro de mediodía, sombras recortadas, alto contraste, reflejos especulares

Esta tabla sirve para dos cosas. Primero, para decidir si la escena que imaginas es coherente con la hora del día y el lugar. Segundo, para escribir prompts que describan consecuencias visibles en lugar de números que el modelo no interpreta de forma literal.

En lugar de cifras, describe caídas y fuentes

Una frase como 40 footcandles no dice nada útil a un modelo de vídeo. En cambio, esta descripción sí funciona: interior nocturno, una lámpara de mesa como única fuente, la luz cae tres pasos hacia el fondo de la habitación, el rostro queda a un paso por encima del fondo, sombras profundas pero con detalle en la penumbra. La frase contiene nivel relativo, dirección implícita y una relación entre sujeto y ambiente.

El ratio antes que el nivel absoluto

En fotografía cinematográfica, el ratio entre luz principal y relleno define el dramatismo. Un ratio de 2:1 produce una imagen amable y televisiva; uno de 8:1 produce tensión; uno de 16:1 bordea el claroscuro. Los modelos generativos tienden a rellenar las sombras por defecto, porque se entrenan con imágenes bien expuestas. Si quieres contraste, pídelo de forma explícita: sombras profundas, relleno mínimo, transición abrupta entre luz y penumbra.

De f-stop a profundidad de campo y coherencia espacial

El f-stop combina dos efectos: la cantidad de luz que atraviesa el objetivo y la profundidad de campo. Un f/1.4 tiene muy poca profundidad; un f/11 mantiene nítido casi todo el cuadro. Pero la profundidad de campo no depende solo de la apertura: también influyen la distancia focal, la distancia al sujeto y el tamaño del sensor. Un modelo de vídeo no calcula círculos de confusión, pero ha aprendido a asociar ciertas expresiones con ciertos resultados visuales.

Apertura Profundidad Uso narrativo Cómo pedirlo
f/1.2–f/2 Muy reducida Retrato íntimo, aislamiento rostro nítido, fondo muy desenfocado, separación clara del entorno
f/2.8–f/4 Reducida Diálogo, plano medio sujeto nítido, fondo suavemente desenfocado, bokeh contenido
f/5.6–f/8 Media Dos personajes, escena coral ambos planos legibles, desenfoque leve en el fondo lejano
f/11–f/16 Amplia Paisaje, contexto, comedia de conjunto todo el cuadro nítido, sin desenfoque perceptible

El error de pedir bokeh sin graduación

La palabra bokeh aparece en casi todos los prompts y casi nunca se concreta. El resultado suele ser un desenfoque excesivo que destruye la legibilidad del decorado y delata el origen sintético. Es mejor indicar el grado: desenfoque suave, desenfoque evidente pero con formas reconocibles, fondo apenas insinuado. Si el fondo importa narrativamente, dilo: el fondo permanece legible aunque el foco esté en el rostro.

Cómo mantener coherencia entre planos

La coherencia espacial es el mayor desafío del vídeo generativo. Para lograrla, bloquea un conjunto de parámetros y reutilízalos en todos los planos de una misma secuencia: distancia focal equivalente, altura de cámara, dirección de la luz principal, temperatura de color, relación de aspecto y densidad de grano. Escribe una ficha técnica de secuencia, de dos o tres líneas, y pégala al inicio de cada prompt. Es más eficaz que repetir adjetivos estéticos.

El puente entre medición y modelo: flujo de trabajo en siete pasos

Un método reproducible evita que cada plano sea una lotería. Este flujo funciona tanto para publicidad como para ficción corta.

  1. Guion técnico y planta de luces. Dibuja la planta aunque no vayas a iluminar de verdad. Define dónde está la ventana, dónde la fuente práctica y qué lado del rostro queda en sombra.
  2. Estimación de niveles y ratio. No necesitas un fotómetro para generar, pero sí una idea de orden de magnitud y de relación entre luz y relleno. Anota el ratio objetivo.
  3. Hoja de estilo. Convierte la planta en lenguaje: dos o tres frases por escena que describan fuentes, dirección, contraste y temperatura de color.
  4. Bloqueo óptico. Fija focales equivalentes, aperturas y alturas de cámara. Un cambio de focal entre planos del mismo diálogo se nota y rompe la continuidad.
  5. Planos clave. Genera primero los planos que definen el look, normalmente el plano medio y el primer plano. Valida contraste, piel y desenfoque antes de producir el resto.
  6. Expansión con consistencia. Usa imágenes de referencia, vídeo a vídeo y control de movimiento para arrastrar el look aprobado al resto de planos.
  7. Post y emparejamiento. Iguala negros, ajusta saturación, añade grano, respiración de lente y pequeños desenfoques de transición. La post produce más sensación de cámara real que cualquier prompt.

Cada paso tiene una función distinta. Los tres primeros son de dirección; los tres siguientes, de producción; el último, de acabado. Saltarse el paso tres es la causa habitual de secuencias que parecen hechas por modelos diferentes.

Cómo elegir la herramienta adecuada para cada tipo de plano

No existe un modelo único que gane en todo. Conviene clasificar las herramientas por lo que hacen bien y asignarlas según el plano.

Herramientas orientadas a fidelidad de textura y control fino

Suelen destacar en detalle de piel, telas, metales y adherencia al prompt. Son la elección natural para primeros planos, planos de producto y cualquier imagen donde la textura importe. Funcionan mejor cuando el movimiento es contenido y la cámara se mueve poco. Si el plano requiere un travelling complejo, tienden a introducir artefactos en bordes y manos.

Herramientas orientadas a realismo físico y movimiento

Modelos como Kling, Hailuo o Luma Ray han mejorado la coherencia temporal en planos con acción: agua, humo, telas al viento, personas caminando. Son útiles para planos generales, persecuciones y cualquier escena donde la física del movimiento sea protagonista. A cambio, la adherencia a detalles finos de vestuario o texto suele ser menor.

Herramientas de continuidad, fusión y ensamblaje

Aquí entran el vídeo a vídeo, la rotoscopia asistida, los mapas de profundidad, el upscaling y el etalonaje. También las utilidades que permiten reutilizar un fotograma aprobado como referencia de identidad para el resto de la secuencia. Un flujo híbrido razonable combina un modelo fuerte en textura para los planos íntimos, uno fuerte en movimiento para los generales, y una capa de composición para unificarlo todo.

Dirección asistida: el agente como asistente, no como autor

Los asistentes de dirección basados en modelos de lenguaje pueden generar listas de planos, comprobar continuidad, proponer variantes de encuadre y mantener el rastro de decisiones. Bien usados, ahorran tiempo de preproducción y reducen olvidos. Mal usados, uniformizan el estilo: todo tiende a la media del entrenamiento.

Tres reglas prácticas. Primera, el agente propone, tú decides; nunca dejes que sustituya la planta de luces. Segunda, dale contexto explícito: referencias, restricciones, paleta y focal. Tercera, revisa siempre la continuidad de dirección de mirada y de eje de acción, porque los modelos son propensos a invertir el eje entre planos. La autoría se conserva cuando el criterio visual sigue siendo humano y la máquina solo acelera la exploración.

Errores frecuentes al traducir parámetros físicos

Acumular adjetivos. Frases como hiperrealista, cinematográfico, épico y atmosférico no describen luz. Sustituye cada adjetivo por una consecuencia visible.

Confundir luz suave con poco contraste. Una fuente grande y difusa puede seguir produciendo un ratio alto si falta relleno. Especifica las dos cosas por separado.

Pedir f/1.4 sin distancia. La apertura sola no determina el desenfoque. Indica también la distancia al sujeto y qué debe quedar legible detrás.

Ignorar la temperatura de color. Mezclar tungsteno y luz de día es una decisión narrativa potente, pero hay que declararla: fuente cálida en el rostro, ventana fría en el fondo.

Describir ópticas imposibles. Un anamórfico con viñeteo extremo y gran angular a la vez produce resultados incoherentes. Elige una personalidad óptica por secuencia.

Generar demasiadas variantes sin criterio. Sin una referencia aprobada, cada nueva iteración te aleja del look en lugar de acercarte.

Dejar la continuidad para la post. Emparejar planos con direcciones de luz opuestas es caro y a menudo imposible. Corrige en generación.

Tres escenas resueltas de principio a fin

Escena nocturna con neón

Intención física: ratio alto, fuentes de color saturado, penumbra profunda. Medición estimada: entre 2 y 8 fc en el rostro, con caída rápida hacia el fondo. Prompt base: calle nocturna bajo la lluvia, dos letreros de neón como únicas fuentes, rostro iluminado por un magenta lateral, relleno mínimo, fondo en azul profundo, sombras densas con detalle, reflejos húmedos en el asfalto. Herramienta: un modelo con buen movimiento para las gotas y otro con buena textura para el primer plano. Post: igualar negros, contener la saturación del magenta para evitar dominantes rosadas en la piel.

Escena de interior con ventana dura

Intención: luz direccional de ventana, contraste alto, polvo en el aire, sujeto parcialmente en sombra. Medición estimada: 200 fc en el borde iluminado, 15 fc en la zona en sombra. Prompt base: interior de día, ventana lateral estrecha, haz de luz recortado sobre la mesa, el rostro recibe el borde de la luz, el lado opuesto cae en penumbra, motas de polvo visibles, temperatura neutra con ligera dominante fría. Post: preservar el recorte del haz, evitar que el relleno automático de la post suba las sombras.

Escena de acción en movimiento

Intención: sensor alto, obturador rápido, movimiento legible pero con estelas. Medición estimada: exterior de 2000 a 6000 fc con sol alto. Prompt base: persecución a mediodía, sol duro cenital, sombras cortas y recortadas, cámara lateral siguiendo al sujeto, ligero barrido en el fondo, polvo levantado, contraste alto. Herramienta: modelo con buena coherencia de movimiento. Post: añadir microdesenfoques direccionales y un grano fino para unificar los fotogramas.

Checklist técnico antes de renderizar cada secuencia

Comprueba que la hoja de estilo está escrita y es coherente con la planta de luces. Verifica que el ratio objetivo y la dirección de la luz principal se repiten en todos los planos. Confirma que la focal equivalente y la altura de cámara no cambian sin motivo narrativo. Revisa que la temperatura de color esté declarada en cada plano. Asegúrate de que existe al menos una imagen de referencia aprobada por secuencia. Comprueba el eje de acción y la dirección de mirada entre planos consecutivos. Deja escrito qué modelo se usa para qué tipo de plano y por qué. Y antes de exportar, revisa las manos, los bordes del sujeto y cualquier texto en pantalla, que son los tres puntos donde la síntesis se delata con más frecuencia.

Preguntas frecuentes

¿Necesito saber usar un fotómetro para trabajar con vídeo generativo? No es imprescindible, pero ayuda. La ventaja no está en medir con precisión, sino en pensar en órdenes de magnitud y en relaciones de contraste. Un director que sabe que un interior doméstico ronda las decenas de footcandles y que un exterior soleado supera los miles describe escenas más creíbles.

¿Los modelos entienden valores numéricos como f/2.8? Rara vez de forma literal. Aprenden asociaciones estadísticas: ciertas palabras aparecen junto a imágenes con más o menos desenfoque. Por eso es más eficaz describir la consecuencia visible que citar la cifra. Si incluyes el número, acompáñalo siempre de una descripción del resultado esperado.

¿Cómo evito que los planos de una misma secuencia parezcan de películas distintas? Fija un bloque de parámetros y reutilízalo: focal, apertura, altura, dirección de luz, temperatura y grano. Añade una referencia visual aprobada y úsala como imagen guía. La consistencia viene de la repetición disciplinada, no de la suerte.

¿Qué hago si el modelo rellena demasiado las sombras? Pide explícitamente relleno mínimo, sombras profundas y transición abrupta. Reduce adjetivos como suave o difuso, que empujan hacia una imagen plana. Si es necesario, corrige después con curvas, bajando el punto negro y protegiendo las altas luces.

¿Vale la pena usar un asistente de dirección con IA? Como apoyo a la preproducción, sí: ayuda con listas de planos, comprobaciones de continuidad y variantes de encuadre. Como sustituto de la dirección, no. El criterio visual, la elección de la focal y la decisión sobre qué se ve y qué se oculta siguen siendo trabajo humano.

¿Cuál es el mayor riesgo creativo de este flujo? La homogeneización. Cuando todas las decisiones se delegan en el prompt por defecto, los proyectos empiezan a parecerse entre sí. Contrarresta con una personalidad óptica clara, una paleta definida, un enfoque de iluminación propio y un etalonaje reconocible. La técnica se aprende rápido; el punto de vista es lo que distingue.

Alexander

Alexander