Hago anuncios que salen enteramente de un ordenador. Y la pregunta que más escucho es la equivocada.

Es esta: «¿Cuánto cuesta un segundo?». Como si esa fuera la cuenta. No lo es. El precio por segundo con el que cada página comparativa llena sus tablas es la partida más pequeña. El precio de verdad está en otro sitio — y nadie lo menciona, porque no encaja bien en una columna.

Empecemos de todos modos por el precio por segundo. Solo para mostrar lo poco que explica.

Lo que un segundo cuesta nominalmente

Modelo Precio (lista neta, USD) Duración del clip Audio ¿Comercial?
Kling 2.6 Pro Kling AI 0,07 $/s (sin audio), 0,14 $/s (con audio) — a través del revendedor fal.ai 5 o 10 s el audio duplica el precio Los usuarios gratuitos NO pueden usar el resultado comercialmente (ToS 4.6); solo los miembros de pago
Ray 3.2 Luma AI por clip: 1080p/5 s = 1,20 $ (≈ 0,24 $/s), 720p/5 s = 0,30 $ 5 o 10 s según el plan
Sora 2 Pro OpenAI 0,30 $/s (Sora 2: 0,10 $/s) solo 720×1280 / 1280×720 según las condiciones de OpenAI
Veo 3.1 Google Standard 0,40 $/s (720p/1080p), 0,60 $/s (4K); Fast desde 0,10 $/s; Lite desde 0,05 $/s 4, 6 u 8 s siempre activo, incluido Google no reclama la propiedad; en la UE solo mediante el plan de pago
Gen-4.5 Runway 12 créditos/s, 1 crédito = 0,01 $ → 0,12 $/s según el plan sin restricciones; Runway se reserva el derecho de entrenar con los resultados
Wan 2.7 Alibaba a través de Alibaba Cloud Model Studio; pesos abiertos solo hasta Wan 2.2 (Apache-2.0) 2 a 15 s archivo propio o generado automáticamente según las condiciones de Model Studio

Fecha de referencia: 24 de julio de 2026. Todos los precios son precios de lista netos en dólares estadounidenses, tomados directamente de la página del proveedor; los compradores de la UE pueden estar sujetos al IVA o a la inversión del sujeto pasivo (esto no es asesoría fiscal). Los precios, los ID de modelo y la disponibilidad cambian con rapidez — consulta con el proveedor antes de tomar cualquier decisión.

Dos cosas llaman la atención.

Primero, el rango. Entre el precio por segundo más barato y el más caro publicado hay aproximadamente un factor de seis — Kling a 0,07 $, Veo Standard a 0,40 $. Quien solo mire esa cifra elegiría Kling y listo. Pero la cifra no dice nada sobre cuántos intentos necesitas hasta que un clip queda bien. Y ahí es exactamente donde se decide la cuenta real.

Segundo, las condiciones que las páginas de precios dejan fuera. Con Kling, como usuario gratuito no puedes explotar comercialmente el resultado en absoluto — eso está en la cláusula 4.6 de las condiciones, no en la página de precios. Con Veo, el audio siempre está incluido en el precio; con Kling lo duplica. Sora 2 solo admite una relación de aspecto. Y Sora se apaga en pocas semanas — más sobre esto enseguida.

La cuenta que nadie escribe: el descarte

Aquí está la única cifra de práctica limpiamente documentada que pude encontrar, y es desalentadora.

Para un anuncio de IA que se emitió en el descanso de las Finales de la NBA (para el mercado de predicción Kalshi), su creador PJ Accetturo documentó abiertamente el esfuerzo: entre 300 y 400 generaciones para 15 clips utilizables. Una persona, dos días. Herramientas: Veo para el vídeo, Gemini y ChatGPT para los prompts, CapCut y Premiere para el montaje, Topaz para el escalado.

Ahora aplica eso al precio por segundo. Si descartas de 20 a 25 intentos antes de que uno funcione, entonces el único clip utilizable no te cuesta el precio por segundo, sino veinte veces eso. Y de repente la diferencia entre 0,07 $ y 0,40 $ pasa a segundo plano: lo que importa es qué modelo te hace descartar menos, no cuál tiene el segundo individual más barato.

Por eso no corono un ganador aquí. La tasa de descarte depende de tu motivo — una toma de producto estática falla de forma distinta que un personaje que camina por el encuadre. Quien te diga «el modelo X es el más barato» ha dejado fuera la variable más cara.

Y luego viene la posproducción

El clip que sale del modelo no es el clip terminado. Es material en bruto.

Toma el escalado que el anuncio de Kalshi necesitó explícitamente. El propio escalador 4K de Runway cobra por fotograma según una fórmula documentada. Para un vídeo de diez segundos a 30 fotogramas por segundo son 360 créditos — es decir, 3,60 $, solo por el escalado. En un modelo cuya generación cuesta 0,12 $ por segundo, escalar diez segundos cuesta por tanto más que generarlos. Topaz, la herramienta usada en ese anuncio, es una suscripción aparte encima.

Y eso es solo el escalado. Después vienen: el montaje, la corrección de color, la mezcla de sonido, ensamblar los 15 clips en algo que no se sienta como 15 prompts pegados. Eso es oficio, y el oficio cuesta tiempo — un tiempo que no aparece en ningún precio por segundo.

La frase honesta es: el vídeo con IA es un acelerador, no un sustituto. El prompt reemplaza el rodaje. No reemplaza el hacer cine.

Qué modelo para qué — con cautela, porque mañana es distinto

Deliberadamente no digo «el mejor modelo». Digo lo que muestran las pruebas hoy, 24 de julio de 2026.

En la arena de comparación ciega de Artificial Analysis, donde los usuarios valoran dos clips uno contra otro sin nombres de marca, Gemini Omni Flash lidera a fecha de consulta — con audio, con un Elo de 1.245 a partir de casi 4.000 votos. Eso es una fotografía instantánea, no una ley natural: el Elo y el número de votos cambian a diario, y detrás presionan Dreamina Seedance y una serie de modelos que nadie conocía hace un año.

La física es el punto de ruptura más duro — y no depende del realismo óptico. El benchmark Physics-IQ de Google DeepMind mide qué tan bien un modelo entiende los procesos físicos (¿cae el objeto correctamente?, ¿fluye el agua de forma plausible?). Los propios autores subrayan que el realismo óptico y la comprensión física no correlacionan. Un clip puede verse fotorrealista y aun así mostrar una física que no existe. Ningún modelo actual se acerca siquiera a un vídeo real.

Las promesas de marketing sobre la consistencia del personaje — la misma persona a través de varios planos — son exactamente eso: promesas. Google describe Veo 3.1 en su propio blog con «calidad de audio y vídeo superior» y la posibilidad de aportar hasta tres imágenes de referencia de un personaje. Google no menciona ninguna medición independiente al respecto. Por mi propia experiencia: la consistencia del personaje es el problema central sin resolver. Las imágenes de referencia ayudan, pero no garantizan nada — cuantos más planos, mayor la deriva.

La pregunta que casi nadie hace: ¿puedo vender esto?

En un anuncio, «creo que sí» no es una respuesta. Lo que dicen las condiciones de uso es distinto en cada proveedor — y rara vez aparece en la página de precios.

Kling prohíbe expresamente a los usuarios gratuitos cualquier explotación comercial (condiciones 4.6: «without our written permission, you may not use … for any commercial purposes»). Solo los miembros de pago pueden. Y Kling exige marcar el resultado visiblemente como «Kling AI» (condiciones 4.5).

Runway permite el uso comercial sin restricciones y no reclama propiedad sobre tus resultados — pero se reserva el derecho de entrenar con ellos. Y: las aplicaciones que usan la API deben mostrar visiblemente «Powered by Runway» y enlazar a runway.com (condiciones).

Google no reclama propiedad sobre los vídeos generados, pero señala expresamente que puede generar el mismo material o uno similar para otros. Cada salida de Veo lleva una marca de agua invisible SynthID.

En resumen: «lo he generado yo, así que es mío» no vale automáticamente con ninguno de estos proveedores. Lee la cláusula antes de que el clip salga al aire.

Mortalidad de las herramientas — el detalle en el que nadie piensa

El 24 de marzo de 2026, OpenAI anunció el cierre de su API de Videos y de todos los modelos Sora 2, con efecto el 24 de septiembre de 2026. En la página de deprecaciones no figura ningún modelo sucesor (a fecha de 24.07.2026). Qué implica esto para la estrategia de OpenAI, no lo sé — no lo dice.

Pero la lección se mantiene: si construyes una producción sobre un modelo, la construyes sobre algo que el proveedor puede apagar con unos meses de aviso. El mismo patrón en Google: Veo 3 y Veo 2 se apagaron el 30 de junio de 2026, y el actual Veo 3.1 sigue llevando «preview» en el nombre. Y pesos realmente abiertos y alojables por cuenta propia solo existen para el Wan de Alibaba hasta la versión 2.2 — todo lo más nuevo es solo vía API, es decir, depende del proveedor.

Quien quiera independencia debe planificarlo: o bien apostar por pesos abiertos (y aceptar la brecha de calidad), o esperar tener que rehacer el flujo de trabajo cada pocos meses.

Lo que sigue es la reproducción de textos legales y fuentes oficiales, a fecha de 24 de julio de 2026 — no es asesoría legal. Si y cómo esto afecta a tu proyecto lo aclara, en caso de duda, una abogada.

Obligación de etiquetado. A partir del 2 de agosto de 2026, el artículo 50 del AI Act de la UE (según las preguntas frecuentes de la Comisión Europea) exige que el contenido sintético esté marcado de forma legible por máquina y reconocible como generado por IA; quien use un vídeo con IA debe revelar claramente un «deepfake» a más tardar en la primera visualización. El período de transición hasta el 2 de diciembre de 2026 afecta solo a la obligación de marcado de los proveedores para sistemas ya existentes. En Alemania vigila esto, desde la Ley de Ejecución de la IA (Bundestag, 11 de junio de 2026), la Agencia Federal de Redes (Bundesnetzagentur). El marco de multas por infracciones de transparencia llega hasta 15 millones de euros o el 3 % de la facturación anual mundial (art. 99, apartado 4, del AI Act).

El detalle sorprendente sobre los derechos de autor: un vídeo generado puramente por IA no pertenece a nadie en Alemania. El § 2, apartado 2, de la ley de derechos de autor alemana (UrhG) solo protege «creaciones intelectuales personales» — un resultado producido de forma completamente autónoma por una IA no cumple ese criterio. No está protegido por derechos de autor; en teoría, cualquiera puede copiarlo. La protección surge solo a través de tu propia aportación creativa — montaje, selección, composición.

Y la otra cara: incluso un rostro completamente sintético puede vulnerar derechos. El § 22 de la ley alemana sobre derechos de autor en las artes (KunstUrhG, derecho a la propia imagen) se aplica en cuanto una persona real es reconocible en la imagen generada — sin que jamás haya rodado una cámara. Un rostro de IA que, por casualidad o intencionadamente, se parece a un humano real no es un espacio libre de derecho.

Mi conclusión

Si te llevas una cifra, que sea esta: el precio por segundo no es el precio. Multiplícalo por tu tasa de descarte, súmale escalado y montaje, y llegas a un múltiplo. Un modelo con la mitad del precio por segundo que te hace descartar tres veces más a menudo es más caro.

Por eso la pregunta correcta no es «cuál es el más barato», sino «cuál descarta menos con mi tipo de motivo» — y eso solo lo respondes tú, pasando tu motivo típico por dos o tres modelos y contando la tasa de acierto. No la lista de precios.

Y antes de que el clip salga al aire: lee las condiciones de uso, pon el etiquetado y, en caso de duda, pregunta a alguien que conozca la situación legal.

Qué herramientas uso para todo el camino alrededor — imagen, montaje, sonido, escalado —, está en mi índice de 137 herramientas de IA, actualizado continuamente.

Fuentes

Todas comprobadas el 24 de julio de 2026 directamente en los proveedores o en organismos oficiales. Los precios y las versiones de los modelos cambian a corto plazo.

Si algo aquí te parece desactualizado o incorrecto: escríbeme.