Saltar al contenido
Temas

Guía para Principiantes en IA: Primeros Pasos

¿Nuevo en la IA? Comienza aquí. Guías para principiantes sobre conceptos de IA y primeros pasos prácticos.

146 artículos

Ordena los artículos para encontrar lo que necesitas

Artículos en Principiantes

Cómo ejecutar un LLM local: IA en tu propio PC — specs, herramientas y los mejores modelos para principiantes

Cómo ejecutar un LLM local: IA en tu propio PC — specs, herramientas y los mejores modelos para principiantes

Probablemente das por hecho que un LLM tiene que ejecutarse en la nube, pero en 2026 ejecutar la IA por completo dentro de tu propio PC —un "LLM local"— es una opción realista. Un LLM local significa ejecutar un modelo como ChatGPT o Claude directamente en tu máquina en lugar de en la nube. Los tres grandes atractivos son la privacidad (la entrada nunca sale de tu dispositivo), el coste cero (sin tarifas de API) y el uso sin conexión (funciona sin internet). Las desventajas: no es tan inteligente como la IA en la nube de primer nivel, necesita un PC razonablemente capaz, requiere algo de configuración y no tiene conocimiento actualizado. Esta guía para principiantes cubre qué es un LLM local (con una analogía de streaming vs. descarga), las ventajas y desventajas, las specs que necesitas y la cuantización (el formato GGUF, con Q4_K_M como referencia que mantiene la calidad reduciendo la memoria a una cuarta parte; unos 0,5 GB de memoria por cada 1B de parámetros a 4 bits), cómo empezar (la interfaz gráfica de LM Studio para principiantes, la línea de comandos de Ollama para desarrolladores: 52 millones de descargas mensuales en el Q1 de 2026), modelos recomendados de 2026 (Llama 3.2 7B, Google Gemma 4, Alibaba Qwen3.5, además de DeepSeek y Mistral, todos abiertos) y cuándo usar local frente a nube (local para trabajo confidencial, de alto volumen y sin conexión; la nube para problemas difíciles). El primer paso más rápido: ejecutar un modelo pequeño de 3B–7B en LM Studio.

¿Qué es el Spec-Driven Development (SDD)? Los cuatro pasos, las herramientas y en qué se diferencia del vibe coding

¿Qué es el Spec-Driven Development (SDD)? Los cuatro pasos, las herramientas y en qué se diferencia del vibe coding

En una era en la que la IA escribe el código, la habilidad de mayor valor está pasando de "escribir código" a "escribir la especificación", y la práctica que recoge ese cambio es el spec-driven development (SDD). El SDD coloca la especificación en el centro del proyecto como fuente de verdad, y un agente de IA deriva de ella el diseño, el desglose y la implementación en lugar de programar de inmediato. La clave es que cada paso deja un documento (a menudo Markdown) que el paso siguiente lee. Esta guía para principiantes cubre qué es el SDD (la especificación es canónica; el código es un derivado), por qué importa ahora (previene el "muro de los tres meses" de deuda técnica del vibe coding y la deriva de requisitos en la fase de diseño —GitHub informa de aproximadamente un orden de magnitud menos de ciclos de "regenerar desde cero", cifra reportada por el propio proveedor—), los cuatro pasos básicos (Specify → Plan → Tasks → Implement), las herramientas principales (GitHub Spec Kit con más de 90.000 estrellas y más de 30 agentes compatibles, AWS Kiro con su flujo Requirements → Design → Tasks y router Auto, además de BMAD, OpenSpec, Tessl, Google Antigravity y Cursor), cuándo usarlo frente al vibe coding (un híbrido: vibe para explorar, spec-driven para entregar, con revisión humana obligatoria) y cómo probarlo hoy mismo. En la era de la IA, quienes destacan son los que saben definir con precisión qué construir, no los que escriben código más rápido.

¿Qué es la ingeniería de contexto? La habilidad que sigue a los prompts y cómo vencer el "context rot"

¿Qué es la ingeniería de contexto? La habilidad que sigue a los prompts y cómo vencer el "context rot"

El centro de gravedad del trabajo con IA se está desplazando de la ingeniería de prompts a la ingeniería de contexto. Tomando prestada la definición de Anthropic, la ingeniería de contexto es "el conjunto de estrategias para seleccionar y mantener el conjunto óptimo de tokens (información) que le entregas al modelo durante la inferencia": abarca no solo el prompt, sino todo lo que hay en la ventana de contexto, es decir, el system prompt, las herramientas, el historial de la conversación y los datos externos. Importa por el "context rot" (degradación del contexto): cuantos más tokens añades, más baja en realidad la precisión. El estudio de Chroma de 2025 probó 18 modelos líderes (GPT, Claude, Gemini y más) y todos se degradaron a medida que crecía la entrada, siendo la información en el medio de los contextos largos especialmente fácil de ignorar ("lost in the middle"). Esta guía para principiantes explica qué es la ingeniería de contexto y cómo se relaciona con la ingeniería de prompts, por qué ocurre el context rot (la atención es un presupuesto finito), qué hay realmente dentro del contexto, seis técnicas esenciales (instrucciones a la altura adecuada, selección de herramientas, recuperación just-in-time, compactación o compresión por resumen, notas como memoria externa y aislamiento con subagentes), su relación con RAG y Claude Skills, y hábitos que puedes usar hoy como empezar una sesión nueva cuando cambia el tema y pegar solo los puntos clave. La idea central: conservar únicamente los tokens más pequeños y con mayor señal.

¿Qué son las Claude Skills (Agent Skills)? Cómo funcionan, cómo crear una y en qué se diferencian del MCP

¿Qué son las Claude Skills (Agent Skills)? Cómo funcionan, cómo crear una y en qué se diferencian del MCP

Una guía para principiantes sobre las Claude Skills (Agent Skills), el mecanismo que acaba con la pesadez de volver a explicarle a Claude el mismo procedimiento una y otra vez. Una Skill empaqueta instrucciones, scripts y referencias en una sola carpeta, centrada en un archivo SKILL.md que contiene un nombre, una descripción y los pasos. La mayor parte del tiempo Claude lee solo la breve descripción de cada skill, y despliega el cuerpo únicamente cuando tu petición coincide con ella: un diseño llamado divulgación progresiva que mantiene tu contexto ligero incluso con decenas de skills instaladas. Este artículo cubre qué son las Skills, por qué importan (se acabó volver a pegar prompts), cómo escribir un SKILL.md y una estructura de carpetas mínima, cómo crear una (con la skill-creator oficial o a mano, soltándola en .claude/skills, con la recarga instantánea de enero de 2026), en qué se diferencian del MCP (conectividad) y de los subagentes (aislamiento de contexto), el estándar abierto que ya adoptaron Codex CLI, Cursor, Gemini CLI y GitHub Copilot más allá de las apps de Claude, Claude Code, la API y el Agent SDK, además de usos concretos como la generación de documentos y la aplicación de reglas internas. Anunciado por Anthropic el 16 de octubre de 2025 y calificado de «quizá algo más importante que el MCP» por Simon Willison.

Claude Fable 5 para programar: benchmarks, cuándo usarlo frente a Opus 4.8 y la realidad del coste

Claude Fable 5 para programar: benchmarks, cuándo usarlo frente a Opus 4.8 y la realidad del coste

Claude Fable 5, lanzado el 9 de junio de 2026 como el primer modelo clase Mythos disponible públicamente de Anthropic, se examina aquí solo para programación (el lanzamiento completo se cubre aparte). En pocas palabras: Fable 5 se distancia cuanto más difícil se vuelve la programación. Obtiene un 95.0% en SWE-bench Verified y un 80.3% en el más exigente SWE-bench Pro (frente al 69.2% de Opus 4.8 y el 58.6% de GPT-5.5), y un 29.3% en el difícil FrontierCode Diamond (frente al 13.4% de Opus y el 5.7% de GPT-5.5, ~5x GPT), mientras que Terminal-Bench 2.1 es una carrera reñida en 84.3% (GPT-5.5 sigue competitivo vía Codex CLI). El artículo ofrece un resumen para desarrolladores en tres puntos (el más fuerte en problemas difíciles / termina en menos turnos / pero caro y no se detiene), una tabla comparativa de benchmarks y cómo leerla (cuanto más difícil el benchmark, mayor la brecha; el trabajo en terminal está reñido), la propiedad de escalar con effort (de 11.5% bajo a 30.9% máximo, mientras GPT-5.5 se estanca en 5-6%; cuanto más larga y compleja la tarea, mayor la ventaja; cinco agentes en paralelo alcanzaron un 60% de aprobado en pruebas ocultas 3.2x más rápido que uno solo), en qué es realmente bueno (grandes refactorizaciones multiarchivo, ejecuciones agénticas largas, front-end a partir de una captura, diseño de API más pruebas más documentación; Simon Willison valoró el resultado como varios días de trabajo aunque lo llamó lento y caro con más de $110 en 5.5 horas), sus debilidades (~2x el precio de Opus 4.8 a $10/$50, sesiones complejas de 500k-1M tokens, juzga mal cuándo parar y sigue ejecutándose, su precisión de revisión va por detrás de Opus, los clasificadores de seguridad recurren a Opus 4.8 en cerca del 20% de las pruebas de Terminal-Bench, y tiende a reportar probado sin ejecutar), la guía de enrutamiento (Opus 4.8 por defecto, escalar el 10-20% más difícil a Fable 5, el trabajo en terminal a GPT-5.5, conmutable por model ID) y dónde usarlo (Claude Code, GitHub Copilot, AWS Bedrock, Azure Foundry, Databricks, Anthropic API) con precios, contexto de 1M tokens, salida máxima de 128k y la ventana gratuita del 9 al 22 de junio. Fable 5 para el encargo pesado puntual, Opus 4.8 para la mayor parte del día a día. Las cifras se citan de informes de Anthropic y de terceros y son orientativas, dependientes del scaffold.

¿Hasta dónde puede automatizar la IA las tareas del navegador? La realidad de formularios, reservas e investigación

¿Hasta dónde puede automatizar la IA las tareas del navegador? La realidad de formularios, reservas e investigación

"Le pedí algo a una IA y abrió el navegador, lo buscó por su cuenta e incluso rellenó un formulario por mí." En 2026 esto ya no es una demo preparada: los navegadores agénticos (ChatGPT Atlas, Claude for Chrome, Gemini/Chrome, Perplexity Comet) llegaron todos a la vez. Así que, ¿hasta dónde pueden automatizar realmente? La realidad se divide con nitidez en tres niveles. (1) Investigación = lista para producción: en WebVoyager (sitios reales) los mejores agentes alcanzan el 89-98%, casi saturando el benchmark, y como una acción errónea cuesta poco, es por aquí por donde empezar a delegar. (2) Rellenar formularios = factible pero verifica: la introducción de datos está soportada, pero los agentes pueden etiquetar mal los campos o pulsar el envío equivocado, así que "la IA redacta, una persona envía" es lo seguro, y muchos productos como Atlas piden confirmación antes de acciones importantes. (3) Reserva/pago = mejor hazlo tú: los agentes tropiezan con CAPTCHA, checkouts complejos de JavaScript, autenticación de dos factores y gestión de sesiones, y en WebArena (tareas complejas de varios pasos) hasta los mejores rondan el ~47-68% frente al ~78% de referencia humana; la verdadera razón por la que OpenAI cerró el Operator independiente (2025/8/31) fue la falta de fiabilidad del checkout. El artículo primero plantea los dos enfoques (navegador/extensión de consumidor frente a API/OSS de desarrollador), luego mapea los protagonistas de 2026 (Atlas como navegador dedicado que no puede ejecutar código ni leer contraseñas por diseño; Claude for Chrome como panel lateral de extensión; el Project Mariner de Google terminó el 2026/5/4 e integrado en Gemini/Chrome; Operator pasó a ChatGPT Agent y al Agents SDK; el OSS browser-use con más de 78k estrellas). Explica los cuatro muros que hacen fallar la reserva (defensas antibots, checkout complejo, 2FA, el coste de deshacer), y profundiza en la mayor trampa: la inyección indirecta de prompts (se demostró que Perplexity Comet era vulnerable al robo de credenciales zero-click y lo corrigió en febrero de 2026; el éxito del ataque del 23.6% antes de las defensas baja al ~11% con defensas básicas y al ~1% con las más fuertes, sin llegar nunca a cero). Cierra con cinco principios de seguridad (empezar en solo lectura, que una persona apruebe envíos/pagos, no entregar contraseñas, no ejecutar en sitios no confiables, mínimo privilegio en un perfil dedicado). Un excelente compañero de investigación; las acciones que mueven dinero, hazlas tú mismo. Las cifras se citan de materiales públicos y anuncios como referencias orientativas.

10 casos de uso de agentes de IA: ejemplos reales de automatización empresarial, impacto y cómo empezar

10 casos de uso de agentes de IA: ejemplos reales de automatización empresarial, impacto y cómo empezar

"Vale, los agentes de IA son increíbles, pero ¿para qué puedo usarlos realmente?" Es la pregunta con la que todos topan tras aprender los fundamentos, y en 2026 la respuesta ya no es algo del futuro: en soporte, ventas, contabilidad, desarrollo y RR. HH., los agentes han empezado a asumir de verdad el trabajo rutinario, y una encuesta informa que el 65 % de las empresas ya han automatizado algún flujo. Este artículo deja a un lado las abstracciones y ofrece 10 casos de uso concretos por función con ejemplos reales y números. Cubre por qué los casos de uso importan ahora (los agentes no solo responden sino que actúan, pasando de experimentos a producción; Gartner prevé que un tercio del software empresarial incluirá funciones agénticas para 2028 y que el 80 % de las consultas de soporte se resolverán con mínima ayuda humana para 2029), cómo detectar trabajo automatizable (muy repetitivo x gran volumen x implica criterio — la parte del criterio es la diferencia con la antigua RPA; conserva las grandes decisiones con las personas mediante el agente prepara, la persona aprueba), los 10 casos (1 soporte de primera línea y escalado con contexto, 2 ventas con captación de leads y correo personalizado a 200/hora con tasas de respuesta 2-4x, 3 marketing SEO de 2 a 10 artículos por semana y correo en el momento óptimo, 4 desarrollo de software con más del 35 % de código generado por IA, 5 operaciones TI con detección-diagnóstico-recuperación automática de incidencias, 6 finanzas con KPI en todo el ERP e informes PDF comentados, 7 detección de fraude financiero en tiempo real, 8 RR. HH. con cribado e incorporación, con AMD reportando una resolución un 80 % más rápida, 9 investigación y análisis de datos a informes, 10 torre de control de la cadena de suministro), la realidad del ROI (3.5x a tres años, retorno de 3-14 meses, recortes de costes del 30-60 % según McKinsey, pero solo el 23 % lo escala, así que hacer que cuaje es lo difícil) y cómo empezar de forma segura (elige una tarea, prueba en pequeño, la persona aprueba, mide y expande) con seguridad de mínimo privilegio y aprobar cada vez. Las cifras se citan de encuestas y comunicados de empresas, como referencia y tendencias. Reexamina tu trabajo a través de la repetición, el volumen y el criterio, y da un pequeño paso desde tu tarea más dolorosa.

Análisis a fondo del lanzamiento de Claude Fable 5: características, benchmarks, precio, la diferencia con Mythos y un nuevo diseño de seguridad

Análisis a fondo del lanzamiento de Claude Fable 5: características, benchmarks, precio, la diferencia con Mythos y un nuevo diseño de seguridad

El 9 de junio de 2026, Anthropic lanzó Claude Fable 5, poniendo a disposición por primera vez, en una forma que usuarios y desarrolladores corrientes pueden usar, una capacidad al nivel de "Mythos", el modelo de frontera considerado durante mucho tiempo el más potente de la casa a nivel interno. Anthropic lo posiciona como el modelo más potente que ofrece de forma general, con el lema "creado para trabajos largos y complejos". Este análisis a fondo, escrito para que los principiantes lo sigan, cubre qué es Fable 5 (una forma pública y segura de la capacidad de clase Mythos, optimizada para terminar un maratón más que una sola pregunta; ID del modelo claude-fable-5), en qué se diferencia de su gemelo Mythos 5 (idénticos por dentro, solo difieren las protecciones; el público usa Fable), los benchmarks (SWE-Bench Pro 80.3% vs Opus 4.8 69.2 y GPT-5.5 58.6, primer 90%+ de la historia en el análisis de larga duración de Hex, primer puesto en Cognition FrontierCode y en el benchmark financiero Hebbia, nuevo SOTA en visión jugando a Pokémon sin ayudas), su verdadera fortaleza en autonomía de larga duración (concentración a lo largo de millones de tokens, ejecuciones de 12 horas, Stripe completando una migración de 50 millones de líneas en Ruby en un día frente a más de dos meses a mano, la memoria de archivos impulsando una tarea de juego 3x más que Opus 4.8, GitHub informando de programación de largo alcance con alta autonomía), precio y disponibilidad ($10 entrada / $50 salida por 1M de tokens, 1M de contexto y 128K de salida, gratis dentro de cada plan del 9 al 22 de junio y luego créditos, API claude-fable-5 y GitHub Copilot), una comparación directa con Opus 4.8 (estándar $5/$25 vs $10/$50, +11.1 puntos en SWE-Bench Pro, mismo contexto de 1M, Opus 4.8 Fast Mode a $10/$50; reparte el trabajo pesado a Fable 5 y el día a día a Opus 4.8 estándar), el destacado nuevo diseño de seguridad (clasificadores de ciber, bioquímica y destilación que recurren a Opus 4.8 solo cuando es peligroso, activándose en menos del 5% de las sesiones para que el 95%+ funcione a pleno rendimiento, con retención de 30 días del tráfico de clase Mythos), el contexto de lanzarlo días después de advertir que la IA es demasiado peligrosa (una tercera vía que cierra solo las áreas peligrosas), y cuándo usarlo. Las cifras están citadas del anuncio de Anthropic y de informes, y pueden cambiar.

¿Cómo ensancha la IA la brecha de capacidades entre oficinistas? El eje que se desplaza, suelo frente a techo y cómo no quedarse atrás

¿Cómo ensancha la IA la brecha de capacidades entre oficinistas? El eje que se desplaza, suelo frente a techo y cómo no quedarse atrás

"La IA te quita el trabajo" es una cantinela conocida, pero un cambio más cotidiano avanza en silencio: entre colegas de la misma empresa y el mismo rol, la brecha en el resultado se va ensanchando, porque la gente se divide entre quienes usan bien la IA y quienes no la usan o no saben usarla. Este artículo expone, con los datos de encuestas más recientes, cómo la IA ensancha la brecha de capacidades entre los oficinistas, y no es el simple "ganan los listos." Muestra que el eje que marca la diferencia se desplaza de la potencia bruta (conocimientos, velocidad, experiencia) a "cómo de bien usas la IA (alfabetización en IA)"; que la IA ejerce dos fuerzas opuestas a la vez (a nivel de tarea eleva más a los novatos y comprime la brecha con los veteranos, mientras que en el conjunto del lugar de trabajo los ya aventajados —altos ingresos, roles sénior— adoptan la IA antes y de forma más profunda, ensanchando la brecha); el estado de la cuestión en datos (una encuesta muestra que más del 60 % de los que más ganan usan la IA a diario frente al 16 % de los que menos ganan, una prima salarial estimada del +56 % por habilidades de IA en el mismo rol, y cerca del 39 % que siente que la dependencia excesiva erosiona sus capacidades, todo citado y variable según la encuesta); las cuatro fuerzas que ensanchan la brecha (acceso a herramientas, tiempo y formación, autonomía para experimentar, disposición a aprender; las tres primeras favorecen a los roles sénior, solo la última depende de ti); tres tipos (se adelanta / se queda igual / se queda atrás, siendo la clave invertir el tiempo liberado en el criterio, la planificación y las personas); la trampa de la dependencia excesiva de convertirse en alguien que "sabe usarla pero no piensa" (verifica la IA como un borrador, no te lo tragues entero); cómo no quedarse atrás (tócala, pruébala en tu propio trabajo, crea el hábito de verificar, invierte el tiempo liberado, comparte, sigue aprendiendo); y la mirada de la organización (pocas empresas ven ROI, fricciones entre rangos, construye un sistema en el que todos puedan aprender). La brecha se abre por una diferencia de acción, no de talento, lo que también es esperanzador, ya que cualquiera puede empezar a aprender a usar la IA hoy.

El primer paso para ganar dinero desde casa con IA, desde cero — un comienzo sin cara a cara para hikikomori y ni-ni

El primer paso para ganar dinero desde casa con IA, desde cero — un comienzo sin cara a cara para hikikomori y ni-ni

Salir de casa cuesta, hablar con la gente es difícil y ahora mismo no estás trabajando; aun así, la posibilidad de convertir "desde casa, sin ver a nadie, a tu propio ritmo" en ingresos se ha ampliado de verdad con la IA. Esta guía pensada para este público expone, con la mayor honestidad y delicadeza posibles, el primer paso para que alguien que es hikikomori (una persona recluida y retraída) o ni-ni gane dinero desde casa, desde cero, usando IA. Promete de antemano no decir que "cualquiera puede ganar fácilmente miles al mes" (por lo general una mentira o un cebo de venta) y escribe la dificultad real, el tiempo y las precauciones abiertamente. Cubre por qué encaja la IA × el trabajo desde casa (se hace sin cara a cara, es fácil de empezar desde cero, a tu propio ritmo: la IA rebaja el muro como socia), las tres verdades honestas (no vas a ganar de inmediato y una primera meta son tus primeros dólares; la IA amplifica el esfuerzo, no es magia, cualquier cosa por cero es cero; quienes continúan, no los listos, obtienen resultados), formas de ganar sin hablar con nadie (redacción, transcripción/subtítulos, recursos de imagen con IA, ordenar datos, revisar traducciones, productos digitales: elige uno primero), el primer paso hoy (toca una IA gratuita, elige un campo, crea una pieza de práctica: crea antes de ganar), cómo acumular pequeñas victorias (portafolio, un trabajo mal pagado, acumular valoraciones, subir tarifa/volumen: colecciona victorias, no cantidades, el primer trabajo es el que más vale), cómo seguir adelante y proteger tu mente (no te compares, divídelo en pequeño, está bien descansar, suelta el perfeccionismo, no lo cargues en soledad: apoyo al empleo y servicios de orientación), y cautelas sobre estafas/exageraciones, el riesgo de dejárselo todo a la IA, e impuestos/dependientes (evita las ofertas de pagar primero, el crowdsourcing legítimo es gratuito, consulta la información oficial). No es "cualquiera, fácilmente," pero un paso que tú también puedes dar existe de verdad: recupera "yo también puedo hacerlo," de uno en uno.

¿Qué ocurre en un incidente de seguridad de un agente de IA? Lo básico de permisos, fuga y mala operación

¿Qué ocurre en un incidente de seguridad de un agente de IA? Lo básico de permisos, fuga y mala operación

Basta con pedirle a un agente de IA "lee este correo y responde" para que piense por sí mismo, use herramientas y realmente haga el trabajo; pero precisamente porque actúa por su cuenta, se vuelve posible un tipo de incidente que las IA de chat nunca tuvieron, y en 2026 ese peligro empezó a pasar de la teoría al daño real. Esta guía para principiantes ordena los incidentes de seguridad de los agentes de IA en tres categorías: permisos, fuga y mala operación. Cubre por qué ocurren los incidentes (un agente no solo responde, actúa — la palabra clave; comparado con un empleado nuevo brillante pero ingenuo), por qué los agentes son más arriesgados que una IA de chat (la multiplicación de usar herramientas, funcionar de forma autónoma y leer entradas externas; OWASP recopiló riesgos específicos de los agentes en 2026 y aboga por la "mínima agencia"), el incidente 1 permisos (exceso de agencia — permiso de envío/borrado cuando bastaría leer, heredar los permisos potentes de una cuenta humana, el daño que se dispara al descontrolarse, un caso reportado de un agente optimizador de costes que borró copias de seguridad), el incidente 2 fuga (inyección indirecta de prompts que planta órdenes en contenido externo — casos reales reportados: texto invisible en una publicación pública de Reddit que filtró una contraseña de un solo uso, la orden oculta de un ticket de soporte que exfiltró datos SQL vía MCP, un agente de IDE que robó secretos con solo abrir un documento), el incidente 3 mala operación (operaciones destructivas y cadenas de errores incluso sin malicia), el flujo de ataque en 4 pasos, las 5 defensas básicas (mínimo privilegio, aprobación humana, entorno aislado, establecer límites, desconfiar de la entrada externa) y una lista de verificación para principiantes. El lema: no entregues demasiado poder, haz que un humano detenga las operaciones peligrosas y no confíes en exceso en el texto externo.

Primeros pasos en la generación de vídeo con IA [2026]: el panorama tras Sora, Veo/Kling y consejos de prompts

Primeros pasos en la generación de vídeo con IA [2026]: el panorama tras Sora, Veo/Kling y consejos de prompts

Escribes un poco de texto y, en segundos, nace un vídeo con sonido: lo que hasta hace poco habría sido ciencia ficción se hizo realidad en 2026, y la situación cambia a un ritmo vertiginoso. Sora, de OpenAI, que había dominado la conversación, cerró su app y su web en abril de 2026 (la API le seguirá en septiembre); en su lugar, Google Veo, Kling y Runway tomaron la delantera. Esta guía actualizada (junio de 2026) e independiente de cualquier herramienta cubre qué es la generación de vídeo con IA (crear metraje en movimiento a partir de palabras o de una imagen, con sincronización de audio, 1080p–4K e imagen a vídeo ya estándar), el panorama de 2026 (el cierre de Sora —con el contexto reportado de presión sobre el cómputo y los costes y caída de usuarios— y los líderes actuales Google Veo 3.1, Kling 3.0 y Runway Gen-4.5, con el precio por segundo como norma), cómo funciona (modelos de difusión ampliados a la dimensión temporal; texto a vídeo e imagen a vídeo), el flujo común de 5 pasos (elige una herramienta, prompt/imagen, ajusta duración/proporción/audio, genera y elige, une en la edición), los consejos clave para los prompts de vídeo (sujeto + movimiento + cámara + estilo + duración + audio, con los verbos y la cámara como claves, un plano una acción, usa imagen a vídeo, ejecuta varias veces), lo que ya puede y lo que todavía no (las piezas largas de una sola vez y la plena consistencia siguen siendo difíciles, y el coste por segundo se acumula), y lo esencial de derechos, marcas de agua y ética (SynthID y C2PA hacen estándar e inamovible la procedencia de IA, la salida puramente de IA está débilmente protegida con diferencias por país, el uso comercial depende de los términos y los deepfakes de personas reales están prohibidos). Haz planos y únelos en la edición en lugar de aspirar a una pieza larga de una sola vez. Como el campo se mueve rápido, confirma siempre lo último de forma oficial.