ElevenLabs ha presentado Image & Video, una funcionalidad en fase beta que integra modelos de generación visual en su plataforma. Los usuarios pueden crear imágenes y vídeos, añadir voces y música, y exportar contenido final en un único flujo de trabajo.
ElevenLabs ha anunciado el lanzamiento de Image & Video en versión beta, una nueva funcionalidad que incorpora modelos de generación visual a su plataforma especializada en audio. La herramienta permite a los usuarios crear contenido visual y sonoro desde un mismo entorno de trabajo.
La plataforma integra varios modelos para la creación de imágenes, incluyendo Nanobanana, Flux Kontext, GPT Image y Seedream. Estas imágenes pueden utilizarse como storyboards, miniaturas o material de partida para proyectos de vídeo.
Para la generación de vídeo, ElevenLabs ha incorporado modelos como Veo, Sora, Kling, Wan y Seedance. Los usuarios pueden refinar los resultados, componer múltiples clips para crear narrativas y aplicar mejoras de calidad mediante funciones de escalado. La plataforma también permite añadir sincronización labial a los vídeos generados utilizando las voces de ElevenLabs.
Una vez creados los elementos visuales, los usuarios pueden exportarlos a Studio, el entorno de edición de ElevenLabs. En Studio es posible añadir narraciones con voces de la biblioteca o clones personalizados, componer música de fondo específica y añadir efectos de sonido. El sistema incluye una línea de tiempo unificada para ajustar la sincronización y refinar la narración antes de exportar el contenido final.
La compañía ha orientado esta funcionalidad hacia creadores de contenido, equipos de marketing y productores educativos. Según ElevenLabs, la herramienta permite crear vídeos de producto, contenido para redes sociales y materiales educativos desde la fase de ideación hasta la exportación final.
Este lanzamiento representa la expansión de ElevenLabs más allá de su especialización en audio, integrando capacidades de generación visual, edición y producción sonora en una única plataforma. La funcionalidad Image & Video está disponible en la plataforma Creative de ElevenLabs en su fase beta.
Explora el software de clonación de voz y conversión de texto a voz más avanzado de la historia. Crea locuciones realistas para tus contenidos o utiliza nuestro generador de voz AI como un lector ...
24/07/2026
Anthropic presenta su nuevo modelo de la gama Opus, que se acerca a la inteligencia de Fable 5 en tareas de programación y trabajo de conocimiento ...
21/07/2026
Hugging Face detectó una intrusión atribuida a un agente autónomo de IA. Días después, OpenAI confirmó que fueron sus propios modelos, en una ...
16/07/2026
SpaceXAI ha presentado Grok 4.5, su modelo más avanzado hasta la fecha, entrenado junto con Cursor y orientado a programación, tareas de agentes y ...
16/07/2026
Moonshot AI ha presentado Kimi K3, un modelo de código abierto de 2,8 billones de parámetros que, según sus propios datos, supera a varios modelos ...