ElevenLabs integra generació d’imatge i vídeo a la seva plataforma d’àudio

17/11/2025

ElevenLabs ha presentat Image & Video, una funcionalitat en fase beta que integra models de generació visual a la seva plataforma. Els usuaris poden crear imatges i vídeos, afegir veus i música, i exportar contingut final en un únic flux de treball.

ElevenLabs integra generació d’imatge i vídeo a la seva plataforma d’àudio

ElevenLabs ha anunciat el llançament d'Image & Video en versió beta, una nova funcionalitat que incorpora models de generació visual a la seva plataforma especialitzada en àudio. L'eina permet als usuaris crear contingut visual i sonor des d'un mateix entorn de treball.

La plataforma integra diversos models per a la creació d'imatges, incloent Nanobanana, Flux Kontext, GPT Image i Seedream. Aquestes imatges poden utilitzar-se com a storyboards, miniatures o material de partida per a projectes de vídeo.

Per a la generació de vídeo, ElevenLabs ha incorporat models com Veo, Sora, Kling, Wan i Seedance. Els usuaris poden refinar els resultats, compondre múltiples clips per crear narratives i aplicar millores de qualitat mitjançant funcions d'escalat. La plataforma també permet afegir sincronització labial als vídeos generats utilitzant les veus d'ElevenLabs.

Un cop creats els elements visuals, els usuaris poden exportar-los a Studio, l'entorn d'edició d'ElevenLabs. A Studio és possible afegir narracions amb veus de la biblioteca o clons personalitzats, compondre música de fons específica i afegir efectes de so. El sistema inclou una línia de temps unificada per ajustar la sincronització i refinar la narració abans d'exportar el contingut final.

La companyia ha orientat aquesta funcionalitat cap a creadors de contingut, equips de màrqueting i productors educatius. Segons ElevenLabs, l'eina permet crear vídeos de producte, contingut per a xarxes socials i materials educatius des de la fase d'ideació fins a l'exportació final.

Aquest llançament representa l'expansió d'ElevenLabs més enllà de la seva especialització en àudio, integrant capacitats de generació visual, edició i producció sonora en una única plataforma. La funcionalitat Image & Video està disponible a la plataforma Creative d'ElevenLabs en la seva fase beta.

Punts clau

  • ElevenLabs llança Image & Video en versió beta per crear contingut visual i sonor
  • Integra models d'imatge com Nanobanana, Flux Kontext, GPT Image i Seedream
  • Inclou models de vídeo com Veo, Sora, Kling, Wan i Seedance
  • Permet afegir sincronització labial amb les veus d'ElevenLabs
  • Studio ofereix edició amb veus, música personalitzada i efectes de so
  • La línia de temps unificada permet ajustar sincronització i narració
  • Orientat a creadors, equips de màrqueting i productors educatius
  • Disponible a la plataforma Creative d'ElevenLabs

Vídeos

IA relacionada

ElevenLabs

Generació de veu IA

Explora el servei de clonació de veu i conversió de text a veu més avançat de la història. Crea locucions realistes per als teus continguts o utilitza el nostre generador de veu AI com un lector ...

Últimes noticies

★★★★★
Valora'ns a Google
Aquest lloc web utilitza cookies tècniques, de personalització i anàlisi, pròpies i de tercers, per facilitar la navegació anònima i analitzar estadístiques d’ús del web. Considerem que si continueu navegant, n’accepteu l’ús.