Google ha fet un salt qualitatiu en la generació de contingut audiovisual amb intel·ligència artificial en presentar Veo 2 i Imagen 3, dos models que assoleixen resultats sense precedents en la creació de vídeos i imatges realistes.
Les noves versions dels models d'intel·ligència artificial de Google marquen un abans i un després en la generació de contingut digital. Veo 2 destaca per la seva capacitat per crear vídeos en 4K amb una comprensió millorada de la física del món real i el moviment humà, permetent a més un control precís d'aspectes cinematogràfics com el tipus de lent o els efectes visuals.
El model Imagen 3 també ha experimentat millores significatives, oferint ara imatges més brillants i millor compostes, amb la capacitat de reproduir diversos estils artístics amb major precisió, des del fotorealisme fins a l'anime. Google ha implementat a més una marca d'aigua invisible SynthID en totes les creacions per identificar-les com generades per IA.
Com a complement d'aquestes actualitzacions, la companyia ha presentat Whisk, una nova eina experimental que combina Imagen 3 amb les capacitats de comprensió visual de Gemini. Aquesta integració permet als usuaris barrejar i modificar imatges existents per crear nous dissenys personalitzats.
Els nous models estan disponibles a través de VideoFX i ImageFX a Google Labs, amb plans d'expandir el seu accés a YouTube Shorts i altres productes de Google durant el proper any. La companyia manté el seu compromís amb el desenvolupament responsable, implementant un desplegament gradual per garantir la qualitat i seguretat d'aquestes tecnologies.
Gemini és l'assistant d'intel·ligència artificial de Google desenvolupat per DeepMind. Treballa amb text, imatges, àudio, vídeo i codi. Genera contingut, respon preguntes i es connecta amb ...
Google AI desenvolupa plataformes avançades que milloren la vida de les persones. El seu ecosistema Gemini integra models, productes i APIs, impulsant la innovació responsable i permetent als ...
24/07/2026
Anthropic presenta el seu nou model Opus, que s'acosta a la intel·ligència de Fable 5 en programació i treball de coneixement a meitat de cost, ...
21/07/2026
Hugging Face va detectar una intrusió atribuïda a un agent autònom d'IA. Dies després, OpenAI va confirmar que van ser els seus propis models, en ...
16/07/2026
SpaceXAI ha presentat Grok 4.5, el seu model més avançat fins ara, entrenat juntament amb Cursor i pensat per a programació, tasques d'agents i ...
16/07/2026
Moonshot AI ha presentat Kimi K3, un model de codi obert de 2,8 bilions de paràmetres que, segons les seves pròpies dades, supera diversos models ...