Google a fait un bond qualitatif dans la génération de contenu audiovisuel avec l'intelligence artificielle en présentant Veo 2 et Imagen 3, deux modèles qui atteignent des résultats sans précédent dans la création de vidéos et d'images réalistes.
Les nouvelles versions des modèles d'intelligence artificielle de Google marquent un tournant dans la génération de contenu numérique. Veo 2 se distingue par sa capacité à créer des vidéos en 4K avec une meilleure compréhension de la physique du monde réel et du mouvement humain, permettant également un contrôle précis des aspects cinématographiques comme le type d'objectif ou les effets visuels.
Le modèle Imagen 3 a également connu des améliorations significatives, offrant désormais des images plus lumineuses et mieux composées, avec la capacité de reproduire divers styles artistiques avec une plus grande précision, du photoréalisme à l'anime. Google a également mis en place un filigrane invisible SynthID sur toutes les créations pour les identifier comme générées par l'IA.
En complément de ces mises à jour, l'entreprise a présenté Whisk, un nouvel outil expérimental qui combine Imagen 3 avec les capacités de compréhension visuelle de Gemini. Cette intégration permet aux utilisateurs de mélanger et de modifier des images existantes pour créer de nouveaux designs personnalisés.
Les nouveaux modèles sont disponibles via VideoFX et ImageFX dans Google Labs, avec des plans d'extension de leur accès à YouTube Shorts et d'autres produits Google au cours de l'année prochaine. L'entreprise maintient son engagement envers un développement responsable, en mettant en œuvre un déploiement progressif pour garantir la qualité et la sécurité de ces technologies.
Gemini est l'assistant d'intelligence artificielle de Google développé par DeepMind. Travaille avec texte, images, audio, vidéo et code. Génère du contenu, répond aux questions et se connecte ...
Google AI développe des plateformes avancées qui améliorent la vie des gens. Son écosystème Gemini intègre modèles, produits et APIs, stimulant l'innovation responsable et permettant aux ...
16/07/2026
SpaceXAI a présenté Grok 4.5, son modèle le plus avancé à ce jour, entraîné avec Cursor et conçu pour la programmation, les tâches d'agents ...
15/07/2026
Thinking Machines Lab lance Inkling, son premier modèle d'IA à poids ouverts : il traite nativement le texte, l'image et l'audio, et vise à être ...
13/07/2026
Le Stanford Digital Economy Lab a présenté le manifeste We Must Act Now, soutenu par 16 lauréats du prix Nobel et plus de 200 économistes et ...
09/07/2026
La famille GPT-5.6, avec les modèles Sol, Terra et Luna, est désormais disponible sur ChatGPT, Codex et l'API après sa version d'essai limitée, ...