Modèles et plateformes d’IA

Le directeur créatif de Google dénonce l’hypothèse entourant la mise à jour Veo 3.1

mm
Ajouter Unite.AI à vos sources préférées sur Google

Henry Daubrez, directeur créatif de Google (GOOGL ) Labs et réalisateur en résidence de l’entreprise, affirme que les enjeux financiers considérables entourant l’intelligence artificielle transforment même les petites améliorations de produits en événements médiatiques gonflés – et il cite la mise à jour du modèle vidéo Veo 3.1 de Google comme exemple principal.

Dans un récent message X, Daubrez a qualifié la sortie de Veo 3.1 de fondamentalement incrémentale, malgré une large couverture qui traite la mise à jour comme un changement de paradigme. “Les enjeux financiers considérables entourant l’IA” créent une pression qui transforme les ajouts de fonctionnalités modestes en événements commercialisés comme révolutionnaires, a-t-il déclaré, reconnaissant que même si Veo 3.1 ajoute des capacités utiles telles que l’animation d’image à image, celles-ci représentent des améliorations mineures plutôt que des avancées.

Google a publié Veo 3.1 le 15 octobre 2025 via une préversion payante dans l’API Gemini, Vertex AI et l’outil de réalisation Flow. La mise à jour étend la longueur maximale de la vidéo à 60 secondes à une résolution de 1080p, ajoute un son plus riche avec des effets sonores synchronisés et une conversation naturelle, et introduit des contrôles de montage, notamment l’interpolation des premiers et derniers cadres et l’extension de scène. Deux variantes de modèle sont livrées : Veo 3.1 donne la priorité à la qualité, tandis que Veo 3.1 Fast est optimisé pour la vitesse.

La critique de Daubrez reflète les dynamiques plus larges de l’industrie à mesure que le cycle d’hypothèse de l’IA entre dans une période de changement financier. Les investissements passent des paris spéculatifs aux applications éprouvées qui démontrent un ROI clair.

Pendant ce temps, les dépenses d’infrastructure des principaux acteurs de l’IA ont atteint des sommets historiques, créant une pression intense pour justifier ces dépenses par des résultats commerciaux tangibles. Les modèles open source ont rapidement banalisé les capacités de base de l’IA, réduisant les marges des fournisseurs propriétaires et forçant les stratégies marketing à mettre l’accent sur les résultats éprouvés plutôt que sur le spectacle technologique.

Daubrez a rejoint Google Labs en tant que réalisateur en résidence en 2025, apportant 18 ans d’expérience dans le mélange du cinéma traditionnel et de la technologie émergente. Le directeur créatif belge et PDG de Dogstudio/DEPT a produit des œuvres primées en utilisant les modèles Veo de Google, notamment le court-métrage “KITSUNE”, pour lequel il a sélectionné plus de 1 700 plans générés par l’IA. Son rôle chez Google consiste à guider le développement du produit Flow pour répondre aux besoins réels de l’industrie créative et à diriger les sessions Flow, un programme de mentorat qui offre aux réalisateurs sélectionnés l’accès à la plate-forme.

Ses commentaires publics sceptiques à l’égard de l’hypothèse de Veo 3.1 sont notables compte tenu de sa double position en tant que membre de Google et défenseur d’un développement d’outils d’IA mesuré et axé sur les créateurs. Les commentaires soulignent la tension entre les impératifs marketing qui déterminent les lancements de produits d’IA et les réalités pratiques auxquelles sont confrontés les professionnels qui utilisent ces outils quotidiennement.

La mise à jour Veo 3.1 s’appuie sur Veo 3, introduit en mai 2025, avec des améliorations qui incluent la possibilité d’insérer ou de supprimer des objets et des personnages avec un éclairage et un ombrage automatiques, des transitions multi-prompt, et des contrôles d’identité et de caméra améliorés.

Les remarques de Daubrez suggèrent que même ceux qui construisent et promeuvent les outils d’IA reconnaissent le fossé entre les récits marketing et le progrès technique incrémental – une déconnexion qui peut s’aggraver à mesure que l’examen financier s’intensifie et que l’industrie passe des lancements à l’hypothèse à la création de valeur durable.

Alex McFarland est un journaliste et écrivain en intelligence artificielle qui explore les derniers développements en intelligence artificielle. Il a collaboré avec de nombreuses startups et publications en intelligence artificielle dans le monde entier.