L'IA Gemini de Google dévoile une fonction de conversion de photos en vidéos
La dernière mise à jour Gemini de Google introduit une conversion révolutionnaire des photos en vidéos grâce au modèle Veo 3. Cette fonction innovante transforme les images statiques en clips vidéo de huit secondes agrémentés d'éléments audio générés par l'intelligence artificielle, tels que des sons ambiants, des bruits de fond et même des paroles synthétisées. Actuellement déployée pour les abonnés Gemini Ultra et Pro dans certaines régions, la version web est lancée aujourd'hui et la version mobile sera disponible cette semaine.
Détails de la mise en œuvre
La nouvelle fonctionnalité d'animation s'intègre de manière transparente dans le flux de travail existant de Gemini. Les utilisateurs activent la fonctionnalité en
- sélectionnant l'option "outils" dans l'interface d'invite
- En choisissant le mode de création "vidéo
- En téléchargeant leur image source et en fournissant des instructions de mouvement
- En ajoutant éventuellement des descriptions audio pour les dialogues et les sons environnementaux.

Spécifications techniques
Le système fournit des vidéos traitées avec les paramètres techniques suivants :
- Format de fichier : Conteneur MP4
- Résolution : 720p HD
- Rapport hauteur/largeur : 16:9 orientation paysage
- Durée : 8 secondes fixes
Applications créatives
Google présente plusieurs cas d'utilisation convaincants de cette technologie :
- Donner vie aux illustrations et aux peintures
- Animer des objets inanimés avec de la personnalité
- Ajouter un mouvement dynamique aux photographies de paysage

Authentification du contenu
Toutes les vidéos générées sont dotées d'un double système de filigrane :
- Filigrane visible indiquant l'origine de l'IA
- Filigrane numérique SynthID intégré pour vérification
Extension de la plateforme
Alors que des fonctionnalités similaires existaient auparavant dans l'application autonome Flow de Google, cette intégration apporte des outils d'animation directement dans l'écosystème de Gemini. Parallèlement, Google annonce une expansion géographique significative pour Flow, rendant l'outil de réalisation de films disponible dans 75 pays supplémentaires, parallèlement au déploiement des fonctionnalités vidéo de Gemini.

Accessibilité et disponibilité
Le lancement progressif de la fonctionnalité suit le calendrier suivant :
- Lancement sur le Web : Disponibilité immédiate
- Déploiement mobile : Déploiement dans la semaine en cours
- Abonnement requis : Gemini Ultra/Pro dans les régions concernées
Article connexe
Ollie mise sur la protection de la vie privée pour remporter la course aux assistants IA
Pour être véritablement utile, un assistant IA doit comprendre en profondeur son utilisateur. Ollie, un assistant personnel conçu pour la vie quotidienne, part du principe que cela ne nécessite pas de
Comment « AI LIVE : Londres » abordera les thèmes de l'IA et de l'automatisation industrielle
Ce sommet réunira des dirigeants de haut niveau venus du monde entier afin d'aborder les défis urgents auxquels sont confrontés les secteurs d'activité à l'échelle mondiale, allant des bouleversements
Anthropic entre sur le marché de la technologie juridique en intelligence artificielle alors que la concurrence s'intensifie
Anthropic a dévoilé une série de nouvelles fonctionnalités de chatbot mardi, visant à fournir un support automatisé aux cabinets d’avocats. Ces améliorations étendent Claude for Legal, la plateforme spécifique aux cabinets lancée plus tôt cette année
Recommandations de sujets spéciaux liés
commentaires (0)
La dernière mise à jour Gemini de Google introduit une conversion révolutionnaire des photos en vidéos grâce au modèle Veo 3. Cette fonction innovante transforme les images statiques en clips vidéo de huit secondes agrémentés d'éléments audio générés par l'intelligence artificielle, tels que des sons ambiants, des bruits de fond et même des paroles synthétisées. Actuellement déployée pour les abonnés Gemini Ultra et Pro dans certaines régions, la version web est lancée aujourd'hui et la version mobile sera disponible cette semaine.
Détails de la mise en œuvre
La nouvelle fonctionnalité d'animation s'intègre de manière transparente dans le flux de travail existant de Gemini. Les utilisateurs activent la fonctionnalité en
- sélectionnant l'option "outils" dans l'interface d'invite
- En choisissant le mode de création "vidéo
- En téléchargeant leur image source et en fournissant des instructions de mouvement
- En ajoutant éventuellement des descriptions audio pour les dialogues et les sons environnementaux.

Spécifications techniques
Le système fournit des vidéos traitées avec les paramètres techniques suivants :
- Format de fichier : Conteneur MP4
- Résolution : 720p HD
- Rapport hauteur/largeur : 16:9 orientation paysage
- Durée : 8 secondes fixes
Applications créatives
Google présente plusieurs cas d'utilisation convaincants de cette technologie :
- Donner vie aux illustrations et aux peintures
- Animer des objets inanimés avec de la personnalité
- Ajouter un mouvement dynamique aux photographies de paysage

Authentification du contenu
Toutes les vidéos générées sont dotées d'un double système de filigrane :
- Filigrane visible indiquant l'origine de l'IA
- Filigrane numérique SynthID intégré pour vérification
Extension de la plateforme
Alors que des fonctionnalités similaires existaient auparavant dans l'application autonome Flow de Google, cette intégration apporte des outils d'animation directement dans l'écosystème de Gemini. Parallèlement, Google annonce une expansion géographique significative pour Flow, rendant l'outil de réalisation de films disponible dans 75 pays supplémentaires, parallèlement au déploiement des fonctionnalités vidéo de Gemini.

Accessibilité et disponibilité
Le lancement progressif de la fonctionnalité suit le calendrier suivant :
- Lancement sur le Web : Disponibilité immédiate
- Déploiement mobile : Déploiement dans la semaine en cours
- Abonnement requis : Gemini Ultra/Pro dans les régions concernées
Ollie mise sur la protection de la vie privée pour remporter la course aux assistants IA
Pour être véritablement utile, un assistant IA doit comprendre en profondeur son utilisateur. Ollie, un assistant personnel conçu pour la vie quotidienne, part du principe que cela ne nécessite pas de
Comment « AI LIVE : Londres » abordera les thèmes de l'IA et de l'automatisation industrielle
Ce sommet réunira des dirigeants de haut niveau venus du monde entier afin d'aborder les défis urgents auxquels sont confrontés les secteurs d'activité à l'échelle mondiale, allant des bouleversements
Anthropic entre sur le marché de la technologie juridique en intelligence artificielle alors que la concurrence s'intensifie
Anthropic a dévoilé une série de nouvelles fonctionnalités de chatbot mardi, visant à fournir un support automatisé aux cabinets d’avocats. Ces améliorations étendent Claude for Legal, la plateforme spécifique aux cabinets lancée plus tôt cette année





Maison






