A IA Gemini do Google revela o recurso de conversão de foto em vídeo
A mais recente atualização do Gemini do Google apresenta a inovadora conversão de foto em vídeo com o modelo Veo 3. Esse recurso inovador transforma imagens estáticas em videoclipes de oito segundos aprimorados com elementos de áudio gerados por IA, como sons ambientes, ruído de fundo e até mesmo fala sintetizada. Atualmente, a versão web está sendo lançada para os assinantes Gemini Ultra e Pro em regiões selecionadas, e a versão móvel será lançada ainda esta semana.
Detalhes da implementação
A nova funcionalidade de animação se integra perfeitamente ao fluxo de trabalho existente do Gemini. Os usuários ativam o recurso ao:
- Selecionando a opção "tools" (ferramentas) na interface de prompt
- Escolher o modo de criação "vídeo".
- Fazer o upload da imagem de origem e fornecer instruções de movimento
- Opcionalmente, adicionar descrições de áudio para diálogos e sons ambientais

Especificações técnicas
O sistema fornece vídeos processados com estes parâmetros técnicos:
- Formato do arquivo: Contêiner MP4
- Resolução: 720p HD
- Proporção de aspecto: orientação paisagem 16:9
- Duração: 8 segundos de duração fixa
Aplicativos criativos
O Google destaca vários casos de uso atraentes para a tecnologia:
- Dar vida a ilustrações e pinturas
- Animação de objetos inanimados com personalidade
- Adicionar movimento dinâmico à fotografia de paisagem

Autenticação de conteúdo
Todos os vídeos gerados incluem dois sistemas de marca d'água:
- Marca d'água visível indicando a origem da IA
- Marca d'água digital SynthID incorporada para verificação
Expansão da plataforma
Embora recursos semelhantes existissem anteriormente no aplicativo Flow autônomo do Google, essa integração traz as ferramentas de animação diretamente para o ecossistema da Gemini. Ao mesmo tempo, o Google anuncia uma expansão geográfica significativa para o Flow, disponibilizando a ferramenta de criação de filmes em mais 75 países, juntamente com o lançamento do recurso de vídeo da Gemini.

Acessibilidade e disponibilidade
O lançamento em fases do recurso segue este cronograma:
- Lançamento na Web: Disponibilidade imediata
- Implementação móvel: Implementação na semana atual
- Requisito de assinatura: Nível Gemini Ultra/Pro nas regiões com suporte
Artigo relacionado
Ollie aposta na privacidade para vencer a corrida dos assistentes de IA
Para ser realmente útil, um assistente de IA precisa compreender profundamente seu usuário. O Ollie, um assistente pessoal projetado para o dia a dia, opera com base na premissa de que isso não exige
Como o AI LIVE: Londres explorará a IA e a automação industrial
A cúpula reunirá executivos de alto escalão de todo o mundo para discutir os desafios urgentes enfrentados pelos setores globais, que vão desde as transformações impulsionadas pela IA até a volatilida
A Anthropic entra no mercado de tecnologia jurídica de IA à medida que a competição se intensifica
A Anthropic apresentou na terça-feira um conjunto de novas funcionalidades para chatbots, destinadas a oferecer suporte automatizado a escritórios de advocacia. Essas melhorias expandem o Claude for Legal, a plataforma específica para firmas lançada
Recomendações de tópicos especiais relacionados
Comentários (0)
A mais recente atualização do Gemini do Google apresenta a inovadora conversão de foto em vídeo com o modelo Veo 3. Esse recurso inovador transforma imagens estáticas em videoclipes de oito segundos aprimorados com elementos de áudio gerados por IA, como sons ambientes, ruído de fundo e até mesmo fala sintetizada. Atualmente, a versão web está sendo lançada para os assinantes Gemini Ultra e Pro em regiões selecionadas, e a versão móvel será lançada ainda esta semana.
Detalhes da implementação
A nova funcionalidade de animação se integra perfeitamente ao fluxo de trabalho existente do Gemini. Os usuários ativam o recurso ao:
- Selecionando a opção "tools" (ferramentas) na interface de prompt
- Escolher o modo de criação "vídeo".
- Fazer o upload da imagem de origem e fornecer instruções de movimento
- Opcionalmente, adicionar descrições de áudio para diálogos e sons ambientais

Especificações técnicas
O sistema fornece vídeos processados com estes parâmetros técnicos:
- Formato do arquivo: Contêiner MP4
- Resolução: 720p HD
- Proporção de aspecto: orientação paisagem 16:9
- Duração: 8 segundos de duração fixa
Aplicativos criativos
O Google destaca vários casos de uso atraentes para a tecnologia:
- Dar vida a ilustrações e pinturas
- Animação de objetos inanimados com personalidade
- Adicionar movimento dinâmico à fotografia de paisagem

Autenticação de conteúdo
Todos os vídeos gerados incluem dois sistemas de marca d'água:
- Marca d'água visível indicando a origem da IA
- Marca d'água digital SynthID incorporada para verificação
Expansão da plataforma
Embora recursos semelhantes existissem anteriormente no aplicativo Flow autônomo do Google, essa integração traz as ferramentas de animação diretamente para o ecossistema da Gemini. Ao mesmo tempo, o Google anuncia uma expansão geográfica significativa para o Flow, disponibilizando a ferramenta de criação de filmes em mais 75 países, juntamente com o lançamento do recurso de vídeo da Gemini.

Acessibilidade e disponibilidade
O lançamento em fases do recurso segue este cronograma:
- Lançamento na Web: Disponibilidade imediata
- Implementação móvel: Implementação na semana atual
- Requisito de assinatura: Nível Gemini Ultra/Pro nas regiões com suporte
Ollie aposta na privacidade para vencer a corrida dos assistentes de IA
Para ser realmente útil, um assistente de IA precisa compreender profundamente seu usuário. O Ollie, um assistente pessoal projetado para o dia a dia, opera com base na premissa de que isso não exige
Como o AI LIVE: Londres explorará a IA e a automação industrial
A cúpula reunirá executivos de alto escalão de todo o mundo para discutir os desafios urgentes enfrentados pelos setores globais, que vão desde as transformações impulsionadas pela IA até a volatilida
A Anthropic entra no mercado de tecnologia jurídica de IA à medida que a competição se intensifica
A Anthropic apresentou na terça-feira um conjunto de novas funcionalidades para chatbots, destinadas a oferecer suporte automatizado a escritórios de advocacia. Essas melhorias expandem o Claude for Legal, a plataforma específica para firmas lançada





Lar






