Google Cloud Melhora Ferramentas de Mídia de IA com Novos Recursos de Música e Vídeo

Na quarta-feira, o Google anunciou melhorias em sua plataforma de nuvem Vertex AI, aprimorando vários modelos de IA geradores de mídia proprietários.
Lyria, a IA de texto para música do Google, está agora em pré-visualização para usuários selecionados, enquanto o modelo de vídeo Veo 2 ganha opções avançadas de edição e efeitos visuais. Além disso, o Google introduziu um recurso de clonagem de voz alimentado pelo Chirp 3, seu modelo de processamento de áudio, para usuários aprovados. O gerador de imagens Imagen 3 agora oferece desempenho significativamente melhorado, segundo o Google.
Anunciadas no Cloud Next, essas atualizações fortalecem a aposta do Google em liderar o mercado de IA generativa empresarial, competindo diretamente com a plataforma Bedrock da Amazon, que oferece ferramentas de IA semelhantes.
O Google promove o Lyria como um substituto para bibliotecas de música livres de royalties, permitindo que os usuários produzam músicas em diversos estilos, desde solos de piano jazz até batidas lo-fi.
O Chirp 3 suporta síntese de fala em aproximadamente 35 idiomas. Inicialmente apresentado no início deste ano, ele alimenta o Instant Custom Voice, que pode replicar uma voz usando apenas 10 segundos de áudio e agora está amplamente disponível. O Chirp 3 também possibilita uma nova ferramenta de pré-visualização, Transcrição com Diarização, que distingue e rotula falantes em gravações com várias pessoas.
Para evitar mau uso, o Instant Custom Voice passa por um processo de verificação para garantir permissões adequadas de uso de voz, diz o Google.
O Veo 2 agora permite que os usuários removam fundos, logotipos ou objetos de vídeos e estendam quadros de vídeo, como converter filmagens de paisagem para retrato. Ele também suporta ajustes de ângulos de câmera e ritmo para cenas geradas por IA, criando efeitos como lapso de tempo ou tomadas estilo drone, e pode interpolar entre quadros inicial e final especificados.
Esses recursos do Veo 2 estão atualmente em pré-visualização.
O Google destacou que as melhorias do Imagen 3 aprimoram sua capacidade de remover objetos e restaurar áreas de imagem ausentes ou danificadas.
Todas as mídias criadas por Imagen, Veo e Lyria (mas não pelo Chirp) carregam a marca d'água SynthID do Google. O Google enfatizou que seus modelos de IA generativa incluem salvaguardas para prevenir a criação de conteúdo prejudicial.
O Google não divulgou os dados de treinamento de seus modelos, um tópico frequentemente debatido devido a preocupações com propriedade intelectual. Algumas empresas treinam IA com material protegido por direitos autorais sem permissão, alegando proteções de uso justo nos EUA, embora criadores frequentemente contestem isso em tribunais.
O Google informou anteriormente ao TechCrunch que oferece opções de exclusão para treinamento de modelos e uma política de indenização para proteger os usuários do Google Cloud e Vertex AI contra reivindicações de direitos autorais relacionadas à IA.
Artigo relacionado
O Google lança recurso de detecção de chamadas falsas para proteger contra golpes de falsificação de identidade por meio de deepfakes gerados por IA
O Google anunciou nesta terça-feira que o Android está lançando um recurso de detecção de chamadas falsas para proteger contra golpes de falsificação de identidade por meio de deepfakes gerados por IA
A Frontier AI Labs se recusa a divulgar estratégias de contenção para modelos rebeldes
Pesquisas recentes indicam que muito poucos laboratórios líderes em IA publicaram ou demonstraram planos de resposta para contenção. Um plano de contenção define os procedimentos a serem seguidos quan
O Google lança óculos inteligentes com tecnologia de áudio na IO 2026, seguindo a estratégia da Meta
O Google está retornando estrategicamente ao mercado de óculos inteligentes.Durante o evento Google I/O desta terça-feira, a gigante da tecnologia revelou uma parceria com a Warby Parker e a Gentle Mo
Recomendações de tópicos especiais relacionados
Comentários (6)
Ces outils de génération musicale et vidéo par IA sont fascinants, mais je m'inquiète un peu de l'impact potentiel sur les artistes... Les capacités de Lyria semblent impressionnantes, j'espère qu'il ne s'agira pas juste d'une autre technologie réservée à une élite. 🎵
Wow, Google's Vertex AI upgrades sound wild! Text-to-music with Lyria? I’m curious if it can whip up a catchy tune for my next TikTok. But, man, I hope they’re careful with copyright issues on this stuff. 😎
Wow, Google's Vertex AI upgrades sound like a game-changer for creators! Text-to-music with Lyria? That's like giving my playlists a sci-fi twist. Can't wait to see how this shakes up the content game! 🎶
Lyria sounds like a game-changer for music creation! 🎵 I’m curious if it can nail niche genres like lo-fi jazz. Google’s pushing hard against Amazon’s Bedrock, but I wonder how user-friendly this is for non-techies.
Google's new AI music and video tools sound like a game-changer! I'm stoked to see how Lyria creates tunes from just text prompts. Wonder if it can nail my favorite lo-fi vibes? 😎

Na quarta-feira, o Google anunciou melhorias em sua plataforma de nuvem Vertex AI, aprimorando vários modelos de IA geradores de mídia proprietários.
Lyria, a IA de texto para música do Google, está agora em pré-visualização para usuários selecionados, enquanto o modelo de vídeo Veo 2 ganha opções avançadas de edição e efeitos visuais. Além disso, o Google introduziu um recurso de clonagem de voz alimentado pelo Chirp 3, seu modelo de processamento de áudio, para usuários aprovados. O gerador de imagens Imagen 3 agora oferece desempenho significativamente melhorado, segundo o Google.
Anunciadas no Cloud Next, essas atualizações fortalecem a aposta do Google em liderar o mercado de IA generativa empresarial, competindo diretamente com a plataforma Bedrock da Amazon, que oferece ferramentas de IA semelhantes.
O Google promove o Lyria como um substituto para bibliotecas de música livres de royalties, permitindo que os usuários produzam músicas em diversos estilos, desde solos de piano jazz até batidas lo-fi.
O Chirp 3 suporta síntese de fala em aproximadamente 35 idiomas. Inicialmente apresentado no início deste ano, ele alimenta o Instant Custom Voice, que pode replicar uma voz usando apenas 10 segundos de áudio e agora está amplamente disponível. O Chirp 3 também possibilita uma nova ferramenta de pré-visualização, Transcrição com Diarização, que distingue e rotula falantes em gravações com várias pessoas.
Para evitar mau uso, o Instant Custom Voice passa por um processo de verificação para garantir permissões adequadas de uso de voz, diz o Google.
O Veo 2 agora permite que os usuários removam fundos, logotipos ou objetos de vídeos e estendam quadros de vídeo, como converter filmagens de paisagem para retrato. Ele também suporta ajustes de ângulos de câmera e ritmo para cenas geradas por IA, criando efeitos como lapso de tempo ou tomadas estilo drone, e pode interpolar entre quadros inicial e final especificados.
Esses recursos do Veo 2 estão atualmente em pré-visualização.
O Google destacou que as melhorias do Imagen 3 aprimoram sua capacidade de remover objetos e restaurar áreas de imagem ausentes ou danificadas.
Todas as mídias criadas por Imagen, Veo e Lyria (mas não pelo Chirp) carregam a marca d'água SynthID do Google. O Google enfatizou que seus modelos de IA generativa incluem salvaguardas para prevenir a criação de conteúdo prejudicial.
O Google não divulgou os dados de treinamento de seus modelos, um tópico frequentemente debatido devido a preocupações com propriedade intelectual. Algumas empresas treinam IA com material protegido por direitos autorais sem permissão, alegando proteções de uso justo nos EUA, embora criadores frequentemente contestem isso em tribunais.
O Google informou anteriormente ao TechCrunch que oferece opções de exclusão para treinamento de modelos e uma política de indenização para proteger os usuários do Google Cloud e Vertex AI contra reivindicações de direitos autorais relacionadas à IA.
O Google lança recurso de detecção de chamadas falsas para proteger contra golpes de falsificação de identidade por meio de deepfakes gerados por IA
O Google anunciou nesta terça-feira que o Android está lançando um recurso de detecção de chamadas falsas para proteger contra golpes de falsificação de identidade por meio de deepfakes gerados por IA
A Frontier AI Labs se recusa a divulgar estratégias de contenção para modelos rebeldes
Pesquisas recentes indicam que muito poucos laboratórios líderes em IA publicaram ou demonstraram planos de resposta para contenção. Um plano de contenção define os procedimentos a serem seguidos quan
O Google lança óculos inteligentes com tecnologia de áudio na IO 2026, seguindo a estratégia da Meta
O Google está retornando estrategicamente ao mercado de óculos inteligentes.Durante o evento Google I/O desta terça-feira, a gigante da tecnologia revelou uma parceria com a Warby Parker e a Gentle Mo
Ces outils de génération musicale et vidéo par IA sont fascinants, mais je m'inquiète un peu de l'impact potentiel sur les artistes... Les capacités de Lyria semblent impressionnantes, j'espère qu'il ne s'agira pas juste d'une autre technologie réservée à une élite. 🎵
Wow, Google's Vertex AI upgrades sound wild! Text-to-music with Lyria? I’m curious if it can whip up a catchy tune for my next TikTok. But, man, I hope they’re careful with copyright issues on this stuff. 😎
Wow, Google's Vertex AI upgrades sound like a game-changer for creators! Text-to-music with Lyria? That's like giving my playlists a sci-fi twist. Can't wait to see how this shakes up the content game! 🎶
Lyria sounds like a game-changer for music creation! 🎵 I’m curious if it can nail niche genres like lo-fi jazz. Google’s pushing hard against Amazon’s Bedrock, but I wonder how user-friendly this is for non-techies.
Google's new AI music and video tools sound like a game-changer! I'm stoked to see how Lyria creates tunes from just text prompts. Wonder if it can nail my favorite lo-fi vibes? 😎





Lar






