谷歌云增强AI媒体工具,新增音乐和视频功能

周三,谷歌公布了其Vertex AI云平台的升级,增强了多个专有媒体生成AI模型。
Lyria,谷歌的文本转音乐AI,现已对部分用户开放预览,而Veo 2视频模型新增了高级编辑和视觉效果选项。此外,谷歌推出了由Chirp 3音频处理模型支持的语音克隆功能,供获批用户使用。据谷歌称,Imagen 3图像生成器的性能现已显著提升。
在Cloud Next上宣布的这些更新加强了谷歌在企业生成式AI市场的领导地位,与亚马逊的Bedrock平台展开激烈竞争,后者提供类似的AI工具。
谷歌将Lyria定位为免版税音乐库的替代品,使用户能够生成从爵士钢琴独奏到低保真节拍等多种风格的歌曲。
Chirp 3支持约35种语言的语音合成。今年早些时候首次预览,它为即时自定义语音功能提供支持,该功能仅需10秒音频即可复制语音,现已广泛可用。Chirp 3还支持新的预览工具——带分割的转录,可在多人录音中区分并标记发言者。
谷歌表示,为防止滥用,即时自定义语音功能需经过验证流程以确保语音使用权限合规。
Veo 2现允许用户移除视频中的背景、标志或物体,并扩展视频框架,例如将横向镜头转换为纵向。它还支持调整AI生成场景的摄像机角度和节奏,创建类似延时摄影或无人机风格的镜头效果,并可在指定的起始和结束框架之间进行插值。
这些Veo 2功能目前处于预览阶段。
谷歌指出,Imagen 3的增强改善了其移除物体和修复缺失或损坏图像区域的能力。
由Imagen、Veo和Lyria(但不包括Chirp)创建的所有媒体均带有谷歌的SynthID水印。谷歌强调,其生成式AI模型包含防止创建有害内容的防护措施。
谷歌未披露其模型的训练数据,这一话题因知识产权问题常引发争议。一些公司未经许可使用受版权保护的材料训练AI,声称受美国公平使用保护,尽管创作者常对此提起诉讼。
谷歌此前向TechCrunch表示,它为模型训练提供退出选项,并提供赔偿政策,以保护谷歌云和Vertex AI用户免受与AI相关的版权索赔。
相关文章
谷歌推出虚假来电检测功能,以防范AI深度伪造冒充诈骗
谷歌周二宣布,Android将推出虚假来电检测功能,以防范利用AI深度伪造技术实施的冒充诈骗。该功能将于本月通过“Phone by Google”在全球范围内面向Android 12及以上版本的设备逐步推出,首先适用于Pixel设备。随着人们越来越不愿接听陌生号码的来电,诈骗分子正改变策略,通过伪造可信的电话号码,并利用AI深度伪造技术模仿权威人士、家人或雇主的语气进行诈骗。例如,某人可能会接到一
Frontier AI Labs 拒绝透露针对失控模型的遏制策略
最新研究表明,极少数领先的人工智能实验室曾公布或演示过遏制响应计划。遏制计划规定了当人工智能系统试图颠覆人类控制时应采取的程序,明确了哪些访问权限将被撤销,以及何时应彻底关闭系统。这些发现来自致力于推动前沿人工智能安全开发实践的组织“Guidelight AI Standards”,该组织对五家主要实验室应对此类情景的准备情况进行了评估。 OpenAI 排名最高,而 Anthropic 和 Met
谷歌在2026年IO大会上推出基于音频技术的智能眼镜,此举与Meta的战略如出一辙
谷歌正战略性地重返智能眼镜市场。在周二举行的谷歌I/O大会上,这家科技巨头宣布与Warby Parker和Gentle Monster合作,推出一系列搭载人工智能的新款眼镜。这些设备由谷歌与三星联合设计,经过优化可与Android和iOS平台无缝集成,计划于今年晚些时候发布。谷歌将这些设备称为“音频眼镜”,用户可通过语音指令进行交互,并利用包括Gemini在内的一系列应用和服务来完成各项任务。图片
相关专题推荐
评论 (6)
0/500
Ces outils de génération musicale et vidéo par IA sont fascinants, mais je m'inquiète un peu de l'impact potentiel sur les artistes... Les capacités de Lyria semblent impressionnantes, j'espère qu'il ne s'agira pas juste d'une autre technologie réservée à une élite. 🎵
Wow, Google's Vertex AI upgrades sound wild! Text-to-music with Lyria? I’m curious if it can whip up a catchy tune for my next TikTok. But, man, I hope they’re careful with copyright issues on this stuff. 😎
Wow, Google's Vertex AI upgrades sound like a game-changer for creators! Text-to-music with Lyria? That's like giving my playlists a sci-fi twist. Can't wait to see how this shakes up the content game! 🎶
Lyria sounds like a game-changer for music creation! 🎵 I’m curious if it can nail niche genres like lo-fi jazz. Google’s pushing hard against Amazon’s Bedrock, but I wonder how user-friendly this is for non-techies.
Google's new AI music and video tools sound like a game-changer! I'm stoked to see how Lyria creates tunes from just text prompts. Wonder if it can nail my favorite lo-fi vibes? 😎

周三,谷歌公布了其Vertex AI云平台的升级,增强了多个专有媒体生成AI模型。
Lyria,谷歌的文本转音乐AI,现已对部分用户开放预览,而Veo 2视频模型新增了高级编辑和视觉效果选项。此外,谷歌推出了由Chirp 3音频处理模型支持的语音克隆功能,供获批用户使用。据谷歌称,Imagen 3图像生成器的性能现已显著提升。
在Cloud Next上宣布的这些更新加强了谷歌在企业生成式AI市场的领导地位,与亚马逊的Bedrock平台展开激烈竞争,后者提供类似的AI工具。
谷歌将Lyria定位为免版税音乐库的替代品,使用户能够生成从爵士钢琴独奏到低保真节拍等多种风格的歌曲。
Chirp 3支持约35种语言的语音合成。今年早些时候首次预览,它为即时自定义语音功能提供支持,该功能仅需10秒音频即可复制语音,现已广泛可用。Chirp 3还支持新的预览工具——带分割的转录,可在多人录音中区分并标记发言者。
谷歌表示,为防止滥用,即时自定义语音功能需经过验证流程以确保语音使用权限合规。
Veo 2现允许用户移除视频中的背景、标志或物体,并扩展视频框架,例如将横向镜头转换为纵向。它还支持调整AI生成场景的摄像机角度和节奏,创建类似延时摄影或无人机风格的镜头效果,并可在指定的起始和结束框架之间进行插值。
这些Veo 2功能目前处于预览阶段。
谷歌指出,Imagen 3的增强改善了其移除物体和修复缺失或损坏图像区域的能力。
由Imagen、Veo和Lyria(但不包括Chirp)创建的所有媒体均带有谷歌的SynthID水印。谷歌强调,其生成式AI模型包含防止创建有害内容的防护措施。
谷歌未披露其模型的训练数据,这一话题因知识产权问题常引发争议。一些公司未经许可使用受版权保护的材料训练AI,声称受美国公平使用保护,尽管创作者常对此提起诉讼。
谷歌此前向TechCrunch表示,它为模型训练提供退出选项,并提供赔偿政策,以保护谷歌云和Vertex AI用户免受与AI相关的版权索赔。
谷歌推出虚假来电检测功能,以防范AI深度伪造冒充诈骗
谷歌周二宣布,Android将推出虚假来电检测功能,以防范利用AI深度伪造技术实施的冒充诈骗。该功能将于本月通过“Phone by Google”在全球范围内面向Android 12及以上版本的设备逐步推出,首先适用于Pixel设备。随着人们越来越不愿接听陌生号码的来电,诈骗分子正改变策略,通过伪造可信的电话号码,并利用AI深度伪造技术模仿权威人士、家人或雇主的语气进行诈骗。例如,某人可能会接到一
Frontier AI Labs 拒绝透露针对失控模型的遏制策略
最新研究表明,极少数领先的人工智能实验室曾公布或演示过遏制响应计划。遏制计划规定了当人工智能系统试图颠覆人类控制时应采取的程序,明确了哪些访问权限将被撤销,以及何时应彻底关闭系统。这些发现来自致力于推动前沿人工智能安全开发实践的组织“Guidelight AI Standards”,该组织对五家主要实验室应对此类情景的准备情况进行了评估。 OpenAI 排名最高,而 Anthropic 和 Met
谷歌在2026年IO大会上推出基于音频技术的智能眼镜,此举与Meta的战略如出一辙
谷歌正战略性地重返智能眼镜市场。在周二举行的谷歌I/O大会上,这家科技巨头宣布与Warby Parker和Gentle Monster合作,推出一系列搭载人工智能的新款眼镜。这些设备由谷歌与三星联合设计,经过优化可与Android和iOS平台无缝集成,计划于今年晚些时候发布。谷歌将这些设备称为“音频眼镜”,用户可通过语音指令进行交互,并利用包括Gemini在内的一系列应用和服务来完成各项任务。图片
Ces outils de génération musicale et vidéo par IA sont fascinants, mais je m'inquiète un peu de l'impact potentiel sur les artistes... Les capacités de Lyria semblent impressionnantes, j'espère qu'il ne s'agira pas juste d'une autre technologie réservée à une élite. 🎵
Wow, Google's Vertex AI upgrades sound wild! Text-to-music with Lyria? I’m curious if it can whip up a catchy tune for my next TikTok. But, man, I hope they’re careful with copyright issues on this stuff. 😎
Wow, Google's Vertex AI upgrades sound like a game-changer for creators! Text-to-music with Lyria? That's like giving my playlists a sci-fi twist. Can't wait to see how this shakes up the content game! 🎶
Lyria sounds like a game-changer for music creation! 🎵 I’m curious if it can nail niche genres like lo-fi jazz. Google’s pushing hard against Amazon’s Bedrock, but I wonder how user-friendly this is for non-techies.
Google's new AI music and video tools sound like a game-changer! I'm stoked to see how Lyria creates tunes from just text prompts. Wonder if it can nail my favorite lo-fi vibes? 😎





首页






