Google I/O 2025 展示創作媒體的實際應用

在 I/O 2025 上,我們透過簡報和實際應用來展示生成式人工智能的能力。我們推出了令人振奮的最新視訊和影像產生模型-Veo 3 和 Imagen 4,並擴大了 Lyria 2 的使用範圍。我們還介紹了Flow,這是一款人工智能電影製作工具,可使用我們最先進的生成模型,無縫創作電影剪輯、場景和連貫敘述。
我們也將這些工具整合到旗艦年度活動中:I/O 主題演講中有 219 張幻燈片是由 AI 製作,48% 的主題演講視覺效果是使用 Imagen 製作,而 80% 的影片則以某種形式結合了 Veo 或 Imagen。以下將深入介紹我們如何運用自己的 AI 工具,包括我們的提示撰寫流程,將 I/O 2025 變得栩栩如生:
Veo 2:設計有風格的演講者標題卡
當我們的副總裁兼搜尋部主管 Elizabeth Reid 上台分享主要的搜尋更新時,螢幕上播放了一段短片,顯示 Liz 張開她的手,露出一隻精巧的橘色摺紙鶴,這隻鶴在她的手掌上方旋轉懸浮。
我們使用 AI Studio 和 Vertex AI Studio(由 Veo 2 驅動)的圖像轉視訊功能來製作這段影片和其他演講者介紹影片。我們收集了講者的頭像,以及他們的興趣和嗜好的詳細資料,並將其納入提示中。這是我們為研究科學家 Jason Baldridge 製作的標題卡提示:
這是 Veo 2 的原始輸出,以簡單的動畫增強,以及觀眾在台上看到的情況:
Imagen 4 與 Veo 3:製作電影的故事板
I/O 展映的數部電影在製作過程中都使用了 AI 工具。開場影片帶領觀眾穿越一個西部主題的小鎮,展開一段驚心動魄的旅程,之後畫面上方顯示拼有「Welcome to I/O」字樣的彩色氣球,為主題演講揭開序幕。
製作團隊採用了各種 AI 工具來製作這部影片。他們首先使用 Imagen 4 來產生影片提示的影像。他們也與 Google DeepMind 團隊合作,使用 Gemini 來精煉提示語,幫助他們找到正確的語言,達到預期的效果。這是用於第一場景的提示:
這是他們產生的結果:
接下來,團隊將這張圖片納入 Veo 3 的提示中,其中包括以下指示:
準備好圖片和精煉的提示後,他們開始使用我們最新的 Veo 3 技術製作影片(可透過 Google AI Ultra 計劃使用!)。他們也使用 Veo 3 進行即時調整 - 在檢視輸出時加入俯拍、更廣的角度以及不同的視覺效果。傳統電影製作經常需要重拍場景,而 Veo 3 則不一樣,團隊可以更快地進行迭代。不需要編碼:部分團隊成員使用 Colab 功能進行編碼剪輯,其他許多成員則依賴文字到影片的提示,以自然語言描述剪輯和要求。
以下是用來創作電影最後一幕的提示:
Lyria RealTime:與 Toro y Moi 即時演奏
在 I/O 預展期間,藝術家 Toro y Moi 在現場音樂佈景中使用 Lyria RealTime 來展示模型的最新功能。Lyria RealTime 是我們的互動式音樂產生模型,可讓您即時製作、控制和表演產生式音樂。您可以混合和變換樂器、聲音、流派等。「這將會是一場表演和實驗,」他在開始前解釋道。「我所演奏的一切都完全是即興創作--我在和電腦即興演奏,電腦也在和我即興演奏」。
在表演前的幾個星期,團隊提供 Toro y Moi 一台 Lyria RealTime 原型,讓他可以測試並改良他的提示。這有助於他在表演中發展出創意概念和提示。他創造了 16 種聲音提示,包括「混亂的康加舞者」和「音高偏移的英國叢林鼓」,並將它們指定給實體 MIDI 控制器上的旋鈕。
透過 MIDI 控制器在本機執行 Lyria RealTime,讓 Toro y Moi 可以在舞台上使用這個模型,並讓觀眾即時看到介面的運作。
表演期間,在 Toro y Moi 身後展示了一個以 Lyria RealTime API 建立並在 MIDI 控制器上執行的應用程式。觀眾可以看到應用程式中創建和控制連續音樂流的選項,以及他在鍵盤和人聲潤飾分層時所使用的提示。
您可以使用 AI Studio 中的 Lyria RealTime API 親自嘗試。
AI Studio:創造 AI 產生的 Swag
我們在 Google AI Studio (我們用來快速測試模型和實驗提示的免費介面) 中使用了幾個 Gemini 模型,設計出今年的 I/O 襯衫,上面有全新的客製化標誌。正如襯衫的標籤所描述的,創意提示是「Google I/O 標誌融化在地上、彩虹色、插圖、攝影棚燈光」。以下是我們的創作過程:
首先,團隊在 AI Studio 中選擇了 Gemini 2.5 Pro,並透過詳細的系統指令提示定義了他們的目標。
設定這些指引後,他們輸入先前提到的創意提示。Gemini 2.5 Pro 隨即會針對所需的影像輸出,產生一份需求與風格構思的清單。例如"核心形狀:三種原始圖形(整體矩形、細斜線/矩形和圓柱形)的基本幾何形狀必須仍然清晰可辨且視覺上與眾不同,即使在它們的側面使用了融化效果。不要扭曲核心結構,使其超出融化塗料的效果"。
團隊拿到這些書面指示後,便改用我們的主力機型 Gemini 2.0 Flash 與圖像產生功能,根據產生的清單製作各種圖像選項。
經過廣泛的實驗後,他們選出了幾個最後的設計 - 包括這個。
值得注意的是,團隊也嘗試繞過 Gemini 2.5 Pro 的初始提示重寫,直接在 AI Studio 中使用 Gemini 2.0 Flash。儘管他們接近了想要的結果,但使用 2.5 Pro 重寫一直能提供更好的結果與更多的創意細節。結果如何?一些非常酷的 T 恤!
準備好回顧了嗎?在此瞭解 I/O 2025 最重要的公告,並使用我們的 I/O 問答測試您的知識。
相關文章
Google 測試 Remy AI 代理,以 Gemini 為重點轉向使用者控制
根據《商業內幕》的報道,谷歌正在測試 Remy,這是 Gemini 的一款全新 AI 個人代理工具。該工具旨在代表使用者執行任務,從而簡化專業工作流程和日常事務。目前,Remy 正在 Gemini 應用的內部員工專屬版本中進行測試。該報告引用了一份內部檔案以及對兩位熟悉該專案的個人的採訪。內部資料將 Remy 描述為“全天候個人代理”,將 Gemini 定位為能夠代表使用者行事的主動助手。接近該專案的訊息人士證實,谷歌員工正在積極測試 Remy。谷歌發言人拒絕提供進一步評論。該報告未提及公開發布
奧利押注隱私保護,力爭在 AI 助理競賽中勝出
要真正發揮實用價值,人工智慧助理必須深入了解其使用者。Ollie 是一款專為日常生活設計的個人助理,其運作前提是:這無需您交出個人資料,亦不會損害您的隱私。雖然某些企業級 AI 工具提供資料隱私保障,但 Ollie 作為首批獲得 SOC 2 合規認證的主流、以家庭為導向的 AI 服務之一,顯得格外突出。此框架允許企業透過獨立稽核證明,其已建立正式的管控措施來保護客戶資料,並確保系統運作的安全性。達
「AI LIVE:倫敦」將如何探討人工智慧與工業自動化
本次峰會將匯聚來自全球的高階主管,共同探討全球產業面臨的迫切挑戰,涵蓋範圍從人工智慧驅動的顛覆性變革到經濟波動。AI LIVE:倫敦峰會將以「科技+人類使命」為主題,匯聚逾 2,000 位國際領袖,共同探討人工智慧新興時代的發展。隸屬於 BizClik 旗下的《AI Magazine》已公佈其於「AI LIVE:倫敦峰會」上舉辦的「人工智慧與工業自動化」聯合爐邊談話的與會陣容。該座談會定於 10
相關專題推薦
評論 (1)
0/500
Veo 3 et Imagen 4 semblent impressionnants, mais j'espère que ces avancées en IA générative ne se contentent pas de faire des jolies images. Qu'en est-il de l'impact environnemental de l'entraînement de ces modèles? Les présentations sont cool, mais je veux aussi voir une vraie réflexion éthique derrière. 😅

在 I/O 2025 上,我們透過簡報和實際應用來展示生成式人工智能的能力。我們推出了令人振奮的最新視訊和影像產生模型-Veo 3 和 Imagen 4,並擴大了 Lyria 2 的使用範圍。我們還介紹了Flow,這是一款人工智能電影製作工具,可使用我們最先進的生成模型,無縫創作電影剪輯、場景和連貫敘述。
我們也將這些工具整合到旗艦年度活動中:I/O 主題演講中有 219 張幻燈片是由 AI 製作,48% 的主題演講視覺效果是使用 Imagen 製作,而 80% 的影片則以某種形式結合了 Veo 或 Imagen。以下將深入介紹我們如何運用自己的 AI 工具,包括我們的提示撰寫流程,將 I/O 2025 變得栩栩如生:
Veo 2:設計有風格的演講者標題卡
當我們的副總裁兼搜尋部主管 Elizabeth Reid 上台分享主要的搜尋更新時,螢幕上播放了一段短片,顯示 Liz 張開她的手,露出一隻精巧的橘色摺紙鶴,這隻鶴在她的手掌上方旋轉懸浮。
我們使用 AI Studio 和 Vertex AI Studio(由 Veo 2 驅動)的圖像轉視訊功能來製作這段影片和其他演講者介紹影片。我們收集了講者的頭像,以及他們的興趣和嗜好的詳細資料,並將其納入提示中。這是我們為研究科學家 Jason Baldridge 製作的標題卡提示:
這是 Veo 2 的原始輸出,以簡單的動畫增強,以及觀眾在台上看到的情況:
Imagen 4 與 Veo 3:製作電影的故事板
I/O 展映的數部電影在製作過程中都使用了 AI 工具。開場影片帶領觀眾穿越一個西部主題的小鎮,展開一段驚心動魄的旅程,之後畫面上方顯示拼有「Welcome to I/O」字樣的彩色氣球,為主題演講揭開序幕。
製作團隊採用了各種 AI 工具來製作這部影片。他們首先使用 Imagen 4 來產生影片提示的影像。他們也與 Google DeepMind 團隊合作,使用 Gemini 來精煉提示語,幫助他們找到正確的語言,達到預期的效果。這是用於第一場景的提示:
這是他們產生的結果:
接下來,團隊將這張圖片納入 Veo 3 的提示中,其中包括以下指示:
準備好圖片和精煉的提示後,他們開始使用我們最新的 Veo 3 技術製作影片(可透過 Google AI Ultra 計劃使用!)。他們也使用 Veo 3 進行即時調整 - 在檢視輸出時加入俯拍、更廣的角度以及不同的視覺效果。傳統電影製作經常需要重拍場景,而 Veo 3 則不一樣,團隊可以更快地進行迭代。不需要編碼:部分團隊成員使用 Colab 功能進行編碼剪輯,其他許多成員則依賴文字到影片的提示,以自然語言描述剪輯和要求。
以下是用來創作電影最後一幕的提示:
Lyria RealTime:與 Toro y Moi 即時演奏
在 I/O 預展期間,藝術家 Toro y Moi 在現場音樂佈景中使用 Lyria RealTime 來展示模型的最新功能。Lyria RealTime 是我們的互動式音樂產生模型,可讓您即時製作、控制和表演產生式音樂。您可以混合和變換樂器、聲音、流派等。「這將會是一場表演和實驗,」他在開始前解釋道。「我所演奏的一切都完全是即興創作--我在和電腦即興演奏,電腦也在和我即興演奏」。
在表演前的幾個星期,團隊提供 Toro y Moi 一台 Lyria RealTime 原型,讓他可以測試並改良他的提示。這有助於他在表演中發展出創意概念和提示。他創造了 16 種聲音提示,包括「混亂的康加舞者」和「音高偏移的英國叢林鼓」,並將它們指定給實體 MIDI 控制器上的旋鈕。
透過 MIDI 控制器在本機執行 Lyria RealTime,讓 Toro y Moi 可以在舞台上使用這個模型,並讓觀眾即時看到介面的運作。
表演期間,在 Toro y Moi 身後展示了一個以 Lyria RealTime API 建立並在 MIDI 控制器上執行的應用程式。觀眾可以看到應用程式中創建和控制連續音樂流的選項,以及他在鍵盤和人聲潤飾分層時所使用的提示。
您可以使用 AI Studio 中的 Lyria RealTime API 親自嘗試。
AI Studio:創造 AI 產生的 Swag
我們在 Google AI Studio (我們用來快速測試模型和實驗提示的免費介面) 中使用了幾個 Gemini 模型,設計出今年的 I/O 襯衫,上面有全新的客製化標誌。正如襯衫的標籤所描述的,創意提示是「Google I/O 標誌融化在地上、彩虹色、插圖、攝影棚燈光」。以下是我們的創作過程:
首先,團隊在 AI Studio 中選擇了 Gemini 2.5 Pro,並透過詳細的系統指令提示定義了他們的目標。
設定這些指引後,他們輸入先前提到的創意提示。Gemini 2.5 Pro 隨即會針對所需的影像輸出,產生一份需求與風格構思的清單。例如"核心形狀:三種原始圖形(整體矩形、細斜線/矩形和圓柱形)的基本幾何形狀必須仍然清晰可辨且視覺上與眾不同,即使在它們的側面使用了融化效果。不要扭曲核心結構,使其超出融化塗料的效果"。
團隊拿到這些書面指示後,便改用我們的主力機型 Gemini 2.0 Flash 與圖像產生功能,根據產生的清單製作各種圖像選項。
經過廣泛的實驗後,他們選出了幾個最後的設計 - 包括這個。
值得注意的是,團隊也嘗試繞過 Gemini 2.5 Pro 的初始提示重寫,直接在 AI Studio 中使用 Gemini 2.0 Flash。儘管他們接近了想要的結果,但使用 2.5 Pro 重寫一直能提供更好的結果與更多的創意細節。結果如何?一些非常酷的 T 恤!
準備好回顧了嗎?在此瞭解 I/O 2025 最重要的公告,並使用我們的 I/O 問答測試您的知識。
奧利押注隱私保護,力爭在 AI 助理競賽中勝出
要真正發揮實用價值,人工智慧助理必須深入了解其使用者。Ollie 是一款專為日常生活設計的個人助理,其運作前提是:這無需您交出個人資料,亦不會損害您的隱私。雖然某些企業級 AI 工具提供資料隱私保障,但 Ollie 作為首批獲得 SOC 2 合規認證的主流、以家庭為導向的 AI 服務之一,顯得格外突出。此框架允許企業透過獨立稽核證明,其已建立正式的管控措施來保護客戶資料,並確保系統運作的安全性。達
「AI LIVE:倫敦」將如何探討人工智慧與工業自動化
本次峰會將匯聚來自全球的高階主管,共同探討全球產業面臨的迫切挑戰,涵蓋範圍從人工智慧驅動的顛覆性變革到經濟波動。AI LIVE:倫敦峰會將以「科技+人類使命」為主題,匯聚逾 2,000 位國際領袖,共同探討人工智慧新興時代的發展。隸屬於 BizClik 旗下的《AI Magazine》已公佈其於「AI LIVE:倫敦峰會」上舉辦的「人工智慧與工業自動化」聯合爐邊談話的與會陣容。該座談會定於 10
Veo 3 et Imagen 4 semblent impressionnants, mais j'espère que ces avancées en IA générative ne se contentent pas de faire des jolies images. Qu'en est-il de l'impact environnemental de l'entraînement de ces modèles? Les présentations sont cool, mais je veux aussi voir une vraie réflexion éthique derrière. 😅





首頁






