Visko 推出 Orbis Live 原型機並獲得種前輪融資

Orbis 是一個即時、互動式的長影片生成系統。來源:Visko
Visko 仍有待改進之處
該報告亦揭露了 Orbis 在某些方面落後於其他系統的具體指標,並已完整公布研究方法與結果。尹承認,仍有更多工作需要完成。
「在研究方面,我們需要對記憶體結構進行更完善的設計,」他表示。「例如,影片在生成過程中可以保持更佳的一致性。」
「其次,我們希望在資料蒐集過程中加入更詳細的動作描述,例如用於訓練這些影片模型,」尹補充道。 「目前,我可以要求機械手臂執行某項任務,但缺乏非常詳細的描述。如果我給予非常詳細的指令,例如將手臂抬高 45 度,我們希望將更精確的動作描述資料納入此模型的訓練中。」
「在工程層面上,我們必須在模型規模和資料量方面進行擴展,」他表示。「目前我們專注於音訊和影片資料。 我們仍在探索整合其他感測器資料的可能性,例如觸覺資料。對於許多可變形物體,我們能從影片中解讀作用力,但我們正在尋找專注於機器人感測器與應用的合作夥伴。目前我們正與幾家硬體公司進行洽談。」

上圖:基於一至三分鐘事件導向基準測試的品質、對齊與動作測量結果。下圖:來自人類偏好研究的長篇影片 Arena 整體點估計值。Orbis 1.0 獲得最高總分;該表格提供所有基準模型的維度層級比較及引用資料。來源:Visko
顧問指出潛在應用
顧問團隊包括加州大學柏克萊分校的 Michael I. Jordan、哥倫比亞大學的 Steve WaiChing Sun,以及紐約大學的 Mengye Ren。分發工作由 Visko 的合作夥伴 Reactor 負責。
「Visko 正致力於影音 AI 領域中最雄心勃勃的方向之一:即時、具狀態的模型,這些模型能在維持物理一致性的同時,持續感知、預測並與世界進行即時互動,」Visko 顧問委員會主席喬丹表示。
他補充道:「Visko 提供了一套最先進的架構,在技術上擁有超越傳統短片生成技術的顯著領先優勢。這項核心能力能支援極為廣泛的商業應用,從機器人技術和物理模擬,到遊戲、直播電商、教育以及即時創意媒體。」
尹表示,Orbis 還能協助建立測試環境,用以驗證邊界案例,從而提升自動駕駛車輛和類人型機器人的安全性。
「有人預估通用型機器人將在五到十年內走進家庭,但根據我與業界人士的交流,這可能還需要一段時間,就像自動駕駛一樣,」他指出。「我的目標是在這個過程中發掘商業化的機會。」

用於測試 Orbis 1.0 的數據包含來自真實世界與生成環境的原始影片資料。來源:Visko
相關文章
Google 推出虛假來電偵測功能,以防範人工智慧深度偽造(deepfake)冒充詐騙
Google 週二宣布,Android 將推出「虛假來電偵測」功能,以防範利用人工智慧深度偽造技術進行的冒充詐騙。此功能將於本月透過「Phone by Google」在全球範圍內逐步推送至 Android 12 及以上版本的裝置,首先從 Pixel 裝置開始。隨著人們越來越不願接聽未知號碼的來電,詐騙者正改變策略,透過偽造可信賴的電話號碼,並利用 AI 深度偽造技術,讓聲音聽起來像是權威人士、家人
Frontier AI Labs 拒絕透露針對失控模型的管控策略
近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
Google 在 2026 年 IO 大會上首度推出以音訊為核心的智慧眼鏡,此舉與 Meta 的策略如出一轍
Google 正以戰略性姿態重返智慧眼鏡市場。在週二舉行的 Google I/O 大會上,這家科技巨頭宣布與 Warby Parker 及 Gentle Monster 合作,推出全新系列搭載人工智慧的眼鏡產品。這些裝置由 Google 與三星共同設計,經過優化可與 Android 及 iOS 平台無縫整合,預計將於今年稍晚上市。Google 將這些裝置稱為「音訊眼鏡」,讓使用者能透過語音指令進行
相關專題推薦
評論 (0)
0/500

Orbis 是一個即時、互動式的長影片生成系統。來源:Visko
Visko 仍有待改進之處
該報告亦揭露了 Orbis 在某些方面落後於其他系統的具體指標,並已完整公布研究方法與結果。尹承認,仍有更多工作需要完成。
「在研究方面,我們需要對記憶體結構進行更完善的設計,」他表示。「例如,影片在生成過程中可以保持更佳的一致性。」
「其次,我們希望在資料蒐集過程中加入更詳細的動作描述,例如用於訓練這些影片模型,」尹補充道。 「目前,我可以要求機械手臂執行某項任務,但缺乏非常詳細的描述。如果我給予非常詳細的指令,例如將手臂抬高 45 度,我們希望將更精確的動作描述資料納入此模型的訓練中。」
「在工程層面上,我們必須在模型規模和資料量方面進行擴展,」他表示。「目前我們專注於音訊和影片資料。 我們仍在探索整合其他感測器資料的可能性,例如觸覺資料。對於許多可變形物體,我們能從影片中解讀作用力,但我們正在尋找專注於機器人感測器與應用的合作夥伴。目前我們正與幾家硬體公司進行洽談。」

上圖:基於一至三分鐘事件導向基準測試的品質、對齊與動作測量結果。下圖:來自人類偏好研究的長篇影片 Arena 整體點估計值。Orbis 1.0 獲得最高總分;該表格提供所有基準模型的維度層級比較及引用資料。來源:Visko
顧問指出潛在應用
顧問團隊包括加州大學柏克萊分校的 Michael I. Jordan、哥倫比亞大學的 Steve WaiChing Sun,以及紐約大學的 Mengye Ren。分發工作由 Visko 的合作夥伴 Reactor 負責。
「Visko 正致力於影音 AI 領域中最雄心勃勃的方向之一:即時、具狀態的模型,這些模型能在維持物理一致性的同時,持續感知、預測並與世界進行即時互動,」Visko 顧問委員會主席喬丹表示。
他補充道:「Visko 提供了一套最先進的架構,在技術上擁有超越傳統短片生成技術的顯著領先優勢。這項核心能力能支援極為廣泛的商業應用,從機器人技術和物理模擬,到遊戲、直播電商、教育以及即時創意媒體。」
尹表示,Orbis 還能協助建立測試環境,用以驗證邊界案例,從而提升自動駕駛車輛和類人型機器人的安全性。
「有人預估通用型機器人將在五到十年內走進家庭,但根據我與業界人士的交流,這可能還需要一段時間,就像自動駕駛一樣,」他指出。「我的目標是在這個過程中發掘商業化的機會。」

用於測試 Orbis 1.0 的數據包含來自真實世界與生成環境的原始影片資料。來源:Visko
Google 推出虛假來電偵測功能,以防範人工智慧深度偽造(deepfake)冒充詐騙
Google 週二宣布,Android 將推出「虛假來電偵測」功能,以防範利用人工智慧深度偽造技術進行的冒充詐騙。此功能將於本月透過「Phone by Google」在全球範圍內逐步推送至 Android 12 及以上版本的裝置,首先從 Pixel 裝置開始。隨著人們越來越不願接聽未知號碼的來電,詐騙者正改變策略,透過偽造可信賴的電話號碼,並利用 AI 深度偽造技術,讓聲音聽起來像是權威人士、家人
Frontier AI Labs 拒絕透露針對失控模型的管控策略
近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
Google 在 2026 年 IO 大會上首度推出以音訊為核心的智慧眼鏡,此舉與 Meta 的策略如出一轍
Google 正以戰略性姿態重返智慧眼鏡市場。在週二舉行的 Google I/O 大會上,這家科技巨頭宣布與 Warby Parker 及 Gentle Monster 合作,推出全新系列搭載人工智慧的眼鏡產品。這些裝置由 Google 與三星共同設計,經過優化可與 Android 及 iOS 平台無縫整合,預計將於今年稍晚上市。Google 將這些裝置稱為「音訊眼鏡」,讓使用者能透過語音指令進行





首頁






