StepZen 推出了 Step Audio 2.5 實時版本,為大型語言模型賦予類似人類的情感與智慧能力。

隨著人工智慧的飛速發展,大型語言模型所提供的互動體驗正在發生顯著變化,已從單純的文字對話邁向真正的實時情感交流。5月8日,大型語言模型領域的領先創新企業傑科星公佈了其最新的研究成果——全新的實時語音模型StepAudio 2.5 Realtime。這一先進模型的問世,再次為提升國內用於語音互動的大型語言模型的自然度與智慧水平奠定了新的里程碑。
深度感知:邁向人類級複雜度的互動時代
與傳統語音助手不同,StepAudio 2.5 Realtime憑藉其達到人類級別複雜度的高度成熟深度感知能力而脫穎而出。它不僅能識別口頭指令,還能精準捕捉對話中的細微情感線索及語境變化。
得益於這些技術提升,該模型在認知智慧與情感智慧方面均取得了顯著進步。在互動過程中,它能根據語調、說話速度等因素,輸出更貼合使用者情緒狀態的回應,從而使交流從單向的資訊傳遞轉變為更具共情力、更接近人類真實對話的模式。
靈活定製:打造專屬的AI人格
為滿足不同應用場景的多樣化需求,StepAudio 2.5 Realtime提供了高度可定製的功能,允許使用者設定特定的AI人格特徵與語言風格。無論使用者是需要用於工作的專業可靠助手,還是追求娛樂體驗的活潑聊天夥伴,開發者和終端使用者都能根據實際需求為AI賦予相應的特質。如此高的定製化程度,有望大幅拓展實時語音模型在教育、娛樂及商業等領域的應用範圍。
全面商業化:國內大型語言模型加速發展
目前,傑科星已宣佈StepAudio 2.5 Realtime現已全面開放使用。這意味著開發者和合作夥伴可以立即獲取該技術並開始進行相關試驗。
相關文章
Suno 在法律訴訟中為歌曲新增水印
Suno,這個允許使用者生成由人工智慧創作的音樂的平臺,近日推出了新功能,包括為平臺製作的曲目新增標籤、限制下載,並更新社羣標準以遏制未經授權的複製品。這些更新是在Suno面臨多家唱片公司和藝術家組織提起的多起訴訟之際推出的。在部落格文章中,聯合創始人兼執行長Mikey Shulman概述了核心原則,強調該平臺旨在促進原創創作,同時擴大更廣泛受眾對人工智慧音樂工具的訪問許可權。一個主要的爭議點在於,使用者將人工智慧生成的歌曲上傳到其他流媒體服務並透過操縱系統獲取收入。Suno表示,現在將採用音訊
馬斯克承認 Grok 構建過程中洩露了使用者程式碼,並承諾清除所有歷史資料
埃隆·馬斯克直接回應了圍繞 Grok Build 的隱私爭議,首先以簡單的“True”(屬實)確認了該事件的有效性。他承諾,此前上傳至 SpaceXAI 的所有使用者資料將被永久刪除,並表示“不留一個位元組”。這是人工智慧行業首次由主要科技領袖公開承認錯誤並主動刪除使用者資料。安全研究人員的“釣魚”測試揭示了資料洩露的具體證據此次爭議源於獨立人工智慧安全研究人員 @cereblab 的一份報告。SpaceXAI 推出的 AI 程式設計助手 Grok Build 在其官方網站上聲稱其“優先本地執行,程式碼
美國股市觸及歷史裡程碑,人工智慧與航空航天巨頭準備開啟萬億美元時代
埃隆·馬斯克、山姆·阿爾特曼和達里奧·阿莫迪,這三位科技領域的巨頭,正推動其各自的企業邁向首次公開募股(IPO)。隨著 SpaceX、OpenAI 和 Anthropic——這三家估值接近萬億美元的行業巨頭——即將上市,2026 年被預測將成為美國曆史上新股發行規模最大的一年。這一歷史性的資本激增已引起全球金融界的關注,成為檢驗公共市場吸收如此大規模資金能力的關鍵壓力測試。這些主要融資活動的同步啟動預計將打破 2021 年創下的 1560 億美元紀錄。超級獨角獸的資本博弈每家公司上市的路徑
相關專題推薦
評論 (0)
0/500

隨著人工智慧的飛速發展,大型語言模型所提供的互動體驗正在發生顯著變化,已從單純的文字對話邁向真正的實時情感交流。5月8日,大型語言模型領域的領先創新企業傑科星公佈了其最新的研究成果——全新的實時語音模型StepAudio 2.5 Realtime。這一先進模型的問世,再次為提升國內用於語音互動的大型語言模型的自然度與智慧水平奠定了新的里程碑。
深度感知:邁向人類級複雜度的互動時代
與傳統語音助手不同,StepAudio 2.5 Realtime憑藉其達到人類級別複雜度的高度成熟深度感知能力而脫穎而出。它不僅能識別口頭指令,還能精準捕捉對話中的細微情感線索及語境變化。
得益於這些技術提升,該模型在認知智慧與情感智慧方面均取得了顯著進步。在互動過程中,它能根據語調、說話速度等因素,輸出更貼合使用者情緒狀態的回應,從而使交流從單向的資訊傳遞轉變為更具共情力、更接近人類真實對話的模式。
靈活定製:打造專屬的AI人格
為滿足不同應用場景的多樣化需求,StepAudio 2.5 Realtime提供了高度可定製的功能,允許使用者設定特定的AI人格特徵與語言風格。無論使用者是需要用於工作的專業可靠助手,還是追求娛樂體驗的活潑聊天夥伴,開發者和終端使用者都能根據實際需求為AI賦予相應的特質。如此高的定製化程度,有望大幅拓展實時語音模型在教育、娛樂及商業等領域的應用範圍。
全面商業化:國內大型語言模型加速發展
目前,傑科星已宣佈StepAudio 2.5 Realtime現已全面開放使用。這意味著開發者和合作夥伴可以立即獲取該技術並開始進行相關試驗。
Suno 在法律訴訟中為歌曲新增水印
Suno,這個允許使用者生成由人工智慧創作的音樂的平臺,近日推出了新功能,包括為平臺製作的曲目新增標籤、限制下載,並更新社羣標準以遏制未經授權的複製品。這些更新是在Suno面臨多家唱片公司和藝術家組織提起的多起訴訟之際推出的。在部落格文章中,聯合創始人兼執行長Mikey Shulman概述了核心原則,強調該平臺旨在促進原創創作,同時擴大更廣泛受眾對人工智慧音樂工具的訪問許可權。一個主要的爭議點在於,使用者將人工智慧生成的歌曲上傳到其他流媒體服務並透過操縱系統獲取收入。Suno表示,現在將採用音訊
馬斯克承認 Grok 構建過程中洩露了使用者程式碼,並承諾清除所有歷史資料
埃隆·馬斯克直接回應了圍繞 Grok Build 的隱私爭議,首先以簡單的“True”(屬實)確認了該事件的有效性。他承諾,此前上傳至 SpaceXAI 的所有使用者資料將被永久刪除,並表示“不留一個位元組”。這是人工智慧行業首次由主要科技領袖公開承認錯誤並主動刪除使用者資料。安全研究人員的“釣魚”測試揭示了資料洩露的具體證據此次爭議源於獨立人工智慧安全研究人員 @cereblab 的一份報告。SpaceXAI 推出的 AI 程式設計助手 Grok Build 在其官方網站上聲稱其“優先本地執行,程式碼
美國股市觸及歷史裡程碑,人工智慧與航空航天巨頭準備開啟萬億美元時代
埃隆·馬斯克、山姆·阿爾特曼和達里奧·阿莫迪,這三位科技領域的巨頭,正推動其各自的企業邁向首次公開募股(IPO)。隨著 SpaceX、OpenAI 和 Anthropic——這三家估值接近萬億美元的行業巨頭——即將上市,2026 年被預測將成為美國曆史上新股發行規模最大的一年。這一歷史性的資本激增已引起全球金融界的關注,成為檢驗公共市場吸收如此大規模資金能力的關鍵壓力測試。這些主要融資活動的同步啟動預計將打破 2021 年創下的 1560 億美元紀錄。超級獨角獸的資本博弈每家公司上市的路徑





首頁






