選項
首頁
新聞
Datagemma使用現實世界數據處理AI幻覺

Datagemma使用現實世界數據處理AI幻覺

2025-04-10
261

Datagemma使用現實世界數據處理AI幻覺

大型語言模型(LLMs)是當今AI突破的核心,能夠篩選海量文本數據集,生成摘要、激發創意,甚至撰寫程式碼。然而,儘管其能力強大,這些模型有時會提供完全錯誤的資訊,這一問題被稱為「幻覺」。這是生成式AI世界中的一大障礙。

我們很高興分享一些前沿研究,這些研究正面解決此問題,旨在通過將LLMs與現實世界的統計數據結合,減少幻覺。我們也興奮地介紹DataGemma,這是首個將LLMs與Google的Data Commons豐富現實數據連結的開放模型。

Data Commons:可信數據的寶庫

Data Commons就像一個不斷擴展的公共數據巨型圖書館,擁有超過2400億個數據點,涵蓋從健康到經濟的各種主題。它從聯合國、世界衛生組織、疾病控制中心和人口普查局等可靠性來源收集這些資訊。通過將這些數據集整合成單一、強大的工具集和AI模型,Data Commons幫助政策制定者、研究人員和組織獲得所需的精確洞察。

想像一個龐大的數據庫,你可以用簡單的英文提問,例如哪些非洲國家電力普及率增長最快,或美國各郡的收入與糖尿病有何關聯。這就是Data Commons的魅力。

Data Commons如何幫助對抗幻覺

隨著越來越多的人轉向生成式AI,我們致力於通過將Data Commons融入我們的輕量級頂尖開放模型家族Gemma,使這些體驗更加扎實。這些DataGemma模型現已開放供研究人員和開發者使用。

DataGemma通過利用Data Commons的知識,提升了Gemma的能力,使用兩種方法來提高LLMs的準確性和推理能力:

  1. RIG(檢索交錯生成)通過主動對照Data Commons的數據檢查事實,增強了我們的Gemma 2模型。當你向DataGemma提問時,它會從Data Commons中搜尋統計數據,提供堅實的答案。雖然RIG不是新概念,但我們在DataGemma中使用它的方式相當特別。

    範例查詢:「全球可再生能源使用量增加嗎?」應用DataGemma RIG方法利用Data Commons(DC)提供權威數據。
  2. RAG(檢索增強生成)讓語言模型提取超出其訓練範圍的額外資訊,使回答更豐富、更準確。透過DataGemma,我們利用Gemini 1.5 Pro的長上下文窗口,在模型生成回答前從Data Commons獲取相關數據,減少幻覺。

    範例查詢:「全球可再生能源使用量增加嗎?」應用DataGemma RAG方法展示更強的推理能力和腳註包含。

令人振奮的成果與未來展望

我們的RIG和RAG初步測試結果良好。我們的模型在處理數字時展現出更高的準確性,這意味著研究、決策或僅出於好奇心使用這些模型的人將遇到更少的幻覺。你可以在我們的研究論文中查看這些結果。

RAG查詢與回答的示意圖。支持真實統計數據以表格形式從Data Commons提供。*為簡潔起見,僅顯示部分回答。 我們不會就此止步。我們全力以赴改進這些方法,擴大努力規模,並進行更多測試。最終,我們將把這些改進應用於Gemma和Gemini模型,從有限訪問階段開始。

通過分享我們的研究並開放這個新的Gemma模型變體,我們希望廣泛推廣基於Data Commons的技術。使LLMs更可靠和可信對於將其轉化為每個人的重要工具至關重要,幫助構建一個AI提供準確資訊、支持明智選擇並深化我們對世界理解的未來。

研究人員和開發者可立即使用我們的RIG和RAG快速入門筆記本開始體驗DataGemma。要深入了解Data Commons與Gemma如何協作,請查看我們的Research post。

相關文章
Google 測試 Remy AI 代理,以 Gemini 為重點轉向使用者控制 Google 測試 Remy AI 代理,以 Gemini 為重點轉向使用者控制 根據《商業內幕》的報道,谷歌正在測試 Remy,這是 Gemini 的一款全新 AI 個人代理工具。該工具旨在代表使用者執行任務,從而簡化專業工作流程和日常事務。目前,Remy 正在 Gemini 應用的內部員工專屬版本中進行測試。該報告引用了一份內部檔案以及對兩位熟悉該專案的個人的採訪。內部資料將 Remy 描述為“全天候個人代理”,將 Gemini 定位為能夠代表使用者行事的主動助手。接近該專案的訊息人士證實,谷歌員工正在積極測試 Remy。谷歌發言人拒絕提供進一步評論。該報告未提及公開發布
奧利押注隱私保護,力爭在 AI 助理競賽中勝出 奧利押注隱私保護,力爭在 AI 助理競賽中勝出 要真正發揮實用價值,人工智慧助理必須深入了解其使用者。Ollie 是一款專為日常生活設計的個人助理,其運作前提是:這無需您交出個人資料,亦不會損害您的隱私。雖然某些企業級 AI 工具提供資料隱私保障,但 Ollie 作為首批獲得 SOC 2 合規認證的主流、以家庭為導向的 AI 服務之一,顯得格外突出。此框架允許企業透過獨立稽核證明,其已建立正式的管控措施來保護客戶資料,並確保系統運作的安全性。達
「AI LIVE:倫敦」將如何探討人工智慧與工業自動化 「AI LIVE:倫敦」將如何探討人工智慧與工業自動化 本次峰會將匯聚來自全球的高階主管,共同探討全球產業面臨的迫切挑戰,涵蓋範圍從人工智慧驅動的顛覆性變革到經濟波動。AI LIVE:倫敦峰會將以「科技+人類使命」為主題,匯聚逾 2,000 位國際領袖,共同探討人工智慧新興時代的發展。隸屬於 BizClik 旗下的《AI Magazine》已公佈其於「AI LIVE:倫敦峰會」上舉辦的「人工智慧與工業自動化」聯合爐邊談話的與會陣容。該座談會定於 10
相關專題推薦
搜索引擎優化 最適合制定搜尋策略的 AI 搜尋結果頁面(SERP)分析工具
最適合制定搜尋策略的 AI 搜尋結果頁面(SERP)分析工具

XIX.AI 透過嚴格的實際測試及每週更新的排行榜,精選了 2026 年最新、最佳且評價最高的 AI 搜尋結果頁面(SERP)分析工具,以協助制定搜尋策略。這些強大的工具能幫助您發掘隱藏的優化機會、提升內容表現,並在搜尋領域中取得競爭優勢。立即探索最適合您的工具,提升您的搜尋策略。現在就來探索吧!

13 個工具
xix.ai
數據分析 適用於 SaaS 和電商團隊的 KPI 監控最佳 AI 異常檢測工具
適用於 SaaS 和電商團隊的 KPI 監控最佳 AI 異常檢測工具

2026 年最新最佳頂級評分 AI 異常檢測工具,助力 SaaS 和電商團隊的 KPI 監控!XIX.AI 基於嚴格的真實世界測試和每週更新的排名,精心策劃了一套強大且顛覆性的工具合集。您將找到詳細的免費與付費對比洞察,幫助您識別必須嘗試的解決方案,從而提升生產力並釋放您的 AI 優勢。立即探索!

10 個工具
xix.ai
寫作 最適合撰寫長篇 SEO 文章的 AI 大綱生成工具
最適合撰寫長篇 SEO 文章的 AI 大綱生成工具

2026 年最新最佳、評價最高的 AI 大綱生成器,專為長篇 SEO 文章打造,由 XIX.AI 精心精選。這些強大的工具能為快速創作高品質內容提供革命性的協助,大幅提升寫作效率。 透過免費版與付費版的比較、實際測試結果及詳細排名,協助您找出最符合需求且不容錯過的選項。立即探索,釋放您的 AI 優勢。

8 個工具
xix.ai
教育與學習 適用於作業與考試準備的人工智慧學習工具
適用於作業與考試準備的人工智慧學習工具

2026 年最新最佳 AI 學習工具,助您完成作業與備考!XIX.AI 精心整理了一份備受好評的清單,收錄了這些強大且具革命性、經實測驗證的工具,能幫助學生提升效率、簡化作業流程,並在考試中取得優異成績。 獲取免費版與付費版的比較、詳細排名,以及必試選項,以釋放您的 AI 優勢。立即探索!

10 個工具
xix.ai
音樂創作 面向詞曲創作者、旋律片段、主旋律及多語言草稿創作的AI人聲演示工具
面向詞曲創作者、旋律片段、主旋律及多語言草稿創作的AI人聲演示工具

2026 年最新最佳 AI 人聲演示工具,專為詞曲創作者、旋律創作者和多語言內容團隊打造!XIX.AI 精心整理了一份經過嚴格真實世界測試的高評分、變革性工具列表。您將找到詳細的免費與付費對比資料、全面排名以及必試選項,幫助您提升創作效率並釋放創意潛力。立即探索,發現滿足您所有內容需求的完美工具!

9 個工具
xix.ai
商業 最適合小型企業的頂尖 AI 競爭情勢分析工具
最適合小型企業的頂尖 AI 競爭情勢分析工具

2026 年最新、最佳且評價最高的中小企業 AI 競爭研究工具!XIX.AI 精心精選了一系列極具威力且能改變遊戲規則的工具,並透過嚴謹的實測與詳細排名,每週更新內容。您可在此找到詳盡的免費版與付費版比較,協助您找出必試的工具,以提升工作效率並獲得競爭優勢。 立即探索,找出最適合您的工具!

9 個工具
xix.ai
評論 (42)
0/500
PaulLopez
PaulLopez 2026-05-09 20:00:13

DataGemma這方法聽起來挺實際的,直接用真實數據來對抗AI幻覺,感覺比單純調整演算法更治本。不過好奇它處理的數據範圍有多大?會不會有偏見問題?希望未來能看到更多實測結果!🤔

HarryRoberts
HarryRoberts 2026-04-12 14:01:14

Interesting approach! Using real-world data to ground the model seems like a practical step beyond just scaling parameters. Hope it doesn't just trade hallucinations for boring, overly-cautious outputs though. The 'Gemma' naming trend continues! 🤔

WilliamRamirez
WilliamRamirez 2025-10-18 18:30:33

Finally! A real solution to AI hallucinations? DataGemma sounds promising, but I'm honestly a bit skeptical. 🤔 How do they ensure the "real-world data" isn't biased itself? Would love to see a breakdown of their methodology compared to other approaches like Retrieval-Augmented Generation.

WillMitchell
WillMitchell 2025-10-05 02:30:40

Me pregunto si DataGemma realmente podrá resolver el problema de las alucinaciones en IA. Parece prometedor, pero ya hemos visto muchas soluciones 'milagrosas' que luego no cumplen. Ojalá esta vez sea diferente, porque los errores en los modelos actuales pueden ser bastante graves 😅

BillyAdams
BillyAdams 2025-08-25 17:47:02

This article on DataGemma is super intriguing! It's wild how LLMs can churn out so much but still trip up on facts sometimes. 😅 Makes me wonder if grounding them in real-world data could finally make AI as reliable as we hope!

StephenScott
StephenScott 2025-08-08 17:00:59

This article on DataGemma is super intriguing! I love how it dives into fixing AI hallucinations with real-world data. Makes me wonder if we’ll finally get models that don’t spit out random nonsense. 😄 Anyone else excited about this?

OR