选项
首页
新闻
麻省理工学院初创公司通过教会系统承认不确定性来解决人工智能幻觉问题

麻省理工学院初创公司通过教会系统承认不确定性来解决人工智能幻觉问题

2025-11-23
142

随着人们越来越依赖人工智能模型来揭示关键信息和做出重大决策,与人工智能幻觉相关的风险也在不断升级。

我们都认识一些人,他们表现得像个万事通,拒绝承认自己的无知,或者根据网上浏览到的信息提供可疑的建议。人工智能幻觉就像这样的朋友--但在这种情况下,这个朋友可能是为你设计癌症治疗方案的人。

这就是 Themis AI 的优势所在。该公司从麻省理工学院分离出来,实现了一些概念上听起来简单但技术上极具挑战性的目标:教会人工智能系统识别并承认不确定性。

人工智能模型往往过于自信。Themis 的 Capsa 平台提供了现实检查,帮助模型识别它们何时是在推测,而不是在确定地运行。

Themis AI公司由麻省理工学院教授丹妮拉-鲁斯(Daniela Rus)和前研究员亚历山大-阿米尼(Alexander Amini)和伊拉赫-阿马迪(Elaheh Ahmadi)于2021年创立,该公司建立的平台几乎可以与任何人工智能系统集成,在不确定因素导致错误之前就将其标记出来。

利用 Capsa,人工智能学会识别自身数据处理中的模式,这些模式表明信息中存在混乱、偏差或空白--这些情况往往会导致幻觉。

自推出以来,Themis 已帮助电信公司避免了代价高昂的网络规划错误,帮助石油和天然气公司解读复杂的地震数据,并发表了关于构建聊天机器人的研究报告,以避免自信地捏造事实。

许多人仍然没有意识到,人工智能系统在本质上经常是在进行有根据的猜测。随着这些系统发挥越来越重要的作用,这种猜测可能会带来严重后果。Themis AI 引入了一个缺失元素:自我意识。

Themis AI 解决人工智能幻觉的路径

多年前,在麻省理工学院鲁斯教授的实验室里,研究人员开始了通往 Themis AI 的旅程,探索一个核心问题:机器如何才能意识到自身的局限性?

2018 年,丰田公司资助了他们为自动驾驶汽车开发可靠人工智能的工作--在这个行业中,错误可能会危及生命。当自动驾驶汽车必须精确探测行人和道路危险时,这一挑战尤为严峻。

他们的突破来自于一种能够识别面部识别系统中种族和性别偏见的算法。他们的系统不仅能检测出偏见,还能通过重新平衡训练数据来纠正偏见,从而有效地教会人工智能克服自身的偏见。

到 2021 年,该团队展示了这种方法如何改变药物发现。人工智能系统可以对潜在药物进行评估,同时强调预测是以可靠数据为基础,还是以猜测或完全的幻觉为基础。制药公司看到了只追求人工智能有信心的候选药物的价值,从而节省了时间和资源。

另一个好处适用于计算能力有限的设备。边缘设备通常依赖于较小的模型,其准确性无法与基于服务器的系统相提并论。Themis 的技术可以帮助这些本地模型独立处理大部分任务,只有在遇到困难时才会寻求服务器支持。

人工智能为改善我们的生活提供了巨大的潜力,但也伴随着真正的风险。随着人工智能在关键基础设施和决策中的嵌入,识别不确定性和避免幻觉的能力可能被证明是其最人性化和最有价值的特质。Themis AI 正在帮助模型学习这一基本技能。

另请参见:糖尿病管理:IBM 和罗氏利用人工智能预测血糖水平

想从行业领导者那里了解更多有关人工智能和大数据的信息?请参加在阿姆斯特丹、加利福尼亚和伦敦举行的人工智能与大数据博览会。这项综合性活动将与智能自动化大会(Intelligent Automation Conference)、BlockX、数字化转型周(Digital Transformation Week)和网络安全与云博览会(Cyber Security & Cloud Expo)等其他领先活动同期举行。

点击此处了解 TechForge 即将举办的其他企业技术活动和网络研讨会。

相关文章
Google 测试 Remy AI 代理,以 Gemini 为重点转向用户控制 Google 测试 Remy AI 代理,以 Gemini 为重点转向用户控制 根据《商业内幕》的报道,谷歌正在测试 Remy,这是 Gemini 的一款全新 AI 个人代理工具。该工具旨在代表用户执行任务,从而简化专业工作流程和日常事务。目前,Remy 正在 Gemini 应用的内部员工专属版本中进行测试。该报告引用了一份内部文件以及对两位熟悉该项目的个人的采访。内部资料将 Remy 描述为“全天候个人代理”,将 Gemini 定位为能够代表用户行事的主动助手。接近该项目的消息人士证实,谷歌员工正在积极测试 Remy。谷歌发言人拒绝提供进一步评论。该报告未提及公开发布
奥利押注隐私保护,力争在AI助手竞争中胜出 奥利押注隐私保护,力争在AI助手竞争中胜出 要真正发挥帮助作用,人工智能助手必须深刻理解其用户。Ollie 是一款专为日常生活设计的个人助理,其运作理念是:实现这一点无需用户交出数据,也不会损害用户的隐私。虽然某些企业级人工智能工具提供了数据隐私保护措施,但Ollie作为首批通过SOC 2认证的主流、面向家庭的人工智能服务之一,尤为突出。该认证框架允许企业通过独立审计证明,其已建立正式的控制措施来保护客户数据,并确保系统安全运行。达成这一里
AI LIVE:伦敦将如何探讨人工智能与工业自动化 AI LIVE:伦敦将如何探讨人工智能与工业自动化 本次峰会将汇聚来自全球的高管,共同探讨全球各行业面临的紧迫挑战,涵盖从人工智能驱动的颠覆性变革到经济波动等各个方面。AI LIVE:伦敦峰会将以“技术与人类使命”为主题,汇聚2,000余位国际领袖,共同探讨人工智能的新时代。BizClik旗下品牌《AI Magazine》已公布其在“AI LIVE:伦敦峰会”上举办的关于人工智能与工业自动化的联合炉边谈话环节阵容。该专题讨论会定于10月20日在伦敦
相关专题推荐
搜索引擎优化 最适合制定搜索策略的AI搜索结果页面(SERP)分析工具
最适合制定搜索策略的AI搜索结果页面(SERP)分析工具

2026年最新、最受欢迎且评价最高的人工智能搜索结果页面(SERP)分析工具,均由XIX.AI通过严格的实际测试精心筛选,并每周更新排名。这些强大的工具可助您发掘隐藏的优化机会、提升内容表现,并在搜索领域获得竞争优势。立即寻找最适合您的工具,提升您的搜索策略。现在就来探索吧!

13 个工具
xix.ai
数据分析 适用于 SaaS 和电商团队的 KPI 监控最佳 AI 异常检测工具
适用于 SaaS 和电商团队的 KPI 监控最佳 AI 异常检测工具

2026 年最新最佳顶级评分 AI 异常检测工具,助力 SaaS 和电商团队的 KPI 监控!XIX.AI 基于严格的真实世界测试和每周更新的排名,精心策划了一套强大且颠覆性的工具合集。您将找到详细的免费与付费对比洞察,帮助您识别必须尝试的解决方案,从而提升生产力并释放您的 AI 优势。立即探索!

10 个工具
xix.ai
写作 最适合撰写长篇SEO文章的AI大纲生成器
最适合撰写长篇SEO文章的AI大纲生成器

2026年最新、最受好评的AI大纲生成器,专为长篇SEO文章打造,由XIX.AI精心甄选。这些强大的工具在快速创建高质量内容方面提供了颠覆性的帮助,显著提升了写作效率。 获取免费版与付费版的对比分析,以及实际测试结果和详细排名,助您找到最适合自身需求、不容错过的理想选择。立即探索,解锁您的AI竞争优势。

8 个工具
xix.ai
教育与学习 用于作业和考试备考的AI学习工具
用于作业和考试备考的AI学习工具

2026年最新最佳AI学习工具,助您轻松完成作业和备考!XIX.AI精心筛选出一份广受好评的顶级工具清单,这些功能强大、颠覆传统的工具经过实际测试,能帮助学生提升效率、简化作业流程,并轻松通过考试。 获取免费版与付费版的对比分析、详细排名以及必试选项,释放你的AI优势。立即探索!

10 个工具
xix.ai
音乐创作 面向词曲创作者、旋律片段、主旋律及多语言草稿创作的AI人声演示工具
面向词曲创作者、旋律片段、主旋律及多语言草稿创作的AI人声演示工具

2026 年最新最佳 AI 人声演示工具,专为词曲创作者、旋律创作者和多语言内容团队打造!XIX.AI 精心整理了一份经过严格真实世界测试的高评分、变革性工具列表。您将找到详细的免费与付费对比数据、全面排名以及必试选项,帮助您提升创作效率并释放创意潜力。立即探索,发现满足您所有内容需求的完美工具!

9 个工具
xix.ai
商业 适合中小企业的最佳AI竞品分析工具
适合中小企业的最佳AI竞品分析工具

2026年最新最佳、评价最高的中小企业AI竞争研究工具!XIX.AI精心精选了一系列功能强大、颠覆行业格局的工具,每周都会根据严格的实际测试和详细排名进行更新。您可以查看全面的免费版与付费版对比,从而找到那些能提升工作效率、助您赢得竞争优势的必试工具。 立即探索,发现最适合您的工具!

9 个工具
xix.ai
评论 (4)
0/500
JohnNelson
JohnNelson 2026-08-19 02:00:11

I was totally shocked by this MIT startup’s idea of teaching AI systems to admit uncertainty instead of fabricating answers, it’s like giving robots a sense of self-awareness. I wonder if this approach can really cut down the misinformation spreading on social media these days.

RichardHarris
RichardHarris 2026-03-17 12:01:11

Just read this and wow, the 'know-it-all' analogy hits home. We've all been there where the system is confidently wrong. Teaching AI to say 'I don't know' could be a game-changer for trust in medical or legal advice. Curious about the scalability—is there a performance trade-off? Hope they can make it work at a large scale 🧐.

WillGarcía
WillGarcía 2026-01-17 10:31:25

AIが「分からない」と言えるようになるって、逆に人間らしい進歩かも?🤔 実際、私も職場で『多分』って言える上司の方が信用できるし。でもMITのスタートアップがこれをビジネスにできるって面白い。AIの過信防止って医療や裁判で本当に必要だよね。個人的には、この技術がSNSのデマ拡散防止に使われないか心配だけど…

AlbertEvans
AlbertEvans 2025-12-19 22:30:45

Diese Startup-Idee aus MIT scheint sehr vielversprechend zu sein. Modelle müssen lernen, Unsicherheiten zuzugeben - genau wie ein vernünftiger Mensch es tun würde 😂. Besonders im Bereich Medizin oder autonomes Fahren, wo fehlerhafte Antworten katastrophal sein können, wird das 'Ich weiß es nicht'-Eingeständnis zu einer lebenswichtigen Funktion. Hoffentlich setzt sich dieser Ansatz bald durch!

OR