蚂蚁集团凭借在AIGC检测方面的突破性成果,在计算机视觉大会上大放异彩

蚂蚁集团近日在CVPR 2026 NTIRE图像检测挑战赛的两个赛道中斩获桂冠,分别是“复杂真实世界场景下的鲁棒性样本测试”和“人脸增强异常检测”。这一成就为在AI时代推进支付、内容安全审查及金融身份认证等领域的风险识别提供了关键支持。
深度伪造(deepfakes)及AIGC滥用带来的风险日益加剧。此类合成内容常令肉眼难以辨别,而现有检测模型在面对真实世界环境及多模态大型模型的快速演进时,准确率会显著下降。CVPR挑战赛通过要求模型在涉及“未知生成架构”和“复杂退化干扰”的极端测试中保持高准确率和鲁棒性,直接应对了这一问题。
蚂蚁集团深耕支付系统二十余年,在此基础上开发了前沿的安全技术。如今,这一专业能力正延伸至AI安全领域。团队基于DINOv3视觉基础模型提出了一种检测框架,使AIGC检测能力从实验室环境向实际应用实现了重大飞跃。
针对“鲁棒性样本测试”赛道,蚂蚁AI安全实验室团队构建了一个包含数百万个高质量样本的复杂训练语料库。该语料库整合了WildFake、Z-Image、Seedream和Nano-banana-pro等数据集,并结合了前沿模型。 其底层架构采用双流并行集成结构,犹如为检测模型配备了两只互补的“眼睛”,既能捕捉局部细节,又能把握全局图像特征。团队模拟了从单个噪点到多重畸变的完整图像退化效应链,精准复现了社交媒体传播及二次摄影中常见的真实世界图像篡改现象。这种方法显著提升了模型在实际场景中的检测性能。
此外,研究团队引入了“定位-审查”两阶段检测范式。该方法首先识别可疑区域,随后进行详细审查。他们还构建了FakeXplained数据集,该数据集提供了针对特定区域的文本解释。 在分析可疑图像时,该技术不仅能判定其是否由AI生成,还能精确定位包含伪造缺陷或物理不一致性的区域,并同步生成详细推理依据。这一突破超越了传统的“黑箱”检测模式,使模型决策变得可追溯且可解释。为促进应对深度伪造挑战的合作,该团队已在GitHub上开源了该领域最全面的AIGC图像和视频检测资源库之一。
在“人脸增强异常检测”竞赛中,蚂蚁国际团队凭借精准定位人脸图像中的异常区域而夺冠。该技术主要应用于金融交易身份验证及开户文件审核等场景,为防范深度伪造和基于AIGC的攻击提供了关键的技术保障。 在跨境支付与金融服务领域,蚂蚁国际已将AIGC识别技术深度融入电子KYC(EKYC)及文件防伪等流程,确保对各类生成式内容具备强大的检测能力。
CVPR(计算机视觉与模式识别会议)是由IEEE主办的国际会议。它与ICCV、ECCV并称为计算机视觉领域的三大顶级会议。本届挑战赛吸引了来自全球的500多支队伍参赛。
相关文章
美国股市触及历史里程碑,人工智能与航空航天巨头准备开启万亿美元时代
埃隆·马斯克、山姆·阿尔特曼和达里奥·阿莫迪,这三位科技领域的巨头,正推动其各自的企业迈向首次公开募股(IPO)。随着 SpaceX、OpenAI 和 Anthropic——这三家估值接近万亿美元的行业巨头——即将上市,2026 年被预测将成为美国历史上新股发行规模最大的一年。这一历史性的资本激增已引起全球金融界的关注,成为检验公共市场吸收如此大规模资金能力的关键压力测试。这些主要融资活动的同步启动预计将打破 2021 年创下的 1560 亿美元纪录。超级独角兽的资本博弈每家公司上市的路径
瑞典人工智能初创公司Lovable Eyes在完成主要融资轮后估值达132亿美元
随着人工智能驱动的编码工具日益普及,瑞典初创公司 Lovable 已获一轮重大融资。该公司计划筹集 30 亿美元,其估值有望升至 132 亿美元——这是去年 12 月记录的 66 亿美元的两倍。预计 Menlo Ventures 将主导此次投资。Lovable 的吸引力源于其核心的“氛围编码”(vibe coding)技术,该技术通过消除对复杂编码技能的需求来简化软件开发。用户只需以自然语言描述其需求,系统即可自动生成应用程序。这种直观的方法吸引了个人开发者、设计师和小企业,并扩展至 Work
Google 测试 Remy AI 代理,以 Gemini 为重点转向用户控制
根据《商业内幕》的报道,谷歌正在测试 Remy,这是 Gemini 的一款全新 AI 个人代理工具。该工具旨在代表用户执行任务,从而简化专业工作流程和日常事务。目前,Remy 正在 Gemini 应用的内部员工专属版本中进行测试。该报告引用了一份内部文件以及对两位熟悉该项目的个人的采访。内部资料将 Remy 描述为“全天候个人代理”,将 Gemini 定位为能够代表用户行事的主动助手。接近该项目的消息人士证实,谷歌员工正在积极测试 Remy。谷歌发言人拒绝提供进一步评论。该报告未提及公开发布
相关专题推荐
评论 (0)
0/500

蚂蚁集团近日在CVPR 2026 NTIRE图像检测挑战赛的两个赛道中斩获桂冠,分别是“复杂真实世界场景下的鲁棒性样本测试”和“人脸增强异常检测”。这一成就为在AI时代推进支付、内容安全审查及金融身份认证等领域的风险识别提供了关键支持。
深度伪造(deepfakes)及AIGC滥用带来的风险日益加剧。此类合成内容常令肉眼难以辨别,而现有检测模型在面对真实世界环境及多模态大型模型的快速演进时,准确率会显著下降。CVPR挑战赛通过要求模型在涉及“未知生成架构”和“复杂退化干扰”的极端测试中保持高准确率和鲁棒性,直接应对了这一问题。
蚂蚁集团深耕支付系统二十余年,在此基础上开发了前沿的安全技术。如今,这一专业能力正延伸至AI安全领域。团队基于DINOv3视觉基础模型提出了一种检测框架,使AIGC检测能力从实验室环境向实际应用实现了重大飞跃。
针对“鲁棒性样本测试”赛道,蚂蚁AI安全实验室团队构建了一个包含数百万个高质量样本的复杂训练语料库。该语料库整合了WildFake、Z-Image、Seedream和Nano-banana-pro等数据集,并结合了前沿模型。 其底层架构采用双流并行集成结构,犹如为检测模型配备了两只互补的“眼睛”,既能捕捉局部细节,又能把握全局图像特征。团队模拟了从单个噪点到多重畸变的完整图像退化效应链,精准复现了社交媒体传播及二次摄影中常见的真实世界图像篡改现象。这种方法显著提升了模型在实际场景中的检测性能。
此外,研究团队引入了“定位-审查”两阶段检测范式。该方法首先识别可疑区域,随后进行详细审查。他们还构建了FakeXplained数据集,该数据集提供了针对特定区域的文本解释。 在分析可疑图像时,该技术不仅能判定其是否由AI生成,还能精确定位包含伪造缺陷或物理不一致性的区域,并同步生成详细推理依据。这一突破超越了传统的“黑箱”检测模式,使模型决策变得可追溯且可解释。为促进应对深度伪造挑战的合作,该团队已在GitHub上开源了该领域最全面的AIGC图像和视频检测资源库之一。
在“人脸增强异常检测”竞赛中,蚂蚁国际团队凭借精准定位人脸图像中的异常区域而夺冠。该技术主要应用于金融交易身份验证及开户文件审核等场景,为防范深度伪造和基于AIGC的攻击提供了关键的技术保障。 在跨境支付与金融服务领域,蚂蚁国际已将AIGC识别技术深度融入电子KYC(EKYC)及文件防伪等流程,确保对各类生成式内容具备强大的检测能力。
CVPR(计算机视觉与模式识别会议)是由IEEE主办的国际会议。它与ICCV、ECCV并称为计算机视觉领域的三大顶级会议。本届挑战赛吸引了来自全球的500多支队伍参赛。
美国股市触及历史里程碑,人工智能与航空航天巨头准备开启万亿美元时代
埃隆·马斯克、山姆·阿尔特曼和达里奥·阿莫迪,这三位科技领域的巨头,正推动其各自的企业迈向首次公开募股(IPO)。随着 SpaceX、OpenAI 和 Anthropic——这三家估值接近万亿美元的行业巨头——即将上市,2026 年被预测将成为美国历史上新股发行规模最大的一年。这一历史性的资本激增已引起全球金融界的关注,成为检验公共市场吸收如此大规模资金能力的关键压力测试。这些主要融资活动的同步启动预计将打破 2021 年创下的 1560 亿美元纪录。超级独角兽的资本博弈每家公司上市的路径
瑞典人工智能初创公司Lovable Eyes在完成主要融资轮后估值达132亿美元
随着人工智能驱动的编码工具日益普及,瑞典初创公司 Lovable 已获一轮重大融资。该公司计划筹集 30 亿美元,其估值有望升至 132 亿美元——这是去年 12 月记录的 66 亿美元的两倍。预计 Menlo Ventures 将主导此次投资。Lovable 的吸引力源于其核心的“氛围编码”(vibe coding)技术,该技术通过消除对复杂编码技能的需求来简化软件开发。用户只需以自然语言描述其需求,系统即可自动生成应用程序。这种直观的方法吸引了个人开发者、设计师和小企业,并扩展至 Work





首页






