搜索 猫眼电影 融媒体矩阵
  • 山东手机报

  • 猫眼电影

  • 大众网官方微信

  • 大众网官方微博

  • 抖音

  • 人民号

  • 全国党媒平台

  • 央视频

  • 百家号

  • 快手

  • 头条号

  • 哔哩哔哩

首页 >新闻 >社会新闻

AIGC检测为何频频“看走眼”?问题可能出在数据源头

2025-12-27 17:58:26
来源:

猫眼电影

作者:

古丽尼沙·阿不都沙塔尔

手机查看

  猫眼电影记者 弗朗索瓦博齐泽 报道首次登录送91元红包

腾讯优图 投稿量子位 | 公众号 QbitAI

在AIGC技术飞速发展的背景下,只需一行简单的prompt就可生成高逼真内容,然而,这一技术进步也带来了严重的安全隐患:虚假新闻、身份欺诈、版权侵犯等问题日益突出。AI生成图像检测也成为了AIGC时代的基础安全能力。

然而在实际应用中, 存在一个“尴尬”现象:检测器往往在“考场”(公开基准数据集)上分数耀眼,一旦换到“战场”(全新模型或数据分布),性能会大幅下降。

近日,腾讯优图实验室联合华东理工大学、北京大学等研究团队在A生成图像检测(AI-Generated Image Detection)泛化问题上展开研究,提出Dual Data Alignment(双重数据对齐,DDA)方法,从数据层面系统性抑制“偏差特征”,显著提升检测器在跨模型、跨数据域场景下的泛化能力。

目前,相关论文《Dual Data Alignment Makes AI-Generated Image Detector Easier Generalizable》已被NeurIPS 2025接收为Spotlight(录取率 Top 3.2%)。

发现:AI图像检测器其实只是在“识别训练集”

研究团队认为问题的根源可能在于训练数据本身的构造方式,使得检测器并没有真正学会区分真假的本质特征,而是“走了捷径”,依赖于一些与真伪本身无关的“偏差特征”(Biased Features)来做出判断。

这些偏差特征是真实图像与AI生成图像在训练数据收集过程中产生的系统性差异。具体来说:

真实图像:来源渠道复杂,清晰度与画质参差不齐;分辨率分布分散;几乎都以JPEG 格式存储,并带有不同程度的压缩痕迹。AI生成图像:呈现出高度统一的模式,分辨率常集中在256×256、512×512、1024×1024等固定档位;并且大多以PNG等无损格式存储;画面干净,没有明显压缩痕迹。

在这样的数据构成下,检测模型可能会去学习“投机策略”,例如PNG≈假图,JPEG≈真图。这种“捷径”可以在某些标准测试集(如GenImage)上甚至可以达到100%的检测准确率,然而一旦对AI生成的PNG图像进行简单的JPEG压缩,使其在格式和压缩痕迹上接近真实图像,这类检测器的性能就会出现“断崖式下跌”。

对比真实图像和AI生成图像,两者可能存在格式偏差、语义偏差和尺寸偏差:

解法和思路

针对这一问题,研究团队认为如果数据本身带有系统性偏差,模型设计的再复杂也难免“学偏”。因此提出了DDA(双重数据对齐,Dual Data Alignment) 方法,通过重构和对齐训练数据来消除偏差。其核心操作分为三步:

像素域对齐(Pixel Alignment)

使用VAE(变分自编码器)技术对每一张真实图像进行重建,得到一张内容一致、分辨率统一的AI生成图像。这一步操作消除了内容和分辨率上的偏差。

频率域对齐(Frequency Alignment)

仅仅像素域对齐是不够的,由于真实图像大多经过JPEG压缩,其高频信息(细节纹理)是受损的;而VAE在重建图像时,反而会“补全”这些细节,创造出比真实图像更丰富的高频信息,这本身又成了一种新的偏差。

△可视化对比真实图像(JPEG75)和AI生成图像(PNG)的高频分量

实验也证实了这一点:当研究者将一幅重建图像中“完美”的高频部分,替换为真实图像中“受损”的高频部分后,检测器对VAE重建图的检出率会大幅下降。

△对比VAE重建图和VAE重建图(高频分量对齐真实图像)的检出率

因此,关键的第二步是对重建图执行与真实图完全相同的JPEG压缩,使得两类图像在频率域上对齐。

最后采用Mixup将真实图像与经过对齐的生成图像在像素层面进行混合,进一步增强真图和假图的对齐程度。

经过上述步骤,就能得到一组在像素和频率特征上都高度一致的“真/假”数据集,促进模型学习更泛化的“区分真假”的特征。

实验效果

传统的学术评测往往是为每个Benchmark单独训练一个检测器评估。这种评测方式与真实应用场景不符。

为了更真实地检验方法的泛化能力,研究团队提出了一种严格的评测准则:只训练一个通用模型,然后用它直接在所有未知的、跨域的测试集上评估。

在这一严格的评测标准下,DDA(基于COCO数据重建)实验效果如下。

综合表现:在一个包含11个不同Benchmark的全面测试中,DDA在其中 10个 上取得了领先表现。安全下限(min-ACC):对于安全产品而言,决定短板的“最差表现”往往比平均分更重要。在衡量模型最差表现的min-ACC指标上,DDA比第二名高出了27.5个百分点。In-the-wild测试:在公认高难度的真实场景“In-the-wild”数据集Chameleon上,检测准确率达到82.4%。跨架构泛化:DDA训练的模型不仅能检测主流的Diffusion模型生成的图像,其学到的本质特征还能有效泛化至GAN和自回归模型等完全不同,甚至没有用到VAE的生成架构。

无偏的训练数据助力泛化性提升

在AI生成图像日益逼真的今天,如何准确识别“真”与“假”变得尤为关键。

但AIGC检测模型的泛化性问题,有时并不需要设计复杂的模型结构,而是需要回归数据本身,从源头消除那些看似微小却足以致命的“偏见”。

“双重数据对齐”提供了一个新的技术思路,通过提供更“高质量”的数据,迫使这些模型最终学习正确的知识,并专注于真正重要的特征,从而获得更强的泛化能力。

论文地址:https://arxiv.org/pdf/2505.14359GitHub:https://github.com/roy-ch/Dual-Data-Alignment

 时事1:电子老虎机下载

  12月27日,云南禄劝中药材种植面积逾17万亩 赋能乡村振兴,大连形势则不容乐观。虽然一季度GDP增速(5.8%)跑赢全国大盘,但投资、消费和进出口增速分别为3.8%、3.7%、-8.9%,均低于全国平均水平。这也愈发暴露出大连的深层次短板,在外界看来,大连产业结构仍以重工业和石化产业为主,新兴产业增长缓慢,制约了经济结构转型升级。,新mg娱乐。

  12月27日,伊朗媒体:以在加沙新建至少13个军事据点,亿纬锂能成立于2001年,于2009年在深圳创业板首批上市,历经20余年发展,已成为全球化布局的全场景锂电池企业。其工厂布局在广东惠州、湖北荆门及武汉、四川成都、云南玉溪及曲靖、江苏启东、浙江宁波、辽宁沈阳、匈牙利、马来西亚及美国。,米乐最新版APP,赌博软件,盛世app下载安装。

 时事2:ag亚洲登录

  12月27日,巴基斯坦继续对印度飞机关闭领空至明年1月23日,会上,时任福建省副省长郭宁宁说,“我们诚挚邀请新朋老友到福建走走看看,相约福州‘最美人间四月天’,共襄峰会盛举,共创美好未来。”,二十一点赌牌,2026世界杯投注的图片,天博app下载地址查询。

  12月27日,经济新底气!中国农产品“出海”跑出“加速度”,结构上,存单净融资持续负值,其中国股份行净融资回落绝对值最高。,环球体育,ob体育官方客户端下载,皇冠博。

 时事3:优信彩票注册平台

  12月27日,青海海南:2000余名民众青海湖畔徒步迎新年,2023年2月,福建省招商引资工作领导小组成立,该领导小组组长由福建省委常委、常务副省长郭宁宁担任。,开元棋盘7123下载,TvT体育手机app下载,大发在线官网。

  12月27日,广东省深圳市政协原党组书记、主席戴北方接受审查调查,2月8日晚些时候,泽连斯基还从伦敦赶赴巴黎,与法国总统马克龙以及德国总理朔尔茨举行了会晤,法德领导人重申了他们的信念,即俄罗斯绝不能赢得这场冲突,他们将继续支持乌克兰。,CC集团彩球最新网站,万博官方manbext2.0,手机怎么投注足彩。

 时事4:斗牛洗牌诀窍

  12月27日,俄罗斯驻朝大使逝世 金正恩向普京致唁电,此次二审稿充实完善了原产地制度规则的规定:完全在一个国家或者地区获得的货物,以该国家或者地区为原产地;两个以上国家或者地区参与生产的货物,以最后完成实质性改变的国家或者地区为原产地。国务院根据中华人民共和国缔结或者共同参加的国际条约、协定对原产地的确定另有规定的,依照其规定。,在哪可以买球球大作战的号,667722黄金城电子游戏,买球app。

  12月27日,广西构建打击拒执犯罪联动新模式 推动解决执行难问题,阿里巴巴向《环球时报》记者提供的数据显示,郑钦文的球拍、潘展乐的泳镜……这些冠军同款装备已登上淘宝热搜,卖爆天猫。其中郑钦文夺冠同款网球拍高居淘宝热搜第一名。自8月3日郑钦文夺冠至8月5日樊振东夺冠,其间超200万人在天猫搜索了“小球”品类相关商品,其中网球相关装备搜索量同比增长300%,“郑钦文同款”专业网球拍V14,48小时内收到了超4万人的问询,超3000人加购,成交量同比暴涨超2000%,成为天猫网球类目成交TOP1商品。不仅如此,就连郑钦文夺冠现场教练穿的“加油服”也火出圈。,博鱼·体育(中国)官方网站,云顶网站登录,真人AG接口。

责编:宁蔚夏

审核:马克·米哈尔

责编:丁明玉

相关推荐 换一换