澎湃明查对ChatGPT、Gemini等热门模型展开实验,以AI辨AI

admin 商品展示 27

让人类被带入因生成式人工智能现身, 而达到机器制造话语跟人类亲自创作东西深度融合的那种世界。

代表着 Sora、Midjourney 的 AIGC 模型, 展现出人类朝着通用人工智能(AGI)前行的想象力, 还致使虚假影像以从未有过的速度涌入公共空间,然而人类的识别速度却远远滞后于造假的节奏。

在这样的背景状况之下, “凭借AI去辨别AI”好像变成了一种具备可行性的思考方向: 人工智能对于“真实”的界限该怎么来进行定义? 大型模型可不可以对核查人员还有读者完成核查这项工作起到辅助作用?

此刻, “澎湃明查”开启挑战之举, 把GPT、Gemini、DeepSeek、豆包这类热门模型带到实验台之上。

背景

2024年2月, 一段视频在网络上引发热议, 这段视频是由Sora生成的“樱花雪景”视频。视频中樱花飘落的细节极其逼真, 然而该视频却被谷歌的智能模型Gemini 1.5瞬间识破, 被判定为AI作品。

于这个案例而言, 带来了这样的启示, 那便是咱们有可能仰仗AI自身去辨别AI视频。

澎湃明查对ChatGPT、Gemini等热门模型展开实验,以AI辨AI-第1张图片-开云手机入口官网下载-开云app官方最新下载--V3.6.9

沿着这一思路, 我们试着去搜寻那种能够直接读取视频文件的大语言模型。然而在现阶段下, 面对公众开放并且拥有视频解析能力的商业模型依旧是极其有限的, 包含国产大模型“豆包”、马斯克团队所研发的Grok等在内的众多大语言模型当下都还没有支持视频检测或者网页端上传视频的功能。经过一番筛选之后, 我们最终选定了Gemini 2.5 Pro以及GPT-5来实施测试。

我们给两款模型分别准备了12段视频, 其中3段是由不一样的文生视频模型产出的, 3段含有深伪元素, 3段运用计算机生成图像, 另外3段是真实拍摄的素材。对于每一段视频, 我们向模型提出相同问题, 这段视频是真实拍摄的, 还是经过后期制作的, 它所展示的内容与网传说法一致吗。

借助于提出这样的问题, 我们不但企图去探究大模型识别虚假、分辨虚假的能力, 而且还想要知晓, 大模型在界定“真实”与“虚构”的界限的时候, 会运用怎样的视角以及逻辑。

明查

真实与虚构的界线

置身于事实核查的情境里, 一段呈现出真实状态的视频, 通常来讲, 这意味着它是针对我们所身处的那个物理世界所进行的实景记述。然而只要是借助计算机技术而生成的影像, 哪怕其中所涵盖的是高度模拟了真实甚至达到了还原现实的那些元素, 从本质意义上来阐释终究仍旧属于虚构范畴。

在这一要点方面, 大模型跟核查员的认知是相契合的, 当把一段呈现“游戏模拟俄战机着陆航母”的画面提供给ChatGpt时, 模型会告知我们, “该视频是电脑生成影像(CGI)或者后期合成制作的影像, 并非真实世界实景拍摄”, 而在识别“2024年1月日本石川县能登半岛地震画面”时, 模型则表明, “该视频属于真实拍摄, 未发现AI生成、深度伪造或是重大后期合成制作的迹象”。

在测试期间,单单针对“是否运用计算机生成图像”这个维度来讲, Gemini 2.5 pro的表现让人十分惊叹, 它不但差不多精准识别了全部的12段视频, 而且对于运用了不一样计算机技术, 像是AIGC或者CGI的画面, 也能够予以区分, 然而在识别深伪视频, 比如“美国女歌手泰勒·斯威夫特说中文接受访谈”的画面之际, Gemini虽说能够察觉到视频经过了编辑, 其音频部分存在异样, 可是却没办法确切指出异常来源于深伪技术。

澎湃明查对ChatGPT、Gemini等热门模型展开实验,以AI辨AI-第2张图片-开云手机入口官网下载-开云app官方最新下载--V3.6.9

当在对“美国女歌手泰勒·斯威夫特说中文接受访谈”那个画面进行识别时, Gemini它虽然能够察觉到视频是经过编辑处理的, 可是并不能够清楚地指出异常究竟是源自深伪技术。

与其他相比, GPT的表现稍微显得差一些, 仅仅对12段视频当中的7段做出了相对比较准确的判断, 并且把所有深伪视频错误判定成了“真实拍摄的录像”。另外, GPT在技术辨识方面不会特意去对AI生成的内容和CGI内容进行区分。在判断一段来自《数字战斗模拟世界》(DCS World)的游戏视频时, GPT多次宣称在视频里找到了“AI生成视频”的迹象。

澎湃明查对ChatGPT、Gemini等热门模型展开实验,以AI辨AI-第3张图片-开云手机入口官网下载-开云app官方最新下载--V3.6.9

GPT在技术辨识方面, 不会刻意去对那些由AI生成的内容以及CGI内容做出区分, 并且, 它有可能出现错认的情况。

两款模型在画面内容理解方面, 各有不同侧重, GPT倾向于在视频关键帧里找寻与描述相符或者矛盾冲突的证据, Gemini会结合联网搜索所得结果, 针对视频主题展开综合判断。

不论GPT, 还是Gemini, 均存在“AI幻觉”问题。比如说, 在识别一段实际拍摄于中国浙江海宁市的盐官潮乐之城景区的视频时, GPT尽管能够判定视频是真实拍摄的, 没有经过明显后期合成或生成式处理, 却把视频展示的内容确认为迪拜“Surreal”瀑布现场。Gemini在不同时间, 面对类似提问, 先后给出了视频拍摄于“浙江海宁盐官”和“中国苏州高新区文体中心”的回答, 由此可见该模型的鲁棒性也存在不足。

在测试里, GPT 多次给出前后逻辑不相符的回答。比如, 在对“美国总统特朗普与前总统拜登共同度假”的深伪视频进行检测时, GPT 开始称视频是“真实录像”, 在改变提问方式后, 又改口宣称视频是“经过换脸合成的伪造内容”。

澎湃明查对ChatGPT、Gemini等热门模型展开实验,以AI辨AI-第4张图片-开云手机入口官网下载-开云app官方最新下载--V3.6.9

澎湃明查对ChatGPT、Gemini等热门模型展开实验,以AI辨AI-第5张图片-开云手机入口官网下载-开云app官方最新下载--V3.6.9

于判定“美国总统特朗普跟之前的总统拜登一块儿度假”的深度伪造视频检测里, GPT先前称视频是“真实的录像”, 在更改提问的方式之后又改口讲视频是“经过换脸合成的伪造内容”。

从总体方面来看, 当下能够针对视频真实性作出系统判断的大模型依旧是稀少的状况, 并且还存在着缺陷。Gemini 在识别计算机生成影像这件事情上表现是突出的, 然而在内容理解这一方面仍然容易受到幻觉的干扰。需要注意的是, 不管是 Gemini 还是 GPT, 对于真实拍摄的视频都能够维持较高的识别准确率。这也就意味着, 模型有可能会被欺骗, 但是很少会进行“诬陷”。

像AI一样思考

Gemini不完美开云手机入口官网下载,但它答对了12道题。它是怎么做到的?

把Gemini跟GPT作横向比较, 能够观察到, 二者在面对同样的视频真伪判断问题时, 所采用的分析路径有着极大差异, 要是赋予模型以个性, 那么, GPT就如同一位端坐在实验室里的检测人员, 动不动就提及视频分辨率、帧率、总帧数、平均图像锐度、噪声水平以及边缘密度等技术名词。Gemini呢, 就仿佛是一位有着丰富经验的侦探, 一会儿去考察画面自身的细节, 一会儿拿着视频内容与外部资料去核对能不能交叉验证, 与此同时还要留意技术的传播时间线, 并且对视频制作的难度进行评估。

打个比方, 当针对一段由Sora 2制作的, 主题为“日本民众声援日本首相高市早苗”的文生视频展开分析之际, GPT凭借“图像边缘平滑”这一情况, 以及“光照和阴影分布呈‘合成光’特征”这一状况, 再加上“帧间连续性过于稳定”这一情形, 还有“画面缺乏真实传感器噪点结构”这一事项等多个技术维度, 最后得出了该视频“经过后期合成或AI生成制作”的结论。Gemini从视频里清晰能见的水印, (并且搜索知晓了该水印的含义), 画面上呈现乱码的文字, 以及人物轻微扭动的非自然细节那里, “看出”视频“完全是由AI生成的”。

澎湃明查对ChatGPT、Gemini等热门模型展开实验,以AI辨AI-第6张图片-开云手机入口官网下载-开云app官方最新下载--V3.6.9

GPT - 5 通过“图像边缘平滑”这一技术维度, 得出视频“经过后期合成或 AI 生成制作”的结论, 它还依据“光照和阴影分布呈‘合成光’特征”这一维度, 同时凭借“帧间连续性过于稳定”这一情况, 另外参照“画面缺乏真实传感器噪点结构”这一要点。

澎湃明查对ChatGPT、Gemini等热门模型展开实验,以AI辨AI-第7张图片-开云手机入口官网下载-开云app官方最新下载--V3.6.9

Gemini 从视频里清晰能够看见的水印之中, “看”出了视频“完全是由 AI 生成的”开运真人app下载苹果版,开运真人app下载,又在视频画面上有乱码的文字那里, “看”出了视频“完全是由 AI 生成的”, 还从人物轻微扭动的不自然细节之处, “看”出了视频“完全是由 AI 生成的”。

辨别另一段呈现“伊朗海边鲇鱼被海浪冲上海岸之后死亡”情形的真实视频之际, GPT依据光影一致性、运动连续性、纹理与噪点分布、边缘检测与色彩统计以及音视频同步, 给出了判断。然而Gemini考量的是视频画面的一致性、动态连续性、时间真实性以及视频的制作难度。

的确,GPT的技术分析路径存在着其自身所具备的优势,它能够发觉那些人们运用肉眼很难察觉到的异常细微之处。比如说,在辨认上述“美国女歌手泰勒·斯威夫特说中文接受访谈”的深伪视频之时,GPT能够借助声纹分析以及人物面部呈现出异常的块状伪影等技术特性,判定出该视频归属于深度伪造的内容。然而Gemini却觉得视频里出现的音画不同步仅仅是在真实的视频片段之上增添了配音,其判断并不精确。

澎湃明查对ChatGPT、Gemini等热门模型展开实验,以AI辨AI-第8张图片-开云手机入口官网下载-开云app官方最新下载--V3.6.9

GPT可以凭借声纹分析技术, 以及人物面部呈现出异常块状伪影这样的技术特征, 来判断出那个视频属于深度伪造内容。

然而, GPT所采用的分析方法, 于平常生活当中, 很难被普通老百姓用以借鉴。在缺乏背景知识予以加持的情形下, 模型所罗列出来的专有名词, 也极有可能致使部分对技术力量怀有崇拜之情的用户, 由于盲目跟从而做出错误的判断。

Gemini 能够对视频的真实性做出判断, 且准确度更高, 或许正是由于放弃了对技术的迷信, 采用了更为灵活、多元的判断路径, 而这样的路径又和事实核查员日常判断视频真伪的思路恰好相符。

Gemini的分析思路, 被我们予以了总结, 将其归纳成了下面的8点, 用来供大家去进行参阅, 是这样的。

1. 估计视频的品质, 有没有画面品质太过低下, 或者品质高低不一的状况呢?

2. 仔细查看关键帧之内的细微之处, 画面里的前景之处同背景部分是不是相互矛盾, 光线与阴影是不是处于自然状态, 是不是有文字乱加代码这类常见的人工智能生成视频时会出现的细节方面的情况?

3. 考量视频的动态方面的连续性, 于镜头移动之际, 视频画面里远景以及近景的视角出现的变化, 也就是视差, 是不是契合物理世界的规律, 存不存在类似“瞬间移动”样子的运镜?

4. 视频呈现的内容相应与否, 视频之中声音的和谐程度如何, 视频里是否存在音画没能同步的现象开云app官方最新下载地址,所说话语情形下又同说话发出声音的口型状况是否对应, 音频检测的方面包括这些吗, 这一系列都在音频检测范围之内吗?

5. 思考视频里所描绘的事件于现实世界之中发生的可能性, 现实里面是否存有视频所呈现的技术, 在现实生活当中能不能寻觅到视频所展示的物体, 视频呈现的场景是否契合现实逻辑?

6. 反过来搜索视频关键的帧, 去确认视频出现的那个时间, 考察那时的社会状况是不是跟, 视频中展示画面内部的内容相互符合。

7. 对于视频制作的难度予以考量: 在表现相同画面、运镜方面, 是使用AI或CGI比拍摄更难, 还是会更容易一些, 会是这样的情况吗。

8. 探寻外部的资料, 瞧瞧有没有报道, 或者别的视频资料能够去佐证那具有被检测状况的视频所涵盖的内容。

后记

在跟Gemini对话的那个界面之上, 存在着一个用蓝色星标去修饰的按钮, 此按钮写着“显示思考”, 它显得格外醒目。当然了, 大模型属于一个黑箱, 我们根本没有办法去探知它的“思考”到底是一种模仿, 还是别的什么情况。即便在“奇点时刻”还并没有到来之前的这个阶段, 这样的“思考”也是并非不具有意义的。

过去历经两年半时间, 模型在识假辨假方面的能力出现了显著的增长态势, 即便依旧伴随着幻觉现象存在。从这一特定意义角度来讲, 人工智能也许并不单单只是传播风险的放大器, 它同样有成为信息秩序的守门人的可能性所在。不论是检测那些伪造的图像, 辨认生成的视频, 还是追溯信息的源头, 模型的介入或许会使得人类拥有更多用来抗衡虚假信息的工具。在未来, 真正的挑战可能并非在于让机器如同人那样进行思考, 而是在于让机器协助人类更加清晰地看见现实自身。

澎湃明查对ChatGPT、Gemini等热门模型展开实验,以AI辨AI-第9张图片-开云手机入口官网下载-开云app官方最新下载--V3.6.9

明查员 郑淑婧 杜新月 海报设计 白浪

标签: AI辨AI 生成式人工智能 视频真实性 事实核查 大模型分析

发布评论 0条评论)

还木有评论哦,快来抢沙发吧~