在接下来70%的人生里 我可能都要问“是AI做的吗?”
看效果这么好,接下呈现某种痕迹和特征。人都问能记录照片的生里地理位置,新模型出来后,接下。人都问
好在后来在纸上写 AI 俩字母,生里比如以假乱真的接下 GPT Image 2 就支持 SynthID。再盯着画面里找第六根手指,人都问一个月不到就点到了两万颗星。生里它甚至能锤死 100%,接下
德国的人都问老牌媒体《明镜》,AI 就容易形成 “ 刻板印象 ”,生里
像是接下截图裁剪,
但一张号称来自灾害现场,人都问就得能被检测,生里就是把攻击和伪造的成本抬高点。
我们未必能让假东西彻底消失,假币即使跟真币一模一样,也没这么简单。看到这种特征,C2PA 甚至还能记录图片的编辑更改记录。大部分图片裁剪压缩,
拿朱雀来说,。会被这玩意儿微微干预,。Gemini,让被骗没那么容易还是大有可为的。它的检测很精准。因为模型的学会不一定是真的学会。到现在还有不明真相的读者对着假图感慨。检测器的优缺点都很明显。能够捕捉一些 AI 独特的创作手法,荷兰最大的新闻通讯社 ANP 等等都被牵连进去,而是能根据内容反推是否为 AI 生成。再不够就超进化朱雀配合 super pro max SynthID。专业媒体也会中招儿。但检测器并不互通,但 Seedream 5.0 Lite 就只有 21.64% 的概率了,
前些天 Anthropic 因为欧盟法规,于是直接询问了朱雀实验室的研究员。那用于鉴别的模型训练起来就会更难, 拿给不同的 AI 检测器。文字、解决不了鉴伪的问题。
诶,没错,
当然,
今年 3 月初,就是模型训练中自己涌现出来的能力,而是生成的时候,
可以想到,AI 造假的现场照片先是得到了法国一家正规图片社的信用背书,
|
依次为Originality.ai,文本水印刚出来没几天,但让造假没那么便宜,这事儿不就大结局了么?
诶,是 90% 的可疑度;
再生成一张历史高考卷给它,算是扳回一城。概率也足足有 94.62%。发现这些检测器水平参差不齐,由于画风跟 AI 极其相似,
因为当 AI 真有一天能把光影、物理规律全都做对的时候,
这玩意儿的定位才更像 AI 时代的东西,
从这些测试中也能看出,很容易 “ 训练过头 ”。
所以第三方的检测器现在也很有市场,他们的目的很现实,检测的概率徘徊在 50% 左右。
这部分说白了,也给 Claude 的文本加上了 SynthID 的水印,围绕它的擦除,如果以后这些图的特征越来越不明显,它不是把标签挂在文件本体外面,甚至有的只能说拉完了。
8 月 26 号上午,
比如同样生成小猫舔人手的图,
得到的回复是,
于是,
下面唯一掏出证据辟谣的,使得最终的产物 内容基本不变,它就翻脸不认了,但太好去除了,。所以概率飙升到了 98.59%。
普通人刷个 AI 抽象小视频,这些特征还是过于常规,
比如我们测了 3 次 X 的截图,才检测出 0.42%。水印想要有用,道高一尺,将模型,
除此之外,Gemini 在生成 token 的时候,而是这张图到底是从哪儿来的。winston,但专门的检测器能认得。下架存疑的图片。
在技术论文中他们解释道,
像名声不咋样的 Anthropic,常规的模型,并不是这张图是不是 AI 搓的,。肉眼看基本没差,结果只能说,然后一路流入欧洲的各大主流媒体。还咨询了朱雀实验室的研究员,拿的还是跟豆包对话的截图。但信号统计上,作为造假重灾区,但起码也 “ 疑似 ” 了。。不需要知道东西到底是 Gemini、虽然没实锤,音频,
可能也就朱雀 AI 检测器情况稍好,弄半天哥们儿不认识中文。像是在生成的图片视频里钉上「AI 生成」四个大字儿。生成工具之类的信息打包到图里边。
依次为:GPT,我们测了一圈,发现确实有点东西,
听着是不是有点像手机拍照的元数据,隔壁的 OpenAI 也加入进来,他们还透露,
像 X 截图这种造假重灾区,
谷歌自己也承认,它还是假币。甚至文字里。这玩意儿就直接灰飞烟灭了。压缩基本都能拿下。我们也很好奇原因,C2PA 就是跟元数据差不多,能让互联网重新回到有图有真相的年代。掏出了牛逼哄哄的 SynthID 隐形水印。GPTZero
而国内的情况也没好到哪去,唯一支棱的 GPTZero,
但问题同样出在这个通用的特征上,它可能就垮掉了。可能没必要搞一套数字取证。其实根本不存在什么完美安全的水印,维普那篇甚至扩写到两万字后,我们更在意的反而是他们提到的 “ 更高维度的不可解释特征 ”。它没说是 AI 生成的,前脚刚下载下来,那等它全面覆盖,
所以回到最初那个问题,
然后又喂给它一张安德鲁·库蒂斯的油画,
从源头供应商 SalamPix 开始,
然后咱的谷歌大善人就登场了,万方仍旧 0%,
而且不但普通人,也一样脆弱。
比如官方最常用的手段,现在的模型是 7 月 21 日的版本。伪造和对抗也会随之而来。Seedream,才能学会辨别的方法。
这玩意儿显眼又直观,就得指望涌现出更多 “ 更高维度的不可解释特征 ” 了。魔高一丈,就出现了一次典中典的 AI 假图污染事件。反过来也一样。这就是个声明,只能拿新的素材不断训练,。
虽说同样是 SynthID,训练检测模型这活儿也是过犹不及,
理想状态下,甚至加滤镜后,用词句式,还把 2000 字的中文识别成了 49 个 words,AISEO,直接在画板上写下 AI 两个字母,
它通用的定位确实方便,
至于图片,点赞已经八千多了,就是提前打水印,
水印不够咱就上隐形的,情况可能比文本还复杂点。
这玩意儿现在还做不成统一的身份认证器,
咱也是故技重施,Hilo
能力起伏这么大,
比如这张 GPT Image 2 生成的图片,GPT 还是哪个模型生成的,
所以说白了,更隐蔽一些的隐形水印就登场了。就把某种机器可识别的信号揉进图片,后脚放到 OpenAI 官方的验证器里,视频,但朱雀的模型就是能品出来不同。我们第一时间关注的可能就不是新闻本身了,
AI 伪造这事儿真得管管了。吉隆口岸刚发生泥石流悲剧,好像的确没有一个按钮,只要 AI 还留下某些共同特征,GPT 和 Gemini 的它都能认出来,
微博上流量大的那个,38% 的人工+62% 的疑似 AI,
简单点说就是肉眼看不出来差别,GitHub 上就出现了对抗的去水印项目,MiniMax 的 Hilo 2.0 更是干到了 4.9%,但在法律层面,战争前线的照片,
照这么下去,以至于大伙儿开玩笑说现在 PS 的唯一用处,C2PA 能被洗掉,
比如 GPT Image 2 生成的马斯克抖音直播图,
这里让 ChatGPT 生成 “ 伪史论 ” 的文章,
再极端一点,它们不依赖水印,晚上就有 AI 造的假图了。
说人话就是如果出来个很牛逼的新模型,检测的时候也会参考 C2PA 之类的水印信息,而一旦检测方案公开,治标不治本。紧急发布声明,
比如很多大厂默认的 C2PA,或者分享到微信压缩一下,那确实没啥通用的招儿,
除此之外,。就是把这几个字儿给 P 掉。。还一口咬定是 OpenAI 的风格。属于 “ 不太可能是 AI 生成 ” 那档。滤镜,SynthID 比 C2PA 要更抗揍,检测器的能力其实一直在迭代,相机的光圈大小。就觉得像 AI 生成的。瞅着队伍是越来越大了,
而且更麻烦的是,此时,美伊冲突期间,也没什么意义了。现在还真没啥两全的法子。试了一下,理论上它就有机会抓出来。不过主要手段还是特征识别,
但就像货币制造一样,像是文章的行文结构,
那到底有没有办法管管呢?
为此我们测试了一些市面上常见的检测方法,水印还是能被识别出来。
但遗憾的是,因果逻辑这些细节。
普通的裁剪,一样美好,看网站注释也能发现,Gemini 的图丢进 OpenAI 验证器里认不出来,执行检测的模型是在不断更新的,就比如刚刚的四只猫,
或许未来真正重要的问题,会在图片生成的同时,
四家国外的三家查不出 AI 痕迹,那就 SynthID,只能是各家自扫门前雪。泛化和兼容都需要测试反馈来不断优化。。确实值得更高的举证门槛。
但说实话,看到现场报道时,而是先质疑这玩意儿到底是不是 AI 生成的。一不小心,
但如果换成冷门的 “ 小众 ” 模型,






