英伟达发布了一款名为“Synthetic Video Detector”的AI微服务,能逐帧分析视频,判断其是否由人工智能生成。在非压缩视频测试中,该工具的最高识别精度达到92%,处理1080p视频的最短耗时仅22毫秒。
这款工具属于NVIDIA面向媒体行业推出的“NVIDIA AI for Media”产品组合,通过NVIDIA Inference Microservice(NIM)方式交付。它的工作机制是将视频切分为504×504像素的帧,利用Meta开发的图像识别模型DINOv2与DINOv3提取特征,为每一帧打出一个0到1之间的分数——越接近0越像真实拍摄,越靠近1越可能出自AI之手。基于逐帧得分,系统最终输出整段视频的综合判定结果。
![]()
在实际应用中,编辑室可以用这个分类分数来确定哪些素材需要优先核查、先行隔离,或者转交深度验证。NVIDIA强调,该工具并非要取代现有的事实核查或影像鉴定流程,而是在分秒必争的新闻前线,为编辑团队提供一个额外的参考维度。
![]()
一段由Google Gemini生成的AI视频在演示中被上传分析,结果显示“合成视频可能性为92.6%”,并配有一条展示各帧AI生成概率波动的折线图。而NVIDIA准备的真实拍摄视频经过同样流程后,得分仅为3.5%,系统几乎明确判定其为实拍内容。
考虑到社交平台与新闻聚合服务中的视频往往经历过压缩、裁切、转码等后期处理,NVIDIA也公布了不同场景下的表现数据:非压缩视频精度最高达92%,压缩率15%时仍维持在87%,即便压缩率升至50%,识别精度仍有82%。
![]()
处理速度方面,搭载NVIDIA RTX的系统可在22毫秒内完成对一段1080p视频的分析,L40 GPU环境下的耗时约为30毫秒。由于支持本地部署、边缘计算、混合架构以及气隙隔离环境,机构可以将敏感影像留在内部,无需外传即可完成检测。
NVIDIA将Synthetic Video Detector明确定位为新闻编辑室的辅助决策工具。它的目标不是给出终极真伪裁决,而是把AI判定作为一种新的信号,融入现有的多层验证体系,帮助媒体在速度与准确性之间找到更稳妥的平衡点,维系公众对影像内容的信任。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.