位置:首页 > 产业资讯 > 马斯克演示Grok新功能:可识别视频内容并精准辨别科比AI视频

马斯克演示Grok新功能:可识别视频内容并精准辨别科比AI视频

时间:2026-08-12  |  作者:半糖攻略君  |  阅读:0

先来看一个有意思的案例。马斯克最近在社交平台推荐自家AI平台Grok的新版本时,顺手上传了一段已故篮球巨星科比的AI合成视频作为实测。

结果是,Grok不仅完美解析了画面和场景,还精准提取了核心台词,最终给出判断:这段视频是深度伪造的AI合成内容。

这背后,正是Grok全新视频交互能力的首次高调亮相。

Grok如何完成视频识别

从马斯克放出的对话记录来看,Grok的操作相当细致。

它先逐帧解析画面:“科比身穿黑色西装,以标志性的‘曼巴精神’发表独白,伴随着指点、手势、微笑以及身体前倾靠近镜头的动作,灯光极具电影质感。”

接着,模型精准提取出视频中的核心台词,包括“SpaceX迄今为止打造的最强智能模型”“Grok 4.5,伟大源于磨砺,曼巴,退场”等内容。

这一步步并非简单的图像识别,而是带着理解力的“读片”。

综合判定为Deepfake,科比AI视频无所遁形

真正的关键环节,在于综合判定。

Grok把所有画面、台词和上下文信息串联起来,最终得出结论:这段影像属于深度伪造的AI合成视频。

它甚至明确指出,科比已于2020年离世,视频内的人物画面完全是AI生成,而非真人实拍。

这意味着,Grok不仅“看懂”了视频内容,还具备了辨别真伪的推理能力。

这已经不是简单的图像识别,而是带着逻辑推理的“阅片思维”。

视频交互能力完成跨代升级

从音频摘要到全维度理解,视频交互跨代升级

Grok近日正式上线的视频交互功能,让用户可以像上传图片一样,直接在对话窗口上传本地视频文件,或者粘贴链接,再向AI下达各种指令。

支持的功能包括:

  • 总结视频全篇内容

  • 识别画面人物与物体

  • 拆解动作细节

  • 针对任一细节持续追问交流

相比以往只提取音频文字生成摘要的旧模式,这次升级完全是跨越式的。

Grok能够联动连续帧画面、音频信息与上下文逻辑,全方位深度理解整条视频的内容。

当AI从“听视频”进化到“看视频”,从内容总结升级到真伪鉴别,视频交互的天花板又被实实在在抬高了一截。

免责声明:文中图文均来自网络,如有侵权请联系删除,心愿游戏发布此文仅为传递信息,不代表心愿游戏认同其观点或证实其描述。

相关文章

更多

精选合集

更多

大家都在玩

热门话题

大家都在看

更多