首页 > 教程攻略 > ai资讯 >马斯克亲自下场演示:Grok 新功能能"看片"了,一段科比 AI 视频精准识破

马斯克亲自下场演示:Grok 新功能能"看片"了,一段科比 AI 视频精准识破

来源:互联网 时间:2026-08-04 14:34:59

来,先看个有意思的案例。马斯克最近在社交平台推荐自家AI平台Grok的新版本时,顺手上传了一段已故篮球巨星科比的AI合成视频——作为实测。结果呢?Grok不仅完美解析了画面和场景,还精准提取了核心台词,最终给出一个判断:这段视频是深度伪造的AI合成内容。这背后,是Grok全新视频交互能力的首次高调亮相。

从马斯克放出的对话记录来看,Grok的操作相当细致。它先是逐帧解析画面:“科比身穿黑色西装,以标志性的‘曼巴精神’发表独白,伴随着指点、手势、微笑以及身体前倾靠近镜头的动作,灯光极具电影质感。”接着,模型精准提取出视频中“SpaceX迄今为止打造的最强智能模型”“Grok 4.5,伟大源于磨砺,曼巴,退场”等核心台词。这一步步,不是简单的图像识别,而是带着理解力的“读片”。

综合判定为Deepfake,科比AI视频无所遁形

真正的关键环节在于综合判定。Grok把所有画面、台词和上下文信息串联起来,最终得出结论:这段影像属于深度伪造的AI合成视频。它甚至明确指出,科比已于2020年离世,视频内的人物画面完全是AI生成,而非真人实拍。这意味着什么?意味着Grok不仅“看懂”了视频内容,还具备了辨别真伪的推理能力——这已经不是简单的图像识别,而是带着逻辑推理的“阅片思维”。

从音频摘要到全维度理解,视频交互跨代升级

Grok近日正式上线的视频交互功能,让用户可以像上传图片一样,直接在对话窗口上传本地视频文件,或者粘贴链接,然后向AI下达各种指令。支持的功能包括:总结视频全篇内容、识别画面人物与物体、拆解动作细节,甚至针对任一细节持续追问交流。

相比以往那种只提取音频文字生成摘要的旧模式,这次升级完全是跨越式的——Grok能够联动连续帧画面、音频信息与上下文逻辑,全方位深度理解整条视频的内容。当AI从“听视频”进化到“看视频”,从内容总结升级到真伪鉴别,视频交互的天花板,又被实实在在抬高了一截。