
体育游戏app平台
Grok,学会一键看片了?
就在昨天,马斯克在X上重生秘书:Grok不错分析任何视频了!

在推文中,马斯克放出一段长达63秒的高清视频。其中主角,竟然是早已离咱们远去的篮球巨星科比。

在视频中,科比身穿玄色西装,坐在洛杉矶夜景前的真皮沙发上。他的手边放着一个篮球,对着镜头向全网倾销Grok 4.5。
听着,我是科比·布莱恩特。今晚,咱们不谈绝杀球,咱们来聊聊下一个令东谈主酣醉的东西——Grok 4.5。
终末还不忘甩出一句经典收尾:Grok 4.5。伟大是挣来的。曼巴Out。
若是不是科比还是死一火,看到这个视频的统统东谈主,大要都会懵一会:这是真的如故假的?足够看不出伪造的陈迹啊……
好在,面前咱们有了Grok。它智商惊东谈主,不仅能赶快吃透长视频,以至还能对相等传神的伪造视频赶快打假,进行本事溯源。
以至,还有东谈主放出实例:Grok 不雅看了一段 30 分钟的无缺访谈视频,学习、分析后,在只是大致 36 秒内就生成了详备纲目。

插入视频
Grok的神级扒皮秀
若是把这段科比视频发给庸碌东谈主,大要率会被淘气转发,以至有东谈主会以为,这是一段科比生前未公开的营业代言。
可是,Grok一眼就能鉴假。
看完视频后,Grok交出一份教科书级的报告。

它历害指出,「这是一段AI生成的Deepfake视频。科比·布莱恩特已于2020年死一火,因此整段视频足够是合成的。」
以至,它还能对视频进行本事溯源。
当被问及“这是哪个AI制作的?”时,Grok以为大要率是xAI自家的Grok Imagine Video 1.5。
因为63秒的时长久超纯文本生成视频(通常10-15秒)的极限,大要率是通过多段拼接,并使用了图像参考+文本教导+唇形同步的混杂职责流。
另外,也有可能是Sora 2或Veo 3制作。

是以,Grok真的能作念到足够「看懂」视频吗?
有本事大神打假了:Grok处理的根柢不是画面,是字幕。真要逐帧渲染分析,那算力得堆到天上去。

并且,AI的幻觉老纰缪还在。
有东谈主平直拿我方11分钟的视频测试了一下,发现纲目里大部分信息要么是转录错,要么熟练虚构。
也有东谈主用X直播试了下,收尾时好时坏,并不踏实。

Grok真的能看懂吗?实测陶哲轩的科拉茨料到
为了考据Grok是否真的有看懂视频的智商,咱们决定亲身上手实测一把。
比如,有一个数学界的死一火问题——科拉茨料到(Collatz conjecture,又称 3n+1 问题)。
数学家们多量以为Collatz料到是一个难以自拔的泥潭,并通常会提醒彼此不要松驰涉足。建议近100年来,无东谈主公布这一料到,既无法解释也莫得反例。
2019年,Terence Tao研究了这个问题,一举卓绝了往常几十年其他统统东谈主的建立。
国际的科普网站Quanta发文先容了这一音问。

其中,有一段视频解释了该料到:
全程莫得一个字,只是一些数字。
Grok真的能看懂吗?
收尾,出乎咱们预见的是,它不仅能解读中枢内容解读,还能先容动画特质,以至终末点出了数学兴味。
视频展示的是以数字 1 为根节点,渐渐构建的 Collatz 逆向树/图。每个节点是一个正整数,边暗示 Collatz 公法下的先行者关连:
• 若是一个数 n 是偶数,则 n/2 n指向它;
• 若是一个数 m 知足 3m+1=n (且 m 为奇数),则 m指向 n 。
动画从最简便的骨干开动,渐渐向外膨胀统统能最终到达 1 的正整数,直不雅呈现统统正整数最终都会参预 4→2→1 轮回这一料到的结构。
并且,这段视频足够莫得字幕!

昨天,OpenAI平直秘书,下一代模子Astra解决了10个首要的数学通达问题。有网友挑剔到,Astra此次发达只怕会让Hinton都显得保守落后!

那Grok真能意会这段长达50多分钟的视频吗?
平直把伙同给Grok,收尾Grok裁减管理。
基于帖子标注 + 视频字幕索要,Grok整理出来了视频中枢内容与时期线。

它归纳了访谈的举座基调与重心。
Hinton 在这段访谈中继续了他 2023–2026 年的一贯态度,但口吻更平直:
1. 对 AI 意志的作风:公开承认还是特意志,但刻意淡化,以免过问对更进击安全问题的洽商。
2. 限制与对皆悲不雅:东谈主类历史上莫得告成限制过更高级智能的前例。
3. Agent 风险:自我保存、操纵、勒诈等算作不是科幻,而是可预期的涌现智商。
4. 时期线压缩:他给出 10–20 年产生东谈主类无法意会的数学的忖度,但蚁合现时进展(尤其是 OpenAI 今日发布的 Astra 收尾),这个时期表还是显得保守。
视频后半段主握东谈主会追问一些更偏营业/战略的问题(从字幕碎屑可见触及 OpenAI 商酌话题),但 Hinton 经久把焦点拉回智商爆炸 + 限制失效的中枢矛盾。
终末,Grok还分析了视频与帖子高下文的关连!
这个实测收尾,实在让东谈主惊艳。看来,Grok这个模子,不单是是读懂字幕,而是确实的性能擢升。
AI 36秒看完30分钟,那东谈主类干嘛?
30分钟的信息量,36秒AI就能看已矣,险些是降维打击。
泡一杯咖啡的功夫,AI就能把一部微电影或一集播客的中枢金句和逻辑头绪,一起放在你面前。
关于信息大爆炸确现代网友来说,这个功能果然救星。
有东谈主暗示:救命,我太需要这个了!因为面前的播客都太长了!
这不即是为我储藏夹里那些听不完的播客量身定制的?

有东谈主感触说,畴昔已来。不是因为它的速率,而是从此,许多事咱们再也不需要亲身脱手了。

而网友共享的案例中,最让东谈主动容的是,是底下这个真实的故事。
有东谈主共享说,我方的祖母跌倒了,髋部骨折。他用Grok分析了马斯克在达沃斯论坛上的演讲,收尾,Grok找到了有效的收尾,还定位了精准的时期戳。

这一刻,AI真的帮咱们从海量信息中,捞出来那一根救命稻草。
不外,这就留住了一个问题:那东谈主类去干嘛呢?


细念念极恐——咱们正在把大脑外包出去?
有学者写了一篇小作文,号称对东谈主类侥幸的终极拷问。
她教会:这么下去,东谈主类会丧失阅读、写稿、批判性念念考的智商——因为咱们把大脑该干的活,全外包了!

咱们的大脑像肌肉相同,会用进废退。
深度阅读、握续专注、挂念回溯、批判性念念维、写稿与话语推理——这些智商一朝被外包,都会退化。
你以为,你每天不错耗尽几百条36秒纲目,但推行上,你你丧失了在冗长对白里捕捉玄妙情态的智商,丧失了在复杂逻辑中抽丝剥茧的耐烦。
以至,她援用了《圣经·箴言》19:2。
心无常识的,乃为不善;脚步急快的,不赦罪人。
天主策画咱们以合理的节律去阅读、消化、意会。东谈主亲手制造用具,然后向它们折腰膜拜——这是现代版的科技偶像珍贵。
这种对速率的病态追求,会让东谈主生造成追赶多巴胺的竞走,却无暇顾及真的的兴味。
东谈主类的灵魂,真的能外包吗?