70万人争先体验!视频生成新王者「可灵AI」又双叒升级了
要说最近什么最火,视频生成AI的Demo一个接一个往外冒,从玩梗图到拼时长,再到硬磕物理逻辑,各家都铆足了劲,恨不得直接叫板Sora。可就在这场混战中,有人不声不响地交出了“电影级”的答卷。
真实风格的光影效果:

天马行空的想象力,杂糅起来也能驾驭:

更有人直接拿它干活了——视频生成AI+音乐生成AI,再配点PS和AE,一首完整的MV就这么出来了。

网友怎么看?他们反倒问一句:“好莱坞你怎么看?”

效果丝滑、精细,社交平台上这样的短视频已经不少了。关键是,它在大幅运动时不会胡乱脑补。比如图生视频——一个奔跑的半人马,动态自然得不像AI生成的。

这些作品背后的模型,正是
快手旗下的大模型「可灵 AI」(Kling)
网页版已经开放,主打简单好用
70万
一月数次升级,可灵 AI 的狂飙式进化
今年是生成式AI的里程碑之年。2月份OpenAI的Sora把竞争拉到了视频生成的高度,但率先落地的,还得看国内公司。
自6月6日正式亮相,短短一个月,快手的可灵AI就经历了三次迭代。从最初的文生视频,到两周后支持图生视频、视频续写、多尺寸选择,它一步步变得全面而强大。不知不觉中,视频生成的各种需求似乎都被覆盖了。
在刚刚结束的世界人工智能大会WAIC 2024上,可灵AI迎来了第三次大升级——发布了一系列新功能,在视频生成质感、美感、可玩性上再上台阶。
快手高级副总裁、快手主站业务与社区科学线负责人
盖坤
高画质版、首尾帧控制和相机镜头控制
首先,
基础模型升级,推出高清画质版
其次,
图生视频增加了“首尾帧控制”功能
效果是这样的:
最后,
增加了运镜控制及自动大师运镜功能
新功能加入后,视频清晰度、美学表现、内容自定义控制都有了肉眼可见的提升。
值得一说的是,
可灵AI网页版已经集成了文生图、文生视频,以及即将上线的视频编辑能力

用“诚意满满”来形容这次的升级一点不为过,背后自然是快手在视频生成能力上的持续创新突破。
「电影级」AI 生成,背后全是技术
相比已经非常成熟的图像生成,视频生成要复杂得多——真实性、动作连贯性、画面流畅性、细节精度、场景角色光影一致性、物理准确性、时长限制……每一项都是硬骨头。这些挑战应对得好不好,直接决定模型的实用性和易用性。
升级后的可灵AI,在以上方面可以说是脱胎换骨。总结起来,
可灵AI拥有七大能力亮点
万鹏飞
前文所展示的高画质版、首尾帧控制和相机镜头控制,正是可灵AI在
电影级高清画面生成、领先图生视频效果、优秀视频生成可控性
电影级高清画面生成
领先的图生视频能力
效果:
优秀的视频生成可控性
同时,可灵AI在运动生成、生成时长、物理规律、指令响应等四大能力上也进一步升级:
一、大幅度且合理的运动生成能力
二、分钟级长视频生成能力
最长生成3分钟视频
三、模拟复杂物理世界特性
四、概念组合和指令响应能力非常强
所有这些能力,又源于可灵AI在技术路线(DiT架构)、模型设计(隐空间编解码、时序信息建模、文本扩展及编码)、数据保障(多维度标签体系、视频描述模型)、计算效率(分布式训练集群、分阶段训练策略)、能力扩展(视频时序延展、多模态输入可控)等方面的积累和创新。技术层面做到了先进且靠谱,难怪一落地就受追捧。
生成式 AI 时代,快手有备而来
过去一年多,大模型领域非常卷。去年都在谈基座模型研发,今年大家又都在讨论应用。WAIC 2024上,我们又目睹了一波“模型派”和“应用派”的争论。在这个浪潮中,快手是怎么做的?
首先,它玩的是体系。从底层的IDC算力中心、网络架构、AI平台,到中层的核心大模型,再到应用层的各类探索,快手实现了全套自主研发。快手副总裁、大模型团队负责人
张迪
整体框架如下:
其次,快手坚持基础模型技术研究和商业应用落地并举的战略。基础模型决定了AI能力上限,研究投入的量变可以引发质变;商业化应用则能滚起技术的雪球——把阶段性成果投入应用,不断收获反馈,形成良性循环。
去年开始,快手推出了“快意”大模型(KwaiYi),从早期的13B参数量发展到175B,并推出了多模态版本。经过多次迭代,快意已在快手内部的素材创作、AI互动、内容生产等场景中发挥作用。今年6月,基于快意的AIGC营销素材单日消耗超过2000万。
有了基础模型,在更多场景上,快手逐渐发展出自己的差异化能力。
在文生图上,快手的“可图”已成为行业内顶尖模型之一,拥有强大的语义理解和指令跟随能力。得益于文本表征创新和图像数据对齐的大量工作,可图能画出摄像级画面质感,经过强化学习训练,审美也与人类标准对齐。
在视频生成上,“可灵AI”点燃了全球新一轮竞争。它可以文生视频、图生视频,拥有丰富的图像编辑能力,在可控性、质感、美感、运动合理度上保持业内领先。工程师们持续进行工程算法优化,力图不断降低视频生成AI的门槛。
说到降低门槛,新技术的优化是当前生成式AI面临的重要挑战之一。作为国民级短视频应用,快手拥有大量AI应用场景,这给了技术落地绝佳的舞台。目前,快手已实现一系列里程碑:
- 在APP评论区内测的对话模型应用“”,可理解视频内容并与用户互动,累计粉丝超1000万。
AI小快
- 电商直播间里,利用文生图AI“”,用户可以用生活照快速试衣,甚至看到动态展示。
可图
- 视频生成模型“”已累计生成700万条视频,开放了一站式内容创作平台。
可灵AI
- 从内容生产、理解到推荐,从个人到电商,快手生成式AI能力已实现主体业务全覆盖,持续推进生态发展。
最后还有一个新尝试——在WAIC上,快手预告首部AIGC短剧《山海奇镜之劈波斩浪》将于本月正式发布。该剧由可灵AI提供深度技术支持,以赛博风格复现《山海经》里上古神话世界。从预告片看,山脉、海洋、森林、天际等场景呈现震撼视觉效果——以往可能需要专业特效团队,现在视觉生成AI就能带来这种体验。
半年前我们还在畅想未来,现在AI真的开始拍电影了。大模型浪潮中,最能证明技术能力的是大规模落地。而快手全方位的实践让我们再次确认:AI的生产力,已在不知不觉中改变着我们的生活。
-
- 关于宇宙的好的网名有哪些
- 角色扮演 | 1
- 网名