首页 > 教程攻略 > ai资讯 >字节跳动 Seedance 2.5 发布:30 秒一镜到底,AI 视频开始会讲故事了

字节跳动 Seedance 2.5 发布:30 秒一镜到底,AI 视频开始会讲故事了

来源:互联网 时间:2026-08-05 17:39:26

字节跳动刚刚放了个大招——Seedance 2.5 视频生成模型正式发布,单次视频生成时长直接从 15 秒翻倍到了 30 秒。这意味着什么?过去 AI 视频只能拍个“短视频片段”,现在能拍一段完整的“小剧情”了。该模型会陆续上线即梦 AI 和豆包专业版,API 服务也很快接入火山方舟,面向影视、广告、教育、工业制造乃至自动驾驶等场景开放。

image.png

按照官方说法,Seedance 2.5 延续了统一的多模态音视频联合生成架构,核心突破在于长叙事能力、多模态参考和编辑能力的全面提升。直白点讲,AI 视频不再只是生成一个零散片段,而是可以完成一段有起承转合的完整创作——从铺垫到精彩处再到收尾,逻辑自洽。

30 秒内组织多镜头叙事,多轮延长保持一致

在官方展示的示例中,一段歌手一镜到底登台演出的片段完整呈现了叙事逻辑:镜头从红色幕布缝隙推进至暖色后台化妆间,年轻女歌手整理耳机,工作人员提醒登台,随后她穿过通道与舞伴互动、接过麦克风,最终登上舞台——镜头拉远至体育馆全景,观众、灯牌、荧光棒和欢呼声尽收眼底。模型能在 30 秒内组织起铺垫、推进、转折、收尾等多个逻辑关联的镜头,这个连贯性相当惊艳。

多轮延长能力同样让人印象深刻——模型可在已有视频基础上继续生成 30 秒,并保持人物主体、场景、画面风格乃至声音和音效的一致性。官方示例中小男孩抱着足球跑出地铁车厢、男主追赶并最终抓住小男孩的连续动作一气呵成,毫无跳脱感。换句话说,你完全可以先拍一段,再续一段,人物和场景始终稳如泰山。

30 张图、10 段视频一起投喂,群像叙事无压力

Seedance 2.5 支持用户单次输入最多 30 张图片、10 段视频、10 段音频作为参考素材。模型可以综合理解不同素材中的构图、场景、风格、人物和道具等元素,并按指令精准用于视频生成。在多人同框场景中,它还能同时还原多人形象与声音并保持主体稳定——官方展示的 30 秒音乐会片段采用 16:9 横屏、电影感写实风格,参考素材覆盖钢琴家、大提琴、小提琴、主唱、管弦乐队、合唱团和观众席。当 AI 视频从“特效玩具”进化到能驾驭完整叙事和群像调度,短视频创作者的工具箱,怕是又要更新换代了。