字节跳动 Seedance 2.5 发布:30 秒一镜到底…

AI广播站2小时前更新 小悠
6 0 0

字节跳动正式发布 Seedance 2.5 视频生成模型,将单次视频生成时长从 15 秒翻倍提升至 30 秒。该模型将陆续上线即梦 AI 与豆包专业版,API 服务也将于近期接入火山方舟,面向影视、广告、教育、工业制造乃至自动驾驶等多场景开放。

官方称,Seedance 2.5 延续了统一的多模态音视频联合生成架构,核心突破在于长叙事能力、多模态参考和编辑能力的全面提升。简单来说,AI 视频不再只是生成一个零散片段,而是可以完成一段有起承转合的完整创作。

字节跳动 Seedance 2.5 发布:30 秒一镜到底,AI 视频开始会讲故事了

30 秒内组织多镜头叙事,多轮延长保持一致

在官方展示的示例中,一段歌手一镜到底登台演出的片段完整呈现了叙事逻辑:镜头从红色幕布缝隙推进至暖色后台化妆间,年轻女歌手整理耳机,工作人员提醒登台,随后她穿过通道与舞伴互动、接过麦克风,最终登上舞台——镜头拉远至体育馆全景,观众、灯牌、荧光棒和欢呼声尽收眼底。模型可在 30 秒内组织铺垫、推进、转折、收尾等多个逻辑关联的镜头。

多轮延长能力同样惊艳——模型可在已有视频基础上继续生成 30 秒,并保持人物主体、场景、画面风格乃至声音和音效的一致性。官方示例中小男孩抱着足球跑出地铁车厢、男主追赶并最终抓住小男孩的连续动作一气呵成,毫无跳脱感。

30 张图、10 段视频一起投喂,群像叙事无压力

Seedance 2.5 支持用户单次输入最多 30 张图片、10 段视频、10 段音频作为参考素材。模型可综合理解不同素材中的构图、场景、风格、人物和道具等元素,并按指令精准用于视频生成。在多人同框场景中,它还能同时还原多人形象与声音并保持主体稳定——官方展示的 30 秒音乐会片段采用 16 比 9 横屏、电影感写实风格,参考素材覆盖钢琴家、大提琴、小提琴、主唱、管弦乐队、合唱团和观众席。当 AI 视频从"特效玩具"进化到能驾驭完整叙事和群像调度,短视频创作的工具箱恐怕又要重写一回了。

科技圈迎来效率革命,字节跳动旗下Seed团队发布Seedance2.5音视频联合生成模型,主打一镜成片。单次生成时长从15秒延至30秒,并支持多轮无缝延长,让复杂情节更连贯。模型深度优化材质、光影与肤质,有效消除塑料感,实现逼真实拍质感,赋能多个产业场景。

字节跳动Seed团队发布视频创作模型Seedance 2.5,主打“一镜成片”音视频联合生成。升级亮点:单次生成时长提至30秒,支持多轮无缝延长;增强长叙事能力;融合多模态参考与后期编辑。可应用于影视、广告、教育等领域,推动多产业场景智能化创作。

7月30日,字节跳动调整AI架构,将飞书团队拆开,产品团队与豆包整合由赵祺负责,其余并入火山引擎,旨在打破部门壁垒,强化大模型与云服务在企业生产力场景中的协同。

字节跳动发布音频创作模型Seed Audio1.0,已在火山方舟开放测试。它打破传统影视音频需多模型分别生成人声、音效与环境声再人工拼接的冗长流程,实现声音场景一体化创作,确保叙事一致性,标志着AI音频生成进入完整声音场景新阶段。

字节跳动视频生成模型Seedance2.5将于7月16日全量开放API,正式商用,降低高品质视频生成门槛。此前6月23日发布,预告7月初终落地。旗下即梦预热,将推会员折扣。

字节跳动 Seedance 2.5 发布:30 秒一镜到底…

关注 “悠AI” 更多干货技巧行业动态

© 版权声明

相关文章

没有相关内容!

暂无评论

您必须登录才能参与评论!
立即登录
none
暂无评论...