GPT-6最佳拍档=字节Seedance

大模型智能 · 人工智能

大模型智能 2026-09-07 00:00 吉林 Sora:那我呢??? 大模型智能|分享 来源 | 量子位 作者 | 闻乐 GPT-6 咋跑去给 字节Seedance 打工了??? 而且这一打,还是身兼数职的那种—— 写故事、搭场景、摆演员、定机位、做分镜、生成视频、剪辑成片…… 好好好,这波是GPT-6负责当导演,Seedance2.5负责出片。 表面上看,是两名动漫角色在日式街巷里拔刀对砍。 镜头一会儿从屋檐掠过,一会儿贴着人物快速推进,角色从对峙、冲刺到近身交锋,前后几个镜头还能保持在同一片场景里。 放在现在的AI视频圈,单看成片可能还不至于让人当场瘫坐(doge)。 但你再看看Higgsfield交给Astra的任务: 想一个剑斗故事,在Blender里完成预演,使用Seedance 2.5生成镜头,再把这些素材剪成最终版本,同时保持角色与场景一致。 也就是说,人类只给了一段总要求,剩下从Brief到最终导出,GPT-6 Astra自己在桌面上全包了。 不er,GPT-6发布会上还在KiCad里画电路板、在Blender里盖房子—— 这才过去两天,网友已经顺手给它安排进影视基地了。。。 01 GPT-6当导演,Seedance负责把戏演出来 整条实现路径,看起来多少有点像一个AI版动画剧组。 GPT-6 Astra拿到任务之后,首先要做的是从头编出一个能拍的故事。 谁和谁打、为什么打、在哪里打、动作怎么推进、需要几个镜头,这些东西得先捋明白。 故事有了,它再打开Blender。 根据剧情把街道、房屋、人物和道具先搭成一个相对简化的3D场景,然后把两个角色放进去,安排他们在不同镜头里的位置和移动路线。 这一阶段做的就是 Previs影视预演 。 这么折腾一圈之后,整场打戏其实已经在Blender里用3D模型排练过一遍了。 GPT-6 Astra随后根据预演画面,继续生成不同镜头对应的参考帧,再把角色形象、场景画面和动作参考交给Seedance 2.5。 到这一步,字节Seedance才正式进组。 它负责把静态的参考帧和粗糙预演,转成真正带有人物动作、镜头运动和动漫质感的视频。 当然了,生成完成之后,Astra还没下班。 它再把Seedance生成的各段素材拖进剪辑工具,挑选镜头、排时间线、拼出完整版本,最后导出成片。 更准确地说,是GPT-6把多个工具和模型攒成了一间临时片场: GPT-6 Astra写故事、操作Blender完成预演,再调用Seedance 2.5生成正式镜头,最后回到桌面完成剪辑和导出。 人类搁外面等着收片。。。 什么AGI先放一边, Seedance 2.5这波接得确实挺稳 。 紧接着,网友又把这套玩法搬去了 木叶村 。 Astra先把场景做成3D Blockout,也就是只保留建筑结构、人物位置和大致空间关系的简模。 然后在Blender里提前架好6台摄影机,分别决定6个镜头怎么拍。 镜头确定之后,每个切点都会导出一张画面。 这些画面再交给 GPT Image 2 进行细化,把原本粗糙的3D灰模变成带有火影风格的关键帧。 最后,Seedance 2.5登场,一条30秒、包含6个镜头的木叶村同人短片,就这么给攒出来了。 动画还没拍够,GPT-6和Seedance又对中国短剧下手了。 这次的玩法更抽象,一句话,把一部30集中国短剧改成美国版。 在对比视频里,故事主线和镜头节奏基本照搬,但人物、场景、语言以及文化背景全部换了一套。 中国AI演员脸换成美国AI演员脸,原来的房间、街道和服装被重新生成,画面构图和人物动作则尽量跟着原片走。 02 GPT-6、Fable5.1、Gemini 3.8全来找Seedance拍片了 而且吧,跑来找Seedance搭班子的还不只GPT-6。 这两天, GPT-6 Astra、Fable 5.1、Gemini 3.8 Flash 轮流写Prompt,然后统一交给Seedance 2.5拍成视频。 好好好,Seedance直接:开机!!! 同一份Brief到了不同模型手里,还真拍出了三股味儿。 有的版本把重点放在人物动作上,镜头跟着事件快速推进;有的更强调构图、光线和氛围,整体看起来更像经过分镜设计;还有的严格沿着任务往下执行,信息给得完整,但导演感相对没那么强。 GPT-6 Astra和Fable 5.1还被抓去连考好几轮,依旧是Seedance 2.5。 比如,手绘日式怪谈: 或者,水墨动画: 先别管GPT-6和Fable谁赢,Seedance这水墨效果确实有点东西。 一圈对比下来,三家大模型的胜负还没吵明白,字节Seedance倒先稳坐片场C位了。。。 03 Seedance下班之后,GPT-6又去DaVinci当调色师了 从片场下班之后,GPT-6紧接着又去兼

查看原文