GPT-6怎么跑去字节跳动打工了?而且这一打,就是身兼数职——写故事、搭场景、摆演员、定机位、做分镜、生成视频、剪辑成片……表面上看,是两名动漫角色在日式街巷里拔刀对砍。镜头从屋檐掠过,贴着人物快速推进,角色从对峙到近身交锋,前后镜头保持在同一场景。放在现在的AI视频圈,单看成片可能还不至于让人当场瘫坐。但你再看看Higgsfield交给Astra的任务:想一个剑斗故事,在Blender里预演,用Seedance 2.5生成镜头,剪成最终版本,同时保持角色与场景一致。也就是说,人类只给了一段总要求,剩下从Brief到最终导出,GPT-6 Astra自己在桌面上全包了。
GPT-6在发布会上还在KiCad里画电路板、在Blender里盖房子,两天后网友已经给它安排进影视基地了。GPT-6当导演,Seedance负责把戏演出来,整条实现路径就像一个AI版动画剧组。拿到任务后,Astra首先要编出一个能拍的故事:谁和谁打、为什么打、在哪里打、动作怎么推进、需要几个镜头。故事有了,它打开Blender,根据剧情搭建街道、房屋、人物和道具,安排位置和移动路线。这就是影视预演。折腾一圈后,整场打戏已经在Blender里用3D模型排练过一遍了。随后,GPT-6根据预演画面生成不同镜头的参考帧,把角色形象、场景画面和动作参考交给Seedance 2.5。到这一步,字节Seedance才正式进组,负责把静态参考帧和粗糙预演,转成带有人物动作、镜头运动和动漫质感的视频。生成完成后,Astra还没下班,它再把素材拖进剪辑工具,挑选镜头、排时间线、拼出完整版本,最后导出成片。更准确地说,GPT-6把多个工具和模型攒成了一间临时片场,人类在外面等着收片。
网友又把这套玩法搬去了木叶村。Astra先做3D Blockout,只保留建筑结构、人物位置和空间关系,在Blender架好6台摄影机,导出6张画面。这些画面交给GPT Image 2细化,变成带有火影风格的关键帧。最后Seedance 2.5登场,一条30秒、包含6个镜头的木叶村同人短片就出来了。动画还没拍够,GPT-6和Seedance又对中国短剧下手了。这次玩法更抽象,一句话把一部30集中国短剧改成美国版。在对比视频中,故事主线和镜头节奏基本照搬,但人物、场景、语言以及文化背景全部换了一套。中国AI演员脸换成美国AI演员脸,原来的房间、街道和服装被重新生成,画面构图和人物动作则尽量跟着原片走。
GPT-6、Fable 5.1、Gemini 3.8全来找Seedance拍片了。GPT-6 Astra和Fable 5.1轮流写Prompt,统一交给Seedance 2.5拍成视频。同一份Brief到了不同模型手里,还真拍出了三股味儿。有的版本重点放在人物动作上,镜头快速推进;有的更强调构图、光线和氛围,像经过分镜设计;还有的严格按任务执行,信息完整但导演感稍弱。GPT-6 Astra和Fable 5.1还被抓去连考好几轮,依旧是Seedance 2.5。比如手绘日式怪谈,或者水墨动画。先别管GPT-6和Fable谁赢,Seedance这水墨效果确实有点东西。三家大模型的胜负还没吵明白,字节Seedance倒先稳坐片场C位了。
Seedance下班之后,GPT-6又去DaVinci当调色师了。这次GPT-6打开的是DaVinci Resolve。网友给了GPT-6 Astra一张参考图片,让它像专业调色师一样,把原视频的颜色调成相近风格。它观察参考图的色温、对比度、阴影、高光和整体色彩倾向,再操作DaVinci里的调色工具,一点点修改视频。最后用时4分钟的效果如下:从前后对比来看,原视频整体偏平、偏灰,处理之后色调明显更浓,阴影被压低,画面冷暖关系更接近参考图。当然,网友对于这位AI调色师的评价就没有动画短片那么一致了。有人觉得4分钟完成参考图风格匹配确实方便;也有人毫不留情地表示,调完之后反而更难看。调色应该服务于故事,颜色本身也可以是叙事母题,AI显然还无法真正理解这些创作意图……只能说,很有影视行业传统艺能,工具刚刚进组,审美之争已经先打起来了。
发布会上,OpenAI还在努力证明Astra可以操作各种专业软件,到了网友手里,使用说明已经被玩出花了。至于Seedance——人在字节坐,GPT-6莫名其妙就成了它的最佳拍档。Sora:那我呢???
