全片使用到的文本模型:豆包、Gemini 3.0;图片模型:Midjoureny V7、nano banana pro/2.0、Flux2 max;视频模型:seedance2.0、Wan2.5、可灵3.0/O3/2.6/O1。影片全部是在画布式工作流工具上完成创作,工作流程上整体还是遵循文本模型-图片生成-视频生成-剪辑成片的传统工作流程。有前期灵感创意之后再与豆包和Gmini这样的大语言模型交流沟通,一步步修改剧本,最后完成可执行的剧本与分镜。根据前期准备的分镜后就开始风格的探索和确定,这一阶段主要是MJ和Gemini相互辅助实现,先将脑海中的大概风格与Gemini沟通,使用其生成的不同版本提示词在MJ中生成,根据生成结果不断修改提示词,生成想要的风格之后再让Gemini总结该风格的关键提示词,实现后续风格的一致性。本片在此阶段完成了风格关键词的统一:风格极简主义,野兽派建筑,超现实主义,寂静,压抑,锐利的几何线条,哑光质感,赛博废土美学。之后使用固定的风格提示词开始生成场景概念图、全景图、细节图以及角色三视图和特写图,完成之后就可以开始按照分镜生成图片关键帧。图片生成阶段大部分是使用nano banana pro/2.0生成并且修改,在场景设计方面使用了一些Flux2 max。在seedance2.0上线后,一些图片模型无法生成或者无法做到场景角色一致性的视角、景别,可以通过在seedance2.0中生成视频再截帧让nano banana pro清晰优化的方式得到完美解决。视频生成阶段,大场面或者是人物运动相对比较大,需要较大摄影机调度大镜头通过seedance2.0生成;展现角色细腻表情或者调度不明显的画面使用可灵系列模型和Wan2.5生成。最后在剪辑软件中剪辑成片。