《牡丹记》选择鱼玄机作为人物原型——她在文学史中以女诗人的身份被人们记住,却同时又被大量带有道德评判的传闻所包围,真实与想象在她的身上长期交织。这种不断被书写与重构的女性形象,与影片希望探讨的主题相契合。影片融合中国志怪叙事与超现实视觉风格,以中国传统纸塑非遗文化为主要视觉形式,并在视觉上选择“宣纸”作为主要材质。一方面,鱼玄机的诗歌书写与纸张媒介天然相关;另一方面,纸张具备撕裂、燃烧、渗透与重组等可变形特征,能够将人物命运转化为可见的物质变化,将叙事推进与材质变化结合起来,呈现女性在传统封建社会结构性压迫中的命运。
在制作流程上,剧本由创作者自行撰写,并将每个段落拆解为构图、机位、景别等视觉参数,再使用豆包(Doubao)文生图模型生成分镜草图。通过多轮提示词迭代与筛选,逐步确定镜头结构与人物姿态。这一阶段主要用于建立叙事节奏与镜头逻辑,并为后续关键帧制作提供结构参考。
关键帧制作阶段以 Midjourney V7 为核心模型,通过输入多张参考图(约5–10张)控制人物结构、纸塑材质与空间关系,并结合 style reference 与参数(如风格化程度、随机性)生成不同变体,再将选定的结果作为新的参考图继续迭代,形成循环优化的流程。为解决关键帧之间的不一致问题,团队将生成图像导入 Blender 进行三维重建,重新调整机位后输出不同视角的截图,再回输至 Midjourney,以此稳定镜头之间的空间结构。随后使用 Procreate 与 Photoshop 对关键帧进行人工修正,减少边缘扭曲与材质漂移问题。
在动画生成阶段,使用 Seedance 2.0 将关键帧扩展为连续镜头,并采用首尾帧锚定与过渡帧补充的方式保持时间连贯性。对于复杂的人物形态变化或镜头运动,先使用 Midjourney 生成中间状态作为过渡帧,再输入 Seedance 进行连续生成。同时,在部分段落中引入真人动作视频作为运动参考,帮助模型生成更稳定的人物动作与镜头推进。该阶段通过关键帧条件控制、跨模型过渡帧与动作参考输入相结合,减少生成视频中的时间漂移与结构跳变。
后期阶段在剪映(CapCut)中完成拼接与校正。由于不同镜头由模型独立生成,需要逐帧对齐首尾画面,通过叠化过渡实现平滑衔接,并手动统一色调、光照与材质纹理,减少段落之间的视觉差异。同时通过调整播放速度与镜头顺序构建整体节奏,并在此阶段加入字幕与书法元素,完成视觉结构的整合。
声音部分采用多模型协同的方式:高潮段落的音乐《卖残牡丹》由 VidMuse AI 通过交互式提示生成;童年回忆段落的人声先由 Mureka AI 基于《青莲乐府》参考生成,再输入 Suno AI 扩展为完整音乐,随后在剪映中分离音轨并由真人重新演唱。部分环境声与人物声音由模型生成,并与素材库音效相结合,最终通过手动标记节拍并与画面对齐,使音乐变化与画面节奏同步。