
《Ser Loras》幕后故事
May 2026
我最近一直在开发一个短片项目,暂定名为Ser Loras。故事围绕着一位身形矮小的骑士展开——他是一个小女孩想象力的产物——在一栋空荡荡的房子里苏醒。他身负一卷卷轴,穿行于一个草叶化作茂密森林、床架如同险峻悬崖般耸立的世界。他的使命单纯而私密:在女儿充满生机的画作与父亲心事重重的现实之间,架起一座桥梁。
这个项目最引人入胜之处,在于对尺度的操控。透过Ser Loras的眼睛,一间平凡无奇的卧室被重新想象成一片辽阔的天地。日常物件失去了它们的家居功能,获得了史诗般的比例:一本图画书变成了阶梯,一盒蜡笔化作建筑用的木材,地板上的一幅素描则成了宽阔的通衢大道。这场冒险的魅力并非源自高奇幻的套路,而是源自透过微缩视角对日常事物的彻底重新诠释。
然而,当这个构想需要与AI对接时,便出现了一个重大的技术难题。传统的生成式模型天生倾向于遵循现实世界的比例,常常会在不经意间把主角放大,或让环境的空间逻辑在不同画面之间发生漂移。在一个以“渺小”为核心特征的项目中,哪怕Ser Loras的身高出现极其微小的不一致,也会瞬间瓦解整部影片的镜头幻觉。
因此,难点并不在于创作单张唯美的画面,而在于在整个镜头序列中维持严格的比例连续性。Ser Loras 必须始终保持一个仅有几厘米高的身躯。一个普通的抽屉拉手必须始终呈现出巨大铁环般的存在感,而孩子的画作也必须始终如地毯般辽阔。每一件家居物品都必须既让人信服它是日常工具,又能作为一处需要攀爬或穿越的雄伟地形。
为了解决这个问题,我将整个工作流构建成一场关于 AI 驱动一致性的实验。首先在 Blender 中搭建一个简易的 3D 环境,我便可以锁定摄像机角度,建立一个明确的空间蓝图。随后,这些截图会被转换成中间草图,为 Nano Banana 提供清晰的结构指引,同时去除原始 CG 的数字痕迹。这个流程确保 AI 能够遵循底层的空间逻辑,为这个统一且真切微小的世界注入生命力。

如果唯一的目标是掌握构图和比例,最直接的方法就是把 Blender 截图直接输入 Nano Banana 进行照片级真实感渲染。我最初也尝试过这种方式,它确实能够很好地锁定摄像机角度、家具摆放和角色比例。对于这样一个项目来说,这些细节至关重要。由于 Ser Loras 只有几厘米高,哪怕比例上出现一点微小的偏差,都可能瞬间打破他微缩存在的幻觉。
然而,难点在于 Blender 截图本身就带有浓重的 3D 渲染痕迹。材质、光照和几何边缘都已经在一定程度上被预先设定。由于我必须限制提示词以保留空间布局,Nano Banana 往往会变得过于保守。它并没有真正地重新诠释这个场景,而只是在打磨现有的 3D 素材。结构虽然准确,但最终画面往往仍带有一种合成感——边缘过于锐利,材质也显得生硬刻板,缺乏真实镜头所具有的那种有机的不完美感。
这正是我引入中间草图步骤的原因。草图保留了最基本的结构蓝图——透视、比例和物体轮廓——同时剥离了原始 Blender 材质所带来的数字化厚重感。Nano Banana 不再是在修补一张 CG 渲染图,而是在解读一份清晰的视觉指引。这让 AI 拥有更大的创作空间,从零开始重建光照、表面质感和照片般的景深。
归根结底,这套工作流的核心在于平衡技术上的精准与影像上的真实感。Blender 提供了必要的空间逻辑,草图去除了残留的 CG 痕迹,而 Nano Banana 最终为这个微缩世界注入了真人实拍般的生命力。
为了降低复杂镜头序列中连续性崩溃的风险,我采用了一种方法:将大幅度的动作拆解为若干个独立的特写镜头。与其强迫生成式模型去合成一个单一、面面俱到的镜头——展现骑士打开抽屉并取出画作的全过程——我更倾向于将叙事拆分成可管理的动作节拍。整个序列被重新构思为一系列亲密的瞬间:最初够不到把手的失败尝试、巧妙利用一本图画书进行战术定位、借助蜡笔盒获得的岌岌可危的高度、蜡笔散落带来的自然混乱,以及最终取回画作的时刻。这种细粒度的处理方式确保每一帧画面都拥有单一、清晰的目标和更简化的空间关系。通过降低每个镜头的视觉密度,我能够更严格地维持项目所需的核心比例与构图,从而绕开 AI 常见的形态漂移和透视畸变问题。最终,这一技术上的必要之举,已经发展成为这部影片视觉语言的核心组成部分,进一步强化了 Ser Loras 那种沉浸式的微观视角。

目前,这套工作流大部分都是在 flick.art 中完成的。我主要使用 Nano Banana 进行图像生成与优化,然后根据每个镜头的具体需求,结合 Kling 和 Seedance 将图像转化为视频。这个过程并不是输入一条提示词然后坐等最终结果,而是在构图、比例、角色一致性和可控运动之间不断地反复打磨。
对我而言,Ser Loras 不仅是一个短片项目,更是一次关于 AI 影视制作工作流程的实验:如何让模型服务于连续的空间、一致的角色和清晰的叙事逻辑,而不是仅仅生成一张张美丽的独立画面。我希望这个过程能对其他在 AI 影视创作中面临类似挑战的创作者有所帮助,尤其是那些正在攻克角色一致性、空间连续性、比例控制以及复杂动作分解等问题的人。
.