Tom 与布偶猫 Kerena 玩耍 — Neta Studio AI 影片

最终影片:Tom 与布偶猫 Kerena 玩耍

五秒钟。在 1944 年阳光照耀的霍格华兹露台上,Tom Riddle 将羽毛逗猫棒朝一只白色布偶猫放低——而在这短暂的一刻,害怕死亡的男孩让她赢了。

Tom 与布偶猫 Kerena 玩耍是来自Kerena Category系列的 5 秒、16:9 写实真人短片,在 Neta Studio 中生成。这是系列的 CLIP 04:身为阿尼马格斯的 Kerena 全片都维持布偶猫形态,而 Tom 始终清楚可辨地是他自己——克制、带着淡淡的玩味,从不逼近她。

三个硬切承载了这个节拍。Tom 注意到猫并放低逗猫棒;他以一个小弧线拉动羽毛,Kerena 受控地扑上去;她抓住羽毛,而他放松绳索,让她保有胜利。没有对白,也没有音乐——只有场景内声音:柔和的微风、爪子轻踏石面的声音、羽毛与绳索的沙沙声,以及 Tom 安静的呼吸。

立即观看: Tom 与布偶猫 Kerena 玩耍 →

影片

16:9 横向 · 5s · 30 fps · omni-reference 真人实拍 — 使用三个锁定的参考生成:Tom 的无长袍制服设定表、Kerena 的布偶猫阿尼马格斯设定表,以及霍格华兹露台世界场景图。影片使用 Seedance 2.0(seedance-2-0)渲染。

下载 MP4 →

制作方式

制作流程解析

阶段 1:世界观与视觉开发gpt-image-2
Kerena Category 系列始于一个简短前提:一个 1940 年代的霍格华兹 AU,其中 Tom Riddle 保持与原作核心一致,而 Kerena Spencer-Moon 是唯一一个他永远无法转化为资源的人。Neta Studio 将这句话发展成完整的黑暗浪漫世界——角色、地点、时间线,以及 Argent Sight 的规则——并开发出贯穿其中的绘画感半写实风格。在任何影片存在之前,演员与场景都先被渲染成绘画式封面。
阶段 2:参考锁定与连贯性gpt-image-2
在单一画面开始移动之前,三个参考已锁定影片。image_1 是 Tom 穿着 1944 年霍格华兹无长袍制服的完整角色设定表——苍白的少年脸庞、深色波浪发、带绿色饰边的炭灰色 V 领毛衣、白衬衫、绿色条纹领带、黑色长裤。image_2 是 Kerena 的阿尼马格斯设定表:一只带柔和灰色斑纹的白色布偶猫、灰绿色眼睛、蓬松的胸前毛领与柔软蓬松的尾巴。image_3 是霍格华兹露台世界场景图——灰色石造拱廊、栏杆、阳光照耀的草坪、修剪整齐的树篱与远方森林。提示词告诉 Seedance 必须完全匹配这三者。
阶段 3:多重参考提示词与场面调度seedance-2-0
制作提示词以 omni_reference 任务执行:三个锁定的身份、一条固定的 180 度摄影机轴线,以及羽毛逗猫棒的严格道具路径——逗猫棒放低、绳索伸出、羽毛掠过石面、Kerena 伸手,她在 Tom 握住把手的同时抓住羽毛。每次切换后 Tom 都位于画面右侧,Kerena 位于画面左侧/下方中央,而世界场景图维持露台、时间与光线方向。结果是一张包含纯场景内声音音轨且没有对白的三镜头节拍图。
阶段 4:迭代与淘汰版本seedance-2-0
不是每一次生成都成功。世界的制作日志保留了失败的 Seedance 2.0 镜头,包括一个始终未能解决的早期直式 9:16 开场,以及第一支必须重新撰写提示词、才能成功生成的「A Tiny Hello」片段,也一并保留了已被取代的早期剪辑版本。每一次失败都直接在提示词中修正,透过加强身份锁定、空间轴线与道具连贯性,而不是在后期制作中修补。当三个参考素材与场面调度稳定下来后,CLIP 04 便顺利完成。
第 5 阶段:单次生成与发布seedance-2-0
Seedance 2.0 根据三张参考图片与完整的动态提示词,在一次生成中完成了 5-second、16:9 的成片:放低的魔杖、跟拍式扑跃、接住,以及 Tom 让她赢。完成的档案会立即发布为可分享的连结,可在任何浏览器中播放,并与世界中的其他片段并列,随时可以重新混剪成更长的版本。

生成提示词

CLIP 04:TOM 与 RAGDOLL KERENA 玩耍

[参考图] 参考映射

<<<image_1>>> = TOM 完整角色参考——无长袍制服。
仅用于锁定Tom的完整角色身份、脸部、发型、年龄感、身体比例、1944 Hogwarts无外袍学生制服、裤装结构和整体可识别性。identity = 仅限提供的参考图像。不复制原图姿势、构图、背景或光线,不重新设计Tom。

<<<image_2>>> = KERENA 阿尼马格斯角色参考——布偶猫。
仅用于锁定Kerena在本片中的Ragdoll猫形态、猫的身份一致性、毛发图案、眼睛、体型、尾巴、脸部轮廓和爪子细节。identity = 仅限提供的参考图像。Kerena在整段影片中保持猫形态,不变回人形,不改变品种或体型。

<<<image_3>>> = 仅限 HOGWARTS 南露台世界场景板。
仅用于锁定户外场景的建筑、灰色石拱门、石质露台、低矮石栏杆、开阔草坪、修剪整齐的树篱、远处森林、前景植物、时间、天气、光线方向和空间连续性。不要复制原图人物、原图姿势或原图构图。<<<image_3>>>不控制Tom或Kerena的身份。

猫咪逗引棒是动作所需的原创场景道具,不是角色参考:一根短小的深色木杖,带细绳和一小簇柔软的奶油色羽毛。全片保持相同玩具设计。

格式

时长:5 seconds。
画面比例:16:9。
模型:Seedance 2.0。
制作工作:omni_reference。
模式:多参考实景拍摄。
帧率:30fps。
视觉风格:超写实实景、自然电影感创作者 vlog 写实风格、明亮温暖的 Hogwarts 户外日光。不是 CGI,不是游戏引擎,不是 3D 动画。

场景与氛围

明亮午后日光下的 1944 Hogwarts 户外露台。Tom 使用羽毛逗引棒安静地与Ragdoll猫形态的Kerena玩耍,让她的注意力在阳光照耀的石面上移动,不强迫接触。氛围亲密、俏皮而克制:Tom保持镇定并略带玩味,而Kerena的好奇与本能兴奋透过眼睛、爪子、尾巴和短促动作清晰呈现。没有人直接对着镜头表演。

镜头安排

镜头 1 (0.0s-1.5s):中广角建立镜头;Tom注意到Ragdoll猫,将羽毛逗引棒放低到石面附近。
镜头 2 (1.5s-3.4s):低机位亲密中景;Tom小幅弧线移动玩具,Kerena跟随、伸爪并完成一次受控扑跃。
镜头 3 (3.4s-5.0s):更紧凑的双主体收束;Kerena抓住羽毛,Tom让她获胜,最后一帧停留在两者安静的交流。

主体锁定

Tom:identity = 仅限 <<<image_1>>>。保持提供的脸部、头发、年龄、身体比例和无长袍 1944 Hogwarts 制服完全一致。Tom全程保持人类,不得身份漂移、年龄漂移、服装变更或脸部变形。表演沉着、冷淡、安静、克制而聪明;不要夸张喜剧。

Kerena:identity = 仅限 <<<image_2>>>。保持提供的Ragdoll猫身份、毛色图案、眼睛、毛发蓬松度、尾巴和身体结构完全一致。Kerena全程都是真实的实体猫,绝不变成人、其他品种或普通猫。动作好奇、温柔、亲暱而警觉。

调度:Tom保持在画面右侧至右中,靠近猫但绝不拥挤或踩到她。Kerena保持在画面左侧至下方中央,只在同一石质露台平面上移动。两者均位于<<<image_3>>>建立的地理空间内。

道具路径:
羽毛逗引棒起初在Tom右手中。木杖向石面降低 → 细绳自然伸展 → 羽毛掠过并略高于露台表面 → Kerena追踪并用两只前爪伸抓 → Kerena抓住并抱住羽毛簇,而Tom右手仍握着木杖手柄并放松细绳。玩具始终是一个连续物体;不得瞬移、复制、漂浮或无法解释地改变。

跨帧规则

维持连续的 180 度摄影轴线。每次剪接后Tom保持画面右侧,Kerena保持画面左侧/下方中央。保留<<<image_3>>>中的同一露台、拱门、栏杆、草坪、树线、前景植被、午后时间和暖光方向。Tom的右手始终是握逗引棒的手。Kerena的爪子、体重、尾巴和毛发维持真实接触与后续动作。剪接之间不得重置任何角色、玩具或背景元素。可改变摄影距离,但画面方向与空间关系固定。

动作

镜头 1 — 0.0s-1.5s:
摄影机:克制的中广角实景构图,50mm 全片幅等效,胸口高度,细微手持呼吸感,向猫咪逗引棒缓慢受控向下倾斜。
动作:Tom在画面右侧站立或放低身体成放松的半蹲。他注意到左下方石面附近的Kerena,用右手放低羽毛逗引棒并轻轻邀请地抖动一次。Kerena先转头,然后双眼锁定羽毛;胡须、耳朵和尾巴自然微调。
表演:Tom脸部保持镇定,眼睛周围只有极细微的柔和变化。Kerena警觉但不害怕。
结束状态:羽毛悬在两者之间、距离石面几 centimeters;Kerena清楚追踪它;Tom尚未碰到她。
硬切。

镜头 2 — 1.5s-3.4s:
摄影机:同一轴线的低机位亲密中景,65mm 全片幅等效,焦点从羽毛转移到Kerena的眼睛和前爪,中等且清晰可读的景深。
动作:Tom让逗引棒在Kerena伸手不可及处做一次小幅左至右弧线。Kerena用头部和肩膀跟随,轻踏两步,接着完成一次短促受控扑跃。爪子接触时细绳短暂绷紧;Tom轻微自然反拉,邀请游戏继续。
表演:Tom保持安静并略带玩味,克制的近乎微笑绝不变成夸张笑容。Kerena的好奇变成玩耍中的专注;眼睛始终盯着羽毛,尾巴轻柔扫动一次以保持平衡。
物理:爪子以可信重量接触石面;落地时毛发略微压缩;细绳带着真实延迟跟随木杖;羽毛因空气阻力飘动。不要漂浮的猫、橡皮般动作或瞬移。
结束状态:Kerena的前爪靠近羽毛,玩具仍由Tom握住,两个主体都清晰可见。
硬切。

镜头 3 — 3.4s-5.0s:
摄影机:更紧凑的双主体构图,50mm 全片幅等效,仅细微且有动机的推近,焦点先保持在Kerena的爪子,再落到Tom的脸部,同时不丢失玩具。
动作:Kerena用前爪抓住羽毛簇,轻轻用嘴咬或用爪拨弄。Tom立即放松细绳,让她保有小小胜利。他略微放低手柄,注视她一拍,让空着的左手自然垂在身旁,不抓她。Kerena从羽毛抬眼望向Tom;尾巴在身旁安定下来。
表演:Tom的克制化为仅在眼睛和嘴角可见的真实微笑。Kerena显得满足且投入,绝不卡通化。动作以安静共享的时刻结束,而非大型反应。
结束状态:Kerena用爪子控制羽毛簇;Tom仍控制木杖手柄;两者在同一画面中,石拱门和阳光草坪在背景清晰可辨。

微动作

Tom自然呼吸、不规律眨眼、细微调整手腕,让袖子和领带随每次动作沉降。Kerena的胡须、耳朵、眼睛、爪子、尾巴和毛发持续呈现细小自然的动物动作;胸口随呼吸起伏,接触时毛发压缩。羽毛和细绳回应每次手部与爪子动作。不要僵住的姿势。

对白与嘴型同步

无对白。无旁白。无歌唱。无字幕、说明文字、画面文字或额外声音。仅限场景内声音。

最后一帧

在 5.0 seconds 时,停留在可读的中景构图:Tom仍在画面右侧,穿着同一套无长袍 1944 Hogwarts 制服,放松地低头看向Kerena。Kerena仍在画面左侧/下方中央,保持Ragdoll形态,身体确实落在石质露台上,两只前爪之间抱着奶油色羽毛簇。Tom右手仍握着逗引棒手柄,细绳放松。<<<image_3>>>中的灰色石拱门、栏杆、阳光草坪和远处树线仍可辨认。暖光保持一致。无文字、字幕、说明文字、标志、介面或浮水印。

世界场景板

仅将<<<image_3>>>用作环境与空间锚点:Hogwarts风格灰色石质露台、古老拱门、石质栏杆、宽阔绿色草坪、修剪整齐的树篱、远处森林边缘、前景植被和温暖午后日光。在同一地理空间内允许新的摄影机构图。不要将场景移到室内,也不要改变天气、季节、时间、建筑或光线方向。

声音底床

仅限场景内声音:柔和户外微风、远处叶声、轻微草地动静、爪子轻敲石面、羽毛和细绳的细微摩擦声、轻微衣料移动声,以及Tom安静的呼吸。无音乐、配乐、歌词、旁白、对白或额外声音。所有声音自然且克制。

捕捉写实感

超写实实景人类与动物摄影。保留自然皮肤质感、单根发丝、真实织物纹理、可信的针织制服材质、浓密Ragdoll毛发、胡须、肉球、羽毛纤维、细绳张力、石材纹理、草和植被。使用真实接触阴影、重力、惯性、爪子压力、毛发压缩、衣料沉降和自然运动模糊。Tom和Kerena必须感觉真实存在于同一空间。不要塑胶皮肤、蜡质头发、合成毛皮、扁平 CGI 表面、游戏引擎渲染或人工美化滤镜。

摄影机捕捉

Seedance 2.0 实景捕捉。16:9 横向构图,30fps,镜头 1 和镜头 3 约 50mm 全片幅等效,镜头 2 约 65mm,自然光学景深、中等背景分离、清晰可读的羽毛和爪子、柔和高光过渡、克制手持呼吸感和细微电影质感。每个镜头只使用一个主要摄影机动作:受控向下倾斜、带焦点转移的受控重新构图,然后细微推近。不要环绕、360 度移动、甩镜、数位变焦、摄影机变形或自动对焦搜寻。

负面限制

不要身份漂移、脸部变形、年龄改变、人类Kerena、以普通猫取代Kerena、品种改变、Tom重复、猫重复、额外前景人物、现代服装、Tom外袍、服装变更、猫瞬移、漂浮的猫、不可能的爪子结构、额外肢体、羽毛玩具复制、漂浮的玩具、细绳穿模、玩具瞬移、夸张喜剧、卡通表演、夸张微笑、动物说话、对白、旁白、音乐、字幕、说明文字、文字、标志、浮水印、介面、CGI外观、3D动画、游戏引擎表面、过度锐化、光亮 AI 皮肤、光线改变、地点改变、损坏的 180 度轴线或剪接间重置。

资产提示

种子参考 —「Tom Riddle,无长袍制服」(image_1)gpt-image-2
1944 年霍格华兹学生制服中的 Tom Riddle 角色设定表,未穿外袍:展示正面、背面与特写视图,包含少年苍白的脸庞、深色自然卷曲的头发、带绿色滚边的深色毛衣、白衬衫、绿色条纹领带、配有真正可使用的左前方裤袋的黑色长裤,以及黑色鞋子。
种子参考 —「Kerena Animagus,布偶猫」(image_2)gpt-image-2
Kerena Spencer-Moon 的布偶猫形态 Animagus 角色设定表:白色长毛皮毛,带柔和灰色斑纹、灰绿色眼睛、蓬松的胸毛、毛绒绒的尾巴、柔和圆润的五官,以及温柔亲人的性格。包含多个正面、侧面、背面、脸部、尾巴与爪子的视图。
种子参考 —「霍格华兹露台世界场景板」(image_3)gpt-image-2
受霍格华兹启发的户外露台场景:宽阔阳光草坪边缘的古老灰色石造拱廊、修剪整齐的树篱、远方森林、石制栏杆、柔和温暖的午后晚些时候日光,以及营造自然取景视野的前景植被。

参考画面

为什么选择 Neta Studio

专业 — 从一句话的创意到完成的电影感短片,完整工作流程皆在云端执行,无需本机设定,并稳定存取最新模型:GPT Image 2 · Seedance 2.0。

一键生成 — 官方调校的技能驱动每个步骤:世界建构、角色设定表、世界场景板、多重参考影片生成、移除背景的精灵图,以及立即发布至可分享连结,任何浏览器都能播放。

社群与 IP 优先 — 保留每个画面、提示词、参考素材与精灵图。随时将这个露台场景重新混编成更长的电影、游戏,或全新的世界。

工作室内部

观看与探索

这部 5-second 多重参考电影由 Neta Studio AI 根据一句话的世界概念与三张锁定的参考图片生成。世界在几分钟内完成。影片也在几分钟内完成。你也可以做到 — 探索这个世界,或从任何想法开始创作。无需编程。免费开始。

×