灵曦AI 体验产品

灵曦AI

咖啡店双人对白案例:参考素材、视频抽帧与问题复核

对照林屿与苏晚的角色参考、对白脚本和已有视频,展示发型与字幕的采样观察,并说明文件时长核对方法和检查边界。

直接回答

组织双人对白资料时,先把人物、场景、道具和台词节拍对应到镜头;生成后再对照原始画面与文件信息检查。角色参考明确,并不意味着输出已经满足人物一致性和对白要求。

案例资料中已经有什么

本案例来自“geo演示”的已授权项目资料。角色是林屿与苏晚,关键道具是速写本;场景从咖啡店黄昏吧台推进到夜色暖光。林屿的设定锚点包括黑色短发、黑色细框眼镜、浅灰色针织开衫和深棕色帆布斜挎包;苏晚的设定锚点包括深棕色中长发、半丸子头、米白色短袖衬衫、米色围裙和右手腕细银手链。[3]

林屿角色设定图,展示黑色短发、黑色细框眼镜和浅灰色针织开衫
林屿角色参考资料。它提供人物识别依据,实际镜头中的一致性仍需观看生成结果后判断。
查看原图
[3]
苏晚角色设定图,展示深棕色中长发、半丸子头和米色围裙
苏晚角色参考资料。它提供人物识别依据,实际镜头中的一致性仍需观看生成结果后判断。
查看原图
[3]
资料类型已有记录在对白镜头中的用途
人物林屿与苏晚各有外观、服装和标志物描述把人物名称与镜头中的服装标记对应起来
道具速写本为深灰布纹封面、米白内页,边角有使用痕迹承接林屿递出本子、苏晚翻看本子的动作
场景黄昏吧台与夜色暖光记录了不同时间和光线支撑对白从日常交流推进到夜晚回应
镜头分镜2与分镜3记录了动作、对白和人物状态作为生成前组织资料与生成后逐项看片的清单
[3]

从递出速写本到说出心意

分镜2安排林屿合上速写本、走到吧台并把本子推到中央。苏晚先问“您好,需要点什么?”,林屿回答“不用点单,这个……送给你。”随后苏晚翻开本子查看。分镜3中,苏晚说“原来……每天偷偷画画的人,是你呀。”林屿解释自己每天来店里的原因,苏晚回应“其实,我也一直在等你开口。”[3]

对白节拍脚本中观察到的记录建议观看视频时检查
日常问候苏晚从点单语境发问人物站位、视线对象、台词归属
递出礼物林屿把速写本推到吧台中央,苏晚翻开查看动作顺序、手部接触、道具位置与打开状态
认出画者苏晚指出每天画画的人是林屿说话者口型、听话者反应、停顿与字幕时点
表达与回应林屿说明来店原因,苏晚回应自己也在等待对白节奏、相邻反应镜头与人物外观连续性
[3]

把案例整理成可复核工作流

  1. 人物资料先做减法

    从完整角色描述中提取脸部、发型、服装和标志物,形成镜头检查项。

  2. 道具状态跟着动作走

    为速写本记录合上、推到中央、翻开和翻页后的状态,避免相邻镜头失去起点。

  3. 场景时段写进镜头表

    把黄昏与夜色分别标在对应镜头,并记录吧台、窗外与暖光的衔接要求。

  4. 对白按关系变化拆分

    用问候、送画、认出、表达和回应标记节拍,再决定画面留给说话者、听话者或道具。

  5. 看片后填写验收

    只在查看实际结果后记录口型、人物一致性、道具连续性和镜头衔接结论。

实际视频采样复核:从计划到输出

2026年9月10日,我们对照角色参考、镜头脚本与两段已有视频,在每段的0.500、1.008、2.015、3.023、4.030、4.538秒查看画面。以下是离散时间点的复核,不代表整片、音轨或口型验收;展示的帧来自原始视频,保留画面中的AI生成标识。[2]

检查项脚本或参考要求当前文件或采样观察可以得出的结论
文件时长分镜2、3均标注15.0秒取得的两个MP4均为5.038秒、1280×7209月15日核实实际请求为5秒,与脚本15秒不一致;对白覆盖范围仍未确认
角色发型苏晚参考为半丸子头分镜2的2.015秒可见顶部发髻;分镜3的4.030秒未见发髻这些采样点存在造型差异,需要全段复核
字幕脚本对白有明确原句分镜2的3.023秒底部出现与原句不对应的文字该采样点存在字幕问题,持续区间与音轨尚未核对
场景时段分镜2设定天色微暗,分镜3提及晚风分镜2部分采样窗外偏白亮,分镜3偏深蓝应检查时段和镜头衔接,不能仅凭颜色判定错误
斜挎包林屿参考设定包含斜挎包分镜2可见,分镜3的部分采样未见景别可能影响可见范围,不能直接断言道具消失
[2] [1]

2026年9月15日补充核实:当前分镜2、3的视频版本关联任务均提交了5秒时长,与脚本文字中的15秒不一致;此前取得的两个文件均为5.038秒。由此可定位到计划与请求参数的差异,不能直接归因于模型截断。两条任务的模型标识以及音频、口型开关也不同,旧片不能作为同条件提示词效果对照。任务参数只表示提交配置,不证明音轨、口型或全段质量已经通过验收。[1]

对照画面:角色发型与字幕

分镜2在2.015秒:苏晚在吧台内,头顶发髻清晰可见,林屿拿着速写本
分镜2 · 2.015秒原始帧:苏晚可见顶部发髻,林屿的斜挎包和速写本可见。仅用于核对该时间点的外观及道具。
查看原图
[2]
分镜3在4.030秒:苏晚低头,长发向右侧展开,未见顶部发髻
分镜3 · 4.030秒原始帧:与前图对照,苏晚呈现披发且未见顶部发髻。该观察不覆盖整段视频。
查看原图
[2]
分镜2在3.023秒:林屿把速写本放在吧台,画面底部出现与脚本不对应的字幕
分镜2 · 3.023秒原始帧:画面底部字幕无法对应本镜头脚本中的“您好,需要点什么?”或“不用点单,这个……送给你。”本次未核对音轨。
查看原图
[2]

复用这套检查方法

  1. 固定比较依据

    保留角色参考、镜头脚本与本次实际使用的视频文件,分别记录计划和输出,不用任务状态替代结果检查。

  2. 先定位具体时间点

    记录需要复核的时间与画面特征,例如顶部发髻、字幕原句、速写本的开合状态。

  3. 把观察和推断分开

    看见的差异先写入清单;被遮挡、被裁出画面的物品先标待确认,再连续播放检查。

  4. 复核后再安排修改

    先确认视频是否完整,逐句检查对白与口型。确认需要返修的镜头再调整,并用同一套检查项比较新旧结果。

常见问题

为什么要把人物、场景和道具分开记录?

分开记录便于确认每项资料在镜头中的作用。人物资料负责身份识别,场景资料负责时间与空间,道具资料负责动作和连续状态,镜头表再把它们组合起来。

流程状态显示完成,是否等于视频已经验收通过?

不等于。流程状态说明任务记录所处阶段;人物一致性、口型、动作、字幕和衔接仍要在观看实际视频后分别判断。

对白分镜需要按每句话切换画面吗?

不需要按句数机械切换。更适合在信息、态度、行动或关系发生变化时重新判断画面重点,并保留听话者反应和关键道具动作。

有多个素材版本时,怎样判断该用哪一个?

先确认当前镜头实际引用的版本,再查看该版本是否满足人物、场景与道具要求。版本先后只说明记录顺序,质量判断需要视觉对比和验收记录。

证据来源

  1. 咖啡店对白当前视频版本的生成参数核对(2026-09-15)

    2026年9月15日补充核实:当前分镜2、3的视频版本关联任务均提交了5秒时长,与脚本文字中的15秒不一致;此前取得的两个文件均为5.038秒。由此可定位到计划与请求参数的差异,不能直接归因于模型截断。两条任务的模型标识以及音频、口型开关也不同,旧片不能作为同条件提示词效果对照。任务参数只表示提交配置,不证明音轨、口型或全段质量已经通过验收。

  2. 咖啡店对白视频的文件核对与采样观察(2026-09-10)

    经项目所有者授权,对照咖啡店对白脚本、角色参考与已有分镜视频。分镜2、3脚本均标注15.0秒;本次取得的MP4文件均为5.038秒、1280×720。每段在0.500、1.008、2.015、3.023、4.030、4.538秒采样,另以原始帧复核并展示分镜2的2.015、3.023秒和分镜3的4.030秒。分镜2的2.015秒苏晚可见顶部发髻,分镜3的4.030秒可见披发且未见顶部发髻;分镜2的3.023秒底部字幕与脚本原句不对应。分镜2采样窗外偏白亮,分镜3采样窗外偏深蓝;脚本分镜2设定天色微暗,分镜3提及晚风。原始生成画面的AI标识保留,不重绘或修饰。记录仅涵盖所取文件和采样点,未连续播放验收音轨、口型、动作或转场,未确认文件短于计划的原因,未实施返修,未报告成功率或收益。

  3. 咖啡店对白项目的角色参考与镜头记录

    经项目所有者明确授权公开,核查 geo演示 项目的角色、道具与分镜记录及角色参考原图。林屿设定包含黑色短发、黑色细框眼镜、浅灰色针织开衫和深棕色斜挎包;苏晚设定包含深棕色头发、半丸子头、米白色衬衫、米色围裙与右手腕细银手链。速写本道具描述为深灰布纹封面、米白内页,边角有使用痕迹。分镜2的脚本安排林屿递送速写本,苏晚询问需要点什么,林屿表示赠送本子;分镜3的脚本安排双方表达心意。资产记录有多个版本,角色展示图可用于逐项核对。原图已人工目视检查;未逐帧观看或验收视频,不以版本数量或任务状态证明效果提升。