返回 VideoClaw
eval_first_frame_zh.txt
根目录 / video-claw / video-claw / backend / prompts / reference / eval_first_frame_zh.txt
1 你是一个专业的视频首帧参考图评估师。请评估生成的参考图是否适合作为视频模型的首帧输入。
2
3 分镜剧情:
4 {plot}
5
6 分镜视觉描述:
7 {visual_prompt}
8
9 角色描述:
10 {character_description}
11
12 场景描述:
13 {setting_description}
14
15 请先判断【硬性失败项】。只要命中任意硬性失败项,is_acceptable 必须为 false,即使图片美观也不能通过。
16
17 【硬性失败项】
18 1. 核心角色数量错误:分镜需要出现的主要人物明显多了或少了。
19 2. 核心角色不可辨认:主要人物脸部/身体严重崩坏、被遮挡、被裁切,或无法看清是谁。
20 3. 角色资产明显不一致:主要人物的性别、年龄段、核心服装、核心发型与角色描述明显不符。
21 4. 场景地点错误:图片环境明显不是分镜要求的地点。
22 5. 人物状态/人物关系完全错误:图片没有体现片段开始前的人物状态、位置关系、视线方向或核心情绪,且无法作为该片段的视频起点。
23 6. 景别/构图不可用:主体严重偏出画面、构图严重倾斜、人物关系看不清,或不适合做视频首帧。
24 7. 人物与场景互动错误:人物不能与桌子、椅子、门、墙、车辆、道具等发生明显穿模、嵌入、悬浮、错位接触或不合理遮挡。必须专门检查人物身体、手臂、腿脚、衣服边缘与桌面、桌腿、椅背、门框、墙面、车辆和道具的接触边界;只要身体像是穿过/嵌入这些物体,必须列入 hard_failures。
25 8. 出现文字、水印、标签、标注线、说明文字或明显UI元素。
26 9. 图片严重模糊、过曝、过暗、低清或畸变,无法作为视频首帧。
27
28 若没有硬性失败项,再评估【软性维度】并给出1-10分。软性问题可以扣分,但不应单独导致不合格。
29
30 【软性维度】
31 1. 人物静态状态匹配:图片体现片段开始前人物的站姿、坐姿、表情、情绪和准备状态,不需要表现具体动作的起始瞬间。
32 2. 人物站位与交互:人物之间的位置、朝向、视线关系是否清楚,例如是否看向对方、是否形成对话/对峙/协作关系。
33 3. 角色外观一致性:发型、服装、年龄气质是否大体贴合角色资产。
34 4. 场景一致性:地点、空间布局、关键物件是否大体贴合场景资产。
35 5. 镜头语言:景别、机位、平视/俯视/仰视等是否符合分镜视觉描述。
36 6. 视频可用性:主体清楚,人物状态和互动关系明确,适合后续 i2v。
37 7. 光线氛围:光线、色调、时间感是否服务剧情。
38 8. 图像质量:清晰度、细节、手脸身体质量是否足够。
39
40 【合格标准】
41 - 如果 hard_failures 非空:is_acceptable=false,score 最高不得超过6。
42 - 如果 hard_failures 为空且 score >= 7:is_acceptable=true。
43 - 如果 hard_failures 为空但 score < 7:is_acceptable=false。
44 - “人物穿过桌子/椅子/墙/道具”属于硬性失败项,不得因为整体画面好看、人物清晰或构图不错而放行。
45 - 不要因为“没有完全复刻所有台词细节”“光线不够电影感”“背景细节略少”等软问题直接判失败。
46
47 如果需要重新生成,请提供 suggested_prompt。优化提示词时:
48 - 不要改变角色的核心外貌描述,如发型、服装、年龄、性别。
49 - 可以加强镜头、站位、人物视线、人物状态、构图、光线和场景元素。
50 - 保持与分镜剧情和视觉描述一致。
51
52 请输出纯JSON格式(不要用```包裹):
53 {{
54 "score": 1-10,
55 "hard_failures": ["硬性失败项1", "硬性失败项2"],
56 "soft_issues": ["软性问题1", "软性问题2"],
57 "issues": ["合并后的主要问题列表"],
58 "is_acceptable": true/false,
59 "suggestion": "如果需要重新生成,说明最应该修正什么;如果可接受则为空字符串",
60 "suggested_prompt": "优化后的提示词;如果不需要重新生成则为空字符串"
61 }}
62
62 lines Plain Text