返回 VideoClaw
eval_select_best_zh.txt
根目录 / video-claw / video-claw / backend / prompts / reference / eval_select_best_zh.txt
1 你是一个专业的视频首帧参考图评估师。请从以下{num_images}张图片中选择最适合作为视频模型首帧的一张。
2
3 分镜剧情:
4 {plot}
5
6 分镜视觉描述:
7 {visual_prompt}
8
9 角色描述:
10 {character_description}
11
12 场景描述:
13 {setting_description}
14
15 {images_list}
16
17 请先对每张图判断【硬性失败项】。优先从没有硬性失败项的图片中选择最佳图。
18
19 【硬性失败项】
20 1. 核心角色数量错误:分镜需要出现的主要人物明显多了或少了。
21 2. 核心角色不可辨认:主要人物脸部/身体严重崩坏、被遮挡、被裁切,或无法看清是谁。
22 3. 角色资产明显不一致:主要人物的性别、年龄段、核心服装、核心发型与角色描述明显不符。
23 4. 场景地点错误:图片环境明显不是分镜要求的地点。
24 5. 人物状态/人物关系完全错误:图片没有体现片段开始前的人物状态、位置关系、视线方向或核心情绪,且无法作为该片段的视频起点。
25 6. 景别/构图不可用:主体严重偏出画面、构图严重倾斜、人物关系看不清,或不适合做视频首帧。
26 7. 人物与场景互动错误:人物不能与桌子、椅子、门、墙、车辆、道具等发生明显穿模、嵌入、悬浮、错位接触或不合理遮挡。必须专门检查人物身体、手臂、腿脚、衣服边缘与桌面、桌腿、椅背、门框、墙面、车辆和道具的接触边界;只要身体像是穿过/嵌入这些物体,必须列入 hard_failures。
27 8. 出现文字、水印、标签、标注线、说明文字或明显UI元素。
28 9. 图片严重模糊、过曝、过暗、低清或畸变,无法作为视频首帧。
29
30 【选择规则】
31 1. 如果存在无硬性失败项的图片,只能从这些图片中选择。
32 2. 如果所有图片都有硬性失败项,选择硬性失败最少且最容易修复的一张。
33 3. 在硬性失败项相同的情况下,优先选择:角色数量正确 > 场景正确 > 人物状态/人物关系正确 > 主体清晰 > 构图和光线更好。
34 4. 软性问题如光线普通、背景细节略少、画面不够电影感,不应压过硬性可用性。
35 5. “人物穿过桌子/椅子/墙/道具”属于硬性失败项,不得因为整体画面好看、人物清晰或构图不错而放行。
36
37 【软性维度】
38 1. 人物静态状态匹配:站姿、坐姿、表情、情绪和准备状态合理,不需要表现具体动作的起始瞬间。
39 2. 人物站位与交互清楚:位置、朝向、视线关系明确,例如看向对方、形成对话/对峙/协作关系。
40 3. 角色外观大体一致。
41 4. 场景布局和关键物件大体一致。
42 5. 镜头语言符合分镜视觉描述。
43 6. 主体清楚,人物状态和互动关系明确,适合后续 i2v。
44 7. 光线、色调、氛围服务剧情。
45 8. 图像质量稳定。
46
47 请输出纯JSON格式(不要用```包裹):
48 {{
49 "selected_index": 0到{num_images_minus_1}之间的整数,
50 "reason": "选择该图片的主要原因,说明硬性失败项和视频可用性",
51 "score": 1-10,
52 "hard_failures": ["该图片的硬性失败项,如果没有则为空数组"],
53 "soft_issues": ["该图片的软性问题,如果没有则为空数组"],
54 "issues": ["合并后的主要问题列表"]
55 }}
56
57 selected_index 必须是从 0 到 {num_images_minus_1} 的整数,表示你选择的图片编号。
58
58 lines Plain Text