docs: Clarify crop_scale parameter to explain Face Processing ROI vs Content Crop

This commit is contained in:
Hawk Lee
2026-01-21 13:13:38 +08:00
parent 16592b3256
commit f8e71620e6
+5 -3
View File
@@ -306,9 +306,11 @@ ComfyUI/models/EchoMimicV3/
- `fps`: 建议 **25** (Ditto 针对 25FPS 训练)。即使输入其他值,目前内部逻辑也会优先保证 25FPS 的同步率。
- **输出**: `IMAGE` (视频帧), `AUDIO`。
- **高级参数 (Advanced Parameters)**:
- `crop_scale`: (默认 2.3) **视野缩放比例**。
- **2.3 (默认)**: 广角视野,包含更多背景和身体,人物动作幅度看起来更大、更松弛。
- **1.5 - 2.0**: 特写视场,人脸占比更大,适合需要展现面部细节的场景,但动作幅度会受限。
- `crop_scale`: (默认 2.3) **面部工作区缩放 (Face Processing Scale)**。
- 定义了模型进行推理时,以面部为中心向外扩展的**工作区域大小**。
- **数值越大**: 视野越广,能覆盖更多头发、脖子和背景,适合大幅度动作,但面部在512画布中的占比变小,可能降低五官清晰度。
- **数值越小**: 视野聚焦,五官更清晰,但可能裁掉头发或下巴,大动作时容易出框。
- 推荐值: 2.3 - 2.5。0**: 特写视场,人脸占比更大,适合需要展现面部细节的场景,但动作幅度会受限。
- `emo`: (默认 Neutral) 表情控制。可选 Angry, Happy, Sad 等。
- `drive_eye`: (默认 True) 是否驱动眼睛。关闭后眼睛将保持参考图状态(或微动),适合原图眼神较好的情况。
- `chk_eye_blink`: (已废弃,请使用 `blink_mode`)。