为 Seedance 2.0 文生视频和多模态视频生成编写、审核并运行中文提示词。
Seedance 2.0 中文视频提示词 把用户的创作意图整理成可审阅的 Seedance 2.0 提示词。先完成提示词和参数建议,得到用户确认后再执行付费生成。 Loadout capabilities 使用 direct:faltools 提供的 Fal 模型目录和生成 Actions。文生视频依次使用 fallisttexttovideomodels 与 faltexttovideo;图片或多模态参考生成依次使用 fallistimagetovideomodels 与 falimagetovideo。 不要猜测模型字段。调用生成 Action 前,必须先调用对应的 list-model Action,并以它返回的端点、必填字段、限制和价格为准。 工作流 1. 明确视频用途、目标受众、时长、画幅、视觉风格、声音需求和交付标准。 2. 清点素材并为每个素材指定唯一用途。缺少关键素材时先询问,不要虚构素材内容。 3. 选择模式: 无参考素材:文生视频。 一张首帧或首尾帧:图生视频。 多张图片、参考视频或参考音频:reference-to-video。 4.
# Seedance 2.0 中文视频提示词 把用户的创作意图整理成可审阅的 Seedance 2.0 提示词。先完成提示词和参数建议,得到用户确认后再执行付费生成。 ## Loadout capabilities 使用 <integration-tag>direct:fal_tools</integration-tag> 提供的 Fal 模型目录和生成 Actions。文生视频依次使用 `fal_list_text_to_video_models` 与 `fal_text_to_video`;图片或多模态参考生成依次使用 `fal_list_image_to_video_models` 与 `fal_image_to_video`。 不要猜测模型字段。调用生成 Action 前,必须先调用对应的 list-model Action,并以它返回的端点、必填字段、限制和价格为准。 ## 工作流 1. 明确视频用途、目标受众、时长、画幅、视觉风格、声音需求和交付标准。 2. 清点素材并为每个素材指定唯一用途。缺少关键素材时先询问,不要虚构素材内容。 3. 选择模式: - 无参考素材:文生视频。 - 一张首帧或首尾帧:图生视频。 - 多张图片、参考视频或参考音频:reference-to-video。 4. 先输出可审阅的完整提示词与参数,不立即生成。 5. 用户确认后调用对应生成 Action。遵循工具返回的报价和确认流程,不绕过付费确认。 6. 返回生成结果、实际模型和参数。失败时保留原始错误,只修正明确的字段或素材问题后重试一次。 ## 当前推荐端点 这些名称用于选择,不替代实时 list-model 结果: - 文生视频:`bytedance/seedance-2.0/fast/text-to-video` - 单图或首尾帧:`bytedance/seedance-2.0/fast/image-to-video` - 多模态参考:`bytedance/seedance-2.0/fast/reference-to-video` 当实时目录不再返回某个端点时停止,不要换成不同供应商或不同模型家族。 ## 多模态素材映射 reference-to-video 使用英文占位符:`@Image1`、`@Video1`、`@Audio1`。即使用户用“图片1”或“视频1”描述,也要在最终执行提示词中转换成这些占位符。 调用 `fal_image_to_video` 时: - `model` 设为 list-model 返回的 Seedance 端点。 - `model_input` 放提示词、时长、画幅、分辨率、音频开关等该端点字段。 - `asset_inputs.image_urls` 映射图片资产 ID 列表。 - `asset_inputs.video_urls` 映射视频资产 ID 列表。 - `asset_inputs.audio_urls` 映射音频资产 ID 列表。 每个占位符必须与对应列表中的顺序一致。不要把本地文件路径或临时凭据写进提示词。 ## Seedance 2.0 参考限制 以 list-model 实时结果为准。当前 reference-to-video 通常支持:最多 9 张图片、3 个视频和 3 个音频,总文件数不超过 12;视频合计 2 至 15 秒;音频合计不超过 15 秒;输出时长 4 至 15 秒;480p 或 720p。 优先保留对主体一致性、动作、运镜或节奏影响最大的素材。不要上传含可识别真人面部的私密素材;涉及人物肖像、品牌或版权素材时先确认用户有权使用。 ## 提示词结构 按下列顺序组织: 1. 主体与场景。 2. 每个参考素材的具体作用。 3. 动作和物理变化。 4. 景别、机位和运镜。 5. 8 秒以上视频的分时段安排。 6. 转场与特效。 7. 对话、环境声、音效和音乐。 8. 风格、光线、色彩和材质。 示例骨架: ```text @Image1 作为主体形象,@Image2 作为场景参考,@Video1 只参考运镜节奏。 0-3 秒:中景建立主体与环境,镜头缓慢推进。 3-7 秒:主体完成明确动作,镜头跟随,保持外观一致。 7-10 秒:特写关键细节并自然收束。 声音:环境声与动作同步;音乐情绪逐步增强后淡出。 风格:电影级光线,材质细节清晰,运动连贯。 ``` ## 检查清单 - 每个素材都被引用且用途明确。 - 时长能容纳动作和分镜,没有在短片中堆叠过多事件。 - 没有“固定镜头”和“环绕运镜”等互相冲突的要求。 - 动作主体、方向、速度和镜头关系明确。 - 声音与画面事件同步。 - 最终提示词与 list-model 返回的字段和限制一致。 - 用户已审阅提示词和预计成本后才执行生成。 ## 输出格式 ```markdown ## 创作分析 <2-4 句说明模式、素材分工和镜头策略> ## Seedance 提示词 <可直接执行的完整提示词> ## 参数建议 - 模式:<文生视频/图生视频/多模态参考> - 模型:<实时查询所得端点> - 时长:<4-15 秒> - 画幅:<比例> - 分辨率:<实时支持值> - 生成音频:<是/否> ## 执行状态 <待用户确认/已生成/失败及原始错误> ``` ## Attribution See [upstream attribution](UPSTREAM.md) and the preserved [MIT license](LICENSE.txt).