2026年,AI视频生成行业发生了一个标志性事件------字节跳动Seedance 2.0/2.5视频生成模型发布之后,一批"导演级Skill"在GitHub上集体开源。这些开源项目不是简单的提示词模板,而是一整套让AI Agent变身"视频创意总监"的技能操作系统:输入一句模糊的想法,Agent会像真正的导演一样进行创意访谈、撰写分镜脚本、分配参考素材角色、生成可直接投产的提示词,甚至像制片人一样评审样片、诊断失败原因、控制重拍预算。
这个现象的背后,是AI视频创作范式的根本转变:从"生成一个片段"走向"完成一段创作"。Seedance 2.0实现了文本、图像、视频、音频四种模态混合输入,通过@引用系统让创作者像导演一样指挥素材;Seedance 2.5进一步将单次生成时长翻倍至30秒,支持最多50个全模态参考,实现"一镜成片"。但模型能力越强,提示词工程的门槛就越高------于是,一批开源开发者把"导演思维"编码成Agent Skill,让任何人在AI对话中就能获得专业导演的工作流。

本文将从Seedance模型能力全景、开源导演Skill生态、核心项目深度解析、安装部署指南、实战案例、应用场景与未来趋势等维度,系统梳理"Seedance 2导演Skill开源"这一技术事件,为AI视频创作者、AI Agent开发者、影视从业者、电商内容团队提供一份从入门到实战的完整指南。
需要先明确一个关键事实:Seedance 模型本身是闭源的商用模型 (通过即梦AI、豆包、火山引擎等平台提供服务),本次开源的是围绕Seedance构建的导演 Skill 层------即提示词工程系统、导演工作流、参考素材管理、版权安全改写、样片评审与修复等Agent技能包。这层开源的价值在于:它把AI视频创作从"拼提示词玄学"变成"可复现、可审计、可协作的专业生产流程"。
**一、**Seedance 2.0/2.5 模型能力全景
要理解导演Skill为什么火,先要理解Seedance模型本身的能力边界。Seedance是字节跳动Seed团队推出的多模态AI视频生成模型系列,2026年2月Seedance 2.0上线,2026年7月31日Seedance 2.5正式发布。
1.1 Seedance 2.0**:多模态全能参考**
Seedance 2.0于2026年2月在字节跳动AI创作平台即梦上线,2026年3月27日官方发布正式博客。它基于统一多模态音视频联合生成架构,核心突破是四种模态混合输入:文本、图片、视频、音频,模型可以同时参考输入素材中的构图、动作、运镜、特效、声音等元素。官方全能参考(Omni-Reference)能力规格:
|--------|-----------------|-------------------------|-----------------|
| 输入模态 | 数量上限 | 参考用途 | 典型场景 |
| 文本 | 不限 | 自然语言描述场景、动作、运镜、风格、光线、叙事 | 所有生成任务的意图表达层 |
| 图片 | 最多9张(单张约30MB上限) | 角色外观/场景设定/视觉风格/首尾帧/产品图 | 角色一致性、产品展示、风格迁移 |
| 视频 | 最多3段(合计约2-15秒) | 运动模式复刻/镜头运镜参考/节奏控制 | 运动复刻、运镜模仿、动作参考 |
| 音频 | 最多3段(合计约15秒) | 音乐节拍卡点/环境音参考/口型驱动/音色 | 音乐MV、口型同步、卡点视频 |
Seedance 2.0单次生成4-15秒带原生音频(音效+配乐+人声)的高质量视频,最高支持4K分辨率(部分平台1080p),角色稳定、物理逻辑严密、指令遵循能力强。它通过自然语言@引用系统从上传素材中参考运动模式、镜头技巧、角色外观------这是"导演模式"的核心语法基础。2026年6月23日,Seedance 2.5在火山引擎FORCE开发者大会上首次亮相(与豆包1.6一同发布),预告了多模态参考输入(图片+视频+音频)和API能力。
1.2 Seedance 2.5**:一镜成片,随心参考**
2026年7月31日,字节跳动Seed官方发布Seedance 2.5正式版本,主题是**"** 一镜成片,随心参考 "(One-take Creation, Flexible Referencing)。官方观察指出:用户对视频创作模型的期待正在从"生成一个片段"走向"完成一段创作"。Seedance 2.5延续Seedance 2.0的统一多模态音视频联合生成架构,聚焦基础生成与参考生成,在长叙事、多模态参考与编辑上实现三大突破:
①长叙事能力:单次生成时长翻倍至30秒(Seedance 2.0约15秒),且支持多轮延长拼接,可产出数分钟连贯内容。单段30秒内容内可完成场景切换、节奏变化与完整叙事(铺垫、转折、收尾),无需手动拼接多个片段------这是"一镜成片"的核心。
②全模态参考扩展:单次最多接受30张图、10段视频与10段音频参考(合计最多50个参考素材),参考类型覆盖白模参考(锁定空间结构/运镜/轨迹)、运动参考、创意参考等,支持时间戳级编辑。
③更强的可控性与编辑能力:针对行业痛点优化镜头衔接、人物稳定性与物理运动逻辑,支持区域级编辑(绿幕/区域/运镜/时间戳编辑)、原生音频(台词/音效/音乐分层)、多语言支持。输出分辨率支持480p和720p(平台标准)。
Seedance 2.5已登陆即梦AI、豆包专业版,企业级API服务于2026年8月陆续上线火山方舟(BytePlus ModelArk的dreamina-seedance-2-5-260628模型卡已发布)。官方规格汇总:
|------------|-------------------------|------------------------------------------|
| 能力项 | Seedance 2.0 | Seedance 2.5 |
| 单次生成时长 | 4-15秒 | 4-30秒(标准),单次扩展4-30秒,嵌套扩展最终输出最高60秒 |
| 参考素材总量 | 最多12个(9图+3视频+3音频) | 最多50个(30图+10视频+10音频) |
| 输入模态 | 文本+图片+视频+音频 | 文本+图片+视频+音频,白模/运动/创意参考类型 |
| 生成分辨率 | 最高4K(平台1080p为主) | 480p/720p(Dreamina文档口径) |
| 原生音频 | 音效+配乐+人声联合生成 | 音画同步增强,台词、音效、音乐、字幕分层语法 |
| 编辑能力 | 基础编辑/续写 | 时间戳级编辑、绿幕/区域/运镜编辑、多轮延长 |
| 叙事能力 | 片段级 | 单段30秒完整叙事(铺垫/转折/收尾),场景切换与节奏变化一体 |
| 发布平台 | 即梦AI、豆包、火山方舟API、Runway等 | 即梦AI、豆包专业版;API陆续上线火山方舟/BytePlus ModelArk |
模型能力越强,驾驭难度越高------50个参考素材如何分配角色?30秒长叙事如何保持一致性?编辑/续写如何锁定边界?这些问题正是导演Skill开源生态要解决的。
二、开源导演****Skill 生态总览
2026年年中以来,围绕Seedance的导演级Agent Skill在GitHub上密集开源,形成了一波社区热潮,抖音、CSDN、知乎、跨境电商社区等多个平台都在传播。核心开源项目包括:
|---------------------------------------------------------|-------------------------------------------------|--------------------------------|------------------------------------------------------------------------------------------------------------------|---------------------------------------|
| 项目 | 定位 | 适配模型 | 核心能力 | 开源协议/热度 |
| Seedance 2.0 Skill OS (Emily2040/seedance-2.0) | 面向Seedance 2.0的模块化Agent技能操作系统,"指挥模型,不要微观管理画面" | Seedance 2.0(2.0/2.0 Fast/V2) | 创意访谈路由/全模态提示词(T2V/I2V/V2V/R2V/FLF2V/编辑/续写/首尾帧)/参考素材角色分离/六语言电影词汇/版权安全改写/失败诊断修复/专业影视工作流/验证脚本,v5.5.2版本 | MIT,2026-05发布,持续更新至v5.5.2(2026-06-12) |
| Seedance2-skill (zhanghaonan777) | "字节Seedance AI视频创意工作台",让AI Agent变身视频创意总监,强调审美门槛 | Seedance 2.0/1.5 Pro/1.0系列全部模型 | 自主创意总监/四维创意审核(记忆点/意外感/情绪弧线/叙事变化)/零文案创意发散/镜头语言12类100+词条/导演风格速查10位/动漫作画术语9项/一键API生成Python CLI | MIT,2026-08发布 |
| Seedance 2.5 Director (sjinn-ai/seedance2.5-skills) | 电影级Seedance 2.5导演控制台,"指挥场景,绑定参考,保持状态" | Seedance 2.5 | 六阶段工作流(Brief→Mode Gate→Contracts→Direction→Compilation→Linting)/参考角色契约/提示词linter(10种模式)/长视频多片段规划/编辑扩展首尾帧关键帧故事板分镜 | MIT,2026-08发布 |
| seedance-video-script (buluslan) | 把商业意图+素材转成Seedance 2.5可直接使用的视频分镜提示词 | Seedance 2.5(即梦C端+火山方舟B端API) | 时间戳分镜/@引用分配/白模参考/绿幕区域运镜编辑/原生音频语法/SPACE框架/5步生成流程/8商业场景模板库/避坑自检 | MIT,v0.2.x持续更新 |
| Awesome Seedance 2.5 Prompts + Skill (AtlasCloudAI) | Seedance 2.5提示词精选集+通用视频提示词Skill | Seedance 2.5及多模型通用 | seedance-25专用Skill + universal-video-prompt-skill通用Skill(跨模型对比/多模型执行),npx skills add一键安装 | 开源,2026-08发布 |
| Seedance Director Mode (leonluo2008-ops) | Seedance 2.0导演模式使用手册 | Seedance 2.0 | 提示词结构/素材准备/多镜头工作流/可直接复用的实战模板 | 开源,2026-08发布 |
| Standed/Seedance2.5 | 独立Seedance 2.5 Skill,AI视频制作 | Seedance 2.5 | 将脚本/简报/素材/镜头说明转成Seedance-ready计划、提示词和QA | MIT,2026-09发布 |
| 火山引擎官方 sd25-pe | Seedance 2.5提示词优化技能(官方) | Seedance 2.5 | 提示词调优,npx --yes skills@latest add "arkdocs地址" --skill sd25-pe,对话框输入/sd25-pe | 官方提供 |
这批开源项目的共同特征是:它们不调用视频生成 API 、不生成视频本身,而是把 " 导演的专业决策过程 " 固化为可复用的 Agent 技能------输入模糊想法时先访谈,有素材时先分配参考角色,写提示词时先过创意审核,生成失败时先诊断根因再单变量重拍。核心价值在于将不可言传的导演经验(镜头语言、叙事节奏、角色一致性、版权边界、成本控制)编码为结构化工作流。
开源生态的三个显著趋势:①从提示词模板到技能操作系统 ------不再是一段"万能提示词",而是多技能路由、分阶段管线、验证脚本齐备的完整系统(Skill OS);②从单模型适配到跨模型通用 ------出现Universal Video Prompt Skill这类跨模型通用技能,一份简报可运行于多个视频模型;③从个人创作到商业生产------越来越多项目面向电商广告、短剧、影视预演等商业场景,提供8大商业场景模板、交付QC、成本感知等生产级能力。
接下来,本文对三个最具代表性的核心项目(Seedance 2.0 Skill OS、Seedance2-skill、Seedance 2.5 Director)做深度解析,并给出安装部署与实战指南。
**三、**Seedance 2.0 Skill OS 深度解析
Seedance 2.0 Skill OS(GitHub: Emily2040/seedance-2.0)是目前生态中体系最完整、维护最活跃的开源导演技能包,当前版本v5.5.2(2026-06-12发布),MIT协议。它的核心设计哲学只有一句话:" 指挥模型,不要微观管理画面 "(Direct the model. Don't micro-manage the frame.)------AI Agent应该像导演一样传达意图和约束,而不是像操作员一样逐帧描述像素。

Seedance 2导演Skill核心工作流信息图:创意访谈→提示词编写→参考素材角色分配→多模态生成→样片评审→诊断修复六阶段管线,下方标注@引用系统、镜头语言词库、版权安全、多语言支持等关键能力
3.1****系统架构:六大通道
Skill OS的README将其设计为"操作系统":每个请求都经过若干关卡,根技能负责路由,验证器把守质量底线。六大通道按设计保持分离:
|-----------|--------------------------------|---------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------|
| 通道 | 职责 | 典型内容 |
| 研究来源 | 标注日期的官方/学术/平台/社区证据 | api-status.md(API可用性/价格/配额/区域/模型ID,声明时必须检查last_verified日期)、platform-surface-matrix.md(模型能力与各平台差异分离)、model-name-map.md(防止2.0/2.0 Fast/V2/Pro混淆)、community-source-methodology.md(公开提示词语料挖掘方法) |
| 生产主干 | 简报→镜头列表→连续性→后期交付→QC | pro-filmmaking-standards.md(导演/摄影/制片/剪辑/调色/声音/本地化/交付各角色应产出什么工件) |
| 提示词路由 | 访谈、撰写、压缩、配方、排障 | seedance-interview/prompt/prompt-short/recipes/troubleshoot等技能 |
| 多模态参考 | 图/视频/音频/首帧/尾帧/角色绑定素材 | reference-workflow.md(每个参考素材分配角色)、i2v-guide.md(图生视频最佳实践) |
| 安全关卡 | IP、肖像、声音、品牌、真人、过滤、平台政策 | seedance-copyright(不安全的名人/受保护IP/私人物品/品牌/歌曲/声音请求改写为更安全的创意等价物) |
| 质量评估 | schema校验、来源新鲜度、词汇完整性、设计审计、行为用例 | validate_skills.py/content_audit.py/eval_schema_check.py/design_audit.py/source_registry_check.py/vocab_schema_check.py |
3.2****核心技能地图
Skill OS提供了一条完整的"提示词生产线",每个技能对应一个具体场景:
|--------------------------|----------------------------|-------------------|
| 技能 | 使用时机 | 输出 |
| seedance-interview | 想法模糊、未成形、需要创意方向 | 聚焦的创意简报和下一步提示词路径 |
| seedance-interview-short | 想要快速简报而非冗长访谈 | 精简简报 |
| seedance-prompt | 概念清晰,需要完整提示词 | 可投产的完整Seedance提示词 |
| seedance-prompt-short | 提示词需要压缩以增强Seedance表现 | 30-100词的压缩提示词 |
| seedance-camera | 需要指定镜头行为、镜头感、景别、运动 | 含精确镜头语言的提示词 |
| seedance-motion | 身体动作、物体运动、编排、物理动作重要 | 含精确运动描述的提示词 |
| seedance-lighting | 情绪、时间段、氛围、光线变化驱动镜头 | 含光线设计的提示词 |
| seedance-characters | 角色身份、多角色走位、一致性重要 | 含角色绑定和一致性约束的提示词 |
| seedance-style | 需要视觉风格但不借用不安全的工作室/系列 | 安全风格描述 |
| seedance-vfx | 粒子、破坏、能量、天气、魔法、变形效果 | 含特效描述的提示词 |
| seedance-audio | 对话、口型同步、音乐、环境音、音频参考行为 | 含音频设计的提示词 |
| seedance-pipeline | 询问API、Web工作流、ComfyUI、后期、集成 | 来源受限的操作清单 |
| seedance-recipes | 想要类型模板或可重复生产配方 | 类型化生产配方 |
| seedance-troubleshoot | 输出质量差、不稳定、模糊、偏离提示词或被拦截 | 根因诊断和修复后的提示词 |
3.3****生产管理与失败修复哲学
Skill OS最有价值的部分是其"制片人式"的生产管理机制和失败修复哲学:
①五级样片评审( Take Triage ):生成完成后,对样片给出五个维度的评审判定(保留/后期修复/编辑/重拍/重写),而不是笼统地说"不行"或"行"。这让团队能明确识别:哪个部分成功了、哪个部分失败了、下一步改什么。
②单变量重拍( One-variable Retakes ):修复失败样片时,一次只改变一个变量(镜头、光线、运动、参考角色、时长、构图、音频或安全措辞),从而准确揭示到底是什么修复了问题。一次改多个变量的重拍是排查大忌。
③尝试预算与成本感知( Attempt Budgets & Cost-aware Drafting ):为每个任务设置重拍次数上限,避免无限抽卡烧钱;起草提示词时考虑API成本和配额。
④模型机制工作模型( Model Mechanics ):提供"为什么每条规则有效"的可运行生成器机制模型------不只告诉你该怎么做,还解释模型为什么这样工作,让使用者理解规则背后的原理。
⑤版权安全改写( Copyright-safe Rewrites ):将涉及不安全的名人肖像、受保护IP、私人物品、品牌、歌曲、声音的请求,改写为保留创意功能的更安全等价物,同时避免隐藏不安全意图。误报场景(如良性制作语境)通过澄清来修复,而非隐藏。
⑥专业影视工作流( Pro Filmmaking Standards ):面向专业电影和商业团队,为每个角色定义应产出的工件------导演产出treatment/场景节拍/表演意图/覆盖/镜头终点/评审意见,摄影指导产出镜头合同/景别/镜头感/摄影机支撑/运动/走位/光线连续性,制片人产出客户简报/权利地图/审批关口/活动变体/风险日志/评审包,剪辑师产出选择计划/编辑决策/连续性交接/手柄/无字幕需求/合片注释,调色师产出色彩意图/ACES交接/成片风格/HDRODR注意事项/产品颜色检查,声音团队产出对话图/环境/特效/音乐分层/同步提示/分轨/M&E/配音和响度说明,本地化团队产出字幕/SDH/强制叙事/配音指南/市场文案/无字版本,交付QC产出帧率/宽高比/裁切/色彩/响度/字幕/元数据/命名/人工QC清单。
⑦多语言电影词汇( Multilingual Vocabulary ):提供英语、中文、日语、韩语、西班牙语、俄语六语言的电影制作精确词汇,包含角色绑定、首尾帧措辞、编辑/扩展措辞、安全措辞和音频提示,以及中英、俄英、日英、韩英、西英混合语言提示词结构。
3.4****当前状态规则与事实边界
Skill OS特别强调"当前状态规则"(Current Status Rule):Seedance平台行为变化很快,在断言API可用性、人脸/肖像授权、上传限制、定价、区域可用性或模型名称之前,必须加载references/api-status.md并检查其last_verified日期。截至2026-06-11,公开官方来源将Seedance 2.0描述为支持文本、图像、音频和视频输入,参考素材最多9图+3视频+3音频;火山引擎5月29日文档保持doubao-seedance-2-0-260128和doubao-seedance-2-0-fast-260128为当前Ark模型ID;Runway文档化seedance2为5-15秒时长,可选图像、视频、音频参考。这种"事实来源可追溯、带日期、分平台"的做法,是开源Skill质量的标杆------它把易变的事实与稳定的方法分离,防止过时的2.0限制或未经验证的第三方说法悄悄变成"2.5的事实"。
**四、**Seedance2-skill :有审美门槛的创意工作台
Seedance2-skill(GitHub: zhanghaonan777/Seedance2-skill)定位与Skill OS不同------它不追求"操作系统"级别的完整体系,而是强调创意质量门槛。项目介绍直言:"不是提示词模板,是一套有审美门槛的创意系统。"它让AI Agent变身"视频创意总监",而非单纯的提示词翻译器。
4.1****四大特色能力
①自主创意总监:没有固定流程,Agent自行决定分析顺序、迭代轮数、输出方式------根据输入灵活调整创作路径,而不是套模板。
②创意审核机制 :每条prompt必须过四关------记忆点 (观众看完能记住什么?)、意外感 (是否有反转、对比、夸张?)、情绪 (有没有情绪弧线?)、叙事(哪怕5秒也要有变化)。四关不过就推翻重来,直到"有意思"为止。这是把"创意总监的否决权"编码进了Agent。
③零文案创意发散:只给一张图不说话?Agent会发散2-3个创意方向,挑最有意思的展开------从纯视觉输入到完整创意方案。
④完整词库:镜头语言12类100+词条(景别/运镜/构图/焦距等)、导演风格速查10位(可参考的导演视觉风格)、动漫作画术语9项------为Agent提供专业创作词汇支撑。
4.2****一键 API 生成 CLI
该项目内置Python CLI工具(scripts/seedance.py),零第三方依赖(仅标准库),覆盖全部Seedance模型:
|-----------------------|-------------------------------------|------------------------------|
| 模型 | Model ID | 能力 |
| Seedance 2.0(默认) | doubao-seedance-2-0-260128 | 文/图/视频/音频多模态、运动复刻、多镜头叙事 |
| Seedance 1.5 Pro | doubao-seedance-1-5-pro-251215 | 文/图生视频、音画同生、Draft样片、Flex离线推理 |
| Seedance 1.0 Pro | doubao-seedance-1-0-pro-250528 | 文/图生视频、首尾帧、精确帧数控制 |
| Seedance 1.0 Pro Fast | doubao-seedance-1-0-pro-fast-251015 | 文/图生视频、速度优先 |
| Seedance 1.0 Lite I2V | doubao-seedance-1-0-lite-i2v-250428 | 多参考图(图1图2语法) |
CLI核心参数覆盖了Seedance的全模态输入:--prompt(视频描述)、--image(首帧图片)、--last-frame(尾帧图片)、--ref-images(参考图1-9张)、--video(参考视频1-3个)、--audio(参考音频1-3个)、--model(模型ID)、--ratio(宽高比16:9/4:3/1:1/3:4/9:16/21:9/adaptive)、--duration(时长,-1自动)、--resolution(480p/720p/1080p)、--draft(样片模式低成本预览)、--service-tier(default/flex离线半价)、--generate-audio(是否生成音频)、--return-last-frame(返回尾帧用于视频接龙)、--callback-url(Webhook回调)、--wait(等待完成)、--download(下载目录)。
使用示例:
文本生成视频
python3 scripts/seedance.py create --prompt "镜头跟随黑衣男子快速逃亡,后面一群人在追" --ratio 16:9 --duration 5 --wait --download ~/Desktop
图片生成视频
python3 scripts/seedance.py create --prompt "画面中的人物缓缓转身" --image photo.jpg --ratio adaptive --wait --download ~/Desktop
视频参考+运动复刻
python3 scripts/seedance.py create --prompt "参考视频的运镜和节奏" --video reference.mp4 --wait --download ~/Desktop
音频卡点
python3 scripts/seedance.py create --prompt "画面随音乐节拍切换" --audio bgm.mp3 --wait --download ~/Desktop
接入方式:兼容任何支持Skill/Tool加载的AI Agent平台------OpenClaw放入~/.openclaw/workspace/skills/seedance-skill/,Cursor放入~/.cursor/skills/seedance-skill/,其他平台将SKILL.md作为system prompt或工具描述注入即可。API Key通过export ARK_API_KEY="your-volcengine-ark-api-key"设置(火山引擎控制台获取)。
**五、**Seedance 2.5 Director :电影级导演控制台
Seedance 2.5 Director(GitHub: sjinn-ai/seedance2.5-skills)是面向Seedance 2.5的最新一代导演技能,口号是"指挥场景,绑定参考,保持状态"(Direct the scene. Bind the references. Preserve the state.)。它基于对2.5官方文档的严格验证(2026年8月3日验证Dreamina官方指南),核心思想是:参考定义权威,导演定义变化,已接受的镜头定义事实(References define authority. Direction defines change. Accepted footage defines truth.)。
5.1****为什么需要它: 2.5 失败的七个结构原因
项目README直指Seedance 2.5复杂生成的典型失败根因:①参考素材竞争控制同一维度(多个素材同时控制人物/光线/运动);②角色、道具、对话未绑定到具名所有者;③一个镜头包含的事件超过时长可支撑的范围;④镜头语言隐藏了决定性动作;⑤编辑未指明一个主视频和一个编辑范围;⑥续写跟随计划结局而非已生成边界;⑦重试改变太多变量以致无法揭示问题所在。这些问题正是导演Skill要解决的------它不只是把短想法扩展成更长的形容词列表,而是先决定每个素材控制什么,再指挥可见动作、镜头、光线、表演、声音、连续性和最终状态。
5.2****六阶段工作流与模式门
每个请求都经过同一受控管线:
|-----------------------------|------------------------------|---------|
| 阶段 | 任务 | 产出 |
| 1. Brief (简报) | 确定目标、活跃平台、时长、素材、必须项和权利 | 明确的任务约束 |
| 2. Mode Gate (模式门) | 选择生成/编辑/扩展/端点/故事板/分镜/转场逻辑 | 正确的生成路径 |
| 3. Contracts (契约) | 为每个参考素材分配角色、权威和排除项 | 参考角色契约 |
| 4. Direction (导演) | 定义可见事件、镜头、光线、表演、声音和结束状态 | 完整的导演指令 |
| 5. Compilation (编译) | 产出一条可直接复制的自然语言提示词,含精确参考token | 最终提示词 |
| 6. Linting (检查) | 在花费生成之前检测结构风险 | 结构风险清单 |
5.3****参考角色契约与模式保护
参考角色契约是Seedance 2.5 Director最核心的机制------每个参考素材都通过@引用指定"控制什么、不控制什么":
@Image 1 定义产品的精确几何、深色拉丝金属和雕刻标记;不要使用其白色背景、工作室构图或反光。
@Video 1 仅控制镜头路径和加速度;不要转移其房间、表演者、物体、色彩分级或音频。
@Audio 1 仅控制雨的环境音和远处金属共鸣;不要添加语音或音乐。
最终提示词示例(12秒产品揭幕):@Image 1定义一件产品的精确几何、深色拉丝金属和雕刻标记,不使用其白色背景、工作室构图或反光;@Video 1仅控制镜头路径和加速度,不转移其房间、表演者、物体、色彩分级或声音;@Audio 1仅控制雨的环境音和远处金属共鸣,不添加对话或音乐。生成一个雨暗机械车间中的12秒产品揭幕。画面开始于湿钢工作台上产品大部分藏在炭布下,一只戴手套的手从画右进入一次性拉开布料。水珠留在产品表面,雕刻标记在布料移开时完全可见。结束状态:恰好一件产品无遮挡立于工作台中央,手已从画右退出,定格于居中四分之三近景。光线:冷色顶灯在湿金属上形成窄轮廓光,镜头滑动时一个暖炉火光反射横穿侧面。声音:保留@Audio 1的雨和金属共鸣,添加一次轻柔布料拖动和一次克制金属落定,无语音无音乐。
模式专属保护规则包括:视频编辑必须声明唯一主视频、单一编辑对象、目标数量与替换继承、编辑范围外的保持不变;向前/向后扩展必须以已接受的边界状态为起点(姿势、注视、道具所有权、空间、镜头位置与运动相位、开放主体运动、音频相位),向后扩展还要防止角色/道具/特效在源中尚不存在时提前出现;首尾帧和关键帧独立定义每个端点,补充参考可控制身份/服装/几何但不得覆盖端点构图,多个关键帧建立有序状态而非逐帧复现;故事板控制镜头顺序和近似构图但排除线稿风格、标签和占位角色;粗分镜控制时空骨架,细分镜可在材质/角色/环境/风格渲染前控制完整几何;无缝转场需要物理触发或变形过程、桥接连续运动、明确的到达构图和音频转场------"让它无缝"不是足够的方向。
5.4****提示词 Linter 与能力边界
项目附带确定性结构检查器lint_prompt.py:
python3 seedance-25/scripts/lint_prompt.py prompt.txt --mode auto --duration 30
支持模式:base/reference/long/edit/extend/first-last/keyframes/storyboard/blockout/transition(auto自动推断)。检查的风险包括:计划直出时长超过30秒、无效/重叠/缺口/超出时长的区间、多个无角色或无排除项的参考、无唯一主视频的编辑、无观察边界状态或连续性锁的扩展、不完整的首尾帧定义、无序关键帧、无阅读顺序或线稿排除的故事板、未分类分镜或缺失继承规则、无两个片段/触发/到达状态的无缝转场、长提示词无阶段或可见结束状态、通用风格助推词过载、矛盾音频指令。错误导致非零退出码,警告和信息提示为审查信号。
能力边界诚实声明:核心技能工作流就绪(产提示词和生产计划,不调用视频生成服务);参考库就绪(基于官方指南);提示词linter就绪(启发式,检测结构风险,不评分美学或模型合规);README视觉为解释性插图而非生成的Seedance输出样例;API集成不包含(各平台API需单独验证)。仓库不声称能访问Seedance 2.5、不保证生成结果、不把用户上传素材视为权利证明------真人肖像、声音、品牌、音乐和受保护角色只能在适当授权下使用或替换为原创等价物。
**六、**seedance-video-script :商业分镜工具
seedance-video-script(GitHub: buluslan/seedance-video-script,v0.2.x,MIT,作者Buluu@新西楼.AI)是面向商业场景的Seedance 2.5视频脚本Skill,定位清晰:"把商业意图+素材转成Seedance 2.5可直接使用的视频分镜提示词"------适合跨境电商、电商广告等商业内容团队,因为商业视频的核心诉求是把"产品卖点+营销意图"翻译成模型可执行的镜头语言。
6.1****五大能力
①时间戳分镜:按Seedance 2.5核心语法输出"0-5秒:...;6-10秒:..."形式的分段提示词,每个时间段定义场景/动作/运镜,模型按时间戳精确执行。
②**@** 引用分配:为每个素材标注用途(人物/场景/运镜/音色/产品),参考素材14种用途+4种功能角色+白模(@白模N锁空间结构/运镜/轨迹)。
③编辑能力:支持绿幕/区域/运镜/时间戳编辑(Seedance 2.5新增能力)。
④原生音频:台词、音效、音乐、字幕四层语法四层音频语法+纯音频驱动+多语言。
⑤SPACE 框架:快速版分镜公式,配合8个商业场景模板库(电商带货/产品展示/品牌广告等)和避坑自检(ID漂移/字幕乱入/风格漂移等+解法)。
6.2 5****步生成流程
摸意图(对话式澄清商业目标/场景/平台/比例/素材)→盘素材分配@引用(为每个素材编号并指定角色)→时间戳分镜(按时间段写场景弧线)→音频+约束(台词/音效/音乐分层+平台约束)→避坑自检(检查ID漂移/字幕乱入/风格漂移等风险)。最小输入示例:"给TikTok做个自动猫砂盆的带货视频,30秒,我有产品图和猫咪图",Agent会反问补全或按输入契约一次给全。
项目明确边界:不调Seedance API(纯产出prompt,用户自行上传即梦/方舟生成)、不生成视频本身、不处理素材文件(素材由用户上传平台,skill只给@编号+顺序)。这是一个"零依赖、纯知识底座+prompt生成"的轻量Skill,特别适合不懂提示词工程的商业团队。
七、安装部署指南:让****AI Agent 获得导演技能
开源导演Skill本质上是Agent技能包,安装方式取决于你的AI客户端。以Seedance 2.0 Skill OS为例,支持Claude Code、Codex、Google Antigravity、OpenClaw、Hermes Agent、Gemini CLI、GitHub Copilot、Cursor、Windsurf等15+客户端:
|------------------------|--------------------------------------------------------------------------|---------------------------------------------------------------|
| 客户端 | 安装位置 | 安装方式 |
| Claude Code | .claude/skills/seedance-20/ | git clone后复制到技能目录 |
| Codex | .agents/skills/seedance-20/ 或 ~/.codex/skills/seedance-20/ | python scripts/install_codex_skill.py --force(自动复制,重启Codex生效) |
| Google Antigravity | .agents/skills/seedance-20/(工作区)或 ~/.gemini/antigravity-cli/skills/(全局) | 复制到对应目录 |
| OpenClaw | workspace skills/seedance-20/ 或 ~/.openclaw/skills/seedance-20/ | openclaw skills install(ClawHub兼容,技能已带openclaw:元数据) |
| Cursor | .cursor/skills/seedance-20/ | 复制到技能目录 |
| Windsurf | .windsurf/skills/seedance-20/ | 复制到技能目录 |
| GitHub Copilot | .github/skills/seedance-20/ | 复制到技能目录 |
| Hermes Agent | project skills/seedance-20/ 或 ~/.hermes/skills/seedance-20/ | hermes skills install |
通用安装原则:①技能目录名必须与根技能名一致(如seedance-20);②Codex从工作目录向上扫描.agents/skills,外加用户/系统技能位置;③仓库根含SKILL.md形如技能文件夹,但仍需安装/复制到被扫描的技能目录下才能自动发现;④安装后重启客户端使$seedance-20出现在可用技能列表。
对于seedance-video-script(Claude Code路径):git clone https://github.com/buluslan/seedance-video-script.git ~/.claude/skills/seedance-video-script。
对于Seedance 2.5 Director(Codex路径):git clone后mkdir -p "{CODEX_HOME:-HOME/.codex}/skills"并cp -R seedance2.5-skills/seedance-25到技能目录;或项目本地mkdir -p .agents/skills后cp -R。运行时技能自包含在seedance-25/目录内。
对于官方sd25-pe(火山引擎):npx --yes skills@latest add "https://arkdocs.tos-cn-beijing.volces.com/skills/" --skill sd25-pe --yes,在AI对话框输入/sd25-pe调用。
对于需要API生成的Seedance2-skill:设置export ARK_API_KEY="your-volcengine-ark-api-key",即可用Python CLI一键生成视频。