Seedance 2.0 开源「导演模型」Skill:一键写剧本、分镜、提示词,把 AI 视频拉到电影级

Seedance 2.0 开源「导演模型」Skill:一键写剧本、分镜、提示词,把 AI 视频拉到电影级
做 AI 视频最痛苦的是什么?不是不会用工具,而是给模型写提示词。你写"史诗级电影镜头,女人读信,光线唯美",出来的东西往往又假又空。
最近 GitHub 上一个爆火的开源项目把这件事彻底换了个思路:别让模型"装饰画面",而是让模型像一个真正的导演那样去"指挥场景"。这就是 Emily2040 的 Seedance 2.0 Skill OS(GitHub 实测 6244★、MIT 协议)。
核心痛点:会写"形容词",不会"执导"
大多数 AI 视频工具,用户只会给模型堆描述词——"电影感""唯美""高大上"。模型收到的是抽象的形容词,自然只能输出空洞的画面。
而真正的导演拿到一个镜头,会先搞清楚:这场戏在"做什么"——人物在哪、做什么动作、镜头怎么走、光线怎么打、声音怎么配,全部为一个意图服务,而且整部片子保持同一种"导演风格"。
怎么实现:让 AI 先"读场",再写提示词
这个项目叫做 Skill OS,本质是一个会"读场再下笔"的 AI 导演 agent。它支持文本、图像、视频、参考视频四种输入,还能原生处理音频、安全改写文案、提供多语言文档。
它的核心机制是一套强制的「导演阅读」(Director's Read):在写任何叙事/故事/表演提示词之前,先拆解镜头里的功能、视角、权力转换、目标、障碍、矛盾、一个可观察的压抑行为、一个不可转移的细节、一个明确的类型禁忌——把"这场戏到底在干什么"想清楚,再生成连贯的机位、灯光、调度、表演和声音方案。
对比一下:
- ❌ 普通写法:
epic cinematic shot of a woman reading a letter, emotional, beautiful lighting - ✅ 导演式写法:
A woman at a kitchen table reads the letter twice, then her hands lower it and go still. Camera: medium close-up at eye level, a slow push-in that settles when her hands stop. Soft window light keeps her face plain. Sound: room tone, one chair scrape, near-silence — the realization lands in the stilled hands, not a word.
区别就在于:先写"谁在做什么",再写"镜头怎么拍"。模型先锁定画面的主角和动作,机位、光线、声音跟着来,画面立刻有了灵魂。
项目还内置了 33 个完整的实战工作流(产品、MV、恐怖、动漫、动作、喜剧、纪录片、高定时装、科幻等),每个都是端到端演示,照抄就能用。
解决什么问题
- 告别"提示词玄学":不再靠堆形容词碰运气,而是用一套可复现的导演逻辑生成高质量镜头。
- 长视频也能保持统一风格:同一部短剧的每一条素材,都能保持同一种导演嗓音,不会跳戏。
- 多语言零门槛:提供中文、日文、韩文等 6 种语言的一等公民入口和专用提示词指南,中文用户从角色锁定、首尾帧、运镜、动作节奏入手即可。
一句话总结
Seedance 2.0 Skill OS 把"写提示词"升级成了"当导演"——先读场、再执导,让 AI 视频从"会输出的模型"变成"会拍片的导演"。想做出电影级 AI 视频,这就是目前最值得上手的那把钥匙。