higgsfield在他们官网上发了一部95分钟的片子,全程都是用AI视频生成的,据说耗费了大概五十万美金,更狠的是他们直接把这个全部流程全部开源了。




相关提示词全部公开了。
地址我放留言区,强烈建议搞内容搞AI创作的都可以去翻一下,可以直接扔给AI让它帮你看也行。人家的方法我们还是可以学到一些的,尤其是现在,我自己用AI搞视频的时候,根本不是怕做不出来,是害怕抽卡费钱啊。



ACTING SKILL.md (角色怎么”演”-行为、眼神、潜台词)
这是一份AI 视频角色表演的完整教科书,教你怎么写 prompt 让 AI 生成”有演技”的人物。简单来说就是:把 AI 当成一个只看得懂”动作指令”的演员(是不是跟前面那个导演文章说的都是一回事:学会当导演),不要指望它懂”情绪”。你描述得越像体育解说(”眼睛先动,头再转,胸口起伏”),它演得越像人。

CINEDANCE HIGGSFIELD SKILL.md – 镜头怎么”拍”(机位、灯光、物理、时间)。

Prompt 结构(固定 12 节)

镜头语言库(不用焦距,用角度) 他们发明了一套角度描述法,绕过 AI 对”85mm”理解不准的问题。
关键:每个角度配 3-4 句”视觉结果描述”(如”背景压成色块”、”前景人物 loom large”),AI 更容易懂。
普通人能直接抄的:
写 prompt 前先画场景地图(哪怕简笔画)—— 空间关系用文字很难描述清
动作按秒拆 —— 0-3秒干嘛、3-6秒干嘛,AI 时间感很差,需要喂
镜头用角度不用焦距 —— “84°广角”比”35mm”稳
物理写具体不写抽象 —— “脚跟着地”比”真实行走”强
输出前检查第一帧 —— AI 最爱开场空镜或人物迟到

LIRA SKILL.md – 图像怎么”生成/修改”(模型选择、prompt 结构、防崩),这是教 AI怎么写图像生成 Prompt,让 Seedance/Soul/NBP 等模型一次出图就能用。

上面的是角色表三件套提示词模板,它网页里有每个角色的最终图:


而且我发现个问题,他们十几秒的视频对应的提示词好长好长!

平均一条都是几千字的!比如你看上面这一条,提示词巨长!我截图一屏幕都不够的。

专业的也是要靠抽卡的!无论是图还是视频,他们也是大量抽卡之后选最满意的 。

这些都是做了N遍之后选了其中一个。我看下人家全部视频素材有十一万五千多个,说不上是百里挑一,那也是几十挑一了。
你要是觉得它这个95分钟的学起来太费劲,没事儿,其实它页面上还有很多其他时长的,比如十几分钟的高质量片子也很多,也都开放了全部流程,我们可以照着来。




比如这个十分钟的。
最后我简单整理下,对我有启发的地方:
1,要有一套角色/场景/道具一致性系统。比如那几个md的文本,可以用来解决AI最容易翻车的地方:人物和场景对不上。
他们的解决办法很土但有效:
-提前做好“角色身份证”——一张特写脸、一张全身正面(故意把头去掉)、一张全身背面。(比如前面提到的角色三件套)
-背景必须是平淡的灰色,光线要平,皮肤要真实(有毛孔那种),不要太“完美”。
-所有东西都起固定名字(比如@小明、@山洞),提示词里反复强调用这些名字。
-连状态都单独拆分:湿身、受伤、换装、白天/夜晚/雨天都做成独立资产,绝不混在一个描述里。甚至说改衣服/伤疤用局部遮罩叠加,绝不整图二次生成,否则皮肤会变塑料、对称、死气沉沉。
2,还有就是那个让我震惊的提示词部分,他们写的提示词超长、超细,像写一份详细的“拍摄指令”。
结构固定不乱:角色数量声明 → 完整角色描述(一字不改)→ 地点参考 → STRICT 约束 → GEO 空间地图 → 场景上下文 → 分拍动作 → 统一 Style Prefix。
怎么走、怎么打、光线从哪来、重力怎么作用、什么东西绝对不能出现(比如漂浮的东西)。
别再写“一个帅哥在战斗”,而是把动作、环境、镜头感觉都写清楚(剧本就显得重要了,所以这里也就把专业度的差距拉开了……)。
3,大量“废片”是正常的 –前25分钟的内容,他们生成了1.6万多个片段,最后只挑出253个能用的。比例大概是64:1。
AI现在还很“抽卡”,你得生成很多,再自己挑好的。别指望一次就完美。人家专业选手都是这样的,普通人更要抽卡了。
当然,也不是一味的乱搞,是讲究方法的,比如下面这两条。
4,先准备“素材库”,再开始生成
他们不是边写边生成,而是先把所有角色、地点、道具都准备好,做成标准图,再按场景一块块生成。
就像做菜前先把所有食材洗好切好,而不是炒菜时才临时去买。
5,按规矩来-规则比人数重要:一人也能按这套跑完整条流水线。
–模型没有记忆:每次提示词都要把完整描述一字不差贴进去,绝不能偷懒缩短。
–只改一行,其他保持原样;所有版本都记日志(改了什么、结果如何)。
–10–15 次法则:超过这个次数还不行,就简化镜头(拆成两个、减动作、换角度),别死磕。
-参考图要明确角色:告诉模型“这是脸参考”还是“地点纹理参考”,地点参考要明确禁止继承构图/角度/颜色。
好了,就这些,我觉得挺好,希望你喜欢。