深度 · 小互解读

Higgsfield 将他们的 95 分钟 AI 故事片《Hell Grind》全部提示词和制作方法开源

我们把 4 万多条生成记录的提示词逐条翻了一遍,把这套方法拆出来了:一段所有镜头共用的 12 行技术底座、一套三视图资产表、一份镜头焦段对照表、一堆从模型翻车里长出来的禁令。全都能直接抄。
一分钟速览
  • 他们放出来的不只是成片,是 11 万多次生成记录,每一条提示词都能点开看、能复制。
  • 最值钱的一段:所有镜头共用的 12 行「技术底座」,从皮肤毛孔到 60:30:10 配色,抄下来就能用。
  • 那一大堆禁令是倒着读的说明书,模型会自己加路人、会把同一个人画两遍、会乱编台词。
材料来自 Higgsfield 自己公开的工程档案。开头那句里的制作成本、戛纳放映、外媒报道三点,出自他们自己的公告口径。文中的统计是我们直接调用他们的公开接口抓取 41,132 条生成记录(其中 41,083 条带提示词)后自行点算的,凡是「出现 N 次」「占 N%」这类关于提示词内容的比例,分母都是 41,083;提示词原文按档案原样引用,中文对照为本站翻译。
开源了什么

他们把做这部电影的全部账本摊开了

Higgsfield 将他们的 95 分钟 AI 故事片《Hell Grind》全部提示词和制作方法开源。所有提示词和素材均已公开。这部影片耗资 50 万美元制作,在戛纳市场放映,并获得《华尔街日报》、《综艺》和 BBC 新闻的报道。

公开的东西具体是这些:115,446 次生成记录,装在 108 个文件夹里按场次排好。每一条点开都能看到当时用的完整提示词、用的哪个模型、参数是多少,还能直接下载素材。正片挂在页面顶上,95 分 6 秒,免费看完。

这篇不谈这部片子好不好看,只干一件事:把这套制作方法从 4 万多条提示词里拆出来,能抄的部分原样贴给你。

115,446公开的总生成次数
41,132本站抓取分析的记录条数(其中 41,083 条带提示词)
16,501单条提示词字符数中位数
干货一 · 技术底座

所有镜头共用同一段 12 行「技术底座」

把 4 万多条提示词按行拆开数重复次数,最先浮出来的就是它。这 12 行几乎挂在每一条提示词的末尾,最高频的一行出现了 8,015 次

它的作用相当于摄制组的拍摄规范:不管这一镜拍什么,画质、镜头、光、色、皮肤、物理、表演、构图、连贯性、帧率、声音这十几件事的标准是钉死的。

档案原文 · 复用最广的技术底座(可直接复制)
Style: 8K IMAX. Photorealistic — no 3D render, no game engine,
  no game-cutscene aesthetic.
Cinematography: Emmanuel Lubezki × Roger Deakins.
Camera: Physical cine lens. 180° shutter motion blur.
Lighting: Natural light only — contre-jour backlight, camera on
  shadow side, atmospheric haze throughout. Key light from sky
  and windows only.
Color: 60:30:10 — dominant / secondary / accent.
Skin: Pore-level realism — vellus hair, asymmetric moles,
  capillary flush, pore-shadow matching on-set light.
Physics: Gravity and inertia respected — mass has real weight,
  correct contact shadows. No floating props.
Acting: Hollywood — micro-pauses before reactions, precise
  eye-line, wet living eyes with catch-lights, visible breath
  and chest rise.
Composition: Rule of thirds + golden ratio. Every person moving
  from frame one.
Continuity: Characters, props, environment identical across
  every cut. No identity drift.
Technical: 24fps smooth motion. 8K detail. No jitter.
Audio: Environmental SFX only. No music. No subtitles.

逐行说说每条在干什么,以及各自在档案里出现了多少次:

这一行它在防什么出现次数
Style 8K IMAX 写实,禁三维渲染、禁游戏引擎、禁游戏过场动画感AI 视频最典型的塑料味就来自「像游戏 CG」。把这三样点名禁掉,比写一百遍「要真实」有用5,820
Cinematography Emmanuel Lubezki × Roger Deakins直接点两位摄影指导的名字当风格锚。比形容词精确得多5,219
Camera 物理电影镜头,180 度快门运动模糊180 度快门是电影感的物理来源,写死它,画面就不会出现那种过于清晰、每帧都锐利的电子感6,693
Lighting 只用自然光,逆光,机位在阴影一侧,全程有空气雾感,主光只来自天空和窗户这是整段里最关键的一行。AI 默认会把人打得又亮又平,这行把打光权交给天气和窗户4,942
Color 60:30:10 主色/辅色/点缀色设计里的经典配色比例,防止画面颜色乱成一锅6,444
Skin 毛孔级真实:汗毛、不对称的痣、毛细血管透出的血色、毛孔阴影要跟现场光对上直接点名皮肤要有的四样东西。「真实的皮肤」是空话,这四样是可执行指令6,822
Physics 尊重重力和惯性,质量要有真实重量,接触阴影要对,道具不许飘AI 视频里东西飘起来、脚不沾地是高频翻车点6,490
Acting 好莱坞式:反应前有微停顿、视线准确、眼睛湿润有反光点、看得见呼吸和胸口起伏把「演得像人」拆成四个可执行的细节4,146
Composition 三分法 + 黄金比例,每个人从第一帧就在动后半句是重点:不写这句,AI 容易给你一群站着不动的人7,252
Continuity 人物、道具、环境每一刀之间完全一致,不许身份漂移长片的命门7,706
Technical 24fps 平滑运动,8K 细节,无抖动帧率和画质基线8,015
Audio 只要环境音效,不要配乐,不要字幕模型会自己配乐、自己上字幕,得明确关掉7,513
直接能用 这 12 行是和内容无关的部分,换个题材照样成立。把它存成一个片段,每次写分镜时贴在末尾,你的提示词水平就已经追上了一部院线级 AI 长片的基线。
干货二 · 单镜结构

一条 15 秒镜头的提示词,前面还有七段

技术底座是共用的,前面那一大坨才是这一镜专属的。单条提示词字符数中位数 16,501,约合 3,000 英文词,最长的一条 39,801 字符。这些字都用在了一套固定骨架上。

角色当前状态
此刻身上什么伤、衣服破在哪、什么表情
最占篇幅
SCENE 承接上一镜
这一镜从上一镜的什么状态接上来
34%
这一镜在讲什么
导演意图,给模型一个理解锚
16%
GEOMETRY 站位几何
谁在哪、离多远、朝哪边
37%
DIALOGUE 对白与音效
没台词也要把风声、脚步声写全
36%
ACTION 动作 + 6 个节拍
15 秒拆成 6 拍,每拍一句话
48%
KEY RULES 硬规则与禁令
必须有什么、绝不能出现什么
33%
另外常驻的几段:CAMERA 镜头 58% · NEGATIVE 不要出现什么 25% · LIGHTING 打光 24% · ⚠️ 警告标记 30%
统计自 4,748 条长度超过 3,000 字符的提示词,各段可并存所以不求和为 100%
本站根据抓取到的生成记录统计绘制。百分比是该段落标题在长提示词中的出现频率。

第一段为什么最长:模型没有记忆