一、研究方法与数据来源
本文以“为生成图像与后续 3D 建模准备参考”为目标来组织资料,因此不只讨论传统摄影审美,也特别纳入了多角度覆盖、干净背景、均匀光照、细节可读性这些更接近建模与摄影测量工作流的要求。资料来源优先选用镜头厂商与影像软件厂商的官方技术页面,以及少量用于补充公式与教学解释的光学教程与开放教材;核心来源包括佳能中国的人像摄影教程与镜头页面、Profoto 的灯光教程、Adobe 的镜头校正与白平衡文档、ARRI 的色彩与动态范围文档、Polycam 与 Epic RealityScan 的 3D 捕捉最佳实践,以及 Cambridge in Colour 与 Scantips 的视角/景深公式说明。文中凡涉及数值对比表,均统一采用 35mm 全画幅等效视角讨论,并在表格前说明假设条件;景深示例默认以全画幅常用的 CoC 0.03 mm 作为示意计算参数。需要特别注意的是,“等效焦距”只用于比较视角,并不是手机或实际镜头的真实焦距;真实视角由传感器尺寸与真实焦距共同决定。
二、执行摘要
如果把人像摄影拆成最影响画面的五个变量,那么最关键的顺序通常是:机位距离与焦段决定透视关系,机位高度决定脸部与身体比例,主体占比决定“近/远”的主观感受,光圈决定清晰范围,打光决定体积感与纹理可读性。其中最容易被误解的一点是:“广角显脸大、长焦显脸平”本质上主要不是焦段本身在改变脸,而是为了得到相同构图,不同焦段会迫使摄影师站在不同距离上拍摄;距离变近时,鼻子、脸颊等更靠近镜头的部位会被相对放大,距离变远时,这种差异变小,面部趋于平整。 佳能与 Cambridge in Colour 都明确指出了这一点:广角近拍会强化近大远小的人脸膨胀感,而长焦常见的“压缩感”来自更远的拍摄距离与更窄的视角。
对希望给图像生成器或 3D 建模提供参考的创作者来说,最实用的经验不是“某支镜头适合人像”这种笼统结论,而是把提示或拍摄需求写成参数组合。例如,想做“俯拍但脸仍然可读”的 9:16 竖幅人像,单写“俯拍”通常不够,应该写成类似:40mm 等效、高角约 65°、主体占画面高度 55%–60%、人脸占画面宽度 20%–25%、背景保留但不喧宾夺主、不要无人机远景。同理,想做 3D 参考图,也不应只写“模型图”,而应加入完整居中、背景干净、轮廓清晰、避免强景深、增加 45° 主视/高角/俯视/背面 45° 的多角度组图。这类写法与摄影测量/建模的基本原则是一致的:多角度、足够重叠、均匀漫射光、无强烈反光和复杂背景,有助于保留形体与表面信息。
在焦段选择上,可以把常用人像范围粗略分成三组。24/28mm 等效适合环境叙事与夸张透视,但对脸部比例和边缘形变最不友好;35/40/50mm 等效是最稳妥的“可读性区间”,既保留环境关系,又不会把人拍得过平;85/135mm 等效更适合压缩背景、弱化形变和做干净肖像,但过长时会削弱空间层次,让脸部显得更平甚至略显“发胖”。佳能的人像教程甚至直接给出了接近这一经验的结论:作者偏好 50–70mm 左右略带轻微变形的脸部立体感,而 85mm 被普遍视为经典人像焦段;再长的远摄虽然变形更小,但有时会让脸显得更平。
光圈方面,最值得记住的技术结论是:在主体占比相同的前提下,焦段变化对总景深的影响远小于很多人想象,真正主导景深的是光圈和对焦距离;但长焦仍会因为背景被“放大”和视角变窄,而让人主观上觉得背景更糊。 这也是为什么 35mm 与 85mm 在“同样胸像占比”下,总景深差别其实并不大,但后者常常显得背景更干净。对建模参考图,通常不建议长期停留在 f/1.2–f/1.8 的极浅景深;为了让五官边缘、发丝轮廓、服装接缝和表面纹理更可读,f/4–f/5.6 往往更安全。
打光层面,若目标是“既好看,又方便后续建模或做参考”,最稳妥的组合是:大面积柔光主光 + 较弱辅光 + 有控制的轮廓光。Profoto 与 Cambridge in Colour 都指出,大光源会得到更柔和的阴影;填充光能减轻阴影深度,常见安全起点是辅光:主光约 1:2。如果使用自然光,阴天/窗边散射光比中午直晒更适合保留皮肤与材质信息;如果追求“木漏日”“丁达尔光柱”这类氛围,应该把它们视为附加效果层,而不是主照明层,否则纹理参考会不稳定。
三、焦段与透视
原理与关键结论
讨论焦段时,最好先把三个概念分开:视角、透视、畸变。视角由传感器尺寸与焦距共同决定,可用常见公式表示为 AoV = 2 × arctan(传感器尺寸 / 2f);焦距越短,视角越大,画面纳入的背景越多;焦距越长,视角越窄,背景范围越少。Scantips 给出了这一公式,佳能也在官方教程中明确说明:焦距越短,拍到的范围越广;焦距越长,拍摄范围越窄。
但透视不是由焦段单独决定的。Cambridge in Colour 明确指出,当主体在画面中的尺寸保持相近时,广角之所以看起来透视更夸张,是因为你必须站得更近;于是近处的鼻尖、脸颊、膝盖与远处背景之间的相对比例被拉开。佳能的人像教程则把这件事翻译成更直观的语言:广角近拍时,鼻子和脸颊“像是突出来一样”,远摄因为拍摄距离变长,面部各部位之间的距离差相对缩小,于是脸部成像更平稳。
对人像工作流而言,可以把 24/28/35/40/50/85/135mm 等效大致理解为七个“空间表现档位”:
- 24mm:环境信息最多,透视最强,最容易让近处部位膨胀,也最容易出现边缘拉伸。
- 28mm:比 24mm 稍稳,但仍属于明显环境人像与近距夸张透视区间。
- 35mm:是环境人像与叙事型人像里常见的平衡点。
- 40mm:比 35mm 更克制,既接近自然视角,又保留少量环境。
- 50mm:经典标准视角,构图与透视都容易控制。
- 85mm:经典人像焦段,变形小、背景更安定。
- 135mm:压缩背景能力强,画面干净,但容易“把空间拍平”。
下表是示意性计算:假设全画幅 36×24mm,拍摄“胸像高度约 0.6m”,并让主体占画面高度约 55%;再假设背景在主体后方 5m 处。表中的“背景可见宽度”用于帮助理解背景压缩与纳入范围,“鼻尖相对耳平面放大倍率”基于简化的面部深度模型(鼻尖比耳平面前出约 12cm),用于量化“近大远小”的程度。视角公式来自 Scantips,透视解释来自 Canon 与 Cambridge in Colour。
| 等效焦段 | 对角视角 | 为保持胸像占比约55%所需机位距离 | 背景后退5m时可见背景宽度 | 鼻尖相对耳平面放大倍率 | 画面倾向 |
|---|---|---|---|---|---|
| 24mm | 84.1° | 1.09m | 9.14m | 1.11× | 强环境、强透视、边缘风险高 |
| 28mm | 75.4° | 1.27m | 8.06m | 1.09× | 仍明显环境感 |
| 35mm | 63.4° | 1.59m | 6.78m | 1.08× | 环境人像平衡点 |
| 40mm | 56.8° | 1.82m | 6.14m | 1.07× | 叙事与自然感兼顾 |
| 50mm | 46.8° | 2.27m | 5.24m | 1.05× | 中性稳妥、易控制 |
| 85mm | 28.6° | 3.86m | 3.75m | 1.03× | 经典人像、背景干净 |
| 135mm | 18.2° | 6.14m | 2.97m | 1.02× | 压缩明显、空间更平 |
从这张表能直接读出一个非常重要的工作流结论:当你说“这张 9:16 竖图太远了”时,问题往往不是单一的纵横比,而是“纵横比 + 焦段 + 主体占比 + 机位距离”这四项没有同时被约束。 仅仅写“9:16 竖图”很容易被模型理解成“留更多环境”,结果人物变小;如果你把焦段写成 40mm 等效、主体占比写成 55%–60%、机位角度写成 65° 高角俯拍,输出就会稳定得多。这个逻辑同样适用于真人拍摄:构图目标越精确,实际焦段选择越容易收敛。
可操作建议与示例参数
如果目的是生成图像参考而不是追求极端透视风格,建议把焦段理解成下面三类工作区间:
| 目标 | 建议焦段 | 建议光圈 | 典型快门 | ISO | 说明 |
|---|---|---|---|---|---|
| 环境人像、保留场景关系 | 35–40mm 等效 | f/2.8–f/4 | 1/125–1/250 | 100–400 | 兼顾环境与主体,可读性高 |
| 通用人像、表情和五官稳定 | 50mm 等效 | f/2.8–f/5.6 | 1/125–1/250 | 100–400 | 最容易控制比例与背景 |
| 干净肖像、弱化透视 | 85mm 等效 | f/2–f/4 | 1/160–1/320 | 100–400 | 背景更收敛,人物更突出 |
| 高识别度特写 | 85–135mm 等效 | f/2.8–f/5.6 | 1/200–1/320 | 100–640 | 适合脸部与材质细节,但空间更平 |
这里的快门与 ISO 属于制作建议,不是硬性规则;如果是建模参考,宁可略升 ISO,也要避免因快门过慢导致的细节拖影。Polycam 与 RealityScan 都强调:清晰、稳定、足够重叠的图像,是后续几何与纹理质量的前提。
常见问题与解决方案
最常见的问题有三个。第一,“画面太拥挤”。通常不是焦段太近,而是主体占比过高且边缘留白不足。解决方式是:保留 35–50mm 等效,把主体高度占比从 70% 降到 55%–60%,同时明确“主体完整、边缘不过切”。第二,“人物太远”。这通常不是纵横比的错,而是提示中缺少主体占比与镜头距离语义;最直接的改法是写出“主体占画面高度 55%–65%”。第三,“脸有点怪”。如果你已经用了 24–28mm,且人脸靠近画面边缘或机位太近,那么“怪”往往是透视与边缘拉伸一起造成的;改用 35–50mm,并把脸保留在画面中部 60%–70% 区域,通常会立刻改善。
本章小结:焦段不是一个孤立的“镜头味道标签”,而是一个会联动机位距离、背景范围、面部比例的空间参数。对既想要画面好看、又想让图像适合做生成与 3D 参考的创作者来说,35–50mm 等效是默认安全区,85mm 是经典净化区,24–28mm 应当在明确需要环境夸张时才使用。
四、视角与机位高度
原理与关键结论
在人像里,同样的焦段只要机位高度变化,人物气质就会明显改变。佳能中国的人像教程给出了非常实用的观察:在 16mm 广角下,从高角度拍摄时,头部会显得很大;从低角度拍摄时,腿会显得更长,但鼻孔也会被拍得更清楚。换到 50mm 与 85mm 后,这种高度变化造成的印象差异就明显减弱,尤其是 85mm,几乎在不同高度下都能保持较稳定的人物成像。
因此,视角与机位高度的本质,不只是“情绪”,也是比例控制。高角俯拍会让靠近相机的头、肩和面部上平面更突出;低角仰拍会强调下颌、鼻底与腿部延伸;平视则因为镜头最接近脸部的自然观察位置,通常具有最高的表情可读性。对生成图像和 3D 参考来说,机位高度最大的意义在于:你是想强调形体体积,还是想强调脸部识别,还是想尽可能保留自然比例。
可操作建议与示例参数
下面这张表把常用视角整理成更适合创作与提示词使用的形式。表中的角度并不是工业标准,而是基于 Canon 对机位高度影响的描述、结合生成图像与视角控制的工作流建议给出的可执行范围。
| 视角类型 | 建议机位描述 | 建议角度范围 | 对脸部比例的影响 | 表情可读性 | 建议主体占比 | 推荐焦段 |
|---|---|---|---|---|---|---|
| 平视 | 镜头接近被摄者眼高 | 0–10° | 最自然 | 最高 | 50%–65% | 40–85mm |
| 高角俯拍 | 略高于头顶向下看 | 60–80° | 头脸略放大、下半身缩短 | 高,但需主体仰头 | 45%–60% | 35–50mm |
| 顶视 | 镜头几乎直上直下 | 85–90° | 图形化最强,比例最不自然 | 中,依赖被摄者抬头 | 35%–50% | 35–50mm |
| 低角仰拍 | 低于胸口或腰部上拍 | -10° 到 -25° | 下颌、鼻底、腿部被强调 | 中,容易“压表情” | 55%–70% | 50–85mm |
| 背面 45° | 主体背向镜头再回头 | 水平偏转约45° | 强调轮廓与肩背体积 | 中高 | 50%–65% | 50–85mm |
对于你前面提到的“俯拍但不要显得太远,也不要太拥挤”这一类目标,最稳定的解决方案通常不是纯顶视,而是高角 60–70°。原因很简单:90° 顶视非常容易把人物做成“平面化俯瞰图”,而 60–70° 还能保留鼻梁、眼窝、嘴角与肩线的立体信息,让表情仍然可读。佳能对广角高机位会放大头部、对 85mm 高度变化更稳定的观察,也间接支持了这个判断:如果你想俯拍又不想脸变形,高角 + 中焦,往往比纯顶视 + 广角更稳。
对应到示例参数,可以这样用:
| 场景 | 等效焦段 | 光圈 | 快门 | ISO | 机位角度 | 主体占比 |
|---|---|---|---|---|---|---|
| 9:16 俯拍人像参考 | 40mm | f/2.8–f/4 | 1/200 | 100–400 | 65° 高角 | 高度 55%–60% |
| 更自然的平视人像 | 50mm | f/2.8–f/5.6 | 1/125–1/250 | 100–400 | 眼高 0–5° | 高度 55%–65% |
| 情绪化低角肖像 | 85mm | f/2–f/4 | 1/200 | 100–400 | -15° 左右 | 高度 60%–70% |
常见问题与解决方案
如果你遇到“俯拍时脸太小”,多数情况下不是角度不对,而是角度太高 + 焦段太广 + 主体占比没约束。最佳修正顺序一般是:先把主体占比提高到 55% 左右,再把角度从 90° 拉回 65° 左右,最后把 24–28mm 改成 35–50mm。反过来,如果你遇到“仰拍显得用力过猛”,问题通常出在机位太低且焦段太广;这时改成 50–85mm,并把机位抬高到略低于胸口,而不是膝盖甚至地面,鼻底与下颌就会自然很多。佳能对 16mm 低角会明显看到鼻孔、对 85mm 高度变化更平稳的结论,正是这类修正的直接依据。
本章小结:机位高度决定的是“人物怎样被观看”。要想让图像既有视角性又保留面部可读性,高角 60–70° 往往比纯顶视更实用;平视最自然;低角最适合做力量感,但对鼻底、下颌与腿部比例要有意识地控制。
五、构图与主体占比
原理与关键结论
在生成图像与摄影沟通里,“近一点”“远一点”常常不够精确。真正高效的写法,是把“近/远”转换为主体占比。最实用的两个指标是:
- 主体高度占比 = 主体投影高度 / 画面高度
- 脸部宽度占比 = 脸部投影宽度 / 画面宽度
这两个指标的价值,在于它们能直接对接生成图像、摄影构图、后续建模与纹理采样。举例来说,9:16 竖构图里写“主体占画面高度约 55%,脸部占画面宽度约 22%”,比单写“中近景竖图”要稳定得多。Polycam 的对象拍摄指南也从另一个侧面支持了这种思路:它建议既要有完整外轮廓的整体现身图,也要有更近的细节图,而且细节图不必总是完整显示全物体,关键是清晰、重叠、角度变化合理。
可操作建议与示例参数
如果你的目标是给 3D 建模、角色设定或图像生成提供“既完整又可读”的参考,可以把主体占比理解成以下四档:
| 主体高度占比 | 主观观感 | 适合用途 | 对 3D 参考的价值 |
|---|---|---|---|
| 45% | 偏远,留白和环境多 | 场景关系、动作与氛围建立 | 适合整体轮廓,不适合面部细节 |
| 55% | 平衡 | 通用参考图、俯拍人像、角色设定 | 最稳妥,兼顾结构与环境 |
| 65% | 偏近 | 强调表情和服装局部 | 适合人物主体,但边缘控制要更严 |
| 70% 及以上 | 明显特写 | 面部纹理、材质参考、情绪特写 | 不适合作为唯一建模图,应与中景搭配 |
如果你要把这套逻辑写进提示词或交付规范,建议至少同时写出四个量:纵横比、焦段等效、机位角度、主体占比。例如:
- 通用 9:16 高角人像:9:16,40mm 等效,65° 高角,主体高度 55%–60%,脸部宽度 20%–25%。
- 更近特写:9:16,50mm 等效,平视或稍高 10°,主体高度 70%,眼睛清晰可辨,边缘不过切。
- 用于建模的完整半身参考:3:4,50mm 等效,平视,主体高度 60%,双肩完整,背景干净。
这类明确比例的写法与 Polycam / RealityScan 强调的“系统性、多角度、足够重叠”是一致的:越能明确主体范围,越容易组织后续的多视图组图。
常见问题与解决方案
“画面拥挤”几乎总对应主体占比过高,尤其是在竖幅里把头部压得太满;通常把主体高度从 70% 降到 55%–60%,并要求“手、猫或重要道具完整进入画面”,就能解决绝大多数问题。相反,“人物太远”并不是让 AI “再近一点”就够了,而要写成“主体高度不能低于 55%”。如果你要为 3D 建模准备参考,建议至少准备两组:一组 55%–65% 的完整结构图,另一组 70%–80% 的材质细节图;前者给形体,后者给纹理。Polycam 也建议在整体环拍之外,额外补拍近距离表面细节,并从略微不同角度反复覆盖。
本章小结:主体占比是把“视觉主观感受”翻译成“可执行参数”的最好方式。对生成图像与 3D 参考来说,55%–65% 是最通用的主参考区间;70% 以上更适合补充特写,而不适合单独承担完整结构说明。
六、光圈景深与镜头校正
原理与关键结论
景深最常被误解的地方在于,人们经常把“背景看起来更糊”误认为“景深一定更浅”。Cambridge in Colour 给出的结论非常关键:景深主要由光圈与对焦距离决定;在主体占比相同、也就是放大率相同的前提下,不同焦段的总景深其实近乎恒定。 长焦看起来更容易得到“糊背景”,很大程度上是因为背景被放大了,且视角更窄,于是失焦区域更显著。佳能的人像教程则从实拍经验上补充了另一面:想要获得更强虚化,通常应尽量使用更长焦距、更大光圈,并拉开主体与背景距离。
这意味着,对“参考图”而言,极大光圈未必总是好事。如果你只是追求情绪氛围,f/1.4–f/2.0 非常动人;但如果你需要后续做 3D、建模、贴图或稳定识别五官边缘,那么让眼睛清楚、鼻尖不糊、耳缘不过分虚,是更重要的目标。很多时候 f/4–f/5.6 比 f/1.8 更适合做“信息型图像”。
下表展示的是在相同主体占比下的总景深示意。假设仍为全画幅、胸像高度约 0.6m、主体占画面高度约 55%,CoC 取 0.03 mm。表格的重点不是让你记住每个数字,而是看见一个反直觉事实:24–135mm 在“同样胸像大小”下,f/1.8、f/2.8、f/4 的总景深非常接近。 计算依据来自 Cambridge in Colour 的景深关系与 CoC 概念说明。
| 等效焦段 | 同样胸像占比下机位距离 | f/1.8 总景深 | f/2.8 总景深 | f/4 总景深 | f/5.6 总景深 |
|---|---|---|---|---|---|
| 24mm | 1.09m | 0.22m | 0.35m | 0.51m | 0.75m |
| 35mm | 1.59m | 0.22m | 0.34m | 0.50m | 0.71m |
| 50mm | 2.27m | 0.22m | 0.34m | 0.49m | 0.69m |
| 85mm | 3.86m | 0.22m | 0.34m | 0.49m | 0.68m |
| 135mm | 6.14m | 0.22m | 0.34m | 0.49m | 0.68m |
与之形成对比的是固定机位距离。如果摄影师站在 2m 不动,那么长焦确实会让景深急剧变浅,因为放大率提高了。这才是许多实拍经验里“长焦更浅”的真正来源。下表同样是示意计算。
| 等效焦段 | 固定 2m 距离时 f/1.8 总景深 | f/2.8 总景深 | f/4 总景深 | f/5.6 总景深 |
|---|---|---|---|---|
| 24mm | 0.77m | 1.25m | 1.97m | 3.40m |
| 35mm | 0.35m | 0.55m | 0.80m | 1.16m |
| 50mm | 0.17m | 0.26m | 0.38m | 0.53m |
| 85mm | 0.06m | 0.09m | 0.13m | 0.18m |
| 135mm | 0.02m | 0.03m | 0.05m | 0.07m |
镜头畸变与量化建议
镜头校正也要分清楚两类问题。桶形/枕形畸变属于镜头本身的光学畸变;透视变形则常常来自相机与主体的空间关系,或相机没有正对平行线。Cambridge in Colour 与 Adobe 都明确区分了这些问题:广角端常见桶形畸变,长焦端常见枕形畸变,而透视问题常可用 Upright / Transform 修正;Adobe 还特别建议先套用镜头校正配置文件,再做透视校正。
对人像而言,更实用的“量化建议”不是去记某颗镜头的畸变百分比,而是记住拍摄距离阈值。如果用一个简化模型,假设鼻尖比耳平面前出约 12cm,那么拍摄距离越近,鼻尖相对耳平面的放大就越强。基于这一几何关系,可以得到下面的实用表:
| 镜头到鼻尖距离 | 鼻尖相对耳平面放大倍率 | 实务判断 |
|---|---|---|
| 0.4m | 1.30× | 强烈夸张,除非故意风格化 |
| 0.6m | 1.20× | 明显膨胀,不适合常规肖像 |
| 0.8m | 1.15× | 仍偏强,适合环境感但不够中性 |
| 1.0m | 1.12× | 还能接受,但面部仍有张力 |
| 1.2m | 1.10× | 可作为胸像/半身的下限参考 |
| 1.5m | 1.08× | 较自然 |
| 2.0m | 1.06× | 更接近经典人像透视 |
这张表的意义非常直接:如果你不想人物脸型被广角近距离夸张,胸像或半身最好让镜头距脸至少在 1.2m 左右;如果你希望更自然,1.5m 以上更保险。 这与佳能“广角近拍会让鼻子和脸颊突出、85mm 变形更小”的观察完全一致。
可操作建议与示例参数
如果你的目标是参考价值优先,可以按照下面的光圈策略来分工:
| 目标 | 建议光圈 | 说明 |
|---|---|---|
| 氛围优先、明显散景 | f/1.8–f/2.2 | 强情绪,但不建议作为唯一参考图 |
| 通用人像参考 | f/2.8–f/4 | 兼顾层次与主体分离 |
| 建模/贴图友好 | f/4–f/5.6 | 五官、轮廓、服装线条更稳定 |
| 产品/模型/实体参考 | f/5.6–f/8 | 适合信息清晰、边界完整的图 |
如果需要后期校正,推荐顺序通常是:先镜头配置文件 → 再透视 Upright / Transform → 最后裁切重新构图。Adobe 明确建议先做镜头配置文件校正,再做 Upright 透视修正,因为这能让后续分析更准确。
常见问题与解决方案
“背景很糊但人物也有点糊”通常不是对焦失败,而是光圈过大导致鼻尖、耳缘、发丝已经滑出“可接受清晰范围”。如果图像是给建模或生成参考用,优先从 f/1.8 收到 f/2.8 或 f/4,再检查主体与背景的距离。另一个常见问题是“建筑线条歪、人物在边缘被拉伸”;前者优先用 Adobe 的透视/变换工具处理,后者则应在拍摄或生成阶段就把脸和身体关键部位置于画面中央区域,并避免用 24–28mm 把脸贴近边缘。
本章小结:景深真正由光圈与距离主导;镜头看起来“更糊背景”并不等于总景深一定更浅。对需要信息清晰的人像参考图,f/4–f/5.6 往往比极大光圈更有用;对畸变控制,距离阈值比单纯“换镜头”更重要。
七、打光类型与色彩控制
原理与关键结论
灯光决定的不是“亮不亮”,而是脸有没有体积、材质有没有层次、背景会不会抢戏、纹理能不能可靠地被观察。Profoto 的教程把一个非常关键的规律讲得很清楚:大光源会产生更柔和的光,小光源会产生更硬的光;光源方向若与环境光方向一致,会更自然。 这几乎是所有人像打光的底层原则。
在两盏灯或主辅光结构里,Cambridge in Colour 进一步指出:填充光会减轻阴影深度、软化面部观感;常见安全起点是辅光:主光约 1:2。 比这更弱的填充更戏剧化,比这更强的填充则会更平、更“商业”。同时,填充光放在镜头附近的 on-axis 位置最不容易产生双重阴影;如果把辅光移到侧前方,则需要更大更软的光源,否则鼻影与轮廓边缘容易出现二次阴影。
打光类型与位置建议
下面这张表把自然光与人造光拆成更适合创作和参考图制作的语言。文中“3D 参考价值”一栏,是基于 Polycam / RealityScan 对均匀漫射光、清晰纹理和多角度可见性的要求给出的工作流评价。
| 光型 | 位置/形态 | 画面效果 | 建议光比或强度 | 对 3D 纹理参考的价值 | 常见风险 |
|---|---|---|---|---|---|
| 直射自然光 | 太阳直打,近似小光源 | 阴影硬、边缘清晰、对比强 | 主光可很强,辅光建议补 1:4 到 1:2 | 中等,适合形体但容易丢阴影细节 | 高光爆、眼窝死黑 |
| 散射自然光 | 阴天、窗边、漫反射 | 皮肤平顺、过渡自然 | 通常可不补,或极弱辅光 | 很高,适合信息型参考图 | 体积感偏弱 |
| 木漏日 | 斑驳树影形成局部亮斑 | 有节奏的高光图案 | 仅作氛围层,不应充当唯一主光 | 中等偏低 | 图案不稳定、脸部信息被打断 |
| 丁达尔光束 | 雾/微粒使光路可见 | 强气氛、空间层次感 | 作为背后或侧后附加效果 | 低到中等 | 影响清晰读取 |
| 主光 | 45° 侧前上方最常见 | 定义主阴影与体积 | 1.0 | 很高 | 过硬会显毛孔/瑕疵 |
| 辅光 | 镜头附近或反侧补光 | 减轻阴影深度 | 0.5 为安全起点 | 高 | 过强会“拍平” |
| 背光/轮廓光 | 后侧上方向主体边缘打 | 分离主体与背景 | 弱于主光或接近主光边缘值 | 高,利于看清轮廓 | 头发/肩线爆高光 |
| 柔光箱/大伞 | 大面积修饰器 | 软、包裹感强 | 适合主光或辅光 | 很高 | 体积感不足时需加轮廓光 |
| 硬光反射罩/裸灯 | 小面积,方向性强 | 对比强、纹理明显 | 更适合风格图 | 中 | 皮肤与反光面过“硬” |
关于“木漏日”和“丁达尔”,需要明确它们的摄影本质。木漏日并不是一种独立光学原理,而是叶隙造成的局部直射光斑;丁达尔效应则是微粒或胶体对光线的散射,使光束在雾、烟、微粒介质中变得可见。OpenStax 对丁达尔效应的解释很直接:胶体颗粒足够大时会散射可见光,因此像雾和烟中的光束会被“看见”。换句话说,木漏日更像图案层,丁达尔更像体积层;两者都很美,但都不应该替代稳定的主照明。
色彩与白平衡
白平衡的首要任务不是“变好看”,而是先让白看起来像白,肤色不偏到难以判断。ARRI 明确指出,若你希望得到准确的色彩表现,应该让相机白平衡匹配场景中的光源,并用中性灰目标检查是否仍有色偏;Adobe 也强调,不同光源会带来不同色温与偏色,阴天偏冷、钨丝灯偏暖,某些荧光源还会引入绿色偏移。两家都建议在需要精确时使用灰卡,并尽量避免严重混光,因为混光是后期最难完全修正的问题之一。
在工作流实践里,可以把白平衡分成两个层级。第一层是技术中性层:如果你是在做参考图、材质图、贴图观察,建议先落在较中性的日光区间,例如约 5200K–5600K 的视觉感受,并尽量控制绿色/洋红偏移。第二层是风格层:当你已经得到一版准确肤色后,再用 LUT 与曲线做情绪化处理。Adobe 对 LUT 的说明是:LUT 可以作为风格与色彩映射的起点,而曲线适合进一步精细调整亮度、对比度与色彩。简化地说,LUT 决定“往哪里去”,曲线决定“去多少”。
如果你的目标是人像与 3D 参考兼顾,我建议:
- 参考优先:先做中性白平衡,保留真实肤色与服装颜色。
- 风格优先:在中性版基础上复制一版,再加 LUT 或曲线做风格化。
- 混光现场:尽量统一主光色温,而不是指望后期“全修回来”。
这与 Adobe 对 RAW、灰卡和一致光源的建议、以及 ARRI 对白平衡与 CC 偏移管理的说明是一致的。
常见问题与解决方案
“人好看但不适合建模”常见原因是光太戏剧化:单侧硬光、脸上一半掉进深阴影、或者木漏日把关键结构切碎了。解决方式不是把所有光都打平,而是把主光放大、辅光加到约 1:2、轮廓光轻轻补上。反过来,“图很平,没有层次”则往往是柔光过大、辅光过强,且背景与主体亮度接近;这时减弱辅光、增加一点轮廓光,通常就能恢复体积感。对于肤色偏色的问题,最优先的修正通常仍然是白平衡与混光管理,而不是先上风格 LUT。
本章小结:打光决定信息质量。若以参考价值为优先,最稳妥的结构通常是大面积主光 + 温和辅光 + 受控轮廓光;若以风格感为优先,再叠加木漏日、雾、丁达尔等效果层。色彩处理则应遵循“先准确、后风格”的顺序。
八、输出参数与批量生成清单
输出参数与比例建议
对于“摄影参考图 / 生成图 / 3D 参考图”三种用途混合出现的项目,建议一开始就把输出规格拆清楚。下面这张表给出的是实务上比较稳妥的组合:
| 用途 | 建议纵横比 | 建议最小分辨率 | 建议焦段 | 建议光圈观感 | 备注 |
|---|---|---|---|---|---|
| 角色/人像主视觉 | 9:16 | 3072 × 5464 以上 | 35–50mm | f/2.8–f/4 | 适合移动端展示与竖屏滚动 |
| 通用参考图 | 3:4 | 3072 × 4096 以上 | 40–85mm | f/4–f/5.6 | 兼顾结构与细节 |
| 模型/物件标准参考 | 1:1 | 3072 × 3072 以上 | 50–85mm | f/5.6–f/8 | 便于统一比对各面信息 |
| 细节补拍 | 任意,但建议 3:4 | 2048 × 2731 以上 | 85–135mm | f/4–f/5.6 | 专门补纹理和接缝 |
对于后续 3D 重建或建模参考,多视图比单张“神图”更重要。Polycam 与 RealityScan 都强调:对象应从不同高度与角度进行系统性拍摄,图像之间需要约 70% 的重叠;复杂形体需要额外补高位、低位、顶视和细节图。Polycam 还指出,**45–65° 的斜拍(oblique)**尤其适合同时捕捉水平面和垂直面。
四张不同角度的建议参数
你前面提到“应该生成四张不同角度的,这样每一面都能看清”,这与 3D 捕捉的基本原则高度一致。下面给出一套可直接执行的“四视图参考组”:
| 视图 | 纵横比 | 等效焦段 | 光圈建议 | 快门 | ISO | 机位角度 | 主体占比 | 灯光建议 | 目标 |
|---|---|---|---|---|---|---|---|---|---|
| 45° 主视 | 3:4 或 1:1 | 50mm | f/5.6 | 1/160 | 100–200 | 水平偏转 45°,平视 | 60%–70% | 主光 45° 侧前上,辅光 1:2 | 建立主要体积与正面细节 |
| 俯视 | 3:4 | 40–50mm | f/5.6 | 1/160 | 100–200 | 85–90° 顶视 | 45%–55% | 漫射主光,弱轮廓光 | 观察顶部结构与平面关系 |
| 高角 65° | 9:16 或 3:4 | 40mm | f/4–f/5.6 | 1/200 | 100–400 | 高角约 65° | 55%–60% | 柔和主光 + 轻辅光 | 兼顾表情与结构,可读性最好 |
| 背面 45° | 3:4 或 1:1 | 50–85mm | f/5.6 | 1/160 | 100–200 | 背向镜头 45° | 60%–70% | 加轻微轮廓光 | 交代后部结构、轮廓、连接关系 |
如果是摄影棚里的精密实体模型,建议把四视图都做成完整居中、背景统一、边界清晰、弱景深或中景深的版本;如果是人物参考图,则建议再额外加一组更近的材质特写。Polycam 的对象模式建议在完整环拍之外补拍近距离细节、底部与隐藏面,这一点对模型、服装、发饰和机械结构都很重要。
可直接使用的中文提示词模板
下面给出三套可直接使用的 prompt 模板。它们不是“唯一正确写法”,但都遵循了本文反复强调的几个原则:明确焦段、机位、主体占比、背景状态、光照性质和负面限制。
摄影棚精密模型用于三维参考
主提示词
一座失落的未来天文观测站,像摄影棚中的精密实体模型,完整居中展示,深灰纯净背景,轮廓清楚,结构完整,边缘不过切。古老石质遗迹底座上悬浮巨型环形星盘,青铜符文、银色机械臂、蓝色能量核心,科幻考古风,写实材质,复杂可辨识细节,50mm 等效视角,45 度主视图,中景深,整体清晰,表面纹理可读,适合作为 3D 建模参考。
负面提示词
不要人物,不要文字,不要水印,不要背景建筑,不要浓雾,不要极暗曝光,不要过度发光,不要纯插画风,不要裁切,不要强景深虚化,不要夸张广角变形。
9:16 人像俯拍模板
主提示词
9:16 竖屏,高角度俯拍,约 65 度顶机位,不是无人机远景。40mm 等效焦段,近距离环境人像构图。年轻东亚裔女性蹲在花园小径上轻轻逗弄一只毛茸茸的橘猫,人物和猫作为主体占画面高度约 55%–60%,人物脸部占画面宽度约 20%–25%,主体完整清晰,边缘不过切,保留适量花园路径和树叶留白。头顶枝叶过滤阳光形成灵动木漏日,淡淡潮湿薄雾中有可见但不过强的柔和光束,边缘轻微雾化,电影感写实摄影,表情自然可读,皮肤与猫毛纹理清晰。
负面提示词
不要无人机视角,不要极远景,不要人物太小,不要拥挤构图,不要文字水印,不要背景杂乱,不要强虚化,不要脸部变形,不要过曝高光。
更近特写模板
主提示词
9:16 竖屏,50mm 等效焦段,平视或略高 10 度,人物主体占画面高度约 70%,近景特写但不过切头顶与下巴,眼睛清晰锐利,肤质与发丝可见。年轻东亚裔女性与橘猫互动瞬间,神情从轻微俏皮过渡到真挚微笑,背景简洁柔和,散景适中,保留少量花园色彩与圆形光斑,真实摄影质感。
负面提示词
不要超广角,不要鼻子夸张,不要过浅景深,不要边缘拉伸,不要猫被遮挡,不要文字水印,不要插画化。
适合批量生成的示例图片清单
下表可以直接作为 Codex、自动化脚本或批量生成器的任务清单。它覆盖了“整体结构图 + 细节图 + 氛围图”的组合思路,便于后续筛选。参数设置依据本文前述的构图、打光与多角度原则。
| ID | 类型 | 纵横比 | 视角/机位 | 等效焦段 | 光圈观感 | 主体占比 | 光照设定 | 用途 |
|---|---|---|---|---|---|---|---|---|
| M01 | 模型主参考 | 3:4 | 45° 主视 | 50mm | f/5.6 | 65% | 柔和棚灯 + 弱辅光 | 结构主图 |
| M02 | 模型顶视 | 3:4 | 顶视 90° | 40mm | f/5.6 | 50% | 均匀漫射光 | 顶部结构 |
| M03 | 模型高角 | 3:4 | 高角 65° | 40mm | f/5.6 | 60% | 主光 45° + 轮廓光 | 立体关系 |
| M04 | 模型背面 | 3:4 | 背面 45° | 50mm | f/5.6 | 65% | 弱轮廓光 | 后部细节 |
| P01 | 人像主图 | 9:16 | 高角 65° | 40mm | f/2.8–f/4 | 55% | 木漏日 + 轻辅光 | 氛围与结构兼顾 |
| P02 | 人像平视 | 9:16 | 平视 | 50mm | f/2.8–f/4 | 60% | 柔和自然光 | 脸部比例参考 |
| P03 | 人像近景 | 9:16 | 平视略高 | 50mm | f/2.8 | 70% | 柔光主光 | 表情与肤质 |
| P04 | 人像背面 45° | 3:4 | 背面 45° | 85mm | f/4 | 60% | 轮廓光稍强 | 发型/肩背轮廓 |
| P05 | 材质细节 | 3:4 | 局部特写 | 85–135mm | f/4–f/5.6 | 80% | 均匀柔光 | 纹理与表面 |
| P06 | 低角风格图 | 9:16 | 仰拍 -15° | 85mm | f/2.8 | 65% | 主光偏侧 | 情绪版补充 |
本章小结:输出参数的本质,是让不同用途的图片各司其职。对生成和建模最友好的不是“一张万能图”,而是完整结构图、角度补充图、细节纹理图的组合。四视图策略、统一背景、柔和但层次清楚的灯光,以及明确的主体占比,是把摄影语言转成建模语言的关键。