DualCam

双摄录像的画中画小窗会自动跟着人脸移动吗?

不会。画中画小窗待在你选定的那个角落、那个尺寸、那个形状里,从头到尾都不会变——它不会为了把人脸框在中间而自己平移、缩放或者挪动位置。小窗里显示的,就是那颗镜头当下拍到的画面,按小窗的形状缩放裁切之后放进去,跟画面里有没有脸完全没关系。

会有这种期待也不奇怪。苹果在部分机型和 FaceTime 这类 App 里提供「人物居中」,用前置摄像头的超广角视野,靠软件实时平移缩放,把检测到的人脸留在画面里。双摄录像乍一看很像——一个小窗里有张脸——所以怀疑背后是不是也在做同样的跟踪,是个合理的疑问。答案是没有,原因要从双摄录像到底是怎么做出来的说起。

每一帧实际发生了什么

双摄录像是一次实时合成:两路摄像头画面在 GPU 上被画进同一张画布,每一帧都是这样,而这张画布就是最终写进文件的内容。画中画小窗是这张画布上一个位置固定的矩形——四个角选一个,三档大小选一个,三种形状选一个。每一帧里,副摄像头当下看到的画面都会被缩放裁切,塞进这个位置不变的矩形。整个流程里没有哪一步会去问「脸在哪儿」,然后据此调整这个矩形——矩形早在画面被画出来之前就已经定好了,跟里面拍到了什么无关。

这也是为什么小窗有时候看着好好的,下一秒人却被切掉一部分:不是它没跟上你,而是它压根没打算跟。它就是一个位置和形状都固定的窗口,显示的是那一刻镜头视野里的东西。

为什么这里没有自动跟踪

像「人物居中」那样的人脸跟踪窗口,其实是完全另一套流程:需要一个够宽的视野可供裁切、需要持续跑在设备上的人脸检测,也需要一种专门为留出这份数字余量而设计的采集格式。多路摄像头会话能选的格式本来就比单摄少——每一路输入都必须跑在明确支持多路的格式上,两路加起来的负载还要压进同一个硬件预算里。在一次实时双摄合成之上,再叠加一条持续跑的人脸检测,等于在采集硬件本就吃得最满的负载上再压一层重活。这不是说这个想法不合理,而是多路会话能用的那份预算,早就全花在「让两路摄像头真的实时合成起来」这件事上了。

这种更简单做法换来的好处,恰恰是双摄录像的立身之本:取景框里看到的那一帧,就是原封不动写进文件的那一帧,事后不会再改。如果换成跟踪窗口,录下来的裁切范围会随着检测算法的猜测不停变化,这就跟「你怎么取景就怎么出片」这个初衷背道而驰了。

没有 App 帮忙的情况下,怎么让自己一直待在小窗里

用尺寸和形状给自己留余量

三档尺寸就是为这个准备的。小尺寸看着精致,但稍微一动就容易被边缘切到;三档里最大的那档,同样的晃动幅度能留出明显更多余量。同样大小下,竖条形状比圆形或方形留的纵向空间也更多——如果你更容易前后倾而不是左右晃,这一点更有用。

拍得久一点就上支架,别一直手持

固定的小窗,前提是手机一直朝着你架好时的方向。手持的话,手上稍微晃一下,你在小窗里的位置变化,不比你自己走动带来的变化小。找个支架或者靠稳的地方架起来,还没开口说话,这一半的问题就先解决了。

发现自己偏了,调手机角度而不是找设置

如果发现自己快滑到边缘了,该做的是调整手机的角度,而不是去找一个能自动解决这事的开关——没有这个开关。画中画的角落、大小、形状确实都能在录制中改,这对分镜头之间重新构图很有用,但没有哪一项会根据人脸当下的位置去重新摆放裁切范围。

如果要经常走动,考虑用分屏而不是小窗

会比划手势、会往前凑、会转身指向身后东西的谈话类镜头,分屏通常比小窗更合适。分屏里每一边占的面积,比画中画任何一档尺寸都大得多,同样幅度的移动,落在框外的概率也小得多。什么时候该用画中画、什么时候该用分屏,见「画中画和分屏怎么选」那篇。

延伸问题

录制中能把画中画小窗挪到别的角落吗?

能——角落、大小、形状都能在录制中改,改完成片立刻跟着变。但这不是自动跟踪,只有你主动去改它才会动。

小窗背后那路铺满画面的摄像头,会跟踪人脸吗?

不会。唯一能实时调整的操作是点按对焦,调的是镜头对哪里聚焦、曝光怎么补偿,不会决定画面里显示哪一部分。取景完全取决于你怎么举手机。

为什么不直接给双摄录像加上「人物居中」那种跟踪?

多路摄像头会话本来能用的硬件预算就比单摄紧张——每一路输入都要用支持多路的格式,两路加起来的负载得压进同一个预算里。在一次实时双摄合成之上再加一条持续跑的人脸检测,等于在采集硬件已经最吃力的负载上再叠一层重活。

想直接开录?

DualCam 让 iPhone 前后摄像头同时工作,边拍边合成为一个 MP4。免费、无需注册、无广告,素材不出手机。

前往 App Store 下载