多媒体制作技术:从实验室走向普通人的创意革命
上个月帮美院的学弟改毕设,吓了我一跳。
五年前我做毕设的时候,剪个4K视频都要卡半小时,转码等一宿,现在他对着AI工具说“把这段航拍的色调调成老胶片,加10%的颗粒感”,十秒钟出来成品。效果不输我当年熬三个通宵调出来的。
实验室里走出来的技术落地,比我们想的快多了
放在二十年前,多媒体制作技术根本不是普通人能碰的东西。非线性编辑一套设备几十万,好莱坞制片厂才敢配齐,国内电视台一个频道也就一两套机器,学这个专业的学生,一学期能摸上两次机就不错了。
现在呢?前两年CVPR顶会上那篇基于扩散模型的AI纹理生成论文,公开不到半年,某头部短视频剪辑APP就把这个功能做成了一键按钮,连没学过任何设计知识的大爷大妈,都能用来给广场舞视频换背景。
高校多媒体制作技术实验室工作站实拍
说实话,我之前也觉得高校实验室里的科研成果,都是发完论文就锁进档案室的东西,离日常应用远得很。直到去年跟一个做多媒体科研的朋友吃饭,他说现在他们课题组接横向项目,第一条要求就是“一年内能落地到C端产品”,不然不接。
什么概念?就是现在做多媒体制作技术的科研,早就不是蹲在实验室写公式凑影响因子了,是盯着市场找真实痛点。你做神经抠图,解决的就是普通人手动抠发丝抠一下午的痛点,做出来直接就能集成到剪图软件里,所有人都能用。
当下多媒体制作技术,最值得关注的突破方向
很多人一提到多媒体制作技术,第一反应就是AI生成内容,不对,AI生成只是表象。真正改变行业的,是端侧化实时多媒体处理。
什么意思?之前做渲染、做剪辑,大一点的文件都得把素材传到云端服务器,算完再下载回来,网速慢一点就要卡十几分钟,出门没网根本没法干活。现在最新的技术成果,可以直接在手机、平板的芯片上跑4K 60帧的实时渲染,拖拽调整光源、修改剪辑点完全无延迟,连网都不用。
手机端实时多媒体制作技术演示现场图
去年移动端芯片开发者大会放的演示,手机上直接实时修改8K VR素材,伸手就能调整场景里的道具位置,画面一点都不卡。搁十年前,这种操作得用几十万的图形工作站才能跑出来。
不过话说回来,另一个我特别看好的方向是多模态交互制作。你不用死守着电脑桌,点鼠标拖时间轴,调无数个参数。对着摄像头比个手势就能切镜头,说一句话就能自动加字幕调播放速度,戴上VR手柄就能直接在三维空间里搭场景,做完直接导出成短视频或者直播素材。
现在国内好几所top高校的多媒体实验室都已经出了可用的原型产品,估计再过两三年,普通用户就能下载到民用版本了。
技术进步也卷走了很多旧岗位,但淘汰的从来都是只会按流程走的工具人。我认识一个做了二十年影视后期的老大哥,十年前他靠熟练掌握复杂的通道抠像就能拿两万月薪,现在他早早学了AI工具的用法,专门给广告公司做前期概念分镜,上个月一个活就赚了三万,比之前坐班赚的多太多。
技术越傻瓜,创意越值钱
技术越傻瓜,创意越值钱
很多人说现在多媒体制作技术这么发达,是不是专业创作者就没饭吃了?完全错。工具是给你省时间的,不是抢饭碗的。
之前做一条一分钟的产品宣传多媒体内容,从拍素材到剪完加特效调色调,要两三天,现在大半天就能搞定所有基础工作,剩下的时间你全都可以用来抠创意,试不同的玩法,不用把生命浪费在重复的机械劳动上。
我前阵子刷短视频,看到一个学编导的在校生,用AI生成加实时剪辑技术,做了一系列“用90年代动画风格拍当代城市街景”的内容,不到两个月涨了八十多万粉,接广告接到手软。放在十年前,他要做这个风格,得一帧一帧手绘,半年都做不出十条内容,根本等不到涨粉就放弃了。
这波技术革命对普通人真的太友好了。之前多媒体制作是门槛极高的行当,你得学三五年软件,攒钱买几万甚至几十万的设备,才能入行接活,现在你只要有个几千块的手机,有想法,就能做出质量不输专业工作室的内容。
当然坑也不少。很多割韭菜的所谓“AI多媒体制作神器”,就是套了个开源模型的壳,卖大几百一年的年费,其实免费版本的功能已经够普通人用了。还有版权问题,现在AI生成素材的版权边界还没完全清晰,做商业内容的时候一定要擦亮眼睛,别踩坑。
也有人说现在的多媒体内容都是AI拼的,没有灵魂。我倒觉得,灵魂这东西从来都不是技术给的,是做内容的人给的。你用老设备拍出来的烂片还是烂片,你用新工具做出来有想法的内容,照样能打动人心。对吧?
昨天路过家楼下的少儿兴趣班,居然看到开了“少儿多媒体创意制作”的班,七八岁的小孩拿着平板剪自己拍的vlog,加动画特效,玩得满头大汗。
你看,再过十年,这批小孩长大,多媒体制作就跟写作文画画一样,是人人都会的基础表达技能了。
多好。