多媒体制作技术:从实验室象牙塔到普通人手里的创作工具
上周逛母校传媒学院的新实验室,撞见几个研究生调实时动捕互动装置,对着空屋子挥挥手,大屏幕上立刻跳出匹配动作的虚拟形象,还自动配上了符合动作节奏的背景音。
我站在旁边看了十分钟,没回过神。
90年代专业多媒体制作工作站设备图
那时候的多媒体制作技术,完全是堆设备堆钱堆出来的,普通创作者碰都碰不到。能做互动多媒体内容的,要么是高校实验室,要么是国家级的媒体机构,普通人连CD-ROM刻录机都见不到,更别说做东西了。
AI驱动多媒体制作在线工具操作界面图
不过话说回来,技术进步的同时,也有一堆新问题出来。比如AI生成内容的版权,比如不同分辨率不同设备的适配,还有怎么防止深度伪造的恶意内容,这些都是现在科研团队啃得头大的新课题。
普通人能蹭到这波技术红利吗
很多人一说多媒体制作技术,就觉得是传媒专业或者计算机专业的人才能碰的东西,和我没关系。
哪能啊。
现在开源的免费工具一大堆,从AI生图到自动剪视频,再到做互动H5,全有免费版能用。你哪怕是个学生,想做个关于自己爱好的互动作品集,拿个普通笔记本就能搞定,根本不需要花大价钱买设备找团队。去年我看全国大学生新媒体竞赛,有个从大山里出来的学生,用免费的AI多媒体工具做了一个关于家乡蜡染的互动H5,进去能点看每一幅蜡染的故事,还能自己上手试染,拿了金奖,整个做下来成本不到三百块,就是花了点钱买服务器流量。换十五年前,这种互动内容,没有几十万根本做不出来。
现在好多人喊,AI抢了多媒体制作的饭碗。
我就一句话,能被抢走的,都是只会套模板混饭吃的。技术把低端的活干了,你就能腾出手来想创意想内容,对吧?以前你做个项目,大半时间花在找素材抠图调颜色上,现在这些活AI几分钟干完,你就能把时间花在讲故事上,花在琢磨用户喜欢什么上。
你说这不是好事是什么?
现在很多科研团队都在往轻量化做,把原来需要高端显卡跑的模型,压缩到能在手机上跑,再过个三五年,你拿个手机就能做个属于自己的VR互动作品,直接发给朋友玩,根本不需要高端电脑。
这种人人都能创作的感觉,不就是当年搞多媒体制作技术的那帮老科研人员,一开始最想看到的吗?
对吧
当年的多媒体制作,是真·贵族玩具
三十年前国内刚开多媒体方向的研究生点,整个系只有一台能剪视频的工作站。 价格顶得上当时半栋教学楼的装修费。 那时候做多媒体,不是说你剪个视频拼两张图就算完。要把文字、图片、音频、视频塞到一张只有650M的CD-ROM里,还要能在配置参差不齐的个人电脑上跑起来,光压缩算法就能卡得科研人员掉头发。我当年听系里老教授说,有个师哥做毕业课题,为了把一个12分钟的纪录片压到能在486电脑上流畅播放,连熬了半个月,机器放实验室不敢关机,每天定三个闹钟爬起来看进度,就怕停电死机重跑。
90年代专业多媒体制作工作站设备图
那时候的多媒体制作技术,完全是堆设备堆钱堆出来的,普通创作者碰都碰不到。能做互动多媒体内容的,要么是高校实验室,要么是国家级的媒体机构,普通人连CD-ROM刻录机都见不到,更别说做东西了。
AI砸进来之后,多媒体制作技术变了天
最近两年顶会上发的多媒体制作相关论文,十篇有七八篇和AI挂钩。 去年SIGGRAPH放出来的那篇文本驱动跨模态多媒体自动生成框架,我下载开源包试了一次,直接看傻了。输入一段几千字的项目文案,它能自动拆分逻辑做分镜,自动生成匹配风格的图片和动效,自动挑符合情绪的BGM,甚至自动给旁白做语音合成和字幕对齐。 我那天下午闲着没事,把手里一个旧的项目文案输进去,不到三个小时,出来的成片质量,赶得上我刚入行的时候跟着团队做一周的活。 说实话,那种冲击感,和我第一次见PS的时候一模一样。 现在的科研方向,早就从当年“怎么把内容塞进去”变成了“怎么让内容更贴合创作者”。现在最火的方向,是风格迁移下的个人化多媒体生成,就是你给AI几张你自己做的图,它就能生成完全符合你个人风格的整套内容,不会千篇一律都是AI脸AI模板。还有实时交互多媒体的生成,就是观众能和你的内容互动,你做直播的时候,AI能跟着观众的弹幕实时改画面改背景音乐,这种放在十年前,就是写在博士论文里的空想,现在小团队都能做出来。
AI驱动多媒体制作在线工具操作界面图
不过话说回来,技术进步的同时,也有一堆新问题出来。比如AI生成内容的版权,比如不同分辨率不同设备的适配,还有怎么防止深度伪造的恶意内容,这些都是现在科研团队啃得头大的新课题。
普通人能蹭到这波技术红利吗
普通人能蹭到这波技术红利吗
很多人一说多媒体制作技术,就觉得是传媒专业或者计算机专业的人才能碰的东西,和我没关系。
哪能啊。
现在开源的免费工具一大堆,从AI生图到自动剪视频,再到做互动H5,全有免费版能用。你哪怕是个学生,想做个关于自己爱好的互动作品集,拿个普通笔记本就能搞定,根本不需要花大价钱买设备找团队。去年我看全国大学生新媒体竞赛,有个从大山里出来的学生,用免费的AI多媒体工具做了一个关于家乡蜡染的互动H5,进去能点看每一幅蜡染的故事,还能自己上手试染,拿了金奖,整个做下来成本不到三百块,就是花了点钱买服务器流量。换十五年前,这种互动内容,没有几十万根本做不出来。
现在好多人喊,AI抢了多媒体制作的饭碗。
我就一句话,能被抢走的,都是只会套模板混饭吃的。技术把低端的活干了,你就能腾出手来想创意想内容,对吧?以前你做个项目,大半时间花在找素材抠图调颜色上,现在这些活AI几分钟干完,你就能把时间花在讲故事上,花在琢磨用户喜欢什么上。
你说这不是好事是什么?
现在很多科研团队都在往轻量化做,把原来需要高端显卡跑的模型,压缩到能在手机上跑,再过个三五年,你拿个手机就能做个属于自己的VR互动作品,直接发给朋友玩,根本不需要高端电脑。
这种人人都能创作的感觉,不就是当年搞多媒体制作技术的那帮老科研人员,一开始最想看到的吗?
对吧