A-SOUL出道两年粉丝破千万:动作捕捉技术让虚拟偶像跳舞唱歌背后藏着怎样的产业链和从业者真实收入
说起A-SOUL,我相信不少人在短视频平台上都刷到过她们跳舞的片段。五个性格鲜明的女孩,有着光滑精致的二次元面孔,在舞台上唱唱跳跳,动作流畅得几乎看不出是”假人”。但你可能不知道的是,这五个”人”背后,站着几十个真正的打工人。
今天咱们就扒一扒,一个虚拟偶像要站上台,到底需要经过多少环节,每个环节的人又能赚多少钱。
虚拟偶像不是”一个人”,是一整个团队在撑着
很多人第一次看到A-SOUL的时候,下意识会觉得:哇,她们好厉害,跳舞跳得这么好,一定是专业的虚拟主播。
但真相可能有点扎心——你以为你在看五个女孩表演,实际上你在看的是十几个幕后人员在实时操控。
A-SOUL的五位成员分别是向晚(Ava)、贝拉(Bella)、珈乐(Carol)、嘉然(Diana)和乃琳(Eileen)。但每个”人”的背后,至少有一个动捕演员在操作。
动捕演员是谁?简单说,就是穿着特殊衣服、脸上贴着标记点的人。他们坐在一个特制的棚子里,通过动作捕捉设备,把自己的一举一动实时”移植”到虚拟形象上。
一个典型的动捕现场是这样的:
动捕演员穿着贴满反光标记点的紧身衣,脸上也有专门的标记点。头顶有一个摄像头阵列,或者周围墙壁上安装着多个红外摄像机。这些设备会实时捕捉标记点的位置,然后经过软件处理,把演员的动作”映射”到虚拟角色身上。
动捕设备类型对比
1. 光学动捕系统(A-SOUL用的主要类型)
- 设备:OptiTrack / Vicon / Motion Analysis
- 价格区间:50万-200万人民币
- 优点:精度高,延迟低(<5ms),适合高精度面部捕捉
- 缺点:需要暗室环境,设备昂贵,校准复杂
2. 惯性动捕系统
- 设备:Xsens / Noitom
- 价格区间:10万-50万人民币
- 优点:不受光线影响,便携
- 缺点:长时间使用有漂移,精度略低
3. 深度相机动捕(新兴方案)
- 设备:Intel RealSense / Azure Kinect
- 价格区间:5千-3万人民币
- 优点:成本低,-setup简单
- 缺点:精度有限,易受环境光干扰
A-SOUL作为国内顶流虚拟偶像团体,用的大概率是OptiTrack或者Vicon这类高端光学动捕系统。这类系统的精度可以达到亚毫米级别,延迟极低,能保证演员的动作和虚拟形象几乎同步。
动作捕捉技术:从”假人跳舞”到”灵魂附体”
动捕技术的工作原理
让我用一个简单的比喻来解释动捕技术:
想象一下,你在看一部电影,主角的每一个表情、每一个动作都栩栩如生。但你知道,演员其实是在绿幕前表演的,后期的CGI角色才是最终你看到的样子。
动捕技术就是连接”真人表演”和”虚拟形象”的桥梁。
动捕技术流程示意
动捕演员表演 → 标记点捕捉 → 数据解算 → 骨骼绑定 → 虚拟形象驱动 → 实时渲染 → 输出画面
具体步骤:
1. 标记点捕捉
- 动捕演员身上贴有30-100个反光标记点
- 多台红外摄像机从不同角度拍摄
- 每个摄像机捕捉到标记点的位置坐标(x,y,z)
2. 数据解算
- 系统根据多个摄像机的数据,计算出每个标记点的3D位置
- 通过已知的骨骼模型,推算出各个关节的角度和位置
- 输出骨骼旋转数据(通常用四元数表示)
3. 骨骼绑定
- 虚拟角色有自己的一套骨骼系统
- 动捕数据被"绑定"到虚拟角色的骨骼上
- 这个过程叫"重定向"(Retargeting)
4. 实时渲染
- 游戏引擎(如Unity/Unreal)接收骨骼数据
- 驱动虚拟角色的表情、动作
- 输出最终画面
面部动捕是技术难点
身体的动作相对好捕捉,但面部表情的捕捉才是真正的技术挑战。
A-SOUL的虚拟形象之所以看起来”有灵魂”,很大程度上归功于精细的面部动捕。人的脸部有超过40块肌肉,能做出数千种不同的表情组合。
面部动捕的几种技术方案
方案一:标记点面部动捕
- 在演员脸上贴10-30个标记点
- 用高分辨率摄像头捕捉
- 精度较高,但舒适度差(脸上贴东西不舒服)
- 代表设备:DIY面部动捕系统、Faceware
方案二:视频驱动的面部捕捉
- 只用普通摄像头
- 通过AI算法识别面部关键点
- 成本低,无需特殊设备
- 精度相对较低,但在进步
- 代表:FaceX、Rokoko Face
方案三:眼镜式动捕
- 演员佩戴特制眼镜
- 眼镜内的摄像头捕捉眼睛和眉毛区域
- 配合面部标记点
- 精度较高,舒适度好
- 代表:Tobii Eye Tracker + 面部标记
方案四:AI驱动的表情生成(新兴)
- 只捕捉少量标记点或视频
- 用深度学习模型生成完整表情
- 成本高(需要训练模型)
- 代表:MetaHuman、Live Link Face
A-SOUL采用的很可能是标记点+面部高清摄像头的组合方案,这样才能保证她们在镜头前做出细腻的表情变化。
延迟问题:为什么虚拟偶像不会”卡”
很多人会问:动捕不是有延迟吗?为什么A-SOUL直播的时候看起来那么流畅?
这个问题很关键。如果延迟太高,演员动了,虚拟形象过了好几秒才动,那观众一眼就能看出是”假”的。
延迟来源及优化方案
延迟来源:
1. 设备采集延迟(<1ms)
- 摄像机拍摄到数据的耗时
- 现代设备已非常低
2. 数据传输延迟(1-10ms)
- 数据从摄像机传到处理主机
- 使用有线连接可大幅降低
3. 解算延迟(1-5ms)
- 多摄像机数据融合计算
- GPU加速可显著降低
4. 绑定/重定向延迟(<1ms)
- 骨骼映射计算
- 现代引擎优化得很好
5. 渲染延迟(5-30ms)
- 渲染一帧画面的时间
- 高端GPU可降低到5ms以内
6. 网络传输延迟(可变)
- 从直播间推送到观众端
- 这是最大的不确定因素
A-SOUL的优化策略:
- 使用高性能GPU(可能是RTX系列)
- 本地渲染而非云端渲染(减少网络延迟)
- 专线网络传输
- 预渲染与实时渲染结合
- 整体端到端延迟控制在30-50ms以内
30-50毫秒的延迟,人眼几乎无法察觉。这就是为什么A-SOUL看起来那么”真实”的原因。
虚拟偶像产业链:从技术到变现的全景图
虚拟偶像不是一个孤立的行业,而是一条完整的产业链。从最上游的技术供应商,到中游的内容制作,再到下游的粉丝经济,每个环节都有人在赚钱。
上游:技术供应商
技术供应商是虚拟偶像产业的”卖水人”。无论虚拟偶像火不火,他们都在卖设备和技术。
动作捕捉设备厂商:
- 国际厂商:OptiTrack(美国)、Vicon(英国)、Motion Analysis(美国)
- 国内厂商:诺亦腾、华如科技、视达科技
- 价格:一套高端光学动捕系统50万-200万人民币
面部动捕设备:
- Faceware(美国)、DIY方案(低成本)
- 价格:几千到几万元不等
渲染引擎:
- Unreal Engine(虚幻引擎):目前虚拟偶像最常用的引擎
- Unity:也有使用,但视觉效果相对较弱
- 费用:Unreal Engine免费,但收入超过100万美元后需支付5%分成
3D建模软件:
- Maya、Blender、3ds Max
- 角色建模、绑定、贴图制作
直播平台技术:
- 虚拟直播间搭建
- 实时推流技术
- OBS、vMix等软件
中游:内容制作公司
以A-SOUL为例,背后是乐华娱乐。乐华娱乐负责整个团体的运营、内容制作、商业化等。
内容制作团队:
- 角色设计:决定虚拟形象的外观、服装、风格
- 3D建模:制作虚拟形象的模型
- 动作库制作:录制各种舞蹈动作、表情预设
- 音乐制作:歌曲创作、编曲、演唱(部分虚拟偶像会找真人歌手配音)
- 视频制作:MV、宣传片、日常内容
运营成本:
- 动捕设备折旧
- 动捕演员工资
- 技术人员工资
- 场地租金(动捕棚、直播间)
- 服务器和渲染设备
- 人员保险、福利
下游:粉丝经济和变现
这是虚拟偶像产业最核心的部分——怎么赚钱。
虚拟偶像变现模式
1. 直播打赏
- 粉丝在直播间送礼物的收入
- 平台抽成约30-50%
- 这是虚拟偶像最主要的收入来源
2. 会员订阅
- 粉丝付费加入粉丝俱乐部
- 享受专属内容、提前观看等权益
- A-SOUL有"舰长"制度,每月不同档位
3. 周边商品
- 手办、玩偶、服饰
- 数字周边(表情包、壁纸、头像框)
- 联名商品
4. 品牌合作
- 广告代言
- 品牌活动出场
- 联名推广
5. 音乐发行
- 数字音乐平台分成
- 演唱会门票
- 音乐版权
6. IP授权
- 游戏授权
- 动画/电影授权
- 主题公园合作
以A-SOUL为例,根据公开数据和行业分析,她们的年收入可能在数千万到上亿元人民币级别。但这笔钱需要分配给乐华娱乐、动捕团队、制作团队等各方。
从业者真实收入:谁在赚钱,谁在吃苦
聊到这里,你可能会好奇:那些幕后工作者到底赚多少钱?
动捕演员
动捕演员是虚拟偶像产业中最核心的岗位之一。他们的工作强度和收入常被低估。
动捕演员的日常工作
工作内容:
- 穿着动捕服,在脸上/身上贴标记点
- 在动捕棚内反复练习动作
- 直播时实时操控虚拟形象
- 配合导演要求调整表演
- 可能需要长时间保持特定姿势
工作强度:
- 一场直播4-6小时
- 每周工作5-6天
- 需要长期保持身材(紧身衣对身材有要求)
- 需要良好的身体协调性
典型薪资结构(参考):
初级动捕演员:
- 月薪:6,000-10,000元
- 工作内容:基础动作、表情捕捉
- 工作时间:8小时/天
中级动捕演员:
- 月薪:10,000-20,000元
- 工作内容:复杂动作、配合直播
- 工作时间:可能需要轮班
高级动捕演员(主操A-SOUL级别):
- 月薪:20,000-50,000元
- 可能还有奖金/分成
- 工作内容:需要表演天赋+技术能力
顶尖动捕演员:
- 年薪:50万-100万+
- 工作内容:需要表演功底(舞蹈/戏剧背景)
- 稀缺人才,收入可观
一个真实的例子:
A-SOUL的动捕演员中,据说有几位是有舞蹈或表演背景的。他们需要在直播时实时表演,同时还要注意镜头感和互动。这不是简单”做动作”,而是一种表演艺术。
有动捕演员在网上分享过自己的经历:”刚开始觉得很有意思,但工作一个月后,背部和脖子经常酸痛,脸上贴满了胶水和标记点,脱下来皮肤红红的。而且直播时要一直保持表演状态,精神高度集中,比想象中累多了。”
3D建模师
3D建模师负责制作虚拟偶像的模型。一个高质量的虚拟形象,可能需要数百小时的工作。
3D建模师薪资参考
初级建模师:
- 月薪:8,000-15,000元
- 工作内容:基础模型制作、贴图
中级建模师:
- 月薪:15,000-30,000元
- 工作内容:完整角色建模、绑定
高级建模师:
- 月薪:30,000-60,000元
- 工作内容:项目主导、技术攻关
顶尖建模师:
- 月薪:60,000-100,000元+
- 稀缺人才,可参与项目分成
技术支持工程师
技术支持工程师负责维护动捕系统、渲染设备等。他们需要确保直播时一切正常运行。
技术支持工程师薪资参考
初级技术支持:
- 月薪:8,000-15,000元
- 工作内容:设备维护、基础故障排查
中级技术支持:
- 月薪:15,000-30,000元
- 工作内容:系统优化、问题诊断
高级技术支持/工程师:
- 月薪:30,000-60,000元
- 工作内容:系统架构、技术创新
顶尖技术支持:
- 月薪:60,000-100,000元+
- 稀缺人才,可能参与创业
内容制作团队
从编剧到导演,从摄影到后期,虚拟偶像的内容制作团队和传统影视团队类似。
内容制作团队薪资参考
策划/编剧:
- 月薪:10,000-30,000元
- 负责角色设定、故事线、直播脚本
导演:
- 月薪:20,000-50,000元
- 负责整体内容和表演指导
视频编辑:
- 月薪:10,000-25,000元
- 负责直播剪辑、宣传片制作
音乐制作:
- 月薪:15,000-40,000元
- 负责歌曲创作、编曲
运营和商务团队
运营团队负责粉丝关系、活动策划、商业化等。商务团队负责品牌合作、广告洽谈等。
运营/商务团队薪资参考
运营专员:
- 月薪:8,000-15,000元
- 负责日常运营、粉丝互动
运营经理:
- 月薪:15,000-30,000元
- 负责整体运营策略
商务专员:
- 月薪:10,000-20,000元
- 负责品牌合作洽谈
商务经理:
- 月薪:20,000-50,000元
- 负责大型合作项目
虚拟偶像行业的真实收入金字塔
如果把虚拟偶像产业比作一座金字塔,我们可以清晰地看到不同位置的人能获得多少收入。
虚拟偶像产业收入金字塔
顶端:虚拟偶像本人(IP形象)
- 代表:A-SOUL成员
- 收入:通过分成、代言等,年收入可达数百万至数千万
- 但前提是:成为顶流
第二层:动捕演员/技术核心
- 代表:A-SOUL的动捕演员
- 收入:年薪30万-100万+(顶尖人才)
- 工作强度:高
- 曝光度:部分公开,部分匿名
第三层:内容制作团队
- 代表:导演、编剧、视频编辑
- 收入:年薪15万-50万
- 工作强度:中高
- 曝光度:低
第四层:技术支持团队
- 代表:动捕工程师、3D建模师
- 收入:年薪15万-60万
- 工作强度:中
- 曝光度:低
底层:运营、商务、助理等
- 收入:年薪8万-30万
- 工作强度:高
- 曝光度:极低
外围:供应商(设备、软件)
- 收入:稳定但单笔利润不高
- 工作强度:低
- 曝光度:无
行业背后的隐忧和挑战
虽然虚拟偶像产业看起来光鲜亮丽,但背后也有许多隐忧。
1. 动捕演员的身体健康问题
长期穿着紧身动捕服、脸上贴标记点,对皮肤和身体都不好。很多动捕演员反映有颈椎、腰椎问题。
2. 工作强度大
直播通常需要4-6小时,而且需要高度集中注意力。加上排练、准备,一天工作10小时以上很常见。
3. 收入不稳定
除了顶层的动捕演员,大部分从业者的收入并不算高。而且虚拟偶像行业竞争激烈的,不是每一个团体都能成功。
4. 技术更新快
动捕技术和渲染技术更新很快,从业者需要持续学习,否则容易被淘汰。
5. 粉丝文化的双刃剑
虚拟偶像的粉丝文化有时会比较”极端”,从业者可能面临网络暴力和隐私泄露的风险。
未来趋势:AI会取代动捕演员吗?
这是很多人关心的问题。随着AI技术的发展,尤其是大模型和生成式AI的进步,虚拟偶像的未来会怎样?
AI对虚拟偶像产业的影响分析
短期(1-3年):AI是辅助工具
- AI可以帮助生成部分表情和动作
- AI辅助建模,提高效率
- AI语音合成替代部分配音
- 但实时表演的"灵魂"仍需真人
中期(3-5年):AI与真人结合
- 半自动虚拟偶像出现
- AI可以完成基础表演,真人负责"注入灵魂"
- 成本降低,门槛下降
- 可能出现"AI+真人"混合模式
长期(5-10年):AI虚拟偶像可能独立
- 完全由AI驱动的虚拟偶像
- 无需动捕演员
- 成本极低,规模可快速扩大
- 但"真实感"和"人情味"可能不足
人类的需求:
- 粉丝追求的不仅是"完美的表演"
- 还有"真实的连接感"
- 知道背后有一个真人,会增加情感投入
- 这也是为什么很多虚拟偶像团队坚持公开动捕演员的原因
A-SOUL团队在出道时就选择了公开动捕演员的部分信息,这其实是一种策略——让观众知道”背后有人”,从而建立更真实的情感连接。
总结:虚拟偶像不是”魔法”,是一整套工业体系
看完以上内容,你应该能理解:A-SOUL这样的虚拟偶像团体,背后是一个复杂的工业体系。
从动捕设备供应商,到动捕演员,到3D建模师,到内容制作团队,到运营和商务团队——每一个环节都有人在付出劳动,也在获取收入。
虚拟偶像的”魔法”,来自于技术和人的共同努力。她们能在舞台上唱唱跳跳,是因为有动捕演员在幕后实时操控;她们的表情如此生动,是因为有精密的面部捕捉设备;她们的直播如此流畅,是因为有技术支持团队在保障系统稳定。
这个行业确实存在,而且正在快速发展。但随着AI技术的进步,这个行业也面临变革。未来的虚拟偶像,可能会更加智能、更加低成本,但也可能失去一些”人情味”。
作为观众,我们也许可以继续享受虚拟偶像带来的娱乐,但也可以多一分理解——那些在镜头前闪闪发光的”虚拟偶像”,背后是一群真正在付出努力的”真人”。
