渲染到凌晨的冬天
做独立动画的,哪个没熬过夜等渲染?阿凯之前在杭州的大厂做美术,出来单干的时候,咬咬牙花两万块攒了两张3090,本以为够够的,真开了大场景才知道什么叫算力不够用。租云端的GPU算力吧,一小时十几块,全片下来小十万,他那点启动资金,撑不到做完就要关门。说实话,那时候他已经在考虑要不要回杭州找工作了,把工作室盘出去,就当这场梦没做过。
你知道西部有多少闲置算力吗?之前炒币热的时候,好多人在这建小矿场,后来币价跌了,电再便宜也扛不住,一半以上的矿机都停着落灰。周边县城三家网吧,晚上过了十二点,一半机位都是空的,那些显卡就亮着机吃灰。运营商的县里机房,白天峰值的时候跑满,夜里空闲率能到六成,这些CPU、GPU、甚至各个基站边缘节点的NPU,散得像掉在地上的珍珠,没人捡。

之前不是没人想整合这些资源,问题是这些算力架构不一样啊,GPU干GPU的活,CPU干CPU的,NPU擅长处理AI推理,放一起就是一堆没法拼的拼图,你总不能让动画师自己拆任务,一个个去对接吧?
把散在各处的算力粘成一块
去年年底,当地运营商推了个试点,给小工作室免费用算力网络异构资源统一调度平台。阿凯抱着死马当活马医的心态报了名,没想到用上第一天就傻了。
他把渲染任务上传之后,平台自动把任务拆成了几百上千个小块,需要大算力并行的纹理计算,拆给了那些闲置矿机的GPU,一些逻辑计算、序列预处理,分给了机房空闲的CPU,就连他工作室自己电脑上闲置的CPU核心都被用上了。原来要跑八个小时的一帧,现在一个半小时就出图了,算下来费用才不到两块钱。
什么是异构资源?说白了就是架构不一样、性能不一样、位置还不一样的各种算力资源。以前这些资源都是各管各的,你要用GPU就得整租整卡,哪怕你的活只需要一半的性能,剩下的也浪费了。统一调度的核心,就是让合适的算力干合适的活,不管它在千里之外的机房,还是在楼下网吧空着的机位,还是你家书房落灰的游戏主机,只要连在算力网上,就能拆了碎了拼起来给你用。

不过话说回来,最让阿凯惊讶的不是速度快价格低,是他根本不用管这些算力从哪来。他不用去和矿场老板谈合作,不用去给网吧改线路,打开客户端上传任务,等着收结果就行,就像开自来水龙头出水一样自然。
算力平权的影子

阿凯的片子今年夏天做完了,在国内一个独立影展拿了最佳美术,现在已经有投资人找过来,他还招了两个从西安毕业回来的小孩,不用挤在北上广的合租房里改图了,住在天水,房贷一个月才两千多,下班就能去河边遛弯。
这事儿我想了好久,我们总说科技改变生活,大部分时候都在说那些高大上的大模型、大火箭,可真正改变普通人命运的,往往是这种底层基础设施的进步。以前算力是奢侈品,只有大公司、大机构能用得起,小工作室想做点自己的东西,连渲染都搞不定,好多好点子就死在最后一步。现在不一样了,把所有散在民间的闲置算力攒起来,通过统一调度变成人人能用的公共资源,成本一下就打下来了。
去年我在贵州见过一个做乡村AI植保的团队,也是用这套东西,把各个村镇基站闲置的NPU调度起来,识别果树病虫害,一亩地一年的算力成本才不到三块钱,果农都用得起。要是放在以前,专门建个数据中心,成本翻十倍都打不住。
当然,现在也还有问题。比如说闲置算力的所有者能拿到多少收益?现在大部分还是运营商统一收了,给的分成不多,好多矿主还是不愿意把机器拿出来。还有数据安全的问题,你把任务交给分散在各个地方的算力,会不会泄密?这些都还在试。
不过你得承认,这是个好开始。以后会不会有那么一天,我们每个人家里所有带芯片的东西——电视、路由器、游戏主机,不用的时候都能把闲置算力分享出去,每个月赚个几百块电费钱,而需要算力的人,不用花大价钱买昂贵的服务器,就能拿到自己需要的算力。算力就像当年的电网,一开始只有大城市的工厂能用,后来慢慢通到每个村子,每个家庭,变成所有人都用得起的公共服务。
阿凯现在在做第二部片子,讲麦积山开窟的画工故事,他说现在渲染根本不用熬夜等了,出门爬一天山,回来片子就渲完了。窗户外还是麦积山的轮廓,风扇嗡嗡转的声音,现在听着不再是熬大夜的煎熬,是梦在跑的声音。对吧?
作者|大讲堂
排版|大讲堂
审核|阿辰
大讲堂