诈骗案炸出来的裸泳者
2026年3月,杭州那家做跨境户外用品的上市公司爆出来的新闻,估计很多人都忘了。财务总监半夜接了个“董事长”的语音电话,说要给上游供应商打紧急保证金,3200万,转出去半小时才反应过来不对——对方的声音,连董事长跟了十年的秘书都分不出差别。
那家公司半年前就花十几万装了主流的音频鉴伪系统,为什么没起作用?说出来你不信,系统默认对外部来电要延迟半秒做实时鉴伪,行政部嫌影响日常沟通效率,悄悄给关了。

说实话,这事刚出来我就翻了四五份行业研报,全在说技术突破,全在吹准确率做到了99%以上,没一个人提——这套高准确率的系统跑起来,到底要花多少钱。
现在音频大模型做深度伪造,一秒仿声语音的生成成本不到0.0002元,骗子打一个小时诈骗电话,总成本才7块2,比十年前黑产买一手公民信息打传统诈骗电话的成本,还便宜8倍。进攻方的成本已经压到了地板价,防守方呢?
装一套全实时的高准确率鉴伪系统,一个月的云算力成本就要小一万,对很多年利润不到百万的中小企业来说,这笔钱就是凭空多出来的负担。不用舍不得,用了又心疼,最后大多为了不影响生意,关掉鉴维功能。
这不就是裸奔吗?
堑壕战里的生意经
圈里老人都懂,音频伪造和鉴伪的对抗,本质就是一场军事上的堑壕战。进攻方挖了一道壕,防守方填上,防守方架了枪,进攻方又找新的突破口,永远没有一劳永逸的终结。AI伪造方给语音加一点点人耳听不到的扰动,原来准确率99%的鉴伪模型,直接就瞎了。
国内现在的玩家分成两拨,打得不亦乐乎。一波是百度、商汤这种头部大模型公司,拿着大模型对抗鉴伪的方案,主打极致低误判率,专门服务国有大行、头部券商,一年服务费几十万起。另一波就是声灵科技这种本土创业公司,扎根珠三角给中小支付机构做服务,主打“够用就好”的轻量模型。
这里有笔明账,大部分人都不会公开说:误判率每降0.9个百分点,推理成本直接翻7倍。大模型对抗鉴伪的误判率是0.3%,端侧轻量模型的误判率是1.2%,差不到一个百分点,成本差了7倍。每鉴伪1小时通话,大模型方案要花18块,比一线城市写字楼保安的时薪还贵两倍。

去年声灵科技推按次付费模式,鉴伪一次收一厘钱,没用不花钱,一年下来给合作的中小银行平均省了60%的鉴伪成本,订单量比之前卖年卡的时候涨了三倍。
不过话说回来,头部大公司会不知道这笔账吗?当然知道。但他们要做高毛利的生意,赚顶级大客户的钱,犯不着跟创业公司抢几分几厘的碎银子。这个方向我认为根本走偏了,现在堆参数拼准确率,大多是卷给投资人看的,真到落地,客户都是用脚投票——只要准确率够用,谁会给你多付好几倍的算力钱?
哪有什么技术落后,无非是生意选择不同罢了。
落在普通人头上的隐形成本

上层的技术博弈和生意选择,最后买单的永远是一线干活的普通人。去年冬天我跟一个南方城商行的风控主管吃饭,他跟我倒了一肚子苦水。他们行去年换了头部公司的高端鉴伪系统,要求所有异地开户的语音核验必须过系统,只要系统标记存疑,就算风控失职扣奖金。
三个月下来,他手下三个风控专员,一共扣了快四万奖金,就因为三个客户在马路边上开户,背景车噪大,系统直接误判成AI伪造。他说现在我们都摸到规律了,只要系统说存疑,我们自己再戴上耳机听一遍,反正不能扣自己的工资对吧?
对整个产业链来说,现在最诡异的地方就是,进攻端的成本已经压到几乎为零,防守端的成本还停留在几年前的高位,根本没跟着降下来。很多人天天喊卡脖子,说我们的大模型参数不如别人,我看卡脖子的根本不是参数,是能不能把鉴伪的算力成本,压到和黑产进攻同一量级。
你想啊,骗子打一分钟诈骗电话才花一分钱,你鉴伪一分钟要花一毛钱,你说中小机构愿意掏这个钱吗?大部分都会选择睁一只眼闭一只眼,等到真出事了才追悔莫及。
我赌五毛钱,最先把音频大模型深度伪造语音鉴伪做成全民可用基础设施的,绝不会是天天堆参数拼发布的头部大模型公司,只会是那些天天跟中小商家打交道,一分一厘抠成本的第三方支付服务商。你说呢?
作者|大讲堂
排版|大讲堂
审核|小准
大讲堂