科技 第38页

OpenVINO的“慢”生意:英特尔如何用开源工具切割AI芯片的肥肉?-大讲堂

OpenVINO的“慢”生意:英特尔如何用开源工具切割AI芯片的肥肉?

很多人都把OpenVINO当成一个模型优化的小工具——错得离谱。它是英特尔AI战略的暗线,一条用软件拴住硬件、用开源绑架生态的阳谋。为什么是现在?因为边缘计算终于不是PPT了,工厂质检、智能摄像头、自动驾驶推理,这些场景在大规模起量。但芯片...

TensorRT:从内核掐算到落地排坑,那些官方没聊透的事-大讲堂

TensorRT:从内核掐算到落地排坑,那些官方没聊透的事

那层‘优化’的皮下面,到底藏着什么 跑模型的人都有个心照不宣的痛:训练时看着指标蹭蹭涨,一到部署就萎了。延迟高得离谱,吞吐死活上不去。然后总有声音说——上 TensorRT 啊!仿佛那是万能药。但真用起来,不少人卡在第一关就骂街:这玩意儿怎...

ONNX:别天真了,这根本不是技术标准,这是地缘政治的棋盘-大讲堂

ONNX:别天真了,这根本不是技术标准,这是地缘政治的棋盘

说一个你可能不愿意承认的事实:AI 战争的下半场,弹药不是模型,是交换格式。 如果你还觉得 ONNX 只是个微软牵头的小玩意儿,那你就等着被供应链卡脖子吧。2024 年最大的谎言就是“大模型是未来”,而真相是——模型的互操作性才是命门。为什...

模型剪枝:算力战争的下一个核按钮-大讲堂

模型剪枝:算力战争的下一个核按钮

去年底,和硅谷某大厂的一位VP喝酒。他说了一句话让我记到现在:“你知道吗,我们数据中心跑的大模型,有30%的FLOPs都浪费在对齐人类偏好的冗余神经元上。” 当时我手里的威士忌差点洒出来。30%。不是个小数目。你要知道,训练一次千亿参数模型...

模型量化:把LLM塞进手机,我踩过的坑和捡到的宝-大讲堂

模型量化:把LLM塞进手机,我踩过的坑和捡到的宝

做模型推理那会儿,真是被延迟逼疯。几百兆的模型,跑一次几百毫秒,用户早就划走了。后来搞量化——嚯,发现新大陆!内存直接腰斩,速度快了三倍。但,别高兴太早。坑多得能填海。今天不整虚的,就聊聊这玩意儿到底怎么玩,怎么避开那些阴沟。 这玩意儿到底...

梯度爆炸:为什么你的供应链下一秒就会崩盘?-大讲堂

梯度爆炸:为什么你的供应链下一秒就会崩盘?

不是危言耸听。看看硅谷现在疯抢H100的样子,像极了2020年抢口罩。但这事儿比口罩绝望得多——算力需求的斜率已经彻底疯了。一季度英伟达数据中心营收同比暴增427%,而台积电的CoWoS封装产线还在喊疼。这就是梯度爆炸。它不是一个数学概念,...

梯度消失,这个神经网络的头号刺客-大讲堂

梯度消失,这个神经网络的头号刺客

你盯着TensorBoard上那几条几乎躺平的loss曲线,心里肯定在骂娘。对吧?层数一深,准确率反而像跳楼一样往下掉,反向传播回来的梯度,小到连浮点数都懒得表示——这就是梯度消失,训练深层网络时最恶心的幽灵。说实话,我第一次撞上它的时候,...

跳跃连接:供应链的致命跃迁,巨头们慌了么?-大讲堂

跳跃连接:供应链的致命跃迁,巨头们慌了么?

供应链的中间层,正在被抽干。就像神经网络里的残差块,跳跃连接直接打通了输入和输出——中间那些冗余的隐藏层,突然变得可有可无。说实话,这玩意儿在深度学习里火了快十年,可真正让实业界脊背发凉的,是它居然映射到了真实的商业世界。 为什么是现在?地...

残差连接:那个让网络真正深起来的魔法短路-大讲堂

残差连接:那个让网络真正深起来的魔法短路

退化,梯度,以及那个小箭头 头回见到残差连接,是在ResNet那篇论文里——说实话,第一反应是:就这?不就是在输出上硬加了个输入吗?也太粗暴了。但是,当我自己撸了个30多层的CNN,看着训练loss不降反升,再切到ResNet-34跑一遍,...