科技 第21页

大语言模型不是技术问题,是生态占坑问题-大讲堂

大语言模型不是技术问题,是生态占坑问题

车载大模型3%使用率撕开的遮羞布 今年年初,国内新势力车企爆出一个猛料:品牌花了两个亿自研的座舱大语言模型,上线半年,用户实际使用率不到3%。 直接上了热搜第一。 我翻了三遍评论区,一半骂车企是冤大头,一半骂资本又来蹭概念割韭菜。 说实话,...

干掉中小厂LLM的,不是算法是水电煤-大讲堂

干掉中小厂LLM的,不是算法是水电煤

2026年,退订潮来了 上个月在上海陆家嘴喝咖啡,碰到一个做HR SaaS的老熟人。胡子拉碴,烟一根接一根抽。 去年他喊着All in LLM,砍了原本做异地算薪产品线的一半预算,砸了近两千万进去,招了八个算法工程师,给产品嵌了LLM驱动的...

GPT不是效率工具,是行业拆台工具-大讲堂

GPT不是效率工具,是行业拆台工具

上个月跟一位做家装设计的老朋友吃饭,他刚从国内头部家装集团东易日盛离职,啤酒一开就骂娘。今年年初公司裁了42%的施工图设计师,全换成GPT加AI画图工具了。原来一个设计师一周出三套施工图,现在一个助理用GPT一天出八套,只要后期改改尺寸细节...

BERT不是通用AI底牌,是算力陷阱-大讲堂

BERT不是通用AI底牌,是算力陷阱

千亿大模型退潮,BERT偷偷杀回线上 上个月跟某头部电商广告算法负责人喝夜酒,聊到今年Q1的大动作,惊得我手里的冰啤都洒了半杯。他们把核心推荐跑了两年的千亿参数大模型,全线下线,换成了微调过三年电商数据的12层BERT。 圈内已经吵翻了。有...

多头注意力不是大模型卖点,是算力命门-大讲堂

多头注意力不是大模型卖点,是算力命门

旗舰芯抢跑端侧大模型,多头数量成了新内卷战场 2026年开年的MWC大会,全场最热的话题不是折叠屏新形态,也不是卫星通信覆盖,是端侧大模型的多头比拼。 高通晒出骁龙8 Gen4,支持128头40亿参数端侧大模型,号称全行业第一。联发科更狠,...

自注意力不是大模型专利,是算力博弈的阳谋-大讲堂

自注意力不是大模型专利,是算力博弈的阳谋

卷到千元机的大模型,集体偷换了自注意力的内核 上个月帮朋友挑2026年新款千元机,随手测了测各家预装的端侧AI助手,结果笑出声。 让AI写一篇三千字的线下门店促销方案,要求开头定好核心客群是周边18-22岁的大学生,主打平价潮玩。结果写到第...

注意力机制不是AI技术问题,是商业分配问题-大讲堂

注意力机制不是AI技术问题,是商业分配问题

2026年开春,国内内容互联网圈炸了件挺有意思的事。抖音全量上线了基于大模型的新一代注意力机制推荐算法,小红书紧接着发了内部公关文,说自己坚持用中小规模的稀疏注意力架构,用户留存反而比去年稳了2个百分点。 第三方机构QuestMobile二...

Transformer不是大模型底座,是算力卷王的特洛伊木马-大讲堂

Transformer不是大模型底座,是算力卷王的特洛伊木马

2026年开春,国内大模型圈子的价格战杀红了眼。有头部厂商喊出“一厘钱百万token在线推理”的报价,直接把同行喊懵了。很多小厂商跟着骂,说这是赔本赚吆喝,赚了估值亏了现金流。 说实话,没人说破这个局里最核心的猫腻:你以为拼的是推理优化,其...

数据并行不是算力问题,是分钱问题-大讲堂

数据并行不是算力问题,是分钱问题

今年开春,OpenAI内部那份GPT-5训练规划泄露,整个硅谷吵翻了。为了赶在2026年底出成品,OpenAI打算把训练数据拆到一万张A100上做全数据并行。谷歌那边直接发了篇博客阴阳怪气,说走纯数据并行堆卡的路,是把钱往水里扔。 圈子里吵...

模型并行不是技术问题,是利益分配问题-大讲堂

模型并行不是技术问题,是利益分配问题

2026年春,千亿模型赛道的暗雷炸了 四月的北京,大模型圈的饭局上全是骂声。一家没人听过的创业小团队,拿了不到两千万启动金,靠模型并行拆分出70B参数的垂直模型,公开榜单得分打平了某头部玩家三年前花一个亿训出来的千亿基座。 头部大佬跳出来说...