首页/行业动态/大模型一体机集体「缩水」:满血版卖不动,
行业动态 · Insights

大模型一体机集体「缩水」:满血版卖不动,32B/70B成走量主力,轻量AI BOX兴起

2026 年 10 月 3 日 · 钛媒体(半导体产业纵横)

部署 · 部署落地 2026 年 10 月 3 日 来源:钛媒体(半导体产业纵横)

10月3日,钛媒体刊发半导体产业纵横文章指出,曾随DeepSeek R1爆红的大模型一体机市场正经历集体「缩水」。2025年春节前后,60多家厂商争相推出DeepSeek一体机,满血版671B机型单台售价普遍在120万至150万元,使用国产加速卡还需两机并联、预算逼近400万元。然而仅三个月后市场便迅速降温,行业形成「DeepSeek有用,但一体机没用」的共识——早期产品多只做硬件打包,软件优化不足,多用户并发时极易卡顿。到2025年下半年,中小厂商的成交主力已悄然换成32B和70B机型。2026年市场进一步分化,多数中端设备最多只能运行70B级别模型,轻量化AI BOX设备开始兴起,满血高端机型则集中于有强合规隔离需求的央国企与金融机构。文章认为,一体机赛道正从「比拼能跑多大模型」转向硬件、推理框架、模型适配、业务应用与运维服务的综合实力竞争。

万有知兴点评

一体机「缩水」不是退步,而是企业AI落地从「参数崇拜」回归「场景适配」的理性回归——能跑多大的模型从来不是目的,能用多少、用在哪里才是。

  • 1.对企业落地意味着:满血版一体机「卖不动」的背后,是绝大多数企业的真实需求其实只是知识库问答、公文写作这类场景,蒸馏后的小模型足够覆盖,671B能力大部分时间属于「能力过剩」。这提醒企业在采购前必须先把业务场景和并发量摸清楚,用真实负载来选型,而不是被「能跑满血版」的宣传牵着走,否则很容易花上百万元买回一台大部分时间闲置、多用户一访问就卡顿的「昂贵摆设」。
  • 2.可借鉴的启示:文章点出一个被长期忽视的隐性成本——除硬件外,企业还要持续承担机房供电散热、运维人力、模型版本迭代、推理框架调优等开销,不少单位只核算硬件支出、忽略后续运维,最终项目落地不及预期。这提示企业做AI私有化预算时,必须把「总拥有成本」(TCO)算全,把运维和模型持续更新纳入长期规划,而不是只盯着一次性硬件投入。
  • 3.另一层启示:云端Token涨价与Agent普及正在反向推高本地部署的价值——当Vibe Coding、AI视频生成等业务量上来后,云端订阅年投入很容易突破百万,而Agent的7×24不间断推理又能拉高一体机利用率。这意味着「本地还是云端」不再是一道静态选择题,企业应根据业务量、数据敏感度、任务类型动态权衡,把高频、敏感、长链路任务沉淀到本地,把低频弹性需求留给云端。

原文:钛媒体(半导体产业纵横) ↗

点评为万有知兴原创观点,转载需注明出处。

看完别人怎么落地,不如看看自己该从哪开始

2 分钟测出你的企业 AI 落地成熟度。

免费做落地测评