大模型“一周三更”:DeepSeek涨价、阿里云开源、智谱“不换药

研发家 | 2026-08-17 0

8月的第二周,中国大模型行业密集变阵。8月13日,DeepSeek确认DeepSeek-V4-Flash和DeepSeek-V4-Pro将在8月17日上调价格,执行峰谷计价,同时发布Harness(工具框架)开发者预览版。一天后智谱发布GLM-5.3,该版本基于和GLM-5.2一样的基座模型,仅靠后训练将编程能力提升50%,同日阿里千问正式开源Qwen3.8系列模型,全新开源的270亿参数规模模型Qwen3.8-27B,家用显卡也能跑。

从"谁更便宜"转向"谁更不可替代"。DeepSeek用Harness对冲涨价可能出现的用户流失风险,智谱押注后训练撬动性能杠杆,阿里云继续开源模型拉动云生态。绕不开算力等硬性成本时,路线就成了战场,AI模型聚合平台OpenRouter最新数据给出了大模型客户的选择,本周全球模型调用量排名前十的模型中,6个均是国产模型。

左手模型右手Harness

一个蓝鲸鱼一个黑鲸鱼,DeepSeek和DeepSeek Harness用颜色区分了官方微信公众号头像,并在同一天发布内容,对于数月更新一次的DeepSeek实属罕见。

DeepSeek账号最新文章的题目是"DeepSeek-V4-Pro正式版上线","DeepSeek Harness团队"的题目是"DeepSeek Harness开发者预览版上线"。

模型预览版转正是DeepSeek预告过的动作,上线Harnees也有蛛丝马迹,但依然让这两篇博文的阅读量迅速达到10万+。

所谓Harness,在当下的AI语境下指的是一套智能体管控系统。过去人类和AI的交互是线性的:你提问,它回答。现在进入了Agent(智能体)时代。Agent要能自主拆解任务、调用工具,甚至自我修正。在这个过程中,模型本身的"智商"固然重要,但运行的"环境和约束"决定了它是否可靠。Harness就是从对话到系统的跃迁。

Nextie(明日新程)创始人、"小冰之父"李笛向北京商报记者具体解释,"三年以前,人们往往认为只要模型能力足够强,就自然可以得到完美的效果。但Claude Code的模型能力足够强,依然需要数十万行代码的Harness,才能让其在具体的应用中发挥端到端的表现。此次DeepSeek的Harness,也是类似的具体行动"。

回到具体的产品,DeepSeek Harness的设计思路是"一切皆插件",采用插件式开放架构来构建 Agent Harness,即模型、工具、技能、会话、沙箱、存储、循环、调度、UI(用户界面)等所有Agent能力均由插件组合而成,可自由替换、灵活重组。DeepSeek Harness方面进一步介绍:开发者无需改动 DeepSeek Harness 的源码本身,就能以插件的方式独立选择、替换或扩展其中的任一能力。

按照这个逻辑,DeepSeek的模型只是DeepSeekHarness 的插件之一。开发者不仅可以接入DeepSeek的模型,理论上也可以对接市面上其他主流大模型。北京商报记者就此通过用户身份给DeepSeek Harness团队留言,截至发稿暂未得到回复。

新技术与旧商业模式

如果将模型涨价和发布Harness拼在一起,业内人士透过技术看到了商业化的焦虑。

8月17日,DeepSeek将采用最新价位收费,且峰谷不同价。届时DeepSeek-V4-Flash,空闲时段百万Tokens输入(缓存命中)价格为0.05元,百万Tokens输入(缓存未命中)价格为1.5元,百万Tokens输出价格4.5元。高峰时段,上述价格均上涨1倍,分别是0.1元、3元、9元。

DeepSeek-V4-Pro空闲时段,百万Tokens输入(缓存命中)价格为0.15元,百万Tokens输入(缓存未命中)价格为4.5元,百万Tokens输出价格为13.5元。高峰时段,上述价格上涨1倍,分别是0.3元、9元、27元。

"基础大模型涨价是大模型从跑马圈地到进入商业化深水区的大趋势,也逐渐成为行业共识",李笛告诉北京商报记者,"模型有商业价值不等于有合理的商业模式,涨价是模型厂商不断感知社会接受度、调整商业模式、最终达到供需平衡的过程"。

早期模型厂商的价格战甚至免费的价格体系,一再拉低用户对大模型价格的心理区间,"在这种情况下模型厂商单纯调价,往往在短期内表现为阵痛,造成用户流失",基于此,李笛认为,"模型企业往往不能只调价,还必须同时提供比过去更深入的服务,Harness就是提质手段之一。大模型时代的今天,我们使用的是最新的技术,但商业模式却是非常陈旧的,是过去三十年来,以边际成本递减为基本前提所奠定的商业模式。但大模型时代并不适用于这一前提"。

站在整个行业的角度,即使有些厂商没有涨价,也在回答同一个问题:模型之外,还能靠什么挣钱?

整个8月,阿里云从算力、模型到产品都有新动态。当月至今,阿里云瓴羊企业级智能分析产品Quick BI完成AI原生架构升级,发布全新版本;视频生成模型Wan3.0启动公测;上线一站式AI语音生产力平台CosyVoice Studio;AI应用创作平台Meoo(秒悟)正式上线团队版;阿里云灵骏真武M890超节点实例正式上线,首批在乌兰察布地域开售;正式开源Qwen3.8系列模型。

不换基座,换打法

"圈地"的方式不止开源和涨价两种。智谱选择了一条更省成本的路:不换基座,聚焦后训练。

8月14日,智谱发布GLM-5.3,与GLM-5.2相比,基座模型没变,通过后训练Scaling(规模化)提高了模型的智能上限。在编程方面,GLM-5.3在内部自建体感评测中较GLM-5.2提升50%,在包括TerminalBench 3.0、Agents' Last Exam(CLI)在内的公开基准测试中取得开源第一。在网络安全能力方面,在白盒代码审查与漏洞发现等安全任务中的表现,GLM-5.3的表现与Mythos 5持平,展现出面向网络安全防御场景的强大潜力。

据智谱介绍,上述全部提升都来自后训练。基于IndexShare、SAO以及持续演进的新一代Slime框架,智谱在与GLM-5.2完全相同的基座上高效推进强化学习。"可能我们还远未开发出这个基座的智能上限。"智谱把这句话标亮加粗。

效果如何?当天,金山办公旗下AI办公智能体灵犀专业版即接入智谱GLM-5.3模型。在推荐这次合作时,金山办公提到了GLM-5.3的代码和网络安全能力。值得注意的是,灵犀在前一天也接入了DeepSeek-V4-Pro正式版,同样提到了代码能力。

这不是巧合,Agent时代,能对话只是门槛,能写代码才是模型撬开客户钱包的硬指标。

文渊智库创始人王超向北京商报记者表示:"模型厂商的商业模式远没有确定,到底是靠C(用户)端,还是靠B(企业)或生态,都没确定。"在他看来,"和海外同行相比,国内大模型的算力成本更低,但是推出的模型效果比同样成本的模型更好"。从某种程度看,智谱的策略正是这一判断的注脚。

OpenRouter 最新数据显示,本周,全球AI大模型调用量前五名中除GPT-5.6 Luna之外,均是中国模型,前十名中有6家是国产模型,分别是DeepSeek-V4-Flash-0731、Hy3、DeepSeek-V4-Flash-0423、GLM-5.2、Mimo-V2.5、DeepSeek-V4-Pro。

赞一个

分享:
打开微信扫一扫
0
版权及免责声明:本网站所有文章除标明原创外,均来自网络。登载本文的目的为传播行业信息,内容仅供参考,如有侵权请联系删除。文章版权归原作者及原出处所有。本网拥有对此声明的最终解释权
更多服务
招商合作
请您完善以下信息,我们会尽快与您联系!
论文投稿
参加会议
合作办会
期刊合作
论文辅导
科研绘图
论文翻译润色
论文查重
其他
提交
专家招募
关闭
个人信息
联系信息
提交
在线客服
商务合作
专家招募
常见问题
手机端
扫描二维码
与学术大咖共探知识边界
出版无忧
投稿无忧
翻译服务
润色服务
自助查重
排版校对
科研绘图