大模型“一周三更”:DeepSeek涨价、阿里云开源、智谱“不换药”
创始人
2026-08-16 20:51:20

8月的第二周,中国大模型行业密集变阵。8月13日,DeepSeek确认DeepSeek-V4-Flash和DeepSeek-V4-Pro将在8月17日上调价格,执行峰谷计价,同时发布Harness(工具框架)开发者预览版。一天后智谱发布GLM-5.3,该版本基于和GLM-5.2一样的基座模型,仅靠后训练将编程能力提升50%,同日阿里千问正式开源Qwen3.8系列模型,全新开源的270亿参数规模模型Qwen3.8-27B,家用显卡也能跑。

从“谁更便宜”转向“谁更不可替代”。DeepSeek用Harness对冲涨价可能出现的用户流失风险,智谱押注后训练撬动性能杠杆,阿里云继续开源模型拉动云生态。绕不开算力等硬性成本时,路线就成了战场,AI模型聚合平台OpenRouter最新数据给出了大模型客户的选择,本周全球模型调用量排名前十的模型中,6个均是国产模型。

左手模型右手Harness

一个蓝鲸鱼一个黑鲸鱼,DeepSeek和DeepSeek Harness用颜色区分了官方微信公众号头像,并在同一天发布内容,对于数月更新一次的DeepSeek实属罕见。

DeepSeek账号最新文章的题目是“DeepSeek-V4-Pro正式版上线”,“DeepSeek Harness团队”的题目是“DeepSeek Harness开发者预览版上线”。

模型预览版转正是DeepSeek预告过的动作,上线Harnees也有蛛丝马迹,但依然让这两篇博文的阅读量迅速达到10万+。

所谓Harness,在当下的AI语境下指的是一套智能体管控系统。过去人类和AI的交互是线性的:你提问,它回答。现在进入了Agent(智能体)时代。Agent要能自主拆解任务、调用工具,甚至自我修正。在这个过程中,模型本身的“智商”固然重要,但运行的“环境和约束”决定了它是否可靠。Harness就是从对话到系统的跃迁。

Nextie(明日新程)创始人、“小冰之父”李笛向北京商报记者具体解释,“三年以前,人们往往认为只要模型能力足够强,就自然可以得到完美的效果。但Claude Code的模型能力足够强,依然需要数十万行代码的Harness,才能让其在具体的应用中发挥端到端的表现。此次DeepSeek的Harness,也是类似的具体行动”。

回到具体的产品,DeepSeek Harness的设计思路是“一切皆插件”,采用插件式开放架构来构建 Agent Harness,即模型、工具、技能、会话、沙箱、存储、循环、调度、UI(用户界面)等所有Agent能力均由插件组合而成,可自由替换、灵活重组。DeepSeek Harness方面进一步介绍:开发者无需改动 DeepSeek Harness 的源码本身,就能以插件的方式独立选择、替换或扩展其中的任一能力。

按照这个逻辑,DeepSeek的模型只是DeepSeekHarness 的插件之一。开发者不仅可以接入DeepSeek的模型,理论上也可以对接市面上其他主流大模型。北京商报记者就此通过用户身份给DeepSeek Harness团队留言,截至发稿暂未得到回复。

新技术与旧商业模式

如果将模型涨价和发布Harness拼在一起,业内人士透过技术看到了商业化的焦虑。

8月17日,DeepSeek将采用最新价位收费,且峰谷不同价。届时DeepSeek-V4-Flash,空闲时段百万Tokens输入(缓存命中)价格为0.05元,百万Tokens输入(缓存未命中)价格为1.5元,百万Tokens输出价格4.5元。高峰时段,上述价格均上涨1倍,分别是0.1元、3元、9元。

DeepSeek-V4-Pro空闲时段,百万Tokens输入(缓存命中)价格为0.15元,百万Tokens输入(缓存未命中)价格为4.5元,百万Tokens输出价格为13.5元。高峰时段,上述价格上涨1倍,分别是0.3元、9元、27元。

“基础大模型涨价是大模型从跑马圈地到进入商业化深水区的大趋势,也逐渐成为行业共识”,李笛告诉北京商报记者,“模型有商业价值不等于有合理的商业模式,涨价是模型厂商不断感知社会接受度、调整商业模式、最终达到供需平衡的过程”。

早期模型厂商的价格战甚至免费的价格体系,一再拉低用户对大模型价格的心理区间,“在这种情况下模型厂商单纯调价,往往在短期内表现为阵痛,造成用户流失”,基于此,李笛认为,“模型企业往往不能只调价,还必须同时提供比过去更深入的服务,Harness就是提质手段之一。大模型时代的今天,我们使用的是最新的技术,但商业模式却是非常陈旧的,是过去三十年来,以边际成本递减为基本前提所奠定的商业模式。但大模型时代并不适用于这一前提”。

站在整个行业的角度,即使有些厂商没有涨价,也在回答同一个问题:模型之外,还能靠什么挣钱?

整个8月,阿里云从算力、模型到产品都有新动态。当月至今,阿里云瓴羊企业级智能分析产品Quick BI完成AI原生架构升级,发布全新版本;视频生成模型Wan3.0启动公测;上线一站式AI语音生产力平台CosyVoice Studio;AI应用创作平台Meoo(秒悟)正式上线团队版;阿里云灵骏真武M890超节点实例正式上线,首批在乌兰察布地域开售;正式开源Qwen3.8系列模型。

不换基座,换打法

“圈地”的方式不止开源和涨价两种。智谱选择了一条更省成本的路:不换基座,聚焦后训练。

8月14日,智谱发布GLM-5.3,与GLM-5.2相比,基座模型没变,通过后训练Scaling(规模化)提高了模型的智能上限。在编程方面,GLM-5.3在内部自建体感评测中较GLM-5.2提升50%,在包括TerminalBench 3.0、Agents' Last Exam(CLI)在内的公开基准测试中取得开源第一。在网络安全能力方面,在白盒代码审查与漏洞发现等安全任务中的表现,GLM-5.3的表现与Mythos 5持平,展现出面向网络安全防御场景的强大潜力。

据智谱介绍,上述全部提升都来自后训练。基于IndexShare、SAO以及持续演进的新一代Slime框架,智谱在与GLM-5.2完全相同的基座上高效推进强化学习。“可能我们还远未开发出这个基座的智能上限。”智谱把这句话标亮加粗。

效果如何?当天,金山办公旗下AI办公智能体灵犀专业版即接入智谱GLM-5.3模型。在推荐这次合作时,金山办公提到了GLM-5.3的代码和网络安全能力。值得注意的是,灵犀在前一天也接入了DeepSeek-V4-Pro正式版,同样提到了代码能力。

这不是巧合,Agent时代,能对话只是门槛,能写代码才是模型撬开客户钱包的硬指标。

相关内容

热门资讯

把家搬到山野:深蓝G318后备... 露营,是方盒子SUV最常被使用的"周末场景"。深蓝G318和坦克300 Hi4-T在露营这件事上,给...
暑期尾声热度不减 百花洲古装游... 8月15日,暑期接近尾声,济南百花洲历史文化街区依旧人气旺盛,古装出游热潮持续升温,不少游客身着雅致...
市旅游汽车站专门为这家博物馆开... 8月14日起,市旅游汽车站开通了博爱县博物馆研学文旅专线,游客今后前往该馆游览更加便捷。 为了推动我...
原创 东... 这几年,景区门票这件事,真的是越来越让人敏感。收吧,大家嫌贵;不收吧,又担心园子养不起、服务跟不上。...