科技

大模型“一周三更”:DeepSeek涨价、阿里云开源、智谱“不换药”

来源:丹巴新文网
大模型“一周三更”:DeepSeek涨价、阿里云开源、智谱“不换药”

8月第二周,中国大模型行业动作频频。13日DeepSeek宣布DeepSeek-V4-Flash与DeepSeek-V4-Pro将在17日调整价格,推行峰谷计价,同步推出Harness(工具框架)开发者预览版。接下来一天,智谱发布GLM-5.3版本,此版本基于GLM-5.2的基座模型,仅靠后训练就让编程能力提升50%。同日,阿里千问开源Qwen3.8系列模型,其中全新开源的270亿参数模型Qwen3.8-27B,使得家用显卡也能运行。

行业风向从“价格战”转向“技术比拼”。DeepSeek用Harness来缓解涨价可能引发的客户流失,智谱则通过后训练技术提升模型性能,阿里云持续开源以强化云生态。面对算力等成本因素,技术路线成为竞争焦点。AI模型聚合平台OpenRouter的最新数据揭示客户选择,本周全球模型调用量排名前十中,六个为国产模型。

模型与Harness双管齐下

DeepSeek官方公众号头像用蓝、黑区分,分别代表DeepSeek与DeepSeek Harness,两账号在同日更新内容,这是DeepSeek数月一次的更新频率。

DeepSeek账号的文章标题为“DeepSeek-V4-Pro正式版上线”,“DeepSeek Harness团队”的标题是“DeepSeek Harness开发者预览版上线”。模型正式版发布是DeepSeek预先透露的,Harness推出也有迹可循。发布日这两篇博文的阅读量迅速突破10万。

Harness在当前AI领域指智能体管控系统。过去人机交互是线性的:人提问,机器回答。如今进入Agent(智能体)时代,Agent需能自主拆解任务、调用工具,甚至自我修正。模型“智商”固然重要,运行环境与约束同样关键,Harness连接对话与系统。

Nextie(明日新程)创始人、“小冰之父”李笛向北京商报记者解析,“此前认为模型能力足够就足够好,但Claude Code模型能力强,仍需数十万行代码的Harness才能发挥端到端效率。DeepSeek的Harness也是类似做法”。

产品层面,DeepSeek Harness秉持“一切皆插件”理念,使用插件式开放架构构建Agent Harness。模型、工具、技能、会话、沙箱、存储、循环、调度、UI等Agent核心能力均由插件组合,可自由替换、灵活组合。DeepSeek Harness团队补充说明:开发者无需改动源码,即可用插件形式选择、替换或扩展任一能力。

从逻辑上,DeepSeek模型仅是DeepSeekHarness的插件之一。开发者不仅可接入DeepSeek模型,理论上也能对接其他主流大模型。北京商报记者以用户身份联系DeepSeek Harness团队,截至发稿未获回复。

技术革新与商业策略

将模型涨价与Harness发布合并看,业内人士在技术中察觉商业化压力。

17日DeepSeek将新价格体系上线,采用峰谷计价模式。那时DeepSeek-V4-Flash,空闲时段百万Tokens输入(缓存命中)费0.05元,百万Tokens输入(缓存未命中)费1.5元,百万Tokens输出费4.5元。高峰时段,所有价格翻倍,分别是0.1元、3元、9元。

相关推荐

网友评论

登录后发表评论
暂无评论,抢沙发吧~