没有预热,没有倒计时,DeepSeek在8月13日深夜打出了一套连环组合拳。凌晨悄悄刷新API文档上线V4 Pro正式版,晚上八点半直接开源Harness开发者预览版。这两招接连甩出来,意图已经再明显不过,DeepSeek不想只做个卖API的模型厂,它要直接下场做Agent时代的安卓底座。 先看V4 Pro,模型架构没动,但后训练让Agent能力原地起飞。自家软件工程基准DeepSWE跑分从12.8直接飙到62.7,以前跑长链路代码修改最容易翻车,现在处理复杂环境操作和工具调用稳得一批。更狠的是价格依然维持在输入3块输出6块,趁着两天前预告的涨价通知还没生效,开发者们正疯狂薅羊毛。 再看深夜开源的Harness,这根本就不是给普通用户准备的成品,而是扔给开发者的一堆硬核零件。核心逻辑就四个字,一切皆插件。从模型、工具到前端UI,甚至连驱动Agent运转的主循环本身都能拆下来换掉。仓库公开才12个小时就狂揽5万星,足见开发者圈子对这种高自由度底座的饥渴程度。 把这两件事拼在一起看,DeepSeek的战略转型已经彻底明牌。V4 Pro负责在前端秀肌肉,用暴涨的Agent能力和极具侵略性的定价死死黏住开发者。Harness则负责在后端建生态,用开源底座把Agent的运行标准握在自己手里。以前大家拼的是谁家的大模型更聪明,现在DeepSeek直接把牌桌换了。当你的Agent跑在它开源的底座上,用着它的插件,调着它的API,这道生态壁垒一旦砌起来,未来算力定价和生态规则的话语权,可就真由不得别人了。 过去几个月,AI Coding圈子里大家都在卷模型,却忽略了一个致命问题。同一个模型塞进不同的框架,最终表现可能天差地别。模型只管预测下一步,而框架决定了它能看到什么、怎么调用工具、出错怎么重试。以前市面上的主流Agent框架,所谓的可扩展性基本停留在工具层,顶多让你换个搜索插件,但Agent怎么循环、怎么调度,这些核心关节全是焊死的。 DeepSeek这次直接把焊点给砸了。它搞出的Cordis插件系统,把插件边界一路下沉到了整个运行时。模型、工具、会话、沙箱,甚至连驱动Agent运转的Agent Loop和前端UI,全都可以拆下来换掉。我上手试了一下,直接用提示词把它的Web前端改成了洋红色主题,这自由度确实有点离谱。更绝的是,它把工具调用拆成了一条可扩展流水线,请求执行前要过审批、权限和沙箱,执行后还能改写结果,全程无需改动底层源码。 这种彻底解耦的设计到底在颠覆什么。它颠覆的不是某个具体的功能,而是Agent基础设施的定义权。当Agent的每一个行为环节都能像搭积木一样随意插拔时,DeepSeek实际上是在输出一种运行标准。它不想只做一个被调用的API,而是要成为定义Agent怎么跑、按什么规则工作的底层操作系统。 一旦开发者习惯了这种高度可组装的底座,并在上面沉淀出自己的插件生态,DeepSeek掌握的就不只是模型层的算力定价权,更是整个Agent运行环境的收税权。这才是它交出这套底牌真正的野心所在。 顺着“一切皆插件”的激进设计,官方抛出了一个极具科幻感的概念:创造模式。Agent能直接检查身处的运行时环境,在内存里试装插件,甚至自己组合出新的运行规则。听起来像是Agent觉醒自我意识,开始给自己重装系统。但咱们得保持清醒,这距离真正的自我改造还差着几个大版本。目前它只是把运行时的可组合性开放给模型,让配置成了可操作对象。真要让Agent自主重构底层逻辑,还得等真实复杂任务验证,现在吹自我进化纯属营销话术。 再看被寄予厚望的多Agent编排。DeepSeek塞进了一套完整系统,父Agent能通过Spawn开启新上下文,或用Fork继承会话,还能现场写JavaScript搞并行流水线,甚至弄了个Ralph模式让多Agent轮次接力。花样确实多,但扒开外衣,骨子里还是最经典的层级式主管与工人架构。父Agent当包工头拆解分发,子Agent当苦力只管执行。 这和真正的群体智能差了十万八千里。系统缺少Agent间的自主发现、协商竞争和动态接管机制,控制权死死捏在父Agent手里。把现有编排套路做成可替换插件,或允许外挂其他家的Agent,工程实现上确实精巧,但绝对算不上范式突破。拿这套东西宣传全新多Agent架构,纯属吹过头。DeepSeek费这么大劲搞花活,核心目的是配合V4 Pro暴涨的能力,用高自由度生态噱头把开发者绑在底座上,从而在算力定价上掌握绝对话语权。 别被炫酷的编排名词忽悠。现阶段拿Harness跑单Agent复杂代码任务,或测试V4 Pro模糊需求的补全能力,确实能体会到效率飞跃。但想指望靠这套层级式系统搞定大规模多Agent协同作业,建议先捂紧钱包,等核心插件和基础接口再迭代几个版本再说。 好马还得配好鞍,底座设计得再天花乱坠,最终干活的还是模型这个脑子。V4 Pro正式版这次保留了1.6T总参数与49B激活参数的MoE底层架构,但后训练显然下了血本。看看跑分就知道,自家软件工程基准DeepSWE从预览版的12.8直接干到62.7,Cybergym也飙到了83.3。以前跑长链路代码修改动不动就翻车,现在处理复杂环境操作和工具调用稳得让人害怕。 但跑分好看只是门票,真刀真枪还得看实测。拿个物理模拟和实时渲染的综合任务去考它,一百七十秒吐出七百多行完整代码,两百个彩色三角形在屏幕上流畅游动,一次运行直接通过,这执行力确实没得挑。 不过最让我惊艳的不是这种按部就班的硬任务,而是对模糊需求的产品化补全。我故意给它挖坑,只扔过去一句想要个好看的番茄钟工作面板,附带几个能计时、有白噪音、有质感这种极其宽泛的方向,剩下的全让它自己脑补。结果它交回来一千两百多行代码,不仅搞定了基础的工作休息循环,还自作主张加上了任务标签、专注统计图表和快捷键支持,甚至直接调用音频接口从零手搓了几种白噪音。 这种对模糊意图的精准捕捉和主动扩展,才是Agent时代模型真正的护城河。以前的大模型像个听话的计算器,你拨一下它动一下;现在的V4 Pro更像个懂行的产品经理,你给个模糊的愿景,它能给你交付一个带细节的成品。当这种强大的意图补全能力,跑在Harness那套高度可定制的插件底座上时,DeepSeek才算真正完成了从卖算力到卖工作流的闭环。别光盯着跑分自嗨了,拿它去处理那些连你自己都没想清楚的边缘需求,你才会发现这模型到底有多可怕。 为什么DeepSeek非要蹚Agent界Android这趟浑水?看看前阵子V4 Flash单日狂吞8万亿token的疯狂数据就懂了。单纯卖模型API是一条算不过账的死胡同。当你把性价比做到极致,流量确实会像海啸一样涌过来,但物理世界的算力瓶颈会直接教你做人。官方提前预告涨价就是最现实的妥协。 既然在底层算力上卷不出绝对护城河,不如直接往上走,去定义Agent的运行标准。这就是Harness开源的真正底牌。以前大家做Agent,都是各家自己攒一套框架,模型和工具死死绑定。DeepSeek这次把模型、工具甚至Agent Loop全拆成插件,本质上是在搞一套统一的底层协议。 你想想,如果全行业的开发者都习惯了在Harness上搭积木,用着它定义的Cordis插件系统,跑着V4 Pro的API,这生态壁垒有多可怕。V4 Pro负责在应用层秀肌肉,用暴涨的代码执行力和模糊需求补全留住用户。Harness负责在底层收税,把Agent怎么跑、按什么规则工作的定义权攥在自己手里。 做模型厂只能赚卖水人的辛苦钱,做基础设施才能掌握生态与算力的双重定价权。别光盯着跑分榜上的数字自嗨了,谁先制定出Agent时代的安卓标准,谁才能真正拿走下一个十年的过路费。 DeepSeek V4 Pro 正式版实测,补齐 Agent 能力 战略宏图看着挺美,但现实账本极其骨感。前阵子V4 Flash搞出的那条行业斩杀线确实让全行业高潮,但流量反噬的代价来得比想象中快得多。 先看一组疯狂的数据。8月1日单日,V4 Flash在一个入口就吞了8万亿token,5万亿是白嫖的免费额度,3万亿是掏了真金白银的付费调用。做个对比,OpenRouter塞了四百多款模型,全平台日均处理量大概6.6万亿。一家模型一天的流量,直接干翻了一个容纳四百多款模型的路由平台。 支撑这种天文数字的,是输入1块输出2块的极端定价。对比月之暗面Kimi K3输入21块输出105块的价格,这性价比简直像个系统漏洞。但这种违背商业常识的低价幻觉,直接导致8月4日API因为前所未有的访问量当场瘫痪。 不管MoE架构怎么稀疏激活,当万亿级请求实打实砸向物理世界的GPU集群时,效率优化根本填不平硬件成本的无底洞。机器要花钱买,算力要烧电跑。 于是戏剧性的一幕来了。8月6日,刚被全网捧为性价比屠夫的DeepSeek,悄悄在后台挂出公告,预告近期整体上调API定价且涨幅较大。 这根本不是什么背刺,而是算力物理定律的无情碾压。大模型不是边际成本趋近于零的传统软件,当规模化带来的不再是成本摊薄,而是基础设施成本的指数级飙升时,低价幻觉必然破灭。 别总指望厂商用爱发电。趁着现在V4 Pro输入3块输出6块的窗口期还没关闭,赶紧把核心业务链路跑通。等涨价大棒真落下来,那些还指望靠白嫖廉价算力跑通商业模式的团队,大概率会第一批死在沙滩上。 技术看透了,账算明白了,咱们直接聊点落地的。对于现在的开发者来说,最务实的策略就一句话:V4 Pro直接拿去干活,Harness先当玩具。 V4 Pro正式版现在的Agent能力已经完全可以扛事了。自家软件工程基准DeepSWE跑分从预览版的12.8直接干到62.7,以前处理长链路代码修改动不动就崩溃,现在面对复杂环境操作稳得让人害怕。更关键的是,趁着输入3块输出6块的涨价前窗口期,你完全可以把核心的代码生成和模糊需求补全业务直接切到V4 Pro上。它那种能主动脑补产品细节的能力,已经足够帮你省下大量跟产品经理扯皮的时间。 但深夜开源的Harness,你千万别急着往生产环境里塞。这玩意儿目前只是个v0.1版本的毛坯,界面对不写底层代码的人极不友好。虽然一切皆插件的理念极其激进,连Agent Loop都能拆下来换,但扒开外衣看,它的多Agent编排骨子里还是最经典的层级式架构,父Agent当包工头,子Agent当苦力,根本谈不上范式突破。你拿它跑跑单Agent复杂任务,或者在内存里玩玩创造模式试装插件,确实能体会到极客的乐趣。可要是想指望靠这套系统立刻搞定大规模多Agent协同作业,大概率会给自己挖坑。 现阶段最聪明的做法,是把V4 Pro当成马上能变现的生产力工具,把Harness当成探索底层运行标准的实验室。别被那些炫酷的开源概念忽悠得连夜重构项目,等它的核心插件和基础接口再迭代几个大版本,咱们再谈全面接管Agent底座的事。 DeepSeek 算力瓶颈与重塑 AI 行业世界观 前文咱们聊了怎么避坑,把V4 Pro当生产力,Harness当实验室。但跳出这些具体的实操,站在更高的视角来看,DeepSeek这波连环拳的真正野心,早就不是单纯卖个聪明的脑子了。 过去两年,整个行业都在卷模型参数,拼的是谁家的大模型更懂代码。但DeepSeek现在想通了,光有个最强大脑没用,你得给它配上一套好用的神经系统。V4 Pro负责把脑子练到极致,用DeepSWE跑分暴涨50分的硬实力和模糊需求补全的软实力死死黏住开发者。而深夜开源的Harness,则是直接下场造躯干。 它把模型、工具、会话甚至Agent Loop全拆成插件,本质上是在搞一套统一的底层协议。如果全行业的开发者都习惯了在Harness上搭积木,用着它定义的Cordis插件系统,跑着V4 Pro的API,这生态壁垒有多可怕。前阵子V4 Flash单日狂吞8万亿token的疯狂数据已经证明,单纯靠低价卖算力是一条算不过账的死胡同,物理世界的GPU集群早晚教人做人。 既然在底层算力上卷不出绝对护城河,不如直接往上走,去定义Agent的运行标准。单纯卖API只能赚点卖水的辛苦钱,掌控底层基建才能拿到整个生态的过路费。当你的Agent跑在它开源的底座上,用着它的插件,这道生态壁垒一旦砌起来,未来算力定价和生态规则的话语权,可就真由不得别人了。 别光盯着跑分榜上的数字自嗨。当海外巨头还在封闭系统里卷模型上限时,DeepSeek已经试图用开源底座制定标准。谁先交出Agent时代的安卓底座,谁才能真正拿走下一个十年的过路费。