智力过剩时代:AI终于可以买断了

公司新闻 60
智力过剩时代:AI终于可以买断了 | 飞哥说
AI认知升级 · 飞哥说

智力过剩时代:AI终于可以买断了

租金变押金,退路比算力更值钱

飞哥 | 十五年电商从业者,持续关注技术与商业的交叉点

先问大家一个问题:这三年你给 AI 一共花了多少钱?几百、几千还是过万?不管是哪个数,停订阅的那天你手里什么都不剩。过去三年的任何一个时间点,全球最顶级的那份智力,你出多少钱都买不到,你只能租。限额、限速、限次数,账号是人家的,模型是人家的,什么时候不让你用?一封邮件的事。

📌 飞哥说:我身边做电商的朋友,十个有九个都在用AI。但你问他们“这AI是你的吗?”没一个人敢说是。租来的东西,永远不踏实。

不过这个星期开始,这个东西能一次性买断了。买断靠的是两件事,而且这两件事相隔一天发生。

哪两件事?DeepSeek 把真正能干活的那部分壳开源了,叫 DSH。第二天阿里放出一个模型,能跑在你们家打游戏的那台电脑里边,追平了大概半年前的世界第一性能。这两件事单看哪件事都不算大,但是把它们放在一起,这就是转折点。

一、从租金到押金:智力定价模式的根本转变

阿里放出来那模型叫千问 3.8 27B,权重直接下载。现在全世界都在抢两张卡,型号是 5090,价格已经抢到翻倍了。因为把这个模型装进两张 5090,它跑出来的东西大概是半年前世界第一的水准。

先说为什么它塞得进你们家的电脑?为什么别的不行?这两年所有的大模型都在往一个方向跑,方向叫混合专家。做法是把一个巨大的模型切成很多块,然后每次有任务的时候唤醒一个小单元去帮你完成这个任务。

它省下来的是算力,但你的显存一分钱没省。你可以把它想象成一间几千人的公司,来了一个任务,它只叫醒其中几个人,剩下的接着睡。人力是省下来了,但是这几千人的工位你一个都省不掉。办公楼还是原来那么大,显存就是那栋办公楼。所以混合专家模型再高效,也进不了你们家那台打游戏的电脑。

千问 27B 走的是另外一条路,叫稠密模型。什么意思?27 个人的公司,来一个活,27 个人全上,所以办公楼就只要 27 个工位,就能把它塞到你们家打游戏那台电脑里了。一张 5090 是 32 个 G,这个模型压到底是 17 个 G,一张卡就塞得下,两张卡是为了让它一个字不压缩地跑。

💡 飞哥说:这就是把一头大象塞进冰箱的方法——不是把大象变小,是换了一头小象。小象能力不差,只是体型合适。

这里边有一个关键点容易被混着讲:稠密不是让它变强的原因,是它能进你家的原因。 它强是被更大的模型手把手教出来的,是拿真实任务反复练出来的,跟架构没关系。这两件事经常被混着讲,但它们是分开的两件事。

二、它到底有多强?半年前的地表最强

有一个指标叫 SWE,千问 27B 的得分是 67.7。SWE‑bench 不是考试题,它是从真实的开源项目里扒出来的真实工单。给你一个几十万行的代码仓库,告诉你这里边有 bug,自己找,自己改完之后跑一遍,人家原本的那套测试全过了给你算 1 分。

67.7 是什么概念?相当于把人家公司里边上百个 bug 工单一句话不交代地丢给一个刚入职的人,然后他关起门来自己修了 67 个,每一个都通过了验收。前面是谁?前面是 GPT5.6,得分是 64.6,后边是今天的世界第一。

但是我不打算吹这个跑分。这张成绩单是千问自己出的,就算打个对折看,长活重活上,真正距第一名还是有差距的。它今天真实的位置大概是这样:约等于半年前地表最强模型。但是半年前你得排队付钱,你得在别人的机器里跑。现在它能完整地、脱了网地运行在你们家客厅里的那台游戏显卡上。

📊 飞哥说:半年前的世界第一,你得跪着求它给你用。现在它坐在你家客厅里,插着电,等你开机。这中间差的不是技术,是权力结构的变化。

三、模型会说话,但真正干活的是那层“壳”

但是你把它跑起来只是完成了一半而已。模型会说话,它读不了你文件,改不了代码,写不了文件,转头它就忘。真正能干活的是外面那层壳,那层壳就是 Claude Code、Codex 这样的。这层壳有一个学名叫 Harness,中文名就是“马具”——驾驭模型干活。

这块得说句实话:手能接别人家的嘴,不是这个星期才有的事。你拿 Claude Code、Codex 早就能接,改一地址,填一模型名,接 DeepSeek 也好,接千问也好,圈里人干这事干了很久。

但是那双手你用的是 Claude Code,那是 Anthropic 的,那是 OpenAI 的。你装在你家自己电脑上,它不归你,图纸也不给你,你改不了一个字,你带不走。哪天涨价,哪天不给你用了,哪天不让你接了,你只能接受。这事不是第一天了。

相隔一天,咱这边的 DeepSeek 把自己那双手完整地开源出来了,叫 DSH。注意,现在全网都很高潮这个 DSH。我说一句公道话:现在这个 DSH 和普通人没有什么关系,它只是一份全开源的 harness 层。但是它因为全开源,协议跟前面那个完全一样宽松,图纸给你,你随便改,改完了拿去开公司卖钱,没人收得回去。

🔧 飞哥说:看见了吗?变的不是能不能换模型,是这双手第一次归你了。嘴手一整套你都能放你们家客厅里了。从“租工具”到“拥有工具”,这是本质变化。

四、押金站起来了:5090 涨价背后的逻辑

到这为止,咱全是好消息。模型小了三十几倍,塞得进你们家那台游戏机,双手还是开源的。按这个走向,这东西应该越来越便宜才对。结果你猜怎么着?5090 从两千美金一块官方定价,现在涨到多少钱了?五千美金,个别型号高出定价百分之一百三。

原因是显存涨价。今天高端卡上显存占到物料成本八成以上,一块卡的钱八成花到那块内存上。东西变小了,装它的盒子翻了一倍。我给它起了个名字叫押金

以前用最强的 AI 是租金,月月付,一天不付用不了。一个月几十块钱到几百块钱美金,按量付费,要么就用 token,更贵。现在可以不交租金了,但是得先交一笔押金——两块 5090 的钱,六万多块钱。一次性租金降到零的同时,押金站起来了,只是搬了个家,从月底账单搬到开机之前了。

然后是最奇怪的部分:买了这两块卡的人,绝大多数不会天天在家跑本地模型。跑两个星期新鲜劲一过,该回去用云上的还是用云去,该用地表最强还用地表最强。这六万块钱是不是就白花了?

不是。 为什么?它在替你干一件看不见的事。

💡 飞哥说:你买的不一定是算力,买的是“随时能走”这四个字。这跟做生意一样,有退路的人,从来不需要跟对方吵架。

五、用 token 数换正确率:智力单价的坍塌

在互联网时代有一个概念叫“用空间换性能”,现在有一个概念叫“用 token 数换正确率”。什么意思?我的千问 27B 虽然不是地表最强,但是已经赶上了半年前的最强。半年前做一个任务,是可以用大量的电力加 token 一遍一遍地试错,一遍一遍地跑。而这个东西是电力成本,不是按 API token 花钱了。它的单价会达到极低。

之前有一兄弟问我这么一个问题:将来 Anthropic 或者 OpenAI 要是不给用了怎么办?这个问题在过去三年是没有答案的,只能跪下,只能祈祷。现在有答案了,而且这个答案不需要真的去用它。

手上那两块卡从插上电那天起就在替你谈判,因为随时能撤,随时能走,对面不能再随便涨价了,而且不能随便断。为什么?因为有退路了。你可能不知道有这么一个说法叫“退出选项”——一段关系里最后能拿到什么条件,往往不取决于谈判,取决于走不走得掉。走得掉的人从来不需要吵架。

所以现在这个局面是挺有意思的:全世界在抢一块自己不打算天天开机的显卡,抢的不是算力,是“随时能走”这五个字的价格,而这个价格正在被抢得越来越贵。

⚡ 飞哥说:今天不必真的去买那两张 5090,交着租金照样用得上最顶级的智力。但从今天起有退路了。这条退路是中国给的。

六、把同一件事放到机房里:智力过剩的真正含义

说句公道话,也不把话说满。在本地跑起来的是它,用它造这件事其实还是在别人手上。这一代的权重别人开源了,下一代还能不能让买断,也是别人说了算的。但是到现在为止,站在这个台阶上了,就站在 27B 的模型上了。

视频到这为止讲的都是客厅那两块卡的事。现在把同一件事放到更广阔的机房里边看一下。以前要拿到水平的回答,得提供一个一万亿参数的模型。这个东西一张卡装不下,十一张卡拼起来才放得下,卡跟卡之间还得不停地互相传参,很多时候传参的时间比推理的时间还要长。

现在同一张卡,整个模型躺进去还剩一半多的地方,剩下的全拿去同时接客。差多少?光是一张卡能装下的用户数,这一项就是十几到二十几倍。再算上不用跨卡传数据,批量能开大,卡不闲着。同一栋地方,同一度电,同一批卡,吐出来有用的东西往上再翻。打不住开头那个词——智力过剩

各位还记得吧?说的就是这件事。不是说 AI 突然变聪明了,是同样一度电,现在能榨出多几十倍的聪明。所以聪明的单价正在往零掉。

📉 飞哥说:当聪明的成本趋近于零,聪明的价值就不再是聪明本身,而是你拿聪明去做什么。就像电便宜了以后,赚钱的不是发电厂,是用电造东西的人。

七、杰文斯悖论:智力越便宜,用量越大

说到这得先说一件一百六十年前的事。英国有一个经济学家叫杰文斯,当时全国都松了一口气,因为蒸汽机越造越省煤,大家算下来觉得英国的煤终于能烧得久一点了。杰文斯翻翻账本说:正好反过来。从蒸汽机开始省煤的那一天起,英国的煤消耗翻着倍地往上涨。

道理并不复杂。煤便宜的时候,只有最赚钱的那几个矿主用得起蒸汽机。煤一便宜,纺织厂就用得起了,铁路就用得起了,轮船就用得起了,最后连家里烧热水都用得起了。每一分省下来的钱,都被新冒出来的用途吃回去了,还不够吃。这件事后来有个名字叫杰文斯悖论

今天这件事正在 AI 身上重演。智力变便宜了,不是大家用得少了,是大家用得多了。以前用不起 AI 的行业,现在用得起了;以前用不起 AI 的人,现在用得起了。每一个新用途都会吃掉更多的智力,而智力还在继续变便宜。

🔥 飞哥说:这就是为什么我一直在关注这件事——智力过剩不是灾难,是机会。就像电便宜了,才有了互联网;算力便宜了,才有了AI。接下来十年,所有行业都会被重做一遍。

八、飞哥的几点判断

  • 第一,AI的定价权正在从“模型方”转移到“用户方”。 以前是人家说多少你给多少,现在你有退路了,情况就不一样了。

  • 第二,本地部署和云端服务会长期共存。 本地图的是安全、可控、不被卡脖子;云端图的是省事、最新、不用管硬件。两条路都有价值。

  • 第三,真正的机会不在“用AI”,在“用AI造东西”。 当智力成本趋近于零,比拼的就是谁更能把智力转化成产品、服务、解决方案。

  • 第四,中国的开源生态正在改变全球AI的权力结构。 这不是一两家公司的事,是整条产业链的话语权在转移。

今天这篇文章,我不劝你买卡,也不劝你不买。我只是把我看到的趋势老老实实写出来——AI正在从“租”变成“买”,从“别人说了算”变成“你说了算”。这件事才刚刚开始,未来三年会有更多变化。


📢 关于AI和商业的交叉点,飞哥持续关注

这篇文章是对近期AI行业变化的观察和思考。如果你也在关注AI如何改变商业、改变电商、改变普通人能做的事情,欢迎一起交流。

也欢迎留言说说你给AI花了多少钱,以及你觉得这钱花得值不值。

本文约5000字 · AI认知观察 · 飞哥原创

关键词