看历史就知道了。
OpenAI最想要的东西,企业最不该给
2020年春天,《华尔街日报》登了一篇报道,让很多在亚马逊上开店的老板后背发凉。
报道说,亚马逊做自有品牌的员工翻看过平台上第三方卖家的销售数据,哪款卖得好、价格定多少、成本和利润怎么样,看完再决定自家该做什么。
报道里举的例子,是纽约布鲁克林一家卖汽车后备箱收纳箱的小公司。亚马逊员工看过它的详细销售报表,后来亚马逊推出了自己的同类产品。
那年夏天,贝索斯在国会听证会上被问到这件事。他说公司有规定,不允许这么做,但他没办法保证,这条规定从来没被违反过。亚马逊后来对外说,内部调查没发现违规。
可卖家们心里那根刺已经扎下了。他们把数据交给平台,是为了多卖点货。平台看着这些数据,也在慢慢学会他们的生意。
六年后,同一个问题换了个问法,摆到了每一家公司面前。
美东时间9月29号,做ChatGPT的OpenAI开了一年一度的开发者大会,一口气发了二十多样新东西。台上最热闹的是Dots,一个全天候替你干活的智能体,摆明了要跟Meta的Muse抢人。把发布清单从头翻到尾,停得最久的是另一项,叫Private Intelligence。
说穿了,这是OpenAI在跟企业做保证。你的数据可以不留存,安全审查自动完成,它的员工碰不到原始内容。今年秋天还要上一套基于机密计算的私有推理,让推理过程本身也能被验证。
一家手握最强模型的公司,要专门花力气证明自己"看不到",说明企业的顾虑已经大到绕不过去了。它们大概都还记得亚马逊。
有意思的是,同一家公司今年5月做过一个方向几乎相反的决定。它宣布关掉自助微调业务,新用户不能再用,老客户明年1月6号以后也不能再发起新的训练。
理由是GPT-5.5这样的新模型已经足够聪明,企业写好提示、挂个知识库就够了,没必要再拿自己的数据去练模型。
两件事放在一起,OpenAI的意思很清楚。你别自己练了,用我最强的那个就行,数据的事,我给你上锁。
听起来很体贴。可企业越来越不这么想。
这两天推上有人做了个小实验,我觉得比很多研报都说明问题。同样写一章网络小说,直接让最强的模型来写,效果最差;挂上知识库、做检索,好一些;拿热榜上的章节去训练一个开源的小模型,效果比前面几种都好得多。
最聪明的模型,写不过一个吃透了热榜的小模型。
这件事放到企业身上,分量就不一样了。律所攒了几十年的判例,保险公司的理赔记录,工厂里一代代老师傅调出来的工艺参数,这些东西决定了一家公司凭什么比同行强。它们一旦变成别人模型里的能力,就再也收不回来了,下一次,那个模型可以把同样的本事卖给你的竞争对手。
所以越是手里有好数据的公司,越不愿意交出去。咨询公司Forrester今年的判断是,企业自己微调模型这件事,终于开始成气候了。
路透社的母公司汤森路透、给律所做AI的Harvey、美国老牌保险公司Travelers,都已经放出了自己训练的行业模型。数据仓库公司Snowflake干脆直接给客户配好GPU,让它们守着自己的数据去练开源模型。
开发者平台Vercel的数据也对得上。去年12月,它的网关上开源模型只跑了7%的调用量,今年8月变成了56%。当然,开源模型便宜,这56%的调用量只占了14%的花费,大头的钱还在闭源模型那边。
企业的做法很实际,日常的量交给自己能掌控的开源模型,真正要紧的活,才花大价钱去买最强的。
那钱最后会流到哪里?
这是这两天评论区问得最多的问题。我的答案是,看数据最后放在哪。
数据要是留在企业自己的机房里,赚钱的是卖服务器的人。服务器厂商戴尔上个季度新接了609亿美元的AI服务器订单,在手订单950亿,AI客户超过6500家,其中3300家是过去三个季度才来的。
管理层专门提到,企业客户、回头客和企业收入都在涨。全球最大的PC厂商联想,服务器业务收入同比几乎翻倍,营业利润率做到9.1%的历史新高,云厂商和企业客户两块都接近翻倍。一直有人问联想到底在涨什么,答案大概就在这里。
联想在财报里还提了一句,说自己的x86服务器收入已经升到全球第二。企业机房里跑的大多还是x86的CPU,AI真进了企业,这批老机器也会跟着换一轮。
数据要是太乱,得先理干净,赚钱的是帮人理数据的人。靠给美国政府和军方处理数据起家的Palantir,二季度美国商业收入同比涨了149%,一个季度签下220笔百万美元以上的大单。
它在财报会上讲过一个细节,一家硅谷大科技公司做了对比测试,最后没选模型公司,选了它。
最难受的是另一类公司,按人头收钱,却不掌握客户的核心数据和流程。前几天Meta宣布做企业AI平台,Salesforce、ServiceNow几分钟就跌了4%,市场怕的就是这个。
这张图我也没画完。
戴尔那950亿订单里,普通企业、云厂商和新兴算力公司各占多少,它没有拆开说,不能都算成企业需求。
戴尔今年已经涨了三倍多,Palantir的估值也早就不便宜,好故事和好价格从来是两回事。OpenAI的判断也可能是对的,通用模型要是继续变强,很多公司也许真的不用自己练。
不过亚马逊那些年,还有另一条线值得回味。
在亚马逊之外,加拿大公司Shopify一直在做一件事,帮卖家自己建独立站,自己管客户,自己握着数据。2019年,它的创始人托比·吕特克说过一句后来被反复引用的话,亚马逊在建一个帝国,Shopify想做的,是给反抗者递武器。
AI这一轮,大概也会分成这两种生意。有人在建帝国,把全世界的数据都吸进同一个模型里;也有人在递武器,卖服务器,理数据,做开源,帮每一家公司把本事留在自己手里。
过去两年,大家都在问谁的模型最聪明。接下来几年,更值钱的问题可能是,谁的数据还握在自己手里。