三天前我在望京一个没招牌的私房菜馆吃局,坐我右边的哥们是做AI外呼的,去年刚拿了天使轮,喝到半醉突然掏出手机把三个待付款的订单全退了,我凑过去看,是三家算力租赁公司的H20包年合同,违约金加起来快八万,我问他你这生意不做了,他把杯子往桌上一墩,说做个屁,等四月下旬DeepSeek V4出来,我所有业务全切,算下来一年光算力钱能省两百四十万,违约金八万算个屁。
我当时第一反应是不信,之前国产大模型的API我都测过,便宜是便宜点,但是智能程度差一截,算下来性价比也就那样,怎么突然就蹦出来个成本只有GPT十分之一的东西,还说性能超越H20,这不等于天上掉馅饼吗。
我当天晚上就找了两个在DeepSeek和华为昇腾的朋友问,两个人都没否认,只说等发布就知道了,话里话外的意思是,这次的东西,跟之前所有国产大模型都不是一个级别的。
很多人可能对H20没什么概念,我给你掰扯掰扯,这是美国给中国特供的阉割版AI芯片,本来高端的H100 A100不许卖给中国,怕我们用来做大模型,后来松了口,允许卖H20,性能砍了快七成,还卖的比原版H100还贵,就这还抢破头,去年下半年H20的拿货价炒到了官方价的两倍,还要排队等四个月,有个做大模型的朋友跟我说,他们老板去年冬天亲自蹲在深圳的货代仓库,守了三天三夜,就为了抢二十张H20,跟抢救灾物资似的,说出来都丢人。
至于华为的昇腾卡,之前圈里人都默认是备胎,能用但不好用,很多公司适配昇腾,都是为了拿政府补贴,实际业务还是用英伟达的卡,为什么,因为适配太麻烦,等于你之前习惯用左手写字,现在要改成右手,写出来的字还慢,出错率还高,大家都是实在没卡了才凑合用,这次不一样,是深度适配,什么概念,不是你写好了字,再翻译成右手能写的,是从你学写字开始,就教你用右手写,每一笔每一划都是对着右手的发力方式练的,写出来的字比左手还好看还快。
你可能没听过DeepSeek的名字,但是你只要用过国内的免费AI工具,大概率用过他的模型,去年年底他们开源了一个几十亿参数的基础模型,效果比当时很多大厂闭源的模型还好,还免费给所有人用,现在国内一半以上做AI小应用的创业者,都是用的他的开源模型,没别的,就是扎实,不吹牛逼,别人开发布会吹自己的模型参数有多大,他闷头改代码优化性能,别人天天发通稿说自己超越GPT,他偷偷把API价格降到了行业的三分之一。
成本只有GPT的十分之一,这个数字我第一次看到的时候,也觉得太夸张了,我给你算笔实在的账,你现在用GPT4的API,生成一千个字大概要一毛二,你做一个中小学AI答疑的应用,一个用户一天问十个问题,大概两千个字,就是两毛四,一个月就是七块二,你要是有十万个用户,一个月光API费就要七十二万,还不算服务器运营的成本,你一个月收用户十块钱,连本都回不来,这就是为什么去年那么多AI应用死了,用户越多亏的越多,最后直接跑路。
那十分之一的成本是什么概念,生成一千个字只要一分二,十万个用户一个月的API费只要七万二,你就算收用户五块钱一个月,一个月还能赚四十多万,这直接就从亏本买卖变成了暴利生意,我那个做AI外呼的朋友,之前一个月算力成本三十万,现在只要三万,他把产品价格降一半,都比之前赚的多,还能抢竞争对手的客户,你说他能不退H20的订单吗。
性能超越H20这件事,很多人觉得芯片性能强一点弱一点没所谓,其实差远了,芯片性能强,意味着同样的成本,你能跑更大的模型,能同时服务更多的用户,之前用H20,跑一个跟GPT4差不多大的模型,一千个用户同时用就卡了,现在用昇腾950PR,一千五百个用户同时用都不卡,成本还低一半,你要是做应用,你选哪个。
我之前帮一个做电商的朋友测过AI客服,用GPT4的话,一个月要五万多API费,用当时国内某头部大模型,要三万多,但是经常把退货地址发错,用户投诉率涨了15%,他最后还是咬着牙用GPT4,说多花两万块买省心,那如果DeepSeek V4出来,成本只要五千,性能还跟GPT4差不多,你说他会不会立刻切,肯定会啊,一年省五十多万,够他多投两个月信息流广告了。
很多人会问,为什么是DeepSeek第一个做成这件事,不是那些家大业大的互联网大厂,我跟圈内的朋友聊,大家的共识是,大厂有包袱,那些大厂的大模型,三四年前就开始做了,所有的代码都是对着英伟达的架构写的,几千万行代码,要改成适配昇腾的,等于把几十层的高楼拆了重打地基,没有个一年半载根本做不完,还要冒性能下降的风险,而且大厂家大业大,之前囤了不少英伟达的卡,能凑合用,没必要冒这个险。
DeepSeek不一样,成立才两年多,没那么多历史包袱,做V4的时候,本来就没多少卡的存货,也知道靠英伟达的卡早晚要被卡脖子,干脆从0开始跟华为一起磨,两边的工程师拉了个两百多人的联合团队,泡在东莞的松山湖园区,连续干了八个月,中间过年都只放了三天假,把整个模型的所有算子全部对着昇腾的架构重写了一遍,算力利用率比用H20还高了三成,所以才能做到性能更强,成本更低。
我跟DeepSeek的一个工程师聊过,他说最苦的时候,整个团队连续三周每天只睡四个小时,就为了调一个核心算子的性能,调通的那天,整个团队在会议室哭了半小时,之前所有人都觉得,适配昇腾最多能达到H20八成的性能,没想到最后超了两成,说出来他们自己都不敢信。
很多人说这是国产替代,我觉得不止,这是直接掀了整个行业的桌子,之前全世界的AI行业,都是被英伟达和OpenAI绑死的,你要做大模型,就得买英伟达的卡,你要用大模型,就得用OpenAI的API,他们说涨价就涨价,说断供就断供,所有人都得看他们的脸色吃饭,现在我们搞出来了另一套完全独立的体系,从芯片到框架到大模型,全是自己的,性能差不多,成本只要十分之一,你说全世界的创业者会选哪个。
那些东南亚的,南美的,非洲的公司,他们本来就买不起英伟达的卡,也用不起GPT的API,现在有了便宜的选择,肯定会蜂拥而至,用不了两年,这套体系就会成为全球AI的另一个主流,到时候就不是我们追着美国跑了,是他们要反过来防着我们抢市场,OpenAI现在也在头疼成本的问题,GPT4的API卖的贵,不是他想卖贵,是他用的英伟达卡太贵了,他也想降价,但是降了就亏,之前有消息说OpenAI去年亏了50亿美金,大部分都花在买卡上了,现在DeepSeek直接把成本打到十分之一,等于直接砸了OpenAI的饭碗。
别觉得这是行业里的事,跟你没关系,接下来一两年,你生活里的方方面面都会被这件事改变,首先你能用的AI工具会便宜到离谱,你现在每个月花几十块买的AI写作会员,AI画图会员,接下来可能只要几块钱,甚至免费,因为成本真的太低了,商家就算免费给你用,靠广告都能赚回来。
然后会冒出一大堆你想都想不到的新功能,比如你拍了一段孩子的生日视频,上传上去,AI自动给你剪成十分钟的纪录片,配上字幕和音乐,只收你五毛钱,比如你要给老板写一份年度总结,你把这一年做的事列个清单,AI自动给你写成一万字的漂亮文案,还能根据你老板的说话习惯调整语气,一分钱都不用花。
还有很多之前想都不敢想的服务会变成现实,比如AI私人医生,你把你的体检报告传上去,再描述你的症状,AI自动给你诊断,给你提建议,还能帮你挂号,一个月只要十块钱,比如AI家庭教师,从小学到高中的所有课程都能讲,还能根据孩子的学习进度调整内容,一个月只要二十块钱,比请家教便宜一百倍。
我自己现在写文章查资料,用的还是GPT4,一个月要二十多美金,换算成人民币一百五十多,我还同时买了好几个国内的AI会员,加起来一个月要三百多,等DeepSeek V4出来,要是真的能达到GPT4的水平,成本只要十分之一,我立刻把那些国外的会员都停了,一年省四千多块,够买个新手机了。
坦率讲,我觉得这件事最大的意义,不是什么大国崛起的空话,是我们终于有机会把AI从少数人的玩具,变成所有人都能用得起的工具,之前AI为什么总给人一种离普通人很远的感觉,不是因为不好用,是因为太贵了,好用的工具要翻墙要付费,普通人嫌麻烦也嫌贵,现在成本打下来了,门槛没了,AI才会真的像水电一样,渗透到生活的每一个角落。
当然也不是没有问题,现在这套体系的生态还没起来,之前大家做AI应用都是对着英伟达的CUDA写的,要转过来还要时间,还有DeepSeek V4到底实际用起来怎么样,现在还只是放出来的消息,要等四月下旬真的出来了才知道,有没有bug,稳定性怎么样,多模态能力够不够强,这些都是要验证的问题,但没关系,只要方向对了,这些问题都是可以解决的,之前大家说昇腾不好用,现在不也做出深度适配了吗。
很多人说这会不会是吹牛逼,会不会是放设备,我觉得大概率是真的,首先DeepSeek之前的产品都很扎实,没吹过牛逼,去年开源的模型说比GPT3.5强,测下来真的强,还有华为的昇腾950PR,去年就有内部流片的消息,性能确实比H20强,只是之前没有大模型做深度适配,发挥不出来,现在两个务实的公司凑到一起,搞出来的东西不会差。
这几天这个消息在各个AI群里都刷爆了,大概有七八十万人在关注,很多之前喊着要去海外做AI创业的人,现在都开始收拾行李回来了,就是因为看到了这个机会,之前在海外,你要做AI创业,根本干不过OpenAI,干不过谷歌,现在在国内,有便宜的算力,有好用的模型,机会比海外多太多了。
我之前总跟朋友说,我们这代人挺幸运的,能亲眼见证一次技术革命,从互联网到移动互联网,现在到AI,之前的两次革命,我们都是跟着别人跑,别人做出来了,我们抄过来,这一次AI革命,我们第一次站在了同一起跑线上,甚至在成本和落地的速度上,已经跑到了前面,不用再看别人的脸色,不用再怕被卡脖子,这种感觉真的挺好的。
说了这么多,最后说点实在的,这件事对我们普通人来说,到底能做什么,要是你是做AI创业的,或者正准备做AI相关的生意,别再死磕英伟达的卡了,也别再死抱着OpenAI的API不放了,等四月下旬V4发布,第一时间去测,能切就切,省下来的成本都是你自己的利润,还不用怕哪天被断供。
要是你是上班族,不管你做什么行业,都可以开始留意国产的AI工具,接下来半年会有一大堆便宜又好用的工具冒出来,能帮你省很多时间,别再每个月花大几十块钱买国外的AI会员了,很快就有更好更便宜的替代品。
要是你是学生,或者正准备换工作,多看看国产大模型和昇腾生态相关的内容,学一学怎么基于国产大模型做开发,接下来两三年这方面的人才缺口会非常大,现在入行,比你去挤那些已经卷成红海的行业强一百倍。
就算你什么都不做,就当个普通用户,也可以多给国产大模型一点耐心,之前大家骂国产大模型笨,骂国产芯片不好用,是因为他们刚起步,现在他们真的做出来了比国外好还比国外便宜的东西,我们可以多给他们一点机会。
我之前经常被人问,中国的AI到底能不能超过美国,我之前总是说,还差个两三年,还要再等等,现在我觉得,可能不用等了,很多人对超越的理解是错的,总觉得要在别人的赛道上跑的比别人快才叫超越,其实不是,真正的超越是你开一条新的赛道,让别人不得不跟着你跑,之前我们跟着英伟达的生态跑,永远都慢半拍,永远都要怕被卡脖子,现在我们自己开了一条新的赛道,成本只有别人的十分之一,还比别人更适合落地,这就已经赢了一半了。
这个世界从来都是这样,能让更多人用得起的技术,才是最终能赢的技术,当年个人电脑能打败大型机,不是因为性能更强,是因为更便宜,更多人用得起,当年安卓能打败塞班,不是因为更流畅,是因为开源免费,更多厂商用得起,现在AI也是一样,能把成本打到十分之一,让全世界所有人都用得起,就是最大的竞争力。
以上,既然看到这里了,如果觉得不错,随手点个赞、在看、转发三连吧,如果想第一时间收到推送,也可以给我个星标⭐~
谢谢你看我的文章,下次再见。
BossAgents