Meta开源可跑手机的Llama 4系列,本质是在改写全球AI行业的底层规则

昨天凌晨三点我刷朋友圈,刷到那个去年拿了两千万融资,专门做端侧大模型的哥们儿,把过去半年发的二十七条关于自主研发端侧大模型的内容,全设成了仅自己可见。 我私戳他问咋了,他隔了十分钟回了个表情包,是那个熊猫头蹲在墙角抽烟,配字全完了。 我当时还没反应过来。 直到刷到HackerNews的顶榜,才知道Meta把Llama4的两个新模型放出来了。一个叫Scout,轻量版,能直接跑在手机上,一个叫Maverick,旗舰版,4050亿参数的MoE架构,完全开源,随便商用,一分钱不收。 那天整个国内AI圈的群,从凌晨一点吵到早上八点。 有人连夜删了自己大模型产品的定价页。 有人连夜改了BP准备去找投资人谈新方向。 有人蹲在官网抢权重下载。 六十多万人挤在各个论坛和社群里刷消息,热闹得像跨年。 之前Llama3出来的时候,整个行业已经疯过一次了。那次70B参数的模型开源可商用,直接把一大半做通用大模型的创业公司逼到了墙角,很多公司之前融了几千万,刚把70B参数的模型做出来,还没来得及卖钱,就直接成了免费的公共资源。 所有人都以为那次已经是地板价了,没想到才过了几个月,Meta直接把天花板给掀了。 4050亿参数是什么概念。 你把整个红楼梦,三国演义,水浒传,西游记,四书五经,加起来所有的字,一共也就三千多万字。 每个字算两个字节,也就六千多万的数据量。 4050亿参数,相当于能装下七千套完整的四大名著加四书五经。 它一次能读完一整套二十四史,还能顺带给你把每个朝代的兴衰原因理得明明白白,连某个不出名的小人物的生卒年都能给你说清楚。 而且它用的是MoE架构,这个架构说起来也简单。 之前的大模型,不管你问什么问题,所有的参数都要参与计算,相当于你去医院看个感冒,整个医院所有的医生都来给你会诊,虽然水平高,但效率低,成本高。 MoE架构就是把参数分成好多组,每组负责一个方向的问题,你问数学题,就找负责数学的那组参数,你写文案,就找负责语文的那组参数,每次只有不到十分之一的参数参与计算,所以速度比之前的同参数模型快了快十倍,成本还低了一大截。 之前有人测过,Maverick的综合性能,跟现在市面上最强的闭源模型GPT-4o,只差了不到两分,在很多逻辑推理和数学题上,甚至比GPT-4o还要准,之前只有闭源模型能做到的效果,现在Meta直接开源了,随便用。 Scout量化之后只有6GB左右,现在大部分的旗舰手机,甚至很多中端手机,都有12GB以上的内存,跑起来完全没问题,甚至还能后台挂着微信和抖音,一点都不卡。 我昨天下午找朋友要了个量化好的Scout安装包,装在我去年买的,三千多块钱的安卓手机上,开飞行模式测了一下。 我问它,假设我是一个做奶茶店的个体户,下个月要在大学门口开新店,目标客户是大一新生,能不能给我做一个为期一周的开业活动方案,预算五千块,要能加到至少两千个学生的微信,还要能保证首月的复购率不低于30%。 它大概八秒钟就出了完整的方案,从第一天的引流活动,到第三天的锁客活动,到第七天的社群活动,连每个活动的具体成本,送什么礼品,怎么加微信,怎么引导复购,甚至连发朋友圈的文案都写好了。 我仔细看了一遍,没有之前那些AI方案的假大空,所有的步骤都是可落地的,甚至还考虑到了大一新生刚开学,有家长陪送,可以做家长的单,这个点我自己都没想到。 整个过程没有连网,所有的计算都在我手机上跑,没有任何数据传出去,速度比我之前用的某国内头部大模型的云端API还快,效果还好。 我当时就明白,我那个哥们儿为什么说全完了。 他花了一年多,烧了一千多万,几十号人熬了无数个通宵做出来的东西,现在随便一个人,在网上找个安装包,就能装在自己手机上用,效果还比他的好,他之前所有的技术壁垒,所有的竞争优势,一夜之间灰飞烟灭。 最狠的还是完全开源可商用这几个字。 之前的大模型,要么是闭源的,你只能调用API,按token收费,稍微用得多点,一个月大几万的费用就出去了,数据还得传到人家的服务器上,人家想看就能看,想封你的号就封你的号,之前OpenAI封了一大批中国用户的号,很多人充了好几百美金的会员,说没就没了,找谁说理都没用。 要么是半开源的,给你看权重,但是不让你商用,或者商用要交几十万甚至上百万的授权费,还要看人家的脸色,稍微有点规模的应用,人家就会过来找你收钱,不给就告你。 国内的很多开源大模型,更是藏着各种坑,有的说自己开源,结果只开了推理的权重,不让你微调,有的说可以商用,结果你赚了钱之后就要跟你分润,各种条款写得密密麻麻,稍不注意就踩坑。 Meta这次是真的狠,直接把两个模型的所有权重,所有代码,全放出来了,没有任何附加条件,你随便改,随便微调,随便用来做产品赚钱,哪怕你用它做了个一年赚几个亿的产品,Meta也不会找你要一分钱,也不会管你怎么用。 很多人说Meta是活菩萨,做慈善,其实根本不是。 Meta之前all in元宇宙,烧了几百亿美金,结果搞了个半死不活,转头all in AI的时候,已经落后OpenAI和谷歌大半年了。要是跟OpenAI一样走闭源卖API的路线,Meta根本打不过,OpenAI有微软的云资源,有几亿的用户,有先发优势,Meta卖API根本卖不动。 所以Meta走了另一条路,就是当年谷歌做安卓的路。 当年智能手机刚出来的时候,诺基亚的系统是闭源的,苹果的iOS也是闭源的,谷歌直接把安卓开源了,免费给所有手机厂商用,谁都可以改,谁都可以用来做手机,短短几年,安卓就占了智能手机市场的八成份额,谷歌虽然不卖系统赚钱,但是所有的安卓手机都要装谷歌的服务,所有的安卓应用都要走谷歌的应用商店,谷歌靠广告和应用分成,一年能赚几百亿美金,比卖系统赚得多得多。 Meta现在打的就是这个主意。 我把模型免费给你用,让所有的开发者,所有的公司,都用我的模型做开发,都基于我的模型做产品,那整个AI行业的标准就是我定的,整个AI生态的核心就是我,以后不管你做什么AI应用,不管你做什么AI硬件,都得适配我的模型,都得跟我的生态兼容,到时候Meta不管是做广告,还是做服务,还是做硬件,都有绝对的话语权,这个收益,比卖API那点钱大一百倍都不止。 而且Meta还有个别人没有的优势,就是它有全世界最大的社交平台,有几十亿的用户,有无数的真实对话数据,别人训练模型要到处找数据,Meta自己家里就用不完,它可以不停地迭代模型,不停地出新版本,永远保持领先,别人想追都很难追上。 很多人现在又开始焦虑,说中国AI又要落后了,Meta都出这么强的开源模型了,国内的厂商还在玩几百亿参数的模型,以后是不是又要被卡脖子。 坦率讲,我觉得真的没必要。 首先,Meta的模型再好,也是用英文数据预训练的,虽然也有中文语料,但对于中文的语境,中文的梗,中文的本地化需求,理解程度肯定不如国内的模型。你让它写个符合国内平台规则的带货文案,它写出来的东西永远有种翻译腔,你让它处理国内的政务需求,处理社保公积金的问题,它根本搞不懂国内的规则。而且国内的监管要求,也不可能允许所有的应用都用海外的模型,本地化的优化,场景的适配,这些都是国内公司的机会。 而且开源是把双刃剑,Meta把模型放出来,国内的公司也能用啊。 之前Llama3出来的时候,国内已经有好多公司,基于Llama3做中文微调,做出来的模型,中文效果比很多自己从头训练的大模型还好,成本还不到十分之一。这次Llama4出来,相当于给国内所有的AI公司,送了一个世界顶级的基础底座,大家不用再烧几十亿去从头训练基础模型了,直接在这个底座上做中文优化,做垂直场景的适配,反而能把更多的钱和精力,花在落地应用上,花在解决真实的用户需求上,反而可能加速国内AI的落地速度。 之前很多小公司想做AI应用,光是买算力训练基础模型就要几千万,根本烧不起,现在基础模型免费了,只要懂场景,懂用户需求,就能做出来好用的产品,反而给了更多小公司和普通人机会。 你可能现在还觉得,这个事跟你没什么关系,你平时用用云端的AI工具就够了,也不用自己做什么产品。 其实不是,这个事的影响,会渗透到你生活的每一个角落,比你想象的快得多。 接下来最多三个月,你手机上的所有APP,都会陆续接入端侧的大模型。 你点外卖的时候,不用再翻几十页的商家,不用再一条一条看评价,你直接跟手机说,我今天想吃辣的,不要海鲜,人均三十以内,离我走路十分钟,评价里没有说食材不新鲜的,它直接给你把最合适的三家列出来,连优惠券都给你领好,整个过程不用连网,你的所有偏好数据都存在你自己的手机上,不会有人拿这个数据给你推广告,也不会有人知道你今天想吃什么。 你逛淘宝的时候,不用再搜一大堆关键词,不用再对比几十家的商品,你直接跟手机说,我要买一双夏天穿的小白鞋,要真皮的,跟高3厘米,不容易脏,价格在两百块以内,差评里没有说开胶的,它直接给你把符合要求的商品列出来,连哪家的优惠券最多,哪家的发货最快都给你标清楚。 你上班的时候,不用再花三个小时写周报,不用再花两个小时整理会议纪要,你直接把会议录音导进手机里,它十分钟就能给你整理好会议纪要,提炼好待办事项,连周报都给你写好,所有的数据都在你自己的手机上处理,不用担心公司的机密泄露。 甚至你以后用的智能手表,智能耳机,家里的智能音箱,车里的车机,都会自带这个模型,不用连网,就能帮你处理所有的事,你开车的时候,直接跟车机说,帮我给我老婆发个消息,说我晚半个小时到家,顺便帮我导航到最近的加油站,要92号油,价格最便宜的,它直接就帮你做了,不用你动手操作,也不用担心网络延迟,安全得很。 对于那些做小生意,做副业,想创业的人来说,这个事更是天大的好事。 之前你开个小店,想做个AI客服,要么买第三方的服务,一个月几千块,还得担心客户数据被人家拿走,要么自己部署模型,租个好点的GPU服务器,一个月就要好几万,小商家根本承担不起。 现在不用了,你随便找个闲置的旧电脑,甚至找个闲置的旧手机,就能把这个模型跑起来,接多少客户都不用额外花钱,所有的客户数据都存在你自己的店里,谁也拿不走,也不用担心哪天服务涨价,哪天服务关停。 之前你想做个AI相关的副业,比如帮别人写文案,帮别人做运营方案,用云端的API,生成得多了成本就上去了,还得担心账号被封,现在自己本地跑,想生成多少生成多少,连网都不用,成本几乎为零,赚的每一分钱都是纯利润。 之前你想创业做AI产品,光基础模型的研发就要几千万,还没做产品钱就烧完了,现在基础模型免费了,你只要懂某个行业的痛点,就能做出来对应的产品,比如你懂教培行业,你就能做个给老师用的AI备课工具,一套卖几千块,卖一百套就是几十万,成本几乎为零。 当然也不是所有人都能吃到这个红利,那些之前靠信息差赚钱的,靠套壳开源模型卖高价的,靠吹自主研发骗融资的,接下来的日子会很难过。 那些没有核心技术,只会把开源模型拿过来套个壳就卖钱的大模型公司,接下来会死一大片,没人会再为了差不多的效果,花几倍的价钱买你的服务。 那些只会吹自己参数多高,效果多好,却没有落地场景的大模型创业公司,接下来也很难拿到融资了,投资人又不傻,既然有免费的世界顶级模型可用,为什么要投你自己做的。 那些之前靠卖AI课程,卖大模型API赚差价的,接下来生意也会越来越难做,因为门槛越来越低,随便一个人就能自己部署模型用,没人再会花几千块钱买你的课程,买你的调用额度。 很多人说,AI越来越卷,普通人根本没有机会,其实恰恰相反,之前AI的红利都被大厂和有钱人拿走了,他们有算力,有人才,有数据,普通人根本碰不到,现在模型免费了,门槛打下来了,普通人只要有想法,懂某个行业的需求,就能分到一杯羹,这个才是真正的普惠。 最后说回你,你现在最应该做的是什么。 不用急着去网上找权重下载,不用急着去学怎么部署模型,大部分人其实根本不需要自己部署,接下来几个月,所有你能用到的AI工具,都会陆续接入这个模型,你等着用就行。 如果你是上班族,现在可以开始琢磨,你工作里有哪些重复的,枯燥的杂事,比如写周报,整理数据,回复邮件,接下来都可以交给AI去做,省下来的时间,去做更有价值的事,去提升自己的核心竞争力,去做点自己想做的事。 如果你是做小生意的,或者做副业的,现在可以开始琢磨,你所在的行业,有什么痛点是之前用AI解决成本太高的,现在成本打下来了,能不能用AI解决,能不能靠这个多赚点钱。 如果你想做点什么新的事,现在可以开始观察,身边有什么需求是还没有被满足的,能不能用AI做出个小产品,哪怕只服务几百个客户,也能赚不少钱。 不用焦虑AI会取代你,真正会取代你的,是那些会用AI的人。 AI的竞赛从来不是谁的模型参数更高,而是谁能让更多的普通人用得起,用得好,这次Meta把火把递到了每个人手里,接下来的路,得你自己走。

以上,既然看到这里了,如果觉得不错,随手点个赞、在看、转发三连吧,如果想第一时间收到推送,也可以给我个星标⭐~

谢谢你看我的文章,下次再见。

← 返回案例列表
分享:
🤖 Try Now →
🤖
🎁