大模型入秋

大模型入秋

泉源:雪豹财经社(ID:xuebaocaijingshe) 
作者:王亚骏

到2024年的最后一个月,大模子依然是最热闹的赛道,没有之一。

12月,智谱AI与阶跃星辰相继完成新一轮融资,OpenAI以直播的形式举行了一场长达12天的马拉松式新品宣布会。

但对从业者肖琳(假名)来说,年底的任何融资事宜和新产物宣布都已经很难让她眼前一亮,反倒是几个月前的一张网传图片成了她的“年度影象”。

这张图片显示,腾讯、字节、百度、科大讯飞和月之暗面旗下大模子的新增用户留存率,在30天后均会降至1%以下。9月,它一度在社交媒体和从业者交流群中疯传。

假,是肖琳对这张图片的第一印象,“图片里的数据没有任何可靠泉源”。她不屑于去认真讨论它的可信度。

不外这并没有阻止它的普遍撒播,甚至肖琳自己也是流传者之一。有人叹息大模子任重道远,有人展望未来有若干玩家能活下来,也有人指斥图片中的大模子欠好用。

“(这张图)之以是能引发这么大的波涛,是契合了人人的情绪。”

01

寒凤

2024年,寒风险些吹进过大模子的每一个角落,连象牙塔里的人们也感受到了气温的降低。

张楠楠(假名)是一名人工智能偏向的在读硕士。已往两年间,他时刻关注大模子的动态,这个行业的升沉一定水平上影响着他结业后的事情远景。

6月,他在与学长学姐的交流中,得知在大模子“六小龙”中已经有公司放弃了预训练。

“六小龙”是指月之暗面、MiniMax、零一万物、百川智能、智谱AI和阶跃星辰这六家公司,它们是海内大模子的头部初创公司。此前有媒体报道称,六小龙中有两家住手了预训练。

投资机构剖析师陈琳(假名)告诉雪豹财经社,“绝对不止两家。”

预训练削减,让张楠楠最先忧郁,未来几年大模子公司的数目会变少、相关岗位的薪资会降低,这可能会波及他未来的就业和薪资。

张楠楠的部门管忧已经变为现实。

凯文(假名)是一位服务于大厂和“六小龙”的大模子猎头。他发现,从4月起,不管是大厂照样六小龙,招聘需求都在显著削减。今年,他手中大模子岗位比去年同期削减了30%~40%。

求职者的涨薪诉求也越来越难谈。去年,凯文推荐的候选人,薪资翻倍的多到他记不清。今年,涨薪一倍的候选人只有一位,准确地说,还只是靠近翻倍。

一家招聘方为频仍跳槽的求职者画了一条红线:五年跳三次。若是候选人的跳槽频率高于这条线,“连面试时机都没有”。

与岗位一起缩短的,另有投资人的刻意。

陈琳在与投资人相同中发现,原本怀着FOMO(Fear of Missing Out)情绪的投资人,最先忧郁头部大模子创企估值过高。智谱AI、月之暗面和百川智能等几家公司的估值已经快速上升至约200亿元人民币的门槛。

陈琳的感知与着名投资人朱啸虎一致。6月,朱啸虎示意,“去年大模子异常火,今年机构都不敢投大模子。”

大洋彼岸,同此凉热。

“我们感受到,华尔街对AI越来越持嫌疑态度。”巴克莱银行在9月的一份研报中表达了自己的担忧。该行测算,2026年大型科技公司在开发模子上的破费约为600亿美元,但从AI中获得的收入仅约为200亿美元。这400亿美元的差额,险些是特斯拉去年净利润的2.7倍。

手艺和产物体验的提高也在放缓。

11月,有外媒报道称,OpenAI的下一代旗舰模子(测试代号为Orion)虽然在性能上已经逾越了现有模子,但可能不会像前面几代产物那样带来伟大飞跃。

新闻一出,著名的AI消极主义者、纽约大学信用教授Gary Marcus在社交媒体上“庆祝”起了自己的胜利:“伙计们,游戏竣事,我赢了。GPT大模子正在进入收益递减期。”

02

昏暗的白月光

2023年2月,美团团结首创人王慧文与出门问问CEO李志飞、真格基金合资人戴雨森和刘元在一家日式餐厅中,探讨了中国大模子的未来。

此前4个月,OpenAI在没有任何预热,也未举行宣布会的情形下,上线了基于大语言模子研发的AI应用程序ChatGPT-3.5,两个月便吸引来一亿月活用户。与之对比,苹果iTunes到达一亿用户用了六年半,微信用了一年零两个月。

饭局竣事后不久,王慧文宣布了自己的人工智能宣言:“5000万美元,带资入组,不在意岗位、薪资和title,求组队。”李开复、前京东高级副总裁周伯文、快手前MMU认真人李岩和李志飞等,均投身大模子创业。

共享充电宝的故事,讲到头了?

大厂们也跑步入场。2023年3月,百度率先宣布了文心一言大模子。往后,AI公司、互联网公司和智能硬件公司们相继跟进,腾讯、阿里、商汤、快手、美团、京东、阿里、OPPO、理想汽车均宣布了自己的大模子。

一时间,“做中国的OpenAI”成为行业热词,这点燃了一级市场久违的投资热情。

据创业邦旗下科创数据平台“睿兽”数据,去年,机构在大模子层的投资事宜为66起,是上一年的投资事宜数目的近2.3倍。大厂们自然没有缺席这场资源盛宴。“六小龙”中,阿里与腾讯均投资了5家。

“那时在深圳的酒吧,人们要么在讨论美股,要么在讨论大模子。”肖琳回忆去年的情景,她并非一个怀有AGI信仰的人,但身处此种环境,她甚至最先理想自己会不会成为改变天下的一员。

2023年中旬,海内大模子已成“百模大战”之势。可就在此时,先行者的故事戛然而止。

投身大模子创业4个月之后,王慧文确诊抑郁症并入院治疗,短期内无法继续向导团队。最终,美团以约20.65亿元的价钱,完成了对光年之外的股权收购。

光年之外前员工贾晨(假名)还记得,王慧文在创业之初精神状态优越,对公司也很上心,但“公司谋划的成本很大,而且手艺难题许多”。

一个能拿出5000万美元的人,因大模子创业得了抑郁症,这让贾晨萌生了“大模子事实是不是一门好生意”的疑问。带着这个疑问,他选择更稳妥的探索方式:去大厂。

王慧文病退后,行业中最先泛起大模子是否终将沦为巨头游戏的讨论。不久后,机构也发出了预警。

2023年10月,科技研究和咨询公司CCS Insight在一份讲述中示意,备受关注的天生式人工智能领域将在2024年接受磨练,这些磨练的详细显示为:手艺炒作逐渐消退,运行成本不停上升,羁系呼声越来越多,投资人不再像之前那样兴奋和乐观。

机构的展望,成了肖琳履历的现实。

2024年头,肖琳看到公司里来了几位身穿白色长袍的外籍人士,她预测这即是传言中的“来自中东的投资人”。她希望这笔融资能顺遂到账,这样她的事情也会加倍稳固。但事与愿违,投资人试用大模子后,因功效不及预期而削减了投资金额。

察觉到投资人收紧钱包的不只一家公司。按朱啸虎上述说法,“机构都不敢投大模子。”

投资机构剖析师陈琳以为,投资人们态度的转变,与大模子应用难以落地不无关系。

出门问问CEO李志飞叹息,在海内大模子创业浪潮发作之初,人们曾异常激进。“然则今天再回过来看,可能有些事情是过于乐观了。”

03

谁能活下来

李志飞以为,自己“可能是中国最早一批关注到GPT-3的人”。他将其视为大模子生长的转折点,让他看到实现通用人工智能的希望。

GPT-3是OpenAI在2020年宣布的一款语言模子(Language Models),该模子的参数目到达1750亿,是GPT-2的117倍,GPT-1的1496倍。

在李志飞看来,这是一次“暴力美学”的胜利。在此之前,他异常反感这个看法,由于“没有什么深度,研究也没有美感”。

“暴力美学”的看法并不难明白,它由先进的算法、海量的训练数据和重大的参数组成。

而这一切,需要以资金为后援。

国盛证券曾测算,GPT-3训练一次的成本约为140万美元。两年后上线的ChatGPT-3.5单次训练成本上升到了460万美元,可以购置一辆博兰基尼Veneno(全球仅有 14 辆)。

在款项的助推下,2023年4月上线的GPT-4参数继续增添至1.8万亿左右。马斯克曾估算,参数目超百万亿的GPT-5仅芯片成本跨越7亿美元,高于小鹏汽车在AI领域整年的投入(35亿元)。

李志飞以为,海内公司无法效仿OpenAI这种并不追求ROI的“暴力美学”。傅盛也认同这个看法。他在接受采访时举了一个例子:“若是一个谷歌研究员跟老板说训练一次2000万美元,老板问能不能做成,你说不知道,一定就很难申请到资源。”

但生意还得继续做。

现在,海内大模子行业的共识是卷应用,将大规模数据集训练出来的深度神经网络模子应用于现实问题中,通过大模子赚到钱。

在7月举行的2024年天下人工智能大会上,百度董事长兼CEO李彦宏称,没有应用,光有一个基础模子,不管是开源照样闭源,都一文不值。李开复在11月初的一次分享中示意,当下海内AI行业的生长,已经进入应用“落地为王”的阶段。

另一个共识是,现在大模子行业已进入镌汰赛阶段。

多位从业者告诉雪豹财经社,他们以为字节将成为赢家之一。创业公司方面,他们普遍以为现在的“六小龙”将活下来一到两家。

百川智能CEO王小川展望,未来海内大模子市场第一梯队或仅有五家,大厂占有主导职位,小型创业公司能存活的寥若晨星。

朱啸虎一度以为,5年后将没有自力的大模子公司存在。2024年8月,他又在一次采访中,将这一限期缩短至3年之内,称大模子创企“最好的效果就是卖给大厂”。

李志飞早早嗅到了镌汰赛的气息。2023年4月,他便展望大模子行业将“卷出天涯”,投身其中的公司也许率与上一代AI公司一样,商业化异常艰难。

“一切都是熟悉的配方和味道。”他说。

原创文章,作者:黄沙子江砂河沙机制砂供应商公司,如若转载,请注明出处:https://news.zcu8.com/23635.html

(0)
黄沙子江砂河沙机制砂供应商公司黄沙子江砂河沙机制砂供应商公司
上一篇 2025年1月9日 下午11:31
下一篇 2025年1月10日