大模型激战半年：王小川进击、王慧文退场，腾讯字节姗姗来迟

本文来源：时代财经作者：谢斯临

(资料图片仅供参考)

国产通用大模型的混战远未结束。在半年左右的蛰伏期过后，大部分玩家都浮出了水面。

在这之中，有人加速迭代。8月8日，由搜狗搜索创始人王小川创立的百川智能发布了旗下第三款大模型产品Baichuan-53B，背后训练参数高达530亿。此时距离王小川宣布进军大模型战场不过4个月的时间，这家创业公司进展神速。

这还只是一个开始，百川智能方面向时代财经透露，后续还会有多款产品发布，包括规模更大、参数超千亿的大模型。

也有人黯淡退场。由美团联合创始人王慧文创立，吸引源码资本、五源资本等知名VC机构，以及美团创始人王兴、快手创始人宿华等互联网大佬投资的光年之外，曾一度被市场认为是国内大模型战场上最强有力的玩家之一。

然而，随着6月下旬王慧文因健康问题离岗退出，无法继续执掌光年之外，这家备受期待的大模型创业公司只能卖身美团，一众投资人也随之退股。

还有人另辟蹊径。AI大牛周明创立的澜舟科技，强调轻量化模型，希望用更低的成本解决B端场景问题。而曾帮助谷歌将BERT模型的训练时间从3天降到76分钟的新加坡国立大学校长青年教授尤洋，则成立了潞晨科技，试图用低成本训练大模型的解决方案突围。

相比之下，大厂自研的大模型则姗姗来迟。直到8月初，腾讯自研的混元大模型和字节打造的AI对话类产品Grace才先后传出内测消息，具体面世时间仍未可知。

同样停留在测试阶段的，还有李开复创立的AI 2.0企业“零一万物”。在7月3日举办的对外交流会上，李开复透露，该公司在三个月内已实现百亿参数规模的模型内测，目前正向300亿—700亿参数规模扩大。不过，该产品至今仍未向市场开放。

这些仍未发布的大模型产品将为科技行业带来什么样的改变，值得市场期待。从这个角度来看，这场混战或许还要持续很久。

进击的王小川

由王小川创立的百川智能，正以其惊人的产品发布速度吸引市场的关注。

在其4月宣布下场做大模型后，仅用了两个月零五天的时间，就在6月15日发布70亿参数开源大模型Baichuan-7B。不到一个月时间，又发布了130亿参数开源大模型Baichuan-13B。

8月8日发布的Baichuan-53B，已经是这家大模型创业公司半年内发布的第三款产品，百川智能进展神速。

百川智能相关负责人回复时代财经表示，公司在创立之前就已经花了很多时间做前期准备，开始就把路线和方法想得比较清楚。

其指出，做大模型都会考虑三个层面：数据、算法和算力。抛开算力不说，做搜索的公司天然有优秀的数据能力，百川智能的核心团队此前已经做了20年的数据抓取、抽取、清洗、去重、反垃圾等操作，可以更快拿到高质量数据集。

而算法是以自然语言处理为中心，将算法工程进行迭代，不是单一的工程问题，而是在文本数据驱动下，算法和工程共同运行。此前在搜索领域积累的经验在这里也能很好地发挥作用，利用数据评价推动模型进步。

“有了之前多年的技术和经验积累，百川智能做大模型产品的速度才会又快又好。”

不过，在发布会上，王小川亦指出，当下国产通用大模型仍处在一个分型复刻的阶段。各家厂商基本都在对标OpenAI，不可避免地会出现同质化的问题。

正因如此，在他看来，与美国闭源大模型的头部格局已定的情况不同，“中国谁的大模型最好”现在并没有结论。在这场混战之中，钱是重要的，但最终决定的力量还是人和团队、组织能力。大厂钱多、人多、算力多，但组织效率通常不一定够好，创业公司的组织效率可能好，也可能不好。

“大家都在争取机会，而且不一定落在大厂里。”

王小川还在采访中谈及退场的王慧文。其指出，王慧文是国内几个主流做大模型里唯一一个没有强势技术背景的，对他的挑战比其他家要大。工作中要做大量的技术决策，招什么人、走什么技术路线图、需要多少计算资源，一定会面临非常多的决策压力。

“不是做大模型压力大，是没有技术背景做决策压力会大很多。但是技术足够的话，其实挺愉悦的。”

腾讯、字节姗姗来迟

大模型混战开启之初，互联网大厂因为坐拥更多算力、人才、资金和数据，被认为是强大的竞争对手。

百度自研的文心一言早在今年3月底就已率先落地；阿里打造通义千问紧随其后，在4月11日举办的阿里云峰会上揭晓。就在阿里发布通义千问的前一天，王小川才刚刚宣布下场，成立百川智能。

相比之下，同为一线大厂的腾讯跟字节，推出通用大模型的步调要慢许多。

8月3日，据36kr报道，腾讯自研的 “腾讯混元大模型”已经进入应用内测阶段。三天后，8月6日，字节旗下的AI对话类产品Grace也被爆出历经两个月的研发后，终于进入测试阶段。

此时距离百度发布文心一言已经过去4个月。对于腾讯通用大模型产品步调稍慢的原因，马化腾曾公开表示，“腾讯也一样在埋头研发，但是并不急于早早做完，把半成品拿出来展示。”

不过，“并不着急”的腾讯，还是在今年6月中旬率先公布了“行业大模型”的路线，一口气抛出10大行业超过50个解决方案。无独有偶，字节跳动也同样在6月发布大模型服务平台“火山方舟”，通过集成多家AI科技公司及科研院所的大模型，向企业提供全方位的平台服务。

市场曾一度认为，行业大模型将成为这两家大厂突围的方法。

但事实或许并非如此。当下被鼓吹的行业大模型始终存在着被替代的风险。科大讯飞总裁吴晓如曾向时代财经指出，10年前，在语音识别技术上，也曾诞生过诸多聚焦在通话、行车、办公等不同场景的专用模型，但随着通用模型技术的成熟，专用模型也随之退场。

“我认为大模型也会经历一样的阶段。”

相比之下，从更长远角度看，通用大模型才真正代表着一个平台级或颠覆性的大机会。正是因此，腾讯和字节都不可能放任自己错过，哪怕进度缓慢，但它们必定要坚持在场。

有腾讯内部人士向时代财经指出，腾讯的计划一直是两条腿走路，通用和行业齐头并进。只是与一些激进的厂商相比，旗下产品涵盖社交、游戏、广告、内容创作等多个领域的腾讯，要更为谨慎一些。

学院派创业者另辟蹊径

在大模型战场上，来自高校、研究机构的学院派创业公司组成了竞争的第三极。

它们既不是王小川、王慧文这样的种子选手，在创业之初就能凭借人脉吸引到数亿美元的投资，并以此迅速起步。也不像腾讯、阿里、百度这样的大厂，在算力、人才、资金等各个方面都占据难以逾越的优势。

但凭借着他们对于人工智能技术的深度理解，这些创业者仍然能在夹击之下，另辟蹊径找到新的发展方向。

比如由原微软亚洲研究院副院长周明创立的澜舟科技，不同于市面上一众追逐千亿乃至万亿参数的大模型产品，这位从1980年就开始研究NLP（自然语言处理）的华人AI大牛希望以更轻量级模型解决B端场景的问题。

其推出的孟子大模型曾以十亿参数，刷新此前被百亿、千亿级别参数模型轮番霸榜的中文语言理解权威评测基准 CLUE 榜单。

这是一项务实的决策。出于数据安全考虑，绝大部分企业都不会将数据上传，而是会要求本地化部署，成本因此被显著拉高。在接受媒体采访时，周明指出，哪怕只是本地部署推理，拿训练好的大模型来用，千亿参数大模型也需要8到16块 A100，换算下来至少是一两百万元的投入，“对很多场景来说，客户需要便宜和够用”。

由新加坡国立大学校长青年教授尤洋创立的潞晨科技，则希望利用算法技术降低大模型的调用成本。

现如今，无论是大厂，还是创业公司，都必须面对国产大模型同质化趋势愈发明显的问题。如果这一问题不被解决，未来大模型极有可能陷入当下云服务厂商面临的低毛利困境。

尤洋对时代财经表示，这是因为底层技术基座迭代成本过于高昂。他以GPT举例，OpenAI每一次的训练成本高达6000万美元，每隔三四个月就需要训练一次，迭代一次则需要四五次训练。以此计算，每迭代一次技术基座可能需要2亿到3亿美元。

过于高昂的成本导致市场上的技术基座极其稀缺。基本上只有GPT、LLAMA，还有国内的GLM。各家厂商基本都是在模仿这几家大模型做产品，才导致了同质化的问题愈发凸显。

长期研究高性能计算的尤洋因此成立了潞晨科技。该公司目前推出的开源系统Colossal-AI 可通过高效多维并行、异构内存等技术，显著降低AI大模型训练、微调和推理的开发与应用成本。

尤洋认为，只有伴随大模型训练成本快速下降，或者采取更好的优化技术，使得参数控制在200亿左右，还依然能够达到和千亿参数一样的效果时，才会真正迎来大模型百花齐放的那一天。

推荐内容

大模型激战半年：王小川进击、王慧文退场，腾讯字节姗姗来迟

电影《消失的她》密钥延期至9月21日

陌陌号是什么（陌陌号是什么样的格式）

OPPO Watch4 Pro亮相：4nm骁龙W5引领智能手表新时代

361度(01361.HK)公布中期业绩，股东应占溢利7.04亿元 同比增27.7%

中国大唐召开2023年8月份月度经济活动分析例会

天振股份跌3.42% 上市即巅峰募18.9亿安信证券保荐

国产全新宝马i5实车 尺寸超现款5系 配单电机

塞下曲其三卢纶经典咏流传 塞下曲其三卢纶教案

全省法治建设督察组在庆阳督察时强调：要抓好法治建设重点工作任务落地见效

华人置业(00127)公布中期业绩，股东应占溢利1.47亿港元，同比降83.16%

甜蜜的事业

7月经济数据透视：餐饮收入增超15%，电影票房环比增1倍

安徽省池州市青阳县市场监督管理局：专业指导进学校 精准帮扶在身边

奔驰欲2030年在马来西亚实现全面电动化

2023杭州银海公寓公租房实物配租咨询方式（电话咨询+线上咨询）

阿涅利家族收购飞利浦15%的股份

省运会“交通银行杯”柔道比赛圆满结束【视频】

怀柔综合性国家科学中心打造自主创新策源地

记者：凯恩肯定对德超杯有不同期待，仅3次触球是非常痛苦的开局

浦发万用金分期还款额度恢复吗-

LPCC三周年｜汽车运动征途再续 性能热爱逐梦起航

农业专家在太白县调研指导蔬菜产业发展

老牌家电巨头欲登港股，但不完全为“圈钱”

小米平板6 Max 14评测：大有可为！一切为生产力服务

收起你的阔腿裤吧！今年春夏流行“低腰裤”，秦岚、娜扎都上头

北京门头沟城区重点工程已有13项复工

主承销商：将于8月24日召开20中南建设MTN002第一次持有人会议

塔斯汀的“中国汉堡”并不tasty

英超首轮-曼联1-0狼队取开门红 瓦拉内破门奥纳纳撞人未判引争议

午评：两市高开低走沪指跌0.29% 医药板块强势

多国持续加强博物馆建设（国际视点）

Mysteel：家电原材料周报（8.7-8.11）

鱼岳镇西街社区：“乒”出精神秀出风采

新款奥迪Q3家族正式上市 售27.98万元起

风光股份：8月14日融资买入107.44万元，融资融券余额4543.52万元

开学了 小学一年级精选作文

油价上涨140元/吨，油价大涨稳如泰山，油价“大跌”愤起反抗

去西部，去往荒原、戈壁与城市 | 活动预告

京东回应刘强东、章泽天移民美国：无中生有 已报案

习言道｜把世界上唯一没有中断的文明继续传承下去

锚点降临前排输出角色推荐 建议培养哪个好

两部门：依法有序调整存量房贷利率

激扬青春·创业创新｜郭斌：用热爱与坚持为理想充电

红米Note 11 突然掉电很快的解决办法

贵阳市第一人民医院原院长张云强接受审查调查

社区小食堂 民生大文章

【新闻随笔】社区小食堂 民生大文章

医药反腐重锤落下，步长制药何去何从？

流感咳个不停还有痰 治疗缓解选连花清咳片

五菱星云将于8月16日亮相 或9月上市 售价可能低于10万

北京地铁13号线扩能提升工程首个区间盾构隧道双线贯通

山东第一医科大学：“健康使者”送医下乡十九载

湖北黔江：多孩家庭买新房发补助，二孩家庭每套奖补15平方米，三孩家庭25平米

孙红雷：你们是不是想拍照？路人：可你是刘华强！

一场“非典型”科普夏令营 城乡孩子在“天眼”碰撞与交融

这家知名企业多项资产被拍卖,曾欲投40亿建东方环球影城！

叙利亚谴责美国与恐怖组织勾结：对叙军发动恐袭 33名士兵死亡

电影《消失的她》密钥延期至9月21日

俄罗斯达吉斯坦卫生部：马哈奇卡拉加油站爆炸事故已致12人死亡

江苏连云港一工厂氢气泄漏引发火情，附近居民深夜被疏散

大模型激战半年：王小川进击、王慧文退场，腾讯字节姗姗来迟

今年最后一个长假！中秋节、国庆节连休8天

女子带孩子在泰山用铁棍捞许愿池硬币，景区：已知晓，会处理

博主缅甸街头拍摄时被人尾随跟踪 吓得淋雨狂奔数公里

德琪医药-B(06996.HK)涨超6%，截至发稿，涨5.97%，报1.42港元，成交额119.98万港元

陌陌号是什么（陌陌号是什么样的格式）

我国首次将AI技术规模化用于输电线路发热检测科技日报

恩施州举行庆祝建州40周年音乐会

机构：预计2025年印度新能源车市场将增至30万辆以上

宝丽迪：公司本次限制性股票激励计划内容符合《上市公司股权激励管理办法》等相关法律法规的规定

8月15日东数西算板块跌幅达2%

8月14日 14:20分 瑜欣电子（301107）股价快速拉升

西安云睿网络将由两大互联网资方共同控制

看守所判刑后多久可以打电话

半导体板块持续下挫 韦尔股份触及跌停

喝酒吐了之后吃点什么好?

破发股华勤技术跌4.29% 募58.5亿上半年营收降15%

五连涨预定？国内油价下周三或将小幅上调 顶多涨1毛

361度(01361.HK)公布中期业绩，股东应占溢利7.04亿元同比增27.7%

国产全新宝马i5实车尺寸超现款5系配单电机

塞下曲其三卢纶经典咏流传塞下曲其三卢纶教案

安徽省池州市青阳县市场监督管理局：专业指导进学校精准帮扶在身边

LPCC三周年｜汽车运动征途再续性能热爱逐梦起航

英超首轮-曼联1-0狼队取开门红瓦拉内破门奥纳纳撞人未判引争议

新款奥迪Q3家族正式上市售27.98万元起

开学了小学一年级精选作文

京东回应刘强东、章泽天移民美国：无中生有已报案

锚点降临前排输出角色推荐建议培养哪个好

社区小食堂民生大文章

【新闻随笔】社区小食堂民生大文章

流感咳个不停还有痰治疗缓解选连花清咳片

五菱星云将于8月16日亮相或9月上市售价可能低于10万

一场“非典型”科普夏令营城乡孩子在“天眼”碰撞与交融

博主缅甸街头拍摄时被人尾随跟踪吓得淋雨狂奔数公里

8月14日 14:20分瑜欣电子（301107）股价快速拉升

半导体板块持续下挫韦尔股份触及跌停

五连涨预定？国内油价下周三或将小幅上调顶多涨1毛

微信提醒：这样的邻居加你微信千万警惕有人已被骗

塞下曲其三卢纶经典咏流传塞下曲其三卢纶教案

三皇是哪三位三皇

视频丨首个“全国生态日”来了百姓和代表共话青绿

8月14日人民币对美元中间价下调99个基点美元汇率7.1686

中央财经大学广东录取分数线中央财经大学广东招生人数多少

国产全新宝马i5实车尺寸超现款5系配单电机

361度(01361.HK)公布中期业绩，股东应占溢利7.04亿元同比增27.7%

开放AI与3D技术、投入10亿升级供应链天猫推出支持家装品牌增长举措

达州钢铁上半年开展“小改小革”活动为企业降本增效超400万元

谢典林称愿助郭连署　蓝委胞姐谢衣鳯称不知

吉星新能源(03395)公布中期业绩，亏损406.22万加元同比盈转亏

特斯拉建“同类第一个”的数据中心招聘相关人员