2024年,全球科技巨头的目光都放在了人工智能和Chat GPT上。
从20世纪50年代开始人工智能技术诞生至今,已经先后四次引起大规模的关注。而如今正处在第四次的大模型时代,前三次分别为专家系统时代、机器学习时代和深度学习时代。
后世之人如果要回顾这次的大模型时代,ChatGPT一定是一个绕不开的名字。2022年时,Open AI研发的ChatGPT-3.5横空出世,技惊四座,无论是写代码论文还是写诗作画,吹拉弹唱样样精通。
由于ChatGPT带起了一股技术热潮,全国各大科技公司开始纷纷投入资源和人力,开发自己的大模型产品,并在不同的场合进行展示和推广,百模大战也就此揭开帷幕,标志AI技术开始迈入新纪元。
时至今日,AI技术的迭代速度和应用广度均达到了前所未有的高度,每次技术的突破,都为人类的生活带来了翻天覆地的变化。如果回溯中国大模型的发展历程,公认的起始点为2022年年底,彼时国内高校率先发布大模型产品,比如复旦MOSS、北大ChatExcel测试版、清华大学“chatglm-6B”大模型、上海交通大学研发的“兆言”大模型、东北大学的“TechGPT”……高校的涌入打响了这场百模大战的前奏。
各大高校打响第一枪后,一场关于AI的创业浪潮爆发。一时之间,优秀创业者和科技大厂共同涌入此赛道,百模大战正式打响。
最先的响应者包括百度的文心一言、360智能大模型1.0、智谱AI ChatGLM,后续跟进者包括商汤日日新、阿里巴巴通义千问、昆仑万维天工、讯飞星火认知、百川智能Baichuan-7B……根据彼时发布的算法备案,10亿级参数规模以上的大模型已发布79个,境内累计41款算法完成深度合成服务算法备案。
在此期间,《北京市促进通用人工智能创新发展的若干趋势》、《深圳市加快推动人工智能高质量发展高水平应用行动方案》等一系列地方支持政策开始落地,也为这场百模大战再添一把烈火。
众所周知,竞争会推动高质量发展,在这场百模大战中,AI产品更新迭代涌入快车道。大厂在持续加码,像“月之暗面”这样的新玩家也在持续入局。
到今天,这场百模大战已经持续一年有余,激进期向稳定发展期转化,目前百模大战中通用大模型呈现寡头竞争格局。“四龙六虎”以及大厂加持下的大模型脱颖而出。
但是,这也意味着涌入决赛圈玩家们之间的厮杀会更加激烈。
目前,百模大战朝新方向转变,此前拼技术的玩家们必须直面落地商业化的难题。最近,AI圈就有传闻,由于融资降温,估值却又在不断推高的背景之下,大模型公司开始变得举步维艰,大模型六虎开始有人放弃大模型研发转向应用,浪漫的技术遇上现实的求生难题。事实上,根据数据,国内外都已经出现了不少宣布破产的AI企业。这其中也不乏有一些研发实力强劲的,但最终倒在了没有后续资金的困难上,毕竟大模型是个极度烧钱的赛道。
滚滚长江东逝水,浪花淘尽英雄。这条大模型赛道每天都有优秀的企业在萌芽,也每天都有企业在败退边缘求生。对于大模型企业来说,变,则生,不变,则死。
百模大战进入新局势,放眼如今的竞争者们,谁又将成为赢家,独领风骚呢?
百花齐放百家争鸣
在数字化浪潮的推动下,百模大战堪称人工智能领域一场前所未有的盛事。这场赛事汇聚了全国顶尖的人工智能研发团队,在这场科技盛宴中一展身手。这些模型,如百余艘船只,在算法的海洋上展开激烈的角逐,展示它们在图像识别、自然语言处理、机器学习等众多领域的卓越能力。
大模型时代并不同于前三个时代,由于大模型通用性的特征,其发展十分有望实现商业闭环。也因此,在这个大模型时代,吸引了众多玩家涌入赛道竞争,形成百花齐开,百舸争流的现象。
另一方面,大模型的市场规模也在持续扩大,资本热度攀升。在2023年时,国内语言大模型的市场规模就突破了130亿元,并还在继续上升中。市场规模的扩大为这场激烈的百模大战再添一把火。
截至目前,国内至少已有200多家大模型厂商推出了各自的产品。
这其中包括有互联网大厂,如百度、阿里、腾讯、华为等;还有垂直于AI领域的老牌厂商,如以四小龙为代表的商汤科技、旷视科技、云从科技、依图科技等;还有一批有出色实力的新秀选手,比如六小虎智谱 AI、百川智能、月之暗面、零一万物、Minimax和阶跃星辰。
互联网大厂:
腾讯混元大模型是由腾讯公司研发的大语言模型,其智元体平台为腾讯元器。作为腾讯全链路自研的通用大语言模型,其参数规模超过万亿,目前提供hunyuan-pro:万亿参数版本、hunyuan-standard:千亿参数版本、hunyuan-lite:百亿参数版本等 3 个版本。
通义千问大模型是由阿里云自主研发的大语言模型,智元体平台包括阿里云、ModelScopeGPT、钉钉AI助理等。通义千问具备强大的语言理解、生成和推理能力,支持多语言对话和图片文本识别,广泛应用于智能搜索引擎、问答系统和智能对话系统等领域,参数规模从18亿到720亿不等。
字节跳动的云雀大模型是一款基于注意力机制的深度学习语言模型,适用于处理自然语言处理任务。具有良好的并行性和效率,能够在大规模数据集上进行训练。云雀大模型的参数规模为1300亿,是目前国内最大的中文预训练模型之一。云雀大模型的智能体平台包括Coze、豆包、飞书智能伙伴。
老牌厂商:
商汤科技:日日新SenseNova大模型是AI四小龙中的商汤科技所推出的大模型。该大模型体系以低成本、高效率打通了各类AI应用,提供包括:面向办公场景的商汤日日新·商量语言大模型-数据分析版本、面向医疗场景的日日新·商量语言大模型-医疗版本“大医”……商汤“日日新·商量大语言模型”已在金融、手机、医疗、汽车、地产、能源、传媒、工业制造等众多垂直行业,已与超过500家客户建立深度合作,加速行业企业的智能化转型。
旷视科技:“旷视太乙”是旷视科技推出的一款生成式人工智能大模型,具备深度学习和推理能力。该模型的应用场景包括城市治理、智慧物流、智慧金融等多个领域,能够提供高效、智能的解决方案,帮助企业和城市实现数字化转型和智能化升级。
云从科技:云从科技推出的从容大模型包含但不限于语言大模型、视觉大模型、语音大模型、代码生成大模型以及图像生成大模型等,它通过实时学习并同步反馈结果,可以解决诸多AI应用的痛点,从而有利于快速普及个性化应用。同时,其具备上下文学习能力,能够以更好的交互性能,应用于金融、安防、政务、交通、能源、教育、医疗、文娱等行业领域。
依图科技:“天问”大模型是上海依图网络科技有限公司在2023年底首发的一款多模态大模型,是视频监控领域内第一个商用发布的大模型产品,基于先进的Transformer架构,具有会思考、可对话、能进化的三大特点
实力新秀:
月之暗面:Kimi 是大模型初创企业月之暗面科推出的智能助手产品,在自然语言处理、长文本处理、多语言对话支持等方面占据优势。后续通过社交媒体平台,在用户争夺战中占据了先机。
百川智能:百小应是百川智能于 2024 年 5 月 22 日推出的首款 AI 助手,它基于百川智能最新发布的基座大模型 Baichuan 4,具备多轮搜索与定向搜索、文件阅读与资料整理、智能交互、多模态能力、语音交互、Web 端和移动端应用等能力。此外,百川智能以医疗AI为核心业务。近期发行的AI健康顾问证明公司正在围绕医疗应用场景发力,探索医疗增强大模型的用户价值和产业价值
智谱AI:被称为国内最有Open AI气质的大模型企业。智谱清言是北京智谱华章科技有限公司推出的一款生成式 AI 助手,基于智谱 AI 自主研发的中英双语对话模型 ChatGLM2,经过万亿字符的文本与代码预训练,并采用有监督微调技术。
Minimax:Minimax专注于图像识别和计算机视觉技术,旗下出品的海螺AI基于MiniMax自研的多模态大模型,融合了自然语言处理、知识图谱、语音识别等多种AI技术,赋予了海螺AI强大的语义理解和知识推理能力。此外,Minimax还有AI陪伴产品“星野”。
零一万物:科技圈大佬李开复博士创立的AI企业。旗下大模型产品包括Yi-34B、Yi-Lightning、Yi-Large等。应用场景包括但不限于智能问答、智能读文档、自动分析和理解文档内容、PPT自动化生复杂推理和预测。
阶跃星辰:此前的大模型格局是四龙五虎,近期开始变成四龙六虎。多出来的第六只老虎,是在今年6月,由前微软全球副总裁姜大昕创办的阶跃星辰。该企业是目前资本市场的新宠儿,以一轮估值20亿美元的融资跻身进AI独角兽的宝座,由此奠定他第六只小虎的地位。其推出的“Step系列”通用大模型,让业内人士眼前一亮,其Step-2万亿参数MoE语言大模型,更是国内首家发布。
百舸争流奋楫者先
目前整个大模型赛道处于高拥挤的状态,而对于大模型来说至关重要的算力等其他资源却是有限的。随着市场竞争的日益激烈,算力等资源会呈现供需失衡的状态并出现资源配置倾斜。再加上算力成本的不断上涨,导致大模型玩家们必须积极竞争来构建优势,以此来获得资源的长期发展和支持。
这也是为什么业界有了“百模大战,必有一战”的说法。
如今,这场百模大战已持续一年有余,战事正逐渐往新的阶段升级。
有一个十分明显的预兆,大模型融资已经在开始慢慢降温了。
今年伊始,Open AI推出Sora掀起国内外视频大模型的鏖战。在那段时间,几乎没多久就会有大模型企业融资的消息传出。而到了6月,似乎一切都改变了。资本的眼球被具身智能等赛道吸引,大模型的融资数量较去年略有下降,开始有降温迹象的出现。
大模型的发展需要大量资源和算力的消耗,在这种逻辑下,金钱就成了唯一入场券。可是现在大模型技术的进展却与预期差距很大。投资人投入巨额资金后,何时见效尚未可知,这也引起大多数投资人的焦虑心理。种种之下,如今的降温现象似乎顺理成章。
这样的境地也迫使大模型人士开始继续思考未来的商业化问题,浪漫的技术研发逐渐向艰苦的落地求生转化。由此,引发了一系列新的竞争。
首当其冲的,就是大模型之间的价格战。
据融中财经不完全梳理,目前为止已有超过7家大模型企业参战。包括字节跳动、阿里云、百度、腾讯、智谱AI、科大讯飞等。
根据梳理,今年5月11日,大模型独角兽智谱AI宣布其入门级模型GLM-3 Turbo的API降价为1元/百万tokens。5月15日,字节宣布旗下通用模型豆包pro-128k版模型推理输入价格降至比行业价格低95.8%,豆包pro-32k模型推理输入降至比行业价格低99.3%。5月21日,阿里云宣布旗下9款大模型全面降价,降幅最高达到97%,两款开源模型更是开启七天限免。几个小时后,百度直接宣布两款轻量级模型ERNIESpeed、ERNIE Lite免费开放。随后,又有两位玩家入局。先是科大讯飞宣布轻量级模型API永久免费开放。后又有腾讯云宣布混元-lite即日起免费,其他模型降幅最高达到87.5%。
一大基本现实是:当前,国内并没有出现真正的杀手级大模型应用。国内头部大模型玩家们在整体能力差异上,可能并不存在绝对领先的情况,大家都是处于趋同的存在,有的只是在能力上的各有特点与侧重。
这样的现实之下,如果其他大模型厂商们不跟进阿里、百度、字节、腾讯的这一波价格战,最终的结局就可能是被市场淘汰。毕竟在当前现实下,想要维持原本价格本已是一件难事儿,更何况当前这几大大模型厂商已经开始让用户尝到了更便宜乃至免费的滋味了。当你走进这欢乐场,悲伤所有的梦与想,各色的脸上各色的妆,没人记得你的摸样。
另外,在新时代下,大模型正在从拼参数到卷应用上。
百度的“文心一言”专注于内容创作和教育服务,为媒体和广告行业提供高效的文案支持,并在教育领域成为学生的智能学习伙伴。科大讯飞的“星火”大模型在教育和医疗领域展现出其独特的价值,为学生提供定制化的学习方案,并辅助医生进行精确的医疗决策。昆仑万维的“天工”大模型则专注于游戏产业,能够自动生成游戏内容并进行智能运营。智谱AI在构建与Open AI相匹敌的模型产品的同时,通过提供API和云服务私有化部署等方案,在科研领域为研究人员提供文献检索和分析服务;并与金融机构合作,进行风险评估和投资决策分析。此外,智谱AI还与国际科研机构和企业共同探索大模型的应用。MiniMax通过面向消费者和企业两端的策略,推出了多种类型的应用。在消费者端,推出了智能聊天助手;在企业端,与企业合作开发智能客服系统和办公自动化软件。
随着大模型技术的日益成熟,其在实际应用中的落地成为了衡量技术价值的关键,也是技术商业化的重要途径。目前,大模型行业的关注点已经从模型的开发转向了应用的实际落地。无论是拥有强大背景的大模型公司,还是新兴的初创企业,都在努力推动应用的发展,目标是打造具有广泛影响力的应用。
不同的厂商采取了不同的策略。一些厂商通过大量的广告宣传来吸引用户,利用流量优势;一些则不断进行产品迭代和优化,以提升产品性能和用户体验;还有一些采取了面向消费者和企业两端的策略,以扩大市场份额。
落地,是任何技术商业化的必要途径,因为它能够给企业带来直接的经济回报。这也是为什么现在的百模大战从曾经的拼参数逐渐转向到卷应用上去。
说到底,如今的百模大战不论是打价格战还是卷到应用层,这些都是企业们追求盈利的手段。任何浪漫的技术,都需要先活下来,吃饱饭再去追求理想中的乌托邦。
而在这样的路径上,大模型企业怎么才能够闯出成功之路?唯有努力前进,探索更多大模型落地的可能性。正所谓,百舸争流,奋楫者先。
北上深厚积薄发
争夺AI第一城
从以往历史来看,中心城市是历次产业革命的发起者与引领者。
此前,北京孕育了中国的互联网产业,广深引领了中国消费电子的爆发,杭州推动了中国电子商务的普及,上海开启了中国半导体发展的序幕。
到如今,随着AI时代的临近,谁又会成最醒目的引领者呢?
从国内来看,我国人工智能产业形成了以北京、上海、深圳为核心的集聚发展态势。北上深三地是目前当之无愧的AI发展T1城市。
北京大模型产业的快速发展,从起步到领先,仅用了一年多的时间。经过一年多的发展,北京已经建立了覆盖大模型、AI算力、数据、应用和解决方案的全产业链,并形成了产学研融合的大模型发展蓝图。目前,北京的AI相关企业数量约为2200家,占全国的40%左右;规模在10亿参数以上的大模型厂商约有一半在北京,数量达到122家。2024年上半年及7月,中国大模型产业相关企业融资情况显示,北京企业获得了43笔超千万元的融资,而上海和深圳分别为11笔和9笔。
北京在AI领域的发展之所以能够领先,主要得益于人才和产业两大优势。在人才方面,北京的AI产业发展有着深厚的历史基础。自1987年中科院开始人工智能研究以来,微软亚洲研究院、清华姚班等机构相继成立,为北京AI产业的发展培养了大量人才。北京汇聚了全国最顶尖的大学和科研机构,拥有90多所知名高校、1000多家科研院所、120个国家重点实验室,全国60%的人工智能人才集中在北京。这些人才资源为北京建设“中国AI第一城”提供了坚实的基础。
在产业链方面,2023年AI产业爆发时,全国4000多家人工智能企业中,北京占了1070家,占比26%;全国获得风险投资的人工智能公司合计1237家,北京占比35%。全国范围内,获批建设新一代人工智能开放创新平台的企业共有24家,其中10家在北京;全球前100名的人工智能专利授权机构中,有30家总部设在北京。同时,国产大模型“创业五虎”崭露头角,估值接近200亿元,其中四家注册在北京,仅有一家位于上海。这些都为北京的AI产业增添了新的活力。
种种数据表明,当下中国AI产业的重心几乎都在北京。
上海,作为中国的经济中心之一,其在AI的发展走在前列,展现出强劲的势头和明确的规划。
上海市政府高度重视AI产业的发展,出台了多项政策以支持和引导AI产业的健康发展。例如,《上海市发展医学人工智能工作方案(2025—2027年)》旨在推动医学与AI的深度融合,以及《上海市促进人工智能产业发展条例》作为全国人工智能领域的首部省级地方法规,为产业发展提供了法治保障。同时,上海也拥有一批在AI领域持续投入的科技企业,如商汤科技、科大讯飞、Minimax等,它们在技术创新和产业升级方面发挥着重要作用。
今年6月20日,上海举行市政府新闻发布会,介绍2024世界人工智能大会暨人工智能全球治理高级别会议筹备进展情况。上海市副市长陈杰透露,上海人工智能产业规上企业从2018年183家增长到2023年的348家,产业规模从1340亿元增长到超3800亿元,居全国前列。全国首个大模型创新生态社区“模速空间”建成,打造五大专业服务平台,吸引80余家大模型企业入驻。
其中,大模型方面,上海目前已有34款大模型通过备案,产生了制造业、金融、具身智能机器人等垂类领域应用。人形机器人方面,多款通用人形机器人原型机发布,实现双足避障行走。算力语料方面,4200亿Token的语料数据实现开源,在打造人工智能全栈自主创新生态中发挥引领带头作用。
深圳,作为中国改革开放的前沿阵地,始终走在科技创新的最前沿,把人工智能作为引领新一轮科技革命和产业变革的战略性技术、发展新质生产力的重要引擎,高标准打造国家人工智能创新应用先导区和国家新一代人工智能创新发展试验区,加速建设全球人工智能先锋城市。作为国家重点发展的城市,深圳于2022年首次提出了‘20+8’战略性新兴产业集群政策,旨在培育经济新动力。其中,人工智能就位列其中。
根据企查查数据,目前深圳市人工智能相关企业共有105,932家。以注册资本对其进行分类,注册资本0-500万的企业有80,521家,占比76.01%;注册资本500-5,000万的企业有22,419家,占比21.16%;注册资本超过5,000万的企业有2,992家,占比2.82%。
产业园区作为集基础设施建设、研发与生产活动及政策扶持于一体的综合平台,对于促进产业集聚和增强产业发展动力具有不可或缺的作用。深圳市目前公布了十大人工智能集聚区,以地理片区为基础,以软件产业园为载体,以算力