2026年AI数字人赛道:百亿市场下,谁在弯道超车

——从狂热回归理性,从“造星”走向“造生产力”

2021年,虚拟美妆数字人“柳夜熙”在抖音上线48小时斩获百万粉丝,A股相关概念股轮番涨停,“3个月造星、6个月回本”的口号在行业内疯狂流传。彼时的数字人赛道,被视为下一个万亿风口。

四年过去,潮水退去。QuestMobile报告显示,2023年虚拟主播的GMV不足真人主播的五分之一,抖音平台虚拟主播平均观看时长从15分钟跌至5分钟,大量曾被寄予厚望的虚拟代言人悄悄从平台首页撤下。

喧嚣散尽,数字人并未消失,而是转身潜入产业后台。艾媒咨询数据显示,2025年中国数字人核心市场规模将达到480.6亿元,带动相关产业规模超过6400亿元;弗若斯特沙利文则预测,2030年中国AI数字人市场规模将达到153.4亿元,2025—2030年复合增长率保持在23%左右。

百亿市场仍在持续扩容,但赛道的竞争逻辑已经彻底改写。当虚火退潮,真正能跑出来的,不再是“流量造星”的玩家,而是把数字人变成“生产力工具”的那批人。

一、市场规模:百亿只是起点,万亿才是终局

数字人市场究竟有多大?不同机构给出的口径虽有差异,但指向的结论高度一致:这是一个已经突破百亿、并将在数年内冲击万亿的赛道。

据艾媒咨询《2025年中国数字人产业发展报告》数据,2017年中国数字人核心市场规模仅为8.1亿元,到2024年已增至339.2亿元,2025年进一步攀升至480.6亿元,八年间增长了将近60倍,年均复合增长率高达66.6%。从“带动市场规模”看,2025年更是突破了6400亿元大关,并将在2030年正式突破万亿,达到10468.6亿元。

弗若斯特沙利文在2026年5月发布的《中国AI数字人产业发展报告(2025年)》中给出了相对保守的口径:中国AI数字人市场规模由2021年的10.2亿元增长至2025年的54.4亿元,2021—2025年复合增长率达52.0%;预计2030年市场规模将达到153.4亿元,2025—2030年复合增长率为23.0%。

两组数据背后,是“两种叙事”

一个偏“全口径”,把虚拟偶像、虚拟主播、3D数字分身、虚拟客服、虚拟主播软件、周边硬件等全部算在一起;一个偏“AI驱动”,只统计与生成式AI大模型深度耦合的智能数字人。

两组数据都不算“虚高”,差异来自统计口径。但无论用哪组数据,趋势都是一致的:百亿赛道已经成型,且仍处于高速增长期。

资本市场也在重新关注这一领域。IT桔子数据显示,截至2025年7月7日,年内数字人领域共发生投融资案件23起,接近2024年全年数据,总金额达35.07亿元,平均每起融资超1.5亿元。政策层面同样释放积极信号,上海、北京、深圳、西宁、绵阳等多地相继出台支持文件,或上线新款数字人为市民提供服务。

图1:数字人行业的“核心引擎”模式正在成为主流(AiHuman核心引擎架构示例)

二、技术分水岭:从“数字皮囊”到“数字大脑”

数字人赛道最大的“洗牌”,发生在技术层面。

早期的数字人,普遍被戏称为“皮囊型”产品:一个虚拟形象+一段TTS语音+一套预设话术。这种数字人制作成本动辄数十万乃至上百万元,而实际表现往往是“形似神不似”——口型对不上、表情僵硬、回答不智能、用户问两句话就“破功”。这是第一代数字人。

第二代数字人:装上“大脑”的AI智能体

转折点发生在2023年——生成式大模型爆发。数字人开始从“皮囊”升级为“数字大脑+数字皮囊”的组合体。

其核心技术架构可以概括为“四层一体”:ASR(语音识别)+ LLM(大语言模型)+ TTS(语音合成)+ 3D实时渲染。前三者让数字人“听得懂、答得对、说得好”,3D渲染则让它“长得像、动得真”。

这种架构下,数字人的能力边界被彻底重塑。它不再是只能念稿的“嘴替”,而是能理解上下文、能调用知识库、能记忆对话历史、能在多轮对话中保持角色一致性的AI智能体。用户问它“李达是谁”、“营业执照怎么办”、“这套房能退吗”,它都能基于真实知识给出有针对性、有上下文关联的回答。

多模态大模型与Audio to Face(语音驱动唇形与表情)技术的成熟,进一步让数字人的“拟人度”产生质变。早期数字人那种“眼睛不动、嘴巴乱动”的违和感,正在被一点点消除。

3D与2D:两条路线的分化

技术分化的另一条主线,是“3D派”和“2D派”的分野。

2D数字人成本低、上线快,适合直播带货、短视频等“流量型”场景;3D数字人制作成本高、技术门槛高,但形象表现力强、可定制空间大,更适合政务、文旅、教育、展厅等需要“品牌化形象”的场景。

据QuestMobile、IDC等机构的观察,2D数字人市场已陷入“模板化价格战”,不少产品的报价从早期的十几万元压到几千元;而3D数字人由于具备“不可替代的场景价值”,在B端政企客户那里仍能保持较高的客单价。

这也解释了为什么2024年以来,能持续拿到大额融资的,几乎都是3D数字人玩家。


三、玩家图谱:三类玩家,三种路径

如果把2025年的AI数字人赛道玩家拉一张图,大致可以分成三类:互联网大厂派、垂直技术派、行业方案派。三者起点不同、资源不同、目标也不同,路径选择差异明显。

1. 互联网大厂派:用流量和模型“碾压”

代表选手是百度、阿里、腾讯、京东、字节等。它们的共同特点是:自带大模型能力、自带流量场景、自带云算力。典型打法是用自有大模型(如文心、混元、通义、豆包等)作为“数字人大脑”,再把数字人嵌入电商、搜索、本地生活等自家流量场景里。

比如,京东2025年“618”期间,1.7万家品牌商家使用数字人直播,数字人直播成本仅为真人的十分之一,可以7×24小时全天开播,转化率提升30%,表现超过80%的真人主播。百度财报显示,2025年第二季度数字人产生的收入环比增长55%,估算规模约5亿元。

大厂的优势是“模型+算力+场景”三位一体;劣势是——它们做的是“通用数字人”,很难针对某一个具体行业做深度定制。

2. 垂直技术派:用“引擎+平台”做深做透

第二类玩家是垂直技术派,它们不追求“通吃”,而是把数字人当成一套“软硬一体”的解决方案来做。这类公司通常自研3D渲染引擎和AIGC生产管线,把“如何低成本、高效率做出一个能用的数字人”作为核心命题。

以时空节拍(杭州)科技有限公司为例,这家公司自主研发了AiHuman 3D数字人AIGC创作与交互引擎,围绕这一核心引擎构建了时空镜3D数字人交互平台、时空智播、时空演播、时空BOT、时空慧创等系列产品,覆盖从形象生产、内容生成、直播运营到智能交互的全链路。

垂直技术派的共同特点是:把“技术底座”作为竞争壁垒,在某个或某几个行业里做深做透。比如时空节拍的时空镜,就把“3D高自由度形象定制+大模型驱动+行业知识库+一体机部署”打成了完整闭环,在政务、文旅、教育、广电等场景里积累了上百个落地案例。

这类玩家的优势是行业理解深、定制能力强;劣势是品牌曝光、流量获取能力弱于大厂。

3. 行业方案派:用“集成+服务”做渠道

第三类玩家更偏“渠道”。它们往往不自研底层技术,而是整合多家厂商的引擎、模型、硬件,针对某个具体行业(如金融、运营商、医院)做整体方案打包。

这类玩家的价值在于“最后一公里”——把通用技术变成客户能用的业务系统。它们的存在,让数字人技术得以在大量中小机构里落地,但也因为技术不掌握在自己手里,毛利率相对有限。

三类玩家对比

四、弯道超车的关键变量

百亿赛道里,谁能在接下来三到五年里“弯道超车”?从2025年的市场表现看,决定胜负的关键变量集中在四个维度。

变量一:3D形象定制能力

数字人的“脸”和“身体”,是用户感知的第一道门。能不能做出符合客户预期、能稳定运行、可复用可迭代的3D数字人形象,是基础门槛。

目前行业里做得比较深的玩家,已经把形象定制拆成了“脸型-容貌-发型-服饰-动作”五大可调节模块,并且支持从照片/视频生成数字分身。时空节拍的AiHuman引擎就支持形象高自由度定制,配合时空镜平台可在政务、文旅、广电等不同场景下输出符合品牌调性的3D数字人形象。

而低端玩家提供的“模板数字人”,同一张脸套在几十个不同品牌的虚拟主播上,用户一看就“出戏”。这在B端场景里几乎不可接受。

变量二:大脑的“业务知识”厚度

数字人能不能“用”,关键看背后的知识库厚度。一个数字人即使形象再精美,如果问它业务问题就“一问三不知”,那就是一个“高级版吉祥物”。

当前行业里,主流做法是“通用大模型+行业知识库+智能体编排”的组合:通用大模型负责“听懂人话、生成回答”,行业知识库负责“提供准确答案”,智能体编排负责“调度多轮对话、调用工具、记忆上下文”。

做得好的玩家,已经把“知识库维护”做成了低代码工具——客户运营人员可以直接在后台增删改问答对,不需要懂技术。

做得差的玩家,要么直接“裸接大模型”导致胡说八道,要么需要客户每次更新知识都要走研发排期。

变量三:场景落地与交付能力

技术再强,落不了地也是空谈。2025年,越来越多客户的诉求已经不是“能不能做”,而是“多久能上线、能不能用住、运营成本高不高”。

这要求数字人厂商具备“端到端交付”能力——从需求调研、知识库建设、形象定制、硬件部署、上线培训到后期运维,能“一站式”完成。

据观察,能稳定拿下政企客户的厂商,往往都有“硬件+软件+内容+服务”的完整团队,而不是只卖软件或只卖硬件的“半截子”玩家。

变量四:部署模式的灵活性

数字人数据涉及大量用户对话、企业知识、行业资料,很多政企客户对“数据安全”非常敏感。能不能支持“私有化部署”,数据能不能“不出校、不出院、不出政府”,正在成为大客户选型的硬指标。

目前主流的部署方式有三种:纯云端SaaS、私有化部署(数据本地化)、混合云。支持“一体机+私有化”交付的玩家,在B端政企市场更受欢迎。

五、行业落地版图:数字人正在“接管”哪些场景?

经过2024—2025年的市场筛选,数字人已经在几个重点行业跑出了清晰的落地模式。

图2:政务场景的AI数字人已经在多个城市“上岗”(武安审批局“小武”现场图)

1. 政务服务:从“咨询台”到“7×24小时不打烊”

政务是数字人最确定的落地场景之一。需求明确、痛点真实、付费意愿强。

据媒体报道,仅2025年6月一个月,西宁、绵阳等多地政府部门就上线了新款数字人,为市民办理业务、享受公共服务提供便利。武安审批局上线的“小武”数字人,在政务大厅承担迎宾、咨询、窗口分流、政策解读、办事引导等工作,把导服台的工作人员从重复问询中解放出来。

在湖南、湖北、江苏、广东等地的税务局、社保局、政务大厅,类似的数字人“上岗”案例已经越来越多。

2. 融媒体:广电系统的“数字员工”

图3:广电融媒体成为数字人最早规模化落地的行业(贵州“微兔”播新闻场景)


广电融媒体是数字人最早规模化落地的行业。地方电视台需要大量播报本地新闻、民生资讯、政策解读,但主持人和记者资源有限,AI数字人成了“最佳补充”。

贵州广播电视台的“微兔”、浙江工人日报的“工小豹”、河南广电的“唐小妹”等,都是这一波浪潮里跑出来的典型。数字人主播不仅承担了日常新闻播报,还参与到专题节目制作、活动主持、对外传播等多个环节。

3. 文旅与博物馆:让历史“开口说话”

图4:博物馆数字人让历史人物“开口说话”成为可能(李达故居数字人现场)


文旅是数字人另一个高密度落地的领域。博物馆、纪念馆、名人故居、红色教育基地,都有强烈的“讲解服务”需求。

湖南永州的李达故居,用AI数字人技术让这位百年前的中共创始人“开口说话”,观众可以向他提问生平、著作、思想;临安博物馆的“吴小越”、永州文旅的“怀素”“湘湘”等数字人,则把地方文化IP变成了可交互的智能体。

在红色文化数字化、文博体验升级、文旅IP开发等多个方向,数字人正在成为新一代的“文化接口”。

4. 直播电商:最具规模的“增量战场”

直播电商是数字人渗透最深的C端场景。京东、百度、抖音、快手等平台,都在2024—2025年集中上线了数字人主播能力。

百度罗永浩数字人首场直播吸引超1300万人次观看,GMV突破5500万元,部分3C、食品品类带货单量超过5月同期真人首秀。京东数字人在“618”期间,表现出超过80%真人主播的带货能力。

但需要注意的是,直播电商的数字人高度依赖平台流量,且面临“录播冒充真人”“虚假宣传”等监管风险。

抖音平台去年优化了对AI主播的识别能力,累计处理超17万个录播直播间,封闭3万多个账号,打击2800多个黑商团伙。这意味着直播数字人正在进入“合规化运营”阶段。

5. 教育与培训:从“课件”到“数字老师”

教育是数字人又一个正在打开的增量市场。从K12到高校,从职业培训到企业内训,数字人都可以承担“虚拟讲师”“虚拟学伴”“虚拟实验员”等多种角色。

丽水学院的畲族姑娘、陶行知数字人,浙江传媒学院出版学院AIGC实验室的数字人一体机,丽水学院、浙农林大学的“农小林”等案例,都在探索把数字人和学科教学、专业实训结合起来。

需要指出的是,教育场景对“内容准确性”“价值观导向”“隐私保护”的要求极高,数字人在教育领域的落地需要更严格的审核与运营机制。

结语:从“流量造星”到“产业深耕”

回望2021到2025这四年,AI数字人赛道完成了一次完整的“过山车”:从狂热追捧到理性回归,从概念噱头到生产力工具,从C端造星到B端深耕。

百亿市场已经成型,万亿空间正在打开。但能够分享这块蛋糕的,不再是“谁都能做”的通用玩家,而是那些把技术做深、把场景做透、把交付做扎实的厂商。

对于时空节拍、AiHuman这类已经把“3D引擎+大模型+行业知识库+一体机部署”打通成完整闭环的厂商来说,2025—2030年这一轮,恰恰是它们从“小而美”走向“大而强”的关键窗口期。

赛道还远未定局,弯道才刚刚开始。

最后编辑于 :
©著作权归作者所有,转载或内容合作请联系作者
【社区内容提示】社区部分内容疑似由AI辅助生成,浏览时请结合常识与多方信息审慎甄别。
平台声明:文章内容(如有图片或视频亦包括在内)由作者上传并发布,文章内容仅代表作者本人观点,简书系信息发布平台,仅提供信息存储服务。

友情链接更多精彩内容