
世界模型独角兽「智象未来」正切入具身智能的核心痛点
一家不做机器人的 AI 公司,刚刚拿下了15亿元C轮融资。
而且,领投方里出现了社保基金、工银资本这样的重量级选手。
7 月 23 日,多模态世界模型技术企业智象未来(HiDream.ai)正式宣布完成15亿元人民币C轮融资。本轮融资由社保基金四川振兴科创基金、工银资本、弘颐资管、敦鸿资本联合领投,厦门国贸资本、上影新视野基金、华策影视、湖北长江产业投资集团、余杭金控股份、交银资本等多家机构跟投,合肥产投、东方富海、金浦投资等老股东继续追加投资。

这是智象未来近三个月内完成的第三轮公开融资,累计融资总额已突破21亿元,公司也凭借本轮融资正式迈入独角兽企业行列。
01.
国家队领投背后的产业共识
本轮融资最鲜明的特点,是投资方构成的多元化与重量级。
国家级基金、地方国资、银行系资本、头部产业方、市场化创投,几乎全部到齐。在国内AI赛道,这种资本结构极为罕见。也侧面印证了智象未来技术路线的长期价值与产业落地潜力。
其中有几个看点尤其值得留意。
领投方中的社保基金四川振兴科创基金,作为国家级长期资本,首次以LP身份布局原生全模态世界模型方向。而社保基金对投资标的的回报周期与稳定性要求极为严格,其重仓往往被视为赛道成熟的信号。工银资本的入局则打开了银行系AIC以“债转股+战略投资”组合方式参与AI企业资本运作的想象空间。

地方国资阵营同样阵容强大。合肥产投已是连续第三轮加注智象未来,作为合肥人工智能产业生态的核心投资平台,其持续跟进既源于对企业发展前景的判断,也契合合肥打造AI与具身智能产业集群的区域战略;厦门国贸资本、余杭金控、湖北长江产业投资集团等多地国资的参与,也反映出各地对视觉生成技术赋能本地制造、机器人产业的期待。
产业资本的入局则更具商业化指向。上影新视野基金、华策影视等影视文化领域机构的进入,直接印证了下游内容产业对AI生成技术的真实需求;而更深层的产业想象空间,则来自其技术向具身智能领域的外溢能力,当高精度生成技术与机器人训练结合,将撬动一个比内容创作更大的市场。
02.
从视觉先锋到世界模型布道者
资本的信心,最终锚定的是创始团队的技术积淀。
智象未来能在短短三年间快速突围,核心离不开创始人兼CEO梅涛。他的履历,几乎可以串起中国视觉AI产业化的半部简史。

创始人兼CEO梅涛
梅涛毕业于中国科学技术大学,拥有工学博士学位,是加拿大工程院外籍院士,同时当选ACM Fellow、IEEE Fellow、国际模式识别学会会士、中国人工智能学会会士,累计发表学术论文300余篇,总被引用量超4万次,先后斩获15项国际最佳论文奖,拥有70余项技术专利,并以首席科学家身份主持科技部科技创新2030人工智能重大项目。
在创办智象未来之前,梅涛已在产业界完成了多轮技术落地验证。他在微软亚洲研究院任职12年,深耕多媒体分析与计算机视觉领域,2017年便带领团队完成了全球首个文生视频研究工作,斩获当年ACM Multimedia最佳创新论文奖,比行业普遍关注到视频生成赛道早了整整五年。
2018年加入京东后,他出任集团副总裁、京东探索研究院副院长,主导落地了十亿级商品图像搜索、物流仓智能机械臂分拣视觉方案等产业项目,在真实工业场景中完成了视觉技术从算法到产品的闭环,也最早接触到了机器人与工业自动化的实际需求。
深厚的学术背景与产业经验,让梅涛在创业之初就选择了一条差异化路线:不走行业常见的“语言模型+视觉插件”拼接式多模态路线,而是从底层架构入手,自研统一Transformer(UiT)原生全模态架构。

在他看来,真正的世界模型是具身智能的终极目标,需要具备对物理规律的理解、因果推理以及与物理世界的多模态交互能力,而只有从底层实现多模态统一表征,才能逐步逼近这一目标。
这条路线的价值已经在公开评测中得到验证。
2026年5月,基于UiT架构的HiDream-O1-Image开源版本登顶全球独立评测平台Artificial Analysis的文生图榜单,成为全球排名第一的开源模型;6月,商用版HiDream-O1-Image-1.5位列该榜单全球前三,是排名最高的中国图像模型,在光影渲染、复杂构图与指令跟随等维度表现突出。

03.
不造机器人,却卡住行业数据命门
尽管智象未来并非纯粹的具身智能公司,但其技术路线与业务布局早已和具身智能深度交织。
在技术理念层面,二者拥有共同的终极目标。
梅涛多次公开表示,智能的终极形态是能够与物理世界交互,而世界模型正是连接生成式AI与具身智能的核心桥梁。智象未来的原生全模态架构,本质是在统一框架下构建对空间、时间、物体运动与物理规律的认知能力,这种能力既可以生成影视内容,也可以为机器人提供训练环境与数据,二者底层技术同源,只是落地场景不同。
在产业合作层面,智象未来已直接切入具身智能的核心痛点。
2026年3月,公司与具身智能数据企业诺亦腾机器人达成战略合作,瞄准行业普遍面临的训练数据瓶颈。在这套合作模式中,诺亦腾提供亚毫米级精度的动作捕捉数据作为“种子样本”,智象未来则凭借毫米级高可控视频生成技术,将有限的真实数据精细化放大百倍以上,双方计划年内生成数万小时高质量、符合物理规律的具身智能训练视频数据。

这一模式直击行业痛点:传统具身智能数据依赖实景采集与人工标注,成本高、周期长、场景单一,难以支撑模型泛化;而纯生成数据又常存在物理逻辑失真的问题。
智象未来与诺亦腾的合作方案,既保留了真实数据的物理准确性,又通过生成技术实现了规模化与场景多样性,或将为具身智能模型提供更高质量数据燃料。
在实战验证层面,其技术路线也在全球顶级赛事中得到检验。
2025年10月,在全球顶尖机器人赛事AgiBot World Challenge@IROS 2025中,智象未来首次参赛便从全球431支战队中脱颖而出,斩获World Model赛道亚军。比赛中,团队采用基于DiT架构的视频生成基础模型,在机器人视频数据集上微调,实现了机器人操作过程的高保真、可控合成,生成画面符合真实物理动作逻辑,关键指标远超赛事官方基线,验证了视频生成技术赋能具身智能的可行性。

04.
内容场景反哺技术底座
技术的价值最终要靠落地兑现。智象未来能在融资周期中持续获得资本青睐,清晰且已验证的商业化路径是关键支撑;而这些商业化场景,也在反向打磨模型能力,为具身智能相关业务积累技术底座。
目前公司已经搭建起“1个大模型底座+1个开放平台+三类垂直应用”的业务体系。
底层是HiDream系列全模态大模型,中间是Token Hub开放平台,并以三个高价值垂直场景对外输出:
- 跨境短视频营销平台HiBurst,已经是TikTok平台前五大AI合作伙伴,服务了大量出海品牌;
- 专业级AI影视创作智能体“帧赞”,服务了上千家制作团队,累计产出的短漫剧超过5000分钟;

- 全球首款支持无限时长视频生成的vivago R1,刚上线就登顶美国Product Hunt日榜,如今覆盖了全球上百个国家和地区。
据公开信息显示,截至2026年,智象未来全球注册用户已超5000万,企业客户突破4万家,2026年第一季度营收已超过2025年全年总和。
05.
结语
成立三年,融资三轮,跻身独角兽,智象未来的成长速度,是中国生成式AI产业快速迭代的一个缩影。
15亿元C轮融资不是终点,而是其押注原生全模态世界模型的新起点。这笔资金的绝大部分,都将投入到世界模型的底座研发与技术迭代中,其中自然也包括具身智能相关的数据生成与仿真能力。对于具身智能行业而言,多一家头部企业投身基础设施建设,意味着整个赛道的创新门槛将进一步降低。当高质量训练数据不再是稀缺资源,机器人真正走进千行百业的那天,或许也会来得更快一些。
