当机器人学会微笑,它的服务才刚刚开始。
“今天天气怎么样?”杭州灵颜科技创始人赵常屹对着面前的机器人头随口问了一句。机器人头微微歪了歪,眼睛灵动地眨了一下,嘴角上扬露出自然的微笑:“今天阳光很好,适合出去走走哦。”这个看似简单的微笑,背后藏着一场正在发生的技术革命——机器人不再只是能干活,还开始会情绪互动了。

今年刚刚成立的灵颜科技,不做热门的灵巧手或大小脑,而是人形机器人的“脸”——一张能看懂人的脸色、做出自然表情、实现音唇眼同步交流的“灵巧脸”。
跨越“恐怖谷”:32个自由度练成“表情自由”
“造脸简单,但造一张让人不害怕的脸要难得多。”赵常屹说。这种偏差正是1970年提出的心理学假设“恐怖谷效应”——机器人逼近人类却不够完美时,人会本能地产生恐惧。表情最为敏感,嘴角延迟0.1秒、眼神飘移、微笑僵硬,都会让“亲切”变成“诡异”。
目前主流产品大多达到20个自由度,而灵颜科技即将发布的产品做到了32个自由度。自由度决定表情的下限,年底还将推出46个自由度的全线驱版本,几乎能复现人类面部的绝大部分细微动作。在狭小空间中实现多自由度是极限工程——灵颜科技的解法是线驱,模仿人体肌肉用极细的线绳走线,在更小空间集成更多自由度。
硬件决定表情的骨架,软件则赋予表情灵魂。灵颜科技自研杏仁体情绪建模模型,基于情绪真机数据训练,如今可支持无上限表情生成,延迟控制在10毫秒以内。机器可以根据对话语境,做出“小幅微笑”“中幅开心”“大幅兴奋”等不同强度的细微表情,切换连续自然。
音唇眼同步:攻克行业公认难题
表情对了,还差最后一步——音、唇、眼同步。嘴型要对上发音,眼神要对上说话对象,一旦滞后错位,“恐怖谷效应”立刻生效。灵颜科技打造了首款音唇眼同步智能体FaceSoul Agent,构建了高可靠、低延迟的分布式协同控制体系,让机器人脸的控制展现出极致的平滑与精准。
模块化架构,让消费者买得起
在量产层面,灵颜科技的应对策略是模块化架构,把眼睛、嘴部、脖子拆成独立模组分别设计生产。目前行业里绝大多数灵巧脸还处于“手搓”阶段,而模块化架构让灵颜科技加速量产进程。
产品规划了四条产品线:灵枢M1面向教育和科研,灵枢W1面向商用导览接待,灵韵系列面向家庭C端情绪陪伴,灵能系列面向人形机器人主机厂做即插即用的标准化零部件。灵能系列定价有望控制在万元以下,达行业较低水平。
赵常屹判断,灵巧脸大规模进入家庭的节点大概在明后年。“今年各家还在迭代技术,重点是在B端把场景跑通。等真正解决恐怖谷效应,机器人头会在C端迎来爆发。”
当一台机器人能对你微微一笑,问一句“今天想喝哪一款”,那个表情自然得让你忽略对方是一台机器——而这,正是灵颜科技正在雕琢的未来。
