星灿智能李战斌:我们将模型开发和硬件相结合,不为人形而人形

七颜百科 °C 栏目:科技科普
星灿智能李战斌:我们将模型开发和硬件相结合,不为人形而人形

  2026世界机器人博览会(WRC)于8月19-23日在北京亦创国际会展中心举行。“AI大模型赋能机器人与具身智能产业新范式专题活动”在博览会同期举办。星灿智能创始人兼CEO李战斌出席并演讲。

  李战斌介绍,星灿智能直接用本体进入家庭进行采集,按照自动驾驶data engine的方式完成低成本、高质量、多维度共生式的采集方式。

  他指出,星灿智能的硬件方式是定义极简和实务主义的形态,也就是模型开发和硬件进行结合,不多浪费一滴硬件成本,“我们不为人形而人形。”

  以下为演讲全文:

  谢谢各位。今天向大家介绍一下星灿智能在具身智能和一体化方面做的一些事情。

  5公里生活圈是我们主要的生活场景,在这个场景里面我们将家庭的出行和陪伴放在一起,去完成从卧室到室内外到社区、到公共城市空间的过程。

  我们知道整个目前家庭生活场景里每个时代都有每个时代具体的机器人产品,包括我们知道在早期低算力产品化是扫地机,2024年之前是扫地机,近期春晚之后是人形机器人,星灿是出行陪伴轮椅为载体结合情感陪伴向家庭陪伴进行迁移。在整个自动驾驶发展中和现在的具身智能具有一脉相承的关系,就是数据的采集方式。现有的采集方式包括我们说的ego的方式还有遥操方式、仿真方式都是有问题的,星灿直接用本体进入家庭进行采集,按照自动驾驶data engine的方式完成低成本、高质量、多维度共生式的采集方式。

  所以我们先构建了一体化的数采硬件,这个硬件本身也是产品,而是一个ToC的产品,这个ToC的产品以轮椅为载体进入家庭,不管是ego的视角,还是environment视角,还是其他视角,拿到360度全维度高保真的数据,这样的方式来保障多场景可复用的数据底座能力。

  这是我们构建了一个XcanBrain,我们所构建的XcanBrain更多是偏向于工程化,和大家所研究的世界模型这条路线相比,我们的落地性会更强一些。我们将端到端、VLA和世界模型做了一个分层决策网络,通过这个分层决策网络,在不同的场景情况下激活不同的模型,实现在2000元以内低算力上达到近万元级的芯片的效果,进而让大量的大算力模型在终端得以场景化应用。我们更多的研究,刚才讲到今天的会议非常有意思,第一个是银河,第二个是日冕,后面又是星灿,大家都对空间智能有很深刻的共情。

  对空间智能的认知,就是长期智能体的世界表征,这块星灿也做了比较深入的研究,因为这块可能和我个人的背景有关系,一直在做智驾地图,做数据这块,所以常期记忆这块我们同样也进行了一定的探索。

  在这块几乎是一致的,大家认为世界表征、任务执行和连续记忆是比较重要的,其中三种连续性要同时满足才能构成一个长期可认知的智能体。

  目前大家都在讲一个问题就是记忆的问题,不管是DeepSeek还是Kimi等等,大家在生成2D的文本上有大量历史记忆的出版物,但是到3D的时候发现语料很少,激光雷达是近20年才出现的,近10年才普遍,所以每一家的语料库里面都缺少关于空间智能特别是3D模型数据。这块我们通过本体数据采集,解决空间数据缺失的问题。

  我们构建了两种能力,一个是world2mind和NavMind,world2mind本质上也是延续了智驾的过程。最早为什么自动驾驶会出现高精地图,原因是没有数据,所以大家对空间的理解描述用更多地图的方式进行解析,后面通过众包的模式我们大量回传数据实现空间的解析,所以我们也是通过将多目多视、点云这些多模态信息进行结合形成心智地图,同时基于心智地图实现了navMind导航。

  同时结合world2mind形成一个即插即用外部中心认知智图沙盒,基于这样的信息,我们能更好的将心智导航内化为结构化的推演能力,从心智规划到真机执行更高的成功率。

  这是我们目前统计的数据。

  刚刚讲到我们的范式包括技术和模型之外,我们的硬件方式是定义极简和实务主义的形态,也就是模型开发和硬件进行结合,不多浪费一滴硬件成本。我们不为人形而人形。

  我们主要面向两种场景,就是生活智能体OS,这个是目前一直在研发的,明年下半年会向整个行业推广。一个是出行场景,是从家庭室内到整个城市的公共空间,另外一个是交互场景,出行+陪伴的打法。

  与此同时在生态扩展上,我们和多家的脑机接口侵入式和非侵入式的进行结合。这个地方我稍微再多讲一点,脑机接口它拿到的是意图,但是在执行层面缺少本体的执行,同时对环境的描述粒度是比较粗的,结合我们的环境感知能力,之后执行层面的丝滑性会更贴合本体的需求。

  这是我们的产品形态,因为时间受限不一一讲。

  我们在塑造一种新的移动生活新空间。

  借此机会今天也发布一下我们的新产品Mate X,时间比较紧张,放在这个地方。

  我们将里面除了模型侧一些能力之外,我们将上万元的光谱技术迁移到我们的产品上去,实现了近百元的光谱结合,它补充了现在大家用于激光雷达或者RGBD获取XYZ信息,视觉获取语义信息和拓扑信息之外,我们在物质模态上也有一点进展,也就是在多模态上进一步往前推进。

  这是我们核心的六大能力:主动感知场景导航、动态场景主动避障、智能跟随模式、自适应与预平衡,情感陪伴和具身陪伴。

  公司成立于去年3月份,目前获得一些奖项,媒体的认可,对我们的一些关注。

  谢谢大家。