近日,魔珐科技与智元AGIBOT正式开展合作,双方围绕灵犀X2,将智元AGIBOT机器人能力与魔珐具身交互智能相结合,推动机器人交互体验进一步升级。
作为双方合作成果在真实服务场景中的一次集中呈现,机器人日前走进上海市徐汇区枫林街道,进入社区服务、科普讲解、长者服务、儿童成长及社区食堂等多个空间,与不同年龄段的社区居民展开面对面互动。
进入社区服务流程,机器人承担迎宾、咨询与服务引导
在枫林街道社区服务场景中,机器人首先以“社区志愿者”的身份参与到日常服务中。
面对前来办事或参加活动的居民,机器人可以主动进行迎宾,并围绕社区活动、服务内容、场地位置等问题展开交流。在介绍相关信息的同时,机器人能够根据具体对话内容配合相应的姿态和身体动作,在问候、讲解和方向指引等不同交流环节中呈现更加完整的表达。

对于机器人而言,社区与展厅等相对固定的展示环境有所不同。居民的年龄、需求以及提出的问题更加多样,交互随时可能发生。这也对机器人在真实服务环境中的持续交流和表达能力提出了更高要求。
此次社区活动,正是双方将合作形成的机器人交互体验进一步放入真实服务流程中的一次实际呈现。
从单向讲解到现场问答,机器人化身“AI科普讲解员”
在社区科普区域,机器人承担起了另一项任务——向社区居民介绍具身交互智能相关知识。
围绕“什么是具身交互智能”“AI如何进入机器人终端”“机器人如何通过语言和身体动作进行表达”等内容,机器人可以完成现场科普讲解,并配合相应的身体动作辅助信息表达。现场居民还可以直接向机器人提出问题。
针对居民在讲解过程中产生的疑问,机器人能够继续进行回答和交流,使一次科普讲解进一步延伸为可持续的互动过程。

从信息介绍到现场问答,这一场景也更直观地呈现了机器人进入讲解、导览、教育等实际场景之后的交互形态:不仅需要准确传递信息,还需要面对不同用户随时发生的提问,并以符合交流内容的方式进行回应。
面向长者、儿童和普通居民,机器人进入更多社区生活空间
除了社区服务和科普讲解,机器人还进入了长者服务、儿童成长以及社区食堂等更加贴近日常生活的空间。
在长者服务场景中,居民可以围绕日常话题与机器人进行交流;在儿童成长空间,孩子们可以围在机器人身边提问、聊天,并参与知识讲解和趣味互动。面对孩子不断变化的问题,机器人通过语言和身体动作配合进行回应,让交流自然延续。

在社区食堂等开放区域,互动则更加随机。居民可能询问社区活动、服务信息,也可能只是经过时主动和机器人打个招呼。机器人可以根据实际交流内容参与问答、信息介绍和服务指引,像一名社区志愿者一样融入日常服务环境。
从儿童到长者,从相对明确的服务需求到随时可能发生的随机交流,不同场景对机器人提出了不同的交互需求。
而对于双方此次合作而言,社区提供的正是这样一个更加综合的真实环境:机器人需要面对不同人群、不同问题和不同交流方式,让双方围绕语义驱动具身表达所形成的交互体验,在真实用户面前得到更加直观的呈现。
从机器人能力到真实体验,具身交互智能成为服务场景的重要一环
随着人形机器人逐步进入商业空间、公共服务、教育、陪伴等直接面对用户的环境,机器人的实际体验越来越不仅取决于本体运动和任务执行能力,也与其如何与人持续交流密切相关。
此次魔珐科技与智元AGIBOT的合作,正是围绕这一方向展开。

此次合作中,双方通过系统协同,将对话内容进一步转化为相应的语音与身体动作表达。魔珐具身交互智能平台的具身表达系统能够根据对话内容和语义信息生成相应的语音与具身表达数据,使机器人的回答能够通过声音和身体动作共同呈现,让语言回应与身体表现保持协调。
通过智元AGIBOT机器人能力与魔珐具身交互智能相结合,双方希望进一步提升机器人在迎宾、讲解、咨询、陪伴及公共服务等直接面对用户的场景中的交互体验。
此次走进徐汇区枫林街道,也让这一合作效果从机器人终端上的能力呈现,进一步进入真实用户、真实空间和真实服务流程之中。
魔珐星云:以感知、认知、表达构建端到端具身交互智能
此次合作背后的能力由魔珐星云提供,魔珐星云是魔珐科技面向多终端打造的端到端具身交互智能平台,围绕感知、认知、表达构建完整的人机交互能力。在感知端,通过多模态感知提升AI在多人交谈、环境噪声等复杂真实环境中的信息识别能力;在认知端,依托全模态知识解析、知识图谱与RAG等技术,让AI能够更准确地理解用户意图、组织和调用知识,并通过知识治理与溯源机制提升回答的准确性与一致性。
在表达端,魔珐星云进一步让AI的认知结果转化为自然的具身表达。在人形机器人终端,机器人不只是通过语言回应,而是能够根据对话语义,让语音与头部、躯干、手势等身体表达相互配合,使身体真正成为交流的一部分。同时,这套表达能力也可以适配屏幕、AR/VR等不同终端,让AI从感知环境、理解需求到自然表达形成完整闭环。
智元机器人:以多模态闭环能力,筑牢人形机器人交互根基
本次社区落地的优质交互体验,核心依托智元AGIBOT硅光动语WITA端到端多模态交互系统。作为面向人形机器人实景应用打造的核心交互底座,该系统以多模态融合架构为核心,打通感知、认知决策、具身行动全链路,高度适配社区复杂动态、人群多元、交互随机的真实服务场景。
首先在多模态感知层面,WITA深度融合视觉、听觉、触觉能力,搭载高噪语音识别、空间拾音定位、人脸手势识别与智能场景理解技术。能够在社区食堂、服务大厅等嘈杂人流环境中,有效识别交互对象、捕捉用户需求、感知环境变化、判断互动时机,为自然流畅的人机交互筑牢感知基础。与此同时,在具身行动与表达层面,WITA实现认知决策到实景行动的无缝落地。可驱动机器人完成拟人化语音播报、多语言应答、视线表情跟随、贴合语境的肢体动作输出,同时支持文生动作、导航讲解、连续服务执行等实景能力,实现语言、情绪、肢体与服务行动的高度协同,完成从被动应答到主动服务、自然互动的升级。
从社区里的迎宾咨询、AI科普,到面向长者、儿童及普通居民的日常互动,此次社区活动也展示了双方合作形成的机器人交互体验在多样化真实场景中的应用效果。
魔珐科技也将持续推动端到端具身交互智能进入更多机器人及其他智能终端,让AI从智能能力进一步走向真实场景和服务流程。
免责声明:本文仅代表作者个人观点,与每日科技网无关。其原创性以及文中陈述文字和内容未经本站证实,对本文以及其中全部或者部分内容、文字的真实性、完整性、及时性本站不作任何保证或承诺,请读者仅作参考,并请自行核实相关内容。
本网站有部分内容均转载自其它媒体,转载目的在于传递更多信息,并不代表本网赞同其观点和对其真实性负责,若因作品内容、知识产权、版权和其他问题,请及时提供相关证明等材料并与我们联系,本网站将在规定时间内给予删除等相关处理.

