
智能互联通义实验室-算法专家/高级算法工程师-具身智能机器人
任职要求
1. 硕士或博士学历,计算机科学、人工智能、机器人、控制、电子工程等相关专业毕业。 2. 具有2年以上具身智能、机器人感知或大模型相关研发经验,熟悉至少一个方向:具身智能大模型、机器人多模态感知、行动决策与控制、模拟器与仿真。 3. 熟练使用主流AI框架(PyTorch / JAX 等),具备端到端训练与推理系统经验,能独立实现从数据到模型落地的闭环。 4. 具有良好的科研能力与工程落地能力,能在研究与产品之间平衡。 加分项 1. 在相关领域有开源成果,或…
工作职责
1. 具身智能大模型研究与优化
(1) 研究和构建具身智能大模型(Embodied Foundation Models)与机器人大脑。
(2) 探索语言、视觉、动作等多模态融合机制(VLM / VLA / VLA-Agent)。
(3) 优化模型的长时记忆、推理能力与可泛化性。
2. 机器人智能算法研发
(1) 设计和实现机器人多模态感知、导航、操作、交互等核心算法模块。
(2) 推进大模型驱动的机器人任务规划与决策。
(3) 基于模拟器与真实世界数据,进行大规模对齐与强化学习(Sim2Real, RLHF, Imitation Learning)。
3. 系统落地与协同研发
(1) 与硬件与系统团队协作,推动模型算法在真实机器人平台上的部署与性能调优。
(2) 支撑具身智能大模型的云端训练体系、数据闭环与MLOps工程。
(3) 发表高水平论文或申请相关专利,推动业界与学界前沿研究。1.拟人SFT数据构建与策略设计 (1)负责面向超拟人语音交互场景的SFT数据方案设计,涵盖角色人设一致性、多轮对话逻辑、情感表达等维度,构建高质量对话语料。 (2)针对多模态交互、A陪伴等需求,设计角色扮演数据的标注规范,包括身份背景、经典台词、行为模式等细粒度标签。 (3)基于业务场景(如儿童教育、情感陪伴、游戏NPC、模拟面试等)设计符合角色设定的对话逻辑,提升用户交互沉浸感。 (4)建立SFT数据评估体系,针对人设一致性、意图识别准确率、对话流畅度等指标进行量化分析与迭代。 2.SFT数据在语音交互模型中的优化 (1)结合语音交互链路(ASR→LLM→TTS),通过SFT技术优化大模型的对话能力,重点提升上下文理解、情感响应准确度及多轮对话连贯性。 (2)探索角色扮演数据在语音Agent中的应用,例如通过Prompt工程控制对话风格、情绪倾向,实现个性化交互体验。 (3)协同声纹识别、情感计算等技术,构建语音-文本-用户画像对齐的数据集,支持个性化交互(如儿童声线识别、成人情感分析)。 (4)推动SFT数据在低延迟语音交互场景的落地,优化端到端响应效率(如实时打断、长上下文记忆等能力)。
1、 主导/核心参与全模态大模型(文本、图像、视频、音频、3D等)的模型架构与核心算法设计、训练及优化,探索跨模态对齐、多模态融合和原生多模态等前沿技术创新; 2、 开发全模态大模型在具体场景中的应用落地(如实时AI视频通话等方向),将全模态大模型技术与业务需求结合,推动场景化落地; 3、 解决全模态大模型训练和推理的挑战性问题(如模态对齐、长序列建模、高效推理等),跟踪相关领域在学术界与工业界的最新进展等。

1、 主导/核心参与全模态大模型(文本、图像、视频、音频、3D等)的模型架构与核心算法设计、训练及优化,探索跨模态对齐、多模态融合和原生多模态等前沿技术创新; 2、 开发全模态大模型在具体场景中的应用落地(如实时AI视频通话等方向),将全模态大模型技术与业务需求结合,推动场景化落地; 3、 解决全模态大模型训练和推理的挑战性问题(如模态对齐、长序列建模、高效推理等),跟踪相关领域在学术界与工业界的最新进展等。