通义Token Foundry-云端Agent技术专家-北京/杭州
任职要求
1. 计算机科学、软件工程或相关专业硕士及以上学历,3年以上后端系统或平台型产品研发经验。 2. 熟悉大模型驱动的Agent架构,具备Task Planning、Function Calling、Tool Use、ReAct等机制的实际开发或集成经验。 3. 精通至少一种主流后端语言(如Java、Go、Python),熟悉微服务架构、分布式系统、消息中间件(如RocketMQ、K…
工作职责
1. 面向ToB行业场景(如AI手机等),设计并构建可扩展、高可用的Agent编排系统,支撑多模态交互系统中复杂任务的自动化执行。 2. 深度整合阿里集团内部丰富的Agent能力,同时对接第三方生态服务,打造统一的行业级Agent应用。 3. 制定标准化的工具描述协议、Agent接入规范与开发者工具链(SDK/CLI/调试平台),降低内外部生态伙伴的接入门槛。 4. 针对移动端等资源受限环境,优化Agent调用链路的性能、延迟与鲁棒性,支持离线、弱网、低功耗等边缘场景下的可靠运行。

1. 面向ToB行业场景(如AI手机等),设计并构建可扩展、高可用的Agent编排系统,支撑多模态交互系统中复杂任务的自动化执行。 2. 深度整合阿里集团内部丰富的Agent能力,同时对接第三方生态服务,打造统一的行业级Agent应用。 3. 制定标准化的工具描述协议、Agent接入规范与开发者工具链(SDK/CLI/调试平台),降低内外部生态伙伴的接入门槛。 4. 针对移动端等资源受限环境,优化Agent调用链路的性能、延迟与鲁棒性,支持离线、弱网、低功耗等边缘场景下的可靠运行。
1. 设计并构建面向多模态交互(语音、视觉、语言、上下文融合)的云端推理服务平台,支持Omni/Speech/VL等大模型的在线/近线推理。 2. 主导端云协同架构中云端服务模块的技术方案,包括模型服务化(Model Serving)、动态批处理(Dynamic Batching)、请求调度、弹性扩缩容、负载均衡等关键能力。 3. 优化云端推理链路的延迟、吞吐与资源利用率,针对ToB客户对SLA(如99.9% 构建统一的服务治理框架,集成监控告警、日志追踪(如OpenTelemetry)、AB测试、灰度发布、故障自愈等运维能力。 4. 与算法团队紧密协作,推动模型结构适配、量化部署、缓存策略等端云联合优化方案落地。
1. 负责机器人操作系统的整体软硬件集成与真机部署,完成机械臂、传感器、计算单元等系统的搭建、调试与优化,构建稳定可靠的机器人运行环境。 2. 负责实时遥操作系统的开发与优化,满足高时效性和可靠性要求,设计并搭建真机评测体系与数据管线。 3. 解决真实机器人系统中的部署问题(延迟、标定误差等),优化异步推理系统(RTC等),设计安全保护机制(碰撞检测、异常行为监测、急停),持续提升系统鲁棒性与安全性。 4. 协同算法、数据、硬件团队,将前沿算法成功转化为可稳定运行的机器人系统,推动在真实场景和任务的落地闭环。