阿里云阿里云智能-技术专家-通义晓蜜
任职要求
1. 熟悉分布式系统的设计和应用,熟悉Mysql、ES、Redis、MQ、Spring、Mybatis等常见数据中间件及框架。 2. 对系统稳定性、可扩展性有深入思考,架构及方案设计至少满足未来2年持续演进需求…
工作职责
1. 通义晓蜜对话机器人技术方案设计 (1)充分了解对话机器人的底层技术原理,设计有技术竞争力的方案。 (2)收集、识别、分析客户需求,并进行合理的抽象,设计具备通用性的标准方案。 (3)基于需求分析,进行技术可行性分析和方案评审,选择合理的技术方案。 2. 通义晓蜜对话机器人技术实现 (1)基于技术方案的拆解,按照任务目标和产出规范,完成任务/子任务的设计、编码开发和系统功能实现。 (2)对编码进行阶段性的讨论和CodeReview,并通过调试优化,推动代码成功部署并进行线上服务的维护工作。 3. 前沿技术跟踪和技术规划 (1)充分了解行业技术动态,并输出中长期技术规划,保证负责的能力具备行业领先性。 4. 重点项目支持 (1)充分了解客户需求,并以标准化产品的思路支持客户需求落地。 (2)可承担复杂项目的技术支持工作。

1. 通义晓蜜对话机器人技术方案设计 (1)充分了解对话机器人的底层技术原理,设计有技术竞争力的方案。 (2)收集、识别、分析客户需求,并进行合理的抽象,设计具备通用性的标准方案。 (3)基于需求分析,进行技术可行性分析和方案评审,选择合理的技术方案。 2. 通义晓蜜对话机器人技术实现 (1)基于技术方案的拆解,按照任务目标和产出规范,完成任务/子任务的设计、编码开发和系统功能实现。 (2)对编码进行阶段性的讨论和CodeReview,并通过调试优化,推动代码成功部署并进行线上服务的维护工作。 3. 前沿技术跟踪和技术规划 (1)充分了解行业技术动态,并输出中长期技术规划,保证负责的能力具备行业领先性。 4. 重点项目支持 (1)充分了解客户需求,并以标准化产品的思路支持客户需求落地。 (2)可承担复杂项目的技术支持工作。
1. 核心架构设计:参与通义晓蜜下一代企业级对话Agent的技术架构设计,在准确率、响应延迟、成本控制之间寻找最优解,制定具备行业竞争力的技术方案。 2. 对话Agent工程化落地:负责对话Agent运行时的架构设计与开发,包括但不限于提示词工程、记忆、规划、工具调用以及复杂任务编排。 3. 高可用系统建设:针对大模型应用特有的长尾延迟和高并发挑战,优化系统吞吐与稳定性;主导代码Review,通过全链路调试与优化,确保线上服务的高可靠性。 4. 数据闭环建设:参与构建“人机协作”的数据反馈机制,通过线上数据回流反哺Agent能力的持续迭代。 5. 前沿技术跟踪与ConvAI规划,持续追踪业界ConvAI、Agentic Workflow、Multi-modal Interaction(多模态交互)等前沿技术动态。

1. 核心架构设计:参与通义晓蜜下一代企业级对话Agent的技术架构设计,在准确率、响应延迟、成本控制之间寻找最优解,制定具备行业竞争力的技术方案。 2. 对话Agent工程化落地:负责对话Agent运行时的架构设计与开发,包括但不限于提示词工程、记忆、规划、工具调用以及复杂任务编排。 3. 高可用系统建设:针对大模型应用特有的长尾延迟和高并发挑战,优化系统吞吐与稳定性;主导代码Review,通过全链路调试与优化,确保线上服务的高可靠性。 4. 数据闭环建设:参与构建“人机协作”的数据反馈机制,通过线上数据回流反哺Agent能力的持续迭代。 5. 前沿技术跟踪与ConvAI规划,持续追踪业界ConvAI、Agentic Workflow、Multi-modal Interaction(多模态交互)等前沿技术动态。
1、稳定性保障与体系建设:负责大模型服务平台及人工智能产品的稳定性保障工作,通过指标建设、预案设计、容量规划、监控完善、建立SOP等手段提升业务可用性与可靠性; 2、高并发流量治理:主导大规模分布式系统及高并发场景下的流量治理方案设计与实施,包括弹性扩缩容以及熔断、限流、降级等容灾策略,确保业务连续性与鲁棒性; 3、新环境部署:在新环境上进行一整套推理系统及其上下游依赖的部署和运维,负责日常模型的上架、性能监测、中间件和底层基建性能监测等。 4、Oncall与应急响应:参与OnCall值班,快速定位并解决生产环境故障,主导重大事件应急响应与复盘;建立故障快速恢复机制,推动根因分析及长效改进措施落地。 5、运维自动化:优化现有部署、监控及维护流程,推动运维自动化与平台化建设,提升研发效率与系统可观测性。负责监控/日志/网络/存储等原生基础设施的保障和工具开发。