logo of tuhu

途虎养车大模型开发工程师

社招全职技术地点:上海状态:招聘

任职要求


1.计算机科学、人工智能等相关专业本科及以上学历。
2.精通Python,有sglang/vllm等开源推理引擎二次开发经验优先。
3.熟悉DeepSeek、GPT等主流大模型架构与训练推理流程,具备模型部署、性能调优及问题定位经验。
4.熟练使用Kubernetes、Docker等容器化技术,具备…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


1.负责主流及自研模型(如Qwen、DeepSeek、MiniMax等)的全链路运维,涵盖部署、监控、高可用保障与故障应急处理,构建可观测体系(日志/指标),确保模型服务稳定性与低延迟响应。
2.优化基于Docker/Kubernetes的模型部署与资源调度策略,提升GPU/CPU资源利用率,推动模型平滑升级与业务无损切换。
3.主导大模型运维平台建设,集成模型监控、评测、用量分析、成本分摊、批量推理及数据集管理等核心能力,提升运维自动化与智能化水平。
4.结合业务实际部署场景,基于sglang/vllm等开源推理引擎进行模型适配部署或二次开发
5.协同算法/业务团队,推动模型从实验到生产的全流程落地,持续跟进大模型与AIOps前沿技术,探索智能运维创新场景。
包括英文材料
学历+
Python+
SGLang+
vLLM+
推理引擎+
GPT+
还有更多 •••
相关职位

logo of pinduoduo
社招技术类

1.负责大模型训练框架的开发和维护,以提高训练平台效率和稳定性为主要目标 2.负责大模型的部署和优化, 包括服务效率和稳定性提升,gpu/cpu部署和 资源调度, 数据IO和模型推理加速 3.负责大模型的业务探索,与算法团队和业务团队紧密配合,提升业务收益

更新于 2026-05-24上海
logo of pinduoduo
社招技术类

岗位职责 1. 负责多模态大模型的架构设计、开发与优化; 2. 设计并实现多模态数据处理流水线、跨模态对齐机制、并行训练系统,优化显存利用、采样速度与生成一致性; 3. 支持模型并行、数据并行、混合并行等分布式训练策略,优化显存利用率、计算效率与通信开销,提升整体训练吞吐量; 4. 与算法团队紧密协作,快速定位并解决多模态融合、生成幻觉、跨模态一致性、长时序建模等系统瓶颈,持续进行性能调优与成本优化。

更新于 2026-04-19上海
logo of lingxi
校招灵犀互娱2026

1. 负责将大模型(LLM)能力落地到实际业务场景,包括但不限于Prompt工程、智能对话、知识库建设、内容生成及业务流程自动化; 2. 设计并开发AI Agent系统及其框架,负责任务规划、多步推理(CoT)、工具调用(Function/Tool Calling)、记忆管理及多智能体协同等核心模块的实现; 3. 构建LLMOps全链路流程,包括大模型应用评测、监控告警、数据标注及RAG(检索增强生成)全链路优化(如切片算法、召回重排等); 4. 参与大模型业务应用平台的研发,推动MCP(模型控制协议)生态建设、工作流编排及代码生成等提效工具的开发,构建高可靠、高扩展的AI架构。

更新于 2026-03-31广州
logo of tencent
社招3年以上腾讯云技术

1.负责海外web网站后端功能开发与性能优化,及web后台高可用架构设计与开发; 2.负责web服务部署、日常运营保障、问题排查等工作,与内部与产品、服务开发、测试等多角色密切配合协作,确保产品迭代进度; 3.负责网站监控告警跟进,监控追踪API调用状态、资源使用率及服务质量(SLA); 4.负责开发者文档、SDK工具包及代码样例维护,提升第三方接入体验。

更新于 2026-01-26西安