logo of tencent

腾讯腾讯云大模型AI后台开发工程师

社招全职2年以上腾讯云技术地点:西安状态:招聘

任职要求


1.本科及以上学历,计算机相关专业,2年以上后台开发经验(优秀者可放宽);
2.计算机基础知识全面,功底扎实,精通数据结构算法,具备清晰的逻辑思维与问题拆解能力;
3.熟悉Linux系统编程与网络编程,熟练掌握C/C++/Golang/Java中的一种或多种(Golang优先);
4.具备独立完成系统/模块设计与…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


1.负责腾讯云生文、生图、生视频等AI大模型能力的工程化服务架构设计与研发,支撑海量ToB商业服务的稳定输出,保障后台系统的高并发处理、高可用运行、高安全防护及灵活扩缩容能力;
2.通过组件化、工具化、平台化及自动化能力建设,提升团队研发效率,持续优化服务质量和系统性能,增强产品市场竞争力。
包括英文材料
学历+
后端开发+
数据结构+
算法+
Linux+
网络编程+
还有更多 •••
相关职位

logo of aliyun
社招2年以上云智能集团

1. 面向客户提供创新的大模型AI应用方案并进行落地验证,为客户提供云和AI产品的综合技术支持。 2. 主导或参与AI Agent技术栈设计,并基于机器学习平台、低代码Agent平台、知识向量库的工程搭建和实施 3. 深入理解客户场景需求,结合AI和云产品能力,提供方案评估、部署实施、测试与迭代,解决实际业务中遇到的模型交互、输出优化等问题。 4. 基于实际问题提供技术支撑和优化,包含不限于模型效果优化、应用指令和工程优化,并进行必要的AI应用落地开发,包括逻辑推理、生成创作、代码生成等 5. 针对客户日常大模型工具链提供技术支持,参与客户AI相关产品使用及模型调优 6. 负责客户AI调用的稳定性、服务保障响应。

更新于 2026-07-22西安|北京|杭州
logo of aligenie
社招2年以上

1. 面向客户提供创新的大模型AI应用方案并进行落地验证,为客户提供云和AI产品的综合技术支持。 2. 主导或参与AI Agent技术栈设计,并基于机器学习平台、低代码Agent平台、知识向量库的工程搭建和实施 3. 深入理解客户场景需求,结合AI和云产品能力,提供方案评估、部署实施、测试与迭代,解决实际业务中遇到的模型交互、输出优化等问题。 4. 基于实际问题提供技术支撑和优化,包含不限于模型效果优化、应用指令和工程优化,并进行必要的AI应用落地开发,包括逻辑推理、生成创作、代码生成等 5. 针对客户日常大模型工具链提供技术支持,参与客户AI相关产品使用及模型调优 6. 负责客户AI调用的稳定性、服务保障响应。

更新于 2026-04-03西安|北京|杭州
logo of aligenie
社招2年以上

1. 面向客户提供创新的大模型AI应用方案并进行落地验证,为客户提供云和AI产品的综合技术支持。 2. 主导或参与AI Agent技术栈设计,并基于机器学习平台、低代码Agent平台、知识向量库的工程搭建和实施 3. 深入理解客户场景需求,结合AI和云产品能力,提供方案评估、部署实施、测试与迭代,解决实际业务中遇到的模型交互、输出优化等问题。 4. 基于实际问题提供技术支撑和优化,包含不限于模型效果优化、应用指令和工程优化,并进行必要的AI应用落地开发,包括逻辑推理、生成创作、代码生成等 5. 针对客户日常大模型工具链提供技术支持,参与客户AI相关产品使用及模型调优 6. 负责客户AI调用的稳定性、服务保障响应。

更新于 2026-04-03成都|北京
logo of aliyun
社招3年以上云智能集团

1. 训练加速系统设计与优化 1) 主导千亿参数大模型的分布式训练架构设计,优化通信效率,突破显存与计算瓶颈。 2) 研发长序列训练加速技术,支持百万级上下文窗口训练,降低计算复杂度与内存占用。 3) 设计混合精度训练方案(FP16/FP8)与梯度累积策略,结合模型并行、流水线并行等技术,提升训练吞吐量 30% 以上。 2. 推理系统优化与工程化落地 1) 构建高性能推理引擎,基于 vLLM、TensorRT-LLM 等框架实现多模态模型的分布式推理,支持 MoE 架构与动态专家激活策略。 2) 研发模型压缩技术(量化、剪枝、LoRA),将端到端延迟降低,同时保持模型精度损失 3. 基础设施全流程优化 1) 优化训练与推理的 I/O 性能,通过异步并发、缓存预取等技术减少数据加载耗时。 2) 设计训练 - 推理一体化监控平台,实时追踪模型性能指标(如训练 loss 波动、推理 QPS),实现异常自动告警与弹性扩缩容。

更新于 2026-02-08杭州|上海