logo of xiaohongshu

小红书AI平台高级研发工程师(训练方向)

社招全职3年以上机器学习平台地点:北京 | 上海 | 深圳 | 杭州状态:招聘

任职要求


任职要求:
1、计算机相关专业本科及以上学历,3年以上后端开发经验
2、精通Go/Java/Python等编程语言,熟悉模型训练全流程,了解PyTorch框架使用
3、具备训练GPU计算优化和大规模集群调度相关经验
4、良好的系统设…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


1、负责模型训练平台核心功能开发和架构设计,包括传统CN/NLP/SD/LLM等多场景支持
2、负责大模型后训练工具平台化建设,包括后预训练、微调、对齐等技术落地
3、设计和实现高性能分布式训练系统,打造端到端训练解决方案
4、优化训练调度和资源管理,提升集群利用率和训练效率
5、开发模型训练监控诊断工具,建设可观测性体系
包括英文材料
学历+
后端开发+
Go+
Java+
还有更多 •••
相关职位

logo of xiaohongshu
社招3-5年后端开发

工作职责: 1、负责大模型平台的架构设计和核心功能研发,构建云原生架构,设计高可用、高性能的微服务体系; 2、负责构建面向大模型全流程的DevOps,与下游云原生平台深度融合,支撑大模型在公司内各业务生产链路稳定高效地落地; 3、负责万卡规模GPU集群效能分析及优化,通过调度策略优化、在离线混部、GPU虚拟化、存储&网络加速等手段,提升GPU集群使用效率; 4、将平台和框架结合,通过任务调度、弹性容灾、性能优化等措施端到端提升AI生产效率,涉及k8s/kubeflow、网络通信、分布式训练等; 5、优化各AI平台性能,提升系统稳定性和可扩展性,保障大规模并发场景下的服务质量与用户体验; 6、持续研究分析业内创新AI平台产品,优化技术方案,改进产品功能,提升创新能力与产品体验。

更新于 2025-11-07北京|上海|杭州
logo of xiaohongshu
社招3-5年大模型

我们是小红书中台大模型 Infra 团队,专注打造领先易用的「AI 大模型全链路基础设施」!团队深耕大模型「数-训-压-推-评」技术闭环,在大模型训练加速、模型压缩、推理优化、部署提效等方向积累了深厚的技术优势,基于 RedAccel 训练引擎、RedSlim 压缩工具、RedServing 推理部署引擎、DirectLLM 大模型 API 服务、QuickSilver 大模型生产部署平台等核心产品,持续赋能社区、商业、交易、安全、数平、研效等多个核心业务,实现 AI 技术高效落地! 1、负责大模型平台的架构设计和核心功能研发,构建云原生架构,设计高可用、高性能的微服务体系; 2、负责构建面向大模型全流程的DevOps,与下游云原生平台深度融合,支撑大模型在公司内各业务生产链路稳定高效地落地; 3、负责万卡规模GPU集群效能分析及优化,通过调度策略优化、在离线混部、GPU虚拟化、存储&网络加速等手段,提升GPU集群使用效率; 4、将平台和框架结合,通过任务调度、弹性容灾、性能优化等措施端到端提升AI生产效率,涉及k8s/kubeflow、网络通信、分布式训练等; 5、优化各AI平台性能,提升系统稳定性和可扩展性,保障大规模并发场景下的服务质量与用户体验; 6、持续研究分析业内创新AI平台产品,优化技术方案,改进产品功能,提升创新能力与产品体验。

更新于 2025-10-23北京|上海|杭州
logo of alibaba
社招1年以上

我们是天猫技术新品营销团队,致力通过大数据、人工智能打造数字化新品营销平台 依托先进的大数据能力,深度解读消费者行为趋势和市场动态追踪,为品牌提供准确的新品研发方向; 围绕AIGC算法模型的训练和应用,持续完善AI相关基础能力建设,提升算法模型的训练和应用效率 基于消费者端互动玩法、新品导购场景,结合平台新品运营产品建设,全面提升商家数字化上新营销能力 我们都期待你的加入,一起开启探索未知、创造未来的旅程!

更新于 2025-05-22杭州
logo of aliyun
社招5年以上产品类-平台型

1. 负责百炼专属版大模型AI Infra产品定义、设计及商业化落地; 2. 制定产品策略以及商业策略,以业务成功为导向,协同研发工程师,售前架构师, 产品运营等多角色共同努力达成业务目标; 3. 深刻理解客户业务和场景需求,追踪行业发展趋势及技术发展动态,规划产品演进路径及迭代,保持具有持续产品力竞争优势; 4. 追踪标杆客户,确保技术可行性,以及对产品演进的持续反馈,沉淀最佳实践,标杆项目案例; 5. 收集客户需求,结合技术理解和研判,推动产品功能升级迭代,提升产品市场竞争力和市场占有率。

更新于 2025-06-27北京|杭州