字节跳动机器学习训练框架研发工程师/专家-Seed

社招全职A1089752024-05-08地点：北京状态：招聘

扫码手机上打开

任职要求

1、熟练掌握Linux环境下的C/C++与Python语言；
2、接触过至少一种机器学习框架（Tensorflow/PyTorch/MxNet或其他自研框架）；
3、有以下至少一项的背景知识与经验：GPU编程，编译器，高性能网络，分布式存储，集群调度；
4、具有独立解决问题的能力，良好的团队合作精神；
5、有强烈的工作责任心，较好的学习能力、沟通能力和自驱力；
6、有良好的工作文档习惯，及时按要求撰写更新工作流程及技术文档。

加分项：
1、…

登录查看完整任职要求

微信扫码，1秒登录

工作职责

团队介绍：字节跳动豆包大模型团队（Seed）成立于 2023 年，致力于寻找通用智能的新方法，追求智能上限，并探索新的交互。团队研究方向涵盖 LLM、语音、视觉、世界模型、基础架构、AI Infra、下一代 AI 交互等，在中国、新加坡、美国等地设有实验室和岗位。 
豆包大模型团队在 AI 领域拥有长期愿景与决心，坚持深耕基础，期望成为世界一流的 AI 研究团队，为科技和社会发展作出贡献。目前团队已推出业界领先的通用大模型以及前沿的多模态能力，支持豆包、扣子、即梦等超过 50 个应用场景。

1、负责字节跳动机器学习训练框架的研究与开发，服务于全公司各个产品；
2、参与机器学习训练框架底层组件的抽象，设计，优化与落地；
3、与全公司算法部门深度合作，为重点项目进行算法与系统的联合优化。

📮 投递简历 ✨AI模拟面试

难度：

包括英文材料

Linux+

C+

C+++

Python+

机器学习+

TensorFlow+

还有更多 •••

登录查看完整学习资料

相关职位

搜广推 - 训练框架研发工程师 / 专家

社招3-5年引擎

【业务介绍】作为公司统一的模型训练引擎团队，支撑公司内所有搜推广类业务的训练工程侧工作，包括模型训练、参数服务器、特征样本流水线等，通过引擎能力的持续建设结合多元异构算力为业务提供高效、灵活、稳定的搜广推模型服务。为公司核心的搜广推业务提供关键的模型训练引擎支撑，解决超大规模稀疏特征训练的核心问题，不断挖掘异构硬件算力，为公司搜广推业务增长提供保障，并获得快速的成长与提升。【岗位职责】 1、负责小红书搜广推业务线的机器学习训练框架的研发与迭代，核心支持公司所有相关业务场景； 2、深入参与分布式训练、自动并行化、参数服务器、特征样本流水线等系统底层功能的创新设计与优化，实现软硬件协同的极致训练效率； 3、跨团队合作，与公司算法部门深度协同，针对关键项目开展算法与系统的联合优化，推动解决实际业务挑战； 4、推动自动化扩展、智能资源调度、跨架构设备兼容（NV GPU、GPGPU、XPU等）、AI系统可观测性等先进技术在公司模型训练平台落地； 5、跟踪并推动AI系统领域的最新技术趋势（如生成式推荐、AI编译优化、RDMA/NCCL通信计算并发等），持续保持平台业界领先优势。

更新于 2025-11-11北京|上海

搜广推 - 训练框架研发工程师 / 专家

社招引擎

【业务介绍】作为公司统一的模型引擎团队，支撑公司内所有搜推广类业务的工程侧工作，包括了模型推理、训练、参数服务器、特征工程等服务，通过引擎能力的持续建设结合多元异构算力为业务提供高效、灵活、稳定的模型服务。【岗位职责】 1、负责小红书搜广推-机器学习训练框架的研究与开发，服务于全公司各个产品； 2、参与机器学习训练框架底层组件的抽象，设计，优化与落地； 3、与全公司算法部门深度合作，为重点项目进行算法与系统的联合优化。

更新于 2025-07-11北京|上海

【公海需求】-搜广推-训练框架研发工程师 / 专家

社招基础后端

岗位职责： 1、负责小红书搜广推-机器学习训练框架的研究与开发，服务于全公司各个产品； 2、参与机器学习训练框架底层组件的抽象，设计，优化与落地； 3、与全公司算法部门深度合作，为重点项目进行算法与系统的联合优化。

北京|上海

AML机器学习框架研发工程师/专家

社招A55202

团队介绍：AML是字节跳动公司的机器学习中台，为抖音/今日头条/西瓜视频等业务提供推荐/广告/CV/语音/NLP的训练和推理系统。为公司内业务部门提供强大的机器学习算力，并在这些业务的问题上研究一些具有通用性和创新性的算法。同时，也通过火山引擎将一些机器学习/推荐系统的核心能力提供给外部企业客户。此外，AML还在AI for Science，科学计算等领域做一些前沿研究。 1、负责字节跳动机器学习训练/推理框架的研究与开发，服务于全公司各个产品； 2、参与机器学习训练/推理框架底层组件的抽象，设计，优化与落地； 3、与全公司算法部门深度合作，为重点项目进行算法与系统的联合优化。

更新于 2024-11-26上海