字节跳动NLP算法工程师-搜索-筋斗云人才计划（北京/上海/杭州/珠海）

校招全职A1833622025-06-09地点：珠海状态：招聘

扫码手机上打开

任职要求

1、获得博士学位，计算机、电子、自动化、软件工程、数学等相关专业优先；
2、在搜索、推荐、广告、自然语言处理NLP、自然语言理解NLU、多模态、机器学习、深度学习等一个或多个领域有较深入的研究者优先；
3、熟悉Linux开发环境，熟练使用C++和Python语言；
4、具有良好的问题分析解决能力，沟通协作能力，工作积极主动，能够与团队融洽合作，一起探索新技术，推进技术进步。

加分项：
1、具有优秀的基础算法、扎实的机器学习/深度学习基础，熟悉NLP、RL、ML等领域的技术，在…

登录查看完整任职要求

微信扫码，1秒登录

工作职责

团队介绍：字节跳动搜索团队主要负责抖音、国际化短视频、今日头条、西瓜视频等产品以及电商、生活服务等业务的搜索算法创新和架构研发工作。我们使用前沿的机器学习技术进行端到端建模并不断创新突破，同时专注于分布式系统、机器学习系统的构建和性能优化，从内存、Disk等优化到索引压缩、召回、排序等算法的探索，充分给同学们提供成长自我的机会。主要工作方向包括：1、探索前沿的NLP技术：从基础的分词、NER，文本、多模态预训练，到业务上的Query分析、基础相关性等，全链路应用深度学习模型，每个细节都充满挑战；2、跨模态匹配技术：在搜索中应用CV+NLP深度学习技术，实现多模态视频搜索强大的语义理解和检索能力；3、大规模流式机器学习技术：应用大规模机器学习，解决搜索中的推荐问题，让搜索更加个性化更加懂你；4、千亿级数据规模的架构：从大规模离线计算，分布式系统的性能、调度优化，到构建高可用、高吞吐和低延迟的在线服务的方方面面都有深入研究和创新；5、推荐技术：基于超大规模机器学习技术，构建业界领先的搜索推荐系统，对搜索推荐技术进行探索和创新。

课题介绍：随着大模型技术的快速发展，智能搜索领域迎来了新的机遇和挑战。传统搜索技术在面对海量数据、多模态信息以及用户复杂需求时，逐渐暴露出模型容量不足、语义理解能力有限、资源利用率低等问题。基于大模型的智能搜索构建旨在通过引入大模型技术，提升搜索系统的智能化水平，优化用户体验，并解决超大规模检索、复杂语义理解、资源高效利用等核心问题。具体目标包括：
1、探索大模型与排序算法的结合，提升个性化排序的精度和用户体验；
2、研究生成式检索算法，解决百亿乃至千亿级别候选库的超大规模检索问题；
3、利用大语言模型（LLM）提升复杂多义Query的搜索满意度。

1、参与字节跳动搜索引擎研发工作，用最前沿的机器学习算法、海量的数据，做最激动人心的技术、给用户最好的搜索体验；
2、参与今日头条/抖音/电商/国际化电商等产品的搜索研发工作，服务相关产品数亿用户；
3、参与搜索核心算法改进，可选的方向包括：
1）探索前沿NLP技术：从基础的分词、NER，到应用上的Query分析、基础相关性等，全链路应用深度学习模型，每个细节都充满挑战；
2）跨模态匹配技术：在搜索中应用CV+NLP深度学习技术，使搜索在上述业务中拥有更强大的检索能力；
3）个性化搜索：应用大规模机器学习，解决搜索中的推荐问题，让搜索更加个性化更加懂你；
4）千亿级数据：从大规模离线计算，分布式系统的性能、调度优化，到构建高可用、高吞吐和低延迟的在线服务的方方面面都有深入研究和创新。

📮 投递简历 ✨AI模拟面试

难度：

包括英文材料

学历+

NLP+

机器学习+

深度学习+

Linux+

C+++

Python+

算法+

ICML+

还有更多 •••

登录查看完整学习资料

相关职位

AI平台高级研发工程师（大模型专项）

社招3年以上机器学习平台

【业务介绍】我们是小红书内稠密类模型（LLM/MLLM/SD/CV/NLP）统一的AI平台QuickSilver，负责调度公司内所有稠密类模型训练与推理资源，基于自建的训推引擎，为公司所有AI算法同学迭代业务模型提供端到端一站式AI服务；包括数据管理，模型管理，模型训练、压缩、推理、部署，服务管理，资源调度等一系列能力。工作职责： 1、负责稠密类模型训练推理开发平台的架构设计和核心功能研发 2、设计和实现大模型训练部署流程，包括模型fine-tuning、推理服务化等 3、构建云原生架构，设计高可用、高性能的微服务体系 4、优化平台性能，提升系统稳定性和可扩展性

北京|上海|深圳

大模型后训练算法工程师/专家

社招引擎

中台稠密引擎组，是小红书负责建设通用深度学习训练推理引擎的团队，面向全公司LLM、多模态LLM、SD、传统CV&NLP等稠密计算型模型训练与推理的业务场景，打造高效、易用、业界领先的训练与推理引擎，为小红书社区、商业化、安全等众多业务方向提供先进的引擎能力，支撑业务持续提升训练推理效率、模型迭代效率与算法研发效率。 1、参与设计和实现深度学习后训练及微调的前沿算法（包括但不限于RFT、RLHF等），以适应多样化的业务场景； 2、结合业务数据和场景，评估选择最适合的微调算法，以支撑业务大语言模型（LLM）微调指标的提升； 3、与数据团队紧密合作，深入理解数据特性，参与设计实现数据提质算法引擎工具，产出高质量数据集提升模型微调效果； 4、与公司内各算法团队深度合作，参与或负责大语言模型、多模态大模型等业务场景的后训练端到端效果提升及落地； 5、密切关注业界 LLM 微调算法和数据提质领域的前沿论文，并整合新技术和算法到训练引擎中，提升框架的领先性；

上海|北京

AI平台高级研发工程师（训练方向）

社招3年以上机器学习平台

1、负责模型训练平台核心功能开发和架构设计，包括传统CN/NLP/SD/LLM等多场景支持 2、负责大模型后训练工具平台化建设，包括后预训练、微调、对齐等技术落地 3、设计和实现高性能分布式训练系统，打造端到端训练解决方案 4、优化训练调度和资源管理，提升集群利用率和训练效率 5、开发模型训练监控诊断工具，建设可观测性体系

北京|上海|深圳

高级算法专家/经理（内容算法方向）(MJ027032)

社招5年以上住宿业务AI &

我们正在寻找一位具有AI智能化及内容算法经验的算法团队负责人。负责领导团队开发前沿技术，推动旅游领域知识的构建，支持内容产品的分发和AI Agent结合的创新应用探索，提升公司产品的智能化水平。：领导并管理内容算法团队，制定技术战略和发展方向，推动知识构建、知识编译、知识分发、探索LLM等创新NLP技术与Agent业务的结合。 1、负责基础NLP相关算法研发，面向但不限于：预训练，文本理解，同义词挖掘，实体识别，term权重分析，属性词挖掘 2、结合NLP和深度学习技术，推动领域知识的构建与优化，制定各环节Benchmark及衡量标准, 跟进业界先进大模型、多模态技术的应用及改进 3、发现并解决推荐分发场景中的意图识别、排序模型、相关性等方向的问题，召回策略和召回模型的优化，开发先进和高性能的召回算法 4、与产品、数据、工程等跨职能团队协作，推动技术落地和产品迭代。 5、负责团队成员的技术指导和能力提升，推动团队技术文化的建设。

更新于 2025-04-01上海