字节跳动大模型算法工程师-国际电商
任职要求
1、2026届获得本科及以上学历,人工智能、计算机、数学相关专业优先; 2、扎实的机器技术基础,了解前沿的AI技术,发表过高水平学术会议论文或者有竞赛经验者优先; 3、熟悉大数据相关框架和应用MR/Spark等优先; 4、熟悉TensorFlow/PyTorch模型的训练和部署,了解混合精度训练、分布式训练等训练加速方法优先; 5、了解模型压缩&推理加速的研究和技术进展,包括但不限于模型量化、剪枝、蒸馏、TensorRT推理优化等; 6、熟悉以下任一方向的技术: 1)CV&多模态:在多媒体和计算机视觉某个领域有较深入的研究,包括但不限于:图像搜索、图像/视频分类和识别、图像分割、目标检测、OCR、图神经网络、多模态、无监督和自监督学习等;有CV/多模态大模型相关项目经验优先,研发&优化电商视频&商品多模态大模型,结合LLM和视频/商品表征,支持视频多模态分类,视频QA,跨模态检索,商品分类等任务,显著超越线上模型;有较强的实践能力,在Kaggle,COCO,ImageNet,ActivityNet,ICPC等比赛获奖者优先;熟悉前沿工作,有顶级学术会议(如CVPR、ICCV、ECCV等)发表论文者优先; 2)自然语言处理(NLP):NLP方向上有较深入的研究,包括但不限于:预训练技术,自然语言理解,多语言&跨语言学习,自然语言生成,迁移学习,半监督学习等;有LLM大模型相关项目经验优先;研发NLP大模型,以统一电商场景的NLP任务,落地电商业务场景;有较强的实践能力,在Kaggle,GLUE,Super GLUE,CLUE等比赛获奖者优先;熟悉前沿工作,有顶级学术会议(如ACL、EMNLP等)发表论文者优先。
工作职责
团队介绍:国际电商是以TikTok为载体的电商业务(也称为TikTok Shop),致力于成为用户发现并获取优价好物的首选平台,在直播电商、视频内容电商、货架电商等多场景下,国际电商希望能为用户提供更个性化、更主动、更高效的消费体验,为商家提供稳定可靠的平台服务,致力于新奇好物畅销全球,美好生活触手可得的使命。 Data-电商团队是国际电商的核心算法技术力量,专注于电商领域的算法创新,帮助用户高效发现感兴趣的商品,保障用户的购物安全,提升交易各环节的智能化水平。在这里,你将与一流的产品和技术团队合作、钻研,一起应对技术和业务上的挑战,推动技术在电商场景的深度落地。 1、大模型算法研发:构建电商领域的大模型LLM底座,融合电商的知识,快速落地电商业务,例如:沉淀电商大模型预训练链路,研发电商NLP大模型,或者研发电商图文或者视频多模态大模型; 2、基础算法研发:持续建设和深耕NLP/CV/多模态基础预训练算法(BERT类算法),例如:沉淀&优化电商场景的预训练模型,包括超长文本/口语文本预训练,电商图片/视频自监督,适配电商商品的多模态表征学习等; 3、梳理&沉淀算法库,抽象算法接口,最大化提高算法/预训练模型的复用率,同时优化数据采集&模型训练&部署&推理的流程,提升研发效率; 4、技术输出:定期分享SOTA模型,赋能电商甚至公司级别的业务BU,沉淀专利和论文。
团队介绍:Data-电商-平台治理算法团队,通过优化算法,和业务产运配合,对字节跳动旗下电商产品进行全方位的质量和生态治理,既包括风险、违规和低质问题的打击,也包括健康电商生态的建设和优化,最大程度优化平台治理的效果,同时提升治理的效率。 职位描述: 1、深入理解电商治理业务,通过优化算法,持续提升商家/商品/视频/直播/IPR治理等各个场景的人审提效和用户体验,探索基于大模型、多模态模型建立「知道拒绝并且知道为何拒绝 」的业内最先进的智能审核系统; 2、负责大模型、多模态在电商域的数据建设、基座增强、指令微调、偏好对齐、CoT和PEFT等工作,面向电商域做极致效果优化; 3、负责大模型、多模态模型解决长文本、长时序、少样本、违规素材提示、policy推荐等审核应用问题; 4、研发电商NLP大模型、电商图文或者视频多模态大模型,面向电商场景,持续优化多语言多场景多任务多模态的算法效果。
团队介绍:国际电商是以TikTok为载体的电商业务(也称为TikTok Shop),致力于成为用户发现并获取优价好物的首选平台,在直播电商、视频内容电商、货架电商等多场景下,国际电商希望能为用户提供更个性化、更主动、更高效的消费体验,为商家提供稳定可靠的平台服务,致力于新奇好物畅销全球,美好生活触手可得的使命。 Data-电商团队是国际电商的核心算法技术力量,专注于电商领域的算法创新,帮助用户高效发现感兴趣的商品,保障用户的购物安全,提升交易各环节的智能化水平。在这里,你将与一流的产品和技术团队合作、钻研,一起应对技术和业务上的挑战,推动技术在电商场景的深度落地。 1、深入理解电商业务,探索基于大模型、多模态模型,持续提升商家/达人在准入、发品、售后等各个业务场景的风险识别效果; 2、提升商品治理审核智能化水平,迭代优化治理大模型,提升大模型对治理规则和商品信息的理解,实现高准高召的问题识别和自动处置; 3、负责强化电商场景下,大模型推理和反思能力,通过商品业务域SFT、高质量Cot、强化学习、数据合成等技术方案,提升商品治理大模型底座能力; 4、参与构建挖掘电商直播、商品、商家和带货主播等多种实体的数据,对大规模网络/海量特征序列进行建模,支撑商家、达人分类/风险团伙挖掘等业务场景解决问题,并为商家/达人治理提供支持; 5、参与构建大规模的图存储和图学习平台,完善电商社区内商家/商品/达人/视频内容的关系建设,构建电商实体通用表征能力,赋能治理业务; 6、建设售后服务MLLM基座大模型,并利用RAG/Agent/RL等技术,解决复杂场景下对体验问题的理解能力。
1、开发AI驱动的智能客服系统:设计并实现AI对话式客服助手,能够处理电商咨询、投诉、退款、争议解决及物流相关问题,以AI替代传统人工客服; 2、大语言模型(LLM)后训练与高效学习:应用最前沿的LLM训练优化技术,如指令微调、强化学习、持续学习等,在最少标注数据的情况下优化AI客服响应质量,具备大语言模型(LLM)微调、知识蒸馏或强化学习的相关经验,应用于对话式AI场景;深入理解检索增强生成(RAG)、专家混合模型(MoE)、稀疏注意力、强化学习、推理时间优化等技术,以提升AI对话质量; 3、基准测试与训练数据构建:识别具有挑战性的客服交互场景,如政策解读、争议处理、客户投诉、导购推荐等,并构建专门的测试集和训练集; 4、多语言与跨文化客服支持:构建能够适应多语言和不同文化背景的AI模型,确保客服交互的精准翻译和针对不同用户群体的合适响应;精通多语言自然语言处理(NLP)、机器翻译及跨语言对话建模; 5、模型优化与高效部署:研究模型压缩、量化、推理优化等技术,确保AI客服助手在大规模应用场景下具备低延迟、高可靠性的表现。
1、开发AI驱动的智能客服系统:设计并实现AI对话式客服助手,能够处理电商咨询、投诉、退款、争议解决及物流相关问题,以AI替代传统人工客服; 2、大语言模型(LLM)后训练与高效学习:应用最前沿的LLM训练优化技术,如指令微调、强化学习、持续学习等,在最少标注数据的情况下优化AI客服响应质量,具备大语言模型(LLM)微调、知识蒸馏或强化学习的相关经验,应用于对话式AI场景;深入理解检索增强生成(RAG)、专家混合模型(MoE)、稀疏注意力、强化学习、推理时间优化等技术,以提升AI对话质量; 3、基准测试与训练数据构建:识别具有挑战性的客服交互场景,如政策解读、争议处理、客户投诉、导购推荐等,并构建专门的测试集和训练集; 4、多语言与跨文化客服支持:构建能够适应多语言和不同文化背景的AI模型,确保客服交互的精准翻译和针对不同用户群体的合适响应。精通多语言自然语言处理(NLP)、机器翻译及跨语言对话建模; 5、模型优化与高效部署:研究模型压缩、量化、推理优化等技术,确保AI客服助手在大规模应用场景下具备低延迟、高可靠性的表现。