logo of bytedance

字节跳动文本大模型算法实习生-电商业务(平台治理方向)

实习兼职A58695地点:上海状态:招聘

任职要求


1、2026届硕士及以上学位在读,计算机相关专业;
2、具有纯文本大模型NLP、深度模型等的训练和应用经验,精通大模型、多模态、CV、NLP等的1-2个领域,优秀的分析和解决问题的能力,对挑战性问题充满激情;
3、具备扎实的代码功底,具备Linux环境研发能力,精通Python和PyTorch等深度学习框架,具备扎…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


ByteIntern:面向2026届毕业生(2025年9月-2026年8月期间毕业),为符合岗位要求的同学提供转正机会。
团队介绍:Data-电商-平台治理算法团队,通过优化算法,和业务团队协作,对字节旗下的电商产品进行全方位的质量和生态的治理,既包括风险、违规和低质问题的打击,也包括健康电商生态的建设和优化,在最大程度的优化平台治理的效果的同时提升治理的工作效率,降低成本。另外一方面,平台治理算法团队致力于攻坚前沿的AI技术,以技术驱动推动业务的变革和发展,领域涉及广泛,包括但不限于NLP/CV/多模态/大模型/图算法/序列算法等。

1、深入理解电商业务,并基于电商领域知识,构建围绕电商场景的文本大模型底座,包括但不限于:数据优化以及数据合成、领域预训练、指令微调、有监督微调等;
2、参与构建挖掘电商直播、商品、商家和带货主播等多种实体的数据,对大规模网络/海量特征序列进行建模,支撑商家、达人分类、风险团伙挖掘等业务场景解决问题,并为商家/达人治理提供支持;
3、负责强化电商治理场景下,大模型推理和反思能力,通过业务域SFT、高质量CoT、强化学习、数据合成等技术方案,持续提升大模型业务理解能力;
4、探索基于文本大模型的电商智能审核系统,实现大规模的机器自动审核,包括:治理规则理解,商品和内容(直播、短视频)的信息抽取、内容理解、风险识别、问题推理等;
5、建设基于文本大模型的电商智能售后Agent,实现模型自动理解消费者意图并智能化给出解决方案,包括:智能仲裁、智能判责、智能售后等。
包括英文材料
学历+
大模型+
NLP+
Linux+
Python+
还有更多 •••
相关职位

logo of bytedance
实习A170288

Bytelntern:面向2026届毕业生(2025年9月-2026年8月期间毕业),为符合岗位要求的同学提供转正机会。 团队介绍:Data-电商-平台治理算法团队,通过优化算法,和业务团队协作,对字节旗下的电商产品进行全方位的质量和生态的治理,既包括风险、违规和低质问题的打击,也包括健康电商生态的建设和优化,在最大程度的优化平台治理的效果的同时提升治理的工作效率,降低成本。另外一方面,平台治理算法团队致力于攻坚前沿的AI技术,以技术驱动推动业务的变革和发展,领域涉及广泛,包括但不限于NLP/CV/多模态/大模型/图算法/序列算法等。 1、参与电商场景下文本、多模态相关模型能力建设,包括但不限于:大模型多模态、关键信息抽取、实体识别、文本分类、知识图谱构建等; 2、参与构建业内领先的内容安全、内容生态识别方法,探索前沿技术(如NLP大模型、多模态大模型的训练和运用相关),并应用落地到电商业务场景中; 3、参与分析模型落地对电商生态的正面影响。

更新于 2025-02-08上海
logo of bytedance
实习A33789

ByteIntern:面向2025届毕业生(2024年9月-2025年8月期间毕业),为符合岗位要求的同学提供转正机会。 团队介绍:Data-电商团队,负责电商创新项目的算法和大数据工作。依托于字节跳动产品,帮助用户发现并获得好物,享受美好生活。在这个团队,我们不仅要通过推荐和搜索算法帮助用户买到感兴趣的好东西,也要通过风控算法和智能平台治理算法去甄别违规行为,保护用户的购物体验;我们还要建设智能客服技术、大规模商品知识图谱来提升各个交易环节的效率;我们也要结合机器学习和运筹算法,来优化供应链和物流的效率和成本,并进一步提升用户体验;另外我们还会用人工智能来帮助商家提升经营能力。我们的使命:没有难卖的优价好物,让美好生活触手可得。 1、参与电商场景下文本、多模态相关模型能力建设,包括但不限于:基于LLAMA/LLaVA等模型的多模态、关键信息抽取、实体识别、文本分类、知识图谱构建等; 2、参与构建业内领先的内容安全、内容生态识别方法,探索前沿技术(如NLP前沿、多模态前沿的训练和运用相关),并应用落地到电商业务场景中; 3、参与分析模型落地对电商生态的正面影响。

更新于 2024-04-21北京
logo of bytedance
实习A212902

ByteIntern:面向2025届毕业生(2024年9月-2025年8月期间毕业),为符合岗位要求的同学提供转正机会。 团队介绍:Data-电商团队,负责电商创新项目的算法和大数据工作。依托于字节跳动产品,帮助用户发现并获得好物,享受美好生活。在这个团队,我们不仅要通过推荐和搜索算法帮助用户买到感兴趣的好东西,也要通过风控算法和智能平台治理算法去甄别违规行为,保护用户的购物体验;我们还要建设智能客服技术、大规模商品知识图谱来提升各个交易环节的效率;我们也要结合机器学习和运筹算法,来优化供应链和物流的效率和成本,并进一步提升用户体验;另外我们还会用人工智能来帮助商家提升经营能力。我们的使命:没有难卖的优价好物,让美好生活触手可得。 1、参与电商场景下文本、多模态相关模型能力建设,包括但不限于:基于LLAMA/LLaVA等模型的多模态、关键信息抽取、实体识别、文本分类、知识图谱构建等; 2、参与构建业内领先的内容安全、内容生态识别方法,探索前沿技术(如NLP前沿、多模态前沿的训练和运用相关),并应用落地到电商业务场景中; 3、参与分析模型落地对电商生态的正面影响。

更新于 2024-04-21上海
logo of bytedance
实习A119218A

Bytelntern:面向2026届毕业生(2025年9月-2026年8月期间毕业),为符合岗位要求的同学提供转正机会。 团队介绍:Data-电商-平台治理算法团队,通过优化算法,和业务团队协作,对字节旗下的电商产品进行全方位的质量和生态的治理,既包括风险、违规和低质问题的打击,也包括健康电商生态的建设和优化,在最大程度的优化平台治理的效果的同时提升治理的工作效率,降低成本。另外一方面,平台治理算法团队致力于攻坚前沿的AI技术,以技术驱动推动业务的变革和发展,领域涉及广泛,包括但不限于NLP/CV/多模态/大模型/图算法/序列算法等。 1、多模态大模型算法研发:负责电商场景下,图文,图视频,音频,OCR,口播等多个模态的预训练和对齐,产出多模态大模型的统一底座,用于电商治理场景所有多模态需求使用; 2、基础算法研发:负责CV/多模态相关模型优化和迭代,多模态表征学习,产出电商通用的预训练模型,Embedding等,用于包含视频意图理解、视频商品类目、同款/相似商品识别、图文意图判断,图文质量治理等电商任务; 3、梳理&沉淀算法库,抽象算法接口,最大化提高算法/预训练模型的复用率,同时优化数据采集&模型训练&部署&推理的流程,提升研发效率; 4、技术输出:定期分享SOTA模型,赋能电商甚至公司级别的业务BU,沉淀专利和论文。

更新于 2025-02-12上海