logo of bytedance

字节跳动推荐大模型算法实习生-电商-筋斗云人才计划(北京/上海/杭州/珠海)

实习兼职A135123A地点:北京状态:招聘

任职要求


1、2026届及之后毕业,博士在读,计算机/数学等相关专业的优先;
2、具有扎实的机器学习基础和编码能力,在机器学习NLP、CV等有较深入的研究经验,熟练掌握主要的算法数据结构;
3、在搜广告推和大模型领域,有参与或者主导过关键项目的优先;
4、在国际顶级会议发表论文者优先,包括但不限于KDD、SIGIR、RecSys、ACL、NeurIPS等;
5、具备较好的问题分析和解决能力,对技术有热情,热衷于推动和解决各种挑战。

工作职责


团队介绍:Data-电商团队,负责电商创新项目的算法和大数据工作。依托于字节跳动产品,帮助用户发现并获得好物,享受美好生活。在这个团队,我们不仅要通过推荐和搜索算法帮助用户买到感兴趣的好东西,也要通过风控算法和智能平台治理算法去甄别违规行为,保护用户的购物体验;我们还要建设智能客服技术、大规模商品知识图谱来提升各个交易环节的效率;我们也要结合机器学习和运筹算法,来优化供应链和物流的效率和成本,并进一步提升用户体验;另外我们还会用人工智能来帮助商家提升经营能力。我们的使命:没有难卖的优价好物,让美好生活触手可得。

课题介绍:
背景:本项目旨在探索推荐领域下的大模型新范式,突破现在持续了较长时间的推荐模型结构和Infra的方案,且效果大幅好于现在的基线模型,在抖音短视频/直播/电商/头条/剪映等多个业务场景上得到应用。推荐领域的大模型是比较有挑战的事情,推荐对工程效率的要求更高,且用户的推荐体验上是个性化的,本课题会以下多个方向来做深入的研究,探索和建设推荐场景的大模型方案,大幅提升推荐模型的天花板。 

1、在电商推荐海量用户与商品的数据下,探索大模型、大算力与推荐系统的结合;
2、探索多模态大模型等技术,提升相关类场景效果与用户体验;
3、探索LLM和推荐系统的结合、生成式推荐等方向,进一步提升信息匹配的效率。
包括英文材料
机器学习+
NLP+
算法+
数据结构+
大模型+
RecSys+
NeurIPS+
相关职位

logo of bytedance
实习A108597

团队介绍:Data-电商团队,负责电商创新项目的算法和大数据工作。依托于字节跳动产品,帮助用户发现并获得好物,享受美好生活。在这个团队,我们不仅要通过推荐和搜索算法帮助用户买到感兴趣的好东西,也要通过风控算法和智能平台治理算法去甄别违规行为,保护用户的购物体验;我们还要建设智能客服技术、大规模商品知识图谱来提升各个交易环节的效率;我们也要结合机器学习和运筹算法,来优化供应链和物流的效率和成本,并进一步提升用户体验;另外我们还会用人工智能来帮助商家提升经营能力。我们的使命:没有难卖的优价好物,让美好生活触手可得。 课题介绍: 电商推荐算法是互联网商业变现的核心驱动力,目前我们有国内最大的兴趣电商分发场景以及最大的电商广告分发场景,我们希望借鉴生成式AI的成功思路,探索在电商推荐算法和架构上的颠覆性创新,解锁更大的算法效果提升空间。重点探索以下方向: 1)基于类Transformer结构的生成式推荐大模型技术,验证电商推荐场景的Scaling Law,探索面向大模型的特征工程以及算法建模范式; 2)研究电商推荐模态下的Tokenization以及COT相关算法优化; 3)算法和工程协同设计与优化,提升海量数据、超大参数背景下的训练与推理效率; 4)语言/推荐/视频等多模态模型的结合。 1、负责电商推荐及电商广告场景推荐大模型的算法优化,引入生成式AI技术,优化算法建模方法、模型结构、特征和样本等,提升电商分发效率; 2、验证推荐大模型的Scaling Law,应对大模型训练中的一切新挑战; 3、挖掘有效的用户行为,不限于Sideinfo、Action_Type等,同时研究行为聚合算法; 4、算法和工程高度融合、协同设计,极致优化推荐大模型的训练及推理效率。

更新于 2025-05-27
logo of bytedance
实习A98756

团队介绍:Data-电商团队,负责电商创新项目的算法和大数据工作。依托于字节跳动产品,帮助用户发现并获得好物,享受美好生活。在这个团队,我们不仅要通过推荐和搜索算法帮助用户买到感兴趣的好东西,也要通过风控算法和智能平台治理算法去甄别违规行为,保护用户的购物体验;我们还要建设智能客服技术、大规模商品知识图谱来提升各个交易环节的效率;我们也要结合机器学习和运筹算法,来优化供应链和物流的效率和成本,并进一步提升用户体验;另外我们还会用人工智能来帮助商家提升经营能力。我们的使命:没有难卖的优价好物,让美好生活触手可得。 课题介绍: 电商推荐算法是互联网商业变现的核心驱动力,目前我们有国内最大的兴趣电商分发场景以及最大的电商广告分发场景,我们希望借鉴生成式AI的成功思路,探索在电商推荐算法和架构上的颠覆性创新,解锁更大的算法效果提升空间。重点探索以下方向: 1)基于类Transformer结构的生成式推荐大模型技术,验证电商推荐场景的Scaling Law,探索面向大模型的特征工程以及算法建模范式; 2)研究电商推荐模态下的Tokenization以及COT相关算法优化; 3)算法和工程协同设计与优化,提升海量数据、超大参数背景下的训练与推理效率; 4)语言/推荐/视频等多模态模型的结合。 1、负责电商推荐及电商广告场景推荐大模型的算法优化,引入生成式AI技术,优化算法建模方法、模型结构、特征和样本等,提升电商分发效率; 2、验证推荐大模型的Scaling Law,应对大模型训练中的一切新挑战; 3、挖掘有效的用户行为,不限于Sideinfo、Action_Type等,同时研究行为聚合算法; 4、算法和工程高度融合、协同设计,极致优化推荐大模型的训练及推理效率。

更新于 2025-05-27
logo of bytedance
实习A24406

团队介绍:Data-电商团队,负责电商创新项目的算法和大数据工作。依托于字节跳动产品,帮助用户发现并获得好物,享受美好生活。在这个团队,我们不仅要通过推荐和搜索算法帮助用户买到感兴趣的好东西,也要通过风控算法和智能平台治理算法去甄别违规行为,保护用户的购物体验;我们还要建设智能客服技术、大规模商品知识图谱来提升各个交易环节的效率;我们也要结合机器学习和运筹算法,来优化供应链和物流的效率和成本,并进一步提升用户体验;另外我们还会用人工智能来帮助商家提升经营能力。我们的使命:没有难卖的优价好物,让美好生活触手可得。 课题介绍: 背景:电商领域短视频内容正逐渐成为业务增长和用户体验优化的重要方向,通过多模态的视频理解与生成大模型创新解决电商场景中的核心挑战,例如短视频与电商商品的精准匹配、AIGC(AI生成内容)视频生成等,让用户在浏览短视频时获得更精准的商品匹配,并为内容创作者提供更便捷强大的创作工具。 研究方向:本课题聚焦于多模态视频理解与生成。构建高效的多模态嵌入模型,实现视频、图像、文本、商品等模态间的统一表示学习,以增强短视频与电商商品的关联性。通过大规模跨模态数据集的构建与优化,提升视频与商品的匹配精准度,使模型能够自动识别短视频中的商品或品牌,并精准映射至电商库,支持用户在观看时直接获取相关购买信息。此外,还将探索 AIGC(AI生成内容)短视频技术,包括商品图像+文本生成带货视频、智能剪辑与特效添加、虚拟试穿等,降低电商内容制作成本,提升营销效率。 1、负责对电商场景下的商品内容、视频内容进行理解和可控生成,赋能电商全链路场景,提供优质商品供给、内容供给、商达供给等,建立商品履约视角的商品理解算法体系,为商品履约保驾护航,提升购物体验; 2、基于前沿的AIGC模型能力,帮助降低商家素材制作成本,提升平台优质供给(短视频、图文等),利用NLP、CV、多模态技术,增强对短视频内容、图文、商品理解能力,支持搜索、推荐、商城全导购链路,提升消费者在内容场和货架场购物体验; 3、挖掘电商垂直领域大规模、高质量Pretrain数据集,基于字节跳动通用大模型,研发电商行业大模型,探索电商交互式导购新场景; 4、跟踪AIGC/CV/NLP/多模态/LLM领域的最新研究和技术发展,负责算法模型迭代升级。

更新于 2025-03-04
logo of bytedance
实习A176174

团队介绍:短视频平台算法团队,负责国际化短视频产品的基础推荐算法,加入我们,你能接触到包括用户增长、社交、直播、电商C端、内容创造、内容消费等核心业务场景,直接为核心用户体验负责,支持产品在全球赛道上高速发展。我们的工作内容包括大规模推荐算法的优化、复杂约束的优化问题的解决、多模态大模型的落地探索,推荐大模型的应用研究等多个学术领域的算法改进以及对多种场景的推荐架构的设计和对产品数据的复杂深入的分析。在这里,你可以深入钻研机器学习算法的改进和优化,探索前沿的技术;可以跟来自全球不同国家的团队合作, 感受不同文化的碰撞, 激发认知;可以通过对产品和内容生态的深度分析,影响产品未来的发展方向。 1、探索多模态模型,包括多模态预训练,多模态LLM; 2、将多模态模型应用于图像/视频的生成创作、逻辑推理、深层语义理解、视频语义压缩、视频高光判断等; 3、探索LLM、多模态等的高效Finetuning技术和推理技术,保证模型在业务场景中的快速适配和高效调用; 4、主要研究方向包括:多模态预训练、图片和视频的生成、图片和视频风格迁移、跨模态检索、大模型多标签分类、半监督学习、自监督学习。

更新于 2025-03-04