字节跳动NLP多模态预训练方向实习生-集团信息系统
任职要求
1、2026届本科及以上学历在读,计算机相关专业优先; 2、扎实的算法和数据结构基础,熟练掌握Python/Go/C++等至少一种编程语言; 3、动手能力强,熟悉NLP/CV领域的理论基础,掌握统计模型、机器学习相关原理,具有实战经验,参与过相关项目; 4、学习能力优秀,有良好的团队合作精神,有责任心; 5、熟悉业界领先大语言模型(GPT系列、LLaMA、ChatGLM等)的原理与训练方法,有NLP、计算机视觉、多模态大模型等科研经历或者对LLM有实践应用经历优先; 6、在顶级学术会议(如CVPR、ICCV、ECCV等)发表论文者优先;在Kaggle,COCO,ImageNet,ActivityNet,ICPC,NOI/IOI等比赛获奖者优先。
工作职责
ByteIntern:面向2026届毕业生(2025年9月-2026年8月期间毕业),为符合岗位要求的同学提供转正机会。 团队介绍:集团信息系统部(Corporate Information System)负责字节跳动信息系统建设。通过构建领先的信息系统,助力公司业务和组织的长期高效经营与发展。与此同时,在安全、隐私、合规层面持续治理,为公司的稳健发展保驾护航。字节跳动的员工分布在全球超过120个城市,业务模式复杂,用户规模大。到现在,集团信息系统部已经覆盖人事、财务、法务、采购、审批、职场等多个领域,隐私安全工作同步开展,AIGC创新孵化也在逐步落地实现。 1、负责AI Native应用的算法研发和LLM效果优化工作,推动最前沿技术的探索和应用; 2、探索大语言模型等先进AI技术在字节跳动国际化公司运营的落地,包括领域预训练、指令微调、训练和推理加速、模型评测等技术; 3、提升自然语言理解的能力,比如实体识别、意图识别、NL2SQL,向量召回,结构化/非结构化,短文本/长文本的表征学习等;应用于对话系统、文本生成、文本分类、知识图谱,检索问答等领域; 4、提升多模态识别和理解能力,比如图片、音频、视频等多模态分类、内容挖掘、理解和生成等。
日常实习:面向全体在校生,为符合岗位要求的同学提供为期3个月及以上的项目实践机会。 团队介绍:Data语音团队致力于语音/音频/音乐相关的AI核心技术研发和产品创新。部门支撑音频和多模态内容从生产、编辑到消费的全流程,赋能内容创作和互动,并以中台形式支持集团多个业务,提供业界前沿的技术能力与解决方案。 1、参与研发多模态模型等下一代人工智能核心技术; 2、关注和推进技术在业务场景中的广泛应用,包括但不限于语言、音乐、语音、音频的生成与理解等; 3、深入调研和关注音频/NLP/多模态等方向的前沿技术。
1、基于淘天海量商品数据,打造技术先进的电商多模态大模型,提升对多模态异构的商品数据(图、文、视频等)的理解能力和结构化能力,输出底层算法能力和高质量结构化数据,支撑发布、比货、导购等多种电商业务场景,并面向商家和消费者探索AIGC等创新业务应用。工作内容包括模型结构设计、训练任务设计、预训练和下游能力建设等; 2、 跟踪、探索大模型方向/多模态预训练方向的前沿技术,将各方向的SOTA能力集成到模型底座上,提升下游任务的效果,打造团队的技术先进性。
ByteIntern:面向2026届毕业生(2025年9月-2026年8月期间毕业),为符合岗位要求的同学提供转正机会。 团队介绍:Data语音团队致力于语音/音频/音乐相关的AI核心技术研发和产品创新。部门支撑音频和多模态内容从生产、编辑到消费的全流程,赋能内容创作和互动,并以中台形式支持集团多个业务,提供业界前沿的技术能力与解决方案。 1、参与研发多模态模型等下一代人工智能核心技术; 2、关注和推进技术在业务场景中的广泛应用,包括但不限于语言、音乐、语音、音频的生成与理解等; 3、深入调研和关注音频/NLP/多模态等方向的前沿技术。