logo of bytedance

字节跳动多模态与世界模型算法研究员-Seed大模型人才校招

校招全职A07246A地点:北京状态:招聘

任职要求


1、2027届获得本科及以上学历,计算机、电子、数学等相关专业;
2、在计算机视觉、多模态、AIGC机器学习、渲染生成等一个或多个领域有较深入的研究者;
3、具有出色的分析、解决问题的能力,能深入解决大模型训练、应用存在的问题,有自主探索解决方案的能力者;
4、具有良好的沟通协作能力,工作积极主动,能够与团队融洽合作,一起探索新技术,推进技术进步。

加分项:
1、具有优秀的基础算法、扎实的机器学习基础,熟悉CV、…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


Seed 大模型人才校招,是字节跳动 Seed 面向高校人才推出的招聘项目。我们始终相信,真正重要的技术进步来自对高难度问题的持续挑战。面对 AI 时代的巨大机遇,Seed 团队并不止步于模型迭代,而是选择进入技术深水区,推进下一代 AI 范式突破,不断探索智能的边界与上限。

团队介绍:字节跳动 Seed 团队成立于 2023 年,致力于寻找通用智能的新方法,追求智能上限,为科技和社会发展作出贡献。
Seed 团队在 AI 领域拥有长期愿景与决心,团队研究方向涵盖 MLLM、GenMedia、AI for Science、机器人等,在中国、新加坡、美国等地设有实验室和岗位。目前,团队已推出业界领先的通用大模型以及前沿的多模态能力,支持豆包、即梦、TRAE 等超过 50 个应用场景,并通过火山引擎开放给企业客户。第三方数据显示,豆包 App 用户量在中国市场排名第一,豆包大模型日均 Token 调用量行业领先。
 
1、探索研究多模态理解、生成式、机器学习、强化学习、AIGC、计算机视觉、人工智能等前沿技术;
2、探索大规模/超大规模多模态理解与生成交织的基础模型,并进行极致系统优化;数据建设、指令微调、偏好对齐、模型优化;提升数据合成、Scalable oversight、模型推理、规划能力,构建全面客观准确的评测体系,探索提升大模型能力;
3、探索突破包括而不限于多模态RAG,视觉COT与Agent等在内的多模态模型、世界模型进阶能力,构建GUI/游戏等虚拟世界的通用多模态Agent;
4、探索全模态流式视频理解模型,内容包括但不限于支持无限长序列流式输入,高功能主动响应能力,超低延时推理与响应,全领域实时解说,Learning From Video等
5、利用预训练、仿真等技术对虚拟/现实世界的各类环境进行建模,提供多模态交互探索的基本能力,推动应用落地,研发以人工智能技术为核心的新技术、新产品。
包括英文材料
学历+
OpenCV+
AIGC+
机器学习+
大模型+
算法+
NLP+
CVPR+
ECCV+
还有更多 •••
相关职位

logo of horizon
社招算法序列

1、参与研发下一代端到端自动驾驶系统的研发; 2、参与世界模型的算法研发; 3、负责面向自动驾驶的多模态大模型系统的算法研发;

更新于 2026-01-08北京|上海
logo of alibaba
实习阿里巴巴2027

1. 主导工业级 VLM (视觉语言大模型) 的预训练与 Post-training,利用大模型深入解析商品、品规与复杂 BOM 清单,构建高确定性的柔性供应链知识引擎; 2. 研发 SOTA 级别的 2D/3D 生成式算法 (如 Diffusion, 3DGS, NeRF 变体等),并在非标品定制场景落地,实现从自然语言意图到可制造 3D 资产的分钟级生成; 3. 构建高质量的多模态数据合成流水线与 Reward Modeling 机制,沉淀极致的 Agentic Tools 生态,赋能跨境与内贸的分销调度系统; 4. 将业务突破转化为学术成果,支持在 NeurIPS、ICLR、ICML、ACL、CVPR 等顶会发表高质量论文,或推动相关算法在社区的开源,建立行业影响力。

更新于 2026-03-16杭州
logo of alibaba
实习阿里巴巴2027

1、负责研发大规模世界模型,提升模型对真实世界动态变化的建模能力; 2、研究可规模化的世界模型架构,解决世界模型在长程预测中的物理一致性问题和长期记忆等问题; 3、构建世界模型数据体系,探索世界模型在参数与数据规模上的 Scaling Laws; 4、构建可交互的世界模型系统,并推动技术在实际产品中的落地。

更新于 2026-03-16北京|杭州