字节跳动AIGC模型优化实习生-Seed大模型人才实习
任职要求
1、2028届及以后本科及以上学历在读,计算机、软件工程等相关专业优先; 2、精通Python编程语言,熟悉Pytorch、FSDP、DeepSpeed、Megatron等分布式训练框架,有AIGC模型训练/推理优化优先; 3、具备坚实的计算机视觉和自然语言处理基础,熟悉LLM/VL…
工作职责
团队介绍:字节跳动 Seed 团队成立于 2023 年,致力于寻找通用智能的新方法,追求智能上限,为科技和社会发展作出贡献。 Seed 团队在 AI 领域拥有长期愿景与决心,团队研究方向涵盖 MLLM、GenMedia、AI for Science、机器人等,在中国、新加坡、美国等地设有实验室和岗位。目前,团队已推出业界领先的通用大模型以及前沿的多模态能力,支持豆包、即梦、TRAE 等超过 50 个应用场景,并通过火山引擎开放给企业客户。第三方数据显示,豆包 App 用户量在中国市场排名第一,豆包大模型日均 Token 调用量行业领先。 1、参与模型训练/推理优化算法的研究与开发,运用数据并行、模型并行、通信优化等前沿技术,极大提升模型训练/推理速度及效率; 2、开发和优化AI研发场景下的工具和方法,持续改进并行训练/推理模型的框架和策略,以满足公司业务的需求; 3、对业务进行性能瓶颈分析,实施模型训练/推理性能优化措施,提升训练/推理效率,同时利用硬件特性最大化资源效用,并与业界技术进步保持同步。
1. 针对 NPU、GPU 等异构硬件,探索 AIGC 大模型的最优推理方案,开发维护自研 AIGC 推理框架,将 XNet 推理引擎的优化能力赋能业务模型,支持微信视频号及其他业务的部署与持续优化 2. 深入理解 AIGC 大模型,以算法-系统 Co-design 的思路,探索与应用 Cache、稀疏、量化等 Training-free 或需要 Finetune 的优化方案,在保证业务指标的前提下,探索推理优化的边界 3. 持续跟进 AIGC 大模型的发展动态,探索并落地通用推理优化方案,支持新模型的高效上线,并提供模型优化的原子能力,支持算法侧与业务侧的高效接入与调试
Seed 大模型人才校招,是字节跳动 Seed 面向高校人才推出的招聘项目。我们始终相信,真正重要的技术进步来自对高难度问题的持续挑战。面对 AI 时代的巨大机遇,Seed 团队并不止步于模型迭代,而是选择进入技术深水区,推进下一代 AI 范式突破,不断探索智能的边界与上限。 团队介绍:字节跳动 Seed 团队成立于 2023 年,致力于寻找通用智能的新方法,追求智能上限,为科技和社会发展作出贡献。 Seed 团队在 AI 领域拥有长期愿景与决心,团队研究方向涵盖 MLLM、GenMedia、AI for Science、机器人等,在中国、新加坡、美国等地设有实验室和岗位。目前,团队已推出业界领先的通用大模型以及前沿的多模态能力,支持豆包、即梦、TRAE 等超过 50 个应用场景,并通过火山引擎开放给企业客户。第三方数据显示,豆包 App 用户量在中国市场排名第一,豆包大模型日均 Token 调用量行业领先。 1、负责AIGC基础模型相关技术的研究和开发,优化豆包AI创作效果,包括图像模型、Agent模型等; 2、向字节跳动内部产品提供基础模型及相关应用的支持; 3、探索以大模型能力为核心的AI创作新产品。
1.负责图像、视频、3D或音频等某一AIGC方向的产品规划与全生命周期管理; 2.深度洞察用户需求与技术趋势,定义具有竞争力的产品能力矩阵和发展路线图; 3.建立科学的模型评估与迭代机制,确保产品效果的持续领先; 4.协调内外部资源,推动产品从概念到上线、优化及商业化落地的全过程。
1、负责千问多模态大模型(文本/视觉/语音/Agent对话)的效果建设与质量把控,深度参与Post-train全环节,从效果理想态定义、评估标准设计到迭代策略输出,用设计专业视角指导模型效果方向; 2、主导模型训练的数据全流程管理,包含多模态数据源策划、标注标签体系设计、精品数据构造与配比调优,驱动模型在美感、指令遵循、对话自然度、多模态一致性等核心维度持续突破; 3、建立系统化的多模态效果评价体系与量化方案,负责模型过程的敏捷评测,通过深度分析模型规律与负面案例,提炼可落地的优化策略并指导算法迭代; 4、持续跟踪全球AI前沿动态(Gemini、Claude、GPT、Flux、Sora等),结合千问产品场景开展能力前置探索与实验,为模型能力建设提供设计侧的战略输入。