logo of bytedance

字节跳动多模态大模型推理算子优化实习生-Data AML

实习兼职A121852地点:北京状态:招聘

任职要求


1、2027届硕士及以上学位在读;
2、实习时间6个月及以上,每周到岗不小于4天;
3、了解GPU或NPU的硬件架构,掌握至少一种推理优化软件栈,有高质…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


ByteIntern:面向2027届毕业生(2026年9月-2027年8月期间毕业),为符合岗位要求的同学提供转正机会。
团队介绍:Data AML是字节跳动的机器学习中台,为抖音/今日头条/西瓜视频等业务提供推荐/广告/CV/语音/NLP的训练和推理系统。为公司内业务部门提供强大的机器学习算力,并在这些业务的问题上研究一些具有通用性和创新性的算法。同时,也通过火山引擎将一些机器学习/推荐系统的核心能力提供给外部企业客户。

1、深度参与业界先进开源LLM/VLM模型的推理优化部署,构建业界领先的模型推理优化能力;
2、负责完善不同芯片的推理适配和优化技术体系,提升大模型x芯片类型矩阵的适配与优化效率;
3、负责新型异构芯片在多种大模型上的分析评估工作;
4、负责前沿技术的调研评估和引进落地,例如前沿论文中的推理加速技术、软硬协同优化、新异构硬件特性等。
包括英文材料
学历+
GitHub+
相关职位

logo of tencent
社招2年以上TEG公共技术

1.负责通用多模态大模型的推理部署,包括多模态理解、生成、语音大模型等研发支持,推动算法落地; 2.多模态大模型性能优化及推理框架优化,提升整体吞吐、降低部署成本;提升框架易用性; 3.紧跟多模态生成和理解领域的技术前沿,推动技术创新在产品中落地; 4.针对落地业务,优化部署方案及适配定制化需求。

更新于 2026-06-08深圳
logo of bytedance
实习A58356

团队介绍:字节跳动 Seed 团队成立于 2023 年,致力于寻找通用智能的新方法,追求智能上限,为科技和社会发展作出贡献。 Seed 团队在 AI 领域拥有长期愿景与决心,团队研究方向涵盖 MLLM、GenMedia、AI for Science、机器人等,在中国、新加坡、美国等地设有实验室和岗位。目前,团队已推出业界领先的通用大模型以及前沿的多模态能力,支持豆包、即梦、TRAE 等超过 50 个应用场景,并通过火山引擎开放给企业客户。第三方数据显示,豆包 App 用户量在中国市场排名第一,豆包大模型日均 Token 调用量行业领先。 1、负责音视频多模态场景大模型推理的性能优化,开发和优化多模态场景的推理系统,确保离在线推理性能达到业界领先水平; 2、与算法同学深度合作,开展算法与训推系统的联合深度优化,支撑部门前沿技术的探索及落地; 3、负责机器学习系统前瞻技术的调研与引入,持续提升部门关键技术竞争力,涵盖高性能推理框架、模型压缩等方向。

更新于 2026-03-30北京
logo of alibaba
实习阿里巴巴2027

1、分布式推理架构的研发,包括多机推理架构设计,P/D分离、A/F分离、VL模型分离架构的落地; 2、推理引擎服务化,包括推理引擎如何接入线上服务平台,自动扩缩容和可观测性的适配,以及提升线上服务稳定性; 3、多模态模型的推理功能开发和性能优化,包括对Qwen-VL、Qwen-Audio、Qwen-Omni等多模态输入/输出模型的功能支持和推理性能优化; 4、分布式 KV Cache Store 的设计与研发,构建高吞吐、低延迟的全局 KV Cache 池化管理机制,实现跨计算节点(显存/内存)的高效数据传输与共享。

更新于 2026-03-23北京|杭州|上海