logo of aliyun

阿里云研究型实习生-多模态大模型软硬协同优化

实习兼职阿里云研究型实习生地点:杭州状态:招聘

任职要求


1、博士在读,且发表过一篇以上的AI类CCF-A会议的文章;
2、熟悉AI深度学习大模型原理和技术栈,有清晰的理解和认系统性的认知,熟悉AI部署和推理流程,hands-on操作过大模型的部署和性能分析,具备独立工程研发、性…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


1、负责研究AI大模型的推理性能优化算法,优化大模型推理部署的算力和访存瓶颈,提升AI模型在GPU、AI加速器等硬件上部署性能效率,推动大模型普惠应用和高性价比的竞争力;
2、负责高性能软硬结合的大模型推理优化方法研究,在AI类业务场景尤其是大模型场景下,通过结合模型算法和硬件来充分挖掘软硬件协同的组合优化潜力,带来高价值的性能和成本优势;
3、负责研发业界SOTA的多模态大模型计算性能优化方法创新,增强技术壁垒,并在云的商业业务中产生核心价值。
包括英文材料
深度学习+
大模型+
相关职位

logo of antgroup
实习研究型实习生

研究领域: 人工智能 项目简介: 本课题面向典型大模型(dense、MoE)进行软硬协同、算子级深入优化,算子包括计算、通信、访存等。 背景: 1. 大模型和搜推模型推理需求: 大模型长序列和Tab3推荐模型增长迅速,前者迈向MoE千~万亿参数,推荐模型增长到数百GB。 - 需求背后存在计算密集、访存密集和多卡推理的通信瓶颈。例如在LLM prefill阶段和多模态模型通常计算密集;LLM decode阶段和搜推模型通常访存密集。 2. 算力阉割:主流NV卡算力大幅阉割,应对以上需求存在较大技术挑战。业界针对模型也不断有算子的深入优化例如FlashAttn系列,FlashMLA,SageAttn等,包括量化、稀疏的算子。

北京|杭州
logo of bytedance
实习A55522A

ByteIntern:面向2027届毕业生(2026年9月-2027届8月期间毕业),为符合岗位要求的同学提供转正机会。 团队介绍:字节跳动基础设施数据库团队,是支撑集团业务的核心技术底座之一。我们管理着业界超大规模的数据库集群,承载了抖音、豆包大模型、今日头条、电商、飞书等核心业务的万亿级流量。从海量并发的事务处理到极致复杂的实时分析,我们直面全球最严苛的技术挑战,同时通过火山引擎为众多企业客户提供具备企业级稳定性的全栈数据库服务。团队基于自研技术栈,打造了涵盖关系型数据库、NoSQL 数据库、多模数据库、大规模图计算平台、多模态检索、云原生中间件的完整数据库产品矩阵。我们践行 “务实浪漫” 的极客文化,不仅在 VLDB、SIGMOD、ICDE 等顶级会议持续输出突破性成果,更将极致的性能优化与软硬协同技术落地于实际生产环境,引领数据库技术迈向云原生新纪元。AI 时代,我们践行 “勇攀高峰”,正致力于构建 Agent-First 的新一代数据架构,打破模型与数据的边界,赋予数据库在智能体生态中主动感知、推理辅助与复杂记忆管理的核心能力。我们的研发团队分布于国内/海外多地,汇聚了行业顶尖的数据库专家,与全球顶尖高校、研究机构深度合作,潜心打磨数据库技术。现诚邀具备数据库内核研发经验、分布式系统架构能力及 AI 创新视野的顶尖极客,携手探索技术无人区,定义 AI 时代的数据基座,赋能全球企业实现 AI 驱动的业务变革。 1、参与火山云数据库产品(关系型/NoSQL/NewSQL/数据库生态工具等)的全生命周期管理,包括市场调研、需求分析、产品规划与产品路径图制定; 2、参与数据库核心功能设计,打造业界领先的云原生数据库和AI数据库产品; 3、联动销售、售前团队,提供产品培训与支持,收集市场反馈与产品动态,优化产品策略,提升产品市场竞争力; 4、协同研发团队明确技术方案,跟进开发进度,参与测试验收,确保产品功能符合设计预期,推动版本迭代与问题优化; 5、关注数据库领域技术趋势(如AI in DB、云原生等),结合业务需求规划产品创新方向。

更新于 2026-03-31成都
logo of bytedance
实习A33906B

ByteIntern:面向2027届毕业生(2026年9月-2027届8月期间毕业),为符合岗位要求的同学提供转正机会。 团队介绍:字节跳动基础设施数据库团队,是支撑集团业务的核心技术底座之一。我们管理着业界超大规模的数据库集群,承载了抖音、豆包大模型、今日头条、电商、飞书等核心业务的万亿级流量。从海量并发的事务处理到极致复杂的实时分析,我们直面全球最严苛的技术挑战,同时通过火山引擎为众多企业客户提供具备企业级稳定性的全栈数据库服务。团队基于自研技术栈,打造了涵盖关系型数据库、NoSQL 数据库、多模数据库、大规模图计算平台、多模态检索、云原生中间件的完整数据库产品矩阵。我们践行 “务实浪漫” 的极客文化,不仅在 VLDB、SIGMOD、ICDE 等顶级会议持续输出突破性成果,更将极致的性能优化与软硬协同技术落地于实际生产环境,引领数据库技术迈向云原生新纪元。AI 时代,我们践行 “勇攀高峰”,正致力于构建 Agent-First 的新一代数据架构,打破模型与数据的边界,赋予数据库在智能体生态中主动感知、推理辅助与复杂记忆管理的核心能力。我们的研发团队分布于国内/海外多地,汇聚了行业顶尖的数据库专家,与全球顶尖高校、研究机构深度合作,潜心打磨数据库技术。现诚邀具备数据库内核研发经验、分布式系统架构能力及 AI 创新视野的顶尖极客,携手探索技术无人区,定义 AI 时代的数据基座,赋能全球企业实现 AI 驱动的业务变革。 1、参与火山云数据库产品(关系型/NoSQL/NewSQL/数据库生态工具等)的全生命周期管理,包括市场调研、需求分析、产品规划与产品路径图制定; 2、参与数据库核心功能设计,打造业界领先的云原生数据库和AI数据库产品; 3、联动销售、售前团队,提供产品培训与支持,收集市场反馈与产品动态,优化产品策略,提升产品市场竞争力; 4、协同研发团队明确技术方案,跟进开发进度,参与测试验收,确保产品功能符合设计预期,推动版本迭代与问题优化; 5、关注数据库领域技术趋势(如AI in DB、云原生等),结合业务需求规划产品创新方向。

更新于 2026-03-31北京
logo of xiaohongshu
社招3年以上机器学习平台

【业务介绍】 作为公司统一的机器学习平台团队,负责调度公司所有模型训练与推理资源;基于自建的训推引擎,构建公司统一的机器学习平台,为公司所有算法同学(稀疏 & 稠密,含 LLM) 模型迭代提供端到端的一站式服务;包括 数据生产,模型训练,模型上线,特征管理,模型测试,资源管控等一系列能力。 【岗位职责】 1、负责机器学习链路,离在线数据相关的开发工作,包括样本数据、特征数据等的数据链路搭建、任务运维和调优、性能优化等 2、负责小红书大规模机器学习平台的后台系统设计和开发工作;包括样本平台,特征平台,训练平台,推理平台等AI应用后台建设等; 3、研究分析业内AI平台产品,优化技术方案,改进产品功能,完善产品体验。

上海