logo of bytedance

字节跳动智能计算体系结构与操作系统研究实习生-STE团队-筋斗云人才计划

实习兼职A152842地点:上海状态:招聘

任职要求


1、2026届及之后毕业,博士在读,软件工程、计算机、数学、人工智能相关专业优先;
2、具备优秀的计算机体系结构能力,拥有出色的代码能力、扎实的数据结构和基础算法功底,熟练掌握C/C++Go、Python;
3、熟悉Linux操作系统、内核、网络等领域相关知识,…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


团队介绍:字节跳动STE团队一直致力于操作系统内核与虚拟化,系统基础软件与基础库的构建和性能优化、超大规模数据中心的系统稳定性和可靠性建设、新硬件与软件的协同设计等基础技术领域的研发与工程化落地,具备全面的基础软件工程能力,为字节上层业务保驾护航。

课题介绍:
在当今数字化时代,随着云计算、人工智能和大数据技术的深度融合,现代数据中心正面临着指数级增长的算力需求与现有计算架构效能瓶颈之间的突出矛盾。传统以通用CPU为核心的体系架构在应对多样化负载时,暴露出诸多问题。例如,内存子系统带宽与时延约束导致的 “内存墙” 效应持续加剧,异构计算单元间的数据搬运开销占比超过实际运算时间,安全可信执行环境带来的性能损耗超过 30%,单机柜算力密度提升受限于功耗密度阈值。与此同时,新兴工作负载如AI训练、图计算、时序数据库等呈现出动态异构特征,对计算架构提出了差异化需求,传统固定架构难以实现最优能效比。
操作系统作为计算机体系结构下重要的软件基础设施与核心技术,在这样的背景下也面临着巨大的挑战。随着计算需求的增长和技术的进步,传统的同构计算环境已无法满足日益复杂的计算任务。现代计算场景中,硬件架构呈现高度异构化,包括 CPU、GPU、FPGA、TPU、NPU、DPU 等,同时边缘计算、云计算形成分布式网络。传统操作系统难以高效管理跨节点、跨架构的资源。加之人工智能训练等场景需要低延迟、高吞吐、安全可信,动态弹性的分布式系统支持,这就要求操作系统具备跨异构资源的统一抽象与调度能力。学术界和工业界对下一代计算机操作系统在分布式微内核架构,异构资源调度算法,跨层优化与编译器支持,安全可信技术,虚拟化和 Serverless,AI 驱动操作系统内核优化以及操作系统内置 AI 推理引擎等方面展开了积极的探索和研究。
课题挑战:
方向一:体系化结构方向
1)负载特征与架构优化:建立数据中心动态负载特征建模框架,深入研究面向数据中心Workload的体系结构设计与优化方法,使系统能够更好地适应多样化的负载需求;
2)CPU核心架构创新:研究高性能低功耗CPU核心架构,积极探索超标量流水线与数据流引擎的融合设计,提升CPU的性能和能效;
3)新型内存层次构建:构建支持存算一体化的新型内存层次结构,研究基于3D堆叠技术的近存计算架构,重点突破高带宽互连拓扑优化、混合内存控制器设计、内存访问模式预测算法,解决 “内存墙” 等问题;
4)安全可信架构构建:构建安全可信计算架构,包括侧信道攻击防御的微架构级实现、侧信道安全架构、自动侧 / 隐蔽通道泄漏检测,确保系统在复杂环境下的安全性和完整性;
5)数据中心架构创新:探索整机柜级系统总线扩展,构建内存语义互联的新型数据中心架构,研究基于新型总线协议 (CXL/UALink) 的全局内存共享机制,提升数据中心的整体性能和资源利用率;
6)可靠性增强技术研究:研究可靠性增强技术,包括开发基于机器学习的故障预测模型,设计自修复的微架构容错机制,研究硬件静默故障检测,以及系统及IP可靠性特性研究和数据分析,保障系统的稳定运行。
方向二:操作系统方向
1)操作系统关键技术突破:突破传统单机操作系统存在的硬件资源利用局限、功能扩展与升级运维复杂、数据管理与共享不足、安全性与可靠性欠佳等问题。在计算高度异构以及计算环境分布化的情况下,从硬件到软件建立完整的信任链,保证整个系统的安全性和完整性。同时,有效地管理和协调多个节点间的通信、数据同步及故障恢复,设计高效的调度算法来匹配任务需求与最适合的计算资源,以最大化性能和效率。操作系统需要能够理解不同类型的计算任务,并能根据实时的工作负载动态调整资源分配,实现跨异构资源的统一抽象与调度;
2)跨领域知识融合:本课题需要融合 OS、内核、算法、存储、虚拟化、网络、系统工程等多方面的跨领域知识和经验,以实现数据中心智能计算体系结构与操作系统的协同创新。
包括英文材料
数据结构+
算法+
C+
C+++
还有更多 •••
相关职位

logo of didi
社招技术

算法工程师 1.基于滴滴交通出行业务,构建完整的打车智能化运营策略解决方案,包括但不限于增长策略、定价策略、供需预测、资源分配策略等各类丰富场景; 2.承担网约车业务核心业务指标,使用运筹优化、机器学习、因果推断等技术持续优化超大规模动态双边市场的交易效率。 计算机/应用数学/计量经济学/统计学相关专业,研究生/本科,2023年毕业 编程基础扎实,至少熟悉python/scala/R等编程语言之一 熟悉常用的机器学习与数据挖掘方法 熟悉常用统计理论与分析方法,数理逻辑好,具有一定的数据分析能力 有较强的学习能力和好奇心,自驱性强,具备良好的团队合作和沟通能力 加分项: 1. 有计量经济学/因果推断方向相关背景优先 2. 有运筹优化/收益管理相关背景优先 3. 有深度学习相关背景优先 4. 有SQL、Hadoop、Spark、Hive、TensorFlow相关经验优先

更新于 2025-04-01北京
logo of didi
社招技术

1. 负责滴滴金融保险风险场景的模型设计、建设、开发、应用落地、持续迭代优化,为业务风险指标负责。 2. 拆解业务风险指标,转化为模型指标,并为之设定合理的提升目标 3. 尝试各类特征工程方法,挖掘集团内外部数据,加工生成有效特征,优化模型效果 4. 数据算法创新,了解并跟进业界领先的人工智能和深度学习进展,推动新的技术在风控领域落地

更新于 2025-04-01北京
logo of didi
社招技术

1. 负责万亿级别QPS的分布式缓存/存储集群,支撑公司所有产品线的业务需求; 2. 设计、研发高可用、高性能的缓存/存储架构和中间件,应对弹性扩缩容,秒级故障自动切换,异地多活,分布式事务等极具挑战性的工作内容和方向; 3. 优化系统性能,深入内核,提升基础服务相关资源的使用率,增加系统稳定性,保障业务运行; 4. 设计并研发自动化运维平台,提升运维质量和效率,探索运维自动化和智能化技术和方向。

更新于 2025-04-01北京
logo of ke
社招5年以上用户技术中心

岗位职责: 1、负责 AI Agent 系统的设计、开发和优化、开发和完善基于大语言模型 (LLM) 的智能体系统,提升 Agent 的自主决策和任务执行能力; 2、负责生成式大模型指令意图理解相关工作,整体提升大模型的多轮对话指令理解能力和性能; 3、设计并实现 Agent 的工具使用接口,实现与各类外部系统和 API 的集成编排; 4、负责大模型在检索、推荐方面的系统设计实现和优化,探索Agent、RAG、领域模型调优等相关技术在业务场景落地; 5、具备模型知识、幻觉机制探究,提升模型知识水平、降低模型幻觉率; 6、能够基于开源模型,设计和开发算法,对模型进行微调,优化其参数和结构,以提高模型的泛化能力和准确性; 7、深入调研AI领域相关的前沿技术,跟踪业内大模型领域的最新进展,并寻求将最新技术应用到产品的可能性。

更新于 2025-04-02北京