logo of tencent

腾讯混元数据算法工程师(北京)

社招全职2年以上AI技术地点:深圳状态:招聘

任职要求


1.硕士及以上学历计算机视觉自然语言处理或多模态方向背景优先;
2.熟练掌握深度学习框架(如PyTorchTensorFlow),熟悉模型训练及数据处理经验,具备优秀的独立开发与分析调研能力;
3.具备良好的团队协作能力,具备强烈的自我驱动力,能够独立完成系统分析与优化,落地大模型应用;
4.加分项:对多模态生成大模型有深入理解,对数据敏感具备较强的数据洞察与分析能力。

加分项
1.熟练掌握HiveSQL、SparkRay等至少两种数据分析及处理工具;
2.有大模型训练或数据相关工作经验者优先。

工作职责


1.数据特征算法:负责海量文本&多模态数据(图像,视频,音频,3D)的内容理解(如分类标签体系、embedding表征、Caption生成等),质量检测(低质识别检测、优质美学评价等),去重/聚类分析,数据合成等算法;
2.数据pipeline建设:负责数据采集、筛选清洗、标注与质量评估pipeline的建设。与模型业务团队紧密配合,充分分析挖掘数据资源,建立自动化数据处理流程与机制,支持模型持续迭代;
3.数据实验分析:对模型训练数据进行详细分析,建立科学数据实验机制,识别样本不足、质量问题、配比不均衡等潜在问题,驱动数据优化提升数据覆盖、质量、多样性需求,最终带来大模型生成效果的持续提升。
包括英文材料
NLP+
Python+
机器学习+
数据科学+
学历+
Spark+
Ray+
数据分析+
大模型+
OpenCV+
深度学习+
PyTorch+
TensorFlow+
相关职位

logo of tencent
社招TEG技术

1.基于大模型训练对于数据的需求进行互联网数据抓取,对提供给大模型训练/搜索等场景的语料进行清洗,提升语料纯度; 2.建设对标业内前沿的大模型训练数据集和数据清洗能力,提升数据质量和多样性,并验证数据价值和效果。

更新于 2025-06-18
logo of tencent
社招TEG技术

1.参与LLM、多模态大模型压缩加速方案研究,包括投机采样、稀疏化、量化和蒸馏等方法; 2.设计可落地的大模型压缩算法及成本优化方案,助力大模型的性能加速; 3.分析业务性能瓶颈和模型特点,定制化开发大模型压缩优化工具,实现高速推理方案。

更新于 2025-05-26
logo of tencent
社招3年以上AI技术

1.负责TTS、ASR、声学前处理、自然语言处理、多模态大模型等AI系统的工程开发(包括训练工具和推理引擎的开发、优化、交付等); 2.负责AI系统最新算法的集成、工程化、实际场景效果验证、优化、上线; 3.负责AI相关业务、产品的工程支持,在效果和性能上更好的落地。

更新于 2025-09-12
logo of tencent
社招混元-模型算法技

1.负责大语言模型(LLM)代码理解和生成相关的技术研究,提升大模型的代码基础能力; 2.跟进大模型代码领域的前沿技术,将其应用于研发生产中,持续提升大模型的代码能力; 3.负责大模型的代码相关的数据构建、训练调优及评测迭代,推进大模型技术在代码补全,Text2SQL,代码问答,代码Agent等业务场景落地。

更新于 2025-06-26