logo of tencent

腾讯混元大模型数据开发工程师

社招全职3年以上TEG技术地点:深圳状态:招聘

任职要求


1.技术要求​:精通Python/Go及DrissionPage,feapder,scrapy,crawlab等;
2.本科及以上学历,3年以上数据采集经验,熟悉大模型数据规范,掌握爬虫所需要的各类型技术,有千万级数据系统建设经验;
3.​综合素质​:逻辑严谨,数据敏感度高,具备跨团队协作能力,适应快节奏研发。

工作职责


1.负责多种模态数据(文本/图像/视频/3D模型)采集方案设计与实施;
2.通过爬虫技术获取各类数据,开发分布式采集系统,优化效率与质量;
3.联合算法团队制定数据标准,建立数据治理体系,提升训练数据可用性。
包括英文材料
Python+
Go+
学历+
大模型+
相关职位

logo of tencent
社招2年以上AI技术

1.负责大模型公共支撑体系的平台建设,为大模型数据高效交付提供平台能力支持; 2.负责大模型评测、数据标注、数据管理及现网运营的平台研发,构建全面的系统化支撑能力; 3.深入分析发掘各项流程环节的瓶颈,推动流程完善,通过平台建设系统优化落地; 4.负责现网问题响应,进行故障排查和保障平台质量,优化平台各节点性能,提升运营效率。

更新于 2025-07-03
logo of tencent
社招TEG技术

1.设计和开发大规模预训练数据处理pipeline,为模型预训练提供稳定、可靠的高质量数据处理能力; 2.根据大模型训练数据特点,抽象并开发高效、可靠的数据加工框架,提升处理数据的工程效率; 3.建设对标业内前沿的大模型训练数据集,提升数据质量和多样性,并验证数据价值和效果。

更新于 2025-06-17
logo of tencent
社招1年以上AI技术

1.负责大模型公共支撑平台的AI能力体系建设,建设模型数据生命周期的AI In The Loop协同框架; 2.负责数据评测/标注平台的AI能力建设,包括不限于AI辅标、数据质检、自动化评测等能力建设; 3.建设算子库设计构建Agent,开发Reward Model模型和建设评估体系,提升质检等场景的准确性。

更新于 2025-07-03
logo of tencent
社招TEG技术

1.负责大模型语音模态的设计、开发和优化,包括但不限于语音/音频数据清洗、模型设计、训练策略等方面的研究与应用; 2.参与语音识别、语音合成、声音克隆等相关大模型语音模态能力的建设,提高跨模态整体效果。

更新于 2025-06-10