腾讯混元大模型数据开发工程师
社招全职3年以上TEG技术地点:深圳状态:招聘
任职要求
1.技术要求:精通Python/Go及DrissionPage,feapder,scrapy,crawlab等; 2.本科及以上学历,3年以上数据采集经验…
登录查看完整任职要求
微信扫码,1秒登录
工作职责
1.负责多种模态数据(文本/图像/视频/3D模型)采集方案设计与实施; 2.通过爬虫技术获取各类数据,开发分布式采集系统,优化效率与质量; 3.联合算法团队制定数据标准,建立数据治理体系,提升训练数据可用性。
包括英文材料
Python+
https://liaoxuefeng.com/books/python/introduction/index.html
中文,免费,零起点,完整示例,基于最新的Python 3版本。
https://www.learnpython.org/
a free interactive Python tutorial for people who want to learn Python, fast.
https://www.youtube.com/watch?v=K5KVEU3aaeQ
Master Python from scratch 🚀 No fluff—just clear, practical coding skills to kickstart your journey!
https://www.youtube.com/watch?v=rfscVS0vtbw
This course will give you a full introduction into all of the core concepts in python.
Go+
https://www.youtube.com/watch?v=8uiZC0l4Ajw
学习Golang的完整教程!从开始到结束不到一个小时,包括如何在Go中构建API的完整演示。没有多余的内容,只有你需要知道的知识。
还有更多 •••
相关职位
社招3年以上AI技术
1.负责大模型全量数据的向量化检索和向量化排重服务,实现实时向量化排重系统; 2.通过向量化检索性能的优化,提升文本排重的准确率和性能; 3.建立大模型数据清洗的反馈机制和反馈系统,提升全网数据抓取效率; 4.参与大模型的数据工程开发,为大模型提供基础数据。
更新于 2025-11-21深圳
社招2年以上AI技术
1.负责大模型公共支撑体系的平台建设,为大模型数据高效交付提供平台能力支持; 2.负责大模型评测、数据标注、数据管理及现网运营的平台研发,构建全面的系统化支撑能力; 3.深入分析发掘各项流程环节的瓶颈,推动流程完善,通过平台建设系统优化落地; 4.负责现网问题响应,进行故障排查和保障平台质量,优化平台各节点性能,提升运营效率。
更新于 2025-07-03深圳
社招TEG技术
1.设计和开发大规模预训练数据处理pipeline,为模型预训练提供稳定、可靠的高质量数据处理能力; 2.根据大模型训练数据特点,抽象并开发高效、可靠的数据加工框架,提升处理数据的工程效率; 3.建设对标业内前沿的大模型训练数据集,提升数据质量和多样性,并验证数据价值和效果。
更新于 2025-06-17深圳