【百度】视觉搜索产品实习生（J80952）

实习A07393

日常实习：面向全体在校生，为符合岗位要求的同学提供为期3个月及以上的项目实践机会。团队介绍：Data AML是字节跳动公司的机器学习中台，为抖音/今日头条/西瓜视频等业务提供推荐/广告/CV/语音/NLP的训练和推理系统。为公司内业务部门提供强大的机器学习算力，并在这些业务的问题上研究一些具有通用性和创新性的算法。同时，也通过火山引擎将一些机器学习/推荐系统的核心能力提供给外部企业客户。此外，AML还在AI for Science，科学计算等领域做一些前沿研究。 1、参与AI搜索和知识管理相关的工具产品建设与迭代； 2、建立和管理用户社群，组织用户交流活动，通过用户调研、产品调研、数据分析等方式了解和挖掘客户需求，产出需求文档； 3、负责产品使用培训，为用户提供支持，确保用户能够高效使用产品； 4、跟踪新功能的上线效果、用户反馈，为进一步优化打磨提供合理建议。

更新于 2025-07-02深圳

AI搜索产品实习生-Data AML

实习A236857A

日常实习：面向全体在校生，为符合岗位要求的同学提供为期3个月及以上的项目实践机会。团队介绍：AML是字节跳动公司的机器学习中台，为抖音/今日头条/西瓜视频等业务提供推荐/广告/CV/语音/NLP的训练和推理系统。为公司内业务部门提供强大的机器学习算力，并在这些业务的问题上研究一些具有通用性和创新性的算法。 1、参与AI搜索和知识管理相关的工具产品建设与迭代； 2、建立和管理用户社群，组织用户交流活动，通过用户调研、产品调研、数据分析等方式了解和挖掘客户需求，产出需求文档； 3、负责产品使用培训，为用户提供支持，确保用户能够高效使用产品； 4、跟踪新功能的上线效果、用户反馈，为进一步优化打磨提供合理建议。

更新于 2025-05-22北京

AI搜索算法实习生-搜索-筋斗云人才计划（北京/上海/杭州/珠海）

实习A147566A

团队介绍：字节跳动搜索团队主要负责抖音、今日头条、西瓜视频等产品的搜索工程、算法创新和架构研发工作。我们的职责是用前沿的技术去打造一个用户体验佳、信息效率高的搜索引擎产品。我们的愿景是做一款用户首选的搜索引擎，我们的使命是可以充分整合内容，高效连接人与信息。团队主要负责抖音、今日头条、西瓜视频、问答和百科等产品的业务研发和架构研发工作。我们使用前沿的前端、客户端和服务端技术赋能于搜索业务的快速迭代，并在技术上不断创新和突破。同时专注于大流量、高并发、低延时的搜索系统的构建，在性能优化上，追求从内存、Disk等优化到业务架构和网络协议的创新探索，在迭代效能上不断探索容器化、动态化、搭建化等方案的创新，技术氛围强，充分给同学们提供自我成长的机会。 1、参与ByteDance搜索引擎研发工作，用前沿的机器学习深度学习算法、海量的数据，做激动人心的技术、给用户更好的搜索体验； 2、参与抖音/电商/生活服务等核心产品的搜索研发工作，致力于为数亿用户提供数千亿精准搜索结果，打造极致的搜索体验； 3、参与搜索核心算法改进，可选的方向包括：（1）NLP：利用LLM等技术，研发新的自然语言处理算法和信息检索技术，提高搜索引擎的准确性和智能化程度。（2）召回与排序：借助语义理解、个性化预估、机制设计等技术，解决超大规模的视频、商品、直播、POI等搜索业务下的召回、排序、重混排模型；（3）多模态：基于海量网页图文、抖音视频数据的大规模多模态预训练和视频分析技术，提升视觉搜索的使用体验；（4）页面分析和摘要：从千亿视频/网页中提取最有价值的信息，进行结构化字段提取、智能摘要生成、转码等工作来优化搜索体验；（5）链接分析：从万亿链接中找出最有价值的网页，优化链接质量、索引质量、垃圾作弊识别、调度策略等。课题介绍：随着大模型技术的快速发展，智能搜索领域迎来了新的机遇和挑战。传统搜索技术在面对海量数据、多模态信息以及用户复杂需求时，逐渐暴露出模型容量不足、语义理解能力有限、资源利用率低等问题。基于大模型的智能搜索构建旨在通过引入大模型技术，提升搜索系统的智能化水平，优化用户体验，并解决超大规模检索、复杂语义理解、资源高效利用等核心问题。具体目标包括： 1、探索大模型与排序算法的结合，提升个性化排序的精度和用户体验； 2、研究生成式检索算法，解决百亿乃至千亿级别候选库的超大规模检索问题； 3、利用大语言模型（LLM）提升复杂多义Query的搜索满意度； 4、构建高性能、低资源消耗的大规模批流一体检索和计算系统，提升资源利用率。 1、个性化排序：传统排序算法难以充分利用多模态信息（如文本、图像、视频等），且模型复杂度有限，无法满足用户对精准化和个性化搜索的需求； 2、超大规模检索：传统判别式模型在千亿级别候选库的检索中，面临模型容量不足、索引效率低下等问题，亟需新一代检索算法； 3、复杂Query理解：用户搜索需求日益复杂，传统搜索引擎难以准确理解长难句、多义Query的语义，导致搜索结果满意度低； 4、资源利用率：搜索系统存储和计算分离的架构导致资源利用率低，如何在保证性能的同时优化资源使用成为关键问题。

更新于 2025-04-21珠海

AI搜索算法实习生-搜索-筋斗云人才计划（北京/上海/杭州/珠海）

实习A227555

团队介绍：字节跳动搜索团队主要负责抖音、今日头条、西瓜视频等产品的搜索工程、算法创新和架构研发工作。我们的职责是用前沿的技术去打造一个用户体验佳、信息效率高的搜索引擎产品。我们的愿景是做一款用户首选的搜索引擎，我们的使命是可以充分整合内容，高效连接人与信息。团队主要负责抖音、今日头条、西瓜视频、问答和百科等产品的业务研发和架构研发工作。我们使用前沿的前端、客户端和服务端技术赋能于搜索业务的快速迭代，并在技术上不断创新和突破。同时专注于大流量、高并发、低延时的搜索系统的构建，在性能优化上，追求从内存、Disk等优化到业务架构和网络协议的创新探索，在迭代效能上不断探索容器化、动态化、搭建化等方案的创新，技术氛围强，充分给同学们提供自我成长的机会。 1、参与ByteDance搜索引擎研发工作，用前沿的机器学习深度学习算法、海量的数据，做激动人心的技术、给用户更好的搜索体验； 2、参与抖音/电商/生活服务等核心产品的搜索研发工作，致力于为数亿用户提供数千亿精准搜索结果，打造极致的搜索体验； 3、参与搜索核心算法改进，可选的方向包括：（1）NLP：利用LLM等技术，研发新的自然语言处理算法和信息检索技术，提高搜索引擎的准确性和智能化程度。（2）召回与排序：借助语义理解、个性化预估、机制设计等技术，解决超大规模的视频、商品、直播、POI等搜索业务下的召回、排序、重混排模型；（3）多模态：基于海量网页图文、抖音视频数据的大规模多模态预训练和视频分析技术，提升视觉搜索的使用体验；（4）页面分析和摘要：从千亿视频/网页中提取最有价值的信息，进行结构化字段提取、智能摘要生成、转码等工作来优化搜索体验；（5）链接分析：从万亿链接中找出最有价值的网页，优化链接质量、索引质量、垃圾作弊识别、调度策略等。课题介绍：随着大模型技术的快速发展，智能搜索领域迎来了新的机遇和挑战。传统搜索技术在面对海量数据、多模态信息以及用户复杂需求时，逐渐暴露出模型容量不足、语义理解能力有限、资源利用率低等问题。基于大模型的智能搜索构建旨在通过引入大模型技术，提升搜索系统的智能化水平，优化用户体验，并解决超大规模检索、复杂语义理解、资源高效利用等核心问题。具体目标包括： 1、探索大模型与排序算法的结合，提升个性化排序的精度和用户体验； 2、研究生成式检索算法，解决百亿乃至千亿级别候选库的超大规模检索问题； 3、利用大语言模型（LLM）提升复杂多义Query的搜索满意度； 4、构建高性能、低资源消耗的大规模批流一体检索和计算系统，提升资源利用率。 1、个性化排序：传统排序算法难以充分利用多模态信息（如文本、图像、视频等），且模型复杂度有限，无法满足用户对精准化和个性化搜索的需求； 2、超大规模检索：传统判别式模型在千亿级别候选库的检索中，面临模型容量不足、索引效率低下等问题，亟需新一代检索算法； 3、复杂Query理解：用户搜索需求日益复杂，传统搜索引擎难以准确理解长难句、多义Query的语义，导致搜索结果满意度低； 4、资源利用率：搜索系统存储和计算分离的架构导致资源利用率低，如何在保证性能的同时优化资源使用成为关键问题。

更新于 2025-04-21杭州

百度视觉搜索产品实习生（J80952）

任职要求

工作职责