
大模型算法工程师(搜索大模型)-搜索-筋斗云人才计划(北京/上海/杭州/珠海)
- 广东省珠海市
- 长期
- 全职
1、探索大模型与排序算法的结合,提升个性化排序的精度和用户体验;
2、研究生成式检索算法,解决百亿乃至千亿级别候选库的超大规模检索问题;
3、利用大语言模型(LLM)提升复杂多义Query的搜索满意度。1、参与搜索引擎(策略、模型)研发工作,支持抖音/今日头条/电商/番茄小说/红果短剧等具有数亿用户的产品,致力于为数亿用户提供数千亿精准搜索结果,打造极致的搜索体验;
2、探索前沿技术,探索大模型等创新技术在AI搜索场景的落地,参与搜索引擎、搜索大模型的改进,包括而不限于:
1)NLP、大模型:构建大规模高质量数据(数据建设、数据抓取与解析、数据合成等)、分词、NER,文本、多模态预训练、Query分析、基础相关性等,全链路结合应用机器学习/深度学习模型,探索搜索引擎与大模型、LLM、MLLM、多模态、机器学习、强化学习等前沿技术的结合,实现搜索引擎全链路革新并进行极致的系统优化,探索提升AI搜索引擎的能力,包含而不限于相关性、权威性、时效性、意图理解能力等;探索新的自然语言处理算法、信息检索技术、LLM适性索引、LLM相关性、生成式召回、排序大模型等,提高搜索引擎的准确性和智能化程度;
2)召回与排序:借助语义理解、个性化预估、机制设计等技术,解决超大规模的视频、商品、直播、POI等搜索业务下的召回、排序、重混排模型;
3)多模态、跨模态匹配技术:基于海量网页图文、抖音视频数据的大规模多模态预训练和视频分析技术,提升视觉搜索的使用体验;在搜索中结合CV+NLP深度学习技术,实现多模态、视频搜索、强大的语义理解和检索能力;
4)页面分析和摘要:从千亿视频/网页中提取最有价值的信息,进行结构化字段提取、智能摘要生成、转码等工作来优化搜索体验;
5)链接分析:从万亿链接中找出最有价值的网页,优化链接质量、索引质量、垃圾作弊识别、调度策略等。职位要求:1、获得博士学位,计算机、电子、自动化、软件工程、数学等相关专业优先;
2、在搜索、推荐、广告、自然语言处理NLP、自然语言理解NLU、多模态、机器学习、深度学习等一个或多个领域有较深入的研究者优先;
3、熟悉Linux开发环境,熟练使用C++和Python语言;
4、具有良好的问题分析解决能力,沟通协作能力,工作积极主动,能够与团队融洽合作,一起探索新技术,推进技术进步。加分项:
1、具有优秀的基础算法、扎实的机器学习/深度学习基础,熟悉NLP、RL、ML等领域的技术,在KDD、WWW、SIGIR、ICML、ACL、COML、EMNLP、CVPR、ECCV、ICCV、NeurIPS、ICLR等顶级会议/期刊上发表论文者优先;
2、具有优秀的代码能力,熟练掌握C/C++或Python编程语言,ACM/ICPC、NOI/IOl、Top Coder、Kaggle等比赛获奖者优先;