招聘城市:北京,上海
…算法对于核心引擎或者基础平台的功能需求
2、抽象通用的业务开发框架与组件,提升业务支持效率,将现有技术逐步平台化和产品化
3、参与搜索引擎、推荐引擎、模型预测、向量检索等基础系统、平台的设计、研发及调优工作,提升效率降低成本
任职要求:
1、基础功底扎实,精通C/C++、Java等至少一门编程语言,具有良好的编程和工程实现能力
2、参与过大规模系统的设计及研发工作,能承担一线的架构设计或研发工作
3、有丰富的搜索或推荐引擎研发经验,对搜索、推荐、KV、模型预测等任一引擎或调度系统有实际开发经验
4、熟悉开源系统,了解Tair、Redis、Lucene、mesos,K8s,Docker,TensorFlow等任一系统者优先
5、有算法Serving服务开发,算法…
招聘城市:北京,上海,深圳
…算法对于核心引擎或者基础平台的功能需求
2、抽象通用的业务开发框架与组件,提升业务支持效率,将现有技术逐步平台化和产品化
3、参与搜索引擎、推荐引擎、模型预测、向量检索等基础系统、平台的设计、研发及调优工作,提升效率降低成本
任职要求:
1、基础功底扎实,精通C/C++、Java等至少一门编程语言,具有良好的编程和工程实现能力
2、参与过大规模系统的设计及研发工作,能承担一线的架构设计或研发工作
3、有丰富的搜索或推荐引擎研发经验,对搜索、推荐、KV、模型预测等任一引擎或调度系统有实际开发经验
4、熟悉开源系统,了解Tair、Redis、Lucene、mesos,K8s,Docker,TensorFlow等任一系统者优先
5、有算法Serving服务开发,算法…
招聘城市:北京,上海
…限于Diffusion、LLM、VLLM等,提升推理效率,降低大模型应用成本;
2. 负责商业AI算法服务的部署,与投放平台、检索侧的工程化对接,搭建稳定可扩展的算法工程框架,承接所有算法服务;
3. 设计和优化推理架构,确保算法服务的高可用性、稳定性和效率,建立完善的监控告警和故障恢复机制;
4. 打造具有业界一流水平的大模型推理技术能力,并通过开源共建等各类形式,形成在业界的广泛技术影响力。
任职要求:
1. 精通Java/Python,对各种AI算法有一定的了解,有丰富的算法工程集成,并有大模型部署、性能优化和落地经验;
2. 有搜广推相关场景经验,对搜广推任意架构有一定的了解;
3. 深入了解transformers、vllm、sglang、tensorrt…
招聘城市:上海,北京,深圳,杭州
…红书搜推广系统的向量检索引擎架构设计与核心算法研发。
2. 优化大规模向量索引的构建、更新与查询性能,支持千亿索引毫秒级高性能检索。
3. 学习和吸纳业界优秀的技术和理论成果,探索前沿向量检索技术(如混合检索、量化压缩、分布式索引、软硬协同等),并推动技术落地。
4. 与算法、工程、产品团队协作,推动向量检索在搜推广场景的规模化应用。
任职要求:
1. 具备扎实的C/C++语言编程基础,熟悉算法、数据结构、操作系统知识。
2. 熟悉向量检索常见算法与框架(如HNSW/IVF/Scann/DiskAnn,hnswlib/faiss/mlivus等),有大规模向量索引构建与优化经验。
3. 对技术有强烈的好奇心和热情,具备良好的分析和解决问题能力。
4. 有搜推广…
招聘城市:上海,北京
…负责训练系统中关键组件的设计与开发,包括但不限于大规模分布式参数服务器、高性能嵌入向量(Embedding)训练与推理、高效的优化器实现等;
3、深入系统底层,利用高性能网络(如RoCE v2, InfiniBand)、RDMA技术以及NVMe SSD存储,优化数据读取、通信和Checkpoint存储等关键路径,实现极致的端到端训练性能;
4、与算法团队紧密合作,理解前沿模型(如大语言模型、推荐系统、多模态模型)对训练基础设施的需求,并将其转化为系统级的创新与优化;
5、负责GPU/XPU计算资源的精细调度与性能优化,深入挖掘硬件潜力,降低训练成本。
任职要求:
1、优秀的代码能力、数据结构和基础算法功底,熟悉C++开发,理解大规模分布式应用系统和平台…
招聘城市:北京,上海
…落地。
1. 参与搜广推预估链路的架构设计和研发,推动预估链路架构演进,提升算法研发/迭代效率,保障搜广推预估链路整体稳定性。
2. 根据搜广推的特征和样本,构建大规模在离线特征/样本计算引擎,支撑批式/流式场景的特征/样本计算和分析。
3. 能深入理解产品和业务,满足算法与产品在模型工程上的需求,解决搜广推算法工程化的问题,支撑业务快速发展。
4. 分析现有预估链路的不足,定位预估链路瓶颈,提升预估链路整体性能。
任职要求:
1. 计算机及相关专业本科以上学历,1-3年服务端开发工作经验,学习能力强,有高并发,高可用系统设计研发经验。
2. 精通C/C++,具备扎实的系统底层能力(内存、并发…
招聘城市:北京,上海
岗位职责:
【业务介绍】
作为公司统一的模型训练引擎团队,支撑公司内所有搜推广类业务的训练工程侧工作,包括模型训练、参数服务器、特征样本流水线等,通过引擎能力的持续建设结合多元异构算力为业务提供高效、灵活、稳定的搜广推模型服务。
为公司核心的搜广推业务提供关键的模型训练引擎支撑,解决超大规模稀疏特征训练的核心问题,不断挖掘异构硬件算力,为公司搜广推业务增长提供保障,并获得快速的成长与提升。
【岗位职责】
1、负责小红书搜广推业务线的机器学习训练框架的研发与迭代,核心支持公司所有相关业务场景;
2、深入参与分布式训练、自动并行化、参数服务器、特征样本流水线等…
招聘城市:上海
…搜索相关策略迭代与优化,包含但不限于query理解、planning、RAG及推理增强优化、相关性、知识库建立及LLM生成策略 等核心模块
2. 基于开源LLM的多领域CPT、SFT、RL
工作要求:
【任职要求】
1. 熟悉自然语言处理,大模型,知识图谱等多个算法领域有扎实的理论基础和丰富的研发经验
2. 熟练使用一种LLM训练推理框架如verl、ms-swift、llama-factory、vLLM、SGLang等, 并熟悉训推相关的主要技术原理
3. 熟悉 spark 、 hadoop 、 hive、faiss 等大数据处理技术, 了解分布式训练、模型压缩和推理加速相关技术
4. 有搜索算法经验/AI应用优化经验/有知名竞赛获奖经历/主导过有影响力的开源项目/有顶会一作发表论文经验者优先考虑
投递简历
招聘城市:上海
岗位介绍:
职位亮点
1
职位描述
工作职责:
【接受25届毕业生~欢迎1-3年算法经验的同学积极投递】
推荐算法工程师服务于哔哩哔哩主站的内容推荐,包括feed流推荐和相关推荐等场景。我们期望使用机器学习,数据挖掘等手段,提升这些场景的推荐效果。
1.负责推荐核心算法研发,提升用户体验,提高业务转化效率;
2.与产品/运营/数据等相关团队密切合作,驱动推荐业务快速迭代;
3.解决具体场景问题,包括新用户的推荐效果,生态机制,多样性策略等。
工作要求:
【接受25届毕业生~欢迎1-3年算法经验的同学积极投递】
1.计算机相关专业本科及以上学历,1年以上互联网公司机器学习算法研发工作经验,有搜索…
招聘城市:北京,上海,杭州
岗位职责:
1、负责搜推广引擎质量产品的开发,包括不限于引擎服务端测试平台、分级发布拦截能力、可测性工具等方向;
2、能够主导技术方案的架构设计制定迭代路线,参与工具平台开发,并在业务落地拿到结果;
3、推进AI技术在质效领域的应用,负责相关agent实现;
任职要求:
1、计算机相关专业本科以上学历,2年以上开发或测试经验,精通Java/Go/C++/Python任一开发语言;
2、熟悉搜推广引擎架构,有搜推广业务经验优先;
3、有Agent开发、模型微调、指标智能检测等实践经验优先;
4、有较好的协同能力,对外沟通界面好,抽象与总结能力强;
招聘城市:上海,北京
…1. 参与下一代高性能参数服务器(Parameter Server)的架构设计、核心模块开发与持续迭代,以满足大规模稀疏模型在线推理的超低延迟、高吞吐需求。
2. 深入优化参数服务器的通信框架(如BRPC、RDMA)、存储引擎(HBM、MEM、SSD分层存储)、并发模型和负载均衡策略,解决海量参数同步中的瓶颈问题。
3. 与算法团队紧密合作,理解前沿模型(如大语言模型、推荐系统、多模态模型)对训推基础设施的需求,并将其转化为系统级的创新与优化;
4. 跟踪业界前沿技术,探索其在参数服务器中的落地场景,推动平台技术演进。
任职要求:
1. 优秀的代码能力、数据结构和基础算法功底,熟悉C++开发,有分布式系统或高性能计算相关开发经验(存储、并发…
招聘城市:北京,上海,深圳
岗位职责:
1、负责小红书国际化模型样本&特征平台开发,为搜广推算法模型提供高效稳定的学习能力 ;
2、负责小红书国际化搜广推索引传输系统优化和迭代,优化提高系统吞吐、降低延迟、提升迭代效率 ;
3、支持大规模搜广推数据的流式/批量处理 ;
任职要求:
1、计算机相关专业,本科以上学历,两年以上工作经验;
2、扎实的计算机专业基础知识,精通数据结构/算法设计;
3、熟练使用Hadoop、Spark、Hive、Flink等大数据处理框架。有海量数据开发经验者优先;
4、有计算广告、推荐系统、信息检索项目背景经验优先 ;
5、具备较强的团队合作精神和沟通能力,能够与不同领域的人员进行有效的沟通和协作。
6、有海外系统建设经验…
招聘城市:上海
…负责推搜场景下的AI应用研发,将大模型能力落地到策略迭代、内容理解等核心链路,覆盖RAG、Agent、Function Calling等方向;
2. 作为团队AI Coding的先行者,深度探索并落地AI辅助编程工具(Cursor、GitHub Copilot等)在业务开发、代码重构、数据处理等场景的应用,总结并推广可复用的实战方法论;
3. 负责推搜业务场景下大模型所需的数据开发工作,包括SFT/偏好数据的构建、清洗与质量评估,搭建可复用的数据处理Pipeline,支撑模型微调与效果迭代;
4. 利用大模型能力提升数据处理效率,探索LLM辅助数据标注、数据增强、质量筛选等自动化方案,推动数据飞轮的建立;
5. 主导制定AI应用与数据工程的开发规范,通过Code Review和技术…
招聘城市:深圳
…推理框架,如vllm,sglang,tensorrt-llm,FasterFransformer等优先;
6.熟悉并行策略,如模型并行、流水线并行等,了解NVLINK、GPU通信者优先;
7.具备GPU、AI芯片体系结构知识,熟悉芯片特性,具备系统性能分析和调优经验优先。
加分项:
1.机器学习或者体系结构相关顶会论文;
2.参与vllm、sglang等开源项目贡献者;
岗位介绍:
在腾讯,后台开发工程师不仅是“又快又稳”的问题解决专家,更是生态共创者。你将与技术团队一同沉淀优质代码,让它成为我们共有的宝贵资产。在不同的业务场景和技术发展阶段,你的架构思维也将帮助更多协作团队拓展新的思考。我们也珍视你的挑战精神,同时欢迎你一起参与团队愿景、文化和产品方向的探讨。
招聘城市:北京
岗位职责:
1.参与RAG搜索引擎的建设,包括在线检索、索引构建、服务运营等模块;
2.承担搜索引擎中功能需求迭代、性能优化、存储优化等工作;
3.工作方向包括:向量&倒排召回、磁盘索引、实时索引、运营系统建设等。
岗位要求:
1.具备扎实的计算机基础,有C++、Python 开发能力,良好的代码结构设计与开发能力;
2.熟悉搜索引擎,对倒排&向量召回有清晰的认识,熟悉常用的向量召回算法;
3.具备良好的后台开发基础,对高并发服务、分布式系统、性能优化有一定了解;
4.具备推荐、搜索、广告领域引擎开发和运营经验优先,具备深度参与向量召回引擎建设经验优先。
招聘城市:北京
…开发能力 ;
2.精通C++/Python,具备高性能编程与系统调优能力(如内存管理、锁优化、分布式一致性协议),有大规模集群(千级节点)运维经验者优先 ;
3.对向量召回算法(如HNSW、SCANN)与近似最近邻搜索有实战经验,熟悉量化、剪枝等加速技术,具备算法侧与工程侧的联合调优能力。
岗位介绍:
在腾讯,后台开发工程师不仅是“又快又稳”的问题解决专家,更是生态共创者。你将与技术团队一同沉淀优质代码,让它成为我们共有的宝贵资产。在不同的业务场景和技术发展阶段,你的架构思维也将帮助更多协作团队拓展新的思考。我们也珍视你的挑战精神,同时欢迎你一起参与团队愿景、文化和产品方向…
招聘城市:深圳
岗位职责:
1.负责微信搜一搜搜索推荐看后推方向整体算法技术,担任方向owner;
2.通过技术优化,不断提升产品效果,提升产品使用率,实现业务目标;
3.工作内容包括并不限于技术规划、case分析、数据挖掘、特征工程、模型开发、召回策略、排序策略,确保算法的有效性和创新性。
岗位要求:
1.硕士及以上学历,计算机科学、统计学、数学或相关专业,5年以上相关工作经验;
2.有离线大数据处理、在线c++开发、深度模型开发经验,能够独立完成相关任务;
3.对NLP、数据挖掘、深度学习一项或多项有深入的理解和应用经验,具备扎实的理论基础;
4.熟悉推荐系统及常用推荐算法;
5.有搜索推荐或视频/文章看后推应用经验最佳。
岗位介绍…
招聘城市:北京,上海
…服务。主导SOTA推理引擎的架构设计与核心模块开发,支撑搜广推业务在长序列建模、生成式推荐、Agent等前沿场景在GPU,XPU等异构计算部件上规模落地。
1. 参与推理引擎的架构设计与核心模块的开发。持续优化推理基础设施:特征DSL编译引擎、服务化推理框架,实现性能提升。
2. 优化搜广推、长序列、多模态、MoE等深度学习模型的推理效率,将各场景的推理性能优化到极致。
3. 针对GPU/NPU等异构计算芯片,探索片内多部件并行流水线等前沿技术,构建业界影响力。
任职要求:
1. 计算机及相关专业本科以上学历,3年以上高性能系统或AI Infra研发经验。
2. 精通C/C++/CUDA/AscendC/TopsCC,具备扎实的系统底层能力(内存…
招聘城市:北京
…编程,如CUDA,OpenCL,Ascend C等,熟悉cutlass等加速库是加分项;
3.熟悉主流大模型推理框架,如vllm,sglang,tensorrt-llm,FasterFransformer等;
4.熟悉各类深度学习网络和算子底层实现细节,训练和推理模型调试、调优有实操经验优先;
5.熟悉并行策略,如模型并行、流水线并行等,了解NVLINK、GPU通信者优先;
6.具备GPU、AI芯片体系结构知识,熟悉芯片特性,具备系统性能分析和调优经验优先;
7.加分项:;
8.机器学习或者体系结构相关顶会论文;
9.参与vllm、sglang等开源项目贡献者;
10.熟悉推理服务框架,具备服务部署经验者优先,有超大模型分布式部署经验优先。
岗位介绍:
在腾讯,后台开发工程师不仅是“又快又稳”的问题解决专家,更是生态共创者…
招聘城市:上海
…多目标搜推模型的分布式训练框架设计,提升训练效率和稳定性;
✧设计支撑毫秒级延迟、高QPS的在线推理服务架构,满足社区实时搜推需求;
✧突破超大Embedding表的存储/更新/检索技术瓶颈,优化存储和计算效率;
✧优化GPU多卡/多机训练和推理的可扩展性,支持超长行为序列建模和参数scaling up的持续迭代;
搜推工程团队致力于构建下一代智能内容分发系统,让用户发现更多“感兴趣”的内容。加入我们,用技术创造快乐,一起构建支撑亿万年轻人内容消费的智能引擎,在B站实现你的技术理想。
工作要求:
✓计算机相关专业本科及以上学历,具备扎实的C++/Python编程功底;
✓有大规模搜广推模型…