招聘城市:上海,北京,杭州
岗位职责:
1、深度参与小红书社区搜索/推荐业务,满足产品、算法对于核心引擎或者基础平台的功能需求
2、抽象通用的业务开发框架与组件,提升业务支持效率,将现有技术逐步平台化和产品化
3、参与搜索引擎、推荐引擎、模型预测、向量检索等基础系统、平台的设计、研发及调优工作,提升效率降低成本
4. 对搜推&cvnlp类模型推理服务进行性能优化,并支持业务的大模型相关探索
任职要求:
1、27年及以后毕业优先,统招本科及以上学历;
2、基础功底扎实,精通C/C++、Java等至少一门编程语言,具有良好的编程和工程实现能力
3、有算法Serving服务开发,算法服务性能优化(如结合GPU/FPGA等的优化经验)优先
4、可实习至少4…
招聘城市:北京,上海
岗位职责:
1、深度参与小红书社区搜索/推荐业务,满足产品、算法对于核心引擎或者基础平台的功能需求
2、抽象通用的业务开发框架与组件,提升业务支持效率,将现有技术逐步平台化和产品化
3、参与搜索引擎、推荐引擎、模型预测、向量检索等基础系统、平台的设计、研发及调优工作,提升效率降低成本
4. 对搜推&cvnlp类模型推理服务进行性能优化,并支持业务的大模型相关探索
任职要求:
1、熟悉Java语言,了解JVM原理,了解面向对象编程细想,了解集合、IO、多线程、网络编程等知识;
2、熟悉常用设计模式,能在编码中灵活使用多种设计模式,了解数据结构及常用算法;
3、熟悉Spring等主流开发框架,能在编码时灵活使用Spring功能…
招聘城市:上海,杭州,北京
岗位职责:
本课题研究如何优化向量检索技术以增强大型语言模型能力。
主要方向包括:
1、优化高维向量索引结构,实现千亿级多模态数据的高效检索;
2、设计多Agent场景下的智能检索增强生成(Agentic RAG)策略,探索检索结果与大模型上下文的最优融合方法;
3、研究基于向量检索优化大模型推理过程中的KV Cache机制,为智能体应用的效果优化和大模型推理提供关键技术支持。
任职要求:
1、不限年级,本科及以上在读,计算机/人工智能/软件工程等相关专业优先;
2、编程基本功扎实,具有扎实的数据结构和算法功底,熟悉常用的设计模式、软件架构模式、计算网络、操作系统,擅长Java/C++至少一门语言;
3、 在Github上拥有有影响力的…
招聘城市:北京,上海,杭州
岗位职责:
本课题针对百亿级倒排索引的高性能检索需求,研发融合极致压缩算法与LSM Tree磁盘索引的高效倒排索引结构;设计基于异构计算加速、灵活查询DSL和混合存储引擎的检索算法;构建集成多级缓存、秒级实时索引更新和分布式调度的服务框架。
目标是在确保99.9%召回率的基础上,实现毫秒级响应,满足小红书亿级用户的高并发、低延迟检索场景。
任职要求:
1、不限年级,本科及以上在读,计算机/人工智能/软件工程等相关专业优先;
2、编程基本功扎实,具有扎实的数据结构和算法功底,熟悉常用的设计模式、软件架构模式、计算网络、操作系统,擅长Java/C++至少一门语言;
3、 在Github上拥有有影响力的开源项目,或者…
招聘城市:北京
岗位职责:
工作职责
1、深度参与小红书海内外社区/电商等核心场景下通用搜索、AI搜索以及搜索增长等业务功能模块,赋能十亿级query规模搜索业务
2、参与小红书搜索业务迭代,同时满足产品、算法对于核心引擎或者基础平台的功能需求
3、抽象通用的业务开发框架与组件,提升业务支持效率,将现有技术逐步平台化和产品化
任职要求:
任职资格
1、熟悉Java语言,了解JVM原理,了解面向对象编程细想,了解集合、IO、多线程、网络编程等知识;
2、熟悉常用设计模式,能在编码中灵活使用多种设计模式,了解数据结构及常用算法;
3、熟悉Spring等主流开发框架,能在编码时灵活使用Spring功能特性;
4、熟悉Linux操作系统,熟悉Shell脚本…
招聘城市:上海,北京
岗位职责:
云原生/Serverless 研发:
1、参与小红书搜广推在离线应用的 Serverless/FaaS 研发框架的设计和开发工作,支持 Java、C++ 等多种语言的应用低成本接入和使用;
2、参与适用于在离线一体的运维调度引擎设计和开发工作,支持数据、索引、代码包、流量、模型等的运维调度;
3、从端到端全流程打造高可靠、高性能、易扩展的 Serverless/FaaS 平台;
4、探索 Serverless + AI 研发新范式,帮助开发者享受到更极致的 AI 时代红利。
AI Agent 研发:
1、参与小红书 AI agent 框架技术研发,包括 DeepResearch Agent、PlanExecutor Agent、Multi Agent、通用 Agent 等技术开发;
2、打造小红书 AI agent 分布式研发运维体系,包括传统应用低成本接入,agent 的调试、运…
招聘城市:北京,上海
岗位职责:
1、深度参与小红书搜广推C端业务迭代,优化搜广推业务架构,提供系统解决方案、提升核心服务稳定性;
2、参与业务通用化、平台化建设,对共用的能力进行抽象设计、研发,提升业务迭代效率;
3、参与解决高并发、高稳定性、业务模型复杂等问题带来的各种技术挑战。
任职要求:
1、本科及以上学历,计算机等相关专业;
2、熟悉JAVA面向对象和多线程、网络等基础编程,熟悉微服务、消息队列等技术,具有良好的编程和工程实现能力;
3、有分布式系统开发、大数据处理开发经验者优先;
4、有互联网企业实习经验优先;
5、有编程竞赛获奖经验或有个人代表作品优先;
6、自驱能力强,有想法,敢于实践。
招聘城市:北京,上海
…率
2、参与 100B以上多模态强化学习算法流程适配(如DAPO等),各领域任务的 RL 正确性验证
3、实验并调优不同并行策略(Tensor/ZeRO/FSDP/Pipeline Parallelism)在超大规模模型上的最佳配置组合
4、协助定位分析分布式训练中的关键性能瓶颈(如GPU利用率低、显存瓶颈、网络通信阻塞、I/O延迟等),设计并实施优化方案进行验证。
5、参与研发/优化训练引擎的关键特性,如大规模集群下的稳定断点续训、高性能异步Rollout机制、以及高性能算子(Kernel)的集成与优化。
任职要求:
任职资格:
1、优秀的代码能力、数据结构和基础算法功底,熟悉Python开发,熟悉 Linux/Git开发环境;
2、有较好的学习能力、沟通协作能力和自驱力,能…
招聘城市:北京,上海
岗位职责:
核心职责:
参与AI平台大模型推理部署等流程及工具的研发建设,完善平台现有功能。
参与AI平台Quota管理模块的开发,实现多机房、多集群环境下的,各种异构计算资源的配额管理功能。
参与AI平台联邦调度能力的设计和开发,与下游云原生团队共同实现平台联邦和弹性部署能力。
任职要求:
任职要求:
计算机/软件工程相关专业在校生,熟悉Go/Python/Java至少一门语言
了解Linux系统及算法基础,熟悉MySQL/Redis等组件使用
了解 Kubernetes 架构和生态,有一定的云原生机器学习系统实践和开发经验;
具备快速学习能力,能持续跟踪AI基础设施技术动态
加分项:
接触过Mesos、Yarn、Argo、Volcano 等云原生技术
熟悉大模型推理基本原理,拥有使用 vLLM…
招聘城市:北京
岗位职责:
1、参与/负责研发面向大语言模型(LLM)/多模态大模型(MLLM)等类型模型的推理服务框架;
2、通过并行计算优化、分布式架构优化、异构调度等多种框架技术,打造高效、易用、领先的AI推理框架;
2、深度参与周边深度学习系统多个子方向的工作,包括但不限于模型管理、推理部署、日志/监控、工作流编排等;
3、与全公司各业务算法部门深度合作,为重点项目进行算法与系统的联合优化,支撑业务目标达成。
任职要求:
1、优秀的代码能力、数据结构和基础算法功底,熟悉C++/Python开发,熟悉 Linux/Git 开发环境;
2、熟悉至少一种主流基础深度学习训练或推理框架(TensorFlow/PyTorch/PaddlePaddle/TensorRT等)的使用和实现;
3、熟悉主流LLM模型结构,熟悉至少一种主流LLM…
招聘城市:上海,北京
岗位职责:
云原生/Serverless 研发:
1、参与小红书搜广推在离线应用的 Serverless/FaaS 研发框架的设计和开发工作,支持 Java、C++ 等多种语言的应用低成本接入和使用;
2、参与适用于在离线一体的运维调度引擎设计和开发工作,支持数据、索引、代码包、流量、模型等的运维调度;
3、从端到端全流程打造高可靠、高性能、易扩展的 Serverless/FaaS 平台;
4、探索 Serverless + AI 研发新范式,帮助开发者享受到更极致的 AI 时代红利。
AI Agent 研发:
1、参与小红书 AI agent 框架技术研发,包括 DeepResearch Agent、PlanExecutor Agent、Multi Agent、通用 Agent 等技术开发;
2、打造小红书 AI agent 分布式研发运维体系,包括传统应用低成本接入,agent 的调试、运…
招聘城市:北京,上海
岗位职责:
1、深度参与小红书搜广推C端业务迭代,优化搜广推业务架构,提供系统解决方案、提升核心服务稳定性;
2、参与业务通用化、平台化建设,对共用的能力进行抽象设计、研发,提升业务迭代效率;
3、参与解决高并发、高稳定性、业务模型复杂等问题带来的各种技术挑战。
任职要求:
1、本科及以上学历,计算机等相关专业;
2、熟悉JAVA面向对象和多线程、网络等基础编程,熟悉微服务、消息队列等技术,具有良好的编程和工程实现能力;
3、有分布式系统开发、大数据处理开发经验者优先;
4、有互联网企业实习经验优先;
5、有编程竞赛获奖经验或有个人代表作品优先;
6、自驱能力强,有想法,敢于实践。
招聘城市:北京,上海
岗位职责:
1、主导新一代训练与推理引擎的架构设计与核心模块开发,支撑搜广推业务在长序列建模、生成式推荐、Agent 等前沿场景的规模落地;
2、与存储、数据平台深度协同,打造端到端 ML 数据 Pipeline:统一特征管理、秒级调试、版本追踪与一键上线,让数据科学家专注模型创新;
3、持续优化训推基础设施:自研 Embedding 高速存储、特征 DSL 引擎、弹性调度与服务化推理框架,实现 10x 级性能提升;
4、跟踪 LLM / Agent 最新进展,将其工程化落地到搜索、广告、推荐及智能体业务,定义行业新标准。
任职要求:
1、计算机及相关专业本科以上学历,具备高性能系统或 AI Infra 研发经验;
2、精通 C/C++,具备扎实的系统底层能力(内存、并发…
招聘城市:北京,上海
岗位职责:
1、深度参与小红书社区搜索/推荐/广告业务,满足产品、算法对于核心引擎或者基础平台的功能需求;
2、参与搜索引擎、推荐引擎、模型预测、向量检索等基础系统、平台的设计、研发及调优工作,提升效率降低成本;
3、参与高效存储和高性能混合检索引擎,包括并不限于正排KV索引、KKV索引、时序索引等;
4、参与抽象通用的业务开发框架与组件,提升业务支持效率,将现有技术逐步平台化和产品化。
任职要求:
1、本科及以上学历,计算机等相关专业优先;
2、基础功底扎实,熟悉Linux/Unix平台上的C++编程,熟悉网络编程-多线程编程,具有良好的编程和工程实现能力;
3、有分布式系统开发、或算法Serving服务开发及性能优化(如结合…
招聘城市:北京,上海
岗位职责:
1、深度参与小红书社区搜索/推荐/广告业务,满足产品、算法对于核心引擎或者基础平台的功能需求;
2、参与搜索引擎、推荐引擎、模型预测、向量检索等基础系统、平台的设计、研发及调优工作,提升效率降低成本;
3、参与高效存储和高性能混合检索引擎,包括并不限于正排KV索引、KKV索引、时序索引等;
4、参与抽象通用的业务开发框架与组件,提升业务支持效率,将现有技术逐步平台化和产品化。
任职要求:
1、本科及以上学历,计算机等相关专业优先;
2、基础功底扎实,熟悉Linux/Unix平台上的C++编程,熟悉网络编程-多线程编程,具有良好的编程和工程实现能力;
3、有分布式系统开发、或算法Serving服务开发及性能优化(如结合…
招聘城市:上海,北京
岗位职责:
1. 参与搜索、广告、推荐系统的数据处理工作,协助团队完成数据清洗、预处理和特征工程;
2. 协助开发和优化大数据处理流程,提升数据处理效率和质量;
3. 学习和研究最新的大数据处理技术和工具,为团队带来新的思路和方法。
任职要求:
1. 本科及以上学历,计算机、软件工程、数据科学等相关专业;
2. 熟悉至少一种编程语言,如 Python、Java 或 C++;
3. 对大数据处理工具有一定的了解,如 Flink、Hadoop、Spark、Hive 等;
4. 具备良好的沟通能力和团队合作精神,能够快速融入团队;
5. 有相关项目经验或实习经验者优先;
招聘城市:上海,杭州,北京
岗位职责:
1、推动大规模搜推/增长算法落地:用大模型重构海外搜推/增长链路——从投放素材利益点挖掘、新用户冷启内容池构建、用户搜索词理解,到千人千面的个性化文案生成,打造国际化搜推/增长智能引擎。参与大模型在全链路的深度集成,提升语义理解、召回&相关性、个性化及生成式建模的技术天花板,实现核心算法的突破。
2、驱动业务显著增量:针对国际化市场的新客增长、回流激活及人群破圈,优化搜推分发策略与消费效率,通过算法升级直接带动海外业务的规模性增长与留存指标。
3、沉淀社区前沿技术:从复杂的业务环境中抽象出清晰具体的技术问题,并将深度学习、LLM等技术…
招聘城市:北京,上海,广州
…C++/Go/Python/Shell等1至2种以上语言;
3、了解Kubernetes架构和生态,熟悉Docker/Containerd/Kata/Podman等容器技术;
4、有优秀的逻辑分析能力,能够对业务逻辑进行合理的抽象和拆分;
5、有强烈的工作责任心,较好的学习能力、沟通能力和自驱力,能够快速的响应和行动;
6、有良好的工作文档习惯,及时按要求撰写更新工作流程及技术文档。
加分项:
1、了解至少一种主流的机器学习框架/推理引擎,有大模型推理性能优化经验;
2、有大模型资源调度/服务编排的落地经验,参与过分布式系统的设计、开发和维护;
3、了解GPU系统/体系结构;
4、在计算机系统顶会(包括但不限于OSDI/NSDI/SOSP/FAST/Eurosys)上有文章发表经验。
招聘城市:北京,上海
岗位职责:
1、负责百亿级搜索内容解析,持续提升解析效果和性能
2、应用大模型技术,提升数据解析质量和成功率
3、负责互联网海量数据(网页、文档、富媒体等)的去重、清洗、结构化导入、分类、信息抽取
任职要求:
1、计算机相关专业,熟练掌握 Python/Java 和 Go 编程语言
2、掌握 spark 开发和使用技能
3、深入理解网站架构和内容组织方式,具备网页结构分析能力
招聘城市:北京,上海
岗位职责:
【部门介绍】引擎架构部提供小红书搜广推,CV和NLP业务的深度学习模型高性能AI Infra服务。主导SOTA AI Infra架构设计与核心模块开发,支撑AI业务在大规模多模态生成式搜广推等前沿场景上规模落地。
1、参与开发支持下一代多模态生成式搜广推超大规模(百亿-万亿级)模型的GPU千卡互联分布式训练框架。
2、与公司算法同学深度合作,为重点项目进行算法与训练框架的联合优化。
3、支撑业界领先的多模态模型在国内最大的生活兴趣社区上落地。
任职要求:
【岗位要求】
1. 有扎实的工程算法基础,精通数据结构和常用算法,熟练掌握各种编译、调试、性能分析工具。
2. 熟悉C/C++/CUDA,具备扎实的系统…