招聘城市:北京
【北斗】大模型推理系统工程师
更新时间:2026-06-11
工作地点:北京市
事业群:核心本地商业-基础研发平台
岗位职责
【愿景】
美团龙猫基座大模型,不只聪明,更懂生活。从语言理解到全模态感知,从架构创新到极致推理,从海量预训练到亿级真实订单 —— 我们造的不仅是实验室里的“优等生”,更是活在大街小巷、三餐四季里的AI。 而我们想做的远不止于此 —— 让模型自己提出假设、训练自己、不断进化; 让一群智能体像团队一样分工协作、攻克复杂问题; 让 AI 走出屏幕,理解物理世界、走进真实场景。 这是我们正在冲刺的方向,也是你可以参与定义的未来。 加入我们,一起把智能带进真实物理世界,亲手打造…
招聘城市:北京,上海
…关键因素。本课题专注于大模型推理加速与分布式系统优化的前沿技术探索,通过软硬件协同设计和算法工程联合优化,降低大模型推理的应用成本,提高推理性能。研究内容包括但不限于:
1.投机推理(Speculative Decoding),研究基于预测性执行的动态推理优化方法,参与设计低延迟推理框架,通过概率模型预生成候选序列以降低解码计算开销。
2.分布式系统优化,探索多节点协同推理中的通信-计算负载均衡策略,提出基于异构硬件的混合并行调度方案,实现吞吐量提升。
3.稀疏Transformer优化与模型压缩,通过稀疏Transformer优化以及模型压缩技术提升模型的计算效率。
4.算子优化,熟悉最新硬件架构的算子优化方法,通过更高效的算子优化模型的吞吐和延时。…
招聘城市:北京,上海
…机器学习DSL;
5.具有良好的沟通协作能力,工作积极主动。
加分项:
1.具备有影响力的大规模分布式系统、高性能计算项目经验;
2.在OSDI、SOSP、NSDI、MLSys、ICML、ICLR、NeurIPS等等顶级会议上有论文发表;
3.在高影响力开源项目(如vLLM/SGLang/Megatron/verl等)有核心代码贡献。
【愿景】
打造全球领先的本地生活智能平台,让每一次搜索和推荐都精准理解用户需求,从被动匹配走向主动认知推理。我们致力于成为大模型在搜索与推荐场景落地的标杆团队,推动行业从传统深度模型向生成式智能的范式跃迁,用AI能力重新定义下一代生活服务入口。
【为什么是我们】
1.顶级算力资源:超大规模GPU集群,充足的算力支持你的大胆想法;…
招聘城市:北京,上海
…是我们】
1.算力资源充足,问题规模真实:接触真实 GPU 集群、训练任务调度、推理集群和资源治理,在工业级场景下优化 GPU 利用率、任务吞吐、训练稳定性和单位算力成本,技术栈横跨 AI、系统、平台和工程架构,成长面很宽。
2.技术挑战硬核,工程深度足:大稀疏+大稠密模型课题,既有传统TB级别的稀疏Embedding,又有LLM规模的Dense。既要搞定稀疏多级异构存储,又要搞定大模型场景下的混合精度、并行策略、通信等难题,以及推理系统上的吞吐、延迟、模型量化等工作。
3.带教资源好,能快速补齐 AI + Infra 复合能力:紧密合作的算法专家团队,补充AI模型领域知;资深 AI Infra专家 1V1指导,全程重度参与系统设计和实现。
招聘城市:北京,上海,成都
…研究 inference-time scaling、process reward model 等推理阶段增效方向,推动团队迭代范式从人工特征设计向算力驱动跃迁。
任职要求:
【任职资格】
1.在搜广推、大语言模型、序列建模、强化学习等一个或多个方向具有系统性研究积累,并有工业级落地经验。
2.在 KDD、SIGIR、WWW、NeurIPS、ICML、ICLR、ACL、EMNLP 等国际顶级会议有论文发表,或主导过具有行业影响力的工业级算法系统研发。
3.熟悉 Python 或 C++,具备大规模分布式训练与在线推理系统的独立研发能力;有千亿参数级模型训练经验者优先。
4.具备将前沿研究成果推进到线上生产环境的完整经验,能够在严格延迟约束与业务指标要求下完成系统交付。
【为什么是我们】
1.核心业务场景…
招聘城市:北京
…推理引擎建设:既有大稀疏(Embedding),又有大稠密(LLM)的模型结构下,优化延迟、吞吐量和显存占用,支持千亿/万亿参数模型的实时推理需求。
3.低进度优化:基于结构化和非结构化模型进行低进度训推协同优化,从源头解决模型性能与精度的平衡难题。
4.广告链路端到端重塑:超长行为序列与超大候选Item情况下,优化传统的多阶段网络传输架构,需要一体化硬件支撑的召回/排序/机制统一服务。
任职要求:
海内外高校在校本科生(大三及以上)、硕士生及博士生,且以下条件至少满足一项
1.工程高手:有大厂实验室的实习经验,或有贡献突出的开源项目,熟悉PyTorch、Megatron、vLLM/SGLang等机器学习框架,有大规模分布式系统…
招聘城市:北京
…搭建过 Agent 或多 Agent 系统,对 Harness 设计、工具调用协议、上下文工程及 Agent 评测方法论(benchmark 构建、轨迹级评估、自动化 judge、失败模式分析)有系统理解与实践
自动化研究系统经验:AI for Science / AI Scientist 类工作、自动化假设生成与实验设计、Agent 长期记忆与知识累积机制、自动化数据分析系统等方向的研究或工程实践
因果推断背景:系统学习或研究过 uplift modeling、CATE 估计、双重机器学习与双重稳健估计、IPW / 离线策略评估、实验设计与因果识别策略;在 LLM 与因果推断交叉方向(LLM 辅助因果发现、反事实推理、causal representation learning)有探索经历者优先
搜索、推荐、广告算法背景:多目标排序、竞价与机制设计、在线学习与探索利用权衡、大规模稀疏模型的学习…
招聘城市:北京,上海
…微调、CoT 推理增强、协同信号注入等方式,构建兼具行为记忆力与语义泛化力的统一广告模型。
3. 生成式召排链路升级:探索生成式技术对召回、预估、重排的系统性改造,推动广告系统端到端统一建模;研究广告场景下 Scaling 规律,建立模型规模与业务指标的可预测转化关系。
4. Agent 自迭代能力构建:探索基于 LLM 的广告系统自演进框架,利用 Multi-Agent 自动化特征工程、样本挖掘、实验分析等研发环节,构建模型基于线上反馈持续自迭代的能力。
任职要求:
【任职资格】
必要条件:
1.2027届本科及以上学历,计算机、人工智能等相关专业;
2.熟练掌握 Python,熟悉 PyTorch 等主流深度学习框架;
3.扎实的机器学习/深度学习理论基础,对推荐系统、NLP…
招聘城市:北京
【北斗】分布式AI推理/AI-Infra研发工程师
更新时间:2026-06-03
岗位职责
为了更好地提升城市即时配送的效率与体验,2017年,美团启动了无人机配送服务的探索,通过科技创新推动履约工具变革,加快建设空地协同的本地即时配送网络。目前,美团已初步完成了自主飞行无人机、智能化调度系统及高效率运营体系的研发建设工作,由此打造了一个服务于多场景、多天候的城市低空物流解决方案。
1、推理框架研发:参与构建与优化高性能分布式 AI 推理引擎,支持大模型在多卡、多机环境下的高效分布式部署与高效通信;
2、分布式任务调度:参与设计与实现面向大模型推理的高效任务调度算法。针对 Prefill与…
招聘城市:北京
【北斗】机器人电子电气架构师
更新时间:2026-06-03
岗位职责
美团是中国领先的生活服务科技平台,拥有覆盖数千万商户与数亿用户的真实履约网络。美团无人机是全球率先实现城市低空配送常态化运营的团队。我们正将具身智能技术引入大规模真实物理场景,探索"让机器像人一样理解世界、自主行动"的下一代智能体。你将加入具身智能算法核心团队,承担以下职责:
1.参与机器人系统工程的研发与落地,面向全球市场即时零售、餐饮等行业场景,推动边缘智能与AI加速计算在机器人系统中的规模化应用,实现客户价值最大化;
2.边端AI加速计算架构设计:针对机器人实时感知、推理与控制场景,主导边缘…
招聘城市:北京
…算法与工程协同:通过算法与系统的协同设计显著提升推荐链路 MFU 水平,解决大参数量模型在毫秒级在线服务下的效果-性能平衡难题。
3.Agentic Recommendation:打破传统协同过滤的被动匹配局限,设计具备领域专家经验、推理能力与主动规划能力的推荐 Agent,探索意图理解驱动的下一代推荐范式。
4.多模态内容理解:融合文本、图像、用户行为等多模态信号,构建统一表征体系,支撑跨业务线的个性化推荐能力复用。
任职要求:
【任职资格】
必要条件:
1.2027届本科及以上学历,计算机/人工智能/统计学等相关专业;
2.具备扎实的机器学习与深度学习理论基础;
3.具有优秀的科研能力与工程实现能力,在搜索、推荐或者大模型等方向具备有影响力的…
招聘城市:北京
…与公司具身智能战略深度协同,支撑关节电机、电驱动总成等动力系统的全栈自研能力构建。
岗位基本要求
【岗位要求】
1.博士学历,电气工程、自动化、控制科学与工程、机械电子工程或相关专业。
2.具备电机/电驱算法领域扎实的理论基础和工程实践经验,熟悉永磁同步电机控制(FOC、弱磁、SVPWM等)。
3.具备优秀的C/C++代码能力和嵌入式开发经验(ARM/Cortex-M、DSP)。
4.有复杂系统电机控制项目经验(人形机器人关节驱动、无人机电推进系统等)优先。
5.在国际顶级会议或期刊(IEEE TPEL、TIE、ICRA、IROS等)发表一作论文优先。
6.熟悉各种功率器件、不同种类电机控制、嵌入式AI推理部署、强化学习或大模型微调等技术优先。
7…
招聘城市:上海
岗位职责:
【课题说明】
本课题目标打破传统推荐系统的召回范式,在LBS服务零售场景下,借助LLM的世界知识与推理能力,构建融合业务特点的生成式召回架构,实现效果突破。
主要挑战在于服务零售行业需求差异大、服务非标准化,在召回过程中同时把控个性化和相关性。
课题将重点设计基于LLM的生成式召回架构,通过领域知识增强与业务目标微调,结合传统稀疏模型的记忆能力与LLM的泛化推理能力,优化端到端目标一致性、长尾query/item的冷启动等问题。
【建议研究方向】
1.推理生成:基于生成式架构引入think过程,结合服务零售行业特点,推理用户真实需求,进而生成更匹配用户诉求的候选。
2.LBS码本优化:基于多模态表征优化…
招聘城市:北京
…架构设计与搭建:面向数字人直播场景,设计并搭建端到端的Agent智能体系统架构,涵盖智能选品、动态讲解、场景装修、实时互动等核心能力模块,实现多Agent间的协同调度与决策联动;
2. Agent核心算法研发与优化:负责Agent在直播场景中的意图理解、任务规划、工具调用、记忆管理等核心算法研发,持续优化Agent的自主决策能力、交互自然度及业务转化率;
3. LLM后训练与Agent微调:聚焦大模型的指令微调(SFT)、人类反馈强化学习(RLHF/RLVR)等后训练技术,结合Agent场景定制偏好对齐策略,基于Agentic RL提升模型在复杂多轮对话与多步推理任务中的表现;
4. Agent效果评估与规模化落地:构建面向Agent系统的自动化评测体系,与工程…
招聘城市:北京,上海
…提升系统的稳定性、可观测性与可审计性。
6.与模型、训练、评测、推理、平台等团队协作,推动 AI Agent 运行时基础设施在实际业务中的落地。
任职要求:
【任职资格】
1.计算机相关专业本科及以上学历,具备扎实的操作系统、计算机网络、分布式系统基础。
2.熟悉 Linux 系统原理,理解进程、线程、namespace、cgroup、文件系统、虚拟化、容器隔离等机制。
3.熟练掌握 python、java 中至少一门系统编程语言,有较强的工程落地能力。
4.有大规模分布式系统、云基础设施、容器平台、虚拟化平台、资源调度系统等相关研发经验。
5.具备较强的问题分析与性能优化能力,能够定位复杂系统中的稳定性与性能瓶颈。
【为什么是我们】
1.加入专业大模型infra团队…
招聘城市:北京
…及其变体,具备独立阅读和复现顶会论文的能力
3.熟练掌握Python及PyTorch/JAX等主流框架,具备清晰的代码工程意识
4.对大模型的训练流程(预训练/后训练)或Agent构建有系统性理解,具备独立完成端到端实验的能力
5.具备RLHF/DPO/GRPO或其他对齐算法的实际训练与调优,对相关数据构建有深度认知
加分项:
1.熟悉ClaudeCode、OpenClaw、Hermes等开源Harness的设计和实现
2.在NeurIPS/ICML/ICLR/ACL/EMNLP等顶会发表过论文(含在投),或有被广泛引用的开源项目
3.有Agent系统(如ReAct/Toolformer/CodeAct类)的研究或工程经验,理解Agent失败模式与评估瓶颈
4.参与过千卡以上规模分布式训练,或对推理优化(量化…
招聘城市:北京,上海
岗位职责:
简介:参与面向大模型训练/推理的高性能计算与系统优化工作,可根据个人背景和研究兴趣选择以下方向之一深入推进:
1、面向GPU/NPU 等多硬件平台的算子开发与极致性能优化(CUDA/Cutlass/TileLang)。
2、跟踪前沿模型算法并完成高性能工程落地,深入框架层开展算子融合、内存/通信优化、流水编排等系统级性能调优。
3、探索基于大模型的高性能 Kernel 自动合成技术,参考 LLM-driven Kernel Generation 范式,研究高效 GPU/NPU Kernel 的端到端自动生成与迭代优化方法。
4、基于DSL(如 Triton、TVM TIR、Halide 等)的编译优化与自动调优技术研究。
5、多硬件后端(NVIDIA/国产芯片)的统一算子库建设与迁移适配。
任职要求:
1、GPU编程:写过…
招聘城市:北京,上海
…训练和推理的各类算法和工程策略探索落地。参与美团基座大模型项目,包含但不限于:
1、大模型高效架构设计探索(高效attention,moe架构等)。
2、预训练 / 后训练算法工程策略。
3、投机推理算法工程策略。
4、模型轻量化策略(剪枝,量化,稀疏,蒸馏,结构搜索等) 。
5、Agentic coding系统优化策略。
任职要求:
1、熟悉一些常用的深度学习框架和大规模训推框架(比如megatron,verl,vllm,sglang等等),在大模型上有训练和推理算法工程优化实际经验的优先;
2、熟悉机器学习和深度学习理论,具备扎实的编程能力,熟悉常见的主流大模型架构;
3、有大模型或机器学习相关顶会论文发表,特别是模型架构优化,训推策略相关的算法或工程论文优先…
招聘城市:北京,上海
…优化
①优化RL场景(longcot、长尾分布、多轮交互)推理引擎效率,包括不限于量化、MTP、并行切分等等。
②训推混部署、全流程异步训练,提升 GPU 利用率。
3、 训推一致性
①训推引擎天然为了各自最大化效率存在精度差异,研究如何不断降低两者diff,包括不限于 Routing Replay、确定性计算等等。
4、训练稳定性
①攻克RL训练特有的奖励Hacking、训练不稳定、KL爆炸等系统层面问题。
②设计细粒度的训练过程监控:reward曲线、KL散度、entropy变化实时可观测。
③优化 PPO clip、advantage normalization 等关键超参的自动调节机制。
5.、长程任务训练优化
①长程任务奖励稀疏、过程难精确控制,研究如何系统性的优化其中工程和算法挑战。
任职要求:
1、了解 PPO…
招聘城市:北京,上海
…事实/经验/工作记忆协同、主动写入与更新、基于任务反馈的记忆读写策略学习,以及长上下文与显式记忆协同的系统设计,以支撑长时程规划、多轮任务连续性与个体化经验积累.
任职要求:
1、计算机、人工智能、数学、统计学、电子信息或相关专业本科高年级、硕士或博士在读;
2、具备扎实的机器学习基础,对以下至少一个方向有较深入理解: - 大语言模型与后训练 - 强化学习 / Online learning / Bandit / Sequence decision making - Agent / Tool use / Planning / Reasoning - 记忆增强模型 / RAG / 长上下文建模 - Reward modeling / Preference learning / PRM / ORM
3、熟悉 Python,具备较强的工程实现能力,能够独立完成实验、调参与结果分析,并具有一定的大模型训练或推理实践经验;
4、具备较强的论文阅读…