牛大妈在社招职位搜索"Infra工程师" 有 14 条结果

小红书(xiaohongshu) AI Infra工程师/专家

全职 北京,上海,深圳
招聘城市:北京,上海,深圳
岗位职责:
【部门介绍】引擎架构部是目前小红书AI Infra核心部门,囊括搜广推、CV、NLP、语音、多模态等主要业务场景。团队主导SOTA AI Infra架构设计与核心模块开发,支撑AI业务在AI前沿场景上规模落地。
【岗位职责】
参与开发下一代超大模型(百亿-万亿级)模型的GPU/NPU/PPU/CPU千卡互联分布式训练和推理框架。
参与开发分布式并行/流水线/通信优化/ZeRO/FSDP工作,消除大规模分布式训练通讯/计算/内存瓶颈,极致优化模型训练和推理的性能。
参与开发Triton,TileLang计算图编译优化或者使用CUDA/cutlass编写高性能算子,将硬件性能压榨到极致,最大化发挥出GPU/NPU/PPU/CPU等异构硬件协同算力。
参与开发/调试用于异构计算全链路的AI编译…
招聘城市:北京
岗位职责:
1.分布式 Dataloader:多源数据加载框架研发,优化预处理流水线、IO 瓶颈与数据倾斜,对接对象存储 / 分布式文件系统,支持动态采样与增量更新;​;
2.Checkpoint 管理:设计高吞吐存储 / 加载方案,优化压缩、分片与冷热分层,实现版本管理、备份恢复与分布式训练框架兼容;​;
3.系统优化:监控吞吐 / 延迟 / 显存指标,定位性能瓶颈,保障极端场景下训练连续性;​;
4.跨团队协作:对齐业务需求,沉淀技术最佳实践。​。
岗位要求:
1.本科及以上学历,3 年 + AI Infra / 分布式系统 / HPC 经验;​;
2.精通 Python/C++,深入理解 Linux 内核、IO 模型,熟悉 PyTorch(优先)及分布式训练原理;​;
3.有分布式 Dataloader 研发与 IO 密集型任务优化相关经验;​;
4.有 checkpoint 存储 / 加载 / 压缩…
招聘城市:广州
岗位职责:
1.负责大模型后训练框架和RL训练的设计,开发和优化。支撑LLM的高效、稳定训练;
2.持续追踪并引入业界最新开源生态技术(如 Verl, Slime, ROLL, AReal 等);
3.与搜索算法团队紧密合作,设计实现高性能的AI搜索大模型,加速最新的大模型技术在搜索场景的落地。
岗位要求:
1.具备较强的动手能力;熟悉 Python ,具备扎实的系统编程功底和优秀的复杂系统 Debug 能力;
2.深入理解大模型分布式训练原理,具备 Megatron-LM、DeepSpeed 或 PyTorch FSDP 等主流框架的开发和优化经验;
3.熟悉大模型后训练与对齐技术(PPO、GRPO、DPO等),熟悉 Verl、ROLL,AReal 等强化学习/分布式计算框架,有实际开发部署并解决相关问题的经验;
4.熟悉…
招聘城市:北京
岗位职责:
1.负责开发和优化LLM,VLM等大模型的推理引擎,构建适合AI Search,智能 Agent相关领域大规落地应用中的推理基础架构;
2.紧跟 LLM Infra 领域的前沿技术演进突破,将合适成果落地于实际应用;
3.与搜索算法同学深度合作,联合优化,设计实现能够给大型搜索系统带来代际更迭的大模型。
岗位要求:
1.熟悉AI基础硬件设置,有真实的大规模推理系统的设计开发部署经验;
2.熟悉各种主流LLM/VLM的模型结构,具有 vllm/sglang/TRT-llm等推理引擎优化实践经验;
3.熟悉LLM 推理常用加速方法(算子融合、量化策略、动态批处理、分布式KV 缓存优化等);
4.有针对真实场景问题的LLM 模型结构和的设计优化经验。
岗位介绍:
在腾讯,后台开发…
招聘城市:北京
岗位职责:
1.工作职责:;
2.负责开发和优化LLM,VLM等大模型的推理引擎,构建适合AI Search,智能 Agent相关领域大规落地应用中的推理基础架构;
3.紧跟 LLM Infra 领域的前沿技术演进突破,将合适成果落地于实际应用;
4.与搜索算法同学深度合作,联合优化,设计实现能够给大型搜索系统带来代际更迭的大模型。
岗位要求:
1.岗位要求:;
2.熟悉AI基础硬件设置,有真实的大规模推理系统的设计开发部署经验;
3.熟悉各种主流LLM/VLM的模型结构,具有 vllm/sglang/TRT-llm等推理引擎优化实践经验;
4.熟悉LLM 推理常用加速方法(算子融合、量化策略、动态批处理、分布式KV 缓存优化等);
5.有针对真实场景问题的LLM 模型结构和的设计优化经验…
招聘城市:北京
岗位职责:
1.核心训练框架开发与优化: 负责大模型分布式训练框架(基于Megatron-LM / DeepSpeed等)的底层架构设计与核心代码开发。支撑千亿/万亿模型的高效、稳定训练;
2.RL Infra 系统建设与协同优化: 负责强化学习(PPO/GRPO/DPO等)训练框架的开发和优化。深度解决 Actor 生成(结合 vLLM/SGlang 等推理引擎)与 Critic/Reward 训练阶段的资源调度、状态流转及通信瓶颈,实现 Training 与 Inference 的极致协同;
3.算法与系统协同设计 (Co-design): 与前沿算法团队紧密合作,追踪并引入业界最新开源生态(如 Verl, Slime, ROLL, AReal 等),快速完成技术原型验证,加速前沿大模型对齐算法在微信海量业务场景的规模化落地。
岗位要求:
1.计算机相关专业,具备较强的动手能力;熟悉…
招聘城市:北京
岗位职责:
1.配合算法工程师,推动深度学习相关算法的落地,打造高吞吐、低延时的推理系统;
2.优化大模型推理性能,提升吞吐并控制成本;
3.优化大模型推理框架,提升框架易用性和可调试性。
岗位要求:
1.熟练掌握 C/C++、Python语言,有计算机体系结构背景或软件开发背景,熟悉系统性能调优的方式;
2.具备基础的GPU编程能力,包括但不限于Cuda、OpenCL;熟悉至少一种GPU加速库,如cublas、cudnn、cutlass等;
3.有Tensorrt/FasterTransformer/Tensorrt-llm/vllm/sglang等深度学习推理框架的实际使用经验;
4.熟悉各类深度学习网络和算子底层实现细节,训练和推理模型调试、调优有实操经验优先;
5.熟悉CPU/GPU异构加速瓶颈分析方法,有服务器端…
招聘城市:深圳
岗位职责:
1.模型训练和推理平台开发;
2.研究并应用模型优化技术到训练流程和在线服务中,提高运行时性能,降低资源占用;
3.业务侧模型部署和评测;
4.团队 gpu 资源管理与调度。
岗位要求:
1.计算机相关专业,本科及以上学历;
2.熟悉Pytorch等主流深度学习框架,熟悉 vllm/sglang 等主流推理框架,具备模型调优及线上部署实践经验;
3.熟悉并行计算,X86、ARM等计算体系结构;
4.拥有优秀的分析和解决问题能力,具备良好的团队协作能力。
岗位介绍:
在腾讯,后台开发工程师不仅是“又快又稳”的问题解决专家,更是生态共创者。你将与技术团队一同沉淀优质代码,让它成为我们共有的宝贵资产。在不同的业务场景和技术发展…
招聘城市:北京
岗位职责:
1.构建评测运行底座:统筹沙盒环境、依赖管理、网络访问、并发调度等关键能力建设,保障大规模评测在生产环境下的稳定、可复现与高效运行;
2.保障评测质量与可观测性:从 Harness 与打分逻辑出发,确保平台化改造后评测结果的准确可信,并建立完善的诊断与问题归因能力;
3.衔接算法与工程:深入理解各 Benchmark 所考察的模型能力维度,作为算法与平台之间的技术桥梁,推动评测需求高质量落地。
岗位要求:
1.计算机相关专业本科及以上学历,3年及以上后端 / 平台 / Infra 研发经验;
2.精通至少一门主流后端语言(Python / Go / Java 等),主导过中大型平台或系统的设计与落地,具备优秀的系统设计与工程实现…
招聘城市:上海
岗位职责:
加入我们,你将
1、负责公司跨端(Web / 小程序 / 移动端)统一 AI 基础设施建设,打造跨平台一致的 AI 能力底座;
2、设计并实现跨端 AI 运行时框架,支持轻量化模型端侧部署、推理加速、资源调度与性能优化;
3、建设跨端通用 AI 组件体系:流式对话、多模态交互、AI 内容生成、端侧智能预处理等;
4、构建跨端 AI 工程化规范、统一 SDK、监控体系与安全防护能力;
5、负责跨端 AI 场景体验优化:流式输出、上下文管理、弱网降级、异常容错;
6、支撑全业务线低成本、高效率落地跨端 AI 能力,输出统一标准与最佳实践。
任职要求:
希望你
1、本科及以上,计算机相关专业,2 年以上跨端开发或前端基建经验;
2、扎实…
招聘城市:北京
部门介绍:
为了更好地提升城市即时配送的效率与体验,2017年,美团启动了无人机配送服务的探索,通过科技创新推动履约工具变革,加快建设空地协同的本地即时配送网络。
在过去的六年里,美团无人机完成了飞行器、自动化机场及智能调度系统的研发工作,实现了研发设计、生产制造、运营运维全链条布局,达成了城市复杂场景物流无人机高频次、高密度、多天时、多天侯运行。
2023年7月,美团无人机在上海发布了自主研发的第四代无人机,跟此前机型相比,新机型升级了环境适应能力,可在“零下20度至50度”的中雨、中雪、6级风、弱光等环境中稳定飞行,能够适应97%以上国内城市…
招聘城市:广州
岗位职责:
1.负责分布式训练基础设施的建设、优化与维护,优化训练过程中的显存管理、计算资源调度与分布式通信效率,提升训练速度与资源利用率,支撑算法研发与模型训练;
2.负责微信小程序 Coding Agent 场景下 LLM 推理服务的建设与优化,涵盖 vLLM / SGLang 等框架适配、请求调度、KV Cache 管理、Prefill-Decode 分离、长上下文推理、投机解码等核心能力建设;
3.负责 GPU 资源管理,通过资源精细化分配和灵活调度提升整体利用率。
岗位要求:
1.熟练掌握 C / C++ / Python 等至少一门编程语言,具备扎实的数据结构和算法功底,有良好的工程素养;
2.熟悉主流分布式训练框架(DeepSpeed / Megatron-LM / FSDP 等),理解常见的显存优化技术和训练加速手段,有异步…
招聘城市:北京,上海
岗位职责:
【训练推理框架研发】
大模型hi lab AI Infra团队专注于大语言模型领域的前沿技术研究和落地,提供高性能、高可靠、可扩展的机器学习系统、丰富的异构计算资源和极致的端到端的机器学习服务体验,为公司提供核心技术能力和服务。
1、负责机器学习框架的研究与开发,服务于公司各个产品;
2、高效部署,优化NLP/多模态大模型核心业务模型;
【轻量化】
机器学习系统团队需要将传统或者新型的轻量化算法和工程有机结合起来进行加速,提高大语言模型训练或者推理性能的同时,通过算法手段尽可能降低效果损失。候选人将在以下几个方向进行深入探索和落地:
1、量化方向:负责但不限于大语言模型的低精度…
招聘城市:北京
部门介绍:
美团自动配送以自研L4级自动驾驶软硬件技术为核心,与美团即时零售业务结合,形成满足公开道路、校园、社区、工业园区等室外全场景下的自动配送整体解决方案。
美团无人车团队成立于2016年,团队成员来自于Waymo、Cruise、Pony.ai、泛亚等自动驾驶行业头部公司,自动驾驶技术团队博士占比高达30%,依靠视觉、激光等传感器,实时感知预测周围环境,通过高精地图定位和智能决策规划,保证自动配送车全场景即时配送能力。自2020年起,自动配送车已在北京、深圳等多地进入常态化试运营阶段,运营车辆超500台,日均运营超16小时,截止2022年6月,已经累计配送近220万单。
欢迎加入…