牛大妈在校招职位搜索AI+Infra++深度学习方向量化AI工程师 有 15 条结果

招聘城市:上海
量化AI工程AIInfra&深度学习方向
招聘人数:3人
单位名称:爱凡哲投资管理有限公司
薪资待遇:面议
工作地点:上海市
发布日期:2026-03-03
基本要求
工作类型:全职
学历要求:硕士研究生及以上
专业要求:计算机科学与技术,数学类
岗位职责
1.负责量化基金场景下的大模型(LLM)与深度学习模型的部署、运维与工程化落地,包括训练环境、推理服务及稳定性保障。
2.参与量化投研与交易相关的深度学习建模与系统实现,包括市场微观结构建模、时序预测、交易执行优化及研究自动化等方向
3.将研究阶段的算法转化为可上线的生产级系统,完成训练、评估、部署及持续迭代优化。
4.构建高性能模型推理架构,优化延迟…
招聘城市:上海
…MoE、算子融合等方向,持续提升模型训练效率和硬件利用率。
通信优化: 深入优化 H/NCCL通信库,解决 RDMA/RoCE 网络下的通信瓶颈,提升多机多卡并行效率(DP/PP/TP/CP/EP)。
稳定性保障: 构建自动容错与快速恢复系统(Checkpoint 优化、故障自动检测与接续),确保千卡集群在数月跨度的训练中保持极高可用性。
2. 推理加速与工程化 (Inference Infra)
高性能引擎: 负责基于 vLLM、TensorRT-LLM、SGLang、Triton Inference Server 等推理框架的开发与优化,提升大模型在线服务的吞吐、时延和资源利用率。
算子优化: 参与 Transformer 核心算子的开发与性能优化,包括 Attention、KV Cache、量化推理、算子融合等方向,探索 CUDA/Triton 等高性能实现方案。
推理架构: 参与构建面向大规模生产环境…
招聘城市:上海
…或深度参与过有较大技术影响力的大模型相关项目。
AI Infra研发工程 (2027届云弧计划)
【岗位职责】
在本岗位,您将有机会深入基础设施技术本质,同时驱动大模型与业务高效落地,具体将参与:
1. 大模型训练与推理基础设施研发: 参与构建和优化面向大规模分布式训练/推理的Infra平台,支持文本、图像、视频、语音等多模态大模型、扩散模型的训练与推理。涵盖集群资源调度、训练框架优化、高性能通信、混合精度训练、显存优化等关键环节,确保模型的训练效率与系统稳定性;
2. 前沿Infra技术探索与创新: 持续跟踪并攻关大模型基础设施领域的前沿方向(如:超大规模异构集群管理、更高效的并行策略、MoE训练/推理优化、量化
招聘城市:北京,上海
…等相关专业优先;
2、熟悉Linux/Unix平台上的C++/Python/Rust编程,熟悉常用的数据结构和算法,有良好的编程习惯;
3、具备大模型方向头部开源框架开发经验,或者具有大模型工程优化的前沿论文成果;
4、熟悉至少一种大模型训练或推理框架的原理和实现,具有修改源码或者深度使用的实践经验;
预训练框架:PyTorch、Megatron、DeepSpeed等
后训练框架:veRL、OpenRLHF、Llama-Factory等
推理框架:vLLM、SGLang、TensorRT-LLM等
5、熟悉大模型量化、蒸馏、剪枝等模型压缩常用方案并有相关实践经验;
6、熟悉NCCL/RDMA/IB/RoCE相关知识,具备AI模型性能调优经验、有CUDAKernel相关研发经验;
7、具备优秀的逻辑思维能力,有良好的团队合作精神,较强的沟通能力和学习能力。
招聘城市:北京,上海
学习能力强,对AI Infra方向有技术热情,富有极客精神;
4.具备扎实的机器学习深度学习基础,熟悉GPU、NPU硬件架构,熟悉CUDA,CCL,RDMA或者任意机器学习DSL;
5.具有良好的沟通协作能力,工作积极主动。
加分项:
1.具备有影响力的大规模分布式系统、高性能计算项目经验;
2.在OSDI、SOSP、NSDI、MLSys、ICML、ICLR、NeurIPS等等顶级会议上有论文发表;
3.在高影响力开源项目(如vLLM/SGLang/Megatron/verl等)有核心代码贡献。
【愿景】
打造全球领先的本地生活智能平台,让每一次搜索和推荐都精准理解用户需求,从被动匹配走向主动认知推理。我们致力于成为大模型在搜索与推荐场景落地的标杆团队,推动行业从传统深度模型向生成…

小红书(xiaohongshu) 【REDstar】大模型 Infra 工程

全职 北京,上海,杭州
招聘城市:北京,上海,杭州
…高并发推理、EPD 分离与 KV Cache 复用、低比特模型量化、国产异构芯片性能优化、万卡级 GPU 调度等真实业务的大规模 AI Infra 挑战。在这里你可以选择在训练、推理或模型压缩方向深耕,也可以参与跨方向系统设计,成长为真正理解大模型全链路的 AI Infra 工程。团队持续参与开源与行业技术交流,期待有志于构建生产级 Infra 能力并持续提升个人行业影响力的优秀同学加入。
工作职责:
1、训练与推理框架研发: 参与 Relax RL 后训练框架和 rLLM 推理框架的核心研发,支撑 LLM、MLLM、Agent、DiT 等模型的高效训练与高性能在线推理;可根据个人专长重点负责训练、推理或模型压缩方向
2、RL Pipeline 与分布式训练优化: 支持 SFT…
招聘城市:上海
…招聘信息
AI Infra研发工程【2027届云弧计划】
2026-06-22 11:58:28
职位描述
岗位职责:
在本岗位,您将有机会深入基础设施技术本质,同时驱动大模型与业务高效落地,具体将参与:
1. 大模型训练与推理基础设施研发:参与构建和优化面向大规模分布式训练/推理的Infra 平台,支持文本、图像、视频、语音等多模态大模型、扩散模型的训练与推理。涵盖集群资源调度、训练框架优化、高性能通信、混合精度训练、显存优化等关键环节,确保模型的训练效率与系统稳定性;
2. 前沿Infra 技术探索与创新:持续跟踪并攻关大模型基础设施领域的前沿方向(如:超大规模异构集群管理、更高效的并行策略、MoE 训练/推理优化、量化与推理加速框架…
招聘城市:上海
量化执行、MPP 调度、CBO 改进
-推动湖仓查询性能向云厂商商业产品看齐
无论选择哪个方向,你都会:
1、撰写技术设计文档——每个非平凡决策都要说清楚 why、alternatives、trade-offs
2、直面线上问题——参与值班、排障、性能调优,理解教科书 vs 现实的差距
3、做技术分享——团队周会、季度 Tech Talk、对外技术布道
4、走完一个完整迭代——半年内你会看到自己的设计从草稿走到生产,影响真实业务和 AI 应用
工作要求:
面向2027届海内外本硕博毕业生(2026年9月-2027年8月期间毕业)
1、专业方向:计算机科学、软件工程、电子工程、应用数学、统计学、数据科学、人工智能 / 机器学习等强相关专业
2、研究 / 实践经历深度参与过以下方向
招聘城市:北京,上海
…调优经验。
-掌握Go/Rust/C++中的一种,能阅读推理框架源码并编写扩展。
-有构建模型评测平台、自动化模型质量监控体系的经验。
-熟悉安全测试,对模型提示注入、隐私泄露等风险有验证经验。
?
我们能提供
-参与构建千卡至万卡级推理集群,直面超大并发场景的挑战。
-紧跟前沿的推理加速技术(Speculative
Decoding、FP8量化、MoE并行等),与资深工程及算法团队紧密协作
?
【 岗位 6 :AI推理引擎工程(Agent优化方向) 】
职位描述
1. 参与智能体自动化优化框架的设计与实现,构建“感知-决策-执行-反馈”闭环系统,覆盖算子生成、图调度、内存管理等环节。
2. 开发Agent与编译工具链(编译器、性能分析器、运行时)的标准化交互接口,实现优化流程自动化。
3. 利用自动…
招聘城市:深圳
…有限公司
招聘信息
AI算法工程
2026-02-2720:23:44
职位描述
方向(一):大模型与多模态模型研发(AI算法)?
1、负责大语言模型(LLM)或多模态模型(文本-视觉/语音)的核心模块设计与实现,主导模型架构改进(如Transformer变体优化、注意力机制创新)、训练策略调优(混合精度训练、梯度检查点、LoRA微调)及效果提升,解决模型泛化性/鲁棒性问题。
2、结合业务场景(如智能客服、内容生成、安全检测),设计多模态融合算法(跨模态表征学习、多任务学习),推动模型在具体场景的效果指标(如意图识别准确率+20%、内容生成相关性+15%)落地。
方向(二):大模型训练与推理性能优化(AIInfra)?
1、负责大模型(LLM/多模态模型)训练/推理全链路性能瓶颈分析,设计量化感知训练(QAT)…
招聘城市:上海
…加速与工程化 (Inference Infra)
高性能引擎: 负责基于 vLLM、TensorRT-LLM、SGLang、Triton Inference Server 等推理框架的开发与优化,提升大模型在线服务的吞吐、时延和资源利用率。
算子优化: 参与 Transformer 核心算子的开发与性能优化,包括 Attention、KV Cache、量化推理、算子融合等方向,探索 CUDA/Triton 等高性能实现方案。
推理架构: 参与构建面向大规模生产环境的推理服务体系,支持高并发、低延迟和高可用的模型服务部署与运维。
工作要求:
面向海内外本硕博在校生
1、技术底色: 计算机相关专业,具有较强的系统编程能力,精通 Python 和 C/C++。
2、计算底层: 熟悉 NVIDIA GPU 架构 (Hopper/Ampere/Blackwall),理解显存层次结构、流处理器(SM)工作原理。
3、框架经验: 熟悉 PyTorch 等深度学习框架…
招聘城市:上海
…MoE、算子融合等方向,持续提升模型训练效率和硬件利用率。
通信优化: 深入优化 H/NCCL通信库,解决 RDMA/RoCE 网络下的通信瓶颈,提升多机多卡并行效率(DP/PP/TP/CP/EP)。
稳定性保障: 构建自动容错与快速恢复系统(Checkpoint 优化、故障自动检测与接续),确保千卡集群在数月跨度的训练中保持极高可用性。
2. 推理加速与工程化 (Inference Infra)
高性能引擎: 负责基于 vLLM、TensorRT-LLM、SGLang、Triton Inference Server 等推理框架的开发与优化,提升大模型在线服务的吞吐、时延和资源利用率。
算子优化: 参与 Transformer 核心算子的开发与性能优化,包括 Attention、KV Cache、量化推理、算子融合等方向,探索 CUDA/Triton 等高性能实现方案。
推理架构: 参与构建面向大规模生产环境…

深圳市大数据研究院 2026招聘

全职 深圳
招聘城市:深圳
…员(AIInfra
2
博士
计算机科学技术或人工智能
1、负责大模型系统架构创新与性能优化,研究分布式训练框架(Megatron-LM、DeepSpeed、Colossal-AI等),设计模型并行、流水线并行、MoE、长上下文、RL训推一体等高效扩展方案,提升千亿级大模型训练效率与稳定性。
2、开展大模型推理与工程化研究,优化低延迟、高吞吐推理体系(动态批处理、KVCache、量化、模型压缩、动态加载等),搭建轻量化部署、服务化框架与高效微调工具链,支持边缘与云端场景落地。
3、深耕软硬件协同设计,针对GPU、国产算力芯片(昇腾、寒武纪等)及RDMA等硬件特性进行深度适配与调度优化,攻克显存瓶颈、通信开销、算子/编译优化等关键工程问题。
4、探索前沿系统技术方向,包括…

地平线 日常实习

兼职 北京,上海,南京,香港,深圳,杭州
招聘城市:北京,上海,南京,香港,深圳,杭州
上场,与世界交手 | 地平线2026年春季校园招聘正式启动
地平线招聘
网申时间:2026-03-18 ~ 2026-05-17
校招摘要:
公司名称: 地平线(Horizon Robotics)
招聘活动: 地平线2026年春季校园招聘
招聘对象: 2026届应届毕业生(含硕博)、在读本硕博实习生
招聘岗位: 专项人才计划(博士岗)与日常实习生岗位,涵盖算法、软件、硬件、测试、产品、市场、人力等方向,具体包括:多模态大模型算法、运动控制(具身方向)、强化学习算法、通用操作(具身方向)、编译器/工具链研发、AI infra(训练/推理)、AI加速算法、深度学习框架、视觉基模、大模型量化算法、NPU架构、算法、软件、测试、技术支持、财务、设计、供应链、生态拓展、市场品牌、投融资、人力资源等。
工作城市: 北京、上海、南京、深圳、杭州、香港…

地平线 上场,与世界交手地平线2026年春季校园招聘正式启动

全职 北京,上海,南京,香港,深圳,杭州
招聘城市:北京,上海,南京,香港,深圳,杭州
…的解决方案整合了领先的算法、专用的软件和先进的处理硬件,为基础辅助驾驶和全场景辅助驾驶提供核心技术。
招聘摘要: 公司名称:地平线(Horizon Robotics)招聘活动名称:地平线2026年春季校园招聘招聘对象:专项人才计划:面向2025年9月1日-2026年8月31日毕业的海内外应届博士;2026年9月1日及以后毕业的海内外在读博士。日常实习生:面向全体在校本硕博同学。招聘岗位:专项人才计划岗位:多模态大模型算法、运动控制(具身方向)、强化学习算法、通用操作(具身方向)、编译器/工具链研发、AI infra(训练/推理)、AI加速算法、深度学习框架、视觉基模、大模型量化算法、NPU架构。日常实习生岗位:算法、软件、测试、技术支持、财务…