招聘城市:上海,北京,杭州
…数据配比、模型训练,样本级标签体系建设,RL数据合成、Reward Model设计、router replay、RL算法创新,显著提升alignment阶段模型生成能力;
3、数据&评测:持续改进数据体系pipeline,包括:数据收集、清洗、去重和配比等,合成各种高质量agentic/reasoning训练数据,提升模型通用能力;持续完善大模型评估体系和Bench,能有效评估STEM、math、code、知识、指令跟随、多语言等维度能力。
任职要求:
1、背景: 计算机、电子、数学等相关专业硕士/博士;深入理解大模型训练、推理和数据构建流程; -
2、专业深耕:在预训练(数据配比,模型结构,AI Infra)、SFT(e.g. 数据合成、拒绝采样)、强化学习(e.g. Reward Model,GRPO/PPO) 或 模型推理(e.g. 投机解码)等领域有深厚积累; -
3、工程能力:熟练使用 PyTorch,有Megatron-LM、FDPS…
招聘城市:深圳
…探索与学习等场景中进行大规模实验验证,推动研究成果在行业内的实际应用,并发表具有影响力的学术论文;
3.探索大模型的前沿技术,结合未来实际应用场景,提供创新的技术解决方案;
4.与跨职能团队合作,确保项目进展顺利,并在技术突破方面发挥领导作用。
岗位要求:
1.计算机科学、机器学习、人工智能等相关专业的全球高校博士学位;
2.具有在全球领先企业从事大模型前沿技术工作的经验;
3.精通Python编程语言,并具有基于PyTorch或TensorFlow等深度学习工具的技术开发经验;
4.拥有丰富的学术研究经验,在世界顶尖会议如NeurIPS、ICLR、ICML、ACL、EMNLP等发表过文章,具备深度学习学术或工程项目经验;
5.具备良好的沟通能力…
招聘城市:北京
…大规模模型预训练,长文本预训练,线性模型结构探索;
2.探索与跟进前沿技术,寻求技术突破,推动机器在AIGC能力的提升和突破;
3.探索高效的模型知识嵌入方法以及模型知识在线学习更新;
4.探索文本模型预训练的scaling law,在小规模小成本下更精准地预测大规模训练后的表现。
岗位要求:
1.熟练掌握Python,熟悉Linux环境开发,精通应用深度学习框架TensorFlow或者PyTorch;
2.持续跟进前沿的深度学习技术,了解前沿的深度学习相关算法,熟悉Transformer等模型结构;
3.具备分析问题定义问题和解决问题能力,具备持续的自驱力来面对挑战;
4.有大规模模型预训练实践经验者或有较强的研究能力在机器学习领域顶级会议发表…
招聘城市:北京
岗位职责:
1.参与开发优化大模型训练框架,支持大规模高效稳定训练;
2.参与大模型结构设计,并联合业务进行模型训练效率和效果验证。
岗位要求:
1.熟练使用PyTorch框架,可对DDP训练的代码进行性能分析和优化;
2.熟练使用主流大模型训练框架DeepSpeed、Megatron,掌握3D并行、ZeRO机制、Flash-Attn等的原理、使用场景、优劣势以及可优化方向;
3.熟练掌握CUDA性能优化手段,有算子编写优化项目经验者优先;
4.对大模型前沿技术比较敏锐者优先;
5.有实际大模型的训练调参和效果评测项目经验的优先;
6.良好的沟通能力、解决问题能力。
招聘城市:北京,上海
…策略、模型能力、下游任务的全链路归因能力
建立并持续完善的数据质量、多样性、重复度、覆盖率等评估体系,分析和量化每个维度的影响
针对模型核心能力进行重点强化,包括不限于数学、推理、Code、Agent、ICL、OCR等
探索如何使用更少数据量,达到同样模型能力的策略,持续提升per token的通用能力训练效果
探索基于各类策略
任职要求:
对大模型方向充满兴趣,且能充分意识到数据对于模型能力的重要价值和数据侧的巨大空间
有很好的数据感觉,对人类文明积累下来的优质数据分布有很好的判断
有很好的NLP/多模态经验,在数据和算法方向上有深度的工作
工程能力强,有大规模数据处理的经验
招聘城市:深圳
…相关专业,具备较强的动手能力;熟悉 Python ,具备扎实的系统编程功底和优秀的复杂系统 Debug 能力;
2.深入理解大模型分布式训练原理,具备 Megatron-LM、DeepSpeed 或FSDP 等主流框架研发经验;
3.熟悉大模型后训练与对齐技术(PPO、GRPO、DPO等),熟悉 Verl、ROLL,AReal 等强化学习/分布式计算框架,可以理解并解决 RL过程中的工程痛点;
4.熟悉主流生成模型的原理,在AIGC相关领域具备实际项目经验;
5.具备极强的技术好奇心与自驱力,面对业界无先例的技术难题,能独立思考并推动解决。
加分项:
1.有大规模 RL 训练平台(支持千级 GPU 集群、亿级样本回放)搭建经验;
2.熟悉智能体强化学习(Agentic RL)训练的基础设施优化方案…
招聘城市:上海
…相关专业,具备较强的动手能力;熟悉 Python ,具备扎实的系统编程功底和优秀的复杂系统 Debug 能力;
2.深入理解大模型分布式训练原理,具备 Megatron-LM、DeepSpeed 或FSDP 等主流框架研发经验;
3.熟悉大模型后训练与对齐技术(PPO、GRPO、DPO等),熟悉 Verl、ROLL,AReal 等强化学习/分布式计算框架,可以理解并解决 RL过程中的工程痛点;
4.熟悉主流生成模型的原理,在AIGC相关领域具备实际项目经验;
5.具备极强的技术好奇心与自驱力,面对业界无先例的技术难题,能独立思考并推动解决。
加分项:
1.有大规模 RL 训练平台(支持千级 GPU 集群、亿级样本回放)搭建经验;
2.熟悉智能体强化学习(Agentic RL)训练的基础设施优化方案…
招聘城市:杭州
…相关专业,具备较强的动手能力;熟悉 Python ,具备扎实的系统编程功底和优秀的复杂系统 Debug 能力;
2.深入理解大模型分布式训练原理,具备 Megatron-LM、DeepSpeed 或FSDP 等主流框架研发经验;
3.熟悉大模型后训练与对齐技术(PPO、GRPO、DPO等),熟悉 Verl、ROLL,AReal 等强化学习/分布式计算框架,可以理解并解决 RL过程中的工程痛点;
4.熟悉主流生成模型的原理,在AIGC相关领域具备实际项目经验;
5.具备极强的技术好奇心与自驱力,面对业界无先例的技术难题,能独立思考并推动解决。
加分项:
1.有大规模 RL 训练平台(支持千级 GPU 集群、亿级样本回放)搭建经验;
2.熟悉智能体强化学习(Agentic RL)训练的基础设施优化方案…
招聘城市:北京
…相关专业,具备较强的动手能力;熟悉 Python ,具备扎实的系统编程功底和优秀的复杂系统 Debug 能力;
2.深入理解大模型分布式训练原理,具备 Megatron-LM、DeepSpeed 或FSDP 等主流框架研发经验;
3.熟悉大模型后训练与对齐技术(PPO、GRPO、DPO等),熟悉 Verl、ROLL,AReal 等强化学习/分布式计算框架,可以理解并解决 RL过程中的工程痛点;
4.熟悉主流生成模型的原理,在AIGC相关领域具备实际项目经验;
5.具备极强的技术好奇心与自驱力,面对业界无先例的技术难题,能独立思考并推动解决。
加分项:
1.有大规模 RL 训练平台(支持千级 GPU 集群、亿级样本回放)搭建经验;
2.熟悉智能体强化学习(Agentic RL)训练的基础设施优化方案…
招聘城市:上海,北京
…DirectLLM 大模型 API 服务、QuickSilver 大模型生产部署平台等核心产品,持续赋能社区、商业、交易、安全、数平、研效等多个核心业务,实现 AI 技术高效落地!
1、参与设计实现支持RLHF/DPO等对齐技术的高效训练框架,优化强化学习阶段的Rollout、Reward Model集成、多阶段训练 Pipline;
2、研发支持多机多卡 RL 的分布式训练框架,开发TP/PP/ZeRO-3与RL流程的动态协同机制,解决 RL 算法在超长时序下的显存/通信瓶刭
3、构建端到端后训练工具链,主导框架与 MLOps 平台集成,提供训练可视化、自动超参搜索等生产级能力
4、与公司各算法部门深度合作,参与大语言模型LLM、多模态大模型 MLLM等业务在 SFT/RL领域的…
招聘城市:北京,上海,杭州
…记忆、学习、反思与策略更新机制
将 Agent 视为一个 持续演化的产品级智能体
5. 新范式与新架构探索
对现有 Attention、NTP 等范式保持批判性思考,例如探索全新的
探索新架构、新目标函数、新训练范式在 Post-Training 中的可能性
参与从模型 → 推理过程 → 自学习环境(System-level Scaling)的演进
任职要求:
基础要求
扎实的机器学习 / 深度学习基础,对模型训练全流程有深入理解
熟悉至少一个方向:
强化学习(RL Scaling / RLAIF / Online RL 等)
多模态学习(尤其是视频、时序、感知建模)
Agent / 多智能体系统
良好的工程能力,能将研究想法落地为稳定系统
加分项
有大模型 Post-Training 或 MOE RL Scaling 实战经验
RL Algo & Infra co-design
对 Token 效率、推理效率、多…
招聘城市:北京,上海,杭州
…研究自我评估与修正机制;探索通过 Intrinsic Reward(内在奖励) 替代外部反馈,实现 AI 的持续自我迭代。
4、Lifelong Learning: 赋予模型从长期交互中持续学习的 Meta 能力,提升模型在长程对话中的用户理解力与任务解决成功率。
任职要求:
基础要求
基础能力: 扎实的机器学习与深度学习基础,对大模型模型训练全流程有深入理解;
解决问题: 具备逻辑严密的分析能力,能够从复杂现象中抽象出底层问题并给出系统性方案。
专业能力:具备扎实的机器学习理论基础,能够深刻理解并解决 RL 训练中的各种问题问题,包括 Reward Hacking、Training Stability、Exploration Efficiency等
动手能力:有优秀的算法实现能力和工程性能感知,具备优秀的数据敏锐度, 能够从中数据得到让模型效果…
招聘城市:深圳
岗位职责:
1.框架开发与优化:负责强化学习、模型精调、知识蒸馏等核心模块的设计与开发,提升框架的训练效率与易用性;
2.分布式训练支持:基于Megatron-LM、DeepSpeed等工具,优化大模型分布式训练策略(数据并行/张量并行/流水并行/专家并行等),解决显存、通信与计算瓶颈;
3.工具链构建:参与开发轻量化训练框架(如LLama-Factory、swift),支持快速模型微调、部署及多硬件平台适配;
4.前沿技术探索:跟踪学术动态(如RLHF、MoE架构、FlashMLA、EPLB、DualPipe等),将最新研究成果转化为框架功能,提升产品竞争力;
5.协作与文档:与产品团队紧密配合,提供框架级解决方案;编写技术文档与案例,赋能公有云客户。
岗位要求:
1.计算机科学、数学、电子工程等相关专业…
招聘城市:北京
…大规模模型预训练,长文本预训练,线性模型结构探索;
2.探索与跟进前沿技术,寻求技术突破,推动机器在AIGC能力的提升和突破;
3.探索高效的模型知识嵌入方法以及模型知识在线学习更新;
4.探索文本模型预训练的scaling law,在小规模小成本下更精准地预测大规模训练后的表现。
岗位要求:
1.熟练掌握Python,熟悉Linux环境开发,精通应用深度学习框架TensorFlow或者PyTorch;
2.持续跟进前沿的深度学习技术,了解前沿的深度学习相关算法,熟悉Transformer等模型结构;
3.具备分析问题定义问题和解决问题能力,具备持续的自驱力来面对挑战;
4.有大规模模型预训练实践经验者或有较强的研究能力在机器学习领域顶级会议发表…
招聘城市:北京
岗位职责:
1.负责微信生态内的大模型算法研究与落地应用,包括但不限于长文本理解、指令遵循、工具调用等基础能力;
2.紧密贴合实际业务场景,通过大语言模型后训练技术解决专项问题,提升业务指标和用户体验;
3.持续追踪前沿技术动态,并结合微信生态,推动研究成果的业务验证和落地转化。
岗位要求:
1.硕士或博士学位,机器学习、人工智能、自然语言处理或相关领域的专业背景;
2.熟悉主流的大模型后训练技术,具备丰富的模型微调及强化学习的实践经验;
3.有大型语言模型算法研究、复杂Agent系统开发者优先;
4.在人工智能顶级学术会议(如NeurIPS、ACL、ICML、EMNLP、ICLR等)发表过高质量相关论文者优先;
5.热爱并…
招聘城市:北京,上海
…落地:将引擎能力应用于公司核心业务,主导或参与多模态、大语言模型等前沿AI模型在国产芯片上的训练、微调与推理部署,解决实际落地中的技术难题;
3、极致性能调优:针对各类业务大模型,进行深度的推理调度策略优化和关键算子(Kernel)的性能剖析与极致优化,持续提升系统的吞吐量、降低延迟;
4、生态合作与协同:作为技术接口人,与国产芯片原厂技术支持团队紧密合作,高效推进芯片驱动、基础软件栈的引入、问题排查与版本迭代,确保技术路线顺畅推进。
任职要求:
1、熟练掌握 C++/Python 编程,具备扎实的计算机体系结构、数据结构和算法基础,具备良好的编程习惯;
2、有至少一款非Nvidia GPU的异构计算芯片适配大模型训练…
招聘城市:杭州
岗位职责:
1.框架开发与优化:负责强化学习、模型精调、知识蒸馏等核心模块的设计与开发,提升框架的训练效率与易用性;
2.分布式训练支持:基于Megatron-LM、DeepSpeed等工具,优化大模型分布式训练策略(数据并行/张量并行/流水并行/专家并行等),解决显存、通信与计算瓶颈;
3.工具链构建:参与开发轻量化训练框架(如LLama-Factory、swift),支持快速模型微调、部署及多硬件平台适配;
4.前沿技术探索:跟踪学术动态(如RLHF、MoE架构、FlashMLA、EPLB、DualPipe等),将最新研究成果转化为框架功能,提升产品竞争力;
5.协作与文档:与产品团队紧密配合,提供框架级解决方案;编写技术文档与案例,赋能公有云客户。
岗位要求:
1.计算机科学、数学、电子工程等相关专业…
招聘城市:北京
岗位职责:
1.框架开发与优化:负责强化学习、模型精调、知识蒸馏等核心模块的设计与开发,提升框架的训练效率与易用性;
2.分布式训练支持:基于Megatron-LM、DeepSpeed等工具,优化大模型分布式训练策略(数据并行/张量并行/流水并行/专家并行等),解决显存、通信与计算瓶颈;
3.工具链构建:参与开发轻量化训练框架(如LLama-Factory、swift),支持快速模型微调、部署及多硬件平台适配;
4.前沿技术探索:跟踪学术动态(如RLHF、MoE架构、FlashMLA、EPLB、DualPipe等),将最新研究成果转化为框架功能,提升产品竞争力;
5.协作与文档:与产品团队紧密配合,提供框架级解决方案;编写技术文档与案例,赋能公有云客户。
岗位要求:
1.计算机科学、数学、电子工程等相关专业…
招聘城市:北京,上海
…检索增强、提示词工程等技术,跟进业内大模型应用趋势。
任职要求:
1、本科及以上学历,计算机科学、人工智能、自然语言处理或相关专业;
2、熟悉机器学习、大模型等相关基础理论,熟悉大模型的发展路径,熟悉大模型的微调和评估方法(如全参微调、LoRA等),有大模型应用全流程实际落地经验优先;
3、熟悉并能合理运用后端研发常用技术包括而不限于:存储、缓存、消息、搜索、微服务等,对大模型技术熟悉,对Prompt、RAG、Agent应用范式有调优、落地经验者优先;
4、具备大模型与后端应用领域结合落地经验(如服务化、性能优化、可用性优化),对用户增长领域有一定熟悉了解者优先;
5、具有良好的沟通能力和跨团队…
招聘城市:深圳
…模态等最新业界技术方向的跟踪与探索,攻克大模型关键技术难点。
岗位要求:
1.计算机、人工智能、数学、NLP、金融工程或相关专业硕士以上学历,2年以上NLP/语言大模型研发经验;
2.精通Transformer模型及其变种原理与架构,具备丰富的预训练/微调/强化对齐经验,具备强化学习训练经验优先,有多模态大模型经验优先;
3.熟练掌握Python,熟悉PyTorch/TensorFlow/VeRL/Megatron等框架,具备大规模分布式训练经验;
4.对技术保持高昂的热忱,具备优秀的分析问题和解决问题的能力,能够独立完成技术攻关;具备良好的沟通与协作能力。
加分项:
1.在顶级会议(NeurIPS/ICML/ICLR/ACL/EMNLP等)发表过NLP/大模型相关论文优先;
2.大模型预训练后训练经验两年以上…