招聘城市:北京
岗位职责:
1.基座大模型(LLM)推理能力和通用能力的核心技术研发,包括数学推理、代码、逻辑推理、知识推理、创作、多轮对话、问答、翻译等任务的算法研发、优化,突破模型智力上限;
2.提升基座大模型在复杂场景的高阶处理能力,如多轮交互(复杂指令遵循、多轮对话、角色扮演等)、Agent 能力( 融合“思考模式”与“非思考模式”,实现自主、精准的函数与工具调用);
3.跟踪前沿技术,参与前沿算法研究,如研发更高效的强化学习(RL)训练算法、探索自适应思考深度的模型优化算法、探索提升思维链的 “智能密度” 的方法等,推动研究成果在业务场景的落地应用;
4.对于探索前沿技术有很好的热情,具备独立探索前沿技术的能力,有良好的团队协作和沟通能力…
招聘城市:北京
岗位职责:
1.基座大模型(LLM)推理能力和通用能力的核心技术研发,包括数学推理、代码、逻辑推理、知识推理、创作、多轮对话、问答、翻译等任务的算法研发、优化,突破模型智力上限;
2.提升基座大模型在复杂场景的高阶处理能力,如多轮交互(复杂指令遵循、多轮对话、角色扮演等)、Agent 能力( 融合“思考模式”与“非思考模式”,实现自主、精准的函数与工具调用);
3.跟踪前沿技术,参与前沿算法研究,如研发更高效的强化学习(RL)训练算法、探索自适应思考深度的模型优化算法、探索提升思维链的 “智能密度” 的方法等,推动研究成果在业务场景的落地应用;
4.对于探索前沿技术有很好的热情,具备独立探索前沿技术的能力,有良好的团队协作和沟通能力…
招聘城市:北京
…业务场景的落地。
岗位要求:
1.计算机相关专业,本科及以上学历;
2.熟悉 linux 开发环境,优秀的 C++ 编程经验,熟练掌握常用数据结构与算法,有一定的软件工程能力和良好的编程能力;
3.了解常见的深度学习训练框架(如 HuggingFace,Megatron,DeepSpeed,PyTorch) 以及推理框架(如 VLLM、SGLang、TRT);
4.具备良好的逻辑思维、快速学习能力、分析和解决问题的能力;
5.对于探索前沿技术有很好的热情,具备独立探索前沿技术的能力,有良好的团队协作和沟通能力。
加分项:
1.主导过基座大模型后训练项目,并在性能优化、稳定性优化方面取得过显著成效;
2.了解 GPU 硬件架构,有 CUDA 编程经验,熟悉各种网络底层算子实现细节;
3.有 ACM/ICPC 等算法竞赛奖项。
招聘城市:深圳
岗位职责:
负责微信视觉基座模型的核心技术研发与业务落地,构建统一的视觉理解与解析能力,支持在微信C端及视频号、公众号、微信小店等业务场景中的规模化应用。
岗位要求:
1.深度参与过业界主流视觉基础模型或多模态大模型的研发工作,系统理解整体技术架构与训练方法。
2.精通大规模模型训练范式,包括预训练(Pretraining)、监督微调(SFT)、多任务联合训练、蒸馏训练、后训练(如 RLHF/DPO 等),理解训练稳定性及效率优化方法。
3.熟悉视觉核心任务中的一种或多种,包括目标检测、分割、图片理解或视觉语言模型(VLM)等方向,熟悉 VLM for Grounding。
4.具备大规模数据构建与治理经验,熟悉自动标注、弱监督学习、数据蒸馏等…
招聘城市:北京
岗位职责:
1.参与微信大规模语言模型(WeLM)的建设,涵盖基座模型训练、模型价值对齐、推理模型研发、智能体研发等环节;
2.设计、实现、优化大规模分布式模型训练各环节的效率;
3.独立或与其他研究员合作进行前沿领域研究;
4.与产品团队、数据团队合作研发有竞争力的AI应用。
岗位要求:
1.有大型自然语言处理项目研发经历并取得过优秀成果;
2.对于学习和参与搭建大规模的复杂AI系统充满热情;
3.计算机科学、数学、物理或相关领域学位。
加分项:
1.能在快速变化的环境中自主推动新研究想法,从概念构思、实验到产品化的全过程;
2.有GPU编程经验者优先;
3.有分布式系统开发经验者优先。
招聘城市:广州
…构建能深度理解行业规则、违规模式与风险信号的模型,支持高质量内容安全审核和账号风控打击;
2.针对大模型应用行算法优化,包括但不限于数据处理加速、模型训练效率提升、推理速度优化等,确保大模型能够在实际应用场景中有效落地;
3.探索并落地多模态大模型前沿技术在安全领域的应用,如强化学习对齐、领域知识注入、跨模态信息对齐、持续预训练/后训练等,推动技术创新与业务价值结合。
岗位要求:
1.硕士及以上学历,计算机、人工智能、机器学习等相关专业背景;
2.3年以上大模型或多模态算法研发经验,熟练掌握至少一种主流深度学习框架(PyTorch优先),精通Python编程;有CUDA并行优化或大规模训练经验者优先;…
招聘城市:北京
岗位职责:
1.负责大语言模型(LLM)推理能力的核心技术研发,包括数学推理、逻辑推理、知识推理和通用任务(如问答、翻译等)的算法研发、优化与创新,提升大模型在复杂场景下的高阶推理能力;
2.跟踪推理领域的前沿技术,参与前沿算法研究,推动研究成果在业务场景的落地应用。
岗位要求:
1.计算机科学、数学、人工智能等相关专业硕士及以上学历;
2.具备良好的数理基础和 NLP 技术基础,能够熟练使用 HuggingFace,Megatron,DeepSpeed,PyTorch 等框架至少一种,深入理解Transformer、GPT等模型架构;
3.在Post-training方向有一定研究基础,熟悉SFT/DPO/PPO/GRPO/Reward Model等;
4.具备良好的分析和解决问题的能力,针对具体的应用场景能合理设计和优化算法并应用;
5…
招聘城市:北京
岗位职责:
1.负责社交大模型方向的记忆检索、Agent函数调用、风格化基座模型等方向的算法突破;
2.紧密贴合业务,通过后训练(SFT&RL)提升模型的专项问题解决能力;
3.基于微信场景数据提供技术解决方案,探索业界前沿技术在业务中的落地与指标优化。
岗位要求:
1.硕士或博士学位,机器学习、人工智能、自然语言处理或相关领域的专业背景;
2.在post-training方向或RL方向有一定研究基础优先;
3.高质量相关论文NeurIPS、ACL、ICML、EMNLP作者优先;
4.有大型语言模型算法研究或落地经验者优先;
5.热爱探索AI前沿技术,具有团队精神和良好的沟通能力。
加分项:
1.北京、广州base均可。
岗位介绍:
渴望为世界带来新意的人,早已对…
招聘城市:成都
…奖励模型、强化学习等方向进行方案设计、数据构建与训练落地,持续提升真实场景下的规划、推理、工具调用与指令遵循能力;
2.针对 Agent 任务执行中的能力短板(如多步规划、抗干扰与幻觉抑制等),设计定向的训练优化方案,并构建数据合成、清洗与质量评估管线;面向意图识别等特定场景模型进行训练与优化,结合业务需求完成定制化的能力构建;
3.持续跟踪并引入后训练领域的最新技术,推动技术在实际业务的创新落地。
岗位要求:
1.计算机、人工智能、机器学习、数学等相关专业,硕士及以上学历,具备扎实的计算机基础与算法基础,2 年以上相关领域工作经验;
2.深入理解大语言模型与 Agent 技术体系,熟练掌握主流后训练技术(SFT…
招聘城市:上海,北京,杭州
…架构、Diffusion训练/推理等新一代大模型范式;
2、后训练:SFT数据合成、拒绝采样、数据配比、模型训练,样本级标签体系建设,RL数据合成、Reward Model设计、router replay、RL算法创新,显著提升alignment阶段模型生成能力;
3、数据&评测:持续改进数据体系pipeline,包括:数据收集、清洗、去重和配比等,合成各种高质量agentic/reasoning训练数据,提升模型通用能力;持续完善大模型评估体系和Bench,能有效评估STEM、math、code、知识、指令跟随、多语言等维度能力。
任职要求:
1、背景: 计算机、电子、数学等相关专业硕士/博士;深入理解大模型训练、推理和数据构建流程; -
2、专业深耕:在预训练(数据配比,模型结构,AI Infra)、SFT(e.g. 数据合成、拒绝采样)、强化学习(e.g. Reward Model,GRPO/PPO) 或 模型推理(e.g…
招聘城市:北京,上海,杭州
…等前沿方向,探索超越纯预训练范式的新能力边界,构建可持续学习、可记忆、可进化的智能系统。
1. Post-Training 核心研究与系统构建
设计并实现面向 推理能力、策略优化和长期表现 的后训练方法
探索 Reasoning RL Scaling、RLAIF for Fuzzy Task、Self-Play、Scalable Oversight 等在大模型中的新用法
将 Post-Training 视为 系统级优化问题,而非单次调参或 reward hacking
2. 强化学习与持续进化机制
设计基于试错和反馈的训练闭环(例如,Natural Language FeedBack),使模型具备自我修正和能力生长
探索 RL 在 边缘能力、长尾任务、工具使用和复杂决策 中的作用
研究长期学习(Lifelong Learning)、稳定性、遗忘控制等关键问题
3. 多模态与“世界建模”
参与多模态模型(尤其是…
招聘城市:北京
…负责生成式大模型预训练相关的工作,包括但不限于:大规模模型预训练,长文本预训练,线性模型结构探索;
2.探索与跟进前沿技术,寻求技术突破,推动机器在AIGC能力的提升和突破;
3.探索高效的模型知识嵌入方法以及模型知识在线学习更新;
4.探索文本模型预训练的scaling law,在小规模小成本下更精准地预测大规模训练后的表现。
岗位要求:
1.熟练掌握Python,熟悉Linux环境开发,精通应用深度学习框架TensorFlow或者PyTorch;
2.持续跟进前沿的深度学习技术,了解前沿的深度学习相关算法,熟悉Transformer等模型结构;
3.具备分析问题定义问题和解决问题能力,具备持续的自驱力来面对挑战;
4.有大规模模型预训练实践经验者…
招聘城市:北京
岗位职责:
1.负责微信生态内的大模型算法研究与落地应用,包括但不限于长文本理解、指令遵循、工具调用等基础能力;
2.紧密贴合实际业务场景,通过大语言模型后训练技术解决专项问题,提升业务指标和用户体验;
3.持续追踪前沿技术动态,并结合微信生态,推动研究成果的业务验证和落地转化。
岗位要求:
1.硕士或博士学位,机器学习、人工智能、自然语言处理或相关领域的专业背景;
2.熟悉主流的大模型后训练技术,具备丰富的模型微调及强化学习的实践经验;
3.有大型语言模型算法研究、复杂Agent系统开发者优先;
4.在人工智能顶级学术会议(如NeurIPS、ACL、ICML、EMNLP、ICLR等)发表过高质量相关论文者优先;
5.热爱并…
招聘城市:北京
岗位职责:
参与微信大规模语言模型(WeLM)的建设,涵盖训练流程的多个环节
1.探索大规模预训练模型的结构创新、优化器策略创新,提升单位算力下的智能获取效率
2.探索更高效全面的预训练数据建设方案、预训练数据使用方案
3.建设通用 Long-Horizon LLM Agent 的训练策略
4.独立或与其他研究员合作进行前沿领域研究。
岗位要求:
1.有大型自然语言处理项目研发经历并取得过优秀成果
2.对于学习和参与搭建大规模的复杂 AI 系统充满热情
3.计算机科学、数学、物理或相关领域学位
4.重视研究与工程成果的实际影响力
加分项:
a.能在快速变化的环境中自主推动新研究想法,从概念构思、实验到产品…
招聘城市:北京
…负责生成式大模型预训练相关的工作,包括但不限于:大规模模型预训练,长文本预训练,线性模型结构探索;
2.探索与跟进前沿技术,寻求技术突破,推动机器在AIGC能力的提升和突破;
3.探索高效的模型知识嵌入方法以及模型知识在线学习更新;
4.探索文本模型预训练的scaling law,在小规模小成本下更精准地预测大规模训练后的表现。
岗位要求:
1.熟练掌握Python,熟悉Linux环境开发,精通应用深度学习框架TensorFlow或者PyTorch;
2.持续跟进前沿的深度学习技术,了解前沿的深度学习相关算法,熟悉Transformer等模型结构;
3.具备分析问题定义问题和解决问题能力,具备持续的自驱力来面对挑战;
4.有大规模模型预训练实践经验者…
招聘城市:北京
岗位职责:
参与微信大规模语言模型(WeLM)多模态基础模型的建设
1.探索研究基于 LLM 的多模态理解训练方案,从预训练开始建设高效智能多模态模型
2.探索研究基于 Long-Horizon 复杂多模场景的通用 Agent 训练策略
3.独立或与其他研究员合作进行前沿领域研究
岗位要求:
1.有大语言模型、强化学习、多模态项目研发经历并取得过优秀成果
2.对于学习和参与搭建大规模的复杂 AI 系统充满热情
3.计算机科学、数学、物理或相关领域学位
4.重视研究与工程成果的实际影响力
加分项:
a.在视觉模态/语音模态有高影响力工作
b.能在快速变化的环境中自主推动新研究想法,从概念构思、实验到产品化的…
招聘城市:北京
岗位职责:
参与微信大规模语言模型(WeLM)的建设,涵盖训练流程的多个环节
1.探索大规模预训练模型的结构创新、优化器策略创新,提升单位算力下的智能获取效率
2.探索更高效全面的预训练数据建设方案、预训练数据使用方案
3.建设通用 Long-Horizon LLM Agent 的训练策略
4.独立或与其他研究员合作进行前沿领域研究。
岗位要求:
1.有大型自然语言处理项目研发经历并取得过优秀成果
2.对于学习和参与搭建大规模的复杂 AI 系统充满热情
3.计算机科学、数学、物理或相关领域学位
4.重视研究与工程成果的实际影响力
加分项:
a.能在快速变化的环境中自主推动新研究想法,从概念构思、实验到产品…
招聘城市:北京
岗位职责:
1.参与开发优化大模型训练框架,支持大规模高效稳定训练;
2.参与大模型结构设计,并联合业务进行模型训练效率和效果验证。
岗位要求:
1.熟练使用PyTorch框架,可对DDP训练的代码进行性能分析和优化;
2.熟练使用主流大模型训练框架DeepSpeed、Megatron,掌握3D并行、ZeRO机制、Flash-Attn等的原理、使用场景、优劣势以及可优化方向;
3.熟练掌握CUDA性能优化手段,有算子编写优化项目经验者优先;
4.对大模型前沿技术比较敏锐者优先;
5.有实际大模型的训练调参和效果评测项目经验的优先;
6.良好的沟通能力、解决问题能力。
招聘城市:广州
…算法团队紧密合作,设计实现高性能的AI搜索大模型,加速最新的大模型技术在搜索场景的落地。
岗位要求:
1.具备较强的动手能力;熟悉 Python ,具备扎实的系统编程功底和优秀的复杂系统 Debug 能力;
2.深入理解大模型分布式训练原理,具备 Megatron-LM、DeepSpeed 或 PyTorch FSDP 等主流框架的开发和优化经验;
3.熟悉大模型后训练与对齐技术(PPO、GRPO、DPO等),熟悉 Verl、ROLL,AReal 等强化学习/分布式计算框架,有实际开发部署并解决相关问题的经验;
4.熟悉最新的大模型结构,熟悉各种软硬件架构,能够结合具体的模型结构和软硬件架构做训练过程的深度优化。
岗位介绍:
在腾讯,后台开发工程师不仅是“又快又稳”的问题解决专家…
招聘城市:深圳
岗位职责:
1.负责大语言模型后训练(Post-Training)阶段的核心技术研发,构建和优化高质量的奖励系统(Reward System),通过Reward Modeling (RM) 和强化学习(RL)算法持续提升模型在复杂指令遵循、逻辑推理及价值观对齐方面的能力;
2.深入研究和优化 RLHF等后训练算法,提升模型训练的稳定性和最终效果;
3.负责后训练阶段的数据合成与管理,设计高效的数据飞轮机制,利用SFT、Self-Instruct等技术合成高质量训练数据,并负责建立从用户反馈(User Feedback)到模型迭代的闭环信号建模体系;
4.负责后训练模型的全维度评测与分析,制定科学的评价指标,跟进前沿技术动态,将最新研究成果快速转化为业务价值。
岗位要求:
1.计算机科学/软件工程…