招聘城市:北京
岗位职责:
1.负责大语言模型(LLM)推理能力的核心技术研发,包括数学推理、逻辑推理、知识推理和通用任务(如问答、翻译等)的算法研发、优化与创新,提升大模型在复杂场景下的高阶推理能力;
2.跟踪推理领域的前沿技术,参与前沿算法研究,推动研究成果在业务场景的落地应用。
岗位要求:
1.计算机科学、数学、人工智能等相关专业硕士及以上学历;
2.具备良好的数理基础和 NLP 技术基础,能够熟练使用 HuggingFace,Megatron,DeepSpeed,PyTorch 等框架至少一种,深入理解Transformer、GPT等模型架构;
3.在Post-training方向有一定研究基础,熟悉SFT/DPO/PPO/GRPO/Reward Model等;
4.具备良好的分析和解决问题的能力,针对具体的应用场景能合理设计和优化算法并应用;
5…
招聘城市:北京
岗位职责:
1.基座大模型(LLM)推理能力和通用能力的核心技术研发,包括数学推理、代码、逻辑推理、知识推理、创作、多轮对话、问答、翻译等任务的算法研发、优化,突破模型智力上限;
2.提升基座大模型在复杂场景的高阶处理能力,如多轮交互(复杂指令遵循、多轮对话、角色扮演等)、Agent 能力( 融合“思考模式”与“非思考模式”,实现自主、精准的函数与工具调用);
3.跟踪前沿技术,参与前沿算法研究,如研发更高效的强化学习(RL)训练算法、探索自适应思考深度的模型优化算法、探索提升思维链的 “智能密度” 的方法等,推动研究成果在业务场景的落地应用;
4.对于探索前沿技术有很好的热情,具备独立探索前沿技术的能力,有良好的团队协作和沟通能力…
招聘城市:北京
岗位职责:
1.基座大模型(LLM)推理能力和通用能力的核心技术研发,包括数学推理、代码、逻辑推理、知识推理、创作、多轮对话、问答、翻译等任务的算法研发、优化,突破模型智力上限;
2.提升基座大模型在复杂场景的高阶处理能力,如多轮交互(复杂指令遵循、多轮对话、角色扮演等)、Agent 能力( 融合“思考模式”与“非思考模式”,实现自主、精准的函数与工具调用);
3.跟踪前沿技术,参与前沿算法研究,如研发更高效的强化学习(RL)训练算法、探索自适应思考深度的模型优化算法、探索提升思维链的 “智能密度” 的方法等,推动研究成果在业务场景的落地应用;
4.对于探索前沿技术有很好的热情,具备独立探索前沿技术的能力,有良好的团队协作和沟通能力…
招聘城市:北京
…业务场景的落地。
岗位要求:
1.计算机相关专业,本科及以上学历;
2.熟悉 linux 开发环境,优秀的 C++ 编程经验,熟练掌握常用数据结构与算法,有一定的软件工程能力和良好的编程能力;
3.了解常见的深度学习训练框架(如 HuggingFace,Megatron,DeepSpeed,PyTorch) 以及推理框架(如 VLLM、SGLang、TRT);
4.具备良好的逻辑思维、快速学习能力、分析和解决问题的能力;
5.对于探索前沿技术有很好的热情,具备独立探索前沿技术的能力,有良好的团队协作和沟通能力。
加分项:
1.主导过基座大模型后训练项目,并在性能优化、稳定性优化方面取得过显著成效;
2.了解 GPU 硬件架构,有 CUDA 编程经验,熟悉各种网络底层算子实现细节;
3.有 ACM/ICPC 等算法竞赛奖项。
招聘城市:北京
岗位职责:
1.参与微信大规模语言模型(WeLM)的建设,涵盖基座模型训练、模型价值对齐、推理模型研发、智能体研发等环节;
2.设计、实现、优化大规模分布式模型训练各环节的效率;
3.独立或与其他研究员合作进行前沿领域研究;
4.与产品团队、数据团队合作研发有竞争力的AI应用。
岗位要求:
1.有大型自然语言处理项目研发经历并取得过优秀成果;
2.对于学习和参与搭建大规模的复杂AI系统充满热情;
3.计算机科学、数学、物理或相关领域学位。
加分项:
1.能在快速变化的环境中自主推动新研究想法,从概念构思、实验到产品化的全过程;
2.有GPU编程经验者优先;
3.有分布式系统开发经验者优先。
招聘城市:深圳
岗位职责:
1.面向AI应用场景的大模型微调,优化PostTraining (SFT/RM/RL) 算法的训练效率和实际用户体验效果;
2.研究各领域高质量数据的自动化合成方法,建设高效的线上数据飞轮链路;
3.配合产品和工程,探索LLM在创作、教育、金融、代码等场景下的创新应用。
岗位要求:
1.研究生及以上学历,计算机、人工智能、数学等相关专业(有数学、编程竞赛加分);
2.多年NLP/深度学习研发经验,至少1年大模型应用相关实战经验;
3.深入理解LLM技术栈(如SFT、RM、RLHF、数据合成等);
4.熟悉Python/PyTorch,以及Transformer、MoE等核心网络架构;具备扎实的代码能力(Python/C++);
5.在ACL/EMNLP/NeurIPS等顶会发表LLM相关论文者加分。
岗位介绍:
渴望…
招聘城市:广州
…构建能深度理解行业规则、违规模式与风险信号的模型,支持高质量内容安全审核和账号风控打击;
2.针对大模型应用行算法优化,包括但不限于数据处理加速、模型训练效率提升、推理速度优化等,确保大模型能够在实际应用场景中有效落地;
3.探索并落地多模态大模型前沿技术在安全领域的应用,如强化学习对齐、领域知识注入、跨模态信息对齐、持续预训练/后训练等,推动技术创新与业务价值结合。
岗位要求:
1.硕士及以上学历,计算机、人工智能、机器学习等相关专业背景;
2.3年以上大模型或多模态算法研发经验,熟练掌握至少一种主流深度学习框架(PyTorch优先),精通Python编程;有CUDA并行优化或大规模训练经验者优先;…
招聘城市:北京
岗位职责:
参与微信大规模语言模型(WeLM)的建设,涵盖训练流程的多个环节
1.探索大规模预训练模型的结构创新、优化器策略创新,提升单位算力下的智能获取效率
2.探索更高效全面的预训练数据建设方案、预训练数据使用方案
3.建设通用 Long-Horizon LLM Agent 的训练策略
4.独立或与其他研究员合作进行前沿领域研究。
岗位要求:
1.有大型自然语言处理项目研发经历并取得过优秀成果
2.对于学习和参与搭建大规模的复杂 AI 系统充满热情
3.计算机科学、数学、物理或相关领域学位
4.重视研究与工程成果的实际影响力
加分项:
a.能在快速变化的环境中自主推动新研究想法,从概念构思、实验到产品…
招聘城市:北京
岗位职责:
1.面向AI应用场景的大模型微调,优化PostTraining (SFT/RM/RL) 算法的训练效率和实际用户体验效果;
2.研究各领域高质量数据的自动化合成方法,建设高效的线上数据飞轮链路;
3.配合产品和工程,探索LLM在创作、教育、金融、代码等场景下的创新应用。
岗位要求:
1.研究生及以上学历,计算机、人工智能、数学等相关专业(有数学、编程竞赛加分);
2.多年NLP/深度学习研发经验,至少1年大模型应用相关实战经验;
3.深入理解LLM技术栈(如SFT、RM、RLHF、数据合成等);
4.熟悉Python/PyTorch,以及Transformer、MoE等核心网络架构;具备扎实的代码能力(Python/C++);
5.在ACL/EMNLP/NeurIPS等顶会发表LLM相关论文者加分。
岗位介绍:
渴望…
招聘城市:上海
岗位职责:
1.面向AI应用场景的大模型微调,优化PostTraining (SFT/RM/RL) 算法的训练效率和实际用户体验效果;
2.研究各领域高质量数据的自动化合成方法,建设高效的线上数据飞轮链路;
3.配合产品和工程,探索LLM在创作、教育、金融、代码等场景下的创新应用。
岗位要求:
1.硕士及以上学历,计算机、人工智能、数学等相关专业(有数学、编程竞赛加分);
2.多年NLP/深度学习研发经验,至少1年大模型应用相关实战经验;
3.深入理解LLM技术栈(如SFT、RM、RLHF、数据合成等);
4.熟悉Python/PyTorch,以及Transformer、MoE等核心网络架构;具备扎实的代码能力(Python/C++);
5.在ACL/EMNLP/NeurIPS等顶会发表LLM相关论文者加分。
岗位介绍:
渴望为…
招聘城市:上海
岗位职责:
1.面向AI应用场景的大模型微调,优化PostTraining (SFT/RM/RL) 算法的训练效率和实际用户体验效果;
2.研究各领域高质量数据的自动化合成方法,建设高效的线上数据飞轮链路;
3.配合产品和工程,探索LLM在创作、教育、金融、代码等场景下的创新应用。
岗位要求:
1.研究生及以上学历,计算机、人工智能、数学等相关专业(有数学、编程竞赛加分);
2.多年NLP/深度学习研发经验,至少1年大模型应用相关实战经验;
3.深入理解LLM技术栈(如SFT、RM、RLHF、数据合成等);
4.熟悉Python/PyTorch,以及Transformer、MoE等核心网络架构;具备扎实的代码能力(Python/C++);
5.在ACL/EMNLP/NeurIPS等顶会发表LLM相关论文者加分。
岗位介绍:
渴望…
招聘城市:广州
…职责:
1.负责大模型训练框架的开发和优化,支撑高效稳定的大规模训练任务;
2.参与大模型应用层面的开发,包含 Agent 应用、RAG 实现与调优、数据合成、自动化测评等。
岗位要求:
1.熟练掌握 C/C++/Python 等至少一门编程语言,具备扎实的数据结构和算法功底;
2.有海量服务开发经验,熟悉分布式系统设计与优化,具备良好的工程素养;
3.熟悉主流大模型训练框架 Megatron/DeepSpeed,熟悉分布式训练调优;
4.具备良好的数据处理能力,具备快速学习能力,有团队合作精神;
5.对于探索前沿技术有热情,具备独立探索前沿技术的能力。
加分项:
1.熟悉大模型相关算法,参与过百卡以上训练任务优先;
2.有大模型应用研发经验,熟悉 Agent 构建…
招聘城市:北京
岗位职责:
1.面向AI应用场景的大模型微调,优化PostTraining (SFT/RM/RL) 算法的训练效率和实际用户体验效果;
2.研究各领域高质量数据的自动化合成方法,建设高效的线上数据飞轮链路;
3.配合产品和工程,探索LLM在创作、教育、金融、代码等场景下的创新应用。
岗位要求:
1.研究生及以上学历,计算机、人工智能、数学等相关专业(有数学、编程竞赛加分);
2.多年NLP/深度学习研发经验,至少1年大模型应用相关实战经验;
3.深入理解LLM技术栈(如SFT、RM、RLHF、数据合成等);
4.熟悉Python/PyTorch,以及Transformer、MoE等核心网络架构;具备扎实的代码能力(Python/C++);
5.在ACL/EMNLP/NeurIPS等顶会发表LLM相关论文者加分。
岗位介绍:
渴望…
招聘城市:广州
…职责:
1.负责大模型训练框架的开发和优化,支撑高效稳定的大规模训练任务;
2.参与大模型应用层面的开发,包含 Agent 应用、RAG 实现与调优、数据合成、自动化测评等。
岗位要求:
1.熟练掌握 C/C++/Python 等至少一门编程语言,具备扎实的数据结构和算法功底;
2.有海量服务开发经验,熟悉分布式系统设计与优化,具备良好的工程素养;
3.熟悉主流大模型训练框架 Megatron/DeepSpeed,熟悉分布式训练调优;
4.具备良好的数据处理能力,具备快速学习能力,有团队合作精神;
5.对于探索前沿技术有热情,具备独立探索前沿技术的能力。
加分项:
1.熟悉大模型相关算法,参与过百卡以上训练任务优先;
2.有大模型应用研发经验,熟悉 Agent 构建…
招聘城市:广州
岗位职责:
1.负责多模态大模型(图文、视频)在红点推送、本地生活推荐等业务场景中的技术探索与落地应用,提升内容生成精准度和用户转化效率;
2.结合业务数据特点,优化多模态模型的后训练、领域微调、生成控制等技术,实现文案创意生成、个性化推荐、分发策略联动的闭环优化;
3.深入理解用户行为和场景需求,探索多模态生成模型与推荐系统的深度融合,提升内容触达的实时性和相关性。
岗位要求:
1.计算机科学、人工智能、自然语言处理等相关专业硕士以上学历;
2.熟练掌握大模型训练、微调(如LoRA/P-tuning)、生成控制(如Prompt Engineering、Reward Model)等技术;
3.具备文案生成、推荐系统或大模型应用落地经验者优先。
招聘城市:深圳
…定向进行数据补充与配方调整,实现"评测发现问题-数据定向强化-效果闭环提升",持续驱动模型游戏核心能力的演进;
3.追踪与研究支撑大模型在游戏业务落地的前沿技术,关注基于执行反馈的3、强化学习(RLAIF/RLCE)、代码自验证生成、AI SWE、多模态内容生成、游戏智能体(Game Agent)等方向,能够将最新研究成果快速转化为游戏业务价值。
岗位要求:
1.计算机相关专业,具备较强的动手能力;熟悉 Python ,具备扎实的系统编程功底和优秀的复杂系统 Debug 能力;
2.训练框架经验: 深入理解大模型分布式训练原理,具备 Megatron-LM、DeepSpeed 或 PyTorch FSDP 等主流框架的实际源码级开发与定制经验;
3.RL 与 RL Infra 储备: 熟悉大模型后训练与对齐技术(PPO…
招聘城市:北京
岗位职责:
参与微信大规模语言模型(WeLM)的建设,涵盖训练流程的多个环节
1.探索大规模预训练模型的结构创新、优化器策略创新,提升单位算力下的智能获取效率
2.探索更高效全面的预训练数据建设方案、预训练数据使用方案
3.建设通用 Long-Horizon LLM Agent 的训练策略
4.独立或与其他研究员合作进行前沿领域研究。
岗位要求:
1.有大型自然语言处理项目研发经历并取得过优秀成果
2.对于学习和参与搭建大规模的复杂 AI 系统充满热情
3.计算机科学、数学、物理或相关领域学位
4.重视研究与工程成果的实际影响力
加分项:
a.能在快速变化的环境中自主推动新研究想法,从概念构思、实验到产品…
招聘城市:广州
…等训练方案设计落地,以及训练效果评估;
2.建设代码任务验证与奖励信号体系,综合运用多种验证策略,持续建模和校准奖励信号,为 RLVR 训练提供稳定、细粒度、可解释的反馈;
3.跟踪大模型后训练前沿技术,探索强化学习算法优化、奖励建模与 Agentic Coding 等方向,并推动在业务场景中落地。
岗位要求:
1.计算机、数学等相关专业本科及以上学历,熟练使用 Python,具备良好的工程能力;
2.扎实的计算机与深度学习基础,深入理解 Transformer 架构及主流大模型训练框架;
3.具备大模型后训练项目经验,熟悉 SFT 与 RLVR 训练流程,理解奖励信号设计、强化学习算法调优与训练稳定性问题;
4.具备较强的数据处理与实验分析能力,能进行训练数据…
招聘城市:深圳
岗位职责:
1.负责大语言模型后训练(Post-Training)阶段的核心技术研发,构建和优化高质量的奖励系统(Reward System),通过Reward Modeling (RM) 和强化学习(RL)算法持续提升模型在复杂指令遵循、逻辑推理及价值观对齐方面的能力;
2.深入研究和优化 RLHF等后训练算法,提升模型训练的稳定性和最终效果;
3.负责后训练阶段的数据合成与管理,设计高效的数据飞轮机制,利用SFT、Self-Instruct等技术合成高质量训练数据,并负责建立从用户反馈(User Feedback)到模型迭代的闭环信号建模体系;
4.负责后训练模型的全维度评测与分析,制定科学的评价指标,跟进前沿技术动态,将最新研究成果快速转化为业务价值。
岗位要求:
1.计算机科学/软件工程…
招聘城市:广州
岗位职责:
1.探索大模型在电商场景的应用;
2.利用大模型优化电商推荐效果,包括但不限于召回、排序等环节;
3.跟踪大模型的前沿进展,研究数据合成、后训练等方法,推动模型在实际场景中的效果优化。
岗位要求:
1.具备扎实的NLP/深度学习研发经验,有大模型应用的相关实践经历,具备RAG和问答系统经验者优先;
2.深入理解LLM技术栈(如SFT、RM、RLHF、数据合成等)。
加分项:
1.ACL、EMNLP、NeurIPS 等顶级会议发表过大模型相关论文者优先。
岗位介绍:
渴望为世界带来新意的人,早已对描绘未来的“热词”不陌生——人工智能、机器学习、数据科学等等。腾讯始终在业界前沿不断探索,积极布局,并为优秀的你提供无限广阔的…