招聘城市:北京,上海
…工作职责:
1、参与强化学习核心算法的设计、实现与优化,探索 RL 在扩散模型去噪过程中的应用,包括但不限于 PPO、DPO、GRPO、DAPO、ReFL等内容;
2、参与强化学习训练框架建设,搭建并且持续优化 Agentic RL 链路;
3、参与奖励模型和偏好数据集的构建与迭代,设计针对多模态生成质量(美学、一致性、指令遵循)的细粒度评价信号;
4、跟踪 ICML/NeurIPS/ICLR/CVPR 等顶会中 RL+生成模型的前沿动态,将论文成果快速转化为内部技术原型并验证。
工作要求:
1、本科及以上学历,计算机、人工智能、数学、自动化等相关专业(硕士/博士优先);
2、了解自然语言处理、计算机视觉或多模态算法,了解主流的 DiT(Diffusion Transformer) 与 VLM(Vision-Language Model) 模型架构;
3…
招聘城市:上海,北京
…持续演进训练策略与系统能力,提升大规模模型训练效率;
2、深度分析与定位训练系统中的性能瓶颈(包括计算、通信、存储等),实施针对性优化,提升训练吞吐、稳定性与可扩展性;
3、持续跟踪并集成业界前沿的训练优化技术(如 MoE、异步RL、LoRA RL、Agentic RL 等)。
工作要求:
1、本科及以上学历,计算机相关专业;
2、熟悉 Python/C++ 中至少一种编程语言,具备扎实的工程基础;
3、深入理解自然语言处理、计算机视觉或多模态算法,熟悉主流的 DiT(Diffusion Transformer) 与 VLM(Vision-Language Model) 模型架构;
4、熟悉常见强化学习训练算法(如 GRPO、DAPO 等)及训练框架(如 verl),熟悉异步强化学习范式;
5、有相关领域开源项目贡献经验者优先;
6、具备大规模训练实…
招聘城市:上海
…UP 主成长扶持、社区质量治理等问题。
4.跟踪推荐系统、深度学习、大模型、多模态理解、图学习、强化学习、生成式推荐等前沿技术,并推动在真实业务场景中的实验和落地。
5.参与推荐系统数据链路、特征工程、离线训练、在线推理、A/B 实验和效果分析,协助优化大规模推荐服务的稳定性与性能。
6.深入理解产品和业务,通过数据分析发现推荐机制中的问题,提出可验证的算法或策略改进方案,并与产品、工程、运营团队协同推进。
7.参与大模型 API 在推荐系统中的应用探索,包括内容标签生成、视频摘要、评论/弹幕理解、用户兴趣归因、推荐理由生成、冷启动内容理解等方向。
8.结合 LLM、多模态模型与传统推荐算法,探索更高质量的内容…
…Up等;校招岗位有算法 - 多模态方向等;社招岗位涵盖大模型深度LTV - 算法工程师等。最低学历要求本科及以上,招聘人数若干。工作涉及技术、产品、营销等领域,有先进的技术、实用的产品和创新的营销方法。网申流程为点击下方岗位名称,一键投递。欢迎符合条件的人士加入我们。
招聘公告: 了解腾讯营销腾讯营销(原腾讯广告)是腾讯面向企业的统一商业服务平台,依托腾讯技术实力与全域生态,整合微信、QQ等海量用户场景,构建超十亿用户流量矩阵,连接用户与品牌,并为广告主提供全经营链路数字化营销解决方案,帮助广告主实现数字化经营与生意增长。这里有技术: 毫秒级处理海量广告请求,算法、大模型、强化学习…
招聘城市:上海
…职责:
1、参与强化学习训练框架的研发与性能优化,根据业务需求持续演进训练策略与系统能力,提升大规模模型训练效率;
2、深度分析与定位训练系统中的性能瓶颈(包括计算、通信、存储等),实施针对性优化,提升训练吞吐、稳定性与可扩展性;
工作要求:
1、本科及以上学历,计算机相关专业;
2、熟悉 Python/C++ 中至少一种编程语言,具备扎实的工程基础;
3、了解自然语言处理、计算机视觉或多模态算法,了解主流的 DiT(Diffusion Transformer) 与 VLM(Vision-Language Model) 模型架构;
4、了解常见强化学习训练算法(如 GRPO、DAPO 等)及训练框架(如 verl),了解异步强化学习范式;
5、有相关领域开源项目贡献经验者优先;
6、具备大规模训练实操经验者优先。
投递简历
招聘城市:上海
…持续演进训练策略与系统能力,提升大规模模型训练效率;
2、深度分析与定位训练系统中的性能瓶颈(包括计算、通信、存储等),实施针对性优化,提升训练吞吐、稳定性与可扩展性;
3、持续跟踪并集成业界前沿的训练优化技术(如 MoE、异步RL、LoRA RL、Agentic RL 等)。
工作要求:
1、本科及以上学历,计算机相关专业;
2、熟悉 Python/C++ 中至少一种编程语言,具备扎实的工程基础;
3、深入理解自然语言处理、计算机视觉或多模态算法,熟悉主流的 DiT(Diffusion Transformer) 与 VLM(Vision-Language Model) 模型架构;
4、熟悉常见强化学习训练算法(如 GRPO、DAPO 等)及训练框架(如 verl),熟悉异步强化学习范式;
5、有相关领域开源项目贡献经验者优先;
6、具备大规模训练实…
招聘城市:上海
…ReFL等内容;
2、参与强化学习训练框架建设,搭建并且持续优化 Agentic RL 链路;
3、参与奖励模型和偏好数据集的构建与迭代,设计针对多模态生成质量(美学、一致性、指令遵循)的细粒度评价信号;
工作要求:
1、本科及以上学历,计算机、人工智能、数学、自动化等相关专业;
2、了解自然语言处理、计算机视觉或多模态算法,了解主流的 DiT(Diffusion Transformer) 与 VLM(Vision-Language Model) 模型架构;
3、熟悉至少 2 种主流强化学习算法原理,熟悉至少一种强化学习训练框架;
4、熟练使用 PyTorch 框架,有从零复现顶会 RL 论文代码的能力;
5、有 Diffusion Model(DDPM/DDIM/Flow Matching)或 LLM/VLM 的后训练(SFT/RLHF/DPO)项目经验者优先;
6、在 NeurIPS/ICML/ICLR/CVPR/ACL 等会议…
招聘城市:上海
…ReFL等内容;
2、参与强化学习训练框架建设,搭建并且持续优化 Agentic RL 链路;
3、参与奖励模型和偏好数据集的构建与迭代,设计针对多模态生成质量(美学、一致性、指令遵循)的细粒度评价信号;
工作要求:
1、本科及以上学历,计算机、人工智能、数学、自动化等相关专业(硕士/博士优先);
2、了解自然语言处理、计算机视觉或多模态算法,了解主流的 DiT(Diffusion Transformer) 与 VLM(Vision-Language Model) 模型架构;
3、熟悉至少 2 种主流强化学习算法原理,熟悉至少一种强化学习训练框架;
4、熟练使用 PyTorch 框架,有从零复现顶会 RL 论文代码的能力;
5、有 Diffusion Model(DDPM/DDIM/Flow Matching)或 LLM/VLM 的后训练(SFT/RLHF/DPO)项目经验者优先;
6、在 NeurIPS/ICML/ICLR/CVPR…
招聘城市:上海
…参与视频基模音频相关维度的评测体系建设:口型对齐、音效物理合理性、音乐情绪匹配、音画节奏关系等维度的出题、评分细则与打分;
3.用 AI 音乐/音频工具(Suno / Udio / ElevenLabs 等)探索生产链路,沉淀音频工作流与资产库;
4.把声音侧的专业判断转化为模型能力需求,反馈给算法团队。
工作要求:
1.录音艺术/音乐制作/影视声音相关专业,或影视/游戏/音乐行业声音岗位从业经验;
2.具备扎实的听觉审美与音画关系判断力,能讲清"为什么这个声音配这个画面是对的";
3.熟练使用主流 DAW(Logic / Cubase / Pro Tools 等)及音频后期流程;
4.有 AI 音乐/音频工具实际使用经验,对生成式音频的能力边界有认知。
加分项:北电声音学院、中传录音艺术…
招聘城市:上海
…数据挖掘:熟悉搜广推链路或用户增长算法,有用户预测、个性化推荐、因果推断经验;
自然语言处理/LLM:有大语言模型、RAG、Agent、机器翻译、对话系统开发经验;
AIGC与多模态:熟悉音视频生成、视频理解,有游戏视频剪辑、语音/音频合成等经验;
内容风控:熟悉反作弊、内容审核机制或图文/音视频合规算法;
强化学习/博弈决策:熟悉主流RL算法、分布式训练框架,有游戏AIBot落地经验;
5. 具备优秀的工程落地能力、强烈的自驱力,能够独立完成从数据处理、模型训练到部署上线的完整闭环。
【加分项】
1. 有知名游戏AI应用落地、toC大模型应用、多语种本地化项目经验者优先;
2. 具备游戏商业化推荐(礼包/商城)、用户增长或风控算法落地经验者优先…
招聘城市:北京,上海
…深度学习框架,会使用agent框架。
4.具备良好的数据分析能力和工程实现能力。
5.有推荐系统、信息检索、NLP/CV等方向的科研或实习经历优先。
6.有顶会论文发表(KDD/WWW/NeurIPS/SIGIR/CIKM等)优先。
【为什么是我们】
你将参与大众点评亿级用户核心推荐与增长链路,从模型设计、实验验证到线上 A/B,完整体验技术驱动业务增长的闭环。团队在长序列建模、跨域推荐、多目标优化、生成式推荐、LLM4Rec、多模态、强化学习、AutoResearch 等前沿方向持续探索,并服务推荐、智能 Push、留存建模等完整用户生命周期场景。团队兼具顶会论文产出与大规模业务落地经验,配备资深 mentor、论文研讨和完整项目训练,助力你成长为独立负责核心方向的算法专家…