招聘城市:北京,上海
…大规模模型的可解释性实验平台与评测工具,将模型行为问题精准回溯至训练数据、训练目标及内部机制层面,并将研究成果直接应用于提升模型的可靠性、安全性、可控性及对齐(Alignment)能力。
【为什么是我们】
1.团队扁平,人才密度高,美团“顶尖人才计划”比例高,近年团队在ICLR、NeurIPS、ICML、ACL等顶会累计发表论文数十篇,团队员工获EMNLP/ACL等Outstanding Paper;
2.参与大语言模型核心技术研发,接触大规模RL、超长上下文、分布式训练和推理优化等前沿技术;
3.充足算力保障,拥有大规模分布式训练环境和丰富数据资源。
任职要求:
【必要项】
1.来自全球Top高校计算机科学、人工智能、数学、物理或相关领域;
2.在大模型领域…
招聘城市:上海
…信息系统;通信工程
工作地址 上海市市辖区松江区
职位要求 岗位要求计算机、人工智能、机器学习、数学等相关专业硕士或博士在读。熟悉机器学习与深度学习基础,了解大模型训练、微调或 post-training 的基本流程。对强化学习有基础理解,熟悉 PPO、GRPO、reward modeling、policy optimization、credit assignment 等概念者优先。熟练使用 Python,熟悉 PyTorch;具备良好的工程实现和实验分析能力。对 LLM 的推理能力、代码智能体、指令遵循、多轮对话、RAG、长文本或多语言中的一个或多个方向有兴趣或实践经验。能独立阅读英文论文,具备较强的问题拆解、实验设计和结果分析能力。每周可实习 4 天及以上,实习期 3 个月以上优先。加分项有 LLM post-training、SFT、RLHF、RLAIF、DPO…
招聘城市:上海
…和深度学习基础,了解大模型训练、微调或 post-training 基本流程。对强化学习有基础理解,熟悉 PPO、GRPO、reward modeling、policy optimization、credit assignment 等概念者优先。熟练使用 Python,熟悉 PyTorch;具备良好的工程实现和实验分析能力。对 AI Agent、工具调用、RAG、多轮推理、任务规划、代码智能体或浏览器智能体有兴趣或实践经验。能独立阅读英文论文,具备较强的问题拆解、实验设计和结果分析能力。每周可实习 4 天及以上,实习期 3 个月以上优先。加分项有 LLM post-training、RLHF、RLAIF、DPO、PPO、GRPO、verl、TRL、Ray、vLLM 等经验。熟悉 SWE-bench、WebArena、OSWorld、GAIA、ALFWorld、WebShop、BrowseComp 等 Agent/长程任务 benchmark。有 coding agent、browser agent、workflow agent、multi-agent system、tool-use agent 项目经验。有自动评测…
招聘城市:北京,上海
…人文训练师及数据团队,把研究成果迅速推向真实场景,打造小红书下一代战略级 AI native 应用产品。
任职要求:
1、本科及以上学历,计算机等相关专业方向优先;
2、扎实机器学习与深度学习基础,熟练掌握PyTorch / JAX / TensorFlow等任一框架;
3、熟悉后训练常用技术(SFT、RLHF / DPO / RLAIF 等)或具备相关项目 / 竞赛 / 论文经验;
4、具备实验设计与问题定位能力,能独立分析大模型在不同数据分布和任务场景下的表现;
5、善于沟通和团队协作,乐于在快速迭代中分享想法、推动落地。
【加分项】
1、有深度参与贡献的顶会(ICML / NeurIPS / ICLR / ACL / CVPR 等)论文;
2、ACM-ICPC、NOI/IOI、Kaggle 等竞赛奖项;
3、参与过开源 / 闭源大模型的 Alignment / Post-Training 项目经历。
招聘城市:北京,上海
…持续探索大语言模型在不同阶段的高效scaling策略;
2、预训练的关键技术探索: 包括从数据策略(筛选,配比,合成,学习效率的提升)、优化技术、可解释性,到下一代模型结构的设计、long context建模、学习范式探索等;
3、通用alignment技术探索: 包括大规模RL的探索,持续提升大模型在通用能力、reasoning、长文本、agent、各方向中长尾知识等多个方向的综合能力,支撑更广泛的应用场景;
4、跟下游的多模态同学一起探索端到端全模态大模型的设计和高效scaling策略;
团队有充足的GPU计算资源,同时跟整个技术社区也有密切合作,开源开放。
任职要求:
1、本科及以上在读,计算机、数学、物理等相关专业方向优先;
2、在大规模数据处理、评测…
招聘城市:北京,上海
…及以上学历,计算机、人工智能、数学等相关专业;
2、深入理解 Transformer 架构与大模型训练全流程(CPT / Mid-train / SFT / RL / OPD),熟悉主流 VLM 架构(如 LLaVA、Qwen-VL、InternVL 等);
3、在大规模预训练、CPT、Mid-training、SFT、RL、在线策略蒸馏(OPD / MOPD)、MLLM 推理优化、视觉对齐或视频理解等方向有深入研究或落地经验;
4、精通 PyTorch,熟悉 Megatron-LM、DeepSpeed 等分布式训练框架,具备百亿/千亿级参数模型的大规模训练经验,熟悉 veRL、OpenRLHF 者优先;
5、对多模态数据的构建、清洗及 Data Mixing 策略有独特见解,理解各训练阶段的数据需求差异;
6、熟悉主流多模态评测集,能构建垂直领域 Benchmark,并以评测结果反向驱动数据与算法迭代。
【加分项】:
1、在 CVPR、ICCV、ECCV…
招聘城市:北京,上海,杭州
…能力,使模型能够进行任务分解、计划生成、工具调用、结果验证和自我修正;
4、建设 VLM Tool-use 能力,支持搜索、知识库、商品库、OCR、ASR、视频分析、审核规则等内部工具调用;
5、优化长视频理解和多帧推理能力,提升模型对视频内容、事件、时序关系和深层语义的理解效率;
6、面向小红书搜索、推荐、广告、电商、审核和内容创作等业务场景,构建数据、训练、评测和上线闭环。
任职要求:
1、本科及以上学历,计算机、人工智能和数学等相关专业;
2、深入理解 Transformer 架构及大模型训练全流程;
3、熟悉主流 VLM 架构(如 LLaVA, Qwen-VL, InternVL 等);
4、在计算机视觉(CV)、多模态学习 或 视频理解 领域有深入研究;
5、在 Search(搜索)、Code(代码生成/工程)、tool-use、alignment…