招聘城市:北京,上海
…多场域(如广告、电商、推荐等)通用基础模型的设计与研发,提升模型的泛化与迁移能力
2. 负责跨域学习、序列建模、多模态建模等新范式在业务中的应用。
3. 负责统一的用户/内容表征体系构建,支持长周期用户兴趣建模与动态演化。
4. 探索新一代模型体系构建,提升业务模型技术的天花板
任职要求:
1. 具备扎实的机器学习、深度学习理论基础,对多模态、序列建模、跨域学习、迁移学习有深入理解与实践
2. 有推荐系统、搜索排序或者广告系统等相关业务经验,具备优秀的系统思维与解题能力
3. 掌握主流深度学习框架,具备高质量模型代码实现与调试能力
4. 具备良好的沟通协作能力和技术热情,能够推动跨团队项目高效落地
招聘城市:北京,上海
…问题进行分析、算法设计、研发以及推动上线,提升业务效果;
任职要求:
1.在大模型方向有一定经验,对Pre-train、SFT等技术有深入了解;
2.有良好的英文读写能力和扎实的数学基础,有快速学习新技术的能力;
3.有扎实的编程基础,熟悉Python/C++等编程语言,具有快速复现前沿论文的能力;
4.熟悉至少一个深度学习和大模型训练框架,包括PyTorch、TensorFlow、MXNet、Caffe、HuggingFace、DeepSpeed等;
5.有较强的研究能力,在国际顶尖会议或期刊(包括但不限于CVPR, ICCV, ECCV, NeurIPS, ICML, ICLR, AAAI, IJCAI, ACMMM, TIP, TPAMI, IJCV,ACL、EMNLP、NAACL、COLING、CoNLL、NLPCC等)上发表过论文者优先;
6.较强的业务问题到算法模型的建模能力,有强烈的求知欲、自驱力…
招聘城市:北京,上海
…技术,在更小模型规模下最大化能力保持。
- 业务落地与规模化应用: 将高效率模型应用于小红书 Agent、AI 搜索、传统搜索、推荐、广告等真实用户场景,并持续优化效果与成本。
任职要求:
- 有大模型 Pre-training / Mid-training 经验,熟悉训练数据、模型结构、训练稳定性及大规模分布式训练;
- 有 Knowledge Distillation / Pre-training Distillation / Model Compression / Pruning 等相关经验;
- 有 SFT / RL / RLHF / OPD / Reward Modeling 等 Post-training 经验;
- 有 MoE、Attention、Long Context、Speculative Decoding、并行解码或其他模型效率优化方向研究经验;
- 熟悉 PyTorch,以及 Megatron-LM、DeepSpeed、FSDP、vLLM、SGLang 等训练或推理框架中的一种或多种;
- 具备优秀的问题拆解、工程实现和快速实验迭代能力,能够在复杂真实业务场景中独立推动算法效果落地…
招聘城市:上海,北京,杭州
…数据配比、模型训练,样本级标签体系建设,RL数据合成、Reward Model设计、router replay、RL算法创新,显著提升alignment阶段模型生成能力;
3、数据&评测:持续改进数据体系pipeline,包括:数据收集、清洗、去重和配比等,合成各种高质量agentic/reasoning训练数据,提升模型通用能力;持续完善大模型评估体系和Bench,能有效评估STEM、math、code、知识、指令跟随、多语言等维度能力。
任职要求:
1、背景: 计算机、电子、数学等相关专业硕士/博士;深入理解大模型训练、推理和数据构建流程; -
2、专业深耕:在预训练(数据配比,模型结构,AI Infra)、SFT(e.g. 数据合成、拒绝采样)、强化学习(e.g. Reward Model,GRPO/PPO) 或 模型推理(e.g. 投机解码)等领域有深厚积累; -
3、工程能力:熟练使用 PyTorch,有Megatron-LM、FDPS…
招聘城市:北京,上海
…大语言模型的重塑,突破逐个token预测的方式,实现高效的推理模式,探索全新scaling law;
2、实现大模型训练的数据清洗、合成和评估;设计和实现大模型训练的AI Infra框架。
任职要求:
1、本科及以上学历,计算机、人工智能和数学等相关专业,博士研究生优先;
2、熟练掌握扩散模型设计和使用技巧,在知名大模型公司/团队从事图像或视频生成者优先,有多模态/OMNI大模型理解&生成统一框架经验者优先;
3、有丰富的大模型预训练和后训练数据处理经验,熟练掌握数据收集、数据清洗、数据去重和数据合成等流程,能针对数据质量制定出评估指标和方法,在知名大模型公司/团队长期从事数据技术者优先;
4、MoE/Dense模型…
招聘城市:北京,上海
…学习基础,能熟练使用至少一种深度学习框架(e.g. PyTorch、Jax、TensorFlow、MindSpore、PaddlePaddle)。
2. 对监督学习、强化学习、表示学习等机器学习方法有深入理解并具备相关的实践经验。
3. 在 NLP/CV/RL 等至少一个 AI 领域中有过深入的研究经历,或通过机器学习算法解决过复杂业务场景问题。
4. 具备卓越的实验分析与问题解决能力,有创新思维,能够良好沟通、与团队成员高效协作。
加分项:
1. 有 ICML、ICLR、NeurIPS、ACL、CVPR、AAAI 等顶级学术会议发表过有影响力研究成果的优先。
2. 在 ACM/ICPC、NOI/IOI、Kaggle 等比赛获奖者优先。
3. 主导、参与过 AI 相关的有大影响力的开源/闭源项目的优先。
4. 有 AI Alignment 相关研究或大模型应用…
招聘城市:北京
…多模态理解等任务,研发业界领先的多模态大模型;
2.持续跟进业界最新的多模态大模型算法,参与多模态大模型的设计、训练、调优及评测工作,并推进多模态大模型在业务场景的应用落地。
岗位要求:
1.计算机科学、机器学习、人工智能、应用数学等相关专业,硕士及以上学历;
2.在多模态理解相关领域(包括自然语言处理、计算机视觉、语音理解/生成等)有扎实的研究基础,熟悉一个或多个模态领域的主流模型和算法,如CLIP、LLAVA、VALL-E等;
3.熟悉深度学习框架,如TensorFlow或Pytorch;了解分布式训练框架,如Deepspeed和Meatron-LM等,并有一定的多机多卡分布式训练经验;
4.较强的工程实现能力,熟练掌握C…
招聘城市:北京,上海,杭州
…如GRPO 等)算法,构建高精度的 Reward Model,解决模型在复杂指令下的对齐问题。
推理模型(Reasoning)优化: 探索长链推理(CoT)、强化学习驱动的自反思与自进化机制,提升模型在的 System 2 思维能力。
Agentic RL 与Agency: 研发面向 Search Agent、Code Agent 和 Tool-use Agent 的强化学习方案,提升模型在开放环境中的任务拆解、工具调用及闭环执行能力。
合成数据与模型进化: 探索高质量合成数据的生成与过滤技术,实现模型能力的自我循环与持续进化
任职要求:
我们希望你具备:
背景: 计算机、数学等相关专业硕士/博士;深入理解 Transformer 架构及大模型训练全流程。
专业深耕: 在 Search(搜索)、Code(代码生成/工程)、tool-use、alignment 或 RL(强化学习) 领域有深厚积累。
工程能力: 熟练…
招聘城市:深圳
…AI 原生应用的算法研发和LLM效果优化工作,推动前沿技术的探索和应用;
2.提升智能营销领域自然语言理解能力,比如NL2DSL、文本生成、数学逻辑、向量召回、结构化/非结构化数据处理、短文本/长文本的表征学习等;
3.探索智能体在复杂营销任务中的应用,利用LLM技术实现智能营销活动的自动化和个性化执行,实现大模型应用、增量训练、模型调试、自动化评估等内容。
岗位要求:
1.计算机、数学、机器学习或相关专业硕士及以上学历;
2.具有扎实的机器学习、NLP基础,5年以上大型互联网公司/营销场景算法模型经验者优先;
3.熟悉LLM的训练或Fine-tuning的方法,例如SFT/RLHF、强化学习(RL)等,通过思维链(CoT)提升模型推理效果…
招聘城市:北京,上海
…策略、模型能力、下游任务的全链路归因能力
建立并持续完善的数据质量、多样性、重复度、覆盖率等评估体系,分析和量化每个维度的影响
针对模型核心能力进行重点强化,包括不限于数学、推理、Code、Agent、ICL、OCR等
探索如何使用更少数据量,达到同样模型能力的策略,持续提升per token的通用能力训练效果
探索基于各类策略
任职要求:
对大模型方向充满兴趣,且能充分意识到数据对于模型能力的重要价值和数据侧的巨大空间
有很好的数据感觉,对人类文明积累下来的优质数据分布有很好的判断
有很好的NLP/多模态经验,在数据和算法方向上有深度的工作
工程能力强,有大规模数据处理的经验
招聘城市:深圳
岗位职责:
1.参与商业化领域的多模态基础大模型的研发,包含领域数据挖掘、模型结构设计和训练机制优化等;
2.将商业化领域的多模态大模型应用于用户/内容/广告/商品理解、个性化内容生成、广告搜推等业务领域,提升业务效果;
3.跟踪前沿算法研究(如预训练、后训练、强化学习、持续学习、理解&生成统一模型、图像/视频生成等),在商业化场景进行技术验证与落地。
岗位要求:
1.计算机相关专业硕士及以上学历,博士优先,具有扎实的计算机和机器学习基础,拥有优秀的的编程能力和工程能力;
2.在计算机视觉、多模态、NLP、AIGC、机器学习等一个或多个领域有较深入的研究,包括但不限于LLM/MLLM、商品理解、视频内容…
招聘城市:广州
岗位职责:
1.负责LLM任务优化,探索和应用最前沿LLM技术;
2.提升自然语言理解任务效果,如内容分类、向量召回、结构化/非结构化标签、文本的表征学习等;
3.探索LLM、AI-Agent在复杂任务中的应用,实现基于LLM的复杂任务在微信内的应用落地;
4.结合最前沿的LLM技术,完善用户行为理解、用户画像构建等任务。
岗位要求:
1.出色的分析、解决问题能力,能从复杂业务的数据中分析和推导问题本质;
2.掌握LLM算法原理、Fine-tuning、Prompt Engineering、RLHF等;
3.有主流LLM、AI-Agent算法研发经验者优先;
4.积极主动,责任心强,有良好的沟通能力和团队协作能力。
招聘城市:深圳
岗位职责:
1.负责大语言模型(LLM)代码理解和生成相关的技术研究,提升大模型的代码基础能力;
2.跟进大模型代码领域的前沿技术,将其应用于研发生产中,持续提升大模型的代码能力;
3.负责大模型的代码相关的数据构建、训练调优及评测迭代,推进大模型技术在代码补全,Text2SQL,代码问答,代码Agent等业务场景落地。
岗位要求:
1.自然语言处理/机器学习/模式识别/人工智能/计算机等相关专业硕士以上学历;
2.在NLP、LLM、深度学习、强化学习方面有一定研究基础,熟悉主流模型和算法,并有一定的实践经验;
3.较强的工程实现能力,熟练掌握C/C++,Python等至少一种语言,有实际编程项目经验,熟悉DeepSpeed、Megatron等分布式训练…
招聘城市:广州
岗位职责:
1.负责LLM任务优化,探索和应用最前沿LLM技术;
2.提升自然语言理解任务效果,如内容分类、向量召回、结构化/非结构化标签、文本的表征学习等;
3.探索LLM、AI-Agent在复杂任务中的应用,实现基于LLM的复杂任务在微信内的应用落地;
4.结合最前沿的LLM技术,完善用户行为理解、用户画像构建等任务。
岗位要求:
1.出色的分析、解决问题能力,能从复杂业务的数据中分析和推导问题本质;
2.掌握LLM算法原理、Fine-tuning、Prompt Engineering、RLHF等;
3.有主流LLM、AI-Agent算法研发经验者优先;
4.积极主动,责任心强,有良好的沟通能力和团队协作能力。
招聘城市:北京,上海
…多模态输入的推理能力,模型能够无偏地利用 context 中不同模态的信息进行高质量的结构化推理,解决复杂问题。
视觉生成基础
具备高质量多模态输入的图片生成模型,提升真实感、一致性和复杂度;
具备强可控与可编辑的能力,支持多种控制方式并保持编辑前后的一致性;
探索 Diffusion 理论,在生成效率和效果上追求 10x 提升的架构创新。
音频生成基础
具备高质量多模态输入的音频生成模型,包括人声、哼唱、音乐、General Audio;
具备强可控和可编辑的能力,支持对音色/风格/情绪/语速等多种维度及其复合要求进行可控编辑;
探索端到端统一表征,追求 learnability / quality / compression 的极致 trade-off 优化。
生成与理解统一模型
探索减小不同模态在…
招聘城市:深圳
岗位职责:
1.主导商业化领域多模态基础大模型的建设,在商业化领域数据潜力挖掘、模型架构设计和训练机制优化等方向进行持续攻关,持续提升基础模型效果;
2.深入理解商业化场景并将其与基础大模型结合,将基础大模型应用于用户/内容/广告/商品理解、个性化生成、广告搜推等业务领域,提升各个业务算法效果;
3.持续跟进前沿算法,包括预训练/后训练、强化学习、持续学习、理解&生成统一模型、图像/视频生成等领域,并结合商业化场景持续探索创新,提升技术影响力。
岗位要求:
1.计算机相关专业博士或5年以上相关经验,具有扎实的计算机和机器学习基础,拥有优秀的的编程能力和工程能力;
2.具有较强的实践…
招聘城市:北京,上海
…问题进行分析、算法设计、研发以及推动上线,提升业务效果;
任职要求:
1.在大模型方向有一定经验,对Pre-train、SFT等技术有深入了解;
2.有良好的英文读写能力和扎实的数学基础,有快速学习新技术的能力;
3.有扎实的编程基础,熟悉Python/C++等编程语言,具有快速复现前沿论文的能力;
4.熟悉至少一个深度学习和大模型训练框架,包括PyTorch、TensorFlow、MXNet、Caffe、HuggingFace、DeepSpeed等;
5.有较强的研究能力,在国际顶尖会议或期刊(包括但不限于CVPR, ICCV, ECCV, NeurIPS, ICML, ICLR, AAAI, IJCAI, ACMMM, TIP, TPAMI, IJCV,ACL、EMNLP、NAACL、COLING、CoNLL、NLPCC等)上发表过论文者优先;
6.较强的业务问题到算法模型的建模能力,有强烈的求知欲、自驱力…
招聘城市:北京,上海,广州
…期待你除了算法外仍然是为出色的工程师。期待你对技术有强烈的好奇心和开放心态,以未来几年 AI 技术的质变突破为目标。
岗位说明:你会负责下述至少一件事情
1.海量数据的处理:定性分析、定量评估数据质量,并给出 scalable 的改进方案,对数据采集和处理流程不断提出新的要求和改进方案。
2.模型的改进:在 Large Scale 上迭代并改进模型使其更加的高效(capacity per flops / improvement per flops),或者提升模型的 scale up 后的稳定性
3.研究并改进 Scale Law,随着模型的变化给出 Large Scale 上的技术选择(例如参数/数据比、不同超参数设置等)
4.多模态:研发多种模态作为输入/输出的 Large Scale 模型
任职要求:
1.良好…
招聘城市:北京
…剧情生成等方向的能力,解决profile遵循、剧情多样性和自动化评估等相关技术问题;
2.探索LLM模型的CoT能力,负责在角色扮演、剧情生成等方向上落地;
3.关注LLM业界前沿动态,能够在实际工作中应用落地,并参与撰写技术文档和学术论文,分享和传播技术成果。
岗位要求:
1.熟练掌握Python,熟悉Linux 环境开发,熟练使用深度学习框架TensorFlow或者PyTorch;
2.熟悉一项或者多项以下技术:LLM预训练、Instruction Tuning、课程学习 或者 强化学习;
3.具备扎实的NLP基础技术,对于Transformer结构,RAG方向等有比较深入的理解;
4.具备独立解决问题的毅力,对新技术有强力的好奇心,有强大的自驱力保持对技术的热情;
5.有NLP领域或者机器学习领域…
招聘城市:深圳
岗位职责:
1.负责LLM在游戏领域的应用落地,包括但不限于游戏智能NPC的对话、决策交互、陪玩等;
2.负责大模型开发的相关工作,包括但不限于:数据合成、微调(SFT、蒸馏)、强化(DPO、GRPO)、RAG、多模态LLM(涉及游戏盘面状态)等;
3.负责探索与跟进AIGC前沿技术,结合未来实际应用场景,提供技术解决方案。
岗位要求:
1.计算机相关专业,硕士及以上学历;
2.熟悉自然语言处理方向基础的理论和方法,了解前沿的深度学习相关算法,在机器学习领域顶级会议发表过高质量论文者优先;
3.熟悉Linux环境开发,熟练掌握Python,熟练使用PyTorch等主流深度学习框架;
4.具备良好的沟通表达能力与团队协作能力;善于分析和解决问题;具备一定的产品思维…