招聘城市:北京,上海
岗位职责:
1. 负责小红书多场域(如广告、电商、推荐等)通用基础模型的设计与研发,提升模型的泛化与迁移能力
2. 负责跨域学习、序列建模、多模态建模等新范式在业务中的应用。
3. 负责统一的用户/内容表征体系构建,支持长周期用户兴趣建模与动态演化。
4. 探索新一代模型体系构建,提升业务模型技术的天花板
任职要求:
1. 具备扎实的机器学习、深度学习理论基础,对多模态、序列建模、跨域学习、迁移学习有深入理解与实践
2. 有推荐系统、搜索排序或者广告系统等相关业务经验,具备优秀的系统思维与解题能力
3. 掌握主流深度学习框架,具备高质量模型代码实现与调试能力
4. 具备良好的沟通协作能力和技术热情…
招聘城市:北京,上海
岗位职责:
1、探索新一代大语言模型基座架构,完成扩散模型(diffusion model)在大语言模型的重塑,突破逐个token预测的方式,实现高效的推理模式,探索全新scaling law;
2、实现大模型训练的数据清洗、合成和评估;设计和实现大模型训练的AI Infra框架。
任职要求:
1、本科及以上学历,计算机、人工智能和数学等相关专业,博士研究生优先;
2、熟练掌握扩散模型设计和使用技巧,在知名大模型公司/团队从事图像或视频生成者优先,有多模态/OMNI大模型理解&生成统一框架经验者优先;
3、有丰富的大模型预训练和后训练数据处理经验,熟练掌握数据收集、数据清洗、数据去重和数据合成等流程,能针对数据质量制定出评估指标和方法…
招聘城市:北京
部门介绍:
基础研发平台是美团的核心技术平台,立足于“零售+科技”的战略定位,通过打造人工智能、大数据、云计算、安全等核心技术能力,以及研发效能平台、企业应用平台等公共服务,为业务提供稳定安全、扩展易用、技术领先的平台技术和产品服务。
在这里,我们会参与到最前沿的技术研发和探索;能够接触超规模集群、海量数据,挑战高复杂业务场景,有机会与业界一流的工程师一起并肩前行。
在这里,我们有超强的技术氛围,持续向社区贡献业界实践,加速行业技术发展;我们有完善的互联网学习生态圈,重视底层逻辑和方法论,助力职业生涯的非线性成长。
真诚地邀请你,和我们一起驱动技术发展,创造行业价值。
岗位职责:
核心职责:
1…
招聘城市:深圳
岗位职责:
1.负责AI 原生应用的算法研发和LLM效果优化工作,推动前沿技术的探索和应用;
2.提升智能营销领域自然语言理解能力,比如NL2DSL、文本生成、数学逻辑、向量召回、结构化/非结构化数据处理、短文本/长文本的表征学习等;
3.探索智能体在复杂营销任务中的应用,利用LLM技术实现智能营销活动的自动化和个性化执行,实现大模型应用、增量训练、模型调试、自动化评估等内容。
岗位要求:
1.计算机、数学、机器学习或相关专业硕士及以上学历;
2.具有扎实的机器学习、NLP基础,5年以上大型互联网公司/营销场景算法模型经验者优先;
3.熟悉LLM的训练或Fine-tuning的方法,例如SFT/RLHF、强化学习(RL)等,通过思维链(CoT…
招聘城市:北京,上海
岗位职责:
深耕用户与内容理解,推动VLM在社区推荐、商业化、增长、电商、搜索等核心业务场景的深度应用,解决实际业务难题。
- 负责VLM相关算法的研发和落地,重点包括统一标签体系与表征、生成式推荐、跨场景兴趣迁移等任务。
- 主导VLM基础模型优化,包括VLM Caption、OCR等关键能力,提升内容理解的准确性与多样性。
- 负责对各业务场景下相关技术问题进行分析、算法设计、研发以及推动上线,提升业务效果;
任职要求:
1.在大模型方向有一定经验,对Pre-train、SFT等技术有深入了解;
2.有良好的英文读写能力和扎实的数学基础,有快速学习新技术的能力;
3.有扎实的编程基础,熟悉Python/C++等编程语言,具有快速复现前沿论文的能力…
招聘城市:北京,上海
部门介绍:
基础研发平台是美团的核心技术平台,立足于“零售+科技”的战略定位,通过打造人工智能、大数据、云计算、安全等核心技术能力,以及研发效能平台、企业应用平台等公共服务,为业务提供稳定安全、扩展易用、技术领先的平台技术和产品服务。
在这里,我们会参与到最前沿的技术研发和探索;能够接触超规模集群、海量数据,挑战高复杂业务场景,有机会与业界一流的工程师一起并肩前行。
在这里,我们有超强的技术氛围,持续向社区贡献业界实践,加速行业技术发展;我们有完善的互联网学习生态圈,重视底层逻辑和方法论,助力职业生涯的非线性成长。
真诚地邀请你,和我们一起驱动技术发展,创造行业价值。
岗位职责:
1. 提升模型…
招聘城市:北京,上海
岗位职责:
1、利用多种 alignment 技术,提升模型的内生安全能力
2、通过 Red Teaming 等机制,评估、发现多模态大模型潜在的安全问题及被恶意误用的风险;
3、通过 SFT、RLHF、对抗训练等方法,提升模型的对齐程度,使其能更好地被用于产品、服务人类;
4、探索 Agent 场景下模型具备执行代码、使用工具时,确保模型能忠实执行人类指令不被恶意使用的算法及系统策略;
5、与跨职能团队协作,以确保我们的产品符合最高安全标准;
任职要求:
1. 具备扎实的机器学习基础,能熟练使用至少一种深度学习框架(e.g. PyTorch、Jax、TensorFlow、MindSpore、PaddlePaddle)。
2. 对监督学习、强化学习、表示学习等机器学习方法有深入理解并具备相关的实践经验。
3. 在 NLP/CV/RL…
招聘城市:北京
岗位职责:
1.负责LLM和多模态大模型在教育领域能力提升,优化元宝教育应用效果,包括但不限于:CPT、SFT、Reward设计与RL训练等;
2.应用大模型技术,设计并优化教育场景AI Agent的核心能力,例如思路规划、Memory机制、工具调用以及多Agent协作,推动Agent技术在教育领域的应用;
3.基于教育领域模型应用特点,构建精准的模型自动评测能力,持续优化模型领域评测集与评测效果;
4.主导算法从需求分析、方案设计、数据处理、模型训练评估与上线的全流程,确保算法高效、稳定地服务于产品。
岗位要求:
1.理解LLM和VLM的在教育领域的前沿应用技术,对AI+教育行业应用有浓厚的兴趣,有解题、批改、AI Tutor等应用落地经验者优先…
招聘城市:上海,北京,杭州
岗位职责:
1、预训练:模型架构设计和实现,持续打磨多阶段预训练技巧,结合自动化和人工筛选,持续迭代化数据配比方案(质量、类别分布、难度等),训练全尺寸Dense和MoE模型,以及探索Hybrid架构、Diffusion训练/推理等新一代大模型范式;
2、后训练:SFT数据合成、拒绝采样、数据配比、模型训练,样本级标签体系建设,RL数据合成、Reward Model设计、router replay、RL算法创新,显著提升alignment阶段模型生成能力;
3、数据&评测:持续改进数据体系pipeline,包括:数据收集、清洗、去重和配比等,合成各种高质量agentic/reasoning训练数据,提升模型通用能力;持续完善大模型评估体系和Bench,能有效评估STEM、math、code、知识、指令跟随、多语言等维度能力。
任职要求:
1、背景: 计算机、电子、数学等相关专业…
招聘城市:北京,上海,杭州
岗位职责:
我们相信,通向更高阶智能的路径不止于更大的 LLM。
Post-Training 正在成为模型能力跃迁的关键阶段:从“学会语言”走向“理解世界、优化行为、持续进化”。该岗位将深度参与 多模态、强化学习、自进化 Agent 系统 等前沿方向,探索超越纯预训练范式的新能力边界,构建可持续学习、可记忆、可进化的智能系统。
1. Post-Training 核心研究与系统构建
设计并实现面向 推理能力、策略优化和长期表现 的后训练方法
探索 Reasoning RL Scaling、RLAIF for Fuzzy Task、Self-Play、Scalable Oversight 等在大模型中的新用法
将 Post-Training 视为 系统级优化问题,而非单次调参或 reward hacking
2. 强化学习与持续进化机制
设计基于试错和反馈的训练闭环(例如,Natural…
招聘城市:北京,上海,杭州
岗位职责:
工作职责:
1、Post-Training Pipeline 设计与迭代:搭建并持续优化 SFT、RM、RLHF / RLAIF / RLVF 等后训练流水线,支持多模态模型的高效迭代,让千亿级大模型在一次次“后训练”中真正变得聪明、智慧、安全
2、可扩展监督与反馈系统:设计低成本人类 + AI 组合反馈机制,自动化完成偏好采集、对齐传递与数据质量评估,通过 Product-Research co-design 探索构建真实用户反馈的模型迭代机制
3、通用推理与工具使用能力提升:构建跨模态强化学习环境和多样化奖励体系,帮助模型学会调用外部工具、提升模型利用文本-图像-语音跨模态信息进行复杂推理和问题解决能力
4、长期记忆、个性化与终身学习:探索持久记忆与动态偏好建模,使模型能够跨会话记住…
招聘城市:北京
…参与万亿网页、百亿文档内容理解、分类、质量打分和数据筛选等工作。
任职要求:
1.硕士研究生及以上学历,计算机、数学等相关专业背景。
2.至少3年以上大规模数据算法开发经验,具有较强的算法设计和实现能力。
3.熟练掌握常见的数据挖掘、机器学习、深度学习算法、NLP算法,有丰富的模型优化和调优经验。
4.具备网页解析、搜索算法经验者优先;具备大模型数据解析清洗经验者优先;具备BERT系列预训练模型经验的同学优先。
4.具备良好的团队合作精神和沟通能力,对数据算法和大模型抱有热情。
岗位亮点:
1.您的工作直接决定公司核心大模型的效果上限
2.和优秀的大模型算法工程师一起探索前沿AI技术
招聘城市:北京
…环节问题;
任职要求:
1. 硕士及以上学历,计算机科学、人工智能、自然语言处理或相关专业,具有扎实的算法理论基础。
2. 两年以上大模型、Agent 等相关领域经验,熟悉主流大模型如DeepSeek/Qwen/LLaMA/Claude/GLM等,对模型背后的原理和差异有深入的理解;
3. 熟悉Python,熟练使用TensorFlow/PyTorch等深度学习框架。
4. 熟悉大模型算法及应用,包含但不限于SFT、RLHF、RAG、AIGC等;
5. 有良好的沟通协作能力,主动及对外驱动能力强,能够在团队中积极主动地分享知识和经验;
6. 善于分析和发现问题,探索本质问题,能提供前瞻、通用的技术方案。
7. 具备较强的自驱力,有强烈的学习意愿和创新精神,对大模型技术有浓厚的兴趣和热情;…
招聘城市:北京,上海
岗位职责:
开发研究多模态 LLM 驱动的智能体技术及其应用,包括但不限于:
提升 long context 场景下模型对复杂指令遵循能力;
提升模型的推理规划能力、工具(例如搜索等)使用、记忆管理能力等;
探索多智能体场景下的合作、辩论、对话等应用;
任职要求:
1. 具备扎实的机器学习基础,能熟练使用至少一种深度学习框架(e.g. PyTorch、Jax、TensorFlow、MindSpore、PaddlePaddle)。
2. 对监督学习、强化学习、表示学习等机器学习方法有深入理解并具备相关的实践经验。
3. 在 NLP/CV/RL 等至少一个 AI 领域中有过深入的研究经历,或通过机器学习算法解决过复杂业务场景问题。
4. 具备卓越的实验分析与问题解决能力,有创新思维,能够良好沟通、与团队成员高效协作…
招聘城市:北京,上海
岗位职责:
1、利用多种 alignment 技术,提升模型的内生安全能力
2、通过 Red Teaming 等机制,评估、发现多模态大模型潜在的安全问题及被恶意误用的风险;
3、通过 SFT、RLHF、对抗训练等方法,提升模型的对齐程度,使其能更好地被用于产品、服务人类;
4、探索 Agent 场景下模型具备执行代码、使用工具时,确保模型能忠实执行人类指令不被恶意使用的算法及系统策略;
5、与跨职能团队协作,以确保我们的产品符合最高安全标准;
任职要求:
1. 具备扎实的机器学习基础,能熟练使用至少一种深度学习框架(e.g. PyTorch、Jax、TensorFlow、MindSpore、PaddlePaddle)。
2. 对监督学习、强化学习、表示学习等机器学习方法有深入理解并具备相关的实践经验。
3. 在 NLP/CV/RL…
招聘城市:北京,上海
岗位职责:
团队介绍
做多模态的人通常有两种:一种是把各种模态「拼」在一起,一种是真的想搞清楚不同模态之间的关系,我们是后者。从视觉理解,到视觉+语音联合感知,到生成与理解统一——我们在挑战的不是某一个模态的单点能力,是整个「理解-生成-统一」的链条,挑战每种模态的单一能力上限,挑战多种模态的融合难题,挑战理解和生成能力的融合难题,实现类人的多模态能力。
探索方向
多模态理解模型基础
具备对图片/视频/语音的全面感知,例如文字/表格/实体/动作/空间关系/情感/声音事件等;
具备视觉和语音联合感知,例如在视频上同时输入视觉和语音能够增强理解;
具备多模态输入的推理能力,模型能够无偏地利用 context 中…
招聘城市:北京,上海,杭州
岗位职责:
1、 负责智能客服系统和相关平台、工具、产品的研究开发,包括对话管理、语言生成、闲聊、问答等。
2、 开发各类NLP模型(如对话理解、文本分类、问题摘要、QA生成等)和预测模型(如用户问题预测)。
3、 基于业务数据的分析,提出建设性的架构方案,设计有效的服务SOP链路。
任职要求:
1、智能对话、文案生成等领域相关背景者优先;2年以上多模态/自然语言处理等相关领域经验;
2、人工智能/计算机/统计/数学等相关专业,研究生学历及以上;
3、熟练掌握基础数据结构与算法,熟练使用Python/Java中的一门或多门语言;能够使用SQL进行数据分析;
4、熟悉NLP/ML基本理论与方法,熟练使用典型的深度学习框架训练和部署。
招聘城市:上海
岗位介绍:
职位描述
工作职责:
1、负责涵盖色情、暴力、敏感言论、涉政等违规内容的音频内容安全审核的核心算法开发
2、主导算法流程闭环:从数据标注策略制定、模型训练与优化、在线服务部署到效果评估与迭代,确保技术方案在真实业务场景中高效落地。
3、协同产品、安全运营、审核、合规等多团队,将算法能力转化为可解释、可运营、可追溯的风险治理策略,支撑平台内容生态的健康可持续发展。
工作要求:
1、ASR 与文本:熟悉语音识别全流程,掌握 Transformer/BERT 等架构,能独立完成敏感文本分类模型的训练与调优。
2、音频特征与安全识别:熟悉语种识别、声纹、音频指纹及色情音频识别技术,有相关算法落地经验。
3、大模型能力:熟悉主流音频/文本…
招聘城市:上海
岗位介绍:
职位描述
工作职责:
1、 参与公司内容安全相关的AI算法设计与研发、并进行业务工程落地部署,岗位专注于内容理解大模型、多模态检索模型两个方向。
2、 参与相关学术研究并落地应用前沿技术。
工作要求:
1、有VLM/LLM学术、工业界SOTA、多模态检索的理论背景和实践经验;熟悉深度学习、机器学习算法,有数据挖掘、数据增强等经验。
2、熟练使用sql;熟练使用AI agent能力者优先
3、具备基本的后端服务开发知识。
4、具备比较强的论文复现能力,以及比较好的论文阅读习惯。
5、 加分项:a. 在nlp/cv领域的国际会议/期刊上一作发表论文、或相关国际比赛获奖;b. B站深度用户。
投递简历
招聘城市:上海
岗位介绍:
部门介绍
我们正在寻找一位对多模态大模型充满热情的资深算法工程师,你将深度参与B站视频理解大模型的研发与落地。作为团队的核心技术骨干,你将负责从数据构建、模型训练到效果评估的全链路关键模块设计,推动模型能力在业务场景中的持续突破。
职位描述
工作职责:
1. 负责B站视频内容理解、互动内容(评论/弹幕)理解、用户建模等方向的学术研究与技术突破,跟踪领域前沿动态,主导核心技术选型与关键难题攻克,提升团队核心技术竞争力。
2. 基于已有多模态大模型(VLM、MLLM),结合站内海量数据,开展post-pretraining/continued pretraining等前沿技术研究,构建适配业务场景、高效统一的下一代模型架构或技术方案。
3. 深耕多…