招聘城市:深圳
…关注训练稳定性、效率及泛化能力,特别是针对跨模态对齐、奖励函数设计及策略优化等环节提出系统性改进方案;
3.技术调研与瓶颈攻关:主动跟踪学术界与工业界在多模态强化学习后训练领域的前沿进展。针对训练中出现的瓶颈(如OOD泛化不足;
4.模态融合冲突等),进行根因分析,并与框架团队协作制定解决方案;
5.跨团队支持与知识沉淀:高效协同框架开发、硬件优化及业务算法团队,确保技术方案落地。撰写高质量的技术文档、设计稿与实验报告,并组织内部分享,推动团队整体技术认知提升。
岗位要求:
1.学历与技术背景:拥有计算机科学、人工智能、电子工程、自动化等相关专业的硕士及以上学历。具备扎实的机器学习…
招聘城市:深圳
岗位职责:
1.负责混元多模态大模型的RL后训练框架研发;
2.设计和开发高效的框架和算子,以支持各种硬件加速器;
3.参与强化学习算法的优化和实现,提高训练和推理性能;
4.跨团队协作,与算法、软件、硬件团队密切合作,提高框架性能和稳定性。
岗位要求:
1.熟悉常用的大模型训练推理框架,如PyTorch/Megatron/VLLM/Verl,有相关开发经验;
2.熟悉Docker、Kubernetes等容器和容器编排技术;
3.熟悉编译器相关技术,了解MLIR/XLA/TVM等AI编译器者优先考虑;
4.熟悉CPU/GPU硬件架构,有扎实的CUDA/OpenMP编程基础;
5.良好的团队协作能力和沟通能力,具有较强的自我驱动能力。
招聘城市:北京
…奖励模型(RM)训练、强化学习(RLHF/RLAIF)优化,聚焦任务规划、记忆机制、工具调用、多轮对话一致性等核心能力提升。;
2.后训练数据体系构建:设计 Agent 后训练数据的采集、清洗、标注与迭代策略,涵盖通用指令集、任务型对话数据、工具调用样本、多模态交互数据等,建立数据质量评估与筛选机制,优化数据分布与多样性。;
3.Agent 能力优化与突破:针对 Agent 在复杂任务拆解、跨领域知识迁移、动态环境适配等场景的痛点,研发创新后训练算法(如分层任务规划训练、多智能体协作训练、反幻觉优化),提升 Agent 的决策准确性与鲁棒性。;
4.工程化落地与系统协作:搭建高高效后训练流水线,支持大规模数据并行处理、分布式训练(DDP/FSDP)与模型…
招聘城市:北京
…具备扎实的深度学习基础;
2.在视频理解、多模态大模型、视觉语言模型或相关方向具有研究或研发经验;
3.熟悉 Transformer、LLM、VLM 等模型架构,对多模态模型训练及后训练方法有较深入理解;
4.具备较强的算法研究、实验分析与工程实现能力,能够独立推动研究问题从定义到落地;
5.对多模态基础模型及视频智能方向有强烈兴趣,具备持续探索前沿问题的研究热情。
加分项:
1.有大规模 VLM / Video-LMM 训练或后训练经验;
2.有 SFT、RLHF、PPO、GRPO 等强化学习或大模型对齐经验;
3.在 CVPR、ICCV、ECCV、NeurIPS、ICLR、ACL、EMNLP 等顶级会议发表过相关工作;
4.有高质量开源项目、大规模视频数据建设或多模态评测体系经验…
招聘城市:北京
…任务中的弱项(如探索效率、工具使用等),设计并落地高效的数据飞轮机制,定向进行数据补充与配方调整,实现“评测发现问题-数据定向强化-效果闭环提升”,持续驱动模型核心能力的演进;
3.深度追踪与研究用于支撑大模型后训练与 Agent 能力提升的前沿数据技术,关注数据自动生成、复杂轨迹数据构建、多模态与多智能体互动等方向,能够将最新数据相关成果快速转化为业务价值。
岗位要求:
1.计算机科学、人工智能或相关专业硕士及以上学历,具备大模型数据工程或模型训练实际项目经验;
2.深入理解 Transformer 架构及大语言模型训练原理,具备丰富的数据经验,能针对 LLM Alignment、RLHF等后训练场景,设计高标准数据方案,有项目实战经验;
3…
招聘城市:深圳
岗位职责:
1.负责语音/音频大模型研发,包括音频理解(ASR/音频caption)、音视频理解等模型研发;
2.负责预训练、后训练、强化学习(文本和音频强化)相关的数据、算法、评测工作;
3.负责音频理解/ASR模型开源以及产品落地(比如产品全链路端到端优化、音频理解在噪音/口音/远场/音效音乐场景的优化)。
岗位要求:
1.有语音识别、音频理解、音乐理解等相关经验者优先;
2.有音视频多模态、大语言模型(预训练、微调、强化学习)等相关经验者优先;
3.优秀的代码能力、数据结构和算法功底,熟练掌握Python,熟悉Pytorch/Megatron/FSDP等模型训练框架、熟悉SLIME/VERL等RL框架优先;
4.有ACM/ICPC、NOI/IOI、Top Coder、Kaggle等比赛获奖者优先;
5.在相关顶级会议…
招聘城市:深圳
…音视频对话)、音频理解(ASR/音频caption)、音频生成(TTS/视频配音)等模型研发;
2.负责语音/音频大模型的预训练、后训练、强化学习(文本和音频强化)相关的数据和算法工作;
3.负责语音对话/音频理解/音频生成的模型开源以及产品落地(比如语音对话产品全链路端到端优化、音频理解在噪音/口音/远场/音效音乐场景的优化、语音合成在播报/闲聊/游戏/社交等场景的优化)。
岗位要求:
1.有语音对话、语音合成、语音识别、音视频多模态、大语言模型(预训练、微调、强化学习)等相关经验者优先;
2.优秀的代码能力、数据结构和算法功底,熟练掌握Python或C/C++,熟悉Pytorch/Megatron/DeepSpeed等模型训练框架,有ACM/ICPC、NOI/IOI、Top Coder、Kaggle等比赛获奖者优先…
招聘城市:北京
…性:致力于大幅度降低多模态大模型幻觉。深入探究幻觉产生的本质,建设完善的幻觉检测链路,实施精细化的数据清洗策略,并主导研发基于强化学习的幻觉消除(Hallucination Removal)方案;
4.赋能用户交互场景:面向真实用户场景进行模型对齐与调优,强化模型在多轮图文交互中的逻辑推理、指令遵循(Instruction Following)以及细节感知能力。搭建线上 Badcase 监控与数据飞轮反馈闭环,持续打磨并打造极致的交互体验。
岗位要求:
1.计算机科学/软件工程/人工智能等相关专业硕士及以上学历;
2.深入理解 Transformer 架构及大语言模型训练原理,在 LLM Alignment、RLHF、Reward Modeling、个性化大模型(Personalized LLM)、记忆机制(Memory/RAG)等后训练领域之一有深入的研究和实践经验…
招聘城市:深圳
…3D AI生成管线,解决几何拓扑优化、材质贴图生成、物理合理性等核心问题。
岗位要求:
1.计算机、人工智能、数学等相关专业硕士及以上学历,有AIGC方向顶级论文者优先;
2.满足以下任意一种技术栈要求:
1).3D表达技术:熟悉几何处理管线(Mesh操作/UV映射等),熟悉NeRF、SDF、Gaussian Splatting等表示方法;
2).生成式模型:深入理解Diffusion类模型、或自回归AR类模型原理,有3D生成经验者优先;
3).后训练技术:对post-training、强化学习、多模态理解与生成有丰富经验;
4).纹理材质技术:了解3D贴图、3D材质生成等技术;
3.代码能力强,能快速实现idea,有扎实工程能力;
4.具备较强的自驱力、学习能力、沟通能力、团队意识。
招聘城市:北京
…建设:负责多模态大语言模型在 Visual2Code 方向的核心算法研发,围绕“视觉输入—代码理解—代码生成—执行验证”完整链路,持续提升模型从界面、图表、文档、图像等视觉信息中理解结构并生成高质量代码的能力;
2.建设高质量数据体系:负责 Visual2Code 训练数据的设计、构建与迭代,包括真实数据挖掘、自动化数据合成、难度分层、质量过滤及数据配比等,建立覆盖多场景、多语言、多任务形态的数据生产与数据飞轮体系;
3.推进模型与算法创新:深入探索 Visual2Code 场景下的 SFT、强化学习、代码执行反馈、Verifier/Reward Model 等后训练方法,研究视觉理解、代码推理与执行反馈之间的协同机制,持续提升模型在复杂任务中的正确率、泛化能力与稳定性;
4.强化复杂视觉编程能力…