招聘城市:北京,上海,深圳
…能力上限。
2、多模态强化学习方案设计,实现视觉感知与多模态理解场景下的高性能可信输出与幻觉抑制。
3、视觉推理能力增强研究(Visual CoT、PRM 等),提升模型在复杂视觉任务上的推理深度。
4、工具调用与 Agent 能力构建,探索多模态模型在规划决策场景中的综合表现。
5、长上下文视觉理解与 GUI 能力研究,提升模型在长程复杂任务上的综合能力。
6、其他你坚信路线正确的多模态大模型前沿方向。
任职要求:
1、具备视觉多模态大模型的预训练或后训练研究经历;
2、熟悉PyTorch,有充分的动手实践经验。
加分项:
1、社区影响力:在多模态大模型领域有影响力的开源项目中做出过核心贡献;
2、学术影响…
招聘城市:北京,上海
…使模型能主动在重复性任务或封闭任务域中总结、提炼认知与经验,并进行有效复用,达到不断自进化 / 自迭代 / 持续学习的效果。
3、训练智能体系统的系统性长程任务高效处理能力,可以自主进行合理的任务拆解、分工;探索通过 agent swarm 或其他先进的 multi-agent system 进行系统性长程任务的并行执行和提效。
4、探索多模态推理和多模态环境交互的范式,并基于此进行增强智能体系统在复杂全模态环境下的任务完成能力。
任职要求:
1、本科及以上学历,计算机、人工智能、自动化、数学、物理等相关专业在读;
2、在强化学习、文本 / 多模态大模型训练、Agent、世界模型等一个或多个领域有较深入的研究和实践经验…
招聘城市:北京,上海
…模态扩展、交互形式和学习范式等四个方面进行研究:
1、智能体复杂指令遵循:大模型目前已经从实验室走向实际的生产环境,从关注Benchmark指标转为重视实际使用体验。真实使用场景以Train-Free + System Prompt的方式居多,其中System Prompt通常具有指令复杂、组合方式多样、变动频繁等特点。该方向主要研究内容有两点:一是大模型对于工具/Skill 调用的指令遵循能力;二是大模型对于复杂总结指令的遵循能力。
2、全模态深度搜索智能体:最真实的物理世界都是全模态的,所以搜索智能体不仅在输入上需要支持全模态,而且在整个搜索过程以及最后的结果呈现上都需要支持全模态。该方向主要研究怎么将已经比较成熟的搜索…
招聘城市:北京,上海
…模态训练pretrain和posttrain的前沿研究,可根据个人背景和研究兴趣选择以下方向之一深入推进:
1、超长序列的高效pretrain训练方案。
2、基于投机采样的方式加速多模态RL的训练效率。
3、针对compute use场景的大规模agentic RL 高效训练方案探索。
任职要求:
1、精通 C++/Python,熟悉 CUDA 编程、NCCL 通信库或 RDMA 网络优化;
2、具有很强的学习能力、复杂问题归纳梳理能力、沟通和团队协作能力,具备能够深度钻研技术的耐心;
3、至少深入研读过 Megatron-LM, vLLM, Sglang, VERL 其中之一的源码,并有过定制化修改或性能调优经历。
加分项目:
1、有很强的学术研究能力和优秀的学术成果(AI领域顶会/顶刊论文);
2、熟悉RL的基础算法…
招聘城市:北京,上海,深圳
…面向不同的多模态架构和训练范式,从视觉基座的角度深入探索视觉连续表征和离散表征的联系和区别,负责探索更具通用性的多模态视觉特征,生产行业内领先的视觉基座。
4、多模态理解生成统一:负责多模态理解与生成的前沿探索与研究,包括但不限于视觉表征统一训练、多模态统一架构探索、理解与生成任务关系研究。
任职要求:
1、硕士及以上学历,计算机、人工智能、自动化、数学、自然语言处理等相关专业,博士优先;
2、在以下一个或多个领域有较深入的研究或实践经验:多模态大模型(MLLM)、全模态融合大模型(Omni-LLM),视觉基座(Vision-Model)、理解生成统一(Unified-MM)、强化学习(RL);
3、具备扎实的算法和数学理论基础及…
招聘城市:北京
…多模态大模型后训练技术,实现图像质量审核、OCR识别、图文一致性校验、图像合成等能力,提升一线运营采集数据等场景的自动化水平与准确性。
4.面向履约空间规划的智能体(Agent)构建:设计并开发能意图识别、归因分析、并自主决策执行商家范围/AOI边界调整的智能体。重点研究Agent的任务规划、工具调用与动态策略优化能力。
5.业务仿真与决策推演:基于空间智能Agent,对不同的策略进行模拟推演,评估其对供给、平台规模、履约体验的影响,为科学决策提供支持。
我们将提供海量的真实业务场景与数据、充足的GPU计算资源以及极高的技术探索自由度,目标是产出兼具技术前沿性与业务影响力的成果,共同定义下一代智能…
招聘城市:北京,上海
岗位职责:
简介:原生多模态旨在以统一的范式处理文本、视觉、语音等各个模态的数据,从而更加自然地进行模态融合,以及通过scaling友好的训练范式,解锁模型智能的新维度。
研究课题包括但不限于:
1、探索early fusion阶段,引入图文交错/audio等多模态序列数据自监督预训练带来的scaling价值。
2、原生全模态预训练的training dynamic探究,模态之间的关系建模。
3、通过SFT / RL等手段,借助多模态token解锁模型新的智能维度,提升模型解决Robot/Gaming等物理世界问题的能力。
任职要求:
岗位要求:
1、熟悉NLP、LLM、MLLM、RL等相关领域,对其中一个或多个方向有深入的研究经历,且有相关实际项目经验;
2、熟悉Python、C++等至少一门编程语言,熟悉…
招聘城市:北京,上海
岗位职责:
简介:我们聚焦于多模态推理的前沿探索。你将参与具有前瞻性的研究,并可根据个人背景与兴趣,选择以下任一方向进行深入:
1、下一代多模态推理架构: 定义并实现复杂/统一多模态模型的高效推理框架。
2、实时交互演进: 针对多模态语音视频流,探索极致的系统级优化。
3、长文本/长视频突破: 深入研究长序列下的创新压缩算法与高性能推理加速方案。
任职要求:
1、熟悉大模型推理原理及主流优化技术,拥有扎实的编程能力;
2、对多模态技术发展趋势有独立见解与思考;
3、具备极强的自驱力、创新意识与执行闭环能力;
加分项:
1、在相关领域有研究或项目实践经验;
2、对系统性能优化、压缩算法、实时…
招聘城市:北京,上海
…大模型的多视角空间感知与主动探索能力研究。
6、其他你坚信路线正确的具身智能前沿方向。
任职要求:
1、计算机科学、自动化、机器人或相关领域在读硕士/博士研究生;
2、具备扎实编程能力,熟练掌握 Python 及 PyTorch;熟悉 C++ 者优先;
3、对具身智能、机器人、计算机图形学或多模态大模型中至少一个方向有深入的理论基础与研究积累;
4、有较强的自驱力和独立解决问题的能力,能在模糊环境中推进研究;
具备以下者优先:
1、在 AI、机器人、计算机图形学等领域 CCF-A 类或同级顶会/顶刊(如 CVPR/ICCV/CoRL/RSS/NeurIPS 等)发表论文(第一作者/共同一作优先);
2、参与国际/国内顶级算法…
招聘城市:北京,上海
…研究基于实时环境反馈的重规划机制,解决“模拟漂移”导致的计划与现实脱节问题,提升规划鲁棒性;设计高效的上下文管理与记忆压缩技术,避免长交互过程中关键信息遗忘,支撑超长序列任务的稳定执行。
2、开放环境动态适应:探索解决真实世界中目标模糊、环境多变、突发干扰下的任务持续执行难题。
3、高效学习范式:研究真实世界开放任务reward以及过程奖励设计方法,为长程任务中间步骤提供有效反馈,解决奖励稀疏问题;研究开放环境下的持续学习方法,避免“灾难性遗忘”,增强智能体在新场景、新任务中的泛化能力。
任职要求:
1、硕士及以上学历,计算机、人工智能、数学、自然语言处理等相关专业,博士优先;
2、在大模型领域有研究基础,或参与…
招聘城市:北京,上海
…探索激发多模态大模型Training-Free泛化能力的Data-Scaling方案(包括VLA和VA),迁移人类数据到具身本体,包括latent action和unified model等方向。
2、探索通过世界模型作为物理仿真引擎的进阶,兼顾仿真和真机的优点,实现泛化评测、强化学习和多样性数据合成。
3、探索通过环境交互的在线强化学习,涉及仿真环境的搭建、数据合成和真机实验,研究通过自我进化的下一代智能提升的关键途径。
任职要求:
1、硕士及以上学历,计算机或相关专业,博士优先;
2、在 ML / NLP / RL / CV / Speech 等相关方向有扎实的研究基础,在 ACL / EMNLP / NAACL / NeurIPS / ICML / ICLR / CVPR / ICCV / ICASSP 等顶级会议发表论文者优先;
3、优秀的代码和算法功底,具备工匠精神,ACM/ICPC…
招聘城市:北京,上海
…研究目标:
1、探索通过在高度多样、丰富的游戏任务下进行大规模智能体训练,提高模型面对一般多模态场景的交互与融合模态推理能力。
2、探索趋向于真实物理世界的开放世界建模,为模型在真实物理世界下的训练和模拟训练提供坚实基础。
3、训练模型在动态、时序变化的开放世界下,自主进行感知、观察、探索、交互、任务推进的能力,并预期这样的能力作为真实物理世界训练的坚实前置基础,可以 minimize 所需的高成本真实物理世界训练量。
任职要求:
岗位要求:
1、本科及以上学历,计算机、人工智能、自动化、数学、物理等相关专业在读;
2、在强化学习、文本/多模态大模型训练、Agent 、世界模型等一个或多个领域有较深入的研究…
招聘城市:北京,上海
…构造、数据清洗、超参数优化以及 outcome-level / process-level 信号设计,提升模型在开放研究任务中的完成率、事实正确性和稳定性。
5、面向真实 research 任务的评测体系与错误分析闭环建设,建立 benchmark、自动化评测指标,系统分析搜索遗漏、证据误判、上下文污染、推理漂移、错误归因与长链路失稳等问题,并推动针对性优化。
任职要求:
1、硕士及以上学历,计算机、人工智能、数学、自然语言处理等相关专业,博士优先;
2、具备扎实的算法和数学理论基础及良好的编程基础,熟悉Python、Java等至少一种编程语言,熟悉PyTorch等深度学习框架;
3、在大模型领域有研究基础,或参与过有影响力的开源项目,在ICLR/NeurIPS/ICML/ACL等顶会发表论文者优先;
4…
招聘城市:北京,上海
岗位职责:
简介:探索下一代大模型训练范式,从模型结构、训练策略、数据策略、算力利用率等角度切入,打造具有更强能力和更高潜力的基座模型
1、设计更高效的模型结构,提高给定数据量、计算量、硬件资源、输出序列长度等约束下的模型能力,如长序列能力、记忆能力等。
2、探索更科学和前沿的训练策略,对影响training dynamic的关键变量(如学习率、batchsize、初始化等)形成更科学的认知,探索diffusion LLM,test-time scaling等技术。
3、研究模型结构和数据的耦合关系,优化分阶段训练范式。
4、结合MLsys解决大规模训练中遇到的卡点问题,实现算法和工程联合设计。
任职要求:
1、熟悉NLP、LLM、MLsys、Optimization、OR、Control、RL等相关领域,对其中…
招聘城市:北京,上海
…业内最前沿的大模型认知和技术积累,既能做前沿 Research,也有直接的落地场景。
【研究方向】
1. 探索模型通过 RL Scaling 等方式使用成套工具解决复杂问题的行动和规划能力,包括 Human in the Loop 多轮交互下 Agent 基础建模的新方案、以及与复杂环境的交互学习能力。
2. 探索模型在 Non-Rule Based Outcome 场景下利用复杂信息进行有效 Reasoning 推理的范式,包括 Proactive Agent 的建模方案 。
3. 探索研究更多内在奖励的机制,从而激发模型主动学习和自我更新的能力。
4. 探索构建长期记忆机制,为下一代高效的推理模型、长序列推理及建模提供基础。
任职要求:
1. 博士在读优先,计算机、人工智能、自动化、数学、物理等相关专业。
2.在强化学习、语言模型…
招聘城市:北京,上海
岗位职责:
简介:参与面向大模型训练/推理的高性能计算与系统优化工作,可根据个人背景和研究兴趣选择以下方向之一深入推进:
1、面向GPU/NPU 等多硬件平台的算子开发与极致性能优化(CUDA/Cutlass/TileLang)。
2、跟踪前沿模型算法并完成高性能工程落地,深入框架层开展算子融合、内存/通信优化、流水编排等系统级性能调优。
3、探索基于大模型的高性能 Kernel 自动合成技术,参考 LLM-driven Kernel Generation 范式,研究高效 GPU/NPU Kernel 的端到端自动生成与迭代优化方法。
4、基于DSL(如 Triton、TVM TIR、Halide 等)的编译优化与自动调优技术研究。
5、多硬件后端(NVIDIA/国产芯片)的统一算子库建设与迁移适配。
任职要求:
1、GPU编程:写过…
招聘城市:北京,上海
…简介:负责大规模强化学习系统设计、分布式调优、调度优化、算法 co-design等,包括不限于 RLHF、RLVR、Agentic RL等范式。和算法共同提升模型各类专项能力,应用生产力等等
你可能从事以下方向:
1、RL训练系统架构
①设计和实现支持 PPO及各类变种算法的高效训练框架。
②Data/Env Scaling,优化并发调度效率 。
2、在线采样 & Rollout 优化
①优化RL场景(longcot、长尾分布、多轮交互)推理引擎效率,包括不限于量化、MTP、并行切分等等。
②训推混部署、全流程异步训练,提升 GPU 利用率。
3、 训推一致性
①训推引擎天然为了各自最大化效率存在精度差异,研究如何不断降低两者diff,包括不限于 Routing Replay、确定性计算等等。
4、训练稳定性
①攻克RL训练…
招聘城市:北京,上海
…模型、音视频联合生成等,思考在模态统一、任务统一和多种模态联合生成过程带来新的能力跃迁并进行度量,分析模态和任务间的相互关联,指引模型架构、训练策略等选型。
3、多模交互方向:包括通用世界模型、音视频交互等,研究动态多轮交互中的一致性、真实性和长程记忆等关键能力的自动化度量,指引基座模型的迭代。
任职要求:
1、硕士及以上学历,计算机或相关专业,博士优先。;
2、在 ML / NLP / RL / CV / Speech 等相关方向有扎实的研究基础,在 ACL / EMNLP / NAACL / NeurIPS / ICML / ICLR / CVPR / ICCV / ICASSP 等顶级会议发表论文者优先;
3、优秀的代码和算法功底,具备工匠精神,ACM/ICPC、NOI/IOI、Top Coder、Kaggle等比赛获奖者优先;
4、在大模型…
招聘城市:北京,上海
…前沿的大模型技术动态,持续改进和优化现有模型;
3. 有机会负责创新AI功能端到端的开发,需要全方位地思考问题,能够在机器学习技术栈中承担不同角色,解决各个环节问题。
任职要求:
1. 硕士及以上学历,计算机科学、人工智能、自然语言处理或相关专业;
2. 熟练掌握至少一种深度学习框架,如PyTorch、TensorFlow等,熟悉Python/Java编程语言,良好的编码习惯和工程能力;
3. 具有生成式模型训练及开发经验,如大模型数据处理、模型微调、预训练、强化学习、AI Agent等。
4. 有良好的沟通协作能力,能够在团队中积极主动地分享知识和经验;
5. 善于分析和发现问题,具备较强的自驱力,有强烈的学习意愿和创新精神,对大模型技术…
招聘城市:北京,上海
…训练和推理的各类算法和工程策略探索落地。参与美团基座大模型项目,包含但不限于:
1、大模型高效架构设计探索(高效attention,moe架构等)。
2、预训练 / 后训练算法工程策略。
3、投机推理算法工程策略。
4、模型轻量化策略(剪枝,量化,稀疏,蒸馏,结构搜索等) 。
5、Agentic coding系统优化策略。
任职要求:
1、熟悉一些常用的深度学习框架和大规模训推框架(比如megatron,verl,vllm,sglang等等),在大模型上有训练和推理算法工程优化实际经验的优先;
2、熟悉机器学习和深度学习理论,具备扎实的编程能力,熟悉常见的主流大模型架构;
3、有大模型或机器学习相关顶会论文发表,特别是模型架构优化,训推策略相关的算法或工程论文优先…