招聘城市:北京,上海
…利用多模态扩展定律指导数据与训练方案,提升模型在多模态交互场景下的原生能力。
【为什么是我们】
1.团队扁平,人才密度高,近年团队在ICLR、NeurIPS、ICML、ACL等顶会累计发表论文数十篇,团队员工获EMNLP 2024 Outstanding Paper、ACL 2025 Outstanding Paper;
2.参与大语言模型核心技术研发,接触大规模RL、超长上下文、分布式训练和推理优化等前沿技术;
3.充足算力保障,拥有大规模分布式训练环境和丰富数据资源。
任职要求:
1.来自全球Top高校计算机科学、人工智能、数学、物理或相关领域应届博士/顶尖硕士毕业生;
2.在大模型领域有研究基础,或参与过有影响力的开源项目,在ICLR/NeurIPS/ICML/ACL等顶会发表论文具备扎实的算法…
招聘城市:北京
…LongCat大模型人才校招】基础模型通用 agent 算法研究员
更新时间:2026-06-03
工作地点:北京市
事业群:核心本地商业-基础研发平台
岗位职责
我们期望探索构建这样的 AI 系统:具备真实物理世界级别的全模态信息交互与处理能力、有高学习和成长属性、可以无人监管地高效执行并完成真实复杂长程任务;从而让 AI 真正成为人类的强大帮手,对工作、生活、科研等人类社会的各个方面都进一步带来更大、更深远的有益影响。
1.探索小时或者天级别复杂长程任务下的 RL Scaling 等可靠后训练范式,实现有效的探索引导和 credit assignment,并保障训练的 robustness、efficiency & effectiveness;
2.探索模型的自进化系统构建方案,在易于模型理解使用的前提…
招聘城市:北京,上海
…TTS 模型探索,研发上下文感知的语音合成大模型,攻克音色 / 情绪 / 语速 / 方言多属性可控、首包延时与自然度的平衡,逼近真人级表达力。
3. 声纹与说话人建模,研究大规模声纹基座模型与多说话人分离算法,构建早期注入、多场景泛化的声纹能力底座。
4. 语音与多模态融合探索,研究语音表征与 LLM、视觉模态的统一建模范式,作为 Omni 模型的语音底座,支撑下一代多模态实时交互。
【为什么是我们】
1.全栈顶配算力支持,依托美团大规模算力集群,提供千卡至万卡级算力支持,具备成熟的分布式训练与低延迟推理优化栈,保障 世界动作模型与 VLA 大规模训练。
2.与优秀人才同行,你将与行业…
招聘城市:北京,上海
…多维度并行策略、多模型交互流程等,支持万亿参数模型在几万张GPU集群高效稳定训练,实现多种模态的基座和推理模型的高效稳定训练。
2.面向多种算力、网络环境和应用场景,设计并实现高性能的模型推理架构,应用量化、剪枝等模型压缩方法,持续降低推理成本。
3.通过手工优化方法,对特化模型子结构和硬件设备上实现SOTA性能,持续迭代基于编译的优化方案,提升通用优化的适用性、优化效果以及对新硬件的覆盖能力。
4.管理及优化全公司算法团队硬件资源,通过算法预估与启发式策略,对全公司万级别节点的大规模GPU/CPU集群构建精细化调度服务能力,持续提升资源使用效率。
【为什么是我们】
1.业界前列的算力…
招聘城市:北京
【LongCat大模型人才校招】基础模型 - 多模态
更新时间:2026-06-03
工作地点:北京市
事业群:核心本地商业-基础研发平台
岗位职责
探索下一代原生多模态基础模型:让模型不止于接入视觉能力,而是能够统一建模文本、图像、视频与交互过程,像理解文字一样理解视觉世界,并在真实物理场景中进行推理、生成和行动。我们将重点探索统一的多模态表征体系,包括离散视觉 token、连续视觉表征及其混合形式,使图像与视频能够被基础模型高效学习、组合和生成。
你将参与以下方向中的一个或多个:
1.研究多模态与文本模态的深度融合策略,包括 early fusion 架构设计、多模态 / 文本数据配比优化、多模态上下文建模等,实现视觉能力与语言能力的协同…
招聘城市:北京
…LongCat大模型人才校招】基座评测与认知分析-多模态与前沿交互研究
更新时间:2026-06-03
工作地点:北京市
事业群:核心本地商业-基础研发平台
岗位职责
多模态大模型能力在近年飞速发展,模态的统一、任务的统一、多种模态联合生成和实时交互带来了崭新的应用体验和生产力提升。在这个过程中,我们需要脚踏实地的同时仰望星空,发挥想象力预判新模型能力带来的应用场景革新,研究达到理想态的关键演进路径并进行度量分析,指引长期有潜力的模型迭代方向。方向包括但不限于
1.多模Agent方向:包括在多模态的工具调用和GUI/CUA,探索结合多模原生能力的OpenClaw展现出的生产力提升潜力,从基座模型能力…
招聘城市:北京
【LongCat大模型人才校招】基座评测与认知分析-具身与开放物理世界探索
更新时间:2026-06-03
工作地点:北京市
事业群:核心本地商业-基础研发平台
岗位职责
从多模态大模型基座延伸到具身智能,我们的目标是做到具身智能的“GPT时刻”,具备test-time zero-shot/few-shot的跨本体、跨任务泛化。在这个过程中,我们进行具身智能在泛化能力评测分析和关键迭代路径的探索,包括但不限于
1.探索激发多模态大模型Training-Free泛化能力的Data-Scaling方案(包括VLA和VA),迁移人类数据到具身本体,包括latent action和unified model等方向;
2.探索通过世界模型作为物理仿真引擎的进阶,兼顾仿真和真机的优点,实现泛化…
招聘城市:北京
【LongCat大模型人才校招】多模态文档理解算法专家
更新时间:2026-07-07
工作地点:北京市
事业群:核心本地商业-基础研发平台
岗位职责
【AI愿景】
美团龙猫基座大模型,不只聪明,更懂生活。从语言理解到全模态感知,从架构创新到极致推理,从海量预训练到亿级真实订单 —— 我们造的不仅是实验室里的“优等生”,更是活在大街小巷、三餐四季里的AI。 而我们想做的远不止于此 —— 让模型自己提出假设、训练自己、不断进化; 让一群智能体像团队一样分工协作、攻克复杂问题; 让 AI 走出屏幕,理解物理世界、走进真实场景。 这是我们正在冲刺的方向,也是你可以参与定义的未来。 加入我们,一起把智能带…
招聘城市:北京,上海
…训练数据质量是影响模型能力的最底层变量,这个方向持续重要且极富挑战,您在做"最核心的事”的同时,是在挖掘大金矿。
2. 超大规模数据工程实战打造业界领先的OCR能力 —— 百亿级文档等您挖掘,您积累的系统设计和优化经验,具有极强的稀缺性与市场价值;同时我们志向打造领先的开源OCR模型。
3. 学术与业务双驱动 —— 团队技术氛围浓厚,鼓励技术创新、突破以及成果转化;核心技术有机会在顶会发表,业务落地与学术产出双向驱动。
【岗位职责】
1.负责百亿级别海量文档数据的解析与处理,包括但不限于复杂版面检测、文档元素识别、长文档解析与结构化信息提取。
2.跟踪并研究多模态大模型与文档智能领域…
招聘城市:北京,上海
…沉淀软硬一体、训推贯通的关键基础能力,提升模型迭代效率、训练资源利用率与系统上限。
【岗位职责】
负责面向LLM数据场景中海量数据抓取需求建设,构建文本、多模态等高质量数据获取能力。
1.面向海量多源数据场景,构建高可用、高稳定性的分布式数据调度与抓取系统,保障数据供给的及时性与完整性。
2.针对不同目标站点的技术防护手段,设计并实现动态友好爬取方案,持续提升抓取成功率与数据质量,保障采集链路在复杂对抗环境下的持续可用。
3.设计数据清洗、去重、校验、质量等保障机制,确保整体系统的效率,对数据缺失、异常、延迟等风险做到早发现、早恢复。
4.深入理解业务场景对数据的需求,协同算法、搜索…
招聘城市:北京
【LongCat大模型人才校招】大模型算法研究员-Search Agent方向
更新时间:2026-06-03
工作地点:北京市
事业群:核心本地商业-基础研发平台
岗位职责
你将加入 LongCat Agent 算法团队,与一线研究员共同推进下一代智能体的范式探索。具体方向包括但不限于:
1.Agentic RL 基础算法研究:探索面向长程多步任务的强化学习训练范式,包括稀疏奖励下的信用分配、过程奖励建模、自我博弈与多智能体协同、可扩展的 reward modeling,以及训练稳定性与样本效率优化。目标是实现Agent 能力增长的主引擎;
2.Search Agent 能力构建:研发面向开放域复杂查询的搜索智能体,覆盖多轮检索规划、查询改写、证据聚合、多源信息冲突消解与可信溯源。重点突破"深度研究"类…
招聘城市:北京,上海
…图形学或多模态大模型中至少一个方向有深入的理论基础与研究积累;
4.有较强的自驱力和独立解决问题的能力,能在模糊环境中推进研究;
5.不满足于复现,有自己的研究判断和技术直觉。能够把握"什么是真正重要的问题",在正确方向上深挖;
6.乐于在跨学科团队(算法、工程、硬件)中协作推进,研究成果能转化为可落地的系统;
具备以下者优先:
1.在 AI、机器人、计算机图形学等领域 CCF-A 类或同级顶会/顶刊(如 CVPR/ICCV/CoRL/RSS/NeurIPS 等)发表论文(第一作者/共同一作优先);
2.主导过有实质影响力的开源项目或技术突破(如在机器人操作、具身导航、世界模型等领域…
招聘城市:北京
…LongCat大模型人才校招】基础模型 - 预训练
更新时间:2026-06-03
工作地点:北京市
事业群:核心本地商业-基础研发平台
岗位职责
1.探索下一代大模型训练范式,从模型结构、训练策略、数据策略、算力利用率等角度切入,打造具有更强能力和更高潜力的基座模型设计更高效的模型结构,提高给定数据量、计算量、硬件资源、序列长度等约束下的模型能力和潜力,如长序列能力、记忆能力、推理能力等。
2.探索更科学的训练策略,对影响training dynamic的关键变量(如学习率、batchsize、初始化等)形成更科学的认知。
3.探索更前沿的训练范式(如diffusion LLM,test-time scaling等具有潜力的技术),发现更高效和稳定的scaling路径。
4.研究模型…
招聘城市:北京
【LongCat大模型人才校招】基础模型 - 数据策略与数据科学
更新时间:2026-06-03
工作地点:北京市
事业群:核心本地商业-基础研发平台
岗位职责
随着模型架构逐渐收敛、算力成本持续上升,高质量数据策略正在成为提升基座模型 scaling efficiency 和能力上限的核心杠杆。本方向聚焦大规模预训练数据的理解、筛选、配比、合成与系统化迭代,致力于建立数据分布、训练动态与模型能力之间的可解释映射,并将其转化为可预测、可干预、可扩展的数据策略和数据系统,持续提升模型的 token efficiency、scaling efficiency 与智能上限。
工作内容包括但不限于:
1.研究数据来源、质量、多样性、难度、覆盖度与模型能力之间的关系,建立“数据分布—训练动态—模型效果”的分析…
招聘城市:北京,上海
…能力。
【为什么是我们】
1.全栈顶配算力支持,依托美团大规模算力集群,提供千卡至万卡级算力支持,具备成熟的分布式训练与低延迟推理优化栈,保障 世界动作模型与 VLA 大规模训练。
2.与优秀人才同行,你将与行业顶尖的大模型研究员及机器人领域专家并肩作战,共同攻克具身智能的技术难点。
任职要求:
1.计算机、机器人、人工智能等相关专业硕士/博士学位,具备扎实的 CV、Robotics 或 RL 理论功底;
2.在 CVPR / NeurIPS / ICLR 等顶级会议发表过高水平论文者优先;
3.深入理解 World Model / VLA / Diffusion Policy / 强化学习等至少一项前沿技术;
4.精通 PyTorch,具备大规模分布式训练或复杂多模态数据管线构建经验…
招聘城市:北京
【LongCat大模型人才校招】基座评测与认知分析-基础模型及Agent能力研究
更新时间:2026-06-03
工作地点:北京市
事业群:核心本地商业-基础研发平台
岗位职责
当前,我们正处在大模型从Chat Bot进化为自主智能体(Agent)的关键阶段。Agent 已深度融入代码生产、办公、搜索等场高价值景,其核心能力从单轮对话拓展到复杂任务规划、工具编排、长程记忆与多步推理。如何系统、科学地衡量这些前沿能力,已成为决定大模型能力天花板的核心挑战。我们诚邀对 Agent 评测有信念感的你,一同定义下一代 Agent 能力的标尺。
本岗位涉及的具体方向包括:
1.构建 Agent 全维度评测体系:设计横跨感知-规划-执行-反思完整闭环的评测维度框架,重点覆盖…
招聘城市:北京
【LongCat大模型人才校招】基础大模型 Post-training 算法研究员
更新时间:2026-06-03
工作地点:北京市
事业群:核心本地商业-基础研发平台
岗位职责
我们在探索通过数据优化及大规模RL的方式,持续提升模型的核心基础能力和复杂生产力场景解决困难问题的能力。让模型具备深度思考与可靠行动的特性,推动模型在真实复杂任务中实现从“会说”到“会做”的跨越。团队在以下方向上进行探索,若你对以下一个或者多个课题感兴趣均欢迎投递:
1)大模型核心基础能力优化
1.围绕指令遵循、幻觉缓解、复杂推理、智能体规划等关键能力,研究并开发高效的后训练与对齐方案。
2.深入分析模型行为,通过数据策略、奖励建模、训练…
招聘城市:北京
【LongCat大模型人才校招】Agentic Coding算法研究员
更新时间:2026-06-03
工作地点:北京市
事业群:核心本地商业-基础研发平台
岗位职责
和我们一起开发前沿Agentic Coding模型,持续提升模型在长程复杂任务和真实开发场景中的表现,并通过代码提升数字世界的智能上限。加入团队,你将参与如下工作:
1.代码全链路训练:包括pretrain、midtrain、SFT、RL等环节,持续提升模型在代码生成、代码理解、代码修复等方向的能力边界。
2.高质量数据建设:构建高质量Coding数据生产、数据配比与数据质量评估体系,覆盖软件工程任务、仓库级代码生成、终端任务、Web开发等方向,推动模型能力持续演进。
3.Coding 强化学习:构建面向 Coding 场景的大规模 RL 训练体系,研究 Reward Design、Self…