招聘城市:北京,上海
…1、计算机、人工智能、数学、统计学、电子信息或相关专业本科高年级、硕士或博士在读;
2、具备扎实的机器学习基础,对以下至少一个方向有较深入理解: - 大语言模型与后训练 - 强化学习 / Online learning / Bandit / Sequence decision making - Agent / Tool use / Planning / Reasoning - 记忆增强模型 / RAG / 长上下文建模 - Reward modeling / Preference learning / PRM / ORM
3、熟悉 Python,具备较强的工程实现能力,能够独立完成实验、调参与结果分析,并具有一定的大模型训练或推理实践经验;
4、具备较强的论文阅读、问题抽象与实验设计能力,能够围绕一个研究问题提出清晰假设、设计验证方案并推进落地;
5、具备良好的沟通协作能力与研究主动性,能够在不确定性较高的前沿问题中快速学习、持续推进。
招聘城市:北京,上海
…课程学习(Curriculum Learning)等训练策略,显著优化Token/FLOPs转化效率
2. 长上下文 (Long Context) 与高效架构演进
长窗口突破: 持续Scaling Up模型的Context Length,优化超长上下文机制,重点提升LongCat基座模型在长上下文上的表现
架构优化: 探索并验证MoE(混合专家)、稀疏注意力(Sparse Attention)、线性注意力等模型结构;结合剪枝与稀疏化技术,协同优化训练与推理效率,提升超长上下文场景下的效率
上下文管理: 探索逐轮次和跨多轮次的上下文管理方法,并建立对应评测体系,从而减少冗余信息堆叠,实现高效思考和性能提升
3. 多模态能力融合与 Agent 赋能
模态融合:探索多模态预训练新范式,突破模态融合瓶颈。利用多模态扩展定律指导数据与…
招聘城市:北京,上海,深圳
…感知与连续决策:从"处理静态截图"升级到"实时屏幕流+音频流"的连续感知模式,探索Agent在动态变化的数字环境中进行实时状态追踪与即时响应的能力,支撑直播监控、实时协作等需要持续交互的场景。
4、全模态Agent的高效学习范式:探索面向全模态CUA场景的强化学习训练方法,包括但不限于:多模态环境下的奖励建模与过程奖励设计、GUI交互轨迹的大规模RL Scaling、基于环境反馈的自进化与持续学习机制,以及多模态推理与行动的联合优化策略。
任职要求:
1、本科及以上学历,计算机、人工智能、自动化、数学等相关专业在读;
2、在以下一个或多个领域有较深入的研究或实践经验:多模态大模型(MLLM)、强化学习…
招聘城市:北京,上海,深圳
…2、实时全双工流式交互与动态响应: 研究面向真实对话场景的流式输入输出机制,攻克语音智能体在自然对话中的“听觉注意力”问题。探索支持随时打断(Interruption)、智能插话(Backchanneling)、端点检测(VAD)与即时状态切换的底层模型架构,实现媲美真人的丝滑对话节奏。
3、语音驱动的Agent规划与工具调用(Voice-to-Action): 探索如何将模糊、口语化、包含冗余信息的自然语音指令,直接转化为精准的Agent意图与工具调用(Tool Use/API Call)序列。研究语音模态下的长上下文记忆、多轮语音交互中的意图追踪,以及“边对话边执行任务”的并行处理能力。
4、面向语音Agent的高效对齐与强化学习: 探索适用于语音大模型的训练范式与对齐策略。包括但不限于…
招聘城市:北京,上海
…探索通过 agent swarm 或其他先进的 multi-agent system 进行系统性长程任务的并行执行和提效。
4、探索多模态推理和多模态环境交互的范式,并基于此进行增强智能体系统在复杂全模态环境下的任务完成能力。
任职要求:
1、本科及以上学历,计算机、人工智能、自动化、数学、物理等相关专业在读;
2、在强化学习、文本 / 多模态大模型训练、Agent、世界模型等一个或多个领域有较深入的研究和实践经验者;
3、好奇心驱动,具有出色的分析、解决问题的能力,有自主探索解决方案的能力者;
4、具有良好的沟通协作能力,对追求纯粹的技术有强烈热情,工作积极主动,能够与团队融洽合作,一起探索新技术并快速试验想法,推进…
招聘城市:北京,上海
…长周期任务的调度架构,解决大规模数据流转下的上下文治理、长期记忆与状态流控难题。
2、BA 场景工具链:构建高扩展性数据处理 Skill 体系与安全高效的代码执行沙盒,支持 Agent 智能调度高并发数据流处理工具。
3、精准营销 Agent:基于海量用户行为数据的宏观统计与微观推理,探索精细化需求理解与大小模型协同的高效系统设计。
4、Skill 体系与模型优化:探索 Skill 的表示、调度与自进化机制;推进 Agentic RL、自适应推理等模型训练与调优工作。
5、智能服务新范式:建立 C 端个人 Agent 与 B 端服务 Agent 的连接,研究智能体架构优化、推理成本控制与长期记忆提升。
任职要求:
1、有好奇心,敢想敢做,学习…
招聘城市:北京,上海
…职责:
简介:Coding是当前 AI 技术落地最快、商业价值最大的方向之一。从代码补全到自主修复 GitHub Issue、到端到端软件工程自动化,大模型 Coding 能力的突破正在重塑整个软件开发范式。我们正在构建下一代具有强大代码生成与自主 Agent 能力的基座模型,打造可在真实工程环境中独立运作的 AI 开发者。
岗位职责
1、负责基座大模型在代码生成、代码理解、代码 debug 等方向的能力研究与提升,提升模型在Coding任务中的 Planning、长上下文理解等核心能力。
2、探索模型在 repo 级代码理解、跨文件修改、自主 debug 等复杂任务上的能力边界。
3、参与 Post-training(SFT / RL/ PRM)等 Alignment 方法在 Coding 场景的研究与落地。
任职要求:
1、熟悉NLP、LLM…
招聘城市:北京,上海
…学习范式以RLVR为主,但是RLVR具有奖励稀疏、适用范围有限、训练不稳定和训练成本高等缺点。该方向主要研究方向包括但不限于:熵机制研究、过程奖励模型(PRM)、开放问题rubrics-based RL、credit assignment、Thinking/Tool Call Budget等。
任职要求:
1、硕士及以上学历,计算机、人工智能、数学、自然语言处理等相关专业,博士优先;
2、在大模型领域有研究基础,或参与过有影响力的开源项目,在ICLR/NeurIPS/ICML/ACL等顶会发表论文者优先;
3、在程序设计竞赛,如ACM/ICPC、Topcoder和Codeforces等,取得优异成绩者优先;
4、具备扎实的机器学习基础,对以下一个或者多个领域有深入研究者优先:
①Pre -training / Mid-training / Post-training
②Complex Instruct Following / Generalization / Long Context
③Multimodal Agent / General Agent…
招聘城市:北京,上海
…Agent 错误归因体系,针对 Agent 陷入死循环、幻觉指令、工具调用失败等典型场景进行深度诊断。
3、未来形态探索:
①跟踪前沿 Agent 发展,研究在多智能体协同、自主进化等未来形态下的 Agent 形态和相应的评测基准。
②利用 LLM/Agent-as-a-Judge 的方式,提升自动化评测的准确性与效率。
任职要求:
1、硕士及以上学历,计算机或相关专业,博士优先;
2、在 ML / NLP / RL / CV / Speech 等相关方向有扎实的研究基础,在 ACL / EMNLP / NAACL / NeurIPS / ICML / ICLR / CVPR / ICCV / ICASSP 等顶级会议发表论文者优先;
3、优秀的代码和算法功底,具备工匠精神,ACM/ICPC、NOI/IOI、Top Coder、Kaggle等比赛获奖者优先;
4、在大模型领域或强化学习领域,主导过大影响力的项目…
招聘城市:北京,上海
…机制,提升复用性与泛化能力。
2、模型训练与调优:包括 Agentic RL、模型自适应推理等,提升智能体在复杂任务中的规划、工具调用与执行能力。
3、OpenClaw C 端社区探索:用 AI Agent 重新定义人与信息的连接方式,从 0 到 1 构建产品与技术全链路。
4、Agent 框架能力建设:智能体架构优化、推理成本控制、上下文治理、长期记忆与执行效率提升等方向研究
5、其他你坚信路线正确的下一代 Agent 前沿方向。
任职要求:
1、有好奇心,敢想敢做,学习能力强,能在复杂问题的深度思考与拆解能力;
2、顶会论文(ACL/EMNLP/NeurIPS/ICLR/KDD 等)、开源贡献或算法竞赛成果突出者优先;
3、有OpenClaw、Claude Code深度使用经验与产出优先…
招聘城市:北京,上海
…回滚与复现验证流程。
4、训练策略、数据配方与反馈信号设计,围绕 SFT、RLVR等方法,结合数据构造、数据清洗、超参数优化以及 outcome-level / process-level 信号设计,提升模型在开放研究任务中的完成率、事实正确性和稳定性。
5、面向真实 research 任务的评测体系与错误分析闭环建设,建立 benchmark、自动化评测指标,系统分析搜索遗漏、证据误判、上下文污染、推理漂移、错误归因与长链路失稳等问题,并推动针对性优化。
任职要求:
1、硕士及以上学历,计算机、人工智能、数学、自然语言处理等相关专业,博士优先;
2、具备扎实的算法和数学理论基础及良好的编程基础,熟悉Python、Java等至少一种编程语言,熟悉PyTorch等深度学习框架;
3、在大模型领域有研究基础…
招聘城市:北京,上海,深圳
…能力上限。
2、多模态强化学习方案设计,实现视觉感知与多模态理解场景下的高性能可信输出与幻觉抑制。
3、视觉推理能力增强研究(Visual CoT、PRM 等),提升模型在复杂视觉任务上的推理深度。
4、工具调用与 Agent 能力构建,探索多模态模型在规划决策场景中的综合表现。
5、长上下文视觉理解与 GUI 能力研究,提升模型在长程复杂任务上的综合能力。
6、其他你坚信路线正确的多模态大模型前沿方向。
任职要求:
1、具备视觉多模态大模型的预训练或后训练研究经历;
2、熟悉PyTorch,有充分的动手实践经验。
加分项:
1、社区影响力:在多模态大模型领域有影响力的开源项目中做出过核心贡献;
2、学术影响…
招聘城市:北京,上海
…生成过程带来新的能力跃迁并进行度量,分析模态和任务间的相互关联,指引模型架构、训练策略等选型。
3、多模交互方向:包括通用世界模型、音视频交互等,研究动态多轮交互中的一致性、真实性和长程记忆等关键能力的自动化度量,指引基座模型的迭代。
任职要求:
1、硕士及以上学历,计算机或相关专业,博士优先。;
2、在 ML / NLP / RL / CV / Speech 等相关方向有扎实的研究基础,在 ACL / EMNLP / NAACL / NeurIPS / ICML / ICLR / CVPR / ICCV / ICASSP 等顶级会议发表论文者优先;
3、优秀的代码和算法功底,具备工匠精神,ACM/ICPC、NOI/IOI、Top Coder、Kaggle等比赛获奖者优先;
4、在大模型领域或强化学习领域,主导过大影响力的项目或论文者优先…
招聘城市:北京,上海
…为模型在真实物理世界下的训练和模拟训练提供坚实基础。
3、训练模型在动态、时序变化的开放世界下,自主进行感知、观察、探索、交互、任务推进的能力,并预期这样的能力作为真实物理世界训练的坚实前置基础,可以 minimize 所需的高成本真实物理世界训练量。
任职要求:
岗位要求:
1、本科及以上学历,计算机、人工智能、自动化、数学、物理等相关专业在读;
2、在强化学习、文本/多模态大模型训练、Agent 、世界模型等一个或多个领域有较深入的研究和实践经验者;
3、好奇心驱动,具有出色的分析、解决问题的能力,有自主探索解决方案的能力者;
4、具有良好的沟通协作能力,对追求纯粹的技术有强烈热情,工作积极主动,能够与…
招聘城市:北京
…基座模型,系统性整合美团用商双端数据,通过PT、SFT、RLHF等方式构建适配外卖/到餐领域的垂直领域LLM,快速支持商业广告系统多大模型应用落地。
2.基于强化学习+领域LLM 的通用相关性解决方案:基于领域LLM,结合GRPO等强化学习技术,多agent 技术 探索相关性问题上限。
任职要求:
海内外高校在校本科生(大三及以上)、硕士生及博士生,且满足:
1.LLM、MLLM、AIGC、RL等一个或多个方向有深入研究经历,且有相关实际项目经验。
2.熟悉Python、C++等至少一门编程语言,熟练使用主流深度学习框架。
3.有影响力的开源项目中做出过核心贡献,或发表过高水平论文。
4.有热情攻克技术难题,推动大模型技术在真实业务场景…
招聘城市:北京
…候选集中精准平衡相关性、多样性与发现感,实现“所想即所得”。
4.引导增长基座: 研发下一代搜索引导与推荐算法,通过生成式技术优化搜索前/中的用户路径,提升用户发现价值的效率。探索搜索与推荐的深度融合,利用 AI Agent 能力引导用户决策,实现业务增长与用户体验的协同进化。
5.跨业务 Builder 型组织建设:作为 Builder,构建跨业务(餐饮、医药、即时零售、服务零售、酒旅等)的通用算法框架,确保技术底座能够快速适配不同垂直场景的特性。在毫秒级延迟的严苛约束下,主导大模型在线 Serving 优化,通过蒸馏、量化、缓存等手段实现效果与性能的极致平衡。
任职要求:
【任职资格】
1.有搜索、推荐、NLP相关实习或项目经验;
2.熟悉大模型训练、微调…