牛大妈在校招职位搜索基座大模型北斗实习大模型推理前沿研究 有 43 条结果

招聘城市:北京,上海
岗位职责:
简介:打造 world class,production ready 的模型推理引擎,可根据个人背景和研究兴趣选择以下方向之一深入推进:
1、异构硬件高性能推理算子研究与开发。
2、Model System Co -design,充分利用硬件特性。
3、Scale up & scale out 分布式推理系统设计,高效可靠的推理调度体系。
4、投机推理算法研究与落地。
5、模型/KVCache 量化算法研究与算子开发。
任职要求:
1、具有扎实的编程功底,熟悉 C++/CUDA 编程最佳;
2、深入理解 Transformer/MoE/Attention 等 LLM 概念;
3、熟悉 RDMA,PD 分离等技术;
4、有一手的开源推理引擎使用/开发/调优经验最佳。
招聘城市:北京,上海
岗位职责:
简介:Reasoning(推理)是模型理解和处理信息的核心能力,是通用智能水平逼近的重要观测维度。本课题聚焦于探究生成式模型的高级推理发生机制,提升模型在复杂任务上的推理表现。
研究内容包括但不限于:
1、复杂任务推理应用效果优化,诸如逻辑推理、数学推理、代码推理、跨模态推理、多模型决策等。
2、RL scaling,通过大规模强化学习持续提升模型推理能力。
3、Test time scaling,通过增加inference时消耗的算力持续提升模型推理能力。
任职要求:
1、熟悉NLP、LLM、RL等相关领域,对其中一个或多个方向有深入的研究经历,且有相关实际项目经验;
2、熟悉Python、C++等至少一门编程语言,熟悉LINUX环境;
3、熟悉 Megatron、DeepSpeed 等开源训练…
招聘城市:北京,上海
岗位职责:
简介:我们聚焦于多模态推理前沿探索。你将参与具有前瞻性的研究,并可根据个人背景与兴趣,选择以下任一方向进行深入:
1、下一代多模态推理架构: 定义并实现复杂/统一多模态模型的高效推理框架。
2、实时交互演进: 针对多模态语音视频流,探索极致的系统级优化。
3、长文本/长视频突破: 深入研究长序列下的创新压缩算法与高性能推理加速方案。
任职要求:
1、熟悉模型推理原理及主流优化技术,拥有扎实的编程能力;
2、对多模态技术发展趋势有独立见解与思考;
3、具备极强的自驱力、创新意识与执行闭环能力;
加分项:
1、在相关领域有研究或项目实践经验;
2、对系统性能优化、压缩算法、实时…
招聘城市:北京,上海
岗位职责:
简介:语言模型后训练前沿算法研究包括但不限于:
1、对齐算法研发:包括 SFT 数据建设,指令微调等。构建高质量的训练数据,包括自动化数据清洗、合成数据生产、高质量 Prompt Engineering 等。优化模型复杂指令遵循、逻辑推理、创作写作、代码生成以及工具调用等能力,提升模型综合能力和用户体验。
2、人类偏好对齐:包括奖励模型、人类偏好对齐等前沿强化算法的探索和实践,提升模型在包括创意写作、对话风格以及模型内生安全对齐等人类偏好上的可控性,生成更符合人类价值观、逻辑习惯和审美偏好的内容。
3、跟踪并实现最新的后训练技术(如数据领域自动化配比、后训练机制设计和优化等)。
任职要求:
1、硕士及以上学历,计算机…
招聘城市:北京,上海
岗位职责:
简介:参与 OpenClaw 下一代 Agent 方向的前沿研究,可根据个人背景和研究兴趣选择以下方向之一深入推进:
1、Skill 体系建设与演化:探索 Skill 的表示、组织、调度与自进化机制,提升复用性与泛化能力。
2、模型训练与调优:包括 Agentic RL、模型自适应推理等,提升智能体在复杂任务中的规划、工具调用与执行能力。
3、OpenClaw C 端社区探索:用 AI Agent 重新定义人与信息的连接方式,从 0 到 1 构建产品与技术全链路。
4、Agent 框架能力建设:智能体架构优化、推理成本控制、上下文治理、长期记忆与执行效率提升等方向研究
5、其他你坚信路线正确的下一代 Agent 前沿方向。
任职要求:
1、有好奇心,敢想敢做,学习能力强,能…
招聘城市:北京,上海,深圳
…以下方向之一深入推进:
1、多模态预训练与后训练技术创新,提升模型在 OCR、文档图表解析、Visual Grounding、细粒度感知、视觉问答等核心任务上的能力上限。
2、多模态强化学习方案设计,实现视觉感知与多模态理解场景下的高性能可信输出与幻觉抑制。
3、视觉推理能力增强研究(Visual CoT、PRM 等),提升模型在复杂视觉任务上的推理深度。
4、工具调用与 Agent 能力构建,探索多模态模型在规划决策场景中的综合表现。
5、长上下文视觉理解与 GUI 能力研究,提升模型在长程复杂任务上的综合能力。
6、其他你坚信路线正确的多模态模型前沿方向。
任职要求:
1、具备视觉多模态模型的预训练或后训练研究经历;
2…
招聘城市:北京,上海,深圳
…交互轨迹的大规模RL Scaling、基于环境反馈的自进化与持续学习机制,以及多模态推理与行动的联合优化策略。
任职要求:
1、本科及以上学历,计算机、人工智能、自动化、数学等相关专业在读;
2、在以下一个或多个领域有较深入的研究或实践经验:多模态模型(MLLM)、强化学习(RL)、Agent系统、GUI Agent / Computer Use、视觉-语言模型、跨模态融合;
3、熟悉Python,具备较强的工程实现能力,有模型训练或推理实践经验者优先;
4、好奇心驱动,具备出色的问题分析与自主探索能力,能够在前沿不确定性较高的方向中持续推进;
5、具有良好的沟通协作能力,对追求前沿技术有强烈热情,能够与团队融洽合作,快速试验想法。
加分项…
招聘城市:北京,上海,深圳
…简介:参与虚拟人交互方向的前沿研究,可根据个人背景和研究兴趣选择以下方向之一深入推进:
1、基于多模态模型构建端到端交互虚拟人模型,实现智能双工交互能力。
2、人、物、场景多模态感知与推理,探索高度拟人化的虚拟人交互体验。
3、Human Video Model 研究:高质量人脸、人体及人物交互的视频生成基座构建。
4、虚拟人语音、表情、动作的多模态对齐与同步生成方法研究
5、其他你坚信路线正确的虚拟人交互前沿方向。
任职要求:
1、熟悉多模态模型、2D虚拟人、视频生成等相关研究进展;
2、熟悉PyTorch,有充分的动手实践经验。
加分项:
1、社区影响力:有多模态模型、视频生成、虚拟人相关研究实习经历…
招聘城市:北京,上海
研究结合常识推理的视觉语言导航(VLN)技术。利用语言模型的逻辑链(CoT)能力,将复杂的模糊指令分解为可执行的动作序列,解决具身智能在复杂物理空间中的定位、语义地图构建及长程任务中的意图保持问题。
4、敏捷运动控制与精细操作:探索强化学习(RL)与模型结合的全身协同控制方案。包括但不限于:人形机器人的复杂地形敏捷行走、基于触觉-视觉融合的多指灵巧手精细操作。研究如何通过Sim-to-Real技术将大规模仿真学习的策略高效迁移至真实硬件,实现丝滑的物理动作输出。
5、具身人机交互与在线进化:构建自然的自然语言/手势交互界面,使机器人能理解人类的情境、反馈并进行修正。研究
招聘城市:北京,上海,深圳
…与世界模型方向的前沿研究,可根据个人背景和研究兴趣选择以下方向之一深入推进:
1、高效率、低损失、高压缩比的图像视频 VAE 和 tokenizer 研究
2、统一生成模型的架构、训练与推理探索(稀疏架构、尺寸 MoE、自回归生成等)。
3、功能模型研究,包括参考生成、长视频生成、流式实时视频生成、音视频生成等。
4、隐式世界模型、WorldActionModel 及 Action-conditioned WorldModel 的方法研究
5、世界模型在具身智能、实时交互等场景中的应用探索。
6、其他你坚信路线正确的视觉生成与世界模型前沿方向。
任职要求:
1、熟悉扩散模型、VAE等相关研究进展;
2、熟悉PyTorch,有充分的动手实践经验。
加分项:
1、有图像/视频生成、Video-based世界模型相关研究实习经历…
招聘城市:北京,上海
…提升模型在多模态交互场景下的原生能力
复杂场景落地:面向 Agent、具身智能等前沿场景,提升模型的多模态指令遵循与复杂任务规划能力
4. 下一代训练范式与前沿技术探索
自进化机制:协同上下游团队,探索模型自进化(Self-evolution)机制,研究RL在Mid-training阶段的应用
能力扩展:研究推理阶段扩展(Test-time Scaling)及全模态链式思维(Omni-modal CoT),推动模型从单纯的“知识记忆”向“深度推理与问题解决”演进
任职要求:
1. 硕士及以上学历,计算机、人工智能、数学、自然语言处理等相关专业,博士优先;
2. 具备扎实的算法和数学理论基础及良好的编程基础,熟悉Python、Java等至少一种编程语言,熟悉PyTorch等深度学习框架;
3. 在模型领域有研究
招聘城市:北京,上海
…该方向主要研究内容有两点:一是模型对于工具/Skill 调用的指令遵循能力;二是模型对于复杂总结指令的遵循能力。
2、全模态深度搜索智能体:最真实的物理世界都是全模态的,所以搜索智能体不仅在输入上需要支持全模态,而且在整个搜索过程以及最后的结果呈现上都需要支持全模态。该方向主要研究怎么将已经比较成熟的搜索智能体从单一的文本模态扩展成同时支持文本、语音、图像等多种形式的全模态智能体,要解决全模态规划、深度推理、上下文管理和记忆带来的挑战。
3、主动交互深度研究智能体:智能体时代,所有的智能体都应该是一个具有自主意识的个体,能够主动提供服务…
招聘城市:北京,上海,深圳
…学习;
3、熟悉Python,熟练使用PyTorch等深度学习框架,具备较强的工程实现能力,有大规模分布式训练或流式推理优化实践经验者优先;
4、好奇心驱动,具备出色的问题分析与自主探索能力,能够在前沿不确定性较高的方向中持续推进;
5、具有良好的沟通协作能力,对追求前沿技术有强烈热情,能够与团队融洽合作,快速试验想法。
加分项:
1、在ICASSP、Interspeech、ACL、ICLR、NeurIPS、ICML等顶会发表过相关论文者优先;
2、在有影响力的开源项目(如模型、语音处理框架、Agent框架等)中做出过核心贡献者优先;
3、有AudioLM、VALL-E、Qwen-Audio等语音/音频模型相关研究经验,或有Voice Agent、Tool-use模型实战经验者优先。
招聘城市:北京,上海
岗位职责:
简介:参与面向模型训练/推理的高性能计算与系统优化工作,可根据个人背景和研究兴趣选择以下方向之一深入推进:
1、面向GPU/NPU 等多硬件平台的算子开发与极致性能优化(CUDA/Cutlass/TileLang)。
2、跟踪前沿模型算法并完成高性能工程落地,深入框架层开展算子融合、内存/通信优化、流水编排等系统级性能调优。
3、探索基于模型的高性能 Kernel 自动合成技术,参考 LLM-driven Kernel Generation 范式,研究高效 GPU/NPU Kernel 的端到端自动生成与迭代优化方法。
4、基于DSL(如 Triton、TVM TIR、Halide 等)的编译优化与自动调优技术研究
5、多硬件后端(NVIDIA/国产芯片)的统一算子库建设与迁移适配。
任职要求:
1、GPU编程:写过…
招聘城市:北京,上海
…1、计算机、人工智能、数学、统计学、电子信息或相关专业本科高年级、硕士或博士在读;
2、具备扎实的机器学习基础,对以下至少一个方向有较深入理解: - 语言模型与后训练 - 强化学习 / Online learning / Bandit / Sequence decision making - Agent / Tool use / Planning / Reasoning - 记忆增强模型 / RAG / 长上下文建模 - Reward modeling / Preference learning / PRM / ORM
3、熟悉 Python,具备较强的工程实现能力,能够独立完成实验、调参与结果分析,并具有一定的模型训练或推理实践经验;
4、具备较强的论文阅读、问题抽象与实验设计能力,能够围绕一个研究问题提出清晰假设、设计验证方案并推进落地;
5、具备良好的沟通协作能力与研究主动性,能够在不确定性较高的前沿问题中快速学习、持续推进。
招聘城市:北京
…与可行性验证,形成可落地的训练方案并推动模型迭代。
1、面向复杂业务场景(如多轮交互、长序列推理、跨模态 Agent 决策等),进行针对性的垂域数据建设与指令微调,持续提升模型在垂直场景下的表现上限。
2、建设后训练评估体系与数据飞轮,设计面向垂域场景的自动化评测基准,驱动"评测→数据→训练→评测"的闭环迭代。
3、探索多模态模型与新一代Agent框架(Claude Code、OpenClaw 等)的深度结合,研究模型在工具调用、环境感知、多步规划等场景下的能力边界,推动多模态模型从"被调用"向"自主交互"演进,拓展智能体在真实复杂环境中的落地路径。
任职要求:
1、对前沿技术有强烈的探索欲,有出色的…
招聘城市:北京,上海,深圳
…生成模型的架构、训练和推理探索,包括稀疏架构、尺寸MoE、自回归生成等;
3. 功能模型,包括参考生成、长视频生成、流式实时视频生成、音视频生成等;
4.实时交互视频世界模型的长时空一致性、动态性和交互控制能力增强,以及在可交互视频、虚拟人实时交互场景的应用。
任职要求:
1.熟悉扩散模型、VAE等相关研究进展
2.熟悉PyTorch,有充分的动手实践经验
加分项:
1.有图像/视频生成、多模态模型相关研究实习经历,有影响力的开源项目中做出过核心贡献
2.发表过高水平论文(如ICLR、CVPR、ICCV等),有相关竞赛经历并取得名次
岗位吸引力:
1.极具前沿性和爆发力的研究方向:你将站在视频生成基座Scaling…
招聘城市:北京,上海
模型架构优化探索,算法工程协同设计,涉及到训练和推理的各类算法和工程策略探索落地。参与美团基座模型项目,包含但不限于:
1、模型高效架构设计探索(高效attention,moe架构等)。
2、预训练 / 后训练算法工程策略。
3、投机推理算法工程策略。
4、模型轻量化策略(剪枝,量化,稀疏,蒸馏,结构搜索等) 。
5、Agentic coding系统优化策略。
任职要求:
1、熟悉一些常用的深度学习框架和大规模训推框架(比如megatron,verl,vllm,sglang等等),在模型上有训练和推理算法工程优化实际经验的优先;
2、熟悉机器学习和深度学习理论,具备扎实的编程能力,熟悉常见的主流模型架构;
3、有模型或机器学习相关顶会论文发表,特别是模型架构…
招聘城市:北京,上海
…式调优、调度优化、算法 co-design等,包括不限于 RLHF、RLVR、Agentic RL等范式。和算法共同提升模型各类专项能力,应用生产力等等
你可能从事以下方向:
1、RL训练系统架构
①设计和实现支持 PPO及各类变种算法的高效训练框架。
②Data/Env Scaling,优化并发调度效率 。
2、在线采样 & Rollout 优化
①优化RL场景(longcot、长尾分布、多轮交互)推理引擎效率,包括不限于量化、MTP、并行切分等等。
②训推混部署、全流程异步训练,提升 GPU 利用率。
3、 训推一致性
①训推引擎天然为了各自最大化效率存在精度差异,研究如何不断降低两者diff,包括不限于 Routing Replay、确定性计算等等。
4、训练稳定性
①攻克RL训练特有的奖励Hacking、训练不稳定、KL爆炸…
招聘城市:北京,上海
…商业分析、精准营销与广告投放、个人助理与智能服务三场景,致力于用 AI Agent 重构人与数据、人与服务的交互方式。
【技术方向】
1、DataAgent 核心基建:攻坚复杂长周期任务的调度架构,解决大规模数据流转下的上下文治理、长期记忆与状态流控难题。
2、BA 场景工具链:构建高扩展性数据处理 Skill 体系与安全高效的代码执行沙盒,支持 Agent 智能调度高并发数据流处理工具。
3、精准营销 Agent:基于海量用户行为数据的宏观统计与微观推理,探索精细化需求理解与大小模型协同的高效系统设计。
4、Skill 体系与模型优化:探索 Skill 的表示、调度与自进化机制;推进 Agentic RL、自适应推理模型训练与调优工作。
5、智能…