牛大妈在社招职位搜索混元大语言模型后训练算法工程师-模型合版方向北京 深圳 有 21 条结果

招聘城市:北京
…职责:
1.深度参与模型训练(包括 SFT、RL )及模型合版的研发和相关算法策略研究,提升模型泛化性、能力边界和上限;
2.训练策略和生产范式的研究,探索更加敏捷、普适和可扩展的训练范式,提升训练和生产效率;
3.相关前沿训练技术方向探索,包括但不限于 Reasoning/Agentic 能力增强和 Scaling, RL/OPD 等收敛性和可扩展性研究;
4.将研究成果转化为实际的模型能力或生产效率,并撰写高水平技术报告或论文,提升技术影响力。
岗位要求:
1.计算机科学、数学、人工智能等相关专业硕士及以上学历,具备良好的数理基础;
2.具备良好的工程实现能力,熟练使用 PyTroch、Megatraon、vLLM 等常见模型训练和推理框架…
招聘城市:北京
…医学信息等相关专业硕士及以上学历,2年以上NLP、搜索、知识工程或智能体相关经验,有模型落地经验者优先;
2.算法能力:深入理解 Transformer 和 LLM 训练流程,熟悉 RAG 技术栈,对检索、上下文处理、多文档理解等有较好基础;
3.Agent 能力:熟悉推理类模型、Agent 框架及其在复杂专业任务中的应用,能够将搜索、数据分析、表格处理、文档处理、报告生成等能力组合成完整工作流;
4.技术功底:熟练掌握 PyTorch 等深度学习框架,了解分布式训练、推理优化及多工具协同的工程实现;
5.综合素质:逻辑清晰,数据敏感度高,能够从复杂专业场景中抽象问题并推动落地,对专业领域 AI Agent 发展方向有自己的理解;
6.软技能:自驱力…
招聘城市:深圳
…1.负责语言模型训练(Post-Training)阶段的核心技术研发,构建和优化高质量的奖励系统(Reward System),通过Reward Modeling (RM) 和强化学习(RL)算法持续提升模型在复杂指令遵循、逻辑推理及价值观对齐方面的能力;
2.深入研究和优化 RLHF等训练算法,提升模型训练的稳定性和最终效果;
3.负责训练阶段的数据合成与管理,设计高效的数据飞轮机制,利用SFT、Self-Instruct等技术合成高质量训练数据,并负责建立从用户反馈(User Feedback)到模型迭代的闭环信号建模体系;
4.负责训练模型的全维度评测与分析,制定科学的评价指标,跟进前沿技术动态,将最新研究成果快速转化为业务价值。
岗位要求:
1.计算机科学/软件工程/人工智能…
招聘城市:北京

1.计算机科学、人工智能或相关专业硕士及以上学历,具备模型数据工程模型训练实际项目经验;
2.深入理解 Transformer 架构及语言模型训练原理,具备丰富的数据经验,能针对 LLM Alignment、RLHF等训练场景,设计高标准数据方案,有项目实战经验;
3.深入实践过 ReAct、Reflexion 等前沿 Agent 推理框架,能够深度剖析 Agent 运行轨迹,系统性优化其思维链质量、工具调用的鲁棒性及环境反馈准确性;
4.熟练掌握 Python,熟悉 PyTorch/TensorFlow 等深度学习框架,能高效利用模型能力解决数据链路难点;
5.在CCF-A顶会(NeurIPS, ICLR, ICML, ACL 等)有高质量论文发表,或在开源社区(如 HuggingFace、GitHub模型相关项目)有高影响力贡献者优先;
6.具备强烈的…
招聘城市:北京
…具备模型数据工程或Code LLM等实际项目经验;
2.深入理解 Transformer 架构及语言模型训练原理,具备丰富的数据处理经验。能针对Code SFT、代码偏好对齐等训练场景,设计高标准数据方案,有项目实战经验;
3.深入实践过 CodeAct、SWE-agent、LATS、AlphaCode等前沿代码推理与自动化框架者优先;
4.熟练掌握 Python,善于利用 Cursor、Claude Code 等 AI 辅助工具提升数据生产与自动化分析效率。熟悉至少一门其他主流编程语言(C++/Java/Go等),熟悉Docker优先;
5.在前沿会议有高质量论文发表,或在开源社区有高影响力贡献者优先;
6.具备强烈的数据敏感度、技术热情和自驱力,能够从繁杂的代码与报错日志中洞察模型能力的边界…
招聘城市:深圳
岗位职责:
1.负责模型高难训练精标数据研发,包括通用Agent、知识Agent、代码Agent、复杂指令等;
2.构建训练数据合成/挖掘体系,人机协同智能标注建设,设计数据价值验证流程,探索数据扩充路径,提升高难任务及Agent能力。
岗位要求:
1.熟练掌握Python,熟悉Linux环境开发,精通深度学习框架PyTorch;
2.具备分析问题定义问题和解决问题能力,具备持续的自驱力来面对挑战,有较强的算法实验能力;
3.持续跟进前沿的模型技术,了解前沿的模型相关算法,熟悉Transformer等模型结构;
4.在模型领域顶会发表过高质量论文者优先,有LLM Agent相关经验优先。
招聘城市:深圳
岗位职责:
1.负责语音/音频模型研发,包括音频理解(ASR/音频caption)、音视频理解等模型研发;
2.负责预训练训练、强化学习(文本和音频强化)相关的数据、算法、评测工作;
3.负责音频理解/ASR模型开源以及产品落地(比如产品全链路端到端优化、音频理解在噪音/口音/远场/音效音乐场景的优化)。
岗位要求:
1.有语音识别、音频理解、音乐理解等相关经验者优先;
2.有音视频多模态、语言模型(预训练、微调、强化学习)等相关经验者优先;
3.优秀的代码能力、数据结构和算法功底,熟练掌握Python,熟悉Pytorch/Megatron/FSDP等模型训练框架、熟悉SLIME/VERL等RL框架优先;
4.有ACM/ICPC、NOI/IOI、Top Coder、Kaggle等比赛获奖者优先;
5.在相关顶级会议…
招聘城市:深圳
…负责语音/音频模型研发,包括语音对话(语音交互/音视频对话)、音频理解(ASR/音频caption)、音频生成(TTS/视频配音)等模型研发;
2.负责语音/音频模型的预训练训练、强化学习(文本和音频强化)相关的数据和算法工作;
3.负责语音对话/音频理解/音频生成的模型开源以及产品落地(比如语音对话产品全链路端到端优化、音频理解在噪音/口音/远场/音效音乐场景的优化、语音合成在播报/闲聊/游戏/社交等场景的优化)。
岗位要求:
1.有语音对话、语音合成、语音识别、音视频多模态、语言模型(预训练、微调、强化学习)等相关经验者优先;
2.优秀的代码能力、数据结构和算法功底,熟练掌握Python或C/C++,熟悉Pytorch/Megatron/DeepSpeed等模型训练框架,有ACM…
招聘城市:北京
工程团队协作,打通 “训练 - 评测 - 迭代” 闭环,适配不同场景下的 Agent 产品需求。​;
5.技术创新与沉淀:跟踪模型 Agent 领域前沿技术(如 LLM+Planning、Tool Learning、Multi-Agent Interaction),主导核心技术攻关与专利申请;输出可复用的训练算法组件、技术文档与评测基准,推动团队技术能力沉淀。
岗位要求:
1.计算机科学、人工智能、机器学习等相关专业硕士及以上学历,1年以上模型训练或 Agent 相关研发经验。​;
2.扎实的算法基础:精通深度学习、强化学习、自然语言处理核心理论,深入理解模型训练原理、Transformer 架构及 Agent 决策机制。​;
3.工程能力扎实:熟练掌握 Python 编程语言,精通 PyTorch/TensorFlow 框架及 HuggingFace 生态,具备大规模数据处理(Spark/Flink)与分布式训练(DDP/FSDP…
招聘城市:北京
岗位职责:
1.建设模型数据回流管线,负责数据的清洗和标准化;
2.负责模型数据飞轮体系产品的落地,挖掘模型使用短板与业务痛点,搭建「使用-回流-迭代升级」的正向数据闭环;
3.开发数据透视、管理和交付平台,提升数据交付过程中的效率和质量;
4.与算法训练和数据采购团队协作,提高各链路流程的效率。
岗位要求:
1.熟练使用 Python、Go 或 Java,具备端或数据平台开发经验;
2.熟悉大规模日志处理、数据清洗、任务调度和常见存储组件;
3.熟悉网关、认证、RBAC 权限控制及企业内部系统开发;
4.了解语言模型训练流程及训练数据特点;
5.熟悉腾讯内部基础设施、网关和权限配置者优先;
6.有模型数据、Agent 轨迹或…
招聘城市:北京
…化交付体系,理解镜像构建优化、依赖隔离、网络/存储、制品/镜像仓库等能力,并能设计可复现的环境交付流程;
3.熟悉 Kubernetes 使用与排障,能在集群环境下完成部署治理、资源配置和稳定性问题定位;
4.有端服务、数据平台、任务平台、机器学习平台或评测平台相关研发经验;
5.理解数据集管理中的版本、信息、质量校验、权限、可追踪性和自动化流程,具备良好的数据建模能力;
6.具备强问题分析与闭环能力,能高效利用 AI 工具提升研发效率,并能与算法和平台团队协作推进落地。
加分项:
1.熟悉强化学习、Eval、Benchmark、Agent 任务数据或模型训练数据流程;
2.具备跨语言协作能力,能借助 AI 工具阅读和维护 TypeScript / Rust / Go 代码。
招聘城市:深圳
…式平台前端架构与全栈研发:负责模型一站式平台的前后端全链路研发工作,覆盖模型训练、效果评测、服务部署、数据管理、权限管理等核心模块的建设与迭代。主导平台前端架构设计,构建高复用、可配置、可扩展的组件化与模板化体系,持续提升平台研发效率与用户体验;
2.复杂交互与可视化能力建设:负责模型训练监控、评测看板、任务流编排、模型对比等复杂交互页面的开发与优化。设计并实现与模型训练、推理、评测等端服务的高效通信方案,处理流式数据、实时状态同步等高并发场景;
3.全栈通用能力沉淀与工程化升级:沉淀组件库、公共模块及工程化能力,推动平台能力标准化和规模…
招聘城市:深圳

3.构建自动化评测流水线,提升评测效率与研发迭代速度;
4.与算法、产品团队紧密协作,理解评测需求并转化为可落地的技术方案。
岗位要求:
1.本科及以上学历,计算机相关专业,5 年以上端开发经验;
2.扎实的系统设计能力,有复杂业务系统或平台型产品的架构经验;
3.熟练掌握 Python/Go 等至少一门语言,熟悉常用框架与中间件;
4.熟悉分布式系统、任务调度、消息队列等技术,有高并发系统开发经验;
5.良好的沟通与协作能力,能够推动跨团队合作。
加分项:
1.有 MLOps/LLMOps 平台建设经验,熟悉模型训练、推理、评估等流程;
2.熟悉模型评测方法论,了解主流 Benchmark 与评估框架;
3.对 AI Infra 领域有热情,关注行业前沿…
招聘城市:西安

4.结合腾讯云星脉高性能网络、向量数据库等底层技术,优化AI任务的全链路性能,降低训练与推理延迟;
5.参与AI模型(如模型)的工程化落地,提供分布式训练框架支持,解决模型部署中的性能瓶颈与资源管理问题1;
6.探索AI与云原生技术的结合,推动模型量化、动态批处理(Continuous Batching)等前沿技术的应用;
7.与算法团队、产品团队紧密协作,输出标准化API与开发者工具,提升平台易用性;
8.参与行业生态共建,推动AI平台在金融、游戏、泛娱乐等场景的规模化落地。
岗位要求:
1.精通Golang开发,熟悉C/C++、Python等语言,具备3年以上端开发经验;
2.深入理解Kubernetes架构,有大规模集群管理经验…
招聘城市:北京
岗位职责:
1.负责TTS、ASR、声学前处理、自然语言处理、多模态模型等AI系统的工程开发(包括训练工具和推理引擎的开发、优化、交付等);
2.负责AI系统最新算法的集成、工程化、实际场景效果验证、优化、上线;
3.负责AI相关业务、产品的工程支持,在效果和性能上更好的落地。
岗位要求:
1.本科及以上学历,计算机相关专业,本科毕业有5年以上工作+学习的经验;
2.全面的计算机体系相关知识、基础扎实,有较好的数据结构基&算法基础,具备良好的思维逻辑;
3.精通c/c++/python语言,熟悉golang语言更佳;
4.优秀的分析与解决问题的能力,良好的沟通与团队合作能力;
5.具备一定的分布式系统、微服务架构、数据库…
招聘城市:北京
…SFT、强化学习等训练算法研发,建设高质量视频训练数据及自动化数据生产流程,探索更高效的视频能力学习与对齐方法。
岗位要求:
1.计算机视觉、人工智能、机器学习等相关方向硕士及以上学历,具备扎实的深度学习基础;
2.在视频理解、多模态模型、视觉语言模型或相关方向具有研究或研发经验;
3.熟悉 Transformer、LLM、VLM 等模型架构,对多模态模型训练训练方法有较深入理解;
4.具备较强的算法研究、实验分析与工程实现能力,能够独立推动研究问题从定义到落地;
5.对多模态基础模型及视频智能方向有强烈兴趣,具备持续探索前沿问题的研究热情。
加分项:
1.有大规模 VLM / Video-LMM 训练训练经验…
招聘城市:北京
…进行模型对齐与调优,强化模型在多轮图文交互中的逻辑推理、指令遵循(Instruction Following)以及细节感知能力。搭建线上 Badcase 监控与数据飞轮反馈闭环,持续打磨并打造极致的交互体验。
岗位要求:
1.计算机科学/软件工程/人工智能等相关专业硕士及以上学历;
2.深入理解 Transformer 架构及语言模型训练原理,在 LLM Alignment、RLHF、Reward Modeling、个性化模型(Personalized LLM)、记忆机制(Memory/RAG)等训练领域之一有深入的研究和实践经验;
3.在用户画像建模、推荐系统与模型结合、或超长上下文/长期记忆模型优化方面有丰富实战经验者优先;
4.具备扎实的算法基础和工程实现能力,熟练掌握 Python,熟悉 PyTorch/TensorFlow 等深度学习框架;
5.拥有分布式训练实战…
招聘城市:北京
算法研究,探索下一代语音、音频生成新范式,拓展语音生成边界能力;
2.探索多模态语音模型的前沿技术,结合文本、语音、视觉等技术提升语音交互体验;
3.负责语音模型的技术研发工作,推动模型性能提升与创新应用。
岗位要求:
1.计算机科学、人工智能、电子工程、信号处理等相关专业硕士、博士研究生;
2.掌握语音模型、语音合成、语音识别、音频生成、语音转换、语音Codec等一项或多项研究和开发经验;
3.熟悉主流对话模型(如GPT4o、GLM-4-Voice、Qwen2.5-Omni、Voila等),有相关项目实践经验者优先;
4.熟练掌握PyTorch等深度学习框架,有模型训练框架Megatron/Deepspeed实践经验者优先;
5.熟悉模型相关结构设计及原理,有大规模预训练训练
招聘城市:深圳
…负责语言模型在AI原生搜索引擎上的优化和落地;
2.建设AI原生搜索系统,包括模型在内容理解、召回、排序、时效性、权威性、query分析等模块的应用落地;
3.调研业界前沿算法,包括模型引用预估、搜索领域训练、LLM for ranking&retrieval,Listwise/setwise ranking等前沿技术在搜索引擎理的研究和应用;
4.参与产品讨论,基于技术对产品提出改进建议。
岗位要求:
1.有语言模型应用经验优先,包括精调(SFT)、强化(GRPO)等技术的落地;
2.有RAG或LLM Agent的应用落地经验者优先;
3.熟悉搜索系统模块,有内容理解、召回、排序、时效性、权威性、query分析等落地经验优先;
4.熟悉TensorFlow,Keras,Pytorch等常规深度学习框架;
5.熟悉自然语言处理方向…
招聘城市:北京
岗位职责:
1.主导 Visual2Code 能力建设:负责多模态语言模型在 Visual2Code 方向的核心算法研发,围绕“视觉输入—代码理解—代码生成—执行验证”完整链路,持续提升模型从界面、图表、文档、图像等视觉信息中理解结构并生成高质量代码的能力;
2.建设高质量数据体系:负责 Visual2Code 训练数据的设计、构建与迭代,包括真实数据挖掘、自动化数据合成、难度分层、质量过滤及数据配比等,建立覆盖多场景、多语言、多任务形态的数据生产与数据飞轮体系;
3.推进模型算法创新:深入探索 Visual2Code 场景下的 SFT、强化学习、代码执行反馈、Verifier/Reward Model 等训练方法,研究视觉理解、代码推理与执行反馈之间的协同机制,持续提升模型在复杂任务中的正确率、泛化能力与稳定性…